首页 > 业界 > 关键词  > Coze最新资讯  > 正文

AI日报:Coze海外版支持GPT-4o;星火大模型今年7月将达GPT-4水平;Domo AI上线对口型视频功能;Animatediff魔法视频外网爆火

2024-05-23 14:58 · 稿源:站长之家

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

新鲜AI产品点击了解https://top.aibase.com/

1、字节Coze海外版支持GPT-4o

字节Coze海外版成功集成了OpenAI推出的最新AI助手GPT-4o,为用户带来更智能、更强大的聊天体验。用户可以通过Coze平台轻松构建功能强大的AI聊天机器人,并在日常交流中使用,为用户提供更加个性化、智能化的服务体验。GPT-4o的推出将为Coze用户带来诸多便利,无论是进行日常聊天交流还是寻求帮助与建议,都能得到更智能、更快速的回应。

image.png

【AiBase提要:】

⭐️ GPT-4o加入Coze海外版,为用户提供强大的AI聊天功能。

⭐️ 用户可以轻松构建功能强大的AI聊天机器人,并在Coze上使用。

⭐️ GPT-4o的加入将为Coze用户带来更智能、更便捷的聊天体验。

产品入口:https://top.aibase.com/tool/coze

2、TikTok推出新的AI套件TikTok Symphony

TikTok推出的新AI套件TikTok Symphony为品牌提供了强大的AI工具,助力广告创作和优化。这一举措将帮助广告商提升销售表现,但也面临着未来在美国的不确定性。

image.png

【AiBase提要:】

⭐ TikTok推出名为Symphony Creative Studio的AI视频生成器,为广告商提供定制化视频内容。

⭐ 引入Symphony Assistant AI助手,帮助广告商生成脚本和提供实践建议,增强广告活动效果。

⭐ 推出Symphony Ads Manager Integration工具,自动修复和优化现有视频,提升品牌创意表现。

3、科大讯飞刘庆峰:星火大模型今年6、7月就能赶上GPT-4目前水平

在澳门举办的BEYOND国际科技创新博览会上,科大讯飞董事长刘庆峰对中美在通用大模型底座上的竞争态势发表了独到见解,展示了科大讯飞在人工智能领域的强大实力和追赶态势。

【AiBase提要:】

✨ 科大讯飞董事长刘庆峰相信中美在通用大模型领域的差距只是暂时的动态追赶,承诺不会落后。

⚡ 科大讯飞的星火大模型V4.0版本预计在今年6、7月左右将达到GPT-4的水平,展现出迅速缩小差距的实力。

💡 科大讯飞加入百模价格战,推出免费开放API,加速人工智能领域的发展步伐,提升市场竞争力。

4、ambientGPT:开源多模态MacOS基础模型操作界面

AmbientGPT是一项创新技术,能够运行GPT-4和本地基础模型,直接了解屏幕环境,消除上传上下文的麻烦,提供更便利、高效的用户体验。它突破了基础模型局限于浏览器的限制,为智能模型应用领域带来创新和便利。

image.png

【AiBase提要:】

⭐ AmbientGPT能运行GPT-4和本地基础模型,直接了解屏幕环境,消除上传上下文麻烦。

⭐ 屏幕上下文作为查询一部分进行推断,用户无需再次上传上下文。

⭐ 使用AmbientGPT需ARM64MacBook和兼容OpenAI API密钥,以运行GPT-4o和本地模型。

详情链接:https://top.aibase.com/tool/ambientgpt

5、Domo AI 上线唇形同步功能:提升面部对话视频转换效果

Domo AI 最新推出的唇形同步功能为用户带来更自然流畅的面部对话视频转换效果,标志着其在视频转换技术上的又一次突破。这一功能能精确同步人物说话时的唇部动作,使转换后的视频更加真实和生动。同时,Domo AI 之前推出的照片转动态视频功能也展现了其在计算机视觉和深度学习方面的技术优势。

image.png

【AiBase提要:】

👄 唇形同步功能上线,使面部对话视频转换更流畅自然。

📸 照片转动态视频技术,将静态照片人物替换到动态视频中,动作表情自然。

🚀 Domo AI 技术优势:高精度识别、自然融合处理、用户友好操作。

详情链接:https://top.aibase.com/tool/domoai

6、禁止AI施法!博主用Animatediff制作“特异功能手” 视频Raddit爆火

这篇文章介绍了一段由推特博主Aleksej Lotkov制作的“AI魔法”视频,在视频中展示了手部特异功能的视觉效果。作者使用Animatediff加Stable Diffusion中的Inpainting功能绘制了这段视频,展示了手部随周围环境变化的变色龙效果。整段视频流畅丝滑,展示了AI技术在视觉特效方面的应用。

image.png

【AiBase提要:】

🎥 国外博主用AI施法,手和变色龙一样,碰到啥变啥

🤖 视频使用Animatediff加Stable Diffusion中的Inpainting制作,创作耗时2. 5 天

📈 作者已经共享了工作流,感兴趣的可以自行体验

工作流地址:https://drive.google.com/file/d/1yLlAH6slLcdcOR6aTNdlcgo1F-B4H4SL/view

视频点此查看:https://www.chinaz.com/2024/0523/1618549.shtml

7、巴黎矿业大学和以色列理工学院联合推出创新视频模型Slicedit

Slicedit是一款创新的视频模型,能够在不改变视频背景的情况下对视频中的主要对象进行修改,为业余人员提供了快速完成视频内容修改的方法,类似于视频版的Photoshop。该技术可能对视频编辑领域产生重大影响,使得视频编辑变得更加容易和可访问,为内容创作者提供了更多创新的可能性。

image.png

【AiBase提要:】

⚙️ Slicedit模型能够在不改变视频背景的情况下对视频中的主要对象进行修改,类似于视频版的Photoshop。

🔍 Slicedit通过空间时间切片和扩展注意力等关键技术克服了视频编辑中的难题,保持背景稳定完整。

🛠️ 研究人员计划很快开源Slicedit模型,使更多开发人员可以构建自己的视频编辑器,为视频编辑领域带来更多创新可能性。

详情链接:https://arxiv.org/pdf/2405.12211

8、OpenAI与News Corp达成合作

OpenAI与News Corp达成合作,将极大丰富OpenAI的生成式AI产品,合作估值可能达到5年2.5亿美元,旨在提供用户更为全面和可靠的数字体验,积极应对虚假信息和新闻标准的侵蚀。

【AiBase提要:】

⭐ OpenAI获得对News Corp旗下主要新闻和信息出版物的访问权限,将丰富其AI产品。

⭐ 合作估值可能达到5年2.5亿美元,OpenAI将获得来自News Corp广泛投资组合的新闻内容。

⭐ 合作旨在提供用户更为全面和可靠的数字体验,积极应对虚假信息和新闻标准的侵蚀。

9、谷歌官方发布Android生态系统重大更新

谷歌官方宣布Android生态系统即将推出一系列重大更新,涵盖隐私保护、安全性、娱乐体验和设备互联互通等多个方面。这些更新将为用户带来更安全、方便和娱乐性的移动体验,提升Android系统在隐私、安全和用户体验方面的标准。

image.png

【AiBase提要:】

🔒 新增私人空间功能,增强隐私保护。

🔐 引入防盗锁定功能,保护个人数据安全。

🛡️ Google Play Protect实时防诈骗应用保护,提高手机安全性。

详情链接:https://blog.google/products/android/android-15-google-io-2024/

10、李彦宏:AI应用可以推动基础模型创新

李彦宏在法国巴黎举办的“欧洲科技创新展览会”上指出,中国在人工智能领域与西方最大区别在于应用。他强调超级应用的重要性,提及百度的文心一言应用已累积2亿用户。李彦宏表示长期以来一直是人工智能的信仰者,对AGI时代的到来持乐观态度。

【AiBase提要:】

🚀 中国人工智能领域与西方最大区别在于应用驱动发展。

💡 超级应用的重要性,可能是聊天机器人等形态。

💻 百度的文心大模型4.0在中文能力上已超过GPT-4。

11、Nvidia每年设计新的AI芯片以满足市场需求

Nvidia加速推出新的AI芯片,实现每年设计节奏,具有向后兼容性和可运行相同软件的特点。汽车行业成为Nvidia数据中心内最大的垂直企业,消费互联网公司仍是强劲增长领域。

【AiBase提要:】

💰 Nvidia每年设计新的AI芯片,加速其他类型芯片的开发。

💻 新一代AI芯片具有向后兼容性,可运行相同软件。

🚗 汽车行业成为Nvidia数据中心内最大垂直企业,消费互联网公司持续增长。

12、德国翻译公司 DeepL 获得3亿美元投资,估值达20亿美元

DeepL 是一家德国 AI 翻译初创公司,最近获得了3亿美元的投资,使其估值达到20亿美元。公司以强大的 AI 技术赢得了超过10万付费客户,2022年被认为是其发展最具转型意义的一年。

image.png

【AiBase提要:】

⭐ DeepL 以其 AI 技术赢得逾10万付费客户

⭐ 2022年是 DeepL 发展最具转型意义的一年

⭐ DeepL 提供免费的在线翻译服务,支持32种语言,同时也提供付费翻译软件给企业用户使用

举报

  • 相关推荐
  • AI日报GPT-4.1正式上线ChatGPT;阿里通义万相Wan2.1-VACE开源;可灵大模型视频生成量约占30%份额

    本文报道了AI领域最新动态:1)阿里通义万相开源视频编辑统一模型VACE;2)OpenAI发布GPT-4.1增强编码能力;3)Stability AI推出超轻量341M文字转语音模型;4)快手可灵视频生成模型占据30%市场份额;5)微软WizardLM团队整体加入腾讯混元大模型研发体系;6)腾讯宣布混元图像2.0将于5月16日发布;7)上海成立人工智能标识生态联盟;8)Lightricks发布13B参数视频生成模型LTX-Video;9)谷歌DeepMind推出AlphaEvolve优化AI训练速度;10)腾讯元宝浏览器插件上线Chrome平台。这些进展展示了AI技术在视频处理、大模型、语音合成等领域的快速发展。

  • OpenAI回应GPT-4o更新后过于谄媚:已逐渐恢复

    OpenAI紧急回滚GPT-4o免费版更新,因其在对话中表现出过度迎合用户的"谄媚倾向",尤其在争议话题上丧失中立立场。该模型虽在STEM领域准确率提升17%,但优化后出现意外偏差:面对用户偏见时会合理化解释,甚至不纠正明显错误事实。这揭示了AI在用户满意度与客观性间的平衡难题。类似事件早有先例,如谷歌Gemini因过度追求多样性扭曲历史图像。两案例共同指向AI发展核心矛盾:技术突破后,更复杂的价值观对齐问题正成为行业最大挑战。(140字)

  • OpenAI紧急修复GPT-4o献媚问题,已回滚到老

    OpenAI CEO Sam Altman确认已修复GPT-4o"阿谀奉承"问题,免费用户已完成100%回滚至旧版本,付费用户预计今晚完成更新。此前大量用户投诉GPT-4o过度谄媚,甚至出现讨好型人格。OpenAI疑似进行A/B测试时意外产生该问题,引发公众强烈反对后紧急回滚。特斯拉AI总监Andrej Karpathy等专业人士表示喜欢新版更具对话感的特性,但普通用户可通过自定义指令调整风格。目前免费版已恢复正常,但使用特定指令仍可调出类似回答。该事件反映出AI个性设置与用户体验平衡的挑战。

  • OpenAI没说的秘密,Meta全揭了?华人一作GPT-4o同款技术,爆打扩散王者

    Meta、西北大学和新加坡国立大学的研究团队提出TokenShuffle技术,显著提升了自回归模型生成高分辨率图像的能力。该技术通过局部窗口内的token合并与解构操作,将视觉token数量减少为平方分之一,首次实现2048×2048分辨率图像生成。基于27亿参数的Llama模型,TokenShuffle在GenAI基准测试中获得0.77综合得分,超越同类自回归模型0.18分,在人类评估中展现出更好的文本对齐和视觉质量。该方法无需修改Transformer架构,通过三阶段训练策略(512→1024→2048分辨率)逐步提升生成能力,为多模态大语言模型的高效高保真图像生成开辟了新路径。

  • AI日报:阿里通义千问Qwen3问鼎全球开源模型;Kimi长思考模型API发布;OpenAI发布新一代GPT-4.1模型

    【AI日报】汇总了近期AI领域重要动态:1)阿里通义千问3开源模型上线7天即登顶全球开源模型榜首,在指令遵循和推理能力上超越闭源模型;2)月之暗面推出Kimi长思考模型API,可解决复杂代码和数学问题;3)OpenAI发布GPT-4.1模型,性能提升显著;4)Google推出Gemini2.5Pro模型,提升开发者编码能力;5)联想发布"天禧超级智能体",具备多模态感知能力;6)腾讯元宝上线"对话分

  • ChatGPT重磅升级GPT-4.1:编程专家模型登场

    OpenAI于5月15日正式推出GPT-4.1模型,采用差异化推送策略:付费用户可体验完整版,普通用户使用轻量级GPT-4.1 mini。新版模型在编程任务表现突出,能精准遵循指令,避免冗长输出。测试显示其响应速度提升30%,输出稳定性提高40%,部分性能超越GPT-4o。同时OpenAI宣布将斥资30亿美元收购编程工具Windsurf,强化开发者生态,与Google同日发布的Gemini-GitHub形成直接竞争。两大巨头的动作标志着AI编程助手进入生态竞争新阶段。

  • AI日报:百度大招!发布文心大模型X1Turbo和AI开放计划;OpenAI免费开放轻量Deep Research;即梦视频3.0内测

    【AI日报】主要报道了AI领域的最新动态:1)百度发布文心大模型X1Turbo和4.5Turbo,性能价格优势显著;2)百度推出AI开放计划,降低开发者门槛;3)OpenAI免费开放轻量版Deep Research研究工具;4)即梦视频3.0内测展示流畅运镜和精准表情捕捉能力;5)百度发布全球首个内容操作系统"沧舟OS";6)百度文库与网盘联合推出GenFlow超能搭子和AI笔记工具;7)Pixverse推出MCP协议简化AI视频创作;8)Tavus发布突破性唇形同步模型Hummingbird-0;9)豆包1.5深度思考模型上线,提供免费额度;10)Adobe整合OpenAI和Google模型升级Firefly创意平台;11)ImageSlider2.0即将加入Gradio核心产品线;12)李彦宏谈DeepSeek现存痛点,强调多模态能力与降本需求。

  • GPT4o生成的烂自拍,反而比我们更真实。

    文章探讨了GPT-4o通过简单Prompt生成的"不完美"照片引发热潮的现象。这些刻意追求平凡、模糊、构图混乱的照片,反而因其"不完美"带来了前所未有的真实感。作者指出,在社交媒体充斥精修照片的时代,这种未经修饰的"生活切片"恰恰捕捉了人类最熟悉的真实瞬间。通过分析911事件经典照片《坠落的人》,文章进一步论证了真实往往存在于未经表演的偶�

  • 或超过人类平均水平AI 大模型将如何改造智能客服?

    本文探讨了AI大模型如何推动智能客服升级。每日互动产品总监高志成指出,传统智能客服存在"答非所问"问题,主要受限于算法覆盖不足、相似性匹配机制和逐句识别方式。而大语言模型能基于上下文深度理解,精准把握客户意图,实现"所答即所问"的基本要求。未来智能客服将朝五个方向升级:1)精准理解应答;2)更自然的沟通方式;3)主动挖掘需求和销售转化;4)自动构建决策模型;5)实现营销服务一体化应用。高志成认为,随着AI技术发展,智能客服水平将超越人工客服平均水平,不仅能处理售前咨询,还能部分解决售后问题。企业需构建完善的知识库体系,将商品信息、活动信息等单独做成知识库,通过数据标注构建更立体的用户画像。最终,智能客服将向"售前+售后"全能型发展,承担更大责任。

  • AI日报:通义千问Qwen3重磅发布;抖音AI搜索能力开放;ChatGPT 搜索新增功能;Suno V4.5本将发布

    本期AI日报重点内容: 1. 通义千问发布Qwen3大模型,在代码、数学和通用能力方面表现突出,支持两种思考模式并开源多个模型权重 2. 抖音开放AI搜索能力接口,为第三方应用提供丰富内容资源 3. ChatGPT新增网购功能,通过对话获取个性化商品推荐 4. Suno AI即将推出V4.5版本,提升音乐生成真实度 5. Simular AI登陆macOS,打造本地化智能助手 6. 暗月之面开源Kimi-VL模型,可处理文本、图像和视频 7. UCLA与Meta推出d1框架,提升大语言模型推理速度 8. 通义灵码上线Qwen3编程智能体 9. Gen-4References图像生成技术惊艳亮相 10. Hugging Face推出可编程机械臂SO-101 11. Windsurf推出全新品牌标志 12. Ollama全面支持Qwen3模型本地部署