11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
豆包发布1.0音频生成模型,革新传统制作流程;Cursor转型综合性开发者平台;企业微信内测AI Agent“大圆”,主打办公提效;阿里云推“峰谷Token”实现成本优化。这些动态显示AI正深度融入办公、开发与商业化,加速从工具向生产力转型。
在火山引擎FORCE原动力大会上,豆包大模型2.1 Pro、豆包视频生成模型 Seedance 2.5、Seedance 2.0 4K版、豆包图像创作模型Seedream 5.0 Pro、豆包音频生成模型1.0五大模型集中亮相。 其中,豆包音频生成模型1.0(Seed-Audio 1.0)正式发布,大幅降低高质量语音内容的规模化生产门槛。 豆包音频生成模型1.0支持在一次生成中同步编排角色对白、情绪语气、方言口音、背景音乐及拟音特效,一
今天举办的2026火山引擎FORCE 原动力大会上,字节跳动发布全新AI视频生成工具Seedance 2.5,这款模型目前处于企业内测阶段,预计7月初正式上线。 上一代Seedance 2.0最长只能生成15秒视频,新版本直接把单次成片时长翻倍,原生就能输出完整30秒视频,做连贯长镜头、完整小故事不用分段拼接,画面叙事流畅度提升很多。 参考素材上限也大幅放宽,2.0版本一次最多只能导入12份图
【AI日报】今日AI领域重要动态:1)阿里开源支持链式推理的音频生成模型ThinkSound,实现高保真空间音频生成;2)谷歌Veo3升级,支持静态图片生成生动视频;3)Hugging Face发布30亿参数小模型SmolLM3,性能优于Llama-3.2-3B;4)阿里开源网络智能体WebSailor,展现强大推理和检索能力;5)Moonvalley发布原生1080P视频生成模型Marey Realism v1.5;6)Vidu Q1支持最多七张参考图像生成一致性视频;7)苹果�
百度推出全球领先的视频生成模型Baidu Steamer-I2V,以89.38%综合评分登顶VBench榜单。该模型通过精准画面控制、高清画质和中文语义优化,能将静态图像转化为连贯动态视频。百度营销平台迎来2周年,已服务超13万家企业,日均生产素材超10万+。在"AI驱动营销全链路升级"主题下,百度与核心代理商共同探讨AIGC技术突破与创意升级,推出"AI创"原生创意大赛。百度商业体系表示将持续巩固传统广告优势,同时突破创意边界,实现营销效果飞跃。未来百度将优化模型性能,拓展应用场景,推动营销行业迈向"一杯咖啡时间完成创意生产"的全智能化时代。
美团近日推出了一款名为妙刷的小程序,妙刷能够根据用户上传的图片,创造出风格迥异的图片和视频,目前部分功能对用户免费开放。妙刷的多样化AI图像玩法包括修图、文本生图、音频生图和视频生成等,这些功能不仅丰富了用户的创意表达方式,也拓宽了艺术创作的边界。通过这款小程序,每个人都能激发灵感,成为创意的实践者,让平凡的景象焕发出新的生命力。
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://top.aibase.com/1、震惊AI界!14、微软研究院推AI框架E5-V:用文本对的单模态训练简化多模态学习降低成本微软研究院与北京航空航天大学联合推出的E5-V框架通过单模态训练简化多模态学习,降低成本,在多个任务中展现出优异性能,代表了多模态学习的重大进步。
Runway前脚刚发布Gen-3Alpha,Google后脚就跟了个王炸。北京时间6月18日凌晨,GoogleDeepmind发布了视频生成音频技术的进展,可以为视频创建戏剧性的背景音乐,逼真的音效,甚至是人物之间的对话。届时我们估计能看到AI圈“大混战”——Runway的Gen-3Alpha刚生成一个视频,隔壁V2A就给它把音乐配好了;Meme变视频还没玩够呢,用户们已经等不及给它配上声音了。
AniTalker是一个创新的开源项目,它能够通过静态肖像画和输入的音频信号生成生动的面部说话视频。这个工具不仅实现了嘴唇的动作同步能够捕捉到丰富的面部表情和非言语线索的复杂动态,为虚拟角色赋予了更加真实和自然的表现力。无论是制作电影、游戏还是在线教育视频,AniTalker都能够提供高效、低成本的解决方案。
audio2photoreal是一个开源项目,专注于从音频生成照片级逼真的avatar。它包含一个基于pytorch的实现,可以从音频中合成交谈中的人类形象。要获取更多详细信息并开始您的AI头像生成之旅,请访问audio2photoreal官方网站。