11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
xAI发布Imagine Image 2.0,支持多图融合与智能扩图;抖音来客新增酒店类目服务费。阿里Meoo、微信朋友圈“AI帮写”、腾讯WorkBuddy手机端相继上线。阿里千问开放平台覆盖多终端与生活服务。英伟达开源全双工语音模型VoiceChat 11B;OpenAI推出ChatGPT语音操控桌面功能。
本期AI日报聚焦八大突破:京东开源实时视频编辑模型;阿里千问图像生成开放API;腾讯混元语音识别读懂语境;字节全双工SeedRealtime上车豆包;马斯克Grok 4.6将灌入SpaceX数据;影石硬件联手千问推出语音助手;Mistral开源3B多模态审核模型Shieldstral;宇树科技机器人冲刺科创板IPO。
微软推出支持16语言的全双工语音模型MAI Realtime;MiniMax开源视频模型H3但限制部分地区使用;商汤发布轻量统一多模态模型U1.5-Lite-Preview;面壁智能开源ForgeStencil实现工业软件自动化优化;Teams新增“举报会议”功能防AI诈骗;ChatGPT Atlas浏览器将停服;苹果诉OpenAI案曝内部数据管理漏洞;高德升级世界模型ABot-World-0,实现24小时连续稳定推理。
2026年8月3日,港股MINIMAX-W(00100.HK)报HK$249.4,涨幅超10%。当日早盘,MiniMax盘前正式宣布发布新一代多模态生成模型H3。市场用真金白银为这次产品发布投了一票。 A 天下苦闭源模型久矣,视频生成赛道此前由Seedance、可灵等头部模型主导,价格、算力、生成时间也一直是行业关注比较高的的话题。 MiniMax发布的H3,正是视频生成市场的一个全新选择。 官方博客中表示,定位H3
MiniMax 今日正式开源新一代通用视频模型 MiniMax H3,这款模型被定位为通用型全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高2K 分辨率、最长15秒、带原生立体声音频的视频内容。 得益于以任务泛化为导向的系统设计,H3在预训练阶段便具备了广泛的多模态上下文理解与生成能力,官方称其能够出色地遵循复杂的多模态指令。输出规�
近期AI动态:MiniMax发布全模态模型H3,成本仅为竞品1/3;字节跳动Seedance 2.5视频生成支持30秒长叙事;DeepSeek V4 Flash上线,130亿参数瞄准Agent赛道;DeepMind推出Gemini Robotics ER2,突破多机器人协同;谷歌地球集成AI图像生成;华为开源5050亿参数盘古大模型;阿里千问发布专业语音识别模型;特斯拉中国车机接入豆包大模型。
腾讯发布科研智能体Hyra-1.0,打通AI研发与科学发现。阿里推出Qwen-Image-3.0,支持4.5K超长文本与复杂图文生成。马斯克将Grok嵌入Excel,实现智能数据分析。Adobe推出AI相机工具Project Indigo。小鹏发布TuringViT高效视觉编码器。YouTube严打低质AI内容。《第九区》导演推出首部AI微电影。阿里拟推“千问办公”,整合三种智能体布局企业市场。
今日,阿里发布最新图像生成基础模型Qwen-Image-3.0。 新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面。 同时,该模型还支持12国语言和20多款字体原生渲染,字字清晰,大幅降低多语言产品海报、影视/漫画分镜等可读可用”商业素材的生产成本。 据悉,Qwen-Image-3.0是千问图像生成和编辑模型系列的�
歌尔丹拿与IMAX达成战略合作,将推出全球首款IMAX车载娱乐系统。该系统集多维声学与高清显示于一体,旨在将汽车打造为移动影院。双方还将围绕游戏、影音等多元内容拓展智能汽车娱乐场景。首套系统预计2026年底落地,将面向高端汽车制造商推广。
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、灵光App“灵光圈”社区焕新:上线热榜、关注等功能,PC端支持导入文档及音视频素材灵光App对灵光圈社区进行功能升级,新增热榜、编辑精选和关注创作者等功能,同时在PC端�