AI日报：可灵AI发布数字人新功能；腾讯混元新技术给大模型 “去油”；抖音上线AI求真功能

2025-09-18 16:19 · 稿源：站长之家

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创新AI产品应用。

新鲜AI产品点击了解：https://app.aibase.com/zh

1、可灵AI发布数字人新功能：一张图片生成 1 分钟高清视频

可灵AI推出的数字人功能实现了从静态图片到动态视频的突破，用户只需提供角色图片和文字或音频输入，即可快速生成高质量视频。该技术基于多模态理解和视频生成模型，支持多种角色创建和多语种处理，为内容创作、教育培训和企业宣传提供了新的可能性。

【AiBase提要:】
📷 可灵AI推出数字人功能，实现静态图片到动态视频的转变。
🎙️ 支持多语种处理，涵盖中文、英语、日语、韩语等语言。
💡 降低视频制作门槛，让普通用户也能轻松创建专业水准的数字人视频。
详情链接:https://klingavatar.github.io/

2、腾讯混元新技术给大模型 “去油”，让AI生成图像更真实！

腾讯混元团队与香港中文大学（深圳）及清华大学合作，推出了SRPO技术，旨在提升AI生成图像的真实感，解决Flux模型在人物皮肤质感上的问题。该技术引入了“语义相对偏好优化”策略，并采用Direct-Align策略优化生成轨迹，显著提升了图像质量与训练效率。

【AiBase提要:】
🧪 引入“语义相对偏好优化”策略，通过正向和负向词汇引导信号以中和奖励模型的偏差。
📈 采用Direct-Align策略，注入可控噪声并利用其作为参考锚点进行图像重建，显著降低重建误差。
⚡ SRPO技术训练效率极高，仅需10分钟便能超越现有方法，真实度和美学评分提升超过三倍。
详情链接:https://tencent.github.io/srpo-project-page/

3、IBM 发布 Granite-Docling-258M:开源企业级文档 AI 模型

IBM 推出的 Granite-Docling-258M 是一个开源的视觉语言模型，专注于端到端文档转换。它能够保持文档的布局信息，提取表格、代码、公式等元素，并输出结构化的机器可读格式，相较于传统 OCR 技术有显著提升。

【AiBase提要:】
🌟 新模型 Granite-Docling-258M 旨在提高文档转换精度，并保持布局信息。
🔧 采用先进的技术架构，相较于前版本 SmolDocling 在多个领域表现出色。
🌍 新增对多种语言的支持，增强了模型的应用范围和灵活性。
详情链接:https://huggingface.co/collections/ibm-granite/granite-docling-682b8c766a565487bcb3ca00

4、Meta发布首款带屏幕AI眼镜Ray-Ban ：随身佩戴的智能助理

Meta 推出首款带屏幕的 AI 眼镜 Ray-Ban，旨在提供更便捷的智能体验，并与神经腕带结合实现精准操控，进一步减少对移动设备的依赖。

【AiBase提要:】
📱 右侧镜片内置显示屏，可呈现应用程序、提醒和导航信息。
🧠 与神经腕带搭配使用，通过肌电图技术实现精准操控。
🌐 支持连接云端，可在眼镜上使用 Meta 旗下应用及查看路线和实时翻译。

5、DeepSeek 论文登上 Nature 封面，AI 大模型首次通过同行评审

DeepSeek R1的研究论文成功登上《Nature》封面，标志着大语言模型首次通过权威同行评审，为AI行业树立了新的学术标准。该模型通过强化学习实现自主演化，提升了推理能力，并在数学竞赛中表现出色。

【AiBase提要:】
🧠 DeepSeek R1通过强化学习在自主环境中自我演化，发展出复杂的推理能力。
📊 在AIME2024数学竞赛中，DeepSeek-R1的表现从15.6%跃升至71.0%，达到与OpenAI模型相当的水平。
🛠️ DeepSeek团队采用了结合拒绝采样和监督微调的多阶段训练框架，提升模型写作能力和整体表现。

6、OpenAI宣布ChatGPT 网页端新增 GPT-5 Thinking 调整功能

OpenAI推出了全新的‘Thinking 调整功能’，允许用户根据需求选择GPT-5模型的思考时长，从而平衡回复速度与智能程度。此外，OpenAI还在积极开发儿童版ChatGPT，以确保未成年人使用安全。

【AiBase提要:】
🌟 新功能上线：ChatGPT网页端推出可调节思考时长的功能，提升用户体验。
🛠️ 多种模式选择：用户可以选择标准、扩展、轻量或重度模式，以满足不同的交流需求。
👶 儿童版开发：OpenAI正在研发儿童版ChatGPT，确保未成年人在使用中的安全。

7、抖音上线 “AI求真” 功能，助你辨别谣言，寻找真相！

抖音推出“AI求真”功能，旨在帮助用户辨别谣言并寻找真相，提升信息透明度和用户保护能力。

【AiBase提要:】
🧠 AI 抖音求真功能上线，帮助用户识别和澄清误导性信息。
🔍 用户可点击链接跳转至“求真卡”页面获取完整信息。
📢 平台通过谣言治理大模型和辟谣团队提升信息透明度。

8、通义DeepResearch发布！全开源AI模型让研究更简单

通义 DeepResearch 团队发布的全开源AI模型在多个权威基准测试中表现出色，其性能甚至超过了许多国际知名模型，同时通过开放的方式推动了AI研究的发展。

【AiBase提要:】
🧠 通义 DeepResearch 团队发布了全开源AI模型，使AI从“能聊天”跃升至“会做研究”。
🚀 在多个权威基准测试中取得先进成绩，模型性能超越许多国际知名模型。
🌐 模型、框架及方案完全开源，为全球科技社区提供开放合作的范例。

（举报）

相关推荐

关键词：

NuwaAI V1.0发布！一句话生成数字人，全面升级数字生产力

在2025年中国国际高新技术成果交易会上，邦彦技术股份有限公司发布NuwaAI V1.0，实现"一句话生成可执行任务的数字人"核心功能。用户通过自然语言指令即可生成具备身份设定、表达能力和完整任务执行流程的数字人，覆盖教育、商业、媒体等场景。该系统支持自动规划内容结构、协调节奏，并能执行发布会主持等全流程工作，标志着数字人从"内容展示"向"任务执行体"的重要转变，为行业提供可持续的生产力工具。

数字人 NuwaAI V1.0
荐AI日报：HeyGen发布AI视频翻译引擎；科大讯飞推星火 X1.5；QQ浏览器推出AI+小窗

本期AI日报聚焦多项技术突破：HeyGen推出精准唇形同步的视频翻译引擎；科大讯飞发布星火X1.5大模型，提升多语言处理能力；QQ浏览器新增AI助手浮窗；科大讯飞推出软硬一体方案，实现高噪声环境精准识别；谷歌Gemini 3 Pro预览版支持百万级上下文窗口；Comfy Cloud让Stable Diffusion实现零门槛创作；谷歌Gemini新增深度研究功能，可整合邮件生成智能报告；上海AgiBot机器人10分钟完成复杂制造任务，重塑生产效率。

AI视频翻译唇形同步跨语言本地化
荐AI日报：阿里千问APP公测；Veo 3.1上线多图参考；超级小爱AI大模型“随心修图”上线

本期AI日报聚焦多项技术突破：阿里千问APP公测，基于Qwen3模型对标ChatGPT；谷歌Veo 3.1支持三图融合生成8秒视频；小米推出"随心修图"功能与7B多模态模型Miloco；谷歌Flow集成Nano Banana模型实现智能抠图；多模态AI工具DeepEyesV2可执行代码与网络搜索；NotebookLM升级支持图像导入检索；JetBrains推出DPAI Arena测试编码AI性能。全球AI竞争持续升温，产品迭代加速。

AI 阿里巴巴千问APP
荐Sora App的AI视频社交，给了百度们新希望

Sora2发布两周后，百度的蒸汽机AI视频模型，和谷歌Veo3.1撞了档期。两家公司选择同期发布并非有多默契，而是Sora2带来的压迫感促使它们不得不加快脚步。奥尔特曼将形容Sora2为“创意领域的ChatGPT3.5时刻”，不仅在物理逻辑、画面连贯性、真实感和音画同步等方面实现了质的飞跃，还把Sora从一个“文本到视频”的工具进化成一个“创意到生态”的平台。这无疑是扔在AI视�

文章搜索核心标签 AI视频模型
荐长视频，要MCN化？

过去十多年，长视频平台习惯用头部综艺与大剧撬动增长:内容够强，自然破圈，声量带动会员与广告。这套“内容中心逻辑”曾行之有效。但短视频重写了注意力分配。用户不再愿意投入整段时间追一个叙事，三十秒的情绪刺激就足以满足娱乐需求。内容生命周期被压缩，哪怕是重金制作，也可能上线当周见顶、难以延展。在这种环境下，平台不得不寻找新的增长方式。�

文章搜索核心标签长视频平台
百度世界2025：罗永浩数字人同款慧播星高说服力技术向全球开放

在今日盛大举行的百度世界大会上，百度公司宣布了一项重大举措——“罗永浩”同款慧播星高说服力数字人技术正式向全球开放。百度创始人李彦宏在大会上强调，数字人技术并非简单的应用工具，而是AI时代的一种基础性技术，甚至可能成为全新的通用交互界面，引领未来人机交互的新潮流。据百度公布的数据显示，在今年双 11 购物节期间，慧播星数字人带货成绩斐然，

百度世界大会数字人技术慧播星
百度搜索AI API全面开放绝大多数结果由AI生成

11月13日，百度创始人李彦宏在2025百度世界大会上宣布，百度搜索已实现绝大多数结果由AI生成，首条结果富媒体覆盖率高达70%。他强调，百度正通过AI技术深度重构搜索结果页，从传统文字链接模式转向以图片、视频等富媒体内容为核心的AI应用。李彦宏指出，百度是全球搜索引擎中对AI化改造最激进的，正引领行业进入全新时代。他还表示，企业需善用AI方能立于不败之地，个人也需掌握AI技能以掌控未来。目前，百度已通过AI+API开放搜索能力，与三星、荣耀、vivo等主流厂商建立合作，共同探索AI搜索的无限可能。

百度世界大会 AI生成富媒体
荐AI日报：xAI推出Grok 4.1；OceanBase发布首款AI数据库seekdb；Kimi K2成功接入Perplexity

本期AI日报聚焦多项技术突破：蚂蚁集团"灵光"AI助手实现30秒生成可编辑应用；xAI推出免费Grok 4.1模型显著提升质量与速度；Poe推出200人群聊功能支持多模型协作；OceanBase发布首款AI数据库seekdb实现混合搜索；国产模型Kimi K2接入Perplexity展现国际竞争力；谷歌DeepMind推出通用智能体SIMA2在3D游戏中任务完成率达62%；ElevenLabs升级为一站式内容生成平台；昆仑万维推出轻量级多模态智能体Skywork R1V4-Lite，用户拍照即可自动完成任务。

AI助手蚂蚁集团灵光App
破局传统服务模式丨绿岛风AI战略瞄准产业数字化未来

广东绿岛风空气系统公司与中山大学签署AI智能设计系统合作协议，将整合企业数十年项目经验与高校科研实力，共同研发行业领先的"设计大脑"。该系统旨在解决传统通风行业设计环节效率低、沟通成本高等痛点，实现"沟通即设计"服务模式，大幅缩短方案确认时间。此次合作是绿岛风深化产学研融合的重要举措，通过校企联动推动技术革新，为行业数字化升级注入新动能。
荐AI日报：百度发布文心5.0；可灵2.5Turbo模型上线“首尾帧”功能；微博推出 VibeThinker-1.5B

本期AI日报聚焦多项技术突破：OpenAI推出GPT-5.1，提升对话自然度与响应速度；百度发布原生全模态大模型文心5.0，支持跨文本图像生成；微博开源VibeThinker-1.5B模型，以低成本实现高效推理；可控视频生成模型新增首尾帧控制功能；李飞飞团队推出商用3D世界生成工具Marble；东北大学开源多语言翻译模型支持60种语言；谷歌Gemini语音功能升级实现更自然交互；阿里启动“千问”项目对标ChatGPT，全面布局C端AI应用竞争。

AI视频生成可灵2.5Turbo 首尾帧功能

今日大家都在搜的词：

热文

3 天
7天

AI日报：可灵AI发布数字人新功能；腾讯混元新技术给大模型 “去油”；抖音上线AI求真功能

NuwaAI V1.0发布！一句话生成数字人，全面升级数字生产力

荐AI日报：HeyGen发布AI视频翻译引擎；科大讯飞推星火 X1.5；QQ浏览器推出AI+小窗

荐AI日报：阿里千问APP公测；Veo 3.1上线多图参考；超级小爱AI大模型“随心修图”上线

荐Sora App的AI视频社交，给了百度们新希望

荐长视频，要MCN化？

百度世界2025：罗永浩数字人同款慧播星高说服力技术向全球开放

百度搜索AI API全面开放绝大多数结果由AI生成

荐AI日报：xAI推出Grok 4.1；OceanBase发布首款AI数据库seekdb；Kimi K2成功接入Perplexity

破局传统服务模式丨绿岛风AI战略瞄准产业数字化未来

荐AI日报：百度发布文心5.0；可灵2.5Turbo模型上线“首尾帧”功能；微博推出 VibeThinker-1.5B

今日大家都在搜的词：

热文

华为Mate 80系列已在华为商城开启预约

华为Mate 80 Pro Max外观公布：采用双圆环设计

华为Mate 80/Pro/Pro Max/RS开启预约：全系直屏设计

AI日报：阿里千问APP公测；Veo 3.1上线多图参考；超级小爱AI大

华为Mate X7外观公布搭载全新折叠玄武架构

阿里巴巴回应千问崩了：状态良好欢迎来问

荣耀500系列官宣将于11月24日发布

一加Ace 6T官宣将于本月发布：首发骁龙8 Gen5

小米超级小爱AI大模型推出随心修图功能

参与开发iPhoneAir设计师离职转投AI初创公司

华为Mate 80系列已在华为商城开启预约

华为Mate 80 Pro Max外观公布：采用双圆环设计

AI日报：李飞飞Marble 3D世界模型公测；OpenAI首次推出ChatGPT

华为Mate 80/Pro/Pro Max/RS开启预约：全系直屏设计

iPhone Pocket正式开售：联名三宅一生售价1299元起

1899元苹果手机包卖完了！iPhone Pocket在吐槽声中销售火爆

AI日报：阿里千问APP公测；Veo 3.1上线多图参考；超级小爱AI大

微信小程序将在iOS端支持接入虚拟支付苹果抽成15%

华为WATCH ULTIMATE DESIGN非凡大师紫金款明天开启预售

华为Mate X7外观公布搭载全新折叠玄武架构

站长商机