首页 > 原创 > 关键词  > 人工智能最新资讯  > 正文

AI日报:ChatGPT AI搜索免费开放;谷歌AI视频模型Veo2优于Sora;Midjourney重磅上新个性化模型与情绪板

2024-12-17 15:19 · 稿源:站长之家

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用

新鲜AI产品点击了解:https://top.aibase.com/

1、OpenAI宣布ChatGPT搜索升级 支持地图、高级语音等功能

OpenAI在最新的直播中宣布了ChatGPT平台的重大技术更新,推出了实时搜索高级语音交互模式,极大提升了用户体验。通过优化搜索算法,用户能够快速获取实时信息,并直接查看源链接,增强了信息的便捷性。此外,新增的视频播放和地图集成功能,为用户提供了更直观的搜索体验,提升了移动端的搜索效率。

微信截图_20241217081801.png

【AiBase提要:】

📈 更新后的ChatGPT引入了实时搜索功能,优化了搜索算法,使用户能够快速获取股票和新闻等实时信息。

🗣️ 新增的高级语音交互模式允许用户通过语音进行多轮搜索,提供个性化的语音助手体验。

🗺️ ChatGPT现在支持地图集成功能,用户可以直接查看地理位置信息,进行路线规划和地点探索。

2、谷歌升级AI视频生成模型 Veo2,4K分辨率、人类偏好评分优于Sora

谷歌最近发布了其新一代视频生成模型Veo2,旨在与OpenAI的Sora竞争。Veo2在视频生成方面展现了更高的真实感和细腻度,用户可以通过Google Labs的VideoFX平台申请使用。此外,谷歌还更新了图像生成模型Imagen3,进一步提升了生成图像的真实感和色彩表现。

image.png

【AiBase提要:】

🎥 Veo2视频生成模型质量优于OpenAI的Sora,用户可申请使用。

🚀 用户可以选择视频风格和效果,生成最高可达4K分辨率的视频。

🎨 更新的Imagen3图像生成模型表现出更好的艺术风格和用户体验。

详情链接:https://labs.google/fx/tools/video-fx

3、Midjourney推出个性化模型与情绪板,可上传图像训练模型了

2024年12月16日,Midjourney公司推出了备受期待的“情绪版板”功能,允许用户上传灵感图像集以生成新艺术作品。配合最新的AI模型,用户可以更轻松地创建个性化资料,简化了模型建立过程,降低了新用户的入门门槛。此外,增强的组织功能使得用户能够更好地管理多个项目。

image.png

【AiBase提要:】

🌟 Midjourney推出心情板功能,用户可上传灵感图像集。

🚀 个性化资料的创建变得更简单,用户只需40个评分即可开始。

🛠️ 组织功能增强,用户可命名资料并追踪相关图像。

详情链接:https://www.midjourney.com/personalize

4、谷歌推出全新AI工具Whisk无需提示词,可多张图片混合生成新风格图像

谷歌最新推出的AI工具Whisk,显著改变了传统的图像生成方式,允许用户通过上传多张图片来生成新图像,而不再依赖于冗长的文字描述。Whisk的设计旨在快速进行视觉探索,用户可以轻松地将不同风格和主题的图像融合,创造出独特的视觉作品。尽管生成图像的过程可能需要几秒钟,并且有时结果会略显奇怪,但整体体验非常有趣。

image.png

【AiBase提要:】

🎨 Whisk允许用户通过多张图片生成新风格图像,颠覆了传统的文字提示方式。

✨ 用户可以上传不同主题的图片,自动融合生成有趣的视觉效果。

🚀 谷歌还发布了Imagen3和Veo2模型,进一步提升了图像和视频生成的能力。

详情链接:https://top.aibase.com/tool/whisk

5、YouTube新功能上线:允许创作者授权第三方使用视频训练AI

YouTube最近推出了一项新功能,允许创作者选择是否授权第三方公司使用他们的视频进行人工智能模型的训练。这一功能的默认设置为关闭,创作者如果不希望第三方使用他们的视频,无需采取任何行动。

【AiBase提要:】

🔒 默认设置为关闭,创作者需主动选择允许第三方使用其视频进行AI训练。

🤝 允许的第三方公司包括知名AI企业,如OpenAI、苹果和微软等。

📈 此功能旨在帮助创作者在AI时代实现内容的新价值。

6、图森未来发布图生视频模型“Ruyi” 并开源Ruyi-Mini-7B

北京图森未来科技有限公司于2024年12月17日发布了其首款“图生视频”大模型“Ruyi”,并开源了Ruyi-Mini-7B版本,供用户在huggingface平台下载使用。该模型专为消费级显卡设计,具备多种生成能力,尤其在动漫和游戏领域展现出色的视觉叙事潜力。尽管技术上取得进展,但仍需解决一些缺陷。

微信截图_20241217140324.png

【AiBase提要:】

🚀 Ruyi大模型专为消费级显卡设计,支持多分辨率和多时长的视频生成,能够处理384×384到1024×1024的分辨率。

🎨 模型在帧间一致性、动作流畅性和色彩呈现方面表现卓越,成为ACG爱好者的理想创意伙伴。

🔧 尽管技术上取得进展,Ruyi仍存在一些缺陷,如手部畸形和面部细节崩坏,图森未来正在努力改进。

详情链接:https://huggingface.co/IamCreateAI/Ruyi-Mini-7B

7、智谱AI完成30亿元融资 推动大模型技术研发与商业化

智谱公司近期成功完成30亿元人民币的新一轮融资,吸引了众多战略投资者和国资机构的参与。这笔资金将用于智谱基座大模型的研发升级,进一步提升其在复杂推理和多模态任务解决方面的能力。尽管面临市场竞争和技术进展放缓的挑战,智谱依然在AI行业中保持领先地位,并在全球范围内产生显著影响。【AiBase提要:】

🚀 智谱公司完成30亿元融资,资金将用于基座大模型的研发和升级,推动行业创新。

📈 今年智谱在B端市场实现逆势增长,API收入同比增长超过30倍,付费客户数增长20倍。

🌍 智谱的C端产品“智谱清言”吸引超过2500万用户,预计付费功能将带来千万级收入。

8、Meta 推出开源AI试衣模型 Leffa:保留更多细节

Meta最近推出了Leffa,一个开源的AI虚拟试穿框架,旨在通过生成新图像提升用户的穿衣体验。用户只需上传一张参考图片,系统便能生成新的穿搭效果,减少了因不合适而退换货的麻烦。Leffa在保留细节和减少图像失真方面表现出色,提供了更自然的试穿效果。

image.png

【AiBase提要:】

🌟 Leffa 是 Meta 推出的开源虚拟试穿框架,可以根据参考图像生成新图像。

👗 该框架能有效减少图像失真,保留更多细节,提高虚拟试穿体验。

💻 用户可在 Hugging Face 平台上试用 Leffa,同时 Meta 提供了完整的项目代码。

详情链接:https://github.com/franciszzj/Leffa

9、Diffusion-Vas:追踪视频目标,可补全遮挡部分

在视频分析领域,物体的持久性是理解物体存在的重要线索。研究者提出的Diffusion-Vas方法,基于扩散先验,旨在提升视频无模态分割和内容补全的效果。该方法分为两个阶段,首先生成无模态掩码,然后利用条件生成模型对遮挡区域进行内容补全。经过多项基准测试,该方法在复杂场景下表现优异,准确率提高了13%。

image.png

【AiBase提要:】

🌟 研究提出了一种新方法,通过扩散先验实现视频中的无模态分割和内容补全。

🖼️ 方法分为两阶段,首先生成无模态掩码,然后进行遮挡区域的内容补全。

📊 在多项基准测试中,该方法显著提高了无模态分割的准确性,尤其在复杂场景下表现优异。

详情链接:https://diffusion-vas.github.io/

10、Meta智能眼镜Ray-Ban Meta升级:实时AI视频与翻译功能

Meta公司对Ray-Ban Meta智能眼镜进行了重要更新,推出了多项基于人工智能的新功能,包括实时对话和语言翻译。这些功能使用户能够与AI助手进行更自然的交流,无需频繁唤醒助手,同时也支持多语言即时翻译,极大提升了用户的沟通便利性。此外,眼镜还新增了Shazam功能,用户可以通过语音识别音乐。

image.png

【AiBase提要:】

🌟 Ray-Ban Meta智能眼镜推出实时AI视频和翻译功能,用户可随时与AI助手对话。

🌍 新增的实时翻译功能支持多种语言之间的即时翻译,提升了用户交流的便利性。

🎵 眼镜还支持Shazam功能,用户可通过语音识别当前播放的音乐。

11、博通CEO预测AI市场大爆发 公司市值突破1万亿美元

博通公司首席执行官Hock Tan在最近的财报电话会议上对AI芯片市场表达了乐观的展望,预计到2027年,博通在这一领域的收入将显著增长,服务可寻址市场预计在600亿至900亿美元之间。公司市值因AI芯片需求激增首次突破1万亿美元。

【AiBase提要:】

🌟 博通预计到2027年AI市场服务可寻址市场将达到600亿至900亿美元。

📈 博通市值因AI芯片需求激增首次突破1万亿美元。

💰 通过收购VMware,博通整体收入增长达51%,且运营成本大幅降低。

12、金山办公:WPS AI将免费解锁AI生成PPT等四大功能

金山办公宣布WPS AI将在年终期间为用户提供四项免费功能,旨在提升工作效率和创意。用户可以使用AI生成PPT、风格克隆、滤镜等功能,快速制作专业的年终总结PPT。此外,WPS还提供多样化的PPT模板,满足不同用户需求。

image.png

【AiBase提要:】

🎉 WPS AI将免费解锁AI生成PPT、风格克隆、滤镜和模板功能,提升用户工作效率。

🖼️ AI生成PPT功能可快速生成专业PPT,智能润色内容,保持逻辑和设计美感。

📋 用户可通过“AI总结季”参与活动,获取丰富的年终总结PPT模板,满足不同行业需求。

举报

  • 相关推荐
  • 聚焦技术突破与产业落地 人工智能与机器人两展四大奖项启动申报

    新一轮科技革命推进AI与机器人产业步入应用与产品化新阶段。第28届深圳高交会将设AI与机器人双馆,同步启动四大奖项评选,构建从底层技术突破到场景落地的完整评价链。评选旨在识别能转化为现实生产力的创新,重点考察原创性、工程化、市场验证与场景成效,推动产业从“展示创新”走向“兑现价值”。依托上届展会超45万人次、1700多亿元签约成果的国家平台,获奖者将获对接市场与资本支持,中国机器人产业正迈入“生态竞争”新阶段。

  • 招生季丨智领时代,技拓新局——湘南幼专人工智能技术应用专业

    湘南幼专人工智能技术应用专业以技能为本、实践导向,培养复合型技术人才。课程“理论+真实项目”双线并行,校企共建实训基地,并鼓励考取数据应用、计算机视觉等“1+X”证书。毕业生可服务智能制造、金融科技等多领域,从事AI开发、模型训练等岗位。专业前景广阔,岗位需求旺盛。

  • 予非知识图谱大模型完成生成式人工智能服务备案!潍坊市首个

    “予非知识图谱大模型”获国家生成式AI服务备案认证,系潍坊首例。模型聚焦非结构化数据治理,具备知识建模、实体对齐、动态图谱等全链能力,内置知识分级与访问控制,适配政务、金融等高合规场景。作为“予非·睿知”平台底座,通过“模型+平台”模式破解知识分散、检索难等痛点,赋能政企业务协同与决策。此举为区域生成式AI合规应用与数字经济发展树立新标杆。

  • 超擎数智与香港中文大学(深圳)签署协议,共建人工智能和边缘计算联合实验室

    2026年8月3日,超擎数智与香港中文大学(深圳)正式签署联合实验室协议,共同成立港中大(深圳)-超擎数智人工智能和边缘计算联合实验室(CUHK-Shenzhen-ChaoQing Joint Laboratory of AI and Edge Computing),双方依托高校国际一流科研力量与企业产业落地能力强强联合,聚焦人工智能、边缘计算核心技术开展深度产学研用协同攻关,搭建集科研创新、人才培育、成果产业转化于一体的长效科�

  • AI日报:OpenAI取消ChatGPT文本聊天限制;小米智能摄像机4 Max AI变焦版开售;Suno 宣布给AI歌曲加水印

    OpenAI取消ChatGPT限制并推出GPT-5.6模型;小米摄像机4 Max AI版内置大模型开售;火山引擎Seedance2.5 API升级视频生成;Suno为AI歌曲加水印并面临版权诉;宇树IPO DeepSeek获配93万股;OpenAI甜甜圈造型硬件2027年发布;谷歌离线翻译器Gemma Translator跑51亿参数,树莓派实现不联网跨语言对话;影石GO Ultra接入千问与Gemini成为AI语音入口。

  • 海尔小优智能体升级亮相世界人工智能大会

    2026世界人工智能大会上,海尔智家总裁李华刚分享AI驱动家电消费升级实践。“小优家庭管家智能体”作为核心载体,能理解空间与习惯,实现从“人找服务”到“服务找人”的主动感知与自主执行,例如根据食材推荐菜谱、识别衣物匹配程序。其目标是推动从分担家务迈向无人家务,并构建“人-车-家-社区”一体化联动,如离家自动关设备、返程提前调节环境。海尔正向平台服务型科技企业蜕变,让主动的“懂家”智慧管家走进每个家庭。

  • WAIC不筹量子重磅发布“量筹一号”——原子量子人工智能基座

    在WAIC2026上,不筹量子公司发布国内首款原子量子AI基座“量筹一号”,标志我国量子计算迈入工程交付新阶段。该产品基于获国际顶刊认可的随机增强量子神经网络等理论突破,实现千比特规模与超99.9%保真度。其首创“三算力融合”架构并配套六层全栈软件,已在气象、具身智能等八大领域实现10-100倍精度提升,并推出三档配置,为AI与量子深度融合提供新质算力底座。

  • 为什么海尔智家能承建国家人工智能应用中试基地?

    AI融入真实场景需经“中试”验证,海尔智家承建的全国首个家居家电方向国家AI应用基地为此落地。文章指出,中试是连接实验室研发与工厂量产的桥梁,海尔凭近20年技术积累,如AI之眼与UHomeOS,让AI理解动态家庭场景。其全球化布局显示,智慧家庭需本地化,理解各地生活方式。此举标志产业从“制造”硬件转向“智造”服务与生态,推动标准统一。

  • 聚焦AI系统性进化 腾讯发布2026人工智能十大趋势报告

    2026年被业界视为AI应用落地的元年。过去三年,基础模型遵循“Scaling Law”持续扩张——更多数据、更大参数、更多GPU。但随着模型能力的持续提升,行业逐渐意识到,仅靠规模扩张已不足以满足AI真正为人类所用的需求。正是在这一产业转折点上,腾讯研究院联合腾讯云智能、腾讯优图在2026世界人工智能大会(WAIC)腾讯AI应用创新论坛上正式发布《协同进化:2026人工智能十大�

  • GOAI 世界人工智能开源大赛 四大赛道正式发布

    GOAI世界人工智能开源大赛发布,围绕“引领AI走进真实世界”设四大赛道:新智基座聚焦多智能体协同基础设施;无界应用面向AI+行业真实场景;前沿探索推动AI驱动科研;具身未来挑战物理世界交互。大赛强调从概念展示转向可运行、可验证的开放系统,关注真实业务流程嵌入。现面向全球开发者、科研团队征集项目,共设100万元全场大奖。

今日大家都在搜的词: