首页 > 业界 > 关键词  > Midjourney最新资讯  > 正文

AI视野:Midjourney开始训练视频模型;文心一言用户破亿;优酷上线“AI搜片”功能;快手开源KwaiAgents系统

2023-12-28 15:43 · 稿源:站长之家

📰🤖📢AI新鲜事

Midjourney开始训练视频模型

Midjourney昨晚发布了重要消息,将开始视频模型训练,同时计划下周推出V6版本的重大更新。该更新将在文本处理方面有显著进步,提高内容连贯性和提示准确性。重点改进包括Inpainting功能和全新的风格调整器,为V7版本的重大更新做准备。

【AiBase提要:】

🚀 视频模型训练启动: Midjourney宣布即将开始视频模型训练,拓展其领先地位。

🆕 V6版本重大更新: 下周V6版本将推出,带来文本处理方面的显著进步,包括Inpainting功能和全新风格调整器。

🔮 V7版本预告: Midjourney透露V7版本将是一次重大更新,预示在视频生成领域竞争中的强劲实力。

文心一言用户破亿

百度首席技术官王海峰在WAVESUMMIT大会上宣布,文心一言用户数量突破1亿,与飞桨开发者规模达到千万。

【AiBase提要:】

🚀 文心一言用户已突破1亿,自8月31日开放服务以来,用户提问量与模型效果同步提升。

🛠️ 文心一言作为百度核心技术之一,在语义理解和自然语言处理领域取得显著成就。

💻 与文心一言技术深度绑定的百度飞桨开发平台成功发展,开发者规模已超过千万,达到1070万。

三星新推AI智能冰箱

三星推出2024Bespoke4-DoorFlexRefrigerator,内置摄像头识别食物,App提供个性化食谱建议,32英寸触摸屏支持TikTok和YouTube,强化AI功能。

【AiBase提要:】

🌿 内置摄像头辨识食物,App提供个性化食谱建议。

📲 与Galaxy手机镜像,32英寸触摸屏支持TikTok和YouTube。

🍽️ 强化的AI功能,如视觉AI识别食物并提供更多定制化选项。

阿里发布《AIGC治理与实践白皮书》

阿里巴巴携手中国电子技术标准化研究院发布《AIGC治理与实践白皮书》。阿里强调在AI发展中建立防火墙,同时突破AI应用的天花板,与社会共同解决问题,推动AI造福更广泛人群。

【AiBase提要:】

🔥 发展防火墙: 阿里致力于在AI领域筑牢发展的防火墙,确保安全发展。

🚀 突破天花板: 阿里强调不断突破AI应用的天花板,迎接前所未有的挑战。

🤝 社会共创: 阿里betway体育注册努力与社会各界合作,共同利用AI技术解决社会难题,推动AI造福更多人。

《纽约时报》起诉微软和OpenAI

纽约时报起诉微软和OpenAI,指责它们侵犯版权、滥用报纸知识产权,要求数十亿美元的法定和实际损害赔偿。

【AiBase提要:】

📰 侵权指控:微软和OpenAI被指控侵犯《纽约时报》版权,滥用报纸知识产权用于训练ChatGPT语言模型。

🤝 合作寻求解决方案:OpenAI表示对起诉感到失望,强调与媒体机构的对话,寻求互利合作方式,但未透露具体细节。

🔍 AI模型竞争与商业机会限制:纽约时报指责微软和OpenAI的GPT模型与其内容直接竞争,同时改变内容限制了时报的商业机会,引发媒体机构对人工智能模型的担忧。

比尔·盖茨预测人工智能将引发技术爆炸

比尔·盖茨预测人工智能将在未来18至24个月内迎来广泛应用,特别关注其在发展中国家的应用,强调全球卫生领域的平等性。

【AiBase提要:】

💡 盖茨预测人工智能将在未来18至24个月内广泛应用,加速科技领域的新发现。

🌍 盖茨关注人工智能在发展中国家的应用,特别强调在全球卫生领域的平等性。

🚀 盖茨指出人工智能在教育、抗击疾病等方面的多个应用案例,强调应根据各国实际情况进行调整。

🤖📈💻💡大模型动态

深言科技“语鲸大模型”通过备案

深言科技的“语鲸大模型”已通过备案,具备强大的语义理解与文本生成、代码理解等能力,将在文本创作、数学计算、代码补全等领域向社会公众开放服务。

【AiBase提要:】

🐋 技术实力: 深言科技的“语鲸大模型”在中文理解和生成方面领先,80亿参数的LingoWhale-8B模型已在多个评测基准上达到领先效果。

📅 产业合作: 入选“北京市通用人工智能产业创新伙伴计划”,并与清华大学NLP实验室合作,致力于推动人工智能产业创新。

🌐 开源与商用: LingoWhale-8B模型已开源供学术研究免费使用,商业用途需申请授权,展示深言科技在大模型领域的技术实力。

字节发布AI模型DiffPortrait3D

DiffPortrait3D是字节跳动团队开发的条件扩散模型,通过零样本能力,从一张肖像图生成逼真、多样的3D面部视图,支持不定姿态、夸张表情和各种艺术风格。

【AiBase提要:】

🌐 独特技术:DiffPortrait3D采用2D扩散模型生成先验,结合条件控制模块、交叉视图注意力模块和3D感知噪声生成机制,实现多视角、野外场景下的高质量3D人像合成。

📸 零样本方法:通过零样本方法,DiffPortrait3D能够从单一肖像生成3D一致的新视图,支持不规定相机视角、极端面部表情和多样艺术描绘,无需繁琐微调。

🔬 综合优势:引入条件控制模块、交叉视图注意力模块和3D感知噪声生成机制,确保在合成图像中保持面部特征一致性,经过多视角和野外基准测试展现出逼真高质量的3D面部重建。

🤖📱💼AI应用

优酷上线“AI搜片”功能

一项全新的AI功能“AI搜片”在优酷上线,被称为全网首个AI对话类影视搜索引擎。用户可通过多轮对话实现模糊搜索、影视问答等功能,提升搜索体验,使影视内容查找更智能和个性化。

微信截图_20231228111602.png

【AiBase提要:】

🔍 优酷推出全新AI功能“AI搜片”——首个AI对话类影视搜索引擎。

🎙️ 用户通过对话实现模糊搜索、影视问答,无需具象问题即可完成搜索。

🌐 涵盖全网百万级影视剧实体信息,融合万亿条文娱相关知识词条,提升用户搜索体验。

👨‍💻💡🎯聚焦开发者

腾讯MotionCtrl正式开源

腾讯视频发布的MotionCtrl视频运动控制器正式开源,具有高度自定义相机和物体运动轨迹,实现精细多样化运动控制。

image.png

Demo:https://huggingface.co/spaces/TencentARC/MotionCtrl

项目地址:https://top.aibase.com/tool/motionctrl

【AiBase提要:】

🔄 MotionCtrl开源:腾讯视频发布的MotionCtrl视频运动控制器正式开源。

📹 多样化运动控制:项目可高度自定义相机和物体在3D空间的运动轨迹,实现更精细和多样化的运动控制。

🌐 架构优势:MotionCtrl独立控制摄像机和物体运动,考虑了它们的固有属性,提高了运动控制的灵活性。

快手开源KwaiAgents系统 性能超越GPT-3.5

快手与哈尔滨工业大学联合研发的「KwaiAgents」系统成功开源,通过Meta-Agent Tuning方法提升7B/13B模型性能,超越了GPT-3.5。

image.png

项目地址:https://github.com/KwaiKEG/KwaiAgents

【AiBase提要】

🚀 开源项目优势: 快手联合哈尔滨工业大学开源「KwaiAgents」系统,包含轻量级AI Agents系统、通用能力大模型、自动化评测Benchmark,为研究者提供便利。

🔄 Meta-Agent Tuning方法: 通过MAT方法,引入更多Agent Prompt模板,提升大模型在任务规划、工具使用、反思等能力,避免过拟合问题。

📈 性能超越GPT-3.5: 经过MAT调优后,7B-13B模型在各项能力上显著提升,评测结果显示超越了GPT-3.5效果。

字节推图像分割项目UniRef++

UniRef++项目由字节公司推出,通过整合即参考图像分割、少镜头图像分割、参考视频对象分割和视频对象分割四种方式,利用UniFusion模块和SAM模型提高图像分割效率和精确度。

image.png

论文地址:https://arxiv.org/pdf/2312.15715.pdf

【AiBase提要】

🔍 UniRef++整合四种图像分割方式,实现自动选择最适合任务的分割方式。

🔄 UniFusion模块与SAM模型结合,进一步提高图像分割效率和精确度。

🚀 项目允许在广泛基准上进行联合训练,提高资源利用效率,实验结果显示在不同任务上取得先进性能。

举报

  • 相关推荐
  • 菁彩Vivid搭载车量超百万,携手车企迎来车载应用新里程碑!

    2025年11月5日,世界超高清视频产业联盟在深圳举办UWA+峰会,宣布中国自主三维音频标准“菁彩声”(Audio Vivid)车载应用装机量突破100万台。该标准基于AI技术,支持7阶HOA渲染与128轨实时处理,解码延迟低于80ms,实现三维空间精准定位与“黄金听音位”个性化体验。已覆盖鸿蒙智行、奇瑞等十余家车企29款车型,获IEC国际标准认证,与Dolby AC-4等并列全球四大三维音频标准。通过构建“标准-内容-终端”生态,推动中国音频产业从技术领先迈向市场引领。

  • 以算力为基,优刻得与IDEA共建低空经济新格局

    10月24日,粤港澳大湾区数字经济研究院低空经济院长李世鹏一行访问优刻得上海总部,与董事长季昕华、副总裁韩畅交流。双方围绕低空经济发展趋势、技术攻关及生态共建等达成多项合作意向,将共同推动低空经济产业创新与落地。此前中共二十届四中全会提出加快低空经济等新兴产业发展。双方团队将在技术产品创新、生态共建与全球化布局等领域深化合作,整合云计算与产业资源优势,促进低空经济全链条发展,把握战略机遇,引领产业健康、智能、可持续发展新阶段。

  • 信锐助力TCL获 “2025中国IDC未来企业大奖联接领军者”优秀奖!

    10月17日,TCL空调办公网络智能连接与体验升级项目在IDC中国CIO峰会获“2025未来企业连接领军者”优秀奖。该项目依托信锐“AI+网络自动驾驶”理念,通过全网智能2.0与小信GPT方案重构企业网络管理模式,实现从感知、分析到决策的智能闭环,助力TCL实现20+维度数据采集、7*24小时AI调优及自然语言交互运维,推动企业数字化转型升级。

  • REDMI官方:REDMI K90超级像素新国屏比2K屏更强

    10月30日,Redmi官方回应K90系列屏幕配置问题,确认全系未采用2K屏,但搭载全新“超级像素新国屏”。该屏幕采用全RGB新一代显示技术,每个像素由独立红绿蓝子像素构成,实现OLED从有损到无损的重大突破。K90 Pro+Max子像素数量达938万,超越传统2K排列,显示文字、线条和图片边缘更清晰锐利。全RGB排列还具备减轻视觉疲劳优势,配合圆偏振2.0、DC调光等护眼技术。核心配置上,K90搭载骁龙8至尊版平台,Pro+Max升级为第五代骁龙8至尊版。起售价分别为2599元和3999元。

  • 平安云原生AI算力资源调度平台,荣获IDC “AI-就绪数字基础设施领军者优秀奖”

    近日,IDC公布2025年中国未来企业大奖获奖名单,平安科技打造的《云原生AI算力资源调度平台》创新项目荣获“AI就绪数字基础设施领军者优秀奖”。该平台通过统一资源池化管理、动态调度及GPU虚拟化等技术,显著提升资源利用率约30%,降低运营成本,并支持金融级高可用与弹性伸缩,助力企业高效应对AI推理与训练场景需求,体现了平安在AI基础设施构建与产业赋能方面的技术实力与国际认可。

  • AI日报:昆仑万维SkyReels V3模型上线;月之暗面推Kimi Linear模型;MiniMax Music 2.0 发布

    本期AI日报聚焦多领域创新:昆仑万维推出SkyReels V3模型,整合顶尖视频生成能力;月之暗面Kimi Linear模型处理长文本速度提升2.9倍;MiniMax Music 2.0实现专业级音乐创作;字节跳动启动豆包股权激励计划吸引AI人才;苹果iOS 27将迎AI重大升级,Siri更个性化;Dia浏览器融合Arc设计理念与AI技术;文心魔法漫画工具实现一键生成连载作品;谷歌Gemini Canvas新增PPT自动生成功能,由Gemini 2.5 Pro驱动,提升职场效率。

  • MiniMax让AI语音有了新基建

    熟悉MiniMax的人都了解这家公司的调性——不鸣则已,一鸣惊人。 要么选择低调,要么发动技术连招,其发展路径呈现出鲜明的“技术深潜”与“节点式爆发“的双重特征。 十月的最后一周,再次进入MiniMax式技术迭代新周期。MiniMax模型“全家桶”全面向Agent方向进化,基础文本模型M1升级至M2,“专为Agent和代码而生”;视频模型升级至Hailuo2.3,Hailuo Video Agent迭代为“全模态全�

  • 今年双11,为什么买百吋电视更推荐RGB-Mini LED?

    今年双11,百吋电视因用户消费升级与居住改善需求增长显著。京东数据显示其销量同比增长200%,反映用户不再满足“够用”尺寸,而是追求影院级沉浸体验。百吋电视受追捧源于超高清内容普及与技术门槛降低,但需注意大屏对显示技术要求更高。RGB-Mini LED技术通过红绿蓝三原色独立背光实现精准控光,解决传统电视色彩与亮度矛盾,如海信UX等产品以高色域、分区控光提升画质。选购时需关注画质芯片与屏幕抗反射能力,确保色彩真实与观看舒适。尺寸是基础,画质才是灵魂。

  • 三星Micro RGB色彩技术亮相进博,智绘AI家电新视界

    三星在第八届进博会上紧扣AI浪潮,展示了显示技术、智能家电、半导体及物联网等领域的前沿成果。重点推出全球首款Micro RGB电视,融合微米级LED创新显示与AI功能,实现精准控光、更高亮度和真实色彩;同时展出144英寸Micro LED及纤薄折叠手机,体现从超大屏到移动显示的技术实力。全线产品集成Vision AI,通过影像增强、自适应音效等技术优化视听体验,并借助Galaxy AI提供个性化服务,强化在移动AI领域的领先地位。

  • iPad mini 8外观巨变:去掉扬声器开孔

    iPad mini 8将采用全新设计,去掉扬声器开孔并提升防水性能,同时苹果也在为iPad mini 8研发一套新的扬声器系统。 据悉,iPad mini 8可能采用屏幕激励器方案,通过驱动屏幕振动来发出声音,其原理是将振动机械能直接传输到屏幕,然后让屏幕代替传统扬声器振膜发声。 具体来说,它是通过在机身内部的微驱动单元(激励器)来激励中框 ,从而带动屏幕振动发声。

今日大家都在搜的词: