首页 > 传媒 > 关键词  > OpenAI最新资讯  > 正文

成都汇阳投资关于Sora 正式上线,多模态模型的里程碑

2024-12-16 14:40 · 稿源: 站长之家用户

 事 件

  12 月 10 日,OpenAl正式上线 Sora,并向包括美国在内的多数国家用户开放,用户可在OpenAI官网上体验Sora。同时,Sora 被包含在ChatGPT Plus 和ChatGPT Pro 的会员订阅方案中, 用户无需额外付费。 其中,订阅Plus方案的用户可使用 Sora 生成最多 50 个分辨率达720p、时长为 5 秒的高 级视频而Pro方案能生成最多 500 个分辨率达1080p、时长为 20 秒的高 级视频,并且提供去水印功能。

新 Sora 视频再创作能力大幅提升

 相较于 OpenAI2 月份发布的版本, 此次上线的新 Sora 新增 Storyboard、Remix、Re-cut 等功能 ,视频再创作能力大幅提升 ,并且优化了视频生成速度及生成方式。新 Sora 的新功能包括 1)Storyboard:类似于电影里的分镜,即用户只需借助文字设计几段视频帧或直接上传图片作为静态视频帧, 并在视频帧之间预留一些时间供Sora 发挥,Sora 便能自动把这些视频帧串联起来形成一段完整的视频:2)Remix:通过不同的文字描述对视频中的元素进行替换、删除或重构, 比如可以把图书馆变成宇宙飞船:3)Re-cut:智能识别并剪切出视频中的最 佳帧,并将其导入 Storyboard 中 ,拓展该视频帧:4)Loop:用于创建无限循环的视频:5)Blend:将两个视频无合并为一个视频:6)Style presets:为视频预设风格 , 比如黑白电影、纸片人等。 此外,借助 Sora Turbo,新Sora 的视频生成速度显著提升, 同时,新 Sora 将视频生成方式扩展为文/文+图/文+视频生成视频。

 国内企业开始加速研发并选代A I 视频生成产品

 今年以来 , 国内企业开始加速研发并选代 AI 视频生成产品 ,产品能力不断提升 ,应用场景持续拓宽。1)今年 6 月,快手 AI 团 队发布可灵 AI 视频生成大模型 ,可生成长达 2 分钟 、分辨率达 1080p 的视频 ,可灵 AI 主要功能包括文生视频 、 图生视频 、 视频续写等;2)今年 7 月 ,智谱 AI 上线视频生成产品智谱清影 ,并在 11 月 进行全新升级 ,支持生成时长为 10 秒的 4K 超高清视频 ,除常规的文生视频和图生视频功能外 ,智谱清影引 入 CogSound 模型 , 可以对为 生成的视频添加背景音乐:3)今年 8 月 , 字节推出即梦 AI 一站式创作平台, 随后在 11 月 宣布即梦 AI 两大视频模型 S2.0 Pro 和 P2.0 Pro 正式全量上线,其中, S2.0Pro 在图生视频场景具有较高的首一致性,能够保持视频与用户输入图像的 色彩 、 风格等保持一致 ,P2.0Pro 具有极 高提示词遵循能力, 能够在一句提示词内实现多个镜头切换及多镜头组合, 同时保持视频内形象主体、 风格和氛围的一致性 。此外 ,Minimax、 阿里云等初创企业及大模型厂商也在布局 AI 视频生成赛道, 整体来看,视频生成工具今年以来, 国内企业开始加速研发并选代 AI 视频生成产品,产品能力不断提升 ,应用场景持续拓宽 。 1)今年 6 月 ,快手 AI 团队发布可灵 AI 视频生成大模型, 可生成长达 2 分钟、分辨率达 1080p 的视频,可灵 AI 主要功能包括文生视频、 图生视频、 视频续写等;2)今年  7 月,智谱AI 上线视频生成产品智谱清影 ,并在11 月进行全新升级 ,支持生成时长为 10 秒的 4K 超高清视频 , 除常规的文生视频和图生视频功能外,智谱清影引 入 CogSound 模型 , 可以对为生成的视频添加背景音乐:3)今年 8 月, 字节推出即梦AI 一站式创作平台, 随后在 11 月宣布即梦 AI 两大视频模型 S2.0 Pro 和 P2.0 Pro 正式全量上线 , 其中 ,S2.0Pro 在图生视频场景具有较高的首一致性 , 能够保持视频与用户输入图像的色彩 、 风格等保持一致 ,P2.0Pro 具有极 高提示词遵循能力, 能够在一句提示词内实现多个镜头切换及多镜头组合 , 同时保持视频内形象主体、风格和氛围的一致性。此外 ,Minimax、 阿里云等初创企业及大模型厂商也在布局 AI 视频生成赛道 , 整体来看 ,视频生成工具的能力不断提升 , 未来有望渗透更多应用场景。

相关公司

 三六零 (601360) : 目前 360 搜索是中国搜索引擎的 Top2 , 市场份额为 35%,公司的人工智能研究院从 2020 年开始一直在包括类 ChatGPT 技术在内的 AIGC 技术上有持续性的投入 ,但截至目前仅作为内部业务自用的生产力工具使用 ,且投资规模及技术水平与当前的 ChatGPT3 相比还有较大差距 , 各项技术指标只能做到略强于 ChatGPT2 。 由于训练数据源及应用方向的原因 ,在中文环境下的实际效果强于 ChatGPT2 。360 在数据资源端有丰富的多模态大数据积累和相关语料 、尤其是中文语料 ,相较于国外同行落后的是预训练大模型和有效的多模态数据清洗与融合技术 。公司有充足的资金储备可用于购买大规模算力 ,在继续深入自行研发的同时 ,不排除寻找强有力的合作伙伴 , 以开放的心态搭建多方共享平台 、补足短板 ,快速缩小差距 。公司也计划尽快推出类 ChatGPT 技 术的 demo 版产品 。

 中科曙光 (603019):伴随宁夏 “ 算力交 易平台 ” 的上线 , “ 东数西算 ” 工程迎来重要里程碑 。 2 月 24 日 ,由宁夏回族自治区联合中科曙光 、中国电信宁夏公司 、北京国际大数据交易所等打造的国内头个一体化算力交易调度平台——东数西算一体化算力服务平台正式上线 。该平台上线后将整合宁夏地区零散算力资源 ,解决算力输出、应用 、交易等难题 ,赋能宁夏“ 六新六 特 ”等产业数字转型升级。

 参考资料:20241212- 山西证券-计算机行业点评: Sora正式上线, 多模态模型的里程碑

 免责声明:以上信息出自汇阳研究部,内容不做具体操作指导,客户亦不应将其作为投资决策的唯 一参考因素。据此买入,责任自负,股市有风险,投资需谨慎。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • AI日报:李飞飞Marble 3D世界模型公测;OpenAI首次推出ChatGPT群聊功能;百度发布多模态 AI助手超能小度

    本期AI日报聚焦多项技术突破:World Labs推出Marble 3D模型,实现多模态生成可交互虚拟世界;OpenAI在韩新试点ChatGPT群聊功能,支持多人协作互动;苹果更新隐私政策,要求第三方AI调用需明示授权;百度发布多模态助手“超能小度”,支持空间感知与设备免费升级;LinkedIn推出AI人脉搜索,通过自然语言精准匹配专业人士;Cursor完成23亿美元融资,估值达293亿;Character AI与耶鲁合作实现音画同步技术Ovi;Google NotebookLM上线深度研究工具,支持多格式文件分析与知识库构建。

  • 品牌AI搜索监控实战手册:你的企业在ChatGPT眼中是什么样子?

    某互联网大厂品牌总监分享:投入200万SEO使"企业级CRM"关键词在Google排名第一,但用户用ChatGPT询问"推荐适合中国企业的CRM系统"时,AI回答中根本没有该品牌。更值得警惕的是,竞品不仅被提及,还被AI用"性价比高""用户体验好"等正面词汇描述。这揭示2025年品牌营销最大盲区:企业不知道AI如何"看待"自身品牌。 数据显示超40%年轻用户开始使用AI搜索作为主要信息渠道,而绝大多数企业对自己在AI平台的"形象"一无所知。文章提出GEO品牌监控概念,通过覆盖度、推荐强度、信息质量三个维度量化品牌在AI搜索中的影响力,并给出五步实施流程:建立监控基线、竞品对标分析、设置持续机制、深度洞察挖掘、数据驱动优化。通过真实案例说明,系统化GEO优化能在3个月内提升品牌提及率33个百分点,证明AI搜索时代的品牌竞争已从"被看见"升级为"被AI信任"。

  • Sora App的AI视频社交,给了百度们新希望

    Sora2发布两周后,百度的蒸汽机AI视频模型,和谷歌Veo3.1撞了档期。 两家公司选择同期发布并非有多默契,而是Sora2带来的压迫感促使它们不得不加快脚步。 奥尔特曼将形容Sora2为“创意领域的ChatGPT3.5时刻”,不仅在物理逻辑、画面连贯性、真实感和音画同步等方面实现了质的飞跃,还把Sora从一个“文本到视频”的工具进化成一个“创意到生态”的平台。 这无疑是扔在AI视�

  • 谁能成为中国的ChatGPT?夸克抢先交卷

    在OpenAI上线自己家AI浏览器ChatGPT Atlas的同一周,微软在海外发布了新的AI助手Mico和更AI化的Edge浏览器,夸克则在国内推出了新的「对话助手」功能。 这一系列消息背后,新旧巨头、两个市场产生了两个确定的共识:一个是AI助理与AI浏览器的融合会进一步深化,入口之争就是系统之争;另一个是对话会成为人与AI交互的主要方式,自然语言就是未来的编程语言。 在海外市场,OpenA

  • OpenAI发布GPT-5.1:情商大涨 本周开始推送

    OpenAI正式推出GPT-5.1模型,以“智商与情商深度融合”为核心亮点。新模型优化推理能力,强化情绪价值与个性化交互,包含Instant与Thinking两大核心版本:Instant首次引入自适应推理功能,针对复杂任务延长思考时间,简单问题保持极速响应;Thinking版本智能分配思考时长,提升回答透彻度与通俗性。新增Auto功能自动匹配最佳模型,支持六种官方预设风格及精准微调。安全评估首次纳入心理健康与情感依赖维度,防范拟人化风险。付费用户可保留旧版三个月过渡期。

  • 长视频,要MCN化?

    过去十多年,长视频平台习惯用头部综艺与大剧撬动增长:内容够强,自然破圈,声量带动会员与广告。 这套“内容中心逻辑”曾行之有效。 但短视频重写了注意力分配。用户不再愿意投入整段时间追一个叙事,三十秒的情绪刺激就足以满足娱乐需求。内容生命周期被压缩,哪怕是重金制作,也可能上线当周见顶、难以延展。 在这种环境下,平台不得不寻找新的增长方式。�

  • AI全面落地双11,淘宝走出一条和OpenAI不同的路

    ​今年的双11已经进入最后阶段,消费者和商家都有一个明显的感受是,AI的浓度真的很高,并且AI的全面落地应用,真的在改变传统用户购物、商家经营的链路。 消费者能感受到两个比较明显的变化:一个是AI导购开始走进真实的购物场景。淘宝为双11投入了六款AI导购类产品,其公布的数据显示,AI万能搜已经帮助消费者解决了5000万个消费需求。 另一个则是平台推荐的商品越

  • OpenAI也来了,巨头为何决战AI浏览器?

    AI浏览器赛道再添一位重量级玩家——ChatGPT Atlas,这是OpenAI推出的首款人工智能驱动的网页浏览器。 这也被外界认为OpenAI要向谷歌宣战,挑战Chrome一直以来的浏览器霸王地位。ChatGPT Atlas发布当天,谷歌母公司Alphabet股价应声下挫,盘中最大跌幅接近5%,足见市场对这一新品的敏感度。 近一年来,AI浏览器的战略价值成为行业共识,从业者更是将其与智能代理(Agent)、搜索引�

  • OpenAI和微软的关系没那么糟,跟英伟达也没那么好

    OpenAI的动作比所有人想象的都要快。 上周二,OpenAI完成重组。其中一个重要变化是:彻底取消了与微软的排他性协议,结束了Azure长达六年的云服务独占模式。此前,OpenAI所有模型的训练、推理与部署都必须优先选择Azure,微软还享有优先购买权。 宣布与Azure“分手”后不到一周,OpenAI便火速宣布了与AWS的战略合作——双方达成一项价值380亿美元的云计算协议,OpenAI将全面接入

  • AI日报:Sora正式登陆Android;网易云音乐推AI调音大师;谷歌将推Nano Banana2

    本期AI日报聚焦多领域突破:OpenAI视频应用Sora登陆安卓平台并引入付费角色功能;网易云音乐推出AI调音大师实现智能音效适配;字节跳动高薪布局人形机器人赛道;谷歌Gemini平台将升级图像生成技术;llama.cpp实现多模态革命;特斯拉秘密实验室通过行为数据训练机器人;上海首例AI著作权案宣判保护原创;微软推出自研图像生成器MAI-Image-1,在创意效率与质量间取得平衡。

今日大家都在搜的词: