首页 > 业界 > 关键词  > MiniCPM-V2.6最新资讯  > 正文

超9000颗星,优于GPT-4V!国内开源多模态大模型

2024-08-11 10:06 · 稿源: ​ AIGC开放社区公众号

国内著名开源社区OpenBMB发布了最新开源多模态大模型——MiniCPM-V2.6。据悉,MiniCPM-V2.6一共有80亿参数,在单图像、多图像和视频理解方面超越了GPT-4V;在单图像理解方面优于GPT-4o mini、Gemini1.5Pro 和 Claude3.5Sonnet。值得一提的是,MiniCPM-V2.6显著减少了模型的内存占用

......

本文由站长之家合作伙伴自媒体作者“​ AIGC开放社区公众号”授权发布于站长之家平台,本平台仅提供信息索引服务。由于内容发布时间超过平台更新维护时间,为了保证文章信息的及时性,内容观点的准确性,平台将不提供完全的内容展现,本页面内容仅为平台搜索索引使用。需阅读完整内容的用户,请查看原文,获取内容详情。

举报

  • 相关推荐
  • 多模态和Agent成为大厂AI的新赛 点

    这是《窄播Weekly》的第52期,本期我们关注的商业动态是:当大厂的AI竞争策略开始倾斜向应用场景,多模态能力和代理执行成为两个焦点。大模型落地C端场景的核心,就是让大模型的能力越来越接近人。沿着这个主旋律,可以划分出两个进化方向:一个是持续降低用户与大模型进行有效沟通的难度;另一个则是让大模型具备执行更复杂任务的能力。前者的实现,需要给到大模型多

  • 多模态和Agent成为大厂AI的新赛点

    本期《窄播Weekly》聚焦AI大厂竞争策略向应用场景倾斜的趋势,重点分析了多模态能力和代理执行两大发展方向。文章指出,大模型落地的核心在于让人机交互更自然,具体表现为:1)通过多模态技术降低用户使用门槛,如阿里夸克新推出的"拍照问夸克"功能;2)通过代理执行提升复杂任务处理能力,如字节、百度等推出的通用Agent产品。国内外厂商路径差异明显:国�

  • 全系标配四轮转向!智己L6开卖48小时预定破9000

    华为4月21日发布全新MateBook L6,性能配置提升明显,官方数据显示其运行速度比上一代提升了约30%。设计上采用窄边框,屏幕刷新率高达90Hz。通过优化散热系统,最高可实现220km/h的极速。在屏幕方面,MateBook L6采用3D触控屏,分辨率达到379ppi,色彩饱和度最高可达2.74JNCD。在显示效果上,这款笔记本电脑在对比度方面表现优秀,单次充电续航可达690km或850km。九号屏幕版本在运行速度方面比上一代提升了约30%,最高可实现100km/h的极速。MateBook L6在电池容量上提供93Wh或100Wh的电池选项,CLTC续航模式下最长可达780km。

  • UniToken:多模态AI的“全能选手”,一次编码搞定图文理解与图像生成

    复旦大学与美团研究者提出UniToken框架,首次在统一模型中实现图文理解与生成任务的"双优表现"。该方案融合连续和离散视觉编码,有效解决了传统多模态建模中的"任务干扰"和"表示割裂"问题。通过三阶段训练策略(视觉语义对齐、多任务联合训练、指令强化微调),UniToken在多个基准测试中性能超越专用模型。其创新性体现在:1)统一的双边视觉编码

  • 字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA

    5月13日,火山引擎在上海搞了场 FORCE LINK AI 创新巡展,一股脑发布了5款模型和产品,包括豆包・视频生成模型 Seedance1.0lite、升级后的豆包1.5・视觉深度思考模型,以及新版豆包・音乐模型。同时,Data Agent 和 Trae 等产品也有了新进展。

  • 90后独臂外卖小哥入职京东 回应:11天收入4900

    安徽90后独臂外卖小哥常文亮转行成为京东全职骑手引发关注。他透露此前在美团月收入约7500元,加入京东外卖仅11天就赚取4900元。更令他欣慰的是,下月起京东将为他全额缴纳五险一金,这让他感受到更好的生活保障。常文亮通过抖音分享转型经历,表示对新工作的福利待遇感到惊喜。京东外卖自2月11日上线后,3月1日起为全职骑手全额承担五险一金费用,成为首个提供全面保障的外卖平台。这一举措既体现了企业对骑手的关怀,也为行业树立了新标杆。

  • AI日报:国内首个多模态AI程序员上岗;字节启动Top Seed计划招募AI人才;DeepSeek R1T Chimera上线OpenRouter

    【AI日报】今日AI领域重要动态:1.百度发布文心快码3.5及多模态AI程序员"文心快码Comate Zulu",提升开发效率;2.字节跳动启动"Top Seed"计划,招募30名AI博士人才;3.DeepSeek开源R1T Chimera模型上线OpenRouter平台;4.阿里AI工程师余亮获"全国劳动模范"称号;5.开源图像编辑工具Step1X-Edit登陆Hugging Face,性能媲美GPT-4o;6.谷歌被曝每月向三星支付巨额资金预装Gemini应用

  • 业界唯一!百度网盘上线多模态AI笔记 效率提升10倍

    快科技5月2日消息,过往,用户在通过视频学习并记录笔记时,总免不了要不停切换平台软件,暂停、截屏、记录、插图、批注、切换返回视频过程繁琐而低效。为了应对这种情况,百度网盘和百度文库联合研发上线了AI笔记”,支持全自动学习、半自动学习、辅助学习三种模式。如今只要在网盘里面任意打开一个学习视频,在右侧就能看到AI笔记”功能,用户可以自主输入内容,也可以让其直接生成图文并茂、结构清晰的笔记。而且每个重要知识点旁会有时间戳,点击时间戳即可跳转到视频中对应位置,实现视频和笔记内容的顺滑关联。此外AI笔记”还可以帮

  • 撒贝宁体验领克900:处处贴心 还有什么是你们没想到的

    撒贝宁亲身体验领克900后感叹其贴心设计。该车二排座椅支持180度旋转,可面向三排乘客或车门,方便老人小孩上下车,且旋转时不影响安全性。全车六座标配按摩功能,让撒贝宁直呼"太卷了"。体验后他表示这款车考虑周到,将所有需求都融入设计中,令人惊喜。

  • AI日报:GPT-4.1正式上线ChatGPT;阿里通义万相Wan2.1-VACE开源;可灵大模型视频生成量约占30%份额

    本文报道了AI领域最新动态:1)阿里通义万相开源视频编辑统一模型VACE;2)OpenAI发布GPT-4.1增强编码能力;3)Stability AI推出超轻量341M文字转语音模型;4)快手可灵视频生成模型占据30%市场份额;5)微软WizardLM团队整体加入腾讯混元大模型研发体系;6)腾讯宣布混元图像2.0将于5月16日发布;7)上海成立人工智能标识生态联盟;8)Lightricks发布13B参数视频生成模型LTX-Video;9)谷歌DeepMind推出AlphaEvolve优化AI训练速度;10)腾讯元宝浏览器插件上线Chrome平台。这些进展展示了AI技术在视频处理、大模型、语音合成等领域的快速发展。