首页 > 业界 > 关键词  > Llama3.1最新资讯  > 正文

首个超越GPT4o级开源模型!Llama 3.1泄密:4050亿参数,下载链接、模型卡都有了

2024-07-23 14:08 · 稿源: 机器之心公众号

Llama3.1终于现身了,不过出处却不是 Meta 官方。今日,Reddit 上新版 Llama 大模型泄露的消息遭到了疯传,除了基础模型,还包括8B、70B 和最大参数的405B 的基准测试结果。下图为 Llama3.1各版本与 OpenAI GPT-4o、Llama38B/70B 的比较结果。可以看到,即使是70B 的版本,也在多项

......

本文由站长之家合作伙伴自媒体作者“机器之心公众号”授权发布于站长之家平台,本平台仅提供信息索引服务。由于内容发布时间超过平台更新维护时间,为了保证文章信息的及时性,内容观点的准确性,平台将不提供完全的内容展现,本页面内容仅为平台搜索索引使用。需阅读完整内容的用户,请查看原文,获取内容详情。

举报

  • 相关推荐
  • 忆联AM6B0:为端侧AI提速,UMA时代的大模型存储“标配”!

    NVIDIA统一内存架构让PC可运行千亿大模型,但对存储性能提出严苛要求。忆联AM6B0 SSD凭借满血性能、高低延迟与可靠设计,成为UMA时代大模型存储“标配”。实测加载千亿大模型仅需14.6秒,顺序读写达7100/6500 MB/s,综合性能领先同级竞品,有效缩短等待、释放生产力,全面补齐算力落地的关键一环。

  • 全栈AI巨头盘点:联想、阿里、华为、百度贯通算力‑大模型‑终端‑行业方案‑生态

    中国AI正加速推进算力、大模型与终端协同。联想以万全异构智算平台与问天超节点为训练推理底座,通过词元中枢统一调度模型,天禧AI连通PC、手机与平板,并以城市、制造智能体落地行业。阿里以平头哥芯片和阿里云为核心,千问模型贯通应用与终端。华为依托昇腾与盘古模型,连接鸿蒙终端与行业场景。百度则以昆仑芯和文心大模型,延伸至小度与智能驾驶。四家企业全栈路径各异,但均在真实业务中持续交付。

  • AI日报:火山引擎上线豆包搜索开放服务;WorkBuddy上线人机双写;OpenAI 推出GPT-5.6模型家族

    火山引擎上线豆包搜索服务,强化企业智能体信息基座;WorkBuddy推“人机双写”让AI融入文档协作。OpenAI发布GPT-5.6模型家族,性能与效率大幅提升。腾讯视频内测WorkSolo,布局AI短剧与互动影游。DeepMind新一代音乐模型Lyria 3.5及腾讯开源AngelSpec框架,分别在AI音乐创作与大模型推理吞吐上取得关键进展。字节跳动整合豆包、飞书、火山引擎,加速AI To B战略。

  • 企业AI落地:从大模型走向本体驱动的超级组织

    企业部署大模型后仍难落地,根因是缺乏统一业务语义与执行闭环。文章提出,企业AI真正的底层是“本体论+大模型+智能体AI”三层架构:本体定义业务对象与关系,让AI理解企业;大模型负责推理;智能体在治理框架内执行动作。以Orion AIP为例,通过构建统一本体、融合数据与规则,可实现风险分析等场景下的“感知-分析-决策-行动”闭环,让AI从对话工具进化为能工作、可追溯、可信赖的组织核心。

  • 《云上Agent基准度量模型》正式发布,腾讯云推动云上Agent安全、稳定、可信

    《云上Agent基准度量模型》正式发布,腾讯云旗下WorkBuddy等产品首批通过认证。该标准由中国信通院牵头,从功能、安全、可靠等六大维度评估Agent,并引入“双重授权”与分级人机协作机制,为自动化操作设定可控边界,推动Agent从“能完成任务”走向“可稳定运行”。腾讯云基于丰富的产品矩阵与安全实践参与编制,为金融、政务等高安全场景提供了可量化的建设参考。

  • 阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型

    阿里发布新一代语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点优化了专业词汇的识别表现。该模型已在医疗等垂直场景中展现出较高准确率,相关听写准确率突破九成五。 语音识别在通用对话中已相对成熟,但在医学、法律、工业等专业领域,由于术语密集且发音相近词多,模型常常出现误判。此次新模型强化了对专业词的处理能力,使其更贴合真实行业场景的需求。

  • OpenAI为免费用户升级至GPT-5.6 Luna,开放更多功能权限

    OpenAI宣布对ChatGPT进行更新,在提升日常对话体验的同时,为免费用户开放更多功能权限。对于Plus和Pro用户,OpenAI更新了聊天界面,优化了交互体验。 此次升级的核心是GPT-5.6 Luna模型的推出。与上一代模型相比,Luna在逻辑推理、多轮对话和创造性写作方面均有提升。免费用户无需订阅即可体验新模型,这被视为OpenAI吸引和留住用户的重要举措。此前,OpenAI曾因DeepSeek等低成本A

  • 模型打底、千问办公上桌,阿里再战 AI 局

    中国AI大模型的参数竞赛,已经进入到万亿规模时代。 8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,核心旗舰模型为Qwen3.8-Max,总参数达2.4万亿、单次激活95B、1M上下文长度、支持视觉理解。 就在Qwen3.8发布的同一周,Kimi K3以2.8万亿参数强势开源,MiniMax的M3Pro也达到2万亿参数级别,并传出即将开源的消息。 此外,包括DeepSeek V4Pro、文心5.0、MiMo-V2.5-Pro、LongCat-2.0等国产AI�

  • 特斯拉车机系统更新:首次接入豆包大模型

    特斯拉中国今日发布2026.14.13版本车载系统更新,即日起面向Model 3、Model Y、Model S、Model X 四款车型分批推送。 总体上看,本次升级囊括智能大模型接入、车载场景实用功能、交互体验优化以及多项系统安全漏洞修复,改动覆盖用车全场景。 值得一提的是,本次更新最大亮点,是特斯拉国内车载系统首次搭载第三方大模型字节跳动豆包大模型正式入驻车机,接替原有语音体系�

  • 腾讯 Hy3模型限免再延长,免费额度用到8月31日

    腾讯宣布,CodeBuddy 和 WorkBuddy 中 Hy3模型调用限时免费活动延长至8月31日。这已经是第二次延期,今年7月腾讯就曾把活动延长到8月5日,这次再往后推了近一个月。 Hy3模型于7月6日发布并开源,是一个快慢思考融合的大语言模型,采用 MoE 架构,总参数295B,激活参数21B,最大支持256K 上下文长度。参数规模放在开源模型里属于第一梯队。 针对这次延期,官方补充了两点说明。Hy

今日大家都在搜的词: