11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
小米发布表格数据基础大模型Xiaomi-TabLDM,一次预训练即可跨数据集直接完成分类回归,打破“一表一模型”。其采用大规模合成数据预训练、双流特征分组、稀疏MoE等,在TALENT、OpenML-CTR23等基准中处第一梯队,回归表现突出且推理高效;工业场景材料性能预测精度提升130%,生产误差降54%,小样本适配优势明显。
最近,大模型厂商集体看向了“Flash”。 变化可以从7月份的一个发布日开始追溯,7月21日,Google DeepMind一口气端出三款Flash模型,但旗舰Gemini3.5Pro缺席。 彼时,Gemini3.6Flash的表现被吐槽不如中国一线开源模型,但国内大模型厂商们却一同捕捉到Flash背后的产业信号,纷纷跟进布局这一效率架构路线。 十天后,国内大模型市场,DeepSeekV4Flash正式版上线并开源,284B总参数、每次�
今日,国产大模型厂商智谱正式入驻天猫开设官方旗舰店,将售卖Coding Plan套餐等产品。 目前在售商品包括个人版的Lite、Pro、Max等类别,可按月/季/年购买订阅。消费者打开淘宝搜索「智谱旗舰店」,就能进店下单所需的Coding Plan订阅套餐。 以后买Token可以像充话费一样丝滑方便,未来还能在大促等节点享受折扣优惠。 此外,除了虚拟充值服务,天猫上还有丰富的AI智能硬件
AI日报要点:千问办公上线Qwen3.8-Flash,推双模式;智谱开源GLM-5.3-Flash,价格降至1/40;腾讯混元1.8B翻译模型压缩至440MB,用于B站弹幕实时翻译;北京首例AIGC商业秘密案罚10万;京东发布“超脑”3.0物流大模型;FF发布两款机器人;谷歌升级Gemini Live语音;Claude Cowork内置浏览器,可独立完成网页操作。
今晚除了智谱会开源牛来大模型之外,阿里旗下的千问也发布了Qwen3.8-Flash大模型,虽然它还在用3.X版本的名字,但实际上是下一代Qwen4架构了。 千问之前就解释过,Qwen3.8-Flash是为了让开源社区提前体验Qwen4架构的新技术,是下代大模型的技术预览版。 据官方介绍,Qwen3.8-Flash是一个多模态 MoE 模型,125B 参数 51B N-gram 嵌入,每个令牌仅激活 6B,262K 原生上下文,可通过 YaRN 扩展
十方融海联合广东工业大学、南洋理工大学提出YARD方法,通过“退化分支”与完整图像对照抑制视觉大模型幻觉,无需额外训练、节省算力,幻觉率降低、准确率提升。论文获EMNLP 2026录用,创始人与业务负责人共同署名,体现产学研结合,助力视觉大模型可靠落地。
Physical AI落地制造需工业大模型作决策中枢并协同软硬件。思谋自研IndustryGPT,基于真实制造数据优化缺陷识别、工艺推演,可轻量化部署边缘硬件,断网本地推理。其串联感知、推理、执行三层闭环,已交付约14万智能体、检测超170亿件零部件,服务特斯拉等,打通数据链路,形成全栈落地能力。
在今日举办的小米玄戒技术沟通会上,小米AI Cube Prototype工程版迷你主机正式亮相。 该主机采用三芯协同架构,由玄戒O3、玄戒O100及玄戒D100三颗自研芯片组成,持续性能释放高达150W,实现了超大规模大模型在端侧的本地部署。 作为核心算力来源,玄戒O3定位AI旗舰SoC,采用了10核全大核CPU架构及16核G2-Ultra NX GPU,并集成200 TOPS的低功耗NPU。 为了解决AI推理中的数据传输瓶颈,�
AI日报要点:商汤开源8B多模态模型;腾讯Hy4将发布,驱动WorkBuddy;Grok Build上线,自然语言生成应用;Adobe Firefly音频工具上线;阿里Qwen-UI-Agent在GUI基准超越GPT/Claude;研究称ChatGPT后超三成网页现AI痕迹;千问新增GLM-5.3、DeepSeek-V4-Pro;豆包上线技能、连接器与工作伙伴。
前不久的财报会议上腾讯预告将发布新一代大模型Hy4,现在这个模型已经有疑似内部界面泄露,意味着发布时间不远了。 在模型选择界面中,腾讯提供了三个选择Hy4,标注为专家级大模型,其次是是Hy3,有个新升级的标志,介绍是全新模型,适用大部分场景。 还有一个选择是DeepSeek,介绍说明是专注推理与理解。 腾讯之前的战略中也是如此,除了部署自家的大模型之外,也