11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
红熊AI指出普通大模型“什么都懂却不认识你”,每次对话清零,企业落地难。其自研OpenBear记忆型全模态大模型,在预训练阶段植入原生记忆架构,不依赖外挂,解决语义、更新、闭环割裂。底层MemoryBear引擎分层管理记忆,中层OpenBear/CodeBear,上层四大Agent应用,让AI从会回答走向认识人。
本周DeepSeek发布了V4.1 Flash,这个大模型架构变化之大,完全可以称得上是V5了,但DeepSeek很低调地没换大版本号。 Pro系列的新品确定了是V4.1 Pro,具体升级还没公布,如果是V4到V4.1这样的提升幅度,那V4.1 Pro性能上限也会很高,但考虑到之前V4 Pro-0813正式版的不及预期,大家期待值不要拉太高。 后续还有一波大模型,爆料者称它叫做DeepSeek Code 2.0,即将发布,时间窗口是9月份,
零犀科技以因果大模型切入高合规垂直场景,定位AI Native,按业务结果收费。其自研因果推理模型融合行业数据,打造销售智能体与数字劳动力,实现从线索触达到交付转化的全AI闭环,已在保险、金融、汽车、教育等行业落地,服务泰康、京东科技等客户,2024年实现首年盈利。
今天(9月4日),OpenAI 发布新一代前沿模型 GPT-6Astra,并直接甩下一句:Welcome to the AGI era(欢迎来到AGI时代)。 最近的大模型行业,新模型的出现简直像坐火箭。9月仅仅过去了四天,就有四家海外巨头轮番上阵。第一天,Anthropic宣布推出Claude Fable5.1和Mythos5.1。第二天,谷歌发布了Gemini3.8Flash和专攻网络安全的Gemini3.8Flash Cyber,Meta祭出Muse Spark1.3。 国内市场的发布节奏同样快得惊人
当地时间本月8日,OpenAI对外公布重磅成果,其一款尚未对外发布、数学能力显著强于GPT-6 Astra的内部大模型,借助约1万个AI智能体协同工作,仅耗时88小时,完成纳维 - 斯托克斯存在性与光滑性问题的证明。 这是克雷数学研究所2000年提出的七大千禧年大奖难题之一,悬赏奖金100万美元,困扰数学界近90年。 纳维-斯托克斯方程是描述流体运动的基础方程,广泛用于气象预报、�
小米发布表格数据基础大模型Xiaomi-TabLDM,一次预训练即可跨数据集直接完成分类回归,打破“一表一模型”。其采用大规模合成数据预训练、双流特征分组、稀疏MoE等,在TALENT、OpenML-CTR23等基准中处第一梯队,回归表现突出且推理高效;工业场景材料性能预测精度提升130%,生产误差降54%,小样本适配优势明显。
最近,大模型厂商集体看向了“Flash”。 变化可以从7月份的一个发布日开始追溯,7月21日,Google DeepMind一口气端出三款Flash模型,但旗舰Gemini3.5Pro缺席。 彼时,Gemini3.6Flash的表现被吐槽不如中国一线开源模型,但国内大模型厂商们却一同捕捉到Flash背后的产业信号,纷纷跟进布局这一效率架构路线。 十天后,国内大模型市场,DeepSeekV4Flash正式版上线并开源,284B总参数、每次�
今日,国产大模型厂商智谱正式入驻天猫开设官方旗舰店,将售卖Coding Plan套餐等产品。 目前在售商品包括个人版的Lite、Pro、Max等类别,可按月/季/年购买订阅。消费者打开淘宝搜索「智谱旗舰店」,就能进店下单所需的Coding Plan订阅套餐。 以后买Token可以像充话费一样丝滑方便,未来还能在大促等节点享受折扣优惠。 此外,除了虚拟充值服务,天猫上还有丰富的AI智能硬件
AI日报要点:千问办公上线Qwen3.8-Flash,推双模式;智谱开源GLM-5.3-Flash,价格降至1/40;腾讯混元1.8B翻译模型压缩至440MB,用于B站弹幕实时翻译;北京首例AIGC商业秘密案罚10万;京东发布“超脑”3.0物流大模型;FF发布两款机器人;谷歌升级Gemini Live语音;Claude Cowork内置浏览器,可独立完成网页操作。
今晚除了智谱会开源牛来大模型之外,阿里旗下的千问也发布了Qwen3.8-Flash大模型,虽然它还在用3.X版本的名字,但实际上是下一代Qwen4架构了。 千问之前就解释过,Qwen3.8-Flash是为了让开源社区提前体验Qwen4架构的新技术,是下代大模型的技术预览版。 据官方介绍,Qwen3.8-Flash是一个多模态 MoE 模型,125B 参数 51B N-gram 嵌入,每个令牌仅激活 6B,262K 原生上下文,可通过 YaRN 扩展