11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
今日,小米正式发布机器人基座模型Xiaomi-Robotics-1,该模型基于10万小时真实世界操作数据完成预训练,结合跨本体后训练,真正实现具身基座模型的开箱即用”。 在预训练阶段,研发团队使用了10万小时真实世界操作轨迹。 这些数据通过通用操作接口设备Universal Manipulation Interface(UMI)采集,覆盖家庭、商业空间、工业场景、办公室及户外等多种环境,包含大量物体交互和�
自变量机器人今日正式开源具身基础模型Wall-OSS-0.5,全球首次实现无需下游任务后训练,预训练模型直接部署至机器人即可完成搬运、分拣、整理绳索等多种操作任务,在部分任务上零样本泛化表现接近常规微调水平。该模型通过梯度桥、视觉对齐动作分词器、动作空间监督流匹配和DMuon优化器四项改进,让主干网络真正掌握动作能力而非依赖外挂模块,在十余个真实机器人任
6月20日,华为发布盘古大模型5.5,五大基础模型全面升级。该模型采用业界首创的Triplet+Transformer统一预训练架构,能跨行业处理表格数据、时间序列数据和图片数据,显著提升预测精度和泛化能力。已在水泥、钢铁、电解铝、供热等多个工业场景落地应用:海螺水泥实现熟料强度预测,宝武钢铁高炉出铁温度合格率超90%,云南铝业年省电2600万度,天津供热能耗降低10%。模型聚焦工业领域,通过工艺优化和系统寻优,助力企业降本增效,推动行业智能化转型。
马斯克在社交平台宣布:Grok3即将推出,已完成预训练,其计算量比Grok2高10倍。作为马斯克麾下社交媒体平台X的强大后盾,Grok系列模型一直以其卓越的生成式人工智能技术引领潮流。Grok3的推出将进一步强化X平台的搜索功能、账户简介优化、帖子深度分析及智能回复等核心服务,为用户带来更加智能化、个性化的社交体验。
【新智元导读】全球顶会NeurIPS2024中,Ilya登场演讲,向全世界宣告:预训练结束了!数据如同化石燃料般难以再生,未来,AI的发展方向就是具备自我意识的超级智能。Ilya现身NeurIPS2024,宣布:预训练从此将彻底终结。毕竟预测未来是不可能的,任何事情都有可能发生。
CodeFuse-VLM是一个支持多种视觉模型和语言大模型的框架,用户可以根据自己的需求搭配不同的VisionEncoder和LLM。CodeFuse-VLM-14B模型在多个通用和代码任务上的性能超过LLAVA-1.5和Qwen-VL。CodeFuse-VLM还被用于训练网页图片到前端代码的多模态大模型,提高了前端工程师的开发效率。
谷歌AI研究团队最近提出了SpatialVLM,这是一种旨在增强视觉语言模型空间推理能力的创新系统。尽管先进的模型如GPT-4V在人工智能驱动任务中取得了显著进展,但它们在空间推理方面仍存在显著局限。-SpatialVLM的开发标志着人工智能技术的重大进步。
最新研究警告,大型模型在基准评估中可能面临潜在危害,原因是测试集中的数据可能意外进入预训练过程。这项研究由中国人民大学信息学院、高瓴人工智能学院和伊利诺伊大学厄巴纳-香槟分校的学者联合进行。对于未来的研究,需要进一步探讨不同程度的数据泄露对模型性能的影响,并在预训练中引入数据泄露进行更深入的模拟测试。
ULTRA是一个旨在推理知识图谱的预训练基础模型。ULTRA的关键创新在于它能够学习通用和可迁移的图表示无需依赖文本信息。ULTRA的通用性和可迁移性使其成为归纳和可迁移的知识图谱推理的有望选择,对于各种不同关系结构的新KGs都能表现出色。
陈丹琦团队近期发布了一项重要的研究成果,他们开发了一种名为LLM-Shearing的大模型剪枝法。这项技术允许将庞大的预训练模型剪枝至仅需3%的计算量和5%的成本,同时保持着SOTA水平的性能。这有望在大规模深度学习模型的研究和应用中产生广泛的影响。