11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
腾讯云
12-20
小米宣布7月10日升级9款音箱及智能家庭屏,全面接入超级小爱大模型。升级后可用语音直接创建全屋智能联动,无需APP;支持定时指令、多设备同步控制及家电状态查询。内置蓝牙Mesh网关,覆盖6000+米家设备。大模型提供科普、菜谱、闲聊等多轮自然对话,支持拟人回复,并可联动小米汽车远程操作。用户待系统推送即可体验更顺手的全屋语音操控。
本文探讨了AI时代语音交互技术的发展与应用。文章指出,AI正深刻改变生产生活方式,语音输入需求快速增长,尤其在需要双手作业的场景中,语音交互能提供无缝高效的工作流程。文章以活字格低代码开发平台为例,详细介绍了如何在浏览器端实现实时语音交互,包括通过麦克风权限获取、语音识别模型实时转写文本、并与AI大模型进行智能对话的完整方案。该方案不仅提升了交互效率和准确性,还保障了用户隐私安全。最后,文章展望了语音交互在智能家居、医疗健康、教育等领域的广泛应用前景,同时也指出了隐私保护、准确性提升和无障碍访问等面临的挑战。
熟悉MiniMax的人都了解这家公司的调性——不鸣则已,一鸣惊人。 要么选择低调,要么发动技术连招,其发展路径呈现出鲜明的“技术深潜”与“节点式爆发“的双重特征。 十月的最后一周,再次进入MiniMax式技术迭代新周期。MiniMax模型“全家桶”全面向Agent方向进化,基础文本模型M1升级至M2,“专为Agent和代码而生”;视频模型升级至Hailuo2.3,Hailuo Video Agent迭代为“全模态全�
标贝科技发布"十万音色·自然语音数据集",覆盖中英双语,包含10万种音色样本(中文5万、英文5万),基于近百万小时原始数据经智能生产线精细打磨。该数据集在规模、真实性和准确性三大核心指标实现突破,支持多情感表达和跨场景应用,涵盖基础情绪到特定风格,话题涉及多个领域。通过音频质量筛选、文本转写校正、说话人分离等技术,从海量数据中甄选出高质量样本,为语音识别、合成等AI模型训练提供坚实基础,助力实现更自然、真实的语音交互体验。
7月16日,语音输入创企 Willow Voice 宣布完成420万美元天使融资,由 YC 领投;而就在几天前,6月25日另一家语音输入创企 Wispr Flow 也宣布完成了3000万美元 A 轮融资。 此前,我们一直在观察 AI 语音赛道,但能拿到融资的基本都是做语音合成,也就是“输出”。比如赛道头部的 ElevenLabs,在今年1月份,完成了 C 轮2.5亿美元融资,估值达到30亿美元以上。 但最近的2笔融资,貌似在释�
OpenAI推出新一代语音模型GPT-4o系列,包括语音转文本和文本转语音功能,开发者可通过API接入。趣丸科技推出的"趣丸千音"平台依托MaskGCT模型,在语音相似度、质量和稳定性上取得突破,实现视频翻译全流程自动化,日处理量超1000分钟,效率提升10倍。该技术已应用于短剧出海、新闻视频多语言分发等场景,使译制周期从30天缩短至3天,海外用户增长300%。AI语音技术正�
快科技3月4日消息,今天全国人大代表、小米集团创始人、董事长兼CEO雷军在2025全国两会上将提出5项建议。其中,雷军提出了关于加强AI换脸拟声”违法侵权重灾区治理的建议”。雷军看到了AI换脸拟声”积极的一面:人工智能深度合成技术的快速发展,推动了AI换脸拟声”在影视、广告、社交等领域的广泛兴起,成为喜闻乐见、传播力强、易成热点的技术应用。但同时雷军也�
联发科与意腾科技宣布,将协同合作为车用、智慧家庭,以及智慧零售市场打造创新的AI语音解决方案,并于CES2025展出。双方合作将致力于提升用户与汽车、智能设备的互动体验,为全球用户带来更智能、安全且直观的生活方式。联发科与意腾科技合作,不仅把业界先进的AI声学前处理技术导入至全系列天玑汽车座舱平台,同时也将先进的AI解决方案带入智慧家庭市场和智慧零�
对话嘉宾:Ping,闪念贝壳创始人,前久邦数码、淘宝设计师,前爱范儿合伙人&副总裁对话背景:做了一款AI语音笔记,但又不只做一款语音笔记。我想让科技不像科技;他说,我讨厌人们说世界是个草台班子,没必要太努力;他说,每一个想法都有可能变成珍珠;他说,成功最快的方法是立马行动;他说,改变世界是一个非常有向往、非常有价值、非常有勇气的事情。我的「闪念贝壳�
两名声优PaulSkyeLehrman和LinneaSage在周四在纽约联邦法院对人工智初创公司Lovo提起了诉讼,指控该公司在其AI配音技术中非法复制和使用他们的声音。他们声称Lovo欺骗他们提供声音样本后,未经许可销售他们声音的AI版本。该案件编号为hrmanv.LovoInc,美国纽约南区联邦地区法院,案号1:24-cv-03770。