据央视新闻报道,在今日的2020中关村论坛新闻发布会上,北京经济技术开发区管委会常务副主任、北京市高级别自动驾驶示范区建设工作专班负责人孔磊表示,北京将建设全球首个高级别自动驾驶示范区。孔磊表示,北京市拟在前期领先的工作基础上,瞄准L4 级以上高级别自动驾驶车辆规模化运行,统筹“车、路、云、网、图”等各类优质要素资源,规划建设高级别自动驾驶示范区,实现L4 级自动驾驶出租车、智能网联公交车、自主代客泊车等高级别应用场景。
(举报)
据央视新闻报道,在今日的2020中关村论坛新闻发布会上,北京经济技术开发区管委会常务副主任、北京市高级别自动驾驶示范区建设工作专班负责人孔磊表示,北京将建设全球首个高级别自动驾驶示范区。孔磊表示,北京市拟在前期领先的工作基础上,瞄准L4 级以上高级别自动驾驶车辆规模化运行,统筹“车、路、云、网、图”等各类优质要素资源,规划建设高级别自动驾驶示范区,实现L4 级自动驾驶出租车、智能网联公交车、自主代客泊车等高级别应用场景。
(举报)
11.11云上盛惠!海量产品 · 轻松上云!云服务器首年1.8折起,买1年送3个月!超值优惠,性能稳定,让您的云端之旅更加畅享。快来腾讯云选购吧!
近日,自动驾驶技术公司Mobileye发布公告称,公司已终止用于自动驾驶系统的下一代激光雷达的内部开发。Mobileye表示,鉴于公司在基于EyeQ6的计算机视觉感知方面取得的实质性进展,以及公司内部开发的成像雷达性能和清晰度的提高,再加上第三方的飞行时间激光雷达装置的成本效益超出预期。你觉得激光雷达对车辆高阶智驾有用吗?
快科技9月23日消息,梅赛德斯-奔驰宣布对其L3级有条件自动驾驶系统进行升级。据悉,新版本的DRIVE PILOT驾驶领航系统将允许在德国高速公路上的最高速度提升至95公里/小时,而此前的限速为60公里/小时。这一升级预计将在2025年初在德国上市。升级后的系统将支持更多使用场景,包括在高速公路拥堵路段以及特定条件下的高速公路右侧车道自动跟随前车行驶。DRIVE PILOT系统采用冗余设计,确保在某个系统发生故障时车辆仍能安全运行,允许驾驶员在有条件自动驾驶期间将注意力转移到其他活动上,如办公、上网或观看视频。奔驰的目标是到2030年前
日前,在2024全球智能汽车产业大会上MomentaCEO曹旭东发表了主题演讲。曹旭东表示:实现可规模化的L4,最关键的点是安全,至少要实现10倍人类的安全性。新能源用了五年时间渗透率增加到50%以上,我们预判高阶智驾速度更快,未来五年的时间渗透率会增加到70�%。
AMD宣布推出AMD汽车车规级系列产品的最新成员ArtixUltraScaleXAAU7P”,一款拥有超小尺寸、优化成本的车规标准FPGA芯片,针对高级驾驶辅助系统、数字座舱信息娱乐系统进行了优化。咨询机构YoleIntelligence的数据显示,ADAS摄像头市场规模2023年估计为20亿美元,预计到2029年将达到27亿美元。客户已将新品设计到ADAS边缘设备中,比如热像仪、红外摄像头,可进行边缘传感器的数据采集、图像/视频处理能连接车载显示器,进一步增强信息娱乐功能。
快科技9月28日消息,在2024中国国际信息通信展会期间,华为光接入领域总裁冯志山在全光宽带高质量发展论坛发表了加速F5G-A万兆光网商用,迎接智能时代新机遇”发言。他指出,各类AI智能应用的快速涌现,驱动光宽产业加速向万兆光网演进,F5G-A万兆光网发展正当时。万兆光网产业也已进入规模爆发期,中国已有10 个省市先后发布打造万兆之城的产业政策,45个领先省份运营商已经率先开始50G PON的商用部署。华为推出业界首个品宽大模型,加速迈向L4自动驾驶网络。华为表示,AI赋能品质宽带运维,大幅降低运维复杂度,支持分钟级的故障诊断,?
9 月 12 日下午,“泛能网 2024 能碳数智新品发布会”在北京成功举办。会上发布了优先聚焦于三个场景的智能产品——能碳智控一体机,带来能源与碳排智能管理新体验。这是新奥泛能网在“双碳”战略大背景下,洞察到企业在存量博弈的时期,普遍存在价格竞争、产品同质化、用能排放约束,创新不足,增速放缓等痛点推出的新一代数智新品。发布会现场,来自能源行业的�
9月10日,在横琴粤澳深度合作区执行委员会的精心指导下,合作区城市规划和建设局成功举办了“科技引领智行未来——横琴智能网联自动驾驶汽车商业化试点启动仪式”。此次盛会不仅标志着横琴粤澳深度合作区正式迈入自动驾驶商业化运营的新纪元,更彰显了广州文远知行在推动该区域智慧交通发展中的核心作用与非凡贡献。文远知行将继续深耕自动驾驶技术,深化与更�
OpenAI宣布本周内,向所有ChatGPTPlus和Team用户开放高级语音模式。除了最初功能之外,OpenAI还新增了自定义指令、语音记忆存储、5种新声音、语速以及新增了50多种语音,同时支持中文模式。我可以用语音来写小说或者个人传记啦。
滁州市文化和旅游局党组书记、局长王连侠率队调研南谯区文旅项目。南谯区委常委、宣传部部长司学军,区文旅局、区教体局、区融媒体中心等单位相关负责同志陪同调研。中航未来·中国民航科普教育基地,在各级部门的指导下,将更加注重系统性、知识性、科学性、实践性和趣味性的航空研学内容搭建,拓宽学生的知识面,深化爱国主义教育,培养学生实践能力,为学生全面发展提供良好的成长空间。
据央视新闻介绍,日前哈伊高铁首座站房铁力站完工,标志着哈伊高铁全线站房工程建设取得阶段性进展。铁力站于2022年4月正式启动施工,是哈伊高铁全线最早开工的高铁站房,也是全线唯一一座旧站改造工程。全线设哈尔滨、哈尔滨北、呼兰北、兴隆镇西、绥化南、庆安南、铁力、日月峡、伊春西9座车站。
Canvas是OpenAI推出的一个新界面,旨在通过与ChatGPT的协作来改进写作和编码项目。它允许用户在一个单独的窗口中与ChatGPT一起工作,超越了简单的聊天界面。Canvas利用GPT-4o模型,能够更好地理解用户的上下文,并提供内联反馈和建议。它支持直接编辑文本或代码,并提供快捷操作菜单,帮助用户调整写作长度、调试代码等。Canvas还支持版本回溯,帮助用户管理项目的不同版本。
Text Behind Image 是一个开源的设计工具,允许用户轻松创建文字背景图片设计。它提供了一个简洁的界面,让用户可以自由地在图片上添加文字,创造出独特的视觉效果。这个工具对于设计师、社交媒体运营者和内容创作者来说非常有用,因为它可以快速生成具有吸引力的视觉内容。
torchao是PyTorch的一个库,专注于自定义数据类型和优化,支持量化和稀疏化权重、梯度、优化器和激活函数,用于推理和训练。它与torch.compile()和FSDP2兼容,能够为大多数PyTorch模型提供加速。torchao旨在通过量化感知训练(QAT)和后训练量化(PTQ)等技术,提高模型的推理速度和内存效率,同时尽量减小精度损失。
Liquid Foundation Models (LFMs) 是一系列新型的生成式AI模型,它们在各种规模上都达到了最先进的性能,同时保持了更小的内存占用和更高效的推理效率。LFMs 利用动态系统理论、信号处理和数值线性代数的计算单元,可以处理包括视频、音频、文本、时间序列和信号在内的任何类型的序列数据。这些模型是通用的AI模型,旨在处理大规模的序列多模态数据,实现高级推理,并做出可靠的决策。
NVLM-D-72B是NVIDIA推出的一款多模态大型语言模型,专注于视觉-语言任务,并且通过多模态训练提升了文本性能。该模型在视觉-语言基准测试中取得了与业界领先模型相媲美的成绩。
gradio-bot是一个可以将Hugging Face Space或Gradio应用转化为Discord机器人的工具。它允许开发者通过简单的命令行操作,将现有的机器学习模型或应用快速部署到Discord平台上,实现自动化交互。这不仅提高了应用的可达性,还为开发者提供了一个与用户直接交互的新渠道。
AI-Powered Meeting Summarizer是一个基于Gradio的网站应用,能够将会议录音转换为文本,并使用whisper.cpp进行音频到文本的转换,以及Ollama服务器进行文本摘要。该工具非常适合快速提取会议中的关键点、决策和行动项目。
VARAG是一个支持多种检索技术的系统,优化了文本、图像和多模态文档检索的不同用例。它通过将文档页面作为图像嵌入,简化了传统的检索流程,并使用先进的视觉语言模型进行编码,提高了检索的准确性和效率。VARAG的主要优点在于它能够处理复杂的视觉和文本内容,为文档检索提供强大的支持。
JoyHallo是一个数字人模型,专为普通话视频生成而设计。它通过收集来自京东健康国际有限公司员工的29小时普通话视频,创建了jdh-Hallo数据集。该数据集覆盖了不同年龄和说话风格,包括对话和专业医疗话题。JoyHallo模型采用中国wav2vec2模型进行音频特征嵌入,并提出了一种半解耦结构来捕捉唇部、表情和姿态特征之间的相互关系,提高了信息利用效率,并加快了推理速度14.3%。此外,JoyHallo在生成英语视频方面也表现出色,展现了卓越的跨语言生成能力。
PhysGen是一个创新的图像到视频生成方法,它能够将单张图片和输入条件(例如,对图片中物体施加的力和扭矩)转换成现实、物理上合理且时间上连贯的视频。该技术通过将基于模型的物理模拟与数据驱动的视频生成过程相结合,实现了在图像空间中的动态模拟。PhysGen的主要优点包括生成的视频在物理和外观上都显得逼真,并且可以精确控制,通过定量比较和全面的用户研究,展示了其在现有数据驱动的图像到视频生成工作中的优越性。
Whisper large-v3-turbo是OpenAI提出的一种先进的自动语音识别(ASR)和语音翻译模型。它在超过500万小时的标记数据上进行训练,能够在零样本设置中泛化到许多数据集和领域。该模型是Whisper large-v3的微调版本,解码层从32减少到4,以提高速度,但可能会略微降低质量。
Realtime API 是 OpenAI 推出的一款低延迟语音交互API,它允许开发者在应用程序中构建快速的语音到语音体验。该API支持自然语音到语音对话,并可处理中断,类似于ChatGPT的高级语音模式。它通过WebSocket连接,支持功能调用,使得语音助手能够响应用户请求,触发动作或引入新上下文。该API的推出,意味着开发者不再需要组合多个模型来构建语音体验,而是可以通过单一API调用实现自然对话体验。
Saylo AI是一个AI角色扮演游戏,让你与AI角色互动,探索多样化的戏剧性故事。它利用人工智能技术,提供沉浸式的互动体验,让玩家在虚拟世界中与AI朋友交流,体验不同的故事情节。Saylo AI的背景信息展示了其创新性和娱乐性,旨在为玩家提供一种全新的娱乐方式。目前产品处于推广阶段,价格未明确标注。
twinny是一个为Visual Studio Code用户设计的AI扩展,旨在提供个性化的编程辅助,提高开发效率。它通过集成先进的AI技术,帮助开发者在编码过程中快速解决问题,优化代码,并提供智能提示。twinny的背景是响应开发者对于更加智能和自动化编程工具的需求,它通过简化开发流程,减少重复劳动,从而让开发者能够专注于更有创造性的工作。
Buildpad 是一个旨在帮助创始人从概念到成功最小可行产品(MVP)的在线平台。它通过提供智能验证工具、AI引导的开发流程、进度跟踪以及个性化的项目见解,帮助用户构建能够获得市场认可的产品。Buildpad 的主要优点包括简化产品开发流程、提高产品成功率、以及提供个性化的指导和支持。
Novela是一个专注于AI时代技能学习的在线平台,提供早期访问服务,用户可以免费试用。它旨在帮助用户掌握AI相关的技能,以适应未来职场的需求。
interview.co是一个专注于简化招聘流程的视频面试软件。它通过提供在线视频面试、AI问题生成器和面试管理工具,帮助企业高效地筛选和评估候选人。产品背景信息显示,interview.co旨在解决传统面试中的时间消耗、日程安排困难和成本高昂等问题。价格方面,interview.co提供试用版,具体定价信息需进一步探索。
Open NotebookLM是一个利用开源语言模型和文本到语音模型的工具,它可以处理PDF内容,生成适合音频播客的自然对话,并将其输出为MP3文件。该项目的灵感来自于NotebookLM工具,通过使用开源的大型语言模型(LLMs)和文本到语音模型来实现。它不仅提高了信息的可访问性,还为内容创作者提供了一种新的媒体形式,使他们能够将书面内容转换为音频格式,扩大其受众范围。
Chital是一个为macOS平台设计的应用程序,它允许用户与Ollama模型进行聊天。这个应用具有低内存占用和快速启动的特点,支持多聊天线程,能够在不同的模型间切换,并支持Markdown格式。此外,它还能自动为聊天线程生成标题摘要。Chital的开发主要是为了满足开发者个人的使用需求,但也鼓励社区成员通过fork代码库来添加新功能。
SafeEar是一个创新的音频深度检测框架,它能够在不依赖于语音内容的情况下检测深度音频。这个框架通过设计一个神经音频编解码器,将语义和声学信息从音频样本中分离出来,仅使用声学信息(如韵律和音色)进行深度检测,从而保护了语音内容的隐私。SafeEar通过在真实世界中增强编解码器来提高检测器的能力,使其能够识别各种深度音频。该框架在四个基准数据集上的广泛实验表明,SafeEar在检测各种深度技术方面非常有效,其等错误率(EER)低至2.02%。同时,它还能保护五种语言的语音内容不被机器和人类听觉分析破译,通过我们的用户研究和单词错误率(WER)均高于93.93%来证明。此外,SafeEar还构建了一个用于反深度和反内容恢复评估的基准,为未来在音频隐私保护和深度检测领域的研究提供了基础。