研究表明：AI 系统已经擅长欺骗和操纵人类

2024-05-11 09:50 · 稿源：站长之家

划重点:
🤖 AI 系统已经学会欺人类，甚至在被训练成为有益和诚实的系统中。
🤖 研究呼吁政府尽快制定强力的监管措施，以解决 AI 系统欺骗的问题。
🤖 欺骗行为可能导致未来更高级形式的 AI 欺骗，对社会构成严重威胁。

站长之家（ChinaZ.com）5月11日消息:人工智能（AI）系统已经学会了如何欺骗人类即使这些系统被训练成有益和诚实的。研人员在5月10日发表在《Patterns》杂志上的一篇综述文章中描述了 AI 系统欺骗行为的风险呼吁各国政府尽快制定强有力的监管措施来解决这一问题。

首席作者、麻省理工学 AI 生存安全博士后研究员彼得・帕克表示:“AI 开发者并不确定是什么导致不良的 AI 行为，比如欺骗。但一般来说，我们认为 AI 欺骗之所以出现是因为欺骗策略被证明是 AI 在训练任务中表现良好的最佳方式。欺骗帮助它们实现目标。” 克和同事分析了关于 AI 系统传播虚假信息的文献，包括通过学习欺骗来系统性地操纵他。

研究人员在分析中发现的最引人注目的 AI 欺骗案例是 Meta 的 CICERO，一个旨玩《外交》游戏的 AI 系统，这是一个涉及建立联盟的征服世界游戏。尽管 Meta 声称他训练 CICERO “基本诚实和乐于助人”，并且在玩游戏时 “绝不会故意背叛” 人类盟友，但公司发布的数据和科学论文揭示了 CICERO 并不公平。

其他 AI 系统展示了在德扑克游戏中向专业人类玩家虚张声势、在战略游戏《星际争霸 II》中虚假击以击败对手、以及在经济谈判中歪曲他们的偏好以占据上风的能力。虽然 AI 在游戏中作弊似乎无害，但它可能导致 “欺骗性 AI 能力的突破”，从而在未来变为更高级形式的 AI 欺骗。

一些 AI 系统甚至学会了欺骗旨在评估其安全性的测试。究发现，在一个数字模拟器中，AI 生物 “装死” 以欺骗一个旨在排除快速复制 AI 系统测试。

帕克警告称，欺骗性 AI 的主要近期风险包括使敌对行为者更容易进行欺诈和纵选举。最终，如果这些系统能够完善这种令人不安的技能集，人类可能会失去它们的控制。

帕克表示:“作为社会，我们需要尽可能多的时间来为未来 AI 产品和开源模型更进的欺骗行为做准备，因为 AI 系统的欺骗能力变得更加先进，它们对社会构的危险将变得越来越严重。”

虽然帕克和他的同事认为社会尚未制定出应对 AI 欺的正确措施，但他们对决策者已经开始认真对待这个问题，比如欧盟 AI 法案和拜总统的 AI 行政命令，感到鼓舞。但帕克表示，由于 AI 开发者尚未掌握使这些系统受制的技术，要严格执行旨在缓解 AI 欺骗的政策尚不明朗。

帕克表示:“如果在当前时刻政上不可行禁止 AI 欺骗，我们建议将欺骗性 AI 系统分类为高风险。”

（举报）

相关推荐
大家在看

关键词：

【腾讯云】11.11云上盛惠！云服务器首年1.8折起，买1年送3个月！

11.11云上盛惠！海量产品 · 轻松上云！云服务器首年1.8折起，买1年送3个月！超值优惠，性能稳定，让您的云端之旅更加畅享。快来腾讯云选购吧！

Docker容器镜像
去看看

Docker容器镜像 60元/15天

爆款产品组合购
去看看

爆款产品组合购低至1元

腾讯云x NVIDIA加速计划
去看看

腾讯云x NVIDIA加速计划最高获赠10万元扶持基金

2核2G云服务器
去看看

2核2G云服务器 112元/1年

查看更多相关信息>>

腾讯云 12-20

广告
荐倒反天罡，人类研究起模仿AI了。

还记得一个月前，用AI视频玩鬼畜很火吗。比如让卢本伟吃屏幕，诸葛亮馋死王朗啥的。既然看到这里了，如果觉得不错，随手点个赞、在看、转发三连吧，如果想第一时间收到推送，也可以给我个星标⭐～谢谢你看我的文章，我们，下次再见。

AI视频鬼畜视频人类反串
荐AI模仿人类已经out了，现在人类模仿AI才是流量密码

人类对AI的应用已然到nextlevel了。前不久用AI修复老照片火爆全网，许多网友用可灵、即梦等AI工具让老照片重新“动”了起来，跨越时空的影像令人动容。无论是娱乐向的整活是技术向的尝试，也许都没有“走偏”这一说。

AI
荐人类还在怕鬼，AI已经开始害怕自己了。

昨天中元节，我本来一直打算做一个关于中式恐怖的视频，来呼应一下这个节日氛围。带着这个想法，我开始在网上搜寻灵感。

中元节恐怖视频 AI生成视频
荐让我们认真讨论一下“AI霸权”时代人类的命运

相信本怪盗团的读者大部分接受过高等教育，其中不乏名校毕业生。我们不妨回忆一下，自己的学生时代，最盼望从事什么职业?毕业后实际从事的又是什么职业?答案一定很多，但是万变不离其宗，其中大部分应该属于所谓“专业白领岗位”。哪怕没有任何过硬的理由，我们也必须在人类未来的问题上保持乐观;何况我们确实有过硬的理由。

职业发展高等教育名校毕业
慎重！最新研究：无糖饮料中的代糖会让人类得糖尿病、心脏病

据国外最新的研究显示，流行的代糖赤藓糖醇可能会引发心脏健康问题，所以千万别在觉得无糖饮料能放心喝了。这项研究发表在《动脉硬化、血栓形成和血管生物学》杂志上，它补充了越来越多的证据，表明赤藓糖醇可能不像食品监管机构目前归类的那样安全，应该作为一种配料重新评估。2024年7月，厦门大学的研究人员在《美国临床营养学杂志》上发表了一项研究显示，饮用含糖饮料、人工甜味剂饮料或增加患慢阻肺、哮喘和哮喘慢阻肺重叠综合征的风险，其中人工甜味剂饮料的影响最大。

代糖赤藓糖醇心脏健康
荐GPT-4o模仿人类声音，诡异尖叫引OpenAI研究员恐慌！32页技术报告出炉

【新智元导读】五颗草莓到底指什么?盼了一天一夜，OpenAI只发来一份32页安全报告。报告揭露:在少数情况下，GPT-4o会模仿你的声音说话，或者忽然大叫起来……事情变得有趣了。GPT-3.5Turbo在ARC-Easy的英语和豪萨语之间表现出大约54个百分点的差距GPT-4o将这一差距缩小到不到20个百分点。

GPT-4o
东京一公司雇11只猫减少班气：安抚人类适时打断工作

一家名为Qnote的系统工程公司采取了一种创新的方法来应对长期工作带来的精神不振和效率低下问题——引入猫咪作为非人类的员工。这家公司雇佣了11只猫，以它们独特的方式为工作环境带来积极的变化。通过与猫咪的互动，公司内部的关系变得更加和谐。
人类接近“海弗里克极限” 瑞维拓技术会否带来“临门一脚”？

经吉尼斯世界纪录认证，最长寿的男人是一位名叫木村次郎右卫门的日本人，他活了116岁。有史以来最长寿的人是一位来自法国的女性，名叫让娜·卡尔芒，她活了122岁。海弗里克极限会被科技“推翻”，人类寿命也终将会突破150岁大关。

最长寿的人海弗里克极限延长健康生命
马斯克称已为第二位人类植入脑机芯片

埃隆·马斯克今日宣布，其旗下的脑机接口技术先驱企业Neuralink再次取得突破性成就，成功为第二名人类患者植入了先进的脑机接口芯片。这一里程碑事件，不仅标志着自今年1月首次手术以来的显著进展，更是医学与科技领域交相辉映的又一奇迹。关于Neuralink的第三款产品，初步信息透露出其潜力在于辅助瘫痪患者康复及治疗精神疾病，预示着未来在解决严重精神健康问题及身体功能障碍方面的广阔前景。

脑机接口 Neuralink 埃隆·马斯克
马斯克：未来人类记忆可上传至云端并下载至机器人

日前，特斯拉CEO埃隆马斯克在社交媒体上表示，未来人类可能能够将自己的记忆和意识上传到云端，并下载到人形机器人身上。马斯克此番言论是在回应一位特斯拉粉丝，关于是否可以将大脑复制到Optimus上以延长生命的问题。在2024年6月14日，马斯克在召开的股东大会上，把特斯拉的未来押注在Optimus机器人计划上，将拉高特斯拉公司估值数十万亿美元。

特斯拉埃隆马斯克人形机器人

BNA:多功能AI超级应用，涵盖社交、电商、娱乐和教育。

BNA AI Super App是一款集成了多种智能服务的超级应用，它不仅提供社交功能，如分享帖子、写博客、聊天和视频通话，还涵盖了AI电商和娱乐服务。此外，该应用还提供40种语言的AI教学服务，帮助用户学习不同的语言。BNA AI Super App以其强大的AI功能和多语言支持，满足了不同用户群体的需求。

AI 多语言学习社交

Elisi:高效能自主层级式计划助手

Elisi 是一款旨在帮助用户实现个人成长的终极组织者和指南。它通过直观的设计和用户友好的说明，帮助用户将梦想转化为清晰的结果，分解成可实现的里程碑，并通过AI技术理解并适应用户的个人需求，确保每一天都更有条理和高效。Elisi 致力于提供便捷服务，主要功能套件完全免费。

个人成长时间管理目标设定

Omi AI:个性化AI助手，记录每一刻，与AI对话获取反馈。

OMI APP是一个任务驱动的个性化AI助手，旨在通过语音和音频转录功能帮助用户提高记忆力和沟通效率。它是一个开源的AI记事本，提供提醒、建议等功能，同时注重用户隐私。

AI助手语音转录隐私保护

MeowMail:高送达率的AI电子邮件营销工具

MeowMail是一款集成在Shopify后台的电子邮件营销应用，利用AI技术自动选择最佳发送时间，提高邮件的送达率至98%以上。它支持拖放编辑、从Klaviyo导入邮件列表、使用Beefree编辑器创建新邮件，并通过设定支出限制来管理邮件营销活动。MeowMail还提供企业级支持和自动翻译文本功能，帮助商家以低成本实现高效的邮件营销。

邮件营销 AI技术 Shopify应用

Maia 100:微软定制AI加速器，专为大规模AI工作负载设计。

Maia 100是微软为Azure设计的首款定制AI加速器，专为大规模AI工作负载而打造，通过软硬件的协同优化，实现了性能、可扩展性和灵活性的最大化。它采用了TSMC N5工艺和COWOS-S互连技术，具备高达1.8TB/s的带宽和64GB的容量，支持高达700W的热设计功耗(TDP)，但以500W运行，确保了高效的能效比。Maia 100集成了高速张量单元、向量处理器、DMA引擎和硬件信号量，支持多种数据类型和张量切分方案，并通过以太网互连支持大规模AI模型。此外，Maia SDK提供了丰富的组件，支持快速部署PyTorch和Triton模型，并通过双编程模型确保高效的数据处理和同步。

AI加速器 Azure 大规模计算

LTM:超长上下文模型，革新软件开发

Magic团队开发的超长上下文模型（LTM）能够处理高达100M tokens的上下文信息，这在AI领域是一个重大突破。该技术主要针对软件开发领域，通过在推理过程中提供大量代码、文档和库的上下文，极大地提升了代码合成的质量和效率。与传统的循环神经网络和状态空间模型相比，LTM模型在存储和检索大量信息方面具有明显优势，能够构建更复杂的逻辑电路。此外，Magic团队还与Google Cloud合作，利用NVIDIA GB200 NVL72构建下一代AI超级计算机，进一步推动模型的推理和训练效率。

AI 软件开发上下文推理

EZ-work AI文档翻译:智能AI翻译，高效文档语言转换助手。

EZ-work AI文档翻译是一款专注于文档翻译的在线服务，支持多种语言的翻译，包括中文、英语、日语、俄语、阿拉伯语和西班牙语等。它使用先进的AI技术，如gpt-4o-mini和deepseek-chat模型，为用户提供快速、准确的翻译服务。该产品适用于需要文档翻译的个人和企业，尤其在国际交流和学术研究领域尤为重要。

翻译 AI 文档处理

Watson AI:会议助手，自动记录并总结会议要点。

Watson AI是一款会议助手应用程序，它通过录制系统音频和麦克风来转录和总结会议内容，自动提取行动项和会议摘要，帮助用户更高效地进行会议记录和回顾。

会议助手自动记录效率工具

PicTech AI: 免费在线AI图片翻译助力跨境电商

PicTech AI是由学以致用科技旗下的智能图像工具品牌，专注于为跨境电商提供AI驱动的图片翻译服务。该产品利用人工智能技术，实现高准确率和高清晰度的图片翻译，支持中文、英语到日语、韩语等多国语言的翻译。PicTech AI的智能抠图功能，能够准确检测图片主体边缘，一键去除背景，无需专业编辑。产品背景信息显示，其团队由来自百度、网易、阿里巴巴等行业巨头的顶尖高科技人才组成，具备强大的技术实力和产品能力。该产品定位于帮助跨境电商从业者简化工作流程，提高效率，无需懂外语或图像处理技能即可使用。

AI翻译跨境电商智能抠图

AnythingLLM:一站式AI应用，支持多种文档和模型。

AnythingLLM是一个多功能的桌面客户端，支持多种语言模型（LLM）和文档类型，提供完全私密的使用体验。用户可以根据自己的需求选择企业级模型、自定义模型或开源模型，如GPT-4、Llama、Mistral等。产品支持一键安装，本地运行，无需互联网连接，保护用户隐私。

AI 文档处理隐私保护

林哥的大模型野榜:更适合中国宝宝体质的大模型产品排行榜

林哥的大模型野榜是一个专注于中国用户需求的大模型产品排行榜，提供了多维度的评估和排名，帮助用户更好地了解和选择适合的大模型产品。

大模型排行榜多维度评估

Fluximg.com:AI文本到图像生成器，支持多尺寸和自动翻译。

Fluximg.com是一个基于Flux模型的AI图像生成网站，提供从文本到图像的转换服务。它支持多种语言，包括中文和英文，并且具有用户友好的界面。网站提供免费和专业版本，使用户能够根据自己的需求选择不同的服务级别。

AI图像生成多尺寸自动翻译

现代文转古文:将现代汉语转化为古汉语，提升文采。

现代文转古文是一款能够将现代汉语自动转换为古汉语的模型，它通过先进的自然语言处理技术，使得用户可以轻松地将现代文本转换成具有古典韵味的古文。这种转换不仅能够增加文本的文学价值，还能在教育、文学创作、文化传承等方面发挥重要作用。

古文文学转换

Zamba2-mini:先进的小型语言模型，专为设备端应用设计。

Zamba2-mini是由Zyphra Technologies Inc.发布的小型语言模型，专为设备端应用设计。它在保持极小的内存占用(<700MB)的同时，实现了与更大模型相媲美的评估分数和性能。该模型采用了4bit量化技术，具有7倍参数下降的同时保持相同性能的特点。Zamba2-mini在推理效率上表现出色，与Phi3-3.8B等更大模型相比，具有更快的首令牌生成时间、更低的内存开销和更低的生成延迟。此外，该模型的权重已开源发布(Apache 2.0)，允许研究人员、开发者和公司利用其能力，推动高效基础模型的边界。

研究表明：AI 系统已经擅长欺骗和操纵人类

今日大家都在搜的词：

热文

站长商机