首页 > 传媒 > 关键词  > 正文

AIGC日日生新,商汤发布SenseTrust治理平台,护航生成式AI可信发展

2023-07-17 15:58 · 稿源: 站长之家用户

( 2023 年 7 月 17 日,上海)生成式AI火爆全球,国内外AI大模型日新月异,人工智能加速走进日常生活。如何在技术“狂飙”的同时,引导技术应用的正向发展?在本年度世界人工智能大会上,商汤科技就此问题给出了答案:着眼现实问题,用可信AI基础设施“护航”大模型发展。

继 4 月发布自研大模型体系后,商汤迅速升级迭代,重磅推出全面升级的“商汤日日新SenseNova”。与之一起亮相的,还有商汤可信AI基础设施—SenseTrust。SenseTrust包含一套完整覆盖数据、模型、应用治理环节的可信AI治理工具,可为商汤自身及行业提供伦理、安全二维一体的检测与加固解决方案,推动发展安全可信的人工智能产业生态。

活动上,商汤副总裁、AI伦理与治理委员会主席张望表示:“技术规模化落地有两点关键条件,一是成本低、应用广的普惠性,二是要可靠、可信的安全性。以大算力为基础的大模型及通用人工智能为加速了条件一的满足,同时也带来了技术滥用风险的规模化升级。如何保障人工智能系统的安全可信已经成为业界乃至全社会面临的一项紧迫课题。为此,商汤针对新时期人工智能的风险特点,打造覆盖数据处理、模型开发、应用部署等AI系统全生命周期的可信AI基础设施SenseTrust,以助力打造可信的大模型。”

活动期间,商汤也正式发布了人工智能伦理与治理的年度报告——《商汤大模型伦理原则与实践白皮书》。白皮书由商汤智能产业研究院与上海交通大学计算法学与AI伦理研究中心共同编制。白皮书以大模型的发展为背景,以生成式人工智能的治理为主题,以“商汤日日新SenseNova”大模型体系治理实践为案例,提出了生成式人工智能治理的核心原则和“三维对齐”科技伦理模式,系统呈现了双方在AI治理领域的比较新观点。

范式变化引发新挑战 业界亟需新时代下技术治理手段

大模型时代,“基础模型+微调”为主要特征的生产范式大大降低了开发成本和应用门槛。AI应用场景更加开放、数据模态更加多元、应用领域更加广泛;与之对应的,技术滥用、风险来源指数级增长,风险评估标准更加难以界定,潜在影响规模化扩散。在应用层面,诸如“幻觉”现象、数据投毒、混淆攻击、诱导攻击等具有现实意义的风险挑战陆续显现。无论是未来生命研究所发布的公开信,还是国内外一系列监管政策的推出,都反映出全球各方对人工智能风险挑战的高度关注。

大模型时代:生产范式变革引发AI风险范式转变

商汤“SenseTrust”构筑大模型时代的“压舱石”

作为行业领先的人工智能企业,商汤科技一直以来高度重视人工智能伦理与治理工作,将技术创新与技术治理并重。早在 2019 年商汤就同步启动了两项前瞻性工作,一项是大模型研发,另一项就是AI伦理与治理。此前,商汤已形成较为完善的人工智能伦理与治理组织结构、管理制度、审查机制、工具体系、伦理文化建设体系和外部生态网络,并收获行业广泛认可。

新时代下,技术加速创新、应用日新月异,传统运营式的治理手段需相应升级,以适应飞速发展、无限拓展的治理需求。商汤整合长期伦理治理思考及技术能力,针对当下生成式人工智能的风险特点,打造可信AI基础设施——SenseTrust,包含数据治理、模型治理、应用治理等层面技术工具,可提供数据处理、模型训练、模型部署、推理服务等全方位、全链路的可信AI检测与加固“工具箱”,为大模型时代构筑“压舱石”。

“SenseTrust”——商汤可信 AI 基础设施应用图景

 · 在数据层面,“SenseTrust” 能够提供从数据脱敏、数据去毒、数据合规审查及偏见评估等治理工具。例如,在模型训练数据的预处理环节,“SenseTrust”提供的数据去毒工具能够检测数据来源中是否包含带有后门、扰乱的有毒数据,并提供去毒方案。针对显式、隐式等不同形式的“毒素”检测率大于95%,结合数据清洗与对抗防御等方法,能够实现有效去毒。目前,“SenseTrust”数据脱敏工具已落地数据标注、城市管理,以及自动驾驶相关业务场景。

 · 在模型层面,“SenseTrust”能够针对传统判别式模型和生成式模型的不同特点提供标准化和定制化的模型评测能力。针对判别式模型,可就能够面向活体识别、图像分类、目标检测等商业化需求提供一键式评测;针对生成式模型,商汤“SenseTrust”构建了百万量级的测试数据集,覆盖三十余类伦理和安全测评维度,可对对抗安全、鲁棒安全、后门安全、可解释性和公平性评测。为进一步提升模型的风险防御能力,商汤“SenseTrust”还能够提供“AI防火墙”,从源头过滤对抗样本,综合检出率达到98%。

 · 在应用层面,商汤在涉及数据保护、数字取证及伪造检测等技术领域有着深厚的积累,并逐步开发了基于生成、鉴伪和溯源三位一体的综合解决方案。例如,针对各方颇为关注的AIGC相关确权溯源和鉴伪问题,“SenseTrust”为此开发了数字水印解决方案,可将特定信息嵌入到数字载体中,不影响载体的使用价值,也不易被人察觉,只有通过特定的解码器和专属密钥才能提取,能够支持多模态数据。数字水印技术已服务于“商汤秒画SenseMirage”、“商汤如影SenseAvatar”等多个产品,以及内容创作、大数据等领域的客户。

今年WAIC上,“商汤日日新SenseNova”大模型体系再度升级。针对体系内的一系列应用平台,商汤在传统“判别式模型”治理经验的基础上,结合生成式人工智能的风险特点,利用SenseTrust工具体系进行了一系列测评,并开展持续的跟踪测试,不断提升风险防御能力。

SenseTrust可进行全方位、全链路的可信AI检测与加固

与此同时,商汤也积极将大模型和生成式人工智能的治理实践成果向外输出。例如,将商汤“SenseTrust”综合鉴伪解决方案投入到十余家银行的安全系统中,实现对各类灰黑产攻击拦截成功率超行业同类产品20%以上,有效防范了黑灰产身份盗取、支付盗刷等网络诈骗。此外,包括模型体检、数字水印,以及主动投毒保护等相关技术,也已通过“商汤AI安全治理开放平台”对外开放。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 大家在看
  • LoomFlows:收集高质量用户反馈

    LoomFlows是一个收集高质量用户反馈的平台。它帮助您简化高质量反馈的收集,识别有影响力的机会,并通过构建合适的功能来加速发展。LoomFlows提供收集用户反馈的渠道、反馈分析、注释截图、Loom视频反馈等功能。它适用于个人和团队,有不同的定价计划供选择。

  • EazyCaptions:创建吸引人的视频,无需编辑技能

    EazyCaptions是一个让用户能够创建吸引人的视频的工具,无需编辑技能。它提供了眼球吸引的字幕、音效和B Roll素材,帮助用户制作出专业水准的视频。使用EazyCaptions,您可以节省大量的编辑时间,通过自动AI字幕生成准确的字幕,并自动突出重点词汇和添加表情符号。此外,它还提供了库存素材和快速的调整功能,帮助用户制作更多样化的视频内容。EazyCaptions适用于各种类型的创作者和内容创造者,如博主、教育工作者、评论员、新闻媒体等。定价方案灵活,包括免费试用和付费选项。

  • Merlin AI Plugins:AI插件,提升工作流效率

    Merlin是一个强大的AI助手,通过GPT 4技术提供1点击访问多种AI插件,包括视频摘要、网页抓取、邮件回复、社交媒体增长等功能。免费下载使用。

  • Udio AI:创造独特的 MP3音乐,立即免费使用

    Udio AI音乐生成器是一个用于音乐创作和分享的应用程序,可以根据您的输入,在您喜欢的风格中生成令人惊叹的音乐。它经过大量的音乐数据训练,可以快速创建您自己的音乐。Udio AI适用于音乐爱好者、创作者以及需要创作灵感的人。免费试用3次。

  • Businessflow Recruit:招聘革命,AI 助力招聘流程优化

    通过 AI 助手,提高招聘效率,降低成本,为公司找到最佳适应的候选人。拥有简历分析、候选人排名、自动面试等功能。定价根据企业规模定制。

  • Wookeys AI:一站式AI助手,为您提供生成文本、图像、代码、视频、音频等的解决方案

    Ultimate AI Assistant是一款综合AI助手,可帮助您简化任务,提高工作效率。它提供了生成文本、图像、代码、视频、音频等多种功能,具有高度定制化的AI解决方案。无论您是需要生成创意文案、设计图像、编写代码、制作视频还是创作音乐,Ultimate AI Assistant都能满足您的需求。该产品定价根据功能和使用量而定,详情请访问官方网站。

  • Sakura FM:与AI角色聊天

    Sakura AI是一个能够与AI角色聊天的平台。通过与AI角色的对话,用户可以探索、发现和创造新的AI体验。开始聊天,释放你的想象力。

  • lensa.app:影像增强AI工具

    Lensakey是一款影像增强AI工具,可一键进行照片修饰、去除干扰、应用时尚滤镜和效果,并创建独特的AI头像。它可以提升您的社交媒体影响力,轻松提升照片质量。

  • StockTune:免费音乐,无限可能

    StockTune 是一个免费音乐库,提供商用和个人使用的免费音乐下载,无需署名。库中拥有丰富多样的高品质音乐曲目,能够满足不同需求。价格:免费。

  • heardeer:10分钟内收集1000+用户访谈反馈

    heardeer可以在10分钟内收集1000+用户访谈反馈,让AI处理繁琐的用户访谈,您可以专注于更重要的任务。heardeer提供全球用户访谈,无需雇佣翻译人员,让用户以自己的母语参与访谈。同时,heardeer提供详细的转录和深度分析,为您节省时间。快来试试heardeer,开始您的用户访谈吧!

  • OneAccord:实时AI翻译为教堂

    OneAccord是一个实时AI翻译平台,为教堂提供语言翻译和字幕服务。它通过AI模型和人工校对,帮助教堂克服语言障碍,使教堂服务对听障人士也能无障碍参与。平台支持多种语言翻译和字幕功能,并提供定制品牌和在线访问。用户可以根据自己的需求选择月度订阅或一次性使用,并可以根据使用时间、语言和听众数量等参数来估算费用。

  • Kursaha:AI驱动的客户获取和参与解决方案

    Kursaha是一种AI驱动的客户获取和参与解决方案,通过定向广告活动、营销策略和参与客户来推动业务增长。核心功能包括实时分析、集成、自动生成OTP和验证、AI驱动的聊天自动化、受众预测和行为队列等。Kursaha是营销数据和产品团队的完整解决方案,帮助他们增强客户参与和获取策略。

  • AI Singing:AI音乐生成器

    AI音乐生成器是一个能够免费生成音乐的AI音乐生成器。它可以自动生成歌曲和歌唱。

  • Blahget:您的智能AI语音驱动型预算助手

    Blahget是一款先进的AI预算助手,可简化财务管理。它利用GPT-4驱动的语音识别技术,实现无缝跟踪支出和收入。从今天开始您的智能预算之旅吧。它可以通过语音快速创建、编辑和删除记录,支持搜索、筛选和排序等操作,并可执行数学计算。迄今已记录超过10万条数据条目。

  • Tools4AI:100% Java实现的LLM代理和大型行动模型

    Tools4AI是100%用Java实现的大型行动模型(LAM),可作为企业Java应用程序的LLM代理。该项目演示了如何将AI与企业工具或外部工具集成,将自然语言提示转换为可执行行为。这些提示可以被称为"行动提示"或"可执行提示"。通过利用AI能力,它简化了用户与复杂系统的交互,提高了生产力和创新能力。

  • SlideAI:AI制作演示文稿

    Slides AI是一款AI制作演示文稿的工具。它利用先进的AI算法分析您的主题,生成相关内容,并创建专业的PowerPoint幻灯片。Slides AI可以为您节省时间和精力,让您轻松创建专业而引人注目的演示文稿。

  • Ping Parrot:AI聊天机器人,帮助您处理客户支持

    Ping Parrot是一个AI聊天机器人平台,可以帮助您快速构建自定义的聊天机器人,并将其嵌入到您的网站上,帮助您处理客户支持。无需编码即可使用。聊天机器人可以根据您的数据进行训练,学习并提供最佳答案。您可以定制聊天机器人的外观以匹配您的品牌,并在80种语言中提供帮助。

  • Inpaint-web:免费的去除水印和物体的工具

    Inpaint-web 是一款永久免费的在线工具,只需一点击即可去除照片中的不想要对象,同时提供修复瑕疵功能。其独特的照片去除和修复功能让用户轻松实现照片编辑需求。用户无需下载安装任何软件,直接在网页上使用。Inpaint-web 定位于为用户提供便捷、高效的照片编辑解决方案。

  • MA-LMM:面向长期视频理解的大规模多模态模型

    MA-LMM是一种基于大语言模型的大规模多模态模型,主要针对长期视频理解进行设计。它采用在线处理视频的方式,并使用记忆库存储过去的视频信息,从而可以在不超过语言模型上下文长度限制或GPU内存限制的情况下,参考历史视频内容进行长期分析。MA-LMM可以无缝集成到当前的多模态语言模型中,并在长视频理解、视频问答和视频字幕等任务上取得了领先的性能。

  • eezyCollab:AI驱动的高效、低成本的影响力营销工具

    eezyCollab是一款AI驱动的影响力营销工具,能快速匹配合适的KOL,进行批量化电子邮件营销,帮助中小企业以低廉的成本进行影响力营销。该产品无需营销专业知识即可上手使用,简单易用,大幅提高了影响力营销的效率和可及性。

今日大家都在搜的词: