首页 > 业界 > 关键词  > gpt4最新资讯  > 正文

AI视野:百度希壤与高通达成合作;gpt4对手claude pro上线;快手内测AI文生图功能;Vercel发布界面生成器v0.dev

2023-09-15 15:04 · 稿源:站长之家

🤖📱💼AI应用

gpt4迎来最强对手,claude pro 正式上线

Anthropic 推出面向消费者的高级订阅计划 Claude Pro,该计划每月收费20美元,相比于免费版 Claude2,拥有更多的使用量、早期访问新功能的权限和更强大的上下文处理能力。然而,与 ChatGPT Plus 相比,Claude Pro 在信息准确性方面稍逊一筹。

image.png

要点:

1、Anthropic 推出面向消费者的高级订阅计划 Claude Pro。

2、Claude Pro 每月收费20美元,具有比免费版更多的使用量和早期访问新功能的权限。

3、Claude Pro 相较于 ChatGPT Plus 在上下文处理能力方面具有优势,但在信息准确性方面稍逊一筹。

Vercel发布界面生成器v0.dev 简单文本描述即可快速生成界面

Vercel推出了界面生成器v0.dev的测试版本,用户可以通过自然语言描述来生成界面代码。该工具可以大大简化界面设计流程,降低设计成本。

1.jpg

地址:https://v0.dev/

要点:

Vercel发布的v0版本界面生成器,可以通过文本描述生成界面代码。

生成的代码可预览、调整和部署,简化界面设计工作量。

该应用处于内测阶段,具有广阔的应用前景和发展潜力。

快手内测AI文生图功能 “快手AI玩评”

快手正在其短视频评论区内测AI文生图功能“快手AI玩评”。用户可以通过输入文字,一键生成多种风格的图片。这基于快手自主研发的大模型“快意”,它在多个大模型榜单上表现出色。此外,快手的“快手AI对话”功能也已在安卓版APP开放内测,可帮助用户快速获取信息。

要点:

1. 快手在短视频评论区内测AI文生图功能“快手AI玩评”,用户可一键生成图片。

2. 该功能基于快手自主研发的大模型“快意”,在多个榜单上表现出色。

3. “快手AI对话”功能已在安卓版APP开放内测,可快速获取信息。

Contra Pro:专为独立开发者和设计师服务的AI作品集建站平台

Contra Pro是面向自由职业者的专业在线作品集平台,提供强大的数据分析工具、模板、域名定制等功能,助力获取客户、建立品牌影响力。

image.png

体验地址:https://contra.com/pro

要点:

1、数据分析 功能全面追踪作品传播效果

2、模板和域名 可定制个性化专属品牌

3、多平台支持 实现作品多平台同步发布

Perplexity发布Collections功能 可将搜索结果保存为不同主题的合集

Perplexity推出Collections功能,用户可以将搜索结果保存为不同主题的合集,便于协同组织和管理知识。

1.jpg

体验地址:https://www.perplexity.ai/library

要点:

1. Collections功能可以将搜索结果按主题组织成合集,用于笔记整理或内容展示。

2. 用户可以邀请他人协作共同编辑一个Collection,丰富主题信息。

3. Collections功能提供了高效的知识组织和共享平台,有利于协同构建知识图谱。

Metaverse踏出VR 元宇宙平台Horizon Worlds网页版已上线

元宇宙平台Horizon Worlds推出网页版和移动App版本公测,标志着其有望吸引更多非VR设备用户,为其未来增长提供动力。

VR 元宇宙 增强现实

图源备注:图片由AI生成,图片授权服务商Midjourney

要点:

1、Horizon Worlds网页版和移动App版本面向部分用户开放公测。

2、公测版允许用户通过手机或网页浏览虚拟世界、使用虚拟形象。

3、移动端和网页版加入有望为Horizon Worlds带来更广阔的用户群,实现爆发式增长。

👨‍💻💡🎯聚焦开发者

PostgreSQL16发布 提高包括AI在内的工作负载性能

PostgreSQL16最新版本发布,提供性能提升、大规模数据复制支持,以及安全性改进和SQL/JSON标准兼容性增强。

image.png

地址:https://www.postgresql.org/docs/16/release-16.html

要点:

1、性能提升:支持批量加载,查询并发改进,扩展并行查询选项等

2、数据复制:增强逻辑复制,支持从备用节点设置,提高回放速度

3、安全增强:细化角色权限控制,提供更高的数据安全性

研究人员利用AI从文字生成3D头像 实现虚拟试衣和形状编辑

近日,研究人员公布了两项利用人工智能从文字生成三维头像的新研究成果,实现了虚拟试衣和头像形状编辑等应用。这些成果来自德国马普所等机构的研究人员,发表在 arXiv 上。

QQ截图20230915100910.jpg

要点:

1、德国马普所等机构的研究人员利用 AI 技术实现了从文字生成3D 头像的新方法。

2、利用该方法可以实现虚拟试衣和头像形状编辑等应用。

3、这些研究成果对时装电商、社交平台和元宇宙等领域将产生深远影响。

instaflow:利用校正流技术加快将文本转化为图像的过程

InstaFlow是一个快速、一步生成高质量图像的模型,通过利用直线概率流和迁移学习,以接近Stable Diffusion的图像质量显著减少计算资源需求。

image.png

项目地址:https://github.com/gnobitab/instaflow

要点:

1. InstaFlow使用文本调整的反流整流生成直线概率流,避免了弥散模型的多步采样,极大提升了推理速度。

2. InstaFlow生成质量接近Stable Diffusion,在MS COCO数据集上的FID指标与最先进的GAN模型相当。

3. InstaFlow只需要有监督训练,通过从预训练好的Stable Diffusion模型迁移学习,训练过程简单高效。

exllamav2:一个用于在现代消费 GPU 上运行本地 LLM 的推理库

exllamav2是一个用于在现代消费级GPU上本地运行大型语言模型的快速推理库,能够利用最新GPU技术,以非常快的速度对巨大神经网络进行推理,在不牺牲太多质量的情况下,实现在普通台式机上运行大模型。

image.png

项目地址:https://github.com/turboderp/exllamav2

要点:

1. 支持新的可调量化格式EXL2,混合使用2-8比特量化,提升性能。

2. 优化的代码架构获得1.5-2倍的推理加速。

3. 易于安装使用,提供交互式示例,支持模型转换,降低使用门槛。

UMMAFormer:一种有效识别视频中的伪造内容的Transformer框架

UMMAFormer是一种新型Transformer框架,通过时序特征异常注意力模块和并行交叉注意力特征金字塔网络,实现了视频内容伪造的有效识别,在多个数据集上超越已有方法。

image.png

论文地址:https://arxiv.org/pdf/2308.14395v1.pdf

要点:

1. 提出时序特征异常注意力模块增强对篡改的检测。

2. 设计并行交叉注意力特征金字塔网络进行特征增强。

3. 在视频修复场景提出新的TVIL数据集,在多个数据集上表现优异。

📰🤖📢AI新鲜事

百度希壤与高通在AI等领域达成合作

百度与高通达成战略合作,将在XR技术、生成式AI、数字人等领域开展深度合作。

人机合作

图源备注:图片由AI生成,图片授权服务商Midjourney

要点:

1. 百度与高通在北京签署战略合作谅解备忘录,将在XR领域展开合作。

2. 双方将在XR技术、生成式AI、数字人等领域开展技术、市场与生态合作。

3.百度将整合高通的XR开发者平台,利用自身技术优势,共同探索文旅、教育等行业的商业解决方案。

王小川成立上海百川智能公司

王小川在上海成立百川智能公司,注册资本500万元,主要从事人工智能软件开发和服务。

百川大模型,百川智能

要点:

1. 百川智能由王小川和茹立云分别持股99%和1%。

2. 公司注册资本500万元,王小川为法定代表人和执行董事。

3. 公司经营范围包括人工智能应用软件开发、人工智能双创服务等。

人工智能芯片设计公司 Arm 上市股价飙升25%

人工智能芯片设计公司Arm在纳斯达克成功上市,首日收盘价较发行价高出25%,成为近两年来最大规模的IPO。Arm的芯片设计和指令被广泛应用于智能手机、笔记本电脑等电子设备。

要点:

1. Arm在纳斯达克上市,首日股价较发行价高出25%,市值约650亿美元。

2. Arm为苹果、三星、英伟达等知名公司提供芯片设计和指令。

3. Arm的技术广泛应用于智能手机、笔记本电脑等电子设备。

马斯克、小扎等AI大佬密会探讨AI监管

9月14日,舒默参议员在华盛顿主持召开了AI闭门峰会。与会嘉宾包括马斯克、小扎、谷歌CEO等AI领域大佬。马斯克认为此会议可能成为文明历史重要时刻。与会者就AI如何改变世界进行了预测,内容涉及治愈癌症、改善食品供应、教育等。同时,也提出AI存在偏见和导致失业的潜在风险。

image.png

图片来自wired

要点:

1. 舒默参议员主持召开AI闭门峰会,汇集AI领域大佬。

2. 与会者就AI如何改变生活进行预测,呼吁政府参与AI监管。

3. 马斯克和小扎支持政府监管AI,但也关注创新。

Adobe财报符合预期 AI收入增长有限股价微跌

Adobe第三季度财报销售额符合分析师预期,达到48.9亿美元,同比增长10%。但人工智能收入增长有限,未达到投资者预期。Adobe近期提高了AI产品定价,存在一定风险。展望第四季度,Adobe预测销售额介于49.8亿至50.3亿美元,利润率也符合预期。

Adobe Firefly,萤火虫,生成式AI,人工智能,图片生成

要点:

1) Adobe第三季度销售额符合预期,同比增长10%。

2) 人工智能收入增长有限,未达投资者预期。

3) 四季度销售额预测符合预期,但AI定价策略面临不确定性。

美国国税局启动人工智能计划追缴百万富翁逃税账单

美国国税局宣布启动使用人工智能技术的计划,旨在加强对富翁逃税行为的监管。该计划主要针对年收入超过100万美元的富人纳税人和大型公司法人,利用先进技术加强税收监管,警示富翁纳税人逃税不再容易。

AI机器人教父

图源备注:图片由AI生成,图片授权服务商Midjourney

要点:

1、美国国税局计划运用人工智能技术加强对富翁逃税行为的监管

2、计划主要针对年收入超过100万美元的富人纳税人和大型公司法人

3、该计划利用先进技术加强税收监管,警示富翁纳税人逃税不再容易

谷歌即将发布对话式人工智能软件Gemini

谷歌即将发布对话式人工智能软件Gemini,定位于与OpenAI的GPT-4竞争,Gemini由一系列大型语言模型组成,可支持聊天机器人、文本生成等多种应用,是谷歌在生成式AI领域追赶OpenAI的重要举措。

中国AI机器人

图源备注:图片由AI生成,图片授权服务商Midjourney

要点:

1. 谷歌将发布对话AI软件Gemini,定位与OpenAI的GPT-4竞争

2. Gemini由多个大型语言模型组成,可支持多种文本生成应用

3. Gemini是谷歌在生成式AI领域追赶OpenAI的重要布局

MLPerf放榜!AI芯片公司墨芯人工智能再夺MLPerf大模型推理三项冠军

最新MLPerf推理测试结果公布,墨芯人工智能的S30计算卡在GPT-J大模型的单卡、4卡、8卡推理性能均获得第一。通过双稀疏算法与硬件协同设计,墨芯在GPT-J模型上取得1.8倍于英伟达H100的性能优势。这证明了稀疏计算是大模型时代的关键,可减少模型计算量,解决大模型推理的算力瓶颈。

image.png

要点:

1. MLPerf公布GPT大模型推理测试,墨芯S30卡单卡、4卡、8卡均获第一

2. 墨芯双稀疏算法硬件协同,在GPT-J上性能领先英伟达H1001.8倍

3. 稀疏计算减少模型计算,可解决大模型推理算力瓶颈

沃顿商学院:ChatGPT的创意能力,比MBA学生更好

沃顿商学院进行了一项关于ChatGPT创意能力的研究,结果显示ChatGPT在创意测试中表现超过了MBA学生。

图片

研究地址:https://knowledge.wharton.upenn.edu/article/is-chatgpt-a-better-entrepreneur-than-most/

要点:

1. 沃顿商学院让ChatGPT和MBA学生在15分钟内为大学生市场设计200个创意产品,结果ChatGPT表现更好。

2. ChatGPT生成的200个创意想法的平均购买率为46.8%,高于学生的40.4%。

3. 在前10%的顶级创意中,87.5%来自ChatGPT,可见其在创意测试中整体优于人类。

🤖📈💻💡大模型动态

全面取代Llama2!Baichuan2自曝史上最全训练细节

最近,百川智能宣布开源两款大模型Baichuan2-7B和Baichuan2-13B,在多个中文、英文通用基准测试中表现最优,明显优于Meta研发的Llama2。Baichuan2使用高达2.6TB的多领域训练数据,实现了高效、稳定、可预测的训练过程。此外,百川智能还开源了11个中间检查点,这对模型的继续研究具有重要价值。值得一提的是,Baichuan2系列模型均可免费商用,这对国内企业来说是一个绝佳的选择。

图片

下载链接:https://github.com/baichuan-inc/Baichuan2

要点:

1. Baichuan2在多个中文、英文通用基准测试中效果最好,明显超过Llama2

2.Baichuan2训练数据高达2.6TB,覆盖科技、商业等多个领域 ,实现了高效、稳定、可预测的训练过程

3. 百川开源了11个中间检查点,对模型研究很有价值

举报

  • 相关推荐
  • 大家在看
  • Nabubit:数据库设计助手,简化数据库设计、管理和演化。

    Nabubit是一个旨在帮助用户优化数据库设计、管理和演化的在线工具。它提供了上传数据库架构图、可视化数据库结构、以及使用自然语言提问的功能。用户可以从头开始设计数据库,无需担心命名或记住语法。完成设计后,可以将其导出到自己喜爱的数据库或框架中。

  • Otter Script:文档生成平台,快速创建复杂文档。

    Otter Script是一个文档生成平台,它通过自动化技术帮助用户节省时间,将原本需要几天完成的复杂文档工作缩短到几分钟。它简化了工作流程,让用户可以更高效地完成更多任务。

  • BNA:多功能AI超级应用,涵盖社交、电商、娱乐和教育。

    BNA AI Super App是一款集成了多种智能服务的超级应用,它不仅提供社交功能,如分享帖子、写博客、聊天和视频通话,还涵盖了AI电商和娱乐服务。此外,该应用还提供40种语言的AI教学服务,帮助用户学习不同的语言。BNA AI Super App以其强大的AI功能和多语言支持,满足了不同用户群体的需求。

  • Elisi:高效能自主层级式计划助手

    Elisi 是一款旨在帮助用户实现个人成长的终极组织者和指南。它通过直观的设计和用户友好的说明,帮助用户将梦想转化为清晰的结果,分解成可实现的里程碑,并通过AI技术理解并适应用户的个人需求,确保每一天都更有条理和高效。Elisi 致力于提供便捷服务,主要功能套件完全免费。

  • Omi AI:个性化AI助手,记录每一刻,与AI对话获取反馈。

    OMI APP是一个任务驱动的个性化AI助手,旨在通过语音和音频转录功能帮助用户提高记忆力和沟通效率。它是一个开源的AI记事本,提供提醒、建议等功能,同时注重用户隐私。

  • MeowMail:高送达率的AI电子邮件营销工具

    MeowMail是一款集成在Shopify后台的电子邮件营销应用,利用AI技术自动选择最佳发送时间,提高邮件的送达率至98%以上。它支持拖放编辑、从Klaviyo导入邮件列表、使用Beefree编辑器创建新邮件,并通过设定支出限制来管理邮件营销活动。MeowMail还提供企业级支持和自动翻译文本功能,帮助商家以低成本实现高效的邮件营销。

  • Maia 100:微软定制AI加速器,专为大规模AI工作负载设计。

    Maia 100是微软为Azure设计的首款定制AI加速器,专为大规模AI工作负载而打造,通过软硬件的协同优化,实现了性能、可扩展性和灵活性的最大化。它采用了TSMC N5工艺和COWOS-S互连技术,具备高达1.8TB/s的带宽和64GB的容量,支持高达700W的热设计功耗(TDP),但以500W运行,确保了高效的能效比。Maia 100集成了高速张量单元、向量处理器、DMA引擎和硬件信号量,支持多种数据类型和张量切分方案,并通过以太网互连支持大规模AI模型。此外,Maia SDK提供了丰富的组件,支持快速部署PyTorch和Triton模型,并通过双编程模型确保高效的数据处理和同步。

  • LTM:超长上下文模型,革新软件开发

    Magic团队开发的超长上下文模型(LTM)能够处理高达100M tokens的上下文信息,这在AI领域是一个重大突破。该技术主要针对软件开发领域,通过在推理过程中提供大量代码、文档和库的上下文,极大地提升了代码合成的质量和效率。与传统的循环神经网络和状态空间模型相比,LTM模型在存储和检索大量信息方面具有明显优势,能够构建更复杂的逻辑电路。此外,Magic团队还与Google Cloud合作,利用NVIDIA GB200 NVL72构建下一代AI超级计算机,进一步推动模型的推理和训练效率。

  • EZ-work AI文档翻译:智能AI翻译,高效文档语言转换助手。

    EZ-work AI文档翻译是一款专注于文档翻译的在线服务,支持多种语言的翻译,包括中文、英语、日语、俄语、阿拉伯语和西班牙语等。它使用先进的AI技术,如gpt-4o-mini和deepseek-chat模型,为用户提供快速、准确的翻译服务。该产品适用于需要文档翻译的个人和企业,尤其在国际交流和学术研究领域尤为重要。

  • Watson AI:会议助手,自动记录并总结会议要点。

    Watson AI是一款会议助手应用程序,它通过录制系统音频和麦克风来转录和总结会议内容,自动提取行动项和会议摘要,帮助用户更高效地进行会议记录和回顾。

  • PicTech AI: 免费在线AI图片翻译 助力跨境电商

    PicTech AI是由学以致用科技旗下的智能图像工具品牌,专注于为跨境电商提供AI驱动的图片翻译服务。该产品利用人工智能技术,实现高准确率和高清晰度的图片翻译,支持中文、英语到日语、韩语等多国语言的翻译。PicTech AI的智能抠图功能,能够准确检测图片主体边缘,一键去除背景,无需专业编辑。产品背景信息显示,其团队由来自百度、网易、阿里巴巴等行业巨头的顶尖高科技人才组成,具备强大的技术实力和产品能力。该产品定位于帮助跨境电商从业者简化工作流程,提高效率,无需懂外语或图像处理技能即可使用。

  • AnythingLLM:一站式AI应用,支持多种文档和模型。

    AnythingLLM是一个多功能的桌面客户端,支持多种语言模型(LLM)和文档类型,提供完全私密的使用体验。用户可以根据自己的需求选择企业级模型、自定义模型或开源模型,如GPT-4、Llama、Mistral等。产品支持一键安装,本地运行,无需互联网连接,保护用户隐私。

  • 林哥的大模型野榜:更适合中国宝宝体质的大模型产品排行榜

    林哥的大模型野榜是一个专注于中国用户需求的大模型产品排行榜,提供了多维度的评估和排名,帮助用户更好地了解和选择适合的大模型产品。

  • Fluximg.com:AI文本到图像生成器,支持多尺寸和自动翻译。

    Fluximg.com是一个基于Flux模型的AI图像生成网站,提供从文本到图像的转换服务。它支持多种语言,包括中文和英文,并且具有用户友好的界面。网站提供免费和专业版本,使用户能够根据自己的需求选择不同的服务级别。

  • 现代文转古文:将现代汉语转化为古汉语,提升文采。

    现代文转古文是一款能够将现代汉语自动转换为古汉语的模型,它通过先进的自然语言处理技术,使得用户可以轻松地将现代文本转换成具有古典韵味的古文。这种转换不仅能够增加文本的文学价值,还能在教育、文学创作、文化传承等方面发挥重要作用。

  • Zamba2-mini:先进的小型语言模型,专为设备端应用设计。

    Zamba2-mini是由Zyphra Technologies Inc.发布的小型语言模型,专为设备端应用设计。它在保持极小的内存占用(<700MB)的同时,实现了与更大模型相媲美的评估分数和性能。该模型采用了4bit量化技术,具有7倍参数下降的同时保持相同性能的特点。Zamba2-mini在推理效率上表现出色,与Phi3-3.8B等更大模型相比,具有更快的首令牌生成时间、更低的内存开销和更低的生成延迟。此外,该模型的权重已开源发布(Apache 2.0),允许研究人员、开发者和公司利用其能力,推动高效基础模型的边界。

  • InterTrack:无需对象模板的人体与物体交互跟踪技术

    InterTrack 是一种先进的跟踪技术,能够在单目RGB视频中跟踪人体与物体的交互,即使在遮挡和动态运动下也能保持跟踪的连贯性。该技术无需使用任何对象模板,仅通过合成数据训练即可在真实世界视频中实现良好的泛化。InterTrack 通过分解4D跟踪问题为每帧的姿态跟踪和规范形状优化,显著提高了跟踪的准确性和效率。

  • GenWarp:生成新视角的图像,保持语义信息。

    GenWarp是一个用于从单张图像生成新视角图像的模型,它通过语义保持的生成变形框架,使文本到图像的生成模型能够学习在哪里变形和在哪里生成。该模型通过增强交叉视角注意力与自注意力来解决现有方法的局限性,通过条件化生成模型在源视图图像上,并纳入几何变形信号,提高了在不同领域场景下的性能。

  • Qwen2-VL:新一代视觉语言模型,更清晰地看世界。

    Qwen2-VL是一款基于Qwen2打造的最新一代视觉语言模型,具备多语言支持和强大的视觉理解能力,能够处理不同分辨率和长宽比的图片,理解长视频,并可集成到手机、机器人等设备中进行自动操作。它在多个视觉理解基准测试中取得全球领先的表现,尤其在文档理解方面有明显优势。

  • Dressplay:个性化服装生成器,轻松变换你的装扮。

    Dressplay是一个创新的在线服装生成器,允许用户通过简单的步骤生成个性化的服装。它利用先进的图像处理技术,让用户能够选择服装区域、目标人物以及想要穿戴的服装,从而创造出逼真的服装效果。Dressplay背后的技术不仅提高了服装设计的效率,也为用户提供了一种全新的个性化体验。目前,Dressplay提供免费试用,用户可以通过网页访问并体验其功能。

今日大家都在搜的词: