首页 > 业界 > 关键词  > 大模型最新资讯  > 正文

AI视野:百度发布量子领域大模型;Runway推出镜头控制功能;Colossal把大模型门槛打下来了

2023-09-25 15:09 · 稿源:站长之家

文头.jpg

🤖📈💻💡大模型动态

百度发布首个量子领域大模型

百度发布首个量子领域大模型,以及百度量子助手和量子写作助手两大AI原生应用,旨在全面推动量子技术与大模型深度融合,释放潜力。

AiBase提要:

👉 百度发布首个量子领域大模型,深度融合量子技术与大模型。

👉 百度量子助手降低百度量子平台门槛,提高使用效率。

👉 量子写作助手高效创作量子领域文档,促进知识产权沉淀。

智谱AI发布MathGLM数学模型,算术任务性能优于GPT-4

智谱AI最新发布的MathGLM数学模型在数学推理方面表现出卓越性能,准确率接近100%,明显优于GPT-4。该模型能够精确计算算术运算,提升中文数学解决能力,对不同年级数学问题和应用题也表现出良好的效果。

微信截图_20230925082352.png

论文链接:https://arxiv.org/abs/2309.03241

Github链接:https://github.com/THUDM/MathGLM

模型下载:https://modelscope.cn/models/ZhipuAI/MathGLM

AiBase提要:

🚀 MathGLM数学模型卓越性能:MathGLM在算术任务上准确率接近100%,胜过GPT-4。

📈 提升中文数学解决能力:MathGLM能够精确计算算术运算,提高中文数学解决能力。

🎯 多用途数学模型:MathGLM在不同年级数学问题和数学应用题上取得了出色的结果。

Deci AI推出8.2亿参数的文本到图像潜在扩散模型DeciDiffusion1.0

Deci AI最近发布了DeciDiffusion1.0,这是一项具有8.2亿参数的文本到图像生成模型,速度比传统方法快3倍。它采用了创新的U-Net-NAS架构,通过四阶段培训过程提高了效率和图像质量。用户研究显示,它在图像美学方面有优势,并在与文本描述的匹配上表现良好,为文本到图像生成领域带来了新的创新。

image.png

项目地址:https://huggingface.co/spaces/Deci/DeciDiffusion-v1-0

AiBase提要:

- 🚀 Deci AI发布DeciDiffusion1.0,8.2亿参数的文本到图像生成模型,速度快3倍

- 🌟 采用U-Net-NAS架构,提高效率和图像质量,经过四阶段培训过程优化

- 🖼️ 用户研究显示在图像美学和文本匹配方面表现出色,带来文本到图像生成领域的创新

百川智能发布闭源大模型Baichuan2-53B 并开放API

百川智能发布闭源大模型Baichuan2-53B,该模型在数学和逻辑推理方面表现出显著提升,通过高质量数据体系和搜索方法减少了模型幻觉,并开放了Baichuan2-53B的API接口,进军商业领域。

AiBase提要:

1. 🚀 Baichuan2-53B全面升级,数学和逻辑推理能力显著提升。

2. 📊 百川智能优化数据体系,确保使用优质数据进行预训练。

3. 🤖 Baichuan2-53B开放API接口,进军商业化领域。

恒生电子:恒生大模型产品LightGPT已开启内测

恒生电子宣布,恒生大模型产品LightGPT已开始内测,该大语言模型专为金融领域打造,具有更专业、更合规和更轻量的特点。通过海量金融数据训练,提升了对金融相关问题的理解能力,有望推动大模型在金融行业的应用。

AiBase提要:

🌐 专业性:LightGPT经过训练使用了2000亿中文tokens,覆盖金融多个领域的应用场景。

📚 合规性:LightGPT学习了中国的金融法律法规,符合中国金融市场的监管要求。

☁️ 轻量化:LightGPT支持私有化/云部署,通过API调用,部署成本较低。

度小满“轩辕70B”金融大模型开源

度小满发布了金融行业大模型“轩辕70B”,具有出色的通用能力和专业金融性能。该模型在中文任务评测和金融领域获得高分,是首个参数量级达到70B的开源大模型,具备8k以上的上下文长度。它在预训练阶段融入了专业金融语料,采用加速优化策略,训练效率出色。模型已在开源社区全面开放,为金融领域提供高效的中文基座模型,用户可自定义微调,有望为自然语言处理和信息抽取任务带来新机遇。

image.png

项目地址:https://github.com/Duxiaoman-DI/XuanYuan

AiBase提要:

1. 🌐 中文增强:轩辕70B通过中文增强和金融领域预训练,提升金融领域理解能力。

2. 📜 上下文长度扩展:首个70B参数级别开源大模型,上下文长度达8k以上,满足金融领域长文本需求。

3. 💼 专业性能:在金融领域评测中获得显著提升,成为处理金融文本的理想选择。

阿里云开源通义千问140亿参数模型Qwen-14B、Qwen-14B-Chat

阿里云于9月25日开源通义千问模型Qwen-14B及其对话模型Qwen-14B-Chat,免费商用。Qwen-14B在多项评测中表现卓越,接近Llama2-70B水平。

微信截图_20230925143325.png

AiBase提要:

🔍 数据质量提升:Qwen-14B使用3万亿Token训练数据,强化推理、认知、规划和记忆。

💬 对话升级:Qwen-14B-Chat基于强大基座模型,准确度提升,内容更符合人类偏好。

📥 下载与调用:用户可在魔搭社区或阿里云灵积平台获取Qwen-14B和Qwen-14B-Chat模型。

👨‍💻💡🎯聚焦开发者

几千元训完中文版LLaMA2!Colossal-LLaMA-2把大模型门槛打下来了!

从头预训练大模型过去需要高达5000万美元的投资,但Colossal-LLaMA-2降低了门槛。只需15小时和几千块钱的投入,即可训练出中文LLaMA2大模型,性能接近SOTA水平,完全开源,可用于各领域低成本构建大模型。

image.png

AiBase提要:

🚀 低成本训练:15小时、几千元训完中文版LLaMA2,降低大模型训练成本。

📈 性能提升: 中文版LLaMA2在多项任务上表现出色,达到SOTA水平。

🌐 全面开源: 开源训练流程、代码和权重,可广泛应用于不同领域。

融资1亿美元的类ChatGPT模型开源啦!可商用,8个模型

生成式AI平台Writer获得1亿美元融资,开源了8个型号的大语言模型Palmyra,包括支持数据微调,适用于多个领域的型号。其中InstructPalmyra-20b支持高级自然语言处理,Palmyra-Med用于医疗保健,Palmyra-Large适用于多种业务场景,性能评测表现出色。Writer成为ChatGPT的主要竞争对手。

开源地址:https://huggingface.co/Writer

在线免费体验地址:https://app.writer.com/organization/

图片

AiBase提要:

🚀 Writer获1亿美元融资,开源Palmyra大语言模型。

💡 Palmyra包括多个型号,支持数据微调,适用于不同领域。

🌟 Palmyra在性能评测中表现出色,成为ChatGPT竞争对手。

UCSD 研究人员开源Graphologue:将LLM文本响应转化为交互式图表

大型语言模型(LLMs)如GPT-4因其生成各种用户查询的文本响应的能力而广受欢迎。加州大学圣地亚哥分校的研究人员开发了Graphologue,这是一种新颖的技术,旨在通过实时将基于文本的LLM响应转换为交互式图形图表来解决这些限制。Graphologue识别重要的文本组件,将它们组织成图形表示,并从LLM答案中创建节点链接图表,使复杂的关系和概念更容易理解。

image.png

项目地址:https://github.com/ucsd-creativitylab/graphologue

AiBase提要:

1. 📊 Graphologue改变了LLM与用户之间的互动方式,通过引入图形表示,使非线性对话成为可能。

2. 💡 这项技术通过将文本响应转化为图形图表,提供更清晰的可视化,帮助用户更好地理解复杂信息。

3. 🔄 用户可以积极互动,自定义图形表示,促进更具动态性和个性化的对话。

中国研究团队发布多视角数据集“FreeMan” 解决3D人体姿势估计局限性

中国的研究团队合作推出了名为“FreeMan”的大规模多视角数据集,旨在解决现有3D人体姿态估计数据集的局限性。该数据集包含来自8台智能手机的1100万帧视频,跨足了室内和室外环境,具备不同光照条件,提供了更真实的场景多样性。研究者通过自动化的标注流程生成了精确的3D标注,可用于多种任务。这一数据集的开源将推动人体建模、计算机视觉和人机交互领域的进步,弥合了受控实验室条件与真实场景之间的差距。

image.png

项目网址:https://wangjiongw.github.io/freeman/

AiBase提要:

📊 数据集多样性: "FreeMan"包含1100万帧视频,涵盖了室内、室外、不同场景和光照条件,为3D人体姿态估计提供更真实的数据多样性。

🧬 自动化标注: 研究团队开发了自动化标注流程,包括人体检测、2D关键点检测、3D姿态估计和网格标注,为多种任务提供了有价值的数据。

🌐 推动领域进步: "FreeMan"的开源将促进人体建模、计算机视觉和人机交互领域的进步,有望提高模型在真实场景中的性能。

📰🤖📢AI新鲜事

Runway推出镜头控制功能,提升AI视频生成

Runway最新功能为AI视频生成带来精准镜头控制,包括运动速度和方向的调整,不仅适用于图像生成视频,还能用于文本生成视频。此举是应对竞争对手Pikalabs的举措之一,两者在AI视频领域竞争激烈,各有优势。Runway侧重加强镜头控制,而Pikalabs致力于提升模型理解能力。AI视频生成领域发展迅猛,文章提到了两者的竞争情况以及未来的发展方向。

AiBase提要:

1. 📹 Runway推出精准镜头控制功能,可单独调整镜头运动和速度。

2. 💥 功能不仅适用于图像生成,还可用于文本生成视频。

3. ⚔️ Runway和Pikalabs竞争激烈,前者加强镜头控制,后者提升模型理解能力。AI视频领域竞争白热化。

中文在线与华为云签署合作协议 涉及大模型训练等

华为云与中文在线签署合作协议,重点合作领域包括大模型训练,双方将共同推动数字内容生态的发展。

AiBase提要:

- 🤝 合作协议签署: 华为云与中文在线正式签署合作协议,涉及公有云和AI等领域。

- 📚 数字内容合作: 华为云将优先承载中文在线的大模型训练内容。

- 🌐 业态多元化: 中文在线积极拓展多模态内容,包括文字生成漫画和动态漫画。

谷歌或于2027年自主生产AI芯片

谷歌计划自主生产Tensor处理单元(TPUs),摆脱博通依赖,以降低成本,每年可节省数十亿美元。

AiBase提要:

🔍1、谷歌考虑自主研发TPUs,不再依赖博通,旨在节省大量成本。

🔍2、与亚马逊和微软类似,谷歌希望自主研发AI芯片,预计每年可节省数十亿美元。

🔍3、决策受博通价格策略影响,但最终尚未确定,谷歌重点是降低芯片成本和减少对Nvidia的依赖。

亚马逊宣布向Claude 母公司Anthropic投资高达40亿美金

亚马逊宣布向人工智能初创公司Anthropic投资40亿美元,以加强在云计算领域的竞争。这项交易将使亚马逊的员工和云客户能够早期获得Anthropic的技术,并整合到其业务中。该交易还表明云计算公司正在积极采取行动,以应对人工智能初创公司的崛起。

AiBase提要:

🔍 亚马逊向Anthropic投资40亿美元,加强云计算竞争。

🌐 员工和云客户将早期获得Anthropic技术。

🚀 云计算公司积极行动,抵御人工智能初创公司崛起。

新研究称,利用AI创作者比人类更环保 碳排放更少

最新研究发现,基于人工智能的系统如ChatGPT、BLOOM、DALL-E2和Midjourney在文学和艺术创作方面,与人类创作者相比,碳排放明显减少。

AiBase提要:

🌱 环保文创:AI创作者环保性能超越人类,碳排放显著降低。

🖋️ 文学艺术:ChatGPT、BLOOM等系统以小数千分之一的碳排放量完成创作。

🧐 质量比较:AI在一些任务上胜过人类,但在复杂任务中仍有局限。

好莱坞编剧就AI和薪酬问题达成“暂定”协议

好莱坞编剧工会(WGA)与电影电视制片和制作人联盟(AMPTP)达成了一项“暂定”协议,结束了长达数月的罢工,涵盖了2023年集体协议、薪酬和AI在剧本创作中的使用等问题,具体条款未公布。

AiBase提要:

🤝协议达成:好莱坞编剧工会(WGA)宣布与电影电视制片和制作人联盟(AMPTP)达成了一项“暂定”协议,结束了长达数月的罢工。

💰 涉及薪酬:协议覆盖了新的2023年集体协议,包括薪酬和AI在剧本创作中的使用等所有问题,但具体的协议条款尚未立即公布。

⏸ 罢工暂停:在工会董事会和会员批准之前,罢工将暂停,否则工会将继续罢工。

引入Bard后,谷歌Gmail工具生成了一些虚构的电子邮件

谷歌最近将其大型语言模型驱动的聊天机器人Bard引入了一系列产品,包括Gmail、Google Drive、Google Docs、Google Maps以及谷歌旗下的YouTube等。尽管谷歌试图将其新一代生成式AI与已有的产品线相结合,但似乎行动有些仓促。一名记者测试后发现,Bard AI制造了虚假的电子邮件,甚至错误地提供航班信息和虚构的列车信息。谷歌表示Bard扩展仍处于实验阶段,但这一产品引发了隐私担忧,也让人担心谷歌在AI领域可能会犯一些严重错误。

AiBase提要:

1. 😳 谷歌引入Bard,但AI制造虚假电子邮件,引发隐私担忧。

2. 🤖 Bard扩展试验阶段,错误提供航班和列车信息。

3. 🌐 谷歌将AI整合到多款产品中,但行动似乎仓促,引发问题。

Canalys预测:2027年将有60%的个人电脑兼容AI功能 出货量预计超过1.75亿台

Canalys预测,到2027年,60%的个人电脑将兼容AI功能,出货量预计将超过1.75亿台,兼容AI的个人电脑市场将迎来爆发式增长。

AiBase提要:

📈 趋势预测: Canalys预测2027年,60%的个人电脑将兼容AI功能,出货量预计将超过1.75亿台。

💻技术要求: Canalys指出,兼容AI的个人电脑必须配备可加快AI计算的芯片组或模块,包括高通的Hexagon张量加速器、苹果的神经引擎、英特尔的Movidius VPU和AMD的APU。

🚀 市场增长: 随着Windows操作系统和AI工具的应用,2025年和2026年兼容AI个人电脑市场有望实现爆发式增长,到2027年,出货量预计将超过1.75亿台,占总个人电脑出货量的60%,年均增长率达94%。

🤖📱💼AI应用

Meta计划推出AI聊天机器人服务「Gen AI Personas」

Meta计划推出名为「Gen AI Personas」的AI聊天机器人服务,旨在挽回社交媒体平台的用户流失问题。然而,Meta的新产品受到了来自Character.AI的直接竞争,后者已经成功吸引了数百万年轻用户。虽然Meta希望通过这一产品吸引年轻用户,但目前的反应复杂,不确定性较大。

image.png

AiBase提要:

🤖 Meta计划推出AI聊天机器人服务: Meta计划推出名为「Gen AI Personas」的AI聊天机器人服务,具备个人助理功能、不同性格的聊天机器人选择以及帮助用户更好表达的能力。

🥊 直接竞争Character.AI: 与Character.AI相比,Meta的新产品主打「虚拟角色聊天」,但目前的虚拟角色设定被批评为过时,引发了复杂的用户反应和疑虑。

📈 Character.AI的成功: Character.AI在短短两年内取得了令人印象深刻的成功,拥有超过1500万用户,主要吸引18-24岁的年轻用户,这使得Meta对其产生浓厚兴趣并尝试模仿。

Genmo AI秒杀Midjourney!3秒创作视频、图像和3D模型

Genmo是一款基于人工智能的创意产品,通过简单的语言描述,能够快速生成视频、图像和3D模型,为内容创作者、设计师和艺术家提供了强大的创作工具。

image.png

地址:https://www.genmo.ai/create/video

AiBase提要:

🚀 创意无限:Genmo利用人工智能技术,通过简单的文字描述,能够快速生成栩栩如生的视频,用户可以制作各类视频内容。

🎨 多样图像生成:除了视频,Genmo还提供强大的图像生成功能,用户只需输入文字描述,就能获得多样风格的高清图片。

🤖3D模型轻松制作:Genmo的3D生成功能让用户能够轻松创建各种3D模型,应用范围广泛,无需专业技能。

豆绘AI:专注为建筑设计从业者提供空间设计AI服务

豆绘AI平台是南京豆绘科技有限公司的产品,专注于为建筑室内园林景观从业者提供空间设计AI服务,包括AI绘图、AI设计助手和AI全景合成。它通过将AI技术与艺术领域相结合,协助用户提高绘画技巧,实现创作效率。

image.png

体验地址:https://www.douhuiai.com/

AiBase提要:

1. 🏢 专注建筑设计:豆绘AI平台为建筑室内园林景观从业者提供AI服务,致力于简化设计工作。

2. 🎨 多功能平台:平台拥有多项功能,包括AI绘图、AI设计助手和AI全景合成,不断更新改进。

3. 🚀 技术驱动发展:豆绘AI的长期目标是通过技术推动行业进步与效率提升,改变行业的发展格局,使从业者受益于科技的便利。

举报

  • 相关推荐
  • 大家在看
  • 几千元训完中文版LLaMA2!Colossal-LLaMA-2把大模型门槛打下来了

    从头预训练大模型被认为需要高达5000万美元的投资,这让很多开发者和中小企业望却步。Colossal-LLaMA-2的出现降低了大模型的门槛。该方案业已应用到多个行业领域,构建垂类大模型并取得良好效果。

  • 百度发布首个量子领域大模型百度量子助手、量子写作助手AI原生应用

    百度发布首个量子领域大模型,及百度量子助手和量子写作助手两大AI原生应用,旨在芯片层、框架层、模型层及应用层等全栈技术上加速量子技术与大模型深度融合,充分激发两大技术各自的潜力。该量子领域大模型是在文心一言基础上,使用量子领域高质量数据进行更有针对性的训练和优化构建的量子领域大模型,能更好地理解量子知识,专业执行量子任务。只需输入6个变量,量子写作助手可在5分钟内撰写一篇13000字符合格式要求的专利文档,高效帮助企业将量子领域的研究成果与知识产权沉淀为企业资产。

  • 百度发布医疗大模型“灵医大模型

    9月19日,百度正式发布国内首个“产业级”医疗大模型——灵医大模型。百度正式宣布面向大健康上下游产业开放灵医大模型测评、试用,推动医疗行业的数字化和智能化进程。在辅助诊疗方面,灵医大模型可实现通过多轮对话了解病人病情,实时辅助医生确诊疾病,推荐治疗方案,提升就诊全流程的效率和体验,并成为患者的24小时“健康管家”,提供智能客服服务。

  • 国内首个“产业级”医疗大模型百度“灵医”发布:文心大模型加持

    目前,国内已有多家科技大厂扎堆发布自家大模型,被业内看作为AI大模型百模”大战已经打响。在各家大战的同时,百度日前正式发布了国内首个产业级”医疗大模型灵医大模型,这也是国内首个实现商业化落地的医疗大模型。技术底座方面,根据IDC发布《AI大模型技术能力评估报告,2023》,灵医大模型的技术底座百度文心大模型3.5拿下12项指标的7个满分,综合评分第一,算法模型第一,行业覆盖第一。

  • AI大模型时代 ≠ 只有大模型AI时代

    什么样的技术能经历时间洗礼还历久弥新?答案或许可以归总为一个“三部曲”般的规律——兴起、发展和大规模应用,外加这个过程再一次演进式的迭代。引领第一次工业革命的是蒸汽机,当它演进成为内燃机并开始普及时,第二次工业革命的颠覆者——电能本身以及与它相关的各种设备正处于初创期在电力设备走向微电子的迭代革新时,各种燃油引擎还在持续改良和普及中�

  • UOS AI来了!中国首个接入大模型的操作系统

    刚刚统信软件运营的深度社区正式官宣deepin成为首个接入大模型的开源操作系统统信软件高级副总经理、CTO张磊表示:“目前UOSAI实现了国内外主流大模型的能力接入,并封装成deepin的AI底层公共能力;同时,我们也将把UOSAI逐步开源给第三方应用,让更多应用可以在deepin上直接调用大模型。”deepin接入大模型,释放AI价值操作系统作为数字时代的基石,为所有计算机软件提供了运行与支撑平台。我们也期待更多的开发者和企业能够参与到这一创新过程中来,共同推动开源操作系统和大模型的深度融合,为构建更美好的未来科技世界贡献力量。

  • 百度CIO李莹接棒小度 大模型或助力小度增长

    百度宣布百度集团副总裁、CIO李莹博士出任小度科技CEO。李莹于2004年加入百度,在多个核心业务IntegerField上获得丰富经验,任百度CIO期间,她运用AI优化内部流程。小度可望借助百度在AI方面的技术优势,在大模型加持下获得进一步发展。

  • 华为发布盘古汽车大模型和医学大模型 上线昇腾AI云服务“模千态”专区

    在华为全联接大会2023的主题演讲中,华为常务董事、华为云CEO张平安介绍了盘古大模型在矿山、政务、气象、数字人直播、软件开发等领域的最新升级和落地进展。他还发布了盘古汽车大模型和医学大模型。为了解决这些问题,华为云在贵安、乌兰察布、芜湖部署了三大AI算力中心,旨在为企业提供可靠的AI算力。

  • AI视野:多模态ChatGPT即将上线;抖音“AI美式证件照”走红;百度发布交通大模型“ACE3.0”

    OpenAI在美东时间9月25日宣布对ChatGPT进行重磅升级,实现了看图、听声音、输出语音内容的三大功能,为通用人工智能迈出重要一步。DeepMind研究:LLMs在图像和音频压缩方面出色表现Google旗下的DeepMind研究人员发现,大型语言模型除了在文本领域表现出色在图像和音频数据的压缩方面具备出色能力,超越了专用的压缩算�

  • 中国移动发布九天·众擎基座大模型推出多个行业大模型

    10月12日,中国移动推出了九天·众擎基座大模型,并基于该基座大模型发布了多个行业大模型,包括九天企业通话大模型、九天川流出行大模型等。中国移动还宣布了“天穹”算网大脑全网试商用。

  • 知了zKnown:致力于信息降噪 / 阅读提效的个人知识助手

    知了 zKnown 是一款 AI-Native 构建的个人知识助手,专注于信息降噪和阅读提效。它通过多端同步、多渠道总结、长文本支持等功能,帮助用户高效地管理和整理信息。产品的主要优点包括:- 多端同步:用户可以在移动app、桌面客户端、网页版、小程序等多个平台同步使用。- 多渠道总结:支持微信公众号、知乎、简书、36Kr、少数派等多个渠道的文章总结。- 长文本支持:最长支持总结3万字的文章内容。- 摘要导出:用户可以将摘要保存到 Notion、Flomo 等平台。- 产品背景:知了 zKnown 致力于通过 AI 技术提升用户的阅读和信息管理效率,适合需要高效处理大量信息的用户。

  • MBox AI Meet:实时转录与会议总结的谷歌会议扩展

    MBox AI Meet是一款免费Chrome扩展,专为Google Meet设计,提供实时转录和自动生成会议总结的功能。它利用AI技术帮助用户在会议中专注于讨论,而无需担心记笔记。该工具通过实时转录捕捉会议的每一个细节,并在会议结束后自动生成总结,确保用户不会错过任何重要信息。MBox AI Meet的隐私优先策略确保会议安全,不存储任何音频或视频内容。此外,该扩展还计划在未来更新中增加更多AI功能,如发言人识别、实时AI助手等。

  • Klee:本地安全AI,保障数据隐私。

    Klee是一款macOS原生的AI助手应用程序,专注于本地处理数据,确保数据安全和隐私。它使用先进的AI技术,如RAG(检索增强生成)和开源大型语言模型,如Llama 3和Mistral,为用户提供高效、智能的笔记、搜索和知识管理功能。Klee的主要优点包括本地运行以保护隐私、支持团队协作、免费使用以及优化的macOS体验。

  • Kipps.AI:快速构建AI助手,提升业务效率

    Kipps.AI 是一个在线平台,允许用户在短短两分钟内构建自己的AI助手,并将其集成到业务中。该平台支持多种数据源,如PDF、Notion、网站链接和文本,用户只需提供这些数据,Kipps.AI 会处理其余部分。它还与常用的工具如GoDaddy、Wordpress、Drupal、Squarespace、Magento和Wix等进行集成,使得用户可以轻松地将AI助手集成到现有的业务流程中。

  • CrossPrism for MacOS:图像识别、标注和关键词生成工具

    CrossPrism for MacOS 是一款专为摄影师设计的图像识别、标注和关键词生成工具。它利用多核 CPU、GPU 和神经引擎,能够识别物种、生成标题和描述,并支持模型训练的可定制性。用户可以在本地自动标注无限量的原始照片,确保所有照片安全地存储在 Mac 上,无需担心云服务中断、数据锁定或文件传输问题。其20多个专家模型可以对从鸟类到地标的各种内容进行分类,并提供新的视角来整理目录和重新发现旧照片。此外,它还支持视频处理、Lightroom 插件、图像质量评估等功能,使其成为一个强大的筛选工具。

  • ZETIC.ai:构建零成本的设备端AI。

    ZETIC.ai提供了一种革命性的设备端AI解决方案,使用NPU技术帮助企业减少对GPU服务器和AI云服务的依赖,从而显著降低成本。它支持任何操作系统、任何处理器和任何目标设备,确保AI模型在转换过程中不损失任何核心功能,同时实现最优性能和最大能效。此外,它还增强了数据安全性,因为数据在设备内部处理,避免了外部泄露的风险。

  • Kerqu.Ai:一站式AI内容生成器,助力跨境电商提升效率。

    Kerqu.Ai是一个为跨境电商卖家提供一站式AI解决方案的平台,整合了先进的AI技术,帮助用户节约成本、提升品牌影响力和销售转化率。产品通过AI技术实现模特换场景、AI图片创作、批量抠图、图片变高清等功能,同时提供一键撰写文案、优化文案和多语言翻译服务,满足多站点经营需求。

  • ReviewHawk:通过分析用户评论,降低用户流失率。

    ReviewHawk是一个专注于分析应用商店评论的工具,旨在帮助企业降低用户流失率,获取用户反馈,从而改善产品。它通过数据驱动的决策和用户满意度分析,帮助企业了解用户真正想要的功能,从而提升用户留存率和产品满意度。

  • Airtable Cobuilder:快速创建与管理数据的应用程序

    Airtable Cobuilder 是一款强大的应用程序构建工具,旨在通过简单的拖放界面和AI辅助功能,帮助用户快速创建和管理数据。它允许用户连接和简化他们最关键的数据,通过可视化数据、自定义视图和集成其他业务工具,提高团队协作和数据管理的效率。该工具特别适合需要高度定制化和灵活性的业务应用场景。

  • Alertfor:追踪网络信息,及时获取答案变化

    Alertfor 是一个在线平台,通过其专有的AQTA (Ask Question Track Answer) 流程,允许用户提交复杂问题,并在网页上寻找最相关的答案。它通过持续追踪提供连续的更新,确保用户能够获得准确且及时的信息。

  • Unskool:家长支持工具,助力家庭教育

    Unskool是一个由家长为家长制作的辅助工具,旨在简化家庭教育过程。它通过去除繁琐的行政工作,让家长能够专注于创造一个丰富的学习环境,让家长和孩子都能茁壮成长。Unskool提供了跟踪、记录和灵感激发的功能,并通过人工智能生成定制的、按需的课程计划,帮助家长更高效地进行家庭教育。

  • AI Generated Diagram:智能生成图表工具

    AI Generated Diagram 是一款利用人工智能技术生成图表的工具。它通过用户输入的提示(prompts)来创建图表,支持多种布局类型,如水平布局(Horizontal)。用户可以通过编辑、配置等操作来调整图表的细节,并支持导出为SVG格式或导出数据。该工具不仅提高了设计图表的效率,还通过AI技术提升了图表的美观度和准确性。

  • Free AI Image Extender:使用人工智能扩展图像边界

    AI Image Extender 是一款利用人工智能技术扩展图像边界的工具,通过生成新内容与现有图像无缝融合,增强图像的视觉延展性。该产品通过先进的AI算法,能够智能识别图像内容并生成自然过渡的扩展区域,适用于需要图像扩展或背景生成的各种场景。

  • Capacities:一个为你的思维打造工作室的APP

    Capacities是一个旨在改善人们思考方式和工作流程的应用程序。它通过使用对象而非传统文件和文件夹来组织信息,帮助用户更直观地理解和连接复杂的信息结构。该应用支持网络化笔记,使用户能够自然地构建信息网络,激发新的创意。Capacities还提供AI助手,帮助用户与笔记中的对象动态互动,并提高写作质量。此外,该应用注重数据安全和隐私保护,符合GDPR标准,数据存储在欧盟的加密服务器上。

  • CLASI:高质量、类人同声传译系统

    CLASI是一个由字节跳动研究团队开发的高质量、类人同声传译系统。它通过新颖的数据驱动读写策略平衡翻译质量和延迟,采用多模态检索模块来增强特定领域术语的翻译,利用大型语言模型(LLMs)生成容错翻译,考虑输入音频、历史上下文和检索信息。在真实世界场景中,CLASI在中英和英中翻译方向上分别达到了81.3%和78.0%的有效信息比例(VIP),远超其他系统。

  • image-matting:AI抠图项目,使用开源模型实现图像抠图。

    image-matting 是一个基于开源模型 briaai/RMBG-1.4 的AI抠图项目。该项目旨在通过学习AI技术、GUI开发、前端学习以及i18n国际化等技术,实现本地模型算法的图像抠图功能。它支持单张和批量抠图,用户可以通过拖拽和粘贴的方式快速进行图像处理。项目还提供了打包后的运行文件下载链接,方便用户使用。

  • OnlyPans:AI定制周晚餐计划

    OnlyPans是一个利用人工智能技术为用户提供定制化晚餐计划的应用程序。它通过与用户的简短聊天来了解用户的预算、口味偏好、语言习惯、饮食限制以及日常生活的忙碌程度,然后快速生成符合用户需求的晚餐计划。随着用户使用时间的增长,OnlyPans会不断学习和优化,提供更加个性化的服务。此外,OnlyPans还提供智能购物清单功能,帮助用户避免食品浪费和不必要的紧急购物。OnlyPans注重用户隐私保护,承诺不会出售用户的任何信息。

  • Excel Dashboard AI:将Excel转换为仪表板和报告的AI工具。

    Excel Dashboard AI是一款利用人工智能技术,将Excel数据快速转换为交互式仪表板和分析报告的工具。它通过自然语言处理能力,允许用户以对话形式与数据进行交流,从而迅速获得洞察。产品的主要优点包括快速生成多样化的数据分析维度、自然语言编辑和锁定分析视角、一键生成交互式仪表板、AI解读图表含义以及将仪表板转换为详尽的分析报告等。

  • 清影 AI 视频生成服务:基于 AI 技术生成视频内容的智能服务。

    清影 AI 视频生成服务是一个创新的人工智能平台,旨在通过智能算法生成高质量的视频内容。该服务适合各种行业用户,能够快速便捷地生成富有创意的视觉内容。无论是商业广告、教育课程还是娱乐视频,清影 AI 都能提供优质的解决方案。该产品依托于先进的 GLM 大模型,确保生成内容的准确性与丰富性,同时满足用户个性化需求。提供免费试用,鼓励用户探索 AI 视频创作的无限可能。

  • Tempest AI:无需编码,10分钟构建游戏

    Tempest AI是一个无需编码即可快速构建游戏的平台。它利用强大的AI助手帮助用户从零开始创建游戏,支持动态角色、适应性任务和互动世界。用户可以通过拖放编辑器构建世界,设计游戏机制,并通过故事构建器控制游戏叙事。Tempest AI不仅适合游戏开发者,也适合那些希望探索创意和互动叙事的爱好者。

今日大家都在搜的词: