首页 > 业界 > 关键词  > Suno最新资讯  > 正文

今日AI:Suno《宫保鸡丁》杀入全球AI音乐榜;AI太烧钱? Stability AI CEO辞职;Domo AI上线照片转视频功能;Viggle让静态图片跳舞

2024-03-25 15:29 · 稿源:站长之家

欢迎来到【今日AI】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

新鲜AI产品点击了解https://top.aibase.com/

QQ截图20240325154213.png

🤖📱💼AI应用

Domo AI上线新功能 只需一张照片和视频即可让人物动起来

image.png

【AiBase提要:】

⭐️ 只需一张照片和一个动态视频就可以让静态的图像跳舞

⭐️ 可获取视频中的动作,自动将照片中的人物融入到视频中

⭐️ 功可以在 Domo AI 的 Discord 频道上体验这项功能。只需使用 /move 命令即可

产品入口:https://top.aibase.com/tool/domoai

Discord下载地址:https://top.aibase.com/tool/discord

视频编辑框架AnyV2V

【AiBase提要:】

⭐️无需训练可以直接集成到现成的图像编辑模型和图像到视频生成模型中

⭐️支持文本提示的各种视频编辑,包括风格转换和面部替换。

⭐️可以根据你的文本提示改变场景中的天气、人物转换等。

项目地址:https://top.aibase.com/tool/anyv2v

文生视频软件Viggle 可通过文字让静态图片跳舞

QQ截图20240325103245.png

【AiBase提要:】

⭐ 根据用户文字描述生成视频,可以让角色做各种动作,包括跳舞

⭐ 也支持上传视频,参考视频动作让静态图片动起来

⭐ Viggle不仅限于传统的2D视频制作,它还能够创建3D角色和场景。

产品入口:https://top.aibase.com/tool/viggle

可在discord免费体验:https://discord.com/invite/5kk5SKwTWd

新型文生成视频AI——Gatekeep 可将数学物理问题转换为视频内容

QQ截图20240325144051.png

【AiBase提要:】

⭐ Gatekeep是一款新型文本转视频AI,专注于将数学和物理问题转化为视频内容。

⭐ Gatekeep根据用户输入的文本提示,生成包含图表、图示和动画的教学视频。

⭐ Gatekeep在数学学习中特别强调应用,可以帮助学生更直观地理解和掌握知识。

体验地址:https://discord.com/invite/36PTEgY892

Synclabs发布唇型同步模型Sync-1.6.0减少闪烁现象

【AiBase提要:】

⭐️ 新版本唇型同步模型Sync-1.6.0重大升级

⭐️ 优化口型同步准确性和视频质量,减少闪烁

⭐️ 用户可通过浏览器界面或API体验和集成模型服务

体验地址:https://top.aibase.com/tool/sync-labs

视频生成工具StreamingT2V:可根据文字描述生成2分钟长度的视频

image.png

【AiBase提要:】

⭐️ 自回归方法逐帧生成视频

⭐️ 长视频生成、高动态效果、时间一致性

⭐️ 文本紧密对齐、高质量图像、模型灵活性

项目页:https://top.aibase.com/tool/streamingt2v

宣称超过XTTS!VoiceCraft:一个支持克隆语音及修改原始音频文本的语音模型

【AiBase提要:】

⭐ 强大的音频克隆能力,通过提供原始音频生成相似新音频

⭐ 支持通过修改原始音频文本编辑音频,提高制作效率

⭐ 演示效果令人印象深刻,显示出巨大潜力

演示页面:https://top.aibase.com/tool/voicecraft

项目地址:https://github.com/jasonppy/VoiceCraft

AI电影生成工具LTX Studio将于3月27日发布

【AiBase提要:】

⭐️ 一键生成电影的工具,根据用户输入的文字生成剧本和视频。

⭐️ 强大功能包括精确指导每个场景、换脸功能和角色生成。

⭐️ 用户可修改、替换角色,提升创造力和自由度。

内测入口:https://top.aibase.com/tool/ltx-studio

📰🤖📢AI新鲜事

百度文心一言或将免费开放 200 万 - 500 万长文本能力

【AiBase提要:】

⭐️ 下个月实施,提供更广泛文本处理能力。

⭐️ 百度文心一言版本升级,长文本能力范围在 200 万- 500 万字。

⭐️ 用户可更轻松处理大篇幅文字,提升处理效率。

《宫保鸡丁》杀入全球AI音乐榜前十!Suno被玩疯了

image.png

【AiBase提要:】

⭐ 《宫保鸡丁》用菜谱做歌词,登上全球AI音乐热门榜前十

⭐ Suno是音乐版ChatGPT,支持生成各种风格、语种歌曲。

⭐ Suno V3版本更高质量,两分钟内生成完整歌曲,支持任意语言。

产品入口:https://top.aibase.com/tool/suno-ai

iOS18或将在系统更新中引入生成式AI功能

【AiBase提要:】

⚡ 苹果预计将在6月的新品发布会上宣布 iOS18的新功能

⚡ 据 Bloomberg 报道,iOS18将引入生成式人工智能功能,并增加存储空间以支持这些功能

⚡ iPhone16的传闻规格包括 RAM 和存储容量升级,以适配新的人工智能功能

Mistral7B v0.2基模型开源,支持32K上下文

【AiBase提要:】

⭐ 提升上下文到32K,取消滑动窗口

⭐ 与微软达成长期合作,微软投资1600万美元

⭐ 发布旗舰级大模型Mistral Large,竞争OpenAI的GPT-4

下载链接:https://models.mistralcdn.com/mistral-7b-v0-2/mistral-7B-v0.2.tar

项目入口:https://top.aibase.com/tool/mistral-7b-instruct-v0-2

AI太烧钱 图像生成头部玩家也玩不起了? Stability AI CEO辞职

【AiBase提要:】

🔍 Stability AI CEO Emad Mostaque辞职,将致力于去中心化人工智能。

📉 公司财务状况压力巨大,CEO被重要投资者要求辞职。

💡 Stability AI面临竞争激烈,采用开源策略导致收入困境。

魔搭社区开源Data-Juicer 、 lite-Sora 类 Sora 模型

【AiBase提要:】

🛠️ 提供一站式工具链,包括数据处理工具、多模态数据集、类 Sora 基础模型、系统 Data-Juicer。

🔧 Data-Juicer含100多种高效算子,可提升视频数据处理效率和质量。

🚀 推出基础类 Sora 模型 lite-Sora,并举办 “ModelScope-Sora 挑战赛” 鼓励开发者参与类 Sora 模型开发。

Data-Juicer页面:https://github.com/modelscope/data-juicer

lite-Sora页面:https://github.com/modelscope/lite-sora

微软开源创新LoRA组合方法,增强文生图复杂细节控制

【AiBase提要:】

🔍 LoRA在文生图领域广泛应用,能准确渲染、融合特定元素,如字符、服装、背景,同时可优化图像操作。

🔍 多重LoRA组合方法由微软和伊利诺伊大学研究人员开发,包括LoRA Switch和LoRA Composite,提高图像生成质量。

🔍 LoRA Switch采用激活顺序切换模式,LoRA Composite则综合各LoRA分数指导图像生成过程,提升多元素图像效果。

项目地址:https://maszhongming.github.io/Multi-LoRA-Composition/

微软新工具LLMLingua-2:可将 AI 提示压缩高达80%,节省时间和成本

【AiBase提要:】

⚙️ LLMLingua-2智能压缩长提示,保留关键信息,使提示长度可减少至原长度的20%。

🚀 LLMLingua-2在多数据集上表现显著优于强基线,展现稳健泛化能力。

💻 LLMLingua-2只需两行代码实现,已集成到广泛使用的RAG框架中。

——————

今日Midjourney提示词分享:樱花少女

1_1711350595233_ai2023_ultra-realistic_photo_of_a_beautiful_Chinese_woman_shot__251c8466-f1e7-4928-a4a1-057b01f9de27.png

图源备注:图片由AI生成,图片授权服务商Midjourney

ultra-realistic photo of a beautiful Chinese woman, shot on a Sony a7III, On the streets full of cherry blossoms in Wuhan, Instagram influencer photo, detailed, lifelike --ar3:4--v 6.0

举报

  • 相关推荐
  • 大家在看
  • Nabubit:数据库设计助手,简化数据库设计、管理和演化。

    Nabubit是一个旨在帮助用户优化数据库设计、管理和演化的在线工具。它提供了上传数据库架构图、可视化数据库结构、以及使用自然语言提问的功能。用户可以从头开始设计数据库,无需担心命名或记住语法。完成设计后,可以将其导出到自己喜爱的数据库或框架中。

  • Otter Script:文档生成平台,快速创建复杂文档。

    Otter Script是一个文档生成平台,它通过自动化技术帮助用户节省时间,将原本需要几天完成的复杂文档工作缩短到几分钟。它简化了工作流程,让用户可以更高效地完成更多任务。

  • BNA:多功能AI超级应用,涵盖社交、电商、娱乐和教育。

    BNA AI Super App是一款集成了多种智能服务的超级应用,它不仅提供社交功能,如分享帖子、写博客、聊天和视频通话,还涵盖了AI电商和娱乐服务。此外,该应用还提供40种语言的AI教学服务,帮助用户学习不同的语言。BNA AI Super App以其强大的AI功能和多语言支持,满足了不同用户群体的需求。

  • Elisi:高效能自主层级式计划助手

    Elisi 是一款旨在帮助用户实现个人成长的终极组织者和指南。它通过直观的设计和用户友好的说明,帮助用户将梦想转化为清晰的结果,分解成可实现的里程碑,并通过AI技术理解并适应用户的个人需求,确保每一天都更有条理和高效。Elisi 致力于提供便捷服务,主要功能套件完全免费。

  • Omi AI:个性化AI助手,记录每一刻,与AI对话获取反馈。

    OMI APP是一个任务驱动的个性化AI助手,旨在通过语音和音频转录功能帮助用户提高记忆力和沟通效率。它是一个开源的AI记事本,提供提醒、建议等功能,同时注重用户隐私。

  • MeowMail:高送达率的AI电子邮件营销工具

    MeowMail是一款集成在Shopify后台的电子邮件营销应用,利用AI技术自动选择最佳发送时间,提高邮件的送达率至98%以上。它支持拖放编辑、从Klaviyo导入邮件列表、使用Beefree编辑器创建新邮件,并通过设定支出限制来管理邮件营销活动。MeowMail还提供企业级支持和自动翻译文本功能,帮助商家以低成本实现高效的邮件营销。

  • Maia 100:微软定制AI加速器,专为大规模AI工作负载设计。

    Maia 100是微软为Azure设计的首款定制AI加速器,专为大规模AI工作负载而打造,通过软硬件的协同优化,实现了性能、可扩展性和灵活性的最大化。它采用了TSMC N5工艺和COWOS-S互连技术,具备高达1.8TB/s的带宽和64GB的容量,支持高达700W的热设计功耗(TDP),但以500W运行,确保了高效的能效比。Maia 100集成了高速张量单元、向量处理器、DMA引擎和硬件信号量,支持多种数据类型和张量切分方案,并通过以太网互连支持大规模AI模型。此外,Maia SDK提供了丰富的组件,支持快速部署PyTorch和Triton模型,并通过双编程模型确保高效的数据处理和同步。

  • LTM:超长上下文模型,革新软件开发

    Magic团队开发的超长上下文模型(LTM)能够处理高达100M tokens的上下文信息,这在AI领域是一个重大突破。该技术主要针对软件开发领域,通过在推理过程中提供大量代码、文档和库的上下文,极大地提升了代码合成的质量和效率。与传统的循环神经网络和状态空间模型相比,LTM模型在存储和检索大量信息方面具有明显优势,能够构建更复杂的逻辑电路。此外,Magic团队还与Google Cloud合作,利用NVIDIA GB200 NVL72构建下一代AI超级计算机,进一步推动模型的推理和训练效率。

  • EZ-work AI文档翻译:智能AI翻译,高效文档语言转换助手。

    EZ-work AI文档翻译是一款专注于文档翻译的在线服务,支持多种语言的翻译,包括中文、英语、日语、俄语、阿拉伯语和西班牙语等。它使用先进的AI技术,如gpt-4o-mini和deepseek-chat模型,为用户提供快速、准确的翻译服务。该产品适用于需要文档翻译的个人和企业,尤其在国际交流和学术研究领域尤为重要。

  • Watson AI:会议助手,自动记录并总结会议要点。

    Watson AI是一款会议助手应用程序,它通过录制系统音频和麦克风来转录和总结会议内容,自动提取行动项和会议摘要,帮助用户更高效地进行会议记录和回顾。

  • PicTech AI: 免费在线AI图片翻译 助力跨境电商

    PicTech AI是由学以致用科技旗下的智能图像工具品牌,专注于为跨境电商提供AI驱动的图片翻译服务。该产品利用人工智能技术,实现高准确率和高清晰度的图片翻译,支持中文、英语到日语、韩语等多国语言的翻译。PicTech AI的智能抠图功能,能够准确检测图片主体边缘,一键去除背景,无需专业编辑。产品背景信息显示,其团队由来自百度、网易、阿里巴巴等行业巨头的顶尖高科技人才组成,具备强大的技术实力和产品能力。该产品定位于帮助跨境电商从业者简化工作流程,提高效率,无需懂外语或图像处理技能即可使用。

  • AnythingLLM:一站式AI应用,支持多种文档和模型。

    AnythingLLM是一个多功能的桌面客户端,支持多种语言模型(LLM)和文档类型,提供完全私密的使用体验。用户可以根据自己的需求选择企业级模型、自定义模型或开源模型,如GPT-4、Llama、Mistral等。产品支持一键安装,本地运行,无需互联网连接,保护用户隐私。

  • 林哥的大模型野榜:更适合中国宝宝体质的大模型产品排行榜

    林哥的大模型野榜是一个专注于中国用户需求的大模型产品排行榜,提供了多维度的评估和排名,帮助用户更好地了解和选择适合的大模型产品。

  • Fluximg.com:AI文本到图像生成器,支持多尺寸和自动翻译。

    Fluximg.com是一个基于Flux模型的AI图像生成网站,提供从文本到图像的转换服务。它支持多种语言,包括中文和英文,并且具有用户友好的界面。网站提供免费和专业版本,使用户能够根据自己的需求选择不同的服务级别。

  • 现代文转古文:将现代汉语转化为古汉语,提升文采。

    现代文转古文是一款能够将现代汉语自动转换为古汉语的模型,它通过先进的自然语言处理技术,使得用户可以轻松地将现代文本转换成具有古典韵味的古文。这种转换不仅能够增加文本的文学价值,还能在教育、文学创作、文化传承等方面发挥重要作用。

  • Zamba2-mini:先进的小型语言模型,专为设备端应用设计。

    Zamba2-mini是由Zyphra Technologies Inc.发布的小型语言模型,专为设备端应用设计。它在保持极小的内存占用(<700MB)的同时,实现了与更大模型相媲美的评估分数和性能。该模型采用了4bit量化技术,具有7倍参数下降的同时保持相同性能的特点。Zamba2-mini在推理效率上表现出色,与Phi3-3.8B等更大模型相比,具有更快的首令牌生成时间、更低的内存开销和更低的生成延迟。此外,该模型的权重已开源发布(Apache 2.0),允许研究人员、开发者和公司利用其能力,推动高效基础模型的边界。

  • InterTrack:无需对象模板的人体与物体交互跟踪技术

    InterTrack 是一种先进的跟踪技术,能够在单目RGB视频中跟踪人体与物体的交互,即使在遮挡和动态运动下也能保持跟踪的连贯性。该技术无需使用任何对象模板,仅通过合成数据训练即可在真实世界视频中实现良好的泛化。InterTrack 通过分解4D跟踪问题为每帧的姿态跟踪和规范形状优化,显著提高了跟踪的准确性和效率。

  • GenWarp:生成新视角的图像,保持语义信息。

    GenWarp是一个用于从单张图像生成新视角图像的模型,它通过语义保持的生成变形框架,使文本到图像的生成模型能够学习在哪里变形和在哪里生成。该模型通过增强交叉视角注意力与自注意力来解决现有方法的局限性,通过条件化生成模型在源视图图像上,并纳入几何变形信号,提高了在不同领域场景下的性能。

  • Qwen2-VL:新一代视觉语言模型,更清晰地看世界。

    Qwen2-VL是一款基于Qwen2打造的最新一代视觉语言模型,具备多语言支持和强大的视觉理解能力,能够处理不同分辨率和长宽比的图片,理解长视频,并可集成到手机、机器人等设备中进行自动操作。它在多个视觉理解基准测试中取得全球领先的表现,尤其在文档理解方面有明显优势。

  • Dressplay:个性化服装生成器,轻松变换你的装扮。

    Dressplay是一个创新的在线服装生成器,允许用户通过简单的步骤生成个性化的服装。它利用先进的图像处理技术,让用户能够选择服装区域、目标人物以及想要穿戴的服装,从而创造出逼真的服装效果。Dressplay背后的技术不仅提高了服装设计的效率,也为用户提供了一种全新的个性化体验。目前,Dressplay提供免费试用,用户可以通过网页访问并体验其功能。

今日大家都在搜的词: