AI工具
ControlFoley
ControlFoley是小米开源的可控视频音效生成模型,能解决V2A领域可控性难题。模型统一支持文本引导、文本控制与参考音频控制三类视频配音任务,通过自研时空音...
OmniVoice Studio
OmniVoice Studio 是全本地运行的开源 ElevenLabs 替代方案,提供跨平台桌面客户端,支持零样本语音克隆、声音设计、视频自动配音、语音听写等功能,覆盖 646...
MiniMax M3
MiniMax M3是MiniMax推出的全新AI模型,具备领先的编程、Agent与长文本处理能力。模型采用创新的MSA稀疏注意力架构,支持1M超长上下文,效率提升20倍。
Hermes Desktop
Hermes Desktop 是开发者 sir1st 推出的 Hermes Agent 社区版桌面应用。将 Python 运行时、hermes-agent 核心与 hermes-web-ui 可视化界面打包为单一可执行文...
getdesign.md
getdesign.md 是 VoltAgent 团队推出的 AI 原生设计系统库与工具平台,核心提供 60+ 顶级品牌的 DESIGN.md 设计规范文件。基于 Google Stitch 提出的 DESIGN....
SenseNova-U1-8B-MoT-Infographic
SenseNova-U1-8B-MoT-Infographic 是商汤科技开源的 8B 参数信息图增强模型,基于 SenseNova-U1-8B-MoT 统一架构,通过专项数据训练与 RL 强化学习,显著提升...
MAI-Image-2.5
MAI-Image-2.5 是微软研究院推出的旗舰级文生图模型,为 MAI-Image 系列最强版本。模型在 Arena 文生图排行榜以 1,254 分冲上第 3 名,较前代提升 72 分,打...
Runway MCP
Runway MCP 是 Runway 推出的官方MCP 服务器,工具将 Gen-4.5、Seedance 2.0、Kling 3.0 等顶尖 AI 图像与视频生成模型接入 Claude、ChatGPT、Cursor 等 MCP ...