AI工具

MiniMax H3

MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本、图像、视频、音频的统一理解与原生生成。模型能输出原生双声道音视频...
阅读原文

Grok Voice Think Fast 2.0

Grok Voice Think Fast 2.0 是 SpaceXAI(xAI)推出的端到端语音到语音模型,采用原生语音到语音架构,无需经过识别—推理—合成多阶段流程即可直接理解并回应...
阅读原文

AngelSpec

AngelSpec 是腾讯混元团队开源的端到端推测解码训练框架,基于 TorchSpec 构建,支持 MTP 自回归与 DFly 块并行共 6 种草稿架构。推理与训练解耦,推理引擎经...
阅读原文

Codex Security CLI

Codex Security CLI是OpenAI开源的AI代码安全扫描CLI工具,前身为Codex内置的闭源安全插件。工具基于大模型语义理解自动扫描代码漏洞,深度验证攻击路径真实...
阅读原文

Lyria 3.5

Lyria 3.5是Google DeepMind 在 Google Flow Music 中推出的新一代音乐生成模型,实现音乐性、歌词质量、人声表现力与创作控制四项核心升级。
阅读原文

Instella-MoE

Instella-MoE 是 AMD 开源的混合专家语言模型系列,总参数量 16B、激活参数量 2.8B,采用 27 层解码器架构。模型基于 AMD Instinct MI300X / MI325X GPU 及 R...
阅读原文

KerWork

KerWork 是桌面级智能执行助手,用户用自然语言下达目标,工具可自动在本地电脑中翻阅查找资料、理解任务背景、规划执行步骤,并调度工具完成跨文件、跨应用...
阅读原文

JiuwenSwarm

JiuwenSwarm是华为2012实验室、华为云、终端小艺等团队联合构建的开源AI Agent平台,也是首个面向鸿蒙PC的开源AI统一工作台。平台采用多智能体协同架构,支持...
阅读原文

RingBot AI

RingBot AI是首个"Agent as a Service"智能体即服务 AaaS 平台,主张交付开箱即用的 AI 智能体。企业零代码操作,数分钟即可同时部署语音 Voice Ag...
阅读原文

NewMax

NewMax 是本地优先的 AI Agent 工作台,支持 macOS、Windows 与 Linux。平台以工作区为单位管理本地文件与对话,可调用 OpenAI、Claude、DeepSeek、Kimi 等十...
阅读原文

Qwen-Audio-Agent

Qwen-Audio-Agent 是阿里语音AI团队推出的开源实时语音 Agent 框架,基于 Qwen-Audio-3.0-Realtime 模型构建。框架作为统一的实时语音入口层,让用户通过自然...
阅读原文

AgentLink

AgentLink 是心言集团推出的跨智能体工作流终端 App,将分布在不同设备、不同类型的 AI 智能体,如 Claude、Codex、OpenClaw 等统一接入移动端,实现扫码配对...
阅读原文

ChatLens语镜

ChatLens语镜是独立第三方的AI会话智能体,通过纯视觉技术为微信等聊天场景提供智能回复辅助。基于OpenCV自研算法与本地OCR实现界面识别和文字提取,不Hook、...
阅读原文

Midjourney V8.2

Midjourney V8.2是Midjourney推出的最新AI图像生成模型版本,在提示词理解、风格参考逻辑和出图稳定性上实现全面升级。
阅读原文

水杉输入法

水杉输入法是基于 Windows 原生 TSF 框架的免费开源中文输入法,专为 Win10/Win11 设计。与多数基于 RIME 的方案不同,工具完全自研,原生兼容 UWP 及高 DPI ...
阅读原文
123358