AI工具
Hy ASR 3.0 preview
Hy ASR 3.0 preview是腾讯混元推出的新一代语音识别模型,基于 Hy3 大语言模型,融合高精度语音识别与深度语义理解。模型支持中文、英语、粤语及10大方言片区...
MemHarness
MemHarness 是上海 AI Lab 联合浙大、复旦、上海交大等高校推出的 LLM Agent 记忆重构框架。现有记忆增强 Agent 常将检索到的历史经验直接注入上下文,若旧经...
SenseNova U1.5-Lite-Preview
SenseNova U1.5-Lite-Preview 是商汤科技开源的轻量级原生统一多模态模型预览版,基于 NEO-Unify 架构迭代,仅 8B-MoT 参数即贯通视觉理解、推理、生成与编辑。
Qwen 3.8-Max
Qwen 3.8-Max 是阿里云 Qwen 团队推出的旗舰大模型,总参数量达 2.4 万亿,基于 Qwen 3.5 架构扩展而成。作为 Qwen 家族迄今最强大的模型,是首个即将开源权...
Qwen-Audio-3.0-ASR-Flash
Qwen-Audio-3.0-ASR-Flash 是阿里千问团队推出的语音识别大模型,现已通过阿里云百炼平台开放调用,提供 Flash、Filetrans、Streaming 三个版本。
Grok Voice Think Fast 2.0
Grok Voice Think Fast 2.0 是 SpaceXAI(xAI)推出的端到端语音到语音模型,采用原生语音到语音架构,无需经过识别—推理—合成多阶段流程即可直接理解并回应...