AI工具
Qwen3.8-Omni-Flash
Qwen3.8-Omni-Flash 是阿里千问推出的原生全模态大模型,支持文本、图像、音频、视频输入与 1M 超长上下文,主打从理解到交付的 Agent 能力,可端到端完成视...
Chatterfly
Chatterfly 是腾讯推出的 AI 原生语音助手,支持语音输入与全场景 AI 打字,把口述内容自动润色成邮件、工作回复、会议纪要和营销文案,并支持 VibeCoding 提...
Spark-Audio-1.0-Preview
Spark-Audio-1.0-Preview 是科大讯飞发布的语音基座大模型,采用 0.65B 音频编码器与 30B-A3B MoE 语言模型,基于 1300 万小时音频在国产算力上训练,支持 99...
Union Alpha
Union Alpha 是登陆 OpenRouter、Cline 与 OpenCode 的匿名 stealth 多模态大模型,支持文本与图像输入、原生工具调用,上下文 262144 tokens、最大输出 1310...
ZDTaichu5.0-9B
ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
Gemini 3.8 Live
Gemini 3.8 Live 是谷歌推出的原生实时语音对话模型,含标准版与 Extended Thinking 版,支持音频到音频直达、97 种语言热切换、后台异步工具调用、实时视觉...
Step Audio 3
Step Audio 3 是阶跃星辰推出的语音大模型系列,涵盖 Realtime 实时对话、ASR 语音识别、TTS 语音合成、Gen 音频生成与 Music 音乐创作,Realtime 语音推理准...