AI工具
Chatterfly
Chatterfly 是腾讯推出的 AI 原生语音助手,支持语音输入与全场景 AI 打字,把口述内容自动润色成邮件、工作回复、会议纪要和营销文案,并支持 VibeCoding 提...
Spark-Audio-1.0-Preview
Spark-Audio-1.0-Preview 是科大讯飞发布的语音基座大模型,采用 0.65B 音频编码器与 30B-A3B MoE 语言模型,基于 1300 万小时音频在国产算力上训练,支持 99...
Union Alpha
Union Alpha 是登陆 OpenRouter、Cline 与 OpenCode 的匿名 stealth 多模态大模型,支持文本与图像输入、原生工具调用,上下文 262144 tokens、最大输出 1310...
ZDTaichu5.0-9B
ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
Gemini 3.8 Live
Gemini 3.8 Live 是谷歌推出的原生实时语音对话模型,含标准版与 Extended Thinking 版,支持音频到音频直达、97 种语言热切换、后台异步工具调用、实时视觉...
Step Audio 3
Step Audio 3 是阶跃星辰推出的语音大模型系列,涵盖 Realtime 实时对话、ASR 语音识别、TTS 语音合成、Gen 音频生成与 Music 音乐创作,Realtime 语音推理准...
HiDream-O1-Video-1.0
HiDream-O1-Video-1.0(简称HD-V1)是智象未来(HiDream.ai)推出的原生全模态视频生成模型,支持文本、图片、视频输入,一键直出5–20秒1080p视频,音画原生...
UnifoLM-WLA-1.0
UnifoLM-WLA-1.0是宇树科技推出的6B具身多模态大模型,基于约2500小时真机数据训练,视觉、语言与动作统一建模,单模型统筹54项桌面操作与10项全身移动任务,...