AI工具

Chatterfly

Chatterfly 是腾讯推出的 AI 原生语音助手,支持语音输入与全场景 AI 打字,把口述内容自动润色成邮件、工作回复、会议纪要和营销文案,并支持 VibeCoding 提...
阅读原文

Spark-Audio-1.0-Preview

Spark-Audio-1.0-Preview 是科大讯飞发布的语音基座大模型,采用 0.65B 音频编码器与 30B-A3B MoE 语言模型,基于 1300 万小时音频在国产算力上训练,支持 99...
阅读原文

Union Alpha

Union Alpha 是登陆 OpenRouter、Cline 与 OpenCode 的匿名 stealth 多模态大模型,支持文本与图像输入、原生工具调用,上下文 262144 tokens、最大输出 1310...
阅读原文

Octop

Octop 是腾讯开源的自托管 AI 助手,MIT 协议免费使用。单进程提供 Web 控制台、CLI 与九大 IM 通道,以专家为单位的多 Agent 架构可独立配置模型、技能、知...
阅读原文

Open-RAIL

Open-RAIL 是中国移动向全球开源的具身智能通用工程底座,行业内首个连接 VLA/WAM 模型与机器人本体的通用层。三线程异步流水线与两级动作平滑抹平 30-50 倍...
阅读原文

ZDTaichu5.0-9B

ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
阅读原文

Hologres

Hologres 是阿里云推出的一站式 Agentic 多模态检索分析平台,兼容 PostgreSQL 协议,支持 PB 级海量数据的实时写入与更新、OLAP 即席分析、高并发点查以及文...
阅读原文

Gemini 3.8 Live

Gemini 3.8 Live 是谷歌推出的原生实时语音对话模型,含标准版与 Extended Thinking 版,支持音频到音频直达、97 种语言热切换、后台异步工具调用、实时视觉...
阅读原文

Vidu S2

Vidu S2 是生数科技推出的实时视频生成模型,含 S2-Editing 实时编辑与 S2-Avatar 实时互动两大引擎,720P、25-42FPS 输出,支持换装换角色换背景,StreamAV-...
阅读原文

Step Audio 3

Step Audio 3 是阶跃星辰推出的语音大模型系列,涵盖 Realtime 实时对话、ASR 语音识别、TTS 语音合成、Gen 音频生成与 Music 音乐创作,Realtime 语音推理准...
阅读原文

YuE2

YuE2 是香港科技大学与 M-A-P 团队开源的音乐生成模型,YuE 的升级版本。它采用白盒乐谱规划机制,根据歌词与风格先生成可编辑 ABC 乐谱再渲染 48kHz 完整歌...
阅读原文

法界通

法界通是面向中国用户的一站式 AI 法律服务平台,整合法律内容社区、公开咨询、AI 法律助手与零中介费的律师认证撮合,支持 Web 与 iOS 多端互通。本站详解其...
阅读原文

HiDream-O1-Video-1.0

HiDream-O1-Video-1.0(简称HD-V1)是智象未来(HiDream.ai)推出的原生全模态视频生成模型,支持文本、图片、视频输入,一键直出5–20秒1080p视频,音画原生...
阅读原文

UnifoLM-WLA-1.0

UnifoLM-WLA-1.0是宇树科技推出的6B具身多模态大模型,基于约2500小时真机数据训练,视觉、语言与动作统一建模,单模型统筹54项桌面操作与10项全身移动任务,...
阅读原文

书生-S2

书生-S2(Intern-S2)是上海人工智能实验室开源的397B多模态基础大模型,主打AI for Science,Memory Decoder架构支持可插拔专业记忆,无需重训主模型即可扩...
阅读原文
123372