Step Audio 3
Step Audio 3 是阶跃星辰推出的语音大模型系列,涵盖 Realtime 实时对话、ASR 语音识别、TTS 语音合成、Gen 音频生成与 Music 音乐创作,Realtime 语音推理准...
HiDream-O1-Video-1.0
HiDream-O1-Video-1.0(简称HD-V1)是智象未来(HiDream.ai)推出的原生全模态视频生成模型,支持文本、图片、视频输入,一键直出5–20秒1080p视频,音画原生...
UnifoLM-WLA-1.0
UnifoLM-WLA-1.0是宇树科技推出的6B具身多模态大模型,基于约2500小时真机数据训练,视觉、语言与动作统一建模,单模型统筹54项桌面操作与10项全身移动任务,...
Xiaomi-CocktailASR-1
Xiaomi-CocktailASR-1 是小米开源的目标说话人语音识别大模型,以参考语音为声纹提示,无需语音分离即可从多人混合语音中转录指定说话人,支持空文本拒识与 C...
LingBot-World 2.0
LingBot-World 2.0 是蚂蚁灵波科技开源的实时交互世界模型,可像游戏一样实时操控,支持攻击施法跳跃与雨雪事件,小时级生成不漂移,高配达 720P/60FPS,1.3B...
Kimi K2.8 Preview
Kimi K2.8 Preview 是月之暗面推出的新一代主力编程模型,已在 Kimi Code 与 Kimi Work 全量上线,编码与 Agent 能力较 K2.7 提升,支持 low/high/max 三档思...
GPT-6 Astra vs Claude Fable 5.1 vs Gemini 3.8 Flash
我用 GPT-6 Astra、Claude Fable 5.1 与 Gemini 3.8 Flash 跑了 Blender 微缩书店、雨滴小游戏、书店改造 SVG、咖啡店客流图解、旧书夜市海报、月相科普图、...
AI 种草带货视频制作教程
AI 种草带货视频制作教程:第一人称实测电商 AI Agent WaClaw,覆盖专属模特形象定制、高质感买家秀种草图、爆款风格换装视频复刻、店铺风格 Skill 沉淀与商...
ABot-Earth 0.7
ABot-Earth 0.7 是高德推出的全球首个 3D 原生城市世界模型:输入卫星图或文字,10 分钟在消费级 GPU 生成公里级 3D 城市,端到端输出 3DGS,覆盖 196+ 国家...