AI工具
VDN-MiniMax-H3
VDN-MiniMax-H3 是 OpenVDN 团队开源的视频生成加速方案,基于 MiniMax-H3 改造,采用混合注意力与 DMD2 蒸馏把去噪步数压缩到 8 步,8 张 B200 约 11 秒生成...
teamai-cli
teamai-cli是腾讯开源的MIT协议CLI工具,用Git仓库统一管理团队AI编程配置skills、rules、MCP与hooks,通过push到MR再到merge与pull的工作流分发到Claude Cod...
PixRestore
PixRestore 是香港理工大学与 OPPO 研究院联合推出的统一图像修复模型,采用像素空间 Diffusion Transformer 与 flow matching,53.7M 参数覆盖八大类图像退...
ffmpeg-skill
ffmpeg-skill 是面向 Claude Code、Cursor、Codex 的开源 Agent Skill,内置 28 个结构化工具覆盖探测、剪切、字幕、调色、响度到批量导出,纯本地零费用,np...
Ling-3.0-flash-VL
Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
XiaoMi MiMo Desktop
XiaoMi MiMo Desktop是小米推出的桌面端通用AI Agent,内置MiMo-X-Pro与MiMo-X-Flash双模型,可直接读取表格、PDF、音视频素材,自动拆解任务并调用工具,交...
ChatGPT Images 2.5
ChatGPT Images 2.5 是 OpenAI 新一代图像生成模型,延迟最高降50%,支持局部精准调优、多轮不漂移与人物高保真,新增 @Sketch 手绘、模板与评论式编辑,API ...
MiniCPM5-2B
MiniCPM5-2B 是面壁智能、OpenBMB 与清华联合开源的 2.5B 端侧语言基座,128K 上下文、34 项基准均分 53.9、6GB 内存可跑,兼容 vLLM/llama.cpp。
DeepSeek V4.1 Flash
DeepSeek V4.1 Flash 是深度求索于 2026 年 9 月 8 日开启内测的轻量原生多模态大模型,采用全新 MoE 架构,社区实测 300–500 tokens/s,API 零迁移接入,9 ...