AI项目和框架
WebCraftBench
WebCraftBench是腾讯混元联合清华北大推出的AI网页生成评测基准:自动插桩后由Playwright智能体探索,用代码覆盖率引导查漏,再从美观度、易用性、需求符合度...
Qwen-Image-2.1
Qwen-Image-2.1 是阿里千问团队开源的图像生成模型,视觉生成部分仅7B参数,将文生图与图像编辑整合于同一模型,原生支持透明图像生成与编辑、最多10张参考图...
Step 5 Preview
Step 5 Preview 深度解析:阶跃星辰新一代旗舰基座模型,稀疏 MoE 架构 600B 总参 / 27B 激活,100 万 Token 上下文,Artificial Analysis 综合 44 分,单任...
Qwen3.8-LiveTranslate
Qwen3.8-LiveTranslate是阿里通义千问推出的实时同声传译大模型,基于Interleave单流融合架构,字均延迟2.3秒,支持60种语言识别与29种语音合成,具备说话人...
HappyOyster 1.0
HappyOyster 1.0是阿里推出的实时生成式开放世界模型系列,已上架阿里云百炼,无需邀测即可通过API调用。含Adventure与Directing两款模型,一句话或一张图生...
MiniMax Code CLI
MiniMax Code CLI 是 MiniMax(稀宇科技)开源的命令行 AI 编程工具,MIT 协议,为 MiniMax Code 客户端核心引擎,FrontierHarness Eval 通过率 76.7%。本文...
GLM-5.3-FlashX
GLM-5.3-FlashX是智谱推出的高速推理模型,最大输出速度200 tokens/s,较GLM-5.3-Flash提速5倍、价格2.5倍,依托10万张国产芯片集群,端到端吞吐达基线3倍,A...
Qwen3.8-Omni-Flash
Qwen3.8-Omni-Flash 是阿里千问推出的原生全模态大模型,支持文本、图像、音频、视频输入与 1M 超长上下文,主打从理解到交付的 Agent 能力,可端到端完成视...
Spark-Audio-1.0-Preview
Spark-Audio-1.0-Preview 是科大讯飞发布的语音基座大模型,采用 0.65B 音频编码器与 30B-A3B MoE 语言模型,基于 1300 万小时音频在国产算力上训练,支持 99...
Union Alpha
Union Alpha 是登陆 OpenRouter、Cline 与 OpenCode 的匿名 stealth 多模态大模型,支持文本与图像输入、原生工具调用,上下文 262144 tokens、最大输出 1310...
ZDTaichu5.0-9B
ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
Gemini 3.8 Live
Gemini 3.8 Live 是谷歌推出的原生实时语音对话模型,含标准版与 Extended Thinking 版,支持音频到音频直达、97 种语言热切换、后台异步工具调用、实时视觉...