AI项目和框架

WebCraftBench

WebCraftBench是腾讯混元联合清华北大推出的AI网页生成评测基准:自动插桩后由Playwright智能体探索,用代码覆盖率引导查漏,再从美观度、易用性、需求符合度...
阅读原文

Qwen-Image-2.1

Qwen-Image-2.1 是阿里千问团队开源的图像生成模型,视觉生成部分仅7B参数,将文生图与图像编辑整合于同一模型,原生支持透明图像生成与编辑、最多10张参考图...
阅读原文

Step 5 Preview

Step 5 Preview 深度解析:阶跃星辰新一代旗舰基座模型,稀疏 MoE 架构 600B 总参 / 27B 激活,100 万 Token 上下文,Artificial Analysis 综合 44 分,单任...
阅读原文

Qwen3.8-LiveTranslate

Qwen3.8-LiveTranslate是阿里通义千问推出的实时同声传译大模型,基于Interleave单流融合架构,字均延迟2.3秒,支持60种语言识别与29种语音合成,具备说话人...
阅读原文

HappyOyster 1.0

HappyOyster 1.0是阿里推出的实时生成式开放世界模型系列,已上架阿里云百炼,无需邀测即可通过API调用。含Adventure与Directing两款模型,一句话或一张图生...
阅读原文

MiniMax Code CLI

MiniMax Code CLI 是 MiniMax(稀宇科技)开源的命令行 AI 编程工具,MIT 协议,为 MiniMax Code 客户端核心引擎,FrontierHarness Eval 通过率 76.7%。本文...
阅读原文

GLM-5.3-FlashX

GLM-5.3-FlashX是智谱推出的高速推理模型,最大输出速度200 tokens/s,较GLM-5.3-Flash提速5倍、价格2.5倍,依托10万张国产芯片集群,端到端吞吐达基线3倍,A...
阅读原文

Hypit

Hypit是开源AI视频生成工具,给Agent一条爆款视频即可自动拆解复刻完整工作流。视频写成结构化.svml文件,改一句台词音画字幕自动同步,可换数字人与语言批量...
阅读原文

Jev

Jev 是 TypeSafe AI 推出的 AI 结构化决策模型,不聊天、不写代码、不生成文字,只做高频决策:输入非结构化信息,一次并行计算输出带校准概率的结构化判断,...
阅读原文

Qwen3.8-Omni-Flash

Qwen3.8-Omni-Flash 是阿里千问推出的原生全模态大模型,支持文本、图像、音频、视频输入与 1M 超长上下文,主打从理解到交付的 Agent 能力,可端到端完成视...
阅读原文

Spark-Audio-1.0-Preview

Spark-Audio-1.0-Preview 是科大讯飞发布的语音基座大模型,采用 0.65B 音频编码器与 30B-A3B MoE 语言模型,基于 1300 万小时音频在国产算力上训练,支持 99...
阅读原文

Union Alpha

Union Alpha 是登陆 OpenRouter、Cline 与 OpenCode 的匿名 stealth 多模态大模型,支持文本与图像输入、原生工具调用,上下文 262144 tokens、最大输出 1310...
阅读原文

Open-RAIL

Open-RAIL 是中国移动向全球开源的具身智能通用工程底座,行业内首个连接 VLA/WAM 模型与机器人本体的通用层。三线程异步流水线与两级动作平滑抹平 30-50 倍...
阅读原文

ZDTaichu5.0-9B

ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
阅读原文

Gemini 3.8 Live

Gemini 3.8 Live 是谷歌推出的原生实时语音对话模型,含标准版与 Extended Thinking 版,支持音频到音频直达、97 种语言热切换、后台异步工具调用、实时视觉...
阅读原文
1234…219