Nemotron 3 Embed

Nemotron 3 Embed 是 NVIDIA 开源的文本嵌入模型系列,专为检索增强生成与智能体检索设计。模型包含 8B 和 1B 两种参数规模,支持 32k 上下文窗口与 34 种语...
阅读原文

StaffDeck

StaffDeck 是面壁智能联合东北大学-面壁智能数据智能联合实验室、清华大学 THUNLP 实验室、OpenBMB 与 AI9Stars 开源的数字员工全流程构建与管理平台。
阅读原文

Wan-Streamer v0.2

Wan-Streamer v0.2 是阿里通义实验室推出的面向实时双工交互的端到端全模态理解与生成模型。模型将"听、看、说、演"统一进单个 Transformer,原生...
阅读原文

腾讯混元 Hy3 实测

最近腾讯的混元 Hy3出了,WorkBuddy 直接能免费用到,大家抢着用都干排队了。 Hy3 是 4 月底发布的 Hy3 preview 升级版。
阅读原文

LibTV Skill Hub 实测

过去一年,Video Agent 几乎成为了 AI 视频行业最热门的方向。 很过 Agent 都能一句话生成视频片段,但当我们真正开始创作完整的视频作品时,还是绕不开生成...
阅读原文

备果

备果是360旗下面向K12中小学教师的AI备课平台,集成AI课件、AI组卷、AI教案、AI教学动画等工具,同时提供超500万精品文档资源库,覆盖全学段全学科多版本教材...
阅读原文

Inkling

Inkling 是 Thinking Machines Lab 推出的开放权重多模态基础模型。模型原生支持文本、图像与音频输入,采用混合专家架构,在 410 亿激活参数下实现跨模态推...
阅读原文

MiniMax Code

MiniMax Code 是 MiniMax 推出的桌面端 AI Agent 编程工具,基于 agent-archon 架构构建,支持 Windows 与 macOS。工具具备 Leader/Worker/Verifier 三角色协...
阅读原文

Codex Micro

Codex Micro 是 OpenAI 与 Work Louder 联合推出的首款实体硬件,是专为 Codex AI 智能体打造的迷你桌面控制中心。Codex Micro 将 AI Agent 的实时状态、任务...
阅读原文

深度实测百度搭子

其实想要 GPT Work + Codex 那套能力,国内已经有成熟平替了。 在我看来,目前体验最棒,甚至可以说是国产第一平替的,还得是百度搭子。不用配环境,不受地区...
阅读原文

OvisOCR2

OvisOCR2 是阿里 ATH-MaaS 团队推出的端到端文档解析模型,基于 Qwen3.5-0.8B 训练并完全开源。模型在 OmniDocBench v1.6 评测中以 96.58 分登顶榜首,具备对...
阅读原文

X2.0

X2.0 是 Xmax AI 推出的全球首个实时交互视频生成模型,支持毫秒级流式生成。用户通过摄像头可实时替换角色服装、召唤虚拟物体、触屏操控画面,实现可玩的视...
阅读原文

ABot-World Studio

ABot-World Studio 是高德推出的通用世界模型工坊,将交互式视频生成与 3DGS 场景生成统一于同一产品。用户输入文字或图片可生成可实时交互的 AI 世界,支持...
阅读原文

MOSS-VL-Realtime

MOSS-VL-Realtime 是 OpenMOSS 开源的 11B 参数流式视觉语言模型,专为实时视频理解设计。模型支持边看边答、即时修正与主动沉默,将视频理解从看录像升级为...
阅读原文

ViiTorVoice-NAR实测

今天发点适合做音色复刻的东西。 说实话,现在做 AI 语音最烦的地方,是生成的音频里只想改几个词,却不得不重新录、重新配、重新剪。
阅读原文