InstructAV2AV

InstructAV2AV 是北京智源人工智能研究院与北京大学联合推出的音视频联合编辑模型。用户只需一句自然语言指令,可在端到端生成过程中同时编辑视频画面与对应...
阅读原文

RabbitVis

RabbitVis 是兔展智能推出的图层级一站式 AI 设计生产工具,基于自研 UniWorld-Design 视觉大模型,将 AI 生成能力与图层编辑能力深度融合。
阅读原文

SeedRealtime

 SeedRealtime是字节跳动Seed团队推出的原生音视频全双工大模型,基于统一架构原生融合音频、视频与文本,实现边看、边听、边说的全模态实时交互。
阅读原文

JoyAI-Video-Edit

JoyAI-Video-Edit是京东开源自研的实时流式视频编辑模型,基于16B参数自回归扩散架构,在720P分辨率下实现30FPS推理速度,支持任意时长稳定流式编辑。
阅读原文

MAGI-2-preview

MAGI-2-preview 是 Sand.ai 开源的全球首个千亿参数 MoE 多模态视频生成模型,总参数 114B、激活仅 6B。模型延续单流架构,将文本、视频、音频统一纳入同一 T...
阅读原文

Shieldstral

Shieldstral 是 Mistral AI 推出的 3B 参数开源多模态内容安全分类模型,基于 Ministral-3B 构建。模型将传统固定类别的内容审核重新定义为二元问答任务,支...
阅读原文

Hy ASR 3.0 preview

Hy ASR 3.0 preview是腾讯混元推出的新一代语音识别模型,基于 Hy3 大语言模型,融合高精度语音识别与深度语义理解。模型支持中文、英语、粤语及10大方言片区...
阅读原文

MemHarness

MemHarness 是上海 AI Lab 联合浙大、复旦、上海交大等高校推出的 LLM Agent 记忆重构框架。现有记忆增强 Agent 常将检索到的历史经验直接注入上下文,若旧经...
阅读原文

Qwen-CUA

Qwen-CUA 是 Qwen 团队与 XLang Lab 联合推出的原生 Computer Use Agent,基于 397B-A17B 混合专家架构,仅通过截图感知界面状态,无需依赖 DOM 树或辅助功能...
阅读原文

E-Bench

E-Bench 是腾讯混元团队联合清华大学 AIR、东南大学推出的多步骤工具使用评测基准,基于王者荣耀、QQ 音乐、腾讯会议三大真实产品为原型,构建全合成虚拟环境...
阅读原文

SenseNova U1.5-Lite-Preview

SenseNova U1.5-Lite-Preview 是商汤科技开源的轻量级原生统一多模态模型预览版,基于 NEO-Unify 架构迭代,仅 8B-MoT 参数即贯通视觉理解、推理、生成与编辑。
阅读原文

GenOffice

GenOffice 是 Genspark 推出的面向 Windows 与 Mac 的本地 AI Office 客户端,定位为AI 时代的 Office。工具开源免费,在保留传统文档编辑能力的同时,将 AI ...
阅读原文

MindMemOS

MindMemOS 是华为诺亚方舟实验室开源的 AI Agent 记忆操作系统,能解决 Agent 用完即忘的痛点。系统将记忆从单个 Agent 中解耦为可跨框架复用的独立资产,采...
阅读原文

Qwen 3.8-Max

Qwen 3.8-Max 是阿里云 Qwen 团队推出的旗舰大模型,总参数量达 2.4 万亿,基于 Qwen 3.5 架构扩展而成。作为 Qwen 家族迄今最强大的模型,是首个即将开源权...
阅读原文

PicsetAI

PicsetAI 是专为电商卖家打造的 AI 视觉设计工具,主打「全品类商品图智能生成」与「爆款风格复刻」。用户只需上传一张产品实拍图,AI 可自动分析产品特征、...
阅读原文