Muse Spark 1.3

Muse Spark 1.3 是 Meta 超级智能实验室发布的新一代大语言模型,主打编程与智能体任务:100 万 Token 上下文、工具调用减少 20%、Token 消耗优化 25%,API ...
阅读原文

Cheso

Cheso 是腾讯推出的 AI 原生演示文稿 Agent,支持自然语言一句话生成 PPT:自动联网检索、交叉验证来源、规划结构、输出设计精美且信息准确的演示文稿。
阅读原文

Gemini 3.8

Gemini 3.8 是 Google 推出的推理与编码模型,含 Flash 与 Flash Cyber 两个版本;3.8 Flash 在保持速度与低价的同时提升软件工程、Agent、多步推理能力。
阅读原文

Easel

Easel是浙江大学与北京大学联合开源的AI社交媒体内容工作台,基于OpenClaw Agent框架,用智能体打通热点发现、选题策划、内容创作、多平台发布与数据复盘全链...
阅读原文

LibTV

LibTV深度动作捕捉实测:上传普通参考视频即可提取灰度深度参考,无标记完成全身姿态估计、多视角动作还原与跨平台动作复刻,换角色、换场景动作不串味、遮挡...
阅读原文

Fusion Model

Fusion Model 是 FUMO Lab 推出的智能分配模型,根据不断演化的任务状态,动态将计算需求分配给最适合的异构模型,实现一次融合、尽揽众长,兼顾预算与性能。...
阅读原文

腾讯混元 Hy4 preview

腾讯混元 Hy4 preview 是腾讯新一代大模型:总参数 770B、激活 49B、上下文超 1M。WorkBuddy 首发接入,能免费体验两周,Hy3 免费至 9 月底。本文第一人称实...
阅读原文

Hy4 preview 轻量版

Hy4 preview 轻量版是腾讯混元推出的开源大模型量化压缩版本:通过Sherry 1.25bit稀疏量化与MIX-STQ1_0逐层混合精度,将约1.5TB的旗舰模型压缩至214GB,支持l...
阅读原文

Claude Fable 5.1

Claude Fable 5.1 是 Anthropic 推出的旗舰大模型,定位公开可用的最强 AI 之一,专为复杂推理、长周期 Agent 任务与知识工作设计,在科学研究、编码、计算机...
阅读原文

Claude Mythos 5.1

Claude Mythos 5.1 是 Anthropic 推出的 Claude 5.1 系列受控旗舰模型,与 Claude Fable 5.1 共享同一基础能力,仅面向通过审核的网络安全机构与生命科学研究...
阅读原文

Muse Voice Transcribe

Muse Voice Transcribe 是 Meta 推出的首个实时音频感知模型,集流式 ASR、说话人分割与端点检测于一体,支持 70 多种语言与原生语码切换,可处理超 1 小时长...
阅读原文

FireRedAudio

FireRedAudio是小红书FireRed团队开源的通用音频语言模型,基于9B参数Qwen3.5自回归LLM,双通道解耦架构统一支持102语种语音识别、音频问答、Zero-shot TTS、...
阅读原文

WeMM-Embedding

WeMM-Embedding是腾讯微信视觉团队开源的多模态Embedding模型家族,提供2B/4B/9B三种规格,基于Qwen3.5骨干,将文本、图像、视频与视觉文档统一编码到共享向...
阅读原文

实测 WorkBuddy × Hy4 preview

实测 WorkBuddy × Hy4 preview:770B 总参数、49B 激活、1M 上下文。VibeCoding 5 分钟交付萝卜赛车小游戏,长周期开发、跨文件数据分析全流程压力测试,给长...
阅读原文

MiniMax H3 Max

MiniMax H3 Max 是 MiniMax 与 fal.ai 联合推出的实时视频生成模型,基于开源 H3 后训练与推理引擎协同优化,5 秒 768p 视频不到 3 秒生成、吞吐达原生 H3 的...
阅读原文