AI工具

Ling-3.0-flash-VL

Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
阅读原文

Virse

Virse是面向专业设计团队的AI创意工作台,以无限画布整合50+生成模型,LAMM审美记忆系统通过六维审美画像实现个性化检索与多轮改稿的风格稳定,支持Agent协作...
阅读原文

XiaoMi MiMo Desktop

XiaoMi MiMo Desktop是小米推出的桌面端通用AI Agent,内置MiMo-X-Pro与MiMo-X-Flash双模型,可直接读取表格、PDF、音视频素材,自动拆解任务并调用工具,交...
阅读原文

H3-World

H3-World是腾讯联合新加坡国立大学、香港理工大学推出的动作可控世界模型,基于33B MiniMax-H3微调,键盘操作转英文指令经时间注意力路由绑定视频帧,8000条...
阅读原文

ChatGPT Images 2.5

ChatGPT Images 2.5 是 OpenAI 新一代图像生成模型,延迟最高降50%,支持局部精准调优、多轮不漂移与人物高保真,新增 @Sketch 手绘、模板与评论式编辑,API ...
阅读原文

MiniCPM5-2B

MiniCPM5-2B 是面壁智能、OpenBMB 与清华联合开源的 2.5B 端侧语言基座,128K 上下文、34 项基准均分 53.9、6GB 内存可跑,兼容 vLLM/llama.cpp。
阅读原文

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash 是深度求索于 2026 年 9 月 8 日开启内测的轻量原生多模态大模型,采用全新 MoE 架构,社区实测 300–500 tokens/s,API 零迁移接入,9 ...
阅读原文

WikiSkill

WikiSkill 是 Google Research 联合 Virginia Tech 提出的 AI Agent 技能进化框架,用三层工作空间把执行轨迹沉淀为持久化知识,再用四组件闭环让技能持续演...
阅读原文

问卷派

问卷派(WeJot)是一款 AI 调研智能体,用自然语言生成问卷、配置逻辑、匹配样本、跑深度统计并导出 Word/Excel/PDF 报告,支持 MaxDiff、Kano、NPS 等高阶模...
阅读原文

YoLive

YoLive 是 Yoroll 推出的实时 AI 互动剧情直播平台,基于 H3 Superfast 模型在 8 张 B200 上 4 秒生成 10 秒 768p 视频,观众弹幕投票决定下一幕剧情走向。
阅读原文

LLaDA-Image

LLaDA-Image 是蚂蚁 inclusionAI 开源的 6B 统一图像生成与编辑模型,LLaDA2.0-mini + 6B DiT 全扩散,Qwen-Image-Bench 中英双榜开源第一,Turbo 2-4 步出图。
阅读原文

MAI-Image-2.6-Flash

MAI-Image-2.6-Flash 是微软推出的高速图像生成模型,生成速度达 GPT-Image-2-Medium 的 2.8 倍、GPU 效率提升 72%,支持多参考图、Web Grounding 与 1.5K 分...
阅读原文

Claude Commerce Agents

Claude Commerce Agents 是 Anthropic 开源的电商 Agent 蓝图,含购物与商家两类 Agent,覆盖零售、旅游、电信、票务四行业,Apache 2.0 协议,内置双层安全...
阅读原文

PatentClaw

PatentClaw 是把 LaTeX 科研论文自动整理成中国发明专利技术交底书的开源工具。多智能体协作完成论文解析、发明点挖掘与初稿撰写,公式表格算法证据可溯源,...
阅读原文

智慧月隐

智慧月隐是秘塔科技推出的AI心理健康小程序,通过结构化卡牌问答互动引导用户深度自我觉察与情绪梳理。用户描述困扰后,AI会针对性追问并引导抽牌,结合专业...
阅读原文
123370