AI工具

img2threejs

img2threejs 是开源的 AI skill,能将单张参考图片自动转换为可交互的 Three.js 3D 模型。用户只需提供一张图片,AI 会分析物体的轮廓、比例、材质与细节,生...
阅读原文

SciReasoner

SciReasoner 是上海人工智能实验室联合港中文、中科院药物所、斯坦福、牛津等团队推出的新一代科学推理多模态基础模型。模型首次提出原生结构推理范式,将蛋...
阅读原文

Mage-Flow

Mage-Flow 是微软开源的轻量级多模态图像生成模型系列,基于流匹配架构,仅 4B 参数。模型包含 Base 基础版、RL 强化学习版、Turbo 加速版和 Edit 图像编辑版...
阅读原文

OpenAI Presence

OpenAI Presence 是 OpenAI 推出的企业级 AI Agent 部署与管理平台,帮助企业将智能体从实验阶段推进到生产环境。
阅读原文

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite 是 Google 推出的最快、最便宜的 Gemini 3.5 系列模型,专为高吞吐、低延迟的生产级 Agent 工作流设计。
阅读原文

Gemini 3.5 Flash Cyber

Gemini 3.5 Flash Cyber 是 Google 基于 Gemini  3.5 Flash 微调的网络安全专用模型,与 CodeMender 代码安全智能体配对使用,专精漏洞发现与修复。
阅读原文

咔皮健康

咔皮健康是商汤科技推出的AI健康助手应用,需搭配iPhone与Apple Watch使用(iOS 17及以上)。通过Apple Watch自动采集心率、睡眠、步数、活动与身体恢复信号...
阅读原文

Macaron-V1

Macaron V1 是 MindLab 推出的后训练多能力模型系统,基于 GLM 5.2 基座,通过强化学习对约 0.5% 核心参数进行 LoRA 微调。系统独创 Mixture-of-LoRA(MoL)...
阅读原文

UnifoLM-OminiA-0.3

UnifoLM-OminiA-0.3是宇树科技推出的全模态交互理解模型,专为G1人形机器人设计。单模型可统筹家居康养多任务,支持视觉识别、语音交互、精细操作与设备控制...
阅读原文

Gemini 3.6 Flash

Gemini 3.6 Flash 是 Google DeepMind 最新推出的主力干活模型,定位大规模 AI Agent 场景,包含三款 Gemini 新模型,Gemini 3.6 Flash、3.5 Flash-Lite 及 3...
阅读原文

MOGE AI 图像提示词

MOGE 是专注 AI 图像提示词的精选画廊,覆盖 GPT Image、Nano Banana、Seedream 等热门模型。所有 Prompt 均由人工精选,每日持续更新,提供全球 10 种语言版...
阅读原文

Qwen-Image-3.0

Qwen-Image-3.0是阿里通义千问团队推出第三代图像生成基础模型。模型支持 4.5k token 超长输入,可一次性渲染复杂九宫格知识图鉴;支持 10px 小字 精准排版,...
阅读原文

Audio-Visual Flamingo

Audio-Visual Flamingo(简称 AV-Flamingo)是 NVIDIA 与马里兰大学联合推出的开源音频-视觉大语言模型,专为长视频与复杂真实世界音视频内容的联合理解与推...
阅读原文

问小白 5 Pro

问小白 5 Pro 是元石科技推出的新一代长内容生成引擎,基于自研元石大模型与 DeepSeek-R1 671B 满血版构建,主打长、稳、可查三大能力。
阅读原文

Matrix -Game3.5

Matrix-Game 3.5 是昆仑万维黎曼动力团队开源的实时流式交互世界模型,基于 Patch Memory 与 Warped PRoPE 实现三维空间级长期记忆与几何一致性建模。
阅读原文
123356