AI工具

LayerBack

LayerBack 是基于 AI 的图表图片转换工具,用户只需上传流程图截图、系统架构图或白板照片,LayerBack 能像人一样"读懂"图中的图形、连接线和文字...
阅读原文

WorldClaw

WorldClaw是腾讯混元团队推出的Agent驱动开放世界3D生成框架。用户输入一句自然语言描述,系统可自动规划地形、区域、建筑、物体与空间关系,采用全局到局部...
阅读原文

SmartSub

SmartSub(妙幕) 是开源的一站式音视频字幕处理桌面工具。工具将全流程整合为单一应用,基于 Whisper、FunASR、Qwen3-ASR 等本地模型离线语音转文字,支持 2...
阅读原文

Kitesurf

Kitesurf 是 Cloudflare 专为 AI Agent 推出的云端轻量浏览器,运行在 Workers V8 隔离环境中。浏览器用 Rust 构建,砍掉标签页、扩展等人类冗余功能,保留 D...
阅读原文

ForgeStencil

ForgeStencil 是面壁智能联合 OpenBMB 开源社区推出的全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统,基于 Kernel Agent 与 App Agent 双智能体闭...
阅读原文

Wan-Animate-2

Wan-Animate-2是万相团队开源的新一代角色动画模型,作为 Wan-Animate 的重大架构升级,放弃了对显式姿态骨架和辅助姿态提取网络的依赖,改为端到端的双分支 ...
阅读原文

Grok Imagine Image 2.0

Grok Imagine Image 2.0 是 SpaceXAI 发布的全新一代图像生成与编辑模型,以「Quality Mode」形式上线 grok 网页端及 iOS、Android 应用。不只做「重抽一张」...
阅读原文

Alpamayo 2 Super

Alpamayo 2 Super 是英伟达开源的自动驾驶 AI 推理模型。模型基于 NVIDIA Cosmos 3 Super Reasoner 构建,具备 360° 环境感知、高级驾驶决策与自动推理标签生...
阅读原文

CosyVoice Studio

CosyVoice Studio是阿里巴巴推出的国内首个一站式AI语音生产力平台,基于自研Qwen-Audio模型打造。平台含三大模块,CosyFlow实现语音转写叠加语义理解,自动...
阅读原文

Warp Agent CLI

Warp Agent CLI 是 Warp 推出的独立命令行编码工具,可在 Ghostty、iTerm 2、VS Code 及系统自带终端等任意环境中运行。工具基于 Warp 终端基础设施构建,内...
阅读原文

Ling-3.0-tiny

Ling-3.0-tiny是蚂蚁百灵推出的原生混合推理模型,总参数 7.9B、每 token 仅激活 1.3B,面向数学推理、指令遵循及资源敏感型部署优化。
阅读原文

SALMONN-2

SALMONN-2 是清华大学、上海人工智能实验室与剑桥大学联合开源的通用音频大语言模型,基于字节跳动 SPEAR 统一自监督音频编码器与多层特征融合适配器构建,以...
阅读原文

Wan3.0

Wan3.0 是阿里云万相团队最新推出的视频生成大模型。模型在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30秒 视频,首次支持 doc、xls...
阅读原文

Hunyuan3D-Buffalo 1.0

Hunyuan3D-Buffalo 1.0 是腾讯混元推出的统一3D多模态框架,通过共享的 Hunyuan3D-VLM 主干将3D问答、空间定位、文生3D、指令编辑和部件生成集成到单一流程中。
阅读原文

Omega

Omega 是腾讯推出的 AI 原生数据分析平台,内测版名为「马尔摩斯(marmos)」。工具通过 Agent 驱动完整分析链路,让用户用自然语言可生成可交互、可迭代、可...
阅读原文
123361