AIGC热点 - 第 3 页

最新文章 AI工具 AIGC动态使用教程

BrowserAct Skills

BrowserAct Skills 是面向 AI Agent 的浏览器自动化 CLI 工具，能解决 Agent 操控浏览器时的核心痛点,无 Cookie 环境、反爬拦截、验证码阻断、人机协作断层等。

阅读原文

AI工具

6天前

AhaCreator

AhaCreator（原名 Aha）是 AI 原生的海外达人营销平台，致力于用 AI Agent 接管达人营销的全流程执行，让品牌方只需在关键节点做决策。平台覆盖 140+ 国家，...

阅读原文

AI工具

6天前

GreenConvert

GreenConvert 是 AI 音视频转录平台，通过神经引擎将音视频转为文字，支持 98 种以上语言，准确率达 98%。平台内置说话人识别、音频修复与多语言翻译，可处理...

阅读原文

AI工具

6天前

Microsoft Scout

Microsoft Scout 是微软推出的 AI 个人助手，基于 OpenClaw 开源技术构建。工具拥有独立 Entra 身份，可在后台持续自主运行，无需用户逐次触发。

阅读原文

AI工具

6天前

Kimi Work

Kimi Work 是月之暗面推出的面向知识工作者的通用型本地 Agent，随 Kimi 最新测试版 Mac 和 Windows 客户端推出。

阅读原文

AI工具

7天前

JoyAI-Echo

JoyAI-Echo 是京东推出的开源长音视频生成框架，专为分钟级多镜头故事生成设计。框架通过跨模态记忆库、记忆驱动后训练、Director Agent 对话式编辑和轻量化...

阅读原文

AI工具

7天前

Ideogram 4

Ideogram 4 是 Ideogram 推出的首个开源文本到图像生成模型，拥有 93 亿参数，从头训练非基于现有模型微调。模型专为高质量图像生成而设计，尤其在设计、营销...

阅读原文

AI工具

7天前

PaddleOCR-VL-1.6

PaddleOCR-VL-1.6 是百度飞桨团队推出的文档解析视觉语言模型（VLM），是 PaddleOCR-VL 系列的最新升级版本。

阅读原文

AI工具

7天前

Bernini

Bernini 是字节跳动开源的统一视频生成与编辑框架，采用MLLM 语义规划 + DiT 视觉渲染的两阶段解耦架构。多模态大模型理解指令并规划语义草图，由 Diffusion ...

阅读原文

AI工具

7天前

Science Skills

Science Skills 是谷歌 DeepMind 推出的开源科学技能集合，专为加速 AI Agent 驱动的科学研究工作流设计。工具整合 AlphaGenome、AlphaFold Database、UniPro...

阅读原文

AI工具

7天前

MAI-Thinking-1

MAI-Thinking-1 是微软推出的首款自研高级推理模型。模型采用 35B 活跃参数 / 约 1T 总参数的稀疏 MoE 架构，完全基于干净、商业授权数据从头训练，未使用任...

阅读原文

AI工具

7天前

MAI Transcribe-1.5

MAI-Transcribe-1.5 是微软 AI 团队自研的语音转文本模型，支持 43 种语言，具备上下文感知的关键词偏置能力，模型在 FLEURS 基准测试中取得行业最低的词错...

阅读原文

AI工具

7天前

MAI-Voice-2

MAI-Voice-2 是微软推出的新一代文本转语音（TTS）模型，是微软迄今最具表现力和自然感的语音合成模型。相比前代在保真度、语言覆盖、说话人一致性和情感范围...

阅读原文

AI工具

7天前

MAI-Code-1-Flash

MAI-Code-1-Flash 是微软专为开发者工作流推出的轻量级代码生成模型，深度集成 GitHub Copilot。模型采用自适应输出长度控制技术，在保持高准确率的同时最高...

阅读原文

AI工具

7天前

Odysseus

Odysseus 是开源自托管的 AI 工作空间，提供类似 ChatGPT / Claude 的聊天界面，工具完全本地化运行，数据不出本机、隐私零泄露。

阅读原文

AI工具

7天前

1 234 5…1,640