AI工具

SkyReels-A2

SkyReels-A2是昆仑万维推出的可控视频生成框架,支持根据文本提示将任意视觉元素(如人物、物体、背景)组合成合成视频,严格保持与每个元素的参考图像的一致...

Copilot Search

Copilot Search 是微软 Bing 推出的智能搜索模式,融合传统搜索和生成式 AI 的优势。基于智能信息整合,根据用户的查询提供简洁的总结、清晰的答案或智能布局...
阅读原文

ACTalker

ACTalker 是用于生成逼真说话人头部视频的端到端视频扩散框架。支持单信号或多信号控制,如音频、表情等。核心架构包括并行 Mamba 结构,通过多个分支利用不...
阅读原文

Seedream 3.0

Seedream 3.0是字节跳动豆包大模型团队推出的AI绘图模型,在中文文字生成和设计感方面表现出色,解决小字生成的稳定性问题,能精准生成复杂的中文内容,提供...
阅读原文

Quasar Alpha

Quasar Alpha 是 OpenRouter 发布的预发布版 AI 模型。拥有 100 万 token 的超大上下文窗口,可处理超长文本和复杂文档。代码生成能力出色,生成速度快,延迟...
阅读原文

OmniCam

OmniCam 是先进的多模态视频生成框架,通过摄像机控制实现高质量的视频生成。支持多种输入模态组合,用户可以提供文本描述、视频中的轨迹或图像作为参考,精...
阅读原文

Llama 4

Llama 4 是 Meta 推出的多模态人工智能模型。首次采用混合专家(MoE)架构,在训练和推理时计算效率更高。Llama 4 目前有 Scout 和 Maverick 两个版本。Scout...
阅读原文

EZApply

EZApply 是全球首个大数据AI双引擎留学平台,破解全球留学信息差。通过实时抓取全球院校数据,结合学生背景信息(如 GPA、语言成绩、科研经历等),为学生提...
阅读原文

OmniTalker

OmniTalker 是阿里巴巴发布的实时文本驱动的说话头像生成技术,能同时处理文本、图像、音频和视频等多种模态输入,以流式方式生成自然语音响应。核心架构为 T...

像素猫AI

像素猫AI(Pixcel Cat)是国内首款支持生成吉卜力风格AI绘画的小程序。操作便捷,用户只需点击想要的风格,选择照片,可一键生成图像,无需复杂的指令调教。...
阅读原文

DeepSeek-GRM

DeepSeek-GRM是DeepSeek和清华大学研究者共同提出的通用奖励模型(Generalist Reward Modeling)。通过点式生成式奖励建模(Pointwise Generative Reward Mod...
阅读原文

OlympicArena

OlympicArena是上海交通大学、上海AI Lab、苏州大学和上海交通大学生成式人工智能实验室(GAIR Lab)联合推出的多学科认知推理基准测试框架。OlympicArena包...
阅读原文

BabelDOC

BabelDOC 是开源的智能 PDF 翻译工具,专为科学论文翻译设计。能在原文旁生成翻译文本,形成双语对照,无需切换窗口,方便阅读。能完整保留数学公式、表格和...

Midjourney V7

Midjourney V7 是 Midjourney 推出的最新版 AI 图像生成模型,在图像生成质量、交互模式和创作效率等方面进行了多项重大改进。草稿模式(Draft Mode)能将图...
阅读原文

remio

remio 是 AI 驱动的个人知识中心,专为多任务专业人士、创作者和学生设计,高效管理海量信息。能自动捕捉网页内容,一键高亮并保存,支持本地文件集成,将各...
阅读原文
13435363738230