标签:AI图像生成

WPS接入DeepSeek,秒变办公神器!

WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
阅读原文

AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!

这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...

Grok Imagine Image 2.0

Grok Imagine Image 2.0 是 SpaceXAI 发布的全新一代图像生成与编辑模型,以「Quality Mode」形式上线 grok 网页端及 iOS、Android 应用。不只做「重抽一张」...
阅读原文

SeFi-Image

SeFi-Image 是基于语义优先扩散的文本到图像模型,提供 1B、2B、5B 三种规格。模型将高层语义结构与纹理细节分离,让语义流提前去噪,为纹理生成提供清晰的结...
阅读原文

Nemotron-Labs-Diffusion

Nemotron-Labs-Diffusion 是 NVIDIA 推出的三模式语言模型,在单一架构内统一自回归、扩散和自我推测解码。通过联合 AR-扩散目标训练,模型可在不同并发场景...
阅读原文

Krea 2

Krea 2 是 Krea AI 推出的首个从零训练的基础图像生成模型,定位为"美学优先"的创意协作者。专注于视觉美学一致性、风格迁移和创意控制,而非单纯...
阅读原文

Boogu-Image-0.1

Boogu-Image-0.1 是 Boogu 团队开源的统一图像生成与编辑模型家族。模型在同一架构下同时支持文生图、指令式图像编辑及中英双语文本渲染,家族包含 Base、Edi...
阅读原文

MAI-Image-2.5

MAI-Image-2.5 是微软研究院推出的旗舰级文生图模型,为 MAI-Image 系列最强版本。模型在 Arena 文生图排行榜以 1,254 分冲上第 3 名,较前代提升 72 分,打...
阅读原文

Fara1.5

Fara1.5是微软研究院 AI Frontiers 实验室最新推出的浏览器端AI智能体(CUA)模型系列,包含 4B、9B、27B 三个参数版本。模型基于 Qwen3.5 微调,采用纯像素...
阅读原文

HyperFrames

HyperFrames是HeyGen开源的AI原生视频渲染框架,采用"Write HTML, Render video"理念,专为AI Agent和开发者设计。框架将视频定义为HTML文件,通过...
阅读原文

GPT-image-2

GPT-image-2 是OpenAI推出的下一代原生图像生成模型,据传内部代号为「Spud」,目前已在ChatGPT进行灰度测试。模型于2026年4月初以"maskingtape-alpha&q...
阅读原文

ERNIE-Image

ERNIE-Image是百度文心团队开源的8B参数文生图模型,基于Diffusion Transformer架构,主打高可控性与精准长文本渲染。
阅读原文

QinyanClaw

QinyanClaw是沁言学术推出的全球首个为学术科研场景深度优化的云端智能体。基于OpenClaw架构,智能体具备长期记忆和自主执行能力,可7×24小时在云端独立运行...
阅读原文

PixVerse V6

PixVerse V6 是爱诗科技推出的最新 AI 视频生成模型。模型在镜头控制、角色表现和多镜头音视频生成方面实现突破,运镜更精准,角色情绪跨帧连贯,物理交互更...
阅读原文

GigaWorld-1

GigaWorld-1 是极佳视界推出的具身世界模型,在 WorldArena 评测中登顶全球第一。模型采用 AC-WM(动作控制世界模型)架构,结合显式动作建模与可微分物理引...
阅读原文

FeelFish 3.0 发布

当 AI 还在以「单智能体问答」的方式帮你改一句台词时,FeelFish 已经在思考一个更宏大的问题:如果每一个创作环节都有一位专属的 AI 专家坐镇,写作会变成什...
阅读原文

Grok Imagine 1.0

Grok Imagine 1.0 是 xAI 最新推出的 AI 视频生成工具,支持生成 10 秒长、720p 分辨率 的视频,配备显著优化的音频效果。
阅读原文
123