AI工具
MoshiVis
MoshiVis 是 Kyutai 推出的开源多模态语音模型,基于 Moshi 实时对话语音模型开发,增加了视觉输入功能。能实现图像的自然、实时语音交互,将语音和视觉信息...
BlockDance
BlockDance 是复旦大学联合字节跳动智能创作团队推出的用在加速扩散模型的新方法。BlockDance 基于识别重用相邻时间步中结构相似的时空特征(STSS),减少冗...
Reve Image
Reve Image 是 Reve 推出的全新 AI 图像生成模型。专注于提升美学表现、精确的提示遵循能力以及出色的排版设计,能生成高质量的视觉作品。模型在生成图像时展...
Shining Yourself
Shining Yourself是商汤科技提出的高保真饰品虚拟试戴技术。基于扩散模型,能实现高度逼真的饰品试戴效果,为用户带来沉浸式的虚拟体验。与传统虚拟试戴方法...
LongCat
LongCat(龙猫)是美团自主研发的生成式大语言模型,通过人工智能技术提升公司内部工作效率和创新能力。模型具备强大的多模态能力,能处理文本、图像等多种数...