标签:语音识别

醒蓝AI

醒蓝AI是一款AI照片生成工具,支持一键生成AI形象照,用户能够轻松制作工作形象照、写真照、证件照和AI换脸照片。醒蓝AI还提供API接口和定制化解决方案,满足...
阅读原文

有道小P

有道小P是网易有道推出的AI全科学习助手,专为K12阶段的学生设计。有道小P搭载了有道子曰教育大模型,能覆盖全学段和全学科的答疑需求,提供个性化的学习辅导...
阅读原文

Mo卡片

Mo卡片是一站式AI知识库卡片式学习工具。Mo卡片以卡片形式提供1500+张专业AI知识卡片,涵盖理论、实操、特别篇等主题。用户通过图文、动画、视频、语音等互动...
阅读原文

微博嘴替

微博嘴替是一个微博账户AI趣味分析应用,专为微博用户设计。微博嘴替通过分析用户的微博资料和内容,生成犀利、幽默风趣和个性化的吐槽。
阅读原文

Subtitle Edit

Subtitle Edit是一款免费开源的多功能字幕编辑器,支持超过300种字幕格式,包括SRT、MicroDVD和Sub Station Alpha等。具备字幕同步、创建、翻译、音频波形可...
阅读原文

HumanVid

HumanVid是香港中文大学和上海人工智能实验室共同推出的高质量数据集,专为人类图像动画训练设计。结合了现实世界视频和合成数据,通过精心设计的规则筛选高...
阅读原文

Seed-ASR

Seed-ASR是字节跳动开发的一款基于大型语言模型(LLM)的语音识别(ASR)模型。在超过2000万小时的语音数据和近90万小时的配对ASR数据上训练,支持普通话和13...
阅读原文

MUMU

MUMU是一种多模态图像生成模型,通过结合文本提示和参考图像来生成目标图像,从而提高生成的准确率和质量。MUMU模型的架构基于SDXL的预训练卷积UNet,采用了...
阅读原文

LeRobot

LeRobot是由HuggingFace推出的开源AI聊天机器人项目,由前特斯拉研究员Remi Cadene领导开发。LeRobot致力于降低机器人技术的入门门槛,提供预训练模型、数据...
阅读原文

STranslate

STranslate是专为Windows用户设计的多功能翻译和OCR工具。支持多种语言翻译,具备划词、截图、监听剪贴板等多种翻译方式,并提供多家翻译服务接口。还拥有基...
阅读原文

Dola

Dola是一款人工智能日历助理,通过自然语言处理技术,使用户能通过文本、语音或图片等多种方式与主流即时通讯软件(如Apple Messages、Telegram、LINE、Whats...
阅读原文

Mini-Omni

Mini-Omni 是一个开源的端到端语音对话模型,具备实时语音输入和输出的能力,能在对话中实现“边思考边说话”的功能。模型的设计支持在不需要额外的自动语音识...
阅读原文

Slax Note

SlaxNote 是一款基于语音识别技术的 AI 语音笔记应用,可以实时将语音转换为文本,并自动润色这些文本,使表达更加流畅和专业。特别适合户外灵感捕捉、想法组...
阅读原文

VoxInstruct

VoxInstruct 是由清华大学开源的语音合成技术,能根据人类语言指令生成高度符合用户需求的语音。系统采用统一的多语言编解码器语言建模框架,将传统的文本到...
阅读原文

Kuakua

Kuakua 是结合积极心理学和AI技术的平台,提升用户的幸福感和心理健康。通过提供多语言支持、心理学资源、AI辅助工具、正念练习和生活方式建议,帮助用户在日...
阅读原文
1789101113