AI项目和框架
XiYan-SQL:阿里推出文本到SQL多生成器集成框架实现智能化数据查询与管理
XiYan-SQL是阿里巴巴推出的自然语言到SQL(NL2SQL)框架,基于多生成器集成策略,结合提示工程和监督微调,提升SQL查询生成质量。XiYan-SQL引入M-Schema半结...
KuaiFormer:智能音响重塑你的听觉体验
KuaiFormer是快手技术团队推出的基于Transformer的检索框架,用在大规模内容推荐系统。基于重新定义检索流程,从传统的分数估计任务转变为Transformer驱动的“...
EyeDiff:基于文本到图像扩散模型的多模态眼科图像生成技术
EyeDiff是文本到图像的扩散模型,基于自然语言提示生成多模态眼科图像,提高常见和罕见眼病的诊断准确性。模型在多个大规模数据集上训练,能准确捕捉关键病变...
MikuDance:动态风格化角色艺术的混合动力动画生成技术
MikuDance是基于扩散模型的动画生成技术,整合混合运动动力学来动画化风格化的角色艺术。MikuDance基于混合运动建模和混合控制扩散技术,解决高动态运动和参...
MATRIX-Gen:多智能体模拟系统引领智能决策新时代
MATRIX-Gen是上海交通大学和牛津大学研究团队推出的多智能体模拟系统,基于模拟1000多个具有独立身份和人格的AI智能体组成的社会,生成多样化且高质量的训练...
BodyTalk:智能视频配音工具实现语音与唇形、面部表情与肢体动作的完美同步
BodyTalk是Panjaya推出的AI视频配音工具,基于生成性AI技术,将视频中的人物声音转换为其他语言,自动调整视频中人物的面部表情和肢体动作,自然地匹配新的语...
Windsurf Editor:智能编程助手提升开发效率与代码质量
Windsurf Editor 是 Codeium 推出的首款“代理式”集成开发环境(IDE),基于深度集成AI技术,提供与人类开发者协作的 AI Copilot 和独立处理复杂任务的 AI Age...
OmniParse:智能数据解析平台助力高效提取与分析非结构化数据
OmniParse是数据解析平台,将非结构化数据转换为结构化、可操作的数据,优化适用于GenAI(大型语言模型)应用。OmniParse支持约20种文件类型,包括文档、表格...
Promptim:智能优化库助力自动迭代配置生成与性能提升
Promptim是实验性的AI提示优化库,基于自动化流程提升AI系统在特定任务上的提示效果。用户提供初始提示、数据集和自定义评估器,Promptim能自动运行优化循环...
TinyTroupe:多智能体角色模拟库助力智能交互与协作创新
TinyTroupe是microsoft推出的实验性Python库,用在模拟具有特定个性、兴趣和目标的人工代理(TinyPersons),在模拟环境(TinyWorld)中进行互动。TinyTroupe...
Thinking Claude:AI思维革新工具让机器更懂人类思维方式
Thinking Claude是基于深度思考协议和浏览器扩展工具,增强AI模型Claude-3.5的“深度思维”能力的项目,让其思考逻辑更接近人类。支持AI以自然、未经过滤的方式...
OmniVision:高效轻量化的边缘多模态模型实现智能化应用
OmniVision是紧凑的多模态模型,拥有968M参数,专为边缘设备优化。OmniVision能处理视觉和文本输入,基于LLaVA架构改进,显著减少图像token数量,降低延迟和...
Free Video-LLM:高效视频语言模型实现无需训练的智能内容生成
Free Video-LLM是创新的无需训练的高效视频语言模型,基于提示引导的视觉感知技术,实现对视频内容的高效理解。模型用预训练的图像LLMs,无需额外训练即可适...
LogoCreator:快速生成专业定制商标的开源AI Logo设计工具
LogoCreator是开源的logo生成器,基于Together AI提供的Flux Pro 1.1技术快速创建专业风格的logo。项目用Next.js和TypeScript构建应用框架,Shadcn和Tailwind...
法信法律基座大模型:法律行业新纪元的千亿参数智能大模型发布
法信法律基座大模型是基于清华大学与面壁智能科研成果转化的千亿参数通用大模型,由最高人民法院发布,定位为国家级法律AI基础设施。提供生成式AI底层能力,...