通义DeepResearch

通义DeepResearch 是阿里巴巴推出的开源深度研究智能体,专为长周期、深度信息检索任务设计。拥有 300 亿参数,每次激活 30 亿参数,支持 ReAct 模式和深度模...
阅读原文

InternVLA·M1

InternVLA·M1 是上海人工智能实验室开发的具身操作“大脑”,是面向指令跟随的双系统操作大模型。构建了覆盖“思考-行动-自主学习”的完整闭环,负责高阶的空间推...
阅读原文

Learn Your Way

Learn Your Way是谷歌推出的基于先进人工智能技术重新构想传统教材的实验性学习工具。将教材内容转化为动态且引人入胜的学习体验,为每个学习者量身定制。工...
阅读原文

SuperDesign – 首个开源的IDE内置设计Agent,设计+开发效率翻倍。

超级设计就是超级代理。超级代理就是超级开发。超级开发就是超级落地。已经被罗永浩的段子洗脑了,今天给大家推荐的项目是SuperDesign,翻译过来就是超级设计...
阅读原文

VLAC

VLAC是上海人工智能实验室发布的具身奖励大模型。以InternVL多模态大模型为基础,融合互联网视频数据和机器人操作数据,为机器人在真实世界中的强化学习提供...
阅读原文

Orchids

Orchids 是全球首款具备全栈开发能力的 AI 工具,能实现从前端到后端的全流程开发。工具在 UI 设计和全栈开发性能上表现卓越,超越多个主流竞品,如 Lovable...
阅读原文

RustGPT

RustGPT 是用 Rust 编写的 Transformer 架构语言模型。RustGPT从零开始构建,不依赖任何外部机器学习框架,仅用 ndarray 进行矩阵运算。
阅读原文

GPT-5和Gemini谁更强?——一个在读博士科研日常视角的分析

我先说一下我自己的使用日常:具体包括但不限于调研、一些比较脏活累活性质的整理工作(Notion文档等等)、coding、加上一些谈天说地的八卦吹牛皮等等。调研...
阅读原文

PromptEnhancer

PromptEnhancer是腾讯混元团队开源的用在提升文本到图像(T2I)模型的提示重写框架,通过思维链(Chain-of-Thought,CoT)提示重写和专用的奖励模型AlignEval...
阅读原文

MasterGo Agent

MasterGo Agent是MasterGo AI推出的全球首个数字界面生产级AI Agent,支持基于设计系统(DSM)的文生UI,能调用团队已有设计规范,实现高效协作和生产。
阅读原文

Nano Bananary

Nano Bananary(香蕉超市) 是开源的图像编辑工具,基于 Google Gemini 图像模型开发,支持中文界面和明暗主题切换,提供 50 多种图像转换效果,无需复杂提示...
阅读原文

数说Social Research

数说Social Research 是数说故事旗下的全能营销 Agent 工具,依托领先大模型技术,接入海量社交媒体数据,能快速解答营销、市场、消费者口碑等专业问题并生成...
阅读原文

Bilibili发布IndexTTS2语音模型:情感与时长可控的语音合成技术突破!

今天要聊的主角是——Bilibili的IndexTTS2语音模型。作为一款专为语音合成设计的AI工具,IndexTTS2自2025年发布以来,已经迅速吸引了大量关注,特别是在情感控...
阅读原文

蚂蚁集团在2025Inclusion·外滩大会上正式发布全球首个智能眼镜可信连接技术框架— gPass

如今,AI眼镜被不少人看作是下一代智能终端的潜力股,市场潜力肉眼可见。但仔细观察就会发现,这个行业还处在起步阶段,面临着不少让人头疼的问题。清华大学...
阅读原文

跨境支付难题:塔塔支付科技如何赋能亚洲数字商务新生态

引言:亚洲支付市场的黄金时代 2025年,亚洲数字支付市场正经历着前所未有的变革浪潮。印度数字支付市场预计到2030年将达到9580亿美元,年复合增长率高达18.5...
阅读原文