标签:开源大模型

WPS接入DeepSeek,秒变办公神器!

WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
阅读原文

AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!

这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...

Xiaomi MiMo-V2.6

Xiaomi MiMo-V2.6 是小米开源的全模态模型系列,含 Pro 与 Flash 两款原生全模态模型,主打以可验证复杂任务为核心的大规模 Agentic 强化学习。
阅读原文

ZDTaichu5.0-9B

ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
阅读原文

UnifoLM-WLA-1.0

UnifoLM-WLA-1.0是宇树科技推出的6B具身多模态大模型,基于约2500小时真机数据训练,视觉、语言与动作统一建模,单模型统筹54项桌面操作与10项全身移动任务,...
阅读原文

书生-S2

书生-S2(Intern-S2)是上海人工智能实验室开源的397B多模态基础大模型,主打AI for Science,Memory Decoder架构支持可插拔专业记忆,无需重训主模型即可扩...
阅读原文

LingBot-World 2.0

LingBot-World 2.0 是蚂蚁灵波科技开源的实时交互世界模型,可像游戏一样实时操控,支持攻击施法跳跃与雨雪事件,小时级生成不漂移,高配达 720P/60FPS,1.3B...
阅读原文

NeoHorse-1

NeoHorse-1 是基元律动联合无问芯穹、清华、北大等开源的 Agent 模型,含 4B/9B 两版,采用 Agent-Native 后训练与 Routing Harness 真实执行轨迹,原生上下...
阅读原文

Ling-3.0-flash-VL

Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
阅读原文

H3-World

H3-World是腾讯联合新加坡国立大学、香港理工大学推出的动作可控世界模型,基于33B MiniMax-H3微调,键盘操作转英文指令经时间注意力路由绑定视频帧,8000条...
阅读原文

星火X2.5

星火X2.5是科大讯飞推出的旗舰通用大模型系列,包含云端MoE基座(293B/30B)与端侧4B/1.7B开源模型,依托全国产算力训练,兼容昇腾、海光等国产芯片,端侧原...
阅读原文

Hy4 preview 轻量版

Hy4 preview 轻量版是腾讯混元推出的开源大模型量化压缩版本:通过Sherry 1.25bit稀疏量化与MIX-STQ1_0逐层混合精度,将约1.5TB的旗舰模型压缩至214GB,支持l...
阅读原文

智谱 GLM-5.3-Flash

GLM-5.3-Flash 是智谱开源的新一代大模型,曾以匿名模型 Ox Alpha 身份登顶 OpenCode 用量榜。原生多模态支持图片视频输入,1M 长上下文,完全依托国产芯片算...
阅读原文

Hy4 preview

Hy4 preview 是腾讯混元发布的开源旗舰大模型,采用 MoE 架构,770B 总参数、49B 激活参数、1M 上下文长度,覆盖软件工程、办公分析、游戏开发与科研探索四大...
阅读原文

LLaDA2.2-flash

LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构约1000亿参数,原生支持128K上下文,以多轮并行去噪替代自回归生成,引入莱文斯坦编辑...
阅读原文

DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略

原标题:DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略 文章来源:夕小瑶科技说 内容字数:4293字DeepSeek开源第四天:DualPipe与EPLB助力大...
阅读原文
12