标签:开源大模型
WPS接入DeepSeek,秒变办公神器!
WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!
这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...
Xiaomi MiMo-V2.6
Xiaomi MiMo-V2.6 是小米开源的全模态模型系列,含 Pro 与 Flash 两款原生全模态模型,主打以可验证复杂任务为核心的大规模 Agentic 强化学习。
ZDTaichu5.0-9B
ZDTaichu5.0-9B是紫东太初开源的9B通用多模态大模型,面向物理世界与具身智能。它在九大空间基准拿下8项同参数全球第一,MindCube-tiny得78.27分大幅领先同级...
UnifoLM-WLA-1.0
UnifoLM-WLA-1.0是宇树科技推出的6B具身多模态大模型,基于约2500小时真机数据训练,视觉、语言与动作统一建模,单模型统筹54项桌面操作与10项全身移动任务,...
LingBot-World 2.0
LingBot-World 2.0 是蚂蚁灵波科技开源的实时交互世界模型,可像游戏一样实时操控,支持攻击施法跳跃与雨雪事件,小时级生成不漂移,高配达 720P/60FPS,1.3B...
NeoHorse-1
NeoHorse-1 是基元律动联合无问芯穹、清华、北大等开源的 Agent 模型,含 4B/9B 两版,采用 Agent-Native 后训练与 Routing Harness 真实执行轨迹,原生上下...
Ling-3.0-flash-VL
Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
Hy4 preview 轻量版
Hy4 preview 轻量版是腾讯混元推出的开源大模型量化压缩版本:通过Sherry 1.25bit稀疏量化与MIX-STQ1_0逐层混合精度,将约1.5TB的旗舰模型压缩至214GB,支持l...
智谱 GLM-5.3-Flash
GLM-5.3-Flash 是智谱开源的新一代大模型,曾以匿名模型 Ox Alpha 身份登顶 OpenCode 用量榜。原生多模态支持图片视频输入,1M 长上下文,完全依托国产芯片算...
Hy4 preview
Hy4 preview 是腾讯混元发布的开源旗舰大模型,采用 MoE 架构,770B 总参数、49B 激活参数、1M 上下文长度,覆盖软件工程、办公分析、游戏开发与科研探索四大...
LLaDA2.2-flash
LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构约1000亿参数,原生支持128K上下文,以多轮并行去噪替代自回归生成,引入莱文斯坦编辑...
DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略
原标题:DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略 文章来源:夕小瑶科技说 内容字数:4293字DeepSeek开源第四天:DualPipe与EPLB助力大...
12