标签:开源大模型

WPS接入DeepSeek,秒变办公神器!

WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
阅读原文

AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!

这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...

Ling-3.0-flash-VL

Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
阅读原文

H3-World

H3-World是腾讯联合新加坡国立大学、香港理工大学推出的动作可控世界模型,基于33B MiniMax-H3微调,键盘操作转英文指令经时间注意力路由绑定视频帧,8000条...
阅读原文

星火X2.5

星火X2.5是科大讯飞推出的旗舰通用大模型系列,包含云端MoE基座(293B/30B)与端侧4B/1.7B开源模型,依托全国产算力训练,兼容昇腾、海光等国产芯片,端侧原...
阅读原文

Hy4 preview 轻量版

Hy4 preview 轻量版是腾讯混元推出的开源大模型量化压缩版本:通过Sherry 1.25bit稀疏量化与MIX-STQ1_0逐层混合精度,将约1.5TB的旗舰模型压缩至214GB,支持l...
阅读原文

智谱 GLM-5.3-Flash

GLM-5.3-Flash 是智谱开源的新一代大模型,曾以匿名模型 Ox Alpha 身份登顶 OpenCode 用量榜。原生多模态支持图片视频输入,1M 长上下文,完全依托国产芯片算...
阅读原文

Hy4 preview

Hy4 preview 是腾讯混元发布的开源旗舰大模型,采用 MoE 架构,770B 总参数、49B 激活参数、1M 上下文长度,覆盖软件工程、办公分析、游戏开发与科研探索四大...
阅读原文

LLaDA2.2-flash

LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构约1000亿参数,原生支持128K上下文,以多轮并行去噪替代自回归生成,引入莱文斯坦编辑...
阅读原文

DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略

原标题:DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略 文章来源:夕小瑶科技说 内容字数:4293字DeepSeek开源第四天:DualPipe与EPLB助力大...
阅读原文

刚刚,李飞飞发公开信!力挺开源AI

李飞飞发文,提AI治理三大原则。
阅读原文

DeepSeek-R1开源模型爆火:性能比肩GPT-4,强化学习飞轮效应显著

原标题:DeepSeek-R1开源模型爆火:性能比肩GPT-4,强化学习飞轮效应显著 文章来源:小夏聊AIGC 内容字数:3593字DeepSeek-R1:中国开源AI的惊艳亮相 近日,...
阅读原文

全模态对齐终于有了开源参考:北大团队发布 align-anything,数据、算法、评估一网打尽!

原标题:全模态对齐终于有了开源参考:北大团队发布 align-anything,数据、算法、评估一网打尽! 文章来源:夕小瑶科技说 内容字数:14675字北大对齐小组:...
阅读原文
12