标签:开源大模型
WPS接入DeepSeek,秒变办公神器!
WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!
这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...
Ling-3.0-flash-VL
Ling-3.0-flash-VL是蚂蚁InclusionAI百灵系列首个开源原生多模态大模型,MoE架构总参124B、单次推理仅激活5.5B,原生图文与视频输入、256K上下文,支持网页复...
Hy4 preview 轻量版
Hy4 preview 轻量版是腾讯混元推出的开源大模型量化压缩版本:通过Sherry 1.25bit稀疏量化与MIX-STQ1_0逐层混合精度,将约1.5TB的旗舰模型压缩至214GB,支持l...
智谱 GLM-5.3-Flash
GLM-5.3-Flash 是智谱开源的新一代大模型,曾以匿名模型 Ox Alpha 身份登顶 OpenCode 用量榜。原生多模态支持图片视频输入,1M 长上下文,完全依托国产芯片算...
Hy4 preview
Hy4 preview 是腾讯混元发布的开源旗舰大模型,采用 MoE 架构,770B 总参数、49B 激活参数、1M 上下文长度,覆盖软件工程、办公分析、游戏开发与科研探索四大...
LLaDA2.2-flash
LLaDA2.2-flash是InclusionAI开源的扩散语言模型(dLLM),采用MoE架构约1000亿参数,原生支持128K上下文,以多轮并行去噪替代自回归生成,引入莱文斯坦编辑...
DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略
原标题:DeepSeek 开源第 4 天:梁文峰亲自带队,给大模型优化并行策略 文章来源:夕小瑶科技说 内容字数:4293字DeepSeek开源第四天:DualPipe与EPLB助力大...
DeepSeek-R1开源模型爆火:性能比肩GPT-4,强化学习飞轮效应显著
原标题:DeepSeek-R1开源模型爆火:性能比肩GPT-4,强化学习飞轮效应显著 文章来源:小夏聊AIGC 内容字数:3593字DeepSeek-R1:中国开源AI的惊艳亮相 近日,...
全模态对齐终于有了开源参考:北大团队发布 align-anything,数据、算法、评估一网打尽!
原标题:全模态对齐终于有了开源参考:北大团队发布 align-anything,数据、算法、评估一网打尽! 文章来源:夕小瑶科技说 内容字数:14675字北大对齐小组:...
12