标签:开源模型

WPS接入DeepSeek,秒变办公神器!

WPS 大家经常用来日常写作,虽然本身提供了AI功能,但可惜需要会员,本文教你三分钟接入最火的DeepSeek,让WPS秒变办公神器。 DeepSeek API申请地址:http:/...
阅读原文

AI赚钱副业~AI生成影视解说,半个月涨粉变现3.5W+!

这两年大家都在感叹生活不易,然而我想说的是,机会还是有的,但问题不在于有没有,而在于你是否能够认准机会,然后抓住它。 接触过很多咨询项目的人,发现...

Qwen3.8-Flash

Qwen3.8-Flash 是阿里云通义千问推出的多模态 MoE 大模型,总参数 125B、每 token 仅激活 6B,原生 262K 上下文可扩展至 1M。四项架构革新将训练成本降至前代...
阅读原文

GLM-5.3-Flash

GLM-5.3-Flash 是智谱开源的原生多模态大模型,总参数320亿、激活参数仅18亿,综合智能指数57分与Claude Opus 4.8持平,成本约其1/40。支持视觉驱动编程、Off...
阅读原文

Hy-MT2-1.8B

Hy-MT2-1.8B 是腾讯混元推出的端侧翻译大模型,1.8B参数支持33种语言互译,FLORES-200基准超越微软、豆包等商业API。提供2-bit与1.25-bit极致量化,440MB起手...
阅读原文

MiniCPM-SALA

MiniCPM-SALA是面壁智能开源的9B端侧大模型,采用创新的SALA(稀疏-线性混合注意力)架构,75%线性注意力负责全局高效建模,用25%稀疏注意力精准捕捉关键信息...
阅读原文

PandaWiki

PandaWiki 是开源的AI知识库搭建系统,基于 AI 大模型的能力,帮助用户快速构建智能化的产品文档、技术文档、FAQ 和博客系统。核心功能包括 AI 辅助创作、AI ...
阅读原文

直逼DeepSeek-R1-32B,碾压李飞飞s1!UC伯克利等开源全新SOTA推理模型

原标题:直逼DeepSeek-R1-32B,碾压李飞飞s1!UC伯克利等开源全新SOTA推理模型 文章来源:新智元 内容字数:4601字斯坦福等机构开源SOTA推理模型OpenThinker-...
阅读原文

LeCun:Deepseek爆火不能说明中国AI强,只能说开源模型很强

原标题:LeCun:Deepseek爆火不能说明中国AI强,只能说开源模型很强 文章来源:夕小瑶科技说 内容字数:4332字DeepSeek横空出世,引发全球AI社区震动 近日,...
阅读原文

颠覆视觉AI:阿里Qwen、腾讯混元与谷歌重磅模型齐亮相!

原标题:视觉 LLM 开源的疯狂月!阿里 Qwen、腾讯混元、谷歌等连续开源重磅模型 文章来源:夕小瑶科技说 内容字数:11205字2024年12月视觉模型的开源盛宴 20...
阅读原文

DeepSeek 怒抢视觉对话王座!DeepSeek-VL2 发布即开源,技术全公开

原标题:DeepSeek 怒抢视觉对话王座!DeepSeek-VL2 发布即开源,技术全公开 文章来源:夕小瑶科技说 内容字数:6315字DeepSeek-VL2:国内大模型领域的“拼多多...
阅读原文

B站(bilibili)开源轻量级Index-1.9B系列模型:创新AI技术的全新突破

原标题:B站(bilibili)开源轻量级Index-1.9B系列模型:创新AI技术的全新突破 文章来源:小夏聊AIGC 内容字数:1091字探索B站最新AI技术:开源Index-1.9B系...
阅读原文

突破边界:AI2发布Tülu 3系列模型,逼近GPT-4o mini的巅峰体验!

原标题:73页,开源「后训练」全流程!AI2发布高质量Tülu 3系列模型,拉平闭源差距,比肩GPT-4o mini 文章来源:新智元 内容字数:7241字开头 近期,Allen In...
阅读原文

腾讯混元文生图开源模型发布了三款ControlNet插件

原标题:腾讯混元文生图开源模型发布了三款ControlNet插件 文章来源:小夏聊AIGC 内容字数:1724字腾讯混元文生图大模型再创新,ControlNet插件助力创作 近...
阅读原文