小语言模型

Small Language Model (SLM)

参数量与算力需求显著更小的语言模型,优先服务端侧、低延迟与私有部署。

01

先用人话理解

不是所有智能都要装进超大服务器。小模型可以塞进手机或笔记本,反应快、更省电,也更适合不把数据上传云端的场景。

02

再往技术里走一步

常见 1B–14B 量级,依赖高质量数据、蒸馏、量化与架构效率。Phi、Gemma、部分 Qwen/Llama 轻量档是代表。

03

为什么重要

它决定了 AI 能否变成系统功能而非仅云端聊天框,也改变了成本结构与隐私边界。

常见误解

小模型一定弱于大模型一切任务

端侧模型不需要对齐

参数少就不能做工具调用

试试搜索