在网页上和 AI 聊天,或者通过 API 向模型提问,通常都由模型厂商运行模型,你提交输入,对方返回结果,服务器怎么配置、模型怎么维护,大多不用你操心。
开源模型提供了另一种选择,允许你获得训练完成后的模型参数,也就是通常所说的权重。配合适当的软件和硬件,这些参数可以在你的电脑、服务器或私有云里运行。原本需要发给外部服务的问题,也就可以在自己的环境里处理。
这里有两件容易混淆的事。
免费,说的是要不要付钱;开源,说的是你能拿到什么,以及被允许怎样使用。 一个聊天产品可以免费,却不提供模型权重。一个允许免费下载的模型,运行起来仍然需要算力和维护成本。
API 也只是访问模型的方式。开源模型可以由服务商托管,通过 API 提供给你;你自己部署的模型,同样可以通过内部 API 供同事使用。因此,“开源还是闭源”和“调用 API 还是自己部署”,要分开看。
日常讨论里,大家经常把能够下载权重的模型统称为开源模型。以后的章节我们也会沿用这个常见说法。
不过,会在严格区分时讲清楚,开放权重不等于开源了模型的全部训练过程。训练数据、训练代码和使用权限,还要分别查看。