跳至主要内容

本地与私有

什么是开放权重模型?

开放权重模型是指公开了训练好的参数、让任何人都能自己下载运行的一类模型。这篇文章说明「开放」这个词在这里具体涵盖什么、不涵盖什么,以及为什么不同模型的许可证差异会这么大。

全部文章 · 最近核实:

这里的「开放」涵盖什么

开放权重是指构成训练好的模型的那些数字可以下载。这足以让你运行它、微调它、检查它,并让它无论发布者之后做什么都能继续可用。

这通常不包括训练数据,往往也不包括训练代码。所以开放权重模型的「可复现」,指的是你能运行它,而不是你能重建它。

许可证真的各不相同

一些开放权重模型带有常见的宽松许可证。另一些附带条件:超过某个阈值的商业使用限制、对特定应用的禁止,或者关于署名和衍生模型的要求。

这在商业上很重要,也容易被跳过。「我们能下载它」和「我们能在产品里用它」是两个不同的问题,只有许可证能回答第二个。

为什么它们重要

它们是唯一能完全在你自己硬件上运行的模型,这让它们成为一切本地和私有部署的基础。它们也不会在你毫无察觉的情况下被下线:只要你保留着,下载好的模型就会一直可用。

与最好的托管模型之间的能力差距是真实存在的,但已经大幅缩小。对于大量日常工作而言,它已经不再是决定性因素。

常见问题

开放权重和开源是一回事吗?
不是。开源意味着源代码以及使用和修改它的自由。开放权重意味着参数被公开,遵循发布者选择的任何许可证——有时是限制性的。
我能微调开放权重模型吗?
技术上可以,这正是想要权重的主要原因之一。你是否被允许这样做,以及能对结果做什么,是一个因模型而异的许可证问题。
商业使用它们安全吗?
很多是安全的;有些则附带条件。请阅读具体模型的具体许可证——这是这个领域里唯一真正无法一概而论的事情。

与其阅读,不如亲自试试

ClawAI 通过 Ollama 和 llama.cpp,在你的硬件上运行开放权重模型,同时也支持 5 家云服务商,路由决定谁处理什么。