本地与私有
什么是开放权重模型?
开放权重模型是指公开了训练好的参数、让任何人都能自己下载运行的一类模型。这篇文章说明「开放」这个词在这里具体涵盖什么、不涵盖什么,以及为什么不同模型的许可证差异会这么大。
全部文章 · 最近核实:
这里的「开放」涵盖什么
开放权重是指构成训练好的模型的那些数字可以下载。这足以让你运行它、微调它、检查它,并让它无论发布者之后做什么都能继续可用。
这通常不包括训练数据,往往也不包括训练代码。所以开放权重模型的「可复现」,指的是你能运行它,而不是你能重建它。
许可证真的各不相同
一些开放权重模型带有常见的宽松许可证。另一些附带条件:超过某个阈值的商业使用限制、对特定应用的禁止,或者关于署名和衍生模型的要求。
这在商业上很重要,也容易被跳过。「我们能下载它」和「我们能在产品里用它」是两个不同的问题,只有许可证能回答第二个。
为什么它们重要
它们是唯一能完全在你自己硬件上运行的模型,这让它们成为一切本地和私有部署的基础。它们也不会在你毫无察觉的情况下被下线:只要你保留着,下载好的模型就会一直可用。
与最好的托管模型之间的能力差距是真实存在的,但已经大幅缩小。对于大量日常工作而言,它已经不再是决定性因素。
常见问题
- 开放权重和开源是一回事吗?
- 不是。开源意味着源代码以及使用和修改它的自由。开放权重意味着参数被公开,遵循发布者选择的任何许可证——有时是限制性的。
- 我能微调开放权重模型吗?
- 技术上可以,这正是想要权重的主要原因之一。你是否被允许这样做,以及能对结果做什么,是一个因模型而异的许可证问题。
- 商业使用它们安全吗?
- 很多是安全的;有些则附带条件。请阅读具体模型的具体许可证——这是这个领域里唯一真正无法一概而论的事情。
与其阅读,不如亲自试试
ClawAI 通过 Ollama 和 llama.cpp,在你的硬件上运行开放权重模型,同时也支持 5 家云服务商,路由决定谁处理什么。