下载大模型,常像从一家仓库搬走数百 GB 货物:人一多,仓库出口就容易吃紧。llama.garden 尝试改用 BitTorrent(BT)分发模型权重——也就是运行模型所需的大量参数文件。下载者可从多个节点取得不同分片,同时把已拿到的部分传给别人,让分发不再只依赖一个托管源。
据项目作者 de4dee 介绍,llama.garden 还加入了 Web seed,让 BT 客户端在早期节点不足时,也能从普通 HTTP 服务器获取分片;随后再靠下载者继续“做种”,扩大供给。作者称,项目已为 Unsloth 一个约 10 TB 的仓库制作种子,并开放了管理自有种子服务器的部分脚本。
这些文件对应 Hugging Face(HF)仓库的特定提交;社区验证后,可用分片校验发现篡改。不过模型一旦更新,就要重新制作种子。现有材料来自作者自述,尚未提供完整的独立测速结果与长期节点规模。