如果你已经下载过 Laguna S 2.1 的低精度版本,这次不能只改一行配置就算升级。官方发布了新的 FP8 与 NVFP4 权重——两者都用较少位数保存模型数值,以降低存储、显存和计算成本。新版本更换了检查点,也就是模型实际加载的一整套权重;旧用户需要重新下载。
以 FP8 版为例,新检查点默认支持 1,048,576 个 token 的上下文,适合一次处理长代码库或长文档。官方称,训练包含扩展至这一长度的阶段,量化也按百万上下文配置校准。模型还用滑动窗口注意力,让多数层主要查看附近内容,以减轻长文本推理的计算量和“临时记忆”占用。不过官方同时提醒,长上下文下可能出现质量下降,实际速度和显存需求也取决于推理软件。
这次更新还值得旧用户重新验证此前部分量化版本出现的循环输出问题,但现有材料没有明确确认该故障已经修复。