AI编程工具公司Poolside于7月21日正式发布Laguna S 2.1,一款118B总参数、8B活跃参数的混合专家(MoE)开源编程模型,支持100万Token上下文窗口,专注于智能体编程和长周期任务。
令人瞩目的是,Laguna S 2.1可在单台NVIDIA DGX Spark上运行,但在SWE-Bench Multilingual等编程基准上能与参数规模4-25倍的更大模型竞争。Poolside CEO Eiso Kant表示,该模型在长周期任务中展现出"非凡的持久性"。
该模型从立项到发布仅用了52天,展示了Poolside极快的迭代速度。团队公开了训练轨迹数据而非仅仅公布最终分数,鼓励社区"找漏洞"——这种开放性在闭源模型主导的编程工具赛道中颇为罕见。
Laguna S 2.1的发布也被赋予了地缘政治意义。Forbes报道将Poolside定位为"美国开源反击"的代表——在中国开源模型(Kimi、DeepSeek、Qwen)主导开源AI生态的当下,美国亟需前沿级开源模型与之竞争。风投家Albert Wenger评论:"给个疯狂的想法:为什么我们不通过打造最好的开源模型来竞争呢?"
模型已在Hugging Face开源,可在双RTX Pro 6000或8卡3090配置上运行。社区初步测试显示,模型在深度编程任务上表现优异,但在SVG/HTML前端任务上尚有提升空间。