Poolside Laguna S 2.1: modelo de código abierto de 118B con contexto de 1M de longitud

Poolside ha lanzado Laguna S 2.1 , su modelo de codificación más potente disponible públicamente hasta la fecha.

发布于 2026年7月22日generalGEO 评分: 07 次阅读
Imagen de portada del artículo «Poolside Laguna S 2.1: modelo de código abierto de 118B con contexto de 1M de longitud»

Poolside Laguna S 2.1: modelo de código abierto de 118B con contexto de 1M de longitud

Introducción

Poolside ha lanzado Laguna S 2.1, su modelo de codificación más potente disponible públicamente hasta la fecha.

Este modelo está diseñado para ingeniería de software basada en agentes y tareas de ciclo largo. Cuenta con 118 mil millones de parámetros totales, activando aproximadamente 8 mil millones de parámetros por token, y admite una ventana de contexto de hasta 1,048,576 tokens tanto en modo de pensamiento como sin pensamiento.

Poolside ha publicado los pesos del modelo bajo la licencia OpenMDW-1.1. La compañía también ofrece varios formatos oficiales de checkpoint y cuantización a través de Hugging Face, mientras que OpenCode proporciona una versión alojada gratuita por tiempo limitado.

Estos detalles hacen de Laguna S 2.1 un lanzamiento excepcional. Está diseñado para ofrecer un rendimiento robusto como agente de codificación sin necesidad de pasar cada token por la red completa de 118 mil millones de parámetros, y puede ser desplegado de forma privada por equipos con hardware suficientemente potente.

Al mismo tiempo, varias declaraciones en torno a este lanzamiento deben contextualizarse. Las puntuaciones de referencia son reportadas principalmente por Poolside, no todos los proveedores de alojamiento expondrán la capacidad completa de 1 millón de tokens, y el hecho de que sea "lo suficientemente pequeño para ejecutarse en una DGX Spark" no significa que el modelo funcione sin problemas en un portátil de desarrollo normal.

¿Qué es Laguna S 2.1?

Laguna S 2.1 es un modelo base de texto a texto, entrenado específicamente para ingeniería de software, trabajo en terminal, uso de herramientas y flujos de trabajo de agentes de codificación.

Se sitúa entre otros dos modelos de Poolside:

Modelo Parámetros totales Parámetros activados por token Ventana de contexto Posicionamiento
Laguna XS 2.1 33B 3B 256K Codificación local más rápida y de ciclo corto
Laguna S 2.1 118B ~8B 1M Codificación de agente de ciclo largo más potente
Laguna M.1 225B 23B 256K Modelo más grande para tareas de agente complejas

Poolside afirma que Laguna S 2.1 tardó menos de nueve semanas desde el inicio del entrenamiento hasta su lanzamiento. Está entrenado sobre la misma serie de datos de preentrenamiento que Laguna XS 2.1, logrando mejoras de rendimiento mediante escalado, correcciones de código de entrenamiento, cambios en la receta y nuevo trabajo de post-entrenamiento.

La compañía describe a S 2.1 como su modelo más potente actual para desarrollo de funciones diarias, cambios en múltiples archivos, tareas de terminal y sesiones de codificación más largas.

Especificaciones principales del modelo

La ficha técnica oficial del modelo enumera la siguiente arquitectura:

Especificación Laguna S 2.1
Arquitectura Mezcla de expertos
Parámetros totales 118B
Parámetros activados ~8B por token
Número de capas 48
Capas de atención global 12
Capas de ventana deslizante 36
Tamaño de ventana deslizante 512 tokens
Número de expertos enrutados 256
Número de expertos seleccionados Top 10
Número de expertos compartidos 1
Ventana de contexto 1,048,576 tokens
Modalidad Entrada y salida de texto
Razonamiento Pensamiento intercalado, controlable por solicitud
Tamaño del vocabulario 100,352 tokens

El modelo utiliza atención de consultas agrupadas y una combinación de atención global y de ventana deslizante. Poolside también proporciona un modelo borrador DFlash entrenado...

Modelo borrador DFlash para decodificación especulativa

Cuando la pila de inferencia lo admite, este modelo reduce la latencia del servicio.

Cómo funciona el diseño de mezcla de expertos (MoE)

Laguna S 2.1 contiene 118 mil millones de parámetros, pero no todos se activan para cada token.

Su enrutador selecciona un subconjunto de expertos para cada token, con aproximadamente 8 mil millones de parámetros participando realmente en el cálculo. Esta es la razón principal por la que Poolside afirma que el modelo es más eficiente que un modelo denso de tamaño similar.

Tabla comparativa simplificada:

Modelo denso Modelo de mezcla de expertos
La mayoría de los parámetros participan por token Solo los expertos seleccionados participan
El cómputo crece con el tamaño total El cómputo puede ser muy inferior al tamaño total
Comportamiento de enrutamiento simple Enrutamiento y servicio más complejos
La memoria depende de los pesos completos del modelo La memoria también depende de los pesos completos y la precisión seleccionada

No confunda la eficiencia computacional con un bajo consumo de memoria.

Incluso si solo se activan 8 mil millones de parámetros por token, el sistema necesita acceder a los pesos completos de los expertos. Los archivos GGUF oficiales muestran el tamaño real:

Archivo GGUF oficial Tamaño aproximado
F16 235 GB
Q8_0 128 GB
Q4_K_M 75 GB
Modelo borrador DFlash BF16 2,2 GB

La versión cuantizada a 4 bits es más manejable que el modelo de precisión completa, pero 75 GB aún requieren una estación de trabajo con memoria unificada extremadamente alta o memoria acelerada, además de espacio adicional para el caché de contexto y el tiempo de ejecución.

Ventana de contexto de un millón de tokens

El modelo base admite una longitud máxima de contexto de 1,048,576 tokens.

Para los agentes de codificación, una ventana de contexto grande es útil en las siguientes tareas:

  • Grandes repositorios de código
  • Múltiples archivos fuente relacionados
  • Historial largo de terminal
  • Registros de compilación y prueba
  • Documentación de API
  • Instrucciones de arquitectura
  • Decisiones previas del agente
  • Salida de múltiples herramientas
  • Trabajos de refactorización a largo plazo

El límite de un millón de tokens no significa que cada solicitud deba llenar toda la ventana.

Los contextos largos aumentan el uso de memoria, el tiempo de precarga y el costo del servicio. También pueden introducir información irrelevante, lo que dificulta el trabajo del modelo. Un buen marco de agente de codificación aún necesita funciones de selección de archivos, recuperación, resumen, almacenamiento en caché y gestión de contexto.

Las plataformas de alojamiento pueden exponer límites de contexto inferiores a los admitidos por el modelo subyacente. El anuncio de lanzamiento de OpenCode afirma soportar un contexto de 1 millón, pero antes de diseñar flujos de trabajo en torno al valor máximo, los usuarios deben consultar la entrada actual del modelo y las políticas del proveedor. Los puntos finales gratuitos o de vista previa pueden ajustar los límites de contexto y la disponibilidad en cualquier momento.

Modo de pensamiento y modo sin pensamiento

Laguna S 2.1 admite dos modos: con razonamiento habilitado y sin pensamiento.

En las API de inferencia compatibles, el modo de razonamiento se puede controlar por solicitud mediante la opción enable_thinking.

Cada modo es adecuado para diferentes tareas:

Modo de pensamiento

Este modo es adecuado para trabajos que requieren planificación y razonamiento intermedio, como:

  • Depuración de fallos complejos
  • Coordinación de cambios en múltiples archivos
  • Diseño de planes de migración
  • Investigación de un repositorio de código desconocido
  • Ejecución de una serie de herramientas de terminal
  • Resolución de problemas utilizando múltiples enfoques viables

Modo sin pensamiento

El modo sin pensamiento es más adecuado para escenarios como:

  • Modificaciones pequeñas
  • Generación directa de código
  • Ajustes de formato
  • Transformaciones simples
  • Completaciones de baja latencia
  • Trabajos rutinarios altamente repetitivos

El modo de razonamiento no se aplica automáticamente a todas las tareas. Por lo general, consume más tokens y lleva más tiempo. Los equipos deben evaluar ambos modos en sus propios repositorios y medir los resultados a través de la tasa de finalización de tareas, no solo basándose en la calidad subjetiva de la salida.

Resultados de referencia reportados por Poolside

Poolside ha publicado los siguientes resultados de prueba para Laguna S 2.1:

Benchmark Puntuación reportada
Terminal-Bench 2.1 70.2 %
SWE-Bench Multilingüe 78.5 %
SWE-Bench Pro (conjunto de datos público) 59.4 %
DeepSWE 40.4 %
SWE Atlas (Preguntas y respuestas sobre repositorios) 46.2 %
Toolathlon Verificado 49.7 %

Poolside indica que la mayoría de las puntuaciones se basan en la métrica pass@1 y son el promedio de múltiples ejecuciones. Su archivo de trayectoria pública...

Registro de ejecución de Terminal-Bench 2.1, que permite a los desarrolladores comprender más claramente el proceso de cómo un agente maneja tareas específicas.

Los resultados muestran que Laguna S 2.1 es competitivo en comparación con modelos de mayor tamaño total de parámetros.

Sin embargo, las tablas de evaluación deben interpretarse con cautela.

Los resultados de evaluación no son una clasificación universal de productos

Los resultados pueden variar según los siguientes factores:

  • Marco del agente
  • Prompt del sistema
  • Definición de herramientas
  • Configuración de tiempo de espera
  • Número de intentos
  • Parámetros de muestreo
  • Versión de la prueba
  • Configuración del repositorio de código
  • Precisión de inferencia
  • Configuración de contexto
  • Fuente de la puntuación (desarrollador del modelo vs evaluador independiente)

La página del modelo de Poolside explica que sus tablas comparativas pueden usar los datos más altos de modelos competidores obtenidos de informes de proveedores, rankings de evaluación o clasificaciones de terceros. Este método es adecuado para comparaciones a nivel macro, pero difiere de probar todos los modelos bajo una configuración de evaluación unificada.

La conclusión más segura es: Laguna S 2.1 muestra un rendimiento sólido en su categoría de parámetros efectivos. Los equipos que seleccionen modelos de codificación de nivel de producción aún deben realizar pruebas con sus propios conjuntos de problemas, repositorios de código, cadenas de herramientas y estándares de revisión.

Pesos abiertos bajo licencia OpenMDW-1.1

Poolside ha publicado Laguna S 2.1 bajo la licencia OpenMDW-1.1, una licencia de materiales de modelo mantenida por el proyecto OpenMDW.

Esta licencia otorga a los usuarios derechos amplios para usar, modificar y redistribuir gratuitamente los materiales del modelo, siempre que se cumplan los términos. Al redistribuir, se debe conservar la licencia y las declaraciones de derechos de autor o fuente correspondientes.

Además, el contenido generado mediante el uso del modelo no está sujeto a las restricciones de la licencia.

En la práctica, los desarrolladores deben distinguir los siguientes términos:

  • Pesos abiertos: Se pueden descargar los parámetros del modelo ya entrenado.
  • Software de código abierto: El código fuente se publica bajo una licencia de software que cumple con los estándares de código abierto.
  • Modelo abierto: Un término amplio que puede incluir pesos, arquitectura, documentación, datos de entrenamiento y código de entrenamiento.

Laguna S 2.1 se publica explícitamente como pesos abiertos. Poolside y OpenCode trabajan juntos para promover el desarrollo y la aplicación de la tecnología de inteligencia artificial.

En los materiales de publicación se utiliza una expresión más fuerte como "código abierto", pero las organizaciones deben revisar el texto real de OpenMDW-1.1, las guías de uso responsable de Poolside, las dependencias de terceros y sus propios requisitos legales antes de redistribuir o implementar comercialmente.

Esta licencia también proporciona los materiales del modelo "tal cual", sin garantía alguna. Los usuarios siguen siendo responsables de probar la exactitud, seguridad, idoneidad y cumplimiento normativo.

Laguna S 2.1 disponible gratuitamente por tiempo limitado en OpenCode

OpenCode ha anunciado que, durante el período promocional, Laguna S 2.1 se puede usar de forma gratuita a través de OpenCode Zen, sin pagar tarifas de uso del modelo.

Esto proporciona a los usuarios una forma de probar con barreras de entrada bajas, sin necesidad de descargar archivos de punto de control de 75-235 GB ni ejecutar hardware de inferencia local.

La documentación de OpenCode señala dos detalles importantes:

  1. La oferta gratuita es temporal.
  2. Las entradas y salidas del servicio gratuito de Laguna S 2.1 pueden ser recopiladas y utilizadas para mejorar el modelo.

Por lo tanto, los usuarios deben evitar enviar:

  • Código fuente propietario.
  • Datos de clientes.
  • Información de credenciales.
  • Claves privadas.
  • Documentos de arquitectura confidenciales.
  • Registros sensibles de seguridad.
  • Información regulada o personal.

La vista previa gratuita es adecuada para repositorios de código públicos, proyectos sintéticos y evaluaciones de bajo riesgo. Solo se deben usar códigos privados de la empresa para pruebas después de revisar las políticas de datos actuales, términos de retención, controles de espacio de trabajo y las opciones de pago o autoalojamiento disponibles de la plataforma.

Cómo probar Laguna S 2.1

Opción 1: Usar el modelo gratuito de OpenCode

OpenCode se puede instalar a través de su instalador oficial:

curl -fsSL https://opencode.ai/install | bash

Una vez instalado, conéctese a OpenCode Zen y seleccione el modelo gratuito Laguna S 2.1 que aparece actualmente.

Durante la vista previa, el nombre exacto del modelo, los límites de contexto, los límites de uso y la disponibilidad pueden cambiar. Antes de iniciar tareas de larga duración, consulte la documentación de OpenCode Zen y el selector de modelos.

Opción 2: Ejecutar el modelo base con el ejecutor de modelos Docker

La tarjeta oficial del modelo en Hugging Face proporciona el siguiente comando:

docker model run hf.co/poolside/Laguna-S-2.1

El tamaño de descarga y la memoria necesaria dependen del formato seleccionado en tiempo de ejecución. Revise los archivos del modelo antes de descargarlos a su estación de trabajo o servidor.

Opción 3: Servir la cuantización GGUF oficial con llama.cpp

Poolside proporciona un repositorio GGUF oficial y una bifurcación de llama.cpp compatible con Laguna.

git clone --branch laguna https://github.com/poolsideai/llama.cpp
cd llama.cpp
cmake -B build
cmake --build build -j

./build/bin/llama-server \
  -hf poolside/Laguna-S-2.1-GGUF:Q4_K_M \
  --jinja \
  --port 8000

El archivo Q4_K_M tiene aproximadamente 75 GB. El sistema también necesita memoria para la sobrecarga de ejecución y la caché KV, especialmente cuando se usan contextos largos.

Opción 4: Añadir decodificación especulativa DFlash

Las instrucciones oficiales incluyen un modelo borrador DFlash opcional:

./build/bin/llama-server \
  -m laguna-s-2.1-Q4_K_M.gguf \
  -md laguna-s-2.1-DFlash-BF16.gguf \
  --spec-type draft-dflash \
  --spec-draft-n-max 15 \
  -fa on \
  --jinja \
  --port 8000

La decodificación especulativa puede mejorar la velocidad de generación, pero los resultados dependen del hardware, la forma del prompt, la longitud del contexto, la configuración de compilación y la tasa de aceptación del modelo borrador.

¿Puede realmente ejecutarse en una sola NVIDIA DGX Spark?

Poolside afirma que Laguna S 2.1 es lo suficientemente pequeño como para ejecutarse en una sola NVIDIA DGX Spark.

Esto es factible para un punto de control cuantificado adecuado, ya que DGX Spark está diseñado con una gran configuración de memoria unificada. Pero esto no significa que todos los formatos de modelo, tamaños de contexto o modos de servicio se adapten inmediatamente.

Los usuarios deben hacerse cuatro preguntas por separado:

  1. ¿Se pueden cargar los pesos?
  2. ¿Qué longitud de contexto se puede soportar después de la sobrecarga de ejecución?
  3. ¿Qué velocidad de generación de tokens se puede alcanzar?
  4. ¿Cuántas sesiones de agente puede atender el sistema simultáneamente?

Un modelo que teóricamente se puede cargar puede seguir siendo demasiado lento para la codificación interactiva con longitudes de contexto extremas. El rendimiento, el tiempo hasta el primer token, el consumo de energía y las cargas de trabajo concurrentes requieren mediciones independientes.

Informes de la comunidad sobre implementación local

El informe inicial de AIBase citó pruebas de la comunidad realizadas en un sistema Apple M3 Max con 128 GB de memoria unificada y la bifurcación llama.cpp de Poolside.

El punto de control Q4_K_M de 75 GB hace que este tipo de implementación sea técnicamente creíble, pero la experiencia variará significativamente según:

  • Presión de memoria.
  • Tamaño del contexto.
  • Nivel de cuantización.
  • Longitud del prompt.
  • Descarga de CPU y GPU.
  • Límites térmicos.
  • Decodificación especulativa.
  • Otras aplicaciones que usen memoria unificada.

Los informes de la comunidad no deben considerarse como recomendaciones de hardware fiables. Los desarrolladores deben consultar los tamaños de archivo oficiales y reservar suficiente margen de memoria antes de descargar el modelo.

Por qué Laguna S 2.1 es crucial para la codificación de agentes

Laguna S 2.1 refleja varios cambios más amplios en el campo de los modelos de codificación.

La computación activa más pequeña es cada vez más importante

Un gran número total de parámetros puede proporcionar capacidad, mientras que la activación dispersa ayuda a controlar la cantidad de cálculo por token.
Esto permite una entrega de servicios más eficiente y una experiencia de menor latencia en aplicaciones de codificación de agentes.

La arquitectura MoE resulta más atractiva para agentes de codificación que podrían ejecutarse durante minutos u horas.

El contexto largo se integra en modelos de pesos abiertos

Las ventanas de millones de tokens solían asociarse principalmente con modelos propietarios alojados. Su aparición en modelos de codificación de pesos abiertos otorga a los equipos un mayor control sobre experimentos con repositorios extensos y despliegues privados.

Los marcos de agentes son fundamentales

Poolside entrena sus modelos Laguna dentro de su propio marco de agentes y afirma que estos modelos rinden mejor en ese entorno o en clientes compatibles con el Protocolo de Cliente de Agentes (ACP).

Los benchmarks de codificación evalúan sistemas compuestos por modelo y agente, no solo la capacidad predictiva del siguiente token. El uso de herramientas, la selección de contexto, la lógica de reintentos, el acceso a terminales y la aplicación de parches afectan significativamente el rendimiento.

Los pesos abiertos amplían las opciones de despliegue

Las organizaciones pueden inspeccionar los archivos, elegir su propio tiempo de ejecución, cuantizar el modelo, desplegarlo en infraestructura privada y conectarlo a agentes de codificación internos.

Esta flexibilidad es valiosa para entornos que manejan código fuente sensible a la privacidad y con acceso restringido a la red.

Limitaciones a considerar antes del uso en producción

Modalidad de solo texto

La ficha técnica oficial describe a Laguna S 2.1 como un modelo texto a texto. No es un modelo nativo para imágenes, audio o video.

Altos requisitos de memoria

Su cantidad de parámetros activos es relativamente pequeña, pero el peso completo del modelo sigue siendo grande. Un portátil normal no será adecuado para el formato oficial de alta calidad.

El contexto largo puede ser costoso

La capacidad máxima de un millón de tokens no equivale a un procesamiento eficiente de esa magnitud en el uso diario. La latencia de precarga y la memoria caché KV pueden volverse considerables.

Los benchmarks requieren validación interna

Una puntuación de programación pública destacada no garantiza el mismo rendimiento con la combinación de lenguajes, sistemas de compilación, estándares de codificación o marcos privados de una empresa.

El acceso alojado gratuito tiene implicaciones de datos

La documentación del período gratuito de OpenCode indica que las entradas y salidas recopiladas pueden utilizarse para mejorar el modelo. No se debe enviar código confidencial sin una política aprobada.

La programación con agentes puede modificar sistemas reales

Cualquier agente de programación, al obtener permisos amplios, podría eliminar archivos, ejecutar comandos, cambiar dependencias o introducir vulnerabilidades de seguridad.

Uso:

  • Control de versiones.
  • Entornos de trabajo aislados.
  • Credenciales con mínimos privilegios.
  • Revisión humana.
  • Entornos de prueba.
  • Copias de seguridad.
  • Aprobación de comandos.

¿Quién debería evaluar Laguna S 2.1?

Laguna S 2.1 es más adecuado para:

  • Equipos que construyen agentes de programación autónomos.
  • Desarrolladores que evalúan alternativas a APIs de programación propietarias.
  • Organizaciones que necesitan despliegues de modelos privados.
  • Investigadores que estudian ingeniería de software de ciclo largo.
  • Equipos de infraestructura con estaciones de trabajo o servidores de gran memoria.
  • Creadores de herramientas que usan clientes de agentes compatibles con OpenAI o basados en ACP.

Podría no ser adecuado para:

  • Flujos de trabajo ligeros solo en portátiles.
  • Autocompletado simple.
  • Despliegues móviles.
  • Equipos sin infraestructura para ejecutar modelos de 75 GB o más.
  • Automatización de producción de alto riesgo sin un sandbox sólido.
  • Cargas de trabajo que requieren entrada multimodal nativa.

Preguntas frecuentes

¿Qué es Poolside Laguna S 2.1?

Laguna S 2.1 es un modelo de mezcla de expertos (MoE) con 118 mil millones de parámetros, diseñado para programación con agentes y tareas de ingeniería de software de ciclo largo. Activa unos 8 mil millones de parámetros por token y admite una ventana de contexto de hasta 1,048,576 tokens.

¿Laguna S 2.1 es completamente de código abierto?

Sus pesos están disponibles públicamente bajo la licencia OpenMDW-1.1, por lo que “pesos abiertos” es la descripción más clara. Los usuarios deben revisar el acuerdo de licencia, la documentación del modelo, las pautas de uso aceptable y cualquier componente de terceros antes de redistribuirlo o desplegarlo comercialmente.

¿Laguna S 2.1 es gratuito en OpenCode?

OpenCode ofrece actualmente una opción gratuita de Laguna S 2.1 por tiempo limitado. La disponibilidad, los límites de contexto, los límites de velocidad y los términos de uso de datos pueden cambiar; por lo tanto, verifique la documentación actual de OpenCode Zen antes de confiar en él.

¿La versión gratuita de OpenCode tiene una ventana de contexto de un millón de tokens?

El anuncio de OpenCode promociona contexto de un millón de tokens, coherente con la capacidad máxima del modelo base. Los puntos finales alojados pueden imponer límites diferentes, así que verifique la configuración del modelo activo en OpenCode antes de enviar contextos muy largos.

¿Laguna S 2.1 puede ejecutarse en una Mac?

Informes de la comunidad indican que las versiones cuantizadas pueden ejecutarse en sistemas Apple Silicon con alta memoria, incluyendo configuraciones M3 Max de 128 GB. El rendimiento y el contexto utilizable dependen del método de cuantización, el entorno de ejecución, la memoria disponible y la carga del sistema.

¿Laguna S 2.1 puede ejecutarse en una sola DGX Spark?

Poolside afirma que una versión adecuada puede ejecutarse en una sola NVIDIA DGX Spark. La longitud de contexto alcanzable, la velocidad de tokens y la concurrencia dependen del formato del punto de control y la configuración del servicio.

¿Cuáles son las puntuaciones de benchmark de Laguna S 2.1?

Poolside reporta un 70.2% en Terminal-Bench 2.1, un 78.5% en SWE-Bench Multilingual, un 59.4% en el conjunto de datos público SWE-Bench Pro y un 40.4% en DeepSWE. Estos datos deben evaluarse junto con los métodos de prueba de la empresa y pruebas independientes.

¿Laguna S 2.1 admite control de razonamiento?

Sí. La ficha técnica oficial indica que admite razonamiento intercalado y permite habilitar o deshabilitar el razonamiento por solicitud en sistemas de servicio compatibles.

Herramientas relacionadas

  • Poolside: Empresa que desarrolla los modelos base de la serie Laguna para codificación inteligente.
  • OpenCode: Un agente de codificación de código abierto que actualmente ofrece acceso gratuito por tiempo limitado a Laguna S 2.1.
  • Hugging Face: Repositorio oficial de pesos, documentación, formatos y guías de uso de Laguna S 2.1.
  • llama.cpp: Un entorno de ejecución de inferencia local con soporte continuo para modelos Laguna en formato GGUF.
  • Docker Model Runner: Herramienta de Docker para descargar y servir modelos locales compatibles.
  • OpenRouter: Opción de API alojada para acceder a modelos Poolside a través de una interfaz compatible con OpenAI.

Enlaces relacionados

Directorio de modelos de Poolside: Comparación oficial de Laguna S 2.1, XS 2.1 y toda la familia de modelos Laguna.

Resumen

Poolside Laguna S 2.1 cuenta con un total de 118B parámetros, aproximadamente 8B parámetros activos por token, una ventana de contexto de un millón de tokens, inferencia controlable y pesos abiertos oficialmente disponibles en varios formatos.

Poolside reporta un rendimiento sólido en pruebas de referencia de terminal e ingeniería de software, incluyendo un 70.2% en Terminal-Bench 2.1 y un 40.4% en DeepSWE. Estos resultados sitúan al modelo como destacado dentro de su categoría de tamaño, aunque los equipos deberían reproducir el rendimiento en sus propios repositorios y marcos de agentes.

El acceso gratuito limitado de OpenCode facilita la prueba del modelo, mientras que los pesos descargables permiten el despliegue privado, pero a costa de enormes requisitos de memoria, cambios en las políticas del servicio de alojamiento y riesgos operativos normales para agentes de codificación autónomos.

Laguna S 2.1 es un lanzamiento significativo de pesos abiertos para tareas de codificación de ciclo largo, pero su verdadero valor dependerá de la integración de agentes, la eficiencia del despliegue y el rendimiento en trabajos de desarrollo reales, más allá de la etiqueta de un millón de tokens de contexto.