✨ EN VIVO ☁️ 24°C Quito, EC •
⛽ PRECIOS Extra/Eco: $3.242 • Súper: $4.74 • Diésel: $3.181
🚗 MOVILIDAD Pico y Placa hoy en Quito restringe a: -
✨ EN VIVO ☁️ 24°C Quito, EC •
⛽ PRECIOS Extra/Eco: $3.242 • Súper: $4.74 • Diésel: $3.181
🚗 MOVILIDAD Pico y Placa hoy en Quito restringe a: -

JetBrains lanza Mellum 2.1, modelo MoE de 12B para agentes de programación

JetBrains presenta el modelo abierto Mellum 2.1 para agentes de desarrollo

Actualizada:

4 min de lectura
  • JetBrains presentó Mellum 2.1, un modelo Mixture-of-Experts con 12.000 millones de parámetros.
  • El sistema activa únicamente 2.400 millones de parámetros por token para agilizar respuestas.
  • Supera a modelos de tamaño similar en pruebas de generación y corrección de código fuente.
  • Las ponderaciones del modelo quedaron liberadas bajo licencia abierta para desarrolladores.

La compañía de herramientas de desarrollo JetBrains anunció el lanzamiento de Mellum 2.1, una nueva arquitectura de inteligencia artificial con 12.000 millones de parámetros diseñada específicamente para asistir a ingenieros de software y potenciar agentes autónomos de programación. La tecnología se basa en un esquema de mezcla de expertos que optimiza los recursos de cómputo en entornos locales y corporativos.

¿Quieres recibir noticias de última hora en tu celular? Sigue nuestro canal de WhatsApp y agréganos en Google para no perderte las primicias.

Arquitectura modular y eficiencia en la generación de código

A diferencia de los modelos monolíticos tradicionales, Mellum 2.1 implementa una estructura en la que solo 2.400 millones de parámetros se activan por cada token procesado. Este enfoque reduce la latencia en un 45% frente a modelos densos equivalentes, lo que permite ejecutarlo en servidores de desarrollo intermedios sin requerir clústeres masivos de tarjetas gráficas aceleradoras.

Publicidad

El modelo fue entrenado con más de 3,5 billones de tokens seleccionados de repositorios de código abierto, documentación técnica rigurosa y conjuntos sintéticos de depuración en lenguajes como Python, Java, Kotlin, C++ y TypeScript. En los ensayos estandarizados de la industria, la herramienta alcanzó un puntaje de precisión del 74,8% en tareas complejas de refactorización de funciones.

Esta innovación se suma a los recientes anuncios del sector tecnológico, como la actualización de Microsoft para optimizar el rendimiento del sistema, en un momento donde las empresas buscan reducir la huella de memoria y los costos de infraestructura computacional.

Capacidades avanzadas para agentes de software autónomos

Uno de los aspectos más destacados de Mellum 2.1 es su habilidad para seguir instrucciones contextuales en sesiones de depuración prolongadas. Según los reportes publicados por Hugging Face, el modelo mantiene una ventana de contexto de 32.768 tokens, facilitando el análisis integral de proyectos con múltiples archivos interconectados.

Los ingenieros de JetBrains explicaron que el sistema incorpora mecanismos de alineación diseñados para evitar alucinaciones sintácticas. En pruebas de generación de pruebas unitarias automatizadas, Mellum 2.1 produjo código ejecutable sin errores de compilación en el 89% de los casos evaluados.

La liberación de las ponderaciones bajo un marco de código abierto busca democratizar el acceso a herramientas de programación asistida. Especialistas del consorcio tecnológico Association for Computing Machinery señalaron que los modelos especializados de tamaño medio representan el futuro de la integración de inteligencia artificial en flujos continuos de integración y despliegue (CI/CD).

Integración en entornos de desarrollo y despliegue empresarial

La adopción de modelos especializados en entornos de ingeniería de software responde a la necesidad de reducir la dependencia de servicios propietarios en la nube, permitiendo a las corporaciones alojar agentes locales que resguarden la propiedad intelectual de sus repositorios confidenciales.

Pruebas complementarias realizadas por la Linux Foundation confirmaron que Mellum 2.1 se integra de manera nativa con canalizaciones automatizadas de pruebas unitarias, detectando vulnerabilidades de seguridad comunes antes de la fase de compilación. Esta capacidad predictiva agiliza los ciclos de entrega de software en empresas de base tecnológica a escala global.

Rendimiento comparativo en entornos de desarrollo integrado

La integración directa de Mellum 2.1 en entornos de desarrollo interactivos permite sugerencias en tiempo real con una latencia inferior a los 50 milisegundos. Ingenieros que evaluaron el modelo reportaron una disminución sustancial en interrupciones cognitivas, facilitando la concentración en tareas complejas de diseño de arquitectura de software y seguridad informática.

La comunidad de desarrolladores de código abierto celebró la iniciativa de JetBrains de poner a disposición pública los pesos de Mellum 2.1. Con esta decisión, equipos de ingeniería de todo el mundo podrán personalizar y afinar el modelo para lenguajes específicos o marcos de trabajo internos sin depender de proveedores externos.

ÚLTIMAS NOTICIAS

Compartir
¡Enlace copiado al portapapeles!
Scroll to Top