gpt-oss-120b¶
En este artículo
Información
gpt-oss-120b es un modelo a gran escala con pesos abiertos de OpenAI, diseñado para tareas de alto rendimiento que requieren un razonamiento profundo, planificación multietapa e interacción compleja con herramientas. El modelo contiene 120 mil millones de parámetros, de los cuales aproximadamente 21 mil millones se activan por pasada, proporcionando un equilibrio entre potencia computacional y eficiencia. Gracias a métodos avanzados de cuantización y optimización, gpt-oss-120b puede implementarse en hardware de servidor con 70 GB o más de memoria de vídeo y admite despliegue local o híbrido escalable.
Funcionalidades principales de gpt-oss-120b¶
- Arquitectura escalable con activación condicional: El modelo contiene 120 mil millones de parámetros, pero mediante el mecanismo de activación dispersa (sparse activation), solo activa aproximadamente 21 mil millones de parámetros por solicitud. Esto reduce significativamente los requisitos de memoria y recursos computacionales sin comprometer la calidad.
- Capacidades avanzadas de agente: gpt-oss-120b admite un conjunto extendido de herramientas, incluyendo ejecución de código, búsqueda web en tiempo real, llamadas a API y generación de salidas estrictamente estructuradas (JSON, XML, etc.). Esto lo convierte en una base ideal para agentes autónomos y sistemas automatizados complejos.
- Razonamiento adaptativo: El modelo implementa un sistema flexible de niveles de razonamiento, desde respuestas directas rápidas hasta cadenas de pensamiento multietapa (chain-of-thought) y árboles de decisión. Los usuarios pueden controlar la "profundidad del pensamiento" dependiendo de la complejidad de la tarea.
- Alto rendimiento en benchmarks: gpt-oss-120b demuestra resultados comparables a los modelos propietarios en los niveles o3 y o4, particularmente en tareas que requieren lógica, matemáticas, programación y síntesis interdisciplinaria de conocimientos.
- Amplio soporte multilingüe: El modelo ha sido entrenado con datos de más de 50 idiomas y puede operar eficazmente en contextos multilingües y multiculturales. Para obtener los mejores resultados, se recomienda especificar explícitamente el idioma y los marcos culturales en el prompt.
- Cuantización eficiente y compatibilidad: El soporte para formatos MXFP4 e INT4 permite una reducción significativa del uso de memoria y la aceleración de la salida sin una pérdida sustancial de calidad. El modelo es compatible con frameworks populares como vLLM, GGUF y Hugging Face Transformers.
Funcionalidades de implementación¶
| ID | Nombre del Software | SO Compatible | VM | BM | VGPU | GPU | CPU Mín. (Núcleos) | RAM Mín. (GB) | HDD/SSD Mín. (GB) | Dominio Personalizado | Activo |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 415 | gpt-oss:120b | Ubuntu 22.04 | - | - | + | + | 16 | 128 | 240 | No | PEDIR |
Información
Para obtener información sobre las funcionalidades de implementación de este software, consulte este enlace.
- El servidor Ollama carga y ejecuta el LLM en memoria;
- Open WebUI se despliega como una aplicación web conectada al servidor Ollama;
- Los usuarios interactúan con el LLM a través de la interfaz web de Open WebUI, enviando solicitudes y recibiendo respuestas;
- Todos los cálculos y el procesamiento de datos ocurren localmente en el servidor. Los administradores pueden configurar el LLM para tareas específicas mediante las herramientas de OpenWebUI.
Primeros pasos tras la implementación de gpt-oss-120b¶
Tras el pago, se enviará una notificación sobre la preparación del servidor al correo electrónico registrado durante el pedido. Esta incluirá la dirección IP del VPS, el login y la contraseña para el acceso al servidor, así como un enlace al panel de control de OpenWebUI. Los clientes gestionan el equipo a través del Server Management Panel and API — Invapi.
- Las credenciales para el acceso al servidor OS (por ejemplo, vía SSH) se enviarán en el correo electrónico recibido.
- Enlace al panel de control de Ollama con la interfaz web de Open WebUI: en la etiqueta webpanel dentro de la pestaña Configuration >> Tags del panel de control de Invapi. El enlace exacto, por ejemplo,
https://gpt-oss<Server_ID_from_Invapi>.hostkey.in, se proporciona en el correo enviado tras la entrega del servidor.
Al visitar por primera vez el enlace de la etiqueta webpanel, se abrirá una página de bienvenida. Haga clic en el botón Get started para comenzar la configuración.
Tras hacer clic en el enlace de la etiqueta webpanel, se abrirá una ventana de inicio de sesión Get started with Open WebUI, donde deberá crear un nombre de cuenta de administrador, correo electrónico y contraseña para su chatbot, y luego presionar el botón Create Admin Account:

Atención
Tras registrar al primer usuario, el sistema le asigna automáticamente un rol de administrador. Para garantizar la seguridad y el control sobre el proceso de registro, todas las solicitudes de registro posteriores deben ser aprobadas en OpenWebUI desde la cuenta de administrador.
Tras completar con éxito el registro, se abrirá la interfaz principal de Open WebUI con acceso a Gpt-oss-20b:

Nota
Puede encontrar información detallada sobre el uso del panel de control de Ollama con Open WebUI en el artículo AI Chatbot on Your Own Server.
Nota
Para un funcionamiento óptimo con el modelo gpt-oss-120b, se recomienda utilizar una GPU con al menos 70 GB de memoria de vídeo para el modelo 120B. Para un procesamiento eficiente de contextos de código largos y tareas complejas de agentes, recomendamos utilizar GPUs con 80 GB de memoria de vídeo. Puede encontrar información detallada sobre la configuración principal de Ollama y Open WebUI en la documentación para desarrolladores de Ollama y en la documentación para desarrolladores de Open WebUI.
Recomendaciones de uso
Para maximizar la eficiencia del modelo gpt-oss 20B, se recomienda:
- Utilizar el modelo para tareas de razonamiento, incluyendo el procesamiento de cadena de pensamiento (chain-of-thought). El modelo admite niveles de razonamiento ajustables: bajo, medio y alto, que se configuran mediante un system prompt.
- Aprovechar las capacidades integradas de agente del modelo, tales como la llamada a funciones (function calling), ejecución de código Python y salidas estructuradas.
- Emplear el modelo para tareas de desarrollo en múltiples etapas aprovechando sus habilidades de agente.
- Integrar el modelo con herramientas de desarrollo existentes mediante API, teniendo en cuenta que admite el ajuste fino (tuning) y opera en formato de respuesta OpenAI Harmony. El modelo está diseñado para un despliegue eficiente con baja latencia, incluso de forma local.
Pedido de un servidor con gpt-oss-120b mediante API¶
Para instalar este software utilizando la API, siga estas instrucciones.