OpenAI Moderation API: gratis, rápida, y la primera capa de guardrails que deberías activar

By Carlos Montiel | Especialista en IA Empresarial
Publicado: 2026-07-28 | Por: Carlos Montiel | Lectura: ~4 minutos

Si tu aplicación de IA todavía no tiene ningún guardrail de contenido, la Moderation API de OpenAI es el punto de partida más barato posible: es gratis, y agregarla es casi sin excusa.

Gratis, y ya cubre texto e imagen

La API de Moderación de OpenAI sigue siendo gratuita en 2026, y ahora cubre tanto texto como imágenes a través del modelo omni-moderation. Es una herramienta de clasificación gratuita, accedida a través de un endpoint dedicado de moderación de la API de OpenAI, que evalúa si un texto (y, para los modelos más nuevos, imágenes) es potencialmente dañino a través de un conjunto de categorías de contenido.

Las categorías que clasifica

La API clasifica contenido de texto en categorías que incluyen odio, acoso, autolesión, contenido sexual, y violencia — devolviendo tanto flags booleanos como puntajes de confianza por categoría, lo que te da flexibilidad para decidir vos mismo dónde poner el umbral de bloqueo en vez de aceptar una decisión binaria fija del proveedor.

La latencia la hace viable en el camino crítico

La API de Moderación es rápida, con latencia típica de 15-25ms, agregando overhead insignificante cuando corre de forma síncrona sobre inputs del usuario — a diferencia de guardrails más pesados que requieren una llamada adicional a un LLM completo, esto se puede correr en el camino crítico de cada request sin degradar notablemente la experiencia del usuario.

La letra chica: no todo funciona igual para imagen y texto

La moderación de imágenes está soportada, pero algunas categorías son solo de texto — esto significa que no todas las categorías de contenido funcionan de la misma forma para inputs de texto e imagen. Vale la pena revisar la documentación específica de qué categorías aplican a cada tipo de input antes de asumir cobertura completa para ambos.

Por qué es el guardrail de "mínimo común denominador"

La Moderation API no reemplaza guardrails más sofisticados como Bedrock Guardrails o Prompt Shields de Azure — no detecta prompt injection ni jailbreaks específicamente. Pero como capa base gratuita contra contenido claramente dañino (odio, violencia, contenido sexual explícito), no hay razón real para no tenerla activa en cualquier aplicación que exponga un LLM al público, incluso como complemento de guardrails más avanzados y no como sustituto.

Carlos Montiel
Arquitecto de Soluciones IA Empresarial
Especialista en LLMs, Agentes y Orquestación
guatemalia.com/#contacto · info@guatemalia.com

¿Necesitas implementar IA en tu empresa?

Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.

Contactar a Carlos Montiel

info@guatemalia.com