Si tu aplicación de IA todavía no tiene ningún guardrail de contenido, la Moderation API de OpenAI es el punto de partida más barato posible: es gratis, y agregarla es casi sin excusa.
La API de Moderación de OpenAI sigue siendo gratuita en 2026, y ahora cubre tanto texto como imágenes a través del modelo omni-moderation. Es una herramienta de clasificación gratuita, accedida a través de un endpoint dedicado de moderación de la API de OpenAI, que evalúa si un texto (y, para los modelos más nuevos, imágenes) es potencialmente dañino a través de un conjunto de categorías de contenido.
La API clasifica contenido de texto en categorías que incluyen odio, acoso, autolesión, contenido sexual, y violencia — devolviendo tanto flags booleanos como puntajes de confianza por categoría, lo que te da flexibilidad para decidir vos mismo dónde poner el umbral de bloqueo en vez de aceptar una decisión binaria fija del proveedor.
La API de Moderación es rápida, con latencia típica de 15-25ms, agregando overhead insignificante cuando corre de forma síncrona sobre inputs del usuario — a diferencia de guardrails más pesados que requieren una llamada adicional a un LLM completo, esto se puede correr en el camino crítico de cada request sin degradar notablemente la experiencia del usuario.
La moderación de imágenes está soportada, pero algunas categorías son solo de texto — esto significa que no todas las categorías de contenido funcionan de la misma forma para inputs de texto e imagen. Vale la pena revisar la documentación específica de qué categorías aplican a cada tipo de input antes de asumir cobertura completa para ambos.
La Moderation API no reemplaza guardrails más sofisticados como Bedrock Guardrails o Prompt Shields de Azure — no detecta prompt injection ni jailbreaks específicamente. Pero como capa base gratuita contra contenido claramente dañino (odio, violencia, contenido sexual explícito), no hay razón real para no tenerla activa en cualquier aplicación que exponga un LLM al público, incluso como complemento de guardrails más avanzados y no como sustituto.
Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.
Contactar a Carlos Montiel