El catálogo de Bedrock en 2026 tiene modelos que van de $0.035 a $75 por millón de tokens — un rango de precio de más de 2,000 veces entre el más barato y el más caro. Elegir mal no es un error menor, es un múltiplo de costo directo.
El catálogo incluye la familia Claude de Anthropic (Opus 4.7, Sonnet 4.6, Haiku 4.5), Llama 4 de Meta (que introdujo arquitectura mixture-of-experts a la línea de Llama en Bedrock), Mistral Large 2 y Mixtral, Cohere Command R+, AI21 Jamba, modelos de imagen de Stability AI, y las familias propias de Amazon: Titan y Nova 2 (Lite, Sonic, Multimodal Embeddings), lanzada a fines de 2025 e inicios de 2026.
Los costos van desde $0.035 por millón de tokens de entrada (Nova Micro) hasta $75 por millón de tokens de salida (Claude Opus 4.7) — una diferencia de más de 2,000 veces entre los extremos del catálogo. Elegir el modelo correcto para cada tarea específica, en vez de usar el mismo modelo "seguro" para todo, es la palanca de costo más grande disponible antes de tocar cualquier otra optimización.
Para clasificación simple, extracción de datos, o respuestas cortas de baja complejidad: Nova Micro o Nova Lite. Para tareas de complejidad media con buen balance costo-calidad: Nova Pro o Llama 4 70B. Para razonamiento complejo, agentes con múltiples pasos, o tareas donde la calidad de la respuesta importa más que el costo marginal: Claude Sonnet o Claude Opus. La regla práctica: empezar la evaluación con el modelo más barato que podría razonablemente resolver la tarea, y subir de categoría solo si las métricas de calidad no alcanzan el umbral aceptable.
La ventaja real para clientes empresariales de AWS es la consolidación: una sola política IAM, una sola línea de facturación, un solo VPC endpoint, un solo log de auditoría de CloudTrail cubriendo todas las llamadas a modelos, sin importar cuál proveedor esté detrás de cada uno. Es una ventaja operativa que ningún catálogo de modelos por sí solo puede ofrecer.
Los modelos disponibles y las versiones específicas cambian con frecuencia — vale la pena revisar la consola de AWS Bedrock o la API del catálogo de modelos para la lista vigente en tu región antes de diseñar una arquitectura alrededor de una versión específica de un modelo, ya que el snapshot exacto puede quedar deprecado o reemplazado sin previo aviso extenso.
Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.
Contactar a Carlos Montiel