Samsung Electronics presentó en Hot Chips 2026, celebrado en Stanford, su chip LPDDR5X-PIM: memoria de bajo consumo con lógica de cómputo integrada directamente en el DRAM, que en pruebas con Llama 3.1 casi triplicó el rendimiento de inferencia frente a la memoria LPDDR5X convencional, usando el mismo empaquetado físico.
PIM (Processing-in-Memory) es un diseño que ejecuta ciertas operaciones de cómputo directamente dentro del propio chip de memoria, en lugar de mover constantemente los datos entre la memoria y el procesador o acelerador de IA. Ese movimiento de datos —no el cómputo en sí— es uno de los mayores cuellos de botella de energía y velocidad en cargas de trabajo de IA. Según Samsung, el LPDDR5X-PIM entrega 614 GB por segundo de ancho de banda para operaciones de PIM, ocho veces más que los 76.8 GB por segundo de una LPDDR5X convencional.
En pruebas reportadas por Samsung y confirmadas por medios especializados como Tom's Hardware y ServeTheHome, correr Llama 3.1 sobre LPDDR5X-PIM elevó el throughput de 27 a 81.3 tokens por segundo —una mejora de aproximadamente 3 veces— y redujo el tiempo de finalización de una tarea de 12.3 a 5.4 segundos. La ventaja competitiva clave es que el chip usa el mismo empaquetado de 561 bolas que la LPDDR5X estándar, lo que permite reemplazarlo directamente en sistemas existentes sin rediseñar la placa o el dispositivo.
Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.
Contactar a Carlos Montiel