Operaciones
Cómo funciona la maquinaria por dentro: almacén, aprovisionamiento y plazos en una empresa física; despliegue, costes y monitorización en un sistema de IA.
Une la operativa industrial con la de los modelos en producción porque las dos gestionan la misma tensión: capacidad contra coste, y velocidad contra fiabilidad. Los problemas de operaciones rara vez se resuelven con más presupuesto: se resuelven midiendo lo que hoy nadie mide.
Empresarial9
Función de asegurar que la empresa tiene lo que necesita, cuando lo necesita, al mejor coste total. No es solo comprar barato.
Red completa que lleva un producto desde la materia prima hasta el cliente final. Tu empresa es un eslabón, no el centro.
Desglose detallado de todo lo que cuesta poner un producto en manos del cliente. Es la base sobre la que se fija un precio con criterio.
Conjunto de mercancías y materiales que una empresa tiene almacenados. Es dinero inmovilizado esperando a convertirse en venta.
Indicador Clave de Rendimiento — métrica medible que refleja si una empresa, equipo o proyecto está cumpliendo sus objetivos estratégicos.
Tiempo total que pasa desde que se pide algo hasta que está disponible. Determina cuánto stock necesitas y qué plazo puedes prometer.
Objectives and Key Results — metodología de gestión por objetivos donde defines QUÉ quieres conseguir (Objective) y CÓMO sabrás que lo lograste (Key Results).
Gasto operativo recurrente que la empresa incurre para mantener su actividad diaria, imputado íntegramente al resultado del ejercicio en que se produce.
Cuántas veces al año se renueva tu almacén. Mide si el stock trabaja o si es dinero durmiendo en una estantería.
Inteligencia Artificial5
Cantidad máxima de tokens que un modelo de lenguaje puede procesar a la vez en una sola petición, incluyendo prompt, contexto recuperado, historial de conversación y respuesta.
Fenómeno por el que un LLM genera información que suena coherente y plausible pero es factualmente falsa o inventada, derivado de su naturaleza estadística de predicción de tokens.
Proceso de usar un modelo ya entrenado para generar predicciones o respuestas en tiempo real. Es la fase de explotación: cada vez que llamas a un LLM en producción, estás haciendo inference.
Mecanismo de cacheo durante la inferencia de un transformer que guarda las matrices Key y Value de cada token ya procesado, evitando recomputarlas en cada paso de generación.
Técnica que reduce la precisión numérica de los pesos de un modelo (de 32 bits a 16, 8, 4 o incluso 2 bits) para hacerlo más pequeño y rápido, sacrificando un mínimo de calidad.