Guías
Guías claras sobre los modelos de decisión: en qué se diferencian de los LLM, cuán rápido es Clef-Flash y dónde una respuesta acotada supera a un párrafo.
Modelos de decisión multimodales: decidir sobre imágenes y vídeo
Un modelo de decisión multimodal puntúa una imagen o un fotograma frente a un esquema de preguntas tipadas y devuelve una probabilidad para cada opción permitida en una sola pasada.
9 min · 2026-10-14
Cómo ajustar Clef-Flash con tus propias decisiones
Clef-Flash son pesos abiertos bajo Apache 2.0, así que puedes ajustar el propio modelo de decisión a tu vocabulario, tus opciones y tu calibración.
10 min · 2026-10-13
Clef-Flash vs Jev: dos modelos de decisión comparados
Clef-Flash y Jev comparten la misma interfaz de modelo de decisión, así que la verdadera elección es un equilibrio entre trabajo crítico en latencia y trabajo crítico en precisión.
9 min · 2026-10-12
Triage de tickets de soporte con IA: categoría, urgencia y escalado a la vez
El triage de tickets de soporte son tres decisiones, no una. Un modelo de decisión devuelve una probabilidad para categoría, urgencia y escalado juntas en una sola pasada.
9 min · 2026-10-11
API de moderación con IA: probabilidades en lugar de un veredicto opaco
Una API de moderación con IA debería devolver probabilidades por etiqueta, no un único veredicto, para que tu equipo controle el umbral que decide qué se bloquea.
9 min · 2026-10-10
Enrutado de herramientas de agentes con un modelo de decisión: puntuar cada función
El enrutado de herramientas de un agente es una decisión, no una conversación. Un modelo de decisión puntúa cada función candidata en una sola pasada y devuelve una probabilidad por herramienta.
9 min · 2026-10-09
Modelo de decisión frente a clasificador: etiquetas fijas o probabilidades tipadas
Un clasificador aprende un conjunto fijo de etiquetas durante el entrenamiento. Un modelo de decisión lee tu esquema en el momento de la petición y puntúa cada opción permitida en una sola pasada.
9 min · 2026-10-08
Cómo ejecutar Clef-Flash en Ollama
Clef-Flash se distribuye como modelo de Ollama: descárgalo, escribe un esquema de preguntas tipadas y lee una probabilidad por opción permitida sin salir de tu máquina.
8 min · 2026-10-07
Rendimiento de Clef-Flash: latencia, coste y memoria explicados
Clef-Flash se reporta con unos 39 ms de latencia mediana, 122 ms de p95 y 0,09 dólares por millón de tokens de entrada: esto significa cada cifra publicada.
9 min · 2026-10-06
¿Qué es un modelo de decisión? Probabilidades tipadas en lugar de chat
Un modelo de decisión recibe un estado y un esquema de preguntas tipadas, y devuelve una probabilidad para cada opción permitida en una sola pasada, sin chat ni prosa.
8 min · 2026-10-05