El modelo
Pequeño a propósito
No conversa. Entiende.
tardi no está hecho para mantener conversaciones largas. Está hecho para comprender consultas, comparar significados y ayudar a los sistemas a encontrar información o elegir entre opciones concretas.
| IA conversacional | tardi | |
|---|---|---|
| Para qué | IA conversacionalgenerar y mantener conversaciones | tardicomprender y apoyar decisiones sobre datos locales |
| Tamaño | IA conversacionalcientos de GB | tardipocos MB |
| Dónde corre | IA conversacionalcentro de datos con GPU | tardiCPU, dentro de tu red |
| Conexión | IA conversacionalla necesita | tardininguna |
Entiende
Encuentra lo que se quiso decir.
tardi entiende el lenguaje por su significado, no por sus palabras.
Evalúa
Cada procedimiento tiene un contexto.
tardi evalúa si un procedimiento corresponde al equipo, la versión y el síntoma consultados. Devuelve aplicable, no aplicable o revisar, con confianza calibrada.
- «purgar el circuito hidráulico antes de reemplazar la válvula»aplicable · mismo modelo 0,94
- «reemplazar el sello de la bomba mecánica»no aplicable · otra versión 0,88
- «revisar el conector del sensor de presión»aplicable · mismo circuito 0,91
- «hay algo raro en el sistema desde ayer»a revisión 0,41
tardi aporta la señal; las reglas del sistema autorizan la acción. Lo que no alcanza el umbral pasa a revisión.
Soberano
Apaga todo.
tardi no se apaga.
No depende de internet, de una nube externa ni de una GPU. El modelo, los datos y el conocimiento permanecen dentro del dispositivo, servidor o red privada donde se ejecutan.
tardi no usa ninguno de los tres.
- Dispositivo de campo
- Servidor local
- Red aislada
Portable
Tu conocimiento viaja contigo.
tardi se despliega junto a la información que necesita: documentos, bases de datos, repositorios o grafos de conocimiento. Se integra con paquetes locales sin depender de servicios externos.
El conocimiento puede actualizarse sin volver a entrenar el modelo: cambia la información local, no toda la inteligencia que la consulta.
Verificable
Un resultado que se puede reproducir.
La misma consulta da el mismo resultado hoy, dentro de un año y en cualquier máquina donde esté instalado. Cada resultado conserva la versión y la huella necesarias para volver a ejecutarlo y auditarlo.
- Reproducibleel mismo cálculo, hoy y dentro de un año.
- Atribuiblecada resultado lleva la versión del modelo y su huella; tus datos guardan con cuál se calcularon.
- Prudentecada capacidad nueva nace observando y se activa solo con evidencia.
Idénticos, bit a bit
Familia
Dos capacidades: entender y decidir.
Una familia de modelos pequeños para trabajar sobre datos y conocimiento local con un mismo runtime.
-
tardi core En desarrollo
15MB máx
El modelo principal. Entiende consultas, ubica información por significado y evalúa candidatos con confianza calibrada.
codificador · hoy 12,5 MB
-
tardi nano Vista previa
6,9MB
Una variante ultraligera para dispositivos con menos memoria y capacidad de procesamiento.
hoy: minería 0.1, en el sandbox del inicio
-
tardi decide En investigación
opciones
Evalúa opciones y criterios definidos para cada dominio, puede abstenerse y entrega resultados estructurados para que el sistema aplique sus reglas.
hoy, el juez de tardi core y las cifras de tardi nano
La generación breve de texto permanece como una línea secundaria de investigación. Hoy tardi core está en desarrollo.
- Español e inglés
- CPU
- Sin conexión
- Determinista
- Confianza calibrada
- Ajustable a tu dominio
Las respuestas cortas.
¿Qué tipo de modelo es?
Un codificador semántico con juez. Convierte texto en vectores, compara significados y puntúa candidatos con una confianza calibrada, y se abstiene cuando la evidencia no alcanza.
¿Qué hace el modelo del sandbox?
tardi nano · minería 0.1 entiende la consulta del operador aunque la diga de distintas formas, reconoce si corresponde a la situación y marca cada cifra con lo que mide. Con esas cifras, las reglas del procedimiento hacen el cálculo: la IA entiende, nunca inventa el resultado. Si la consulta no es de la situación, se abstiene. Pesa 6,9 MB y corre en el navegador sin enviar nada fuera.
¿Cuánto pesa y qué necesita para correr?
Menos de 15 MB. Corre en el procesador de servidores y portátiles normales, Intel/AMD (x86_64) o ARM (arm64), incluido Apple Silicon. Sin GPU, sin red y sin servicios externos. tardi nano, la variante ultraligera, corre además dentro del navegador de un computador o de un teléfono.
¿Es determinista?
Sí, y por construcción: el runtime calcula con productos enteros y funciones definidas operación por operación, sin que ninguna biblioteca pueda reordenarlas. Cada versión se comprueba contra una implementación de referencia y entre máquinas de arquitectura distinta, sobre un conjunto de textos congelado, antes de publicarse. El sandbox del sitio corre en el navegador con otro motor: sirve para probar tardi y no tiene esa garantía bit a bit.
¿De dónde viene el modelo?
Parte de una base abierta con licencia permisiva y se transforma para cada dominio: vocabulario multilingüe recortado a las piezas del dominio, un cuerpo mucho más pequeño y capas propias para entender y evaluar, entrenadas con los datos, el etiquetado y la calibración de ese dominio. La línea continúa hacia un tokenizador y una arquitectura propios, sin pesos heredados.
¿Cómo se mide?
Con un conjunto de referencia que se construye antes de tocar el modelo y se congela: consultas escritas por personas del dominio y pares etiquetados por dos anotadores. La partición de prueba se lee una sola vez, cada meta se fija antes de comparar modelos y se informa cada corte —negación, números, nombres parecidos, idioma cruzado y abstención—, sin que ninguno pueda retroceder. El modelo del sandbox, tardi nano · minería 0.1, se midió con datos sintéticos: muestra cómo funciona tardi, no su calidad en una operación real.
¿Cuáles son sus límites?
No conversa, no redacta y no razona en varios pasos. En cada dominio nuevo se mide con los datos de ese dominio antes de ponerlo a trabajar, porque el vocabulario cambia de un sector a otro. Y si la calibración no alcanza sus umbrales, el juez se abstiene en vez de arriesgar: es el comportamiento previsto, no una falla.
¿Qué licencia tiene?
Comercial, por versión entregada, para usarlo dentro de tu propia infraestructura. Sin telemetría ni interruptor remoto.
¿Genera texto?
Hoy no: está construido para entender y evaluar, y todo en él —el tamaño, el juez, el determinismo— viene de esa decisión. La generación breve es una línea de investigación aparte dentro de la familia.