Plataforma
Fundamentos: la Ley de Productividad Aumentada
La investigación detrás del enfoque de Guren AI: por qué fallan los pilotos de IA corporativa y qué mostró el benchmark sobre 100.000 órdenes.
El enfoque de Guren AI se apoya en una investigación publicada por su fundador en Zenodo, el repositorio científico abierto operado por el CERN: “Beyond the Imitation Game: The Blueprint for Corporate AI Success” (DOI 10.5281/zenodo.22771826).
#La fórmula
P(IA) = α × T × O × H| Factor | Qué mide |
|---|---|
| α · Complejidad | La exigencia del dominio. En industrias reguladas (banca, salud) es más alta y exige más rigor en los otros tres factores. |
| T · Tecnología | La calidad técnica: modelos, conexiones, validación de consultas, capa semántica. |
| O · Organización | Gobierno de datos y procesos: métricas definidas, dueños, permisos. |
| H · Personas | La adopción: si el equipo no usa la herramienta, el resultado es cero. |
#Por qué fallan los pilotos
- Búsqueda por similitud sobre números: los sistemas que “leen” documentos para responder aproximan cifras en vez de sumarlas, y pueden inventar un número con total seguridad.
- Consultas generadas sin control: un modelo que escribe SQL directo contra la base puede producir la duplicación silenciosa de órdenes con múltiples pagos: totales inflados sin ningún error visible.
- Sin dueños ni definiciones: cada área calcula “venta” a su manera y nadie confía en el tablero.
#El benchmark
La investigación evaluó 50 preguntas de negocio sobre un conjunto de 100.000 órdenes de e-commerce, en tres niveles de dificultad (filtros simples, uniones entre tablas y casos complejos), comparando tres arquitecturas.
| Arquitectura | Exactitud total | Error silencioso |
|---|---|---|
| Búsqueda por similitud (RAG directo) | 16.0% | 68.0% |
| SQL generado sin control | 52.0% | 34.0% |
| Capa semántica con validación (enfoque de David) | 96.0% | <0.1% |
#Cómo se traduce en cada producto
- David: el modelo entiende la pregunta; la capa semántica compila la consulta; tu base calcula.
- Ana: responde solo con el conocimiento cargado y no afirma acciones que no ocurrieron.
- Laura: cada dato guarda su fuente y cada correo pasa por aprobación humana en el piloto.