Auditorías Gratuitas IA: pipeline de consultoría automatizada
Sistema completo que realiza auditorías empresariales gratuitas mediante cuestionarios de voz, transcribe con IA, analiza y genera informes PDF profesionales — convirtiendo leads en clientes cualificados.
Paso 01
Problema
Las auditorías de consultoría cuestan entre 1.500€ y 3.000€ y requieren semanas de trabajo manual. Silvigon necesitaba una forma de ofrecer auditorías gratuitas a escala, detectar automáticamente puntos débiles en procesos y generar informes profesionales que generen confianza y conviertan leads en clientes.
Paso 02
Contexto y restricciones
Construido para Silvigon, una empresa de automatización y ERP del sector de prefabricados de hormigón, áridos y construcción. El sistema debía cubrir todo el ciclo de vida de la auditoría: invitar empresas, grabar respuestas por voz, análisis con IA y generar un informe PDF de calidad consultora.
Rol: Arquitecto y desarrollador completo del sistema: captura de voz, pipeline de IA, clustering, generación de PDF y despliegue en Railway.
Paso 03
Decisiones clave
- Cuestionario por voz: cada persona graba respuestas a 6 preguntas en ~10 minutos, sin necesidad de escribir. El audio se sube directamente a Cloudflare R2 mediante URLs prefirmadas.
- Groq Whisper para transcripción (216x tiempo real, $0.04/h) con OpenAI Whisper como respaldo.
- GPT-4o mini para extracción exhaustiva de problemas (mejor 50 falsos positivos que 1 problema perdido).
- Clustering semántico: sentence-transformers (embedding español) + UMAP + HDBSCAN para consolidar cientos de problemas en ~72 oportunidades accionables.
- Juez LLM revisa cada cluster para fusionar/dividir/rechazar antes del resultado final.
- Pipeline de 4 pasos por oportunidad: investigación web (Gemini + Google Search), propuesta técnica, copy comercial con ROI y ensamblado determinista.
- Typst 0.15 para generación de PDF — 55x más rápido que WeasyPrint, calidad Knuth-Plass, <500ms de compilación.
- Pipeline de anonimato: elimina nombres de empleados, usa corchetes y plural neutro.
- Modelo de precio reembolsable: 299€ por el informe, totalmente reembolsable si contratan la implementación.
Paso 04
Resultados
- Auditoría automatizada de principio a fin: de la grabación de voz al PDF profesional en minutos.
- Coste por auditoría: ~2–5$ en APIs de IA, ~0.0001$ en generación de PDF.
- Informe profesional de 8 secciones: resumen ejecutivo, KPIs, oportunidades priorizadas, hoja de ruta, impacto económico, metodología, próximos pasos, garantías.
- Cero duplicados en prueba real: 269 problemas individuales → 72 oportunidades consolidadas.
- En producción: desplegado en Railway, Docker con ffmpeg + Typst + modelo de embeddings.
Métricas
- Coste del pipeline: ~2.60$ en IA para 72 oportunidades (GPT-4o mini + Gemini + embeddings).
- Transcripción: 216x tiempo real mediante Groq.
- Compilación PDF: <500ms con Typst.
- Calidad del clustering: 0 duplicados en prueba real de 269 → 72.
- Anonimato automático de todos los identificadores personales.
- ~72 oportunidades identificadas por auditoría, cada una con plan de fases, ROI estimado y evidencias.
Paso 05
Aprendizajes y próxima mejora
Cómo funciona
El sistema es un pipeline completo que va desde que una empresa acepta una auditoría gratuita hasta que recibe un informe PDF profesional — sin intervención humana.
Flujo del pipeline
Empresa acepta → [Invitar empleados] → [Grabación voz (6 preguntas, ~10min)]
→ [Transcripción Groq Whisper] → [Extracción problemas GPT-4o mini]
→ [Clustering semántico (UMAP + HDBSCAN)] → [Juez LLM revisa clusters]
→ [Por oportunidad: Investigación web → Solución técnica → Copy comercial → Ensamblado]
→ [Matriz de priorización (Impacto vs Complejidad)] → [PDF con Typst]
Fases clave
Captura: El admin crea una empresa, selecciona departamentos y genera tokens de acceso. Los empleados graban respuestas mediante un cuestionario web con test de micrófono y barras de frecuencia. El audio se sube directamente a Cloudflare R2 (sin pasar por el backend).
Transcripción: Groq Whisper Large v3 Turbo procesa el audio a 216x velocidad real. Archivos >25MB se comprimen con ffmpeg. OpenAI Whisper actúa como respaldo.
Análisis: GPT-4o mini extrae problemas de forma exhaustiva de cada transcripción — títulos, descripciones, citas textuales, herramientas, frecuencia, tiempo perdido. Un segundo pase de enriquecimiento detecta roles, relaciones y pistas de cuantificación.
Clustering: Sentence-transformers (español, 768d) → UMAP (15d) → HDBSCAN → Juez LLM. Transforma cientos de problemas en ~72 oportunidades consolidadas sin duplicados.
Soluciones: Por cada oportunidad: (1) Gemini + Google Search para investigación, (2) GPT-4o mini para soluciones técnicas estructuradas, (3) Copy comercial con ROI, (4) Ensamblado determinista con sanitización de evidencias.
Informe: Typst 0.15 genera un PDF profesional de 8 secciones con tarjetas KPI, badges de prioridad, hojas de ruta y análisis de impacto económico.
Estado: Alpha
El sistema es completamente funcional y está desplegado, pero aún en fase alpha. Estamos trabajando activamente en:
- Anonimato de empleados: garantizar que ningún empleado pueda ser identificado en el informe, para fomentar respuestas sinceras sin miedo a represalias.
- Adopción de la herramienta: asegurar que el flujo de grabación sea intuitivo y sin fricción para todos los usuarios.
- Calidad del informe: iterar en el PDF para igualar los estándares de calidad de las consultoras premium.
📄 Descargar ejemplo de informe (PDF, 1.7MB) Informe de prueba generado a partir de un pipeline real. Los datos de la empresa han sido anonimizados.
Dimensiones del cuestionario (6 preguntas)
🔍 Procesos — ¿Cómo detectas que un proceso está fallando? 🧠 Decisiones — ¿Cómo tomas decisiones con datos incompletos? ⚡ Problemas — ¿Qué problemas repetitivos enfrentas a diario? 🔀 Excepciones — ¿Cómo gestionas excepciones que no encajan en el sistema? 🔑 Dependencias — ¿Qué pasa cuando una persona clave no está? 🌟 Visión — ¿Qué automatizarías si pudieras?
Aprendizajes
- Los cuestionarios por voz reducen drásticamente la barrera de participación — la gente dice más de lo que escribe.
- La extracción exhaustiva (más falsos positivos) es la estrategia correcta: el clustering con LLM consolida de forma fiable.
- Un paso de ensamblado determinista tras la generación con IA asegura un formato consistente y evita la propagación de alucinaciones.
- Typst es muy superior a los motores HTML-a-PDF para generación programática de informes.
Enlaces
Paso 06