ls ~/research/ai
Inteligencia Artificial
Servicio de ingeniería centrado en el harness: la capa determinista que envuelve al modelo y valida, autoriza, ejecuta y registra cada acción que propone. Aborda cinco casos de uso —llevar una demo a producción, dar trazabilidad a lo que ya corre, pasar una auditoría, construir un harness desde cero y evaluar si de verdad hace falta uno— con un diagnóstico inicial de una a dos semanas que puede concluir que no es necesario. El diseño trabaja sobre contratos de herramientas, control de contexto, verificación antes de actuar, gestión de estado entre pasos, límites de coste y política, control de concurrencia y linaje de ejecución completo para reproducir cualquier decisión. Trato directo con el ingeniero por correo cifrado, sin CRM ni secuencias de venta.
Plugin independiente para Claude Code que orquesta 19 agentes reales (10 de núcleo + 9 opcionales) con 62 skills en 15 dominios. Incluye 6 flujos quality-gated (feature, fix, spike, ship, audit, quick), 26 comandos namespaced + /alfred, memoria persistente en SQLite local (WAL + FTS5), dashboard en tiempo real, capa PM operativa (SonIA), sistema de diseño (Selina) y segunda opinión técnica externa (Lucius). Los quality gates obligan a demostrar el trabajo con evidencia verificable antes de avanzar. Sin dependencias externas ni servicios remotos: todo corre en local sobre Python 3.10+, Node.js y SQLite.
Runtime reproducible (Docker, validado en clean room) que añade a Hermes el flujo completo de revisión sistemática en doce fases con un único estado material: intake con wizard, descomposición de la pregunta, protocolo previo al corpus, búsqueda multifuente registrada (OpenAlex, Crossref, Semantic Scholar, arXiv), DOI-first con deduplicación, cribado OK/KO con justificación, full text con hash y lectura reconstruida (Poppler + Docling + OCR), extracción profunda por campo (biomédico, técnico, sociales, educación, management), síntesis, revisión independiente y publication gate determinista. Entrega manuscrito en PDF, LaTeX editable, MD modular, CSV, figuras y ZIP, con watchdog que reanuda fases tras un reinicio y memoria material en workspace y Obsidian.
Plugin de Product Owner para Claude Code que profesionaliza el trabajo de PO asistido por IA. Analiza requisitos, redacta historias de usuario con formato Given/When/Then y criterios de aceptación, planifica sprints incorporando un factor de complejidad IA y publica el resultado en Trello. Pensado para equipos que quieren PO asistido sin perder método Scrum.
Revisión crítica de literatura sobre personalidad sintética en modelos de lenguaje: 385 trabajos únicos con ficha completa (método, resultados, límites y lo que cada estudio no demuestra), organizados en 6 líneas de investigación: validez psicométrica, inducción de rasgos, agentes e identidad, comportamiento colectivo, aplicaciones y sesgo, y gobernanza. Publicado en syntheticpersonality.com.
Sistema multi-agente que trabaja secuencialmente: Explorer (analiza estructura y clasifica tablas), Observer (monitorea métricas y detecta anomalías), Architect (propone índices con estimación de impacto), Gardener (detecta bloat y programa mantenimiento), Partitioner (recomienda estrategias para tablas grandes). 4 niveles de autonomía según el entorno. No modifica la base de datos, solo analiza y propone.
Plataforma de análisis automatizado de errores batch en entornos mainframe para aplicaciones JPLI (migraciones COBOL a Java), desarrollada para un banco Tier 1 español. El usuario sube un ZIP con la evidencia completa de un error batch —organizada en directorios anidados por ejecución— y un dispatcher recorre esa jerarquía clasificando cada archivo por convención de nombres (scripts JCL, logs stdout, stacktraces XML y el árbol de código fuente JPLI/Java extraído del propio stacktrace) y lo enruta al agente correspondiente. Un equipo de 6 agentes LLM especializados trabaja en paralelo: analizan los scripts JCL, los logs stdout, la jerarquía de excepciones de los stacktraces XML y el código JPLI/Java implicado; un quinto agente correlaciona todas las fuentes, reconstruye la línea temporal del error y determina la causa raíz con un nivel de confianza asociado; y un sexto genera el reporte técnico final —resumen ejecutivo, causa raíz, evidencias que la soportan, impacto y plan de corrección accionable— siguiendo la estructura pactada con el cliente. Todo el flujo queda trazado con logging centralizado por niveles. Proyecto confidencial de cliente.
- aiEasyTXT
Editor TXT-first para macOS con asistentes IA integrados (OpenAI/Claude): correccion, expansion de ideas y sugerencias. Markdown/Mermaid con vista dividida.
Sitio divulgativo que traduce mi investigación del PhD sobre personalidad sintética en IA a un lenguaje accesible para gente curiosa. Explora cómo se forma, se mide y se sesga la personalidad de los modelos de lenguaje, con ejemplos prácticos y sin jerga académica. Puente entre la investigación académica en LLM Synthetic Personality Review y el público general.
Cuadernos prácticos del facsímil «Inteligencia artificial para gente curiosa», organizados por fascículos y ejecutables en Google Colab. Cada cuaderno explica un concepto paso a paso con código y salidas reales: red neuronal a mano con NumPy, sobreajuste en directo, ML clásico, BFS/DFS/A*, Sudoku como CSP, planificación (mundo de bloques), minimax/alfa-beta, atención Q/K/V a mano, temperatura/top-k/top-p, cuantización, mini-GPT desde cero, tokens y coste, salidas estructuradas y agente ReAct mínimo.
Workshop completo en formato web de slides navegables con teclado, actualizado a mayo 2026: fundamentos (neurona, backpropagation, tokens, embeddings, cuantización), IA clásica (BFS/DFS/A*, SAT/CSP, PDDL, minimax/MCTS, ontologías/SPARQL), arquitecturas (Transformers por dentro, MoE, SSM/Mamba), RAG y RAG multimodal, fine-tuning, agentes en producción, MCP, evals, computer-use, red-team tooling, LLMOps, seguridad agéntica y vibe coding.
Skill abierta para agentes de IA que convierte una carpeta o ZIP de facturas (PDF, fotos, Facturae, XML) en un proceso ordenado, local y revisable de clasificación de IVA: inventaría sin tocar los originales (tipo, tamaño, SHA-256), extrae texto y activa OCR reanudable cuando hace falta, separa archivo, factura, operación y fila, y clasifica con un recorrido AEAT trazable que exige llegar a un caso terminal. Solo pregunta lo determinante (país, establecimiento, exención, inversión del sujeto pasivo) y, tras revisar el perfil fiscal, exporta por separado un libro de auditoría y un XLSX con la estructura de los libros registro AEAT 2026 para conciliar el Modelo 303. Producto independiente y no oficial; no presenta declaraciones ni sustituye la validación oficial.
Módulo independiente para Odoo 19 Community (LGPL-3.0) que procesa uno o varios adjuntos por correo, separa facturas de firmas, logotipos y duplicados, y extrae proveedor, NIF/VAT, fechas, conceptos, importes, impuestos, moneda e IBAN. Funciona con OpenAI, OpenRouter, Ollama local o Cloud y servidores OpenAI-compatible, con modelo principal y de respaldo. Crea únicamente facturas de proveedor en borrador —nunca publica asientos, ordena pagos ni crea proveedores nuevos—, exige coincidencia exacta con un proveedor existente y conserva historial de intentos, estados y alertas por documento para la revisión del equipo contable.
- aiAgente Q
Equipo de agentes QA que trabaja junto a tu equipo de desarrollo: revisa repositorios en GitHub y se alinea con los sistemas de integración continua. Coordina skills de calidad y seguridad por dominio, ejecuta análisis estático y entrega informes en un portal e issues accionables en GitHub, sin arrancar el producto. Pensado para integrarse en el flujo de desarrollo con evidencia trazable. Acceso por invitación.