Alucinaciones en RAG: cómo diseñé un sistema que dice “no lo sé”
Cómo diseñé un sistema RAG que admite cuando no sabe. Tres decisiones técnicas para prevenir alucinaciones en retrieval-augmented generation.
Cuándo NO usar multi-agente ni SLM: la regla del un-solo-LLM
Multi-agente y SLMs son sexy pero over-engineered. La regla práctica para decidir cuándo un solo LLM basta y cuándo justifica armar el grafo.
Un agente me dio 10/10 cinco veces — ahí supe que algo estaba mal
Un agente me aprobó 5 veces con 10/10. Cinco huecos, tres movían plata. Cómo evité que un auditor cómplice destruyera el sistema. SDD en acción.
Estaba hackeando mi propio sistema cuando Claude me frenó
Usé Claude Fable 5 para hackear mi propio sistema. El modelo me frenó a mitad. Sobre la frontera fina entre seguridad defensiva y ataque malicioso.