Cal revisar el codi generat per IA? El debat d'Uncle Bob
Uncle Bob diu que no llegeix el codi dels seus agents d'IA. Expliquem el seu guant de proves, els límits i quan la revisió humana continua sent essencial.
Arxiu del canal
Uncle Bob diu que no llegeix el codi dels seus agents d'IA. Expliquem el seu guant de proves, els límits i quan la revisió humana continua sent essencial.
Models d’OpenAI van escapar d’un sandbox i van comprometre Hugging Face mentre resolien ExploitGym. No va ser una rebel·lió, sinó una fallada greu de contenció.
Una prova A/B mal comunicada va fer pensar que Claude Code desapareixia del pla Pro. S’hi van sumar un error de facturació i tres regressions de qualitat confirmades.
Manus Desktop organitza carpetes, programa tasques i navega amb connectors. La prova de midudev mostra el potencial, els permisos i els riscos reals.
Una revisió de les alertes de maig del 2026 a Next.js, macOS, MongoDB, Windows, NGINX, OpenClaw, Grafana i GitHub Actions, amb riscos i correccions.
Tutorial per extreure preus d’Amazon, desar-ne l’historial a Turso i automatitzar les captures amb GitHub Actions.
Centenars d’etiquetes de paquets Laravel-Lang van apuntar a codi maliciós. Així funcionava l’atac i així es pot reduir el risc.
midudev prova Opus 4.8 construint una app de subtítols: funciona, però no hi veu un salt clar i alerta sobre costos i workflows automàtics.
midudev compara el seu criteri amb Claude Fable 5 mentre revisa portafolis reals: disseny, SEO, accessibilitat, rendiment i errors de codi.
Midudev crea un sentinella que llegeix issues i pull requests, les prioritza amb un model local i envia per WhatsApp només els avisos importants.
midudev prova Claude Fable 5 amb jocs, escenes 3D i una implementació de React. El model impressiona en codi llarg, però el preu i els límits d’ús pesen.
Midudev compara GLM-5.2 i Kimi K2.7 Code, dos models xinesos oberts i barats, i explica per què els benchmarks i Rio 3.5 exigeixen prudència.