Una setmana de gairebé 100 hores en una startup d’IA de Toronto
Erik Cupsa documenta una setmana a Meuze: redissenya la web en 30 hores, prepara demos per a restaurants, tanca una prova en 14 locals i construeix un agent de WhatsApp.
Tema
Resums de vídeos per entendre millor aquest tema.
Erik Cupsa documenta una setmana a Meuze: redissenya la web en 30 hores, prepara demos per a restaurants, tanca una prova en 14 locals i construeix un agent de WhatsApp.
Bijan Bowen prova Claude Sonnet 5 amb un sistema operatiu web, jocs 3D i tasques multimodals, però el model resulta lent i gasta molts tokens.
midudev prova la multimodalitat de MiniMax M3, el configura a Claude Code i Cursor i el compara amb Opus creant un joc de karts 3D. M3 acaba molt abans; Opus estructura millor el codi.
NeetCode analitza la nova consigna de l’enginyeria amb IA: deixar de dirigir agents un per un i construir bucles que reparteixin feina. El vídeo n’explica una arquitectura concreta, però adverteix sobre errors acumulats, permisos, revisions i desplegaments massa ràpids.
Agents que escriuen codi, l’incident de Replit i un nou perfil professional: què canvia realment per als programadors amb la IA.
Fable 5 programa una granja d’Arduino, crea una ciutat temporal, recupera un iBook i genera un joc 3D. Què funciona i què falla?
Alva Majo prova Claude Code en tres experiments amb Godot: prototip autònom, desenvolupament supervisat i depuració d’un joc real.
Fable 5 torna després de la suspensió: analitzem el nou filtre de seguretat, els falsos positius i una prova pràctica amb subagents.
Una prova amb Fable 5 passa de 1.143 a 1.880 tokens/s en llama.cpp. Expliquem les dues millores útils, els dos fracassos i els límits.
Grok 4.5 promet codi, agents i documents amb una API de 2/6 dòlars. Contrastem la prova del vídeo amb les especificacions oficials.
Bijan Bowen prova Tencent Hy3 amb un sistema operatiu al navegador, videojocs en C++ i 3D, una web de rellotges, un model de motor V8 i un problema real de Linux. El model sorprèn pel preu i la velocitat, però una confusió entre la llum del teclat i la pantalla exposa els riscos dels agents amb accés al sistema.
GPT‑5.6 Sol lidera proves de programació i incorpora raonament max i multiagent ultra. Expliquem capacitats, preus, límits i l’avís de METR.