Mousepower: agents that can’t be measured, can’t be managed. — Maximillian Piras, Yutori
Maximillian Piras från Yutori argumenterar att AI-agenter — program som styr datorn som en människa skulle — har ett mätproblem.
Vi räknar tokens (små textenheter som agenter konsumerar) men vet inte om det faktiskt gav värde. Hans jämförelse är James Watts "horsepower" från 1700-talet: en oprecis men användbar måttstav som fick människor att prova ångmaskiner. Piras föreslår att vi i stället fokuserar på konkreta resultat — buggar fixade, supportärenden lösta. Han presenterar också en "entropimatris" för att välja vilka uppgifter som passar för agenter: de bästa uppgifterna är varken för enkla (då räcker ett script) eller för komplexa (då blir det för svårt att verifiera), utan ligger i ett mittenläge där det är billigare att kontrollera ett resultat än att lösa problemet från början.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
Generative UI... in Python? — Jeremiah Lowin, Prefect
AI Engineer för 10 tim sedan
Training Taste — Thais Castello Branco, Taste Labs
AI Engineer för 10 tim sedan
Design at the Speed of Adjectives — Paul Bakaus, Renaissance Geek, Inc.
AI Engineer för 11 tim sedan
The Design-Code Roundtrip That Isn't — Jonathan Gordon, ReWeaver AI
AI Engineer för 12 tim sedan