Mousepower: agents that can’t be measured, can’t be managed. — Maximillian Piras, Yutori
Maximillian Piras från Yutori argumenterar att AI-agenter — program som styr datorn som en människa skulle — har ett mätproblem.
Vi räknar tokens (små textenheter som agenter konsumerar) men vet inte om det faktiskt gav värde. Hans jämförelse är James Watts "horsepower" från 1700-talet: en oprecis men användbar måttstav som fick människor att prova ångmaskiner. Piras föreslår att vi i stället fokuserar på konkreta resultat — buggar fixade, supportärenden lösta. Han presenterar också en "entropimatris" för att välja vilka uppgifter som passar för agenter: de bästa uppgifterna är varken för enkla (då räcker ett script) eller för komplexa (då blir det för svårt att verifiera), utan ligger i ett mittenläge där det är billigare att kontrollera ett resultat än att lösa problemet från början.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
Building ambitious software — Jonathan Kelley, Dioxus Labs & Cognition
AI Engineer för 11 tim sedan
Generative UI... in Python? — Jeremiah Lowin, Prefect
AI Engineer 10 sep.
Training Taste — Thais Castello Branco, Taste Labs
AI Engineer 10 sep.
Design at the Speed of Adjectives — Paul Bakaus, Renaissance Geek, Inc.
AI Engineer 10 sep.