Act, Confirm, or Stop? Smarter behavior for AI assistants, wearables & robots — Amit Desai, Roku
Amit Desai från Roku visar att man kan göra AI-assistenter mycket bättre utan att förbättra själva noggrannheten.
Hans poäng är att utvecklare fokuserar på att öka modellens träffsäkerhet medan de ignorerar en helt oberoende inställning: vad systemet ska göra när det är osäkert. Med samma 79 procents träffsäkerhet kan användarvärken minska med nästan hälften genom att systemet kan välja mellan tre beteenden: agera, fråga användaren innan det agerar, eller stanna och säga att det inte förstod. Det avgörande är att olika felutfall kostar olika mycket för användaren – att spela fel låt är värre än att säga "jag förstod inte" – och att man kan beräkna dessa kostnader och välja tröskelvärden som minimerar den totala kostnaden, en metod Desai kallar OUCH (Outcome User Cost Heuristic).
Sammanfattningen har tagits fram med AI av Vibekollen utifrån källans publicering. Innehållet tillhör AI Engineer.
Mer att läsa
Building advertising for the way people use AI
OpenAI för 3 tim sedan
Server-Side Code Execution Tools for AI Agents, Compared
OpenRouter för 13 tim sedan
v0.40.0
Ollama för 13 tim sedan
Google froze its open source bug bounty program due to a ‘significant rise’ in AI submissions
TechCrunch AI för 16 tim sedan