Your Agent Didn't Fail. Your Harness Did. — Vinoth Govindarajan, OpenAI
Videon handlar om fel som uppstår inte i AI-modellen själv utan i systemet omkring den — det som kallas "harness failures".
Problemet är att agenter kan svara självsäkert från gammal data medan två processer skriver över varandra utan att krascha, eller när ett verktyg anropas men aldrig får svar. Lösningen är att se det som: modellen föreslår, systemet genomför, och en kvittans bevisar att det faktiskt hände. Föreläsaren visar vanliga misstag som felaktig tillåelse, saknade deadlines och state som aldrig sparas, och presenterar fem frågor man bör ställa för varje incident: vad startade det, vilken state ärvde det, vilken behörighet användes, vad kördes, och vilken bevis finns kvar.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
The exact tools used to port a massive codebase in days #programming #typescript #dev
AI Engineer för 3 tim sedan
The Universal Remote Control for AI — Alex Hancock, Block
AI Engineer för 7 tim sedan
MCP Apps: Give the Model Data, Give the User a UI — Dustin Mihalik, Indeed
AI Engineer för 7 tim sedan
Your agents lack context: Here's how to fix "You're absolutely right!" — Brandon Waselnuk, Unblocked
AI Engineer för 8 tim sedan