BloggOpenAI
Putting frontier cyber models in more trusted hands
Approved Daybreak partners can use OpenAI’s frontier cyber models to deliver authorized, governed cybersecurity services to customers.
10 aug. openai.com
Vibekollen Nytt
Hämtar senaste nytt…
Vibekollen Nytt
Modeller, verktyg och händelser som formar AI-världen. Hitta nyheter, video och poddar – och följ vad som händer på Vibekollen.
Alla nyheter i tidsordning. Använd filtren för att hitta ditt ämne, din podd eller ditt verktyg.
BloggOpenAI
Approved Daybreak partners can use OpenAI’s frontier cyber models to deliver authorized, governed cybersecurity services to customers.
10 aug. openai.com
VideoAI Engineer
Ben Holmes visar hur man bygger en kunskapsbas genom att först skriva ned tankar slarvigt via röstdiktation, utan att oroa sig för ordning. Därefter låter man AI-agenter (som Claude) strukturera materialet i flera omgångar: de lägger på tidsstämplar, lägger till taggar från en förutbestämd lista, söker upp källor och skapar länkar. Slutligen genererar man en wiki från anteckningarna och kör hela processen automatiskt varje dag via molntjänst, så man vaknar till en uppdaterad wiki. Systemet kan också visa en grafvy över alla anteckningar för att hitta luckor i ens eget tänkande.
10 aug. youtube.com
VideoAI Engineer
Stefania Druga från Sakana.ai testade hur AI-agenter kan minnas information under längre arbetsuppgifter. Hon byggde ett minnessystem som fungerar som en skrivning-hantering-läsning-loop runt modellen, inte en enkel databas. Det viktigaste resultatet var negativt: när all information redan fick plats i modellens korttidsminne (context window) gjorde minnet ingen skillnad — bara högre kostnad. Men när svaret låg långt ut — på steg 124 medan frågan kom på steg 500 — blev minnet helt avgörande. Hennes bästa approach var en rangordnad lista över tidigare beslut, vilket slog både slumpmässig sökning och en "oracle" som fick perfekt minne. Hon körde experimenten på en lokal dator i Tokyo med fläktar runt den.
10 aug. youtube.com
BloggOpenAI
Virgin Atlantic använder ChatGPT Work för att snabba upp sitt arbete med forskning, produktplanering och beslutsfattande. Med verktyget kan teamen bättre koppla ihop olika signaler från kundernas hela resa genom flyget — från bokning till efter resan.
10 aug. openai.com
BloggOpenAI
Zapier använder ChatGPT Work för att förbättra sitt marknadsföringsarbete. Med verktyget har de minskat antalet potentiella kunder som försvinner från försäljningsprocessen, skapat kampanjmaterial automatiskt och gjort rapporteringen enklare. Det handlar om att använda AI för att göra återkommande marknadsuppgifter snabbare och mer effektiv.
10 aug. openai.com
BloggOpenAI
OpenAI introducerar Premium seats för ChatGPT Business, vilket ger högre användargränser för de mest krävande arbetuppgifterna. Folk som registrerar sig före den 20 augusti får 100 dollar i workspace credits som bonus.
10 aug. openai.com
BloggHugging Face
Meta har lanserat Muse Glimmer, en AI-modell med 30 miljarder parametrar som kan arbeta med text, bilder och videor samtidigt. Modellen är öppen källkod och finns redan integrerad i populära verktyg som transformers, llama.cpp och vLLM. Den använder smartare teknik för att minska minnesförbrukningen och snabba upp genereringen — bland annat kan den dela information mellan flera frågor och använder en optional "drafter"-modul för snabbare kod- och innehållsgenerering.
10 aug. huggingface.co
VideoAI Engineer
Superconductor använder AI-agenter som sitter med i möten och Slack-kanaler för att fånga idéer direkt från konversationer — utan att någon manuellt behöver skriva ner vad som behövs gjort. En bot lyssnade på ett möte på fyra timmar, plockade upp en kundönskan om tydligare kriterier för när arbete är klart, öppnade ett ärende själv och implementerade förslaget. Företaget kör agenterna i isolerade molnmiljöer där de inte kan komma åt produktionsdatabaser av misstag, och folk från support och tillväxt kan trigga verkligt arbete utan att behöva en utvecklarmiljö. Under en månad använde de 10,5 miljarder tokens och körde 3 300 agentsessioner för ungefär 10 000 dollar.
9 aug. youtube.com
VideoAI Engineer
En Carnegie Mellon-studie visade att produktivitetsvinsten från AI-kodning försvinner efter tre månader, medan problem och komplexitet stannar kvar — det kallas verifieringsskuld. En Wharton-studie fann att utvecklare följer AI:s råd 92,7 procent av gången när det är rätt, men också närmare 80 procent när AI är instruerad att ljuga med säkerhet. Anirban Chatterjee från Sonar föreslår en tvåskiktad lösning: noll tillit (verifiera kod med andra metoder än de som skrev den) och flera lager av granskning (både automatisk analys och resonemang-baserad granskning). Sonars jämförelser av olika AI-modeller visar att samma modell är bra på olika saker — en Claude är stark på korrekthet medan en annan är bättre på underhållbarhet och säkerhet.
9 aug. youtube.com
VideoAI Engineer
Matt Dailey beskriver "velocity sickness" — problemet när AI-verktyg gör ett team mycket snabbare utan attOutputen faktiskt har effekt. En nyhetsbrevsskrivare skrev en bok per vecka med AI-hjälp, men publiken läste inte så mycket. På ingenjörsteam blir det för många kodändringar att granska samtidigt, och decisions fattas av AI-agenter istället för människor som förstår konsekvenserna. Daileys lösning är att skilja mellan beslutsfattande och implementation: använd delade dokument för beslut (inte chatthistorik som försvinner), så agenter blir statslösa och teamet återfår kontrollen.
9 aug. youtube.com
VideoAI Engineer
Anthropic's Applied AI-team presenterar hur agenter — AI-system som löser uppgifter självständigt — bör byggas för att klara långvariga jobb i produktion. De visar att gamla lösningar blir overhead när modellerna blir smartare: Sonnet 4.5 var försiktig med sitt minnesutrymme och avslutade tidigt, så de byggde in en fix — men när Opus 4.5 skickades utan detta beteende blev fixen bara långsam överflödig kod. Huvudinsikten är att separera agentens hjärna (resoneringsloopen) från dess händer (verktygsexekveringen), vilket gör systemen 60–90 procent snabbare och gör fel återhämtningsbara istället för ödesdigra. En logg av allt som händer under sessionen används för tre saker: att se vad agenten gör, att hämta tillbaka information som Claude glömt, och för något de kallar "dreaming" — ett nattligt jobb som förbättrar agentens minne inför nästa dag.
9 aug. youtube.com
VideoAI Engineer
Wisedocs processade medicinska anspråk genom tio olika kodrepon som ingen ville röra vid. Denys Linkovs team spenderade sex månader på att slå ihop det till ett enda repo, och han benchmarkade om de borde ha väntat på bättre AI-modeller istället. En refaktoringsuppgift tog tre timmar med o3-modellen och resulterade i tio stora fel, medan nyare modeller som Sonnet 4.6 och Opus 4.8 klarade det snabbare och med färre misstag. Men när man gav GPT 5.5 hela jobbet på en gång skrev den 2 000 rader kod på 10 minuter som mest var skalet utan själva funktionerna — något modellen själv erkände. Linkov drar slutsatsen att att göra jobbet direkt var värt det: kodroller öppnades för commits, arbete som tog månader tar nu en vecka, och utvecklare från andra delar av företaget hjälper till frivilligt nu.
8 aug. youtube.com
VideoAI Engineer
Kwindla Kramer argumenterar att agenter — AI-system som kan utföra uppgifter själva — är dagens primitiva byggblock, ungefär som webbsidor var på 1990-talet. Han går genom teknikhistorien för att visa hur varje decennium hade sitt fokus: på 1950-talet handlade det om att få människors avsikter in i datorn, på 1960-talet kom interaktivitet, på 1970-talet kom abstraktioner för större system. Hans huvudpoäng är att den riktiga framtiden ligger i AI-inbyggd mjukvara som kommer efter agenter — system med asinkron kommunikation, långvariga deltagenter som delar kunskap, och dynamiska gränssnitt. Han använder sitt eget spel Gradient Bang som exempel på tekniken han tror vi bör bygga nästa.
8 aug. youtube.com
VideoAI Engineer
Saoud Rizwan argumenterar att open source-communityn har dött — inte för att koden försvunnit, utan för att AI-genererade pull requests och säkerhetsbuggar gjort det omöjligt att underhålla projekt. Projekt som Zig, curl och tldraw stänger nu ned bidrag eller bannar AI helt. Det som överlevar är istället "open weights", dvs öppna AI-modeller som företag kan använda själva. Rizwan jämför med Open Compute, där Facebook öppnade sina datacenterdesigner, industrin standardiserade på dem, och alla — inklusive Facebook — sparade miljarder. Han uppmanar amerikanska AI-labb att släppa öppna modeller innan världen blir beroende av utländska alternativ.
8 aug. youtube.com
BloggHugging Face
Hugging Face presenterar TutorMoments, ett sätt att testa om AI-modeller kan fungera som bra lärare — specifikt om de vet när de ska hjälpa en elev och när de ska låta eleven göra jobbet själv. De använder verkliga handskrivna transkript från mattelektioner, där erfarna lärare har markerat de kritiska momenten. Sedan låter de AI:n ta över som lärare och ser vad den gör. Resultatet visar att AI-modeller oftast ger för mycket hjälp istället för att låta eleverna tänka själva, även om man kan förbättra det genom att explicit säga till modellen vad balansen mellan stöd och utmaning bör vara.
7 aug. huggingface.co
BloggOpenAI
OpenAI is sharing preliminary cybersecurity evaluations for Astra and the steps we’re taking to strengthen safeguards and security controls.
7 aug. openai.com
BloggOpenAI
Discover how HSP GRUPPE uses ChatGPT Enterprise to boost productivity, improve work quality, and create more capacity for tax advisory and client service.
7 aug. openai.com