BloggOpenAI
The full stack behind abundant intelligence
OpenAI CFO Sarah Friar explains how advances across chips, compute, models, and products compound to deliver more useful intelligence at greater scale and lower cost.
25 aug. openai.com
Vibekollen Nytt
Hämtar senaste nytt…
Vibekollen Nytt
Modeller, verktyg och händelser som formar AI-världen. Hitta nyheter, video och poddar – och följ vad som händer på Vibekollen.
Alla nyheter i tidsordning. Använd filtren för att hitta ditt ämne, din podd eller ditt verktyg.
BloggOpenAI
OpenAI CFO Sarah Friar explains how advances across chips, compute, models, and products compound to deliver more useful intelligence at greater scale and lower cost.
25 aug. openai.com
BloggOpenAI
Jalapeño is a custom inference chip from OpenAI that delivers faster, more power-efficient AI inference, with higher throughput and lower latency for modern models.
25 aug. openai.com
BloggOpenRouter
OpenRouter erbjuder ett enhetligt API för videogenerering som gömmer komplexiteten bakom olika videoleverantörer. Istället för att integrera varje leverantör separat — Seedance, Veo, Wan och andra — använder du samma endpoint, samma autentisering och samma jobkö-logik för alla. Du skickar en prompt till POST /api/v1/videos, får ett jobb-ID, pollar tills videon är klar, och hämtar sedan MP4:en. Eftersom videogenerering tar flera sekunder till minuter använder OpenRouter ett asynkront system där din app kan fortsätta medan generingen pågår i bakgrunden, och jobbet sparas så att du kan hämta det senare även efter omstart.
25 aug. openrouter.ai
BloggOpenRouter
OpenAI erbjöd stora rabatter på sina nya modeller Terra och Luna mellan 27 juli och 14 augusti. Under denna period ökade användningen av Terra-tokens 5,6 gånger och Luna-tokens 13,8 gånger, medan den orabatterade Sol-modellen bara steg 1,1 gånger. Ungefär en tredjedel av användarna som prövade de rabatterade modellerna fortsatte att använda dem efter rabattperioden. Vinsterna kom främst från konkurrenter snarare än från andra OpenAI-modeller — OpenAIs totala marknadsandel växte från 7,1 procent till 12,4 procent under rabattperioden.
25 aug. openrouter.ai
BloggOpenRouter
Det finns ingen universellt bästa AI-modell — bara den bästa för din specifika uppgift, budget och tidpunkt. OpenRouter presenterar ett sexstegs ramverk för att välja rätt modell: definiera först din uppgift konkret, skapa en kortlista från benchmarks och live-data, jämför pris och svartid mellan leverantörer, testa de bästa kandidaterna med dina egna instruktioner, bedöm dem efter kostnad per slutförd uppgift (inte per token), och förvänta dig att svaret förändras när nya modeller lanseras. Genom OpenRouters MCP-server kan du göra allt detta direkt i din kodeditor utan att lämna den.
25 aug. openrouter.ai
BloggOpenAI
Use the Admin plugin for ChatGPT Work and Codex to analyze workspace usage, manage members and permissions, adjust limits, and act on admin requests.
25 aug. openai.com
BloggOpenAI
OpenAI stängde av konton från Ryssland som använde AI-verktyg för att sprida påverkanskampanjer. Kontona skapade en falsk tankesmedja som sägs vara baserad i Israel, och publicerade ett index som främjade Ryssland och kritiserade väst. OpenAI upptäckte denna hemliga Operation och tog bort den från sin plattform.
25 aug. openai.com
BloggHugging Face
Gradio har lanserat gr.Workflow, ett verktyg som låter dig bygga AI-pipelines visuellt genom att dra och koppla ihop noder i en canvas. Varje nod representerar ett steg — det kan vara en egen Python-funktion, en AI-modell från Hugging Face, eller en annan Gradio-app. När du är klar har du samtidigt ett gränssnitt att klicka i, ett REST-API att anropa från kod, och en app du kan deploya direkt till Hugging Face Spaces med ett kommando. Exemplen visar allt från bildredigering och borttagning av bakgrunder till att generera flera AI-konstverk från en prompt parallellt.
25 aug. huggingface.co
VideoAI Engineer
Giedrius Šteimantas från Oxylabs visar hur AI-agenter ofta slösar pengar och tokens på att läsa blockerade webbsidor utan att märka det — en 200-statuskod betyder inte att sidan är faktisk innehål. Hans exempel är en shopping-agent som körde långsamt och kostade mycket för mycket. Genom att dela upp arbetet i tre delar — sökning via API istället för webbläsare, beslutsstadiet med en scraper som misslyckas tydligt när den blockeras, och endast checkout via automatiserad webbläsare — får man ner kostnaderna drastiskt. Regeln från tio år av webskrapning är enkel: använd webbläsare bara när du måste, och validera innan du skickar data till modellen.
25 aug. youtube.com
PoddThe AI Daily Brief
Podden diskuterar en viral rankinglista över AI-modeller och hur svårare det blivit att säga vilken som är bäst. Istället för att fokusera enbart på intelligens väger företag nu in kostnad och hastighet när de väljer modeller. Många bygger nu med en blandning av både dura premiummodeller och öppna modeller. I nyheterna nämns att Hugging Face utforskar en försäljning, NVIDIA expanderar sin satsning på öppna modeller, och Dr. Dre använder AI-musik.
24 aug. podcasters.spotify.com
VideoAll About AI
30 Days of AI Bot Trading on Kalshi and Polymarket: The Results Kalshi: https://www.kalshi.com/r/aaa MaxxQuant AI Agent Hedge Fund - The Worlds First Hedge Fund For AI Agents: https://www.maxxquant.com Polymarket: https://polymarket.com/?r=allabtai3 x: https://x.com/AllAbtAI 👊 Become a YouTube Member to Support Me: https://www.youtube.com/c/AllAboutAI/join Website: https://www.allabtai.com Business Inquiries: kbfseo@gmail.com
24 aug. youtube.com
BloggMistral AI
Mistral AI har tillkännagett ett strategiskt samarbete med HUMAIN för att utveckla AI-teknik i Saudiarabien och Mellanöstern. Samarbetet omfattar infrastruktur, utveckling av AI-modeller och lösningar, med fokus på cybersäkerhet, röstteknologi och arabiskspråkig AI. Mistral kommer att använda HUMAINs datacenter för att möta lokal efterfrågan, och de två företagen planerar en gemensam marknadsstrategi för reglerade branscher. Samarbetet värderas till hundratals miljoner euro och handlar om "sovereign AI" — AI där data och kontroll stannar hos kunden istället för att lagras på externa plattformar.
24 aug. mistral.ai
PoddEye on AI
Enligt podcasten tar det bara några timmar att bygga en AI-agent, men sex till sju månader att få den i produktion. Manoj Saxena, som tidigare commercialiserade IBM Watson, grundade TrustWise utifrån insikten att intelligens utan kontroll inte går att distribuera. Saxena menar att 95 procent av företags AI-agentprojekt stannar mellan pilotfas och produktion — inte på grund av dåliga AI-modeller, utan för att det saknas en helt ny typ av infrastruktur som kan övervaka varje verktygsanrop och beslut i realtid. TrustWise AI Control Tower gör exakt detta, och kan samtidigt anpassa agenternas beteende mot sex nivåer av krav — från FN:s människorättskatalog till individuella kundavtal — på bara 10 till 300 millisekunder per beslut.
24 aug. aneyeonai.libsyn.com
BloggNVIDIA
NVIDIA presenterar NVLink Fusion, en lösning som låter företag bygga egna AI-processorer (XPU) utan att behöva utveckla all infrastruktur från grunden. Istället för att designa nätverk, serverracks och kylutrustning helt själva kan företag koppla sina anpassade processorer till NVIDIAs befintliga system. NVLink Fusion levererar snabbare kommunikation mellan processorer — cirka 3 gånger lägre latens än standardnätverksalternativ — och stöder upp till 72 processorer i ett nätverk. Det möjliggör också att företag kan förbereda sina datacenter innan den slutgiltiga processoren är klar, vilket minskar risken och tiden till marknaden.
24 aug. blogs.nvidia.com
BloggNVIDIA
NVIDIA har lanserat Groq 3 LPX, ett system som är nu i full produktion och utformat för att köra agentbaserade AI-system (AI-system som kan ta egna beslut och använda verktyg). Systemet kan generera 3 400 output-tokens per sekund — ungefär fyra gånger snabbare än närmaste konkurrents lösning. NVIDIA kombinerar här tre komponenter: Vera Rubin-processorer för att läsa in och förstå stora mängder text, Spectrum-X-nätverk för snabb datakommunikation, och Groq 3 LPX för att generera svar. Företag som SpaceXAI, CoreWeave och Nebius börjar redan använda plattformen.
24 aug. blogs.nvidia.com
BloggNVIDIA
NVIDIA presenterar sin nya Vera Rubin NVL72-processor, som klarar AI-agenter (autonoma AI-system) 30 gånger effektivare än tidigare modeller. Agenter använder mycket mer data än vanlig chat — de söker genom databaser, jämför alternativ och för resonemang steg för steg, vilket gör att mängden bearbetad data växer enormt. Vera Rubin minskar också kostnaden per miljon bearbetade ord med 35 gånger. Det är viktigt för företag som kör AI-fabriker, eftersom det gör det möjligt att köra fler agenter för samma ström och tjäna mer pengar på varje bearbetad fråga.
24 aug. blogs.nvidia.com
VideoNate Herk
Nate Herk har jobbat på Goldman Sachs inom affärsintelligens och delar fem säkerhetsprinciper för att jobba med AI-agenter — automatiserade verktyg som kan utföra uppgifter på egen hand. Han belyser risken genom ett exempel där en AI-agent skickade en rabattkod till 200 000 människor utan kontroll, och kontrast detta mot miljön på Goldman Sachs där ett fel i datainmatning kan kosta miljontals dollar. Videon presenterar lärdomar om hur man bygger säkerhet in i AI-system från början.
24 aug. youtube.com