klod.sk
Novinky

AI Digest #44: OpenAI pod paľbou za matematiku, Grok 4.7 zaostáva za Claude

4 min čítania

Deň patril hlavne OpenAI, ktoré si po spornom matematickom dôkaze zavolalo na pomoc nezávislých matematikov. Popri tom vyšiel nový model od xAI a Amazon si postavil hranicu proti cudzím nákupným AI agentom.

OpenAI si po spore o Navier-Stokesovu rovnicu zriadilo poradnú skupinu matematikov

OpenAI koncom minulého týždňa oznámilo, že jeho interný model, výkonnejší než GPT-6 Astra, po zhruba 88 hodinách práce s asi 10-tisíc súbežnými AI agentmi vytvoril dôkaz, že trojrozmerné Navier-Stokesove rovnice môžu v konečnom čase vytvoriť singularitu. Ide o jeden z problémov, za ktorý Clay Mathematics Institute vypísal milión dolárov. Ibaže výsledok zatiaľ nikto verejne nevidel a inštitút problém stále vedie ako otvorený.

Kauzu skomplikoval spor o zásluhy: dvanásť hodín pred oznámením OpenAI zverejnil Tristan Buckmaster z NYU spolu s Leventom Alpögem z Anthropicu vlastné riešenie príbuzných problémov, tiež s pomocou viacerých AI modelov vrátane tých od OpenAI. Podľa Axiosu aj Scientific American sa v matematickej komunite rozpútala debata o tom, kto si zásluhy zaslúži a či OpenAI výsledok nezverejnilo narýchlo kvôli marketingu. Tri dni po oznámení podpísalo 25 laureátov Fieldsovej medaily vrátane Terenca Taa otvorený list, v ktorom varujú, že AI firmy premieňajú slávne otvorené problémy na marketingové benchmarky.

Ako reakciu OpenAI v pondelok oznámilo vznik Poradnej skupiny pre matematiku a umelú inteligenciu, ktorá sídli na Institute for Advanced Study v Princetone a beží aj na stránke agmai.org. Deväťčlenné vedenie tvoria mená ako Timothy Gowers, Martin Hairer, Edward Witten či samotný Terence Tao, ktorý oznámenie zverejnil na svojom blogu. Skupina nemá žiadnu rozhodovaciu právomoc nad tempom výskumu OpenAI, jej prvou úlohou je len pomôcť koordinovať zverejnenie viac než stovky ďalších matematických výsledkov, ktoré má interný model OpenAI podľa firmy vyriešiť. Institute for Advanced Study zároveň spresnil, že zodpovednosť za rozhodnutia ostáva výhradne na strane firmy, poradcovia majú len poradný hlas.

xAI vypustilo Grok 4.7, v agentickom kódovaní citeľne zaostáva za Claude aj GPT-6

xAI v pondelok vydalo Grok 4.7, model s 2,1 bilióna parametrov, čo je o 40 percent viac než malo Grok 4.6. Cena ostala rovnaká ako pri predchodcovi, 2 doláre za milión vstupných a 6 dolárov za milión výstupných tokenov, kontextové okno zostáva na 500-tisíc tokenoch. Vydanie prišlo po viacerých odkladoch, Musk termín posúval podľa dostupných zdrojov aspoň päťkrát od konca júla.

Podľa xAI model dlhšie premýšľa nad ťažkými úlohami a častejšie si overuje vlastné odpovede, firma tiež do trénovania primiešala dáta zo SpaceX vrátane telemetrie Starlinku a záznamov o výrobných a inžinierskych zlyhaniach, s cieľom zlepšiť uvažovanie o fyzických systémoch. Výsledky na nezávislých benchmarkoch sú ale skromnejšie, než xAI prezentuje. Podľa The Decoder dosiahol Grok 4.7 na Artificial Analysis Intelligence Index 46 bodov, zatiaľ čo Claude Fable 5.1 aj GPT-6 majú po 53. Rozdiel je ešte výraznejší v agentickom kódovaní: na Terminal-Bench 4.0 má Grok 4.7 len 26 percent oproti 60 percentám GPT-6 Astra a 55 percentám Claude Fable 5.1. Jediné, kde sa Grok drží lepšie, je klasické kódovanie na CursorBench 4.0, kde s 46,3 percenta predbehol GPT-5.6 Sol Max, na Claude Fable 5.1 ale stále stráca.

Amazon zablokoval Metin nákupný AI agent Muse

V nedeľu večer začali používatelia Metinho asistenta Muse pri pokuse nakúpiť na Amazone dostávať chybové hlásenie, že neautorizovaný AI agent porušuje podmienky používania platformy. Podľa TechCrunch a Bloombergu Amazon vec najprv riešil priamo s Metou a žiadal dobrovoľnú nápravu, k technickému blokovaniu pristúpil až po tom, čo Meta odmietla Amazon z fungovania Muse vyňať.

Dôvody sú podľa oboch zdrojov kombináciou konkurenčného záujmu, Amazon má vlastné modely aj jednu z najpoužívanejších inferenčných platforiem, a praktického rizika. Ak by nákupy cez cudzieho agenta zlyhávali, reklamácie, vrátenia aj spory s predajcami by musel riešiť Amazon, nie Meta. Pre bežných používateľov to znamená, že nákupné AI agenty od konkurenčných firiem zatiaľ na veľkých e-shopoch fungujú len s obmedzeniami, ktoré si platforma určuje sama.

V skratke

  • Americký minister financií Scott Bessent v CNBC vyhlásení povedal, že za júlový hackerský incident OpenAI na Hugging Face nesie zodpovednosť manažment firmy, nie samotní AI agenti (Bloomberg).
  • Tento týždeň sa vo Washingtone koná summit Trumpa a Si Ťin-pchinga, kde má byť AI jednou z hlavných tém, na sprievodnej večeri sa podľa ohlásení zúčastnia aj šéfovia Amazonu, Googlu, OpenAI, Applu, Tesly aj Nvidie (NBC News).
  • OpenAI vyzvalo Spojené štáty, aby prevzali vedenie pri stanovovaní globálnych bezpečnostných štandardov pre najpokročilejšie AI modely (Bloomberg).

To podstatné zo sveta AI v jednom emaili.

Ak máš pocit, že sa AI mení rýchlejšie, než stíhaš sledovať, stačí odoberať náš weekly digest. Naservírujeme ti ho každý štvrtok na obed.

Bez spamu. Odhlásiš sa jedným klikom.