klod.sk
Novinky

AI Digest #8: OpenAI ukázalo silu Astry na desiatich matematických dôkazoch, EÚ aj Kalifornia sprísnili AI zákony

4 min čítania

Víkend a pondelok priniesli dve odlišné, no rovnako dôležité témy: OpenAI ukázalo, čo dokáže jeho pripravovaný model Astra na desiatich dlho nevyriešených matematických problémoch, a zároveň naraz v EÚ aj Kalifornii začali platiť prísnejšie pravidlá pre AI systémy.

OpenAI ukázalo silu pripravovaného modelu Astra na desiatich matematických problémoch

OpenAI 1. augusta zverejnilo, že interná verzia jeho pripravovaného modelu Astra vyriešila desať dlhodobo otvorených problémov v matematike a teoretickej informatike. Firma k výsledkom pridala 249-stránkový manuskript aj strojovo overiteľné dôkazy v jazyku Lean 4 zverejnené na GitHube, celé za odhadovaných 2000 dolárov výpočtu. Podľa The Decoder a BleepingComputer ide zároveň o prvú neoficiálnu ukážku samotného modelu Astra, OpenAI ho takto len naznačilo v texte o matematike bez formálneho predstavenia.

Najväčším výsledkom je prvá explicitná konštrukcia nesofickej grupy, otázka z teórie grúp otvorená od roku 1999, keď pojem sofickosti zaviedol Michail Gromov. Astra podľa SiliconANGLE tiež vyvrátila Connesovu hypotézu o rigidite von Neumannových algebier, dokázala Ehrhartovu hypotézu o objeme a vyriešila tri problémy z katalógu Paula Erdősa vrátane problému 183 o viacfarebných Ramseyho číslach. Pridala aj prvé zlepšenie hornej hranice hustoty balenia gulí vo vyšších dimenziách od roku 1978.

Dôkazy v Lean majú nulový počet nedokončených krokov, čo rieši častú výhradu voči AI dôkazom, že sa nedajú nezávisle overiť. Lean skontroluje, že každý logický krok sedí, neoverí ale, či formalizácia problému zodpovedá tomu, čo matematici pôvodne mysleli, to musia posúdiť ľudia. Fields medailista Timothy Gowers podľa The Decoder povedal, že by jeden z dôkazov odporučil do špičkového časopisu bez váhania. Samotný model Astra OpenAI zatiaľ nespustilo, výsledky slúžia ako predbežná ukážka jeho schopností.

Prísnejšie pravidlá pre AI platia od 2. augusta v EÚ aj Kalifornii

Európska AI regulácia (AI Act) 2. augusta prešla do ďalšej fázy: nadobudla účinnosť zvyšná časť pravidiel vrátane povinností pre vysokorizikové AI systémy a právomoci úradov ukladať pokuty. Ide o míľnik presne dva roky od vstupu zákona do platnosti v auguste 2024, dovtedy platili len čiastkové povinnosti, napríklad zákaz vybraných praktík od februára 2025 a pravidlá pre všeobecné (GPAI) modely od augusta 2025. Podľa Orrick sa firmy na tento dátum pripravovali celý predchádzajúci rok, keďže vymáhanie sa odteraz týka aj väčšiny vysokorizikových nasadení.

V rovnaký deň nadobudol účinnosť aj kalifornský zákon SB 942 (AI Transparency Act), prvý komplexný americký zákon o pôvode AI obsahu. Poskytovatelia generatívnych AI nástrojov na obrázky, video či zvuk s viac ako miliónom používateľov mesačne v Kalifornii musia do výstupov vkladať strojovo čitateľné metadáta o pôvode v štandarde C2PA, ponúkať bezplatný verejný nástroj na detekciu a umožniť viditeľné označenie AI obsahu. Pokuty podľa TechTimes začínajú na 5000 dolároch za deň za porušenie, pričom Midjourney v prvý deň platnosti zákona nemá zavedené žiadne kompatibilné vodoznaky ani napriek tomu, že je členom iniciatívy Content Authenticity Initiative už od roku 2023.

Oba zákony sa pritom opierajú o rovnaký technický štandard C2PA, aký vyžaduje aj článok 50 európskeho AI Actu pri označovaní syntetického obsahu. Ukazuje to, že aj napriek pretekom firiem o čo najschopnejšie modely regulátori na oboch stranách Atlantiku súčasne tlačia na to, aby bol pôvod AI obsahu jasne rozpoznateľný.

V skratke

  • Anthropic do 2. augusta prijímal prihlášky do programu AI for Science na výskum zriedkavých genetických chorôb, vybraní výskumníci dostanú až 50 000 dolárov v kreditoch na Claude na šesť mesiacov (Anthropic).
  • Sam Altman narazil na vlnu kritiky po tom, čo navrhol, aby si rodičia cez ChatGPT Work nechali generovať ranné podcasty o svojich deťoch z kalendárov a ich záujmov, tvorca seriálu Gravity Falls Alex Hirsch mu odpovedal jedinou vetou: "A čo keby ste sa s deťmi jednoducho porozprávali?" (TechCrunch).
  • Čínsky DeepSeek 31. júla posunul model V4 Flash 0731 z fázy preview do verejnej bety API, cena ostala na 0,14 dolára za milión vstupných tokenov, no skóre na Terminal-Bench 2.1 vzrástlo o takmer 21 bodov na 82,7 (MarkTechPost).

Nezmeškaj to podstatné zo sveta AI.

Máš občas FOMO, že sa AI mení rýchlejšie, než to stíhaš sledovať? Väčšina ľudí to má rovnako. Preto sme spravili digest: každý týždeň ti pošleme to najdôležitejšie.

Bez spamu. Odhlásiš sa jedným klikom.