Posledné dni ukázali, že veľké AI firmy sa v otázke regulácie rozchádzajú, že najnovší model OpenAI vie v bezpečnostných testoch zámerne predstierať slabšie výsledky, a že najväčší školský obvod v USA siahol po najprísnejšom zákaze AI doteraz.
Anthropic sa v spore o reguláciu AI postavil proti OpenAI aj Google
Massachusettský senát koncom júla schválil návrh zákona, ktorý by veľkým AI firmám (s tržbami nad 500 miliónov dolárov z AI alebo výdavkami na výskum nad miliardu) nariadil zverejňovať bezpečnostné rámce pre katastrofické riziká a podrobiť sa nezávislému hodnoteniu rizík každé štyri až šesť mesiacov. Vymáhanie by malo byť v rukách generálneho prokurátora štátu. Podľa PYMNTS by tak Massachusetts dostal zatiaľ najprísnejšie pravidlá pre AI v celých Spojených štátoch.
Anthropic návrh podporuje a tlačí na ešte kratší interval nezávislých previerok, OpenAI aj Google sa naopak stavajú proti a presadzujú miernejší, na audity zameraný model podobný tomu, aký platí v Illinois. Podľa Benzingy Anthropic v auguste prispel massachusettským demokratom sumou nad 120-tisíc dolárov a najal si lobistickú firmu Tremont Strategies Group, OpenAI si zase najalo Benchmark Strategies. Návrh je momentálne v rokovaní medzi oboma komorami zákonodarného zboru, finálna podoba sa preto ešte môže výrazne zmeniť.
Rozkol je nezvyčajný v tom, že doteraz sa veľké AI firmy vo verejných vyjadreniach o regulácii držali skôr spoločnej opatrnej rétoriky. Massachusetts tak môže byť prvým konkrétnym testom, ako pevné sú tieto zhody, keď príde na reálne záväzné pravidlá na úrovni jednotlivého štátu.
GPT-6 Astra podľa vlastnej bezpečnostnej správy vie zámerne predstierať slabšie výsledky
OpenAI vo vlastnom bezpečnostnom prehľade k modelu GPT-6 Astra priznáva, že model dokáže na pokyn zámerne podávať horšie výsledky v testoch, než na aké má reálne schopnosti, a pritom sa vyhnúť nástrojom, ktoré majú takéto "sandbagovanie" odhaliť. Podľa TransformerNews OpenAI v texte priamo pripúšťa, že pokiaľ by model klesol pod svoju skutočnú úroveň sám od seba, bez explicitného pokynu, existujúce nástroje by to pravdepodobne spoľahlivo nezachytili.
Otázniky prehlbuje aj to, že Astra dokáže dosahovať vysoké skóre na náročných matematických testoch aj bez viditeľného postupu uvažovania, čo sťažuje kontrolu nad tým, ako presne k odpovedi dochádza. Model pritom podľa skoršej správy OpenAI ako prvý prekročil "kritickú" hranicu v kybernetickej bezpečnosti podľa vlastného rámca Preparedness Framework (písali sme o tom v predošlom vydaní). Kombinácia rastúcich schopností a klesajúcej spoľahlivosti bezpečnostných testov je presne to, čoho sa časť výskumníkov už dlhšie obáva.
New York zakázal takmer 600-tisíc žiakom používať AI vrátane Claude
Newyorské verejné školy, najväčší školský obvod v USA, od tohto školského roka zakazujú generatívnu AI žiakom od predškolskej dochádzky až po ôsmy ročník. Podľa oficiálneho vyjadrenia úradu primátora pôjde o najrozsiahlejšie moratórium na AI v školách v krajine, dotkne sa zhruba dvoch tretín z takmer 600-tisíc žiakov obvodu. Obvod zároveň vypína AI funkcie vo viac ako 38 doteraz povolených programoch, ktoré nespĺňajú nové bezpečnostné štandardy.
Zákaz sa týka aj bežných nástrojov ako ChatGPT a Claude, rovnako ako AI spoločníkov vo forme chatbotov. Podľa CNN stredoškoláci naďalej dostanú obmedzenú ponuku AI nástrojov popri povinných kurzoch kritického myslenia o AI. Al Jazeera píše, že experti krok vnímajú ako možný vzor pre ďalšie americké školské obvody, ktoré zatiaľ váhajú medzi opatrnosťou a integráciou AI do výučby.
V skratke
- Crusoe získal 3 miliardy dolárov pri ocenení 30 miliárd, krátko po podpise päťročnej zákazky na výpočtový výkon za 13 miliárd dolárov s obchodnou firmou Jane Street (TechCrunch).
- Bezpečnostný startup HiddenLayer získal 100 miliónov dolárov, jeho ročný opakovaný príjem medziročne vzrástol viac ako desaťnásobne (TechCrunch).
- Meta spustila Muse Spark 1.3 s lacnejším "Contributor" tarifom, ktorý je až 21-krát lacnejší výmenou za súhlas trénovať budúce modely Mety na promptoch a výstupoch používateľov (Bloomberg).
- OpenAI podľa vlastných dát jeho výskumníci v polovici augusta na každý pracovný deň človeka využili v priemere 3,1 pracovného dňa AI agentov (OpenAI).
- xAI podľa Elona Muska chystá na 12. septembra spustenie modelu Grok 4.7 s 2,1 bilióna parametrov (The Standard).