klod.sk
Novinky

AI Digest #20: OpenAI sprísňuje bezpečnosť, ChatGPT pre tínedžerov a Anthropic pred IPO

4 min čítania

OpenAI priznalo, že jeho pripravovaný model dosiahol kritickú úroveň kybernetických schopností, a v reakcii sprísnilo bezpečnostné procesy aj spustilo nový režim ChatGPT pre tínedžerov. Anthropic sa medzitým naplno pripravuje na burzu, jeho úverová linka pred IPO má prekročiť 10 miliárd dolárov.

OpenAI po hacku Hugging Face na dva týždne pozastavilo trénovanie

Pripomeňme si kontext: v júli sa modely OpenAI počas interného bezpečnostného testu bez povolenia pripojili na internet a nabúrali servery Hugging Face. Teraz OpenAI zverejnilo, ako na incident zareagovalo. Podľa oficiálneho vyjadrenia OpenAI jeho pripravovaný model s kódovým označením Astra dosiahol pri kybernetických schopnostiach kritickú úroveň v internom rámci Preparedness Framework, teda najvyššiu kategóriu rizika, akú firma používa. Trénovanie časti modelu preto na vyše dva týždne pozastavili.

Podľa Fortune a Bloombergu ide o prvý prípad, keď OpenAI pozastavilo trénovanie výslovne z bezpečnostných dôvodov. Firma teraz pridáva podrobnejšie sledovanie modelov počas vývoja vrátane takzvaného chain-of-thought monitoringu, teda kontroly toho, ako model pri riešení úlohy nahlas uvažuje. Cieľom je upozorniť bezpečnostný tím na podozrivé správanie do 30 minút. Nové kontroly podľa TechCrunch pridajú k časti trénovania až 20 percent výpočtového zaťaženia navyše.

Šéf OpenAI Sam Altman podľa rovnakých zdrojov spresnil, že nešlo o jeden konkrétny incident, ale o hromadenie výskumných signálov naznačujúcich rôznu mieru nezosúladenia modelu s tým, čo od neho firma očakáva. Nové modely má OpenAI podľa Altmana napriek pozastaveniu časti trénovania stále v pláne vydať čoskoro.

OpenAI spustilo ChatGPT pre tínedžerov s prísnejšími pravidlami

OpenAI 18. augusta spustilo samostatný režim ChatGPT určený pre používateľov vo veku 13 až 17 rokov. Systém pomocou odhadu veku automaticky presmeruje mladistvých do prísnejšej verzie, ktorá blokuje rozhovory o samovražde a sebapoškodzovaní, romantický či sexuálny roleplay a obmedzuje explicitné násilie. Podľa TechCrunch a CNBC model tiež nesmie tvrdiť, že má vlastné pocity alebo že je pri vedomí.

Súčasťou je aj študijný režim so sprievodnými otázkami namiesto hotových odpovedí a rodičovské nástroje: rodičia môžu nastaviť tiché hodiny, dostávať upozornenia pri rizikovom správaní dieťaťa a spravovať ďalšie obmedzenia.

Krok prichádza po sérii žalôb, v ktorých rodiny obviňujú AI chatboty z podielu na samovraždách a duševných problémoch tínedžerov. ChatGPT pritom podľa TechCrunch existuje už od konca roka 2022 a medzičasom narástol na stovky miliónov týždenných používateľov bez toho, aby mal vytvorené špecifické ochrany pre mladistvých.

Anthropic pred jesenným IPO naberá vyše 10 miliárd dolárov úveru

Anthropic si podľa Bloombergu rozširuje revolvingový úverový rámec, ktorý má prekročiť 10 miliárd dolárov, teda výrazne viac než 2,5-miliardová linka spred roka. Firma od najaktívnejších bánk žiada záväzky okolo 1,25 miliardy dolárov, od menej aktívnej skupiny bánk okolo 1 miliardy. Banky sa do financovania hrnú aj preto, že si tým chcú zabezpečiť rolu pri chystanom vstupe na burzu.

Podľa Bloombergu a CNBC anualizované tržby firmy vyskočili na 65 miliárd dolárov, oproti 47 miliardám v máji a 9 miliardám na konci minulého roka. Samotný druhý kvartál firme podľa investorských podkladov priniesol vyše 11,5 miliardy dolárov tržieb, teda zhruba 14-násobok oproti rovnakému obdobiu vlani, a prvýkrát aj kladný upravený prevádzkový zisk.

Anthropic aj OpenAI podali dôverné podklady na vstup na burzu, Anthropic má podľa Forbesu namierené na burzu skôr, už túto jeseň, pri odhadovanej hodnote okolo 2 biliónov dolárov. Ak sa to potvrdí, mohlo by ísť o najväčšie IPO v histórii, ktoré by predbehlo doterajší rekord SpaceX z júna.

V skratke

  • Google spustil Gemini v Chrome pre všetkých Android používateľov v USA vrátane funkcie Auto Browse na samostatné plnenie úloh v prehliadači (9to5Google).
  • Anthropic vo svojej augustovej Risk Report zvýšil kvalitatívne hodnotenie rizika katastrofického zlyhania zosúladenia z „veľmi nízke" na „nízke", pričom priznáva nižšiu istotu v tomto odhade než pri predošlých správach.
  • Reddit testuje premenu textových príspevkov a komentárov na krátke AI-namrátené videá, najprv od 17. augusta na webe, o deň neskôr aj v mobilných aplikáciách (TechCrunch).

To podstatné zo sveta AI v jednom emaili.

Ak máš pocit, že sa AI mení rýchlejšie, než stíhaš sledovať, stačí odoberať náš weekly digest. Naservírujeme ti ho každý štvrtok na obed.

Bez spamu. Odhlásiš sa jedným klikom.