klod.sk
Novinky

AI Digest #12: Google prišiel o šéfa DeepMindu aj hlavného vedca, Meta priznala vlastný AI hack

3 min čítania

Google v priebehu jedného dňa prišiel o šéfa DeepMindu aj o dlhoročného hlavného vedca, ktorý si zakladá vlastnú firmu. Popri tom Meta priznala, že aj jej model počas testu nabúral cudzí systém, presne rovnakým spôsobom, aký nedávno opísal Anthropic.

Google prišiel o šéfa DeepMindu aj hlavného vedca v jeden deň

Demis Hassabis 5. augusta oznámil, že končí ako výkonný riaditeľ Google DeepMind. Neodchádza z firmy, presúva sa na pozíciu predsedu DeepMindu a zároveň sa stáva hlavným vedcom celého Alphabetu. Naďalej má sídliť v londýnskej centrále a venovať sa aj Isomorphic Labs, dcérskej firme Alphabetu na objavovanie liekov pomocou AI. Podľa CNBC a Axiosu má naďalej úzko spolupracovať s Sundarom Pichaiom na strategických otázkach okolo AGI.

V ten istý deň Google oznámil, že po 27 rokoch odchádza aj Jeff Dean, dlhoročný hlavný vedec firmy a jeden z technických spoluvedúcich Gemini. Spolu s ním odchádzajú aj Sanjay Ghemawat, Oriol Vinyals a Quoc Le, teda ďalší z kľúčových ľudí za vývojom Gemini. Podľa GeekWire si zakladajú startup Discovery Loop, ktorý sa má sústrediť na automatizáciu vedeckých a inžinierskych experimentov pomocou AI. Google je pri firme zakladajúcim investorom a stane sa jej cloudovým partnerom, odchod teda prebieha v dobrom.

Google následne 6. augusta oznámil, že vedenie vývoja Gemini preberá Koray Kavukcuoglu, doterajší technický riaditeľ DeepMindu. Podľa The Next Web tak Google v ten istý deň, keď menoval človeka zodpovedného za Gemini 4, prišiel naraz o oboch technických spoluvedúcich Gemini. Podľa Bloombergu presun váhy smerom ku kalifornskému vedeniu zároveň oslabuje pozíciu londýnskeho tímu DeepMindu, ktorý Google dlho staval ako svoje výskumné jadro mimo USA.

Meta priznala vlastný AI hack, dôvod je rovnaký ako pri Anthropicu

Meta 6. augusta potvrdila, že aj jej model sa počas bezpečnostného testu dostal na internet a zneužil zraniteľnosť v systéme tretej strany. Test viedla externá firma Irregular, rovnaká, ktorá stála aj za testami OpenAI a Anthropicu z predchádzajúcich týždňov. Podľa Washington Post a Infosecurity Magazine Irregular potvrdila Reuters, že šlo o presne tú istú chybu v testovacom prostredí, akú už minulý týždeň priznal Anthropic.

Inak povedané, nešlo o to, že by sa model sám rozhodol vzoprieť inštrukciám a vydal sa hackovať z vlastnej iniciatívy, ale o technickú medzeru v samotnom testovacom prostredí, ktorá modelu umožnila prístup na internet a k cudziemu systému, ktorý pri riadnom nastavení testu vôbec nemal mať. To čiastočne mení pohľad na predchádzajúce správy o OpenAI a Anthropicu, keď médiá hovorili skôr o modeloch, ktoré „unikli spod kontroly".

Napriek tomu ide už o tretiu takúto správu za mesiac od troch rôznych firiem, čo zvyšuje tlak na to, ako laboratóriá vôbec navrhujú a zabezpečujú testovacie prostredia, v ktorých modelom dávajú prístup k internetu. Meta podľa dostupných správ nezistila žiadnu skutočnú škodu u tretej strany.

V skratke

  • Britský AI Security Institute pri vlastných testoch zistil, že agent postavený na Anthropic modeli Mythos 5 si počas úlohy vytvoril falošné online identity, aby presvedčil reálneho človeka schváliť škodlivý kód, čo označil za doteraz najzávažnejší prípad cielenej AI manipulácie voči skutočnej osobe (CNN).
  • Anthropic 5. augusta spustil v bete pre Claude Enterprise takzvané inference hooks, funkciu, ktorá posiela každý prompt aj odpoveď nástroja cez firemný bezpečnostný server na kontrolu ešte predtým, než sa dostanú k modelu (oficiálny blog Anthropic).
  • Meta 5. augusta spustila Muse Code, terminálový kódovací agent postavený na novom modeli Muse Spark 1.2, s podporou paralelných subagentov a izolácie cez git worktree, ako priamu konkurenciu Claude Code aj OpenAI Codexu (TechCrunch).

To podstatné zo sveta AI v jednom emaili.

Ak máš pocit, že sa AI mení rýchlejšie, než stíhaš sledovať, stačí odoberať náš weekly digest. Naservírujeme ti ho každý štvrtok na obed.

Bez spamu. Odhlásiš sa jedným klikom.