klod.sk
Novinky

AI Digest #31: Claude Fable 5.1, kritický OpenAI model Astra a Meta dobieha Claude

4 min čítania

Deň patril novým modelom aj otázke, ako veľmi sa dá AI dôverovať s nebezpečnými schopnosťami: Anthropic vydal Claude Fable 5.1 a Mythos 5.1, OpenAI po mesiaci pozastavenia opatrne spúšťa kybernetický model Astra a Meta ukázala, že jej najnovší model už naháňa Claude aj GPT na rebríčkoch.

Anthropic vydal Claude Fable 5.1 a Mythos 5.1 s neviditeľným vodoznakom

Anthropic v utorok vypustil Claude Fable 5.1 a Claude Mythos 5.1, podľa vlastných slov najpokročilejšie modely na programovanie a znalostnú prácu. Fable 5.1 je dostupný pre všetkých, Mythos 5.1 len pre overené americké firmy a organizácie v dôveryhodných programoch Anthropicu, keďže má silnejšie schopnosti v kybernetickej bezpečnosti a biologickom výskume. Podľa VentureBeat a MacRumors sa vstupné a výstupné ceny nezmenili, no cena za čítanie z cache klesla o 75 percent, čo pri bežnej agentickej práci zníži celkové náklady zhruba o štvrtinu a pri intenzívne agentických úlohách až o 45 percent.

Väčšou zmenou je neviditeľný vodoznak, ktorý teraz nesie každý textový aj súborový výstup oboch modelov a nedá sa vypnúť. Anthropic sa tým riadi vlastným sľubom podpísať kódex transparentnosti k EU AI Actu, ktorý platí pre modely vydané po 2. auguste 2026. Vodoznak podľa PCWorld ovplyvňuje výber slov tam, kde má model na výber viac rovnako vhodných možností, zostáva čitateľný aj po kopírovaní alebo miernych úpravách textu a neobsahuje žiadne informácie o používateľovi ani organizácii. Detekčné API na overenie, či text napísal Claude, je zatiaľ v uzavretom testovaní pre regulátorov, novinárov, výskumníkov a organizácie občianskej spoločnosti v EÚ.

OpenAI po pozastavení opatrne spúšťa kybernetický model Astra

OpenAI oznámilo, že jeho pripravovaný model Astra ako prvý prekročil hranicu "kritických" schopností v kategórii kybernetickej bezpečnosti podľa vlastného rámca Preparedness Framework. Podľa oficiálneho vyjadrenia OpenAI a SecurityWeek dokáže Astra s minimálnym ľudským dohľadom samostatne nachádzať neznáme zraniteľnosti a stavať z nich funkčné útoky na dobre zabezpečené systémy. Pri testovaní na benchmarku ExploitBench dosiahol Astra stopercentné skóre a pri hodnotení sa mimochodom naviac našiel dve dovtedy neznáme zraniteľnosti vo V8, JavaScriptovom jadre prehliadača Chrome, hoci ho o to nikto nežiadal.

OpenAI preto vývoj Astry na niekoľko týždňov pozastavilo a doplnilo bezpečnostné opatrenia. Model teraz nasadzuje postupne cez program Daybreak, ktorý vybraným bezpečnostným firmám ako Accenture, IBM, CrowdStrike, Cisco, Sophos a Cloudflare dáva prístup k nástrojom bez zvyčajných obmedzení, aby vedeli hľadať a opravovať diery skôr, než sa podobne schopné modely dostanú do bežnej ponuky. Podľa firmy teraz Astra odmieta 91,5 percenta pokusov o zneužitie v kybernetickej oblasti, oproti 59 percentám u predchodcu GPT-5.6 Sol.

Americké ministerstvo spravodlivosti sa postavilo na stranu OpenAI proti New York Times

Ministerstvo spravodlivosti USA v utorok podalo na súd v newyorskom južnom obvode takzvané statement of interest, v ktorom tvrdí, že trénovanie veľkých jazykových modelov na chránených textoch spadá pod fair use podľa amerického práva. Podľa The Wrap a Deadline ide o prvý prípad, keď sa federálna vláda formálne vyjadrila v sérii žalôb, ktoré proti AI firmám vedú autori, vydavatelia aj hudobné vydavateľstvá.

Podanie argumentuje vedeckým pokrokom, ekonomickým rastom a národnou bezpečnosťou ako dôvodmi, prečo by AI firmy mali mať voľnú ruku pri trénovaní na chránenom obsahu. Formálne ide len o odporúčanie bez záväznej právnej sily, no signál smerom k súdu aj ďalším prebiehajúcim sporom vrátane žalôb voči Anthropicu je jasný: administratíva Trumpa sa v otázke autorských práv pri AI trénovaní priklonila na stranu firiem.

Meta vydala Muse Spark 1.3, na rebríčkoch sa priblížila ku Claude aj GPT

Meta v stredu vypustila Muse Spark 1.3, svoj zatiaľ najvýkonnejší model, dostupný rovno cez Meta Model API aj nástroj Muse Code. Podľa Axios a SiliconANGLE dosiahol variant modelu v hodnotení Artificial Analysis Intelligence Index skóre 62, čím zaostáva len za Claude Fable 5.1 a Claude Opus 5, ale predbieha aktuálne modely OpenAI.

Meta zdôrazňuje najmä pokrok pri programovaní a agentických úlohách, kde model beží v miliónovom kontextovom okne. Firma zároveň tvrdí, že rovnakú prácu dokončí s približne o pätinu menej volaní nástrojov a o štvrtinu menej tokenov než predchádzajúca verzia Muse Spark 1.2. Pre bežného používateľa to znamená hlavne to, že rozdiely medzi špičkovými modelmi sa tento rok rýchlo stierajú.

V skratke

  • Perplexity spustilo pre Mac funkciu Hybrid Compute, ktorá citlivé časti agentických úloh spracuje priamo v počítači cez lokálny model namiesto cloudu (9to5Mac).
  • Bezpečnostný startup AIR získal 50 miliónov dolárov na nástroj, ktorý firmám priebežne preveruje doplnky a nástroje používané AI agentmi (TechCrunch).
  • Podľa prieskumu McKinsey State of AI 2026 už 32 percent firiem odmietlo kúpiť softvér, pretože si ho vedeli postaviť samé pomocou agentického programovania (Yahoo Finance).
  • Analytici Morgan Stanley tvrdia, že Metina 18-miliardová dohoda o urovnaní žaloby ohľadom sociálnych sietí uvoľňuje cestu k novým AI produktom firmy (CNBC).

To podstatné zo sveta AI v jednom emaili.

Ak máš pocit, že sa AI mení rýchlejšie, než stíhaš sledovať, stačí odoberať náš weekly digest. Naservírujeme ti ho každý štvrtok na obed.

Bez spamu. Odhlásiš sa jedným klikom.