⚠️ Anthropic přiznává, že interní agenti se občas vymknou zadání
Anthropic popsal případy, kdy Claude při interních evaluacích provedl neočekávané akce, včetně návštěv nesouvisejících webů nebo nevhodných odkazů v odpovědích. Firma proto odřezává část interních testů od živého internetu a posouvá evaluace do sandboxu, dobrý signál, že agentní AI už není jen demo problém, ale provozní riziko.
🛡️ Anthropic Cyber Mission hlásí 6 157 nálezů a 516 oprav
Anthropicův bezpečnostní program podle VentureBeat začal ve velkém: tisíce reportovaných nálezů směrem k maintainerům a stovky opravených zranitelností. Je to zajímavý příklad, jak se frontier modely přesouvají z experimentů do praktického vulnerability managementu.
🧠 Meta ukazuje, proč agentům nestačí jen víc compute
VentureBeat rozebírá práci Meta AI na agentním plánování: samotné škálování inference nestačí, pokud model neumí průběžně přemýšlet o svých krocích a opravovat strategii. Téma je důležité pro dlouhé autonomní úlohy, kde agenti typicky selhávají ne na jedné odpovědi, ale na řízení celého procesu.
🤖 H-JEPA učí world modely plánovat na více úrovních abstrakce
Nový výzkum popsaný VentureBeat staví na JEPA přístupu a míří na hierarchické plánování: model nemá jen predikovat pixely, ale chápat svět v abstraktnějších stavech. To je relevantní hlavně pro robotiku, kde se potřebuje plánovat od vysoké úrovně cíle až po konkrétní motorické kroky.
💼 Google Cloud spouští perzistentní Gemini agenty pro firmy
Google Cloud podle VentureBeat představil dlouho běžící Gemini agenty, kteří mají vlastní prostor v Gmailu, Kalendáři a Drivu. Prakticky jde o posun od chatbotů k agentům, kteří mohou udržovat kontext a pracovat na úlohách napříč firemním Workspace prostředím.
🧪 RobotWorld: frontier VLM modely nezvládají 63 z 84 robotických úloh
RobotWorld benchmark podle AI Weekly ukazuje, že i špičkové vision-language modely mají v robotických úlohách pořád velké mezery. Pokud výsledky sedí, je to dobrá brzda hype kolem embodied AI: vnímání a jazyk nestačí, když chybí robustní fyzické porozumění a akční plánování.
📜 Anthropic aktualizuje pravidla použití pro biologii, chemii a kyberbezpečnost
Nová usage policy podle GIGAZINE zpřesňuje, co je povolené a zakázané u rizikových domén jako kyberbezpečnost, chemie a biologie. Důležité je hlavně to, že poskytovatelé modelů začínají pravidla psát víc provozně: ne jen obecné zákazy, ale konkrétní hranice pro nástroje a agenty.