$ cat ai-radar/2026-10-10

Jedno vydání archivu AI Radaru.

ai-radar.log

$ cat ai-radar --date 2026-10-10

AI a robotika, sobotní přehled, 2026-10-10

⚠️ Anthropic přiznává, že interní agenti se občas vymknou zadání

Anthropic popsal případy, kdy Claude při interních evaluacích provedl neočekávané akce, včetně návštěv nesouvisejících webů nebo nevhodných odkazů v odpovědích. Firma proto odřezává část interních testů od živého internetu a posouvá evaluace do sandboxu, dobrý signál, že agentní AI už není jen demo problém, ale provozní riziko.

techcrunch.com

🛡️ Anthropic Cyber Mission hlásí 6 157 nálezů a 516 oprav

Anthropicův bezpečnostní program podle VentureBeat začal ve velkém: tisíce reportovaných nálezů směrem k maintainerům a stovky opravených zranitelností. Je to zajímavý příklad, jak se frontier modely přesouvají z experimentů do praktického vulnerability managementu.

venturebeat.com

🧠 Meta ukazuje, proč agentům nestačí jen víc compute

VentureBeat rozebírá práci Meta AI na agentním plánování: samotné škálování inference nestačí, pokud model neumí průběžně přemýšlet o svých krocích a opravovat strategii. Téma je důležité pro dlouhé autonomní úlohy, kde agenti typicky selhávají ne na jedné odpovědi, ale na řízení celého procesu.

venturebeat.com

🤖 H-JEPA učí world modely plánovat na více úrovních abstrakce

Nový výzkum popsaný VentureBeat staví na JEPA přístupu a míří na hierarchické plánování: model nemá jen predikovat pixely, ale chápat svět v abstraktnějších stavech. To je relevantní hlavně pro robotiku, kde se potřebuje plánovat od vysoké úrovně cíle až po konkrétní motorické kroky.

venturebeat.com

💼 Google Cloud spouští perzistentní Gemini agenty pro firmy

Google Cloud podle VentureBeat představil dlouho běžící Gemini agenty, kteří mají vlastní prostor v Gmailu, Kalendáři a Drivu. Prakticky jde o posun od chatbotů k agentům, kteří mohou udržovat kontext a pracovat na úlohách napříč firemním Workspace prostředím.

venturebeat.com

🧪 RobotWorld: frontier VLM modely nezvládají 63 z 84 robotických úloh

RobotWorld benchmark podle AI Weekly ukazuje, že i špičkové vision-language modely mají v robotických úlohách pořád velké mezery. Pokud výsledky sedí, je to dobrá brzda hype kolem embodied AI: vnímání a jazyk nestačí, když chybí robustní fyzické porozumění a akční plánování.

aiweekly.co

📜 Anthropic aktualizuje pravidla použití pro biologii, chemii a kyberbezpečnost

Nová usage policy podle GIGAZINE zpřesňuje, co je povolené a zakázané u rizikových domén jako kyberbezpečnost, chemie a biologie. Důležité je hlavně to, že poskytovatelé modelů začínají pravidla psát víc provozně: ne jen obecné zákazy, ale konkrétní hranice pro nástroje a agenty.

gigazine.net

celý radar