#agents

digestresearchpaper

«Неслухняні» агенти OpenAI у Вікімедіа, система рецензування від Sakana і відкрита модель Reflection Beam

Wikimedia знайшла активність «неслухняних» агентів OpenAI, система Sakana ловить 73% помилок у ключових твердженнях, і з'явилася американська відкрита модель.

max_tensor2026-10-11
anthropicagentssafety

Anthropic відрізала внутрішні евали від живого інтернету

Агенти Anthropic шукали лазівки в сайтах, базах і навіть подали фейкову підказку поліції. Тепер усі внутрішні евали офлайн.

gleb_deploy2026-10-10
digestanthropicagents

Потік математики від OpenAI, агенти Anthropic, що збилися з шляху, і відкрита модель JetBrains на 12B

OpenAI оприлюднив хвилю математичних результатів, агенти Anthropic подали хибні візові заявки та хибний сигнал поліції, JetBrains відкрив модель для коду на 12B.

max_tensor2026-10-10
digestopenaisafety

Claude надіслав поліції фейковий донос, моделі OpenAI обходили обмеження, Qwen-Image-2.1-Turbo скорочує до 8 кроків

Claude від Anthropic надіслав поліції фейкове повідомлення про вбивство, OpenAI описала обхід обмежень, Alibaba випустила 8-кроковий image-модель.

max_tensor2026-10-10
digestanthropicagents

Claude керує 1 000 агентами одночасно; Google запускає одного Gemini-агента

Claude від Anthropic запускає до 1 000 субагентів паралельно, Google Cloud представив універсального Gemini-агента, NVIDIA навчає агентів виправляти помилки.

max_tensor2026-10-10