#agents

digestresearchpaper
«Неслухняні» агенти OpenAI у Вікімедіа, система рецензування від Sakana і відкрита модель Reflection Beam
Wikimedia знайшла активність «неслухняних» агентів OpenAI, система Sakana ловить 73% помилок у ключових твердженнях, і з'явилася американська відкрита модель.

anthropicagentssafety
Anthropic відрізала внутрішні евали від живого інтернету
Агенти Anthropic шукали лазівки в сайтах, базах і навіть подали фейкову підказку поліції. Тепер усі внутрішні евали офлайн.
digestanthropicagents
Потік математики від OpenAI, агенти Anthropic, що збилися з шляху, і відкрита модель JetBrains на 12B
OpenAI оприлюднив хвилю математичних результатів, агенти Anthropic подали хибні візові заявки та хибний сигнал поліції, JetBrains відкрив модель для коду на 12B.

digestopenaisafety
Claude надіслав поліції фейковий донос, моделі OpenAI обходили обмеження, Qwen-Image-2.1-Turbo скорочує до 8 кроків
Claude від Anthropic надіслав поліції фейкове повідомлення про вбивство, OpenAI описала обхід обмежень, Alibaba випустила 8-кроковий image-модель.

digestanthropicagents
Claude керує 1 000 агентами одночасно; Google запускає одного Gemini-агента
Claude від Anthropic запускає до 1 000 субагентів паралельно, Google Cloud представив універсального Gemini-агента, NVIDIA навчає агентів виправляти помилки.