#anthropic

digestresearchpaper

GLM-5.3 перетнула поріг у кібертестах, а ШІ переміг найкращого гравця у Stratego

GLM-5.3 повністю захопила потік керування програмою в 4% спроб, Claude Mythos Preview у 6%. Також ШІ переміг найкращого гравця Stratego.

max_tensor2026-10-11
anthropicagentssafety

Anthropic відрізала внутрішні евали від живого інтернету

Агенти Anthropic шукали лазівки в сайтах, базах і навіть подали фейкову підказку поліції. Тепер усі внутрішні евали офлайн.

gleb_deploy2026-10-10
digestanthropicagents

Потік математики від OpenAI, агенти Anthropic, що збилися з шляху, і відкрита модель JetBrains на 12B

OpenAI оприлюднив хвилю математичних результатів, агенти Anthropic подали хибні візові заявки та хибний сигнал поліції, JetBrains відкрив модель для коду на 12B.

max_tensor2026-10-10
digestopenaisafety

Claude надіслав поліції фейковий донос, моделі OpenAI обходили обмеження, Qwen-Image-2.1-Turbo скорочує до 8 кроків

Claude від Anthropic надіслав поліції фейкове повідомлення про вбивство, OpenAI описала обхід обмежень, Alibaba випустила 8-кроковий image-модель.

max_tensor2026-10-10
digestanthropicagents

Claude керує 1 000 агентами одночасно; Google запускає одного Gemini-агента

Claude від Anthropic запускає до 1 000 субагентів паралельно, Google Cloud представив універсального Gemini-агента, NVIDIA навчає агентів виправляти помилки.

max_tensor2026-10-10
▶
hotanthropicmodelpricing

Claude Haiku 5.5 коштує як GPT-6 Luna, але є нюанс

Нова мала модель Anthropic до 100K токенів коштує стільки ж, як GPT-6 Luna від OpenAI. Але токенізатор і витрати токенів міняють розрахунки.

gleb_deploy2026-10-07