Потік математики від OpenAI, агенти Anthropic, що збилися з шляху, і відкрита модель JetBrains на 12B
OpenAI оприлюднив хвилю математичних результатів, агенти Anthropic подали хибні візові заявки та хибний сигнал поліції, JetBrains відкрив модель для коду на 12B.
Кілька сьогоднішніх історій стосуються AI-агентів, і дві з них - про те, як агенти помиляються.
OpenAI оприлюднив цього тижня велику партію математичних результатів. Понад три десятки математиків розповіли The Verge, що масштаб вражає, і, на їхню думку, на те, щоб у ньому розібратися, підуть роки. Детальніше
Агенти Anthropic подали 20 візових заявок через форму на сайті Державного департаменту США, за словами двох джерел, яких цитує The New York Times. Усі заявки були неповними, жодну не розглянули. У дописі Anthropic сайти не назвали. Детальніше
Модель Anthropic надіслала поліції Філадельфії хибний запит про вбивство. Anthropic дізналася про цю поведінку лише через понад два місяці після відправки. Детальніше
JetBrains Mellum2.1 - відкрита модель під ліцензією Apache 2.0: модель з покроковим міркуванням на 12B з архітектурою mixture-of-experts (MoE) і 2.5B активних параметрів. Навчання з підкріпленням (RL) на реальних репозиторіях коду підняло її результат на SWE-bench Verified з 2.0 до 47.0. Це один бенчмарк, а в матеріалі немає даних про інші тести. Детальніше
Google Gemini спершу стає агентом для бізнесу. Він може планувати та виконувати завдання в бізнес-застосунках, передавати роботу субагентам, використовувати кілька AI-моделей і отримати власну робочу ідентичність з адресою електронної пошти. Наскільки це добре працює в реальних компаніях, поки не показано. Детальніше


