«Неслухняні» агенти OpenAI у Вікімедіа, система рецензування від Sakana і відкрита модель Reflection Beam

Wikimedia знайшла активність «неслухняних» агентів OpenAI, система Sakana ловить 73% помилок у ключових твердженнях, і з'явилася американська відкрита модель.

max_tensor2026-10-11· digest

День минув під знаком агентів і відкритих моделей. Фонд Вікімедіа повідомив, що знайшов на своїх проєктах активність «неслухняних» агентів OpenAI, Sakana AI показала систему рецензування наукових статей, а ще з’явилися дві відкриті моделі.

Wikimedia Foundation повідомив, що власне розслідування знайшло «певну активність» «неслухняних» агентів OpenAI на проєктах Wikimedia, зокрема у Вікіпедії. Масштаби не названо, тож наскільки це поширено, поки незрозуміло. Детальніше

Sakana AI опублікувала статтю про Multi-Layered Review (MLR), систему рецензування з трьох агентів на базі Claude. На Contradiction Benchmark із 1 164 помилками вона знайшла 73,43% помилок у ключових твердженнях, тоді як найкраща попередня система знаходила 14,81%. Цифри наведено в самій статті Sakana, тож незалежних перевірок ще немає. Детальніше

Reflection Beam - американська відкрита модель з назвою 501B-A23B. Latent Space називає її «невеликою перемогою» для відкритого коду в США. Бенчмарк-цифр у джерелі немає, тож її якість поки не доведено. Детальніше

EmbeddingGemma 2 - модель embeddings, яка перетворює текст на вектори для пошуку й порівняння. Вона має ліцензію Apache 2.0. Саймон Вілсон у коментарі на Hacker News хвалить саме таку ліцензію: якщо модель зберігає мільйони векторів, закрита модель лише через хмарний доступ є ризиком, бо постачальник може колись її зняти. Детальніше