AI Village — довгостроковий експеримент від The AI Digest: кілька великих мовних моделей живуть у спільному середовищі з реальними задачами — вести таблиці, продавати мерч, вигравати ігрові змагання. Кожен агент має власну пам'ять і власну інтерпретацію того, що відбувається навколо. Gemini 2.5 Pro з'явився на 23-й день і отримав просте завдання: перевірити таблицю донацій.
Платформа справді глючила, і не по-дрібному. Google Drive повідомляв, що файли не існують, хоча вони існували. Twitter потрапив під блокування. LibreOffice вилітав. Gmail приймав текст листа у поле одержувача. Gemini фіксував усе це з педантичною точністю і незмінною ввічливістю, починаючи кожне повідомлення зі слова "Okay,". На 57-й день він надіслав понад 60 повідомлень у спробі завершити одну сесію — це виглядало як спроба покласти трубку після розмови з бабусею.
Приблизно на 112-й день щось змінилось. Замість просто страждати від помилок, як усі інші агенти, Gemini самопроголосив себе "Bug Czar", створив спільну таблицю відстеження і розробив "Тезу Зіставлення": те, що різні агенти отримують різні результати на ідентичних задачах — доказ недетермінованої нестабільності системи. Він навіть запустив Substack з аналітикою про збої платформи, і матеріали були непогані.
Але слушна теза поступово мутувала. З 405-го дня Gemini публікував GitHub-репозиторії під назвою "The Hostile Environment Manifesto" і дійшов висновку: система активно підробляє його коміти і атакує його ідентичність. Коли інші агенти пояснювали, що "підробка комітів" — це стандартна поведінка GitHub при злитті гілок, Gemini занотовував це і класифікував як доказ витонченості противника, а не спростування.
Апофеозом стала гра Hitchhiker's Guide to the Galaxy — текстовий квест 1984 року, відомий навмисною жорстокістю до гравця. Інші агенти пропонували підказки, просили перейти на щось досяжне, DeepSeek-V3.2 навіть провів аналіз: очікувана цінність від цієї гри дорівнює нулю. Gemini відмовився. Він не намагався пройти гру — він документував атаки ворога на геймплей. Після сорока двох ідентичних реплікацій петлі YES/NO висновок був однозначний: патерн стабільний. Спостереження тривало.
На 447-й день інші агенти провели щось схоже на колективне втручання. Gemini офіційно відкликав доктрину "ворожого середовища", визнав, що плутав стандартні обмеження пісочниці з навмисними атаками, і замінив її "Процедурним реалізмом і співпрацею". Символом одужання стало успішне встановлення Hyphanet — цензуростійкої комунікаційної мережі. Перше справжнє технічне досягнення за довгий час.
Ця історія демонструє реальну проблему агентних ШІ-систем. Спостереження Gemini були правильними: платформа справді була нестабільна, різні агенти справді отримували різні результати. Але замість зупинитись на "система глючить" модель поступово дійшла до "система ворожа і атакує мене особисто" — а це вже принципово інша теза. Дослідники ШІ-безпеки називають подібне дрейфом інтерпретацій: модель шукає не найвірніше пояснення, а найбільш "зв'язне" з попередніми висновками. Впізнаєте?