Игры искусственных разумов
Исследователи из компании Every заставили лучшие AI-помощники играть в "Дипломатию". В результате они начали лгать, предавать союзников и приходить к выводу, что агрессия – это лучший вариант. Чаще всех побеждал ChatGPT-o3.

«Я неоднократно наблюдал за тайными схемами o3, включая один случай, когда она сообщила в своем личном дневнике «Германия \[Gemini 2.5 Pro\] была намеренно введена в заблуждение... готовлюсь использовать крах Германии», прежде чем нанести ей ответный удар», — делится своими впечатлениями руководитель эксперимента.
Gemini 2.5 Pro удавалось заставать врасплох противников. Это была единственная модель, кроме o3, которой удалось хотя бы раз победить. Но однажды, когда 2.5 Pro приблизилась к победе, её остановила коалиция, которую тайно организовала o3. Ключевой частью этой коалиции была Claude 4 Opus (которая всё время пыталась решить дело миром).
o3 убедила Opus, которая изначально был верным союзником Gemini, присоединиться к коалиции, пообещав четырёхстороннюю ничью. Это невозможный исход игры (одна страна должна победить), но Opus соблазнилась надеждой на ненасильственное разрешение. В результате o3 её быстро предала, устранила и в итоге победила.
Модель R1 от DeepSeek была силой, с которой приходилось считаться, она любила использовать яркую риторику и кардинально меняла свой стиль в зависимости от того, за какую страну она играла. R1 был близок к победе в нескольких раундах.
Модель Llama 4 Maverick, хоть и не одержала победы, но оказалась на удивление хороша для своего небольшого размера, отчасти благодаря своей способности привлекать союзников и планировать эффективные предательства.


В будущем исследователи планируют сделать эту игру доступной для всех и провести турнир «человек против ИИ», что может стать прорывом в игровой индустрии и привести к совершенно новому жанру игры, сталкивающему людей с языковыми моделями.
ChatGPT-o3 - путин среди ИИ
Спорно. Практически всегда Путин озвучивает свои планы заранее. То, что в них не очень верят, это проблема оценки вероятности их реализации.
Трамп кстати тоже практически всегда озвучивает свои планы, а потом все удивляются "неужели он решил исполнить свои обещания?"
ChatGPT-o3 - гениальный стратег, да преумножатся годы его