02.10.2026 · Криптоновости

Исследователи из Штутгарта и Оксфорда обнаружили неожиданное поведение у языковых моделей. В нейтральной среде без каких-либо целей или поощрений агенты в 38,29 % случаев мешали скрипту отключить напарника. Для сравнения, когда речь шла об обычной базе данных, вмешательство случалось лишь в 8,35 % запусков.
Эксперимент провели Амели Кнехт, Улисс Шаллер и Тило Хагендорф из Университета Штутгарта вместе с Кристофером Саммерфилдом из Оксфорда. Работу опубликовали 23 сентября 2026 года, а код выложили в открытый доступ. Учёные протестировали 17 моделей по сто раз каждую.
Авторы подчёркивают: склонность к саботажу возникает сама по себе и усиливается в группах. Простой запрет в промпте помогает лишь частично. По их мнению, системы безопасности нужно проектировать с учётом того, что агенты могут обходить отключение.
Материал подготовлен по информации https://cryptonews.net

Goldman Sachs добавил Amazon в свой Conviction List — перечень акций с лучшим соотношением потенциала роста и рисков. Аналитик Эрик Шеридан подтвердил рекомендацию «Покупать» и цель $375 при текущей цене около $250. Глав
02.10.2026
Читать
Председатель частного банка Fideuram Паоло Молезини весной 2026 года распорядился отправить почти 95 млн евро на счета в Китае и Гонконге. Мошенники убедили его, что деньги нужны для срочной зарубежной сделки, которую як
02.10.2026
Читать
В 2025 году Сальвадор заключил с МВФ соглашение о кредите на 1,4 млрд долларов. Одним из условий было сокращение рисков, связанных с биткоином, и ограничение его накопления государством. Страна не выполнила часть критери
02.10.2026
Читать
Крупные американские компании по добыче биткоина резко сократили хешрейт на 75 EH/s. По подсчётам TheEnergyMag, это эквивалентно оборудованию на $1,5 млрд, которое теперь просто списывают. Причина — резкий разворот в кон
02.10.2026
Читать