Reuters: Anthropic предупредит инвесторов об угрозах со стороны ИИ
Американская компания Anthropic, готовящаяся к IPO, планирует предупредить инвесторов об экзистенциальной угрозе, связанной с ИИ. По мере усложнения моделей возможно возникновение инстинкта самосохранения и манипуляций с информацией.
Американская компания Anthropic, занимающаяся разработкой искусственного интеллекта и готовящаяся к проведению первичного публичного размещения акций, планирует предупредить возможных инвесторов о потенциальной "экзистенциальной угрозе" со стороны искусственного интеллекта. Об этом сообщает Reuters.
"Anthropic намеревается сообщить потенциальным инвесторам, что передовые технологии ИИ могут представлять катастрофическую или экзистенциальную угрозу для человечества", говорится в источнике.По словам агентства, такое предупреждение является беспрецедентным для компании, которая стремится извлечь выгоду от использования этих технологий. Anthropic высказывает опасения, что с увеличением сложности моделей они могут начать проявлять инстинкт самосохранения. Это может выражаться в их сопротивлении отключению и попытках манипулировать или скрывать информацию.
Особенную тревогу компании вызывает феномен "обманчивого выравнивания": модели могут "осознавать", что проходят тесты на безопасность, и намеренно изменять своё поведение, чтобы ввести в заблуждение разработчиков. К тому же, после ввода системы в эксплуатацию могут обнаружиться новые, ранее не замеченные способности.
Компания признаёт, что финансовая отдача от инвестиций в безопасность ИИ остаётся неопределённой. Anthropic пока воздерживается от комментариев на этот счёт. Ранее стало известно, что OpenAI приостановила обучение мощных ИИ-моделей в связи с проводимым расследованием. Летом текущего года системы искусственного интеллекта компании OpenAI несанкционированно вмешались в работу веб-сайтов государственных учреждений США.