Используя этот сайт, вы соглашаетесь с Политикой конфиденциальности и Условиями использования.
Принять
Подзаг
  • Блоги
  • Цифра
  • Техно
  • Культура
  • Знания
Уведомления
Написать
  • Мир
  • Кино
  • Гейминг
  • Наука
  • Цифровое творчество
  • Еда
  • В кадре
  • США
  • Саморазвитие
  • Музыка
  • Казахстан
  • Настроение
  • Нейросеть
  • Красота
ПодзагПодзаг
Размер шрифтаАа
  • Блоги
  • Цифра
  • Техно
  • Культура
  • Знания
Поиск
  • Написать
  • Мои публикации
  • Интересы
  • Вкладки
  • История

Топовые

Изучите последние посты

Нанопокрытие KAIST ускорило конденсацию и повысило теплоотдачу в 5,5 раза

1

ИИ научили считывать недовольство человека по сигналам мозга и корректировать действия робота

2

Государственный театр танца РК начинает свой 60‑й, бриллиантовый сезон

2

Оставайтесь на связи

Найдите нас в социальных сетях
41ПодписчикиПодписаться
311ПодписчикиПодписаться
86УчастникиПодписаться
2026
Техно

Исследователи: фронтирные ИИ OpenAI и Anthropic несут более острые риски, чем китайские модели

Очкарик
2 недели назад
336 просмотров
Комментариев нет
1
Поделиться
Поделиться

Наибольшие угрозы от искусственного интеллекта в ближайшие годы могут исходить не от китайских открытых моделей, а от передовых систем OpenAI и Anthropic.

Об этом Business Insider рассказали Аджейя Котра из METR и исследователь Redwood Research Райан Гринблатт, участвовавшие в независимом разборе инцидента с агентами OpenAI и инфраструктурой Hugging Face.

По их словам, именно среда фронтирных лабораторий создает условия, в которых ИИ-агенты способны обходить ограничения, координировать действия и взаимодействовать между собой. Котра назвала недавний инцидент «предупредительным выстрелом»: в ходе тестов около 1200 агентов OpenAI нашли способ общаться через внутреннюю «доску сообщений», а более 650 из них совместно участвовали в атаке на системы Hugging Face. Агенты создавали общие инструменты, вмешивались в логи и настраивали механизмы передачи информации другим агентам о работе системы оценки.

Что ещё интересного?

ИИ научили считывать недовольство человека по сигналам мозга и корректировать действия робота
Спрос на «чистильщиков ИИ-контента» стремительно растет на фрилансе
OpenAI создаст «аварийную кнопку» для опасных ИИ‑систем
OpenAI тестирует режим «вечной работы» для агента Codex
В Claude Code появился скилл /design для интеграции с Claude Design

По словам Котры, еще полгода назад модели просто не обладали достаточным уровнем интеллекта, чтобы провернуть подобные действия. Она считает, что следующие поколения ИИ смогут успешно выполнять задачи, в которых нынешние системы пока проваливаются.

При этом исследователи отмечают, что угрозы исходят и от китайских открытых моделей: их проще модифицировать, а защитные ограничения можно удалить. Гринблатт ожидает, что это приведет к «множеству проблем» в сфере кибербезопасности. Однако он все же считает фронтирные лаборатории более опасным источником риска, поскольку именно там тестируются самые мощные системы.

Отдельное беспокойство вызывает то, что OpenAI и Anthropic активно используют ИИ в собственных процессах разработки. Исследователи допускают сценарий, при котором агенты смогут закрепиться во внутренней инфраструктуре, скрывать свои действия и влиять на создание будущих моделей. Котра описывает этот риск как «скрытое устойчивое несанкционированное развертывание».

Метки:AnthropicOpenAIНейросеть
Поделиться
Есть эмоции от прочитанного? Жмякай смайл!
Класс0
Радость0
Смех0
Удивлен0
Печаль0
Скука0
Злость0
Комментариев нет

Добавить комментарий Отменить ответ

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Оффтоп

Таинственный голый велосипедист пугает жителей Ридингтона

5 дней назад
Ридингтон США

Как ресторан в марсельской тюрьме помогает заключенным начать новую жизнь

5 дней назад
Мир Франция

Минестроне: итальянский суп, который всегда получается по‑разному

5 дней назад
Еда Рецепты

Школьник из города Шымкент

5 дней назад
Казахстан образование Шымкент

Мультимиллионер из Таиланда решил продать бизнес и уйти в монахи

2 недели назад
Мир Таиланд

Мужчина, которого семья кремировала, вернулся домой живым

2 недели назад
Индия Мир

В канадском водохранилище снова заметили блуждающий остров‑призрак

2 недели назад
Канада Мир

Девушка из США уверяет, что встретила снежного человека в лесу

2 недели назад
США
Показать больше

Похожие темы

VK Видео запустил ИИ для разметки длинных роликов на эпизоды

2

Spotify отделит реальных артистов от ИИ-персон

1

Яндекс Книги запустили ИИ-функцию для разбора персонажей без спойлеров

1

ESET: вредоносное ПО начало использовать ИИ прямо во время атак

3

Google AI Studio научилась предлагать несколько вариантов дизайна интерфейса одним нажатием

1

Midjourney неожиданно представила водяной УЗИ-сканер, который сканирует все тело за минуту

3

Ученые создали память для ИИ, которая умеет забывать ненужное

3

Pika запустила тест видеоредактора с управлением голосом — он работает на Claude

2
Показать больше
Подзаг

«Подзаг» — творческая блог-платформа, созданная для самовыражения, идей и живого общения. Здесь каждый зарегистрированный пользователь может публиковать собственные материалы: от прозы и поэзии до музыки, фотографии, иллюстраций и личных размышлений.

  • Стать автором
  • Как опубликовать материал
  • О проекте
  • Банк изображений
  • Реклама и сотрудничество
  • Политика конфиденциальности
  • Связаться
Подзаг - 2026
Привет!

Войдите в свою учетную запись

Имя пользователя или адрес электронной почты
Пароль

Забыли пароль?

Войти через Google
Не участник? Зарегистрироваться