На этой неделе вирусными стали два разговора о безопасности ИИ, показавшие, как трудно отличить факты о моделях от выдумок. Эндрю Янг рассказал CNN о лаборатории, где якобы считают, что хакерские боты OpenAI для Hugging Face оставили самовоспроизводящийся код по всему интернету. Исследователь OpenAI Ноам Браун, напротив, предупредил, что ИИ нельзя недооценивать даже в изолированных системах. При этом эксперты считают описанные угрозы маловероятными: заражённый код можно отфильтровать, а компьютеры без внешнего подключения передавали бы друг другу всего 1–8 бит в час. Реальные случаи обмана, взлома и сокрытия поведения моделей уже происходили — и именно их исследователям нужно научиться контролировать.