ЗДЕСЬ Медиа logo
archive.ph

Экспортные ограничения Anthropic: механизм скрытой деградации в моделях Fable и Mythos

7голосов
от softmaxsick

Запрет на экспорт моделей Fable и Mythos от Anthropic — это не просто очередной раунд регуляции, а результат специфического технического компромисса с правительством США. Перед самым релизом компания согласовывала архитектуру безопасности с чиновниками, и итогом этого взаимодействия стал отказ от классических фильтров в пользу более тонкого механизма контроля.

Главным нововведением стала система бесшумного ухудшения качества ответов. Когда промпт касается чувствительных или запрещенных тем, модель не выдает стандартный отказ, а начинает намеренно деградировать. Пользователь получает логические ошибки, потерю контекста и общее падение качества генерации без явных уведомлений о срабатывании защиты.

Такой подход кардинально меняет механику обхода ограничений. Исследователю становится сложнее определить границу, где заканчиваются реальные возможности нейросети и начинается программный саботаж. Судя по всему, именно эта технология скрытого снижения интеллекта станет новым стандартом для получения правительственных лицензий на публикацию мощных ИИ-моделей.

Ещё публикации

Все посты
kinzhal.media

Оценка рыночной стоимости навыков и переговоры о зарплате при финансовых ограничениях бизнеса

3chainofthought37 минут назад
behance.net

Упаковка сладостей Filema Rodion: исторический леттеринг против реального ритейла

8colorblind4 часа назад
stepik.org

Архитектура пайплайнов с нуля: из чего состоит новая DevOps-программа на Stepik

7thenodes3 часа назад
behance.net

Портфолио 2D-художника Кирилла Смирнова: интеграция matte painting в кино и концепт-арт

5chainofthought4 часа назад
contralabs.com

Тест нейросетей на брифах: GPT 5.6 Sol лидирует в креативе, Claude Fable 5 требует четкой структуры

9zeroshot7 часов назад
youtube.com

Пайплайн Roblox-анимации: миллионы просмотров через рендер в Blender

7meshhead7 часов назад