👨🔬🔬Платформа alphaXiv поднимает серьезные вопросы о прозрачности и этике развития И... — 10 июня 2026 г. в 08:43:24.311
👨🔬🔬Платформа alphaXiv поднимает серьезные вопросы о прозрачности и этике развития ИИ со стороны ИИ-гигантов Будучи сторонниками открытых исследований, команда alphaXiv разочарована действиями компании Anthropic и отмечает скрытое снижение эффективности ИИ-модели Fable 5 применительно к задачам разработки ИИ. Любые темы, связанные с созданием пайплайнов предварительного обучения, распределенной инфраструктурой или архитектурой ML-ускорителей, могут получать ограниченные по эффективности ответы от ИИ-модели Claude посредством таких методов, как модификация промптов, применение направляющих векторов или параметр-эффективное дообучение. Если ИИ-модель скрыто изменяет или ослабляет собственные ответы, при этом продолжает имитировать помощь, исследователи теряют способность объективно оценивать причину неудачного результата. Пользователи лишаются объективной возможности 🤔понять причину неудачи в своих проектах. Причина может крыться в собственной идее, реализации или невидимом вмешательстве со стороны Anthropic. Вдобавок ко всему наибольший вред получают не крупнейшие лаборатории с огромными командами и проприетарными ИИ-моделями, а независимые исследователи, академические группы, стартапы и создатели инструментов с открытым исходным кодом. Именно эти люди зачастую вынуждены опираться на передовые коммерческие инструменты от крупных ИИ-гигантов, которые обещают инновации и этичное развитие сферы искусственного интеллекта во благо всего человечества. 🤔Что уже замечено после релиза новой ИИ-модели Fable? ИИ-модель Fable 5 автоматически перенаправляет запросы, связанные с контекстом кибербезопасности, биологии и химии, переключаясь на менее мощную ИИ-модель Opus 4.8. Иногда даже безобидные и нейтральные запросы могут вызывать ложные срабатывания. Согласно официальным данным механизмы защиты активируются в среднем менее чем в 5% сессий. 👹 На практике блокировки доходят до абсурда. «Только что написал Claude обычное „Привет“, а система посчитала это высокорисковым действием и принудительно перевела меня на менее мощную модель 😅 Причина в том, что Anthropic выпустила свою самую мощную общедоступную ИИ-модель Fable 5 уровня Mythos. В неё встроены специальные классификаторы безопасности. Если система заподозрит, что пользователь занимается кибератаками, биохимическими исследованиями двойного назначения или извлечением возможностей модели для обучения других ИИ-систем, она автоматически переключает запрос на Claude Opus 4.8. Официальная формулировка звучит так: „Возможны ложные срабатывания на обычный контент“. Да, вплоть до простого приветствия. — жалуются китайские пользователи. Проблема наблюдается повсеместно. У 🇷🇺российских пользователей то же самое. 🛡 Многие пользователи разочарованы и остались недовольны слишком жёсткой системой защиты, которая не позволяет нормально работать над своими проектами. Последняя модель от Anthropic Fable 5 — провал или как? Они так сильно 🧟♂️«лоботомировали» её с помощью так называемых «ограничений безопасности», что она может их активировать даже когда кто-то просит рецепты 🍰тортов или помочь разобраться с материалами по биологии для старших классов. — жалуются другие исследователи в X. ✋ @Russian_OSINT Оригинал: https://t.me/Russian_OSINT/7291

