RAG | Нейросети | ИИ | AI | Агенты | Mistral Large 4 | Gemini 4 Argon | GPT-6.1 Sol | Claude Sonnet 5.5 | GLM 5.3 | DeepSeek V4.1
IT и технологии · 7 октября 2026 г.
«Ты — эксперт с двадцатилетним стажем» больше не добавляет знаний. USC на шести открыты...
«Ты — эксперт с двадцатилетним стажем» больше не добавляет знаний. USC на шести открытых моделях замерил: с такой ролью точность на MMLU падает с 71,6 до 68 процентов. OpenAI советует наоборот — описывать результат и ставить одну-две жёсткие границы, а не пошаговый маршрут. Так плюс 10–15% качества и минус 41–66% токенов. Роли не мёртвые. Персона задаёт стиль и поднимает долю отказов на JailbreakBench с 53 до 71%, но для фактической точности она не помощник.