Учёные изучили возможность больших языковых моделей оценивать растворимость молекул — 27 августа 2026 г. в 07:36:01.007
Учёные изучили возможность больших языковых моделей оценивать растворимость молекул Учёные Института общей и неорганической химии им. Н.С. Курнакова РАН разработали SoluBench — бенчмарк для проверки способности больших языковых моделей решать практические задачи, связанные с растворимостью органических соединений. Он включает 9806 вопросов четырёх типов, составленных на основе экспериментальных данных BigSolDB 2.0 и MixtureSolDB. С помощью SoluBench исследователи протестировали более 20 открытых и проприетарных языковых моделей. Результаты работы опубликованы в журнале Journal of Chemical Information and Modeling. Растворимость — одно из важнейших свойств вещества. От неё зависит выбор растворителя в органическом синтезе, разработке лекарств и различных технологических процессах. Для её прогнозирования применяют методы машинного обучения, но они обычно требуют специальных данных, программного обеспечения и навыков работы с такими системами. Большие языковые модели (Large Language Models, LLM) проще в использовании: химик может задать вопрос обычным языком и получить прогноз. Однако было неясно, действительно ли LLM способны учитывать химические закономерности или лишь воспроизводят сведения, встречавшиеся им во время обучения. Чтобы это проверить, исследователи создали SoluBench на основе задач, близких к практической химии. Моделям предлагалось определить, в каком из двух растворителей вещество растворяется лучше; выбрать лучший растворитель из нескольких; предсказать, как добавление второго растворителя повлияет на растворимость; а также сравнить растворимость двух разных соединений в одном растворителе. Продолжение на сайте ХИА #хиа_наука ХИА — главные новости из мира химии ВК | Дзен | Сайт

