Наука
LoRA-дообучение создаёт собственные признаки: исследование SAE..
Исследователи изучили внутренние представления языковых моделей при LoRA-дообучении с помощью разреженных автоэнкодеров (SAE). Оказалось,...
LLM-агенты сравнялись с людьми в аннотации фенотипов —..
Исследователи оценили пять крупных языковых моделей от Anthropic и OpenAI как кураторов-агентов для аннотации биологических фенотипов....
Исследователи объяснили, почему нейросети согласованно..
Учёные предложили статистическую модель, объясняющую, как нейросети разных архитектур формируют согласованные представления объектов....
LLM-рецензии на научные статьи: слабая согласованность с людьми..
Исследователи из Гамбургского университета изучили, насколько рецензии, написанные большими языковыми моделями (LLM), совпадают с...
Терапевт научил сердечников проверять обезвоживание по складке..
Доцент кафедры терапии Пироговского университета Федор Евдокимов предложил простой тест для выявления нехватки жидкости у людей с...
Новый метод COM повышает точность анализа временных рядов в LLM..
Исследователи представили метод COM, который учитывает непрерывность и упорядоченность токенов временных рядов. Это улучшает работу больших...
Ученые предложили метод выборочной вырубки тропических лесов с..
Исследователи представили метод URIEL, сочетающий вертолеты, роботов и ИИ для устойчивой выборочной вырубки тропических лесов. Технология...
Новый ИИ-агент TRACE ускоряет оптимизацию лекарств за счёт..
Исследователи представили TRACE — агента на основе большой языковой модели, который формулирует выбор инструментов для молекулярной...
Новый трансформер CCT превзошел GPT-2 Small на 12% по перплексии..
Исследователи представили Cognitive Categorical Transformer (CCT) — архитектуру на 306 млн параметров, которая улучшает предсказательную...
RL-дообучение сохраняет нейросетевые схемы лучше SFT, выяснили..
Новое исследование на arXiv показывает, что обучение с подкреплением (RL) при дообучении больших языковых моделей меньше разрушает...



