Наука
Математики предложили оптимальный способ выбора уровней шума для..
Новое исследование на arXiv предлагает математический фреймворк для оптимального распределения шума при обучении диффузионных моделей....
ИИ-модели уперлись в потолок персонализации: новый бенчмарк..
Исследователи представили SDR-Bench — набор из 6279 историй успешных продаж для оценки способности языковых моделей адаптировать сообщения...
Предобучение на симуляции ODE решает проблему нехватки данных в..
Ученые провели первое систематическое исследование методов внедрения биокинетических знаний в нейросети для моделирования биопроцессов....
PlanE: фреймворк для планирования данных, дообучения и инференса..
Исследователи представили PlanE — фреймворк для создания экстрактивных LLM, который объединяет декомпозицию данных, инструктивное...
ReliableTableQA: нейросеть научилась проверять надёжность..
Исследователи представили фреймворк ReliableTableQA, который обучает нейросеть оценивать статистическую достоверность ответов на запросы к...
Ученые нашли "общее пространство" в работе LLM при генерации..
Исследователи разработали метод DecodeShare, выявляющий низкоразмерное подпространство, общее для разных задач на этапе декодирования LLM....
Нейросеть научилась создавать «цифровые двойники» без..
Исследователи представили архитектуру Zero-Shot Digital Twins, которая использует графовые нейронные сети для моделирования физических...
InferenceBench: ИИ-агенты ускоряют LLM-инференс до 8 раз, но..
Исследователи представили бенчмарк InferenceBench для оценки способности ИИ-агентов оптимизировать скорость инференса больших языковых...
Ученые предложили метод оценки доверия к ансамблям LLM с учетом..
Исследователи представили новый подход к агрегации предсказаний от нескольких больших языковых моделей, основанный на структурированных...
DC-Leap ускоряет диффузионные языковые модели до 105 раз без..
Исследователи представили DC-Leap — метод ускорения диффузионных больших языковых моделей (dLLMs), не требующий дополнительного обучения....


