Наука
Байесовские методы в глубоком обучении: новый подход к оценке..
Исследователи представили DVIP, VaLLA и FMGP — три метода, которые улучшают оценку неопределённости и объясняют, почему большие нейросети...
ИИ справился с формализацией теоремы, но провалил экспертизу:..
Крупная языковая модель успешно замкнула доказательство теоремы Гротендика об обращении в нуль, но экспертная проверка выявила серьёзные...
Нейронные slack-переменные решают проблему соблюдения..
Исследователи представили метод нейронных slack-переменных, который превращает задачу обеспечения монотонности и выпуклости нейросетей в...
Фреймворк RACG: оценка причинного риска для безопасных ИИ-агентов..
Исследователи представили фреймворк Risk-Aware Causal Gating (RACG), который оценивает причинно-следственный риск для принятия решений...
Нейронная вариативность улучшает защиту искусственных нейросетей..
Исследователи обнаружили, что структурированный шум в активациях искусственных нейронных сетей, аналогичный вариативности в коре мозга,...
DiPOD: новый метод стабильного RL-дообучения диффузионных моделей..
Исследователи выявили причину нестабильности при дообучении диффузионных политик с помощью RL — явление двойного дрейфа. Предложенный метод...
Новый бенчмарк MA-ProofBench: даже GPT-5.5 решает лишь 16% задач..
Опубликован первый формальный бенчмарк для проверки способностей языковых моделей доказывать теоремы из математического анализа. Лучшая...
Модель D2H-AD на основе гиперразмерных вычислений превзошла..
Исследователи представили гибридный фреймворк D2H-AD, использующий гиперразмерные вычисления. Новая модель показала превосходство над пятью...
Низкая грамотность в AI не ведёт к тотальной восприимчивости:..
Учёные перепроверили данные известного исследования и выяснили: связь между низкой AI-грамотностью и высокой готовностью использовать ИИ...
Норма весов управляет задержкой grokking: исследование arXiv..
Учёные подтвердили, что норма весов нейросети определяет момент возникновения grokking — задержки обобщения. Эксперименты показали...


