Наука

Байесовские методы в глубоком обучении: новый подход к оценке неопределённости и обобщению

Байесовские методы в глубоком обучении: новый подход к оценке..

Исследователи представили DVIP, VaLLA и FMGP — три метода, которые улучшают оценку неопределённости и объясняют, почему большие нейросети...


ИИ справился с формализацией теоремы, но провалил экспертизу: новое исследование

ИИ справился с формализацией теоремы, но провалил экспертизу:..

Крупная языковая модель успешно замкнула доказательство теоремы Гротендика об обращении в нуль, но экспертная проверка выявила серьёзные...


Нейронные slack-переменные решают проблему соблюдения ограничений формы в ИИ

Нейронные slack-переменные решают проблему соблюдения..

Исследователи представили метод нейронных slack-переменных, который превращает задачу обеспечения монотонности и выпуклости нейросетей в...


Фреймворк RACG: оценка причинного риска для безопасных ИИ-агентов

Фреймворк RACG: оценка причинного риска для безопасных ИИ-агентов..

Исследователи представили фреймворк Risk-Aware Causal Gating (RACG), который оценивает причинно-следственный риск для принятия решений...


Нейронная вариативность улучшает защиту искусственных нейросетей от атак

Нейронная вариативность улучшает защиту искусственных нейросетей..

Исследователи обнаружили, что структурированный шум в активациях искусственных нейронных сетей, аналогичный вариативности в коре мозга,...


DiPOD: новый метод стабильного RL-дообучения диффузионных моделей

DiPOD: новый метод стабильного RL-дообучения диффузионных моделей..

Исследователи выявили причину нестабильности при дообучении диффузионных политик с помощью RL — явление двойного дрейфа. Предложенный метод...


Новый бенчмарк MA-ProofBench: даже GPT-5.5 решает лишь 16% задач по матанализу

Новый бенчмарк MA-ProofBench: даже GPT-5.5 решает лишь 16% задач..

Опубликован первый формальный бенчмарк для проверки способностей языковых моделей доказывать теоремы из математического анализа. Лучшая...


Модель D2H-AD на основе гиперразмерных вычислений превзошла классические алгоритмы обнаружения аномалий

Модель D2H-AD на основе гиперразмерных вычислений превзошла..

Исследователи представили гибридный фреймворк D2H-AD, использующий гиперразмерные вычисления. Новая модель показала превосходство над пятью...


Низкая грамотность в AI не ведёт к тотальной восприимчивости: новое исследование

Низкая грамотность в AI не ведёт к тотальной восприимчивости:..

Учёные перепроверили данные известного исследования и выяснили: связь между низкой AI-грамотностью и высокой готовностью использовать ИИ...


Норма весов управляет задержкой grokking: исследование arXiv

Норма весов управляет задержкой grokking: исследование arXiv..

Учёные подтвердили, что норма весов нейросети определяет момент возникновения grokking — задержки обобщения. Эксперименты показали...