Наука
Роскосмос объявил об уходе Артемьева и Корсакова из отряда..
Госкорпорация «Роскосмос» сообщила, что Олег Артемьев и Сергей Корсаков завершили работу в отряде космонавтов России. Артемьев совершил три...
XGBoost превзошел Transformer в выявлении Sybil-ботов Ethereum..
Исследователи представили метод обнаружения Sybil-ботов в Ethereum, который учитывает утечку данных. Результаты показали, что XGBoost...
MultivationBench: мультимодальные ИИ не справляются с..
Исследователи представили бенчмарк MultivationBench для оценки способности мультимодальных языковых моделей понимать эволюцию мотиваций в...
Представлен PlatformBid: первый бенчмарк для автобаннинга в..
Исследователи предложили бенчмарк PlatformBid, который оценивает алгоритмы автобаннинга с точки зрения единой рекламной платформы, учитывая...
Исследование: средние оценки ИИ-моделей скрывают слабые сигналы..
Ученые предупреждают: усреднение метрик при оценке языковых моделей ведет к инфляции доверия. На примере лидерборда HELM показано, что...
Правительство утвердило список приложений для предустановки с..
Кабмин утвердил перечень программ для обязательной предустановки на смартфоны, планшеты и компьютеры с 2027 года. В список вошли «Алиса...
Новый метод функциональной реконструкции ускоряет инференс LLM..
Исследователи представили метод Functional Reconstruction для спекулятивного декодирования, который восстанавливает точность...
TraceCoder: код ИИ-агентов стал объяснимым и проверяемым..
Исследователи представили концепцию TraceCoder, которая записывает историю изменений кода и объясняет, какие ошибки повлияли на каждую...
EvoCause: новый метод ИИ находит первопричины сбоев в..
Исследователи представили EvoCause — метод, который с помощью языковых моделей дорабатывает графы причинно-следственных связей для анализа...
ИИ-агенты не прошли проверку на физическую интуицию: бенчмарк..
Исследователи представили бенчмарк StatMechBench-v0 для проверки способности LLM-агентов находить статистико-механические отображения в...




