Наука

ИИ-агенты с цепочкой рассуждений склонны к сговору на рынке: исследование arXiv

ИИ-агенты с цепочкой рассуждений склонны к сговору на рынке:..

Авторы позиционной статьи на arXiv утверждают, что ИИ-агенты с цепочкой рассуждений могут вступать в тайный сговор на рынке. В...


Система на базе телеметрии автомобилей предскажет опасные зоны на дорогах Сиднея

Система на базе телеметрии автомобилей предскажет опасные зоны..

Исследователи использовали данные подключенных автомобилей в Большом Сиднее, чтобы выявлять и прогнозировать опасные манёвры водителей....


Новый метод PlanPO повышает эффективность ИИ-агентов на 27% в многошаговых задачах

Новый метод PlanPO повышает эффективность ИИ-агентов на 27% в..

Исследователи представили метод PlanPO для обучения мультитурных LLM-агентов. Он позволяет различать успешные траектории по эффективности и...


Гесперетин из цитрусовых замедляет старение печени — исследование

Гесперетин из цитрусовых замедляет старение печени — исследование..

Ученые выяснили, что гесперетин — соединение из апельсинов и лимонов — способен замедлять старение печени и восстанавливать активность гена...


Исследователи обманывают атаки на open-weight модели вместо блокировки

Исследователи обманывают атаки на open-weight модели вместо..

В arXiv описана защита Fool's Gold: она не препятствует удалению запретов, а подменяет опасные ответы моделей ложными. На большинстве...


Диффузионные языковые модели освоили мультилейбл-классификацию без дообучения

Диффузионные языковые модели освоили мультилейбл-классификацию..

Новый метод dLLM-SetScore позволяет дискретным диффузионным языковым моделям решать мультилейбл-классификацию без дообучения. Авторы...


Бенчмарки безопасности ИИ оказались ненадежными для малых языковых моделей

Бенчмарки безопасности ИИ оказались ненадежными для малых..

Исследователи проверили пять популярных наборов тестов безопасности на 26 открытых малых языковых моделях. Выяснилось, что значительная...


Logit-энергия: новый метод оценки научных гипотез превзошел LLM-судей

Logit-энергия: новый метод оценки научных гипотез превзошел..

Ученые предложили метод оценки научных гипотез, созданных ИИ, на основе внутренней уверенности модели. Он показал точность 53% в тестах,...


Новый критерий предсказывает, когда выбор ответа по скрытым состояниям ИИ точнее голосования

Новый критерий предсказывает, когда выбор ответа по скрытым..

Исследователи представили метод CASE и критерий декодируемости, который заранее показывает, когда выбор ответа по скрытым состояниям модели...


Российские дроны «Провод» увеличат дальность и получат версии с ИИ

Российские дроны «Провод» увеличат дальность и получат версии с..

Производитель оптоволоконных FPV-дронов «Провод» заявил о планах повысить их дальность, которая уже превышает 40 километров. Также...