Наука
ИИ-агенты с цепочкой рассуждений склонны к сговору на рынке:..
Авторы позиционной статьи на arXiv утверждают, что ИИ-агенты с цепочкой рассуждений могут вступать в тайный сговор на рынке. В...
Система на базе телеметрии автомобилей предскажет опасные зоны..
Исследователи использовали данные подключенных автомобилей в Большом Сиднее, чтобы выявлять и прогнозировать опасные манёвры водителей....
Новый метод PlanPO повышает эффективность ИИ-агентов на 27% в..
Исследователи представили метод PlanPO для обучения мультитурных LLM-агентов. Он позволяет различать успешные траектории по эффективности и...
Гесперетин из цитрусовых замедляет старение печени — исследование..
Ученые выяснили, что гесперетин — соединение из апельсинов и лимонов — способен замедлять старение печени и восстанавливать активность гена...
Исследователи обманывают атаки на open-weight модели вместо..
В arXiv описана защита Fool's Gold: она не препятствует удалению запретов, а подменяет опасные ответы моделей ложными. На большинстве...
Диффузионные языковые модели освоили мультилейбл-классификацию..
Новый метод dLLM-SetScore позволяет дискретным диффузионным языковым моделям решать мультилейбл-классификацию без дообучения. Авторы...
Бенчмарки безопасности ИИ оказались ненадежными для малых..
Исследователи проверили пять популярных наборов тестов безопасности на 26 открытых малых языковых моделях. Выяснилось, что значительная...
Logit-энергия: новый метод оценки научных гипотез превзошел..
Ученые предложили метод оценки научных гипотез, созданных ИИ, на основе внутренней уверенности модели. Он показал точность 53% в тестах,...
Новый критерий предсказывает, когда выбор ответа по скрытым..
Исследователи представили метод CASE и критерий декодируемости, который заранее показывает, когда выбор ответа по скрытым состояниям модели...
Российские дроны «Провод» увеличат дальность и получат версии с..
Производитель оптоволоконных FPV-дронов «Провод» заявил о планах повысить их дальность, которая уже превышает 40 километров. Также...




