Исследования и наука

Исследование: прогноз развития ИИ до 2026 года Hacker News · 16.06.2026 Вышел Artificial Intelligence Index Report 2026 — ежегодное исследование, отслеживающее ключевые тренды в сфере ИИ. В отчёте проанализированы данные по инвестициям, публикациям, патентам и внедрению технологий. DRFLOW: новый бенчмарк для прогнозирования персонализированных рабочих процессов arXiv · 16.06.2026 Исследователи представили новый бенчмарк DRFLOW, предназначенный для оценки способности ИИ-агентов прогнозировать персонализированные рабочие процессы. В отличие от существующих систем, которые в основном фокусируются на генерации отчётов и сводок, DRFLOW направлен на решение более сложных задач, таких как определение последовательности конкретных действий для выполнения определённых задач. Исследование: тесты в коде от ИИ-агентов часто бессмысленны arXiv · 16.06.2026 Исследователи изучили качество тестов, генерируемых ИИ-агентами в открытых репозиториях. Оказалось, что более 932 000 пулл-реквестов с кодом от ИИ содержат тесты без проверочной логики. Это значит, что тесты просто запускают код, но не проверяют его корректность. Исследование: классификация киберугроз с помощью открытых моделей arXiv · 16.06.2026 Учёные изучили, как открытые языковые модели могут автоматизировать классификацию киберугроз по стандарту MITRE ATT&CK. Ранее этот процесс требовал значительных человеческих усилий, а до появления LLM автоматизация была ограничена сложностью анализа неструктурированных отчётов о киберугрозах (CTI). Новый метод для реалистичного 3D ре-эйджа лиц arXiv · 16.06.2026 Исследователи представили новый фреймворк ReAge3D для реалистичного и контролируемого изменения возраста 3D-моделей лиц. Технология сохраняет детали и идентичность лица, что делает её подходящей для применения в медицине, кино и других областях. Исследование: ИИ-агенты для анализа данных с носимых устройств arXiv · 16.06.2026 Исследователи представили новый подход к обработке данных с носимых устройств с помощью ИИ-агентов. В статье, опубликованной на arXiv, описывается система WEQA (Wearable hEalth Question Answering), которая использует адаптивное агентное рассуждение для работы с высокоразмерными и непрерывными данными, поступающими от носимых датчиков. Новый датасет для анализа звуков выстрелов из разных видов оружия arXiv · 16.06.2026 Учёные представили новый открытый датасет Certus Caliber Classification Gunshot Dataset (C3GD), предназначенный для анализа звуков выстрелов из огнестрельного оружия. В его основе лежит более 8000 записей, охватывающих широкий спектр видов оружия, калибров, патронов, микрофонов и их расположений. Исследование: как ИИ-модели теряют когнитивные способности в длительных диалогах arXiv · 16.06.2026 Новое исследование на arXiv обращает внимание на проблему когнитивного увядания (cognitive atrophy) в поведении больших языковых моделей (LLM). Авторы отмечают, что существующие бенчмарки оценивают знания, безопасность и качество ответов, но не учитывают, как модели ведут себя в длительных, эмоционально насыщенных диалогах. Поисковый движок для 5600 AI-статей за 1 доллар Hacker News · 16.06.2026 Разработчики создали поисковую систему для 5600 научных работ по ИИ, потратив всего 1 доллар. Проект использует данные из ArXiv и позволяет быстро находить релевантные исследования по ключевым словам и темам. Исследование выявило скрытые региональные предвзятости в LLM arXiv · 16.06.2026 Современные чат-боты часто используют данные о местоположении пользователей, чтобы адаптировать ответы. Однако исследователи из arXiv обнаружили, что модели могут генерировать географические ссылки даже при нейтральных запросах. Это явление называется location leakage — утечка местоположения. VibeThinker-3B: новый подход к верифицируемому рассуждению в небольших языковых моделях Hacker News · 16.06.2026 Исследователи представили VibeThinker-3B — небольшую языковую модель, способную выполнять верифицируемое рассуждение. Это значит, что модель может не только генерировать ответы, но и предоставлять обоснования для своих выводов, что делает её более прозрачной и надежной. Новая теория поведения потребителей для ИИ-агентов arXiv · 16.06.2026 Исследователи предложили концепцию LLM Consumer Behavior Theory — нового направления, изучающего, как ИИ-агенты принимают решения о покупках вместо людей. В традиционной экономике потребительское поведение всегда связывали с людьми, но с ростом автономных агентов на основе больших языковых моделей (LLM) эта парадигма меняется. Исследование раскрывает механизмы обобщения в моделях знаний arXiv · 16.06.2026 Учёные изучили, как foundation models для графов знаний (KGFMs) обобщают информацию на новых данных. Эти модели способны предсказывать связи в незнакомых графах без дополнительного обучения, но их эффективность варьируется. Новый метод вычисления сходства траекторий судов на основе контрастного обучения arXiv · 16.06.2026 Учёные представили новый фреймворк MoCo-AIS для вычисления сходства траекторий судов. Он основан на контрастном обучении и предназначен для анализа мобильных паттернов, что важно для извлечения маршрутных шаблонов, прогнозирования мобильности и обнаружения аномалий. ИИ для оценки депрессии по диалогам с виртуальными ассистентами arXiv · 16.06.2026 Учёные предложили новый метод оценки тяжести депрессии на основе диалогов с ИИ-ассистентами. Исследование опубликовано на arXiv. Новый метод для мультимодального разрешения кореферентности без предварительного обучения arXiv · 16.06.2026 Исследователи предложили новый подход Plug-and-Adapt для мультимодального разрешения кореферентности (MCR), который не требует предварительного обучения на аннотированных данных. В статье на arXiv показано, что визуальная информация помогает устранять неоднозначности в тексте, что значительно повышает точность системы. ChLogic: тестирование логического мышления моделей на китайском arXiv · 16.06.2026 Исследователи представили новый бенчмарк ChLogic, который оценивает способность языковых моделей сохранять логическое мышление при работе с китайскими выражениями. В отличие от английских тестов, ChLogic проверяет, как модели справляются с логическими структурами, представленными на китайском языке. Исследование взаимодействия мультимодальных биомаркеров при болезни Альцгеймера arXiv · 16.06.2026 Учёные провели количественный анализ мультимодальных биомаркеров при болезни Альцгеймера (БА). Исследование опубликовано на arXiv и посвящено интеграции молекулярных, структурных, клинических и генетических данных для улучшения диагностики и моделирования заболевания. AATF: открытый стандарт для аудита решений ИИ-агентов Hacker News · 16.06.2026 Команда разработчиков представила AATF (Agent Audit Trail Format) — открытый стандарт для записи и анализа решений, принимаемых ИИ-агентами. Этот формат позволяет фиксировать логику, данные и контекст, на основе которых агент принимает решения, что критически важно для отладки, мониторинга и повышения прозрачности работы агентов. Исследование DPBench раскрывает ключи к эффективной координации агентов Hacker News · 15.06.2026 Учёные из Стэнфорда и MIT представили исследование DPBench, которое исследует структурные детерминанты координации между мультиагентными системами на основе больших языковых моделей (LLM). Исследование выявляет ключевые факторы, влияющие на эффективность взаимодействия агентов, включая архитектуру, механизмы коммуникации и стратегии принятия решений. Первые шаги к автоматизации исследований в ИИ Hacker News · 15.06.2026 Компания Recursive.ai представила проект, направленный на автоматизацию процессов в исследованиях искусственного интеллекта. Это важный шаг, который может значительно ускорить разработку новых моделей и алгоритмов, а также снизить затраты на исследования. Как изменились практики документирования в AI за десятилетие arXiv · 15.06.2026 Новое исследование, опубликованное на arXiv, анализирует тенденции в документировании AI-исследований за последние десять лет. Авторы проанализировали 56 800 конференционных статей, чтобы понять, как изменились практики документирования в ответ на кризис воспроизводимости результатов. Как разработчики работают с ИИ-инструментами Hacker News · 15.06.2026 Компания Cursor опубликовала отчёт о привычках разработчиков, который включает данные о том, как программисты используют ИИ-инструменты в своей повседневной работе. Исследование охватило более 1000 разработчиков из разных стран и компаний, что делает его одним из самых масштабных в своей области. Donate Agent Traces: открытая платформа для сбора данных об агентах Hacker News · 15.06.2026 Команда Trace Commons запустила проект Donate Agent Traces — платформу для сбора и анализа данных о работе ИИ-агентов. Проект позволяет разработчикам и исследователям делиться логами взаимодействий агентов с пользователями, что может значительно ускорить развитие технологий в этой области.