Исследования и наука

DeepMind представила исследование о переходе от AGI к ASI Hacker News · 17.06.2026 DeepMind опубликовала исследование, посвящённое эволюции искусственного интеллекта от искусственного общего интеллекта (AGI) к искусственному сверхинтеллекту (ASI). В работе рассматриваются ключевые этапы развития ИИ, а также потенциальные последствия для общества и технологий. Новая классификация мировых моделей для ИИ Hacker News · 17.06.2026 Исследователи предложили функциональную таксономию мировых моделей, которые используются в ИИ для понимания и взаимодействия с окружающим миром. В статье на Substack автор подробно разбирает различные типы моделей, их применение и ограничения. Исследование: люди превосходят ИИ в долгосрочном планировании Hacker News · 17.06.2026 Новое исследование показало, что люди пока опережают ИИ в задачах, требующих долгосрочного планирования. Учёные сравнили способность людей и искусственных интеллектуальных систем к стратегическому мышлению и принятию решений на длительных временных горизонтах. Исследование раскрывает архитектурную сложность нейросетей Hacker News · 16.06.2026 Учёные из Массачусетского технологического института (MIT) и Стэнфордского университета опубликовали исследование, посвящённое архитектурной сложности нейросетей. В работе, размещённой на arXiv, авторы анализируют, как структура нейронных сетей влияет на их производительность и обобщающую способность. Исследование: экспертиза в программировании сохраняется даже при использовании ИИ-агентов Hacker News · 16.06.2026 Исследователи из Anthropic провели эксперимент, чтобы оценить, как ИИ-агенты влияют на экспертизу в программировании. Участники с разным уровнем навыков использовали ИИ-агента для решения задач по кодингу. Результаты показали, что даже при помощи ИИ опытные разработчики демонстрировали лучшие результаты, чем новички. Новые рубрики для оценки RLVR в исследовании Complex-If and Beyond Hacker News · 16.06.2026 Исследователи представили документ Complex-If and Beyond, в котором предложены экспертные рубрики для оценки RLVR (Reinforcement Learning from Human Feedback). Документ доступен в формате PDF и содержит подробные критерии для оценки качества моделей, обучаемых с использованием RLVR. Oxford Digital News Report 2026: ИИ меняет медиапотребление Hacker News · 16.06.2026 Вышел ежегодный Oxford Digital News Report 2026, который анализирует глобальные тренды в медиапотреблении. В этом году ключевое внимание уделено влиянию искусственного интеллекта на новостные медиа. Исследование: могут ли LLM-агенты строить модели мира Hacker News · 16.06.2026 Учёные изучают способность языковых моделей (LLM) строить модели мира через агентное поведение. В новом исследовании, опубликованном на arXiv, рассматривается, как агентные автоматические системы могут обучаться и адаптироваться в динамических средах. Исследование: как LLMs справляются с юридическими рассуждениями Hacker News · 16.06.2026 Учёные из Стэнфорда и MIT провели исследование, посвящённое способности языковых моделей (LLMs) решать юридические задачи и автоматически формализовать правовые тексты. В работе, опубликованной на arXiv, авторы оценили точность и последовательность моделей в интерпретации законов и применении их к конкретным случаям. ReproRepo: масштабируемый фреймворк для проверки воспроизводимости исследований arXiv · 16.06.2026 Исследователи представили ReproRepo — фреймворк для автоматизированной проверки воспроизводимости научных работ. Проблема воспроизводимости остаётся ключевой для научного прогресса, но существующие методы требуют значительных ручных усилий. Исследование: нейросимволические агенты для киберзащиты arXiv · 16.06.2026 Учёные представили исследование, посвящённое созданию автономных киберзащитных агентов на основе нейросимволических подходов. В работе рассматривается применение поведенческих деревьев с компонентами, способными к обучению (LECs), для обучения, принятия решений и адаптации агентов в условиях киберугроз. Darshana Graph: корпус для сравнительного анализа индийской философии arXiv · 16.06.2026 Исследователи представили Darshana Graph — корпус из более чем 125 000 текстов, охватывающий классические философские традиции индуизма, буддизма и джайнизма. В основу легли публичные и открытые переводы ключевых источников, включая «Бхагавад-гиту», «Брахма-сутры», основные Упанишады, Палийский канон и центральные тексты джайнизма. Как цифровизировать арабско-английский словарь Al-Mawrid arXiv · 16.06.2026 Учёные представили методологию для систематической цифровизации и кодирования арабско-английского словаря Al-Mawrid. Исследование преобразует печатный ресурс в стандартизированный вычислительный словарь, заполняя пробел в арабской лексической инфраструктуре. ИИ для восстановления природы: проект Earth AI от Google The latest research from Google · 16.06.2026 Google Research представил проект Earth AI, направленный на восстановление природных экосистем с помощью искусственного интеллекта. Система использует спутниковые снимки и данные о растительности для анализа состояния земель и разработки планов по их восстановлению. Исследование: прогноз развития ИИ до 2026 года Hacker News · 16.06.2026 Вышел Artificial Intelligence Index Report 2026 — ежегодное исследование, отслеживающее ключевые тренды в сфере ИИ. В отчёте проанализированы данные по инвестициям, публикациям, патентам и внедрению технологий. DRFLOW: новый бенчмарк для прогнозирования персонализированных рабочих процессов arXiv · 16.06.2026 Исследователи представили новый бенчмарк DRFLOW, предназначенный для оценки способности ИИ-агентов прогнозировать персонализированные рабочие процессы. В отличие от существующих систем, которые в основном фокусируются на генерации отчётов и сводок, DRFLOW направлен на решение более сложных задач, таких как определение последовательности конкретных действий для выполнения определённых задач. Исследование: тесты в коде от ИИ-агентов часто бессмысленны arXiv · 16.06.2026 Исследователи изучили качество тестов, генерируемых ИИ-агентами в открытых репозиториях. Оказалось, что более 932 000 пулл-реквестов с кодом от ИИ содержат тесты без проверочной логики. Это значит, что тесты просто запускают код, но не проверяют его корректность. Исследование: классификация киберугроз с помощью открытых моделей arXiv · 16.06.2026 Учёные изучили, как открытые языковые модели могут автоматизировать классификацию киберугроз по стандарту MITRE ATT&CK. Ранее этот процесс требовал значительных человеческих усилий, а до появления LLM автоматизация была ограничена сложностью анализа неструктурированных отчётов о киберугрозах (CTI). Новый метод для реалистичного 3D ре-эйджа лиц arXiv · 16.06.2026 Исследователи представили новый фреймворк ReAge3D для реалистичного и контролируемого изменения возраста 3D-моделей лиц. Технология сохраняет детали и идентичность лица, что делает её подходящей для применения в медицине, кино и других областях. Исследование: ИИ-агенты для анализа данных с носимых устройств arXiv · 16.06.2026 Исследователи представили новый подход к обработке данных с носимых устройств с помощью ИИ-агентов. В статье, опубликованной на arXiv, описывается система WEQA (Wearable hEalth Question Answering), которая использует адаптивное агентное рассуждение для работы с высокоразмерными и непрерывными данными, поступающими от носимых датчиков. Новый датасет для анализа звуков выстрелов из разных видов оружия arXiv · 16.06.2026 Учёные представили новый открытый датасет Certus Caliber Classification Gunshot Dataset (C3GD), предназначенный для анализа звуков выстрелов из огнестрельного оружия. В его основе лежит более 8000 записей, охватывающих широкий спектр видов оружия, калибров, патронов, микрофонов и их расположений. Исследование: как ИИ-модели теряют когнитивные способности в длительных диалогах arXiv · 16.06.2026 Новое исследование на arXiv обращает внимание на проблему когнитивного увядания (cognitive atrophy) в поведении больших языковых моделей (LLM). Авторы отмечают, что существующие бенчмарки оценивают знания, безопасность и качество ответов, но не учитывают, как модели ведут себя в длительных, эмоционально насыщенных диалогах. Поисковый движок для 5600 AI-статей за 1 доллар Hacker News · 16.06.2026 Разработчики создали поисковую систему для 5600 научных работ по ИИ, потратив всего 1 доллар. Проект использует данные из ArXiv и позволяет быстро находить релевантные исследования по ключевым словам и темам. Исследование выявило скрытые региональные предвзятости в LLM arXiv · 16.06.2026 Современные чат-боты часто используют данные о местоположении пользователей, чтобы адаптировать ответы. Однако исследователи из arXiv обнаружили, что модели могут генерировать географические ссылки даже при нейтральных запросах. Это явление называется location leakage — утечка местоположения.