Исследования и наука
DeepMind представила исследование о переходе от AGI к ASI
DeepMind опубликовала исследование, посвящённое эволюции искусственного интеллекта от искусственного общего интеллекта (AGI) к искусственному сверхинтеллекту (ASI). В работе рассматриваются ключевые этапы развития ИИ, а также потенциальные последствия для общества и технологий.
Новая классификация мировых моделей для ИИ
Исследователи предложили функциональную таксономию мировых моделей, которые используются в ИИ для понимания и взаимодействия с окружающим миром. В статье на Substack автор подробно разбирает различные типы моделей, их применение и ограничения.
Исследование: люди превосходят ИИ в долгосрочном планировании
Новое исследование показало, что люди пока опережают ИИ в задачах, требующих долгосрочного планирования. Учёные сравнили способность людей и искусственных интеллектуальных систем к стратегическому мышлению и принятию решений на длительных временных горизонтах.
Исследование раскрывает архитектурную сложность нейросетей
Учёные из Массачусетского технологического института (MIT) и Стэнфордского университета опубликовали исследование, посвящённое архитектурной сложности нейросетей. В работе, размещённой на arXiv, авторы анализируют, как структура нейронных сетей влияет на их производительность и обобщающую способность.
Исследование: экспертиза в программировании сохраняется даже при использовании ИИ-агентов
Исследователи из Anthropic провели эксперимент, чтобы оценить, как ИИ-агенты влияют на экспертизу в программировании. Участники с разным уровнем навыков использовали ИИ-агента для решения задач по кодингу. Результаты показали, что даже при помощи ИИ опытные разработчики демонстрировали лучшие результаты, чем новички.
Новые рубрики для оценки RLVR в исследовании Complex-If and Beyond
Исследователи представили документ Complex-If and Beyond, в котором предложены экспертные рубрики для оценки RLVR (Reinforcement Learning from Human Feedback). Документ доступен в формате PDF и содержит подробные критерии для оценки качества моделей, обучаемых с использованием RLVR.
Oxford Digital News Report 2026: ИИ меняет медиапотребление
Вышел ежегодный Oxford Digital News Report 2026, который анализирует глобальные тренды в медиапотреблении. В этом году ключевое внимание уделено влиянию искусственного интеллекта на новостные медиа.
Исследование: могут ли LLM-агенты строить модели мира
Учёные изучают способность языковых моделей (LLM) строить модели мира через агентное поведение. В новом исследовании, опубликованном на arXiv, рассматривается, как агентные автоматические системы могут обучаться и адаптироваться в динамических средах.
Исследование: как LLMs справляются с юридическими рассуждениями
Учёные из Стэнфорда и MIT провели исследование, посвящённое способности языковых моделей (LLMs) решать юридические задачи и автоматически формализовать правовые тексты. В работе, опубликованной на arXiv, авторы оценили точность и последовательность моделей в интерпретации законов и применении их к конкретным случаям.
ReproRepo: масштабируемый фреймворк для проверки воспроизводимости исследований
Исследователи представили ReproRepo — фреймворк для автоматизированной проверки воспроизводимости научных работ. Проблема воспроизводимости остаётся ключевой для научного прогресса, но существующие методы требуют значительных ручных усилий.
Исследование: нейросимволические агенты для киберзащиты
Учёные представили исследование, посвящённое созданию автономных киберзащитных агентов на основе нейросимволических подходов. В работе рассматривается применение поведенческих деревьев с компонентами, способными к обучению (LECs), для обучения, принятия решений и адаптации агентов в условиях киберугроз.
Darshana Graph: корпус для сравнительного анализа индийской философии
Исследователи представили Darshana Graph — корпус из более чем 125 000 текстов, охватывающий классические философские традиции индуизма, буддизма и джайнизма. В основу легли публичные и открытые переводы ключевых источников, включая «Бхагавад-гиту», «Брахма-сутры», основные Упанишады, Палийский канон и центральные тексты джайнизма.
Как цифровизировать арабско-английский словарь Al-Mawrid
Учёные представили методологию для систематической цифровизации и кодирования арабско-английского словаря Al-Mawrid. Исследование преобразует печатный ресурс в стандартизированный вычислительный словарь, заполняя пробел в арабской лексической инфраструктуре.
ИИ для восстановления природы: проект Earth AI от Google
Google Research представил проект Earth AI, направленный на восстановление природных экосистем с помощью искусственного интеллекта. Система использует спутниковые снимки и данные о растительности для анализа состояния земель и разработки планов по их восстановлению.
Исследование: прогноз развития ИИ до 2026 года
Вышел Artificial Intelligence Index Report 2026 — ежегодное исследование, отслеживающее ключевые тренды в сфере ИИ. В отчёте проанализированы данные по инвестициям, публикациям, патентам и внедрению технологий.
DRFLOW: новый бенчмарк для прогнозирования персонализированных рабочих процессов
Исследователи представили новый бенчмарк DRFLOW, предназначенный для оценки способности ИИ-агентов прогнозировать персонализированные рабочие процессы. В отличие от существующих систем, которые в основном фокусируются на генерации отчётов и сводок, DRFLOW направлен на решение более сложных задач, таких как определение последовательности конкретных действий для выполнения определённых задач.
Исследование: тесты в коде от ИИ-агентов часто бессмысленны
Исследователи изучили качество тестов, генерируемых ИИ-агентами в открытых репозиториях. Оказалось, что более 932 000 пулл-реквестов с кодом от ИИ содержат тесты без проверочной логики. Это значит, что тесты просто запускают код, но не проверяют его корректность.
Исследование: классификация киберугроз с помощью открытых моделей
Учёные изучили, как открытые языковые модели могут автоматизировать классификацию киберугроз по стандарту MITRE ATT&CK. Ранее этот процесс требовал значительных человеческих усилий, а до появления LLM автоматизация была ограничена сложностью анализа неструктурированных отчётов о киберугрозах (CTI).
Новый метод для реалистичного 3D ре-эйджа лиц
Исследователи представили новый фреймворк ReAge3D для реалистичного и контролируемого изменения возраста 3D-моделей лиц. Технология сохраняет детали и идентичность лица, что делает её подходящей для применения в медицине, кино и других областях.
Исследование: ИИ-агенты для анализа данных с носимых устройств
Исследователи представили новый подход к обработке данных с носимых устройств с помощью ИИ-агентов. В статье, опубликованной на arXiv, описывается система WEQA (Wearable hEalth Question Answering), которая использует адаптивное агентное рассуждение для работы с высокоразмерными и непрерывными данными, поступающими от носимых датчиков.
Новый датасет для анализа звуков выстрелов из разных видов оружия
Учёные представили новый открытый датасет Certus Caliber Classification Gunshot Dataset (C3GD), предназначенный для анализа звуков выстрелов из огнестрельного оружия. В его основе лежит более 8000 записей, охватывающих широкий спектр видов оружия, калибров, патронов, микрофонов и их расположений.
Исследование: как ИИ-модели теряют когнитивные способности в длительных диалогах
Новое исследование на arXiv обращает внимание на проблему когнитивного увядания (cognitive atrophy) в поведении больших языковых моделей (LLM). Авторы отмечают, что существующие бенчмарки оценивают знания, безопасность и качество ответов, но не учитывают, как модели ведут себя в длительных, эмоционально насыщенных диалогах.
Поисковый движок для 5600 AI-статей за 1 доллар
Разработчики создали поисковую систему для 5600 научных работ по ИИ, потратив всего 1 доллар. Проект использует данные из ArXiv и позволяет быстро находить релевантные исследования по ключевым словам и темам.
Исследование выявило скрытые региональные предвзятости в LLM
Современные чат-боты часто используют данные о местоположении пользователей, чтобы адаптировать ответы. Однако исследователи из arXiv обнаружили, что модели могут генерировать географические ссылки даже при нейтральных запросах. Это явление называется location leakage — утечка местоположения.