Исследования и наука

Масштабирование LLM и точность социальных симуляций arXiv · 02.07.2026 Исследователи проанализировали, помогает ли увеличение вычислительных мощностей и параметров моделей повысить реалистичность социальных симуляций на базе LLM. Работа проверяет, является ли точность моделирования следствием общих способностей нейросетей или требует отдельных архитектурных решений. Результаты показывают, что текущая парадигма масштабирования не гарантирует автоматического устранения разрывов в достоверности поведения виртуальных агентов в сложных социальных контекстах. Языковые модели как инструмент измерения культурных явлений arXiv · 02.07.2026 Исследователи проанализировали использование больших языковых моделей для количественной оценки культурных феноменов. Авторы доказывают, что процесс измерения в NLP не является пассивной фиксацией данных, а представляет собой материально-дискурсивную практику. Выбор архитектуры модели, обучающей выборки и методов аннотирования напрямую участвует в формировании той культурной реальности, которую исследователи пытаются измерить и описать с помощью ИИ. Проблема оценки вклада ИИ: почему промпт не является конечным продуктом Hacker News · 02.07.2026 Дискуссия вокруг оценки интеллектуального вклада при использовании генеративного ИИ смещается от промпт-инжиниринга к анализу итогового результата. Автор статьи утверждает, что сам по себе запрос к модели не является «работой», а лишь инструментом. Ценность создается в процессе итераций, верификации данных и интеграции сгенерированного контента в бизнес-процессы, что требует глубокой экспертизы, а не просто навыка написания промптов. Оптимизация тестирования и обучения стабилизаторных состояний при ограниченной квантовой памяти arXiv · 02.07.2026 Исследователи представили алгоритм для тестирования и обучения стабилизаторных состояний в условиях ограниченной когерентной квантовой памяти. Работа решает проблему эффективной обработки n-кубитных состояний, когда доступный объем памяти k значительно меньше размера системы. Авторы доказывают, что при строгих ограничениях на память возможно достижение высокой точности идентификации квантовых состояний, что критически важно для масштабирования квантовых вычислений и коррекции ошибок. Extreme Adaptive Transformer: новый подход к прогнозированию редких событий в данных arXiv · 02.07.2026 Исследователи представили архитектуру Extreme Adaptive Transformer, предназначенную для повышения точности прогнозирования временных рядов с редкими, но критически важными экстремальными значениями. Модель решает проблему «замыливания» аномалий в стандартных трансформерах, что критически важно для таких областей, как гидрология, управление водными ресурсами и системы раннего предупреждения, где пиковые показатели определяют эффективность принятия решений. Исследование: качество кода ИИ-агентов зависит от усилий на рассуждение, а не от инструментов arXiv · 02.07.2026 Новое исследование ставит под сомнение эффективность расширения функционала ИИ-агентов для написания кода. Анализ 90 независимых запусков показал, что доступ к дополнительным инструментам, таким как браузерное тестирование, не гарантирует успех. Ключевым фактором надежности результата является объем вычислительных усилий, затраченных моделью на логические рассуждения в процессе генерации, а не количество доступных внешних сервисов. Миграция исследований NLP в сторону общего машинного обучения arXiv · 02.07.2026 Исследование arXiv выявило значительный сдвиг в академической среде: фокус разработок в области обработки естественного языка (NLP) смещается из профильных конференций, таких как ACL, в сторону площадок по общему машинному обучению. Анализ публикаций показывает, что развитие больших языковых моделей стирает границы между дисциплинами, заставляя исследователей чаще публиковать работы на междисциплинарных форумах по ML. Генерация 3D-интерьеров сложной геометрии с помощью LLM arXiv · 02.07.2026 Исследователи представили новый метод синтеза 3D-сцен для помещений со сложной, неортогональной геометрией (non-Manhattan environments). В отличие от существующих решений, ориентированных на стандартные прямоугольные планировки, предложенный подход позволяет эффективно моделировать нестандартные пространственные связи и объекты, значительно снижая количество геометрических ошибок и повышая физическую достоверность создаваемых интерьеров на основе текстовых описаний. Object-centric LeJEPA: новый подход к обучению визуальных энкодеров arXiv · 02.07.2026 Исследователи представили Object-centric LeJEPA — метод обучения визуальных энкодеров, который фокусируется на отдельных объектах вместо анализа сцены целиком. Такой подход позволяет моделям достигать высокой эффективности при меньшем объеме обучающих данных. Технология решает проблему избыточности традиционных методов самообучения, предлагая более точное представление визуальных признаков для последующих прикладных задач компьютерного зрения. Метод ACID повышает точность планирования в моделях мира для робототехники arXiv · 02.07.2026 Исследователи представили метод ACID (Action Consistency via Inverse Dynamics), решающий проблему расхождения между прогнозами моделей мира и реальным поведением среды. Новый подход внедряет проверку согласованности действий через обратную динамику, что позволяет отсеивать нереалистичные траектории при планировании в реальном времени, значительно повышая надежность управления автономными агентами и роботами в сложных условиях. Автономные ИИ-агенты для проведения научных исследований в физике arXiv · 02.07.2026 Исследователи представили отказоустойчивый конвейер на базе LLM, способный автоматизировать полный цикл научной работы: от анализа корпусов текстов до написания рукописей в области вычислительной физики. В отличие от стандартных сред, система учитывает специфику физического моделирования, где методология требует глубокого обоснования, а калибровка результатов опирается на внешние литературные источники, а не на встроенные программные песочницы. Улучшение структурной обобщаемости моделей через направленные типы CCG arXiv · 02.07.2026 Исследователи представили новый подход к архитектуре парсеров, решающий проблему неспособности моделей учитывать направление связей в структуре предложения. Переработав символьный бэкенд на основе направленных типов CCG (Combinatory Categorial Grammar), авторы добились значительного роста точности в тестах SLOG, сохранив при этом минимальное количество обучаемых параметров — всего 30 тысяч. Новый взгляд на нейронные квантовые состояния через обучение с подкреплением arXiv · 02.07.2026 Исследователи пересмотрели подход к нейронным квантовым состояниям (NQS), предложив использовать методы обучения с подкреплением (RL) для оптимизации авторегрессионных моделей. Новый метод позволяет эффективно аппроксимировать квантовые волновые функции многих тел, решая проблему сложности обучения, характерную для традиционных подходов, и обеспечивая точную выборку из распределения Борна без ограничений, присущих методам цепей Маркова. Обобщение в офлайн-обучении с подкреплением: роль структуры данных arXiv · 02.07.2026 Исследователи пересмотрели роль пессимизма в офлайн-обучении с подкреплением (RL). В работе доказано, что избыточная консервативность моделей не препятствует оптимальному обобщению в контекстных марковских процессах принятия решений (CMDP). Успех алгоритмов зависит не от степени пессимизма, а от структурных свойств данных, что открывает новые пути для повышения эффективности обучения агентов на статических наборах данных. Обучение в контексте в импульсных нейронных сетях arXiv · 02.07.2026 Исследователи представили новый подход к реализации обучения в контексте (ICL) в импульсных нейронных сетях (SNN). Ранее такие модели не справлялись со сложными задачами, требующими адаптации на лету. Авторы статьи доказали, что использование дендритных структур в однослойных сетях позволяет эффективно имитировать механизмы градиентного спуска, сопоставимые с возможностями современных трансформеров и моделей пространства состояний. Проблема доверия к LLM в химических исследованиях и разработке лекарств Hacker News · 02.07.2026 Для использования больших языковых моделей в критически важных областях, таких как фармацевтика, необходимо внедрение механизмов верификации промежуточных рассуждений. Исследователи подчеркивают, что текущие «черные ящики» склонны к галлюцинациям, что недопустимо при поиске новых молекул. Решением становится переход к моделям, которые предоставляют пошаговое обоснование своих выводов, позволяя ученым проверять каждый этап логической цепочки. Исследование Purified OPSD: почему самодистилляция вредит длинным цепочкам рассуждений arXiv · 02.07.2026 Исследователи проанализировали метод on-policy self-distillation (OPSD), используемый для улучшения логических способностей LLM через обучение на собственных траекториях с подсказками «учителя». Выяснилось, что при работе с длинными цепочками рассуждений (long-CoT) этот подход не только не дает значимого прироста производительности, но и дестабилизирует процесс обучения, приводя к деградации способности модели к глубокому мышлению. CoFL-S: новый метод управления роботами через языковые инструкции arXiv · 02.07.2026 Исследователи представили CoFL-S — фреймворк для навигации роботов, который связывает высокоуровневые языковые команды с низкоуровневым управлением движением. Система предсказывает векторные поля потоков в локальном секторе обзора робота, что позволяет точнее интерпретировать инструкции и выполнять маневры в динамических пространствах, преодолевая ограничения традиционных методов, сфокусированных только на глобальном планировании или семантическом анализе. Аддитивная архитектура MLP-GNN для прогнозирования растворимости веществ arXiv · 02.07.2026 Исследователи представили новый метод глубокого обучения для оценки растворимости химических соединений в воде, критически важного параметра в ранней разработке лекарств. В отличие от стандартных моделей, объединяющих данные в единый вектор, предложенная архитектура разделяет физико-химические дескрипторы и информацию о молекулярных графах, что позволяет интерпретировать вклад каждого компонента в итоговый прогноз. Классификация типов взаимодействия человека и ИИ в рабочих группах arXiv · 02.07.2026 Исследователи проанализировали 53 научных работы, посвященных командной работе людей и систем искусственного интеллекта, чтобы систематизировать существующие подходы к взаимодействию. На основе психологических таксономий авторы выделили пять ключевых кластеров сотрудничества, различающихся по степени автономности агентов, характеру распределения задач и уровню вовлеченности человека в процесс принятия решений, что помогает лучше понять динамику гибридных команд. Оптимизация распределения ресурсов в условиях неопределенности arXiv · 02.07.2026 Исследователи представили математическую модель для управления распределением ресурсов в режиме реального времени, когда запросы поступают последовательно, а их ценность и объем потребления являются случайными величинами. Работа фокусируется на минимизации «сожаления» (regret) при принятии необратимых решений об отклонении или принятии запросов в условиях ограниченных мощностей и потенциальной вырожденности данных. RadiomicNet: гибридная архитектура для интерпретируемой сегментации медицинских изображений arXiv · 02.07.2026 Исследователи представили RadiomicNet — двухпотоковую нейросетевую архитектуру, объединяющую глубокое обучение с классическими радиомическими признаками. Решение направлено на решение проблем «черного ящика» в медицине, обеспечивая высокую точность сегментации при значительном снижении количества параметров модели. Метод позволяет врачам лучше понимать логику принятия решений ИИ, что критически важно для клинической диагностики и планирования лечения. Новые теоретические границы для задачи мульти-секретаря arXiv · 02.07.2026 Исследователи представили работу, устанавливающую строгие нижние границы для аддитивного сожаления (regret) в задаче мульти-секретаря. Авторы доказали, что для распределений с разрывами в поддержке достижение границы O(log T) невозможно, что закрывает давний вопрос о сложности алгоритмов принятия решений в условиях неопределенности и ограниченной информации при выборе оптимальной стратегии. Исследование интерпретируемости языковых моделей в химии arXiv · 02.07.2026 Исследователи провели систематический анализ того, как химические языковые модели (CLM) кодируют молекулярные структуры при работе с форматом SMILES. Изучив восемь предобученных и шесть случайных моделей, авторы оценили способность нейросетей распознавать 78 химических подструктур. Работа проясняет влияние этапов предобучения и дообучения на формирование «химического понимания» у моделей, что критически важно для задач молекулярного дизайна и разработки новых материалов.