Искусственный интеллект

Модели, алгоритмы, биомедицинский AI и вычислительная наука.

Искусственный интеллект
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 51

Изучение готовности студентов медицинских специальностей Кореи к использованию искусственного интеллекта: поперечное исследование.

Искусственный интеллект (ИИ) стремительно трансформирует системы здравоохранения и клиническую практику, увеличивая необходимость подготовки будущих врачей к эффективному взаимодействию с технологиями ИИ в клинических условиях. Несмотря на возрастающий интерес к интеграции ИИ в медицинское образование, эмпирические данные о готовности студентов медицины использовать ИИ остаются ограниченными. Настоящее исследование направлено на оценку готовности к медицинскому ИИ среди студентов медицинских вузов Кореи и изучение факторов, связанных с этой готовностью. Было проведено поперечное исследование среди студентов, обучающихся в шестилетней медицинской программе в университете Кореи. Всего в исследовании участвовали 204 студента. Готовность к медицинскому ИИ оценивалась с помощью Шкалы готовности к медицинскому ИИ для студентов (MAIRS-MS), которая охватывает четыре области: когнитивная, способность, видение и этика. Описательная статистика, независимые t-тесты и корреляционный анализ Пирсона проводились с использованием SPSS версии 27. Средний балл готовности к медицинскому ИИ составил 4,19 по 7-балльной шкале Лайкерта, что указывает на средний уровень готовности к медицинскому ИИ. Среди подшкал наивысший средний балл был у этики (4,69), за ним следовали видение (4,44), способность (4,18) и когнитивная (3,92). Частота использования ИИ была значительно связана с готовностью к медицинскому ИИ, в то время как ежедневная продолжительность использования ИИ не имела значительного отношения. Значительных различий по полу не было обнаружено. Когда студенты были разделены на группы с низким (предварительно медицинские годы 1-2) и высоким (медицинские годы 1-4) уровнем, группа с высоким уровнем показала значительно более высокие баллы только в подшкале способности. Результаты показывают, что студенты медицины еще не готовы достаточно использовать технологии ИИ в клинической практике, особенно в отношении знаний и практических навыков, связанных с ИИ. Эти результаты подчеркивают необходимость структурированного и долгосрочного образования по ИИ в медицинских учебных планах для лучшей подготовки будущих врачей к интегрированным в ИИ условиям здравоохранения.

3 минДоказательность: средняяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedcohort studyEvidence 58

Разработка и валидация модели глубокого обучения двойного канала для прогнозирования острого повреждения почек в непрерывном режиме у критически больных пациентов.

Цель данного исследования заключалась в разработке и внешней валидации модели прогнозирования риска острого повреждения почек (ОПП) на 48 часов в реальном времени для критически больных пациентов с использованием модели глубокого обучения двойного канала (DC-AKI). Модель была разработана на основе электронных медицинских записей 28,099 пациентов в медицинском центре Beth Israel Deaconess и внешне валидирована на двух независимых когорт, состоящих из 3,108 пациентов из базы данных eICU и 2,808 пациентов из больницы народного госпиталя провинции Чжэцзян. Тридцать одна изменяющаяся во времени характеристика обновлялась каждые 6 часов. Архитектура модели DC-AKI интегрировала сети BiGRU, свёрточные слои и механизмы внимания для захвата мультишкалярных временных зависимостей. Модель достигла значений площади под кривой операционных характеристик (AUC) 0,720 (95% ДИ, 0,714-0,728) при внутренней валидации и 0,577 (95% ДИ, 0,570-0,583) и 0,798 (95% ДИ, 0,795-0,799) в двух внешних когорт. Анализ интерпретируемости SHAP выявил ключевые клинические предикторы и индивидуальные траектории риска. В заключение, DC-AKI продемонстрировала хорошую предсказательную способность в развивающей когортной популяции и на одном сайте внешней валидации, хотя производительность существенно варьировала в зависимости от учреждений. Необходимо дальнейшая валидация и локальная калибровка для поддержки её клинического применения.

3 минДоказательность: средняяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 37

Картирование пероксисомального интерактома позволяет моделирование функций и болезней на основе сетевого анализа.

Дисфункция пероксисом приводит к широкому спектру многосистемных заболеваний, однако механистическое понимание и терапевтические опции остаются ограниченными, что создает серьезные трудности для клинического управления. Стратегии вычислительного моделирования на основе сетей поддерживают генерирование гипотез, открытие биомаркеров и перераспределение лекарств, но их использование ограничено неполным охватом человеческого интерактома — особенно нехваткой достоверных данных о взаимодействиях белков (PPI) для пероксисомальных белков. Мы представляем первую всестороннюю карту пероксисомального интерактома, сгенерированную с использованием автоматизированной стратегии биолюминесцентного резонансного энергообмена, направляемой информатикой. Мы проанализировали PPI для 92 пероксисомальных белков и шести изоформ, подтвердив 68% известных взаимодействий и идентифицировав 333 новые. Интеграция с кураторскими PPI привела к расширенному пероксисомальному интерактому, обогащенному мишенями для лекарств и белками, связанными с заболеваниями. Подсеть, связанная с заболеваниями, позволила приоритизировать кандидатов для перераспределения лекарств. Производные от трансприптомных данных тканеспецифические варианты расширенного пероксисомального интерактома раскрыли различные функциональные подсистемы в девяти тканях. Анализ генетической онтологии 1,272 непероксисомальных интеракторов предположил пути, способствующие тканевой уязвимости. Наш подход предоставляет системный уровень для механистической информации о пероксисомальных заболеваниях, определения мишеней для лечения и применения к другим органеллам.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 35

Обнаружение болезни Альцгеймера на основе магнитно-резонансной томографии с использованием структуры EfficientNet-CMSACCN.

Болезнь Альцгеймера (БА) — это дегенеративное неврологическое заболевание, характеризующееся потерей памяти, ухудшением когнитивных функций и уменьшением объема мозговой ткани. Обнаружить его на ранней стадии сложно из-за вариаций в прогрессировании заболевания и ограниченных возможностей методов нейровизуализации с единственной модальностью. Диагностика болезни Альцгеймера на основе магнитно-резонансной томографии (МРТ) предоставляет дополнительные структурные и функциональные данные, однако существующие методы глубокого обучения часто сталкиваются с проблемами несбалансированности данных, высокой вычислительной сложности и ограниченной обобщаемостью. Для устранения этих пробелов разработана структура извлечения признаков из МРТ на основе EfficientNet для классификации стадий болезни Альцгеймера. EfficientNet, оснащенный комбинированным масштабированием, слоями с разделением по глубине и компонентами сжатием и возбуждением, позволяет точно охарактеризовать корковые структуры и вариации во всем мозге, сохраняя при этом вычислительную эффективность. Извлеченные признаки классифицируются с помощью сети свёрточной многомасштабной внимательной сети на основе сжатия (C-MSACCN), которая объединяет механизмы внимания и стратегии сжатия для повышения точности и снижения сложности модели. Более того, улучшенный оптимизатор соседей клеток (ICNO) тонко настраивает гиперпараметры, находя баланс между исследованием и эксплуатацией для оптимального сходимости и устойчивости. С точностью 99,9%, точностью, полнотой и F1-мерой на наборах данных модель превосходит предыдущие работы. Валидация подтверждает согласованность, а методы визуализации выделяют области, связанные с заболеванием, для предоставления клинической информации.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 30

Предвосхищающая и тематически специфическая нейронная осцилляция предсказывает эстетическую оценку поэзии.

Поэзия конденсирует язык в минимальные формы, вызывая эмоции, визуальные образы и эстетические суждения, однако нейронная основа таких оценок остается плохо изученной. Мы исследовали, как мозг оценивает две структурно сопоставленные, но тематически разные поэтические формы: хайку на тему природы и сенрю на тему эмоций. Участники читали стихи и оценивали их по пяти критериям - эстетическая привлекательность, яркость образов, эмоциональная вовлеченность, оригинальность и креативность - в то время как записывалась ЭЭГ. Используя многоклассовые модели градиентного бустинга с SHapley Additive exPlanations, мы предсказали оценочные рейтинги на основе осцилляторных нейронных характеристик в разных временных окнах и областях скальпа. Модели показали лучшие результаты по сравнению с линейными базовыми моделями и имели ограниченную обобщаемость между темами, указывая на контентно-специфическое нейронное кодирование. Обнаружились различия в процессах обработки: сенрю продемонстрировала более сильные вкладки в бета-диапазон, в то время как хайку задействовало более распределенные многочастотные динамики. Временные профили также различались, при этом хайку показывало устойчивое вовлечение на этапах чтения и размышления, а сенрю демонстрировала более раннюю оценку во время чтения. Предшествующая нейронная активность способствовала предсказанию последующих оценок, что предполагает роль предвосхищающего состояния мозга в эстетической оценке. По всем стихотворениям оценочные измерения сходились на доминирующей общей оси, которая надежно предсказывалась на основе нейронных характеристик. В совокупности эти результаты указывают на то, что эстетическая оценка поэзии отражает взаимодействие между предвосхищающими нейронными состояниями, контентно-специфической осцилляторной динамикой и процессами, специфичными для измерений, организованными вокруг общей оценочной оси. Эта работа устанавливает поэзию как удобную модельную систему для изучения того, как мозг конструирует смысл и ценность из минимального языкового ввода.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 28

Большие языковые модели точно определяют причины решений в устных отчетах.

Понимание причин, стоящих за человеческими выборами в условиях риска, является центральной целью науки о принятии решений, однако традиционные методы, основанные на поведенческих данных, ограничены строгими предположениями о неизменности. Мы представляем масштабируемую аналитическую структуру с использованием больших языковых моделей (BLM) для анализа устных отчетов и выявления сформулированных причин выбора между денежными лотереями. Проверенная BLM точно определила предопределенные причины решений в свободных текстовых отчетах участников, что совпало с их фактическими выборами в 95% случаев. Наш анализ показывает, что причины, лежащие в основе решений людей, варьируются систематически и в большей степени зависят от структуры проблемы выбора, чем от индивидуальных различий. Важно отметить, что причины, полученные из устных отчетов, предоставляют более экономичные и информативные представления процессов принятия решений, чем те, что исходят только из выборов; кроме того, профили причин, специфичных для проблемы, достигают точности предсказаний вне выборки, которая сопоставима с установленными вычислительными моделями. Эта работа демонстрирует, что устные отчеты являются богатым источником данных, и наша аналитическая структура может раскрыть их потенциал, предоставляя результаты, которые ставят под сомнение основные предположения о неизменности в этой области и прокладывают путь к более контекстно чувствительным и интерпретируемым моделям человеческого принятия решений.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 28

Комбинаторное принятие решений, основанное на многокомпонентных поверхностных конденсатах.

Живые организмы полагаются на молекулярные сети, такие как генетические цепи и сигнальные пути, для обработки информации и надежного принятия решений в переполненных и шумных средах. Последние достижения показывают, что взаимодействующие биомолекулы самоорганизуются посредством фазовых переходов в сосуществующие пространственные компартменты, называемые конденсатами, зачастую на клеточных поверхностях, таких как хроматин и мембраны. В данной работе мы демонстрируем, что многокомпонентные жидкости могут быть спроектированы для рекрутинга различных конденсатов на поверхности с различными составами, выполняя форму классификации поверхности посредством конденсации. Мы проводим аналогию с многомерной классификацией в машинном обучении и исследуем, как скрытые виды, аналогичные скрытым узлам, расширяют выразительность и емкость этих взаимодействующих ансамблей для облегчения сложных границ решений. Простое изменение уровней отдельных видов позволяет повторно запрограммировать тот же молекулярный репертуар для решения новых задач. Наши выводы показывают, что физические процессы, лежащие в основе биомолекулярных конденсатов, могут кодировать и управлять адаптивной обработкой информации, выходя за рамки компартментализации.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 24

Повреждение средней кишки вызывает рекрутирование гемоцитов, зависимое от тромбоксана A2, у Culex pipiens molestus

Комары передают разнообразные патогены через повторные кровососания, что подвергает среднюю кишку значительному механическому стрессу и клеточному повреждению. Хотя известно, что гемоциты ассоциируются со средней кишкой после травмы, механизмы, способствующие их рекрутированию, остаются слабо определёнными. Учитывая сохранённые роли эйкозаноидного сигнального пути в ответах на травмы, мы предположили, что тромбоксин A2 (TXA2) участвует в рекрутировании гемоцитов к повреждённой средней кишке. В данной работе мы демонстрируем, что химически индуцированное повреждение средней кишки значительно увеличивает как количество гемоцитов, прикреплённых к средней кишке, так и циркулирующих в организме. Фармакологическая блокада циклооксигеназы подавляет рекрутирование гемоцитов, тогда как добавление стабильного аналога TXA2 восстанавливает ответ, что указывает на необходимость сигнального пути TXA2 для данного процесса. Чтобы выявить кандидаты-ферменты, вовлечённые в биосинтез TXA2, мы провели докинг-анализы в silico и идентифицировали два кандидата из семейства цитохрома P450 (CYP). Среди них CYP6D3 был показан как сильно регульрованный в популяциях гемоцитов после повреждения средней кишки. Интерференция РНК с помощью нокаута CYP6D3 значительно снизила как рекрутирование гемоцитов к средней кишке, так и системные уровни TXB2, поддерживая его роль в эйкозаноидной иммунной реакции. В совокупности, наши данные показывают, что сигналы TXA2 обеспечивают рекрутирование гемоцитов к повреждённой средней кишке комара и предполагают наличие сохранённого липидно-опосредованного механизма, лежащего в основе тканевой иммунной реакции у насекомых, который может влиять на векторную компетентность.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedcohort studyEvidence 52

Двунаправленный анализ ишемического инсульта на основе спектров SERS мочи и ультразвука ствола сонной артерии.

Достижение ненавязчивого высокочастотного мониторинга ишемического инсульта (ИИ) остается важной клинической задачей для своевременного вмешательства и точной вторичной профилактики. Установление точных корреляций между системными микроскопическими молекулярными отпечатками пациентов и локализованными макроскопическими патологическими событиями в органах является необходимым для преодоления ограничений одномодального выявления и повышения эффективности клинической оценки риска. Однако, учитывая сложность гетерогенных данных, эффективная интеграция кросс-мерных данных «молекулярной визуализации» остается критическим узким местом на пути к достижению этой цели. В данном исследовании мы представляем метод, подтверждающий возможность различия между пациентами с подтвержденным ИИ и здоровыми контрольными группами (ЗК), который использует методы машинного обучения (МЛ) в сочетании с поверхностно-усиленной рамановской спектроскопией (SERS) мочи (одномерные данные) и ультразвуковым изображением ствола сонной артерии (CBI) (двухмерные данные). В экспериментальной когорте из 101 участника данный подход проанализировал 10 100 спектров SERS и 481 изображение CBI, достигнув 92% точности классификации и площади под кривой (AUC) 0,95. Более того, с помощью комбинации спектров SERS и технологии жидкостной хроматографии-масс-спектрометрии данное исследование предварительно исследовало различия в мочевых биомаркерах между группами ЗК/ИИ. Предложенная в этом исследовании стратегия многомерного слияния данных эффективно преодолевает информационный разрыв между традиционным молекулярным выявлением и клиническими фенотипами, систематически соотнеся микрофлюидные биомаркеры с макроорганными изображениями. Этот подход предоставляет ранее не исследованный, ненавязчивый и высокоточный инструмент для стратификации риска и клинического принятия решений при классификации групп ЗК/ИИ.

3 минДоказательность: средняяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 31

К направлению автономной роботизированной и микророботизированной хирургии.

Автономная роботизированная хирургия (АРХ) стала многообещающей целью в области биомедицинских технологий, дополнительно усовершенствованной миниатюризацией в направлении микророботизированной хирургии (μ-АРХ). Это уменьшение масштаба обещает малотравматичные, частично или полностью автоматизированные хирургические процедуры, способные сократить время восстановления пациентов, снизить медицинские расходы и предоставить ранее недоступные процедурные возможности. Данная перспектива подчеркивает конкретные достижения в АРХ, которые потенциально могут быть адаптированы для микромасштаба (μ-АРХ), организованные по пяти хирургическим направлениям: эндоваскулярная, эндолюмinale, лапароскопическая, офтальмологическая и ортопедическая. Мы исследуем как клинические потребности, так и технологические достижения в области хирургической робототехники и выделяем ключевые инновации, необходимые для прогресса в этих хирургических областях. Наш вклад уникален тем, что объединяет взгляды как хирургических экспертов, так и новаторов в области биомеханики, очерчивая дорожную карту для продвижения и окончательной интеграции автономной АРХ и μ-АРХ в основное хирургическое практику.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 28

Моделирование популяционных пангеномов под коалесцентными демографическими моделями с помощью MSpangenome

Мотивация: Графы разнообразия пангеномов (PVGs) все чаще используются для представления геномного разнообразия, однако в настоящее время отсутствует общая структура для прямого генерирования популяционных пангеномов из явных эволюционных историй. Существующие симуляторы обычно сосредоточены на отдельных классах вариации и не интегрируют эти вариации в рамках генеалогической структуры, основанной на явных демографических историях. В результате оценка методов пангеномов в реалистичных популяционно-генетических условиях остается сложной задачей, а эталонные наборы данных с известной эволюционной истинной редко встречаются. Результаты: Мы представляем MSpangenome - структуру, учитывающую генеалогию, которая связывает симуляции популяционной генетики по модели коалесценции и анализы графов пангеномов. Этот конвейер объединяет симуляцию предков с msprime и алгоритм построения графов de novo для генерации PVGs непосредственно из смоделированных генеалогий. Явно моделируя рекомбинацию, демографическую историю и неполную сортировку линий, MSpangenome производит структурно сложные пангеномы, в которых вложенные и перекрывающиеся структурные варианты естественным образом возникают из базовых генеалогий, в то время как их эволюционная история и топология графа остаются известными по конструкции. Это обеспечивает общую структуру для генерации реалистичных популяционных пангеномов и установления наборов данных с известной истинной для методической оценки. Мы демонстрируем его полезность, генерируя пангеномы на уровне популяции и используя их в качестве контролируемых ссылок для оценки широко используемых инструментов построения графов, таких как PGGB и Minigraph-Cactus. Наши анализы выявили контрастные режимы производительности в зависимости от уровней разнообразия последовательностей, размеров образцов и классов структурной вариации, подчеркивая ценность симуляционных оценок для выявления ошибок реконструкции, которые трудно обнаружить, используя только эмпирические наборы данных. Доступность и реализация: MSpangenome реализован на Python, полностью контейнеризирован, доступен бесплатно по адресу https://forge.inrae.fr/pangepop/MSpangepop и зеркалирован на https://github.com/inrae/MSpangepop.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 35

Мужской семенной затычка увеличивает фертильность самок нематод Caenorhabditis

Геномы самоплодных гермафродитов предоставляют уникальную возможность исследовать, почему некоторые гены с полоспецифическими функциями теряются, в то время как другие сохраняются. В андродиецком виде Caenorhabditis elegans наличие семенной затычки полиморфно среди генетических фонов. Производство семенной затычки контролируется единственным геном plg-1, который имеет выражение, специфичное для самцов. Учитывая, что самцы присутствуют менее 1% времени, этот ген, вероятно, теряется из-за ослабленного отбора или очистительного отбора, особенно если сохранение семенной затычки поддерживается внутришлюпочным отбором у самцов, как это часто предполагается. Мы использовали разнообразную панель из почти 2000 природных штаммов C. elegans, чтобы показать, что plg-1 сохраняется как минимум в 61% генетических фонов, несмотря на андродиецкую систему спаривания. Оценки генетического разнообразия показывают, что утрата plg-1 коррелирует с глобализацией видов. Мы показали, что общая фекундитет гермафродита не коррелирует с генотипом plg-1, указывая на то, что этот ген не сохраняется через связь с полезным геном гермафродита. Затем мы продемонстрировали как на C. elegans, так и на обязательном бисексуальном виде C. remanei, что наличие семенной затычки не гарантирует отцовства, предотвращая спаривание последующих самцов. Вместо этого самки с семенной затычкой имеют более длительное пиковое репродуктивное окно и более высокую фекундитет, чем самки без семенной затычки. В совокупности эти результаты указывают на то, что семенная затычка является полезной для самок. Мы предполагаем, что эта польза возникает из того, что семенные затычки действуют как покрытие вагины, которое может препятствовать потере спермы во время откладывания яиц, тем самым снижая лимит спермы. Наша работа указывает на то, что семенная затычка может не всегда вызывать конкуренцию между самцами и может представлять собой репродуктивное сотрудничество. Более широко, это демонстрирует, что выражение генов, специфичных для самцов, не означает, что их функции также специфичны для самцов, особенно в контексте репродуктивных взаимодействий.

Предварительная публикация без научного рецензирования.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 34

Масштабируемая много групповая ненегативная пространственная факторизация для пространственных геномных данных с гетерогенностью клеточных типов

Технологии пространственной транскриптомики (СТ) позволяют изучать экспрессию генов в контексте пространственной организации тканей, предоставляя идеи о структуре тканей, клеточных взаимодействиях и прогрессии заболеваний. Однако существующие методы уменьшения размерности часто игнорируют пространственную информацию или не могут отличить пространственные генетические паттерны от паттернов, вызванных различиями в клеточных типах, что ограничивает биологическую интерпретацию, сворачивая различия в паттернах экспрессии генов с различиями в пропорциях клеточных типов. Чтобы решить эти проблемы, мы представляем масштабируемую много групповую ненегативную пространственную факторизацию (smNSF) — вычислительно удобную вероятностную модель, которая интегрирует пространственные координаты и метки клеточных типов в единую модель матричной факторизации. Используя много групповые гауссовские процессы (MGGP) в качестве априорных значений, наша модель захватывает сложные пространственные вариации специфическим для клеточного типа образом, при этом обеспечивая ненегативность для улучшения интерпретируемости. Мы разрабатываем вариационную инференцию для MGGP, которая поддерживает масштабируемую оптимизацию и улучшает численную стабильность smNSF. На семи наборах данных пространственной транскриптомики, охватывающих разнообразные технологии и ткани, smNSF восстанавливает разреженные, интерпретируемые пространственные факторы и, через свои умовные постериоры для клеточных типов, организует их в пространственные программы, обогащенные клеточными типами, специфичные для клеточных типов и универсальные, которые не очевидны из маргинальных факторов. Учитывая метки клеточных типов в данных СТ, smNSF дает возможность проводить пространственные декомпозиции с учетом клеточных типов и поддерживает умовные постериоры для in silico исследования взаимосвязей между пространственными паттернами и клеточной идентичностью. Резюме автора: Большинство современных методов анализа пространственной транскриптомики либо игнорируют пространственную структуру, либо не могут отделить пространственные паттерны, обусловленные геном, от различий, вызванных клеточными типами. В данной работе мы разрабатываем метод, который использует пространственные координаты и метки клеточных типов вместе, чтобы лучше выявить паттерны экспрессии генов. Наш подход, масштабируемая много групповая ненегативная пространственная факторизация (smNSF), использует гауссовские процессы для моделирования пространственной структуры, которые мы расширяем, чтобы захватить как пространственную структуру, так и клеточный тип в единой рамке, называемой много групповыми гауссовскими процессами. Применяя smNSF к наборам данных пространственной транскриптомики из мозга мыши и тканей человека, мы обнаруживаем, что условие на разные клеточные типы выявляет пространственные паттерны, которые невидимы в стандартных анализах: некоторые клеточные типы подавляют паттерн, другие усиливают его, а некоторые раскрывают структуру, которая проявляется только после условия. Это помогает нам понять, как специфические для клеточных типов пространственные программы способствуют организации тканей. Чтобы сделать этот анализ выполнимым на масштабе современных пространственных экспериментов, мы также вводим новую вычислительную аппроксимацию для гауссовских процессов, которая в принципе может быть прямо применена к другим моделям латентных переменных GP. Вместе эти инструменты помогают разбирать биологические источники вариации и поддерживают in silico исследование того, как может изменяться экспрессия генов при различных композициях тканей или клеточных типов.

Предварительная публикация без научного рецензирования.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 24

Конкурирующие эффекты модулируют скорость деполиаденилирования РНК с поли(A) в биомолекулярном конденсате

Уникальная растворительная среда, обнаруживаемая в биомолекулярных конденсатах, может контролировать клеточные ферментативные реакции и изменять кинетику реакций, модулируя концентрации реагентов, структурную динамику и активности ферментов. В данной работе мы исследуем взаимодействие множества регуляторных факторов внутри конденсата для контроля за деполиаденилированием РНК с поли(A), которое является первым и лимитирующим шагом в деле разложения мРНК. Деполиаденилаза CNOT7, подсостав CCR4-NOT комплекса деполиаденилирования, локализуется в цитоплазматических РНК-гранулах и демонстрирует повышенную активность деградации в vitro в конденсатах, образованных C-концевой областью низкой сложности CAPRIN1, компонента РНК-гранул. Мы используем комбинацию ферментативных анализов, кинетического моделирования, микроскопии, ядерного магнитного резонанса (ЯМР) и молекулярных динамических симуляций для деконволюции и определения компонентов, которые лежат в основе этого усиления. Мы выяснили, что фермент и РНК концентрируются в конденсатах относительно буфера, что увеличивает активность CNOT7, в то время как равновесие между активным и неактивным состояниями CNOT7 остается неизменным. Увеличение кинетических скоростей, зависимое от концентрации, компенсируется значительным снижением каталитической эффективности фермента, вероятно, из-за более медленной диффузии CNOT7 и РНК внутри конденсатов, что уменьшает вероятность образования комплекса фермент-подсубрат. Молекулярные динамические симуляции показывают взаимодействия CNOT7-CAPRIN1, которые полагаются на особенности консервативной последовательности CAPRIN1, указывая на эволюционно консервативную роль конденсации CAPRIN1. С помощью этого количественного кинетического анализа мы описываем многоаспектный механизм регулирования деполиаденилирования CNOT7 в условиях конденсата.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 25

KRCA: Эффективная система анализа коренных причин в гипермасштабируемых микросервисных системах с использованием агентного ИИ

Гипермасштабируемые микросервисные системы стали стандартной инфраструктурой для крупных интернет-компаний. Эти системы состоят из множества слабо связанных микросервисов, которые развиваются независимо через постоянную разработку и развертывание. Такая сложность делает сбои неизбежными, что требует эффективного анализа коренных причин (RCA), чтобы помочь инженерам по надежности сайтов (SRE) быстро локализовать корневые сервисы и классифицировать типы сбоев. Однако существующие методы RCA часто сталкиваются с трудностями в адаптации к экстремальной динамичности и масштабам этих систем. В этой работе мы представляем KRCA, сквозную систему RCA, разработанную для гипермасштабируемых микросервисных систем. Для управления обширным пространством поиска KRCA использует многоступенчатый конвейер, который начинается с досконального анализа на уровне API для изоляции подозрительных сервисов. Затем он создает граф причинно-следственных связей на основе аномальных метрик, чтобы служить высокореколлным структурным приоритетом, прежде чем использовать память-расширенную многоагентную структуру для проверки причинности и генерации окончательного отчета о сбое. Объединив структурированные причинно-следственные ограничения с многоагентным рассуждением, KRCA обеспечивает баланс между диагностической точностью и требованиями к эффективности для использования в реальном времени. Экспериментальные результаты показывают, что KRCA достигает оценок AC@1 0.88 и 0.79 для локализации корневых сервисов и классификации типов сбоев, превосходя самые сильные базовые показатели по крайней мере на 31% в абсолютных приростах. KRCA была внедрена в производственной среде Kuaishou на протяжении более шести месяцев, что позволило сократить среднее время диагностики на 77.3%.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 28

WUSTCA: улучшенная классификация радиочастотных сигналов БПЛА с использованием вейвлет-преобразования и механизмов внимания STCA.

Беспилотные летательные аппараты (БПЛА) играют важную роль в различных гражданских и коммерческих приложениях, что требует точной классификации их радиочастотных (РЧ) сигналов. Современные подходы на основе глубокого обучения сталкиваются с высокой вычислительной сложностью, чувствительностью к шуму и ограниченной точностью. В данной статье предлагается новая структура классификации сигналов БПЛА, которая сочетает в себе вейвлетное извлечение признаков с иерархической архитектурой U-Net, дополненной механизмами внимания с раздельным временем (STCA) и остаточной связанностью. Модель WUSTCA эффективно классифицирует сигналы БПЛА и их контроллеров, достигая средней точности классификации 96,6% для БПЛА и 95,83% для контроллеров БПЛА на наборе данных CardRF. Решая такие проблемы, как помехи шума и разнообразие сигналов, данная работа предоставляет надежное и эффективное решение для классификации сигналов БПЛА, открывая путь для приложений в реальном времени в сложных условиях.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedotherEvidence 27

Искусственный интеллект и диагностика болезни Хиршпрунга.

В исследовании рассматривается использование технологий искусственного интеллекта для диагностики болезни Хиршпрунга, редкого расстройства кишечника, характеризующегося отсутствием нервных клеток в определенных участках толстого кишечника. AI может помочь в улучшении точности и скорости диагностики, что особенно важно для ранней интервенции.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 36

Starmate: Легковесный ИИ-ассистент для опекунов людей с аутизмом, разработанный и оценённый с использованием ориентированной на пользователя смешанной методологии.

Аутизм и расстройства спектра аутизма (РАС) затрагивают десятки миллионов семей по всему миру, однако родители сталкиваются с обилием, но ненадёжными онлайн-советами и ограниченным доступом к своевременному, сочувственному руководству. Чтобы заполнить этот критический пробел, мы разработали Starmate (http://kefeng.mpu.edu.mo/starmate) — ИИ-ассистент с 1,5 миллиарда параметров, адаптированный для опекунов людей с РАС, используя строгую ориентированную на пользователя смешанную методологию. На основе углублённых интервью и опроса Kano, который выявил «практическое руководство» как необходимое требование для опекунов, мы сконструировали новую модульную архитектуру, интегрирующую анализ настроений, извлечение знаний на основе графов, проверенное экспертами (LightRAG), и модель Qwen2.5-1.5B, специально подстроенную под нашу домен. В слепом сравнении с ведущими коммерческими крупными языковыми моделями, Starmate показал улучшенные результаты по ключевым метрикам в рамках данной оценки (86.76 против 78.43-83.84) и продемонстрировал конкретные преимущества в области эмпатии, практического руководства и логической ясности. Автоматизированное бенчмаркинг также подтвердило эти результаты, с высокими оценками по профессиональной точности (86.18), эмпатии (86.79) и практическому руководству (82.58). Эти результаты демонстрируют техническую возможность легковесной, ориентированной на конфиденциальность, специализированной крупной языковой модели для генерации точных, эмпатичных и действенных ответов в бенчмаркинговых сценариях, создавая основу для будущей реальной пригодности и клинического тестирования.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектbioRxivpreprintEvidence 31

Нейронное отслеживание речевой огибающей волны как индикатор пространственного освобождения от маскировки

Понимание речи в шумных условиях сильно зависит от бинауральных подсказок, таких как межушные временные и уровеньные различия (ITDs и ILDs), которые поддерживают пространственное слуховое восприятие и сегрегацию конкурирующих звуковых источников. Когда эти подсказки ухудшаются, слушатели испытывают значительные трудности в сложных акустических условиях. Поведенческие меры бинауральной выгоды, такие как различия уровней маскировки и различия уровня разборчивости, а также пространственное освобождение от маскировки (SRM), хорошо изучены у слушателей с нормальным слухом (NH), однако они требуют активного поведенческого ответа. Нейронное отслеживание речи с использованием электроэнцефалографии (ЭЭГ) стало многообещающим подходом для количественной оценки нейронной обработки непрерывной речи, однако его чувствительность к пространственным слуховым подсказкам остается недостаточно охарактеризованной. Мы исследовали нейронные корреляты пространственного освобождения от маскировки у слушателей с нормальным слухом с использованием нейронного отслеживания речи на основе ЭЭГ. Девятнадцать участников слушали непрерывные голландские речевые истории, представлены с маскирующим шумом в двух пространственных конфигурациях: совмещенные (S0N0) и пространственно разделенные (S0N90) при различных соотношениях сигнал-шум (SNR). Нейронное отслеживание огибающей волны речи было количественно оценено с помощью анализа реконструкции огибающей волны и анализа временной реакции (TRF). Пространственное разделение усилило нейронное отслеживание огибающей волны целевой речи, особенно при сложных соотношениях SNR, где также наблюдалось поведенческое SRM. Анализ TRF дополнительно показал, что увеличились амплитуды и уменьшились задержки поздних корковых компонентов, что соответствует эффектам пространственного раскрепощения. Эти результаты демонстрируют, что нейронное отслеживание речи фиксирует корковые сигнатуры пространственного раскрепощения и closely отображает поведенческие улучшения в понимании речи. Установление этих взаимосвязей у слушателей с нормальным слухом поддерживает разработку объективных нейронных мер для оценки бинауральной выгоды у трудно тестируемых групп.

Предварительная публикация без научного рецензирования.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 28

Генерация клинических отчетов о лекарственных препаратах с использованием многофазных моделей с подсказками.

Исследование посвящено использованию многофазных моделей с подсказками для автоматизации процесса генерации клинических отчетов о лекарственных препаратах. Основное внимание уделяется применению таких моделей в области ветеринарии, где проводились эксперименты на животных для оценки эффективности данной методологии.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 39

Алгоритмы машинного обучения для определения пола по измерениям черепа и таза, полученным с помощью 3D-компьютерной томографии.

Определение пола по останкам скелета является ключевым элементом судебной антропологии, при этом череп и таз являются наиболее различимыми по полу элементами с точки зрения морфологии. Традиционные морфометрические подходы, такие как дискриминантный анализ и логистическая регрессия, достигли высокой точности в оценке пола среди различных популяций, включая южноафриканцев. Однако использование машинного обучения (МЛ) для определения пола на основе измерений черепа и таза еще не было исследовано ни в одной южноафриканской популяции. Это исследование оценивало потенциал алгоритмов МЛ для определения пола по черепным и тазовым измерениям, полученным с помощью компьютерной томографии (КТ) современных чернокожих южноафриканцев. В выборку вошли 680 элементов скелета (400 черепов и 280 тазовых костей) с равным распределением мужчин и женщин. КТ-сканы, архивируемые в Отделе радиологии Академической больницы Шарлотты Макеке в Йоханнесбурге, были реконструированы в 3D-модели с помощью программного обеспечения Xiris и IntelliSpace, откуда были собраны восемь черепных и одиннадцать тазовых измерений. Применялись семь классических алгоритмов МЛ, и использовались методы ранжирования признаков для определения наиболее информативных переменных для оценки пола. Затем была разработана модель стекового обучения МЛ, в которую были включены три лучших классификатора в качестве базовых моделей. Их выводы были объединены и переданы различным алгоритмам МЛ, которые выступали в роли мета-обучающих для финальной классификации. Результаты подтвердили сильный половой диморфизм в черепных и тазовых костях, а стековые модели достигли высокой точности (череп: 80,3-94,3%; таз: 86,1-96,1%) по сравнению с традиционными многовариантными методами, демонстрируя потенциал МЛ в судебном определении пола.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектPubMedanimal studyEvidence 36

Компактная четырехпортовая MIMO-антенна с круглой поляризацией, вдохновленная машинным обучением, для многодиапазонных беспроводных приложений.

В данной работе представлена компактная MIMO-антенна с четырьмя элементами, демонстрирующая резонанс на частотах 6.39 ГГц, 11.09 ГГц, 14.69 ГГц и 17.96 ГГц, охватывающая диапазоны C, X и Ku соответственно в рамках одной компактной структуры. Разработанная четырехэлементная MIMO-антенна использует Y-образную радиирующую монопольную конфигурацию с соединённымиGround-элементами для удобной интеграции в системы. Также разработанная MIMO-антенна достигает геометрически обусловленной круглой поляризации (CP) под определёнными углами возвышения без внешних фазовращателей или паразитных структур, что приводит к повышенной надежности против затухания многопутевых сигналов и несовпадения поляризаций. Кроме того, критически важный параметр высокой изоляции между элементами поддерживается (Sij < -20 дБ), эффективно подавляя взаимные помехи. Параметры представленного дизайна четырехпортовой антенны также оптимизированы с использованием различных алгоритмов машинного обучения, причем модель гауссовской регрессии оказалась наиболее подходящей, обеспечивая наилучшие показатели возвратных потерь. В заключение, разработанная четырехпортовая MIMO-антенна была изготовлена, и её прототип протестирован для валидации смоделированных результатов. Компрéhенсивный анализ характеристик разнообразия демонстрирует параметры ECC (≤ 0.001), DG (≈ 10 дБ), CCL (< 0.2 б/с/Гц) и TARC (> 9.99), что обеспечивает эргодическую пропускную способность канала, превышающую 9 б/с/Гц. Средняя эффективность наблюдается на уровне 57% по всем диапазонам с пиковым усилением 9.78 дБи на 17.96 ГГц, что делает это решение высокоинтегрированным, надежным и перспективным для CP-MIMO систем связи, делая его сильным кандидатом для спутниковых и современных беспроводных приложений.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 28

Измерение разрыва между идеями исследований человека и языковых моделей

Языковые модели (ЯМ) все чаще используются для генерации идей для исследований, но существующие оценки в основном судят о каждой идее по таким критериям, как новизна, осуществимость или предпочтения экспертов. Вместо этого мы задаем вопрос: насколько далеко находятся текущие идеи, сгенерированные ЯМ, от идей человеческих исследователей? Чтобы охарактеризовать этот разрыв, мы разрабатываем рамки крупномасштабной оценки идей на основе высококачественных научных статей. Для каждой статьи мы проводим обратную разработку небольшого набора тесно связанных предыдущих работ, которые, вероятно, вдохновили ее основную идею. Затем ЯМ получают задание сгенерировать новую идею на основе набора заголовков и аннотаций статей. Мы представляем таксономию вкусов в исследованиях по двум осям, чтобы охарактеризовать каждую идею по ее паттерну возможностей и исследовательской парадигме, и используем ее для количественной оценки различий между человеческими и ЯМ-генерированными идеями. В различных наборах идей, сгенерированных разными ЯМ, мы наблюдаем постоянный распределительный разрыв: идеи ЯМ непропорционально сосредоточены вокруг возможностей синтеза и аналогий, в то время как распределение ссылок на человеческие работы намного шире и охватывает более разнообразные способы формирования разрывов и конструкций вкладов. Этот результат указывает на то, что мощные ЯМ могут производить ряд разумных идей, но этот диапазон остается уже и систематически смещенным по сравнению с исследовательским вкусом человека.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 25

Хватает ли одного слоя? Обучение одного слоя трансформера может сопоставиться с полным обучением с подкреплением

Обучение с подкреплением (RL) стало центральным компонентом постобучения крупных языковых моделей (LLMs), однако мало что известно о том, как адаптация RL распределена по слоям трансформера. Существующие подходы обычно обновляют все параметры модели равномерно, подразумевая, что каждый слой вносит схожий вклад в приросты, достигнутые в процессе постобучения с использованием RL. В данной работе мы ставим под сомнение это предположение через систематическое изучение обучения RL по слоям. Удивительно, но мы обнаружили, что обучение одного слоя трансформера может воспроизвести большую часть приростов, достигнутых при полном обучении с RL, а в некоторых случаях даже превзойти его. Чтобы количественно оценить это явление, мы вводим величину "вклад слоя", которая измеряет долю полного улучшения RL, достигнутого благодаря обучению слоя в изоляции. В рамках семи моделей, охватывающих две семейства моделей (Qwen3, Qwen2.5), три алгоритма RL (GRPO, GiGPO, Dr. GRPO) и несколько областей задач, включая математическое рассуждение, генерацию кода и агентное принятие решений, мы наблюдаем замечательно стабильный паттерн: приросты RL сосредоточены в небольшом подмножестве, а в большинстве случаев даже в одном слое трансформера. Более того, тот же структурный паттерн последовательно возникает: слои с высоким вкладом сосредоточены в середине стека трансформера, тогда как слои ближе к входу и выходу вносят значительно меньший вклад. Ранжирование слоев при этом остается сильно коррелированным между датасетами, задачами, семействами моделей и алгоритмами RL.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 28

Имитационное обучение с критикой языка на основе субоптимальных демонстраций

Предыдущие работы по имитационному обучению на основе субоптимальных демонстраций обычно полагаются на сжатые сигналы супервизии, такие как оценки уверенности, баллы дискриминатора или веса важности. Эти скалярные сигналы имеют свои ограничения, так как не могут явно выразить промежуточные размышления о ходе выполнения задачи, режимах неудачи или корректирующих действиях. Мы предлагаем рамки имитационного обучения с критическим анализом языка, которое вместо этого использует естественный язык в качестве структурированного сигнала супервизии, избегая сворачивания выразительной обратной связи в скаляры. Наш метод сначала создает языковые метки на основе демонстраций, которые явно описывают текущий прогресс, идентифицируют субоптимальное поведение и предоставляют детализированные корректирующие рекомендации. Затем мы вводим функцию потерь критики языка, которая непосредственно обучает политики, используя эти структурированные сигналы, не сводя их к скалярам, и инстанцируем ее для как имитационного клонирования поведения, так и диффузионных политик, получая LC-BC и LC-DP. Мы также предоставляем теоретический результат, показывающий, что предложенная цель обеспечивает верхнюю границу разрыва производительности эксперта при стандартных предположениях. Эмпирически мы проводим оценку на различных задачах непрерывного управления, охватывающих навигацию, манипуляцию и игровую деятельность, где наши методы последовательно превосходят сильные базы имитационного обучения и оффлайн обучения с подкреплением. Эти результаты демонстрируют, что язык может служить мощной и структурированной формой супервизии для обучения устойчивым политикам на основе субоптимальных данных.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 25

AutoMem: Автоматизированное изучение памяти как когнитивного навыка

Экспертиза в памяти является приобретенным навыком: знание того, что кодировать, когда извлекать и как организовывать знания — это способность, известная в когнитивной науке как метапамять. Мы применяем эту перспективу к большим языковым моделям (LLMs), рассматривая управление памятью как обучаемый навык. Мы придаем операциям файловой системы статус основных действий памяти наряду с действиями по выполнению задач, позволяя модели самостоятельно решать, как управлять своей памятью. Этот навык памяти улучшается по двум направлениям: структура, которая его поддерживает (подсказки, схемы файлов, словарь действий), и умение модели его применять. Оба направления устойчивы к ручной оптимизации: эпизоды в долгосрочных задачах выполняются на протяжении тысяч шагов, и одна ошибка в памяти может оставаться незамеченной на долгое время, что делает человеческий обзор полных траекторий непрактичным. Мы представляем AutoMem, фреймворк, который автоматизирует оба направления. В первом цикле сильная LLM просматривает полные траектории агента и итеративно пересматривает структуру памяти, которая определяет, как агент взаимодействует со своими файлами памяти. Во втором цикле хорошие решения агента по памяти идентифицируются из множества эпизодов и используются в качестве обучающего сигнала для прямого улучшения мастерства модели в управлении памятью. В трех процедурно сгенерированных долгосрочных играх (Crafter, MiniHack и NetHack) оптимизация памяти отдельно — без изменения поведения модели в действиях по выполнению задач — улучшила производительность базового агента примерно в 2-4 раза, позволив 32B модели с открытыми весами конкурировать с передовыми системами, такими как Claude Opus 4.5 и Gemini 3.1 Pro Thinking. Наши результаты показывают, что управление памятью является независимо обучаемым навыком и представляет собой цель с высоким потенциалом, обеспечивающую значительные улучшения в долгосрочных задачах.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 35

Теория: Проверка приемлемости переработанных выводов на основе неформальных рассуждений

Когда можно доверять ответу системы ИИ? Формальные помощники в доказательствах предлагают определенность, но не могут охватить большинство распределений задач; линейные LLM-судьи обеспечивают покрытие, но выдают непрозрачные оценки, которые не могут быть проверены после факта и подвержены тем же проблемам согласованности, что и любые LLM. Мы представляем Теорию — архитектуру верификации, которая заполняет этот пробел. Кандидатское решение переписывается в последовательность типизированных переходов состояний, каждый из которых оправдан явным обоснованием — будь то цитата, вычисление или заданный факт, и каждый переход может быть проверен независимо. Основное инвариантное требование состоит в полноте изменений: каждое отличие между последовательными состояниями доказательства должно быть учтено, чтобы скрытые предпосылки обнажались как несанкционированные мутации, а не проходили молча. На HLE-Verified Gold (185 задач для экспертов только с текстом) Теория сертифицирует 105 задач с 91.4% строгой точностью (доверительный интервал Уилсона 95% [84.5%, 95.4%]). Каждая сертификация приводит к читабельному следу доказательства, в котором каждый шаг может быть оспорен независимо. Холистические LLM-судьи достигают сопоставимой точности при аналогичном покрытии, но не справляются с разными задачами (Jaccard 0.14-0.36), что делает эти подходы дополнителями. Из 95 атакованных поврежденных доказательств в 15 областях структурированные судьи находят 94.7%, по сравнению с 83.2% для холистического судейства (p= 0.0017). В целом 11.5 процентных пункта разница сосредоточена на скрытых предпосылках (90.6% против 62.5%, разница в 28 процентных пунктов) и сфабрикованных цитатах (100% против 90%), что является классами ошибок, где формальный анализ предсказывает преимущество; производительность идентична в случаях арифметических и ошибочных применений теорем, где преимущество не предсказывается. На GPQA Diamond (n= 65) сертифицированная точность составила 97.1% (доверительный интервал Уилсона [85.1%, 99.5%]).

Предварительная публикация без научного рецензирования.

3 минДоказательность: предварительнаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 25

Гипотеза разделения предсказания состояния

Трансформеры используют один и тот же поток вычислений для предсказания следующего токена и хранения полезного состояния для будущих предсказаний токенов. Мы формулируем гипотезу о разделении предсказания состояния: разделение этих двух ролей обеспечивает лучшую производительность языкового моделирования. Мы разрабатываем вариант трансформера, который использует два вычислительных потока для разделения этих функций, и проводим эксперименты по предварительному обучению на данных различного масштаба. Наши эксперименты показывают, что разделение предсказания состояния последовательно предлагает лучшую эффективность данных и вычислений, улучшая показатель валидации и превосходя стандартные трансформеры в среднем на 2-3 процентных пункта по downstream задачам. Мы также проводим обширный эмпирический анализ, который исключает потенциальные конфаундеры и демонстрирует принципиальное различие в градиентах, которое влечет наш дизайн.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 27

Осязание и восприятие данных: Повторно используемый программный конвейер для тактильных статистических графиков в доступном образовании

Статистическая визуализация обычно рассматривается как визуальный носитель, но данные также можно воспринимать на ощупь. Трехмерные тактильные графики позволяют студентам с нарушениями зрения ощущать распределения, отслеживать тенденции и исследовать взаимосвязи через прямое тактильное взаимодействие. Однако использование таких графиков в классе остается ограниченным, поскольку создание каждого графика в CAD-программном обеспечении требует специализированных навыков и часов ручной работы. Мы рассматриваем эту проблему как программную через трехуровневый повторно используемый конвейер, состоящий из около 1500 строк JavaScript. Первый уровень автоматически извлекает параметры тактильного дизайна на основе размеров пластины с использованием исследований в области тактильного восприятия. Второй уровень предоставляет общую структуру графиков и пять модульных средств для построения разбросов, столбчатых диаграмм, гистограмм, линейных графиков и бокспотов. Необязательный третий уровень использует мультимодельную языковую модель для извлечения структурированных спецификаций графиков из загруженных изображений, с обязательной проверкой со стороны учителя перед созданием печатной версии. Конвейер генерирует готовые для печати двоичные файлы на языке стандартной тесселяции за менее чем 250 миллисекунд. Мы представляем дизайн, производительность и ограничения.

Предварительная публикация без научного рецензирования.

3 минДоказательность: низкаяЧитать далее
Искусственный интеллект
Искусственный интеллектarXivpreprintEvidence 34

FurnitureVLA: Обучение долгосрочной бимануальной сборке мебели с помощью модели видение-язык-действие

Текущие исследования в области роботизированной сборки мебели в основном сосредоточены на игрушечных масштабах или манипуляциях с одной рукой. Мы представляем FurnitureVLA, первое систематическое исследование бимануальной сборки мебели в реальном масштабе с использованием моделей видения-языка-действия (VLA). Мы формализуем задачу, разрабатываем масштабируемый симуляционный конвейер для генерации и оценки экспертных данных и создаем систему телеприсутствия в виртуальной реальности для управления бимануально одним оператором с целью сбора качественных демонстраций из реального мира. Чтобы справиться с экстремально долгосрочной сборкой, которая включает до 7 подсостояний и 1550 контрольных шагов, мы предлагаем улучшенную модель VLA, донастроенную на семантически обоснованные подсостояния, которая совместно предсказывает действия и непрерывный сигнал прогресса, позволяя автоматически переходить между подсостояниями и снижая накопление ошибок во время вывода. Мы также исследуем факторы проектирования восприятия и управления, которые критически влияют на точность в сборке в реальном масштабе. FurnitureVLA улучшает средний уровень успеха симуляции с 48% до 80% по сравнению с базовыми показателями для трех типов мебели, с дополнительным приростом в 21% благодаря изучению факторов проектирования. Мы валидируем на реальной платформе Kinova Gen3 с только 16% снижением на наиболее сложной задаче.

Предварительная публикация без научного рецензирования.

3 минДоказательность: предварительнаяЧитать далее