Недавно компания Anthropic объявила, что их популярный искусственный интеллект совершил самостоятельное биологическое открытие. Однако красивый сюжет о машине-ученом быстро столкнулся с суровой реальностью: исследователь из Дании задался вопросом, не «вдохновился» ли алгоритм его неопубликованными черновиками.
Ключевые тезисы:
- Алгоритм описал сложную систему обратных транскриптаз (ART), опираясь на повторный анализ данных 2022 года и ранее открытый фермент.
- Датский ученый Марио Родригес Местре утверждает, что загружал в чат-бот материалы о тех же ферментах, но Anthropic отрицает обучение на этих данных.
- Открытие ИИ требует лабораторной проверки: способность новых ферментов редактировать гены пока остается лишь неподтвержденной гипотезой.
Нейросеть Claude обнаружила новую биологическую систему ферментов в бактериофагах, но исследователь из Копенгагенского университета обвинил алгоритм в использовании его неопубликованных черновиков. Прямых доказательств кражи данных на данный момент нет.
В центре истории оказалась необычная группа ферментов, найденная у бактериофагов — вирусов, заражающих бактерии. Представители Anthropic назвали эту находку ART (обратные транскриптазы, ассоциированные с массивами).
Обратные транскриптазы — это важнейшие белки, которые умеют переписывать информацию с одноцепочечной молекулы РНК на двуцепочечную ДНК, хранящую главные инструкции жизни. Ученые активно используют этот механизм в лабораториях и диагностике, включая создание некоторых тестов на COVID-19. Кроме того, с помощью таких белков биологи измеряют активность генов в клетках.
Anthropic преподнесла идентификацию ART как триумф искусственного интеллекта, способного инициировать настоящие прорывы в биологии. Но этот триумф оказался с оговорками.
Марио Родригес Местре, кандидат наук в области вычислительной биологии из Копенгагенского университета, заявил, что его команда исследует эти же ферменты с 2022 года. Датские ученые дали им собственное имя — «джамботроны». Как сообщает журнал The Scientist, Местре регулярно загружал материалы своей диссертации и черновики будущих статей в чат-бот для помощи в работе.
Местре также числится среди изобретателей патента на искусственные «ретроны» — генетические системы, содержащие фермент обратной транскриптазы и связанную с ним РНК. Заявка на этот патент в США была опубликована еще в июле 2023 года. В ней прямо перечисляются последовательности обратной транскриптазы из гигантских фагов (jumbo phages) — тех самых вирусов, о которых гордо отчиталась Anthropic.
Разработчики нейросети категорически отрицают обвинения. Anthropic утверждает, что модель не обучалась на пользовательских переписках, а команда биологов компании не имела к ним доступа. На данный момент независимых доказательств того, что машина украла черновики Местре, не существует. Сам по себе патент 2023 года также не доказывает, что датская команда успела полностью охарактеризовать ту сложную систему ферментов, которую в итоге описала нейросеть.
Если отбросить маркетинговый шум, ситуация выглядит весьма иронично: искусственный интеллект выступил скорее как очень начитанный, но забывчивый ассистент, объединивший чужие труды.
Сам фермент, оказавшийся в центре внимания, на самом деле уже был открыт до этого — и сделали это люди, исследователи из Техасского университета A&M. Достижение алгоритма заключается в другом: нейросеть распознала более крупную биологическую систему. Машина связала воедино сам фермент, серию повторяющихся последовательностей ДНК (которые производят малые молекулы РНК) и возможный белок-партнер.
Важно отметить, что часть этих выводов была сделана на основе повторного анализа данных, опубликованных другой исследовательской группой еще в 2022 году. Это блестяще иллюстрирует, как старые массивы информации могут скрывать новые закономерности, но одновременно напоминает о необходимости отдавать должное авторам исходных экспериментов.
Пока что открытие существует лишь в виде цифровой гипотезы. Ученым-людям еще предстоит провести реальные лабораторные тесты и ответить на базовые вопросы:
- Активен ли этот фермент в реальности?
- Действительно ли он копирует связанную РНК в ДНК?
- Какую функцию вся эта система выполняет внутри вируса?
Внешнее сходство новой системы с известным инструментом редактирования генов CRISPR привлекло массу внимания, однако это не делает ART готовым генным редактором. На данный момент это лишь перспективная гипотеза, требующая проверки.
Так что, статус самостоятельного цифрового первооткрывателя вызывает большие сомнения. В отчете Anthropic честно указано, что при десяти дополнительных запусках поиска алгоритмы не смогли обнаружить тот самый массив повторов. Способность модели распознать паттерн, когда ей напрямую дают нужные готовые последовательности — это не то же самое, что автономное открытие полностью с нуля. Отчет компании до сих пор не прошел независимое рецензирование.
Подобные прецеденты заставляют пересмотреть правила работы с умными алгоритмами. Специалист из Манчестерского университета, активно использующий ИИ для перевода биологических задач в программный код, подчеркивает критическую важность документации. Каждое взаимодействие с алгоритмом, каждая инструкция и использованная версия модели должны фиксироваться так же тщательно, как и реактивы в колбах.
Прежде чем скармливать чат-ботам неопубликованные данные, исследователям следует сверяться с правилами своего университета. Руководство Манчестерского университета прямо предписывает защищать конфиденциальную информацию и тщательно проверять источники. Наличие платной подписки на нейросеть не гарантирует, что ваши черновики останутся только у вас.
У персональных и коммерческих сервисов Anthropic разные условия использования. Коммерческие тарифы по умолчанию исключают использование введенных данных для обучения будущих моделей, но даже там возможны исключения (например, при отправке обратной связи). Более того, хранение файлов на локальном компьютере с использованием инструментов вроде Claude Science не делает систему герметичной: базы данных остаются у вас, но запросы и ответы всё равно обрабатываются на серверах компании.
Безусловно, открытие системы ART ставит перед биологией интригующие вопросы. Но еще более важный вопрос этот случай задает всей современной науке: как справедливо распределять признание, когда в процесс вмешивается искусственный интеллект. Громкие анонсы технологических корпораций должны учитывать и описывать вклад живых людей — тех, кто собирал данные у лабораторного стола — так же подробно, как и успехи кремниевых алгоритмов.
Поддержать нас на Boosty
Поддержать нас на Дзен
FAQ: Часто задаваемые вопросы
Действительно ли нейросеть украла данные у биолога?
Прямых доказательств этому нет. Компания Anthropic отрицает использование переписок ученого для обучения модели, однако тот факт, что исследователь загружал в систему материалы о тех же ферментах, вызывает споры о прозрачности работы алгоритмов.
Умеют ли новые ферменты редактировать гены, как CRISPR?
Пока это неизвестно. Система лишь внешне напоминает CRISPR, но ее способность редактировать гены — это только теоретическая возможность, которую еще предстоит доказать в лабораторных условиях.
Может ли платный тариф гарантировать приватность научных данных?
Нет, не всегда. Хотя коммерческие версии нейросетей обычно не используют пользовательские данные для обучения по умолчанию, инструкции и ответы все равно обрабатываются на сторонних серверах. Ученым рекомендуется строго следовать протоколам безопасности своих институтов.
Читайте также: Нейросети начинают программировать сами себя. Создатели Claude просят нажать на тормоза, но эксперты видят в этом пиар
