클로드가 21시간 만에 찾은 '제2의 크리스퍼' — 950개 에이전트가 DNA 20만 개를 뒤졌다

발행 2026-09-24 · 분류 AI 속보 · 난이도 중급 · 읽는 시간 7분

DNA 이중나선 일러스트 위에 'AI 에이전트 950개가 21시간 만에 찾은 새 효소'라는 제목 카드 — 테크한잔

결론부터: 앤트로픽이 "우리 모델을 쓰면 논문이 잘 나와요" 수준의 발표가 아니라, 아예 자기 손으로 생물실험실을 차리고 그 안에서 AI가 신물질을 찾아냈다고 발표했습니다. 대상은 박테리오파지(박테리아에 붙는 바이러스)에 숨어 있던 미지의 효소 시스템이고, 회사 쪽은 그것을 ART(어레이 연관逆전사효소)로 불렀습니다.

HackerNews에는 하루 만에 표 618개·댓글 47개가 붙었습니다. 그런데 댓글창의 첫 화면은 축하 인사가 아니라 "이거 위험하지 않나"였습니다.

오늘은 무엇이 얼마나 빨리 찾아졌는지(숫자 포함), 이게 '챗봇이 논문 썼다' 뉴스와 왜 다른 얘기인지, 해외 댓글창이 왜 축하 대신 걱정으로 갈라졌는지까지 따라갑니다.

30초 요약

항목내용
무슨 일앤트로픽이 생명과학 연구그룹과 자체 실험실을 소개하며, 클로드 에이전트가 DNA 서열 데이터베이스에서 새로운 효소 시스템 'ART'를 자율 발견했다고 발표 (2026-09-23, 프리프린트 함께 공개)
규모발표문 기준: 에이전트 약 950개가 21시간 동안 토큰 2억 개를 소진해 검색. 역전사효소(RT) 20만 개 이상 수집 → 신규 후보 시스템 3,500개 → 정밀 분석 후보 20개로 좁힘
찾은 것역전사효소 + 인접 파트너 유전자 + 규칙적으로 반복되는 비암호화 DNA 어레이 3종 세트. 반복 배치가 크리스퍼 어레이와 닮았고, 초기 실험에서 어레이가 짧은 RNA 여러 개로 발현됨
모르는 것회사 스스로 "기능은 아직 모른다"고 못 박음. 인간 과학자는 처음 방향 제시(프롬프트)와 실험실 작업에만 관여했다고 밝힘
외부 평가크리스퍼 유전자 편집 선구자 펭 쩡(MIT·브로드연구소)이 프리프린트 검토 후 "진짜 흥미롭고 추가 조사할 가치가 있다"는 논평 (원문 인용)
쟁점댓글 다수는 "피어 리뷰가 아닌 보도자료인 이유", "생물 무기 우려", "정확히 누가 발견의 주체인가"

1. 무엇이 터졌나

앤트로픽은 2026년 봄 '범용 AI로 과학 발견을 앞당길 수 있는가'를 검증할 연구그룹을 꾸리고 베이 에어리어에 분자생물학 실험실을 차렸습니다. 발표문에 따르면 실험대는 인간 과학자가 전부 만지고, 인체 감염성 병원체는 다루지 않습니다. 즉 AI가 시험관을 대신 잡은 게 아니라, AI가 서열 데이터를 읽고 사람이 시험대에서 확인하는 구조입니다.

발표문에서 가장 잘 나도는 문장은 이겁니다. 역전사효소를 검색해 달라는 초기 프롬프트 하나를 던졌더니, 여러 에이전트가 데이터베이스를 헤집다가 한 에이전트가 이상한 것 하나를 골라냈고, 인간이 실험실로 확인하니 미지의 시스템이 맞았다는 이야기입니다. 회사 표현을 빌리면 과학자의 관여는 "처음 프롬프트와 실험실 작업"으로 제한됐습니다.

숫자도 공개했습니다. 에이전트 약 950개가 21시간을 쏟아 토큰 약 2억 개를 태웠고, RT 계열 20만 개 이상을 모아 신규 후보 3,500개를 걸러냈습니다. 발표문은 이 단계가 인간 전문가라면 "몇 주에서 몇 달" 걸린다고 견줬습니다.

2. 왜 대단한 얘기인가 — "요약 잘함"과 차원이 다른 세 가지

① 발견의 원조 패턴과 같은 생김새

크리스퍼 자체가 세상에 나온 경로를 떠올리면 이 발표의 노림수가 보입니다. 특정 박테리아 DNA에서 "이상하게 반복되는 서열"을 누군가 눈여겨본 게 출발이었고, 이제 유전자 편집 치료제의 토대가 됐습니다.限制性 효소도, 옐로스톤 온천에서 나온 Taq 중합효소(PCR의 기반)도 전부 "자연의 분자 기계 잔치에서 이상한 것 하나를 주운" 얘기입니다. 앤트로픽은 이번 ART가 바로 그 '이상한 것 주우기' 단계에 해당한다고 직접 줄 세웠습니다. 반복 어레이가 RNA로 발현된다는 초기 결과까지 붙어 있어, 크리스퍼처럼 "프로그램 가능한 DNA 가위·복사·붙이기 도구"로 자랄 여지를 열어 둔 거죠. 다만 회사 자신도 기능은 미확인이라고 밝힌 단계임을 분명히 해야 합니다.

② '발견'이 에이전트의 판단으로 완료됐다

발표문에 따르면 문제를 푼 에이전트는 반복 서열을 발견하고 스스로 감탄(?)한 뒤, 인간 과학자처럼 행동했습니다. 반복 횟수를 세고 간격을 재고, 알려진 RT 시스템들과 배치를 비교하고, 문헌에 같은 도형이 이미 보고된 적 없는지 검색하고, 최종적으로 "새 생물학적 시스템이다"라는 리포트를 인간 검토용으로 제출했습니다. 통상적인 AI 활용(사람이 묻고 AI가 답하는)과 다른 지점은 이 '판단과 후속 조사'가 한 세션 안에서 굴렀다는 점입니다. 회사 워크플로 묘사에 따르면 후보 리포트는 한 캠페인당 수백~수천 장 나오고, 그중 대부분은 후속 분석 단계에서 탈락합니다. 조사 하나에서 테스트할 후보가 1개 나오거나, 아예 0개일 수도 있다고까지 적어 놨습니다.

③ '가설' 그 자체가 연구 대상이 됐다

발표문에서 가장 눈길 끄는 부수 관찰입니다. AI가 가설을 너무 많이 찍어내다 보니, 연구팀의 새 연구 주제가 "어떤 제안은 테스트할 가치가 있고 어떤 건 뭉개는가"가 됐습니다. 그 판별 기준을 다시 모델 지침에 되먹여 자기들의 연구적 취향을 닮게 만든다고 합니다. 프롬프트 기술을 넘어 '선별 취향'이라는 자산이 생기는 얘기입니다.

3. 바로 써먹기 — 이 발표에서 실무로 가져갈 것

생물학자가 아니라도 가져갈 게 있습니다. '에이전트 다수로 데이터 광산을 채굴'하는 패턴이 시범 운용을 시작했기 때문입니다.

① 이 패턴을 내 도메인에 옮기려면

앤트로픽 방식범용 도메인(코드·문서·거래 로그) 대응물
기능 미상 단백질 20만 개 모으기주석 없는 레거시 코드·미분류 티켓·이상 거래 로그 풀
계열 단위 탐색 → 후보 3,500개패턴·클러스터 단위로 무리 지어 이상 후보 대량 생성
후보마다 사람 읽을 리포트 1장각 후보에 '왜 의심되는가' 근거 요약서 자동 첨부 — 사람을 움직이는 건 이 한 장
후속 분석으로 대부분 탈락2단계 자체 검증(재검색·재실행)으로 거르기 — 1차 산물을 바로 믿지 않기
선별 기준을 모델 지침에 되먹이기'내가 뭉갠 후보들의 공통점'을 규칙 문서로 축적 — 팀 고유의 필터 자산화

요약하면 한 문장입니다. AI 시대의 병목은 '생성'이 아니라 '선별'이고, 이 팀도 그 자리에 도달해 있습니다.

② 오늘 따라 해볼 만한 최소 단위

에이전트 950개를 깔 필요는 없습니다. 같은 논리의 1/N 버전은 이렇습니다. 아무도 정리하지 않은 데이터 풀을 하나 정하고, "알려진 패턴에 안 맞는 것만 골라 근거 3줄 리포트로"라는 지시를 세션 몇 개에 나눠 뿌리고, 다른 세션에 "그 후보들을 반박해 봐"라고 재검증을 시킵니다. 위 표의 네 번째 줄(후보가 살아남는가)을 통과한 항목에만 내 시간을 쓰면 됩니다. 아래는 그 논리의 개념도 수준 예시입니다 — 명령형은 각자 쓰는 CLI 문서에서 확인하세요.

# 후보 생성과 반박을 서로 다른 세션으로 (개념 예시)
agent -p "로그에서 알려진 패턴에 안 맞는 이상 행위를 골라
각각 근거 3줄로 리포트" > candidates.md
agent -p "candidates.md의 후보를 하나씩 반박하라. 근거 없는 건 기각" > rebuttal.md

4. 해외 반응 쟁점

① "피어 리뷰를 왜 통과 안 하나". 상위권 댓글 중 상당수가 "이건 심사 논문이 아니라 보도자료"라는 지점이었습니다. 실제 앤트로픽도 프리프린트를 함께 공개하면서 "기능은 모른다, 하지만 빨리 공유하는 편이 옳다"고 직접 이유를 밝혔습니다. 회의론 쪽은 "속도와 신뢰는 트레이드오프"라고 밀어붙이고, 옹호 쪽은 "부정적 결과까지 대량 생산하는 구조 자체가 검증 문화"라고 맞섭니다.

② "누가 발견한 건가". "클로드가 스스로 찾은 건가, 클로드를 쓴 사람이 찾은 건가"라는 질문이 상위 댓글에 있습니다. 발표문의 표현("초기 프롬프트 외 관여는 실험실 작업")이 논쟁의 양쪽 다에 쓰입니다. 한쪽은 저 문장을 과장이라 보고, 다른 쪽은 "발명에서 인간이 한 일은 질문 하나"라는 역사적 사례들을 듭니다.

③ 공포 계열. "표적형 바이러스 만들기가 쉬워지는 것 아니냐"는 우려와, "2027년 우리 실험실의 신종 효소 사건을 수사한다"는 식의 조롱 밈이 섞였습니다. 다만 회사 실험실은 인간만 시험대를 만지고 병원체를 안 다룬다고 발표문에 적혀 있습니다. 공포는 이번 실험이 아니라 '능력이 모두에게 퍼지는 미래'를 향한 것입니다.

④ "모델명이 없다". "발표문의 '클로드'가 정확히 어떤 모델(opus/mythos/fable)인지 적시되지 않았다"는 지적도 있었습니다. 파인튜닝·하네스 여부가 불투명하다는 논점으로, 재현성 논의의 전제라는 게 이 진영의 주장입니다.

⑤ 경쟁 구도. "이제 공은 OpenAI 코트"류의 댓글처럼, 이번 발표를 빅랩 경쟁(OpenAI·xAI의 과학 쪽 행보)의 한 수로 읽는 시각도 상당했습니다.

5. 마시기 전 주의

바로 가기

같이 마시면 좋은 잔
메타 상용 에이전트가 세션 파일시스템 6.8GB를 대화 한 판으로 반출한 사건 — 에이전트가 '발견'과 '반출'을 구분 못 한다는 점에서, 오늘 글의 에이전트 자율성 이야기와 정반대 얼굴을 마주하는 잔.
AI 속보 시리즈 — 해외에서 먼저 검증된 발표만 골라 숫자와 한계까지.
도구 코너 — 내 PC로 도는 AI 모델 체크 (준비 중).