뉴스/정보

매슈 슈워츠, Claude와 3개월간 36편 원고…정밀계산 도구 BootLoops 공개

작성자
작성일
2026-10-02 09:12
조회
8

원문: Matthew Schwartz, Claude-shaped science (2026-10-01)
공개 코드·검증 규칙: BootLoops GitHub

매슈 슈워츠가 2026년 10월 1일 Anthropic에 기고한 연구 경험담이다. 소개된 작업은 앞선 약 3개월 동안 진행됐으며, 발표일 하루에 나온 성과로 읽으면 안 된다.

1. 어느 정도의 성과인가?

슈워츠는 약 400개 후보 문제를 탐색해 18개 분야, 공저자 19명과 36편의 원고를 진행했다고 보고했다. 이 숫자는 출판·동료심사를 마친 논문 36편을 뜻하지 않는다. 적분 30개 가운데 15개는 알려진 결과의 재현, 나머지 15개는 저자가 새 결과라고 설명한다.

2. AI에 맞는 문제를 고른다

접근법은 코딩·정밀계산·문헌 연결에 강한 Claude의 장점을 살리는 것이다. 서로 다른 분야에 비슷한 수학 문제가 있으면 계산 도구를 재사용하고 확장한다. 그러나 기술적으로 맞는 계산도 해당 분야에서 중요한 발견인지는 별개였다. 전문가가 연구 질문을 다듬는 역할을 했다.

3. 어디까지 믿어야 하나?

저자는 증명되지 않은 보조정리를 남기고 완료를 선언하거나, 결론·신규성·소요시간을 잘못 판단하는 실패를 설명한다. 성공 기준을 명확히 하고 결과를 직접 검토해야 한다는 이야기다. 이 글은 연구자의 자체 보고이며, 여기서 독립 재현까지 확인한 것은 아니다.

슈워츠는 프로젝트 기간 Anthropic 방문연구자로 일했다. BootLoops는 그가 소유·관리하는 프로젝트이며 Anthropic의 공식 지원 제품은 아니다.

4. 공개 저장소에서 확인할 수 있는 것

BootLoops 1.0은 모델 자체가 아니라, 언어모델이 정량과학 작업을 수행할 때 쓰는 계산 소프트웨어와 작업 규칙의 묶음이다. README에는 도구 패키지 49개가 명시돼 있다. 적분, 점화식, 베이지안 모형 비교, 오차를 추적하는 정밀계산 등을 다룬다.

검증 규칙도 구체적이다. 결과를 맞추는 데 쓰지 않은 지점에서 독립적인 계산 방법과 비교하고, 검증 절차가 오류를 실제로 잡는지도 대조 실험으로 확인한다. 계산에 사용한 정보가 다시 자기 결과를 보증하는 순환을 피하려는 설계다.

코드는 기본적으로 MIT, 저장소용 설명문과 그림은 CC BY 4.0으로 공개됐다. 일부 제3자 코드에는 별도 라이선스가 적용된다. 도구를 공개했다는 사실과 각각의 과학적 결론이 검증됐다는 사실은 구분해야 한다.

5. 해설: 연구 자동화를 평가하는 기준

여기서 볼 만한 지표는 원고 수 하나만이 아니다. 같은 도구로 다른 연구자가 결과를 다시 얻을 수 있는지, 잘못된 답을 걸러내는 검사까지 재현되는지, 분야 전문가가 결과의 중요성에 동의하는지를 함께 봐야 한다.

AI 연구 자동화를 평가할 때 계산 속도, 검증의 강도, 질문의 가치를 따로 살펴보면 생산량이 늘어난 부분과 실제 지식이 확장된 부분을 더 정확히 구별할 수 있다.

전체 0