AI가 후속모델 R&D 일부 주도…신모델 개발주기 단축과 안전관리 과제 부각

□ AI 활용 확대로 빨라지는 첨단 AI 개발

ㅇ 2026년 9월 17일 앤트로픽이 발표한 AI 연구개발 자동화와 감독체계를 분석한 보고서에서 자사 AI 연구개발의 26%를 클로드가 주도하고 90% 이상에서 협업 이상의 역할을 하는 것으로 나타났으며, 미·중 주요 기업의 신모델 출시 주기도 평균 125일에서 44일로 단축되면서 AI 주도 연구개발 확대와 안전관리 필요성이 부각됐음

ㅇ 앤트로픽은 AI가 후속 모델 연구개발의 상당 부분을 주도하기 시작했지만, 인간의 개입 없이 완전히 자율적으로 후속 모델을 개발하는 단계에는 아직 도달하지 않았다고 밝혔음

 AI 에이전트가 연구·개발 업무에 광범위하게 투입되면서, 앤트로픽은 실시간·사후 모니터링과 인간 검토를 결합한 감독체계를 운영하고 있음

ㅇ AI 개발 자동화와 성능 향상 속도가 빨라짐에 따라 앤트로픽은 개발 속도와 감독 수준, 안전 분야 자원 투입 등을 지속적으로 측정·공개할 필요성을 제기했음


□ AI 주도 연구개발 확대와 재귀적 자기개선 가능성
ㅇ 앤트로픽은 AI가 차세대 모델 개발에 얼마나 관여하는지를 측정하기 위해 AI R&D 자동화 지수를 구축하고, 에포크 AI의 자동화 수준(AL0~AL5)을 적용했음
ㅇ 2026년 8월 기준 클로드는 AI 연구개발의 26%를 주도(AL4·자동화 수준 4단계)하고 있으며, 이는 인간의 감독 아래 AI가 업무 대부분을 처음부터 끝까지 수행하는 수준

ㅇ 앤트로픽은 이를 통해 AI가 완전히 자율적으로 후속 모델을 구축하는 재귀적 자기개선 단계에 얼마나 가까워지고 있는지를 파악하려는 것이라고 설명했음

ㅇ 다만 개발사 간 공통 평가방법이 없고 자사 모델이 자사 시스템을 평가한다는 한계가 있어, 비교 가능한 공통 측정기준을 마련할 필요가 있다고 제시했음


□ AI 에이전트 확대와 감독체계 강화

ㅇ 앤트로픽의 주요 내부 플랫폼에서는 2026년 8월 기준 약 3만 개의 AI 에이전트가 동시에 연구·엔지니어링 업무를 수행하고 있음

ㅇ 앤트로픽은 에이전트 행동을 실시간으로 점검하는 온라인 모니터와 사후 활동을 분석하는 오프라인 모니터를 운영하고 있음

ㅇ 2026년 8월 10억 건 이상의 행동을 분석한 결과 온라인 모니터가 AI 에이전트의 행동을 차단한 비율은 0.002% 약 4만7천 건당 1건이었으며, 오프라인 모니터는 우선순위가 높은 약 50건을 매주 인간 검토로 넘기고 있음

ㅇ 앤트로픽은 개발사들이 모니터링 범위·검토 속도·차단 및 상향검토 비율 등을 공개해 AI 에이전트 활용 확대에 감독체계가 적절히 대응하고 있는지 확인할 수 있도록 해야 한다고 제안했음


□ AI 개발 속도와 안전성 관리의 균형

ㅇ 앤트로픽은 2026년 7월 한 주간 컴퓨팅 자원 사용을 분석한 결과, 전체 AI R&D 자원의 약 6%, AI 주도 R&D 자원의 약 12%가 안전 관련 업무에 투입됐다고 밝혔음

ㅇ 영국 AI보안연구소(AISI)에 따르면 AI 모델의 사이버 공격 능력이 두 배로 향상되는 데 걸리는 기간은 8개월에서 4.7개월로 단축돼 성능 향상 속도도 빨라지고 있음

ㅇ 다만 앤트로픽은 안전 연구가 일반적인 모델 개발보다 상대적으로 적은 컴퓨팅 자원을 사용할 수 있어, 컴퓨팅 자원 비중만으로 안전 분야 투자 수준을 판단하는 데는 한계가 있다고 설명했음

ㅇ AI 개발 자동화가 확대되는 상황에서 개발 속도와 내부 안전관리 수준을 정기적으로 측정·공개하고 독립적인 외부 검증을 확대하는 투명성 체계가 필요하다고 강조했음



(출처: 이데일리, 연합뉴스, 앤트로픽)

해시태그

#AI 연구개발 # AI 에이전트 # 재귀적 자기개선 # AI 자동화 # AI 개발주기 # AI 안전성 # 제3자 검증

참고자료