AI 재귀적 자기개선 실현 시점 놓고 논쟁 재점화

3분 RSIAGIAI 연구강화학습
최근 30일 조회수 — 좋아요 —

핵심 요약

새 arXiv 논문의 RSI 로드맵과 연구자 팟캐스트 대담이 재귀적 자기개선 실현 가능성을 두고 상반된 견해를 드러냈다.

재귀적 자기개선 논쟁, 새 논문과 연구자 대담으로 재점화

AI 연구자들 사이에서 ‘진짜 재귀적 자기개선’(RSI, Recursive Self-Improvement)이 실현 단계에 들어섰는지를 둘러싼 논쟁이 최근 공개된 논문과 팟캐스트 대담을 계기로 다시 부각됐다. RSI는 AI 시스템이 경험과 피드백을 지속적인 변화로 전환해 자신의 역량뿐 아니라 이후 개선 과정 자체를 함께 향상시키는 능력을 가리킨다.

2026년 9월 10일 arXiv에 공개된 논문 “The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement”는 RSI 논의의 이론적 틀을 제시했다.1 연구진은 먼저 ‘Headroom-Closed Index’(HCI)라는 지표를 동원해 현재 대형언어모델(LLM)이 가진 한계를 짚은 뒤, RSI로 가는 발전 경로를 단계별로 정리했다. 이 로드맵은 개선 실행의 자율성에서 시작해 개선 전략의 자율성, 경험 획득의 자율성, 환경 적응의 자율성을 거쳐 최종적으로 재귀적 메타개선 단계로 이어진다. 논문은 이 과정을 과학적 발견, 신체화 지능(embodied intelligence), 소프트웨어 엔지니어링 등 서로 다른 영역에 적용해 각 영역마다 요구 조건과 발전 속도가 다르다는 점을 보였고, 업계의 실제 사례와 초기 실증 증거를 근거로 진짜 RSI 실현을 가로막는 핵심 과제들을 정리했다.

이 이론적 논의는 비슷한 시기 공개된 대담에서 현장 연구자들의 구체적인 검증을 받았다. 9월 11일 공개된 드와케시 파텔(Dwarkesh Patel)의 팟캐스트에는 씽킹 머신스(Thinking Machines)의 수석과학자이자 OpenAI 공동창업자인 존 슐먼(John Schulman), 자이프라(Zyphra) CTO 베렌 밀리지(Beren Millidge), 베이스텐(Baseten) 모델 트레이닝 총괄 찰리 오닐(Charlie O’Neill)이 참여해 RSI에 대한 반론을 의도적으로 세워보는 자리를 가졌다.2

밀리지는 2036년에도 AI가 “수십억의 초지능”으로 세상을 바꾸지 못할 가능성을 꼽으며, AI 연구에서 반복돼온 패턴을 지적했다. 체스나 어려운 수학 문제처럼 “풀면 대단할 것”이라 여겨진 과제들을 AI가 실제로 풀어내도 막상 그 영향이 제한적이었던 경우가 많았다는 것이다. 그는 이런 흐름이 계속된다면 AI가 벤치마크나 평가 환경에 넣은 과제는 무엇이든 극도로 잘 해내면서도, 실제 세계로 옮겨지면 성능이 떨어지는 ‘시뮬레이션-실제 간극’(sim-to-real gap)이 지속적으로 발전을 가로막을 수 있다고 설명했다.

대담은 이 ‘시뮬레이션-실제 간극’ 외에도 중국 연구소들의 발전 동력, 장기 horizon 강화학습이 AGI를 이끌어낼 수 있는지, 강화학습이 왜 잘 작동하는지, 연구자들의 단기 타임라인 전망 등을 다뤘다. 다만 제공된 자료에는 이 쟁점들에 대한 구체적 결론이나 수치는 담겨 있지 않다.

두 자료를 겹쳐 보면 RSI 논쟁의 구도가 드러난다. 논문 쪽은 RSI로 가는 단계적 로드맵과 분석 틀을 내놓았지만, 현장 연구자들의 대담은 그 로드맵이 현실에서 막힐 수 있는 구체적 지점, 특히 벤치마크 성능과 실제 영향력 사이의 간극을 경계하는 목소리를 냈다. 두 자료 모두 RSI가 임박했다는 주장과 아직 멀었다는 주장이 공존하는 상태임을 보여줄 뿐, 어느 쪽이 맞는지에 대한 합의는 확인되지 않는다.

Footnotes

  1. arXiv, “The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement” ↩

  2. Hacker News(드와케시 파텔 팟캐스트), “AI researchers debate how close we are to recursive self-improvement” ↩

읽기 목록은 이 브라우저에 저장됩니다.

출처

  1. The Last AI Built by Humans: Toward Genuine Recursive Self-Improvement — arXiv (cs.AI/cs.CL/cs.LG)
  2. AI researchers debate how close we are to recursive self-improvement — Hacker News

이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요.