AGI Soon As Possible
Article

AI가 코딩해도 전문성은 보상받는다: 클로드 코드 40만 세션 분석

2026-07-02 · 4분 읽기

AI 코딩 에이전트의 성공을 가르는 것은 코딩 경력이 아니라 도메인 전문성이다. Anthropic이 2026년 6월 16일 공개한 연구는 클로드 코드 세션 약 40만 건(이용자 23.5만 명)을 분석해, 전문가 세션의 검증 성공률이 28~33%로 초보 15%의 두 배에 이른다고 밝혔다. 전문가는 프롬프트당 12개 액션을 끌어내 초보(5개)의 두 배가 넘었다. ASAP은 이 결과를 1차 출처로 정리한다.

핵심 발견: 가른 것은 경력이 아니라 전문성

이 연구가 통념을 뒤집는 지점은 명확하다. 성과를 가른 변수는 코딩 이력이 아니라 사람이 세션에 가져온 도메인 전문성이었다. 전문성이 클수록 같은 지시 하나로 클로드가 더 많은 일을 해냈다. 즉 AI가 실행을 맡는 시대에도 무엇을 어떻게 시킬지 아는 판단력이 결과 차이를 만든다.

여기서 놓치기 쉬운 함의가 하나 있다. 전문성이 프롬프트당 액션 수와 검증 성공률을 동시에 끌어올렸다는 것은, 전문가가 단지 "더 많이" 시키는 것이 아니라 "맞게" 시킨다는 뜻이다. 애매한 지시는 에이전트가 몇 걸음 못 가 멈추게 하고, 방향이 분명한 지시는 한 번에 긴 작업 사슬을 완주시킨다. 전문성의 값어치는 코드를 직접 짜는 손이 아니라 문제를 정의하고 경계를 긋는 머리에 붙어 있다.

숫자로 본 전문성 격차

전문성 수준에 따라 성공률과 산출이 뚜렷이 갈린다. 2026년 6월 16일 공개된 수치는 다음과 같다.

지표초보전문가
검증 성공률15%28~33%
프롬프트당 액션5개12개

전문가는 초보보다 두 배가 넘는 액션을 한 번의 프롬프트로 끌어냈고, 검증된 성공에 도달하는 비율도 약 두 배였다.

두 지표가 함께 오른다는 점이 특히 중요하다. 액션만 많고 성공률이 낮다면 그저 시행착오가 잦다는 뜻이겠지만, 전문가는 더 긴 작업을 시키면서도 더 자주 검증에 성공한다. 실행량과 정확도가 동반 상승하는 조합은 전문성이 잡음이 아니라 신호라는 증거에 가깝다.

누구나 코드를 만든다: 직군은 거의 무관

코드를 만드는 세션에서는 직군이 거의 영향을 주지 않았다. 대부분의 주요 직군이 코드 생산 세션에서 소프트웨어 엔지니어와 거의 같은 성공률을 보였는데, 평균 34% 대 29%로 비전공 직군이 오히려 약간 앞섰다. 전문성이 코딩 이력보다 중요하다는 핵심 발견을 뒷받침한다.

비전공 직군이 소폭 앞선 이유를 과장 해석하지 않는 편이 안전하다. 이 수치는 "코드를 만드는 세션"에 한정된 값이고, 애초에 코드 생성에 나선 비전공자는 자기 분야의 문제를 명확히 알고 있을 가능성이 높다. 즉 직군 자체가 실력을 만든다기보다, 어느 직군이든 자기 도메인을 정확히 아는 사람이 유리하다는 앞선 발견의 다른 표현으로 읽는 편이 타당하다.

7개월 새 바뀐 것

7개월 동안 사용 양상도 변했다. 2025년 10월부터 2026년 4월 사이 디버깅 세션 비중은 거의 절반으로 줄었고, 세션당 평균 작업 가치는 약 25% 올랐다. 사람들이 단순 오류 수정을 넘어 더 가치 있는 작업을 AI에 맡기는 쪽으로 이동했음을 보여준다.

이 이동은 두 가지로 읽힌다. 하나는 도구가 좋아져 단순 버그 잡기 같은 저부가 작업을 사람이 손댈 필요가 줄었다는 것, 다른 하나는 사용자가 에이전트를 신뢰하며 더 무거운 작업을 위임하기 시작했다는 것이다. 어느 쪽이든 사람이 남기는 몫은 방향 설정과 검증으로 좁혀지고 있고, 이는 전문성이 보상받는다는 본 연구의 결론과 같은 방향을 가리킨다.

한국 개발 현장에 주는 함의

한국의 실무자와 팀이 이 결과에서 가져갈 시사점은 분명하다. 첫째, 채용과 평가에서 "코딩 연차"만 보는 관성은 재검토할 여지가 있다. 성과를 가른 것은 이력이 아니라 도메인 이해였기 때문이다. 둘째, 비개발 직군의 AI 코딩 진입 장벽이 생각보다 낮다는 신호이므로, 기획·마케팅·운영 인력이 자기 도메인 문제를 직접 프로토타이핑하도록 지원하는 편이 조직 생산성에 유리할 수 있다. 셋째, 개발자에게 남는 경쟁력은 문법 지식이 아니라 문제를 잘게 쪼개고 결과를 검증하는 능력 쪽으로 이동한다.

한계와 ASAP의 시각

이 연구를 확대 해석하지 않으려면 몇 가지 유보가 필요하다. 표본은 클로드 코드 사용자에 한정되므로 이미 AI 도구에 익숙한 집단이라는 편향이 있고, "전문성"과 "검증 성공"의 조작적 정의도 원문 맥락 안에서 이해해야 한다. 관측된 것은 상관이지, 전문성이 성공을 낳았다는 인과의 확정이 아니다. 또한 자사 제품 사용 데이터를 자사가 분석한 결과라는 점도 감안하는 편이 정직하다.

그럼에도 ASAP이 이 데이터를 주목하는 이유는, 결론이 상식과 어긋나지 않으면서 방향성이 일관되기 때문이다. 실행 비용이 낮아질수록 무엇을 만들지 정의하고 결과를 판별하는 능력의 상대 가치가 오른다는 흐름은, 코딩뿐 아니라 대부분의 지식 노동에 적용될 개연성이 크다. 숫자의 절대값보다 이 방향성을 신호로 읽는 편이 실무에 유용하다.

실행이 값싸질수록 커지는 것

Anthropic 연구는 실행이 값싸질수록 전문성과 판단이 차별화 요인이 된다는 흐름을 2026년 데이터로 뒷받침한다. AI가 코드를 써주더라도, 무엇을 만들지 정의하고 결과를 검증하는 도메인 전문성은 사라지지 않고 오히려 더 큰 보상을 받다. 코딩 이력보다 분야 전문성이 AI 활용의 핵심 자산이 되는 셈이다. 실행을 AI에 넘길수록, 방향을 아는 사람의 가치는 커진다.

출처: Anthropic, "Agentic coding and persistent returns to expertise"(2026-06-16, 약 40만 세션·23.5만 이용자, 2025년 10월~2026년 4월 분석).

ASAP — AGI Soon As Possible

AI·테크 이슈,
가장 깊게

단순 소식을 넘어, 맥락과 구조까지 파고듭니다

AGI Soon As Possible · asapai.co.kr

← 전체 글 보기