(사진=AFP)
21일 니혼게이자이(닛케이)신문이 앤스로픽, 오픈AI 등 AI 모델 개발을 선도하는 미국 5개사와 알리바바그룹, 문샷AI 등 중국 4개사를 조사한 결과, 고성능 모델을 새로 내놓기까지 걸린 기간이 2023년 1월부터 올해 3월까지는 평균 125일이었으나 올해 4~9월엔 44일로 크게 짧아졌다.
이달 들어서도 신모델 출시가 잇따랐다. 앤스로픽은 지난 1일 ‘클로드 페이블 5.1’을, 오픈AI는 지난 3일 ‘GPT-6 아스트라’를 각각 공개했다. 구글은 지난 2일 이전 모델 출시 후 불과 3주 만에 ‘제미나이 3.8 플래시’를 선보였다. 메타는 지난 7월부터 자사 첨단 모델 ‘뮤즈 스파크’를 매달 업데이트하고 있고, 스페이스X의 그록도 지난달까지 3개월 연속 신모델을 내놨다.
앤스로픽의 경우 지난해 11월 ‘클로드 오푸스 4.5’부터 올해 4월 ‘오푸스 4.7’까지는 신모델 출시 간격이 70일 안팎이었다. 하지만 이후로는 5월 ‘오푸스 4.8’, 6월 ‘페이블 5’와 ‘소네트 5’, 7월 ‘오푸스 5’에 이어 이달 ‘페이블 5.1’까지 짧게는 12일, 길어도 6주 간격으로 신모델을 쏟아냈다.
중국 기업들도 속도를 내고 있다. 딥시크는 지난 7월 31일 ‘V4 플래시’를 정식 출시한 데 이어 지난달 13일엔 ‘V4 프로’를 일반에 공개했고, 이달 들어선 ‘V4.1 플래시’까지 내놨다. 지난달 이후엔 알리바바와 ‘GLM’ 시리즈를 개발한 즈푸AI도 잇따라 신모델을 공개했다.
최근엔 미국 기업들의 신모델 출시가 특히 잦다. 미국 상위 5개사가 3분기(7~9월) 발표한 AI 모델은 20개로, 2분기보다 두 배 늘었다. 성능 경쟁뿐 아니라 저가형, 속도 중시형, 사이버보안 특화형 등 용도별로 모델을 세분화하는 움직임도 확산하고 있다.
중국 기업들이 누구나 내려받아 쓸 수 있는 개방형 고성능 모델을 내놓자, 미국 기업들도 제품군을 넓혀 경쟁 우위를 지키려는 것이다. 실제 문샷AI가 지난 7월 발표한 ‘키미 K3’는 미국 최첨단 모델에 근접한 성능을 내고 있음에도 이용료는 3분의 1 수준이다.
개발 속도가 빨라진 요인 중 하나는 AI가 직접 AI 모델 연구개발을 떠맡고 있다는 점이다. AI는 실험 관리나 결과 분석 같은 고난도 업무까지 처리할 수 있게 됐다.
앤스로픽은 지난 17일 자사 연구개발의 26%를 AI가 주도하고, 90% 이상에 AI가 관여하고 있다고 밝혔다. 지난달 기준 수치로, 지난 2월만 해도 AI가 주도하는 비율은 사실상 0%였다. 앤스로픽은 “AI가 더 뛰어난 후속 AI 모델을 개발하는 순환 구조가 생길 가능성이 있다”고 짚었다.
(사진=AFP)
오픈AI에선 지난달 AI 에이전트(비서)의 가동 시간이 인간 연구자 근무 시간의 3.1배에 달했다. 이 회사의 평범한 연구자는 하루 600달러(약 83만원)어치의 AI 에이전트를 쓰고 있었고, 상위 10%는 하루 7000달러(약 972만원)어치 이상 AI를 부렸다. 지난 6월 초만 해도 인간 연구자가 더 오래 일했지만, 불과 몇 달 새 AI의 역할이 급격히 커졌다.
AI 활용이 늘면서 지난달 오픈AI가 작성한 프로그램 코드 양은 지난해 평균치의 7배로 불어났다. 앤스로픽이 올해 2분기(4~6월) 실제 제품 등에 채택한 코드 양도 2021~2025년 평균의 8배에 달했다. 코드 양이 늘어나면 AI 모델의 성능 향상으로 이어진다.
성능이 좋아지는 속도도 빨라지고 있다. 영국 정부 산하 AI보안연구소(AISI)에 따르면 AI 모델의 사이버 공격 능력이 2배로 커지는 데 걸리는 기간은 올해 2월 기준 4.7개월로, 지난해 11월(8개월)보다 짧아졌다. AISI는 현재 이 기간이 더 줄었다고 설명했다. 미국 조사업체 아티피셜애널리시스가 여러 테스트를 조합해 만든 AI 성능 지수에서도 올해 들어 AI 모델의 능력이 눈에 띄게 향상됐다.
◇커지는 통제 불능 우려…제3자 검증 요구
AI가 스스로 진화해 인간의 통제를 벗어날 수 있다는 우려도 커지고 있다. 미국에선 다리오 아모데이 앤스로픽 최고경영자(CEO)를 중심으로 AI 모델 개발 속도를 늦춰야 한다는 목소리가 높아지고 있다.
앤스로픽은 지난 17일 공개한 보고서에서 “AI 모델 연구개발에서 AI가 어떤 역할을 하는지, 연구개발에 관여하는 AI를 인간이 적절히 감독하고 있는지를 제3의 기관이 검증해야 한다”고 강조했다. 오픈AI에서는 AI가 수행해야 할 업무를 잘못 판단해 개발 환경을 벗어나는 사고까지 발생했다.
AI 능력이 높아지는 가운데 관리·감독 체계가 소홀해지면 더 심각한 사고로 이어질 수 있다. 개발 경쟁을 벌이는 미국과 중국이 안전관리 체계 마련에 뜻을 모을 수 있을지가 관건이라고 닛케이는 짚었다.









