구글, ‘제미나이 4 아르곤’ 공개…AI 경쟁, 복잡한 업무 수행으로 확장
- 코딩·기업 지식 업무·사이버보안에 초점…회사 발표 기준 성능 개선
- 최대 출력 한도 100만 토큰으로 확대…입력 데이터 범위와는 구분
- 보안 전문가에 우선 제공…유료 API·AI 울트라로 단계적 확대 계획
구글이 차세대 AI 모델 ‘제미나이 4 아르곤’을 공개하며 기업용 AI 경쟁에 나섰다. 소프트웨어 개발과 법률·금융 등 지식 업무, 사이버보안처럼 여러 단계의 판단과 실행이 필요한 작업에 초점을 맞췄다. AI 경쟁의 무게중심이 답변의 품질에서 복잡한 업무를 얼마나 지속적으로 수행할 수 있는지로 넓어지고 있음을 보여주는 발표다.
구글은 9월 30일 현지시간 아르곤을 발표하고, ‘페어윈드 프로그램’을 통해 선별된 사이버보안 전문가에게 우선 제공한다고 밝혔다. 미국 정부의 모델 출시 전 접근 절차에도 참여하고 있다. 일반 이용자에게 전면 개방한 상태는 아니며, 초기 평가와 안전장치 보완을 거쳐 제공 범위를 확대할 계획이다.
주요 변화는 최대 출력 한도를 기존 6만4000 토큰에서 100만 토큰으로 늘린 것이다. 토큰은 AI가 정보를 처리하고 생성하는 단위다. 이번 확대는 긴 추론과 복잡한 결과 생성을 지원하기 위한 것으로, 모델이 한 번에 참조하는 입력 데이터의 범위인 ‘컨텍스트 윈도’와는 구분해야 한다. 출력 한도가 커졌다고 모든 작업의 정확도가 함께 높아지는 것은 아니다.
구글은 장기간의 소프트웨어 개발 작업을 평가하는 ‘DeepSWE v1.1’에서 77.9%, 보안 취약점 수정 능력을 평가하는 ‘CWE-bench v1’에서 68%를 기록했다고 발표했다. 법률·금융 등 전문 업무에서도 높은 성능을 제시했다. 다만 특정 평가의 점수는 해당 조건에서의 결과이며, 모든 기업 업무에서 경쟁 모델보다 우수하다는 의미로 해석하기는 어렵다.
내부 활용 사례도 공개했다. 구글은 데이터센터 메모리 최적화와 대규모 코드 전환 등에 아르곤을 적용하고 있다고 설명했다. 중요한 시스템의 코드 변경에는 자동·수동 감사와 테스트, 검토를 거친다고 밝혔다. AI가 작업을 수행하더라도 실제 서비스에 반영하기 위한 검증 과정은 함께 유지하는 방식이다.
사이버보안에서는 소프트웨어 취약점을 찾아 검증하고 수정하는 능력을 강조했다. 이러한 역량은 방어에 활용될 수 있는 동시에 악용 가능성도 있어 접근을 단계적으로 확대한다. 구글은 악성 요청 대응과 프롬프트 인젝션 방어, 모델 행동 감시, 격리된 실행 환경 강화 등을 추진하고 있다.
가격도 기업의 선택에 영향을 줄 요소다. 구글이 예고한 초기 요금은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러다. 할인 기간 이후에는 각각 4달러와 20달러가 적용된다. 향후 유료 API 고객과 구글 AI 울트라 가입자부터 제공 범위를 넓힐 계획이지만 구체적인 일반 공개 일정은 제시하지 않았다.
기업 입장에서는 토큰 단가와 업무 처리 비용을 함께 살펴야 한다. 긴 추론이나 반복 실행으로 사용량이 늘면 낮은 단가가 곧 낮은 총비용을 뜻하지는 않는다. 결과를 확인하고 수정하는 데 드는 시간까지 포함해, 하나의 업무를 정확하게 끝내는 데 필요한 비용을 비교할 필요가 있다.
한국 기업에도 판단 기준은 같다. 해외 벤치마크와 함께 한국어 문서 처리, 국내 업무 규정에 대한 대응, 사내 데이터 보호, 기존 시스템 연동을 검증해야 한다. 아르곤의 등장은 선택지를 넓히지만 실제 도입의 가치는 모델의 순위보다 현장에서 확인되는 정확성과 생산성, 통제 가능한 운영 비용에 달려 있다.
더 좋은 미래를 위한 콘텐츠 플랫폼 – <굿퓨처데일리>

