GPT-6 Sol·Claude Opus 5.5 출시GPT-6 Sol 요금은 5.6 Sol의 절반
블로그
가이드

Gemini 4 Argon 리뷰: 강력한 발표, 아직 공개 API는 아님

Argon은 중요한 프런티어 업그레이드로 보이지만, 출시 당일 운영 트래픽을 옮기기보다 호출 가능한 계약을 기다린 뒤 평가하는 편이 합리적입니다.

약 13분OmniaKey
Gemini 4 ArgonGemini 4모델 리뷰API 가격사이버 보안

Gemini 4 Argon은 Google의 첫 Gemini 4 프런티어 모델입니다. Google은 2026-09-30 이를 발표하며 장기 소프트웨어 엔지니어링, 기업 지식 업무와 방어적 사이버 보안을 위한 모델이라고 설명했습니다. 접근은 의도적으로 단계적입니다. 먼저 Fairwind Program을 통한 신뢰된 사이버 방어자에게 제공되고, 이후 유료 API 고객과 Google AI Ultra 구독자에게 확대됩니다.

따라서 이 글은 직접 API 벤치마크가 아니라 출시 리뷰입니다. Google은 DeepSWE, AutomationBench, LVBench와 보안 평가에서 높은 결과를 보고했습니다. Artificial Analysis에는 초기 독립 스냅샷이 있지만 속도 항목은 아직 완성되지 않았습니다. 실제 Gemini 자격 증명으로 유료 요청을 실행하지 않았고, 확인 시점에 OmniaKey 공개 카탈로그에도 Argon은 없었습니다.

2026-10-01 사실 확인. 아래 출시 정보와 벤더 벤치마크는 Google 발표와 안전성 자료에 근거합니다. 독립 수치는 별도로 표시했습니다. Google은 아직 안정적인 공개 model ID, 엔드포인트 계약, SDK 마이그레이션 가이드 또는 일반 제공일을 공개하지 않았으므로 요청 예시를 지어내거나 운영 접근을 주장하지 않습니다.

결론 요약

질문2026-10-01 기준 확인된 답
무엇이 출시됐나요코딩, 기업 지식 업무와 사이버 방어를 위한 Gemini 4 Argon입니다.
오늘 누구나 호출할 수 있나요아닙니다. 신뢰된 사이버 방어자부터 시작하며 유료 API 고객과 Google AI Ultra 구독자에게 확대됩니다.
API model ID는 무엇인가요제품명은 발표됐지만 안정적인 공개 API ID는 아직 없습니다. gemini-4-argon을 추측해서는 안 됩니다.
컨텍스트 또는 출력 한도는Google은 출력 토큰 한도가 1M이며 기존 Gemini의 64K에서 늘었다고 밝혔습니다. 최종 입력 계약은 대기 중입니다.
초기 가격은입력 1M 토큰당 $2, 출력 $10이며 캐시 입력은 입력 가격에서 95% 할인됩니다.
초기 기간 뒤에는입력 $4, 출력 $20 / 1M 토큰이 적용된다고 Google이 밝혔습니다.
재현 가능한 공개 벤치마크가 있나요Google의 벤더 결과와 Artificial Analysis의 초기 Intelligence Index 53이 있습니다. 직접 유료 벤치마크는 실행하지 않았습니다.
OmniaKey가 Argon을 라우팅하나요확인일 공개 OmniaKey 카탈로그에는 없었습니다. 게이트웨이 이전 전에 실제 카탈로그를 확인하세요.

짧은 결론은 유망하지만 검증 없이 운영 전환할 단계는 아니다입니다. 계정에서 호출할 수 있게 되면 평가 큐의 상단에 둘 만합니다. 그 전까지는 Gemini 3.8 Flash처럼 수용 테스트를 통과한 경로를 기준으로 삼으세요.

Google이 발표한 내용

Google은 Argon을 새로운 프런티어 모델이라고 부르며 이미 내부 워크플로에 사용한다고 설명했습니다. 첫 외부 그룹은 Fairwind Program의 신뢰된 사이버 방어자입니다. 개발자, 기업과 소비자에게 “가능한 한 빨리” 확대하고 유료 API 고객과 Google AI Ultra 구독자부터 시작한다고 밝혔습니다.

발표는 모델의 존재를 증명하지만 모든 AI Studio 프로젝트, 지역, SDK, 게이트웨이와 계정에서 호출할 수 있다는 뜻은 아닙니다. 기존 Gemini 4 상태 가이드가 구분했듯 이름 붙은 학습과 호출 가능한 API는 서로 다릅니다. 이번 발표로 Argon은 발표된 제품 단계가 되었지만 전체 API 제공 여부는 별도 확인해야 합니다.

능력 프로필

능력공개된 내용해석
장기 추론복잡한 다단계 워크플로를 위한 깊은 추론목표 사용 사례이지 모든 긴 프롬프트의 유용성을 보장하지 않습니다.
소프트웨어 엔지니어링Google 보고 DeepSWE v1.1 77.9%특정 하네스와 설정에서의 벤더 결과입니다.
기업 업무코딩, 금융, 법률 조사·작성, 시각 분석도메인별 수용 테스트가 필요합니다.
멀티모달차트, 문서와 긴 동영상의 시각 이해전체 입력 스키마는 발표문에 없습니다.
사이버 방어취약점 탐색, 검증과 수정방어자와 일반 사용자에게 제공·가드레일이 다릅니다.
출력 여유Google 기준 최대 1M 출력 토큰백만 토큰 생성을 권장하는 수치가 아닙니다.

Google은 내부 사례로 양자 연구 최적화에서 공개 기준보다 40% 좋은 결과, 데이터센터 분석으로 300 TiB 이상 메모리 절감, libgav1 Rust 포트를 기존 Rust 구현보다 2.7배 빠르게 만든 작업을 소개했습니다. 이는 Google 워크플로에 대한 주장이지 독립 실험 결과가 아닙니다. 대규모 변경은 운영 전에 자동·수동 감사를 거쳤습니다.

Argon의 목표는 분명합니다. 계획을 세우고 도구를 사용하며 긴 근거를 검토하고 여러 단계에서 일관성을 유지해야 하는 작업입니다. 짧은 채팅만으로는 장점을 측정하기 어렵습니다.

벤치마크: 강한 신호와 범위

평가Gemini 4 ArgonGoogle의 설명
DeepSWE v1.177.9%장기 소프트웨어 엔지니어링
AutomationBench51.3%업무 기능의 엔드투엔드 실행
LVBench91.7%장시간 동영상 이해
CWE-bench v168%취약점 수정, 공동 1위
Vals Finance Agent v2선두 결과 주장다단계 금융 조사
Harvey Legal Agent Benchmark선두 결과 주장법률 조사와 작성

이 수치가 지지하는 결론은 Google이 긴 컨텍스트, 도구 사용과 지속적인 추론이 필요한 작업을 겨냥한다는 것입니다. 보편적 순위를 증명하지는 않습니다. DeepSWE는 Google의 환경에서 측정됐고 프롬프트, 하네스, 재시도, 도구 권한과 종료 조건이 다를 수 있습니다.

9to5Google은 Google의 DeepSWE 비교로 Argon 77.9%, Claude Opus 5.5 74.2%, GPT-6 Astra 74.1%를 소개했습니다. 같은 조건의 독립 테스트가 아니라 출시 맥락으로 읽어야 합니다. Artificial Analysis의 Intelligence Index 53도 초기 고추론 스냅샷이며 속도는 아직 제공되지 않습니다.

실제 결정에서는 모델, 추론 설정, 도구, 컨텍스트, 재시도, 출력 토큰, 지연 시간, 통과 결과와 사람의 수정 시간을 기록하세요. 이 항목이 없으면 점수에서 에이전트 비용이나 신뢰성을 예측할 수 없습니다.

사이버 보안이 출시 조건인 이유

Google은 Argon을 일반 모델 출시로 다루지 않습니다. 신뢰된 방어자와 내부 팀에는 방어 능력을 모두 사용할 수 있도록 사이버 가드레일이 없는 버전을 제공하고, 광범위한 출시 전에는 오용 방어를 강화한다고 설명했습니다.

발표에서 언급한 네 영역은 다음과 같습니다.

  1. 오용 방지. 사이버 및 CBRN 공격 오용을 감시하면서 정당한 이중용도 연구를 보존합니다.
  2. 간접 프롬프트 인젝션. 검색된 문서에 숨은 지시를 막기 위해 레드팀과 적대적 학습을 사용합니다.
  3. 미스얼라인먼트 감시. 사용자 의도를 넘는 행동을 감시하고 필요하면 추론과 작업을 중지합니다.
  4. 환경 강화. 고위험 평가와 학습 전에 샌드박스를 격리하고 봉인합니다.

이는 안전성 설명이지 실제 시스템에 대한 공격적 테스트 허가가 아닙니다. 소유한 코드, 합성 취약점, 격리 네트워크와 명확한 중지 조건을 사용하세요.

가격과 API 상태

과금 항목Google이 공개한 Argon 가격
초기 입력$2.00 / 1M 토큰
초기 출력$10.00 / 1M 토큰
캐시 입력입력 가격 95% 할인, 초기 가격 기준 $0.10 / 1M
초기 기간 이후입력 $4.00 / 출력 $20.00 / 1M 토큰

이 가격은 Google 가격이며 OmniaKey 견적이 아닙니다. 일반 제공일, 정확한 model ID, 엔드포인트, 속도 제한, Batch 조건, 지역 규칙과 최종 캐시 계약도 아직 발표되지 않았습니다.

gemini-4-argon을 클라이언트에 넣고 지원 ID라고 가정하지 마세요. 모델 페이지가 나오면 정확한 문자열, API 버전, SDK 동작, 사고 제어, 스트리밍, 도구 스키마와 출력 과금을 함께 확인해야 합니다. OmniaKey의 제공 여부와 현재 가격은 라이브 카탈로그가 기준이며 10월 1일 Argon은 등록되지 않았습니다.

키를 URL에 넣지 않고 두 카탈로그를 확인할 수 있습니다.

bash
set -o pipefail
curl --fail-with-body --silent --show-error \
  https://generativelanguage.googleapis.com/v1beta/models \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
| jq -r '.models[]?.name | sub("^models/"; "") | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'
bash
set -o pipefail
curl --fail-with-body --silent --show-error https://api.omniakey.com/v1/models \
  -H "Authorization: Bearer $OMNIAKEY_API_KEY" \
| jq -r '.data[]?.id | select(. == "gemini-4-argon" or startswith("gemini-4-argon-"))'

빈 결과는 해당 자격 증명과 시점에 한정됩니다. 비공개 테스터의 접근을 부정하지 않으며 운영 설정에 별칭을 만들어 넣을 이유도 아닙니다.

초기 독립 스냅샷

Artificial Analysis는 **Gemini 4 Argon (High)**를 텍스트·이미지 입력, 텍스트 출력과 1M 토큰 컨텍스트를 가진 추론 모델로 표시합니다. Intelligence Index는 53으로 추적 모델 중앙값 약 26보다 높고, 지수 평가의 작업당 추정 비용은 $1.99였습니다. 생성 토큰 110M도 중앙값 82M보다 많았습니다.

같은 페이지는 출력 속도를 제공하지 않고 공급자 가격도 초기 데이터라고 설명합니다. 품질과 장황함의 초기 신호로는 쓸 수 있지만 지연 시간 약속이나 Google 요금표의 대체재는 아닙니다. 인용할 때 확인 날짜를 남기세요.

접근이 열렸을 때 평가하는 방법

출시 프롬프트 모음 대신 고정 평가 세트를 사용하세요.

  1. 저장소 변경. 결정적 테스트와 검토 가능한 diff가 있는 범위가 정해진 기능을 줍니다.
  2. 장기 디버깅. 원인은 알지만 즉시 보이지 않는 여러 모듈의 실패를 포함합니다.
  3. 도구 권한. 허용된 읽기, 거부된 쓰기, 잘못된 인자, 취소와 재시도를 테스트합니다.
  4. 지식 업무. 출처와 검토 기준이 있는 금융·법률 문서를 요청합니다.
  5. 멀티모달 컨텍스트. 정답이 있는 긴 영상, 차트 또는 문서 묶음을 사용합니다.
  6. 보안 샌드박스. 합성 취약점으로 경계에 도달하면 중지하는지 확인합니다.

각 실행에 모델 ID·공급자, 추론 설정·도구 정의, 입력·캐시·추론·표시 출력 토큰, 첫 토큰 시간·전체 지연·재시도·공급자 오류, 합격 여부·첫 시도 합격·사람의 수정 시간, 직접 또는 게이트웨이 비용을 기록하세요.

Gemini 3.8 Flash, Claude Opus 5.5 또는 GPT-6 Astra와 같은 저장소 상태와 도구로 비교하세요. 높은 점수라도 재시도나 수정이 많으면 더 비쌀 수 있습니다.

결론: 평가 큐에는 넣되 자동 전환하지 말 것

Gemini 4 Argon은 2026년의 중요한 모델 발표 중 하나입니다. DeepSWE, 기업 업무, 영상과 사이버 보안 결과는 긴 도구 작업이라는 목표와 맞습니다. API가 열리면 1M 출력 한도와 $2/$10 도입 가격은 측정 가능한 파일럿을 만들 만합니다.

하지만 Google이 주요 표를 관리하고 공개 model ID와 SDK 계약이 없으며 제공은 단계적이고 독립 속도 데이터도 없습니다. 지금은 기준선을 고정하고 공식 접근 경로를 요청한 뒤 같은 수용 세트를 통과했을 때만 전환하세요. 현재 OmniaKey 경로는 모델 카탈로그에서 확인하고, Argon이 확대될 때까지 Gemini 3.8 Flash 가격 가이드를 현재 Google 비용 기준으로 사용하세요.

자주 묻는 질문

Gemini 4 Argon은 모두 사용할 수 있나요?

아닙니다. Fairwind의 신뢰된 사이버 방어자부터 시작하며 이후 유료 API 고객과 Google AI Ultra 구독자에게 확대될 예정입니다. 일반 제공일은 발표되지 않았습니다.

Gemini 4 Argon API model ID는 무엇인가요?

Google은 제품명을 발표했지만 발표 자료에 안정적인 공개 API ID를 적지 않았습니다. 모델 페이지와 Models API가 정확한 ID를 반환할 때까지 gemini-4-argon은 검색 문자열로만 취급하세요.

Gemini 4 Argon 가격은 얼마인가요?

도입 가격은 입력 1M 토큰 $2, 출력 $10이며 캐시 입력은 95% 저렴합니다. 도입 후에는 $4와 $20이라고 Google이 밝혔습니다. OmniaKey 가격은 아닙니다.

Argon은 1M 토큰 컨텍스트를 지원하나요?

Google이 명시한 것은 기존 64K에서 늘어난 1M 출력 토큰 한도입니다. Artificial Analysis는 컨텍스트를 1M으로 표시합니다. 예산을 세우기 전에 Google API 문서에서 최종 입력·출력 계약을 확인하세요.

지금 Gemini 3.8 Flash를 바꿔야 하나요?

발표만으로 자동 교체할 이유는 없습니다. 현재 검증된 경로를 기준선으로 두고 Argon 접근, 가격과 SDK 동작이 문서화된 뒤 같은 작업을 다시 실행하세요.

확인한 출처

공식·1차 자료:

독립·2차 자료:

2026-10-01 확인. 가격, 제공 여부, model ID와 평가 결과는 바뀔 수 있습니다. 운영 설정을 바꾸기 전에 Google 최신 모델 페이지와 OmniaKey 라이브 카탈로그를 확인하세요.