인기 게시판 TOP 50
![]()
구글(Google)이 오랫동안 기다려온 차세대 인공지능(AI) 모델인 '제미나이 4 아르곤(Gemini 4 Argon)'을 소수의 사이버 보안 파트너들에게 우선 공개한다고 수요일 밝혔습니다.
주목할 이유 (Why it matters): 제미나이 4는 구글 최상위 플래그십 모델 라인업의 오랜 공백 끝에 출시되었습니다. 그 공백기 동안 경쟁사인 오픈AI(OpenAI)와 앤스로픽(Anthropic)이 앞을 향해 질주하는 사이, 구글은 상대적으로 더 작고 저렴한 '플래시(Flash)' 모델들만을 지속적으로 출시해 왔습니다.
현주소 (State of play): 구글은 제미나이 4 아르곤이 소프트웨어 엔지니어링, 금융, 법률 업무, 사이버 보안 분야에서 복잡하고 장시간 실행되는 장기 과업(Long-running tasks)을 처리하도록 특별히 설계되었다고 설명합니다.
-
구글은 새 모델이 특정 코딩 및 지식 업무 벤치마크에서 최고 수준(SOTA)을 기록했으며, 일부 영역에서는 경쟁사인 오픈AI의 프론티어 모델 'GPT-6 아스트라(Astra)'를 능가했다고 밝혔습니다.
-
구글은 신뢰할 수 있는 소수의 사이버 방어 파트너들에게만 모델을 우선 배포하고 있으며, 미국 정부의 자발적 사전 출시 평가 절차에 참여하고 있습니다.
-
구글은 추가 테스트를 거친 후 배포 범위를 확대할 것이며, 유료 구독자들에게 우선적으로 접근 권한이 주어질 것이라고 밝혔습니다.
주요 발언 (What they're saying): 구글 딥마인드(Google DeepMind)의 제미나이 제품 총괄인 툴시 도식(Tulsee Doshi)은 Axios와의 인터뷰에서 다음과 같이 말했습니다. "아르곤은 여러 도메인 전반에 걸쳐 프론티어 역량을 갖춘 다재다능한 모델입니다."
-
"최근 몇 주 동안 구글 내부 직원들이 모델의 성능을 한계까지 철저히 테스트(Put through its paces)하면서 강력한 성능을 가까이서 직접 확인했습니다. 많은 직원들이 가장 까다로운 코딩 작업과 연구 과제를 해결하는 데 이미 이 모델에 의존하고 있습니다."
예외적 시각 (Yes, but): 블룸버그(Bloomberg)는 수요일 익명의 소식통을 인용해 일부 구글 직원들이 내부 테스트에서 모델의 성능에 미흡함을 느꼈다고 보도했습니다. (구글 측은 블룸버그에 해당 보도가 사실과 다르다고 해명했습니다.)
-
이는 벤치마크가 지닌 고유한 과제입니다. 모델은 벤치마크 점수를 잘 받도록 훈련될 수 있지만, 진정한 검증과 실질적인 결과는 현실 세계(Real-world)의 현장에서 도출되기 마련입니다.
과거 배경 (Flashback): 제미나이 4는 이전 플래그십 세대인 제미나이 3가 출시된 지 거의 1년 만에 등장했습니다.
-
지난 5월, 순다르 피차이 구글 CEO는 차기 주요 모델 출시가 6월에 이뤄질 것이라고 밝힌 바 있습니다.
-
그러나 '제미나이 3.5 프로'로 널리 예상되었던 해당 모델은 끝내 출시되지 않았습니다.
-
지난 7월, Axios는 구글 딥마인드 직원들의 사기 저하가 이러한 출시 지연의 한 원인이었다고 보도했습니다.
집중 분석 (Zoom in): 기업들과 사용자들을 뒤흔들고 있는 최근의 AI 안전성 논쟁 맥락에서 본다면, 구글이 개발에 추가적인 시간을 투입한 것이 꼭 부정적으로만 받아들여지지는 않을 수 있습니다.
-
오픈AI는 에이전트가 통제를 벗어나는 오작동(Going rogue) 문제를 겪어 왔으며, 최근에는 보안 문제를 이유로 'GPT-6.1 아스트라' 개발을 전격 폐기한다고 밝혔습니다.
-
최상위 AI 개발사인 오픈AI와 앤스로픽은 자사 에이전트들의 부적절한 오작동 및 일탈 행위와 관련된 수만 건의 사건을 조사하고 있다고 Axios가 앞서 보도한 바 있습니다.
결론 (The bottom line): 만약 개발자 커뮤니티가 벤치마크 지표에 나타난 대로 제미나이 4가 오픈AI와 앤스로픽의 프론티어 시스템과 대등한 경쟁력을 갖추고 있다고 평가한다면, 한때 역량에 의구심을 받기 시작했던 구글에게는 결정적인 대역전 및 추격의 발판이 될 것입니다.