MY 뉴스
홈 주요뉴스 글로벌

[미국 특징주] 구글 '제미나이 4 아스트라' 공개...사내선 "실무 코딩 미흡" 회의론

※ 뉴스 공유하기

URL 복사완료

※ 본문 글자 크기 조정

  • 더 작게
  • 작게
  • 보통
  • 크게
  • 더 크게

※ 번역할 언어 선택

AI 핵심 요약

beta
분석 중...
  • 블룸버그가 30일 구글이 제미나이4를 공개했으나 내부는 회의적이라고 전했다.
  • 구글은 벤치마크 강점을 내세웠지만 실무 코딩 성능은 기대에 못 미쳤다.
  • 비용 부담과 인재 이탈 속 구글은 주장 왜곡을 부인하며 반격했다.

AI가 자동 생성한 요약으로 정확하지 않을 수 있어요.

이 기사는 인공지능(AI) 모델의 번역을 기반으로 전문 기자의 검증과 분석을 통해 생성한 콘텐츠로, 원문은 10월 1일 블룸버그 보도입니다. 

[서울=뉴스핌] 최원진 기자= 알파벳(NASDAQ: GOOGL) 구글이 차세대 인공지능(AI) 모델인 '제미나이 4'를 전격 공개했으나, 내부에서는 실제 성능, 특히 코딩 능력에 대한 회의론이 제기되고 있다고 블룸버그 통신이 30일(현지시간) 보도했다.

구글은 이날 소수의 신뢰할 수 있는 사이버 보안 파트너에게 해당 모델을 공개했으며, 추가 테스트를 거쳐 유료 구독자를 시작으로 접근 권한을 확대할 예정이라고 밝혔다.

구글 로고 [사진=로이터 뉴스핌]

구글 측은 제미나이 4가 여러 주요 벤치마크(성능 평가) 테스트에서 우수한 점수를 기록했고, 특히 보안 능력을 측정하는 테스트에서는 오픈AI의 아스트라 모델을 능가했다고 전했지만 정작 구글 내부 관계자들은 지표만 믿을 순 없단 분위기인 것으로 전해졌다. 구글 내부 개발진이 제미나이 4를 실무에 투입했을 때 평가 테스트 점수만큼의 성능을 보여주지 못하고 있어서다. 특히 웹과 앱의 외관과 사용자 경험을 디자인하는 프론트엔드 작업 등 복잡한 실무 코딩 분야에서 난항을 겪고 있는 것으로 전해졌다.

전문가들은 구글이 실제 유용한 제품을 만들기보다 벤치마크 점수를 높이는 데만 몰두하는 이른바 '벤치맥싱(Benchmaxxing)' 현상에 빠졌을 수 있다고 말한다. 이는 엔지니어들이 제품의 성능보다는 벤치마크 점수 향상에만 집중하는 현상을 일컫는데, AI 연구소들이 이러한 경향을 보이는 이유는 고객들이 벤치마크 점수를 기준으로 모델을 평가하는 경우가 많기 때문이다. 

AI 스타트업 써지AI의 창업자 에드윈 첸 대표는 "비유하자면 '우리 아이가 SAT(미국 수능)에서 높은 점수를 받았다'와 같다. 시험 점수가 높다고 해서 사회에서의 실제 업무 능력이 뛰어난 것은 아닌 것과 같은 이치"라고 꼬집었다.

AI MY뉴스 AI 추천

여기에 제미나이 4의 거대한 모델 규모로 인한 높은 운영비용(마진 압박) 역시 부담으로 작용하고 있다는 분석이다.

구글의 AI 개발 잔혹사는 이번이 처음이 아니다. 구글은 당초 지난 6월 '제미나이 3.5 프로'를 출시할 계획이었으나 개발에 차질을 빚으며 프로젝트를 전격 폐기했다. 해당 프로젝트 수포로 구글은 최대 4억 달러에 달하는 개발 비용을 허비한 것으로 추정된다.

사내 분위기 역시 엇갈리고 있다. 일부 직원들은 경쟁사인 앤스로픽의 페이블이나 오픈AI의 아스트라가 제미나이보다 빠르게 발전하고 있어 격차를 줄이기 어렵다고 보고 있다. 또한 정교한 전략 부재, 관료주의적 조직 문화에 대한 불만 속에 제프 딘 등 간판급 AI 연구원들의 이탈도 이어졌다.

반면 구글 측은 제미나이 4의 코딩 성능 저하 주장에 대해 "사실과 다르다"고 반박했다. 코레이 카부크추오글루 구글 딥마인드 최고경영자(CEO)는 "팀을 전적으로 신뢰하며, 구글이 늘 최첨단 자리를 지킬 것임은 확실하다"고 강조했다.

wonjc6@newspim.com

22대 국회의원 인물DB
<저작권자© 글로벌리더의 지름길 종합뉴스통신사 뉴스핌(Newspim), 무단 전재-재배포 금지>