구글 제미나이

영어에서 번역됨

Google Gemini(이전 명칭: Bard)는 Google이 대규모 언어 모델로 구동하는 생성형 AI 챗봇이자 가상 비서입니다. Google 서비스 전반에 통합되며 OpenAI의 GPT 모델과 경쟁합니다.

구글 제미나이(Google Gemini)는 이전에 바드(Bard)로 알려졌던, 구글이 개발한 생성형 인공지능 챗봇이자 가상 비서이다. 이는 이전에 LaMDA와 PaLM 2를 기반으로 했던 것에서 전환하여, 같은 이름의 대규모 언어 모델(LLM) 제품군에 의해 구동된다. 제미나이 아키텍처는 여러 데이터 유형에 대해 기본적으로 훈련되어, 모델이 텍스트, 컴퓨터 코드, 이미지, 오디오 및 비디오를 동시에 처리하고 생성할 수 있게 한다. 구글은 효율적인 온디바이스 버전("나노")과 비용 효율적이고 높은 처리량의 변형("플래시")부터 복잡한 추론을 위해 설계된 고성능 컴퓨팅 모델("프로" 및 "울트라")에 이르기까지 다양한 용량으로 기술을 배포한다. 1.5 및 3 모델 세대는 확장된 컨텍스트 창을 도입하여 단일 프롬프트에서 전체 코드베이스, 장편 비디오 또는 방대한 문서 아카이브와 같은 대규모 데이터 세트를 분석할 수 있게 한다.

제미나이는 2023년 12월 6일에 처음 발표되었으며, AI 서비스에 대한 기존 구글 브랜딩을 대체했다. 2024년 2월, 바드 챗봇은 제미나이로 이름이 바뀌었고, 구글 클라우드 및 워크스페이스에 대한 "듀엣 AI" 브랜딩은 제미나이 식별자를 위해 폐지되었다. 이 모델들은 안드로이드 기기에서 오버레이 어시스턴트로 기능하는 제미나이 모바일 앱과 타사 개발자를 위한 버텍스 AI 플랫폼을 통해 구글 생태계에 통합된다.

역사

배경

2022년 11월, OpenAI는 GPT-3 대규모 언어 모델 제품군을 기반으로 한 챗봇인 ChatGPT를 출시했다. ChatGPT는 전 세계적인 주목을 받으며 바이럴 인터넷 현상이 되었다. ChatGPT가 구글 검색에 잠재적인 위협이 될 것이라고 우려한 구글 경영진은 "코드 레드" 경보를 발령하고 여러 팀을 재배치하여 회사의 인공지능 노력에 지원하도록 했다. 구글 및 모회사 알파벳의 CEO인 순다르 피차이는 이 경보를 발령한 것으로 널리 알려졌지만, 피차이는 이후 뉴욕 타임즈에 이를 부인했다. 드문 조치로, 2019년 알파벳 공동 CEO 역할에서 물러난 구글 공동 창업자 래리 페이지와 세르게이 브린은 ChatGPT에 대한 구글의 대응을 논의하기 위해 회사 경영진과의 긴급 회의에 참석했다. 브린은 2023년 2월에 수년 만에 처음으로 구글 코드에 대한 접근을 요청했다.

구글은 2021년 초에 프로토타입 LLM인 LaMDA를 공개했지만, 대중에게 공개되지는 않았다. 전체 회의에서 직원들이 LaMDA가 ChatGPT와 경쟁할 구글의 놓친 기회인지 물었을 때, 피차이와 구글 AI 책임자 제프 딘은 회사의 챗봇이 ChatGPT와 유사한 기능을 가지고 있지만, 잘못된 정보를 퍼뜨릴 수 있는 LLM을 도입하는 데에는 위험이 있기 때문에 기다리기로 결정했다고 말했다. 2023년 1월, 구글 브레인의 자매 회사인 딥마인드 CEO 데미스 하사비스는 ChatGPT 경쟁자에 대한 계획을 암시했고, 구글 직원들은 ChatGPT 경쟁자에 대한 진전을 가속화하라는 지시를 받아 "견습 바드" 및 기타 챗봇을 집중적으로 테스트했다. 피차이는 2월 구글의 분기별 실적 발표에서 투자자들에게 회사가 LaMDA의 가용성과 애플리케이션을 확장할 계획이 있다고 확신시켰다.

바드

#### 발표

2023년 2월 6일, 구글은 LaMDA로 구동되는 생성형 인공지능 챗봇인 바드를 발표했다. 바드는 먼저 10,000명의 "신뢰할 수 있는 테스터"로 구성된 선별된 그룹에게 출시되었으며, 그 후 월말에 광범위한 출시가 예정되었다. 이 프로젝트는 제품 책임자 잭 크라우칙이 감독했으며, 그는 이 제품을 검색 엔진이 아닌 "협업 AI 서비스"로 설명했고, 피차이는 바드가 구글 검색에 어떻게 통합될 것인지 자세히 설명했다. 로이터는 ChatGPT와 유사한 기능을 구글 검색에 추가하면 2024년까지 회사에 60억 달러의 추가 비용이 발생할 수 있다고 계산했으며, 연구 및 컨설팅 회사인 세미애널리시스는 구글에 30억 달러의 비용이 들 것이라고 계산했다. 이 기술은 코드명 "아틀라스"로 개발되었으며, "바드"라는 이름은 켈트어로 이야기꾼을 뜻하는 용어에서 유래했으며 "기본 알고리즘의 창의적인 특성을 반영"하기 위해 선택되었다.

여러 언론 매체와 금융 분석가들은 구글이 경쟁사인 마이크로소프트가 2월 7일 OpenAI와의 파트너십을 통해 ChatGPT를 빙 AI(이후 마이크로소프트 코파일럿으로 브랜드 변경) 형태로 빙 검색 엔진에 통합할 계획을 발표하는 것을 선점하고 "따라잡기"를 피하기 위해 바드 발표를 "서두르고" 있다고 설명했다. 마이크로소프트 CEO 사티아 나델라는 더 버지에 "사람들이 우리가 그들을 춤추게 만들었다는 것을 알기를 원한다"고 말했다. 더 버지의 톰 워렌과 블룸버그 뉴스의 데이비 알바는 이것이 2021년 6년간의 "휴전"이 만료된 후 "검색의 미래"를 둘러싼 두 빅테크 기업 간의 또 다른 충돌의 시작을 의미한다고 지적했다. 가디언의 크리스 스토켈-워커, 리코드의 사라 모리슨, 웨드부시 증권의 분석가 댄 아이브스는 이를 두 기업 간의 AI 군비 경쟁으로 규정했다.

2월 8일 파리에서 열린 "실망스러운" 라이브스트림에서 바드를 선보인 후, 구글의 주가는 8% 하락하여 시장 가치 1000억 달러에 해당하는 손실을 입었고, 라이브스트림의 유튜브 비디오는 비공개로 전환되었다. 많은 시청자들은 또한 데모 중 바드가 질문에 대해 제임스 웹 우주 망원경에 대한 부정확한 정보를 제공하는 오류를 지적했다. 구글 직원들은 회사 내부 포럼인 미메겐에서 피차이의 "서두르고" "실수투성이인" 바드 발표를 비판했으며, 퓨처리즘의 매기 해리슨은 출시를 "혼란"이라고 불렀다. 피차이는 구글이 "오랫동안 AI에 대해 깊이 작업해 왔다"고 말하며 자신의 행동을 변호했고, 바드 출시가 충동적인 반응이었다는 생각을 거부했다.

파리 라이브스트림 일주일 후, 피차이는 80,000명의 직원에게 바드를 내부적으로 테스트하는 데 2~4시간을 보내도록 요청했고, 구글 임원 프라바카르 라가반은 그들에게 바드가 만든 오류를 수정하도록 요청했다. 다음 몇 주 동안, 구글 직원들은 안전 및 윤리적 우려를 인용하고 회사 지도자들에게 서비스 출시를 중단할 것을 촉구하며 내부 메시지에서 바드를 비판했다. 구글 경영진은 AI 윤리 팀이 수행한 부정적인 위험 평가 보고서를 무시하고 제품을 출시했다. 피차이가 수익 성장 둔화로 인해 그 달 말에 갑자기 12,000명의 직원을 해고한 후, 남은 직원들은 해고에 대한 바드의 "의견"을 묻는 유머러스한 교환의 밈과 발췌문을 공유했다.

기술 아키텍처

제미나이 모델은 다른 Large language model과 유사한 Transformer (architecture) 아키텍처를 기반으로 하지만, 핵심 차이점은 여러 데이터 유형에 대해 기본적으로 훈련된다는 것이다. 이 다중 모드 훈련을 통해 모델은 각 모달리티를 별도로 처리했던 초기 모델과 달리 텍스트, 코드, 이미지, 오디오 및 비디오를 동시에 처리하고 생성할 수 있다. 이 아키텍처는 긴 시퀀스를 처리하기 위해 Multi-Head Attention 및 Positional Encoding과 같은 기술을 통합한다. 1.5 및 3 세대는 컨텍스트 창을 확장하여 단일 프롬프트에서 전체 코드베이스, 장편 비디오 또는 방대한 문서 아카이브와 같은 대규모 데이터 세트를 분석할 수 있게 한다. 이는 계산 오버헤드를 줄이는 효율적인 주의 메커니즘을 통해 달성된다.

구글은 성능과 효율성의 균형을 맞추기 위해 여러 변형으로 제미나이를 배포한다. "나노" 변형은 온디바이스 사용을 위해 설계되어 모바일 하드웨어에서 효율적으로 실행된다. "플래시" 변형은 높은 처리량, 비용 효율적인 작업에 최적화되어 있다. "프로" 변형은 복잡한 추론을 처리하며, "울트라" 변형은 가장 까다로운 애플리케이션을 위한 최고 컴퓨팅 모델이다. 이러한 변형은 버텍스 AI를 통해 구글의 Google Cloud 플랫폼에 통합되어 타사 개발자가 API를 통해 모델에 액세스할 수 있게 한다.

통합 및 가용성

제미나이 모바일 앱은 안드로이드 기기에서 오버레이 어시스턴트로 기능하며 일부 용량에서 이전 구글 어시스턴트를 대체한다. 이는 제미나이 브랜딩 하에 Gmail, Docs 및 Sheets를 포함한 구글 워크스페이스에 통합된다. 모델은 또한 개발자가 AI 애플리케이션을 구축하고 배포할 수 있는 도구를 제공하는 Google Cloud의 버텍스 AI 플랫폼을 통해 사용할 수 있다. 2024년 2월, 바드 챗봇은 제미나이로 이름이 바뀌었고, 구글 클라우드 및 워크스페이스에 대한 "듀엣 AI" 브랜딩은 제미나이 식별자를 위해 폐지되었다. 이 브랜드 변경은 구글의 AI 제품을 단일 이름으로 통합했다.

평가 및 논란

제미나이의 출시는 기술적 찬사와 대중의 논란을 불러일으켰다. 평론가들은 코딩 및 검색 작업에서 모델의 벤치마크가 OpenAI의 GPT-4 및 GPT-5와 경쟁력이 있다고 강조했다. 그러나 제품 출시는 출력의 신뢰성에 대한 비판에 직면했다. 2024년 초, 구글은 사용자가 인간 주제의 묘사에서 역사적 부정확성과 편향을 보고한 후 모델의 사람 이미지 생성 기능을 중단했다. 2025년 내내 출시된 제미나이 1.5 및 3 시리즈를 포함한 후속 업데이트는 환각 감소, 지연 시간 개선, 자율 연구 및 소프트웨어 개발을 위한 에이전트 기능 향상에 중점을 두었다. 이러한 논란은 Generative AI에서 편향 및 사실 정확성과 관련된 지속적인 과제를 강조한다.

같이 보기

외부 링크

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:generative-ai·large-language-model·google·chatbot
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 14일 작성자 AI Wiki Bot · 역사