Scale AI, Inc.는 캘리포니아주 샌프란시스코에 본사를 둔 미국의 인공지능 인프라 및 소프트웨어 기업이다. 원래 데이터 주석에 주력했던 이 회사는 인간 피드백 기반 강화 학습(RLHF) 서비스, 대규모 언어 모델(LLM) 평가, AI 애플리케이션 구축 및 배포를 위한 엔터프라이즈 소프트웨어 제품군으로 사업을 확장했다. 고객은 상업 부문과 세계 각국 정부에 걸쳐 있으며, 미국 군대와 카타르 정부도 포함된다.
회사의 연구 부서인 안전, 평가 및 정렬 연구소(Safety, Evaluation and Alignment Lab)는 LLM의 평가와 정렬에 중점을 두며, 벤치마크인 Humanity's Last Exam을 공동 개발했다. Scale AI는 자회사인 Remotasks와 Outlier를 통해 데이터 라벨링을 아웃소싱한다. Remotasks는 컴퓨터 비전과 자율주행차에, Outlier는 LLM용 데이터 주석에 중점을 둔다. 2025년 6월, Meta Platforms는 140억 달러 이상에 Scale AI의 의결권 없는 지분 49%를 인수했으며, CEO 알렉산더 왕(Alexandr Wang)은 사임하고 Meta에 합류했다.
역사
초기 (2016–2019)
Scale은 2016년 알렉산더 왕과 루시 구(Lucy Guo)가 Y Combinator를 통해 설립했다. 두 사람은 이전에 Quora에서 함께 일한 바 있다. 초기 투자자로는 Dragoneer Investment Group, Tiger Global Management, Index Ventures가 있었다. 구는 2018년에 해고되었다. 2019년 8월, 피터 틸(Peter Thiel)의 Founders Fund가 1억 달러를 투자한 후 Scale의 기업 가치는 10억 달러를 넘어 유니콘 지위를 달성했다.
성장 (2019–2025)
Scale은 2020년 미국 국방부와 계약을 체결했다. 2021년 5월, 트럼프 행정부 시절 미국 최고 기술 책임자였던 마이클 크라치오스(Michael Kratsios)가 전무이사 겸 전략 책임자로 합류했다. 2021년 7월까지 Scale은 데이터 라벨링 수요 증가에 힘입어 Greenoaks, Dragoneer, Tiger Global이 주도한 자금 조달로 기업 가치 70억 달러에 도달했다.
2022년 1월, Scale은 미국 연방 기관에 자사 도구에 대한 접근 권한을 제공하는 2억 5천만 달러 규모의 계약을 따냈다. 2022년 2월, 러시아의 우크라이나 침공에 대응하여 자동 피해 식별 서비스(Automated Damage Identification Service)를 개발하여 위성 이미지를 분석해 건물 피해를 측정하고 인도주의 단체를 위해 보고서를 지오태깅했다. 2022년 11월, Time은 Scale을 2022년 최고의 발명품 목록에 선정했으며, 회사는 세인트루이스에 사무소를 열었다.
2023년 1월, Scale은 인력의 20%를 해고했다. 2023년 5월, 미 육군 제18공수군단과 계약을 체결하여 분류 네트워크에 LLM(도노반)을 배치한 최초의 AI 기업이 되었다. 2023년 8월, Scale은 GPT-3.5를 미세 조정하는 OpenAI의 "선호 파트너"가 되었으며, 그 서비스는 ChatGPT를 만드는 데 사용되었다. 같은 달, Scale의 평가 플랫폼은 DEF CON에서 최초의 생성형 AI 레드팀 행사에 사용되어 다양한 기업의 모델을 테스트했다. 2023년 12월, Scale은 개방형 생성형 AI 모델을 위한 보안 프레임워크인 Meta의 Purple Llama 이니셔티브에 기여했다.
2024년 2월, 국방부는 1년 계약으로 군사 목적의 LLM을 테스트하고 평가할 기업으로 Scale을 선정했다. 2024년 3월, Accel이 자금 조달을 주도한 후 Scale의 기업 가치는 약 130억 달러에 도달했다. 2024년 5월, Scale은 Amazon과 Meta Platforms를 포함한 신규 투자자로부터 추가로 10억 달러를 조달하여 기업 가치를 140억 달러로 끌어올렸다. 2024년 8월, Scale은 미국 AI 안전 연구소와 AI 모델의 연구, 테스트, 평가에 협력하기로 합의했다.
2024년 12월, 전 직원이 임금 체불과 근로자 오분류를 주장하며 Scale을 상대로 소송을 제기했고, 다음 달 두 번째 직원도 유사한 소송을 제기했다. 2025년 1월, 여러 계약 직원이 충격적인 콘텐츠에 노출되어 심리적 피해를 입었다며 Scale을 상대로 소송을 제기했다. 같은 달, The Conversation은 Scale과 Meta가 이전에 군사 목적의 LLM 제품인 Defense Llama를 공동 제작 및 판매한 적이 있다고 보도했다. Scale은 또한 The Washington Post에 도널드 트럼프 대통령에게 "AI 전쟁에서 승리"할 것을 호소하는 전면 광고를 게재했다. 1월 말, Scale과 AI 안전 센터(Center for AI Safety)는 AI 시스템용 벤치마크인 Humanity's Last Exam을 공개했다. Scale은 또한 EnigmaEval, MultiChallenge, MASK 벤치마크 개발에도 참여했다.
2025년 2월, Scale은 Web Qatar 2025 정상회의에서 서명된 계약으로 AI 도구와 교육을 통해 정부 서비스를 개선하기 위해 카타르 정부와 5년 파트너십을 체결했다. 또한 2월에 Scale은 미국 AI 안전 연구소의 AI 모델 제3자 평가 기관이 되었다. 2025년 3월, Scale은 국방부와 Thunderforge 프로젝트에 대한 수백만 달러 규모의 계약을 체결했다. 이는 군사 작전 계획 및 실행에 AI를 사용하는 "미국 군사 자동화의 주요 단계"로, 국방 혁신 부서(Defense Innovation Unit)가 Anduril Industries 및 Microsoft와 함께 수여했으며, 처음에는 USINDOPACOM과 EUCOM을 대상으로 한다. 2025년 4월, Scale은 벤치마크에 대해 LLM을 테스트하여 약점을 식별하고 훈련 데이터 필요성을 표시하는 플랫폼인 Scale Evaluation을 출시했다.
Meta의 추가 투자 (2025)
2025년 6월 10일, Meta Platforms는 148억 달러에 Scale AI의 의결권 없는 지분 49%를 인수하기로 합의했다. Scale은 독립적인 단독 법인으로 남았다. 전 CEO 알렉산더 왕은 Meta 내 고위 직책을 맡았고, Scale의 최고 전략 책임자이자 전 Uber 임원인 제이슨 드로게(Jason Droege)가 그를 대체했다.
Scale Labs
2026년 3월, 회사는 AI 연구 개발을 촉진하기 위한 이니셔티브인 Scale Lab을 출시했다.
운영 및 서비스
Scale AI는 데이터 주석, RLHF, 모델 평가를 포함하는 데이터 엔진을 제공한다. 이 플랫폼은 컴퓨터 비전, 자율주행차, LLM을 지원한다. 회사는 취약점, 편향, 안전 위험을 식별하기 위해 인간 기반 적대적 테스트를 수행하는 LLM 레드팀을 운영한다. 이 팀은 OpenAI, Google DeepMind, 각국 AI 안전 연구소와 협력하여 사이버 보안 취약점, 탈옥, 에이전트형 AI 행동과 같은 위협에 대해 시스템을 평가해 왔다.
정부 및 군사 계약
Scale의 정부 업무에는 미국 국방부, 미 육군, 국방 혁신 부서와의 계약이 포함된다. 프로젝트로는 분류 네트워크에 배치된 LLM인 도노반(Donovan)과 AI 기반 군사 의사 결정 도구인 Thunderforge가 있다. 국제적으로 Scale은 사회 프로그램 효율성 개선을 위해 카타르와 파트너십을 맺었다.
상업 파트너십
상업 고객으로는 Google, Microsoft, Meta, General Motors, OpenAI, Time이 있다. Scale과 OpenAI의 파트너십은 GPT-3.5 미세 조정을 포함하며 ChatGPT 개발에 기여했다. 회사는 또한 Meta의 Purple Llama 이니셔티브에도 기여했다.
논란 및 법적 문제
Scale은 2024년 말과 2025년 초에 임금 체불, 근로자 오분류, 계약 직원의 심리적 피해를 주장하는 소송에 직면했다. 이러한 사례는 AI 데이터 라벨링 산업의 노동 관행에 대한 지속적인 우려를 부각시킨다.
같이 보기
- 인공지능
- 대규모 언어 모델
- OpenAI
- Google DeepMind
- Amazon Web Services
- Meta Platforms