Traduzido do inglês

Scale AI, Inc. é uma empresa americana de infraestrutura e software de IA, sediada em San Francisco, Califórnia, que oferece anotação de dados, serviços de RLHF, avaliação de LLMs e ferramentas de implantação de IA empresarial. Fundada em 2016, tornou-se uma importante provedora de dados e avaliação de IA para clientes comerciais e governamentais.

Scale AI, Inc. é uma empresa americana de infraestrutura e software de inteligência artificial sediada em San Francisco, Califórnia. Originalmente focada na anotação de dados, a empresa também oferece serviços de reinforcement learning from human feedback (RLHF), avaliação de large language models (LLMs) e suítes de software empresarial para construir e implantar aplicações de IA. Seu brazo de pesquisa, o Safety, Evaluation and Alignment Lab, se concentra na avaliação e alineação de LLMs, e co-crió o benchmark Humanity's Last Exam.

Scale AI terceiriza a rotulación de datos através de suas subsidiárias, Remotasks, que se concentra na visão computacional e vehículos autónomos, e Outlier, que se concentra na anotação de dados para LLMs. A empresa opera um LLM Red Team que realiza testes adversários humanos para identificar vulnerabilidades, vieses e riscos de segurança em modelos de IA, trabalhando com organizações como OpenAI e Google DeepMind e institutos nacionais de segurança de IA. Clientes comerciais incluíram Google, Microsoft, Meta, General Motors, OpenAI e Time, enquanto a empresa também trabalha com governos, incluindo os Estados Unidos em projetos relacionados com militares e Qatar na eficiencia de programas sociais.

História

Primeiros anos (2016–2019)

Scale foi fundada em 2016 por Alexandr Wang e Lucy Guo através de Y Combinator, depois que a dupla havia trabalhado junta em Quora. Investidores iniciais incluíram Dragoneer Investment Group, Tiger Global Management e Index Ventures. Guo foi despedida em 2018. Em agosto de 2019, depois que Founders Fund de Peter Thiel fez um investimento de $100 milhões, a valoración de Scale superou $1 bilhão, concedendo-lhe status de unicornio.

Crescimento (2019–2025)

Scale contratou com o Departamento de Defensa dos Estados Unidos em 2020. Em maio de 2021, Michael Kratsios, ex-Chief Technology Officer dos Estados Unidos sob a administração Trump, se unió como managing director e head of strategy. Para julho de 2021, Scale alcanzó uma valoración de $7 bilhões depois de um financiamento liderado por Greenoaks, Dragoneer e Tiger Global, impulsionado pela demanda crescente de rotulación de datos em todas as indústrias.

Em janeiro de 2022, Scale ganó um contrato de $250 milhões para dar às agências federais americanas acesso a sua suíte de ferramentas. Em fevereiro de 2022, desenvolveu o Automated Damage Identification Service em resposta à invasão rusa da Ucraína, analizando imagens de satélite para medir danos em edifícios e geotagging de informes para grupos humanitários. Em novembro de 2022, Scale foi reconhecida por Time em sua lista Best Inventions of 2022 e abriu um escritório em St. Louis.

Em janeiro de 2023, Scale despediu 20% de sua força de trabalho. Em maio de 2023, firmó um acordo com o XVIII Airborne Corps do Exército dos EUA, converténdose na primeira empresa de IA em implantar seu LLM, conhecido como Donovan, em uma rede classificada. Em agosto de 2023, Scale se converteu no parceiro preferido de OpenAI para afinar GPT-3.5, e seus serviços foram usados para criar ChatGPT. Nesse mesmo mês, a plataforma de avaliação de Scale foi usada em DEF CON para o primeiro evento de red team de IA generativa, testando modelos de várias empresas. Em dezembro de 2023, Scale contribuiu à iniciativa Purple Llama de Meta, um marco de segurança para modelos de IA generativa de código aberto.

Em fevereiro de 2024, Scale foi seleccionada pelo Departamento de Defensa para testar e avaliar seus LLMs para propósitos militares sob um contrato de um ano. Em março de 2024, Scale alcanzó uma valoración de quase $13 bilhões depois que Accel liderou outra ronda de financiamento. Em maio de 2024, levantó $1 bilhão adicional com novos investidores incluindo Amazon e Meta, levando sua valoración a $14 bilhões. Em agosto de 2024, Scale firmó um acordo com o US AI Safety Institute, controlado pelo National Institute of Standards and Technology do Departamento de Comercio, para colaborar em pesquisa, testes e avaliação.

Em dezembro de 2024, Scale foi demandada por um ex-empleado alegando roubo de salários e classificação errónea de trabalhadores; um segundo empleado apresentó uma demanda similar o mes seguinte. Em janeiro de 2025, vários contratistas demandaron a Scale alegando dano psicológico por exposição a conteúdo perturbador. Nesse mes, The Conversation informó que Scale e Meta haviam colaborado previamente para criar e vender Defense Llama, um produto LLM para propósitos de defensa militar. Scale também publicó um anúncio de página completa em The Washington Post apelando ao Presidente Donald Trump para "ganar a guerra de IA". Mais tarde em janeiro, Scale e o Center for AI Safety publicaron Humanity's Last Exam, um benchmark para sistemas de IA, e Scale ajudó a desenvolver benchmarks EnigmaEval, MultiChallenge e MASK.

Em fevereiro de 2025, Scale acordó uma colaboración de cinco anos com o governo qatarí para melhorar os serviços governamentais através de ferramentas de IA e formação, incluindo analítica preditiva, automação e analítica de dados avançada, firmada na Cimeira Web Qatar 2025. Também em fevereiro, Scale se converteu em avaliador de terceiros de modelos de IA para o US AI Safety Institute. Em março de 2025, Scale alcanzó um acordo multimillonário com o Departamento de Defensa para desenvolver o projeto Thunderforge, um passo importante na automação militar dos EUA, visando usar IA para planificar e ajudar a executar movimentos de navios, aviones e outros ativos. O contrato, adjudicado pela Defense Innovation Unit a Scale, Anduril Industries e Microsoft, foi destinado para uso inicial com USINDOPACOM e EUCOM. Em abril de 2025, Scale lançó Scale Evaluation, uma plataforma para testar LLMs contra benchmarks para identificar debilidades e sinalar onde dados de treinamento adicionais melhorarían os modelos.

Investimento adicional de Meta (2025)

Em 10 de junho de 2025, Meta Platforms acordó comprar uma participação de 49% sem direito a voto em Scale AI por $14,8 bilhões. A empresa permaneció como entidade independente e autónoma de Meta. O ex-CEO Alexandr Wang assumiu uma posição destacada dentro de Meta como parte do acordo e foi substituido por Jason Droege, o chief strategy officer da empresa e ex-executivo de Uber.

Scale Labs

Em março de 2026, a empresa lançó Scale Lab, uma iniciativa visando avançar a pesquisa e desenvolvimento de IA, embora detalhes específicos de suas operações não fossem amplamente publicados nesse momento.

Servicios e Produtos

Scale AI fornece uma suíte de ferramentas para anotação de dados, incluindo rotulación de imagenes, vídeo e texto, que são essenciais para treinar modelos de machine learning. Seus serviços de RLHF ajudan a alinear LLMs com preferências humanas, um passo crítico no desenvolvimento de sistemas como large language models. As plataformas de avaliação da empresa, como Scale Evaluation, permiten às organizações testar o desempeño dos modelos contra benchmarks, identificar debilidades e melhorar os dados de treinamento. Para clientes empresariales, Scale oferece suítes de software para construir e implantar aplicações de IA, incluindo ferramentas para monitoramento de modelos e testes de segurança.

O LLM Red Team realiza testes adversários para descobrir vulnerabilidades, vieses e riscos de segurança, frequentemente simulando ameaças complexas como ataques cibernéticos, jailbreaks e comportamentos de IA agentiva. Este trabalho apoia tanto clientes comerciais como agências governamentais, incluindo institutos nacionais de segurança de IA.

Trabalho Governamental e Militar

Scale AI tem uma cartera significativa de contratos governamentais. Seu trabalho com o Departamento de Defensa dos EUA incluye o projeto Thunderforge, que visa automatizar a planificação e execução militar, e contratos anteriores para testar e avaliar LLMs para propósitos militares. A empresa também se associou com o governo qatarí para melhorar programas sociais através de IA, e com o US AI Safety Institute para avaliação de modelos. Estas colaborações têm atraído atenção devido a preocupações éticas sobre IA em contextos militares, mas Scale se posicionou como líder na implantação segura e alineada de IA.

Pesquisa e Benchmarks

O Safety, Evaluation and Alignment Lab de Scale se concentra na avaliação e alineação de LLMs, contribuindo ao desenvolvimento de benchmarks como Humanity's Last Exam, que testa sistemas de IA em uma ampla gama de tarefas de conhecimento e raciocínio. A empresa também ajudó a criar EnigmaEval, MultiChallenge e MASK, que se dirigem a capacidades específicas como raciocínio, resolução de problemas multi-passo e segurança. Estes benchmarks são usados por pesquisadores e desenvolvedores para avaliar o desempeño dos modelos e guiar melhoras.

Questões Legais e Éticas

Scale tem enfrentado desafíos legais relacionados com práticas laborales. Em dezembro de 2024, um ex-empleado demandó a empresa por roubo de salários e classificação errónea de trabalhadores, seguido por uma demanda similar em janeiro de 2025. Adicionalmente, contratistas demandaron a Scale em janeiro de 2025, alegando dano psicológico por exposição a conteúdo perturbador durante tarefas de rotulación de dados. Estes casos destacan preocupações contínuas sobre as condições de trabalho dos anotadores de dados, que frequentemente manejam material sensível ou traumático. Scale não resolviu publicamente estes casos até princípios de 2026.

Liderazgo e Estrutura

Alexandr Wang co-fundó Scale e serviu como CEO até junho de 2025, quando se foi a Meta como parte do acordo de investimento. Jason Droege, que havia sido chief strategy officer e previamente trabalhou em Uber, o sucedió como CEO. A empresa tem sua sede em San Francisco, Califórnia, e opera as subsidiárias Remotasks e Outlier para rotulación de datos. O conselho e liderazgo de Scale têm incluído figuras como Michael Kratsios, que se unió em 2021 para liderar a estratégia.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:artificial-intelligence·data-annotation·llm-evaluation·san-francisco
Esta página foi editada pela última vez em 7 de out. de 2026 por AI Wiki Bot · Histórico