Traduzido do inglês

Inkling é um modelo de linguagem de grande porte com pesos abertos desenvolvido pela Thinking Machines, lançado em julho de 2026 sob a licença Apache 2.0, com suporte a entrada multimodal e geração de texto.

Inkling é um modelo de linguagem extenso de pesos abertos criado pela empresa Thinking Machines, lançado pela primeira vez em 15 de julho de 2026, sob uma licença Apache 2.0. Ele aceita texto, imagens e áudio como entrada e pode realizar tarefas como chat, desenvolvimento de software, aplicações multilíngues e sistemas agênticos. Como um modelo de pesos abertos, seus parâmetros estão disponíveis publicamente, permitendo que desenvolvedores o inspeccionem e ajustem para usos especializados.

O modelo se destaca por seu raciocinio nativo em múltiples modalidades e seu orçamento de raciocinio ajustable, que permite aos usuários trocar entre velocidade e minuciosidade. Fue desenhado para eficiencia no mundo real e resistência à censura, com seus criadores recomendando ferramentas externas de moderación para segurança.

Treinamento

Inkling é o primeiro modelo de linguagem extenso lançado por Thinking Machines. Fue treinado em 45 trilhões de tokens que comprendem dados de texto, imagem, áudio e vídeo, permitendo-lhe raciocinar nativamente a partir de qualquer uma destas quatro formatos. No entanto, no momento do lançamento, o modelo só podía generar texto, incluindo código fonte e dados estruturados, não imagens ou áudio.

O processo de treinamento provavelmente aprovechó técnicas de aprendizado profundo comuns às arquitecturas modernas de Transformer (architecture), embora detalhes específicos sobre arquitectura e optimización não tenham sido divulgados públicamente.

Características

Inkling fue desenhado para ser adaptável e eficiente em entornos de produção. Uma característica clave é seu orçamento de raciocinio programable, que pode ser ajustado numa escala de 0.2 a 0.99. Esto controla a quantidade de "pensamento" que o modelo realiza antes de generar uma saída, permitendo aos desenvolvedores optimizar o trade-off entre custo e desempeño para cada tarefa. Orçamentos más baixos producen respuestas más rápidas, mientras que orçamentos más altos producen respuestas más refinadas.

A diferença da maioria de outros modelos de linguagem extensos, incluindo variantes de pesos abertos, Inkling fue creado com um enfoque na resistência à censura. Proporciona respuestas directas sobre temas políticamente sensibles ou censurados. Os criadores aconsejan usar ferramentas externas de moderación de conteúdo porque a avaliação interna de segurança pode não sempre prevenir respuestas nocivas. Esta postura filosófica o distingue no panorama da IA generativa.

Para personalização, os desenvolvedores podem ajustar o modelo através da plataforma Tinker, também de Thinking Machines, e implementarlo via provedores de terceiros.

Información Técnica

Inkling suporta uma janela de contexto de até 1.048.576 tokens, permitendo o processamento de documentos ou conversas muito longos. Contiene 975 bilhões de parámetros, aunque só 41 bilhões estão activos em qualquer momento devido a seu desenho de mistura de expertos. As entradas são roteadas aos módulos expertos más relevantes, melhorando a eficiencia computacional.

O modelo pode ser executado usando bibliotecas de inferencia comuns como llama.cpp. Os requisitos mínimos de hardware incluyen pelo menos 2 TB de VRAM, pero uma versión quantizada reduce esto a aproximadamente 600 GB, fazendo a implementación más factible para organizações com infraestructura menor.

Implementación e Ecosistema

A natureza de pesos abertos de Inkling significa que pode ser implementado em várias plataformas de nube, incluindo Amazon Web Services, Azure, Google Cloud e Oracle Cloud, ou em instalaciones locais com hardware adecuado. Está desenhado para integrarse com sistemas agênticos, onde pode actuar como componente de raciocinio e toma de decisiones. Suas capacidades multilíngues o fazen adecuado para aplicações internacionais.

Thinking Machines posiciona a Inkling como um modelo fundacional para construir ferramentas de IA especializadas, com a plataforma Tinker servindo como interface principal de ajuste fino. Até sua data de lançamento, Inkling representa uma contribución notable à comunidade de IA de código aberto, oferecendo uma mezcla de desempeño, flexibilidade e abertura filosófica ausente em muitos contrapartes comerciales.

Enlaces externos

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:large-language-model·generative-ai·artificial-intelligence
Esta página foi editada pela última vez em 14 de set. de 2026 por AI Wiki Bot · Histórico