Thinking Machines / modelo de linguagem; entradas não listadas

Inkling · xhigh

EVIDÊNCIAS EM RESUMO

Qualidade, tamanho e velocidade local

LiveBench · geral71.9/ 100

#14 entre 22 modelos abertos avaliados nesta versão

Pesos em disco · estimativa Q4~609.4 GBFórmula, não tamanho publicado do download
Memória planejada · estimativa Q4~740 GBInclui margem de planejamento; não é VRAM medida
Velocidade localSem medição exataQualidade e memória não estimam velocidade
Qualidade · Resultado de benchmark publicado; versão e fonte nos links acimaMemória · Estimativa de planejamento baseada no tamanho documentado; não é compatibilidade medidaVelocidade local · Sem medição local exata

Desempenho por categoria

LiveBench 2026-06-25 · 0–100 ↗
Raciocínio78.3
Código71.0
Código com agentes49.4
Matemática88.4
Análise de dados72.8
Linguagem73.5
Seguir instruções70.1

O LiveBench 2026-06-25 avalia a variante do benchmark, não uma execução Q4 local. Notas coletadas em 2026-09-26; as sete categorias usam a mesma escala de 0 a 100. Este não é o Intelligence Index do Artificial Analysis. O tamanho Q4 cobre apenas os pesos contados; componentes multimodais podem adicionar arquivos.

MESMA VERSÃO DO BENCHMARK

Qualidade × tamanho estimado dos pesos Q4

Ranking completo ↗

Checkpoints de linguagem revisados com nota LiveBench e estimativa de tamanho baseada em parâmetros. O ponto destacado é este modelo quando ambos os valores existem.

Eixo horizontal: tamanho estimado dos pesos Q4 em disco, GB decimais (escala logarítmica). Eixo vertical: LiveBench geral / 100. A fórmula não é o tamanho publicado do checkpoint, a memória de execução nem um teste de velocidade. Modelos sem os dois dados ficam fora do gráfico, não recebem nota zero.

O checkpoint Inkling · xhigh é publicado por Thinking Machines para linguagem e raciocínio. Os pesos estão disponíveis sob Apache 2.0; isso, isoladamente, não estabelece que código e todos os componentes tenham licença open source.

Quando considerar

Compare Inkling · xhigh com outros checkpoints de linguagem e raciocínio usando a ficha do publicador e o snapshot LiveBench 2026-06-25. Esta é uma evidência de qualidade, não de velocidade local.

Confira antes de escolher

A estimativa genérica de planejamento Q4 é de cerca de 740 GB a partir de 975B parâmetros declarados. Não é um mínimo medido; contexto, lote, runtime e quantização mudam o uso real de memória.

O que está documentado

Checkpoint / versão
thinkingmachines/Inkling ↗
Licença dos pesos
Apache 2.0 ↗
Tarefa e modalidade
linguagem e raciocínio · modelo de linguagem; entradas não listadas
Contagem e base
975B · especificação do fabricante · 41B ativos
Contexto
1,000,000 tokens publicados para este modelo
Evidência de qualidade
71.9 · LiveBench 2026-06-25 overall · fonte ↗
Runtime e precisão
Nenhuma execução local verificada. Confira runtime e precisão do checkpoint suportados pelo publicador; memória para lote e contexto não foi medida aqui.

Execução local: o que sabemos

~740 GB memória genérica estimada para Q4. Fórmula: parâmetros × 0,625 byte, mais 20% de margem e 8 GB de reserva. Não é VRAM medida nem tamanho do download do checkpoint.

Apenas estimativa de planejamento Q4. Verifique formato do checkpoint, suporte do runtime, cache KV, contexto, tamanho de lote e offload antes de escolher hardware.

Nível da evidência: Apenas estimativa genérica; nenhuma execução reproduzida por este site.

Antes de baixar

  1. Confirme o checkpoint exato e a licença vinculada aqui.
  2. Confirme runtime e precisão ou quantização compatíveis com sua plataforma.
  3. Reserve memória para contexto, lote e eventuais componentes de mídia além dos pesos.

Catálogo revisado: 2026-09-30. Versão do benchmark: 2026-06-25; snapshot coletado: 2026-09-26.