Local AI Wizard
Modelos de imagem
51 entradas open-weight no snapshot da Artificial Analysis consultado em 2026-09-22, com revisão técnica aprofundada quando há evidência primária.
i
A cobertura completa vem de um snapshot do arena da Artificial Analysis para cada modalidade; ranks e Elo só são comparáveis dentro da mesma modalidade. Variantes de API podem compartilhar o mesmo checkpoint público.
O selo de ficha revisada indica que licença, componentes ou hardware foram conferidos em fontes primárias. Entradas apenas do benchmark continuam visíveis para garantir cobertura, com dados desconhecidos marcados em vez de inferidos.
Melhores modelos de imagem neste snapshot
Busca, filtros e meu hardware 51/51
51 modelos · 51 ranqueados · 9 fichas técnicas revisadas · snapshot do benchmark ↗ 2026-09-22
Score do benchmark × memória de GPU documentada
19 de 51 modelos visíveis têm um caminho de memória documentado. Abra o ranking para ver todos.
Comparar modelos selecionados
| Campo |
|---|
| Tarefa |
| Parâmetros |
| Tamanho do repositório |
| Componentes |
| Hardware |
| Licença |
Escolha modelos para comparar.
Modelos de vídeo
7 entradas open-weight no snapshot da Artificial Analysis consultado em 2026-09-22, com revisão técnica aprofundada quando há evidência primária.
i
A cobertura completa vem de um snapshot do arena da Artificial Analysis para cada modalidade; ranks e Elo só são comparáveis dentro da mesma modalidade. Variantes de API podem compartilhar o mesmo checkpoint público.
O selo de ficha revisada indica que licença, componentes ou hardware foram conferidos em fontes primárias. Entradas apenas do benchmark continuam visíveis para garantir cobertura, com dados desconhecidos marcados em vez de inferidos.
Melhores modelos de vídeo neste snapshot
Busca, filtros e meu hardware 13/13
13 modelos · 7 ranqueados · 6 fichas técnicas revisadas · snapshot do benchmark ↗ 2026-09-22
Score do benchmark × memória de GPU documentada
2 de 13 modelos visíveis têm um caminho de memória documentado. Abra o ranking para ver todos.
Comparar modelos selecionados
| Campo |
|---|
| Tarefa |
| Parâmetros |
| Tamanho do repositório |
| Componentes |
| Hardware |
| Licença |
Escolha modelos para comparar.
Modelos de áudio
16 entradas open-weight no snapshot da Artificial Analysis consultado em 2026-09-22, com revisão técnica aprofundada quando há evidência primária.
i
A cobertura completa vem de um snapshot do arena da Artificial Analysis para cada modalidade; ranks e Elo só são comparáveis dentro da mesma modalidade. Variantes de API podem compartilhar o mesmo checkpoint público.
O selo de ficha revisada indica que licença, componentes ou hardware foram conferidos em fontes primárias. Entradas apenas do benchmark continuam visíveis para garantir cobertura, com dados desconhecidos marcados em vez de inferidos.
Melhores modelos de áudio neste snapshot
Busca, filtros e meu hardware 19/19
19 modelos · 16 ranqueados · 3 fichas técnicas revisadas · snapshot do benchmark ↗ 2026-09-22
Score do benchmark × memória de GPU documentada
8 de 19 modelos visíveis têm um caminho de memória documentado. Abra o ranking para ver todos.
Comparar modelos selecionados
| Campo |
|---|
| Tarefa |
| Parâmetros |
| Tamanho do repositório |
| Componentes |
| Hardware |
| Licença |
Escolha modelos para comparar.
Explore your hardware
Explore high-scoring models within your memory budget.
Configuration · Q4 · 8,192 tokens · llama.cpp
llama.cpp setup documentation · Needs a supported architecture and GGUF checkpoint; choose the correct hardware backend. Choosing a runtime does not verify model compatibility. System RAM does not evaluate loading peaks or offload.
Start with a capacity
Select a preset or enter a custom capacity to reveal the strongest scored open models that fit.
Check local speed · import a benchmark
Run an optional test on your own machine, then import the JSON file. This website does not run inference or upload the file. Results remain in this tab and are not automatically matched to recommendations.
llama-bench -m /path/to/model.gguf -p 512 -n 128 -d 8192 -r 5 -o json > benchmark.jsonReplace the example path with an existing GGUF checkpoint. Requires llama-bench installed locally. Tokenization and sampling are excluded from its timing.
Browse published local measurements
Published measurements
Reported, not independently reproduced
These measurements belong to the exact checkpoint, quantization, backend, context and hardware shown. They are reference results, not a speed guarantee for another model ID, preset or runtime.
| Model / checkpoint | Hardware | Reported decode | Protocol | Source |
|---|---|---|---|---|
gpt-oss 20B MXFP4 MoEggml-org/gpt-oss-20b-GGUF | DGX Spark · 1× NVIDIA GB10MXFP4 MoE · CUDA | 83.43 ± 0.59tok/s · Not reported by llama-bench | 0 in → 32 outcontext depth=0; n_prompt=0 (tg32 row)Protocol & environment
| llama.cpp bench ↗ |
Qwen3 Coder 30B A3B Q8_0ggml-org/Qwen3-Coder-30B-A3B-Instruct-Q8_0-GGUF | DGX Spark · 1× NVIDIA GB10Q8_0 · CUDA | 61.06 ± 0.23tok/s · Not reported by llama-bench | 0 in → 32 outcontext depth=0; n_prompt=0 (tg32 row)Protocol & environment
| llama.cpp bench ↗ |
Qwen3.8 27B NVFP4 + MTPInferact/Qwen3.8-27B-NVFP4 | DGX Spark · 1× GB10NVFP4 + MTP (3 speculative tokens) · vLLM official | 18.5tok/s · TTFT 341 ms · C1 | 128 in → 128 outmax_model_len=262,144; KV dtype=FP8Protocol & environment
| NVIDIA Developer Forum ↗ |
Qwen3.8 27B NVFP4 + DSparkRadixArk/Qwen3.8-27B-NVFP4 | DGX Spark · 1× GB10NVFP4 + DSpark · SGLang | 36.6tok/s · TTFT 246 ms · C1 | 128 in → 128 outmax_model_len not stated in this recipe excerpt; do not inferProtocol & environment
| NVIDIA Developer Forum ↗ |
Reported results are kept separate from planning estimates. A missing match means “not measured here”, not zero performance.
Modelos de texto
LiveBench · 2026-06-25 · Scores de 22 modelos abertos · Consultado 2026-09-22
Comece pela qualidade. Explore o hardware quando precisar.
Escolher modelos 8/36
Escolher hardware · 4/6
8 modelos nesta visualização
Deslize o gráfico para os lados ou use a Tabela para comparar de forma compacta.
Hardware by memory capacity
32 GB
128 GB
256 GB
Explore em detalhe
Dez fichas de checkpoints, cinco configurações de hardware e três comparações por tarefa. Cada página mostra fonte, data e limites.
Modelos
Qwen3.5 9Btexto + imagem + vídeoQwen3.8 27Btexto + imagem + vídeoQwen3.5 35B A3Btexto + imagem + vídeoDeepSeek V4 Flash · 0731textoGLM-5.3 Flashtexto + imagemKimi K2.6 · thinkingtexto + imagemFLUX.2 [dev]imagemQwen-ImageimagemWan2.1 T2V 1.3BvídeoStable Audio Open SmalláudioFontes, metodologia e status dos dados
01 / LiveBench
O score geral é a média, com pesos iguais, das médias de sete categorias (0–100). Todos os scores usam a mesma versão. Este não é o Intelligence Index do Artificial Analysis; as escalas não devem ser misturadas.
CSV ↗ · Categorias ↗ · LiveBench ↗ · Política de reutilização ↗02 / Estimativa de memória
Fórmula de planejamento: parâmetros totais × 0,625 bytes, mais 20% de folga e 8 GB de reserva, arredondados para cima em GB decimais. É uma heurística, não um mínimo medido ou garantia. Quantização, contexto, cache KV, componentes visuais, runtime e offload alteram a exigência. MoE usa parâmetros totais, não só os ativos.
Qwen usa parâmetros de linguagem; GLM-5.3 e DeepSeek V4 usam contagens de tensores; GLM-5.3 Flash usa a especificação de 320B do fabricante. Arquiteturas sem estimativa revisada ficam fora do eixo de memória.
03 / Referência, não teste local
O LiveBench avalia o modelo e o esforço de raciocínio indicados. O score não mede a variante local Q4. Os links de hardware são oficiais, sem afiliados. Estoque, configuração exata e disponibilidade regional podem mudar.
04 / Atualizações automáticas sem APIs pagas
O produto publicado consulta diariamente scores, organizações oficiais aprovadas, preços e estoque nos EUA; especificações de hardware são consultadas semanalmente. Visitas vencidas também podem atualizar com segurança. O D1 preserva o último snapshot válido. Metodologia incompatível entra em quarentena; fontes indisponíveis nunca apagam dados válidos. Modelos novos permanecem com benchmark pendente ou dados insuficientes até existirem fatos oficiais.