Blog
Pesos abertos do Qwen 3.8 Max: especificações, preço da API e hardware
Os pesos abertos do Qwen3.8 Max foram lançados em 12 de agosto. Veja as especificações completas — 2,4T MoE, 95B ativos e contexto de 256K —, a API por US$ 2/US$ 6 por milhão de tokens, custos de auto-hospedagem e benchmarks contra Fable 5 e GPT-5.6 Sol.
Prompts para Seedance 2.5: Modelos Prontos para Copiar e Colar
Um guia prático de prompts para Seedance 2.5, com fórmula reutilizável de plano, modelos para histórias, produtos, referências e áudio, além de ajustes para desvios e ações apressadas.
Alternativas ao EvoLink AI: 5 opções por API e custo
Um guia prático de alternativas ao EvoLink AI. Escolha entre um gateway multimodal, um especialista em mídia, um roteador de LLMs, um provedor direto ou uma estrutura BYOK/self-hosted conforme o fluxo de trabalho que você precisa migrar.
Grok 5: data de lançamento, especificações e o que realmente está confirmado
O Grok 5 ainda não foi lançado. A xAI confirmou o treinamento em janeiro de 2026, mas todas as janelas previstas já passaram. Mercados de previsão indicam 82% de chance de lançamento até o fim de 2026.
Gemini 4: tudo o que foi confirmado, o que se espera e o que ainda não se sabe (2026)
O Google confirmou o pré-treinamento do Gemini 4 durante sua teleconferência de resultados do 2º trimestre de 2026. Ainda não há data de lançamento, especificações ou preço. Este guia separa fatos de especulações e recomenda modelos atuais para você usar.
Nemotron 3.5 Lightning: o MoE de 30B feito para a velocidade dos agentes
MoE de 30B com 3B de parâmetros ativos, arquitetura híbrida Mamba-2 e conclusão de tarefas de agentes 4x mais rápida. Veja especificações, análise de benchmarks, guia de implantação local e critérios para decidir.
Guia da API DeepSeek V4 Pro GA: preços, benchmarks e migração
O DeepSeek V4 Pro GA (0813) chega com 10 benchmarks publicados, pesos abertos sob licença MIT, controles de esforço de raciocínio e cobrança de API em horários de pico e fora de pico a partir de 16 de agosto. A saída do Pro sobe para US$ 1,98–US$ 3,96/M.
Prompts para fotos com Gemini AI: ideias testadas para copiar e colar
Uma biblioteca testada e organizada por tarefa de prompts para fotos com Gemini AI, para editar imagens enviadas e criar novas imagens, com cláusulas de preservação de identidade e correções para falhas comuns.
ZCode vs Claude Code: qual agente de programação vence em 2026?
ZCode e Claude Code comparados em modelos, preços, Goal Mode versus hooks, subagentes, governança de dados e os recursos adicionados ao ZCode em agosto de 2026.
Como rodar Muse Glimmer MLX no Mac com o backend SGLang
Guia para executar o Muse Glimmer 30B no Mac pelo backend MLX do SGLang: ambiente com Python 3.11, compilação a partir do código-fonte, inicialização com SGLANG_USE_MLX, variáveis de ajuste, cálculo de memória e correção de erros.
Muse Glimmer vs Qwen 3.6 27B: comparação de benchmarks para programação
Qwen3.6-27B lidera no TerminalBench 2.1 (60,7 vs. 51,7) e no SWE-bench Verified (77,2). O Muse Glimmer se destaca pelo contexto de 262K em uma única RTX 3090 e pelo menor uso de tokens por tarefa.
Muse Glimmer 30B: guia de specs, benchmarks e uso local
Muse Glimmer é o modelo multimodal denso de 30B da Meta. Alcança 236 tok/s na RTX 5090 e cabe em uma RTX 3090 com contexto de 262K. Mas fica 9 pontos atrás do Qwen 3.6 27B no TerminalBench.
OpenRouter Auto Router: como funciona, faixas de custo e quando fixar um modelo
O Auto Router atualizado do OpenRouter (ago. de 2026) usa dados de gastos da comunidade em mais de 55T de tokens semanais para selecionar modelos para cerca de 30 tipos de tarefa, com 5 faixas de custo e uma matriz de roteamento publicada.
GPT-5.6 Luna vs DeepSeek V4 Pro: testamos as duas APIs
Rodamos prompts idênticos no GPT-5.6 Luna e no DeepSeek V4 Pro, conferimos as tabelas oficiais de preços e mapeamos onde cada um leva vantagem: Luna em velocidade e visão; V4 Pro em cargas com muito cache e saídas longas.
GPT Image 2 vs Nano Banana: qual modelo escolher (2026)
GPT Image 2 vs Nano Banana 2 em renderização de texto, fotorrealismo, edição, preços de API e velocidade. GPT Image 2 vence em design e edição; NB2 em retratos e custo. Inclui um framework de decisão.
GPT-6: tudo o que se sabe até agora (agosto de 2026)
A OpenAI não anunciou o GPT-6. O codinome "Spud" chegou ao mercado como GPT-5.5, não como GPT-6. Veja o que está confirmado, o que são rumores e como está a disputa na fronteira dos modelos.
Review do OpenChamber: testamos a GUI do OpenCode para agentes de IA
O OpenChamber v1.18 reúne o SDK do OpenCode em uma interface com execuções multi-modelo, revisão de diffs por IA, acesso remoto e fluxos com GitHub. É gratuito, licenciado sob MIT e tem limitações reais.
Como usar o ChatGPT de forma eficaz: guia prático
Um guia prático para usar melhor o ChatGPT, baseado em definição de tarefa, contexto, restrições, formato de saída, iteração e verificação proporcional ao risco.
Grok Imagine 2 (Image 2.0): análise, API e alternativas
Explica que Grok Imagine 2 é o modelo de imagem Imagine Image 2.0, não a continuação em vídeo; aborda os recursos, a 2ª posição no Arena e o status da API; além de testar alternativas com API que já podem ser usadas.
Preços da API Muse Spark 1.2: Standard vs Contributor (2026)
A API Muse Spark 1.2 da Meta tem dois níveis: Standard, por $1.25/$4.25, e Contributor, por $0.10/$0.20 com compartilhamento de dados. Veja limites de taxa, entrada em cache, comparação com concorrentes e como escolher o nível.