Blog
FLUX 3 Video: o que faz e quando estará disponível
A Black Forest Labs lançou o FLUX 3, um modelo multimodal que gera vídeos com áudio nativo. Veja seus recursos e quando cada versão estará disponível.
Kimi Code vs Claude Code: o mito dos US$ 19 em 2026
Muita gente ainda trata o Kimi Code como uma cópia barata do Claude Code. Com o K3, essa conta deixou de fechar. Veja os preços verificados, um teste prático de programação, a configuração de interoperabilidade em duas linhas e qual CLI faz mais sentido usar.
9 alternativas ao Ollama que resolvem o que ele não resolve
Um guia de alternativas ao Ollama organizado por problema: tabela comparativa com suporte móvel, observações de hardware para cada ferramenta, custo de migração quase zero e situações em que uma API hospedada é melhor do que rodar modelos localmente.
Cursor Router: IA para programar 60% mais barata, mas com uma condição
Lançado em 22 de julho de 2026, o Cursor Router direciona cada solicitação de programação ao modelo capaz mais barato. Entenda como ele decide, quanto cada modo Auto custa por commit, onde o roteamento falha e quais são as alternativas no plano Pro.
Gemini 3.5 Flash-Lite: preço, velocidade e quando usar
O Gemini 3.5 Flash-Lite custa $0.30/$2.50 por 1M de tokens e entrega cerca de 415 tokens por segundo. Nos testes, foi 93% mais barato que o 3.6 Flash em tarefas simples. Veja quando vale optar pela versão mais econômica.
Gemini 3.6 Flash vs 3.1 Pro: preço, velocidade e veredito
O Gemini 3.6 Flash é mais barato, mais rápido e supera o 3.1 Pro na maioria dos benchmarks de código e agentes. O 3.1 Pro só lidera nas tarefas mais difíceis de raciocínio puro. Veja o confronto direto, com um teste prático.
API de Detecção NSFW vs Visão de LLM: Testei as Armadilhas
Comparação prática entre APIs de detecção NSFW e detectores open-source versus visão multimodal de LLM nas mesmas imagens, com preços, uma matriz de decisão e uma recomendação em camadas de construir versus comprar.
16 prompts para editor de fotos com IA (com antes e depois reais)
Uma biblioteca de prompts para editor de fotos com IA prontos para copiar e colar, organizados por tarefa, além da cláusula de bloqueio de identidade que evita alterações no rosto — tudo testado em um modelo real de edição de imagens, com resultados de antes e depois.
Preço, mudanças incompatíveis e data de lançamento do Claude Opus 5
O Claude Opus 5 chegou em 24 de julho de 2026 como claude-opus-5, mantendo o preço do Opus 4.8: contexto de 1M, novo nível máximo de esforço, thinking ativado por padrão e duas mudanças incompatíveis para revisar antes da migração.
Qwen-Image-3.0: como usar de graça e quanto ele realmente custa
Um guia prático sobre o Qwen-Image-3.0: como usá-lo gratuitamente hoje, por que ainda não existe preço oficial de API, para quem vale a pena adotar e como ele se compara ao Nano Banana Pro e ao Seedream 5.
Qwen-Audio-3.0-TTS: o modelo de TTS que lidera a Arena
Qwen-Audio-3.0-TTS é o novo modelo hospedado de texto para fala da Alibaba. A versão Plus lidera a arena independente de TTS da Artificial Analysis; este guia reúne especificações, benchmarks, preços e formas de acesso.
API gratuita do Google AI Studio: o que realmente é grátis
O Google AI Studio oferece um nível gratuito da API Gemini com uma chave real em menos de um minuto. Veja o que o termo “grátis” cobre, quais são os limites e a pegadinha do treinamento de dados à qual você deve ficar atento.
Erro de conexão upstream? Entenda o que está acontecendo
Entenda o erro de conexão upstream no ChatGPT e na API da OpenAI: o que cada motivo de reset indica, por que a falha está do lado da OpenAI e como se recuperar com status, tentativas e failover.
Kimi K3 no OpenCode: configuração e custo real por sessão
Um guia prático para usar o Kimi K3 no OpenCode: a configuração exata, os preços confirmados de $3/$15, o custo real por sessão e como evitar que o K3 consuma tokens demais.
Qwen3.8 Open Weights: data de lançamento, vazamentos e o que esperar
O Qwen3.8-Max-Preview já está disponível, mas os open weights ainda não. Confira o cronograma vazado, a ressalva dos 2,4 trilhões de parâmetros, as primeiras reações de testadores e os sinais de que os pesos realmente foram liberados.
GLM-5.3: data de lançamento, vazamentos e o que esperar
O GLM-5.3 ainda não teve lançamento oficial. O modelo mais recente da Z.ai continua sendo o GLM-5.2, de 16 de junho. Veja a cadência de lançamentos, a enquete do fundador, os canais de possíveis vazamentos e a referência atual: o GLM-5.2.
Melhor API de remoção de fundo: testei 5 na mesma imagem
Uma imagem de teste, cinco pipelines de remoção de fundo: BiRefNet vence em qualidade, a Replicate o hospeda por US$ 0,51 a cada 1.000 imagens, editores baseados em prompt falham, e os pesos gratuitos do RMBG-2.0 proíbem uso comercial.
Melhor LLM para tradução: testamos 6, e 2 custam 10x mais
Teste prático de julho de 2026 com seis LLMs em três tarefas de tradução (EN→JA marketing, EN→DE documentação e JA→EN diálogo), medindo latência, consumo de tokens, custo por tarefa e os casos em que o DeepL ainda vence.
Um prompt para um site 3D em 30 segundos (6 testados)
Seis prompts completos para sites 3D, testados de ponta a ponta: cinco páginas Three.js funcionando e uma falha instrutiva. Veja renders reais, contagem de tokens, tempos de geração e a anatomia de um bom prompt.
Os pesos abertos do Kimi K3 chegaram: 1,56 TB e quem consegue rodá-lo
O que a Moonshot de fato lançou com os pesos abertos do Kimi K3, o que a Licença Kimi K3 permite, qual é o requisito real de hardware para hospedar um MoE de 2,8T e quais provedores já o oferecem.