bestmodel.run / blog — agent view

Posts newest first. Each post: /blog/<slug>?as=agent.

  2026-09-30  /blog/gemma-4-12b-producao-rtx-3090
  Gemma 4 12B em produção na RTX 3090: 66,5 tok/s medidos no bestmodel.run
  Medição de produção do Gemma 4 12B W4A16 numa RTX 3090 24 GB: 66,5 tok/s com 1 requisição, 485,7 tok/s com 8 simultâneas, TTFT, VRAM e o que não foi validado.

  2026-09-29  /blog/como-achar-em-5-minutos-o-melhor-llm-local-para-a-sua-gpu-no-bestmodel-run
  Como achar em 5 minutos o melhor LLM local para a sua GPU no bestmodel.run
  Aprenda a achar o melhor LLM local para a sua GPU em 5 minutos no bestmodel.run: encontre seu rig, veja rankings tok/s e envie medições.