AkitaOnRails Blog
Destaques
2026-07-19— LLM Benchmark: Devo usar o que tem nota maior?2026-07-17— LLM Benchmark: Kimi K3 chegou no nível do Claude Opus?2026-07-12— Notícias Quânticas: Majorana 2 e entendendo Shor2026-07-12— Usando IA pra resolver meus probleminhas do dia-a-dia2026-07-11— Como me precaver pros meus agentes não apagarem minhas coisas?2026-07-09— LLM Benchmarks: Grok 4.5 e GPT 5.6 Sol2026-06-24— Por que LLMs vão falhar na Sua Empresa?2026-06-11— LLM Benchmark: Fable 5 e a novela da Anthropic2026-06-05— Controvérsia de IA em contribuições de projetos de código aberto - minha opinião2026-05-30— Boas práticas de projetos de código aberto com LLM - O Mínimo2026-04-25— LLM Benchmarks: Vale a Pena ($$) Misturar 2 Modelos? (Planner + Executor)2026-04-24— Benchmark de LLMs pra Coding (Maio 2026): DeepSeek v4, Kimi v2.6, Grok 4.3, GPT 5.52026-04-20— Clean Code pra Agentes de IA2026-04-11— VS Code é o novo Cartão Perfurado2026-02-24— RANT: o Akita abriu as pernas pra IA??2026-02-16— Vibe Code: Do Zero à Produção em 6 DIAS | The M.Akita Chronicles2026-02-08— RANT: IA acabou com os programadores?2025-06-18— AGI ou Skynet não vão chegar tão cedo2025-05-02— RANT - LLMs são LOOT BOXES!
LLM Benchmark: Devo usar o que tem nota maior?
Por que o primeiro lugar num ranking de LLMs não é necessariamente o melhor modelo, por que 90+ é um cluster e como usar benchmarks sem terceirizar sua decisão técnica.
LLM Benchmark: Kimi K3 chegou no nível do Claude Opus?
Coloquei o Kimi K3 para criar sozinho um chat em Rails 8: fez 89/A, superou o Opus 4.6 e foi uma alternativa mais barata ao Opus 4.8. Ainda ficou atrás dele em arquitetura, hardening e testes.
Notícias Quânticas: Majorana 2 e entendendo Shor
A Microsoft anunciou o Majorana 2 com qubits de 20 segundos e físicos respondendo que nada foi resolvido. Aproveito pra explicar direito o algoritmo de Shor, por que fatoração vira busca de período, e no que computador quântico é bom de verdade.
Usando IA pra resolver meus probleminhas do dia-a-dia
Um apanhado dos meus pequenos projetos open source: relógio de mesa com widgets, leitores de mangá, email decente, treino de digitação, karaokê de YouTube, ComfyUI em Docker e mais. Tudo nascido de probleminhas reais do meu dia-a-dia.
Como me precaver pros meus agentes não apagarem minhas coisas?
LLMs apagando arquivos de gente famosa viraram manchete essa semana. Em cinco meses de uso pesado, em YOLO mode, nunca aconteceu comigo. Mas eu também não confio: snapshots BTRFS, backups restic, sandbox e disciplina.
LLM Benchmarks: Grok 4.5 e GPT 5.6 Sol
Grok 4.5 entrou na Tier A com 87, e GPT 5.6 Sol marcou 92. O Sol venceu o GPT 5.5 por 92 a 81 no A/B cego, mas a reauditoria o levou a 85. Com o cache-read corrigido, Opus 4.8 segue o melhor equilíbrio na API.
Por que LLMs vão falhar na Sua Empresa?
A tese, assumidamente especulativa, é que LLMs amplificam processos onde pessoas terceirizam decisões. A alternativa proposta são ciclos diários de decisão, implementação, teste e revisão próximos do resultado.
LLM Benchmark: Fable 5 e a novela da Anthropic
Fable 5 marcou 94/100, praticamente empatado com o Opus 4.8, mas custa dez vezes mais e redireciona tarefas sensíveis. Como o Mythos não é auditável, fico no 4.8.
Controvérsia de IA em contribuições de projetos de código aberto - minha opinião
IA em contribuições open source veio para ficar, mesmo trazendo AI slop, regressões e falsos bugs. A saída prática é automatizar triagem e auditoria, sem tirar do humano a decisão final.
Boas práticas de projetos de código aberto com LLM - O Mínimo
Projetos open source feitos com LLM só ficam prontos com instalação simples, testes e CI confiáveis e documentação focada no problema. Padronizar releases e deploys torna a automação previsível.
LLM Benchmarks: Vale a Pena ($$) Misturar 2 Modelos? (Planner + Executor)
Três rodadas mostram que multi-agente não supera o Opus 4.7 solo no opencode, que fez 97/100 em 18 minutos por cerca de $4. GPT 5.4 xHigh com executor medium economiza, mas perde 3 pontos.
Benchmark de LLMs pra Coding (Maio 2026): DeepSeek v4, Kimi v2.6, Grok 4.3, GPT 5.5
Reauditei 24 LLMs na mesma aplicação Rails com RubyLLM: Opus 4.7 e GPT 5.4 empatam em 97, GPT 5.5 chega a 96, Kimi e Gemini viram Tier A, e DeepSeek V4 Pro só atinge Tier A via DeepClaude.
Clean Code pra Agentes de IA
Clean Code muda de peso quando o leitor primário é um agente: código pequeno, nomes greppáveis, contexto de proveniência, testes headless e regras explícitas reduzem navegação, custo e erros.
VS Code é o novo Cartão Perfurado
Na era dos agentes de código, digitar tudo manualmente no VS Code virou o equivalente moderno do cartão perfurado. O que não virou legado foi fundamento.
RANT: o Akita abriu as pernas pra IA??
Uso LLMs para programar desde 2023, mas isso não mudou minha rejeição à AGI com a tecnologia atual nem à substituição total de programadores. Para mim, elas removem tarefas mundanas quando há experiência para revisar, decidir e testar.
Vibe Code: Do Zero à Produção em 6 DIAS | The M.Akita Chronicles
Em seis dias, coloquei newsletter, blog, podcast e bot Discord em produção com 201 commits. O resultado só ficou confiável após deploy, testes, integração e refatorações, seguindo disciplina de Extreme Programming.
RANT: IA acabou com os programadores?
LLMs já ajudam a substituir trabalho braçal, mas não dispensam programadores experientes: o autor vê limites na arquitetura atual e defende revisão sênior, formação sólida e adaptação.
AGI ou Skynet não vão chegar tão cedo
Questiono previsões de AGI e alarmismo de CEOs e especialistas. O argumento central é que LLMs, com a arquitetura atual, chegaram a um limite e exigem uma nova descoberta para avançar.
RANT - LLMs são LOOT BOXES!
Depois de gastar quase USD 150 em testes, concluí que LLMs ajudam em tarefas pequenas, mas programação real continua parecendo uma loot box cara: mais tokens e agentes não garantem código correto.
2026 - Julho
- LLM Benchmark: Devo usar o que tem nota maior?
- LLM Benchmark: Kimi K3 chegou no nível do Claude Opus?
- Notícias Quânticas: Majorana 2 e entendendo Shor
- Usando IA pra resolver meus probleminhas do dia-a-dia
- Como me precaver pros meus agentes não apagarem minhas coisas?
- A Resposta sobre Bun em Rust que Andrew Kelly deveria ter feito
- LLM Benchmarks: Grok 4.5 e GPT 5.6 Sol
- Fiz o Fable 5 analisar código do TikTok, Clash of Kings e Gov.br - Entendendo Fingerprint
- Frank GO: brincando de GO com IA
- LLM Benchmark: Sonnet 5 falha, Gemini Flash surpreende, Sakana Fugu quase chega ao Tier A
- Off-Topic: Não tenha esperança com Política - Como se tornar imune
2026 - Junho
- Por que LLMs vão falhar na Sua Empresa?
- ai-memory: memória de longo prazo (Karpathy Wiki) e auto-aprendizado (Hermes) pros seus projetos
- A Controvérsia da LLM Rio 3.5. Plágio?
- ai-memory: arquitetura emergente e software maleável
- LLM Benchmark: Kimi v2.7 code, GLM 5.2, Minimax M3 local
- Burlando o bloqueio à API do GitHub no Brasil
- LLM Benchmark: Fable 5 e a novela da Anthropic
- Brincando de TUI com LLMs - Ratatui+Bubbletea
- Controvérsia de IA em contribuições de projetos de código aberto - minha opinião
- LLM Benchmarks - Atualizando sobre Grok 4.3, MiniMax v3 e Opus 4.8
2026 - Maio
- Boas práticas de projetos de código aberto com LLM - O Mínimo
- Solução Completa de Mangá: Frank Manga+, Frank Yomik, extensão Prettify-Manga
- Backup de Gmail pra Maildir em Linux
- Primeiras Impressões usando Oh-My-Pi e OpenCode
- Dicas e Toolkit de IA do Akita: ai-jail, ai-memory, ai-usagebar
- Criei um Widget de Waybar pra Omarchy pra Monitorar Uso de Planos de LLM: ai-usagebar
- Criei um CLI pra Checar Pendências no Meu GitHub: ghpending
- Criei um Sistema de Memória pra Agentes de Código: ai-memory
- Memória de Agentes IA: Karpathy LLM Wiki e agentmemory na Prática
- Terminando Minha Maratona de IA: Sucesso ou Fracasso?
- LLM Benchmarks: DeepSeek Destravado! Use DeepClaude
- NW-Omarchy: Trazendo Omarchy pro X11 com XLibre
2026 - Abril
- LLM Benchmarks: Vale a Pena ($$) Misturar 2 Modelos? (Planner + Executor)
- Benchmark de LLMs pra Coding (Maio 2026): DeepSeek v4, Kimi v2.6, Grok 4.3, GPT 5.5
- Como Driveclub e shadPS4 Quase Derrotaram a IA e a Mim: Como Aprender
- Clean Code pra Agentes de IA
- Meus Retrogames de Corrida Favoritos Rodando no Meu Distrobox
- LLM Benchmarks Parte 2: Vale Combinar Múltiplos Modelos no Mesmo Projeto? Claude + GLM??
- Omarchy no Thinkpad T14 Gen 6: Mini-Review e Setup Completo
- Por que as LLMs não te dão o resultado esperado | Por que eu prefiro Claude Code hoje
- Seedance 2.0 finalmente foi lançado: Primeiras Impressões
- Distrobox de Emulação com Claude Code
- VS Code é o novo Cartão Perfurado
- Como a ElevenLabs Não Foi Morta pelo Qwen3 TTS
- 20 Anos de Blog: Traduzindo Tudo pra Inglês
- RAG Está Morto? Contexto Longo, Grep e o Fim do Vector DB Obrigatório
- Testando LLMs Open Source e Comerciais - Quem Consegue Bater o Claude Opus?
- Transformando YouTube num App de Karaoke | Frank Karaoke
- Bitcoin no Home Server: Soberania e Privacidade com Coldcard, Sparrow e Fulcrum
- Meu Cockpit de Sim Racing - Formula FX1
2026 - Março
- O código fonte do Claude Code vazou. O que achamos dentro.
- Migrando meu Home Server com Claude Code | openSUSE MicroOS
- Review: Minisforum MS-S1 Max | AMD AI Max+ 395 com 96GB de VRAM
- Ensinando a questionar notícias | Frank Investigator
- Reescrevi o OpenClaw em Rust, funcionou? | FrankClaw
- Atacando fraudes via email | Frank FBI
- Portando 10 Mil Linhas de Python pra Crystal com Claude: easy-subtitle
- Crystal e um wrapper inteligente pro FFmpeg feito em 3 horas | easy-ffmpeg
- 37 dias de Imersão em Vibe Coding: Conclusão quanto a Modelos de Negócio
- Meu primeiro fracasso com Vibe Code e como Consertei | Frank Yomik
- Eu Fiz um Sistema de Data Mining pra Minha Namorada Influencer — Dicas e Truques
- ai-jail: Sandbox para Agentes de IA — De Shell Script a Ferramenta Real
- Software Nunca Está 'Pronto' — 4 Projetos, a Vida Pós-Deploy, e Por Que One-Shot Prompt É Mito
2026 - Fevereiro
- RANT: o Akita abriu as pernas pra IA??
- Vibe Code: Fiz um Indexador Inteligente de Imagens com IA em 2 dias | Frank Sherlock
- Vibe Code: Fiz um clone do Mega em Rails em 1 dia pro meu Home Server
- Do Zero à Pós-Produção em 1 Semana - Como usar IA em Projetos de Verdade | Bastidores do The M.Akita Chronicles
- Testes de Integração em MonoRepo | Bastidores do The M.Akita Chronicles
- SQLite + Kamal: Deploy de Rails sem Drama | Bastidores do The M.Akita Chronicles
- Discord como Admin Panel | Bastidores do The M.Akita Chronicles
- Jobs Assíncronos que sobrevivem ao Caos | Bastidores do The M.Akita Chronicles
- Frontend Sem Framework | Bastidores do The M.Akita Chronicles
- Servindo IA na Nuvem: Meu TTS pessoal | Bastidores do The M.Akita Chronicles
- Web Scrapping em 2026 | Bastidores do The M.Akita Chronicles
- Enviando Emails sem Spammar | Bastidores do The M.Akita Chronicles
- Vibe Code: Do Zero à Produção em 6 DIAS | The M.Akita Chronicles
- AI Agents: Qual seria a melhor Linguagem de Programação para LLMs?
- RANT: IA acabou com os programadores?
- Vibe Code: Fiz um Editor de Markdown do zero com Claude Code (FrankMD) PARTE 2
- Vibe Code: Fiz um Editor de Markdown do zero com Claude Code (FrankMD) PARTE 1
2026 - Janeiro
- Vibe Code: Qual LLM é a MELHOR?? Vamos falar a REAL
- Vibe Code: Eu fiz um appzinho 100% com GLM 4.7 (TV Clipboard)
- AI Agents: Qual é o melhor? OpenCode, Crush, Claude Code, GPT Codex, Copilot, Cursor, Windsurf, Antigravity?
- AI 3D: Já dá pra modelar 3D com prompts?
- AI Agents: GLM 4.7 Flash é realmente tão bom assim?
- Omarchy 3: Setup de Dual GPUs com AMD e NVIDIA
- AI Agents: Instalando LSPs pro Crush
- AI Agents: Comparando as principais LLM de 2026 no Desafio de Zig
- AI Agents: Garantindo a Proteção do seu Sistema
- Omarchy 3 - Um dos Melhores Agentes pra Programação: Crush
2025 - Novembro
2025 - Setembro
- Tudo que Precisa Saber Sobre Retro-Gaming
- Coisas que "Iniciantes" Ignoram sobre PCs
- Omarchy 2.0 - Básico de LazyVim
- Omarchy 2.0 - Indicado pra Iniciantes?
- Omarchy 2.0 - Instale com a ISO do Omarchy
- Omarchy 2.0 - Bitwarden Self-Hosted / VaultWarden
- Instalando Grafana no meu Home Server
- Meu Novo Blog - Como Eu Fiz
- Protegendo seu Home Server com Cloudflare Zero Trust
- Acessando meu Home Server com Domínio de Verdade
- Omarchy 2.0 - Entendendo SSH e Yubikeys
- Omarchy 2.0 - TUIs (Terminal User Interface Apps)
- Omarchy 2.0 - Mise pra organizar ambientes de desenvolvimento
- Omarchy 2.0 - LazyVim - LazyExtras
- Omarchy 2.0 - ZSH Configs
2025 - Agosto
- Como Contribuir no Blog do AkitaOnRails usando Docker
- Instalando Omarchy 2.0 do Zero - Anotações Pessoais
2025 - Junho
2025 - Maio
- Seu Windows pode estar Capado sem Você Saber. Cheque isto!!
- História da Computação e Retro Dev no YouTube
- Último Tentativa de Treinar uma LLM com LoRa. Tiro de canhão, mas errando a mosca.
- Ensinando Zig mais recente pra sua LLM - Treinando LoRas (quase)
- RANT - LLMs são LOOT BOXES!
- Quando LLMs não Funcionam pra Programar? Um caso de uso mais real.
- Rant - LLMs vão evoluir pra sempre? Desmistificando LLMs na programação
2025 - Abril
- Dissecando um Modelfile de Ollama - Ajustando Qwen3 pra código
- Testando o Recém Lançado LLM Open Source - Qwen3 (com Aider e Ollama)
- Destruindo a "Personalidade" do ChatGPT 4o
- Testando LLMs com Aider na RunPod - qual usar pra código?
- Seu Próprio Co-Pilot Gratuito Universal que funciona Local: AIDER-OLLAMA-QWEN
- Hello World de LLM: criando seu próprio chat de I.A. que roda local
- Acessando seu NAS usando iSCSI em vez de SMB
- Mudando roupas usando I.A. (ComfyUI)
- Usando I.A (ComfyUI) pra gerar NPCs em desenvolvimento de games
- Entendendo o Básico de ComfyUI pra gerar imagens com I.A.
- Gerando Imagens com I.A - até estilo Ghibli 😂 - com Docker e CUDA
- Gerando Videos de até 2 min a partir de uma Foto com I.A.
- Aumentando Resolução de Anime velho pra 4K com I.A.
- Colorindo Imagens Preto e Branco com I.A.
- Configurando meu NAS Synology com NFS no Linux
- NVIDIA e Wayland - Problemas pra PCI Passthrough em VMs
- Configuração da BIOS do meu PC - X670E Aorus Xtreme
2026 - Julho
11 postsLLM Benchmark: Devo usar o que tem nota maior?
Por que o primeiro lugar num ranking de LLMs não é necessariamente o melhor modelo, por que 90+ é um cluster e como usar benchmarks sem terceirizar sua decisão técnica.
LLM Benchmark: Kimi K3 chegou no nível do Claude Opus?
Coloquei o Kimi K3 para criar sozinho um chat em Rails 8: fez 89/A, superou o Opus 4.6 e foi uma alternativa mais barata ao Opus 4.8. Ainda ficou atrás dele em arquitetura, hardening e testes.
Notícias Quânticas: Majorana 2 e entendendo Shor
A Microsoft anunciou o Majorana 2 com qubits de 20 segundos e físicos respondendo que nada foi resolvido. Aproveito pra explicar direito o algoritmo de Shor, por que fatoração vira busca de período, e no que computador quântico é bom de verdade.
Usando IA pra resolver meus probleminhas do dia-a-dia
Um apanhado dos meus pequenos projetos open source: relógio de mesa com widgets, leitores de mangá, email decente, treino de digitação, karaokê de YouTube, ComfyUI em Docker e mais. Tudo nascido de probleminhas reais do meu dia-a-dia.
Como me precaver pros meus agentes não apagarem minhas coisas?
LLMs apagando arquivos de gente famosa viraram manchete essa semana. Em cinco meses de uso pesado, em YOLO mode, nunca aconteceu comigo. Mas eu também não confio: snapshots BTRFS, backups restic, sandbox e disciplina.
A Resposta sobre Bun em Rust que Andrew Kelly deveria ter feito
Usei Claude Fable 5 e GPT 5.6 Sol como árbitros para comparar Rust e Zig no rewrite do Bun. Rust ajuda a reduzir bugs de ownership e custo de manutenção, mas o método com agentes pesou tanto quanto a linguagem.
LLM Benchmarks: Grok 4.5 e GPT 5.6 Sol
Grok 4.5 entrou na Tier A com 87, e GPT 5.6 Sol marcou 92. O Sol venceu o GPT 5.5 por 92 a 81 no A/B cego, mas a reauditoria o levou a 85. Com o cache-read corrigido, Opus 4.8 segue o melhor equilíbrio na API.
Fiz o Fable 5 analisar código do TikTok, Clash of Kings e Gov.br - Entendendo Fingerprint
Uma análise estática, feita com o Fable 5, compara o fingerprint opaco do TikTok, o UUID persistente do Clash of Kings e os cuidados de privacidade do gov.br, com ressalvas sobre o método.
Frank GO: brincando de GO com IA
Criei o Frank GO como um fork do Sabaki com KataGo, reunindo mais de 4.700 tsumego, partidas históricas e 15 jogos de Hikaru no Go. Overlays tornam território e pontuação visíveis para iniciantes.
LLM Benchmark: Sonnet 5 falha, Gemini Flash surpreende, Sakana Fugu quase chega ao Tier A
No benchmark de coding, Sonnet 5 marcou 58/100 porque chamou uma API inexistente, enquanto Gemini 3.5 Flash fez 93/100. Sakana Fugu Ultra ficou em 79/100, perto do Tier A.
Off-Topic: Não tenha esperança com Política - Como se tornar imune
Defendo tratar política como risco ambiental, não como religião: eleição não é plano de vida. A estratégia proposta é ampliar renda em moeda forte, entender impostos e organizar patrimônio dentro da lei.
2026 - Junho
10 postsPor que LLMs vão falhar na Sua Empresa?
A tese, assumidamente especulativa, é que LLMs amplificam processos onde pessoas terceirizam decisões. A alternativa proposta são ciclos diários de decisão, implementação, teste e revisão próximos do resultado.
ai-memory: memória de longo prazo (Karpathy Wiki) e auto-aprendizado (Hermes) pros seus projetos
O ai-memory transforma sessões de agentes em uma wiki Markdown consultável, com hooks, MCP e handoff entre ferramentas. Um loop inspirado no Hermes promove memórias com validação, evidência e revisão opcional.
A Controvérsia da LLM Rio 3.5. Plágio?
A evidência pública indica que o checkpoint inicial da Rio 3.5 era uma mescla de Nex-N2-Pro e Qwen, sem crédito à Nex. O caso aponta falha de atribuição, não plágio jurídico.
ai-memory: arquitetura emergente e software maleável
Em 24 dias, contribuidores levaram o ai-memory de um MVP pessoal a um sistema multiplataforma e multiusuário. A arquitetura nasceu do uso e só depois foi consolidada.
LLM Benchmark: Kimi v2.7 code, GLM 5.2, Minimax M3 local
No benchmark, GLM 5.2 marcou 87 e Kimi K2.7 Code, 86. O MiniMax M3 aberto não cabe em 128 GB, enquanto programação séria ainda pede Opus 4.8 ou GPT 5.5.
Burlando o bloqueio à API do GitHub no Brasil
Testei o bloqueio da API do GitHub no Brasil: trocar DNS não resolveu no meu link, mas um wrapper SOCKS5h com Tor fez `gh` e ghpending funcionarem. É um workaround para um bloqueio opaco.
LLM Benchmark: Fable 5 e a novela da Anthropic
Fable 5 marcou 94/100, praticamente empatado com o Opus 4.8, mas custa dez vezes mais e redireciona tarefas sensíveis. Como o Mythos não é auditável, fico no 4.8.
Brincando de TUI com LLMs - Ratatui+Bubbletea
Criei o ratatui-bubbletea para dar ao Ratatui temas e componentes inspirados no Bubble Tea, usando Rust e LLMs. O toolkit já alimenta TUIs reais como o ai-usagebar sem substituir a biblioteca base.
Controvérsia de IA em contribuições de projetos de código aberto - minha opinião
IA em contribuições open source veio para ficar, mesmo trazendo AI slop, regressões e falsos bugs. A saída prática é automatizar triagem e auditoria, sem tirar do humano a decisão final.
LLM Benchmarks - Atualizando sobre Grok 4.3, MiniMax v3 e Opus 4.8
No benchmark Rails 8, Opus 4.8 mantém a liderança com 95/100, enquanto Grok 4.3 e MiniMax M3 enfim ficam usáveis, mas seguem no Tier B e atrás de GPT e Opus.
2026 - Maio
12 postsBoas práticas de projetos de código aberto com LLM - O Mínimo
Projetos open source feitos com LLM só ficam prontos com instalação simples, testes e CI confiáveis e documentação focada no problema. Padronizar releases e deploys torna a automação previsível.
Solução Completa de Mangá: Frank Manga+, Frank Yomik, extensão Prettify-Manga
Frank Manga+ leva o catálogo do MANGA Plus ao desktop, enquanto Prettify melhora a leitura em sites e Kindle e Frank Yomik acrescenta furigana ou tradução em páginas japonesas e coreanas.
Backup de Gmail pra Maildir em Linux
Troquei o backup manual do Thunderbird por mbsync em modo pull, Maildir e timer do systemd. Restic replica o acervo no NAS e off-site, deixando os e-mails locais, abertos e acessíveis por vários clientes.
Primeiras Impressões usando Oh-My-Pi e OpenCode
Oh-My-Pi é mais flexível para projetos com arquivos e artefatos variados, enquanto OpenCode é mais polido no código comum. O teste mostrou que nenhum harness audita tudo, e Codex segue atrás.
Dicas e Toolkit de IA do Akita: ai-jail, ai-memory, ai-usagebar
Depois de mais de 600 horas com agentes de código, Akita reúne ferramentas como ai-jail, ai-memory, ai-usagebar e ghpending, e defende testes, backups, refatoração e engenharia disciplinada.
Criei um Widget de Waybar pra Omarchy pra Monitorar Uso de Planos de LLM: ai-usagebar
O ai-usagebar, port do claudebar para Rust, reúne Claude, Codex, Z.AI e OpenRouter num widget Waybar ou numa TUI standalone que funciona em qualquer terminal, inclusive via SSH.
Criei um CLI pra Checar Pendências no Meu GitHub: ghpending
Akita criou o ghpending para consultar issues e PRs de vários repositórios num digest Rust, buscando tudo em paralelo e elevando o limite do GitHub de 60 para 5.000 req/h com token.
Criei um Sistema de Memória pra Agentes de Código: ai-memory
Após encontrar reindexações, perda de dados e hooks defeituosos no agentmemory, Akita criou o ai-memory em Rust, com Markdown, SQLite/FTS5, captura automática e handoff entre agentes. O projeto ainda é beta.
Memória de Agentes IA: Karpathy LLM Wiki e agentmemory na Prática
Akita compara a compaction de Claude Code, Codex e opencode, explica a LLM Wiki de Karpathy e testa o agentmemory antes de retirar a recomendação por bugs estruturais e apontar o ai-memory.
Terminando Minha Maratona de IA: Sucesso ou Fracasso?
Após mais de 500 horas em 24 repositórios, Akita ranqueia seus experimentos e conclui que Codex e Claude Code sustentam programação diária, mas sem revisão e XP a produtividade vira slop.
LLM Benchmarks: DeepSeek Destravado! Use DeepClaude
Troquei o harness do opencode pelo loop do Claude Code via DeepClaude e o DeepSeek V4 Pro subiu de 69/B para 89/A em 18 minutos e $3,14. O bug de multi-turn no controller continua.
NW-Omarchy: Trazendo Omarchy pro X11 com XLibre
Criei o NW-Omarchy como sessão X11 paralela ao Omarchy, com XLibre, bspwm e equivalentes para manter temas e mais de 70 atalhos. HDR e scaling fracionado ficam no Hyprland.
2026 - Abril
18 postsLLM Benchmarks: Vale a Pena ($$) Misturar 2 Modelos? (Planner + Executor)
Três rodadas mostram que multi-agente não supera o Opus 4.7 solo no opencode, que fez 97/100 em 18 minutos por cerca de $4. GPT 5.4 xHigh com executor medium economiza, mas perde 3 pontos.
Benchmark de LLMs pra Coding (Maio 2026): DeepSeek v4, Kimi v2.6, Grok 4.3, GPT 5.5
Reauditei 24 LLMs na mesma aplicação Rails com RubyLLM: Opus 4.7 e GPT 5.4 empatam em 97, GPT 5.5 chega a 96, Kimi e Gemini viram Tier A, e DeepSeek V4 Pro só atinge Tier A via DeepClaude.
Como Driveclub e shadPS4 Quase Derrotaram a IA e a Mim: Como Aprender
Depois de 31 fases e 44 commits, descobri que o blackout noturno do DriveClub no shadPS4 vinha do feedback GPU→CPU sem sincronização. `readbacks_mode: 2` resolveu o bug, mas a investigação ensinou o caminho.
Clean Code pra Agentes de IA
Clean Code muda de peso quando o leitor primário é um agente: código pequeno, nomes greppáveis, contexto de proveniência, testes headless e regras explícitas reduzem navegação, custo e erros.
Meus Retrogames de Corrida Favoritos Rodando no Meu Distrobox
Consolidei no Linux uma coleção de corridas clássicas em Distrobox. Driveclub roda a 30 FPS com um fork do shadPS4, e FM4 funciona no Xenia após muito ajuste.
LLM Benchmarks Parte 2: Vale Combinar Múltiplos Modelos no Mesmo Projeto? Claude + GLM??
Testei sete combinações em Claude Code, opencode e Codex, mas nenhum sub-agente foi chamado. A variância entre runs e harnesses mantém Opus sozinho como padrão para projetos greenfield.
Omarchy no Thinkpad T14 Gen 6: Mini-Review e Setup Completo
Instalei Omarchy num ThinkPad T14 Gen 6 e transformei o notebook num companion Linux para SSH, Claude Code e NAS. A tela é datada, mas portas, resistência e suporte compensam.
Por que as LLMs não te dão o resultado esperado | Por que eu prefiro Claude Code hoje
Toda semana alguém me diz 'cancelei o Claude, não performa tanto quanto o GPT'. Eu estou com 500+ horas no Claude Code e no Codex, 400 mil linhas geradas, e os dois entregam. A diferença não é o modelo. É como a pessoa está conversando com ele.
Seedance 2.0 finalmente foi lançado: Primeiras Impressões
A ByteDance liberou pro grande público hoje o Seedance 2.0, o modelo de geração de vídeo que vinha em acesso restrito há meses. Testei sync de áudio com avatar e referência de vídeo via render do Blender. Dá pra fazer coisa séria, mas o caminho até produção profissional ainda é longo, e o problema do deepfake virou inevitável.
Distrobox de Emulação com Claude Code
Criei um Distrobox Arch para 12 plataformas de emulação e Steam, organizado em 17 roles Ansible com ajuda do Claude Code. A automação torna o setup reproduzível e mantém as decisões visíveis.
VS Code é o novo Cartão Perfurado
Na era dos agentes de código, digitar tudo manualmente no VS Code virou o equivalente moderno do cartão perfurado. O que não virou legado foi fundamento.
Como a ElevenLabs Não Foi Morta pelo Qwen3 TTS
Quando o Qwen3 TTS saiu, meio mundo disse que era 'ElevenLabs killer'. Passei semanas tentando rodar o Qwen3 em produção no meu podcast. Ontem finalmente troquei pra ElevenLabs v3. Quase um dia depois, posso dizer: o open source ainda tá muito longe.
20 Anos de Blog: Traduzindo Tudo pra Inglês
Quatro dias atrás completei 20 anos de blog. E por coincidência, quando eu ia escrever esse post, resolvi fazer algo que nunca tinha tido fôlego pra fazer: traduzir todo o blog pra inglês. Com Claude Code, num fim de semana.
RAG Está Morto? Contexto Longo, Grep e o Fim do Vector DB Obrigatório
Os modelos frontier passaram dos 200k pra 1M tokens de contexto. Será que ainda faz sentido montar uma stack inteira com vector DB pra fazer RAG, quando dá pra usar grep e jogar o documento inteiro na janela?
Testando LLMs Open Source e Comerciais - Quem Consegue Bater o Claude Opus?
Este benchmark histórico comparou 33 LLMs num app Rails: Opus, Sonnet e GLM 5 funcionaram, enquanto Qwen 3.6 35B chegou perto na RTX 5090 após uma correção. Os rankings foram depois revisados.
Transformando YouTube num App de Karaoke | Frank Karaoke
Criei um app Android em Flutter que sobrepõe pontuação ao vivo a vídeos de karaokê do YouTube, usando filtro de áudio e YIN em quatro modos. É divertido, mas a avaliação ainda é experimental.
Bitcoin no Home Server: Soberania e Privacidade com Coldcard, Sparrow e Fulcrum
Montei uma stack Bitcoin doméstica com Coldcard, Sparrow, Fulcrum e bitcoind: chaves offline, consultas privadas e broadcast próprio. Dá trabalho, mas aumenta o controle sobre custódia e operação.
Meu Cockpit de Sim Racing - Formula FX1
Troquei anos de suportes instáveis por um cockpit Formula FX1 com direct drive Fanatec, PS5, RTX 4090 e OLED 4K. A estrutura não balança e fica pronta em 30 segundos para meu uso single-player.
2026 - Março
13 postsO código fonte do Claude Code vazou. O que achamos dentro.
Analisei o source map que vazou do Claude Code e encontrei features escondidas, memória em camadas, multiagentes e um DRM baseado em xxHash64. O código também expôs um produto difícil de manter.
Migrando meu Home Server com Claude Code | openSUSE MicroOS
Migrei 49 containers de Ubuntu para openSUSE MicroOS com ajuda do Claude Code, reorganizando Docker, NFS, ROCm, backups e SELinux. A automação acelerou o trabalho, mas arquitetura e validação continuaram humanas.
Review: Minisforum MS-S1 Max | AMD AI Max+ 395 com 96GB de VRAM
Nos meus testes, a RTX 5090 foi até 7 vezes mais rápida nos modelos que cabem em 32GB. O Minisforum, porém, rodou modelos de 50 a 81GB que a placa não comporta.
Ensinando a questionar notícias | Frank Investigator
Criei o Frank Investigator para comparar coberturas, rastrear fontes omitidas e analisar notícias em 15 etapas com três LLMs. O relatório aponta omissões e reenquadramentos, mas não dá veredictos finais.
Reescrevi o OpenClaw em Rust, funcionou? | FrankClaw
Reescrevi o core do OpenClaw em Rust como FrankClaw, com 56.586 linhas, 7 canais e correções para as 7 vulnerabilidades críticas auditadas. Ele lida com conversas simples, mas workflows complexos ainda não foram testados.
Atacando fraudes via email | Frank FBI
Construí o Frank FBI para analisar emails encaminhados em seis camadas, combinando autenticação, reputação, OSINT e três LLMs. O resultado é um relatório de risco self-hosted, com os dados sob seu controle.
Portando 10 Mil Linhas de Python pra Crystal com Claude: easy-subtitle
Pedi ao Claude um port feature-parity do Subservient para Crystal e obtive o easy-subtitle em menos de 40 minutos: 2.516 linhas, 76 testes e um binário estático de 6 MB, sem runtime Python.
Crystal e um wrapper inteligente pro FFmpeg feito em 3 horas | easy-ffmpeg
Eu queria converter vídeos sem decorar flags do FFmpeg. Saiu uma CLI inteligente em Crystal com presets, modo interativo e compilação estática pra Linux e macOS, em 3 horas de vibe coding.
37 dias de Imersão em Vibe Coding: Conclusão quanto a Modelos de Negócio
Depois de 37 dias, 650+ commits, ~144K linhas de código e quase 10 projetos publicados, minha conclusão sobre o que vibe coding significa para o futuro de startups e modelos de negócio.
Meu primeiro fracasso com Vibe Code e como Consertei | Frank Yomik
Como eu gastei dias construindo um sistema de detecção de balões de mangá com OpenCV, joguei tudo fora e reconstruí em horas com um modelo pré-treinado. Lições sobre vibe coding, fracasso produtivo e saber quando mudar de direção.
Eu Fiz um Sistema de Data Mining pra Minha Namorada Influencer — Dicas e Truques
Em três dias, construí um sistema Rails que coleta dados de redes sociais, eventos e concorrentes e os transforma em consultas num bot Discord. A influencer recebe cinco digests diários em português, baseados em dados reais.
ai-jail: Sandbox para Agentes de IA — De Shell Script a Ferramenta Real
Transformei um script Bash de bubblewrap no ai-jail, uma ferramenta Rust com configuração TOML por projeto, lockdown e bootstrap de permissões. Ela cobre Linux e macOS, mas a paridade entre plataformas é aproximada.
Software Nunca Está 'Pronto' — 4 Projetos, a Vida Pós-Deploy, e Por Que One-Shot Prompt É Mito
Depois de 125 commits pós-publicação em quatro projetos, bugs reais, novas features, releases e contribuições externas reforçaram minha conclusão: one-shot serve para demo. Produção exige iteração, testes, CI e decisões humanas.
2026 - Fevereiro
17 postsRANT: o Akita abriu as pernas pra IA??
Uso LLMs para programar desde 2023, mas isso não mudou minha rejeição à AGI com a tecnologia atual nem à substituição total de programadores. Para mim, elas removem tarefas mundanas quando há experiência para revisar, decidir e testar.
Vibe Code: Fiz um Indexador Inteligente de Imagens com IA em 2 dias | Frank Sherlock
Em 48 horas, criei o Frank Sherlock, um catálogo local de imagens com Rust, Tauri, Ollama e OCR, publicado em beta para três sistemas. O benchmark favoreceu o qwen2.5vl:7b.
Vibe Code: Fiz um clone do Mega em Rails em 1 dia pro meu Home Server
Em três horas, construí o FrankMega, um clone self-hosted do Mega em Rails 8, SQLite e Docker. A iteração corrigiu 22 falhas de segurança e fechou com 210 testes e deploy via Cloudflare Tunnel.
Do Zero à Pós-Produção em 1 Semana - Como usar IA em Projetos de Verdade | Bastidores do The M.Akita Chronicles
Em oito dias, coloquei newsletter, podcast, blog e bot Discord em produção com 274 commits e 1.323 testes. Comparado ao FrankMD, XP, TDD, CI e refatoração contínua entregaram mais com menos dívida.
Testes de Integração em MonoRepo | Bastidores do The M.Akita Chronicles
Testes unitários não bastavam para três apps que compartilham Markdown. Um ambiente de integração com cache, dados reais via rsync, pipeline paralelo e preflight encontrou bugs que mocks escondiam.
SQLite + Kamal: Deploy de Rails sem Drama | Bastidores do The M.Akita Chronicles
Rails 8, SQLite, SolidQueue, SolidCache e Kamal colocaram uma aplicação completa num VPS de US$12 por mês. Volumes, VACUUM INTO, SSL automático e deploy sem downtime simplificaram a operação.
Discord como Admin Panel | Bastidores do The M.Akita Chronicles
Um bot Discord substituiu o admin web para curadoria, jobs, custos e perguntas à IA. Parser, dispatcher, jobs e notificações mantêm a operação solo produtiva, desde que erros nunca sejam silenciados.
Jobs Assíncronos que sobrevivem ao Caos | Bastidores do The M.Akita Chronicles
Jobs Rails 8 precisam sobreviver a crashes, retries e concorrência. Locks com TTL, claiming atômico, estados ambíguos, crons de segurança e notificações fazem o processamento continuar sem duplicar emails.
Frontend Sem Framework | Bastidores do The M.Akita Chronicles
Sem framework JavaScript, combinei Tailwind v4, Hugo, ERB e CSS inline para servir web, blog, RSS e emails. O resultado cobre dark mode, acessibilidade e compatibilidade com clientes como Outlook 2016.
Servindo IA na Nuvem: Meu TTS pessoal | Bastidores do The M.Akita Chronicles
Coloquei Qwen3-TTS numa GPU serverless da RunPod para gerar podcasts semanais de 30 minutos. Cold starts, volumes, sampling, referências de voz, loudness e prompts em duas passadas definiram a qualidade.
Web Scrapping em 2026 | Bastidores do The M.Akita Chronicles
O scraping saiu de Net::HTTP e chegou ao Chromium com Ferrum e stealth patches para SPAs e sites protegidos. A regra final foi browser-first quando necessário, mantendo APIs e RSS como opções melhores.
Enviando Emails sem Spammar | Bastidores do The M.Akita Chronicles
Um pipeline de emails com SES evita duplicatas distinguindo rejeições de estados ambíguos: claiming atômico, estados terminais e status unknown. DKIM, SPF, DMARC, List-Unsubscribe e suppression list fecham o circuito.
Vibe Code: Do Zero à Produção em 6 DIAS | The M.Akita Chronicles
Em seis dias, coloquei newsletter, blog, podcast e bot Discord em produção com 201 commits. O resultado só ficou confiável após deploy, testes, integração e refatorações, seguindo disciplina de Extreme Programming.
AI Agents: Qual seria a melhor Linguagem de Programação para LLMs?
Claude e GPT imaginaram uma linguagem mais adequada a LLMs, com AST tipada, efeitos e proveniência. A partir da ideia, Claude gerou em Rust o protótipo PACT, ainda não testado.
RANT: IA acabou com os programadores?
LLMs já ajudam a substituir trabalho braçal, mas não dispensam programadores experientes: o autor vê limites na arquitetura atual e defende revisão sênior, formação sólida e adaptação.
Vibe Code: Fiz um Editor de Markdown do zero com Claude Code (FrankMD) PARTE 2
Em cerca de 30 horas, transformei um protótipo Rails no FrankMD, com i18n, testes e CodeMirror. O resultado foi 6 a 7 vezes mais rápido, mas exigiu refatoração e supervisão constantes.
Vibe Code: Fiz um Editor de Markdown do zero com Claude Code (FrankMD) PARTE 1
Criei o FrankMD, um editor Markdown self-hosted em Rails 8 para meu workflow de blog, com preview, uploads, Hugo, temas e revisão por IA. Em três dias, chegou perto do ideal para meu uso.
2026 - Janeiro
10 postsVibe Code: Qual LLM é a MELHOR?? Vamos falar a REAL
Submeti o mesmo app a análises de Opus, GPT 5.2 Codex, Kimi, Gemini e MiniMax. Cada modelo encontrou problemas diferentes, mas nenhum eliminou a necessidade de revisão humana.
Vibe Code: Eu fiz um appzinho 100% com GLM 4.7 (TV Clipboard)
Usei o GLM 4.7 para criar o TV Clipboard, um app Go com WebSockets, QR Code e clipboard remoto. Após mais de 10 horas e 250 prompts, ainda precisei revisar segurança, testes e manutenção.
AI Agents: Qual é o melhor? OpenCode, Crush, Claude Code, GPT Codex, Copilot, Cursor, Windsurf, Antigravity?
Comparei agentes como Crush, OpenCode, Claude Code e Codex e concluí que os harnesses proprietários ainda influenciam o resultado. Mesmo assim, continuo preferindo o Crush e uso Claude Code pontualmente.
AI 3D: Já dá pra modelar 3D com prompts?
A partir de ilustrações limpas e vistas consistentes geradas pelo Nano Banana, criei um modelo 3D no Hunyuan, ajustei-o no Blender e consegui uma impressão surpreendentemente boa na Bambulab X1C.
AI Agents: GLM 4.7 Flash é realmente tão bom assim?
Rodei o GLM 4.7 Flash localmente numa RTX 5090 e ele foi o único modelo open source a compilar o desafio de Zig. O comportamento foi bom, mas ampliar o contexto o deixou até 20 vezes mais lento.
Omarchy 3: Setup de Dual GPUs com AMD e NVIDIA
Descrição do post aqui
AI Agents: Instalando LSPs pro Crush
Documentei meu Crush com Claude, Ollama e LM Studio e criei um script para Arch Linux que usa o Mise para detectar linguagens e instalar automaticamente os LSPs correspondentes.
AI Agents: Comparando as principais LLM de 2026 no Desafio de Zig
Testei LLMs comerciais e open source numa migração difícil de Zig 0.15 com llama.cpp. Só as comerciais concluíram, e Claude Opus venceu por resolver tudo mais rápido e com menos insistência.
AI Agents: Garantindo a Proteção do seu Sistema
Mostro como isolar agentes de programação com Bubblewrap: o jail deixa apenas o projeto gravável, oculta o restante do sistema e monta só os diretórios necessários, reduzindo riscos de comandos destrutivos.
Omarchy 3 - Um dos Melhores Agentes pra Programação: Crush
Usei o Crush com Claude Opus 4.5 num blog Hugo e num chat em Zig com llama.cpp, CUDA e Qwen3. Ele refatorou scripts, atualizou APIs, corrigiu um segmentation fault e entregou um binário funcional por quase US$ 8.
2025 - Novembro
1 postOmarchy - Não entrar em Sleep enquanto Copia
Um script consulta o uso de I/O com iostat e usa systemd-inhibit para impedir que o Hypridle suspenda o Arch durante cópias longas, como transferências do NAS para um cartão microSD.
2025 - Setembro
15 postsTudo que Precisa Saber Sobre Retro-Gaming
Reuni minhas impressões sobre handhelds Linux, Android, FPGA e PC, de Miyoo Mini Plus a Analog Pocket e ROG Ally X, além de emuladores e front-ends. A melhor escolha depende do uso e do orçamento.
Coisas que "Iniciantes" Ignoram sobre PCs
Expliquei como CPU, placa-mãe, RAM, GPU, armazenamento, USB, fonte e refrigeração afetam um PC. A recomendação final é aprender os componentes e comprar o melhor computador que seu orçamento permitir.
Omarchy 2.0 - Básico de LazyVim
Um guia direto de LazyVim para quem vem do VS Code: buffers, modos, navegação com hjkl, comandos combinados, blocos verticais e busca e substituição formam o mínimo para começar no NeoVim.
Omarchy 2.0 - Indicado pra Iniciantes?
Omarchy é meu Linux diário, mas não existe uma distro universal para iniciantes. Como o hardware muda tudo, mostro como testar ISOs com Ventoy e ambientes de desenvolvimento com Distrobox antes de escolher.
Omarchy 2.0 - Instale com a ISO do Omarchy
A ISO oficial do Omarchy instala Arch, Hyprland e UWSM em poucos minutos, com LUKS, Limine e Snapper já preparados para login automático e rollback. Depois de testar o caminho manual, eu escolheria a ISO.
Omarchy 2.0 - Bitwarden Self-Hosted / VaultWarden
Instalei o VaultWarden no home server com Docker Compose, publiquei o acesso por túnel Cloudflare, migrei o cofre do Bitwarden e deixei o 2FA da conta principal no Aegis antes de apagar a conta na nuvem.
Instalando Grafana no meu Home Server
Montei Grafana, Prometheus e cAdvisor com Docker Compose para acompanhar o Intel NUC por dashboards. Os IDs 1860, 13484 e 3662 cobrem métricas do sistema, containers e saúde geral sem pesar no servidor.
Meu Novo Blog - Como Eu Fiz
Migrei o blog de Rails para Hugo com tema Hextra, Markdown, GitHub Actions e deploy gratuito na Netlify. Também automatizei o envio de screenshots ao S3 pelo Nautilus e deixei a manutenção bem mais simples.
Protegendo seu Home Server com Cloudflare Zero Trust
Protegi meus serviços do home server com Cloudflare Zero Trust e login via Google OAuth. Agora o acesso passa por uma autenticação extra, com sessão compartilhada por 24 horas.
Acessando meu Home Server com Domínio de Verdade
Configurei domínio próprio, HTTPS e Cloudflare Tunnels para acessar containers Docker remotamente sem abrir portas no roteador. Também criei uma ponte para o Plex, isolado em outra VLAN.
Omarchy 2.0 - Entendendo SSH e Yubikeys
Mostro como criar chaves SSH ED25519, usar uma Yubikey 5 com PIV ou FIDO2 e desativar login por senha. Para chaves locais, configuro o ssh-agent com cache de 30 minutos.
Omarchy 2.0 - TUIs (Terminal User Interface Apps)
Defendo TUIs como alternativas leves a GUIs e webapps Electron e apresento ferramentas como LazyDocker, dblab, Posting, gdu e sc-im. No Omarchy, elas também podem ser lançadas como apps.
Omarchy 2.0 - Mise pra organizar ambientes de desenvolvimento
Uso Mise para fixar versões de Ruby, Node e outras linguagens por projeto, evitando que atualizações do sistema quebrem o ambiente. Para bancos de dados, separo as versões com Docker Compose.
Omarchy 2.0 - LazyVim - LazyExtras
Apresento os atalhos básicos do LazyVim, como buffers, busca de arquivos e NeoTree. Com :LazyExtras, habilito suporte às linguagens com LSP, linters, snippets e syntax highlighting.
Omarchy 2.0 - ZSH Configs
Troquei o Bash do Omarchy por ZSH e organizei aliases, variáveis secretas, Atuin, Starship e SGPT. O resultado é um shell ajustado ao meu workflow, com histórico sincronizado e busca no terminal.
2025 - Agosto
2 postsComo Contribuir no Blog do AkitaOnRails usando Docker
Mostro como contribuir com o blog usando apenas Docker e Docker Compose, sem instalar Hugo, Go ou Ruby localmente. Scripts criam posts e volumes permitem hot reload durante a edição.
Instalando Omarchy 2.0 do Zero - Anotações Pessoais
Reinstalei meu desktop com Arch Linux e Omarchy, separando o HOME, configurando BTRFS, Timeshift e NFS para o NAS. Depois dos backups, cerca de 95% do setup já estava pronto.
2025 - Junho
1 postAGI ou Skynet não vão chegar tão cedo
Questiono previsões de AGI e alarmismo de CEOs e especialistas. O argumento central é que LLMs, com a arquitetura atual, chegaram a um limite e exigem uma nova descoberta para avançar.
2025 - Maio
7 postsSeu Windows pode estar Capado sem Você Saber. Cheque isto!!
Descobri que o Windows recém-instalado estava em Power Saver e limitava meu Core i7 a 0,5 GHz, causando travamentos. Ao mudar para Ultimate Performance, a CPU voltou a passar de 4 GHz.
História da Computação e Retro Dev no YouTube
Reuni canais e playlists que acompanho sobre história da computação, hardware antigo, emulação, desenvolvimento de jogos e programação, com recomendações como Ben Eater, javidx9 e 3Blue1Brown.
Último Tentativa de Treinar uma LLM com LoRa. Tiro de canhão, mas errando a mosca.
Aluguei uma H100 para treinar Qwen3-32B com LoRA, mas o modelo consumiu quase toda a VRAM, ficou lento e, no fim, não conseguiu gerar código utilizável.
Ensinando Zig mais recente pra sua LLM - Treinando LoRas (quase)
Treinei um LoRA para levar Zig 0.14 ao Qwen3-8B. O modelo passou a responder que conhecia a versão nova, mas continuou inventando detalhes e errando código, num semi-sucesso.
RANT - LLMs são LOOT BOXES!
Depois de gastar quase USD 150 em testes, concluí que LLMs ajudam em tarefas pequenas, mas programação real continua parecendo uma loot box cara: mais tokens e agentes não garantem código correto.
Quando LLMs não Funcionam pra Programar? Um caso de uso mais real.
Tentei criar um chat em Zig com llama.cpp, CUDA e Qwen3 usando o Gemini 2.5 Pro. Ele resolveu scripts comuns, mas travou na API C++ e consumiu mais de USD 50 em tentativas.
Rant - LLMs vão evoluir pra sempre? Desmistificando LLMs na programação
Após testar Claude, Gemini, Qwen e outros em refatorações reais, questiono benchmarks, evolução exponencial e Vibe Coding. LLMs ajudam, mas ainda dependem de programadores atentos para revisar e corrigir.
2025 - Abril
17 postsDissecando um Modelfile de Ollama - Ajustando Qwen3 pra código
Expliquei como temperature, top_p, top_k, min_p e repeat_penalty mudam a geração de tokens e criei um Modelfile para o Qwen3. Com temperatura baixa, o 14B gerou código rápido e utilizável.
Testando o Recém Lançado LLM Open Source - Qwen3 (com Aider e Ollama)
Testei o Qwen3 com Aider, localmente e via OpenRouter, em refatorações e testes. O 14B foi muito mais rápido e competente que o Qwen2.5, embora o Gemini ainda tenha levado vantagem.
Destruindo a "Personalidade" do ChatGPT 4o
Mostrei como configurar o ChatGPT 4o para abandonar elogios, conversa fiada e trejeitos pseudo-humanos. Com as instruções certas, ele passa a responder de forma curta, direta e sem fingir consciência.
Testando LLMs com Aider na RunPod - qual usar pra código?
Comparei modelos de código com Aider na RTX 4090, A40 e H100. O Qwen2.5-Coder 32B foi lento e frustrante, enquanto o 7B se saiu melhor, mas Claude e Gemini venceram.
Seu Próprio Co-Pilot Gratuito Universal que funciona Local: AIDER-OLLAMA-QWEN
Configurei o Aider com APIs comerciais e Ollama, mostrando watch-files, modo arquiteto e prompts. O fluxo local funciona bem para mudanças pequenas, desde que alguém revise tudo e evite commits automáticos.
Hello World de LLM: criando seu próprio chat de I.A. que roda local
Construí o Tiny Qwen CLI para explicar, na prática, como um LLM tokeniza contexto, gera o próximo token e usa parsers e scripts externos para ler arquivos e buscar páginas, formando agentes.
Acessando seu NAS usando iSCSI em vez de SMB
Mover o Docker para NFS deixou os builds lentos por causa das chamadas RPC arquivo a arquivo. Com um disco iSCSI em bloco no Synology, os comandos caíram de centenas de segundos para menos de um.
Mudando roupas usando I.A. (ComfyUI)
Montei um workflow ComfyUI com IDM-VTON e IPAdapter para trocar roupas mantendo rosto e pose. Funciona melhor com peças parecidas, mas exige mais de 20 GB de VRAM e ainda tem glitches.
Usando I.A (ComfyUI) pra gerar NPCs em desenvolvimento de games
Testei o workflow pago de Mickmumpitz no meu setup Docker: uma RTX 4090 leva cerca de 30 minutos para gerar character sheets coerentes, com 500 GB de espaço e ajustes manuais.
Entendendo o Básico de ComfyUI pra gerar imagens com I.A.
Explico os principais componentes do ComfyUI usando um workflow que transforma uma foto em anime. Modelos, mapas e parâmetros mudam bastante o resultado, então é preciso experimentar.
Gerando Imagens com I.A - até estilo Ghibli 😂 - com Docker e CUDA
Empacotei o ComfyUI em Docker Compose, com CUDA, downloads automáticos e extensões persistentes. O ambiente fica isolado e portátil, mas manter dependências Python continua trabalhoso.
Gerando Videos de até 2 min a partir de uma Foto com I.A.
Rodei o FramePack com HunyuanVideo em Docker para animar fotos de action figures e desenhos. Ele promete vídeos de até dois minutos, mas movimentos curtos de 5 a 10 segundos são mais práticos.
Aumentando Resolução de Anime velho pra 4K com I.A.
Usei Video2X com Real-ESRGAN em Docker CUDA para levar anime antigo de DVD a 4K, a cerca de 13 fps. O modelo 6B foi quatro vezes mais lento sem melhorar claramente o resultado.
Colorindo Imagens Preto e Branco com I.A.
Coloquei o DDColor em Docker e colorizei uma foto preto e branco em cerca de um segundo. A transferência de Reinhard usa uma referência para mudar a paleta geral, não objetos específicos.
Configurando meu NAS Synology com NFS no Linux
Troquei SMB por NFS no Synology para recuperar ownership, chmod e permissões nativas no Linux. Ajustar UID/GID para 1000 e corrigir terabytes com chown levou horas, mas resolveu o problema.
NVIDIA e Wayland - Problemas pra PCI Passthrough em VMs
No GNOME com Wayland, a RTX 4090 fica presa ao descarregar o driver para PCI passthrough. A solução foi matar o GDM por outro TTY e automatizar a troca com scripts.
Configuração da BIOS do meu PC - X670E Aorus Xtreme
Registrei os ajustes da BIOS da minha X670E Aorus Xtreme com Ryzen 9 7950X3D: PBO 90 Level 2 estável, EXPO ativo, C-States desabilitados, kernel Zen e checagem semanal de BIOS.