💎 Enquanto muitos estão construindo super-sistemas com múltiplas habilidades e subagentes e depois deixam o Claude Code rodar por horas, eu faço o oposto — sou ainda mais meticuloso.
Sim, Codex-5.3 e Opus-4.6 são bons, mas ainda não são bons o suficiente (na minha opinião. Mas abaixo você entenderá por que penso assim)
Qual é o meu framework?
Suponha que estamos começando um projeto do zero ou vamos implementar uma funcionalidade super-grande.
1. Discuto a implementação longamente com GPT e Claude em paralelo, compartilhando ideias entre eles periodicamente. Depois fico com o Claude para ele criar as especificações, e mostro cada especificação para o GPT. Ele encontra muitas imperfeições! E juntos, nós três refinamos as especificações.
2. Em seguida, com base nas especificações, criamos um arquivo de plano, onde cada seção é detalhada ao máximo em tarefas + nelas está descrito a quais especificações o agente de IA deve se referir. Também é necessário atualizar o CLAUDE.md e o AGENTS.md para a funcionalidade/projeto. Neles, é obrigatório especificar que devem haver testes e documentação para cada módulo!
3. Depois, para conveniência, o Claude cria prompts para mim, que em cada etapa basta copiar e colar e apertar iniciar.
4. Em seguida, em chats separados com o Claude, começamos a trabalhar com as especificações. 1 chat = no máximo 1 seção. Quando a base já existe, podemos paralelizar. Para cada seção, primeiro o agente de codificação Claude deve fazer um plano, eu mostro ao Codex, ele o valida e, geralmente, mostra um monte de pontos fracos. Na maioria das vezes, basta 1 iteração de refinamento do plano, mas às vezes 2–3. Assim que o Claude termina a implementação e fornece um resumo do que fez, mostro novamente ao Codex, que encontra fraquezas e bugs. E então o Claude os corrige. Depois /compact e continuamos (ou um novo chat).
4.5 Sim, não uso o Codex aqui à toa. Se eu fizer a revisão do agente Claude em um chat separado, também funciona, mas pior. E uso aqui o codex-5.3-extra-high.
5. Após cada seção, e melhor ainda, com mais frequência, é necessário fazer outra revisão através do agente /review. Aqui eu faço tanto com sonnet-4.6 quanto com Codex-5.3-high (sem extra), e eles encontram fraquezas diferentes. Também é possível executar uma security-review no Claude, se as funcionalidades puderem representar insegurança.
6. E assim até que as especificações sejam concluídas. Depois, para garantir, podemos passar pelos agentes novamente para verificar se tudo foi feito como deveria.
Pontos adicionais:
— atenção: eu, pelo menos superficialmente, mas LEIO o que os agentes planejaram! Caso contrário, é uma roleta: quanto mais tempo você fizer isso, maior a probabilidade de um desvio significativo do que está na sua cabeça. Mesmo com pessoas, é necessária uma sincronização constante, o que dizer dos agentes.
— é desejável, novamente, testar manualmente e verificar o que foi realmente feito, não confiando apenas em relatórios e na aprovação nos testes.
— o framework acima pode ser excessivo para um MVP que precisa ser feito rapidamente em 2–3 horas. Mas se houver tempo e tokens, é melhor fazer direito desde o início, porque depois a refatoração pode ser mais longa e dolorosa.
P.S. Uso o 1code.dev
os caras têm Codex e Claude Code. Eles já refinaram bem a solução, reportei bugs como pude, porque é realmente conveniente. Mais conveniente do que o ingênuo Claude Code desktop. A única coisa: esteja preparado para ter uma GPU de 16 GB se quiser rodar 4+ chats simultaneamente.
E também é legal que o fundador é um dos nossos, da Rússia.
Quais são os seus frameworks ou truques?
Coloquei o vídeo acima para chamar a atenção) Ele é sobre a pesquisa da Anthropic sobre quais profissões desaparecerão em breve)
#vibecoding
@oh_my_zen
Comentários
0Ainda não há comentários.