💎 Pendant que beaucoup construisent des super-systèmes avec de multiples compétences et sous-agents et laissent Claude Code tourner pendant des heures, je fais l'inverse — encore plus méticuleusement.
Oui, Codex-5.3 et Opus-4.6 sont bons, mais pas encore assez bons (à mon avis. Mais vous comprendrez pourquoi je pense cela ci-dessous).
Quel est mon framework ?
Supposons que nous commençons un projet de zéro ou que nous allons implémenter une super grosse fonctionnalité.
1. Je discute longuement de l'implémentation avec GPT et Claude en parallèle, en partageant parfois des idées entre eux. Ensuite, je reste avec Claude pour qu'il me fasse des specs, et je montre chaque spec à GPT. Il trouve beaucoup d'imperfections ! Et ensemble à trois, nous peaufinons les specs.
2. Ensuite, sur la base des specs, nous créons un fichier de plan, où chaque section est détaillée au maximum par tâches, et il est précisé à quelles specs l'agent IA doit se référer. Il faut aussi mettre à jour CLAUDE.md et AGENTS.md pour la fonctionnalité/le projet. Il faut impérativement y préciser que des tests et de la documentation sont requis pour chaque module !
3. Ensuite, pour plus de commodité, Claude me crée des prompts qu'il suffit de copier-coller et d'exécuter à chaque étape.
4. Ensuite, dans des chats séparés avec Claude, nous commençons à travailler sur les specs. 1 chat = maximum 1 section. Une fois la base établie, on peut paralléliser. Pour chaque section, d'abord l'agent de codage Claude doit faire un plan, je le montre à Codex, il le valide et, en général, montre un tas de points faibles. La plupart du temps, une itération de peaufinage du plan suffit, mais parfois 2-3. Dès que Claude a terminé l'implémentation et fourni un résumé de ce qu'il a fait, je le montre à nouveau à Codex, qui trouve des faiblesses et des bugs. Ensuite, Claude les corrige. Puis /compact et on continue (ou nouveau chat).
4.5 Oui, je n'utilise pas Codex ici pour rien. Si on fait la revue de l'agent Claude séparément dans un chat séparé, ça marche aussi, mais moins bien. Et j'utilise ici codex-5.3-extra-high.
5. Après chaque section, et encore mieux, plus souvent, il faut faire une autre revue via l'agent /review. Ici, je le fais à la fois via sonnet-4.6 et via Codex-5.3-high (sans extra), et ils trouvent différentes faiblesses. On peut aussi lancer security-review dans Claude si les fonctionnalités peuvent présenter des risques de sécurité.
6. Et ainsi de suite jusqu'à ce que les specs soient terminées. On peut ensuite, par sécurité, repasser les agents dessus pour vérifier que tout est fait comme il faut.
Points supplémentaires :
— Attention, je lis, ne serait-ce qu'en diagonale, ce que les agents ont planifié ! Sinon, c'est une roulette : plus on fait cela longtemps, plus la probabilité de dévier significativement de ce que vous avez en tête est élevée. Même avec des humains, une synchronisation constante est nécessaire, alors qu'en est-il des agents.
— Il est également souhaitable de tester manuellement et de voir ce qui a été fait concrètement, sans se fier uniquement aux rapports et à la réussite des tests.
— Le framework ci-dessus peut être excessif pour un MVP à faire rapidement en 2-3 heures. Mais si vous avez du temps et des tokens, il est préférable de bien faire les choses dès le départ, car le refactoring peut ensuite être plus long et plus douloureux.
P.S. J'utilise 1code.dev
Les gars y ont à la fois Codex et Claude Code. Ils ont déjà bien peaufiné la solution, je leur ai signalé des bugs autant que possible, car c'est vraiment pratique. Plus pratique que le naïf Claude Code desktop. Seul bémol : soyez prêts à avoir 16 Go de GPU si vous voulez lancer 4 chats ou plus simultanément.
Et en plus, c'est agréable que le fondateur soit aussi un des nôtres, originaire de Russie.
Quels sont vos frameworks ou astuces ?
La vidéo ci-dessus est mise pour attirer l'attention) Elle est en lien avec la recherche d'Anthropic sur les professions qui vont bientôt disparaître)
#vibecoding
@oh_my_zen
Commentaires
0Aucun commentaire pour le moment.
Connectez-vous pour participer à la discussion.