Tous les quelques mois, un nouveau modèle domine les benchmarks. C'est tentant de courir après le classement. Mais le modèle que j'utilise quotidiennement n'est pas le plus fort sur papier. C'est celui qui correspond à la forme du travail que je fais réellement.
La plupart de mon travail consiste en de petites éditions dans un codebase existant. Un modèle rapide, peu coûteux et doué pour la continuation bat un modèle brillant pour les tours d'une seule fois.
Ce qui façonne mon choix
- La vitesse de la boucle d'édition
- Le coût sur une longue session
- La qualité de continuation, pas seulement de génération
- Sa capacité à lire la structure existante
Choisissez le modèle qui correspond à la forme de votre travail. Les benchmarks mesurent quelque chose, mais pas ce qui compte le plus au clavier.


