Pully
Stage : Petit modèle, grand cerveau : conception de harnais et alternatives ouvertes à Claude Code
- 03 octobre 2026
- 100%
- Pully
Résumé de l'emploi
Stage de 6 mois débutant en février 2027, dans un environnement dynamique.
Tâches
- Évaluer les agents de codage open-source par rapport à Claude Code.
- Concevoir un protocole de benchmark rigoureux pour les tests.
- Rédiger un rapport technique et présenter les résultats.
Compétences
- Connaissances en Python et intérêt pour les agents autonomes.
- Capacité à concevoir des expériences et analyser des données.
- Excellentes compétences en communication écrite.
Est-ce utile ?
À propos de cette offre
Date de début : février 2027 · Durée : 6 mois
Veuillez inclure vos relevés de notes académiques les plus récents avec votre candidature. Les candidatures soumises sans relevés ne seront pas prises en compte.
Les assistants de codage IA évoluent d’une simple autocomplétion vers des agents autonomes qui planifient, éditent des bases de code multi-fichiers, exécutent des tests et itèrent sur leurs propres résultats. Aux côtés d’outils propriétaires tels que Claude Code, un écosystème en pleine croissance d’agents de codage open source et de harnais (OpenCode, Pi, OMP et autres) associe des LLM ouverts à différentes stratégies d’orchestration, d’utilisation d’outils et de gestion du contexte.
Lors de ce stage de 6 mois débutant en février 2027, vous étudierez jusqu’où peuvent aller les agents open source : un petit modèle open source associé à un harnais personnalisé soigneusement réglé peut-il égaler ou surpasser un grand modèle fonctionnant derrière un harnais générique tel que Claude Code ?
Vos missions
- Configurer et évaluer les harnais de codage open source (OpenCode, Pi, OMP) face à Claude Code sur une suite partagée de tâches de codage
- Concevoir un protocole d’évaluation rigoureux : niveaux de tâches, critères de réussite et notation (précision, qualité du code, nombre de tours, coût, latence)
- Tester si de petits modèles open source avec un harnais personnalisé réglé peuvent égaler ou surpasser de grands modèles derrière un harnais générique dans des situations spécifiques
- Analyser les modes d’échec et identifier les leviers de conception de harnais les plus importants (planification, utilisation d’outils, gestion du contexte, récupération d’erreurs)
- Étendre la conception du harnais à d’autres tâches : gestion de projet, visualisation, analyse de données
- Rédiger vos conclusions dans un rapport technique, présenter les résultats et démonstrations en interne, et créer des modèles et directives réutilisables pour les agents de codage open source
Ce que nous offrons
- Un environnement de travail dynamique et collaboratif avec une équipe multiculturelle très motivée travaillant sur plusieurs sites internationaux
- La chance de faire une différence dans la vie des gens en construisant des solutions innovantes
- Des événements internes de codage tels que des hackathons et des sessions Brownbag, ainsi que notre blog technique
- Des afterworks mensuels organisés dans chaque lieu
Votre profil
- À l’aise avec Python
- Intérêt sincère pour les LLM, les agents de codage autonomes et les outils pour développeurs
- Rigoureux et curieux, à l’aise pour concevoir des expériences et interpréter des données
- Bonnes compétences en communication écrite (rapports d’évaluation, documentation interne)