Cursor, la plateforme de codage propulsee par l'IA, a admis avoir utilise le modèle Kimi K2.5 de la société chinoise Moonshot AI dans sa fonctionnalite Composer 2, après avoir fait face a la colere des utilisateurs concernant cet usage non divulgue. L'entreprise a accede au modèle chinois via la plateforme d'inference hébergée de Fireworks AI, qui fournit un accès API a divers modèles, y compris ceux d'entreprises chinoises. Cursor n'a reconnu cette intégration qu'après que des utilisateurs ont identifie le modèle grace a des schémas d'utilisation et des réponses de l'API.
Cet incident met en evidence la complexité des chaînes d'approvisionnement dans l'outillage IA, ou les développeurs peuvent utiliser sans le savoir des modèles issus de régions géopolitiquement sensibles. Le manque de transparence de Cursor est particulièrement préoccupant compte tenu des tensions actuelles autour des modèles d'IA chinois et de la souveraineté des données. Le marche des assistants de codage est de plus en plus concurrentiel, les entreprises intégrant plusieurs fournisseurs de modèles pour ameliorer leurs capacités, mais cette approche créé des lacunes de divulgation qui peuvent prendre au depourvu les utilisateurs soucieux de la provenance des modèles.
Fireworks AI joue ici le role d'intermédiaire, offrant un accès heberge a des modèles provenant de divers fournisseurs, y compris des entreprises chinoises. Cette couche d'infrastructure masque aux utilisateurs finaux la source ultime du modèle, ce qui créé un problème de responsabilité. Bien que Fireworks fournisse une infrastructure technique legitime, cet arrangement a permis a Cursor de beneficier des capacités de l'IA chinoise tout en maintenant une distance plausible avec tout partenariat direct.
Pour les développeurs qui choisissent un assistant de codage, cela souligne la nécessité de poser des questions précises sur la provenance des modèles. Les entreprises devraient divulguer de manière proactive tous les modèles presents dans leur pile technologique, surtout lorsque les requêtes transitent par des fournisseurs d'inference tiers. L'époque du "on utilise juste de l'IA" sans autre precision est revolue : les utilisateurs meritent de savoir exactement quels modèles traitent leur code.
