Cursor, la plateforme de codage propulsee par l'IA, a admis avoir utilise le modele Kimi K2.5 de la societe chinoise Moonshot AI dans sa fonctionnalite Composer 2, apres avoir fait face a la colere des utilisateurs concernant cet usage non divulgue. L'entreprise a accede au modele chinois via la plateforme d'inference hebergee de Fireworks AI, qui fournit un acces API a divers modeles, y compris ceux d'entreprises chinoises. Cursor n'a reconnu cette integration qu'apres que des utilisateurs ont identifie le modele grace a des schemas d'utilisation et des reponses de l'API.
Cet incident met en evidence la complexite des chaines d'approvisionnement dans l'outillage IA, ou les developpeurs peuvent utiliser sans le savoir des modeles issus de regions geopolitiquement sensibles. Le manque de transparence de Cursor est particulierement preoccupant compte tenu des tensions actuelles autour des modeles d'IA chinois et de la souverainete des donnees. Le marche des assistants de codage est de plus en plus concurrentiel, les entreprises integrant plusieurs fournisseurs de modeles pour ameliorer leurs capacites, mais cette approche cree des lacunes de divulgation qui peuvent prendre au depourvu les utilisateurs soucieux de la provenance des modeles.
Fireworks AI joue ici le role d'intermediaire, offrant un acces heberge a des modeles provenant de divers fournisseurs, y compris des entreprises chinoises. Cette couche d'infrastructure masque aux utilisateurs finaux la source ultime du modele, ce qui cree un probleme de responsabilite. Bien que Fireworks fournisse une infrastructure technique legitime, cet arrangement a permis a Cursor de beneficier des capacites de l'IA chinoise tout en maintenant une distance plausible avec tout partenariat direct.
Pour les developpeurs qui choisissent un assistant de codage, cela souligne la necessite de poser des questions precises sur la provenance des modeles. Les entreprises devraient divulguer de maniere proactive tous les modeles presents dans leur pile technologique, surtout lorsque les requetes transitent par des fournisseurs d'inference tiers. L'epoque du "on utilise juste de l'IA" sans autre precision est revolue : les utilisateurs meritent de savoir exactement quels modeles traitent leur code.
