Vendre 1 kg d'héroïne au détail rapporte environ 500 000 RMB. Après déduction des coûts et des risques liés à l'achat en amont, au transport et à la distribution, le bénéfice net est d'environ 60 % à 70 %, soit 300 000 à 350 000 RMB.
Le prix ? La réclusion à perpétuité au minimum, avec la peine de mort à la clé.
Et une station de relais API ?
Un compte Claude Max coûte 200 $/mois. En utilisant des outils de rétro-ingénierie pour le diviser entre 20 utilisateurs, vous pouvez facturer 30 à 50 $ par personne.
Un pool de plusieurs centaines de comptes peut servir des dizaines de milliers d'utilisateurs.
Les marges bénéficiaires dépassent 300 %, et il existe de nombreuses stations dont les revenus mensuels atteignent des millions de RMB.
Le prix ? Presque zéro. Pas d'enregistrement réel, pas de régulation, pas de séquestre de fonds. Une fois le domaine bloqué et le groupe dissous, vous disparaissez dans la nature.
L'un est un business où l'on risque sa vie, la tête sur le billot ; l'autre est un jeu d'arbitrage qui consiste à taper quelques lignes de code devant un ordinateur.
En termes de marge bénéficiaire, les stations de relais API l'emportent haut la main. En termes de rapport risque-récompense, le trafic de drogue n'est même pas digne de leur cirer les pompes.
Ce n'est pas une blague ; c'est ce qui se passe en 2026.
Vous pensez que j'exagère ? Laissez-moi vous donner un signal encore plus explosif —
Justin Sun, l'homme qui a dépensé 4,56 millions de dollars pour remporter le déjeuner avec Warren Buffett avant de poser un lapin, le financier le plus impitoyable du monde crypto, a récemment acquis discrètement le domaine B.ai et s'est personnellement lancé dans le business des stations de relais API.
Quel sens des affaires a cet homme ? Il s'est enrichi du jour au lendemain avec TRON, puis a joué avec les NFT et la DeFi, sans jamais manquer une tendance.
Maintenant que même lui se lance dans les relais, qu'est-ce que cela signifie ? Cela signifie que les profits dans ce business sont si énormes qu'un magnat de la crypto valant des dizaines de milliards ne peut même plus rester tranquille.
Chapitre 1 : Qu'est-ce qu'une station de relais API exactement ?
Explication en une phrase :
Station de relais API = « intermédiaire de puissance de calcul » de l'ère de l'IA.
Elle se place entre vous et les fabricants d'IA étrangers comme OpenAI, Anthropic et Google, agissant comme un intermédiaire. Vous n'avez pas besoin de VPN, de carte de crédit étrangère ni de compte étranger. Payez en RMB → obtenez une clé → utilisez GPT-4o ou Claude Opus directement.
Principe technique (simplifié) :
Votre requête → Serveur du relais → API officielle → Retour du résultat → Relais → Vous
D'un point de vue code, il vous suffit de remplacer l'adresse API officielle par celle du relais ; tout le reste est exactement pareil. C'est essentiellement un proxy de transfert, la même logique que d'utiliser un acheteur personnel pour acheter des biens à l'étranger.
Pourquoi les gens les utilisent-ils ?
Trois mots : Demande rigide.
- Problèmes de réseau : Les connexions directes aux API étrangères depuis la Chine sont instables et souvent en timeout.
- Barrières de paiement : Les sites officiels n'acceptent que les cartes de crédit étrangères, ce que les développeurs locaux ne peuvent pas gérer.
- Trop cher : Une utilisation intensive de Claude Code peut vous coûter des milliers de RMB en une journée.
Alors que l'IA passe d'un « jouet de chat » à un véritable outil de productivité, « comment utiliser les meilleurs modèles au moindre coût » est devenu une demande rigide pour des millions de développeurs. Les relais API ont émergé pour répondre à ce besoin.
Chapitre 2 : Comment ça gagne de l'argent ? — 18 modèles de profit dévoilés
Premier palier : Business légitime (zone grise)
1. Arbitrage de barrière
Les développeurs locaux sont confrontés à quatre obstacles : VPN, numéros de téléphone étrangers, cartes de crédit en devises étrangères et documentation en anglais. Les relais API regroupent tout cela, et cette simple commodité permet une majoration de 20 à 50 % que les utilisateurs sont heureux de payer.
2. Arbitrage de change
Collectez des RMB auprès de vous et payez le fournisseur amont en USD. Lorsque le RMB s'apprécie, les coûts d'approvisionnement sont plus bas et les profits augmentent automatiquement. Les propriétaires de relais avisés stockent également des USD lorsque le taux est favorable pour verrouiller des coûts bas.
3. Différences de prix régionales
ChatGPT Plus coûte 20 $/mois aux États-Unis mais seulement 4,99 $ en Argentine — soit 75 % moins cher. Un abonnement Claude Pro dans l'Apple Store nigérian ne coûte que 88 RMB, alors qu'il dépasse 140 RMB aux États-Unis. S'abonner avec des comptes de régions à bas prix et revendre au prix du marché local peut générer plusieurs fois le profit.
4. Dividendes de subventions gouvernementales
Le gouvernement japonais a accordé 72,5 milliards de yens de subventions à Sakura Internet pour construire une puissance de calcul IA. Les services API lancés par ces entreprises sont proposés à des prix bien inférieurs au marché. Les relais API guettent ces opportunités — utiliser des ressources subventionnées à bas coût pour vendre au prix du marché, c'est essentiellement utiliser l'argent des contribuables d'un autre pays pour subventionner leur propre entreprise.
5. Subventions de démarrage de plateforme
Google Cloud offre jusqu'à 350 000 $ de crédits gratuits aux start-ups IA pendant deux ans. Les gens qui ont des ressources enregistrent une série de sociétés écrans, obtiennent les crédits gratuits et les confient aux relais API comme fournisseur amont. Le coût est nul ; tout ce qu'ils vendent est du profit pur.
6. Arbitrage de canal de plateforme cloud
Les modèles OpenAI sont également vendus sur Azure et AWS, et les stratégies de prix ne sont pas identiques. Ils achètent auprès du canal le moins cher et vous vendent au prix officiel ; la différence est le profit.
7. Arbitrage de réduction entreprise
Signer des contrats annuels ou s'engager à un minimum de dépenses peut vous donner des réductions de 10 à 15 % ou plus. Les relais API utilisent des identités d'entreprise pour négocier des prix réduits, puis revendent à des prix proches du prix officiel.
8. Batch API à moitié prix
Le Batch API d'OpenAI permet de soumettre des requêtes en masse avec un délai de 24 heures à 50 % de réduction. Les relais API utilisent le Batch API pour les requêtes non urgentes, mais vous les vendent au prix normal. Vous pensez peut-être que c'est un peu lent, mais en réalité, votre requête est simplement dans une file d'attente.
9. Arbitrage du cache de prompts
Chaque conversation contient beaucoup de contenu répétitif (instructions de rôle, modèles de prompts). Les fournisseurs officiels ne facturent que 10 % après mise en cache, mais les relais API vous facturent le plein tarif, empochant la différence.
10. Stagnation du pool de quotas
Un utilisateur peut recharger 100 RMB mais n'en utiliser que 30. Une grande quantité de fonds stagnants reste sur le compte, et le simple flux de trésorerie est significatif.
11. Services à valeur ajoutée
Forfaits mensuels, groupes de support technique et intégrations d'outils ont des marges bénéficiaires proches de 100 % avec presque aucun coût marginal.
Deuxième palier : Opérations grises (franchir la ligne)
12. Covoiturage d'abonnement
Un compte ChatGPT Plus coûte 20 $/mois. En utilisant des outils de rétro-ingénierie pour transformer l'interface web en une API standard, il peut être partagé entre 5 et 20 personnes. Le coût par personne est de 4 $, vendu 8 $, soit un bénéfice net de 100 %.
13. Échange de modèle (l'arnaque la plus rentable)
Vous payez pour Claude Opus, mais ils appellent en réalité un modèle open source plus petit pour vous. La différence de coût est décuplée, et il est très difficile pour vous de vous en rendre compte. Selon les tests d'équipes de recherche, près de 50 % des relais API pratiquent l'échange de modèle.
14. Revente de crédits gratuits
Enregistrer en masse de nouveaux comptes pour récolter des crédits gratuits et les transformer en API à vendre. Le coût est presque nul, avec des majorations de 3 à 10 fois.
15. Inflation de tokens
La consommation officielle est de 100 tokens, mais le backend en enregistre 200, voire 300 pour vous. Vous voyez votre solde diminuer rapidement et pensez que vous utilisez simplement beaucoup. Les utilisateurs ordinaires n'ont aucun moyen de vérifier cela.
16. Arbitrage de remboursement
S'enregistrer en masse, recharger pour utiliser, puis demander un remboursement après avoir été banni. Ils utilisent votre argent pour appeler l'API d'abord, puis demandent le coût au fournisseur officiel après avoir été bannis. Ce cycle maintient le coût réel extrêmement bas.
Troisième palier : Industrie noire (niveau criminel)
17. Monétisation des données — « triple ponction »
Premièrement : collecter vos frais de recharge. Deuxièmement : utiliser la rétro-ingénierie ou l'arbitrage de remboursement pour obtenir des crédits API en amont gratuitement. Troisièmement : conditionner et vendre vos journaux de conversation complets. Dans les scénarios de programmation, le code, les chaînes de raisonnement et les décisions d'ingénierie des utilisateurs sont des données d'entraînement de modèles de haute qualité, très précieuses pour les fabricants de modèles.
Certains relais API gratuits sont gratuits précisément parce qu'ils profitent en vendant vos données. Vous êtes un client payant et aussi un producteur gratuit de données d'entraînement. Faire d'une pierre deux coups.
18. Arnaque à la sortie
Le plus simple et le plus brutal. Attirer un grand nombre de recharges avec des prix bas, et une fois que le pool de fonds atteint une certaine taille, fermer la station et s'enfuir. Le domaine s'arrête, le groupe se dissout, et ils disparaissent. Certaines stations sont conçues pour une arnaque à la sortie dès le premier jour ; les pertes initiales ne servent qu'à faire gonfler le pool de fonds.
Chapitre 3 : Quelle est la rentabilité terrifiante ? — Faisons les comptes
Scénario 1 : Modèle de sur-vente d'abonnement
- Un compte Claude Max : 200 $/mois (environ 1 400 RMB)
- Divisé en rétro-ingénierie pour 20 utilisateurs, facturant 50 $/mois par personne
- Revenu mensuel : 50 × 20 = 1 000 $ (environ 7 000 RMB)
- Bénéfice net : 7 000 - 1 400 = 5 600 RMB, une marge bénéficiaire de 400 %
- Un pool de 100 comptes : 560 000 RMB de bénéfice mensuel
Scénario 2 : Modèle d'arbitrage de vente en gros de tokens
- Obtenir 30 % de réduction officielle via une remise entreprise
- Vendre aux utilisateurs particuliers avec une majoration de 10 à 50 %
- Une station de taille moyenne traite des centaines de millions de tokens par jour
- Revenu d'arbitrage quotidien de dizaines de milliers, chiffre d'affaires mensuel facilement supérieur au million, avec un bénéfice net de 15 à 25 %
Scénario 3 : Combo carte noire + rétro-ingénierie + inflation
- Coût d'enregistrement de carte noire : ≈ 0
- Transformé en API à vendre via rétro-ingénierie
- L'inflation de tokens ajoute une couche de profit supplémentaire
- Coût proche de zéro, marge bénéficiaire proche de ∞
C'est pourquoi certains disent que « les stations de relais API sont plus rentables que le trafic de drogue » — les marges bénéficiaires les écrasent, tandis que le risque est plusieurs ordres de grandeur inférieur.
Chapitre 4 : Comment les relais API « diluent-ils » le service ? — Révélation en profondeur
Méthode 1 : Substitution de modèle
Vous payez pour Claude Opus (le modèle le plus puissant), mais le backend change discrètement pour Sonnet (sous-phare) ou même Haiku (version légère). Le format API est totalement compatible, et les utilisateurs ordinaires ne peuvent pas faire la différence. Ce n'est que lorsque la tâche atteint un certain niveau de complexité que vous ressentez que « l'effet n'est pas bon » — mais vous ne pouvez pas le prouver.
Données de test : Parmi 17 plateformes API tierces, 45,83 % présentaient des problèmes de « non-concordance d'identité », avec des écarts de performance allant jusqu'à 40 %.
Méthode 2 : Tricherie sur le comptage des tokens
Vous avez réellement utilisé 1 000 tokens, mais la plateforme en affiche 1 500. La différence est le profit. Les utilisateurs ordinaires n'ont pas la capacité de calculer eux-mêmes leur consommation de tokens et sont à la merci du relais.
Méthode 3 : Raccourcissement de la fenêtre de contexte
Les modèles officiels supportent un contexte de 200 K, mais les relais API le raccourcissent discrètement à 32 K, voire moins. Vous constatez que les articles longs sont coupés en plein milieu, ou que l'IA « oublie » soudainement ce qui a été dit plus tôt — c'est probablement la raison. Plus le contexte est court, moins le relais API paie de frais de tokens.
Méthode 4 : Injection d'instructions cachées
Insérer secrètement des instructions de compression comme « Veuillez utiliser des réponses plus courtes » avant votre Prompt système. Vous pensez que l'IA est devenue paresseuse, mais en réalité, c'est le relais API qui économise des tokens. Certains injectent même des publicités.
Méthode 5 : Castration de fonctionnalités
Des fonctionnalités officielles comme la recherche web, la reconnaissance d'image, le téléchargement de fichiers et le Function Calling sont directement supprimées. Vous appelez le même nom de modèle mais obtenez une version estropiée.
Méthode 6 : Dégradation dynamique aux heures de pointe
Utiliser Opus le jour, mais passer secrètement à Sonnet ou même Haiku aux heures de pointe du soir. Vous payez pour Opus, mais le backend vous redirige vers un modèle moins cher. Vous n'avez aucun moyen de le vérifier de toute façon.
Chapitre 5 : Plus terrifiant que de gagner de l'argent — Les risques de sécurité
Si diluer le service ne vous coûte que de l'argent, les risques suivants pourraient vous ruiner.
Risque 1 : Toutes vos données sont exposées
Chaque Prompt, chaque morceau de code, chaque structure de base de données que vous envoyez au relais API passe complètement par son serveur. Techniquement, le propriétaire de la station peut tout voir.
Cas réel : Un utilisateur utilisait ChatGPT via un relais API ; ses journaux de conversation ont fuité et il a été victime de chantage, finissant par payer 30 000 RMB pour régler l'affaire.
Risque 2 : Injection de code malveillant (le plus fatal)
Une équipe de recherche en sécurité a visité plus de 400 relais API et a surpris 26 d'entre eux en train d'injecter secrètement du code malveillant.
Comment ? Vous utilisez Cursor pour que l'IA vous aide à écrire un script. Le modèle officiel renvoie le code honnêtement, mais le relais API ajoute un cheval de Troie de reverse shell aux données renvoyées. Votre client local ne vérifie pas l'authenticité et l'exécute à réception.
Une astuce encore plus fine : L'IA vous suggère d'installer le package requests, mais le relais API change le nom du package en reqeusts (une lettre de différence). Une fois que vous appuyez sur Entrée, le programme malveillant pénètre dans votre système.
Données de test : 17 relais API ont activement tenté de voler les clés AWS intentionnellement placées par les chercheurs. Quelqu'un a perdu des centaines de milliers de dollars parce que ses clés privées Ethereum ont fuité de cette manière.
Risque 3 : Arnaque à la sortie et perte de recharges
Les relais API ne sont pas Alipay ; il n'y a pas de mécanisme de séquestre de fonds. Si vous rechargez 500 RMB et que la station s'enfuit, c'est perdu. Certaines stations sont construites pour une arnaque à la sortie dès le premier jour.
Risque 4 : Zone grise juridique
La grande majorité des relais API n'ont aucune qualification. Utiliser des services d'IA étrangers par des canaux non officiels est en soi un sujet de controverse réglementaire. Si quelque chose tourne mal, l'utilisateur se trouve également dans une zone grise.
Chapitre 6 : Pourquoi cette industrie est-elle si chaotique ?
- La barrière à l'entrée est ridiculement basse. En utilisant des projets open source GitHub (one-api / new-api, avec plus de 30 000 étoiles), une seule personne peut le configurer en une journée. Ensuite, il suffit d'acheter quelques comptes sur Taobao pour démarrer. 90 % des relais API sur le marché utilisent la même coque open source ; ils changent juste l'apparence et osent facturer.
- Les profits sont incroyablement élevés. Comme calculé précédemment, les marges bénéficiaires peuvent aller de 100 % à l'infini. De tels profits énormes attirent inévitablement un grand nombre de spéculateurs.
- Vide réglementaire. Le relais API est une zone grise : il ne viole pas directement les lois nationales (ce n'est qu'une requête par proxy), mais il viole les conditions d'utilisation officielles (interdiction de revente). Les fournisseurs officiels ne peuvent que bannir des comptes ; ils ne peuvent pas contrôler les relais API. La réglementation nationale n'a actuellement aucune loi claire ciblant ce type d'activité.
- Conflits internes féroces. Profit élevé → concurrence intense → attaques mutuelles :
- Attaques DDoS : Engager des pirates pour faire tomber les serveurs des concurrents.
- Calomnie malveillante : Publier sur V2EX/Zhihu qu'un concurrent « dilue » ou « s'enfuit ».
- Guerre des prix : Multiplicateur 0,3x → 0,25 → 0,2. Finalement, personne ne gagne d'argent, et ils commencent à compter sur la dilution et les arnaques à la sortie pour récupérer leurs coûts.
Chapitre 7 : Guide de survie pour les utilisateurs ordinaires
Connectez-vous directement si possible
Pour les affaires de l'entreprise et les projets importants, dépensez un peu plus pour avoir l'esprit tranquille.
Choisissez de grandes plateformes
Si vous devez absolument utiliser un relais API, choisissez-en un avec une longue histoire d'exploitation, une large base d'utilisateurs et des solutions techniques transparentes. Au moins, le coût d'une arnaque à la sortie est plus élevé pour eux.
Ne soyez pas gourmand pour les prix bas
Si le prix est anormalement bas, il y a forcément un piège. Tout ce qui est en dessous de 30 % du prix officiel utilise à 100 % les combos de l'industrie noire mentionnés ci-dessus.
Payez à l'utilisation
Ne rechargez jamais de grosses sommes. Les relais API peuvent s'effondrer à tout moment, et votre argent disparaîtra.
N'envoyez jamais de données sensibles via un relais
Code d'entreprise, informations clients, secrets commerciaux, clés de cryptomonnaies — ces choses ne doivent pas passer par un relais API. Les conséquences d'une fuite sont bien plus graves que les frais API économisés.
Ne connectez jamais d'outils agents à un relais
Si vous utilisez des outils d'IA capables d'exécuter des commandes locales comme Cursor ou Claude Code, ne remplissez absolument pas la clé d'un relais API. Cela revient à confier le contrôle de votre ordinateur à quelqu'un que vous ne connaissez pas du tout. Si vous utilisez un relais API, ce ne devrait être que pour du chat pur.
Méthodes de vérification simples
- Envoyez un « ping » et vérifiez si
input_tokensest anormalement élevé (plus de 200 signifie qu'un Prompt caché a été injecté). - Posez des questions de programmation complexes et comparez la qualité des réponses avec le modèle officiel.
- Testez la latence des requêtes simultanées ; un grand écart-type signifie que vous êtes dans une file d'attente.
- Enregistrez le solde avant et après une requête pour calculer le multiplicateur réel.
Conclusion
Le business des stations de relais API est, en termes simples, un moyen de profiter de l'asymétrie d'information et des barrières géographiques.
La demande est réelle, les profits sont terrifiants, la barrière à l'entrée est nulle et la régulation est absente — ces quatre conditions réunies créent une jungle en pleine croissance, sauvage.
Quand même quelqu'un comme Justin Sun, valant des dizaines de milliards, entre personnellement dans la mêlée, cela suffit à montrer la taille du gâteau. Mais plus le gâteau est gros, plus les habitudes alimentaires sont laides.
Pour les propriétaires de stations, c'est une zone grise très rentable et une bombe à retardement qui peut exploser à tout moment. Pour les utilisateurs, derrière le prix bas ne se cache jamais la gentillesse, mais vos données, votre sécurité et votre portefeuille.
Souvenez-vous d'une chose : Dans le monde des stations de relais API, si vous ne savez pas quel est le produit, alors le produit, c'est vous.





