everyapi
Vente · Edge
Nœuds Edge · BYO-GPUSur dossier

Votre GPU passe ses journées à ne rien faire. Dirigez-le vers la passerelle.

Faites tourner l'agent Edge open source sur une machine qui a un GPU disponible. Votre machine se connecte à EveryAPI et répond aux requêtes du marché avec une copie d'Ollama qui tourne chez vous — pas de port à ouvrir, pas d'adresse publique, pas de nom de domaine, rien à changer dans le pare-feu. Les vendeurs approuvés ajoutent un nœud depuis le tableau de bord et reçoivent un code d'installation à usage unique.

Réseau
La connexion part de chez vous
C'est votre machine qui vient vers nous. Rien chez vous n'accepte de connexion entrante.
Installation
Une seule commande d'installation
Trouve votre GPU, choisit un modèle à sa taille, et le teste avant de dire que c'est prêt
Revenus
Sur ce qui a été payé, jamais sur une estimation
Vous êtes crédité une fois la requête payée — jamais sur une estimation
Comment une requête arrive jusqu'à votre GPU

Le tunnel part vers l'extérieur, et c'est tout l'intérêt.

Les machines à la maison ou au bureau n'ont presque jamais d'adresse publique, et nous ne voulions pas vous en demander une. À la place, votre machine ouvre une connexion vers nous et la garde ouverte, comme une appli de messagerie reste connectée.

  1. 01
    Acheteur
    Envoie une requête ordinaire, dans le format que ses outils utilisent déjà.
  2. 02
    Passerelle
    Met la requête en forme et choisit un nœud qui a le modèle demandé.
  3. 03
    Votre agent
    Récupère la tâche sur la connexion qu'il a ouverte, et vérifie qu'elle fait partie des rares types de requêtes qu'il a le droit de transmettre.
  4. 04
    Ollama en local
    Tourne sur votre GPU. La réponse repart au fur et à mesure par le même chemin.

La flèche qui pointe vers votre machine, c'est la connexion que votre machine a établie. Nous ne pouvons pas entrer dans votre réseau — le nœud a seulement besoin de pouvoir joindre api.everyapi.ai, comme n'importe quel site web.

Les réponses arrivent au fur et à mesure

Votre GPU envoie les mots au fur et à mesure qu'il les produit, donc l'acheteur voit la réponse s'afficher au lieu d'attendre qu'elle soit entière. Si la connexion lâche en cours de route, la requête compte comme échouée — elle n'est pas facturée comme si elle était allée au bout.

Une conversation reste sur la même machine

Les messages suivants d'une même conversation reviennent sur le même nœud, ce qui reste rapide parce que votre machine a encore le début de l'échange en mémoire. Quand des nœuds arrivent ou s'en vont, seules les conversations qui étaient dessus sont concernées.

Plusieurs machines, une seule annonce

Vous pouvez rattacher autant de machines que vous voulez à une même annonce. Elle propose tout ce que vos machines ont, prises ensemble, donc elles n'ont pas toutes besoin des mêmes modèles.

Plus de nouvelles, et vous sortez tout seul

Votre nœud donne régulièrement de ses nouvelles. S'il s'arrête — coupure de courant, redémarrage, connexion perdue — nous le voyons, nous le marquons hors ligne, et nous cessons de lui envoyer du travail jusqu'à son retour. Personne n'a rien à faire.

De zéro à la première réponse

Une seule commande sur la machine qui a le GPU.

Ajoutez le nœud dans le tableau de bord pour obtenir un code d'installation à usage unique, puis lancez l'installateur sur la machine. Il regarde quel matériel vous avez, configure tout en conséquence, et démarre l'ensemble.

01enregistrer

Créez le nœud

Les vendeurs approuvés ajoutent un nœud Edge dans le tableau de bord et reçoivent un code d'installation, affiché une seule fois. Nous n'en gardons qu'une version brouillée, et nous effaçons même celle-là dès que votre machine s'est connectée.

02installer

Lancez l'installateur

Il regarde combien de mémoire a votre GPU et combien de place il reste sur le disque, choisit un modèle qui tient largement, le télécharge, et lui pose vraiment une question de test avant de vous dire que ça a marché. Ajoutez --model pour choisir le vôtre.

03connecter

Regardez-le passer en ligne

Votre machine crée sa propre clé privée, prouve qui elle est, et nous dit quels modèles elle a. Votre annonce reste éteinte tant qu'une machine ne s'est pas connectée avec au moins un modèle qui peut être vendu.

installation en une ligne
# Les valeurs viennent du tableau de bord quand vous créez le nœud
curl -fsSL https://dl.everyapi.ai/edge/install.sh | bash -s -- \
--node-id 42 --token edgert_...
 
# Choisissez le modèle vous-même au lieu de le laisser décider
curl -fsSL https://dl.everyapi.ai/edge/install.sh | bash -s -- \
--node-id 42 --token edgert_... --model qwen2.5:7b

Quelques précautions que prend l'installateur, pour qu'un premier essai ne vous laisse pas coincé : il refuse de tourner dans un dossier où vous gardez du code, comme ça votre code d'installation ne peut pas finir dans un endroit que vous partageriez par accident ; il garde ce code tant que nous n'avons pas confirmé la connexion, comme ça un premier essai raté peut être retenté au lieu de laisser un nœud mort ; et le relancer plus tard ne pose aucun problème.

Sur quoi ça tourne

Trois voies GPU, détectées toutes seules

L'installateur regarde ce que vous avez — NVIDIA, puis AMD, puis Apple Silicon, puis CPU — et se configure en conséquence. S'il manque quelque chose, il vous le dit et s'arrête ; il n'installe jamais rien sur votre machine sans vous demander.

nvidiaGPU NVIDIA

La configuration la plus courante, et celle par défaut. Il vous faut d'abord un pilote graphique assez récent et le NVIDIA Container Toolkit installés.

rocmAMD avec ROCm 5.7+

Fonctionne avec les cartes AMD, à condition d'avoir installé ROCm d'AMD sur la machine au préalable.

macosApple Silicon

Les Mac ne peuvent pas partager la puce graphique avec Docker, donc sur un Mac le modèle tourne directement sur la machine et seul l'agent tourne dans un conteneur.

cpuPas de GPU

Ça tournera, et les réponses seront calculées par le processeur au lieu d'une carte graphique. Bien pour essayer, et vraiment utile pour un type de travail (transformer du texte en chiffres faciles à rechercher), mais beaucoup trop lent pour que vendre du chat en vaille la peine.

Il vous faut Docker installé, avec une version à jour de Docker Compose — l'installateur comme la CLI vérifient et vous donnent un lien si ça manque, plutôt que d'installer quoi que ce soit à votre place. L'agent Edge tourne sur Linux et macOS.

Au quotidien

Après l'installation, tout tient en une seule commande

Une seule commande couvre tout ce dont un nœud en marche a besoin, et le tableau de bord affiche la même chose. Chaque nœud reste dans son coin sur la machine, donc vous pouvez en faire tourner plusieurs côte à côte.

everyapi edge status
Voir les deux points de vue en même temps

Montre ce qui se passe sur votre machine à côté de ce que nous voyons de notre côté — en ligne ou hors ligne, quand elle a donné de ses nouvelles pour la dernière fois, et quels modèles sont installés.

everyapi edge models
Gérer les modèles

Ajoutez, retirez et listez les modèles d'un nœud. Marche sans terminal ouvert, donc vous pouvez le mettre dans un script.

everyapi edge pause
Le mettre de côté

Arrête l'arrivée de nouvelles tâches, et ça tient même après un redémarrage — rien ne le remet au travail en douce. Si vous avez plusieurs machines, en mettre une en pause laisse les autres tourner.

everyapi edge logs -f
Suivre le journal

Regardez ce que fait votre nœud, en direct. Le tableau de bord affiche la même chose nœud par nœud si vous préférez éviter le terminal.

everyapi edge update
Mettre à jour quand vous voulez

Récupère la dernière version et redémarre. Rien ne se met à jour tout seul — le logiciel sur votre machine ne change que quand vous lancez cette commande.

everyapi edge remove
Partir proprement

Arrête tout, efface les fichiers qu'il a créés, et supprime le nœud sauf si vous préférez le garder dans la liste. Il vous demande confirmation avant de faire tout ça.

Panneau localIl y a aussi un petit panneau de contrôle sur 127.0.0.1:8421, qui ne s'ouvre que depuis la machine elle-même — ajoutez ou retirez des modèles, voyez à quel point elle est occupée, parcourez l'activité récente et lisez le journal, le tout sans taper de commandes.
Vous faites tourner le conteneur de quelqu'un d'autre

Alors voici exactement ce qu'il peut faire, et ce qu'il ne peut pas faire.

Rien de tout ça n'est une promesse qu'on vous demande de croire sur parole — chaque point est la façon dont le logiciel est construit, et vous pouvez lire le code vous-même.

La clé de votre machine reste sur votre machine

Au premier lancement, l'agent crée une clé privée et la verrouille pour que vous seul puissiez la lire. Si ce fichier devient un jour lisible par d'autres, l'agent refuse de démarrer plutôt que de continuer. Nous ne voyons jamais que la moitié publique.

Il ne peut transmettre qu'une poignée de types de requêtes

L'agent ne transmet que le petit ensemble de requêtes dont un modèle a besoin pour répondre, et cette limite est inscrite dans l'agent lui-même, ce n'est pas un réglage que nous contrôlons. Même si nous étions compromis, nous ne pourrions pas faire faire autre chose à votre machine.

Ce que les gens demandent n'est pas enregistré sur votre machine

L'agent n'a nulle part où le mettre — la fiche qu'il garde n'a pas de case pour la question ni pour la réponse. Il note quel modèle a été utilisé, le temps que ça a pris, la quantité traitée, et une étiquette client qui ne veut rien dire. Pas de questions, pas de réponses, pas de clés, pas d'adresses e-mail.

Le code d'installation ne marche qu'une fois

Il est affiché une seule fois, nous n'en gardons qu'une version brouillée, et nous effaçons même celle-là après la première connexion de votre machine — donc personne ne peut le réutiliser. Ensuite, votre machine s'identifie avec sa propre clé à chaque fois.

Rien ne se met à jour tout seul

Les nouvelles versions n'arrivent que quand vous les demandez. Et si vous supprimez un nœud depuis le tableau de bord, l'agent reçoit l'ordre de s'arrêter pour de bon — il s'éteint en donnant une raison claire, au lieu de réessayer indéfiniment.

Vous êtes payé sur ce qui a été réglé, pas sur une prévision

Vous n'êtes crédité qu'une fois la requête réellement payée, et chaque requête compte une seule fois. Si votre machine était hors ligne à ce moment-là, elle récupère ce qu'elle a manqué à sa prochaine connexion. Les gains vont sur votre solde vendeur, et les faire passer sur votre solde principal est une étape à part.

L'agent est open source sous Apache 2.0, et tout se trouve sur github.com/everyapi-ai/everyapi-edge — y compris tout ce qui est décrit ci-dessus.

Avant de vous lancer

Les questions à se poser d'abord

Pour tout le reste, écrivez à support@everyapi.ai — une vraie personne vous répond.

Non. Les nœuds Edge font partie du marché, et l'accès vendeur est soumis à examen. Vous déposez d'abord une demande, et nous l'examinons — depuis combien de temps vous avez le compte, comment vous vous en êtes servi, ce genre de choses, et l'opérateur peut ajuster ces critères. Ce n'est qu'après ça que vous pouvez ajouter un nœud.

Un GPU qui dort, dirigé vers quelque chose d'utile.

Demandez l'accès vendeur, enregistrez un nœud, et lancez une seule commande sur la machine. L'accès vendeur est accordé après examen de votre demande.