あなたの GPU は一日のほとんど遊んでいます。 その GPU を、ゲートウェイにつなぎましょう。
GPU が空いているマシンで、オープンソースの Edge エージェントを動かします。あなたのマシンのほうから EveryAPI につなぎに行き、手元で動く Ollama を使って、マーケットプレイスのリクエストに答えます——ポート開放も、グローバル IP も、ドメインも、ファイアウォールの設定変更もいりません。販売者として承認されると、ダッシュボードからノードを追加して、一度きりのセットアップコードを受け取れます。
つなぎに行くのはあなたのマシンのほう。そこが肝心なところです。
家や職場のマシンにグローバル IP があることは、まずありません。そのために何かを用意してくださいとも言いたくありませんでした。代わりに、あなたのマシンのほうからこちらへ接続を開いて、そのままつなぎっぱなしにします。チャットアプリがつながり続けているのと同じやり方です。
- 01購入者いつも使っているツールの形式のまま、ふつうにリクエストを送ります。
- 02ゲートウェイリクエストを整えて、指定されたモデルを持っているノードを選びます。
- 03あなたのエージェント自分で開いた接続から仕事を受け取り、渡してよい数少ない種類のリクエストかどうかを確かめます。
- 04手元の Ollamaあなたの GPU で動きます。答えは、来た道をそのまま戻っていきます。
あなたのマシンに向かっている矢印は、あなたのマシン自身が作った接続です。こちらからあなたのネットワークに入っていくことはできません。ノードに必要なのは、ふつうのウェブサイトを開くのと同じように api.everyapi.ai につながることだけです。
あなたの GPU は、言葉を作ったそばから送り出します。だから購入者は、全部そろうのを待たずに、答えが現れていくのを見られます。途中で接続が切れた場合、そのリクエストは失敗として数えます——最後まで終わったことにして課金することはありません。
同じ会話の続きのメッセージは、同じノードに戻ってきます。あなたのマシンには前のやり取りが読み込まれたままなので、そのぶん速く応えられます。ノードが増えたり抜けたりしても、影響を受けるのは、そのノードにあった会話だけです。
ひとつの出品には、何台でもマシンを紐づけられます。出品に並ぶのは、あなたのマシン全体が持っているモデルをまとめたものなので、全部のマシンに同じモデルを入れておく必要はありません。
ノードは定期的に「動いています」と知らせてきます。それが止まれば——停電、再起動、接続が切れた——こちらで気づいてオフラインにし、戻ってくるまで仕事を送るのをやめます。誰かが何かをする必要はありません。
コマンドはひとつ。GPU を積んだマシンで実行するだけです。
ダッシュボードでノードを追加して、一度きりのセットアップコードを受け取り、そのマシンでインストーラーを実行します。インストーラーが、どんなハードウェアかを調べ、それに合わせて一式を用意し、起動します。
ノードを作る
承認された販売者は、ダッシュボードでエッジノードを追加し、セットアップコードを受け取ります。表示は一度きりです。こちらが保存するのは、そのコードを元に戻せない形にしたものだけで、あなたのマシンがつながった時点で、それすら消します。
インストーラーを実行する
GPU のメモリと、空いているディスクの量を調べ、余裕をもって収まるモデルを選んでダウンロードします。そのうえで実際に試しの質問を通してみて、うまくいってから「成功しました」と伝えます。自分でモデルを選びたいときは --model を付けてください。
オンラインになるのを見届ける
あなたのマシンが自分だけの鍵を作り、自分が本人であることを示して、持っているモデルを伝えます。出品は、売れるモデルをひとつ以上持ったマシンがつながるまで、オフのままです。
# 値は、ノードを作ったときにダッシュボードに表示されますcurl -fsSL https://dl.everyapi.ai/edge/install.sh | bash -s -- \ --node-id 42 --token edgert_... # 自動で選ばせずに、モデルを自分で指定するcurl -fsSL https://dl.everyapi.ai/edge/install.sh | bash -s -- \ --node-id 42 --token edgert_... --model qwen2.5:7b最初の一回で詰まらないように、インストーラーはいくつか手を打っています。プログラムのソースを置いているフォルダの中では動きません——セットアップコードが、うっかり人に共有してしまう場所に紛れ込まないようにするためです。そのコードは、接続が確認できるまで手元に残しておくので、一度失敗しても、使えないノードが残るのではなく、やり直せます。あとからもう一度実行しても大丈夫です。
GPU は 3 通り、自動で見分けます
インストーラーが、あなたのマシンに何が載っているかを調べます——NVIDIA、次に AMD、次に Apple Silicon、最後に CPU——そして、それに合わせて自分で設定します。足りないものがあれば、そう伝えて止まります。断りなく、あなたのマシンに何かを入れることはありません。
いちばん多い構成で、これが初期設定です。ある程度新しいグラフィックドライバーと、NVIDIA の Container Toolkit を先に入れておいてください。
AMD のカードで動きます。ただし、AMD の ROCm を先にマシンへ入れておく必要があります。
Mac は Docker にグラフィックチップを渡せません。そのため Mac では、モデルをマシン上で直接動かし、コンテナで動くのはエージェントだけになります。
グラフィックカードの代わりに CPU が答えを作ります。試してみるぶんには十分ですし、ある種類の仕事(文章を検索しやすい数字に変える作業)では本当に役に立ちます。ただしチャットを売り物にするには、遅すぎて実用になりません。
Docker と、新しめの Docker Compose が入っている必要があります——インストーラーも CLI も、あるかどうかを確かめて、なければリンクを出すだけです。自分で何かを入れることはありません。エッジエージェントが動くのは Linux と macOS です。
セットアップのあとは、すべてコマンドひとつ
動いているノードに必要なことは、ひとつのコマンドですべてまかなえます。ダッシュボードにも同じ内容が出ます。ノードはそれぞれ、マシン上の自分の場所だけを使うので、いくつも並べて動かせます。
everyapi edge statusあなたのマシンで起きていることを、こちらから見えている状態と並べて表示します——オンラインかオフラインか、最後に連絡があったのはいつか、どのモデルが入っているか。
everyapi edge modelsノードのモデルを追加・削除・一覧表示します。画面のない環境でも動くので、スクリプトから呼び出せます。
everyapi edge pause新しい仕事が入ってこなくなり、再起動をはさんでもそのままです——知らないうちに仕事へ戻されることはありません。複数のマシンを動かしているなら、1 台を止めても残りは動き続けます。
everyapi edge logs -fノードが今なにをしているかを、リアルタイムで見られます。ターミナルを使いたくなければ、ダッシュボードでもノードごとに同じものが見られます。
everyapi edge update最新版を取ってきて、再起動します。勝手に更新されるものはありません——あなたのマシンのソフトが変わるのは、あなたがこれを実行したときだけです。
everyapi edge removeすべてを停止し、作られたファイルを片づけ、残しておきたいと言わないかぎり、ノードも削除します。どれも、実行する前に確認します。
だから、できることとできないことを、はっきり書いておきます。
どれも「信じてください」というお願いではありません——どれもソフトの作りそのもので、コードはあなた自身が読めます。
初回起動のとき、エージェントは秘密の鍵を作り、あなたしか読めないようにします。そのファイルが他の人からも読める状態になったら、エージェントはそのまま動き続けず、起動をやめます。こちらが目にするのは、公開してよい側の半分だけです。
エージェントが転送するのは、モデルが答えるために必要な、ごく少数のリクエストだけです。しかもこの制限はエージェント自体に組み込まれていて、こちらの設定で変えられるものではありません。仮にこちら側が乗っ取られたとしても、あなたのマシンに別のことをさせることはできません。
そもそもエージェントに、置いておく場所がありません——残る記録に、質問や答えを入れる欄がないのです。書かれるのは、使ったモデル、かかった時間、処理した量、そして意味を持たない購入者ラベルだけ。質問も、答えも、キーも、メールアドレスも入りません。
表示は一度だけ。こちらが持つのは、元に戻せない形にしたものだけで、あなたのマシンが最初につながったあとは、それも消します——誰であれ、もう一度使うことはできません。それ以降は、あなたのマシンが毎回、自分の鍵で自分だと示します。
新しい版が入るのは、あなたが取りにいったときだけです。そしてダッシュボードからノードを削除すると、エージェントには「もう終わり」と伝わります。いつまでも再接続を試すのではなく、理由をはっきり示して終了します。
計上されるのは、そのリクエストの支払いが実際に済んだあとだけで、同じリクエストが二重に数えられることはありません。そのときマシンがオフラインだったなら、次につながったときに、取りこぼした分を受け取ります。収益は販売者の残高に入り、メイン残高へ移すのは別の操作になります。
エージェントは Apache 2.0 のオープンソースで、コードは全部 github.com/everyapi-ai/everyapi-edge にあります——ここまでに書いたことは、すべてそこで確かめられます。
いいえ。エッジノードはマーケットプレイスの一部で、販売者アクセスは審査制です。まず申請していただき、こちらで確認します。見るのはアカウントを作ってからの期間や、これまでの使い方といったところで、この基準は運営側で変えられます。それが通ってはじめて、ノードを追加できます。
余っている GPU の時間を、 役に立つところへ。
販売者アクセスを申請して、ノードを登録し、マシンでコマンドをひとつ実行するだけです。販売者アクセスは審査のうえで付与されます。