iPhone で llama.cpp に接続:ローカル計算を直接使う
自分のコンピューターで動く llama.cpp に iPhone から直接つなぎます。待ち受けアドレスやファイアウォールから Oriveo の設定まで、エンジンをインターネットに公開せずに済む手順を説明します。
- 手元の計算資源を別の端末から使えます。ローカル HTTP では API の認証情報を送りません。
- Oriveo はクライアントです。llama.cpp はコンピューターやサーバーで動かす必要があり、スマートフォン上でモデルは動きません。
- 認証のないエンジンをインターネットに公開しないでください。自宅や職場の Wi-Fi、または Tailscale など対応するプライベート VPN を使います。パブリックアドレスや、パブリックとプライベートが混在する DNS 名は拒否されます。

llama.cpp を準備する
エンジンをプライベートなアドレスで起動し、コンピューター上でポートに接続できることを確かめてから、LAN またはプライベート VPN からのアクセスだけを許可します。
- llama-server --host 0.0.0.0 --port 8080 --model /path/model.gguf
- --chat-template /path/template.jinja
- GET http://127.0.0.1:8080/health
iPhone から接続する
Oriveo の「プロバイダー」で「ローカル計算」を選び、使うエンジンを指定してプライベートアドレスを入力します。検出されたモデルを確認してから保存してください。
プライベートネットワークの中だけで使う
認証のないエンジンをインターネットに公開しないでください。自宅や職場の Wi-Fi、または Tailscale など対応するプライベート VPN を使います。パブリックアドレスや、パブリックとプライベートが混在する DNS 名は拒否されます。
アプリについてのよくある質問
Oriveo のサーバーを経由する必要はありますか?
ありません。ネイティブアプリは直接接続します。Web 版はブラウザーのローカルネットワークアクセスと CORS を使い、プライベートアドレスへの通信を Oriveo のサーバーで中継することはありません。
モデルはスマートフォンの上で動くのですか?
いいえ。モデルはコンピューターやサーバーで動き、スマートフォンはメッセージをやり取りするクライアントです。
どのコマンドとポートを使いますか?
llama-server --host 0.0.0.0 --port 8080 --model /path/model.gguf · --chat-template /path/template.jinja · GET http://127.0.0.1:8080/health