AIでチャット
iOS app by Kazuhiro Yoshimitsu. Utilities · Kazuhiro Yoshimitsu
- Store rating
- 0 / 5
- Store rating count
- 0
- Download price
- Free to download
- In-app purchases
- Unknown
- Version
- 1.0.9
- Listing last refreshed
- 2026-09-08
View the original store listing
Store description excerpt
AIでチャットは、インターネット接続なしでも動作するローカルAIチャットアプリです。 会話はすべてあなたのiPhone・iPadの中だけで処理されます。入力した内容やAIの返答が外部のサーバーに送信されることはありません。機内モードのままでもそのまま使い続けられます。クラウドAIのサブスクリプションや通信環境に縛られず、自分の端末の性能の範囲で、自分の選んだモデルを使用できるアプリです。 ■ 使い方はシンプルに3ステップ 1. アプリ内のモデル一覧から、端末に合ったAIモデルを選ぶ (迷ったら、端末のメモリに応じて自動で選ばれる「おすすめ」でOK) 2. モデルをダウンロード(数百MB〜数GB、Wi-Fi推奨) 3. あとは話しかけるだけ。ダウンロード済みのモデルは、すぐに使えます ■ 自分の端末で動く、自分で選べるAIモデル Hugging Face上で公開されているGGUF形式のオープンモデル(Gemma、Qwenなど)をアプリ内から検索してダウンロードし、そのまま端末上で動かせます。一覧ではモデルごとに推定メモリ消費から「動作可能 / ギリギリ動作 / 動作不可」を判定して 表示するので、ダウンロードしたのに重くて使えない、という失敗を防げます。 ■ 対応済みモデル (v1.0.9 時点) 設定の「対応済みモデル」に、動作確認済みモデルのダウンロードリンクを収録しています。 推奨設定(Temperatureなど)はアプリ側で調整済みなので、選ぶだけでそのモデルが使用できます。モデルを切り替えると、Temperatureは自動でそのモデルの推奨値に設定されます。 ・推奨: Google Gemma 4 (E2B / E4B)、Alibaba Qwen3.5 4B / Qwen3.5 0.8B ・その他の対応済み: NVIDIA Nemotron 3 Nano 4B、Microsoft Phi-4 mini、 IBM Granite 4.2 3B、Prism ML Bonsai 8B / Bonsai 27B、 LiquidAI LFM2.5 2.6B / LFM2.5 1.2B JP、Shanghai AI Lab Agents-A1 4B、 ModelScope Spark-X2.5 4B / Spark-X2.5 1.7B、Mistral AI Ministral 3 3B、 Hugging Face SmolLM3 3B、Google Gemma 3 1B、LLM-jp 3.1 1.8B 一覧はアップデートごとに追加していきます。 もちろん、ここに無いGGUFも自由に試せます。 ■ 応答の挙動を細かく調整できます ・システムプロンプト: AIの性格や口調、答え方の方針を自由記述で指定。 ・Temperature: 0.0(正確・一貫)〜2.0(創造的)の間で応答のばらつきを調整。 ・コンテキストサイズ: 2K〜32K。一度に扱える会話や文書の長さを、応答速度とのバランスで選べます。大きなモデルでは、端末のメモリに合わせて安全に使える長さへ自動調整され、調整された場合はその旨を画面に表示します。 ・長文優先 / 会話継続優先: 長い文書を一度に読ませたいか、テンポの良いやり取りを続けたいか、用途に応じてメモリの使い方を切り替えできます。 ■ 生成を速くする仕組み (実験的機能) 本体のモデルと一緒に、小さな「先読み用」のモデルを動かして生成を速くする仕組みに対応しています。3つの方式があり、いずれか1つを選んで使います。 ・MTP(Multi-Token Prediction): Gemma 4シリーズ向け。本体と同じ配布元にある小さなモデルを併用します。 ・DFlash: Qwen3.5 4B向け。別途配布されている専用の小さなモデルを併用します。 ・Speculative Decoding: 本体と同じトークナイザ(語彙)を持つ小さなモデル(例: Qwen3.5 4BではQwen3.5 0.8B)を、自分で選んで併用します。 いずれも初期状態では無効です。端末やモデルの組み合わせによっては、遅くなることがあるため、実際に試して確かめられるようにしています。メモリ使用量が増えるため、メモリが足りないなどで使えない場合は、その理由を画面に表示します。 ■ プライバシー優先の設計 ・会話履歴は端末内のデータベースに保存され、外部には送信されません。 ・アカウント登録やサインインは不要です。 ・広告やトラッキングはありません。 ・チャットの入力内容が、設定なしに外部へ送信されることは一切ありません。 ■ このiPhoneが、あなたのAIサーバーになる サーバーモードをオンにすると、iPhone/iPad自体がOpenAI互換のAPIサーバーとして動き、同じネットワークの別の端末(別の「AIでチャット」や、OpenAI互換の各種クライアント)から、この端末でロード中のモデルを使えます。ポケットの中のiPhoneが、家中の端末にAIを配る小さなサーバーになります。専用画面を開いている間だけ稼働するシンプルな設計です。 ・対応API: /v1/chat/completions(ストリーミング/一括)、/v1/models、/props(コンテキストサイズの取得) ・会話履歴はrole付きのまま受け取り、モデル本来のチャットテンプレートに変換して推論します ・max_tokensなどクライアントからの生成指定を尊重。温度が未指定なら、サーバー側で使用中のモデルの推奨値で応えます ・ブラウザから使える簡易チャット画面も内蔵。同じネットワークのPCからアクセスでき、ファイル添付にも対応 ・APIキー認証に対応(キーは画面で生成。未設定の場合は同一ネットワーク内から認証なしでアクセスできます) ■ 自分のサーバーに接続することも(上級者向け) 同じネットワーク(自宅LAN)やVPN(Tailscale等)経由で、自分が運用しているOpenAI互換の推論サーバー(llama-server など)に接続して、端末単体では動かせない大きなモデルを使うこともできます。 ・接続先はプロファイルとして複数保存(https/http、ポート、モデルID。APIキーはKeychainに保存) ・接続テストで疎通確認とあわせて、サーバーのコンテキストサイズを自動取得(llama-serverと本アプリのサーバーモードに対応)。4K〜256Kの手動指定も可能で、長いファイル添付はこの値に合わせて送られます ・思考(reasoning)対応モデルでは、本文が始まるまで「思考中…」の進行を文字数つきで表示。生成を停止すると、サーバー側の生成も即座に止まります ・サーバー側のエラーは理由をそのまま画面に表示します ・接続できるのはTailscale(*.ts.net)・プライベートIP・.localのホストのみ。設定を誤って公開インターネット上のサーバーへ会話が送られることはありません ■ 主な機能 ・ローカルLLMとのチャット(ストリーミング応答、Markdown表示、コード
Review coverage
AppRill has captured 0 reviews for this app. This is a collected sample, separate from the store rating count. Latest review capture: Not captured yet.
Recent captured chart positions
No chart positions have been captured for this app yet.
Chart position, rating count and review coverage do not establish downloads, revenue or profit. Understand the differences.