← ホームに戻る

❓ よくある質問

ENAIWEBに関する質問と回答

🚀 基本・設定

どのAIプロバイダーを使えばいいですか?

初心者の方はGeminiがおすすめです。無料で1日1,500リクエストまで使え、設定も簡単です。高品質な音声読み上げが必要な場合は、ElevenLabsやGoogle Cloud TTSを検討してください。

無料で使えますか?

はい、以下の組み合わせで完全無料で使えます:

  • AI画像認識: Gemini(無料枠あり)
  • 音声読み上げ: ブラウザTTS(APIキー不要)
  • OCR(テキスト抽出): Tesseract.js(オフライン、完全無料)
インターネット接続は必要ですか?

Tesseract.js(OCR)とブラウザTTSはオフラインで動作します。AI Vision APIやクラウドTTSを使用する場合はインターネット接続が必要です。

スマホでも使えますか?

はい、スマートフォンやタブレットでも使えます。カメラで撮影した画像を直接アップロードすることも可能です。

対応しているファイル形式は?

PDFファイルと画像ファイル(JPEG、PNG、WebPなど)に対応しています。

大きなPDFファイルは処理できますか?

ブラウザのメモリに依存しますが、通常は50ページ程度まで問題なく処理できます。大きなファイルは数ページずつ分割して処理することをお勧めします。

⚠️ トラブルシューティング

画像認識が失敗する

LLM設定でAIプロバイダーとAPIキーを正しく設定してください。未設定時はTesseract.jsに自動切り替えされます。

音声が再生されない

TTS設定を確認してください。ブラウザTTSは追加設定不要です。iOS Safariでは、画面をタップしてから音声が再生される場合があります。

単語の意味が表示されない

単語をクリック(タップ)して日本語訳を表示してください。辞書にない単語は「翻訳」ボタンでオンライン検索できます。

抽出精度を上げるには?

以下のポイントに注意してください:

  • 高解像度の画像を使用する
  • 文字がはっきり見えるように撮影する
  • AI Vision API(Gemini、OpenAI等)を使用する(Tesseract.jsより高精度)
カスタムプロバイダーで404エラー

URLの末尾に /chat/completions を付けないでください。例: https://your-api.com/v1

モデルリストが取得できない

/models エンドポイントが利用できない場合、デフォルトリストが表示されます。手動でモデル名を入力することも可能です。

🔧 操作方法

履歴は削除できますか?

はい、履歴リストの🗑️アイコンをクリックすると個別に削除できます。すべての履歴を削除するには、ブラウザの設定からlocalStorageをクリアしてください。

設定をリセットしたい

設定パネル下部の「設定をクリア」ボタンをクリックすると、すべての設定がリセットされます。

ステータスバッジ(🤖 / 📷)の意味は?

現在のOCR設定を示しています:

  • 🤖 AI: Gemini、OpenAI、Claude等のAI Vision APIを使用
  • 📷 JS: Tesseract.js(オフラインOCR)を使用

バッジをクリックすると現在の設定詳細を確認できます。

🌍 その他

他の言語もサポートしていますか?

現在は英語→日本語の翻訳に特化しています。他の言語のサポートは今後のアップデートで検討中です。