CATEGORY AI・機械学習

LLM APIのコストを抑える実践テクニック

キャッシュ・バッチ・モデル選択の 3 つで、同じ処理の請求が一桁変わります。プロンプトキャッシュの読み出しは入力料金の約 0.1 倍、急がない処理はバッチ API で 50% 引き。2026年8月16日時点の公式ドキュメントの料金で、どこから削るかを整理しました。

OllamaのOpenAI互換APIでローカルLLMをアプリから使う

既存の OpenAI クライアントはほぼ動く。ただし落ちる機能がはっきり決まっている。Ollama は http://localhost:11434/v1/ に OpenAI 互換のエンドポイントを持っているので、ベース URL を差し替えるだけで既存のクライアントライブラリがそのまま動きます。

Whisperで音声の文字起こしをVPSで動かす

メモリ 1GB の VPS で載るのは tiny と base だけ。文字起こしは画像生成と違って CPU だけでも動きます。GPU が無い一般的な VPS でも成立する数少ない用途です。ただしモデルサイズがメモリで決まります。

ChatGPT APIをPHPから使う最小サンプルコード

OpenAI APIをPHPから使う場面は思った以上に多い。簡単な要約ツール、チャットボット、コード補完ヘルパーなど、PHPバックエンドにサクッと組み込みたい時のために、最小限のサンプルコードをまとめた。 APIキーの取…