SitePoint 日本語 フォロー プロンプト圧縮とキャッシュチューニング:LLM APIコストを60%削減 OpenAI、Anthropic、Google Geminiにおけるプロンプト圧縮、セマンティックキャッシュ、連鎖思考の枝刈り、および出力長制約を用いたLLMコスト削減のためのクロスモデルガイド。 Prompt Compression and Cache Tuning: Cut Your LLM API Costs by 60% sitepoint.com