SitePoint 中文 关注 提示压缩与缓存调优:将 LLM API 成本降低 60% 跨模型指南:利用提示压缩、语义缓存、思维链剪枝及输出长度限制,在 OpenAI、Anthropic 和 Google Gemini 上降低 LLM 成本。 Prompt Compression and Cache Tuning: Cut Your LLM API Costs by 60% sitepoint.com