使用大语言模型时,通常按读写文本量计费,以「token」计数。一个 token 约四个字符或四分之三个词。提供商列出每 1,000 token 的价格。例如 GPT-3.5 Turbo 可能约 $0.002/1,000 token,而 GPT-4 高得多,prompt 约 $0.03–$0.06,回复约 $0.06–$0.12。Llama-2 等较小开源模型若在本机运行可免费使用,但仍需承担硬件或云时间成本。Vision 或 audio 模型常因算力更高而额外收费。规划成本时,估算每次调用的 token 数、乘以单价,并加上托管或存储费用。