PromptCode 请求量 · 09-12 → 09-26

口径:ods.daily_cost_detail,只看生产环境(测试环境已全量走 endless,不计入),requests 按 promptCode 求和,_endless 后缀并回原 code;时间口径:数据记录的是北京时间(UTC+8),报表按北京时间日统计(每天 = UTC 前一日 16:00 至当日 16:00)。成本按官方价目估算,不是账单金额。业务阶段按 promptCode 命名归类。

本期要点

  • 规模:15 天请求 22,907,328 次,日均 152.7 万,较 9 月上旬(09-01~11)日均 136.4 万 +11.9%;token 830.7 亿;成本约 $65,401(按官方价目估算),日均 $4,360,较上旬 +32.1%。
  • 业务集中在前三块:题型识别 29.8%、学习资料生成 20.8%、解题过程 17.2%,合计 67.8% 的请求。成本排序不同:解题过程 $14,494(22.2%)最高,其次学习资料生成 $11,230、题型识别 $10,296。
  • 单价差异大:可视化与多媒体只占 4.1% 请求却花了 14.8% 成本(千次 $10.43),主要是 gpt-5.5(千次 $14.35);思考推理千次 $4.57、解题过程 $3.67,都高于整体均值 $2.86。
  • 模型:gemini-3.5-flash-lite / 3.8-flash / 3.7-flash 三个合计 58.0% 请求、64.6% 成本;gpt-5.5 以 3.4% 请求占 17.1% 成本;自建 Qwen3.6-35B 承担 8.0% 请求,不产生 API 成本。
  • 单价上升的原因:千次成本从 9 月上旬的 $2.42 升到本期 $2.86(+18%)。9 月上旬主力是 gemini-3-flash / 3.1-flash-lite,本期换成 3.5-flash-lite / 3.8-flash / 3.7-flash,其中 3.7 / 3.8-flash 千次 $4.37 / $3.87。09-12~15 多个 code 临时改用 gpt-5.6-luna(千次 $0.77),09-12~13 千次成本约 $1.8,09-16 回到 gemini 后为 $3.04。
  • 节奏:工作日日均 178.1 万、周末 101.9 万(约 57%);峰值在 09-21(周一)216.6 万次、$6,566。gemini 经 endless 09-16 小量试切、09-17 起分批放量,09-22 后 endless 稳定在 51–52%(详见「Endless 切换进度」tab)。

里程碑

请求、成本、单价与模型结构(共用时间轴,竖虚线为里程碑,点任意一天联动下方 Top 20)

A 09-12 多个 code 改用 gpt-5.6-luna · B 09-16 回到 gemini 直连 · C 09-17 gemini 经 endless 放量 · D 09-21 本期峰值 · E 09-22 大 code 切完

按业务阶段

业务阶段code 数请求占比日均较上旬成本成本占比千次成本平均 in / out主要模型最大 code
题型识别66,823,21829.8%+7.6%$10,29615.7%$1.513,369 / 69gemini-3.7-flash / gemini-3.5-flash-litequestion_type_module_v2_simulator
学习资料生成214,764,71820.8%+10.3%$11,23017.2%$2.362,411 / 207gemini-3.8-flash / gpt-5.6-lunagenerate_recap_text
解题过程273,950,05617.2%+10.1%$14,49422.2%$3.673,789 / 610gemini-3.5-flash-lite / gemini-3.7-flashsolving_module_humc_single
最终答案42,306,58010.1%+9.7%$2,9914.6%$1.303,918 / 136gemini-3.5-flash-lite / gemini-3.1-flash-litemodule_part_final_answer
思考推理131,718,2967.5%+13.1%$7,85312.0%$4.573,019 / 734gemini-3-flash / gemini-3.8-flashthinking_module_common_v2
可视化与多媒体15927,7954.1%+8.4%$9,68014.8%$10.431,585 / 434gpt-5.5 / gemini-3-flashquestion-visuals-generator-default
答案引用高亮2721,2473.1%+3.7%$4,3286.6%$6.002,240 / 266gemini-3-flash / gpt-5.5answer_reference_highlight
追问与推荐14617,3692.7%+15.2%$3,6695.6%$5.947,960 / 443gemini-3.7-flash / gemini-3.1-flash-litewebQuestionMoreStream
检索向量1458,2712.0%09-16 起放量$130.0%$0.03187 / 187gemini-embeddingembeddingQuestion
浏览器插件14262,3391.1%+19.1%$4250.6%$1.621,466 / 201gemini-2.5-flash / gemini-3.8-flashplugin_course_history_title_summary
其他5211,5530.9%+35.4%$1740.3%$0.821,706 / 208gemini-3.1-flash-lite / gpt-5.6-lunamemory_extract_v1
AI Tutor11145,8860.6%+13.6%$2490.4%$1.712,773 / 443gemini-2.5-flash / gemini-3-flashAndroid_AI_Sync_tutor

「日均较上旬」= 本期日均 / 09-01~11 日均 − 1。检索向量(embeddingQuestion)09-16 起放量,此前只有零星请求。

按模型(Top 14)

模型请求占比成本成本占比千次成本平均 in / out经 endless
gemini-3.5-flash-lite4,882,29421.3%$7,77511.9%$1.593,901 / 17218%
gemini-3.8-flash4,464,55619.5%$17,26726.4%$3.872,961 / 40243%
gemini-3.7-flash3,943,47617.2%$17,23126.3%$4.373,978 / 30557%
gemini-3-flash2,359,36010.3%$6,67210.2%$2.833,090 / 5520%
gpt-5.6-luna2,300,62710.0%$1,7662.7%$0.772,490 / 226100%
Qwen3.6-35B1,838,4378.0%$00.0%自建3,015 / 810%
gemini-3.1-flash-lite1,257,0275.5%$1,5082.3%$1.203,356 / 2620%
gpt-5.5778,8453.4%$11,17917.1%$14.351,674 / 175100%
gemini-embedding458,2712.0%$130.0%$0.03187 / 187100%
gemini-2.5-flash339,3081.5%$1650.3%$0.49784 / 930%
gemini-2.5-flash-lite88,8720.4%$450.1%$0.502,371 / 5250%
gemini-2.5-flash-tts84,5630.4%$2020.3%$2.3926 / 2370%
gemini-3.5-flash56,2000.2%$9131.4%$16.243,220 / 1,15423%
gpt-5.122,1360.1%$1350.2%$6.102,567 / 4500%

每日总请求(点选某一天查看 Top 20)

Top 20 promptCode

#promptCoderequests占比endless 占比vs 前一日

「vs 前一日」对比同一 promptCode 在前一日的请求量;「新增」表示前一日为 0。周末以浅底标出。