口径:ods.daily_cost_detail,只看生产环境(测试环境已全量走 endless,不计入),requests 按 promptCode 求和,_endless 后缀并回原 code;时间口径:数据记录的是北京时间(UTC+8),报表按北京时间日统计(每天 = UTC 前一日 16:00 至当日 16:00)。成本按官方价目估算,不是账单金额。业务阶段按 promptCode 命名归类。
A 09-12 多个 code 改用 gpt-5.6-luna · B 09-16 回到 gemini 直连 · C 09-17 gemini 经 endless 放量 · D 09-21 本期峰值 · E 09-22 大 code 切完
| 业务阶段 | code 数 | 请求 | 占比 | 日均较上旬 | 成本 | 成本占比 | 千次成本 | 平均 in / out | 主要模型 | 最大 code |
|---|---|---|---|---|---|---|---|---|---|---|
| 题型识别 | 6 | 6,823,218 | 29.8% | +7.6% | $10,296 | 15.7% | $1.51 | 3,369 / 69 | gemini-3.7-flash / gemini-3.5-flash-lite | question_type_module_v2_simulator |
| 学习资料生成 | 21 | 4,764,718 | 20.8% | +10.3% | $11,230 | 17.2% | $2.36 | 2,411 / 207 | gemini-3.8-flash / gpt-5.6-luna | generate_recap_text |
| 解题过程 | 27 | 3,950,056 | 17.2% | +10.1% | $14,494 | 22.2% | $3.67 | 3,789 / 610 | gemini-3.5-flash-lite / gemini-3.7-flash | solving_module_humc_single |
| 最终答案 | 4 | 2,306,580 | 10.1% | +9.7% | $2,991 | 4.6% | $1.30 | 3,918 / 136 | gemini-3.5-flash-lite / gemini-3.1-flash-lite | module_part_final_answer |
| 思考推理 | 13 | 1,718,296 | 7.5% | +13.1% | $7,853 | 12.0% | $4.57 | 3,019 / 734 | gemini-3-flash / gemini-3.8-flash | thinking_module_common_v2 |
| 可视化与多媒体 | 15 | 927,795 | 4.1% | +8.4% | $9,680 | 14.8% | $10.43 | 1,585 / 434 | gpt-5.5 / gemini-3-flash | question-visuals-generator-default |
| 答案引用高亮 | 2 | 721,247 | 3.1% | +3.7% | $4,328 | 6.6% | $6.00 | 2,240 / 266 | gemini-3-flash / gpt-5.5 | answer_reference_highlight |
| 追问与推荐 | 14 | 617,369 | 2.7% | +15.2% | $3,669 | 5.6% | $5.94 | 7,960 / 443 | gemini-3.7-flash / gemini-3.1-flash-lite | webQuestionMoreStream |
| 检索向量 | 1 | 458,271 | 2.0% | 09-16 起放量 | $13 | 0.0% | $0.03 | 187 / 187 | gemini-embedding | embeddingQuestion |
| 浏览器插件 | 14 | 262,339 | 1.1% | +19.1% | $425 | 0.6% | $1.62 | 1,466 / 201 | gemini-2.5-flash / gemini-3.8-flash | plugin_course_history_title_summary |
| 其他 | 5 | 211,553 | 0.9% | +35.4% | $174 | 0.3% | $0.82 | 1,706 / 208 | gemini-3.1-flash-lite / gpt-5.6-luna | memory_extract_v1 |
| AI Tutor | 11 | 145,886 | 0.6% | +13.6% | $249 | 0.4% | $1.71 | 2,773 / 443 | gemini-2.5-flash / gemini-3-flash | Android_AI_Sync_tutor |
「日均较上旬」= 本期日均 / 09-01~11 日均 − 1。检索向量(embeddingQuestion)09-16 起放量,此前只有零星请求。
| 模型 | 请求 | 占比 | 成本 | 成本占比 | 千次成本 | 平均 in / out | 经 endless |
|---|---|---|---|---|---|---|---|
| gemini-3.5-flash-lite | 4,882,294 | 21.3% | $7,775 | 11.9% | $1.59 | 3,901 / 172 | 18% |
| gemini-3.8-flash | 4,464,556 | 19.5% | $17,267 | 26.4% | $3.87 | 2,961 / 402 | 43% |
| gemini-3.7-flash | 3,943,476 | 17.2% | $17,231 | 26.3% | $4.37 | 3,978 / 305 | 57% |
| gemini-3-flash | 2,359,360 | 10.3% | $6,672 | 10.2% | $2.83 | 3,090 / 552 | 0% |
| gpt-5.6-luna | 2,300,627 | 10.0% | $1,766 | 2.7% | $0.77 | 2,490 / 226 | 100% |
| Qwen3.6-35B | 1,838,437 | 8.0% | $0 | 0.0% | 自建 | 3,015 / 81 | 0% |
| gemini-3.1-flash-lite | 1,257,027 | 5.5% | $1,508 | 2.3% | $1.20 | 3,356 / 262 | 0% |
| gpt-5.5 | 778,845 | 3.4% | $11,179 | 17.1% | $14.35 | 1,674 / 175 | 100% |
| gemini-embedding | 458,271 | 2.0% | $13 | 0.0% | $0.03 | 187 / 187 | 100% |
| gemini-2.5-flash | 339,308 | 1.5% | $165 | 0.3% | $0.49 | 784 / 93 | 0% |
| gemini-2.5-flash-lite | 88,872 | 0.4% | $45 | 0.1% | $0.50 | 2,371 / 525 | 0% |
| gemini-2.5-flash-tts | 84,563 | 0.4% | $202 | 0.3% | $2.39 | 26 / 237 | 0% |
| gemini-3.5-flash | 56,200 | 0.2% | $913 | 1.4% | $16.24 | 3,220 / 1,154 | 23% |
| gpt-5.1 | 22,136 | 0.1% | $135 | 0.2% | $6.10 | 2,567 / 450 | 0% |
| # | promptCode | requests | 占比 | endless 占比 | vs 前一日 |
|---|
「vs 前一日」对比同一 promptCode 在前一日的请求量;「新增」表示前一日为 0。周末以浅底标出。
口径同「全部请求」tab(日期为北京时间日),统计 apiType='endless' 的请求。gemini 经 endless 09-16 小量试切、09-17 起放量;09-12~15 的高点来自多个 code 改用 gpt-5.6-luna(gpt 系列经 endless 调用),不是网关切换。与 Solvely 网关迁移简报 →「Endless 切换进度」同一份数据。
solving_module_humc_single 已切,solving_module_common_transform 系列还在直连。module_part_final_answer(+5.6pp)和 solving_module_common_transform(+4.2pp)。A 09-12 gpt-5.6-luna 经 endless(非网关切换)· B 09-16 起点 5.8% · C 09-17 gemini 经 endless 放量 · D 09-19 v2_simulator 全量 · E 09-22 solver_mode_v1 与 flashcard_text 全量
| 业务阶段 | 15 天请求 | 15 天 endless | 15 天占比 | 09-16 | 09-26 | 变化 | 09-26 待切 | 最大待切 code(分组) |
|---|---|---|---|---|---|---|---|---|
| 题型识别 | 6,823,218 | 2,659,002 | 39.0% | 0.0% | 70.4% | +70.4pp | 99,512 | question_type_combined(自建 qwen) |
| 学习资料生成 | 4,764,718 | 2,789,008 | 58.5% | 0.0% | 82.6% | +82.6pp | 43,475 | generate_flashcard_image(同模型可直接切) |
| 解题过程 | 3,950,056 | 1,403,542 | 35.5% | 8.4% | 38.8% | +30.4pp | 120,855 | solving_module_common_transform(同模型可直接切) |
| 最终答案 | 2,306,580 | 199,890 | 8.7% | 0.0% | 0.0% | +0.0pp | 108,120 | module_part_final_answer(同模型可直接切) |
| 思考推理 | 1,718,296 | 142,078 | 8.3% | 0.0% | 2.8% | +2.8pp | 80,389 | thinking_module_common_v2(需先开通模型) |
| 可视化与多媒体 | 927,795 | 717,289 | 77.3% | 76.6% | 79.2% | +2.6pp | 10,542 | generate_video_title(需先开通模型) |
| 答案引用高亮 | 721,247 | 128,433 | 17.8% | 8.4% | 9.2% | +0.9pp | 32,378 | answer_reference_highlight(部分走 endless) |
| 追问与推荐 | 617,369 | 34,995 | 5.7% | 0.2% | 0.2% | -0.0pp | 31,167 | question_ask_more_full_multi_context_check(同模型可直接切) |
| 检索向量 | 458,271 | 458,271 | 100.0% | 100.0% | 100.0% | +0.0pp | 0 | — |
| 浏览器插件 | 262,339 | 2,280 | 0.9% | 0.1% | 0.0% | -0.1pp | 17,279 | plugin_course_history_title_summary(需先开通模型) |
| 其他 | 211,553 | 61,376 | 29.0% | 41.9% | 17.5% | -24.4pp | 17,398 | memory_extract_v1(需先开通模型) |
| AI Tutor | 145,886 | 0 | 0.0% | 0.0% | 0.0% | +0.0pp | 6,979 | Android_AI_Sync_tutor(需先开通模型) |
| 模型 | 15 天请求 | 15 天 endless | 15 天占比 | 09-26 占比 | 09-26 待切 | 状态 |
|---|---|---|---|---|---|---|
| gemini-3.5-flash-lite | 4,882,294 | 877,370 | 18.0% | 44.3% | 147,091 | 已在 endless |
| gemini-3.8-flash | 4,464,556 | 1,910,127 | 42.8% | 71.2% | 83,359 | 已在 endless |
| gemini-3.7-flash | 3,943,476 | 2,255,335 | 57.2% | 87.2% | 27,541 | 已在 endless |
| gemini-3-flash | 2,359,360 | 0 | 0.0% | 0.0% | 113,543 | 未开通 |
| gpt-5.6-luna | 2,300,627 | 2,299,966 | 100.0% | 100.0% | 0 | 已在 endless |
| Qwen3.6-35B | 1,838,437 | 0 | 0.0% | 0.0% | 94,456 | 自建 |
| gemini-3.1-flash-lite | 1,257,027 | 0 | 0.0% | 0.0% | 70,443 | 未开通 |
| gpt-5.5 | 778,845 | 778,845 | 100.0% | 100.0% | 0 | 已在 endless |
| gemini-embedding | 458,271 | 458,271 | 100.0% | 100.0% | 0 | 已在 endless |
| gemini-2.5-flash | 339,308 | 0 | 0.0% | 0.0% | 20,851 | 未开通 |
| gemini-2.5-flash-lite | 88,872 | 0 | 0.0% | 0.0% | 4,435 | 未开通 |
| gemini-2.5-flash-tts | 84,563 | 0 | 0.0% | 0.0% | 3,417 | 未开通 |
| gemini-3.5-flash | 56,200 | 13,006 | 23.1% | 54.9% | 2,063 | 已在 endless |
| gpt-5.1 | 22,136 | 0 | 0.0% | 0.0% | 534 | 未开通 |
状态:已在 endless = 近 15 天有请求经 endless;未开通 = 还没在 endless 上跑过,对应 code 切换前要先开通模型。
| # | promptCode | endless requests | 占当日 endless | 该 code endless 占比 | vs 前一日 |
|---|
「vs 前一日」对比该 code 前一日的 endless 请求;「新增」表示前一日没有走 endless,通常就是当天切过去的。
| # | promptCode | 业务阶段 | 分组 | 当前通道 · 模型 | 09-26 请求 | 占当日 | 切完后 endless 占比 | 近 7 天 in / out |
|---|
「切完后 endless 占比」= 09-26 的 52.1% 加上当前筛选下从第 1 行切到该行的请求,分母为 09-26 总请求 1,186,427。分组:同模型可直接切 = 当前模型已在 endless 上运行,只换通道;需先开通模型 = 当前模型还没在 endless 上跑过;部分走 endless = 09-26 有 5–95% 走 endless;自建 qwen = Qwen3.6-35B 自建推理,是否纳入迁移待定;长输出 = 平均输出 ≥3,000 token,先确认流式超时;长尾 = 09-26 请求 <1,000。in / out 为近 7 天平均 token(含 endless 流量)。