ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Agentsview 定价数据源调研:LiteLLM、Pydantic GenAI Prices 与九个机器可读 AI 价目表的选型结论

Agentsview 定价数据源调研:LiteLLM、Pydantic GenAI Prices 与九个机器可读 AI 价目表的选型结论 Agentsview 定价数据源调研LiteLLM、Pydantic GenAI Prices 与九个机器可读 AI 价目表的选型结论【免费下载链接】agentsviewLocal-first session search, analytics, insights, and token use statistics for coding agents, supporting Claude Code, Codex, and more than 20 other agents.项目地址: https://gitcode.com/GitHub_Trending/ag/agentsview导读本文是 Agentsview本地优先的 coding agent 会话搜索、分析与 token 用量统计工具在 2026-08-25 所做的一次定价数据源横向调研评估了 LiteLLM、Portkey Models、Pydantic GenAI Prices、models.dev、Langfuse、OpenRouter、Helicone、AgentOps tokencost 与 RoninForge AI Price Index 共九个机器可读的 AI 定价来源。调研围绕xai/grok-4.6与gpt-5.6-luna两个探针模型展开回答了一个核心问题当前价目表与历史生效价目表这两类需求能否由单一来源同时满足读完本文你将掌握各数据源的覆盖能力、结构化程度、历史追溯能力、许可证约束以及 Agentsview 最终采纳的LiteLLM 保当前 GenAI Prices 保历史分层架构与仓库内的落地代码路径。调研背景两个探针模型与审计方法本次调研对每个候选源采用默认分支或 2026-08-25 当天可观察到的在线 API并把引用固定到被审计的 commit快照方式保证结论可复现。两个探针模型的选择非常刻意xai/grok-4.6用于检验一个数据源对刚发布模型的响应速度发布当日是否入库代表当前目录这一需求。gpt-5.6-luna用于检验数据源对历史降价区间的保留能力7 月 9 日以 $1/$6 发布、7 月 30 日降至 $0.20/$1.20代表历史有用性这一需求。二者恰好暴露了当前目录类来源与历史有效日期类来源之间的现实差距——没有任何单一来源同时具备 LiteLLM 的当前覆盖和 Pydantic 的条件历史能力这正是分层设计的出发点。结论摘要分层设计是正解调研的最终判断可以用一句话概括LiteLLM 仍是当前价目表的最佳主源Pydantic GenAI Prices 是最佳历史/条件层二者通过事件时间戳衔接。具体要点LiteLLM同时覆盖两个探针模型Grok 4.6 发布当日入库且已携带 context bands、batch、flex、priority、regional、cache、search 与非 token 计价字段。Agentsview 当前只解析了其中一小部分这是摄取限制不是上游数据缺口。Portkey Models当前价的许可最友好替代。其 JSON 对 Luna 的 context bands、执行模式、区域、缓存价与附加单位的表达比 LiteLLM 的扁平字段命名空间更显式Grok 4.6 同样发布当日入库。但它不保留有效日期历史无法单独解决历史价需求。Pydantic GenAI Prices通用条件 schema 最有用。可按开始日期与 UTC 时间窗选价支持 tier 数组、任意计价单位、provider/model 别名匹配。其当前 feed 同时保留 Luna 两个价格周期但尚无 Grok 4.6适合做历史与条件层而非主目录。RoninForge AI Price Index本次调研中最刻意做历史优先的项目每条记录都带生效日期、验证日期、置信度与一手来源。但覆盖仍小且其 Luna 历史把 7 月 30 日的降价错误套到了 7 月 9 日发布之上暂不能作为唯一历史权威。结论没有任何单一来源同时拥有 LiteLLM 的当前覆盖与 Pydantic 的条件历史。证据指向分层设计——用 LiteLLM 保证当前广覆盖并保留更多上游字段当事件时间戳需要历史价时由带有效日期的 GenAI Prices 记录覆盖 LiteLLM。九个候选源横向对比下表汇总了 2026-08-25 当天九个来源的探针覆盖、定价结构、历史能力、许可证与来源性质数据源探针覆盖2026-08-25定价结构有效历史许可证与时效来源性质LiteLLM两个都覆盖极宽的 token/非 token 字段具名的 context、batch、flex、priority、regional 字段通用 tier 数组无。更新直接替换当前字段MITenterprise/之外3,174 条当前模型记录审计 commit947dbbf2026-08-22独立社区目录带 provider 引用Portkey Models两个都覆盖显式 context tiers、区域、standard/batch/flex/priority 模式、缓存与任意附加单位无。价格更新直接覆盖记录MIT仓库与目录 2026-08-25 更新宣称 40 provider 共 2,000 模型独立社区目录带贡献者来源链接策略Pydantic GenAI Prices v2只有 Luna无 Grok 4.6有序条件价格、开始日期、UTC 时间窗、tier 数组、任意单位、provider 回退与丰富匹配有经人工策展时MIT36 个 provider 共 1,477 个模型审计 commit83a49e82026-08-25策展复合源LiteLLM、OpenRouter、Helicone 等仅作为差异输入models.dev两个都覆盖标准/缓存/音频 token 价、正式 context tiers、具名实验模式无MIT199 个 provider 共 7,285 条 provider-model 条目审计 commita4ba8de2026-08-25独立一手 provider 记录 provider API 同步其 OpenRouter provider 反映的是 OpenRouter 路由Langfuse只有 Luna无 Grok 4.6带数字用量条件的排序 tier、属性条件、regex 模型匹配、任意用量键无MIT Expatenterprise 路径之外167 条默认记录审计 commite491ab92026-08-25独立策展默认集OpenRouter两个都覆盖当前路由模型价字段、context 覆盖、batch 限定模型 ID、缓存、web search、图像、音频、推理无在线 API 有 419 个模型API 与文档均未附带开放数据许可独立在线市场数据价格描述 OpenRouter 路由而非必然的一手牌价Helicone审计main上两个都没有阈值数组、provider/model 别名、缓存乘数、请求、web search 与多模态价遗留行可有日期区间仅遗留形态的部分能力Apache-2.0审计maincommit67df07b2026-07-21混合。一手记录为人工编写OpenRouter 回退记录由 OpenRouter 生成AgentOps tokencost两个都没有LiteLLM 的旧版扁平 per-model 对象消费端暴露 prompt/completion 估算无MIT目录最后更新 2025-09-05直接转包 LiteLLMRoninForge AI Price Index两个都覆盖带变体的价格记录、多种单位、生效区间、验证日期、置信度与来源schema 支持但覆盖不完整数据 CC BY 4.0、工具 MIT11 个 provider 共 108 个模型审计 commit2322493上有每日导出独立一手转录聚合器仅作检测与交叉核对LiteLLM当前价目表的主力源被审计的model_prices_and_context_window.jsoncommit947dbbf2026-08-22包含 3,174 个模型对象。其中gpt-5.6-luna记录标准价与大于 272K 输入价的 input、output、cache-write、cache-read 四类价格另有 batch、flex、priority、EU/US 上浮与 search-query 价格。xai/grok-4.6记录标准价与大于 200K 输入价的 input、output、cache-read 价格。Grok 4.6 以 day-0 目录提交928dfab入库即发布当天即被收录而 Luna 的降价则暴露了它的历史局限commitf1b781d直接替换了旧价格当前 JSON 中没有任何effective-start/effective-end字段——旧值只存在于 Git 历史中不在正常定价文档里。该目录位于 LiteLLMenterprise/目录之外因此以 MIT 许可发布。更完整的字段清单与上游/Agentsview 之间的差距见仓库文档 litellm-pricing-capabilities-2026-08-24.md。Portkey Models结构化最清晰的许可替代Portkey 以 provider JSON 文件加免鉴权 API 发布。其 README 明确了 cents-per-token 单位、token 与缓存字段、任意additional_units与独立 batch 配置。被审计的gpt-5.6-luna对象更进一步其custom_pricing树包含 272K context 映射、默认与数据驻留区域以及 standard、batch、flex、priority 四种执行模式每个叶子保留 input、output、cache、web-search、file-search 价格。被审计的grok-4.6对象带当前 input、output、cache-read、web-search、X-search、code-execution、attachment-search、file-search 价格但缺少 Grok 大于 200K 的带宽档——schema 有能力表达只是这条记录本身不完整相比 LiteLLM、models.dev、OpenRouter 与 RoninForge。Git 历史显示Portkey 于 2026-08-12 在d559716加入 Grok7 月 30 日在6da7d21更新 Luna——该 diff 同时覆盖了普通与带日期的模型对象。带日期的模型 ID 只标识 provider 模型快照并不是有效日期价格序列。仓库以 MIT 发布。对 Go 嵌入而言 Portkey 有一个独特优点源数据本身就是普通 provider JSON其显式嵌套条件维度比 LiteLLM 不断膨胀的后缀字段命名空间更容易保留。但它仍只是第二个当前目录无法消除对历史数据的需求。Pydantic GenAI Prices条件历史层的最佳候选被审计的 v2 feedcommit83a49e8包含 36 个 provider、1,477 个模型。data.json含 OpenAI 与 AWS 的 Luna 记录但没有 Grok 4.6。OpenAI 记录先给出旧价 $1/$6 短上下文然后是start_date: 2026-07-30的新价 $0.20/$1.20 记录两套价格都带 272K 整请求 tier 与缓存价。其类型化源契约支持有序条件价格、开始日期与时区感知的每日窗口、数字 tier 数组、任意价格单位、provider 回退以及 exact、prefix、suffix、contains、regex、OR、AND 七种匹配方式见上游prices_types.py与生成的 v2 JSON Schema。需要注意的是它并非独立价格普查。其 pricing-data README 明说会下载 Helicone、OpenRouter、LiteLLM 与 Simon Willison 的价格来注入差异供人工裁决LiteLLM importer 与 OpenRouter importer 各自说明各比较源贡献了什么。策展的 provider YAML 才是发布的权威因此它可以补上输入源缺失的历史但更新速度取决于人工复核环节。仓库以 MIT 发布。由于版本化 JSON 可直接原样嵌入 Go且 Luna 记录天然支持事件时间戳选价它成为 Agentsview 历史层的第一选择缺失 Grok 覆盖则意味着查询必须先落到当前目录。models.dev规模最大的第一方能力目录models.dev 的在线api.json在审计日有 199 个 provider 下 7,285 条 provider-model 条目两个探针模型的第一方 source TOML 均存在并引用 provider 定价页面providers/openai/models/gpt-5.6-luna.toml标准价与 272K tier 价外加一个实验性 fast 模式。providers/xai/models/grok-4.6.toml标准价与 200K tier 价。其规范化的Costschema 覆盖 input、output、reasoning、cache read/write、音频 token 价与正式 context tiers具名实验模式可挂不同的 cost 与 provider 请求形态。但它没有通用条件语言、有效价格日期、时间窗或非 token 计费单位provider 与模型 ID 是精确匹配构建期的base_model继承不是运行期别名匹配。Grok 在发布当日经2f03855入库Luna 降价经9b6e58f2026-07-31入库。项目 MIT 许可生成的 JSON 也易嵌入 Go但它本质是当前 provider 能力目录而非历史定价数据。Langfuse条件分层匹配器的范本Langfuse 被审计的default-model-prices.jsoncommite491ab9有 167 条记录。它包含 Luna且带六个有序 tierstandard、fast、flex、大于 272K、fast大于 272K、flex大于 272K但没有 Grok 4.6。其 tier 匹配器的语义值得借鉴对数字用量明细求值 regex、对精确属性值匹配、条件间 AND、非默认 tier 按优先级升序排序、取首个命中否则回退默认。实现在上游matcher.ts接受的条件形态在validation.ts。当前默认值只用service_tier与speed两个键理论上任意精确元数据键都可以编码区域但没有日期或时间比较——createdAt/updatedAt只是记录维护元数据不是选择器。默认目录是独立策展数据并配有自动化的 model-price audit 工作流。它位于 Langfuse enterprise 路径之外适用根 LICENSE 的 MIT Expat 条款。JSON 可直接嵌入但缺 Grok 记录且无历史对本仓库而言弱于 LiteLLM 或 Portkey。OpenRouter路由价目表与许可边界免鉴权的在线GET /api/v1/models在审计日返回 419 个模型。它包含 Grok 4.6$2/$6 标准价、200K 覆盖到 $4/$12、cache-read 覆盖、web-search 价以及 standard 与:batch两种 Luna ID各自带 272K 覆盖、缓存价与 web-search 价。官方 models API 参考文档说明了模型与价格响应结构。跨整个在线响应定价对象用到了 prompt、completion、cache read/write、一小时 cache write、内部推理、audio、image、web search 字段。但created时间戳描述的是模型上架时间而非价格生效时间没有有效价格区间也没有历史价格数组。更重要的是语义边界OpenRouter 是市场与路由器其价格回答的是一条 OpenRouter 路由多少钱并不自动等于一手 provider 的标准牌价。Luna 案例可见一斑OpenRouter 有独立的 standard 与 batch ID而旧消费者曾把打折后的路由价误当成标准价。在线 API 对 Go 解析友好但不适合作为唯一内嵌快照——API 参考与官方服务条款都没有为目录附带开放数据许可。这并不证明再分发被禁止而是说本次调研没有找到与 MIT 或 CC BY 4.0 相当的明确开放许可。Helicone覆盖缺口与半残历史能力在被审计的maincommit67df07b2026-07-21上Helicone 两个目标模型都没有xAI 目录止步于 Grok 4.6 之前OpenAI 目录树到达 GPT-5.4 而未及 5.6。其当前注册表的ModelPricing类型支持阈值数组、input/output 价、缓存乘数与存储、thinking、request、web-search 与按模态计价Endpoint 记录补充 provider ID、别名、区域、位置与优先级。这些 TypeScript 模块对 Go 嵌入不如一份 check-in 的 JSON 制品方便。历史能力方面旧版ModelRow允许dateRangellm-costsAPI 路由会返回它但新注册表类型没有有效日期字段因此历史只是遗留形态的部分能力不是通用契约。来源性质也需区分一手 author 模块是独立编写的OpenRouter 回退则由buildPricesOpenRouter.py直接抓取 OpenRouter API 生成并非独立。项目以 Apache-2.0 发布。AgentOps tokencost过期拷贝不应引入tokencost 不是独立定价源。其update_prices.py调用包内 LiteLLM 刷新与 check-in JSON 比对后写入刷新后的 LiteLLM 对象一个 daily workflow 曾自动化该拷贝过程。被审计的model_prices.json两个探针模型都没有目录最后一次提交停留在 2025-09-05——比本次调研的模型早了近一年。项目 MIT 许可但嵌入它等于再带一份 Agentsview 已在用的源的过期拷贝没有任何增量价值。RoninForge AI Price Index历史优先但覆盖有限RoninForge 明确把带日期的一手证据置于广度之上README 描述 point-in-time 查询与旗舰优先的推进节奏。审计日观察到的current.json含 11 个 provider 下 108 个模型的 327 条价格变体两个探针模型及全部标准/context 带宽 token 价都在内。其 price-record JSON Schema 要求 provider、model、variation、unit、price、effective_from、验证日期、source、source kind 与 confidence 字段支持闭区间生效区间以及 input、output、cache、batch、context-tier、embedding、audio、image 变体覆盖 token、image、minute、character、request 五种单位。方法论明确聚合器只做差异检测一手来源必须确认公开数值。每日生成并签名的导出提交说明项目在积极维护。但被审计数据存在一处实质性 Luna 历史错误OpenAI 记录把 $0.20/$1.20 的降价价从effective_from: 2026-07-09起套用前面没有 $1/$6 区间而 LiteLLM 降价 diff、Portkey 7 月 30 日 diff、models.dev 源注释与 Pydantic 条件记录都指向 7 月 30 日。RoninForge 的当前价是正确的但它在 7 月 9 日至 7 月 29 日之间给出的 point-in-time 答案是错的。xAI 记录则正确包含了 2026-08-12 起的 Grok 4.6 标准与 200K tier 价。数据以 CC BY 4.0 发布可带署名嵌入项目值得持续关注并可作为历史佐证来源但窄覆盖与 Luna 错误使其现阶段不能作为唯一来源。Agentsview 中的落地现状调研结论与源码的对应调研文档并非停留在纸面——仓库代码已经实现了其中大部分结论可以逐条对照验证。LiteLLM 主源与摄取限制internal/pricing/catalog/litellm.go 中的ModelPricing结构只有六个基础字段input/output/cache-creation/1h cache-creation/cache-read/bands带正则input_cost_per_token_above_([0-9])(k?)_tokens解析整请求上下文带宽见同文件parsePricingBands每个 band 是完整的五元价格组per-token 价格统一换算为每百万 token 价格。正如调研结论所说batch、flex、priority、regional、通用 tiered_pricing 数组等上游字段当前全部被丢弃——这正是Agentsview 当前丢弃了大部分结构是摄取限制而非上游数据缺口的代码级印证。内嵌快照的不可变性与可复现性internal/pricing/fallback.go 通过//go:embed snapshot/litellm_snapshot.json.gz内置离线目录并强制source_ref必须是 40 位十六进制 commitimmutableFallbackSourceRefPattern同时对压缩包、JSON 体积与模型数量设上限1 MiB / 8 MiB / 10 万条防止失控。快照生成器 internal/pricing/cmd/litellm-snapshot/main.go 固定从不可变 LiteLLM commit418c7c6...拉取目录产出带version内容 SHA-256 前 12 位与source_ref的 gzip bundle并额外叠加appendModelOverlay的策展补丁。GenAI Prices 历史层的实现internal/pricing/catalog/genai.go 完整实现了调研所描述的条件 schema——Resolve(providerID, modelID, timestamp)按时间戳选择激活价格genAIConstraint区分 Always / StartDate / TimeOfDay 三种约束active方法处理时间窗含跨午夜区间匹配层支持 equals/startsWith/endsWith/contains/regex/OR/AND 且大小写不敏感tier 数组按阈值排序后合成PricingBand。解析后仍保留原始 JSONRawJSON版本号取内容 SHA-256 前缀——与保留上游 v2 JSON新单位与新条件不需要另造目录格式的建议一致。内嵌副本由 internal/pricing/genai_fallback.go 提供//go:embed snapshot/genai_prices.json.gz存储侧 internal/db/genai_pricing.go 用genai_pricing单例行表保存完整上游文档与embedded/fetched来源标记。先历史、后当前的解析顺序internal/export/pricing.go 的resolveGenAI在事件时间戳非零时优先尝试 GenAI Prices 解析含 canonical model、reported model、effort-tier 基模型、flat 回退模型的多候选回退链命中即返回其价格未命中才落到 LiteLLM 平面目录。这正对应调研建议第 3 条如果有匹配的有效记录就用它否则回退到当前 LiteLLM 价格。此外 internal/pricing/supplemental.go 还实现了调研未覆盖的日期敏感别名机制CanonicalModelForDate用KimiModelEraCutoff2026-07-19 UTC把 kimi-for-coding、daimon-kimi-code 等无日期歧义别名按时间戳映射到 K2.6 或 K3 的 canonical 模型DuckDB 侧 internal/duckdb/analytics_usage.go 在聚合查询内复用同一逻辑。给 Agentsview 的分层数据源建议调研对后续演进给出五条明确建议保留 LiteLLM 作为必需当前目录其在两个目标模型上的覆盖与更新速度已被验证。在引入第二个当前目录之前先扩展 Agentsview 对 LiteLLM 的表示batch、flex、priority、regional、非 token 与通用 tier 数据上游已经存在缺的是解析与存储。用 Pydantic GenAI Prices 作为可选的历史与条件首层命中有效记录就用否则回退当前 LiteLLM保留上游 v2 JSON 原样避免为新单位/新条件发明新格式。把 Portkey 作为当前价的最佳许可交叉核对与潜在替代输入新鲜、结构干净但不提供历史且其 Grok 记录目前缺 200K 带宽。不要引入 tokencost 或 Helicone 作为回退目录tokencost 是 LiteLLM 的过期拷贝Helicone 两个探针模型都不覆盖。OpenRouter 对路由特定缺口有用但没有有效历史也没有明确的开放目录许可RoninForge 是有用证据尚未成为权威。这套安排的最大收益是避免在 Agentsview 内手工维护价格并把两个不同的问题彻底分开广度当前覆盖来自 LiteLLM日期敏感选择来自真正建模日期的窄来源。仓库代码catalog解析器、fallback/genai_fallback内嵌快照、export解析顺序、db存储已经按此分层落地后续迭代只需沿扩展 LiteLLM 字段 保留 GenAI Prices 原样 JSON两个方向推进即可。【免费下载链接】agentsviewLocal-first session search, analytics, insights, and token use statistics for coding agents, supporting Claude Code, Codex, and more than 20 other agents.项目地址: https://gitcode.com/GitHub_Trending/ag/agentsview创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进