资讯动态

Zed 托管模型详解:Zed-Hosted Models 的定价、上下文窗口、工具能力与源码实现

发布时间:2026/9/7 5:26:04 来源:尧图企业网站定制
Zed 托管模型详解Zed-Hosted Models 的定价、上下文窗口、工具能力与源码实现【免费下载链接】zedCode at the speed of thought – Zed is a high-performance, multiplayer code editor from the creators of Atom and Tree-sitter.项目地址: https://gitcode.com/GitHub_Trending/ze/zed本文围绕 Zed 官方文档中的 Zed-Hosted ModelsZed 托管模型展开讲清楚 Zed 订阅下可用的 Claude / GPT / Gemini 托管模型清单、各家按 1M token 计费的 Zed 价格与供应商原价对照、各模型的上下文窗口大小、近期退役模型迁移指引以及计费规则与数据保留注意事项并结合 Zed 开源仓库中的language_models、cloud_llm_client等 crate 源码说明托管模型列表如何下发、能力标志工具调用、思考模式等如何建模、请求如何经 Zed 云端路由到上游供应商。读完本文你可以完成托管模型的选型与成本估算并理解 Zed 客户端侧支撑这些模型的服务端协议。托管模型概述与适用前提Zed 的付费计划提供主流大模型的托管版本其速率限制高于直接调用供应商 API 的默认限制模型可用性会定期更新。如果不希望走 Zed 托管也可以改用自有 API key对应文档为 LLM Providers通用接入流程见 AI Quick Start。需要注意的准入限制Claude Fable 5、Claude Opus 系列、GPT-5.5 pro、GPT-5.4 pro 仅对 Zed Pro 与 Zed Business 计划开放Zed 编辑器本身无需订阅即可使用但托管模型属于 Zed Pro / Student / Business 等付费计划的权益免费计划无法使用计划权益对照可参考 Plans Pricing试用Trial结束会自动转为 Zed Free且试用期间不提供 Anthropic Opus 系列模型。从源码结构看客户端侧的托管模型能力门槛正是这样实现的cloud.rs 中settings_view会根据user_store.plan()返回ZedPro、ZedProTrial、ZedStudent、ZedBusiness、ZedVip等不同状态渲染“Subscribed to Pro”等提示文案当组织配置is_zed_model_provider_enabled为 false 时Business 组织成员会看到“Zeds hosted models are disabled by your organizations configuration”的禁用说明。也就是说托管模型是否可用由“登录态 计划类型 组织配置”三者共同决定。模型清单与定价按 1M token 计价下表完整继承官方文档的定价信息。Zed 的计费规则为所有托管模型使用均按最右侧“Zed Price”列计费该价格为供应商官方列表价上浮 10%与 Plans Pricing 中 “list price from the provider, 10%” 的说明一致。AnthropicClaude 系列ModelToken TypeProvider Price per 1M tokensZed Price per 1M tokensClaude Fable 5Input$10.00$11.00Output$50.00$55.00Input - Cache Write$12.50$13.75Input - Cache Read$1.00$1.10Claude Opus 5Input$5.00$5.50Output$25.00$27.50Input - Cache Write$6.25$6.875Input - Cache Read$0.50$0.55Claude Opus 4.5 / 4.6 / 4.7 / 4.8Input$5.00$5.50Output$25.00$27.50Input - Cache Write$6.25$6.875Input - Cache Read$0.50$0.55Claude Sonnet 5Input$2.00$2.20Output$10.00$11.00Input - Cache Write$2.50$2.75Input - Cache Read$0.20$0.22Claude Sonnet 4.5 / 4.6Input$3.00$3.30Output$15.00$16.50Input - Cache Write$3.75$4.125Input - Cache Read$0.30$0.33Claude Haiku 4.5Input$1.00$1.10Output$5.00$5.50Input - Cache Write$1.25$1.375Input - Cache Read$0.10$0.11原文档说明上表中 Claude Sonnet 5 的价格采用的是 Anthropic 到 2026 年 8 月 31 日为止的引入期introductory定价。OpenAIGPT 系列ModelToken TypeProvider Price per 1M tokensZed Price per 1M tokensGPT-5.6 SolInput$5.00$5.50Output$30.00$33.00Input - Cache Write$6.25$6.875Cached Input$0.50$0.55GPT-5.6 TerraInput$2.50$2.75Output$15.00$16.50Input - Cache Write$3.125$3.4375Cached Input$0.25$0.275GPT-5.6 LunaInput$1.00$1.10Output$6.00$6.60Input - Cache Write$1.25$1.375Cached Input$0.10$0.11GPT-5.5 proInput$30.00$33.00Output$180.00$198.00GPT-5.5Input$5.00$5.50Output$30.00$33.00Cached Input$0.50$0.55GPT-5.4 proInput$30.00$33.00Output$180.00$198.00GPT-5.4Input$2.50$2.75Output$15.00$16.50Cached Input$0.025$0.0275GPT-5.3-CodexInput$1.75$1.925Output$14.00$15.40Cached Input$0.175$0.1925GPT-5.2 / GPT-5.2-CodexInput$1.75$1.925Output$14.00$15.40Cached Input$0.175$0.1925GPT-5 miniInput$0.25$0.275Output$2.00$2.20Cached Input$0.025$0.0275GPT-5 nanoInput$0.05$0.055Output$0.40$0.44Cached Input$0.005$0.0055GoogleGemini 系列ModelToken TypeProvider Price per 1M tokensZed Price per 1M tokensGemini 3.1 ProInput$2.00$2.20Output$12.00$13.20Gemini 3.5 FlashInput$1.50$1.65Output$9.00$9.90Gemini 3 FlashInput$0.50$0.55Output$3.00$3.30注意Gemini 计费特殊性Zed 托管的 Gemini 模型不使用 Google 的上下文缓存context caching因此 Gemini 只按 input 和 output token 计费没有单独的 cached-input 价格。这样做的目的是保持托管 Gemini 请求的“零数据保留zero-data-retention”行为官方文档引用了 Google Vertex AI 关于 context caching 与 zero data retention 的公开说明作为背景。选型速览从价格梯度看最轻量的选项是 GPT-5 nanoZed 价 $0.055 / $0.44 每百万输入/输出 token与 Gemini 3 Flash$0.55 / $3.30中档主力是 Claude Sonnet 5、GPT-5.6 Luna/Terra 与 Gemini 3.5 Flash旗舰档位为 Claude Fable 5、GPT-5.6 Sol、GPT-5.5 pro 与 GPT-5.4 pro其中 pro 级 OpenAI 模型输出价高达 $198/1M且仅 Pro/Business 计划可用。Claude 与 GPT 系列普遍提供缓存写入/缓存读取的独立计价重复上下文越多的长会话缓存读取价格约为普通输入价的 10% 左右会显著影响实际成本。上下文窗口Context Windows上下文窗口是 LLM 一次能考虑的最大文本跨度输入提示词 输出内容的总和。Zed 托管模型的上下文窗口如下表完整继承自官方文档ModelProviderZed-Hosted Context WindowClaude Fable 5Anthropic1MClaude Opus 5Anthropic1MClaude Opus 4.5Anthropic200kClaude Opus 4.6Anthropic1MClaude Opus 4.7Anthropic1MClaude Opus 4.8Anthropic1MClaude Sonnet 5Anthropic1MClaude Sonnet 4.5Anthropic200kClaude Sonnet 4.6Anthropic1MClaude Haiku 4.5Anthropic200kGPT-5.6 Sol / Terra / LunaOpenAI272k input / 400k totalGPT-5.5 proOpenAI272k input / 400k totalGPT-5.5OpenAI272k input / 400k totalGPT-5.4 proOpenAI272k input / 400k totalGPT-5.4OpenAI272k input / 400k totalGPT-5.3-CodexOpenAI272k input / 400k totalGPT-5.2OpenAI272k input / 400k totalGPT-5.2-CodexOpenAI272k input / 400k totalGPT-5 miniOpenAI272k input / 400k totalGPT-5 nanoOpenAI272k input / 400k totalGemini 3.1 ProGoogle200kGemini 3.5 FlashGoogle1MGemini 3 FlashGoogle1M官方文档说明Zed 当前将托管的 Gemini 3.1 Pro 请求限制在 200k token 以内原因是超过该上下文的定价会发生变化。使用建议原文档强调每个 Agent thread 各自维护独立的上下文窗口会话中提示词、附加文件与响应越多上下文占用越大。建议为每个不同任务开启新的 thread以聚焦上下文。从源码结构看上下文上限并非写死在客户端cloud_llm_client.rs 中的LanguageModel结构体携带max_token_count普通模式上限、max_token_count_in_max_mode扩展模式上限与max_output_tokens输出上限三个字段这些值由 Zed 云端在模型列表接口中随模型一起下发CloudModelProvider收到ListModelsResponse后调用update_models写入内存供线程创建时选择与限额校验使用。近期退役模型及迁移指引Zed 已不再提供以下模型官方文档给出的迁移路径如下退役模型建议迁移到Claude Opus 4.1Claude Opus 4.5 / 4.6 / 4.7 / 4.8Claude Sonnet 4Claude Sonnet 4.5 或 4.6Claude Sonnet 3.72026-02-19 退役Claude Sonnet 4.5 或 4.6GPT-5.1、GPT-5GPT-5.2 或 GPT-5.2-CodexGemini 2.5 ProGemini 3.1 ProGemini 3 Pro2026-03-26 退役Gemini 3.1 ProGemini 2.5 FlashGemini 3 Flash 或 Gemini 3.5 FlashGrok 4、Grok 4 Fast、Grok 4 Fast (Non-Reasoning)、Grok Code Fast 12026-05-15 退役Zed 已不再提供托管 xAI 模型如果你的 Agent thread 或自动化流程中引用了上述模型 ID需要按此表切换到继任模型Zed 云端模型列表接口同时下发default_model、default_fast_model与recommended_models见 cloud_llm_client.rs 中的ListModelsResponse客户端在模型下线后会拿到更新后的默认与推荐列表避免继续指向已退役模型。计费规则、限额与数据保留计费与用量任何 Zed 托管模型的使用都按上文“Zed Price”列供应商列表价 10%计费详见 Plans Pricing。Zed Pro 每月含 $5 token 额度超额按上述费率计Pro 试用含 $14 天可用的 $20 额度。原文档同时提醒LLM 可能陷入无效循环unproductive loops而需要用户介入对长时间运行的任务要随时监控并在必要时中断——这也是控制 token 消耗的实际手段。在 Billing 页面可配置Monthly Spend LimitPro 用户默认 $10不包含订阅内 $5 额度达到限额后托管模型使用会停止直到月度重置。数据保留警示必读官方文档明确警示Anthropic 会保留发送到 Claude Fable 5 的 prompt 与输出至少 30 天用于信任与安全trust and safety目的。对此“不用于训练”的承诺依然成立Zed 自身不保留你的 prompt 或输出该保留发生在供应侧属于 Covered Models 的全平台强制保留Zed 无法退出opt out即使用自有 API key 调用这些模型也无法避开其余 Zed 托管模型保持零数据保留处理。这一政策在 Privacy and Security 文档 的 “Provider Safety Retention for Designated Models” 一节有完整展开。若你不想接受供应侧保留应选择供应商未指定安全保留的模型。从源码看客户端甚至为此内置了确认门cloud.rs 中ClientTokenProvider::has_data_retention_consent读取设置项anthropic_retention即客户端会对用户就 Anthropic 保留政策取得显式同意状态后再发起相应请求。工具调用Tool Calls能力官方文档指出模型可以通过工具Tools与你的代码交互、搜索网页并执行其他实用功能。工具是托管模型在 Agent Panel 中发挥价值的关键Zed 内置工具包括读/搜类read_file、list_directory、find_path、grep、diagnostics、fetch编辑类edit_file、write_file、create_directory、move_path、copy_path、delete_path、terminal其他search_web仅 Zed Pro 订阅 Zed provider 可用、skill加载技能指令、spawn_agent派生子代理拥有独立上下文窗口。在托管模型侧工具能力由云端下发字段声明LanguageModel结构体中的supports_tools、supports_streaming_tools、supports_parallel_tool_calls注释标明仅 OpenAI 与 xAI 使用等布尔字段决定了线程 UI 中可开启的工具相关选项。换言之某个托管模型能否用工具、是否支持并行工具调用均以模型列表接口下发为准而非客户端硬编码。客户端如何接入托管模型源码级补充以下机制帮助理解托管模型在 Zed 中的实际运行链路均在 crates/language_models/src/provider/cloud.rs 与 crates/cloud_llm_client/src/cloud_llm_client.rs 中认证与令牌托管模型走 Zed 账户登录态CloudLanguageModelProvider::is_authenticated检查client::Status与UserStore当前用户ClientTokenProvider负责为当前组织缓存/刷新 LLM tokencached_llm_token/refresh_llm_token。云端响应头x-zed-expired-token与x-zed-outdated-token分别指示令牌“过期”与“结构过期”客户端据此触发刷新。模型列表动态刷新State订阅了用户信息变化、全局 LLM token 刷新事件与云端重连事件并实现了带抖动jitter的防抖刷新MODELS_REFRESH_DEBOUNCE为 5 分钟 随机抖动保证“模型可用性定期更新”而不会形成刷新风暴登出时会清空缓存的模型列表测试sign_out_hides_cached_cloud_models验证了该行为。请求路由与流式状态完成请求体CompletionBody携带providerAnthropic / OpenAi / Google / XAi 等、model与原始provider_request说明 Zed 云端是统一入口、按供应商转发流式响应中的CompletionRequestStatus枚举包含Queued { position }、Started、Failed { code, message, retry_after }、StreamEnded等状态客户端可据此展示排队位置与失败重试间隔。Fast Mode 计费透传fast_mode_confirmation中的 UI 文案说明“Fast mode 将请求路由到上游供应商的快速模式/优先档上游的高级按 token 定价会直接透传到你的 Zed 账单”这与定价表中 pro 级模型高昂的输出单价相呼应——选择快速/优先通道时需意识到成本变化。总结Zed 托管模型的价值在于“订阅即接入 更高速率限制 统一计费”覆盖 Claude Fable 5 / Sonnet / Haiku、GPT-5.x 与 Gemini 3 系列三大供应商选型时对照三张表即可价格表注意 Sonnet 5 引入期定价与 Gemini 无缓存价、上下文窗口表1M 级Claude Fable 5、Sonnet 5、Opus 5/4.6/Gemini 3 Flash 系GPT 系统一 272k input/400k totalGemini 3.1 Pro 限 200k、退役迁移表计费上以 Zed Price供应商价 10%为准配合月度额度与 Spend Limit 控制成本数据合规上唯一例外是 Claude Fable 5 的供应侧 30 天安全保留敏感场景应改选其他托管模型客户端侧的认证、模型列表、能力标志与流式状态均由 Zed 云端动态下发LanguageModel/ListModelsResponse/CompletionRequestStatus因此模型能力与可用性以运行时下发为准本文表格反映的是当前仓库文档快照。【免费下载链接】zedCode at the speed of thought – Zed is a high-performance, multiplayer code editor from the creators of Atom and Tree-sitter.项目地址: https://gitcode.com/GitHub_Trending/ze/zed创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价