{"auto_groups":["default"],"data":[{"model_name":"qwen3.8-max","vendor_id":20,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.125,"create_cache_ratio":1.25,"enable_groups":["DeepSeek","default","Z.ai+kimi","国模","国模-test"],"supported_endpoint_types":["openai"],"pricing_version":"5a90f2b86c08bd983a9a2e6d66c255f4eaef9c4bc934386d2b6ae84ef0ff1f1f"},{"model_name":"gpt-image-2.5-1k","vendor_id":1,"quota_type":1,"model_ratio":0,"model_price":0.004,"owner_by":"","completion_ratio":0,"enable_groups":["GPT-image"],"supported_endpoint_types":["openai"]},{"model_name":"grok-4.7","vendor_id":24,"quota_type":0,"model_ratio":0.8,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.25,"enable_groups":["Grok"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-7","description":"Opus 4.7 是 Anthropic Opus 系列的下一代产品，专为长时间运行的异步代理而设计。它在 Opus 4.6 的编码和代理功能优势基础上，显著提升了复杂多步骤任务的性能，并在扩展工作流中实现了更可靠的代理执行。对于任务随时间展开的异步代理流水线（例如大型代码库、多阶段调试和端到端项目编排），Opus 4.7 尤为有效。\n\n除了编码之外，Opus 4.7 还增强了知识工作能力，涵盖文档撰写、演示文稿制作和数据分析等各个方面。它能够在超长的输出和长时间会话中保持一致性，使其成为需要坚持、判断和执行的任务的理想选择。","vendor_id":29,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-sonnet-4-6","description":"Sonnet 4.6 是 Anthropic 迄今为止功能最强大的 Sonnet 系列产品，在编码、代理和专业工作方面均展现出卓越的性能。它尤其擅长迭代开发、复杂代码库导航、端到端项目管理（含内存管理）、文档创建以及在 Web 质量保证和工作流自动化方面的出色计算机应用。","vendor_id":29,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"deepseek-v4-flash","description":"相比 DeepSeek-V4-Pro，DeepSeek-V4-Flash 在世界知识储备方面稍逊一筹，但展现出了接近的推理能力。而由于模型参数和激活更小，相较之下 V4-Flash 能够提供更加快捷、经济的 API 服务。\n\n在 Agent 测评中，DeepSeek-V4-Flash 在简单任务上与 DeepSeek-V4-Pro 旗鼓相当，但在高难度任务上仍有差距。","vendor_id":4,"quota_type":0,"model_ratio":0.14,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.02,"enable_groups":["DeepSeek","default","test","Z.ai+kimi","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-flash-0731","vendor_id":4,"quota_type":0,"model_ratio":0.15,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.2,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-pro-0813","vendor_id":4,"quota_type":0,"model_ratio":0.66,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.033333333333,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"hy3","quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.5-flash","description":"Google 面向智能体时代的高速高性价比模型，优化多步任务、子代理部署、长周期规划，兼顾前沿能力、低延迟与成本，适合高并发规模化业务场景。","vendor_id":23,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"enable_groups":["Gemini"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"glm-5.1","description":"GLM-5.1 在编码能力方面实现了重大飞跃，尤其在处理长期任务方面取得了显著提升。与以往基于分钟级交互的模型不同，GLM-5.1 可以独立且持续地处理单个任务超过 8 小时，在整个过程中自主进行规划、执行和自我改进，最终交付完整的工程级结果。","tags":"推理模型","vendor_id":6,"quota_type":0,"model_ratio":0.7,"model_price":0,"owner_by":"","completion_ratio":3.142857142857,"cache_ratio":0.557142857143,"enable_groups":["国模 专属算力","国模-test","default","GLM 专属算力","国模"],"supported_endpoint_types":["anthropic"]},{"model_name":"gpt-5.6-terra","description":"OpenAI GPT‑5.6 系列均衡主力模型，兼顾推理、代码生成、结构化提取与通用智能体任务，性能优于前代，成本低于旗舰 Sol，适合日常大规模业务调用。","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default","GPT-plus","GPT-pro"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic"],"billing_mode":"tiered_expr","billing_expr":"len \u003c= 272000 ? tier(\"0_272k\", p * 2 + c * 12 + cr * 0.2 + cc * 2.5) : tier(\"272k_plus\", p * 4 + c * 18 + cr * 0.4 + cc * 5)"},{"model_name":"hy4-preview","quota_type":0,"model_ratio":0.417,"model_price":0,"owner_by":"","completion_ratio":2.998800959233,"cache_ratio":0.05035971223,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"xiaomi/mimo-v2.5","quota_type":0,"model_ratio":0.07,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.02,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"xiaomi/mimo-v2.5-pro","quota_type":0,"model_ratio":0.2175,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.008275862069,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-5-20251101","vendor_id":29,"quota_type":0,"model_ratio":0.8,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.25,"enable_groups":["Claude Max"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"kimi-k3","description":"月之暗面 Moonshot 旗舰 MoE 模型，100 万 token 上下文，原生支持图像、视频多模态输入，长文档理解、软件工程、深度检索能力突出，同时支持 API 与开放权重本地部署。","vendor_id":5,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"enable_groups":["Z.ai+kimi","国模","国模-test","DeepSeek","default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.5","description":"GPT-5.5 是 OpenAI 专为复杂专业工作负载而设计的前沿模型，它在 GPT-5.4 的基础上进行了增强，拥有更强大的推理能力、更高的可靠性以及在处理高难度任务时更高效的词元处理能力。它拥有超过 100 万个词元的上下文窗口（92.2 万个输入，12.8 万个输出），支持文本和图像输入，从而能够在单个系统中实现大规模推理、编码和多模态工作流程。","tags":"推理模型","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default","GPT-plus","GPT-pro"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 272000 ? tier(\"base\", p * 5 + c * 30 + cr * 0.5) : tier(\"第2档\", p * 10 + c * 45 + cr * 1)"},{"model_name":"grok-4.6","description":"xAI 推出的旗舰前沿模型，500K 上下文窗口，支持图像输入，提供多档可配置推理强度，针对智能体、代码开发、知识工作优化，幻觉率低，工具调用能力强","vendor_id":24,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":1,"create_cache_ratio":0.25,"enable_groups":["国模-test","default","Grok"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic","gemini","jina-rerank"]},{"model_name":"gemini-3.1-flash-lite-preview","vendor_id":23,"quota_type":0,"model_ratio":0.125,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"create_cache_ratio":0.33332,"enable_groups":["default","Gemini"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"kimi-k2.7-code","vendor_id":5,"quota_type":0,"model_ratio":0.475,"model_price":0,"owner_by":"","completion_ratio":4.210526315789,"cache_ratio":0.2,"enable_groups":["default","国模","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"meta/muse-spark-1.3","vendor_id":30,"quota_type":0,"model_ratio":0.625,"model_price":0,"owner_by":"","completion_ratio":3.4,"cache_ratio":0.12,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"MiniMax-M2.7","description":"MiniMax-M2.7是专为自主化现实场景生产效率与持续迭代优化打造的新一代大语言模型。该模型可主动参与自身迭代升级，通过多智能体协作融合先进的智能体能力，能够在动态环境中规划、执行并优化复杂任务。\n\nMiniMax-M2.7经训练可达到生产级性能，可处理实时调试、根本原因分析、金融建模，以及Word、Excel、PowerPoint全流程文档生成等工作流。其在多项基准测试中表现优异：SWE-Pro测试得分56.2%，Terminal Bench 2测试得分57.0%，同时在GDPval-AA测试中获得1495的ELO评分，为应用于现实数字工作流的多智能体系统树立了全新标准。","vendor_id":17,"quota_type":0,"model_ratio":0.15,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.2,"enable_groups":["国模","default","MiniMax","test"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gpt-5.6-sol","description":"OpenAI GPT‑5.6 系列旗舰，在编码、科研、网络安全、知识工作取得顶尖效果，效率更强，以更少 token 完成复杂任务，面向最高难度前沿业务场景。","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default","GPT-plus","GPT-pro"],"supported_endpoint_types":["openai","openai-response","anthropic"],"billing_mode":"tiered_expr","billing_expr":"len \u003c= 272000 ? tier(\"0_272k\", p * 4 + c * 20 + cr * 0.4 + cc * 6.25) : tier(\"272k_plus\", p * 6 + c * 32 + cr * 0.6 + cc * 12.5)"},{"model_name":"Qwen/Qwen3.7-Plus","vendor_id":20,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 256000 ? tier(\"base\", p * 0.32 + c * 1.28 + cr * 0.064 + cc * 0.4) : tier(\"第2档\", p * 0.96 + c * 3.84 + cr * 0.192 + cc * 1.2)"},{"model_name":"claude-fable-5-1","vendor_id":29,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.025,"create_cache_ratio":1.25,"enable_groups":["Claude Max","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"glm-5.3-flash","description":"原生多模态 MoE 大模型，百万上下文，兼顾 GUI 智能体与代码能力，用很低推理成本接近全球第一梯队模型水平。","vendor_id":6,"quota_type":0,"model_ratio":0.075,"model_price":0,"owner_by":"","completion_ratio":3.333333333333,"cache_ratio":0.2,"enable_groups":["default","国模","国模-test"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic","gemini"]},{"model_name":"mimo-v2.5","quota_type":0,"model_ratio":0.07,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.02,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4.1-flash","vendor_id":4,"quota_type":0,"model_ratio":0.15,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.2,"enable_groups":["default","国模","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seedance-2-0-260128","vendor_id":28,"quota_type":1,"model_ratio":0,"model_price":1000,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"glm-5.3-flashx","vendor_id":6,"quota_type":0,"model_ratio":0.185,"model_price":0,"owner_by":"","completion_ratio":3.378378378378,"cache_ratio":0.202702702703,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"Qwen/Qwen3.8-Flash","vendor_id":20,"quota_type":0,"model_ratio":0.075,"model_price":0,"owner_by":"","completion_ratio":3.133333333333,"cache_ratio":0.106666666667,"create_cache_ratio":1.333333333333,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"kimi-k2.6","description":"Kimi K2.6 是 Moonshot AI 的下一代多模态模型，专为长期编码、代码驱动的 UI/UX 生成和多智能体编排而设计。它能够处理跨 Python、Rust 和 Go 的复杂端到端编码任务，并将提示和视觉输入转换为可用于生产环境的界面。其智能体集群架构可扩展至数百个并行子智能体，实现自主任务分解——无需人工干预，即可在一次运行中交付文档、网站和电子表格。","vendor_id":31,"quota_type":0,"model_ratio":0.475,"model_price":0,"owner_by":"","completion_ratio":4.210526315789,"cache_ratio":0.168421052632,"enable_groups":["default","Z.ai+kimi","国模"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-pro","description":"Agent 能力大幅提高：相比前代模型，DeepSeek-V4-Pro 的 Agent 能力显著增强。在 Agentic Coding 评测中，V4-Pro 已达到当前开源模型最佳水平，并在其他 Agent 相关评测中同样表现优异。目前 DeepSeek-V4 已成为公司内部员工使用的 Agentic Coding 模型，据评测反馈使用体验优于 Sonnet 4.5，交付质量接近 Opus 4.6 非思考模式，但仍与 Opus 4.6 思考模式存在一定差距。\n\n丰富的世界知识：DeepSeek-V4-Pro 在世界知识测评中，大幅领先其他开源模型，仅稍逊于顶尖闭源模型 Gemini-Pro-3.1。\n\n世界顶级推理性能：在数学、STEM、竞赛型代码的测评中，DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型，取得了比肩世界顶级闭源模型的优异成绩","vendor_id":4,"quota_type":0,"model_ratio":0.435,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.008333333333,"enable_groups":["Z.ai+kimi","国模-test","DeepSeek","default","test"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.8-flash","vendor_id":23,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":0.055533333333,"enable_groups":["default","Gemini"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.6","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["GPT-pro","default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6-astra","description":"A new generation of intelligence. GPT‑6 Astra brings together years of research and big bets across pre-training, reinforcement learning, and alignment.","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":2,"enable_groups":["default","GPT-plus","GPT-pro"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c= 272000 ? tier(\"小于等于272k\", p * 10 + c * 50 + cr * 1 + cc * 12.5) : tier(\"大于272k\", p * 20 + c * 75 + cr * 2 + cc * 25)"},{"model_name":"grok-4.5","vendor_id":24,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.15,"enable_groups":["default","Grok","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-image-2","vendor_id":1,"quota_type":1,"model_ratio":0,"model_price":0.01477,"owner_by":"","completion_ratio":0,"enable_groups":["GPT-image"],"supported_endpoint_types":["image-generation"]},{"model_name":"mimo-v2.5-pro","quota_type":0,"model_ratio":0.2175,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.008275862069,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"MiniMax-M3","description":"MiniMax-M3 是 MiniMax 推出的多模态基础模型。它支持文本、图像和视频输入，并输出文本，拥有 100 万个词元的上下文窗口，适用于长时间的智能体工作、编码和工具使用。该模型基于 MiniMax 稀疏注意力机制 (MSA) 构建，MSA 用键值块选择取代了完整的注意力机制，从而在长时间上下文中大幅降低每个词元的计算量——在 100 万个词元的情况下，其计算成本约为上一代模型的 1/20，同时显著加快了预填充和解码速度，并在大多数任务中保持了质量。\n\n该模型在交错数据上作为原生多模态模型进行训练，并通过交互式用户模拟器框架针对多轮次、类似生产环境的协作进行了调优，因此更适合持续的多步骤任务，而非单轮执行。","vendor_id":17,"quota_type":0,"model_ratio":0.3,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.2,"enable_groups":["default","MiniMax","test","国模","国模-test"],"supported_endpoint_types":["openai","anthropic"]},{"model_name":"claude-opus-5","description":"Anthropic 最高能力旗舰模型，100 万 token 上下文，复杂推理、长文档深度分析、高级编码、工具调用达到行业顶尖水平，适合高难度专业任务与深度智能体工作流。","vendor_id":29,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic"]},{"model_name":"Qwen/Qwen3.8-Max-0902","vendor_id":20,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.125,"create_cache_ratio":1.25,"enable_groups":["国模-test","default"],"supported_endpoint_types":["openai"]},{"model_name":"meta/muse-spark-1.3-contributor","vendor_id":30,"quota_type":0,"model_ratio":0.05,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.02,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.1-flash-lite","vendor_id":23,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.05,"enable_groups":["default","Gemini"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"qwen3.7-max","vendor_id":20,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.2,"create_cache_ratio":1.25,"enable_groups":["default","Z.ai+kimi","国模","DeepSeek"],"supported_endpoint_types":["openai"]},{"model_name":"deepseek-v4-flash-vision-exp","vendor_id":4,"quota_type":0,"model_ratio":0.11,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.031818181818,"enable_groups":["default","国模","国模-test"],"supported_endpoint_types":["openai"]},{"model_name":"claude-fable-5","description":"Claude Fable 5 是 Anthropic 推出的一款 Mythos-class 模型，专为自主知识工作和 coding（编程）而构建。它支持文本、图像和文件输入以及文本输出，具备 reasoning（推理）能力，并拥有 1M-token 的 context window（上下文窗口）。它非常适合处理以往需要频繁人工介入的长周期、复杂且异步的任务。\n\n它在 end-to-end（端到端）工作方面表现尤为出色，能够接手原本需要人类耗费数小时、数天甚至数周才能完成的工作——应对那些耗时长、充满模糊性或高度多步骤的难题。在执行范围明确的任务时，它极少出错，能够通过 verification loops（验证循环）自动进行自我纠错，并配备了强大的 safeguards（安全防护机制）。","vendor_id":29,"quota_type":0,"model_ratio":5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","default"],"supported_endpoint_types":["anthropic"]},{"model_name":"qwen3.8-flash","vendor_id":20,"quota_type":0,"model_ratio":0.075,"model_price":0,"owner_by":"","completion_ratio":3.133333333333,"cache_ratio":0.106666666667,"create_cache_ratio":1.333333333333,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3-flash","vendor_id":23,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"enable_groups":["default","Gemini"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"glm-5.3","description":"智谱 AI 新一代旗舰基座模型，1M 上下文，擅长复杂编程、长程任务与网络安全相关任务，具备强大智能体能力，支持 API 调用与本地权重部署微调。","vendor_id":6,"quota_type":0,"model_ratio":0.7,"model_price":0,"owner_by":"","completion_ratio":3.142857142857,"cache_ratio":0.185714285714,"enable_groups":["DeepSeek","default","Z.ai+kimi","国模","国模-test"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic","gemini","jina-rerank"]},{"model_name":"claude-haiku-4-5-20251001","description":"Claude Haiku 4.5 是 Anthropic 旗下速度最快、效率最高的模型，它以远低于大型 Claude 模型的成本和延迟，提供接近前沿水平的智能。Haiku 4.5 在推理、编码和计算机使用任务方面均达到 Claude Sonnet 4 的性能水平，为实时和高容量应用带来前沿级能力。\n\n它为 Haiku 系列引入了扩展思维功能，支持可控的推理深度、摘要式或交错式思维输出，以及工具辅助工作流程，并全面支持编码、Bash、网络搜索和计算机使用工具。Haiku 4.5 在 SWE-bench Verified 测试中得分超过 73%，跻身世界顶级编码模型之列，同时保持了对子代理、并行执行和规模化部署的卓越响应能力。","vendor_id":29,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-opus-4-6","description":"Opus 4.6 是 Anthropic 针对编码和长期专业任务的最强模型。它专为跨整个工作流程而非单个提示运行的智能体而设计，因此在大型代码库、复杂重构和随时间展开的多步骤调试方面尤为高效。与前几代模型相比，该模型展现出更深入的上下文理解、更强的故障分解能力以及在处理高难度工程任务时更高的可靠性。\n\n除了编码之外，Opus 4.6 在持续的知识工作方面也表现出色。它只需一次即可生成接近生产就绪的文档、计划和分析，并在超长的输出和长时间会话中保持一致性。这使其成为需要坚持、判断和执行力的任务的理想选择，例如技术设计、迁移规划和端到端项目执行。","vendor_id":29,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-opus-4-8","description":"Claude Opus 4.8 是 Anthropic 公司 Opus 系列中最强大的通用模型。它支持文本、图像和文件输入，并输出文本，具备推理功能，上下文窗口大小可达 100 万个标记。它适用于高度自主的智能体、长期智能体工作、知识型工作以及对长时间会话一致性要求较高的内存驱动型任务。\n\n它在多步骤推理、复杂编码和端到端项目编排方面表现尤为出色——能够处理大型代码库、多阶段调试和长时间运行的异步智能体流水线。除了编码之外，它还能处理知识型工作，例如撰写文档、制作演示文稿和分析数据，并能保证输出内容的高质量，即使输出篇幅很长也能保持高质量。","vendor_id":29,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-sonnet-5","description":"高性能均衡模型，可自主规划、调用浏览器 / 终端等工具，以更低成本实现接近高阶模型的智能体能力，兼顾推理、速度与性价比，适配绝大多数企业业务场景。","vendor_id":29,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"create_cache_ratio":1.25,"enable_groups":["Claude Max","Claude-kiro特惠","default"],"supported_endpoint_types":["openai","openai-response","openai-response-compact","anthropic"]},{"model_name":"glm-5.2","vendor_id":6,"quota_type":0,"model_ratio":0.7,"model_price":0,"owner_by":"","completion_ratio":3.142857142857,"cache_ratio":0.185714285714,"enable_groups":["国模-test","DeepSeek","default","Z.ai+kimi","国模","国模 专属算力"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.1-pro-preview","description":"Google 预览版高阶模型，深度复杂推理，强大多模态理解，支持文本、图像、视频输入，面向高难度复杂问题求解、创意生成与高级智能体实验场景。","vendor_id":23,"quota_type":0,"model_ratio":1,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.1,"enable_groups":["Gemini","default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gemini-3.1-pro-preview-low","vendor_id":23,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":4,"enable_groups":["default","Gemini"],"supported_endpoint_types":["gemini","openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 200000 ? tier(\"base\", p * 2 + c * 12 + cr * 0.2 + cc * 0.375) : tier(\"第2档\", p * 4 + c * 18 + cr * 0.4 + cc * 0.375)"},{"model_name":"gpt-5.6-luna","vendor_id":1,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":6,"enable_groups":["default","GPT-plus"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c= 272000 ? tier(\"0_272k\", p * 0.2 + c * 1.2 + cr * 0.02 + cc * 0.25) : tier(\"272k_plus\", p * 0.4 + c * 1.8 + cr * 0.04 + cc * 0.5)"},{"model_name":"MiniMax-M2.7-highspeed","description":"MiniMax-M2.7 是一款新一代大型语言模型，专为实现自主、真实的生产力提升和持续改进而设计。M2.7 能够积极参与自身演化，通过多智能体协作集成先进的智能体功能，使其能够在动态环境中规划、执行和优化复杂任务。\n\nM2.7 经过生产级性能训练，能够处理实时调试、根本原因分析、财务建模以及在 Word、Excel 和 PowerPoint 等文档中生成完整文档等工作流程。它在各项基准测试中均表现出色，例如在 SWE-Pro 和 Terminal Bench 2 测试中分别获得 56.2% 和 57.0% 的分数，并在 GDPval-AA 测试中获得 1495 ELO 评分，为在真实数字工作流程中运行的多智能体系统树立了新的标杆。","vendor_id":17,"quota_type":0,"model_ratio":37.5,"model_price":0,"owner_by":"","completion_ratio":1,"enable_groups":["default","国模"],"supported_endpoint_types":["openai"]},{"model_name":"Qwen/Qwen3.8-27B","vendor_id":20,"quota_type":0,"model_ratio":0.225,"model_price":0,"owner_by":"","completion_ratio":7.111111111111,"cache_ratio":0.111111111111,"enable_groups":["default","国模-test"],"supported_endpoint_types":["openai"]}],"group_ratio":{"Claude Max":0.15,"Claude-kiro特惠":0.045,"GPT-image":1,"GPT-plus":0.03,"GPT-plus 特惠":0.025,"GPT-pro":0.06,"Gemini":0.08,"Grok":0.03,"Grok-image":1,"default":1,"国模":0.4,"国模-test":0.4},"pricing_version":"a42d372ccf0b5dd13ecf71203521f9d2","success":true,"supported_endpoint":{"anthropic":{"path":"/v1/messages","method":"POST"},"embeddings":{"path":"/v1/embeddings","method":"POST"},"gemini":{"path":"/v1beta/models/{model}:generateContent","method":"POST"},"image-generation":{"path":"/v1/images/generations","method":"POST"},"jina-rerank":{"path":"/v1/rerank","method":"POST"},"openai":{"path":"/v1/chat/completions","method":"POST"},"openai-response":{"path":"/v1/completions","method":"POST"},"openai-response-compact":{"path":"/v1/responses/compact","method":"POST"}},"usable_group":{"Claude Max":"纯血Claude Max（限制官方客户端）","Claude-kiro特惠":"Claude-kiro 特惠","GPT-image":"gpt-image-2分组 单次折合 rmb 0.06","GPT-plus":"plus分组 出错切换pro","GPT-plus 特惠":"福利分组 ","GPT-pro":"GPT-pro （满血不降智 pro 尊享）","Gemini":"高并发 1000+rpm ","Grok":"Grok大模型","Grok-image":"","default":"默认","国模":"内含 qwen glm kimi DeepSeek minimax","国模-test":"新资源 test"},"vendors":[{"id":24,"name":"xAI","icon":"XAI"},{"id":27,"name":"快手","icon":"Kling.Color"},{"id":21,"name":"零一万物","icon":"Yi.Color"},{"id":23,"name":"Google","icon":"Gemini.Color"},{"id":4,"name":"DeepSeek","icon":"DeepSeek.Color"},{"id":25,"name":"免费模型free"},{"id":26,"name":"Meta","icon":"Ollama"},{"id":31,"name":"MiniMax","icon":"Minimax.Color"},{"id":1,"name":"OpenAI","icon":"OpenAI"},{"id":5,"name":"Moonshot","icon":"Moonshot"},{"id":6,"name":"智谱","icon":"Zhipu.Color"},{"id":17,"name":"Minimax","icon":"Minimax.Color"},{"id":19,"name":"阿里云百炼","icon":"Qwen.Color"},{"id":22,"name":"Mistral","icon":"Mistral.Color"},{"id":28,"name":"字节跳动","icon":"Doubao.Color"},{"id":29,"name":"Anthropic","icon":"Claude.Color"},{"id":20,"name":"阿里巴巴","icon":"Qwen.Color"},{"id":30,"name":"讯飞","icon":"Spark.Color"}]}