{"auto_groups":[],"data":[{"model_name":"glm-5.2","description":"GLM-5.2是智谱AI面向长程任务（Long Horizon Task）设计的新一代开源旗舰模型，支持1M无损超长上下文。具备卓越的编程与工程能力，可自主完成任务拆解、架构设计、前后端开发、联调测试到多端部署的完整链路，适用于复杂工程任务、长程交互、代码生成、企业应用等场景。","tags":"code,旗舰全能,文本处理","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":3.428571428571,"cache_ratio":0.257142857143,"enable_groups":["default"],"supported_endpoint_types":["openai"],"pricing_version":"5a90f2b86c08bd983a9a2e6d66c255f4eaef9c4bc934386d2b6ae84ef0ff1f1f"},{"model_name":"gemini-3.1-pro-preview","description":"Gemini 3.1 Pro Preview 是 Google 推出的预览版旗舰推理模型，重点提升复杂推理、代码生成、Agent 工具调用及多步骤任务执行能力。模型具备更高的事实一致性、更优的 Token 效率，并支持最长 100 万 Token 上下文窗口，可处理超长文档、代码库及多模态输入，适用于软件开发、企业智能体、科研分析和复杂业务场景。","tags":"code,多模态,旗舰全能","vendor_id":20,"quota_type":0,"model_ratio":1.95,"model_price":0,"owner_by":"","completion_ratio":6.410256410256,"cache_ratio":0.102564102564,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gpt-5.5","description":"GPT-5.5 是一款性能进一步提升的通用大模型，在代码生成、复杂推理和多轮对话方面表现更强。相比前代版本，其在稳定性、上下文理解及响应质量上有明显优化，适用于开发辅助、内容生成、数据分析等多种场景，同时在性能与成本之间保持良好平衡，适合作为中高阶应用的核心模型。","tags":"通用大模型,code,多模态","vendor_id":8,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":5.6,"cache_ratio":0.096,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-7","description":"Claude Opus 4.7 是 Anthropic 2026 年 4 月推出的旗舰开放模型。擅长复杂代码、长周期 Agent 任务，指令遵循更强；支持最高 2576px 高清图像解析，视觉细节识别大幅提升，适配图表、截图精读，拥有百万级上下文，适合高难度专业推理与多模态复杂工作。","tags":"code,多模态,旗舰全能","vendor_id":19,"quota_type":0,"model_ratio":1.3,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.115384615385,"create_cache_ratio":1.230769230769,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gpt-image-2","description":"OpenAI 2026 年 4 月发布旗舰图像生成模型（ChatGPT Images 2.0），搭载思考模式，指令遵循、空间逻辑大幅升级。中文等多语种文字渲染准确率极高，支持自定义画幅、最高 2K 输出，擅长海报、界面、图文排版，适配商业设计、对话式迭代修图。","tags":"图像生成,商业设计","vendor_id":8,"quota_type":1,"model_ratio":0,"model_price":0.08,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["image-generation","openai"],"billing_mode":"tiered_expr","billing_expr":"tier(\"base\", fixed(0.08))"},{"model_name":"happyhorse-1.0-i2v","description":"HappyHorse-1.0-I2V支持图生视频，具备高度还原的动态画面生成能力，能够精准理解文本语义，输出流畅自然、细节丰富的高质量视频。换算成秒是1.5元/秒","tags":"视频生成","vendor_id":2,"quota_type":0,"model_ratio":0.00005,"model_price":0,"owner_by":"","completion_ratio":500000,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kimi-k3","description":"Kimi K3 是 Kimi 迄今能力最强的旗舰模型，拥有 2.8 万亿参数，基于 KDA 混合线性注意力机制（Kimi Delta Attention）和注意力残差（Attention Residuals）技术构建，原生支持视觉理解，并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型，面向长程编程、知识工作和推理等前沿智能场景而设计。","tags":"文本生成,旗舰模型","vendor_id":17,"quota_type":0,"model_ratio":8,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-haiku-4-5","description":"Claude Haiku 4.5，Anthropic 2025 年 10 月发布轻量高速模型，支持 200K 上下文。首代 Haiku 搭载扩展思考与 Computer Use，代码能力对标 Sonnet 4，速度更快、成本仅约其三分之一。主打低延迟实时对话、批量任务、轻量 Agent，适合高并发规模化部署。","tags":"高性价比,快速响应","vendor_id":19,"quota_type":0,"model_ratio":0.35,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.257142857143,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"glm-image","description":"GLM-Image 是智谱新旗舰图像生成模型， 模型全程基于国产芯片完成训练，采用独创的「自回归+扩散解码器」混合架构，兼顾全局指令理解与局部细节刻画，克服了海报、PPT、科普图等知识密集型场景生成难题，是面向以 Nano Banana Pro 为代表的新一代「认知型生成」技术范式的一次重要探索。\n推荐常用尺寸： 1280x1280 、 1568x1056 、 1056x1568 、 1472x1088 、 1088x1472 、 1728x960 、 960x1728。","tags":"图像生成","vendor_id":3,"quota_type":1,"model_ratio":0,"model_price":0.15,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"tier(\"base\", fixed(0.15))"},{"model_name":"grok-4.5","description":"500K 上下文，支持图文输入，推理速度快。深度优化代码开发、代码审查与 AI 智能体工作流，支持工具调用，Token 效率高，适合大型项目开发、长文档分析、自动化任务搭建。","tags":"多模态,code,长文档处理","vendor_id":22,"quota_type":0,"model_ratio":0.6,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"deepseek-flash","description":"DeepSeek V4.1 Flash 是 DeepSeek 发布的最小尺寸旗舰模型，原生支持多模态视觉理解，API 模型名为 deepseek-flash。该模型为 552B 参数 MoE 架构，输入激活仅 8B，输出激活 16B，推理成本显著降低","tags":"多模态,旗舰模型","vendor_id":1,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.133333333333,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.6-plus","description":"Qwen3.6原生视觉语言系列Plus模型，展现出与当前顶尖前沿模型相媲美的卓越性能，模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。","tags":"深度思考,视觉理解,文本生成","vendor_id":2,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":4.8,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.7-flash","description":"Gemini‑3.7‑Flash 是谷歌 2026 年 8 月发布的高性价比多模态主力模型抖音百科。拥有 1M 上下文、64K 输出，支持图文音视频输入，强化代码与智能体能力，可自定义推理模式，兼顾速度、成本与复杂任务表现，适配开发与企业工作流","tags":"多模态,code,复杂任务","vendor_id":20,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":4.8,"cache_ratio":0.133333333333,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"claude-fable-5","description":"Claude Fable 5 是一款偏向创意表达与叙事能力优化的大模型，在故事生成、文案创作和情感表达方面表现突出。其语言风格自然流畅，适合用于内容创作、品牌文案及交互式故事场景，同时兼顾一定的逻辑能力，能够在创意与实用之间取得良好平衡。","tags":"高新能,期间全能","vendor_id":19,"quota_type":0,"model_ratio":2.25,"model_price":0,"owner_by":"","completion_ratio":4.888888888889,"cache_ratio":0.144444444444,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"glm-5v-turbo","description":"GLM-5V-Turbo 是智谱首个多模态 Coding 基座模型，面向视觉编程任务打造。能够原生处理图片、视频、文本等多模态输入，同时擅长长程规划、复杂编程和动作执行；深度适配 Agent 工作流，能够与 Claude Code、OpenClaw 等 Agent 深度协同，完成”看懂环境→规划动作→执行任务”的完整闭环。","tags":"视觉理解,多模态","vendor_id":3,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":4.4,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 32000 ? tier(\"base\", p * 5 + c * 22 + cr * 1.5) : tier(\"tier_2\", p * 7 + c * 26 + cr * 2)"},{"model_name":"deepseek-v4-pro","description":"旗舰级 MoE 大模型，总参1.6T、激活 49B，原生支持百万级超长上下文。依托海量高质量训练数据，具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力，适配高阶科研、复杂办公、深度智能代理等高难度场景。","tags":"深度思考,旗舰全能,code","vendor_id":1,"quota_type":0,"model_ratio":1.6,"model_price":0,"owner_by":"","completion_ratio":3.125,"cache_ratio":0.09375,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.6-27b","description":"Qwen3.6系列27B原生视觉语言Dense模型，模型效果相较3.5-27B重点提升了Agentic coding能力、模型STEM与推理能力进一步增强；视觉模态方面在空间智能、物体定位与检测能力上显著增强，视频理解、文档OCR及视觉Agent能力稳步提升。","tags":"视觉理解,文本生成","vendor_id":2,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":6.666666666666667,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seed-2-0-code-preview-260215","description":"Doubao-Seed-2.0-Code 面向企业级编程需求优化，在 Seed 2.0 优秀的 Agent、VLM 能力基础上，特别增强了代码能力，不仅前端能力表现出众，也对企业常见的多语言编码需求做了特别优化，适合接入各种 AI 编程工具使用。","tags":"深度思考,code","vendor_id":9,"quota_type":0,"model_ratio":1.8,"model_price":0,"owner_by":"","completion_ratio":4.722222222222,"cache_ratio":0.194444444444,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-sonnet-4-6","description":"Claude Sonnet 4.6，Anthropic 2026 年 2 月发布中端主力模型，支持百万 token 上下文。代码、智能体、计算机操作能力大幅增强，性能贴近 Opus 4.6，成本更低。擅长批量开发、文档分析、自动化 Agent 任务，兼顾速度与推理质量，适合规模化商用场景。","tags":"code,多模态","vendor_id":19,"quota_type":0,"model_ratio":0.8,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.125,"create_cache_ratio":1.1875,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"gemini-3.5-flash","description":"Gemini 3.5 Flash 是 Google 推出的高性价比多模态模型，主打低延迟与高吞吐，适合实时对话、内容生成与轻量推理任务。相比 Pro 系列，Flash 在保证基础智能能力的同时显著降低成本，支持文本、图像等多模态输入，并具备较强的代码生成与理解能力，广泛应用于聊天机器人、自动化工具与前端交互等场景。","tags":"多模态,code,高性价比","vendor_id":20,"quota_type":0,"model_ratio":0.75,"model_price":0,"owner_by":"","completion_ratio":6.666666666667,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"gemini-3.6-flash","description":"Gemini 3.6 Flash是Google DeepMind推出的通用主力多模态大模型，作为3.5 Flash迭代版本，支持文本、图像、音视频输入，拥有百万级上下文窗口。模型优化代码生成、工具调用与智能体任务，显著减少冗余输出，Token消耗相比前代降低约17%，推理速度更快、调用成本下调，适合批量文档处理、自动化Agent、开发运维等规模化商用场景。","tags":"多模态,code","vendor_id":20,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":4.8,"cache_ratio":0.133333333333,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"wan2.7-i2v","description":"万相2.7-图生视频，演绎能力全面升级，文戏情感细腻自然，动作戏激烈拳拳到肉，搭配更富有戏剧性和节奏感的镜头切换，实现更强表演能力。","tags":"视频生成","vendor_id":2,"quota_type":1,"model_ratio":0,"model_price":3,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_usage_schema":{"resolution":{"enum":["720P","1080P"],"description":{"en":"Output video resolution","zh":"输出视频分辨率"},"enumLabels":{"1080P":{"en":"1080P","zh":"1080P"},"720P":{"en":"720P","zh":"720P"}}},"seconds":{"type":"number","unit":"second","description":{"en":"Video generation unit price","zh":"视频生成单价"}}}},{"model_name":"doubao-seed-2-0-mini-260428","description":"量均衡型全模态模型，支持文本、图片、语音、视频四模态理解与跨模态推理。精简推理链路以提升响应效率和运行稳定性，强化多语种及小语种处理能力，适用于通用轻量化多模态解析场景。","tags":"深度思考,视觉理解","vendor_id":9,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-sonnet-5","description":"Claude Sonnet 5 是一款注重综合能力与稳定性的中高端大模型，在代码生成、文本理解和多轮对话方面表现优秀。相比轻量模型，其在复杂任务处理和逻辑推理上更为可靠，适用于开发辅助、内容创作及企业级应用场景，同时在性能与成本之间取得良好平衡。","tags":"code,文本理解,多模态","vendor_id":19,"quota_type":0,"model_ratio":0.6,"model_price":0,"owner_by":"","completion_ratio":4.666666666667,"cache_ratio":0.138039215687,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"deepseek-v4-flash","description":"高效轻量化MoE模型，总参284B，激活13B，原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉，综合能力均衡，主打高并发、轻量化任务，适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。","tags":"文本生成,深度思考","vendor_id":1,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":2.6,"cache_ratio":0.3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"Qwen/Qwen3.5-4B","description":"Qwen3.5-4B 是通义千问团队推出的原生多模态大语言模型，拥有 4B 参数，是 Qwen3.5 系列中最轻量的 Dense 模型。该模型采用门控 Delta 网络与门控注意力相结合的高效混合架构，原生支持 256K 上下文长度，并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力，支持文本、图像和视频理解，在同规模模型中表现优异，多项指标超越 GPT-5-Nano 和 Gemini-2.5-Flash-Lite。模型默认启用思考模式（Thinking Mode），支持工具调用，并覆盖 201 种语言和方言","tags":"视觉,推理模型","vendor_id":2,"quota_type":0,"model_ratio":0.1,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-image-2.5","description":"gpt-image-2.5 系列*，画质 \u003e gpt-image-2，延迟直接砍半，适合批量 / 快速迭代","tags":"画质好,速度快,生图","vendor_id":8,"quota_type":1,"model_ratio":0,"model_price":0.1,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["image-generation","openai"],"billing_mode":"tiered_expr","billing_expr":"tier(\"base\", fixed(0.1))"},{"model_name":"kimi-k2.7-code","description":"kimi-k2.7-code是 kimi 迄今最智能的coding模型，在长上下文中更可靠地遵循指令，能以更高的成功率完成编程任务，同时支持文本、图片与视频输入，思考模式，对话与 Agent 任务。","tags":"视觉理解,Code,深度思考","vendor_id":17,"quota_type":0,"model_ratio":3.25,"model_price":0,"owner_by":"","completion_ratio":4.153846153846,"cache_ratio":0.215384615385,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.4","description":"GPT-5.4 是一款性能均衡的通用大模型，具备良好的文本理解、代码生成与多轮对话能力。相比早期版本，在稳定性与响应速度上有所提升，适用于内容生成、代码辅助、数据处理等常见场景。同时具备较好的成本控制能力，适合作为日常开发与企业应用中的基础模型使用。","tags":"文本理解,code,多模态","vendor_id":8,"quota_type":0,"model_ratio":0.65,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.107692307692,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.4-mini","description":"GPT-5.4-mini 是一款轻量级通用模型，主打高性价比与快速响应能力。具备基础的文本理解、简单代码生成和多轮对话能力，适用于日常问答、轻量内容生成及基础开发辅助等场景。在保证可用性的同时有效降低成本，适合作为高频调用或中转网关中的经济型模型选择。","tags":"高性价比,快速响应","vendor_id":8,"quota_type":0,"model_ratio":0.25,"model_price":0,"owner_by":"","completion_ratio":6,"cache_ratio":0.3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seed-1-8-251228","description":"Doubao-Seed-1.8 面向多模态 Agent 场景定向优化。Agent 能力上，Tool Use、复杂指令遵循等能力均大幅增强。多模态理解方面，视觉基础能力显著提升，可低帧率理解超长视频，视频运动理解、复杂空间理解及文档结构化解析能力也有所优化，还原生支持智能上下文管理，用户可配置上下文策略。","tags":"深度思考,视觉理解","vendor_id":9,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-6-astra","description":"GPT‑6‑Astra 是 OpenAI2026 年 9 月发布的新一代旗舰大模型新华网。拥有 105 万上下文窗口，强化深度推理、计算机操作、编程与网络安全能力，擅长复杂多步骤智能体任务，支持图文输入，面向专业科研、工程与企业工作场景，逐步向订阅及 API 用户开放Azure AI F...","tags":"旗舰模型,code,多模态","vendor_id":8,"quota_type":0,"model_ratio":2.5,"model_price":0,"owner_by":"","completion_ratio":5.2,"cache_ratio":0.09,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-fable-5-1","description":"Anthropic 顶尖通用大模型，1M 上下文，最大输出 128K。擅长长周期 Agent 任务、复杂编码、多步骤科研与文档处理，推理能力强，缓存读取费用大幅降低，适合高难度复杂工作流，有安全防护限制高危领域调用","tags":"复杂编码,旗舰模型,code","vendor_id":19,"quota_type":0,"model_ratio":10,"model_price":0,"owner_by":"","completion_ratio":4.75,"cache_ratio":0.09,"create_cache_ratio":1.1,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"grok-4.3","description":"支持图文多模态输入，拥有 1M 上下文窗口。自带可调深度推理，擅长复杂逻辑分析、代码处理与工具调用，幻觉控制优秀，适合长文档解读、智能体自动化、专业数据分析场景。","tags":"多模态,code,长文档处理","vendor_id":22,"quota_type":0,"model_ratio":0.4,"model_price":0,"owner_by":"","completion_ratio":2.25,"cache_ratio":0.1875,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"qwen3.5-27b","description":"Qwen3.5系列27B原生视觉语言Dense模型，融合了线性注意力机制；响应速度快，兼具推理速度和性能。该模型的综合能力接近于Qwen3.5-122B-A10B。","tags":"视觉理解,文本生成","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":5,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 120000 ? tier(\"base\", p * 0.7 + c * 5) : tier(\"tier_2\", p * 2 + c * 15)"},{"model_name":"gemini-3.8-flash","description":"Gemini‑3.8‑Flash，谷歌 2026‑09 发布，迭代自 3.7‑Flashstorage.go...。1M 上下文、64K 输出，全模态输入，强化代码、Agent 与多步推理，支持可调推理强度，速度成本不变，面向生产级智能体与开发场景","tags":"推理强,code,多模态","vendor_id":20,"quota_type":0,"model_ratio":1.5,"model_price":0,"owner_by":"","completion_ratio":4.8,"cache_ratio":0.133333333333,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"glm-5.3","description":"依靠大规模后训练实现能力跃升。编程能力较上代提升 50%，长程软件工程、终端 Agent 表现突出，网络安全漏洞挖掘能力涌现，多项基准位居开源前列。支持 200K 上下文、128K 最大输出，适配代码开发、安全审计、工具调用场景，API 已开放，权重后续开源，适合开发与安全场景调用。","tags":"code,旗舰模型","vendor_id":3,"quota_type":0,"model_ratio":3.5,"model_price":0,"owner_by":"","completion_ratio":3.428571428571,"cache_ratio":0.214285714286,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.7-plus","description":"Qwen3.7系列中高性价比Plus模型，在强大文本能力的基础上全面升级了视觉-语言能力，同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力，能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。\n\n该模型版本功能等同于快照模型qwen3.7-plus-2026-05-26","tags":"文本生成,视觉理解,深度思考","vendor_id":2,"quota_type":0,"model_ratio":0.8,"model_price":0,"owner_by":"","completion_ratio":4.0625,"cache_ratio":0.25,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gemini-3.5-flash-lite","description":"Gemini 3.5 Flash Lite 是一款轻量级高效模型，主打低成本与极速响应，适合高频调用场景。具备基础的文本理解、简单推理及内容生成能力，可用于日常问答、轻量文案和自动化任务处理。在保证可用性的同时大幅降低算力消耗，适合作为中转网关或批量任务中的经济型选择。","tags":"文本理解,高性价比","vendor_id":20,"quota_type":0,"model_ratio":0.55,"model_price":0,"owner_by":"","completion_ratio":8.727272727273,"cache_ratio":0.109090909091,"enable_groups":["default"],"supported_endpoint_types":["gemini","openai"]},{"model_name":"grok-4.6","description":"xAI 2026 前沿旗舰模型。500K 上下文，支持图文输入、工具调用。重点强化长链路 Agent 智能体、复杂代码工程、知识分析任务，评测追平 GPT‑5.6，推理档位可调，API 定价具备优势，适合自动化与开发场景","tags":"旗舰模型,code,多模态","vendor_id":22,"quota_type":0,"model_ratio":0.7,"model_price":0,"owner_by":"","completion_ratio":2.625,"cache_ratio":0.228571428571,"enable_groups":["default"],"supported_endpoint_types":["openai","openai-response"]},{"model_name":"qwen3.5-flash","description":"Qwen3.5原生视觉语言系列Flash模型，基于混合架构设计，融合了线性注意力机制与稀疏混合专家模型，实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步；响应速度快，兼具推理速度和性能。","tags":"深度思考,视觉理解,文本生成","vendor_id":2,"quota_type":0,"model_ratio":0.1,"model_price":0,"owner_by":"","completion_ratio":9,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.7-max","description":"Qwen3.7系列中规模最大、综合能力最强的Max模型，当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型，核心优势在于智能体能力的广度与深度：在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。","tags":"旗舰全能,深度思考,code","vendor_id":2,"quota_type":0,"model_ratio":3,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen-image-2.0","description":"Qwen-Image-2.0系列加速版模型，实现了图片生成和图片编辑的融合；具备更专业的文字渲染1k token指令支持能力、更细腻的真实质感，细腻刻画写实场景、更强的语义遵循能力。加速版有效实现了模型效果和性能的最佳平衡。","tags":"图片生成","vendor_id":2,"quota_type":1,"model_ratio":0,"model_price":0.18,"owner_by":"","completion_ratio":0,"enable_groups":["default"],"supported_endpoint_types":["image-generation","openai"],"billing_usage_schema":{"image_count":{"type":"number","unit":"count","unitLabel":{"en":"image","fr":"image","ja":"枚","ru":"изображение","vi":"ảnh","zh":"张","zh-TW":"張"},"description":{"en":"Image generation unit price","zh":"图片生成单价"}}}},{"model_name":"Qwen/Qwen3.5-9B","description":"Qwen3.5-9B 是通义千问团队推出的原生多模态大语言模型，拥有 9B 参数。作为 Qwen3.5 系列的轻量级 Dense 模型，它采用门控 Delta 网络与门控注意力相结合的高效混合架构，原生支持 256K 上下文长度，并可扩展至约 100 万 tokens。模型通过早期融合训练实现了统一的视觉语言基础能力，支持文本、图像和视频理解。模型默认启用思考模式（Thinking Mode），支持工具调用，并覆盖 201 种语言和方言","tags":"视觉,推理模型","vendor_id":2,"quota_type":0,"model_ratio":0.3,"model_price":0,"owner_by":"","completion_ratio":3.333333333333,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"MiniMax-M3","description":"MiniMax M3 凭借业界领先的 Coding 与 Agentic 能力、1M 超长上下文窗口以及原生多模态特性，可出色胜任企业级长文档理解、高质量内容生成、代码编写、Bug 修复及原生应用构建等任务；强大的 Agentic 能力端到端贯通工作流，原生多模态更带来流畅自然的图文混合交互体验。","icon":"Minimax.Color size={64}","tags":"文本生成,视觉理解","vendor_id":16,"quota_type":0,"model_ratio":2.25,"model_price":0,"owner_by":"","completion_ratio":3.4285714285714284,"cache_ratio":0.171428571429,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c= 512000 ? tier(\"≤ 512k\", p * 2.15 + c * 8.5 + cr * 0.6) : tier(\"\u003e 512k\", p * 5 + c * 18 + cr * 0.9)"},{"model_name":"MiniMax-M2.7","description":"M2.7 能够自行构建复杂 Agent Harness，并基于 Agent Teams、复杂 Skills、Tool Search tool 等能力，完成高度复杂的生产力任务。","tags":"深度思考,文本生成","vendor_id":16,"quota_type":0,"model_ratio":0.91,"model_price":0,"owner_by":"","completion_ratio":4,"cache_ratio":0.236263736264,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-4-8","description":"Claude Opus 4.8 是一款高端旗舰级大模型，专注于复杂推理、长文本理解与高质量代码生成能力。在多轮对话和深度分析场景中表现稳定，适用于高要求的开发辅助、系统设计及企业级应用。同时具备较强的上下文处理能力，在性能与可靠性方面处于领先水平。","tags":"文本理解,code","vendor_id":19,"quota_type":0,"model_ratio":1.3,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.115384615385,"create_cache_ratio":1.230769230769,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"claude-opus-4-6","description":"Claude Opus 4.6 是 Anthropic2026 年 2 月发布的旗舰模型，支持100 万 token 超长上下文，强化 Agent 长任务、大型代码库分析与多步骤推理。搭载自适应思考机制，擅长复杂工程、深度文档研判；视觉能力稳健，适合企业复杂工作流、长期自主智能体开发。","tags":"code,多模态,复杂工作","vendor_id":19,"quota_type":0,"model_ratio":1.3,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.115384615385,"create_cache_ratio":1.103448275862,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"doubao-1-5-lite-32k-250115","description":"Doubao1.5-lite在轻量版语言模型中也处于全球一流水平，在综合（MMLU_pro）、推理（BBH）、数学（MATH）、专业知识（GPQA）权威测评指标持平或超越GPT-4omini，Cluade 3.5 Haiku。","tags":"推理模型","vendor_id":9,"quota_type":0,"model_ratio":0.15,"model_price":0,"owner_by":"","completion_ratio":3.3333333333333335,"cache_ratio":0.333333333333,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-seed-2-0-pro-260215","description":"旗舰级全能通用模型，面向 Agent 时代的复杂推理与长链路任务执行场景。强调多模态理解、长上下文推理、结构化生成与工具增强执行。复杂指令与多约束执行能力突出，可稳定应对多步复杂规划、复杂图文推理、视频内容理解与高难度分析等场景。","tags":"推理模型,旗舰全能","vendor_id":9,"quota_type":0,"model_ratio":2,"model_price":0,"owner_by":"","completion_ratio":4.5,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"claude-opus-5","description":"Claude Opus 5 是 Anthropic 新一代高端模型，支持 100 万上下文窗口。性能接近旗舰 Fable 5，定价维持前代 Opus 4.8 水平。代码、复杂推理、长文档分析突出，支持多级推理强度调节，适合代码评审、大型项目分析、专业深度任务。","tags":"code,复杂推理,多模态","vendor_id":19,"quota_type":0,"model_ratio":1.3,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.115384615385,"create_cache_ratio":1.230769230769,"enable_groups":["default"],"supported_endpoint_types":["anthropic","openai"]},{"model_name":"kimi-k2.6","description":"kimi-k2.6是Kimi最新最智能的模型，具备更强更稳的长程代码编写能力，指令遵循和自我纠错能力显著提升，同时支持文本、图片与视频输入，思考与非思考模式，对话与Agent任务。","icon":"Kimi.Color size={64}","tags":"深度思考,视觉理解,旗舰全能","vendor_id":17,"quota_type":0,"model_ratio":2.6,"model_price":0,"owner_by":"","completion_ratio":4.153846153846,"cache_ratio":0.201923076923,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kimi-k2.5","description":"Kimi K2.5 是一款开源的原生多模态智能体模型，基于 Kimi-K2-Base，通过约 15 万亿混合视觉与文本 tokens 持续预训练而成。该模型采用 MoE 架构，拥有 1T 总参数和 32B 激活参数，支持 256K 上下文长度","icon":"Kimi.Color size={64} ","tags":"旗舰全能,长文本处理,code","vendor_id":17,"quota_type":0,"model_ratio":1.9,"model_price":0,"owner_by":"","completion_ratio":5.25,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"kimi/kimi-k2.7-code-highspeed","description":"K2.7 Code高速版与普通版是同一个模型，但输出速度约为普通版的 5-6 倍，常规编程场景下（取输入长度中位数）输出速度约 180 Token/s，短上下文场景可达 260 Token/s ，带来更极致的编程体验。","tags":"深度思考,Code,视觉理解","vendor_id":17,"quota_type":0,"model_ratio":6.5,"model_price":0,"owner_by":"","completion_ratio":4.153846153846154,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"glm-5.1","description":"GLM-5.1是智谱AI推出的面向长程任务（Long Horizon Task）设计的模型，总参数744B，支持200K超长上下文，最大输出 128K tokens。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率；在多任务基准中表现优异，适用于智能交互、企业应用、开发辅助等场景。","tags":"推理模型,旗舰全能,code","vendor_id":3,"quota_type":0,"model_ratio":2.25,"model_price":0,"owner_by":"","completion_ratio":3.555555555556,"cache_ratio":0.222222222222,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"qwen3.5-plus","description":"Qwen3.5原生视觉语言系列Plus模型，基于混合架构设计，融合了线性注意力机制与稀疏混合专家模型，实现了更高的推理效率。在多项任务评测中，3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能，模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。","tags":"文本生成,深度思考,视觉理解","vendor_id":2,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.2,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"len \u003c 120000 ? tier(\"base\", p * 0.75 + c * 4.5 + cr * 0.3) : len \u003c 250000 ? tier(\"tier_2\", p * 1.8 + c * 11 + cr * 0.6) : tier(\"tier_3\", p * 3.6 + c * 23 + cr * 0.8)"},{"model_name":"ByteDance-Seed/Seed-OSS-36B-Instruct","description":"Seed-OSS 是由字节跳动 Seed 团队开发的一系列开源大型语言模型，专为强大的长上下文处理、推理、智能体（agent）和通用能力而设计。该系列中的 Seed-OSS-36B-Instruct 是一个拥有 360 亿参数的指令微调模型，它原生支持超长上下文长度，使其能够一次性处理海量文档或复杂的代码库。该模型在推理、代码生成和智能体任务（如工具使用）方面进行了特别优化，同时保持了平衡且出色的通用能力。此模型的一大特色是“思考预算”（Thinking Budget）功能，允许用户根据需要灵活调整推理长度，从而在实际应用中有效提升推理效率","tags":"文案创作,code","vendor_id":9,"quota_type":0,"model_ratio":0.8,"model_price":0,"owner_by":"","completion_ratio":2.625,"cache_ratio":0.3125,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"glm-5.3-flash","description":"GLM‑5.3‑Flash 是智谱开源的 GLM‑5 系列原生多模态 MoE 模型。总参 320B，推理仅激活 18B，支持 1M 上下文，混合注意力架构，MIT 协议开源。编程、Agent 能力突出，性价比极高，兼顾图像理解，主打 API 高频调用与本地部署。","tags":"高新价比,高性能","vendor_id":3,"quota_type":0,"model_ratio":0.28,"model_price":0,"owner_by":"","completion_ratio":3.071428571429,"cache_ratio":0.392857142857,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"doubao-1-5-pro-32k-250115","description":"扩展至128k上下文窗口。在多项公开测评基准上达到全球领先水平，特别在知识、代码、推理、中文权威测评基准上获得最佳成绩，综合得分优于GPT4o、Claude 3.5 Sonnet等业界一流模型。","tags":"code,推理模型","vendor_id":9,"quota_type":0,"model_ratio":0.5,"model_price":0,"owner_by":"","completion_ratio":2,"cache_ratio":0.3,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.6-terra","description":"GPT-5.6-Terra 是一款注重稳定性与通用能力的大模型，在文本理解、逻辑推理和多轮对话中表现均衡。适用于内容生成、知识问答及业务辅助等场景，同时兼顾响应速度与成本控制，适合作为企业级应用或中转网关中的基础模型使用。","tags":"稳定通用,code","vendor_id":8,"quota_type":0,"model_ratio":0.6,"model_price":0,"owner_by":"","completion_ratio":5,"cache_ratio":0.125,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"gpt-5.6-luna","description":"GPT-5.6 Luna 是一款注重性能与成本平衡的通用大模型，适合大规模调用与实际业务落地。其响应速度快、稳定性高，可支持聊天对话、内容生成、代码辅助、数据处理等多种场景。相比高阶推理模型，Luna 在保持较好理解与生成能力的同时，具备更低的使用成本，特别适合企业级服务或个人开发者在高并发、成本敏感环境下长期使用，是一款实用性很强的主力模型。","tags":"高性价比,通用模型","vendor_id":8,"quota_type":0,"model_ratio":0.375,"model_price":0,"owner_by":"","completion_ratio":5.733333333333,"cache_ratio":0.133333333333,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"(len \u003c 272000) ? (tier(\"base\", p * 0.93 + c * 5.6 + cr * 0.15)) : ((len \u003e= 272000)) ? (tier(\"base\", p * 1.9 + c * 8.5 + cr * 0.22)) : (((tier(\"base\", p * 0.93 + c * 5.6 + cr * 0.15))))"},{"model_name":"gpt-5.6-sol","description":"GPT-5.6-SOL 是一款高性能通用大模型，主打代码生成、复杂推理与多任务处理能力。相比基础版本，其在长上下文理解与稳定性上进一步优化，适合用于 AI 编程助手、自动化流程、数据分析及企业级应用场景。同时兼顾成本与响应速度，在多模型路由体系中具备较高性价比，是构建中转网关与开发工具链的理想选择。","tags":"code,高性能,多模态","vendor_id":8,"quota_type":0,"model_ratio":1.25,"model_price":0,"owner_by":"","completion_ratio":5.6,"cache_ratio":0.1,"enable_groups":["default"],"supported_endpoint_types":["openai"],"billing_mode":"tiered_expr","billing_expr":"tier(\"base\", p * 2.4 + c * 13.5 + cr * 0.24 + cc * 2.4)"},{"model_name":"qwen3.8-max","description":"2.4万亿参数MoE旗舰，编程与办公能力全面跃升，可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务，一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程，支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代，持续进化。","tags":"深度思考,多模态,文本生成","vendor_id":2,"quota_type":0,"model_ratio":3,"model_price":0,"owner_by":"","completion_ratio":3,"cache_ratio":0.15,"enable_groups":["default"],"supported_endpoint_types":["openai"]},{"model_name":"MiniMax-M2.7-highspeed","description":"与 M2.7 效果不变，速度大幅提升","tags":"文本生成,深度思考","vendor_id":16,"quota_type":0,"model_ratio":2.1,"model_price":0,"owner_by":"","completion_ratio":4.0476190476190474,"cache_ratio":0.119047619048,"enable_groups":["default"],"supported_endpoint_types":["openai"]}],"group_ratio":{"default":1},"pricing_version":"a42d372ccf0b5dd13ecf71203521f9d2","success":true,"supported_endpoint":{"anthropic":{"path":"/v1/messages","method":"POST"},"gemini":{"path":"/v1beta/models/{model}:generateContent","method":"POST"},"image-generation":{"path":"/v1/images/generations","method":"POST"},"openai":{"path":"/v1/chat/completions","method":"POST"},"openai-response":{"path":"/v1/responses","method":"POST"}},"usable_group":{"default":"默认分组"},"vendors":[{"id":13,"name":"MiniMax Token Plan (minimax.io)"},{"id":14,"name":"Vivgrid"},{"id":3,"name":"智谱","icon":"Zhipu.Color"},{"id":5,"name":"零一万物","icon":"Yi.Color"},{"id":7,"name":"腾讯","icon":"Hunyuan.Color"},{"id":9,"name":"字节跳动","icon":"Doubao.Color"},{"id":10,"name":"百度","icon":"Wenxin.Color"},{"id":1,"name":"DeepSeek","icon":"DeepSeek.Color"},{"id":12,"name":"OpenCode Zen","icon":"OpenCode"},{"id":20,"name":"Google","icon":"Gemini.Color"},{"id":21,"name":" Gemini"},{"id":22,"name":"xAI","icon":"XAI"},{"id":2,"name":"阿里巴巴","icon":"Qwen.Color"},{"id":4,"name":"Moonshot","icon":"Moonshot"},{"id":11,"name":"快手","icon":"Kling.Color"},{"id":15,"name":"Moark"},{"id":16,"name":"MiniMax","icon":"Minimax.Color size={64}"},{"id":17,"name":"Kimi","icon":"Kimi.Color size={64} "},{"id":18,"name":"xiaomi","description":"小米大模型","icon":" \u003cXiaomiMiMo.Avatar size={64} /\u003e"},{"id":6,"name":"Meta","icon":"Ollama"},{"id":8,"name":"OpenAI","icon":"OpenAI"},{"id":19,"name":"Anthropic","icon":"Claude.Color"}]}