{"models":[{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"Doubao-Seed-2.1-turbo面向 Coding 和 Agent 时代打造的新一代大模型，效果与成本均衡，全面升级 Coding、Agent 与多模态能力，以更强的自主规划、长链路执行和动态修复能力，胜任企业真实复杂任务。","en":"Doubao‑Seed‑2.1‑turbo is a new‑generation large model built for the Coding and Agent era. It strikes a balance between performance and cost, with comprehensively upgraded capabilities in coding, agent workflows and multimodality. Boasting enhanced autonomous planning, long‑chain execution and dynamic repair capabilities, it excels at handling real‑world complex enterprise tasks."},"context_length":256000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Doubao-Seed-2.1-turbo","documentation_url":null,"public_id":"doubao-seed-2-1-turbo-260628","series_id":"doubao","supported_endpoint_types":["chat/completions"],"model_name":"doubao-seed-2-1-turbo-260628","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"doubao","zh-CN":"豆包"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","public_slug":"Doubao-Seed-2.1-turbo","pricing":{"scheme":"split_token","input_price":0.44000000,"output_price":2.21000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.09000000,"unit":"1M tokens"},{"metric":"output","price":2.21000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.00250000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":256000,"provider_plans":[{"prefix":"doubao","sale_pricing":null,"name":{"en":"火山引擎","zh-CN":"火山引擎"},"id":"channel_5JhvoVsHiQcfw1Eq","pricing":{"scheme":"split_token","input_price":0.44000000,"output_price":2.21000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.09000000,"unit":"1M tokens"},{"metric":"output","price":2.21000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.00250000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"Doubao-Seed-2.1-pro是迈向生产级智能的新一代大模型，全面升级 Coding、Agent 与多模态能力，以更强的自主规划、长链路执行和动态修复能力，胜任企业真实复杂任务。","en":"Doubao‑Seed‑2.1‑pro is a new‑generation large‑model stepping toward production‑grade intelligence. It features comprehensively upgraded coding, agent and multimodal capabilities. With enhanced autonomous planning, long‑chain execution and dynamic repair abilities, it is capable of handling real‑world complex enterprise tasks."},"context_length":256000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Doubao-Seed-2.1-pro","documentation_url":null,"public_id":"doubao-seed-2-1-pro-260628","series_id":"doubao","supported_endpoint_types":["chat/completions"],"model_name":"doubao-seed-2-1-pro-260628","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"doubao","zh-CN":"豆包"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","public_slug":"Doubao-Seed-2.1-pro","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":4.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17650000,"unit":"1M tokens"},{"metric":"output","price":4.41180000,"unit":"1M tokens"},{"metric":"cache_write","price":0.00250000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":256000,"provider_plans":[{"prefix":"doubao","sale_pricing":null,"name":{"en":"火山引擎","zh-CN":"火山引擎"},"id":"channel_5JhvoVsHiQcfw1Eq","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":4.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17650000,"unit":"1M tokens"},{"metric":"output","price":4.41180000,"unit":"1M tokens"},{"metric":"cache_write","price":0.00250000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.9000,"description":{"zh-CN":"Kimi K2.5 支持文本、图片与视频输入，思考与非思考模式，对话与 Agent 任务。模型上下文长度 256k，支持长思考擅长深度推理。支持自动上下文缓存功能，ToolCalls、JSON Mode、Partial Mode、联网搜索功能等能力。","en":"Kimi K2.5 accepts text, image and video inputs with reasoning and non‑reasoning modes for conversational and Agent tasks. It has a 256k context length, supports extended thinking and excels at deep reasoning. It also provides auto‑context caching, ToolCalls, JSON Mode, Partial Mode and web search capabilities."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"kimi-k2.5","supported_endpoint_types":["chat/completions"],"model_name":"kimi-k2.5","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"kimi","zh-CN":"kimi"},"public_slug":"kimi-k2.5","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.52938000,"unit":"1M tokens","scheme":"split_token","output_price":2.77938000,"breakdown":[{"metric":"input","price":0.52938000,"unit":"1M tokens"},{"metric":"cache_read","price":0.09261000,"unit":"1M tokens"},{"metric":"output","price":2.77938000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.9000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.58820000,"output_price":3.08820000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.58820000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10290000,"unit":"1M tokens"},{"metric":"output","price":3.08820000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"moonshot","sale_pricing":null,"name":{"en":"月之暗面","zh-CN":"月之暗面"},"id":"channel_9dLaeou90-mlvK9D","pricing":{"scheme":"split_token","input_price":0.58820000,"output_price":3.08820000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.58820000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10290000,"unit":"1M tokens"},{"metric":"output","price":3.08820000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","capabilities":["text","image-understanding"],"context_length":256000,"display_name":"kimi-k2.5","documentation_url":null,"series_id":"kimi","release_date":null,"sale_pricing":{"input_price":0.52938000,"unit":"1M tokens","scheme":"split_token","output_price":2.77938000,"breakdown":[{"metric":"input","price":0.52938000,"unit":"1M tokens"},{"metric":"cache_read","price":0.09261000,"unit":"1M tokens"},{"metric":"output","price":2.77938000,"unit":"1M tokens"}]},"sale_discount":0.9000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","pricing":{"scheme":"split_token","input_price":0.58820000,"output_price":3.08820000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.58820000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10290000,"unit":"1M tokens"},{"metric":"output","price":3.08820000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","capabilities":["text","image-understanding"],"min_sale_discount":null,"description":{"zh-CN":"Claude Opus 5 是 Anthropic 推出的旗舰模型，适用于高难度推理、代码开发以及长周期智能代理任务。该模型在端到端软件开发、代码审查与漏洞查找、图表与文档可视化分析、复杂办公产出物撰写，以及多子代理协同调度方面表现尤为突出。","en":"Claude Opus 5 is Anthropic’s flagship model for demanding reasoning, coding, and long-horizon agentic work. It is particularly strong at end-to-end software tasks, code review and bug finding, visual analysis of charts and documents, complex office deliverables, and coordinating parallel subagents."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Claude Opus 5","documentation_url":null,"public_id":"claude-opus-5","series_id":"claude","supported_endpoint_types":["messages"],"model_name":"claude-opus-5","release_date":"2026-07-20","faq":null,"supported_protocols":["Anthropic"],"series_name":{"en":"claude","zh-CN":"claude"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","public_slug":"Claude Opus 5","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":25.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"output","price":25.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"cache_write","price":6.25000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"qfg","sale_pricing":null,"name":{"en":"QFG","zh-CN":"QFG"},"description":{"en":"QFG","zh-CN":"QFG"},"id":"channel_KjmyRWxw6RnJ58dP","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":25.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"output","price":25.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"cache_write","price":6.25000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.9000,"description":{"zh-CN":"Kimi K2.6 是通用模型，具备稳定的长程代码编写、指令遵循和自我纠错能力，同时支持文本、图片与视频输入，思考与非思考模式，对话与 Agent 任务。模型上下文长度 256k，支持长思考擅长深度推理。支持自动上下文缓存功能，ToolCalls、JSON Mode、Partial Mode、联网搜索功能等能力。","en":"Kimi K2.6 is a general‑purpose model with stable long‑range coding, instruction‑following and self‑correction capabilities. It accepts text, image and video inputs with reasoning / non‑reasoning modes for conversational and Agent tasks. With 256k context length, it supports extended thinking and excels at deep reasoning. It also features auto‑context caching, ToolCalls, JSON Mode, Partial Mode and web search."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"kimi-k2.6","supported_endpoint_types":["chat/completions"],"model_name":"kimi-k2.6","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"kimi","zh-CN":"kimi"},"public_slug":"kimi-k2.6","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.86031000,"unit":"1M tokens","scheme":"split_token","output_price":3.57354000,"breakdown":[{"metric":"input","price":0.86031000,"unit":"1M tokens"},{"metric":"cache_read","price":0.14562000,"unit":"1M tokens"},{"metric":"output","price":3.57354000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.9000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.16180000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"moonshot","sale_pricing":null,"name":{"en":"月之暗面","zh-CN":"月之暗面"},"id":"channel_9dLaeou90-mlvK9D","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.16180000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","capabilities":["text","image-understanding"],"context_length":256000,"display_name":"kimi-k2.6","documentation_url":null,"series_id":"kimi","release_date":null,"sale_pricing":{"input_price":0.86031000,"unit":"1M tokens","scheme":"split_token","output_price":3.57354000,"breakdown":[{"metric":"input","price":0.86031000,"unit":"1M tokens"},{"metric":"cache_read","price":0.14562000,"unit":"1M tokens"},{"metric":"output","price":3.57354000,"unit":"1M tokens"}]},"sale_discount":0.9000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.16180000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltbgw8zl5-154d4nc.png","capabilities":["text","image-understanding"],"min_sale_discount":null,"description":{"zh-CN":"Grok 4.5 是 SpaceXAI 专为编码、智能体任务和知识工作而构建的前沿模型。","en":"Grok 4.5 is a model from SpaceXAI with frontier performance on coding, knowledge work, and STEM."},"context_length":500000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"grok-4.5","documentation_url":null,"public_id":"grok-4.5","series_id":"grok","supported_endpoint_types":["chat/completions"],"model_name":"grok-4.5","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"grok","zh-CN":"grok"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltbgw8zl5-154d4nc.png","public_slug":"grok-4.5","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":6.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"},{"metric":"output","price":6.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null,"provider_plans":[{"prefix":"aws","sale_pricing":null,"name":{"en":"Aws","zh-CN":"Aws"},"id":"channel_Qvt8rh9ZeDvhIVJe","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":6.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"},{"metric":"output","price":6.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text","image-understanding","video"],"min_sale_discount":null,"description":{"zh-CN":"GLM‑5V‑Turbo 是智谱首款多模态 Agent 基座模型，针对视觉编码与复杂任务场景深度优化。支持图片、视频、文本、文件多模态输入，强化视觉理解、长周期规划与动作执行能力。","en":"GLM-5V-Turbo is Zhipu’s first multimodal agent base model, deeply optimized for visual coding and complex task scenarios. It supports multimodal inputs including images, videos, text and files, with enhanced capabilities in visual understanding, long-horizon planning and action execution."},"context_length":200000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"glm-5V-Turbo","documentation_url":null,"public_id":"glm-5V-Turbo","series_id":"glm","supported_endpoint_types":["chat/completions"],"model_name":"glm-5V-Turbo","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","public_slug":"glm-5V-Turbo","pricing":{"scheme":"split_token","input_price":1.02940000,"output_price":3.82350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.02940000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26470000,"unit":"1M tokens"},{"metric":"output","price":3.82350000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":131072,"provider_plans":[{"prefix":"z-ai","sale_pricing":null,"name":{"en":"智谱","zh-CN":"智谱"},"id":"channel_IIk_fiARtbaLIHAz","pricing":{"scheme":"split_token","input_price":1.02940000,"output_price":3.82350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.02940000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26470000,"unit":"1M tokens"},{"metric":"output","price":3.82350000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","capabilities":["video"],"min_sale_discount":null,"description":{"zh-CN":"豆包大模型团队推出的新一代专业级多模态创作视频模型 Seedance 2.0，支持图像、视频、音频等多模态作为参考输入生成视频，还具备视频编辑、延长等能力，能高精度还原各类细节并稳定角色特征，具备极致拟真的视听稳定性，深度适配商业广告、影视制作与社交媒体营销等各大核心场景。","en":"Seedance 2.0, a new‑generation professional‑grade multimodal video‑creation model launched by the Doubao Large‑Model Team, supports video generation with reference inputs including images, videos and audio. It also features capabilities such as video editing and extension. The model restores diverse details with high precision and keeps character features consistent, delivering extremely realistic audio‑visual stability. It is deeply adapted for key scenarios including commercial advertising, film‑and‑television production and social‑media marketing."},"context_length":null,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Doubao-Seedance-2.0","documentation_url":null,"public_id":"doubao-seedance-2-0-260128","series_id":"doubao","supported_endpoint_types":["videos/generations"],"model_name":"doubao-seedance-2-0-260128","release_date":null,"faq":null,"supported_protocols":["Hilinkup API"],"series_name":{"en":"doubao","zh-CN":"豆包"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsyqxh6sl-1486ywa.png","public_slug":"doubao-seedance-2-0-260128","pricing":{"scheme":"unit","price":7.40000000,"unit":"1M tokens","breakdown":[{"metric":"video_token","price":7.40000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null,"provider_plans":[{"prefix":"skyrouter","sale_pricing":null,"name":{"en":"SKYROUTER","zh-CN":"SKYROUTER"},"id":"channel_4zlJtwxloHLOLnMW","pricing":{"scheme":"unit","price":7.40000000,"unit":"1M tokens","breakdown":[{"metric":"video_token","price":7.40000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Qwen-Image-3.0-Pro 是阿里千问第三代旗舰图像生成模型，基于20B参数MMDiT架构，主打\"内容丰实、细节真实、知识厚实\"。支持4.5k token超长输入，可一次生成报纸、分镜、试卷等复杂版面；10px小字精准渲染，微表情、发丝等细节逼近真实摄影；原生支持12国语言、20+字体，可仿真网页、游戏等UI界面。","en":"Qwen‑Image‑3.0‑Pro is Alibaba Qwen’s 3rd‑generation flagship text‑to‑image model built on a 20B‑parameter MMDiT architecture, featuring rich content, realistic details and solid knowledge capability. It supports 4.5k‑token long inputs to generate complex layouts such as newspapers, storyboards and exam papers in one go. It renders tiny 10‑px text precisely and reproduces fine details like micro‑expressions and hair strands near photographic quality. It natively supports 12 languages and 20+ fonts for simulating webpages, game UIs and more."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"qwen-image-3.0-pro","supported_endpoint_types":["images/generations"],"model_name":"qwen-image-3.0-pro","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"qwen-image-3-0-pro","provider_plans":[{"prefix":"aliyun","sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["image"],"context_length":null,"display_name":"qwen-image-3.0-pro","documentation_url":null,"series_id":"qwen","release_date":"2026-08-05","sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.9000,"description":{"zh-CN":"Kimi K3 拥有 2.8 万亿参数，基于 KDA 混合线性注意力机制（Kimi Delta Attention）和注意力残差（Attention Residuals）技术构建，原生支持视觉理解，并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型，面向长程编程、知识工作和推理等前沿智能场景而设计。","en":"Kimi K3 features 2.8‑trillion parameters, built with KDA hybrid linear attention (Kimi Delta Attention) and Attention Residuals. It natively supports visual understanding with a 1‑million‑token context window. As the world’s first open‑source 3‑trillion‑scale model, it is designed for cutting‑edge intelligence scenarios including long‑horizon coding, knowledge work and reasoning."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"kimi-k3","supported_endpoint_types":["chat/completions"],"model_name":"kimi-k3","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"kimi","zh-CN":"kimi"},"public_slug":"kimi-k3","provider_plans":[{"prefix":"moonshot","sale_pricing":null,"name":{"en":"月之暗面","zh-CN":"月之暗面"},"id":"channel_9dLaeou90-mlvK9D","pricing":{"scheme":"split_token","input_price":2.94120000,"output_price":14.70590000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.94120000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":14.70590000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"tencent","sale_pricing":{"input_price":2.64708000,"unit":"1M tokens","scheme":"split_token","output_price":13.23531000,"breakdown":[{"metric":"input","price":2.64708000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26469000,"unit":"1M tokens"},{"metric":"output","price":13.23531000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.9000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":2.94120000,"output_price":14.70590000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.94120000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":14.70590000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","capabilities":["text","image-understanding"],"context_length":1000000,"display_name":"kimini-k3","documentation_url":null,"series_id":"kimi","release_date":"2026-07-27","sale_pricing":{"input_price":2.64708000,"unit":"1M tokens","scheme":"split_token","output_price":13.23531000,"breakdown":[{"metric":"input","price":2.64708000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26469000,"unit":"1M tokens"},{"metric":"output","price":13.23531000,"unit":"1M tokens"}]},"sale_discount":0.9000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","pricing":{"scheme":"split_token","input_price":2.94120000,"output_price":14.70590000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.94120000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":14.70590000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Qwen3.8‑Flash 是通义千问发布的最新多模态大模型，兼具强大的理解与生成能力以及出众的响应速度。原生支持百万级上下文窗口，可一次性处理超长文档、代码仓库与复杂对话。在代码辅助、智能体协作、图文理解等场景表现优异。","en":"Qwen3.8‑Flash is the latest multimodal large model released by Qwen. It combines powerful comprehension and generation capabilities with outstanding response speed. Natively supporting a million‑level context window, it can process ultra‑long documents, code repositories and complex conversations in one go. It delivers excellent performance in scenarios including coding assistance, agent collaboration and image‑text understanding."},"related_model_ids":["qwen3.8-max","qwen3.7-plus"],"series_description":{"en":"","zh-CN":""},"public_id":"qwen3.8-flash","supported_endpoint_types":["chat/completions"],"model_name":"qwen3.8-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"Qwen3.8-Flash","provider_plans":[{"prefix":"aliyun","sale_pricing":{"input_price":0.08232000,"unit":"1M tokens","scheme":"split_token","output_price":0.27797000,"breakdown":[{"metric":"input","price":0.08232000,"unit":"1M tokens"},{"metric":"output","price":0.27797000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01029000,"unit":"1M tokens"},{"metric":"cache_write","price":0.12866000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.39710000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.39710000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"},{"metric":"cache_write","price":0.18380000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["text"],"context_length":1000000,"display_name":"qwen3.8-flash","documentation_url":null,"series_id":"qwen","release_date":"2026-08-26","sale_pricing":{"input_price":0.08232000,"unit":"1M tokens","scheme":"split_token","output_price":0.27797000,"breakdown":[{"metric":"input","price":0.08232000,"unit":"1M tokens"},{"metric":"output","price":0.27797000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01029000,"unit":"1M tokens"},{"metric":"cache_write","price":0.12866000,"unit":"1M tokens"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.39710000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.39710000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"},{"metric":"cache_write","price":0.18380000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":131000},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Wan 2.6-T2I 是阿里巴巴推出的高质量文生图模型。它在画面质感、美学表现与指令遵循能力上全面升级，支持长文本生图与广泛历史文化 IP 覆盖，能够精准控制艺术风格并生成真实感人像，满足多样化的创意生成需求。","en":"Wan 2.6‑T2I is a high‑quality text‑to‑image model launched by Alibaba. It delivers comprehensive upgrades in image texture, aesthetic performance and instruction‑following capabilities. It supports image generation from long‑form text and extensive coverage of historical and cultural IPs. It enables precise control over artistic styles and generates lifelike human portraits to meet diverse creative‑generation requirements."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"wan2.6-t2i","supported_endpoint_types":["images/generations"],"model_name":"wan2.6-t2i","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"wan2-6-t2i","provider_plans":[{"prefix":"aliyun","sale_pricing":{"unit":"image","scheme":"unit","price":0.02058000,"breakdown":[{"metric":"image","price":0.02058000,"unit":"image"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"unit","price":0.02940000,"unit":"image","breakdown":[{"metric":"image","price":0.02940000,"unit":"image"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["image"],"context_length":null,"display_name":"wan2.6-t2i","documentation_url":null,"series_id":"qwen","release_date":null,"sale_pricing":{"unit":"image","scheme":"unit","price":0.02058000,"breakdown":[{"metric":"image","price":0.02058000,"unit":"image"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"unit","price":0.02940000,"unit":"image","breakdown":[{"metric":"image","price":0.02940000,"unit":"image"}]},"status":"ACTIVE","max_output_tokens":null},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"codex-auto-review 并不是一个独立对外公开发售的基础大模型，而是 OpenAI 在 Codex / Agents 框架中用于沙盒自动化安全审查（Auto-review）的内部 Agent 系统模型标识。","en":"codex‑auto‑review is not an independent publicly‑available foundational large model. It is an internal Agent‑system identifier within OpenAI’s Codex / Agents framework for sandbox automated security auto‑review."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"codex-auto-review","documentation_url":null,"public_id":"codex-auto-review","series_id":"gpt","supported_endpoint_types":["chat/completions"],"model_name":"codex-auto-review","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","public_slug":"codex-auto-review","pricing":{"scheme":"split_token","input_price":0.20000000,"output_price":1.20000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.25000000,"unit":"1M tokens"},{"metric":"output","price":1.20000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"aotur","sale_pricing":null,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":0.20000000,"output_price":1.20000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.25000000,"unit":"1M tokens"},{"metric":"output","price":1.20000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.6000,"description":{"zh-CN":"GLM‑5.3‑Flash 是智谱 AI（Z.ai）开发的原生多模态模型，针对高效代码生成与长周期智能体任务做了优化。其混合稀疏‑线性注意力架构能够降低计算开销，同时保障长上下文处理的精度。","en":"GLM-5.3-Flash is a native multimodal model developed by Zhipu AI (Z.ai), optimized for efficient code generation and long-horizon agent tasks. Its hybrid sparse-linear attention architecture reduces computational overhead while maintaining accuracy in long-context processing."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"glm-5.3-flash","supported_endpoint_types":["chat/completions"],"model_name":"glm-5.3-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"public_slug":"glm-5.3-flash","provider_plans":[{"prefix":"baidu","sale_pricing":null,"name":{"en":"baidu","zh-CN":"百度云"},"id":"channel_F5lNnCuOJJ77Ekay","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"tencent","sale_pricing":null,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"z-ai","sale_pricing":null,"name":{"en":"智谱","zh-CN":"智谱"},"id":"channel_IIk_fiARtbaLIHAz","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"or2","sale_pricing":{"input_price":0.07644000,"unit":"1M tokens","scheme":"split_token","output_price":0.26767000,"breakdown":[{"metric":"input","price":0.07644000,"unit":"1M tokens"},{"metric":"output","price":0.26767000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02197000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6500,"name":{"en":"OR2","zh-CN":"OR2"},"description":{"en":"OR2","zh-CN":"OR2"},"id":"channel_0WqBSUjNZ_E9gJla","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"openrouter","sale_pricing":{"input_price":0.07056000,"unit":"1M tokens","scheme":"split_token","output_price":0.24708000,"breakdown":[{"metric":"input","price":0.07056000,"unit":"1M tokens"},{"metric":"output","price":0.24708000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02028000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"OpenRouter","zh-CN":"OpenRouter"},"description":{"en":null,"zh-CN":"OpenRouter"},"id":"channel__MohbHygsuJk3oBY","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text"],"context_length":1000000,"display_name":"glm-5.3-flash","documentation_url":null,"series_id":"glm","release_date":"2026-09-02","sale_pricing":{"input_price":0.07644000,"unit":"1M tokens","scheme":"split_token","output_price":0.26767000,"breakdown":[{"metric":"input","price":0.07644000,"unit":"1M tokens"},{"metric":"output","price":0.26767000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02197000,"unit":"1M tokens"}]},"sale_discount":0.6500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","pricing":{"scheme":"split_token","input_price":0.11760000,"output_price":0.41180000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.11760000,"unit":"1M tokens"},{"metric":"output","price":0.41180000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03380000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Gemini 3.8 Flash 是谷歌性能最强的轻量模型，相较于 3.7 Flash，它在软件工程、智能代理任务以及多步推理能力上均有大幅提升。","en":"Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gemini-3.8-flash","supported_endpoint_types":["chat/completions"],"model_name":"gemini-3.8-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gemini","zh-CN":"gemini"},"public_slug":"Gemini 3.8 Flash","provider_plans":[{"prefix":"ainowork","sale_pricing":{"input_price":1.05000000,"unit":"1M tokens","scheme":"split_token","output_price":5.25000000,"breakdown":[{"metric":"input","price":1.05000000,"unit":"1M tokens"},{"metric":"output","price":5.25000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10500000,"unit":"1M tokens"},{"metric":"cache_write","price":0.70000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"AinoWork‑Global","zh-CN":"AinoWork‑Global"},"description":{"en":null,"zh-CN":"AinoWork(海外)"},"id":"channel_Z9qv_4oXhj6ZoANI","pricing":{"scheme":"split_token","input_price":1.50000000,"output_price":7.50000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"output","price":7.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.00000000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"openrouter","sale_pricing":{"input_price":1.05000000,"unit":"1M tokens","scheme":"split_token","output_price":5.25000000,"breakdown":[{"metric":"input","price":1.05000000,"unit":"1M tokens"},{"metric":"output","price":5.25000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10500000,"unit":"1M tokens"},{"metric":"cache_write","price":0.70000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"OpenRouter","zh-CN":"OpenRouter"},"description":{"en":null,"zh-CN":"OpenRouter"},"id":"channel__MohbHygsuJk3oBY","pricing":{"scheme":"split_token","input_price":1.50000000,"output_price":7.50000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"output","price":7.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsn92mls2-1rfb08q.png","capabilities":["text"],"context_length":1000000,"display_name":"gemini-3.8-flash","documentation_url":null,"series_id":"gemini","release_date":"2026-09-02","sale_pricing":{"input_price":1.05000000,"unit":"1M tokens","scheme":"split_token","output_price":5.25000000,"breakdown":[{"metric":"input","price":1.05000000,"unit":"1M tokens"},{"metric":"output","price":5.25000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.10500000,"unit":"1M tokens"},{"metric":"cache_write","price":0.70000000,"unit":"1M tokens"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsn92mls2-1rfb08q.png","pricing":{"scheme":"split_token","input_price":1.50000000,"output_price":7.50000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"output","price":7.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":64000},{"sale_enabled":true,"min_sale_discount":0.35000000,"description":{"zh-CN":"DeepSeek V4.1 Flash 是深度求索推出的稀疏混合专家模型，属于 V4.1 系列中高性价比版本。它适用于代码编写、逻辑推理以及智能代理工作流场景，在需要多步骤持续执行直至完成的长周期任务上表现尤为突出。","en":"DeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the cost-efficient tier of the V4.1 family. It is suited for coding, reasoning, and agentic workflows, and is particularly strong at long-horizon tasks that must run to completion across many steps."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"deepseek-flash","supported_endpoint_types":["chat/completions"],"model_name":"deepseek-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"deepseek","zh-CN":"deepseek"},"public_slug":"DeepSeek-V4.1-Flash","provider_plans":[{"prefix":"deepseek","sale_pricing":null,"timezone":"Asia/Shanghai","name":{"en":"DeepSeek","zh-CN":"DeepSeek"},"time_discount_rules":[{"name":"空闲时段","time_start":"00:00","time_end":"23:59","weekdays":[6,7],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"00:00","time_end":"08:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"12:00","time_end":"13:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"18:00","time_end":"23:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"}],"id":"channel_hncc7adVnq96MTlH","pricing":{"scheme":"split_token","input_price":0.29410000,"output_price":1.17650000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00590000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"doubao","sale_pricing":{"input_price":0.20587000,"unit":"1M tokens","scheme":"split_token","output_price":0.82355000,"breakdown":[{"metric":"input","price":0.20587000,"unit":"1M tokens"},{"metric":"output","price":0.82355000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00413000,"unit":"1M tokens"}]},"sale_enabled":true,"timezone":"Asia/Shanghai","sale_discount":0.7000,"name":{"en":"火山引擎","zh-CN":"火山引擎"},"time_discount_rules":[{"name":"空闲时段","time_start":"00:00","time_end":"23:59","weekdays":[6,7],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"00:00","time_end":"08:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"12:00","time_end":"13:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"18:00","time_end":"23:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"}],"id":"channel_5JhvoVsHiQcfw1Eq","pricing":{"scheme":"split_token","input_price":0.29410000,"output_price":1.17650000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00590000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","capabilities":["text"],"context_length":1000000,"display_name":"DeepSeek-V4.1-Flash","documentation_url":null,"series_id":"deepseek","release_date":"2026-09-10","sale_pricing":{"input_price":0.20587000,"unit":"1M tokens","scheme":"split_token","output_price":0.82355000,"breakdown":[{"metric":"input","price":0.20587000,"unit":"1M tokens"},{"metric":"output","price":0.82355000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00413000,"unit":"1M tokens"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","pricing":{"scheme":"split_token","input_price":0.29410000,"output_price":1.17650000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00590000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":384000},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT‑6 Astra 是 OpenAI 于 2026 年 9 月推出的新一代旗舰前沿大模型。\n主打自主智能体与电脑操控能力，擅长复杂推理、大型项目开发与端到端任务执行。","en":"GPT‑6 Astra is a new‑generation flagship cutting‑edge large‑scale model launched by OpenAI in September 2026.\nIt features autonomous agent and computer‑control capabilities, excelling at complex reasoning, large‑scale project development and end‑to‑end task execution."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt‑6-astra","supported_endpoint_types":["responses"],"model_name":"gpt‑6-astra","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"gpt‑6-astra","provider_plans":[{"prefix":"aotur","sale_pricing":{"input_price":1.50000000,"unit":"1M tokens","scheme":"split_token","output_price":7.50000000,"breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"output","price":7.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.87500000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"qfc","sale_pricing":null,"name":{"en":"QFC","zh-CN":"QFC"},"description":{"en":"QFC","zh-CN":"QFC"},"id":"channel_4OFyTUor6tx2ezJH","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text"],"context_length":1050000,"display_name":"gpt‑6-astra","documentation_url":null,"series_id":"gpt","release_date":"2026-09-03","sale_pricing":{"input_price":1.50000000,"unit":"1M tokens","scheme":"split_token","output_price":7.50000000,"breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"output","price":7.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.87500000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"Claude Fable 5.1 在 Claude Fable 5 的基础上实现了全方位提升，**智能体编码、长周期智能体工作流以及知识类工作**方面提升最为显著：尤其擅长大规模代码重构、前端与可视化代码生成，以及金融分析类任务。相较于 Fable 5，它输出的方案和摘要也往往更加简洁。建议你在当前使用 Fable 5 的场景中直接升级测试；对于强推理任务，可搭配 Opus 5 一同使用。","en":"Claude Fable 5.1 improves on Claude Fable 5 across the board, with the biggest gains in agentic coding, long-running agentic workflows, and knowledge work: long code refactors, front-end and visual code generation, and finance and analysis tasks in particular. It also tends to be more concise than Fable 5 in its plans and summaries. We recommend testing it as a direct upgrade wherever you use Fable 5 today, and alongside Opus 5 on reasoning-heavy tasks."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Claude Fable 5.1","documentation_url":null,"public_id":"claude-fable-5-1","series_id":"claude","supported_endpoint_types":["messages"],"model_name":"claude-fable-5-1","release_date":"2026-09-01","faq":null,"supported_protocols":["Anthropic"],"series_name":{"en":"claude","zh-CN":"claude"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","public_slug":"Claude Fable 5.1","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"qfg","sale_pricing":null,"name":{"en":"QFG","zh-CN":"QFG"},"description":{"en":"QFG","zh-CN":"QFG"},"id":"channel_KjmyRWxw6RnJ58dP","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"available","recommended":false}]},{"sale_enabled":true,"min_sale_discount":0.9000,"description":{"zh-CN":"Kimi K2.7 Code 是面向代码场景的 Coding 模型，在长上下文中更可靠地遵循指令，能以更高的成功率完成编程任务。同时支持文本、图片与视频输入，仅支持思考模式，对话与 Agent 任务。","en":"Kimi K2.7 Code is a coding‑focused model for programming scenarios. It follows instructions more reliably under long‑context conditions and completes programming tasks with higher success rates. Meanwhile, it accepts text, image and video inputs. It supports only reasoning mode for conversational and Agent tasks."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"kimi-k2.7-code","supported_endpoint_types":["chat/completions"],"model_name":"kimi-k2.7-code","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"kimi","zh-CN":"kimi"},"public_slug":"kimi-k2.7-code","provider_plans":[{"prefix":"moonshot","sale_pricing":null,"name":{"en":"月之暗面","zh-CN":"月之暗面"},"id":"channel_9dLaeou90-mlvK9D","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.19120000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"tencent","sale_pricing":{"input_price":0.86031000,"unit":"1M tokens","scheme":"split_token","output_price":3.57354000,"breakdown":[{"metric":"input","price":0.86031000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17208000,"unit":"1M tokens"},{"metric":"output","price":3.57354000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.9000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.19120000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","capabilities":["text"],"context_length":256000,"display_name":"kimi-k2.7-code","documentation_url":null,"series_id":"kimi","release_date":"2026-06-15","sale_pricing":{"input_price":0.86031000,"unit":"1M tokens","scheme":"split_token","output_price":3.57354000,"breakdown":[{"metric":"input","price":0.86031000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17208000,"unit":"1M tokens"},{"metric":"output","price":3.57354000,"unit":"1M tokens"}]},"sale_discount":0.9000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltfkme3je-k33o4a.png","pricing":{"scheme":"split_token","input_price":0.95590000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.95590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.19120000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltj713jjy-1ssa6qs.png","capabilities":["text","image-understanding"],"min_sale_discount":null,"description":{"zh-CN":"MiniMax-M3 支持最高 1,000,000 token 上下文，OpenAI 兼容 Chat Completions 支持文本、图片和视频输入，可使用 image_url 与 video_url 内容块。适用于 Agent 推理、工具调用、代码和长上下文任务。","en":"MiniMax‑M3 supports up to 1,000,000‑token context. With OpenAI‑compatible Chat Completions, it accepts text, image and video inputs, and supports `image_url` and `video_url` content blocks. It is suitable for Agent reasoning, tool‑calling, coding and long‑context tasks."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"MiniMax-M3","documentation_url":null,"public_id":"MiniMax-M3","series_id":"mimimax","supported_endpoint_types":["chat/completions"],"model_name":"MiniMax-M3","release_date":"2026-06-12","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Minimax","zh-CN":"MiniMax"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltj713jjy-1ssa6qs.png","public_slug":"MiniMax-M3","pricing":{"scheme":"split_token","input_price":0.61760000,"output_price":0.61760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.61760000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12350000,"unit":"1M tokens"},{"metric":"cache_write","price":0.77210000,"unit":"1M tokens"},{"metric":"output","price":0.61760000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null,"provider_plans":[{"prefix":"minimax","sale_pricing":null,"name":{"en":"MiniMax","zh-CN":"MiniMax"},"id":"channel_ObJhXS7w0YS-8TxY","pricing":{"scheme":"split_token","input_price":0.61760000,"output_price":0.61760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.61760000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12350000,"unit":"1M tokens"},{"metric":"cache_write","price":0.77210000,"unit":"1M tokens"},{"metric":"output","price":0.61760000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Qwen3.8-Max 是阿里通义千问系列最强旗舰模型，采用2.4万亿参数稀疏MoE架构，推理时仅激活950亿参数。支持100万Token超长上下文，原生支持文本、图像、视频多模态输入。具备自主编程、长程任务规划、专业办公及多模态视觉理解四大核心能力。","en":"Qwen3.8‑Max is the most powerful flagship model in Alibaba's Tongyi Qwen series. It adopts a 2.4‑trillion‑parameter sparse MoE architecture, with only 95 billion parameters activated during inference. It supports an ultra‑long context of 1 million tokens and natively accepts multimodal inputs including text, images and videos. It features four core capabilities: autonomous coding, long‑horizon task planning, professional office work and multimodal visual understanding."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"qwen3.8-max","supported_endpoint_types":["chat/completions"],"model_name":"qwen3.8-max","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"qwen3.8-max","provider_plans":[{"prefix":"aliyun","sale_pricing":{"input_price":1.23529000,"unit":"1M tokens","scheme":"split_token","output_price":3.70587000,"breakdown":[{"metric":"input","price":1.23529000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12320000,"unit":"1M tokens"},{"metric":"cache_write","price":1.54420000,"unit":"1M tokens"},{"metric":"output","price":3.70587000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"split_token","input_price":1.76470000,"output_price":5.29410000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.76470000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17600000,"unit":"1M tokens"},{"metric":"cache_write","price":2.20600000,"unit":"1M tokens"},{"metric":"output","price":5.29410000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["text","image-understanding"],"context_length":1000000,"display_name":"qwen3.8-max","documentation_url":null,"series_id":"qwen","release_date":"2026-08-12","sale_pricing":{"input_price":1.23529000,"unit":"1M tokens","scheme":"split_token","output_price":3.70587000,"breakdown":[{"metric":"input","price":1.23529000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12320000,"unit":"1M tokens"},{"metric":"cache_write","price":1.54420000,"unit":"1M tokens"},{"metric":"output","price":3.70587000,"unit":"1M tokens"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"split_token","input_price":1.76470000,"output_price":5.29410000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.76470000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17600000,"unit":"1M tokens"},{"metric":"cache_write","price":2.20600000,"unit":"1M tokens"},{"metric":"output","price":5.29410000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltj713jjy-1ssa6qs.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"MiniMax-M2.7 是一款新一代大型语言模型，旨在实现自主、实际的应用场景和持续改进。M2.7 能够积极参与自身的演化，通过多智能体协作集成了先进的智能体功能，使其能够在动态环境中规划、执行和优化复杂的任务。\nM2.7 经过专门训练，具备生产级性能，能够处理实时调试、根本原因分析、财务建模以及跨 Word、Excel 和 PowerPoint 生成完整文档等工作流程。","en":"MiniMax‑M2.7 is a new‑generation large language model designed for autonomous, real‑world application scenarios and continuous improvement. Capable of actively participating in its own evolution, M2.7 integrates advanced agent features via multi‑agent collaboration, enabling it to plan, execute and optimize complex tasks in dynamic environments.\nSpecially trained for production‑grade performance, M2.7 handles workflows including real‑time debugging, root‑cause analysis, financial modeling, and end‑to‑end document generation across Word, Excel and PowerPoint."},"context_length":200000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"MiniMax-M2.7","documentation_url":null,"public_id":"MiniMax-M2.7","series_id":"mimimax","supported_endpoint_types":["chat/completions"],"model_name":"MiniMax-M2.7","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Minimax","zh-CN":"MiniMax"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltj713jjy-1ssa6qs.png","public_slug":"MiniMax-M2.7","pricing":{"scheme":"split_token","input_price":0.30880000,"output_price":1.23530000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.30880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06180000,"unit":"1M tokens"},{"metric":"cache_write","price":0.38600000,"unit":"1M tokens"},{"metric":"output","price":1.23530000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":200000,"provider_plans":[{"prefix":"minimax","sale_pricing":null,"name":{"en":"MiniMax","zh-CN":"MiniMax"},"id":"channel_ObJhXS7w0YS-8TxY","pricing":{"scheme":"split_token","input_price":0.30880000,"output_price":1.23530000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.30880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06180000,"unit":"1M tokens"},{"metric":"cache_write","price":0.38600000,"unit":"1M tokens"},{"metric":"output","price":1.23530000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"Claude Sonnet 5 默认支持 100 万令牌上下文窗口（100 万令牌既是默认值也是最大值；没有更小的上下文变体）、128k 最大输出令牌、自适应思考，以及与 Claude Sonnet 4.6 相同的工具和平台功能集，但 Priority Tier 除外，该功能在 Claude Sonnet 5 上不可用。","en":"Claude Sonnet 5 features a default 1‑million‑token context window (1 million tokens is both default and maximum; no smaller‑context variants), a maximum 128k output tokens, and adaptive reasoning. It shares the same set of tooling and platform capabilities as Claude Sonnet 4.6, except for Priority Tier, which is unavailable on Claude Sonnet 5."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Claude Sonnet 5","documentation_url":null,"public_id":"claude-sonnet-5","series_id":"claude","supported_endpoint_types":["messages"],"model_name":"claude-sonnet-5","release_date":null,"faq":null,"supported_protocols":["Anthropic"],"series_name":{"en":"claude","zh-CN":"claude"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","public_slug":"claude-sonnet-5","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":10.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"},{"metric":"output","price":10.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"aws","sale_pricing":null,"name":{"en":"Aws","zh-CN":"Aws"},"id":"channel_Qvt8rh9ZeDvhIVJe","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":10.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"},{"metric":"output","price":10.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"qfg","sale_pricing":null,"name":{"en":"QFG","zh-CN":"QFG"},"description":{"en":"QFG","zh-CN":"QFG"},"id":"channel_KjmyRWxw6RnJ58dP","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":10.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"},{"metric":"output","price":10.00000000,"unit":"1M tokens"}]},"status":"available","recommended":false}]},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":null,"en":"Claude Fable 5 是 Anthropic 广泛发布的最强大的模型，为长时间运行的代理提供下一代智能。"},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"Claude Fable 5","documentation_url":null,"public_id":"claude-fable-5","series_id":"claude","supported_endpoint_types":["messages"],"model_name":"claude-fable-5","release_date":null,"faq":null,"supported_protocols":["Anthropic"],"series_name":{"en":"claude","zh-CN":"claude"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","public_slug":"claude-fable-5","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"qfg","sale_pricing":null,"name":{"en":"QFG","zh-CN":"QFG"},"description":{"en":"QFG","zh-CN":"QFG"},"id":"channel_KjmyRWxw6RnJ58dP","pricing":{"scheme":"split_token","input_price":10.00000000,"output_price":50.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":10.00000000,"unit":"1M tokens"},{"metric":"output","price":50.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":1.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":12.50000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"OpenAI 最新的图像生成模型。可通过专用图像 API 实现高保真图像生成与编辑。","en":"OpenAI's latest image generation model. Supports high-fidelity image generation and editing via the dedicated Images API."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-image-2","supported_endpoint_types":["images/generations"],"model_name":"gpt-image-2","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"GPT Image 2","provider_plans":[{"prefix":"aotur","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text","image"],"context_length":400000,"display_name":"gpt-image-2","documentation_url":null,"series_id":"gpt","release_date":"2026-04-22","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"qwen-image-2.0-pro 是阿里云推出的专业级图像生成与编辑融合模型。它支持文生图与图像编辑，具备 1k token 指令支持能力，在文字渲染、真实质感呈现与语义遵循方面表现突出，支持最高 2048×2048 分辨率输出，适用于海报、信息图、PPT 等专业图文混合场景。","en":"qwen‑image‑2.0‑pro is an integrated professional image generation‑and‑editing model from Alibaba Cloud. It supports text‑to‑image and image editing with 1k‑token instruction capacity. It excels in text rendering, realistic texture and semantic adherence, delivering outputs up to 2048×2048 resolution for posters, infographics, PPT and other professional graphic‑text scenarios."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"qwen-image-2.0-pro","supported_endpoint_types":["images/generations"],"model_name":"qwen-image-2.0-pro","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"qwen-image-2-0-pro","provider_plans":[{"prefix":"aliyun","sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["image"],"context_length":null,"display_name":"qwen-image-2.0-pro","documentation_url":null,"series_id":"qwen","release_date":null,"sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT‑5.6 Terra 是 OpenAI GPT‑5.6 系列的均衡型模型，定位介于旗舰级 Sol 与高性价比 Luna 之间。适用于需要兼顾能力与成本的日常编码、推理及智能体任务，以约 Sol 一半的成本提供强劲性能。","en":"GPT-5.6 Terra is a balanced model in OpenAI's GPT-5.6 series, positioned between the flagship Sol tier and the cost-efficient Luna tier. It is suited for everyday coding, reasoning, and agentic tasks where capability and cost need to be balanced, offering strong performance at roughly half the cost of Sol."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-5.6-terra","supported_endpoint_types":["responses"],"model_name":"gpt-5.6-terra","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"gpt-5-6-terra","provider_plans":[{"prefix":"aotur","sale_pricing":{"input_price":0.30000000,"unit":"1M tokens","scheme":"split_token","output_price":1.80000000,"breakdown":[{"metric":"input","price":0.30000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03000000,"unit":"1M tokens"},{"metric":"output","price":1.80000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.37500000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":12.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"output","price":12.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"qfc","sale_pricing":null,"name":{"en":"QFC","zh-CN":"QFC"},"description":{"en":"QFC","zh-CN":"QFC"},"id":"channel_4OFyTUor6tx2ezJH","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":12.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"output","price":12.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text"],"context_length":1050000,"display_name":"gpt-5.6-terra","documentation_url":null,"series_id":"gpt","release_date":"2026-07-09","sale_pricing":{"input_price":0.30000000,"unit":"1M tokens","scheme":"split_token","output_price":1.80000000,"breakdown":[{"metric":"input","price":0.30000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03000000,"unit":"1M tokens"},{"metric":"output","price":1.80000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.37500000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"split_token","input_price":2.00000000,"output_price":12.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":2.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.20000000,"unit":"1M tokens"},{"metric":"output","price":12.00000000,"unit":"1M tokens"},{"metric":"cache_write","price":2.50000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT‑5.5 是 OpenAI 面向复杂专业工作负载打造的前沿模型，在 GPT‑5.4 基础上强化推理能力、提升可靠性，并优化高难度任务的 token 效率。上下文窗口超 100 万 Token（922K 输入、128K 输出），支持文本与图像输入，可在单系统内完成大规模推理、编码及多模态工作流。","en":"GPT-5.5 is OpenAI’s frontier model designed for complex professional workloads, building on GPT-5.4 with stronger reasoning, higher reliability, and improved token efficiency on hard tasks. It features a 1M+ token context window (922K input, 128K output) with support for text and image inputs, enabling large-scale reasoning, coding, and multimodal workflows within a single system."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-5.5","supported_endpoint_types":["chat/completions"],"model_name":"gpt-5.5","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"gpt-5.5","provider_plans":[{"prefix":"aotur","sale_pricing":{"input_price":0.75000000,"unit":"1M tokens","scheme":"split_token","output_price":4.50000000,"breakdown":[{"metric":"input","price":0.75000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.07500000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":30.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text","image-understanding"],"context_length":1050000,"display_name":"gpt-5.5","documentation_url":null,"series_id":"gpt","release_date":null,"sale_pricing":{"input_price":0.75000000,"unit":"1M tokens","scheme":"split_token","output_price":4.50000000,"breakdown":[{"metric":"input","price":0.75000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.07500000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":30.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT Image 2.5 Sunburst 是 OpenAI 推出的图像生成与编辑模型，属于 GPT Image 2.5 系列中主打高精度的版本。适用于对编辑精度要求高于生成速度的精细创意创作，可通过专用图像 API 调用。","en":"GPT Image 2.5 Sunburst is an image generation and editing model from OpenAI, positioned as the precision-oriented tier of the GPT Image 2.5 series. It is suited to detailed creative work where editing accuracy matters more than generation speed, via the dedicated Images API."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-image-2.5-sunburst","supported_endpoint_types":["images/generations"],"model_name":"gpt-image-2.5-sunburst","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"GPT Image 2.5 Sunburst","provider_plans":[{"prefix":"aotur","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["image"],"context_length":400000,"display_name":"gpt-image-2.5-sunburst","documentation_url":null,"series_id":"gpt","release_date":"2026-09-11","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT‑5.6 Sol 是 OpenAI GPT‑5.6 系列的旗舰模型，适用于复杂推理、代码开发以及智能体工作流，在命令行、多步编码任务与长周期问题求解方面实力尤为突出。","en":"GPT-5.6 Sol is the flagship model in OpenAI's GPT-5.6 series. It is suited for complex reasoning, coding, and agentic workflows, and is particularly strong at command-line and multi-step coding tasks and long-horizon problem solving."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-5.6-sol","supported_endpoint_types":["responses"],"model_name":"gpt-5.6-sol","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"gpt-5.6-sol","provider_plans":[{"prefix":"aotur","sale_pricing":{"input_price":0.60000000,"unit":"1M tokens","scheme":"split_token","output_price":3.00000000,"breakdown":[{"metric":"input","price":0.60000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.75000000,"unit":"1M tokens"},{"metric":"output","price":3.00000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":4.00000000,"output_price":20.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":4.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.40000000,"unit":"1M tokens"},{"metric":"cache_write","price":5.00000000,"unit":"1M tokens"},{"metric":"output","price":20.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"qfc","sale_pricing":null,"name":{"en":"QFC","zh-CN":"QFC"},"description":{"en":"QFC","zh-CN":"QFC"},"id":"channel_4OFyTUor6tx2ezJH","pricing":{"scheme":"split_token","input_price":4.00000000,"output_price":20.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":4.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.40000000,"unit":"1M tokens"},{"metric":"cache_write","price":5.00000000,"unit":"1M tokens"},{"metric":"output","price":20.00000000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text"],"context_length":1050000,"display_name":"gpt-5.6-sol","documentation_url":null,"series_id":"gpt","release_date":"2026-07-09","sale_pricing":{"input_price":0.60000000,"unit":"1M tokens","scheme":"split_token","output_price":3.00000000,"breakdown":[{"metric":"input","price":0.60000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.75000000,"unit":"1M tokens"},{"metric":"output","price":3.00000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"split_token","input_price":4.00000000,"output_price":20.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":4.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.40000000,"unit":"1M tokens"},{"metric":"cache_write","price":5.00000000,"unit":"1M tokens"},{"metric":"output","price":20.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"Claude Opus 4.8 是 Anthropic 公司 Opus 系列中最强大的通用模型。它支持文本、图像和文件输入，并输出文本，具备推理功能，上下文窗口大小为 100 万个标记。它适用于高度自主的智能体、长期智能体任务、知识型任务以及对长时间会话一致性要求较高的记忆驱动型任务。","en":"Claude Opus 4.8 is the most powerful general‑purpose model in Anthropic’s Opus series. It accepts text, image and file inputs with text‑only output and reasoning capability, featuring a 1‑million‑token context window. It is suitable for highly‑autonomous agents, long‑running agent tasks, knowledge‑intensive workloads, and memory‑driven tasks requiring high consistency across extended sessions."},"context_length":1000000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"claude opus 4.8","documentation_url":null,"public_id":"claude-opus-4-8","series_id":"claude","supported_endpoint_types":["chat/completions"],"model_name":"claude-opus-4-8","release_date":null,"faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"claude","zh-CN":"claude"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dls4p2c9oi-17izxnp.png","public_slug":"claude-opus-4-8","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":25.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"cache_write","price":6.25000000,"unit":"1M tokens"},{"metric":"output","price":25.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null,"provider_plans":[{"prefix":"aws","sale_pricing":null,"name":{"en":"Aws","zh-CN":"Aws"},"id":"channel_Qvt8rh9ZeDvhIVJe","pricing":{"scheme":"split_token","input_price":5.00000000,"output_price":25.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":5.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.50000000,"unit":"1M tokens"},{"metric":"cache_write","price":6.25000000,"unit":"1M tokens"},{"metric":"output","price":25.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}]},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Wan 2.7-Image-Pro 是阿里巴巴推出的专业级图像生成与编辑模型。它支持文生图、多图参考生成与融合编辑，可通过多张参考图精准引导画面的风格、色彩与主体特征，并支持最高 4K 分辨率输出与交互式局部编辑。","en":"Wan 2.7‑Image‑Pro is a professional image generation and editing model from Alibaba. It supports text‑to‑image, multi‑reference‑image generation and fusion editing. Multiple reference images can precisely guide style, color and subject features. It delivers up to 4K resolution output and interactive partial editing."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"wan2.7-image-pro","supported_endpoint_types":["images/generations"],"model_name":"wan2.7-image-pro","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"wan2-7-image-pro","provider_plans":[{"prefix":"aliyun","sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["image"],"context_length":null,"display_name":"wan2.7-image-pro","documentation_url":null,"series_id":"qwen","release_date":null,"sale_pricing":{"unit":"image","scheme":"unit","price":0.05145000,"breakdown":[{"metric":"image","price":0.05145000,"unit":"image"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"unit","price":0.07350000,"unit":"image","breakdown":[{"metric":"image","price":0.07350000,"unit":"image"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT‑5.6 Luna 是 OpenAI GPT‑5.6 系列中一款高速高性价比模型，适合聊天、分类、轻量智能体工作流等高并发、对延迟敏感的任务，在同价位档位下具备不错的推理能力。","en":"GPT-5.6 Luna is a fast, cost-efficient model in OpenAI's GPT-5.6 series. It is suited for high-volume, latency-sensitive tasks such as chat, classification, and lightweight agentic workflows, providing capable reasoning for its price tier."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-5.6-luna","supported_endpoint_types":["responses"],"model_name":"gpt-5.6-luna","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"gpt-5.6-luna","provider_plans":[{"prefix":"aotur","sale_pricing":{"input_price":0.03000000,"unit":"1M tokens","scheme":"split_token","output_price":0.18000000,"breakdown":[{"metric":"input","price":0.03000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00300000,"unit":"1M tokens"},{"metric":"cache_write","price":0.03750000,"unit":"1M tokens"},{"metric":"output","price":0.18000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"split_token","input_price":0.20000000,"output_price":1.20000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.25000000,"unit":"1M tokens"},{"metric":"output","price":1.20000000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"qfc","sale_pricing":null,"name":{"en":"QFC","zh-CN":"QFC"},"description":{"en":"QFC","zh-CN":"QFC"},"id":"channel_4OFyTUor6tx2ezJH","pricing":{"scheme":"split_token","input_price":0.20000000,"output_price":1.20000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.25000000,"unit":"1M tokens"},{"metric":"output","price":1.20000000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["text","image-understanding"],"context_length":1050000,"display_name":"gpt-5.6-luna","documentation_url":null,"series_id":"gpt","release_date":"2026-07-09","sale_pricing":{"input_price":0.03000000,"unit":"1M tokens","scheme":"split_token","output_price":0.18000000,"breakdown":[{"metric":"input","price":0.03000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00300000,"unit":"1M tokens"},{"metric":"cache_write","price":0.03750000,"unit":"1M tokens"},{"metric":"output","price":0.18000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"split_token","input_price":0.20000000,"output_price":1.20000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.20000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.02000000,"unit":"1M tokens"},{"metric":"cache_write","price":0.25000000,"unit":"1M tokens"},{"metric":"output","price":1.20000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.50000000,"description":{"zh-CN":"DeepSeek‑V4‑Pro‑0813 是 DeepSeek 的旗舰开源 MoE（混合专家）模型，总参数量 1.6 万亿，每个 token 激活 490 亿参数，支持 100 万 token 上下文窗口。专为高阶推理、代码编写、理工科任务与自主智能体打造，在开源模型中具备顶尖性能，可对标主流闭源模型。","en":"DeepSeek-V4-Pro-0813 is DeepSeek’s flagship open-weight Mixture-of-Experts (MoE) model. It has a total parameter count of 1.6 trillion, with 49 billion parameters activated per token, and supports a 1M-token context window. Tailored for advanced reasoning, coding, STEM tasks and autonomous agents, it delivers state-of-the-art performance among open-source models, comparable to leading proprietary systems."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"deepseek-v4-pro","supported_endpoint_types":["chat/completions"],"model_name":"deepseek-v4-pro","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"deepseek","zh-CN":"deepseek"},"public_slug":"deepseek-v4-pro","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":1.05880000,"unit":"1M tokens","scheme":"split_token","output_price":3.17648000,"breakdown":[{"metric":"input","price":1.05880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03528000,"unit":"1M tokens"},{"metric":"cache_write","price":1.05880000,"unit":"1M tokens"},{"metric":"output","price":3.17648000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.8000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":1.32350000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"},{"metric":"cache_write","price":1.32350000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"doubao","sale_pricing":{"input_price":1.05880000,"unit":"1M tokens","scheme":"split_token","output_price":3.17648000,"breakdown":[{"metric":"input","price":1.05880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03528000,"unit":"1M tokens"},{"metric":"cache_write","price":1.05880000,"unit":"1M tokens"},{"metric":"output","price":3.17648000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.8000,"name":{"en":"火山引擎","zh-CN":"火山引擎"},"id":"channel_5JhvoVsHiQcfw1Eq","pricing":{"scheme":"split_token","input_price":1.32350000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"},{"metric":"cache_write","price":1.32350000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"deepseek","sale_pricing":null,"timezone":"Asia/Shanghai","name":{"en":"DeepSeek","zh-CN":"DeepSeek"},"time_discount_rules":[{"name":"空闲时段","time_start":"00:00","time_end":"23:59","weekdays":[6,7],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"00:00","time_end":"08:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"12:00","time_end":"13:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"18:00","time_end":"23:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"}],"id":"channel_hncc7adVnq96MTlH","pricing":{"scheme":"split_token","input_price":1.32350000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"},{"metric":"cache_write","price":1.32350000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","capabilities":["text"],"context_length":1000000,"display_name":"deepseek-v4-pro","documentation_url":null,"series_id":"deepseek","release_date":"2026-08-13","sale_pricing":{"input_price":1.05880000,"unit":"1M tokens","scheme":"split_token","output_price":3.17648000,"breakdown":[{"metric":"input","price":1.05880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03528000,"unit":"1M tokens"},{"metric":"cache_write","price":1.05880000,"unit":"1M tokens"},{"metric":"output","price":3.17648000,"unit":"1M tokens"}]},"sale_discount":0.8000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","pricing":{"scheme":"split_token","input_price":1.32350000,"output_price":3.97060000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"},{"metric":"cache_write","price":1.32350000,"unit":"1M tokens"},{"metric":"output","price":3.97060000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":384000},{"sale_enabled":true,"min_sale_discount":0.8500,"description":{"zh-CN":"Gemini 3.5 Flash 可持续提供前沿模型级的智能表现，并针对实际任务进行了优化，速度更快，成本更低。它专为智能体时代而设计，擅长大规模部署分代理、处理多步工作流和长时程任务。此模型在涉及复杂编码周期和迭代的快速代理循环方面特别有效。","en":"Gemini 3.5 Flash delivers consistent cutting‑edge model‑level intelligence, optimized for real‑world tasks with higher speed and lower cost. Built for the agent era, it excels at large‑scale sub‑agent deployment, multi‑step workflows and long‑horizon tasks. This model is especially effective for fast agent loops involving complex coding cycles and iterations."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gemini-3.5-flash","supported_endpoint_types":["chat/completions"],"model_name":"gemini-3.5-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gemini","zh-CN":"gemini"},"public_slug":"gemini-3.5-flash","provider_plans":[{"prefix":"aws","sale_pricing":{"input_price":1.27500000,"unit":"1M tokens","scheme":"split_token","output_price":7.65000000,"breakdown":[{"metric":"input","price":1.27500000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12750000,"unit":"1M tokens"},{"metric":"cache_write","price":0.85000000,"unit":"1M tokens"},{"metric":"output","price":7.65000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.8500,"name":{"en":"Aws","zh-CN":"Aws"},"id":"channel_Qvt8rh9ZeDvhIVJe","pricing":{"scheme":"split_token","input_price":1.50000000,"output_price":9.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.00000000,"unit":"1M tokens"},{"metric":"output","price":9.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsn92mls2-1rfb08q.png","capabilities":["text","image-understanding","audio"],"context_length":1000000,"display_name":"gemini-3.5-flash","documentation_url":null,"series_id":"gemini","release_date":null,"sale_pricing":{"input_price":1.27500000,"unit":"1M tokens","scheme":"split_token","output_price":7.65000000,"breakdown":[{"metric":"input","price":1.27500000,"unit":"1M tokens"},{"metric":"cache_read","price":0.12750000,"unit":"1M tokens"},{"metric":"cache_write","price":0.85000000,"unit":"1M tokens"},{"metric":"output","price":7.65000000,"unit":"1M tokens"}]},"sale_discount":0.8500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlsn92mls2-1rfb08q.png","pricing":{"scheme":"split_token","input_price":1.50000000,"output_price":9.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.15000000,"unit":"1M tokens"},{"metric":"cache_write","price":1.00000000,"unit":"1M tokens"},{"metric":"output","price":9.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":64000},{"sale_enabled":true,"min_sale_discount":0.40000000,"description":{"zh-CN":"DeepSeek‑V4‑Flash 拥有 100 万 token 上下文窗口，面向代码开发、工具调用与复杂工作流场景打造，在保持高效推理的同时实现智能体性能的大幅跃升。","en":"DeepSeek-V4-Flash features a 1M-token context window. Tailored for code development, tool calling and complex workflows, it delivers a leap in Agent performance while maintaining efficient inference."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"deepseek-v4-flash","supported_endpoint_types":["chat/completions"],"model_name":"deepseek-v4-flash","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"deepseek","zh-CN":"deepseek"},"public_slug":"deepseek-v4-flash","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.35296000,"unit":"1M tokens","scheme":"split_token","output_price":1.05880000,"breakdown":[{"metric":"input","price":0.35296000,"unit":"1M tokens"},{"metric":"output","price":1.05880000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01176000,"unit":"1M tokens"}]},"sale_enabled":true,"timezone":"Asia/Shanghai","sale_discount":0.8000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"time_discount_rules":[{"name":"空闲时段","time_start":"00:00","time_end":"23:59","weekdays":[6,7],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"00:00","time_end":"08:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"12:00","time_end":"13:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"},{"name":"空闲时段","time_start":"18:00","time_end":"23:59","weekdays":[1,2,3,4,5],"month_days":null,"multiplier":"0.5000"}],"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"doubao","sale_pricing":{"input_price":0.26472000,"unit":"1M tokens","scheme":"split_token","output_price":0.79410000,"breakdown":[{"metric":"input","price":0.26472000,"unit":"1M tokens"},{"metric":"output","price":0.79410000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00882000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"火山引擎","zh-CN":"火山引擎"},"id":"channel_5JhvoVsHiQcfw1Eq","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","capabilities":["text"],"context_length":1000000,"display_name":"deepseek-v4-flash","documentation_url":null,"series_id":"deepseek","release_date":"2026-07-31","sale_pricing":{"input_price":0.26472000,"unit":"1M tokens","scheme":"split_token","output_price":0.79410000,"breakdown":[{"metric":"input","price":0.26472000,"unit":"1M tokens"},{"metric":"output","price":0.79410000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00882000,"unit":"1M tokens"}]},"sale_discount":0.6000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":384000},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"Qwen3.7系列中高性价比Plus模型，在文本能力的基础上全面升级了视觉-语言能力，同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力，能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。","en":"Qwen3.7‑Plus is the cost‑effective Plus model in the Qwen3.7 series. It comprehensively upgrades vision‑language capabilities based on text performance, while retaining full agent capabilities for coding, tool‑using and productivity workflows. Its core feature is multimodal interactive hybrid agent ability: it perceives real‑world scenes, reads screens and operates GUIs, generates code from visual references, and performs end‑to‑end navigation for mobile applications."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"qwen3.7-plus","supported_endpoint_types":["chat/completions"],"model_name":"qwen3.7-plus","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"qwen3.7-plus","provider_plans":[{"prefix":"aliyun","sale_pricing":{"input_price":0.61768000,"unit":"1M tokens","scheme":"split_token","output_price":2.47058000,"breakdown":[{"metric":"input","price":0.61768000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06160000,"unit":"1M tokens"},{"metric":"cache_write","price":0.77210000,"unit":"1M tokens"},{"metric":"output","price":2.47058000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":3.52940000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"cache_read","price":0.08800000,"unit":"1M tokens"},{"metric":"cache_write","price":1.10300000,"unit":"1M tokens"},{"metric":"output","price":3.52940000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["text","image-understanding"],"context_length":1000000,"display_name":"qwen3.7-plus","documentation_url":null,"series_id":"qwen","release_date":"2026-06-01","sale_pricing":{"input_price":0.61768000,"unit":"1M tokens","scheme":"split_token","output_price":2.47058000,"breakdown":[{"metric":"input","price":0.61768000,"unit":"1M tokens"},{"metric":"cache_read","price":0.06160000,"unit":"1M tokens"},{"metric":"cache_write","price":0.77210000,"unit":"1M tokens"},{"metric":"output","price":2.47058000,"unit":"1M tokens"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":3.52940000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"cache_read","price":0.08800000,"unit":"1M tokens"},{"metric":"cache_write","price":1.10300000,"unit":"1M tokens"},{"metric":"output","price":3.52940000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.7000,"description":{"zh-CN":"通义千问图像 3（Qwen Image 3）是通义千问推出的一体化图像生成与编辑模型。该模型支持精准渲染文字以及小至 10 像素的细节，同时相比前代版本拥有更丰富的世界知识库。","en":"Qwen Image 3 is an all‑in‑one image generation and editing model released by Qwen. It supports accurate text rendering and fine details down to 10 pixels, and features a richer world knowledge base compared with its predecessor."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"qwen-image-3.0","supported_endpoint_types":["images/generations"],"model_name":"qwen-image-3.0","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"Qwen","zh-CN":"千问"},"public_slug":"qwen-image-3-0","provider_plans":[{"prefix":"aliyun","sale_pricing":{"unit":"image","scheme":"unit","price":0.01855000,"breakdown":[{"metric":"image","price":0.01855000,"unit":"image"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"通义千问","zh-CN":"通义千问"},"id":"channel_CSckPCLDXnmveuTa","pricing":{"scheme":"unit","price":0.02650000,"unit":"image","breakdown":[{"metric":"image","price":0.02650000,"unit":"image"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","capabilities":["image"],"context_length":null,"display_name":"qwen-image-3.0","documentation_url":null,"series_id":"qwen","release_date":"2026-08-05","sale_pricing":{"unit":"image","scheme":"unit","price":0.01855000,"breakdown":[{"metric":"image","price":0.01855000,"unit":"image"}]},"sale_discount":0.7000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dltt1tijrm-zxd1bs.png","pricing":{"scheme":"unit","price":0.02650000,"unit":"image","breakdown":[{"metric":"image","price":0.02650000,"unit":"image"}]},"status":"ACTIVE","max_output_tokens":null},{"sale_enabled":true,"min_sale_discount":0.6000,"description":{"zh-CN":"GLM‑5.2 是面向长上下文任务时代打造的旗舰模型，支持具备实际可用性的 100 万 token 上下文窗口，经验证可承载项目级工程上下文。长周期任务执行更加稳定，对工程标准的遵循更为可靠，开发场景任务成功率进一步提升。","en":"GLM‑5.2 is a flagship model built for the era of long‑context tasks. It supports a practically‑usable 1M‑token context window, which has been verified to hold project‑level engineering context. It achieves more stable execution of long‑horizon tasks, more reliable compliance with engineering standards, and further‑improved success rates for development scenarios."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"glm-5.2","supported_endpoint_types":["chat/completions"],"model_name":"glm-5.2","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"public_slug":"GLM-5.2","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"}]},"status":"available","recommended":true},{"prefix":"ainoworkz","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"AinoWork‑china","zh-CN":"AinoWork‑china"},"id":"channel_UNui1JuGXxj7scNM","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"}]},"status":"available","recommended":false}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text"],"context_length":1000000,"display_name":"glm-5.2","documentation_url":null,"series_id":"glm","release_date":"2026-06-16","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"}]},"sale_discount":0.6000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.6000,"description":{"zh-CN":"GLM‑5.1 是智谱 AI 面向复杂编码与长周期任务场景打造的高性能模型。编码能力得到大幅增强，长时任务能力显著提升。可在单次任务中实现最长 8 小时持续自主运行，完成从规划、执行到迭代优化的完整闭环，输出可用于生产环境的结果。","en":"GLM-5.1 is a high-performance model built by Zhipu AI for complex coding and long-horizon task scenarios. It features substantially strengthened coding capabilities and notable improvements for long-duration tasks. It can operate continuously and autonomously for up to 8 hours within a single task, completing the full loop from planning and execution to iterative optimization and delivering production-grade outputs."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"glm-5.1","supported_endpoint_types":["chat/completions"],"model_name":"glm-5.1","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"public_slug":"glm-5.1","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"ainoworkz","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"AinoWork‑china","zh-CN":"AinoWork‑china"},"id":"channel_UNui1JuGXxj7scNM","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text"],"context_length":200000,"display_name":"glm-5.1","documentation_url":null,"series_id":"glm","release_date":"2026-04-07","sale_pricing":{"input_price":0.70590000,"unit":"1M tokens","scheme":"split_token","output_price":2.47056000,"breakdown":[{"metric":"input","price":0.70590000,"unit":"1M tokens"},{"metric":"cache_read","price":0.17646000,"unit":"1M tokens"},{"metric":"output","price":2.47056000,"unit":"1M tokens"}]},"sale_discount":0.6000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.8000,"description":{"zh-CN":"混元Hy4 preview总参数770B、激活参数49B，重点面向Agent、Coding与生产力场景优化，强化复杂任务中的理解、规划、工具调用与持续执行能力。适用于Coding Agent、复杂工具调用以及各类需要多步骤规划和持续执行的Agent工作流。","en":"Hunyuan Hy4 preview has 770B total parameters and 49B activated parameters. It is optimized with a focus on Agent, Coding and productivity scenarios, enhancing its capabilities for comprehension, planning, tool‑calling and sustained execution for complex tasks. It is suitable for Coding Agents, sophisticated tool‑calling, and all kinds of Agent workflows that require multi‑step planning and continuous execution."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"hy4-preview","supported_endpoint_types":["chat/completions"],"model_name":"hy4-preview","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"hy","zh-CN":"混元"},"public_slug":"Hy4 preview","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":0.70592000,"unit":"1M tokens","scheme":"split_token","output_price":2.11768000,"breakdown":[{"metric":"input","price":0.70592000,"unit":"1M tokens"},{"metric":"output","price":2.11768000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03528000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.8000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":2.64710000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"output","price":2.64710000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/2sru9rkxpu-rto8c.png","capabilities":["text"],"context_length":1000000,"display_name":"hy4-preview","documentation_url":null,"series_id":"hy","release_date":"2026-08-31","sale_pricing":{"input_price":0.70592000,"unit":"1M tokens","scheme":"split_token","output_price":2.11768000,"breakdown":[{"metric":"input","price":0.70592000,"unit":"1M tokens"},{"metric":"output","price":2.11768000,"unit":"1M tokens"},{"metric":"cache_read","price":0.03528000,"unit":"1M tokens"}]},"sale_discount":0.8000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/2sru9rkxpu-rto8c.png","pricing":{"scheme":"split_token","input_price":0.88240000,"output_price":2.64710000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.88240000,"unit":"1M tokens"},{"metric":"output","price":2.64710000,"unit":"1M tokens"},{"metric":"cache_read","price":0.04410000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":64000},{"sale_enabled":true,"min_sale_discount":0.9000,"description":{"zh-CN":"智谱最新旗舰模型，采用规模扩大数十倍的长周期任务环境、更加丰富多元的环境类型，并延长后训练周期。编码体验较前代提升 50%，在 Terminal Bench 3.0 等公开基准中位列开源模型第一。","en":"Zhipu’s latest flagship model adopts long‑horizon task environments scaled up by dozens of times, a richer and more diverse set of environment types, and extended post‑training cycles. It brings a 50% improvement in coding experience compared with its predecessor and ranks first among open‑source models on public benchmarks including Terminal Bench 3.0."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"glm-5.3","supported_endpoint_types":["chat/completions"],"model_name":"glm-5.3","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"public_slug":"GLM-5.3","provider_plans":[{"prefix":"tencent","sale_pricing":{"input_price":1.05885000,"unit":"1M tokens","scheme":"split_token","output_price":3.70584000,"breakdown":[{"metric":"input","price":1.05885000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26469000,"unit":"1M tokens"},{"metric":"output","price":3.70584000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.9000,"name":{"en":"腾讯云","zh-CN":"腾讯云"},"id":"channel_cNiY193eBS9vWG7n","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text"],"context_length":1000000,"display_name":"glm-5.3","documentation_url":null,"series_id":"glm","release_date":"2026-08-19","sale_pricing":{"input_price":1.05885000,"unit":"1M tokens","scheme":"split_token","output_price":3.70584000,"breakdown":[{"metric":"input","price":1.05885000,"unit":"1M tokens"},{"metric":"cache_read","price":0.26469000,"unit":"1M tokens"},{"metric":"output","price":3.70584000,"unit":"1M tokens"}]},"sale_discount":0.9000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","pricing":{"scheme":"split_token","input_price":1.17650000,"output_price":4.11760000,"unit":"1M tokens","breakdown":[{"metric":"input","price":1.17650000,"unit":"1M tokens"},{"metric":"cache_read","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":4.11760000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000},{"sale_enabled":true,"min_sale_discount":0.6000,"description":{"zh-CN":"DeepSeek V4 Flash Vision Exp 是 DeepSeek 发布的实验性视觉增强变体，基于 DeepSeek V4 Flash 0731 模型构建。该版本新增图像理解能力，同时在智能体、推理及通用知识任务上保持与基座模型同等文本性能。它属于稀疏混合专家（MoE）模型，总参数量 2840 亿，激活参数量 130 亿。","en":"DeepSeek V4 Flash Vision Exp is an experimental vision‑enhanced variant released by DeepSeek, built upon the DeepSeek V4 Flash 0731 model. This iteration adds image‑understanding capabilities while maintaining the base model’s textual performance on agent, reasoning and general‑knowledge tasks. It is a sparse Mixture‑of‑Experts (MoE) model with 284 billion total parameters and 13 billion activated parameters."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"deepseek-v4-flash-vision-exp","supported_endpoint_types":["chat/completions"],"model_name":"deepseek-v4-flash-vision-exp","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"deepseek","zh-CN":"deepseek"},"public_slug":"deepseek-v4-flash-vision-exp","provider_plans":[{"prefix":"openrouter","sale_pricing":{"input_price":0.30884000,"unit":"1M tokens","scheme":"split_token","output_price":0.92645000,"breakdown":[{"metric":"input","price":0.30884000,"unit":"1M tokens"},{"metric":"output","price":0.92645000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01029000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.7000,"name":{"en":"OpenRouter","zh-CN":"OpenRouter"},"description":{"en":null,"zh-CN":"OpenRouter"},"id":"channel__MohbHygsuJk3oBY","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"available","recommended":false},{"prefix":"or2","sale_pricing":{"input_price":0.26472000,"unit":"1M tokens","scheme":"split_token","output_price":0.79410000,"breakdown":[{"metric":"input","price":0.26472000,"unit":"1M tokens"},{"metric":"output","price":0.79410000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00882000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.6000,"name":{"en":"OR2","zh-CN":"OR2"},"description":{"en":"OR2","zh-CN":"OR2"},"id":"channel_0WqBSUjNZ_E9gJla","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","capabilities":["text"],"context_length":1000000,"display_name":"deepseek-v4-flash-vision-exp","documentation_url":null,"series_id":"deepseek","release_date":"2026-08-22","sale_pricing":{"input_price":0.26472000,"unit":"1M tokens","scheme":"split_token","output_price":0.79410000,"breakdown":[{"metric":"input","price":0.26472000,"unit":"1M tokens"},{"metric":"output","price":0.79410000,"unit":"1M tokens"},{"metric":"cache_read","price":0.00882000,"unit":"1M tokens"}]},"sale_discount":0.6000,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlssjpi02v-852p3e.png","pricing":{"scheme":"split_token","input_price":0.44120000,"output_price":1.32350000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.44120000,"unit":"1M tokens"},{"metric":"output","price":1.32350000,"unit":"1M tokens"},{"metric":"cache_read","price":0.01470000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":384000},{"sale_enabled":true,"min_sale_discount":0.1500,"description":{"zh-CN":"GPT Image 2.5 Flare 是 OpenAI 推出的图像生成与编辑模型，属于 GPT Image 2.5 系列里主打速度的版本。适合大批量日常图像生成、创作者内容制作，以及通过专用图像 API 快速原型开发。","en":"GPT Image 2.5 Flare is an image generation and editing model from OpenAI, positioned as the speed-oriented tier of the GPT Image 2.5 series. It is suited to high-volume everyday generation, creator content, and rapid prototyping via the dedicated Images API."},"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"public_id":"gpt-image-2.5-flare","supported_endpoint_types":["images/generations"],"model_name":"gpt-image-2.5-flare","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"gpt","zh-CN":"GPT"},"public_slug":"GPT Image 2.5 Flare","provider_plans":[{"prefix":"aotur","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_enabled":true,"sale_discount":0.1500,"name":{"en":"Aotur","zh-CN":"Aotur"},"id":"channel_tJuyPqNnP3s04JKb","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"available","recommended":true}],"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","capabilities":["image"],"context_length":400000,"display_name":"gpt-image-2.5-flare","documentation_url":null,"series_id":"gpt","release_date":"2026-09-11","sale_pricing":{"unit":"1M tokens","scheme":"unit","price":1.20000000,"breakdown":[{"metric":"input","price":1.20000000,"unit":"1M tokens"},{"metric":"output","price":4.50000000,"unit":"1M tokens"},{"metric":"cache_read","price":0.30000000,"unit":"1M tokens"}]},"sale_discount":0.1500,"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt7gm9b9v-s0zqn3.png","pricing":{"scheme":"unit","price":8.00000000,"unit":"1M tokens","breakdown":[{"metric":"input","price":8.00000000,"unit":"1M tokens"},{"metric":"output","price":30.00000000,"unit":"1M tokens"},{"metric":"cache_read","price":2.00000000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":null},{"icon_url":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","capabilities":["text"],"min_sale_discount":null,"description":{"zh-CN":"GLM-5.3-FlashX 是 Z.ai GLM-5.3-Flash 的高速版本，属于原生多模态模型，推理速度最高可达 200 token/s。该模型基于相同的混合稀疏 + 线性注意力架构构建（总参数量 320B，激活参数量 18B），具备 100 万 token 上下文窗口，适用于高效代码编写、视觉理解以及长周期智能代理任务。","en":"GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture (320B total parameters, 18B active), it is suited for efficient coding, visual understanding, and long-horizon agent tasks with a 1M-token context window."},"context_length":128000,"related_model_ids":[],"series_description":{"en":"","zh-CN":""},"display_name":"GLM-5.3-FlashX","documentation_url":null,"public_id":"glm-5.3-flashx","series_id":"glm","supported_endpoint_types":["chat/completions"],"model_name":"glm-5.3-flashx","release_date":"2026-09-20","faq":null,"supported_protocols":["OpenAI-compatible"],"series_name":{"en":"glm","zh-CN":"智谱"},"series_logo":"https://sh-assets.oss-cn-hangzhou.aliyuncs.com/model-series-icon/dlt3awzu5q-1jx2pp7.png","public_slug":"GLM-5.3-FlashX","pricing":{"scheme":"split_token","input_price":0.29410000,"output_price":1.02940000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":1.02940000,"unit":"1M tokens"},{"metric":"cache_read","price":0.08380000,"unit":"1M tokens"}]},"status":"ACTIVE","max_output_tokens":128000,"provider_plans":[{"prefix":"z-ai","sale_pricing":null,"name":{"en":"智谱","zh-CN":"智谱"},"id":"channel_IIk_fiARtbaLIHAz","pricing":{"scheme":"split_token","input_price":0.29410000,"output_price":1.02940000,"unit":"1M tokens","breakdown":[{"metric":"input","price":0.29410000,"unit":"1M tokens"},{"metric":"output","price":1.02940000,"unit":"1M tokens"},{"metric":"cache_read","price":0.08380000,"unit":"1M tokens"}]},"status":"available","recommended":true}]}],"total":45}