
讯飞星火 API 是科大讯飞推出的模型即服务,2026 年当前模型矩阵分为两档:深度推理系列(Spark X2 旗舰 / Spark X1.5)与通用系列(Spark Ultra / Pro / Lite)。支持 OpenAI 兼容接口(base_url: https://spark-api-open.xf-yun.com/v1,Bearer Token 鉴权)、WebSocket 协议、Python/Java/Android/iOS/Windows/Linux SDK、REST API。X2/X1.5 推理模型定价 2-3 元/百万 tokens;Ultra 可免费领取;Lite 永久免费;个人认证送 20 万 tokens 免费包,企业认证送 100 万 tokens 免费包。国内直连,无需 VPN。
产品概述
讯飞星火于 2023 年 5 月首次发布,是国内最早一批向公众开放的对话大模型。2025 年 10 月 V4.0 Ultra 面向所有用户免费开放;2026 年 3 月 Max 版本套餐下线、后端服务升级为 Ultra;2026 年 4 月发布 Spark X2——星火最新深度推理模型,数学、推理、语言理解、智能体方向效果重点提升,支持动态调整深度思考模式(thinking 字段控制),输入 64K/输出 128K,支持 FunctionCall;同期 X1.5 推理模型输入输出均扩展至 64K。当前模型矩阵:深度推理 X2(旗舰,2-3 元/百万 tokens)/ X1.5(2-3 元/百万 tokens)/ Ultra(高性价比,重点提升指令跟随、文本生成、FunctionCall,可免费领取)/ Pro(强性能,128K 上下文版本,5 元/百万 tokens)/ Lite(轻量级,永久免费,8K 上下文)。平台累计服务比亚迪、长虹、海康威视、中石油、华中师范大学、美图、迪思公关、真我等头部企业,覆盖 300+ 应用场景,共建 20+ 行业大模型。
核心能力
- 文本生成:X2 / X1.5 / Ultra / Pro / Lite 全档通用对话、写作、代码、翻译
- 深度推理:X2 支持动态调整思考模式(thinking 字段),数学/推理/语言理解/智能体 SOTA
- 长上下文:X2 输入 64K/输出 128K;X1.5 输入输出均 64K;Ultra 32K;Pro 8K 或 128K(Pro-128K 版本);Lite 8K
- 语音与多模态:语音识别(ASR,支持 202 种方言 + 37 种多语种)、超拟人语音合成(MOS 4.5)、一句话复刻音色克隆、图片生成、图片理解(HiDream)
- 智能体:FunctionCall、Web Search 插件、天气/日期/诗词等内置插件、星火助手、角色模拟
- 高级功能:OpenAI 兼容、Tool Use、JSON Output、智能 PPT 生成、星火知识库(RAG)、可定制化 API(链接本地知识库+联网检索)
优势亮点
- 中文语音能力业界第一:讯飞 20 年语音技术积累,ASR 支持 202 种方言 + 37 种多语种,超拟人 TTS MOS 4.5,一句话复刻音色——这是 ChatGPT/Claude 都不具备的独特优势
- Spark X2 深度推理:支持动态调整思考模式,数学/推理/智能体效果重点提升,输入 64K/输出 128K
- 价格极致亲民:X2/X1.5 推理模型仅 2-3 元/百万 tokens;Ultra 免费领取;Lite 永久免费;Pro 128K 上下文 5 元/百万 tokens
- 免费额度清晰:个人认证 20 万 tokens、企业认证 100 万 tokens 免费包;简享包 300 元/1 亿 tokens(3 元/百万 tokens),套餐四可低至 2 元/百万 tokens
- OpenAI 完全兼容:base_url
https://spark-api-open.xf-yun.com/v1,原 GPT 代码改地址即可跑 - 全栈能力矩阵:文本/语音识别/语音合成/图片生成/图片理解/PPT 生成/角色模拟/知识库——一站式 AI 能力平台
- 政企落地经验国内第一梯队:服务比亚迪、中石油、海康威视、长虹、华为等头部企业,共建 20+ 行业大模型
- 国内直连:国内手机号+实名认证即可注册,无需 VPN
- 多 SDK 支持:Python / Java / Android / iOS / Windows / Linux 全平台 SDK,接入门槛低
短板
- 上下文长度偏短:X2 输入 64K/输出 128K,Ultra 仅 32K,相比 DeepSeek-V4(1M)、GLM-5.2(500K)、Gemini 3.1 Pro(2M)差距显著,超长文档场景受限
- 通用推理能力弱于第一梯队:X2 在复杂数学/科学推理上不及 Claude Opus 4.8 / GPT-5.5 / DeepSeek V4-Pro
- 免费额度相对保守:个人 20 万 tokens、企业 100 万 tokens,远不如阿里百炼(¥100 万 Tok)、智谱(2000 万 Tokens)大方
- 模型版本命名复杂:Ultra/Max/Pro/Lite/X2/X1.5 多版本并存,Max 套餐 2026 年 3 月 10 日已下线,老用户迁移成本高
- 海外节点缺失:主要服务国内,海外开发者需走合规中转
- 第三方模型不覆盖:仅提供讯飞自研模型,无 DeepSeek/Qwen/GLM 等第三方模型(不像硅基流动/百炼那样聚合)
- 多模态能力不均衡:语音能力业界第一,但视觉/视频能力弱于 GPT-5.5 / Claude Opus 4.8
- 免费活动额度动态:”1 亿 tokens 免费领”等活动为限时促销,以控制台实时为准
适用人群
国内开发者、语音交互应用(ASR/TTS/音色克隆)、政企合规项目(教育/汽车/能源/家电)、中文长文档处理、Agent 工作流、想薅 Lite 永久免费做原型验证的爱好者、需要全栈 AI 能力(文本+语音+图像+PPT)的团队。
相关导航


MiniMax API

智谱 BigModel

OpenAI API

TokenHub
硅基流动

OpenRouter

