Felo 发布 GPT-6 Astra:105 万上下文窗口与 Agent 工具集成
Felo 平台近日宣布其 OpenAPI 接口正式支持 GPT-6 Astra,这是 OpenAI 最新推出的旗舰级模型。针对当前 AI 应用中长文档处理、复杂代码生成及多步骤 Agent 工作流面临的上下文碎片化挑战,GPT-6 Astra 通过其惊人的上下文容量和统一的 API 表面,为开发者提供了全新的解决方案。
核心突破:超长上下文与全栈能力
GPT-6 Astra 被定义为 OpenAI 最强大的模型之一,专注于复杂推理、编程、计算机操作、研究及文档创建。其核心规格包括:
- 上下文窗口:高达 1,050,000 tokens,足以容纳完整的代码库摘要、技术规范及多轮对话历史。
- 最大输出:支持 128,000 tokens 的长文本生成。
- 推理设置:提供
low,medium,high,xhigh,max五种推理努力程度选项,开发者可根据质量与延迟预算灵活调整。 - 知识截止:截至 2026 年 4 月 30 日。
统一接口:三种协议,一个模型 ID
为了简化迁移路径,Felo OpenAPI 为 GPT-6 Astra 提供了三种兼容的请求表面,允许开发者在不修改客户端逻辑的情况下切换协议:
- Chat Completions:标准的聊天补全接口。
- Responses:Anthropic 风格的响应接口,支持更丰富的工具调用控制。
- Messages:兼容 Claude 等客户端的消息协议。
开发者只需将 model 参数设置为 gpt-6-astra,即可利用这些接口调用模型。该模型原生支持多种 Agent 工具,包括 Web 搜索、文件搜索、代码解释器、托管 Shell、MCP (Model Context Protocol) 及工具搜索等。
成本效益:更具竞争力的定价策略
Felo 在保持与 OpenAI 官方定价基准一致的同时,推出了针对 Felo 平台的专属优惠。根据 Felo 模型页面显示:
- 输入价格:$10.00 / 1M tokens
- 输出价格:$50.00 / 1M tokens
Felo 宣称其启动价格最高可达官方 API 价格的 50% 以下。此外,Felo 还优化了缓存策略,缓存输入 token 的写入成本仅为标准输入的 1.25 倍,并在特定请求规模下提供批量与 Flex 模式的折扣。这种灵活的计费结构使得 GPT-6 Astra 成为企业级应用预算内的理想选择。
快速上手指南
开发者可通过以下五个步骤快速集成 GPT-6 Astra:
- 获取 API Key:在 Felo 控制台创建密钥并设置环境变量。
- 配置端点:选择
https://openapi.felo.ai/api/v1/chat/completions等相应端点。 - 设置模型 ID:在请求体中将
model设为gpt-6-astra。 - 启用工具与结构化输出:利用
tools、tool_choice和response_format参数控制 Agent 行为。 - 开启流式传输:设置
stream: true以接收服务器发送事件 (SSE)。
通过 Playground 进行测试,确保在正式部署前验证推理设置、延迟表现及成本估算,是最佳实践。
“GPT-6 Astra 将推理、编码、长上下文分析及 Agent 工作流统一在一个模型条目下,为团队提供了通过 Felo OpenAPI 迁移的清晰路径。” —— Felo 官方团队
结语
Felo 此次发布的 GPT-6 Astra 不仅提升了模型本身的算力上限,更通过兼容的 API 设计降低了技术门槛。对于需要处理海量数据和高复杂度任务的团队而言,这是一个兼具性能与成本优势的重要更新。