跳到正文

燎原 / 03 · 燎原驿

先把连接,
说清楚。

现在的中转站,
维护成本过高。

所以这里不把它包装成一个永远稳定的产品:眼下先连接现有服务,之后逐步接入免费的公益中转站,让更多人用更低的成本,找到合适的工具。

进入燎原驿

最近的模型 / 三种视角

模型会变化,
连接也该更轻。

模型是实际回答问题的人。
中转站只是把入口整理好。

OPENAI / GPT-600:16

GPT-6 Sol / GPT-6 Luna

一边多想几步,一边更快抵达。Sol 适合需要深度推演的任务,Luna 适合日常往返;具体可用模型,以燎原驿当前列表为准。

ANTHROPIC / CLAUDE00:20

Claude Opus 5.5

把复杂问题继续往下拆,也把长内容留在上下文里。它适合读、想、写都很长的工作,重点不是更响亮,而是更清楚。

ALIBABA / QWEN00:44

Qwen 3.8

国产模型也放进这次比较里。先看它怎样介绍自己,再回到具体任务和公开评测,慢慢判断适不适合。

公开榜单 / 致知

排名不是一句总分,
而是把事情做到了哪一步。

这份 2026 年 9 月 Agentic 月榜,把模型放进建模、移动端、动画、数据处理、图形性能和科学展示六类任务里。它记录完成质量,也留下模型需要多少帮助。

AGENTIC · CODE V32026-09 月榜

23 个模型 · 6 类开发任务 · 本页展示前 6 项记录

  1. 01
    GPT-6 Astra maxCodex CLI
    6 项实测4 次无需提示
    轻量A+iOSA+动画A+数据A图形B+科学A
  2. 02
    Fable 5 highClaude Code
    3 项实测1 次无需提示
    轻量A+iOSA+动画A数据图形科学
  3. 03
    Opus 5 maxClaude Code
    6 项实测4 次无需提示
    轻量AiOSA+动画B+数据D图形C科学B
  4. 04
    GPT-6 Sol maxCodex CLI
    3 项实测1 次无需提示
    轻量通过iOS通过动画B数据C图形科学B
  5. 05
    GPT-5.6 Sol maxCodex App
    5 项实测3 次无需提示
    轻量AiOSA动画B数据B图形C科学
  6. 06
    Kimi-K3 maxClaude Code
    6 项实测2 次无需提示
    轻量AiOSA动画B数据D+图形D科学C+

数据来自“致知|大模型智力长期追踪榜单”的 2026-09 Agentic 月榜,本页按原始顺序保留前六项记录,没有另算一个看似精确的总分。

A 档接近独立完成,B 通常说明问题后一轮可修复,C 需要多轮推进,D 需要较多人工协助;“通过”表示前代已获 A、因此不再重复测试,“—”表示该项未测。

查看致知完整榜单

现在 / 以后

先把三件事分开,
再看我们要走向哪里。

01

模型:决定谁来回答

GPT 或 Claude,是实际完成任务的模型。不同模型有不同的长处,也有不同的费用和权限。

02

API:把请求送进去

API 是软件与模型之间的通道。地址、Key 和模型名写对了,软件才知道该把问题交给谁。

03

中转站:先连接,后公益

当前维护成本过高,服务会保持克制。未来我们会沿着分享与开源的方向,逐步接入免费的公益中转站。

还不清楚 API 和 Key?先读《从 AI 到 API,一篇讲明白》

准备好了,再从这里进入。

打开燎原驿