【水】感觉Copilot的GPT应该是微软专门为了agent微调的
rt,感觉感觉微软Copilot的GPT 5.6 Reasoning可能是专为 Agent 设计/微调的模型
因为它的CoT(思维链)几乎全是结构化的思考,类似是这样的:
标题(确定意图类别)
正文(明确下一步操作)
像跟给自己的下一步操作写操作日志 一样的流水章,而不是通常模型的碎碎念。
对比一下
传统长思考:“我现在要检查一下连接池,让我想想,连接池里的 Take 和 Warm 行为可能影响 TTFB,所以我先用 shell 看一下日志,另外 PreheatPool 也需要关注...”(冗长且不易解析)
Agent 结构化思考:
标题(确定意图类别)
正文(明确下一步操作)
**Deciding next action**
It seems like the task requires inspecting the connection pool and its warm-up criteria. I'll proceed with executing the shell tool to inspect the connection pool logs.
这样好处就是响应快,可解析性强,省token,在agent环境下很好
缺点就是牺牲了思考深度,智商可能表现的较低。对模型来说容错率低(因为不能反复纠错,思考,换方向)。对于数学,深度推理任务可能表现不佳。
以上均为本人猜测,不代表模型真实训练目标,亦不代表模型思维链(CoT)完整如此,不排除这个可能为模型二次加工的概览。

客户端记录的思考/输出对比图






