Claude 的「顾问策略」:让便宜模型遇到难题时自动请教贵模型
Anthropic 前几天发了一篇官方博客,核心就一句话:让便宜模型跑日常任务,只在遇到难题时请教贵模型。这个思路叫「顾问策略」(Advisor Strategy),效果出乎意料地好,而且普通人在现有的智能体平台里就能实现。
围绕 AI 工作流、Agent 设计和内容系统的每日更新。
Anthropic 前几天发了一篇官方博客,核心就一句话:让便宜模型跑日常任务,只在遇到难题时请教贵模型。这个思路叫「顾问策略」(Advisor Strategy),效果出乎意料地好,而且普通人在现有的智能体平台里就能实现。
为啥很少很少有人讨论 Github Copilot?全网追捧 Claude Opus Token 额度,「再给我一口纯的 Opus」都成了网络热梗,各种中转站靠卖假 Claude 模型赚翻的当口,我一直以为 Github Copilot 肯定也是有很强风控的……直到随手用了一张国内信用卡就成功打开,发现所有 Claude 模型随便用,还不按 Token 计费。突然感觉这个世界好魔幻。
最近快手万擎发布了 KAT-Coder-Pro V2。今天咱们直接来看看这个模型在实际业务里的真实站位。
前阵子DeepSeek的开源,曾让硅谷巨头们重新审视他们一直坚信的算力神话。而最近,中国AI的另一股力量又给出了新的底层架构解法。
最近从 OpenClaw 开始,Agent 落地的速度明显加快了。
OpenAI 昨天发布了 GPT-5.4,这是他们整合了推理、编码和计算机控制能力的新一代旗舰模型。作为日课,我不打算写那种吸引眼球的新闻稿,而是基于权威数据和实测,客观分析这个模型的真实能力。
很多圈友问我,我是怎么选模型的,以及怎么选到便宜的模型渠道。其实真正的问题是:你在为什么场景花钱。场景不同,模型选择完全不同。
3月3日,OpenAI 和谷歌同一天各发了一个新模型。OpenAI 发的是 GPT-5.3 Instant,谷歌发的是 Gemini 3.1 Flash-Lite。两个定位完全不同,但都有一个共同点:官方宣传和实际数据之间,有些值得说清楚的地方。