Kimi Cookbook

This chapter is available in Chinese only. The content below has not been translated.

04 / 第四章

四模式 · 快答、深想、交办、集群.

输入框旁边的模式开关, 我自己长期没动过 —— Instant / Thinking / Agent / Agent Swarm, 是 Kimi 把「答你一句」和「替你做成」分开的旋钮。挑错了, 要么干等, 要么不够使。这章我给一张对照加四个场景, 和一条贯穿始终的判断。

MD海报

Kimi 的输入框不只是个打字框 —— 旁边有一个我自己长期没怎么动过的模式开关: Instant、Thinking、Agent、Agent Swarm。多数人一直留在默认那档, 没意识到换一档, 它干的活就完全是另一回事。 这四个模式, 是 Kimi 把「答你一句」和「替你做成」分开的旋钮。1注 1Kimi 帮助中心 · Agent 模式 —— 截至 2026-07, 输入框可在 Instant / Thinking / Agent / Agent Swarm 之间切换; Agent 模式不只回答, 直接产出网站 / 幻灯 / 文档 / 表格等成品。挑错了, 要么简单问题让你干等, 要么把一句话能答的事支起一整套 agent。这章我给一张对照加四个场景, 以及一条贯穿始终的判断 —— 挑能办成事的最低那一档。

I

四个模式, 是从「答」到「做」的四档.

这四个模式排在一条阶梯上: 从「给你一句话」到「替你干一整件事」。越往右, 它替你扛得越多, 你付的时间、额度和风险也越大。
Instant · 快答
不开思考, 秒回, 几乎不耗什么。查事实、改错字、要立刻拿到一句话 —— 这一档够。
Thinking · 深想
先在内部推几步再答, 拿等待换深度。多步推理、算账、写码、要核对的活(思考在 K2.6 上可关, K3 与 K2.7-Code 永远开)。<Footnote n={3} />
Agent · 交办
不只给答案, 直接做出网站 / 幻灯 / 文档 / 表格。一跑就吃掉共享额度池里的一份(各档约合 6–360 个)和并发额度, 还得等它把成品做完。细看第五章。
Agent Swarm · 集群
派一群子 agent 并行干, 烧的是按档限次的集群额度(Moderato 25 次 / Allegretto 50 / Allegro 120, K3 驱动, 仍是 Beta), 一次消耗约为普通 Agent 任务的数倍。<Footnote n={2} />细看第六章。
一句话记住分界: 前两档(Instant / Thinking)是「它答、你做」, 后两档(Agent / Agent Swarm)是「它做、你验」。你这次到底要一段回答, 还是要一件成品, 决定了你该停在哪一档。
四个模式从快答到集群的上升阶梯, 越往右代价越大四个模式 · 从「答你」到「替你做」挑能办成事的最低那一档 —— 往右, 时间 / 额度 / 自主都在涨它答 · 你做它做 · 你验时间 / 额度 / 自主 ↑Instant 快答秒回, 不思考Thinking 深想先推几步再答Agent 交办直接做出成品Agent Swarm一群子 agent 并行答你替你做
Instant → Thinking → Agent → Agent Swarm, 越往右它替你扛得越多, 时间、额度、自主也越大。

II

四个场景, 各停一档.

#场景一 · 「这个 API 报错是什么意思」.

贴一段报错问原因 —— 要的是一句话。开 Instant, 秒回, 接着干活。这种活开 Thinking 是白等十几秒, 开 Agent 是等十分钟换一句本该秒回的话。日常问答, 默认就该停在这里。

#场景二 · 「这笔账帮我核一遍」.

多步推理、容易算错一步就全错的活 —— 开 Thinking, 让它在内部先推几步。代价只是多等一点, 换来的是少犯低级错。边界: 它推它的, 你核你的; 深想提高正确率, 不豁免核对。

#场景三 · 「把这周的数据做成汇报 PPT」.

要的是一件能直接交的成品, 不只是建议 —— 上 Agent。它会自己拆任务、做页面、导出文件, 你等几分钟到十几分钟, 烧掉共享额度池里的一份。出发前把话说清: 受众是谁、要几页、什么风格。交办模式最贵的不是额度, 是它把一个偏掉的方向一口气做到底。成品到手先验再发, 别直接转发。

#场景四 · 「五十个网页, 给我一张竞品对照表」.

这活的特征是「多」不是「难」: 几十个网页要翻、十几份材料要读、一个问题要多个独立视角。单线干到天黑的事, 放一群子 agent 并行, 烧一次集群额度(Moderato 每月 25 次)。2注 2Kimi 帮助中心 · Agent Swarm —— Agent Swarm 是多智能体协作模式, 派出一群子 agent 并行干活、各自独立再归并, 面向大规模查找 / 处理 / 多视角的任务; 现由 Kimi K3 驱动(K3 集群)。截至 2026-07 仍带 Beta 说明, Moderato 档起可用(25 次 / Allegretto 50 次 / Allegro 120 次)。边界: 别为不存在的规模付费 —— 十个网页以内、一条线能读完的活, 一个 Agent 甚至 Thinking 就够, 动用 Swarm 纯属浪费次数。 我把四个场景收成一行判断: 先看活的形状, 再挑能办成它的最低那一档。
活的形状停在哪档实际代价
要一句话Instant秒回, 几乎不耗什么
要一段讲得通的推理Thinking多等十几秒
要一件能交的成品Agent几分钟 + 共享额度一份
要并行一大批 / 多视角Agent Swarm集群次数一次(每月按档限量)

III

默认够用, 别为「更高级」上更高的档.

一个常见的错觉是「上更高级的模式 = 更好的结果」。多数日常活, 停在前两档才对: 拿 Agent 去问一个事实, 是等十分钟换一句本该秒回的话; 拿 Swarm 去做一件单线就能办的事, 是为不存在的规模付费。把模式当工具挑, 不当「等级」追。

四个模式, 从「答你」到「替你做」; 我只挑能办成事的最低那一档.

四个模式, 从「答你」到「替你做」; 我只挑能办成事的最低那一档.

Kimi x Zhaphar

讨论

讨论.

评论区初始化中…