This chapter is available in Chinese only. The content below has not been translated.
— 01 / 第一章Chapter 1
引子 · 我印象里的 Kimi 是旧的引子 · 我印象里的 Kimi 是旧的.
我对 Kimi 的印象, 曾停在「长文本」那一年 —— 付了费, 却只用它读长文、写中文。到 K3 回头一看, 它早长成一套对标 OpenAI / Anthropic 的全栈。这本书, 是我把这套栈一块块拆开看的记录。我对 Kimi 的印象, 曾停在「长文本」那一年 —— 付了费, 却只用它读长文、写中文。到 K3 回头一看, 它早长成一套对标 OpenAI / Anthropic 的全栈。这本书, 是我把这套栈一块块拆开看的记录。
5 分钟 · 发布 2026.06 · 更新 2026.075 Min · Released 2026.06 · Updated 2026.07
我记住 Kimi, 是在 2024 年: 一个能一口气读进几十万字的框 —— 把一整本书、一份几百页的合同丢进去, 它真能读完、答得上。那一下确实惊艳。我为这个框付了费, 然后用了两年: 读长文, 写中文, 没了。我记住 Kimi, 是在 2024 年: 一个能一口气读进几十万字的框 —— 把一整本书、一份几百页的合同丢进去, 它真能读完、答得上。那一下确实惊艳。我为这个框付了费, 然后用了两年: 读长文, 写中文, 没了。
到 K3 发布, 我回官网看了一眼, 才发现自己的印象停在一张过期快照上: 它早长成一套对标 OpenAI 和 Anthropic 的全栈 —— 2.8 万亿参数、1M 上下文的旗舰, 能做出网站幻灯文档表格的 Agent, 调度几百个子 agent 的 Agent Swarm, Deep Research, 跑在终端的 Kimi Code, 底下垫着一套 OpenAI 兼容、权重开源的 API。1注 1Note 1Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。我大概率只用到了这套栈的一个角。这本书, 是我把这个角之外的部分一块块拆开看过的记录。到 K3 发布, 我回官网看了一眼, 才发现自己的印象停在一张过期快照上: 它早长成一套对标 OpenAI 和 Anthropic 的全栈 —— 2.8 万亿参数、1M 上下文的旗舰, 能做出网站幻灯文档表格的 Agent, 调度几百个子 agent 的 Agent Swarm, Deep Research, 跑在终端的 Kimi Code, 底下垫着一套 OpenAI 兼容、权重开源的 API。1注 1Note 1Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。我大概率只用到了这套栈的一个角。这本书, 是我把这个角之外的部分一块块拆开看过的记录。
— I
我停在了 2024 年那张快照上我停在了 2024 年那张快照上.
Kimi 出圈靠的是长上下文: 一次吃下几万、几十万字, 别人要分段喂, 它一口吞; 加上中文写得顺, 它成了很多人手里那个「读长文、写中文」的工具 —— 包括我。这张底牌今天还在, 也仍是强项, 这本书后面照样会用到它。但只认得这张底牌, 看到的就是两年前的它。Kimi 出圈靠的是长上下文: 一次吃下几万、几十万字, 别人要分段喂, 它一口吞; 加上中文写得顺, 它成了很多人手里那个「读长文、写中文」的工具 —— 包括我。这张底牌今天还在, 也仍是强项, 这本书后面照样会用到它。但只认得这张底牌, 看到的就是两年前的它。
判断它的标准, 也跟着变了。2024 年我问的是「它能不能读完这份长文」, 一道是非题; 现在该问的是「这套栈里, 哪一面对得上我手头这类活」, 一张地图。从是非题换成地图 —— 这是我写这本书的原因, 也是读它的方法。判断它的标准, 也跟着变了。2024 年我问的是「它能不能读完这份长文」, 一道是非题; 现在该问的是「这套栈里, 哪一面对得上我手头这类活」, 一张地图。从是非题换成地图 —— 这是我写这本书的原因, 也是读它的方法。
2025-07K2开源的万亿 MoE, 出圈之作开源的万亿 MoE, 出圈之作
2025-11K2 Thinking加上推理(思考)加上推理(思考)
2026-01K2.5多模态 + Agent Swarm多模态 + Agent Swarm
2026-04K2.6原生多模态旗舰原生多模态旗舰
2026-06K2.7-Code专攻编码专攻编码
2026-07K32.8 万亿参数 · 1M 上下文2.8 万亿参数 · 1M 上下文
一年六代 —— 我记忆里的 Kimi, 已经是好几代以前的事了。截至 2026-07。一年六代 —— 我记忆里的 Kimi, 已经是好几代以前的事了。截至 2026-07。
— II
它长成了一套对标前沿的栈它长成了一套对标前沿的栈.
把它的产品线摆出来, 几乎能跟 OpenAI 和 Anthropic 一一对上。旗舰模型 K3 是 2.8 万亿参数的 MoE、1M token 上下文, 原生多模态、思考永远开着, 权重官方承诺 7 月 27 日前放出。2注 2Note 2Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。往上按官方的摆法是五件套: 网页里的 Kimi 本体(聊天加五档会员, 外带 Agent 做成品、Agent Swarm、Deep Research、Kimi Claw 一排入口)、桌面端的 Kimi Work、终端里的 Kimi Code、浏览器扩展 Kimi WebBridge, 和最底下的 Kimi Platform 开放平台 API。1注 1Note 1Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。把它的产品线摆出来, 几乎能跟 OpenAI 和 Anthropic 一一对上。旗舰模型 K3 是 2.8 万亿参数的 MoE、1M token 上下文, 原生多模态、思考永远开着, 权重官方承诺 7 月 27 日前放出。2注 2Note 2Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。往上按官方的摆法是五件套: 网页里的 Kimi 本体(聊天加五档会员, 外带 Agent 做成品、Agent Swarm、Deep Research、Kimi Claw 一排入口)、桌面端的 Kimi Work、终端里的 Kimi Code、浏览器扩展 Kimi WebBridge, 和最底下的 Kimi Platform 开放平台 API。1注 1Note 1Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。Kimi 官网首页(kimi.com)—— 截至 2026-07 首屏标注「Kimi AI with K3 | Built for Agentic Coding & Knowledge Work」(中文站「K3 上线, 专为智能体编程与知识工作打造」), 产品入口排着 Chat / Slides / Websites / Docs / Sheets / Deep Research / Agent / Agent Swarm / Kimi Code / Kimi Claw(入口已迁 /bot), 侧边栏另有 Kimi Work(Beta)。这是「它早不只是聊天框」最直接的一手证据。
「一一对上」只证明形态, 证明不了它们是一体的。让我改口叫它「栈」的, 是两层咬合。同一颗脑子: 四模式、Agent、Swarm、Kimi Code 背后是同一条模型线 —— K3 一发布, 官方把 Agent 集群也切到它驱动, 没有各产品各养各的模型。6注 6Note 6Kimi 帮助中心 · Agent Swarm —— 截至 2026-07, Agent Swarm 由 Kimi K3 驱动(K3 集群); 单次任务最多部署约 300 个子智能体同时工作。产品层随模型层一起换脑, 是「一套栈」而非「一组单品」的直接证据。Kimi 帮助中心 · Agent Swarm —— 截至 2026-07, Agent Swarm 由 Kimi K3 驱动(K3 集群); 单次任务最多部署约 300 个子智能体同时工作。产品层随模型层一起换脑, 是「一套栈」而非「一组单品」的直接证据。同一本账: 一个会员账号串起所有入口, 聊天之外的成品、研究、集群共享一个 token 额度池 —— 第九章会算到, Swarm 跑得猛, 是真的会把 Agent 的额度吃紧。7注 7Note 7Kimi 帮助中心 · 会员套餐价格 —— Agent、深度研究、PPT、Kimi Claw 等功能共享一个 token 额度池(次数只是按常见任务折算的估值), 只有 Kimi Code 是单独的池; 一个会员账号串起所有入口。截至 2026-07。Kimi 帮助中心 · 会员套餐价格 —— Agent、深度研究、PPT、Kimi Claw 等功能共享一个 token 额度池(次数只是按常见任务折算的估值), 只有 Kimi Code 是单独的池; 一个会员账号串起所有入口。截至 2026-07。一颗脑子加一本账, 动一层、其他层跟着动, 这是「栈」和「杂货铺」的区别。丑话也说在这: 生态那一层还薄 —— 插件、第三方集成、企业采购的成熟度, 都还追不上那两家。所以本书说「对标」, 说的是产品形态和模型能力两层; 生态这层, 先不算数。「一一对上」只证明形态, 证明不了它们是一体的。让我改口叫它「栈」的, 是两层咬合。同一颗脑子: 四模式、Agent、Swarm、Kimi Code 背后是同一条模型线 —— K3 一发布, 官方把 Agent 集群也切到它驱动, 没有各产品各养各的模型。6注 6Note 6Kimi 帮助中心 · Agent Swarm —— 截至 2026-07, Agent Swarm 由 Kimi K3 驱动(K3 集群); 单次任务最多部署约 300 个子智能体同时工作。产品层随模型层一起换脑, 是「一套栈」而非「一组单品」的直接证据。Kimi 帮助中心 · Agent Swarm —— 截至 2026-07, Agent Swarm 由 Kimi K3 驱动(K3 集群); 单次任务最多部署约 300 个子智能体同时工作。产品层随模型层一起换脑, 是「一套栈」而非「一组单品」的直接证据。同一本账: 一个会员账号串起所有入口, 聊天之外的成品、研究、集群共享一个 token 额度池 —— 第九章会算到, Swarm 跑得猛, 是真的会把 Agent 的额度吃紧。7注 7Note 7Kimi 帮助中心 · 会员套餐价格 —— Agent、深度研究、PPT、Kimi Claw 等功能共享一个 token 额度池(次数只是按常见任务折算的估值), 只有 Kimi Code 是单独的池; 一个会员账号串起所有入口。截至 2026-07。Kimi 帮助中心 · 会员套餐价格 —— Agent、深度研究、PPT、Kimi Claw 等功能共享一个 token 额度池(次数只是按常见任务折算的估值), 只有 Kimi Code 是单独的池; 一个会员账号串起所有入口。截至 2026-07。一颗脑子加一本账, 动一层、其他层跟着动, 这是「栈」和「杂货铺」的区别。丑话也说在这: 生态那一层还薄 —— 插件、第三方集成、企业采购的成熟度, 都还追不上那两家。所以本书说「对标」, 说的是产品形态和模型能力两层; 生态这层, 先不算数。
最能说明它换了打法的, 是价格。两年三级跳: K2.5 输入每百万 token ¥4.00, K2.6 涨到 ¥6.50, K3 直接定到 ¥20.00、输出 ¥100.00。3注 3Note 3Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。4注 4Note 4钛媒体 ·「Kimi K2.6 涨 58% 的 API 定价」(2026-04)—— 独立报道, 指出 K2.6 输入价较上一代 K2.5 上涨约 58%、输出约三成, 解读为月之暗面不再以低价抢量、转向对标前沿。本书引它作外部参照, 不作权威终点。钛媒体 ·「Kimi K2.6 涨 58% 的 API 定价」(2026-04)—— 独立报道, 指出 K2.6 输入价较上一代 K2.5 上涨约 58%、输出约三成, 解读为月之暗面不再以低价抢量、转向对标前沿。本书引它作外部参照, 不作权威终点。一个还在抢量的便宜货不会这样定价。但话要说准: 价格证明的是它的自我定位, 证明不了它值这个钱 —— 值不值, 要看单位任务成本和独立实测, 那是第三章一笔一笔算的账。抢量、拼便宜那条路, 现在是 DeepSeek 在走; Kimi 把自己摆上了对标前沿的货架 —— 摆没摆稳, 价格说了不算, 后面一格一格验。最能说明它换了打法的, 是价格。两年三级跳: K2.5 输入每百万 token ¥4.00, K2.6 涨到 ¥6.50, K3 直接定到 ¥20.00、输出 ¥100.00。3注 3Note 3Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。4注 4Note 4钛媒体 ·「Kimi K2.6 涨 58% 的 API 定价」(2026-04)—— 独立报道, 指出 K2.6 输入价较上一代 K2.5 上涨约 58%、输出约三成, 解读为月之暗面不再以低价抢量、转向对标前沿。本书引它作外部参照, 不作权威终点。钛媒体 ·「Kimi K2.6 涨 58% 的 API 定价」(2026-04)—— 独立报道, 指出 K2.6 输入价较上一代 K2.5 上涨约 58%、输出约三成, 解读为月之暗面不再以低价抢量、转向对标前沿。本书引它作外部参照, 不作权威终点。一个还在抢量的便宜货不会这样定价。但话要说准: 价格证明的是它的自我定位, 证明不了它值这个钱 —— 值不值, 要看单位任务成本和独立实测, 那是第三章一笔一笔算的账。抢量、拼便宜那条路, 现在是 DeepSeek 在走; Kimi 把自己摆上了对标前沿的货架 —— 摆没摆稳, 价格说了不算, 后面一格一格验。
K2.5K2.54.00
K2.6K2.66.50
K3K320.00×5×5
¥ / 百万 token · 输入价¥ / 百万 token · 输入价 · K2.5 → K3, 输入价两年五倍 —— 它把自己挪出了「便宜」那一栏。K2.5 → K3, 输入价两年五倍 —— 它把自己挪出了「便宜」那一栏。
— III
这本书给这套栈画一张图这本书给这套栈画一张图.
这本书不列全部功能, 也不教点哪个按钮(界面几个月一变, 判断不会)。它给这张地图标的是: 每一面对标前沿的哪一个、省什么、什么时候用、什么时候别用。后面顺着这套栈走 —— 全景、挑模型、四种模式、Agent 交办、Agent Swarm 与 Claw、Deep Research、Kimi Code 与 API, 然后是选档与取舍, 末尾一页实战速查。这本书不列全部功能, 也不教点哪个按钮(界面几个月一变, 判断不会)。它给这张地图标的是: 每一面对标前沿的哪一个、省什么、什么时候用、什么时候别用。后面顺着这套栈走 —— 全景、挑模型、四种模式、Agent 交办、Agent Swarm 与 Claw、Deep Research、Kimi Code 与 API, 然后是选档与取舍, 末尾一页实战速查。
也把话说在前头: 「长成全栈」不等于「样样第一」。我说的「差前沿半步」, 点名道姓、带上刻度: 最难的推理、最吃打磨的 agentic coding、一锤定音的输出, 地盘仍归 Claude Fable 5 和 GPT 5.6 Sol —— 独立榜 DeepSWE(2026-07-17)上 K3 是 69%、榜首 73%, 差 4 个点、误差棒还重叠; 官方在发布博客里自己也承认「trails the most powerful proprietary models」。5注 5Note 5DeepSWE 官方榜单(页面标注更新于 2026-07-17, 113 个任务、16 个模型, 统一 mini-swe-agent harness)—— kimi-k3[max] 69%±5%、第 4, 榜首 gpt-5.6-sol[max] 73%±3%, 误差棒与二三位重叠; 单任务成本 $4.65, 为前五中第二低。独立第三方实测, 这是独立执行类榜单首个收录 K3 的成绩。DeepSWE 官方榜单(页面标注更新于 2026-07-17, 113 个任务、16 个模型, 统一 mini-swe-agent harness)—— kimi-k3[max] 69%±5%、第 4, 榜首 gpt-5.6-sol[max] 73%±3%, 误差棒与二三位重叠; 单任务成本 $4.65, 为前五中第二低。独立第三方实测, 这是独立执行类榜单首个收录 K3 的成绩。2注 2Note 2Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。「半步」就是这个距离: 看得见, 还没追上。本书每一面都会标出这条线, 该回 frontier 就回。还有一条最容易踩的: 会员订阅不含 API, 开放平台(platform.kimi.com)是另一套账户、另一条账单。3注 3Note 3Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。它们重要, 只是别混成一笔账。也把话说在前头: 「长成全栈」不等于「样样第一」。我说的「差前沿半步」, 点名道姓、带上刻度: 最难的推理、最吃打磨的 agentic coding、一锤定音的输出, 地盘仍归 Claude Fable 5 和 GPT 5.6 Sol —— 独立榜 DeepSWE(2026-07-17)上 K3 是 69%、榜首 73%, 差 4 个点、误差棒还重叠; 官方在发布博客里自己也承认「trails the most powerful proprietary models」。5注 5Note 5DeepSWE 官方榜单(页面标注更新于 2026-07-17, 113 个任务、16 个模型, 统一 mini-swe-agent harness)—— kimi-k3[max] 69%±5%、第 4, 榜首 gpt-5.6-sol[max] 73%±3%, 误差棒与二三位重叠; 单任务成本 $4.65, 为前五中第二低。独立第三方实测, 这是独立执行类榜单首个收录 K3 的成绩。DeepSWE 官方榜单(页面标注更新于 2026-07-17, 113 个任务、16 个模型, 统一 mini-swe-agent harness)—— kimi-k3[max] 69%±5%、第 4, 榜首 gpt-5.6-sol[max] 73%±3%, 误差棒与二三位重叠; 单任务成本 $4.65, 为前五中第二低。独立第三方实测, 这是独立执行类榜单首个收录 K3 的成绩。2注 2Note 2Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。Kimi K3 官方博客(2026-07-16)—— K3 是 2.8 万亿参数的 MoE(896 专家、每 token 激活 16)、1M token 上下文、原生视觉、思考默认 max 档; 官方承诺「full model weights will be released by July 27, 2026」。同一篇博客里官方自评整体仍「trails the most powerful proprietary models」, 点名 Claude Fable 5 与 GPT 5.6 Sol, Limitations 承认与这两家有「a noticeable gap in user experience」。K2 系权重(Kimi-K2.6 / Kimi-K2.7-Code)早已以 Modified MIT 挂在 Hugging Face。截至 2026-07-17, K3 权重尚未上架。「半步」就是这个距离: 看得见, 还没追上。本书每一面都会标出这条线, 该回 frontier 就回。还有一条最容易踩的: 会员订阅不含 API, 开放平台(platform.kimi.com)是另一套账户、另一条账单。3注 3Note 3Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。Kimi 开放平台(platform.kimi.com, 原 platform.moonshot.cn)—— API base_url 为 https://api.moonshot.cn/v1, 与 OpenAI Chat Completions 兼容; 旗舰 kimi-k3 每百万 token 输入 ¥20.00、缓存命中 ¥2.00、输出 ¥100.00, 1M 上下文。消费端会员与开放平台 API 是两套账户、两条计费。截至 2026-07。它们重要, 只是别混成一笔账。
动笔之前, 我先照了一次镜子。翻自己两周的 Kimi 记录, 数「有几件不是默认聊天」—— 数出来是 1。这个数本身没意义: 多点开几个入口不等于把活干好, 它量的是「用没用」, 不是「有没有用」。我改成记三笔账: 哪件事它替我省了时间, 哪件原来做不成的做成了, 哪件质量明显上去了。三笔都记不出来的那一面, 对我仍是摆设。后面九章, 每一章都是在替我回答: 这面能不能记上账。动笔之前, 我先照了一次镜子。翻自己两周的 Kimi 记录, 数「有几件不是默认聊天」—— 数出来是 1。这个数本身没意义: 多点开几个入口不等于把活干好, 它量的是「用没用」, 不是「有没有用」。我改成记三笔账: 哪件事它替我省了时间, 哪件原来做不成的做成了, 哪件质量明显上去了。三笔都记不出来的那一面, 对我仍是摆设。后面九章, 每一章都是在替我回答: 这面能不能记上账。
我印象里的 Kimi 是张旧快照,
它早长成了一套栈.
我印象里的 Kimi 是张旧快照,
它早长成了一套栈.
Kimi x Zhaphar
— 讨论Discussion
讨论Discussion.
评论区初始化中…Initializing comments…