Kimi K3真正值得长期保存的不是‘四大入口按钮’,而是模型能力、入口权限、上下文/价格/License漂移和交付验收的分层工作流
AH-0374 是一份信息密度很高的 Kimi K3 教程。它试图回答四件事:K3 到底是什么、不同入口怎么选、真实项目表现怎样、人与 Agent 应该如何协作。 这类教程最大的风险不是“写得不够全”,而是写得太像一张产品截图:模型、价格、上下文、会员、入口、发布状态都在快速变化。 因此 Batch 38 不把它保存成“2026 Kimi K3 按钮大全”,而重构成: Kimi Capab
Kimi K3 真正值得长期保存的,不是“四大入口按钮”:而是能力、入口、权限、License 与验收的分层工作流
AH-0374 是一份信息密度很高的 Kimi K3 教程。它试图回答四件事:K3 到底是什么、不同入口怎么选、真实项目表现怎样、人与 Agent 应该如何协作。
这类教程最大的风险不是“写得不够全”,而是写得太像一张产品截图:模型、价格、上下文、会员、入口、发布状态都在快速变化。
因此 Batch 38 不把它保存成“2026 Kimi K3 按钮大全”,而重构成:
> Kimi Capability / Surface / License / Acceptance Contract
长期保存稳定原则,动态字段全部带核验日期。
---
一、截至 2026-08-14,Kimi K3 的“开源”状态已经发生变化
原素材发布时强调:
“K3 已宣布开源,但完整权重不是已经躺在仓库里,而是后续发布。”
这个判断在当时有价值。
但现在必须更新。
Moonshot AI 当前官方 GitHub 已经公开 Kimi K3 完整权重和技术报告。官方 README 把它描述为:
2.8T 总参数; 104B 激活参数; 原生多模态; 1,048,576 token 上下文; 面向长程编程、知识工作和推理。
所以:
> Release Claim Must Be Re-verified
“即将开源”已经过期。
当前事实是:
full weights 已公开。
---
二、但“公开权重”不要自动写成“标准开源软件”
K3 使用的是:
Kimi K3 License
不是 Apache-2.0、MIT 这类常见开源许可证。
许可证确实给了非常宽的:
use / copy / modify / distribute / sublicense / sell / deploy / fine-tune
权利。
但它同时包含商业条件。
尤其是:
Model-as-a-Service; 一定收入规模; 超大 MAU / 月收入产品的品牌展示等。
因此正式规则:
> Open-weight ≠ Standard OSS License
alphahole 后续遇到模型“开源”,一定继续检查:
Weights available? Code available? License? Commercial use? MaaS restriction? Revenue trigger? Attribution/branding? Derivative obligations?
---
三、K3 License 最值得企业用户注意什么?
当前许可证对一般内部使用和普通商业产品相对宽松。
但如果你运营:
Model as a Service,
并达到许可证定义的收入门槛,
可能需要与 Moonshot AI 单独签署协议。
如果产品达到极高 MAU 或月收入门槛, 还可能触发 Kimi K3 品牌展示条件。
普通个人开发者大概率不会触发。
但 SaaS / API / 大型平台不能把“可以下载权重”理解成:
“完全无商业约束。”
---
四、1M 上下文是真的,但“每个入口都有1M”不是
模型本身官方支持:
1,048,576 token。
但用户实际能用多少, 取决于:
产品入口; 会员等级; API; 会话形式; 当前 rollout。
当前 Kimi 官方会员页甚至明确:
更高等级计划才解锁 K3 超长对话容量。
因此:
> Model Context ≠ Surface Context
以后保存两列:
Model Max Context Surface Available Context。
---
五、原素材里“网页 Agent 128K、Moderato 256K”等数字为什么不能永久写死?
因为它们属于:
Product Surface
不是模型架构。
会员和产品规则已经继续变化。
当前官方定价页的套餐名、价格、并行任务数、超长对话权限都已经有新的版本。
所以 alphahole 不应该每次重新写一篇新教程。
只维护:
Surface Matrix。
---
六、正确的 Kimi 产品地图应该分四层
Layer 1:Model
K3 本体能力。Layer 2:Surface
Kimi.com / Work / Code / API / Swarm。Layer 3:Permission
网页、文件、浏览器、终端、API、生产系统分别能碰什么。Layer 4:Acceptance
最终交付如何验证。这样即使入口改名, 方法论仍然成立。
---
七、Kimi Agent 当前确实已经扩展成完整工作系统
官方帮助中心当前明确:
K3 可以通过:
Kimi App; kimi.com; Kimi Work; Kimi Code; Kimi API
使用。
Kimi Agent 还提供网站生成、文档、数据分析等工具能力。
所以源文的“大方向”是正确的:
K3 已经不是单纯聊天模型。
---
八、但“入口越强,风险越高”比入口名称更重要
网页研究:
主要风险是错误信息和引用。
本地 Work:
增加本地文件与浏览器权限。
Code:
增加代码、终端、仓库修改。
API:
增加生产数据和系统集成。
因此入口选择的第一问题不是:
“哪个最强?”
而是:
> 最小权限下,哪个入口足够完成任务?
---
九、WebBridge 当前官方闭环了什么?
Kimi 当前官方页面确认:
WebBridge 通过本地桥接服务 + 浏览器扩展工作, 使用 Chrome DevTools Protocol 完成:
导航; 点击; 截图; 读取页面; 填写。
官方还强调执行在本地浏览器环境中。
这说明源文对 WebBridge“给 Agent 一双眼睛和手”的描述基本成立。
---
十、但是浏览器能看到,不代表可以复制
这是 AH-0375 也反复出现的问题。
CDP 可以暴露:
DOM; 网络请求; 前端资源; 页面行为。
技术上可见不等于:
版权允许复制; 商标允许模仿; 专利不存在; 服务条款允许自动化; 访问控制可以绕过。
因此:
> Browser Access ≠ Clean-room Permission
---
十一、K3 官方 benchmark 能说明什么?
官方 README 当前报告大量:
reasoning; coding; agent; knowledge-work; multimodal
benchmark。
它能说明:
K3 是强模型候选。
不能直接说明:
“你的公司用它一定比 Claude / Codex 更好”。
---
十二、Benchmark 到生产之间有一条很长的路
真实工作流还取决于:
你的代码库; 工具链; 上下文; 测试; 权限; 网络; 中文/英文材料; 响应时间; 价格; 失败模式。
所以:
> Benchmark ≠ Workflow Winner
---
十三、正确的模型评测是同一任务、同一验收
选 20 个真实任务。
固定:
Input; Tools; Time Limit; Acceptance; Review rubric。
然后比较:
Correctness; Rework; Cost; Latency; Scope violation; Human review time。
不要比:
“谁第一屏看起来更聪明”。
---
十四、原素材里的个人实测应该保留,但只能叫 USER_TEST
例如:
一夜跑长程任务; 复刻前端; 分析大仓库; 长时间编码。
这些都是很有价值的:
USER_TEST
但不是:
官方 benchmark; 独立实验; 普遍结论。
---
十五、“K3 媲美 Opus”必须降级
个人项目里:
某个模型表现接近另一个模型,
只说明:
这个任务; 这套提示; 这个时间点; 这个环境。
所以模型比较必须写:
Task / Harness / Date / Acceptance / Result。
---
十六、当前 API 价格可以核验,但价格不是永久事实
截至当前官方 K3 定价页:
缓存命中输入; 缓存未命中输入; 输出
分别有明确按百万 token 计价。
这些数字可以用于当前成本模型。
但必须绑定:
Verified date。
---
十七、“缓存便宜90%”为什么不能直接当实际省钱90%?
因为真实成本取决于:
多少上下文真的命中缓存; 提示是否稳定; 缓存生命周期; 输出比例; Agent工具循环。
因此:
> Cache Discount ≠ Total Cost Reduction
---
十八、做生产预算要算完整 Agent Cost
Model Input + Cached Input + Output + Tool calls + Browser/Compute + Retry + Failed tasks + Human review。
最容易漏的是:
失败重跑 + 人工返工。
---
十九、长上下文也不是越大越好
1M 能让模型看到更多。
但更多不等于:
更 relevant。
大量低价值历史会:
增加成本; 增加噪声; 让证据冲突更难发现。
因此继续沿用:
> Context Quality > Context Volume
---
二十、源文“分三轮:事实→分析→成稿”的做法值得保留
这其实不是 Kimi 专属技巧。
它属于:
Research Evidence Pipeline。
第一轮:
抽事实与来源。
第二轮:
分析矛盾与边界。
第三轮:
输出。
这比“一次塞八个链接让它写漂亮文章”可靠得多。
---
二十一、K3 任务合同仍然走 B37 Agent Contract
Goal / Inputs / Source priority / Done / Forbidden / Tools / Tests / Evidence / Human Gate / Rollback。
产品换了,
合同不换。
---
二十二、最重要的一条:验证比生成更重要
AH-0374 本身就强调:
不要只看最后中文顺不顺。
要看:
访问了什么; 数字能否回到来源; 材料冲突时是否写待核验。
这一点完全进入 alphahole 核心 SOP。
---
二十三、研究型任务至少验四件事
Source
来源对吗?Claim
来源真的支持这句话吗?Date
是不是当前?Conflict
冲突有没有被隐藏?---
二十四、代码型任务至少验五件事
Diff; Tests; Runtime; Scope; Rollback。
模型说:
“已经完成”
不是证据。
---
二十五、高后果浏览器任务仍然保留 Human Gate
涉及:
付款; 发消息; 发布; 删除; 改生产; 提交敏感表单
最后一步默认人确认。
---
二十六、Kimi Work 能本地操作,不代表授权整个硬盘
源文建议:
先给测试目录。
这是正确方向。
正式化为:
> Least Privilege Workspace
只给:
任务必要文件; 必要浏览器站点; 必要命令。
---
二十七、API Key 继续走 Secrets Governance
环境变量; 密钥管理; 最小权限; 不进 Git; 可撤销; 轮换。
“教程里复制粘贴 key”是硬禁区。
---
二十八、K3 的开源权重真正适合谁?
不是所有人都该本地部署 2.8T 模型。
模型体量巨大。
普通开发者更可能使用:
官方 API; 托管推理; 量化服务。
因此“权重开放”更大的意义是:
研究; 生态; 可审计性; 部署选择; 竞争。
不是:
“家里电脑免费跑旗舰模型”。
---
二十九、开源模型产品化还要算 Infrastructure Economics
GPU; 显存; 吞吐; 延迟; 并发; 运维; 容灾; 更新; 安全。
API 贵不贵,
必须和:
自托管总成本
比较。
---
三十、License 还必须进入 Infrastructure Decision
同一个模型:
官方 API; 第三方推理; 自托管; MaaS
许可责任不同。
所以模型路由新增:
> Capability + Cost + License + Control
---
三十一、什么时候优先 Kimi.com / Agent?
临时研究; 公开网页; 文件产出; 低技术门槛。
验收:
引用; 事实; 文件质量。
---
三十二、什么时候优先 Work?
本地文件; 浏览器已登录状态; 桌面工作流。
额外验收:
文件范围; 隐私; 浏览器动作。
---
三十三、什么时候优先 Code?
真实仓库; 测试; 终端; 多文件工程。
额外验收:
Diff; Build; Tests; Scope; Rollback。
---
三十四、什么时候用 API?
产品集成; 稳定流水线; 可观测; 批处理; 自定义权限。
前提:
你愿意承担:
工程; 监控; 账单; 数据治理。
---
三十五、不要用“API更专业”制造复杂度
如果网页入口已经能完成,
不要为了显得技术强:
先写 SDK。
技术层级不是成熟度。
结果可验证才是。
---
三十六、产品方向
进入:
> AI Model Surface & Workflow Router
它不是 Kimi 专属产品。
输入:
Task; Data sensitivity; Tools; Latency; Budget; Acceptance。
输出:
推荐 Surface + Permission + Verification。
---
三十七、V3
选 30 个真实任务:
Research; Document; Spreadsheet; Code; Browser; API。
比较:
用户自己选入口
vs
Capability Router。
指标:
Wrong-surface; Rework; Cost; Permission Incident; Accepted Output Time。
---
三十八、Stop Rule
如果 Router 最后只是:
“研究用网页、代码用Code”
没有减少返工和权限事故,
就不独立产品化。
---
最后
Kimi K3 的真正价值不是:
“2.8T、1M、开源、免费”
这四个宣传词本身。
而是它说明了一件更大的事:
模型正在变成可执行工作基础设施。
但模型越能干,
用户越不能只背按钮。
长期真正值得保存的是:
模型能做什么; 哪个入口能碰什么; 什么权限可以给; 什么许可证允许; 什么叫完成; 结果怎么证明。
按钮会继续改。
套餐会继续改。
价格会继续改。
真正不会过期的,是你的验收责任。