作者lordmi (星宿喵)
看板AI_Art
標題Re: [閒聊] Kimi K3已開源 就是AI傾銷?!
時間Thu Jul 30 15:16:11 2026
經過幾天社群上有更多意見,根本讀不完Orz
所以剛才讓Gemini 3.1pro整理主要的論點,並再跑一輪驗證。
結果如下:
**針對系統整合開發者,K3 存在多項「行為契約」與成本陷阱**
思考過程完整性 (Preserved Thinking):
強制要求:多輪對話中必須原樣回傳 Assistant 消息中的 reasoning_content,否則生
成質量將高度不穩定
接入配置陷阱:
K3 始終自帶思考過程且無法關閉;若 Web Search 配置無效,請求可能悄無聲息地降級
至 K2.6
max_completion_tokens 預設高達 131,072,必須顯式設置較小限制以控制成本
快取與成本管理:
快取定價優勢:Cache Hit 定價僅為 Cache Miss 的 1/10 ($0.3 vs $3.0 / M tokens)
最佳化建議:將系統提示詞、代碼倉庫快照、工具定義等靜態內容全部前置以觸發快取
分層路由策略 (Tiered Routing):
最佳實踐:日常雜事由 DeepSeek 或 GLM-5.2 處理;前端視覺或長程 Agent 任務交給
K3;高風險驗證由 Claude Fable 5 處理
**已知限制與風險驗證**
幻覺率上升:根據第三方測試 (Artificial Analysis),K3 的幻覺率從 K2.6 的 39%上
升至 51%
這意味著模型變得更加「過度主動」,即使在不確定的情況下也會自信地給出答案
上下文理解力瓶頸:雖然窗口高達 1M,但測試顯示 300K 壓縮版得分 (91.2) 高於全量
1M 版 (90.4),1M 窗口不代表 1M token 內均能無損理解
自託管可行性:
2.8T 模型權重約 1.56TB,駐留視訊記憶體需 1.4TB,生產環境建議 64 張以上加速卡
若採用 CPU + 大記憶體方案,推理速度僅約 0.05 到 1 token/s,生成 3.2 萬 token
需等待 9 小時,個人自託管現階段不具備實踐可行性
蒸餾疑雲:社群與美國政府指控 Moonshot 可能大規模蒸餾了 Anthropic 的 Claude
Fable 模型
雖然模型中曾出現「我是 Anthropic 開發的 Claude」等身分汙染現象,但目前尚無
權重級別的實錘證據。
最後寫幾個AI沒抓到但我看到的事情
國際版KIMI包套是美元價。用中國國內價算,一開始就錯了
KIMI就算付錢也會用你的資料訓練。好喔,遇到商用架構直接出局。OAI跟A/讓你至少
能自己選
最後API按量計價跟Sonnet5在一桌,我只能說口氣很大,後面降不降就看前人踩坑了
--
弟子「先生、処女を貴重だと思う男は多いです?」 孔明「
..その通りだ 」
弟子「しかし逆に童貞は女に気持ち悪がられます? 」孔明「
....確かに 」
弟子「おかしいじゃないですか、何故このような意識の違いが生まれるのですか 」
孔明「
それは一度も侵入を許していない砦は頼もしく
一度も侵入に成功しない兵士は頼りないからだ! 」
原出:「孔明の罠だ!」(民明書房新刊)
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 36.229.125.247 (臺灣)
※ 文章網址: https://webptt.com/m.aspx?n=bbs/AI_Art/M.1785395779.A.DF9.html
1F:推 Supasizeit: 看起來k3 是DOA了 07/30 17:50
2F:→ Supasizeit: 跟sonnet一起坐垃圾桌 07/30 17:51
3F:→ peterturtle: 我個人是覆水難收派,完全不會相信對話紀錄不會拿去 07/30 21:05
4F:→ peterturtle: 訓練的那邊就是了。 07/30 21:05
5F:推 newyorker54: 人類學都會買數百萬元盜版書去訓練,這種道德水平, 07/31 01:17
6F:→ newyorker54: 現成的輸入資料不會用來訓練?反正又抓不到證據 07/31 01:17