跳至主要內容
PHUA MEDIA
生活 現象觀察

把 AI 的草稿紙撕掉四分之三,帳單跟著少了六成:DeepSeek 這波操作,同行股價先綠了

DeepSeek 把快取命中價格砍到 0.02 元、KV Cache 壓到四分之一,本文從情境拆解這次降價背後被撕小的「AI 草稿紙」與同日綠掉的同行股價。

PHUA MEDIA 編輯室 閱讀約 5 分鐘

先把時間點說清楚:這件事發生在 9 月 10 日,兩天後才在掘金等技術社羣慢慢發酵開來。它沒有記者會,沒有鋪天蓋地的宣傳片,就是一則價格調整公告,加一個新模型名字。但把幾件事並排放在一起看,味道就出來了:同一天,港股幾家大模型公司收盤全綠,智譜跌了 11%,MinMax 跌了約 9%。

一家還沒上市的公司,發了一個模型、調了一個價格,先把同行的股價砸了。這本身比降價更像故事。

降的不是價,是「記性的房租」

很多人刷到「快取命中單價從 0.05 元降到 0.02 元」這條訊息,第一反應是「又降價」,然後劃走。但這次便宜六成只是結果,真正發生的事藏在 AI 的「草稿紙」裡。

你每次跟 AI 對話,它都得把你說過的話臨時記下來,這樣你追問時才接得上。行內叫 KV Cache,你可以把它想成 AI 的工作記憶。閒聊兩句,這張紙不大,花不了幾個錢。但有兩種情況,紙會越鋪越厚:一種是你甩給它一篇長文、一疊資料;另一種是你讓它自己連續幹活,查資料、呼叫工具、跑幾十輪,它得一直惦記著前面發生了什麼。

紙越厚,佔的記憶體越多,帳單就越長。對那種自己連軸轉的 AI(行內叫 Agent,白話就是「AI 打工人」),這筆草稿紙的費用往往是總成本裡最厚的一層,因為它要反覆回頭看自己記的東西。很多人讓 AI 跑長任務跑出天價帳單,燒的常常就是這張紙,這也是之前社羣裡各種「幫 AI 省記憶體」的折騰層出不窮的原因,像是先前有人嫌瀏覽器裡跑 Agent 像在迷路,乾脆自己做了個DeepSeek Harness 桌機端來接住這些痛點。

新模型做了什麼:讀和寫,用了兩套腦子

DeepSeek 這次發佈的模型叫 V4.1 Flash。它做的事情說穿了很樸素:讓 AI 記東西更省地方。官方給的數字是,KV Cache 佔的記憶體被壓到前一代的四分之一,連帶硬碟需求壓到八分之一。

怎麼做到的?一句話版本:把「讀」和「寫」拆開。過去多數 AI,讀你的問題和寫答案用的是同一套腦子。這次拆成兩套,讀輸入用一套輕量的(每次只喚醒約 8B 參數),寫答案用另一套(約 16B)。既然讀只需要一次,就把讀的那部分做得緊湊,記下來的草稿自然就短;寫答案時回頭看的是這份更短的草稿,佔用跟著縮水。

順帶解釋一下參數:這個模型總共 552B 個「神經元」,但每次上工只叫醒其中一小撮,這叫 MoE 混合專家,像一家 552 人的公司,每次只派 8 到 16 個人出場。不是全員到齊才開工。

對普通人和做產品的人,影響差很多

如果你只是聊天:最直接的好處就是便宜了。閒時的快取命中單價從 0.05 元降到 0.02 元,而且分峯谷計價,閒時價是高峯的一半。官方等於在暗示你,重活排在半夜或白天低谷時段跑,更劃算。

如果你是做產品、玩 AI 自動化的,重點則完全不同。以前 AI 打工人因為記性太佔記憶體,長任務跑久了貴得離譜,很多產品只好把上下文切得稀碎,不敢讓它多記。現在草稿紙只剩四分之一,同樣長的任務、同樣的記憶命中率,單次成本變成原來的四分之一。這代表一類先前在帳面上站不住的東西,長程自動助手、帶持久記憶的客服、跑幾百輪的調研 AI,第一次有了算得過來的可能。

說白了,這次改動的重點不是「單次回答更便宜」,而是長任務的成本曲線被壓平了。

順手一個變化:三個模式合併成一個

同一天,DeepSeek 也把原本的「快速、專家、識圖」三個模式合成了一個「智慧模式」。以前你得自己判斷:簡單問題用快速檔,燒腦的用專家檔,發圖用識圖檔。現在不用選了,模型自己看輸入有多難、是不是圖文,自動決定用輕量算力還是深度思考。

底層夠聰明了,上層就不需要你手動換檔。這個方向其實和整個 AI 產品的潮流一致:把選項藏起來,把判斷還給機器。

同一天,同行的股價先給了反應

最有畫面的一段在股市。發模型、宣佈降價的同一天,港股大模型公司集體下跌,智譜單日跌 11%,MinMax 跌約 9%。市場把這歸因於 DeepSeek「發新模型加大幅降價」的組合拳,也有投行跳出來提醒,價格戰可能要開打了。

當然,單日股價永遠有雜訊,一天跌深未必等於格局已定。但「一家未上市公司調個價格、同日同行齊跌」這個畫面,確實把競爭的緊張感直接搬上了檯面。而這種緊張感,去年就演過一輪:當時DeepSeek 的 IPO 傳聞沒有新聞稿也傳遍全網,靠一句「在準備」就刷了半天屏。這家公司的每一個動作,不論真假、不論大小,都自帶放大器。

結尾落在那張紙上

技術迭代有時候挺樸素。最貴的那一行,往往不在參數表上,而在 AI 的草稿紙裡。當快取命中的費用從 0.05 元落到 0.02 元,那張被撕掉四分之三的草稿紙,是工程師從記憶體裡一點一點摳出來的。

至於價格戰會不會真的開打、長任務 AI 會不會因此迎來一波新產品潮,現在說都太早。可以確定的是,下一次你讓 AI 連續跑幾十輪任務、看到帳單比預期友善時,那省下來的錢,多半就是從那張變小的草稿紙上來的。

#deepseek+降價現象#v4.1flash+ai草稿紙#大模型價格戰+社羣話題