DeepSeek-V4-Pro 八月十三日正式上線,API 名仍係 deepseek-v4-pro;八月十六日起分尖峰離峰,香港返工上晝同下晝多數時段係尖峰,離峰先半價。
坊間一傳就變成「DeepSeek 4 出咗」。其實官方名係 DeepSeek-V4-Pro 正式版,唔係再出一隻全新家族。四月已經有 V4 預覽。七月三十一日先把 V4-Flash 轉公測,八月十三日先輪到 Pro 喺 App、網頁同 API 全面開,偏偏網頁入口叫 Expert Mode、API 模型名仍然寫 deepseek-v4-pro,搞到好多人以為要換一串新 id。
先講重點。呢篇按 DeepSeek 官方公告 同 價目表 拆香港用家最易踩嘅三件事:幾時出、幾點計費、Pro 同 Flash 點揀,舊名 deepseek-chat、deepseek-reasoner 官方早講過會停,而家應對 V4 兩個型號,唔好再當永遠可用。
正式版出咗咩,同預覽差在邊
V4-Pro 賣點唔係再加一截 context,而係官方自己講嘅生產環境 agent。文件列出一串基準:HLE 無工具 42.7、有工具 60.0,Terminal Bench 2.1 去到 87.9,NL2Repo 61.5,Cybergym 83.3,DeepSWE 62.7,Toolathlon-Verified 74.1,Agents’ Last Exam 25.7,AutomationBench 31.8,DSBench-FullStack 71.1,DSBench-Hard 67.2。
數字係廠方自己報。明明一排八十分睇落好威,唔好直接當贏晒 GPT-5.6 或者 Claude Opus 5,對方用邊套 harness、temperature、effort 檔,官方註腳都寫過唔同,我們建議當「Pro 正式版側重 agent」呢句成立,能力榜就留俾自己場景實測。
Flash 官方版本標 DeepSeek-V4-Flash-0731,API 名 deepseek-v4-flash。兩隻都係 1M context、最大輸出 384K,並行上限差一截:Flash 2500、Pro 500,長窗唔等於平,output 先係帳單大頭。
思考力度而家有三檔。簡單分類用低,日常 agent 用高,複雜任務先 max;居然有人所有請求都開 max,token 一脹,所謂平價即刻唔平。
接口方面,DeepSeek API 原生支援 OpenAI Responses API 格式,並為 Codex 做過一鍵設定,同時留低 Chat Completions 同 Anthropic 介面,base URL 仍係 https://api.deepseek.com,Anthropic 格式行 /anthropic,JSON 同工具呼叫兩邊都有,FIM 只限非思考模式。
香港用家點入場,唔使改號
聊天用官方 App 或者網頁。開 Expert Mode 就用到 V4-Pro,寫程式、接自己服務就把模型名設成 deepseek-v4-pro 或 deepseek-v4-flash,呼叫方法官方寫不變。
香港用家多數已經喺 Cursor 用緊第二隻頂模。本站八月寫過 Grok 4.6 vs GPT-5.6 Sol vs Claude,七月亦有 Grok 4.5 香港介紹,DeepSeek 呢條線係官方 App 加官方 API,唔好同 Grok 喺 Cursor 嘅入口混為同一張帳單,跟官方同 IDE 提供嘅通道即可,唔使為咗用模型去學繞過地區限制。
坦白說,預覽期已經用開 deepseek-v4-pro 嘅人,正式版最易漏睇嘅唔係新功能,而係八月十六日 16:00 UTC 開始嘅尖峰離峰價,價目變咗、模型名冇變,帳單一出先發覺日間貴咗一倍。
尖峰離峰點計,香港日間其實貴
新價按每百萬 tokens、美元計。離峰係尖峰一半,官方尖峰係 UTC 01:00–04:00 同 06:00–10:00,換香港時間大約 09:00–12:00、14:00–18:00。
返工寫 code 嘅上晝同下晝,多數時段明明係尖峰。午膳先鬆。傍晚六點之後同通宵都係離峰,想慳就把可延後嘅批次、評測、長 agent 搬去晚間,即時對答、會議跟住改 code,就接受尖峰價。
| 模型 | Cache miss 輸入(尖峰/離峰) | 輸出(尖峰/離峰) | Cache hit 輸入(尖峰/離峰) | 並行上限 |
|---|---|---|---|---|
| deepseek-v4-pro | $1.32 / $0.66 | $3.96 / $1.98 | $0.044 / $0.022 | 500 |
| deepseek-v4-flash | $0.44 / $0.22 | $1.32 / $0.66 | $0.014 / $0.007 | 2500 |
單位每百萬 tokens。Cache hit 平兩個數量級,重複系統提示值得先設計到打中 cache,新價由二零二六年八月十六日 16:00 UTC 生效,之後以官網價目為準。
自己計一條。假設一次 agent 跑一千萬 input(cache miss)、兩百萬 output,Pro 尖峰大約 10×1.32 加 2×3.96,即 13.2 加 7.92,合共 21.12 美元。離峰剛好一半。Flash 尖峰約 7.04 美元。竟然同一條任務,Pro 尖峰可以貴過 Flash 尖峰兩倍不止,max 思考再加長輸出,差距仲會拉開。
同 Grok、GPT、Claude 八月價點比
八月香港頂模唔止 DeepSeek 一條線。Grok 4.6 標準檔每百萬輸入兩美元、輸出六美元,提示一過二十萬 token 成筆跳到四美元同十二美元,GPT-5.6 Sol 輸入五美元、輸出三十美元,Claude Opus 5 五美元同二十五美元,Sonnet 5 兩美元同十美元,七月對照表喺 Grok 4.5 vs GPT-5.6 vs Claude Fable 5。
用返上面一千萬加兩百萬、未踩 Grok 二十萬崖:Grok 約 20 加 12 即 32 美元,Sol 約 50 加 60 即 110 美元,Opus 5 約 50 加 50 即 100 美元。V4-Pro 尖峰 21.12 美元仍然平一檔,Flash 7.04 美元再平一截。
平唔等於最好用。長任務要穩、生態要齊,仍然可以揀 Claude 或者 Grok,DeepSeek 強項係官方 API 價同 1M 窗,唔係宣布取代所有 IDE 預設模型。
場景點揀:Flash、Pro、定繼續用第二隻
大量分類、摘要、便宜 tool call,用 Flash。要強啲嘅 agent、生產環境,先 Pro。同一條長任務開 max 再加尖峰輸出,帳單可以快過你以為嘅「DeepSeek 好平」。
日常喺 Cursor 寫細件 Python、前端,Grok 4.6 標準兩美元六美元仍然順手,提示控住二十萬以下就得;要平坦長檔、唔想踩 Grok 加價崖,Sonnet 5 每百萬兩美元十美元、一百萬無崖,預算更好估;旗艦推理、輸出可以貴,先 Sol 或者 Opus 5。
我們自己試過把重複系統提示做成可 cache 嘅前綴,hit 價低到幾乎可忽略,偏偏第一轉 miss 仍然跟尖峰表。團隊如果日日開長 context,最抵嘅未必係換模型,而係拆任務同打中 cache。
核對官價。本頁數字來自二零二六年八月官方文件,落單前請睇當時 DeepSeek 價目,價錢會改,唔當採購承諾。
常見問題 FAQ
DeepSeek 4 係咪今日先出?
答案係唔係。官方係 DeepSeek-V4-Pro 正式版,八月十三日 GA,唔係另一隻叫 DeepSeek 4 嘅新系列,八月十六日起先改尖峰離峰價。
香港幾點先算離峰?
睇香港時間。UTC 尖峰 01:00–04:00、06:00–10:00,即大約 09:00–12:00 同 14:00–18:00,其餘時段離峰,價係尖峰一半。
API 模型名要不要改?
唔使改名。Pro 用 deepseek-v4-pro,Flash 用 deepseek-v4-flash,網頁 Expert Mode 對應 Pro 正式版。
V4-Pro 同 V4-Flash 點揀?
量大、要平、工具呼叫密,用 Flash,並行上限 2500;生產 agent、要官方強調嘅正式版能力,用 Pro,並行上限 500。兩隻都係 1M context、最大輸出 384K。
可唔可以當佢贏晒 Grok 同 Claude?
價平一檔係事實。官方基準係廠方自己報,場景唔同,能力榜要自己測,長檔穩陣同 IDE 生態,Grok、Claude 仍然有位置。