首頁 » Blog » AI » Claude Opus 5 用咗一星期:更慳 Token 更聰明

Claude Opus 5 用咗一星期:更慳 Token 更聰明

今年講 AI 模型,我哋已經寫過三篇:Claude Fable 5 實戰應用Fable 5 強到被美國全球叫停,到之後嘅Fable 5 回歸 + Sonnet 5 深度實測

而今次要講嘅 Claude Opus 5,係我用得最「唔覺眼」嘅一隻——唔覺眼唔係話佢弱,而係佢用起上嚟太順,順到你唔會停低諗「呢個模型得唔得」

密集用咗大約一個星期,日日拎嚟做 PHP、MySQL、CMS 開發同 SEO 內容生成,我可以先講結論:

  • 能力上,同 Fable 5 差唔多。唔係碾壓,係打成平手,各有各嘅性格。
  • Token 消耗甚至比 4.8 更慳。呢個係我最意外嘅一點,亦係最實際嘅一點。
  • 但佢明顯更聰明。唔係「識多啲嘢」嗰種聰明,係「明白你想點」嗰種聰明。

EC Shop City 自 2006 年成立,接近 20 年來服務超過 18,000 間香港企業。作為一個日日要開發、要管幾個電商平台同客戶網站嘅香港開發者,以下係我一星期嘅真實使用紀錄,唔係跑分,係實戰。

先講返 Fable 5 同 Sonnet 5 嘅脈絡

如果你係第一次睇我哋嘅 AI 系列,簡單交代返背景,因為冇呢個背景,你會唔明點解「同 Fable 5 差唔多」呢句係一句好高嘅評價。

  • Fable 5——今年最強嘅一隻,強到出過一輪風波、一度全球停用,之後又重新開放。我實測過,係真係強,尤其係處理複雜、多層邏輯嘅任務。
  • Sonnet 5——定位完全唔同,快、平、輕,適合大量重複性工作。
  • 4.8——上一代嘅主力,我用咗好耐,係我心目中嘅「基準線」。

所以當我講「Opus 5 同 Fable 5 差唔多」,意思係:佢已經去到第一梯隊。而當我再講「但佢仲慳過 4.8」,呢個組合先係重點——因為頂級能力 + 低於上一代嘅成本,喺過去係唔會同時出現嘅。

更多相關實測可以睇 AI 文章分類

頭三日:一個「唔嘈」嘅模型

用新模型頭幾日,我通常會刻意唔改變自己嘅工作習慣,用返平時嗰套 prompt,睇下佢反應。

第一個感覺:廢話少咗好多

以前用 4.8,我叫佢改一段 PHP,佢好多時會:

  • 先重複一次我嘅需求(「你想將呢個函數改成...」)
  • 解釋佢打算點做
  • 俾出完整代碼
  • 再逐點解釋佢改咗咩
  • 最後加一段「注意事項」同「建議」

五段入面,我真正要嘅係第三段。其餘四段,全部都係 output token——而 output token 通常係最貴嗰種

Opus 5 嘅預設行為明顯克制好多。同樣嘅要求,佢傾向直接俾改動,簡短講一句改咗乜,就收。要詳細解釋?你問佢就會有,而且質素唔差。分別在於佢唔會未問就倒晒出嚟。

第二個感覺:唔會亂改你冇叫佢改嘅嘢

呢個係我最欣賞嘅一點。以前有個經典痛點:你叫 AI 改一個 function 入面嘅一行,佢順手幫你「優化」埋成個檔案——變數改名、加咗 type hint、重排咗邏輯。睇落好心,但實際上你要逐行 diff 睇返佢動咗咩,慢過自己寫。

Opus 5 明顯收斂咗。叫佢改一行,佢就改一行。對於管緊幾個生產環境網站嘅人嚟講,呢個「唔自作主張」嘅特性,比多兩分聰明更有價值。

最大驚喜:Token 消耗甚至比 4.8 更慳

呢個係我一星期落嚟最實在嘅發現,亦係我覺得最值得同大家分享嘅一點。

以下係我自己嘅實際使用觀察,唔係官方數據,唔同人嘅工作模式會有唔同結果。

點解會慳?三個原因

  1. Output 冇咁長氣。上面講過,答案密度高咗,同樣資訊量用少咗字。
  2. 來回次數少咗。呢個係隱形嘅大頭。以前一個需求要傾三四轉先啱,每一轉都要重新帶埋前文,context 越滾越大。Opus 5 好多時第一次就中,一轉搞掂 = 慳返後面幾轉嘅全部 context token
  3. 唔會重複貼返成個檔案。叫佢改嘢,佢傾向只俾改動部分,唔會成 500 行貼返出嚟。
情境 4.8 嘅典型流程 Opus 5 嘅典型流程
改一個 PHP function 解釋 + 全檔案 + 逐點說明,可能要再修正 1 至 2 次 只俾改動段落 + 一句說明,多數一次到位
Debug 一段 MySQL query 列出多個可能原因,要你逐個試 直接指出最可能嗰個,並解釋點解
睇一段長 log 搵問題 逐段複述再分析 直接跳去有問題嗰幾行
寫一篇長文 結構好但常有重複段落,要人手刪 結構緊湊,重複明顯少

重點唔係「單次便宜咗幾多百分比」,而係「你少咗幾多次來回」。對於一日跑幾十上百個 request 嘅開發者嚟講,第二項嘅節省遠大過第一項。

「更聰明」到底聰明喺邊?

「更聰明」係好虛嘅形容詞,我具體講返幾樣我實際感受到嘅嘢。

一、佢會記得你嘅專案脈絡

喺一段長對話入面,我早段講過「呢個系統跑緊 PHP 8.2、DB 係 MySQL、唔用 framework」,到後面第二十幾條訊息,佢俾嘅代碼仍然跟返呢個前提,唔會突然扔個 Laravel 寫法俾我。4.8 喺長對話後段就明顯會「漂移」。

二、佢會問返轉頭,但問得啱位

當需求真係有歧義,佢會問一條——而且係問最關鍵嗰條,唔係列五條問題晒你時間。呢個分寸拿捏得幾好。

三、佢明白「唔好做咩」

我試過講一句「呢個係生產環境,唔好改結構」,之後佢全程都守住呢條線,甚至喺建議入面主動加一句「呢個改動需要改 schema,你話過唔改,所以我用另一個做法」。呢種對限制條件嘅記憶同尊重,係我覺得最「聰明」嘅地方。

四、佢識得分輕重

俾佢一段有五個問題嘅代碼,佢唔會平鋪直敘咁列五點,而係會講「呢個係會即刻炸嘅,先改;其餘三個係風格問題,得閒先算」。呢個係經驗判斷,唔係知識。

Opus 5 vs Fable 5:真實使用差異

兩隻都係第一梯隊,但性格唔同。以下係我一星期嘅主觀感受。

比較項目 Fable 5 Opus 5
整體能力 極強 極強(實際使用感差唔多)
回答風格 詳盡、鋪陳、會展開好多角度 克制、直接、答完就收
Token 效率 一般(因為講得多) 明顯較佳
複雜架構設計 略勝一籌,思考鋪得闊 好,但傾向收窄範圍
日常改代碼 有時過度熱心 更貼身,唔會亂郁
長對話穩定性 更好,較少漂移
中文(廣東話)表達 自然 自然,語氣控制更準
需要你 prompt 幾清晰 要寫得幾詳細 短 prompt 都估得中
適合嘅場景 由零設計、探索性思考 日常開發、持續維護、內容生產

簡單講:Fable 5 似一個好肯講嘅資深架構師,Opus 5 似一個做嘢好穩、講嘢好精準嘅資深工程師。你要開新專案諗方向,前者好;你要日日開工出貨,後者順好多。

PHP / MySQL 實戰表現

我哋自己嘅 eshopdev 電商平台係 PHP + MySQL 自建,加上幫客戶維護緊幾個唔同年代嘅系統,環境由舊版 PHP 到 8.2 都有。呢個星期我用 Opus 5 做過以下幾類工作。

一、舊代碼維護

呢個係最見真章嘅場景。舊系統嘅代碼風格唔統一、冇註釋、變數命名混亂。Opus 5 嘅表現係會遷就返你原本嘅風格,唔會硬要你現代化。對於「唔想搞爛」嘅生產環境,呢點好重要。

二、SQL 優化

俾一條慢 query 佢,加埋 table structure 同大概數據量,佢會直接指出係邊個 index 缺失或者邊個 join 有問題,而唔係列出十條泛泛而談嘅優化建議。準確度我覺得同 Fable 5 相若。

三、安全檢查

叫佢審一段處理表單嘅代碼,SQL injection、XSS、CSRF、密碼 hash 方式呢幾樣佢都會查,而且會標明邊個係即時風險、邊個係理論風險。呢個分級好實用。

四、由零寫新功能

寫一個完整嘅訂單匯出模組,包括後端查詢、CSV 生成、權限檢查。第一版可用度好高,主要要改嘅係同我哋自家 framework 慣例對接嘅部分——呢個係任何模型都幫唔到嘅,因為佢唔知你內部規矩。

但要講清楚:AI 出嘅代碼一律要自己睇過先上生產環境。Opus 5 出錯率低咗,但唔係零。尤其涉及付款、權限、用戶資料嗰啲,永遠人手複核。

用嚟寫 SEO 內容嘅表現

我哋 Blog 大部分文章都係人機協作寫出嚟——由我定角度同真實經歷,AI 幫手鋪結構同擴寫。呢個星期全部改用 Opus 5。

做得好嘅地方

  • 廣東話書面語掌握得好。唔會變成大陸用語,亦唔會生硬到似翻譯。
  • 結構意識強。H2、H3 分層合理,識得咩內容應該用表格、咩應該用列表。
  • 唔會堆砌關鍵字。你叫佢做 SEO,佢唔會亂咁塞關鍵字,而係自然分佈。
  • 重複內容明顯少咗。4.8 寫長文成日喺唔同段落講同一件事,Opus 5 好好多。

仍然要人手做嘅部分

  • 真實經歷同數據。你嘅客戶故事、你嘅實測結果、你嘅報價——呢啲 AI 生唔到,亦唔應該叫佢生。
  • 觀點同立場。一篇文有冇睇頭,睇你敢唔敢講一啲有人會唔同意嘅嘢。
  • 本地脈絡。香港市場嘅實際情況,要你自己補。

寫 SEO 內容嘅完整方法,可以參考我哋嘅 SEO 內容策略完整指南自己做 SEO 完整教學

用咗一星期,發現嘅缺點

唔想寫成一篇吹捧文,所以要講返唔好嘅地方。

一、有時太克制

佢嘅「唔多講」有時會變成「講少咗」。有幾次佢俾咗個做法,但冇提醒我有個更好嘅替代方案——我要自己再問「有冇其他做法」佢先講。Fable 5 就會主動列埋。如果你係新手,Fable 5 嗰種會鋪開嚟講嘅風格可能對你更有幫助。

二、超長 context 之下仍然會有偏移

比 4.8 好好多,但唔係無限。當對話拉到極長,佢一樣會開始漏咗早期嘅設定。我嘅做法係每去到一個階段就開新對話,並用一段精簡嘅專案背景重新起手

三、對極舊環境嘅假設有時偏新

我有客戶仲跑緊好舊嘅 PHP 版本。如果你唔明講版本,佢預設會用較新嘅語法。解決方法好簡單:每次開頭講清楚版本。

四、一星期唔足以驗證穩定性

我只用咗一星期。模型嘅表現會隨負載、版本更新而變,今日嘅結論唔代表三個月後一樣。呢篇係一星期嘅快照,唔係定論。

邊個場景用邊隻?我而家嘅實際分配

我唔信「一隻打天下」。以下係我一星期之後定落嚟嘅實際分工。

工作類型 我用邊隻 原因
日常改代碼、debug Opus 5 準、快、唔亂郁、慳 token
新系統架構設計 Fable 5 思考鋪得闊,會提出你冇諗過嘅角度
大量重複性小任務 Sonnet 5 快同平,唔使動用重型模型
長篇 SEO 文章 Opus 5 結構好、重複少、語氣控制準
代碼安全審查 Opus 5 + 人手複核 風險分級做得好,但一定要自己再睇
探索性研究、比較方案 Fable 5 會主動列齊選項同 trade-off
批量翻譯、格式轉換 Sonnet 5 呢啲嘢用貴模型純屬浪費

用 AI 慳唔慳錢,一半靠模型定價,一半靠你識唔識分配。用重型模型做翻譯,同用平模型做架構設計,兩樣都係浪費。

對香港中小企嘅實際意義

講咗咁多技術,落返地。對一個唔寫代碼嘅老闆嚟講,呢件事點解關你事?

一、開發成本結構真係喺度變

以前要三日先做到嘅功能,而家可能一日;以前要請人做嘅內容量,而家一個人加 AI 做得晒。但呢個唔等於「網站可以好平」——因為真正值錢嘅從來唔係打字速度,而係知道應該做咩、唔應該做咩

二、內容門檻降低,代表競爭加劇

你識用 AI 寫文,你嘅同行都識。當人人都出到一篇「睇落 OK」嘅文,贏嘅就會係有真實經歷、真實數據、真實觀點嗰個。呢個亦係點解我哋堅持每篇文都要有自己嘅實測同案例。

三、唔好將 AI 當成「唔使請人」

AI 係放大器。一個本身唔識判斷嘅人用 AI,只會更快咁做錯嘢,而且錯得更似樣。

四、最重要嗰句:唔好將你嘅資產放喺唔屬於你嘅地方

呢個係我哋今年講咗幾次嘅主題。無論係 WhatsApp 帳號被封、社交平台改規則,定係某個 AI 模型突然停用(Fable 5 就發生過),道理都一樣:平台會變,工具會換,只有你自己嘅網站、自己嘅資料、自己嘅客戶名單,係你真正擁有嘅嘢。

慳 Token 嘅七個實用技巧

就算模型本身慳咗,用法唔啱一樣燒錢。以下係我自己嘅做法。

  1. 開頭一次過講清楚環境同限制。PHP 版本、DB、有冇用 framework、可唔可以改 schema——講清楚可以省返幾轉來回。
  2. 明確叫佢「只俾改動部分」。一句 prompt,慳幾百行 output。
  3. 階段性開新對話。唔好一個 thread 用足一日,context 會越滾越貴。
  4. 只貼相關代碼。唔好成個 1,000 行檔案掟俾佢,抽相關嗰段就夠。
  5. 簡單嘢用細模型。格式轉換、改錯字,唔使勞煩頂級模型。
  6. 建立自己嘅 prompt 範本。常用嘅需求寫成範本,每次改幾個字就用得,又快又穩定。
  7. 唔好叫佢解釋你唔會睇嘅嘢。你唔會睇嗰段「注意事項」,其實一直喺度計錢。

想將 AI 真正用喺你盤生意上?

EC Shop City 自 2006 年成立,接近 20 年來服務超過 18,000 間香港企業。我哋日日用 AI 做開發同內容,亦幫客戶將 AI 整合入電商平台、客服流程同內容生產。

我哋唔要求客戶簽長期合約,亦唔會扣起源碼。你嘅網站、你嘅資料、你嘅客戶名單,永遠屬於你。

了解我哋嘅網頁設計、電商及 AI 整合服務

常見問題 FAQ

Opus 5 同 Fable 5 邊隻好啲?

用咗一星期嘅感受係能力上差唔多,但性格唔同。Fable 5 思考鋪得闊、講得詳盡,適合由零設計架構同探索性任務;Opus 5 克制精準、唔亂改嘢、Token 效率明顯較佳,適合日常開發同持續維護。我而家係兩隻都用,按任務分配。

話 Opus 5 比 4.8 更慳 Token,係點量度?

呢個係我自己嘅實際使用觀察,唔係官方數據。慳嘅原因主要有三個:輸出冇咁長氣、來回次數少咗(一次到位嘅比例高咗)、唔會重複貼返成個檔案。其中「來回次數少咗」係最大嘅隱形節省,因為每多一轉,前文 context 都要重新計一次。

「更聰明」具體係指咩?

唔係指佢識多啲知識,而係指理解力同判斷力:長對話入面記得住你早段講過嘅前提;問返轉頭時只問最關鍵嗰條;會尊重你講過嘅限制(例如「生產環境唔好改結構」);而且識得分辨邊個問題緊急、邊個係風格問題。

AI 寫嘅代碼可唔可以直接上生產環境?

唔可以。Opus 5 出錯率確實低咗,但唔係零。尤其涉及付款流程、權限控制、用戶個人資料處理嘅代碼,一律要人手逐行複核並喺測試環境跑過。AI 係放大你效率嘅工具,唔係代替你負責任。

中小企老闆自己唔識寫代碼,用得著呢啲模型嗎?

用得著,但用法唔同。你唔會用佢寫系統,但可以用嚟:起草 SEO 文章初稿、整理客戶常見問題、寫產品描述、分析銷售數據、草擬報價同回覆。關鍵係你要有判斷力去審佢寫嘅嘢,唔好照抄。

應唔應該完全轉用 Opus 5,唔用其他模型?

唔建議。一來唔同模型有唔同強項,二來——Fable 5 曾經突然全球停用嗰次已經上咗一課:唔好將工作流程完全綁死喺單一工具上。保持兩至三隻模型嘅使用習慣,出事嗰陣先唔會停擺。

用 AI 寫 SEO 文章,Google 會唔會懲罰?

Google 嘅立場係睇內容質素同對用戶嘅價值,唔係睇你用咩工具寫。問題出喺大量低質、無實質內容嘅 AI 水文。我哋嘅做法係:AI 負責結構同擴寫,真實經歷、實測數據、觀點立場一律由人提供——呢啲先係 AI 生唔到、亦係排名真正贏嘅地方。

一星期嘅測試夠唔夠下結論?

坦白講,唔夠。呢篇係一個香港開發者喺真實工作環境入面用咗一星期嘅快照,唔係跑分報告,亦唔係定論。模型表現會隨版本更新而變,我會繼續用落去,有新發現會再寫。

寫喺最後

今年由 Fable 5 嘅震撼登場、被叫停、再回歸,到 Sonnet 5,再到而家嘅 Opus 5,節奏快到有時會覺得追唔切。

但用咗一星期 Opus 5 之後,我反而冇咗嗰種「又要重新學過」嘅焦慮。因為佢俾我嘅感覺唔係「一隻更勁嘅模型」,而係一隻更明白你想做咩嘅工具

而工具嘅最高境界,就係你用嘅時候唔會諗起佢。

Token 慳咗、來回少咗、要返轉頭執嘅嘢少咗——呢三樣加埋,先係「更聰明」對一個日日要出貨嘅人嚟講嘅真正意思。

分享這篇文章: