開發者棄用 Claude Code 付費版,轉投 VS Code 本地大模型提效實錄
一位開發者因 Claude Code 20 美元訂閱的嚴格使用限制,轉而在 VS Code 中搭建本地 LLM 開發環境。通過 Docker Model Runner + Continue 外掛執行 Qwen2.5 Coder 14B 模型,在 M5 MacBook Air 16GB 記憶體裝置上實現無限次程式碼輔助,儘管體驗不及雲端服務,但對日常 bug 修復和小功能開發已足夠高效。

從訂閱焦慮到本地自由:一個程式設計師的AI工具遷移實錄
一位老哥用了半年Claude Code,最終還是因為"離譜的使用限制"(原話:almost unusable usage limits)怒退20刀月費訂閱。他的解決方案很硬核:直接在VS Code裡搭了個本地大模型(LLM)工作流,用開源模型平替雲端服務。雖然體驗打了點折扣,但無限白嫖的特性反而讓他產出更多程式碼了。
痛點暴擊:雲端AI的隱形天花板
作者日常就是修bug、加小功能、調優程式碼,這些活兒根本用不著頂級模型的推理能力。Claude Code雖然強,但那個"5小時限額"簡直要命——debug時反覆試錯都不敢放開手腳。這波啊,是訂閱制AI的通病:說是按需付費,結果用起來處處受限。
選型指南:效能與硬體的極限拉扯
老哥的裝備是M5 MacBook Air(16GB記憶體),直接pass了那些龐然大物。以下是他的實測體驗:
- GPT-OSS 20B:能力線上,但光模型就吃掉16GB記憶體,開個VS Code直接卡成PPT
- Codestral 22B:量化後勉強能跑,程式碼補全還行,但處理多檔案專案就拉胯
- DeepSeek Coder V2 Lite:9GB記憶體佔用,算是備胎之一
- Qwen2.5 Coder 7B/14B:7B版本快是快,但容易跑偏;**14B版本(Q4量化後9GB)**在程式碼生成、推理和修復上表現均衡,還支援工具呼叫——這可是Continue外掛實現檔案操作的核心能力
最終選擇:Qwen2.5 Coder 14B。用作者原話:雖然比不上Claude那種專案級理解能力,但修bug加功能這種明確需求完全hold住,響應速度也能跟得上coding節奏。
落地實操:Docker+Continue組合拳
1. 推理引擎:Docker Model Runner
用Docker Model Runner當模型底座,負責下載和執行模型。在Docker Desktop裡一鍵啟動後,通過OpenAI相容API(埠12434)提供服務,直接拉取Qwen2.5 Coder 14B。
2. VS Code對接:Continue外掛
Continue這外掛堪稱神隊友:
- 聊天視窗、行內編輯、自動補全全都有
- Agent模式:能搜專案檔案直接改程式碼
- 雲端本地模型通吃
配置檔案~/.continue/config.yaml示例:
- name: Qwen2.5 Coder 14B
provider: openai
model: ai/qwen2.5-coder:14B
apiBase: http://localhost:12434/engines/v1
apiKey: not-needed
contextLength: 8192
maxTokens: 2048
temperature: 0.1
capabilities:
- tool_use
roles:
- chat
- edit
- apply
這套配置讓本地模型化身編碼助手,查專案、找檔案、改程式碼一條龍服務,全程資料不出本地。
3. 騷操作最佳化
- 大小模型組合拳:小模型負責補全(速度快),14B大模型主攻程式碼編輯
- 專案規則庫:在
.continue/rules/裡存專案結構、測試命令和禁改檔案清單,讓模型少犯二
真實體驗:夠用但別指望太爽
作者直言,本地方案和Claude Code比確實糙:
- Qwen2.5 Coder 14B理解大專案慢半拍,得多給明確指令
- 別指望它自己搞定複雜需求
但修bug、加小功能這種明確需求基本穩了。Continue會自動關聯專案檔案,建議的程式碼改動能直接應用,不用來回複製貼上。
效能表現(M5 MacBook Air 16GB):
- 響應比雲端慢,長時間跑機器能煎雞蛋
- 跑14B模型時記憶體吃緊,其他吃記憶體的軟體得關一關
- 最大亮點:徹底告別用量焦慮——隨便試錯、反覆追問、批次修bug,真·為所欲為
國內開發者の快樂指南
- 成本暴降:20刀月費變一次性硬體投入,越用越回本
- 隱私無憂:程式碼不出本地,企業敏感專案隨便搞
- 網路自由:再也不用擔心API抽風
- 國產優勢:Qwen2.5 Coder對中文註釋理解更溜,工具生態也更接地氣
適用場景:日常維護中小專案、個人練手、對響應速度要求不極致的場景。架構設計或大型重構還是得找更專業的模型。
常見問題
16GB 記憶體的裝置能流暢執行 Qwen2.5 Coder 14B 嗎?
根據原文實測,Q4 量化版本佔用約 9GB 記憶體,在 M5 MacBook Air 16GB 裝置上可執行,但會限制其他應用的可用記憶體,長時間使用會導致裝置發熱。建議關閉記憶體密集型應用(如多個 Docker 容器)以保證流暢性。
本地模型與 Claude Code 的核心差距在哪裡?
原文指出三點:1)理解大型專案的速度和準確性較弱;2)錯誤率更高,需更具體的指令;3)無法處理模糊需求。但對於明確定義的 bug 修復、小功能開發等佔日常工作 80% 的任務,14B 模型已足夠勝任,且無使用次數限制。
Continue 外掛的 Agent 模式可靠嗎?
原文提到 Continue 支援檔案搜尋和終端命令等工具呼叫,但效果高度依賴模型能力。Qwen2.5 Coder 14B 支援 tool_use,可執行基本的檔案檢查和程式碼變更,但複雜的多步驟自主操作仍不如雲端大模型穩定。
如何降低本地模型的響應延遲?
原文建議:1)用更小的模型(如 Qwen2.5 Coder 7B)處理自動補全;2)通過 .continue/rules/ 提供專案結構等上下文,減少模型推理負擔;3)避免同時執行其他高負載任務。硬體層面,更大記憶體或 GPU 加速(如 NVIDIA 顯示卡)可顯著提升速度。
這套方案對中國開發者有哪些獨特優勢?
三點核心價值:1)規避國際 AI 服務的網路訪問限制;2)程式碼隱私完全可控,適合企業敏感專案;3)Qwen 系列模型由阿里雲開源,對中文程式碼註釋和文件理解更優,且國內社群支援活躍。成本方面,一次性硬體投入後無持續訂閱費用。
本文基於 GNews:XDA Developers 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://www.xda-developers.com/ditched-claude-codes-20-plan-local-llm-vs-code-getting-more-done/
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
頂級 AI 影像生成工具,以畫面質感、藝術風格、構圖理解著稱。V7 模型在寫實和創意兩個方向均領先。需 Discord 或網頁版使用。
Cursor
精选AI 开发工具
AI-first 程式碼編輯器,基於 VS Code 構建,深度整合 Claude / GPT-4o 等模型。Composer 多檔案編輯、Tab 自動補全、Agent 模式三大殺手鐧。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以長上下文(200K tokens)、對複雜任務的細膩理解、Artifacts 視覺化輸出聞名。Claude Sonnet 4.5 / Opus 4.7 在程式設計、寫作、推理多項基準上領先。
相关推荐
同类资讯 — 由发布时间排序

Anthropic 與 OpenAI 承諾引入獨立安全評估員,但獨立效能否兌現仍存疑
Anthropic CEO Dario Amodei 提議將第三方安全評估機構嵌入前沿 AI 公司內部,OpenAI 也表示支援。評估員將獲得模型訓練過程、檢查點(checkpoints)等深度訪問許可權,並可公開發布風險發現。但評估機構擔心:過往合作中時間限制、保密協議和釋出控制權等問題能否真正解決?沒有立法支援,這種"獨立評估"會否淪為受 AI 公司控制的外包服務?

輝達高管詳解機器人行業缺失的"ChatGPT時刻"及資料瓶頸
輝達物理AI全球負責人Les Karpas將在TechCrunch Disrupt 2026大會上解析機器人領域為何尚未迎來類似ChatGPT的突破性時刻。核心障礙在於:機器人缺乏類似網際網路規模的物理世界資料集,而這正是大語言模型成功的基礎。他將分享初創企業如何通過模擬、合成數據和跨平臺基礎模型嘗試彌合數字與物理世界的鴻溝。

特朗普與習近平會晤料不會就AI減速達成協議 OpenAI與Anthropic呼籲遇冷
美國AI安全焦慮升溫,OpenAI的Sam Altman與Anthropic的Dario Amodei呼籲中美協調放緩AI發展,Altman甚至稱兩國領導人若達成協議可獲諾貝爾和平獎。但特朗普與習近平均明確拒絕"減速論",雙方將於9月24日會晤討論AI安全,但分歧明顯:美方擔憂存在風險,中方視其為遏制企圖;美國偏好閉源模型,中國推崇開源低成本路線。

谷歌 AI 社會影響計劃:從疾病預測到災害預警的全球實踐
谷歌在其官方部落格中系統闡述了 AI 技術在社會領域的應用進展,涵蓋疾病防治、自然災害預測、教育普及和經濟機會拓展四大方向。通過與全球社群和研究者合作,谷歌正將 AI 從理論研究轉化為可測量的實際影響,包括利用衛星每 20 分鐘掃描全球以捕捉汽車大小的山火,以及通過 Flood Hub 等工具預測洪水。