前沿解讀 · Anthropic

如何把Claude Code接進真實工作流:來自15家高增長初創公司的經驗

Anthropic走訪15家高增長初創公司,記錄Claude Code如何進入原型、研發、驗證、版本替換和產品化,並歸納出五條值得創業團隊關注的AI原生工作規則。

2026年8月20日,Claude官網釋出Michael Segner撰寫的《The Claude Code Guide for Startups》。這份指南匯集15家公司的受訪實踐,並歸納出五條規則。

這些案例覆蓋工程交付、缺陷分流、法律檔案處理、醫療編碼審計、模型接入與內部平臺建設。它們共同指向一套清晰的方法:選對工作單元,配置許可權與驗證機制,同時保留低成本重建的能力。

文中Agentic Coding指AI代理參與規劃、編碼、測試與提交的開發方式;Agent指在授權範圍內連續執行任務的AI代理;PR指程式碼合併請求;Skills指可複用的指令模組。

四個來自受訪企業的指標

以下資料來自Anthropic指南中的企業個案,適用週期與統計口徑以各公司原始披露為準,不代表普遍效果。

受訪企業披露30%ClickHouse功能交付量提升
受訪企業披露2–3倍Omni工程生產力提升
受訪企業披露100%Clay缺陷分流自動化
受訪企業披露6,000+ PR / 周Artemis Security每週PR規模

這15家公司討論的,已經超出“寫程式碼更快”

指南中的共同變化發生在工作流層面:誰可以發起產品改進、哪些任務可以交給Agent連續執行、什麼證據足以讓結果進入生產環境,以及模型升級後如何低成本替換舊方案。

第一層變化是原型入口擴大。領域專家可以直接完成從問題到首版原型的過程,工程、設計和合規角色把精力集中在專業判斷與上線質量上。

第二層變化是重複工作形成閉環。Agent獲得真實工具、明確許可權和停止條件,能夠接收任務、執行、檢查並回報;人工負責邊界、異常和高風險決策。

第三層變化是驗證與重建成為基礎設施。團隊持續維護測試、評測、知識檔案和回退路徑,才能在模型能力快速演進時提高自主程度,並把內部經驗轉化為客戶產品。

五條規則:從可用原型走向可靠工作流

這五條規則把任務選擇、驗證能力、環境設計和反饋閉環放進同一套工作方法。

01|讓領域專家完成問題到原型的第一步

Claude Code降低了從想法到可執行原型的門檻。產品洞察不必經過多層轉述,律師、醫生、銷售和創始人可以先把自己最理解的問題做成第一版,再讓設計、工程和合規人員處理專業邊界。

案例切面:Parahelp的非技術成員開始提交介面與產品改進;Crosby把Claude Code接進律師日常使用的工具;Heidi讓問題擁有者直接提交程式碼合併請求;Clay和Omni則用定期評審與共享頻道,把零散原型接入正式路線圖。

落地動作

  • 把Claude Code接到團隊每天使用的真實資料來源與工具。
  • 用共享指令和設計規範統一原型質量。
  • 建立固定的原型展示、評審和進入路線圖的機制。

02|優先自動化標準清楚、結果可驗證的重複工作

缺陷分流、測試修復、程式碼審查、舊程式碼清理和大批次資料分析,都具備明確輸入、可檢查輸出與重複執行的特徵。團隊可以讓Agent接管大部分標準化流程,把工程師時間留給需要判斷的異常和關鍵決策。

案例切面:Clay用Agent處理缺陷分流,Translucent讓多個審查視角並行檢查程式碼,Commure用子代理並行推進任務單,ClickHouse則把易波動測試修復、測試覆蓋發現和運維任務做成持續迴圈。

落地動作

  • 先選擇停止條件清楚、失敗容易發現的工作單元。
  • 讓任務從接收、執行到回報形成閉環。
  • 把異常、爭議和高風險結果自動路由給人工處理。

03|讓自主程度與驗證能力匹配

Agent能連續工作多長時間、可以改動哪些資源,取決於團隊能否可靠地檢查結果。測試、評測集、人工稽核、版本記錄和確定性檢查共同決定了自主範圍;醫療、法律等高風險場景還需要更嚴格的審計鏈路。

案例切面:Zingage把架構原則和驗證方式寫成約567行團隊約束;Cainex讓醫療編碼審計員同時複核結果與推理,再用經過人工確認的標準樣本和隨機樣本回測;Higgsfield用評測與生產測試壓縮新模型接入週期。

落地動作

  • 把安全邊界、架構規則和不可變條件寫進專案根目錄的規則檔案。
  • 為關鍵任務維護標準樣本、隨機樣本與版本對比指標。
  • 用固定檢查阻止未通過測試、合規或敏感資訊檢查的結果。

04|為版本替換預留驗證與回退路徑

模型能力快速變化,今天合理的架構可能在幾個月後需要調整。把版本替換視為常規能力,意味著新舊路徑可以並行比較,改動先規劃再實施,舊程式碼在驗證完成後得到清理,必要時還能快速回退。

案例切面:Clay把反覆重做視為獲得清晰度的方法;Commure用可複用指令清理已經全量釋出的功能開關和關聯程式碼;Harvey會隨推理、規劃與編排能力升級重構平臺;Cognition接受部分系統可能在6至12個月內被重做。

落地動作

  • 在與當前版本分開的工作區並行執行新舊版本。
  • 沿用同一套評測比較兩條路徑,確認新版本勝出後再切換。
  • 把舊路徑清理寫進完成標準,避免長期保留雙重系統。

05|先在內部真實工作流中驗證

團隊先用Claude Code構建內部Agent,在自己的真實任務中持續使用,記錄模型行為、工具設計和失敗模式。經過內部驗證的能力,再依據使用反饋與評測結果進入客戶產品。

案例切面:Omni從Claude Code的檔案式上下文和並行處理方式獲得產品設計啟發;Emergent用本地除錯區分模型問題與工具鏈問題;ClickHouse把內部開發Agent的經驗延伸到SQL控制台AI助手與AI SRE。

落地動作

  • 先做內部原型,選擇一組真實使用者持續使用。
  • 把每次失敗歸因到模型、上下文、工具或評測。
  • 只有在價值、穩定性和治理條件成熟後,再進入客戶產品。

15家公司的實踐切面

展開公司名稱檢視具體做法。

Artemis Security6,000+ PR / 周

具體實踐

指南稱,Artemis Security每週交付6,000多個PR。團隊把Agent接進端到端交付流程,同時持續建設測試基礎設施、程式碼庫組織方式和團隊知識系統,讓每次貢獻都能沿用同一套結構。

可複用經驗

高吞吐量依賴可複用的測試與知識基礎。先提高系統可驗證性,再擴大Agent的併發與自主範圍。

Cainex醫療編碼驗證閉環

具體實踐

Cainex先由Agent批次處理醫療記錄,再由審計員在內部應用中複核編碼結果、推理過程和問題分類。Claude Code讀取修正與評論,定位產生錯誤的指令,修改通用原則;候選變更還要經過人工確認的標準樣本、失敗記錄與隨機樣本回測。

可複用經驗

這套閉環強調“修正原則”。專家反饋進入版本化指導,所有變化可追蹤,工程師只處理系統無法解決的高難度案例。

Clay缺陷分流全部自動化

具體實踐

指南稱,Clay已將缺陷分流流程全部自動化,從首次判斷延伸到修復建議。公司還設定季度原型評審,讓市場等非工程角色製作的原型獲得進入正式路線圖的機會;內部分析Agent則幫助團隊快速讀取業務資料。

可複用經驗

Clay把原型入口、自動化閉環和定期重做放在同一套機制中。廣泛參與需要配套評審,快速交付需要配套清理與重建。

ClickHouse功能交付量提升30%

具體實踐

指南稱,ClickHouse交付的功能數量增加30%。團隊把多個軟體研發階段改造成自主迴圈,其中兩個Agent分別負責修復易波動測試和發現測試覆蓋缺口,當時位列程式碼倉庫第2、第3貢獻者;另有一組Agent處理運維任務。

可複用經驗

團隊用Claude Code構建和迭代這些內部Agent,並把經驗延伸到客戶產品中的SQL控制台AI助手和麵向站點可靠性工程(SRE)的AI工具。

Cognition為6–12個月內的重做做準備

具體實踐

2026年5月,Cognition聯合創始人Walden Yan表示,在當前AI開發環境下,今天構建的東西很可能在6個月至1年內被重做或淘汰。團隊會為模型尚未完全具備、但很快可能出現的能力提前佈局。

可複用經驗

產品與架構決策需要同時考慮當前可用性和模型能力曲線,並把替換成本控制在可接受範圍。

Commure一次專案並行約13個任務單

具體實踐

指南記錄Commure一名工程師曾把約13個任務單並行交給多個子代理,每個子代理負責自己的任務和程式碼合併請求。團隊還能在發現生產資料問題的當天提交修復,並用Agent掃描理賠資料、發現跨站點異常。

可複用經驗

Commure還把舊功能開關與關聯程式碼的清理做成可複用指令。過去消耗多個開發週期的遷移,可以轉化為計劃、並行執行和人工審查。

Crosby律師洞察直接進入產品

具體實踐

Crosby把Claude Code接入律師日常使用的工具和作業系統,讓最理解法律工作的人直接把洞察變成產品原型。團隊還用多個子代理並行整理數千份法律檔案,把大規模資料彙總變成可重複流程。

可複用經驗

領域專家無需遷移到陌生的工程環境。把AI接到熟悉工具與權威資料來源,更容易保留問題語境並減少重複搬運。

Emergent一個Markdown啟動開發環境

具體實踐

Emergent新員工入職第一天,只需讓Claude Code讀取指定Markdown檔案,就能初始化開發環境;遇到失效或過期步驟時,Claude Code會同步更新檔案。團隊還在GitHub上維護可複用指令模組,記錄資料庫位置、資料結構和公司上下文。

可複用經驗

Emergent的應用構建器同樣使用Anthropic模型。團隊可在本地快速判斷異常來自模型行為還是工具鏈設計,從而縮短問題分流週期。

Harvey隨模型能力重構平臺

具體實踐

2026年5月,Harvey應用AI負責人表示,推理、自主執行、規劃和編排等新一波模型能力持續推動平臺架構重構。團隊過去六個月的架構與當前方案已有根本差異。

可複用經驗

當模型能力跨越關鍵閾值,舊平臺可能限制產品上限。Harvey的選擇是及時轉向Agent原生架構。

Heidi問題擁有者直接提交PR

具體實踐

Heidi表示,Claude Code縮短了想法從提出者、產品經理、設計師到工程師的轉述鏈路。理解問題的人可以先提交PR,設計與工程人員在專業環節介入;上線前再按經過確認的技術與合規框架自動檢查,並把關鍵問題交給對應稽核人。

可複用經驗

團隊還把客戶與臨床人員反饋結合使用資料進行分類,讓領域洞察、產品原型和驗證機制形成更短的反饋迴路。

Higgsfield模型接入從數天縮短到數小時

具體實踐

指南引述Higgsfield稱,新影片和影像模型持續出現,每個模型上線前都需要新的指令模組、評測、路由邏輯和生產測試。Claude Code把這一週期從數天縮短到數小時,並讓團隊在同一工作會話中發現生產問題、部署修復。

可複用經驗

模型接入速度來自一套可重複的適配與評測流水線,單純提升編碼速度無法替代它。

Omni工程生產力提升至2–3倍

具體實踐

指南稱,Omni工程生產力提升至原來的2–3倍。團隊設有專門的Claude原型Slack頻道,所有角色都可以提交原型;工程師也被安排參與客戶訪談,以便更快閉合產品反饋。

可複用經驗

Omni借鑑Claude Code的檔案式上下文與並行處理方式,簡化了自家產品架構,減少對複雜檢索管線的依賴,並把部分並行互動思路帶進產品介面。

Parahelp非技術角色也能提交產品改進

具體實踐

Parahelp聯合創始人表示,工程師的交付量明顯增加,包括他本人在內的非技術成員也開始提交UI變更和其他產品改進。Claude Code讓理解問題的人能夠完成從想法到第一版原型的關鍵一步。

可複用經驗

“人人交付”仍然保留專業分工。非技術成員貢獻問題理解與首版實現,工程師繼續負責架構、質量和上線要求。

Translucent多視角程式碼審查

具體實踐

Translucent的程式碼審查Agent會把一次變更分發給多個審查視角,再綜合結果,模擬資深工程師的多角度檢查。公司還建設內部Agent市場,按工程、交付和銷售等角色組織工具。

可複用經驗

除軟體研發外,團隊還讓Agent持續分析醫院財務資料,識別人工分析團隊難以及時發現的預警訊號。

Zingage用約567行工程原則約束工作

具體實踐

Zingage早期給Claude較高自主權時,獲得了看似合理、實際逐漸偏離架構的程式碼。隨後團隊整理約567行工程原則,寫清問題如何界定、哪些條件必須成立,以及如何用證據證明結果有效。

可複用經驗

把不可改變的規則放進每次會話都會讀取的專案根目錄規則檔案,可以讓許可權邊界、架構約束和驗證標準隨任務一起生效。

團隊執行清單

準備把AI程式設計代理引入真實工作流,可以先完成十項檢查。

  1. 選定一個輸入明確、結果可檢查、需要反覆執行的工作單元,寫清完成標準與停止條件。
  2. 把Claude Code接到權威資料來源、程式碼倉庫和團隊日常工具,減少複製貼上與上下文丟失。
  3. 把架構約束、安全邊界和不可變條件寫進每次會話都會讀取的專案根目錄規則檔案。
  4. 用共享指令模組沉澱團隊方法,併為不同目錄維護各自的編碼約定與業務背景。
  5. 建立自動化測試、人工確認的標準樣本、隨機樣本與版本對比指標,持續判斷輸出是否真的變好。
  6. 為高風險結果保留人工稽核;讓稽核者同時看到結果、推理、證據和歷史修訂。
  7. 使用固定檢查阻止未通過測試、合規或敏感資訊檢查的結果進入下一階段。
  8. 在與當前版本分開的工作區並行執行新舊版本,用同一套評測比較結果,並把舊路徑清理納入完成標準。
  9. 為跨角色原型設定固定展示與評審機制,讓有效方案進入正式路線圖。
  10. 先在內部真實工作流中持續使用,再依據價值、穩定性與治理記錄決定是否面向客戶。

來源說明

本文依據Anthropic於2026年8月20日釋出、Michael Segner撰寫的《The Claude Code Guide for Startups》整理與解讀。相關公司與資料均來自該指南。