每日技術脈動

Copilot 沙箱 GA、Haiku 5.5 上線|10/7

3 則新聞,長度 4 分 16 秒

本集重點

GitHub Copilot 本機沙箱正式 GA,讓 Agent 工具執行受檔案、網路與憑證政策限制,但仍須主動啟用並確認隔離範圍。Claude Haiku 5.5 提供分級價格,Sonnet 5.5 快取讀取也降價;Copilot CLI 則可探索本機模型,選用後仍不會自動離線。

本集新聞

  1. GitHub Copilot 本機沙箱正式 GA,涵蓋 CLI、app 與 VS Code Agent Host

    GitHub 宣布本機沙箱正式 GA,以 MXC 將檔案、網路、憑證等政策轉成作業系統限制,適用於 Copilot CLI、app 與使用 Agent Host 的 VS Code 工作階段,不額外收費。

    對工程師的影響

    可限制 Agent 命令接觸的資源。官方文件指出功能預設關閉,CLI 與 app 設定獨立,遠端 MCP 不受本機沙箱隔離,CLI 內建檔案工具自行檢查政策。企業須確認沙箱不可用時的有效政策,不能將其等同虛擬機或容器隔離。

    閱讀原文:GitHub Changelog
  2. Claude Haiku 5.5 發布,Sonnet 5.5 快取讀取價格減半

    Haiku 5.5 加入可調 effort。Prompt 不超過 100,000 tokens 時,每百萬輸入/輸出 tokens 為 0.10/0.50 美元;超過門檻為 0.50/2.50 美元。Sonnet 5.5 快取讀取降為每百萬 tokens 0.10 美元。

    對工程師的影響

    摘要、分類與範圍較小的子 Agent 可列為低成本路由候選,但須計入重試、驗證及升級回大模型的費用。供應商仍建議複雜 agentic coding 使用 Sonnet 或 Opus。快取讀取降價不等於整體帳單減半,實際節省取決於用量組成。

    閱讀原文:Anthropic
  3. Copilot CLI 1.0.94-0 可探索本機 Ollama 模型,離線模式仍需另設

    模型選單可探索執行中的 Ollama,經確認後加入並在目前工作階段切換。Runtime 與模型必須事先安裝,模型須支援工具呼叫及串流。選用本機模型不會自動開啟離線模式或停用 GitHub 遙測。

    對工程師的影響

    省下模型探索與切換操作,但不保證任務品質或完全離線。處理內部程式碼時須核對 provider endpoint、離線設定與工具網路權限;即使 CLI 使用離線模式,遠端 provider 仍會收到 prompt 與程式碼脈絡。

    閱讀原文:GitHub Changelog

逐字稿

10 月 7 日的重點,是 Agent 能碰哪些資源,以及哪些工作可以交給更便宜的模型。

先看 GitHub Copilot。本機沙箱在 10 月 7 日正式 GA,涵蓋 Copilot CLI、Copilot app,以及使用 Agent Host 的 VS Code 工作階段。它用 Microsoft 的 MXC,把檔案、網路與憑證政策轉成各作業系統的限制。這項能力不額外收費。

不過,正式推出不代表已經替你開啟。官方文件說,本機沙箱預設關閉,而且 CLI 與 app 的設定各自獨立。它採用作業系統層級的限制,沒有把命令放進另一台虛擬機或容器。遠端 MCP 也不在本機沙箱範圍內。CLI 內建檔案工具則由工具自行檢查政策,並非由作業系統沙箱攔截。

編輯觀察,讓 Agent 跑測試、安裝依賴或操作 Git 的團隊,現在可以把可讀寫路徑與憑證存取寫成政策。這能縮小命令誤操作的範圍,但不能把所有工具都當成同一種隔離。企業若要求沙箱不可用時必須停止,還要確認 failIfUnavailable 等有效設定。只打開開關,並不足以保證每條執行路徑都會拒絕降級。

再來看 Anthropic。Claude Haiku 5.5 已發布,模型名稱是 claude-haiku-5-5。官方把它定位在摘要、分類、context 壓縮,以及範圍較小的子 Agent 工作,也首次替 Haiku 加入可調整的 effort。

價格要看 prompt 長度。100,000 tokens 以內,每百萬輸入 tokens 是 0.10 美元,輸出是 0.50 美元。超過這個門檻,分別變成 0.50 美元與 2.50 美元。Sonnet 5.5 的快取讀取價格也從每百萬 tokens 0.20 美元降到 0.10 美元。

編輯觀察,這讓大量重複的小任務有了更低的單價,但不能直接把複雜開發任務全部換成 Haiku。Anthropic 自己也指出,複雜的 agentic coding 仍較適合 Sonnet 或 Opus。模型能力與節省幅度的比較來自供應商,不能當成自家工作負載的保證。對已有模型路由的服務,我的判斷是,先把輸出可檢查、失敗可重跑的小步驟列為分流候選。成本計算則要包含重試、驗證與回到大模型的費用。Sonnet 的快取讀取降價,也只會直接影響命中的那部分用量。

最後回到 Copilot CLI。從 1.0.94-0 起,模型選單可以探索正在執行的本機 Ollama 模型。使用者確認 provider 與 endpoint 後,就能加入模型並在目前工作階段切換,不必重啟 CLI。Ollama 與模型要事先安裝,模型也必須支援工具呼叫與串流。這個流程不會幫你下載模型。

還有一個重要邊界:選本機模型,不會自動開啟離線模式,也不會停用 GitHub 遙測。離線模式需要另外設定。即使已開啟,若 provider 指向遠端,prompt 與程式碼脈絡仍會送到那個服務。

編輯觀察,這項更新省下的是探索與切換模型的操作,沒有證明本機模型和雲端模型一樣可靠。處理內部程式碼的團隊,要分別確認推論 endpoint、CLI 對 GitHub 的連線,以及工具自己的網路權限。本機推論和工具隔離是兩件事,換模型不能代替沙箱政策。

這次更新讓成本與權限都有更多控制點。真正要落實的,是把每個控制點接到你的工作流程,並確認它實際涵蓋哪些步驟。