今天最值得看三件事:Anthropic 推出 Claude Sonnet 5,性能逼近 Opus 4.8 但價格更低,還開放 Linux 桌面版與科研工作台;Google ADK Go 2.0 帶來以圖為基礎的多智能體工作流引擎與人工參與循環;Every 公開單人維護 5 款產品的「複利工程」方法論,把每次解法寫進 CLAUDE.md 讓 AI 自動避坑。對中小企 IT 落地 AGENT 化流程都是實用訊號。
模型發佈
Claude Sonnet 5 發佈:性能逼近 Opus 4.8、價格更低
Anthropic 推出最新的 Claude Sonnet 5,內建計畫、瀏覽器與終端機工具使用能力,可自主運行。性能接近 Opus 4.8,在推理、工具使用、程式編寫與知識工作等 agentic 能力上比 Sonnet 4.6 大幅提升,BrowseComp 與 OSWorld-Verified 評測都嚴格優於 4.6。安全評估顯示不良行為率更低、幻覺與諂媚減少。即日起至 2026/8/31 特惠:輸入每百萬 token $2、輸出 $10,之後恢復 $3/$15。全套餐及 Claude Code 皆可用。
對 3Q 客戶意義:3Q 內部 agent 與客戶自動化流程可直接升級主力模型,特惠期正是壓成本導入的好時機。
工具開源
Google 發佈 ADK Go 2.0:以圖為基礎的多智能體工作流引擎
Agent Development Kit(ADK)for Go 2.0 推出以圖為基礎的工作流引擎,用來組合複雜的多智能體應用。新版內建人工參與循環(HITL)編排、以純 Go 程式碼做動態執行,以及指數退避重試等自動彈性機制。統一執行模型後,單一 agent 應用與複雜圖形都跑在同一個 runtime 上,簡化了遙測與狀態持久化。
對 3Q 客戶意義:想用 Go 把 AI agent 嵌進企業後端流程的團隊,多了一個帶人工審核關卡與重試機制的正規框架。
shot-scraper video:讓 AI agent 自動錄製操作演示影片
shot-scraper 1.10 新增 shot-scraper video 指令,可用 storyboard.yml 定義操作步驟,透過 Playwright 錄製瀏覽器影片,依賴 Playwright 1.61.0 新的 screencast 機制,解決過去開頭白幀、寬度固定 800px 等問題。開發者 Simon Willison 特別把 --help 輸出寫得夠詳細,讓編碼 agent 能直接呼叫此指令產生演示影片。
對 3Q 客戶意義:做企業系統交付時,可用它自動產出功能操作教學影片,省下人工錄製與後製工時。
產品動態
Claude Desktop 推出 Linux 公測版
Claude Desktop 現已在 Linux(Ubuntu 與 Debian)推出測試版。除了瀏覽器與終端機,所有付費方案現在都能在 Linux 上獲得完整桌面體驗,包含 Claude Code、Claude Cowork 與聊天。
對 3Q 客戶意義:以 Ubuntu/Debian 為主的 IT 開發與維運環境,終於能原生跑 Claude 桌面工具,不必再繞瀏覽器。
X 推出 hosted X MCP,AI agent 可直連 X API
X(Twitter)官方推出 hosted X MCP,AI agent 可透過 MCP 協定直接呼叫 X API 取得即時資訊,支援 Grok、Cursor 等工具。需註冊 X API 並按量付費,個人優惠價每次呼叫 0.01 美元(1 美元 1000 次)。有人實測拉取近三天書籤僅花 0.1 美元。設定流程:建立 APP 並儲值、取得設定 ID、輔助設定(可交給 Codex/Claude)、授權啟動。
對 3Q 客戶意義:MCP 正快速成為各家資料源的標準接口,3Q 在整合外部資料進 agent 流程時值得優先評估 MCP 化。
來源:X:歸藏
技巧與觀點
一人維護 5 款產品、80% 時間不寫程式:Every 的「複利工程」
軟體公司 Every 公開「複利工程」方法論,以單人工程團隊維護 5 款產品。核心是四步循環 Plan→Work→Review→Compound,其中 Compound 把每次解決問題的解法寫進 CLAUDE.md 與 docs/solutions/,讓 AI 下次自動避開同樣的坑。工程師 80% 時間花在 Plan 與 Review,只有 20% 用來寫程式。配套開源外掛支援 Claude Code,含 26 個專項 agent、23 條工作流指令、13 項技能,可零設定使用。
對 3Q 客戶意義:小團隊要放大產能,關鍵不是寫更多程式,而是把解法沉澱成 AI 可讀的知識庫——這正是 3Q 顧問服務可複製的做法。
來源:X:小互
Claude Code 入門:智能體循環(Agent Loop)
Claude Code 團隊把 agent loop 定義為「agent 重複工作直到滿足停止條件」,並分為四類:turn-based(使用者提示觸發,Claude 自行判斷完成或需更多脈絡)、goal-based(用 /goal 設定可驗證完成標準與最大輪次)、time-based(用 /loop 依時間間隔重複,可用 /schedule 移到雲端)、proactive(依事件或排程自動運行,無人即時參與)。文章也說明如何寫 SKILL.md 把人工驗證步驟編碼,讓 Claude 做端到端自檢。
對 3Q 客戶意義:要把 AI 從聊天玩具變成能跑排程與自檢的業務流程,這四種循環模式是設計 agent 化維運的基礎框架。
來源:Claude 部落格
AI 就業爭論更混亂:高投入企業反而增員 10%
截至 2026 年 5 月,AI 相關裁員接近 9 萬個。但 Ramp 與 Revelio Labs 對近 22,000 家公司的報告發現,高 AI 投入企業(近三個月人均月支出 30 美元)總員工數成長 10.2%、入門級職位成長 12%。報告認為 AI 並非普遍造成職位消失,而是在資源充裕的科技企業成為擴張工具——降低工程、業務、客服成本進而推動整體增員;僅買訂閱卻未持續投入的公司則沒有成長,可能加大企業間的資源鴻溝。
對 3Q 客戶意義:AI 導入不是砍人,而是壓低單位成本再擴張;中小企要的是把它嵌進真實流程持續投入,而非買個訂閱擺著。
3Q 編輯部觀點
今天的主軸很清楚:AI 正從「會聊天」全面轉向「會自己幹活」。Claude Sonnet 5 內建瀏覽器與終端機工具、能自主運行,還把價格壓到特惠 $2/$10,等於把 agentic 能力的門檻一路拉低;Google ADK Go 2.0 補上以圖為基礎的工作流引擎與人工參與循環,讓多 agent 應用能帶審核關卡跑進企業後端;X 把 API 包成 hosted MCP,資料源 MCP 化的趨勢愈發明確。對 3Q 這種要把 AI 塞進真實業務流程的顧問角色,這些都是可以直接落地的積木,而不是展示用的花招。
更值得中小企老闆看的,是 Every 的「複利工程」與 Claude Code 的 agent loop 這兩篇。它們回答了同一個問題:小團隊怎麼用 AI 放大產能?答案不是叫 AI 寫更多程式,而是把每次的解法、每個驗證步驟寫成 AI 讀得懂的知識(CLAUDE.md、SKILL.md),讓下一次自動避坑、自動自檢。這跟我們一直強調的「把老 ERP 知識沉澱、把流程標準化」是同一套邏輯。再對照 TechCrunch 的就業數據——真正因 AI 增員的是持續投入、把它嵌進流程的公司,只買訂閱擺著的沒有紅利。結論給客戶很簡單:AI 的價值不在買了什麼模型,而在你有沒有把它接進日常的工單、報表、維運裡持續累積。Linux 桌面版與科研工作台的推出,也代表工具鏈正逐步補齊,導入的技術藉口愈來愈少了。
資料素材來源:AIHOT (aihot.virxact.com)。本文由 3Q 編輯部用 Claude 篩選、翻譯為繁體中文、加上對 3Q 客戶意義的觀點。各則新聞著作權屬原始發佈者,請點上方連結看原文。