AI 技術週報|2026-W33:Agent 的正式供應、工具協定與任務成本

Google Gemini 3.7 Flash 與 DeepSeek V4-Pro 正式可用,讓 Agent 導入同時面對供應、工具協定相容性與任務成本排程。

本週值得注意的不是又多了一個模型,而是 Agent 導入的三個條件開始一起變得具體:模型是否正式供應、能否接進既有的工具協定,以及任務成本能否被安排。Google 在 8 月 13 日將 Gemini 3.7 Flash 轉為正式可用,並定位為 coding 與 agents 的 workhorse;同日 DeepSeek 將 V4-Pro 轉為正式可用,且提供原生 OpenAI Responses API 格式與 Codex 適配。到了 8 月 16 日,DeepSeek 的新尖離峰計價生效。這些公告共同把選模型的問題,推向供應、相容性與成本三件事。

三個改變,對應三個導入條件

正式可用,才是可以納入平台評估的起點

Google 將 Gemini 3.7 Flash 列為 generally available,並表示它面向 coding 與 agentic workflows。DeepSeek 也宣布 V4-Pro 在 app、web 與 API 正式可用。這讓團隊能把兩者放進正式的採購、存取與評估流程;但兩家對能力的描述仍是供應商主張,不是獨立 benchmark,也不等於特定工作負載一定適用。

協定相容性開始和模型能力同等重要

DeepSeek 說明 V4-Pro 支援原生 OpenAI Responses API 格式並適配 Codex,同時提供 low、high、max 三種 thinking effort。這代表工程團隊不只要比較模型輸出,也要檢查既有 agent、tool calling、評估與權限流程能否沿用。這份適配聲明不證明語意完全相同,也不能省略遷移測試。

任務成本不再只是月結帳單

DeepSeek 宣布的新尖離峰計價於 8 月 16 日 16:00 UTC 生效,離峰價格為尖峰的一半。對可延後執行的批次評估、長任務或非同步 agent,排程可能成為成本控制的一部分;對即時工作流則未必有同樣效果。實際節省仍取決於流量、token 使用、模型選擇與工作負載,不能由公告直接推算。

給系統設計者的本週判讀

Agent 的採用判斷正在從「哪個模型更強」變成一個小型營運設計:先確認正式供應範圍,再驗證 API 與工具協定是否真的可接入,最後按同步性與成本條件安排任務。這不是要求把每個新模型立刻接進 production,而是要求把可用性、相容性與成本假設一起納入測試計畫。

事實邊界

本文只涵蓋 2026-W33(8 月 10 日至 16 日)的 Google 與 DeepSeek 官方文件。Gemini 與 V4-Pro 的能力描述均保留為供應商歸因;本文不主張獨立效能勝負、Codex 完整相容、確定節費,或任何團隊已完成導入。

第一手來源