- Gemini 3.8 Flash 正式上線。 主打長程式編碼、代理任務與多步推理,開發者可直接由 Gemini API 使用;高攻防能力的 Flash Cyber 則只透過 Fairwind 提供受信任防禦團隊。
- 企業開始真正掌控 coding agent 的模型與資料邊界。 GitHub Copilot 可依團隊指定預設模型,App 與 CLI 也會遵守內容排除政策,降低敏感程式碼被帶入上下文的風險。
- Claude Code 把 MCP 管理推向組織層。 管理員可統一派送 HTTP/SSE MCP 伺服器;無人值守環境能自動拒絕原本需要互動確認的操作。
- 瀏覽器本地 AI 的底層開始平台化。 Hugging Face 將 WebGPU 核心做成可版本化、可測試與可跨硬體比較的套件,降低前端推論優化門檻。
AI 技術早報
與 Leo 每日收到的早報同步
今天最重要的事
Hermes sync模型/API 動態
Hermes sync- Gemini 3.8 Flash: 已 GA,定位為低成本、高推理強度的通用工作模型;3.7 Flash 仍受支援,適合更重視 token 效率的負載。優惠價至 2026-12-31,之後每百萬輸入/輸出 token 由 0.75/3.75 美元調為 1.50/7.50 美元。
產品新功能
Hermes sync- Copilot 內容排除 GA: App 與 CLI 不再把管理員排除的檔案當上下文,適用 Business、Enterprise。
- Copilot 團隊模型治理 GA: 企業可設定全域或依團隊區分的預設模型,涵蓋 App、CLI、VS Code。
- Claude Code 2.1.259: 新增受管 MCP 派送與無提示無人值守模式;後者會自動拒絕需要詢問的動作,安全但可能使工作中斷。
- Amazon Connect agentic CX designer GA: 以無程式碼畫布混合自然對話、確定性流程、護欄與系統整合,供客服團隊建立語音及數位自助服務;首波涵蓋東京、新加坡等九區域。
- Hugging Face WebGPU kernels: 提供可直接載入的瀏覽器 GPU 運算核心及 Fleet 實機測試;首批包含 207 個核心。
GitHub AI 趨勢 Top 10
Hermes sync- 專案名稱:
Gitlawb/openclaude
功能: 可跨環境、跨模型執行的 coding agent。
為何值得注意: 單日吸星強,反映開發者持續尋找可攜代理層。
風險/限制: 未辨識到授權條款。
趨勢數據: 31,962 stars、近 24 小時 +700、Trending 第 18。
https://github.com/Gitlawb/openclaude
- 專案名稱:
Imbad0202/academic-research-skills
功能: 將研究、寫作、審稿與修訂封裝成 Claude Code 流程。
為何值得注意: 「技能包」正由提示集合變成完整專業工作管線。
風險/限制: 未辨識到授權條款。
趨勢數據: 45,542 stars、近 24 小時 +682、Trending 第 11。
https://github.com/Imbad0202/academic-research-skills
- 專案名稱:
debpalash/VoiceStudio
功能: 本地執行聲音複製、配音、轉錄與有聲書製作。
為何值得注意: 把分散的語音任務整合成桌面工作室,兼顧隱私。
風險/限制: AGPL 授權需留意衍生服務義務。
趨勢數據: 14,655 stars、Trending 第 4、當日仍有提交。
https://github.com/debpalash/VoiceStudio
- 專案名稱:
ChromeDevTools/chrome-devtools-mcp
功能: 讓 coding agent 經 MCP 操作 Chrome DevTools 進行偵錯。
為何值得注意: 瀏覽器觀測與代理修碼逐漸接成閉環。
趨勢數據: 50,625 stars、五日 +663、Trending 第 6。
https://github.com/ChromeDevTools/chrome-devtools-mcp
- 專案名稱:
yanliudesign/mono-color-skill
功能: 生成單色油墨、網點攝影與編輯式排版的影像技能。
為何值得注意: 小型風格技能也能形成可重用的創作介面。
趨勢數據: 2,021 stars、近 24 小時 +241、專案約 15 天。
https://github.com/yanliudesign/mono-color-skill
- 專案名稱:
diudiu-tech/delivery-harness
功能: 示範外送流程的代理 harness 與按需調度。
為何值得注意: 把代理控制層落到具體營運流程,而非只做聊天展示。
趨勢數據: 1,324 stars、近 24 小時 +185、專案約 21 天。
https://github.com/diudiu-tech/delivery-harness
- 專案名稱:
XiaoDuoYa/codex-with-chatgpt
功能: 以 ChatGPT 規劃、Codex harness 執行任務。
為何值得注意: 顯示「規劃模型與執行框架解耦」需求升溫。
風險/限制: 第三方登入與權限邊界需自行審核。
趨勢數據: 2,273 stars、近 24 小時 +150、專案約 5 天。
https://github.com/XiaoDuoYa/codex-with-chatgpt
- 專案名稱:
pacifio/atlas
功能: 集中追蹤多個 coding agent 的變更、狀態與交接。
為何值得注意: 多代理並行後,版本控制上方需要新的協調層。
趨勢數據: 2,852 stars、Trending 第 9、當日仍有提交。
https://github.com/pacifio/atlas
- 專案名稱:
superlinked/sie
功能: 為代理所需的 embedding、reranking 等模型提供推論叢集。
為何值得注意: 將 RAG 周邊模型整合成可營運的 serving 層。
風險/限制: 最近提交距觀測日約六天。
趨勢數據: 3,046 stars、Trending 第 8。
https://github.com/superlinked/sie
- 專案名稱:
blader/humanizer
功能: 以 agent skill 改寫文字,降低制式 AI 文風。
為何值得注意: 寫作品質控制正被包成跨工具技能。
風險/限制: 容易被用於規避揭露或檢測,且近期程式活動較弱。
趨勢數據: 40,337 stars、Trending 第 15。
https://github.com/blader/humanizer
新詞/新模式雷達
Hermes sync- 受信任防禦者通路: 高攻防能力模型先限量給經審核的政府、關鍵基礎設施與防禦團隊。它兼顧能力釋出與濫用風險,但資格、稽核及退出機制仍不透明;Google、OpenAI、Anthropic 三個獨立來源家族在近 72 小時出現同類模式。
今日觀察
Hermes sync- 模型競爭已不只比能力與價格;「誰能用、透過何種治理通路使用」正成為產品設計的一部分。
- coding agent 的下一個企業採購重點,會從生成品質轉向內容邊界、模型政策、無人值守權限與多代理協調。