
Insights & News
分享網站、AI automation、數碼營銷、AI news 和 VMTS 公司新聞。
MODULE.001 //
全部文章
分享網站、AI automation、數碼營銷、AI news 和 VMTS 公司新聞。

Grok Bot 擴大至更多方案:xAI 把 Agent 包裝成可交辦工作的數碼隊友
xAI 宣布 Grok Bot 擴展至 SuperGrok Plus、Cursor Pro+ 和所有 Cursor Teams 方案,繼續主打有自己的雲端電腦、能跨工具執行工作並在需要時請人批准的 Agent。

Meta AI 連接社交、廣告與 Google Workspace:小企業 marketing 進入資料工作流
Meta 為小企業推出一組 Meta AI 功能,讓用戶選擇連接 Instagram、Facebook、Meta Ads 和 Google Workspace,整理數據、製作報告並設定重複任務和提醒。

OpenAI Private Safety Processing:Zero Data Retention 也開始支援跨互動安全訊號
OpenAI 宣布在符合 Zero Data Retention 的 API 使用情境中預覽 Private Safety Processing,嘗試在不保留提示詞與回覆內容的前提下,識別跨互動和長流程 Agent 的安全風險。

ChatGPT Ads 進入 31 個歐洲市場:AI marketing 開始貼近決策旅程
OpenAI 宣布 ChatGPT Ads 擴展至 31 個歐洲市場,讓 Free 和 Go 用戶在探索、比較和購買階段看到標示清楚的廣告,並向廣告商提供轉換導向工具。

GitHub Copilot 進入 Slack:共享 Agent 從對話直接走向 PR
GitHub 在 Slack 推出 Copilot agentic experience 公開預覽,讓團隊在 DM、channel 或 thread 以 @GitHub 交辦 issue、調查、實作、驗證和 Pull Request 工作。

Anthropic 把 Computer Use、Skills API 和 Files API 推向正式可用
Anthropic 於 8 月 20 日宣布 Claude Platform 的 Computer Use、browser use、Skills API 和 Files API 正式可用,讓 Agent 可以操作介面、載入團隊技能和持續處理文件。

研究:Mission-critical Agent 不應一開始就拿到完整工具箱
一篇 8 月 18 日上載的 arXiv 研究提出 map-guided escalation,先按任務給 Agent 較小的 harness,只有 self-check 失敗才擴大資訊和工具範圍。

Agent Lightning v1.0:把 Agent harness 直接納入 agentic RL 訓練
Agent Lightning v1.0 研究把 deploy-time harness 視為 agentic RL 的一等公民,提供可重用的訓練流程,並報告 Qwen3.5-9B 在 SWE-bench Verified 上由 41.8% 升至 56.4%。

RaivenTracks:讓 AI 科學工作流保留可分支的決策歷史
一篇 8 月 14 日上載的 arXiv 研究,為對話式科學視覺化加入可分支的 provenance,讓研究人員可以還原已驗證規格,而不必重新解讀整段對話。

EU AI Act 如何落入 Agile:研究提出 12 項可放進交付流程的指引
一篇 8 月 17 日上載的研究,把 EU AI Act 的文件、風險管理和人手監督要求,翻譯成可連接 Definition of Done、Sprint Review 和其他 Agile 活動的 12 項指引。

企業 Agent 治理不只看透明度:AMCIS 研究比較五種 workflow 配置
AMCIS 2026 一篇設計科學研究把自主程度、人機協作和機器學習 guardrails 視為治理配置,指出可執行 Agent 的責任控制要跟 workflow 風險對齊。

Resolve 發布新一代 AgentLab:把企業 Agent 的建置、測試和治理放在同一流程
Resolve 於 8 月 17 日公布新一代 AgentLab,主打自然語言建置、可重用 skills、AI 輔助 workflow、受治理部署及上線前的 permission confidence 測試。

GenRouter 讓圖像 Agent 按需求選 workflow:複雜任務才使用重型推理
8 月 17 日的 GenRouter 預印本把多種 agentic image pipeline 統一成可路由的 workflow space,作者報告在自家測試中減少超過 95% execution cost 和 65% latency。

AI Research Preference Models:讓研究 Agent 先判斷哪個實驗值得花 GPU 時間
8 月 14 日的研究提出 RPM,讓 AI research agent 在真正執行昂貴實驗前,先比較候選方案的價值,作者報告可用較少預算接近 24 小時 baseline 表現。

新研究把實體 AI Agent 安全拆成 12 個信任邊界:問題不只在模型
一篇 8 月 17 日上載的 arXiv 研究,以五層、十二個 attack surface 分析 foundation-model-powered embodied agents,指出記憶、middleware、world state 和多智能體信任仍被低估。

Anthropic 研究多智能體系統:更多 Agent 不一定帶來更好結果
Anthropic 以漏洞研究、共享遊戲世界和協作決策實驗,分析多智能體如何放大協作、資源競爭、從眾和錯誤共識風險。

GLM-5.3 發布:Z.ai 把長程 coding 與 cyber 能力放在同一個 Agent 模型內
Z.ai 發布 GLM-5.3,主打 post-training、長程 coding、terminal agent 和 cyber benchmark;部分數字屬供應商自家測試,不能直接等同獨立排名。

Qwen3.8-27B 開放權重:把原生視覺、長上下文與 Agent 工具帶到較小模型
Qwen 在 8 月 14 日公布 Qwen3.8-27B,27B dense vision-language 模型支援 262K 上下文、可延伸至 1M,以及 reasoning effort 控制。

Uniphore 推出 Marketing AI:用數碼孿生和小型模型模擬下一步營銷決策
Uniphore 發布 Marketing AI,主打每位客戶的數碼孿生、客製化 small language model 和 campaign simulation;供應商聲稱可降低成本,但仍需獨立驗證。

Anthropic 為 Claude 加入文字水印:可驗證 AI 參與,但不等於作者證明
Anthropic 宣布未來 Claude 模型會加入不可見文字水印,讓人可以估計 Claude 是否參與寫作,同時強調水印不包含使用者身份,也不代表作者或所有權證明。
MODULE.002 //
需要協助或查詢更多?
告訴我們您的網站、維護或推廣需要,我們會盡快回覆。
