
AWS 在 2026 年 8 月 6 日宣布 Amazon Bedrock AgentCore Runtime Instances,作為原有 microVM runtime 以外的另一種 production compute 選項。它由 AWS 管理背後的 EC2 infrastructure,讓 agent 可以在較持久的執行環境中保留 session 和計算資源,而不只是在每次請求時啟動一個短生命週期的 sandbox。
Runtime Instances 可以在同一個 runtime 內運行多個 agents,並支援最長 14 日的 shared sessions。AWS 亦列出 stop 和 restart、GPU、container deployments 等能力。這種設計適合需要長時間處理任務、保留工作目錄,或在多個 agent 之間傳遞中間狀態的 workflow,但 session 壽命越長,權限、資料清理和資源隔離也越重要。
AWS 表示,Runtime Instances 可以和 EBS 及 AgentCore Memory 配合。EBS 提供持久儲存,Memory 則用於跨 session 的長期 recall;兩者處理的是不同層次的狀態。企業若把兩者一起使用,就要清楚界定哪些資料只是暫存工作檔案,哪些資料可以進入長期記憶,以及資料保留多久。
這個新選項仍沿用 AgentCore 的 API、identity controls 和 observability。AWS 將它定位為同一套 agent 平台內的 compute 取捨,而不是另起一個部署模型。Runtime Instances 亦支援 agent-to-agent communication:一個 agent 可以把另一個 agent 當作 tool 呼叫,並共享檔案系統和 session context。
在開發框架方面,AWS 表示它不綁定單一 framework 或 model,可配合 CrewAI、LangGraph、LlamaIndex 和 Strands 等工具。平台支援 Linux ARM64 和 x86_64、Python 3.11 至 3.14、container,以及 GPU workloads。AWS 公告列出的 launch regions 包括美國東部 Ohio、Virginia、Oregon,以及 Mumbai、Singapore、Sydney、Tokyo、Frankfurt 和 Ireland。
成本模型也和短生命週期的 invocation 不同。AWS 表示 Runtime Instances 按標準 EC2 pricing 加上 AgentCore management fee 計算;實際費用會受 instance type、GPU、運行時間、儲存、流量和地區影響。這些是 AWS 公布的產品和價格說明,採用前仍應按最新區域文件及自己的 load pattern 計算,不能只用一次請求的 token 成本估算。
對 production agent 而言,Runtime Instances 的價值在於把 session、工具、檔案和 agent-to-agent 協作放進同一個可管理的計算邊界。相對地,團隊需要處理長 session 的 stale credentials、跨 agent 的資料權限、重啟後的 idempotency、GPU 利用率和租戶隔離。持久計算減少啟動摩擦,但不會自動解決 workflow reliability。
這次更新反映 agent infrastructure 正由「每次呼叫一個 runtime」走向「按工作型態選擇持久或短暫的 execution」。短任務可以維持輕量 sandbox,長任務或需要本地狀態的流程則可考慮 Runtime Instances。真正的選擇仍應由 session 生命週期、資料治理、可觀測性、失敗恢復和總成本共同決定。



