"Agent"
- 把遠端 agent 工作機鋪成一條路:個人尺度的 paved road
要從零架一台遠端 agent 工作機、卻面對選型 / 連線 / 認證 / 無人值守散在多篇不知照什麼順序走、或想把個人 infra 用一條可重現的路收斂決策時回來讀
- Agent-as-Tool
把一個專責 agent 包成可被另一個 agent 呼叫的 tool,形成跨 agent 的責任邊界
- Beyond LLM: Enhancing LLM Applications (Stanford CS230)
Stanford CS230 Deep Learning 講座整理:從 prompt engineering、fine-tuning、RAG 到 agentic workflow、evals、multi-agent system 的全景 survey。保留英文原文。
- Case Study:customer support agent 從 task decomposition 到 eval
把模組四原理串成端到端案例:observe → decompose → design workflow → instrument trace → design eval → iterate。每段標出引用哪章。
- Context Drift
Agent 長任務中累積上下文逐步偏離原始目標,導致後續行動看似合理但整體跑偏
- Goal Drift
Agent 把子目標誤當成整體目標,提早停止或朝錯誤完成條件前進的失敗模式
- Multi-agent system
多個 LLM agent 協作的系統、跟 multi-call workflow 的差異在控制流跟責任邊界、三種拓樸 flat / hierarchical / agent-as-tool
- Tool Result Misread
Agent 誤讀工具輸出,把錯誤、空結果或部分成功當成成功,導致後續步驟建立在錯誤狀態上
- Agent Loop
LLM agent 自我循環的工作流:LLM 規劃下一步、執行 tool、看結果、再規劃下一步、直到任務完成或停止條件觸發
- Agent Memory
Agent 在 context window 之外管理長期狀態的設計、五個層次:working / short-term / long-term episodic / semantic / procedural
- Tool Use
LLM 透過結構化呼叫外部工具(讀檔、查資料庫、發 API request)來擴展能力的設計、function calling 跟 MCP 是常見實作
- 遠端 agent 工作機選型:家用機還是 VPS
要架一台跑 coding agent / 長任務的常駐遠端工作機、在家用機與 VPS 之間猶豫、擔心延遲 / 浮動 IP / 環境隔離、或要估 VPS 規格與計費時回來讀
- 遠端 agent 工作機實作記錄:從 Docker image 到手機端跑通
要把 mosh + zellij + Claude Code + ntfy + 手機連線的遠端 agent 工作流在 VM 上實際架起來、需要每一步的驗證判準與除錯分流時回來讀
- 6.2 tool use 與 MCP server 的權限模型
個人 dev 場景下 tool use / MCP server 的副作用權限:檔案系統 / shell / 網路存取邊界、第三方 MCP 信任、副作用的可逆性
- 手機終端 client 選型:連遠端 agent 工作機該用哪個
要從手機連一台遠端 agent 工作機、在 Blink / Termius / 自製通道之間挑一個能撐住 mosh 漫遊與擴充鍵列的終端 client 時回來讀
- 4.4 Agent 架構原理
Agent loop 結構、失敗模式、什麼任務適合 vs 不適合、跟人類審查的協作模型
- 在 container 裡跑 Claude Code:安裝、認證與 hooks 通知
要把 Claude Code 裝進 container 當遠端 agent、遇到重建後要重認證、agent 要 clone/push 私有 repo 卻卡在認證、或想讓任務結束自動推通知時回來讀
- 4.8 Multi-Agent 拓樸:flat / hierarchical / agent-as-tool
從 multi-call workflow 走到 multi-agent system 的判讀、flat vs hierarchical 拓樸、agent-as-tool 的 MCP 視角、specialization 跟 orchestration overhead 的取捨
- Datadog 成本治理與 Agent 配置
說明 Datadog 的計價模型、custom metrics 成本控制、Agent 部署配置與常見故障模式
- 4.19 Agent memory 分層架構
Agent 在 context window 之外管理長期狀態的設計:working / short-term / long-term episodic / semantic / procedural 五個層次、寫入時機、retrieval 設計、失敗模式
- LLM Agent Prompt Injection 後果治理
production LLM agent 場景的 prompt injection 後果:tool spec 設計、agent loop 限制、review checkpoint、跟 incident workflow 的接合
- 發射管制隊視角:評估工作團隊設計的判讀方法
設計或檢視團隊分組、agent 編制、審查角色歸屬時,用發射管制隊的組織概念逐項判讀結構選擇的正當性:任務編組、安全分線、業務與編組之分等判讀 lens
- Background Agent 平行研究:main context 節省的量化效應
用 background agent 平行做同類研究任務、主 context 只收 finding summary、節省 ~80% context 用量的工作方法