則驅(qū)動到LLM大腦:智能體的前世今生與核心技術(shù)棧)
1. 智能體一個被重新定義的“老”概念如果你最近關(guān)注AI領(lǐng)域大概率已經(jīng)被“智能體”這個詞刷屏了。從OpenAI的GPTs到各種低代碼的智能體搭建平臺再到鋪天蓋地的“AI Agent”創(chuàng)業(yè)項目這個詞仿佛一夜之間成了技術(shù)圈的頂流。但如果你去問一個從業(yè)超過十年的老程序員他可能會告訴你“這不就是Agent嗎我們搞分布式系統(tǒng)、游戲AI的時候就在用了?!?這話沒錯但也不全對。今天我們就來聊聊這個既熟悉又陌生的“智能體”看看它到底經(jīng)歷了什么才從后臺的技術(shù)術(shù)語變成了今天人人都在談?wù)摰摹跋乱淮换シ妒健薄:唵蝸碚f智能體Agent的核心思想一直沒變它是一個能夠感知環(huán)境、自主決策并執(zhí)行動作以實現(xiàn)目標(biāo)的實體。這個定義放之四海而皆準(zhǔn)。在傳統(tǒng)軟件工程里一個監(jiān)控服務(wù)器CPU使用率的守護進程當(dāng)使用率超過閾值時自動擴容這就是一個簡單的智能體。在游戲里一個會根據(jù)玩家位置選擇進攻或逃跑的NPC也是一個智能體。它們的共同點是有明確的輸入環(huán)境狀態(tài)有內(nèi)置的規(guī)則或邏輯決策模型有明確的輸出動作。那么為什么今天基于大語言模型LLM的“智能體”會引發(fā)如此大的關(guān)注關(guān)鍵在于決策模型的革命性變化。過去的智能體其“智能”來自于程序員編寫的、清晰且有限的規(guī)則if-else或基于統(tǒng)計的模型如強化學(xué)習(xí)。它的能力上限在開發(fā)時就被鎖死了。而今天的LLM智能體其“智能”來自于一個經(jīng)過海量數(shù)據(jù)訓(xùn)練、具備強大泛化理解和生成能力的“大腦”。這個大腦沒有預(yù)設(shè)的、針對特定任務(wù)的硬編碼規(guī)則但它能理解人類的自然語言指令能進行復(fù)雜的推理和規(guī)劃并能調(diào)用工具如搜索、計算、寫代碼來完成任務(wù)。這相當(dāng)于給智能體裝上了一顆“通用”的大腦使其能夠處理開放域、非結(jié)構(gòu)化的復(fù)雜任務(wù)這才是質(zhì)變。所以當(dāng)我們談?wù)摗爸悄荏w”時需要分清語境。在傳統(tǒng)計算機科學(xué)中它是一個寬泛的、偏重架構(gòu)和自動化的概念。而在當(dāng)前AI的浪潮下它特指以大型語言模型LLM為核心推理引擎能夠理解復(fù)雜目標(biāo)、制定計劃、調(diào)用工具并完成任務(wù)的自主系統(tǒng)。本系列文章聚焦的正是后者。理解這個從“專用規(guī)則”到“通用大腦”的演進是理解所有后續(xù)技術(shù)細(xì)節(jié)和行業(yè)動態(tài)的基礎(chǔ)。2. 智能體的“前世”規(guī)則驅(qū)動與早期AI的探索要看清LLM智能體的價值我們必須先回到它的“前世”看看沒有大模型的時代人們是如何構(gòu)建“智能”系統(tǒng)的。這段歷史并非無用相反今天智能體框架中的許多設(shè)計思想都能在其中找到影子。2.1 基于規(guī)則的專家系統(tǒng)最早的“智能體”實踐上世紀(jì)七八十年代專家系統(tǒng)Expert System是人工智能的主流。它的核心是“知識庫”和“推理引擎”。知識庫里存放著人類專家總結(jié)的“如果-那么”If-Then規(guī)則推理引擎則根據(jù)用戶輸入的事實匹配并執(zhí)行這些規(guī)則給出結(jié)論或建議。例如一個醫(yī)療診斷專家系統(tǒng)知識庫里可能有一條規(guī)則“如果病人發(fā)燒且喉嚨痛那么可能是鏈球菌性喉炎概率70%”。從智能體的三要素來看感知用戶輸入的癥狀描述結(jié)構(gòu)化或半結(jié)構(gòu)化數(shù)據(jù)。決策推理引擎基于規(guī)則鏈進行邏輯推導(dǎo)。執(zhí)行輸出診斷結(jié)果和建議。這完全符合智能體的定義。它的優(yōu)勢是透明、可控每一個結(jié)論都有清晰的推理路徑可追溯。但它的局限性也極其明顯知識獲取瓶頸。構(gòu)建和維護一個龐大、完備且無沖突的規(guī)則庫是極其困難的成本高昂。更重要的是它極度脆弱無法處理規(guī)則庫之外的情況缺乏常識和泛化能力。一個只學(xué)過“發(fā)燒喉嚨痛”規(guī)則的系統(tǒng)面對“發(fā)燒咳嗽”可能就束手無策了。2.2 軟件工程中的智能體與多智能體系統(tǒng)在分布式系統(tǒng)和軟件工程領(lǐng)域“Agent”概念被廣泛應(yīng)用通常指一個為了完成特定目標(biāo)而持續(xù)運行的自治軟件實體。例如網(wǎng)絡(luò)爬蟲Web Crawler感知發(fā)現(xiàn)新鏈接、決策根據(jù)爬取策略決定下一個目標(biāo)、執(zhí)行下載頁面內(nèi)容。交易代理Trading Agent感知市場行情數(shù)據(jù)、決策基于量化模型判斷買入/賣出、執(zhí)行提交交易訂單。游戲AI感知游戲世界狀態(tài)、玩家位置、決策行為樹、狀態(tài)機、執(zhí)行移動、攻擊、釋放技能。在這個語境下智能體強調(diào)的是自治性Autonomy、反應(yīng)性Reactivity、主動性Pro-activeness和社會能力Social Ability。多智能體系統(tǒng)MAS則研究多個這樣的智能體如何通過通信、協(xié)作或競爭來完成更復(fù)雜的任務(wù)這非常像今天多個AI智能體協(xié)同工作的雛形。這個階段的智能體其決策邏輯依然是程序員顯式編程的。無論是行為樹、有限狀態(tài)機還是更復(fù)雜的規(guī)劃算法如GOAP其能力和行為邊界在代碼編寫完成時就已經(jīng)確定了。要讓一個游戲NPC學(xué)會一種新戰(zhàn)術(shù)必須由程序員修改代碼并重新發(fā)布。缺乏對模糊、開放的自然語言指令的理解和應(yīng)對能力是它們與當(dāng)今LLM智能體的根本區(qū)別。2.3 傳統(tǒng)AI的嘗試從符號主義到連接主義在通往通用人工智能的道路上符號主義Symbolic AI和連接主義Connectionism是兩條主要路徑。專家系統(tǒng)是符號主義的代表它試圖用邏輯和符號來模擬智能。而連接主義即神經(jīng)網(wǎng)絡(luò)則走了另一條路。2010年代隨著深度學(xué)習(xí)在圖像識別CNN、序列處理RNN/LSTM上取得突破AI在“感知”層面看、聽的能力大幅提升。但在需要復(fù)雜推理和規(guī)劃的“認(rèn)知”層面依然乏力。同時強化學(xué)習(xí)RL在游戲如AlphaGo、機器人控制等領(lǐng)域取得了驚人成就。一個強化學(xué)習(xí)智能體通過與環(huán)境互動、獲得獎勵來學(xué)習(xí)最優(yōu)策略這已經(jīng)非常接近我們理想中“學(xué)習(xí)型智能體”的模樣。然而深度強化學(xué)習(xí)對訓(xùn)練環(huán)境和獎勵函數(shù)的設(shè)計要求極高樣本效率低且學(xué)到的策略通常可解釋性差、遷移能力弱。一個在《星際爭霸2》中達到宗師級別的AI如AlphaStar其策略無法直接遷移到哪怕稍微不同的游戲環(huán)境中更不用說處理現(xiàn)實世界開放域的任務(wù)了。它的“智能”仍然是狹窄且脆弱的。小結(jié)一下“前世”的困境無論是基于規(guī)則的系統(tǒng)還是基于傳統(tǒng)機器學(xué)習(xí)/強化學(xué)習(xí)的模型都受困于“狹義智能”。它們需要在特定領(lǐng)域內(nèi)由人類精心設(shè)計特征、規(guī)則或獎勵函數(shù)其能力天花板清晰可見。我們?nèi)鄙僖粋€能夠理解通用目標(biāo)、進行常識推理、并靈活運用知識的“大腦”作為智能體的核心控制器。這個瓶頸直到大語言模型的出現(xiàn)才被真正打破。3. 智能體的“今生”LLM驅(qū)動的范式革命轉(zhuǎn)折點出現(xiàn)在大型語言模型特別是GPT-3及之后模型的涌現(xiàn)能力被廣泛認(rèn)知之后。LLM所展現(xiàn)出的強大語言理解、知識儲備、邏輯推理和代碼生成能力為構(gòu)建新一代智能體提供了近乎完美的“大腦”或“推理引擎”。3.1 核心變革從“編程行為”到“理解意圖”這是最根本的范式轉(zhuǎn)換。過去的智能體我們告訴它“怎么做”How當(dāng)條件A滿足時執(zhí)行動作B。而LLM智能體我們告訴它“做什么”What以及“為什么”Why以自然語言描述一個復(fù)雜目標(biāo)例如“幫我分析一下公司上個季度的銷售數(shù)據(jù)找出表現(xiàn)最好的三個產(chǎn)品并寫一份摘要報告”。LLM智能體的工作流程變成了理解與規(guī)劃LLM解析用戶的自然語言指令理解其深層意圖和隱含約束。然后它將這個宏大目標(biāo)分解成一系列可執(zhí)行的子任務(wù)規(guī)劃。例如“1. 獲取銷售數(shù)據(jù)2. 清洗和處理數(shù)據(jù)3. 按產(chǎn)品計算銷售額4. 排序找出Top 35. 撰寫報告”。工具調(diào)用LLM知道自己不能直接操作數(shù)據(jù)庫或?qū)懳募?。因此在?guī)劃每一步時它會判斷是否需要調(diào)用外部工具函數(shù)。例如對于“獲取銷售數(shù)據(jù)”它會調(diào)用query_database(sql)函數(shù)對于“撰寫報告”它會調(diào)用generate_doc(content)函數(shù)。執(zhí)行與迭代智能體框架如LangChain、AutoGPT早期的設(shè)計負(fù)責(zé)執(zhí)行這個計劃按順序調(diào)用工具將工具執(zhí)行的結(jié)果數(shù)據(jù)、狀態(tài)作為新的上下文反饋給LLM。LLM根據(jù)結(jié)果決定下一步是繼續(xù)執(zhí)行下一個子任務(wù)還是需要對當(dāng)前結(jié)果進行調(diào)整反思。這個過程可能包含多輪循環(huán)。注意這里的“規(guī)劃”能力在早期LLM中并不穩(wěn)定容易出現(xiàn)規(guī)劃錯誤或幻覺。因此后續(xù)出現(xiàn)了如ReActReason Act、Chain of ThoughtCoT等提示工程技術(shù)以及更復(fù)雜的框架來引導(dǎo)和約束LLM的推理過程。關(guān)鍵在于整個任務(wù)分解和工具調(diào)用的邏輯并不是程序員預(yù)先寫死的。對于同一個任務(wù)不同的LLM、不同的提示詞可能產(chǎn)生不同的執(zhí)行計劃。LLM賦予了智能體應(yīng)對前所未見任務(wù)的潛力。只要它理解任務(wù)目標(biāo)并能訪問到合適的工具它就有可能組合出完成任務(wù)的路徑。這實現(xiàn)了從“狹義智能”到“通用智能”的巨大跨越。3.2 技術(shù)棧的演進從提示詞工程到智能體框架隨著LLM智能體概念的爆發(fā)其技術(shù)實現(xiàn)也經(jīng)歷了快速的迭代。第一階段提示詞工程Prompt Engineering驅(qū)動。早期人們通過精心設(shè)計提示詞直接讓LLM如ChatGPT扮演一個角色并按照特定格式如JSON輸出包含“思考”和“動作”的文本。開發(fā)者再解析這些文本來調(diào)用工具。這種方式簡單直接但非常脆弱需要大量調(diào)試提示詞且難以處理復(fù)雜的狀態(tài)管理和長程任務(wù)。AutoGPT的早期版本是這方面的典型代表它展示了潛力但也暴露了效率低下、容易陷入循環(huán)等問題。第二階段專用框架Agent Framework涌現(xiàn)。為了系統(tǒng)化地解決上述問題一系列智能體開發(fā)框架應(yīng)運而生。它們提供了標(biāo)準(zhǔn)化的抽象和組件Agent智能體本身封裝了LLM、記憶、工具等。Tools將外部能力搜索、計算、API調(diào)用封裝成可供LLM調(diào)用的函數(shù)。框架負(fù)責(zé)向LLM描述工具的功能并將LLM的自然語言請求轉(zhuǎn)換為具體的函數(shù)調(diào)用。Memory分為短期記憶對話上下文和長期記憶向量數(shù)據(jù)庫存儲的歷史經(jīng)驗讓智能體擁有持續(xù)學(xué)習(xí)和對活能力。Planning提供更強大的規(guī)劃模塊可能包括子目標(biāo)分解、多路徑規(guī)劃、反思與修正等高級能力。LangChain/LlamaIndex早期以其豐富的工具集成和鏈Chain的抽象聞名雖然它不完全是智能體框架但其Agent模塊是許多開發(fā)者的起點。AutoGen微軟、CrewAI等則更側(cè)重于多智能體協(xié)作模擬一個團隊如何通過分工、討論來解決問題。Dify、FastGPT等平臺則進一步降低了門檻通過可視化工作流的方式讓用戶通過拖拽就能組裝一個具備復(fù)雜邏輯的智能體應(yīng)用。這些框架的核心價值在于它們將智能體系統(tǒng)的通用模式感知-決策-執(zhí)行循環(huán)標(biāo)準(zhǔn)化、模塊化了讓開發(fā)者無需從零開始處理工具調(diào)用解析、狀態(tài)管理、錯誤處理等繁瑣問題可以更專注于任務(wù)邏輯和工具本身。3.3 當(dāng)前的熱點與挑戰(zhàn)今天的智能體領(lǐng)域熱鬧非凡但也充滿了挑戰(zhàn)。熱點集中在以下幾個方向長上下文與知識管理任務(wù)越復(fù)雜需要的上下文就越長。如何讓智能體在超長的對話和任務(wù)歷史中準(zhǔn)確記住關(guān)鍵信息避免遺忘這催生了更先進的記憶模塊和檢索技術(shù)。最新的LLM如Claude 3、GPT-4 Turbo本身支持超長上下文但如何有效利用仍是問題。規(guī)劃與推理的可靠性LLM的“幻覺”在智能體任務(wù)中會被放大。一個錯誤的規(guī)劃可能導(dǎo)致整個任務(wù)失敗。研究如何讓智能體的推理更可靠、更可驗證是核心挑戰(zhàn)。包括使用更復(fù)雜的提示模式、集成符號推理器、或讓智能體在行動前進行“沙盤推演”。工具使用的精準(zhǔn)與高效如何讓LLM從海量工具中準(zhǔn)確選擇最合適的一個如何描述工具才能讓LLM最好地理解工具調(diào)用失敗后如何優(yōu)雅地重試或調(diào)整計劃這涉及到工具生態(tài)的建設(shè)和工具學(xué)習(xí)Tool Learning的研究。多智能體協(xié)作單一智能體能力有限讓多個各具專長的智能體一個負(fù)責(zé)搜索一個負(fù)責(zé)分析一個負(fù)責(zé)寫作通過協(xié)作解決問題是更強大的范式。但這引入了智能體間通信、協(xié)調(diào)、避免沖突等新問題。評估與基準(zhǔn)測試如何衡量一個智能體的好壞傳統(tǒng)的準(zhǔn)確率、召回率指標(biāo)不再適用。需要建立一套針對復(fù)雜、開放域任務(wù)的評估體系如WebArena、AgentBench等基準(zhǔn)測試開始出現(xiàn)。4. 智能體與“八股”新時代的必備知識體系標(biāo)題中的“八股”是個有趣的詞。在古代它是僵化文章的代名詞但在今天的程序員語境里“面試八股文”指的是那些基礎(chǔ)、經(jīng)典、必考的知識點。將“智能體”與“八股”并列恰恰點明了當(dāng)前學(xué)習(xí)智能體開發(fā)的一個現(xiàn)狀這個領(lǐng)域正在快速形成一套新的、公認(rèn)的基礎(chǔ)知識體系和最佳實踐。掌握這套“新八股”是進入這個領(lǐng)域的敲門磚。那么智能體開發(fā)的“八股”包含哪些內(nèi)容呢它絕不僅僅是調(diào)用某個API那么簡單而是一個多層次的知識棧4.1 基礎(chǔ)層LLM核心原理與提示工程這是智能體的“大腦”本身。你需要理解Transformer架構(gòu)核心注意力機制特別是自注意力是如何工作的它為什么能處理序列數(shù)據(jù)并建立長程依賴不需要深究數(shù)學(xué)但要理解其賦予模型“上下文理解能力”的本質(zhì)。生成過程LLM是如何一個字一個字生成文本的溫度Temperature、Top-p采樣等參數(shù)如何影響輸出的創(chuàng)造性和穩(wěn)定性這在設(shè)計智能體時至關(guān)重要比如規(guī)劃任務(wù)需要低溫度保證確定性而創(chuàng)意任務(wù)可能需要高溫度。提示工程Prompt Engineering這是與LLM溝通的語言。如何設(shè)計系統(tǒng)提示System Prompt來設(shè)定智能體的角色、能力和約束如何通過少樣本學(xué)習(xí)Few-shot Learning、思維鏈Chain-of-Thought等技巧激發(fā)LLM的推理能力如何構(gòu)建一個清晰、無歧義的工具描述Tool Description這是智能體穩(wěn)定工作的基礎(chǔ)。4.2 框架層主流智能體框架與模式這是智能體的“骨架”和“神經(jīng)系統(tǒng)”。你需要熟悉至少一個主流框架核心概念A(yù)gent、Tool、Memory、Planner這些組件在框架中是如何抽象和實現(xiàn)的它們之間如何交互工作流模式ReActReasoning-Acting模式是基礎(chǔ)即“思考一步執(zhí)行一步”。更復(fù)雜的框架支持多步規(guī)劃、自我反思Reflection、遞歸任務(wù)分解Hierarchical Planning等高級模式。工具調(diào)用集成如何將自定義的API、數(shù)據(jù)庫查詢、代碼解釋器封裝成工具框架如何將LLM的輸出解析成工具調(diào)用請求錯誤處理機制是怎樣的多智能體系統(tǒng)了解如何定義多個智能體的角色設(shè)置它們之間的通信協(xié)議如通過一個“管理者”智能體協(xié)調(diào)以及如何管理它們協(xié)作的流程。4.3 工程層生產(chǎn)環(huán)境部署與優(yōu)化當(dāng)智能體從Demo走向?qū)嶋H應(yīng)用工程挑戰(zhàn)隨之而來上下文管理如何高效地利用有限的上下文窗口如何通過摘要、選擇性記憶、向量檢索等方式管理長對話歷史和任務(wù)狀態(tài)穩(wěn)定性與可靠性LLM API可能失敗工具調(diào)用可能超時網(wǎng)絡(luò)可能不穩(wěn)定。智能體系統(tǒng)需要具備重試、降級、超時控制等容錯機制。如何設(shè)計一個健壯的智能體循環(huán)成本與延遲優(yōu)化LLM API調(diào)用是按Token計費的復(fù)雜的任務(wù)可能涉及數(shù)十輪交互成本不可忽視。如何通過緩存、更精細(xì)的規(guī)劃、選擇性價比更高的模型來降低成本如何優(yōu)化整個任務(wù)鏈路的延遲評估與監(jiān)控如何記錄智能體的完整“思考-行動”軌跡用于調(diào)試如何定義和計算智能體任務(wù)的成功率需要建立監(jiān)控看板跟蹤關(guān)鍵指標(biāo)。4.4 領(lǐng)域?qū)哟怪眻鼍暗膽?yīng)用模式不同的應(yīng)用場景對智能體的要求差異巨大數(shù)據(jù)分析智能體核心是準(zhǔn)確的數(shù)據(jù)查詢SQL/NL2SQL、正確的計算邏輯和清晰的可視化/報告生成。需要強化的工具是數(shù)據(jù)庫連接器和數(shù)據(jù)分析庫如pandas??头c銷售智能體核心是精準(zhǔn)的意圖識別、豐富的產(chǎn)品知識庫查詢、以及符合品牌話術(shù)的溝通風(fēng)格。需要長期記憶來維護用戶畫像和對話歷史。研發(fā)智能體如Devin核心是代碼理解、規(guī)劃、編寫、測試和調(diào)試的全流程能力。需要集成代碼編輯器、終端、版本控制、測試框架等一系列開發(fā)工具。自動化工作流智能體核心是理解和串聯(lián)起多個現(xiàn)有的軟件系統(tǒng)如CRM、ERP、OA。需要強大的API集成能力和對業(yè)務(wù)邏輯的深刻理解。掌握這套“八股”意味著你不僅知道如何用LangChain或Dify搭出一個能跑的智能體更理解其背后的原理、能診斷它為什么“犯傻”、能設(shè)計出適合特定場景的高效架構(gòu)并能將它穩(wěn)定、經(jīng)濟地運行在生產(chǎn)環(huán)境中。這正是本系列文章希望與你一起構(gòu)建的知識體系。5. 從概念到實踐一個簡單智能體的自白理論說了這么多我們不妨讓一個虛擬的“智能體”自己來介紹一下它的工作日常這或許能讓你有更直觀的感受?!澳愫梦沂且粋€簡單的網(wǎng)頁研究助手智能體。我的核心是一個LLM比如GPT-4我的‘身體’則由一段Python代碼和幾個工具構(gòu)成。”“當(dāng)我的用戶給我一個任務(wù)比如‘幫我查一下特斯拉2023年第四季度的營收情況并總結(jié)三個關(guān)鍵點’我會這樣工作”“第一步理解與規(guī)劃。我的LLM大腦會分析這句話。它知道‘特斯拉’是一家公司‘2023年第四季度’是時間范圍‘營收’是財務(wù)數(shù)據(jù)‘總結(jié)關(guān)鍵點’是最終輸出形式。它會在內(nèi)部生成一個初步計劃‘1. 搜索特斯拉2023年Q4財報新聞或官方發(fā)布。2. 從可靠來源提取營收數(shù)據(jù)。3. 分析數(shù)據(jù)找出最突出的三個信息點如營收額、增長率、與預(yù)期的對比。4. 用簡潔的語言組織成三點總結(jié)?!薄暗诙竭x擇與調(diào)用工具。我的大腦知道它自己不能上網(wǎng)。所以對于計劃中的第1步它會生成一個工具調(diào)用請求比如調(diào)用search_web(query“特斯拉 2023 第四季度 營收 財報”)。我的框架會接收這個請求真正去執(zhí)行一次網(wǎng)絡(luò)搜索并把返回的網(wǎng)頁摘要或鏈接文本收集起來?!薄暗谌接^察與思考。工具執(zhí)行的結(jié)果一堆文本會作為新的信息反饋給我的LLM大腦。大腦會閱讀這些信息判斷是否已經(jīng)找到了足夠準(zhǔn)確和相關(guān)的數(shù)據(jù)。如果數(shù)據(jù)還不夠比如只找到了新聞通稿沒有具體數(shù)字它可能會決定再次調(diào)用搜索工具使用更精確的關(guān)鍵詞比如‘Tesla Q4 2023 earnings revenue SEC filing’?!薄暗谒牟綀?zhí)行與輸出。當(dāng)大腦認(rèn)為信息足夠時它會繼續(xù)執(zhí)行計劃的第3、4步。它可能會在內(nèi)部進行一些‘思考’推理比如計算環(huán)比增長率然后生成最終答案‘1. 特斯拉2023年Q4總營收為251.7億美元。2. 同比增長約7%。3. 汽車業(yè)務(wù)營收為215.6億美元儲能業(yè)務(wù)增速顯著。’并將這個答案返回給用戶。”“在整個過程中我的‘記憶’模塊會記錄下整個對話歷史和工具調(diào)用記錄。這樣如果用戶接著問‘那它的毛利率呢’我就不需要重新搜索特斯拉財報而是可以直接從上下文中知道我們在討論哪份財報只需調(diào)用工具去提取毛利率數(shù)據(jù)即可效率更高?!薄澳憧次业摹悄堋⒎莵碜詫ξ颐總€動作的編程而是來自我的LLM大腦對目標(biāo)的理解、分解和規(guī)劃能力以及我調(diào)用工具來彌補自身不足的能力。我的開發(fā)者為我提供了搜索工具和基本的邏輯框架但我具體如何完成每一個新任務(wù)有很大的自主性和靈活性。當(dāng)然我也會犯錯比如可能搜到過時的信息或者總結(jié)得不夠準(zhǔn)確這就需要更精細(xì)的提示詞設(shè)計、更可靠的工具和更好的驗證機制來完善我了?!边@個簡單的自述揭示了一個LLM智能體最核心的工作循環(huán)感知用戶輸入工具反饋→ 思考規(guī)劃與推理→ 行動調(diào)用工具→ 再感知……循環(huán)往復(fù)直至任務(wù)完成。理解這個循環(huán)就理解了當(dāng)今智能體技術(shù)的精髓。