一位從業(yè)者公開了一套名為“4層執(zhí)行架構(gòu)”的方法論。這套系統(tǒng)的核心設(shè)計目標,是盡可能消除大語言模型在代碼執(zhí)行過程中的模糊判斷,將“理解我的意圖”這一需求,前置到執(zhí)行開始前的設(shè)計階段。
該系統(tǒng)由四層純Markdown文件構(gòu)成,不依賴任何特定框架、運行時環(huán)境或供應(yīng)商鎖定機制。其最核心的規(guī)則在于:判斷行為僅被允許在唯一的一層中、通過唯一的一種機制進行。在其他所有層級中,歧義無法被表達——它要么根據(jù)磁盤上已存在的數(shù)據(jù)自行消解,要么系統(tǒng)停止運行并主動向人類提問。
![]()
該架構(gòu)明確區(qū)分了兩個關(guān)鍵概念:“條件”與“判斷”。條件是指根據(jù)已經(jīng)寫入文件或狀態(tài)的數(shù)據(jù)進行分支,例如判斷一個狀態(tài)字段是否為“已完成”。而判斷則是指基于解釋、模糊性或者個人偏好進行分支。在這套系統(tǒng)中,每一個“判斷”最終都經(jīng)由一個人類決定來消解,其實現(xiàn)機制為“ASK”指令,該指令會阻斷執(zhí)行流程,直到人類給出答復(fù)。條件被允許在上兩層中合法使用,而判斷僅被允許在其中的一層。
架構(gòu)的層級間具有嚴格的單向調(diào)用規(guī)則:每一層只能調(diào)用其下方的層,沒有任何一層能夠向上調(diào)用。設(shè)計者指出,這種分層雖然與前沿LLM平臺上的“工具/技能/代理”等詞匯存在概念重疊,但并非一一對應(yīng)。行業(yè)術(shù)語的邊界往往是模糊的,而這些層級則涇渭分明。問題的關(guān)鍵在于,行業(yè)通用詞匯不會告訴你機械性指令在哪里結(jié)束、判斷在哪里開始。一個平臺的“技能”文件,可能會在一系列名義上的機械性指令中,悄然包含一個需要判斷的選項,比如“選擇用戶到底想要X還是Y”,而這種模糊性在這套新架構(gòu)中是不被允許的。
從業(yè)者表示,借助這套架構(gòu),人力資源與LLM在數(shù)天內(nèi)就于一個名為“paragraf”的代碼庫中完成了超過20個工作項。這些任務(wù)包括創(chuàng)建新的UI包、修復(fù)缺陷、提升測試覆蓋率以及API清理,并且每一個項目都經(jīng)歷了規(guī)劃、實現(xiàn)、測試驗證和歸檔的完整流程。架構(gòu)使用者在一個典型的工作項中所需做的貢獻,僅是兩個決策,因為其他上百個決策在系統(tǒng)設(shè)計之初就已一次性完成。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.