跳到主要內容

上下文工程與長上下文提示:引領大型語言模型的智慧未

大型語言模型(LLMs)的互動方式已從簡單、靜態的提示迅速演變。最初,使用者主要專注於精心設計的指令,以獲得即時回應 。然而,隨著LLMs能力與複雜性的提升,對於更精密的引導方法以確保可靠輸出的需求日益顯著 。這種轉變標誌著從單純的「提示設計」邁向更全面的「上下文管理」典範。

提示工程作為最初與LLMs有效溝通的學科應運而生,它涉及仔細措辭查詢、指定風格,並提供基本上下文或範例 。諸如「思維鏈」(Chain-of-Thought, CoT)和「上下文學習」(In-Context Learning, ICL)等技術被開發出來,旨在增強模型推斷能力,並使其無需額外微調即可適應新任務 。

上下文工程 (Context Engineering)是人工智慧開發中的一門新興學科,專注於設計系統,能動態地為大型語言模型(LLM)提供完成任務所需的精確資訊、工具與指令。

這種方法遠遠超越傳統的提示工程(prompt engineering),後者通常僅是撰寫一個靜態提示詞。而上下文工程則包含對 所有資訊的系統性、動態策劃與管理——包括指令、使用者輸入、記憶、外部知識、工具定義、結構化輸出等——在 LLM 產生回應前給予模型所需的一切。

提示工程:奠基之石

提示工程是與LLM有效溝通的起點。它強調文字措辭、角色扮演以及提供少量範例等技巧,透過技術如:

•   思維鏈(Chain-of-Thought, CoT): 促使模型以中間步驟推理、解題,提升多步驟任務表現。
•   上下文學習(In-Context Learning, ICL): 模型從提示中的少量範例暫時性學習,適應新任務。
•   基於角色的提示: 指定模型模擬特定角色的語氣與專業程度。
•   動態提示: 根據任務狀態與模型輸出調整提示內容與順序。
•   指令與上下文分離: 把指令與背景資料分開,保持清晰結構。

然而,這些提示依舊是靜態、手工製作,當面對長對話、動態場景或巨量資料時,便顯現出適應性不足、可擴展性差與高維度變異性的挑戰。

上下文工程:協調AI的舞台

上下文工程不僅設計一條提示,而是搭建整個互動環境。它結合了多項技術與組件:

•   系統提示/指令: 設定AI的行為與任務目標。
•   短期記憶(聊天歷史): 提供最近對話上下文。
•   長期記憶(知識庫): 維持跨多次互動的知識與使用者偏好。
•   檢索增強生成(RAG): 即時檢索外部資料補充知識。
•   工具調用: 允許模型動態調用API或外部系統,獲取或操作數據。
•   結構化輸出: 指定回應格式,如JSON、XML、表格等。
•   工作流程工程: 為多步驟任務規劃上下文組裝與資訊流。
•   資料策劃與處理: 利用摘要、分塊、排序等方法優化上下文內容。

它的核心在於動態管理與全面覆蓋:即隨對話演進或任務需求,組裝最合適的上下文,並在多步驟流程中共享一致記憶,確保連貫性。

長上下文提示:拓展AI的思維長度

長上下文提示(login context prompt) 的出現為模型提供了更大的「舞台空間」,突破短期記憶限制。例如:

•   早期LLMs僅能處理512~1024個 token,而今日如Gemini 1.5 Pro已達到200萬 context window,甚至Meta Llama 4上限高達1000萬 token。
•   這使模型能一次性理解完整的長篇文檔或多回合對話,顯著提升:
•   對長篇文本的整體理解與事實準確性
•   多樣本上下文學習
•   大型文檔的摘要與關鍵資訊檢索
•   程式碼庫、醫療紀錄、法律合約等龐大數據分析
•   跨多回合客戶對話的記憶保持

然而,挑戰也隨之而來,包括「迷失在中間」、「注意力稀釋」、成本增加、延遲上升等,需要搭配精細的上下文工程克服。

核心對比與協同作用

以下表格清楚展現上下文工程與長上下文提示的不同定位與相互補充:

特徵 上下文工程 (CE) 長上下文提示 (LCP) 協同作用
定義 動態組裝、管理與呈現上下文的系統性學科 模型內可同時處理的上下文視窗容量 CE智能填充LCP的視窗,以最佳資訊支援推理
焦點 資訊的相關性、結構化與即時更新 一次可保留的資訊數量與範圍 結合以實現長對話、一致回答、高度準確性
問題解決 適應性、記憶管理、工作流程協調 克服短期記憶不足、避免文檔碎片化 CE防止LCP被雜訊占用,最大化其效用

而在數據處理應用方面,長上下文LLMs與RAG技術則各有優勢:

特徵 長上下文LLMs 檢索增強生成 (RAG) 混合模型
最佳用途 靜態、大型文檔分析、延遲敏感場景 即時更新、多源資料、動態推理 靜態與動態數據並用
延遲特性 低延遲(資料預載入) 高延遲(即時檢索) 智能平衡
可擴展性 受記憶體限制 可透過外部資料庫擴展 整合兩者

未來展望:智能化、自主化、多模態

未來AI將朝以下方向前進:

•   混合架構: 同時結合長上下文與RAG,並在上下文路由中根據需求動態選擇資料來源。
•   智能上下文管理: 利用壓縮演算法、動態令牌分配與AutoML自我調整,提升上下文利用效率。
•   自主代理: 具備規劃、工具調用、結果解釋、自我優化能力,成為能獨立完成複雜任務的智慧體。
•   多模態上下文: 將圖像、音訊、影片與文字無縫整合到單一上下文環境中,實現對真實世界情境的全方位理解。
•   自動化上下文工程: AI不僅消耗上下文,還能主動建構、更新、優化自身的上下文環境。

後記

每過一段時間,就會有什麼 XXX 已死, XXX 才是未來。

但對於自身的經驗來說,所有的事情都是堆疊和累積,並非完全的黑與白這麼絕對的區分,更深入的來說,整個 Context window,其實還是來自於 prompt engingeer 的掌握,對於如何進行 Prompt 之後, Context 才能有更絕對的掌握。

如何整合上下文工程 (Context Engineering) 流程會是基礎於 prompt ,再加上具備 long context 的項目,整合長上下文提示 (Long context prompting),是AI邁向高度智能、自主化的基礎。

可以預見的未來,AI不再是只能「回答」的工具,而是能真正理解、推理、規劃與協助的智慧夥伴。未來AI應用的競爭力,將不僅取決於模型參數數量,而是取決於能否動態、智慧地策劃上下文,將大量資料轉化為具有商業價值與人性化的服務體驗。

參考連結

工商服務

如果你看完這篇文章,也開始對「怎麼用 AI 幫你加速、放大你的想法」感到興趣,那你絕對不能錯過這場活動👇

🎤 🐻 Coding Bear 台北場|來聊什麼是 Vibe Coding 台北場

我們將深入分享如何結合 AI 與程式、創意、內容製作,

讓你用最自然的方式,讓 AI 成為你的工作室助手。

📅 時間:7/25(五)18:30

👉 報名連結:https://codingbear.kktix.cc/events/ai-vibe-coding-2025-07-taipei

天南地北來亂聊,從設計、內容到自動化,無論你是創作者還是開發者,這場講座也許會有實用又有趣的靈感(吧)。來聊聊 AI 怎麼幫你少做一點雜事、多做一點你真的想做的事吧!

留言

這個網誌中的熱門文章

Vibe Coding:到底?氛圍驅動程式開發必殺技?

Vibe Coding(氛圍編程) 是由 OpenAI 共同創辦人 Andrej Karpathy 在 2025 年提出的革命性程式開發方式,它讓開發者透過自然語言與 AI 對話來生成程式碼,徹底改變了傳統的編程模式。 這種開發方式的核心理念是 「順著感覺走」 ,讓 AI 處理技術細節,開發者專注於創意和需求描述。 Vibe Coding 需要基本上的規劃和執行,但並沒有強制規範,從日常經驗來說可分為三個階段, 前期準備、開發過程、和後期維護 三個關鍵階段。每個階段都有其特定的任務和注意事項,正確執行這些步驟將大幅提升開發效率和程式品質。 將靈感與需求透過 AI 快速轉化成產品功能或原型。以下幫你分成 「前、中、後」 三階段要做的事情,適合你自己做、或帶團隊做 前期:設定 vibe & 準備素材 這個階段的重點是 「建立開發語境」 ,因為 AI 的生成表現高度依賴前期提供的上下文與資料。 明確目標 :釐清要解決的問題、預期要做的功能與核心價值。例如在筆記軟體的情境中,可能是:「我要做一款讓使用者能用 Markdown 記錄筆記,並提供標籤與全文搜尋功能的簡單 App。」 收集靈感 :觀察同類產品(如 Obsidian、Notion)、蒐集市場痛點(例如太多筆記軟體無法脫機使用,或同步效能差)。 建立語境 :準備初步 prompt、背景知識、產品定位、品牌調性、目標使用者輪廓等。 確認資源 :決定用哪些工具(Gemini、ChatGPT、設計軟體、流程管理工具等)。 確認完上述內容之後,就可以先開始進行準備規格,進行第一次的 Vibe Coding 方向驗證 提示詞模板準備 很多人會跳過這步驟,但一份 「好的 AI 提示詞模板」 將決定接下來每一次 AI 對話的品質。有效的提示詞模板需具備: 描述具體且無歧義 包含技術要求和約束條件 提供範例資料和測試案例 指定程式碼風格和慣例 例如針對筆記軟體的案例:   「建立一個支援 AI 功能純文字筆記,輸入內容可即時渲染;需支援儲存到本地檔案,提供標籤欄位做分類;以 React 架構,程式風格採用 Tailwind style components 並使用 hooks。」 開發工具選擇 開發工具的選擇 同樣重要,目前市場上主要的 ...

Claude Code Hooks:自動化與安全的最佳實踐

寫在最前頭,這份文章主要寫起來是給自己看, 同時內容是比較適合開發者,工程師們可以做些自動化處理的簡單筆記。 Claude Code hooks Claude Code hooks 是一種強大的自動化機制,允許用戶在 Claude Code 的不同生命週期階段,自定義執行 shell 指令。這種設計讓開發者能夠將規則和自動化行為嵌入到應用層級,確保每次都能可靠執行,而不必依賴 LLM(大型語言模型)是否會選擇執行某項操作。 Hooks 的核心用途 通知 :自訂收到 Claude Code 等待用戶輸入或執行權限時的提醒方式。 自動格式化 :如在每次檔案編輯後自動執行 prettier (針對 .ts 檔)、 gofmt (針對 .go 檔)等。 日誌記錄 :追蹤所有執行過的命令,便於合規或除錯。 自動反饋 :當 Claude Code 產生不符合團隊規範的程式碼時,自動給出反饋。 自訂權限 :阻擋對生產環境檔案或敏感目錄的修改[^1]。 配置與結構 Hooks 透過設定檔進行配置,分為全域( ~/.claude/settings.json )、專案( .claude/settings.json )、本地專案( .claude/settings.local.json )以及企業級策略設定。每個 hook 由「事件名稱」和「匹配器」組成: "hooks": { "PreToolUse": [ { "matcher": "Bash", "hooks": [ { "type": "command", "command": "jq -r '...'" } ] } ] } matcher :用於匹配工具名稱(支援正則表達式),如 Write 、 Edit|Write 、 Notebook.* 。 hooks :當匹配時要執行的命令陣列。 type :目前僅支援 "command" 。 ...

[CSS] z-index 在不同瀏覽器繼承問題

今天會討論到這個課題,是因為要實做一個Popup dialog,所以我們希望的結果如下圖。 可是在IE7 卻發生了這樣的情況。 Popup不論怎麼設定z-index都無法浮在最上層,我們看一下html架構發生什麼事情。