ความจำกับทักษะ: ความจำแบบบอกเล่าและความจำแบบกระบวนการ
สรุป
**ความทรงจำและทักษะต่างก็เป็นความทรงจำระยะยาว แต่มีความแตกต่างกันโดยพื้นฐาน ความทรงจำคือความทรงจำแบบชี้แจง: มันเก็บข้อเท็จจริง เหตุการณ์ ข้อสรุป และความชอบเป็นรายการสั้น ๆ และสามารถเรียกคืนได้เมื่อคำถามตรงกัน (MEMORY.md + memories/) ทักษะคือความทรงจำเชิงกระบวนการ: มันเก็บขั้นตอนปฏิบัติสำหรับ "ต้องทำอย่างไรเมื่อเกิดสถานการณ์ X" เป็น YAML ที่มีตัวกระตุ้นพร้อมกระบวนการ และจะถูกโหลดด้วยความสำคัญสูงเมื่อสถานการณ์ตรงกัน (ไดเรกทอรี skills/ + SKILL.md) มีข้อจำกัดที่ชัดเจนสามประการที่แยกพวกมันออกจากกัน: ตัวกระตุ้นต่างกัน (ตรงคำถาม vs ตรงสถานการณ์) รูปแบบต่างกัน (รายการ vs ขั้นตอนทีละขั้น) และอัตราการเปลี่ยนแปลงต่างกัน (ความทรงจำเปลี่ยนทุกวัน ทักษะสามารถอยู่นิ่งได้นานเป็นเดือน) เอเจนต์ที่เดินด้วยสองขา ทั้งเข้าใจคุณและรู้วิธีทำงาน.
ทำไมแนวคิดทั้งสองนี้ถึงสับสนอยู่เสมอ
ถ้า Hermes Agent มีการออกแบบหนึ่งที่อ่านผิดได้ง่ายเป็นพิเศษ นั่นคือการแยกอย่างชัดเจนระหว่าง หน่วยความจำ และ ทักษะ
ปฏิกิริยาแรกของคนส่วนใหญ่คือสามคำถาม:
- "พวกเขาไม่ใช่ความจำระยะยาวทั้งคู่หรือ? ทำไมต้องแยกกัน?"
- "พวกเขาทั้งคู่เป็น Markdown ทำไมไม่รวมไว้ด้วยกันล่ะ?"
- "การจำว่า 'frontend ของ agent-demo รันบนพอร์ต dev ท้องถิ่น' กับการจำว่า 'สรุปก่อน แล้วจึงระบุการเปลี่ยนแปลงเมื่อเขียนคำอธิบาย PR' — มันไม่เหมือนกันหรือ?"
คำตอบสั้น ๆ: เพราะสมองของมนุษย์ก็แบ่งพวกมันเช่นกัน
1. วิทยาศาสตร์ความรู้ความเข้าใจได้ทำการแบ่งแยกนี้แล้ว: การแสดงออกเชิงประกาศกับเชิงกระบวนการ
จิตวิทยาได้แยกความทรงจำระยะยาวออกเป็นสองประเภทมานานแล้ว:
| ประเภท | คำจำกัดความ | ตัวอย่าง | วิธีเรียกใช้งาน |
|---|---|---|---|
| เชิงคำประกาศ | ข้อเท็จจริงที่คุณสามารถกล่าวได้ | "ฉันอาศัยอยู่ในปักกิ่ง", "React 18 แนะนำ concurrent rendering" | โดยการ กล่าว |
| เชิงกระบวนการ | ทักษะที่คุณสามารถทำได้แต่ไม่สามารถอธิบายได้ | ขี่จักรยาน, พิมพ์สัมผัส, เขียนคำอธิบาย PR อย่างมีโครงสร้าง | โดยการ ดำเนินการ |
ความทรงจำทั้งสองประเภทนี้แตกต่างกันใน วิธีที่ถูกเก็บไว้ เรียกใช้ และอัปเดต: ความทรงจำเชิงบรรยายสามารถถ่ายทอดเป็นคำพูดได้ (ช่องทางคำพูด) ในขณะที่ความทรงจำเชิงกระบวนการส่วนใหญ่เป็นการปฏิบัติ (ช่องทางการเคลื่อนไหว) ในการทดลองทางจิตวิทยา ผู้ป่วยที่มีความเสียหายที่ฮิปโปแคมป์มีความทรงจำเชิงบรรยายที่บกพร่องอย่างรุนแรง แต่ยังสามารถเรียนรู้ภารกิจเชิงกระบวนการได้ เช่น การเขียนสะท้อน — สองเส้นทางอิสระ ไม่ใช่สองการแสดงออกของเส้นทางเดียวกัน
Hermes เอเจนต์ส่งต่อความแตกต่างนั้นตรงเข้าสู่การออกแบบระบบของมัน:
- ความทรงจำ (
memories/,MEMORY.md): ความทรงจำเชิงประกาศของเอเจนต์ - ทักษะ (
skills/): ความทรงจำเชิงกระบวนการของเอเจนต์
2. ความทรงจำ: สิ่งที่เอเจนต์สามารถกล่าวได้
ระบบความจำเก็บ ข้อเท็จจริง เหตุการณ์ ข้อสรุป และความชอบ:
- "จัสมินกำลังทำงานบนเว็บไซต์ระดับโลกสำหรับ agent-demo."
- "สัปดาห์ที่แล้ว ส่วน hero ถูกเปลี่ยนเป็นการไล่สีแบบเคลื่อนไหว."
- "โปรเจกต์นี้รันบน Next.js ซึ่งเซิร์ฟเวอร์ frontend development อยู่บนพอร์ต dev ในเครื่อง."
ลักษณะเด่นของมัน:
- เชิงประกาศ: มีอยู่ในรูปของประโยคสั้น ๆ และรายการที่สามารถอ้างอิงโดยตรงในพรอมต์ได้
- เรียกคืนตามความต้องการ: เมื่อหัวข้อที่เกี่ยวข้องปรากฏขึ้น การจับคู่ FTS5 จะดึงรายการที่เกี่ยวข้องเข้ามา
- แปรปรวน: รายการใหม่จะถูกเพิ่มเข้าไป รายการเก่าจะถูก
replaced หรือremoved
คิดถึงความทรงจำเหมือนสมุดบันทึกของเจ้าหน้าที่ — สมุดที่วางเปิดอยู่บนโต๊ะ เต็มไปด้วยข้อเท็จจริงเฉพาะเจาะจง
3. ทักษะ: สิ่งที่เอเจนต์สามารถทำได้
ทักษะหนึ่งเก็บ ขั้นตอนมาตรฐานสำหรับงานประเภทหนึ่ง ทักษะ Hermes แบบทั่วไปคือ SKILL.md ซึ่งหน้าส่วน YAML ของมันประกาศเงื่อนไขทริกเกอร์และชุดเครื่องมือที่มันรองรับ:
---
name: pr-description-format
trigger:
when: "user asks to write a PR description"
fallback_for_toolsets: [git, code-review]
---
# Standard procedure for writing a PR description
1. Summarize the goal of the change in one sentence
2. List the changes (grouped by module)
3. Blast radius
4. Testing status
5. Related issue / rollback planลักษณะเด่นของมัน:
- เชิงกระบวนการ: มีอยู่ในรูปแบบ “เมื่อใดควรกระตุ้น + ทำอย่างไร” ใกล้เคียงกับ SOP ที่ใช้ซ้ำได้
- ถูกกระตุ้นโดยสถานการณ์: เมื่อเอเจนต์รู้จักสถานการณ์ที่ตรงกัน Skill จะ ถูกโหลดโดยอัตโนมัติในฐานะ prompt ที่มีลำดับความสำคัญสูง เพื่อแนะแนวทางการกระทำนั้น
- ค่อนข้างมั่นคง: เมื่อ Skill ถูกตั้งค่าแล้ว โดยทั่วไปจะอยู่กับที่; สิ่งที่เปลี่ยนคือสถานการณ์และเนื้อหาใน Memory ที่เชื่อมโยงกับมัน
คิดถึงทักษะเหมือนกับความทรงจำของกล้ามเนื้อของเอเจนต์ — ไม่จำเป็นต้องนึกถึง การเคลื่อนไหวเกิดขึ้นโดยอัตโนมัติ
ผู้ใช้ Hermes ยังสามารถเรียกใช้ /learn เพื่อให้เอเจนต์กลั่นกรอง "ส่วนของเซสชันนี้ที่ควรจัดทำเป็นรหัส" เป็น SKILL.md ใหม่ — คล้ายกับที่พี่เลี้ยงถ่ายทอดวิธีการให้กับศิษย์ฝึกงาน
4. "ทำไมไม่รวมมันเข้าด้วยกัน?" — ข้อจำกัดหลักสามข้อ
บางคนอาจถาม: ทั้งคู่เป็น Markdown ทั้งคู่เป็นความจำระยะยาว งั้นทำไมไม่เอามารวมกันล่ะ?
เพราะว่ามันใช้ไม่ได้ เหตุผลเหล่านี้คล้ายกับข้อจำกัดสามข้อที่ทำให้ USER.md และ MEMORY.md แยกจากกัน แต่ที่นี่ข้อจำกัดเหล่านี้กลับยิ่งแข็งแกร่งกว่า
ข้อจำกัด 1: ตัวกระตุ้นที่แตกต่างกัน
- หน่วยความจําจะถูก "เรียกคืนเมื่อคําสั่งค้นหาตรงกัน" (FTS5 รวมกับสรุปความหมาย)
- สกิลจะถูก "โหลดเมื่อสถานการณ์ตรงกัน" โดยปกติจะมีทริกเกอร์ชัดเจน (
trigger.when: "user asks to write a PR description")
เมื่อรวมกัน เอเจนต์จะสูญเสียการติดตามว่ากำลังอ้างข้อเท็จจริงหรือปฏิบัติตามขั้นตอนอยู่
ข้อจำกัด 2: รูปแบบที่แตกต่างกัน
- ความจำคือ ประโยคสั้น ข้อเท็จจริง รายการ ("[2026-07-30] agent-demo frontend local dev port").
- ทักษะคือ ขั้นตอน แม่แบบ ข้อจำกัด, มักจะมี YAML frontmatter พร้อมลำดับ "ขั้นตอน 1 / 2 / 3".
เมื่อต่อกันแน่น เอเจนต์ไม่สามารถบอกได้ว่า “นี่คือพื้นหลัง หรือสิ่งที่ฉันควรดำเนินการในตอนนี้?”
ข้อจำกัด 3: อัตราการเปลี่ยนแปลงที่แตกต่างกัน
- ความทรงจำเปลี่ยนทุกวัน (การใช้งานครั้งเดียวอาจเพิ่มรายการหนึ่งหรือสองรายการ)
- ทักษะสามารถคงที่ได้นานหลายเดือน (แนวปฏิบัติสำหรับคำอธิบาย PR ไม่ต้องแก้ไขเป็นเวลาครึ่งปี)
การนำสิ่งเหล่านี้มารวมกันทำให้รายการข้อเท็จจริงที่มีความถี่สูงลบล้างมาตรฐาน SOP ที่มั่นคง — เหมือนกับการผนวกรัฐธรรมนูญและปฏิทินตั้งโต๊ะเข้าด้วยกันในสมุดเล่มเดียว
5. สถานการณ์จริง: /learn และหน่วยความจำทำงานร่วมกัน
สมมติว่าคุณบอกเอเจนต์:
"จากนี้ไป ทีมงานของเราจะเขียนคำอธิบาย PR ในรูปแบบนี้: สรุปเป็นประโยคเดียว, รายการการเปลี่ยนแปลง, ขอบเขตผลกระทบ, สถานะการทดสอบ นอกจากนี้ โปรดจำไว้ว่าโครงการนี้เรียกว่า agent-demo และ frontend รันบนพอร์ตพัฒนาในเครื่อง"
เอเจนต์ Hermes ที่ผ่านการฝึกอบรมมาอย่างดีจัดการเรื่องนั้นดังนี้:
- ครึ่งแรก → เส้นทาง
/learn, เขียน ทักษะ ใหม่:pr-description-format.md, ถูกกระตุ้นโดยuser asks to write a PR description. - ครึ่งหลัง → การปฏิบัติการอะตอม
add, เขียนรายการ ความทรงจำ หนึ่งรายการ:- [2026-07-30] agent-demo: frontend dev server on a local dev port.
ครั้งต่อไปที่คุณพูดว่า "เขียนคำอธิบาย PR ให้ฉัน" เอเจนต์จะ:
- จับคู่สถานการณ์และโหลดทักษะ:
pr-description-format.mdเข้าสู่คำสั่งที่มีความสำคัญสูง - จับคู่ความทรงจำตามคำค้น: มันรู้ว่าโปรเจกต์ปัจจุบันคือ agent-demo ซึ่งรันอยู่บนพอร์ตพัฒนาท้องถิ่น
- รวมทั้งสองอย่าง: สร้างคำอธิบาย PR ที่เป็นไปตามมาตรฐานทีมและเหมาะกับโปรเจกต์เฉพาะ
การจำข้อเท็จจริงรวมกับการจำขั้นตอน คือสิ่งที่ทำให้ผลลัพธ์ดีกว่าผลรวมของส่วนประกอบต่างๆ
6. ชุดทักษะและ fallback_for_toolsets
Hermes เพิ่มสองชั้นของการจัดระเบียบเหนือทักษะ:
- ชุดทักษะ: ทักษะที่เกี่ยวข้องจะถูกจัดเป็นกลุ่ม ชุด 'release pipeline' อาจประกอบด้วย
pre-release-checklist,changelog-formatและdeploy-rollbackโดยสามารถเปิดใช้งาน ปิดใช้งาน หรือแบ่งปันเป็นหน่วยได้ fallback_for_toolsets: ทักษะสามารถประกาศได้ว่ามันสำรองชุดเครื่องมือเมื่อชุดเครื่องมือนั้นล้มเหลว ตัวอย่างเช่น เมื่อชุดเครื่องมือgitเกิดข้อผิดพลาด ทักษะที่มีขั้นตอนการกู้คืนแบบ manual rebase จะทำงาน
ทั้งหมดนี้เปลี่ยนทักษะจาก SOPs จุดเดียวให้เป็น วิธีการทำงานที่สามารถประกอบกันได้ — เป็นวิธีการทำงานทั้งหมดที่ผู้ใช้นำมาให้เอเจนต์ ซึ่งถูกบันทึกเป็นทรัพย์สินที่สามารถแชร์ได้
7. ไม่ใช่ความคิดใหม่ แต่ไม่ค่อยมีการนำไปใช้อย่างถูกต้อง
การผสมผสานหน่วยความจำเชิงข้อเท็จจริงและเชิงกระบวนการได้รับการพูดคุยในวงการ AI มานานแล้ว การวิศวกรรมมันจริง ๆ และทำให้มัน สามารถมองเห็น แก้ไข และนำกลับมาใช้ใหม่โดยผู้ใช้ คือสิ่งที่ Hermes อยู่ข้างหน้าค่อนข้างมาก — มันทำแผนที่ทุกชั้นไปยังไดเรกทอรี ฟิลด์ และคำสั่งที่ชัดเจน:
| ความสามารถ | ด้านความจำ | ด้านทักษะ |
|---|---|---|
| ไดเรกทอรีหลัก | ~/.hermes/memories/ | ~/.hermes/skills/ |
| การเข้าถึงชั้นสั่งงาน | MEMORY.md, USER.md | SKILL.md โหลดเมื่อสถานการณ์ตรงกัน |
| คำสั่งจับ | add / replace / remove (ขับเคลื่อนโดยเอเจนต์บวกการอนุมัติ /memory pending) | /learn (ขับเคลื่อนโดยเอเจนต์บวกการอนุมัติ /skills pending) |
| การจัดระเบียบ | รายการบวกดัชนีข้อความเต็ม FTS5 | SOP เดียวบวก Bundles และ fallback_for_toolsets |
| อัตราการเปลี่ยนแปลง | รายวัน | หลายเดือน |
นำการจัดชั้นนั้นมาสู่บริบทของผลิตภัณฑ์ และคุณจะได้รูปทรงที่มีศักยภาพจริง:
- ความทรงจำคือคลังข้อมูลที่ใช้ร่วมกันระหว่างคุณกับเอเจนต์.
- ทักษะคือวิธีการทำงานที่คุณนำมาสู่เอเจนต์.
ด้วยกัน ทั้งสองทำให้เอเจนต์กลายเป็นพันธมิตรที่ เข้าใจคุณและรู้วิธีทำงาน — ไม่ใช่แชทบอทที่มีความทรงจำดี
8. LightVela: การเปลี่ยนทั้งความจำและทักษะให้กลายเป็นทรัพย์สินของผู้ใช้
Hermes ได้ทำให้การแบ่ง Memory / Skill สามารถใช้งานได้ในเชิงวิศวกรรมแล้ว แต่ยังคงเป็น Markdown สำหรับนักพัฒนา อยู่ LightVela มีแนวทางที่จะยกระดับชั้นนั้นจากฟีเจอร์ทางเทคนิคไปสู่ ทรัพย์สินของผู้ใช้:
- ห้องสมุดทักษะส่วนบุคคล: ผู้ใช้สามารถรวบรวม แก้ไข และแชร์ทักษะ (เวิร์กโฟลว์) ของตนเองในแบบเดียวกับที่รวบรวมพรอมต์ และเชื่อมโยงพวกมันกับสถานการณ์การทริกเกอร์ รูปแบบการเขียนของคุณ, ขั้นตอนการตรวจสอบ (SOP), และมาตรฐานการแปลทั้งหมดสามารถกลายเป็นทักษะได้
- ห้องสมุดความทรงจำส่วนบุคคล: ทุกความทรงจำที่เป็นข้อเท็จจริงที่เอเจนต์ถือเกี่ยวกับคุณสามารถมองเห็น แก้ไข และลบได้ โปร่งใส — ไม่จำเป็นต้องแก้ไข
~/.hermes/MEMORY.md - การใช้ซ้ำในระดับทีม: ทั้งทักษะและความทรงจำสามารถถูกบันทึกในขอบเขตของทีม ดังนั้นผู้เข้าร่วมใหม่จะได้รับความทรงจำและวิธีการแชร์ของทีมโดยอัตโนมัติ แทนที่จะต้องพึ่งพาการบอกต่อ
- เส้นทางสั้นที่สุด: หากโมเดล "สองขา" น่าสนใจสำหรับคุณ แต่คุณไม่อยากจัดการกับ Ollama, SSH, systemd และ
~/.hermes/การสำรองข้อมูล LightVela คือเส้นทางสั้นที่สุดไปสู่โมเดลนั้นในรูปแบบสินค้าที่สมบูรณ์
ในคำอื่น ๆ การฝึกเอเจนต์บน LightVela หมายถึง การสะสมสินทรัพย์สองอย่างในเวลาเดียวกัน: ความจำเกี่ยวกับคุณ และชุดทักษะของคุณ สองสินทรัพย์นี้คือสิ่งที่เป็นของคุณในระยะยาว — มันสำคัญกว่าตัวโมเดลเอง
ข้อสรุปสำคัญ
- ความจำ ≠ ทักษะ ความจำชนิดแรกคือ ความจำเชิงปริยาย (ข้อเท็จจริงที่สามารถกล่าวได้) ส่วนชนิดที่สองคือ ความจำเชิงกระบวนการ (วิธีการที่ต้องทำตาม)
- มีข้อจำกัดหลักสามประการที่ทำให้แยกออกจากกัน: สิ่งกระตุ้นต่างกัน / รูปแบบต่างกัน / อัตราการเปลี่ยนแปลงต่างกัน
- เอเจนต์ที่มีความสมบูรณ์ต้องเดินด้วยขาทั้งสองข้าง — จำข้อเท็จจริงและวิธีการ
- LightVela เปลี่ยนทั้งสองอย่างให้กลายเป็นทรัพย์สินของผู้ใช้ ดังนั้น “การฝึกเอเจนต์ของตัวเอง” จึงกลายเป็นประสบการณ์ผลิตภัณฑ์ที่คุณสามารถสร้างต่อได้ แทนที่จะเป็นเพียงสโลแกน
สิ่งที่ทำให้เราถึงจุดนี้
ในหมวดหมู่นี้ มีบทความห้าบทความที่ครอบคลุมเนื้อหา:
- เอเจนต์ Hermes แตกต่างจาก OpenClaw อย่างไร (การสะสม vs การเชื่อมโยง)
- เอเจนต์ Hermes จดจำคุณได้อย่างไร (สี่ชั้นความจำที่มีโครงสร้าง)
- ทำไมเอเจนต์ Hermes ต้องแบ่งความจำออกเป็นสองส่วน (
USER.mdvsMEMORY.md) - ทำไมความจำมากขึ้นจึงไม่ดีกว่า: เอเจนต์ Hermes กรอง ดูแล และอัปเดตความจำระยะยาวอย่างไร (สี่กฎเหล็ก)
- ความจำไม่ใช่ทักษะ: ความแตกต่างระหว่างความจำเชิงข้อเท็จจริงและความจำเชิงกระบวนการ (การเดินบนสองขา)
บรรทัดเดียวปิดท้าย: คูน้ำสำหรับเจเนอเรชันถัดไปของเอเจนต์ไม่ได้อยู่ที่ขนาดของโมเดล แต่ขึ้นอยู่กับว่าเอเจนต์นั้น รู้จักคุณจริงๆ (ความจำ) และ มีวิธีการ (ทักษะ) — และว่าทั้งสองสิ่งนี้สามารถทำงานได้อย่างน่าเชื่อถือในระยะยาวหรือไม่ ขึ้นอยู่กับว่าเอเจนต์นั้น มีชีวิตอยู่ต่อไป นั่นคือเหตุผลที่ LightVela อยู่ที่นี่.
อัปเดตล่าสุดเมื่อ 2026-10-09
Hermes การจัดเก็บความทรงจำระยะยาวของเอเจนต์: กฎเหล็กสี่ข้อสำหรับ "น้อยแต่แม่นยำ"
ทำลายกฎเหล็กสี่ข้อ — ผูกมัด แข็งตัว โปร่งใส รวมตัว — ซึ่งรับประกันความทรงจำระยะยาวของตัวแทน Hermes แม่นยำและไม่บวม
คุณสามารถเปลี่ยน Hermes สมองของตัวแทนได้หรือไม่? ชั้นของโมเดล vs ชั้นของตัวแทน
ทราบความรับผิดชอบใดที่เป็นของโมเดลและความรับผิดชอบใดที่ยังคงอยู่กับเอเจนต์ รวมถึงอัตลักษณ์ ความทรงจำ เครื่องมือ ช่องทาง และงานที่กำหนดเวลา