LightVela

ความจำกับทักษะ: ความจำแบบบอกเล่าและความจำแบบกระบวนการ

สรุป

**ความทรงจำและทักษะต่างก็เป็นความทรงจำระยะยาว แต่มีความแตกต่างกันโดยพื้นฐาน ความทรงจำคือความทรงจำแบบชี้แจง: มันเก็บข้อเท็จจริง เหตุการณ์ ข้อสรุป และความชอบเป็นรายการสั้น ๆ และสามารถเรียกคืนได้เมื่อคำถามตรงกัน (MEMORY.md + memories/) ทักษะคือความทรงจำเชิงกระบวนการ: มันเก็บขั้นตอนปฏิบัติสำหรับ "ต้องทำอย่างไรเมื่อเกิดสถานการณ์ X" เป็น YAML ที่มีตัวกระตุ้นพร้อมกระบวนการ และจะถูกโหลดด้วยความสำคัญสูงเมื่อสถานการณ์ตรงกัน (ไดเรกทอรี skills/ + SKILL.md) มีข้อจำกัดที่ชัดเจนสามประการที่แยกพวกมันออกจากกัน: ตัวกระตุ้นต่างกัน (ตรงคำถาม vs ตรงสถานการณ์) รูปแบบต่างกัน (รายการ vs ขั้นตอนทีละขั้น) และอัตราการเปลี่ยนแปลงต่างกัน (ความทรงจำเปลี่ยนทุกวัน ทักษะสามารถอยู่นิ่งได้นานเป็นเดือน) เอเจนต์ที่เดินด้วยสองขา ทั้งเข้าใจคุณและรู้วิธีทำงาน.


ทำไมแนวคิดทั้งสองนี้ถึงสับสนอยู่เสมอ

ถ้า Hermes Agent มีการออกแบบหนึ่งที่อ่านผิดได้ง่ายเป็นพิเศษ นั่นคือการแยกอย่างชัดเจนระหว่าง หน่วยความจำ และ ทักษะ

ปฏิกิริยาแรกของคนส่วนใหญ่คือสามคำถาม:

  • "พวกเขาไม่ใช่ความจำระยะยาวทั้งคู่หรือ? ทำไมต้องแยกกัน?"
  • "พวกเขาทั้งคู่เป็น Markdown ทำไมไม่รวมไว้ด้วยกันล่ะ?"
  • "การจำว่า 'frontend ของ agent-demo รันบนพอร์ต dev ท้องถิ่น' กับการจำว่า 'สรุปก่อน แล้วจึงระบุการเปลี่ยนแปลงเมื่อเขียนคำอธิบาย PR' — มันไม่เหมือนกันหรือ?"

คำตอบสั้น ๆ: เพราะสมองของมนุษย์ก็แบ่งพวกมันเช่นกัน


1. วิทยาศาสตร์ความรู้ความเข้าใจได้ทำการแบ่งแยกนี้แล้ว: การแสดงออกเชิงประกาศกับเชิงกระบวนการ

จิตวิทยาได้แยกความทรงจำระยะยาวออกเป็นสองประเภทมานานแล้ว:

ประเภทคำจำกัดความตัวอย่างวิธีเรียกใช้งาน
เชิงคำประกาศข้อเท็จจริงที่คุณสามารถกล่าวได้"ฉันอาศัยอยู่ในปักกิ่ง", "React 18 แนะนำ concurrent rendering"โดยการ กล่าว
เชิงกระบวนการทักษะที่คุณสามารถทำได้แต่ไม่สามารถอธิบายได้ขี่จักรยาน, พิมพ์สัมผัส, เขียนคำอธิบาย PR อย่างมีโครงสร้างโดยการ ดำเนินการ

ความทรงจำทั้งสองประเภทนี้แตกต่างกันใน วิธีที่ถูกเก็บไว้ เรียกใช้ และอัปเดต: ความทรงจำเชิงบรรยายสามารถถ่ายทอดเป็นคำพูดได้ (ช่องทางคำพูด) ในขณะที่ความทรงจำเชิงกระบวนการส่วนใหญ่เป็นการปฏิบัติ (ช่องทางการเคลื่อนไหว) ในการทดลองทางจิตวิทยา ผู้ป่วยที่มีความเสียหายที่ฮิปโปแคมป์มีความทรงจำเชิงบรรยายที่บกพร่องอย่างรุนแรง แต่ยังสามารถเรียนรู้ภารกิจเชิงกระบวนการได้ เช่น การเขียนสะท้อน — สองเส้นทางอิสระ ไม่ใช่สองการแสดงออกของเส้นทางเดียวกัน

Hermes เอเจนต์ส่งต่อความแตกต่างนั้นตรงเข้าสู่การออกแบบระบบของมัน:

  • ความทรงจำ (memories/, MEMORY.md): ความทรงจำเชิงประกาศของเอเจนต์
  • ทักษะ (skills/): ความทรงจำเชิงกระบวนการของเอเจนต์

2. ความทรงจำ: สิ่งที่เอเจนต์สามารถกล่าวได้

ระบบความจำเก็บ ข้อเท็จจริง เหตุการณ์ ข้อสรุป และความชอบ:

  • "จัสมินกำลังทำงานบนเว็บไซต์ระดับโลกสำหรับ agent-demo."
  • "สัปดาห์ที่แล้ว ส่วน hero ถูกเปลี่ยนเป็นการไล่สีแบบเคลื่อนไหว."
  • "โปรเจกต์นี้รันบน Next.js ซึ่งเซิร์ฟเวอร์ frontend development อยู่บนพอร์ต dev ในเครื่อง."

ลักษณะเด่นของมัน:

  • เชิงประกาศ: มีอยู่ในรูปของประโยคสั้น ๆ และรายการที่สามารถอ้างอิงโดยตรงในพรอมต์ได้
  • เรียกคืนตามความต้องการ: เมื่อหัวข้อที่เกี่ยวข้องปรากฏขึ้น การจับคู่ FTS5 จะดึงรายการที่เกี่ยวข้องเข้ามา
  • แปรปรวน: รายการใหม่จะถูกเพิ่มเข้าไป รายการเก่าจะถูก replaced หรือ removed

คิดถึงความทรงจำเหมือนสมุดบันทึกของเจ้าหน้าที่ — สมุดที่วางเปิดอยู่บนโต๊ะ เต็มไปด้วยข้อเท็จจริงเฉพาะเจาะจง


3. ทักษะ: สิ่งที่เอเจนต์สามารถทำได้

ทักษะหนึ่งเก็บ ขั้นตอนมาตรฐานสำหรับงานประเภทหนึ่ง ทักษะ Hermes แบบทั่วไปคือ SKILL.md ซึ่งหน้าส่วน YAML ของมันประกาศเงื่อนไขทริกเกอร์และชุดเครื่องมือที่มันรองรับ:

---
name: pr-description-format
trigger:
  when: "user asks to write a PR description"
fallback_for_toolsets: [git, code-review]
---

# Standard procedure for writing a PR description

1. Summarize the goal of the change in one sentence
2. List the changes (grouped by module)
3. Blast radius
4. Testing status
5. Related issue / rollback plan

ลักษณะเด่นของมัน:

  • เชิงกระบวนการ: มีอยู่ในรูปแบบ “เมื่อใดควรกระตุ้น + ทำอย่างไร” ใกล้เคียงกับ SOP ที่ใช้ซ้ำได้
  • ถูกกระตุ้นโดยสถานการณ์: เมื่อเอเจนต์รู้จักสถานการณ์ที่ตรงกัน Skill จะ ถูกโหลดโดยอัตโนมัติในฐานะ prompt ที่มีลำดับความสำคัญสูง เพื่อแนะแนวทางการกระทำนั้น
  • ค่อนข้างมั่นคง: เมื่อ Skill ถูกตั้งค่าแล้ว โดยทั่วไปจะอยู่กับที่; สิ่งที่เปลี่ยนคือสถานการณ์และเนื้อหาใน Memory ที่เชื่อมโยงกับมัน

คิดถึงทักษะเหมือนกับความทรงจำของกล้ามเนื้อของเอเจนต์ — ไม่จำเป็นต้องนึกถึง การเคลื่อนไหวเกิดขึ้นโดยอัตโนมัติ

ผู้ใช้ Hermes ยังสามารถเรียกใช้ /learn เพื่อให้เอเจนต์กลั่นกรอง "ส่วนของเซสชันนี้ที่ควรจัดทำเป็นรหัส" เป็น SKILL.md ใหม่ — คล้ายกับที่พี่เลี้ยงถ่ายทอดวิธีการให้กับศิษย์ฝึกงาน


4. "ทำไมไม่รวมมันเข้าด้วยกัน?" — ข้อจำกัดหลักสามข้อ

บางคนอาจถาม: ทั้งคู่เป็น Markdown ทั้งคู่เป็นความจำระยะยาว งั้นทำไมไม่เอามารวมกันล่ะ?

เพราะว่ามันใช้ไม่ได้ เหตุผลเหล่านี้คล้ายกับข้อจำกัดสามข้อที่ทำให้ USER.md และ MEMORY.md แยกจากกัน แต่ที่นี่ข้อจำกัดเหล่านี้กลับยิ่งแข็งแกร่งกว่า

ข้อจำกัด 1: ตัวกระตุ้นที่แตกต่างกัน

  • หน่วยความจําจะถูก "เรียกคืนเมื่อคําสั่งค้นหาตรงกัน" (FTS5 รวมกับสรุปความหมาย)
  • สกิลจะถูก "โหลดเมื่อสถานการณ์ตรงกัน" โดยปกติจะมีทริกเกอร์ชัดเจน (trigger.when: "user asks to write a PR description")

เมื่อรวมกัน เอเจนต์จะสูญเสียการติดตามว่ากำลังอ้างข้อเท็จจริงหรือปฏิบัติตามขั้นตอนอยู่

ข้อจำกัด 2: รูปแบบที่แตกต่างกัน

  • ความจำคือ ประโยคสั้น ข้อเท็จจริง รายการ ("[2026-07-30] agent-demo frontend local dev port").
  • ทักษะคือ ขั้นตอน แม่แบบ ข้อจำกัด, มักจะมี YAML frontmatter พร้อมลำดับ "ขั้นตอน 1 / 2 / 3".

เมื่อต่อกันแน่น เอเจนต์ไม่สามารถบอกได้ว่า “นี่คือพื้นหลัง หรือสิ่งที่ฉันควรดำเนินการในตอนนี้?”

ข้อจำกัด 3: อัตราการเปลี่ยนแปลงที่แตกต่างกัน

  • ความทรงจำเปลี่ยนทุกวัน (การใช้งานครั้งเดียวอาจเพิ่มรายการหนึ่งหรือสองรายการ)
  • ทักษะสามารถคงที่ได้นานหลายเดือน (แนวปฏิบัติสำหรับคำอธิบาย PR ไม่ต้องแก้ไขเป็นเวลาครึ่งปี)

การนำสิ่งเหล่านี้มารวมกันทำให้รายการข้อเท็จจริงที่มีความถี่สูงลบล้างมาตรฐาน SOP ที่มั่นคง — เหมือนกับการผนวกรัฐธรรมนูญและปฏิทินตั้งโต๊ะเข้าด้วยกันในสมุดเล่มเดียว


5. สถานการณ์จริง: /learn และหน่วยความจำทำงานร่วมกัน

สมมติว่าคุณบอกเอเจนต์:

"จากนี้ไป ทีมงานของเราจะเขียนคำอธิบาย PR ในรูปแบบนี้: สรุปเป็นประโยคเดียว, รายการการเปลี่ยนแปลง, ขอบเขตผลกระทบ, สถานะการทดสอบ นอกจากนี้ โปรดจำไว้ว่าโครงการนี้เรียกว่า agent-demo และ frontend รันบนพอร์ตพัฒนาในเครื่อง"

เอเจนต์ Hermes ที่ผ่านการฝึกอบรมมาอย่างดีจัดการเรื่องนั้นดังนี้:

  • ครึ่งแรก → เส้นทาง /learn, เขียน ทักษะ ใหม่: pr-description-format.md, ถูกกระตุ้นโดย user asks to write a PR description.
  • ครึ่งหลัง → การปฏิบัติการอะตอม add, เขียนรายการ ความทรงจำ หนึ่งรายการ: - [2026-07-30] agent-demo: frontend dev server on a local dev port.

ครั้งต่อไปที่คุณพูดว่า "เขียนคำอธิบาย PR ให้ฉัน" เอเจนต์จะ:

  1. จับคู่สถานการณ์และโหลดทักษะ: pr-description-format.md เข้าสู่คำสั่งที่มีความสำคัญสูง
  2. จับคู่ความทรงจำตามคำค้น: มันรู้ว่าโปรเจกต์ปัจจุบันคือ agent-demo ซึ่งรันอยู่บนพอร์ตพัฒนาท้องถิ่น
  3. รวมทั้งสองอย่าง: สร้างคำอธิบาย PR ที่เป็นไปตามมาตรฐานทีมและเหมาะกับโปรเจกต์เฉพาะ

การจำข้อเท็จจริงรวมกับการจำขั้นตอน คือสิ่งที่ทำให้ผลลัพธ์ดีกว่าผลรวมของส่วนประกอบต่างๆ


6. ชุดทักษะและ fallback_for_toolsets

Hermes เพิ่มสองชั้นของการจัดระเบียบเหนือทักษะ:

  • ชุดทักษะ: ทักษะที่เกี่ยวข้องจะถูกจัดเป็นกลุ่ม ชุด 'release pipeline' อาจประกอบด้วย pre-release-checklist, changelog-format และ deploy-rollback โดยสามารถเปิดใช้งาน ปิดใช้งาน หรือแบ่งปันเป็นหน่วยได้
  • fallback_for_toolsets: ทักษะสามารถประกาศได้ว่ามันสำรองชุดเครื่องมือเมื่อชุดเครื่องมือนั้นล้มเหลว ตัวอย่างเช่น เมื่อชุดเครื่องมือ git เกิดข้อผิดพลาด ทักษะที่มีขั้นตอนการกู้คืนแบบ manual rebase จะทำงาน

ทั้งหมดนี้เปลี่ยนทักษะจาก SOPs จุดเดียวให้เป็น วิธีการทำงานที่สามารถประกอบกันได้ — เป็นวิธีการทำงานทั้งหมดที่ผู้ใช้นำมาให้เอเจนต์ ซึ่งถูกบันทึกเป็นทรัพย์สินที่สามารถแชร์ได้


7. ไม่ใช่ความคิดใหม่ แต่ไม่ค่อยมีการนำไปใช้อย่างถูกต้อง

การผสมผสานหน่วยความจำเชิงข้อเท็จจริงและเชิงกระบวนการได้รับการพูดคุยในวงการ AI มานานแล้ว การวิศวกรรมมันจริง ๆ และทำให้มัน สามารถมองเห็น แก้ไข และนำกลับมาใช้ใหม่โดยผู้ใช้ คือสิ่งที่ Hermes อยู่ข้างหน้าค่อนข้างมาก — มันทำแผนที่ทุกชั้นไปยังไดเรกทอรี ฟิลด์ และคำสั่งที่ชัดเจน:

ความสามารถด้านความจำด้านทักษะ
ไดเรกทอรีหลัก~/.hermes/memories/~/.hermes/skills/
การเข้าถึงชั้นสั่งงานMEMORY.md, USER.mdSKILL.md โหลดเมื่อสถานการณ์ตรงกัน
คำสั่งจับadd / replace / remove (ขับเคลื่อนโดยเอเจนต์บวกการอนุมัติ /memory pending)/learn (ขับเคลื่อนโดยเอเจนต์บวกการอนุมัติ /skills pending)
การจัดระเบียบรายการบวกดัชนีข้อความเต็ม FTS5SOP เดียวบวก Bundles และ fallback_for_toolsets
อัตราการเปลี่ยนแปลงรายวันหลายเดือน

นำการจัดชั้นนั้นมาสู่บริบทของผลิตภัณฑ์ และคุณจะได้รูปทรงที่มีศักยภาพจริง:

  • ความทรงจำคือคลังข้อมูลที่ใช้ร่วมกันระหว่างคุณกับเอเจนต์.
  • ทักษะคือวิธีการทำงานที่คุณนำมาสู่เอเจนต์.

ด้วยกัน ทั้งสองทำให้เอเจนต์กลายเป็นพันธมิตรที่ เข้าใจคุณและรู้วิธีทำงาน — ไม่ใช่แชทบอทที่มีความทรงจำดี


8. LightVela: การเปลี่ยนทั้งความจำและทักษะให้กลายเป็นทรัพย์สินของผู้ใช้

Hermes ได้ทำให้การแบ่ง Memory / Skill สามารถใช้งานได้ในเชิงวิศวกรรมแล้ว แต่ยังคงเป็น Markdown สำหรับนักพัฒนา อยู่ LightVela มีแนวทางที่จะยกระดับชั้นนั้นจากฟีเจอร์ทางเทคนิคไปสู่ ทรัพย์สินของผู้ใช้:

  • ห้องสมุดทักษะส่วนบุคคล: ผู้ใช้สามารถรวบรวม แก้ไข และแชร์ทักษะ (เวิร์กโฟลว์) ของตนเองในแบบเดียวกับที่รวบรวมพรอมต์ และเชื่อมโยงพวกมันกับสถานการณ์การทริกเกอร์ รูปแบบการเขียนของคุณ, ขั้นตอนการตรวจสอบ (SOP), และมาตรฐานการแปลทั้งหมดสามารถกลายเป็นทักษะได้
  • ห้องสมุดความทรงจำส่วนบุคคล: ทุกความทรงจำที่เป็นข้อเท็จจริงที่เอเจนต์ถือเกี่ยวกับคุณสามารถมองเห็น แก้ไข และลบได้ โปร่งใส — ไม่จำเป็นต้องแก้ไข ~/.hermes/MEMORY.md
  • การใช้ซ้ำในระดับทีม: ทั้งทักษะและความทรงจำสามารถถูกบันทึกในขอบเขตของทีม ดังนั้นผู้เข้าร่วมใหม่จะได้รับความทรงจำและวิธีการแชร์ของทีมโดยอัตโนมัติ แทนที่จะต้องพึ่งพาการบอกต่อ
  • เส้นทางสั้นที่สุด: หากโมเดล "สองขา" น่าสนใจสำหรับคุณ แต่คุณไม่อยากจัดการกับ Ollama, SSH, systemd และ ~/.hermes/ การสำรองข้อมูล LightVela คือเส้นทางสั้นที่สุดไปสู่โมเดลนั้นในรูปแบบสินค้าที่สมบูรณ์

ในคำอื่น ๆ การฝึกเอเจนต์บน LightVela หมายถึง การสะสมสินทรัพย์สองอย่างในเวลาเดียวกัน: ความจำเกี่ยวกับคุณ และชุดทักษะของคุณ สองสินทรัพย์นี้คือสิ่งที่เป็นของคุณในระยะยาว — มันสำคัญกว่าตัวโมเดลเอง


ข้อสรุปสำคัญ

  • ความจำ ≠ ทักษะ ความจำชนิดแรกคือ ความจำเชิงปริยาย (ข้อเท็จจริงที่สามารถกล่าวได้) ส่วนชนิดที่สองคือ ความจำเชิงกระบวนการ (วิธีการที่ต้องทำตาม)
  • มีข้อจำกัดหลักสามประการที่ทำให้แยกออกจากกัน: สิ่งกระตุ้นต่างกัน / รูปแบบต่างกัน / อัตราการเปลี่ยนแปลงต่างกัน
  • เอเจนต์ที่มีความสมบูรณ์ต้องเดินด้วยขาทั้งสองข้าง — จำข้อเท็จจริงและวิธีการ
  • LightVela เปลี่ยนทั้งสองอย่างให้กลายเป็นทรัพย์สินของผู้ใช้ ดังนั้น “การฝึกเอเจนต์ของตัวเอง” จึงกลายเป็นประสบการณ์ผลิตภัณฑ์ที่คุณสามารถสร้างต่อได้ แทนที่จะเป็นเพียงสโลแกน

สิ่งที่ทำให้เราถึงจุดนี้

ในหมวดหมู่นี้ มีบทความห้าบทความที่ครอบคลุมเนื้อหา:

  1. เอเจนต์ Hermes แตกต่างจาก OpenClaw อย่างไร (การสะสม vs การเชื่อมโยง)
  2. เอเจนต์ Hermes จดจำคุณได้อย่างไร (สี่ชั้นความจำที่มีโครงสร้าง)
  3. ทำไมเอเจนต์ Hermes ต้องแบ่งความจำออกเป็นสองส่วน (USER.md vs MEMORY.md)
  4. ทำไมความจำมากขึ้นจึงไม่ดีกว่า: เอเจนต์ Hermes กรอง ดูแล และอัปเดตความจำระยะยาวอย่างไร (สี่กฎเหล็ก)
  5. ความจำไม่ใช่ทักษะ: ความแตกต่างระหว่างความจำเชิงข้อเท็จจริงและความจำเชิงกระบวนการ (การเดินบนสองขา)

บรรทัดเดียวปิดท้าย: คูน้ำสำหรับเจเนอเรชันถัดไปของเอเจนต์ไม่ได้อยู่ที่ขนาดของโมเดล แต่ขึ้นอยู่กับว่าเอเจนต์นั้น รู้จักคุณจริงๆ (ความจำ) และ มีวิธีการ (ทักษะ) — และว่าทั้งสองสิ่งนี้สามารถทำงานได้อย่างน่าเชื่อถือในระยะยาวหรือไม่ ขึ้นอยู่กับว่าเอเจนต์นั้น มีชีวิตอยู่ต่อไป นั่นคือเหตุผลที่ LightVela อยู่ที่นี่.

อัปเดตล่าสุดเมื่อ 2026-10-09

บนหน้านี้

สรุปทำไมแนวคิดทั้งสองนี้ถึงสับสนอยู่เสมอ1. วิทยาศาสตร์ความรู้ความเข้าใจได้ทำการแบ่งแยกนี้แล้ว: การแสดงออกเชิงประกาศกับเชิงกระบวนการ2. ความทรงจำ: สิ่งที่เอเจนต์สามารถกล่าวได้3. ทักษะ: สิ่งที่เอเจนต์สามารถทำได้4. "ทำไมไม่รวมมันเข้าด้วยกัน?" — ข้อจำกัดหลักสามข้อข้อจำกัด 1: ตัวกระตุ้นที่แตกต่างกันข้อจำกัด 2: รูปแบบที่แตกต่างกันข้อจำกัด 3: อัตราการเปลี่ยนแปลงที่แตกต่างกัน5. สถานการณ์จริง: /learn และหน่วยความจำทำงานร่วมกัน6. ชุดทักษะและ fallback_for_toolsets7. ไม่ใช่ความคิดใหม่ แต่ไม่ค่อยมีการนำไปใช้อย่างถูกต้อง8. LightVela: การเปลี่ยนทั้งความจำและทักษะให้กลายเป็นทรัพย์สินของผู้ใช้ข้อสรุปสำคัญสิ่งที่ทำให้เราถึงจุดนี้