Memory cho Agent dưới dạng File: Định dạng mới cho trí tuệ nhân tạo

Trong khi hầu hết các benchmark AI khởi đầu với blank context window, các agent thực tế cần có “kho nhớ” sẵn có để hoạt động hiệu quả. Bài viết đề xuất lưu trữ trí nhớ của agent dưới dạng các tệp tin Markdown, biến “memory” thành dữ liệu có thể đọc và truy vấn ngay.

Ba kiểu hệ thống nhớ hiện nay thường gặp:

  • Liên kết chặt chẽ với một nền tảng cụ thể, chỉ lưu thông tin về người dùng.
  • Kiến trúc phức tạp yêu cầu pgvector, Neo4j và một LLM riêng để quyết định gì đáng nhớ.
  • Kiểu “High Modernist” dùng đồ thị và logic, nhưng lại tách rời ngữ cảnh, khiến thông tin trở nên vô nghĩa.

Định dạng memoryfield được giới thiệu dưới dạng một thư mục zip chứa các file *.md và một cơ sở dữ liệu SQLite cho các embedding. Mỗi ghi chú có tiêu đề, thời gian tạo, UUID và nội dung viết trực tiếp bằng Markdown – ví dụ “Carbon Fibre Woks”. Nhờ vậy, agent không cần “chunk”, “enrich” hay “double‑summarise” tài liệu; nó ghi nhớ ngay trong ngôn ngữ mình hiểu nhất.

Hạn chế duy nhất là mỗi trang phải đủ ngắn để nhúng vào vector, khoảng 8 KB (≈ 2000 token). Điều này thực tế giúp giảm chi phí tính toán và tránh “bloat” dữ liệu.

Việc chuyển trí nhớ agent thành các tệp tin có cấu trúc rõ ràng sẽ giúp các nhà phát triển Việt Nam dễ dàng tích hợp, chia sẻ và mở rộng hệ thống nhớ mà không phụ thuộc vào giải pháp “black‑box” phức tạp. Ngoài ra, việc version control các file .md trên Git giúp theo dõi lịch sử và đồng bộ giữa các thành viên.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account