Cuộc chiến "bộ nhớ" AI agent: MRAgent tiết kiệm token gấp 27 lần so với LangMem
Nhìn rộng hơn: cuộc đua AI agent đang dần chuyển trọng tâm, từ câu hỏi "mô hình nào thông minh hơn" sang câu hỏi ít được nói tới nhưng quyết định hóa đơn vận hành nhiều hơn, đó là "ai quản lý bộ nhớ rẻ hơn". 118.000 so với 3.260.000, đó là số token mà hai framework bộ nhớ AI agent tiêu tốn để trả lời cùng một câu hỏi phức tạp trong bài kiểm tra LongMemEval. MRAgent, framework mới từ nhóm nghiên cứu Đại học Quốc gia Singapore (NUS), chỉ dùng 118.000 token, trong khi LangMem, một framework phổ biến, đốt tới 3,26 triệu token, gấp khoảng 27 lần. Đặt trong bối cảnh chi phí vận hành: cách một AI agent "nhớ" thông tin cũ đang trở thành yếu tố quyết định hóa đơn API hàng tháng, không kém gì việc chọn mô hình AI nào.