Công cụ local dùng LLM riêng để làm gọn đầu ra dài dòng của Claude 5

Vomit là một công cụ mới được giới thiệu trên Hacker News, có nhiệm vụ xử lý đầu ra dài dòng, lộn xộn của Claude 5 bằng cách chuyển nội dung qua một LLM chạy local. Theo tác giả, toàn bộ quy trình diễn ra trên máy người dùng, không có telemetry và không phụ thuộc vào dịch vụ bên ngoài.

Công cụ được viết bằng Go và có thể cài trực tiếp vào GOPATH bằng lệnh go install github.com/zachahn/vomit@latest. Sau khi cài đặt, người dùng chạy Vomit init để thiết lập thông tin kết nối tới LLM, rồi dùng Vomit scrub -claude để xem hướng dẫn thay thế đầu ra của Claude thông qua hooks.

Ngoài chế độ can thiệp vào luồng đầu ra, Vomit còn cung cấp một chế độ không xâm lấn, cho phép chạy công cụ song song nếu người dùng không muốn thay đổi trực tiếp cách Claude hoạt động. Với những ai chưa có LLM local, tác giả đề xuất dùng Llama.app và tải model GPT-OSS 20B, sau đó chạy lại lệnh khởi tạo để kết nối.

Mục tiêu của dự án là dùng một model riêng để rút gọn phần nội dung dư thừa, qua đó giúp người dùng tiết kiệm token và nhận câu trả lời dễ đọc hơn. Tuy nhiên, hiệu quả thực tế sẽ phụ thuộc vào model local, prompt xử lý và mức độ chính xác cần giữ lại sau khi biên tập.

Với cộng đồng AI Việt Nam, Vomit là một ví dụ đáng chú ý về cách ghép nhiều LLM thành quy trình hậu xử lý riêng tư. Công cụ cũng có thể gợi mở các ứng dụng local tương tự cho việc tóm tắt, chuẩn hóa hoặc làm sạch đầu ra từ coding agent.

Nguồn: Hacker News — Biên dịch & tổng hợp: danhbaai.com

Danh Bạ AI
Logo
Register New Account