Skip to main content
Tính năng beta. Tính năng kiểm tra được phát hành dưới dạng beta trong khi chúng tôi thu thập phản hồi ban đầu. Danh mục phát hiện và định dạng báo cáo có thể thay đổi trước bản phát hành ổn định tiếp theo. Vui lòng mở một issue nếu có gì không ổn.
Tính năng kiểm tra sẽ phát lại các bản ghi lịch sử agent-CLI trước đó của bạn thông qua engine chính sách của failproofai và tạo ra một báo cáo hình ảnh có thể chia sẻ trên trang /audit của bảng điều khiển — kiểu mẫu agent của bạn, điểm từ 0–100 và chính xác những chính sách nào sẽ bắt được cái gì.

Chạy nó

Ba cách để bắt đầu — tất cả đều dẫn tới cùng một báo cáo /audit.

Không cần cài đặt

npx -y failproofai audit tải failproofai, chạy quét, và mở bảng điều khiển cho bạn — không cần cài đặt gì trước.

Từ CLI

failproofai audit chạy quét trong terminal của bạn, rồi tự động mở localhost:8020/audit khi hoàn thành.

Từ bảng điều khiển

Chạy failproofai và nhấp vào Audit trong thanh điều hướng (giữa Policies và Projects), hoặc mở /audit trực tiếp.
Chạy failproofai audit -h (hoặc --help) để xem cách sử dụng. Tính năng kiểm tra chạy hoàn toàn ngoại tuyến — không cần tài khoản hoặc mạng — và bảng điều khiển tiếp tục phục vụ cho đến khi bạn dừng nó bằng Ctrl+C.
Bảng điều khiển quét các bản ghi lịch sử agent CLI trước đó trên máy này (Claude Code, Codex, Copilot, Cursor, OpenCode, Pi, Gemini) và báo cáo xem agent đã làm những việc mà failproofai được xây dựng để dừng bao nhiêu lần — kiểm tra biến môi trường, force push, tiền tố cd <cwd> dư thừa, vòng lặp sleep-polling, đọc lại tệp vừa sửa, và nhiều hơn nữa. Đối với mỗi bản ghi lịch sử, mọi sự kiện sử dụng công cụ được phát lại thông qua 39 chính sách tích hợp 8 bộ phát hiện chỉ dùng để kiểm tra bắt các mẫu chưa được bao phủ bởi các chính sách thời gian chạy. Số lượng được tổng hợp cho mỗi chính sách / bộ phát hiện trên tất cả các phiên.

Những gì bạn nhận được

Trang /audit là một áp phích trên toàn màn hình, có thể chia sẻ được, theo sau là bốn phần phía dưới:
  1. Áp phích — danh tính của agent của bạn một cách sơ lược: kiểu mẫu của nó (một trong 8 — optimist, cowboy, explorer, goldfish, paranoid architect, precision builder, hammer, ghost), các từ khóa tính cách, mức độ hiếm có của kiểu mẫu đó, và điểm từ 0–100 với một dải cấp bậc (S xuống bottom tier). Được xây dựng để chia sẻ — đăng trên X hoặc LinkedIn, hoặc tải xuống dưới dạng PNG.
  2. // strengths — những gì agent của bạn đã làm tốt, dưới dạng các số thực từ quét (ví dụ: clean-tool-call %, 0 push-to-main attempts), chỉ được hiển thị khi chính sách liên quan có một hồ sơ sạch sẽ.
  3. // quirks — những gì lọt qua: một bảng xếp hạng các hành vi mà failproofai sẽ bắt được — khi nào nó lần cuối xảy ra, cái gì lọt qua (và chính sách tích hợp sẽ chặn nó), mức độ nghiêm trọng của nó, và nó được nhìn thấy bao nhiêu lần (new / recurring / N× seen).
  4. // how to improve — danh sách sửa chữa được quy định: một hàng cho mỗi chính sách với failproofai policy add <slug> sao chép dán, cộng với nút install all cho phép mọi khuyến nghị cùng một lúc và hiển thị projected score của bạn nếu bạn làm.
  5. // come back better — xây dựng thói quen: đặt reminder tái kiểm tra qua email (3d / 7d / 14d / 30d) hoặc tái kiểm tra ngay bây giờ, và mời một bạn chạy kiểm tra của riêng họ (gửi từ failproof.ai, Cc cho bạn). Reminders và invites yêu cầu đăng nhập — xem failproofai auth.

Bộ phát hiện chỉ dùng để kiểm tra

Những bộ này phát hiện các mẫu hành vi “ngu ngốc” không (chưa) được thực thi thời gian thực. Chúng chạy chỉ trong quá trình kiểm tra và không bao giờ chặn một lệnh gọi công cụ trực tiếp.

Bộ nhớ đệm

  • Bộ nhớ đệm mỗi bản ghi lịch sử tại ~/.failproofai/cache/audit/<sha1>.json được khóa bằng (mtime, size, engineVersion, detectorVersion) — tự động vô hiệu hóa khi bản ghi lịch sử hoặc mã chính sách/phát hiện thay đổi. Mỗi mục cũng lưu trữ dấu thời gian cachedAt làm siêu dữ liệu TTL (không phải một phần của khóa bộ nhớ đệm); các mục cũ hơn 7 ngày bị từ chối khi đọc để các kết quả dài hạn không vượt quá ý định phát hiện khác nhau.
  • Bộ nhớ đệm toàn bộ kết quả tại ~/.failproofai/audit-dashboard.json (chế độ 0600). Cho phép bảng điều khiển hiển thị ngay lập tức khi điều hướng mà không cần chạy lại. Cũng bị từ chối khi đọc quá TTL 7 ngày/audit sau đó rơi vào trạng thái trống của nó và nhắc nhở chạy làm mới. Nhấp vào [ re-audit now ] gần dưới cùng của báo cáo để làm mới — re-audit gửi noCache: true, vì vậy nó bỏ qua bộ nhớ đệm mỗi bản ghi lịch sử và quét lại mọi bản ghi lịch sử thay vì trả lại kết quả được lưu trong bộ nhớ đệm; lần chạy phát trực tiếp tiến độ thông qua một dải dính ở đầu và hoán đổi kết quả tại chỗ khi thành công (không tải lại trang; một re-audit không thành công sẽ giữ lại báo cáo trước đó).

Ghi chú

  • Không có đột biến. Tính năng kiểm tra phát lại ở chế độ chỉ đọc. warn-repeated-tool-calls bị bỏ qua vì sidecar mỗi phiên của nó sẽ bị sửa đổi.
  • Chính sách quy trình bị bỏ qua. require-*-before-stop chính sách chỉ kích hoạt trên Stop sự kiện và execSync so với trạng thái git trực tiếp — chúng không có ý nghĩa “điều gì sẽ xảy ra vào năm 2025” giải thích, vì vậy chúng không xuất hiện trong số đếm kiểm tra.
  • Chính sách tùy chỉnh bị bỏ qua. Các hook tùy chỉnh được cung cấp bởi người dùng không được phát lại (chúng có thể đã thay đổi kể từ phiên gốc).