การรายงานการแจ้งเตือน
Chute ตรวจสอบคุณภาพการเชื่อมต่อ ความพร้อมใช้งานของพร็อกซี รูปแบบทราฟฟิก และความสมบูรณ์ของการกำหนดค่า เมื่อตรวจพบความผิดปกติที่สำคัญ แอป Chute อาจแสดงการแจ้งเตือนของระบบเพื่อแจ้งเตือนคุณ
การหมดเวลาหรือโหนดที่ไม่สามารถเข้าถึงได้เพียงครั้งเดียวจะไม่กระตุ้นการแจ้งเตือน — เฉพาะรูปแบบที่ต่อเนื่องหรือขนาดใหญ่เท่านั้นที่จะกระตุ้น
ประเภทเหตุการณ์
| เหตุการณ์ | ความหมาย |
|---|---|
| Mass Connection Failure | การเชื่อมต่อจำนวนมากกำลังล้มเหลวในลักษณะเดียวกัน (เช่น ทั้งหมดหมดเวลา) |
| Service Unavailable | โหนดพร็อกซีที่ระบุยังคงปิดการเชื่อมต่อโดยไม่ส่งคืนข้อมูลใดๆ — โหนดอาจไม่ทำงาน |
| Traffic Surge | ทราฟฟิกแบนด์วิดธ์สูงต่อเนื่อง (อัปโหลดหรือดาวน์โหลด) สูงกว่าค่าเฉลี่ยล่าสุดอย่างมีนัยสำคัญ การพุ่งขึ้นทันทีจะถูกละเว้น |
| Config Auto-Update Failed | การอัปเดตอัตโนมัติของการกำหนดค่าแบบจัดการล้มเหลวซ้ำๆ (ข้อผิดพลาดในการดาวน์โหลดหรือแยกวิเคราะห์) |
| Policy Group Switch | กลุ่มนโยบาย (Fallback / URL Test / Load Balance / SSID) สลับไปยังพร็อกซีอื่นโดยอัตโนมัติ หากกลุ่มแกว่งไปมาอย่างรวดเร็ว การแจ้งเตือน "flapping" เดียวจะแสดงแทนการแจ้งเตือนต่อการสลับ |
| Egress IP Change | ที่อยู่ IP ขาออกสาธารณะที่สังเกตได้สำหรับการเชื่อมต่อมีการเปลี่ยนแปลง |
| Tailscale DERP Home Change | เอนจิน Tailscale สลับไปยังภูมิภาครีเลย์ home DERP อื่น |
| Tailscale Diagnostics | เหตุการณ์ Tailscale เช่น ปัญหา exit-node หรือความล้มเหลวของ auth-key |
เกณฑ์
ระบบการรายงานถูกเปิดใช้งานโดยค่าเริ่มต้น เกณฑ์เป็นแบบในตัวและไม่สามารถกำหนดค่าผ่านไฟล์การกำหนดค่าได้ ค่าอ้างอิงคือ:
| เกณฑ์ | ค่า | หน่วย | คำอธิบาย |
|---|---|---|---|
| เกณฑ์ความล้มเหลวจำนวนมาก | 20 | จำนวน | ความล้มเหลวขั้นต่ำในหน้าต่างเพื่อกระตุ้นการแจ้งเตือน Mass Connection Failure |
| อัตราความล้มเหลวจำนวนมาก | 0.3 | อัตราส่วน (0–1) | อัตราความล้มเหลวขั้นต่ำ (ความล้มเหลว / ทั้งหมด) สำหรับการเชื่อมต่อ TCP |
| หน้าต่างความล้มเหลวจำนวนมาก | 60 | วินาที | หน้าต่างเวลาสำหรับการนับความล้มเหลวจำนวนมาก |
| จำนวน Service Unavailable | 3 | จำนวน | ความล้มเหลวบนโหนดเดียวก่อนกระตุ้นการแจ้งเตือน Service Unavailable |
| หน้าต่าง Service Unavailable | 300 | วินาที | หน้าต่างเวลาสำหรับการนับความล้มเหลวของโหนด |
| ตัวคูณการพุ่งขึ้นของทราฟฟิก | 5.0 | อัตราส่วน | อัตราปัจจุบันต้องเกินค่าเฉลี่ย 5 นาทีด้วยตัวคูณนี้ |
| ระยะเวลาการพุ่งขึ้นของทราฟฟิก | 60 | วินาที | ระยะเวลาที่การพุ่งขึ้นต้องต่อเนื่องก่อนแจ้งเตือน |
| หน้าต่าง flap ของนโยบาย | 60 | วินาที | หน้าต่างเวลาสำหรับการตรวจจับการแกว่งของกลุ่มนโยบาย |
| เกณฑ์ flap ของนโยบาย | 3 | จำนวน | จำนวนการสลับภายในหน้าต่างที่กระตุ้นการแจ้งเตือน flapping |
| ช่วง cooldown | 120 | วินาที | ช่วงขั้นต่ำระหว่างการแจ้งเตือนต่อเนื่องประเภทเดียวกัน |
| จำนวนความล้มเหลวของการกำหนดค่า | 2 | จำนวน | ความล้มเหลวในการอัปเดตติดต่อกัน (รีเซ็ตเมื่อสำเร็จครั้งใดก็ตาม) ก่อนกระตุ้นการแจ้งเตือน Config Update Failure — ไม่มีหน้าต่างเวลา |
วิธีการควบคุมการแจ้งเตือน
เพื่อหลีกเลี่ยงสแปมการแจ้งเตือน Chute ใช้มาตรการป้องกันหลายอย่าง:
- Cooldown: การแจ้งเตือนประเภทเดียวกันจะไม่ยิงมากกว่าหนึ่งครั้งต่อช่วง cooldown (120 วินาที)
- การระงับจำนวนมาก: เมื่อการแจ้งเตือน Mass Connection Failure ยิง การแจ้งเตือน Service Unavailable แต่ละรายการจะถูกระงับ — การแจ้งเตือนจำนวนมากครอบคลุมปัญหาอยู่แล้ว
- Anti-flap: หากกลุ่มนโยบายสลับไปมาอย่างรวดเร็ว (3 ครั้งขึ้นไปภายใน 60 วินาที) การแจ้งเตือน "flapping" เดียวจะแสดงแทนการแจ้งเตือนต่อการสลับ
- ช่วงผ่อนผัน: การแจ้งเตือน Service Unavailable ถูกระงับเป็นเวลา 60 วินาทีหลังจากเครื่องยนต์เริ่มหรือโหลดการกำหนดค่าใหม่ เพื่อหลีกเลี่ยงการแจ้งเตือนเท็จจากการเปลี่ยนการเชื่อมต่อตอนเริ่มต้น
- รีเซ็ตเมื่อเปลี่ยนเครือข่าย: ตัวนับภายในทั้งหมดถูกรีเซ็ตเมื่อเครือข่ายเปลี่ยน (Wi-Fi ↔ เซลลูลาร์) หรือการกำหนดค่าถูกโหลดใหม่ ป้องกันข้อมูลเก่าจากการกระตุ้นการแจ้งเตือนเท็จ