# Lớp 4 — Taxonomy kỹ thuật detector

Cập nhật 11/10/2026. Mục tiêu: tự giải thích **một detector quan sát gì, tính gì, học gì và chấm điểm thế nào**, rồi đọc một kỹ thuật mới bằng cơ chế và bằng chứng. Bộ này bổ sung chiều sâu cho [chương 04](../04-KY-THUAT-DETECTOR.md); không chọn đề tài hoặc chạy thí nghiệm mới.

## Tiền đề và cách học

Lớp 1 cung cấp tín hiệu, tensors, xác suất/loss/gradient. Lớp 2 cung cấp task, fake process, source×label confound. Lớp 3 cung cấp representation, JEPA target/predictor/EMA và provenance. Có thể quay lại link tiền đề trong từng bài khi cần. Không lặp toàn bộ SSL hoặc toàn bộ EER/DCF ở đây; đánh giá sâu thuộc lớp 5.

Học từng micro-lesson trong chat: giải thích một cơ chế, giải một ví dụ nhỏ, trả lời một câu **vì sao**, rồi nhận feedback. Chưa chắc thì thay số/đổi giả định và thử lại. Bài tập có đáp án giải thích để tự kiểm sau khi đã suy nghĩ; không dùng việc mở đáp án làm bằng chứng đã hiểu.

Trong công thức detector, y=1 là bona fide (B), y=0 là spoof (S), thứ tự hai output logits là (z_S,z_B), score d=z_B−z_S có hướng high=B. Toy tự biên soạn được đánh dấu; paper report, source đọc và runtime xác minh là các mức bằng chứng riêng.

## Lộ trình chín bài

| Bài | Câu hỏi trung tâm | Ví dụ/phép tự kiểm |
|---|---|---|
| [1. Detector như một hệ thống](01-DETECTOR-NHU-MOT-HE-THONG.md) | Forward khác update thế nào? | Trace waveform → grid → score; crop collision |
| [2. Front-end, baseline và multi-view](02-FRONTEND-BASELINE-MULTIVIEW.md) | LFCC-GMM, RawNet2, AASIST thực sự tính gì? | Gaussian likelihood toy, node axes, paper/config khác nhau |
| [3. Adaptation và gradient/PEFT](03-ADAPTATION-GRADIENT-PEFT.md) | Parameters/state nào đổi và gradient đi đâu? | BN buffer, frozen block, LoRA matrices/init/merge |
| [4. Layer fusion và pooling](04-LAYER-FUSION-POOLING.md) | Gom positions/layers giữ hoặc bỏ gì? | Masked mean/std, weighted variance, thứ tự và 2D axes |
| [5. Loss, sampling và optimization](05-LOSS-SAMPLING-OPTIMIZATION.md) | Weight nào tác động contribution qua reduction nào? | Hard/soft CE/BCE, singleton, effective prior, focal gradient |
| [6. Augmentation và evidence](06-AUGMENTATION-LABEL-EVIDENCE.md) | Biến đổi giữ label và giữ cue có giống nhau không? | Partial crop, mixup, filter/crop order, mask union |
| [7. Data và domain robustness](07-DATA-DOMAIN-ROBUSTNESS.md) | Đổi support, exposure hoặc objective nào? | Source shortcut, DOSS domain weights, DANN/Group DRO |
| [8. Inference và scoring](08-INFERENCE-SCORING-FUSION.md) | Score/coverage/aggregation tương ứng task nào? | Two logits, fusion ranking, tail window, latency |
| [9. Diagnostics và recipe paper](09-DIAGNOSTICS-RECIPE-PAPER.md) | Phép đo trả lời được claim nào? | Probe vs reliance, hai kiểu ablation, tích hợp recipe |

Không xem taxonomy là bảng xếp hạng “handcrafted < SSL”, “frozen < full” hoặc “mean < attention”. Mỗi lựa chọn đổi assumptions, cost và failure modes; chỉ so chất lượng trong protocol/budget được xác định.

## Các hồ sơ hỗ trợ

- [Sổ đăng ký nguồn](10-SO-DANG-KY-NGUON.md): version, mục method đã đọc, nguồn primary và giới hạn suy luận.
- [Báo cáo enrich/QA](11-BAO-CAO-ENRICH.md): phần còn mỏng trước đây, cách đã bổ sung và phạm vi kiểm.
- [Tiến độ học và bàn giao](12-TIEN-DO-HOC-VA-BAN-GIAO.md): tách trạng thái học liệu khỏi trạng thái người học.
- [Root kiểm paper/source](research/root-source-review.md), [dossier kiến trúc](research/architecture-sources.md), [dossier training](research/training-sources.md): bằng chứng và những chỗ chưa audit.
- [Script toy/QA](scripts/kiem-tra-hoc-lieu.py), [kết quả kiểm](research/validation.json): tính toán minh họa và local links/hash; không training model.

## Điều kiện tự kiểm cuối lớp

Chọn một detector và viết sáu dòng ở bài 9. Phải vẽ riêng forward/update, tính một pooling/loss/score toy, chỉ rõ một assumption có thể hỏng, và đưa ra phép kiểm phân biệt hai giải thích. Cần giải thích được vì sao frozen không đồng nghĩa linear probe, reweight không tạo missing support, và probe/attention không tự chứng minh causal reliance.

**Trạng thái:** học liệu đã biên soạn; người học bắt đầu từ micro-lesson M1 trong chat. Chưa có câu trả lời được chấm, chưa hoàn tất lớp 4. Không chỉnh bảng điều phối chung thay cho chat điều phối.
