ajaudio / studyAUDIO-JEPA · RESEARCH NOTES
7 phút đọc · Toàn văn
Mục lục bài · 5 mục

Sổ đăng ký nguồn — Lớp 5#

Ngày đối chiếu: 11/10/2026. Đây là ledger của học liệu, không chứng nhận tái lập mô hình. “Đọc mục liên quan” nghĩa là đã kiểm đoạn phương pháp/công thức được dùng; không có nghĩa đã đọc toàn paper. R=root đọc trực tiếp, M=agent metrics đọc, E=agent evidence đọc. Root đã phản biện và giới hạn các claims trước khi đưa vào bài.

Hồ sơ metrics · Hồ sơ evidence · Root review.

Nguồn tại workspace#

NguồnVị trí đã kiểmMức đọc và cách dùng
PDF đã nộp SOICT 4308§3.1 p4; §4.1 p6; phương pháp/kết quả p6–10; §8 p12R đọc các đoạn liên quan, xem render p9–10 và hai bảng. Không tuyên bố đọc lại toàn PDF ở lượt lớp 5. Reported pipeline/parameter counts/EER/seed/development history; không rerun.
Chương 06Toàn chương; đặc biệt Tables 2/4, recipe và historical notesR đọc để giữ scope và liên kết evidence; các ghi chép v38–v41 vẫn là history, không tự thành verified runtime.
Bản đồ 00, chương 05, literature 07, tự kiểm 08Map và phần liên quanR dùng để phân tích lỗ hổng và giữ ranh giới lớp 5.
Start/report/progress lớp 1–4; tiền đề xác suất, protocol, SSL/scoringLinks cụ thể trong mỗi bàiR đọc phần tiền đề cần nối; không đánh dấu người học đã đạt lớp 1–4.
Scorer snapshotASVspoof 5 commit dưới đâyR lưu file văn bản, SHA-256 được QA ghi. Chỉ gọi ba hàm trên toy; không checkpoint/corpus.

Metrics, costs và tasks#

Nguồn primaryVersion/vị tríĐã đọcClaim dùng và giới hạn
Fawcett, ROC analysisPRL 2006, §§5–7, Fig 6R mục ties/AUC; M toàn bài/mục liên quanNhóm tie, finite pair credit và ROC area. Không suy AUC tốt ở mọi low-FPR region.
Davis–Goadrich, ROC–PR relationshipICML 2006, §§3–4R PDF/phần ROC–PRPR interpolation cần giữ count/prevalence; nối thẳng PR là một area convention, không identity với AP.
scikit-learn AP docs, ranking codeDocs 1.9.1; commit afe5bcd80ce17fd8ca88c33beb17534bd36423bcR AP definition; M docs/code functionsAP không nội suy; distinct thresholds/ties. Docs stable có thể đổi; code commit đã pin. Không khẳng định toàn environment dự án chạy version này.
Saito–RehmsmeierPLOS ONE 2015, theoretical backgroundM HTML/mục liên quanPR và prevalence; superiority framing có bối cảnh mất cân bằng, không luật mọi task. Công thức prevalence trong bài được tự suy từ Bayes/counts.
Martin et al., DETEurospeech 1997, p1 và special pointsR mục liên quanNormal-deviate axes, endpoint infinities. Plot toy clip 1%/99% chỉ để vẽ, không đổi metric; curve thẳng không được xem như proof distribution.
ASVspoof 5 Phase 2 Evaluation Planv0.6, 28/06/2024, §§4.1–4.3, Appendices 11.1–11.2R sections/appendices; M plan 14 p; E phần protocolTrack 1 minDCF, supplementary EER/actDCF/Cllr; Track 2 min aDCF, optional tandem metrics. Priors/costs/score convention thuộc phiên bản này.
Official calculate_modules.pyCommit fe23d3053a0889b305d98c9e4cadf418c213d972R/M thân DET/EER/actDCF/Cllr/tDCF và legacyStable per-trial tie handling, nearest-average EER, threshold predicate khác rank-step label; modern/legacy tDCF khác. Không coi toy tie-aware scorer là official identical implementation.
BOSARIS ToolkitarXiv v1, §§2.2–2.7, PAV 3.2R Bayes/DCF/proper cost/calibration sections; M toàn bàiLLR calibration và empirical optimal mapping. ROCCH-EER của toolkit khác adjacent-point EER interpolation dùng trong toy; không đánh đồng.
Brümmer–du Preez, PAVv1, §2, §4.5, §5/Theorem 12R method/theorems liên quan; M toàn bàiTối ưu regular binary proper scoring rules trên sample với monotonicity/weights. Không bảo đảm calibration unseen domain.
Guo et al.ICML 2017, §4.2 temperature scalingR method/Eq 9 ở p6; identity trong bài được tự suyTemperature posterior calibration không tự chuyển weighted-CE output thành deployment LLR. Không đọc lại toàn paper ở lượt này.
Kinnunen et al., t-DCFv1, §§2–5, đặc biệt §5 joint probabilitiesR method; M plan/code liên quanProduct rates cần conditional independence. Bản 2018 có costs khác; toy chung target miss cost khớp dạng rút gọn modern scorer dưới assumptions nêu rõ.
PartialSpoofv2, dataset/labels §§2–3R sections về construction/segment labelsUtterance và segment labels; không đọc lại toàn paper ở lớp 5, không gán multi-resolution claims của bản sau cho bản này.
Range-Based EERv1, §§2–4, Eqs 1–7R §§2–3 overlaps/denominators; M toàn bàiPoint/frame vs duration/range và resolution; không cung cấp collar phổ quát.

Thiết kế và uncertainty#

Nguồn primaryVersion/vị tríĐã đọcClaim dùng và giới hạn
Cawley–TalbotJMLR 2010, §§4.1,5R mục bias–variance/selectionNoisy criterion có thể bị overfit. Toy winning error 9% là phép liệt kê riêng, không số liệu bài gốc.
Kapoor–NarayananarXiv 2022 v1, §2.4; journal 2023 khác versionR taxonomy; E taxonomy/recommendationsSeparation, nonindependence và mismatch test population. Không có proof exact overlap của corpus dự án.
Bouthillier et al.v1, §§2–3, AppendixC.2R sections và pairing caveat; E benchmark recommendationsData/init/augmentation/search sources of variance; same seed number chưa shared experimental path.
Field–Welsh, PDF đã mởJRSS B2007, §§2–3,5E method/consistency/conclusions; R đọc dossier, PDF endpoint root không mở đượcCluster bootstrap theo sampling model; không cite theorem như blanket guarantee cho EER với ít groups.
Owen–Ecklesv3, crossed models/product weighting §§2–4, discussion§9R sections và scope; E methodMean-variance theory cho crossed effects. Seed×group EER procedure là design proposal, coverage chưa chứng minh.
Shalizi bootstrap lectureAuthor lecture 2018, procedure/block bootstrapR phần liên quanEmpirical approximation, dependence và estimator assumptions; không nominal-coverage guarantee cho toy 2 groups.
NIST mean CIHandbook t intervalR trang formulat-CI cho mean dưới assumptions; ba seed không tự thỏa assumptions, không population/domain interval.
Fagerland et al.BMC 2013, Methods exact conditional và DiscussionR/E mục liên quanMcNemar matched binary pairs; exact conservative, methods có tradeoffs. Không test EER và không sửa cluster dependence.
Lakens2017, TOST/equivalence bounds/dependent meansR/E phương phápPrespecified margin; corresponding 90%CI ở alpha 0.05 dưới phù hợp t model. Không cắm mọi metric vào t-test.
Holm1979, §2 scheme/Theorem 1R/E scheme/union-bound argumentFWER với valid p-values; không cần independence. Không cứu test feedback làm base p invalid.

Cơ chế, provenance và cost#

Nguồn primaryVersion/vị tríĐã đọcClaim dùng và giới hạn
Hewitt–LiangEMNLP 2019, §§2–3 control/selectivityR sections; E intro/control framingProbe capacity/decodability cần control. Audio reliance counterexample là toy tự biên soạn, không empirical finding của paper NLP.
Pineau et al.JMLR 2021, §5/checklist appendixR checklist/reporting và discussion; E reproducibility programTransparency về metrics/error bars/code/data. Không bảo đảm correctness hay acceptance.
PyTorch Benchmark tutorialWeb docs 2.14.0+cu 130, CPU/CUDA timing/warm-upR mục thực thi timingThread count/warm-up/sync matters. Chưa đo detector, chưa xác nhận projecttorch version.
MLPerf Inference Rulesmaster, ngày 11/10/2026, chưa pin commitE scenario/system boundary/timing sectionsVí dụ quality gắn workload/cost; chỉ framing, không compliance claim.

DeLong 1988 chỉ author-hosted summary, Dietterich 1998 chỉ abstract tin cậy vì OCR lỗi, Geirhos 2020 chỉ abstract/perspective. Chúng được định vị trong dossier evidence; không dùng công thức/theorem chưa đọc. Journal Cllr 2006 chỉ publisher preview: bài 3 dùng formula plan và PAV/BOSARIS, không gán decomposition provenance cho toàn văn chưa tiếp cận.

Các bằng chứng còn thiếu#

Không có raw per-ID scores của paper được audit ở lượt này, không tái chạy checkpoint/baseline, không audit toàn lineage/split, không latency/memory measurement trên model. Vì vậy không mới tuyên bố significance, calibration ngoài miền, objective causality, leakage cụ thể, detector localization hoặc cost frontier thật.

Script và machine QA chỉ kiểm toys, tài liệu và ranh giới file. Source URL stable/master có thể trôi; hai code commits và snapshot local giúp khóa phần implementation được dùng.

↓ Bản Markdown nguyên gốcGiữ nguyên nội dung · Công thức, bảng và nguồn đầy đủ.Các chat bàn giao được mở trong Codex.

Gõ từ khóa để tìm bài học và đoạn liên quan.