# Điều phối quá trình ôn tập Audio-JEPA

Cập nhật: 12/10/2026. Chat điều phối: **Review Audio JEPA research**, ID `01a126cc-dabe-78a3-bed6-028233318092`.

Mục tiêu là học sâu nền tảng và các taxonomy để tự xây dựng một nghiên cứu tốt hơn. Mỗi lớp có một chat riêng cho hỏi đáp; tiến hành lần lượt. Chưa chọn hướng nghiên cứu, lập ngân sách tính toán hay chạy thí nghiệm mới.

Đã tạo đủ sáu chat và hoàn tất học liệu cả sáu lớp theo báo cáo bàn giao: 55 bài học chính cùng các bản đồ, hồ sơ nguồn và tài liệu bổ trợ. Tiến độ hiểu bài của người học tiếp tục được theo dõi riêng trong từng chat. Bản HTML ôn tập được xây dựng từ toàn bộ Markdown theo yêu cầu ngày 12/10; trạng thái biên soạn không đồng nghĩa người học đã hoàn tất.

## Phân công model

- **GPT-6-luna, reasoning max:** đọc phần được giao, tìm và mở nguồn primary, ghi bằng chứng, đề xuất ví dụ và nội dung thiếu. Mỗi subagent có file nghiên cứu riêng.
- **GPT-6.1-sol, reasoning xhigh:** chủ trì từng chat lớp kiến thức, kiểm chứng các kết luận quan trọng, tổng hợp, sửa học liệu và dạy qua hỏi đáp.
- Cách phân công này là lựa chọn cho công việc hiện tại. Chất lượng phải được đánh giá qua nguồn, tính đúng của công thức và khả năng giải thích; tên model không thay thế kiểm chứng. Xem [hướng dẫn chọn model của OpenAI](https://learn.chatgpt.com/docs/models#recommended-models).

## Sáu lớp và trạng thái

| Lớp | Bản đồ hiện tại | Enrich học liệu | Học qua hỏi đáp | Chat riêng |
|---|---|---|---|---|
| 1 — Toán, âm thanh và deep learning | [01-NEN-TANG.md](01-NEN-TANG.md) | Hoàn tất tám bài; [báo cáo bàn giao](lop-01-nen-tang/10-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a126f3-7c56-7573-a10b-7993f514dff7` |
| 2 — Deepfake và bài toán | [02-DEEPFAKE-VA-BAI-TOAN.md](02-DEEPFAKE-VA-BAI-TOAN.md) | Hoàn tất tám bài và hộ chiếu dataset; [báo cáo bàn giao](lop-02-deepfake-bai-toan/10-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a1272b-32cd-7d10-8d04-3d419c17c9f7` |
| 3 — SSL và JEPA | [03-SSL-VA-JEPA.md](03-SSL-VA-JEPA.md) | Hoàn tất mười bài và hồ sơ recipe; [báo cáo bàn giao](lop-03-ssl-jepa/12-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a12750-653e-7b13-be9d-ea6e9e39355d` |
| 4 — Kỹ thuật detector | [04-KY-THUAT-DETECTOR.md](04-KY-THUAT-DETECTOR.md) | Hoàn tất chín bài; [báo cáo bàn giao](lop-04-ky-thuat-detector/11-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a12951-d3d2-7a02-8c4b-080df6836623` |
| 5 — Đánh giá và thực nghiệm | [05-DANH-GIA-VA-THUC-NGHIEM.md](05-DANH-GIA-VA-THUC-NGHIEM.md) | Hoàn tất mười bài; [báo cáo bàn giao](lop-05-danh-gia-thuc-nghiem/12-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a129b7-cb41-7203-867e-969e50706bd3` |
| 6 — Giải phẫu paper đã nộp | [06-GIAI-PHAU-PAPER.md](06-GIAI-PHAU-PAPER.md) | Hoàn tất mười bài và claim–evidence ledger; [báo cáo bàn giao](lop-06-giai-phau-paper/12-BAO-CAO-ENRICH.md) | Đã đặt câu hỏi đầu; đang chờ trả lời theo hồ sơ bàn giao | `01a12a88-d288-7113-a9e2-67434b877250` |

## Tiêu chí bàn giao lớp 1

Giữ chương 01 làm bản đồ; các bài học sâu nằm trong `lop-01-nen-tang/`. Tách bản ghi tìm nguồn ở `lop-01-nen-tang/research/` khỏi bài học đã kiểm chứng. Mỗi bài cần giải thích cơ chế, ký hiệu và đơn vị, dẫn xuất cần thiết, ví dụ số hoàn chỉnh, phản ví dụ, liên hệ cụ thể với paper, bài tập có đáp án và nguồn trực tiếp hỗ trợ nội dung.

Cần có trang bắt đầu, nguồn và mức đọc, báo cáo phần bổ sung/sửa, cùng việc kiểm tra công thức, shape, ví dụ số và link nội bộ. Không dùng số lượng chữ hoặc số nguồn làm bằng chứng đã enrich đủ sâu. Các nguồn chưa đọc đủ để xác nhận một cơ chế phải được ghi rõ.

Sau khi hoàn tất học liệu, chat lớp 1 bắt đầu bài đầu bằng đoạn giải thích vừa sức và một câu hỏi kiểm tra hiểu. Viết xong học liệu không đồng nghĩa người dùng đã học xong lớp. Việc điều phối các lớp tiếp theo tiếp tục trong chat gốc.

## Tiêu chí bàn giao lớp 2

Lớp 2 giữ cùng tiêu chí chất lượng của lớp 1. Bài học sâu và hồ sơ nguồn nằm trong `lop-02-deepfake-bai-toan/`; ưu tiên pipeline cụ thể, các trục taxonomy độc lập, phản ví dụ về nhãn và protocol, hộ chiếu dataset có nguồn, bài tập phân loại/lập luận có đáp án. Ví dụ số chỉ dùng khi giúp hiểu cơ chế. Chủ trì lớp 2 không sửa học liệu lớp 1 hoặc bảng điều phối này.

## Tiêu chí bàn giao lớp 3

Bài học sâu và hồ sơ nguồn nằm trong `lop-03-ssl-jepa/`. Dạy rõ target/context/loss/gradient/update/constraints của từng recipe; có trace JEPA, ví dụ loss/EMA/masking và phản ví dụ collapse/utility. Các biến thể mới phải được kiểm tra nguồn và method, không nâng abstract thành bằng chứng cơ chế. Giữ chương 03 làm bản đồ, tách trạng thái học liệu và người học; chủ trì không sửa lớp 1/2 hoặc bảng điều phối.

## Tiêu chí bàn giao lớp 4

Bài học sâu và hồ sơ nguồn nằm trong `lop-04-ky-thuat-detector/`. Truy vết hệ thống từ waveform tới score; giải thích vị trí, cơ chế, giả định và failure modes của front-end, adaptation, layer fusion/pooling, loss/sampling, augmentation, data-centric/domain robustness và inference. Có ví dụ đầy đủ, phản ví dụ, bài tập có đáp án và source review; không chạy model hoặc chọn hướng mới. Chủ trì không sửa lớp 1–3 hoặc bảng điều phối; bàn giao và tiến độ học ghi trong thư mục lớp 4.

## Tiêu chí bàn giao lớp 5

Bài học sâu và hồ sơ nguồn nằm trong `lop-05-danh-gia-thuc-nghiem/`. Dạy decision/score conventions, metrics và calibration bằng ví dụ đầy đủ; nối split/model selection, uncertainty và thiết kế so sánh với claim/estimand cụ thể. Có phản ví dụ, nguồn thống kê/protocol đã đối chiếu, bài tập có đáp án, QA numerical và phạm vi bằng chứng rõ. Reproducibility/efficiency là phần học, không yêu cầu tái chạy model hoặc chọn hướng mới. Chủ trì không sửa lớp 1–4 hoặc bảng điều phối; bàn giao qua file.

## Tiêu chí bàn giao lớp 6

Bài học sâu và hồ sơ nguồn nằm trong `lop-06-giai-phau-paper/`. Đọc đủ PDF đã nộp và kiểm trực quan hình/bảng; nối pipeline, protocol, kết quả và lịch sử với kiến thức lớp 1–5. Có claim–evidence ledger và provenance rõ giữa reported paper, verified code, historical notes và toy; không suy raw seed ranges từ mean/SD, không nâng source association hoặc anisotropy thành causal diagnosis. Có bài tập lập luận/trace/số với đáp án, báo cáo/QA và micro-lesson đầu. Không sửa manuscript hoặc chạy lại detector; chủ trì không sửa lớp 1–5 hay bảng điều phối.

## Nhật ký giao việc

- 11/10/2026: Tạo chat lớp 1 trong project **JEPA Research**, môi trường local, model `gpt-6.1-sol`, reasoning `xhigh`. Giao hai subagent `gpt-6-luna` ở `max` nghiên cứu tiếng nói/DSP và toán/deep learning. Chat lớp 1 chịu trách nhiệm kiểm chứng, biên soạn và bắt đầu dạy; trạng thái thực thi cần đọc từ chat và báo cáo bàn giao.
- 11/10/2026: Đã đọc tiến độ chat mới và xác nhận hai subagent `speech_dsp_sources` và `math_dl_sources` bắt đầu. Agent chủ trì đã đọc học liệu, mở nguồn và phát hiện câu về Fourier cần làm rõ: biến đổi Fourier phức giữ thông tin qua phase; không thể nói phép biến đổi đầy đủ tự làm mất vị trí thời gian. Học liệu đang được enrich, chưa bàn giao.
- 11/10/2026: Đã đọc báo cáo, trang bắt đầu và hồ sơ tiến độ lớp 1, cùng tin bàn giao trong chat. Học liệu lớp 1 đã hoàn tất; hồ sơ người học đang chờ câu trả lời đầu tiên. Người dùng đánh giá tích cực và yêu cầu làm tương tự cho lớp 2.
- 11/10/2026: Tạo chat **Audio-JEPA — Lớp 2: Deepfake và bài…**, ID `01a1272b-32cd-7d10-8d04-3d419c17c9f7`, project **JEPA Research**, local, `gpt-6.1-sol` ở `xhigh`. Giao chủ trì spawn hai subagent `gpt-6-luna` ở `max`, nghiên cứu cơ chế sinh/pipeline và bài toán/dataset/domain shift; chủ trì kiểm chứng và biên soạn rồi bắt đầu hỏi đáp.
- 11/10/2026: Đã đọc tiến độ chat lớp 2 và xác nhận hai subagent `generation_sources` và `protocol_sources` bắt đầu. Chủ trì đang đọc tài liệu; học liệu lớp 2 chưa bàn giao.
- 11/10/2026: Đã đọc trang bắt đầu, báo cáo, hồ sơ học và tin bàn giao lớp 2. Học liệu gồm tám bài sâu, sổ nguồn và hộ chiếu dataset đã hoàn tất trong phạm vi báo cáo; đang chờ câu trả lời đầu của người học. Người dùng yêu cầu tiếp tục lớp 3.
- 11/10/2026: Tạo chat lớp 3, ID `01a12750-653e-7b13-be9d-ea6e9e39355d`, project **JEPA Research**, local, `gpt-6.1-sol` ở `xhigh`. Giao chủ trì spawn hai subagent `gpt-6-luna` ở `max` nghiên cứu SSL/loss/đối chiếu speech models và JEPA/teacher/masking/biến thể; chủ trì kiểm chứng, biên soạn và bắt đầu dạy qua hỏi đáp.
- 11/10/2026: Đã xác nhận chat **Audio-JEPA — Lớp 3: SSL và JEPA** đang thực thi và subagent `ssl_sources` bắt đầu. Nhánh JEPA đã được giao trong yêu cầu; tại thời điểm kiểm tra chưa có mục bắt đầu của subagent thứ hai trong bản đọc tiến độ. Học liệu lớp 3 chưa bàn giao.
- 11/10/2026: Đã đọc tin bàn giao, trang bắt đầu, báo cáo và tiến độ lớp 3. Mười bài sâu, hồ sơ recipe và đối chiếu paper/code/checkpoint đã hoàn tất trong phạm vi báo cáo; cả hai subagent đã thực hiện công việc. Người học đang chờ câu hỏi đầu theo hồ sơ bàn giao. Người dùng yêu cầu tiếp tục lớp 4.
- 11/10/2026: Tạo chat lớp 4, ID `01a12951-d3d2-7a02-8c4b-080df6836623`, project **JEPA Research**, local, `gpt-6.1-sol` ở `xhigh`. Giao hai subagent `gpt-6-luna` ở `max` nghiên cứu architecture/adaptation/pooling/inference và training/loss/augmentation/data/diagnostics; chủ trì kiểm chứng, biên soạn và bắt đầu hỏi đáp.
- 11/10/2026: Đã đọc tiến độ chat **Audio-JEPA — Lớp 4: Kỹ thuật detector** và xác nhận hai subagent `architecture_sources` và `training_sources` bắt đầu. Học liệu đang enrich, chưa bàn giao.
- 11/10/2026: Đã đọc tin bàn giao, trang bắt đầu, báo cáo và tiến độ lớp 4. Chín bài sâu và QA đã hoàn tất trong phạm vi báo cáo; người học đang chờ câu trả lời đầu về forward/update theo hồ sơ bàn giao. Người dùng yêu cầu tiếp tục lớp tiếp theo.
- 11/10/2026: Tạo chat lớp 5, ID `01a129b7-cb41-7203-867e-969e50706bd3`, project **JEPA Research**, local, `gpt-6.1-sol` ở `xhigh`. Giao hai subagent `gpt-6-luna` ở `max` nghiên cứu metrics/calibration/protocol và statistics/evidence/reproducibility; chủ trì kiểm chứng, biên soạn và bắt đầu hỏi đáp.
- 11/10/2026: Đã đọc tiến độ chat **Audio-JEPA — Lớp 5: Đánh giá và thực…** và xác nhận hai subagent `metrics_sources` và `evidence_sources` bắt đầu. Chủ trì đang đối chiếu metric conventions và phạm vi historical claims; học liệu đang enrich, chưa bàn giao.
- 11/10/2026: Đã đọc tin bàn giao, trang bắt đầu, báo cáo và tiến độ lớp 5. Mười bài sâu và QA đã hoàn tất trong phạm vi báo cáo; người học đang chờ câu hỏi đầu về threshold/error tradeoff theo hồ sơ bàn giao. Người dùng yêu cầu tiếp tục lớp cuối của sáu lớp đã định.
- 11/10/2026: Tạo chat lớp 6, ID `01a12a88-d288-7113-a9e2-67434b877250`, project **JEPA Research**, local, `gpt-6.1-sol` ở `xhigh`. Giao hai subagent `gpt-6-luna` ở `max` nghiên cứu paper pipeline/method và results/history/evidence; chủ trì kiểm chứng, biên soạn và bắt đầu hỏi đáp. Đã tạo đủ sáu chat; không coi việc tạo/biên soạn là người học hoàn tất.
- 11/10/2026: Đã đọc tiến độ chat **Audio-JEPA — Lớp 6: Giải phẫu paper** và xác nhận hai subagent `paper_pipeline_sources` và `paper_evidence_sources` bắt đầu. Chủ trì đang đọc PDF và nguồn; học liệu chưa bàn giao.

