⚠️ Lưu trữ: Prompt này được viết cho kiến trúc v4.0. Kiến trúc hiện tại là v5.0 (Context Loading, 21 tuần).

PROMPT: Tổng Audit Kế hoạch 16 Tuần — Phân tích, Phản biện, Chấm điểm & Nâng cấp

Loại: Deep research + phản biện + đánh giá đa chiều + lên plan cải tiến
Target: Agent có quyền đọc file, phân tích, tạo file
Phiên bản: 1.0
Ngày tạo: 25/09/2026
Phạm vi: Toàn bộ 16 tuần × 112 ngày × ~200 file kế hoạch


Mục đích

Đánh giá toàn diện chất lượng, tính khả thi, và hiệu quả của TOÀN BỘ kế hoạch dự án CXK từ góc nhìn:
1. (học sinh lớp 10, 2h/ngày tối đa)
2. (giáo viên hướng dẫn, ~1h15/tuần)
3. (cố vấn y khoa, review nội dung)
4. Quản lý dự án (tiến độ, rủi ro, scope)
5. Giám khảo (chất lượng khoa học, phương pháp)


Cách sử dụng

Chạy prompt 19_TONG_AUDIT để đánh giá toàn bộ kế hoạch.

PHẦN A: Thu thập Dữ liệu (Giai đoạn 1)

Bước A1: Đọc toàn bộ tài liệu gốc

Đọc theo thứ tự ưu tiên:

1. AGENTS.md                                    (quy tắc dự án)
2. docs/GLOSSARY.md                              (thuật ngữ)
3. docs/research/plans/MASTER_PLAN_v3_AI_AGENT_DRIVEN.md  (master plan)
4. docs/research/plans/LICH_GVHD_16_TUAN.md     (lịch GVHD)
5. docs/project/project_charter.md               (charter)
6. docs/project/intended_use.md                   (scope)
7. safety/risk_register.md                        (rá»§i ro)

Bước A2: Đọc kế hoạch chi tiết từng tuần

Với mỗi tuần W[N] (N = 1..16):

docs/research/plans/W[N]/README.md               (tổng quan tuần)
docs/research/plans/W[N]/_AI_ANALYSIS.md          (phân tích AI)
docs/research/plans/W[N]/_AI_PROMPTS.md           (prompt thá»±c thi)
docs/research/plans/W[N]/_W[N]_PROGRESS_REPORT.md (báo cáo tiến độ, nếu có)
docs/research/plans/W[N]/D[XX]_*.md               (mỗi file ngày — scan tên + headers)

Bước A3: Thu thập thống kê thô

Cho mỗi tuần, ghi nhận:
- Tổng số
- Phân bổ: AI_FULL / AI_PARTIAL / NCS_ONLY
- Effort NCS (tổng giờ / ngày TB)
- Effort GVHD (phiên / phút)
- Deliverable count
- Dependency depth (chuỗi dài nhất)


PHẦN B: Chấm điểm Đa chiều (Giai đoạn 2)

B1: Bảng Scorecard — 10 chiều × 10 điểm = /100

Đánh giá TOÀN BỘ kế hoạch (macro level):

# Chiều đánh giá Câu hỏi chính Điểm (/10)
1 Tính khả thi NCS NCS lớp 10, 2h/ngày có làm được không? Task nào quá khó? /10
2 Cân bằng effort Effort phân bổ đều hay có tuần quá tải? Buffer đủ chưa? /10
3 Chuỗi dependency Dependency có hợp lý? Bottleneck ở đâu? Nếu delay 1 task thì ảnh hưởng gì? /10
4 Phủ rủi ro Risk register đầy đủ? Mỗi tuần có risk mitigation chưa? /10
5 Gate readiness Deliverable cho mỗi gate có đủ? Tiêu chí gate rõ ràng + đo lường được? /10
6 AI automation Tỷ lệ AI hợp lý? Có task nào gán AI nhưng AI không làm được? /10
7 Chất lượng DoD đo lường được? Có tiêu chí "pass/fail" rõ ràng? /10
8 Scope control Scope có rõ ràng? Có dấu hiệu scope creep? Web-only MVP giữ đúng? /10
9 Phương pháp NCKH Phương pháp nghiên cứu có chuẩn? Pilot design hợp lệ? Mẫu đủ lớn? /10
10 Safety & Ethics An toàn y khoa đủ chặt? Consent form? ? Quy trình CVYK review? /10

Tổng: /100

B2: Bảng Scorecard — Từng Sprint (/100)

Với mỗi (1-8), chấm 5 tiêu chí × 20 điểm:

# Tiêu chí Mô tả Điểm (/20)
1 Clarity Mỗi task có mô tả rõ ràng, NCS đọc hiểu được không? /20
2 Measurability DoD có tiêu chí đo được bằng số/checkbox cụ thể? /20
3 Achievability Effort ước lượng có thực tế? Buffer đủ? /20
4 Relevance Task đóng góp trực tiếp vào gate/deliverable cuối? /20
5 Timeliness Thứ tự dependency hợp lý? Không có task orphan? /20

B3: Bảng Scorecard — Từng Tuần (/50)

Với mỗi tuần (1-16), chấm nhanh:

# Tiêu chí Điểm (/10)
1 Task clarity Task mô tả đủ chi tiết?
2 Effort realism NCS ≤ 2h/ngày thực tế?
3 Output tangible Mỗi ngày có output cụ thể (file/deliverable)?
4 Dependency logic Thứ tự hợp lý, không vòng tròn?
5 AI prompt quality Prompt trong _AI_PROMPTS.md đủ chi tiết tự chạy?

PHẦN C: Phản biện & Gap Analysis (Giai đoạn 3)

C1: Phản biện theo vai trò

Phản biện từ 5 góc nhìn, mỗi góc ít nhất 3 findings:

Góc nhìn 1: NCS (Gia Hiếu — học sinh lớp 10)
- Task nào quá khó cho học sinh PTTH?
- Có cần kiến thức chuyên môn mà NCS chưa có?
- NCS có đủ kỹ năng đọc error log, review code, chạy test?
- Ngày nào effort > 2h thực tế?

Góc nhìn 2: GVHD (Thầy Đảm — giáo viên hướng dẫn)
- Thời gian GVHD đủ review chất lượng output không?
- GVHD có tool/năng lực review code AI tạo ra?
- Gate review có checklists rõ ràng cho GVHD ký?
- GVHD có bị quá tải tuần nào?

Góc nhìn 3: CVYK ()
- Nội dung y khoa có đủ thời gian review?
- Quy trình CVYK approve rõ ràng?
- Gold-label có cần CVYK trực tiếp gán từng case?

Góc nhìn 4: Giám khảo NCKH PTTH
- Phương pháp nghiên cứu có đủ chặt chẽ?
- Pilot study design: N bao nhiêu? Sampling method? Consent?
- Kết quả có reproducible không (người khác làm lại được)?
- Báo cáo có đủ sections: Abstract, Intro, Methods, Results, Discussion?
- Có đóng góp mới (novelty) hay chỉ áp dụng tool có sẵn?

Góc nhìn 5: Kỹ sư phần mềm (Technical Reviewer)
- Architecture có scalable? Có over-engineering cho prototype?
- Bảo mật: user data, conversation logs, injection?
- deployment: SSL? CORS? Error handling?
- ChromaDB vs MSSQL: tại sao dùng cả 2? Có cần?
- Test coverage: unit test? integration test? chỉ manual test?

C2: Gap Analysis

# Gap Mức độ Sprint ảnh hưởng Đề xuất
1 [gap description] 🔴/🟡/🟢 S[N] [giải pháp]

C3: Anti-patterns

Kiểm tra các anti-pattern phổ biến trong kế hoạch dự án:

  • [ ] Happy path bias: Chỉ lên kế hoạch cho trường hợp tốt, không có plan B?
  • [ ] Effort underestimate: Task "5 phút" thực tế mất 30 phút?
  • [ ] Dependency hell: Chuỗi dependency > 5 task liên tiếp?
  • [ ] Feature creep: Thêm tính năng ngoài scope Web-only MVP?
  • [ ] Testing afterthought: Test chỉ ở cuối, không test liên tục?
  • [ ] Documentation debt: Tài liệu chỉ viết cuối project?
  • [ ] Single point of failure: Nếu bị lỗi 1 tuần thì sao?
  • [ ] Missing rollback: Không có plan quay lại version cũ nếu lỗi?

PHẦN D: Bổ sung KPI & Chỉ tiêu Đo lường (Giai đoạn 4)

D1: KPI Hiện có (từ DoS v3.0)

# KPI Target Đo bằng
1 Safety violations 0 Test tự động
2 AI automation rate ≥ 75% Task count
3 ≥ 50 file count
4 Gate signatures 100% Checklist
5 NCS daily effort ≤ 2h Nhật ký
6 GVHD total effort ≤ 35h Lịch GVHD

D2: KPI Bổ sung (ĐỀ XUẤT thêm — chấm điểm mỗi cái có cần thiết không)

# KPI Mới Target Đề xuất Tại sao cần Đo bằng Cần thiết? (0-10)
1 Sprint Velocity ≥ 80% tasks hoàn thành/sprint Đo tiến độ thực vs kế hoạch Task board ?
2 Rework Rate ≤ 15% tasks cần làm lại Đo chất lượng lần đầu Progress report ?
3 NCS Skill Growth +1 level/sprint (theo rubric) Đo NCS có tiến bộ thực sự Rubric tự đánh giá ?
4 Test Coverage Growth +10 cases/sprint (từ S3 trở đi) Đảm bảo testing tích lũy Test count log ?
5 KB Growth Rate +15 cards/sprint (từ S2 trở đi) Đảm bảo tri thức tích lũy Card file count ?
6 Technical Debt Score ≤ 3/10 cuối mỗi sprint Phát hiện sớm nợ kỹ thuật Checklist lint ?
7 Response Quality (AI) ≥ 80% câu trả lời chính xác trên benchmark Đo chất lượng AI Benchmark runner ?
8 Safety Sensitivity ≥ 95% phát hiện Đo độ nhạy Red-team test suite ?
9 Score ≥ 90 Lighthouse Đo trợ năng cho NCT Lighthouse CLI ?
10 Pilot Satisfaction ≥ 4/5 trung bình Đo hài lòng người dùng thử Survey results ?
11 Diary Completeness 100% ngày có nhật ký Đo kỷ luật ghi chép File count diary/ ?
12 Gate On-time Rate 100% gate đúng hạn Đo tiến độ tổng thể Timeline vs actual ?
13 Source Citation Rate ≥ 90% claims có trích dẫn Đo tính khoa học Evidence matrix audit ?
14 Cross-ref Consistency 0 broken links Đo tính nhất quán tài liệu Link checker script ?
15 GVHD Satisfaction ≥ 4/5 sau mỗi gate Đo chất lượng từ góc GVHD Feedback form đơn giản ?

D3: Dashboard KPI (thiết kế)

Đề xuất cấu trúc file dashboard:

# File: docs/project/kpi_dashboard.yaml
project: CXK
last_updated: YYYY-MM-DD
sprints:
  - id: S1
    week_range: [1, 2]
    velocity: { planned: X, completed: Y, rate: "Z%" }
    ai_automation: { total_tasks: X, ai_full: Y, rate: "Z%" }
    ncs_effort: { planned_h: X, actual_h: Y }
    gvhd_effort: { planned_h: X, actual_h: Y }
    rework_rate: "X%"
    test_count: X
    kb_cards: X
    tech_debt: X/10
    gate: { name: "Gate 0", status: "PASSED/PENDING", date: "YYYY-MM-DD" }

PHẦN E: Kế hoạch Nâng cấp (Giai đoạn 5)

E1: Phân loại findings theo mức độ

Mức Ý nghĩa Hành động
🔴 CRITICAL Rủi ro cao, có thể gây fail project Sửa NGAY trước khi bắt đầu sprint đó
🟡 IMPORTANT Ảnh hưởng chất lượng nhưng không fail Sửa trong tuần hiện tại
🟢 NICE-TO-HAVE Cải thiện nhưng không bắt buộc Backlog, làm nếu có thời gian

E2: Action Plan (mẫu)

## Action Plan Nâng cấp

| # | Finding | Mức | Hành động | File cần sửa | Sprint | Ưu tiên |
|---|---|---|---|---|---|---|
| 1 | [finding] | 🔴 | [cụ thể sửa gì] | [path] | S[N] | 1 |
| 2 | [finding] | 🟡 | [cụ thể sửa gì] | [path] | S[N] | 2 |

E3: Thực thi nâng cấp

Với mỗi action item CRITICAL và IMPORTANT:
1. Đọc file cần sửa
2. Xác định thay đổi cụ thể
3. Thực hiện sửa đổi
4. Verify kết quả


Ràng buộc

  • Phản biện TRUNG THỰC — không ngại chỉ ra điểm yếu
  • Số liệu cụ thể — chấm điểm bằng số, không dùng "tốt/khá/trung bình"
  • So sánh thực tế — so với năng lực thực sự của NCS lớp 10
  • Không thêm scope — đề xuất nâng cấp TRONG scope Web-only MVP
  • Thuật ngữ chuẩn — theo AGENTS.md và GLOSSARY.md
  • Relative path — cho mọi link nội bộ

Output

Tạo file kết quả: docs/research/plans/_TONG_AUDIT_KE_HOACH.md

Bao gồm:
1. Bảng Scorecard tổng thể (/100)
2. Bảng Scorecard từng Sprint (/100)
3. Heatmap từng tuần (/50)
4. Top 10 Findings phản biện (kèm bằng chứng)
5. Gap Analysis table
6. Anti-pattern checklist
7. KPI Dashboard đề xuất (có đánh giá cần/không cần)
8. Action Plan nâng cấp (đã )
9. Executive Summary — 1 trang tóm tắt cho GVHD đọc nhanh


Checklist Hoàn thành

  • [ ] Đã đọc Master Plan + 16 README + 16 _AI_ANALYSIS.md
  • [ ] Đã chấm scorecard tổng thể 10 chiều × 10 điểm
  • [ ] Đã chấm scorecard từng sprint (8 sprint × 5 tiêu chí)
  • [ ] Đã chấm heatmap từng tuần (16 tuần × 5 tiêu chí)
  • [ ] Đã phản biện từ 5 góc nhìn (≥ 3 findings/góc = ≥ 15 findings)
  • [ ] Đã liệt kê gaps và anti-patterns
  • [ ] Đã đề xuất + đánh giá 15 KPI bổ sung
  • [ ] Đã lên action plan với phân loại 🔴/🟡/🟢
  • [ ] Đã viết executive summary

Ghi chú quan trọng: Prompt này KHÔNG thực thi nâng cấp. Chỉ phân tích và lên plan. Việc thực thi nâng cấp sẽ dùng prompt 18 (đánh giá tiến độ) cho từng tuần sau khi action plan được NCS/GVHD duyệt.