AI20K Khóa 4 — 30 đề tuyển chọn cho team

Top 10 + học kiến thức mới · MVP 3 tuần (6 tuần tổng) · GPU trung bình · deploy online thật
Giang · ML/CV research 1 bạn · AI/ML 1 bạn · LLM/agentic/RAG Bạn · backend/infra/product Độ khó 60–100% Loại VSOC + robotics nặng sim
Luật quan trọng: mỗi đề tối đa 2 team đăng ký → chốt sớm 2–3 đề để giữ chỗ. MVP bắt buộc: web deploy online · ≥2 vai trò · agentic có state + tool-use · HITL cho hành động rủi ro · eval/benchmark · đo latency/lỗi/chi phí · failure analysis.

⭐ TOP 5 nên ưu tiên tận dụng moat hiếm của team · dễ ăn điểm PLO 3/5/7 · khả thi 3 tuần

#1
DEV-18
CamSearch NL — tìm kiếm camera bằng ngôn ngữ tự nhiên
Dùng cả 4 người: CV open-vocab (Giang) + vector search (backend) + NL agent (LLM). Hiếm team làm nổi CV+agentic. Metric rõ (recall@k, latency).
#2
AIP-04
RAG tự đánh giá & tối ưu chất lượng truy hồi (RAGAS)
Đánh trúng PLO 3+7 — thứ giám khảo chấm nặng nhất. Ít team làm eval bài bản. Deploy dễ, chi phí đo được.
#3
RAV-18
IncidentLens — VLM phân tích & tóm tắt sự cố từ video+log
Multimodal (Giang VLM + LLM), liên quan trực tiếp VinFast (đơn vị ra đề). Không cần sim, chỉ video+CSV. Eval LLM-as-Judge.
#4
AIP-18
AgentOps — quan sát & gỡ lỗi hệ Multi-Agent (tracing)
Moat infra của bạn. Multi-agent debugging là pain-point thật, rất ít team đụng tới. Ăn điểm PLO 2+5+7 đậm.
#5
FIN-02
Phát hiện gian lận giao dịch realtime (ML+LLM+HITL)
Cân bằng CP1/CP2/CP3 hoàn hảo: ML scoring + LLM giải thích + infra realtime + HITL. Độ khó cao → khác biệt lớn. (đăng ký sớm)

Nhóm 1 — Computer Vision + Agentic Giang gánh lõi · 8 đề

TênKhóLõiPLOGhi chú 3 tuần
DEV-18CamSearch NL (semantic video search)76%Giang CV + backend + LLM1,3,5GroundingDINO/YOLO-World chậm trên GPU nhỏ → optimize/quantize
DEV-02DriverGuard — DMS buồn ngủ (PERCLOS)75%Giang CV + ML1,5,7MediaPipe/ONNX nhẹ; khó ở ánh sáng xấu; mô phỏng edge trên laptop
RAV-18IncidentLens — VLM tóm tắt sự cố lái75%Giang VLM + LLM1,2,7Video+log CSV, không cần sim; VLM inference cache/batch
DEV-12GuardianCam — người lạ & té ngã on-device72%Giang CV (pose/face)1,5,6Fall = temporal pose; face few-shot; giảm false positive
MFG-20Giám sát PPE & vùng nguy hiểm72%Giang CV + LLM1,5,7Dataset PPE hạn chế → data aug; ưu tiên recall
MFG-04Kiểm tra chất lượng bề mặt (defect)70%Giang CV + LLM1,7Dataset MVTec AD công khai; HITL PASS/FAIL đơn giản
SC-03Giám sát an ninh từ camera AI70%Giang CV + agentic1,5,6YOLOv8 sẵn; mock camera stream; tuning false positive
DEV-17RetailVision Edge (đếm người + heatmap)68%Giang CV + backend1,5YOLOv8+ByteTrack nhẹ; tracking qua occlusion khó

Nhóm 2 — RAG chất lượng cao + Multi-agent bạn LLM gánh lõi · 8 đề

TênKhóLõiPLOGhi chú 3 tuần
EDU-09LitReview Agent — tổng quan tài liệu + phân tích80%LLM + backend sandbox2,3,7Chống hallucinate DOI; Semantic Scholar API; eval citation ≥80%
VFO2O-20Coach tư vấn viên bán xe (tra cứu + role-play)80%LLM + backend2,3,7LLM-as-Judge theo rubric; 2 chế độ; validate chấm vs chuyên gia
EDU-04Kho tri thức học thuật (multi-assistant router)78%LLM/RAG2,3,6Hybrid BM25+vector+reranker; citation per-sentence; RAGAS ≥80%
DATA-01Text-to-SQL self-service analytics72%LLM + backend2,5,7Eval execution accuracy (Spider-like); retry agent + fallback
VMEC-09Giáo dục sức khỏe cá nhân hóa (grounded RAG)70%LLM/RAG3,6,7Grounding tuyệt đối + out-of-scope classifier; label ground-truth
BDSO2O-02SalesMate — RAG tài liệu dự án + tra tồn kho70%LLM/RAG + backend3,5,6Reranker + kiểm tra nhất quán dữ liệu; HITL trước gửi giá
VMEC-02Triage triệu chứng & phân luồng cấp cứu75%LLM/agentic1,6,7LangGraph state machine + red-flag detector; guardrails chặt
ITOPS-01Phân loại & xử lý ticket IT Helpdesk65%LLM + backend3,5,7RAG KB + classifier; eval F1; SLA tracking; HITL

Nhóm 3 — Infra / Observability / Eval / AgentOps bạn gánh lõi · 6 đề

TênKhóLõiPLOGhi chú 3 tuần
AIP-18AgentOps — tracing & debug multi-agent80%backend/observability2,5,7OpenTelemetry/Langfuse; mock multi-agent traces thực tế
PTNT-02Orchestrate đa dịch vụ (saga + rollback)78%backend (NodeJS/K8s)1,2,5Saga khó test; chuẩn bị rollback failure scenarios
PTNT-08Giám sát & tự chẩn đoán lỗi tích hợp (RCA)76%backend + ML5,7Jaeger/OTel; trace correlation edge cases
AIP-04RAG platform tự đánh giá & tối ưu (RAGAS)75%LLM + backend3,5,7RAGAS cần test dataset tốt để metric ổn định
ITOPS-03Giám sát hạ tầng & chẩn đoán sự cố74%backend (Prometheus/Grafana)5,7Time-series anomaly + RCA; cần dataset metric mô phỏng
AIP-05Guardrails & phát hiện prompt injection / PII70%LLM/security + backend6,7Llama Guard/Presidio; cân bằng false positive cần mẫu lớn

Nhóm 4 — ML/Data + Reasoning 2 bạn AI/ML gánh lõi · 5 đề

TênKhóLõiPLOGhi chú 3 tuần
FIN-02Phát hiện gian lận giao dịch realtime85%ML + LLM + infra1,5,6,7XGBoost/IsoForest + LLM giải thích; realtime (Kafka); precision cao
FIN-03eKYC & xác minh danh tính (OCR+face+deepfake)85%CV/ML + backend1,5,6OCR tiếng Việt + face match + deepfake; accuracy 99%+ khó
FIN-04Chấm điểm tín dụng thay thế (SHAP)80%ML + LLM4,6,7LightGBM + SHAP; feature engineering giao dịch; check fairness
GSM-05Phát hiện gian lận cuốc xe80%ML + LLM6,7IsoForest + PostGIS tuyến; giảm false positive; giải thích
SC-04Phát hiện bất thường cảm biến IoT đa nguồn65%ML + agentic5,7LSTM/IsoForest nhẹ; sinh dữ liệu cảm biến mô phỏng hợp lý

Nhóm 5 — Agentic business + HITL + guardrails cả team · 3 đề

TênKhóLõiPLOGhi chú 3 tuần
BO-03Soạn thảo & rà soát rủi ro hợp đồng85%LLM + backend3,6,7RAG pháp lý + OCR + diff engine; HITL luật sư; context dài
BDSO2O-11FunnelOptimizer — phân tích phễu O2O (code-exec)80%LLM + ML/data4,5,7Code-exec agent (pandas) + what-if; causal inference khó
GSM-01CSKH đặt xe & xử lý khiếu nại (multi-intent)75%LLM + backend1,3,6Tool-use đặt/hủy/hoàn tiền; HITL hoàn tiền cao; guardrail PII

Gợi ý phối team & việc cần làm

Chọn đề theo mục tiêu

  • An toàn + chắc top-10: AIP-04 / DATA-01 — deploy dễ, eval rõ, đúng thế mạnh LLM+infra.
  • Khác biệt (moat): DEV-18, RAV-18, AIP-18 — ít team làm nổi CV+agentic / observability.
  • Điểm kỹ thuật cao (2 bạn ML tỏa sáng): FIN-02, FIN-03, FIN-04.
  • Cân bằng CP1/CP2/CP3: RAV-18, FIN-02, BO-03.

Việc cần làm

  1. Team đọc TOP 5 → shortlist còn 2–3 đề.
  2. Đăng ký sớm (mỗi đề max 2 team).
  3. Tuần 1: chốt PRD + kiến trúc agent + dựng eval dataset nhỏ (đừng để tới cuối).
  4. Tuần 2–3: MVP deploy online + đo latency/lỗi/chi phí + 1 kịch bản demo + 1 kịch bản lỗi.