50.000₫138.000₫Giảm 64%Published
LLM Quest Academy — Từ y = ax + b đến Agentic AI
Từ toán nền đến Agentic AI — 50+ nodes, 10 levels
✦ Thử trước khi mua
Tinh hoa khoá học — chạy thử trực tiếp
Mọi widget dưới đây là chính công cụ tương tác bạn sẽ dùng trong bài học sau khi mua. Chạm vào chúng — kéo slider, bấm preset. Nếu thấy hấp dẫn, toàn bộ khoá học được thiết kế cùng phong cách.
📍 L4-2 Self-Attention
Attention heatmap — kéo tham số để thấy ai chú ý đến ai
Đọc heatmap thế nào?
Mỗi hàng = một token query. Mỗi ô = trọng số attention token hàng dành cho token cột. Tổng mỗi hàng = 1 (softmax).
Trong LLM thật, các ô được tính bằng softmax(QKᵀ/√d). Ở đây ta dùng một công thức giả lập đơn giản chỉ để minh hoạ hình thức.
💡 Một trong nhiều demo bạn được dùng trong các bài học Transformer.
📍 L4-3 Positional encoding
Sinusoidal PE heatmap — thay d, B, số vị trí ngay
📡 Heatmap Positional Encoding — kéo slider để thấy ảnh hưởng
Giá trị PE: -1 (tím) → 0 → +1 (vàng)
Cột thấp (i nhỏ) đổi màu nhanh theo pos = tần số cao. Cột cao = tần số thấp.
💡 Đi sâu vào lý do paper gốc chọn công thức sin/cos cụ thể đó.
📍 L7-2 RLHF
Bradley-Terry — Δr biến thành xác suất preference & BT loss
🤝 Bradley-Terry tương tác — xác suất preference theo reward gap
Reward gap Δr
3.00
P(y_w ≻ y_l)
95.3%
BT loss của cặp này
0.049
Δr lớn → σ → 1 → loss ≈ 0. Δr âm → mô hình đoán sai → loss tăng nhanh.
💡 Hiểu rõ ChatGPT được tinh chỉnh bằng preference data như thế nào.
Lộ trình tổng quan — 10 cấp độ
từ đại số cơ bản đến agent tự trị- Level 0 · Toán & Mô hình cơ bảnTừ y = ax + b đến trực giác toán
- Level 1 · Tối ưu & Xác suấtLoss, gradient descent, xác suất
- Level 2 · Machine Learning cốt lõiRegression, classification, tradeoffs
- Level 3 · Deep Learning cơ bảnNeuron, MLP, backprop, regularization
- Level 4 · Chuỗi & AttentionRNN tới self-attention
- Level 5 · Transformer & GPTTokenization, pretraining, sampling
- Level 6 · Kỹ thuật ứng dụng LLMPrompting, RAG, evals
- Level 7 · Fine-tuning & AlignmentSFT, preference tuning, safety
- Level 8 · Hệ thống AgentPlanning, tools, multi-agent
- Level 9 · LLM Ops & GovernanceObservability, cost, policy
55+ bài tương tác10 boss projectSong ngữ VI + ENQuiz tự chấm + tutor gợi ý