Đang chạy mực qua máy in — từng lớp màu một, kiên nhẫn nhé!
№ 01
№ 02
№ 03
№ 04
№ 05
№ 06
EACH (EduAI Competency Hub) · AI·20K Demo Day Zine
№ 21
EACH (EduAI Competency Hub)
EduAI Competency Hub là nền tảng học tập AI cá nhân hóa, giúp sinh viên chuyển từ "dùng AI thụ động" sang thành thạo Prompting, tư duy phản biện và tuân thủ liêm chính học thuật. Hệ thống ứng dụng AI Agent đa tầng kết hợp thuật toán thích ứng (BKT/Elo) để chấm điểm và dẫn dắt người học theo thời gian thực.
Fig. 01 · Ảnh dự án
1. Đặt vấn đề & Bài toán thực tế
Đối với Sinh viên (Đặc biệt khối ngành Kinh tế - Xã hội):
Lạm dụng AI dẫn đến nguy cơ bị điểm 0 do đạo văn hoặc thông tin bịa đặt (Hallucination).
Thiếu kỹ năng kiểm chứng nguồn tin và chưa hiểu rõ ranh giới đạo đức, pháp lý khi ứng dụng Generative AI vào học tập.
Ngại học các khóa lý thuyết dài dòng, thiếu môi trường thực hành phản hồi tức thì.
Đối với Nhà trường & Giảng viên:
Thiếu thước đo định lượng chuẩn hóa để đánh giá năng lực AI thực chất của sinh viên.
Lo ngại bùng nổ chi phí API LLM nếu triển khai bài tập thực hành đại trà cho hàng nghìn sinh viên.
2. Giải pháp Kỹ thuật Cốt lõi
EduAI Competency Hub (EACH) giải quyết triệt để bài toán trên bằng kiến trúc 3-Tier AI-Powered System:
Chẩn đoán Đầu vào 2 Giai đoạn (Fast-Track Screener + 5Q Diagnostic):
Đánh giá phân loại siêu tốc qua 2 câu Screener kết hợp 5 câu tình huống đại diện cho 5 miền năng lực theo Khung năng lực AI sinh viên (AILFS 1.0).
Ứng dụng mô hình toán học Bayesian Knowledge Tracing (BKT) và Hệ thống Elo Rating để xác định điểm năng lực và lỗ hổng kiến thức ban đầu với chi phí gọi API là 0 USD.
Duolingo Gamification Engine & 3 Dạng Thử Thách AI Sandbox:
Cây lộ trình học tập trực quan (5 Units): Quản lý tiến độ học qua hệ thống 3 Tim năng lượng (Hearts), Daily Streak, XP Points và Chế độ Ôn Luyện Điểm Mù (Practice Weak Spots) để hồi phục Tim.
3 Dạng Thử Thách Interactive tại Sandbox:
Dạng 1 - Quiz Tương tác: Rèn luyện phản xạ nhận diện bẫy ảo giác, điều khoản bịa và thông tin chưa kiểm chứng trong phản hồi AI.
Dạng 3 - Viết Prompt Tình huống Thực tế (Scenario): Thực hành giải quyết tình huống thực tế có AI chấm điểm và trợ giảng thích ứng.
Hệ thống AI Agent Đa Tầng (LangGraph, RAG & Socratic Tutor):
LLM Auto-Eval: Chấm điểm theo rubric chuẩn và tự động bóc tách lỗi vào 6 nhóm nguyên nhân (Vague Prompt, Missing Constraint, Hallucination Risk, Ethics Violation, Over-Reliance, Off-Task).
Scaffolding Hint Node (Gợi ý phân tầng 3 bước):
Cung cấp gợi ý định hướng trúng nhóm lỗi mà không làm lộ đáp án cốt lõi.
§
Phụ lục — Demo & Slides
Video demo
Bản demo trực tiếp
Slide trình bày
Sai lần 1 (Hint 1):
Sai lần 2 (Hint 2): Kích hoạt RAG Tool truy xuất ChromaDB để cung cấp trích dẫn chuẩn AILFS 1.0 và quy chế đối soát.
Sai từ 3 lần trở lên (Walkthrough): Cung cấp lời giải mẫu chuẩn, kích hoạt cờ xác nhận (Requires Ack) và gắn nhãn Điểm mù (Weak Spot) vào Database.
Socratic AI Tutor: Trợ lý trò chuyện gợi mở Socratic tích hợp Guardrail 2 đầu kiểm duyệt an toàn, tuyệt đối không giải hộ bài thi.
Tối ưu Chi phí, Bảo mật & Giám sát (Observability):
Redis Semantic Caching 2 tầng giúp tiết kiệm 60% đến 80% chi phí gọi LLM.
Hệ thống Arize Phoenix / OpenTelemetry theo dõi chi tiết độ trễ, token usage và luồng thực thi Agent.
Phân quyền RBAC, kiểm duyệt domain email trường học và Dashboard Giảng viên (HITL) ẩn danh hóa 100% dữ liệu sinh viên bằng mã hóa SHA-256.
3. Tính khả thi & Kết quả Đạt được
Tính khả thi kỹ thuật: Hệ thống đã hoàn thiện End-to-End với Backend FastAPI, Frontend React Vite, Vector DB ChromaDB và tích hợp LLM thực tế (GPT-4o-mini / Gemini 1.5 Flash).
Hiệu quả định lượng:
Thời gian chẩn đoán ban đầu bằng thuật toán BKT/Elo cực nhanh (dưới 5ms).
Giảm thiểu hơn 70% lỗi vi phạm đạo đức và trích dẫn giả trong các bài nộp Sandbox sau các vòng lặp gợi ý.
Mức tăng trưởng điểm năng lực trung bình đạt trên 150 điểm Elo sau lộ trình học.
Minh chứng kiểm thử: Vượt qua 100% bộ Test Cases kiểm thử thực nghiệm trên cả 5 miền năng lực với nhật ký Arize Phoenix Trace minh bạch.
4. Hướng phát triển trong tương lai
Ngắn hạn: Mở rộng Ngân hàng bài tập Sandbox lên hơn 100 tình huống tương tác; hoàn thiện phân tích biểu đồ Radar 5 miền trên Dashboard.
Trung hạn: Tích hợp chuẩn LTI (Learning Tools Interoperability) để nhúng trực tiếp vào các hệ thống LMS phổ biến như Canvas, Moodle, Blackboard.
Dài hạn: Mở rộng thêm Miền năng lực thứ 6 (Thiết kế & Phát triển hệ thống AI cho khối ngành IT) và cấp chứng chỉ số AI Competency Credential.