Dự án nghiên cứu & ứng dụng Học máy (Machine Learning) và Xử lý Ngôn ngữ Tự nhiên (NLP) huấn luyện mô hình PhoBERT v4 phân loại tin tức tiếng Việt theo chủ đề thời gian thực.
Case study
Lượng bài viết tin tức tiếng Việt phát sinh liên tục rất lớn, phân loại thủ công mất nhiều thời gian, chi phí và dễ gây sai sót hệ thống.
Xây dựng pipeline xử lý ngôn ngữ tự nhiên tiếng Việt, huấn luyện mô hình PhoBERT v4 cho độ chính xác cao (90%+), phát triển REST API FastAPI và giao diện Web Dashboard hiển thị chỉ số đo lường.
Tự động phân loại chính xác nhãn chủ đề văn bản tiếng Việt thời gian thực, đo lường các chỉ số Precision, Recall và F1-Score trực quan.
Bối cảnh
Đồ án / Dự án Nghiên cứu Học máy & Xử lý Ngôn ngữ Tự nhiên (NLP)
Vai trò
Huấn luyện mô hình PhoBERT v4, xây dựng REST API bằng FastAPI và phát triển giao diện Web Dashboard.