🧠 PHÂN LOẠI INTENT KHÁCH HÀNG

Cuộc thi Xây dựng Hệ thống Hiểu Ngữ nghĩa

🌐 Trang web chính thức: omillm.magicvoice.vn

💎 Domain được tài trợ bởi Magicvoice Việt Nam - nền tảng AI giọng nói số một Phường Từ Liêm

🏆 Nhà tài trợ giải thưởng:

💰 Giải nhất 1 triệu đồng - Mr.Frost

🎯 Người đầu tiên đạt 0.85 accuracy: 500 cá - Mr.Z

🌊 Giải nhì & giải 3: mỗi giải chiếc quạt đeo cổ fresh cho chuyến nghỉ dưỡng ở Huế - Mr. Magic Voice

🎁 Vẫn tiếp tục nhận thêm nhà tài trợ

Bối cảnh

Bạn đang tham gia nhiệm vụ xây dựng một hệ thống hiểu ngữ nghĩa nhằm phân loại intent (mục đích) của khách hàng dựa trên câu trả lời cho lời chào từ nhân viên chăm sóc khách hàng.

Lời chào mặc định:
"Em là Khuê - Chuyên viên chăm sóc khách hàng của Ngân hàng Thương mại cổ phần Quân Đội. Em có thể hỗ trợ gì được cho quý khách ạ."

Khách hàng sẽ trả lời theo nhiều cách khác nhau. Nhiệm vụ của bạn là viết prompt hiệu quả nhất để xác định chính xác intent của khách hàng, dựa trên nội dung phản hồi và lịch sử hội thoại (nếu có).

📁 Tài liệu & Download

📥 Link tải Public Test

Tải file public_test.txt chính thức từ BTC:

🔗 https://drive.google.com/file/d/1R03j6XyBMIO8Ggo52_d2UTBtgF2oCIcG/

📝 Hướng dẫn viết Prompt

Tài liệu tham khảo cách viết prompt hiệu quả:

🔗 https://docs.google.com/spreadsheets/d/1ZPwaNHPEhs4fbWWXSEaNVmw2CD8Z44-oPm47HY1znDA/

🗂 Thông tin Input/Output

📥 Input

Một file testcases gồm nhiều dòng. Mỗi dòng có định dạng:

input_message     expected_intent     history
input_message: câu trả lời hiện tại của khách hàng
expected_intent: tên intent chuẩn để đánh giá
history: các đoạn hội thoại trước đó (nếu có) dạng: "bot: ... \nuser: ...\nbot: ..."

📤 Output

Prompt của bạn phải đưa ra intent dự đoán, được so sánh với expected_intent để tính độ chính xác (accuracy).

📋 Bảng mô tả Intent

Bạn sẽ được cung cấp bảng intent definition tại link: https://docs.google.com/spreadsheets/d/1xIgqATInvI0KRqyU08PqTSf8h0S4mKNB_7DTjZy1eQ8/ liệt kê tất cả các intent hợp lệ trong cuộc thi, kèm theo mô tả ngắn gọn.

339
Dòng dữ liệu Public Test
1000
Dòng dữ liệu Private Test 1
2000
Dòng dữ liệu Private Test 2
>90%
Độ chính xác mục tiêu

🧪 Luật chơi & Cách chấm điểm

🔓 Giai đoạn Public Test

BTC cung cấp file public_test.txt gồm 339 dòng dữ liệu mẫu
Người chơi sử dụng file này để thử nghiệm và điều chỉnh prompt
Mỗi lần gửi prompt đúng định dạng sẽ được ghi nhận điểm số trên leaderboard

🔒 Giai đoạn Private Test

BTC sử dụng bộ private test ngầm định (ẩn) để đánh giá cuối cùng
Prompt có độ chính xác cao nhất trên public test sẽ được dùng làm prompt chính thức
Người chiến thắng có độ chính xác cao nhất trên tập private test

📊 Quy trình Chấm điểm

Sau khi submit public_test và prompt, kết quả sẽ được chấm trên 2 bộ test:
Public test (339 dữ liệu): dữ liệu công khai
Private test 1 (1000 dữ liệu): ẩn dữ liệu, show accuracy khi user submit prompt
Trả về nhãn, accuracy của public testaccuracy của private test

🏆 Kết quả Cuối cùng

Kết quả cuối cùng sẽ được chạy prompt 5 lần trên bộ Private test 2 (2000 dữ liệu)
Private test 2: là tập Private chứa 1/2 là bộ Private 1 (1000 dữ liệu)1000 dữ liệu ẩn chưa chạy lần nào của Ban tổ chức
Đảm bảo tính công bằng và độ tin cậy của kết quả thi đấu

📌 Lưu ý quan trọng

⚠️ Các quy định bắt buộc:

Chỉ các prompt được chạy với file public_test.txt do BTC cung cấp mới được ghi nhận trên leaderboard
File test bạn upload lên có thể tự do, tuy nhiên không được upload quá nhiều để spam, chỉ file giữ nguyên nội dung, không chỉnh sửa input hay expected_intent thì mới được đưa vào leaderboard và lấy prompt làm kết quả thi đấu
Hệ thống đánh giá sẽ tự động so sánh kết quả dự đoán của bạn với expected_intent để tính điểm