Think Exam
Nền tảng đánh giá AI tổ chức được cả thi trực tuyến, thi trên máy lẫn giấy bút
Think Exam là nền tảng đánh giá xuất thân từ Ấn Độ, phục vụ hơn 100 quốc gia, toàn cầu có hơn 2.500 điểm thi. Chỗ đặc biệt của nó là "giao đề đa phương thức", hỗ trợ cả thi trực tuyến, thi bằng máy tính, thi giấy bút và chế độ hỗn hợp, đây là nhu cầu bắt buộc với tổ chức cần làm các kỳ thi công khai quy mô lớn.
Đặc điểm chức năng và tình huống sử dụng
AI được dùng ở vài chỗ: bảy loại cảnh báo giám thị, xác thực danh tính AI tuyên bố độ chính xác 92%, tự động chấm câu hỏi tự luận (bài luận, trả lời ngắn), chọn đề thích ứng, và phân tích chuyên sâu kết quả thi. Giám thị từ xa cung cấp cả hai chế độ người thật và AI.
Về chức năng bao trùm trắc nghiệm tâm lý và kỹ năng, hạ tầng cho lượng lớn người thi cùng lúc, tích hợp LMS, báo cáo chi tiết, cũng hỗ trợ thi lập trình và hackathon.
Người dùng gồm trường học và đại học, cơ sở dạy thêm và cấp chứng chỉ, cơ quan chính phủ và quản lý, bộ phận tuyển dụng và phát triển nhân viên của doanh nghiệp, cùng các nhà xuất bản đề thi.
Tình huống tương ứng ở Việt Nam thực ra không ít: thi tuyển sinh của các trường nghề, kiểm định năng lực của công ty, đủ loại kỳ thi chứng chỉ. Trước đây những việc này phần lớn thuê ngoài cho vài nhà cung cấp bản địa, giá và độ linh hoạt đều không lý tưởng. Cấu trúc chi phí của loại nền tảng Ấn Độ này thường thân thiện hơn nhiều, đáng đưa vào đánh giá, nhưng phải xác nhận trước các chi tiết bản địa hóa như giao diện tiếng Việt, múi giờ Việt Nam, định dạng số căn cước.
Việc tự động chấm câu hỏi tự luận tôi giữ thái độ dè dặt: về kỹ thuật làm được, nhưng dùng trong kỳ thi chính thức có hiệu lực pháp lý (xét tuyển, chứng chỉ) thì rủi ro rất cao, khi thí sinh khiếu nại bạn giải thích điểm AI cho thế nào? Cách dùng hợp lý hơn là đào tạo nội bộ và thi thử.
Tính năng chính
- Giao đề chế độ trực tuyến, thi máy, giấy bút và hỗn hợp
- Giám thị từ xa hai luồng người thật và AI, bảy loại cảnh báo
- Xác thực danh tính AI tuyên bố độ chính xác 92%
- Tự động chấm câu hỏi tự luận
- Chọn đề thích ứng và phân tích chuyên sâu kết quả thi
- Hỗ trợ thi lập trình và hackathon, tích hợp LMS
Ưu điểm
- Giao đề đa phương thức đáp ứng nhu cầu thực thể của kỳ thi công khai quy mô lớn
- Hạ tầng 2.500 điểm thi toàn cầu là điều ít đối thủ làm được
- Cấu trúc chi phí của nhà cung cấp Ấn Độ thường thân thiện hơn đối thủ Âu Mỹ
Nhược điểm
- Không công khai giá
- Chấm tự luận bằng AI dùng cho thi chính thức có rủi ro khiếu nại, nên giới hạn ở bối cảnh nội bộ
- Giao diện tiếng Việt và bản địa hóa Việt Nam (định dạng xác thực danh tính...) cần xác nhận
Trường hợp sử dụng
- Trực tuyến hóa các kỳ thi tuyển sinh hoặc chứng chỉ quy mô lớn
- Trắc nghiệm kỹ năng và năng lực trong tuyển dụng doanh nghiệp
- Đánh giá cuối kỳ và giám thị cho khóa học từ xa
- Trắc nghiệm năng lực lập trình và hackathon
Ghi chú biên tập
Về giám thị AI, tôi cho rằng cả ngành nhìn chung bán quá đà. Nó là hỗ trợ chứ không phải phán quyết, mặt trái của "92% độ chính xác" là 8% số người bị oan, đặt vào kỳ thi xét tuyển thì đó là con số có thể hủy hoại một con người. Muốn dùng, thì hãy giữ con người trong vòng lặp.
Câu hỏi thường gặp
Chấm tự luận tự động có dùng được cho thi chính thức không?
Lời khuyên của tôi là không. Về kỹ thuật làm được, nhưng thi chính thức liên quan quyền lợi của thí sinh, một khi khiếu nại bạn phải giải thích từng điểm trừ ra sao. Cách an toàn hơn là dùng cho đào tạo nội bộ, thi thử và sàng lọc ban đầu, chấm điểm chính thức giữ thủ công hoặc ít nhất là người rà soát lại.
Giám thị AI có phán đoán sai không?
Chắc chắn có. Cúi xuống nhìn bàn phím, người nhà đi qua khung hình, mất mạng đều có thể bị đánh dấu. Cách làm có trách nhiệm là coi cảnh báo AI là gợi ý "nhờ người vào xem đoạn ghi hình này", chứ không phải kết luận thẳng là gian lận. Bên phát triển cũng cung cấp chế độ giám thị người thật, kỳ thi quan trọng nên dùng kèm.
Công cụ AI liên quan
實價雷達 HouseTW
Trang tra cứu giá nhà miễn phí tích hợp 3,49 triệu giao dịch thực tế tại Đài Loan cùng các dữ liệu rủi ro ngập lụt, đứt gãy địa chất và hóa lỏng đất trên cùng một bản đồ.
Profet AI
Nền tảng AutoML chuyên dụng cho ngành sản xuất tại Đài Loan.
Cubo AI
Camera giám sát em bé tích hợp AI do đội ngũ Đài Loan phát triển.
Whoscall
Ứng dụng nhận diện cuộc gọi và chống lừa đảo tích hợp AI do đội ngũ Đài Loan phát triển.
Claude
Trợ lý AI do Anthropic phát triển, chuyên gia xử lý văn bản dài và đối thoại an toàn.
Microsoft Dragon Copilot
Trợ lý AI y tế do Microsoft gộp Nuance DAX và Dragon, đi tuyến hệ thống bệnh viện lớn