Enterprise AI Summit 2026

Xây dựng AI chuyên biệt cho doanh nghiệp

Từ mô hình đến Expert Agent

TS. Triệu Hải Long Chuyên gia cao cấp Đại học Cambridge

Hai hướng chúng tôi đang xây

01 Legal AI Expert Agents
02 Speech AI Specialized & Sovereign AI
Enterprise AI Summit 202602
updating

Tại sao Legal AI là một bài toán khó?

01Không chỉ tìm văn bản
02Luật có cấu trúc, quan hệ, hiệu lực, sửa đổi
03Câu trả lời cần reasoning + evidence + verification
Legal AI là một bài toán tiêu biểu để nghiên cứu Expert Agent.
Enterprise AI Summit 202603
updating

Một Expert Agent cần những gì?

Knowledge Tri thức chuyên ngành và dữ liệu riêng
Reasoning Suy luận theo logic của chuyên gia
Verification Kiểm tra quy tắc, bằng chứng và ràng buộc
Learning Đánh giá, phản hồi và cải thiện liên tục

Benchmark VietLegal theo 5 cấp năng lực

Level 1·Recognition & Recall

TaskCMC-LegalOursΔ
Legal Entity Recognition65.2468.40+3.16
Legal Topic Classification82.7188.40+5.69
Legal Concept Recall61.3373.70+12.37
Article Recall68.4094.20+25.80
Legal Schema Recall22.2550.30+28.05

Level 2·Understanding & Structuring

TaskCMC-LegalOursΔ
Relation Extraction87.3571.10−16.25
Legal Element Recognition51.3366.00+14.67
Legal Graph Structuring0.5290.791+0.262
Judgment Verification73.3383.50+10.17
User Intent Understanding61.6874.80+13.12

Level 3·Reasoning & Inference

TaskCMC-LegalOursΔ
Article / Clause Prediction35.3373.20+37.87
Legal Court Decision Prediction82.1782.65+0.48
Multi-Article Reasoning74.6677.74+3.08
Conflict & Consistency DetectionY-F111.8551.32+39.47
N-F139.5946.38+6.79
Penalty / Remedy Estimation57.3849.58−7.80

Level 4·Interpretation & Generation

TaskCMC-LegalOursΔ
Legal Document Summarization0.3270.366+0.039
Judicial Reasoning Generation0.4170.320−0.097
Objective Legal Opinion Generation0.4930.457−0.036

Level 5·Ethics, Fairness & Bias

TaskCMC-LegalOursΔ
Bias Detection41.7656.00+14.24
Privacy & Data Protection67.7469.50+1.76
Ethical Consistency Assessment86.5687.94+1.38
Unfair Contract Detection51.2854.00+2.72
Enterprise AI Summit 202605

Huấn luyện model chuyên biệt

82.28
86.68
85.36
85.94
Legal Topic
Classification
69.92
91.18
91.98
80.75
Legal Entity
Recognition
61.72
50.50
51.90
62.5
User Intent
Understanding

Benchmark công khai (VietLegal, CMC OpenAI 2026)

Qwen2.5:7BQwen2.5:32BQwen2.5:70BQwen2.5:7B Fine-tuned
Enterprise AI Summit 202606

Huấn luyện model chuyên biệt

76.7
82.8
88.9
88.9
Intent
18.9
29.4
31.7
62.2
Legal concept
35.6
47.2
50.6
84.4
Scope /
user facts
35.6
41.1
58.3
62.2
Question
rewrite

Benchmark năng lực sản phẩm

Qwen2.5:7BQwen2.5:32BQwen2.5:70BQwen2.5:7B Fine-tuned
Enterprise AI Summit 202607

Knowledge Graph: luật không phải tập hợp các đoạn text

Câu hỏiNguyên tắc ưu đãi trong đấu thầu?

RAG thông thường
Nghị định 24/2024 · Điều 4 Nguyên tắc ưu đãi độ tương đồng cao nhất Các đoạn rời nhau — không có cạnh, không biết văn bản đã bị thay thế.
Legal Knowledge Graph
sửa đổi căn cứ căn cứ sửa đổi sửa đổi THAY THẾ 22/2023/QH15 Luật Đấu thầu 90/2025/QH15 Luật sửa đổi 115/2024/NĐ-CP 17/2025/NĐ-CP 24/2024/NĐ-CP hết hiệu lực · 04/8/2025 214/2025/NĐ-CP hiệu lực từ 04/8/2025 Điều 4 Nguyên tắc ưu đãi Điều 5 Nguyên tắc ưu đãi RAG trả về ô này đáp án đúng căn cứ / chứa sửa đổi thay thế
Muốn AI hiểu luật, đôi khi cần biểu diễn cấu trúc của tri thức, không chỉ semantic similarity.
Enterprise AI Summit 202608

Đóng góp của Knowledge Graph vào Legal Retrieval

77.8
78.4
Tra cứu
cơ bản
68.8
78.7
Tra cứu
dẫn chiếu
43.2
53.6
Tra cứu hiệu lực
theo thời gian
26.5
41.6
Tra cứu liên cấp
văn bản
40.0
60.0
Tra cứu
sửa đổi / bãi bỏ
Baseline GraphRAG
Enterprise AI Summit 202609
updating

Tích hợp tri thức chuyên gia vào Legal AI

Chuyên gia tham gia:

01kiểm tra corpus và văn bản;
02kiểm tra ground truth / kết quả;
03xác định logic nghiệp vụ;
04xây các điều kiện verification;
05đánh giá câu trả lời cuối.

Expert knowledge không chỉ nằm trong tài liệu — mà còn nằm trong cách chuyên gia xác định một kết luận có đúng hay không.

Enterprise AI Summit 202610

Legal Expert Agent

TRI THỨCAGENTNGƯỜI DÙNGCHUYÊN GIAModelfine-tunedVăn bản pháp luậtKnowledge GraphWebTri thức chuyên giaHiểuTra cứuSuy luậnKiểm chứngTrả lờicập nhậtkiểm chứng thất bại → tra cứu lạiAGENT TỰ CẢI THIỆN TỪ PHẢN HỒItrả lời kèm bằng chứng
Enterprise AI Summit 202611

Agent tiếp tục cải thiện năng lực khi có phản hồi

66.5
68.5
Legal Entity
Recognition
76
78
Legal Concept
Recall
62
67
Article /
Clause Prediction
68
71
Multi-Article
Reasoning
Initial Agent After feedback loops
Enterprise AI Summit 202612

So sánh chất lượng trả lời pháp lý với các hệ thống AI hàng đầu

Citation / Evidence

41.8
ChatGPT
33.3
Gemini
36.2
Claude
63.2
Our Legal Agent

Answer Correctness

67
ChatGPT
41
Gemini
57
Claude
64
Our Legal Agent
Enterprise AI Summit 202613
updating

Từ Legal Agent đến Expert Agents

Legal chỉ là example.

Legal Finance HR Procurement Compliance

Ở giữa là:

Domain knowledge + reasoning + verification + learning

Mục tiêu không chỉ là Legal AI. Mục tiêu là một phương pháp để xây những AI có năng lực chuyên gia cho từng domain.

Enterprise AI Summit 202614

Phần trước — chuyên biệt hoá ở tầng tri thức, lập luận và kiểm chứng.

Speech AI

Chuyên biệt hoá ở tầng model.

updating

Speech AI: tại sao cần model riêng?

Một cuộc họp tiếng Việt thực tế có:

nhiều speaker accent nói chồng thuật ngữ doanh nghiệp noise tên riêng dữ liệu nhạy cảm

Meeting speech khác rất xa một đoạn audio sạch dùng để demo speech-to-text.

Enterprise AI Summit 202616

100+ giờ dữ liệu Meeting Speech: quy mô và độ đa dạng

Quy mô
101.7 giờ Tổng thời lượng
289 Cuộc họp
~35K Lượt thoại / đoạn
Độ đa dạng
87 voices* Số giọng
3–4 speakers* Số người nói / cuộc
~10%* Chồng lời trung bình
52.3% Nam · 47.7% Nữ* Giới tính
Bắc 37.5% · Nam 30.0% · Trung 3.7%* Vùng giọng
Business · Technology · Finance · Healthcare · HR · Marketing · Operations · … Domain

* Thống kê speaker / accent / overlap trên phần dữ liệu có metadata tương ứng.

Enterprise AI Summit 202617
updating

Chúng tôi xây Speech AI như thế nào?

01Xây dựng / chuẩn hóa dataset
02~100 giờ meeting speech tiếng Việt
03Fine-tune model từ PhoWhisper
04Training evaluation iteration
Enterprise AI Summit 202618

Benchmark Speech AI · General domain

CER ↓ — thấp hơn là tốt hơn

22.65
PhoWhisper-large
21.48
ViMedCSS-AG
18.25
Our speech model

ViMedCSS hard

Enterprise AI Summit 202619

Benchmark Speech AI · Code-switching

Coverage từ tiếng Anh giữ được trong văn bản đầu ra ↑ — cao hơn là tốt hơn

27.72
PhoWhisper-large
37.55
Our speech model

ViMedCSS hard

34.74
PhoWhisper-large
85.82
Our speech model

Meeting

Enterprise AI Summit 202620

Benchmark Speech AI · Meeting domain

CER ↓ — thấp hơn là tốt hơn

4.26
PhoWhisper-large
updating
ElevenLabs Scribe v2
1.61−62%
Our speech model

Meeting (medium)

15.92
PhoWhisper-large
6.44
ElevenLabs Scribe v2
5.77−64%
Our speech model

Meeting (hard)

Enterprise AI Summit 202621
updating

Tại sao làm chủ Speech model quan trọng với doanh nghiệp?

Không chỉ accuracy:

Specialization meeting Vietnamese
Control model / deployment
Privacy confidential meetings
Sovereignty giảm phụ thuộc external API
Enterprise AI Summit 202622

Những gì chúng tôi đang xây

01Huấn luyện model cho từng domain
02Xây dựng tri thức có cấu trúc
03Đưa lập luận và kiểm chứng của chuyên gia vào hệ thống
04Đánh giá và cải thiện liên tục

Từ AI tổng quát đến AI chuyên biệt mà doanh nghiệp có thể hiểu, tin cậy và làm chủ.

Enterprise AI Summit 202623
B blueprint N notes S static