List of topics
Biểu thức chính quy - Regular Expressions
Chi tiết các thuật toán tách từ
Chuẩn hóa văn bản
[Bổ trợ] Học máy là gì
[Bổ trợ] Đại số tuyến tính
Ôn tập Toán + học máy, học sâu và các khái niệm liên quan
[Bổ trợ] Các thuật toán Training
Vector Semantics và Embeddings
SkipGram, Glove, FastText và Softmax đa tầng
Mô hình ngôn ngữ
RNN và LSTM
Chữa bài tập + Ôn tập lập trình mô hình
Bài toán dịch máy
Mô hình Transfomer (3 buổi)
Mô hình Bert và ứng dụng
Thực hành Bert và ứng dụng với bài toán NER và POS Tag
GPT + Đào tạo phân tán
Bài toán truy xuất thông tin - Information Retrieval
Vector Database and RAG
Transformer nâng cao
Dự án cuối khóa - 2 tuần
Đọc thêm - Model hỏi đáp (QA)
Paper Reading - LLAMA 3.1

Chi tiết các thuật toán tách từ

  • Thuật toán BPE

  • Thuật toán WordPiece

  • Sử dụng thư viện SentencePiece

  • Sử dụng thư viện Spacy

  • Sử dụng thư viện Underthesea cho Tiếng Việt

1. Giới thiệu Tách token

3. Video Zoom NLP 01

3.1. Video

4. Video Zoom NLP 02

4.1. Video Zoom 02

5. Video Zoom NLP 03

5.1. Zoom NLP 03 - 24-09-2024

1. Giới thiệu Tách token
1.1. Slide
1.2. Thực hành tách từ với các thư viện khác nhau
1.3. Lập trình tách Ngrams
2. Thuật toán tách token BPE + WordPiece
2.1. Thực hành dùng WordPiece với HuggingFace
2.2. BPE Demo
3. Video Zoom NLP 01
3.1. Video
4. Video Zoom NLP 02
4.1. Video Zoom 02
5. Video Zoom NLP 03
5.1. Zoom NLP 03 - 24-09-2024