List of topics
Biểu thức chính quy - Regular Expressions
Chi tiết các thuật toán tách từ
Chuẩn hóa văn bản
[Bổ trợ] Học máy là gì
[Bổ trợ] Đại số tuyến tính
Ôn tập Toán + học máy, học sâu và các khái niệm liên quan
[Bổ trợ] Các thuật toán Training
Vector Semantics và Embeddings
SkipGram, Glove, FastText và Softmax đa tầng
Mô hình ngôn ngữ
RNN và LSTM
Chữa bài tập + Ôn tập lập trình mô hình
Bài toán dịch máy
Mô hình Transfomer (3 buổi)
Mô hình Bert và ứng dụng
Thực hành Bert và ứng dụng với bài toán NER và POS Tag
GPT + Đào tạo phân tán
Bài toán truy xuất thông tin - Information Retrieval
Vector Database and RAG
Transformer nâng cao
Dự án cuối khóa - 2 tuần
Đọc thêm - Model hỏi đáp (QA)
Paper Reading - LLAMA 3.1
Chi tiết các thuật toán tách từ
Thuật toán BPE
Thuật toán WordPiece
Sử dụng thư viện SentencePiece
Sử dụng thư viện Spacy
Sử dụng thư viện Underthesea cho Tiếng Việt
1. Giới thiệu Tách token
1.1. Slide
1.2. Thực hành tách từ với các thư viện khác nhau
Python thuần: https://colab.research.google.com/drive/1l3_wOM7cA5KLnJcv3jcgcb1g03SVAN05?usp=sharing
Thư viện Pytorch: https://drive.google.com/file/d/1jwJQ0iYBMHAce0FQBApEwu75il5Ugi2A/view?usp=sharing
Thư viện Tensorflow: https://drive.google.com/file/d/1MTBQwgqd1jBwK_yNGNNIQ4lkKrkaG36z/view?usp=sharing
High Speed with HuggingFace Dataset:
https://colab.research.google.com/drive/1HNLSiDVbgzPzk0Wu1xiPZvgvxcgs_ax8?usp=sharing
1.3. Lập trình tách Ngrams
Click to view more
2. Thuật toán tách token BPE + WordPiece
2.1. Thực hành dùng WordPiece với HuggingFace
2.2. BPE Demo
3. Video Zoom NLP 01
3.1. Video
4. Video Zoom NLP 02
4.1. Video Zoom 02
5. Video Zoom NLP 03
5.1. Zoom NLP 03 - 24-09-2024
1. Giới thiệu Tách token
1.1. Slide
1.2. Thực hành tách từ với các thư viện khác nhau
1.3. Lập trình tách Ngrams
2. Thuật toán tách token BPE + WordPiece
2.1. Thực hành dùng WordPiece với HuggingFace
2.2. BPE Demo
3. Video Zoom NLP 01
3.1. Video
4. Video Zoom NLP 02
4.1. Video Zoom 02
5. Video Zoom NLP 03
5.1. Zoom NLP 03 - 24-09-2024