Về công cụ này
Số ký tự và từ hữu ích cho bài viết, bài đăng, thẻ SEO và biểu mẫu có giới hạn. Độ dài byte (UTF-8) quan trọng với cơ sở dữ liệu và tin nhắn khi ký tự không phải ASCII chiếm nhiều byte.
Dán hoặc gõ văn bản để đếm ký tự, từ và hơn thế ngay lập tức.
Số ký tự và từ hữu ích cho bài viết, bài đăng, thẻ SEO và biểu mẫu có giới hạn. Độ dài byte (UTF-8) quan trọng với cơ sở dữ liệu và tin nhắn khi ký tự không phải ASCII chiếm nhiều byte.
Để đếm ký tự, cộng từng chữ cái, chữ số, dấu câu và khoảng trắng trong văn bản; để đếm không tính khoảng trắng, trừ số khoảng trắng khỏi tổng đó. Ví dụ: "Xin chào thế giới!" có 18 ký tự tổng cộng và 15 ký tự nếu không tính khoảng trắng.
Có, số ký tự mặc định tính cả khoảng trắng; mục riêng 'không khoảng trắng' hiển thị số sau khi trừ khoảng trắng. Ví dụ: 'Hello, world!' có 13 ký tự tổng cộng, 12 ký tự nếu bỏ khoảng trắng (trừ 1 khoảng trắng).
3 byte. '안녕하세요' (5 ký tự tiếng Hàn) được công cụ này tính là 15 byte.
Một emoji như 😀 được tính là 1 ký tự nhưng chiếm 4 byte trong UTF-8 -- nhiều hơn hẳn một chữ cái ASCII (chỉ 1 byte).
Không. Công cụ này chỉ tính dung lượng byte UTF-8 qua Blob API của trình duyệt. Trong UTF-8, một ký tự tiếng Hàn chiếm 3 byte; còn trong bảng mã cũ EUC-KR (vẫn được một số hệ thống Hàn Quốc dùng), cùng ký tự đó chỉ chiếm 2 byte -- nên giới hạn ký tự theo EUC-KR không thể so trực tiếp với số byte UTF-8 của công cụ này.
Tính theo các nhóm dấu kết thúc câu (., !, ? và dạng full-width 。!?) trong văn bản. Một đoạn văn không có dấu câu như vậy vẫn được tính là một câu.
Bằng cách tách văn bản theo khoảng trắng -- mỗi chuỗi ký tự liên tục không phải khoảng trắng, nằm giữa hai khoảng trắng, được tính là một từ.
Tùy theo từng tổ chức và nền tảng -- có nơi tính cả khoảng trắng, có nơi không, và giới hạn (500, 1000, 1500 ký tự...) cũng khác nhau theo từng nhà tuyển dụng hoặc trường học. Không có một con số chung, hãy luôn kiểm tra thông báo cụ thể của nơi bạn nộp hồ sơ.
4 ký tự, 5 byte theo UTF-8 -- riêng chữ é có dấu đã chiếm 2 byte, còn 3 chữ cái ASCII thường mỗi chữ chiếm 1 byte.
| Văn bản | Ký tự | Không tính khoảng trắng | Byte (UTF-8) |
|---|---|---|---|
| Xin chào thế giới! | 18 | 15 | 23 |
| cà phê sữa đá | 13 | 10 | 19 |
| Trăm năm trong cõi người ta, chữ tài chữ mệnh khéo là ghét nhau. | 64 | 51 | 80 |
| Việt Nam | 8 | 7 | 10 |
| Thẻ meta description SEO nên giữ dưới 160 ký tự để hiển thị đầy đủ trên kết quả tìm kiếm | 88 | 69 | 120 |
Mỗi chữ cái, chữ số, dấu câu, khoảng trắng và ký tự xuống dòng được tính là một ký tự. Emoji và chữ có dấu mỗi loại chỉ tính là một ký tự, dù chúng có thể chiếm nhiều byte khi lưu trữ.
Số ký tự đo các đơn vị văn bản hiển thị, còn số byte (UTF-8) đo dung lượng lưu trữ. Chữ cái ASCII như trong "Hello" dùng 1 byte mỗi ký tự, nhưng tiếng Việt có dấu, tiếng Hàn, tiếng Trung và nhiều ký tự khác dùng 2-4 byte mỗi ký tự, nên số byte thường cao hơn nhiều.
Giới hạn khác nhau tùy nền tảng: X (trước đây là Twitter) cho phép 280 ký tự mỗi bài đăng, một đoạn SMS giới hạn 160 ký tự, và thẻ meta description thường nên giữ dưới khoảng 155-160 ký tự để hiển thị đầy đủ trên kết quả tìm kiếm. Luôn kiểm tra giới hạn hiện hành của nền tảng cụ thể.
Câu được đếm bằng cách nhận diện các cụm dấu kết thúc câu (dấu chấm, dấu chấm than, dấu chấm hỏi) trong văn bản. Một đoạn văn bản không có dấu kết thúc câu nào vẫn được tính là một câu.
Số ký tự và số byte được tính khi bạn gõ, dựa trên độ dài văn bản Unicode chuẩn và dung lượng byte UTF-8; kết quả có thể hơi khác với bộ đếm riêng của một nền tảng nào đó nếu nền tảng đó dùng bảng mã khác hoặc tính emoji thành nhiều đơn vị.
Sources: RFC 3629 - UTF-8, a transformation format of ISO 10646, The Unicode Standard
Cập nhật lần cuối: 2026-08-17