Hỏi “google nlp là gì” thì phần lớn người làm SEO đang nói tới một sản phẩm cụ thể: Cloud Natural Language API của Google Cloud, cùng trang demo cho phép dán một đoạn văn vào và xem máy tách ra những thực thể nào, cảm xúc ra sao, thuộc chủ đề gì. Công cụ này hữu ích để nhìn văn bản của mình bằng con mắt của một hệ thống xử lý ngôn ngữ. Nhưng nó không phải thuật toán xếp hạng của Google Search, và bài này sẽ nói rõ ranh giới đó.
Bài viết đi qua các chức năng của API theo tài liệu chính thức, cách đọc chỉ số salience, score, magnitude, một giới hạn lớn với tiếng Việt mà ít bài nhắc tới, và cách dùng các công cụ kiểu Entity Explorer để tra thực thể trong Knowledge Graph.
Google NLP là gì: tên gọi và thứ người ta thực sự nói tới
NLP (Natural Language Processing, xử lý ngôn ngữ tự nhiên) là lĩnh vực chung, không phải của riêng Google. Khi dân SEO nói “Google NLP”, họ thường gộp ba thứ khác nhau:
- Cloud Natural Language API: dịch vụ trả phí theo lượng dùng trên Google Cloud, lập trình viên gọi qua API để phân tích văn bản. Có bản demo dùng thử ngay trên trang sản phẩm.
- Các mô hình ngôn ngữ Google dùng trong Search: ví dụ BERT, được Google công bố áp dụng cho tìm kiếm từ năm 2019. Những mô hình này chạy bên trong hệ thống tìm kiếm, người ngoài không gọi được.
- Knowledge Graph: kho thực thể (người, tổ chức, địa điểm, khái niệm) mà Google dùng để hiển thị bảng tri thức và hiểu mối quan hệ giữa các thực thể.
Ba thứ này có liên quan về ý tưởng, nhưng khác nhau về vai trò. Cloud Natural Language API là thứ duy nhất trong ba cái bạn có thể trực tiếp thử. Vì vậy mọi kết luận rút ra từ demo chỉ nên hiểu là “một mô hình của Google đọc đoạn văn này như vậy”, chứ không phải “Google Search chấm bài của tôi như vậy”.
Google Natural Language API làm được gì
Theo trang Natural Language basics của Google Cloud, API có sáu phương thức phân tích chính. Bạn có thể gọi riêng từng cái, hoặc gọi gộp qua annotateText.
| Phương thức | Trả về gì | SEO dùng để làm gì |
|---|---|---|
| analyzeEntities (phân tích thực thể) | Danh sách thực thể trong văn bản: tên, loại (người, tổ chức, địa điểm, sự kiện, sản phẩm…), độ nổi bật salience, số lần nhắc; một số thực thể kèm liên kết Wikipedia và mã định danh | Xem máy có nhận ra đúng thực thể chính của bài không, hay đang coi một thực thể phụ là trọng tâm |
| analyzeSentiment (cảm xúc) | Điểm score và magnitude cho cả văn bản và từng câu | Soát giọng văn đánh giá sản phẩm, phản hồi khách hàng, bài xử lý khủng hoảng |
| analyzeEntitySentiment | Cảm xúc gắn với từng thực thể | Xem một bài so sánh đang nói tích cực hay tiêu cực về thương hiệu nào |
| analyzeSyntax (cú pháp) | Tách câu, tách từ, từ loại, quan hệ phụ thuộc | Ít dùng trong SEO; hữu ích khi soát câu quá dài, cấu trúc rối |
| classifyText (phân loại nội dung) | Danh mục chủ đề kèm độ tin cậy | Kiểm tra bài có bị hiểu lệch chủ đề không; cần tối thiểu khoảng hai mươi từ để chạy |
| moderateText (kiểm duyệt) | Nhãn nội dung nhạy cảm | Soát nội dung do người dùng gửi, bình luận |
Các chức năng này được thiết kế cho lập trình viên xây ứng dụng: phân loại email hỗ trợ, đọc phản hồi khách hàng, gắn nhãn tài liệu. Việc SEO mượn nó để soi bài viết là một cách dùng phụ, không phải mục đích chính của sản phẩm.
Salience, score, magnitude: đọc kết quả thế nào cho đúng
Salience là con số từ 0 đến 1 cho biết một thực thể quan trọng đến đâu so với toàn bộ văn bản. Thực thể xuất hiện ở tiêu đề, câu mở đầu, làm chủ ngữ nhiều lần thường có salience cao. Tổng salience của mọi thực thể trong một văn bản không nhất thiết cộng lại thành một con số đẹp, nên đừng so salience giữa hai bài khác độ dài như so điểm thi.
Score của phân tích cảm xúc chạy từ âm một (tiêu cực) đến dương một (tích cực). Magnitude đo cường độ cảm xúc, từ không trở lên, và thường tăng theo độ dài văn bản. Tài liệu Google lưu ý rằng API chỉ phân biệt tích cực với tiêu cực, không phân biệt “giận” với “buồn”. Một bài có score gần không nhưng magnitude cao nghĩa là bài chứa nhiều cảm xúc trái chiều triệt tiêu nhau, không phải bài trung tính.
Cách đọc hợp lý: nhìn thứ tự thực thể theo salience. Nếu bài của bạn viết về “dịch vụ SEO tại Hà Nội” mà thực thể đứng đầu lại là tên một công cụ bạn nhắc qua, đó là dấu hiệu phần mở bài hoặc tiêu đề đang kéo trọng tâm lệch đi. Con số tuyệt đối ít ý nghĩa hơn thứ tự.
Giới hạn với tiếng Việt cần biết trước khi dán bài vào demo
Đây là điểm nhiều hướng dẫn bỏ qua. Trang Language support của Cloud Natural Language, kiểm tra cuối tháng 9/2026, chỉ liệt kê tiếng Việt ở bảng phân tích cảm xúc. Các bảng phân tích thực thể, cảm xúc theo thực thể, cú pháp, phân loại nội dung và kiểm duyệt đều không có tiếng Việt.
Hệ quả thực tế:
- Dán một bài tiếng Việt vào để “xem Google nhận ra thực thể nào” có thể không trả kết quả thực thể, hoặc báo ngôn ngữ không được hỗ trợ cho chức năng đó.
- Các công cụ bên thứ ba quảng cáo “chấm điểm entity bằng Google NLP” cho bài tiếng Việt cần được hỏi rõ: họ dịch sang tiếng Anh trước rồi mới phân tích, hay dùng mô hình khác. Kết quả của bản dịch không phản ánh chính xác văn bản gốc.
- Danh sách ngôn ngữ có thể thay đổi. Trước khi xây quy trình dựa trên API, hãy mở lại trang Language support để kiểm.
Với website song ngữ, bạn có thể chạy bản tiếng Anh để soát trọng tâm thực thể, rồi áp nhận xét sang bản tiếng Việt bằng đánh giá của người viết. Đó là cách dùng khiêm tốn nhưng trung thực.
SEO dùng Google NLP như thế nào cho có ích
Khi đã hiểu giới hạn, API vẫn có chỗ dùng trong quy trình nội dung, nhất là với nội dung tiếng Anh hoặc các ngôn ngữ được hỗ trợ đầy đủ:
- Soát trọng tâm bài: thực thể chính có đứng đầu danh sách salience không. Nếu không, sửa tiêu đề, câu mở đầu và các heading để nói thẳng vào chủ đề.
- Soát tên thương hiệu: tên công ty, tên sản phẩm có được nhận là tổ chức hay sản phẩm, hay bị coi là danh từ chung. Tên bị hiểu sai là tín hiệu nên viết rõ ngữ cảnh hơn (ví dụ “công ty X tại Hà Nội” thay vì chỉ “X”).
- So sánh với trang đang xếp hạng: chạy vài trang đứng đầu cho cùng truy vấn để xem họ nhắc những thực thể liên quan nào mà bài mình thiếu. Đây là gợi ý để bổ sung nội dung, không phải danh sách từ phải nhồi.
- Soát giọng văn: trang đánh giá sản phẩm có score tiêu cực bất thường có thể do cách viết so sánh gây hiểu nhầm.
Cách tiếp cận này khớp với tư duy semantic SEO: viết để máy và người cùng hiểu chủ đề, các khái niệm liên quan và quan hệ giữa chúng, thay vì đếm mật độ từ khóa. Bài semantic search và tối ưu ngữ nghĩa giải thích thêm vì sao công cụ tìm kiếm chuyển từ khớp chuỗi ký tự sang hiểu ý nghĩa.
Muốn thương hiệu được máy hiểu đúng là một thực thể?
VIDCO rà cách tên doanh nghiệp, người đại diện và sản phẩm xuất hiện trên website, schema và các nguồn bên ngoài, rồi đề xuất việc cần làm theo thứ tự. Xem gói tại trang dịch vụ entity hoặc gửi brief để được tư vấn.
Điều Google NLP không nói với bạn
Cần nói thẳng: Cloud Natural Language API là một sản phẩm thương mại của Google Cloud, không phải cửa sổ nhìn vào hệ thống xếp hạng của Google Search. Google chưa bao giờ tuyên bố hai hệ thống dùng chung mô hình hay chung cách chấm. Vì vậy:
- Salience cao không có nghĩa bài sẽ lên hạng. Thứ hạng còn phụ thuộc mức độ trả lời đúng ý định tìm kiếm, độ tin cậy của trang và tên miền, trải nghiệm trang, liên kết và nhiều yếu tố khác.
- “Điểm NLP” mà một số công cụ đưa ra là chỉ số do chính công cụ đó đặt ra. Tối ưu cho điểm đó là tối ưu cho công cụ, không phải cho Google.
- Viết lại câu chỉ để đẩy salience một từ lên thường làm bài khó đọc. Người đọc khó chịu thì mọi con số khác cũng vô nghĩa.
Hãy coi API như một người đọc thử máy móc: nó chỉ ra chỗ bài của bạn mơ hồ, còn quyết định sửa thế nào vẫn thuộc về người viết.
Entity Explorer và Knowledge Graph Search API
“Entity Explorer” là tên chung người ta gọi các công cụ tra cứu thực thể trong Knowledge Graph của Google. Phần lớn chúng được dựng trên Knowledge Graph Search API, một API chính thức của Google. Theo tài liệu tại developers.google.com, API này:
- Cho phép tìm thực thể trong Google Knowledge Graph, trả về theo kiểu schema.org và định dạng JSON-LD.
- Chỉ đọc, không cho thêm hay sửa thực thể.
- Trả về từng thực thể riêng lẻ kèm trường resultScore, không trả về cả đồ thị quan hệ giữa các thực thể.
- Được Google ghi rõ là không phù hợp làm dịch vụ quan trọng trong sản phẩm; Google cũng đang chuyển người dùng mới sang Cloud Enterprise Knowledge Graph.
Với SEO, công cụ kiểu Entity Explorer trả lời một câu hỏi đơn giản: thương hiệu, người sáng lập hay sản phẩm của bạn đã có mặt trong Knowledge Graph như một thực thể chưa, được gán loại gì (Organization, Person…), mô tả ra sao. Nếu chưa có, việc cần làm là xây dấu vết thực thể nhất quán: trang giới thiệu rõ ràng, schema Organization với sameAs trỏ tới các hồ sơ chính thức, thông tin khớp nhau giữa website, Google Business Profile, báo chí và mạng xã hội. Bài Knowledge Graph và thực thể thương hiệu và Entity SEO là gì đi sâu vào phần này.
Một lưu ý: không tìm thấy trong API không có nghĩa Google hoàn toàn không biết bạn. API chỉ trả một phần dữ liệu và có thể chậm hơn những gì hiển thị trên kết quả tìm kiếm.
Quy trình năm bước dùng Google NLP và Entity Explorer
| Bước | Việc làm | Kết quả cần có |
|---|---|---|
| 1 | Xác định thực thể chính của trang và vài thực thể liên quan bắt buộc phải nhắc | Danh sách ngắn viết trước khi mở công cụ |
| 2 | Chạy bản tiếng Anh (hoặc ngôn ngữ được hỗ trợ) qua demo Natural Language | Thứ tự thực thể theo salience, loại thực thể |
| 3 | So thứ tự đó với danh sách ở bước 1 | Chỗ lệch trọng tâm: tiêu đề, mở bài, heading cần sửa |
| 4 | Tra thương hiệu và người đại diện bằng công cụ dựa trên Knowledge Graph Search API | Biết đã có thực thể hay chưa, loại và mô tả |
| 5 | Sửa nội dung và schema, đo lại bằng Search Console sau vài tuần | Thay đổi về hiển thị và truy vấn liên quan, không phải điểm công cụ |
Câu hỏi thường gặp
Google NLP có phải yếu tố xếp hạng không?
Không. Cloud Natural Language API là dịch vụ của Google Cloud. Google Search dùng hệ thống riêng và chưa từng công bố rằng kết quả của API này được dùng để xếp hạng trang.
Dùng demo Google Natural Language API có mất phí không?
Trang demo trên website sản phẩm cho dùng thử với đoạn văn ngắn. Gọi API qua mã nguồn cần tài khoản Google Cloud và được tính phí theo lượng dùng, có hạn mức miễn phí; hãy xem trang giá hiện hành trước khi chạy số lượng lớn.
Vì sao dán bài tiếng Việt vào không thấy thực thể?
Vì tại thời điểm viết, tiếng Việt chỉ được hỗ trợ ở phân tích cảm xúc. Phân tích thực thể và phân loại nội dung chưa có tiếng Việt trong danh sách ngôn ngữ chính thức.
Entity Explorer khác Google NLP thế nào?
Google NLP phân tích một đoạn văn bạn đưa vào. Entity Explorer tra cứu kho thực thể sẵn có của Google qua Knowledge Graph Search API. Một cái đọc văn bản của bạn, một cái cho biết Google đã ghi nhận những thực thể nào.
Doanh nghiệp nhỏ có cần quan tâm tới thực thể không?
Có, ở mức cơ bản: tên, địa chỉ, số điện thoại, người đại diện, lĩnh vực phải nhất quán trên website và các hồ sơ bên ngoài. Việc này rẻ và giúp cả người dùng lẫn công cụ tìm kiếm nhận diện đúng doanh nghiệp.
Cần rà thực thể thương hiệu trước khi đầu tư nội dung?
Gửi tên miền và tên pháp nhân. VIDCO kiểm tra thương hiệu đã được nhận diện ra sao và đề xuất các việc entity nên làm trước.
Xem thêm: dịch vụ entity của VIDCO.