
Google bác bỏ tác dụng của llms-author.txt trong SEO
Đại diện Google khẳng định các tệp như llms-author.txt và thẻ Content-Signal không có tác dụng với công cụ tìm kiếm hay mô hình AI.
Mới đây, John Mueller từ Google đã phản hồi một thắc mắc trên Reddit liên quan đến việc sử dụng tệp llms-author.txt để tối ưu hóa công cụ tìm kiếm (SEO). Cụ thể, người dùng này gặp khó khăn khi tên của họ trùng với hai thực thể nổi bật khác, khiến khách hàng khó tìm thấy dịch vụ của họ trực tuyến.
Để giải quyết vấn đề, người này đã tạo một tệp llms-author.txt ghi rõ chức danh, cơ quan và lĩnh vực hoạt động. Bên cạnh đó, họ thêm thẻ chỉ thị Content-Signal vào tệp robots.txt nhằm khai báo mục đích nội dung cho các mô hình ngôn ngữ lớn (LLM).
For years this meant a chunk of my “who is this person” signal was diluted or outright wrong whenever a model or a search feature tried to summarize me.
FIRST STEP
First, an explicit llms-author.txt file separate from the main llms.txt, stating job title, agency, location and area of practice in plain sentences rather than relying on schema alone to carry that weight.
SECOND STEP
Second, adding the new Content-Signal header (ai-train=no, search=yes, ai-input=yes) to robots.txt, mostly out of curiosity about whether declaring intent at the header level changes anything measurable.
Tuy nhiên, John Mueller cho biết Google không sử dụng llms.txt hay llms-author.txt. Ông cũng lưu ý chưa có trình thu thập dữ liệu (crawler) hay LLM nào xác nhận sử dụng các tệp này, ngoại trừ một số công cụ SEO.
I guess a few things …
Google doesn’t use llms.txt or llms-author.txt. I don’t know of any other crawler / llm confirming they’re using these (other than SEO tools).
AFAIK none of the crawlers / llms use the “content-signal” robots.txt directives. It was made up by a CDN, afaik it has no effects whatsoever for any crawler or llm. Using it just adds bloat & future maintenance to your robots.txt file.
You can also add other arbitrary things to your robots.txt file, crawlers just use the directives that they support and ignore the rest.
Đối với thẻ Content-Signal, vị đại diện Google khẳng định nó hoàn toàn không có tác dụng với crawler hay LLM. Nó vốn được một mạng phân phối nội dung (CDN) tạo ra, và việc sử dụng chỉ làm phình to cũng như tăng gánh nặng bảo trì cho tệp robots.txt. Các crawler sẽ chỉ đọc những chỉ thị mà chúng hỗ trợ và bỏ qua phần còn lại.
Trên thực tế, llms-author.txt không phải là một tiêu chuẩn chính thức. Giới chuyên môn nhận định người dùng Reddit đang cố dùng giải pháp SEO kỹ thuật (technical SEO) cho một vấn đề nằm ngoài phạm vi này. Để khắc phục tình trạng trùng tên, họ cần mở rộng “dấu chân kỹ thuật số” bằng cách xuất hiện nhiều hơn trên video, podcast hoặc các trang web để trở nên nổi tiếng hơn.
Thêm hanthienhai.com vào danh sách nguồn ưu tiên trên Google