Cấu trúc liên kết (URL)
Cũng như việc công cụ chọn kiếm đề nghị nhìn thấy nội dung để phân dòng theo từ khóa và lập một số chỉ mục, chúng cũng đề nghị nhìn thấy liên kết để chọn thấy các nội dung đó. một cấu trúc liên kết giúp vài spider xem lướt một vài kết nối trong web và thu thập thông tin – là khía cạnh sống còn đối với việc chọn thấy những trang trong của web ấy. Hàng trăm ngàn website đã phạm buộc phải sai lầm nghiêm trọng khi cố tình giấu hay phức tạp hoá một vài định hướng bằng rộng rãi mẹo khác nhau để công cụ tìm kiếm không thể truy cập, từ đấy gây ảnh hưởng tới khả năng liệt kê trang web trong sổ mục của công cụ tìm kiếm.
Chúng tôi minh hoạ vấn đề này như sau:
Trong ví dụ trên, spider của Google đã tiếp cận được trang "A" và trông thấy liên kết dẫn tới các trang "B" và "E". Tuy nhiên, dù trang C và D cũng là một số trang siêu quan trọng trên web nhưng spider ko chọn thấy liên kết để tiếp cận chúng (và thậm chí còn không biết chúng đang hiện hữu). ấy là vì ko với "liên kết trực tiếp và sở hữu thể thu thập" nào dẫn tới những trang này. Theo Google, một vài trang web này ko tồn tại – nội dung đảm bảo, chọn từ khóa thấp, quảng bá tối ưu, rất nhiều sẽ là con số không tròn trĩnh giả dụ ngay từ đầu những spider đã không thu thập được những trang này.
vài thành phần của 1 liên kết
Trong hình minh hoạ trên, thẻ "<a" là phần bắt đầu của 1 liên kết. vài thẻ liên kết mang thể chứa cất hình ảnh, văn bản hay một vài khía cạnh khác. rất nhiều những thành phần ấy tạo ra 1 khu vực mang thể nhấp chuột được trên trang web và khách hàng có thể nhấp vào đó để chuyển đến 1 trang khác. Đây là chi tiết định hướng cơ bản của Internet – "các cực kỳ liên kết". Phần 'href' báo cho trình duyệt (và công cụ chọn kiếm) biết liên kết sẽ trỏ đến đâu. Trong ví dụ này, đấy chính là URL http://www.jonwye.com. Tiếp theo, là phần liên kết khách truy cập mang thể nhìn thấy, được dân tối ưu hóa gọi là "văn bản liên kết", giúp miêu tả trang website mà liên kết này trỏ tới. Trang web được trỏ đến nói về "belt" (dây nịt), được thiết kế bởi một người quý khách của tôi sống ở Washington D.C., John Wye, do vậy tôi sử dụng đoạn liên kết "Jon Wye's Custom Designed Belts". Thẻ </a> kết thúc liên kết, nghĩa là, một vài thành phần khác (phía sau </a>) của trang website sẽ không được liên kết tới.
Đây là định dạng cơ bản nhất của một liên kết – và cực kỳ dễ hiểu đối mang công cụ chọn kiếm. vài spider biết rằng chúng yêu cầu lưu liên kết này vào biểu đồ liên kết của trang website mà công cụ tìm kiếm đã thu thập, tiêu dùng nó để đánh giá một số biến số truy vấn độc lập (như PageRank của Google), và đi theo nó để đánh chỉ mục nội dung của trang web được trỏ tới.
cộng Xem qua vài lí do nhiều làm trang website của mọi người ko thể truy cập
vài hình thức phải đăng kí
giả dụ mọi người buộc người mua phải hoàn tất thủ tục đăng kí trực tuyến trước khi truy cập một nội dung nào ấy, với thể công cụ tìm kiếm sẽ không bao giờ trông thấy một vài trang web được bảo vệ quá kĩ này. Thao tác đăng kí mang thể ngắn gọn như nhập password để đăng nhập, hoặc dài cái như 1 bản khảo sát nghiên cứu. Trong cả hai giả dụ, một vài spider sẽ ko phấn đấu đi "đăng kí", do vậy, bất cứ nội dung hay liên kết nào chỉ có thể được truy cập sau khi đăng kí đều trở nên vô hình đối với công cụ chọn kiếm.
các liên kết với định dạng Javascript ko thể phân tích
trường hợp bạn dùng Javascript cho liên kết, khách hàng sẽ nhận thấy, vài công cụ chọn kiếm không thể thu thập hoặc sẽ đánh giá thấp giá trị của những liên kết được nhúng bên trong. Chính do vậy, người mua buộc phải tiêu dùng một số liên kết HTML tiêu chuẩn thay thế Javascript (hoặc sử dụng kèm theo) cho một số trang khách hàng muốn spider thu thập.
Liên kết trỏ tới những thiết bị khóa bởi thẻ meta robot hay robots.txt
Thẻ Meta Robots và tệp tin tức Robots.txt cho phép chủ web ngăn một vài spider tiếp cận trang website của họ. khách hàng đề nghị cẩn thận vì khá đa dạng những webmaster đã vô tình tiêu dùng chức năng này vì nghĩ rằng sở hữu thể ngăn chặn các bot lừa đảo, nhưng rốt cuộc, chính các công cụ tìm kiếm lại ko thể thu thập tin tức.
Liên kết tiêu dùng Frame hoặc I-frame
Về mặt kĩ thuật, một vài liên kết dùng frame hay I-frame đều mang thể thu thập được, nhưng cả hai đều gây cạnh tranh về mặt cấu trúc cho những công cụ tìm kiếm khi chúng muốn tổ chức và đi theo liên kết đó. Trừ phi người dùng là chuyên gia có kiến thức kĩ thuật phải chăng và hiểu biết cặn kẽ về qui trình đánh chỉ mục và đi theo liên kết của công cụ chọn kiếm thì hãy sử dụng. ví như ko, thấp nhất khách hàng đề nghị tránh xa chúng.
Robots ko tiêu dùng hình thức tìm kiếm
Mặc dù điều này cũng gần giống như hình thức đăng kí đã nói bên trên, nhưng chúng tôi vẫn nên nhắc lại vì đây là lỗi siêu rộng rãi. một vài webmaster sự kiện rằng ví như họ đặt 1 khung tìm kiếm trên web, lúc ấy công cụ chọn kiếm sở hữu thể chọn thấy phần lớn tin tức khách truy cập đã tìm kiếm. Nhưng thật ko may khi một số spider sẽ không tìm mọi cách thực hiện thao tác tìm kiếm. bây giờ người ta ước đoán có hàng triệu trang web ko được thu thập vì bị chặn bởi một vài bức tường "đăng kí" hoặc "tìm kiếm". Chúng vẫn vô danh cho đến lúc với một trang nào đó (đã được thu thập) liên kết trực tiếp có chúng.
những liên kết dạng flash, java hay vài plug-in khác
một vài liên kết được nhúng vào web Panda (trong ví dụ trên) là một minh họa rõ nét cho hiện tượng này. Mặc dù hàng tá con panda được liệt kê và liên kết đến trang Panda, nhưng không spider nào có thể tiếp cận chúng thông qua cấu trúc liên kết của website được, làm cho chúng vô hình đối mang công cụ chọn kiếm (cũng không thể hiển thị cho người thực hiện truy vấn chọn kiếm).
Liên kết trên những trang có hàng trăm hàng ngàn liên kết
vài công cụ tìm kiếm mang thể thu thập đầy đủ liên kết trên 1 trang bất kì, nhưng không có nghĩa là vô hạn. Chúng chỉ thu thập nội dung một số website mang vài lượng liên kết nhất định, và nguyên tắc này siêu thiết yếu trong việc giảm thiểu spam và bảo vệ đồ vật hạng website. vài trang web chứa hàng trăm liên kết ko có nghĩa số đông vài liên kết trên trang đều được thu thập và đánh chỉ mục.
nếu giảm thiểu được các "cạm bẫy" trên, người dùng sẽ có được vài liên kết HTML thân thiện có spider, giúp chúng dễ dàng truy cập nội dung trên một số trang web của khách hàng
Thẻ rel="nofollow"
Thẻ rel="nofollow" có thể được dùng trong cú pháp sau:
<a href="http://www.seomoz.org" rel="nofollow">Lousy Punks!</a>
người mua với thể chèn nhiều thuộc tính vào liên kết, nhưng công cụ chọn kiếm hầu như lờ đi rất nhiều, nếu tất cả mọi người sử dụng thẻ rel="nofollow". Trong ví dụ trên, bằng phương pháp chèn thêm thuộc tính rel="nofollow" vào thẻ liên kết, chúng ta đề cập với công cụ chọn kiếm rằng, chúng ta – một vài người chủ website, không muốn liên kết này được đánh giá như một liên kết bình thường, "một lá phiếu bình chọn".
Nofollow – ko theo – hiểu theo đúng nghĩa đen, là 1 dấu hiệu để công cụ tìm kiếm không thu thập liên kết (dù đôi khi vẫn được thu thập). Thẻ nofollow được xem là mẹo giúp ngăn chặn một số comment tự động trên blog, guestbook, và các spam liên kết, nhưng nó dần biến đổi để "kiêm luôn chức năng" báo cho công cụ tìm kiếm biết những giá trị liên kết nào chúng nên xóa bỏ. Mỗi công cụ tìm kiếm sẽ có mẹo phân tích 'các liên kết gắn thẻ nofollow' khác nhau, nhưng vài liên kết này kèm theo không với giá trị cao như một số liên kết dofollow khác.
có bắt buộc Liên Kết Nofollow Nào Cũng Xấu?
Dù chúng ko chứa phổ biến giá trị như các liên kết anh em "dofollow" khác, những liên kết "nofollow" cũng là 1 phần tự dưng của 1 cấu trúc liên kết đa dạng. 1 website có đầy đủ inbound link sẽ dần tích lũy nhiều liên kết 'không theo', và đây ko phải là vấn đề gì tồi tệ. Thật ra, SEOmoz đã chỉ ra rằng các website mang đồ vật hạng cao hơn sở hữu tỉ lệ phần trăm inbound link 'nofollow' cao hơn các webite mang thứ hạng phải chăng hơn.
Đối có Google
Google khẳng định trong số đông vài ví như, họ ko đi theo một số liên kết 'nofollow', và các liên kết này cũng không chế tạo giá trị cho PageRank hoặc liên kết văn bản. Thông thường, việc sử dụng tính năng nofollow là để chiếc bỏ một vài liên kết cụ thể nào đó ra khỏi biểu đồ tổng thể của web. Liên kết nofollow ko đựng giá trị và ko được xem là văn bản HTML (như thể liên kết chẳng phải tồn tại). Tuy nhiên, ko ít webmaster vẫn 1 mực thông tin rằng 1 liên kết nofollow tới từ website với độ uy tín cao, như Wikipedia, vẫn góp phần tạo phải chất lượng cho trang web của họ.
Đối với Bing & Yahoo!
Bing, quản lí kết quả tìm kiếm trên Yahoo, cũng khẳng định rằng họ ko kể liên kết nofollow vào biểu đồ liên kết. Trước đây, họ từng tuyên bố vẫn tiêu dùng liên kết nofollow để giúp một vài crawler thu thập trang web mới. Điều đó với nghĩa, tuy họ "có thể" đi theo liên kết này, nhưng không xem chúng là mẹo giúp cải thiện thiết bị hạng cho website.






0 nhận xét:
Đăng nhận xét