顯示具有 重複性內容 標籤的文章。 顯示所有文章
顯示具有 重複性內容 標籤的文章。 顯示所有文章

Scraped Content or Content Scraping

Scraped Content這個專有名詞,老實說我不知道如何翻成中文,但根據這個字的表面意思有抄襲內容、收集內容、轉貼內容之意。

至於什麼是Scraped Content呢?

簡單來說,Scraped Content是指非原創性的內容,而內容來源是藉由人工或自動程式取得他人網站的內容,並"可能"藉由附帶性的網址,連結回原內容的網站,取得的方式有些是經過原作者同意,有些是沒有經過同意的。而這裡提到的"可能",視這些Scraper(取得這些內容的人)而定,有些人將取得的內容佔為己有,因此不會附帶原作者網站的連結,而有觀念且尊敬原創的人通常都會附上原作者內容的連結。(附帶一提;雖然附上原作者內容的連結,不一定合法,必須視原作者網站是否有公佈版權聲明或徴得本人同意之)。

搜尋引擎對重複性內容的4個盲點

最近搜尋引擎Google針對內容農場(Content Farm)進行大規模撲"章"的動作,直接影響到一些知名聯合供稿網站(Associated Content Syndication),例如:associatedcontent.com, ezinearticles.com等等,主要為了抑治來自不同網站的大量重複性內容,企圖佔據絕大的搜尋引擎結果排名,除了造成搜尋引擎爬蟲效率的影響外,也讓一些有價值的網站無法浮出抬面,也進一步引起使用者對搜尋引擎的負面觀感。