顯示具有 Sb群發方法 標籤的文章。 顯示所有文章
顯示具有 Sb群發方法 標籤的文章。 顯示所有文章

2013年6月7日 星期五

Sb群發方法之List的數量 X10倍



Sb群發方法之List的數量 X10

一、匯出List到根功能變數名稱url

載入你先前積累好的ListScrapeBox — > 首先去掉重複的功能變數名稱 Remove Duplicate Domains —> 接著Trim to Root
接著把結果匯出來,接下來我要把這些功能變數名稱裡其他的文章頁面也都挖出來,從而達到擴大list數目的目的。
二、根功能變數名稱URL本地處理
接下來要做兩種處理:
(1)、把匯出的根功能變數名稱List前面批量加上Site: 存為list1.txt (目的是挖掘這些功能變數名稱被google收錄的頁面)
(2)、把匯出的根功能變數名稱List末尾批量加上/sitemap.xml 存為list2.txt (目的是利用sitemal工具來挖掘頁面)

三、Scrapebox處理List1.txt
ScrapeboxHarvest模組中選擇Custom Footprint,把List1.txt導入關鍵字清單中,搜尋引擎只選擇google,載入代理,開始搜索吧。
四、ScrapeboxSitemap Scraper 處理List2.txt
ScrapeboxAddons中有個小工具叫Sitemap Scraper ,我們把它安裝一下,執行緒開到100,導入List2.txt,開始Scrape
五、保存結果
搜索完之後,把步驟3和步驟4的結果載入到Scrapebox中,去掉重複的URL,這時候List應該要翻了很多倍了。但是裡面有很多不是文章頁的,要把他們處理掉。
你可以把這個List2-3遍,發送成功的保存下來就是可用的
我一般喜歡用這個來處理自動通過審核的List,因為大多WordPress中一但有一個文章是自動通過的,整站的文章頁都是可以自動通過的。

Sb群發方法收集之採集自己網站中已收錄的文章頁面

Scrapebox裡提供的採集功能來提取自己網站所有被收錄的頁面 (這裡只針對wordpress類型的網站)
1、具體方式是在Harvest模組中選中Custom Footprint
keywords輸入框中輸入 site:yourdomain,你可以輸入很多個功能變數名稱一起採集,掛代理開啟多執行緒採集

採集完成後 去掉重複的URL 然後將list匯出
這些就是網站中被收錄的頁面。 但是這些頁面中會有一些除首頁和文章頁以外的頁面,我們需要過濾一下
非文章頁面的URL一般都有統一的特徵: /about/ ; wp-login.php; /tag/; /page/ 等等 需要把他們所在的URL行都刪除掉
具體方法是可以用一些編輯器用規則運算式來匹配這些URL 然後批量替換掉,比如EditplusDreamweaver
這種用Scrapebox採集已收錄頁面的方法的優點:支持多網站一起采,採集起來超級快
缺點是:會採集一些非文章頁面,需要自己過濾
2. 為採集來的URL指定關鍵字並且生成ScrapeBox可發的websites.txt
URL採集來之後就要給他們指定關鍵字了,但是如果一個一個手動寫依舊是會累死人。。。
懶人方法:使用火車頭採集一遍這些URL列表,並且生成scrapebox可發的Websites格式
簡單說下操作,採集來的URL list導入火車頭,火車頭需要採集保存兩個欄位, URL和關鍵字
關鍵字項可以根據你網站URL的實際情況來採集原始程式碼中的
在採集的時候可以針對採集後的結果做一些字串替換操作,直接就生成scrapebox可發的格式Post或者Trackback
採集完之後匯出csv,大致檢查一下,複製裡面內容保存為文本就可以分發到Scrapebox裡面了