Как закрыться от семраша, ахрефса и т.д.? - Форум успешных вебмастеров - GoFuckBiz.com - Страница 2
 
 
Форум успешных вебмастеров - GoFuckBiz.com

  Форум успешных вебмастеров - GoFuckBiz.com > Бизнес-решения > Скрипты, программы и технические решения
Дата
USD/RUB89.7026
BTC/USD67702.8803
Скрипты, программы и технические решения Обсуждаем скрипты, программы и новые технологии.

Закрытая тема
Опции темы Опции просмотра
Старый 18.01.2016, 13:47
Start Post: Как закрыться от семраша, ахрефса и т.д.? 
  #11
Maximus325
Технодаун
 
Регистрация: 11.05.2007
Сообщений: 10,384
Бабло: $1503235
Question

Есть у кого готовое проверенное решение?
Они robots.txt чтут? Или по ua через htaccess надо? Хитроботы у них есть?
Речь про свои сателлиты с которых будет продвигаться основной проект.
__________________
ноу криминалити ин раша
Maximus325 вне форума  
Старый 18.01.2016, 17:14   #12
blackforest
Ебланнед
 
Регистрация: 21.01.2009
Сообщений: 285
Бабло: $55970
По умолчанию

В .htaccess использую такую конструкцию:


More


Ботов можно добавить. При помощи этой хрени снизил более чем в два раза нагрузку на сервер, только за счет фильтра лишних ботов. Оригинал линк: __https://perishablepress.com/ultimate-htaccess-blacklist/
__________________
Ссылки на ваши сайты - 20000 ссылок за $10. При заказе более 100 тыс. ссылок - скидки.
Сделаю сайты-многостраничники на любом языке. Цены от бесплатно до $15.

Последний раз редактировалось admin; 21.01.2016 в 14:14.
blackforest вне форума  
Старый 18.01.2016, 17:21   #13
Matt Cutts
Senior Member
 
Регистрация: 24.09.2009
Сообщений: 821
Бабло: $106455
По умолчанию

Использовать apache для блокировки ботов нецелезообразно, когда есть nginx, fail2ban

nginx большой код, который вообще практически не грузит систему

Код:
if ($http_user_agent ~ "Python-urllib|Spinn3r|SISTRIX|Morfeus|Toata|MJ12bot|QuerySeekerSpider|JikeSpider|proximic|Sosospider|Sogou web spider|aesop_com_spiderman|alexibot|backweb|batchftp|bigfoot|black.hole|blackwidow|blowfish|botalot|buddy|builtbottough|bullseye|cheesebot|cherrypicker|chinaclaw|collector|copier|copyrightcheck|cosmos|crescent|custo|da|diibot|disco|dittospyder|dragonfly|drip|easydl|ebingbong|ecatch|eirgrabber|emailcollector|emailsiphon|emailwolf|erocrawler|exabot|eyenetie|filehound|flashget|flunky|frontpage|getright|getweb|go.?zilla|go-ahead-got-it|gotit|grabnet|grafula|harvest|hloader|hmview|httplib|httrack|humanlinks|ilsebot|infonavirobot|infotekies|intelliseek|interget|iria|jennybot|jetcar|joc|justview|jyxobot|kenjin|keyword|larbin|leechftp|lexibot|lftp|libweb|likse|linkscan|linkwalker|lnspiderguy|lwp|magnet|mag-net|markwatch|mata.hari|memo|microsoft.url|midown.tool|miixpc|mirror|missigua|mister.pix|moget|mozilla.newt|nameprotect|navroad|backdoorbot|nearsite|net.?vampire|netants|netcraft|netmechanic|netspider|nextgensearchbot|attach|nicerspro|nimblecrawler|npbot|octopus|offline.?explorer|offline.navigator|openfind|outfoxbot|pagegrabber|papa|pavuk|pcbrowser|php.?version.?tracker|pockey|propowerbot|prowebwalker|psbot|pump|queryn|recorder|realdownload|reaper|reget|true_robot|repomonkey|rma|internetseer|sitesnagger|siphon|slysearch|smartdownload|snake|snapbot|snoopy|sogou|spacebison|spankbot|spanner|sqworm|superbot|superhttp|surfbot|asterias|suzuran|szukacz|takeout|teleport|telesoft|the.intraformant|thenomad|tighttwatbot|titan|urldispatcher|turingos|turnitinbot|urly.warning|vacuum|vci|voideye|whacker|libwww-perl|widow|wisenutbot|wwwoffle|xaldon|xenu|zeus|zyborg|anonymouse|zip|emaile|enhancer|fetch|go.?is|auto|bandit|clip|copier|master|sauger|site.quester|whack|craftbot|download|extract|stripper|sucker|ninja|clshttp|webspider|leacher|grabber|webpictures|Jakarta|User-Agent|libwww|lwp-trivial|PHPCrawl|WEP Search|Missigua Locator|ISC Systems iRc|Aboundex|360Spider|Java|Cogentbot|BunnySlippers|Cegbfeieh|AIBOT|Demon|Devil|Wonder|Foobot|Kenjin Spider|Density|LinkextractorPro|LWP::Simple|MassDownloader|Mass Downloader|NetZIP|NG|Metasearch|WebFetch|WebCopier|Webclipping|WebBandit|WebAuto|WebGo|Web.Image.Collector|WebLeacher|WebmasterWorldForumBot|WebReaper|WebSauger|eXtractor|Webster|WebStripper|WebWhacker|WebZIP|Catall Spider|AcoiRobot|rogerbot|mj12bot|Ahrefsbot|Zite|TweetmemeBot|woriobot|topsy|js-kit|NING") {return 400;}
разместить в секции server
Matt Cutts вне форума  
Старый 18.01.2016, 18:24   #14
buratin0
Mr. Lucky Guy
 
Аватар для buratin0
 
Регистрация: 27.07.2010
Адрес: RU -> DE -> Asia
Сообщений: 706
Бабло: $175250
Отправить сообщение для buratin0 с помощью ICQ
По умолчанию

юзал для pbn на wp этот плагин топик на БХВ

Основная цель была - скрыть от гугла беки. Наверное, наивно, но ни один из чекеров беки не обнаружил за год
buratin0 на форуме  
Старый 19.01.2016, 12:42   #15
Irbs
Юниор
 
Регистрация: 26.07.2014
Сообщений: 12
Бабло: $2760
По умолчанию

а если закроешь - со временем в сервисах обнулятся бэки или так и висеть будут?
Irbs вне форума  
Старый 24.01.2016, 07:16   #16
chesser
автоматизирую интернеты
 
Аватар для chesser
 
Регистрация: 05.07.2009
Адрес: chesser.ru
Сообщений: 3,362
Бабло: $470735
По умолчанию

Цитата:
Сообщение от Matt Cutts
Использовать apache для блокировки ботов нецелезообразно, когда есть nginx
+1

мой опыт: http://www.gofuckbiz.com/showpost.ph...26&postcount=2 , файл custom/bad_ua

через map имхо более аккуратно выглядит, чем через большущий regexp в одну строчку, хотя результат примерно одинаковый.
__________________
USA и NL серверы и VPS | wiki | блог | Drupal | NginxТДС
Ave, Google, morituri te salutant! © chesser
chesser вне форума  
Старый 25.01.2016, 21:31   #17
darksoul
Senior Member
 
Аватар для darksoul
 
Регистрация: 30.09.2014
Сообщений: 840
Бабло: $180224
Отправить сообщение для darksoul с помощью ICQ Отправить сообщение для darksoul с помощью Telegram Отправить сообщение для darksoul с помощью Jabber
По умолчанию

Цитата:
Сообщение от buratin0 Посмотреть сообщение
юзал для pbn на wp этот плагин топик на БХВ

Основная цель была - скрыть от гугла беки. Наверное, наивно, но ни один из чекеров беки не обнаружил за год
Зачем придумывать велосипед ?

Самое адекватное решение, которое уже работает достаточно долго и проверенно лично.
Пауки в гости не лезут, если чо и можно спалить - то только через гугль вебмастер.
darksoul вне форума  
Старый 25.01.2016, 21:54   #18
GrifMK
Senior Member
 
Аватар для GrifMK
 
Регистрация: 27.01.2013
Сообщений: 268
Бабло: $54315
По умолчанию

Цитата:
Сообщение от Matt Cutts Посмотреть сообщение
Использовать apache для блокировки ботов нецелезообразно, когда есть nginx, fail2ban

nginx большой код, который вообще практически не грузит систему

Код:
if ($http_user_agent ~ "Python-urllib|Spinn3r|SISTRIX|Morfeus|Toata|MJ12bot|QuerySeekerSpider|JikeSpider|proximic|Sosospider|Sogou web spider|aesop_com_spiderman|alexibot|backweb|batchftp|bigfoot|black.hole|blackwidow|blowfish|botalot|buddy|builtbottough|bullseye|cheesebot|cherrypicker|chinaclaw|collector|copier|copyrightcheck|cosmos|crescent|custo|da|diibot|disco|dittospyder|dragonfly|drip|easydl|ebingbong|ecatch|eirgrabber|emailcollector|emailsiphon|emailwolf|erocrawler|exabot|eyenetie|filehound|flashget|flunky|frontpage|getright|getweb|go.?zilla|go-ahead-got-it|gotit|grabnet|grafula|harvest|hloader|hmview|httplib|httrack|humanlinks|ilsebot|infonavirobot|infotekies|intelliseek|interget|iria|jennybot|jetcar|joc|justview|jyxobot|kenjin|keyword|larbin|leechftp|lexibot|lftp|libweb|likse|linkscan|linkwalker|lnspiderguy|lwp|magnet|mag-net|markwatch|mata.hari|memo|microsoft.url|midown.tool|miixpc|mirror|missigua|mister.pix|moget|mozilla.newt|nameprotect|navroad|backdoorbot|nearsite|net.?vampire|netants|netcraft|netmechanic|netspider|nextgensearchbot|attach|nicerspro|nimblecrawler|npbot|octopus|offline.?explorer|offline.navigator|openfind|outfoxbot|pagegrabber|papa|pavuk|pcbrowser|php.?version.?tracker|pockey|propowerbot|prowebwalker|psbot|pump|queryn|recorder|realdownload|reaper|reget|true_robot|repomonkey|rma|internetseer|sitesnagger|siphon|slysearch|smartdownload|snake|snapbot|snoopy|sogou|spacebison|spankbot|spanner|sqworm|superbot|superhttp|surfbot|asterias|suzuran|szukacz|takeout|teleport|telesoft|the.intraformant|thenomad|tighttwatbot|titan|urldispatcher|turingos|turnitinbot|urly.warning|vacuum|vci|voideye|whacker|libwww-perl|widow|wisenutbot|wwwoffle|xaldon|xenu|zeus|zyborg|anonymouse|zip|emaile|enhancer|fetch|go.?is|auto|bandit|clip|copier|master|sauger|site.quester|whack|craftbot|download|extract|stripper|sucker|ninja|clshttp|webspider|leacher|grabber|webpictures|Jakarta|User-Agent|libwww|lwp-trivial|PHPCrawl|WEP Search|Missigua Locator|ISC Systems iRc|Aboundex|360Spider|Java|Cogentbot|BunnySlippers|Cegbfeieh|AIBOT|Demon|Devil|Wonder|Foobot|Kenjin Spider|Density|LinkextractorPro|LWP::Simple|MassDownloader|Mass Downloader|NetZIP|NG|Metasearch|WebFetch|WebCopier|Webclipping|WebBandit|WebAuto|WebGo|Web.Image.Collector|WebLeacher|WebmasterWorldForumBot|WebReaper|WebSauger|eXtractor|Webster|WebStripper|WebWhacker|WebZIP|Catall Spider|AcoiRobot|rogerbot|mj12bot|Ahrefsbot|Zite|TweetmemeBot|woriobot|topsy|js-kit|NING") {return 400;}
разместить в секции server

А можно разжевать в какой файл и в какой форме ставить?
А то что-т не выходит каменный цветок. Нигс запускаться после моих манипуляций отказывается.
GrifMK вне форума  
Старый 26.01.2016, 03:11   #19
chesser
автоматизирую интернеты
 
Аватар для chesser
 
Регистрация: 05.07.2009
Адрес: chesser.ru
Сообщений: 3,362
Бабло: $470735
По умолчанию

Цитата:
Сообщение от GrifMK
А можно разжевать в какой файл и в какой форме ставить?
/etc/nginx/nginx.conf - это главный файл настроек nginx, в который инклудятся другие файлы, в том числе с настройками каждого домена или группы доменов, и в них есть код вида:

server {
...................
server_name chesser.ru;
...................
blablabla
...................
...................
...................
}

вставляешь эту строчку с "if ($http_user_agent ~ "Python-urllib|S......" после "server_name chesser.ru;" , перегружаешь nginx

сами файлы с настройками доменов часто находятся в /etc/nginx/conf.d/
но если у тебя панель(direct admin, ispmanager, cpanel), то она подключает эти файлы из своей директории, поэтому лучше настраивать согласно правилам конфигурирования nginx-шаблонов конкретной панели.

http://nginx.org/ru/docs/http/ngx_ht...module.html#if
__________________
USA и NL серверы и VPS | wiki | блог | Drupal | NginxТДС
Ave, Google, morituri te salutant! © chesser
chesser вне форума  
Старый 26.01.2016, 10:42   #20
GrifMK
Senior Member
 
Аватар для GrifMK
 
Регистрация: 27.01.2013
Сообщений: 268
Бабло: $54315
По умолчанию

Цитата:
Сообщение от chesser Посмотреть сообщение
/etc/nginx/nginx.conf - это главный файл настроек nginx, в который инклудятся другие файлы, в том числе с настройками каждого домена или группы доменов, и в них есть код вида:

server {
...................
server_name chesser.ru;
...................
blablabla
...................
...................
...................
}

вставляешь эту строчку с "if ($http_user_agent ~ "Python-urllib|S......" после "server_name chesser.ru;" , перегружаешь nginx

сами файлы с настройками доменов часто находятся в /etc/nginx/conf.d/
но если у тебя панель(direct admin, ispmanager, cpanel), то она подключает эти файлы из своей директории, поэтому лучше настраивать согласно правилам конфигурирования nginx-шаблонов конкретной панели.

http://nginx.org/ru/docs/http/ngx_ht...module.html#if
Серв. С вестой.
Спасибо. ПОпробую.
GrifMK вне форума  
Старый 02.02.2016, 04:16   #21
Latium
Member
 
Регистрация: 01.11.2013
Сообщений: 36
Бабло: $8760
По умолчанию

Немного не по теме, рискну спросить. Как защититься от ботов, которым плевать на robots.txt и при этом используют useragent от броузера и хорошие прокси в большом количестве?

Отлавливать тех, кто не исполняет js и не грузит картинки?
Latium вне форума