|
| Дата |
|
USD/RUB | 93.4409 | BTC/USD | 63966.6593 |
|
|
|
Скрипты, программы и технические решения Обсуждаем скрипты, программы и новые технологии. |
11.04.2013, 22:04
|
#1
|
Mamber
Регистрация: 28.12.2010
Адрес: Green Street
Сообщений: 3,197
Бабло: $478630
|
Борьба с ботами
Хотел узнать, кто и как отшивает левых ботов и боритесь ли с ними вообще...
У меня сайты с миллионными индексами и честно хз на сколько сильно левые боты ебут сервак.
Нагуглил данную статью,
http://www.maultalk.com/topic126197....ode=linearplus
На сколько оно актуально отшивает ботов? Можно ли смело юзать его решение?
и какие списки у вас?
|
|
|
11.04.2013, 22:28
|
#2
|
Senior Member
Регистрация: 01.02.2011
Сообщений: 729
Бабло: $191845
|
Та это ерунда, лучше проанализируй логи за неделю скриптом, получи наиболее частые ip и юзерагенты, а там уже заноси в блек лист все что не нужно. Или повесь это дело на крон. Есть еще антидидос приблуды (iptables, моды для апача, скрипты): все, что превышает лимит обращений с одного ip - идет лесом.
Последний раз редактировалось chizer; 11.04.2013 в 22:33.
|
|
|
11.04.2013, 22:39
|
#3
|
Senior Member
Регистрация: 20.03.2012
Сообщений: 861
Бабло: $393585
|
Мое ихмо побанишь скрытых ботов поисковиков - сделаешь еще хуже для миллионных индексов. И серваку станет полегче. Но станет ли легче тебе от этого?
__________________
Сторонникам Морали и Нравственности нужно немедленно отрезать хуй, потому что хуй -- это безнравственно.
|
|
|
11.04.2013, 23:02
|
#4
|
Mamber
Регистрация: 28.12.2010
Адрес: Green Street
Сообщений: 3,197
Бабло: $478630
ТС -->
|
ТС
awm521212225,
получается, тогда единственный толк - это банить только по юзер агенту?
|
|
|
11.04.2013, 23:06
|
#5
|
Senior Member
Регистрация: 01.02.2011
Сообщений: 729
Бабло: $191845
|
Цитата:
Сообщение от awm521212225
Мое ихмо побанишь скрытых ботов поисковиков - сделаешь еще хуже для миллионных индексов. И серваку станет полегче. Но станет ли легче тебе от этого?
|
не думаю, что скрытые боты поисковиков будут парсить все подряд страницы. если они вообще существуют.
|
|
|
11.04.2013, 23:13
|
#6
|
Senior Member
Регистрация: 20.03.2012
Сообщений: 861
Бабло: $393585
|
PHP код:
User-agent: BecomeBot
User-agent: Nutch
User-agent: Jetbot/1.0
User-agent: Jetbot
User-agent: Teoma
User-agent: WebVac
User-agent: Stanford
User-agent: Stanford CompSciClub
User-agent: Stanford CompClub
User-agent: Stanford Spiderboys
User-agent: scooter
User-agent: naver
User-agent: dumbot
User-agent: Hatena Antenna
User-agent: grub-client
User-agent: grub
User-agent: looksmart
User-agent: WebZip
User-agent: larbin
User-agent: b2w/0.1
User-agent: Copernic
User-agent: psbot
User-agent: Python-urllib
User-agent: NetMechanic
User-agent: URL_Spider_Pro
User-agent: CherryPicker
User-agent: EmailCollector
User-agent: EmailSiphon
User-agent: WebBandit
User-agent: EmailWolf
User-agent: ExtractorPro
User-agent: CopyRightCheck
User-agent: Crescent
User-agent: SiteSnagger
User-agent: ProWebWalker
User-agent: CheeseBot
User-agent: LNSpiderguy
User-agent: Mozilla
User-agent: mozilla
User-agent: mozilla/3
User-agent: mozilla/4
User-agent: mozilla/5
User-agent: Mozilla/4.0 (compatible; MSIE 4.0; Windows NT)
User-agent: Mozilla/4.0 (compatible; MSIE 4.0; Windows 95)
User-agent: Mozilla/4.0 (compatible; MSIE 4.0; Windows 98)
User-agent: Mozilla/4.0 (compatible; MSIE 4.0; Windows XP)
User-agent: Mozilla/4.0 (compatible; MSIE 4.0; Windows 2000)
User-agent: ia_archiver
User-agent: ia_archiver/1.6
User-agent: Alexibot
User-agent: Teleport
User-agent: TeleportPro
User-agent: Stanford Comp Sci
User-agent: MIIxpc
User-agent: Telesoft
User-agent: Website Quester
User-agent: moget/2.1
User-agent: WebZip/4.0
User-agent: WebStripper
User-agent: WebSauger
User-agent: WebCopier
User-agent: NetAnts
User-agent: Mister PiX
User-agent: WebAuto
User-agent: TheNomad
User-agent: WWW-Collector-E
User-agent: RMA
User-agent: libWeb/clsHTTP
User-agent: asterias
User-agent: httplib
User-agent: turingos
User-agent: spanner
User-agent: InfoNaviRobot
User-agent: Harvest/1.5
User-agent: Bullseye/1.0
User-agent: Mozilla/4.0 (compatible; BullsEye; Windows 95)
User-agent: Crescent Internet ToolPak HTTP OLE Control v.1.0
User-agent: CherryPickerSE/1.0
User-agent: CherryPickerElite/1.0
User-agent: WebBandit/3.50
User-agent: NICErsPRO
User-agent: Microsoft URL Control - 5.01.4511
User-agent: DittoSpyder
User-agent: Foobot
User-agent: WebmasterWorldForumBot
User-agent: SpankBot
User-agent: BotALot
User-agent: lwp-trivial/1.34
User-agent: lwp-trivial
User-agent: [url]http://www.WebmasterWorld.com[/url] bot
User-agent: BunnySlippers
User-agent: Microsoft URL Control - 6.00.8169
User-agent: URLy Warning
User-agent: Wget/1.6
User-agent: Wget/1.5.3
User-agent: Wget
User-agent: LinkWalker
User-agent: cosmos
User-agent: moget
User-agent: hloader
User-agent: humanlinks
User-agent: LinkextractorPro
User-agent: Offline Explorer
User-agent: Mata Hari
User-agent: LexiBot
User-agent: Web Image Collector
User-agent: The Intraformant
User-agent: True_Robot/1.0
User-agent: True_Robot
User-agent: BlowFish/1.0
User-agent: [url]http://www.SearchEngineWorld.com[/url] bot
User-agent: JennyBot
User-agent: MIIxpc/4.2
User-agent: BuiltBotTough
User-agent: ProPowerBot/2.14
User-agent: BackDoorBot/1.0
User-agent: toCrawl/UrlDispatcher
User-agent: WebEnhancer
User-agent: suzuran
User-agent: VCI WebViewer VCI WebViewer Win32
User-agent: VCI
User-agent: Szukacz/1.4
User-agent: QueryN Metasearch
User-agent: Openfind data gathere
User-agent: Openfind
User-agent: Xenu's Link Sleuth 1.1c
User-agent: Xenu's
User-agent: Zeus
User-agent: RepoMonkey Bait & Tackle/v1.01
User-agent: RepoMonkey
User-agent: Microsoft URL Control
User-agent: Openbot
User-agent: URL Control
User-agent: Zeus Link Scout
User-agent: Zeus 32297 Webster Pro V2.9 Win32
User-agent: Webster Pro
User-agent: EroCrawler
User-agent: LinkScan/8.1a Unix
User-agent: Keyword Density/0.9
User-agent: Kenjin Spider
User-agent: Iron33/1.0.2
User-agent: Bookmark search tool
User-agent: GetRight/4.2
User-agent: FairAd Client
User-agent: Gaisbot
User-agent: Aqua_Products
User-agent: Radiation Retriever 1.1
User-agent: WebmasterWorld Extractor
User-agent: Flaming AttackBot
User-agent: Oracle Ultra Search
User-agent: MSIECrawler
User-agent: PerMan
User-agent: searchpreview
User-agent: sootle
User-agent: es
User-agent: Enterprise_Search/1.0
User-agent: Enterprise_Search
Вот юзер агенты которые поидее можно побанить.
__________________
Сторонникам Морали и Нравственности нужно немедленно отрезать хуй, потому что хуй -- это безнравственно.
|
|
|
11.04.2013, 23:16
|
#7
|
BOSS V.I.P.
Регистрация: 28.02.2008
Сообщений: 499
Бабло: $72950
|
Мое мнение лучше накинуть 20-50$ и взять мощный сервер, E3 или даже E5. Поставить туда чистый nginx без апача. А пытаться отфильтровать ботов решение не самое лучшее, можно, как тут уже сказали и скрытых СЕ ботов блокнуть и тогда горе будет. Да и боты меняются, появляются новые, замучаешься фильтровать.
|
|
|
11.04.2013, 23:19
|
#8
|
Mamber
Регистрация: 28.12.2010
Адрес: Green Street
Сообщений: 3,197
Бабло: $478630
ТС -->
|
ТС
Проц и так самый мощный из предлагаемых конфигов.
И если суммарный индекс на сайтах с сервака - допустим лямов 10
и если отсечь хотя бы ahrefs то это уже гуд=)
|
|
|
11.04.2013, 23:28
|
#9
|
автоматизирую интернеты
Регистрация: 05.07.2009
Адрес: chesser.ru
Сообщений: 3,362
Бабло: $470735
|
user-agent-ы на то и нужны, чтобы по ним отсекать, но это не единственный признак.
если кто-то (левый бот, кролер или человек) зайдет ко мне по адресу site.com/w00t или site.com/admin/FCK или site.com/PMA и тд, я таким тоже 444 покажу. IP можно автоматом писать в лог-файл и по крону готовить blacklist IP-адресов, который автоматом подгружать в конфиг nginx. Делал такое, в принципе работало очень шустро, но если знаешь какие ip банить, то лучше сразу их в файерволе фильтровать наверно
|
|
|
11.04.2013, 23:42
|
#10
|
Senior Member
Регистрация: 26.10.2009
Сообщений: 597
Бабло: $127864
|
как уже выше отписали отсеки известных ботов-паразитов и расскажи о результатах.
|
|
|
|