|
| Дата |
|
USD/RUB | 88.4375 | BTC/USD | 67677.0598 |
|
|
|
Поисковые системы Поисковая оптимизация под Google, Yahoo, Bing и т.д. |
28.09.2014, 05:08
|
Start Post: Google Brain - кто что думает?
|
Member
Регистрация: 26.01.2014
Сообщений: 74
Бабло: $33398
|
Google применил технологии Deep Learning для борьбы с поисковым спамом
18 сентября был опубликован патент Google на классификацию поискового спама «Классификация ресурсов с использованием самообучающейся сети» (Classifying Resources Using a Deep Network ). Об этом сообщает SEO-эксперт Билл Славски (Bill Slawski).
Запатентованная технология была изобретена разработчиками компании Цинчжоу Ван (Qingzhou Wang), Ю Лян(Yu Liang), Ке Ян (Ke Yang) и Кай Чэнь (Kai Chen).
Последние несколько лет лидер поиска был занят построением самообучающейся сети, известной как Google Brain.
Google Brain – неофициальное название исследовательского проекта Google, посвященного глубокому обучению (Deep Learning). В рамках этого проекта исследователи компании смогли создать примерную модель работы нейронов головного мозга – «нейрональную» самообучающуюся сеть, соединив 16,000 процессоров и подключив её к сети Интернет. Полученная система сумела самостоятельно обучиться распознавать образ котов.
Теперь компания использует эти технологии для идентификации поискового спама, что нашло выражение в разработке патента на его классификацию.
Патент описывает методы, которые включают:
прием входящей информации, содержащей множество характеристик ресурса, в котором каждая характеристика – это значение соответствующего атрибута ресурса;
обработку каждой характеристики, используя соответствующую функцию вложения для генерации одного или нескольких числовых значений;
обработку числовых значений, используя один или несколько нейронных сетевых уровней для создания альтернативного представления о характеристиках ресурса, в котором обработка значений с эластичными параметрами включает применение к ним одного или нескольких нелинейных преобразований;
обработку альтернативного представления входа с использованием классификатора для генерации соответствующей оценки для каждой категории в их заранее определенном наборе, где каждая из соответствующих оценок измеряет прогнозированную вероятность, что ресурс принадлежит к соответствующей категории.
«Предопределенный набор категорий» может включать категорию спама поисковых систем. Оценка категории (category score) для ресурса измеряет предсказанную вероятность, что ресурс является поисковым спамом.
Предопределенный набор категорий может включать в себя соответствующую категорию для каждого из множества типов поискового спама.
Оценки категорий могут быть использованы для:
определения, следует ли добавлять эти ресурсы в индекс поисковых систем;
генерирования и упорядочивания результатов поиска в ответ на поисковые запросы.
Самообучающаяся сеть может быть эффективно использована для классификации ресурсов в категории. Например, ресурсы могут быть классифицированы как являющиеся или не являющиеся спамом, как являющиеся одним из нескольких видов спама или как один из двух и больше типов ресурсов.
«Использование самообучающейся сети для классификации ресурсов по категориям может привести к тому, что поисковые системы будут способны лучше удовлетворить информационные потребности пользователей путем эффективного определения поискового спама и воздержания от предоставления поисковых результатов, определяющих такие ресурсы, пользователям. Или же они смогут предоставить поисковые результаты, которые идентифицируют ресурсы, принадлежащие к категориям, лучше соответствующим информационным потребностям пользователя» - поясняют разработчики в патенте.
Согласно патенту, эта система классификации ресурсов может типизировать ресурсы как «поисковый спам или не поисковый спам». Она не определяет детали веб-спама, но говорит о том, что может выделить его типичные виды, такие как:
контент-спам;
ресурсы, содержащие ссылочный спам;
ресурсы, использующие клоакинг;
и т.д.
Ресурсы на страницах сайта могут включать слова из контента сайта в символьной форме; URL-ы сайта; его тайтл; имя домена; категории или типы объектов, относящиеся к сайту; его возраст. Каждая из этих характеристик может быть использована для расчета вероятности того, что сайт является спам-ресурсом, и определения, индексировать его или понижать в выдаче.
Патент не предоставляет деталей относительно обучения и классификации характеристик в рамках модели машинного обучения, но ссылается на документ, который дает эту информацию: Large Scale Distributed Deep Networks.
Последний раз редактировалось Narval; 28.09.2014 в 05:14.
|
|
|
29.09.2014, 15:04
|
#12
|
Везучий ВМ
Регистрация: 21.08.2009
Сообщений: 1,493
Бабло: $239825
|
А там ничего не сказано про отчисления в пенсионный фонд дорвейщиков ?
__________________
Не зная ни сна и ни отдыха, при лунном и солнечном свете, легко и просто качаю бабло в интернете
|
|
|
29.09.2014, 15:14
|
#13
|
Senior Medved
Регистрация: 15.06.2008
Сообщений: 4,137
Бабло: $22479945
|
Цитата:
Сообщение от res1dent
А там ничего не сказано про отчисления в пенсионный фонд дорвейщиков ?
|
Нет, но обещали устроить в ближайший завод
|
|
|
29.09.2014, 16:52
|
#14
|
Шоколатье
Регистрация: 20.04.2007
Сообщений: 5,960
Бабло: $726105
|
главное посоны - в таксисты не ходите.
а то гугл и оттуда выдавит, инфа 100%
|
|
|
29.09.2014, 20:02
|
#15
|
Senior Member
Регистрация: 09.07.2014
Сообщений: 5,602
Бабло: $760725
|
Думаю так, самое главное это, чтобы не загнулось ссылочное, о чем М. Каттс утверждал не так давно.
Ну и потом это конечно пироги, что собственно и является поисковым спамом. Чтобы эти 2 фактора жили.
|
|
|
03.10.2014, 14:58
|
#16
|
я крут как root
Регистрация: 28.05.2012
Адрес: HTTPHEADER
Сообщений: 478
Бабло: $66080
|
Кота они распознали наверно так же, как и лица?
__________________
TrueMed$ - ссылка для реги без инвайта конверт 1:1 USA, 1:3 Евро, 0% на выплаты.
|
|
|
03.10.2014, 15:07
|
#17
|
gofuckingoogle
Регистрация: 28.08.2008
Адрес: 666
Сообщений: 9,413
Бабло: $1278665
|
Цитата:
«нейрональную» самообучающуюся сеть, соединив 16,000 процессоров и подключив её к сети Интернет. Полученная система сумела самостоятельно обучиться распознавать образ котов.
|
Нужно попробовать позаливать на сайты пикчи котов
|
|
|
13.11.2014, 18:33
|
#18
|
Senior Member
Регистрация: 25.12.2008
Сообщений: 1,092
Бабло: $272735
|
Цитата:
Сообщение от Dadee
главное посоны - в таксисты не ходите.
а то гугл и оттуда выдавит, инфа 100%
|
посмотрел видос понравилось, молодцы конечно они - двигают мир вперед
|
|
|
27.11.2014, 14:56
|
#19
|
Ебланнед
Регистрация: 10.11.2014
Сообщений: 44
Бабло: $6940
|
тоже глянул видео, молодцы, круто
|
|
|
28.11.2014, 11:29
|
#20
|
Senior Member
Регистрация: 25.12.2013
Сообщений: 6,549
Бабло: $785925
|
Цитата:
Сообщение от SoftMaster
Кота они распознали наверно так же, как и лица?
|
Какик красивые у нее лица на столе!
__________________
Надежный и отзывчивый VPS хостинг для серьезных проектов
Проверенная годами пуш партнерка с ежедневными выплатами
|
|
|
02.12.2014, 14:27
|
#21
|
Ебланнед
Регистрация: 10.11.2014
Сообщений: 44
Бабло: $6940
|
это точно, глаза невозможно оторвать
|
|
|
|