×
Россия +7 (909) 261-97-71

Как поисковые машины могут расшифровывать аббревиатуры в запросах

Россия +7 (909) 261-97-71
Шрифт:
0 6129
Оглавление
Подпишитесь на нас в Telegram

Когда пользователи поисковых машин используют аббревиатуры или их расшифровки, то они могут пропустить некоторые довольно важные страницы.

Например, поищите в Yahoo [NASA Moon bombing] (бомбардировка луны NASA) и сравните результаты с выдачей по запросу [National Aeronautics and Space Administration moon bombing] и вы увидите огромную разницу.

А должны ли быть эти результаты одинаковыми? NASA и National Aeronautics and Space Administration это одна и та же организация. С другой стороны, NASA также является аббревиатурой для:

  • North American Saxophone Alliance.
  • National Auto Sport Association.
  • National Association of Students of Architecture.

Кроме того, существует гора Nasa в Швеции, и там же расположена серебряная шахта Nasa. Есть шведская музыкальная группа с таким названием, исполнитель хип-хопа с таким именем, DJ и народность Nasa в Колумбии.

Как поисковая машина должна обращаться с аббревиатурами в запросах? Должна ли она расшифровывать аббревиатуры для улучшения поисковых результатов? Если страница имеет высокий рейтинг по запросу «National Aeronautics and Space Administration», но низкий по «NASA», то должна ли такая страница отображаться в поисковых результатах по термину содержащему NASA?

Именно подобные вопросы поднимаются в патенте Yahoo, опубликованном на прошлой неделе.

Обработка аббревиатур в веб-поиске
Изобретатели: Xing Wei, Fuchun Peng и Benoit Dumoulin
Принадлежит Yahoo
US Patent Application 20090259629
Опубликовано 15 октября 2009
Подано на рассмотрение 15 апреля 2008

Аннотация

Метод обработки аббревиатур в веб-запросах включает:

  • создание словаря множества возможных расшифровок потенциальных аббревиатур, связанных с ключевыми словами запроса полученного или ожидаемого поисковой машиной;
  • принятие запроса содержащего аббревиатуру;
  • расширение аббревиатуры в один из множества вариантов расшифровки аббревиатуры при вероятности корректности такого расширения выше установленной границы, где вероятность определяется с учетом контекста аббревиатуры в запросе, где в контекст включен хотя бы якорный текст;
  • отсылка запроса с расшифрованной аббревиатурой поисковой машине для генерации страницы поисковых результатов соответствующей запросу.

Одним из первых шагов, как мы видим, является ассоциация аббревиатур с их расшифровками. Это возможно реализовать при помощи анализа якорного текста, указывающего на страницы, и содержащего как аббревиатуры, так и их расшифровки. Например, если на одни и те же страницы стоят ссылки со словами «NASA» и «National Aeronautics and Space Administration», то в словарь может быть добавлена следующая строка:

  • NASA = National Aeronautics and Space Administration.

Но что тогда делать представителям Североамериканского Саксофонного Объединения (North American Saxophone Alliance), которые будут в ответ на запрос «NASA jazz competition» (состязание по джазу NASA) получать ссылки на проекты по освоению Луны? Возможно, словарь аббревиатур может содержать и информацию, полученную из других источников.

При расшифровке аббревиатур поисковой машине следует соблюдать осторожность. В патенте приводятся следующие примеры различного использования аббревиатуры/слова «aim»:

  • aim download — судя по всему, здесь «aim» является аббревиатурой «AOL instant messenger».
  • aim stock — в данном случае это явно сокращение «alternative investment market».
  • aim at improvement — а здесь «aim» используется просто как слово, а не аббревиатура.

Существует минимум три способа для поисковой машины узнать о наличии аббревиатуры:

  • Сессии запросов — Если человек искал «aim download» и не увидел релевантного результата, то он скорее всего перепишет запрос как «aol instant messenger download». Рассмотрение подобной информации в логах запросов поисковой машины может помочь в составлении словаря аббревиатур и получении информации об использовании аббревиатур в различных контекстах.
  • Якорный текст — Если на одни и те же страницы стоят ссылки с текстом в виде аббревиатуры и ее расшифровки, то между этими текстами можно отследить связь.
  • Логи кликов — Переходы людей на одну и ту же страницу со страниц поисковых результатов по различным запросам может означать, что запросы каким-то образом связаны между собой. Чем чаще подобное происходит, тем выше вероятность связи.

Все три метода основываются на участии людей. Проставление ссылок, выбор страниц в поисковых результатах или уточнение запросов во время поиска — все это делают люди. Вся информация доступна для поисковых машин и может быть использована для построения статистической модели, которая подскажет поисковой машине, когда стоит использовать расшифровку аббревиатуры.

Кроме всего вышеописанного, в патенте рассматриваются случаи возможной обработки различных сокращений вроде акронимов, инициальных аббревиатур, составных слов и т.п.

Когда поисковая машина обнаруживает подобное слово в запросе, она может поступить следующим образом:

  • Расширить запрос, чтобы включить страницы с аббревиатурой, страницы с расшифровкой аббревиатуры и страницы, содержащие оба написания.
  • Предложить пользователю провести поиск по расшифрованной аббревиатуре.
  • Проигнорировать расширенную версию и просто выдать результат поиска со страницами, содержащими аббревиатуру.

Выводы

Если вы что-то ищите и используете в поисковом запросе аббревиатуру, то неплохой идеей является повторение поиска с расшифрованной версией аббревиатуры. Особенно, если вам нужна как можно более полная информация по теме.

Если вы публикуете что-то в глобальной сети и используете в тексте аббревиатуры, то неплохо бы на той же странице использовать и расшифровку аббревиатуры. Плюс проверьте, что выдает поисковая машина на запрос с этой аббревиатурой.

Рассмотренный патент принадлежит Yahoo, но вполне возможно, что подобные идеи обсуждались или тестировались разработчиками и других поисковых машин.


Переводной материал, источник


Есть о чем рассказать? Тогда присылайте свои материалы Марине Ибушевой


Новые 
Новые
Лучшие
Старые
Сообщество
Подписаться 
Подписаться на дискуссию:
E-mail:
ОК
Вы подписаны на комментарии
Ошибка. Пожалуйста, попробуйте ещё раз.
Отправить отзыв
ПОПУЛЯРНЫЕ ОБСУЖДЕНИЯ НА SEONEWS
Роскомнадзор начал требовать от владельцев сайтов уведомлять об использовании Google Analytics. Опыт SEOnews
Денис Добрынин
1
комментарий
0
читателей
Полный профиль
Денис Добрынин - Что-то я как-то пропустил момент, с которого например госномер автомобиля или разрешение монитора и версия установленного на ПК ОС стала перс.данными... Но сегодня тоже получили бумажку с ай-яй-яем. Пойдем на прием в теруправление.
Топ-10 SEO-курсов на 2024-2025 год для вашего роста
Виталий
1
комментарий
0
читателей
Полный профиль
Виталий - Вот тоже хороший курс для старта в сео -docs.google.com/document/d/1Qs7xVx4u3MZeuh8jf8s70NuIEYIuXVgtttaLMxADIsk/edit. Я много чего почерпнул для себя.
Авторы на RUTUBE теперь могут загружать видео в формате серий
Наиль г.Пенза
4
комментария
0
читателей
Полный профиль
Наиль г.Пенза - Ну что вы принимаете мою заявку? Или удалиться с "тихой грустью". А моих фото пока нет,они у меня удалились с Галереи, когда покупал себе смартфон. На фото пока моя дочь,сам я лежу в каридологие, сами понимаете какая у меня будет фотография
Рейтинги сайтов по отзывам в выдаче Яндекса: откуда берутся и как их улучшить
Romano
2
комментария
0
читателей
Полный профиль
Romano - дополнение: такие оценки не отображаются, но участвуют в общем рейтинге
Мастер-класс по использованию операторов Wordstat: повышаем эффективность сбора семантики
Старый сеошник
5
комментариев
0
читателей
Полный профиль
Старый сеошник - Ну это же просто рекламная статья ради обратной ссылки)))) Куча воды по абсолютно базовой информации. Справка Яндекса описала все тоже самое, но в 8 раз короче yandex.ru/support2/wordstat/ru/content/operators Ок, про историю запроса там нет. Но это же просто в интерфейсе кнопка)
Россиянам могут запретить рекламу в Instagram* и Facebook*
Марина Ибушева
65
комментариев
0
читателей
Полный профиль
Марина Ибушева - Окончательное как раз и означает третье. Любой законопроект перед тем, как отправиться в Совет Федерации и на подпись прзиденту, проходит в России три обязательные стадии рассмотрения в Государственной Думе: Первое чтение - обсуждается общая концепция законопроекта. Второе чтение - более детальное обсуждение проекта, поправки и дополнения. Третье чтение (окончательное) - голосование за проект. Так что ожидается 25 марта второе и третье, окончательное чтение.
SEO-продвижение сайтов клиник
Дмитрий Севальнев
124
комментария
0
читателей
Полный профиль
Дмитрий Севальнев - Вау, мощно!
Тренды SEO в 2025 году
Борис
4
комментария
0
читателей
Полный профиль
Борис - 50/50 Описанная тобой ситуация (надеюсь, не против, что сразу на "ты") — типичная и вообще не требует какого-то глубинного опыта. Достаточно немного логики и наблюдательности. Разобью на пункты для читабельности: 1) Каннибализацию очень просто распознать. Достаточно загрузить СЯ в систему съёма позиций и мониторить источники. Если происходит некое «мигание» — идём (повторно) в топ, смотрим, подтверждаем гипотезу — склеиваем. 2) Но чаще всего эту проблему можно решить на уровне качественной группировки СЯ. А некоторые кластеры со знаком вопроса, которые мы решили разделить на несколько, достаточно держать под контролем. И снова получается, что внимательность и логика здесь могут помочь. И никакого серьёзного опыта не требуется. 3) Соглашусь, что в Яндексе правило "Интент = одна страница" — очень важно, но не всегда. Например, есть кластер, связанный с установкой сантехники, который включает запросы: "установка сантехники", "цена на установку сантехники". Вот здесь, как раз, для многих может быть неочевидно, что кластер лучше разделить на два: "Установка сантехники" и "Цена на установку сантехники". 4) Продолжая мысль из п.3 — в такой ситуации в Яндексе (скорее всего) всё будет ок. И никакой каннибализации не произойдёт. 5) Если говорить про Google (тот же п.3), то здесь, вероятно, возникнут проблемы (всё зависит от оптимизации страниц). Эти два кластера могут не дотянуть до топа из-за своей релевантности. Мы все знаем, что Google может «съесть» страницу с несколькими интентами, и всё будет ок. (в этом предложении пасхалка, что нужно сделать ;)) А если ещё поработать над ссылочным — вообще сказка. Конечно, эту проблему можно решить, но если переборщить, то каннибализация может уже произойти в Яндексе. Вот как раз чтобы уловить эту тонкую грань, и нужен хоть какой-то опыт, которого часто нет у джунов.
Целевая аудитория: как найти и встроиться в ее вселенную
Александра
2
комментария
0
читателей
Полный профиль
Александра - Здравствуйте! Благодарю Вас за отличную статью! Много полезной информации, написано доступным языком.
Настоящий квест: как увеличили трафик на сайт сети компьютерных клубов в 19,5 раз, а число конверсий в 42,5 раза
Владлен
1
комментарий
0
читателей
Полный профиль
Владлен - Интересно, есть только вопрос по ссылкам, в каком диапазоне стоимость ссылки была, ведь судя по скринам за 5 месяцев было куплено 10 ссылок
ТОП КОММЕНТАТОРОВ
Комментариев
910
Комментариев
834
Комментариев
554
Комментариев
540
Комментариев
483
Комментариев
392
Комментариев
373
Комментариев
262
Комментариев
249
Комментариев
171
Комментариев
156
Комментариев
141
Комментариев
124
Комментариев
121
Комментариев
100
Комментариев
97
Комментариев
97
Комментариев
96
Комментариев
80
Комментариев
77
Комментариев
74
Комментариев
67
Комментариев
65
Комментариев
60
Комментариев
59

Отправьте отзыв!
Отправьте отзыв!