Вход в систему Регистрация

Занимательная лингвистика в SEO

Аналитикум
Дата выхода в эфир : 10.10.2011
  • просмотров 53227
  • комментариев 16

Герои: Эльвира Арсланова

Зарегистрируйтесь или авторизируйтесь, чтобы добавлять комментарии к передачам

Комментарии

  • Дима Himi 05.02.2012

    Программа отличная, одна из немногих, где очень структурировано и четко описан принцип работы ПС по части антиспама текстов.
    Эльвира, вы упоминали программу Word Meet Tools, которую, как оказалось, не так просто найти в поиске...
    Вы можете дать на неё ссылку? = )

  • Neo 18.10.2011

    Михаил, передача конечно классная. И Эльвира красивая и крайне умненькая девушка :)
    Какими программами такие лингвистики проводятся?
    Где их можно купить (программы или сервисы) или как проводить такую лингвистику для своих проектов?
    Как мы можем (насколько доступно это) использовать это в своей SEO деятельности?
    Благодарю за внимание.

    • Эльвира 25.10.2011

      Neo, программ много. И в то же время не очень много, потому что не все работают с кириллицей и с большими объемами данных. Для больших объемов иногда лучше писать что-то свое. Тем не менее:
      1) Книга по основам комп.лингвистики: "speech and language processing"
      jurafsly and martin
      2) программа для выделения шинглов, подсчета частот, различного рода статистики в текстах, например: http://www.lexically.net/wordsmith/version5/index.html
      3) программа для подсчета коллокаций на русских текстах
      http://alingva.ru/index.php/lingvosoft/18-key-word
      4) различные анализаторы (синтаксический, морфологический) можно попробовать посмотреть тут: aot.ru bkb http://www.solarix.ru/

  • Николаускас 18.10.2011

    Почему обрезаются сообщения?
    Часть - 2.
    Есть по-русски что то почитать по данному интервью, название литературы?

    • Эльвира 25.10.2011

      Николаускас,
      по-русски...я читаю статьи с различных конференций, как я уже упомянула в программе.
      Ничего нового я сейчас, наверное, не скажу, но все же перечислю возможные источники:
      1) http://company.yandex.ru/public/articles/
      2)http://www.dline.info/jcl/v1n1.php( на английском)
      3)http://www.dialog-21.ru/
      4) http://research.google.com/
      5)speech and language processing
      jurafsly and martin
      6)http://alingva.ru/index.php/2010-05-24-19-29-23
      7) http://aclweb.org/

  • Николаускас 18.10.2011

    Ух! Симпатичная и умная девушка =).
    Лингвистика

  • Всеволод 12.10.2011

    можно все ссылки из презентации либо выложить в комменте, либо саму презентацию выложить?

  • Всеволод 12.10.2011

    Михаил, в первой части в конце упоминалось о статье Яндекса, в которой описывается про метод выявления спамовых текстов. Можно ссылочку в студию? =)

    • Михаил Сливинский 13.10.2011

      Конечно, http://download.yandex.ru/company/A_Kustarev_A_Raigorodsky_poisk_neestestvennih_textov_statia.pdf

    • Павко 13.10.2011

      Еще раньше, кстати, про майкрософтовский(вроде) метод выявления спама в тексте говорили - про сжатие текстов. Чем больше сжимается, тем спамнее - а посоветуйте плз плагины - утилиты чем можно проверять страницы/тексты на сжатие?

  • Павко 12.10.2011

    И выложите, пожалуйста, названия всех программ, что называли, чтобы не смотреть каждый раз, когда забыл :)

  • Павко 12.10.2011

    Интересно, но к сожалению SEO-компаниям и уж тем более простым смертным SEO-шникам практически никогда такие технологии не заиметь.
    Софта готового для серьезной работы с большими корпусами, кластерами запросов, я так понял нет? (или просто никто не палит его?)

    А собственное писать никто не будет - выхлоп для обычных компаний будет мизерный по сравнению затратами:
    Вложить в разработку миллион, чтобы получить в итоге софт, который говорит хороший текст или плохой. И это в эпоху, когда всем жалко 5$ за 1000 текста и все ищут где бы за 1$ написать :)

    Правда по картинкам ощущение что там просто с вордстатом баловались, впринципе можно все о чем говорили найти и по правой колонке вордстата, если в несколько итераций проходиться по всем запросам, отсеивая общие и нетематические запросы.

    А так было бы здорово побаловаться.
    Базы Пастухова из 200 миллионов ключевиков есть, википедию(или хотя бы какую-то репрезентативную часть) скачать - легко.
    Что со всем этим делать только дальше. Чем нормировать, леммировать, анализировать))) Все сервисы по анализу задыхаются даже от пары сотен КБ текста.

    • Эльвира 25.10.2011

      Павко,
      вы правы, для небольших компаний свой софт писать не стоит , наверное. Хотя смотря что иметь ввиду под софтом. Например, что просто нормировать и посчитать статистику на текстах не нужно особых затрат. А потом уже дело лингвистов и аналитиков как правильно обработать информацию.

      А вот, например, анализаторы различные лучше использовать готовые. Благо они есть, если поискать. Особенно, если вы работает с каким0-то определенным типом текстов, то все инструменты можно "заточить" под свои нужды.

    • Михаил Сливинский 12.10.2011

      Действительно, на многое нужны ресурсы, но часть можно сделать "на коленке". Например, wordsmithtools вполне доступна: http://www.lexically.net/wordsmith/version5/index.html.

Рекомендуем

Новости блога

Facebook
ВКонтакте
Twitter

Доклады конференций

Как построить эффективную платформу для SEO
Использование эвристик для классификации ссылочных доноров

Новости AdCrunch

AMD will acquire Fei-Fei Li’s World Labs for $8.2 billion
The AI boom took over Climate Week and not everyone is happy about it
Nvidia launches new platform for reining in rogue AI agents

Наши проекты