Всемирная Сеть (WWW) - использование и приложения

Поиск в Интернете. Плагиат

Разбить на страницы
Показывать лекцию целиком

Google

Google - это обозначение числа, получаемого из единицы и ста нулей. А еще это самая популярная поисковая система в мире. Интерфейс системы доступен почти на всех языках мира, а одним из адресов, впрочем, самым нужным нам, является http://www.google.ru (рис. 8.1):

(рис 8.1) Главная страница Google Россия ( http://www.google.ru)

Кнопка "Мне повезёт!" откроет самую релевантную ссылку по запросу. В данном случае мы сразу увидим сайт http://www.intuit.ru.

Правила поиска в Google очень похожи на правила Яндекс. Их описание можно видеть в разделе "Основные сведения о поиске Google" (http://www.google.ru/intl/ru/help/basics.html), который доступен по ссылке "Все о Google" (http://www.google.ru/intl/ru/about.html). Как обычно, поиск осуществляется без учета заглавных букв, запросы "ИНТУИТ", "ИнТуИт", "интуит" будут обработаны совершенно одинаково. В запросе склоняются слова и поиск "дистанционного обучения" позволит найти и просто "дистанционное обучение". Поиск по точной фразе также задается с помощью кавычек - запрос "Понедельник начинается в субботу" позволит найти именно произведение братьев Стругацких, а не упоминание дней недели. Исключение слова, в отличие от Яндекса, осуществляет указанием знака минуса перед словом. Запрос "машина - автомобиль" исключит упоминание слова "машина" в значении "автомобиль".

Расширенный поиск Google (http://www.google.ru/advanced_search?hl=ru), в соответствии со своим названием, предоставляет продвинутые инструменты поиска (рис. 8.2):

(рис 8.2) Расширенный поиск Google.

Использовать его достаточно легко, поскольку все условия определяются достаточно ясно. Google предлагает несколько забавных возможностей поиска. Например, калькулятор, позволяющий вычислять выражения по запросу (рис. 8.3):

(рис 8.3) Калькулятор Google.

Калькулятор даже знает ответ на вопрос, сколько чайных ложек в стакане. Конвертор валют понимает вопросы, формулируемые на вполне человеческом языке (рис. 8.4):

(рис 8.4) Перевод долларов в рубли.

Как и Яндекс, Google предлагает множество сервисов: http://www.google.ru/intl/ru/options. Некоторые из них, например Документы Google (doc.google.com) или Ответы (http://otvety.google.ru/otvety/) были новаторскими и задавали направление всей индустрии.

Google предлагает всем желающим принять участие в тестировании своих экспериментальных разработок на площадке http://labs.google.com. Яндекс тоже предлагает подобный проект: http://nano.yandex.ru/

Google Earth

В фильмах любят использовать прием, когда какой-то город или местность показываются из космоса. Камера моментально наезжает, словно метеор, приближаясь к Земле. Заканчивается все тем, что проступают городские улицы и далее действие идет уже в обычном режиме.

Теперь любой пользователь Интернета может сам воссоздать такой трюк. Достаточно скачать программу Google Earth (http://earth.google.com/, ~ 7,36 МБ) и, подключившись к Интернету, управлять всей планетой. Земной шар крутится, а камера моментально снижается над поверхностью и летает над ней на очень маленькой высоте, вплоть до 50-метрового масштаба местности (рис. 8.5):

(рис 8.5) Москва в Google Earth.

Допустимая высота камеры от 63 тыс. км (почти полторы величины геостационарной орбиты) до нескольких метров.

С помощью Google Earth можно увидеть почти все уголки Земного шара. Различаются дома, стадионы, площади, реки и горы - словом, видны все города и районы, в которых вы когда-то были.

В режиме имитатора полета предлагается выполнить путешествие на сверхзвуковом истребителе. Трехмерный ландшафт будет разворачивать с действительной скоростью движения, зависящей от высоты полета (рис. 8.6):

(рис 8.6) Полет над Санкт-Петербургом на реактивном истребителе.

Мы можем выполнять фигуры высшего пилотажа, и даже отправить самолет в штопор. Пролететь над всей страной, от Мурманска до Владивостока, в режиме реального времени, любуясь закатом Солнца - стало реальностью. Достаточно ввести название города или населенного пункта, чтобы Google Earth плавно и аккуратно развернул Земной шар в нужную точку (рис. 8.7):

(рис 8.7) Из ночного Владивостока в дневной Мурманск. Высота 10 тыс. км.

Google Earth - это множество сервисов, для охвата которых можно было бы написать отдельную книгу. Google Street View позволяет двигаться по улицам на автомобиле и смотреть по сторонам. С помощью Panoramio пользователи добавляют фотографии с привязкой к конкретным местам. Именно отмеченные точки отображаются в виде светлячков-шариков. Google 3D Warehouse предлагает трехмерные модели крупнейших зданий. Wikimapia - это множество слоев, которые могут добавлять пользователи. Маленькие кусочки поверхности можно подписывать, совсем как обычные бумажные карты. Ну и конечно, в программе есть обычные возможности, вроде измерения расстояний, поиск компаний, прокладывания маршрутов и перехода к обычным, поверхностным картам Google.

Если надоест разглядывать земную поверхность, можно обратить свой взгляд в небо. Созвездия и планеты, туманности и кометы - великолепный планетарий прямо на вашем компьютере (рис. 8.8):

(рис 8.8) Крабовидная туманность.

Увидеть туманность Андромеды легко - достаточно просто набрать в поисковой строке "Туманность Андромеды".

Google Earth - это великолепная программа для всей семьи. Она может превратить изучение географии и астрономии в увлекательное занятие, от которого совершенно невозможно оторваться.

Для приемлемой работы достаточно соединения с Интернетом на скорости в 64 Кбит\сек. Большая скорость обеспечит большую комфортность работы. Впрочем, даже на dial-up соединении программой можно пользоваться. Превосходный механизм кеширования позволяет возвращаться к уже однократно загруженной панораме.

Рамблер

Рамблер (http://www.rambler.ru/)- это старейшая поисковая система Рунета, запущенная в 1996 году . Сегодня это крупный портал (в настоящем смысле этого слова), объединяющий множество сервисов. Можно обратить внимание на экспериментальную версию нового поиска (http://beta.rambler.ru/), разрабатываемую параллельно с работой основной (рис. 8.9):

(рис 8.9) Экспериментальная версия поиска Рамблер.

Расширенный поиск обычного Рамблера также предлагает задать множество условий (рис. 8.10):

(рис 8.10) Расширенный поиск Рамблера http://www.rambler.ru/cgi-bin/advanced.cgi?set=www

Рамблер также предлагает уже известные нам правила задания продвинутых запросов, включающих в себя различные условия http://www.rambler.ru/doc/help.shtml.

SEO-оптимизация и увеличение энтропии

Десять лет назад поиск информации в Интернете напоминал детективное расследование. Тогда были разумеется, поисковые системы. Для поиска термина также нужно было набрать его в адресной строке. В куче появившихся ссылок приходилось выбирать жемчужины - сайты с нужным содержимым. Откуда же тогда брались все остальные страницы?

Представим себе, например, сайт туристической фирмы "Лето-отдых". Очень простой сайт, состоящий из нескольких страниц. На одной из них приводится описание тура в Сочи. Цены, условия, контакты - словом, все то, что нужно. Представим также себе, что таких сайтов несколько. Несколько реальных различных фирм, соответственно несколько представительств в Интернете. Реальный бизнес и его отражение в сети.

Теперь представим себе веб-мастера, который не владеет туристической фирмой, не предлагает поездки в Сочи, но умеет делать веб-страницы. Он делает одну страницу, на которую выводит кучу ссылок на сайты туристических фирм. "Отдых летом в Сочи", "Лето-отдых в Сочи", "Отдых в Сочи", "Поездки на море", "Дешевые туры в Сочи", "Условия проживания в гостиницах в Сочи" - вся страница испещрена подобными ссылками. Естественно, такая страница будет содержать как бы больше информации о поездке в Сочи, чем аскетичная страница настоящей турфирмы, предлагающей настоящие туры. Следовательно, в поисковых системах по запросу "Отдых в Сочи" она будет появляться на более ранних позициях, чем страница туристической фирмы. На "сайт" веб-мастера будут заходить много посетителей, поэтому ему остается лишь разместить там рекламу и получать за нее деньги.

Другой веб-мастер, увидев легкий доход первого веб-мастера, решил сделать свою страницу. Он изменил ее оформление, повесил еще больше рекламы, добавил те же самые ссылки - словом, сделал свой супер-каталог.

После того, как 1253 веб-мастера разместили свои каталоги, умный веб-мастер создал свой каталог. На котором стояли ссылки уже не на исходные сайты туристических фирм, а на каталоги обычных веб-мастеров. И конечно, он также разместил кучу рекламы с целью получать за нее кучу денег.

Пример умного веб-мастера оказался заразительным. Другие умные веб-мастера принялись мастерить свои каталоги каталогов, словом, процесс рос лавинообразным образом. Энтропия (хаос) увеличивается, полезной информации не прибавляется.

Что теперь ждет обычного пользователя, который набирает в поисковике "Отдых в Сочи"?. Он попадает на супер-каталог. Подождав, пока загрузится вся реклама, он ее посмотрел, затем все-таки перешел по ссылке каталога "Туры в Сочи - предложения". И снова попал в другой каталог. Перешел с другого каталога - и снова попал в каталог. Потеряв терпение и закрыв, наконец, каталоги каталогов, пользователь возвращается в окно поисковика и методично просматривая результаты, наконец, на 1000-ссылке попадает на сайт фирмы "Лето-отдых".

Понятно, что не для всех запросов был смысл создавать каталоги и каталоги каталогов. Например, нет смысла собирать ссылки на сайты синхрофазотронов и общей теории относительности. Потому что большинство пользователей не каждый день набирают такие запросы. Так (или почти так) обстояло с поиском в Интернет лет десять назад. Все были довольны, кроме самих пользователей, которые, найдя жемчужину настоящего сайта, были вынуждены записывать его, добавлять в Избранное, обмениваться ссылками - словом, тщательно беречь найденные результаты.

Понятно, что долго так продолжаться не могло. Появилась релевантность, которую придумали в компании Google и которая почти одновременно была реализована в компании Яндекс.

Релевантность (от англ. relevant) - это степень соответствия запроса и найденного результата, то есть его уместность. Полный механизм релевантности представляет собой ноу-хау поисковых компаний, которые, разумеется, раскрывать его не собираются. Но этот механизм позволяет получать конечному пользователю именно то, что он ищет. Для того, чтобы понять, как примерно работает идея релевантности, рассмотрим следующий пример.

Сайт туристической фирмы "Лето-отдых" стал очень большим. На нем публикуются мнения и отзывы туристов, предложения отелей, расписание авиарейсов в Сочи. Тысячи посетителей заходят на него каждый день, с удовольствием читают новые мнения, отзывы, разглядывают фотографии. В своих сайтах они ставят ссылки на замечательный сайт фирмы. Да, и каталоги тоже ставят множество ссылок на этот сайт. Есть еще конкурент туристической фирмы, который называется "Зима-отдых". Их сайт достаточно неплохой, но его аудитория поменьше. Поэтому и в каталогах появляется он реже.

Поисковые системы внимательно подсчитали количество ссылок на сайт фирмы "Лето-отдых", учли количество посетителей, и вывели его на первое место в результате. На второе поставили сайт "Зима-отдых". Сайты остальных фирм - в таком же порядке. Ну а каталоги, супер-каталоги и прочие каталоги-каталогов разместились на заслуженном 1000 месте, которое теперь никто и не смотрит.

В этом заключается идея расчета авторитетности страницы, которая называется (PageRank). Конечно, современная индексация страниц включает в себя множество параметров, но идея их сводится к предоставлению пользователям именно того, что они ищут.

Теперь нет смысла создавать раздражающие каталоги с рекламой и множеством ссылок. По ним все равно никто не будет ходить, потому что в поисковых системах они будут занимать крайне низкие позиции.

Для завершения картины, представим себе еще одну задачу. Владельцы сайта "Зима-отдых" захотели, чтобы в поисковых системах они были на первом месте, оттеснив сайт "Лето-отдых". Для этого они обратились к SEO (от англ. search engine optimization, SEO, поисковая оптимизация)-мастерам, которые обычно предлагают следующие подходы:

  • Белая оптимизация. Это законная, честная работа над повышением ресурса в позиции. Сюда входит написание уникальных, интересных материалов, которые будут привлекать посетителей. Например, в рассматриваемом случае, опубликовать интересные статьи, советы, которые будут привлекать посетителей. SEO-оптимизаторы также исправляют содержимое страниц, добавляя необходимое количество ключевых слов, а также размещают информацию о ресурсе в каталогах самих поисковых систем.
  • Серая оптимизация. Это не вполне честная работа над популяризацией ресурса. Например, если просто взять и скопировать тексты с сайта "Лето-отдых". Или договориться с другими популярными сайтами, чтобы они поставили ссылки на данный сайт.
  • Черная оптимизация. Она работает, но если ее обнаруживают в поисковых системах, то раскручиваемый ресурс вообще банится или понижается в рейтинге. К методам черной оптимизации относится спам, размещение ссылки ресурса на форумах, досках объявлений, блогах, и т.д.
  • В целом, SEO-оптимизация конечно нужна (особенно только что созданным сайтам, аналоги которых уже есть) но и без нее работает правило - если ресурс предлагает уникальную информацию, если он новаторский и интересный, то без всяких методов раскрутки он займет свое заслуженное первое место.

    Прочитать то, что думает, например, команда Яндекса об оптимизации сайтов, можно в разделе Яндекс.Вебмастер (http://help.yandex.ru/webmaster/). Также Яндекс предоставляет инструменты http://webmaster.yandex.ru/, позволяющие оценить свой сайт с точки зрения поисковых запросов.

    Какая поисковая система лучше?

    Холивар (от англ. holy war - священная война) - это обмен сообщениями на форумах и блогах, когда участники пытаются убедить друг друга в преимуществе некоторых неочевидных альтернатив. Что лучше - Windows или Linux? Какой браузер лучше - Opera или Mozilla Firefox? Какая поисковая система ищет лучше? И хотя все эти вопросы зачастую лишены смысла, а проведение исследований чаще всего невозможно, поскольку трудно подобрать объективные критерии, все же нельзя сказать, что это задаваемые вопросы - риторические.

    Что касается поисковых систем, то их можно оценить по количеству обработанных запросов. Согласно исследованиям аналитической компании comScore (http://www.comscore.com/press/release.asp?press=2018) за декабрь 2007 года, рейтинг мировых поисковых систем выглядит так:

  • Google Sites: 41 млрд 345 млн; доля рынка 62,4%.
  • Yahoo! Sites: 8 млрд 505 млн; 12,8%.
  • Baidu.com: 3 млрд 428 млн; 5,2%.
  • Microsoft: 1 млрд 940 млн; 2,9%.
  • NHN Corporation: 1 млрд 572 млн; 2,4%.
  • eBay: 1 млрд 428 млн; 2,2%.
  • Time Warner Network: 1 млрд 062 млн; 1,6%.
  • Ask Network: 728 млн; 1,1%.
  • Yandex: 566 млн; 0,9%.
  • Alibaba.com: 531 млн; 0,8%.
  • Яндекс занимает девятое место. Много это или мало? Учитывая то, что количество англоязычных пользователей значительно превосходит число русскоязычных, это отличный результат. Третье место компании Baidu.com объясняется тем, что это китайская поисковая система, обслуживающая запросы страны с населением более миллиарда человек. Понятно, что Яндексу удалось обойти другие русскоязычные поисковые системы и это объективный показатель.

    Вместе с тем, представленные цифры все же не отвечают на вопрос, какая из поисковых систем ищет лучше? Ищет лучше в Рунете? Именно здесь и начинается холивар.

    Все же можно дать несколько замечаний, позволяющих оценить работу системы в целом. Спустя какое время после размещения уникального материала, например, в блоге, он становится доступным в результатах поиска? Это легко проверить на собственном блоге. Какая система дает больше результатов при поиске редких, уникальных или специализированных запросов? Какова релевантность выдаваемых при этом результатов? Насколько выдаваемые результаты поиска являются актуальными?

    Можно предложить множество подобных вопросов, которые каждый пользователь решает для себя сам.

    Поиск людей

    Бывает, что возникает задача найти человека. Или узнать о нем как можно больше сведений. Интернет в этом деле также может помочь. Конечно, найти можно лишь то, что существует. Говоря другими словами, если данные о человеке есть в Интернете, то их можно найти. Первое, что нужно сделать - это набрать в поисковике примерно следующие запросы:

    "Фамилия Имя"
    "Имя Фамилия"
    "Имя Фамилия Отчество"
    "Фамилия И.О."

    Указывать поиск лучше всего по точной фразе, т.е. в кавычках. Если имя человека является широко распространенным, например, "Иванов Иван", то в строке запроса можно добавлять различные уточняющие значения - название города или места работы. Запрос типа ""Иванов Иван" Москва руководитель начальник ООО Финики и бананы" позволит сузить область поиска.

    Если удалось найти e-mail, то следующим шагом будет указание адреса этого e-mail в строке запроса. В случае, когда электронная почта заведена на популярном портале Mail.Ru, можно проверить адрес электронной почты через Mail.RU Агент (рис. 8.11):

    (рис 8.11) Поиск пользователя по электронной почте.

    Таким образом можно узнать возраст, день и год рождения, а также фотографии пользователя. Обратим внимание, что если вы не хотите, чтобы вас можно было таким образом найти, тогда в своем почтовом ящике, в разделе "Настройки \ Анкетные данные" следует снять галочку "Отображать эти данные в моей анкете в Mail.Ru Агенте…" (рис. 8.12):

    (рис 8.12) Настройка анкетных данных в почтовом ящике Mail.Ru.

    Аналогичной функциональностью обладают агенты других почтовых служб.

    Живой журнал пользователя - это отличный способ узнать очень многое о человеке. Большинство живых журналов содержат не философские измышления об устройстве бытия и основах мироздания, а вполне приземленные житейские описания. Работы, друзей, событий, происшествий. С подробными фотографиями, комментариями участников, а также видеозаписи. Хвастливые и скромные, радостные и печальные, записи блога очень часто могут дать исчерпывающее представление о человеке. Следует попробовать открыть следующие адреса:

    Фамилия.livejournal.com
    Имя_Фамилия.livejournal.com
    Фамилия_Имя.livejournal.com
    Имя.livejournal.com (может быть, искомый персонаж успел зарегистрировать журнал самым первым?)
    Ник.livejournal.com

    Последний вариант относится к самым вероятным - люди любят использовать один и тот же псевдоним (ник) на разных форумах. Достаточно установить соответствие между реальным именем и ником, чтобы попробовать посмотреть соответствующий живой журнал. Обратим внимание на то, что сам по себе блог и его профиль могут не индексироваться в поисковых системах с привязкой к реальному имени. То есть если набрать фразу вроде "Живой журнал Иванова Ивана, livejournal.com", то результат будет отрицательным по той простой причине, что в блогах могут вообще не указываться реальные имена. Вариант же ник.livejournal.com работает в подавляющем большинстве случаев. Также следует попробовать поискать с указанным ником живые журналы в других популярных сервисах блогов, например в liveinternet.ru.

    Набираем в Яндексе "Поиск людей" и переходим в каталог, который содержит ссылки на популярные социальные сети (рис. 8.14):

    (рис 8.13) Каталог Яндекса "Поиск людей".

    К сожалению, на момент написания курса, большинство социальных сетей закрывают свое содержимое от индексации поисковиками. Поэтому мы не сможем найти того же Ивана Иванова по запросу в поисковике, даже если он зарегистрирован во многих сетях. Поэтому здесь нам просто придется довольно долго ходить по всем сайтам каталога, регистрироваться, а затем уже искать нужных пользователей.

    Современные базы данных, такие как справочники городских телефонов, базы номеров ГИБДД, справочники сотовых операторов, предназначены для служебного пользования. В Рунете нет законного аналога ресурсу http://people.yahoo.com/, на котором можно было бы найти номер телефона или адрес по имени человека. Однако многочисленные предложения приобретения таких баз, только своим существованием указывающие на преступную халатность, в сети есть. Это следует учитывать, хотя бы для представления возможностей злоумышленников, способных ими воспользоваться.

    Интернет и плагиат

    Давайте разберемся, что такое цитирование, плагиат и рерайтинг (Rewriting). Для начала цитата:

    Реферат (лат. refero - доношу, сообщаю, излагаю) - краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада; доклад на заданную тему, сделанный на основе критического обзора соответствующих источников информации (научных трудов, литературы по теме). Реферат является адекватным по смыслу изложением содержания первичного текста.

    Реферат отражает главную информацию первоисточника. Реферат должен быть информативным, объективно передавать информацию, отличаться полнотой изложения, а также корректно оценивать материал, содержащийся в первоисточнике.

    Различают два вида рефератов: продуктивные и репродуктивные. Репродуктивный реферат воспроизводит содержание первичного текста. Продуктивный содержит творческое или критическое осмысление реферируемого источника.

    Источник: http://ru.wikipedia.org/wiki/Реферат

    Итак, перед вами было цитирование. Оно отделяется от основного текста, указывается источник, словом, его цель - передать какую-либо мысль, которая принадлежит кому-то. А я думаю, что реферат - это краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада; доклад на заданную тему, сделанный на основе критического обзора соответствующих источников информации (научных трудов, литературы по теме). Последнее предложение - пример чистейшего плагиата. Здесь налицо попытка выдать чужую мысль за свою, которая вставляется в свой блок текста. Ну и наконец, пример рерайтинга (переписывания):

    Реферат (лат. refero - доношу, сообщаю, излагаю) - это краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада на определенную тематику, представляющий собой критический обзор каких-либо источников информации (научных публикаций, статей). Содержание реферата должно соответствовать оригинальному тексту.

    Реферат содержит суть материалов оригинала. Реферат должен содержать факты, которые должны освещаться объективно и с достаточной полнотой. Реферат также должен давать правильную оценку материалу, который приводится в источнике.

    Существуют два вида рефератов: продуктивные и репродуктивные. Репродуктивный реферат представляет собой пересказ первичного текста. Продуктивный основан на творческой или критической переработке оригинальных источников.

    Понятно, что цитирование употребляется мало и к месту. Цитирование - это хорошо. А вот рерайтинг и плагиат - это плохо. Плагиат плох тем, что при его использовании происходит попытка выдать чужие мысли за свои. И получить за это выгоду - бывает, и материальную. Плагиат - это попытка жить чужой головой. Возможность получения практически любых текстов в Интернете привела к тому, что плагиат принял массовый характер. Служебные инструкции, девизы компаний, даже объявления воспроизводятся банальными копированием и вставкой. Возьмем конкретный пример - раздел вакансий в студии дизайна Артемия Лебедева: http://www.artlebedev.ru/studio/vacancy/. Там есть такая фраза (внимание! Цитирование): "Постоянный раздел о вакансиях - намек на то, что молодые талантливые специалисты нужны нам всегда". Эта фраза так нравится многим компаниям, что они ее просто копируют на своих сайтах. Естественно, выдавая ее за свой неповторимый стиль. В кавычках (поиск по точной фразе!) запускаем запрос в Яндексе и видим эти самые компании (рис. 8.14):

    (рис 8.14) Поиск по точной фразе "Постоянный раздел о вакансиях - намек на то, что молодые талантливые специалисты нужны нам всегда".

    О существовании таких "единомышленников" знают и в самой студии: http://www.artlebedev.ru/everything/clones/vacancy/

    Этот небольшой пример показателен - даже лицо компании, включающее в себя стандартный раздел "Вакансии" может быть сделано за две минуты блуждания по Интернету и выделением текста с последующим использованием сочетаний клавиш CTRL + C, CTRL + V. Чего уж тут говорить о рефератах, с которых и начался этот раздел. Создание реферата сегодня сводится зачастую к его скачиванию из банка рефератов, изменению титульного листа, распечатке и собственно, сдаче преподавателю.

    Что касается рерайтинга - здесь трудно дать однозначную оценку. Понятно, что по трудозатратам он не сравним с придумыванием своего авторского текста. Я совершенно не думая, переписал три абзаца определения, взятого из википедиии. Рерайтинг - это создание электронного мусора. Однако почему тогда он является востребованным? Ну, таким образом можно быть новостным изданием, не имея штата аккредитованных корреспондентов. Быть популярным тематическим изданием, не имея коллектива профессиональных авторов. Заполнять содержимое - что поделать, если открытый сайт фирмы по разведению кактусов 1589-й по счету в Интернете. Словом, искусно воровать чужие тексты. Но понятно, что рерайтинг - более сложная и тонкая работа, чем банальное копирование и вставка. Поэтому для рерайтеров вакансии встречаются, для плагиаторов - нет.

    Как определять уникальность текста? Как не получить материал, абзацы которого представляет собой попурри из давно уже известных высказываний и мыслей? В этом нам опять поможет Интернет. Рассмотрим несколько способов.

    Поиск по ключевой фразе

    Для начала, нужно попробовать просто поискать фрагмент текста по фразам. Поисковый запрос Яндекса, например, может обрабатывать до 300 символов. Попробуем вставить характерную фразу "краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада" (рис. 8.15):

    (рис 8.15) Поиск по фразе "краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада".

    Яндекс выдает достаточно большое число ссылок на различного рода энциклопедии. Понятно, что это определение не является уникальным. Ясно также и то, что плагиат этого определения будет найден чрезвычайно легко.

    Попробуем поискать версию этой же фразы, которая была переписана: "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада" (рис. 8.16):

    (рис 8.16) Поиск по точной фразе "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада".

    Точное соответствие по фразе не дало результатов. Однако если мы уберем кавычки и повторим запрос, то найдем схожие определения (рис. 8.17):

    (рис 8.17) Поиск по фразе "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада" без указания кавычек.

    В принципе, немного поизучав предлагаемые ссылки, можно установить соответствие между оригиналом и его измененным вариантом.

    При поиске текста, исправленного рерайтером, или плагиата, вкрапленного в текст, следует искать яркие выражения, характерные обороты, связки терминов. Достаточно найти два-три узнаваемых слова, провести поиск по их сочетанию, чтобы найти оригинальные материалы, которые были использованы полностью или частично.

    Недостатком поиска по ключевым фразам является относительная трудоемкость способа и низкая скорость проверки текста.

    Поиск на сайтах антиплагиата

    Сервис Antiplagiat.Ru позволяет выявлять тексты с плагиатом, копируя их в онлайн-форме (рис. 8.18):

    (рис 8.18) Сервис Antiplagiat.Ru.

    Здесь мы поместили для проверки оригинального определения слова "Реферат". В результате появляется отчет, указывающий на ссылки, с которых были взяты заимствования (рис. 8.19):

    (рис 8.19) Отчет о проверке текста.

    Отчет содержит оценку оригинальности, которая подсчитывается на основании процентного соотношения оригинального и копированного текста. Фрагменты чужого текста выводятся в виде, удобном для сравнения.

    Попробуем теперь проверить текст, который был отредактирован. Отчет о проверке сообщает, что текст полностью оригинальный (рис. 8.20):

    (рис 8.20) Отчет о проверке текста после рерайтинга.

    И хотя мы знаем, что это не так, сервис все же убеждает нас в обратном. Впрочем, работу по изменению текста можно считать творческой с точки зрения студенческого реферата. По крайней мере, это не банально скопированный и вставленный блок текста.

    Антиплагиат киллер

    Появление сервиса antiplagiat.ru в свое время вызвал панику в студенческой среде. Преподаватели устанавливали 10% лимит для заимствованных фрагментов, требуя для всей остальной работы оригинального текста. Студенты узнав, что появилась система, которую нельзя обмануть, были ужасно огорчены. Но на самом деле не все так уж хорошо для преподавателей и не все так плохо для студентов. Мы с вами уже убедились, что переработанный текст уже нельзя уличить. Кроме этого, пристальное внимание к сервису антиплагиата позволило создателям сайта http://www.antiplagiatkiller.ru/ разработать программу, помогающую плагиатчикам изменять фрагменты.

    Суть работы программы заключается в сверке двух документов - оригинального и копированного. Последовательная проверка и изменение абзацев позволяет добиться того, что текст не будет распознаваться как плагиат (рис. 8.21):

    (рис 8.21) Подсказки помогут плагиатчикам перекроить свою "работу".

    Разработчики этой программы утверждают, что им удалось определить механизм распознавания текста, применяемый на сайте antiplagiat.ru. И хотя проверка с помощью этой программы лишь означает возможность локально проверять свои работы, она все же определенно помогает плагиатчикам.

    Double Content Finder

    Программа Double Content Finder, бесплатно предлагаемая для скачивания на сайте http://textbroker.ru/ - еще один инструмент для борьбы с плагиатом. Проверяемый текст может быть взят из файла, по ссылке или из текстового поля (рис. 8.22):

    (рис 8.22) Программа Double Content Finder.

    Здесь мы снова поместили оригинальное определение реферата. В результате онлайн-проверки программа также выдала множество ссылок (рис. 8.23):

    (рис 8.23) Проверка текста с плагиатом.

    Проверка отредактированного определения также не дала результатов - текст признан оригинальным (рис. 8.24):

    (рис 8.24) Проверка измененного текста.

    Заметим, что Double Content Finder предлагает более удобный интерфейс для проверки текстов, чем сайт antiplagiat.ru

    PlagiatInform

    Для университетов и институтов, а также издательств, компания СофтИнформ разработала уникальный инструмент проверки текстов - PlagiatInform (http://www.searchinform.ru/main/full-text-search-products-searchinform-plagiatinform.html). Комплексное решение может быть развернуто на базе локальной сети и Интернета. Локальная база материалов может содержать образцы текстов для сверки, которые отбираются преподавателями. Комбинация этой базы вместе с материалами из Интернета позволяют анализировать проверяемые тексты (рис. 8.25):

    (рис 8.25) Принцип работы системы PlagiatInform. Иллюстрация не плагиат, а собственность компании СофтИнформ.

    Возможность нарабатывать собственную базу материалов в сочетании с технологиями поиска - достаточно мощное средство для борьбы с плагиатом.

    И все-таки, оценив некоторые системы борьбы с плагиатом, можно сделать выводы. На сегодняшний день большинство систем позволяют находить банальное копирование текста, осуществляемое по принципу "CTRL + C, CTRL + V" с некоторыми простыми вариациями. Впрочем, именно оно и встречается наиболее часто. Другие методы обмана могут выявляться только компетентными специалистами, обладающими знаниями в соответствующей предметной области.

    Страницы:

    Google

    Google - это обозначение числа, получаемого из единицы и ста нулей. А еще это самая популярная поисковая система в мире. Интерфейс системы доступен почти на всех языках мира, а одним из адресов, впрочем, самым нужным нам, является http://www.google.ru (рис. 8.1):

    (рис 8.1) Главная страница Google Россия ( http://www.google.ru)

    Кнопка "Мне повезёт!" откроет самую релевантную ссылку по запросу. В данном случае мы сразу увидим сайт http://www.intuit.ru.

    Правила поиска в Google очень похожи на правила Яндекс. Их описание можно видеть в разделе "Основные сведения о поиске Google" (http://www.google.ru/intl/ru/help/basics.html), который доступен по ссылке "Все о Google" (http://www.google.ru/intl/ru/about.html). Как обычно, поиск осуществляется без учета заглавных букв, запросы "ИНТУИТ", "ИнТуИт", "интуит" будут обработаны совершенно одинаково. В запросе склоняются слова и поиск "дистанционного обучения" позволит найти и просто "дистанционное обучение". Поиск по точной фразе также задается с помощью кавычек - запрос "Понедельник начинается в субботу" позволит найти именно произведение братьев Стругацких, а не упоминание дней недели. Исключение слова, в отличие от Яндекса, осуществляет указанием знака минуса перед словом. Запрос "машина - автомобиль" исключит упоминание слова "машина" в значении "автомобиль".

    Расширенный поиск Google (http://www.google.ru/advanced_search?hl=ru), в соответствии со своим названием, предоставляет продвинутые инструменты поиска (рис. 8.2):

    (рис 8.2) Расширенный поиск Google.

    Использовать его достаточно легко, поскольку все условия определяются достаточно ясно. Google предлагает несколько забавных возможностей поиска. Например, калькулятор, позволяющий вычислять выражения по запросу (рис. 8.3):

    (рис 8.3) Калькулятор Google.

    Калькулятор даже знает ответ на вопрос, сколько чайных ложек в стакане. Конвертор валют понимает вопросы, формулируемые на вполне человеческом языке (рис. 8.4):

    (рис 8.4) Перевод долларов в рубли.

    Как и Яндекс, Google предлагает множество сервисов: http://www.google.ru/intl/ru/options. Некоторые из них, например Документы Google (doc.google.com) или Ответы (http://otvety.google.ru/otvety/) были новаторскими и задавали направление всей индустрии.

    Google предлагает всем желающим принять участие в тестировании своих экспериментальных разработок на площадке http://labs.google.com. Яндекс тоже предлагает подобный проект: http://nano.yandex.ru/

    Google Earth

    В фильмах любят использовать прием, когда какой-то город или местность показываются из космоса. Камера моментально наезжает, словно метеор, приближаясь к Земле. Заканчивается все тем, что проступают городские улицы и далее действие идет уже в обычном режиме.

    Теперь любой пользователь Интернета может сам воссоздать такой трюк. Достаточно скачать программу Google Earth (http://earth.google.com/, ~ 7,36 МБ) и, подключившись к Интернету, управлять всей планетой. Земной шар крутится, а камера моментально снижается над поверхностью и летает над ней на очень маленькой высоте, вплоть до 50-метрового масштаба местности (рис. 8.5):

    (рис 8.5) Москва в Google Earth.

    Допустимая высота камеры от 63 тыс. км (почти полторы величины геостационарной орбиты) до нескольких метров.

    С помощью Google Earth можно увидеть почти все уголки Земного шара. Различаются дома, стадионы, площади, реки и горы - словом, видны все города и районы, в которых вы когда-то были.

    В режиме имитатора полета предлагается выполнить путешествие на сверхзвуковом истребителе. Трехмерный ландшафт будет разворачивать с действительной скоростью движения, зависящей от высоты полета (рис. 8.6):

    (рис 8.6) Полет над Санкт-Петербургом на реактивном истребителе.

    Мы можем выполнять фигуры высшего пилотажа, и даже отправить самолет в штопор. Пролететь над всей страной, от Мурманска до Владивостока, в режиме реального времени, любуясь закатом Солнца - стало реальностью. Достаточно ввести название города или населенного пункта, чтобы Google Earth плавно и аккуратно развернул Земной шар в нужную точку (рис. 8.7):

    (рис 8.7) Из ночного Владивостока в дневной Мурманск. Высота 10 тыс. км.

    Google Earth - это множество сервисов, для охвата которых можно было бы написать отдельную книгу. Google Street View позволяет двигаться по улицам на автомобиле и смотреть по сторонам. С помощью Panoramio пользователи добавляют фотографии с привязкой к конкретным местам. Именно отмеченные точки отображаются в виде светлячков-шариков. Google 3D Warehouse предлагает трехмерные модели крупнейших зданий. Wikimapia - это множество слоев, которые могут добавлять пользователи. Маленькие кусочки поверхности можно подписывать, совсем как обычные бумажные карты. Ну и конечно, в программе есть обычные возможности, вроде измерения расстояний, поиск компаний, прокладывания маршрутов и перехода к обычным, поверхностным картам Google.

    Если надоест разглядывать земную поверхность, можно обратить свой взгляд в небо. Созвездия и планеты, туманности и кометы - великолепный планетарий прямо на вашем компьютере (рис. 8.8):

    (рис 8.8) Крабовидная туманность.

    Увидеть туманность Андромеды легко - достаточно просто набрать в поисковой строке "Туманность Андромеды".

    Google Earth - это великолепная программа для всей семьи. Она может превратить изучение географии и астрономии в увлекательное занятие, от которого совершенно невозможно оторваться.

    Для приемлемой работы достаточно соединения с Интернетом на скорости в 64 Кбит\сек. Большая скорость обеспечит большую комфортность работы. Впрочем, даже на dial-up соединении программой можно пользоваться. Превосходный механизм кеширования позволяет возвращаться к уже однократно загруженной панораме.

    Рамблер

    Рамблер (http://www.rambler.ru/)- это старейшая поисковая система Рунета, запущенная в 1996 году . Сегодня это крупный портал (в настоящем смысле этого слова), объединяющий множество сервисов. Можно обратить внимание на экспериментальную версию нового поиска (http://beta.rambler.ru/), разрабатываемую параллельно с работой основной (рис. 8.9):

    (рис 8.9) Экспериментальная версия поиска Рамблер.

    Расширенный поиск обычного Рамблера также предлагает задать множество условий (рис. 8.10):

    (рис 8.10) Расширенный поиск Рамблера http://www.rambler.ru/cgi-bin/advanced.cgi?set=www

    Рамблер также предлагает уже известные нам правила задания продвинутых запросов, включающих в себя различные условия http://www.rambler.ru/doc/help.shtml.

    SEO-оптимизация и увеличение энтропии

    Десять лет назад поиск информации в Интернете напоминал детективное расследование. Тогда были разумеется, поисковые системы. Для поиска термина также нужно было набрать его в адресной строке. В куче появившихся ссылок приходилось выбирать жемчужины - сайты с нужным содержимым. Откуда же тогда брались все остальные страницы?

    Представим себе, например, сайт туристической фирмы "Лето-отдых". Очень простой сайт, состоящий из нескольких страниц. На одной из них приводится описание тура в Сочи. Цены, условия, контакты - словом, все то, что нужно. Представим также себе, что таких сайтов несколько. Несколько реальных различных фирм, соответственно несколько представительств в Интернете. Реальный бизнес и его отражение в сети.

    Теперь представим себе веб-мастера, который не владеет туристической фирмой, не предлагает поездки в Сочи, но умеет делать веб-страницы. Он делает одну страницу, на которую выводит кучу ссылок на сайты туристических фирм. "Отдых летом в Сочи", "Лето-отдых в Сочи", "Отдых в Сочи", "Поездки на море", "Дешевые туры в Сочи", "Условия проживания в гостиницах в Сочи" - вся страница испещрена подобными ссылками. Естественно, такая страница будет содержать как бы больше информации о поездке в Сочи, чем аскетичная страница настоящей турфирмы, предлагающей настоящие туры. Следовательно, в поисковых системах по запросу "Отдых в Сочи" она будет появляться на более ранних позициях, чем страница туристической фирмы. На "сайт" веб-мастера будут заходить много посетителей, поэтому ему остается лишь разместить там рекламу и получать за нее деньги.

    Другой веб-мастер, увидев легкий доход первого веб-мастера, решил сделать свою страницу. Он изменил ее оформление, повесил еще больше рекламы, добавил те же самые ссылки - словом, сделал свой супер-каталог.

    После того, как 1253 веб-мастера разместили свои каталоги, умный веб-мастер создал свой каталог. На котором стояли ссылки уже не на исходные сайты туристических фирм, а на каталоги обычных веб-мастеров. И конечно, он также разместил кучу рекламы с целью получать за нее кучу денег.

    Пример умного веб-мастера оказался заразительным. Другие умные веб-мастера принялись мастерить свои каталоги каталогов, словом, процесс рос лавинообразным образом. Энтропия (хаос) увеличивается, полезной информации не прибавляется.

    Что теперь ждет обычного пользователя, который набирает в поисковике "Отдых в Сочи"?. Он попадает на супер-каталог. Подождав, пока загрузится вся реклама, он ее посмотрел, затем все-таки перешел по ссылке каталога "Туры в Сочи - предложения". И снова попал в другой каталог. Перешел с другого каталога - и снова попал в каталог. Потеряв терпение и закрыв, наконец, каталоги каталогов, пользователь возвращается в окно поисковика и методично просматривая результаты, наконец, на 1000-ссылке попадает на сайт фирмы "Лето-отдых".

    Понятно, что не для всех запросов был смысл создавать каталоги и каталоги каталогов. Например, нет смысла собирать ссылки на сайты синхрофазотронов и общей теории относительности. Потому что большинство пользователей не каждый день набирают такие запросы. Так (или почти так) обстояло с поиском в Интернет лет десять назад. Все были довольны, кроме самих пользователей, которые, найдя жемчужину настоящего сайта, были вынуждены записывать его, добавлять в Избранное, обмениваться ссылками - словом, тщательно беречь найденные результаты.

    Понятно, что долго так продолжаться не могло. Появилась релевантность, которую придумали в компании Google и которая почти одновременно была реализована в компании Яндекс.

    Релевантность (от англ. relevant) - это степень соответствия запроса и найденного результата, то есть его уместность. Полный механизм релевантности представляет собой ноу-хау поисковых компаний, которые, разумеется, раскрывать его не собираются. Но этот механизм позволяет получать конечному пользователю именно то, что он ищет. Для того, чтобы понять, как примерно работает идея релевантности, рассмотрим следующий пример.

    Сайт туристической фирмы "Лето-отдых" стал очень большим. На нем публикуются мнения и отзывы туристов, предложения отелей, расписание авиарейсов в Сочи. Тысячи посетителей заходят на него каждый день, с удовольствием читают новые мнения, отзывы, разглядывают фотографии. В своих сайтах они ставят ссылки на замечательный сайт фирмы. Да, и каталоги тоже ставят множество ссылок на этот сайт. Есть еще конкурент туристической фирмы, который называется "Зима-отдых". Их сайт достаточно неплохой, но его аудитория поменьше. Поэтому и в каталогах появляется он реже.

    Поисковые системы внимательно подсчитали количество ссылок на сайт фирмы "Лето-отдых", учли количество посетителей, и вывели его на первое место в результате. На второе поставили сайт "Зима-отдых". Сайты остальных фирм - в таком же порядке. Ну а каталоги, супер-каталоги и прочие каталоги-каталогов разместились на заслуженном 1000 месте, которое теперь никто и не смотрит.

    В этом заключается идея расчета авторитетности страницы, которая называется (PageRank). Конечно, современная индексация страниц включает в себя множество параметров, но идея их сводится к предоставлению пользователям именно того, что они ищут.

    Теперь нет смысла создавать раздражающие каталоги с рекламой и множеством ссылок. По ним все равно никто не будет ходить, потому что в поисковых системах они будут занимать крайне низкие позиции.

    Для завершения картины, представим себе еще одну задачу. Владельцы сайта "Зима-отдых" захотели, чтобы в поисковых системах они были на первом месте, оттеснив сайт "Лето-отдых". Для этого они обратились к SEO (от англ. search engine optimization, SEO, поисковая оптимизация)-мастерам, которые обычно предлагают следующие подходы:

  • Белая оптимизация. Это законная, честная работа над повышением ресурса в позиции. Сюда входит написание уникальных, интересных материалов, которые будут привлекать посетителей. Например, в рассматриваемом случае, опубликовать интересные статьи, советы, которые будут привлекать посетителей. SEO-оптимизаторы также исправляют содержимое страниц, добавляя необходимое количество ключевых слов, а также размещают информацию о ресурсе в каталогах самих поисковых систем.
  • Серая оптимизация. Это не вполне честная работа над популяризацией ресурса. Например, если просто взять и скопировать тексты с сайта "Лето-отдых". Или договориться с другими популярными сайтами, чтобы они поставили ссылки на данный сайт.
  • Черная оптимизация. Она работает, но если ее обнаруживают в поисковых системах, то раскручиваемый ресурс вообще банится или понижается в рейтинге. К методам черной оптимизации относится спам, размещение ссылки ресурса на форумах, досках объявлений, блогах, и т.д.
  • В целом, SEO-оптимизация конечно нужна (особенно только что созданным сайтам, аналоги которых уже есть) но и без нее работает правило - если ресурс предлагает уникальную информацию, если он новаторский и интересный, то без всяких методов раскрутки он займет свое заслуженное первое место.

    Прочитать то, что думает, например, команда Яндекса об оптимизации сайтов, можно в разделе Яндекс.Вебмастер (http://help.yandex.ru/webmaster/). Также Яндекс предоставляет инструменты http://webmaster.yandex.ru/, позволяющие оценить свой сайт с точки зрения поисковых запросов.

    Какая поисковая система лучше?

    Холивар (от англ. holy war - священная война) - это обмен сообщениями на форумах и блогах, когда участники пытаются убедить друг друга в преимуществе некоторых неочевидных альтернатив. Что лучше - Windows или Linux? Какой браузер лучше - Opera или Mozilla Firefox? Какая поисковая система ищет лучше? И хотя все эти вопросы зачастую лишены смысла, а проведение исследований чаще всего невозможно, поскольку трудно подобрать объективные критерии, все же нельзя сказать, что это задаваемые вопросы - риторические.

    Что касается поисковых систем, то их можно оценить по количеству обработанных запросов. Согласно исследованиям аналитической компании comScore (http://www.comscore.com/press/release.asp?press=2018) за декабрь 2007 года, рейтинг мировых поисковых систем выглядит так:

  • Google Sites: 41 млрд 345 млн; доля рынка 62,4%.
  • Yahoo! Sites: 8 млрд 505 млн; 12,8%.
  • Baidu.com: 3 млрд 428 млн; 5,2%.
  • Microsoft: 1 млрд 940 млн; 2,9%.
  • NHN Corporation: 1 млрд 572 млн; 2,4%.
  • eBay: 1 млрд 428 млн; 2,2%.
  • Time Warner Network: 1 млрд 062 млн; 1,6%.
  • Ask Network: 728 млн; 1,1%.
  • Yandex: 566 млн; 0,9%.
  • Alibaba.com: 531 млн; 0,8%.
  • Яндекс занимает девятое место. Много это или мало? Учитывая то, что количество англоязычных пользователей значительно превосходит число русскоязычных, это отличный результат. Третье место компании Baidu.com объясняется тем, что это китайская поисковая система, обслуживающая запросы страны с населением более миллиарда человек. Понятно, что Яндексу удалось обойти другие русскоязычные поисковые системы и это объективный показатель.

    Вместе с тем, представленные цифры все же не отвечают на вопрос, какая из поисковых систем ищет лучше? Ищет лучше в Рунете? Именно здесь и начинается холивар.

    Все же можно дать несколько замечаний, позволяющих оценить работу системы в целом. Спустя какое время после размещения уникального материала, например, в блоге, он становится доступным в результатах поиска? Это легко проверить на собственном блоге. Какая система дает больше результатов при поиске редких, уникальных или специализированных запросов? Какова релевантность выдаваемых при этом результатов? Насколько выдаваемые результаты поиска являются актуальными?

    Можно предложить множество подобных вопросов, которые каждый пользователь решает для себя сам.

    Поиск людей

    Бывает, что возникает задача найти человека. Или узнать о нем как можно больше сведений. Интернет в этом деле также может помочь. Конечно, найти можно лишь то, что существует. Говоря другими словами, если данные о человеке есть в Интернете, то их можно найти. Первое, что нужно сделать - это набрать в поисковике примерно следующие запросы:

    "Фамилия Имя"
    "Имя Фамилия"
    "Имя Фамилия Отчество"
    "Фамилия И.О."

    Указывать поиск лучше всего по точной фразе, т.е. в кавычках. Если имя человека является широко распространенным, например, "Иванов Иван", то в строке запроса можно добавлять различные уточняющие значения - название города или места работы. Запрос типа ""Иванов Иван" Москва руководитель начальник ООО Финики и бананы" позволит сузить область поиска.

    Если удалось найти e-mail, то следующим шагом будет указание адреса этого e-mail в строке запроса. В случае, когда электронная почта заведена на популярном портале Mail.Ru, можно проверить адрес электронной почты через Mail.RU Агент (рис. 8.11):

    (рис 8.11) Поиск пользователя по электронной почте.

    Таким образом можно узнать возраст, день и год рождения, а также фотографии пользователя. Обратим внимание, что если вы не хотите, чтобы вас можно было таким образом найти, тогда в своем почтовом ящике, в разделе "Настройки \ Анкетные данные" следует снять галочку "Отображать эти данные в моей анкете в Mail.Ru Агенте…" (рис. 8.12):

    (рис 8.12) Настройка анкетных данных в почтовом ящике Mail.Ru.

    Аналогичной функциональностью обладают агенты других почтовых служб.

    Живой журнал пользователя - это отличный способ узнать очень многое о человеке. Большинство живых журналов содержат не философские измышления об устройстве бытия и основах мироздания, а вполне приземленные житейские описания. Работы, друзей, событий, происшествий. С подробными фотографиями, комментариями участников, а также видеозаписи. Хвастливые и скромные, радостные и печальные, записи блога очень часто могут дать исчерпывающее представление о человеке. Следует попробовать открыть следующие адреса:

    Фамилия.livejournal.com
    Имя_Фамилия.livejournal.com
    Фамилия_Имя.livejournal.com
    Имя.livejournal.com (может быть, искомый персонаж успел зарегистрировать журнал самым первым?)
    Ник.livejournal.com

    Последний вариант относится к самым вероятным - люди любят использовать один и тот же псевдоним (ник) на разных форумах. Достаточно установить соответствие между реальным именем и ником, чтобы попробовать посмотреть соответствующий живой журнал. Обратим внимание на то, что сам по себе блог и его профиль могут не индексироваться в поисковых системах с привязкой к реальному имени. То есть если набрать фразу вроде "Живой журнал Иванова Ивана, livejournal.com", то результат будет отрицательным по той простой причине, что в блогах могут вообще не указываться реальные имена. Вариант же ник.livejournal.com работает в подавляющем большинстве случаев. Также следует попробовать поискать с указанным ником живые журналы в других популярных сервисах блогов, например в liveinternet.ru.

    Набираем в Яндексе "Поиск людей" и переходим в каталог, который содержит ссылки на популярные социальные сети (рис. 8.14):

    (рис 8.13) Каталог Яндекса "Поиск людей".

    К сожалению, на момент написания курса, большинство социальных сетей закрывают свое содержимое от индексации поисковиками. Поэтому мы не сможем найти того же Ивана Иванова по запросу в поисковике, даже если он зарегистрирован во многих сетях. Поэтому здесь нам просто придется довольно долго ходить по всем сайтам каталога, регистрироваться, а затем уже искать нужных пользователей.

    Современные базы данных, такие как справочники городских телефонов, базы номеров ГИБДД, справочники сотовых операторов, предназначены для служебного пользования. В Рунете нет законного аналога ресурсу http://people.yahoo.com/, на котором можно было бы найти номер телефона или адрес по имени человека. Однако многочисленные предложения приобретения таких баз, только своим существованием указывающие на преступную халатность, в сети есть. Это следует учитывать, хотя бы для представления возможностей злоумышленников, способных ими воспользоваться.

    Интернет и плагиат

    Давайте разберемся, что такое цитирование, плагиат и рерайтинг (Rewriting). Для начала цитата:

    Реферат (лат. refero - доношу, сообщаю, излагаю) - краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада; доклад на заданную тему, сделанный на основе критического обзора соответствующих источников информации (научных трудов, литературы по теме). Реферат является адекватным по смыслу изложением содержания первичного текста.

    Реферат отражает главную информацию первоисточника. Реферат должен быть информативным, объективно передавать информацию, отличаться полнотой изложения, а также корректно оценивать материал, содержащийся в первоисточнике.

    Различают два вида рефератов: продуктивные и репродуктивные. Репродуктивный реферат воспроизводит содержание первичного текста. Продуктивный содержит творческое или критическое осмысление реферируемого источника.

    Источник: http://ru.wikipedia.org/wiki/Реферат

    Итак, перед вами было цитирование. Оно отделяется от основного текста, указывается источник, словом, его цель - передать какую-либо мысль, которая принадлежит кому-то. А я думаю, что реферат - это краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада; доклад на заданную тему, сделанный на основе критического обзора соответствующих источников информации (научных трудов, литературы по теме). Последнее предложение - пример чистейшего плагиата. Здесь налицо попытка выдать чужую мысль за свою, которая вставляется в свой блок текста. Ну и наконец, пример рерайтинга (переписывания):

    Реферат (лат. refero - доношу, сообщаю, излагаю) - это краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада на определенную тематику, представляющий собой критический обзор каких-либо источников информации (научных публикаций, статей). Содержание реферата должно соответствовать оригинальному тексту.

    Реферат содержит суть материалов оригинала. Реферат должен содержать факты, которые должны освещаться объективно и с достаточной полнотой. Реферат также должен давать правильную оценку материалу, который приводится в источнике.

    Существуют два вида рефератов: продуктивные и репродуктивные. Репродуктивный реферат представляет собой пересказ первичного текста. Продуктивный основан на творческой или критической переработке оригинальных источников.

    Понятно, что цитирование употребляется мало и к месту. Цитирование - это хорошо. А вот рерайтинг и плагиат - это плохо. Плагиат плох тем, что при его использовании происходит попытка выдать чужие мысли за свои. И получить за это выгоду - бывает, и материальную. Плагиат - это попытка жить чужой головой. Возможность получения практически любых текстов в Интернете привела к тому, что плагиат принял массовый характер. Служебные инструкции, девизы компаний, даже объявления воспроизводятся банальными копированием и вставкой. Возьмем конкретный пример - раздел вакансий в студии дизайна Артемия Лебедева: http://www.artlebedev.ru/studio/vacancy/. Там есть такая фраза (внимание! Цитирование): "Постоянный раздел о вакансиях - намек на то, что молодые талантливые специалисты нужны нам всегда". Эта фраза так нравится многим компаниям, что они ее просто копируют на своих сайтах. Естественно, выдавая ее за свой неповторимый стиль. В кавычках (поиск по точной фразе!) запускаем запрос в Яндексе и видим эти самые компании (рис. 8.14):

    (рис 8.14) Поиск по точной фразе "Постоянный раздел о вакансиях - намек на то, что молодые талантливые специалисты нужны нам всегда".

    О существовании таких "единомышленников" знают и в самой студии: http://www.artlebedev.ru/everything/clones/vacancy/

    Этот небольшой пример показателен - даже лицо компании, включающее в себя стандартный раздел "Вакансии" может быть сделано за две минуты блуждания по Интернету и выделением текста с последующим использованием сочетаний клавиш CTRL + C, CTRL + V. Чего уж тут говорить о рефератах, с которых и начался этот раздел. Создание реферата сегодня сводится зачастую к его скачиванию из банка рефератов, изменению титульного листа, распечатке и собственно, сдаче преподавателю.

    Что касается рерайтинга - здесь трудно дать однозначную оценку. Понятно, что по трудозатратам он не сравним с придумыванием своего авторского текста. Я совершенно не думая, переписал три абзаца определения, взятого из википедиии. Рерайтинг - это создание электронного мусора. Однако почему тогда он является востребованным? Ну, таким образом можно быть новостным изданием, не имея штата аккредитованных корреспондентов. Быть популярным тематическим изданием, не имея коллектива профессиональных авторов. Заполнять содержимое - что поделать, если открытый сайт фирмы по разведению кактусов 1589-й по счету в Интернете. Словом, искусно воровать чужие тексты. Но понятно, что рерайтинг - более сложная и тонкая работа, чем банальное копирование и вставка. Поэтому для рерайтеров вакансии встречаются, для плагиаторов - нет.

    Как определять уникальность текста? Как не получить материал, абзацы которого представляет собой попурри из давно уже известных высказываний и мыслей? В этом нам опять поможет Интернет. Рассмотрим несколько способов.

    Поиск по ключевой фразе

    Для начала, нужно попробовать просто поискать фрагмент текста по фразам. Поисковый запрос Яндекса, например, может обрабатывать до 300 символов. Попробуем вставить характерную фразу "краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада" (рис. 8.15):

    (рис 8.15) Поиск по фразе "краткое изложение содержания научной работы, книги или учения, оформленное в виде письменного публичного доклада".

    Яндекс выдает достаточно большое число ссылок на различного рода энциклопедии. Понятно, что это определение не является уникальным. Ясно также и то, что плагиат этого определения будет найден чрезвычайно легко.

    Попробуем поискать версию этой же фразы, которая была переписана: "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада" (рис. 8.16):

    (рис 8.16) Поиск по точной фразе "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада".

    Точное соответствие по фразе не дало результатов. Однако если мы уберем кавычки и повторим запрос, то найдем схожие определения (рис. 8.17):

    (рис 8.17) Поиск по фразе "краткое изложение научной работы, учебника или книги, оформленное в виде письменных материалов, публичного доклада" без указания кавычек.

    В принципе, немного поизучав предлагаемые ссылки, можно установить соответствие между оригиналом и его измененным вариантом.

    При поиске текста, исправленного рерайтером, или плагиата, вкрапленного в текст, следует искать яркие выражения, характерные обороты, связки терминов. Достаточно найти два-три узнаваемых слова, провести поиск по их сочетанию, чтобы найти оригинальные материалы, которые были использованы полностью или частично.

    Недостатком поиска по ключевым фразам является относительная трудоемкость способа и низкая скорость проверки текста.

    Поиск на сайтах антиплагиата

    Сервис Antiplagiat.Ru позволяет выявлять тексты с плагиатом, копируя их в онлайн-форме (рис. 8.18):

    (рис 8.18) Сервис Antiplagiat.Ru.

    Здесь мы поместили для проверки оригинального определения слова "Реферат". В результате появляется отчет, указывающий на ссылки, с которых были взяты заимствования (рис. 8.19):

    (рис 8.19) Отчет о проверке текста.

    Отчет содержит оценку оригинальности, которая подсчитывается на основании процентного соотношения оригинального и копированного текста. Фрагменты чужого текста выводятся в виде, удобном для сравнения.

    Попробуем теперь проверить текст, который был отредактирован. Отчет о проверке сообщает, что текст полностью оригинальный (рис. 8.20):

    (рис 8.20) Отчет о проверке текста после рерайтинга.

    И хотя мы знаем, что это не так, сервис все же убеждает нас в обратном. Впрочем, работу по изменению текста можно считать творческой с точки зрения студенческого реферата. По крайней мере, это не банально скопированный и вставленный блок текста.

    Антиплагиат киллер

    Появление сервиса antiplagiat.ru в свое время вызвал панику в студенческой среде. Преподаватели устанавливали 10% лимит для заимствованных фрагментов, требуя для всей остальной работы оригинального текста. Студенты узнав, что появилась система, которую нельзя обмануть, были ужасно огорчены. Но на самом деле не все так уж хорошо для преподавателей и не все так плохо для студентов. Мы с вами уже убедились, что переработанный текст уже нельзя уличить. Кроме этого, пристальное внимание к сервису антиплагиата позволило создателям сайта http://www.antiplagiatkiller.ru/ разработать программу, помогающую плагиатчикам изменять фрагменты.

    Суть работы программы заключается в сверке двух документов - оригинального и копированного. Последовательная проверка и изменение абзацев позволяет добиться того, что текст не будет распознаваться как плагиат (рис. 8.21):

    (рис 8.21) Подсказки помогут плагиатчикам перекроить свою "работу".

    Разработчики этой программы утверждают, что им удалось определить механизм распознавания текста, применяемый на сайте antiplagiat.ru. И хотя проверка с помощью этой программы лишь означает возможность локально проверять свои работы, она все же определенно помогает плагиатчикам.

    Double Content Finder

    Программа Double Content Finder, бесплатно предлагаемая для скачивания на сайте http://textbroker.ru/ - еще один инструмент для борьбы с плагиатом. Проверяемый текст может быть взят из файла, по ссылке или из текстового поля (рис. 8.22):

    (рис 8.22) Программа Double Content Finder.

    Здесь мы снова поместили оригинальное определение реферата. В результате онлайн-проверки программа также выдала множество ссылок (рис. 8.23):

    (рис 8.23) Проверка текста с плагиатом.

    Проверка отредактированного определения также не дала результатов - текст признан оригинальным (рис. 8.24):

    (рис 8.24) Проверка измененного текста.

    Заметим, что Double Content Finder предлагает более удобный интерфейс для проверки текстов, чем сайт antiplagiat.ru

    PlagiatInform

    Для университетов и институтов, а также издательств, компания СофтИнформ разработала уникальный инструмент проверки текстов - PlagiatInform (http://www.searchinform.ru/main/full-text-search-products-searchinform-plagiatinform.html). Комплексное решение может быть развернуто на базе локальной сети и Интернета. Локальная база материалов может содержать образцы текстов для сверки, которые отбираются преподавателями. Комбинация этой базы вместе с материалами из Интернета позволяют анализировать проверяемые тексты (рис. 8.25):

    (рис 8.25) Принцип работы системы PlagiatInform. Иллюстрация не плагиат, а собственность компании СофтИнформ.

    Возможность нарабатывать собственную базу материалов в сочетании с технологиями поиска - достаточно мощное средство для борьбы с плагиатом.

    И все-таки, оценив некоторые системы борьбы с плагиатом, можно сделать выводы. На сегодняшний день большинство систем позволяют находить банальное копирование текста, осуществляемое по принципу "CTRL + C, CTRL + V" с некоторыми простыми вариациями. Впрочем, именно оно и встречается наиболее часто. Другие методы обмана могут выявляться только компетентными специалистами, обладающими знаниями в соответствующей предметной области.

    Вернуться к учебному плану