- Что это такое?
- Безопасность[ | ]
- Будущее
- Детство и юность
- Инструмент
- Каким был интернет до эпохи веба
- Карьера
- Компоненты www¶
- Конфиденциальность
- Общий шлюзовый интерфейс cgi
- Первый браузер
- Перспективы развития[ | ]
- Появление программы
- Примечания[ | ]
- Принцип работы системы
- Программное обеспечение сервиса www¶
- Распространение[ | ]
- Сервис www
- Создание www (the world wide web)
- Специальный язык
- Способы активного отображения информации[ | ]
- Технологии[ | ]
- Язык гипертекстовой разметки html
Что это такое?
Итак, World Wide Web — это система, занимающаяся предоставлением доступа к особым документам, которые обычно связаны между собой. При этом эти файлы имеют особое местоположение: на ПК, которые подсоединены к Сети интернет. Термин также известен как Всемирная паутина.
Как еще могут называть World Wide Web? Порой пользователи используют «веб», который переводится с английского как «паутина», а также распространена аббревиатура WWW.
Безопасность[ | ]
Для киберпреступников Всемирная паутина стала ключевым способом распространения вредоносного программного обеспечения. Кроме того, под понятие сетевой преступности подпадают кража личных данных, мошенничество, шпионаж и незаконный сбор сведений о тех или иных субъектах или объектах[4].
Веб-уязвимости, по некоторым данным, в настоящее время превосходят по количеству любые традиционные проявления проблем компьютерной безопасности; по оценкам Google, примерно одна из десяти страниц во Всемирной паутине может содержать вредоносный [5][6][7].
По данным компании Sophos, британского производителя антивирусных решений, большинство кибератак в веб-пространстве совершается со стороны легитимных ресурсов, размещённых по преимуществу в США, Китае и России[8].
Наиболее распространённым видом подобных нападений, по сведениям от той же компании, является SQL-инъекция — злонамеренный ввод прямых запросов к базе данных в текстовые поля на страницах ресурса, что при недостаточном уровне защищённости может привести к раскрытию содержимого БД[9].
Другой распространённой угрозой, использующей возможности HTML и уникальных идентификаторов ресурсов, для сайтов Всемирной паутины является межсайтовое выполнение сценариев (XSS), которое стало возможным с введением технологии JavaScript и набрало обороты в связи с развитием Web 2.
0 и Ajax — новые стандарты веб-дизайна поощряли использование интерактивных сценариев[10][11][12].
Предлагаемые решения соответствующих проблем существенно варьируются вплоть до полного противоречия друг другу. Крупные поставщики защитных решений вроде McAfee, Avira, Avast и другие разрабатывают продукты для оценки информационных систем на предмет их соответствия определённым требованиям, другие игроки рынка (например, Finjan) рекомендуют проводить активное исследование программного а и вообще всего содержимого в режиме реального времени, вне зависимости от источника данных[4][14].
Есть также мнения, согласно которым предприятия должны воспринимать безопасность как удачную возможность для развития бизнеса, а не как источник расходов; для этого на смену сотням компаний, обеспечивающих защиту информации сегодня, должна прийти немногочисленная группа организаций, которая приводила бы в исполнение инфраструктурную политику постоянного и повсеместного управления цифровыми правами[15][16].
Будущее
World Wide Web — это система, которая еще не достигла пика своего развития. Учитывая современные технологии, все мы понимаем, насколько велико будущее Всемирной паутины. Сейчас очень много ресурсов брошено на два направления: социальное и семантическое.
Социальная паутина целиком и полностью зависит от поведения пользователей. Она развивается в соответствии с тем, как происходит упорядочивание информации в Сети.
Семантическая паутина — это направление, целью которого является улучшение релевантности запросов и связности данных. Для этого специалисты занимаются вводом новых метаданных.
Детство и юность
Родители будущего изобретателя всемирной паутины были математиками. Они занимались созданием одного из первых компьютеров, который назывался «Марк I». Вначале Тим учился в школе Эмануэль, расположенной в Уондсуэрте, а затем получал образование в Королевском колледже.
Именно там ему удалось сделать свой первый компьютер на основе процессора M6800. При этом вместо монитора парень использовал телевизор. Однажды Тима с другом поймали за хакерской атакой. В результате их лишили права использовать компьютеры университета.
Инструмент
Для просмотра World Wide Web требуется веб-браузер. Именно благодаря этому инструменту каждый может просматривать страницы. Эта особая программа отображает гипертекст и работает с гиперссылками.
Гиперссылки — это элемент гипертекстового файла, который является ссылкой на другой компонент текста, расположенный в этом же документе или в другом. Благодаря этому инструменту каждый пользователь может легко перемещаться в Интернете.
Каким был интернет до эпохи веба
Первый прототип современного интернета назывался ARPANET. Он обладал ограниченными возможностями, но при этом быстро развивался. В 1972 году там были созданы доски объявлений и электронная почта. При этом система имела важный недостаток, а именно – отсутствие единого протокола. Потому компьютеры разных типов не имели возможности обмениваться информацией.
В 1983 году были созданы протоколы TCP/IP. Это дало возможность объединять сети друг с другом. В тот же период возник термин «Интернет». Он закрепился за сетью ARPANET. Однако уже в 1984 году американский научный фонд придумал свою более гибкую сеть, которая называлась NSFNet. За год к ней подключили примерно 10 тысяч компьютеров, и ARPANET существенно потеряла свои позиции.
К концу восьмидесятых интернет стал напоминать современный. Так, в 1988 году был придуман протокол Internet Relay Chat. Благодаря этому появилась возможность общения в режиме реального времени, которая называлась чатом.
Карьера
После завершения Оксфорда в 1976 году Тим получил степень бакалавра физики и начал работать в компании Plessey Telecommunications Ltd. Там он преимущественно занимался системами распределенных транзакций.
Уже через 2 года Бернерс Ли перешел в другую компанию, которая называлась DG Nash Ltd. Там он занимался созданием программного обеспечения для принтеров.
Особую роль в судьбе будущего создателя интернета сыграло его новое место работы. Тим устроился в Европейскую лабораторию по ядерным исследованиям. Она называлась CERN и находилась в Женеве. Там ученый придумал программу Enquire, которая переводится как «дознаватель» или «справочная». Она базировалась на методе случайных ассоциаций. Принцип программы во многом лег в основу создания всемирной паутины.
После этого Тим 3 года работал на должности системного архитектора. Во время научной работы, которой исследователь занимался в CERN, ему удалось создать целый ряд распределенных систем, предназначенных для сбора данных. С 1981 по 1984 год Бернерс Ли работал в Image Computer Systems Ltd.
Компоненты www¶
Функционирование сервиса обеспечивается четырьмя составляющими:
Адресация веб-ресурсов. URL, URN, URI
Для доступа к любым сетевым ресурсам необходимо знать где они размещены и как к ним можно обратиться. Во Всемирной паутине для обращения к веб-документам изначально используется стандартизованная схема адресации и идентификации, учитывающую опыт адресации и идентификации таких сетевых сервисов, как e-mail, telnet, ftp и т.п. — URL, Uniform Resource Locator.
URL (RFC 1738) — унифицированный локатор (указатель) ресурсов, стандартизированный способ записи адреса ресурса в www и сети Интернет. Адрес URL имеет гибкую и расширяемую структуру для максимально естественного указания местонахождения ресурсов в сети. Для записи адреса используется ограниченный набор символов ASCII. Общий вид адреса можно представить так:
Конфиденциальность
Есть проблемы и с конфиденциальностью. Конечно, многие сайты, которым важно доверие клиента, будут защищать все максимально надежно. Но утечка данных все равно порой случается с ресурсами: будь-то банк или интернет-магазин.
Но конфиденциальность может быть нарушена и просто из-за принципов работы Всемирной паутины. Например, страница может запрашивать определенную информацию: местоположение, возраст или имя. Все это накапливается и попадает в руки маркетологов и рекламщиков.
Вся эта информация может действительно использоваться в целях составления релевантной рекламы и работы с ЦА. Но порой данные могут быть переданы третьим лицам, а как они уже поступят с ними — неизвестно.
Социальные сети сейчас, пожалуй, самый действенный метод сбора информации для мошенников. Они могут знать, где вы находитесь по данным геолокации, могут знать, чем вы увлекаетесь и куда ходите. Иногда пользователь может стать жертвой хулигана, а иногда более серьезных злоумышленников.
Общий шлюзовый интерфейс cgi
Это понятие расшифровывается как Common Gateway Interface. Оно представляет собой спецификацию интерфейса для веб-серверов для выполнения разных программ. Первая спецификация была написана в 1993 году Национальным центром приложений суперкомпьютеров.
Первый браузер
Первый веб-браузер тоже создал Тим Бернерс Ли. Это произошло в 1990 году. Он получил название WorldWideWeb, но впоследствии переименован в Nexus. При этом первым распространенным браузером, который имел графический интерфейс, стал NCSA Mosaic. Программа обладала открытым исходным кодом. Потому некоторые другие разработчики взяли его за основу. В результате появились Internet Explorer и Netscape Navigator.
Первый браузер обладал недостатками. Однако практически все их удалось устранить в Netscape Navigator. Ряд сотрудников компании Netscape принимали участие в разработке NCSA Mosaic.
Бренд Netscape выпустил Netscape Navigator под различные операционные системы. Он был совместим с Windows, UNIX, Mac OS. Это позволило добиться неплохих результатов и получить отличную прибыль. Это заставило компанию Microsoft приложить усилия для создания своего продукта. Результатом этой работы стало появление Internet Explorer.
Перспективы развития[ | ]
В настоящее время наметились два направления в развитии Всемирной паутины: семантическая паутина и социальная паутина.
В рамках второго направления наработки, являющиеся частью семантической паутины, активно используются в качестве инструментов (RSS и другие форматы веб-каналы, OPML, микроформаты XHTML). Частично семантизированные участки дерева категорий «Википедии» помогают пользователям осознанно перемещаться в информационном пространстве, однако, очень мягкие требования к подкатегориям не дают основания надеяться на расширение таких участков. В связи с этим интерес могут представлять попытки составления атласов Знания.
Существует также популярное понятие Web 2.0, обобщающее сразу несколько направлений развития Всемирной паутины.
Появление программы
Конечно, World Wide Web всемирное признание получил не сразу. Какое-то время ученым понадобилось для того, чтобы привести все в порядок. Для корректной работы нужно было создать веб-сервер, чем и занялся Тим, а после он разработал первый браузер.
Чтобы не изобретать велосипед, первый веб-обозреватель стали называть World Wide Web. Эта программа работала на базе платформы NeXTSTEP. Интерфейс ее был очень простым и понятным. Все данные были отображены в тексте, но изредка встречались и изображения.
Примечания[ | ]
- ↑Статья «Web как „следующий шаг“ (NextStep) революции персональных компьютеров».
- ↑LHC: The first band on the web
- ↑IBM разработала голосовой интернет
- ↑ 12Ben-Itzhak, Yuval. Infosecurity 2008 – New defence strategy in battle against e-crime, ComputerWeekly, Reed Business Information (18 апреля 2008). Дата обращения 20 апреля 2008.
- ↑Christey, Steve and Martin, Robert A.Vulnerability Type Distributions in CVE (version 1.1) (неопр.). MITRE Corporation (22 мая 2007). Дата обращения: 7 июня 2008.Архивировано 15 апреля 2022 года.
- ↑Symantec Internet Security Threat Report: Trends for July–December 2007 (Executive Summary) (англ.) : journal. — Symantec Corp., 2008. — April (vol. XIII). — P. 1—2. Архивировано 25 июня 2008 года.
- ↑Google searches web’s dark side, BBC News (11 мая 2007). Дата обращения 26 апреля 2008.
- ↑Security Threat Report (неопр.) (PDF). Sophos (Q1 2008). Дата обращения: 24 апреля 2008.Архивировано 15 апреля 2022 года.
- ↑Security threat report (неопр.) (PDF). Sophos (июль 2008). Дата обращения: 24 августа 2008.Архивировано 15 апреля 2022 года.
- ↑Fogie, Seth, Jeremiah Grossman, Robert Hansen, and Anton Rager.Cross Site Scripting Attacks: XSS Exploits and Defense (англ.). — Syngress, Elsevier Science & Technology, 2007. — P. 68—69, 127. — ISBN 1-59749-154-3.
- ↑O’Reilly, Tim.What Is Web 2.0 (неопр.) 4–5. O’Reilly Media (30 сентября 2005). Дата обращения: 4 июня 2008.Архивировано 15 апреля 2022 года.
- ↑Ritchie, Paul.The security risks of AJAX/web 2.0 applications (неопр.) // Infosecurity. — Elsevier, 2007. — March. Архивировано 25 июня 2008 года.Архивированная копия (неопр.) (недоступная ссылка). Дата обращения: 15 апреля 2022.Архивировано 25 июня 2008 года.
- ↑Berinato, Scott. Software Vulnerability Disclosure: The Chilling Effect, CSO, CXO Media (1 января 2007), С. 7. Архивировано 18 апреля 2008 года.Дата обращения 7 июня 2008.
- ↑Prince, Brian. McAfee Governance, Risk and Compliance Business Unit, eWEEK, Ziff Davis Enterprise Holdings (9 апреля 2008). Дата обращения 25 апреля 2008.
- ↑Preston, Rob. Down To Business: It’s Past Time To Elevate The Infosec Conversation, InformationWeek, United Business Media (12 апреля 2008). Архивировано 14 апреля 2008 года.Дата обращения 25 апреля 2008.
- ↑Claburn, Thomas. RSA’s Coviello Predicts Security Consolidation, InformationWeek, United Business Media (6 февраля 2007). Архивировано 7 февраля 2009 года.Дата обращения 25 апреля 2008.
- ↑boyd, danah; Hargittai, Eszter.Facebook privacy settings: Who cares? (неопр.) // First Monday. — University of Illinois at Chicago, 2022. — July (т. 15, № 8).
- ↑Lynn, Jonathan. Internet users to exceed 2 billion …, Reuters (19 октября 2022). Архивировано 22 апреля 2022 года.Дата обращения 9 февраля 2022.
- ↑S. Lawrence, C.L. Giles, «Searching the World Wide Web, » Science, 280(5360), 98-100, 1998.
- ↑S. Lawrence, C.L. Giles, «Accessibility of Information on the Web, » Nature, 400, 107—109, 1999.
- ↑The ‘Deep’ Web: Surfacing Hidden Value (неопр.). Brightplanet.com. Дата обращения: 27 июля 2009.Архивировано 4 апреля 2008 года.
- ↑Distribution of languages on the Internet (неопр.). Netz-tipp.de. Дата обращения: 27 июля 2009.Архивировано 24 мая 2022 года.
- ↑Alessio Signorini.Indexable Web Size (неопр.). Cs.uiowa.edu. Дата обращения: 27 июля 2009.Архивировано 24 мая 2022 года.
- ↑The size of the World Wide Web (неопр.). Worldwidewebsize.com. Дата обращения: 27 июля 2009.Архивировано 24 мая 2022 года.
- ↑Alpert, Jesse; Hajaj, Nissan.We knew the web was big… (неопр.). The Official Google Blog (25 июля 2008). Архивировано 24 мая 2022 года.
Принцип работы системы
Технологии World Wide Web помогают установить связь между документами. Все это происходит за счет огромного количества веб-серверов, из которых и состоит Всемирная паутина.
Для связи обычно применяют гипертекст. Эта технология известна всем, кто хоть раз заходил в Сеть. Например, ярче всего ее можно заметить в «Википедии». Когда вы открываете любую статью, вы сразу замечаете большое количество ссылок на другие страницы.
Из определенного количества веб-страниц можно составить веб-сайт. При этом все они должны быть объединены единым дизайном, стилем и темой. Веб-страницы в этом случае размещены на едином сервере. Чтобы просматривать данные в Сети, пользователи устанавливают веб-браузеры.
Программное обеспечение сервиса www¶
Веб-серверы
Распространение[ | ]
В период с 2005 по 2022 год количество веб-пользователей удвоилось и достигло отметки двух миллиардов[18]. Согласно ранним исследованиям 1998 и 1999 годов, большинство существующих веб-сайтов не индексировалось корректно поисковыми системами, а сама веб-сеть оказалась крупнее, чем ожидалось[19][20].
По данным на 2001 год было создано уже более 550 миллионов веб-документов, большинство из которых, однако, находилось в пределах невидимой сети[21].
По данным на 2002 год было создано более 2 миллиардов веб-страниц[22], 56,4 % всего интернет-содержимого было на английском языке, после него шёл немецкий (7,7 %), французский (5,6 %) и японский (4,9 %).
Согласно исследованиям, проводимым в конце января 2005 года, на 75 разных языках было определено более 11,5 миллиарда веб-страниц, которые были индексированы в открытой сети[23].
А по данным на март 2009 года, количество страниц увеличилось до 25,21 миллиарда[24]. 25 июля 2008 года инженеры программного обеспечения Google Джессе Альперт и Ниссан Хайай объявили, что поисковик Google засёк более миллиарда уникальных URL-ссылок[25].
Сервис www
Конкуренция за лидирующие позиции в области создания лучшего проводника началась в девяностые годы прошлого века. Одной из первых таких программ стал сервис World Wide Web. Ее аббревиатура WWW сегодня часто применяется для обозначения интернета.
Впоследствии браузер получил название Nexus. Однако в скором времени он сдал свои позиции. При этом лидерство на рынке заняли более продвинутые и совершенные браузеры.
Создание www (the world wide web)
Когда же была придумана всемирная паутина? Эту концепцию предложил британский ученый Тим Бернерс Ли. Это произошло в 1989 году. Затем он реализовал проект World Wide Web в сотрудничестве с бельгийским исследователем Робертом Кайо.
Специальный язык
Чтобы все данные были унифицированы, нужно использовать единый язык. Обычно это HTML, который помогает создавать, хранить и отображать гипертекст.
Этот процесс называется версткой. О нем знают дизайнеры и частично программисты. Специалист, который занимается версткой, называется веб-мастером.
Когда файл будет написан соответствующим языком, его сохраняют, а после распространяют по Всемирной паутине. HTML — наиболее распространенный тип ресурса в Сети.
После того как специалист разработал соответствующий файл и отправил его на веб-сервер, он превращается в веб-страницу, когда начинает отображаться пользователям.
Способы активного отображения информации[ | ]
Представленная в сети информация может быть доступна:
- только для чтения («пассивно»);
- для чтения и добавления/изменения («активно»).
К способам активного отображения информации во Всемирной паутине относятся:
Это деление весьма условно. Так, скажем, блог или гостевую книгу можно рассматривать как частный случай форума, который, в свою очередь, является частным случаем системы управления контентом. Обычно разница проявляется в назначении, подходе и позиционировании того или иного продукта.
Отчасти информация с сайтов может также быть доступна через речь. В Индии уже началось[3] тестирование системы, делающей текстовое содержимое страниц доступным даже для людей, не умеющих читать и писать.
Технологии[ | ]
Для улучшения визуального восприятия веба стала широко использоваться технология CSS, которая позволяет задавать единые стили оформления для множества веб-страниц. Ещё одно нововведение, на которое стоит обратить внимание, — система обозначения ресурсов URN (англ. Uniform Resource Name).
Популярная концепция развития Всемирной паутины — создание семантической паутины. Семантическая паутина — надстройка над существующей Всемирной паутиной, которая призвана сделать размещённую в сети информацию более понятной для компьютеров.
Это также концепция сети, в которой каждый ресурс на человеческом языке был бы снабжён описанием, понятным компьютеру. Семантическая паутина открывает доступ к чётко структурированной информации для любых приложений, независимо от платформы и независимо от языков программирования.
Программы смогут сами находить нужные ресурсы, обрабатывать информацию, классифицировать данные, выявлять логические связи, делать выводы и даже принимать решения на основе этих выводов. При широком распространении и грамотном внедрении семантическая паутина может вызвать революцию в Интернете.
Для создания понятного компьютеру описания ресурса, в семантической паутине используется формат RDF (англ. Resource Description Framework), который основан на синтаксисе XML и использует идентификаторы URI для обозначения ресурсов.
Новинки в этой области: RDFS (англ. RDF Schema) и SPARQL (англ. Protocol And RDF Query Language) (произносится как «спа́ркл»), новый язык запросов для быстрого доступа к данным RDF.
Язык гипертекстовой разметки html
Язык гипертекстовой разметки, который назывался HyperText Markup Language или сокращенно HTML, придумал Тимоти Бернерс Ли во время своей работы в швейцарской компании CERN. Этот язык предназначался для разметки и оформления документов всемирной паутины.


