О XML
Расширяемый язык разметки или XML, является языком сценариев для представления структурированных данных в текстовом файле. Структурированные данные Вы хотите представлять использование XML, могут быть фактически чем-либо — адресные книги, параметры конфигурации, электронные таблицы, Веб-страницы, финансовые транзакции, технические получения, и т.д. XML определяет ряд правил для разработки текстовых форматов для таких данных. Храня данные в формате структурированного текста, XML позволяет Вам смотреть на данные без программы, произведшей его. XML-файлы просты для компьютеров генерировать и читать, они однозначны, и они избегают распространенных ошибок текстовых форматов данных, таких как отсутствие расширяемости, отсутствие поддержки интернационализации и локализации и зависимости от платформы.
XML является сложным подлежащим, полная обработка которого выходит за рамки этой темы. Разработчики, плохо знакомые с понятиями XML, могут счесть спецификацию XML 1.0 и материал поддержки в веб-сайте сохраняемыми Консорциумом World Wide Web в http://www.w3c.org/XML. Организация по Продвижению Стандартов Структурированной информации размещает два превосходных сайта на XML в http://www.xml.org/ и http://www.oasis-open.org/cover/. Существует также большая информация о XML и его различном использовании на следующих корпоративных сайтах: http://www.ibm.com/developer/xml/, http://msdn.microsoft.com/xml/default.asp, и http://java.sun.com/xml/.
Синтаксис XML
Как HTML, XML основывается на Стандартном обобщенном языке разметки или SGML. Это общее наследие представляет XML знакомый в стили к приученным к HTML. В отличие от HTML, тем не менее, синтаксис XML требует, чтобы использование соответствия запустилось и конечные тэги, такой как <string> и </string>, разграничивать логические разделы документа или наборов данных. Единицу информации, включенную тегами, вызывают элементом. Как ярлык, если элемент не имеет никакого содержания между своим запуском и конечными тэгами, теги могут быть объединены в единственный тег, заканчивающийся “/>”, такой как <true/>. Этот простой синтаксис просто обработать компьютером с дополнительным преимуществом оставления понятным людям.
Лучший способ проиллюстрировать основные характеристики XML с простым примером. Документ, показанный в Перечислении 1, содержит представление XML объекта клиента, который, возможно, был экспортирован от базы данных клиентов.
Перечисление 1 простой XML-документ
<?xml version="1.0" encoding="UTF-8"?> |
<customer> |
<name>Jane Doe</name> |
<address region="USA"> |
<street>6236 Nicolet Rd</street> |
<city>Richmond</city> |
<state>VA</state> |
<postal>23225</postal> |
</address> |
<birthday> |
<month>10</month> |
<day>11</day> |
<year>1949</year> |
</birthday> |
</customer> |
Этот документ в качестве примера содержит основные структурные функции XML. Сначала существует требуемый Пролог — также вызвал определение XML — содержащий версию XML и информацию о кодировке символов. (В отсутствие атрибута кодирования Базовая Основа принимает UTF-8.) Остаток от документа является просто перечислением элементов, составляющих информацию о клиентах.
Синтаксические анализаторы XML
В вычислениях условий синтаксический анализатор является программой, берущей ввод в форме последовательных инструкций, тегов или некоторой другой определенной последовательности маркеров, и разбивающей их в легко управляемые части. Синтаксический анализатор XML разработан, чтобы считать и, в некотором смысле, интерпретировать XML-документы. Как это выполняется, синтаксический анализатор распознает и реагирует на каждую структуру XML, с которой это встречается путем принятия некоторых указанных мер на основе типа структуры. Много синтаксических анализаторов XML, названных основанными на дереве синтаксическими анализаторами, преобразовывают XML-документ в древовидную структуру, отражающую структурную иерархию данных XML. Это дерево тогда сделано доступным для Вашего приложения, которое является бесплатным интерпретировать и изменить данные как надлежащие. Другие синтаксические анализаторы событийно-управляемы, и сообщают их клиенту о каждой конструкции XML, с которой они встречаются.
В дополнение к тому, чтобы быть событийно-управляемым или основанным на дереве, синтаксические анализаторы XML могут проверять или непроверять. Проверка синтаксических анализаторов проверяет содержание документа по ряду определенных правил, утверждающих, какие элементы позволяются в документе и в том, какой порядок они должны появиться. Эти правила появляются в XML-документе или как дополнительная структура XML вызвала определение типа документа или DTD, или как XML-схема. Непроверяющие синтаксические анализаторы меньше и быстрее, но они не проверяют документы по DTD; они только проверяют, правильно построен ли документ структурно.