О XML

Расширяемый язык разметки или XML, является языком сценариев для представления структурированных данных в текстовом файле. Структурированные данные Вы хотите представлять использование XML, могут быть фактически чем-либо — адресные книги, параметры конфигурации, электронные таблицы, Веб-страницы, финансовые транзакции, технические получения, и т.д. XML определяет ряд правил для разработки текстовых форматов для таких данных. Храня данные в формате структурированного текста, XML позволяет Вам смотреть на данные без программы, произведшей его. XML-файлы просты для компьютеров генерировать и читать, они однозначны, и они избегают распространенных ошибок текстовых форматов данных, таких как отсутствие расширяемости, отсутствие поддержки интернационализации и локализации и зависимости от платформы.

XML является сложным подлежащим, полная обработка которого выходит за рамки этой темы. Разработчики, плохо знакомые с понятиями XML, могут счесть спецификацию XML 1.0 и материал поддержки в веб-сайте сохраняемыми Консорциумом World Wide Web в http://www.w3c.org/XML. Организация по Продвижению Стандартов Структурированной информации размещает два превосходных сайта на XML в http://www.xml.org/ и http://www.oasis-open.org/cover/. Существует также большая информация о XML и его различном использовании на следующих корпоративных сайтах: http://www.ibm.com/developer/xml/, http://msdn.microsoft.com/xml/default.asp, и http://java.sun.com/xml/.

Синтаксис XML

Как HTML, XML основывается на Стандартном обобщенном языке разметки или SGML. Это общее наследие представляет XML знакомый в стили к приученным к HTML. В отличие от HTML, тем не менее, синтаксис XML требует, чтобы использование соответствия запустилось и конечные тэги, такой как <string> и </string>, разграничивать логические разделы документа или наборов данных. Единицу информации, включенную тегами, вызывают элементом. Как ярлык, если элемент не имеет никакого содержания между своим запуском и конечными тэгами, теги могут быть объединены в единственный тег, заканчивающийся “/>”, такой как <true/>. Этот простой синтаксис просто обработать компьютером с дополнительным преимуществом оставления понятным людям.

Лучший способ проиллюстрировать основные характеристики XML с простым примером. Документ, показанный в Перечислении 1, содержит представление XML объекта клиента, который, возможно, был экспортирован от базы данных клиентов.

Перечисление 1  простой XML-документ

<?xml version="1.0" encoding="UTF-8"?>
<customer>
    <name>Jane Doe</name>
    <address region="USA">
        <street>6236 Nicolet Rd</street>
        <city>Richmond</city>
        <state>VA</state>
        <postal>23225</postal>
    </address>
    <birthday>
        <month>10</month>
        <day>11</day>
        <year>1949</year>
    </birthday>
</customer>

Этот документ в качестве примера содержит основные структурные функции XML. Сначала существует требуемый Пролог — также вызвал определение XML — содержащий версию XML и информацию о кодировке символов. (В отсутствие атрибута кодирования Базовая Основа принимает UTF-8.) Остаток от документа является просто перечислением элементов, составляющих информацию о клиентах.

Синтаксические анализаторы XML

В вычислениях условий синтаксический анализатор является программой, берущей ввод в форме последовательных инструкций, тегов или некоторой другой определенной последовательности маркеров, и разбивающей их в легко управляемые части. Синтаксический анализатор XML разработан, чтобы считать и, в некотором смысле, интерпретировать XML-документы. Как это выполняется, синтаксический анализатор распознает и реагирует на каждую структуру XML, с которой это встречается путем принятия некоторых указанных мер на основе типа структуры. Много синтаксических анализаторов XML, названных основанными на дереве синтаксическими анализаторами, преобразовывают XML-документ в древовидную структуру, отражающую структурную иерархию данных XML. Это дерево тогда сделано доступным для Вашего приложения, которое является бесплатным интерпретировать и изменить данные как надлежащие. Другие синтаксические анализаторы событийно-управляемы, и сообщают их клиенту о каждой конструкции XML, с которой они встречаются.

В дополнение к тому, чтобы быть событийно-управляемым или основанным на дереве, синтаксические анализаторы XML могут проверять или непроверять. Проверка синтаксических анализаторов проверяет содержание документа по ряду определенных правил, утверждающих, какие элементы позволяются в документе и в том, какой порядок они должны появиться. Эти правила появляются в XML-документе или как дополнительная структура XML вызвала определение типа документа или DTD, или как XML-схема. Непроверяющие синтаксические анализаторы меньше и быстрее, но они не проверяют документы по DTD; они только проверяют, правильно построен ли документ структурно.