Введение

Процессоры контента иногда путают с сетевыми процессорами, которые проверяют полезную нагрузку пакетов IP-пакетов, проходящих через компьютерную сеть. Эти компоненты позволяют проектировать и развертывать сетевые системы следующего поколения, которые могут принимать решения по обработке пакетов или сообщений на основе осведомленности о содержании пакета или сообщения. Работа процессоров контента часто называется обработкой контента или глубокой инспекцией пакетов, DPI, хотя некоторые люди считают, что выражение DPI слишком ограничивающее, поскольку многие процессоры контента могут изменять и переписывать контент на лету, поэтому они могут делать гораздо больше, чем просто проверять, что подразумевает своего рода функцию мониторинга. В отличие от процессоров, основанных на знаниях, или тернарной адресной памяти (TCAMS), которые в основном нацелены на заголовок пакета (двадцать процентов пакета в настоящее время состоит из заголовка), процессоры контента заходят гораздо дальше в пакет или сообщение, тем самым определяя характер контента в самом пакете (80% пакета в настоящее время являются данными). Приложения процессоров контента включают в себя: приложение уровня 7, коммутаторы сетей, ориентированные на приложения, маршрутизаторы, компьютерные приборы для единого управления угрозами (UTM), обнаружение вторжений, системы профилактики (IDS / IPS), антивирус, соответствие, [VOIP] и шлюзы XML. Различные уровни модели OSI приведены в следующей ссылке с описанием уровня 7, где обработка контента является и станет неотъемлемой частью интеллектуальной сети по мере созревания сетей следующего поколения. Продвинутые процессоры контента могут как анализировать, так и преобразовывать контент. Например: новый продукт Microsoft Office 2007 имеет возможность сохранять документы в открытом формате XML, вместо ppt, xls и doc приложения сохраняют в инкапсулированном (на самом деле ZIP) типе файла pptx, xlsx и docx. Таким образом, процессор контента может быть использован для изучения всех корпоративных документов и замены одного названия компании другим, или изменения включенного корпоративного логотипа, все потому, что структурированные данные, представленные в XML, могут быть обработаны намного легче, чем в проприетарном и недокументированном формате. XML часто описывается как самоописывающийся язык. Некоторые процессоры содержимого поддерживают возможность обрабатывать как сообщения, основанные на пакетах, так и пакеты по пакетам, а некоторые могут отслеживать содержимое в нескольких пакетах, чтобы подписи, которые они могут искать, могли пересекать границы пакетов, и они все равно будут найдены.