Большинство корпоративных данных не так уж сложно получить. Просто их копировали так много раз, что никто уже не уверен, какая версия является правильной.
Каждая архитектурная схема рассказывает одну и ту же историю. Система учета слева. Слой интеграции посередине. Хранилище, озеро данных, кэш, средство синхронизации, шина событий, хранилище признаков справа. Каждый элемент находится на своем месте не просто так. Каждый из них был правильным ответом на проблему в момент его добавления. И каждый из них теперь представляет собой место, где данные должны поддерживаться в актуальном состоянии по сравнению со всеми остальными.
Это и есть налог на копирование. Предприятия платят его уже целое десятилетие, и большинство решило, что оно того стоит, поскольку альтернативой было полное отсутствие аналитики. Бизнес-оркестрация и автоматизация меняют этот расчет. Как только данные начинают управлять выполнением задач между агентами, роботами, рабочими процессами и приложениями, а не просто питать информационные панели, стоимость устаревших данных может проявиться в самой работе, а не только в отчетности.
Почему модель «копируй и синхронизируй» достигает своего предела
Шаблон копирования был создан для мира, в котором данные перемещались по расписанию. Каждую ночь извлечение, преобразование и загрузка (ETL) наполняли хранилище. Почасовая синхронизация обновляла кэш. Еженедельные выгрузки заполняли озеро данных. Задержка измерялась часами и допускалась, поскольку конечным потребителем была панель мониторинга или отчет, а панели обновляются по графику.
Агенты — нет. Агенты действуют.
Когда агент принимает решение о том, одобрить ли счет, направить ли претензию, эскалировать ли тикет или порекомендовать кредитную линию, он принимает решение, которое бизнес будет претворять в жизнь. Если лежащие в основе этого решения данные устарели на шесть часов, следствием этого является не устаревшая диаграмма. Следствием является неверное действие: упущенный период оплаты, дублированный возврат средств, клиент, которому сообщили о несоответствии требованиям, которым он на самом деле удовлетворяет. Терпимость предприятия к задержкам ETL в аналитике улетучивается в тот момент, когда данные начинают управлять исполнением.
В этом заключается архитектурная уязвимость. Тот самый уровень данных, который успешно обслуживал отчетность, не может успешно обслуживать агентов, роботов и рабочие процессы, действующие в бизнесе практически в реальном времени. Что-то должно измениться.
Что на самом деле означает «без копирования»
Подключение без копирования — это архитектурная альтернатива перемещению данных каждый раз, когда вам нужно их использовать. Вместо репликации данных из источника в другую систему уровень без копирования федеративно распределяет запросы к источнику в момент запроса. Данные остаются там, где они живут. Потребитель видит их так, будто они локальные. Это отличается от встроенных в платформу функций клонирования и совместного использования без копирования: ничего не дублируется и ничего не перемещается в UiPath.
Это не новая идея в инженерии данных. Новым является то, что она становится основой для доступа средств корпоративной автоматизации к данным, а не только для аналитических запросов к ним.
В UiPath Data Fabric федеративные сущности являются примитивом без копирования. Сущность указывает на живую внешнюю систему — Snowflake, Databricks, SAP, Salesforce, ServiceNow, операционную базу данных — и направляет к ней запросы в режиме реального времени по требованию. В UiPath ничего не копируется. Сущность представляет собой модель структуры данных и их связей с другими сущностями, а не дубликат самих данных.
И поскольку одна сущность может охватывать несколько исходных систем, агенты и средства автоматизации могут выполнять запросы к ним без предварительной консолидации этих данных в одном месте.
Практический результат заключается в том, что агент, рабочий процесс или приложение, запрашивающие сущность клиента, счета или заказа, в данный момент считывают первоисточник. Не снимок. Не кэшированную копию. Текущее состояние.
Стоимость копирования в конкретных проявлениях
Легко недооценить то, чего шаблон копирования на самом деле стоит предприятию, поскольку затраты распределены между командами и бюджетами. Если собрать их воедино, они выглядят следующим образом:
- Накладные расходы на сверку. Каждая копия — это место, где данные могут расходиться. Команды создают конвейеры для обнаружения расхождений, задания для их исправления, информационные панели для мониторинга и дежурные смены для реагирования на сбои.
Накладные расходы на сверку. Каждая копия — это место, где данные могут расходиться. Команды создают конвейеры для обнаружения расхождений, задания для их исправления, информационные панели для мониторинга и дежурные смены для реагирования на сбои.
- Область применения управления данными. Каждая копия — это еще одно место, где необходимо обеспечивать соблюдение политик доступа, происхождения, хранения и аудита. От группы комплаенс-контроля негласно требуется управление N копиями одних и тех же данных, причем число N растет.
Область применения управления данными. Каждая копия — это еще одно место, где необходимо обеспечивать соблюдение политик доступа, происхождения, хранения и аудита. От группы комплаенс-контроля негласно требуется управление N копиями одних и тех же данных, причем число N растет.
- Переделка интеграции. Каждый новый сценарий использования, требующий данных из системы, как правило, создает собственные соединения, преобразования и пути доступа. Одна и та же логика переписывается для разных проектов, поскольку нет общей модели для потребления.
Переделка интеграции. Каждый новый сценарий использования, требующий данных из системы, как правило, создает собственные соединения, преобразования и пути доступа. Одна и та же логика переписывается для разных проектов, поскольку нет общей модели для потребления.
- Задержка, которую замечает бизнес. К тому моменту, когда скопированные данные станут достаточно актуальными для принятия мер, момент для действий может быть упущен. Для аналитики это было неудобством. Для агентов это режим сбоя.
Задержка, которую замечает бизнес. К тому моменту, когда скопированные данные станут достаточно актуальными для принятия мер, момент для действий может быть упущен. Для аналитики это было неудобством. Для агентов это режим сбоя.
Концепция «без копирования» устраняет причину этих затрат, а не смягчает их последствия. Между источником и копией нет расхождений, если нет копии. Нет области управления для дубликата, которого не существует. Нечего переинтегрировать, если каждый потребитель считывает данные из одной и той же федеративной сущности.
Роль UiPath в экосистеме без копирования
Подход без копирования не является изобретением UiPath, и мы не пытаемся заменить платформы данных, которым уже доверяют предприятия. Snowflake и Databricks — это те места, где современные предприятия консолидируют аналитику, ИИ и операционные данные. Они созданы для этой роли и справляются с ней очень хорошо.
Чего не хватало предприятиям, так это уровня, который делает данные на этих платформах — а также в SAP, Salesforce, ServiceNow и операционных базах данных — непосредственно пригодными для использования автоматизацией, управляющей бизнесом. Не через очередную копию. Не через очередную синхронизацию. А в качестве управляемого структурированного контекста, который агенты и рабочие процессы используют на месте и в режиме реального времени или практически в реальном времени.
Именно эту роль играет UiPath Data Fabric. Snowflake и Databricks остаются системами учета для хранящихся в них данных. UiPath становится контекстным слоем без копирования, который позволяет этим данным управлять выполнением задач агентами, оркестрацией, приложениями и средствами автоматизации на платформе UiPath.
Платформы данных хранят информацию. Data Fabric делает ее пригодной для использования автоматизацией, которая управляет бизнесом, без ее перемещения.
Что это значит для нового поколения автоматизации
Агенты, которых предприятие будет запускать через два года, будут совсем не теми агентами, которые оно строит сегодня. Изменятся модели. Изменятся фреймворки. Изменятся коннекторы. Неизменными остаются данные и системы, в которых они хранятся.
Именно на это делается ставка в основе слоя данных без создания копий. Если данные остаются там, где они находятся, и моделируются один раз как управляемые федеративные сущности, каждый агент, рабочий процесс и приложение, создаваемые с этого момента, используют один и тот же доверенный контекст. Новые сценарии использования надстраиваются поверх того же фундамента, а не перестраиваются заново. Платформы данных, в которые предприятия уже инвестировали, сохраняют свое место. Налог на дублирование данных перестает расти.
Именно для этого и нужен подход без создания копий. Не для того, чтобы избежать перемещения данных как самоцели, а чтобы обеспечить бизнес-оркестрацию и автоматизацию фундаментом данных, способным выдерживать нагрузки корпоративного масштаба.
Узнайте, как UiPath Data Fabric заставляет работать концепцию без создания копий, предоставляя агентам управляемый, актуальный или почти реальном времени контекст во всех ваших корпоративных системах.










