SmartDocs от МТС с помощью ИИ повысил эффективность обработки документов

SmartDocs от МТС с помощью ИИ повысил эффективность обработки документов

SmartDocs от МТС с помощью ИИ повысил эффективность обработки документов

Специалисты МТС запустили новый сервис — SmartDocs, который должен повысить эффективность внутренних процессов оператора в десятки раз. Теперь в обработке корпоративных документов будет принимать участие искусственный интеллект (ИИ).

SmartDocs может распознавать и классифицировать тексты, документы, а также извлекать технические параметры и выделять суть из большого объёма данных. Подготовить короткую сводку по документу и переписать текст — всё это тоже по силам новому сервису.

Помимо этого, МТС также тестирует функциональность, позволяющую выравнивать стили, автоматически заносить теги и анализировать тональность текста.

По словам оператора связи, точность распознавания изображений, рукописного, машинописного и печатного текстов у SmartDocs достигает 95%. Такие показатели минимизируют вероятность ошибки.

Только за I квартал 2024 Года более 2,5 млн документов были обработаны с применением SmartDocs. Впервые решение использовали в МТС для классификации и извлечения продуктовых характеристик тендерной документации, в результате чего трудоемкость обработки данного типа документов сократилась более чем в два раза.

С начала 2024-го SmartDocs применяется в МТС для автоматического учета ключевых параметров при обработке договоров. Это позволило сократить длительность цикла закупки в среднем на 10 дней. До конца 2024 г. тысячи сотрудников МТС будут использовать сервис в ежедневной работе.

OOXML — фикция: LibreOffice обвинила Microsoft в манипуляциях

Проблемы совместимости остаются одной из главных причин, по которым пользователи не спешат переходить с Microsoft Office на LibreOffice. Формально всё работает, но на практике время от времени всплывают странности с вёрсткой, форматированием и отображением данных. И, как считают в The Document Foundation (TDF), дело тут вовсе не в LibreOffice.

Фонд, стоящий за LibreOffice, снова выступил с жёсткой критикой Microsoft. В блоге Итало Виньоли — одного из основателей TDF — корпорация из Редмонда обвиняется в том, что она игнорирует интересы отрасли ради собственных коммерческих целей.

По его словам, утверждение «OOXML — это стандарт, и его просто нужно принять» выглядит, мягко говоря, странно.

Виньоли настаивает: Office Open XML (OOXML) не может считаться полноценным стандартом, пока Microsoft не готова радикально переработать сами приложения Office. В качестве примера он напомнил о давней проблеме Excel с автопреобразованием данных — истории, которая напрямую затронула научное сообщество.

Excel годами автоматически превращал текстовые значения в даты. Для обычных таблиц это удобно, но для генетиков — катастрофа. Названия генов вроде MARCH1, SEPT1 или DEC1 Excel воспринимал как даты и превращал их в «1-Mar», «1-Sep» и «1-Dec».

В 2016 году журнал Genome Biology проанализировал почти 3,6 тысячи научных работ с Excel-файлами и выяснил, что примерно в каждой пятой были ошибки, вызванные именно автозаменой форматов.

Долгое время Microsoft считала проблему нишевой и не давала возможность отключить такое поведение. Лишь в 2023 году компания добавила соответствующую настройку; уже после того, как Комитет по номенклатуре генов человека (HGNC) был вынужден переименовать около 27 генов, чтобы избежать ошибок. К тому моменту ущерб для исследований уже был нанесён.

По словам Виньоли, OOXML «открыт» лишь формально. Спецификация формата занимает около 7 000 страниц, что делает полноценную и корректную реализацию сторонними разработчиками почти невозможной.

Кроме того, Microsoft Office сам не использует строгую версию стандарта (Strict OOXML), предпочитая так называемый Transitional-вариант. В нём до сих пор есть зависимости от старых, проприетарных форматов и поведения древних версий Word — вплоть до элементов с названиями вроде autoSpaceLikeWord95 или shapeLayoutLikeWW8.

Отдельно Виньоли критикует рекомендации использовать Windows Metafile для графики вместо открытых и кросс-платформенных форматов вроде SVG.

Для пользователей всё это выливается в знакомую проблему: документы между Office и LibreOffice открываются, но не всегда так, как ожидалось. Для TDF же это очередное подтверждение того, что формат Office по-прежнему работает как инструмент удержания пользователей внутри экосистемы Microsoft.

Спор вокруг OOXML длится уже много лет, и новый выпад со стороны LibreOffice ясно показывает: вопрос совместимости и «открытых стандартов» по-прежнему далёк от закрытия.

RSS: Новости на портале Anti-Malware.ru