ИИ для перевода документов: что он умеет и где проходит граница
Автор: Юрий Водостой — технический переводчик и редактор, основатель бюро Insight Translation, создатель HardTrans · Обновлено 2026-08-13
Да, ИИ переводит документы, и как черновик это рабочий инструмент. Результат решает не модель, а обвязка вокруг неё. Google Переводчик и DeepL принимают файл и возвращают файл, но переводят сегмент за сегментом: то, каким термином переведено понятие на странице 12, никак не влияет на страницу 480, а на втором файле проекта всё начинается заново. Сервис для документов читает весь комплект сразу, собирает по нему бриф и глоссарий и переводит с ними каждый файл. Страница в 250 слов у нас стоит 90 ₽, первый документ до 10 страниц — бесплатно, без регистрации.
Чем сервис для комплектов отличается от ChatGPT и Google Переводчика
Единицей работы. Загрузку документов Google Переводчик и DeepL держат давно: отдаёте DOCX, получаете DOCX. Разница не в этом. Каждый сегмент переводится сам по себе, и терминология не переходит с файла на файл: перевели спецификацию — паспорт изделия сервис берёт с чистого листа, ничего не зная о принятых решениях. Глоссарии у них есть, но в платных версиях: DeepL Pro и Google Cloud Translation, в бесплатном вебе их нет. И даже платный глоссарий вы ведёте руками, а брифа по комплекту не строит ни один из них.
ChatGPT держит в окне ровно тот кусок, который вы туда вставили, и файл в исходном формате не собирает. Бриф по комплекту он тоже не строит — переносить решения между файлами приходится вручную, вставляя свой список терминов в каждый новый запрос. Вёрстку вы восстанавливаете сами: таблицы, нумерацию, сноски. На трёх абзацах это незаметно, на многостраничной спецификации ручная пересборка становится ощутимой работой.
На переделку после «закинули в Google» к нам приносили не раз — когда-то эта формулировка была у заказчиков дежурной. После ChatGPT, что характерно, не приносят: в чат закидывают по одному файлу, и тот, кому нужен консистентный перевод большого объёма, до чата с ним просто не доходит — идёт сразу к специалистам.
У нас первый проход идёт по всем файлам комплекта сразу: система собирает бриф проекта и глоссарий и дальше переводит каждый документ уже с ними на руках. Свой глоссарий подгрузите — тогда термины берутся из него, а то, чего в нём нет, система добирает в собственный. Автоглоссарий скачаете в CSV по завершении перевода: его удобно отдать редактору или положить в проектную папку.
На выходе мы возвращаем тот же файл. Форматы: DOCX, XLSX, PPTX, PDF с текстовым слоем и XLIFF из профессиональных систем — .sdlxliff (Trados), .mqxlz и .mqxliff (memoQ), .mxliff (Phrase), выгрузки Smartcat; inline-теги сохраняем, а разбор форматов есть в гайде про перевод XLIFF онлайн.
| Чат-бот (ChatGPT и аналоги) | Онлайн-переводчик (Google, DeepL) | HardTrans | |
|---|---|---|---|
| Единица работы | кусок текста в окне | сегмент за сегментом | комплект файлов целиком |
| Термины между файлами | переносите вручную | не переносятся | бриф и глоссарий проекта на все файлы |
| Ваш глоссарий | вставляете в запрос вручную | в бесплатном вебе нет, в платных версиях есть | загружаете CSV, термины берутся из него |
| На выходе | текст в чате, файл в исходном формате не собирает | файл (в веб-версии), но каждый сегмент переведён сам по себе | тот же файл, переведён с брифом и глоссарием комплекта |
Чего мы не делаем, чтобы не было сюрпризов: памяти переводов и CAT-обвязки в сервисе нет, сканы без текстового слоя не берём, финальную редактуру человеком в услугу не включаем.
Как это выглядит в живых проектах
Показательный паттерн — компании со штатными отделами переводов. Их сотрудники давно и охотно пользуются нейросетями в чате: будничные задачи, короткие письма, страница-другая описания. А комплекты документов они отправляют нам — потому что чат в окне не решает ровно того, ради чего затевается комплект: единой терминологии на десятках файлов. Люди, которые работают с нейросетями каждый день, лучше всех понимают их ограничения.
Второй паттерн — дедлайны, в которые человеческой команды физически не существует. Был случай: около 500 страниц за выходные, с вёрсткой. Такой объём в такой срок делается только связкой «ИИ-конвейер + глоссарии + инструкции проекта» — и комплект ушёл клиенту вовремя.
Где ИИ-перевода достаточно, а где нет
Про ИИ-перевод мы слышим два полярных мнения, причём ежедневно: «нейросеть — это хрень, не смейте» и «зачем вообще переводчики, есть же нейросети». Оба мимо. Первые игнорируют инструмент, который в грамотной обвязке уже делает работу. Вторые видят волшебную палочку и не видят ограничений: контекстное окно, лимиты файлов, потерянный на середине документа контекст.
Сама граница проходит не по сложности текста, а по тому, кто прочитает результат. Чтобы разобраться для себя, о чём документ, хватит любого бесплатного движка — платить тут не за что. Документу, который ходит внутри компании, нужна сквозная терминология по всему объёму: сотрудник видит три названия одного узла и не понимает, один это узел или три. На этом уровне ИИ-перевод с глоссарием закрывает задачу целиком. Документу, который уходит наружу и под подпись, ИИ даёт черновик со сквозной терминологией и снимает с редактора основную часть работы, но ответственность за термин остаётся на человеке: редактуру планируйте отдельным этапом, в HardTrans она не входит. Подробный разбор трёх уровней, с примерами из комплектов под инспекцию и приёмку, лежит в гайде про перевод технической документации.
Как выбрать: проверяйте на своём файле
ИИ для перевода документов выбирают одним способом: прогоняют через него свой файл. Маркетинговый пример на сайте всегда удачный, и это верно для нашего сайта тоже. Возьмите документ, на котором вы реально застряли, прогоните его через два-три сервиса и посмотрите на четыре вещи.
- Один термин по всему тексту. Найдите понятие, которое встречается на первой и на последней странице, и сравните перевод.
- Формат на выходе. Файл, с которым можно сразу работать, или текст, который придётся заново верстать.
- Таблицы и нумерация. Съехавшая нумерация пунктов дороже в правке, чем неточный термин.
- Ваш глоссарий. Загрузите десяток своих терминов и проверьте, взяты ли именно они.
Свои прогоны мы держим открытыми и датированными, чтобы их можно было перепроверить: пары «Google Translate — HardTrans» по технике и юриспруденции лежат на витрине сравнений; разбор трёх фраз из технической документации со сроками прогона есть в гайде по техдокументации. Перепечатывать их здесь не будем: примеры живут там, с датой и направлением перевода. Механику того, что именно ломается у машинного перевода на длинном документе, разбирали отдельно.
Сколько стоит и сколько занимает
90 ₽ за страницу в 250 слов. Без регистрации и привязки карты: вы загружаете свой файл, первые 10 страниц — бесплатно.
По скорости у нас замер, а не оценка: по 15 комплектам от 100 страниц, прошедшим через сервис с марта по июль 2026 года, медиана — 0,34 минуты на страницу. Комплект на 100 страниц занимает 30–50 минут вместе с первым проходом, на котором собирается бриф. Документ на 10 страниц выходит примерно за 5 минут.
Дальше время уходит уже не на перевод, а на редактуру — и вот её объём зависит от того, был ли глоссарий и насколько единообразен исходник.
Частые вопросы
Можно ли переводить конфиденциальные документы нейросетью?
Зависит от того, что у вас в договоре, а не от настроек сервиса. Публичный чат-бот означает копипаст текста в общий интерфейс руками сотрудника; у нас вы загружаете файл и получаете файл, а для первого документа не нужна даже регистрация — корпоративную почту вводить, чтобы просто попробовать, не придётся. Крайности тут одинаково вредны: одни спокойно копипастят конфиденциальные документы в бесплатный чат-бот, не задумываясь, что бесплатная версия может использовать текст для обучения; другие требуют только on-premise даже для документов без всякой тайны. Рабочая середина — читать условия сервиса: у нас перевод идёт через Anthropic API, и ваши тексты не используются для обучения моделей — ни нами, ни Anthropic; Anthropic хранит данные API ограниченный срок по своей политике и не обучается на них. Файлы автоматически удаляются с наших серверов через 7 дней. Но если по договору или режиму данные нельзя передавать третьей стороне, облачный сервис не подходит, ни наш, ни любой другой.
Чем это отличается от Google Переводчика?
Google Переводчик тоже принимает файл и возвращает файл; разница в единице работы. Он переводит сегмент за сегментом, и терминология не переходит с одного файла проекта на другой. Мы читаем комплект целиком, собираем по нему бриф и глоссарий и применяем ваш глоссарий, если он есть. На одном предложении разница почти не видна — она вылезает на объёме и на втором-третьем файле того же проекта.
Какая нейросеть лучше переводит документы?
Сравнивать модели в отрыве от обвязки бессмысленно: одна и та же модель с брифом и глоссарием и без них даёт разный результат на одном и том же файле. У нас переводит Claude Sonnet 4.6, но работу делает не только модель, а связка «первый проход по комплекту → бриф и глоссарий → перевод с ними». Проверяйте на своём документе.
В каком виде загружать и выгружать глоссарий?
Загрузка — CSV или TSV: две колонки, слева термин исходника, справа перевод. Разделитель (запятая, точка с запятой, табуляция) и кодировку система определяет сама, XLSX-выгрузку из Smartcat тоже принимаем. Готовый глоссарий проекта скачаете в CSV по завершении перевода. Готовить его заранее не нужно: если своего списка нет, система соберёт глоссарий сама на первом проходе.
Загрузите документ, на котором у вас ломаются обычные переводчики, и посмотрите результат на своём материале: первый документ до 10 страниц бесплатно, без регистрации.
Другие направления: юридические документы, медицинские документы, научные тексты.
Данные по срокам — 15 комплектов от 100 страниц, март–июль 2026 года, медиана 0,34 мин/стр. Цены и условия действуют на дату публикации.
Похожие материалы
Первый документ — бесплатно