Перевод XLIFF онлайн: Smartcat, Trados, memoQ и Phrase
Автор: Юрий Водостой — технический переводчик и редактор, основатель бюро Insight Translation, создатель HardTrans · Обновлено 2026-09-09
Эта страница — для переводчиков и бюро, которые уже работают в CAT-системах и хотят закрыть в них один шаг: качественный претранслейт двуязычного файла. Вы выгружаете XLIFF из Trados, memoQ, Phrase или Smartcat, загружаете его к нам и получаете обратно тот же файл с заполненными target. Разметка остается на месте, id и порядок сегментов не меняются, файл возвращается в тот же проект и открывается в вашей системе. Ниже по порядку: как проходит файл, какие расширения мы принимаем, что происходит с тегами и терминологией, сколько всё это стоит.
Смысл шага — в получении качественного, консистентного черновика. Перед переводом наша система читает файл целиком, а если файлов в задаче несколько — весь комплект сразу, и дальше держит один термин по всему тексту; ваш глоссарий при этом применяется ко всем файлам разом. 90 ₽ за страницу в 250 слов, первый документ до 10 страниц — бесплатно, без регистрации.
Порядок работы с файлом
Выгружаете двуязычный файл из своей системы, загружаете на hardtrans.ru и выбираете направление. На выходе — файл с тем же расширением и с суффиксом из пары языков в имени: manual.sdlxliff вернется как manual.ru-en.sdlxliff.
Внутри порядок такой: сначала система читает все сегменты файла целиком, а если файлов несколько — все файлы задачи сразу. По прочитанному она составляет бриф проекта и глоссарий: терминологию, аббревиатуры, сквозные решения. И только потом переводит сегменты пакетами, держа этот бриф перед глазами.
Переписывает HardTrans одно: содержимое <target>. Порядок сегментов, их id и атрибуты остаются как были, а если <target> в сегменте не было, система создает его и кладет туда перевод. Исключение одно, и оно про Trados: там, где он сам не создал <target>, сегмент вернется ровно таким, каким пришел.
Статус сегмента мы не трогаем — какое состояние стояло в файле, такое и вернется. Проставлять «переведено» за редактора мы не беремся: сегменты подтверждает человек.
Какие типы XLIFF принимает HardTrans
Шесть расширений из разных CAT-систем.
.xliffи.xlf— XLIFF 1.2, в том числе выгрузка Smartcat.sdlxliff— Trados Studio.mqxliffи.mqxlz— memoQ.mxliff— Phrase (Memsource)
Это ровно то, что ваша система отдает при экспорте двуязычного файла, включая архив memoQ .mqxlz — его принимаем как есть, распаковывать вручную не нужно.
Пока наша система читает только XLIFF 1.2: файл в версии 2.0 не даст ни одного сегмента, так что экспортируйте из своей системы в 1.2 или напишите в поддержку: support@hardtrans.ru, мы оперативно реализуем эту функцию. Размер файла — до 50 МБ.
Как перевести файл из Smartcat, Trados или memoQ
Smartcat отдает двуязычный файл выгрузкой из документа — это обычный .xliff версии 1.2. Переводите его у нас и загружайте обратно в тот же документ проекта: сегментация и id не менялись, поэтому перевод встает на свои места.
В Trados выгружать нечего, потому что рабочий файл проекта и есть .sdlxliff — он лежит в папке проекта, в подпапке целевого языка. Копируете его оттуда, переводите, кладете обратно и открываете проект.
memoQ отдает двуязычный файл в своем формате, .mqxliff или он же в архиве .mqxlz; принимаем оба, архив собирается обратно со всем содержимым. У Phrase то же самое с .mxliff.
Теги и разметка остаются на месте
Модель переводит только текст: теги снимаются перед переводом и возвращаются на свои места при сборке файла, поэтому в target приходит та же разметка, что стояла в source. Файл открывается в вашей CAT-системе и импортируется обратно в проект — расширение, кодировка и структура остаются такими, какими их ждет эта система.
Отдельно про Smartcat: пустые inline-теги, которые он сам подставляет в target из памяти, мы заполняем содержимым одноименного тега из source — без этого на реимпорте он отвечает «parameter length cannot be zero».
Панелей «до и после» по тегам мы не показываем: сохранность разметки имеет смысл проверять на вашем файле, а не на нашем, и первый документ до 10 страниц бесплатен как раз для этого.
Один термин — один перевод на весь файл
XLIFF режет документ на сегменты, и обычный движок переводит каждый как отдельное предложение: что он выбрал двадцать сегментов назад, он уже не помнит. Отсюда разнобой, который в CAT виден лучше, чем где-либо еще, — достаточно отфильтровать сегменты по термину.
Исходник (немецкий): «Die Pumpe ist für eine Leistung von 75 kW auszulegen. Die Leistung des Antriebs ist im Abnahmeprotokoll zu dokumentieren.»
Насос должен быть рассчитан на мощность 75 кВт. Работоспособность привода должна быть задокументирована в акте приёмки.
Насос должен быть рассчитан на мощность 75 кВт. Мощность привода должна быть задокументирована в акте приёмки.
Тесты: июнь 2026
Тесты проводили в июне 2026 года, немецкий → русский, без глоссария. Одно и то же Leistung Google переводит сначала «мощность», потом «работоспособность».
Это фрагмент, а на фрагменте разница всегда скромная — на целом документе она гораздо заметнее. 7 сентября 2026 года мы перевели через сервис типовой контракт целиком (224 абзаца, 25 расчетных страниц, русский → английский) и посчитали, сколько разных английских слов пришлось на один русский термин.
| Термин | Google Translate | HardTrans · без глоссария |
|---|---|---|
| ответственность | 2 варианта | 1 |
| обеспечение исполнения Контракта | 3 | 1 |
| гарантийные обязательства | 4 | 1 |
| цена Контракта | 3 | 1 |
| срок поставки | 2 | 1 |
| закупка | 2 | 1 |
Варианты считали по корню слова: liability и liable — один вариант, регистр не учитывали.
Google на этих терминах переключается между двумя и четырьмя вариантами, а HardTrans без глоссария держит по одному. Полный счет по этому документу, вместе с терминами, где он не в нашу пользу, — в guide про перевод договора на английский. Механику, из-за которой сегментированный текст расползается, разбирает статья почему машинный перевод не справляется.
Глоссарий: ваши термины на весь комплект
Загрузите XLSX-выгрузку из Smartcat, CSV, TSV или обычный TXT — можно несколько файлов сразу, они применяются ко всем файлам задачи. На оценке, до оплаты, видно, сколько терминов подхватилось и сколько среди них конфликтов: один термин, разные переводы в разных списках.
Что меняет ваш список, видно на том же контракте. «Обеспечение исполнения Контракта» встречается там 27 раз: Google дал три разных перевода, HardTrans без глоссария — один, performance security. Но это его выбор, а не ваш: с загруженным глоссарием в тех же пунктах стоит security for the performance. Товарно-транспортная накладная без глоссария вышла как consignment note (bill of lading) — коносамент, которым российская накладная не является; с глоссарием — delivery note (consignment note).
Свой глоссарий проекта система составляет сама, еще до перевода, и отдает отдельной ссылкой рядом с результатом, в CSV. Если своего списка у вас нет, работает этот, а если есть — ваши термины главнее, и то, чего в них нет, система добирает в собственный. Как это выглядит на отраслевой терминологии, показано на витрине сравнений и в guide про перевод технической документации.
Повторы, претранслейт и цена
Одинаковые сегменты переводятся один раз, а перевод подставляется во все вхождения — и внутри файла, и между файлами одной задачи. На повторяющиеся сегменты действует скидка 75%, сумму со скидкой видно на оценке до оплаты.
Повтор в XLIFF считается по паре «source + target», а не по одному source: сегмент с заполненным из памяти target и такой же сегмент с пустым target — для нас разные, потому что модель должна видеть, где вариант уже предложен, а где нет.
С претранслейтом (pre-translate в CAT-системах) у вас есть выбор. Переключатель «Пропустить уже переведенные сегменты» появляется, как только среди загруженных файлов есть XLIFF: с ним сегменты с непустым target не идут в модель вообще и возвращаются нетронутыми, без него — переводятся заново, и ваш target перезаписывается нашим.
Чего сервис не делает
Памяти переводов у нас нет — ни своей, ни подключаемой: fuzzy-совпадения не ищутся и не подставляются, TMX никуда не грузится. Нет и редактора сегментов, а QA-проверки по числам, тегам и терминологии вместе с отчетами по ним — работа вашей CAT-системы, и она делает ее лучше.
Trados, memoQ, Phrase и Smartcat мы не заменяем. Мы закрываем один шаг внутри них — претранслейт, после которого редактор начинает с консистентного черновика, а не с пустого файла. Это качественный черновик под редактуру, а не финальный перевод.
Сколько стоит и как запустить
90 ₽ за страницу в 250 слов, повторяющиеся сегменты — со скидкой 75%. Первый документ до 10 страниц — бесплатно, без регистрации и привязки карты.
Выгрузите XLIFF из своей системы и загрузите на главной — тот самый файл, на котором вы сейчас застряли. Если файлов несколько, кидайте их одной задачей: общий бриф и общий глоссарий проекта работают как раз на комплекте.
Частые вопросы
Импортируется ли результат обратно в Trados, memoQ или Smartcat?
Возвращаем ровно тот формат, который загрузили: .sdlxliff остается .sdlxliff, .mqxlz — архивом со своим skeleton. Кастомные namespace-префиксы, порядок атрибутов в <xliff>, BOM и XML-декларация приводятся к тому виду, который ждут CAT-системы, пустые inline-теги из памяти заполняются содержимым из source. Проверить это дешевле, чем обсуждать: первый документ до 10 страниц — бесплатно.
Как перевести файл из Smartcat?
Выгрузите из документа двуязычный XLIFF, загрузите его на hardtrans.ru, выберите направление и заберите тот же файл с заполненными target — а потом загрузите обратно в тот же документ Smartcat. Расширение и структура не меняются, а пустые inline-теги, которые Smartcat подставляет из памяти, заполняются содержимым из source.
Как сделать претранслейт в Trados или memoQ?
Так же, только файл берется по-разному: в Trados это .sdlxliff из папки проекта, в memoQ — экспорт двуязычного файла, .mqxliff или .mqxlz. Переведенный файл возвращается на свое место, и редактор открывает проект с заполненными сегментами вместо пустых. Подтверждать сегменты и гонять QA вы будете в своей системе: этого мы не делаем.
Поддерживаете ли вы XLIFF 2.0?
Пока нет. Мы читаем XLIFF 1.2 — это .xliff и .xlf, .sdlxliff, .mqxliff, .mqxlz, .mxliff и выгрузки Smartcat. Файл в 2.0 не даст ни одного сегмента, потому что там другая структура: <unit> и <segment> вместо <trans-unit>. Экспортируйте из своей системы в 1.2.
Что будет с сегментами, которые уже переведены из памяти?
По умолчанию они переводятся заново и ваш target перезаписывается. Если претранслейт надо сохранить, включите переключатель «Пропустить уже переведенные сегменты» — тогда сегменты с непустым target не уйдут в модель и вернутся такими, какими пришли. Переключатель появляется в настройках, как только среди загруженных файлов есть XLIFF.
Сколько ждать перевода?
Замер по задачам, прошедшим через сервис с марта по июль 2026 года: на 132 задачах от 5 страниц медиана — 0,49 минуты на страницу, на 15 комплектах от 100 страниц — 0,34. Файл на 10 страниц выходит примерно за 5 минут, комплект на 200 страниц — за час с небольшим. Выборка общая по всем форматам, отдельного замера по XLIFF у нас нет.
Это замена CAT-системе?
Нет. Памяти переводов, редактора сегментов и QA-проверок у нас нет, статусы сегментов мы не проставляем. Наш шаг один — претранслейт: вы отдаете выгруженный файл, получаете его же с черновиком в target и садитесь редактировать там, где привыкли.
Что происходит с моими файлами?
Файлы автоматически удаляются с наших серверов через 7 дней. Ваши тексты не используются для обучения моделей — ни нами, ни Anthropic (провайдером модели). Anthropic хранит данные API ограниченный срок по своей политике и не обучается на них.
Загрузите файл и посмотрите на своем материале — первый документ до 10 страниц бесплатно, без регистрации.
Другие направления: техническая документация, договоры, медицинские документы, научные тексты.
Метод. Немецко-русская пара — тесты проводили в июне 2026 года, без глоссария, результат опубликован на витрине сравнений. Счет вариантов на термин — тесты 7 сентября 2026 года, русский → английский: приказ Минпромторга России от 7 апреля 2020 г. № 1152, приложение № 3 (типовой контракт на поставку), документ целиком — 224 абзаца, 6 462 слова, 25 расчетных страниц. Считали на договоре в DOCX, а не на XLIFF; для XLIFF работает тот же разбор файла целиком перед переводом. Google Translate и HardTrans переводили один и тот же текст с одинаковым разбиением на абзацы, вариант с глоссарием — тот же текст через HardTrans с загруженным списком на 36 пар.
Похожие материалы
Первый документ — бесплатно