Ворчливый редактор
275 subscribers
423 photos
2 videos
13 files
78 links
Old editor yells at everybody. В общем, ищете самый бесполезный канал "около перевода"? Вам сюда.
А ИНОГДА ЕЩЕ ТУТ
о технологиях в текстах и переводах.
Download Telegram
Даже не знаю, можно (и нужно) ли тут что-нибудь добавить.

#лингвомем
😁5👀1
Ворчливый редактор
Даже не знаю, можно (и нужно) ли тут что-нибудь добавить. #лингвомем
А, нет, можно добавить. Вытащил наушники из разъема ПК с «десяткой» на борту и вставил обратно.
😁4
По наблюдениям, при работе в Google AI Studio, когда в текущем диалоге количество токенов достигнет 100 тысяч (ну в крайнем случае 150 тысяч), лучше начинать новый диалог с теми же вводными данными. В противном случае LLM будет думать долго, а, учитывая накопленный контекст, в ограничения («попробуйте позже») будете упираться часто.

#нейросетевое
Ворчливый редактор
Поскольку Poe с момента рассказа о нём окончательно испортился (начисляемые кредиты стали настолько активно расходоваться на контекст чата, что суточного лимита стало хватать запроса примерно на три), время его удалять. Благо есть чем заменить — LM Arena.…
Если вам надо скреативить что-то иллюстративное на русском языке к вашему тексту, то могу порекомендовать LLM gpt-image-1.5-high-fidelity. Сколько сегодня разных ни перепробовал, только эта русский язык без ошибок понимает и (почти) без ошибок воспроизводит. Пример на прикрепленной иллюстрации, искать на LMarena (в реплае), которая теперь называется просто arena.ai.

#нейросетевое
👍2
Тем временем, кажется, в индустрии локализации назревает свой «Скайнет». Немецкие актеры дубляжа решили, что их голоса — это не просто набор данных для тренировки нейросетей, и объявили бойкот главному стриминговому гиганту планеты.

В чем суть?

Ядром раздора стал новый пункт в контрактах Netflix. Компания честно (и за это ей даже выразили робкий респект) прописала право использовать записи актеров для обучения ИИ. Но есть, как водится, нюанс: Ассоциация немецких актеров озвучивания (VDS), представляющая интересы более 600 профессионалов, увидела в этом прямую угрозу своей профессии.

Логика актеров проста: «Мы озвучиваем фильм сегодня, чтобы завтра наш цифровой клон озвучил десять других бесплатно». Председатель VDS Анна-София Лумпе заявила, что их опасения попросту игнорируются, а решения, меняющие судьбу индустрии, принимаются без участия самих творцов.

«Недопонимания» и ультиматумы

Netflix попытался сыграть в «доброго полицейского», назвав страхи актеров «недопониманием технических намерений». Но тут же включил режим «злого полицейского», выдвинув ультиматум: если актеры не вернутся в будки звукозаписи, компания просто перестанет дублировать контент для Германии.

Да-да, вы не ослышались: Netflix пригрозил оставить одну из самых читающих (но любящих дубляж!) наций Европы наедине с субтитрами. Смелый ход для рынка, где, согласно отчету самого же Netflix за вторую половину 2025 года, более трети просмотров приходится на неанглоязычный контент (привет, корейские дорамы и испанские триллеры!).

Юристы в деле

Вместо того чтобы испугаться, VDS перевела спор в юридическую плоскость. Ассоциация наняла специализированную юридическую фирму Spirit Legal для проверки контрактов на соответствие GDPR, авторскому праву и — что самое интересное — свежему EU AI Act (Закону ЕС об ИИ).

Юрист Инес Духанич уже назвала это «критическим моментом» для европейских традиций авторского права, заявив, что актеры — это «творцы, а не источники данных».

Почему это важно?

Этот кейс — лакмусовая бумажка для всего мира. Если Netflix продавит свои условия в Германии, оплоте профсоюзов и защиты данных, то в остальных странах «цифровой дубляж» станет стандартом быстрее, чем вы успеете сказать «Ich bin ein Berliner».

Запасаемся попкорном и ждём развязки 🍿
❤8
Пока мы все дружно боялись, что ИИ заменит поэтов и комиков, свежее исследование компании Appen (опубликованное в феврале 2026 года) подкинуло успокоительное. Оказывается, даже самые мощные модели современности — включая хваленый GPT-5 и ветерана сцены Claude 3.7 Sonnet — теряются, когда дело доходит до культурных нюансов.

В чем суть эксперимента?

Команда под руководством Мэдисон Ван Дорен решила проверить, как нейросети справляются с маркетинговыми текстами, нашпигованными идиомами, игрой слов и локальными отсылками. В «битве» участвовали 7 моделей, включая GPT-5, Llama 4 и Mistral Medium. Их заставили переводить письма на 15 языков.

Результат? Даже лидер гонки, GPT-5, набрал лишь около 67% от идеального балла.

«Молчание — золото» (по мнению ИИ)

Самое смешное в этой истории — стратегия, которую выбрали модели. Столкнувшись со сложной идиомой (например, «break a leg» или специфической шуткой), нейросети часто... просто удаляли её. Логика железная: нет фразы — нет ошибки.

В то время как праздничные поздравления ИИ переводит сносно, каламбуры вызывают у них ступор. Модель Aya Expanse 8B и вовсе оказалась в хвосте рейтинга, показав, что размер (параметров) всё-таки имеет значение (В в названии — это миллиарды), но не гарантирует чувство юмора.

Вердикт

Мы получили первое в мире масштабное исследование, где переводы оценивали живые люди именно на предмет «культурной адекватности», а не просто грамматики. Вывод неутешителен для техно-оптимистов: ИИ может написать код за секунду, но чтобы адаптировать рекламную кампанию для другой страны, вам всё ещё нужен человек. Иначе решивший опереться на ИИ бренд рискует стать посмешищем (или просто промолчать в самый ответственный момент).

Так что, коллеги, выдыхаем. Наше чувство юмора пока что вне конкуренции.
👍4🥰3👏1🥴1
Кстати, да.
😁5💯3❤2
Коллеги, как считаете — нормально ли выходной день написывать и названивать по телефону исполнителю с настоятельной просьбой срочно внести правки в сданный перевод (тут — просто внести паспортные данные в перевод шаблона доверенности), ведь клиенту надо?
Anonymous Poll
4%
да
8%
конечно
4%
разумеется
8%
ты еще спрашиваешь
46%
а ты вообще зачем за компом-то сидишь еще
38%
рот закрой и не бухти, удаленщик
13%
свой вариант (в комментариях)
😭5
Когнитивный диссонанс – это когда идёшь на приём к врачу по фамилии Мужикина и подсознательно ожидаешь увидеть некую даму, способную остановить на скаку горящую избу. А встречаешь такое мимимишное создание вполовину стройнее и на голову ниже тебя.

Но специалист она отличный.
❤4
С праздником, коллеги. Вы — свет нашей профессии. Продолжайте и дальше украшать мир своим присутствием.
❤4
Ворчливый редактор
Вы, может, слышали, может, нет, но OpenAI запустила новую функцию в своей ЧатГопоте — перевод. Ей можно воспользоваться на специальной странице https://chatgpt.com/translate/ Правда, как водится, есть нюанс: поскольку это по сути всё тот же ChatGPT, то те…
Я давненько обещал рассказать про нормальную LLM для переводов. Ну так вот…

Что за зверь?

В начале 2026 года «корпорация добра» Google выкатила TranslateGemma — семейство открытых моделей на базе архитектуры Gemma 3, заточенных исключительно под машинный перевод на 55 языков. У них есть три весовые категории: 4B, 12B и 27B параметров. И, небольшой сюрприз, они умеют переводить текст даже со встроенных картинок без дополнительного обучения.

Давид против Голиафа

Самое занятное в этой истории — эффективность. Оказывается, модель-середнячок на 12 миллиардов параметров переводит точнее, чем прошлый базовый гигант на 27 миллиардов. Что это значит для нас? То, что нейронку с качеством уровня бигтеха теперь можно запустить локально. Демо-версия, о которой пишет, например, издание Slator, доказывает: тяжеловесный софт или бэкенд больше не нужны, всё крутится прямо в окне браузера.

Почему индустрия в восторге?

По многим причинам:

— Больше не нужно параноить, что NDA-документы или медицинские карты утекут на серверы корпораций. Ведь данные не покидают жесткий диск.
— Никаких подписок на облако. Скачал — пользуешься.
— Младшая 4B-модель комфортно чувствует себя на обычных смартфонах.

В общем, теперь независимость от облака выглядит так:
git clone https://huggingface.co/google/translategemma-4b-it (if you know, you know)

Кажется, кто-то в Кремниевой долине решил, что приватность — это новая нефть. Ну, или просто захотел насолить конкурентам с их платными API. В любом случае, мы в огромном плюсе! 😎
🌚2
Ворчливый редактор
Я давненько обещал рассказать про нормальную LLM для переводов. Ну так вот… Что за зверь? В начале 2026 года «корпорация добра» Google выкатила TranslateGemma — семейство открытых моделей на базе архитектуры Gemma 3, заточенных исключительно под машинный…
…Хотя, с другой стороны, впору вспомнить комиссара Жибера из серии фильмов «Такси» с его знаменитым «Мы в дерьме!» ©. Германистам, по крайней мере.

Честно скажу, доходы ещё до начала известных событий у меня и так не росли (только если я больше работал). А в последние несколько лет так и тем более. Но недавно в одном подкасте слух зацепила фраза, что, мол, по данным Росстата, зарплата переводчиков за минувшие 5 лет в реальном выражении снизилась аж на 30% — одно из самых масштабных падений по отраслям.

Я погуглил и узнал, что Росстат напрямую такой цифры именно по «переводчикам» не публиковал (они считают более широкими категориями). Но если наложить данные Росстата об инфляции на рыночные ставки переводчиков, то математически это выходит правда: покупательная способность переводчиков действительно упала на 25–30% из-за того, что ставки (особенно на фрилансе) стоят на месте, а цены выросли.

Откуда взялась эта цифра и что происходит на самом деле?

В экономике есть понятие «реальная зарплата» — это не то, сколько вы получаете денег (номинал), а то, сколько товаров вы можете на них купить. А теперь по фактам, так сказать:

Накопленная инфляция с 2020 по 2024 год в России составила порядка 38–45% (официально цены выросли почти в полтора раза).

В массовом сегменте письменных переводов ставки за слово или страницу почти не менялись последние 5–7 лет. Если в 2020 году переводчик получал условные 50–60 тысяч рублей, и в 2024 получает 60–65 тысяч (рост номинала на ~10-15%), то его реальный доход рухнул как раз на те самые 30%.

Скорее всего, эксперт в подкасте взял официальную инфляцию Росстата и наложил ее на стагнацию ставок в отрасли.

Почему так произошло?

Если подумать, то рынок переводов переживает «идеальный шторм». Зарплаты придавило с трех сторон:

Технологический удар (AI и LLM). Это главный фактор. Нейросети убили рынок «чернового» и простого технического перевода. Заказчики теперь не готовы платить за перевод с нуля, они платят за постредактуру (MTPE), а это стоит на 30–50% дешевле. Объем работы тот же (или больше), а денег меньше.

Уход западного бизнеса. Раньше корпоративный сектор (юридические, маркетинговые переводы для европейских компаний) был самым «жирным» куском рынка. Эти компании ушли, бюджеты схлопнулись.

Демпинг. Из-за снижения спроса на английский/немецкий, на рынке оказалось много свободных рук, готовых работать за еду, что не дает поднимать цены опытным спецам.

У кого всё плохо, а у кого — хорошо?

Тут важно понимать, что «средняя температура по больнице» обманчива.

Письменные переводчики (EN/DE → RU) (в том числе и ваш покорный слуга): здесь самое сильное падение. Реальные доходы упали даже больше, чем на 30%. Ставки за страницу часто те же, что были в 2018 году.

Устные синхронисты: их ИИ пока не заменил. Здесь доходы в номинале выросли, но работы стало меньше физически (меньше международных ивентов в РФ).

Восточные языки (китайский, арабский, фарси): тут ровно наоборот. Дефицит кадров дикий, зарплаты растут выше инфляции. Хороший китаист сейчас может зарабатывать в 1.5–2 раза больше англиста того же уровня.

Получается, что фраза из подкаста — это экономически верная оценка, хотя и не прямая цитата из бюллетеня Росстата. Если вы работаете с европейскими языками в письменном сегменте и не повышали свои расценки агрессивно последние 3 года, вы действительно стали беднее примерно на треть.
😢3💯3
Если вы хотите максимально задолбаться на ровном месте при переводе с применением нейросети, воспользуйтесь ChatGPT. Вне зависимости от объема переводимого текста.

Когда-нибудь я раскрою эту мысль. Но только не сегодня.

#вр #нейросетевое
🤔2
Ворчливый редактор
Если вы хотите максимально задолбаться на ровном месте при переводе с применением нейросети, воспользуйтесь ChatGPT. Вне зависимости от объема переводимого текста. Когда-нибудь я раскрою эту мысль. Но только не сегодня. #вр #нейросетевое
Нет, всё-таки раскрою. Вот настроил я ChatGPT, выбрал ему максимально рабочий тон, отдельно пользовательские инструкции для ответов прописал.

Даю первое задание: перевести файл с субтитрами формата SRT с английского на русский язык. В файле 920 сегментов, но это чудо техники не разбивает перевод на 2 или 3 больших батча — оно начинает переводить мне по 30 (!) сегментов за раз! Точнее, оно предлагает разбить перевод на 2-3 части, но само же не следует своему предложению. Зато постоянно задаёт тупые проактивные вопросы типа «Сделать текст ещё плотнее?». Просто переведи мне его сначала, блин.

Какого качества перевод? Ну, буквально в первом же сегменте фраза «Remember Andrea [...]?» переведена как «Помнишь Андрею [...]?». Ни DeepSeek, ни тем более Gemini, ни даже какой-нибудь Qwen таких перлов не выдают.

Пишешь, чтобы хоть как-то это ускорить: переведи сегменты с 60 до 200. Смотришь, как выводится ответ: сегменты 60-80, затем многоточие, сегменты 199-200.

Да ты о**ела, что ли? — Ой, да, извините, потеряла часть перевода, вот сегменты с 80 по 120. Потому что идите нах**, вот почему.

Завязываешь с этим мозго**ством, вспоминаешь про arena.ai, переводишь там в Gemini минут за пять почти без проблем. Только в конце ответ упирается в лимит символов и остаются непереведенными сегментов двадцать.

Уже чисто из спортивного интереса, типа «Ну хоть это ты сможешь перевести нормально?», скармливаешь их ChatGPT. Результат: в двух субтитрах сбита нумерация (тупо имеют одинаковый номер), ещё в одном потерян текст.

Браво.

#вр #нейросетевое
🤡3😁1
– ...Это я, Киану Ривз!

#лингвошутка
😁9
Как необычно, пожалуй, впервые за долгое время чувствовать, что ты действительно находишься в отпуске. Что тебе не надо подрабатывать, чтобы свести концы с концами. Что над тобой в целом не довлеют никакие обязательные дела. Что можно вообще не подходить к компьютеру. Что это отдых.
❤10