Русская Википедия:Нейронный машинный перевод Google
Нейронный машинный перевод Google (GNMT) — это система нейронного машинного перевода (NMT), разработанная компанией Google и представленная в ноябре 2016 года, которая использует искусственную нейронную сеть для повышения беглости и точности перевода в Google Переводчике.[1][2][3]
GNMT улучшает качество перевода, применяя метод машинного перевода на основе примеров (EBMT), в котором система “обучается на миллионах примеров”.[2] Предлагаемая архитектура системного обучения GNMT была впервые опробована на более, чем ста языках, поддерживаемых Google Переводчиком.[2] Благодаря большой сквозной структуре, система со временем учится создавать более качественные и естественные переводы.[1] GNMT способна переводить предложения целиком, а не по частям.[1] Сеть GNMT может выполнять интерлингвальный машинный перевод, кодируя семантику предложения вместо того, чтобы запоминать переводы отдельных фраз.[2][4]
История
Проект Google Brain был создан в 2011 году в “секретной исследовательской лаборатории Google X”[5] Джеффом Дином, сотрудником Google, Грегом Коррадо, исследователем из Google, и Эндрю Ыном, профессором компьютерных наук Стэнфордского университета.[6][7][8] Работа Ына легла в основу одного из самых больших технологических прорывов в Google и Стэнфорде.[5]
В сентябре 2016 года исследовательская группа Google объявила о разработке системы перевода GNMT, и к ноябрю Google Переводчик начал использовать нейронный машинный перевод (NMT) вместо прежних статистических методов (SMT)[1][9][10][11], которые использовались с октября 2007 года внутри собственной закрытой SMT системы.[12][13]
Система NMT внутри Google Переводчика использует большую искусственную нейронную сеть, пригодную для глубинного обучения.[1][2][3] Изучая миллионы примеров, GNMT улучшает качество перевода, используя более широкий контекст для вывода наиболее подходящего перевода. Затем результат перестраивается и адаптируется для соответствия грамматике человеческого языка. GNMT не создала свой внутренний универсальный язык, а скорее стремилась найти общее между многими языками, что должно быть интересно больше для психологов и лингвистов, чем для специалистов в области информатики.[14] Новый движок перевода был включен в обе стороны для девяти языков: английского, французского, немецкого, испанского, португальского, китайского, японского, корейского и турецкого в 2016 году.[15] В марте 2017 года были добавлены ещё три языка: русский, хинди и вьетнамский.[16] В том же месяце с помощью сообщества Google Переводчика была добавлена поддержка иврита и арабского языка.[17] Далее в конце апреля 2017 года была добавлена поддержка девяти индийских языков, а именно: хинди, бенгали, маратхи, гуджарати, пенджаби, тамильский, телугу, малаялам и каннада.[18]
Языки, поддерживаемые GNMT
Ниже приведён список языковых пар, в которых для перевода используется модель нейронного машинного перевода Google (NMT). По состоянию на июль 2017 года для всех языков поддерживается только перевод на английский язык и обратно:[19]
Языковая пара | Коды языков | |
---|---|---|
1 | Африкаанс <-> Английский | af <-> en
|
2 | Арабский <-> Английский | ar <-> en
|
3 | Болгарский <-> Английский | bg <-> en
|
4 | Китайский (упрощенный) <-> Английский | zh-CN <-> en
|
5 | Китайский (традиционный) <-> Английский | zh-TW <-> en
|
6 | Хорватский <-> Английский | hr <-> en
|
7 | Чешский <-> Английский | cs <-> en
|
8 | Датский <-> Английский | da <-> en
|
9 | Голландский <-> Английский | nl <-> en
|
10 | Французский <-> Английский | fr <-> en
|
11 | Немецкий <-> Английский | de <-> en
|
12 | Греческий <-> Английский | el <-> en
|
13 | Иврит <-> Английский | iw <-> en
|
14 | Хинди <-> Английский | hi <-> en
|
15 | Исландский <-> Английский | is <-> en
|
16 | Индонезийский <-> Английский | id <-> en
|
17 | Итальянский <-> Английский | it <-> en
|
18 | Японский <-> Английский | ja <-> en
|
19 | Корейский <-> Английский | ko <-> en
|
20 | Норвежский <-> Английский | no <-> en
|
21 | Польский <-> Английский | pl <-> en
|
22 | Португальский <-> Английский | pt <-> en
|
23 | Румынский <-> Английский | ro <-> en
|
24 | Русский <-> Английский | ru <-> en
|
25 | Словацкий <-> Английский | sk <-> en
|
26 | Испанский <-> Английский | es <-> en
|
27 | Шведский <-> Английский | sv <-> en
|
28 | Тайский <-> Английский | th <-> en
|
29 | Турецкий <-> Английский | tr <-> en
|
30 | Вьетнамский <-> Английский | vi <-> en
|
Прямой перевод
Утверждается, что система GNMT лучше предыдущего варианта Google Переводчика тем, что она может выполнять “прямой перевод”, т.е. переводить с одного языка на другой напрямую (например, с японского на корейский).[2] Ранее Google Переводчик сначала переводил с исходного языка на английский, а затем с английского на конечный язык вместо прямого перевода с одного языка на другой.[4]
См. также
- Машинный перевод на основе примеров
- Машинный перевод на основе правил
- Сравнение приложений для машинного перевода
- Статистический машинный перевод
- Искусственный интеллект
- Cache language model
- Компьютерная лингвистика
- Автоматизированный перевод
- История машинного перевода
- Список новых технологий
- Список исследовательских лабораторий, занимающихся машинным переводом
- Нейронный машинный перевод
- Машинный перевод
- Универсальный переводчик
Ссылки
Внешние ссылки
- Преимущества и недостатки машинного перевода
- Статистический машинный перевод
- Международная ассоциация машинного перевода (IAMT) Шаблон:Wayback
- Архив машинного перевода Шаблон:Wayback от Джона Хатчинса. Электронное хранилище (и библиография) статей, книг и статей в области машинного перевода и технологии компьютерного перевода
- Машинный перевод (автоматический перевод) Шаблон:Wayback – публикации Джона Хатчинса (включают в себя PDF нескольких книг про машинный перевод)
Шаблон:Подходы к машинному переводу
Шаблон:Обработка естественного языка
- ↑ 1,0 1,1 1,2 1,3 1,4 Шаблон:Citation Шаблон:Wayback
- ↑ 2,0 2,1 2,2 2,3 2,4 2,5 Шаблон:Citation Шаблон:Wayback
- ↑ 3,0 3,1 Шаблон:Citation Шаблон:Wayback
- ↑ 4,0 4,1 Шаблон:Cite web
- ↑ 5,0 5,1 Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Citation Шаблон:Wayback
- ↑ Шаблон:Cite news
- ↑ Шаблон:Cite web
- ↑ Google Switches to its Own Translation System Шаблон:Wayback, October 22, 2007
- ↑ Шаблон:Cite web
- ↑ Шаблон:Citation Шаблон:Wayback
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- ↑ Шаблон:Cite web
- Русская Википедия
- Применение искусственного интеллекта
- Компьютерная лингвистика
- Машинный перевод
- Искусственные нейронные сети
- Задачи обработки естественного языка
- Страницы, где используется шаблон "Навигационная таблица/Телепорт"
- Страницы с телепортом
- Википедия
- Статья из Википедии
- Статья из Русской Википедии