参考文献:
ar_to_ja
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ar_to_en')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ar",
"en"
],
"id": null,
"_type": "Translation"
}
}
ar_to_es
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ar_to_es')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ar",
"es"
],
"id": null,
"_type": "Translation"
}
}
ar_to_fr
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ar_to_fr')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ar",
"fr"
],
"id": null,
"_type": "Translation"
}
}
あるとる
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ar_to_ru')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ar",
"ru"
],
"id": null,
"_type": "Translation"
}
}
ar_to_zh
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ar_to_zh')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ar",
"zh"
],
"id": null,
"_type": "Translation"
}
}
en_to_es
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/en_to_es')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"en",
"es"
],
"id": null,
"_type": "Translation"
}
}
en_to_fr
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/en_to_fr')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"en",
"fr"
],
"id": null,
"_type": "Translation"
}
}
en_to_ru
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/en_to_ru')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"en",
"ru"
],
"id": null,
"_type": "Translation"
}
}
en_to_zh
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/en_to_zh')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"en",
"zh"
],
"id": null,
"_type": "Translation"
}
}
es_to_fr
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/es_to_fr')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"es",
"fr"
],
"id": null,
"_type": "Translation"
}
}
エストゥル
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/es_to_ru')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"es",
"ru"
],
"id": null,
"_type": "Translation"
}
}
es_to_zh
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/es_to_zh')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"es",
"zh"
],
"id": null,
"_type": "Translation"
}
}
fr_to_ru
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/fr_to_ru')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"fr",
"ru"
],
"id": null,
"_type": "Translation"
}
}
fr_to_zh
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/fr_to_zh')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"fr",
"zh"
],
"id": null,
"_type": "Translation"
}
}
ru_to_zh
次のコマンドを使用して、このデータセットを TFDS にロードします。
ds = tfds.load('huggingface:un_ga/ru_to_zh')
- 説明:
United nations general assembly resolutions: A six-language parallel corpus.
This is a collection of translated documents from the United Nations originally compiled into a translation memory by Alexandre Rafalovitch, Robert Dale (see http://uncorpora.org).
6 languages, 15 bitexts
total number of files: 6
total number of tokens: 18.87M
total number of sentence fragments: 0.44M
- ライセンス: 既知のライセンスはありません
- バージョン: 2.0.0
- 分割:
スプリット | 例 |
---|---|
'train' | 74067 |
- 特徴:
{
"id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"translation": {
"languages": [
"ru",
"zh"
],
"id": null,
"_type": "Translation"
}
}