서브카

참고자료:

서적

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/books')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 345
'train' 1314
'validation' 256
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}

전자 제품

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/electronics')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 358
'train' 1295
'validation' 255
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}

식료품점

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/grocery')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 591
'train' 1124
'validation' 218
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}

영화 산업

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/movies')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 291
'train' 1369
'validation' 261
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}

레스토랑

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/restaurants')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 266
'train' 1400
'validation' 267
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}

트립어드바이저

TFDS에 이 데이터세트를 로드하려면 다음 명령어를 사용하세요.

ds = tfds.load('huggingface:subjqa/tripadvisor')
  • 설명 :
SubjQA is a question answering dataset that focuses on subjective questions and answers.
The dataset consists of roughly 10,000 questions over reviews from 6 different domains: books, movies, grocery,
electronics, TripAdvisor (i.e. hotels), and restaurants.
  • 라이센스 : 알려진 라이센스 없음
  • 버전 : 1.1.0
  • 분할 :
나뉘다
'test' 512
'train' 1165
'validation' 230
  • 특징 :
{
    "domain": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "nn_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_mod": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "query_asp": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "q_reviews_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question_subj_level": {
        "dtype": "int64",
        "id": null,
        "_type": "Value"
    },
    "ques_subj_score": {
        "dtype": "float32",
        "id": null,
        "_type": "Value"
    },
    "is_ques_subjective": {
        "dtype": "bool",
        "id": null,
        "_type": "Value"
    },
    "review_id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "id": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "title": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "context": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "question": {
        "dtype": "string",
        "id": null,
        "_type": "Value"
    },
    "answers": {
        "feature": {
            "text": {
                "dtype": "string",
                "id": null,
                "_type": "Value"
            },
            "answer_start": {
                "dtype": "int32",
                "id": null,
                "_type": "Value"
            },
            "answer_subj_level": {
                "dtype": "int64",
                "id": null,
                "_type": "Value"
            },
            "ans_subj_score": {
                "dtype": "float32",
                "id": null,
                "_type": "Value"
            },
            "is_ans_subjective": {
                "dtype": "bool",
                "id": null,
                "_type": "Value"
            }
        },
        "length": -1,
        "id": null,
        "_type": "Sequence"
    }
}