📊💡Датасет для анализа видео
CinePile — это датасет для понимания видео на основе вопросов и ответов. Он был создан с использованием передовых моделей больших языковых моделей (LLM). Датасет включает примерно 300 000 точек данных для обучения и 5 000 точек данных для тестирования.
Каждая строка в наборе данных состоит из вопроса (dtype: string), пяти вариантов ответа (dtype: list) и ключа ответа (answer_key) (dtype: string). Во вспомогательных столбцах хранятся название фильма, жанр фильма, названия видеоклипов и т. д.
Для загрузки датасета через Python-скрипт можно воспользоваться следующей командой:
from datasets import load_dataset
dataset = load_dataset("tomg-group-umd/cinepile")
Post #578
589