LAION пусна масивен отворен набор от видеоданни с 10 милиона часа видеоматериали за изследвания в областта на ИИ
LAION пусна Big Video Dataset (BVD) — един от най-големите отворени набори от видеоданни за изследвания в областта на ИИ. Той се основава на 1,3 милиарда URL адреса към видеоклипове, открити в CommonCrawl. Екипът е изтеглил 80 милиона от тези видеоклипове с обща продължителност 10 милиона часа и е извлякъл 55 милиона клипа с автоматично генерирани описания на видеото и аудиото, както и 300 милиона статични изображения.

Според научната статия моделите, обучени с BVD, превъзхождат сравними модели, обучени с InternVid, с до 2,1 процентни пункта при разпространени тестове за преобразуване на видео в текст. Обучението свързва видеото, аудиото и текста, като научава кое визуално съдържание съответства на кои описания или звуци.
LAION предоставя набора от данни само за изследователски цели. От правна гледна точка организацията вероятно може да се позове на решение на Хамбургския регионален съд от 2024 г., което ѝ е позволило да събира защитено с авторски права съдържание за некомерсиални изследвания. LAION призовава потребителите да зачитат правата на първоначалните създатели на съдържание. Наборът от данни и кодът са свободно достъпни.
Новини за ИИ без сензация – подбрани от хора
Абонирайте се за THE DECODER за четене без реклами, седмичен бюлетин за ИИ, нашия ексклузивен шест пъти годишно доклад за новостите „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.