Qwen3.5-27B: модель видит не каждый кадр
Qwen3.5-27B: модель видит не каждый кадр
Вы дали модели видео, а короткое появление предмета она пропустила. Прежде чем менять prompt или GPU, проверьте, какие кадры до неё дошли. У Qwen3.5-27B от команды Qwen поддержка видео не означает просмотр каждого кадра исходного файла.
В официальном примере обработки видео указаны fps=2 и do_sample_frames=True: кадры выбираются с заданной частотой. Это частота отбора для модели, не частота съёмки. Поэтому запись с плавным движением может поступить на анализ как редкая последовательность снимков.
Возьмите короткий ролик с событием, время которого вы знаете. Сохраните кадры после предобработки и проверьте, попал ли туда нужный момент. Затем в поддерживаемой конфигурации vLLM сравните отбор при fps=2 и fps=4, не меняя вопрос и разрешение. Для настройки fps через запрос карточка требует запуска vLLM с параметром --media-io-kwargs '{"video":{"num_frames":-1}}'.
Сравните найденные события, время ответа и пиковую VRAM — память GPU. Так вы проверите цену более частого отбора на своей нагрузке. Даже большее число кадров не гарантирует правильного ответа: модель может неверно понять видимое.
Сначала проверьте, увидела ли модель нужный момент, и только потом оценивайте её ответ.

