Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
Из этого я взял лору Лайт2х лору от Киджая (ужатую), 8 (7) шагов euler beta, Sol, и получается заебато, конечно. Спектрум, как мне показалось, толком тут уже не работает, пропуск 1-2 шагов погоды не делает, ИМХО. Сажа включена по умолчанию, флагом в sh, что ты мне сделаешь.
Я хз как вы смотрите, турбо лора реально не даёт слоумо и следует промпту так же эффективно, выполняя порядок действий на протяжени 15 секунд, что и ориг, при этом прирост от х3 до х5, и это самая первая сырая версия.
блядь как же я заебался заставить сэйдж работать, куда обновил, колесо прикрутил, всё пишет что работает, а на ноде всегда ошибка вылезает. 6 часов убил на эту хуйню
>>1670688 бле ананас, спектрум то работает, не кто не спорит и время уменьшается, но ты прикинь если у тебя под турбо лорой из 6 шагов, полноценных только 3
это на обычной генерации скип еще компенсируется, на турбе это сразу деградация картинки
>>1670698 Его можно в comfy подключить, ёбаный рот, какие вы все однобокие экспериментаторы хуевы, только циферки дрочить в готовых инструментах можете.
Ну я сравнил ориг + ртх + дено. Дено действительно мылит, но на ртх без дено видно увеличенные артефакты, короче, ну чу-у-у-уточку лучше с ртх и еще чу-у-у-уточку лучше с дено => ртх. Но за 2,5 секунды как будто и даром. Надо тестить мелкие разрешения теперь.
Как же r2v ебёт это просто сказка! Я охуел. Тут даже лоры не нужны. Единственный минус - звуковые эффекты. Но по идее и их можно пофиксить через прикрепляемое аудио.
>>1670751 Двачую. Вообще реф это монстр. Вот я взял лору, сгенерил хенджоб. А там вместо пениса бодихоррор. Ну я думал подождать лору сначала, а потом вспомнил про реф моделку. По итогу в качестве рефа дал рандомную пикчу пениса и вообще отлично вышло.
>>1670741 На. Я все прошлые выходные пытался соединить эти две картинки в одну, нихуя не выходило либо выходило криво. А вчера с первой попытки сделал видеорил, именно то что мен нужно. Хотел пикчу, а получил видос в 1080 рублей. Кадр с тележкйо тоже заебался делать, ван её все время двигал, чтобы я ему не говорил. Эйч три с первого раза взял нужный ракурс.
Пытаюсь использовать две картинки с персонажами и видео в качестве референса их движений (типа, чтобы два моих персонажа танцевали как на видео). Но в итоге каждый раз получаю тупо видео ряд из референсного видео. Вроде бы всё делаю, как в гайде написано. Мой промпт: subject_definitions: <Subject 1> is the woman from <Picture 0> dancing like in a <Video 0> <Subject 2> is the man from <Picture 1> dancing like in a <Video 0>
summary: [reference generation] The target video is a dark scene where <Subject 1> and <Subject 2> dancing like in a <Video 0>.
detailed_description: The target video is in a realistic, documentary style with natural lighting and a static camera. [Shot 1] The video opens with <Subject 1> which dances with <Subject 2>. <Subject 1> and <Subject 2> smiles. Static camera.
overall_soundscape: Quiet street noise can be heard on the background.
non_diegetic_music: A romantic melody plays in the background.
Пробовал исправлять с помощью DeepSeek - результат тот же. Использую стандартный воркфлоу из темплейтов для ref2va.
>>1670863 Прогони референесное видео через DWPose или Depth Anything.
Есть еще одна мутная тема с размерам референса. По ощущениям если он совпадает с конечным разрешением, то больше шансов, что модель его затянет как есть в кадр и наоборот.
Какой положняк по двум турболорам? И как использовать первую в стандартном лоадере - ругается миллионом сообщений вида [WARNING] lora key not loaded: blocks.39.adaln_proj.linear.lora_A.weight
>>1670850 У меня ref2va на 5060ti 16 gb (+ 80 gb RAM) с одной картинкой-референсом на модели int8 c 16 шагами 5 секунд видео 1280 x 736 на дефолтном воркфлоу генерится примерно 15-16 минут
Охуел конечно, как оно легко с камерой работает, представляя те же объекты со всех возможных ракурсов. И это на голом ворке из комфи. Надо обмазаться по полной.
>>1670914 в теории если турбу ебашишь то аудио надо на 6 выкрутить при 4-8 шагах, по умолчанию и так 12 и 3 используются и только увеличиваешь время генерации из-за лишнего патча
бля какой подгон сделали китайцы конеш, хуй представишь что какой то ван или лтх могли бы сделать хоть чтото похожее. без всяких лор на стоковой модели. Пиздец конеш базированые китайцы, правда походу над было ставить побольше секунд, а то они прям зарашили. Но вот вернулось то что умерло с лтх, а именно кайф в придумывании промптов всяких так еще и качество как будто ты корпу юзаешь, ток бесплатно и без цензуры
>>1670918 -> >>1668830 → >Но если по картинке с референсом модель не сделает рол с каким нибудь иллитидом сосущем ебушем рот тянки, то выкладывать рил будет нечего, ван с лорами останется на пьедестале. Ну и как, ван всё ещё на пьедестале?
>>1670926 Но у LTX всё же звук получше будет. Я хоть и тоже в восторге от китайцев, но расстроен из за того что вместо минутных LTX видосов моя система едва способна на видосы в 15-20-сек в лоу резоолюшене, какой то дауншифтинг или очередная заявка на полумилионный апгрейд системы :( Также не совсем понял почему Ref2VA по одной пикче генерит результирующее видео раз в 10 дольше чем FL2VA, того же разрешения и той же длительности.
>>1670993 ну кстати чтобы чисто прогнать посмотреть как промпт будет работать можно вообще все ускорялки включить, результат будет кал но что то видно будет