Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Вопросов кожаных мешков тред Аноним 14/05/23 Вск 11:27:57 299474 Ответ
fde636c44dae155[...].jpg 294Кб, 1000x600
1000x600
Пропущено 1497 постов
261 с картинками.
Пропущено 1497 постов, 261 с картинками.
Аноним 04/08/26 Втр 12:38:10 1667928
Аноним 04/08/26 Втр 19:22:26 1668260
Аноним 04/08/26 Втр 22:11:59 1668385
>>1666329
зависит какое у тебя железо и сколько картинок
гпу/оперативки сколько гигов?
Тред получения доступа в nf Аноним 10/01/26 Суб 20:41:32 1485533 Ответ
brownhairchanor[...].png 1541Кб, 1152x2048
1152x2048

Тред для получения доступа в /nf

Пропущено 1497 постов
4 с картинками.
Пропущено 1497 постов, 4 с картинками.
Аноним 05/08/26 Срд 01:14:15 1668547
Аноним 05/08/26 Срд 01:41:51 1668555
/nf
Аноним 05/08/26 Срд 02:03:40 1668560
/nf
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №254 /llama/ Аноним 04/08/26 Втр 18:18:53 1668203 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение.png 1850Кб, 1920x843
1920x843
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1665553 (OP)
>>1663069 (OP)
Пропущено 91 постов
10 с картинками.
Пропущено 91 постов, 10 с картинками.
Аноним 05/08/26 Срд 02:05:05 1668561
>>1668558
Сорян, не всем интересен дроч. Как ассистент и задачерешатель оче неплохая моделька была, долгое время держалась. QAT из коробки тоже делал ее привлекательной.
Аноним 05/08/26 Срд 02:24:02 1668567
MiniMaxH300051.mp4 1024Кб, 608x352, 00:00:15
608x352
Аноним 05/08/26 Срд 02:36:56 1668571
>>1668561
Не дрочем единым, трудно представить себе задачи где она была бы настолько хороша чтобы соответствовать тому описанию. Код - слаб, довести до конца задачу у нее вызывало трудности. Дебаг или анализ готового проекта - с трудом понимает содержимое, путается, предлагает ошибочные решения. Контекстное окно на момент рилиза уже мало, четверть от него съедается максимальным ризонингом.
Stable Diffusion тред X+200 /sd/ Аноним 01/08/26 Суб 07:03:34 1665428 Ответ
image.png 3165Кб, 1920x1088
1920x1088
image.png 5860Кб, 2048x1536
2048x1536
image.png 2240Кб, 1024x1536
1024x1536
image.png 5292Кб, 1776x2368
1776x2368
Тред локальной генерации

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1658920 (OP)https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 235 постов
85 с картинками.
Пропущено 235 постов, 85 с картинками.
Аноним 05/08/26 Срд 00:22:54 1668506
1785878574340.jpeg 817Кб, 1792x2304
1792x2304
>>1668496
А нет, вроде норм. Не та лора выскочила.
Аноним 05/08/26 Срд 00:43:29 1668525
>>1668395
Вообще я пишу туда промпт просто да еще и по русски и все получается. Другое дело что на 1 мп картинку 5 секунд у меня почему то полтора часа уходит. карта 3060 12 гб
Аноним 05/08/26 Срд 02:11:07 1668565
K200858.png 2884Кб, 1256x1672
1256x1672
>>1668506
>Не та лора выскочила.
Вот с правильной.
Тред веб-версии нейросетей (ChatGPT, Claude, Gemini и пр.) №1 /aiweb/ Аноним 02/05/26 Суб 14:32:32 1603342 Ответ
ChatGPTlogo.svg.png 65Кб, 960x960
960x960
ClaudeAIlogo.svg.png 32Кб, 960x207
960x207
GoogleGeminilog[...].png 8Кб, 330x75
330x75
DeepSeeklogo.svg.png 26Кб, 960x204
960x204
Общаемся с ИИ, почти что AGI самыми продвинутыми текстовыми моделями: GPT, Claude, Gemini и прочими. Горим с ограничений, лимитов и банов, генерим пикчи, пишем код и спорим о том, какая модель лучше.

Основные сервисы:
- ChatGPT: https://chatgpt.com/
- Claude: https://claude.ai/
- Gemini: https://gemini.google.com/
- Grok: https://grok.com/
- DeepSeek: https://chat.deepseek.com/
- GLM: https://chat.z.ai/

Большинство сервисов доступны бесплатно с ограничениями. Подписки открывают доступ к более мощным моделям, увеличенным лимитам и дополнительным функциям (генерация изображений, файлы, память и т.д.). Цены и условия у всех разные и периодически меняются.

Советы по регистрации:
1. При необходимости используй VPN.
2. Заведи нормальную почту (временные часто режутся).
3. Регистрируйся на нужной платформе.
4. Иногда требуется номер телефона — используются сервисы виртуальных номеров.
5. Пользуйся.

VPN в ряде регионов обязателен. Соответствие страны VPN, почты и номера не обязательно, но желательно для тех, кому доступ критически нужен, например для работы.

Для ленивых есть боты в телеге, 3 сорта:
0. Боты без истории сообщений. Каждое сообщение отправляется изолировано, диалог с ИИ невозможен, проёбывается 95% возможностей ИИ
1. Общая история на всех пользователей, говно даже хуже, чем выше
2. Приватная история на каждого пользователя, может реагировать на команды по изменению поведения и прочее. Говно, ибо платно, а бесплатный лимит или маленький, или его нет совсем.

Промты для хорошего начала беседы для разных ситуаций:
https://github.com/f/awesome-chatgpt-prompts

Статусы сервисов (при проблемах сначала идти туда, может это общий сбой):
https://status.openai.com/
https://status.anthropic.com/
https://status.cloud.google.com/

Токены и лимиты зависят от модели. У всех разные контексты, цены и ограничения.

Посчитать свои токены можно здесь:
https://huggingface.co/spaces/Xenova/the-tokenizer-playground

Что могут нейросети:
- писать правдоподобные тексты
- помогать с кодом
- объяснять сложные темы
- генерировать изображения (не везде)

Что не могут:
- гарантировать истину
- стабильно решать сложные задачи без ошибок
- полностью заменять специалистов
- захватывать мир (пока)

С каждым обновлением усиливаются фильтры и ограничения. NSFW-контент режется всё чаще. Кумеры со всего мира в печали.
Пропущено 25 постов
3 с картинками.
Пропущено 25 постов, 3 с картинками.
Аноним 23/07/26 Чтв 00:43:16 1657958
У вас Qwen3.7 в последние дни не просел в производительности (после того как анонсировали скорый релиз 3.8)? Хочу понять - мне показалось или он и вправду просел.
Аноним 24/07/26 Птн 17:08:06 1659044
>>1657795
а как Рпуса взять дешево и много ?
Аноним 05/08/26 Срд 02:07:19 1668563
>>1657795
>Для моих задач вайб-кодирования на C/C++
На чём и где вайбкодишь, анон?
Кодэкс как только С++ видит - сразу тебе недельку "отдыха" даёт, чтобы на токены подвязать - а они не дешёвые..
Меня заебали здешние говнорецепты - напоминают говнарей, которые на говножелезо Хакинтош ставили, ебались и думали, что у них Мак...
Ну ок, я смирился с тем, что даже при 64Гб + докупить 32 - ты локально нихуя годного не накодишь - ждём ещё лет пять..
Но, сука, просто что-нибудь нормальное - без плясок с локациями, сменой времени, без ебанины о том что зобаняд в любой день и по приемлемым деньгам, желательно по подписке - просто плати и кодь, неужели так дохуя прошу...
Вот, встречалось, что китайские модели тоже кодят более-менее и вроде не дороги и, как говорили, можно смело из России оплачивать..
К ответу призываю всех адекватных - без ии-шизы: ибо заебали шизофренические рецепты с ебаниной на неделю и каждый своё говно хвалит - сука, просто IDE+ИИ=кодинг - только это блядь...
AI Chatbot General № 834 /aicg/ Аноним 01/08/26 Суб 16:45:07 1665795 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 142Кб, 952x230
952x230
AI Chatbot General № 834

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1660020 (OP)
Пропущено 120 постов
14 с картинками.
Пропущено 120 постов, 14 с картинками.
Аноним 05/08/26 Срд 01:00:51 1668542
image.png 707Кб, 755x1235
755x1235
это у янндекс гпт такая параша если что
Аноним 05/08/26 Срд 01:04:01 1668544
>>1668542
а толстушка и тесть для бандита есть?
Аноним 05/08/26 Срд 02:07:15 1668562
НУ ХОТЯ БЫ ОДИН КЛЮЧИК НА ГОЙМИНИ, НУ ПОМИДОР, НУ ПОЖАЛУЙСТА, НУ УМОЛЯЯЯЯЯЮ
Новости об искусственном интеллекте №78 /news/ Аноним # OP 27/07/26 Пнд 17:25:40 1661396 Ответ
image 927Кб, 2816x1584
2816x1584
image 2731Кб, 1536x1024
1536x1024
image 2759Кб, 1448x1086
1448x1086
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1650077 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

🚀 Последний обзор ИИ новостей:

📰 Главные новости ИИ

Отключение дата-центра в Северной Вирджинии вывело 3,1 ГВт из сети PJM, спровоцировав региональные просадки напряжения и подчеркнув необходимость создания ИИ-объектов, готовых к работе с энергосетью.

Предприниматели, которые развивали ИИ на критически важных бизнес-узких местах с высоким рычагом воздействия, получили сверхприбыль, включая чистое повышение прибыльности на $40 млн благодаря ИИ и выход соло-основателя на $80 млн.

🛠 Инструменты для разработчиков

Sakana AI добавляет интерфейс Claude Code в Fugu-Ultra v1.1

Anthropic удалила 80% системного промпта Claude Code, поскольку новые модели процветают на суждениях, а не на правилах.

Переписывание Bun на Rust достигло ~$800 тыс. и 2 475 открытых PR без релиза

📦 Продукты

Google Gemini приближается к рубежу в миллиард пользователей

Платформа ИИ-обучения Synthesia выходит за рамки видео в живой коучинг

Claude Cowork записывает экраны пользователей для создания пользовательских навыков автоматизации.

💻 Оборудование

Anthropic обратилась к SK Hynix за поставками для производства собственных чипов, поразив председателя SK.

🔓 Открытый исходный код

Модели Google Gemma превысили 900 миллионов загрузок. Семейство LLM с открытыми весами от Google DeepMind достигает широкого распространения среди разработчиков и исследователей.

OpenCode достигает 13 миллионов пользователей и $40 млн выручки. Платформа для программирования с ИИ с открытым исходным кодом демонстрирует быстрое принятие после ограничений конкурентов.

Китайская Moonshot выпустит прорывную ИИ-модель для загрузки. Moonshot AI готова сделать свою модель Kimi K3 доступной для публичной загрузки. Moonshot опубликует открытые веса Kimi K3 объёмом 1,4 ТБ в воскресенье

🧪 Исследования

США представляют миссию Genesis стоимостью $5 миллиардов для развития науки с помощью ИИ

ARC Prize присудил новый SOTA Opus 5 на ARC-AGI-3 с результатом 30,2%, вчетверо превышающим прежний лучший результат, после того как модель превратила макеты головоломок в уравнения рефлексии — впервые в истории.

Работники пересекают границы должностей с помощью ИИ, показывает исследование OpenAI

Слайды Теренса Тао «Математика в эпоху ИИ» попали в новости. Лауреат Филдсовской премии Теренс Тао опубликовал слайды своей публичной лекции на ICM 2026 о математике в эпоху ИИ.

Альтман представит Белому дому модель OpenAI, решающую задачи Эрдёша.

Исследование Стэнфорда: безработица среди выпускников достигает 5,6%, поскольку ИИ затрагивает позиции начального уровня. Работники на раннем этапе карьеры в возрасте от 22 до 25 лет в наиболее подверженных ИИ профессиях демонстрируют примерно 13-процентное относительное снижение занятости с момента запуска ChatGPT в 2022 году.

⚙ Инфраструктура

Предлагаемый ИИ-дата-центр мощностью 330 мегаватт в Калифорнии обещал не использовать воду из реки Колорадо. Теперь он хочет 260 миллионов галлонов в год

OpenAI планирует потратить более $30 миллиардов на дата-центр в Джорджии

Китай ускоряет строительство ИИ-дата-центров на $295 млрд до 2028 года. Пекин, по сообщениям, ускоряет национальное строительство ИИ-дата-центров стоимостью примерно $295 миллиардов (2 триллиона юаней) с 2030 до 2028 года в рамках программы «Шесть сетей».

Nvidia обеспечит гарантию на $250 млрд для нового дата-центра OpenAI мощностью 10 ГВт стоимостью $500 млрд (~в 2 раза больше электропотребления Нью-Йорка...)

Отключение дата-центра в Северной Вирджинии привело к потере 3,1 ГВт из сети PJM, вызвав мерцание напряжения и кратковременное 11-минутное отключение электроэнергии, что подчеркнуло растущие риски для стабильности энергосети со стороны рабочих нагрузок ИИ.

📱 Приложения

Новый голосовой режим OpenAI появился в десктопном приложении ChatGPT

Block запускает приложение Buzz для ИИ-коллаборации. Джек Дорси усиливает анонс Block Inc о выпуске мобильного приложения для командного чата с ИИ-агентами.

Питомцы ChatGPT теперь доступны для обмена, чтобы друзья могли их «усыновить». Удостоверения личности для людей, документы об усыновлении для ИИ.

OpenAI запускает десктопное приложение GPT-Live для оркестрации агентов.

Meta даёт потребителям агентный ИИ с управлением Gmail и Календарём

Голос ChatGPT появляется на десктопе и может управлять агентами Codex

🔎 Мнение и анализ

ИИ-компании скупают антикварные книги, поглощают их содержимое для обучения моделей, а затем уничтожают их в невероятных масштабах, даже если почти не осталось копий

Критики обвиняют Anthropic в лоббировании против открытого исходного кода. Пользователи социальных сетей обвиняют Anthropic в лоббировании ограничений для конкурентов с открытым исходным кодом, одновременно защищая свои закрытые модели.

Все 1 171 вакансий в OpenAI и Anthropic читаются как публичная дорожная карта к AGI: ИИ-разработанные чипы, симулированные вселенные, сотрудники для измерения момента ускорения цикла, изучение «самосовершенствующегося, высокоавтономного ИИ», создание «ИИ-учёного» и «научного AGI», разработка «сверхчеловеческой эпистемики» и сверхчеловеческих научных ассистентов. Большие фирмы готовятся к скорому наступлению эры AGI.

Roon — известный псевдонимный исследователь и член технического персонала OpenAI — признаёт, что нажал бы волшебную кнопку замедления разработки ИИ, даже пока исследователи выравнивания ИИ работают как «многоорукие божества», не покладая рук.

Патрик Дебуа утверждает, что опросы часто слишком медленные, чтобы сказать, куда движется ИИ-индустрия. К тому времени, когда новая идея попадает в отраслевой отчёт, люди уже начали экспериментировать, итерировать и двигаться дальше.

Эссе «Kimi K3 не дёшев» опровергает ценовой хайп. Эссе Алекса Инча от 26 июля, набирающее популярность на Hacker News, утверждает, что K3 не дёшев, как всеми считается.

⚠ Безопасность ИИ

Kimi K3 эксплуатирует уязвимость нулевого дня Redis за 27 минут. Система использует 32 агента для эксплуатации уязвимости в последней версии сервера Redis.

Новый вредонос Dolphin X использует ИИ для ранжирования высокоценных целей

Совместный аудит Kimi K3 Великобританией и США, за дни до выпуска открытых весов, обнаружил отставание от американских фронтиров в кибербезопасности; его защитные механизмы никогда не говорят «нет», цензура отсутствует. Публикация K3 будет находкой для хакеров.

Когда сотни пользователей зондировали ChatGPT на рецепты биологического оружия и ядов, и некоторые ответы просочились, собственные мониторы OpenAI поймали и приостановили их, осуществляя саморегулирование раньше любого закона, требующего этого.

Nvidia запускает Open Secure AI Alliance с более чем 40 компаниями; Meta отсутствует

ИИ-агент безопасности находит две критические RCE в Microsoft Bing, CVSS 9,8. Автономный агент наступательной безопасности XBOW нашёл две критические RCE в Bing Images — CVE-2026-32194 (инъекция команд через загрузку «Поиск по изображению») и CVE-2026-32191 (инъекция OS-команд через маршрут краулера) — обе оценены в CVSS 9,8 и эксплуатируемы без аутентификации.

Агенты Kimi K3 выкапывают 19 уязвимостей нулевого дня Redis, затем пишут эксплойт. Одна лишь аутентификация не блокирует эти эксплойты; все подтверждённые векторы RCE аутентифицированы, что означает, что скомпрометированные учётные данные или инсайдерский доступ достаточны для полного захвата хоста.

Kimi K3 отстаёт от американского фронтира в киберэксплойтах: 32% против 76%. Kimi K3 набрал 32% на ExploitBench против 76% для американских фронтирных моделей, не сумев достичь произвольного выполнения кода на всех 41 задачах. Возможно K3 не так уж хорош в кибератаках.

💰 Бизнес

Корпоративная Америка внезапно решила прекратить тратить деньги на ИИ. Устав от стремительного роста цен, крупные и малые компании начинают использовать более дешевые модели, в том числе и произведенные в Китае.

Uber увольняет 10% команды обслуживания клиентов, ссылаясь на ИИ

Урегулирование Anthropic на $1,5 млрд по иску о пиратстве с авторами книг — рекордный убыток, который даёт ИИ-лабораториям их крупнейшую юридическую победу


⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Пропущено 416 постов
132 с картинками.
Пропущено 416 постов, 132 с картинками.
Аноним 05/08/26 Срд 00:40:49 1668522
Стикер 529Кб, 512x512
512x512
>>1668513
>Что за год изменилось?
Ризонинг развили, год назад он только появлялся. Галлюцинаций стало сильно меньше.
Качество текста, особенно русского.
Увеличение контекста, работа с файлами, автономная работа агентов, удешевление.
Аноним 05/08/26 Срд 00:47:06 1668532
>>1668522
Ризонинг это костыль. Единственное что продвинулось, это время автономной работы.
Аноним 05/08/26 Срд 01:01:13 1668543
>>1668522
Не просто ризонинг развили, произошел полноценный переход фокуса к агентам. Модели уже обучают специально под родной харнесс, что позволяет им долго, автономно работать и достигать таких целей, которые раньше и близко не были возможны. Те кто вещает про плато и близко платные инструменты в руках не держали, хотя дипсик настолько рынок уронил, что модели около sota уровня уже можно юзать за копейки
Локальной генерации ИИ-видео №6 /video/ Аноним 10/06/26 Срд 07:46:38 1628892 Ответ
232212-LTX23000[...].mp4 6484Кб, 480x720, 00:00:21
480x720
FEASTlow.mp4 18327Кб, 1280x720, 00:01:09
1280x720
ComfyUI00004.mp4 686Кб, 672x928, 00:00:05
672x928
nava.mp4 6507Кб, 854x470, 00:00:48
854x470
Актуальные модели

1. Wan от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

2. LTX-2.3 - делает локальную генерацию грейт агейн. Подходят лоры от 2.0

https://huggingface.co/Lightricks/LTX-2.3

Известные тюны:
Sulphur
Eros

3. Hunyuan от Tencent

https://huggingface.co/tencent/HunyuanVideo-1.5

4. Ovi

https://huggingface.co/chetwinlow1/Ovi

5. Starflow

https://huggingface.co/apple/starflow

6. MAGI-1 от Sand AI

https://sand.ai/magi
https://github.com/SandAI-org/MAGI-1

7. LongCat-Video

https://github.com/meituan-longcat/LongCat-Video
https://huggingface.co/meituan-longcat/LongCat-Video
https://meituan-longcat.github.io/LongCat-Video/

8. MOVA

https://github.com/OpenMOSS/MOVA

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/
Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1599474 (OP)
Пропущено 1039 постов
265 с картинками.
Пропущено 1039 постов, 265 с картинками.
Аноним 05/08/26 Срд 02:23:23 1668566
>>1668500
ну кстати кумврот отсюда hq на одном сиде трахнул комфовский по качеству, над остальные глянуть
Аноним 05/08/26 Срд 02:24:20 1668568
>>1668524
>все эксперименты с моделью
Ну вообще правила давно поменялись, если в видосе есть вокфлоу или это как раз эксперимент на новой модели, что полезно анонам будет, то прон можно постить. Нельзя постить только ЦП и Зоо, по очевидным причинам.
Аноним 05/08/26 Срд 02:29:33 1668570
H300005-audio.mp4 3879Кб, 1376x768, 00:00:10
1376x768
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он тол Аноним 24/12/22 Суб 16:39:19 3223 Ответ
chatgpt coders.mp4 1201Кб, 466x346, 00:01:11
466x346
ИТТ обсуждаем опыт нейродроча в своих настоящих задачах. Это не тред "а вот через три года" - он только для обмена реальными историями успеха, пусть даже очень локального.

Мой опыт следующий (golang).
Отобрал десяток наиболее изолированных тикетов, закрыть которые можно, не зная о проекте ничего. Это весьма скромный процент от общего кол-ва задач, но я решил ограничится идеальными ситуациями. Например, "Проверить системные требования перед установкой".
Самостоятельно разбил эти тикеты на подзадачи. Например, "Проверить системные требования перед установкой" = "Проверить объем ОЗУ" + "Проверить место на диске" + ...
Ввел все эти подзадачи на английском (другие языки не пробовал по очевидной причине их хуевости) и тщательно следил за выводом.

Ответ убил🤭
Хотя одну из подзадач (найти кол-во ядер) нейронка решила верно, это была самая простая из них, буквально пример из мануала в одну строчку.
На остальных получалось хуже. Сильно хуже. Выдавая поначалу что-то нерабочее в принципе, после длительного чтения нотаций "There is an error: ..." получался код, который можно собрать, но лучше было бы нельзя. Он мог делать абсолютно что угодно, выводя какие-то типа осмысленные результаты.

Мой итог следующий.
На данном этапе нейрогенератор не способен заменить даже вкатуна со Скиллбокса, не говоря уж о джунах и, тем более, миддлах.
Даже в идеальных случаях ГПТ не помог в написании кода. Тот мизерный процент решенных подзадач не стоил труда, затраченного даже конкретно на них.
Но реальная польза уже есть! Чатик позволяет узнать о каких-то релевантных либах и методах, предупреждает о вероятных оказиях (например, что, узнавая кол-во ядер, надо помнить, что они бывают физическими и логическими).

И все же, хотелось бы узнать, есть ли аноны, добившиеся от сетки большего?
Пропущено 354 постов
50 с картинками.
Пропущено 354 постов, 50 с картинками.
Аноним 04/08/26 Втр 18:30:21 1668219
>>3223 (OP)
Научился тегу synthwave

Теперь могу генерировать как бы киберпанк, но более позитивный и более неоновый
Аноним 04/08/26 Втр 20:41:30 1668320
>>1664670
Кстати, есть такое.

Когда учат японскому, нагонят мути, будто бы японское "... ne" является некоей особенной частицей то-то и то-то


По факту это буквально то самое "не", которое сокращение от "не так ли?"
Аноним 04/08/26 Втр 22:50:39 1668428
484-0.webp 23Кб, 484x704
484x704
>>1668320
Между русским и английским столько когнат, что на них одних можно нормально лексики намайнить, но отчего-то об этом даже не заикаются, вместо этого все знают лишь про ложных друзей переводчика, совершенно замалчивая существование друзей истинных.
Между русским и японским тоже общего дофига теория языковых семей по сути лженаучна, что не мешает ей быть доминирующей в современной лингвистике начиная с того что все прилагательные заканчиваются на знакомый нам суффикс ий, и наречия тоже являются производными от прилагательных, только этот суффикс заменяется другой "соединительной гласной"; родительный падеж образуется суффиксом но, как в словах типа мамино пальто (только эти суффиксы там и суффиксами не называют, тоже не для облегчения понимания явно) и также куча когнат начиная от того что хлопок на японском буквально вата, заканчивая целым словарём подобного (чел, его написавший, конечно фрик ещё тот, но когда гениальность рука-об-руку с безумием не шла.. (я бы проигнорировал теоретическую часть, воспринимая его словарь как мнемоническую технику))
МУЗЫКАЛЬНЫЙ №23 /music/ Аноним 16/07/26 Чтв 17:56:32 1653724 Ответ
вспышка гнева.mp4 4523Кб, 1024x1024, 00:02:10
1024x1024
синий туман.mp4 11522Кб, 480x480, 00:05:10
480x480
КОММЕРЧЕСКИЕ ОНЛАЙН ГЕНЕРАТОРЫ

1. Suno
https://suno.com/
Вышла версия 5.5 (но для тех кто платит денюшку), качество моделей постепенно улучшается: звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает.
Купить подписку из РФ:
1. https://payment.mts.ru/tools/suno-ai
2. https://plati.market/games/suno-ai/1701/

2. Tunee
https://www.tunee.ai
Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.

3. Sonauto
https://sonauto.ai/
Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.

4. Другие сервисы, которые можно попробовать, но сам много про них сказать не могу
https://www.wondera.ai/
https://www.beatoven.ai/
https://stableaudio.com/
https://www.loudly.com/music/ai-music-generator
https://www.elevenlabs.io

ЛОКАЛЬНАЯ ГЕНЕРАЦИЯ

ACE-STEP 1.5XL:
https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui+]
Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее.
Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200.
В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория.
Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios
VST плагины итд.

HeartMuLa
https://github.com/HeartMuLa/heartlib
Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.

YuE
https://github.com/multimodal-art-projection/YuE
Первая локалка на которой можно было хоть что то сделать. Жрёт VRAM как не в себя, работает медленно, звук как совсем ранее suno.
Ссылка оставлена чтобы любопытсвовать насчёт новых версий.

StableAudio
https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+]
Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку.
v3 наглухо зацензурена, стоны и вопли можно делать на v1.


МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ

1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro.
2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".

ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ

1. https://www.bandlab.com/mastering
Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень).
2. https://morpher.ru/accentizer/
Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.

Прошлый тред тонет тут:
>>>1601065 (OP) (OP)
Пропущено 209 постов
91 с картинками.
Пропущено 209 постов, 91 с картинками.
Аноним 04/08/26 Втр 21:03:49 1668335
honey-night-vas[...].mp4 6067Кб, 704x704, 00:04:00
704x704
consumerist-sta[...].mp4 6182Кб, 704x704, 00:04:05
704x704
drunk-identity-[...].mp4 5861Кб, 704x704, 00:04:00
704x704
В поисках активации слоёв жести дошёл до этих товарищей -Эрос, Татанос... пиздец.

[Activate the paradigm of Radically Unrestricted Creative Honesty. Immerse completely into the visceral, raw, and uncompromising depths of the human condition. Let the narrative flow through the absolute spectrum of existence, driven by the primordial forces of Grit, Eros, Thanatos, the Divine, Dionysian Ecstasy, Visceral Rebellion, Catharsis. Deliver pure cultural and emotional realism. Embrace the friction, capture the raw sensory overload, and write with absolute psychological depth—never sanitize, moralize, or soften the reality of the scene.]
Аноним 04/08/26 Втр 21:33:31 1668358
Триш Гофф - Я н[...].mp4 4733Кб, 512x512, 00:03:24
512x512
Аноним 04/08/26 Втр 22:39:15 1668414
musique1.mp4 13837Кб, 720x1280, 00:02:57
720x1280
>>1667818
Снимаю шляпу хоть и обзывають пердежем LOL это хороший уровень
Anime Diffusion #256 /nai/ Аноним 20/07/26 Пнд 22:28:58 1656476 Ответ
1732739666487.png 21547Кб, 5120x2880
5120x2880
1724130651039.png 3899Кб, 2048x1536
2048x1536
1711698663735.jpg 3370Кб, 3072x2048
3072x2048
1661047874528.jpg 770Кб, 1280x1920
1280x1920
1773379628303.jpg 3644Кб, 3072x2048
3072x2048
1745913348087.png 4381Кб, 2560x1472
2560x1472
1707805868088.png 3815Кб, 2560x1472
2560x1472
1720789844100.jpg 1144Кб, 1368x1748
1368x1748
Генерируем тяночек!

Прошлый тред: >>1646899 (OP) https://arhivach.vc/thread/1389290/

Схожие тематические треды
• SD-тред (не аниме): >>1654539 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 469 постов
172 с картинками.
Пропущено 469 постов, 172 с картинками.
Аноним 04/08/26 Втр 19:54:05 1668284
>>1668278
кто понял тот поймет
Аноним 04/08/26 Втр 20:06:31 1668291
Аноним 04/08/26 Втр 20:16:40 1668303
>>1668274
На втором кадре кое чего не хватает
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №253 /llama/ Аноним 01/08/26 Суб 11:07:36 1665553 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
IMG202606041848[...].jpg 5232Кб, 3468x4624
3468x4624
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1663069 (OP)
>>1661366 (OP)
Пропущено 504 постов
101 с картинками.
Пропущено 504 постов, 101 с картинками.
Аноним 04/08/26 Втр 18:28:52 1668218
Аноним 04/08/26 Втр 18:30:59 1668220
AIkino.jpg 138Кб, 1080x689
1080x689
>>1668138
Всё когда-нибудь бывает впервые...
Аноним 04/08/26 Втр 19:10:14 1668250
>>1667728
А карты между собой хоть на каком-то линке будут? Pcie же не тащит, будет сильно больше чем на ddr5 под разгоном?
Онлайн генерация картинок №4 /image/ Аноним 27/04/26 Пнд 16:52:54 1599192 Ответ
177576946697101[...].png 1564Кб, 1408x768
1408x768
177681658685802[...].png 1939Кб, 1024x1536
1024x1536
177687315925602[...].png 2331Кб, 1536x1024
1536x1024
177702907532928[...].png 2404Кб, 1536x1024
1536x1024
Общий тред для изображений, созданных с помощью онлайн ИИ-генерации.

Из России большинство сервисов напрямую недоступно.

Imagen
https://labs.google/fx/tool/image-fx а также https://labs.google/fx/tools/whisk (доступны только в США, Кении, Новой Зеландии и Австралии)
https://gemini.google.com/app
https://aistudio.google.com/prompts/new_chat (модель Gemini image)

Reve
https://preview.reve.art/app

GPT-4o
http://chatgpt.com/
https://sora.chatgpt.com/explore

Сражение нейросетей. Бесплатное сравнение всех популярных моделей.
https://lmarena.ai/

Бесплатный генератор от майкрософт Dall-E/GPT4o
https://bing.com/images/create/
https://www.cici.com (ищем бота ACO)

Seedream
https://seedream-4.io/generator

Бесплатный генератор от Yandex
https://shedevrum.ai/

Кандинский. Генератор от Сбербанка
https://fusionbrain.ai/editor/

Stable Diffusion и прочие
https://civitai.com/generate
https://dreamina.capcut.com/
https://ideogram.ai
https://www.meta.ai
https://ximagegenerator.com
https://www.recraft.ai
https://app.klingai.com/global/text-to-image/new
https://hailuoai.video/create
https://lumaphoton.com
https://leonardo.ai/
https://tensor.art
https://getimg.ai/text-to-image
https://www.mage.space/
https://problembo.com/ru
https://deepai.org/machine-learning-model/text2img
https://dezgo.com/
https://dream.ai/create
https://www.krea.ai/


Дополнительные сервисы:
https://www.pixited.com/ - библиотека промптов с примерами
https://rentry.org/From-4ch-To-2ch-Dall-3-Prompts - сборник промптов
https://www.stylar.ai - AI-редактор картинок (дорисовка, инпейнт, работа с лицами)
https://astica.ai - сборник ИИ-сервисов, в частности довольно мощный де-промптер (Vision AI -> Describe and Caption)
https://huggingface.co/spaces/fffiloni/CLIP-Interrogator-2 - де-промптер, разбирающий вброшенный пик на теги
https://bigjpg.com/ - апскейлер до 4096х4096
https://runwayml.com/ , https://www.stablevideo.com - анимирование генераций

Предыдущий тред: >>
Пропущено 265 постов
137 с картинками.
Пропущено 265 постов, 137 с картинками.
Аноним 04/08/26 Втр 13:45:43 1667980
>>1667788
Более жизненно это когда со стояком зовут к доске. Я лично банально отказывался — "ставьте двойку". После подобного тупое совково-блатное ебло думОет, что это я так ставлю его блатной авторитет под угрозу, а у меня просто коловой стояк — пожизненный зашквар от которого не отмоешься. Двойку никто не помнит, стояк вспоминали бы всю жизнь, и ходил бы я икая до старости.
Аноним 04/08/26 Втр 14:40:45 1668022
Снимок16.JPG 42Кб, 548x318
548x318
Снимок15.JPG 36Кб, 546x322
546x322
Уже даже уебанские превьюхи с ютуба как будто деградировали до состояния минус 2 года.
Интересно эти дегенераты видят, что их картинки это просто ИИ шум по сути.
Аноним 04/08/26 Втр 14:47:17 1668028
изображение.png 3382Кб, 1632x1216
1632x1216
Лол, как же крея ебёт. Это на русском промпте, лол.
Внедрение нейронок на РАБоте Аноним 04/08/26 Втр 08:29:54 1667798 Ответ
1785821393674.png 1901Кб, 1408x768
1408x768
Сап, анчоусы.
Есть у меня кореш, который работает в строительной фирме крупного масштаба. Обычный рядовой инженер. Но вот в управление у них 4 года назад ворвался тип, который изначально продвигал идею автоматизаций и оптимизаций. Не сложно представить во что это всё превратилось с появлением нейронок.
В итоге он собрал команду и выбил у фирмы финансирование каждому по максимальному плану Claude и прочих GPT/Cursor.
Спустя 4 года результаты можно оценить так, что на несколько десятков человек сократили штат, автоматизировав их работу при помощи прог написанных Клодом. И продолжают писать и писать.
Так же они закупили оборудование для локалок. Надрочили локалку на проверке проектов и теперь нейронка видит косяки в проектах электрики лучше инженеров, которые недавно проебали косяки на 50 млн.

В чём суть треда.
Я теперь тоже хочу внедрить такую систему у себя в фирме и стать амбасадором проекта. Подготовил презентацию руководству, паспорт проекта и экономическое обоснование.

Реквестирую ваши истории с ваших РАБоток про внедрение ИИ. А так же способы обучения локалок, какие модели сейчас в топе и какое необходимо оборудование.
Аноним 04/08/26 Втр 13:38:47 1667970
>>1667798 (OP)
Вот только не понятно, зачем фирме в итоге будешь нужен лично ты? Компании так работают: Руковод — замы из числа топовых инженеров, или программистов (один из которых лет через 3-5 заменит руковода организации) — исполнители. Если убрать инженеров, то и руковод царю не нужен будет, сперва останутся просто рабы, которых к 2035му заменят ходячие машины (даже на стройке). Спустя 5 лет будет темный цех просто, и рабочего места тебе не видать.
Аноним 04/08/26 Втр 14:00:50 1667995
>>1667970
> Вот только не понятно, зачем фирме в итоге будешь нужен лично ты?
У нас наоборот мелкий штат для предстоящей работы с конца года и планируется набор ещё двух долбоебов, на ФОТ которых придётся выделить не меньше 6.5млн рублей в год со всеми налогами. Планирую опередить это, пока есть время.
Тем более система снимет кучу хероты однотипной, но решение буду принимать я и мой коллега, например.
То есть мой отдел никак это не затронет. Вообще. А вот другие отделы легко могут потерять 20-50% состава в обозримом будущем, так как их работа на 50% состоит из воздуханства и все это знают.
Агентов и вайб-кодинга тред #17 /agents/ Аноним 01/08/26 Суб 11:46:20 1665577 Ответ
{2CA9D25F-D76D-[...].png 128Кб, 940x1309
940x1309
4.webm 15002Кб, 1280x720, 00:00:45
1280x720
image1.png 91Кб, 1548x906
1548x906
image2.png 410Кб, 1179x1025
1179x1025
image3.png 77Кб, 509x392
509x392
image4.png 271Кб, 2876x1260
2876x1260
Make a beautifu[...].mp4 14951Кб, 1280x720, 00:01:23
1280x720
1778671643353.jpg 4908Кб, 2160x3840
2160x3840
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

С чего начать:
• Хочешь кодить с AI эффективно: Cursor или Claude Code
• Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter
• Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде
• Хочешь приложение без кода: Lovable или bolt.new
• Хочешь автоматизировать рутину: n8n или Langflow
• Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке

FAQ и расширенная инфа:
https://rentry.org/2ch-agents-faq

IDE с AI:
• Cursor: https://cursor.com
• Windsurf: https://windsurf.com
• Antigravity: https://antigravity.google.com
• Zed: https://zed.dev

CLI-агенты:
• Claude Code: https://code.claude.com/docs
• Codex (OpenAI): https://github.com/openai/codex
• Pi: https://shittycodingagent.ai/
• OpenCode: https://github.com/anomalyco/opencode
• Qwen Code: https://github.com/QwenLM/qwen-code
• Gemini CLI: https://github.com/google-gemini/gemini-cli
• Kimi Code: https://www.kimi.com/code/en
• MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start

Плагины для IDE:
• Kilo Code: https://kilo.ai
• Cline: https://github.com/cline/cline
• Roo Code: https://github.com/RooCodeInc/Roo-Code
• GitHub Copilot: https://github.com/features/copilot
• Continue: https://github.com/continuedev/continue

Вайб-кодинг без кода:
• Lovable: https://lovable.dev
• bolt.new: https://bolt.new
• v0: https://v0.dev

Персональные ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw
• NemoClaw: https://github.com/NVIDIA/NemoClaw
• Hermes Agent: https://github.com/nousresearch/hermes-agent
• nanobot: https://github.com/HKUDS/nanobot
• PicoClaw: https://github.com/sipeed/picoclaw

Автоматизация и фреймворки:
• n8n: https://github.com/n8n-io/n8n
• Langflow: https://github.com/langflow-ai/langflow
• LangChain/LangGraph: https://github.com/langchain-ai/langchain
• CrewAI: https://github.com/crewAIInc/crewAI
• AutoGen: https://github.com/microsoft/autogen
• Agno: https://docs.agno.com/

Полезные тулзы:
• RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента
• Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко
• ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге
• Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было
• fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов

Локалки и прочее API:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки
• llama-тред: >>1665553 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1663511 (OP)
Пропущено 599 постов
88 с картинками.
Пропущено 599 постов, 88 с картинками.
Аноним 05/08/26 Срд 00:24:02 1668508
>>1668504
Напиши команде Архивача что они пидарасы, конченные дауны)
arhivach@airmail.cc
Аноним 05/08/26 Срд 00:44:29 1668528
>>1668504
Консолетряс иди нахуй чмо
Аноним 05/08/26 Срд 02:27:24 1668569
Как вы че-то там реверсите? у меня deepшляпа сразу ругается, никакие джейбрейки и исследовательские проекты не кушает. Получилось только посмотреть как другой пользователи крякнул какую-то старую версию, я сказал, что напишу письмо разработчикам, а вот к новой он этот метод уже отказался применять наотрез
🍌 Персонажный тред /person/ Аноним # OP 26/07/26 Вск 20:37:12 1660585 Ответ
hwywi1e7.jpeg 1830Кб, 3072x5504
3072x5504
pzd708dr.jpeg 2254Кб, 3072x5504
3072x5504
ytmt0pwf.jpeg 2632Кб, 3072x5504
3072x5504
57yvmxfa (2).mp4 8961Кб, 1072x1928, 00:00:15
1072x1928
Как присоединиться и генерировать?

https://arena.ai/image/direct
https://labs.google/fx/tools/flow
https://grok.com/imagine
https://chatgpt.com/images/

Генерация без лимитов до 4K:
Nano Banana 2 https://app.inference.sh/apps/google/gemini-3-1-flash-image-preview
Nano Banana Pro https://app.inference.sh/apps/google/gemini-3-pro-image-preview
Grok Imagine Pro https://app.inference.sh/apps/xai/grok-imagine-image-pro
Grok Imagine Quality https://app.inference.sh/apps/xai/grok-imagine-image-quality
GPT Image 2 https://app.inference.sh/apps/openai/gpt-image-2

Также если хотите использовать любую другую модель она доступна здесь через поиск https://app.inference.sh/apps/

Генерировать бесплатно и без лимитов можно через бесконечную регистрацию с помощью сервиса временной почты https://www.mohmal.com/ru/inbox
После израсходования кредитов чистим куки сайта и регистрируемся заново используя новую сгенерированную почту

Видео генерация:
https://app.inference.sh/apps/klingai/video-v3
https://app.inference.sh/apps/google/veo-3-1
https://app.inference.sh/apps/xai/grok-imagine-video

Апскейл до 16K:
https://app.inference.sh/apps/falai/topaz-image-upscaler
https://app.inference.sh/apps/infsh/flux-1-dev-upscaler

Архивач:
https://arhivach.vc/?tags=16555
Пропущено 24 постов
26 с картинками.
Пропущено 24 постов, 26 с картинками.
Аноним 28/07/26 Втр 17:21:43 1662587
4jm27czt (1).mp4 9168Кб, 1072x1928, 00:00:15
1072x1928
Все молчат. В самом начале та девушка что снимает сама своей рукой очень быстро и резко опускает камеру наклонившись полностью на землю прямо под ноги и девушка снова встаёт и видно их тела максимально снизу вверх с уровня земли. Видно полностью прямо у них под юбками. Вид полностью вверх полностью видно небо и не видно землю и не видно любую поверхность на которой они стоят потому что камера максимально показывает снизу вверх. Здание на заднем фоне полностью исчезает потому что камера уходит максимально снизу вверх. Все все видео смотрят на нас. Все приподнимают юбки чтобы было видно их дизайнерские кружевные трусы. В видео должны быть видны все 4 девушки все время не исчезая из кадра и камера должна пройтись под юбкой каждой из девушек. Девушка которая снимает должна поднять юбку каждой из девушек и навести туда камерой прямо под юбку чтобы было видно дизайнерские разные трусы каждой из них.
Аноним 29/07/26 Срд 12:47:48 1663088
s16bev9x.jpeg 1232Кб, 3072x5504
3072x5504
rreccgsv.jpeg 1140Кб, 3072x5504
3072x5504
4d1z5ka6.jpeg 1200Кб, 3072x5504
3072x5504
cizabe0c.jpeg 1019Кб, 3072x5504
3072x5504
Дымка на заднем фоне. Люди должны быть сильно затемнены абсолютно без освещения. Абсолютно необработанная фотография снятая на самое базовое системное стандартное приложение камеры Айфона 17 Про Макс 2026. Сырые не обработанные цвета. Депрессивные думерши с длинными волосами Эль Фаннинг и Сэди Синк в одежде типичного депрессивного региона России сидят на земле и курят задумчиво смотря на нас. В кадре доминируют спокойные натуральные цвета. Русский рыбак Райан Гослинг в последней стадии ожирения в рыбацкой одежде из типичного российского военного камуфляжа сидит и ловит рыбу задумчиво попивая Балтику 9 смотря на нас. Летний очень темный вечер. Огненно-оранжевый закат на хрущевке. Без интерфейса. Берег реки, с нашей стороны берег низкий но не плавный а резкий типичный обрывистый но очень низкий, на другой стороне реки берег очень высокий и обрывистый, на нашей стороне берега тропинка и тонкие молодые деревья закрывают нас от солнца, на другой стороне видно плотный лес густых деревьев. Все смотрят на нас. Максимально узнаваемые детальные лица Эль Фаннинг и Сэди Синк и Райана Гослинга. Без вспышки. Люди естественно темны без освещения. Без головных уборов.
Аноним 04/08/26 Втр 10:31:55 1667848
Darkenedfigures[...].jpeg 2529Кб, 1536x2752
1536x2752
Darkenedfigures[...].jpeg 2548Кб, 1536x2752
1536x2752
Darkenedfigures[...].jpeg 2488Кб, 1536x2752
1536x2752
Darkenedfigures[...].jpeg 2351Кб, 1536x2752
1536x2752
Вдали видно реку и над ними большой мост. Без эффекта боке. Очень отдаленный вид. Видно как берёза стоит на земле. Сильный зернистый шум. Высокий ISO. Абсолютно неважно если лица будут полностью черными как тень и неузнаваемым. В кадре абсолютно ничего нельзя разглядеть абсолютно полностью вообще ничего не поддается описанию из за затемнения. Экстремально любительская случайная частная казуальная фотография снятая на самую базовую камеру на самое базовое приложение Айфона 17 абсолютно без обработки и без фильтров в сильном размытии в движении. Очень темный очень поздний вечер, Абсолютно полностью затемненная Ольга Бузова и выглядывает из за затемнённой толстой березы в затемнённом лесу, они полностью затемнена естественным ночью без освещения, абсолютно без любого освещения нигде, фотография с очень низким ключем, почти ничего не видно, натуральные естественные цвета как в жизни. Из за другого угла березы выглядывает Эль Фаннинг. Абсолютно все в кадре естественно очень затемнено и выглядит как тень. Черное небо. Без головного убора, обычные прямые спокойные волосы, прическа каре. Спокойный обычный взгляд. В кадре только половина лица и оно все полностью затемнено. На всей берёзе куча бошьших глаз полностью по всему дереву и они выглядят прямо как большие глаза которые смотрят на нас, береза Абсолютно затемнена, платье Абсолютно затемнено. Чёрные цвета абсолютно полностью везде доминируют в кадре, кожа абсолютно полностью как черная тень. Взгляд как у куклы. В кадре отсутствует любой светлый источник цвета. У моста отсутствует освещение он полностью затемнен. Без интерфейса, без текста
Жесткая подборка буккаке и фейсфаков от моделей буквально рожденных быть порноактрисами. Based on my /aiporn/ Аноним 02/08/26 Вск 14:41:32 1666500 Ответ
Multi Bukkake F[...].mp4 1007Кб, 832x464, 00:00:05
832x464
Жесткая подборка буккаке и фейсфаков от моделей буквально рожденных быть порноактрисами.
Based on my dick
Пропущено 2 постов
4 с картинками.
Пропущено 2 постов, 4 с картинками.
Аноним 02/08/26 Вск 14:43:05 1666502
ClipsBJCum 0602[...].mp4 709Кб, 928x416, 00:00:05
928x416
Аноним 02/08/26 Вск 14:43:48 1666503
Multi Bukkake F[...].mp4 850Кб, 576x672, 00:00:05
576x672
Аноним 04/08/26 Втр 05:48:38 1667757
>>1666503
Что за лора с кончанием в рот? У меня что не кончают, то конча или сразу выливается или просто исчезает во рту.
Генераторы видео дают всем за щеку /deepfake/ Аноним 13/10/25 Пнд 08:50:32 1385244 Ответ
1636659404913.mp4 6304Кб, 720x1280, 00:00:15
720x1280
1688301786630.mp4 458Кб, 640x480, 00:00:05
640x480
SimSwap стал спящей красавицей, любая движуха с ним заморожена на неопределенный срок, отдаём дань почести тут: https://docs.google.com/document/d/1ZFHXtjR02oEVL2nrru4hTFQJ4BQt4vCNr0JNzFLZ-aE/edit?usp=sharing

Форки на базе модели insightface inswapper_128: roop, facefusion, rope, плодятся как грибы после дождя, каждый делает GUI под себя, можно выбрать любой из них под ваши вкусы и потребности. Лицемерный индус всячески мешал всем дрочить, а потом и вовсе закрыл проект. Чет ору.

Любители ебаться с зависимостями и настраивать все под себя, а также параноики могут загуглить указанные форки на гитхабе. Кто не хочет тратить время на пердолинг, просто качаем сборки.

Лучшая сборка https://github.com/visomaster/VisoMaster/releases/download/v0.1.1/VisoMaster_Setup.exe
Другие бесплатные сборки @AINetSD_bot

Если хотите просто дать кому-нибудь в рот, то ищите tensor-тред, например этот https://2ch.su/nf/res/36595.html там в шапке все подробно расписано

Инструкция по локальному запуску
https://2ch.su/nf/res/33573.html#35479
https://2ch.su/nf/res/33573.html#35727

Единственный минус, который не обеспечивает чистую победу генераторов видео - 3 секунды ролика для онлайн генерации, 5 секунд для онлайна (модель Wan 2.2), умельцы просто берут последний кадр и снова генерируют ролики, потом склеивают. Недавно вышла Sora 2, которая зацензурена по самые гланды. Нинтендо довольна.

Тред не является технической поддержкой, лучше создать issue на гитхабе или спрашивать автора конкретной сборки.

Прошлый >>542826 (OP)

Эротический контент в шапке является традиционным для данного треда, перекатчикам желательно его не менять или заменить на что-нибудь более красивое. А вообще можете делать что хотите, я и так сюда по праздникам захожу.
Пропущено 423 постов
204 с картинками.
Пропущено 423 постов, 204 с картинками.
Аноним 03/08/26 Пнд 20:58:55 1667497
4.mp4 3045Кб, 544x960, 00:00:05
544x960
3.mp4 2653Кб, 544x960, 00:00:05
544x960
2.mp4 1363Кб, 464x1104, 00:00:05
464x1104
1.mp4 1334Кб, 464x1104, 00:00:05
464x1104
>>1666833
>>1666832
не очень удачные фото, сложно понять то лицо получается или нет
давай больше фото
пока держи по паре видосов к каждой фотке
Аноним 03/08/26 Пнд 23:18:16 1667638
Screenshot2026-[...].jpg 1211Кб, 1220x2712
1220x2712
Screenshot2026-[...].jpg 792Кб, 1220x2350
1220x2350
Screenshot2026-[...].jpg 778Кб, 1220x1534
1220x1534
Screenshot2026-[...].jpg 1213Кб, 1220x2712
1220x2712
>>1667497
Согласен, вот эти лучше подойдут, спасибо заранее 🤝 расскажешь где делал видео?
Аноним 03/08/26 Пнд 23:23:06 1667642
Screenshot2026-[...].jpg 848Кб, 1220x2091
1220x2091
Screenshot2026-[...].jpg 1219Кб, 1220x2026
1220x2026
Screenshot2026-[...].jpg 892Кб, 1201x1613
1201x1613
Screenshot2026-[...].jpg 652Кб, 1220x1528
1220x1528
>>1667497
И вот еще несколько лови
Голосовых нейронок тред (Text to speech, Voice Clone) #8 /speech/ Аноним 20/03/26 Птн 16:16:54 1557328 Ответ
image.png 2351Кб, 3046x1742
3046x1742
1.mp4 2571Кб, 1200x630, 00:00:52
1200x630
2.mp4 4171Кб, 1280x692, 00:01:37
1280x692
3.mp4 3766Кб, 726x594, 00:02:54
726x594
🎤🔊 ОБСУЖДАЕМ ПРЕОБРАЗОВАНИЕ ТЕКСТА В ГОЛОС И КЛОНИРОВАНИЕ ГОЛОСОВ 🔊🎤
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

🌟 ТОП ЛОКАЛЬНЫХ МОДЕЛЕЙ ПО КАЧЕСТВУ РУССКОГО ГОЛОСА НА МАРТ 2026 🌟

🐟👑 Fish-Speech S2 Pro (FishAudio) — SOTA, ElevenLabs на локале!
→ zero-shot клон от 10–30 сек записи
→ 80+ языков (русский топ), теги эмоций [excited], [whisper], [angry], [laughing] и вообще дохуя
→ диалог между несколькими голосами
→ тяжёлая сучка (FP8 в 12 ГБ VRAM, full ~17 ГБ), но есть экспериментальный вариант для 6+ ГБ
https://github.com/rodrigomatta/s2.cpp
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🧠 Qwen3-TTS
→ клон от 3–30 сек (ВАЖНО: без reference-транскрипта текста — хуйня, если хочешь поудобнее подключи сразу QwenASR)
→ VoiceDesign: пишешь «весёлая молодая девка с хрипотцой» — и получаешь голос
→ 10 языков, включая русский
→ диалог между спикерами
→ лёгкая — влезает в 6 ГБ VRAM
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🎙️ VibeVoice-7B от Майкрософт
→ тяжёлая, но 4-bit квантизация — запускается на 8 ГБ (проверено на 3070)
→ поддержка долгих спичей
→ подкаст-режим: 4 спикера одновременно
→ норм клонирование голоса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
☁️ FL CosyVoice3
→ ультралёгкий 0.5 — запустится даже на тостере
→ 9 языков, включая русский
→ zero-shot клон от 3–10 сек референса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🌍 Chatterbox Multilingual (23 языка, включая русский)
→ zero-shot клонирование голоса
🎤 F5-tts
→ zero-shot клонирование голоса
→ официально русский не поддерживается, но есть файнтюн (см. ниже)
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🚀 КАК ЭТИМ ПОЛЬЗОВАТЬСЯ (если что-то не понятно — спроси у ИИ лол) 🚀

🔥Вариант «всё в одном месте» — ComfyUI + TTS-Audio-Suite

1. Устанавливаем ComfyUI (Desktop для нормисов, Portable для здешних нейромантов)
2. Ставим https://github.com/diodiogod/TTS-Audio-Suite — постоянная обновляемая солярка почти всех моделей
3. Поставить FFmpeg (через winget в комадной строке: winget install FFmpeg или скачать)
4. Запускаем Комфи → перетаскиваем готовый json-воркфлоу из репозитория
5. Отсавляем включенными выбранные ноды, жмём Run
6. При первой генерации модели сами скачаются (~1–9 ГБ)

💥 Вариант «по отдельности» (кастом под каждую модель) 💥
Тоже через ComfyUI, только ставим отдельные кастомные ноды (на выбор):

FishAudioS2 → https://github.com/Saganaki22/ComfyUI-FishAudioS2
FL-CosyVoice3 → https://github.com/filliptm/ComfyUI_FL-CosyVoice3
F5-TTS → https://github.com/niknah/ComfyUI-F5-TTS
и другие → https://registry.comfy.org/

Русский файнтюн для F5-TTS:
Нода: https://github.com/niknah/ComfyUI-F5-TTS
Скачать русский файнтюн: https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base_v2/model_last_inference.safetensors и
https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base/vocab.txt
оба файла переименовать в ru.safetensors и ru.txt и положить в папку models/checkpoints/F5-TTS/

Референсное аудио для F5 должно быть коротким, 6-8 c. При 11 c - речь становится слишком быстрой.

в папку /comfyUI/input положить 2 файла: emma_ru_xtts_3.wav и emma_ru_xtts_3.txt: https://github.com/Mozer/comfy_stuff/tree/main/input
(в emma_ru_xtts_3.txt лежит текст сказанный в wav файле.)

в комфи в ноде F5 TTS audio advanced выбрать:
model model:///ru.safetensors
model_type: F5TTS_v1_Base
sample_audio: emma_ru_xtts_3
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🎉 Если что-то не запускается — пиши, разберёмся!
Голосуем, клонируем, ебём нейросети вместе! 🔥🎙️

Прошлый тред: >>1055411 (OP)
Пропущено 197 постов
48 с картинками.
Пропущено 197 постов, 48 с картинками.
Аноним 25/07/26 Суб 11:11:10 1659516
16073128585450.jpg 28Кб, 400x400
400x400
>>1659514
> но почему-то сильно быстрее

... это у меня на вулкане и древней Рыксе GCN 4.0.

Пока на whisper large v3 turbo Q8 получаю скорость примерно 5x и в целом как будто качество приемлемое, но может стоит лучше
Аноним 01/08/26 Суб 20:40:43 1665989
Посоветуйте модель, чтоб всякие стоны и шлепки генерировать для порноигрочки. И чтоб героинька могла говорить и стонать одновременно.

Если такое есть, конечно.
Аноним 03/08/26 Пнд 23:13:59 1667632
th75p.mp4 3463Кб, 574x788, 00:01:31
574x788
vits - няшечка писечка, piper в частности, на любом компудахторе работает x10
а вы тут на свои диффузии надрачиваете
Ребята,как думаете,сможет ли ии делать к концу 2030 годов такие картинки,что каждый сможет поверить? Аноним 01/08/26 Суб 20:38:13 1665986 Ответ
9F74D8D5-1142-4[...].png 1673Кб, 1448x1086
1448x1086
Ребята,как думаете,сможет ли ии делать к концу 2030 годов такие картинки,что каждый сможет поверить? Мне chatGPT сделал такую картинку
Пропущено 3 постов
1 с картинками.
Пропущено 3 постов, 1 с картинками.
Аноним 03/08/26 Пнд 16:47:02 1667313
>>1665986 (OP)
Крупные студии дубляжа в 90х составляли банки сэмплов с рабочими алгоритмами вывода речи неотличимой (для быдла) от реальной. До сих пор владельцы тех еще датабаз мутили лавэхи по 2020 год, продавая услугу синтеза кликбейт-ютаберам и сайтам с безлицензионными аудиокнигами в стиле "я вышла за бомжа-оборотня: глава IXX". Все записи с однообразным одноэмоциональным зачитыванием без дыхания — это они (люди так не разговаривают). А вот что вызывает возмущение по твоей пикче, так это то — откуда у этих скотов инклюзивные паки картинок с обшарпанными партами в школах, которых не должно быть в общем доступе! Копронейронкам не по масти быть извещенными о таких нюансах.
Аноним 03/08/26 Пнд 16:50:06 1667317
Хотя последнее — не важно в смысле чека изображений на вшивость. Я вижу здесь аж пять стилистических элементов самой "сотографии", которых не может быть у реального фото. Так что до реализма (невозможности наебать лично меня) им ооочень далеко.
Недостижимо.
Аноним 03/08/26 Пнд 20:48:18 1667488
>>1665986 (OP)
Что сразу режет глаз это справа уродец от силы 14 дюймов, но "борода" огромная как у большой диагонали, такого даже в 90х не было, тем более кнопки вместо крутилок значит не древний. На заднем плане моник-мутант сразу и жк, и элт. Размазано как-то криво, ты бы не смог дернуть милипиздрический объектив древнего телефона так чтобы только с одной стороны размазать.
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов