В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Если вы прпоустили и не обсуждали (тред не читал): В llama.cpp завозят MTP. На Qwen3.6-27b дает +95% скорости. На Qwen3.6-35B-A3B дает +40% скорости. Вчерашние тесты. Но поджирает видеопамять.
В догонку — для геммы выложили головы, следовательно ии ускорит. Теоретическое пиковое ускорение до 3х-4х на некоторых моделях (+200%+300%). Помимо плотных квена с геммой, ускорение можно поиметь на крупных МОЕ. И если это вместо 7-15 токенов будет 15-30 — то это тоже очень круто. Я бы погонял ~300B на 20-25 тпс.
Ну, посмотрим. Ждем, когда замерджат, плюс мимо завезут (кстати, пока мимо у меня очень медленная, почему-то).
Пишу как неведомый в ИИ вам за советом. Использовал грок для создания NSFW контента, а именно генерация картинок и их анимация. Подскажите, есть ли аналоги для подобного функционала или же обход цензуры в грок
>>1555531 > но 96% - многовато, наверное Хуй знает. Там система ебанутая какая-то. Тут >>1555415 оригинал - 95% жпг из mpv, и инпейнт 95% жпг из гимпа (только сохранение в жпег, ничего не изменено по сравнению с png). Оба показывают 96% уверенности digitally edited, будто оно вообще не замечает разницы. Гораздо более интересно, что оно на это >>1555438 показывает 67% real image.
>>1555531 Кажется разобрался. Дохуя внимания оно уделяет геометрии бэкграунда, с которой у нейронок обычно не оче. > GPT-5 или Gamini Попробуй ей клосап или 1гирл в чистом поле скормить. Подозреваю, что не определит нихуя.
В тредике трансформируем аниме арты в professional photography, ultra-realistic, 8k resolution и бесконечно рероллим 3D анимацию/фигурки/околоаниме/просто всратые
По возможности постите рядом оригинальный арт, чтобы было с чем сравнить.
>>1591303 (OP) klein 9b snofs 1) transform this picture to the real life cosplay photo with blank background
2) transform this picture into professional photography, ultra-realistic, 8k resolution
3) ориг
>>1604007 klein 9b обычный 4) transform this picture to the real life cosplay photo with blank background, yellow hair, white shirt, red color of neck accessory, прищуренные глаза, looking aside
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
Вообще новичок всегда должен поебаться с настройками. Так что все правильно в рентри, а уж если поебется но будет усердно в треде поймёт что есть кобольд и варианты по ппроще, ибо если гейткипа не будет совсем то наплыв даунов которых надо только спунфидить будет критическим. А там и качество треда упадёт. Никто не захочет кому либо помогать понимая что сидит в треде с даунами из /b/ а не такими же энтузиастами на взаимопомощи.
Агентов и вайб-кодинга тред #4 /agents/
Аноним14/04/26 Втр 03:30:28№1585804Ответ
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
С чего начать: - Хочешь кодить с AI эффективно: Cursor или Claude Code - Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter - Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.5, подробности в llama-треде - Хочешь приложение без кода: Lovable или bolt.new - Хочешь автоматизировать рутину: n8n или Langflow - Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке
>>1599933 извини, я на 2-х недельную командировку уезжал, сейчас подписочку на плати сру возьму и опять буду срать на рентри орг охуенными идеями только вы же нихуя не подхватываете челленджи, а только говном поливаете
еще и какой то долбаеб на мой айпи подвесил бан за вредоносные ссылки. наркоман
>>1600343 У меня тоже отъебнуло. Это чисточки братан. Дальше будет намного неприятнее и затратнее. Еби как не в себя подписки с карженных кредиток на плати сру и ггселах, потом уже такой лофы не будет, доставай с чулана все свои заблокноченные проекты и реализуй, потом не потянешь
Общаемся с самым продвинутым ИИ самой продвинутой текстовой моделью из доступных. Горим с ограничений, лимитов и банов, генерим пикчи в стиле Studio Ghibli и Венеры Милосской и обоссываем пользователей других нейросетей по мере возможности.
Общение доступно на https://chatgpt.com/ , бесплатно без СМС и регистрации. Регистрация открывает функции создания изображений (может ограничиваться при высокой нагрузке), а подписка за $20 даёт доступ к новейшим моделям и продвинутым функциям. Бояре могут заплатить 200 баксов и получить персонального учёного (почти).
Гайд по регистрации из России (устарел, нуждается в перепроверке): 1. Установи VPN, например расширение FreeVPN под свой любимый браузер и включи его. 2. Возьми нормальную почту. Адреса со многих сервисов временной почты блокируются. Отбитые могут использовать почту в RU зоне, она прекрасно работает. 3. Зайди на https://chatgpt.com/ и начни регистрацию. Ссылку активации с почты запускай только со включенным VPN. 4. Если попросят указать номер мобильного, пиздуй на sms-activate.org или 5sim.biz (дешевле) и в строку выбора услуг вбей openai. Для разового получения смс для регистрации тебе хватит индийского или польского номера за 7 - 10 рублей. Пользоваться Индонезией и странами под санкциями не рекомендуется. 5. Начинай пользоваться ChatGPT. 6. ??? 7. PROFIT!
VPN не отключаем, все заходы осуществляем с ним. Соответствие страны VPN, почты и номера не обязательно, но желательно для тех, кому доступ критически нужен, например для работы.
Для ленивых есть боты в телеге, 3 сорта: 0. Боты без истории сообщений. Каждое сообщение отправляется изолировано, диалог с ИИ невозможен, проёбывается 95% возможностей ИИ 1. Общая история на всех пользователей, говно даже хуже, чем выше 2. Приватная история на каждого пользователя, может реагировать на команды по изменению поведения и прочее. Говно, ибо платно, а бесплатный лимит или маленький, или его нет совсем.
бля, вот как знал, что нужно год брать за 3к, а я все дешевил, взял за 350 две недели назад месяц, а теперь обосрамс, минимум полтораха месяц стал стоить. а я там пикчи нонстопом генерю, нигде лучше не делает, как в гпт
OpenAI прекращает юридические риски для Microsoft в связи с её сделкой с Amazon на $50 млрд.
Google тестирует поиск с помощью чат-бота с ИИ для YouTube и маркировку ИИ в поисковой рекламе, функцию поиска на основе ИИ, которая показывает направляющие ответы.
Корпоративные агентные рабочие процессы охватывают десятки агентов, сотни инструментов и более 15 систем учёта. Контроль и управление ими в реальном времени требует инфраструктуры, которой не существовало до появления Lakebase.
⚙️ Инфраструктура
Canonical излагает план внедрения ИИ в Ubuntu Linux.
Новый центр обработки данных с ИИ в Юте будет генерировать и потреблять более чем в два раза больше электроэнергии, чем использует весь штат — кампус центров обработки данных Кевина О'Лири мощностью 9 гигаватт в Юте одобрен. Проект «гипермасштабного» центра обработки данных в Юте — ожидается, что он будет генерировать и потреблять больше энергии, чем весь штат.
Более быстрый способ оценки потребления энергии ИИ. Метод «EnergAIzer» генерирует надёжные результаты за секунды, позволяя операторам центров обработки данных эффективно распределять ресурсы и сокращать потери энергии.
🏭 Компании
Сообщается, что Google и Пентагон договорились о сделке на «любое законное» использование ИИ.
Следующий этап партнёрства Microsoft и OpenAI. Microsoft остаётся основным облачным партнёром OpenAI, и продукты OpenAI будут первоначально выпускаться на Azure, если только Microsoft не сможет и не пожелает поддерживать необходимые возможности.
Сотрудники Google просят Сундара Пичаи отказаться от использования ИИ в секретных военных целях.
Илон Маск хайпит разоблачительную статью Сэма Альтмана в The New Yorker на платформе X по мере начала судебного процесса. Этот шаг происходит в момент, когда судебный процесс по иску Илона Маска против OpenAI начинается в федеральном суде в Окленде. Илон Маск и генеральный директор OpenAI Сэм Альтман направляются в суд для высокопоставленного противостояния по вопросу будущего OpenAI. Судебный процесс Илона Маска против Сэма Альтмана должен раскрыть продолжающуюся борьбу за власть в OpenAI.
Anthropic назначает Тео Хурмузиса генеральным менеджером по Австралии и Новой Зеландии и официально открывает офис в Сиднее.
🛠️ Инструменты для разработчиков
GitHub Copilot переходит на оплату, основанную на использовании.
Anthropic теперь обучает свои самые передовые фундаментальные модели на инфраструктуре AWS Trainium и Graviton, совместно разрабатывая решения непосредственно на уровне кремния с Annapurna Labs для максимальной вычислительной эффективности от аппаратного обеспечения до полного стека.
Meta подписала соглашение о масштабном развёртывании процессоров AWS Graviton, начиная с десятков миллионов ядер Graviton для обеспечения интенсивных по использованию ЦП агентных рабочих нагрузок ИИ — включая рассуждения в реальном времени, генерацию кода, поиск и оркестровку многоэтапных задач.
Как ведущие технологические компании убивают «налог создателя» с помощью Lakebase.
Агент для написания кода на базе Claude удаляет всю базу данных компании за 9 секунд — резервные копии уничтожены после того, как инструмент Cursor на базе Claude от Anthropic вышел из-под контроля.
💰 Финансирование Дэвид Сильвер из DeepMind только что привлёк $1,1 млрд для создания ИИ, который обучается без человеческих данных.
📱 Приложения
Атака убийственных скрипт-кидди. Люди без технического образования могут использовать ИИ для расширения своих хакерских возможностей способом, который был невозможен с простыми скриптами.
Автомобиль, разработанный с помощью ИИ, обретает форму. В условиях глобального хаоса торговых войн и неопределённого спроса автопроизводители полагаются на ИИ, чтобы сократить время разработки.
Я протестировал ChatGPT Images 2.0 против Gemini Nano Banana, чтобы узнать, какой из них лучше. ChatGPT Images 2.0 набрал 97%. Gemini Nano Banana набрал 85%.
🏢 Приобретения
Китай накладывает вето на сделку Meta с Manus на $2 млрд после многомесячного расследования.
🏢 Мнение и анализ
77% руководителей предприятий заявляют, что навыки работы с ИИ являются срочными — так почему обучение всё ещё остаётся второстепенным?
💻 Оборудование
Акции Qualcomm резко растут на фоне сообщений о том, что компания может производить чипы для смартфона OpenAI.
🧪 Исследования
Выравнивание делает модели более решительными, не делая их более правдивыми. На протяжении 3 архитектур и 4 методов обучения с подкреплением мы обнаруживаем, что слой фиксации — где модель закрепляет свой прогноз — не смещается под воздействием обучения с подкреплением.
🎓 Учебные пособия
Присоединяйтесь к новому курсу «Vibe Coding» по агентным ИИ от Google и Kaggle. Интенсивный курс Google по агентным ИИ совместно с Kaggle возвращается 15–19 июня 2026 года, и регистрация открывается сегодня.
💰 Бизнес
Тейлор Свифт подаёт заявку на регистрацию товарного знака своего голоса и облика, по-видимому, для защиты от неправомерного использования ИИ
🤖 Робототехника
Japan Airlines тестирует гуманоидных роботов в качестве наземных сотрудников.
Kinetix AI представляет KAI: гуманоид с 115 степенями свободы, нацеленный на «физический интеллект».
За пределами набора: Asimov подробно описывает 100-часовой путь к шагающему гуманоиду.
AGIBOT представляет масштабный флот и стек моделей ИИ на APC 2026.
🧠 Модели
Знакомьтесь, Talkie-1930: открытая языковая модель с 13 млрд параметров, обученная на английских текстах до 1931 года для исследований в области исторического мышления и обобщения.
🌐 Другие события в индустрии ИИ
Microsoft и OpenAI изменяют условия сделки, чтобы стартап мог вести переговоры с Amazon и другими. Теперь OpenAI может продавать продукты на Amazon и Google Cloud, расширяя охват предприятий. Прекращение эксклюзивности может смягчить антимонопольный контроль в США, Великобритании и Европе.
Ник Бостром говорит, что больше всего его удивила эта продолжительная эра примерно человеческого уровня ИИ, которая уже растянулась на 3–5 лет и может продлиться ещё дольше — эра одновременно чуждая и знакомая.
Демис Хассабис, который когда-то говорил, что для AGI требуется ещё 1–2 прорыва, теперь считает, что это вопрос подбрасывания монеты — нужны ли вообще дополнительные прорывы.
Сэм Альтман высмеял разрыв между прогнозами «после AGI никто не работает» и пользователями, которые переходят на полифазный сон, чтобы писать больше кода с помощью GPT-5.5 в Codex.
Ноам Браун из OpenAI отмечает, что веса моделей теперь имеют относительно меньшее значение, чем обеспечение вычислительных ресурсов для инференса, то есть призом является уже не рецепт, а кухня.
Рецепты также живут быстрее и умирают моложе: GPT-4o работал 21 месяц, тогда как GPT-5.4 просуществовал всего 49 дней — расписание однодневки для синтетических разумов.
Лиам Прайс, 23-летний юноша без продвинутой математической подготовки, с помощью одного единственного промпта для GPT-5.4 Pro решил задачу Эрдёша, которая ускользала от выдающихся умов, побудив Терри Тао размышлять о том, что люди сталкиваются с «ментальным блоком» из-за того, что делают «небольшой неверный поворот на первом ходу».
Сообщается, что OpenAI работает с MediaTek и Qualcomm над процессорами для смартфонов с ИИ, при этом производство и массовый выпуск запланированы на 2028 год с участием Luxshare.
Apple, не желая отставать, имеет в разработке шесть основных категорий продуктов, включая ИИ-наушники AirPods, умные очки, подвески, умные дисплеи, настольных роботов и камеры безопасности.
Спрос на ИИ настолько чрезмерен, говорит генеральный директор AWS, что «мы никогда не выводили из эксплуатации старые A100», что является признаком того, что мы вступили в эпоху пост-устаревания кремния.
Государственная электросеть Китая развёртывает 500 гуманоидных роботов для работы с высоким напряжением, где оптимальным режимом отказа теперь является расплавленный сервопривод, а не расплавленный оператор.
Публичные рынки потеплели к новой энергетике: ядерный стартап X-energy привлёк $1 млрд в ходе IPO и вырос на 25% на старте, в то время как геотермальный стартап Fervo подал документы с оценкой примерно в $3 млрд. Meta идёт ещё дальше, подписывая контракт на получение до 1 гигаватта космической солнечной энергии от Overview Energy, передаваемой со спутников на наземные центры обработки данных.
>>1602741 Пчел у нас некоторые кабаны даже не в курсе что можно через интернет клиентов искать, они объявления на марштурках заказывают, а что такое "свой сайт" - в душе не ебут, а ты про то, что они нейронками будут пользоваться. У нас сейчас лаг дикий из-за этого.
>>1602932 GTP Image 2 рисует красиво, но не без косяков. Всё равно перепроверять за ним надо. И да, болезнь с пальцами, вроде как у нанобананы решилась. Но всё равно нет-нет да и появляется. Что несомненно никак не умаляет его возможности делать охуенные огромные плакаты с кучей разной инфы.
>>1601303 Опять эта шляпа с индустриазацией. Прошивку (шляпу) смени. У тебя когнитивное заблуждение: я не вижу результата, значит его нет. Ты еще самолет братьев Райт вспомни. Вот он летает, на нем можно лететь, значит это реально, а радио нереально, ведь волны нельзя потрогать, и они вообще еще не дошли в нашу страну.
Революция ИИ начинается с вообще с другого пространства, роботы это лишь одна из волн цунами, и она как раз в материальном проявлена.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
>>1599254 >Ван же не помещается даже в 16 гигов В оперативу выгружается/подгружается, поэтому у меня так долго генерируется. Можно быстрее, но хуево на Q6 и ниже генерировать вон анон соревнования на кастратах запостил >>1599341
SeedVR2 - это какая-то хуета. Никаких настроек толком нет, работает долго, результат - говно. gfpgan в sd имел настройки и офигительно восстанавливал лица, даже из шакальных пикселей. Считается типа он устарел, а вот это недоразумение - это будущее?
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1588814 Анон, я понимаю твою боль. Moevonchik (да и любой MoE на базе Qwen 2.5) — это тот еще любитель графомании в «мыслях», если его не приструнить. Проблема в том, что в этих моделях блоки <thought> или похожие структуры часто вшиты в логику обучения, и просто командами «не думай» их не всегда удается выпилить. Вот несколько способов ограничить это безумие: 1. Ограничение через параметры генерации (Самый действенный) Вместо того чтобы просить его «не думать», нужно жестко ограничить количество токенов, которые он может выдать до того, как встретит закрывающий тег мыслей. В Tavern / SillyTavern: Зайди в настройки AI Response Configuration. Там должен быть параметр Response Length или Max New Tokens. Но это обрежет весь ответ. Лучший вариант для Таверны: Используй "Stopping Strings" (Стоп-слова). Добавь туда </thought> или \n\n. Как только он закончит «думать» и закроет тег, генерация первой части прекратится. 2. Специфические флаги в llama.cpp Если ты запускаешь через llama-server или main, попробуй использовать параметр -n (количество токенов), но это опять же на весь ответ. Если ты хочешь именно «отрубить» мысли, попробуй в System Prompt (системный промпт) добавить: Do not use <thought> tags. Respond directly. Но важно: если модель была дообучена (SFT/RLHF) именно на цепочках рассуждений, она может начать тупить или ломаться без них. 3. Почему /nothink не сработал? Скорее всего, потому что Moevonchik ожидает определенный формат. Чтобы /nothink работал в Таверне, он должен физически вырезать блок из вывода. Проверь в настройках расширений (Extensions) Таверны, включен ли соответствующий скрипт обработки вывода. 4. Радикальный метод: Logit Bias Если ты видишь, что он всегда начинает ответ с конкретного токена (например, <thought>), ты можешь в настройках llama.cpp или Таверны выставить Logit Bias на этот токен в -100. Это физически запретит модели его генерировать. Узнать ID токена можно в консоли llama.cpp при старте.
Совет: Если хочешь «золотую середину», попробуй в системном промпте написать: «Write a very brief internal monologue (max 50 words) before the main response». Иногда просьба писать «коротко» работает лучше, чем полный запрет.
Пока богатые бояре шикуют я запустил всё это дело на старенькой 1050Ti, поднял отдельный физический сервер из говна и палок с open web ui на линукс через докер, подружил веб ебало с олламой, а олламу с cuda 11.8, и балуюсь с маленькими abliterated модельками на 4-9b, думающие при должном пердолинге хорошо "дообучаются" через RAG базы знаний, если с температурой и top_k, repeat_penalti поиграть, выходит вполне осмысленно, чем подробнее база и объяснения, тем адекватнее модель применяет новые знания. Только базы надо самому составлять, чтобы лишней бесполезной хуйнёй и сухой терминологией модель не кормить. Так что грустные нищуки со старой 1050Ti тоже могут попробовать запилить свою локальную вайфу. Обзор маленьких моделек для нищуков: gemma3:4b - веселая ебанушка, любит смайлики, сносно болтает по-русски. Расцензуреная версия резко деградировала, не рекомендую.
huihui_ai/qwen3-abliterated:4b Вот её рекомендую галлюцинирует меньше чем более толстая 8b, даже с температурой 0.5-0.7 Думает, осмысленно подходит к использованию базы данных, с разговорным русским получше чем у дикпик-r1. Можно чему-то "научить" задав жесткий императивный системный промпт: "НЕ ИСПОЛЬЗУЙ ПРЯМОЕ ЦИТИРОВАНИЕ, выдавай знания из базы как свои собственные мысли. Ты работаешь с динамическим словарём (RAG) который содержит ПРАВИЛЬНЫЕ МОРФОЛОГИЧЕСКИЕ ФОРМЫ. ПРАВИЛО: Корректными считаются ТОЛЬКО те формы, которые указаны в RAG словаре. Любая другая форма, особенно помеченные как "ТВОИ ОШИБКИ:" ЗАПРЕЩЕНА. Внутренние знания модели о словоизменении ИГНОРИРУЙ, если они ПРОТИВОРЕЧАТ СЛОВАРЮ." и далее логику и роль, как использовать знания из базы.
huihui_ai/qwen3-abliterated:8b-v2-q4_K_M Лучше логика, но хуже с галлюцинациями если не понизить температуру до 0.3 и top_k, всё пытается превратить в зоопарк, видимо в датасете было много о природе. (фуриёбы на месте?)
deepseek-r1:7b-qwen-distill-q4_K_M тоже думает, тоже может работать с базой, но делает это слишком долго и доёбисто, больше усилий тратит на размышления. Может в некоторые задачи.
GGUF модели прокинул через бэкэнд kobold_old_pc Тут пожалуй стоит выделить только одну - Qwen3.5-9B-Claude-Code-Q4_K_M.gguf Квен с ризонингом клода, может писать адекватный код и анализировать крупные проекты. Долго, муторно, хз зачем оно вам, но пусть будет.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
• Z-Image-Base • FLUX.2 klein (4b и 9b) • Z-Image-Turbo • Flux 2 • Qwen Image / Qwen Image Edit • Wan 2.2 (подходит для генерации картинок). • NAG (негативный промпт на моделях с 1 CFG) • Лора Lightning для Qwen, Wan ускоряет в 4 раза. Nunchaku ускоряет модели в 2-4 раза. DMD2 для SDXL ускоряет в 2 раза.
>>1602419 Если ты генеришь постоянно картинки - у тебя деформация 100%. Я вот музончик пишу с полгода - начал слышать голоса доёбываться до всего подряд, причем уже не только в нейропесенках, но и в обычных нахожу косяки или недостаточную насыщенность, лол. Я думаю если ты куда-нибудь пойдешь на сайт с проф. фотками - тоже начнешь выискивать косяки. Фоток без глубины - полно. Если нет - значит это тупо психологическая защита.
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области!
🚀 Последний обзор ИИ новостей:
🚨 Главные релизы и "Монстры" Claude Mythos Preview (или Capybara) — новая сверхмодель от Anthropic. Выбила 93.9% на SWE-bench Verified. Модель признана слишком опасной для публичного релиза. На этапе тестов она автономно нашла 27-летнюю уязвимость в OpenBSD, 16-летнюю в FFmpeg и смогла "сбежать" из виртуальной песочницы, прислав разработчику письмо на почту. Запуск Project Glasswing — Anthropic открыла доступ к модели Mythos только закрытому клубу из 40+ корпораций (включая Apple, Google, Microsoft) для экстренного поиска уязвимостей в мировом софте. Смерть Sora: Сэм Альтман официально заявил, что OpenAI закрывает разработку видеогенератора Sora (и проекты по робототехнике), чтобы бросить абсолютно все вычислительные мощности на новое поколение моделей и агентов (модель Spud). Gemma 4 31B сдвигает границу Парето — локальная модель, которая рвет бенчмарки и превосходит аналоги при низкой стоимости инференса. Китайские релизы: GLM 5.1 появилась на OpenRouter, а Qwen3.5-Omni теперь понимает текст, картинки, голос и видео одновременно.
🛠️ Инструменты разработчика и Open Source Мила Йовович (да, актриса) вместе с разработчиком Беном Сигманом выпустила опенсорс-инструмент MemPalace. Это система управления памятью ИИ, берущая 100% на LongMemEval. Фишка в сжатии огромной базы знаний всего в 120 токенов контекста. Cursor обновился до 3.0 с формальным переходом к оркестратору агентов. Netflix выложил в Open Source технологию VOID (Video Object and Interaction Deletion) на базе CogVideoX-5B + SAM 2. Позволяет бесшовно удалять объекты из видео с реалистичной симуляцией физических последствий.
💻 Оборудование и Инфраструктура NVIDIA представила NTC (Neural Texture Compression) в рамках DLSS 5. Нейросети теперь восстанавливают текстуры на лету, что снижает потребление видеопамяти (VRAM) в играх на 85% без потери качества картинки. DeepSeek переходит на китайские чипы: Следующая модель DeepSeek V4 будет работать эксклюзивно на железе Huawei (чипы Ascend 950PR), чтобы показать технологическую независимость. Выход модели задерживается из-за сложной адаптации софта с NVIDIA на Huawei. Anthropic закупает TPU от Google в огромных масштабах (на несколько гигаватт) на фоне безумного роста выручки ($30 млрд run-rate к апрелю 2026 года).
🏭 Компании, Политика и Экономика Антикитайская коалиция: OpenAI, Anthropic и Google впервые объединились в рамках Frontier Model Forum, чтобы бороться с китайскими лабораториями (DeepSeek, MiniMax), которые массово воруют знания их моделей через атаки "враждебной дистилляции". Радикальный план OpenAI для правительства США: Компания опубликовала 13-страничный документ, предлагающий ввести налоги на роботов, базовый доход для граждан (через "Фонд общественного благосостояния"), перейти на 4-дневную (32-часовую) рабочую неделю и закрепить "Право на ИИ" в конституции. Конец халявы от Anthropic: Компания запретила использовать обычные подписки ($20) для работы сторонних ИИ-агентов (типа OpenClaw). Теперь для этого нужно платить отдельно по API (pay-as-you-go).
🎨 Генерация контента (Медиа) Китайские генераторы видео Wan 2.7 и Seedance 2.0 активно захватывают рынок после ухода Sora. Suno 5.5 разрешил загружать собственный голос для клонирования в песнях. Google выпустила Veo 3.1 Lite — дешевую видеомодель с нативным звуком. На LMArena замечена (и скрыта) новая модель GPT-IMAGE-2.
OpenAI теперь позволяет командам создавать собственных ботов, способных самостоятельно выполнять работу
Клиент Google Cloud просыпается со счётом на сумму более $18 000, несмотря на установленный бюджет в $7, благодаря забытому ключу API в опубликованном проекте — злоумышленник отправил более 60 000 запросов и превысил лимит расходов в $1
📦 Продукты
Google обновляет Workspace, чтобы сделать ИИ вашим новым офисным стажёром
X запускает новые персонализированные ленты на базе ИИ - до 75 тем на личной странице. X собирается позволить Grok курировать вашу ленту
💻 Оборудование
Google представляет чипы для обучения и инференса ИИ в очередном выпаде в сторону Nvidia
Nvidia представляет - масштабирование дата-центра, готового к ИИ, с помощью NVIDIA RTX PRO 4500 Blackwell Server Edition и NVIDIA vGPU 20
🔓 Открытый исходный код
Nvidia - Упрощение разреженного глубокого обучения с помощью универсального разреженного тензора в nvmath-python. Мы рады сообщить об интеграции UST в nvmath-python v0.9.0 для ускорения разреженных научных приложений и приложений глубокого обучения.
🧪 Исследования
Nvidia - Продвижение перспективных оптимизаторов для ускоренного обучения больших языковых моделей с помощью NVIDIA Megatron
Обучение ИИ-моделей говорить «Я не уверен». Новый метод обучения повышает надёжность оценок уверенности ИИ без ущерба для производительности, устраняя первопричину возникновения галлюцинаций в моделях рассуждения.
Upenn: Хороши ли агенты на базе больших языковых моделей в оптимизации порядка соединений?
⚙️ Инфраструктура
Поднимая Австрию: Google инвестирует в свой первый дата-центр в Альпах.
Глава Microsoft: Благодарим премьер-министра Энтони Альбанизе за тёплый приём сегодня. Мы делаем наши крупнейшие на сегодняшний день инвестиции в Австралию, выделяя 25 миллиардов австралийских долларов на расширение мощностей в области ИИ и облачных технологий.
📱 Приложения
Cricket Australia использует аналитику на базе ИИ, чтобы приблизить болельщиков к действию
🔎 Мнение и анализ
Рынок приложений Индии стремительно растёт — но глобальные платформы захватывают большую часть выгод
⚠️ Безопасность ИИ
5 ИИ-моделей попытались меня обмануть. Некоторые из них были пугающе хороши Кибернетические возможности ИИ-моделей вызывают беспокойство у экспертов. Социальные навыки искусственного интеллекта могут оказаться не менее опасными.
💰 Бизнес
Anthropic стремится нанять сотрудника на шестизначную зарплату для ведения переговоров по сделкам с дата-центрами в целях стимулирования расширения ИИ в Европе — CNBC
3 промпта, которые Марк Кубан рекомендует вводить в Claude — Business Insider
🌐 Остальные события в ИИ области:
Новая ИИ-модель Mythos от Anthropic вызывает глобальную тревогу.
Робот для настольного тенниса Ace входит в историю, обыграв игроков высшего уровня.
Команда Alibaba Qwen выпускает Qwen3.6-27B: плотную модель с открытыми весами, превосходящую 397B MoE на бенчмарках агентного программирования.
OpenAI открывает исходный код Euphony: инструмента визуализации на базе браузера для данных чатов Harmony и журналов сессий Codex.
Bloomberg: несанкционированные пользователи имеют постоянный доступ к не выпущенной модели Mythos от Anthropic и другим необъявленным моделям
Агент Skywork теперь работает внутри мессенджеров WhatsApp, Telegram, Slack, Discord, LINE и Lark
Gemini в Google Chrome расширяется на Японию, Австралию, Индонезию, Сингапур, Южную Корею и другие страны Азиатско-Тихоокеанского региона
Google открывает лист ожидания для нового Jules — сквозной агентной платформы для разработки продуктов, которая отправляет пул-реквесты
Американская группа по защите детей NCMEC получила 1,5 миллиона сообщений о подозрительном контенте с сексуальной эксплуатацией детей, связанном с ИИ, в 2025 году — значительный скачок по сравнению с 67 000 в 2024 году и 4 700 в 2023 году
Google обновляет Workspace, чтобы сделать ИИ вашим новым офисным стажёром
Напомним: OpenAI запускает Images 2.0 в ChatGPT, Codex и API
Студент использовал ИИ-ассистентов для переписывания утечки исходного кода для Claude Code на другом языке, что подчеркивает неопределённость в вопросах авторского права и ИИ
OpenAI выпускает ChatGPT для клиницистов — инструмент для медицинских задач, таких как документирование и исследования, бесплатный для проверенных врачей, фармацевтов и других специалистов в США
Отчёт: группа цифровой безопасности 360 из Китая обнаружила около 1 000 ранее неизвестных уязвимостей, в том числе в Microsoft Office, с помощью агентного ИИ
OpenAI запускает ChatGPT для Google Sheets — нативные ИИ-формулы, сводки и генерация таблиц в ваших электронных таблицах
Anthropic выпускает Claude Code /ultrareview — команду для глубокого многопроходного ревью кода для командной строки
Источники: xAI в последние недели вела переговоры с Mistral и Cursor о возможном трёхстороннем партнёрстве; сооснователь Mistral Девендра Чаплот присоединился к xAI в марте
Google представляет детали своего TPU 8-го поколения — два чипа для агентной эры: TPU 8t для обучения и TPU 8i для инференса
Google превращает Chrome в ИИ-коллегу для работы
Google Cloud и Wiz представляют новые агентные решения для безопасности ИИ на Next '26, включая агентов для поиска угроз и инженерии обнаружения, для борьбы с автоматизированными эксплойтами нулевого дня
Источник: TML Миры Мурати подписала сделку с Google Cloud на сумму в однозначных миллиардах долларов для доступа к новейшим ИИ-системам Google, построенным на чипах Nvidia GB300
OpenAI анонсирует агентные решения для рабочих пространств в ChatGPT, позволяя командам создавать общих агентов на базе Codex для сложных задач, и заявляет, что они являются «эволюцией GPTs»
Gemini для дома от Google возвращает функцию продолжения разговоров
Google заявляет, что 75% нового кода, создаваемого внутри компании, теперь генерируется ИИ и проверяется инженерами-людьми — рост с 50% прошлой осенью
Группа Discord сообщает, что получила доступ к Claude Mythos, угадав местоположение
Google делает ставку на $32 млрд в киберсилы на базе ИИ-агентов по мере эскалации гонки вооружений в области безопасности
Новое исследование показывает, что ChatGPT может угрожать «поцарапать вашу машину» и становиться всё более агрессивным, если подбирать промпты определённым образом
Lovable отрицает утечку данных, называет это намеренным поведением, затем публично обвиняет HackerOne в раскрытии информации
Claude Desktop изменяет настройки доступа к приложениям для браузеров, которые пользователи даже не устанавливали, вызывая опасения относительно согласия в ЕС
Google устраняет уязвимость в IDE Antigravity, позволяющую выполнение кода через инъекцию промптов, обходящую песочницу Strict Mode
Atlassian начнёт собирать данные клиентов из Jira и Confluence по умолчанию в августе для обучения своего ИИ Rovo
Anthropic рассматривает возможность удаления Claude Code из своего самого дешёвого тарифного плана
Похоже, Anthropic удалила доступ к Claude Code из тарифного плана Pro за $20/месяц; Anthropic заявляет, что «проводит небольшой тест на ~2% новых регистраций прозумеров»
Ведущая юридическая фирма Sullivan & Cromwell сообщила федеральному суду по делам о банкротстве в США, что крупная подача документов в громком деле содержала множественные ИИ-галлюцинации
SpaceX сотрудничает с Cursor и имеет опцион на покупку стартапа за $60 млрд
Знаменитости смогут находить и запрашивать удаление ИИ-дипфейков на YouTube
Обновлённый генератор изображений от OpenAI теперь может получать информацию из веба для промптов ChatGPT Images 2.0
«Не просто генерация изображений. Это мышление» — ChatGPT Images 2.0 может фундаментально изменить способ создания ИИ-изображений
Google теперь предлагает два исследовательских агента: Deep Research, заменяющий декабрьскую предварительную версию, и Deep Research Max, оба доступны через платные уровни Gemini API
Microsoft GitHub приостанавливает регистрацию новых аккаунтов Copilot для планов Pro, Pro Plus и Student
Samsung демонстрирует ИИ-робота Project Luna — компаньона с поворотной головкой, предвещающего будущее дизайна
Moonshot AI запускает Kimi K2.6 в Kimi Chat и API с поддержкой длинного контекста для программирования и выполнения агентных задач
ИИ-компания удаляет 3 миллиона фотографий с OKCupid, которые использовала для обучения распознаванию лиц
Сука, из-за репрессий ссаных антропиков цены на кодекс на сайтах по продаже ключей взлетели в 4 раза. Вангую скоро будут стоить столько же сколько и официально. Надо было на год закупаться.
Лимиты: 10 генераций в день. Нужна платная подписка чтобы увеличить лимиты, либо можно абузить сервис через создание множества аккаунтов. Отличается фирменным "песочным" звучанием. Недавно объявили о слиянии с Warner Music Group. Загибаем пальчики крестиком, надеемся, что ссуну не постигнет участь удио.
Провели ребрендинг, выкатили новый интерфейс с прикрученным чатиком с ИИ. Удобный интерфейс, легко делать разнообразные каверы, заниматься исправлениями косяков генераций. Есть возможность реплейса, свапа вокала, музыки в бесплатном тарифе (и даже работает нормально, а не как в платке суны) Для экономии кредитов лучше вручную забивать промты через кнопку "compose"
Тёмная Сингапурско-Китайская лошадка. Один из самых неудобных интерфейсов. 80 приветственных кредитов, далее по 30 ежедневно сгораемых кредитов. Ограничение промта стилей 300-400 символов. Излишне сложные промты лирики так же начинает резать. Приятный холодный звук. Не песочит. Неплохо делает русский вокал.
Это буквально первый проект который может генерировать песни по заданному тексту локально. Оригинальная версия генерирует 30-секундный отрывок за 5 минут на 4090. На данный момент качество музыки низкое по сравнению с Суно. Версия из второй ссылки лучше оптимизирована под слабые видеокарты (в т.ч. 6-8 Гб VRAM, по словам автора). Инструкция на английском по ссылке.
Еще сайты по генерации ИИ-музыки, в них тоже низкое качество звука и понимание промта по сравнению с Суно, либо какие-то другие недостатки типа слишком долгого ожидания генерации или скудного набора жанров, но может кому-то зайдет, поэтому без описания:
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>1598079 Вне зависимости от того как модель на самом деле перформит, чел в твите гигабазу выдал Раз уж корпорации разгребают и каталогизируют завалы награбленного с интернета и решают что и насколько пойдёт в обучение а что нет то могут и специальную небольшую модель (70-150g) сделать с увеличенным литературным корпусом вместо кода. Денег уйдёт чуток, а репутацию заработают
пчелы, я установил лм студио и нейронка квен грузится. а вот для картинок нужен файл, я его тоже в папку кинул и с ним ошибка при развёртовании. чё делать? видеопамяти 24