Локальный ИИ

8материалов

Сборка машины для локальных LLM, RTX 3090, Qwen, настройка контекста и практика запуска моделей.

Локальный ИИ

Как я оставил локальную нейросеть чинить баги ночью

Перед уходом домой запустил локальную нейросеть чинить баги на проекте. Пока-что она настроена не идеально, легко может уйти в бессмысленный и бесконечный цикл. Поэтому настроил автоматическое выключение компьютера…

Локальный ИИ

Недавно писал, что подписываюсь на людей, которые глубже меня погружены в llm, локальные модели и вайбкодинг, чтобы отслеживать тренды.

Открываю ленту: + SFT-корпус на 0,7 млрд токенов, 5 эпох, 8×H100; + 100500 часов тестов на 4×5090, FP8, NVFP4, AWQ, 20 млн reasoning-токенов. И я. Сижу со своим Qwen на одной 3090 и думаю: ага, то есть я,…

Локальный ИИ

Похоже, мне нужна вторая RTX 3090.

Нет, не потому, что первая плохо справляется. Скорее наоборот. После прошлого поста ещё поигрался с настройками запуска и контекст удалось поднять до 164к токенов. Можно запускать и на 192к, но там уже придётся…

Локальный ИИ

Что я получил, купив б/у RTX 3090 за 75 тысяч рублей

Короткий ответ: вполне серьёзную локальную альтернативу большим облачным LLM. Цена удовольствия: нужно вникать. Параметры запуска, кванты, софт, архитектура, инфраструктура и тонны тестов. Большие LLM дают комфорт,…

Локальный ИИ

Один промпт — 20 000 токенов: эксперимент с расходом контекста

Промпт, которым обычно проверяешь, не отвалилась ли модель. Может VPN тупит, может что-то программно сломалось и т.д. Знаете, сколько контекстного окна отжирает этот промпт из одного слова у Гермеса? 20 тысяч…