<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
        <title>Запустил нейронку на 235B на домашнем сервере. Без видеокарты</title>
        <link>https://tube.4e6a.ru/videos/watch/8babeddb-3c2a-4bd0-8591-7dddb53477bf</link>
        <description>Энтерпрайз оборудование тут:  https://clck.ru/3NyVEp Промокод: DONEX Реклама ООО "СЕРВЕР ЦЕНТР" erid: 2VtzqwFWSrW Запустил большие нейросети на домашнем сервере без единой видеокарты: два Xeon E5-2680v4, 128 ГБ DDR4 и llama.cpp. Проверяю, что реально тянет процессор - от Qwen3-Coder 30B до gpt-oss 120B и Qwen3-235B, замеряю скорость генерации и разбираюсь, что решает на самом деле: MoE, квантизация и NUMA. Сравниваю с RTX 3090 и честно показываю, где старый сервер берет объемом, а где проигрывает в скорости. Локальный ChatGPT без подписки, без VPN и без интернета - разбираемся, кому это реально нужно и сколько стоит. 🛒 Материнская плата SuperMicro на SP3: https://ali.click/afgtf1u?erid=2SDnjevWZjG https://ali.click/52ddh1f?erid=2SDnjehEuTq 🛒 Маленькая и бюджетная SuperMicro для старта homelab: https://ali.click/fma8718?erid=2SDnjddDaWv 🛒 Комплект плата + проц + память (очень близкий к моей первой сборке на канале) https://ali.click/g6dah1y?erid=2SDnjdN5BUP 🛒 Двухсокет с 64Gb ddr4: https://ali.click/1pdah16?erid=2SDnjdEfaYb 🛒 Двухсокет похожий намой из этого видео, но с нищей памятью на частоте 2133. (оч дорого, берите только если прям вот очень хочется готовый комплект с двухсокетом на 128. Хотя я бы уже рассматривал supermicro за около 20к на двухсокете и самостоятельно стрелять оперативку на Авито. Камни 2680v4 сейчас стоят около 1к - 1.5к за штуку, тоже можно найти на Авито. https://ali.click/j6eah10?erid=2SDnjdSXpHH Поддержать канал копеечкой можно на Бусти. Подписчикам уровня Junior Developer и выше, ролики доступны раньше, чем на Ютубе. Присоединяйтесь: https://boosty.to/donex Подписчики канала в телеграме, получают чуть больше контента, и я иногда выкладываю информацию, не подходящую под формат канала. Присоединяйся, в общем 😃 Наш канал в телеге: https://t.me/DonExCode Наш чатик в телеге: https://t.me/DonExCodeChat Наш дискорд: https://discord.gg/TpYWFyf7bX 00:00 - О чем видос 00:59 - Конфигурация сервера 02:19 - Энтерпрайз железо 03:27 - dense и  MoE модели 05:22 - преимущество перед видеокартой 06:26 - квантизация 07:25 - настройка сервера и NUMA 09:24 - тесты 09:41 - бенчмарк GPT oss 120B 10:29 - бенчмарк Qwen3.5 122B 10:51 - бенчмарк GLM 4.5 Air 106B 11:06 - количество активных параметров 11:41 - модели для 64 Гб ОЗУ 14:04 - сравниваем с RTX 3090 14:46 - запускаем qwen3 235B 15:28 - проблема квантизации 16:08 - Тесты на конкретных задачах 16:41 - Qwen3 Coder 30B 17:22 - GLM 4.5 106B 18:22 - GPT OSS 120B 17:14 - Qwen3 235B 20:38 - Выводы о работе моделей 21:59 - Нюансы локальных LLM 23:08 - Узкое место системы 23:37 - Какой ценой? 26:22 - Зачем нужны локальные LLM? 29:04 - Бейджи спонсоров</description>
        <lastBuildDate>Mon, 27 Jul 2026 22:16:20 GMT</lastBuildDate>
        <docs>https://validator.w3.org/feed/docs/rss2.html</docs>
        <generator>PeerTube - https://tube.4e6a.ru</generator>
        <image>
            <title>Запустил нейронку на 235B на домашнем сервере. Без видеокарты</title>
            <url>https://tube.4e6a.ru/lazy-static/avatars/5a03b981-ae38-4088-b5d8-3fc8d965eabc.png</url>
            <link>https://tube.4e6a.ru/videos/watch/8babeddb-3c2a-4bd0-8591-7dddb53477bf</link>
        </image>
        <copyright>All rights reserved, unless otherwise specified in the terms specified at https://tube.4e6a.ru/about and potential licenses granted by each content's rightholder.</copyright>
        <atom:link href="https://tube.4e6a.ru/feeds/video-comments.xml?videoId=8babeddb-3c2a-4bd0-8591-7dddb53477bf" rel="self" type="application/rss+xml"/>
    </channel>
</rss>