<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Llm on IT / AI</title><link>https://it.ikt.su/tags/llm/</link><description>Recent content in Llm on IT / AI</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Thu, 27 Aug 2026 12:00:00 +0300</lastBuildDate><atom:link href="https://it.ikt.su/tags/llm/index.xml" rel="self" type="application/rss+xml"/><item><title>Локальные LLM на своём железе: с чего начать</title><link>https://it.ikt.su/posts/2026-08-27-lokalnye-llm-s-chego-nachat/</link><pubDate>Thu, 27 Aug 2026 12:00:00 +0300</pubDate><guid>https://it.ikt.su/posts/2026-08-27-lokalnye-llm-s-chego-nachat/</guid><description>&lt;p&gt;Запуск языковой модели на своём компьютере — приватность, офлайн-режим и никаких лимитов запросов. Разбираем минимальный старт.&lt;/p&gt;
&lt;h2 id="что-понадобится"&gt;Что понадобится&lt;/h2&gt;
&lt;ul&gt;
&lt;li&gt;&lt;strong&gt;8 ГБ RAM&lt;/strong&gt; — модели 3–7B в квантованном виде (Q4);&lt;/li&gt;
&lt;li&gt;&lt;strong&gt;16 ГБ RAM&lt;/strong&gt; — комфортная работа с моделями 7–13B;&lt;/li&gt;
&lt;li&gt;видеокарта ускоряет генерацию, но не обязательна.&lt;/li&gt;
&lt;/ul&gt;
&lt;h2 id="самый-простой-путь-ollama"&gt;Самый простой путь: Ollama&lt;/h2&gt;
&lt;p&gt;Ollama ставится одной командой и тянет модели по аналогии с docker pull:&lt;/p&gt;
&lt;div class="highlight"&gt;&lt;pre tabindex="0" style="color:#f8f8f2;background-color:#282a36;-moz-tab-size:4;-o-tab-size:4;tab-size:4;-webkit-text-size-adjust:none;"&gt;&lt;code class="language-bash" data-lang="bash"&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#6272a4"&gt;# установка (Linux)&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;curl -fsSL https://ollama.com/install.sh | sh
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#6272a4"&gt;# загрузить и запустить модель&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;ollama run llama3.1:8b
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;&lt;span style="color:#6272a4"&gt;# список локальных моделей&lt;/span&gt;
&lt;/span&gt;&lt;/span&gt;&lt;span style="display:flex;"&gt;&lt;span&gt;ollama list
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;После запуска модель доступна и через API на &lt;code&gt;http://localhost:11434&lt;/code&gt; — её можно подключать к своим скриптам и редакторам.&lt;/p&gt;</description></item></channel></rss>