<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>AWQ on CodeOnTime</title><link>https://codeontime.ru/tags/awq/</link><description>Recent content in AWQ on CodeOnTime</description><generator>Hugo</generator><language>ru-ru</language><lastBuildDate>Wed, 12 Aug 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://codeontime.ru/tags/awq/index.xml" rel="self" type="application/rss+xml"/><item><title>AWQ vs GGUF vs INT4: что выбрать под ваше железо (на примерах Qwen)</title><link>https://codeontime.ru/blog/awq-vs-gguf-int4-qwen/</link><pubDate>Wed, 12 Aug 2026 00:00:00 +0000</pubDate><guid>https://codeontime.ru/blog/awq-vs-gguf-int4-qwen/</guid><description>&lt;h2 id="проблема"&gt;Проблема&lt;/h2&gt;&#10;&lt;p&gt;«Нам нужна Qwen, но не влезает в VRAM». Ответ почти всегда — квантизация. Но форматов несколько: AWQ, GGUF, INT4, и каждый по-разному влияет на VRAM, качество и скорость. Выбор «на слух» приводит к тому, что модель либо не влезает, либо деградирует, либо медленнее, чем могла бы.&lt;/p&gt;</description></item></channel></rss>