<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Gpu on CodeOnTime</title><link>https://codeontime.ru/tags/gpu/</link><description>Recent content in Gpu on CodeOnTime</description><generator>Hugo</generator><language>ru-ru</language><lastBuildDate>Wed, 02 Sep 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://codeontime.ru/tags/gpu/index.xml" rel="self" type="application/rss+xml"/><item><title>1 млрд токенов/сутки: финальная архитектура, тономика и что мы бы сделали по-другому</title><link>https://codeontime.ru/blog/05-final-architecture/</link><pubDate>Wed, 02 Sep 2026 00:00:00 +0000</pubDate><guid>https://codeontime.ru/blog/05-final-architecture/</guid><description>&lt;h2 id="хук-4500год-против-api"&gt;Хук: ~$4,500/год против API&lt;/h2&gt;&#10;&lt;p&gt;&lt;strong&gt;1 млрд токенов в сутки.&lt;/strong&gt; В пике. В среднем — 600–750M/сутки, ≈220–275B в год. Если бы этот объём шёл через API, он стоил бы &lt;strong&gt;$35–125K в год&lt;/strong&gt; в зависимости от blended-тарифа. На нашем железе — &lt;strong&gt;~$4,500/год&lt;/strong&gt;. Вот как мы дошли до этой цифры — и как ловили себя на нечестных расчётах по пути.&lt;/p&gt;</description></item><item><title>Почему мы собрали LLM-сервер, который жжёт миллиард токенов в сутки</title><link>https://codeontime.ru/blog/01-why-and-hardware/</link><pubDate>Fri, 14 Aug 2026 00:00:00 +0000</pubDate><guid>https://codeontime.ru/blog/01-why-and-hardware/</guid><description>&lt;h2 id="хук-момент-когда-api-стал-болью"&gt;Хук: момент, когда API стал болью&lt;/h2&gt;&#10;&lt;p&gt;В марте 2026 мы посмотрели на счёт за Claude API — &lt;strong&gt;$4,200 за месяц&lt;/strong&gt; — и поняли: наш код-агент сжигает больше токенов, чем мы зарабатываем.&lt;/p&gt;</description></item></channel></rss>