<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>AGmind Systems Lab — отчёты</title>
    <link>https://agmind.ai/ru/</link>
    <description>Исследования квалификации локальных AI-систем: доказательства, ограничения и отрицательные результаты.</description>
    <language>ru-RU</language>
    <atom:link href="https://agmind.ai/ru/rss.xml" rel="self" type="application/rss+xml"/>
    <item>
      <title>DeepSeek-V4-Flash 0731 на двух DGX Spark: рецепт с размеченными ловушками</title>
      <link>https://agmind.ai/ru/reports/deepseek-v4-flash-0731-dgx-spark-recipe/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/deepseek-v4-flash-0731-dgx-spark-recipe/</guid>
      <description>Точный серверный рецепт за нашими опубликованными цифрами на GB10: пиненные веса и образ, порядок запуска head-first против зависания TCPStore, MoE-флаг, который пропускает автовыбор, что мониторить, когда NVML молчит — и какие цифры ждать.</description>
      <pubDate>Sun, 16 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>Стоит ли DGX Spark своих денег под локальные LLM? Измеренный ответ</title>
      <link>https://agmind.ai/ru/reports/dgx-spark-worth-it/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/dgx-spark-worth-it/</guid>
      <description>Самый частый покупательский вопрос ниши закрыт почти исключительно спековой арифметикой. Вот что пара GB10 реально сделала в нашей лаборатории — 284B MoE, кривая контекста до миллиона токенов — и кому её брать, а кому нет.</description>
      <pubDate>Sun, 16 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>HTTP 200 и пустой ответ: режим отказа, которого не видит ваш мониторинг</title>
      <link>https://agmind.ai/ru/reports/answerless-http-200/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/answerless-http-200/</guid>
      <description>Reasoning-модель может потратить весь токен-бюджет на размышления и вернуть успешный ответ с нулём видимого пользователю текста. Мы измерили, как часто это происходит на двух семействах моделей — и почему TTFT-дашборды при этом выглядят идеально.</description>
      <pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Кириллический налог: сколько русский текст реально стоит в токенах, измерено</title>
      <link>https://agmind.ai/ru/reports/cyrillic-token-cost/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/cyrillic-token-cost/</guid>
      <description>Наш long-context корпус резался по оценке «символов на токен» — она держалась на английском и промахнулась на треть на русском. Измеренные счётчики опубликованы: что это значит для контекстных окон кириллицы и как мы поймали свою ошибку.</description>
      <pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Я пользуюсь ИИ каждый день. И считаю, что луддиты были правы</title>
      <link>https://agmind.ai/ru/essays/luddites-were-right/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/essays/luddites-were-right/</guid>
      <description>Год журнала: каждый случай, когда ИИ соврал, и каждый, когда всерьёз выручил. Протокол проверки, к которому это привело, и почему реальная история луддитов — про качество и цену перехода, а не про страх машин.</description>
      <pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate>
    </item>
    <item>
      <title>Почему опубликованные скорости DeepSeek на DGX Spark расходятся между собой</title>
      <link>https://agmind.ai/ru/reports/dspark-speed-numbers-disagree/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/dspark-speed-numbers-disagree/</guid>
      <description>Одна и та же модель на тех же двух узлах GB10 публикуется со скоростями от конца пятидесятых до начала семидесятых токенов в секунду. Каждая из этих цифр может быть верной — вот конфигурация за каждой и какую цитировать под какой вопрос.</description>
      <pubDate>Thu, 13 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>Сколько людей реально могут делить одну локальную AI-коробку на 128 ГБ?</title>
      <link>https://agmind.ai/ru/reports/concurrency-capacity-strix-halo/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/concurrency-capacity-strix-halo/</guid>
      <description>Измеренная лестница конкурентности на одном Strix Halo: как выглядит ожидание при одном, четырёх и восьми одновременных чатах, что осталось корректным и почему «токенов в секунду» не отвечает на вопрос о размере команды.</description>
      <pubDate>Wed, 12 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Спекулятивный DSpark на двух DGX Spark: кривая глубины до миллиона токенов</title>
      <link>https://agmind.ai/ru/reports/dspark-speculative-1m-dgx-spark/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/dspark-speculative-1m-dgx-spark/</guid>
      <description>Наш fp8-запуск DSpark на GB10, независимая репродукция комьюнити-сборки NVFP4 и данные глубины, которых никто не публиковал: одиночная кривая до реального миллионного промпта — плюс два негативных результата, названные своими именами.</description>
      <pubDate>Wed, 05 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>vLLM auto выбрал не то MoE-ядро для DeepSeek-V4-Flash на GB10</title>
      <link>https://agmind.ai/ru/reports/dsv4-flash-moe-backend-dgx-spark/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/dsv4-flash-moe-backend-dgx-spark/</guid>
      <description>DeepSeek-V4-Flash-0731 на двух узлах DGX Spark: образ содержит MoE-ядро под MXFP4-экспертов этой модели на этом кремнии — а автовыбор его пропускает. Ручной выбор стоит двузначных процентов декода. Рецепт и сырые результаты открыты.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>Вторая модель, второй квант, второй бэкенд: что переносится на одном ящике</title>
      <link>https://agmind.ai/ru/reports/model-quant-backend-strix-halo/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/model-quant-backend-strix-halo/</guid>
      <description>Тот же юнит Strix Halo, три замены по одной за раз: второе семейство моделей воспроизводит режим пустых ответов; Q8_0 не покупает ничего измеримого на этих ворклоадах; ROCm работает на gfx1151, но декодит медленнее Vulkan.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Strix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — кэш сессии документа</title>
      <link>https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-docsession/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-docsession/</guid>
      <description>Второй вопрос по тому же вставленному документу: с выключенным кэшем промптов он заново платит полуминутный префилл; с включённым — отвечает быстрее секунды. Одна настройка превращает работу с документами из непригодной в живую.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Strix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — три часа под непрерывной нагрузкой</title>
      <link>https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-endurance/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-endurance/</guid>
      <description>Непрерывный 3-часовой closed-loop проход при конкуренции 4 на обоих юнитах: все запросы отвечены, темп декода удержан между первыми и последними пятью минутами, без теплового обвала — при заметно разной температуре кристалла у двух юнитов.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_single_run</category>
    </item>
    <item>
      <title>Strix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — бытовой ассистент</title>
      <link>https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-interactive/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-interactive/</guid>
      <description>Однопользовательский бытовой чат на Beelink GTR9 Pro: мгновенные ответы без размышления, сломанная конфигурация на дефолтном бюджете размышления и лимит многословности, который не проходится ни в одном режиме.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Strix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — поиск по вставленному документу</title>
      <link>https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-longcontext/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-longcontext/</guid>
      <description>Иголочная лестница контекста до 30k измеренных токенов с unanswerable-контролями: и поиск, и честность держатся на всех измеренных глубинах — а время до первого токена растёт линейно до десятков секунд.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Strix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — строгий JSON для автоматизаций</title>
      <link>https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-structured/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/tested-configurations/strix-halo-qwen36-llamacpp-vulkan-structured/</guid>
      <description>Детерминированное извлечение, классификация и структурная генерация в строгом JSON: идеальный task-success в обоих режимах размышления на этом корпусе — при семнадцатикратной разнице во времени между ними.</description>
      <pubDate>Mon, 03 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>Time-to-first-token ничего не говорит о думающей модели</title>
      <link>https://agmind.ai/ru/reports/ttft-thinking-model-strix-halo/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/ttft-thinking-model-strix-halo/</guid>
      <description>На коробке Strix Halo привычная цифра TTFT выглядела отлично, а большинство запросов возвращали пустой ответ с HTTP 200. Клиентские замеры, три режима работы, evidence-пакеты приложены.</description>
      <pubDate>Sun, 02 Aug 2026 00:00:00 GMT</pubDate>
      <category>lab_repeated</category>
    </item>
    <item>
      <title>DeepSeek-V4-Flash DSpark на 2× DGX Spark: контекст 1M — legacy-результаты</title>
      <link>https://agmind.ai/ru/reports/dspark-dgx-spark-1m-legacy/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/dspark-dgx-spark-1m-legacy/</guid>
      <description>Bring-up спекулятивного декодирования DSpark на GB10 (sm_121) через 200G RoCE, кривая глубины до миллиона токенов, независимое воспроизведение комьюнити-сборки и два честных отрицательных результата.</description>
      <pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate>
      <category>legacy</category>
    </item>
    <item>
      <title>Мультислотный LLM-инференс на Strix Halo — legacy-результаты</title>
      <link>https://agmind.ai/ru/reports/strix-halo-multislot-legacy/</link>
      <guid isPermaLink="true">https://agmind.ai/ru/reports/strix-halo-multislot-legacy/</guid>
      <description>Что делает один мини-ПК Strix Halo со 128 ГБ под 32 параллельными чат-потоками: рецепты, обрыв конкурентности после 8 запросов во всех конфигурациях, и где спекулятивное декодирование перестаёт помогать.</description>
      <pubDate>Fri, 31 Jul 2026 00:00:00 GMT</pubDate>
      <category>legacy</category>
    </item>
  </channel>
</rss>
