Ապացույցներ
Ստուգված կոնֆիգուրացիաներ
Մեկ քարտ = մեկ ճշգրիտ համակարգ, runtime, մոդելի արտեֆակտ և workload-ի ռևիզիա՝ վճռով հենց այդ համադրության համար։ Քարտը երբեք չի նշանակում նույն սարքի այլ տարբերակների աջակցություն։
- PASS WITH LIMITS active lab_repeatedStrix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — փաստաթղթի սեսիայի քեշ
Երկրորդ հարցը նույն տեղադրված փաստաթղթի վերաբերյալ. prompt cache-ն անջատած՝ նորից է վճարում կեսրոպեանոց prefill-ը, միացրած՝ պատասխանում է վայրկյանից արագ։ Մեկ կարգավորում փաստաթղթերի հետ աշխատանքը ոչ պիտանիից դարձնում է կենդանի։
- Համակարգ:
- Beelink GTR9 Pro — Ryzen AI Max+ 395, Radeon 8060S (gfx1151), 128 ԳԲ unified
- Runtime:
- llama.cpp server-vulkan-b9049, ամրագրված image digest-ով sha256:e359c012…
- Մոդել:
- Qwen3.6-35B-A3B Q4_K_M (ggml-org, ամրագրված ռևիզիա, sha256:671e47e0…)
- Workload:
- doc-session-v1 @ 2026-08-03 — ընդհանուր պրեֆիքսով հարցերի զույգեր 8k/32k թոքենանոց փաստաթղթերի վրա, EN+RU
- PASS WITH LIMITS active lab_single_runStrix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — երեք ժամ անընդհատ ծանրաբեռնվածության տակ
Անընդհատ 3-ժամյա closed-loop անցում concurrency 4-ով երկու յունիթի վրա. բոլոր հարցումները պատասխանված են, decode-ի տեմպը պահպանված է առաջին և վերջին հինգ րոպեների միջև, առանց ջերմային փլուզման — երկու յունիթի բյուրեղի նկատելիորեն տարբեր ջերմաստիճանով։
- Համակարգ:
- 2× Beelink GTR9 Pro — Ryzen AI Max+ 395, Radeon 8060S (gfx1151), 128 ԳԲ unified — մեկ անցում՝ յունիթին, կողք կողքի
- Runtime:
- llama.cpp server-vulkan-b9049, ամրագրված image digest-ով sha256:e359c012…
- Մոդել:
- Qwen3.6-35B-A3B Q4_K_M (ggml-org, ամրագրված ռևիզիա, sha256:671e47e0…)
- Workload:
- endurance-30m-v1 @ 2026-08-03 — human-կորպուսը closed-loop ցիկլով 180 րոպե, չեկփոինթներ՝ 30/60/180 ր
- PARTIAL active lab_repeatedStrix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — կենցաղային օգնական
Մեկ օգտատիրոջ կենցաղային չաթ Beelink GTR9 Pro-ի վրա. ակնթարթային պատասխաններ առանց մտածողության, կոտրված կոնֆիգուրացիա մտածողության լռելյայն բյուջեով և բազմախոսության շեմ, որը չի անցնում ոչ մի ռեժիմում։
- Համակարգ:
- Beelink GTR9 Pro — Ryzen AI Max+ 395, Radeon 8060S (gfx1151), 128 ԳԲ unified — մեկ օգտատիրոջ բջիջները ռեպլիկացված են երկրորդ՝ կոմերցիոն առումով նույնական յունիթի վրա
- Runtime:
- llama.cpp server-vulkan-b9049, պատկերի digest-ը ֆիքսված է՝ sha256:e359c012…
- Մոդել:
- Qwen3.6-35B-A3B Q4_K_M (ggml-org, ամրագրված ռևիզիա, sha256:671e47e0…)
- Workload:
- interactive-assistant-v2 @ 2026-08-02 — 16 կենցաղային խնդիր, EN+RU
- PASS WITH LIMITS active lab_repeatedStrix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — որոնում տեղադրված փաստաթղթում
Ասեղի կոնտեքստի սանդուղք մինչև 30k չափված թոքեն՝ unanswerable-կոնտրոլներով. և՛ որոնումը, և՛ ազնվությունը պահպանվում են բոլոր չափված խորություններում — իսկ առաջին թոքենի ժամանակը գծայնորեն աճում է մինչև տասնյակ վայրկյաններ։
- Համակարգ:
- Beelink GTR9 Pro — Ryzen AI Max+ 395, Radeon 8060S (gfx1151), 128 ԳԲ unified
- Runtime:
- llama.cpp server-vulkan-b9049, պատկերի digest-ը ֆիքսված է՝ sha256:e359c012…
- Մոդել:
- Qwen3.6-35B-A3B Q4_K_M (ggml-org, ամրագրված ռևիզիա, sha256:671e47e0…)
- Workload:
- long-context-v1 @ 2026-08-03 — ասեղի սանդուղք, նոմինալ աստիճաններ 2k–32k (EN չափված 1.8k–30.0k, RU 1.4k–21.1k), կոնտրոլներով
- PASS WITH LIMITS active lab_repeatedStrix Halo × llama.cpp Vulkan × Qwen3.6-35B-A3B — խիստ JSON ավտոմատացումների համար
Դետերմինիստական դուրսբերում, դասակարգում և կառուցվածքային գեներացիա խիստ JSON-ով. իդեալական task-success մտածողության երկու ռեժիմներում էլ այս կորպուսի վրա — դրանց միջև ժամանակի տասնյոթապատիկ տարբերությամբ։
- Համակարգ:
- Beelink GTR9 Pro — Ryzen AI Max+ 395, Radeon 8060S (gfx1151), 128 ԳԲ unified
- Runtime:
- llama.cpp server-vulkan-b9049, պատկերի digest-ը ֆիքսված է՝ sha256:e359c012…
- Մոդել:
- Qwen3.6-35B-A3B Q4_K_M (ggml-org, ամրագրված ռևիզիա, sha256:671e47e0…)
- Workload:
- structured-agent-v1 @ 2026-08-03 — 16 դետերմինիստական JSON-խնդիր, EN+RU