Ախտանիշի քարտ
dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1
Ollama-ի Vulkan ուղին ինտեգրված GPU-ները լռելյայն դեն է նետում, իսկ ներկառուցված ROCm backend-ը gfx1151-ն ինքն է վերցնում, ուստի drop տողը գործողություն չի պահանջում. Ollama-ն թարմացրեք միայն, եթե ROCm տող չի հաջորդում, և ollama ps-ով համոզվեք, որ մոդելն ամբողջովին GPU-ի վրա է։
- Պլատֆորմ:
- Strix Halo (Ryzen AI Max+ 395)
- Runtime:
- Ollama
- Հրապարակվել է:
- 02.09.2026
Ինչ եք տեսնում
Թարմ Ollama տեղադրում Strix Halo տուփի վրա։ Զտեք ծառայության լոգում GPU-ի մասին տողերը, և դուրս է գալիս երկու գրառում, որոնք հակասական են թվում.
msg="dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1"
id=0 library=Vulkan name=Vulkan0 description="AMD Radeon Graphics (RADV GFX1151)"
msg="inference compute" id=0 library=ROCm compute=gfx1151
description="Radeon 8060S Graphics" type=iGPU total="117.4 GiB" available="117.4 GiB"
Առաջին տողը կարդացվում է որպես «ձեր GPU-ն չի աջակցվում»։ Մարդիկ դրան անվերապահ հավատում են և գնում են issue-թրեքեր։
Երկրորդ ախտանիշն ավելի լուռ է։ Մոդելը բեռնվում է և պատասխանում, բայց
դանդաղ, իսկ ollama ps-ը PROCESSOR սյունակում ցույց է տալիս
XX%/XX% CPU/GPU-ի նման արժեք 100% GPU-ի փոխարեն։ Չաթի
պատասխաններից դա չեք իմանա։
Որտեղ ենք հանդիպել
- Սարքաշար. Strix Halo, Ryzen AI Max+ 395, մեր սեփական տուփերից մեկը։
iGPU-ն ROCm-ի տակ երևում է որպես
Radeon 8060S Graphics, իսկ Vulkan-ի տակ՝ որպեսAMD Radeon Graphics (RADV GFX1151)։ - Runtime. Ollama, թարմ լռելյայն տեղադրում պաշտոնական սկրիպտով
(
curl -fsSL https://ollama.com/install.sh | sh)։ Ուղեցույցը տարբերակ չի ամրագրում; այն դա անվանում է «արդի Ollama»։ - Ամսաթիվ. 2026-09-01, ուղեցույցի ամսաթիվը; ուղեցույցը նշում է, որ գրվել է տեղադրման ընթացքում։
Պատճառ
Ollama-ն մեկ փաթեթում մի քանի backend է ներառում։ Դրա Vulkan ուղին ինտեգրված GPU-ները լռելյայն դեն է նետում, և առաջին տողն ընդամենը դա է ասում։ Ներկառուցված ROCm backend-ը gfx1151-ը ճանաչում է ուղղակիորեն, վերցնում է սարքը և հայտնում է հիշողության ամբողջ առաստաղը։ Երկու տողն էլ միաժամանակ ճիշտ է; Vulkan drop-ը սարքաշարի մասին դատավճիռ չէ։
OLLAMA_IGPU_ENABLE=1-ը նշանակություն ունի միայն այն դեպքում, եթե ուզում
եք հենց Vulkan ուղին։ Արդի Ollama-ի վրա սարքն առանց դրա աշխատում է
ROCm-ի միջոցով։
CPU-fallback-ն ունի երկու պատճառ, որոնք ուղեցույցը նշում է. մոդելը չափազանց մեծ է միջուկի TTM պարամետրով սահմանված հիշողության առաստաղի համար, կամ GPU-ն ընդհանրապես չի հայտնաբերվել։ Երկու դեպքում էլ պատասխանները շարունակում են գալ՝ մոդելի մի մասը կամ ամբողջը CPU-ի վրա աշխատելով։
Լուծում
Բուն drop տողում ուղղելու բան չկա։ Կարդացեք լոգը, փնտրեք ROCm տողը, ապա ապացուցեք, թե որտեղ է մոդելը նստել.
journalctl -u ollama -n 80 | grep -iE "gpu|rocm|gfx|compute"
Drop տողին հետևում է library=ROCm compute=gfx1151 տողը.
OLLAMA_IGPU_ENABLE-ին մի դիպչեք և անցեք առաջ։
Drop տող կա, ROCm տող չկա. ձեր Ollama-ն ավելի հին է, քան ներկառուցված gfx1151-ի աջակցությունը։ Թարմացրեք այն, նախքան որևէ այլ բանի դիպչելը։
Ապա՝ բեռնված մոդելով.
ollama ps
PROCESSOR-ը պետք է ցույց տա 100% GPU։ Մերը ցույց է տալիս։ Եթե
այն ցույց է տալիս XX%/XX% CPU/GPU, ապա կամ մոդելը գերազանցում է
հիշողության հատկացման էջի
առաստաղը, կամ GPU-ն չի հայտնաբերվել. վերադարձեք լոգին։
Բա՞ց է դեռ upstream-ում
Մենք չենք հետևում։ Ուղեցույցում upstream issue-ի կամ PR-ի հղում չկա։
Ապացույցներ
- Ollama Strix Halo-ի վրա. տեղադրում, GPU-ի դետեկտ, առաջին մոդելը
- Հիշողությունը Strix Halo-ի վրա, առաստաղը, որից կախված է fallback-ի ստուգումը
Աղբյուրներ
- Ollama Strix Halo-ի վրա (Ryzen AI Max+ 395). տեղադրում, GPU-ի դետեկտ, առաջին մոդելը · /guides/ollama-strix-halo/
Այս քարտը փաստագրում է լաբորատորիայի սեփական երկաթի վրա դիտարկված մեկ խափանում; թվերը, եթե կան, ապրում են հղված աղբյուր էջում, ոչ թե այստեղ։