Ախտանիշի քարտ

dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1

Ollama-ի Vulkan ուղին ինտեգրված GPU-ները լռելյայն դեն է նետում, իսկ ներկառուցված ROCm backend-ը gfx1151-ն ինքն է վերցնում, ուստի drop տողը գործողություն չի պահանջում. Ollama-ն թարմացրեք միայն, եթե ROCm տող չի հաջորդում, և ollama ps-ով համոզվեք, որ մոդելն ամբողջովին GPU-ի վրա է։

Պլատֆորմ:
Strix Halo (Ryzen AI Max+ 395)
Runtime:
Ollama
Հրապարակվել է:
02.09.2026

Ինչ եք տեսնում

Թարմ Ollama տեղադրում Strix Halo տուփի վրա։ Զտեք ծառայության լոգում GPU-ի մասին տողերը, և դուրս է գալիս երկու գրառում, որոնք հակասական են թվում.

msg="dropping integrated GPU; to enable, set OLLAMA_IGPU_ENABLE=1"
     id=0 library=Vulkan name=Vulkan0 description="AMD Radeon Graphics (RADV GFX1151)"
msg="inference compute" id=0 library=ROCm compute=gfx1151
     description="Radeon 8060S Graphics" type=iGPU total="117.4 GiB" available="117.4 GiB"

Առաջին տողը կարդացվում է որպես «ձեր GPU-ն չի աջակցվում»։ Մարդիկ դրան անվերապահ հավատում են և գնում են issue-թրեքեր։

Երկրորդ ախտանիշն ավելի լուռ է։ Մոդելը բեռնվում է և պատասխանում, բայց դանդաղ, իսկ ollama psPROCESSOR սյունակում ցույց է տալիս XX%/XX% CPU/GPU-ի նման արժեք 100% GPU-ի փոխարեն։ Չաթի պատասխաններից դա չեք իմանա։

Որտեղ ենք հանդիպել

Պատճառ

Ollama-ն մեկ փաթեթում մի քանի backend է ներառում։ Դրա Vulkan ուղին ինտեգրված GPU-ները լռելյայն դեն է նետում, և առաջին տողն ընդամենը դա է ասում։ Ներկառուցված ROCm backend-ը gfx1151-ը ճանաչում է ուղղակիորեն, վերցնում է սարքը և հայտնում է հիշողության ամբողջ առաստաղը։ Երկու տողն էլ միաժամանակ ճիշտ է; Vulkan drop-ը սարքաշարի մասին դատավճիռ չէ։

OLLAMA_IGPU_ENABLE=1-ը նշանակություն ունի միայն այն դեպքում, եթե ուզում եք հենց Vulkan ուղին։ Արդի Ollama-ի վրա սարքն առանց դրա աշխատում է ROCm-ի միջոցով։

CPU-fallback-ն ունի երկու պատճառ, որոնք ուղեցույցը նշում է. մոդելը չափազանց մեծ է միջուկի TTM պարամետրով սահմանված հիշողության առաստաղի համար, կամ GPU-ն ընդհանրապես չի հայտնաբերվել։ Երկու դեպքում էլ պատասխանները շարունակում են գալ՝ մոդելի մի մասը կամ ամբողջը CPU-ի վրա աշխատելով։

Լուծում

Բուն drop տողում ուղղելու բան չկա։ Կարդացեք լոգը, փնտրեք ROCm տողը, ապա ապացուցեք, թե որտեղ է մոդելը նստել.

journalctl -u ollama -n 80 | grep -iE "gpu|rocm|gfx|compute"

Drop տողին հետևում է library=ROCm compute=gfx1151 տողը. OLLAMA_IGPU_ENABLE-ին մի դիպչեք և անցեք առաջ։

Drop տող կա, ROCm տող չկա. ձեր Ollama-ն ավելի հին է, քան ներկառուցված gfx1151-ի աջակցությունը։ Թարմացրեք այն, նախքան որևէ այլ բանի դիպչելը։

Ապա՝ բեռնված մոդելով.

ollama ps

PROCESSOR-ը պետք է ցույց տա 100% GPU։ Մերը ցույց է տալիս։ Եթե այն ցույց է տալիս XX%/XX% CPU/GPU, ապա կամ մոդելը գերազանցում է հիշողության հատկացման էջի առաստաղը, կամ GPU-ն չի հայտնաբերվել. վերադարձեք լոգին։

Բա՞ց է դեռ upstream-ում

Մենք չենք հետևում։ Ուղեցույցում upstream issue-ի կամ PR-ի հղում չկա։

Ապացույցներ

Աղբյուրներ

Այս քարտը փաստագրում է լաբորատորիայի սեփական երկաթի վրա դիտարկված մեկ խափանում; թվերը, եթե կան, ապրում են հղված աղբյուր էջում, ոչ թե այստեղ։

← Բոլոր ախտանիշների քարտերը