Reddit
gfx906-llama-cpp: новый прирост PP/TG для MI50/MI60/Radeon VII/AMD GCN
Форк llama.cpp для AMD GCN (MI50, MI60, Radeon VII) получил значительные улучшения производительности: prefill вырос на 23%, deep fill на 14%, TG на 11% по сравнению с upstream. Изменения основаны на адаптации существующих PR llama.cpp, результаты бит-идентичны эталонным.
score 55r/LocalLLaMA