Intel ускоряет Qwen3-8B на Core Ultra с помощью обрезки слоев и спекулятивного декодирования
Intel и Hugging Face представили метод ускорения агентской модели Qwen3-8B на процессорах Core Ultra через спекулятивное декодирование и обрезку слоев, достигнув 1.4× прироста скорости.
