
Kompresi model AI Multiverse Computing tingkatkan performa Llama 3.3 70B di Intel Xeon 6 hampir 94%.
Multiverse Computing mengumumkan bahwa model AI Llama 3.3 70B yang dikompresi dengan CompactifAI kini berjalan efisien di prosesor Intel Xeon 6, dengan throughput hampir dua kali lipat dan latensi setengah dari versi asli. Terobosan ini mengurangi uk...


