Llama 3.2


Llama 3.2 в новостной повестке, календарь упоминаний и aналитика в реальном времени.

Календарь упоминаний:

2026
08 июля

BaseRT демонстрирует ускорение декодирования Llama 3.2 на чипах Apple Silicon

Суть: Движок BaseRT обеспечил прирост скорости генерации токенов для моделей Llama 3.2 при работе на процессорах M3 и M4 Pro за счет прямой интеграции с графическим API Metal.

Событие: В ходе тестирования Llama 3.2 1B показала ускорение декодирования в 1,28 раза по сравнению с llama.cpp и в 1,15 раза против MLX при квантовании Q4.

Событие: Модель Llama 3.2 3B достигла прироста производительности в 1,15 раза относительно llama.cpp и в 1,05 раза относительно MLX в тех же условиях тестирования.

Фактор: Эффективность ускорения Llama 3.2 в движке BaseRT снижается с ростом размера модели, так как на крупных архитектурах узким местом становится пропускная способность памяти.

Подробнее →


В нашей базе собрано 1 событие по теме «Llama 3.2». Мы показываем все из них.