Llama-3.3-70B-Instruct
Llama-3.3-70B-Instruct в новостной повестке, календарь упоминаний и aналитика в реальном времени.
Календарь упоминаний:
Метод физики конденсированного состояния позволил сократить Llama-3.3-70B-Instruct вдвое без критической потери качества
Команда Multiverse Computing применила оптимизацию системы Изинга для выбора блоков, подлежащих удалению из больших языковых моделей. В отличие от стандартных подходов, игнорирующих взаимовлияние слоев, новый алгоритм учитывает зависимости между ними через расчет «энергии» системы. Это позволяет находить комбинации ненужных компонентов, которые минимально влияют на точность ответов модели даже при агрессивном сжатии архитектуры.
Исследование: При удалении 40 из 80 блоков (50% глубины) Llama-3.3-70B-Instruct сохранил результат 76.9 в бенчмарке MMLU, тогда как лучший альтернативный алгоритм показал лишь 54.0.
Эффект: Метод обеспечивает преимущество почти в 23 процентных пункта по точности при глубоком сжатии, что делает его эффективным инструментом для снижения затрат на инференс и экономию оперативной памяти GPU.
В нашей базе собрано 1 событие по теме «Llama-3.3-70B-Instruct». Мы показываем все из них.