4B-модель обошла Postgres на 81% после обучения за $1200
Исследователь обучил 4-миллиардную модель Qwen на двух б/у RTX 3090 за $1200: она строит планы запросов к БД на 81% быстрее Postgres. LoRA-адаптер на 21,2 млн параметров весит 42,5 МБ и помещается на смартфон.
- Обучение: ~$800 за аренду 2x H100 на 95 часов и ~$400 на API-траектории
- Итог: ускорение 1,81x и снижение суммарной задержки на 44,7%
- LoRA-адаптер: 21,2 млн параметров, 42,5 МБ, помещается на телефон
- Метод RL основан на GRPO из статьи DeepSeekMath 2024 года
Читать дальше
ИИ