
핵심 정리
- 1
PrismML đã huy động được 22,25 triệu đô la và nhằm mục tiêu giảm kích thước LLM mà không ảnh hưởng đến hiệu suất.
- 2
Mô hình Bonsai 2 27B nén Qwen3.8 27B xuống còn 5,9 GB, đạt được sự giảm nhớ 9-10 lần.
- 3
Mô hình đạt được 98% điểm số đánh giá của phiên bản gốc, tăng từ 95% so với các phiên bản trước.
- 4
Quá trình nén sử dụng 'trọng số tam hình' (+1, -1, 0) thay vì các giá trị thông thường 16 bit.
- 5
Các mô hình trong tương lai với hàng tỷ tham số đang được lên kế hoạch, với kỳ vọng đạt được sự nén tinh vi tiên tiến hơn.
관련 태그


