Blog
2 bài viết với chủ đề toi-uu
· Nguyễn Minh Tuấn
TensorRT cho người mới: tối ưu mô hình suy luận nhanh gấp 5 lần
TensorRT biên dịch mô hình thành engine tối ưu cho từng GPU cụ thể. Giải thích FP16, INT8, calibration và cách dùng trtexec để đo hiệu năng trước khi tích hợp vào ứng dụng.
· Nguyễn Minh Tuấn
Tiết kiệm pin cho thiết bị TinyML: từ vài ngày lên vài tháng
Deep sleep giữa các lần suy luận, tắt radio khi không dùng và lấy mẫu theo sự kiện: ba kỹ thuật kéo dài pin gấp hàng chục lần. Đo dòng điện thực tế trên ESP32 cho từng chiến lược.