// BLOG

From the Fleet team

Product updates, engineering deep-dives, and the occasional GPU war story.

fine-tuninggpuguide

Fine-Tuning LLMs on a Budget: LoRA vs QLoRA on Fleet

A practical guide to LoRA and QLoRA fine-tuning on cloud GPUs — what each method costs in memory, when to use which, and how to run them on Fleet by changing one line.

READ →
companygpulaunch

Introducing Fleet: Cloud GPUs Without the Cloud Ops

Why we built Fleet — run local Python on cloud GPUs to train, fine-tune, and deploy ML models, with no Docker, Kubernetes, or infrastructure to manage.

READ →
★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO★ FLEET PLATFORM ONLINE★ GPU SCHEDULING ACTIVE★ ALL SYSTEMS GO★ INFERENCE ENDPOINTS READY★ MISSION CONTROL STANDING BY★ LAUNCH IN T-MINUS ZERO