LoRA Weight Save/Load #
Persists LoRA adapter weights to a simple binary format.
File Format #
Header (24 bytes):
magic : u32 = 0x4C4F5241 ("LORA")
version : u32 = 1
rank : u32
alpha : f32
numLayers: u32
reserved : u32 = 0
Per layer (2 * (A_size + B_size) bytes):
Q_A data : f32[rank * dim]
Q_B data : f32[dim * rank]
V_A data : f32[rank * dim]
V_B data : f32[kvDim * rank]
Save LoRA adapter weights to a binary file
Equations
- One or more equations did not get rendered due to their size.
Instances For
Load LoRA adapter weights from a binary file
Equations
- One or more equations did not get rendered due to their size.