类 | |
| struct | QuantPayload |
函数 | |
| bool | isQuantDType (DType dt) |
| int | quantByteSize (DType dt, int count) |
| uint16_t | f32ToF16 (float x) |
| float | f16ToF32 (uint16_t h) |
| float | fp8E4M3ToF32 (uint8_t v) |
| float | fp4E2M1ToF32 (uint8_t nib) |
| uint32_t | floatToEfm (float x, int expBits, int manBits, int bias) |
| uint8_t | f32ToFp8E4M3 (float x) |
| uint8_t | f32ToFp4E2M1 (float x) |
| float | efmMaxMagnitude (int expBits, int manBits, int bias) |
| float | dequantValue (DType dt, const uint8_t *bytes, const float *scales, int group, int idx) |
| void | dequantizeAll (DType dt, const uint8_t *bytes, const float *scales, int group, int count, float *out) |
| QuantPayload | quantize (const float *src, int count, DType dt, int group) |
函数说明
◆ dequantizeAll()
|
inline |
◆ dequantValue()
|
inline |
引用了 f16ToF32(), eve::tensor::Fp16, eve::tensor::Fp4E2M1, fp4E2M1ToF32(), eve::tensor::Fp8E4M3, fp8E4M3ToF32(), group, h, idx, eve::tensor::Int4, eve::tensor::Int8 , 以及 v.
被这些函数引用 dequantizeAll() , 以及 eve::tensor::Tensor::get().
◆ efmMaxMagnitude()
|
inline |
Largest finite magnitude of an e/m format (used for block scaling).
被这些函数引用 quantize().
◆ f16ToF32()
|
inline |
◆ f32ToF16()
|
inline |
◆ f32ToFp4E2M1()
|
inline |
◆ f32ToFp8E4M3()
|
inline |
◆ floatToEfm()
|
inline |
Round-trip encode of an arbitrary float into a tiny e/m format (nearest, via a cached value table + binary search — no per-element exponential math).
被这些函数引用 f32ToFp4E2M1() , 以及 f32ToFp8E4M3().
◆ fp4E2M1ToF32()
|
inline |
◆ fp8E4M3ToF32()
|
inline |
◆ isQuantDType()
|
inline |
True for the weight-quantization dtypes (stored packed, dequantized on use).
引用了 eve::tensor::Fp16, eve::tensor::Fp4E2M1, eve::tensor::Fp8E4M3, eve::tensor::Int4 , 以及 eve::tensor::Int8.
被这些函数引用 eve::tensor::Tensor::isQuantized() , 以及 eve::tensor::TF::quantizeWeight().
◆ quantByteSize()
|
inline |
Bytes needed to store count elements of dt (int4/fp4 pack two per byte).
引用了 eve::tensor::Fp16, eve::tensor::Fp4E2M1, eve::tensor::Fp8E4M3, eve::tensor::Int4 , 以及 eve::tensor::Int8.
被这些函数引用 quantize().
◆ quantize()
|
inline |