blob: 28d07c50c3c24a30f3db56188e6f7c727c49fcab [file]
cbuffer cbuffer_m : register(b0) {
uint4 m[1];
};
static int counter = int(0);
int i() {
counter = (counter + int(1));
return counter;
}
vector<float16_t, 4> tint_bitcast_to_f16(uint2 src) {
uint2 v = src;
uint2 mask = (65535u).xx;
uint2 shift = (16u).xx;
float2 t_low = f16tof32((v & mask));
float2 t_high = f16tof32(((v >> shift) & mask));
float16_t v_1 = float16_t(t_low.x);
float16_t v_2 = float16_t(t_high.x);
float16_t v_3 = float16_t(t_low.y);
return vector<float16_t, 4>(v_1, v_2, v_3, float16_t(t_high.y));
}
matrix<float16_t, 2, 3> v_4(uint start_byte_offset) {
uint4 v_5 = m[(start_byte_offset / 16u)];
vector<float16_t, 3> v_6 = tint_bitcast_to_f16((((((start_byte_offset % 16u) / 4u) == 2u)) ? (v_5.zw) : (v_5.xy))).xyz;
uint4 v_7 = m[((8u + start_byte_offset) / 16u)];
return matrix<float16_t, 2, 3>(v_6, tint_bitcast_to_f16(((((((8u + start_byte_offset) % 16u) / 4u) == 2u)) ? (v_7.zw) : (v_7.xy))).xyz);
}
[numthreads(1, 1, 1)]
void f() {
uint v_8 = (8u * min(uint(i()), 1u));
matrix<float16_t, 2, 3> l_m = v_4(0u);
uint4 v_9 = m[(v_8 / 16u)];
vector<float16_t, 3> l_m_i = tint_bitcast_to_f16((((((v_8 % 16u) / 4u) == 2u)) ? (v_9.zw) : (v_9.xy))).xyz;
}