program(1.3) [buildInfo = dict({{"coremlc-component-MIL", "3500.14.1"}, {"coremlc-version", "3500.32.1"}, {"coremltools-component-torch", "2.7.0"}, {"coremltools-source-dialect", "TorchScript"}, {"coremltools-version", "9.0"}})] { func main(tensor latent, tensor s0_cos, state> s0_l0_k, state> s0_l0_v, state> s0_l1_k, state> s0_l1_v, state> s0_l2_k, state> s0_l2_v, state> s0_l3_k, state> s0_l3_v, tensor s0_mask, tensor s0_sin, tensor s1_cos, state> s1_l0_k, state> s1_l0_v, state> s1_l1_k, state> s1_l1_v, tensor s1_mask, tensor s1_sin, tensor s2_cos, state> s2_l0_k, state> s2_l0_v, state> s2_l1_k, state> s2_l1_v, tensor s2_mask, tensor s2_sin, tensor s3_cos, state> s3_l0_k, state> s3_l0_v, state> s3_l1_k, state> s3_l1_v, state> s3_l2_k, state> s3_l2_v, state> s3_l3_k, state> s3_l3_v, tensor s3_mask, tensor s3_sin) { tensor var_594 = const()[name = string("op_594"), val = tensor([1, 192, 4, 1])]; tensor var_595_cast_fp16 = reshape(shape = var_594, x = latent)[name = string("op_595_cast_fp16")]; tensor var_600 = const()[name = string("op_600"), val = tensor([0, 1, 3, 2])]; tensor var_605 = const()[name = string("op_605"), val = tensor([1, 192, 4])]; tensor var_601_cast_fp16 = transpose(perm = var_600, x = var_595_cast_fp16)[name = string("transpose_37")]; tensor x_1_cast_fp16 = reshape(shape = var_605, x = var_601_cast_fp16)[name = string("x_1_cast_fp16")]; tensor input_1_perm_0 = const()[name = string("input_1_perm_0"), val = tensor([0, 2, 1])]; tensor stages_0_input_proj_weight_to_fp16 = const()[name = string("stages_0_input_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(64)))]; tensor linear_0_bias_0_to_fp16 = const()[name = string("linear_0_bias_0_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(98432)))]; tensor input_1_cast_fp16 = transpose(perm = input_1_perm_0, x = x_1_cast_fp16)[name = string("transpose_36")]; tensor linear_0_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_input_proj_weight_to_fp16, x = input_1_cast_fp16)[name = string("linear_0_cast_fp16")]; tensor input_5_axes_0 = const()[name = string("input_5_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_0_norm1_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(99008)))]; tensor stages_0_transformer_layers_0_norm1_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_0_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(99584)))]; fp16 var_614_to_fp16 = const()[name = string("op_614_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_5_cast_fp16 = layer_norm(axes = input_5_axes_0, beta = stages_0_transformer_layers_0_norm1_bias_to_fp16, epsilon = var_614_to_fp16, gamma = stages_0_transformer_layers_0_norm1_weight_to_fp16, x = linear_0_cast_fp16)[name = string("input_5_cast_fp16")]; tensor stages_0_transformer_layers_0_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(100160)))]; tensor linear_1_bias_0_to_fp16 = const()[name = string("linear_1_bias_0_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(493440)))]; tensor linear_1_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_0_transformer_layers_0_self_attn_in_proj_weight_to_fp16, x = input_5_cast_fp16)[name = string("linear_1_cast_fp16")]; tensor var_628 = const()[name = string("op_628"), val = tensor([1, 4, 3, 4, 64])]; tensor var_629_cast_fp16 = reshape(shape = var_628, x = linear_1_cast_fp16)[name = string("op_629_cast_fp16")]; tensor var_635 = const()[name = string("op_635"), val = tensor([2, 0, 3, 1, 4])]; tensor query_1_begin_0 = const()[name = string("query_1_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_1_end_0 = const()[name = string("query_1_end_0"), val = tensor([1, 1, 4, 4, 64])]; tensor query_1_end_mask_0 = const()[name = string("query_1_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_1_squeeze_mask_0 = const()[name = string("query_1_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_3_cast_fp16 = transpose(perm = var_635, x = var_629_cast_fp16)[name = string("transpose_35")]; tensor query_1_cast_fp16 = slice_by_index(begin = query_1_begin_0, end = query_1_end_0, end_mask = query_1_end_mask_0, squeeze_mask = query_1_squeeze_mask_0, x = qkv_3_cast_fp16)[name = string("query_1_cast_fp16")]; tensor key_1_begin_0 = const()[name = string("key_1_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_1_end_0 = const()[name = string("key_1_end_0"), val = tensor([2, 1, 4, 4, 64])]; tensor key_1_end_mask_0 = const()[name = string("key_1_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_1_squeeze_mask_0 = const()[name = string("key_1_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_1_cast_fp16 = slice_by_index(begin = key_1_begin_0, end = key_1_end_0, end_mask = key_1_end_mask_0, squeeze_mask = key_1_squeeze_mask_0, x = qkv_3_cast_fp16)[name = string("key_1_cast_fp16")]; tensor value_1_begin_0 = const()[name = string("value_1_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_1_end_0 = const()[name = string("value_1_end_0"), val = tensor([3, 1, 4, 4, 64])]; tensor value_1_end_mask_0 = const()[name = string("value_1_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_1_squeeze_mask_0 = const()[name = string("value_1_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_1_cast_fp16 = slice_by_index(begin = value_1_begin_0, end = value_1_end_0, end_mask = value_1_end_mask_0, squeeze_mask = value_1_squeeze_mask_0, x = qkv_3_cast_fp16)[name = string("value_1_cast_fp16")]; tensor var_651 = const()[name = string("op_651"), val = tensor([1, 4, 4, 32, 2])]; tensor query_pairs_1_cast_fp16 = reshape(shape = var_651, x = query_1_cast_fp16)[name = string("query_pairs_1_cast_fp16")]; tensor var_658 = const()[name = string("op_658"), val = tensor([1, 4, 4, 32, 2])]; tensor key_pairs_1_cast_fp16 = reshape(shape = var_658, x = key_1_cast_fp16)[name = string("key_pairs_1_cast_fp16")]; tensor qr_1_begin_0 = const()[name = string("qr_1_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_1_end_0 = const()[name = string("qr_1_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor qr_1_end_mask_0 = const()[name = string("qr_1_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_1_squeeze_mask_0 = const()[name = string("qr_1_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_1_cast_fp16 = slice_by_index(begin = qr_1_begin_0, end = qr_1_end_0, end_mask = qr_1_end_mask_0, squeeze_mask = qr_1_squeeze_mask_0, x = query_pairs_1_cast_fp16)[name = string("qr_1_cast_fp16")]; tensor qi_1_begin_0 = const()[name = string("qi_1_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_1_end_0 = const()[name = string("qi_1_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor qi_1_end_mask_0 = const()[name = string("qi_1_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_1_squeeze_mask_0 = const()[name = string("qi_1_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_1_cast_fp16 = slice_by_index(begin = qi_1_begin_0, end = qi_1_end_0, end_mask = qi_1_end_mask_0, squeeze_mask = qi_1_squeeze_mask_0, x = query_pairs_1_cast_fp16)[name = string("qi_1_cast_fp16")]; tensor kr_1_begin_0 = const()[name = string("kr_1_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_1_end_0 = const()[name = string("kr_1_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor kr_1_end_mask_0 = const()[name = string("kr_1_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_1_squeeze_mask_0 = const()[name = string("kr_1_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_1_cast_fp16 = slice_by_index(begin = kr_1_begin_0, end = kr_1_end_0, end_mask = kr_1_end_mask_0, squeeze_mask = kr_1_squeeze_mask_0, x = key_pairs_1_cast_fp16)[name = string("kr_1_cast_fp16")]; tensor ki_1_begin_0 = const()[name = string("ki_1_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_1_end_0 = const()[name = string("ki_1_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor ki_1_end_mask_0 = const()[name = string("ki_1_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_1_squeeze_mask_0 = const()[name = string("ki_1_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_1_cast_fp16 = slice_by_index(begin = ki_1_begin_0, end = ki_1_end_0, end_mask = ki_1_end_mask_0, squeeze_mask = ki_1_squeeze_mask_0, x = key_pairs_1_cast_fp16)[name = string("ki_1_cast_fp16")]; tensor var_672_cast_fp16 = mul(x = qr_1_cast_fp16, y = s0_cos)[name = string("op_672_cast_fp16")]; tensor var_673_cast_fp16 = mul(x = qi_1_cast_fp16, y = s0_sin)[name = string("op_673_cast_fp16")]; tensor var_675_cast_fp16 = sub(x = var_672_cast_fp16, y = var_673_cast_fp16)[name = string("op_675_cast_fp16")]; tensor var_676_cast_fp16 = mul(x = qr_1_cast_fp16, y = s0_sin)[name = string("op_676_cast_fp16")]; tensor var_677_cast_fp16 = mul(x = qi_1_cast_fp16, y = s0_cos)[name = string("op_677_cast_fp16")]; tensor var_679_cast_fp16 = add(x = var_676_cast_fp16, y = var_677_cast_fp16)[name = string("op_679_cast_fp16")]; int32 query_3_axis_0 = const()[name = string("query_3_axis_0"), val = int32(-1)]; tensor query_3_cast_fp16 = stack(axis = query_3_axis_0, values = (var_675_cast_fp16, var_679_cast_fp16))[name = string("query_3_cast_fp16")]; tensor var_683_cast_fp16 = mul(x = kr_1_cast_fp16, y = s0_cos)[name = string("op_683_cast_fp16")]; tensor var_684_cast_fp16 = mul(x = ki_1_cast_fp16, y = s0_sin)[name = string("op_684_cast_fp16")]; tensor var_686_cast_fp16 = sub(x = var_683_cast_fp16, y = var_684_cast_fp16)[name = string("op_686_cast_fp16")]; tensor var_687_cast_fp16 = mul(x = kr_1_cast_fp16, y = s0_sin)[name = string("op_687_cast_fp16")]; tensor var_688_cast_fp16 = mul(x = ki_1_cast_fp16, y = s0_cos)[name = string("op_688_cast_fp16")]; tensor var_690_cast_fp16 = add(x = var_687_cast_fp16, y = var_688_cast_fp16)[name = string("op_690_cast_fp16")]; int32 key_3_axis_0 = const()[name = string("key_3_axis_0"), val = int32(-1)]; tensor key_3_cast_fp16 = stack(axis = key_3_axis_0, values = (var_686_cast_fp16, var_690_cast_fp16))[name = string("key_3_cast_fp16")]; tensor var_698 = const()[name = string("op_698"), val = tensor([1, 4, 4, 64])]; tensor query_5_cast_fp16 = reshape(shape = var_698, x = query_3_cast_fp16)[name = string("query_5_cast_fp16")]; tensor var_704 = const()[name = string("op_704"), val = tensor([1, 4, 4, 64])]; tensor key_5_cast_fp16 = reshape(shape = var_704, x = key_3_cast_fp16)[name = string("key_5_cast_fp16")]; tensor read_state_0 = read_state(input = s0_l0_k)[name = string("read_state_0")]; tensor var_720_begin_0 = const()[name = string("op_720_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_720_end_0 = const()[name = string("op_720_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_720_end_mask_0 = const()[name = string("op_720_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_720_cast_fp16 = slice_by_index(begin = var_720_begin_0, end = var_720_end_0, end_mask = var_720_end_mask_0, x = read_state_0)[name = string("op_720_cast_fp16")]; int32 var_727 = const()[name = string("op_727"), val = int32(2)]; bool new_key_1_interleave_0 = const()[name = string("new_key_1_interleave_0"), val = bool(false)]; tensor new_key_1_cast_fp16 = concat(axis = var_727, interleave = new_key_1_interleave_0, values = (var_720_cast_fp16, key_5_cast_fp16))[name = string("new_key_1_cast_fp16")]; tensor read_state_1 = read_state(input = s0_l0_v)[name = string("read_state_1")]; tensor var_743_begin_0 = const()[name = string("op_743_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_743_end_0 = const()[name = string("op_743_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_743_end_mask_0 = const()[name = string("op_743_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_743_cast_fp16 = slice_by_index(begin = var_743_begin_0, end = var_743_end_0, end_mask = var_743_end_mask_0, x = read_state_1)[name = string("op_743_cast_fp16")]; int32 var_750 = const()[name = string("op_750"), val = int32(2)]; bool new_value_1_interleave_0 = const()[name = string("new_value_1_interleave_0"), val = bool(false)]; tensor new_value_1_cast_fp16 = concat(axis = var_750, interleave = new_value_1_interleave_0, values = (var_743_cast_fp16, value_1_cast_fp16))[name = string("new_value_1_cast_fp16")]; tensor concat_0 = const()[name = string("concat_0"), val = tensor([0, 0, 0, 0])]; tensor concat_1 = const()[name = string("concat_1"), val = tensor([0, 0, 0, 0])]; tensor s0_l0_k_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l0_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l0_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l0_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l0_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l0_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l0_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l0_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l0_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_0, begin_mask = s0_l0_k_internal_tensor_assign_1_begin_mask_0, end = concat_1, end_mask = s0_l0_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l0_k_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l0_k_internal_tensor_assign_1_stride_0, update = new_key_1_cast_fp16, x = read_state_0)[name = string("s0_l0_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l0_k_internal_tensor_assign_1_cast_fp16, input = s0_l0_k)[name = string("coreml_update_state_24_write_state")]; tensor concat_2 = const()[name = string("concat_2"), val = tensor([0, 0, 0, 0])]; tensor concat_3 = const()[name = string("concat_3"), val = tensor([0, 0, 0, 0])]; tensor s0_l0_v_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l0_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l0_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l0_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l0_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l0_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l0_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l0_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l0_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_2, begin_mask = s0_l0_v_internal_tensor_assign_1_begin_mask_0, end = concat_3, end_mask = s0_l0_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l0_v_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l0_v_internal_tensor_assign_1_stride_0, update = new_value_1_cast_fp16, x = read_state_1)[name = string("s0_l0_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l0_v_internal_tensor_assign_1_cast_fp16, input = s0_l0_v)[name = string("coreml_update_state_25_write_state")]; bool var_769_transpose_x_1 = const()[name = string("op_769_transpose_x_1"), val = bool(false)]; bool var_769_transpose_y_1 = const()[name = string("op_769_transpose_y_1"), val = bool(true)]; tensor var_769_cast_fp16 = matmul(transpose_x = var_769_transpose_x_1, transpose_y = var_769_transpose_y_1, x = query_5_cast_fp16, y = new_key_1_cast_fp16)[name = string("op_769_cast_fp16")]; fp16 var_770_to_fp16 = const()[name = string("op_770_to_fp16"), val = fp16(0x1p-3)]; tensor scores_1_cast_fp16 = mul(x = var_769_cast_fp16, y = var_770_to_fp16)[name = string("scores_1_cast_fp16")]; tensor var_773_cast_fp16 = add(x = scores_1_cast_fp16, y = s0_mask)[name = string("op_773_cast_fp16")]; int32 var_774 = const()[name = string("op_774"), val = int32(-1)]; tensor probabilities_1_cast_fp16 = softmax(axis = var_774, x = var_773_cast_fp16)[name = string("probabilities_1_cast_fp16")]; bool attention_1_transpose_x_0 = const()[name = string("attention_1_transpose_x_0"), val = bool(false)]; bool attention_1_transpose_y_0 = const()[name = string("attention_1_transpose_y_0"), val = bool(false)]; tensor attention_1_cast_fp16 = matmul(transpose_x = attention_1_transpose_x_0, transpose_y = attention_1_transpose_y_0, x = probabilities_1_cast_fp16, y = new_value_1_cast_fp16)[name = string("attention_1_cast_fp16")]; tensor var_780_perm_0 = const()[name = string("op_780_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_784 = const()[name = string("op_784"), val = tensor([1, 4, 256])]; tensor var_780_cast_fp16 = transpose(perm = var_780_perm_0, x = attention_1_cast_fp16)[name = string("transpose_34")]; tensor input_7_cast_fp16 = reshape(shape = var_784, x = var_780_cast_fp16)[name = string("input_7_cast_fp16")]; tensor stages_0_transformer_layers_0_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(495040)))]; tensor linear_2_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_0_self_attn_out_proj_weight_to_fp16, x = input_7_cast_fp16)[name = string("linear_2_cast_fp16")]; tensor stages_0_transformer_layers_0_layer_scale_1_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_0_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(626176)))]; tensor var_790_cast_fp16 = mul(x = stages_0_transformer_layers_0_layer_scale_1_scale_to_fp16, y = linear_2_cast_fp16)[name = string("op_790_cast_fp16")]; tensor input_9_cast_fp16 = add(x = linear_0_cast_fp16, y = var_790_cast_fp16)[name = string("input_9_cast_fp16")]; tensor input_11_axes_0 = const()[name = string("input_11_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_0_norm2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(626752)))]; tensor stages_0_transformer_layers_0_norm2_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_0_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(627328)))]; fp16 var_794_to_fp16 = const()[name = string("op_794_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_11_cast_fp16 = layer_norm(axes = input_11_axes_0, beta = stages_0_transformer_layers_0_norm2_bias_to_fp16, epsilon = var_794_to_fp16, gamma = stages_0_transformer_layers_0_norm2_weight_to_fp16, x = input_9_cast_fp16)[name = string("input_11_cast_fp16")]; tensor stages_0_transformer_layers_0_ffn_0_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(627904)))]; tensor linear_3_bias_0_to_fp16 = const()[name = string("linear_3_bias_0_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1152256)))]; tensor linear_3_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_0_transformer_layers_0_ffn_0_weight_to_fp16, x = input_11_cast_fp16)[name = string("linear_3_cast_fp16")]; string input_15_mode_0 = const()[name = string("input_15_mode_0"), val = string("EXACT")]; tensor input_15_cast_fp16 = gelu(mode = input_15_mode_0, x = linear_3_cast_fp16)[name = string("input_15_cast_fp16")]; tensor stages_0_transformer_layers_0_ffn_2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_0_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1154368)))]; tensor linear_4_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_0_ffn_2_weight_to_fp16, x = input_15_cast_fp16)[name = string("linear_4_cast_fp16")]; tensor stages_0_transformer_layers_0_layer_scale_2_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_0_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1678720)))]; tensor var_810_cast_fp16 = mul(x = stages_0_transformer_layers_0_layer_scale_2_scale_to_fp16, y = linear_4_cast_fp16)[name = string("op_810_cast_fp16")]; tensor input_17_cast_fp16 = add(x = input_9_cast_fp16, y = var_810_cast_fp16)[name = string("input_17_cast_fp16")]; tensor input_19_axes_0 = const()[name = string("input_19_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_1_norm1_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1679296)))]; tensor stages_0_transformer_layers_1_norm1_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_1_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1679872)))]; fp16 var_814_to_fp16 = const()[name = string("op_814_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_19_cast_fp16 = layer_norm(axes = input_19_axes_0, beta = stages_0_transformer_layers_1_norm1_bias_to_fp16, epsilon = var_814_to_fp16, gamma = stages_0_transformer_layers_1_norm1_weight_to_fp16, x = input_17_cast_fp16)[name = string("input_19_cast_fp16")]; tensor stages_0_transformer_layers_1_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(1680448)))]; tensor linear_5_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_0_transformer_layers_1_self_attn_in_proj_weight_to_fp16, x = input_19_cast_fp16)[name = string("linear_5_cast_fp16")]; tensor var_828 = const()[name = string("op_828"), val = tensor([1, 4, 3, 4, 64])]; tensor var_829_cast_fp16 = reshape(shape = var_828, x = linear_5_cast_fp16)[name = string("op_829_cast_fp16")]; tensor var_835 = const()[name = string("op_835"), val = tensor([2, 0, 3, 1, 4])]; tensor query_7_begin_0 = const()[name = string("query_7_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_7_end_0 = const()[name = string("query_7_end_0"), val = tensor([1, 1, 4, 4, 64])]; tensor query_7_end_mask_0 = const()[name = string("query_7_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_7_squeeze_mask_0 = const()[name = string("query_7_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_7_cast_fp16 = transpose(perm = var_835, x = var_829_cast_fp16)[name = string("transpose_33")]; tensor query_7_cast_fp16 = slice_by_index(begin = query_7_begin_0, end = query_7_end_0, end_mask = query_7_end_mask_0, squeeze_mask = query_7_squeeze_mask_0, x = qkv_7_cast_fp16)[name = string("query_7_cast_fp16")]; tensor key_7_begin_0 = const()[name = string("key_7_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_7_end_0 = const()[name = string("key_7_end_0"), val = tensor([2, 1, 4, 4, 64])]; tensor key_7_end_mask_0 = const()[name = string("key_7_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_7_squeeze_mask_0 = const()[name = string("key_7_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_7_cast_fp16 = slice_by_index(begin = key_7_begin_0, end = key_7_end_0, end_mask = key_7_end_mask_0, squeeze_mask = key_7_squeeze_mask_0, x = qkv_7_cast_fp16)[name = string("key_7_cast_fp16")]; tensor value_3_begin_0 = const()[name = string("value_3_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_3_end_0 = const()[name = string("value_3_end_0"), val = tensor([3, 1, 4, 4, 64])]; tensor value_3_end_mask_0 = const()[name = string("value_3_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_3_squeeze_mask_0 = const()[name = string("value_3_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_3_cast_fp16 = slice_by_index(begin = value_3_begin_0, end = value_3_end_0, end_mask = value_3_end_mask_0, squeeze_mask = value_3_squeeze_mask_0, x = qkv_7_cast_fp16)[name = string("value_3_cast_fp16")]; tensor var_851 = const()[name = string("op_851"), val = tensor([1, 4, 4, 32, 2])]; tensor query_pairs_3_cast_fp16 = reshape(shape = var_851, x = query_7_cast_fp16)[name = string("query_pairs_3_cast_fp16")]; tensor var_858 = const()[name = string("op_858"), val = tensor([1, 4, 4, 32, 2])]; tensor key_pairs_3_cast_fp16 = reshape(shape = var_858, x = key_7_cast_fp16)[name = string("key_pairs_3_cast_fp16")]; tensor qr_3_begin_0 = const()[name = string("qr_3_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_3_end_0 = const()[name = string("qr_3_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor qr_3_end_mask_0 = const()[name = string("qr_3_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_3_squeeze_mask_0 = const()[name = string("qr_3_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_3_cast_fp16 = slice_by_index(begin = qr_3_begin_0, end = qr_3_end_0, end_mask = qr_3_end_mask_0, squeeze_mask = qr_3_squeeze_mask_0, x = query_pairs_3_cast_fp16)[name = string("qr_3_cast_fp16")]; tensor qi_3_begin_0 = const()[name = string("qi_3_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_3_end_0 = const()[name = string("qi_3_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor qi_3_end_mask_0 = const()[name = string("qi_3_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_3_squeeze_mask_0 = const()[name = string("qi_3_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_3_cast_fp16 = slice_by_index(begin = qi_3_begin_0, end = qi_3_end_0, end_mask = qi_3_end_mask_0, squeeze_mask = qi_3_squeeze_mask_0, x = query_pairs_3_cast_fp16)[name = string("qi_3_cast_fp16")]; tensor kr_3_begin_0 = const()[name = string("kr_3_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_3_end_0 = const()[name = string("kr_3_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor kr_3_end_mask_0 = const()[name = string("kr_3_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_3_squeeze_mask_0 = const()[name = string("kr_3_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_3_cast_fp16 = slice_by_index(begin = kr_3_begin_0, end = kr_3_end_0, end_mask = kr_3_end_mask_0, squeeze_mask = kr_3_squeeze_mask_0, x = key_pairs_3_cast_fp16)[name = string("kr_3_cast_fp16")]; tensor ki_3_begin_0 = const()[name = string("ki_3_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_3_end_0 = const()[name = string("ki_3_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor ki_3_end_mask_0 = const()[name = string("ki_3_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_3_squeeze_mask_0 = const()[name = string("ki_3_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_3_cast_fp16 = slice_by_index(begin = ki_3_begin_0, end = ki_3_end_0, end_mask = ki_3_end_mask_0, squeeze_mask = ki_3_squeeze_mask_0, x = key_pairs_3_cast_fp16)[name = string("ki_3_cast_fp16")]; tensor var_872_cast_fp16 = mul(x = qr_3_cast_fp16, y = s0_cos)[name = string("op_872_cast_fp16")]; tensor var_873_cast_fp16 = mul(x = qi_3_cast_fp16, y = s0_sin)[name = string("op_873_cast_fp16")]; tensor var_875_cast_fp16 = sub(x = var_872_cast_fp16, y = var_873_cast_fp16)[name = string("op_875_cast_fp16")]; tensor var_876_cast_fp16 = mul(x = qr_3_cast_fp16, y = s0_sin)[name = string("op_876_cast_fp16")]; tensor var_877_cast_fp16 = mul(x = qi_3_cast_fp16, y = s0_cos)[name = string("op_877_cast_fp16")]; tensor var_879_cast_fp16 = add(x = var_876_cast_fp16, y = var_877_cast_fp16)[name = string("op_879_cast_fp16")]; int32 query_9_axis_0 = const()[name = string("query_9_axis_0"), val = int32(-1)]; tensor query_9_cast_fp16 = stack(axis = query_9_axis_0, values = (var_875_cast_fp16, var_879_cast_fp16))[name = string("query_9_cast_fp16")]; tensor var_883_cast_fp16 = mul(x = kr_3_cast_fp16, y = s0_cos)[name = string("op_883_cast_fp16")]; tensor var_884_cast_fp16 = mul(x = ki_3_cast_fp16, y = s0_sin)[name = string("op_884_cast_fp16")]; tensor var_886_cast_fp16 = sub(x = var_883_cast_fp16, y = var_884_cast_fp16)[name = string("op_886_cast_fp16")]; tensor var_887_cast_fp16 = mul(x = kr_3_cast_fp16, y = s0_sin)[name = string("op_887_cast_fp16")]; tensor var_888_cast_fp16 = mul(x = ki_3_cast_fp16, y = s0_cos)[name = string("op_888_cast_fp16")]; tensor var_890_cast_fp16 = add(x = var_887_cast_fp16, y = var_888_cast_fp16)[name = string("op_890_cast_fp16")]; int32 key_9_axis_0 = const()[name = string("key_9_axis_0"), val = int32(-1)]; tensor key_9_cast_fp16 = stack(axis = key_9_axis_0, values = (var_886_cast_fp16, var_890_cast_fp16))[name = string("key_9_cast_fp16")]; tensor var_898 = const()[name = string("op_898"), val = tensor([1, 4, 4, 64])]; tensor query_11_cast_fp16 = reshape(shape = var_898, x = query_9_cast_fp16)[name = string("query_11_cast_fp16")]; tensor var_904 = const()[name = string("op_904"), val = tensor([1, 4, 4, 64])]; tensor key_11_cast_fp16 = reshape(shape = var_904, x = key_9_cast_fp16)[name = string("key_11_cast_fp16")]; tensor read_state_2 = read_state(input = s0_l1_k)[name = string("read_state_2")]; tensor var_920_begin_0 = const()[name = string("op_920_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_920_end_0 = const()[name = string("op_920_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_920_end_mask_0 = const()[name = string("op_920_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_920_cast_fp16 = slice_by_index(begin = var_920_begin_0, end = var_920_end_0, end_mask = var_920_end_mask_0, x = read_state_2)[name = string("op_920_cast_fp16")]; int32 var_927 = const()[name = string("op_927"), val = int32(2)]; bool new_key_3_interleave_0 = const()[name = string("new_key_3_interleave_0"), val = bool(false)]; tensor new_key_3_cast_fp16 = concat(axis = var_927, interleave = new_key_3_interleave_0, values = (var_920_cast_fp16, key_11_cast_fp16))[name = string("new_key_3_cast_fp16")]; tensor read_state_3 = read_state(input = s0_l1_v)[name = string("read_state_3")]; tensor var_943_begin_0 = const()[name = string("op_943_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_943_end_0 = const()[name = string("op_943_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_943_end_mask_0 = const()[name = string("op_943_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_943_cast_fp16 = slice_by_index(begin = var_943_begin_0, end = var_943_end_0, end_mask = var_943_end_mask_0, x = read_state_3)[name = string("op_943_cast_fp16")]; int32 var_950 = const()[name = string("op_950"), val = int32(2)]; bool new_value_3_interleave_0 = const()[name = string("new_value_3_interleave_0"), val = bool(false)]; tensor new_value_3_cast_fp16 = concat(axis = var_950, interleave = new_value_3_interleave_0, values = (var_943_cast_fp16, value_3_cast_fp16))[name = string("new_value_3_cast_fp16")]; tensor concat_4 = const()[name = string("concat_4"), val = tensor([0, 0, 0, 0])]; tensor concat_5 = const()[name = string("concat_5"), val = tensor([0, 0, 0, 0])]; tensor s0_l1_k_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l1_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l1_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l1_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l1_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l1_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l1_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l1_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l1_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_4, begin_mask = s0_l1_k_internal_tensor_assign_1_begin_mask_0, end = concat_5, end_mask = s0_l1_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l1_k_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l1_k_internal_tensor_assign_1_stride_0, update = new_key_3_cast_fp16, x = read_state_2)[name = string("s0_l1_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l1_k_internal_tensor_assign_1_cast_fp16, input = s0_l1_k)[name = string("coreml_update_state_26_write_state")]; tensor concat_6 = const()[name = string("concat_6"), val = tensor([0, 0, 0, 0])]; tensor concat_7 = const()[name = string("concat_7"), val = tensor([0, 0, 0, 0])]; tensor s0_l1_v_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l1_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l1_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l1_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l1_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l1_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l1_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l1_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l1_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_6, begin_mask = s0_l1_v_internal_tensor_assign_1_begin_mask_0, end = concat_7, end_mask = s0_l1_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l1_v_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l1_v_internal_tensor_assign_1_stride_0, update = new_value_3_cast_fp16, x = read_state_3)[name = string("s0_l1_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l1_v_internal_tensor_assign_1_cast_fp16, input = s0_l1_v)[name = string("coreml_update_state_27_write_state")]; bool var_969_transpose_x_1 = const()[name = string("op_969_transpose_x_1"), val = bool(false)]; bool var_969_transpose_y_1 = const()[name = string("op_969_transpose_y_1"), val = bool(true)]; tensor var_969_cast_fp16 = matmul(transpose_x = var_969_transpose_x_1, transpose_y = var_969_transpose_y_1, x = query_11_cast_fp16, y = new_key_3_cast_fp16)[name = string("op_969_cast_fp16")]; fp16 var_970_to_fp16 = const()[name = string("op_970_to_fp16"), val = fp16(0x1p-3)]; tensor scores_3_cast_fp16 = mul(x = var_969_cast_fp16, y = var_970_to_fp16)[name = string("scores_3_cast_fp16")]; tensor var_973_cast_fp16 = add(x = scores_3_cast_fp16, y = s0_mask)[name = string("op_973_cast_fp16")]; int32 var_974 = const()[name = string("op_974"), val = int32(-1)]; tensor probabilities_3_cast_fp16 = softmax(axis = var_974, x = var_973_cast_fp16)[name = string("probabilities_3_cast_fp16")]; bool attention_3_transpose_x_0 = const()[name = string("attention_3_transpose_x_0"), val = bool(false)]; bool attention_3_transpose_y_0 = const()[name = string("attention_3_transpose_y_0"), val = bool(false)]; tensor attention_3_cast_fp16 = matmul(transpose_x = attention_3_transpose_x_0, transpose_y = attention_3_transpose_y_0, x = probabilities_3_cast_fp16, y = new_value_3_cast_fp16)[name = string("attention_3_cast_fp16")]; tensor var_980_perm_0 = const()[name = string("op_980_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_984 = const()[name = string("op_984"), val = tensor([1, 4, 256])]; tensor var_980_cast_fp16 = transpose(perm = var_980_perm_0, x = attention_3_cast_fp16)[name = string("transpose_32")]; tensor input_21_cast_fp16 = reshape(shape = var_984, x = var_980_cast_fp16)[name = string("input_21_cast_fp16")]; tensor stages_0_transformer_layers_1_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2073728)))]; tensor linear_6_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_1_self_attn_out_proj_weight_to_fp16, x = input_21_cast_fp16)[name = string("linear_6_cast_fp16")]; tensor stages_0_transformer_layers_1_layer_scale_1_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_1_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2204864)))]; tensor var_990_cast_fp16 = mul(x = stages_0_transformer_layers_1_layer_scale_1_scale_to_fp16, y = linear_6_cast_fp16)[name = string("op_990_cast_fp16")]; tensor input_23_cast_fp16 = add(x = input_17_cast_fp16, y = var_990_cast_fp16)[name = string("input_23_cast_fp16")]; tensor input_25_axes_0 = const()[name = string("input_25_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_1_norm2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2205440)))]; tensor stages_0_transformer_layers_1_norm2_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_1_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2206016)))]; fp16 var_994_to_fp16 = const()[name = string("op_994_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_25_cast_fp16 = layer_norm(axes = input_25_axes_0, beta = stages_0_transformer_layers_1_norm2_bias_to_fp16, epsilon = var_994_to_fp16, gamma = stages_0_transformer_layers_1_norm2_weight_to_fp16, x = input_23_cast_fp16)[name = string("input_25_cast_fp16")]; tensor stages_0_transformer_layers_1_ffn_0_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2206592)))]; tensor linear_7_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_0_transformer_layers_1_ffn_0_weight_to_fp16, x = input_25_cast_fp16)[name = string("linear_7_cast_fp16")]; string input_29_mode_0 = const()[name = string("input_29_mode_0"), val = string("EXACT")]; tensor input_29_cast_fp16 = gelu(mode = input_29_mode_0, x = linear_7_cast_fp16)[name = string("input_29_cast_fp16")]; tensor stages_0_transformer_layers_1_ffn_2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_1_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(2730944)))]; tensor linear_8_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_1_ffn_2_weight_to_fp16, x = input_29_cast_fp16)[name = string("linear_8_cast_fp16")]; tensor stages_0_transformer_layers_1_layer_scale_2_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_1_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3255296)))]; tensor var_1010_cast_fp16 = mul(x = stages_0_transformer_layers_1_layer_scale_2_scale_to_fp16, y = linear_8_cast_fp16)[name = string("op_1010_cast_fp16")]; tensor input_31_cast_fp16 = add(x = input_23_cast_fp16, y = var_1010_cast_fp16)[name = string("input_31_cast_fp16")]; tensor input_33_axes_0 = const()[name = string("input_33_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_2_norm1_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3255872)))]; tensor stages_0_transformer_layers_2_norm1_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_2_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3256448)))]; fp16 var_1014_to_fp16 = const()[name = string("op_1014_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_33_cast_fp16 = layer_norm(axes = input_33_axes_0, beta = stages_0_transformer_layers_2_norm1_bias_to_fp16, epsilon = var_1014_to_fp16, gamma = stages_0_transformer_layers_2_norm1_weight_to_fp16, x = input_31_cast_fp16)[name = string("input_33_cast_fp16")]; tensor stages_0_transformer_layers_2_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3257024)))]; tensor linear_9_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_0_transformer_layers_2_self_attn_in_proj_weight_to_fp16, x = input_33_cast_fp16)[name = string("linear_9_cast_fp16")]; tensor var_1028 = const()[name = string("op_1028"), val = tensor([1, 4, 3, 4, 64])]; tensor var_1029_cast_fp16 = reshape(shape = var_1028, x = linear_9_cast_fp16)[name = string("op_1029_cast_fp16")]; tensor var_1035 = const()[name = string("op_1035"), val = tensor([2, 0, 3, 1, 4])]; tensor query_13_begin_0 = const()[name = string("query_13_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_13_end_0 = const()[name = string("query_13_end_0"), val = tensor([1, 1, 4, 4, 64])]; tensor query_13_end_mask_0 = const()[name = string("query_13_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_13_squeeze_mask_0 = const()[name = string("query_13_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_11_cast_fp16 = transpose(perm = var_1035, x = var_1029_cast_fp16)[name = string("transpose_31")]; tensor query_13_cast_fp16 = slice_by_index(begin = query_13_begin_0, end = query_13_end_0, end_mask = query_13_end_mask_0, squeeze_mask = query_13_squeeze_mask_0, x = qkv_11_cast_fp16)[name = string("query_13_cast_fp16")]; tensor key_13_begin_0 = const()[name = string("key_13_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_13_end_0 = const()[name = string("key_13_end_0"), val = tensor([2, 1, 4, 4, 64])]; tensor key_13_end_mask_0 = const()[name = string("key_13_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_13_squeeze_mask_0 = const()[name = string("key_13_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_13_cast_fp16 = slice_by_index(begin = key_13_begin_0, end = key_13_end_0, end_mask = key_13_end_mask_0, squeeze_mask = key_13_squeeze_mask_0, x = qkv_11_cast_fp16)[name = string("key_13_cast_fp16")]; tensor value_5_begin_0 = const()[name = string("value_5_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_5_end_0 = const()[name = string("value_5_end_0"), val = tensor([3, 1, 4, 4, 64])]; tensor value_5_end_mask_0 = const()[name = string("value_5_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_5_squeeze_mask_0 = const()[name = string("value_5_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_5_cast_fp16 = slice_by_index(begin = value_5_begin_0, end = value_5_end_0, end_mask = value_5_end_mask_0, squeeze_mask = value_5_squeeze_mask_0, x = qkv_11_cast_fp16)[name = string("value_5_cast_fp16")]; tensor var_1051 = const()[name = string("op_1051"), val = tensor([1, 4, 4, 32, 2])]; tensor query_pairs_5_cast_fp16 = reshape(shape = var_1051, x = query_13_cast_fp16)[name = string("query_pairs_5_cast_fp16")]; tensor var_1058 = const()[name = string("op_1058"), val = tensor([1, 4, 4, 32, 2])]; tensor key_pairs_5_cast_fp16 = reshape(shape = var_1058, x = key_13_cast_fp16)[name = string("key_pairs_5_cast_fp16")]; tensor qr_5_begin_0 = const()[name = string("qr_5_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_5_end_0 = const()[name = string("qr_5_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor qr_5_end_mask_0 = const()[name = string("qr_5_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_5_squeeze_mask_0 = const()[name = string("qr_5_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_5_cast_fp16 = slice_by_index(begin = qr_5_begin_0, end = qr_5_end_0, end_mask = qr_5_end_mask_0, squeeze_mask = qr_5_squeeze_mask_0, x = query_pairs_5_cast_fp16)[name = string("qr_5_cast_fp16")]; tensor qi_5_begin_0 = const()[name = string("qi_5_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_5_end_0 = const()[name = string("qi_5_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor qi_5_end_mask_0 = const()[name = string("qi_5_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_5_squeeze_mask_0 = const()[name = string("qi_5_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_5_cast_fp16 = slice_by_index(begin = qi_5_begin_0, end = qi_5_end_0, end_mask = qi_5_end_mask_0, squeeze_mask = qi_5_squeeze_mask_0, x = query_pairs_5_cast_fp16)[name = string("qi_5_cast_fp16")]; tensor kr_5_begin_0 = const()[name = string("kr_5_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_5_end_0 = const()[name = string("kr_5_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor kr_5_end_mask_0 = const()[name = string("kr_5_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_5_squeeze_mask_0 = const()[name = string("kr_5_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_5_cast_fp16 = slice_by_index(begin = kr_5_begin_0, end = kr_5_end_0, end_mask = kr_5_end_mask_0, squeeze_mask = kr_5_squeeze_mask_0, x = key_pairs_5_cast_fp16)[name = string("kr_5_cast_fp16")]; tensor ki_5_begin_0 = const()[name = string("ki_5_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_5_end_0 = const()[name = string("ki_5_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor ki_5_end_mask_0 = const()[name = string("ki_5_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_5_squeeze_mask_0 = const()[name = string("ki_5_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_5_cast_fp16 = slice_by_index(begin = ki_5_begin_0, end = ki_5_end_0, end_mask = ki_5_end_mask_0, squeeze_mask = ki_5_squeeze_mask_0, x = key_pairs_5_cast_fp16)[name = string("ki_5_cast_fp16")]; tensor var_1072_cast_fp16 = mul(x = qr_5_cast_fp16, y = s0_cos)[name = string("op_1072_cast_fp16")]; tensor var_1073_cast_fp16 = mul(x = qi_5_cast_fp16, y = s0_sin)[name = string("op_1073_cast_fp16")]; tensor var_1075_cast_fp16 = sub(x = var_1072_cast_fp16, y = var_1073_cast_fp16)[name = string("op_1075_cast_fp16")]; tensor var_1076_cast_fp16 = mul(x = qr_5_cast_fp16, y = s0_sin)[name = string("op_1076_cast_fp16")]; tensor var_1077_cast_fp16 = mul(x = qi_5_cast_fp16, y = s0_cos)[name = string("op_1077_cast_fp16")]; tensor var_1079_cast_fp16 = add(x = var_1076_cast_fp16, y = var_1077_cast_fp16)[name = string("op_1079_cast_fp16")]; int32 query_15_axis_0 = const()[name = string("query_15_axis_0"), val = int32(-1)]; tensor query_15_cast_fp16 = stack(axis = query_15_axis_0, values = (var_1075_cast_fp16, var_1079_cast_fp16))[name = string("query_15_cast_fp16")]; tensor var_1083_cast_fp16 = mul(x = kr_5_cast_fp16, y = s0_cos)[name = string("op_1083_cast_fp16")]; tensor var_1084_cast_fp16 = mul(x = ki_5_cast_fp16, y = s0_sin)[name = string("op_1084_cast_fp16")]; tensor var_1086_cast_fp16 = sub(x = var_1083_cast_fp16, y = var_1084_cast_fp16)[name = string("op_1086_cast_fp16")]; tensor var_1087_cast_fp16 = mul(x = kr_5_cast_fp16, y = s0_sin)[name = string("op_1087_cast_fp16")]; tensor var_1088_cast_fp16 = mul(x = ki_5_cast_fp16, y = s0_cos)[name = string("op_1088_cast_fp16")]; tensor var_1090_cast_fp16 = add(x = var_1087_cast_fp16, y = var_1088_cast_fp16)[name = string("op_1090_cast_fp16")]; int32 key_15_axis_0 = const()[name = string("key_15_axis_0"), val = int32(-1)]; tensor key_15_cast_fp16 = stack(axis = key_15_axis_0, values = (var_1086_cast_fp16, var_1090_cast_fp16))[name = string("key_15_cast_fp16")]; tensor var_1098 = const()[name = string("op_1098"), val = tensor([1, 4, 4, 64])]; tensor query_17_cast_fp16 = reshape(shape = var_1098, x = query_15_cast_fp16)[name = string("query_17_cast_fp16")]; tensor var_1104 = const()[name = string("op_1104"), val = tensor([1, 4, 4, 64])]; tensor key_17_cast_fp16 = reshape(shape = var_1104, x = key_15_cast_fp16)[name = string("key_17_cast_fp16")]; tensor read_state_4 = read_state(input = s0_l2_k)[name = string("read_state_4")]; tensor var_1120_begin_0 = const()[name = string("op_1120_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_1120_end_0 = const()[name = string("op_1120_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_1120_end_mask_0 = const()[name = string("op_1120_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1120_cast_fp16 = slice_by_index(begin = var_1120_begin_0, end = var_1120_end_0, end_mask = var_1120_end_mask_0, x = read_state_4)[name = string("op_1120_cast_fp16")]; int32 var_1127 = const()[name = string("op_1127"), val = int32(2)]; bool new_key_5_interleave_0 = const()[name = string("new_key_5_interleave_0"), val = bool(false)]; tensor new_key_5_cast_fp16 = concat(axis = var_1127, interleave = new_key_5_interleave_0, values = (var_1120_cast_fp16, key_17_cast_fp16))[name = string("new_key_5_cast_fp16")]; tensor read_state_5 = read_state(input = s0_l2_v)[name = string("read_state_5")]; tensor var_1143_begin_0 = const()[name = string("op_1143_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_1143_end_0 = const()[name = string("op_1143_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_1143_end_mask_0 = const()[name = string("op_1143_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1143_cast_fp16 = slice_by_index(begin = var_1143_begin_0, end = var_1143_end_0, end_mask = var_1143_end_mask_0, x = read_state_5)[name = string("op_1143_cast_fp16")]; int32 var_1150 = const()[name = string("op_1150"), val = int32(2)]; bool new_value_5_interleave_0 = const()[name = string("new_value_5_interleave_0"), val = bool(false)]; tensor new_value_5_cast_fp16 = concat(axis = var_1150, interleave = new_value_5_interleave_0, values = (var_1143_cast_fp16, value_5_cast_fp16))[name = string("new_value_5_cast_fp16")]; tensor concat_8 = const()[name = string("concat_8"), val = tensor([0, 0, 0, 0])]; tensor concat_9 = const()[name = string("concat_9"), val = tensor([0, 0, 0, 0])]; tensor s0_l2_k_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l2_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l2_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l2_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l2_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l2_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l2_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l2_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l2_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_8, begin_mask = s0_l2_k_internal_tensor_assign_1_begin_mask_0, end = concat_9, end_mask = s0_l2_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l2_k_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l2_k_internal_tensor_assign_1_stride_0, update = new_key_5_cast_fp16, x = read_state_4)[name = string("s0_l2_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l2_k_internal_tensor_assign_1_cast_fp16, input = s0_l2_k)[name = string("coreml_update_state_28_write_state")]; tensor concat_10 = const()[name = string("concat_10"), val = tensor([0, 0, 0, 0])]; tensor concat_11 = const()[name = string("concat_11"), val = tensor([0, 0, 0, 0])]; tensor s0_l2_v_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l2_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l2_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l2_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l2_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l2_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l2_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l2_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l2_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_10, begin_mask = s0_l2_v_internal_tensor_assign_1_begin_mask_0, end = concat_11, end_mask = s0_l2_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l2_v_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l2_v_internal_tensor_assign_1_stride_0, update = new_value_5_cast_fp16, x = read_state_5)[name = string("s0_l2_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l2_v_internal_tensor_assign_1_cast_fp16, input = s0_l2_v)[name = string("coreml_update_state_29_write_state")]; bool var_1169_transpose_x_1 = const()[name = string("op_1169_transpose_x_1"), val = bool(false)]; bool var_1169_transpose_y_1 = const()[name = string("op_1169_transpose_y_1"), val = bool(true)]; tensor var_1169_cast_fp16 = matmul(transpose_x = var_1169_transpose_x_1, transpose_y = var_1169_transpose_y_1, x = query_17_cast_fp16, y = new_key_5_cast_fp16)[name = string("op_1169_cast_fp16")]; fp16 var_1170_to_fp16 = const()[name = string("op_1170_to_fp16"), val = fp16(0x1p-3)]; tensor scores_5_cast_fp16 = mul(x = var_1169_cast_fp16, y = var_1170_to_fp16)[name = string("scores_5_cast_fp16")]; tensor var_1173_cast_fp16 = add(x = scores_5_cast_fp16, y = s0_mask)[name = string("op_1173_cast_fp16")]; int32 var_1174 = const()[name = string("op_1174"), val = int32(-1)]; tensor probabilities_5_cast_fp16 = softmax(axis = var_1174, x = var_1173_cast_fp16)[name = string("probabilities_5_cast_fp16")]; bool attention_5_transpose_x_0 = const()[name = string("attention_5_transpose_x_0"), val = bool(false)]; bool attention_5_transpose_y_0 = const()[name = string("attention_5_transpose_y_0"), val = bool(false)]; tensor attention_5_cast_fp16 = matmul(transpose_x = attention_5_transpose_x_0, transpose_y = attention_5_transpose_y_0, x = probabilities_5_cast_fp16, y = new_value_5_cast_fp16)[name = string("attention_5_cast_fp16")]; tensor var_1180_perm_0 = const()[name = string("op_1180_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_1184 = const()[name = string("op_1184"), val = tensor([1, 4, 256])]; tensor var_1180_cast_fp16 = transpose(perm = var_1180_perm_0, x = attention_5_cast_fp16)[name = string("transpose_30")]; tensor input_35_cast_fp16 = reshape(shape = var_1184, x = var_1180_cast_fp16)[name = string("input_35_cast_fp16")]; tensor stages_0_transformer_layers_2_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3650304)))]; tensor linear_10_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_2_self_attn_out_proj_weight_to_fp16, x = input_35_cast_fp16)[name = string("linear_10_cast_fp16")]; tensor stages_0_transformer_layers_2_layer_scale_1_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_2_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3781440)))]; tensor var_1190_cast_fp16 = mul(x = stages_0_transformer_layers_2_layer_scale_1_scale_to_fp16, y = linear_10_cast_fp16)[name = string("op_1190_cast_fp16")]; tensor input_37_cast_fp16 = add(x = input_31_cast_fp16, y = var_1190_cast_fp16)[name = string("input_37_cast_fp16")]; tensor input_39_axes_0 = const()[name = string("input_39_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_2_norm2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3782016)))]; tensor stages_0_transformer_layers_2_norm2_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_2_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3782592)))]; fp16 var_1194_to_fp16 = const()[name = string("op_1194_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_39_cast_fp16 = layer_norm(axes = input_39_axes_0, beta = stages_0_transformer_layers_2_norm2_bias_to_fp16, epsilon = var_1194_to_fp16, gamma = stages_0_transformer_layers_2_norm2_weight_to_fp16, x = input_37_cast_fp16)[name = string("input_39_cast_fp16")]; tensor stages_0_transformer_layers_2_ffn_0_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(3783168)))]; tensor linear_11_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_0_transformer_layers_2_ffn_0_weight_to_fp16, x = input_39_cast_fp16)[name = string("linear_11_cast_fp16")]; string input_43_mode_0 = const()[name = string("input_43_mode_0"), val = string("EXACT")]; tensor input_43_cast_fp16 = gelu(mode = input_43_mode_0, x = linear_11_cast_fp16)[name = string("input_43_cast_fp16")]; tensor stages_0_transformer_layers_2_ffn_2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_2_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(4307520)))]; tensor linear_12_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_2_ffn_2_weight_to_fp16, x = input_43_cast_fp16)[name = string("linear_12_cast_fp16")]; tensor stages_0_transformer_layers_2_layer_scale_2_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_2_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(4831872)))]; tensor var_1210_cast_fp16 = mul(x = stages_0_transformer_layers_2_layer_scale_2_scale_to_fp16, y = linear_12_cast_fp16)[name = string("op_1210_cast_fp16")]; tensor input_45_cast_fp16 = add(x = input_37_cast_fp16, y = var_1210_cast_fp16)[name = string("input_45_cast_fp16")]; tensor input_47_axes_0 = const()[name = string("input_47_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_3_norm1_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(4832448)))]; tensor stages_0_transformer_layers_3_norm1_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_3_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(4833024)))]; fp16 var_1214_to_fp16 = const()[name = string("op_1214_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_47_cast_fp16 = layer_norm(axes = input_47_axes_0, beta = stages_0_transformer_layers_3_norm1_bias_to_fp16, epsilon = var_1214_to_fp16, gamma = stages_0_transformer_layers_3_norm1_weight_to_fp16, x = input_45_cast_fp16)[name = string("input_47_cast_fp16")]; tensor stages_0_transformer_layers_3_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(4833600)))]; tensor linear_13_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_0_transformer_layers_3_self_attn_in_proj_weight_to_fp16, x = input_47_cast_fp16)[name = string("linear_13_cast_fp16")]; tensor var_1228 = const()[name = string("op_1228"), val = tensor([1, 4, 3, 4, 64])]; tensor var_1229_cast_fp16 = reshape(shape = var_1228, x = linear_13_cast_fp16)[name = string("op_1229_cast_fp16")]; tensor var_1235 = const()[name = string("op_1235"), val = tensor([2, 0, 3, 1, 4])]; tensor query_19_begin_0 = const()[name = string("query_19_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_19_end_0 = const()[name = string("query_19_end_0"), val = tensor([1, 1, 4, 4, 64])]; tensor query_19_end_mask_0 = const()[name = string("query_19_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_19_squeeze_mask_0 = const()[name = string("query_19_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_15_cast_fp16 = transpose(perm = var_1235, x = var_1229_cast_fp16)[name = string("transpose_29")]; tensor query_19_cast_fp16 = slice_by_index(begin = query_19_begin_0, end = query_19_end_0, end_mask = query_19_end_mask_0, squeeze_mask = query_19_squeeze_mask_0, x = qkv_15_cast_fp16)[name = string("query_19_cast_fp16")]; tensor key_19_begin_0 = const()[name = string("key_19_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_19_end_0 = const()[name = string("key_19_end_0"), val = tensor([2, 1, 4, 4, 64])]; tensor key_19_end_mask_0 = const()[name = string("key_19_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_19_squeeze_mask_0 = const()[name = string("key_19_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_19_cast_fp16 = slice_by_index(begin = key_19_begin_0, end = key_19_end_0, end_mask = key_19_end_mask_0, squeeze_mask = key_19_squeeze_mask_0, x = qkv_15_cast_fp16)[name = string("key_19_cast_fp16")]; tensor value_7_begin_0 = const()[name = string("value_7_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_7_end_0 = const()[name = string("value_7_end_0"), val = tensor([3, 1, 4, 4, 64])]; tensor value_7_end_mask_0 = const()[name = string("value_7_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_7_squeeze_mask_0 = const()[name = string("value_7_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_7_cast_fp16 = slice_by_index(begin = value_7_begin_0, end = value_7_end_0, end_mask = value_7_end_mask_0, squeeze_mask = value_7_squeeze_mask_0, x = qkv_15_cast_fp16)[name = string("value_7_cast_fp16")]; tensor var_1251 = const()[name = string("op_1251"), val = tensor([1, 4, 4, 32, 2])]; tensor query_pairs_7_cast_fp16 = reshape(shape = var_1251, x = query_19_cast_fp16)[name = string("query_pairs_7_cast_fp16")]; tensor var_1258 = const()[name = string("op_1258"), val = tensor([1, 4, 4, 32, 2])]; tensor key_pairs_7_cast_fp16 = reshape(shape = var_1258, x = key_19_cast_fp16)[name = string("key_pairs_7_cast_fp16")]; tensor qr_7_begin_0 = const()[name = string("qr_7_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_7_end_0 = const()[name = string("qr_7_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor qr_7_end_mask_0 = const()[name = string("qr_7_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_7_squeeze_mask_0 = const()[name = string("qr_7_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_7_cast_fp16 = slice_by_index(begin = qr_7_begin_0, end = qr_7_end_0, end_mask = qr_7_end_mask_0, squeeze_mask = qr_7_squeeze_mask_0, x = query_pairs_7_cast_fp16)[name = string("qr_7_cast_fp16")]; tensor qi_7_begin_0 = const()[name = string("qi_7_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_7_end_0 = const()[name = string("qi_7_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor qi_7_end_mask_0 = const()[name = string("qi_7_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_7_squeeze_mask_0 = const()[name = string("qi_7_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_7_cast_fp16 = slice_by_index(begin = qi_7_begin_0, end = qi_7_end_0, end_mask = qi_7_end_mask_0, squeeze_mask = qi_7_squeeze_mask_0, x = query_pairs_7_cast_fp16)[name = string("qi_7_cast_fp16")]; tensor kr_7_begin_0 = const()[name = string("kr_7_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_7_end_0 = const()[name = string("kr_7_end_0"), val = tensor([1, 4, 4, 32, 1])]; tensor kr_7_end_mask_0 = const()[name = string("kr_7_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_7_squeeze_mask_0 = const()[name = string("kr_7_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_7_cast_fp16 = slice_by_index(begin = kr_7_begin_0, end = kr_7_end_0, end_mask = kr_7_end_mask_0, squeeze_mask = kr_7_squeeze_mask_0, x = key_pairs_7_cast_fp16)[name = string("kr_7_cast_fp16")]; tensor ki_7_begin_0 = const()[name = string("ki_7_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_7_end_0 = const()[name = string("ki_7_end_0"), val = tensor([1, 4, 4, 32, 2])]; tensor ki_7_end_mask_0 = const()[name = string("ki_7_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_7_squeeze_mask_0 = const()[name = string("ki_7_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_7_cast_fp16 = slice_by_index(begin = ki_7_begin_0, end = ki_7_end_0, end_mask = ki_7_end_mask_0, squeeze_mask = ki_7_squeeze_mask_0, x = key_pairs_7_cast_fp16)[name = string("ki_7_cast_fp16")]; tensor var_1272_cast_fp16 = mul(x = qr_7_cast_fp16, y = s0_cos)[name = string("op_1272_cast_fp16")]; tensor var_1273_cast_fp16 = mul(x = qi_7_cast_fp16, y = s0_sin)[name = string("op_1273_cast_fp16")]; tensor var_1275_cast_fp16 = sub(x = var_1272_cast_fp16, y = var_1273_cast_fp16)[name = string("op_1275_cast_fp16")]; tensor var_1276_cast_fp16 = mul(x = qr_7_cast_fp16, y = s0_sin)[name = string("op_1276_cast_fp16")]; tensor var_1277_cast_fp16 = mul(x = qi_7_cast_fp16, y = s0_cos)[name = string("op_1277_cast_fp16")]; tensor var_1279_cast_fp16 = add(x = var_1276_cast_fp16, y = var_1277_cast_fp16)[name = string("op_1279_cast_fp16")]; int32 query_21_axis_0 = const()[name = string("query_21_axis_0"), val = int32(-1)]; tensor query_21_cast_fp16 = stack(axis = query_21_axis_0, values = (var_1275_cast_fp16, var_1279_cast_fp16))[name = string("query_21_cast_fp16")]; tensor var_1283_cast_fp16 = mul(x = kr_7_cast_fp16, y = s0_cos)[name = string("op_1283_cast_fp16")]; tensor var_1284_cast_fp16 = mul(x = ki_7_cast_fp16, y = s0_sin)[name = string("op_1284_cast_fp16")]; tensor var_1286_cast_fp16 = sub(x = var_1283_cast_fp16, y = var_1284_cast_fp16)[name = string("op_1286_cast_fp16")]; tensor var_1287_cast_fp16 = mul(x = kr_7_cast_fp16, y = s0_sin)[name = string("op_1287_cast_fp16")]; tensor var_1288_cast_fp16 = mul(x = ki_7_cast_fp16, y = s0_cos)[name = string("op_1288_cast_fp16")]; tensor var_1290_cast_fp16 = add(x = var_1287_cast_fp16, y = var_1288_cast_fp16)[name = string("op_1290_cast_fp16")]; int32 key_21_axis_0 = const()[name = string("key_21_axis_0"), val = int32(-1)]; tensor key_21_cast_fp16 = stack(axis = key_21_axis_0, values = (var_1286_cast_fp16, var_1290_cast_fp16))[name = string("key_21_cast_fp16")]; tensor var_1298 = const()[name = string("op_1298"), val = tensor([1, 4, 4, 64])]; tensor query_23_cast_fp16 = reshape(shape = var_1298, x = query_21_cast_fp16)[name = string("query_23_cast_fp16")]; tensor var_1304 = const()[name = string("op_1304"), val = tensor([1, 4, 4, 64])]; tensor key_23_cast_fp16 = reshape(shape = var_1304, x = key_21_cast_fp16)[name = string("key_23_cast_fp16")]; tensor read_state_6 = read_state(input = s0_l3_k)[name = string("read_state_6")]; tensor var_1320_begin_0 = const()[name = string("op_1320_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_1320_end_0 = const()[name = string("op_1320_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_1320_end_mask_0 = const()[name = string("op_1320_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1320_cast_fp16 = slice_by_index(begin = var_1320_begin_0, end = var_1320_end_0, end_mask = var_1320_end_mask_0, x = read_state_6)[name = string("op_1320_cast_fp16")]; int32 var_1327 = const()[name = string("op_1327"), val = int32(2)]; bool new_key_7_interleave_0 = const()[name = string("new_key_7_interleave_0"), val = bool(false)]; tensor new_key_7_cast_fp16 = concat(axis = var_1327, interleave = new_key_7_interleave_0, values = (var_1320_cast_fp16, key_23_cast_fp16))[name = string("new_key_7_cast_fp16")]; tensor read_state_7 = read_state(input = s0_l3_v)[name = string("read_state_7")]; tensor var_1343_begin_0 = const()[name = string("op_1343_begin_0"), val = tensor([0, 0, 4, 0])]; tensor var_1343_end_0 = const()[name = string("op_1343_end_0"), val = tensor([1, 4, 500, 64])]; tensor var_1343_end_mask_0 = const()[name = string("op_1343_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1343_cast_fp16 = slice_by_index(begin = var_1343_begin_0, end = var_1343_end_0, end_mask = var_1343_end_mask_0, x = read_state_7)[name = string("op_1343_cast_fp16")]; int32 var_1350 = const()[name = string("op_1350"), val = int32(2)]; bool new_value_7_interleave_0 = const()[name = string("new_value_7_interleave_0"), val = bool(false)]; tensor new_value_7_cast_fp16 = concat(axis = var_1350, interleave = new_value_7_interleave_0, values = (var_1343_cast_fp16, value_7_cast_fp16))[name = string("new_value_7_cast_fp16")]; tensor concat_12 = const()[name = string("concat_12"), val = tensor([0, 0, 0, 0])]; tensor concat_13 = const()[name = string("concat_13"), val = tensor([0, 0, 0, 0])]; tensor s0_l3_k_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l3_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l3_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l3_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l3_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l3_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l3_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l3_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l3_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_12, begin_mask = s0_l3_k_internal_tensor_assign_1_begin_mask_0, end = concat_13, end_mask = s0_l3_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l3_k_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l3_k_internal_tensor_assign_1_stride_0, update = new_key_7_cast_fp16, x = read_state_6)[name = string("s0_l3_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l3_k_internal_tensor_assign_1_cast_fp16, input = s0_l3_k)[name = string("coreml_update_state_30_write_state")]; tensor concat_14 = const()[name = string("concat_14"), val = tensor([0, 0, 0, 0])]; tensor concat_15 = const()[name = string("concat_15"), val = tensor([0, 0, 0, 0])]; tensor s0_l3_v_internal_tensor_assign_1_stride_0 = const()[name = string("s0_l3_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s0_l3_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s0_l3_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s0_l3_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s0_l3_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s0_l3_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s0_l3_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s0_l3_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_14, begin_mask = s0_l3_v_internal_tensor_assign_1_begin_mask_0, end = concat_15, end_mask = s0_l3_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s0_l3_v_internal_tensor_assign_1_squeeze_mask_0, stride = s0_l3_v_internal_tensor_assign_1_stride_0, update = new_value_7_cast_fp16, x = read_state_7)[name = string("s0_l3_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s0_l3_v_internal_tensor_assign_1_cast_fp16, input = s0_l3_v)[name = string("coreml_update_state_31_write_state")]; bool var_1369_transpose_x_1 = const()[name = string("op_1369_transpose_x_1"), val = bool(false)]; bool var_1369_transpose_y_1 = const()[name = string("op_1369_transpose_y_1"), val = bool(true)]; tensor var_1369_cast_fp16 = matmul(transpose_x = var_1369_transpose_x_1, transpose_y = var_1369_transpose_y_1, x = query_23_cast_fp16, y = new_key_7_cast_fp16)[name = string("op_1369_cast_fp16")]; fp16 var_1370_to_fp16 = const()[name = string("op_1370_to_fp16"), val = fp16(0x1p-3)]; tensor scores_7_cast_fp16 = mul(x = var_1369_cast_fp16, y = var_1370_to_fp16)[name = string("scores_7_cast_fp16")]; tensor var_1373_cast_fp16 = add(x = scores_7_cast_fp16, y = s0_mask)[name = string("op_1373_cast_fp16")]; int32 var_1374 = const()[name = string("op_1374"), val = int32(-1)]; tensor probabilities_7_cast_fp16 = softmax(axis = var_1374, x = var_1373_cast_fp16)[name = string("probabilities_7_cast_fp16")]; bool attention_7_transpose_x_0 = const()[name = string("attention_7_transpose_x_0"), val = bool(false)]; bool attention_7_transpose_y_0 = const()[name = string("attention_7_transpose_y_0"), val = bool(false)]; tensor attention_7_cast_fp16 = matmul(transpose_x = attention_7_transpose_x_0, transpose_y = attention_7_transpose_y_0, x = probabilities_7_cast_fp16, y = new_value_7_cast_fp16)[name = string("attention_7_cast_fp16")]; tensor var_1380_perm_0 = const()[name = string("op_1380_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_1384 = const()[name = string("op_1384"), val = tensor([1, 4, 256])]; tensor var_1380_cast_fp16 = transpose(perm = var_1380_perm_0, x = attention_7_cast_fp16)[name = string("transpose_28")]; tensor input_49_cast_fp16 = reshape(shape = var_1384, x = var_1380_cast_fp16)[name = string("input_49_cast_fp16")]; tensor stages_0_transformer_layers_3_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5226880)))]; tensor linear_14_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_3_self_attn_out_proj_weight_to_fp16, x = input_49_cast_fp16)[name = string("linear_14_cast_fp16")]; tensor stages_0_transformer_layers_3_layer_scale_1_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_3_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5358016)))]; tensor var_1390_cast_fp16 = mul(x = stages_0_transformer_layers_3_layer_scale_1_scale_to_fp16, y = linear_14_cast_fp16)[name = string("op_1390_cast_fp16")]; tensor input_51_cast_fp16 = add(x = input_45_cast_fp16, y = var_1390_cast_fp16)[name = string("input_51_cast_fp16")]; tensor input_53_axes_0 = const()[name = string("input_53_axes_0"), val = tensor([-1])]; tensor stages_0_transformer_layers_3_norm2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5358592)))]; tensor stages_0_transformer_layers_3_norm2_bias_to_fp16 = const()[name = string("stages_0_transformer_layers_3_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5359168)))]; fp16 var_1394_to_fp16 = const()[name = string("op_1394_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_53_cast_fp16 = layer_norm(axes = input_53_axes_0, beta = stages_0_transformer_layers_3_norm2_bias_to_fp16, epsilon = var_1394_to_fp16, gamma = stages_0_transformer_layers_3_norm2_weight_to_fp16, x = input_51_cast_fp16)[name = string("input_53_cast_fp16")]; tensor stages_0_transformer_layers_3_ffn_0_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5359744)))]; tensor linear_15_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_0_transformer_layers_3_ffn_0_weight_to_fp16, x = input_53_cast_fp16)[name = string("linear_15_cast_fp16")]; string input_57_mode_0 = const()[name = string("input_57_mode_0"), val = string("EXACT")]; tensor input_57_cast_fp16 = gelu(mode = input_57_mode_0, x = linear_15_cast_fp16)[name = string("input_57_cast_fp16")]; tensor stages_0_transformer_layers_3_ffn_2_weight_to_fp16 = const()[name = string("stages_0_transformer_layers_3_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(5884096)))]; tensor linear_16_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_0_transformer_layers_3_ffn_2_weight_to_fp16, x = input_57_cast_fp16)[name = string("linear_16_cast_fp16")]; tensor stages_0_transformer_layers_3_layer_scale_2_scale_to_fp16 = const()[name = string("stages_0_transformer_layers_3_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(6408448)))]; tensor var_1410_cast_fp16 = mul(x = stages_0_transformer_layers_3_layer_scale_2_scale_to_fp16, y = linear_16_cast_fp16)[name = string("op_1410_cast_fp16")]; tensor input_59_cast_fp16 = add(x = input_51_cast_fp16, y = var_1410_cast_fp16)[name = string("input_59_cast_fp16")]; tensor stages_0_output_proj_weight_to_fp16 = const()[name = string("stages_0_output_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(6409024)))]; tensor linear_17_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_0_output_proj_weight_to_fp16, x = input_59_cast_fp16)[name = string("linear_17_cast_fp16")]; tensor x_19_perm_0 = const()[name = string("x_19_perm_0"), val = tensor([0, 2, 1])]; tensor var_1423 = const()[name = string("op_1423"), val = tensor([1, 384, 2, 4])]; tensor x_19_cast_fp16 = transpose(perm = x_19_perm_0, x = linear_17_cast_fp16)[name = string("transpose_27")]; tensor var_1424_cast_fp16 = reshape(shape = var_1423, x = x_19_cast_fp16)[name = string("op_1424_cast_fp16")]; tensor var_1429 = const()[name = string("op_1429"), val = tensor([0, 1, 3, 2])]; tensor var_1434 = const()[name = string("op_1434"), val = tensor([1, 384, 8])]; tensor var_1430_cast_fp16 = transpose(perm = var_1429, x = var_1424_cast_fp16)[name = string("transpose_26")]; tensor x_21_cast_fp16 = reshape(shape = var_1434, x = var_1430_cast_fp16)[name = string("x_21_cast_fp16")]; tensor input_61_perm_0 = const()[name = string("input_61_perm_0"), val = tensor([0, 2, 1])]; tensor stages_1_input_proj_weight_to_fp16 = const()[name = string("stages_1_input_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(6802304)))]; tensor input_61_cast_fp16 = transpose(perm = input_61_perm_0, x = x_21_cast_fp16)[name = string("transpose_25")]; tensor linear_18_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_1_input_proj_weight_to_fp16, x = input_61_cast_fp16)[name = string("linear_18_cast_fp16")]; tensor input_65_axes_0 = const()[name = string("input_65_axes_0"), val = tensor([-1])]; tensor stages_1_transformer_layers_0_norm1_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(6998976)))]; tensor stages_1_transformer_layers_0_norm1_bias_to_fp16 = const()[name = string("stages_1_transformer_layers_0_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(6999552)))]; fp16 var_1443_to_fp16 = const()[name = string("op_1443_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_65_cast_fp16 = layer_norm(axes = input_65_axes_0, beta = stages_1_transformer_layers_0_norm1_bias_to_fp16, epsilon = var_1443_to_fp16, gamma = stages_1_transformer_layers_0_norm1_weight_to_fp16, x = linear_18_cast_fp16)[name = string("input_65_cast_fp16")]; tensor stages_1_transformer_layers_0_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7000128)))]; tensor linear_19_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_1_transformer_layers_0_self_attn_in_proj_weight_to_fp16, x = input_65_cast_fp16)[name = string("linear_19_cast_fp16")]; tensor var_1457 = const()[name = string("op_1457"), val = tensor([1, 8, 3, 4, 64])]; tensor var_1458_cast_fp16 = reshape(shape = var_1457, x = linear_19_cast_fp16)[name = string("op_1458_cast_fp16")]; tensor var_1464 = const()[name = string("op_1464"), val = tensor([2, 0, 3, 1, 4])]; tensor query_25_begin_0 = const()[name = string("query_25_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_25_end_0 = const()[name = string("query_25_end_0"), val = tensor([1, 1, 4, 8, 64])]; tensor query_25_end_mask_0 = const()[name = string("query_25_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_25_squeeze_mask_0 = const()[name = string("query_25_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_19_cast_fp16 = transpose(perm = var_1464, x = var_1458_cast_fp16)[name = string("transpose_24")]; tensor query_25_cast_fp16 = slice_by_index(begin = query_25_begin_0, end = query_25_end_0, end_mask = query_25_end_mask_0, squeeze_mask = query_25_squeeze_mask_0, x = qkv_19_cast_fp16)[name = string("query_25_cast_fp16")]; tensor key_25_begin_0 = const()[name = string("key_25_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_25_end_0 = const()[name = string("key_25_end_0"), val = tensor([2, 1, 4, 8, 64])]; tensor key_25_end_mask_0 = const()[name = string("key_25_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_25_squeeze_mask_0 = const()[name = string("key_25_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_25_cast_fp16 = slice_by_index(begin = key_25_begin_0, end = key_25_end_0, end_mask = key_25_end_mask_0, squeeze_mask = key_25_squeeze_mask_0, x = qkv_19_cast_fp16)[name = string("key_25_cast_fp16")]; tensor value_9_begin_0 = const()[name = string("value_9_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_9_end_0 = const()[name = string("value_9_end_0"), val = tensor([3, 1, 4, 8, 64])]; tensor value_9_end_mask_0 = const()[name = string("value_9_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_9_squeeze_mask_0 = const()[name = string("value_9_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_9_cast_fp16 = slice_by_index(begin = value_9_begin_0, end = value_9_end_0, end_mask = value_9_end_mask_0, squeeze_mask = value_9_squeeze_mask_0, x = qkv_19_cast_fp16)[name = string("value_9_cast_fp16")]; tensor var_1480 = const()[name = string("op_1480"), val = tensor([1, 4, 8, 32, 2])]; tensor query_pairs_9_cast_fp16 = reshape(shape = var_1480, x = query_25_cast_fp16)[name = string("query_pairs_9_cast_fp16")]; tensor var_1487 = const()[name = string("op_1487"), val = tensor([1, 4, 8, 32, 2])]; tensor key_pairs_9_cast_fp16 = reshape(shape = var_1487, x = key_25_cast_fp16)[name = string("key_pairs_9_cast_fp16")]; tensor qr_9_begin_0 = const()[name = string("qr_9_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_9_end_0 = const()[name = string("qr_9_end_0"), val = tensor([1, 4, 8, 32, 1])]; tensor qr_9_end_mask_0 = const()[name = string("qr_9_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_9_squeeze_mask_0 = const()[name = string("qr_9_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_9_cast_fp16 = slice_by_index(begin = qr_9_begin_0, end = qr_9_end_0, end_mask = qr_9_end_mask_0, squeeze_mask = qr_9_squeeze_mask_0, x = query_pairs_9_cast_fp16)[name = string("qr_9_cast_fp16")]; tensor qi_9_begin_0 = const()[name = string("qi_9_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_9_end_0 = const()[name = string("qi_9_end_0"), val = tensor([1, 4, 8, 32, 2])]; tensor qi_9_end_mask_0 = const()[name = string("qi_9_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_9_squeeze_mask_0 = const()[name = string("qi_9_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_9_cast_fp16 = slice_by_index(begin = qi_9_begin_0, end = qi_9_end_0, end_mask = qi_9_end_mask_0, squeeze_mask = qi_9_squeeze_mask_0, x = query_pairs_9_cast_fp16)[name = string("qi_9_cast_fp16")]; tensor kr_9_begin_0 = const()[name = string("kr_9_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_9_end_0 = const()[name = string("kr_9_end_0"), val = tensor([1, 4, 8, 32, 1])]; tensor kr_9_end_mask_0 = const()[name = string("kr_9_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_9_squeeze_mask_0 = const()[name = string("kr_9_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_9_cast_fp16 = slice_by_index(begin = kr_9_begin_0, end = kr_9_end_0, end_mask = kr_9_end_mask_0, squeeze_mask = kr_9_squeeze_mask_0, x = key_pairs_9_cast_fp16)[name = string("kr_9_cast_fp16")]; tensor ki_9_begin_0 = const()[name = string("ki_9_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_9_end_0 = const()[name = string("ki_9_end_0"), val = tensor([1, 4, 8, 32, 2])]; tensor ki_9_end_mask_0 = const()[name = string("ki_9_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_9_squeeze_mask_0 = const()[name = string("ki_9_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_9_cast_fp16 = slice_by_index(begin = ki_9_begin_0, end = ki_9_end_0, end_mask = ki_9_end_mask_0, squeeze_mask = ki_9_squeeze_mask_0, x = key_pairs_9_cast_fp16)[name = string("ki_9_cast_fp16")]; tensor var_1501_cast_fp16 = mul(x = qr_9_cast_fp16, y = s1_cos)[name = string("op_1501_cast_fp16")]; tensor var_1502_cast_fp16 = mul(x = qi_9_cast_fp16, y = s1_sin)[name = string("op_1502_cast_fp16")]; tensor var_1504_cast_fp16 = sub(x = var_1501_cast_fp16, y = var_1502_cast_fp16)[name = string("op_1504_cast_fp16")]; tensor var_1505_cast_fp16 = mul(x = qr_9_cast_fp16, y = s1_sin)[name = string("op_1505_cast_fp16")]; tensor var_1506_cast_fp16 = mul(x = qi_9_cast_fp16, y = s1_cos)[name = string("op_1506_cast_fp16")]; tensor var_1508_cast_fp16 = add(x = var_1505_cast_fp16, y = var_1506_cast_fp16)[name = string("op_1508_cast_fp16")]; int32 query_27_axis_0 = const()[name = string("query_27_axis_0"), val = int32(-1)]; tensor query_27_cast_fp16 = stack(axis = query_27_axis_0, values = (var_1504_cast_fp16, var_1508_cast_fp16))[name = string("query_27_cast_fp16")]; tensor var_1512_cast_fp16 = mul(x = kr_9_cast_fp16, y = s1_cos)[name = string("op_1512_cast_fp16")]; tensor var_1513_cast_fp16 = mul(x = ki_9_cast_fp16, y = s1_sin)[name = string("op_1513_cast_fp16")]; tensor var_1515_cast_fp16 = sub(x = var_1512_cast_fp16, y = var_1513_cast_fp16)[name = string("op_1515_cast_fp16")]; tensor var_1516_cast_fp16 = mul(x = kr_9_cast_fp16, y = s1_sin)[name = string("op_1516_cast_fp16")]; tensor var_1517_cast_fp16 = mul(x = ki_9_cast_fp16, y = s1_cos)[name = string("op_1517_cast_fp16")]; tensor var_1519_cast_fp16 = add(x = var_1516_cast_fp16, y = var_1517_cast_fp16)[name = string("op_1519_cast_fp16")]; int32 key_27_axis_0 = const()[name = string("key_27_axis_0"), val = int32(-1)]; tensor key_27_cast_fp16 = stack(axis = key_27_axis_0, values = (var_1515_cast_fp16, var_1519_cast_fp16))[name = string("key_27_cast_fp16")]; tensor var_1527 = const()[name = string("op_1527"), val = tensor([1, 4, 8, 64])]; tensor query_29_cast_fp16 = reshape(shape = var_1527, x = query_27_cast_fp16)[name = string("query_29_cast_fp16")]; tensor var_1533 = const()[name = string("op_1533"), val = tensor([1, 4, 8, 64])]; tensor key_29_cast_fp16 = reshape(shape = var_1533, x = key_27_cast_fp16)[name = string("key_29_cast_fp16")]; tensor read_state_8 = read_state(input = s1_l0_k)[name = string("read_state_8")]; tensor var_1549_begin_0 = const()[name = string("op_1549_begin_0"), val = tensor([0, 0, 8, 0])]; tensor var_1549_end_0 = const()[name = string("op_1549_end_0"), val = tensor([1, 4, 800, 64])]; tensor var_1549_end_mask_0 = const()[name = string("op_1549_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1549_cast_fp16 = slice_by_index(begin = var_1549_begin_0, end = var_1549_end_0, end_mask = var_1549_end_mask_0, x = read_state_8)[name = string("op_1549_cast_fp16")]; int32 var_1556 = const()[name = string("op_1556"), val = int32(2)]; bool new_key_9_interleave_0 = const()[name = string("new_key_9_interleave_0"), val = bool(false)]; tensor new_key_9_cast_fp16 = concat(axis = var_1556, interleave = new_key_9_interleave_0, values = (var_1549_cast_fp16, key_29_cast_fp16))[name = string("new_key_9_cast_fp16")]; tensor read_state_9 = read_state(input = s1_l0_v)[name = string("read_state_9")]; tensor var_1572_begin_0 = const()[name = string("op_1572_begin_0"), val = tensor([0, 0, 8, 0])]; tensor var_1572_end_0 = const()[name = string("op_1572_end_0"), val = tensor([1, 4, 800, 64])]; tensor var_1572_end_mask_0 = const()[name = string("op_1572_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1572_cast_fp16 = slice_by_index(begin = var_1572_begin_0, end = var_1572_end_0, end_mask = var_1572_end_mask_0, x = read_state_9)[name = string("op_1572_cast_fp16")]; int32 var_1579 = const()[name = string("op_1579"), val = int32(2)]; bool new_value_9_interleave_0 = const()[name = string("new_value_9_interleave_0"), val = bool(false)]; tensor new_value_9_cast_fp16 = concat(axis = var_1579, interleave = new_value_9_interleave_0, values = (var_1572_cast_fp16, value_9_cast_fp16))[name = string("new_value_9_cast_fp16")]; tensor concat_16 = const()[name = string("concat_16"), val = tensor([0, 0, 0, 0])]; tensor concat_17 = const()[name = string("concat_17"), val = tensor([0, 0, 0, 0])]; tensor s1_l0_k_internal_tensor_assign_1_stride_0 = const()[name = string("s1_l0_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s1_l0_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s1_l0_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s1_l0_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s1_l0_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s1_l0_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s1_l0_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s1_l0_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_16, begin_mask = s1_l0_k_internal_tensor_assign_1_begin_mask_0, end = concat_17, end_mask = s1_l0_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s1_l0_k_internal_tensor_assign_1_squeeze_mask_0, stride = s1_l0_k_internal_tensor_assign_1_stride_0, update = new_key_9_cast_fp16, x = read_state_8)[name = string("s1_l0_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s1_l0_k_internal_tensor_assign_1_cast_fp16, input = s1_l0_k)[name = string("coreml_update_state_32_write_state")]; tensor concat_18 = const()[name = string("concat_18"), val = tensor([0, 0, 0, 0])]; tensor concat_19 = const()[name = string("concat_19"), val = tensor([0, 0, 0, 0])]; tensor s1_l0_v_internal_tensor_assign_1_stride_0 = const()[name = string("s1_l0_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s1_l0_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s1_l0_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s1_l0_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s1_l0_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s1_l0_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s1_l0_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s1_l0_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_18, begin_mask = s1_l0_v_internal_tensor_assign_1_begin_mask_0, end = concat_19, end_mask = s1_l0_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s1_l0_v_internal_tensor_assign_1_squeeze_mask_0, stride = s1_l0_v_internal_tensor_assign_1_stride_0, update = new_value_9_cast_fp16, x = read_state_9)[name = string("s1_l0_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s1_l0_v_internal_tensor_assign_1_cast_fp16, input = s1_l0_v)[name = string("coreml_update_state_33_write_state")]; bool var_1598_transpose_x_1 = const()[name = string("op_1598_transpose_x_1"), val = bool(false)]; bool var_1598_transpose_y_1 = const()[name = string("op_1598_transpose_y_1"), val = bool(true)]; tensor var_1598_cast_fp16 = matmul(transpose_x = var_1598_transpose_x_1, transpose_y = var_1598_transpose_y_1, x = query_29_cast_fp16, y = new_key_9_cast_fp16)[name = string("op_1598_cast_fp16")]; fp16 var_1599_to_fp16 = const()[name = string("op_1599_to_fp16"), val = fp16(0x1p-3)]; tensor scores_9_cast_fp16 = mul(x = var_1598_cast_fp16, y = var_1599_to_fp16)[name = string("scores_9_cast_fp16")]; tensor var_1602_cast_fp16 = add(x = scores_9_cast_fp16, y = s1_mask)[name = string("op_1602_cast_fp16")]; int32 var_1603 = const()[name = string("op_1603"), val = int32(-1)]; tensor probabilities_9_cast_fp16 = softmax(axis = var_1603, x = var_1602_cast_fp16)[name = string("probabilities_9_cast_fp16")]; bool attention_9_transpose_x_0 = const()[name = string("attention_9_transpose_x_0"), val = bool(false)]; bool attention_9_transpose_y_0 = const()[name = string("attention_9_transpose_y_0"), val = bool(false)]; tensor attention_9_cast_fp16 = matmul(transpose_x = attention_9_transpose_x_0, transpose_y = attention_9_transpose_y_0, x = probabilities_9_cast_fp16, y = new_value_9_cast_fp16)[name = string("attention_9_cast_fp16")]; tensor var_1609_perm_0 = const()[name = string("op_1609_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_1613 = const()[name = string("op_1613"), val = tensor([1, 8, 256])]; tensor var_1609_cast_fp16 = transpose(perm = var_1609_perm_0, x = attention_9_cast_fp16)[name = string("transpose_23")]; tensor input_67_cast_fp16 = reshape(shape = var_1613, x = var_1609_cast_fp16)[name = string("input_67_cast_fp16")]; tensor stages_1_transformer_layers_0_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7393408)))]; tensor linear_20_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_1_transformer_layers_0_self_attn_out_proj_weight_to_fp16, x = input_67_cast_fp16)[name = string("linear_20_cast_fp16")]; tensor stages_1_transformer_layers_0_layer_scale_1_scale_to_fp16 = const()[name = string("stages_1_transformer_layers_0_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7524544)))]; tensor var_1619_cast_fp16 = mul(x = stages_1_transformer_layers_0_layer_scale_1_scale_to_fp16, y = linear_20_cast_fp16)[name = string("op_1619_cast_fp16")]; tensor input_69_cast_fp16 = add(x = linear_18_cast_fp16, y = var_1619_cast_fp16)[name = string("input_69_cast_fp16")]; tensor input_71_axes_0 = const()[name = string("input_71_axes_0"), val = tensor([-1])]; tensor stages_1_transformer_layers_0_norm2_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7525120)))]; tensor stages_1_transformer_layers_0_norm2_bias_to_fp16 = const()[name = string("stages_1_transformer_layers_0_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7525696)))]; fp16 var_1623_to_fp16 = const()[name = string("op_1623_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_71_cast_fp16 = layer_norm(axes = input_71_axes_0, beta = stages_1_transformer_layers_0_norm2_bias_to_fp16, epsilon = var_1623_to_fp16, gamma = stages_1_transformer_layers_0_norm2_weight_to_fp16, x = input_69_cast_fp16)[name = string("input_71_cast_fp16")]; tensor stages_1_transformer_layers_0_ffn_0_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(7526272)))]; tensor linear_21_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_1_transformer_layers_0_ffn_0_weight_to_fp16, x = input_71_cast_fp16)[name = string("linear_21_cast_fp16")]; string input_75_mode_0 = const()[name = string("input_75_mode_0"), val = string("EXACT")]; tensor input_75_cast_fp16 = gelu(mode = input_75_mode_0, x = linear_21_cast_fp16)[name = string("input_75_cast_fp16")]; tensor stages_1_transformer_layers_0_ffn_2_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_0_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8050624)))]; tensor linear_22_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_1_transformer_layers_0_ffn_2_weight_to_fp16, x = input_75_cast_fp16)[name = string("linear_22_cast_fp16")]; tensor stages_1_transformer_layers_0_layer_scale_2_scale_to_fp16 = const()[name = string("stages_1_transformer_layers_0_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8574976)))]; tensor var_1639_cast_fp16 = mul(x = stages_1_transformer_layers_0_layer_scale_2_scale_to_fp16, y = linear_22_cast_fp16)[name = string("op_1639_cast_fp16")]; tensor input_77_cast_fp16 = add(x = input_69_cast_fp16, y = var_1639_cast_fp16)[name = string("input_77_cast_fp16")]; tensor input_79_axes_0 = const()[name = string("input_79_axes_0"), val = tensor([-1])]; tensor stages_1_transformer_layers_1_norm1_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8575552)))]; tensor stages_1_transformer_layers_1_norm1_bias_to_fp16 = const()[name = string("stages_1_transformer_layers_1_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8576128)))]; fp16 var_1643_to_fp16 = const()[name = string("op_1643_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_79_cast_fp16 = layer_norm(axes = input_79_axes_0, beta = stages_1_transformer_layers_1_norm1_bias_to_fp16, epsilon = var_1643_to_fp16, gamma = stages_1_transformer_layers_1_norm1_weight_to_fp16, x = input_77_cast_fp16)[name = string("input_79_cast_fp16")]; tensor stages_1_transformer_layers_1_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8576704)))]; tensor linear_23_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_1_transformer_layers_1_self_attn_in_proj_weight_to_fp16, x = input_79_cast_fp16)[name = string("linear_23_cast_fp16")]; tensor var_1657 = const()[name = string("op_1657"), val = tensor([1, 8, 3, 4, 64])]; tensor var_1658_cast_fp16 = reshape(shape = var_1657, x = linear_23_cast_fp16)[name = string("op_1658_cast_fp16")]; tensor var_1664 = const()[name = string("op_1664"), val = tensor([2, 0, 3, 1, 4])]; tensor query_31_begin_0 = const()[name = string("query_31_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_31_end_0 = const()[name = string("query_31_end_0"), val = tensor([1, 1, 4, 8, 64])]; tensor query_31_end_mask_0 = const()[name = string("query_31_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_31_squeeze_mask_0 = const()[name = string("query_31_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_23_cast_fp16 = transpose(perm = var_1664, x = var_1658_cast_fp16)[name = string("transpose_22")]; tensor query_31_cast_fp16 = slice_by_index(begin = query_31_begin_0, end = query_31_end_0, end_mask = query_31_end_mask_0, squeeze_mask = query_31_squeeze_mask_0, x = qkv_23_cast_fp16)[name = string("query_31_cast_fp16")]; tensor key_31_begin_0 = const()[name = string("key_31_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_31_end_0 = const()[name = string("key_31_end_0"), val = tensor([2, 1, 4, 8, 64])]; tensor key_31_end_mask_0 = const()[name = string("key_31_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_31_squeeze_mask_0 = const()[name = string("key_31_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_31_cast_fp16 = slice_by_index(begin = key_31_begin_0, end = key_31_end_0, end_mask = key_31_end_mask_0, squeeze_mask = key_31_squeeze_mask_0, x = qkv_23_cast_fp16)[name = string("key_31_cast_fp16")]; tensor value_11_begin_0 = const()[name = string("value_11_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_11_end_0 = const()[name = string("value_11_end_0"), val = tensor([3, 1, 4, 8, 64])]; tensor value_11_end_mask_0 = const()[name = string("value_11_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_11_squeeze_mask_0 = const()[name = string("value_11_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_11_cast_fp16 = slice_by_index(begin = value_11_begin_0, end = value_11_end_0, end_mask = value_11_end_mask_0, squeeze_mask = value_11_squeeze_mask_0, x = qkv_23_cast_fp16)[name = string("value_11_cast_fp16")]; tensor var_1680 = const()[name = string("op_1680"), val = tensor([1, 4, 8, 32, 2])]; tensor query_pairs_11_cast_fp16 = reshape(shape = var_1680, x = query_31_cast_fp16)[name = string("query_pairs_11_cast_fp16")]; tensor var_1687 = const()[name = string("op_1687"), val = tensor([1, 4, 8, 32, 2])]; tensor key_pairs_11_cast_fp16 = reshape(shape = var_1687, x = key_31_cast_fp16)[name = string("key_pairs_11_cast_fp16")]; tensor qr_11_begin_0 = const()[name = string("qr_11_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_11_end_0 = const()[name = string("qr_11_end_0"), val = tensor([1, 4, 8, 32, 1])]; tensor qr_11_end_mask_0 = const()[name = string("qr_11_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_11_squeeze_mask_0 = const()[name = string("qr_11_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_11_cast_fp16 = slice_by_index(begin = qr_11_begin_0, end = qr_11_end_0, end_mask = qr_11_end_mask_0, squeeze_mask = qr_11_squeeze_mask_0, x = query_pairs_11_cast_fp16)[name = string("qr_11_cast_fp16")]; tensor qi_11_begin_0 = const()[name = string("qi_11_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_11_end_0 = const()[name = string("qi_11_end_0"), val = tensor([1, 4, 8, 32, 2])]; tensor qi_11_end_mask_0 = const()[name = string("qi_11_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_11_squeeze_mask_0 = const()[name = string("qi_11_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_11_cast_fp16 = slice_by_index(begin = qi_11_begin_0, end = qi_11_end_0, end_mask = qi_11_end_mask_0, squeeze_mask = qi_11_squeeze_mask_0, x = query_pairs_11_cast_fp16)[name = string("qi_11_cast_fp16")]; tensor kr_11_begin_0 = const()[name = string("kr_11_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_11_end_0 = const()[name = string("kr_11_end_0"), val = tensor([1, 4, 8, 32, 1])]; tensor kr_11_end_mask_0 = const()[name = string("kr_11_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_11_squeeze_mask_0 = const()[name = string("kr_11_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_11_cast_fp16 = slice_by_index(begin = kr_11_begin_0, end = kr_11_end_0, end_mask = kr_11_end_mask_0, squeeze_mask = kr_11_squeeze_mask_0, x = key_pairs_11_cast_fp16)[name = string("kr_11_cast_fp16")]; tensor ki_11_begin_0 = const()[name = string("ki_11_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_11_end_0 = const()[name = string("ki_11_end_0"), val = tensor([1, 4, 8, 32, 2])]; tensor ki_11_end_mask_0 = const()[name = string("ki_11_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_11_squeeze_mask_0 = const()[name = string("ki_11_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_11_cast_fp16 = slice_by_index(begin = ki_11_begin_0, end = ki_11_end_0, end_mask = ki_11_end_mask_0, squeeze_mask = ki_11_squeeze_mask_0, x = key_pairs_11_cast_fp16)[name = string("ki_11_cast_fp16")]; tensor var_1701_cast_fp16 = mul(x = qr_11_cast_fp16, y = s1_cos)[name = string("op_1701_cast_fp16")]; tensor var_1702_cast_fp16 = mul(x = qi_11_cast_fp16, y = s1_sin)[name = string("op_1702_cast_fp16")]; tensor var_1704_cast_fp16 = sub(x = var_1701_cast_fp16, y = var_1702_cast_fp16)[name = string("op_1704_cast_fp16")]; tensor var_1705_cast_fp16 = mul(x = qr_11_cast_fp16, y = s1_sin)[name = string("op_1705_cast_fp16")]; tensor var_1706_cast_fp16 = mul(x = qi_11_cast_fp16, y = s1_cos)[name = string("op_1706_cast_fp16")]; tensor var_1708_cast_fp16 = add(x = var_1705_cast_fp16, y = var_1706_cast_fp16)[name = string("op_1708_cast_fp16")]; int32 query_33_axis_0 = const()[name = string("query_33_axis_0"), val = int32(-1)]; tensor query_33_cast_fp16 = stack(axis = query_33_axis_0, values = (var_1704_cast_fp16, var_1708_cast_fp16))[name = string("query_33_cast_fp16")]; tensor var_1712_cast_fp16 = mul(x = kr_11_cast_fp16, y = s1_cos)[name = string("op_1712_cast_fp16")]; tensor var_1713_cast_fp16 = mul(x = ki_11_cast_fp16, y = s1_sin)[name = string("op_1713_cast_fp16")]; tensor var_1715_cast_fp16 = sub(x = var_1712_cast_fp16, y = var_1713_cast_fp16)[name = string("op_1715_cast_fp16")]; tensor var_1716_cast_fp16 = mul(x = kr_11_cast_fp16, y = s1_sin)[name = string("op_1716_cast_fp16")]; tensor var_1717_cast_fp16 = mul(x = ki_11_cast_fp16, y = s1_cos)[name = string("op_1717_cast_fp16")]; tensor var_1719_cast_fp16 = add(x = var_1716_cast_fp16, y = var_1717_cast_fp16)[name = string("op_1719_cast_fp16")]; int32 key_33_axis_0 = const()[name = string("key_33_axis_0"), val = int32(-1)]; tensor key_33_cast_fp16 = stack(axis = key_33_axis_0, values = (var_1715_cast_fp16, var_1719_cast_fp16))[name = string("key_33_cast_fp16")]; tensor var_1727 = const()[name = string("op_1727"), val = tensor([1, 4, 8, 64])]; tensor query_35_cast_fp16 = reshape(shape = var_1727, x = query_33_cast_fp16)[name = string("query_35_cast_fp16")]; tensor var_1733 = const()[name = string("op_1733"), val = tensor([1, 4, 8, 64])]; tensor key_35_cast_fp16 = reshape(shape = var_1733, x = key_33_cast_fp16)[name = string("key_35_cast_fp16")]; tensor read_state_10 = read_state(input = s1_l1_k)[name = string("read_state_10")]; tensor var_1749_begin_0 = const()[name = string("op_1749_begin_0"), val = tensor([0, 0, 8, 0])]; tensor var_1749_end_0 = const()[name = string("op_1749_end_0"), val = tensor([1, 4, 800, 64])]; tensor var_1749_end_mask_0 = const()[name = string("op_1749_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1749_cast_fp16 = slice_by_index(begin = var_1749_begin_0, end = var_1749_end_0, end_mask = var_1749_end_mask_0, x = read_state_10)[name = string("op_1749_cast_fp16")]; int32 var_1756 = const()[name = string("op_1756"), val = int32(2)]; bool new_key_11_interleave_0 = const()[name = string("new_key_11_interleave_0"), val = bool(false)]; tensor new_key_11_cast_fp16 = concat(axis = var_1756, interleave = new_key_11_interleave_0, values = (var_1749_cast_fp16, key_35_cast_fp16))[name = string("new_key_11_cast_fp16")]; tensor read_state_11 = read_state(input = s1_l1_v)[name = string("read_state_11")]; tensor var_1772_begin_0 = const()[name = string("op_1772_begin_0"), val = tensor([0, 0, 8, 0])]; tensor var_1772_end_0 = const()[name = string("op_1772_end_0"), val = tensor([1, 4, 800, 64])]; tensor var_1772_end_mask_0 = const()[name = string("op_1772_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1772_cast_fp16 = slice_by_index(begin = var_1772_begin_0, end = var_1772_end_0, end_mask = var_1772_end_mask_0, x = read_state_11)[name = string("op_1772_cast_fp16")]; int32 var_1779 = const()[name = string("op_1779"), val = int32(2)]; bool new_value_11_interleave_0 = const()[name = string("new_value_11_interleave_0"), val = bool(false)]; tensor new_value_11_cast_fp16 = concat(axis = var_1779, interleave = new_value_11_interleave_0, values = (var_1772_cast_fp16, value_11_cast_fp16))[name = string("new_value_11_cast_fp16")]; tensor concat_20 = const()[name = string("concat_20"), val = tensor([0, 0, 0, 0])]; tensor concat_21 = const()[name = string("concat_21"), val = tensor([0, 0, 0, 0])]; tensor s1_l1_k_internal_tensor_assign_1_stride_0 = const()[name = string("s1_l1_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s1_l1_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s1_l1_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s1_l1_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s1_l1_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s1_l1_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s1_l1_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s1_l1_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_20, begin_mask = s1_l1_k_internal_tensor_assign_1_begin_mask_0, end = concat_21, end_mask = s1_l1_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s1_l1_k_internal_tensor_assign_1_squeeze_mask_0, stride = s1_l1_k_internal_tensor_assign_1_stride_0, update = new_key_11_cast_fp16, x = read_state_10)[name = string("s1_l1_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s1_l1_k_internal_tensor_assign_1_cast_fp16, input = s1_l1_k)[name = string("coreml_update_state_34_write_state")]; tensor concat_22 = const()[name = string("concat_22"), val = tensor([0, 0, 0, 0])]; tensor concat_23 = const()[name = string("concat_23"), val = tensor([0, 0, 0, 0])]; tensor s1_l1_v_internal_tensor_assign_1_stride_0 = const()[name = string("s1_l1_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s1_l1_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s1_l1_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s1_l1_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s1_l1_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s1_l1_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s1_l1_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s1_l1_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_22, begin_mask = s1_l1_v_internal_tensor_assign_1_begin_mask_0, end = concat_23, end_mask = s1_l1_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s1_l1_v_internal_tensor_assign_1_squeeze_mask_0, stride = s1_l1_v_internal_tensor_assign_1_stride_0, update = new_value_11_cast_fp16, x = read_state_11)[name = string("s1_l1_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s1_l1_v_internal_tensor_assign_1_cast_fp16, input = s1_l1_v)[name = string("coreml_update_state_35_write_state")]; bool var_1798_transpose_x_1 = const()[name = string("op_1798_transpose_x_1"), val = bool(false)]; bool var_1798_transpose_y_1 = const()[name = string("op_1798_transpose_y_1"), val = bool(true)]; tensor var_1798_cast_fp16 = matmul(transpose_x = var_1798_transpose_x_1, transpose_y = var_1798_transpose_y_1, x = query_35_cast_fp16, y = new_key_11_cast_fp16)[name = string("op_1798_cast_fp16")]; fp16 var_1799_to_fp16 = const()[name = string("op_1799_to_fp16"), val = fp16(0x1p-3)]; tensor scores_11_cast_fp16 = mul(x = var_1798_cast_fp16, y = var_1799_to_fp16)[name = string("scores_11_cast_fp16")]; tensor var_1802_cast_fp16 = add(x = scores_11_cast_fp16, y = s1_mask)[name = string("op_1802_cast_fp16")]; int32 var_1803 = const()[name = string("op_1803"), val = int32(-1)]; tensor probabilities_11_cast_fp16 = softmax(axis = var_1803, x = var_1802_cast_fp16)[name = string("probabilities_11_cast_fp16")]; bool attention_11_transpose_x_0 = const()[name = string("attention_11_transpose_x_0"), val = bool(false)]; bool attention_11_transpose_y_0 = const()[name = string("attention_11_transpose_y_0"), val = bool(false)]; tensor attention_11_cast_fp16 = matmul(transpose_x = attention_11_transpose_x_0, transpose_y = attention_11_transpose_y_0, x = probabilities_11_cast_fp16, y = new_value_11_cast_fp16)[name = string("attention_11_cast_fp16")]; tensor var_1809_perm_0 = const()[name = string("op_1809_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_1813 = const()[name = string("op_1813"), val = tensor([1, 8, 256])]; tensor var_1809_cast_fp16 = transpose(perm = var_1809_perm_0, x = attention_11_cast_fp16)[name = string("transpose_21")]; tensor input_81_cast_fp16 = reshape(shape = var_1813, x = var_1809_cast_fp16)[name = string("input_81_cast_fp16")]; tensor stages_1_transformer_layers_1_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(8969984)))]; tensor linear_24_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_1_transformer_layers_1_self_attn_out_proj_weight_to_fp16, x = input_81_cast_fp16)[name = string("linear_24_cast_fp16")]; tensor stages_1_transformer_layers_1_layer_scale_1_scale_to_fp16 = const()[name = string("stages_1_transformer_layers_1_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(9101120)))]; tensor var_1819_cast_fp16 = mul(x = stages_1_transformer_layers_1_layer_scale_1_scale_to_fp16, y = linear_24_cast_fp16)[name = string("op_1819_cast_fp16")]; tensor input_83_cast_fp16 = add(x = input_77_cast_fp16, y = var_1819_cast_fp16)[name = string("input_83_cast_fp16")]; tensor input_85_axes_0 = const()[name = string("input_85_axes_0"), val = tensor([-1])]; tensor stages_1_transformer_layers_1_norm2_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(9101696)))]; tensor stages_1_transformer_layers_1_norm2_bias_to_fp16 = const()[name = string("stages_1_transformer_layers_1_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(9102272)))]; fp16 var_1823_to_fp16 = const()[name = string("op_1823_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_85_cast_fp16 = layer_norm(axes = input_85_axes_0, beta = stages_1_transformer_layers_1_norm2_bias_to_fp16, epsilon = var_1823_to_fp16, gamma = stages_1_transformer_layers_1_norm2_weight_to_fp16, x = input_83_cast_fp16)[name = string("input_85_cast_fp16")]; tensor stages_1_transformer_layers_1_ffn_0_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(9102848)))]; tensor linear_25_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_1_transformer_layers_1_ffn_0_weight_to_fp16, x = input_85_cast_fp16)[name = string("linear_25_cast_fp16")]; string input_89_mode_0 = const()[name = string("input_89_mode_0"), val = string("EXACT")]; tensor input_89_cast_fp16 = gelu(mode = input_89_mode_0, x = linear_25_cast_fp16)[name = string("input_89_cast_fp16")]; tensor stages_1_transformer_layers_1_ffn_2_weight_to_fp16 = const()[name = string("stages_1_transformer_layers_1_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(9627200)))]; tensor linear_26_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_1_transformer_layers_1_ffn_2_weight_to_fp16, x = input_89_cast_fp16)[name = string("linear_26_cast_fp16")]; tensor stages_1_transformer_layers_1_layer_scale_2_scale_to_fp16 = const()[name = string("stages_1_transformer_layers_1_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10151552)))]; tensor var_1839_cast_fp16 = mul(x = stages_1_transformer_layers_1_layer_scale_2_scale_to_fp16, y = linear_26_cast_fp16)[name = string("op_1839_cast_fp16")]; tensor input_91_cast_fp16 = add(x = input_83_cast_fp16, y = var_1839_cast_fp16)[name = string("input_91_cast_fp16")]; tensor stages_1_output_proj_weight_to_fp16 = const()[name = string("stages_1_output_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10152128)))]; tensor linear_27_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_1_output_proj_weight_to_fp16, x = input_91_cast_fp16)[name = string("linear_27_cast_fp16")]; tensor x_31_perm_0 = const()[name = string("x_31_perm_0"), val = tensor([0, 2, 1])]; tensor var_1852 = const()[name = string("op_1852"), val = tensor([1, 384, 2, 8])]; tensor x_31_cast_fp16 = transpose(perm = x_31_perm_0, x = linear_27_cast_fp16)[name = string("transpose_20")]; tensor var_1853_cast_fp16 = reshape(shape = var_1852, x = x_31_cast_fp16)[name = string("op_1853_cast_fp16")]; tensor var_1858 = const()[name = string("op_1858"), val = tensor([0, 1, 3, 2])]; tensor var_1863 = const()[name = string("op_1863"), val = tensor([1, 384, 16])]; tensor var_1859_cast_fp16 = transpose(perm = var_1858, x = var_1853_cast_fp16)[name = string("transpose_19")]; tensor x_33_cast_fp16 = reshape(shape = var_1863, x = var_1859_cast_fp16)[name = string("x_33_cast_fp16")]; tensor input_93_perm_0 = const()[name = string("input_93_perm_0"), val = tensor([0, 2, 1])]; tensor stages_2_input_proj_weight_to_fp16 = const()[name = string("stages_2_input_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10545408)))]; tensor input_93_cast_fp16 = transpose(perm = input_93_perm_0, x = x_33_cast_fp16)[name = string("transpose_18")]; tensor linear_28_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_2_input_proj_weight_to_fp16, x = input_93_cast_fp16)[name = string("linear_28_cast_fp16")]; tensor input_97_axes_0 = const()[name = string("input_97_axes_0"), val = tensor([-1])]; tensor stages_2_transformer_layers_0_norm1_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10742080)))]; tensor stages_2_transformer_layers_0_norm1_bias_to_fp16 = const()[name = string("stages_2_transformer_layers_0_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10742656)))]; fp16 var_1872_to_fp16 = const()[name = string("op_1872_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_97_cast_fp16 = layer_norm(axes = input_97_axes_0, beta = stages_2_transformer_layers_0_norm1_bias_to_fp16, epsilon = var_1872_to_fp16, gamma = stages_2_transformer_layers_0_norm1_weight_to_fp16, x = linear_28_cast_fp16)[name = string("input_97_cast_fp16")]; tensor stages_2_transformer_layers_0_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(10743232)))]; tensor linear_29_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_2_transformer_layers_0_self_attn_in_proj_weight_to_fp16, x = input_97_cast_fp16)[name = string("linear_29_cast_fp16")]; tensor var_1886 = const()[name = string("op_1886"), val = tensor([1, 16, 3, 4, 64])]; tensor var_1887_cast_fp16 = reshape(shape = var_1886, x = linear_29_cast_fp16)[name = string("op_1887_cast_fp16")]; tensor var_1893 = const()[name = string("op_1893"), val = tensor([2, 0, 3, 1, 4])]; tensor query_37_begin_0 = const()[name = string("query_37_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_37_end_0 = const()[name = string("query_37_end_0"), val = tensor([1, 1, 4, 16, 64])]; tensor query_37_end_mask_0 = const()[name = string("query_37_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_37_squeeze_mask_0 = const()[name = string("query_37_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_27_cast_fp16 = transpose(perm = var_1893, x = var_1887_cast_fp16)[name = string("transpose_17")]; tensor query_37_cast_fp16 = slice_by_index(begin = query_37_begin_0, end = query_37_end_0, end_mask = query_37_end_mask_0, squeeze_mask = query_37_squeeze_mask_0, x = qkv_27_cast_fp16)[name = string("query_37_cast_fp16")]; tensor key_37_begin_0 = const()[name = string("key_37_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_37_end_0 = const()[name = string("key_37_end_0"), val = tensor([2, 1, 4, 16, 64])]; tensor key_37_end_mask_0 = const()[name = string("key_37_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_37_squeeze_mask_0 = const()[name = string("key_37_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_37_cast_fp16 = slice_by_index(begin = key_37_begin_0, end = key_37_end_0, end_mask = key_37_end_mask_0, squeeze_mask = key_37_squeeze_mask_0, x = qkv_27_cast_fp16)[name = string("key_37_cast_fp16")]; tensor value_13_begin_0 = const()[name = string("value_13_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_13_end_0 = const()[name = string("value_13_end_0"), val = tensor([3, 1, 4, 16, 64])]; tensor value_13_end_mask_0 = const()[name = string("value_13_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_13_squeeze_mask_0 = const()[name = string("value_13_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_13_cast_fp16 = slice_by_index(begin = value_13_begin_0, end = value_13_end_0, end_mask = value_13_end_mask_0, squeeze_mask = value_13_squeeze_mask_0, x = qkv_27_cast_fp16)[name = string("value_13_cast_fp16")]; tensor var_1909 = const()[name = string("op_1909"), val = tensor([1, 4, 16, 32, 2])]; tensor query_pairs_13_cast_fp16 = reshape(shape = var_1909, x = query_37_cast_fp16)[name = string("query_pairs_13_cast_fp16")]; tensor var_1916 = const()[name = string("op_1916"), val = tensor([1, 4, 16, 32, 2])]; tensor key_pairs_13_cast_fp16 = reshape(shape = var_1916, x = key_37_cast_fp16)[name = string("key_pairs_13_cast_fp16")]; tensor qr_13_begin_0 = const()[name = string("qr_13_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_13_end_0 = const()[name = string("qr_13_end_0"), val = tensor([1, 4, 16, 32, 1])]; tensor qr_13_end_mask_0 = const()[name = string("qr_13_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_13_squeeze_mask_0 = const()[name = string("qr_13_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_13_cast_fp16 = slice_by_index(begin = qr_13_begin_0, end = qr_13_end_0, end_mask = qr_13_end_mask_0, squeeze_mask = qr_13_squeeze_mask_0, x = query_pairs_13_cast_fp16)[name = string("qr_13_cast_fp16")]; tensor qi_13_begin_0 = const()[name = string("qi_13_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_13_end_0 = const()[name = string("qi_13_end_0"), val = tensor([1, 4, 16, 32, 2])]; tensor qi_13_end_mask_0 = const()[name = string("qi_13_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_13_squeeze_mask_0 = const()[name = string("qi_13_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_13_cast_fp16 = slice_by_index(begin = qi_13_begin_0, end = qi_13_end_0, end_mask = qi_13_end_mask_0, squeeze_mask = qi_13_squeeze_mask_0, x = query_pairs_13_cast_fp16)[name = string("qi_13_cast_fp16")]; tensor kr_13_begin_0 = const()[name = string("kr_13_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_13_end_0 = const()[name = string("kr_13_end_0"), val = tensor([1, 4, 16, 32, 1])]; tensor kr_13_end_mask_0 = const()[name = string("kr_13_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_13_squeeze_mask_0 = const()[name = string("kr_13_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_13_cast_fp16 = slice_by_index(begin = kr_13_begin_0, end = kr_13_end_0, end_mask = kr_13_end_mask_0, squeeze_mask = kr_13_squeeze_mask_0, x = key_pairs_13_cast_fp16)[name = string("kr_13_cast_fp16")]; tensor ki_13_begin_0 = const()[name = string("ki_13_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_13_end_0 = const()[name = string("ki_13_end_0"), val = tensor([1, 4, 16, 32, 2])]; tensor ki_13_end_mask_0 = const()[name = string("ki_13_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_13_squeeze_mask_0 = const()[name = string("ki_13_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_13_cast_fp16 = slice_by_index(begin = ki_13_begin_0, end = ki_13_end_0, end_mask = ki_13_end_mask_0, squeeze_mask = ki_13_squeeze_mask_0, x = key_pairs_13_cast_fp16)[name = string("ki_13_cast_fp16")]; tensor var_1930_cast_fp16 = mul(x = qr_13_cast_fp16, y = s2_cos)[name = string("op_1930_cast_fp16")]; tensor var_1931_cast_fp16 = mul(x = qi_13_cast_fp16, y = s2_sin)[name = string("op_1931_cast_fp16")]; tensor var_1933_cast_fp16 = sub(x = var_1930_cast_fp16, y = var_1931_cast_fp16)[name = string("op_1933_cast_fp16")]; tensor var_1934_cast_fp16 = mul(x = qr_13_cast_fp16, y = s2_sin)[name = string("op_1934_cast_fp16")]; tensor var_1935_cast_fp16 = mul(x = qi_13_cast_fp16, y = s2_cos)[name = string("op_1935_cast_fp16")]; tensor var_1937_cast_fp16 = add(x = var_1934_cast_fp16, y = var_1935_cast_fp16)[name = string("op_1937_cast_fp16")]; int32 query_39_axis_0 = const()[name = string("query_39_axis_0"), val = int32(-1)]; tensor query_39_cast_fp16 = stack(axis = query_39_axis_0, values = (var_1933_cast_fp16, var_1937_cast_fp16))[name = string("query_39_cast_fp16")]; tensor var_1941_cast_fp16 = mul(x = kr_13_cast_fp16, y = s2_cos)[name = string("op_1941_cast_fp16")]; tensor var_1942_cast_fp16 = mul(x = ki_13_cast_fp16, y = s2_sin)[name = string("op_1942_cast_fp16")]; tensor var_1944_cast_fp16 = sub(x = var_1941_cast_fp16, y = var_1942_cast_fp16)[name = string("op_1944_cast_fp16")]; tensor var_1945_cast_fp16 = mul(x = kr_13_cast_fp16, y = s2_sin)[name = string("op_1945_cast_fp16")]; tensor var_1946_cast_fp16 = mul(x = ki_13_cast_fp16, y = s2_cos)[name = string("op_1946_cast_fp16")]; tensor var_1948_cast_fp16 = add(x = var_1945_cast_fp16, y = var_1946_cast_fp16)[name = string("op_1948_cast_fp16")]; int32 key_39_axis_0 = const()[name = string("key_39_axis_0"), val = int32(-1)]; tensor key_39_cast_fp16 = stack(axis = key_39_axis_0, values = (var_1944_cast_fp16, var_1948_cast_fp16))[name = string("key_39_cast_fp16")]; tensor var_1956 = const()[name = string("op_1956"), val = tensor([1, 4, 16, 64])]; tensor query_41_cast_fp16 = reshape(shape = var_1956, x = query_39_cast_fp16)[name = string("query_41_cast_fp16")]; tensor var_1962 = const()[name = string("op_1962"), val = tensor([1, 4, 16, 64])]; tensor key_41_cast_fp16 = reshape(shape = var_1962, x = key_39_cast_fp16)[name = string("key_41_cast_fp16")]; tensor read_state_12 = read_state(input = s2_l0_k)[name = string("read_state_12")]; tensor var_1978_begin_0 = const()[name = string("op_1978_begin_0"), val = tensor([0, 0, 16, 0])]; tensor var_1978_end_0 = const()[name = string("op_1978_end_0"), val = tensor([1, 4, 1200, 64])]; tensor var_1978_end_mask_0 = const()[name = string("op_1978_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_1978_cast_fp16 = slice_by_index(begin = var_1978_begin_0, end = var_1978_end_0, end_mask = var_1978_end_mask_0, x = read_state_12)[name = string("op_1978_cast_fp16")]; int32 var_1985 = const()[name = string("op_1985"), val = int32(2)]; bool new_key_13_interleave_0 = const()[name = string("new_key_13_interleave_0"), val = bool(false)]; tensor new_key_13_cast_fp16 = concat(axis = var_1985, interleave = new_key_13_interleave_0, values = (var_1978_cast_fp16, key_41_cast_fp16))[name = string("new_key_13_cast_fp16")]; tensor read_state_13 = read_state(input = s2_l0_v)[name = string("read_state_13")]; tensor var_2001_begin_0 = const()[name = string("op_2001_begin_0"), val = tensor([0, 0, 16, 0])]; tensor var_2001_end_0 = const()[name = string("op_2001_end_0"), val = tensor([1, 4, 1200, 64])]; tensor var_2001_end_mask_0 = const()[name = string("op_2001_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2001_cast_fp16 = slice_by_index(begin = var_2001_begin_0, end = var_2001_end_0, end_mask = var_2001_end_mask_0, x = read_state_13)[name = string("op_2001_cast_fp16")]; int32 var_2008 = const()[name = string("op_2008"), val = int32(2)]; bool new_value_13_interleave_0 = const()[name = string("new_value_13_interleave_0"), val = bool(false)]; tensor new_value_13_cast_fp16 = concat(axis = var_2008, interleave = new_value_13_interleave_0, values = (var_2001_cast_fp16, value_13_cast_fp16))[name = string("new_value_13_cast_fp16")]; tensor concat_24 = const()[name = string("concat_24"), val = tensor([0, 0, 0, 0])]; tensor concat_25 = const()[name = string("concat_25"), val = tensor([0, 0, 0, 0])]; tensor s2_l0_k_internal_tensor_assign_1_stride_0 = const()[name = string("s2_l0_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s2_l0_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s2_l0_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s2_l0_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s2_l0_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s2_l0_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s2_l0_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s2_l0_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_24, begin_mask = s2_l0_k_internal_tensor_assign_1_begin_mask_0, end = concat_25, end_mask = s2_l0_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s2_l0_k_internal_tensor_assign_1_squeeze_mask_0, stride = s2_l0_k_internal_tensor_assign_1_stride_0, update = new_key_13_cast_fp16, x = read_state_12)[name = string("s2_l0_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s2_l0_k_internal_tensor_assign_1_cast_fp16, input = s2_l0_k)[name = string("coreml_update_state_36_write_state")]; tensor concat_26 = const()[name = string("concat_26"), val = tensor([0, 0, 0, 0])]; tensor concat_27 = const()[name = string("concat_27"), val = tensor([0, 0, 0, 0])]; tensor s2_l0_v_internal_tensor_assign_1_stride_0 = const()[name = string("s2_l0_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s2_l0_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s2_l0_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s2_l0_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s2_l0_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s2_l0_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s2_l0_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s2_l0_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_26, begin_mask = s2_l0_v_internal_tensor_assign_1_begin_mask_0, end = concat_27, end_mask = s2_l0_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s2_l0_v_internal_tensor_assign_1_squeeze_mask_0, stride = s2_l0_v_internal_tensor_assign_1_stride_0, update = new_value_13_cast_fp16, x = read_state_13)[name = string("s2_l0_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s2_l0_v_internal_tensor_assign_1_cast_fp16, input = s2_l0_v)[name = string("coreml_update_state_37_write_state")]; bool var_2027_transpose_x_1 = const()[name = string("op_2027_transpose_x_1"), val = bool(false)]; bool var_2027_transpose_y_1 = const()[name = string("op_2027_transpose_y_1"), val = bool(true)]; tensor var_2027_cast_fp16 = matmul(transpose_x = var_2027_transpose_x_1, transpose_y = var_2027_transpose_y_1, x = query_41_cast_fp16, y = new_key_13_cast_fp16)[name = string("op_2027_cast_fp16")]; fp16 var_2028_to_fp16 = const()[name = string("op_2028_to_fp16"), val = fp16(0x1p-3)]; tensor scores_13_cast_fp16 = mul(x = var_2027_cast_fp16, y = var_2028_to_fp16)[name = string("scores_13_cast_fp16")]; tensor var_2031_cast_fp16 = add(x = scores_13_cast_fp16, y = s2_mask)[name = string("op_2031_cast_fp16")]; int32 var_2032 = const()[name = string("op_2032"), val = int32(-1)]; tensor probabilities_13_cast_fp16 = softmax(axis = var_2032, x = var_2031_cast_fp16)[name = string("probabilities_13_cast_fp16")]; bool attention_13_transpose_x_0 = const()[name = string("attention_13_transpose_x_0"), val = bool(false)]; bool attention_13_transpose_y_0 = const()[name = string("attention_13_transpose_y_0"), val = bool(false)]; tensor attention_13_cast_fp16 = matmul(transpose_x = attention_13_transpose_x_0, transpose_y = attention_13_transpose_y_0, x = probabilities_13_cast_fp16, y = new_value_13_cast_fp16)[name = string("attention_13_cast_fp16")]; tensor var_2038_perm_0 = const()[name = string("op_2038_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_2042 = const()[name = string("op_2042"), val = tensor([1, 16, 256])]; tensor var_2038_cast_fp16 = transpose(perm = var_2038_perm_0, x = attention_13_cast_fp16)[name = string("transpose_16")]; tensor input_99_cast_fp16 = reshape(shape = var_2042, x = var_2038_cast_fp16)[name = string("input_99_cast_fp16")]; tensor stages_2_transformer_layers_0_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11136512)))]; tensor linear_30_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_2_transformer_layers_0_self_attn_out_proj_weight_to_fp16, x = input_99_cast_fp16)[name = string("linear_30_cast_fp16")]; tensor stages_2_transformer_layers_0_layer_scale_1_scale_to_fp16 = const()[name = string("stages_2_transformer_layers_0_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11267648)))]; tensor var_2048_cast_fp16 = mul(x = stages_2_transformer_layers_0_layer_scale_1_scale_to_fp16, y = linear_30_cast_fp16)[name = string("op_2048_cast_fp16")]; tensor input_101_cast_fp16 = add(x = linear_28_cast_fp16, y = var_2048_cast_fp16)[name = string("input_101_cast_fp16")]; tensor input_103_axes_0 = const()[name = string("input_103_axes_0"), val = tensor([-1])]; tensor stages_2_transformer_layers_0_norm2_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11268224)))]; tensor stages_2_transformer_layers_0_norm2_bias_to_fp16 = const()[name = string("stages_2_transformer_layers_0_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11268800)))]; fp16 var_2052_to_fp16 = const()[name = string("op_2052_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_103_cast_fp16 = layer_norm(axes = input_103_axes_0, beta = stages_2_transformer_layers_0_norm2_bias_to_fp16, epsilon = var_2052_to_fp16, gamma = stages_2_transformer_layers_0_norm2_weight_to_fp16, x = input_101_cast_fp16)[name = string("input_103_cast_fp16")]; tensor stages_2_transformer_layers_0_ffn_0_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11269376)))]; tensor linear_31_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_2_transformer_layers_0_ffn_0_weight_to_fp16, x = input_103_cast_fp16)[name = string("linear_31_cast_fp16")]; string input_107_mode_0 = const()[name = string("input_107_mode_0"), val = string("EXACT")]; tensor input_107_cast_fp16 = gelu(mode = input_107_mode_0, x = linear_31_cast_fp16)[name = string("input_107_cast_fp16")]; tensor stages_2_transformer_layers_0_ffn_2_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_0_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(11793728)))]; tensor linear_32_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_2_transformer_layers_0_ffn_2_weight_to_fp16, x = input_107_cast_fp16)[name = string("linear_32_cast_fp16")]; tensor stages_2_transformer_layers_0_layer_scale_2_scale_to_fp16 = const()[name = string("stages_2_transformer_layers_0_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12318080)))]; tensor var_2068_cast_fp16 = mul(x = stages_2_transformer_layers_0_layer_scale_2_scale_to_fp16, y = linear_32_cast_fp16)[name = string("op_2068_cast_fp16")]; tensor input_109_cast_fp16 = add(x = input_101_cast_fp16, y = var_2068_cast_fp16)[name = string("input_109_cast_fp16")]; tensor input_111_axes_0 = const()[name = string("input_111_axes_0"), val = tensor([-1])]; tensor stages_2_transformer_layers_1_norm1_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12318656)))]; tensor stages_2_transformer_layers_1_norm1_bias_to_fp16 = const()[name = string("stages_2_transformer_layers_1_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12319232)))]; fp16 var_2072_to_fp16 = const()[name = string("op_2072_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_111_cast_fp16 = layer_norm(axes = input_111_axes_0, beta = stages_2_transformer_layers_1_norm1_bias_to_fp16, epsilon = var_2072_to_fp16, gamma = stages_2_transformer_layers_1_norm1_weight_to_fp16, x = input_109_cast_fp16)[name = string("input_111_cast_fp16")]; tensor stages_2_transformer_layers_1_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12319808)))]; tensor linear_33_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_2_transformer_layers_1_self_attn_in_proj_weight_to_fp16, x = input_111_cast_fp16)[name = string("linear_33_cast_fp16")]; tensor var_2086 = const()[name = string("op_2086"), val = tensor([1, 16, 3, 4, 64])]; tensor var_2087_cast_fp16 = reshape(shape = var_2086, x = linear_33_cast_fp16)[name = string("op_2087_cast_fp16")]; tensor var_2093 = const()[name = string("op_2093"), val = tensor([2, 0, 3, 1, 4])]; tensor query_43_begin_0 = const()[name = string("query_43_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_43_end_0 = const()[name = string("query_43_end_0"), val = tensor([1, 1, 4, 16, 64])]; tensor query_43_end_mask_0 = const()[name = string("query_43_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_43_squeeze_mask_0 = const()[name = string("query_43_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_31_cast_fp16 = transpose(perm = var_2093, x = var_2087_cast_fp16)[name = string("transpose_15")]; tensor query_43_cast_fp16 = slice_by_index(begin = query_43_begin_0, end = query_43_end_0, end_mask = query_43_end_mask_0, squeeze_mask = query_43_squeeze_mask_0, x = qkv_31_cast_fp16)[name = string("query_43_cast_fp16")]; tensor key_43_begin_0 = const()[name = string("key_43_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_43_end_0 = const()[name = string("key_43_end_0"), val = tensor([2, 1, 4, 16, 64])]; tensor key_43_end_mask_0 = const()[name = string("key_43_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_43_squeeze_mask_0 = const()[name = string("key_43_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_43_cast_fp16 = slice_by_index(begin = key_43_begin_0, end = key_43_end_0, end_mask = key_43_end_mask_0, squeeze_mask = key_43_squeeze_mask_0, x = qkv_31_cast_fp16)[name = string("key_43_cast_fp16")]; tensor value_15_begin_0 = const()[name = string("value_15_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_15_end_0 = const()[name = string("value_15_end_0"), val = tensor([3, 1, 4, 16, 64])]; tensor value_15_end_mask_0 = const()[name = string("value_15_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_15_squeeze_mask_0 = const()[name = string("value_15_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_15_cast_fp16 = slice_by_index(begin = value_15_begin_0, end = value_15_end_0, end_mask = value_15_end_mask_0, squeeze_mask = value_15_squeeze_mask_0, x = qkv_31_cast_fp16)[name = string("value_15_cast_fp16")]; tensor var_2109 = const()[name = string("op_2109"), val = tensor([1, 4, 16, 32, 2])]; tensor query_pairs_15_cast_fp16 = reshape(shape = var_2109, x = query_43_cast_fp16)[name = string("query_pairs_15_cast_fp16")]; tensor var_2116 = const()[name = string("op_2116"), val = tensor([1, 4, 16, 32, 2])]; tensor key_pairs_15_cast_fp16 = reshape(shape = var_2116, x = key_43_cast_fp16)[name = string("key_pairs_15_cast_fp16")]; tensor qr_15_begin_0 = const()[name = string("qr_15_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_15_end_0 = const()[name = string("qr_15_end_0"), val = tensor([1, 4, 16, 32, 1])]; tensor qr_15_end_mask_0 = const()[name = string("qr_15_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_15_squeeze_mask_0 = const()[name = string("qr_15_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_15_cast_fp16 = slice_by_index(begin = qr_15_begin_0, end = qr_15_end_0, end_mask = qr_15_end_mask_0, squeeze_mask = qr_15_squeeze_mask_0, x = query_pairs_15_cast_fp16)[name = string("qr_15_cast_fp16")]; tensor qi_15_begin_0 = const()[name = string("qi_15_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_15_end_0 = const()[name = string("qi_15_end_0"), val = tensor([1, 4, 16, 32, 2])]; tensor qi_15_end_mask_0 = const()[name = string("qi_15_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_15_squeeze_mask_0 = const()[name = string("qi_15_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_15_cast_fp16 = slice_by_index(begin = qi_15_begin_0, end = qi_15_end_0, end_mask = qi_15_end_mask_0, squeeze_mask = qi_15_squeeze_mask_0, x = query_pairs_15_cast_fp16)[name = string("qi_15_cast_fp16")]; tensor kr_15_begin_0 = const()[name = string("kr_15_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_15_end_0 = const()[name = string("kr_15_end_0"), val = tensor([1, 4, 16, 32, 1])]; tensor kr_15_end_mask_0 = const()[name = string("kr_15_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_15_squeeze_mask_0 = const()[name = string("kr_15_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_15_cast_fp16 = slice_by_index(begin = kr_15_begin_0, end = kr_15_end_0, end_mask = kr_15_end_mask_0, squeeze_mask = kr_15_squeeze_mask_0, x = key_pairs_15_cast_fp16)[name = string("kr_15_cast_fp16")]; tensor ki_15_begin_0 = const()[name = string("ki_15_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_15_end_0 = const()[name = string("ki_15_end_0"), val = tensor([1, 4, 16, 32, 2])]; tensor ki_15_end_mask_0 = const()[name = string("ki_15_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_15_squeeze_mask_0 = const()[name = string("ki_15_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_15_cast_fp16 = slice_by_index(begin = ki_15_begin_0, end = ki_15_end_0, end_mask = ki_15_end_mask_0, squeeze_mask = ki_15_squeeze_mask_0, x = key_pairs_15_cast_fp16)[name = string("ki_15_cast_fp16")]; tensor var_2130_cast_fp16 = mul(x = qr_15_cast_fp16, y = s2_cos)[name = string("op_2130_cast_fp16")]; tensor var_2131_cast_fp16 = mul(x = qi_15_cast_fp16, y = s2_sin)[name = string("op_2131_cast_fp16")]; tensor var_2133_cast_fp16 = sub(x = var_2130_cast_fp16, y = var_2131_cast_fp16)[name = string("op_2133_cast_fp16")]; tensor var_2134_cast_fp16 = mul(x = qr_15_cast_fp16, y = s2_sin)[name = string("op_2134_cast_fp16")]; tensor var_2135_cast_fp16 = mul(x = qi_15_cast_fp16, y = s2_cos)[name = string("op_2135_cast_fp16")]; tensor var_2137_cast_fp16 = add(x = var_2134_cast_fp16, y = var_2135_cast_fp16)[name = string("op_2137_cast_fp16")]; int32 query_45_axis_0 = const()[name = string("query_45_axis_0"), val = int32(-1)]; tensor query_45_cast_fp16 = stack(axis = query_45_axis_0, values = (var_2133_cast_fp16, var_2137_cast_fp16))[name = string("query_45_cast_fp16")]; tensor var_2141_cast_fp16 = mul(x = kr_15_cast_fp16, y = s2_cos)[name = string("op_2141_cast_fp16")]; tensor var_2142_cast_fp16 = mul(x = ki_15_cast_fp16, y = s2_sin)[name = string("op_2142_cast_fp16")]; tensor var_2144_cast_fp16 = sub(x = var_2141_cast_fp16, y = var_2142_cast_fp16)[name = string("op_2144_cast_fp16")]; tensor var_2145_cast_fp16 = mul(x = kr_15_cast_fp16, y = s2_sin)[name = string("op_2145_cast_fp16")]; tensor var_2146_cast_fp16 = mul(x = ki_15_cast_fp16, y = s2_cos)[name = string("op_2146_cast_fp16")]; tensor var_2148_cast_fp16 = add(x = var_2145_cast_fp16, y = var_2146_cast_fp16)[name = string("op_2148_cast_fp16")]; int32 key_45_axis_0 = const()[name = string("key_45_axis_0"), val = int32(-1)]; tensor key_45_cast_fp16 = stack(axis = key_45_axis_0, values = (var_2144_cast_fp16, var_2148_cast_fp16))[name = string("key_45_cast_fp16")]; tensor var_2156 = const()[name = string("op_2156"), val = tensor([1, 4, 16, 64])]; tensor query_47_cast_fp16 = reshape(shape = var_2156, x = query_45_cast_fp16)[name = string("query_47_cast_fp16")]; tensor var_2162 = const()[name = string("op_2162"), val = tensor([1, 4, 16, 64])]; tensor key_47_cast_fp16 = reshape(shape = var_2162, x = key_45_cast_fp16)[name = string("key_47_cast_fp16")]; tensor read_state_14 = read_state(input = s2_l1_k)[name = string("read_state_14")]; tensor var_2178_begin_0 = const()[name = string("op_2178_begin_0"), val = tensor([0, 0, 16, 0])]; tensor var_2178_end_0 = const()[name = string("op_2178_end_0"), val = tensor([1, 4, 1200, 64])]; tensor var_2178_end_mask_0 = const()[name = string("op_2178_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2178_cast_fp16 = slice_by_index(begin = var_2178_begin_0, end = var_2178_end_0, end_mask = var_2178_end_mask_0, x = read_state_14)[name = string("op_2178_cast_fp16")]; int32 var_2185 = const()[name = string("op_2185"), val = int32(2)]; bool new_key_15_interleave_0 = const()[name = string("new_key_15_interleave_0"), val = bool(false)]; tensor new_key_15_cast_fp16 = concat(axis = var_2185, interleave = new_key_15_interleave_0, values = (var_2178_cast_fp16, key_47_cast_fp16))[name = string("new_key_15_cast_fp16")]; tensor read_state_15 = read_state(input = s2_l1_v)[name = string("read_state_15")]; tensor var_2201_begin_0 = const()[name = string("op_2201_begin_0"), val = tensor([0, 0, 16, 0])]; tensor var_2201_end_0 = const()[name = string("op_2201_end_0"), val = tensor([1, 4, 1200, 64])]; tensor var_2201_end_mask_0 = const()[name = string("op_2201_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2201_cast_fp16 = slice_by_index(begin = var_2201_begin_0, end = var_2201_end_0, end_mask = var_2201_end_mask_0, x = read_state_15)[name = string("op_2201_cast_fp16")]; int32 var_2208 = const()[name = string("op_2208"), val = int32(2)]; bool new_value_15_interleave_0 = const()[name = string("new_value_15_interleave_0"), val = bool(false)]; tensor new_value_15_cast_fp16 = concat(axis = var_2208, interleave = new_value_15_interleave_0, values = (var_2201_cast_fp16, value_15_cast_fp16))[name = string("new_value_15_cast_fp16")]; tensor concat_28 = const()[name = string("concat_28"), val = tensor([0, 0, 0, 0])]; tensor concat_29 = const()[name = string("concat_29"), val = tensor([0, 0, 0, 0])]; tensor s2_l1_k_internal_tensor_assign_1_stride_0 = const()[name = string("s2_l1_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s2_l1_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s2_l1_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s2_l1_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s2_l1_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s2_l1_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s2_l1_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s2_l1_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_28, begin_mask = s2_l1_k_internal_tensor_assign_1_begin_mask_0, end = concat_29, end_mask = s2_l1_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s2_l1_k_internal_tensor_assign_1_squeeze_mask_0, stride = s2_l1_k_internal_tensor_assign_1_stride_0, update = new_key_15_cast_fp16, x = read_state_14)[name = string("s2_l1_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s2_l1_k_internal_tensor_assign_1_cast_fp16, input = s2_l1_k)[name = string("coreml_update_state_38_write_state")]; tensor concat_30 = const()[name = string("concat_30"), val = tensor([0, 0, 0, 0])]; tensor concat_31 = const()[name = string("concat_31"), val = tensor([0, 0, 0, 0])]; tensor s2_l1_v_internal_tensor_assign_1_stride_0 = const()[name = string("s2_l1_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s2_l1_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s2_l1_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s2_l1_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s2_l1_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s2_l1_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s2_l1_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s2_l1_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_30, begin_mask = s2_l1_v_internal_tensor_assign_1_begin_mask_0, end = concat_31, end_mask = s2_l1_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s2_l1_v_internal_tensor_assign_1_squeeze_mask_0, stride = s2_l1_v_internal_tensor_assign_1_stride_0, update = new_value_15_cast_fp16, x = read_state_15)[name = string("s2_l1_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s2_l1_v_internal_tensor_assign_1_cast_fp16, input = s2_l1_v)[name = string("coreml_update_state_39_write_state")]; bool var_2227_transpose_x_1 = const()[name = string("op_2227_transpose_x_1"), val = bool(false)]; bool var_2227_transpose_y_1 = const()[name = string("op_2227_transpose_y_1"), val = bool(true)]; tensor var_2227_cast_fp16 = matmul(transpose_x = var_2227_transpose_x_1, transpose_y = var_2227_transpose_y_1, x = query_47_cast_fp16, y = new_key_15_cast_fp16)[name = string("op_2227_cast_fp16")]; fp16 var_2228_to_fp16 = const()[name = string("op_2228_to_fp16"), val = fp16(0x1p-3)]; tensor scores_15_cast_fp16 = mul(x = var_2227_cast_fp16, y = var_2228_to_fp16)[name = string("scores_15_cast_fp16")]; tensor var_2231_cast_fp16 = add(x = scores_15_cast_fp16, y = s2_mask)[name = string("op_2231_cast_fp16")]; int32 var_2232 = const()[name = string("op_2232"), val = int32(-1)]; tensor probabilities_15_cast_fp16 = softmax(axis = var_2232, x = var_2231_cast_fp16)[name = string("probabilities_15_cast_fp16")]; bool attention_15_transpose_x_0 = const()[name = string("attention_15_transpose_x_0"), val = bool(false)]; bool attention_15_transpose_y_0 = const()[name = string("attention_15_transpose_y_0"), val = bool(false)]; tensor attention_15_cast_fp16 = matmul(transpose_x = attention_15_transpose_x_0, transpose_y = attention_15_transpose_y_0, x = probabilities_15_cast_fp16, y = new_value_15_cast_fp16)[name = string("attention_15_cast_fp16")]; tensor var_2238_perm_0 = const()[name = string("op_2238_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_2242 = const()[name = string("op_2242"), val = tensor([1, 16, 256])]; tensor var_2238_cast_fp16 = transpose(perm = var_2238_perm_0, x = attention_15_cast_fp16)[name = string("transpose_14")]; tensor input_113_cast_fp16 = reshape(shape = var_2242, x = var_2238_cast_fp16)[name = string("input_113_cast_fp16")]; tensor stages_2_transformer_layers_1_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12713088)))]; tensor linear_34_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_2_transformer_layers_1_self_attn_out_proj_weight_to_fp16, x = input_113_cast_fp16)[name = string("linear_34_cast_fp16")]; tensor stages_2_transformer_layers_1_layer_scale_1_scale_to_fp16 = const()[name = string("stages_2_transformer_layers_1_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12844224)))]; tensor var_2248_cast_fp16 = mul(x = stages_2_transformer_layers_1_layer_scale_1_scale_to_fp16, y = linear_34_cast_fp16)[name = string("op_2248_cast_fp16")]; tensor input_115_cast_fp16 = add(x = input_109_cast_fp16, y = var_2248_cast_fp16)[name = string("input_115_cast_fp16")]; tensor input_117_axes_0 = const()[name = string("input_117_axes_0"), val = tensor([-1])]; tensor stages_2_transformer_layers_1_norm2_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12844800)))]; tensor stages_2_transformer_layers_1_norm2_bias_to_fp16 = const()[name = string("stages_2_transformer_layers_1_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12845376)))]; fp16 var_2252_to_fp16 = const()[name = string("op_2252_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_117_cast_fp16 = layer_norm(axes = input_117_axes_0, beta = stages_2_transformer_layers_1_norm2_bias_to_fp16, epsilon = var_2252_to_fp16, gamma = stages_2_transformer_layers_1_norm2_weight_to_fp16, x = input_115_cast_fp16)[name = string("input_117_cast_fp16")]; tensor stages_2_transformer_layers_1_ffn_0_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(12845952)))]; tensor linear_35_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_2_transformer_layers_1_ffn_0_weight_to_fp16, x = input_117_cast_fp16)[name = string("linear_35_cast_fp16")]; string input_121_mode_0 = const()[name = string("input_121_mode_0"), val = string("EXACT")]; tensor input_121_cast_fp16 = gelu(mode = input_121_mode_0, x = linear_35_cast_fp16)[name = string("input_121_cast_fp16")]; tensor stages_2_transformer_layers_1_ffn_2_weight_to_fp16 = const()[name = string("stages_2_transformer_layers_1_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(13370304)))]; tensor linear_36_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_2_transformer_layers_1_ffn_2_weight_to_fp16, x = input_121_cast_fp16)[name = string("linear_36_cast_fp16")]; tensor stages_2_transformer_layers_1_layer_scale_2_scale_to_fp16 = const()[name = string("stages_2_transformer_layers_1_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(13894656)))]; tensor var_2268_cast_fp16 = mul(x = stages_2_transformer_layers_1_layer_scale_2_scale_to_fp16, y = linear_36_cast_fp16)[name = string("op_2268_cast_fp16")]; tensor input_123_cast_fp16 = add(x = input_115_cast_fp16, y = var_2268_cast_fp16)[name = string("input_123_cast_fp16")]; tensor stages_2_output_proj_weight_to_fp16 = const()[name = string("stages_2_output_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(13895232)))]; tensor linear_37_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_2_output_proj_weight_to_fp16, x = input_123_cast_fp16)[name = string("linear_37_cast_fp16")]; tensor x_43_perm_0 = const()[name = string("x_43_perm_0"), val = tensor([0, 2, 1])]; tensor var_2281 = const()[name = string("op_2281"), val = tensor([1, 384, 2, 16])]; tensor x_43_cast_fp16 = transpose(perm = x_43_perm_0, x = linear_37_cast_fp16)[name = string("transpose_13")]; tensor var_2282_cast_fp16 = reshape(shape = var_2281, x = x_43_cast_fp16)[name = string("op_2282_cast_fp16")]; tensor var_2287 = const()[name = string("op_2287"), val = tensor([0, 1, 3, 2])]; tensor var_2292 = const()[name = string("op_2292"), val = tensor([1, 384, 32])]; tensor var_2288_cast_fp16 = transpose(perm = var_2287, x = var_2282_cast_fp16)[name = string("transpose_12")]; tensor x_45_cast_fp16 = reshape(shape = var_2292, x = var_2288_cast_fp16)[name = string("x_45_cast_fp16")]; tensor input_125_perm_0 = const()[name = string("input_125_perm_0"), val = tensor([0, 2, 1])]; tensor stages_3_input_proj_weight_to_fp16 = const()[name = string("stages_3_input_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(14288512)))]; tensor input_125_cast_fp16 = transpose(perm = input_125_perm_0, x = x_45_cast_fp16)[name = string("transpose_11")]; tensor linear_38_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_input_proj_weight_to_fp16, x = input_125_cast_fp16)[name = string("linear_38_cast_fp16")]; tensor input_129_axes_0 = const()[name = string("input_129_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_0_norm1_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(14485184)))]; tensor stages_3_transformer_layers_0_norm1_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_0_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(14485760)))]; fp16 var_2301_to_fp16 = const()[name = string("op_2301_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_129_cast_fp16 = layer_norm(axes = input_129_axes_0, beta = stages_3_transformer_layers_0_norm1_bias_to_fp16, epsilon = var_2301_to_fp16, gamma = stages_3_transformer_layers_0_norm1_weight_to_fp16, x = linear_38_cast_fp16)[name = string("input_129_cast_fp16")]; tensor stages_3_transformer_layers_0_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(14486336)))]; tensor linear_39_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_3_transformer_layers_0_self_attn_in_proj_weight_to_fp16, x = input_129_cast_fp16)[name = string("linear_39_cast_fp16")]; tensor var_2315 = const()[name = string("op_2315"), val = tensor([1, 32, 3, 4, 64])]; tensor var_2316_cast_fp16 = reshape(shape = var_2315, x = linear_39_cast_fp16)[name = string("op_2316_cast_fp16")]; tensor var_2322 = const()[name = string("op_2322"), val = tensor([2, 0, 3, 1, 4])]; tensor query_49_begin_0 = const()[name = string("query_49_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_49_end_0 = const()[name = string("query_49_end_0"), val = tensor([1, 1, 4, 32, 64])]; tensor query_49_end_mask_0 = const()[name = string("query_49_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_49_squeeze_mask_0 = const()[name = string("query_49_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_35_cast_fp16 = transpose(perm = var_2322, x = var_2316_cast_fp16)[name = string("transpose_10")]; tensor query_49_cast_fp16 = slice_by_index(begin = query_49_begin_0, end = query_49_end_0, end_mask = query_49_end_mask_0, squeeze_mask = query_49_squeeze_mask_0, x = qkv_35_cast_fp16)[name = string("query_49_cast_fp16")]; tensor key_49_begin_0 = const()[name = string("key_49_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_49_end_0 = const()[name = string("key_49_end_0"), val = tensor([2, 1, 4, 32, 64])]; tensor key_49_end_mask_0 = const()[name = string("key_49_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_49_squeeze_mask_0 = const()[name = string("key_49_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_49_cast_fp16 = slice_by_index(begin = key_49_begin_0, end = key_49_end_0, end_mask = key_49_end_mask_0, squeeze_mask = key_49_squeeze_mask_0, x = qkv_35_cast_fp16)[name = string("key_49_cast_fp16")]; tensor value_17_begin_0 = const()[name = string("value_17_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_17_end_0 = const()[name = string("value_17_end_0"), val = tensor([3, 1, 4, 32, 64])]; tensor value_17_end_mask_0 = const()[name = string("value_17_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_17_squeeze_mask_0 = const()[name = string("value_17_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_17_cast_fp16 = slice_by_index(begin = value_17_begin_0, end = value_17_end_0, end_mask = value_17_end_mask_0, squeeze_mask = value_17_squeeze_mask_0, x = qkv_35_cast_fp16)[name = string("value_17_cast_fp16")]; tensor var_2338 = const()[name = string("op_2338"), val = tensor([1, 4, 32, 32, 2])]; tensor query_pairs_17_cast_fp16 = reshape(shape = var_2338, x = query_49_cast_fp16)[name = string("query_pairs_17_cast_fp16")]; tensor var_2345 = const()[name = string("op_2345"), val = tensor([1, 4, 32, 32, 2])]; tensor key_pairs_17_cast_fp16 = reshape(shape = var_2345, x = key_49_cast_fp16)[name = string("key_pairs_17_cast_fp16")]; tensor qr_17_begin_0 = const()[name = string("qr_17_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_17_end_0 = const()[name = string("qr_17_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor qr_17_end_mask_0 = const()[name = string("qr_17_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_17_squeeze_mask_0 = const()[name = string("qr_17_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_17_cast_fp16 = slice_by_index(begin = qr_17_begin_0, end = qr_17_end_0, end_mask = qr_17_end_mask_0, squeeze_mask = qr_17_squeeze_mask_0, x = query_pairs_17_cast_fp16)[name = string("qr_17_cast_fp16")]; tensor qi_17_begin_0 = const()[name = string("qi_17_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_17_end_0 = const()[name = string("qi_17_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor qi_17_end_mask_0 = const()[name = string("qi_17_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_17_squeeze_mask_0 = const()[name = string("qi_17_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_17_cast_fp16 = slice_by_index(begin = qi_17_begin_0, end = qi_17_end_0, end_mask = qi_17_end_mask_0, squeeze_mask = qi_17_squeeze_mask_0, x = query_pairs_17_cast_fp16)[name = string("qi_17_cast_fp16")]; tensor kr_17_begin_0 = const()[name = string("kr_17_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_17_end_0 = const()[name = string("kr_17_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor kr_17_end_mask_0 = const()[name = string("kr_17_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_17_squeeze_mask_0 = const()[name = string("kr_17_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_17_cast_fp16 = slice_by_index(begin = kr_17_begin_0, end = kr_17_end_0, end_mask = kr_17_end_mask_0, squeeze_mask = kr_17_squeeze_mask_0, x = key_pairs_17_cast_fp16)[name = string("kr_17_cast_fp16")]; tensor ki_17_begin_0 = const()[name = string("ki_17_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_17_end_0 = const()[name = string("ki_17_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor ki_17_end_mask_0 = const()[name = string("ki_17_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_17_squeeze_mask_0 = const()[name = string("ki_17_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_17_cast_fp16 = slice_by_index(begin = ki_17_begin_0, end = ki_17_end_0, end_mask = ki_17_end_mask_0, squeeze_mask = ki_17_squeeze_mask_0, x = key_pairs_17_cast_fp16)[name = string("ki_17_cast_fp16")]; tensor var_2359_cast_fp16 = mul(x = qr_17_cast_fp16, y = s3_cos)[name = string("op_2359_cast_fp16")]; tensor var_2360_cast_fp16 = mul(x = qi_17_cast_fp16, y = s3_sin)[name = string("op_2360_cast_fp16")]; tensor var_2362_cast_fp16 = sub(x = var_2359_cast_fp16, y = var_2360_cast_fp16)[name = string("op_2362_cast_fp16")]; tensor var_2363_cast_fp16 = mul(x = qr_17_cast_fp16, y = s3_sin)[name = string("op_2363_cast_fp16")]; tensor var_2364_cast_fp16 = mul(x = qi_17_cast_fp16, y = s3_cos)[name = string("op_2364_cast_fp16")]; tensor var_2366_cast_fp16 = add(x = var_2363_cast_fp16, y = var_2364_cast_fp16)[name = string("op_2366_cast_fp16")]; int32 query_51_axis_0 = const()[name = string("query_51_axis_0"), val = int32(-1)]; tensor query_51_cast_fp16 = stack(axis = query_51_axis_0, values = (var_2362_cast_fp16, var_2366_cast_fp16))[name = string("query_51_cast_fp16")]; tensor var_2370_cast_fp16 = mul(x = kr_17_cast_fp16, y = s3_cos)[name = string("op_2370_cast_fp16")]; tensor var_2371_cast_fp16 = mul(x = ki_17_cast_fp16, y = s3_sin)[name = string("op_2371_cast_fp16")]; tensor var_2373_cast_fp16 = sub(x = var_2370_cast_fp16, y = var_2371_cast_fp16)[name = string("op_2373_cast_fp16")]; tensor var_2374_cast_fp16 = mul(x = kr_17_cast_fp16, y = s3_sin)[name = string("op_2374_cast_fp16")]; tensor var_2375_cast_fp16 = mul(x = ki_17_cast_fp16, y = s3_cos)[name = string("op_2375_cast_fp16")]; tensor var_2377_cast_fp16 = add(x = var_2374_cast_fp16, y = var_2375_cast_fp16)[name = string("op_2377_cast_fp16")]; int32 key_51_axis_0 = const()[name = string("key_51_axis_0"), val = int32(-1)]; tensor key_51_cast_fp16 = stack(axis = key_51_axis_0, values = (var_2373_cast_fp16, var_2377_cast_fp16))[name = string("key_51_cast_fp16")]; tensor var_2385 = const()[name = string("op_2385"), val = tensor([1, 4, 32, 64])]; tensor query_53_cast_fp16 = reshape(shape = var_2385, x = query_51_cast_fp16)[name = string("query_53_cast_fp16")]; tensor var_2391 = const()[name = string("op_2391"), val = tensor([1, 4, 32, 64])]; tensor key_53_cast_fp16 = reshape(shape = var_2391, x = key_51_cast_fp16)[name = string("key_53_cast_fp16")]; tensor read_state_16 = read_state(input = s3_l0_k)[name = string("read_state_16")]; tensor var_2407_begin_0 = const()[name = string("op_2407_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2407_end_0 = const()[name = string("op_2407_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2407_end_mask_0 = const()[name = string("op_2407_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2407_cast_fp16 = slice_by_index(begin = var_2407_begin_0, end = var_2407_end_0, end_mask = var_2407_end_mask_0, x = read_state_16)[name = string("op_2407_cast_fp16")]; int32 var_2414 = const()[name = string("op_2414"), val = int32(2)]; bool new_key_17_interleave_0 = const()[name = string("new_key_17_interleave_0"), val = bool(false)]; tensor new_key_17_cast_fp16 = concat(axis = var_2414, interleave = new_key_17_interleave_0, values = (var_2407_cast_fp16, key_53_cast_fp16))[name = string("new_key_17_cast_fp16")]; tensor read_state_17 = read_state(input = s3_l0_v)[name = string("read_state_17")]; tensor var_2430_begin_0 = const()[name = string("op_2430_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2430_end_0 = const()[name = string("op_2430_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2430_end_mask_0 = const()[name = string("op_2430_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2430_cast_fp16 = slice_by_index(begin = var_2430_begin_0, end = var_2430_end_0, end_mask = var_2430_end_mask_0, x = read_state_17)[name = string("op_2430_cast_fp16")]; int32 var_2437 = const()[name = string("op_2437"), val = int32(2)]; bool new_value_17_interleave_0 = const()[name = string("new_value_17_interleave_0"), val = bool(false)]; tensor new_value_17_cast_fp16 = concat(axis = var_2437, interleave = new_value_17_interleave_0, values = (var_2430_cast_fp16, value_17_cast_fp16))[name = string("new_value_17_cast_fp16")]; tensor concat_32 = const()[name = string("concat_32"), val = tensor([0, 0, 0, 0])]; tensor concat_33 = const()[name = string("concat_33"), val = tensor([0, 0, 0, 0])]; tensor s3_l0_k_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l0_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l0_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l0_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l0_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l0_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l0_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l0_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l0_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_32, begin_mask = s3_l0_k_internal_tensor_assign_1_begin_mask_0, end = concat_33, end_mask = s3_l0_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l0_k_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l0_k_internal_tensor_assign_1_stride_0, update = new_key_17_cast_fp16, x = read_state_16)[name = string("s3_l0_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l0_k_internal_tensor_assign_1_cast_fp16, input = s3_l0_k)[name = string("coreml_update_state_40_write_state")]; tensor concat_34 = const()[name = string("concat_34"), val = tensor([0, 0, 0, 0])]; tensor concat_35 = const()[name = string("concat_35"), val = tensor([0, 0, 0, 0])]; tensor s3_l0_v_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l0_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l0_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l0_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l0_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l0_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l0_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l0_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l0_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_34, begin_mask = s3_l0_v_internal_tensor_assign_1_begin_mask_0, end = concat_35, end_mask = s3_l0_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l0_v_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l0_v_internal_tensor_assign_1_stride_0, update = new_value_17_cast_fp16, x = read_state_17)[name = string("s3_l0_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l0_v_internal_tensor_assign_1_cast_fp16, input = s3_l0_v)[name = string("coreml_update_state_41_write_state")]; bool var_2456_transpose_x_1 = const()[name = string("op_2456_transpose_x_1"), val = bool(false)]; bool var_2456_transpose_y_1 = const()[name = string("op_2456_transpose_y_1"), val = bool(true)]; tensor var_2456_cast_fp16 = matmul(transpose_x = var_2456_transpose_x_1, transpose_y = var_2456_transpose_y_1, x = query_53_cast_fp16, y = new_key_17_cast_fp16)[name = string("op_2456_cast_fp16")]; fp16 var_2457_to_fp16 = const()[name = string("op_2457_to_fp16"), val = fp16(0x1p-3)]; tensor scores_17_cast_fp16 = mul(x = var_2456_cast_fp16, y = var_2457_to_fp16)[name = string("scores_17_cast_fp16")]; tensor var_2460_cast_fp16 = add(x = scores_17_cast_fp16, y = s3_mask)[name = string("op_2460_cast_fp16")]; int32 var_2461 = const()[name = string("op_2461"), val = int32(-1)]; tensor probabilities_17_cast_fp16 = softmax(axis = var_2461, x = var_2460_cast_fp16)[name = string("probabilities_17_cast_fp16")]; bool attention_17_transpose_x_0 = const()[name = string("attention_17_transpose_x_0"), val = bool(false)]; bool attention_17_transpose_y_0 = const()[name = string("attention_17_transpose_y_0"), val = bool(false)]; tensor attention_17_cast_fp16 = matmul(transpose_x = attention_17_transpose_x_0, transpose_y = attention_17_transpose_y_0, x = probabilities_17_cast_fp16, y = new_value_17_cast_fp16)[name = string("attention_17_cast_fp16")]; tensor var_2467_perm_0 = const()[name = string("op_2467_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_2471 = const()[name = string("op_2471"), val = tensor([1, 32, 256])]; tensor var_2467_cast_fp16 = transpose(perm = var_2467_perm_0, x = attention_17_cast_fp16)[name = string("transpose_9")]; tensor input_131_cast_fp16 = reshape(shape = var_2471, x = var_2467_cast_fp16)[name = string("input_131_cast_fp16")]; tensor stages_3_transformer_layers_0_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(14879616)))]; tensor linear_40_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_0_self_attn_out_proj_weight_to_fp16, x = input_131_cast_fp16)[name = string("linear_40_cast_fp16")]; tensor stages_3_transformer_layers_0_layer_scale_1_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_0_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(15010752)))]; tensor var_2477_cast_fp16 = mul(x = stages_3_transformer_layers_0_layer_scale_1_scale_to_fp16, y = linear_40_cast_fp16)[name = string("op_2477_cast_fp16")]; tensor input_133_cast_fp16 = add(x = linear_38_cast_fp16, y = var_2477_cast_fp16)[name = string("input_133_cast_fp16")]; tensor input_135_axes_0 = const()[name = string("input_135_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_0_norm2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(15011328)))]; tensor stages_3_transformer_layers_0_norm2_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_0_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(15011904)))]; fp16 var_2481_to_fp16 = const()[name = string("op_2481_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_135_cast_fp16 = layer_norm(axes = input_135_axes_0, beta = stages_3_transformer_layers_0_norm2_bias_to_fp16, epsilon = var_2481_to_fp16, gamma = stages_3_transformer_layers_0_norm2_weight_to_fp16, x = input_133_cast_fp16)[name = string("input_135_cast_fp16")]; tensor stages_3_transformer_layers_0_ffn_0_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(15012480)))]; tensor linear_41_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_3_transformer_layers_0_ffn_0_weight_to_fp16, x = input_135_cast_fp16)[name = string("linear_41_cast_fp16")]; string input_139_mode_0 = const()[name = string("input_139_mode_0"), val = string("EXACT")]; tensor input_139_cast_fp16 = gelu(mode = input_139_mode_0, x = linear_41_cast_fp16)[name = string("input_139_cast_fp16")]; tensor stages_3_transformer_layers_0_ffn_2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_0_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(15536832)))]; tensor linear_42_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_0_ffn_2_weight_to_fp16, x = input_139_cast_fp16)[name = string("linear_42_cast_fp16")]; tensor stages_3_transformer_layers_0_layer_scale_2_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_0_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16061184)))]; tensor var_2497_cast_fp16 = mul(x = stages_3_transformer_layers_0_layer_scale_2_scale_to_fp16, y = linear_42_cast_fp16)[name = string("op_2497_cast_fp16")]; tensor input_141_cast_fp16 = add(x = input_133_cast_fp16, y = var_2497_cast_fp16)[name = string("input_141_cast_fp16")]; tensor input_143_axes_0 = const()[name = string("input_143_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_1_norm1_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16061760)))]; tensor stages_3_transformer_layers_1_norm1_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_1_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16062336)))]; fp16 var_2501_to_fp16 = const()[name = string("op_2501_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_143_cast_fp16 = layer_norm(axes = input_143_axes_0, beta = stages_3_transformer_layers_1_norm1_bias_to_fp16, epsilon = var_2501_to_fp16, gamma = stages_3_transformer_layers_1_norm1_weight_to_fp16, x = input_141_cast_fp16)[name = string("input_143_cast_fp16")]; tensor stages_3_transformer_layers_1_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16062912)))]; tensor linear_43_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_3_transformer_layers_1_self_attn_in_proj_weight_to_fp16, x = input_143_cast_fp16)[name = string("linear_43_cast_fp16")]; tensor var_2515 = const()[name = string("op_2515"), val = tensor([1, 32, 3, 4, 64])]; tensor var_2516_cast_fp16 = reshape(shape = var_2515, x = linear_43_cast_fp16)[name = string("op_2516_cast_fp16")]; tensor var_2522 = const()[name = string("op_2522"), val = tensor([2, 0, 3, 1, 4])]; tensor query_55_begin_0 = const()[name = string("query_55_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_55_end_0 = const()[name = string("query_55_end_0"), val = tensor([1, 1, 4, 32, 64])]; tensor query_55_end_mask_0 = const()[name = string("query_55_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_55_squeeze_mask_0 = const()[name = string("query_55_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_39_cast_fp16 = transpose(perm = var_2522, x = var_2516_cast_fp16)[name = string("transpose_8")]; tensor query_55_cast_fp16 = slice_by_index(begin = query_55_begin_0, end = query_55_end_0, end_mask = query_55_end_mask_0, squeeze_mask = query_55_squeeze_mask_0, x = qkv_39_cast_fp16)[name = string("query_55_cast_fp16")]; tensor key_55_begin_0 = const()[name = string("key_55_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_55_end_0 = const()[name = string("key_55_end_0"), val = tensor([2, 1, 4, 32, 64])]; tensor key_55_end_mask_0 = const()[name = string("key_55_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_55_squeeze_mask_0 = const()[name = string("key_55_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_55_cast_fp16 = slice_by_index(begin = key_55_begin_0, end = key_55_end_0, end_mask = key_55_end_mask_0, squeeze_mask = key_55_squeeze_mask_0, x = qkv_39_cast_fp16)[name = string("key_55_cast_fp16")]; tensor value_19_begin_0 = const()[name = string("value_19_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_19_end_0 = const()[name = string("value_19_end_0"), val = tensor([3, 1, 4, 32, 64])]; tensor value_19_end_mask_0 = const()[name = string("value_19_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_19_squeeze_mask_0 = const()[name = string("value_19_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_19_cast_fp16 = slice_by_index(begin = value_19_begin_0, end = value_19_end_0, end_mask = value_19_end_mask_0, squeeze_mask = value_19_squeeze_mask_0, x = qkv_39_cast_fp16)[name = string("value_19_cast_fp16")]; tensor var_2538 = const()[name = string("op_2538"), val = tensor([1, 4, 32, 32, 2])]; tensor query_pairs_19_cast_fp16 = reshape(shape = var_2538, x = query_55_cast_fp16)[name = string("query_pairs_19_cast_fp16")]; tensor var_2545 = const()[name = string("op_2545"), val = tensor([1, 4, 32, 32, 2])]; tensor key_pairs_19_cast_fp16 = reshape(shape = var_2545, x = key_55_cast_fp16)[name = string("key_pairs_19_cast_fp16")]; tensor qr_19_begin_0 = const()[name = string("qr_19_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_19_end_0 = const()[name = string("qr_19_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor qr_19_end_mask_0 = const()[name = string("qr_19_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_19_squeeze_mask_0 = const()[name = string("qr_19_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_19_cast_fp16 = slice_by_index(begin = qr_19_begin_0, end = qr_19_end_0, end_mask = qr_19_end_mask_0, squeeze_mask = qr_19_squeeze_mask_0, x = query_pairs_19_cast_fp16)[name = string("qr_19_cast_fp16")]; tensor qi_19_begin_0 = const()[name = string("qi_19_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_19_end_0 = const()[name = string("qi_19_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor qi_19_end_mask_0 = const()[name = string("qi_19_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_19_squeeze_mask_0 = const()[name = string("qi_19_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_19_cast_fp16 = slice_by_index(begin = qi_19_begin_0, end = qi_19_end_0, end_mask = qi_19_end_mask_0, squeeze_mask = qi_19_squeeze_mask_0, x = query_pairs_19_cast_fp16)[name = string("qi_19_cast_fp16")]; tensor kr_19_begin_0 = const()[name = string("kr_19_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_19_end_0 = const()[name = string("kr_19_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor kr_19_end_mask_0 = const()[name = string("kr_19_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_19_squeeze_mask_0 = const()[name = string("kr_19_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_19_cast_fp16 = slice_by_index(begin = kr_19_begin_0, end = kr_19_end_0, end_mask = kr_19_end_mask_0, squeeze_mask = kr_19_squeeze_mask_0, x = key_pairs_19_cast_fp16)[name = string("kr_19_cast_fp16")]; tensor ki_19_begin_0 = const()[name = string("ki_19_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_19_end_0 = const()[name = string("ki_19_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor ki_19_end_mask_0 = const()[name = string("ki_19_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_19_squeeze_mask_0 = const()[name = string("ki_19_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_19_cast_fp16 = slice_by_index(begin = ki_19_begin_0, end = ki_19_end_0, end_mask = ki_19_end_mask_0, squeeze_mask = ki_19_squeeze_mask_0, x = key_pairs_19_cast_fp16)[name = string("ki_19_cast_fp16")]; tensor var_2559_cast_fp16 = mul(x = qr_19_cast_fp16, y = s3_cos)[name = string("op_2559_cast_fp16")]; tensor var_2560_cast_fp16 = mul(x = qi_19_cast_fp16, y = s3_sin)[name = string("op_2560_cast_fp16")]; tensor var_2562_cast_fp16 = sub(x = var_2559_cast_fp16, y = var_2560_cast_fp16)[name = string("op_2562_cast_fp16")]; tensor var_2563_cast_fp16 = mul(x = qr_19_cast_fp16, y = s3_sin)[name = string("op_2563_cast_fp16")]; tensor var_2564_cast_fp16 = mul(x = qi_19_cast_fp16, y = s3_cos)[name = string("op_2564_cast_fp16")]; tensor var_2566_cast_fp16 = add(x = var_2563_cast_fp16, y = var_2564_cast_fp16)[name = string("op_2566_cast_fp16")]; int32 query_57_axis_0 = const()[name = string("query_57_axis_0"), val = int32(-1)]; tensor query_57_cast_fp16 = stack(axis = query_57_axis_0, values = (var_2562_cast_fp16, var_2566_cast_fp16))[name = string("query_57_cast_fp16")]; tensor var_2570_cast_fp16 = mul(x = kr_19_cast_fp16, y = s3_cos)[name = string("op_2570_cast_fp16")]; tensor var_2571_cast_fp16 = mul(x = ki_19_cast_fp16, y = s3_sin)[name = string("op_2571_cast_fp16")]; tensor var_2573_cast_fp16 = sub(x = var_2570_cast_fp16, y = var_2571_cast_fp16)[name = string("op_2573_cast_fp16")]; tensor var_2574_cast_fp16 = mul(x = kr_19_cast_fp16, y = s3_sin)[name = string("op_2574_cast_fp16")]; tensor var_2575_cast_fp16 = mul(x = ki_19_cast_fp16, y = s3_cos)[name = string("op_2575_cast_fp16")]; tensor var_2577_cast_fp16 = add(x = var_2574_cast_fp16, y = var_2575_cast_fp16)[name = string("op_2577_cast_fp16")]; int32 key_57_axis_0 = const()[name = string("key_57_axis_0"), val = int32(-1)]; tensor key_57_cast_fp16 = stack(axis = key_57_axis_0, values = (var_2573_cast_fp16, var_2577_cast_fp16))[name = string("key_57_cast_fp16")]; tensor var_2585 = const()[name = string("op_2585"), val = tensor([1, 4, 32, 64])]; tensor query_59_cast_fp16 = reshape(shape = var_2585, x = query_57_cast_fp16)[name = string("query_59_cast_fp16")]; tensor var_2591 = const()[name = string("op_2591"), val = tensor([1, 4, 32, 64])]; tensor key_59_cast_fp16 = reshape(shape = var_2591, x = key_57_cast_fp16)[name = string("key_59_cast_fp16")]; tensor read_state_18 = read_state(input = s3_l1_k)[name = string("read_state_18")]; tensor var_2607_begin_0 = const()[name = string("op_2607_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2607_end_0 = const()[name = string("op_2607_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2607_end_mask_0 = const()[name = string("op_2607_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2607_cast_fp16 = slice_by_index(begin = var_2607_begin_0, end = var_2607_end_0, end_mask = var_2607_end_mask_0, x = read_state_18)[name = string("op_2607_cast_fp16")]; int32 var_2614 = const()[name = string("op_2614"), val = int32(2)]; bool new_key_19_interleave_0 = const()[name = string("new_key_19_interleave_0"), val = bool(false)]; tensor new_key_19_cast_fp16 = concat(axis = var_2614, interleave = new_key_19_interleave_0, values = (var_2607_cast_fp16, key_59_cast_fp16))[name = string("new_key_19_cast_fp16")]; tensor read_state_19 = read_state(input = s3_l1_v)[name = string("read_state_19")]; tensor var_2630_begin_0 = const()[name = string("op_2630_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2630_end_0 = const()[name = string("op_2630_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2630_end_mask_0 = const()[name = string("op_2630_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2630_cast_fp16 = slice_by_index(begin = var_2630_begin_0, end = var_2630_end_0, end_mask = var_2630_end_mask_0, x = read_state_19)[name = string("op_2630_cast_fp16")]; int32 var_2637 = const()[name = string("op_2637"), val = int32(2)]; bool new_value_19_interleave_0 = const()[name = string("new_value_19_interleave_0"), val = bool(false)]; tensor new_value_19_cast_fp16 = concat(axis = var_2637, interleave = new_value_19_interleave_0, values = (var_2630_cast_fp16, value_19_cast_fp16))[name = string("new_value_19_cast_fp16")]; tensor concat_36 = const()[name = string("concat_36"), val = tensor([0, 0, 0, 0])]; tensor concat_37 = const()[name = string("concat_37"), val = tensor([0, 0, 0, 0])]; tensor s3_l1_k_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l1_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l1_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l1_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l1_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l1_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l1_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l1_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l1_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_36, begin_mask = s3_l1_k_internal_tensor_assign_1_begin_mask_0, end = concat_37, end_mask = s3_l1_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l1_k_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l1_k_internal_tensor_assign_1_stride_0, update = new_key_19_cast_fp16, x = read_state_18)[name = string("s3_l1_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l1_k_internal_tensor_assign_1_cast_fp16, input = s3_l1_k)[name = string("coreml_update_state_42_write_state")]; tensor concat_38 = const()[name = string("concat_38"), val = tensor([0, 0, 0, 0])]; tensor concat_39 = const()[name = string("concat_39"), val = tensor([0, 0, 0, 0])]; tensor s3_l1_v_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l1_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l1_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l1_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l1_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l1_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l1_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l1_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l1_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_38, begin_mask = s3_l1_v_internal_tensor_assign_1_begin_mask_0, end = concat_39, end_mask = s3_l1_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l1_v_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l1_v_internal_tensor_assign_1_stride_0, update = new_value_19_cast_fp16, x = read_state_19)[name = string("s3_l1_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l1_v_internal_tensor_assign_1_cast_fp16, input = s3_l1_v)[name = string("coreml_update_state_43_write_state")]; bool var_2656_transpose_x_1 = const()[name = string("op_2656_transpose_x_1"), val = bool(false)]; bool var_2656_transpose_y_1 = const()[name = string("op_2656_transpose_y_1"), val = bool(true)]; tensor var_2656_cast_fp16 = matmul(transpose_x = var_2656_transpose_x_1, transpose_y = var_2656_transpose_y_1, x = query_59_cast_fp16, y = new_key_19_cast_fp16)[name = string("op_2656_cast_fp16")]; fp16 var_2657_to_fp16 = const()[name = string("op_2657_to_fp16"), val = fp16(0x1p-3)]; tensor scores_19_cast_fp16 = mul(x = var_2656_cast_fp16, y = var_2657_to_fp16)[name = string("scores_19_cast_fp16")]; tensor var_2660_cast_fp16 = add(x = scores_19_cast_fp16, y = s3_mask)[name = string("op_2660_cast_fp16")]; int32 var_2661 = const()[name = string("op_2661"), val = int32(-1)]; tensor probabilities_19_cast_fp16 = softmax(axis = var_2661, x = var_2660_cast_fp16)[name = string("probabilities_19_cast_fp16")]; bool attention_19_transpose_x_0 = const()[name = string("attention_19_transpose_x_0"), val = bool(false)]; bool attention_19_transpose_y_0 = const()[name = string("attention_19_transpose_y_0"), val = bool(false)]; tensor attention_19_cast_fp16 = matmul(transpose_x = attention_19_transpose_x_0, transpose_y = attention_19_transpose_y_0, x = probabilities_19_cast_fp16, y = new_value_19_cast_fp16)[name = string("attention_19_cast_fp16")]; tensor var_2667_perm_0 = const()[name = string("op_2667_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_2671 = const()[name = string("op_2671"), val = tensor([1, 32, 256])]; tensor var_2667_cast_fp16 = transpose(perm = var_2667_perm_0, x = attention_19_cast_fp16)[name = string("transpose_7")]; tensor input_145_cast_fp16 = reshape(shape = var_2671, x = var_2667_cast_fp16)[name = string("input_145_cast_fp16")]; tensor stages_3_transformer_layers_1_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16456192)))]; tensor linear_44_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_1_self_attn_out_proj_weight_to_fp16, x = input_145_cast_fp16)[name = string("linear_44_cast_fp16")]; tensor stages_3_transformer_layers_1_layer_scale_1_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_1_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16587328)))]; tensor var_2677_cast_fp16 = mul(x = stages_3_transformer_layers_1_layer_scale_1_scale_to_fp16, y = linear_44_cast_fp16)[name = string("op_2677_cast_fp16")]; tensor input_147_cast_fp16 = add(x = input_141_cast_fp16, y = var_2677_cast_fp16)[name = string("input_147_cast_fp16")]; tensor input_149_axes_0 = const()[name = string("input_149_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_1_norm2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16587904)))]; tensor stages_3_transformer_layers_1_norm2_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_1_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16588480)))]; fp16 var_2681_to_fp16 = const()[name = string("op_2681_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_149_cast_fp16 = layer_norm(axes = input_149_axes_0, beta = stages_3_transformer_layers_1_norm2_bias_to_fp16, epsilon = var_2681_to_fp16, gamma = stages_3_transformer_layers_1_norm2_weight_to_fp16, x = input_147_cast_fp16)[name = string("input_149_cast_fp16")]; tensor stages_3_transformer_layers_1_ffn_0_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(16589056)))]; tensor linear_45_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_3_transformer_layers_1_ffn_0_weight_to_fp16, x = input_149_cast_fp16)[name = string("linear_45_cast_fp16")]; string input_153_mode_0 = const()[name = string("input_153_mode_0"), val = string("EXACT")]; tensor input_153_cast_fp16 = gelu(mode = input_153_mode_0, x = linear_45_cast_fp16)[name = string("input_153_cast_fp16")]; tensor stages_3_transformer_layers_1_ffn_2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_1_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(17113408)))]; tensor linear_46_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_1_ffn_2_weight_to_fp16, x = input_153_cast_fp16)[name = string("linear_46_cast_fp16")]; tensor stages_3_transformer_layers_1_layer_scale_2_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_1_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(17637760)))]; tensor var_2697_cast_fp16 = mul(x = stages_3_transformer_layers_1_layer_scale_2_scale_to_fp16, y = linear_46_cast_fp16)[name = string("op_2697_cast_fp16")]; tensor input_155_cast_fp16 = add(x = input_147_cast_fp16, y = var_2697_cast_fp16)[name = string("input_155_cast_fp16")]; tensor input_157_axes_0 = const()[name = string("input_157_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_2_norm1_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(17638336)))]; tensor stages_3_transformer_layers_2_norm1_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_2_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(17638912)))]; fp16 var_2701_to_fp16 = const()[name = string("op_2701_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_157_cast_fp16 = layer_norm(axes = input_157_axes_0, beta = stages_3_transformer_layers_2_norm1_bias_to_fp16, epsilon = var_2701_to_fp16, gamma = stages_3_transformer_layers_2_norm1_weight_to_fp16, x = input_155_cast_fp16)[name = string("input_157_cast_fp16")]; tensor stages_3_transformer_layers_2_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(17639488)))]; tensor linear_47_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_3_transformer_layers_2_self_attn_in_proj_weight_to_fp16, x = input_157_cast_fp16)[name = string("linear_47_cast_fp16")]; tensor var_2715 = const()[name = string("op_2715"), val = tensor([1, 32, 3, 4, 64])]; tensor var_2716_cast_fp16 = reshape(shape = var_2715, x = linear_47_cast_fp16)[name = string("op_2716_cast_fp16")]; tensor var_2722 = const()[name = string("op_2722"), val = tensor([2, 0, 3, 1, 4])]; tensor query_61_begin_0 = const()[name = string("query_61_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_61_end_0 = const()[name = string("query_61_end_0"), val = tensor([1, 1, 4, 32, 64])]; tensor query_61_end_mask_0 = const()[name = string("query_61_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_61_squeeze_mask_0 = const()[name = string("query_61_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_43_cast_fp16 = transpose(perm = var_2722, x = var_2716_cast_fp16)[name = string("transpose_6")]; tensor query_61_cast_fp16 = slice_by_index(begin = query_61_begin_0, end = query_61_end_0, end_mask = query_61_end_mask_0, squeeze_mask = query_61_squeeze_mask_0, x = qkv_43_cast_fp16)[name = string("query_61_cast_fp16")]; tensor key_61_begin_0 = const()[name = string("key_61_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_61_end_0 = const()[name = string("key_61_end_0"), val = tensor([2, 1, 4, 32, 64])]; tensor key_61_end_mask_0 = const()[name = string("key_61_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_61_squeeze_mask_0 = const()[name = string("key_61_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_61_cast_fp16 = slice_by_index(begin = key_61_begin_0, end = key_61_end_0, end_mask = key_61_end_mask_0, squeeze_mask = key_61_squeeze_mask_0, x = qkv_43_cast_fp16)[name = string("key_61_cast_fp16")]; tensor value_21_begin_0 = const()[name = string("value_21_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_21_end_0 = const()[name = string("value_21_end_0"), val = tensor([3, 1, 4, 32, 64])]; tensor value_21_end_mask_0 = const()[name = string("value_21_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_21_squeeze_mask_0 = const()[name = string("value_21_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_21_cast_fp16 = slice_by_index(begin = value_21_begin_0, end = value_21_end_0, end_mask = value_21_end_mask_0, squeeze_mask = value_21_squeeze_mask_0, x = qkv_43_cast_fp16)[name = string("value_21_cast_fp16")]; tensor var_2738 = const()[name = string("op_2738"), val = tensor([1, 4, 32, 32, 2])]; tensor query_pairs_21_cast_fp16 = reshape(shape = var_2738, x = query_61_cast_fp16)[name = string("query_pairs_21_cast_fp16")]; tensor var_2745 = const()[name = string("op_2745"), val = tensor([1, 4, 32, 32, 2])]; tensor key_pairs_21_cast_fp16 = reshape(shape = var_2745, x = key_61_cast_fp16)[name = string("key_pairs_21_cast_fp16")]; tensor qr_21_begin_0 = const()[name = string("qr_21_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_21_end_0 = const()[name = string("qr_21_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor qr_21_end_mask_0 = const()[name = string("qr_21_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_21_squeeze_mask_0 = const()[name = string("qr_21_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_21_cast_fp16 = slice_by_index(begin = qr_21_begin_0, end = qr_21_end_0, end_mask = qr_21_end_mask_0, squeeze_mask = qr_21_squeeze_mask_0, x = query_pairs_21_cast_fp16)[name = string("qr_21_cast_fp16")]; tensor qi_21_begin_0 = const()[name = string("qi_21_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_21_end_0 = const()[name = string("qi_21_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor qi_21_end_mask_0 = const()[name = string("qi_21_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_21_squeeze_mask_0 = const()[name = string("qi_21_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_21_cast_fp16 = slice_by_index(begin = qi_21_begin_0, end = qi_21_end_0, end_mask = qi_21_end_mask_0, squeeze_mask = qi_21_squeeze_mask_0, x = query_pairs_21_cast_fp16)[name = string("qi_21_cast_fp16")]; tensor kr_21_begin_0 = const()[name = string("kr_21_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_21_end_0 = const()[name = string("kr_21_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor kr_21_end_mask_0 = const()[name = string("kr_21_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_21_squeeze_mask_0 = const()[name = string("kr_21_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_21_cast_fp16 = slice_by_index(begin = kr_21_begin_0, end = kr_21_end_0, end_mask = kr_21_end_mask_0, squeeze_mask = kr_21_squeeze_mask_0, x = key_pairs_21_cast_fp16)[name = string("kr_21_cast_fp16")]; tensor ki_21_begin_0 = const()[name = string("ki_21_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_21_end_0 = const()[name = string("ki_21_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor ki_21_end_mask_0 = const()[name = string("ki_21_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_21_squeeze_mask_0 = const()[name = string("ki_21_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_21_cast_fp16 = slice_by_index(begin = ki_21_begin_0, end = ki_21_end_0, end_mask = ki_21_end_mask_0, squeeze_mask = ki_21_squeeze_mask_0, x = key_pairs_21_cast_fp16)[name = string("ki_21_cast_fp16")]; tensor var_2759_cast_fp16 = mul(x = qr_21_cast_fp16, y = s3_cos)[name = string("op_2759_cast_fp16")]; tensor var_2760_cast_fp16 = mul(x = qi_21_cast_fp16, y = s3_sin)[name = string("op_2760_cast_fp16")]; tensor var_2762_cast_fp16 = sub(x = var_2759_cast_fp16, y = var_2760_cast_fp16)[name = string("op_2762_cast_fp16")]; tensor var_2763_cast_fp16 = mul(x = qr_21_cast_fp16, y = s3_sin)[name = string("op_2763_cast_fp16")]; tensor var_2764_cast_fp16 = mul(x = qi_21_cast_fp16, y = s3_cos)[name = string("op_2764_cast_fp16")]; tensor var_2766_cast_fp16 = add(x = var_2763_cast_fp16, y = var_2764_cast_fp16)[name = string("op_2766_cast_fp16")]; int32 query_63_axis_0 = const()[name = string("query_63_axis_0"), val = int32(-1)]; tensor query_63_cast_fp16 = stack(axis = query_63_axis_0, values = (var_2762_cast_fp16, var_2766_cast_fp16))[name = string("query_63_cast_fp16")]; tensor var_2770_cast_fp16 = mul(x = kr_21_cast_fp16, y = s3_cos)[name = string("op_2770_cast_fp16")]; tensor var_2771_cast_fp16 = mul(x = ki_21_cast_fp16, y = s3_sin)[name = string("op_2771_cast_fp16")]; tensor var_2773_cast_fp16 = sub(x = var_2770_cast_fp16, y = var_2771_cast_fp16)[name = string("op_2773_cast_fp16")]; tensor var_2774_cast_fp16 = mul(x = kr_21_cast_fp16, y = s3_sin)[name = string("op_2774_cast_fp16")]; tensor var_2775_cast_fp16 = mul(x = ki_21_cast_fp16, y = s3_cos)[name = string("op_2775_cast_fp16")]; tensor var_2777_cast_fp16 = add(x = var_2774_cast_fp16, y = var_2775_cast_fp16)[name = string("op_2777_cast_fp16")]; int32 key_63_axis_0 = const()[name = string("key_63_axis_0"), val = int32(-1)]; tensor key_63_cast_fp16 = stack(axis = key_63_axis_0, values = (var_2773_cast_fp16, var_2777_cast_fp16))[name = string("key_63_cast_fp16")]; tensor var_2785 = const()[name = string("op_2785"), val = tensor([1, 4, 32, 64])]; tensor query_65_cast_fp16 = reshape(shape = var_2785, x = query_63_cast_fp16)[name = string("query_65_cast_fp16")]; tensor var_2791 = const()[name = string("op_2791"), val = tensor([1, 4, 32, 64])]; tensor key_65_cast_fp16 = reshape(shape = var_2791, x = key_63_cast_fp16)[name = string("key_65_cast_fp16")]; tensor read_state_20 = read_state(input = s3_l2_k)[name = string("read_state_20")]; tensor var_2807_begin_0 = const()[name = string("op_2807_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2807_end_0 = const()[name = string("op_2807_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2807_end_mask_0 = const()[name = string("op_2807_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2807_cast_fp16 = slice_by_index(begin = var_2807_begin_0, end = var_2807_end_0, end_mask = var_2807_end_mask_0, x = read_state_20)[name = string("op_2807_cast_fp16")]; int32 var_2814 = const()[name = string("op_2814"), val = int32(2)]; bool new_key_21_interleave_0 = const()[name = string("new_key_21_interleave_0"), val = bool(false)]; tensor new_key_21_cast_fp16 = concat(axis = var_2814, interleave = new_key_21_interleave_0, values = (var_2807_cast_fp16, key_65_cast_fp16))[name = string("new_key_21_cast_fp16")]; tensor read_state_21 = read_state(input = s3_l2_v)[name = string("read_state_21")]; tensor var_2830_begin_0 = const()[name = string("op_2830_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_2830_end_0 = const()[name = string("op_2830_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_2830_end_mask_0 = const()[name = string("op_2830_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_2830_cast_fp16 = slice_by_index(begin = var_2830_begin_0, end = var_2830_end_0, end_mask = var_2830_end_mask_0, x = read_state_21)[name = string("op_2830_cast_fp16")]; int32 var_2837 = const()[name = string("op_2837"), val = int32(2)]; bool new_value_21_interleave_0 = const()[name = string("new_value_21_interleave_0"), val = bool(false)]; tensor new_value_21_cast_fp16 = concat(axis = var_2837, interleave = new_value_21_interleave_0, values = (var_2830_cast_fp16, value_21_cast_fp16))[name = string("new_value_21_cast_fp16")]; tensor concat_40 = const()[name = string("concat_40"), val = tensor([0, 0, 0, 0])]; tensor concat_41 = const()[name = string("concat_41"), val = tensor([0, 0, 0, 0])]; tensor s3_l2_k_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l2_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l2_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l2_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l2_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l2_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l2_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l2_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l2_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_40, begin_mask = s3_l2_k_internal_tensor_assign_1_begin_mask_0, end = concat_41, end_mask = s3_l2_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l2_k_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l2_k_internal_tensor_assign_1_stride_0, update = new_key_21_cast_fp16, x = read_state_20)[name = string("s3_l2_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l2_k_internal_tensor_assign_1_cast_fp16, input = s3_l2_k)[name = string("coreml_update_state_44_write_state")]; tensor concat_42 = const()[name = string("concat_42"), val = tensor([0, 0, 0, 0])]; tensor concat_43 = const()[name = string("concat_43"), val = tensor([0, 0, 0, 0])]; tensor s3_l2_v_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l2_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l2_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l2_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l2_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l2_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l2_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l2_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l2_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_42, begin_mask = s3_l2_v_internal_tensor_assign_1_begin_mask_0, end = concat_43, end_mask = s3_l2_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l2_v_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l2_v_internal_tensor_assign_1_stride_0, update = new_value_21_cast_fp16, x = read_state_21)[name = string("s3_l2_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l2_v_internal_tensor_assign_1_cast_fp16, input = s3_l2_v)[name = string("coreml_update_state_45_write_state")]; bool var_2856_transpose_x_1 = const()[name = string("op_2856_transpose_x_1"), val = bool(false)]; bool var_2856_transpose_y_1 = const()[name = string("op_2856_transpose_y_1"), val = bool(true)]; tensor var_2856_cast_fp16 = matmul(transpose_x = var_2856_transpose_x_1, transpose_y = var_2856_transpose_y_1, x = query_65_cast_fp16, y = new_key_21_cast_fp16)[name = string("op_2856_cast_fp16")]; fp16 var_2857_to_fp16 = const()[name = string("op_2857_to_fp16"), val = fp16(0x1p-3)]; tensor scores_21_cast_fp16 = mul(x = var_2856_cast_fp16, y = var_2857_to_fp16)[name = string("scores_21_cast_fp16")]; tensor var_2860_cast_fp16 = add(x = scores_21_cast_fp16, y = s3_mask)[name = string("op_2860_cast_fp16")]; int32 var_2861 = const()[name = string("op_2861"), val = int32(-1)]; tensor probabilities_21_cast_fp16 = softmax(axis = var_2861, x = var_2860_cast_fp16)[name = string("probabilities_21_cast_fp16")]; bool attention_21_transpose_x_0 = const()[name = string("attention_21_transpose_x_0"), val = bool(false)]; bool attention_21_transpose_y_0 = const()[name = string("attention_21_transpose_y_0"), val = bool(false)]; tensor attention_21_cast_fp16 = matmul(transpose_x = attention_21_transpose_x_0, transpose_y = attention_21_transpose_y_0, x = probabilities_21_cast_fp16, y = new_value_21_cast_fp16)[name = string("attention_21_cast_fp16")]; tensor var_2867_perm_0 = const()[name = string("op_2867_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_2871 = const()[name = string("op_2871"), val = tensor([1, 32, 256])]; tensor var_2867_cast_fp16 = transpose(perm = var_2867_perm_0, x = attention_21_cast_fp16)[name = string("transpose_5")]; tensor input_159_cast_fp16 = reshape(shape = var_2871, x = var_2867_cast_fp16)[name = string("input_159_cast_fp16")]; tensor stages_3_transformer_layers_2_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18032768)))]; tensor linear_48_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_2_self_attn_out_proj_weight_to_fp16, x = input_159_cast_fp16)[name = string("linear_48_cast_fp16")]; tensor stages_3_transformer_layers_2_layer_scale_1_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_2_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18163904)))]; tensor var_2877_cast_fp16 = mul(x = stages_3_transformer_layers_2_layer_scale_1_scale_to_fp16, y = linear_48_cast_fp16)[name = string("op_2877_cast_fp16")]; tensor input_161_cast_fp16 = add(x = input_155_cast_fp16, y = var_2877_cast_fp16)[name = string("input_161_cast_fp16")]; tensor input_163_axes_0 = const()[name = string("input_163_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_2_norm2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18164480)))]; tensor stages_3_transformer_layers_2_norm2_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_2_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18165056)))]; fp16 var_2881_to_fp16 = const()[name = string("op_2881_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_163_cast_fp16 = layer_norm(axes = input_163_axes_0, beta = stages_3_transformer_layers_2_norm2_bias_to_fp16, epsilon = var_2881_to_fp16, gamma = stages_3_transformer_layers_2_norm2_weight_to_fp16, x = input_161_cast_fp16)[name = string("input_163_cast_fp16")]; tensor stages_3_transformer_layers_2_ffn_0_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18165632)))]; tensor linear_49_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_3_transformer_layers_2_ffn_0_weight_to_fp16, x = input_163_cast_fp16)[name = string("linear_49_cast_fp16")]; string input_167_mode_0 = const()[name = string("input_167_mode_0"), val = string("EXACT")]; tensor input_167_cast_fp16 = gelu(mode = input_167_mode_0, x = linear_49_cast_fp16)[name = string("input_167_cast_fp16")]; tensor stages_3_transformer_layers_2_ffn_2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_2_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(18689984)))]; tensor linear_50_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_2_ffn_2_weight_to_fp16, x = input_167_cast_fp16)[name = string("linear_50_cast_fp16")]; tensor stages_3_transformer_layers_2_layer_scale_2_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_2_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19214336)))]; tensor var_2897_cast_fp16 = mul(x = stages_3_transformer_layers_2_layer_scale_2_scale_to_fp16, y = linear_50_cast_fp16)[name = string("op_2897_cast_fp16")]; tensor input_169_cast_fp16 = add(x = input_161_cast_fp16, y = var_2897_cast_fp16)[name = string("input_169_cast_fp16")]; tensor input_171_axes_0 = const()[name = string("input_171_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_3_norm1_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_norm1_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19214912)))]; tensor stages_3_transformer_layers_3_norm1_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_3_norm1_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19215488)))]; fp16 var_2901_to_fp16 = const()[name = string("op_2901_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_171_cast_fp16 = layer_norm(axes = input_171_axes_0, beta = stages_3_transformer_layers_3_norm1_bias_to_fp16, epsilon = var_2901_to_fp16, gamma = stages_3_transformer_layers_3_norm1_weight_to_fp16, x = input_169_cast_fp16)[name = string("input_171_cast_fp16")]; tensor stages_3_transformer_layers_3_self_attn_in_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_self_attn_in_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19216064)))]; tensor linear_51_cast_fp16 = linear(bias = linear_1_bias_0_to_fp16, weight = stages_3_transformer_layers_3_self_attn_in_proj_weight_to_fp16, x = input_171_cast_fp16)[name = string("linear_51_cast_fp16")]; tensor var_2915 = const()[name = string("op_2915"), val = tensor([1, 32, 3, 4, 64])]; tensor var_2916_cast_fp16 = reshape(shape = var_2915, x = linear_51_cast_fp16)[name = string("op_2916_cast_fp16")]; tensor var_2922 = const()[name = string("op_2922"), val = tensor([2, 0, 3, 1, 4])]; tensor query_67_begin_0 = const()[name = string("query_67_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor query_67_end_0 = const()[name = string("query_67_end_0"), val = tensor([1, 1, 4, 32, 64])]; tensor query_67_end_mask_0 = const()[name = string("query_67_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor query_67_squeeze_mask_0 = const()[name = string("query_67_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor qkv_cast_fp16 = transpose(perm = var_2922, x = var_2916_cast_fp16)[name = string("transpose_4")]; tensor query_67_cast_fp16 = slice_by_index(begin = query_67_begin_0, end = query_67_end_0, end_mask = query_67_end_mask_0, squeeze_mask = query_67_squeeze_mask_0, x = qkv_cast_fp16)[name = string("query_67_cast_fp16")]; tensor key_67_begin_0 = const()[name = string("key_67_begin_0"), val = tensor([1, 0, 0, 0, 0])]; tensor key_67_end_0 = const()[name = string("key_67_end_0"), val = tensor([2, 1, 4, 32, 64])]; tensor key_67_end_mask_0 = const()[name = string("key_67_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor key_67_squeeze_mask_0 = const()[name = string("key_67_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor key_67_cast_fp16 = slice_by_index(begin = key_67_begin_0, end = key_67_end_0, end_mask = key_67_end_mask_0, squeeze_mask = key_67_squeeze_mask_0, x = qkv_cast_fp16)[name = string("key_67_cast_fp16")]; tensor value_begin_0 = const()[name = string("value_begin_0"), val = tensor([2, 0, 0, 0, 0])]; tensor value_end_0 = const()[name = string("value_end_0"), val = tensor([3, 1, 4, 32, 64])]; tensor value_end_mask_0 = const()[name = string("value_end_mask_0"), val = tensor([false, true, true, true, true])]; tensor value_squeeze_mask_0 = const()[name = string("value_squeeze_mask_0"), val = tensor([true, false, false, false, false])]; tensor value_cast_fp16 = slice_by_index(begin = value_begin_0, end = value_end_0, end_mask = value_end_mask_0, squeeze_mask = value_squeeze_mask_0, x = qkv_cast_fp16)[name = string("value_cast_fp16")]; tensor var_2938 = const()[name = string("op_2938"), val = tensor([1, 4, 32, 32, 2])]; tensor query_pairs_cast_fp16 = reshape(shape = var_2938, x = query_67_cast_fp16)[name = string("query_pairs_cast_fp16")]; tensor var_2945 = const()[name = string("op_2945"), val = tensor([1, 4, 32, 32, 2])]; tensor key_pairs_cast_fp16 = reshape(shape = var_2945, x = key_67_cast_fp16)[name = string("key_pairs_cast_fp16")]; tensor qr_begin_0 = const()[name = string("qr_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor qr_end_0 = const()[name = string("qr_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor qr_end_mask_0 = const()[name = string("qr_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qr_squeeze_mask_0 = const()[name = string("qr_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qr_cast_fp16 = slice_by_index(begin = qr_begin_0, end = qr_end_0, end_mask = qr_end_mask_0, squeeze_mask = qr_squeeze_mask_0, x = query_pairs_cast_fp16)[name = string("qr_cast_fp16")]; tensor qi_begin_0 = const()[name = string("qi_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor qi_end_0 = const()[name = string("qi_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor qi_end_mask_0 = const()[name = string("qi_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor qi_squeeze_mask_0 = const()[name = string("qi_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor qi_cast_fp16 = slice_by_index(begin = qi_begin_0, end = qi_end_0, end_mask = qi_end_mask_0, squeeze_mask = qi_squeeze_mask_0, x = query_pairs_cast_fp16)[name = string("qi_cast_fp16")]; tensor kr_begin_0 = const()[name = string("kr_begin_0"), val = tensor([0, 0, 0, 0, 0])]; tensor kr_end_0 = const()[name = string("kr_end_0"), val = tensor([1, 4, 32, 32, 1])]; tensor kr_end_mask_0 = const()[name = string("kr_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor kr_squeeze_mask_0 = const()[name = string("kr_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor kr_cast_fp16 = slice_by_index(begin = kr_begin_0, end = kr_end_0, end_mask = kr_end_mask_0, squeeze_mask = kr_squeeze_mask_0, x = key_pairs_cast_fp16)[name = string("kr_cast_fp16")]; tensor ki_begin_0 = const()[name = string("ki_begin_0"), val = tensor([0, 0, 0, 0, 1])]; tensor ki_end_0 = const()[name = string("ki_end_0"), val = tensor([1, 4, 32, 32, 2])]; tensor ki_end_mask_0 = const()[name = string("ki_end_mask_0"), val = tensor([true, true, true, true, false])]; tensor ki_squeeze_mask_0 = const()[name = string("ki_squeeze_mask_0"), val = tensor([false, false, false, false, true])]; tensor ki_cast_fp16 = slice_by_index(begin = ki_begin_0, end = ki_end_0, end_mask = ki_end_mask_0, squeeze_mask = ki_squeeze_mask_0, x = key_pairs_cast_fp16)[name = string("ki_cast_fp16")]; tensor var_2959_cast_fp16 = mul(x = qr_cast_fp16, y = s3_cos)[name = string("op_2959_cast_fp16")]; tensor var_2960_cast_fp16 = mul(x = qi_cast_fp16, y = s3_sin)[name = string("op_2960_cast_fp16")]; tensor var_2962_cast_fp16 = sub(x = var_2959_cast_fp16, y = var_2960_cast_fp16)[name = string("op_2962_cast_fp16")]; tensor var_2963_cast_fp16 = mul(x = qr_cast_fp16, y = s3_sin)[name = string("op_2963_cast_fp16")]; tensor var_2964_cast_fp16 = mul(x = qi_cast_fp16, y = s3_cos)[name = string("op_2964_cast_fp16")]; tensor var_2966_cast_fp16 = add(x = var_2963_cast_fp16, y = var_2964_cast_fp16)[name = string("op_2966_cast_fp16")]; int32 query_69_axis_0 = const()[name = string("query_69_axis_0"), val = int32(-1)]; tensor query_69_cast_fp16 = stack(axis = query_69_axis_0, values = (var_2962_cast_fp16, var_2966_cast_fp16))[name = string("query_69_cast_fp16")]; tensor var_2970_cast_fp16 = mul(x = kr_cast_fp16, y = s3_cos)[name = string("op_2970_cast_fp16")]; tensor var_2971_cast_fp16 = mul(x = ki_cast_fp16, y = s3_sin)[name = string("op_2971_cast_fp16")]; tensor var_2973_cast_fp16 = sub(x = var_2970_cast_fp16, y = var_2971_cast_fp16)[name = string("op_2973_cast_fp16")]; tensor var_2974_cast_fp16 = mul(x = kr_cast_fp16, y = s3_sin)[name = string("op_2974_cast_fp16")]; tensor var_2975_cast_fp16 = mul(x = ki_cast_fp16, y = s3_cos)[name = string("op_2975_cast_fp16")]; tensor var_2977_cast_fp16 = add(x = var_2974_cast_fp16, y = var_2975_cast_fp16)[name = string("op_2977_cast_fp16")]; int32 key_69_axis_0 = const()[name = string("key_69_axis_0"), val = int32(-1)]; tensor key_69_cast_fp16 = stack(axis = key_69_axis_0, values = (var_2973_cast_fp16, var_2977_cast_fp16))[name = string("key_69_cast_fp16")]; tensor var_2985 = const()[name = string("op_2985"), val = tensor([1, 4, 32, 64])]; tensor query_cast_fp16 = reshape(shape = var_2985, x = query_69_cast_fp16)[name = string("query_cast_fp16")]; tensor var_2991 = const()[name = string("op_2991"), val = tensor([1, 4, 32, 64])]; tensor key_cast_fp16 = reshape(shape = var_2991, x = key_69_cast_fp16)[name = string("key_cast_fp16")]; tensor read_state_22 = read_state(input = s3_l3_k)[name = string("read_state_22")]; tensor var_3007_begin_0 = const()[name = string("op_3007_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_3007_end_0 = const()[name = string("op_3007_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_3007_end_mask_0 = const()[name = string("op_3007_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_3007_cast_fp16 = slice_by_index(begin = var_3007_begin_0, end = var_3007_end_0, end_mask = var_3007_end_mask_0, x = read_state_22)[name = string("op_3007_cast_fp16")]; int32 var_3014 = const()[name = string("op_3014"), val = int32(2)]; bool new_key_interleave_0 = const()[name = string("new_key_interleave_0"), val = bool(false)]; tensor new_key_cast_fp16 = concat(axis = var_3014, interleave = new_key_interleave_0, values = (var_3007_cast_fp16, key_cast_fp16))[name = string("new_key_cast_fp16")]; tensor read_state_23 = read_state(input = s3_l3_v)[name = string("read_state_23")]; tensor var_3030_begin_0 = const()[name = string("op_3030_begin_0"), val = tensor([0, 0, 32, 0])]; tensor var_3030_end_0 = const()[name = string("op_3030_end_0"), val = tensor([1, 4, 1600, 64])]; tensor var_3030_end_mask_0 = const()[name = string("op_3030_end_mask_0"), val = tensor([true, true, true, true])]; tensor var_3030_cast_fp16 = slice_by_index(begin = var_3030_begin_0, end = var_3030_end_0, end_mask = var_3030_end_mask_0, x = read_state_23)[name = string("op_3030_cast_fp16")]; int32 var_3037 = const()[name = string("op_3037"), val = int32(2)]; bool new_value_interleave_0 = const()[name = string("new_value_interleave_0"), val = bool(false)]; tensor new_value_cast_fp16 = concat(axis = var_3037, interleave = new_value_interleave_0, values = (var_3030_cast_fp16, value_cast_fp16))[name = string("new_value_cast_fp16")]; tensor concat_44 = const()[name = string("concat_44"), val = tensor([0, 0, 0, 0])]; tensor concat_45 = const()[name = string("concat_45"), val = tensor([0, 0, 0, 0])]; tensor s3_l3_k_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l3_k_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l3_k_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l3_k_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l3_k_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l3_k_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l3_k_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l3_k_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l3_k_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_44, begin_mask = s3_l3_k_internal_tensor_assign_1_begin_mask_0, end = concat_45, end_mask = s3_l3_k_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l3_k_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l3_k_internal_tensor_assign_1_stride_0, update = new_key_cast_fp16, x = read_state_22)[name = string("s3_l3_k_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l3_k_internal_tensor_assign_1_cast_fp16, input = s3_l3_k)[name = string("coreml_update_state_46_write_state")]; tensor concat_46 = const()[name = string("concat_46"), val = tensor([0, 0, 0, 0])]; tensor concat_47 = const()[name = string("concat_47"), val = tensor([0, 0, 0, 0])]; tensor s3_l3_v_internal_tensor_assign_1_stride_0 = const()[name = string("s3_l3_v_internal_tensor_assign_1_stride_0"), val = tensor([1, 1, 1, 1])]; tensor s3_l3_v_internal_tensor_assign_1_begin_mask_0 = const()[name = string("s3_l3_v_internal_tensor_assign_1_begin_mask_0"), val = tensor([false, true, true, true])]; tensor s3_l3_v_internal_tensor_assign_1_end_mask_0 = const()[name = string("s3_l3_v_internal_tensor_assign_1_end_mask_0"), val = tensor([true, true, true, true])]; tensor s3_l3_v_internal_tensor_assign_1_squeeze_mask_0 = const()[name = string("s3_l3_v_internal_tensor_assign_1_squeeze_mask_0"), val = tensor([false, false, false, false])]; tensor s3_l3_v_internal_tensor_assign_1_cast_fp16 = slice_update(begin = concat_46, begin_mask = s3_l3_v_internal_tensor_assign_1_begin_mask_0, end = concat_47, end_mask = s3_l3_v_internal_tensor_assign_1_end_mask_0, squeeze_mask = s3_l3_v_internal_tensor_assign_1_squeeze_mask_0, stride = s3_l3_v_internal_tensor_assign_1_stride_0, update = new_value_cast_fp16, x = read_state_23)[name = string("s3_l3_v_internal_tensor_assign_1_cast_fp16")]; write_state(data = s3_l3_v_internal_tensor_assign_1_cast_fp16, input = s3_l3_v)[name = string("coreml_update_state_47_write_state")]; bool var_3056_transpose_x_1 = const()[name = string("op_3056_transpose_x_1"), val = bool(false)]; bool var_3056_transpose_y_1 = const()[name = string("op_3056_transpose_y_1"), val = bool(true)]; tensor var_3056_cast_fp16 = matmul(transpose_x = var_3056_transpose_x_1, transpose_y = var_3056_transpose_y_1, x = query_cast_fp16, y = new_key_cast_fp16)[name = string("op_3056_cast_fp16")]; fp16 var_3057_to_fp16 = const()[name = string("op_3057_to_fp16"), val = fp16(0x1p-3)]; tensor scores_cast_fp16 = mul(x = var_3056_cast_fp16, y = var_3057_to_fp16)[name = string("scores_cast_fp16")]; tensor var_3060_cast_fp16 = add(x = scores_cast_fp16, y = s3_mask)[name = string("op_3060_cast_fp16")]; int32 var_3061 = const()[name = string("op_3061"), val = int32(-1)]; tensor probabilities_cast_fp16 = softmax(axis = var_3061, x = var_3060_cast_fp16)[name = string("probabilities_cast_fp16")]; bool attention_transpose_x_0 = const()[name = string("attention_transpose_x_0"), val = bool(false)]; bool attention_transpose_y_0 = const()[name = string("attention_transpose_y_0"), val = bool(false)]; tensor attention_cast_fp16 = matmul(transpose_x = attention_transpose_x_0, transpose_y = attention_transpose_y_0, x = probabilities_cast_fp16, y = new_value_cast_fp16)[name = string("attention_cast_fp16")]; tensor var_3067_perm_0 = const()[name = string("op_3067_perm_0"), val = tensor([0, 2, 1, 3])]; tensor var_3071 = const()[name = string("op_3071"), val = tensor([1, 32, 256])]; tensor var_3067_cast_fp16 = transpose(perm = var_3067_perm_0, x = attention_cast_fp16)[name = string("transpose_3")]; tensor input_173_cast_fp16 = reshape(shape = var_3071, x = var_3067_cast_fp16)[name = string("input_173_cast_fp16")]; tensor stages_3_transformer_layers_3_self_attn_out_proj_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_self_attn_out_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19609344)))]; tensor linear_52_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_3_self_attn_out_proj_weight_to_fp16, x = input_173_cast_fp16)[name = string("linear_52_cast_fp16")]; tensor stages_3_transformer_layers_3_layer_scale_1_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_3_layer_scale_1_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19740480)))]; tensor var_3077_cast_fp16 = mul(x = stages_3_transformer_layers_3_layer_scale_1_scale_to_fp16, y = linear_52_cast_fp16)[name = string("op_3077_cast_fp16")]; tensor input_175_cast_fp16 = add(x = input_169_cast_fp16, y = var_3077_cast_fp16)[name = string("input_175_cast_fp16")]; tensor input_177_axes_0 = const()[name = string("input_177_axes_0"), val = tensor([-1])]; tensor stages_3_transformer_layers_3_norm2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_norm2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19741056)))]; tensor stages_3_transformer_layers_3_norm2_bias_to_fp16 = const()[name = string("stages_3_transformer_layers_3_norm2_bias_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19741632)))]; fp16 var_3081_to_fp16 = const()[name = string("op_3081_to_fp16"), val = fp16(0x1.5p-17)]; tensor input_177_cast_fp16 = layer_norm(axes = input_177_axes_0, beta = stages_3_transformer_layers_3_norm2_bias_to_fp16, epsilon = var_3081_to_fp16, gamma = stages_3_transformer_layers_3_norm2_weight_to_fp16, x = input_175_cast_fp16)[name = string("input_177_cast_fp16")]; tensor stages_3_transformer_layers_3_ffn_0_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_ffn_0_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(19742208)))]; tensor linear_53_cast_fp16 = linear(bias = linear_3_bias_0_to_fp16, weight = stages_3_transformer_layers_3_ffn_0_weight_to_fp16, x = input_177_cast_fp16)[name = string("linear_53_cast_fp16")]; string input_181_mode_0 = const()[name = string("input_181_mode_0"), val = string("EXACT")]; tensor input_181_cast_fp16 = gelu(mode = input_181_mode_0, x = linear_53_cast_fp16)[name = string("input_181_cast_fp16")]; tensor stages_3_transformer_layers_3_ffn_2_weight_to_fp16 = const()[name = string("stages_3_transformer_layers_3_ffn_2_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(20266560)))]; tensor linear_54_cast_fp16 = linear(bias = linear_0_bias_0_to_fp16, weight = stages_3_transformer_layers_3_ffn_2_weight_to_fp16, x = input_181_cast_fp16)[name = string("linear_54_cast_fp16")]; tensor stages_3_transformer_layers_3_layer_scale_2_scale_to_fp16 = const()[name = string("stages_3_transformer_layers_3_layer_scale_2_scale_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(20790912)))]; tensor var_3097_cast_fp16 = mul(x = stages_3_transformer_layers_3_layer_scale_2_scale_to_fp16, y = linear_54_cast_fp16)[name = string("op_3097_cast_fp16")]; tensor input_cast_fp16 = add(x = input_175_cast_fp16, y = var_3097_cast_fp16)[name = string("input_cast_fp16")]; tensor stages_3_output_proj_weight_to_fp16 = const()[name = string("stages_3_output_proj_weight_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(20791488)))]; tensor linear_55_bias_0_to_fp16 = const()[name = string("linear_55_bias_0_to_fp16"), val = tensor(BLOBFILE(path = string("@model_path/weights/weight.bin"), offset = uint64(20914432)))]; tensor linear_55_cast_fp16 = linear(bias = linear_55_bias_0_to_fp16, weight = stages_3_output_proj_weight_to_fp16, x = input_cast_fp16)[name = string("linear_55_cast_fp16")]; tensor x_63_perm_0 = const()[name = string("x_63_perm_0"), val = tensor([0, 2, 1])]; tensor var_3110 = const()[name = string("op_3110"), val = tensor([1, 1, 240, 32])]; tensor x_63_cast_fp16 = transpose(perm = x_63_perm_0, x = linear_55_cast_fp16)[name = string("transpose_2")]; tensor var_3111_cast_fp16 = reshape(shape = var_3110, x = x_63_cast_fp16)[name = string("op_3111_cast_fp16")]; tensor var_3116 = const()[name = string("op_3116"), val = tensor([0, 1, 3, 2])]; tensor var_3126 = const()[name = string("op_3126"), val = tensor([1, 3840, 2])]; tensor var_3117_cast_fp16 = transpose(perm = var_3116, x = var_3111_cast_fp16)[name = string("transpose_1")]; tensor var_3127_cast_fp16 = reshape(shape = var_3126, x = var_3117_cast_fp16)[name = string("op_3127_cast_fp16")]; tensor var_3130_perm_0 = const()[name = string("op_3130_perm_0"), val = tensor([0, 2, 1])]; tensor audio = transpose(perm = var_3130_perm_0, x = var_3127_cast_fp16)[name = string("transpose_0")]; } -> (audio); }