File size: 385,989 Bytes
e97e085
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
235
236
237
238
239
240
241
242
243
244
245
246
247
248
249
250
251
252
253
254
255
256
257
258
259
260
261
262
263
264
265
266
267
268
269
270
271
272
273
274
275
276
277
278
279
280
281
282
283
284
285
286
287
288
289
290
291
292
293
294
295
296
297
298
299
300
301
302
303
304
305
306
307
308
309
310
311
312
313
314
315
316
317
318
319
320
321
322
323
324
325
326
327
328
329
330
331
332
333
334
335
336
337
338
339
340
341
342
343
344
345
346
347
348
349
350
351
352
353
354
355
356
357
358
359
360
361
362
363
364
365
366
367
368
369
370
371
372
373
374
375
376
377
378
379
380
381
382
383
384
385
386
387
388
389
390
391
392
393
394
395
396
397
398
399
400
401
402
403
404
405
406
407
408
409
410
411
412
413
414
415
416
417
418
419
420
421
422
423
424
425
426
427
428
429
430
431
432
433
434
435
436
437
438
439
440
441
442
443
444
445
446
447
448
449
450
451
452
453
454
455
456
457
458
459
460
461
462
463
464
465
466
467
468
469
470
471
472
473
474
475
476
477
478
479
480
481
482
483
484
485
486
487
488
489
490
491
492
493
494
495
496
497
498
499
500
501
502
503
504
505
506
507
508
509
510
511
512
513
514
515
516
517
518
519
520
521
522
523
524
525
526
527
528
529
530
531
532
533
534
535
536
537
538
539
540
541
542
543
544
545
546
547
548
549
550
551
552
553
554
555
556
557
558
559
560
561
562
563
564
565
566
567
568
569
570
571
572
573
574
575
576
577
578
579
580
581
582
583
584
585
586
587
588
589
590
591
592
593
594
595
596
597
598
599
600
601
602
603
604
605
606
607
608
609
610
611
612
613
614
615
616
617
618
619
620
621
622
623
624
625
626
627
628
629
630
631
632
633
634
635
636
637
638
639
640
641
642
643
644
645
646
647
648
649
650
651
652
653
654
655
656
657
658
659
660
661
662
663
664
665
666
667
668
669
670
671
672
673
674
675
676
677
678
679
680
681
682
683
684
685
686
687
688
689
690
691
692
693
694
695
696
697
698
699
700
701
702
703
704
705
706
707
708
709
710
711
712
713
714
715
716
717
718
719
720
721
722
723
724
725
726
727
728
729
730
731
732
733
734
735
736
737
738
739
740
741
742
743
744
745
746
747
748
749
750
751
752
753
754
755
756
757
758
759
760
761
762
763
764
765
766
767
768
769
770
771
772
773
774
775
776
777
778
779
780
781
782
783
784
785
786
787
788
789
790
791
792
793
794
795
796
797
798
799
800
801
802
803
804
805
806
807
808
809
810
811
812
813
814
815
816
817
818
819
820
821
822
823
824
825
826
827
828
829
830
831
832
833
834
835
836
837
838
839
840
841
842
843
844
845
846
847
848
849
850
851
852
853
854
855
856
857
858
859
860
861
862
863
864
865
866
867
868
869
870
871
872
873
874
875
876
877
878
879
880
881
882
883
884
885
886
887
888
889
890
891
892
893
894
895
896
897
898
899
900
901
902
903
904
905
906
907
908
909
910
911
912
913
914
915
916
917
918
919
920
921
922
923
924
925
926
927
928
929
930
931
932
933
934
935
936
937
938
939
940
941
942
943
944
945
946
947
948
949
950
951
952
953
954
955
956
957
958
959
960
961
962
963
964
965
966
967
968
969
970
971
972
973
974
975
976
977
978
979
980
981
982
983
984
985
986
987
988
989
990
991
992
993
994
995
996
997
998
999
1000
1001
1002
1003
1004
1005
1006
1007
1008
1009
1010
1011
1012
1013
1014
1015
1016
1017
1018
1019
1020
1021
1022
1023
1024
1025
1026
1027
1028
1029
1030
1031
1032
1033
1034
1035
1036
1037
1038
1039
1040
1041
1042
1043
1044
1045
1046
1047
1048
1049
1050
1051
1052
1053
1054
1055
1056
1057
1058
1059
1060
1061
1062
1063
1064
1065
1066
1067
1068
1069
1070
1071
1072
1073
1074
1075
1076
1077
1078
1079
1080
1081
1082
1083
1084
1085
1086
1087
1088
1089
1090
1091
1092
1093
1094
1095
1096
1097
1098
1099
1100
1101
1102
1103
1104
1105
1106
1107
1108
1109
1110
1111
1112
1113
1114
1115
1116
1117
1118
1119
1120
1121
1122
1123
1124
1125
1126
1127
1128
1129
1130
1131
1132
1133
1134
1135
1136
1137
1138
1139
1140
1141
1142
1143
1144
1145
1146
1147
1148
1149
1150
1151
1152
1153
1154
1155
1156
1157
1158
1159
1160
1161
1162
1163
1164
1165
1166
1167
1168
1169
1170
1171
1172
1173
1174
1175
1176
1177
1178
1179
1180
1181
1182
1183
1184
1185
1186
1187
1188
1189
1190
1191
1192
1193
1194
1195
1196
1197
1198
1199
1200
1201
1202
1203
1204
1205
1206
1207
1208
1209
1210
1211
1212
1213
1214
1215
1216
1217
1218
1219
1220
1221
1222
1223
1224
1225
1226
1227
1228
1229
1230
1231
1232
1233
1234
1235
1236
1237
1238
1239
1240
1241
1242
1243
1244
1245
1246
1247
1248
1249
1250
1251
1252
1253
1254
1255
1256
1257
1258
1259
1260
1261
1262
1263
1264
1265
1266
1267
1268
1269
1270
1271
1272
1273
1274
1275
1276
1277
1278
1279
1280
1281
1282
1283
1284
1285
1286
1287
1288
1289
1290
1291
1292
1293
1294
1295
1296
1297
1298
1299
1300
1301
1302
1303
1304
1305
1306
1307
1308
1309
1310
1311
1312
1313
1314
1315
1316
1317
1318
1319
1320
1321
1322
1323
1324
1325
1326
1327
1328
1329
1330
1331
1332
1333
1334
1335
1336
1337
1338
1339
1340
1341
1342
1343
1344
1345
1346
1347
1348
1349
1350
1351
1352
1353
1354
1355
1356
1357
1358
1359
1360
1361
1362
1363
1364
1365
1366
1367
1368
1369
1370
1371
1372
1373
1374
1375
1376
1377
1378
1379
1380
1381
1382
1383
1384
1385
1386
1387
1388
1389
1390
1391
1392
1393
1394
1395
1396
1397
1398
1399
1400
1401
1402
1403
1404
1405
1406
1407
1408
1409
1410
1411
1412
1413
1414
1415
1416
1417
1418
1419
1420
1421
1422
1423
1424
1425
1426
1427
1428
1429
1430
1431
1432
1433
1434
1435
1436
1437
1438
1439
1440
1441
1442
1443
1444
1445
1446
1447
1448
1449
1450
1451
1452
1453
1454
1455
1456
1457
1458
1459
1460
1461
1462
1463
1464
1465
1466
1467
1468
1469
1470
1471
1472
1473
1474
1475
1476
1477
1478
1479
1480
1481
1482
1483
1484
1485
1486
1487
1488
1489
1490
1491
1492
1493
1494
1495
1496
1497
1498
1499
1500
1501
1502
1503
1504
1505
1506
1507
1508
1509
1510
1511
1512
1513
1514
1515
1516
1517
1518
1519
1520
1521
1522
1523
1524
1525
1526
1527
1528
1529
1530
1531
1532
1533
1534
1535
1536
1537
1538
1539
1540
1541
1542
1543
1544
1545
1546
1547
1548
1549
1550
1551
1552
1553
1554
1555
1556
1557
1558
1559
1560
1561
1562
1563
1564
1565
1566
1567
1568
1569
1570
1571
1572
1573
1574
1575
1576
1577
1578
1579
1580
1581
1582
1583
1584
1585
1586
1587
1588
1589
1590
1591
1592
1593
1594
1595
1596
1597
1598
1599
1600
1601
1602
1603
1604
1605
1606
1607
1608
1609
1610
1611
1612
1613
1614
1615
1616
1617
1618
1619
1620
1621
1622
1623
1624
1625
1626
1627
1628
1629
1630
1631
1632
1633
1634
1635
1636
1637
1638
1639
1640
1641
1642
1643
1644
1645
1646
1647
1648
1649
1650
1651
1652
1653
1654
1655
1656
1657
1658
1659
1660
1661
1662
1663
1664
1665
1666
1667
1668
1669
1670
1671
1672
1673
1674
1675
1676
1677
1678
1679
1680
1681
1682
1683
1684
1685
1686
1687
1688
1689
1690
1691
1692
1693
1694
1695
1696
1697
1698
1699
1700
1701
1702
1703
1704
1705
1706
1707
1708
1709
1710
1711
1712
1713
1714
1715
1716
1717
1718
1719
1720
1721
1722
1723
1724
1725
1726
1727
1728
1729
1730
1731
1732
1733
1734
1735
1736
1737
1738
1739
1740
1741
1742
1743
1744
1745
1746
1747
1748
1749
1750
1751
1752
1753
1754
1755
1756
1757
1758
1759
1760
1761
1762
1763
1764
1765
1766
1767
1768
1769
1770
1771
1772
1773
1774
1775
1776
1777
1778
1779
1780
1781
1782
1783
1784
1785
1786
1787
1788
1789
1790
1791
1792
1793
1794
1795
1796
1797
1798
1799
1800
1801
1802
1803
1804
1805
1806
1807
1808
1809
1810
1811
1812
1813
1814
1815
1816
1817
1818
1819
1820
1821
1822
1823
1824
1825
1826
1827
1828
1829
1830
1831
1832
1833
1834
1835
1836
1837
1838
1839
1840
1841
1842
1843
1844
1845
1846
1847
1848
1849
1850
1851
1852
1853
1854
1855
1856
1857
1858
1859
1860
1861
1862
1863
1864
1865
1866
1867
1868
1869
1870
1871
1872
1873
1874
1875
1876
1877
1878
1879
1880
1881
1882
1883
1884
1885
1886
1887
1888
1889
1890
1891
1892
1893
1894
1895
1896
1897
1898
1899
1900
1901
1902
1903
1904
1905
1906
1907
1908
1909
1910
1911
1912
1913
1914
1915
1916
1917
1918
1919
1920
1921
1922
1923
1924
1925
1926
1927
1928
1929
1930
1931
1932
1933
1934
1935
1936
1937
1938
1939
1940
1941
1942
1943
1944
1945
1946
1947
1948
1949
1950
1951
1952
1953
1954
1955
1956
1957
1958
1959
1960
1961
1962
1963
1964
1965
1966
1967
1968
1969
1970
1971
1972
1973
1974
1975
1976
1977
1978
1979
1980
1981
1982
1983
1984
1985
1986
1987
1988
1989
1990
1991
1992
1993
1994
1995
1996
1997
1998
1999
2000
2001
2002
2003
2004
2005
2006
2007
2008
2009
2010
2011
2012
2013
2014
2015
2016
2017
2018
2019
2020
2021
2022
2023
2024
2025
2026
2027
2028
2029
2030
2031
2032
2033
2034
2035
2036
2037
2038
2039
2040
2041
2042
2043
2044
2045
2046
2047
2048
2049
2050
2051
2052
2053
2054
2055
2056
2057
2058
2059
2060
2061
2062
2063
2064
2065
2066
2067
2068
2069
2070
2071
2072
2073
2074
2075
2076
2077
2078
2079
2080
2081
2082
2083
2084
2085
2086
2087
2088
2089
2090
2091
2092
2093
2094
2095
2096
2097
2098
2099
2100
2101
2102
2103
2104
2105
2106
2107
2108
2109
2110
2111
2112
2113
2114
2115
2116
2117
2118
2119
2120
2121
2122
2123
2124
2125
2126
2127
2128
2129
2130
2131
2132
2133
2134
2135
2136
2137
2138
2139
2140
2141
2142
2143
2144
2145
2146
2147
2148
2149
2150
2151
2152
2153
2154
2155
2156
2157
2158
2159
2160
2161
2162
2163
2164
2165
2166
2167
2168
2169
2170
2171
2172
2173
2174
2175
2176
2177
2178
2179
2180
2181
2182
2183
2184
2185
2186
2187
2188
2189
2190
2191
2192
2193
2194
2195
2196
2197
2198
2199
2200
2201
2202
2203
2204
2205
2206
2207
2208
2209
2210
2211
2212
2213
2214
2215
2216
2217
2218
2219
2220
2221
2222
2223
2224
2225
2226
2227
2228
2229
2230
2231
2232
2233
2234
2235
2236
2237
2238
2239
2240
2241
2242
2243
2244
2245
2246
2247
2248
2249
2250
2251
2252
2253
2254
2255
2256
2257
2258
2259
2260
2261
2262
2263
2264
2265
2266
2267
2268
2269
2270
2271
2272
2273
2274
2275
2276
2277
2278
2279
2280
2281
2282
2283
2284
2285
2286
2287
2288
2289
2290
program(1.0)
[buildInfo = dict<tensor<string, []>, tensor<string, []>>({{"coremlc-component-MIL", "3304.5.2"}, {"coremlc-version", "3304.6.2"}, {"coremltools-component-torch", "2.1.0"}, {"coremltools-source-dialect", "TorchScript"}, {"coremltools-version", "8.0b1"}})]
{
    func main<ios16>(tensor<fp16, [64, 64]> cos, tensor<fp16, [1, 448, 1, 512]> k_cache_0, tensor<fp16, [1, 448, 1, 512]> k_cache_1, tensor<fp16, [1, 448, 1, 512]> k_cache_2, tensor<fp16, [1, 448, 1, 512]> k_cache_3, tensor<fp16, [1, 512, 1, 64]> mask, tensor<fp16, [64, 64]> sin, tensor<fp16, [1, 512, 1, 448]> v_cache_0, tensor<fp16, [1, 512, 1, 448]> v_cache_1, tensor<fp16, [1, 512, 1, 448]> v_cache_2, tensor<fp16, [1, 512, 1, 448]> v_cache_3, tensor<fp16, [1, 2048, 8, 8]> x) [CoreML_InputDefaultValues = dict<tensor<string, []>, tensor<fp32, []>>({{"k_cache_0", 0}, {"k_cache_1", 0}, {"k_cache_2", 0}, {"k_cache_3", 0}, {"v_cache_0", 0}, {"v_cache_1", 0}, {"v_cache_2", 0}, {"v_cache_3", 0}})] {
            tensor<int32, []> var_21 = const()[name = tensor<string, []>("op_21"), val = tensor<int32, []>(-1)];
            tensor<int32, []> var_25 = const()[name = tensor<string, []>("op_25"), val = tensor<int32, []>(-2)];
            tensor<int32, []> var_27 = const()[name = tensor<string, []>("op_27"), val = tensor<int32, []>(-3)];
            tensor<int32, []> var_69 = const()[name = tensor<string, []>("op_69"), val = tensor<int32, []>(1)];
            tensor<bool, []> var_72 = const()[name = tensor<string, []>("op_72"), val = tensor<bool, []>(true)];
            tensor<bool, []> x_eps_1_interleave_0 = const()[name = tensor<string, []>("x_eps_1_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_1_to_fp16 = const()[name = tensor<string, []>("eps_chan_1_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(64)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_1_cast_fp16 = concat(axis = var_69, interleave = x_eps_1_interleave_0, values = (x, eps_chan_1_to_fp16))[name = tensor<string, []>("x_eps_1_cast_fp16")];
            tensor<int32, [1]> norm_x_1_axes_0 = const()[name = tensor<string, []>("norm_x_1_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_1_cast_fp16 = reduce_l2_norm(axes = norm_x_1_axes_0, keep_dims = var_72, x = x_eps_1_cast_fp16)[name = tensor<string, []>("norm_x_1_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_1_cast_fp16 = real_div(x = x, y = norm_x_1_cast_fp16)[name = tensor<string, []>("x_normed_1_cast_fp16")];
            tensor<fp16, []> var_96_to_fp16 = const()[name = tensor<string, []>("op_96_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_3_cast_fp16 = mul(x = x_normed_1_cast_fp16, y = var_96_to_fp16)[name = tensor<string, []>("x_normed_3_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_0_norm_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_norm_1_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(256)))];
            tensor<fp16, [1, 2048, 8, 8]> x_5_cast_fp16 = mul(x = x_normed_3_cast_fp16, y = blocks_0_norm_1_weight_to_fp16)[name = tensor<string, []>("x_5_cast_fp16")];
            tensor<int32, [4]> var_117 = const()[name = tensor<string, []>("op_117"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> input_1_cast_fp16 = reshape(shape = var_117, x = x_5_cast_fp16)[name = tensor<string, []>("input_1_cast_fp16")];
            tensor<int32, [2]> var_120 = const()[name = tensor<string, []>("op_120"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_122 = const()[name = tensor<string, []>("op_122"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> q_1_pad_type_0 = const()[name = tensor<string, []>("q_1_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> q_1_pad_0 = const()[name = tensor<string, []>("q_1_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_0_attn_q_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_attn_q_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(4416)))];
            tensor<fp16, [1, 2048, 1, 64]> q_1_cast_fp16 = conv(dilations = var_122, groups = var_69, pad = q_1_pad_0, pad_type = q_1_pad_type_0, strides = var_120, weight = blocks_0_attn_q_proj_weight_to_fp16, x = input_1_cast_fp16)[name = tensor<string, []>("q_1_cast_fp16")];
            tensor<int32, [2]> var_126 = const()[name = tensor<string, []>("op_126"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_128 = const()[name = tensor<string, []>("op_128"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> k_1_pad_type_0 = const()[name = tensor<string, []>("k_1_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> k_1_pad_0 = const()[name = tensor<string, []>("k_1_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_0_attn_k_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_attn_k_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(8393088)))];
            tensor<fp16, [1, 512, 1, 64]> k_1_cast_fp16 = conv(dilations = var_128, groups = var_69, pad = k_1_pad_0, pad_type = k_1_pad_type_0, strides = var_126, weight = blocks_0_attn_k_proj_weight_to_fp16, x = input_1_cast_fp16)[name = tensor<string, []>("k_1_cast_fp16")];
            tensor<int32, [2]> var_132 = const()[name = tensor<string, []>("op_132"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_134 = const()[name = tensor<string, []>("op_134"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> v_1_pad_type_0 = const()[name = tensor<string, []>("v_1_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> v_1_pad_0 = const()[name = tensor<string, []>("v_1_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_0_attn_v_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_attn_v_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(10490304)))];
            tensor<fp16, [1, 512, 1, 64]> v_1_cast_fp16 = conv(dilations = var_134, groups = var_69, pad = v_1_pad_0, pad_type = v_1_pad_type_0, strides = var_132, weight = blocks_0_attn_v_proj_weight_to_fp16, x = input_1_cast_fp16)[name = tensor<string, []>("v_1_cast_fp16")];
            tensor<int32, [4]> var_137 = const()[name = tensor<string, []>("op_137"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<fp16, [1, 32, 64, 64]> q_3_cast_fp16 = reshape(shape = var_137, x = q_1_cast_fp16)[name = tensor<string, []>("q_3_cast_fp16")];
            tensor<int32, [4]> var_139 = const()[name = tensor<string, []>("op_139"), val = tensor<int32, [4]>([1, -1, 64, 64])];
            tensor<fp16, [1, 8, 64, 64]> k_3_cast_fp16 = reshape(shape = var_139, x = k_1_cast_fp16)[name = tensor<string, []>("k_3_cast_fp16")];
            tensor<int32, [4]> var_153_begin_0 = const()[name = tensor<string, []>("op_153_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_153_end_0 = const()[name = tensor<string, []>("op_153_end_0"), val = tensor<int32, [4]>([1, 32, 32, 64])];
            tensor<bool, [4]> var_153_end_mask_0 = const()[name = tensor<string, []>("op_153_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 32, 32, 64]> var_153_cast_fp16 = slice_by_index(begin = var_153_begin_0, end = var_153_end_0, end_mask = var_153_end_mask_0, x = q_3_cast_fp16)[name = tensor<string, []>("op_153_cast_fp16")];
            tensor<int32, [4]> var_159_begin_0 = const()[name = tensor<string, []>("op_159_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_159_end_0 = const()[name = tensor<string, []>("op_159_end_0"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<bool, [4]> var_159_end_mask_0 = const()[name = tensor<string, []>("op_159_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 32, 32, 64]> var_159_cast_fp16 = slice_by_index(begin = var_159_begin_0, end = var_159_end_0, end_mask = var_159_end_mask_0, x = q_3_cast_fp16)[name = tensor<string, []>("op_159_cast_fp16")];
            tensor<fp16, []> const_10_promoted_to_fp16 = const()[name = tensor<string, []>("const_10_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 32, 32, 64]> var_161_cast_fp16 = mul(x = var_159_cast_fp16, y = const_10_promoted_to_fp16)[name = tensor<string, []>("op_161_cast_fp16")];
            tensor<bool, []> rotated_1_interleave_0 = const()[name = tensor<string, []>("rotated_1_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 32, 64, 64]> rotated_1_cast_fp16 = concat(axis = var_25, interleave = rotated_1_interleave_0, values = (var_161_cast_fp16, var_153_cast_fp16))[name = tensor<string, []>("rotated_1_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_164_cast_fp16 = mul(x = q_3_cast_fp16, y = cos)[name = tensor<string, []>("op_164_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_165_cast_fp16 = mul(x = rotated_1_cast_fp16, y = sin)[name = tensor<string, []>("op_165_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> roped_1_cast_fp16 = add(x = var_164_cast_fp16, y = var_165_cast_fp16)[name = tensor<string, []>("roped_1_cast_fp16")];
            tensor<int32, [4]> var_178_begin_0 = const()[name = tensor<string, []>("op_178_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_178_end_0 = const()[name = tensor<string, []>("op_178_end_0"), val = tensor<int32, [4]>([1, 8, 32, 64])];
            tensor<bool, [4]> var_178_end_mask_0 = const()[name = tensor<string, []>("op_178_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 8, 32, 64]> var_178_cast_fp16 = slice_by_index(begin = var_178_begin_0, end = var_178_end_0, end_mask = var_178_end_mask_0, x = k_3_cast_fp16)[name = tensor<string, []>("op_178_cast_fp16")];
            tensor<int32, [4]> var_184_begin_0 = const()[name = tensor<string, []>("op_184_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_184_end_0 = const()[name = tensor<string, []>("op_184_end_0"), val = tensor<int32, [4]>([1, 8, 64, 64])];
            tensor<bool, [4]> var_184_end_mask_0 = const()[name = tensor<string, []>("op_184_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 8, 32, 64]> var_184_cast_fp16 = slice_by_index(begin = var_184_begin_0, end = var_184_end_0, end_mask = var_184_end_mask_0, x = k_3_cast_fp16)[name = tensor<string, []>("op_184_cast_fp16")];
            tensor<fp16, []> const_12_promoted_to_fp16 = const()[name = tensor<string, []>("const_12_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 8, 32, 64]> var_186_cast_fp16 = mul(x = var_184_cast_fp16, y = const_12_promoted_to_fp16)[name = tensor<string, []>("op_186_cast_fp16")];
            tensor<bool, []> rotated_3_interleave_0 = const()[name = tensor<string, []>("rotated_3_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 8, 64, 64]> rotated_3_cast_fp16 = concat(axis = var_25, interleave = rotated_3_interleave_0, values = (var_186_cast_fp16, var_178_cast_fp16))[name = tensor<string, []>("rotated_3_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_189_cast_fp16 = mul(x = k_3_cast_fp16, y = cos)[name = tensor<string, []>("op_189_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_190_cast_fp16 = mul(x = rotated_3_cast_fp16, y = sin)[name = tensor<string, []>("op_190_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> roped_3_cast_fp16 = add(x = var_189_cast_fp16, y = var_190_cast_fp16)[name = tensor<string, []>("roped_3_cast_fp16")];
            tensor<int32, [4]> var_193 = const()[name = tensor<string, []>("op_193"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> k_7_cast_fp16 = reshape(shape = var_193, x = roped_3_cast_fp16)[name = tensor<string, []>("k_7_cast_fp16")];
            tensor<int32, [4]> var_195 = const()[name = tensor<string, []>("op_195"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> new_v_cache_0 = reshape(shape = var_195, x = v_1_cast_fp16)[name = tensor<string, []>("new_v_cache_0_type_fp32_cast_fp16")];
            tensor<int32, [4]> k_9_perm_0 = const()[name = tensor<string, []>("k_9_perm_0"), val = tensor<int32, [4]>([0, -1, 2, -3])];
            tensor<bool, []> k_11_interleave_0 = const()[name = tensor<string, []>("k_11_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 64, 1, 512]> new_k_cache_0 = transpose(perm = k_9_perm_0, x = k_7_cast_fp16)[name = tensor<string, []>("transpose_3")];
            tensor<fp16, [1, 512, 1, 512]> k_11_cast_fp16 = concat(axis = var_27, interleave = k_11_interleave_0, values = (k_cache_0, new_k_cache_0))[name = tensor<string, []>("k_11_cast_fp16")];
            tensor<bool, []> v_7_interleave_0 = const()[name = tensor<string, []>("v_7_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 512, 1, 512]> v_7_cast_fp16 = concat(axis = var_21, interleave = v_7_interleave_0, values = (v_cache_0, new_v_cache_0))[name = tensor<string, []>("v_7_cast_fp16")];
            tensor<int32, [4]> var_211 = const()[name = tensor<string, []>("op_211"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> q_7_cast_fp16 = reshape(shape = var_211, x = roped_1_cast_fp16)[name = tensor<string, []>("q_7_cast_fp16")];
            tensor<int32, [4]> var_216_begin_0 = const()[name = tensor<string, []>("op_216_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_216_end_0 = const()[name = tensor<string, []>("op_216_end_0"), val = tensor<int32, [4]>([1, 64, 1, 64])];
            tensor<bool, [4]> var_216_end_mask_0 = const()[name = tensor<string, []>("op_216_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_216_cast_fp16 = slice_by_index(begin = var_216_begin_0, end = var_216_end_0, end_mask = var_216_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_216_cast_fp16")];
            tensor<int32, [4]> var_220_begin_0 = const()[name = tensor<string, []>("op_220_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_220_end_0 = const()[name = tensor<string, []>("op_220_end_0"), val = tensor<int32, [4]>([1, 128, 1, 64])];
            tensor<bool, [4]> var_220_end_mask_0 = const()[name = tensor<string, []>("op_220_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_220_cast_fp16 = slice_by_index(begin = var_220_begin_0, end = var_220_end_0, end_mask = var_220_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_220_cast_fp16")];
            tensor<int32, [4]> var_224_begin_0 = const()[name = tensor<string, []>("op_224_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_224_end_0 = const()[name = tensor<string, []>("op_224_end_0"), val = tensor<int32, [4]>([1, 192, 1, 64])];
            tensor<bool, [4]> var_224_end_mask_0 = const()[name = tensor<string, []>("op_224_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_224_cast_fp16 = slice_by_index(begin = var_224_begin_0, end = var_224_end_0, end_mask = var_224_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_224_cast_fp16")];
            tensor<int32, [4]> var_228_begin_0 = const()[name = tensor<string, []>("op_228_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_228_end_0 = const()[name = tensor<string, []>("op_228_end_0"), val = tensor<int32, [4]>([1, 256, 1, 64])];
            tensor<bool, [4]> var_228_end_mask_0 = const()[name = tensor<string, []>("op_228_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_228_cast_fp16 = slice_by_index(begin = var_228_begin_0, end = var_228_end_0, end_mask = var_228_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_228_cast_fp16")];
            tensor<int32, [4]> var_232_begin_0 = const()[name = tensor<string, []>("op_232_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_232_end_0 = const()[name = tensor<string, []>("op_232_end_0"), val = tensor<int32, [4]>([1, 320, 1, 64])];
            tensor<bool, [4]> var_232_end_mask_0 = const()[name = tensor<string, []>("op_232_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_232_cast_fp16 = slice_by_index(begin = var_232_begin_0, end = var_232_end_0, end_mask = var_232_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_232_cast_fp16")];
            tensor<int32, [4]> var_236_begin_0 = const()[name = tensor<string, []>("op_236_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_236_end_0 = const()[name = tensor<string, []>("op_236_end_0"), val = tensor<int32, [4]>([1, 384, 1, 64])];
            tensor<bool, [4]> var_236_end_mask_0 = const()[name = tensor<string, []>("op_236_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_236_cast_fp16 = slice_by_index(begin = var_236_begin_0, end = var_236_end_0, end_mask = var_236_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_236_cast_fp16")];
            tensor<int32, [4]> var_240_begin_0 = const()[name = tensor<string, []>("op_240_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_240_end_0 = const()[name = tensor<string, []>("op_240_end_0"), val = tensor<int32, [4]>([1, 448, 1, 64])];
            tensor<bool, [4]> var_240_end_mask_0 = const()[name = tensor<string, []>("op_240_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_240_cast_fp16 = slice_by_index(begin = var_240_begin_0, end = var_240_end_0, end_mask = var_240_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_240_cast_fp16")];
            tensor<int32, [4]> var_244_begin_0 = const()[name = tensor<string, []>("op_244_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_244_end_0 = const()[name = tensor<string, []>("op_244_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_244_end_mask_0 = const()[name = tensor<string, []>("op_244_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_244_cast_fp16 = slice_by_index(begin = var_244_begin_0, end = var_244_end_0, end_mask = var_244_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_244_cast_fp16")];
            tensor<int32, [4]> var_248_begin_0 = const()[name = tensor<string, []>("op_248_begin_0"), val = tensor<int32, [4]>([0, 512, 0, 0])];
            tensor<int32, [4]> var_248_end_0 = const()[name = tensor<string, []>("op_248_end_0"), val = tensor<int32, [4]>([1, 576, 1, 64])];
            tensor<bool, [4]> var_248_end_mask_0 = const()[name = tensor<string, []>("op_248_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_248_cast_fp16 = slice_by_index(begin = var_248_begin_0, end = var_248_end_0, end_mask = var_248_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_248_cast_fp16")];
            tensor<int32, [4]> var_252_begin_0 = const()[name = tensor<string, []>("op_252_begin_0"), val = tensor<int32, [4]>([0, 576, 0, 0])];
            tensor<int32, [4]> var_252_end_0 = const()[name = tensor<string, []>("op_252_end_0"), val = tensor<int32, [4]>([1, 640, 1, 64])];
            tensor<bool, [4]> var_252_end_mask_0 = const()[name = tensor<string, []>("op_252_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_252_cast_fp16 = slice_by_index(begin = var_252_begin_0, end = var_252_end_0, end_mask = var_252_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_252_cast_fp16")];
            tensor<int32, [4]> var_256_begin_0 = const()[name = tensor<string, []>("op_256_begin_0"), val = tensor<int32, [4]>([0, 640, 0, 0])];
            tensor<int32, [4]> var_256_end_0 = const()[name = tensor<string, []>("op_256_end_0"), val = tensor<int32, [4]>([1, 704, 1, 64])];
            tensor<bool, [4]> var_256_end_mask_0 = const()[name = tensor<string, []>("op_256_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_256_cast_fp16 = slice_by_index(begin = var_256_begin_0, end = var_256_end_0, end_mask = var_256_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_256_cast_fp16")];
            tensor<int32, [4]> var_260_begin_0 = const()[name = tensor<string, []>("op_260_begin_0"), val = tensor<int32, [4]>([0, 704, 0, 0])];
            tensor<int32, [4]> var_260_end_0 = const()[name = tensor<string, []>("op_260_end_0"), val = tensor<int32, [4]>([1, 768, 1, 64])];
            tensor<bool, [4]> var_260_end_mask_0 = const()[name = tensor<string, []>("op_260_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_260_cast_fp16 = slice_by_index(begin = var_260_begin_0, end = var_260_end_0, end_mask = var_260_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_260_cast_fp16")];
            tensor<int32, [4]> var_264_begin_0 = const()[name = tensor<string, []>("op_264_begin_0"), val = tensor<int32, [4]>([0, 768, 0, 0])];
            tensor<int32, [4]> var_264_end_0 = const()[name = tensor<string, []>("op_264_end_0"), val = tensor<int32, [4]>([1, 832, 1, 64])];
            tensor<bool, [4]> var_264_end_mask_0 = const()[name = tensor<string, []>("op_264_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_264_cast_fp16 = slice_by_index(begin = var_264_begin_0, end = var_264_end_0, end_mask = var_264_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_264_cast_fp16")];
            tensor<int32, [4]> var_268_begin_0 = const()[name = tensor<string, []>("op_268_begin_0"), val = tensor<int32, [4]>([0, 832, 0, 0])];
            tensor<int32, [4]> var_268_end_0 = const()[name = tensor<string, []>("op_268_end_0"), val = tensor<int32, [4]>([1, 896, 1, 64])];
            tensor<bool, [4]> var_268_end_mask_0 = const()[name = tensor<string, []>("op_268_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_268_cast_fp16 = slice_by_index(begin = var_268_begin_0, end = var_268_end_0, end_mask = var_268_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_268_cast_fp16")];
            tensor<int32, [4]> var_272_begin_0 = const()[name = tensor<string, []>("op_272_begin_0"), val = tensor<int32, [4]>([0, 896, 0, 0])];
            tensor<int32, [4]> var_272_end_0 = const()[name = tensor<string, []>("op_272_end_0"), val = tensor<int32, [4]>([1, 960, 1, 64])];
            tensor<bool, [4]> var_272_end_mask_0 = const()[name = tensor<string, []>("op_272_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_272_cast_fp16 = slice_by_index(begin = var_272_begin_0, end = var_272_end_0, end_mask = var_272_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_272_cast_fp16")];
            tensor<int32, [4]> var_276_begin_0 = const()[name = tensor<string, []>("op_276_begin_0"), val = tensor<int32, [4]>([0, 960, 0, 0])];
            tensor<int32, [4]> var_276_end_0 = const()[name = tensor<string, []>("op_276_end_0"), val = tensor<int32, [4]>([1, 1024, 1, 64])];
            tensor<bool, [4]> var_276_end_mask_0 = const()[name = tensor<string, []>("op_276_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_276_cast_fp16 = slice_by_index(begin = var_276_begin_0, end = var_276_end_0, end_mask = var_276_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_276_cast_fp16")];
            tensor<int32, [4]> var_280_begin_0 = const()[name = tensor<string, []>("op_280_begin_0"), val = tensor<int32, [4]>([0, 1024, 0, 0])];
            tensor<int32, [4]> var_280_end_0 = const()[name = tensor<string, []>("op_280_end_0"), val = tensor<int32, [4]>([1, 1088, 1, 64])];
            tensor<bool, [4]> var_280_end_mask_0 = const()[name = tensor<string, []>("op_280_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_280_cast_fp16 = slice_by_index(begin = var_280_begin_0, end = var_280_end_0, end_mask = var_280_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_280_cast_fp16")];
            tensor<int32, [4]> var_284_begin_0 = const()[name = tensor<string, []>("op_284_begin_0"), val = tensor<int32, [4]>([0, 1088, 0, 0])];
            tensor<int32, [4]> var_284_end_0 = const()[name = tensor<string, []>("op_284_end_0"), val = tensor<int32, [4]>([1, 1152, 1, 64])];
            tensor<bool, [4]> var_284_end_mask_0 = const()[name = tensor<string, []>("op_284_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_284_cast_fp16 = slice_by_index(begin = var_284_begin_0, end = var_284_end_0, end_mask = var_284_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_284_cast_fp16")];
            tensor<int32, [4]> var_288_begin_0 = const()[name = tensor<string, []>("op_288_begin_0"), val = tensor<int32, [4]>([0, 1152, 0, 0])];
            tensor<int32, [4]> var_288_end_0 = const()[name = tensor<string, []>("op_288_end_0"), val = tensor<int32, [4]>([1, 1216, 1, 64])];
            tensor<bool, [4]> var_288_end_mask_0 = const()[name = tensor<string, []>("op_288_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_288_cast_fp16 = slice_by_index(begin = var_288_begin_0, end = var_288_end_0, end_mask = var_288_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_288_cast_fp16")];
            tensor<int32, [4]> var_292_begin_0 = const()[name = tensor<string, []>("op_292_begin_0"), val = tensor<int32, [4]>([0, 1216, 0, 0])];
            tensor<int32, [4]> var_292_end_0 = const()[name = tensor<string, []>("op_292_end_0"), val = tensor<int32, [4]>([1, 1280, 1, 64])];
            tensor<bool, [4]> var_292_end_mask_0 = const()[name = tensor<string, []>("op_292_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_292_cast_fp16 = slice_by_index(begin = var_292_begin_0, end = var_292_end_0, end_mask = var_292_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_292_cast_fp16")];
            tensor<int32, [4]> var_296_begin_0 = const()[name = tensor<string, []>("op_296_begin_0"), val = tensor<int32, [4]>([0, 1280, 0, 0])];
            tensor<int32, [4]> var_296_end_0 = const()[name = tensor<string, []>("op_296_end_0"), val = tensor<int32, [4]>([1, 1344, 1, 64])];
            tensor<bool, [4]> var_296_end_mask_0 = const()[name = tensor<string, []>("op_296_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_296_cast_fp16 = slice_by_index(begin = var_296_begin_0, end = var_296_end_0, end_mask = var_296_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_296_cast_fp16")];
            tensor<int32, [4]> var_300_begin_0 = const()[name = tensor<string, []>("op_300_begin_0"), val = tensor<int32, [4]>([0, 1344, 0, 0])];
            tensor<int32, [4]> var_300_end_0 = const()[name = tensor<string, []>("op_300_end_0"), val = tensor<int32, [4]>([1, 1408, 1, 64])];
            tensor<bool, [4]> var_300_end_mask_0 = const()[name = tensor<string, []>("op_300_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_300_cast_fp16 = slice_by_index(begin = var_300_begin_0, end = var_300_end_0, end_mask = var_300_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_300_cast_fp16")];
            tensor<int32, [4]> var_304_begin_0 = const()[name = tensor<string, []>("op_304_begin_0"), val = tensor<int32, [4]>([0, 1408, 0, 0])];
            tensor<int32, [4]> var_304_end_0 = const()[name = tensor<string, []>("op_304_end_0"), val = tensor<int32, [4]>([1, 1472, 1, 64])];
            tensor<bool, [4]> var_304_end_mask_0 = const()[name = tensor<string, []>("op_304_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_304_cast_fp16 = slice_by_index(begin = var_304_begin_0, end = var_304_end_0, end_mask = var_304_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_304_cast_fp16")];
            tensor<int32, [4]> var_308_begin_0 = const()[name = tensor<string, []>("op_308_begin_0"), val = tensor<int32, [4]>([0, 1472, 0, 0])];
            tensor<int32, [4]> var_308_end_0 = const()[name = tensor<string, []>("op_308_end_0"), val = tensor<int32, [4]>([1, 1536, 1, 64])];
            tensor<bool, [4]> var_308_end_mask_0 = const()[name = tensor<string, []>("op_308_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_308_cast_fp16 = slice_by_index(begin = var_308_begin_0, end = var_308_end_0, end_mask = var_308_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_308_cast_fp16")];
            tensor<int32, [4]> var_312_begin_0 = const()[name = tensor<string, []>("op_312_begin_0"), val = tensor<int32, [4]>([0, 1536, 0, 0])];
            tensor<int32, [4]> var_312_end_0 = const()[name = tensor<string, []>("op_312_end_0"), val = tensor<int32, [4]>([1, 1600, 1, 64])];
            tensor<bool, [4]> var_312_end_mask_0 = const()[name = tensor<string, []>("op_312_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_312_cast_fp16 = slice_by_index(begin = var_312_begin_0, end = var_312_end_0, end_mask = var_312_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_312_cast_fp16")];
            tensor<int32, [4]> var_316_begin_0 = const()[name = tensor<string, []>("op_316_begin_0"), val = tensor<int32, [4]>([0, 1600, 0, 0])];
            tensor<int32, [4]> var_316_end_0 = const()[name = tensor<string, []>("op_316_end_0"), val = tensor<int32, [4]>([1, 1664, 1, 64])];
            tensor<bool, [4]> var_316_end_mask_0 = const()[name = tensor<string, []>("op_316_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_316_cast_fp16 = slice_by_index(begin = var_316_begin_0, end = var_316_end_0, end_mask = var_316_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_316_cast_fp16")];
            tensor<int32, [4]> var_320_begin_0 = const()[name = tensor<string, []>("op_320_begin_0"), val = tensor<int32, [4]>([0, 1664, 0, 0])];
            tensor<int32, [4]> var_320_end_0 = const()[name = tensor<string, []>("op_320_end_0"), val = tensor<int32, [4]>([1, 1728, 1, 64])];
            tensor<bool, [4]> var_320_end_mask_0 = const()[name = tensor<string, []>("op_320_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_320_cast_fp16 = slice_by_index(begin = var_320_begin_0, end = var_320_end_0, end_mask = var_320_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_320_cast_fp16")];
            tensor<int32, [4]> var_324_begin_0 = const()[name = tensor<string, []>("op_324_begin_0"), val = tensor<int32, [4]>([0, 1728, 0, 0])];
            tensor<int32, [4]> var_324_end_0 = const()[name = tensor<string, []>("op_324_end_0"), val = tensor<int32, [4]>([1, 1792, 1, 64])];
            tensor<bool, [4]> var_324_end_mask_0 = const()[name = tensor<string, []>("op_324_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_324_cast_fp16 = slice_by_index(begin = var_324_begin_0, end = var_324_end_0, end_mask = var_324_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_324_cast_fp16")];
            tensor<int32, [4]> var_328_begin_0 = const()[name = tensor<string, []>("op_328_begin_0"), val = tensor<int32, [4]>([0, 1792, 0, 0])];
            tensor<int32, [4]> var_328_end_0 = const()[name = tensor<string, []>("op_328_end_0"), val = tensor<int32, [4]>([1, 1856, 1, 64])];
            tensor<bool, [4]> var_328_end_mask_0 = const()[name = tensor<string, []>("op_328_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_328_cast_fp16 = slice_by_index(begin = var_328_begin_0, end = var_328_end_0, end_mask = var_328_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_328_cast_fp16")];
            tensor<int32, [4]> var_332_begin_0 = const()[name = tensor<string, []>("op_332_begin_0"), val = tensor<int32, [4]>([0, 1856, 0, 0])];
            tensor<int32, [4]> var_332_end_0 = const()[name = tensor<string, []>("op_332_end_0"), val = tensor<int32, [4]>([1, 1920, 1, 64])];
            tensor<bool, [4]> var_332_end_mask_0 = const()[name = tensor<string, []>("op_332_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_332_cast_fp16 = slice_by_index(begin = var_332_begin_0, end = var_332_end_0, end_mask = var_332_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_332_cast_fp16")];
            tensor<int32, [4]> var_336_begin_0 = const()[name = tensor<string, []>("op_336_begin_0"), val = tensor<int32, [4]>([0, 1920, 0, 0])];
            tensor<int32, [4]> var_336_end_0 = const()[name = tensor<string, []>("op_336_end_0"), val = tensor<int32, [4]>([1, 1984, 1, 64])];
            tensor<bool, [4]> var_336_end_mask_0 = const()[name = tensor<string, []>("op_336_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_336_cast_fp16 = slice_by_index(begin = var_336_begin_0, end = var_336_end_0, end_mask = var_336_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_336_cast_fp16")];
            tensor<int32, [4]> var_340_begin_0 = const()[name = tensor<string, []>("op_340_begin_0"), val = tensor<int32, [4]>([0, 1984, 0, 0])];
            tensor<int32, [4]> var_340_end_0 = const()[name = tensor<string, []>("op_340_end_0"), val = tensor<int32, [4]>([1, 2048, 1, 64])];
            tensor<bool, [4]> var_340_end_mask_0 = const()[name = tensor<string, []>("op_340_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_340_cast_fp16 = slice_by_index(begin = var_340_begin_0, end = var_340_end_0, end_mask = var_340_end_mask_0, x = q_7_cast_fp16)[name = tensor<string, []>("op_340_cast_fp16")];
            tensor<int32, [4]> var_346_begin_0 = const()[name = tensor<string, []>("op_346_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_346_end_0 = const()[name = tensor<string, []>("op_346_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_346_end_mask_0 = const()[name = tensor<string, []>("op_346_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_346_cast_fp16 = slice_by_index(begin = var_346_begin_0, end = var_346_end_0, end_mask = var_346_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_346_cast_fp16")];
            tensor<int32, [4]> var_362_begin_0 = const()[name = tensor<string, []>("op_362_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 64])];
            tensor<int32, [4]> var_362_end_0 = const()[name = tensor<string, []>("op_362_end_0"), val = tensor<int32, [4]>([1, 512, 1, 128])];
            tensor<bool, [4]> var_362_end_mask_0 = const()[name = tensor<string, []>("op_362_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_362_cast_fp16 = slice_by_index(begin = var_362_begin_0, end = var_362_end_0, end_mask = var_362_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_362_cast_fp16")];
            tensor<int32, [4]> var_378_begin_0 = const()[name = tensor<string, []>("op_378_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 128])];
            tensor<int32, [4]> var_378_end_0 = const()[name = tensor<string, []>("op_378_end_0"), val = tensor<int32, [4]>([1, 512, 1, 192])];
            tensor<bool, [4]> var_378_end_mask_0 = const()[name = tensor<string, []>("op_378_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_378_cast_fp16 = slice_by_index(begin = var_378_begin_0, end = var_378_end_0, end_mask = var_378_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_378_cast_fp16")];
            tensor<int32, [4]> var_394_begin_0 = const()[name = tensor<string, []>("op_394_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 192])];
            tensor<int32, [4]> var_394_end_0 = const()[name = tensor<string, []>("op_394_end_0"), val = tensor<int32, [4]>([1, 512, 1, 256])];
            tensor<bool, [4]> var_394_end_mask_0 = const()[name = tensor<string, []>("op_394_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_394_cast_fp16 = slice_by_index(begin = var_394_begin_0, end = var_394_end_0, end_mask = var_394_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_394_cast_fp16")];
            tensor<int32, [4]> var_410_begin_0 = const()[name = tensor<string, []>("op_410_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 256])];
            tensor<int32, [4]> var_410_end_0 = const()[name = tensor<string, []>("op_410_end_0"), val = tensor<int32, [4]>([1, 512, 1, 320])];
            tensor<bool, [4]> var_410_end_mask_0 = const()[name = tensor<string, []>("op_410_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_410_cast_fp16 = slice_by_index(begin = var_410_begin_0, end = var_410_end_0, end_mask = var_410_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_410_cast_fp16")];
            tensor<int32, [4]> var_426_begin_0 = const()[name = tensor<string, []>("op_426_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 320])];
            tensor<int32, [4]> var_426_end_0 = const()[name = tensor<string, []>("op_426_end_0"), val = tensor<int32, [4]>([1, 512, 1, 384])];
            tensor<bool, [4]> var_426_end_mask_0 = const()[name = tensor<string, []>("op_426_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_426_cast_fp16 = slice_by_index(begin = var_426_begin_0, end = var_426_end_0, end_mask = var_426_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_426_cast_fp16")];
            tensor<int32, [4]> var_442_begin_0 = const()[name = tensor<string, []>("op_442_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 384])];
            tensor<int32, [4]> var_442_end_0 = const()[name = tensor<string, []>("op_442_end_0"), val = tensor<int32, [4]>([1, 512, 1, 448])];
            tensor<bool, [4]> var_442_end_mask_0 = const()[name = tensor<string, []>("op_442_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_442_cast_fp16 = slice_by_index(begin = var_442_begin_0, end = var_442_end_0, end_mask = var_442_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_442_cast_fp16")];
            tensor<int32, [4]> var_458_begin_0 = const()[name = tensor<string, []>("op_458_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 448])];
            tensor<int32, [4]> var_458_end_0 = const()[name = tensor<string, []>("op_458_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_458_end_mask_0 = const()[name = tensor<string, []>("op_458_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_458_cast_fp16 = slice_by_index(begin = var_458_begin_0, end = var_458_end_0, end_mask = var_458_end_mask_0, x = k_11_cast_fp16)[name = tensor<string, []>("op_458_cast_fp16")];
            tensor<int32, [4]> var_472_begin_0 = const()[name = tensor<string, []>("op_472_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_472_end_0 = const()[name = tensor<string, []>("op_472_end_0"), val = tensor<int32, [4]>([1, 64, 1, 512])];
            tensor<bool, [4]> var_472_end_mask_0 = const()[name = tensor<string, []>("op_472_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_472_cast_fp16 = slice_by_index(begin = var_472_begin_0, end = var_472_end_0, end_mask = var_472_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_472_cast_fp16")];
            tensor<int32, [4]> var_488_begin_0 = const()[name = tensor<string, []>("op_488_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_488_end_0 = const()[name = tensor<string, []>("op_488_end_0"), val = tensor<int32, [4]>([1, 128, 1, 512])];
            tensor<bool, [4]> var_488_end_mask_0 = const()[name = tensor<string, []>("op_488_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_488_cast_fp16 = slice_by_index(begin = var_488_begin_0, end = var_488_end_0, end_mask = var_488_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_488_cast_fp16")];
            tensor<int32, [4]> var_504_begin_0 = const()[name = tensor<string, []>("op_504_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_504_end_0 = const()[name = tensor<string, []>("op_504_end_0"), val = tensor<int32, [4]>([1, 192, 1, 512])];
            tensor<bool, [4]> var_504_end_mask_0 = const()[name = tensor<string, []>("op_504_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_504_cast_fp16 = slice_by_index(begin = var_504_begin_0, end = var_504_end_0, end_mask = var_504_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_504_cast_fp16")];
            tensor<int32, [4]> var_520_begin_0 = const()[name = tensor<string, []>("op_520_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_520_end_0 = const()[name = tensor<string, []>("op_520_end_0"), val = tensor<int32, [4]>([1, 256, 1, 512])];
            tensor<bool, [4]> var_520_end_mask_0 = const()[name = tensor<string, []>("op_520_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_520_cast_fp16 = slice_by_index(begin = var_520_begin_0, end = var_520_end_0, end_mask = var_520_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_520_cast_fp16")];
            tensor<int32, [4]> var_536_begin_0 = const()[name = tensor<string, []>("op_536_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_536_end_0 = const()[name = tensor<string, []>("op_536_end_0"), val = tensor<int32, [4]>([1, 320, 1, 512])];
            tensor<bool, [4]> var_536_end_mask_0 = const()[name = tensor<string, []>("op_536_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_536_cast_fp16 = slice_by_index(begin = var_536_begin_0, end = var_536_end_0, end_mask = var_536_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_536_cast_fp16")];
            tensor<int32, [4]> var_552_begin_0 = const()[name = tensor<string, []>("op_552_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_552_end_0 = const()[name = tensor<string, []>("op_552_end_0"), val = tensor<int32, [4]>([1, 384, 1, 512])];
            tensor<bool, [4]> var_552_end_mask_0 = const()[name = tensor<string, []>("op_552_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_552_cast_fp16 = slice_by_index(begin = var_552_begin_0, end = var_552_end_0, end_mask = var_552_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_552_cast_fp16")];
            tensor<int32, [4]> var_568_begin_0 = const()[name = tensor<string, []>("op_568_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_568_end_0 = const()[name = tensor<string, []>("op_568_end_0"), val = tensor<int32, [4]>([1, 448, 1, 512])];
            tensor<bool, [4]> var_568_end_mask_0 = const()[name = tensor<string, []>("op_568_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_568_cast_fp16 = slice_by_index(begin = var_568_begin_0, end = var_568_end_0, end_mask = var_568_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_568_cast_fp16")];
            tensor<int32, [4]> var_584_begin_0 = const()[name = tensor<string, []>("op_584_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_584_end_0 = const()[name = tensor<string, []>("op_584_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_584_end_mask_0 = const()[name = tensor<string, []>("op_584_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_584_cast_fp16 = slice_by_index(begin = var_584_begin_0, end = var_584_end_0, end_mask = var_584_end_mask_0, x = v_7_cast_fp16)[name = tensor<string, []>("op_584_cast_fp16")];
            tensor<string, []> var_600_equation_0 = const()[name = tensor<string, []>("op_600_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_600_cast_fp16 = einsum(equation = var_600_equation_0, values = (var_346_cast_fp16, var_216_cast_fp16))[name = tensor<string, []>("op_600_cast_fp16")];
            tensor<fp16, []> var_601_to_fp16 = const()[name = tensor<string, []>("op_601_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_602_cast_fp16 = mul(x = var_600_cast_fp16, y = var_601_to_fp16)[name = tensor<string, []>("op_602_cast_fp16")];
            tensor<string, []> var_604_equation_0 = const()[name = tensor<string, []>("op_604_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_604_cast_fp16 = einsum(equation = var_604_equation_0, values = (var_346_cast_fp16, var_220_cast_fp16))[name = tensor<string, []>("op_604_cast_fp16")];
            tensor<fp16, []> var_605_to_fp16 = const()[name = tensor<string, []>("op_605_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_606_cast_fp16 = mul(x = var_604_cast_fp16, y = var_605_to_fp16)[name = tensor<string, []>("op_606_cast_fp16")];
            tensor<string, []> var_608_equation_0 = const()[name = tensor<string, []>("op_608_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_608_cast_fp16 = einsum(equation = var_608_equation_0, values = (var_346_cast_fp16, var_224_cast_fp16))[name = tensor<string, []>("op_608_cast_fp16")];
            tensor<fp16, []> var_609_to_fp16 = const()[name = tensor<string, []>("op_609_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_610_cast_fp16 = mul(x = var_608_cast_fp16, y = var_609_to_fp16)[name = tensor<string, []>("op_610_cast_fp16")];
            tensor<string, []> var_612_equation_0 = const()[name = tensor<string, []>("op_612_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_612_cast_fp16 = einsum(equation = var_612_equation_0, values = (var_346_cast_fp16, var_228_cast_fp16))[name = tensor<string, []>("op_612_cast_fp16")];
            tensor<fp16, []> var_613_to_fp16 = const()[name = tensor<string, []>("op_613_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_614_cast_fp16 = mul(x = var_612_cast_fp16, y = var_613_to_fp16)[name = tensor<string, []>("op_614_cast_fp16")];
            tensor<string, []> var_616_equation_0 = const()[name = tensor<string, []>("op_616_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_616_cast_fp16 = einsum(equation = var_616_equation_0, values = (var_362_cast_fp16, var_232_cast_fp16))[name = tensor<string, []>("op_616_cast_fp16")];
            tensor<fp16, []> var_617_to_fp16 = const()[name = tensor<string, []>("op_617_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_618_cast_fp16 = mul(x = var_616_cast_fp16, y = var_617_to_fp16)[name = tensor<string, []>("op_618_cast_fp16")];
            tensor<string, []> var_620_equation_0 = const()[name = tensor<string, []>("op_620_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_620_cast_fp16 = einsum(equation = var_620_equation_0, values = (var_362_cast_fp16, var_236_cast_fp16))[name = tensor<string, []>("op_620_cast_fp16")];
            tensor<fp16, []> var_621_to_fp16 = const()[name = tensor<string, []>("op_621_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_622_cast_fp16 = mul(x = var_620_cast_fp16, y = var_621_to_fp16)[name = tensor<string, []>("op_622_cast_fp16")];
            tensor<string, []> var_624_equation_0 = const()[name = tensor<string, []>("op_624_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_624_cast_fp16 = einsum(equation = var_624_equation_0, values = (var_362_cast_fp16, var_240_cast_fp16))[name = tensor<string, []>("op_624_cast_fp16")];
            tensor<fp16, []> var_625_to_fp16 = const()[name = tensor<string, []>("op_625_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_626_cast_fp16 = mul(x = var_624_cast_fp16, y = var_625_to_fp16)[name = tensor<string, []>("op_626_cast_fp16")];
            tensor<string, []> var_628_equation_0 = const()[name = tensor<string, []>("op_628_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_628_cast_fp16 = einsum(equation = var_628_equation_0, values = (var_362_cast_fp16, var_244_cast_fp16))[name = tensor<string, []>("op_628_cast_fp16")];
            tensor<fp16, []> var_629_to_fp16 = const()[name = tensor<string, []>("op_629_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_630_cast_fp16 = mul(x = var_628_cast_fp16, y = var_629_to_fp16)[name = tensor<string, []>("op_630_cast_fp16")];
            tensor<string, []> var_632_equation_0 = const()[name = tensor<string, []>("op_632_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_632_cast_fp16 = einsum(equation = var_632_equation_0, values = (var_378_cast_fp16, var_248_cast_fp16))[name = tensor<string, []>("op_632_cast_fp16")];
            tensor<fp16, []> var_633_to_fp16 = const()[name = tensor<string, []>("op_633_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_634_cast_fp16 = mul(x = var_632_cast_fp16, y = var_633_to_fp16)[name = tensor<string, []>("op_634_cast_fp16")];
            tensor<string, []> var_636_equation_0 = const()[name = tensor<string, []>("op_636_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_636_cast_fp16 = einsum(equation = var_636_equation_0, values = (var_378_cast_fp16, var_252_cast_fp16))[name = tensor<string, []>("op_636_cast_fp16")];
            tensor<fp16, []> var_637_to_fp16 = const()[name = tensor<string, []>("op_637_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_638_cast_fp16 = mul(x = var_636_cast_fp16, y = var_637_to_fp16)[name = tensor<string, []>("op_638_cast_fp16")];
            tensor<string, []> var_640_equation_0 = const()[name = tensor<string, []>("op_640_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_640_cast_fp16 = einsum(equation = var_640_equation_0, values = (var_378_cast_fp16, var_256_cast_fp16))[name = tensor<string, []>("op_640_cast_fp16")];
            tensor<fp16, []> var_641_to_fp16 = const()[name = tensor<string, []>("op_641_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_642_cast_fp16 = mul(x = var_640_cast_fp16, y = var_641_to_fp16)[name = tensor<string, []>("op_642_cast_fp16")];
            tensor<string, []> var_644_equation_0 = const()[name = tensor<string, []>("op_644_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_644_cast_fp16 = einsum(equation = var_644_equation_0, values = (var_378_cast_fp16, var_260_cast_fp16))[name = tensor<string, []>("op_644_cast_fp16")];
            tensor<fp16, []> var_645_to_fp16 = const()[name = tensor<string, []>("op_645_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_646_cast_fp16 = mul(x = var_644_cast_fp16, y = var_645_to_fp16)[name = tensor<string, []>("op_646_cast_fp16")];
            tensor<string, []> var_648_equation_0 = const()[name = tensor<string, []>("op_648_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_648_cast_fp16 = einsum(equation = var_648_equation_0, values = (var_394_cast_fp16, var_264_cast_fp16))[name = tensor<string, []>("op_648_cast_fp16")];
            tensor<fp16, []> var_649_to_fp16 = const()[name = tensor<string, []>("op_649_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_650_cast_fp16 = mul(x = var_648_cast_fp16, y = var_649_to_fp16)[name = tensor<string, []>("op_650_cast_fp16")];
            tensor<string, []> var_652_equation_0 = const()[name = tensor<string, []>("op_652_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_652_cast_fp16 = einsum(equation = var_652_equation_0, values = (var_394_cast_fp16, var_268_cast_fp16))[name = tensor<string, []>("op_652_cast_fp16")];
            tensor<fp16, []> var_653_to_fp16 = const()[name = tensor<string, []>("op_653_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_654_cast_fp16 = mul(x = var_652_cast_fp16, y = var_653_to_fp16)[name = tensor<string, []>("op_654_cast_fp16")];
            tensor<string, []> var_656_equation_0 = const()[name = tensor<string, []>("op_656_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_656_cast_fp16 = einsum(equation = var_656_equation_0, values = (var_394_cast_fp16, var_272_cast_fp16))[name = tensor<string, []>("op_656_cast_fp16")];
            tensor<fp16, []> var_657_to_fp16 = const()[name = tensor<string, []>("op_657_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_658_cast_fp16 = mul(x = var_656_cast_fp16, y = var_657_to_fp16)[name = tensor<string, []>("op_658_cast_fp16")];
            tensor<string, []> var_660_equation_0 = const()[name = tensor<string, []>("op_660_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_660_cast_fp16 = einsum(equation = var_660_equation_0, values = (var_394_cast_fp16, var_276_cast_fp16))[name = tensor<string, []>("op_660_cast_fp16")];
            tensor<fp16, []> var_661_to_fp16 = const()[name = tensor<string, []>("op_661_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_662_cast_fp16 = mul(x = var_660_cast_fp16, y = var_661_to_fp16)[name = tensor<string, []>("op_662_cast_fp16")];
            tensor<string, []> var_664_equation_0 = const()[name = tensor<string, []>("op_664_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_664_cast_fp16 = einsum(equation = var_664_equation_0, values = (var_410_cast_fp16, var_280_cast_fp16))[name = tensor<string, []>("op_664_cast_fp16")];
            tensor<fp16, []> var_665_to_fp16 = const()[name = tensor<string, []>("op_665_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_666_cast_fp16 = mul(x = var_664_cast_fp16, y = var_665_to_fp16)[name = tensor<string, []>("op_666_cast_fp16")];
            tensor<string, []> var_668_equation_0 = const()[name = tensor<string, []>("op_668_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_668_cast_fp16 = einsum(equation = var_668_equation_0, values = (var_410_cast_fp16, var_284_cast_fp16))[name = tensor<string, []>("op_668_cast_fp16")];
            tensor<fp16, []> var_669_to_fp16 = const()[name = tensor<string, []>("op_669_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_670_cast_fp16 = mul(x = var_668_cast_fp16, y = var_669_to_fp16)[name = tensor<string, []>("op_670_cast_fp16")];
            tensor<string, []> var_672_equation_0 = const()[name = tensor<string, []>("op_672_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_672_cast_fp16 = einsum(equation = var_672_equation_0, values = (var_410_cast_fp16, var_288_cast_fp16))[name = tensor<string, []>("op_672_cast_fp16")];
            tensor<fp16, []> var_673_to_fp16 = const()[name = tensor<string, []>("op_673_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_674_cast_fp16 = mul(x = var_672_cast_fp16, y = var_673_to_fp16)[name = tensor<string, []>("op_674_cast_fp16")];
            tensor<string, []> var_676_equation_0 = const()[name = tensor<string, []>("op_676_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_676_cast_fp16 = einsum(equation = var_676_equation_0, values = (var_410_cast_fp16, var_292_cast_fp16))[name = tensor<string, []>("op_676_cast_fp16")];
            tensor<fp16, []> var_677_to_fp16 = const()[name = tensor<string, []>("op_677_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_678_cast_fp16 = mul(x = var_676_cast_fp16, y = var_677_to_fp16)[name = tensor<string, []>("op_678_cast_fp16")];
            tensor<string, []> var_680_equation_0 = const()[name = tensor<string, []>("op_680_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_680_cast_fp16 = einsum(equation = var_680_equation_0, values = (var_426_cast_fp16, var_296_cast_fp16))[name = tensor<string, []>("op_680_cast_fp16")];
            tensor<fp16, []> var_681_to_fp16 = const()[name = tensor<string, []>("op_681_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_682_cast_fp16 = mul(x = var_680_cast_fp16, y = var_681_to_fp16)[name = tensor<string, []>("op_682_cast_fp16")];
            tensor<string, []> var_684_equation_0 = const()[name = tensor<string, []>("op_684_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_684_cast_fp16 = einsum(equation = var_684_equation_0, values = (var_426_cast_fp16, var_300_cast_fp16))[name = tensor<string, []>("op_684_cast_fp16")];
            tensor<fp16, []> var_685_to_fp16 = const()[name = tensor<string, []>("op_685_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_686_cast_fp16 = mul(x = var_684_cast_fp16, y = var_685_to_fp16)[name = tensor<string, []>("op_686_cast_fp16")];
            tensor<string, []> var_688_equation_0 = const()[name = tensor<string, []>("op_688_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_688_cast_fp16 = einsum(equation = var_688_equation_0, values = (var_426_cast_fp16, var_304_cast_fp16))[name = tensor<string, []>("op_688_cast_fp16")];
            tensor<fp16, []> var_689_to_fp16 = const()[name = tensor<string, []>("op_689_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_690_cast_fp16 = mul(x = var_688_cast_fp16, y = var_689_to_fp16)[name = tensor<string, []>("op_690_cast_fp16")];
            tensor<string, []> var_692_equation_0 = const()[name = tensor<string, []>("op_692_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_692_cast_fp16 = einsum(equation = var_692_equation_0, values = (var_426_cast_fp16, var_308_cast_fp16))[name = tensor<string, []>("op_692_cast_fp16")];
            tensor<fp16, []> var_693_to_fp16 = const()[name = tensor<string, []>("op_693_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_694_cast_fp16 = mul(x = var_692_cast_fp16, y = var_693_to_fp16)[name = tensor<string, []>("op_694_cast_fp16")];
            tensor<string, []> var_696_equation_0 = const()[name = tensor<string, []>("op_696_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_696_cast_fp16 = einsum(equation = var_696_equation_0, values = (var_442_cast_fp16, var_312_cast_fp16))[name = tensor<string, []>("op_696_cast_fp16")];
            tensor<fp16, []> var_697_to_fp16 = const()[name = tensor<string, []>("op_697_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_698_cast_fp16 = mul(x = var_696_cast_fp16, y = var_697_to_fp16)[name = tensor<string, []>("op_698_cast_fp16")];
            tensor<string, []> var_700_equation_0 = const()[name = tensor<string, []>("op_700_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_700_cast_fp16 = einsum(equation = var_700_equation_0, values = (var_442_cast_fp16, var_316_cast_fp16))[name = tensor<string, []>("op_700_cast_fp16")];
            tensor<fp16, []> var_701_to_fp16 = const()[name = tensor<string, []>("op_701_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_702_cast_fp16 = mul(x = var_700_cast_fp16, y = var_701_to_fp16)[name = tensor<string, []>("op_702_cast_fp16")];
            tensor<string, []> var_704_equation_0 = const()[name = tensor<string, []>("op_704_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_704_cast_fp16 = einsum(equation = var_704_equation_0, values = (var_442_cast_fp16, var_320_cast_fp16))[name = tensor<string, []>("op_704_cast_fp16")];
            tensor<fp16, []> var_705_to_fp16 = const()[name = tensor<string, []>("op_705_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_706_cast_fp16 = mul(x = var_704_cast_fp16, y = var_705_to_fp16)[name = tensor<string, []>("op_706_cast_fp16")];
            tensor<string, []> var_708_equation_0 = const()[name = tensor<string, []>("op_708_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_708_cast_fp16 = einsum(equation = var_708_equation_0, values = (var_442_cast_fp16, var_324_cast_fp16))[name = tensor<string, []>("op_708_cast_fp16")];
            tensor<fp16, []> var_709_to_fp16 = const()[name = tensor<string, []>("op_709_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_710_cast_fp16 = mul(x = var_708_cast_fp16, y = var_709_to_fp16)[name = tensor<string, []>("op_710_cast_fp16")];
            tensor<string, []> var_712_equation_0 = const()[name = tensor<string, []>("op_712_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_712_cast_fp16 = einsum(equation = var_712_equation_0, values = (var_458_cast_fp16, var_328_cast_fp16))[name = tensor<string, []>("op_712_cast_fp16")];
            tensor<fp16, []> var_713_to_fp16 = const()[name = tensor<string, []>("op_713_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_714_cast_fp16 = mul(x = var_712_cast_fp16, y = var_713_to_fp16)[name = tensor<string, []>("op_714_cast_fp16")];
            tensor<string, []> var_716_equation_0 = const()[name = tensor<string, []>("op_716_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_716_cast_fp16 = einsum(equation = var_716_equation_0, values = (var_458_cast_fp16, var_332_cast_fp16))[name = tensor<string, []>("op_716_cast_fp16")];
            tensor<fp16, []> var_717_to_fp16 = const()[name = tensor<string, []>("op_717_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_718_cast_fp16 = mul(x = var_716_cast_fp16, y = var_717_to_fp16)[name = tensor<string, []>("op_718_cast_fp16")];
            tensor<string, []> var_720_equation_0 = const()[name = tensor<string, []>("op_720_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_720_cast_fp16 = einsum(equation = var_720_equation_0, values = (var_458_cast_fp16, var_336_cast_fp16))[name = tensor<string, []>("op_720_cast_fp16")];
            tensor<fp16, []> var_721_to_fp16 = const()[name = tensor<string, []>("op_721_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_722_cast_fp16 = mul(x = var_720_cast_fp16, y = var_721_to_fp16)[name = tensor<string, []>("op_722_cast_fp16")];
            tensor<string, []> var_724_equation_0 = const()[name = tensor<string, []>("op_724_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_724_cast_fp16 = einsum(equation = var_724_equation_0, values = (var_458_cast_fp16, var_340_cast_fp16))[name = tensor<string, []>("op_724_cast_fp16")];
            tensor<fp16, []> var_725_to_fp16 = const()[name = tensor<string, []>("op_725_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_726_cast_fp16 = mul(x = var_724_cast_fp16, y = var_725_to_fp16)[name = tensor<string, []>("op_726_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_1_cast_fp16 = add(x = var_602_cast_fp16, y = mask)[name = tensor<string, []>("aw_1_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_3_cast_fp16 = add(x = var_606_cast_fp16, y = mask)[name = tensor<string, []>("aw_3_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_5_cast_fp16 = add(x = var_610_cast_fp16, y = mask)[name = tensor<string, []>("aw_5_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_7_cast_fp16 = add(x = var_614_cast_fp16, y = mask)[name = tensor<string, []>("aw_7_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_9_cast_fp16 = add(x = var_618_cast_fp16, y = mask)[name = tensor<string, []>("aw_9_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_11_cast_fp16 = add(x = var_622_cast_fp16, y = mask)[name = tensor<string, []>("aw_11_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_13_cast_fp16 = add(x = var_626_cast_fp16, y = mask)[name = tensor<string, []>("aw_13_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_15_cast_fp16 = add(x = var_630_cast_fp16, y = mask)[name = tensor<string, []>("aw_15_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_17_cast_fp16 = add(x = var_634_cast_fp16, y = mask)[name = tensor<string, []>("aw_17_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_19_cast_fp16 = add(x = var_638_cast_fp16, y = mask)[name = tensor<string, []>("aw_19_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_21_cast_fp16 = add(x = var_642_cast_fp16, y = mask)[name = tensor<string, []>("aw_21_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_23_cast_fp16 = add(x = var_646_cast_fp16, y = mask)[name = tensor<string, []>("aw_23_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_25_cast_fp16 = add(x = var_650_cast_fp16, y = mask)[name = tensor<string, []>("aw_25_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_27_cast_fp16 = add(x = var_654_cast_fp16, y = mask)[name = tensor<string, []>("aw_27_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_29_cast_fp16 = add(x = var_658_cast_fp16, y = mask)[name = tensor<string, []>("aw_29_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_31_cast_fp16 = add(x = var_662_cast_fp16, y = mask)[name = tensor<string, []>("aw_31_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_33_cast_fp16 = add(x = var_666_cast_fp16, y = mask)[name = tensor<string, []>("aw_33_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_35_cast_fp16 = add(x = var_670_cast_fp16, y = mask)[name = tensor<string, []>("aw_35_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_37_cast_fp16 = add(x = var_674_cast_fp16, y = mask)[name = tensor<string, []>("aw_37_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_39_cast_fp16 = add(x = var_678_cast_fp16, y = mask)[name = tensor<string, []>("aw_39_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_41_cast_fp16 = add(x = var_682_cast_fp16, y = mask)[name = tensor<string, []>("aw_41_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_43_cast_fp16 = add(x = var_686_cast_fp16, y = mask)[name = tensor<string, []>("aw_43_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_45_cast_fp16 = add(x = var_690_cast_fp16, y = mask)[name = tensor<string, []>("aw_45_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_47_cast_fp16 = add(x = var_694_cast_fp16, y = mask)[name = tensor<string, []>("aw_47_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_49_cast_fp16 = add(x = var_698_cast_fp16, y = mask)[name = tensor<string, []>("aw_49_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_51_cast_fp16 = add(x = var_702_cast_fp16, y = mask)[name = tensor<string, []>("aw_51_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_53_cast_fp16 = add(x = var_706_cast_fp16, y = mask)[name = tensor<string, []>("aw_53_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_55_cast_fp16 = add(x = var_710_cast_fp16, y = mask)[name = tensor<string, []>("aw_55_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_57_cast_fp16 = add(x = var_714_cast_fp16, y = mask)[name = tensor<string, []>("aw_57_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_59_cast_fp16 = add(x = var_718_cast_fp16, y = mask)[name = tensor<string, []>("aw_59_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_61_cast_fp16 = add(x = var_722_cast_fp16, y = mask)[name = tensor<string, []>("aw_61_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_63_cast_fp16 = add(x = var_726_cast_fp16, y = mask)[name = tensor<string, []>("aw_63_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_759_cast_fp16 = softmax(axis = var_69, x = aw_1_cast_fp16)[name = tensor<string, []>("op_759_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_760_cast_fp16 = softmax(axis = var_69, x = aw_3_cast_fp16)[name = tensor<string, []>("op_760_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_761_cast_fp16 = softmax(axis = var_69, x = aw_5_cast_fp16)[name = tensor<string, []>("op_761_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_762_cast_fp16 = softmax(axis = var_69, x = aw_7_cast_fp16)[name = tensor<string, []>("op_762_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_763_cast_fp16 = softmax(axis = var_69, x = aw_9_cast_fp16)[name = tensor<string, []>("op_763_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_764_cast_fp16 = softmax(axis = var_69, x = aw_11_cast_fp16)[name = tensor<string, []>("op_764_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_765_cast_fp16 = softmax(axis = var_69, x = aw_13_cast_fp16)[name = tensor<string, []>("op_765_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_766_cast_fp16 = softmax(axis = var_69, x = aw_15_cast_fp16)[name = tensor<string, []>("op_766_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_767_cast_fp16 = softmax(axis = var_69, x = aw_17_cast_fp16)[name = tensor<string, []>("op_767_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_768_cast_fp16 = softmax(axis = var_69, x = aw_19_cast_fp16)[name = tensor<string, []>("op_768_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_769_cast_fp16 = softmax(axis = var_69, x = aw_21_cast_fp16)[name = tensor<string, []>("op_769_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_770_cast_fp16 = softmax(axis = var_69, x = aw_23_cast_fp16)[name = tensor<string, []>("op_770_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_771_cast_fp16 = softmax(axis = var_69, x = aw_25_cast_fp16)[name = tensor<string, []>("op_771_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_772_cast_fp16 = softmax(axis = var_69, x = aw_27_cast_fp16)[name = tensor<string, []>("op_772_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_773_cast_fp16 = softmax(axis = var_69, x = aw_29_cast_fp16)[name = tensor<string, []>("op_773_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_774_cast_fp16 = softmax(axis = var_69, x = aw_31_cast_fp16)[name = tensor<string, []>("op_774_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_775_cast_fp16 = softmax(axis = var_69, x = aw_33_cast_fp16)[name = tensor<string, []>("op_775_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_776_cast_fp16 = softmax(axis = var_69, x = aw_35_cast_fp16)[name = tensor<string, []>("op_776_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_777_cast_fp16 = softmax(axis = var_69, x = aw_37_cast_fp16)[name = tensor<string, []>("op_777_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_778_cast_fp16 = softmax(axis = var_69, x = aw_39_cast_fp16)[name = tensor<string, []>("op_778_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_779_cast_fp16 = softmax(axis = var_69, x = aw_41_cast_fp16)[name = tensor<string, []>("op_779_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_780_cast_fp16 = softmax(axis = var_69, x = aw_43_cast_fp16)[name = tensor<string, []>("op_780_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_781_cast_fp16 = softmax(axis = var_69, x = aw_45_cast_fp16)[name = tensor<string, []>("op_781_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_782_cast_fp16 = softmax(axis = var_69, x = aw_47_cast_fp16)[name = tensor<string, []>("op_782_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_783_cast_fp16 = softmax(axis = var_69, x = aw_49_cast_fp16)[name = tensor<string, []>("op_783_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_784_cast_fp16 = softmax(axis = var_69, x = aw_51_cast_fp16)[name = tensor<string, []>("op_784_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_785_cast_fp16 = softmax(axis = var_69, x = aw_53_cast_fp16)[name = tensor<string, []>("op_785_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_786_cast_fp16 = softmax(axis = var_69, x = aw_55_cast_fp16)[name = tensor<string, []>("op_786_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_787_cast_fp16 = softmax(axis = var_69, x = aw_57_cast_fp16)[name = tensor<string, []>("op_787_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_788_cast_fp16 = softmax(axis = var_69, x = aw_59_cast_fp16)[name = tensor<string, []>("op_788_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_789_cast_fp16 = softmax(axis = var_69, x = aw_61_cast_fp16)[name = tensor<string, []>("op_789_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_790_cast_fp16 = softmax(axis = var_69, x = aw_63_cast_fp16)[name = tensor<string, []>("op_790_cast_fp16")];
            tensor<string, []> var_792_equation_0 = const()[name = tensor<string, []>("op_792_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_792_cast_fp16 = einsum(equation = var_792_equation_0, values = (var_472_cast_fp16, var_759_cast_fp16))[name = tensor<string, []>("op_792_cast_fp16")];
            tensor<string, []> var_794_equation_0 = const()[name = tensor<string, []>("op_794_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_794_cast_fp16 = einsum(equation = var_794_equation_0, values = (var_472_cast_fp16, var_760_cast_fp16))[name = tensor<string, []>("op_794_cast_fp16")];
            tensor<string, []> var_796_equation_0 = const()[name = tensor<string, []>("op_796_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_796_cast_fp16 = einsum(equation = var_796_equation_0, values = (var_472_cast_fp16, var_761_cast_fp16))[name = tensor<string, []>("op_796_cast_fp16")];
            tensor<string, []> var_798_equation_0 = const()[name = tensor<string, []>("op_798_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_798_cast_fp16 = einsum(equation = var_798_equation_0, values = (var_472_cast_fp16, var_762_cast_fp16))[name = tensor<string, []>("op_798_cast_fp16")];
            tensor<string, []> var_800_equation_0 = const()[name = tensor<string, []>("op_800_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_800_cast_fp16 = einsum(equation = var_800_equation_0, values = (var_488_cast_fp16, var_763_cast_fp16))[name = tensor<string, []>("op_800_cast_fp16")];
            tensor<string, []> var_802_equation_0 = const()[name = tensor<string, []>("op_802_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_802_cast_fp16 = einsum(equation = var_802_equation_0, values = (var_488_cast_fp16, var_764_cast_fp16))[name = tensor<string, []>("op_802_cast_fp16")];
            tensor<string, []> var_804_equation_0 = const()[name = tensor<string, []>("op_804_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_804_cast_fp16 = einsum(equation = var_804_equation_0, values = (var_488_cast_fp16, var_765_cast_fp16))[name = tensor<string, []>("op_804_cast_fp16")];
            tensor<string, []> var_806_equation_0 = const()[name = tensor<string, []>("op_806_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_806_cast_fp16 = einsum(equation = var_806_equation_0, values = (var_488_cast_fp16, var_766_cast_fp16))[name = tensor<string, []>("op_806_cast_fp16")];
            tensor<string, []> var_808_equation_0 = const()[name = tensor<string, []>("op_808_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_808_cast_fp16 = einsum(equation = var_808_equation_0, values = (var_504_cast_fp16, var_767_cast_fp16))[name = tensor<string, []>("op_808_cast_fp16")];
            tensor<string, []> var_810_equation_0 = const()[name = tensor<string, []>("op_810_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_810_cast_fp16 = einsum(equation = var_810_equation_0, values = (var_504_cast_fp16, var_768_cast_fp16))[name = tensor<string, []>("op_810_cast_fp16")];
            tensor<string, []> var_812_equation_0 = const()[name = tensor<string, []>("op_812_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_812_cast_fp16 = einsum(equation = var_812_equation_0, values = (var_504_cast_fp16, var_769_cast_fp16))[name = tensor<string, []>("op_812_cast_fp16")];
            tensor<string, []> var_814_equation_0 = const()[name = tensor<string, []>("op_814_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_814_cast_fp16 = einsum(equation = var_814_equation_0, values = (var_504_cast_fp16, var_770_cast_fp16))[name = tensor<string, []>("op_814_cast_fp16")];
            tensor<string, []> var_816_equation_0 = const()[name = tensor<string, []>("op_816_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_816_cast_fp16 = einsum(equation = var_816_equation_0, values = (var_520_cast_fp16, var_771_cast_fp16))[name = tensor<string, []>("op_816_cast_fp16")];
            tensor<string, []> var_818_equation_0 = const()[name = tensor<string, []>("op_818_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_818_cast_fp16 = einsum(equation = var_818_equation_0, values = (var_520_cast_fp16, var_772_cast_fp16))[name = tensor<string, []>("op_818_cast_fp16")];
            tensor<string, []> var_820_equation_0 = const()[name = tensor<string, []>("op_820_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_820_cast_fp16 = einsum(equation = var_820_equation_0, values = (var_520_cast_fp16, var_773_cast_fp16))[name = tensor<string, []>("op_820_cast_fp16")];
            tensor<string, []> var_822_equation_0 = const()[name = tensor<string, []>("op_822_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_822_cast_fp16 = einsum(equation = var_822_equation_0, values = (var_520_cast_fp16, var_774_cast_fp16))[name = tensor<string, []>("op_822_cast_fp16")];
            tensor<string, []> var_824_equation_0 = const()[name = tensor<string, []>("op_824_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_824_cast_fp16 = einsum(equation = var_824_equation_0, values = (var_536_cast_fp16, var_775_cast_fp16))[name = tensor<string, []>("op_824_cast_fp16")];
            tensor<string, []> var_826_equation_0 = const()[name = tensor<string, []>("op_826_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_826_cast_fp16 = einsum(equation = var_826_equation_0, values = (var_536_cast_fp16, var_776_cast_fp16))[name = tensor<string, []>("op_826_cast_fp16")];
            tensor<string, []> var_828_equation_0 = const()[name = tensor<string, []>("op_828_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_828_cast_fp16 = einsum(equation = var_828_equation_0, values = (var_536_cast_fp16, var_777_cast_fp16))[name = tensor<string, []>("op_828_cast_fp16")];
            tensor<string, []> var_830_equation_0 = const()[name = tensor<string, []>("op_830_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_830_cast_fp16 = einsum(equation = var_830_equation_0, values = (var_536_cast_fp16, var_778_cast_fp16))[name = tensor<string, []>("op_830_cast_fp16")];
            tensor<string, []> var_832_equation_0 = const()[name = tensor<string, []>("op_832_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_832_cast_fp16 = einsum(equation = var_832_equation_0, values = (var_552_cast_fp16, var_779_cast_fp16))[name = tensor<string, []>("op_832_cast_fp16")];
            tensor<string, []> var_834_equation_0 = const()[name = tensor<string, []>("op_834_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_834_cast_fp16 = einsum(equation = var_834_equation_0, values = (var_552_cast_fp16, var_780_cast_fp16))[name = tensor<string, []>("op_834_cast_fp16")];
            tensor<string, []> var_836_equation_0 = const()[name = tensor<string, []>("op_836_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_836_cast_fp16 = einsum(equation = var_836_equation_0, values = (var_552_cast_fp16, var_781_cast_fp16))[name = tensor<string, []>("op_836_cast_fp16")];
            tensor<string, []> var_838_equation_0 = const()[name = tensor<string, []>("op_838_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_838_cast_fp16 = einsum(equation = var_838_equation_0, values = (var_552_cast_fp16, var_782_cast_fp16))[name = tensor<string, []>("op_838_cast_fp16")];
            tensor<string, []> var_840_equation_0 = const()[name = tensor<string, []>("op_840_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_840_cast_fp16 = einsum(equation = var_840_equation_0, values = (var_568_cast_fp16, var_783_cast_fp16))[name = tensor<string, []>("op_840_cast_fp16")];
            tensor<string, []> var_842_equation_0 = const()[name = tensor<string, []>("op_842_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_842_cast_fp16 = einsum(equation = var_842_equation_0, values = (var_568_cast_fp16, var_784_cast_fp16))[name = tensor<string, []>("op_842_cast_fp16")];
            tensor<string, []> var_844_equation_0 = const()[name = tensor<string, []>("op_844_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_844_cast_fp16 = einsum(equation = var_844_equation_0, values = (var_568_cast_fp16, var_785_cast_fp16))[name = tensor<string, []>("op_844_cast_fp16")];
            tensor<string, []> var_846_equation_0 = const()[name = tensor<string, []>("op_846_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_846_cast_fp16 = einsum(equation = var_846_equation_0, values = (var_568_cast_fp16, var_786_cast_fp16))[name = tensor<string, []>("op_846_cast_fp16")];
            tensor<string, []> var_848_equation_0 = const()[name = tensor<string, []>("op_848_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_848_cast_fp16 = einsum(equation = var_848_equation_0, values = (var_584_cast_fp16, var_787_cast_fp16))[name = tensor<string, []>("op_848_cast_fp16")];
            tensor<string, []> var_850_equation_0 = const()[name = tensor<string, []>("op_850_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_850_cast_fp16 = einsum(equation = var_850_equation_0, values = (var_584_cast_fp16, var_788_cast_fp16))[name = tensor<string, []>("op_850_cast_fp16")];
            tensor<string, []> var_852_equation_0 = const()[name = tensor<string, []>("op_852_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_852_cast_fp16 = einsum(equation = var_852_equation_0, values = (var_584_cast_fp16, var_789_cast_fp16))[name = tensor<string, []>("op_852_cast_fp16")];
            tensor<string, []> var_854_equation_0 = const()[name = tensor<string, []>("op_854_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_854_cast_fp16 = einsum(equation = var_854_equation_0, values = (var_584_cast_fp16, var_790_cast_fp16))[name = tensor<string, []>("op_854_cast_fp16")];
            tensor<bool, []> x_15_interleave_0 = const()[name = tensor<string, []>("x_15_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 2048, 1, 64]> x_15_cast_fp16 = concat(axis = var_69, interleave = x_15_interleave_0, values = (var_792_cast_fp16, var_794_cast_fp16, var_796_cast_fp16, var_798_cast_fp16, var_800_cast_fp16, var_802_cast_fp16, var_804_cast_fp16, var_806_cast_fp16, var_808_cast_fp16, var_810_cast_fp16, var_812_cast_fp16, var_814_cast_fp16, var_816_cast_fp16, var_818_cast_fp16, var_820_cast_fp16, var_822_cast_fp16, var_824_cast_fp16, var_826_cast_fp16, var_828_cast_fp16, var_830_cast_fp16, var_832_cast_fp16, var_834_cast_fp16, var_836_cast_fp16, var_838_cast_fp16, var_840_cast_fp16, var_842_cast_fp16, var_844_cast_fp16, var_846_cast_fp16, var_848_cast_fp16, var_850_cast_fp16, var_852_cast_fp16, var_854_cast_fp16))[name = tensor<string, []>("x_15_cast_fp16")];
            tensor<int32, [4]> var_859 = const()[name = tensor<string, []>("op_859"), val = tensor<int32, [4]>([1, 2048, -1, 8])];
            tensor<fp16, [1, 2048, 8, 8]> input_3_cast_fp16 = reshape(shape = var_859, x = x_15_cast_fp16)[name = tensor<string, []>("input_3_cast_fp16")];
            tensor<int32, [2]> var_862 = const()[name = tensor<string, []>("op_862"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_864 = const()[name = tensor<string, []>("op_864"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> attention_output_1_pad_type_0 = const()[name = tensor<string, []>("attention_output_1_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> attention_output_1_pad_0 = const()[name = tensor<string, []>("attention_output_1_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_0_attn_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_attn_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(12587520)))];
            tensor<fp16, [1, 2048, 8, 8]> attention_output_1_cast_fp16 = conv(dilations = var_864, groups = var_69, pad = attention_output_1_pad_0, pad_type = attention_output_1_pad_type_0, strides = var_862, weight = blocks_0_attn_proj_weight_to_fp16, x = input_3_cast_fp16)[name = tensor<string, []>("attention_output_1_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_17_cast_fp16 = add(x = attention_output_1_cast_fp16, y = x)[name = tensor<string, []>("x_17_cast_fp16")];
            tensor<bool, []> x_eps_3_interleave_0 = const()[name = tensor<string, []>("x_eps_3_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_3_to_fp16 = const()[name = tensor<string, []>("eps_chan_3_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(20976192)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_3_cast_fp16 = concat(axis = var_69, interleave = x_eps_3_interleave_0, values = (x_17_cast_fp16, eps_chan_3_to_fp16))[name = tensor<string, []>("x_eps_3_cast_fp16")];
            tensor<int32, [1]> norm_x_3_axes_0 = const()[name = tensor<string, []>("norm_x_3_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_3_cast_fp16 = reduce_l2_norm(axes = norm_x_3_axes_0, keep_dims = var_72, x = x_eps_3_cast_fp16)[name = tensor<string, []>("norm_x_3_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_7_cast_fp16 = real_div(x = x_17_cast_fp16, y = norm_x_3_cast_fp16)[name = tensor<string, []>("x_normed_7_cast_fp16")];
            tensor<fp16, []> var_890_to_fp16 = const()[name = tensor<string, []>("op_890_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_9_cast_fp16 = mul(x = x_normed_7_cast_fp16, y = var_890_to_fp16)[name = tensor<string, []>("x_normed_9_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_0_norm_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_norm_2_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(20976384)))];
            tensor<fp16, [1, 2048, 8, 8]> input_5_cast_fp16 = mul(x = x_normed_9_cast_fp16, y = blocks_0_norm_2_weight_to_fp16)[name = tensor<string, []>("input_5_cast_fp16")];
            tensor<int32, [2]> var_901 = const()[name = tensor<string, []>("op_901"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_903 = const()[name = tensor<string, []>("op_903"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> input_7_pad_type_0 = const()[name = tensor<string, []>("input_7_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> input_7_pad_0 = const()[name = tensor<string, []>("input_7_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_0_mlp_fc_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_mlp_fc_1_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(20980544)))];
            tensor<fp16, [1, 8192, 8, 8]> input_7_cast_fp16 = conv(dilations = var_903, groups = var_69, pad = input_7_pad_0, pad_type = input_7_pad_type_0, strides = var_901, weight = blocks_0_mlp_fc_1_weight_to_fp16, x = input_5_cast_fp16)[name = tensor<string, []>("input_7_cast_fp16")];
            tensor<int32, [2]> var_907 = const()[name = tensor<string, []>("op_907"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_909 = const()[name = tensor<string, []>("op_909"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> x_fc_2_1_pad_type_0 = const()[name = tensor<string, []>("x_fc_2_1_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> x_fc_2_1_pad_0 = const()[name = tensor<string, []>("x_fc_2_1_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_0_mlp_fc_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_mlp_fc_2_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(54535040)))];
            tensor<fp16, [1, 8192, 8, 8]> x_fc_2_1_cast_fp16 = conv(dilations = var_909, groups = var_69, pad = x_fc_2_1_pad_0, pad_type = x_fc_2_1_pad_type_0, strides = var_907, weight = blocks_0_mlp_fc_2_weight_to_fp16, x = input_5_cast_fp16)[name = tensor<string, []>("x_fc_2_1_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> var_912_cast_fp16 = silu(x = input_7_cast_fp16)[name = tensor<string, []>("op_912_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> input_9_cast_fp16 = mul(x = var_912_cast_fp16, y = x_fc_2_1_cast_fp16)[name = tensor<string, []>("input_9_cast_fp16")];
            tensor<int32, [2]> var_915 = const()[name = tensor<string, []>("op_915"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_917 = const()[name = tensor<string, []>("op_917"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> var_919_pad_type_0 = const()[name = tensor<string, []>("op_919_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> var_919_pad_0 = const()[name = tensor<string, []>("op_919_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 8192, 1, 1]> blocks_0_mlp_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_0_mlp_proj_weight_to_fp16"), val = tensor<fp16, [2048, 8192, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(88089536)))];
            tensor<fp16, [1, 2048, 8, 8]> var_919_cast_fp16 = conv(dilations = var_917, groups = var_69, pad = var_919_pad_0, pad_type = var_919_pad_type_0, strides = var_915, weight = blocks_0_mlp_proj_weight_to_fp16, x = input_9_cast_fp16)[name = tensor<string, []>("op_919_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_21_cast_fp16 = add(x = var_919_cast_fp16, y = x_17_cast_fp16)[name = tensor<string, []>("x_21_cast_fp16")];
            tensor<int32, []> var_925 = const()[name = tensor<string, []>("op_925"), val = tensor<int32, []>(-1)];
            tensor<int32, []> var_929 = const()[name = tensor<string, []>("op_929"), val = tensor<int32, []>(-2)];
            tensor<int32, []> var_931 = const()[name = tensor<string, []>("op_931"), val = tensor<int32, []>(-3)];
            tensor<int32, []> var_973 = const()[name = tensor<string, []>("op_973"), val = tensor<int32, []>(1)];
            tensor<bool, []> var_976 = const()[name = tensor<string, []>("op_976"), val = tensor<bool, []>(true)];
            tensor<bool, []> x_eps_5_interleave_0 = const()[name = tensor<string, []>("x_eps_5_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_5_to_fp16 = const()[name = tensor<string, []>("eps_chan_5_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(121644032)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_5_cast_fp16 = concat(axis = var_973, interleave = x_eps_5_interleave_0, values = (x_21_cast_fp16, eps_chan_5_to_fp16))[name = tensor<string, []>("x_eps_5_cast_fp16")];
            tensor<int32, [1]> norm_x_5_axes_0 = const()[name = tensor<string, []>("norm_x_5_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_5_cast_fp16 = reduce_l2_norm(axes = norm_x_5_axes_0, keep_dims = var_976, x = x_eps_5_cast_fp16)[name = tensor<string, []>("norm_x_5_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_13_cast_fp16 = real_div(x = x_21_cast_fp16, y = norm_x_5_cast_fp16)[name = tensor<string, []>("x_normed_13_cast_fp16")];
            tensor<fp16, []> var_999_to_fp16 = const()[name = tensor<string, []>("op_999_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_15_cast_fp16 = mul(x = x_normed_13_cast_fp16, y = var_999_to_fp16)[name = tensor<string, []>("x_normed_15_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_1_norm_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_norm_1_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(121644224)))];
            tensor<fp16, [1, 2048, 8, 8]> x_25_cast_fp16 = mul(x = x_normed_15_cast_fp16, y = blocks_1_norm_1_weight_to_fp16)[name = tensor<string, []>("x_25_cast_fp16")];
            tensor<int32, [4]> var_1023 = const()[name = tensor<string, []>("op_1023"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> input_11_cast_fp16 = reshape(shape = var_1023, x = x_25_cast_fp16)[name = tensor<string, []>("input_11_cast_fp16")];
            tensor<int32, [2]> var_1026 = const()[name = tensor<string, []>("op_1026"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1028 = const()[name = tensor<string, []>("op_1028"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> q_9_pad_type_0 = const()[name = tensor<string, []>("q_9_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> q_9_pad_0 = const()[name = tensor<string, []>("q_9_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_1_attn_q_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_attn_q_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(121648384)))];
            tensor<fp16, [1, 2048, 1, 64]> q_9_cast_fp16 = conv(dilations = var_1028, groups = var_973, pad = q_9_pad_0, pad_type = q_9_pad_type_0, strides = var_1026, weight = blocks_1_attn_q_proj_weight_to_fp16, x = input_11_cast_fp16)[name = tensor<string, []>("q_9_cast_fp16")];
            tensor<int32, [2]> var_1032 = const()[name = tensor<string, []>("op_1032"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1034 = const()[name = tensor<string, []>("op_1034"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> k_13_pad_type_0 = const()[name = tensor<string, []>("k_13_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> k_13_pad_0 = const()[name = tensor<string, []>("k_13_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_1_attn_k_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_attn_k_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(130037056)))];
            tensor<fp16, [1, 512, 1, 64]> k_13_cast_fp16 = conv(dilations = var_1034, groups = var_973, pad = k_13_pad_0, pad_type = k_13_pad_type_0, strides = var_1032, weight = blocks_1_attn_k_proj_weight_to_fp16, x = input_11_cast_fp16)[name = tensor<string, []>("k_13_cast_fp16")];
            tensor<int32, [2]> var_1038 = const()[name = tensor<string, []>("op_1038"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1040 = const()[name = tensor<string, []>("op_1040"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> v_11_pad_type_0 = const()[name = tensor<string, []>("v_11_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> v_11_pad_0 = const()[name = tensor<string, []>("v_11_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_1_attn_v_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_attn_v_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(132134272)))];
            tensor<fp16, [1, 512, 1, 64]> v_11_cast_fp16 = conv(dilations = var_1040, groups = var_973, pad = v_11_pad_0, pad_type = v_11_pad_type_0, strides = var_1038, weight = blocks_1_attn_v_proj_weight_to_fp16, x = input_11_cast_fp16)[name = tensor<string, []>("v_11_cast_fp16")];
            tensor<int32, [4]> var_1043 = const()[name = tensor<string, []>("op_1043"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<fp16, [1, 32, 64, 64]> q_11_cast_fp16 = reshape(shape = var_1043, x = q_9_cast_fp16)[name = tensor<string, []>("q_11_cast_fp16")];
            tensor<int32, [4]> var_1045 = const()[name = tensor<string, []>("op_1045"), val = tensor<int32, [4]>([1, -1, 64, 64])];
            tensor<fp16, [1, 8, 64, 64]> k_15_cast_fp16 = reshape(shape = var_1045, x = k_13_cast_fp16)[name = tensor<string, []>("k_15_cast_fp16")];
            tensor<int32, [4]> var_1059_begin_0 = const()[name = tensor<string, []>("op_1059_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1059_end_0 = const()[name = tensor<string, []>("op_1059_end_0"), val = tensor<int32, [4]>([1, 32, 32, 64])];
            tensor<bool, [4]> var_1059_end_mask_0 = const()[name = tensor<string, []>("op_1059_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 32, 32, 64]> var_1059_cast_fp16 = slice_by_index(begin = var_1059_begin_0, end = var_1059_end_0, end_mask = var_1059_end_mask_0, x = q_11_cast_fp16)[name = tensor<string, []>("op_1059_cast_fp16")];
            tensor<int32, [4]> var_1065_begin_0 = const()[name = tensor<string, []>("op_1065_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_1065_end_0 = const()[name = tensor<string, []>("op_1065_end_0"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<bool, [4]> var_1065_end_mask_0 = const()[name = tensor<string, []>("op_1065_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 32, 32, 64]> var_1065_cast_fp16 = slice_by_index(begin = var_1065_begin_0, end = var_1065_end_0, end_mask = var_1065_end_mask_0, x = q_11_cast_fp16)[name = tensor<string, []>("op_1065_cast_fp16")];
            tensor<fp16, []> const_30_promoted_to_fp16 = const()[name = tensor<string, []>("const_30_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 32, 32, 64]> var_1067_cast_fp16 = mul(x = var_1065_cast_fp16, y = const_30_promoted_to_fp16)[name = tensor<string, []>("op_1067_cast_fp16")];
            tensor<bool, []> rotated_5_interleave_0 = const()[name = tensor<string, []>("rotated_5_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 32, 64, 64]> rotated_5_cast_fp16 = concat(axis = var_929, interleave = rotated_5_interleave_0, values = (var_1067_cast_fp16, var_1059_cast_fp16))[name = tensor<string, []>("rotated_5_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_1070_cast_fp16 = mul(x = q_11_cast_fp16, y = cos)[name = tensor<string, []>("op_1070_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_1071_cast_fp16 = mul(x = rotated_5_cast_fp16, y = sin)[name = tensor<string, []>("op_1071_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> roped_5_cast_fp16 = add(x = var_1070_cast_fp16, y = var_1071_cast_fp16)[name = tensor<string, []>("roped_5_cast_fp16")];
            tensor<int32, [4]> var_1084_begin_0 = const()[name = tensor<string, []>("op_1084_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1084_end_0 = const()[name = tensor<string, []>("op_1084_end_0"), val = tensor<int32, [4]>([1, 8, 32, 64])];
            tensor<bool, [4]> var_1084_end_mask_0 = const()[name = tensor<string, []>("op_1084_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 8, 32, 64]> var_1084_cast_fp16 = slice_by_index(begin = var_1084_begin_0, end = var_1084_end_0, end_mask = var_1084_end_mask_0, x = k_15_cast_fp16)[name = tensor<string, []>("op_1084_cast_fp16")];
            tensor<int32, [4]> var_1090_begin_0 = const()[name = tensor<string, []>("op_1090_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_1090_end_0 = const()[name = tensor<string, []>("op_1090_end_0"), val = tensor<int32, [4]>([1, 8, 64, 64])];
            tensor<bool, [4]> var_1090_end_mask_0 = const()[name = tensor<string, []>("op_1090_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 8, 32, 64]> var_1090_cast_fp16 = slice_by_index(begin = var_1090_begin_0, end = var_1090_end_0, end_mask = var_1090_end_mask_0, x = k_15_cast_fp16)[name = tensor<string, []>("op_1090_cast_fp16")];
            tensor<fp16, []> const_32_promoted_to_fp16 = const()[name = tensor<string, []>("const_32_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 8, 32, 64]> var_1092_cast_fp16 = mul(x = var_1090_cast_fp16, y = const_32_promoted_to_fp16)[name = tensor<string, []>("op_1092_cast_fp16")];
            tensor<bool, []> rotated_7_interleave_0 = const()[name = tensor<string, []>("rotated_7_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 8, 64, 64]> rotated_7_cast_fp16 = concat(axis = var_929, interleave = rotated_7_interleave_0, values = (var_1092_cast_fp16, var_1084_cast_fp16))[name = tensor<string, []>("rotated_7_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_1095_cast_fp16 = mul(x = k_15_cast_fp16, y = cos)[name = tensor<string, []>("op_1095_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_1096_cast_fp16 = mul(x = rotated_7_cast_fp16, y = sin)[name = tensor<string, []>("op_1096_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> roped_7_cast_fp16 = add(x = var_1095_cast_fp16, y = var_1096_cast_fp16)[name = tensor<string, []>("roped_7_cast_fp16")];
            tensor<int32, [4]> var_1099 = const()[name = tensor<string, []>("op_1099"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> k_19_cast_fp16 = reshape(shape = var_1099, x = roped_7_cast_fp16)[name = tensor<string, []>("k_19_cast_fp16")];
            tensor<int32, [4]> var_1101 = const()[name = tensor<string, []>("op_1101"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> new_v_cache_1 = reshape(shape = var_1101, x = v_11_cast_fp16)[name = tensor<string, []>("new_v_cache_1_type_fp32_cast_fp16")];
            tensor<int32, [4]> k_21_perm_0 = const()[name = tensor<string, []>("k_21_perm_0"), val = tensor<int32, [4]>([0, -1, 2, -3])];
            tensor<bool, []> k_23_interleave_0 = const()[name = tensor<string, []>("k_23_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 64, 1, 512]> new_k_cache_1 = transpose(perm = k_21_perm_0, x = k_19_cast_fp16)[name = tensor<string, []>("transpose_2")];
            tensor<fp16, [1, 512, 1, 512]> k_23_cast_fp16 = concat(axis = var_931, interleave = k_23_interleave_0, values = (k_cache_1, new_k_cache_1))[name = tensor<string, []>("k_23_cast_fp16")];
            tensor<bool, []> v_17_interleave_0 = const()[name = tensor<string, []>("v_17_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 512, 1, 512]> v_17_cast_fp16 = concat(axis = var_925, interleave = v_17_interleave_0, values = (v_cache_1, new_v_cache_1))[name = tensor<string, []>("v_17_cast_fp16")];
            tensor<int32, [4]> var_1117 = const()[name = tensor<string, []>("op_1117"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> q_15_cast_fp16 = reshape(shape = var_1117, x = roped_5_cast_fp16)[name = tensor<string, []>("q_15_cast_fp16")];
            tensor<int32, [4]> var_1122_begin_0 = const()[name = tensor<string, []>("op_1122_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1122_end_0 = const()[name = tensor<string, []>("op_1122_end_0"), val = tensor<int32, [4]>([1, 64, 1, 64])];
            tensor<bool, [4]> var_1122_end_mask_0 = const()[name = tensor<string, []>("op_1122_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1122_cast_fp16 = slice_by_index(begin = var_1122_begin_0, end = var_1122_end_0, end_mask = var_1122_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1122_cast_fp16")];
            tensor<int32, [4]> var_1126_begin_0 = const()[name = tensor<string, []>("op_1126_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_1126_end_0 = const()[name = tensor<string, []>("op_1126_end_0"), val = tensor<int32, [4]>([1, 128, 1, 64])];
            tensor<bool, [4]> var_1126_end_mask_0 = const()[name = tensor<string, []>("op_1126_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1126_cast_fp16 = slice_by_index(begin = var_1126_begin_0, end = var_1126_end_0, end_mask = var_1126_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1126_cast_fp16")];
            tensor<int32, [4]> var_1130_begin_0 = const()[name = tensor<string, []>("op_1130_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_1130_end_0 = const()[name = tensor<string, []>("op_1130_end_0"), val = tensor<int32, [4]>([1, 192, 1, 64])];
            tensor<bool, [4]> var_1130_end_mask_0 = const()[name = tensor<string, []>("op_1130_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1130_cast_fp16 = slice_by_index(begin = var_1130_begin_0, end = var_1130_end_0, end_mask = var_1130_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1130_cast_fp16")];
            tensor<int32, [4]> var_1134_begin_0 = const()[name = tensor<string, []>("op_1134_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_1134_end_0 = const()[name = tensor<string, []>("op_1134_end_0"), val = tensor<int32, [4]>([1, 256, 1, 64])];
            tensor<bool, [4]> var_1134_end_mask_0 = const()[name = tensor<string, []>("op_1134_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1134_cast_fp16 = slice_by_index(begin = var_1134_begin_0, end = var_1134_end_0, end_mask = var_1134_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1134_cast_fp16")];
            tensor<int32, [4]> var_1138_begin_0 = const()[name = tensor<string, []>("op_1138_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_1138_end_0 = const()[name = tensor<string, []>("op_1138_end_0"), val = tensor<int32, [4]>([1, 320, 1, 64])];
            tensor<bool, [4]> var_1138_end_mask_0 = const()[name = tensor<string, []>("op_1138_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1138_cast_fp16 = slice_by_index(begin = var_1138_begin_0, end = var_1138_end_0, end_mask = var_1138_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1138_cast_fp16")];
            tensor<int32, [4]> var_1142_begin_0 = const()[name = tensor<string, []>("op_1142_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_1142_end_0 = const()[name = tensor<string, []>("op_1142_end_0"), val = tensor<int32, [4]>([1, 384, 1, 64])];
            tensor<bool, [4]> var_1142_end_mask_0 = const()[name = tensor<string, []>("op_1142_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1142_cast_fp16 = slice_by_index(begin = var_1142_begin_0, end = var_1142_end_0, end_mask = var_1142_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1142_cast_fp16")];
            tensor<int32, [4]> var_1146_begin_0 = const()[name = tensor<string, []>("op_1146_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_1146_end_0 = const()[name = tensor<string, []>("op_1146_end_0"), val = tensor<int32, [4]>([1, 448, 1, 64])];
            tensor<bool, [4]> var_1146_end_mask_0 = const()[name = tensor<string, []>("op_1146_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1146_cast_fp16 = slice_by_index(begin = var_1146_begin_0, end = var_1146_end_0, end_mask = var_1146_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1146_cast_fp16")];
            tensor<int32, [4]> var_1150_begin_0 = const()[name = tensor<string, []>("op_1150_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_1150_end_0 = const()[name = tensor<string, []>("op_1150_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_1150_end_mask_0 = const()[name = tensor<string, []>("op_1150_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1150_cast_fp16 = slice_by_index(begin = var_1150_begin_0, end = var_1150_end_0, end_mask = var_1150_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1150_cast_fp16")];
            tensor<int32, [4]> var_1154_begin_0 = const()[name = tensor<string, []>("op_1154_begin_0"), val = tensor<int32, [4]>([0, 512, 0, 0])];
            tensor<int32, [4]> var_1154_end_0 = const()[name = tensor<string, []>("op_1154_end_0"), val = tensor<int32, [4]>([1, 576, 1, 64])];
            tensor<bool, [4]> var_1154_end_mask_0 = const()[name = tensor<string, []>("op_1154_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1154_cast_fp16 = slice_by_index(begin = var_1154_begin_0, end = var_1154_end_0, end_mask = var_1154_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1154_cast_fp16")];
            tensor<int32, [4]> var_1158_begin_0 = const()[name = tensor<string, []>("op_1158_begin_0"), val = tensor<int32, [4]>([0, 576, 0, 0])];
            tensor<int32, [4]> var_1158_end_0 = const()[name = tensor<string, []>("op_1158_end_0"), val = tensor<int32, [4]>([1, 640, 1, 64])];
            tensor<bool, [4]> var_1158_end_mask_0 = const()[name = tensor<string, []>("op_1158_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1158_cast_fp16 = slice_by_index(begin = var_1158_begin_0, end = var_1158_end_0, end_mask = var_1158_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1158_cast_fp16")];
            tensor<int32, [4]> var_1162_begin_0 = const()[name = tensor<string, []>("op_1162_begin_0"), val = tensor<int32, [4]>([0, 640, 0, 0])];
            tensor<int32, [4]> var_1162_end_0 = const()[name = tensor<string, []>("op_1162_end_0"), val = tensor<int32, [4]>([1, 704, 1, 64])];
            tensor<bool, [4]> var_1162_end_mask_0 = const()[name = tensor<string, []>("op_1162_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1162_cast_fp16 = slice_by_index(begin = var_1162_begin_0, end = var_1162_end_0, end_mask = var_1162_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1162_cast_fp16")];
            tensor<int32, [4]> var_1166_begin_0 = const()[name = tensor<string, []>("op_1166_begin_0"), val = tensor<int32, [4]>([0, 704, 0, 0])];
            tensor<int32, [4]> var_1166_end_0 = const()[name = tensor<string, []>("op_1166_end_0"), val = tensor<int32, [4]>([1, 768, 1, 64])];
            tensor<bool, [4]> var_1166_end_mask_0 = const()[name = tensor<string, []>("op_1166_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1166_cast_fp16 = slice_by_index(begin = var_1166_begin_0, end = var_1166_end_0, end_mask = var_1166_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1166_cast_fp16")];
            tensor<int32, [4]> var_1170_begin_0 = const()[name = tensor<string, []>("op_1170_begin_0"), val = tensor<int32, [4]>([0, 768, 0, 0])];
            tensor<int32, [4]> var_1170_end_0 = const()[name = tensor<string, []>("op_1170_end_0"), val = tensor<int32, [4]>([1, 832, 1, 64])];
            tensor<bool, [4]> var_1170_end_mask_0 = const()[name = tensor<string, []>("op_1170_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1170_cast_fp16 = slice_by_index(begin = var_1170_begin_0, end = var_1170_end_0, end_mask = var_1170_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1170_cast_fp16")];
            tensor<int32, [4]> var_1174_begin_0 = const()[name = tensor<string, []>("op_1174_begin_0"), val = tensor<int32, [4]>([0, 832, 0, 0])];
            tensor<int32, [4]> var_1174_end_0 = const()[name = tensor<string, []>("op_1174_end_0"), val = tensor<int32, [4]>([1, 896, 1, 64])];
            tensor<bool, [4]> var_1174_end_mask_0 = const()[name = tensor<string, []>("op_1174_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1174_cast_fp16 = slice_by_index(begin = var_1174_begin_0, end = var_1174_end_0, end_mask = var_1174_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1174_cast_fp16")];
            tensor<int32, [4]> var_1178_begin_0 = const()[name = tensor<string, []>("op_1178_begin_0"), val = tensor<int32, [4]>([0, 896, 0, 0])];
            tensor<int32, [4]> var_1178_end_0 = const()[name = tensor<string, []>("op_1178_end_0"), val = tensor<int32, [4]>([1, 960, 1, 64])];
            tensor<bool, [4]> var_1178_end_mask_0 = const()[name = tensor<string, []>("op_1178_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1178_cast_fp16 = slice_by_index(begin = var_1178_begin_0, end = var_1178_end_0, end_mask = var_1178_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1178_cast_fp16")];
            tensor<int32, [4]> var_1182_begin_0 = const()[name = tensor<string, []>("op_1182_begin_0"), val = tensor<int32, [4]>([0, 960, 0, 0])];
            tensor<int32, [4]> var_1182_end_0 = const()[name = tensor<string, []>("op_1182_end_0"), val = tensor<int32, [4]>([1, 1024, 1, 64])];
            tensor<bool, [4]> var_1182_end_mask_0 = const()[name = tensor<string, []>("op_1182_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1182_cast_fp16 = slice_by_index(begin = var_1182_begin_0, end = var_1182_end_0, end_mask = var_1182_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1182_cast_fp16")];
            tensor<int32, [4]> var_1186_begin_0 = const()[name = tensor<string, []>("op_1186_begin_0"), val = tensor<int32, [4]>([0, 1024, 0, 0])];
            tensor<int32, [4]> var_1186_end_0 = const()[name = tensor<string, []>("op_1186_end_0"), val = tensor<int32, [4]>([1, 1088, 1, 64])];
            tensor<bool, [4]> var_1186_end_mask_0 = const()[name = tensor<string, []>("op_1186_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1186_cast_fp16 = slice_by_index(begin = var_1186_begin_0, end = var_1186_end_0, end_mask = var_1186_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1186_cast_fp16")];
            tensor<int32, [4]> var_1190_begin_0 = const()[name = tensor<string, []>("op_1190_begin_0"), val = tensor<int32, [4]>([0, 1088, 0, 0])];
            tensor<int32, [4]> var_1190_end_0 = const()[name = tensor<string, []>("op_1190_end_0"), val = tensor<int32, [4]>([1, 1152, 1, 64])];
            tensor<bool, [4]> var_1190_end_mask_0 = const()[name = tensor<string, []>("op_1190_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1190_cast_fp16 = slice_by_index(begin = var_1190_begin_0, end = var_1190_end_0, end_mask = var_1190_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1190_cast_fp16")];
            tensor<int32, [4]> var_1194_begin_0 = const()[name = tensor<string, []>("op_1194_begin_0"), val = tensor<int32, [4]>([0, 1152, 0, 0])];
            tensor<int32, [4]> var_1194_end_0 = const()[name = tensor<string, []>("op_1194_end_0"), val = tensor<int32, [4]>([1, 1216, 1, 64])];
            tensor<bool, [4]> var_1194_end_mask_0 = const()[name = tensor<string, []>("op_1194_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1194_cast_fp16 = slice_by_index(begin = var_1194_begin_0, end = var_1194_end_0, end_mask = var_1194_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1194_cast_fp16")];
            tensor<int32, [4]> var_1198_begin_0 = const()[name = tensor<string, []>("op_1198_begin_0"), val = tensor<int32, [4]>([0, 1216, 0, 0])];
            tensor<int32, [4]> var_1198_end_0 = const()[name = tensor<string, []>("op_1198_end_0"), val = tensor<int32, [4]>([1, 1280, 1, 64])];
            tensor<bool, [4]> var_1198_end_mask_0 = const()[name = tensor<string, []>("op_1198_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1198_cast_fp16 = slice_by_index(begin = var_1198_begin_0, end = var_1198_end_0, end_mask = var_1198_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1198_cast_fp16")];
            tensor<int32, [4]> var_1202_begin_0 = const()[name = tensor<string, []>("op_1202_begin_0"), val = tensor<int32, [4]>([0, 1280, 0, 0])];
            tensor<int32, [4]> var_1202_end_0 = const()[name = tensor<string, []>("op_1202_end_0"), val = tensor<int32, [4]>([1, 1344, 1, 64])];
            tensor<bool, [4]> var_1202_end_mask_0 = const()[name = tensor<string, []>("op_1202_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1202_cast_fp16 = slice_by_index(begin = var_1202_begin_0, end = var_1202_end_0, end_mask = var_1202_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1202_cast_fp16")];
            tensor<int32, [4]> var_1206_begin_0 = const()[name = tensor<string, []>("op_1206_begin_0"), val = tensor<int32, [4]>([0, 1344, 0, 0])];
            tensor<int32, [4]> var_1206_end_0 = const()[name = tensor<string, []>("op_1206_end_0"), val = tensor<int32, [4]>([1, 1408, 1, 64])];
            tensor<bool, [4]> var_1206_end_mask_0 = const()[name = tensor<string, []>("op_1206_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1206_cast_fp16 = slice_by_index(begin = var_1206_begin_0, end = var_1206_end_0, end_mask = var_1206_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1206_cast_fp16")];
            tensor<int32, [4]> var_1210_begin_0 = const()[name = tensor<string, []>("op_1210_begin_0"), val = tensor<int32, [4]>([0, 1408, 0, 0])];
            tensor<int32, [4]> var_1210_end_0 = const()[name = tensor<string, []>("op_1210_end_0"), val = tensor<int32, [4]>([1, 1472, 1, 64])];
            tensor<bool, [4]> var_1210_end_mask_0 = const()[name = tensor<string, []>("op_1210_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1210_cast_fp16 = slice_by_index(begin = var_1210_begin_0, end = var_1210_end_0, end_mask = var_1210_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1210_cast_fp16")];
            tensor<int32, [4]> var_1214_begin_0 = const()[name = tensor<string, []>("op_1214_begin_0"), val = tensor<int32, [4]>([0, 1472, 0, 0])];
            tensor<int32, [4]> var_1214_end_0 = const()[name = tensor<string, []>("op_1214_end_0"), val = tensor<int32, [4]>([1, 1536, 1, 64])];
            tensor<bool, [4]> var_1214_end_mask_0 = const()[name = tensor<string, []>("op_1214_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1214_cast_fp16 = slice_by_index(begin = var_1214_begin_0, end = var_1214_end_0, end_mask = var_1214_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1214_cast_fp16")];
            tensor<int32, [4]> var_1218_begin_0 = const()[name = tensor<string, []>("op_1218_begin_0"), val = tensor<int32, [4]>([0, 1536, 0, 0])];
            tensor<int32, [4]> var_1218_end_0 = const()[name = tensor<string, []>("op_1218_end_0"), val = tensor<int32, [4]>([1, 1600, 1, 64])];
            tensor<bool, [4]> var_1218_end_mask_0 = const()[name = tensor<string, []>("op_1218_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1218_cast_fp16 = slice_by_index(begin = var_1218_begin_0, end = var_1218_end_0, end_mask = var_1218_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1218_cast_fp16")];
            tensor<int32, [4]> var_1222_begin_0 = const()[name = tensor<string, []>("op_1222_begin_0"), val = tensor<int32, [4]>([0, 1600, 0, 0])];
            tensor<int32, [4]> var_1222_end_0 = const()[name = tensor<string, []>("op_1222_end_0"), val = tensor<int32, [4]>([1, 1664, 1, 64])];
            tensor<bool, [4]> var_1222_end_mask_0 = const()[name = tensor<string, []>("op_1222_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1222_cast_fp16 = slice_by_index(begin = var_1222_begin_0, end = var_1222_end_0, end_mask = var_1222_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1222_cast_fp16")];
            tensor<int32, [4]> var_1226_begin_0 = const()[name = tensor<string, []>("op_1226_begin_0"), val = tensor<int32, [4]>([0, 1664, 0, 0])];
            tensor<int32, [4]> var_1226_end_0 = const()[name = tensor<string, []>("op_1226_end_0"), val = tensor<int32, [4]>([1, 1728, 1, 64])];
            tensor<bool, [4]> var_1226_end_mask_0 = const()[name = tensor<string, []>("op_1226_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1226_cast_fp16 = slice_by_index(begin = var_1226_begin_0, end = var_1226_end_0, end_mask = var_1226_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1226_cast_fp16")];
            tensor<int32, [4]> var_1230_begin_0 = const()[name = tensor<string, []>("op_1230_begin_0"), val = tensor<int32, [4]>([0, 1728, 0, 0])];
            tensor<int32, [4]> var_1230_end_0 = const()[name = tensor<string, []>("op_1230_end_0"), val = tensor<int32, [4]>([1, 1792, 1, 64])];
            tensor<bool, [4]> var_1230_end_mask_0 = const()[name = tensor<string, []>("op_1230_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1230_cast_fp16 = slice_by_index(begin = var_1230_begin_0, end = var_1230_end_0, end_mask = var_1230_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1230_cast_fp16")];
            tensor<int32, [4]> var_1234_begin_0 = const()[name = tensor<string, []>("op_1234_begin_0"), val = tensor<int32, [4]>([0, 1792, 0, 0])];
            tensor<int32, [4]> var_1234_end_0 = const()[name = tensor<string, []>("op_1234_end_0"), val = tensor<int32, [4]>([1, 1856, 1, 64])];
            tensor<bool, [4]> var_1234_end_mask_0 = const()[name = tensor<string, []>("op_1234_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1234_cast_fp16 = slice_by_index(begin = var_1234_begin_0, end = var_1234_end_0, end_mask = var_1234_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1234_cast_fp16")];
            tensor<int32, [4]> var_1238_begin_0 = const()[name = tensor<string, []>("op_1238_begin_0"), val = tensor<int32, [4]>([0, 1856, 0, 0])];
            tensor<int32, [4]> var_1238_end_0 = const()[name = tensor<string, []>("op_1238_end_0"), val = tensor<int32, [4]>([1, 1920, 1, 64])];
            tensor<bool, [4]> var_1238_end_mask_0 = const()[name = tensor<string, []>("op_1238_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1238_cast_fp16 = slice_by_index(begin = var_1238_begin_0, end = var_1238_end_0, end_mask = var_1238_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1238_cast_fp16")];
            tensor<int32, [4]> var_1242_begin_0 = const()[name = tensor<string, []>("op_1242_begin_0"), val = tensor<int32, [4]>([0, 1920, 0, 0])];
            tensor<int32, [4]> var_1242_end_0 = const()[name = tensor<string, []>("op_1242_end_0"), val = tensor<int32, [4]>([1, 1984, 1, 64])];
            tensor<bool, [4]> var_1242_end_mask_0 = const()[name = tensor<string, []>("op_1242_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1242_cast_fp16 = slice_by_index(begin = var_1242_begin_0, end = var_1242_end_0, end_mask = var_1242_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1242_cast_fp16")];
            tensor<int32, [4]> var_1246_begin_0 = const()[name = tensor<string, []>("op_1246_begin_0"), val = tensor<int32, [4]>([0, 1984, 0, 0])];
            tensor<int32, [4]> var_1246_end_0 = const()[name = tensor<string, []>("op_1246_end_0"), val = tensor<int32, [4]>([1, 2048, 1, 64])];
            tensor<bool, [4]> var_1246_end_mask_0 = const()[name = tensor<string, []>("op_1246_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_1246_cast_fp16 = slice_by_index(begin = var_1246_begin_0, end = var_1246_end_0, end_mask = var_1246_end_mask_0, x = q_15_cast_fp16)[name = tensor<string, []>("op_1246_cast_fp16")];
            tensor<int32, [4]> var_1252_begin_0 = const()[name = tensor<string, []>("op_1252_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1252_end_0 = const()[name = tensor<string, []>("op_1252_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_1252_end_mask_0 = const()[name = tensor<string, []>("op_1252_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1252_cast_fp16 = slice_by_index(begin = var_1252_begin_0, end = var_1252_end_0, end_mask = var_1252_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1252_cast_fp16")];
            tensor<int32, [4]> var_1268_begin_0 = const()[name = tensor<string, []>("op_1268_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 64])];
            tensor<int32, [4]> var_1268_end_0 = const()[name = tensor<string, []>("op_1268_end_0"), val = tensor<int32, [4]>([1, 512, 1, 128])];
            tensor<bool, [4]> var_1268_end_mask_0 = const()[name = tensor<string, []>("op_1268_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1268_cast_fp16 = slice_by_index(begin = var_1268_begin_0, end = var_1268_end_0, end_mask = var_1268_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1268_cast_fp16")];
            tensor<int32, [4]> var_1284_begin_0 = const()[name = tensor<string, []>("op_1284_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 128])];
            tensor<int32, [4]> var_1284_end_0 = const()[name = tensor<string, []>("op_1284_end_0"), val = tensor<int32, [4]>([1, 512, 1, 192])];
            tensor<bool, [4]> var_1284_end_mask_0 = const()[name = tensor<string, []>("op_1284_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1284_cast_fp16 = slice_by_index(begin = var_1284_begin_0, end = var_1284_end_0, end_mask = var_1284_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1284_cast_fp16")];
            tensor<int32, [4]> var_1300_begin_0 = const()[name = tensor<string, []>("op_1300_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 192])];
            tensor<int32, [4]> var_1300_end_0 = const()[name = tensor<string, []>("op_1300_end_0"), val = tensor<int32, [4]>([1, 512, 1, 256])];
            tensor<bool, [4]> var_1300_end_mask_0 = const()[name = tensor<string, []>("op_1300_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1300_cast_fp16 = slice_by_index(begin = var_1300_begin_0, end = var_1300_end_0, end_mask = var_1300_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1300_cast_fp16")];
            tensor<int32, [4]> var_1316_begin_0 = const()[name = tensor<string, []>("op_1316_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 256])];
            tensor<int32, [4]> var_1316_end_0 = const()[name = tensor<string, []>("op_1316_end_0"), val = tensor<int32, [4]>([1, 512, 1, 320])];
            tensor<bool, [4]> var_1316_end_mask_0 = const()[name = tensor<string, []>("op_1316_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1316_cast_fp16 = slice_by_index(begin = var_1316_begin_0, end = var_1316_end_0, end_mask = var_1316_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1316_cast_fp16")];
            tensor<int32, [4]> var_1332_begin_0 = const()[name = tensor<string, []>("op_1332_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 320])];
            tensor<int32, [4]> var_1332_end_0 = const()[name = tensor<string, []>("op_1332_end_0"), val = tensor<int32, [4]>([1, 512, 1, 384])];
            tensor<bool, [4]> var_1332_end_mask_0 = const()[name = tensor<string, []>("op_1332_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1332_cast_fp16 = slice_by_index(begin = var_1332_begin_0, end = var_1332_end_0, end_mask = var_1332_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1332_cast_fp16")];
            tensor<int32, [4]> var_1348_begin_0 = const()[name = tensor<string, []>("op_1348_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 384])];
            tensor<int32, [4]> var_1348_end_0 = const()[name = tensor<string, []>("op_1348_end_0"), val = tensor<int32, [4]>([1, 512, 1, 448])];
            tensor<bool, [4]> var_1348_end_mask_0 = const()[name = tensor<string, []>("op_1348_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1348_cast_fp16 = slice_by_index(begin = var_1348_begin_0, end = var_1348_end_0, end_mask = var_1348_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1348_cast_fp16")];
            tensor<int32, [4]> var_1364_begin_0 = const()[name = tensor<string, []>("op_1364_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 448])];
            tensor<int32, [4]> var_1364_end_0 = const()[name = tensor<string, []>("op_1364_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_1364_end_mask_0 = const()[name = tensor<string, []>("op_1364_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_1364_cast_fp16 = slice_by_index(begin = var_1364_begin_0, end = var_1364_end_0, end_mask = var_1364_end_mask_0, x = k_23_cast_fp16)[name = tensor<string, []>("op_1364_cast_fp16")];
            tensor<int32, [4]> var_1378_begin_0 = const()[name = tensor<string, []>("op_1378_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1378_end_0 = const()[name = tensor<string, []>("op_1378_end_0"), val = tensor<int32, [4]>([1, 64, 1, 512])];
            tensor<bool, [4]> var_1378_end_mask_0 = const()[name = tensor<string, []>("op_1378_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1378_cast_fp16 = slice_by_index(begin = var_1378_begin_0, end = var_1378_end_0, end_mask = var_1378_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1378_cast_fp16")];
            tensor<int32, [4]> var_1394_begin_0 = const()[name = tensor<string, []>("op_1394_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_1394_end_0 = const()[name = tensor<string, []>("op_1394_end_0"), val = tensor<int32, [4]>([1, 128, 1, 512])];
            tensor<bool, [4]> var_1394_end_mask_0 = const()[name = tensor<string, []>("op_1394_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1394_cast_fp16 = slice_by_index(begin = var_1394_begin_0, end = var_1394_end_0, end_mask = var_1394_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1394_cast_fp16")];
            tensor<int32, [4]> var_1410_begin_0 = const()[name = tensor<string, []>("op_1410_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_1410_end_0 = const()[name = tensor<string, []>("op_1410_end_0"), val = tensor<int32, [4]>([1, 192, 1, 512])];
            tensor<bool, [4]> var_1410_end_mask_0 = const()[name = tensor<string, []>("op_1410_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1410_cast_fp16 = slice_by_index(begin = var_1410_begin_0, end = var_1410_end_0, end_mask = var_1410_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1410_cast_fp16")];
            tensor<int32, [4]> var_1426_begin_0 = const()[name = tensor<string, []>("op_1426_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_1426_end_0 = const()[name = tensor<string, []>("op_1426_end_0"), val = tensor<int32, [4]>([1, 256, 1, 512])];
            tensor<bool, [4]> var_1426_end_mask_0 = const()[name = tensor<string, []>("op_1426_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1426_cast_fp16 = slice_by_index(begin = var_1426_begin_0, end = var_1426_end_0, end_mask = var_1426_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1426_cast_fp16")];
            tensor<int32, [4]> var_1442_begin_0 = const()[name = tensor<string, []>("op_1442_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_1442_end_0 = const()[name = tensor<string, []>("op_1442_end_0"), val = tensor<int32, [4]>([1, 320, 1, 512])];
            tensor<bool, [4]> var_1442_end_mask_0 = const()[name = tensor<string, []>("op_1442_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1442_cast_fp16 = slice_by_index(begin = var_1442_begin_0, end = var_1442_end_0, end_mask = var_1442_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1442_cast_fp16")];
            tensor<int32, [4]> var_1458_begin_0 = const()[name = tensor<string, []>("op_1458_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_1458_end_0 = const()[name = tensor<string, []>("op_1458_end_0"), val = tensor<int32, [4]>([1, 384, 1, 512])];
            tensor<bool, [4]> var_1458_end_mask_0 = const()[name = tensor<string, []>("op_1458_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1458_cast_fp16 = slice_by_index(begin = var_1458_begin_0, end = var_1458_end_0, end_mask = var_1458_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1458_cast_fp16")];
            tensor<int32, [4]> var_1474_begin_0 = const()[name = tensor<string, []>("op_1474_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_1474_end_0 = const()[name = tensor<string, []>("op_1474_end_0"), val = tensor<int32, [4]>([1, 448, 1, 512])];
            tensor<bool, [4]> var_1474_end_mask_0 = const()[name = tensor<string, []>("op_1474_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1474_cast_fp16 = slice_by_index(begin = var_1474_begin_0, end = var_1474_end_0, end_mask = var_1474_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1474_cast_fp16")];
            tensor<int32, [4]> var_1490_begin_0 = const()[name = tensor<string, []>("op_1490_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_1490_end_0 = const()[name = tensor<string, []>("op_1490_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_1490_end_mask_0 = const()[name = tensor<string, []>("op_1490_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_1490_cast_fp16 = slice_by_index(begin = var_1490_begin_0, end = var_1490_end_0, end_mask = var_1490_end_mask_0, x = v_17_cast_fp16)[name = tensor<string, []>("op_1490_cast_fp16")];
            tensor<string, []> var_1506_equation_0 = const()[name = tensor<string, []>("op_1506_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1506_cast_fp16 = einsum(equation = var_1506_equation_0, values = (var_1252_cast_fp16, var_1122_cast_fp16))[name = tensor<string, []>("op_1506_cast_fp16")];
            tensor<fp16, []> var_1507_to_fp16 = const()[name = tensor<string, []>("op_1507_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1508_cast_fp16 = mul(x = var_1506_cast_fp16, y = var_1507_to_fp16)[name = tensor<string, []>("op_1508_cast_fp16")];
            tensor<string, []> var_1510_equation_0 = const()[name = tensor<string, []>("op_1510_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1510_cast_fp16 = einsum(equation = var_1510_equation_0, values = (var_1252_cast_fp16, var_1126_cast_fp16))[name = tensor<string, []>("op_1510_cast_fp16")];
            tensor<fp16, []> var_1511_to_fp16 = const()[name = tensor<string, []>("op_1511_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1512_cast_fp16 = mul(x = var_1510_cast_fp16, y = var_1511_to_fp16)[name = tensor<string, []>("op_1512_cast_fp16")];
            tensor<string, []> var_1514_equation_0 = const()[name = tensor<string, []>("op_1514_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1514_cast_fp16 = einsum(equation = var_1514_equation_0, values = (var_1252_cast_fp16, var_1130_cast_fp16))[name = tensor<string, []>("op_1514_cast_fp16")];
            tensor<fp16, []> var_1515_to_fp16 = const()[name = tensor<string, []>("op_1515_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1516_cast_fp16 = mul(x = var_1514_cast_fp16, y = var_1515_to_fp16)[name = tensor<string, []>("op_1516_cast_fp16")];
            tensor<string, []> var_1518_equation_0 = const()[name = tensor<string, []>("op_1518_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1518_cast_fp16 = einsum(equation = var_1518_equation_0, values = (var_1252_cast_fp16, var_1134_cast_fp16))[name = tensor<string, []>("op_1518_cast_fp16")];
            tensor<fp16, []> var_1519_to_fp16 = const()[name = tensor<string, []>("op_1519_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1520_cast_fp16 = mul(x = var_1518_cast_fp16, y = var_1519_to_fp16)[name = tensor<string, []>("op_1520_cast_fp16")];
            tensor<string, []> var_1522_equation_0 = const()[name = tensor<string, []>("op_1522_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1522_cast_fp16 = einsum(equation = var_1522_equation_0, values = (var_1268_cast_fp16, var_1138_cast_fp16))[name = tensor<string, []>("op_1522_cast_fp16")];
            tensor<fp16, []> var_1523_to_fp16 = const()[name = tensor<string, []>("op_1523_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1524_cast_fp16 = mul(x = var_1522_cast_fp16, y = var_1523_to_fp16)[name = tensor<string, []>("op_1524_cast_fp16")];
            tensor<string, []> var_1526_equation_0 = const()[name = tensor<string, []>("op_1526_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1526_cast_fp16 = einsum(equation = var_1526_equation_0, values = (var_1268_cast_fp16, var_1142_cast_fp16))[name = tensor<string, []>("op_1526_cast_fp16")];
            tensor<fp16, []> var_1527_to_fp16 = const()[name = tensor<string, []>("op_1527_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1528_cast_fp16 = mul(x = var_1526_cast_fp16, y = var_1527_to_fp16)[name = tensor<string, []>("op_1528_cast_fp16")];
            tensor<string, []> var_1530_equation_0 = const()[name = tensor<string, []>("op_1530_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1530_cast_fp16 = einsum(equation = var_1530_equation_0, values = (var_1268_cast_fp16, var_1146_cast_fp16))[name = tensor<string, []>("op_1530_cast_fp16")];
            tensor<fp16, []> var_1531_to_fp16 = const()[name = tensor<string, []>("op_1531_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1532_cast_fp16 = mul(x = var_1530_cast_fp16, y = var_1531_to_fp16)[name = tensor<string, []>("op_1532_cast_fp16")];
            tensor<string, []> var_1534_equation_0 = const()[name = tensor<string, []>("op_1534_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1534_cast_fp16 = einsum(equation = var_1534_equation_0, values = (var_1268_cast_fp16, var_1150_cast_fp16))[name = tensor<string, []>("op_1534_cast_fp16")];
            tensor<fp16, []> var_1535_to_fp16 = const()[name = tensor<string, []>("op_1535_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1536_cast_fp16 = mul(x = var_1534_cast_fp16, y = var_1535_to_fp16)[name = tensor<string, []>("op_1536_cast_fp16")];
            tensor<string, []> var_1538_equation_0 = const()[name = tensor<string, []>("op_1538_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1538_cast_fp16 = einsum(equation = var_1538_equation_0, values = (var_1284_cast_fp16, var_1154_cast_fp16))[name = tensor<string, []>("op_1538_cast_fp16")];
            tensor<fp16, []> var_1539_to_fp16 = const()[name = tensor<string, []>("op_1539_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1540_cast_fp16 = mul(x = var_1538_cast_fp16, y = var_1539_to_fp16)[name = tensor<string, []>("op_1540_cast_fp16")];
            tensor<string, []> var_1542_equation_0 = const()[name = tensor<string, []>("op_1542_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1542_cast_fp16 = einsum(equation = var_1542_equation_0, values = (var_1284_cast_fp16, var_1158_cast_fp16))[name = tensor<string, []>("op_1542_cast_fp16")];
            tensor<fp16, []> var_1543_to_fp16 = const()[name = tensor<string, []>("op_1543_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1544_cast_fp16 = mul(x = var_1542_cast_fp16, y = var_1543_to_fp16)[name = tensor<string, []>("op_1544_cast_fp16")];
            tensor<string, []> var_1546_equation_0 = const()[name = tensor<string, []>("op_1546_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1546_cast_fp16 = einsum(equation = var_1546_equation_0, values = (var_1284_cast_fp16, var_1162_cast_fp16))[name = tensor<string, []>("op_1546_cast_fp16")];
            tensor<fp16, []> var_1547_to_fp16 = const()[name = tensor<string, []>("op_1547_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1548_cast_fp16 = mul(x = var_1546_cast_fp16, y = var_1547_to_fp16)[name = tensor<string, []>("op_1548_cast_fp16")];
            tensor<string, []> var_1550_equation_0 = const()[name = tensor<string, []>("op_1550_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1550_cast_fp16 = einsum(equation = var_1550_equation_0, values = (var_1284_cast_fp16, var_1166_cast_fp16))[name = tensor<string, []>("op_1550_cast_fp16")];
            tensor<fp16, []> var_1551_to_fp16 = const()[name = tensor<string, []>("op_1551_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1552_cast_fp16 = mul(x = var_1550_cast_fp16, y = var_1551_to_fp16)[name = tensor<string, []>("op_1552_cast_fp16")];
            tensor<string, []> var_1554_equation_0 = const()[name = tensor<string, []>("op_1554_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1554_cast_fp16 = einsum(equation = var_1554_equation_0, values = (var_1300_cast_fp16, var_1170_cast_fp16))[name = tensor<string, []>("op_1554_cast_fp16")];
            tensor<fp16, []> var_1555_to_fp16 = const()[name = tensor<string, []>("op_1555_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1556_cast_fp16 = mul(x = var_1554_cast_fp16, y = var_1555_to_fp16)[name = tensor<string, []>("op_1556_cast_fp16")];
            tensor<string, []> var_1558_equation_0 = const()[name = tensor<string, []>("op_1558_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1558_cast_fp16 = einsum(equation = var_1558_equation_0, values = (var_1300_cast_fp16, var_1174_cast_fp16))[name = tensor<string, []>("op_1558_cast_fp16")];
            tensor<fp16, []> var_1559_to_fp16 = const()[name = tensor<string, []>("op_1559_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1560_cast_fp16 = mul(x = var_1558_cast_fp16, y = var_1559_to_fp16)[name = tensor<string, []>("op_1560_cast_fp16")];
            tensor<string, []> var_1562_equation_0 = const()[name = tensor<string, []>("op_1562_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1562_cast_fp16 = einsum(equation = var_1562_equation_0, values = (var_1300_cast_fp16, var_1178_cast_fp16))[name = tensor<string, []>("op_1562_cast_fp16")];
            tensor<fp16, []> var_1563_to_fp16 = const()[name = tensor<string, []>("op_1563_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1564_cast_fp16 = mul(x = var_1562_cast_fp16, y = var_1563_to_fp16)[name = tensor<string, []>("op_1564_cast_fp16")];
            tensor<string, []> var_1566_equation_0 = const()[name = tensor<string, []>("op_1566_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1566_cast_fp16 = einsum(equation = var_1566_equation_0, values = (var_1300_cast_fp16, var_1182_cast_fp16))[name = tensor<string, []>("op_1566_cast_fp16")];
            tensor<fp16, []> var_1567_to_fp16 = const()[name = tensor<string, []>("op_1567_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1568_cast_fp16 = mul(x = var_1566_cast_fp16, y = var_1567_to_fp16)[name = tensor<string, []>("op_1568_cast_fp16")];
            tensor<string, []> var_1570_equation_0 = const()[name = tensor<string, []>("op_1570_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1570_cast_fp16 = einsum(equation = var_1570_equation_0, values = (var_1316_cast_fp16, var_1186_cast_fp16))[name = tensor<string, []>("op_1570_cast_fp16")];
            tensor<fp16, []> var_1571_to_fp16 = const()[name = tensor<string, []>("op_1571_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1572_cast_fp16 = mul(x = var_1570_cast_fp16, y = var_1571_to_fp16)[name = tensor<string, []>("op_1572_cast_fp16")];
            tensor<string, []> var_1574_equation_0 = const()[name = tensor<string, []>("op_1574_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1574_cast_fp16 = einsum(equation = var_1574_equation_0, values = (var_1316_cast_fp16, var_1190_cast_fp16))[name = tensor<string, []>("op_1574_cast_fp16")];
            tensor<fp16, []> var_1575_to_fp16 = const()[name = tensor<string, []>("op_1575_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1576_cast_fp16 = mul(x = var_1574_cast_fp16, y = var_1575_to_fp16)[name = tensor<string, []>("op_1576_cast_fp16")];
            tensor<string, []> var_1578_equation_0 = const()[name = tensor<string, []>("op_1578_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1578_cast_fp16 = einsum(equation = var_1578_equation_0, values = (var_1316_cast_fp16, var_1194_cast_fp16))[name = tensor<string, []>("op_1578_cast_fp16")];
            tensor<fp16, []> var_1579_to_fp16 = const()[name = tensor<string, []>("op_1579_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1580_cast_fp16 = mul(x = var_1578_cast_fp16, y = var_1579_to_fp16)[name = tensor<string, []>("op_1580_cast_fp16")];
            tensor<string, []> var_1582_equation_0 = const()[name = tensor<string, []>("op_1582_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1582_cast_fp16 = einsum(equation = var_1582_equation_0, values = (var_1316_cast_fp16, var_1198_cast_fp16))[name = tensor<string, []>("op_1582_cast_fp16")];
            tensor<fp16, []> var_1583_to_fp16 = const()[name = tensor<string, []>("op_1583_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1584_cast_fp16 = mul(x = var_1582_cast_fp16, y = var_1583_to_fp16)[name = tensor<string, []>("op_1584_cast_fp16")];
            tensor<string, []> var_1586_equation_0 = const()[name = tensor<string, []>("op_1586_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1586_cast_fp16 = einsum(equation = var_1586_equation_0, values = (var_1332_cast_fp16, var_1202_cast_fp16))[name = tensor<string, []>("op_1586_cast_fp16")];
            tensor<fp16, []> var_1587_to_fp16 = const()[name = tensor<string, []>("op_1587_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1588_cast_fp16 = mul(x = var_1586_cast_fp16, y = var_1587_to_fp16)[name = tensor<string, []>("op_1588_cast_fp16")];
            tensor<string, []> var_1590_equation_0 = const()[name = tensor<string, []>("op_1590_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1590_cast_fp16 = einsum(equation = var_1590_equation_0, values = (var_1332_cast_fp16, var_1206_cast_fp16))[name = tensor<string, []>("op_1590_cast_fp16")];
            tensor<fp16, []> var_1591_to_fp16 = const()[name = tensor<string, []>("op_1591_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1592_cast_fp16 = mul(x = var_1590_cast_fp16, y = var_1591_to_fp16)[name = tensor<string, []>("op_1592_cast_fp16")];
            tensor<string, []> var_1594_equation_0 = const()[name = tensor<string, []>("op_1594_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1594_cast_fp16 = einsum(equation = var_1594_equation_0, values = (var_1332_cast_fp16, var_1210_cast_fp16))[name = tensor<string, []>("op_1594_cast_fp16")];
            tensor<fp16, []> var_1595_to_fp16 = const()[name = tensor<string, []>("op_1595_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1596_cast_fp16 = mul(x = var_1594_cast_fp16, y = var_1595_to_fp16)[name = tensor<string, []>("op_1596_cast_fp16")];
            tensor<string, []> var_1598_equation_0 = const()[name = tensor<string, []>("op_1598_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1598_cast_fp16 = einsum(equation = var_1598_equation_0, values = (var_1332_cast_fp16, var_1214_cast_fp16))[name = tensor<string, []>("op_1598_cast_fp16")];
            tensor<fp16, []> var_1599_to_fp16 = const()[name = tensor<string, []>("op_1599_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1600_cast_fp16 = mul(x = var_1598_cast_fp16, y = var_1599_to_fp16)[name = tensor<string, []>("op_1600_cast_fp16")];
            tensor<string, []> var_1602_equation_0 = const()[name = tensor<string, []>("op_1602_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1602_cast_fp16 = einsum(equation = var_1602_equation_0, values = (var_1348_cast_fp16, var_1218_cast_fp16))[name = tensor<string, []>("op_1602_cast_fp16")];
            tensor<fp16, []> var_1603_to_fp16 = const()[name = tensor<string, []>("op_1603_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1604_cast_fp16 = mul(x = var_1602_cast_fp16, y = var_1603_to_fp16)[name = tensor<string, []>("op_1604_cast_fp16")];
            tensor<string, []> var_1606_equation_0 = const()[name = tensor<string, []>("op_1606_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1606_cast_fp16 = einsum(equation = var_1606_equation_0, values = (var_1348_cast_fp16, var_1222_cast_fp16))[name = tensor<string, []>("op_1606_cast_fp16")];
            tensor<fp16, []> var_1607_to_fp16 = const()[name = tensor<string, []>("op_1607_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1608_cast_fp16 = mul(x = var_1606_cast_fp16, y = var_1607_to_fp16)[name = tensor<string, []>("op_1608_cast_fp16")];
            tensor<string, []> var_1610_equation_0 = const()[name = tensor<string, []>("op_1610_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1610_cast_fp16 = einsum(equation = var_1610_equation_0, values = (var_1348_cast_fp16, var_1226_cast_fp16))[name = tensor<string, []>("op_1610_cast_fp16")];
            tensor<fp16, []> var_1611_to_fp16 = const()[name = tensor<string, []>("op_1611_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1612_cast_fp16 = mul(x = var_1610_cast_fp16, y = var_1611_to_fp16)[name = tensor<string, []>("op_1612_cast_fp16")];
            tensor<string, []> var_1614_equation_0 = const()[name = tensor<string, []>("op_1614_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1614_cast_fp16 = einsum(equation = var_1614_equation_0, values = (var_1348_cast_fp16, var_1230_cast_fp16))[name = tensor<string, []>("op_1614_cast_fp16")];
            tensor<fp16, []> var_1615_to_fp16 = const()[name = tensor<string, []>("op_1615_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1616_cast_fp16 = mul(x = var_1614_cast_fp16, y = var_1615_to_fp16)[name = tensor<string, []>("op_1616_cast_fp16")];
            tensor<string, []> var_1618_equation_0 = const()[name = tensor<string, []>("op_1618_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1618_cast_fp16 = einsum(equation = var_1618_equation_0, values = (var_1364_cast_fp16, var_1234_cast_fp16))[name = tensor<string, []>("op_1618_cast_fp16")];
            tensor<fp16, []> var_1619_to_fp16 = const()[name = tensor<string, []>("op_1619_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1620_cast_fp16 = mul(x = var_1618_cast_fp16, y = var_1619_to_fp16)[name = tensor<string, []>("op_1620_cast_fp16")];
            tensor<string, []> var_1622_equation_0 = const()[name = tensor<string, []>("op_1622_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1622_cast_fp16 = einsum(equation = var_1622_equation_0, values = (var_1364_cast_fp16, var_1238_cast_fp16))[name = tensor<string, []>("op_1622_cast_fp16")];
            tensor<fp16, []> var_1623_to_fp16 = const()[name = tensor<string, []>("op_1623_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1624_cast_fp16 = mul(x = var_1622_cast_fp16, y = var_1623_to_fp16)[name = tensor<string, []>("op_1624_cast_fp16")];
            tensor<string, []> var_1626_equation_0 = const()[name = tensor<string, []>("op_1626_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1626_cast_fp16 = einsum(equation = var_1626_equation_0, values = (var_1364_cast_fp16, var_1242_cast_fp16))[name = tensor<string, []>("op_1626_cast_fp16")];
            tensor<fp16, []> var_1627_to_fp16 = const()[name = tensor<string, []>("op_1627_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1628_cast_fp16 = mul(x = var_1626_cast_fp16, y = var_1627_to_fp16)[name = tensor<string, []>("op_1628_cast_fp16")];
            tensor<string, []> var_1630_equation_0 = const()[name = tensor<string, []>("op_1630_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_1630_cast_fp16 = einsum(equation = var_1630_equation_0, values = (var_1364_cast_fp16, var_1246_cast_fp16))[name = tensor<string, []>("op_1630_cast_fp16")];
            tensor<fp16, []> var_1631_to_fp16 = const()[name = tensor<string, []>("op_1631_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_1632_cast_fp16 = mul(x = var_1630_cast_fp16, y = var_1631_to_fp16)[name = tensor<string, []>("op_1632_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_65_cast_fp16 = add(x = var_1508_cast_fp16, y = mask)[name = tensor<string, []>("aw_65_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_67_cast_fp16 = add(x = var_1512_cast_fp16, y = mask)[name = tensor<string, []>("aw_67_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_69_cast_fp16 = add(x = var_1516_cast_fp16, y = mask)[name = tensor<string, []>("aw_69_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_71_cast_fp16 = add(x = var_1520_cast_fp16, y = mask)[name = tensor<string, []>("aw_71_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_73_cast_fp16 = add(x = var_1524_cast_fp16, y = mask)[name = tensor<string, []>("aw_73_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_75_cast_fp16 = add(x = var_1528_cast_fp16, y = mask)[name = tensor<string, []>("aw_75_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_77_cast_fp16 = add(x = var_1532_cast_fp16, y = mask)[name = tensor<string, []>("aw_77_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_79_cast_fp16 = add(x = var_1536_cast_fp16, y = mask)[name = tensor<string, []>("aw_79_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_81_cast_fp16 = add(x = var_1540_cast_fp16, y = mask)[name = tensor<string, []>("aw_81_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_83_cast_fp16 = add(x = var_1544_cast_fp16, y = mask)[name = tensor<string, []>("aw_83_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_85_cast_fp16 = add(x = var_1548_cast_fp16, y = mask)[name = tensor<string, []>("aw_85_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_87_cast_fp16 = add(x = var_1552_cast_fp16, y = mask)[name = tensor<string, []>("aw_87_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_89_cast_fp16 = add(x = var_1556_cast_fp16, y = mask)[name = tensor<string, []>("aw_89_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_91_cast_fp16 = add(x = var_1560_cast_fp16, y = mask)[name = tensor<string, []>("aw_91_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_93_cast_fp16 = add(x = var_1564_cast_fp16, y = mask)[name = tensor<string, []>("aw_93_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_95_cast_fp16 = add(x = var_1568_cast_fp16, y = mask)[name = tensor<string, []>("aw_95_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_97_cast_fp16 = add(x = var_1572_cast_fp16, y = mask)[name = tensor<string, []>("aw_97_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_99_cast_fp16 = add(x = var_1576_cast_fp16, y = mask)[name = tensor<string, []>("aw_99_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_101_cast_fp16 = add(x = var_1580_cast_fp16, y = mask)[name = tensor<string, []>("aw_101_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_103_cast_fp16 = add(x = var_1584_cast_fp16, y = mask)[name = tensor<string, []>("aw_103_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_105_cast_fp16 = add(x = var_1588_cast_fp16, y = mask)[name = tensor<string, []>("aw_105_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_107_cast_fp16 = add(x = var_1592_cast_fp16, y = mask)[name = tensor<string, []>("aw_107_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_109_cast_fp16 = add(x = var_1596_cast_fp16, y = mask)[name = tensor<string, []>("aw_109_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_111_cast_fp16 = add(x = var_1600_cast_fp16, y = mask)[name = tensor<string, []>("aw_111_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_113_cast_fp16 = add(x = var_1604_cast_fp16, y = mask)[name = tensor<string, []>("aw_113_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_115_cast_fp16 = add(x = var_1608_cast_fp16, y = mask)[name = tensor<string, []>("aw_115_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_117_cast_fp16 = add(x = var_1612_cast_fp16, y = mask)[name = tensor<string, []>("aw_117_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_119_cast_fp16 = add(x = var_1616_cast_fp16, y = mask)[name = tensor<string, []>("aw_119_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_121_cast_fp16 = add(x = var_1620_cast_fp16, y = mask)[name = tensor<string, []>("aw_121_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_123_cast_fp16 = add(x = var_1624_cast_fp16, y = mask)[name = tensor<string, []>("aw_123_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_125_cast_fp16 = add(x = var_1628_cast_fp16, y = mask)[name = tensor<string, []>("aw_125_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_127_cast_fp16 = add(x = var_1632_cast_fp16, y = mask)[name = tensor<string, []>("aw_127_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1665_cast_fp16 = softmax(axis = var_973, x = aw_65_cast_fp16)[name = tensor<string, []>("op_1665_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1666_cast_fp16 = softmax(axis = var_973, x = aw_67_cast_fp16)[name = tensor<string, []>("op_1666_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1667_cast_fp16 = softmax(axis = var_973, x = aw_69_cast_fp16)[name = tensor<string, []>("op_1667_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1668_cast_fp16 = softmax(axis = var_973, x = aw_71_cast_fp16)[name = tensor<string, []>("op_1668_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1669_cast_fp16 = softmax(axis = var_973, x = aw_73_cast_fp16)[name = tensor<string, []>("op_1669_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1670_cast_fp16 = softmax(axis = var_973, x = aw_75_cast_fp16)[name = tensor<string, []>("op_1670_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1671_cast_fp16 = softmax(axis = var_973, x = aw_77_cast_fp16)[name = tensor<string, []>("op_1671_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1672_cast_fp16 = softmax(axis = var_973, x = aw_79_cast_fp16)[name = tensor<string, []>("op_1672_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1673_cast_fp16 = softmax(axis = var_973, x = aw_81_cast_fp16)[name = tensor<string, []>("op_1673_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1674_cast_fp16 = softmax(axis = var_973, x = aw_83_cast_fp16)[name = tensor<string, []>("op_1674_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1675_cast_fp16 = softmax(axis = var_973, x = aw_85_cast_fp16)[name = tensor<string, []>("op_1675_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1676_cast_fp16 = softmax(axis = var_973, x = aw_87_cast_fp16)[name = tensor<string, []>("op_1676_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1677_cast_fp16 = softmax(axis = var_973, x = aw_89_cast_fp16)[name = tensor<string, []>("op_1677_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1678_cast_fp16 = softmax(axis = var_973, x = aw_91_cast_fp16)[name = tensor<string, []>("op_1678_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1679_cast_fp16 = softmax(axis = var_973, x = aw_93_cast_fp16)[name = tensor<string, []>("op_1679_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1680_cast_fp16 = softmax(axis = var_973, x = aw_95_cast_fp16)[name = tensor<string, []>("op_1680_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1681_cast_fp16 = softmax(axis = var_973, x = aw_97_cast_fp16)[name = tensor<string, []>("op_1681_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1682_cast_fp16 = softmax(axis = var_973, x = aw_99_cast_fp16)[name = tensor<string, []>("op_1682_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1683_cast_fp16 = softmax(axis = var_973, x = aw_101_cast_fp16)[name = tensor<string, []>("op_1683_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1684_cast_fp16 = softmax(axis = var_973, x = aw_103_cast_fp16)[name = tensor<string, []>("op_1684_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1685_cast_fp16 = softmax(axis = var_973, x = aw_105_cast_fp16)[name = tensor<string, []>("op_1685_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1686_cast_fp16 = softmax(axis = var_973, x = aw_107_cast_fp16)[name = tensor<string, []>("op_1686_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1687_cast_fp16 = softmax(axis = var_973, x = aw_109_cast_fp16)[name = tensor<string, []>("op_1687_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1688_cast_fp16 = softmax(axis = var_973, x = aw_111_cast_fp16)[name = tensor<string, []>("op_1688_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1689_cast_fp16 = softmax(axis = var_973, x = aw_113_cast_fp16)[name = tensor<string, []>("op_1689_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1690_cast_fp16 = softmax(axis = var_973, x = aw_115_cast_fp16)[name = tensor<string, []>("op_1690_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1691_cast_fp16 = softmax(axis = var_973, x = aw_117_cast_fp16)[name = tensor<string, []>("op_1691_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1692_cast_fp16 = softmax(axis = var_973, x = aw_119_cast_fp16)[name = tensor<string, []>("op_1692_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1693_cast_fp16 = softmax(axis = var_973, x = aw_121_cast_fp16)[name = tensor<string, []>("op_1693_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1694_cast_fp16 = softmax(axis = var_973, x = aw_123_cast_fp16)[name = tensor<string, []>("op_1694_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1695_cast_fp16 = softmax(axis = var_973, x = aw_125_cast_fp16)[name = tensor<string, []>("op_1695_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_1696_cast_fp16 = softmax(axis = var_973, x = aw_127_cast_fp16)[name = tensor<string, []>("op_1696_cast_fp16")];
            tensor<string, []> var_1698_equation_0 = const()[name = tensor<string, []>("op_1698_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1698_cast_fp16 = einsum(equation = var_1698_equation_0, values = (var_1378_cast_fp16, var_1665_cast_fp16))[name = tensor<string, []>("op_1698_cast_fp16")];
            tensor<string, []> var_1700_equation_0 = const()[name = tensor<string, []>("op_1700_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1700_cast_fp16 = einsum(equation = var_1700_equation_0, values = (var_1378_cast_fp16, var_1666_cast_fp16))[name = tensor<string, []>("op_1700_cast_fp16")];
            tensor<string, []> var_1702_equation_0 = const()[name = tensor<string, []>("op_1702_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1702_cast_fp16 = einsum(equation = var_1702_equation_0, values = (var_1378_cast_fp16, var_1667_cast_fp16))[name = tensor<string, []>("op_1702_cast_fp16")];
            tensor<string, []> var_1704_equation_0 = const()[name = tensor<string, []>("op_1704_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1704_cast_fp16 = einsum(equation = var_1704_equation_0, values = (var_1378_cast_fp16, var_1668_cast_fp16))[name = tensor<string, []>("op_1704_cast_fp16")];
            tensor<string, []> var_1706_equation_0 = const()[name = tensor<string, []>("op_1706_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1706_cast_fp16 = einsum(equation = var_1706_equation_0, values = (var_1394_cast_fp16, var_1669_cast_fp16))[name = tensor<string, []>("op_1706_cast_fp16")];
            tensor<string, []> var_1708_equation_0 = const()[name = tensor<string, []>("op_1708_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1708_cast_fp16 = einsum(equation = var_1708_equation_0, values = (var_1394_cast_fp16, var_1670_cast_fp16))[name = tensor<string, []>("op_1708_cast_fp16")];
            tensor<string, []> var_1710_equation_0 = const()[name = tensor<string, []>("op_1710_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1710_cast_fp16 = einsum(equation = var_1710_equation_0, values = (var_1394_cast_fp16, var_1671_cast_fp16))[name = tensor<string, []>("op_1710_cast_fp16")];
            tensor<string, []> var_1712_equation_0 = const()[name = tensor<string, []>("op_1712_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1712_cast_fp16 = einsum(equation = var_1712_equation_0, values = (var_1394_cast_fp16, var_1672_cast_fp16))[name = tensor<string, []>("op_1712_cast_fp16")];
            tensor<string, []> var_1714_equation_0 = const()[name = tensor<string, []>("op_1714_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1714_cast_fp16 = einsum(equation = var_1714_equation_0, values = (var_1410_cast_fp16, var_1673_cast_fp16))[name = tensor<string, []>("op_1714_cast_fp16")];
            tensor<string, []> var_1716_equation_0 = const()[name = tensor<string, []>("op_1716_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1716_cast_fp16 = einsum(equation = var_1716_equation_0, values = (var_1410_cast_fp16, var_1674_cast_fp16))[name = tensor<string, []>("op_1716_cast_fp16")];
            tensor<string, []> var_1718_equation_0 = const()[name = tensor<string, []>("op_1718_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1718_cast_fp16 = einsum(equation = var_1718_equation_0, values = (var_1410_cast_fp16, var_1675_cast_fp16))[name = tensor<string, []>("op_1718_cast_fp16")];
            tensor<string, []> var_1720_equation_0 = const()[name = tensor<string, []>("op_1720_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1720_cast_fp16 = einsum(equation = var_1720_equation_0, values = (var_1410_cast_fp16, var_1676_cast_fp16))[name = tensor<string, []>("op_1720_cast_fp16")];
            tensor<string, []> var_1722_equation_0 = const()[name = tensor<string, []>("op_1722_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1722_cast_fp16 = einsum(equation = var_1722_equation_0, values = (var_1426_cast_fp16, var_1677_cast_fp16))[name = tensor<string, []>("op_1722_cast_fp16")];
            tensor<string, []> var_1724_equation_0 = const()[name = tensor<string, []>("op_1724_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1724_cast_fp16 = einsum(equation = var_1724_equation_0, values = (var_1426_cast_fp16, var_1678_cast_fp16))[name = tensor<string, []>("op_1724_cast_fp16")];
            tensor<string, []> var_1726_equation_0 = const()[name = tensor<string, []>("op_1726_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1726_cast_fp16 = einsum(equation = var_1726_equation_0, values = (var_1426_cast_fp16, var_1679_cast_fp16))[name = tensor<string, []>("op_1726_cast_fp16")];
            tensor<string, []> var_1728_equation_0 = const()[name = tensor<string, []>("op_1728_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1728_cast_fp16 = einsum(equation = var_1728_equation_0, values = (var_1426_cast_fp16, var_1680_cast_fp16))[name = tensor<string, []>("op_1728_cast_fp16")];
            tensor<string, []> var_1730_equation_0 = const()[name = tensor<string, []>("op_1730_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1730_cast_fp16 = einsum(equation = var_1730_equation_0, values = (var_1442_cast_fp16, var_1681_cast_fp16))[name = tensor<string, []>("op_1730_cast_fp16")];
            tensor<string, []> var_1732_equation_0 = const()[name = tensor<string, []>("op_1732_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1732_cast_fp16 = einsum(equation = var_1732_equation_0, values = (var_1442_cast_fp16, var_1682_cast_fp16))[name = tensor<string, []>("op_1732_cast_fp16")];
            tensor<string, []> var_1734_equation_0 = const()[name = tensor<string, []>("op_1734_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1734_cast_fp16 = einsum(equation = var_1734_equation_0, values = (var_1442_cast_fp16, var_1683_cast_fp16))[name = tensor<string, []>("op_1734_cast_fp16")];
            tensor<string, []> var_1736_equation_0 = const()[name = tensor<string, []>("op_1736_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1736_cast_fp16 = einsum(equation = var_1736_equation_0, values = (var_1442_cast_fp16, var_1684_cast_fp16))[name = tensor<string, []>("op_1736_cast_fp16")];
            tensor<string, []> var_1738_equation_0 = const()[name = tensor<string, []>("op_1738_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1738_cast_fp16 = einsum(equation = var_1738_equation_0, values = (var_1458_cast_fp16, var_1685_cast_fp16))[name = tensor<string, []>("op_1738_cast_fp16")];
            tensor<string, []> var_1740_equation_0 = const()[name = tensor<string, []>("op_1740_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1740_cast_fp16 = einsum(equation = var_1740_equation_0, values = (var_1458_cast_fp16, var_1686_cast_fp16))[name = tensor<string, []>("op_1740_cast_fp16")];
            tensor<string, []> var_1742_equation_0 = const()[name = tensor<string, []>("op_1742_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1742_cast_fp16 = einsum(equation = var_1742_equation_0, values = (var_1458_cast_fp16, var_1687_cast_fp16))[name = tensor<string, []>("op_1742_cast_fp16")];
            tensor<string, []> var_1744_equation_0 = const()[name = tensor<string, []>("op_1744_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1744_cast_fp16 = einsum(equation = var_1744_equation_0, values = (var_1458_cast_fp16, var_1688_cast_fp16))[name = tensor<string, []>("op_1744_cast_fp16")];
            tensor<string, []> var_1746_equation_0 = const()[name = tensor<string, []>("op_1746_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1746_cast_fp16 = einsum(equation = var_1746_equation_0, values = (var_1474_cast_fp16, var_1689_cast_fp16))[name = tensor<string, []>("op_1746_cast_fp16")];
            tensor<string, []> var_1748_equation_0 = const()[name = tensor<string, []>("op_1748_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1748_cast_fp16 = einsum(equation = var_1748_equation_0, values = (var_1474_cast_fp16, var_1690_cast_fp16))[name = tensor<string, []>("op_1748_cast_fp16")];
            tensor<string, []> var_1750_equation_0 = const()[name = tensor<string, []>("op_1750_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1750_cast_fp16 = einsum(equation = var_1750_equation_0, values = (var_1474_cast_fp16, var_1691_cast_fp16))[name = tensor<string, []>("op_1750_cast_fp16")];
            tensor<string, []> var_1752_equation_0 = const()[name = tensor<string, []>("op_1752_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1752_cast_fp16 = einsum(equation = var_1752_equation_0, values = (var_1474_cast_fp16, var_1692_cast_fp16))[name = tensor<string, []>("op_1752_cast_fp16")];
            tensor<string, []> var_1754_equation_0 = const()[name = tensor<string, []>("op_1754_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1754_cast_fp16 = einsum(equation = var_1754_equation_0, values = (var_1490_cast_fp16, var_1693_cast_fp16))[name = tensor<string, []>("op_1754_cast_fp16")];
            tensor<string, []> var_1756_equation_0 = const()[name = tensor<string, []>("op_1756_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1756_cast_fp16 = einsum(equation = var_1756_equation_0, values = (var_1490_cast_fp16, var_1694_cast_fp16))[name = tensor<string, []>("op_1756_cast_fp16")];
            tensor<string, []> var_1758_equation_0 = const()[name = tensor<string, []>("op_1758_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1758_cast_fp16 = einsum(equation = var_1758_equation_0, values = (var_1490_cast_fp16, var_1695_cast_fp16))[name = tensor<string, []>("op_1758_cast_fp16")];
            tensor<string, []> var_1760_equation_0 = const()[name = tensor<string, []>("op_1760_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_1760_cast_fp16 = einsum(equation = var_1760_equation_0, values = (var_1490_cast_fp16, var_1696_cast_fp16))[name = tensor<string, []>("op_1760_cast_fp16")];
            tensor<bool, []> x_35_interleave_0 = const()[name = tensor<string, []>("x_35_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 2048, 1, 64]> x_35_cast_fp16 = concat(axis = var_973, interleave = x_35_interleave_0, values = (var_1698_cast_fp16, var_1700_cast_fp16, var_1702_cast_fp16, var_1704_cast_fp16, var_1706_cast_fp16, var_1708_cast_fp16, var_1710_cast_fp16, var_1712_cast_fp16, var_1714_cast_fp16, var_1716_cast_fp16, var_1718_cast_fp16, var_1720_cast_fp16, var_1722_cast_fp16, var_1724_cast_fp16, var_1726_cast_fp16, var_1728_cast_fp16, var_1730_cast_fp16, var_1732_cast_fp16, var_1734_cast_fp16, var_1736_cast_fp16, var_1738_cast_fp16, var_1740_cast_fp16, var_1742_cast_fp16, var_1744_cast_fp16, var_1746_cast_fp16, var_1748_cast_fp16, var_1750_cast_fp16, var_1752_cast_fp16, var_1754_cast_fp16, var_1756_cast_fp16, var_1758_cast_fp16, var_1760_cast_fp16))[name = tensor<string, []>("x_35_cast_fp16")];
            tensor<int32, [4]> var_1765 = const()[name = tensor<string, []>("op_1765"), val = tensor<int32, [4]>([1, 2048, -1, 8])];
            tensor<fp16, [1, 2048, 8, 8]> input_13_cast_fp16 = reshape(shape = var_1765, x = x_35_cast_fp16)[name = tensor<string, []>("input_13_cast_fp16")];
            tensor<int32, [2]> var_1768 = const()[name = tensor<string, []>("op_1768"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1770 = const()[name = tensor<string, []>("op_1770"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> attention_output_3_pad_type_0 = const()[name = tensor<string, []>("attention_output_3_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> attention_output_3_pad_0 = const()[name = tensor<string, []>("attention_output_3_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_1_attn_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_attn_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(134231488)))];
            tensor<fp16, [1, 2048, 8, 8]> attention_output_3_cast_fp16 = conv(dilations = var_1770, groups = var_973, pad = attention_output_3_pad_0, pad_type = attention_output_3_pad_type_0, strides = var_1768, weight = blocks_1_attn_proj_weight_to_fp16, x = input_13_cast_fp16)[name = tensor<string, []>("attention_output_3_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_37_cast_fp16 = add(x = attention_output_3_cast_fp16, y = x_21_cast_fp16)[name = tensor<string, []>("x_37_cast_fp16")];
            tensor<bool, []> x_eps_7_interleave_0 = const()[name = tensor<string, []>("x_eps_7_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_7_to_fp16 = const()[name = tensor<string, []>("eps_chan_7_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(142620160)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_7_cast_fp16 = concat(axis = var_973, interleave = x_eps_7_interleave_0, values = (x_37_cast_fp16, eps_chan_7_to_fp16))[name = tensor<string, []>("x_eps_7_cast_fp16")];
            tensor<int32, [1]> norm_x_7_axes_0 = const()[name = tensor<string, []>("norm_x_7_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_7_cast_fp16 = reduce_l2_norm(axes = norm_x_7_axes_0, keep_dims = var_976, x = x_eps_7_cast_fp16)[name = tensor<string, []>("norm_x_7_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_19_cast_fp16 = real_div(x = x_37_cast_fp16, y = norm_x_7_cast_fp16)[name = tensor<string, []>("x_normed_19_cast_fp16")];
            tensor<fp16, []> var_1796_to_fp16 = const()[name = tensor<string, []>("op_1796_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_21_cast_fp16 = mul(x = x_normed_19_cast_fp16, y = var_1796_to_fp16)[name = tensor<string, []>("x_normed_21_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_1_norm_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_norm_2_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(142620352)))];
            tensor<fp16, [1, 2048, 8, 8]> input_15_cast_fp16 = mul(x = x_normed_21_cast_fp16, y = blocks_1_norm_2_weight_to_fp16)[name = tensor<string, []>("input_15_cast_fp16")];
            tensor<int32, [2]> var_1807 = const()[name = tensor<string, []>("op_1807"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1809 = const()[name = tensor<string, []>("op_1809"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> input_17_pad_type_0 = const()[name = tensor<string, []>("input_17_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> input_17_pad_0 = const()[name = tensor<string, []>("input_17_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_1_mlp_fc_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_mlp_fc_1_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(142624512)))];
            tensor<fp16, [1, 8192, 8, 8]> input_17_cast_fp16 = conv(dilations = var_1809, groups = var_973, pad = input_17_pad_0, pad_type = input_17_pad_type_0, strides = var_1807, weight = blocks_1_mlp_fc_1_weight_to_fp16, x = input_15_cast_fp16)[name = tensor<string, []>("input_17_cast_fp16")];
            tensor<int32, [2]> var_1813 = const()[name = tensor<string, []>("op_1813"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1815 = const()[name = tensor<string, []>("op_1815"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> x_fc_2_3_pad_type_0 = const()[name = tensor<string, []>("x_fc_2_3_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> x_fc_2_3_pad_0 = const()[name = tensor<string, []>("x_fc_2_3_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_1_mlp_fc_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_mlp_fc_2_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(176179008)))];
            tensor<fp16, [1, 8192, 8, 8]> x_fc_2_3_cast_fp16 = conv(dilations = var_1815, groups = var_973, pad = x_fc_2_3_pad_0, pad_type = x_fc_2_3_pad_type_0, strides = var_1813, weight = blocks_1_mlp_fc_2_weight_to_fp16, x = input_15_cast_fp16)[name = tensor<string, []>("x_fc_2_3_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> var_1818_cast_fp16 = silu(x = input_17_cast_fp16)[name = tensor<string, []>("op_1818_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> input_19_cast_fp16 = mul(x = var_1818_cast_fp16, y = x_fc_2_3_cast_fp16)[name = tensor<string, []>("input_19_cast_fp16")];
            tensor<int32, [2]> var_1821 = const()[name = tensor<string, []>("op_1821"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1823 = const()[name = tensor<string, []>("op_1823"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> var_1825_pad_type_0 = const()[name = tensor<string, []>("op_1825_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> var_1825_pad_0 = const()[name = tensor<string, []>("op_1825_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 8192, 1, 1]> blocks_1_mlp_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_1_mlp_proj_weight_to_fp16"), val = tensor<fp16, [2048, 8192, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(209733504)))];
            tensor<fp16, [1, 2048, 8, 8]> var_1825_cast_fp16 = conv(dilations = var_1823, groups = var_973, pad = var_1825_pad_0, pad_type = var_1825_pad_type_0, strides = var_1821, weight = blocks_1_mlp_proj_weight_to_fp16, x = input_19_cast_fp16)[name = tensor<string, []>("op_1825_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_41_cast_fp16 = add(x = var_1825_cast_fp16, y = x_37_cast_fp16)[name = tensor<string, []>("x_41_cast_fp16")];
            tensor<int32, []> var_1831 = const()[name = tensor<string, []>("op_1831"), val = tensor<int32, []>(-1)];
            tensor<int32, []> var_1835 = const()[name = tensor<string, []>("op_1835"), val = tensor<int32, []>(-2)];
            tensor<int32, []> var_1837 = const()[name = tensor<string, []>("op_1837"), val = tensor<int32, []>(-3)];
            tensor<int32, []> var_1879 = const()[name = tensor<string, []>("op_1879"), val = tensor<int32, []>(1)];
            tensor<bool, []> var_1882 = const()[name = tensor<string, []>("op_1882"), val = tensor<bool, []>(true)];
            tensor<bool, []> x_eps_9_interleave_0 = const()[name = tensor<string, []>("x_eps_9_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_9_to_fp16 = const()[name = tensor<string, []>("eps_chan_9_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(243288000)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_9_cast_fp16 = concat(axis = var_1879, interleave = x_eps_9_interleave_0, values = (x_41_cast_fp16, eps_chan_9_to_fp16))[name = tensor<string, []>("x_eps_9_cast_fp16")];
            tensor<int32, [1]> norm_x_9_axes_0 = const()[name = tensor<string, []>("norm_x_9_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_9_cast_fp16 = reduce_l2_norm(axes = norm_x_9_axes_0, keep_dims = var_1882, x = x_eps_9_cast_fp16)[name = tensor<string, []>("norm_x_9_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_25_cast_fp16 = real_div(x = x_41_cast_fp16, y = norm_x_9_cast_fp16)[name = tensor<string, []>("x_normed_25_cast_fp16")];
            tensor<fp16, []> var_1905_to_fp16 = const()[name = tensor<string, []>("op_1905_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_27_cast_fp16 = mul(x = x_normed_25_cast_fp16, y = var_1905_to_fp16)[name = tensor<string, []>("x_normed_27_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_2_norm_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_norm_1_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(243288192)))];
            tensor<fp16, [1, 2048, 8, 8]> x_45_cast_fp16 = mul(x = x_normed_27_cast_fp16, y = blocks_2_norm_1_weight_to_fp16)[name = tensor<string, []>("x_45_cast_fp16")];
            tensor<int32, [4]> var_1929 = const()[name = tensor<string, []>("op_1929"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> input_21_cast_fp16 = reshape(shape = var_1929, x = x_45_cast_fp16)[name = tensor<string, []>("input_21_cast_fp16")];
            tensor<int32, [2]> var_1932 = const()[name = tensor<string, []>("op_1932"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1934 = const()[name = tensor<string, []>("op_1934"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> q_17_pad_type_0 = const()[name = tensor<string, []>("q_17_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> q_17_pad_0 = const()[name = tensor<string, []>("q_17_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_2_attn_q_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_attn_q_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(243292352)))];
            tensor<fp16, [1, 2048, 1, 64]> q_17_cast_fp16 = conv(dilations = var_1934, groups = var_1879, pad = q_17_pad_0, pad_type = q_17_pad_type_0, strides = var_1932, weight = blocks_2_attn_q_proj_weight_to_fp16, x = input_21_cast_fp16)[name = tensor<string, []>("q_17_cast_fp16")];
            tensor<int32, [2]> var_1938 = const()[name = tensor<string, []>("op_1938"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1940 = const()[name = tensor<string, []>("op_1940"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> k_25_pad_type_0 = const()[name = tensor<string, []>("k_25_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> k_25_pad_0 = const()[name = tensor<string, []>("k_25_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_2_attn_k_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_attn_k_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(251681024)))];
            tensor<fp16, [1, 512, 1, 64]> k_25_cast_fp16 = conv(dilations = var_1940, groups = var_1879, pad = k_25_pad_0, pad_type = k_25_pad_type_0, strides = var_1938, weight = blocks_2_attn_k_proj_weight_to_fp16, x = input_21_cast_fp16)[name = tensor<string, []>("k_25_cast_fp16")];
            tensor<int32, [2]> var_1944 = const()[name = tensor<string, []>("op_1944"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_1946 = const()[name = tensor<string, []>("op_1946"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> v_21_pad_type_0 = const()[name = tensor<string, []>("v_21_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> v_21_pad_0 = const()[name = tensor<string, []>("v_21_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_2_attn_v_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_attn_v_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(253778240)))];
            tensor<fp16, [1, 512, 1, 64]> v_21_cast_fp16 = conv(dilations = var_1946, groups = var_1879, pad = v_21_pad_0, pad_type = v_21_pad_type_0, strides = var_1944, weight = blocks_2_attn_v_proj_weight_to_fp16, x = input_21_cast_fp16)[name = tensor<string, []>("v_21_cast_fp16")];
            tensor<int32, [4]> var_1949 = const()[name = tensor<string, []>("op_1949"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<fp16, [1, 32, 64, 64]> q_19_cast_fp16 = reshape(shape = var_1949, x = q_17_cast_fp16)[name = tensor<string, []>("q_19_cast_fp16")];
            tensor<int32, [4]> var_1951 = const()[name = tensor<string, []>("op_1951"), val = tensor<int32, [4]>([1, -1, 64, 64])];
            tensor<fp16, [1, 8, 64, 64]> k_27_cast_fp16 = reshape(shape = var_1951, x = k_25_cast_fp16)[name = tensor<string, []>("k_27_cast_fp16")];
            tensor<int32, [4]> var_1965_begin_0 = const()[name = tensor<string, []>("op_1965_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1965_end_0 = const()[name = tensor<string, []>("op_1965_end_0"), val = tensor<int32, [4]>([1, 32, 32, 64])];
            tensor<bool, [4]> var_1965_end_mask_0 = const()[name = tensor<string, []>("op_1965_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 32, 32, 64]> var_1965_cast_fp16 = slice_by_index(begin = var_1965_begin_0, end = var_1965_end_0, end_mask = var_1965_end_mask_0, x = q_19_cast_fp16)[name = tensor<string, []>("op_1965_cast_fp16")];
            tensor<int32, [4]> var_1971_begin_0 = const()[name = tensor<string, []>("op_1971_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_1971_end_0 = const()[name = tensor<string, []>("op_1971_end_0"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<bool, [4]> var_1971_end_mask_0 = const()[name = tensor<string, []>("op_1971_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 32, 32, 64]> var_1971_cast_fp16 = slice_by_index(begin = var_1971_begin_0, end = var_1971_end_0, end_mask = var_1971_end_mask_0, x = q_19_cast_fp16)[name = tensor<string, []>("op_1971_cast_fp16")];
            tensor<fp16, []> const_50_promoted_to_fp16 = const()[name = tensor<string, []>("const_50_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 32, 32, 64]> var_1973_cast_fp16 = mul(x = var_1971_cast_fp16, y = const_50_promoted_to_fp16)[name = tensor<string, []>("op_1973_cast_fp16")];
            tensor<bool, []> rotated_9_interleave_0 = const()[name = tensor<string, []>("rotated_9_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 32, 64, 64]> rotated_9_cast_fp16 = concat(axis = var_1835, interleave = rotated_9_interleave_0, values = (var_1973_cast_fp16, var_1965_cast_fp16))[name = tensor<string, []>("rotated_9_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_1976_cast_fp16 = mul(x = q_19_cast_fp16, y = cos)[name = tensor<string, []>("op_1976_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_1977_cast_fp16 = mul(x = rotated_9_cast_fp16, y = sin)[name = tensor<string, []>("op_1977_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> roped_9_cast_fp16 = add(x = var_1976_cast_fp16, y = var_1977_cast_fp16)[name = tensor<string, []>("roped_9_cast_fp16")];
            tensor<int32, [4]> var_1990_begin_0 = const()[name = tensor<string, []>("op_1990_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_1990_end_0 = const()[name = tensor<string, []>("op_1990_end_0"), val = tensor<int32, [4]>([1, 8, 32, 64])];
            tensor<bool, [4]> var_1990_end_mask_0 = const()[name = tensor<string, []>("op_1990_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 8, 32, 64]> var_1990_cast_fp16 = slice_by_index(begin = var_1990_begin_0, end = var_1990_end_0, end_mask = var_1990_end_mask_0, x = k_27_cast_fp16)[name = tensor<string, []>("op_1990_cast_fp16")];
            tensor<int32, [4]> var_1996_begin_0 = const()[name = tensor<string, []>("op_1996_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_1996_end_0 = const()[name = tensor<string, []>("op_1996_end_0"), val = tensor<int32, [4]>([1, 8, 64, 64])];
            tensor<bool, [4]> var_1996_end_mask_0 = const()[name = tensor<string, []>("op_1996_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 8, 32, 64]> var_1996_cast_fp16 = slice_by_index(begin = var_1996_begin_0, end = var_1996_end_0, end_mask = var_1996_end_mask_0, x = k_27_cast_fp16)[name = tensor<string, []>("op_1996_cast_fp16")];
            tensor<fp16, []> const_52_promoted_to_fp16 = const()[name = tensor<string, []>("const_52_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 8, 32, 64]> var_1998_cast_fp16 = mul(x = var_1996_cast_fp16, y = const_52_promoted_to_fp16)[name = tensor<string, []>("op_1998_cast_fp16")];
            tensor<bool, []> rotated_11_interleave_0 = const()[name = tensor<string, []>("rotated_11_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 8, 64, 64]> rotated_11_cast_fp16 = concat(axis = var_1835, interleave = rotated_11_interleave_0, values = (var_1998_cast_fp16, var_1990_cast_fp16))[name = tensor<string, []>("rotated_11_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_2001_cast_fp16 = mul(x = k_27_cast_fp16, y = cos)[name = tensor<string, []>("op_2001_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_2002_cast_fp16 = mul(x = rotated_11_cast_fp16, y = sin)[name = tensor<string, []>("op_2002_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> roped_11_cast_fp16 = add(x = var_2001_cast_fp16, y = var_2002_cast_fp16)[name = tensor<string, []>("roped_11_cast_fp16")];
            tensor<int32, [4]> var_2005 = const()[name = tensor<string, []>("op_2005"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> k_31_cast_fp16 = reshape(shape = var_2005, x = roped_11_cast_fp16)[name = tensor<string, []>("k_31_cast_fp16")];
            tensor<int32, [4]> var_2007 = const()[name = tensor<string, []>("op_2007"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> new_v_cache_2 = reshape(shape = var_2007, x = v_21_cast_fp16)[name = tensor<string, []>("new_v_cache_2_type_fp32_cast_fp16")];
            tensor<int32, [4]> k_33_perm_0 = const()[name = tensor<string, []>("k_33_perm_0"), val = tensor<int32, [4]>([0, -1, 2, -3])];
            tensor<bool, []> k_35_interleave_0 = const()[name = tensor<string, []>("k_35_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 64, 1, 512]> new_k_cache_2 = transpose(perm = k_33_perm_0, x = k_31_cast_fp16)[name = tensor<string, []>("transpose_1")];
            tensor<fp16, [1, 512, 1, 512]> k_35_cast_fp16 = concat(axis = var_1837, interleave = k_35_interleave_0, values = (k_cache_2, new_k_cache_2))[name = tensor<string, []>("k_35_cast_fp16")];
            tensor<bool, []> v_27_interleave_0 = const()[name = tensor<string, []>("v_27_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 512, 1, 512]> v_27_cast_fp16 = concat(axis = var_1831, interleave = v_27_interleave_0, values = (v_cache_2, new_v_cache_2))[name = tensor<string, []>("v_27_cast_fp16")];
            tensor<int32, [4]> var_2023 = const()[name = tensor<string, []>("op_2023"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> q_23_cast_fp16 = reshape(shape = var_2023, x = roped_9_cast_fp16)[name = tensor<string, []>("q_23_cast_fp16")];
            tensor<int32, [4]> var_2028_begin_0 = const()[name = tensor<string, []>("op_2028_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2028_end_0 = const()[name = tensor<string, []>("op_2028_end_0"), val = tensor<int32, [4]>([1, 64, 1, 64])];
            tensor<bool, [4]> var_2028_end_mask_0 = const()[name = tensor<string, []>("op_2028_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2028_cast_fp16 = slice_by_index(begin = var_2028_begin_0, end = var_2028_end_0, end_mask = var_2028_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2028_cast_fp16")];
            tensor<int32, [4]> var_2032_begin_0 = const()[name = tensor<string, []>("op_2032_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_2032_end_0 = const()[name = tensor<string, []>("op_2032_end_0"), val = tensor<int32, [4]>([1, 128, 1, 64])];
            tensor<bool, [4]> var_2032_end_mask_0 = const()[name = tensor<string, []>("op_2032_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2032_cast_fp16 = slice_by_index(begin = var_2032_begin_0, end = var_2032_end_0, end_mask = var_2032_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2032_cast_fp16")];
            tensor<int32, [4]> var_2036_begin_0 = const()[name = tensor<string, []>("op_2036_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_2036_end_0 = const()[name = tensor<string, []>("op_2036_end_0"), val = tensor<int32, [4]>([1, 192, 1, 64])];
            tensor<bool, [4]> var_2036_end_mask_0 = const()[name = tensor<string, []>("op_2036_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2036_cast_fp16 = slice_by_index(begin = var_2036_begin_0, end = var_2036_end_0, end_mask = var_2036_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2036_cast_fp16")];
            tensor<int32, [4]> var_2040_begin_0 = const()[name = tensor<string, []>("op_2040_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_2040_end_0 = const()[name = tensor<string, []>("op_2040_end_0"), val = tensor<int32, [4]>([1, 256, 1, 64])];
            tensor<bool, [4]> var_2040_end_mask_0 = const()[name = tensor<string, []>("op_2040_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2040_cast_fp16 = slice_by_index(begin = var_2040_begin_0, end = var_2040_end_0, end_mask = var_2040_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2040_cast_fp16")];
            tensor<int32, [4]> var_2044_begin_0 = const()[name = tensor<string, []>("op_2044_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_2044_end_0 = const()[name = tensor<string, []>("op_2044_end_0"), val = tensor<int32, [4]>([1, 320, 1, 64])];
            tensor<bool, [4]> var_2044_end_mask_0 = const()[name = tensor<string, []>("op_2044_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2044_cast_fp16 = slice_by_index(begin = var_2044_begin_0, end = var_2044_end_0, end_mask = var_2044_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2044_cast_fp16")];
            tensor<int32, [4]> var_2048_begin_0 = const()[name = tensor<string, []>("op_2048_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_2048_end_0 = const()[name = tensor<string, []>("op_2048_end_0"), val = tensor<int32, [4]>([1, 384, 1, 64])];
            tensor<bool, [4]> var_2048_end_mask_0 = const()[name = tensor<string, []>("op_2048_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2048_cast_fp16 = slice_by_index(begin = var_2048_begin_0, end = var_2048_end_0, end_mask = var_2048_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2048_cast_fp16")];
            tensor<int32, [4]> var_2052_begin_0 = const()[name = tensor<string, []>("op_2052_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_2052_end_0 = const()[name = tensor<string, []>("op_2052_end_0"), val = tensor<int32, [4]>([1, 448, 1, 64])];
            tensor<bool, [4]> var_2052_end_mask_0 = const()[name = tensor<string, []>("op_2052_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2052_cast_fp16 = slice_by_index(begin = var_2052_begin_0, end = var_2052_end_0, end_mask = var_2052_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2052_cast_fp16")];
            tensor<int32, [4]> var_2056_begin_0 = const()[name = tensor<string, []>("op_2056_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_2056_end_0 = const()[name = tensor<string, []>("op_2056_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_2056_end_mask_0 = const()[name = tensor<string, []>("op_2056_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2056_cast_fp16 = slice_by_index(begin = var_2056_begin_0, end = var_2056_end_0, end_mask = var_2056_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2056_cast_fp16")];
            tensor<int32, [4]> var_2060_begin_0 = const()[name = tensor<string, []>("op_2060_begin_0"), val = tensor<int32, [4]>([0, 512, 0, 0])];
            tensor<int32, [4]> var_2060_end_0 = const()[name = tensor<string, []>("op_2060_end_0"), val = tensor<int32, [4]>([1, 576, 1, 64])];
            tensor<bool, [4]> var_2060_end_mask_0 = const()[name = tensor<string, []>("op_2060_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2060_cast_fp16 = slice_by_index(begin = var_2060_begin_0, end = var_2060_end_0, end_mask = var_2060_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2060_cast_fp16")];
            tensor<int32, [4]> var_2064_begin_0 = const()[name = tensor<string, []>("op_2064_begin_0"), val = tensor<int32, [4]>([0, 576, 0, 0])];
            tensor<int32, [4]> var_2064_end_0 = const()[name = tensor<string, []>("op_2064_end_0"), val = tensor<int32, [4]>([1, 640, 1, 64])];
            tensor<bool, [4]> var_2064_end_mask_0 = const()[name = tensor<string, []>("op_2064_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2064_cast_fp16 = slice_by_index(begin = var_2064_begin_0, end = var_2064_end_0, end_mask = var_2064_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2064_cast_fp16")];
            tensor<int32, [4]> var_2068_begin_0 = const()[name = tensor<string, []>("op_2068_begin_0"), val = tensor<int32, [4]>([0, 640, 0, 0])];
            tensor<int32, [4]> var_2068_end_0 = const()[name = tensor<string, []>("op_2068_end_0"), val = tensor<int32, [4]>([1, 704, 1, 64])];
            tensor<bool, [4]> var_2068_end_mask_0 = const()[name = tensor<string, []>("op_2068_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2068_cast_fp16 = slice_by_index(begin = var_2068_begin_0, end = var_2068_end_0, end_mask = var_2068_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2068_cast_fp16")];
            tensor<int32, [4]> var_2072_begin_0 = const()[name = tensor<string, []>("op_2072_begin_0"), val = tensor<int32, [4]>([0, 704, 0, 0])];
            tensor<int32, [4]> var_2072_end_0 = const()[name = tensor<string, []>("op_2072_end_0"), val = tensor<int32, [4]>([1, 768, 1, 64])];
            tensor<bool, [4]> var_2072_end_mask_0 = const()[name = tensor<string, []>("op_2072_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2072_cast_fp16 = slice_by_index(begin = var_2072_begin_0, end = var_2072_end_0, end_mask = var_2072_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2072_cast_fp16")];
            tensor<int32, [4]> var_2076_begin_0 = const()[name = tensor<string, []>("op_2076_begin_0"), val = tensor<int32, [4]>([0, 768, 0, 0])];
            tensor<int32, [4]> var_2076_end_0 = const()[name = tensor<string, []>("op_2076_end_0"), val = tensor<int32, [4]>([1, 832, 1, 64])];
            tensor<bool, [4]> var_2076_end_mask_0 = const()[name = tensor<string, []>("op_2076_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2076_cast_fp16 = slice_by_index(begin = var_2076_begin_0, end = var_2076_end_0, end_mask = var_2076_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2076_cast_fp16")];
            tensor<int32, [4]> var_2080_begin_0 = const()[name = tensor<string, []>("op_2080_begin_0"), val = tensor<int32, [4]>([0, 832, 0, 0])];
            tensor<int32, [4]> var_2080_end_0 = const()[name = tensor<string, []>("op_2080_end_0"), val = tensor<int32, [4]>([1, 896, 1, 64])];
            tensor<bool, [4]> var_2080_end_mask_0 = const()[name = tensor<string, []>("op_2080_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2080_cast_fp16 = slice_by_index(begin = var_2080_begin_0, end = var_2080_end_0, end_mask = var_2080_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2080_cast_fp16")];
            tensor<int32, [4]> var_2084_begin_0 = const()[name = tensor<string, []>("op_2084_begin_0"), val = tensor<int32, [4]>([0, 896, 0, 0])];
            tensor<int32, [4]> var_2084_end_0 = const()[name = tensor<string, []>("op_2084_end_0"), val = tensor<int32, [4]>([1, 960, 1, 64])];
            tensor<bool, [4]> var_2084_end_mask_0 = const()[name = tensor<string, []>("op_2084_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2084_cast_fp16 = slice_by_index(begin = var_2084_begin_0, end = var_2084_end_0, end_mask = var_2084_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2084_cast_fp16")];
            tensor<int32, [4]> var_2088_begin_0 = const()[name = tensor<string, []>("op_2088_begin_0"), val = tensor<int32, [4]>([0, 960, 0, 0])];
            tensor<int32, [4]> var_2088_end_0 = const()[name = tensor<string, []>("op_2088_end_0"), val = tensor<int32, [4]>([1, 1024, 1, 64])];
            tensor<bool, [4]> var_2088_end_mask_0 = const()[name = tensor<string, []>("op_2088_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2088_cast_fp16 = slice_by_index(begin = var_2088_begin_0, end = var_2088_end_0, end_mask = var_2088_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2088_cast_fp16")];
            tensor<int32, [4]> var_2092_begin_0 = const()[name = tensor<string, []>("op_2092_begin_0"), val = tensor<int32, [4]>([0, 1024, 0, 0])];
            tensor<int32, [4]> var_2092_end_0 = const()[name = tensor<string, []>("op_2092_end_0"), val = tensor<int32, [4]>([1, 1088, 1, 64])];
            tensor<bool, [4]> var_2092_end_mask_0 = const()[name = tensor<string, []>("op_2092_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2092_cast_fp16 = slice_by_index(begin = var_2092_begin_0, end = var_2092_end_0, end_mask = var_2092_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2092_cast_fp16")];
            tensor<int32, [4]> var_2096_begin_0 = const()[name = tensor<string, []>("op_2096_begin_0"), val = tensor<int32, [4]>([0, 1088, 0, 0])];
            tensor<int32, [4]> var_2096_end_0 = const()[name = tensor<string, []>("op_2096_end_0"), val = tensor<int32, [4]>([1, 1152, 1, 64])];
            tensor<bool, [4]> var_2096_end_mask_0 = const()[name = tensor<string, []>("op_2096_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2096_cast_fp16 = slice_by_index(begin = var_2096_begin_0, end = var_2096_end_0, end_mask = var_2096_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2096_cast_fp16")];
            tensor<int32, [4]> var_2100_begin_0 = const()[name = tensor<string, []>("op_2100_begin_0"), val = tensor<int32, [4]>([0, 1152, 0, 0])];
            tensor<int32, [4]> var_2100_end_0 = const()[name = tensor<string, []>("op_2100_end_0"), val = tensor<int32, [4]>([1, 1216, 1, 64])];
            tensor<bool, [4]> var_2100_end_mask_0 = const()[name = tensor<string, []>("op_2100_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2100_cast_fp16 = slice_by_index(begin = var_2100_begin_0, end = var_2100_end_0, end_mask = var_2100_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2100_cast_fp16")];
            tensor<int32, [4]> var_2104_begin_0 = const()[name = tensor<string, []>("op_2104_begin_0"), val = tensor<int32, [4]>([0, 1216, 0, 0])];
            tensor<int32, [4]> var_2104_end_0 = const()[name = tensor<string, []>("op_2104_end_0"), val = tensor<int32, [4]>([1, 1280, 1, 64])];
            tensor<bool, [4]> var_2104_end_mask_0 = const()[name = tensor<string, []>("op_2104_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2104_cast_fp16 = slice_by_index(begin = var_2104_begin_0, end = var_2104_end_0, end_mask = var_2104_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2104_cast_fp16")];
            tensor<int32, [4]> var_2108_begin_0 = const()[name = tensor<string, []>("op_2108_begin_0"), val = tensor<int32, [4]>([0, 1280, 0, 0])];
            tensor<int32, [4]> var_2108_end_0 = const()[name = tensor<string, []>("op_2108_end_0"), val = tensor<int32, [4]>([1, 1344, 1, 64])];
            tensor<bool, [4]> var_2108_end_mask_0 = const()[name = tensor<string, []>("op_2108_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2108_cast_fp16 = slice_by_index(begin = var_2108_begin_0, end = var_2108_end_0, end_mask = var_2108_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2108_cast_fp16")];
            tensor<int32, [4]> var_2112_begin_0 = const()[name = tensor<string, []>("op_2112_begin_0"), val = tensor<int32, [4]>([0, 1344, 0, 0])];
            tensor<int32, [4]> var_2112_end_0 = const()[name = tensor<string, []>("op_2112_end_0"), val = tensor<int32, [4]>([1, 1408, 1, 64])];
            tensor<bool, [4]> var_2112_end_mask_0 = const()[name = tensor<string, []>("op_2112_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2112_cast_fp16 = slice_by_index(begin = var_2112_begin_0, end = var_2112_end_0, end_mask = var_2112_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2112_cast_fp16")];
            tensor<int32, [4]> var_2116_begin_0 = const()[name = tensor<string, []>("op_2116_begin_0"), val = tensor<int32, [4]>([0, 1408, 0, 0])];
            tensor<int32, [4]> var_2116_end_0 = const()[name = tensor<string, []>("op_2116_end_0"), val = tensor<int32, [4]>([1, 1472, 1, 64])];
            tensor<bool, [4]> var_2116_end_mask_0 = const()[name = tensor<string, []>("op_2116_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2116_cast_fp16 = slice_by_index(begin = var_2116_begin_0, end = var_2116_end_0, end_mask = var_2116_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2116_cast_fp16")];
            tensor<int32, [4]> var_2120_begin_0 = const()[name = tensor<string, []>("op_2120_begin_0"), val = tensor<int32, [4]>([0, 1472, 0, 0])];
            tensor<int32, [4]> var_2120_end_0 = const()[name = tensor<string, []>("op_2120_end_0"), val = tensor<int32, [4]>([1, 1536, 1, 64])];
            tensor<bool, [4]> var_2120_end_mask_0 = const()[name = tensor<string, []>("op_2120_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2120_cast_fp16 = slice_by_index(begin = var_2120_begin_0, end = var_2120_end_0, end_mask = var_2120_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2120_cast_fp16")];
            tensor<int32, [4]> var_2124_begin_0 = const()[name = tensor<string, []>("op_2124_begin_0"), val = tensor<int32, [4]>([0, 1536, 0, 0])];
            tensor<int32, [4]> var_2124_end_0 = const()[name = tensor<string, []>("op_2124_end_0"), val = tensor<int32, [4]>([1, 1600, 1, 64])];
            tensor<bool, [4]> var_2124_end_mask_0 = const()[name = tensor<string, []>("op_2124_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2124_cast_fp16 = slice_by_index(begin = var_2124_begin_0, end = var_2124_end_0, end_mask = var_2124_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2124_cast_fp16")];
            tensor<int32, [4]> var_2128_begin_0 = const()[name = tensor<string, []>("op_2128_begin_0"), val = tensor<int32, [4]>([0, 1600, 0, 0])];
            tensor<int32, [4]> var_2128_end_0 = const()[name = tensor<string, []>("op_2128_end_0"), val = tensor<int32, [4]>([1, 1664, 1, 64])];
            tensor<bool, [4]> var_2128_end_mask_0 = const()[name = tensor<string, []>("op_2128_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2128_cast_fp16 = slice_by_index(begin = var_2128_begin_0, end = var_2128_end_0, end_mask = var_2128_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2128_cast_fp16")];
            tensor<int32, [4]> var_2132_begin_0 = const()[name = tensor<string, []>("op_2132_begin_0"), val = tensor<int32, [4]>([0, 1664, 0, 0])];
            tensor<int32, [4]> var_2132_end_0 = const()[name = tensor<string, []>("op_2132_end_0"), val = tensor<int32, [4]>([1, 1728, 1, 64])];
            tensor<bool, [4]> var_2132_end_mask_0 = const()[name = tensor<string, []>("op_2132_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2132_cast_fp16 = slice_by_index(begin = var_2132_begin_0, end = var_2132_end_0, end_mask = var_2132_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2132_cast_fp16")];
            tensor<int32, [4]> var_2136_begin_0 = const()[name = tensor<string, []>("op_2136_begin_0"), val = tensor<int32, [4]>([0, 1728, 0, 0])];
            tensor<int32, [4]> var_2136_end_0 = const()[name = tensor<string, []>("op_2136_end_0"), val = tensor<int32, [4]>([1, 1792, 1, 64])];
            tensor<bool, [4]> var_2136_end_mask_0 = const()[name = tensor<string, []>("op_2136_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2136_cast_fp16 = slice_by_index(begin = var_2136_begin_0, end = var_2136_end_0, end_mask = var_2136_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2136_cast_fp16")];
            tensor<int32, [4]> var_2140_begin_0 = const()[name = tensor<string, []>("op_2140_begin_0"), val = tensor<int32, [4]>([0, 1792, 0, 0])];
            tensor<int32, [4]> var_2140_end_0 = const()[name = tensor<string, []>("op_2140_end_0"), val = tensor<int32, [4]>([1, 1856, 1, 64])];
            tensor<bool, [4]> var_2140_end_mask_0 = const()[name = tensor<string, []>("op_2140_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2140_cast_fp16 = slice_by_index(begin = var_2140_begin_0, end = var_2140_end_0, end_mask = var_2140_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2140_cast_fp16")];
            tensor<int32, [4]> var_2144_begin_0 = const()[name = tensor<string, []>("op_2144_begin_0"), val = tensor<int32, [4]>([0, 1856, 0, 0])];
            tensor<int32, [4]> var_2144_end_0 = const()[name = tensor<string, []>("op_2144_end_0"), val = tensor<int32, [4]>([1, 1920, 1, 64])];
            tensor<bool, [4]> var_2144_end_mask_0 = const()[name = tensor<string, []>("op_2144_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2144_cast_fp16 = slice_by_index(begin = var_2144_begin_0, end = var_2144_end_0, end_mask = var_2144_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2144_cast_fp16")];
            tensor<int32, [4]> var_2148_begin_0 = const()[name = tensor<string, []>("op_2148_begin_0"), val = tensor<int32, [4]>([0, 1920, 0, 0])];
            tensor<int32, [4]> var_2148_end_0 = const()[name = tensor<string, []>("op_2148_end_0"), val = tensor<int32, [4]>([1, 1984, 1, 64])];
            tensor<bool, [4]> var_2148_end_mask_0 = const()[name = tensor<string, []>("op_2148_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2148_cast_fp16 = slice_by_index(begin = var_2148_begin_0, end = var_2148_end_0, end_mask = var_2148_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2148_cast_fp16")];
            tensor<int32, [4]> var_2152_begin_0 = const()[name = tensor<string, []>("op_2152_begin_0"), val = tensor<int32, [4]>([0, 1984, 0, 0])];
            tensor<int32, [4]> var_2152_end_0 = const()[name = tensor<string, []>("op_2152_end_0"), val = tensor<int32, [4]>([1, 2048, 1, 64])];
            tensor<bool, [4]> var_2152_end_mask_0 = const()[name = tensor<string, []>("op_2152_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2152_cast_fp16 = slice_by_index(begin = var_2152_begin_0, end = var_2152_end_0, end_mask = var_2152_end_mask_0, x = q_23_cast_fp16)[name = tensor<string, []>("op_2152_cast_fp16")];
            tensor<int32, [4]> var_2158_begin_0 = const()[name = tensor<string, []>("op_2158_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2158_end_0 = const()[name = tensor<string, []>("op_2158_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_2158_end_mask_0 = const()[name = tensor<string, []>("op_2158_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2158_cast_fp16 = slice_by_index(begin = var_2158_begin_0, end = var_2158_end_0, end_mask = var_2158_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2158_cast_fp16")];
            tensor<int32, [4]> var_2174_begin_0 = const()[name = tensor<string, []>("op_2174_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 64])];
            tensor<int32, [4]> var_2174_end_0 = const()[name = tensor<string, []>("op_2174_end_0"), val = tensor<int32, [4]>([1, 512, 1, 128])];
            tensor<bool, [4]> var_2174_end_mask_0 = const()[name = tensor<string, []>("op_2174_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2174_cast_fp16 = slice_by_index(begin = var_2174_begin_0, end = var_2174_end_0, end_mask = var_2174_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2174_cast_fp16")];
            tensor<int32, [4]> var_2190_begin_0 = const()[name = tensor<string, []>("op_2190_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 128])];
            tensor<int32, [4]> var_2190_end_0 = const()[name = tensor<string, []>("op_2190_end_0"), val = tensor<int32, [4]>([1, 512, 1, 192])];
            tensor<bool, [4]> var_2190_end_mask_0 = const()[name = tensor<string, []>("op_2190_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2190_cast_fp16 = slice_by_index(begin = var_2190_begin_0, end = var_2190_end_0, end_mask = var_2190_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2190_cast_fp16")];
            tensor<int32, [4]> var_2206_begin_0 = const()[name = tensor<string, []>("op_2206_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 192])];
            tensor<int32, [4]> var_2206_end_0 = const()[name = tensor<string, []>("op_2206_end_0"), val = tensor<int32, [4]>([1, 512, 1, 256])];
            tensor<bool, [4]> var_2206_end_mask_0 = const()[name = tensor<string, []>("op_2206_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2206_cast_fp16 = slice_by_index(begin = var_2206_begin_0, end = var_2206_end_0, end_mask = var_2206_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2206_cast_fp16")];
            tensor<int32, [4]> var_2222_begin_0 = const()[name = tensor<string, []>("op_2222_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 256])];
            tensor<int32, [4]> var_2222_end_0 = const()[name = tensor<string, []>("op_2222_end_0"), val = tensor<int32, [4]>([1, 512, 1, 320])];
            tensor<bool, [4]> var_2222_end_mask_0 = const()[name = tensor<string, []>("op_2222_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2222_cast_fp16 = slice_by_index(begin = var_2222_begin_0, end = var_2222_end_0, end_mask = var_2222_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2222_cast_fp16")];
            tensor<int32, [4]> var_2238_begin_0 = const()[name = tensor<string, []>("op_2238_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 320])];
            tensor<int32, [4]> var_2238_end_0 = const()[name = tensor<string, []>("op_2238_end_0"), val = tensor<int32, [4]>([1, 512, 1, 384])];
            tensor<bool, [4]> var_2238_end_mask_0 = const()[name = tensor<string, []>("op_2238_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2238_cast_fp16 = slice_by_index(begin = var_2238_begin_0, end = var_2238_end_0, end_mask = var_2238_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2238_cast_fp16")];
            tensor<int32, [4]> var_2254_begin_0 = const()[name = tensor<string, []>("op_2254_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 384])];
            tensor<int32, [4]> var_2254_end_0 = const()[name = tensor<string, []>("op_2254_end_0"), val = tensor<int32, [4]>([1, 512, 1, 448])];
            tensor<bool, [4]> var_2254_end_mask_0 = const()[name = tensor<string, []>("op_2254_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2254_cast_fp16 = slice_by_index(begin = var_2254_begin_0, end = var_2254_end_0, end_mask = var_2254_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2254_cast_fp16")];
            tensor<int32, [4]> var_2270_begin_0 = const()[name = tensor<string, []>("op_2270_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 448])];
            tensor<int32, [4]> var_2270_end_0 = const()[name = tensor<string, []>("op_2270_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_2270_end_mask_0 = const()[name = tensor<string, []>("op_2270_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_2270_cast_fp16 = slice_by_index(begin = var_2270_begin_0, end = var_2270_end_0, end_mask = var_2270_end_mask_0, x = k_35_cast_fp16)[name = tensor<string, []>("op_2270_cast_fp16")];
            tensor<int32, [4]> var_2284_begin_0 = const()[name = tensor<string, []>("op_2284_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2284_end_0 = const()[name = tensor<string, []>("op_2284_end_0"), val = tensor<int32, [4]>([1, 64, 1, 512])];
            tensor<bool, [4]> var_2284_end_mask_0 = const()[name = tensor<string, []>("op_2284_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2284_cast_fp16 = slice_by_index(begin = var_2284_begin_0, end = var_2284_end_0, end_mask = var_2284_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2284_cast_fp16")];
            tensor<int32, [4]> var_2300_begin_0 = const()[name = tensor<string, []>("op_2300_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_2300_end_0 = const()[name = tensor<string, []>("op_2300_end_0"), val = tensor<int32, [4]>([1, 128, 1, 512])];
            tensor<bool, [4]> var_2300_end_mask_0 = const()[name = tensor<string, []>("op_2300_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2300_cast_fp16 = slice_by_index(begin = var_2300_begin_0, end = var_2300_end_0, end_mask = var_2300_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2300_cast_fp16")];
            tensor<int32, [4]> var_2316_begin_0 = const()[name = tensor<string, []>("op_2316_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_2316_end_0 = const()[name = tensor<string, []>("op_2316_end_0"), val = tensor<int32, [4]>([1, 192, 1, 512])];
            tensor<bool, [4]> var_2316_end_mask_0 = const()[name = tensor<string, []>("op_2316_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2316_cast_fp16 = slice_by_index(begin = var_2316_begin_0, end = var_2316_end_0, end_mask = var_2316_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2316_cast_fp16")];
            tensor<int32, [4]> var_2332_begin_0 = const()[name = tensor<string, []>("op_2332_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_2332_end_0 = const()[name = tensor<string, []>("op_2332_end_0"), val = tensor<int32, [4]>([1, 256, 1, 512])];
            tensor<bool, [4]> var_2332_end_mask_0 = const()[name = tensor<string, []>("op_2332_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2332_cast_fp16 = slice_by_index(begin = var_2332_begin_0, end = var_2332_end_0, end_mask = var_2332_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2332_cast_fp16")];
            tensor<int32, [4]> var_2348_begin_0 = const()[name = tensor<string, []>("op_2348_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_2348_end_0 = const()[name = tensor<string, []>("op_2348_end_0"), val = tensor<int32, [4]>([1, 320, 1, 512])];
            tensor<bool, [4]> var_2348_end_mask_0 = const()[name = tensor<string, []>("op_2348_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2348_cast_fp16 = slice_by_index(begin = var_2348_begin_0, end = var_2348_end_0, end_mask = var_2348_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2348_cast_fp16")];
            tensor<int32, [4]> var_2364_begin_0 = const()[name = tensor<string, []>("op_2364_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_2364_end_0 = const()[name = tensor<string, []>("op_2364_end_0"), val = tensor<int32, [4]>([1, 384, 1, 512])];
            tensor<bool, [4]> var_2364_end_mask_0 = const()[name = tensor<string, []>("op_2364_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2364_cast_fp16 = slice_by_index(begin = var_2364_begin_0, end = var_2364_end_0, end_mask = var_2364_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2364_cast_fp16")];
            tensor<int32, [4]> var_2380_begin_0 = const()[name = tensor<string, []>("op_2380_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_2380_end_0 = const()[name = tensor<string, []>("op_2380_end_0"), val = tensor<int32, [4]>([1, 448, 1, 512])];
            tensor<bool, [4]> var_2380_end_mask_0 = const()[name = tensor<string, []>("op_2380_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2380_cast_fp16 = slice_by_index(begin = var_2380_begin_0, end = var_2380_end_0, end_mask = var_2380_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2380_cast_fp16")];
            tensor<int32, [4]> var_2396_begin_0 = const()[name = tensor<string, []>("op_2396_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_2396_end_0 = const()[name = tensor<string, []>("op_2396_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_2396_end_mask_0 = const()[name = tensor<string, []>("op_2396_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_2396_cast_fp16 = slice_by_index(begin = var_2396_begin_0, end = var_2396_end_0, end_mask = var_2396_end_mask_0, x = v_27_cast_fp16)[name = tensor<string, []>("op_2396_cast_fp16")];
            tensor<string, []> var_2412_equation_0 = const()[name = tensor<string, []>("op_2412_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2412_cast_fp16 = einsum(equation = var_2412_equation_0, values = (var_2158_cast_fp16, var_2028_cast_fp16))[name = tensor<string, []>("op_2412_cast_fp16")];
            tensor<fp16, []> var_2413_to_fp16 = const()[name = tensor<string, []>("op_2413_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2414_cast_fp16 = mul(x = var_2412_cast_fp16, y = var_2413_to_fp16)[name = tensor<string, []>("op_2414_cast_fp16")];
            tensor<string, []> var_2416_equation_0 = const()[name = tensor<string, []>("op_2416_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2416_cast_fp16 = einsum(equation = var_2416_equation_0, values = (var_2158_cast_fp16, var_2032_cast_fp16))[name = tensor<string, []>("op_2416_cast_fp16")];
            tensor<fp16, []> var_2417_to_fp16 = const()[name = tensor<string, []>("op_2417_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2418_cast_fp16 = mul(x = var_2416_cast_fp16, y = var_2417_to_fp16)[name = tensor<string, []>("op_2418_cast_fp16")];
            tensor<string, []> var_2420_equation_0 = const()[name = tensor<string, []>("op_2420_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2420_cast_fp16 = einsum(equation = var_2420_equation_0, values = (var_2158_cast_fp16, var_2036_cast_fp16))[name = tensor<string, []>("op_2420_cast_fp16")];
            tensor<fp16, []> var_2421_to_fp16 = const()[name = tensor<string, []>("op_2421_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2422_cast_fp16 = mul(x = var_2420_cast_fp16, y = var_2421_to_fp16)[name = tensor<string, []>("op_2422_cast_fp16")];
            tensor<string, []> var_2424_equation_0 = const()[name = tensor<string, []>("op_2424_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2424_cast_fp16 = einsum(equation = var_2424_equation_0, values = (var_2158_cast_fp16, var_2040_cast_fp16))[name = tensor<string, []>("op_2424_cast_fp16")];
            tensor<fp16, []> var_2425_to_fp16 = const()[name = tensor<string, []>("op_2425_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2426_cast_fp16 = mul(x = var_2424_cast_fp16, y = var_2425_to_fp16)[name = tensor<string, []>("op_2426_cast_fp16")];
            tensor<string, []> var_2428_equation_0 = const()[name = tensor<string, []>("op_2428_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2428_cast_fp16 = einsum(equation = var_2428_equation_0, values = (var_2174_cast_fp16, var_2044_cast_fp16))[name = tensor<string, []>("op_2428_cast_fp16")];
            tensor<fp16, []> var_2429_to_fp16 = const()[name = tensor<string, []>("op_2429_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2430_cast_fp16 = mul(x = var_2428_cast_fp16, y = var_2429_to_fp16)[name = tensor<string, []>("op_2430_cast_fp16")];
            tensor<string, []> var_2432_equation_0 = const()[name = tensor<string, []>("op_2432_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2432_cast_fp16 = einsum(equation = var_2432_equation_0, values = (var_2174_cast_fp16, var_2048_cast_fp16))[name = tensor<string, []>("op_2432_cast_fp16")];
            tensor<fp16, []> var_2433_to_fp16 = const()[name = tensor<string, []>("op_2433_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2434_cast_fp16 = mul(x = var_2432_cast_fp16, y = var_2433_to_fp16)[name = tensor<string, []>("op_2434_cast_fp16")];
            tensor<string, []> var_2436_equation_0 = const()[name = tensor<string, []>("op_2436_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2436_cast_fp16 = einsum(equation = var_2436_equation_0, values = (var_2174_cast_fp16, var_2052_cast_fp16))[name = tensor<string, []>("op_2436_cast_fp16")];
            tensor<fp16, []> var_2437_to_fp16 = const()[name = tensor<string, []>("op_2437_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2438_cast_fp16 = mul(x = var_2436_cast_fp16, y = var_2437_to_fp16)[name = tensor<string, []>("op_2438_cast_fp16")];
            tensor<string, []> var_2440_equation_0 = const()[name = tensor<string, []>("op_2440_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2440_cast_fp16 = einsum(equation = var_2440_equation_0, values = (var_2174_cast_fp16, var_2056_cast_fp16))[name = tensor<string, []>("op_2440_cast_fp16")];
            tensor<fp16, []> var_2441_to_fp16 = const()[name = tensor<string, []>("op_2441_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2442_cast_fp16 = mul(x = var_2440_cast_fp16, y = var_2441_to_fp16)[name = tensor<string, []>("op_2442_cast_fp16")];
            tensor<string, []> var_2444_equation_0 = const()[name = tensor<string, []>("op_2444_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2444_cast_fp16 = einsum(equation = var_2444_equation_0, values = (var_2190_cast_fp16, var_2060_cast_fp16))[name = tensor<string, []>("op_2444_cast_fp16")];
            tensor<fp16, []> var_2445_to_fp16 = const()[name = tensor<string, []>("op_2445_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2446_cast_fp16 = mul(x = var_2444_cast_fp16, y = var_2445_to_fp16)[name = tensor<string, []>("op_2446_cast_fp16")];
            tensor<string, []> var_2448_equation_0 = const()[name = tensor<string, []>("op_2448_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2448_cast_fp16 = einsum(equation = var_2448_equation_0, values = (var_2190_cast_fp16, var_2064_cast_fp16))[name = tensor<string, []>("op_2448_cast_fp16")];
            tensor<fp16, []> var_2449_to_fp16 = const()[name = tensor<string, []>("op_2449_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2450_cast_fp16 = mul(x = var_2448_cast_fp16, y = var_2449_to_fp16)[name = tensor<string, []>("op_2450_cast_fp16")];
            tensor<string, []> var_2452_equation_0 = const()[name = tensor<string, []>("op_2452_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2452_cast_fp16 = einsum(equation = var_2452_equation_0, values = (var_2190_cast_fp16, var_2068_cast_fp16))[name = tensor<string, []>("op_2452_cast_fp16")];
            tensor<fp16, []> var_2453_to_fp16 = const()[name = tensor<string, []>("op_2453_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2454_cast_fp16 = mul(x = var_2452_cast_fp16, y = var_2453_to_fp16)[name = tensor<string, []>("op_2454_cast_fp16")];
            tensor<string, []> var_2456_equation_0 = const()[name = tensor<string, []>("op_2456_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2456_cast_fp16 = einsum(equation = var_2456_equation_0, values = (var_2190_cast_fp16, var_2072_cast_fp16))[name = tensor<string, []>("op_2456_cast_fp16")];
            tensor<fp16, []> var_2457_to_fp16 = const()[name = tensor<string, []>("op_2457_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2458_cast_fp16 = mul(x = var_2456_cast_fp16, y = var_2457_to_fp16)[name = tensor<string, []>("op_2458_cast_fp16")];
            tensor<string, []> var_2460_equation_0 = const()[name = tensor<string, []>("op_2460_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2460_cast_fp16 = einsum(equation = var_2460_equation_0, values = (var_2206_cast_fp16, var_2076_cast_fp16))[name = tensor<string, []>("op_2460_cast_fp16")];
            tensor<fp16, []> var_2461_to_fp16 = const()[name = tensor<string, []>("op_2461_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2462_cast_fp16 = mul(x = var_2460_cast_fp16, y = var_2461_to_fp16)[name = tensor<string, []>("op_2462_cast_fp16")];
            tensor<string, []> var_2464_equation_0 = const()[name = tensor<string, []>("op_2464_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2464_cast_fp16 = einsum(equation = var_2464_equation_0, values = (var_2206_cast_fp16, var_2080_cast_fp16))[name = tensor<string, []>("op_2464_cast_fp16")];
            tensor<fp16, []> var_2465_to_fp16 = const()[name = tensor<string, []>("op_2465_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2466_cast_fp16 = mul(x = var_2464_cast_fp16, y = var_2465_to_fp16)[name = tensor<string, []>("op_2466_cast_fp16")];
            tensor<string, []> var_2468_equation_0 = const()[name = tensor<string, []>("op_2468_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2468_cast_fp16 = einsum(equation = var_2468_equation_0, values = (var_2206_cast_fp16, var_2084_cast_fp16))[name = tensor<string, []>("op_2468_cast_fp16")];
            tensor<fp16, []> var_2469_to_fp16 = const()[name = tensor<string, []>("op_2469_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2470_cast_fp16 = mul(x = var_2468_cast_fp16, y = var_2469_to_fp16)[name = tensor<string, []>("op_2470_cast_fp16")];
            tensor<string, []> var_2472_equation_0 = const()[name = tensor<string, []>("op_2472_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2472_cast_fp16 = einsum(equation = var_2472_equation_0, values = (var_2206_cast_fp16, var_2088_cast_fp16))[name = tensor<string, []>("op_2472_cast_fp16")];
            tensor<fp16, []> var_2473_to_fp16 = const()[name = tensor<string, []>("op_2473_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2474_cast_fp16 = mul(x = var_2472_cast_fp16, y = var_2473_to_fp16)[name = tensor<string, []>("op_2474_cast_fp16")];
            tensor<string, []> var_2476_equation_0 = const()[name = tensor<string, []>("op_2476_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2476_cast_fp16 = einsum(equation = var_2476_equation_0, values = (var_2222_cast_fp16, var_2092_cast_fp16))[name = tensor<string, []>("op_2476_cast_fp16")];
            tensor<fp16, []> var_2477_to_fp16 = const()[name = tensor<string, []>("op_2477_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2478_cast_fp16 = mul(x = var_2476_cast_fp16, y = var_2477_to_fp16)[name = tensor<string, []>("op_2478_cast_fp16")];
            tensor<string, []> var_2480_equation_0 = const()[name = tensor<string, []>("op_2480_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2480_cast_fp16 = einsum(equation = var_2480_equation_0, values = (var_2222_cast_fp16, var_2096_cast_fp16))[name = tensor<string, []>("op_2480_cast_fp16")];
            tensor<fp16, []> var_2481_to_fp16 = const()[name = tensor<string, []>("op_2481_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2482_cast_fp16 = mul(x = var_2480_cast_fp16, y = var_2481_to_fp16)[name = tensor<string, []>("op_2482_cast_fp16")];
            tensor<string, []> var_2484_equation_0 = const()[name = tensor<string, []>("op_2484_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2484_cast_fp16 = einsum(equation = var_2484_equation_0, values = (var_2222_cast_fp16, var_2100_cast_fp16))[name = tensor<string, []>("op_2484_cast_fp16")];
            tensor<fp16, []> var_2485_to_fp16 = const()[name = tensor<string, []>("op_2485_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2486_cast_fp16 = mul(x = var_2484_cast_fp16, y = var_2485_to_fp16)[name = tensor<string, []>("op_2486_cast_fp16")];
            tensor<string, []> var_2488_equation_0 = const()[name = tensor<string, []>("op_2488_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2488_cast_fp16 = einsum(equation = var_2488_equation_0, values = (var_2222_cast_fp16, var_2104_cast_fp16))[name = tensor<string, []>("op_2488_cast_fp16")];
            tensor<fp16, []> var_2489_to_fp16 = const()[name = tensor<string, []>("op_2489_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2490_cast_fp16 = mul(x = var_2488_cast_fp16, y = var_2489_to_fp16)[name = tensor<string, []>("op_2490_cast_fp16")];
            tensor<string, []> var_2492_equation_0 = const()[name = tensor<string, []>("op_2492_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2492_cast_fp16 = einsum(equation = var_2492_equation_0, values = (var_2238_cast_fp16, var_2108_cast_fp16))[name = tensor<string, []>("op_2492_cast_fp16")];
            tensor<fp16, []> var_2493_to_fp16 = const()[name = tensor<string, []>("op_2493_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2494_cast_fp16 = mul(x = var_2492_cast_fp16, y = var_2493_to_fp16)[name = tensor<string, []>("op_2494_cast_fp16")];
            tensor<string, []> var_2496_equation_0 = const()[name = tensor<string, []>("op_2496_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2496_cast_fp16 = einsum(equation = var_2496_equation_0, values = (var_2238_cast_fp16, var_2112_cast_fp16))[name = tensor<string, []>("op_2496_cast_fp16")];
            tensor<fp16, []> var_2497_to_fp16 = const()[name = tensor<string, []>("op_2497_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2498_cast_fp16 = mul(x = var_2496_cast_fp16, y = var_2497_to_fp16)[name = tensor<string, []>("op_2498_cast_fp16")];
            tensor<string, []> var_2500_equation_0 = const()[name = tensor<string, []>("op_2500_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2500_cast_fp16 = einsum(equation = var_2500_equation_0, values = (var_2238_cast_fp16, var_2116_cast_fp16))[name = tensor<string, []>("op_2500_cast_fp16")];
            tensor<fp16, []> var_2501_to_fp16 = const()[name = tensor<string, []>("op_2501_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2502_cast_fp16 = mul(x = var_2500_cast_fp16, y = var_2501_to_fp16)[name = tensor<string, []>("op_2502_cast_fp16")];
            tensor<string, []> var_2504_equation_0 = const()[name = tensor<string, []>("op_2504_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2504_cast_fp16 = einsum(equation = var_2504_equation_0, values = (var_2238_cast_fp16, var_2120_cast_fp16))[name = tensor<string, []>("op_2504_cast_fp16")];
            tensor<fp16, []> var_2505_to_fp16 = const()[name = tensor<string, []>("op_2505_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2506_cast_fp16 = mul(x = var_2504_cast_fp16, y = var_2505_to_fp16)[name = tensor<string, []>("op_2506_cast_fp16")];
            tensor<string, []> var_2508_equation_0 = const()[name = tensor<string, []>("op_2508_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2508_cast_fp16 = einsum(equation = var_2508_equation_0, values = (var_2254_cast_fp16, var_2124_cast_fp16))[name = tensor<string, []>("op_2508_cast_fp16")];
            tensor<fp16, []> var_2509_to_fp16 = const()[name = tensor<string, []>("op_2509_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2510_cast_fp16 = mul(x = var_2508_cast_fp16, y = var_2509_to_fp16)[name = tensor<string, []>("op_2510_cast_fp16")];
            tensor<string, []> var_2512_equation_0 = const()[name = tensor<string, []>("op_2512_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2512_cast_fp16 = einsum(equation = var_2512_equation_0, values = (var_2254_cast_fp16, var_2128_cast_fp16))[name = tensor<string, []>("op_2512_cast_fp16")];
            tensor<fp16, []> var_2513_to_fp16 = const()[name = tensor<string, []>("op_2513_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2514_cast_fp16 = mul(x = var_2512_cast_fp16, y = var_2513_to_fp16)[name = tensor<string, []>("op_2514_cast_fp16")];
            tensor<string, []> var_2516_equation_0 = const()[name = tensor<string, []>("op_2516_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2516_cast_fp16 = einsum(equation = var_2516_equation_0, values = (var_2254_cast_fp16, var_2132_cast_fp16))[name = tensor<string, []>("op_2516_cast_fp16")];
            tensor<fp16, []> var_2517_to_fp16 = const()[name = tensor<string, []>("op_2517_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2518_cast_fp16 = mul(x = var_2516_cast_fp16, y = var_2517_to_fp16)[name = tensor<string, []>("op_2518_cast_fp16")];
            tensor<string, []> var_2520_equation_0 = const()[name = tensor<string, []>("op_2520_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2520_cast_fp16 = einsum(equation = var_2520_equation_0, values = (var_2254_cast_fp16, var_2136_cast_fp16))[name = tensor<string, []>("op_2520_cast_fp16")];
            tensor<fp16, []> var_2521_to_fp16 = const()[name = tensor<string, []>("op_2521_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2522_cast_fp16 = mul(x = var_2520_cast_fp16, y = var_2521_to_fp16)[name = tensor<string, []>("op_2522_cast_fp16")];
            tensor<string, []> var_2524_equation_0 = const()[name = tensor<string, []>("op_2524_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2524_cast_fp16 = einsum(equation = var_2524_equation_0, values = (var_2270_cast_fp16, var_2140_cast_fp16))[name = tensor<string, []>("op_2524_cast_fp16")];
            tensor<fp16, []> var_2525_to_fp16 = const()[name = tensor<string, []>("op_2525_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2526_cast_fp16 = mul(x = var_2524_cast_fp16, y = var_2525_to_fp16)[name = tensor<string, []>("op_2526_cast_fp16")];
            tensor<string, []> var_2528_equation_0 = const()[name = tensor<string, []>("op_2528_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2528_cast_fp16 = einsum(equation = var_2528_equation_0, values = (var_2270_cast_fp16, var_2144_cast_fp16))[name = tensor<string, []>("op_2528_cast_fp16")];
            tensor<fp16, []> var_2529_to_fp16 = const()[name = tensor<string, []>("op_2529_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2530_cast_fp16 = mul(x = var_2528_cast_fp16, y = var_2529_to_fp16)[name = tensor<string, []>("op_2530_cast_fp16")];
            tensor<string, []> var_2532_equation_0 = const()[name = tensor<string, []>("op_2532_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2532_cast_fp16 = einsum(equation = var_2532_equation_0, values = (var_2270_cast_fp16, var_2148_cast_fp16))[name = tensor<string, []>("op_2532_cast_fp16")];
            tensor<fp16, []> var_2533_to_fp16 = const()[name = tensor<string, []>("op_2533_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2534_cast_fp16 = mul(x = var_2532_cast_fp16, y = var_2533_to_fp16)[name = tensor<string, []>("op_2534_cast_fp16")];
            tensor<string, []> var_2536_equation_0 = const()[name = tensor<string, []>("op_2536_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_2536_cast_fp16 = einsum(equation = var_2536_equation_0, values = (var_2270_cast_fp16, var_2152_cast_fp16))[name = tensor<string, []>("op_2536_cast_fp16")];
            tensor<fp16, []> var_2537_to_fp16 = const()[name = tensor<string, []>("op_2537_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_2538_cast_fp16 = mul(x = var_2536_cast_fp16, y = var_2537_to_fp16)[name = tensor<string, []>("op_2538_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_129_cast_fp16 = add(x = var_2414_cast_fp16, y = mask)[name = tensor<string, []>("aw_129_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_131_cast_fp16 = add(x = var_2418_cast_fp16, y = mask)[name = tensor<string, []>("aw_131_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_133_cast_fp16 = add(x = var_2422_cast_fp16, y = mask)[name = tensor<string, []>("aw_133_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_135_cast_fp16 = add(x = var_2426_cast_fp16, y = mask)[name = tensor<string, []>("aw_135_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_137_cast_fp16 = add(x = var_2430_cast_fp16, y = mask)[name = tensor<string, []>("aw_137_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_139_cast_fp16 = add(x = var_2434_cast_fp16, y = mask)[name = tensor<string, []>("aw_139_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_141_cast_fp16 = add(x = var_2438_cast_fp16, y = mask)[name = tensor<string, []>("aw_141_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_143_cast_fp16 = add(x = var_2442_cast_fp16, y = mask)[name = tensor<string, []>("aw_143_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_145_cast_fp16 = add(x = var_2446_cast_fp16, y = mask)[name = tensor<string, []>("aw_145_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_147_cast_fp16 = add(x = var_2450_cast_fp16, y = mask)[name = tensor<string, []>("aw_147_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_149_cast_fp16 = add(x = var_2454_cast_fp16, y = mask)[name = tensor<string, []>("aw_149_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_151_cast_fp16 = add(x = var_2458_cast_fp16, y = mask)[name = tensor<string, []>("aw_151_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_153_cast_fp16 = add(x = var_2462_cast_fp16, y = mask)[name = tensor<string, []>("aw_153_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_155_cast_fp16 = add(x = var_2466_cast_fp16, y = mask)[name = tensor<string, []>("aw_155_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_157_cast_fp16 = add(x = var_2470_cast_fp16, y = mask)[name = tensor<string, []>("aw_157_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_159_cast_fp16 = add(x = var_2474_cast_fp16, y = mask)[name = tensor<string, []>("aw_159_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_161_cast_fp16 = add(x = var_2478_cast_fp16, y = mask)[name = tensor<string, []>("aw_161_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_163_cast_fp16 = add(x = var_2482_cast_fp16, y = mask)[name = tensor<string, []>("aw_163_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_165_cast_fp16 = add(x = var_2486_cast_fp16, y = mask)[name = tensor<string, []>("aw_165_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_167_cast_fp16 = add(x = var_2490_cast_fp16, y = mask)[name = tensor<string, []>("aw_167_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_169_cast_fp16 = add(x = var_2494_cast_fp16, y = mask)[name = tensor<string, []>("aw_169_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_171_cast_fp16 = add(x = var_2498_cast_fp16, y = mask)[name = tensor<string, []>("aw_171_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_173_cast_fp16 = add(x = var_2502_cast_fp16, y = mask)[name = tensor<string, []>("aw_173_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_175_cast_fp16 = add(x = var_2506_cast_fp16, y = mask)[name = tensor<string, []>("aw_175_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_177_cast_fp16 = add(x = var_2510_cast_fp16, y = mask)[name = tensor<string, []>("aw_177_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_179_cast_fp16 = add(x = var_2514_cast_fp16, y = mask)[name = tensor<string, []>("aw_179_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_181_cast_fp16 = add(x = var_2518_cast_fp16, y = mask)[name = tensor<string, []>("aw_181_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_183_cast_fp16 = add(x = var_2522_cast_fp16, y = mask)[name = tensor<string, []>("aw_183_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_185_cast_fp16 = add(x = var_2526_cast_fp16, y = mask)[name = tensor<string, []>("aw_185_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_187_cast_fp16 = add(x = var_2530_cast_fp16, y = mask)[name = tensor<string, []>("aw_187_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_189_cast_fp16 = add(x = var_2534_cast_fp16, y = mask)[name = tensor<string, []>("aw_189_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_191_cast_fp16 = add(x = var_2538_cast_fp16, y = mask)[name = tensor<string, []>("aw_191_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2571_cast_fp16 = softmax(axis = var_1879, x = aw_129_cast_fp16)[name = tensor<string, []>("op_2571_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2572_cast_fp16 = softmax(axis = var_1879, x = aw_131_cast_fp16)[name = tensor<string, []>("op_2572_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2573_cast_fp16 = softmax(axis = var_1879, x = aw_133_cast_fp16)[name = tensor<string, []>("op_2573_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2574_cast_fp16 = softmax(axis = var_1879, x = aw_135_cast_fp16)[name = tensor<string, []>("op_2574_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2575_cast_fp16 = softmax(axis = var_1879, x = aw_137_cast_fp16)[name = tensor<string, []>("op_2575_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2576_cast_fp16 = softmax(axis = var_1879, x = aw_139_cast_fp16)[name = tensor<string, []>("op_2576_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2577_cast_fp16 = softmax(axis = var_1879, x = aw_141_cast_fp16)[name = tensor<string, []>("op_2577_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2578_cast_fp16 = softmax(axis = var_1879, x = aw_143_cast_fp16)[name = tensor<string, []>("op_2578_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2579_cast_fp16 = softmax(axis = var_1879, x = aw_145_cast_fp16)[name = tensor<string, []>("op_2579_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2580_cast_fp16 = softmax(axis = var_1879, x = aw_147_cast_fp16)[name = tensor<string, []>("op_2580_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2581_cast_fp16 = softmax(axis = var_1879, x = aw_149_cast_fp16)[name = tensor<string, []>("op_2581_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2582_cast_fp16 = softmax(axis = var_1879, x = aw_151_cast_fp16)[name = tensor<string, []>("op_2582_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2583_cast_fp16 = softmax(axis = var_1879, x = aw_153_cast_fp16)[name = tensor<string, []>("op_2583_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2584_cast_fp16 = softmax(axis = var_1879, x = aw_155_cast_fp16)[name = tensor<string, []>("op_2584_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2585_cast_fp16 = softmax(axis = var_1879, x = aw_157_cast_fp16)[name = tensor<string, []>("op_2585_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2586_cast_fp16 = softmax(axis = var_1879, x = aw_159_cast_fp16)[name = tensor<string, []>("op_2586_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2587_cast_fp16 = softmax(axis = var_1879, x = aw_161_cast_fp16)[name = tensor<string, []>("op_2587_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2588_cast_fp16 = softmax(axis = var_1879, x = aw_163_cast_fp16)[name = tensor<string, []>("op_2588_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2589_cast_fp16 = softmax(axis = var_1879, x = aw_165_cast_fp16)[name = tensor<string, []>("op_2589_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2590_cast_fp16 = softmax(axis = var_1879, x = aw_167_cast_fp16)[name = tensor<string, []>("op_2590_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2591_cast_fp16 = softmax(axis = var_1879, x = aw_169_cast_fp16)[name = tensor<string, []>("op_2591_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2592_cast_fp16 = softmax(axis = var_1879, x = aw_171_cast_fp16)[name = tensor<string, []>("op_2592_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2593_cast_fp16 = softmax(axis = var_1879, x = aw_173_cast_fp16)[name = tensor<string, []>("op_2593_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2594_cast_fp16 = softmax(axis = var_1879, x = aw_175_cast_fp16)[name = tensor<string, []>("op_2594_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2595_cast_fp16 = softmax(axis = var_1879, x = aw_177_cast_fp16)[name = tensor<string, []>("op_2595_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2596_cast_fp16 = softmax(axis = var_1879, x = aw_179_cast_fp16)[name = tensor<string, []>("op_2596_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2597_cast_fp16 = softmax(axis = var_1879, x = aw_181_cast_fp16)[name = tensor<string, []>("op_2597_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2598_cast_fp16 = softmax(axis = var_1879, x = aw_183_cast_fp16)[name = tensor<string, []>("op_2598_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2599_cast_fp16 = softmax(axis = var_1879, x = aw_185_cast_fp16)[name = tensor<string, []>("op_2599_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2600_cast_fp16 = softmax(axis = var_1879, x = aw_187_cast_fp16)[name = tensor<string, []>("op_2600_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2601_cast_fp16 = softmax(axis = var_1879, x = aw_189_cast_fp16)[name = tensor<string, []>("op_2601_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_2602_cast_fp16 = softmax(axis = var_1879, x = aw_191_cast_fp16)[name = tensor<string, []>("op_2602_cast_fp16")];
            tensor<string, []> var_2604_equation_0 = const()[name = tensor<string, []>("op_2604_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2604_cast_fp16 = einsum(equation = var_2604_equation_0, values = (var_2284_cast_fp16, var_2571_cast_fp16))[name = tensor<string, []>("op_2604_cast_fp16")];
            tensor<string, []> var_2606_equation_0 = const()[name = tensor<string, []>("op_2606_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2606_cast_fp16 = einsum(equation = var_2606_equation_0, values = (var_2284_cast_fp16, var_2572_cast_fp16))[name = tensor<string, []>("op_2606_cast_fp16")];
            tensor<string, []> var_2608_equation_0 = const()[name = tensor<string, []>("op_2608_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2608_cast_fp16 = einsum(equation = var_2608_equation_0, values = (var_2284_cast_fp16, var_2573_cast_fp16))[name = tensor<string, []>("op_2608_cast_fp16")];
            tensor<string, []> var_2610_equation_0 = const()[name = tensor<string, []>("op_2610_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2610_cast_fp16 = einsum(equation = var_2610_equation_0, values = (var_2284_cast_fp16, var_2574_cast_fp16))[name = tensor<string, []>("op_2610_cast_fp16")];
            tensor<string, []> var_2612_equation_0 = const()[name = tensor<string, []>("op_2612_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2612_cast_fp16 = einsum(equation = var_2612_equation_0, values = (var_2300_cast_fp16, var_2575_cast_fp16))[name = tensor<string, []>("op_2612_cast_fp16")];
            tensor<string, []> var_2614_equation_0 = const()[name = tensor<string, []>("op_2614_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2614_cast_fp16 = einsum(equation = var_2614_equation_0, values = (var_2300_cast_fp16, var_2576_cast_fp16))[name = tensor<string, []>("op_2614_cast_fp16")];
            tensor<string, []> var_2616_equation_0 = const()[name = tensor<string, []>("op_2616_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2616_cast_fp16 = einsum(equation = var_2616_equation_0, values = (var_2300_cast_fp16, var_2577_cast_fp16))[name = tensor<string, []>("op_2616_cast_fp16")];
            tensor<string, []> var_2618_equation_0 = const()[name = tensor<string, []>("op_2618_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2618_cast_fp16 = einsum(equation = var_2618_equation_0, values = (var_2300_cast_fp16, var_2578_cast_fp16))[name = tensor<string, []>("op_2618_cast_fp16")];
            tensor<string, []> var_2620_equation_0 = const()[name = tensor<string, []>("op_2620_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2620_cast_fp16 = einsum(equation = var_2620_equation_0, values = (var_2316_cast_fp16, var_2579_cast_fp16))[name = tensor<string, []>("op_2620_cast_fp16")];
            tensor<string, []> var_2622_equation_0 = const()[name = tensor<string, []>("op_2622_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2622_cast_fp16 = einsum(equation = var_2622_equation_0, values = (var_2316_cast_fp16, var_2580_cast_fp16))[name = tensor<string, []>("op_2622_cast_fp16")];
            tensor<string, []> var_2624_equation_0 = const()[name = tensor<string, []>("op_2624_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2624_cast_fp16 = einsum(equation = var_2624_equation_0, values = (var_2316_cast_fp16, var_2581_cast_fp16))[name = tensor<string, []>("op_2624_cast_fp16")];
            tensor<string, []> var_2626_equation_0 = const()[name = tensor<string, []>("op_2626_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2626_cast_fp16 = einsum(equation = var_2626_equation_0, values = (var_2316_cast_fp16, var_2582_cast_fp16))[name = tensor<string, []>("op_2626_cast_fp16")];
            tensor<string, []> var_2628_equation_0 = const()[name = tensor<string, []>("op_2628_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2628_cast_fp16 = einsum(equation = var_2628_equation_0, values = (var_2332_cast_fp16, var_2583_cast_fp16))[name = tensor<string, []>("op_2628_cast_fp16")];
            tensor<string, []> var_2630_equation_0 = const()[name = tensor<string, []>("op_2630_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2630_cast_fp16 = einsum(equation = var_2630_equation_0, values = (var_2332_cast_fp16, var_2584_cast_fp16))[name = tensor<string, []>("op_2630_cast_fp16")];
            tensor<string, []> var_2632_equation_0 = const()[name = tensor<string, []>("op_2632_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2632_cast_fp16 = einsum(equation = var_2632_equation_0, values = (var_2332_cast_fp16, var_2585_cast_fp16))[name = tensor<string, []>("op_2632_cast_fp16")];
            tensor<string, []> var_2634_equation_0 = const()[name = tensor<string, []>("op_2634_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2634_cast_fp16 = einsum(equation = var_2634_equation_0, values = (var_2332_cast_fp16, var_2586_cast_fp16))[name = tensor<string, []>("op_2634_cast_fp16")];
            tensor<string, []> var_2636_equation_0 = const()[name = tensor<string, []>("op_2636_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2636_cast_fp16 = einsum(equation = var_2636_equation_0, values = (var_2348_cast_fp16, var_2587_cast_fp16))[name = tensor<string, []>("op_2636_cast_fp16")];
            tensor<string, []> var_2638_equation_0 = const()[name = tensor<string, []>("op_2638_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2638_cast_fp16 = einsum(equation = var_2638_equation_0, values = (var_2348_cast_fp16, var_2588_cast_fp16))[name = tensor<string, []>("op_2638_cast_fp16")];
            tensor<string, []> var_2640_equation_0 = const()[name = tensor<string, []>("op_2640_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2640_cast_fp16 = einsum(equation = var_2640_equation_0, values = (var_2348_cast_fp16, var_2589_cast_fp16))[name = tensor<string, []>("op_2640_cast_fp16")];
            tensor<string, []> var_2642_equation_0 = const()[name = tensor<string, []>("op_2642_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2642_cast_fp16 = einsum(equation = var_2642_equation_0, values = (var_2348_cast_fp16, var_2590_cast_fp16))[name = tensor<string, []>("op_2642_cast_fp16")];
            tensor<string, []> var_2644_equation_0 = const()[name = tensor<string, []>("op_2644_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2644_cast_fp16 = einsum(equation = var_2644_equation_0, values = (var_2364_cast_fp16, var_2591_cast_fp16))[name = tensor<string, []>("op_2644_cast_fp16")];
            tensor<string, []> var_2646_equation_0 = const()[name = tensor<string, []>("op_2646_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2646_cast_fp16 = einsum(equation = var_2646_equation_0, values = (var_2364_cast_fp16, var_2592_cast_fp16))[name = tensor<string, []>("op_2646_cast_fp16")];
            tensor<string, []> var_2648_equation_0 = const()[name = tensor<string, []>("op_2648_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2648_cast_fp16 = einsum(equation = var_2648_equation_0, values = (var_2364_cast_fp16, var_2593_cast_fp16))[name = tensor<string, []>("op_2648_cast_fp16")];
            tensor<string, []> var_2650_equation_0 = const()[name = tensor<string, []>("op_2650_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2650_cast_fp16 = einsum(equation = var_2650_equation_0, values = (var_2364_cast_fp16, var_2594_cast_fp16))[name = tensor<string, []>("op_2650_cast_fp16")];
            tensor<string, []> var_2652_equation_0 = const()[name = tensor<string, []>("op_2652_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2652_cast_fp16 = einsum(equation = var_2652_equation_0, values = (var_2380_cast_fp16, var_2595_cast_fp16))[name = tensor<string, []>("op_2652_cast_fp16")];
            tensor<string, []> var_2654_equation_0 = const()[name = tensor<string, []>("op_2654_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2654_cast_fp16 = einsum(equation = var_2654_equation_0, values = (var_2380_cast_fp16, var_2596_cast_fp16))[name = tensor<string, []>("op_2654_cast_fp16")];
            tensor<string, []> var_2656_equation_0 = const()[name = tensor<string, []>("op_2656_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2656_cast_fp16 = einsum(equation = var_2656_equation_0, values = (var_2380_cast_fp16, var_2597_cast_fp16))[name = tensor<string, []>("op_2656_cast_fp16")];
            tensor<string, []> var_2658_equation_0 = const()[name = tensor<string, []>("op_2658_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2658_cast_fp16 = einsum(equation = var_2658_equation_0, values = (var_2380_cast_fp16, var_2598_cast_fp16))[name = tensor<string, []>("op_2658_cast_fp16")];
            tensor<string, []> var_2660_equation_0 = const()[name = tensor<string, []>("op_2660_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2660_cast_fp16 = einsum(equation = var_2660_equation_0, values = (var_2396_cast_fp16, var_2599_cast_fp16))[name = tensor<string, []>("op_2660_cast_fp16")];
            tensor<string, []> var_2662_equation_0 = const()[name = tensor<string, []>("op_2662_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2662_cast_fp16 = einsum(equation = var_2662_equation_0, values = (var_2396_cast_fp16, var_2600_cast_fp16))[name = tensor<string, []>("op_2662_cast_fp16")];
            tensor<string, []> var_2664_equation_0 = const()[name = tensor<string, []>("op_2664_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2664_cast_fp16 = einsum(equation = var_2664_equation_0, values = (var_2396_cast_fp16, var_2601_cast_fp16))[name = tensor<string, []>("op_2664_cast_fp16")];
            tensor<string, []> var_2666_equation_0 = const()[name = tensor<string, []>("op_2666_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_2666_cast_fp16 = einsum(equation = var_2666_equation_0, values = (var_2396_cast_fp16, var_2602_cast_fp16))[name = tensor<string, []>("op_2666_cast_fp16")];
            tensor<bool, []> x_55_interleave_0 = const()[name = tensor<string, []>("x_55_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 2048, 1, 64]> x_55_cast_fp16 = concat(axis = var_1879, interleave = x_55_interleave_0, values = (var_2604_cast_fp16, var_2606_cast_fp16, var_2608_cast_fp16, var_2610_cast_fp16, var_2612_cast_fp16, var_2614_cast_fp16, var_2616_cast_fp16, var_2618_cast_fp16, var_2620_cast_fp16, var_2622_cast_fp16, var_2624_cast_fp16, var_2626_cast_fp16, var_2628_cast_fp16, var_2630_cast_fp16, var_2632_cast_fp16, var_2634_cast_fp16, var_2636_cast_fp16, var_2638_cast_fp16, var_2640_cast_fp16, var_2642_cast_fp16, var_2644_cast_fp16, var_2646_cast_fp16, var_2648_cast_fp16, var_2650_cast_fp16, var_2652_cast_fp16, var_2654_cast_fp16, var_2656_cast_fp16, var_2658_cast_fp16, var_2660_cast_fp16, var_2662_cast_fp16, var_2664_cast_fp16, var_2666_cast_fp16))[name = tensor<string, []>("x_55_cast_fp16")];
            tensor<int32, [4]> var_2671 = const()[name = tensor<string, []>("op_2671"), val = tensor<int32, [4]>([1, 2048, -1, 8])];
            tensor<fp16, [1, 2048, 8, 8]> input_23_cast_fp16 = reshape(shape = var_2671, x = x_55_cast_fp16)[name = tensor<string, []>("input_23_cast_fp16")];
            tensor<int32, [2]> var_2674 = const()[name = tensor<string, []>("op_2674"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2676 = const()[name = tensor<string, []>("op_2676"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> attention_output_5_pad_type_0 = const()[name = tensor<string, []>("attention_output_5_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> attention_output_5_pad_0 = const()[name = tensor<string, []>("attention_output_5_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_2_attn_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_attn_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(255875456)))];
            tensor<fp16, [1, 2048, 8, 8]> attention_output_5_cast_fp16 = conv(dilations = var_2676, groups = var_1879, pad = attention_output_5_pad_0, pad_type = attention_output_5_pad_type_0, strides = var_2674, weight = blocks_2_attn_proj_weight_to_fp16, x = input_23_cast_fp16)[name = tensor<string, []>("attention_output_5_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_57_cast_fp16 = add(x = attention_output_5_cast_fp16, y = x_41_cast_fp16)[name = tensor<string, []>("x_57_cast_fp16")];
            tensor<bool, []> x_eps_11_interleave_0 = const()[name = tensor<string, []>("x_eps_11_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_11_to_fp16 = const()[name = tensor<string, []>("eps_chan_11_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(264264128)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_11_cast_fp16 = concat(axis = var_1879, interleave = x_eps_11_interleave_0, values = (x_57_cast_fp16, eps_chan_11_to_fp16))[name = tensor<string, []>("x_eps_11_cast_fp16")];
            tensor<int32, [1]> norm_x_11_axes_0 = const()[name = tensor<string, []>("norm_x_11_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_11_cast_fp16 = reduce_l2_norm(axes = norm_x_11_axes_0, keep_dims = var_1882, x = x_eps_11_cast_fp16)[name = tensor<string, []>("norm_x_11_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_31_cast_fp16 = real_div(x = x_57_cast_fp16, y = norm_x_11_cast_fp16)[name = tensor<string, []>("x_normed_31_cast_fp16")];
            tensor<fp16, []> var_2702_to_fp16 = const()[name = tensor<string, []>("op_2702_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_33_cast_fp16 = mul(x = x_normed_31_cast_fp16, y = var_2702_to_fp16)[name = tensor<string, []>("x_normed_33_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_2_norm_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_norm_2_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(264264320)))];
            tensor<fp16, [1, 2048, 8, 8]> input_25_cast_fp16 = mul(x = x_normed_33_cast_fp16, y = blocks_2_norm_2_weight_to_fp16)[name = tensor<string, []>("input_25_cast_fp16")];
            tensor<int32, [2]> var_2713 = const()[name = tensor<string, []>("op_2713"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2715 = const()[name = tensor<string, []>("op_2715"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> input_27_pad_type_0 = const()[name = tensor<string, []>("input_27_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> input_27_pad_0 = const()[name = tensor<string, []>("input_27_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_2_mlp_fc_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_mlp_fc_1_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(264268480)))];
            tensor<fp16, [1, 8192, 8, 8]> input_27_cast_fp16 = conv(dilations = var_2715, groups = var_1879, pad = input_27_pad_0, pad_type = input_27_pad_type_0, strides = var_2713, weight = blocks_2_mlp_fc_1_weight_to_fp16, x = input_25_cast_fp16)[name = tensor<string, []>("input_27_cast_fp16")];
            tensor<int32, [2]> var_2719 = const()[name = tensor<string, []>("op_2719"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2721 = const()[name = tensor<string, []>("op_2721"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> x_fc_2_5_pad_type_0 = const()[name = tensor<string, []>("x_fc_2_5_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> x_fc_2_5_pad_0 = const()[name = tensor<string, []>("x_fc_2_5_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_2_mlp_fc_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_mlp_fc_2_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(297822976)))];
            tensor<fp16, [1, 8192, 8, 8]> x_fc_2_5_cast_fp16 = conv(dilations = var_2721, groups = var_1879, pad = x_fc_2_5_pad_0, pad_type = x_fc_2_5_pad_type_0, strides = var_2719, weight = blocks_2_mlp_fc_2_weight_to_fp16, x = input_25_cast_fp16)[name = tensor<string, []>("x_fc_2_5_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> var_2724_cast_fp16 = silu(x = input_27_cast_fp16)[name = tensor<string, []>("op_2724_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> input_29_cast_fp16 = mul(x = var_2724_cast_fp16, y = x_fc_2_5_cast_fp16)[name = tensor<string, []>("input_29_cast_fp16")];
            tensor<int32, [2]> var_2727 = const()[name = tensor<string, []>("op_2727"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2729 = const()[name = tensor<string, []>("op_2729"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> var_2731_pad_type_0 = const()[name = tensor<string, []>("op_2731_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> var_2731_pad_0 = const()[name = tensor<string, []>("op_2731_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 8192, 1, 1]> blocks_2_mlp_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_2_mlp_proj_weight_to_fp16"), val = tensor<fp16, [2048, 8192, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(331377472)))];
            tensor<fp16, [1, 2048, 8, 8]> var_2731_cast_fp16 = conv(dilations = var_2729, groups = var_1879, pad = var_2731_pad_0, pad_type = var_2731_pad_type_0, strides = var_2727, weight = blocks_2_mlp_proj_weight_to_fp16, x = input_29_cast_fp16)[name = tensor<string, []>("op_2731_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_61_cast_fp16 = add(x = var_2731_cast_fp16, y = x_57_cast_fp16)[name = tensor<string, []>("x_61_cast_fp16")];
            tensor<int32, []> var_2737 = const()[name = tensor<string, []>("op_2737"), val = tensor<int32, []>(-1)];
            tensor<int32, []> var_2741 = const()[name = tensor<string, []>("op_2741"), val = tensor<int32, []>(-2)];
            tensor<int32, []> var_2743 = const()[name = tensor<string, []>("op_2743"), val = tensor<int32, []>(-3)];
            tensor<int32, []> var_2785 = const()[name = tensor<string, []>("op_2785"), val = tensor<int32, []>(1)];
            tensor<bool, []> var_2788 = const()[name = tensor<string, []>("op_2788"), val = tensor<bool, []>(true)];
            tensor<bool, []> x_eps_13_interleave_0 = const()[name = tensor<string, []>("x_eps_13_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_13_to_fp16 = const()[name = tensor<string, []>("eps_chan_13_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(364931968)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_13_cast_fp16 = concat(axis = var_2785, interleave = x_eps_13_interleave_0, values = (x_61_cast_fp16, eps_chan_13_to_fp16))[name = tensor<string, []>("x_eps_13_cast_fp16")];
            tensor<int32, [1]> norm_x_13_axes_0 = const()[name = tensor<string, []>("norm_x_13_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_13_cast_fp16 = reduce_l2_norm(axes = norm_x_13_axes_0, keep_dims = var_2788, x = x_eps_13_cast_fp16)[name = tensor<string, []>("norm_x_13_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_37_cast_fp16 = real_div(x = x_61_cast_fp16, y = norm_x_13_cast_fp16)[name = tensor<string, []>("x_normed_37_cast_fp16")];
            tensor<fp16, []> var_2811_to_fp16 = const()[name = tensor<string, []>("op_2811_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_39_cast_fp16 = mul(x = x_normed_37_cast_fp16, y = var_2811_to_fp16)[name = tensor<string, []>("x_normed_39_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_3_norm_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_norm_1_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(364932160)))];
            tensor<fp16, [1, 2048, 8, 8]> x_65_cast_fp16 = mul(x = x_normed_39_cast_fp16, y = blocks_3_norm_1_weight_to_fp16)[name = tensor<string, []>("x_65_cast_fp16")];
            tensor<int32, [4]> var_2835 = const()[name = tensor<string, []>("op_2835"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> input_31_cast_fp16 = reshape(shape = var_2835, x = x_65_cast_fp16)[name = tensor<string, []>("input_31_cast_fp16")];
            tensor<int32, [2]> var_2838 = const()[name = tensor<string, []>("op_2838"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2840 = const()[name = tensor<string, []>("op_2840"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> q_25_pad_type_0 = const()[name = tensor<string, []>("q_25_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> q_25_pad_0 = const()[name = tensor<string, []>("q_25_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_3_attn_q_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_attn_q_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(364936320)))];
            tensor<fp16, [1, 2048, 1, 64]> q_25_cast_fp16 = conv(dilations = var_2840, groups = var_2785, pad = q_25_pad_0, pad_type = q_25_pad_type_0, strides = var_2838, weight = blocks_3_attn_q_proj_weight_to_fp16, x = input_31_cast_fp16)[name = tensor<string, []>("q_25_cast_fp16")];
            tensor<int32, [2]> var_2844 = const()[name = tensor<string, []>("op_2844"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2846 = const()[name = tensor<string, []>("op_2846"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> k_37_pad_type_0 = const()[name = tensor<string, []>("k_37_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> k_37_pad_0 = const()[name = tensor<string, []>("k_37_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_3_attn_k_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_attn_k_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(373324992)))];
            tensor<fp16, [1, 512, 1, 64]> k_37_cast_fp16 = conv(dilations = var_2846, groups = var_2785, pad = k_37_pad_0, pad_type = k_37_pad_type_0, strides = var_2844, weight = blocks_3_attn_k_proj_weight_to_fp16, x = input_31_cast_fp16)[name = tensor<string, []>("k_37_cast_fp16")];
            tensor<int32, [2]> var_2850 = const()[name = tensor<string, []>("op_2850"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_2852 = const()[name = tensor<string, []>("op_2852"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> v_31_pad_type_0 = const()[name = tensor<string, []>("v_31_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> v_31_pad_0 = const()[name = tensor<string, []>("v_31_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [512, 2048, 1, 1]> blocks_3_attn_v_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_attn_v_proj_weight_to_fp16"), val = tensor<fp16, [512, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(375422208)))];
            tensor<fp16, [1, 512, 1, 64]> v_31_cast_fp16 = conv(dilations = var_2852, groups = var_2785, pad = v_31_pad_0, pad_type = v_31_pad_type_0, strides = var_2850, weight = blocks_3_attn_v_proj_weight_to_fp16, x = input_31_cast_fp16)[name = tensor<string, []>("v_31_cast_fp16")];
            tensor<int32, [4]> var_2855 = const()[name = tensor<string, []>("op_2855"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<fp16, [1, 32, 64, 64]> q_27_cast_fp16 = reshape(shape = var_2855, x = q_25_cast_fp16)[name = tensor<string, []>("q_27_cast_fp16")];
            tensor<int32, [4]> var_2857 = const()[name = tensor<string, []>("op_2857"), val = tensor<int32, [4]>([1, -1, 64, 64])];
            tensor<fp16, [1, 8, 64, 64]> k_39_cast_fp16 = reshape(shape = var_2857, x = k_37_cast_fp16)[name = tensor<string, []>("k_39_cast_fp16")];
            tensor<int32, [4]> var_2871_begin_0 = const()[name = tensor<string, []>("op_2871_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2871_end_0 = const()[name = tensor<string, []>("op_2871_end_0"), val = tensor<int32, [4]>([1, 32, 32, 64])];
            tensor<bool, [4]> var_2871_end_mask_0 = const()[name = tensor<string, []>("op_2871_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 32, 32, 64]> var_2871_cast_fp16 = slice_by_index(begin = var_2871_begin_0, end = var_2871_end_0, end_mask = var_2871_end_mask_0, x = q_27_cast_fp16)[name = tensor<string, []>("op_2871_cast_fp16")];
            tensor<int32, [4]> var_2877_begin_0 = const()[name = tensor<string, []>("op_2877_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_2877_end_0 = const()[name = tensor<string, []>("op_2877_end_0"), val = tensor<int32, [4]>([1, 32, 64, 64])];
            tensor<bool, [4]> var_2877_end_mask_0 = const()[name = tensor<string, []>("op_2877_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 32, 32, 64]> var_2877_cast_fp16 = slice_by_index(begin = var_2877_begin_0, end = var_2877_end_0, end_mask = var_2877_end_mask_0, x = q_27_cast_fp16)[name = tensor<string, []>("op_2877_cast_fp16")];
            tensor<fp16, []> const_70_promoted_to_fp16 = const()[name = tensor<string, []>("const_70_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 32, 32, 64]> var_2879_cast_fp16 = mul(x = var_2877_cast_fp16, y = const_70_promoted_to_fp16)[name = tensor<string, []>("op_2879_cast_fp16")];
            tensor<bool, []> rotated_13_interleave_0 = const()[name = tensor<string, []>("rotated_13_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 32, 64, 64]> rotated_13_cast_fp16 = concat(axis = var_2741, interleave = rotated_13_interleave_0, values = (var_2879_cast_fp16, var_2871_cast_fp16))[name = tensor<string, []>("rotated_13_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_2882_cast_fp16 = mul(x = q_27_cast_fp16, y = cos)[name = tensor<string, []>("op_2882_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> var_2883_cast_fp16 = mul(x = rotated_13_cast_fp16, y = sin)[name = tensor<string, []>("op_2883_cast_fp16")];
            tensor<fp16, [1, 32, 64, 64]> roped_13_cast_fp16 = add(x = var_2882_cast_fp16, y = var_2883_cast_fp16)[name = tensor<string, []>("roped_13_cast_fp16")];
            tensor<int32, [4]> var_2896_begin_0 = const()[name = tensor<string, []>("op_2896_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2896_end_0 = const()[name = tensor<string, []>("op_2896_end_0"), val = tensor<int32, [4]>([1, 8, 32, 64])];
            tensor<bool, [4]> var_2896_end_mask_0 = const()[name = tensor<string, []>("op_2896_end_mask_0"), val = tensor<bool, [4]>([true, true, false, true])];
            tensor<fp16, [1, 8, 32, 64]> var_2896_cast_fp16 = slice_by_index(begin = var_2896_begin_0, end = var_2896_end_0, end_mask = var_2896_end_mask_0, x = k_39_cast_fp16)[name = tensor<string, []>("op_2896_cast_fp16")];
            tensor<int32, [4]> var_2902_begin_0 = const()[name = tensor<string, []>("op_2902_begin_0"), val = tensor<int32, [4]>([0, 0, 32, 0])];
            tensor<int32, [4]> var_2902_end_0 = const()[name = tensor<string, []>("op_2902_end_0"), val = tensor<int32, [4]>([1, 8, 64, 64])];
            tensor<bool, [4]> var_2902_end_mask_0 = const()[name = tensor<string, []>("op_2902_end_mask_0"), val = tensor<bool, [4]>([true, true, true, true])];
            tensor<fp16, [1, 8, 32, 64]> var_2902_cast_fp16 = slice_by_index(begin = var_2902_begin_0, end = var_2902_end_0, end_mask = var_2902_end_mask_0, x = k_39_cast_fp16)[name = tensor<string, []>("op_2902_cast_fp16")];
            tensor<fp16, []> const_72_promoted_to_fp16 = const()[name = tensor<string, []>("const_72_promoted_to_fp16"), val = tensor<fp16, []>(-0x1p+0)];
            tensor<fp16, [1, 8, 32, 64]> var_2904_cast_fp16 = mul(x = var_2902_cast_fp16, y = const_72_promoted_to_fp16)[name = tensor<string, []>("op_2904_cast_fp16")];
            tensor<bool, []> rotated_interleave_0 = const()[name = tensor<string, []>("rotated_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 8, 64, 64]> rotated_cast_fp16 = concat(axis = var_2741, interleave = rotated_interleave_0, values = (var_2904_cast_fp16, var_2896_cast_fp16))[name = tensor<string, []>("rotated_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_2907_cast_fp16 = mul(x = k_39_cast_fp16, y = cos)[name = tensor<string, []>("op_2907_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> var_2908_cast_fp16 = mul(x = rotated_cast_fp16, y = sin)[name = tensor<string, []>("op_2908_cast_fp16")];
            tensor<fp16, [1, 8, 64, 64]> roped_cast_fp16 = add(x = var_2907_cast_fp16, y = var_2908_cast_fp16)[name = tensor<string, []>("roped_cast_fp16")];
            tensor<int32, [4]> var_2911 = const()[name = tensor<string, []>("op_2911"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> k_43_cast_fp16 = reshape(shape = var_2911, x = roped_cast_fp16)[name = tensor<string, []>("k_43_cast_fp16")];
            tensor<int32, [4]> var_2913 = const()[name = tensor<string, []>("op_2913"), val = tensor<int32, [4]>([1, -1, 1, 64])];
            tensor<fp16, [1, 512, 1, 64]> new_v_cache_3 = reshape(shape = var_2913, x = v_31_cast_fp16)[name = tensor<string, []>("new_v_cache_3_type_fp32_cast_fp16")];
            tensor<int32, [4]> k_45_perm_0 = const()[name = tensor<string, []>("k_45_perm_0"), val = tensor<int32, [4]>([0, -1, 2, -3])];
            tensor<bool, []> k_interleave_0 = const()[name = tensor<string, []>("k_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 64, 1, 512]> new_k_cache_3 = transpose(perm = k_45_perm_0, x = k_43_cast_fp16)[name = tensor<string, []>("transpose_0")];
            tensor<fp16, [1, 512, 1, 512]> k_cast_fp16 = concat(axis = var_2743, interleave = k_interleave_0, values = (k_cache_3, new_k_cache_3))[name = tensor<string, []>("k_cast_fp16")];
            tensor<bool, []> v_37_interleave_0 = const()[name = tensor<string, []>("v_37_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 512, 1, 512]> v_37_cast_fp16 = concat(axis = var_2737, interleave = v_37_interleave_0, values = (v_cache_3, new_v_cache_3))[name = tensor<string, []>("v_37_cast_fp16")];
            tensor<int32, [4]> var_2929 = const()[name = tensor<string, []>("op_2929"), val = tensor<int32, [4]>([1, 2048, 1, -1])];
            tensor<fp16, [1, 2048, 1, 64]> q_cast_fp16 = reshape(shape = var_2929, x = roped_13_cast_fp16)[name = tensor<string, []>("q_cast_fp16")];
            tensor<int32, [4]> var_2934_begin_0 = const()[name = tensor<string, []>("op_2934_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_2934_end_0 = const()[name = tensor<string, []>("op_2934_end_0"), val = tensor<int32, [4]>([1, 64, 1, 64])];
            tensor<bool, [4]> var_2934_end_mask_0 = const()[name = tensor<string, []>("op_2934_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2934_cast_fp16 = slice_by_index(begin = var_2934_begin_0, end = var_2934_end_0, end_mask = var_2934_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2934_cast_fp16")];
            tensor<int32, [4]> var_2938_begin_0 = const()[name = tensor<string, []>("op_2938_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_2938_end_0 = const()[name = tensor<string, []>("op_2938_end_0"), val = tensor<int32, [4]>([1, 128, 1, 64])];
            tensor<bool, [4]> var_2938_end_mask_0 = const()[name = tensor<string, []>("op_2938_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2938_cast_fp16 = slice_by_index(begin = var_2938_begin_0, end = var_2938_end_0, end_mask = var_2938_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2938_cast_fp16")];
            tensor<int32, [4]> var_2942_begin_0 = const()[name = tensor<string, []>("op_2942_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_2942_end_0 = const()[name = tensor<string, []>("op_2942_end_0"), val = tensor<int32, [4]>([1, 192, 1, 64])];
            tensor<bool, [4]> var_2942_end_mask_0 = const()[name = tensor<string, []>("op_2942_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2942_cast_fp16 = slice_by_index(begin = var_2942_begin_0, end = var_2942_end_0, end_mask = var_2942_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2942_cast_fp16")];
            tensor<int32, [4]> var_2946_begin_0 = const()[name = tensor<string, []>("op_2946_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_2946_end_0 = const()[name = tensor<string, []>("op_2946_end_0"), val = tensor<int32, [4]>([1, 256, 1, 64])];
            tensor<bool, [4]> var_2946_end_mask_0 = const()[name = tensor<string, []>("op_2946_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2946_cast_fp16 = slice_by_index(begin = var_2946_begin_0, end = var_2946_end_0, end_mask = var_2946_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2946_cast_fp16")];
            tensor<int32, [4]> var_2950_begin_0 = const()[name = tensor<string, []>("op_2950_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_2950_end_0 = const()[name = tensor<string, []>("op_2950_end_0"), val = tensor<int32, [4]>([1, 320, 1, 64])];
            tensor<bool, [4]> var_2950_end_mask_0 = const()[name = tensor<string, []>("op_2950_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2950_cast_fp16 = slice_by_index(begin = var_2950_begin_0, end = var_2950_end_0, end_mask = var_2950_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2950_cast_fp16")];
            tensor<int32, [4]> var_2954_begin_0 = const()[name = tensor<string, []>("op_2954_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_2954_end_0 = const()[name = tensor<string, []>("op_2954_end_0"), val = tensor<int32, [4]>([1, 384, 1, 64])];
            tensor<bool, [4]> var_2954_end_mask_0 = const()[name = tensor<string, []>("op_2954_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2954_cast_fp16 = slice_by_index(begin = var_2954_begin_0, end = var_2954_end_0, end_mask = var_2954_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2954_cast_fp16")];
            tensor<int32, [4]> var_2958_begin_0 = const()[name = tensor<string, []>("op_2958_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_2958_end_0 = const()[name = tensor<string, []>("op_2958_end_0"), val = tensor<int32, [4]>([1, 448, 1, 64])];
            tensor<bool, [4]> var_2958_end_mask_0 = const()[name = tensor<string, []>("op_2958_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2958_cast_fp16 = slice_by_index(begin = var_2958_begin_0, end = var_2958_end_0, end_mask = var_2958_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2958_cast_fp16")];
            tensor<int32, [4]> var_2962_begin_0 = const()[name = tensor<string, []>("op_2962_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_2962_end_0 = const()[name = tensor<string, []>("op_2962_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_2962_end_mask_0 = const()[name = tensor<string, []>("op_2962_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2962_cast_fp16 = slice_by_index(begin = var_2962_begin_0, end = var_2962_end_0, end_mask = var_2962_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2962_cast_fp16")];
            tensor<int32, [4]> var_2966_begin_0 = const()[name = tensor<string, []>("op_2966_begin_0"), val = tensor<int32, [4]>([0, 512, 0, 0])];
            tensor<int32, [4]> var_2966_end_0 = const()[name = tensor<string, []>("op_2966_end_0"), val = tensor<int32, [4]>([1, 576, 1, 64])];
            tensor<bool, [4]> var_2966_end_mask_0 = const()[name = tensor<string, []>("op_2966_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2966_cast_fp16 = slice_by_index(begin = var_2966_begin_0, end = var_2966_end_0, end_mask = var_2966_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2966_cast_fp16")];
            tensor<int32, [4]> var_2970_begin_0 = const()[name = tensor<string, []>("op_2970_begin_0"), val = tensor<int32, [4]>([0, 576, 0, 0])];
            tensor<int32, [4]> var_2970_end_0 = const()[name = tensor<string, []>("op_2970_end_0"), val = tensor<int32, [4]>([1, 640, 1, 64])];
            tensor<bool, [4]> var_2970_end_mask_0 = const()[name = tensor<string, []>("op_2970_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2970_cast_fp16 = slice_by_index(begin = var_2970_begin_0, end = var_2970_end_0, end_mask = var_2970_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2970_cast_fp16")];
            tensor<int32, [4]> var_2974_begin_0 = const()[name = tensor<string, []>("op_2974_begin_0"), val = tensor<int32, [4]>([0, 640, 0, 0])];
            tensor<int32, [4]> var_2974_end_0 = const()[name = tensor<string, []>("op_2974_end_0"), val = tensor<int32, [4]>([1, 704, 1, 64])];
            tensor<bool, [4]> var_2974_end_mask_0 = const()[name = tensor<string, []>("op_2974_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2974_cast_fp16 = slice_by_index(begin = var_2974_begin_0, end = var_2974_end_0, end_mask = var_2974_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2974_cast_fp16")];
            tensor<int32, [4]> var_2978_begin_0 = const()[name = tensor<string, []>("op_2978_begin_0"), val = tensor<int32, [4]>([0, 704, 0, 0])];
            tensor<int32, [4]> var_2978_end_0 = const()[name = tensor<string, []>("op_2978_end_0"), val = tensor<int32, [4]>([1, 768, 1, 64])];
            tensor<bool, [4]> var_2978_end_mask_0 = const()[name = tensor<string, []>("op_2978_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2978_cast_fp16 = slice_by_index(begin = var_2978_begin_0, end = var_2978_end_0, end_mask = var_2978_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2978_cast_fp16")];
            tensor<int32, [4]> var_2982_begin_0 = const()[name = tensor<string, []>("op_2982_begin_0"), val = tensor<int32, [4]>([0, 768, 0, 0])];
            tensor<int32, [4]> var_2982_end_0 = const()[name = tensor<string, []>("op_2982_end_0"), val = tensor<int32, [4]>([1, 832, 1, 64])];
            tensor<bool, [4]> var_2982_end_mask_0 = const()[name = tensor<string, []>("op_2982_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2982_cast_fp16 = slice_by_index(begin = var_2982_begin_0, end = var_2982_end_0, end_mask = var_2982_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2982_cast_fp16")];
            tensor<int32, [4]> var_2986_begin_0 = const()[name = tensor<string, []>("op_2986_begin_0"), val = tensor<int32, [4]>([0, 832, 0, 0])];
            tensor<int32, [4]> var_2986_end_0 = const()[name = tensor<string, []>("op_2986_end_0"), val = tensor<int32, [4]>([1, 896, 1, 64])];
            tensor<bool, [4]> var_2986_end_mask_0 = const()[name = tensor<string, []>("op_2986_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2986_cast_fp16 = slice_by_index(begin = var_2986_begin_0, end = var_2986_end_0, end_mask = var_2986_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2986_cast_fp16")];
            tensor<int32, [4]> var_2990_begin_0 = const()[name = tensor<string, []>("op_2990_begin_0"), val = tensor<int32, [4]>([0, 896, 0, 0])];
            tensor<int32, [4]> var_2990_end_0 = const()[name = tensor<string, []>("op_2990_end_0"), val = tensor<int32, [4]>([1, 960, 1, 64])];
            tensor<bool, [4]> var_2990_end_mask_0 = const()[name = tensor<string, []>("op_2990_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2990_cast_fp16 = slice_by_index(begin = var_2990_begin_0, end = var_2990_end_0, end_mask = var_2990_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2990_cast_fp16")];
            tensor<int32, [4]> var_2994_begin_0 = const()[name = tensor<string, []>("op_2994_begin_0"), val = tensor<int32, [4]>([0, 960, 0, 0])];
            tensor<int32, [4]> var_2994_end_0 = const()[name = tensor<string, []>("op_2994_end_0"), val = tensor<int32, [4]>([1, 1024, 1, 64])];
            tensor<bool, [4]> var_2994_end_mask_0 = const()[name = tensor<string, []>("op_2994_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2994_cast_fp16 = slice_by_index(begin = var_2994_begin_0, end = var_2994_end_0, end_mask = var_2994_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2994_cast_fp16")];
            tensor<int32, [4]> var_2998_begin_0 = const()[name = tensor<string, []>("op_2998_begin_0"), val = tensor<int32, [4]>([0, 1024, 0, 0])];
            tensor<int32, [4]> var_2998_end_0 = const()[name = tensor<string, []>("op_2998_end_0"), val = tensor<int32, [4]>([1, 1088, 1, 64])];
            tensor<bool, [4]> var_2998_end_mask_0 = const()[name = tensor<string, []>("op_2998_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_2998_cast_fp16 = slice_by_index(begin = var_2998_begin_0, end = var_2998_end_0, end_mask = var_2998_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_2998_cast_fp16")];
            tensor<int32, [4]> var_3002_begin_0 = const()[name = tensor<string, []>("op_3002_begin_0"), val = tensor<int32, [4]>([0, 1088, 0, 0])];
            tensor<int32, [4]> var_3002_end_0 = const()[name = tensor<string, []>("op_3002_end_0"), val = tensor<int32, [4]>([1, 1152, 1, 64])];
            tensor<bool, [4]> var_3002_end_mask_0 = const()[name = tensor<string, []>("op_3002_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3002_cast_fp16 = slice_by_index(begin = var_3002_begin_0, end = var_3002_end_0, end_mask = var_3002_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3002_cast_fp16")];
            tensor<int32, [4]> var_3006_begin_0 = const()[name = tensor<string, []>("op_3006_begin_0"), val = tensor<int32, [4]>([0, 1152, 0, 0])];
            tensor<int32, [4]> var_3006_end_0 = const()[name = tensor<string, []>("op_3006_end_0"), val = tensor<int32, [4]>([1, 1216, 1, 64])];
            tensor<bool, [4]> var_3006_end_mask_0 = const()[name = tensor<string, []>("op_3006_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3006_cast_fp16 = slice_by_index(begin = var_3006_begin_0, end = var_3006_end_0, end_mask = var_3006_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3006_cast_fp16")];
            tensor<int32, [4]> var_3010_begin_0 = const()[name = tensor<string, []>("op_3010_begin_0"), val = tensor<int32, [4]>([0, 1216, 0, 0])];
            tensor<int32, [4]> var_3010_end_0 = const()[name = tensor<string, []>("op_3010_end_0"), val = tensor<int32, [4]>([1, 1280, 1, 64])];
            tensor<bool, [4]> var_3010_end_mask_0 = const()[name = tensor<string, []>("op_3010_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3010_cast_fp16 = slice_by_index(begin = var_3010_begin_0, end = var_3010_end_0, end_mask = var_3010_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3010_cast_fp16")];
            tensor<int32, [4]> var_3014_begin_0 = const()[name = tensor<string, []>("op_3014_begin_0"), val = tensor<int32, [4]>([0, 1280, 0, 0])];
            tensor<int32, [4]> var_3014_end_0 = const()[name = tensor<string, []>("op_3014_end_0"), val = tensor<int32, [4]>([1, 1344, 1, 64])];
            tensor<bool, [4]> var_3014_end_mask_0 = const()[name = tensor<string, []>("op_3014_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3014_cast_fp16 = slice_by_index(begin = var_3014_begin_0, end = var_3014_end_0, end_mask = var_3014_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3014_cast_fp16")];
            tensor<int32, [4]> var_3018_begin_0 = const()[name = tensor<string, []>("op_3018_begin_0"), val = tensor<int32, [4]>([0, 1344, 0, 0])];
            tensor<int32, [4]> var_3018_end_0 = const()[name = tensor<string, []>("op_3018_end_0"), val = tensor<int32, [4]>([1, 1408, 1, 64])];
            tensor<bool, [4]> var_3018_end_mask_0 = const()[name = tensor<string, []>("op_3018_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3018_cast_fp16 = slice_by_index(begin = var_3018_begin_0, end = var_3018_end_0, end_mask = var_3018_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3018_cast_fp16")];
            tensor<int32, [4]> var_3022_begin_0 = const()[name = tensor<string, []>("op_3022_begin_0"), val = tensor<int32, [4]>([0, 1408, 0, 0])];
            tensor<int32, [4]> var_3022_end_0 = const()[name = tensor<string, []>("op_3022_end_0"), val = tensor<int32, [4]>([1, 1472, 1, 64])];
            tensor<bool, [4]> var_3022_end_mask_0 = const()[name = tensor<string, []>("op_3022_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3022_cast_fp16 = slice_by_index(begin = var_3022_begin_0, end = var_3022_end_0, end_mask = var_3022_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3022_cast_fp16")];
            tensor<int32, [4]> var_3026_begin_0 = const()[name = tensor<string, []>("op_3026_begin_0"), val = tensor<int32, [4]>([0, 1472, 0, 0])];
            tensor<int32, [4]> var_3026_end_0 = const()[name = tensor<string, []>("op_3026_end_0"), val = tensor<int32, [4]>([1, 1536, 1, 64])];
            tensor<bool, [4]> var_3026_end_mask_0 = const()[name = tensor<string, []>("op_3026_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3026_cast_fp16 = slice_by_index(begin = var_3026_begin_0, end = var_3026_end_0, end_mask = var_3026_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3026_cast_fp16")];
            tensor<int32, [4]> var_3030_begin_0 = const()[name = tensor<string, []>("op_3030_begin_0"), val = tensor<int32, [4]>([0, 1536, 0, 0])];
            tensor<int32, [4]> var_3030_end_0 = const()[name = tensor<string, []>("op_3030_end_0"), val = tensor<int32, [4]>([1, 1600, 1, 64])];
            tensor<bool, [4]> var_3030_end_mask_0 = const()[name = tensor<string, []>("op_3030_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3030_cast_fp16 = slice_by_index(begin = var_3030_begin_0, end = var_3030_end_0, end_mask = var_3030_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3030_cast_fp16")];
            tensor<int32, [4]> var_3034_begin_0 = const()[name = tensor<string, []>("op_3034_begin_0"), val = tensor<int32, [4]>([0, 1600, 0, 0])];
            tensor<int32, [4]> var_3034_end_0 = const()[name = tensor<string, []>("op_3034_end_0"), val = tensor<int32, [4]>([1, 1664, 1, 64])];
            tensor<bool, [4]> var_3034_end_mask_0 = const()[name = tensor<string, []>("op_3034_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3034_cast_fp16 = slice_by_index(begin = var_3034_begin_0, end = var_3034_end_0, end_mask = var_3034_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3034_cast_fp16")];
            tensor<int32, [4]> var_3038_begin_0 = const()[name = tensor<string, []>("op_3038_begin_0"), val = tensor<int32, [4]>([0, 1664, 0, 0])];
            tensor<int32, [4]> var_3038_end_0 = const()[name = tensor<string, []>("op_3038_end_0"), val = tensor<int32, [4]>([1, 1728, 1, 64])];
            tensor<bool, [4]> var_3038_end_mask_0 = const()[name = tensor<string, []>("op_3038_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3038_cast_fp16 = slice_by_index(begin = var_3038_begin_0, end = var_3038_end_0, end_mask = var_3038_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3038_cast_fp16")];
            tensor<int32, [4]> var_3042_begin_0 = const()[name = tensor<string, []>("op_3042_begin_0"), val = tensor<int32, [4]>([0, 1728, 0, 0])];
            tensor<int32, [4]> var_3042_end_0 = const()[name = tensor<string, []>("op_3042_end_0"), val = tensor<int32, [4]>([1, 1792, 1, 64])];
            tensor<bool, [4]> var_3042_end_mask_0 = const()[name = tensor<string, []>("op_3042_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3042_cast_fp16 = slice_by_index(begin = var_3042_begin_0, end = var_3042_end_0, end_mask = var_3042_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3042_cast_fp16")];
            tensor<int32, [4]> var_3046_begin_0 = const()[name = tensor<string, []>("op_3046_begin_0"), val = tensor<int32, [4]>([0, 1792, 0, 0])];
            tensor<int32, [4]> var_3046_end_0 = const()[name = tensor<string, []>("op_3046_end_0"), val = tensor<int32, [4]>([1, 1856, 1, 64])];
            tensor<bool, [4]> var_3046_end_mask_0 = const()[name = tensor<string, []>("op_3046_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3046_cast_fp16 = slice_by_index(begin = var_3046_begin_0, end = var_3046_end_0, end_mask = var_3046_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3046_cast_fp16")];
            tensor<int32, [4]> var_3050_begin_0 = const()[name = tensor<string, []>("op_3050_begin_0"), val = tensor<int32, [4]>([0, 1856, 0, 0])];
            tensor<int32, [4]> var_3050_end_0 = const()[name = tensor<string, []>("op_3050_end_0"), val = tensor<int32, [4]>([1, 1920, 1, 64])];
            tensor<bool, [4]> var_3050_end_mask_0 = const()[name = tensor<string, []>("op_3050_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3050_cast_fp16 = slice_by_index(begin = var_3050_begin_0, end = var_3050_end_0, end_mask = var_3050_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3050_cast_fp16")];
            tensor<int32, [4]> var_3054_begin_0 = const()[name = tensor<string, []>("op_3054_begin_0"), val = tensor<int32, [4]>([0, 1920, 0, 0])];
            tensor<int32, [4]> var_3054_end_0 = const()[name = tensor<string, []>("op_3054_end_0"), val = tensor<int32, [4]>([1, 1984, 1, 64])];
            tensor<bool, [4]> var_3054_end_mask_0 = const()[name = tensor<string, []>("op_3054_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3054_cast_fp16 = slice_by_index(begin = var_3054_begin_0, end = var_3054_end_0, end_mask = var_3054_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3054_cast_fp16")];
            tensor<int32, [4]> var_3058_begin_0 = const()[name = tensor<string, []>("op_3058_begin_0"), val = tensor<int32, [4]>([0, 1984, 0, 0])];
            tensor<int32, [4]> var_3058_end_0 = const()[name = tensor<string, []>("op_3058_end_0"), val = tensor<int32, [4]>([1, 2048, 1, 64])];
            tensor<bool, [4]> var_3058_end_mask_0 = const()[name = tensor<string, []>("op_3058_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 64]> var_3058_cast_fp16 = slice_by_index(begin = var_3058_begin_0, end = var_3058_end_0, end_mask = var_3058_end_mask_0, x = q_cast_fp16)[name = tensor<string, []>("op_3058_cast_fp16")];
            tensor<int32, [4]> var_3064_begin_0 = const()[name = tensor<string, []>("op_3064_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_3064_end_0 = const()[name = tensor<string, []>("op_3064_end_0"), val = tensor<int32, [4]>([1, 512, 1, 64])];
            tensor<bool, [4]> var_3064_end_mask_0 = const()[name = tensor<string, []>("op_3064_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3064_cast_fp16 = slice_by_index(begin = var_3064_begin_0, end = var_3064_end_0, end_mask = var_3064_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3064_cast_fp16")];
            tensor<int32, [4]> var_3080_begin_0 = const()[name = tensor<string, []>("op_3080_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 64])];
            tensor<int32, [4]> var_3080_end_0 = const()[name = tensor<string, []>("op_3080_end_0"), val = tensor<int32, [4]>([1, 512, 1, 128])];
            tensor<bool, [4]> var_3080_end_mask_0 = const()[name = tensor<string, []>("op_3080_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3080_cast_fp16 = slice_by_index(begin = var_3080_begin_0, end = var_3080_end_0, end_mask = var_3080_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3080_cast_fp16")];
            tensor<int32, [4]> var_3096_begin_0 = const()[name = tensor<string, []>("op_3096_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 128])];
            tensor<int32, [4]> var_3096_end_0 = const()[name = tensor<string, []>("op_3096_end_0"), val = tensor<int32, [4]>([1, 512, 1, 192])];
            tensor<bool, [4]> var_3096_end_mask_0 = const()[name = tensor<string, []>("op_3096_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3096_cast_fp16 = slice_by_index(begin = var_3096_begin_0, end = var_3096_end_0, end_mask = var_3096_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3096_cast_fp16")];
            tensor<int32, [4]> var_3112_begin_0 = const()[name = tensor<string, []>("op_3112_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 192])];
            tensor<int32, [4]> var_3112_end_0 = const()[name = tensor<string, []>("op_3112_end_0"), val = tensor<int32, [4]>([1, 512, 1, 256])];
            tensor<bool, [4]> var_3112_end_mask_0 = const()[name = tensor<string, []>("op_3112_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3112_cast_fp16 = slice_by_index(begin = var_3112_begin_0, end = var_3112_end_0, end_mask = var_3112_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3112_cast_fp16")];
            tensor<int32, [4]> var_3128_begin_0 = const()[name = tensor<string, []>("op_3128_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 256])];
            tensor<int32, [4]> var_3128_end_0 = const()[name = tensor<string, []>("op_3128_end_0"), val = tensor<int32, [4]>([1, 512, 1, 320])];
            tensor<bool, [4]> var_3128_end_mask_0 = const()[name = tensor<string, []>("op_3128_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3128_cast_fp16 = slice_by_index(begin = var_3128_begin_0, end = var_3128_end_0, end_mask = var_3128_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3128_cast_fp16")];
            tensor<int32, [4]> var_3144_begin_0 = const()[name = tensor<string, []>("op_3144_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 320])];
            tensor<int32, [4]> var_3144_end_0 = const()[name = tensor<string, []>("op_3144_end_0"), val = tensor<int32, [4]>([1, 512, 1, 384])];
            tensor<bool, [4]> var_3144_end_mask_0 = const()[name = tensor<string, []>("op_3144_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3144_cast_fp16 = slice_by_index(begin = var_3144_begin_0, end = var_3144_end_0, end_mask = var_3144_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3144_cast_fp16")];
            tensor<int32, [4]> var_3160_begin_0 = const()[name = tensor<string, []>("op_3160_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 384])];
            tensor<int32, [4]> var_3160_end_0 = const()[name = tensor<string, []>("op_3160_end_0"), val = tensor<int32, [4]>([1, 512, 1, 448])];
            tensor<bool, [4]> var_3160_end_mask_0 = const()[name = tensor<string, []>("op_3160_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3160_cast_fp16 = slice_by_index(begin = var_3160_begin_0, end = var_3160_end_0, end_mask = var_3160_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3160_cast_fp16")];
            tensor<int32, [4]> var_3176_begin_0 = const()[name = tensor<string, []>("op_3176_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 448])];
            tensor<int32, [4]> var_3176_end_0 = const()[name = tensor<string, []>("op_3176_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_3176_end_mask_0 = const()[name = tensor<string, []>("op_3176_end_mask_0"), val = tensor<bool, [4]>([true, true, true, false])];
            tensor<fp16, [1, 512, 1, 64]> var_3176_cast_fp16 = slice_by_index(begin = var_3176_begin_0, end = var_3176_end_0, end_mask = var_3176_end_mask_0, x = k_cast_fp16)[name = tensor<string, []>("op_3176_cast_fp16")];
            tensor<int32, [4]> var_3190_begin_0 = const()[name = tensor<string, []>("op_3190_begin_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<int32, [4]> var_3190_end_0 = const()[name = tensor<string, []>("op_3190_end_0"), val = tensor<int32, [4]>([1, 64, 1, 512])];
            tensor<bool, [4]> var_3190_end_mask_0 = const()[name = tensor<string, []>("op_3190_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3190_cast_fp16 = slice_by_index(begin = var_3190_begin_0, end = var_3190_end_0, end_mask = var_3190_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3190_cast_fp16")];
            tensor<int32, [4]> var_3206_begin_0 = const()[name = tensor<string, []>("op_3206_begin_0"), val = tensor<int32, [4]>([0, 64, 0, 0])];
            tensor<int32, [4]> var_3206_end_0 = const()[name = tensor<string, []>("op_3206_end_0"), val = tensor<int32, [4]>([1, 128, 1, 512])];
            tensor<bool, [4]> var_3206_end_mask_0 = const()[name = tensor<string, []>("op_3206_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3206_cast_fp16 = slice_by_index(begin = var_3206_begin_0, end = var_3206_end_0, end_mask = var_3206_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3206_cast_fp16")];
            tensor<int32, [4]> var_3222_begin_0 = const()[name = tensor<string, []>("op_3222_begin_0"), val = tensor<int32, [4]>([0, 128, 0, 0])];
            tensor<int32, [4]> var_3222_end_0 = const()[name = tensor<string, []>("op_3222_end_0"), val = tensor<int32, [4]>([1, 192, 1, 512])];
            tensor<bool, [4]> var_3222_end_mask_0 = const()[name = tensor<string, []>("op_3222_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3222_cast_fp16 = slice_by_index(begin = var_3222_begin_0, end = var_3222_end_0, end_mask = var_3222_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3222_cast_fp16")];
            tensor<int32, [4]> var_3238_begin_0 = const()[name = tensor<string, []>("op_3238_begin_0"), val = tensor<int32, [4]>([0, 192, 0, 0])];
            tensor<int32, [4]> var_3238_end_0 = const()[name = tensor<string, []>("op_3238_end_0"), val = tensor<int32, [4]>([1, 256, 1, 512])];
            tensor<bool, [4]> var_3238_end_mask_0 = const()[name = tensor<string, []>("op_3238_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3238_cast_fp16 = slice_by_index(begin = var_3238_begin_0, end = var_3238_end_0, end_mask = var_3238_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3238_cast_fp16")];
            tensor<int32, [4]> var_3254_begin_0 = const()[name = tensor<string, []>("op_3254_begin_0"), val = tensor<int32, [4]>([0, 256, 0, 0])];
            tensor<int32, [4]> var_3254_end_0 = const()[name = tensor<string, []>("op_3254_end_0"), val = tensor<int32, [4]>([1, 320, 1, 512])];
            tensor<bool, [4]> var_3254_end_mask_0 = const()[name = tensor<string, []>("op_3254_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3254_cast_fp16 = slice_by_index(begin = var_3254_begin_0, end = var_3254_end_0, end_mask = var_3254_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3254_cast_fp16")];
            tensor<int32, [4]> var_3270_begin_0 = const()[name = tensor<string, []>("op_3270_begin_0"), val = tensor<int32, [4]>([0, 320, 0, 0])];
            tensor<int32, [4]> var_3270_end_0 = const()[name = tensor<string, []>("op_3270_end_0"), val = tensor<int32, [4]>([1, 384, 1, 512])];
            tensor<bool, [4]> var_3270_end_mask_0 = const()[name = tensor<string, []>("op_3270_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3270_cast_fp16 = slice_by_index(begin = var_3270_begin_0, end = var_3270_end_0, end_mask = var_3270_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3270_cast_fp16")];
            tensor<int32, [4]> var_3286_begin_0 = const()[name = tensor<string, []>("op_3286_begin_0"), val = tensor<int32, [4]>([0, 384, 0, 0])];
            tensor<int32, [4]> var_3286_end_0 = const()[name = tensor<string, []>("op_3286_end_0"), val = tensor<int32, [4]>([1, 448, 1, 512])];
            tensor<bool, [4]> var_3286_end_mask_0 = const()[name = tensor<string, []>("op_3286_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3286_cast_fp16 = slice_by_index(begin = var_3286_begin_0, end = var_3286_end_0, end_mask = var_3286_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3286_cast_fp16")];
            tensor<int32, [4]> var_3302_begin_0 = const()[name = tensor<string, []>("op_3302_begin_0"), val = tensor<int32, [4]>([0, 448, 0, 0])];
            tensor<int32, [4]> var_3302_end_0 = const()[name = tensor<string, []>("op_3302_end_0"), val = tensor<int32, [4]>([1, 512, 1, 512])];
            tensor<bool, [4]> var_3302_end_mask_0 = const()[name = tensor<string, []>("op_3302_end_mask_0"), val = tensor<bool, [4]>([true, false, true, true])];
            tensor<fp16, [1, 64, 1, 512]> var_3302_cast_fp16 = slice_by_index(begin = var_3302_begin_0, end = var_3302_end_0, end_mask = var_3302_end_mask_0, x = v_37_cast_fp16)[name = tensor<string, []>("op_3302_cast_fp16")];
            tensor<string, []> var_3318_equation_0 = const()[name = tensor<string, []>("op_3318_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3318_cast_fp16 = einsum(equation = var_3318_equation_0, values = (var_3064_cast_fp16, var_2934_cast_fp16))[name = tensor<string, []>("op_3318_cast_fp16")];
            tensor<fp16, []> var_3319_to_fp16 = const()[name = tensor<string, []>("op_3319_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3320_cast_fp16 = mul(x = var_3318_cast_fp16, y = var_3319_to_fp16)[name = tensor<string, []>("op_3320_cast_fp16")];
            tensor<string, []> var_3322_equation_0 = const()[name = tensor<string, []>("op_3322_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3322_cast_fp16 = einsum(equation = var_3322_equation_0, values = (var_3064_cast_fp16, var_2938_cast_fp16))[name = tensor<string, []>("op_3322_cast_fp16")];
            tensor<fp16, []> var_3323_to_fp16 = const()[name = tensor<string, []>("op_3323_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3324_cast_fp16 = mul(x = var_3322_cast_fp16, y = var_3323_to_fp16)[name = tensor<string, []>("op_3324_cast_fp16")];
            tensor<string, []> var_3326_equation_0 = const()[name = tensor<string, []>("op_3326_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3326_cast_fp16 = einsum(equation = var_3326_equation_0, values = (var_3064_cast_fp16, var_2942_cast_fp16))[name = tensor<string, []>("op_3326_cast_fp16")];
            tensor<fp16, []> var_3327_to_fp16 = const()[name = tensor<string, []>("op_3327_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3328_cast_fp16 = mul(x = var_3326_cast_fp16, y = var_3327_to_fp16)[name = tensor<string, []>("op_3328_cast_fp16")];
            tensor<string, []> var_3330_equation_0 = const()[name = tensor<string, []>("op_3330_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3330_cast_fp16 = einsum(equation = var_3330_equation_0, values = (var_3064_cast_fp16, var_2946_cast_fp16))[name = tensor<string, []>("op_3330_cast_fp16")];
            tensor<fp16, []> var_3331_to_fp16 = const()[name = tensor<string, []>("op_3331_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3332_cast_fp16 = mul(x = var_3330_cast_fp16, y = var_3331_to_fp16)[name = tensor<string, []>("op_3332_cast_fp16")];
            tensor<string, []> var_3334_equation_0 = const()[name = tensor<string, []>("op_3334_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3334_cast_fp16 = einsum(equation = var_3334_equation_0, values = (var_3080_cast_fp16, var_2950_cast_fp16))[name = tensor<string, []>("op_3334_cast_fp16")];
            tensor<fp16, []> var_3335_to_fp16 = const()[name = tensor<string, []>("op_3335_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3336_cast_fp16 = mul(x = var_3334_cast_fp16, y = var_3335_to_fp16)[name = tensor<string, []>("op_3336_cast_fp16")];
            tensor<string, []> var_3338_equation_0 = const()[name = tensor<string, []>("op_3338_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3338_cast_fp16 = einsum(equation = var_3338_equation_0, values = (var_3080_cast_fp16, var_2954_cast_fp16))[name = tensor<string, []>("op_3338_cast_fp16")];
            tensor<fp16, []> var_3339_to_fp16 = const()[name = tensor<string, []>("op_3339_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3340_cast_fp16 = mul(x = var_3338_cast_fp16, y = var_3339_to_fp16)[name = tensor<string, []>("op_3340_cast_fp16")];
            tensor<string, []> var_3342_equation_0 = const()[name = tensor<string, []>("op_3342_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3342_cast_fp16 = einsum(equation = var_3342_equation_0, values = (var_3080_cast_fp16, var_2958_cast_fp16))[name = tensor<string, []>("op_3342_cast_fp16")];
            tensor<fp16, []> var_3343_to_fp16 = const()[name = tensor<string, []>("op_3343_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3344_cast_fp16 = mul(x = var_3342_cast_fp16, y = var_3343_to_fp16)[name = tensor<string, []>("op_3344_cast_fp16")];
            tensor<string, []> var_3346_equation_0 = const()[name = tensor<string, []>("op_3346_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3346_cast_fp16 = einsum(equation = var_3346_equation_0, values = (var_3080_cast_fp16, var_2962_cast_fp16))[name = tensor<string, []>("op_3346_cast_fp16")];
            tensor<fp16, []> var_3347_to_fp16 = const()[name = tensor<string, []>("op_3347_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3348_cast_fp16 = mul(x = var_3346_cast_fp16, y = var_3347_to_fp16)[name = tensor<string, []>("op_3348_cast_fp16")];
            tensor<string, []> var_3350_equation_0 = const()[name = tensor<string, []>("op_3350_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3350_cast_fp16 = einsum(equation = var_3350_equation_0, values = (var_3096_cast_fp16, var_2966_cast_fp16))[name = tensor<string, []>("op_3350_cast_fp16")];
            tensor<fp16, []> var_3351_to_fp16 = const()[name = tensor<string, []>("op_3351_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3352_cast_fp16 = mul(x = var_3350_cast_fp16, y = var_3351_to_fp16)[name = tensor<string, []>("op_3352_cast_fp16")];
            tensor<string, []> var_3354_equation_0 = const()[name = tensor<string, []>("op_3354_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3354_cast_fp16 = einsum(equation = var_3354_equation_0, values = (var_3096_cast_fp16, var_2970_cast_fp16))[name = tensor<string, []>("op_3354_cast_fp16")];
            tensor<fp16, []> var_3355_to_fp16 = const()[name = tensor<string, []>("op_3355_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3356_cast_fp16 = mul(x = var_3354_cast_fp16, y = var_3355_to_fp16)[name = tensor<string, []>("op_3356_cast_fp16")];
            tensor<string, []> var_3358_equation_0 = const()[name = tensor<string, []>("op_3358_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3358_cast_fp16 = einsum(equation = var_3358_equation_0, values = (var_3096_cast_fp16, var_2974_cast_fp16))[name = tensor<string, []>("op_3358_cast_fp16")];
            tensor<fp16, []> var_3359_to_fp16 = const()[name = tensor<string, []>("op_3359_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3360_cast_fp16 = mul(x = var_3358_cast_fp16, y = var_3359_to_fp16)[name = tensor<string, []>("op_3360_cast_fp16")];
            tensor<string, []> var_3362_equation_0 = const()[name = tensor<string, []>("op_3362_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3362_cast_fp16 = einsum(equation = var_3362_equation_0, values = (var_3096_cast_fp16, var_2978_cast_fp16))[name = tensor<string, []>("op_3362_cast_fp16")];
            tensor<fp16, []> var_3363_to_fp16 = const()[name = tensor<string, []>("op_3363_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3364_cast_fp16 = mul(x = var_3362_cast_fp16, y = var_3363_to_fp16)[name = tensor<string, []>("op_3364_cast_fp16")];
            tensor<string, []> var_3366_equation_0 = const()[name = tensor<string, []>("op_3366_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3366_cast_fp16 = einsum(equation = var_3366_equation_0, values = (var_3112_cast_fp16, var_2982_cast_fp16))[name = tensor<string, []>("op_3366_cast_fp16")];
            tensor<fp16, []> var_3367_to_fp16 = const()[name = tensor<string, []>("op_3367_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3368_cast_fp16 = mul(x = var_3366_cast_fp16, y = var_3367_to_fp16)[name = tensor<string, []>("op_3368_cast_fp16")];
            tensor<string, []> var_3370_equation_0 = const()[name = tensor<string, []>("op_3370_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3370_cast_fp16 = einsum(equation = var_3370_equation_0, values = (var_3112_cast_fp16, var_2986_cast_fp16))[name = tensor<string, []>("op_3370_cast_fp16")];
            tensor<fp16, []> var_3371_to_fp16 = const()[name = tensor<string, []>("op_3371_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3372_cast_fp16 = mul(x = var_3370_cast_fp16, y = var_3371_to_fp16)[name = tensor<string, []>("op_3372_cast_fp16")];
            tensor<string, []> var_3374_equation_0 = const()[name = tensor<string, []>("op_3374_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3374_cast_fp16 = einsum(equation = var_3374_equation_0, values = (var_3112_cast_fp16, var_2990_cast_fp16))[name = tensor<string, []>("op_3374_cast_fp16")];
            tensor<fp16, []> var_3375_to_fp16 = const()[name = tensor<string, []>("op_3375_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3376_cast_fp16 = mul(x = var_3374_cast_fp16, y = var_3375_to_fp16)[name = tensor<string, []>("op_3376_cast_fp16")];
            tensor<string, []> var_3378_equation_0 = const()[name = tensor<string, []>("op_3378_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3378_cast_fp16 = einsum(equation = var_3378_equation_0, values = (var_3112_cast_fp16, var_2994_cast_fp16))[name = tensor<string, []>("op_3378_cast_fp16")];
            tensor<fp16, []> var_3379_to_fp16 = const()[name = tensor<string, []>("op_3379_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3380_cast_fp16 = mul(x = var_3378_cast_fp16, y = var_3379_to_fp16)[name = tensor<string, []>("op_3380_cast_fp16")];
            tensor<string, []> var_3382_equation_0 = const()[name = tensor<string, []>("op_3382_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3382_cast_fp16 = einsum(equation = var_3382_equation_0, values = (var_3128_cast_fp16, var_2998_cast_fp16))[name = tensor<string, []>("op_3382_cast_fp16")];
            tensor<fp16, []> var_3383_to_fp16 = const()[name = tensor<string, []>("op_3383_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3384_cast_fp16 = mul(x = var_3382_cast_fp16, y = var_3383_to_fp16)[name = tensor<string, []>("op_3384_cast_fp16")];
            tensor<string, []> var_3386_equation_0 = const()[name = tensor<string, []>("op_3386_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3386_cast_fp16 = einsum(equation = var_3386_equation_0, values = (var_3128_cast_fp16, var_3002_cast_fp16))[name = tensor<string, []>("op_3386_cast_fp16")];
            tensor<fp16, []> var_3387_to_fp16 = const()[name = tensor<string, []>("op_3387_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3388_cast_fp16 = mul(x = var_3386_cast_fp16, y = var_3387_to_fp16)[name = tensor<string, []>("op_3388_cast_fp16")];
            tensor<string, []> var_3390_equation_0 = const()[name = tensor<string, []>("op_3390_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3390_cast_fp16 = einsum(equation = var_3390_equation_0, values = (var_3128_cast_fp16, var_3006_cast_fp16))[name = tensor<string, []>("op_3390_cast_fp16")];
            tensor<fp16, []> var_3391_to_fp16 = const()[name = tensor<string, []>("op_3391_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3392_cast_fp16 = mul(x = var_3390_cast_fp16, y = var_3391_to_fp16)[name = tensor<string, []>("op_3392_cast_fp16")];
            tensor<string, []> var_3394_equation_0 = const()[name = tensor<string, []>("op_3394_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3394_cast_fp16 = einsum(equation = var_3394_equation_0, values = (var_3128_cast_fp16, var_3010_cast_fp16))[name = tensor<string, []>("op_3394_cast_fp16")];
            tensor<fp16, []> var_3395_to_fp16 = const()[name = tensor<string, []>("op_3395_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3396_cast_fp16 = mul(x = var_3394_cast_fp16, y = var_3395_to_fp16)[name = tensor<string, []>("op_3396_cast_fp16")];
            tensor<string, []> var_3398_equation_0 = const()[name = tensor<string, []>("op_3398_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3398_cast_fp16 = einsum(equation = var_3398_equation_0, values = (var_3144_cast_fp16, var_3014_cast_fp16))[name = tensor<string, []>("op_3398_cast_fp16")];
            tensor<fp16, []> var_3399_to_fp16 = const()[name = tensor<string, []>("op_3399_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3400_cast_fp16 = mul(x = var_3398_cast_fp16, y = var_3399_to_fp16)[name = tensor<string, []>("op_3400_cast_fp16")];
            tensor<string, []> var_3402_equation_0 = const()[name = tensor<string, []>("op_3402_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3402_cast_fp16 = einsum(equation = var_3402_equation_0, values = (var_3144_cast_fp16, var_3018_cast_fp16))[name = tensor<string, []>("op_3402_cast_fp16")];
            tensor<fp16, []> var_3403_to_fp16 = const()[name = tensor<string, []>("op_3403_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3404_cast_fp16 = mul(x = var_3402_cast_fp16, y = var_3403_to_fp16)[name = tensor<string, []>("op_3404_cast_fp16")];
            tensor<string, []> var_3406_equation_0 = const()[name = tensor<string, []>("op_3406_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3406_cast_fp16 = einsum(equation = var_3406_equation_0, values = (var_3144_cast_fp16, var_3022_cast_fp16))[name = tensor<string, []>("op_3406_cast_fp16")];
            tensor<fp16, []> var_3407_to_fp16 = const()[name = tensor<string, []>("op_3407_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3408_cast_fp16 = mul(x = var_3406_cast_fp16, y = var_3407_to_fp16)[name = tensor<string, []>("op_3408_cast_fp16")];
            tensor<string, []> var_3410_equation_0 = const()[name = tensor<string, []>("op_3410_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3410_cast_fp16 = einsum(equation = var_3410_equation_0, values = (var_3144_cast_fp16, var_3026_cast_fp16))[name = tensor<string, []>("op_3410_cast_fp16")];
            tensor<fp16, []> var_3411_to_fp16 = const()[name = tensor<string, []>("op_3411_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3412_cast_fp16 = mul(x = var_3410_cast_fp16, y = var_3411_to_fp16)[name = tensor<string, []>("op_3412_cast_fp16")];
            tensor<string, []> var_3414_equation_0 = const()[name = tensor<string, []>("op_3414_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3414_cast_fp16 = einsum(equation = var_3414_equation_0, values = (var_3160_cast_fp16, var_3030_cast_fp16))[name = tensor<string, []>("op_3414_cast_fp16")];
            tensor<fp16, []> var_3415_to_fp16 = const()[name = tensor<string, []>("op_3415_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3416_cast_fp16 = mul(x = var_3414_cast_fp16, y = var_3415_to_fp16)[name = tensor<string, []>("op_3416_cast_fp16")];
            tensor<string, []> var_3418_equation_0 = const()[name = tensor<string, []>("op_3418_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3418_cast_fp16 = einsum(equation = var_3418_equation_0, values = (var_3160_cast_fp16, var_3034_cast_fp16))[name = tensor<string, []>("op_3418_cast_fp16")];
            tensor<fp16, []> var_3419_to_fp16 = const()[name = tensor<string, []>("op_3419_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3420_cast_fp16 = mul(x = var_3418_cast_fp16, y = var_3419_to_fp16)[name = tensor<string, []>("op_3420_cast_fp16")];
            tensor<string, []> var_3422_equation_0 = const()[name = tensor<string, []>("op_3422_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3422_cast_fp16 = einsum(equation = var_3422_equation_0, values = (var_3160_cast_fp16, var_3038_cast_fp16))[name = tensor<string, []>("op_3422_cast_fp16")];
            tensor<fp16, []> var_3423_to_fp16 = const()[name = tensor<string, []>("op_3423_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3424_cast_fp16 = mul(x = var_3422_cast_fp16, y = var_3423_to_fp16)[name = tensor<string, []>("op_3424_cast_fp16")];
            tensor<string, []> var_3426_equation_0 = const()[name = tensor<string, []>("op_3426_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3426_cast_fp16 = einsum(equation = var_3426_equation_0, values = (var_3160_cast_fp16, var_3042_cast_fp16))[name = tensor<string, []>("op_3426_cast_fp16")];
            tensor<fp16, []> var_3427_to_fp16 = const()[name = tensor<string, []>("op_3427_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3428_cast_fp16 = mul(x = var_3426_cast_fp16, y = var_3427_to_fp16)[name = tensor<string, []>("op_3428_cast_fp16")];
            tensor<string, []> var_3430_equation_0 = const()[name = tensor<string, []>("op_3430_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3430_cast_fp16 = einsum(equation = var_3430_equation_0, values = (var_3176_cast_fp16, var_3046_cast_fp16))[name = tensor<string, []>("op_3430_cast_fp16")];
            tensor<fp16, []> var_3431_to_fp16 = const()[name = tensor<string, []>("op_3431_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3432_cast_fp16 = mul(x = var_3430_cast_fp16, y = var_3431_to_fp16)[name = tensor<string, []>("op_3432_cast_fp16")];
            tensor<string, []> var_3434_equation_0 = const()[name = tensor<string, []>("op_3434_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3434_cast_fp16 = einsum(equation = var_3434_equation_0, values = (var_3176_cast_fp16, var_3050_cast_fp16))[name = tensor<string, []>("op_3434_cast_fp16")];
            tensor<fp16, []> var_3435_to_fp16 = const()[name = tensor<string, []>("op_3435_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3436_cast_fp16 = mul(x = var_3434_cast_fp16, y = var_3435_to_fp16)[name = tensor<string, []>("op_3436_cast_fp16")];
            tensor<string, []> var_3438_equation_0 = const()[name = tensor<string, []>("op_3438_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3438_cast_fp16 = einsum(equation = var_3438_equation_0, values = (var_3176_cast_fp16, var_3054_cast_fp16))[name = tensor<string, []>("op_3438_cast_fp16")];
            tensor<fp16, []> var_3439_to_fp16 = const()[name = tensor<string, []>("op_3439_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3440_cast_fp16 = mul(x = var_3438_cast_fp16, y = var_3439_to_fp16)[name = tensor<string, []>("op_3440_cast_fp16")];
            tensor<string, []> var_3442_equation_0 = const()[name = tensor<string, []>("op_3442_equation_0"), val = tensor<string, []>("bkhc,bchq->bkhq")];
            tensor<fp16, [1, 512, 1, 64]> var_3442_cast_fp16 = einsum(equation = var_3442_equation_0, values = (var_3176_cast_fp16, var_3058_cast_fp16))[name = tensor<string, []>("op_3442_cast_fp16")];
            tensor<fp16, []> var_3443_to_fp16 = const()[name = tensor<string, []>("op_3443_to_fp16"), val = tensor<fp16, []>(0x1p-3)];
            tensor<fp16, [1, 512, 1, 64]> var_3444_cast_fp16 = mul(x = var_3442_cast_fp16, y = var_3443_to_fp16)[name = tensor<string, []>("op_3444_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_193_cast_fp16 = add(x = var_3320_cast_fp16, y = mask)[name = tensor<string, []>("aw_193_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_195_cast_fp16 = add(x = var_3324_cast_fp16, y = mask)[name = tensor<string, []>("aw_195_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_197_cast_fp16 = add(x = var_3328_cast_fp16, y = mask)[name = tensor<string, []>("aw_197_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_199_cast_fp16 = add(x = var_3332_cast_fp16, y = mask)[name = tensor<string, []>("aw_199_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_201_cast_fp16 = add(x = var_3336_cast_fp16, y = mask)[name = tensor<string, []>("aw_201_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_203_cast_fp16 = add(x = var_3340_cast_fp16, y = mask)[name = tensor<string, []>("aw_203_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_205_cast_fp16 = add(x = var_3344_cast_fp16, y = mask)[name = tensor<string, []>("aw_205_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_207_cast_fp16 = add(x = var_3348_cast_fp16, y = mask)[name = tensor<string, []>("aw_207_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_209_cast_fp16 = add(x = var_3352_cast_fp16, y = mask)[name = tensor<string, []>("aw_209_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_211_cast_fp16 = add(x = var_3356_cast_fp16, y = mask)[name = tensor<string, []>("aw_211_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_213_cast_fp16 = add(x = var_3360_cast_fp16, y = mask)[name = tensor<string, []>("aw_213_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_215_cast_fp16 = add(x = var_3364_cast_fp16, y = mask)[name = tensor<string, []>("aw_215_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_217_cast_fp16 = add(x = var_3368_cast_fp16, y = mask)[name = tensor<string, []>("aw_217_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_219_cast_fp16 = add(x = var_3372_cast_fp16, y = mask)[name = tensor<string, []>("aw_219_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_221_cast_fp16 = add(x = var_3376_cast_fp16, y = mask)[name = tensor<string, []>("aw_221_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_223_cast_fp16 = add(x = var_3380_cast_fp16, y = mask)[name = tensor<string, []>("aw_223_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_225_cast_fp16 = add(x = var_3384_cast_fp16, y = mask)[name = tensor<string, []>("aw_225_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_227_cast_fp16 = add(x = var_3388_cast_fp16, y = mask)[name = tensor<string, []>("aw_227_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_229_cast_fp16 = add(x = var_3392_cast_fp16, y = mask)[name = tensor<string, []>("aw_229_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_231_cast_fp16 = add(x = var_3396_cast_fp16, y = mask)[name = tensor<string, []>("aw_231_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_233_cast_fp16 = add(x = var_3400_cast_fp16, y = mask)[name = tensor<string, []>("aw_233_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_235_cast_fp16 = add(x = var_3404_cast_fp16, y = mask)[name = tensor<string, []>("aw_235_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_237_cast_fp16 = add(x = var_3408_cast_fp16, y = mask)[name = tensor<string, []>("aw_237_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_239_cast_fp16 = add(x = var_3412_cast_fp16, y = mask)[name = tensor<string, []>("aw_239_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_241_cast_fp16 = add(x = var_3416_cast_fp16, y = mask)[name = tensor<string, []>("aw_241_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_243_cast_fp16 = add(x = var_3420_cast_fp16, y = mask)[name = tensor<string, []>("aw_243_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_245_cast_fp16 = add(x = var_3424_cast_fp16, y = mask)[name = tensor<string, []>("aw_245_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_247_cast_fp16 = add(x = var_3428_cast_fp16, y = mask)[name = tensor<string, []>("aw_247_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_249_cast_fp16 = add(x = var_3432_cast_fp16, y = mask)[name = tensor<string, []>("aw_249_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_251_cast_fp16 = add(x = var_3436_cast_fp16, y = mask)[name = tensor<string, []>("aw_251_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_253_cast_fp16 = add(x = var_3440_cast_fp16, y = mask)[name = tensor<string, []>("aw_253_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> aw_cast_fp16 = add(x = var_3444_cast_fp16, y = mask)[name = tensor<string, []>("aw_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3477_cast_fp16 = softmax(axis = var_2785, x = aw_193_cast_fp16)[name = tensor<string, []>("op_3477_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3478_cast_fp16 = softmax(axis = var_2785, x = aw_195_cast_fp16)[name = tensor<string, []>("op_3478_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3479_cast_fp16 = softmax(axis = var_2785, x = aw_197_cast_fp16)[name = tensor<string, []>("op_3479_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3480_cast_fp16 = softmax(axis = var_2785, x = aw_199_cast_fp16)[name = tensor<string, []>("op_3480_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3481_cast_fp16 = softmax(axis = var_2785, x = aw_201_cast_fp16)[name = tensor<string, []>("op_3481_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3482_cast_fp16 = softmax(axis = var_2785, x = aw_203_cast_fp16)[name = tensor<string, []>("op_3482_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3483_cast_fp16 = softmax(axis = var_2785, x = aw_205_cast_fp16)[name = tensor<string, []>("op_3483_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3484_cast_fp16 = softmax(axis = var_2785, x = aw_207_cast_fp16)[name = tensor<string, []>("op_3484_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3485_cast_fp16 = softmax(axis = var_2785, x = aw_209_cast_fp16)[name = tensor<string, []>("op_3485_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3486_cast_fp16 = softmax(axis = var_2785, x = aw_211_cast_fp16)[name = tensor<string, []>("op_3486_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3487_cast_fp16 = softmax(axis = var_2785, x = aw_213_cast_fp16)[name = tensor<string, []>("op_3487_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3488_cast_fp16 = softmax(axis = var_2785, x = aw_215_cast_fp16)[name = tensor<string, []>("op_3488_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3489_cast_fp16 = softmax(axis = var_2785, x = aw_217_cast_fp16)[name = tensor<string, []>("op_3489_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3490_cast_fp16 = softmax(axis = var_2785, x = aw_219_cast_fp16)[name = tensor<string, []>("op_3490_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3491_cast_fp16 = softmax(axis = var_2785, x = aw_221_cast_fp16)[name = tensor<string, []>("op_3491_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3492_cast_fp16 = softmax(axis = var_2785, x = aw_223_cast_fp16)[name = tensor<string, []>("op_3492_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3493_cast_fp16 = softmax(axis = var_2785, x = aw_225_cast_fp16)[name = tensor<string, []>("op_3493_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3494_cast_fp16 = softmax(axis = var_2785, x = aw_227_cast_fp16)[name = tensor<string, []>("op_3494_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3495_cast_fp16 = softmax(axis = var_2785, x = aw_229_cast_fp16)[name = tensor<string, []>("op_3495_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3496_cast_fp16 = softmax(axis = var_2785, x = aw_231_cast_fp16)[name = tensor<string, []>("op_3496_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3497_cast_fp16 = softmax(axis = var_2785, x = aw_233_cast_fp16)[name = tensor<string, []>("op_3497_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3498_cast_fp16 = softmax(axis = var_2785, x = aw_235_cast_fp16)[name = tensor<string, []>("op_3498_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3499_cast_fp16 = softmax(axis = var_2785, x = aw_237_cast_fp16)[name = tensor<string, []>("op_3499_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3500_cast_fp16 = softmax(axis = var_2785, x = aw_239_cast_fp16)[name = tensor<string, []>("op_3500_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3501_cast_fp16 = softmax(axis = var_2785, x = aw_241_cast_fp16)[name = tensor<string, []>("op_3501_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3502_cast_fp16 = softmax(axis = var_2785, x = aw_243_cast_fp16)[name = tensor<string, []>("op_3502_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3503_cast_fp16 = softmax(axis = var_2785, x = aw_245_cast_fp16)[name = tensor<string, []>("op_3503_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3504_cast_fp16 = softmax(axis = var_2785, x = aw_247_cast_fp16)[name = tensor<string, []>("op_3504_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3505_cast_fp16 = softmax(axis = var_2785, x = aw_249_cast_fp16)[name = tensor<string, []>("op_3505_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3506_cast_fp16 = softmax(axis = var_2785, x = aw_251_cast_fp16)[name = tensor<string, []>("op_3506_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3507_cast_fp16 = softmax(axis = var_2785, x = aw_253_cast_fp16)[name = tensor<string, []>("op_3507_cast_fp16")];
            tensor<fp16, [1, 512, 1, 64]> var_3508_cast_fp16 = softmax(axis = var_2785, x = aw_cast_fp16)[name = tensor<string, []>("op_3508_cast_fp16")];
            tensor<string, []> var_3510_equation_0 = const()[name = tensor<string, []>("op_3510_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3510_cast_fp16 = einsum(equation = var_3510_equation_0, values = (var_3190_cast_fp16, var_3477_cast_fp16))[name = tensor<string, []>("op_3510_cast_fp16")];
            tensor<string, []> var_3512_equation_0 = const()[name = tensor<string, []>("op_3512_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3512_cast_fp16 = einsum(equation = var_3512_equation_0, values = (var_3190_cast_fp16, var_3478_cast_fp16))[name = tensor<string, []>("op_3512_cast_fp16")];
            tensor<string, []> var_3514_equation_0 = const()[name = tensor<string, []>("op_3514_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3514_cast_fp16 = einsum(equation = var_3514_equation_0, values = (var_3190_cast_fp16, var_3479_cast_fp16))[name = tensor<string, []>("op_3514_cast_fp16")];
            tensor<string, []> var_3516_equation_0 = const()[name = tensor<string, []>("op_3516_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3516_cast_fp16 = einsum(equation = var_3516_equation_0, values = (var_3190_cast_fp16, var_3480_cast_fp16))[name = tensor<string, []>("op_3516_cast_fp16")];
            tensor<string, []> var_3518_equation_0 = const()[name = tensor<string, []>("op_3518_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3518_cast_fp16 = einsum(equation = var_3518_equation_0, values = (var_3206_cast_fp16, var_3481_cast_fp16))[name = tensor<string, []>("op_3518_cast_fp16")];
            tensor<string, []> var_3520_equation_0 = const()[name = tensor<string, []>("op_3520_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3520_cast_fp16 = einsum(equation = var_3520_equation_0, values = (var_3206_cast_fp16, var_3482_cast_fp16))[name = tensor<string, []>("op_3520_cast_fp16")];
            tensor<string, []> var_3522_equation_0 = const()[name = tensor<string, []>("op_3522_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3522_cast_fp16 = einsum(equation = var_3522_equation_0, values = (var_3206_cast_fp16, var_3483_cast_fp16))[name = tensor<string, []>("op_3522_cast_fp16")];
            tensor<string, []> var_3524_equation_0 = const()[name = tensor<string, []>("op_3524_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3524_cast_fp16 = einsum(equation = var_3524_equation_0, values = (var_3206_cast_fp16, var_3484_cast_fp16))[name = tensor<string, []>("op_3524_cast_fp16")];
            tensor<string, []> var_3526_equation_0 = const()[name = tensor<string, []>("op_3526_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3526_cast_fp16 = einsum(equation = var_3526_equation_0, values = (var_3222_cast_fp16, var_3485_cast_fp16))[name = tensor<string, []>("op_3526_cast_fp16")];
            tensor<string, []> var_3528_equation_0 = const()[name = tensor<string, []>("op_3528_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3528_cast_fp16 = einsum(equation = var_3528_equation_0, values = (var_3222_cast_fp16, var_3486_cast_fp16))[name = tensor<string, []>("op_3528_cast_fp16")];
            tensor<string, []> var_3530_equation_0 = const()[name = tensor<string, []>("op_3530_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3530_cast_fp16 = einsum(equation = var_3530_equation_0, values = (var_3222_cast_fp16, var_3487_cast_fp16))[name = tensor<string, []>("op_3530_cast_fp16")];
            tensor<string, []> var_3532_equation_0 = const()[name = tensor<string, []>("op_3532_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3532_cast_fp16 = einsum(equation = var_3532_equation_0, values = (var_3222_cast_fp16, var_3488_cast_fp16))[name = tensor<string, []>("op_3532_cast_fp16")];
            tensor<string, []> var_3534_equation_0 = const()[name = tensor<string, []>("op_3534_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3534_cast_fp16 = einsum(equation = var_3534_equation_0, values = (var_3238_cast_fp16, var_3489_cast_fp16))[name = tensor<string, []>("op_3534_cast_fp16")];
            tensor<string, []> var_3536_equation_0 = const()[name = tensor<string, []>("op_3536_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3536_cast_fp16 = einsum(equation = var_3536_equation_0, values = (var_3238_cast_fp16, var_3490_cast_fp16))[name = tensor<string, []>("op_3536_cast_fp16")];
            tensor<string, []> var_3538_equation_0 = const()[name = tensor<string, []>("op_3538_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3538_cast_fp16 = einsum(equation = var_3538_equation_0, values = (var_3238_cast_fp16, var_3491_cast_fp16))[name = tensor<string, []>("op_3538_cast_fp16")];
            tensor<string, []> var_3540_equation_0 = const()[name = tensor<string, []>("op_3540_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3540_cast_fp16 = einsum(equation = var_3540_equation_0, values = (var_3238_cast_fp16, var_3492_cast_fp16))[name = tensor<string, []>("op_3540_cast_fp16")];
            tensor<string, []> var_3542_equation_0 = const()[name = tensor<string, []>("op_3542_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3542_cast_fp16 = einsum(equation = var_3542_equation_0, values = (var_3254_cast_fp16, var_3493_cast_fp16))[name = tensor<string, []>("op_3542_cast_fp16")];
            tensor<string, []> var_3544_equation_0 = const()[name = tensor<string, []>("op_3544_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3544_cast_fp16 = einsum(equation = var_3544_equation_0, values = (var_3254_cast_fp16, var_3494_cast_fp16))[name = tensor<string, []>("op_3544_cast_fp16")];
            tensor<string, []> var_3546_equation_0 = const()[name = tensor<string, []>("op_3546_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3546_cast_fp16 = einsum(equation = var_3546_equation_0, values = (var_3254_cast_fp16, var_3495_cast_fp16))[name = tensor<string, []>("op_3546_cast_fp16")];
            tensor<string, []> var_3548_equation_0 = const()[name = tensor<string, []>("op_3548_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3548_cast_fp16 = einsum(equation = var_3548_equation_0, values = (var_3254_cast_fp16, var_3496_cast_fp16))[name = tensor<string, []>("op_3548_cast_fp16")];
            tensor<string, []> var_3550_equation_0 = const()[name = tensor<string, []>("op_3550_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3550_cast_fp16 = einsum(equation = var_3550_equation_0, values = (var_3270_cast_fp16, var_3497_cast_fp16))[name = tensor<string, []>("op_3550_cast_fp16")];
            tensor<string, []> var_3552_equation_0 = const()[name = tensor<string, []>("op_3552_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3552_cast_fp16 = einsum(equation = var_3552_equation_0, values = (var_3270_cast_fp16, var_3498_cast_fp16))[name = tensor<string, []>("op_3552_cast_fp16")];
            tensor<string, []> var_3554_equation_0 = const()[name = tensor<string, []>("op_3554_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3554_cast_fp16 = einsum(equation = var_3554_equation_0, values = (var_3270_cast_fp16, var_3499_cast_fp16))[name = tensor<string, []>("op_3554_cast_fp16")];
            tensor<string, []> var_3556_equation_0 = const()[name = tensor<string, []>("op_3556_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3556_cast_fp16 = einsum(equation = var_3556_equation_0, values = (var_3270_cast_fp16, var_3500_cast_fp16))[name = tensor<string, []>("op_3556_cast_fp16")];
            tensor<string, []> var_3558_equation_0 = const()[name = tensor<string, []>("op_3558_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3558_cast_fp16 = einsum(equation = var_3558_equation_0, values = (var_3286_cast_fp16, var_3501_cast_fp16))[name = tensor<string, []>("op_3558_cast_fp16")];
            tensor<string, []> var_3560_equation_0 = const()[name = tensor<string, []>("op_3560_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3560_cast_fp16 = einsum(equation = var_3560_equation_0, values = (var_3286_cast_fp16, var_3502_cast_fp16))[name = tensor<string, []>("op_3560_cast_fp16")];
            tensor<string, []> var_3562_equation_0 = const()[name = tensor<string, []>("op_3562_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3562_cast_fp16 = einsum(equation = var_3562_equation_0, values = (var_3286_cast_fp16, var_3503_cast_fp16))[name = tensor<string, []>("op_3562_cast_fp16")];
            tensor<string, []> var_3564_equation_0 = const()[name = tensor<string, []>("op_3564_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3564_cast_fp16 = einsum(equation = var_3564_equation_0, values = (var_3286_cast_fp16, var_3504_cast_fp16))[name = tensor<string, []>("op_3564_cast_fp16")];
            tensor<string, []> var_3566_equation_0 = const()[name = tensor<string, []>("op_3566_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3566_cast_fp16 = einsum(equation = var_3566_equation_0, values = (var_3302_cast_fp16, var_3505_cast_fp16))[name = tensor<string, []>("op_3566_cast_fp16")];
            tensor<string, []> var_3568_equation_0 = const()[name = tensor<string, []>("op_3568_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3568_cast_fp16 = einsum(equation = var_3568_equation_0, values = (var_3302_cast_fp16, var_3506_cast_fp16))[name = tensor<string, []>("op_3568_cast_fp16")];
            tensor<string, []> var_3570_equation_0 = const()[name = tensor<string, []>("op_3570_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3570_cast_fp16 = einsum(equation = var_3570_equation_0, values = (var_3302_cast_fp16, var_3507_cast_fp16))[name = tensor<string, []>("op_3570_cast_fp16")];
            tensor<string, []> var_3572_equation_0 = const()[name = tensor<string, []>("op_3572_equation_0"), val = tensor<string, []>("bchk,bkhq->bchq")];
            tensor<fp16, [1, 64, 1, 64]> var_3572_cast_fp16 = einsum(equation = var_3572_equation_0, values = (var_3302_cast_fp16, var_3508_cast_fp16))[name = tensor<string, []>("op_3572_cast_fp16")];
            tensor<bool, []> x_75_interleave_0 = const()[name = tensor<string, []>("x_75_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 2048, 1, 64]> x_75_cast_fp16 = concat(axis = var_2785, interleave = x_75_interleave_0, values = (var_3510_cast_fp16, var_3512_cast_fp16, var_3514_cast_fp16, var_3516_cast_fp16, var_3518_cast_fp16, var_3520_cast_fp16, var_3522_cast_fp16, var_3524_cast_fp16, var_3526_cast_fp16, var_3528_cast_fp16, var_3530_cast_fp16, var_3532_cast_fp16, var_3534_cast_fp16, var_3536_cast_fp16, var_3538_cast_fp16, var_3540_cast_fp16, var_3542_cast_fp16, var_3544_cast_fp16, var_3546_cast_fp16, var_3548_cast_fp16, var_3550_cast_fp16, var_3552_cast_fp16, var_3554_cast_fp16, var_3556_cast_fp16, var_3558_cast_fp16, var_3560_cast_fp16, var_3562_cast_fp16, var_3564_cast_fp16, var_3566_cast_fp16, var_3568_cast_fp16, var_3570_cast_fp16, var_3572_cast_fp16))[name = tensor<string, []>("x_75_cast_fp16")];
            tensor<int32, [4]> var_3577 = const()[name = tensor<string, []>("op_3577"), val = tensor<int32, [4]>([1, 2048, -1, 8])];
            tensor<fp16, [1, 2048, 8, 8]> input_33_cast_fp16 = reshape(shape = var_3577, x = x_75_cast_fp16)[name = tensor<string, []>("input_33_cast_fp16")];
            tensor<int32, [2]> var_3580 = const()[name = tensor<string, []>("op_3580"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_3582 = const()[name = tensor<string, []>("op_3582"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> attention_output_pad_type_0 = const()[name = tensor<string, []>("attention_output_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> attention_output_pad_0 = const()[name = tensor<string, []>("attention_output_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 2048, 1, 1]> blocks_3_attn_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_attn_proj_weight_to_fp16"), val = tensor<fp16, [2048, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(377519424)))];
            tensor<fp16, [1, 2048, 8, 8]> attention_output_cast_fp16 = conv(dilations = var_3582, groups = var_2785, pad = attention_output_pad_0, pad_type = attention_output_pad_type_0, strides = var_3580, weight = blocks_3_attn_proj_weight_to_fp16, x = input_33_cast_fp16)[name = tensor<string, []>("attention_output_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_77_cast_fp16 = add(x = attention_output_cast_fp16, y = x_61_cast_fp16)[name = tensor<string, []>("x_77_cast_fp16")];
            tensor<bool, []> x_eps_interleave_0 = const()[name = tensor<string, []>("x_eps_interleave_0"), val = tensor<bool, []>(false)];
            tensor<fp16, [1, 1, 8, 8]> eps_chan_to_fp16 = const()[name = tensor<string, []>("eps_chan_to_fp16"), val = tensor<fp16, [1, 1, 8, 8]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(385908096)))];
            tensor<fp16, [1, 2049, 8, 8]> x_eps_cast_fp16 = concat(axis = var_2785, interleave = x_eps_interleave_0, values = (x_77_cast_fp16, eps_chan_to_fp16))[name = tensor<string, []>("x_eps_cast_fp16")];
            tensor<int32, [1]> norm_x_axes_0 = const()[name = tensor<string, []>("norm_x_axes_0"), val = tensor<int32, [1]>([1])];
            tensor<fp16, [1, 1, 8, 8]> norm_x_cast_fp16 = reduce_l2_norm(axes = norm_x_axes_0, keep_dims = var_2788, x = x_eps_cast_fp16)[name = tensor<string, []>("norm_x_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_43_cast_fp16 = real_div(x = x_77_cast_fp16, y = norm_x_cast_fp16)[name = tensor<string, []>("x_normed_43_cast_fp16")];
            tensor<fp16, []> var_3608_to_fp16 = const()[name = tensor<string, []>("op_3608_to_fp16"), val = tensor<fp16, []>(0x1.6ap+5)];
            tensor<fp16, [1, 2048, 8, 8]> x_normed_45_cast_fp16 = mul(x = x_normed_43_cast_fp16, y = var_3608_to_fp16)[name = tensor<string, []>("x_normed_45_cast_fp16")];
            tensor<fp16, [1, 2048, 1, 1]> blocks_3_norm_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_norm_2_weight_to_fp16"), val = tensor<fp16, [1, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(385908288)))];
            tensor<fp16, [1, 2048, 8, 8]> input_35_cast_fp16 = mul(x = x_normed_45_cast_fp16, y = blocks_3_norm_2_weight_to_fp16)[name = tensor<string, []>("input_35_cast_fp16")];
            tensor<int32, [2]> var_3619 = const()[name = tensor<string, []>("op_3619"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_3621 = const()[name = tensor<string, []>("op_3621"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> input_37_pad_type_0 = const()[name = tensor<string, []>("input_37_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> input_37_pad_0 = const()[name = tensor<string, []>("input_37_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_3_mlp_fc_1_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_mlp_fc_1_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(385912448)))];
            tensor<fp16, [1, 8192, 8, 8]> input_37_cast_fp16 = conv(dilations = var_3621, groups = var_2785, pad = input_37_pad_0, pad_type = input_37_pad_type_0, strides = var_3619, weight = blocks_3_mlp_fc_1_weight_to_fp16, x = input_35_cast_fp16)[name = tensor<string, []>("input_37_cast_fp16")];
            tensor<int32, [2]> var_3625 = const()[name = tensor<string, []>("op_3625"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_3627 = const()[name = tensor<string, []>("op_3627"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> x_fc_2_pad_type_0 = const()[name = tensor<string, []>("x_fc_2_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> x_fc_2_pad_0 = const()[name = tensor<string, []>("x_fc_2_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [8192, 2048, 1, 1]> blocks_3_mlp_fc_2_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_mlp_fc_2_weight_to_fp16"), val = tensor<fp16, [8192, 2048, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(419466944)))];
            tensor<fp16, [1, 8192, 8, 8]> x_fc_2_cast_fp16 = conv(dilations = var_3627, groups = var_2785, pad = x_fc_2_pad_0, pad_type = x_fc_2_pad_type_0, strides = var_3625, weight = blocks_3_mlp_fc_2_weight_to_fp16, x = input_35_cast_fp16)[name = tensor<string, []>("x_fc_2_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> var_3630_cast_fp16 = silu(x = input_37_cast_fp16)[name = tensor<string, []>("op_3630_cast_fp16")];
            tensor<fp16, [1, 8192, 8, 8]> input_cast_fp16 = mul(x = var_3630_cast_fp16, y = x_fc_2_cast_fp16)[name = tensor<string, []>("input_cast_fp16")];
            tensor<int32, [2]> var_3633 = const()[name = tensor<string, []>("op_3633"), val = tensor<int32, [2]>([1, 1])];
            tensor<int32, [2]> var_3635 = const()[name = tensor<string, []>("op_3635"), val = tensor<int32, [2]>([1, 1])];
            tensor<string, []> var_3637_pad_type_0 = const()[name = tensor<string, []>("op_3637_pad_type_0"), val = tensor<string, []>("custom")];
            tensor<int32, [4]> var_3637_pad_0 = const()[name = tensor<string, []>("op_3637_pad_0"), val = tensor<int32, [4]>([0, 0, 0, 0])];
            tensor<fp16, [2048, 8192, 1, 1]> blocks_3_mlp_proj_weight_to_fp16 = const()[name = tensor<string, []>("blocks_3_mlp_proj_weight_to_fp16"), val = tensor<fp16, [2048, 8192, 1, 1]>(BLOBFILE(path = tensor<string, []>("@model_path/weights/weight.bin"), offset = tensor<uint64, []>(453021440)))];
            tensor<fp16, [1, 2048, 8, 8]> var_3637_cast_fp16 = conv(dilations = var_3635, groups = var_2785, pad = var_3637_pad_0, pad_type = var_3637_pad_type_0, strides = var_3633, weight = blocks_3_mlp_proj_weight_to_fp16, x = input_cast_fp16)[name = tensor<string, []>("op_3637_cast_fp16")];
            tensor<fp16, [1, 2048, 8, 8]> new_x = add(x = var_3637_cast_fp16, y = x_77_cast_fp16)[name = tensor<string, []>("op_3638_cast_fp16")];
        } -> (new_x, new_k_cache_0, new_v_cache_0, new_k_cache_1, new_v_cache_1, new_k_cache_2, new_v_cache_2, new_k_cache_3, new_v_cache_3);
}