Added many other

This commit is contained in:
2026-08-06 18:56:32 +03:00
parent 9f2fd08ee5
commit d9d7ee49d2
2144 changed files with 1115424 additions and 1284 deletions
+281
View File
@@ -0,0 +1,281 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<24>;
.reg .b16 %rs<10>;
.reg .f32 %f<126>;
.reg .b32 %r<32>;
.reg .b64 %rd<10>;
mov.u32 %r1, %ctaid.x;
mov.u32 %r2, %ntid.x;
mov.u32 %r3, %tid.x;
mad.lo.s32 %r4, %r1, %r2, %r3;
mov.u32 %r5, %ntid.y;
mov.u32 %r6, %ctaid.y;
mov.u32 %r7, %tid.y;
mad.lo.s32 %r8, %r6, %r5, %r7;
ld.const.u64 %rd2, [params+144];
cvta.to.global.u64 %rd3, %rd2;
ld.const.u32 %r9, [params+136];
mad.lo.s32 %r10, %r9, %r8, %r4;
mul.wide.u32 %rd4, %r10, 8;
add.s64 %rd5, %rd3, %rd4;
add.s64 %rd1, %rd5, 6;
ld.global.u16 %rs1, [%rd5+6];
// begin inline asm
{ cvt.f32.f16 %f25, %rs1;}
// end inline asm
ld.global.u16 %rs2, [%rd5];
// begin inline asm
{ cvt.f32.f16 %f26, %rs2;}
// end inline asm
ld.global.u16 %rs3, [%rd5+2];
// begin inline asm
{ cvt.f32.f16 %f27, %rs3;}
// end inline asm
ld.global.u16 %rs4, [%rd5+4];
// begin inline asm
{ cvt.f32.f16 %f28, %rs4;}
// end inline asm
ld.const.u64 %rd6, [params+160];
cvta.to.global.u64 %rd7, %rd6;
ld.const.u32 %r11, [params+152];
mad.lo.s32 %r12, %r11, %r8, %r4;
cvt.u64.u32 %rd8, %r12;
add.s64 %rd9, %rd7, %rd8;
ld.global.u8 %rs5, [%rd9];
cvt.rn.f32.u16 %f29, %rs5;
div.rn.f32 %f5, %f29, 0f437F0000;
ld.const.f32 %f6, [params+704];
setp.lt.f32 %p1, %f6, 0f00000000;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
neg.f32 %f8, %f6;
setp.lt.f32 %p2, %f6, 0fBF800000;
@%p2 bra $L__BB0_4;
bra.uni $L__BB0_3;
$L__BB0_4:
mul.f32 %f35, %f6, 0fBF000000;
cvt.rzi.f32.f32 %f36, %f35;
add.f32 %f37, %f36, %f36;
sub.f32 %f38, %f8, %f37;
abs.f32 %f10, %f38;
abs.f32 %f11, %f5;
setp.lt.f32 %p3, %f11, 0f00800000;
mul.f32 %f39, %f11, 0f4B800000;
selp.f32 %f40, %f39, %f11, %p3;
selp.f32 %f41, 0fC3170000, 0fC2FE0000, %p3;
mov.b32 %r13, %f40;
and.b32 %r14, %r13, 8388607;
or.b32 %r15, %r14, 1065353216;
mov.b32 %f42, %r15;
shr.u32 %r16, %r13, 23;
cvt.rn.f32.u32 %f43, %r16;
add.f32 %f44, %f41, %f43;
setp.gt.f32 %p4, %f42, 0f3FB504F3;
mul.f32 %f45, %f42, 0f3F000000;
add.f32 %f46, %f44, 0f3F800000;
selp.f32 %f47, %f46, %f44, %p4;
selp.f32 %f48, %f45, %f42, %p4;
add.f32 %f49, %f48, 0fBF800000;
add.f32 %f50, %f48, 0f3F800000;
rcp.approx.ftz.f32 %f51, %f50;
add.f32 %f52, %f49, %f49;
mul.f32 %f53, %f52, %f51;
mul.f32 %f54, %f53, %f53;
mov.f32 %f55, 0f3C4CAF63;
mov.f32 %f56, 0f3B18F0FE;
fma.rn.f32 %f57, %f56, %f54, %f55;
mov.f32 %f58, 0f3DAAAABD;
fma.rn.f32 %f59, %f57, %f54, %f58;
mul.rn.f32 %f60, %f59, %f54;
mul.rn.f32 %f61, %f60, %f53;
sub.f32 %f62, %f49, %f53;
add.f32 %f63, %f62, %f62;
neg.f32 %f64, %f53;
fma.rn.f32 %f65, %f64, %f49, %f63;
mul.rn.f32 %f66, %f51, %f65;
add.f32 %f67, %f61, %f53;
sub.f32 %f68, %f53, %f67;
add.f32 %f69, %f61, %f68;
add.f32 %f70, %f66, %f69;
add.f32 %f71, %f67, %f70;
sub.f32 %f72, %f67, %f71;
add.f32 %f73, %f70, %f72;
mov.f32 %f74, 0f3F317200;
mul.rn.f32 %f75, %f47, %f74;
mov.f32 %f76, 0f35BFBE8E;
mul.rn.f32 %f77, %f47, %f76;
add.f32 %f78, %f75, %f71;
sub.f32 %f79, %f75, %f78;
add.f32 %f80, %f71, %f79;
add.f32 %f81, %f73, %f80;
add.f32 %f82, %f77, %f81;
add.f32 %f83, %f78, %f82;
sub.f32 %f84, %f78, %f83;
add.f32 %f85, %f82, %f84;
abs.f32 %f12, %f8;
setp.gt.f32 %p5, %f12, 0f77F684DF;
mul.f32 %f86, %f6, 0fB9000000;
selp.f32 %f87, %f86, %f8, %p5;
mul.rn.f32 %f88, %f87, %f83;
neg.f32 %f89, %f88;
fma.rn.f32 %f90, %f87, %f83, %f89;
fma.rn.f32 %f91, %f87, %f85, %f90;
mov.f32 %f92, 0f00000000;
fma.rn.f32 %f93, %f92, %f83, %f91;
add.rn.f32 %f94, %f88, %f93;
neg.f32 %f95, %f94;
add.rn.f32 %f96, %f88, %f95;
add.rn.f32 %f97, %f96, %f93;
mov.b32 %r17, %f94;
setp.eq.s32 %p6, %r17, 1118925336;
add.s32 %r18, %r17, -1;
mov.b32 %f98, %r18;
add.f32 %f99, %f97, 0f37000000;
selp.f32 %f13, %f99, %f97, %p6;
selp.f32 %f100, %f98, %f94, %p6;
mov.f32 %f101, 0f3FB8AA3B;
mul.rn.f32 %f102, %f100, %f101;
cvt.rzi.f32.f32 %f103, %f102;
abs.f32 %f104, %f103;
setp.gt.f32 %p7, %f104, 0f42FC0000;
mov.b32 %r19, %f103;
and.b32 %r20, %r19, -2147483648;
or.b32 %r21, %r20, 1123811328;
mov.b32 %f105, %r21;
selp.f32 %f106, %f105, %f103, %p7;
mov.f32 %f107, 0fBF317218;
fma.rn.f32 %f108, %f106, %f107, %f100;
mov.f32 %f109, 0f3102E308;
fma.rn.f32 %f110, %f106, %f109, %f108;
mul.f32 %f111, %f110, 0f3FB8AA3B;
add.f32 %f112, %f106, 0f4B40007F;
mov.b32 %r22, %f112;
shl.b32 %r23, %r22, 23;
mov.b32 %f113, %r23;
ex2.approx.ftz.f32 %f114, %f111;
mul.f32 %f14, %f114, %f113;
setp.eq.f32 %p8, %f14, 0f7F800000;
mov.f32 %f124, 0f7F800000;
@%p8 bra $L__BB0_6;
fma.rn.f32 %f124, %f14, %f13, %f14;
$L__BB0_6:
setp.neu.f32 %p9, %f5, 0f00000000;
@%p9 bra $L__BB0_8;
setp.eq.f32 %p10, %f10, 0f3F800000;
add.f32 %f115, %f5, %f5;
mov.b32 %r24, %f115;
selp.b32 %r25, %r24, 0, %p10;
or.b32 %r26, %r25, 2139095040;
setp.gt.f32 %p11, %f6, 0f80000000;
selp.b32 %r27, %r26, %r25, %p11;
mov.b32 %f124, %r27;
$L__BB0_8:
add.f32 %f116, %f11, %f12;
mov.b32 %r28, %f116;
setp.lt.s32 %p12, %r28, 2139095040;
@%p12 bra $L__BB0_15;
setp.gtu.f32 %p13, %f11, 0f7F800000;
setp.gtu.f32 %p14, %f12, 0f7F800000;
or.pred %p15, %p13, %p14;
@%p15 bra $L__BB0_14;
bra.uni $L__BB0_10;
$L__BB0_14:
sub.f32 %f124, %f5, %f6;
bra.uni $L__BB0_15;
$L__BB0_1:
add.f32 %f30, %f5, 0fBF800000;
fma.rn.f32 %f31, %f6, %f30, 0f3F800000;
cvt.sat.f32.f32 %f125, %f31;
bra.uni $L__BB0_16;
$L__BB0_3:
add.f32 %f32, %f5, 0fBF800000;
fma.rn.f32 %f33, %f32, %f8, 0f3F800000;
cvt.sat.f32.f32 %f125, %f33;
bra.uni $L__BB0_16;
$L__BB0_10:
setp.eq.f32 %p16, %f12, 0f7F800000;
@%p16 bra $L__BB0_13;
bra.uni $L__BB0_11;
$L__BB0_13:
setp.gt.f32 %p19, %f11, 0f3F800000;
selp.b32 %r29, 2139095040, 0, %p19;
xor.b32 %r30, %r29, 2139095040;
setp.gt.f32 %p20, %f6, 0f80000000;
selp.b32 %r31, %r30, %r29, %p20;
mov.b32 %f124, %r31;
bra.uni $L__BB0_15;
$L__BB0_11:
setp.neu.f32 %p17, %f11, 0f7F800000;
@%p17 bra $L__BB0_15;
setp.le.f32 %p18, %f6, 0f80000000;
selp.f32 %f124, 0f7F800000, 0f00000000, %p18;
$L__BB0_15:
setp.eq.f32 %p21, %f6, 0f80000000;
setp.eq.f32 %p22, %f5, 0f3F800000;
or.pred %p23, %p21, %p22;
selp.f32 %f117, 0f3F800000, %f124, %p23;
cvt.sat.f32.f32 %f125, %f117;
$L__BB0_16:
mul.f32 %f118, %f26, %f125;
mul.f32 %f119, %f27, %f125;
mul.f32 %f120, %f28, %f125;
// begin inline asm
{ cvt.rn.f16.f32 %rs8, %f120;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs7, %f119;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs6, %f118;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs9, %f25;}
// end inline asm
st.global.v4.u16 [%rd1+-6], {%rs6, %rs7, %rs8, %rs9};
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 79ff5733455c05344a5ccf8b915d812d
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
+199
View File
@@ -0,0 +1,199 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<5>;
.reg .b16 %rs<29>;
.reg .f32 %f<91>;
.reg .b32 %r<31>;
.reg .b64 %rd<21>;
mov.u32 %r3, %ctaid.x;
mov.u32 %r4, %ntid.x;
mov.u32 %r5, %tid.x;
mad.lo.s32 %r1, %r3, %r4, %r5;
mov.u32 %r6, %ntid.y;
mov.u32 %r7, %ctaid.y;
mov.u32 %r8, %tid.y;
mad.lo.s32 %r2, %r7, %r6, %r8;
ld.const.u64 %rd3, [params+1144];
cvta.to.global.u64 %rd4, %rd3;
ld.const.u32 %r9, [params+1136];
mad.lo.s32 %r10, %r9, %r2, %r1;
mul.wide.u32 %rd5, %r10, 8;
add.s64 %rd6, %rd4, %rd5;
ld.global.u16 %rs8, [%rd6];
// begin inline asm
{ cvt.f32.f16 %f17, %rs8;}
// end inline asm
ld.global.u16 %rs9, [%rd6+2];
// begin inline asm
{ cvt.f32.f16 %f18, %rs9;}
// end inline asm
ld.global.u16 %rs10, [%rd6+4];
// begin inline asm
{ cvt.f32.f16 %f19, %rs10;}
// end inline asm
mul.f32 %f20, %f18, 0f3F372474;
fma.rn.f32 %f21, %f17, 0f3E59999A, %f20;
fma.rn.f32 %f22, %f19, 0f3D93A92A, %f21;
ld.const.u64 %rd7, [params+160];
cvta.to.global.u64 %rd8, %rd7;
ld.const.u32 %r11, [params+152];
mad.lo.s32 %r12, %r11, %r2, %r1;
mul.wide.u32 %rd9, %r12, 16;
add.s64 %rd1, %rd8, %rd9;
ld.global.v4.f32 {%f23, %f24, %f25, %f26}, [%rd1];
ld.const.u64 %rd10, [params+144];
cvta.to.global.u64 %rd11, %rd10;
ld.const.u32 %r13, [params+136];
mad.lo.s32 %r14, %r13, %r2, %r1;
mul.wide.u32 %rd12, %r14, 4;
add.s64 %rd13, %rd11, %rd12;
ld.global.v4.u8 {%rs11, %rs12, %rs13, %rs14}, [%rd13];
cvt.rn.f32.u16 %f30, %rs11;
div.rn.f32 %f31, %f30, 0f437F0000;
fma.rn.f32 %f32, %f31, 0f40000000, 0fBF800000;
cvt.rn.f32.u16 %f33, %rs12;
div.rn.f32 %f34, %f33, 0f437F0000;
fma.rn.f32 %f35, %f34, 0f40000000, 0fBF800000;
cvt.rn.f32.u16 %f36, %rs13;
div.rn.f32 %f37, %f36, 0f437F0000;
fma.rn.f32 %f38, %f37, 0f40000000, 0fBF800000;
mul.f32 %f39, %f35, %f35;
fma.rn.f32 %f40, %f32, %f32, %f39;
fma.rn.f32 %f41, %f38, %f38, %f40;
sqrt.rn.f32 %f42, %f41;
rcp.rn.f32 %f43, %f42;
mul.f32 %f44, %f32, %f43;
mul.f32 %f45, %f35, %f43;
mul.f32 %f46, %f43, %f38;
fma.rn.f32 %f47, %f22, %f44, %f23;
fma.rn.f32 %f48, %f22, %f45, %f24;
fma.rn.f32 %f49, %f22, %f46, %f25;
cvt.rn.f32.u16 %f50, %rs14;
div.rn.f32 %f51, %f50, 0f437F0000;
ld.global.f32 %f52, [%rd1+12];
min.f32 %f90, %f51, %f52;
mul.f32 %f2, %f47, %f90;
mul.f32 %f3, %f48, %f90;
mul.f32 %f4, %f49, %f90;
ld.const.f32 %f53, [params+1168];
setp.gt.f32 %p1, %f53, 0f3F000000;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
mul.f32 %f54, %f3, %f3;
fma.rn.f32 %f55, %f2, %f2, %f54;
fma.rn.f32 %f56, %f4, %f4, %f55;
sqrt.rn.f32 %f57, %f56;
rcp.rn.f32 %f58, %f57;
mul.f32 %f5, %f2, %f58;
mul.f32 %f6, %f3, %f58;
mul.f32 %f7, %f4, %f58;
ld.const.u64 %rd14, [params+400];
cvta.to.global.u64 %rd15, %rd14;
ld.const.u32 %r15, [params+392];
mad.lo.s32 %r16, %r15, %r2, %r1;
mul.wide.u32 %rd16, %r16, 4;
add.s64 %rd2, %rd15, %rd16;
ld.global.v2.u8 {%rs15, %rs28}, [%rd2];
or.b16 %rs17, %rs15, %rs28;
and.b16 %rs18, %rs17, 255;
setp.eq.s16 %p2, %rs18, 0;
@%p2 bra $L__BB0_4;
ld.global.u8 %rs27, [%rd2+2];
bra.uni $L__BB0_5;
$L__BB0_1:
st.global.v4.f32 [%rd1], {%f2, %f3, %f4, %f90};
bra.uni $L__BB0_9;
$L__BB0_4:
ld.global.u8 %rs27, [%rd2+2];
setp.eq.s16 %p3, %rs27, 0;
mov.f32 %f87, 0f00000000;
mov.u16 %rs28, 0;
mov.f32 %f88, %f87;
mov.f32 %f89, %f87;
@%p3 bra $L__BB0_6;
$L__BB0_5:
cvt.rn.f32.u16 %f62, %rs15;
div.rn.f32 %f63, %f62, 0f437F0000;
fma.rn.f32 %f64, %f63, 0f40000000, 0fBF800000;
and.b16 %rs21, %rs28, 255;
cvt.rn.f32.u16 %f65, %rs21;
div.rn.f32 %f66, %f65, 0f437F0000;
fma.rn.f32 %f67, %f66, 0f40000000, 0fBF800000;
cvt.rn.f32.u16 %f68, %rs27;
div.rn.f32 %f69, %f68, 0f437F0000;
fma.rn.f32 %f70, %f69, 0f40000000, 0fBF800000;
mul.f32 %f71, %f67, %f67;
fma.rn.f32 %f72, %f64, %f64, %f71;
fma.rn.f32 %f73, %f70, %f70, %f72;
sqrt.rn.f32 %f74, %f73;
rcp.rn.f32 %f75, %f74;
mul.f32 %f89, %f75, %f70;
mul.f32 %f88, %f75, %f67;
mul.f32 %f87, %f64, %f75;
$L__BB0_6:
mul.f32 %f76, %f6, %f88;
fma.rn.f32 %f77, %f5, %f87, %f76;
fma.rn.f32 %f14, %f7, %f89, %f77;
setp.leu.f32 %p4, %f90, 0f00000000;
@%p4 bra $L__BB0_8;
fma.rn.f32 %f78, %f14, 0f3F000000, 0f3F000000;
mov.f32 %f79, 0f3B808081;
max.f32 %f90, %f78, %f79;
$L__BB0_8:
ld.const.u64 %rd17, [params+1160];
cvta.to.global.u64 %rd18, %rd17;
ld.const.u32 %r21, [params+1152];
mad.lo.s32 %r26, %r21, %r2, %r1;
fma.rn.f32 %f80, %f5, 0f3F000000, 0f3F000000;
mul.f32 %f81, %f80, 0f437F0000;
cvt.rzi.u32.f32 %r27, %f81;
fma.rn.f32 %f82, %f6, 0f3F000000, 0f3F000000;
mul.f32 %f83, %f82, 0f437F0000;
cvt.rzi.u32.f32 %r28, %f83;
fma.rn.f32 %f84, %f7, 0f3F000000, 0f3F000000;
mul.f32 %f85, %f84, 0f437F0000;
cvt.rzi.u32.f32 %r29, %f85;
mul.f32 %f86, %f90, 0f437F0000;
cvt.rzi.u32.f32 %r30, %f86;
mul.wide.u32 %rd19, %r26, 4;
add.s64 %rd20, %rd18, %rd19;
cvt.u16.u32 %rs23, %r30;
cvt.u16.u32 %rs24, %r29;
cvt.u16.u32 %rs25, %r28;
cvt.u16.u32 %rs26, %r27;
st.global.v4.u8 [%rd20], {%rs26, %rs25, %rs24, %rs23};
$L__BB0_9:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 4b0c86b38310acc418b7497defaa6dbc
timeCreated: 1765545286
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
+111
View File
@@ -0,0 +1,111 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .b16 %rs<13>;
.reg .f32 %f<16>;
.reg .b32 %r<13>;
.reg .b64 %rd<9>;
mov.u32 %r1, %ctaid.x;
mov.u32 %r2, %ntid.x;
mov.u32 %r3, %tid.x;
mad.lo.s32 %r4, %r1, %r2, %r3;
mov.u32 %r5, %ctaid.y;
mov.u32 %r6, %ntid.y;
mov.u32 %r7, %tid.y;
mad.lo.s32 %r8, %r5, %r6, %r7;
ld.const.u64 %rd1, [params+144];
cvta.to.global.u64 %rd2, %rd1;
ld.const.u32 %r9, [params+136];
mad.lo.s32 %r10, %r9, %r8, %r4;
mul.wide.u32 %rd3, %r10, 8;
add.s64 %rd4, %rd2, %rd3;
ld.global.u16 %rs1, [%rd4+6];
// begin inline asm
{ cvt.f32.f16 %f1, %rs1;}
// end inline asm
ld.global.u16 %rs2, [%rd4];
// begin inline asm
{ cvt.f32.f16 %f2, %rs2;}
// end inline asm
ld.global.u16 %rs3, [%rd4+2];
// begin inline asm
{ cvt.f32.f16 %f3, %rs3;}
// end inline asm
ld.global.u16 %rs4, [%rd4+4];
// begin inline asm
{ cvt.f32.f16 %f4, %rs4;}
// end inline asm
ld.const.u64 %rd5, [params+160];
cvta.to.global.u64 %rd6, %rd5;
ld.const.u32 %r11, [params+152];
mad.lo.s32 %r12, %r11, %r8, %r4;
mul.wide.u32 %rd7, %r12, 8;
add.s64 %rd8, %rd6, %rd7;
ld.global.u16 %rs5, [%rd8+6];
// begin inline asm
{ cvt.f32.f16 %f5, %rs5;}
// end inline asm
ld.global.u16 %rs6, [%rd8];
// begin inline asm
{ cvt.f32.f16 %f6, %rs6;}
// end inline asm
ld.global.u16 %rs7, [%rd8+2];
// begin inline asm
{ cvt.f32.f16 %f7, %rs7;}
// end inline asm
ld.global.u16 %rs8, [%rd8+4];
// begin inline asm
{ cvt.f32.f16 %f8, %rs8;}
// end inline asm
add.f32 %f13, %f2, %f6;
add.f32 %f14, %f3, %f7;
add.f32 %f15, %f4, %f8;
mul.f32 %f9, %f1, %f13;
mul.f32 %f10, %f1, %f14;
mul.f32 %f11, %f1, %f15;
min.f32 %f12, %f1, %f5;
// begin inline asm
{ cvt.rn.f16.f32 %rs12, %f12;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs11, %f11;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs10, %f10;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs9, %f9;}
// end inline asm
st.global.v4.u16 [%rd8], {%rs9, %rs10, %rs11, %rs12};
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: b70186849e4f4e546ae5f08c7bb75ea0
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,140 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-23083092
// Cuda compilation tools, release 9.1, V9.1.85
// Based on LLVM 3.4svn
//
.version 6.1
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain(
)
{
.reg .b16 %rs<31>;
.reg .f32 %f<20>;
.reg .b32 %r<15>;
.reg .b64 %rd<13>;
mov.u32 %r1, %ctaid.x;
mov.u32 %r2, %ntid.x;
mov.u32 %r3, %tid.x;
mad.lo.s32 %r4, %r2, %r1, %r3;
mov.u32 %r5, %ctaid.y;
mov.u32 %r6, %ntid.y;
mov.u32 %r7, %tid.y;
mad.lo.s32 %r8, %r6, %r5, %r7;
ld.const.u64 %rd1, [params+144];
cvta.to.global.u64 %rd2, %rd1;
ld.const.u32 %r9, [params+136];
mad.lo.s32 %r10, %r9, %r8, %r4;
mul.wide.u32 %rd3, %r10, 8;
add.s64 %rd4, %rd2, %rd3;
ld.global.v4.u16 {%rs19, %rs20, %rs21, %rs22}, [%rd4];
// inline asm
{ cvt.f32.f16 %f1, %rs22;}
// inline asm
// inline asm
{ cvt.f32.f16 %f2, %rs19;}
// inline asm
// inline asm
{ cvt.f32.f16 %f3, %rs20;}
// inline asm
// inline asm
{ cvt.f32.f16 %f4, %rs21;}
// inline asm
ld.const.u64 %rd5, [params+160];
cvta.to.global.u64 %rd6, %rd5;
ld.const.u32 %r11, [params+152];
mad.lo.s32 %r12, %r11, %r8, %r4;
mul.wide.u32 %rd7, %r12, 8;
add.s64 %rd8, %rd6, %rd7;
ld.global.v4.u16 {%rs23, %rs24, %rs25, %rs26}, [%rd8];
// inline asm
{ cvt.f32.f16 %f5, %rs26;}
// inline asm
// inline asm
{ cvt.f32.f16 %f6, %rs23;}
// inline asm
// inline asm
{ cvt.f32.f16 %f7, %rs24;}
// inline asm
// inline asm
{ cvt.f32.f16 %f8, %rs25;}
// inline asm
add.f32 %f9, %f2, %f6;
add.f32 %f10, %f3, %f7;
add.f32 %f11, %f4, %f8;
min.f32 %f12, %f1, %f5;
// inline asm
{ cvt.rn.f16.f32 %rs12, %f12;}
// inline asm
// inline asm
{ cvt.rn.f16.f32 %rs11, %f11;}
// inline asm
// inline asm
{ cvt.rn.f16.f32 %rs10, %f10;}
// inline asm
// inline asm
{ cvt.rn.f16.f32 %rs9, %f9;}
// inline asm
st.global.v4.u16 [%rd8], {%rs9, %rs10, %rs11, %rs12};
ld.const.u64 %rd9, [params+744];
cvta.to.global.u64 %rd10, %rd9;
ld.const.u32 %r13, [params+736];
mad.lo.s32 %r14, %r13, %r8, %r4;
mul.wide.u32 %rd11, %r14, 8;
add.s64 %rd12, %rd10, %rd11;
ld.global.v4.u16 {%rs27, %rs28, %rs29, %rs30}, [%rd12];
// inline asm
{ cvt.f32.f16 %f13, %rs27;}
// inline asm
// inline asm
{ cvt.f32.f16 %f14, %rs28;}
// inline asm
// inline asm
{ cvt.f32.f16 %f15, %rs29;}
// inline asm
ld.const.f32 %f19, [params+752];
fma.rn.f32 %f16, %f2, %f19, %f13;
fma.rn.f32 %f17, %f3, %f19, %f14;
fma.rn.f32 %f18, %f4, %f19, %f15;
// inline asm
{ cvt.rn.f16.f32 %rs18, %f18;}
// inline asm
// inline asm
{ cvt.rn.f16.f32 %rs17, %f17;}
// inline asm
// inline asm
{ cvt.rn.f16.f32 %rs16, %f16;}
// inline asm
st.global.v4.u16 [%rd12], {%rs16, %rs17, %rs18, %rs12};
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: aa19402ba85dcd241ae909161efb299b
timeCreated: 1765669197
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
+437
View File
@@ -0,0 +1,437 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<2>;
.reg .b16 %rs<53>;
.reg .f32 %f<134>;
.reg .b32 %r<42>;
.reg .b64 %rd<45>;
mov.u32 %r3, %ctaid.x;
mov.u32 %r4, %ntid.x;
mov.u32 %r5, %tid.x;
mad.lo.s32 %r1, %r3, %r4, %r5;
mov.u32 %r6, %ntid.y;
mov.u32 %r7, %ctaid.y;
mov.u32 %r8, %tid.y;
mad.lo.s32 %r2, %r7, %r6, %r8;
ld.const.u64 %rd4, [params+784];
cvta.to.global.u64 %rd5, %rd4;
ld.const.u32 %r9, [params+776];
mad.lo.s32 %r10, %r9, %r2, %r1;
mul.wide.u32 %rd6, %r10, 8;
add.s64 %rd7, %rd5, %rd6;
ld.global.u16 %rs1, [%rd7];
// begin inline asm
{ cvt.f32.f16 %f11, %rs1;}
// end inline asm
ld.global.u16 %rs2, [%rd7+2];
// begin inline asm
{ cvt.f32.f16 %f12, %rs2;}
// end inline asm
ld.global.u16 %rs3, [%rd7+4];
// begin inline asm
{ cvt.f32.f16 %f13, %rs3;}
// end inline asm
ld.const.u64 %rd8, [params+800];
cvta.to.global.u64 %rd9, %rd8;
ld.const.u32 %r11, [params+792];
mad.lo.s32 %r12, %r11, %r2, %r1;
mul.wide.u32 %rd10, %r12, 8;
add.s64 %rd11, %rd9, %rd10;
ld.global.u16 %rs4, [%rd11];
// begin inline asm
{ cvt.f32.f16 %f14, %rs4;}
// end inline asm
ld.global.u16 %rs5, [%rd11+2];
// begin inline asm
{ cvt.f32.f16 %f15, %rs5;}
// end inline asm
ld.global.u16 %rs6, [%rd11+4];
// begin inline asm
{ cvt.f32.f16 %f16, %rs6;}
// end inline asm
fma.rn.f32 %f41, %f14, 0f40000000, 0fBF800000;
fma.rn.f32 %f42, %f15, 0f40000000, 0fBF800000;
fma.rn.f32 %f43, %f16, 0f40000000, 0fBF800000;
ld.const.u64 %rd12, [params+816];
cvta.to.global.u64 %rd13, %rd12;
ld.const.u32 %r13, [params+808];
mad.lo.s32 %r14, %r13, %r2, %r1;
mul.wide.u32 %rd14, %r14, 8;
add.s64 %rd15, %rd13, %rd14;
ld.global.u16 %rs7, [%rd15];
// begin inline asm
{ cvt.f32.f16 %f17, %rs7;}
// end inline asm
ld.global.u16 %rs8, [%rd15+2];
// begin inline asm
{ cvt.f32.f16 %f18, %rs8;}
// end inline asm
ld.global.u16 %rs9, [%rd15+4];
// begin inline asm
{ cvt.f32.f16 %f19, %rs9;}
// end inline asm
fma.rn.f32 %f44, %f17, 0f40000000, 0fBF800000;
fma.rn.f32 %f45, %f18, 0f40000000, 0fBF800000;
fma.rn.f32 %f46, %f19, 0f40000000, 0fBF800000;
ld.const.u64 %rd16, [params+832];
cvta.to.global.u64 %rd17, %rd16;
ld.const.u32 %r15, [params+824];
mad.lo.s32 %r16, %r15, %r2, %r1;
mul.wide.u32 %rd18, %r16, 8;
add.s64 %rd19, %rd17, %rd18;
ld.global.u16 %rs10, [%rd19];
// begin inline asm
{ cvt.f32.f16 %f20, %rs10;}
// end inline asm
ld.global.u16 %rs11, [%rd19+2];
// begin inline asm
{ cvt.f32.f16 %f21, %rs11;}
// end inline asm
ld.global.u16 %rs12, [%rd19+4];
// begin inline asm
{ cvt.f32.f16 %f22, %rs12;}
// end inline asm
fma.rn.f32 %f47, %f20, 0f40000000, 0fBF800000;
fma.rn.f32 %f48, %f21, 0f40000000, 0fBF800000;
fma.rn.f32 %f49, %f22, 0f40000000, 0fBF800000;
ld.const.u64 %rd20, [params+928];
cvta.to.global.u64 %rd21, %rd20;
ld.const.u32 %r17, [params+920];
mad.lo.s32 %r18, %r17, %r2, %r1;
mul.wide.u32 %rd22, %r18, 8;
add.s64 %rd23, %rd21, %rd22;
ld.global.u16 %rs13, [%rd23];
// begin inline asm
{ cvt.f32.f16 %f23, %rs13;}
// end inline asm
ld.global.u16 %rs14, [%rd23+2];
// begin inline asm
{ cvt.f32.f16 %f24, %rs14;}
// end inline asm
ld.global.u16 %rs15, [%rd23+4];
// begin inline asm
{ cvt.f32.f16 %f25, %rs15;}
// end inline asm
ld.const.u64 %rd24, [params+944];
cvta.to.global.u64 %rd25, %rd24;
ld.const.u32 %r19, [params+936];
mad.lo.s32 %r20, %r19, %r2, %r1;
mul.wide.u32 %rd26, %r20, 8;
add.s64 %rd1, %rd25, %rd26;
ld.global.u16 %rs16, [%rd1];
// begin inline asm
{ cvt.f32.f16 %f26, %rs16;}
// end inline asm
ld.global.u16 %rs17, [%rd1+2];
// begin inline asm
{ cvt.f32.f16 %f27, %rs17;}
// end inline asm
ld.global.u16 %rs18, [%rd1+4];
// begin inline asm
{ cvt.f32.f16 %f28, %rs18;}
// end inline asm
fma.rn.f32 %f50, %f26, 0f40000000, 0fBF800000;
fma.rn.f32 %f51, %f27, 0f40000000, 0fBF800000;
fma.rn.f32 %f52, %f28, 0f40000000, 0fBF800000;
mul.f32 %f53, %f23, %f50;
mul.f32 %f54, %f24, %f51;
mul.f32 %f55, %f25, %f52;
ld.const.u64 %rd27, [params+960];
cvta.to.global.u64 %rd28, %rd27;
ld.const.u32 %r21, [params+952];
mad.lo.s32 %r22, %r21, %r2, %r1;
mul.wide.u32 %rd29, %r22, 8;
add.s64 %rd2, %rd28, %rd29;
ld.global.u16 %rs19, [%rd2];
// begin inline asm
{ cvt.f32.f16 %f29, %rs19;}
// end inline asm
ld.global.u16 %rs20, [%rd2+2];
// begin inline asm
{ cvt.f32.f16 %f30, %rs20;}
// end inline asm
ld.global.u16 %rs21, [%rd2+4];
// begin inline asm
{ cvt.f32.f16 %f31, %rs21;}
// end inline asm
fma.rn.f32 %f56, %f29, 0f40000000, 0fBF800000;
fma.rn.f32 %f57, %f30, 0f40000000, 0fBF800000;
fma.rn.f32 %f58, %f31, 0f40000000, 0fBF800000;
mul.f32 %f59, %f23, %f56;
mul.f32 %f60, %f24, %f57;
mul.f32 %f61, %f25, %f58;
ld.const.u64 %rd30, [params+976];
cvta.to.global.u64 %rd31, %rd30;
ld.const.u32 %r23, [params+968];
mad.lo.s32 %r24, %r23, %r2, %r1;
mul.wide.u32 %rd32, %r24, 8;
add.s64 %rd3, %rd31, %rd32;
ld.global.u16 %rs22, [%rd3];
// begin inline asm
{ cvt.f32.f16 %f32, %rs22;}
// end inline asm
ld.global.u16 %rs23, [%rd3+2];
// begin inline asm
{ cvt.f32.f16 %f33, %rs23;}
// end inline asm
ld.global.u16 %rs24, [%rd3+4];
// begin inline asm
{ cvt.f32.f16 %f34, %rs24;}
// end inline asm
fma.rn.f32 %f62, %f32, 0f40000000, 0fBF800000;
fma.rn.f32 %f63, %f33, 0f40000000, 0fBF800000;
fma.rn.f32 %f64, %f34, 0f40000000, 0fBF800000;
mul.f32 %f65, %f23, %f62;
mul.f32 %f66, %f24, %f63;
mul.f32 %f67, %f25, %f64;
ld.global.u16 %rs25, [%rd7+6];
// begin inline asm
{ cvt.f32.f16 %f35, %rs25;}
// end inline asm
ld.global.u16 %rs26, [%rd23+6];
// begin inline asm
{ cvt.f32.f16 %f36, %rs26;}
// end inline asm
min.f32 %f40, %f35, %f36;
add.f32 %f68, %f11, %f23;
add.f32 %f69, %f12, %f24;
add.f32 %f70, %f13, %f25;
fma.rn.f32 %f71, %f11, %f41, %f53;
fma.rn.f32 %f72, %f12, %f42, %f54;
fma.rn.f32 %f73, %f13, %f43, %f55;
fma.rn.f32 %f74, %f11, %f44, %f59;
fma.rn.f32 %f75, %f12, %f45, %f60;
fma.rn.f32 %f76, %f13, %f46, %f61;
fma.rn.f32 %f77, %f11, %f47, %f65;
fma.rn.f32 %f78, %f12, %f48, %f66;
fma.rn.f32 %f79, %f13, %f49, %f67;
mov.f32 %f80, 0f34000000;
max.f32 %f81, %f68, %f80;
max.f32 %f82, %f69, %f80;
max.f32 %f83, %f70, %f80;
div.rn.f32 %f84, %f71, %f81;
div.rn.f32 %f85, %f72, %f82;
div.rn.f32 %f86, %f73, %f83;
fma.rn.f32 %f87, %f84, 0f3F000000, 0f3F000000;
fma.rn.f32 %f88, %f85, 0f3F000000, 0f3F000000;
fma.rn.f32 %f89, %f86, 0f3F000000, 0f3F000000;
div.rn.f32 %f90, %f74, %f81;
div.rn.f32 %f91, %f75, %f82;
div.rn.f32 %f92, %f76, %f83;
fma.rn.f32 %f93, %f90, 0f3F000000, 0f3F000000;
fma.rn.f32 %f94, %f91, 0f3F000000, 0f3F000000;
fma.rn.f32 %f95, %f92, 0f3F000000, 0f3F000000;
div.rn.f32 %f96, %f77, %f81;
div.rn.f32 %f97, %f78, %f82;
div.rn.f32 %f98, %f79, %f83;
fma.rn.f32 %f99, %f96, 0f3F000000, 0f3F000000;
fma.rn.f32 %f100, %f97, 0f3F000000, 0f3F000000;
fma.rn.f32 %f101, %f98, 0f3F000000, 0f3F000000;
mul.f32 %f37, %f68, %f40;
mul.f32 %f38, %f69, %f40;
mul.f32 %f39, %f70, %f40;
mul.f32 %f2, %f40, %f87;
mul.f32 %f3, %f40, %f88;
mul.f32 %f4, %f40, %f89;
mul.f32 %f5, %f40, %f93;
mul.f32 %f6, %f40, %f94;
mul.f32 %f7, %f40, %f95;
mul.f32 %f8, %f40, %f99;
mul.f32 %f9, %f40, %f100;
mul.f32 %f10, %f40, %f101;
// begin inline asm
{ cvt.rn.f16.f32 %rs29, %f39;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs28, %f38;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs27, %f37;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs30, %f40;}
// end inline asm
st.global.v4.u16 [%rd23], {%rs27, %rs28, %rs29, %rs30};
ld.const.u32 %r25, [params+1112];
setp.gt.s32 %p1, %r25, 0;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
mul.f32 %f114, %f2, 0f437F0000;
mov.f32 %f115, 0f437F0000;
min.f32 %f116, %f114, %f115;
mul.f32 %f117, %f3, 0f437F0000;
min.f32 %f118, %f117, %f115;
mul.f32 %f119, %f4, 0f437F0000;
min.f32 %f120, %f119, %f115;
mul.f32 %f121, %f5, 0f437F0000;
min.f32 %f122, %f121, %f115;
mul.f32 %f123, %f6, 0f437F0000;
min.f32 %f124, %f123, %f115;
mul.f32 %f125, %f7, 0f437F0000;
min.f32 %f126, %f125, %f115;
mul.f32 %f127, %f8, 0f437F0000;
min.f32 %f128, %f127, %f115;
mul.f32 %f129, %f9, 0f437F0000;
min.f32 %f130, %f129, %f115;
mul.f32 %f131, %f10, 0f437F0000;
min.f32 %f132, %f131, %f115;
ld.const.u64 %rd33, [params+1072];
cvta.to.global.u64 %rd34, %rd33;
ld.const.u32 %r26, [params+1064];
mad.lo.s32 %r27, %r26, %r2, %r1;
cvt.rzi.u32.f32 %r28, %f116;
cvt.rzi.u32.f32 %r29, %f118;
cvt.rzi.u32.f32 %r30, %f120;
mul.f32 %f133, %f40, 0f437F0000;
cvt.rzi.u32.f32 %r31, %f133;
mul.wide.u32 %rd35, %r27, 4;
add.s64 %rd36, %rd34, %rd35;
cvt.u16.u32 %rs43, %r30;
cvt.u16.u32 %rs44, %r29;
cvt.u16.u32 %rs45, %r28;
cvt.u16.u32 %rs46, %r31;
st.global.v4.u8 [%rd36], {%rs45, %rs44, %rs43, %rs46};
ld.const.u64 %rd37, [params+1088];
cvta.to.global.u64 %rd38, %rd37;
ld.const.u32 %r32, [params+1080];
mad.lo.s32 %r33, %r32, %r2, %r1;
cvt.rzi.u32.f32 %r34, %f122;
cvt.rzi.u32.f32 %r35, %f124;
cvt.rzi.u32.f32 %r36, %f126;
mul.wide.u32 %rd39, %r33, 4;
add.s64 %rd40, %rd38, %rd39;
cvt.u16.u32 %rs47, %r36;
cvt.u16.u32 %rs48, %r35;
cvt.u16.u32 %rs49, %r34;
st.global.v4.u8 [%rd40], {%rs49, %rs48, %rs47, %rs46};
ld.const.u64 %rd41, [params+1104];
cvta.to.global.u64 %rd42, %rd41;
ld.const.u32 %r37, [params+1096];
mad.lo.s32 %r38, %r37, %r2, %r1;
cvt.rzi.u32.f32 %r39, %f128;
cvt.rzi.u32.f32 %r40, %f130;
cvt.rzi.u32.f32 %r41, %f132;
mul.wide.u32 %rd43, %r38, 4;
add.s64 %rd44, %rd42, %rd43;
cvt.u16.u32 %rs50, %r41;
cvt.u16.u32 %rs51, %r40;
cvt.u16.u32 %rs52, %r39;
st.global.v4.u8 [%rd44], {%rs52, %rs51, %rs50, %rs46};
bra.uni $L__BB0_3;
$L__BB0_1:
cvt.sat.f32.f32 %f102, %f2;
cvt.sat.f32.f32 %f103, %f3;
cvt.sat.f32.f32 %f104, %f4;
// begin inline asm
{ cvt.rn.f16.f32 %rs34, %f40;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs33, %f104;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs32, %f103;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs31, %f102;}
// end inline asm
st.global.v4.u16 [%rd1], {%rs31, %rs32, %rs33, %rs34};
cvt.sat.f32.f32 %f106, %f5;
cvt.sat.f32.f32 %f107, %f6;
cvt.sat.f32.f32 %f108, %f7;
// begin inline asm
{ cvt.rn.f16.f32 %rs38, %f40;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs37, %f108;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs36, %f107;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs35, %f106;}
// end inline asm
st.global.v4.u16 [%rd2], {%rs35, %rs36, %rs37, %rs38};
cvt.sat.f32.f32 %f110, %f8;
cvt.sat.f32.f32 %f111, %f9;
cvt.sat.f32.f32 %f112, %f10;
// begin inline asm
{ cvt.rn.f16.f32 %rs42, %f40;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs41, %f112;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs40, %f111;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs39, %f110;}
// end inline asm
st.global.v4.u16 [%rd3], {%rs39, %rs40, %rs41, %rs42};
$L__BB0_3:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 953bb4da9de20924c8fcbfd390d7e313
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
+631
View File
@@ -0,0 +1,631 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .b16 %rs<93>;
.reg .f32 %f<120>;
.reg .b32 %r<45>;
.reg .b64 %rd<73>;
mov.u32 %r1, %ctaid.x;
mov.u32 %r2, %ntid.x;
mov.u32 %r3, %tid.x;
mad.lo.s32 %r4, %r1, %r2, %r3;
mov.u32 %r5, %ctaid.y;
mov.u32 %r6, %ntid.y;
mov.u32 %r7, %tid.y;
mad.lo.s32 %r8, %r5, %r6, %r7;
ld.const.u64 %rd1, [params+784];
cvta.to.global.u64 %rd2, %rd1;
ld.const.u32 %r9, [params+776];
mad.lo.s32 %r10, %r9, %r8, %r4;
mul.wide.u32 %rd3, %r10, 8;
add.s64 %rd4, %rd2, %rd3;
ld.global.u16 %rs1, [%rd4];
// begin inline asm
{ cvt.f32.f16 %f1, %rs1;}
// end inline asm
ld.global.u16 %rs2, [%rd4+2];
// begin inline asm
{ cvt.f32.f16 %f2, %rs2;}
// end inline asm
ld.global.u16 %rs3, [%rd4+4];
// begin inline asm
{ cvt.f32.f16 %f3, %rs3;}
// end inline asm
ld.const.u64 %rd5, [params+800];
cvta.to.global.u64 %rd6, %rd5;
ld.const.u32 %r11, [params+792];
mad.lo.s32 %r12, %r11, %r8, %r4;
mul.wide.u32 %rd7, %r12, 8;
add.s64 %rd8, %rd6, %rd7;
ld.global.u16 %rs4, [%rd8];
// begin inline asm
{ cvt.f32.f16 %f4, %rs4;}
// end inline asm
ld.global.u16 %rs5, [%rd8+2];
// begin inline asm
{ cvt.f32.f16 %f5, %rs5;}
// end inline asm
ld.global.u16 %rs6, [%rd8+4];
// begin inline asm
{ cvt.f32.f16 %f6, %rs6;}
// end inline asm
ld.const.u64 %rd9, [params+816];
cvta.to.global.u64 %rd10, %rd9;
ld.const.u32 %r13, [params+808];
mad.lo.s32 %r14, %r13, %r8, %r4;
mul.wide.u32 %rd11, %r14, 8;
add.s64 %rd12, %rd10, %rd11;
ld.global.u16 %rs7, [%rd12];
// begin inline asm
{ cvt.f32.f16 %f7, %rs7;}
// end inline asm
ld.global.u16 %rs8, [%rd12+2];
// begin inline asm
{ cvt.f32.f16 %f8, %rs8;}
// end inline asm
ld.global.u16 %rs9, [%rd12+4];
// begin inline asm
{ cvt.f32.f16 %f9, %rs9;}
// end inline asm
ld.const.u64 %rd13, [params+832];
cvta.to.global.u64 %rd14, %rd13;
ld.const.u32 %r15, [params+824];
mad.lo.s32 %r16, %r15, %r8, %r4;
mul.wide.u32 %rd15, %r16, 8;
add.s64 %rd16, %rd14, %rd15;
ld.global.u16 %rs10, [%rd16];
// begin inline asm
{ cvt.f32.f16 %f10, %rs10;}
// end inline asm
ld.global.u16 %rs11, [%rd16+2];
// begin inline asm
{ cvt.f32.f16 %f11, %rs11;}
// end inline asm
ld.global.u16 %rs12, [%rd16+4];
// begin inline asm
{ cvt.f32.f16 %f12, %rs12;}
// end inline asm
ld.const.u64 %rd17, [params+848];
cvta.to.global.u64 %rd18, %rd17;
ld.const.u32 %r17, [params+840];
mad.lo.s32 %r18, %r17, %r8, %r4;
mul.wide.u32 %rd19, %r18, 8;
add.s64 %rd20, %rd18, %rd19;
ld.global.u16 %rs13, [%rd20];
// begin inline asm
{ cvt.f32.f16 %f13, %rs13;}
// end inline asm
ld.global.u16 %rs14, [%rd20+2];
// begin inline asm
{ cvt.f32.f16 %f14, %rs14;}
// end inline asm
ld.global.u16 %rs15, [%rd20+4];
// begin inline asm
{ cvt.f32.f16 %f15, %rs15;}
// end inline asm
ld.const.u64 %rd21, [params+864];
cvta.to.global.u64 %rd22, %rd21;
ld.const.u32 %r19, [params+856];
mad.lo.s32 %r20, %r19, %r8, %r4;
mul.wide.u32 %rd23, %r20, 8;
add.s64 %rd24, %rd22, %rd23;
ld.global.u16 %rs16, [%rd24];
// begin inline asm
{ cvt.f32.f16 %f16, %rs16;}
// end inline asm
ld.global.u16 %rs17, [%rd24+2];
// begin inline asm
{ cvt.f32.f16 %f17, %rs17;}
// end inline asm
ld.global.u16 %rs18, [%rd24+4];
// begin inline asm
{ cvt.f32.f16 %f18, %rs18;}
// end inline asm
ld.const.u64 %rd25, [params+880];
cvta.to.global.u64 %rd26, %rd25;
ld.const.u32 %r21, [params+872];
mad.lo.s32 %r22, %r21, %r8, %r4;
mul.wide.u32 %rd27, %r22, 8;
add.s64 %rd28, %rd26, %rd27;
ld.global.u16 %rs19, [%rd28];
// begin inline asm
{ cvt.f32.f16 %f19, %rs19;}
// end inline asm
ld.global.u16 %rs20, [%rd28+2];
// begin inline asm
{ cvt.f32.f16 %f20, %rs20;}
// end inline asm
ld.global.u16 %rs21, [%rd28+4];
// begin inline asm
{ cvt.f32.f16 %f21, %rs21;}
// end inline asm
ld.const.u64 %rd29, [params+896];
cvta.to.global.u64 %rd30, %rd29;
ld.const.u32 %r23, [params+888];
mad.lo.s32 %r24, %r23, %r8, %r4;
mul.wide.u32 %rd31, %r24, 8;
add.s64 %rd32, %rd30, %rd31;
ld.global.u16 %rs22, [%rd32];
// begin inline asm
{ cvt.f32.f16 %f22, %rs22;}
// end inline asm
ld.global.u16 %rs23, [%rd32+2];
// begin inline asm
{ cvt.f32.f16 %f23, %rs23;}
// end inline asm
ld.global.u16 %rs24, [%rd32+4];
// begin inline asm
{ cvt.f32.f16 %f24, %rs24;}
// end inline asm
ld.const.u64 %rd33, [params+912];
cvta.to.global.u64 %rd34, %rd33;
ld.const.u32 %r25, [params+904];
mad.lo.s32 %r26, %r25, %r8, %r4;
mul.wide.u32 %rd35, %r26, 8;
add.s64 %rd36, %rd34, %rd35;
ld.global.u16 %rs25, [%rd36];
// begin inline asm
{ cvt.f32.f16 %f25, %rs25;}
// end inline asm
ld.global.u16 %rs26, [%rd36+2];
// begin inline asm
{ cvt.f32.f16 %f26, %rs26;}
// end inline asm
ld.global.u16 %rs27, [%rd36+4];
// begin inline asm
{ cvt.f32.f16 %f27, %rs27;}
// end inline asm
ld.const.u64 %rd37, [params+928];
cvta.to.global.u64 %rd38, %rd37;
ld.const.u32 %r27, [params+920];
mad.lo.s32 %r28, %r27, %r8, %r4;
mul.wide.u32 %rd39, %r28, 8;
add.s64 %rd40, %rd38, %rd39;
ld.global.u16 %rs28, [%rd40];
// begin inline asm
{ cvt.f32.f16 %f28, %rs28;}
// end inline asm
ld.global.u16 %rs29, [%rd40+2];
// begin inline asm
{ cvt.f32.f16 %f29, %rs29;}
// end inline asm
ld.global.u16 %rs30, [%rd40+4];
// begin inline asm
{ cvt.f32.f16 %f30, %rs30;}
// end inline asm
ld.const.u64 %rd41, [params+944];
cvta.to.global.u64 %rd42, %rd41;
ld.const.u32 %r29, [params+936];
mad.lo.s32 %r30, %r29, %r8, %r4;
mul.wide.u32 %rd43, %r30, 8;
add.s64 %rd44, %rd42, %rd43;
ld.global.u16 %rs31, [%rd44];
// begin inline asm
{ cvt.f32.f16 %f31, %rs31;}
// end inline asm
ld.global.u16 %rs32, [%rd44+2];
// begin inline asm
{ cvt.f32.f16 %f32, %rs32;}
// end inline asm
ld.global.u16 %rs33, [%rd44+4];
// begin inline asm
{ cvt.f32.f16 %f33, %rs33;}
// end inline asm
ld.const.u64 %rd45, [params+960];
cvta.to.global.u64 %rd46, %rd45;
ld.const.u32 %r31, [params+952];
mad.lo.s32 %r32, %r31, %r8, %r4;
mul.wide.u32 %rd47, %r32, 8;
add.s64 %rd48, %rd46, %rd47;
ld.global.u16 %rs34, [%rd48];
// begin inline asm
{ cvt.f32.f16 %f34, %rs34;}
// end inline asm
ld.global.u16 %rs35, [%rd48+2];
// begin inline asm
{ cvt.f32.f16 %f35, %rs35;}
// end inline asm
ld.global.u16 %rs36, [%rd48+4];
// begin inline asm
{ cvt.f32.f16 %f36, %rs36;}
// end inline asm
ld.const.u64 %rd49, [params+976];
cvta.to.global.u64 %rd50, %rd49;
ld.const.u32 %r33, [params+968];
mad.lo.s32 %r34, %r33, %r8, %r4;
mul.wide.u32 %rd51, %r34, 8;
add.s64 %rd52, %rd50, %rd51;
ld.global.u16 %rs37, [%rd52];
// begin inline asm
{ cvt.f32.f16 %f37, %rs37;}
// end inline asm
ld.global.u16 %rs38, [%rd52+2];
// begin inline asm
{ cvt.f32.f16 %f38, %rs38;}
// end inline asm
ld.global.u16 %rs39, [%rd52+4];
// begin inline asm
{ cvt.f32.f16 %f39, %rs39;}
// end inline asm
ld.const.u64 %rd53, [params+992];
cvta.to.global.u64 %rd54, %rd53;
ld.const.u32 %r35, [params+984];
mad.lo.s32 %r36, %r35, %r8, %r4;
mul.wide.u32 %rd55, %r36, 8;
add.s64 %rd56, %rd54, %rd55;
ld.global.u16 %rs40, [%rd56];
// begin inline asm
{ cvt.f32.f16 %f40, %rs40;}
// end inline asm
ld.global.u16 %rs41, [%rd56+2];
// begin inline asm
{ cvt.f32.f16 %f41, %rs41;}
// end inline asm
ld.global.u16 %rs42, [%rd56+4];
// begin inline asm
{ cvt.f32.f16 %f42, %rs42;}
// end inline asm
ld.const.u64 %rd57, [params+1008];
cvta.to.global.u64 %rd58, %rd57;
ld.const.u32 %r37, [params+1000];
mad.lo.s32 %r38, %r37, %r8, %r4;
mul.wide.u32 %rd59, %r38, 8;
add.s64 %rd60, %rd58, %rd59;
ld.global.u16 %rs43, [%rd60];
// begin inline asm
{ cvt.f32.f16 %f43, %rs43;}
// end inline asm
ld.global.u16 %rs44, [%rd60+2];
// begin inline asm
{ cvt.f32.f16 %f44, %rs44;}
// end inline asm
ld.global.u16 %rs45, [%rd60+4];
// begin inline asm
{ cvt.f32.f16 %f45, %rs45;}
// end inline asm
ld.const.u64 %rd61, [params+1024];
cvta.to.global.u64 %rd62, %rd61;
ld.const.u32 %r39, [params+1016];
mad.lo.s32 %r40, %r39, %r8, %r4;
mul.wide.u32 %rd63, %r40, 8;
add.s64 %rd64, %rd62, %rd63;
ld.global.u16 %rs46, [%rd64];
// begin inline asm
{ cvt.f32.f16 %f46, %rs46;}
// end inline asm
ld.global.u16 %rs47, [%rd64+2];
// begin inline asm
{ cvt.f32.f16 %f47, %rs47;}
// end inline asm
ld.global.u16 %rs48, [%rd64+4];
// begin inline asm
{ cvt.f32.f16 %f48, %rs48;}
// end inline asm
ld.const.u64 %rd65, [params+1040];
cvta.to.global.u64 %rd66, %rd65;
ld.const.u32 %r41, [params+1032];
mad.lo.s32 %r42, %r41, %r8, %r4;
mul.wide.u32 %rd67, %r42, 8;
add.s64 %rd68, %rd66, %rd67;
ld.global.u16 %rs49, [%rd68];
// begin inline asm
{ cvt.f32.f16 %f49, %rs49;}
// end inline asm
ld.global.u16 %rs50, [%rd68+2];
// begin inline asm
{ cvt.f32.f16 %f50, %rs50;}
// end inline asm
ld.global.u16 %rs51, [%rd68+4];
// begin inline asm
{ cvt.f32.f16 %f51, %rs51;}
// end inline asm
ld.const.u64 %rd69, [params+1056];
cvta.to.global.u64 %rd70, %rd69;
ld.const.u32 %r43, [params+1048];
mad.lo.s32 %r44, %r43, %r8, %r4;
mul.wide.u32 %rd71, %r44, 8;
add.s64 %rd72, %rd70, %rd71;
ld.global.u16 %rs52, [%rd72];
// begin inline asm
{ cvt.f32.f16 %f52, %rs52;}
// end inline asm
ld.global.u16 %rs53, [%rd72+2];
// begin inline asm
{ cvt.f32.f16 %f53, %rs53;}
// end inline asm
ld.global.u16 %rs54, [%rd72+4];
// begin inline asm
{ cvt.f32.f16 %f54, %rs54;}
// end inline asm
ld.global.u16 %rs55, [%rd4+6];
// begin inline asm
{ cvt.f32.f16 %f55, %rs55;}
// end inline asm
ld.global.u16 %rs56, [%rd40+6];
// begin inline asm
{ cvt.f32.f16 %f56, %rs56;}
// end inline asm
min.f32 %f92, %f55, %f56;
add.f32 %f93, %f1, %f28;
add.f32 %f94, %f2, %f29;
add.f32 %f95, %f3, %f30;
add.f32 %f96, %f4, %f31;
add.f32 %f97, %f5, %f32;
add.f32 %f98, %f6, %f33;
add.f32 %f99, %f7, %f34;
add.f32 %f100, %f8, %f35;
add.f32 %f101, %f9, %f36;
add.f32 %f102, %f10, %f37;
add.f32 %f103, %f11, %f38;
add.f32 %f104, %f12, %f39;
add.f32 %f105, %f13, %f40;
add.f32 %f106, %f14, %f41;
add.f32 %f107, %f15, %f42;
add.f32 %f108, %f16, %f43;
add.f32 %f109, %f17, %f44;
add.f32 %f110, %f18, %f45;
add.f32 %f111, %f19, %f46;
add.f32 %f112, %f20, %f47;
add.f32 %f113, %f21, %f48;
add.f32 %f114, %f22, %f49;
add.f32 %f115, %f23, %f50;
add.f32 %f116, %f24, %f51;
add.f32 %f117, %f25, %f52;
add.f32 %f118, %f26, %f53;
add.f32 %f119, %f27, %f54;
mul.f32 %f57, %f93, %f92;
mul.f32 %f58, %f94, %f92;
mul.f32 %f59, %f95, %f92;
mul.f32 %f61, %f96, %f92;
mul.f32 %f62, %f97, %f92;
mul.f32 %f63, %f98, %f92;
mul.f32 %f65, %f99, %f92;
mul.f32 %f66, %f100, %f92;
mul.f32 %f67, %f101, %f92;
mul.f32 %f69, %f102, %f92;
mul.f32 %f70, %f103, %f92;
mul.f32 %f71, %f104, %f92;
mul.f32 %f73, %f105, %f92;
mul.f32 %f74, %f106, %f92;
mul.f32 %f75, %f107, %f92;
mul.f32 %f77, %f108, %f92;
mul.f32 %f78, %f109, %f92;
mul.f32 %f79, %f110, %f92;
mul.f32 %f81, %f111, %f92;
mul.f32 %f82, %f112, %f92;
mul.f32 %f83, %f113, %f92;
mul.f32 %f85, %f114, %f92;
mul.f32 %f86, %f115, %f92;
mul.f32 %f87, %f116, %f92;
mul.f32 %f89, %f117, %f92;
mul.f32 %f90, %f118, %f92;
mul.f32 %f91, %f119, %f92;
// begin inline asm
{ cvt.rn.f16.f32 %rs59, %f59;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs58, %f58;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs57, %f57;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs60, %f92;}
// end inline asm
st.global.v4.u16 [%rd40], {%rs57, %rs58, %rs59, %rs60};
// begin inline asm
{ cvt.rn.f16.f32 %rs63, %f63;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs62, %f62;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs61, %f61;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs64, %f92;}
// end inline asm
st.global.v4.u16 [%rd44], {%rs61, %rs62, %rs63, %rs64};
// begin inline asm
{ cvt.rn.f16.f32 %rs67, %f67;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs66, %f66;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs65, %f65;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs68, %f92;}
// end inline asm
st.global.v4.u16 [%rd48], {%rs65, %rs66, %rs67, %rs68};
// begin inline asm
{ cvt.rn.f16.f32 %rs71, %f71;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs70, %f70;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs69, %f69;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs72, %f92;}
// end inline asm
st.global.v4.u16 [%rd52], {%rs69, %rs70, %rs71, %rs72};
// begin inline asm
{ cvt.rn.f16.f32 %rs75, %f75;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs74, %f74;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs73, %f73;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs76, %f92;}
// end inline asm
st.global.v4.u16 [%rd56], {%rs73, %rs74, %rs75, %rs76};
// begin inline asm
{ cvt.rn.f16.f32 %rs79, %f79;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs78, %f78;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs77, %f77;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs80, %f92;}
// end inline asm
st.global.v4.u16 [%rd60], {%rs77, %rs78, %rs79, %rs80};
// begin inline asm
{ cvt.rn.f16.f32 %rs83, %f83;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs82, %f82;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs81, %f81;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs84, %f92;}
// end inline asm
st.global.v4.u16 [%rd64], {%rs81, %rs82, %rs83, %rs84};
// begin inline asm
{ cvt.rn.f16.f32 %rs87, %f87;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs86, %f86;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs85, %f85;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs88, %f92;}
// end inline asm
st.global.v4.u16 [%rd68], {%rs85, %rs86, %rs87, %rs88};
// begin inline asm
{ cvt.rn.f16.f32 %rs91, %f91;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs90, %f90;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs89, %f89;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs92, %f92;}
// end inline asm
st.global.v4.u16 [%rd72], {%rs89, %rs90, %rs91, %rs92};
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 1380a778e2426264bb7bae5aff3b1499
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,160 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<3>;
.reg .b16 %rs<9>;
.reg .f32 %f<70>;
.reg .b32 %r<19>;
.reg .b64 %rd<38>;
ld.param.u32 %r2, [__direct_callable__oxMain_param_0];
ld.param.f32 %f1, [__direct_callable__oxMain_param_1];
ld.param.f32 %f2, [__direct_callable__oxMain_param_1+4];
ld.const.u64 %rd4, [params+24];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.u32 %rd6, %r2, 12;
add.s64 %rd7, %rd5, %rd6;
ld.global.s32 %rd1, [%rd7];
ld.global.s32 %rd2, [%rd7+4];
ld.global.s32 %rd3, [%rd7+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r2;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
mov.f32 %f69, 0f3F800000;
sub.f32 %f39, %f69, %f1;
sub.f32 %f68, %f39, %f2;
bra.uni $L__BB0_3;
$L__BB0_1:
sub.s32 %r3, %r2, %r1;
ld.const.v2.u64 {%rd8, %rd9}, [params+48];
cvta.to.global.u64 %rd12, %rd8;
mul.wide.u32 %rd13, %r3, 4;
add.s64 %rd14, %rd12, %rd13;
ld.const.u64 %rd15, [params+40];
cvta.to.global.u64 %rd16, %rd15;
shl.b64 %rd17, %rd1, 3;
add.s64 %rd18, %rd16, %rd17;
ld.global.v2.f32 {%f8, %f9}, [%rd18];
shl.b64 %rd19, %rd2, 3;
add.s64 %rd20, %rd16, %rd19;
ld.global.v2.f32 {%f12, %f13}, [%rd20];
shl.b64 %rd21, %rd3, 3;
add.s64 %rd22, %rd16, %rd21;
ld.global.v2.f32 {%f16, %f17}, [%rd22];
mov.f32 %f20, 0f3F800000;
sub.f32 %f21, %f20, %f1;
sub.f32 %f68, %f21, %f2;
mul.f32 %f22, %f1, %f12;
mul.f32 %f23, %f1, %f13;
fma.rn.f32 %f24, %f68, %f8, %f22;
fma.rn.f32 %f25, %f68, %f9, %f23;
fma.rn.f32 %f26, %f2, %f16, %f24;
fma.rn.f32 %f27, %f2, %f17, %f25;
ld.global.u32 %r4, [%rd14];
shr.u32 %r5, %r4, 16;
abs.f32 %f28, %f26;
cvt.rmi.f32.f32 %f29, %f28;
sub.f32 %f30, %f28, %f29;
abs.f32 %f31, %f27;
cvt.rmi.f32.f32 %f32, %f31;
sub.f32 %f33, %f31, %f32;
cvta.to.global.u64 %rd23, %rd9;
shl.b32 %r6, %r4, 4;
cvt.u64.u32 %rd24, %r6;
and.b64 %rd25, %rd24, 1048560;
add.s64 %rd26, %rd23, %rd25;
ld.global.v2.u32 {%r7, %r8}, [%rd26];
cvt.rn.f32.u32 %f34, %r7;
mul.f32 %f35, %f30, %f34;
cvt.rzi.u32.f32 %r11, %f35;
cvt.rn.f32.u32 %f36, %r8;
mul.f32 %f37, %f33, %f36;
cvt.rzi.u32.f32 %r12, %f37;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd27, %r13;
ld.global.u64 %rd28, [%rd26+8];
add.s64 %rd29, %rd28, %rd27;
ld.u8 %r14, [%rd29];
and.b32 %r15, %r5, %r14;
setp.eq.s32 %p2, %r15, 0;
selp.f32 %f69, 0f00000000, 0f3F800000, %p2;
$L__BB0_3:
cvt.u32.u64 %r16, %rd1;
cvt.u32.u64 %r17, %rd2;
cvt.u32.u64 %r18, %rd3;
ld.const.u64 %rd30, [params+16];
cvta.to.global.u64 %rd31, %rd30;
mul.wide.s32 %rd32, %r16, 24;
add.s64 %rd33, %rd31, %rd32;
mul.wide.s32 %rd34, %r17, 24;
add.s64 %rd35, %rd31, %rd34;
mul.wide.s32 %rd36, %r18, 24;
add.s64 %rd37, %rd31, %rd36;
ld.global.f32 %f40, [%rd33+12];
ld.global.f32 %f41, [%rd33+16];
ld.global.f32 %f42, [%rd33+20];
ld.global.f32 %f43, [%rd35+12];
mul.f32 %f44, %f1, %f43;
ld.global.f32 %f45, [%rd35+16];
mul.f32 %f46, %f1, %f45;
ld.global.f32 %f47, [%rd35+20];
mul.f32 %f48, %f1, %f47;
fma.rn.f32 %f49, %f68, %f40, %f44;
fma.rn.f32 %f50, %f68, %f41, %f46;
fma.rn.f32 %f51, %f68, %f42, %f48;
ld.global.f32 %f52, [%rd37+12];
ld.global.f32 %f53, [%rd37+16];
ld.global.f32 %f54, [%rd37+20];
fma.rn.f32 %f55, %f2, %f52, %f49;
fma.rn.f32 %f56, %f2, %f53, %f50;
fma.rn.f32 %f57, %f2, %f54, %f51;
mul.f32 %f58, %f56, %f56;
fma.rn.f32 %f59, %f55, %f55, %f58;
fma.rn.f32 %f60, %f57, %f57, %f59;
sqrt.rn.f32 %f61, %f60;
rcp.rn.f32 %f62, %f61;
mul.f32 %f63, %f57, %f62;
mul.f32 %f64, %f56, %f62;
mul.f32 %f65, %f55, %f62;
st.param.f32 [func_retval0+0], %f65;
st.param.f32 [func_retval0+4], %f64;
st.param.f32 [func_retval0+8], %f63;
st.param.f32 [func_retval0+24], %f69;
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 9f4e4d8ebdf0ed647b5a30fe1623fdd6
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,164 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<3>;
.reg .b16 %rs<9>;
.reg .f32 %f<72>;
.reg .b32 %r<19>;
.reg .b64 %rd<38>;
ld.param.u32 %r2, [__direct_callable__oxMain_param_0];
ld.param.f32 %f1, [__direct_callable__oxMain_param_1];
ld.param.f32 %f2, [__direct_callable__oxMain_param_1+4];
ld.const.u64 %rd4, [params+24];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.u32 %rd6, %r2, 12;
add.s64 %rd7, %rd5, %rd6;
ld.global.s32 %rd1, [%rd7];
ld.global.s32 %rd2, [%rd7+4];
ld.global.s32 %rd3, [%rd7+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r2;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
mov.f32 %f71, 0f3F800000;
bra.uni $L__BB0_3;
$L__BB0_1:
sub.s32 %r3, %r2, %r1;
ld.const.v2.u64 {%rd8, %rd9}, [params+48];
cvta.to.global.u64 %rd12, %rd8;
mul.wide.u32 %rd13, %r3, 4;
add.s64 %rd14, %rd12, %rd13;
ld.const.u64 %rd15, [params+40];
cvta.to.global.u64 %rd16, %rd15;
shl.b64 %rd17, %rd1, 3;
add.s64 %rd18, %rd16, %rd17;
ld.global.v2.f32 {%f5, %f6}, [%rd18];
shl.b64 %rd19, %rd2, 3;
add.s64 %rd20, %rd16, %rd19;
ld.global.v2.f32 {%f9, %f10}, [%rd20];
shl.b64 %rd21, %rd3, 3;
add.s64 %rd22, %rd16, %rd21;
ld.global.v2.f32 {%f13, %f14}, [%rd22];
mov.f32 %f17, 0f3F800000;
sub.f32 %f18, %f17, %f1;
sub.f32 %f19, %f18, %f2;
mul.f32 %f20, %f1, %f9;
mul.f32 %f21, %f1, %f10;
fma.rn.f32 %f22, %f19, %f5, %f20;
fma.rn.f32 %f23, %f19, %f6, %f21;
fma.rn.f32 %f24, %f2, %f13, %f22;
fma.rn.f32 %f25, %f2, %f14, %f23;
ld.global.u32 %r4, [%rd14];
shr.u32 %r5, %r4, 16;
abs.f32 %f26, %f24;
cvt.rmi.f32.f32 %f27, %f26;
sub.f32 %f28, %f26, %f27;
abs.f32 %f29, %f25;
cvt.rmi.f32.f32 %f30, %f29;
sub.f32 %f31, %f29, %f30;
cvta.to.global.u64 %rd23, %rd9;
shl.b32 %r6, %r4, 4;
cvt.u64.u32 %rd24, %r6;
and.b64 %rd25, %rd24, 1048560;
add.s64 %rd26, %rd23, %rd25;
ld.global.v2.u32 {%r7, %r8}, [%rd26];
cvt.rn.f32.u32 %f32, %r7;
mul.f32 %f33, %f28, %f32;
cvt.rzi.u32.f32 %r11, %f33;
cvt.rn.f32.u32 %f34, %r8;
mul.f32 %f35, %f31, %f34;
cvt.rzi.u32.f32 %r12, %f35;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd27, %r13;
ld.global.u64 %rd28, [%rd26+8];
add.s64 %rd29, %rd28, %rd27;
ld.u8 %r14, [%rd29];
and.b32 %r15, %r5, %r14;
setp.eq.s32 %p2, %r15, 0;
selp.f32 %f71, 0f00000000, 0f3F800000, %p2;
$L__BB0_3:
cvt.u32.u64 %r16, %rd1;
cvt.u32.u64 %r17, %rd2;
cvt.u32.u64 %r18, %rd3;
ld.const.u64 %rd30, [params+16];
cvta.to.global.u64 %rd31, %rd30;
mul.wide.s32 %rd32, %r16, 24;
add.s64 %rd33, %rd31, %rd32;
mul.wide.s32 %rd34, %r17, 24;
add.s64 %rd35, %rd31, %rd34;
mul.wide.s32 %rd36, %r18, 24;
add.s64 %rd37, %rd31, %rd36;
ld.global.f32 %f37, [%rd35];
ld.global.f32 %f38, [%rd33];
sub.f32 %f39, %f38, %f37;
ld.global.f32 %f40, [%rd35+4];
ld.global.f32 %f41, [%rd33+4];
sub.f32 %f42, %f41, %f40;
ld.global.f32 %f43, [%rd35+8];
ld.global.f32 %f44, [%rd33+8];
sub.f32 %f45, %f44, %f43;
ld.global.f32 %f46, [%rd37];
sub.f32 %f47, %f37, %f46;
ld.global.f32 %f48, [%rd37+4];
sub.f32 %f49, %f40, %f48;
ld.global.f32 %f50, [%rd37+8];
sub.f32 %f51, %f43, %f50;
mul.f32 %f52, %f42, %f51;
mul.f32 %f53, %f45, %f49;
sub.f32 %f54, %f52, %f53;
mul.f32 %f55, %f45, %f47;
mul.f32 %f56, %f39, %f51;
sub.f32 %f57, %f55, %f56;
mul.f32 %f58, %f39, %f49;
mul.f32 %f59, %f42, %f47;
sub.f32 %f60, %f58, %f59;
mul.f32 %f61, %f57, %f57;
fma.rn.f32 %f62, %f54, %f54, %f61;
fma.rn.f32 %f63, %f60, %f60, %f62;
sqrt.rn.f32 %f64, %f63;
rcp.rn.f32 %f65, %f64;
mul.f32 %f66, %f60, %f65;
mul.f32 %f67, %f65, %f57;
mul.f32 %f68, %f65, %f54;
st.param.f32 [func_retval0+0], %f68;
st.param.f32 [func_retval0+4], %f67;
st.param.f32 [func_retval0+8], %f66;
st.param.f32 [func_retval0+24], %f71;
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: a3ef3331adda75f48869609dc8a660d9
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,202 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<4>;
.reg .b16 %rs<41>;
.reg .f32 %f<106>;
.reg .b32 %r<29>;
.reg .b64 %rd<41>;
ld.param.u32 %r3, [__direct_callable__oxMain_param_0];
ld.param.f32 %f24, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f23, [__direct_callable__oxMain_param_1];
ld.const.u64 %rd4, [params+24];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.u32 %rd6, %r3, 12;
add.s64 %rd7, %rd5, %rd6;
ld.global.s32 %rd1, [%rd7];
ld.global.s32 %rd2, [%rd7+4];
ld.global.s32 %rd3, [%rd7+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r3;
@%p1 bra $L__BB0_4;
bra.uni $L__BB0_1;
$L__BB0_4:
mov.f32 %f105, 0f3F800000;
bra.uni $L__BB0_5;
$L__BB0_1:
sub.s32 %r4, %r3, %r1;
ld.const.u64 %rd8, [params+48];
cvta.to.global.u64 %rd9, %rd8;
mul.wide.u32 %rd10, %r4, 4;
add.s64 %rd11, %rd9, %rd10;
ld.const.u64 %rd12, [params+40];
cvta.to.global.u64 %rd13, %rd12;
shl.b64 %rd14, %rd1, 3;
add.s64 %rd15, %rd13, %rd14;
ld.global.v2.f32 {%f25, %f26}, [%rd15];
shl.b64 %rd16, %rd2, 3;
add.s64 %rd17, %rd13, %rd16;
ld.global.v2.f32 {%f29, %f30}, [%rd17];
shl.b64 %rd18, %rd3, 3;
add.s64 %rd19, %rd13, %rd18;
ld.global.v2.f32 {%f33, %f34}, [%rd19];
mov.f32 %f37, 0f3F800000;
sub.f32 %f38, %f37, %f23;
sub.f32 %f39, %f38, %f24;
mul.f32 %f40, %f23, %f29;
mul.f32 %f41, %f23, %f30;
fma.rn.f32 %f42, %f39, %f25, %f40;
fma.rn.f32 %f43, %f39, %f26, %f41;
fma.rn.f32 %f1, %f24, %f33, %f42;
fma.rn.f32 %f2, %f24, %f34, %f43;
ld.global.u32 %r2, [%rd11];
and.b32 %r5, %r2, -16384;
setp.eq.s32 %p2, %r5, 16384;
@%p2 bra $L__BB0_3;
bra.uni $L__BB0_2;
$L__BB0_3:
add.s32 %r17, %r2, -16384;
ld.const.u64 %rd28, [params+64];
cvta.to.global.u64 %rd29, %rd28;
mul.wide.u32 %rd30, %r17, 8;
add.s64 %rd31, %rd29, %rd30;
ld.global.u64 %rd32, [%rd31];
tex.2d.v4.f32.f32 {%f54, %f55, %f56, %f57}, [%rd32, {%f1, %f2}];
cvt.sat.f32.f32 %f58, %f54;
mul.f32 %f59, %f58, 0f437F0000;
cvt.rzi.s32.f32 %r18, %f59;
cvt.sat.f32.f32 %f60, %f55;
mul.f32 %f61, %f60, 0f437F0000;
cvt.rzi.s32.f32 %r19, %f61;
cvt.sat.f32.f32 %f62, %f56;
mul.f32 %f63, %f62, 0f437F0000;
cvt.rzi.s32.f32 %r20, %f63;
shl.b32 %r21, %r19, 8;
or.b32 %r22, %r21, %r18;
shl.b32 %r23, %r20, 16;
or.b32 %r24, %r22, %r23;
not.b32 %r25, %r24;
cvt.rn.f32.s32 %f105, %r25;
bra.uni $L__BB0_6;
$L__BB0_2:
abs.f32 %f44, %f1;
cvt.rmi.f32.f32 %f45, %f44;
sub.f32 %f46, %f44, %f45;
abs.f32 %f47, %f2;
cvt.rmi.f32.f32 %f48, %f47;
sub.f32 %f49, %f47, %f48;
ld.const.u64 %rd20, [params+56];
cvta.to.global.u64 %rd21, %rd20;
shl.b32 %r6, %r2, 4;
cvt.u64.u32 %rd22, %r6;
and.b64 %rd23, %rd22, 1048560;
add.s64 %rd24, %rd21, %rd23;
ld.global.v2.u32 {%r7, %r8}, [%rd24];
cvt.rn.f32.u32 %f50, %r7;
mul.f32 %f51, %f46, %f50;
cvt.rzi.u32.f32 %r11, %f51;
cvt.rn.f32.u32 %f52, %r8;
mul.f32 %f53, %f49, %f52;
cvt.rzi.u32.f32 %r12, %f53;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd25, %r13;
ld.global.u64 %rd26, [%rd24+8];
add.s64 %rd27, %rd26, %rd25;
ld.u8 %r14, [%rd27];
shr.u32 %r15, %r2, 16;
and.b32 %r16, %r15, %r14;
setp.eq.s32 %p3, %r16, 0;
selp.f32 %f105, 0f00000000, 0f3F800000, %p3;
$L__BB0_5:
cvt.u32.u64 %r26, %rd1;
cvt.u32.u64 %r27, %rd2;
cvt.u32.u64 %r28, %rd3;
ld.const.u64 %rd33, [params+16];
cvta.to.global.u64 %rd34, %rd33;
mul.wide.s32 %rd35, %r26, 24;
add.s64 %rd36, %rd34, %rd35;
mul.wide.s32 %rd37, %r27, 24;
add.s64 %rd38, %rd34, %rd37;
mul.wide.s32 %rd39, %r28, 24;
add.s64 %rd40, %rd34, %rd39;
ld.global.f32 %f70, [%rd38];
ld.global.f32 %f71, [%rd36];
sub.f32 %f72, %f71, %f70;
ld.global.f32 %f73, [%rd38+4];
ld.global.f32 %f74, [%rd36+4];
sub.f32 %f75, %f74, %f73;
ld.global.f32 %f76, [%rd38+8];
ld.global.f32 %f77, [%rd36+8];
sub.f32 %f78, %f77, %f76;
ld.global.f32 %f79, [%rd40];
sub.f32 %f80, %f70, %f79;
ld.global.f32 %f81, [%rd40+4];
sub.f32 %f82, %f73, %f81;
ld.global.f32 %f83, [%rd40+8];
sub.f32 %f84, %f76, %f83;
mul.f32 %f85, %f75, %f84;
mul.f32 %f86, %f78, %f82;
sub.f32 %f87, %f85, %f86;
mul.f32 %f88, %f78, %f80;
mul.f32 %f89, %f72, %f84;
sub.f32 %f90, %f88, %f89;
mul.f32 %f91, %f72, %f82;
mul.f32 %f92, %f75, %f80;
sub.f32 %f93, %f91, %f92;
mul.f32 %f94, %f90, %f90;
fma.rn.f32 %f95, %f87, %f87, %f94;
fma.rn.f32 %f96, %f93, %f93, %f95;
sqrt.rn.f32 %f97, %f96;
rcp.rn.f32 %f98, %f97;
mul.f32 %f104, %f93, %f98;
mul.f32 %f103, %f98, %f90;
mul.f32 %f102, %f98, %f87;
$L__BB0_6:
st.param.f32 [func_retval0+0], %f102;
st.param.f32 [func_retval0+4], %f103;
st.param.f32 [func_retval0+8], %f104;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f20;
st.param.f32 [func_retval0+20], %f21;
st.param.f32 [func_retval0+24], %f105;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 0e86d4c4196b29f488a08effd5f656dc
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,198 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<5>;
.reg .b16 %rs<41>;
.reg .f32 %f<93>;
.reg .b32 %r<31>;
.reg .b64 %rd<46>;
ld.param.u32 %r5, [__direct_callable__oxMain_param_0];
ld.param.f32 %f21, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f20, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r6), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r7), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd4, [params+72];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.s32 %rd6, %r5, 4;
add.s64 %rd7, %rd5, %rd6;
ld.global.u32 %r3, [%rd7];
setp.eq.s32 %p1, %r3, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd8, [params+480];
cvta.to.global.u64 %rd9, %rd8;
ld.const.u32 %r9, [params+472];
mad.lo.s32 %r10, %r9, %r7, %r6;
cvt.u64.u32 %rd10, %r10;
add.s64 %rd11, %rd9, %rd10;
ld.global.u8 %r11, [%rd11];
mov.u32 %r12, 1;
shl.b32 %r13, %r12, %r11;
and.b32 %r14, %r13, %r3;
setp.eq.s32 %p2, %r14, 0;
mov.f32 %f89, 0f00000000;
mov.f32 %f90, %f89;
mov.f32 %f91, %f89;
mov.f32 %f92, %f89;
@%p2 bra $L__BB0_6;
$L__BB0_2:
ld.const.u64 %rd12, [params+24];
cvta.to.global.u64 %rd13, %rd12;
mul.wide.u32 %rd14, %r5, 12;
add.s64 %rd15, %rd13, %rd14;
ld.global.s32 %rd1, [%rd15];
ld.global.s32 %rd2, [%rd15+4];
ld.global.s32 %rd3, [%rd15+8];
ld.const.u32 %r4, [params+32];
setp.gt.u32 %p3, %r4, %r5;
@%p3 bra $L__BB0_4;
bra.uni $L__BB0_3;
$L__BB0_4:
mov.f32 %f92, 0f3F800000;
sub.f32 %f61, %f92, %f20;
sub.f32 %f87, %f61, %f21;
bra.uni $L__BB0_5;
$L__BB0_3:
sub.s32 %r15, %r5, %r4;
ld.const.v2.u64 {%rd16, %rd17}, [params+48];
cvta.to.global.u64 %rd20, %rd16;
mul.wide.u32 %rd21, %r15, 4;
add.s64 %rd22, %rd20, %rd21;
ld.const.u64 %rd23, [params+40];
cvta.to.global.u64 %rd24, %rd23;
shl.b64 %rd25, %rd1, 3;
add.s64 %rd26, %rd24, %rd25;
ld.global.v2.f32 {%f30, %f31}, [%rd26];
shl.b64 %rd27, %rd2, 3;
add.s64 %rd28, %rd24, %rd27;
ld.global.v2.f32 {%f34, %f35}, [%rd28];
shl.b64 %rd29, %rd3, 3;
add.s64 %rd30, %rd24, %rd29;
ld.global.v2.f32 {%f38, %f39}, [%rd30];
mov.f32 %f42, 0f3F800000;
sub.f32 %f43, %f42, %f20;
sub.f32 %f87, %f43, %f21;
mul.f32 %f44, %f20, %f34;
mul.f32 %f45, %f20, %f35;
fma.rn.f32 %f46, %f87, %f30, %f44;
fma.rn.f32 %f47, %f87, %f31, %f45;
fma.rn.f32 %f48, %f21, %f38, %f46;
fma.rn.f32 %f49, %f21, %f39, %f47;
ld.global.u32 %r16, [%rd22];
shr.u32 %r17, %r16, 16;
abs.f32 %f50, %f48;
cvt.rmi.f32.f32 %f51, %f50;
sub.f32 %f52, %f50, %f51;
abs.f32 %f53, %f49;
cvt.rmi.f32.f32 %f54, %f53;
sub.f32 %f55, %f53, %f54;
cvta.to.global.u64 %rd31, %rd17;
shl.b32 %r18, %r16, 4;
cvt.u64.u32 %rd32, %r18;
and.b64 %rd33, %rd32, 1048560;
add.s64 %rd34, %rd31, %rd33;
ld.global.v2.u32 {%r19, %r20}, [%rd34];
cvt.rn.f32.u32 %f56, %r19;
mul.f32 %f57, %f52, %f56;
cvt.rzi.u32.f32 %r23, %f57;
cvt.rn.f32.u32 %f58, %r20;
mul.f32 %f59, %f55, %f58;
cvt.rzi.u32.f32 %r24, %f59;
mad.lo.s32 %r25, %r19, %r24, %r23;
cvt.u64.u32 %rd35, %r25;
ld.global.u64 %rd36, [%rd34+8];
add.s64 %rd37, %rd36, %rd35;
ld.u8 %r26, [%rd37];
and.b32 %r27, %r17, %r26;
setp.eq.s32 %p4, %r27, 0;
selp.f32 %f92, 0f00000000, 0f3F800000, %p4;
$L__BB0_5:
cvt.u32.u64 %r28, %rd1;
cvt.u32.u64 %r29, %rd2;
cvt.u32.u64 %r30, %rd3;
ld.const.u64 %rd38, [params+16];
cvta.to.global.u64 %rd39, %rd38;
mul.wide.s32 %rd40, %r28, 24;
add.s64 %rd41, %rd39, %rd40;
mul.wide.s32 %rd42, %r29, 24;
add.s64 %rd43, %rd39, %rd42;
mul.wide.s32 %rd44, %r30, 24;
add.s64 %rd45, %rd39, %rd44;
ld.global.f32 %f62, [%rd41+12];
ld.global.f32 %f63, [%rd41+16];
ld.global.f32 %f64, [%rd41+20];
ld.global.f32 %f65, [%rd43+12];
mul.f32 %f66, %f20, %f65;
ld.global.f32 %f67, [%rd43+16];
mul.f32 %f68, %f20, %f67;
ld.global.f32 %f69, [%rd43+20];
mul.f32 %f70, %f20, %f69;
fma.rn.f32 %f71, %f87, %f62, %f66;
fma.rn.f32 %f72, %f87, %f63, %f68;
fma.rn.f32 %f73, %f87, %f64, %f70;
ld.global.f32 %f74, [%rd45+12];
ld.global.f32 %f75, [%rd45+16];
ld.global.f32 %f76, [%rd45+20];
fma.rn.f32 %f77, %f21, %f74, %f71;
fma.rn.f32 %f78, %f21, %f75, %f72;
fma.rn.f32 %f79, %f21, %f76, %f73;
mul.f32 %f80, %f78, %f78;
fma.rn.f32 %f81, %f77, %f77, %f80;
fma.rn.f32 %f82, %f79, %f79, %f81;
sqrt.rn.f32 %f83, %f82;
rcp.rn.f32 %f84, %f83;
mul.f32 %f91, %f79, %f84;
mul.f32 %f90, %f78, %f84;
mul.f32 %f89, %f77, %f84;
$L__BB0_6:
st.param.f32 [func_retval0+0], %f89;
st.param.f32 [func_retval0+4], %f90;
st.param.f32 [func_retval0+8], %f91;
st.param.v4.b8 [func_retval0+12], {%rs9, %rs10, %rs11, %rs12};
st.param.f32 [func_retval0+16], %f17;
st.param.f32 [func_retval0+20], %f18;
st.param.f32 [func_retval0+24], %f92;
st.param.v4.b8 [func_retval0+28], {%rs13, %rs14, %rs15, %rs16};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 9c12cc6929ebe57479ee41d6aebcec3d
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,198 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<5>;
.reg .b16 %rs<41>;
.reg .f32 %f<93>;
.reg .b32 %r<27>;
.reg .b64 %rd<50>;
ld.param.u32 %r4, [__direct_callable__oxMain_param_0];
ld.param.f32 %f21, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f20, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r5), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r6), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd5, [params+72];
cvta.to.global.u64 %rd6, %rd5;
mul.wide.s32 %rd7, %r4, 8;
add.s64 %rd8, %rd6, %rd7;
ld.global.u64 %rd1, [%rd8];
setp.eq.s64 %p1, %rd1, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd9, [params+480];
cvta.to.global.u64 %rd10, %rd9;
ld.const.u32 %r8, [params+472];
mad.lo.s32 %r9, %r8, %r6, %r5;
cvt.u64.u32 %rd11, %r9;
add.s64 %rd12, %rd10, %rd11;
ld.global.u8 %r10, [%rd12];
mov.u64 %rd13, 1;
shl.b64 %rd14, %rd13, %r10;
and.b64 %rd15, %rd14, %rd1;
setp.eq.s64 %p2, %rd15, 0;
mov.f32 %f89, 0f00000000;
mov.f32 %f90, %f89;
mov.f32 %f91, %f89;
mov.f32 %f92, %f89;
@%p2 bra $L__BB0_6;
$L__BB0_2:
ld.const.u64 %rd16, [params+24];
cvta.to.global.u64 %rd17, %rd16;
mul.wide.u32 %rd18, %r4, 12;
add.s64 %rd19, %rd17, %rd18;
ld.global.s32 %rd2, [%rd19];
ld.global.s32 %rd3, [%rd19+4];
ld.global.s32 %rd4, [%rd19+8];
ld.const.u32 %r3, [params+32];
setp.gt.u32 %p3, %r3, %r4;
@%p3 bra $L__BB0_4;
bra.uni $L__BB0_3;
$L__BB0_4:
mov.f32 %f92, 0f3F800000;
sub.f32 %f61, %f92, %f20;
sub.f32 %f87, %f61, %f21;
bra.uni $L__BB0_5;
$L__BB0_3:
sub.s32 %r11, %r4, %r3;
ld.const.v2.u64 {%rd20, %rd21}, [params+48];
cvta.to.global.u64 %rd24, %rd20;
mul.wide.u32 %rd25, %r11, 4;
add.s64 %rd26, %rd24, %rd25;
ld.const.u64 %rd27, [params+40];
cvta.to.global.u64 %rd28, %rd27;
shl.b64 %rd29, %rd2, 3;
add.s64 %rd30, %rd28, %rd29;
ld.global.v2.f32 {%f30, %f31}, [%rd30];
shl.b64 %rd31, %rd3, 3;
add.s64 %rd32, %rd28, %rd31;
ld.global.v2.f32 {%f34, %f35}, [%rd32];
shl.b64 %rd33, %rd4, 3;
add.s64 %rd34, %rd28, %rd33;
ld.global.v2.f32 {%f38, %f39}, [%rd34];
mov.f32 %f42, 0f3F800000;
sub.f32 %f43, %f42, %f20;
sub.f32 %f87, %f43, %f21;
mul.f32 %f44, %f20, %f34;
mul.f32 %f45, %f20, %f35;
fma.rn.f32 %f46, %f87, %f30, %f44;
fma.rn.f32 %f47, %f87, %f31, %f45;
fma.rn.f32 %f48, %f21, %f38, %f46;
fma.rn.f32 %f49, %f21, %f39, %f47;
ld.global.u32 %r12, [%rd26];
shr.u32 %r13, %r12, 16;
abs.f32 %f50, %f48;
cvt.rmi.f32.f32 %f51, %f50;
sub.f32 %f52, %f50, %f51;
abs.f32 %f53, %f49;
cvt.rmi.f32.f32 %f54, %f53;
sub.f32 %f55, %f53, %f54;
cvta.to.global.u64 %rd35, %rd21;
shl.b32 %r14, %r12, 4;
cvt.u64.u32 %rd36, %r14;
and.b64 %rd37, %rd36, 1048560;
add.s64 %rd38, %rd35, %rd37;
ld.global.v2.u32 {%r15, %r16}, [%rd38];
cvt.rn.f32.u32 %f56, %r15;
mul.f32 %f57, %f52, %f56;
cvt.rzi.u32.f32 %r19, %f57;
cvt.rn.f32.u32 %f58, %r16;
mul.f32 %f59, %f55, %f58;
cvt.rzi.u32.f32 %r20, %f59;
mad.lo.s32 %r21, %r15, %r20, %r19;
cvt.u64.u32 %rd39, %r21;
ld.global.u64 %rd40, [%rd38+8];
add.s64 %rd41, %rd40, %rd39;
ld.u8 %r22, [%rd41];
and.b32 %r23, %r13, %r22;
setp.eq.s32 %p4, %r23, 0;
selp.f32 %f92, 0f00000000, 0f3F800000, %p4;
$L__BB0_5:
cvt.u32.u64 %r24, %rd2;
cvt.u32.u64 %r25, %rd3;
cvt.u32.u64 %r26, %rd4;
ld.const.u64 %rd42, [params+16];
cvta.to.global.u64 %rd43, %rd42;
mul.wide.s32 %rd44, %r24, 24;
add.s64 %rd45, %rd43, %rd44;
mul.wide.s32 %rd46, %r25, 24;
add.s64 %rd47, %rd43, %rd46;
mul.wide.s32 %rd48, %r26, 24;
add.s64 %rd49, %rd43, %rd48;
ld.global.f32 %f62, [%rd45+12];
ld.global.f32 %f63, [%rd45+16];
ld.global.f32 %f64, [%rd45+20];
ld.global.f32 %f65, [%rd47+12];
mul.f32 %f66, %f20, %f65;
ld.global.f32 %f67, [%rd47+16];
mul.f32 %f68, %f20, %f67;
ld.global.f32 %f69, [%rd47+20];
mul.f32 %f70, %f20, %f69;
fma.rn.f32 %f71, %f87, %f62, %f66;
fma.rn.f32 %f72, %f87, %f63, %f68;
fma.rn.f32 %f73, %f87, %f64, %f70;
ld.global.f32 %f74, [%rd49+12];
ld.global.f32 %f75, [%rd49+16];
ld.global.f32 %f76, [%rd49+20];
fma.rn.f32 %f77, %f21, %f74, %f71;
fma.rn.f32 %f78, %f21, %f75, %f72;
fma.rn.f32 %f79, %f21, %f76, %f73;
mul.f32 %f80, %f78, %f78;
fma.rn.f32 %f81, %f77, %f77, %f80;
fma.rn.f32 %f82, %f79, %f79, %f81;
sqrt.rn.f32 %f83, %f82;
rcp.rn.f32 %f84, %f83;
mul.f32 %f91, %f79, %f84;
mul.f32 %f90, %f78, %f84;
mul.f32 %f89, %f77, %f84;
$L__BB0_6:
st.param.f32 [func_retval0+0], %f89;
st.param.f32 [func_retval0+4], %f90;
st.param.f32 [func_retval0+8], %f91;
st.param.v4.b8 [func_retval0+12], {%rs9, %rs10, %rs11, %rs12};
st.param.f32 [func_retval0+16], %f17;
st.param.f32 [func_retval0+20], %f18;
st.param.f32 [func_retval0+24], %f92;
st.param.v4.b8 [func_retval0+28], {%rs13, %rs14, %rs15, %rs16};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: d70b9a80726a1e44a95d695adf6c8d1f
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,230 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<6>;
.reg .b16 %rs<57>;
.reg .f32 %f<114>;
.reg .b32 %r<37>;
.reg .b64 %rd<53>;
ld.param.u32 %r5, [__direct_callable__oxMain_param_0];
ld.param.f32 %f29, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f28, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r6), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r7), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd5, [params+72];
cvta.to.global.u64 %rd6, %rd5;
mul.wide.s32 %rd7, %r5, 8;
add.s64 %rd8, %rd6, %rd7;
ld.global.u64 %rd1, [%rd8];
setp.eq.s64 %p1, %rd1, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd9, [params+480];
cvta.to.global.u64 %rd10, %rd9;
ld.const.u32 %r9, [params+472];
mad.lo.s32 %r10, %r9, %r7, %r6;
cvt.u64.u32 %rd11, %r10;
add.s64 %rd12, %rd10, %rd11;
ld.global.u8 %r11, [%rd12];
mov.u64 %rd13, 1;
shl.b64 %rd14, %rd13, %r11;
and.b64 %rd15, %rd14, %rd1;
setp.eq.s64 %p2, %rd15, 0;
mov.f32 %f110, 0f00000000;
mov.f32 %f111, %f110;
mov.f32 %f112, %f110;
mov.f32 %f113, %f110;
@%p2 bra $L__BB0_8;
$L__BB0_2:
ld.const.u64 %rd16, [params+24];
cvta.to.global.u64 %rd17, %rd16;
mul.wide.u32 %rd18, %r5, 12;
add.s64 %rd19, %rd17, %rd18;
ld.global.s32 %rd2, [%rd19];
ld.global.s32 %rd3, [%rd19+4];
ld.global.s32 %rd4, [%rd19+8];
ld.const.u32 %r3, [params+32];
setp.gt.u32 %p3, %r3, %r5;
@%p3 bra $L__BB0_6;
bra.uni $L__BB0_3;
$L__BB0_6:
mov.f32 %f113, 0f3F800000;
sub.f32 %f82, %f113, %f28;
sub.f32 %f108, %f82, %f29;
bra.uni $L__BB0_7;
$L__BB0_3:
sub.s32 %r12, %r5, %r3;
ld.const.u64 %rd20, [params+48];
cvta.to.global.u64 %rd21, %rd20;
mul.wide.u32 %rd22, %r12, 4;
add.s64 %rd23, %rd21, %rd22;
ld.const.u64 %rd24, [params+40];
cvta.to.global.u64 %rd25, %rd24;
shl.b64 %rd26, %rd2, 3;
add.s64 %rd27, %rd25, %rd26;
ld.global.v2.f32 {%f38, %f39}, [%rd27];
shl.b64 %rd28, %rd3, 3;
add.s64 %rd29, %rd25, %rd28;
ld.global.v2.f32 {%f42, %f43}, [%rd29];
shl.b64 %rd30, %rd4, 3;
add.s64 %rd31, %rd25, %rd30;
ld.global.v2.f32 {%f46, %f47}, [%rd31];
mov.f32 %f50, 0f3F800000;
sub.f32 %f51, %f50, %f28;
sub.f32 %f108, %f51, %f29;
mul.f32 %f52, %f28, %f42;
mul.f32 %f53, %f28, %f43;
fma.rn.f32 %f54, %f108, %f38, %f52;
fma.rn.f32 %f55, %f108, %f39, %f53;
fma.rn.f32 %f4, %f29, %f46, %f54;
fma.rn.f32 %f5, %f29, %f47, %f55;
ld.global.u32 %r4, [%rd23];
and.b32 %r13, %r4, -16384;
setp.eq.s32 %p4, %r13, 16384;
@%p4 bra $L__BB0_5;
bra.uni $L__BB0_4;
$L__BB0_5:
add.s32 %r25, %r4, -16384;
ld.const.u64 %rd40, [params+64];
cvta.to.global.u64 %rd41, %rd40;
mul.wide.u32 %rd42, %r25, 8;
add.s64 %rd43, %rd41, %rd42;
ld.global.u64 %rd44, [%rd43];
tex.2d.v4.f32.f32 {%f66, %f67, %f68, %f69}, [%rd44, {%f4, %f5}];
cvt.sat.f32.f32 %f70, %f66;
mul.f32 %f71, %f70, 0f437F0000;
cvt.rzi.s32.f32 %r26, %f71;
cvt.sat.f32.f32 %f72, %f67;
mul.f32 %f73, %f72, 0f437F0000;
cvt.rzi.s32.f32 %r27, %f73;
cvt.sat.f32.f32 %f74, %f68;
mul.f32 %f75, %f74, 0f437F0000;
cvt.rzi.s32.f32 %r28, %f75;
shl.b32 %r29, %r27, 8;
or.b32 %r30, %r29, %r26;
shl.b32 %r31, %r28, 16;
or.b32 %r32, %r30, %r31;
not.b32 %r33, %r32;
cvt.rn.f32.s32 %f113, %r33;
bra.uni $L__BB0_8;
$L__BB0_4:
abs.f32 %f56, %f4;
cvt.rmi.f32.f32 %f57, %f56;
sub.f32 %f58, %f56, %f57;
abs.f32 %f59, %f5;
cvt.rmi.f32.f32 %f60, %f59;
sub.f32 %f61, %f59, %f60;
ld.const.u64 %rd32, [params+56];
cvta.to.global.u64 %rd33, %rd32;
shl.b32 %r14, %r4, 4;
cvt.u64.u32 %rd34, %r14;
and.b64 %rd35, %rd34, 1048560;
add.s64 %rd36, %rd33, %rd35;
ld.global.v2.u32 {%r15, %r16}, [%rd36];
cvt.rn.f32.u32 %f62, %r15;
mul.f32 %f63, %f58, %f62;
cvt.rzi.u32.f32 %r19, %f63;
cvt.rn.f32.u32 %f64, %r16;
mul.f32 %f65, %f61, %f64;
cvt.rzi.u32.f32 %r20, %f65;
mad.lo.s32 %r21, %r15, %r20, %r19;
cvt.u64.u32 %rd37, %r21;
ld.global.u64 %rd38, [%rd36+8];
add.s64 %rd39, %rd38, %rd37;
ld.u8 %r22, [%rd39];
shr.u32 %r23, %r4, 16;
and.b32 %r24, %r23, %r22;
setp.eq.s32 %p5, %r24, 0;
selp.f32 %f113, 0f00000000, 0f3F800000, %p5;
$L__BB0_7:
cvt.u32.u64 %r34, %rd2;
cvt.u32.u64 %r35, %rd3;
cvt.u32.u64 %r36, %rd4;
ld.const.u64 %rd45, [params+16];
cvta.to.global.u64 %rd46, %rd45;
mul.wide.s32 %rd47, %r34, 24;
add.s64 %rd48, %rd46, %rd47;
mul.wide.s32 %rd49, %r35, 24;
add.s64 %rd50, %rd46, %rd49;
mul.wide.s32 %rd51, %r36, 24;
add.s64 %rd52, %rd46, %rd51;
ld.global.f32 %f83, [%rd48+12];
ld.global.f32 %f84, [%rd48+16];
ld.global.f32 %f85, [%rd48+20];
ld.global.f32 %f86, [%rd50+12];
mul.f32 %f87, %f28, %f86;
ld.global.f32 %f88, [%rd50+16];
mul.f32 %f89, %f28, %f88;
ld.global.f32 %f90, [%rd50+20];
mul.f32 %f91, %f28, %f90;
fma.rn.f32 %f92, %f108, %f83, %f87;
fma.rn.f32 %f93, %f108, %f84, %f89;
fma.rn.f32 %f94, %f108, %f85, %f91;
ld.global.f32 %f95, [%rd52+12];
ld.global.f32 %f96, [%rd52+16];
ld.global.f32 %f97, [%rd52+20];
fma.rn.f32 %f98, %f29, %f95, %f92;
fma.rn.f32 %f99, %f29, %f96, %f93;
fma.rn.f32 %f100, %f29, %f97, %f94;
mul.f32 %f101, %f99, %f99;
fma.rn.f32 %f102, %f98, %f98, %f101;
fma.rn.f32 %f103, %f100, %f100, %f102;
sqrt.rn.f32 %f104, %f103;
rcp.rn.f32 %f105, %f104;
mul.f32 %f112, %f100, %f105;
mul.f32 %f111, %f99, %f105;
mul.f32 %f110, %f98, %f105;
$L__BB0_8:
st.param.f32 [func_retval0+0], %f110;
st.param.f32 [func_retval0+4], %f111;
st.param.f32 [func_retval0+8], %f112;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f25;
st.param.f32 [func_retval0+20], %f26;
st.param.f32 [func_retval0+24], %f113;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 7fcaf40824d797147ad0c20c4473fd4b
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,230 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<6>;
.reg .b16 %rs<57>;
.reg .f32 %f<114>;
.reg .b32 %r<41>;
.reg .b64 %rd<49>;
ld.param.u32 %r6, [__direct_callable__oxMain_param_0];
ld.param.f32 %f29, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f28, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r7), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r8), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd4, [params+72];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.s32 %rd6, %r6, 4;
add.s64 %rd7, %rd5, %rd6;
ld.global.u32 %r3, [%rd7];
setp.eq.s32 %p1, %r3, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd8, [params+480];
cvta.to.global.u64 %rd9, %rd8;
ld.const.u32 %r10, [params+472];
mad.lo.s32 %r11, %r10, %r8, %r7;
cvt.u64.u32 %rd10, %r11;
add.s64 %rd11, %rd9, %rd10;
ld.global.u8 %r12, [%rd11];
mov.u32 %r13, 1;
shl.b32 %r14, %r13, %r12;
and.b32 %r15, %r14, %r3;
setp.eq.s32 %p2, %r15, 0;
mov.f32 %f110, 0f00000000;
mov.f32 %f111, %f110;
mov.f32 %f112, %f110;
mov.f32 %f113, %f110;
@%p2 bra $L__BB0_8;
$L__BB0_2:
ld.const.u64 %rd12, [params+24];
cvta.to.global.u64 %rd13, %rd12;
mul.wide.u32 %rd14, %r6, 12;
add.s64 %rd15, %rd13, %rd14;
ld.global.s32 %rd1, [%rd15];
ld.global.s32 %rd2, [%rd15+4];
ld.global.s32 %rd3, [%rd15+8];
ld.const.u32 %r4, [params+32];
setp.gt.u32 %p3, %r4, %r6;
@%p3 bra $L__BB0_6;
bra.uni $L__BB0_3;
$L__BB0_6:
mov.f32 %f113, 0f3F800000;
sub.f32 %f82, %f113, %f28;
sub.f32 %f108, %f82, %f29;
bra.uni $L__BB0_7;
$L__BB0_3:
sub.s32 %r16, %r6, %r4;
ld.const.u64 %rd16, [params+48];
cvta.to.global.u64 %rd17, %rd16;
mul.wide.u32 %rd18, %r16, 4;
add.s64 %rd19, %rd17, %rd18;
ld.const.u64 %rd20, [params+40];
cvta.to.global.u64 %rd21, %rd20;
shl.b64 %rd22, %rd1, 3;
add.s64 %rd23, %rd21, %rd22;
ld.global.v2.f32 {%f38, %f39}, [%rd23];
shl.b64 %rd24, %rd2, 3;
add.s64 %rd25, %rd21, %rd24;
ld.global.v2.f32 {%f42, %f43}, [%rd25];
shl.b64 %rd26, %rd3, 3;
add.s64 %rd27, %rd21, %rd26;
ld.global.v2.f32 {%f46, %f47}, [%rd27];
mov.f32 %f50, 0f3F800000;
sub.f32 %f51, %f50, %f28;
sub.f32 %f108, %f51, %f29;
mul.f32 %f52, %f28, %f42;
mul.f32 %f53, %f28, %f43;
fma.rn.f32 %f54, %f108, %f38, %f52;
fma.rn.f32 %f55, %f108, %f39, %f53;
fma.rn.f32 %f4, %f29, %f46, %f54;
fma.rn.f32 %f5, %f29, %f47, %f55;
ld.global.u32 %r5, [%rd19];
and.b32 %r17, %r5, -16384;
setp.eq.s32 %p4, %r17, 16384;
@%p4 bra $L__BB0_5;
bra.uni $L__BB0_4;
$L__BB0_5:
add.s32 %r29, %r5, -16384;
ld.const.u64 %rd36, [params+64];
cvta.to.global.u64 %rd37, %rd36;
mul.wide.u32 %rd38, %r29, 8;
add.s64 %rd39, %rd37, %rd38;
ld.global.u64 %rd40, [%rd39];
tex.2d.v4.f32.f32 {%f66, %f67, %f68, %f69}, [%rd40, {%f4, %f5}];
cvt.sat.f32.f32 %f70, %f66;
mul.f32 %f71, %f70, 0f437F0000;
cvt.rzi.s32.f32 %r30, %f71;
cvt.sat.f32.f32 %f72, %f67;
mul.f32 %f73, %f72, 0f437F0000;
cvt.rzi.s32.f32 %r31, %f73;
cvt.sat.f32.f32 %f74, %f68;
mul.f32 %f75, %f74, 0f437F0000;
cvt.rzi.s32.f32 %r32, %f75;
shl.b32 %r33, %r31, 8;
or.b32 %r34, %r33, %r30;
shl.b32 %r35, %r32, 16;
or.b32 %r36, %r34, %r35;
not.b32 %r37, %r36;
cvt.rn.f32.s32 %f113, %r37;
bra.uni $L__BB0_8;
$L__BB0_4:
abs.f32 %f56, %f4;
cvt.rmi.f32.f32 %f57, %f56;
sub.f32 %f58, %f56, %f57;
abs.f32 %f59, %f5;
cvt.rmi.f32.f32 %f60, %f59;
sub.f32 %f61, %f59, %f60;
ld.const.u64 %rd28, [params+56];
cvta.to.global.u64 %rd29, %rd28;
shl.b32 %r18, %r5, 4;
cvt.u64.u32 %rd30, %r18;
and.b64 %rd31, %rd30, 1048560;
add.s64 %rd32, %rd29, %rd31;
ld.global.v2.u32 {%r19, %r20}, [%rd32];
cvt.rn.f32.u32 %f62, %r19;
mul.f32 %f63, %f58, %f62;
cvt.rzi.u32.f32 %r23, %f63;
cvt.rn.f32.u32 %f64, %r20;
mul.f32 %f65, %f61, %f64;
cvt.rzi.u32.f32 %r24, %f65;
mad.lo.s32 %r25, %r19, %r24, %r23;
cvt.u64.u32 %rd33, %r25;
ld.global.u64 %rd34, [%rd32+8];
add.s64 %rd35, %rd34, %rd33;
ld.u8 %r26, [%rd35];
shr.u32 %r27, %r5, 16;
and.b32 %r28, %r27, %r26;
setp.eq.s32 %p5, %r28, 0;
selp.f32 %f113, 0f00000000, 0f3F800000, %p5;
$L__BB0_7:
cvt.u32.u64 %r38, %rd1;
cvt.u32.u64 %r39, %rd2;
cvt.u32.u64 %r40, %rd3;
ld.const.u64 %rd41, [params+16];
cvta.to.global.u64 %rd42, %rd41;
mul.wide.s32 %rd43, %r38, 24;
add.s64 %rd44, %rd42, %rd43;
mul.wide.s32 %rd45, %r39, 24;
add.s64 %rd46, %rd42, %rd45;
mul.wide.s32 %rd47, %r40, 24;
add.s64 %rd48, %rd42, %rd47;
ld.global.f32 %f83, [%rd44+12];
ld.global.f32 %f84, [%rd44+16];
ld.global.f32 %f85, [%rd44+20];
ld.global.f32 %f86, [%rd46+12];
mul.f32 %f87, %f28, %f86;
ld.global.f32 %f88, [%rd46+16];
mul.f32 %f89, %f28, %f88;
ld.global.f32 %f90, [%rd46+20];
mul.f32 %f91, %f28, %f90;
fma.rn.f32 %f92, %f108, %f83, %f87;
fma.rn.f32 %f93, %f108, %f84, %f89;
fma.rn.f32 %f94, %f108, %f85, %f91;
ld.global.f32 %f95, [%rd48+12];
ld.global.f32 %f96, [%rd48+16];
ld.global.f32 %f97, [%rd48+20];
fma.rn.f32 %f98, %f29, %f95, %f92;
fma.rn.f32 %f99, %f29, %f96, %f93;
fma.rn.f32 %f100, %f29, %f97, %f94;
mul.f32 %f101, %f99, %f99;
fma.rn.f32 %f102, %f98, %f98, %f101;
fma.rn.f32 %f103, %f100, %f100, %f102;
sqrt.rn.f32 %f104, %f103;
rcp.rn.f32 %f105, %f104;
mul.f32 %f112, %f100, %f105;
mul.f32 %f111, %f99, %f105;
mul.f32 %f110, %f98, %f105;
$L__BB0_8:
st.param.f32 [func_retval0+0], %f110;
st.param.f32 [func_retval0+4], %f111;
st.param.f32 [func_retval0+8], %f112;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f25;
st.param.f32 [func_retval0+20], %f26;
st.param.f32 [func_retval0+24], %f113;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: c1b98cde1a58fcc4cbe76f6cab92fa16
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,184 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<4>;
.reg .b16 %rs<9>;
.reg .f32 %f<93>;
.reg .b32 %r<19>;
.reg .b64 %rd<40>;
ld.param.u32 %r2, [__direct_callable__oxMain_param_0];
ld.param.f32 %f1, [__direct_callable__oxMain_param_1];
ld.param.f32 %f2, [__direct_callable__oxMain_param_1+4];
ld.const.u64 %rd6, [params+24];
cvta.to.global.u64 %rd7, %rd6;
mul.wide.u32 %rd8, %r2, 12;
add.s64 %rd9, %rd7, %rd8;
ld.global.s32 %rd1, [%rd9];
ld.global.s32 %rd2, [%rd9+4];
ld.global.s32 %rd3, [%rd9+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r2;
@%p1 bra $L__BB0_2;
bra.uni $L__BB0_1;
$L__BB0_2:
mov.f32 %f90, 0f3F800000;
sub.f32 %f51, %f90, %f1;
sub.f32 %f89, %f51, %f2;
bra.uni $L__BB0_3;
$L__BB0_1:
sub.s32 %r3, %r2, %r1;
ld.const.v2.u64 {%rd10, %rd11}, [params+48];
cvta.to.global.u64 %rd14, %rd10;
mul.wide.u32 %rd15, %r3, 4;
add.s64 %rd16, %rd14, %rd15;
ld.const.u64 %rd17, [params+40];
cvta.to.global.u64 %rd18, %rd17;
shl.b64 %rd19, %rd1, 3;
add.s64 %rd20, %rd18, %rd19;
ld.global.v2.f32 {%f20, %f21}, [%rd20];
shl.b64 %rd21, %rd2, 3;
add.s64 %rd22, %rd18, %rd21;
ld.global.v2.f32 {%f24, %f25}, [%rd22];
shl.b64 %rd23, %rd3, 3;
add.s64 %rd24, %rd18, %rd23;
ld.global.v2.f32 {%f28, %f29}, [%rd24];
mov.f32 %f32, 0f3F800000;
sub.f32 %f33, %f32, %f1;
sub.f32 %f89, %f33, %f2;
mul.f32 %f34, %f1, %f24;
mul.f32 %f35, %f1, %f25;
fma.rn.f32 %f36, %f89, %f20, %f34;
fma.rn.f32 %f37, %f89, %f21, %f35;
fma.rn.f32 %f38, %f2, %f28, %f36;
fma.rn.f32 %f39, %f2, %f29, %f37;
ld.global.u32 %r4, [%rd16];
shr.u32 %r5, %r4, 16;
abs.f32 %f40, %f38;
cvt.rmi.f32.f32 %f41, %f40;
sub.f32 %f42, %f40, %f41;
abs.f32 %f43, %f39;
cvt.rmi.f32.f32 %f44, %f43;
sub.f32 %f45, %f43, %f44;
cvta.to.global.u64 %rd25, %rd11;
shl.b32 %r6, %r4, 4;
cvt.u64.u32 %rd26, %r6;
and.b64 %rd27, %rd26, 1048560;
add.s64 %rd28, %rd25, %rd27;
ld.global.v2.u32 {%r7, %r8}, [%rd28];
cvt.rn.f32.u32 %f46, %r7;
mul.f32 %f47, %f42, %f46;
cvt.rzi.u32.f32 %r11, %f47;
cvt.rn.f32.u32 %f48, %r8;
mul.f32 %f49, %f45, %f48;
cvt.rzi.u32.f32 %r12, %f49;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd29, %r13;
ld.global.u64 %rd30, [%rd28+8];
add.s64 %rd31, %rd30, %rd29;
ld.u8 %r14, [%rd31];
and.b32 %r15, %r5, %r14;
setp.eq.s32 %p2, %r15, 0;
selp.f32 %f90, 0f00000000, 0f3F800000, %p2;
$L__BB0_3:
cvt.u32.u64 %r16, %rd1;
cvt.u32.u64 %r17, %rd2;
cvt.u32.u64 %r18, %rd3;
ld.const.u64 %rd32, [params+16];
cvta.to.global.u64 %rd33, %rd32;
mul.wide.s32 %rd34, %r16, 32;
add.s64 %rd35, %rd33, %rd34;
mul.wide.s32 %rd36, %r17, 32;
add.s64 %rd37, %rd33, %rd36;
add.s64 %rd4, %rd37, 12;
mul.wide.s32 %rd38, %r18, 32;
add.s64 %rd39, %rd33, %rd38;
add.s64 %rd5, %rd39, 12;
ld.global.f32 %f52, [%rd35+12];
ld.global.f32 %f53, [%rd35+16];
ld.global.f32 %f54, [%rd35+20];
ld.global.f32 %f55, [%rd37+12];
mul.f32 %f56, %f1, %f55;
ld.global.f32 %f57, [%rd37+16];
mul.f32 %f58, %f1, %f57;
ld.global.f32 %f59, [%rd37+20];
mul.f32 %f60, %f1, %f59;
fma.rn.f32 %f61, %f89, %f52, %f56;
fma.rn.f32 %f62, %f89, %f53, %f58;
fma.rn.f32 %f63, %f89, %f54, %f60;
ld.global.f32 %f64, [%rd39+12];
ld.global.f32 %f65, [%rd39+16];
ld.global.f32 %f66, [%rd39+20];
fma.rn.f32 %f67, %f2, %f64, %f61;
fma.rn.f32 %f68, %f2, %f65, %f62;
fma.rn.f32 %f69, %f2, %f66, %f63;
mul.f32 %f70, %f68, %f68;
fma.rn.f32 %f71, %f67, %f67, %f70;
fma.rn.f32 %f72, %f69, %f69, %f71;
sqrt.rn.f32 %f73, %f72;
rcp.rn.f32 %f74, %f73;
mul.f32 %f8, %f67, %f74;
mul.f32 %f9, %f68, %f74;
mul.f32 %f10, %f69, %f74;
ld.global.v2.f32 {%f91, %f76}, [%rd35+24];
setp.lt.f32 %p3, %f76, 0f00000000;
@%p3 bra $L__BB0_5;
bra.uni $L__BB0_4;
$L__BB0_5:
add.f32 %f92, %f76, 0f3F800000;
bra.uni $L__BB0_6;
$L__BB0_4:
ld.global.v2.f32 {%f77, %f78}, [%rd4+12];
ld.global.v2.f32 {%f79, %f80}, [%rd5+12];
mul.f32 %f82, %f1, %f77;
mul.f32 %f84, %f1, %f78;
fma.rn.f32 %f85, %f89, %f91, %f82;
fma.rn.f32 %f86, %f89, %f76, %f84;
fma.rn.f32 %f91, %f2, %f79, %f85;
fma.rn.f32 %f92, %f2, %f80, %f86;
$L__BB0_6:
st.param.f32 [func_retval0+0], %f8;
st.param.f32 [func_retval0+4], %f9;
st.param.f32 [func_retval0+8], %f10;
st.param.f32 [func_retval0+16], %f91;
st.param.f32 [func_retval0+20], %f92;
st.param.f32 [func_retval0+24], %f90;
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 758cd40f91d764c49ac5cee488d911b3
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,220 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<6>;
.reg .b16 %rs<41>;
.reg .f32 %f<119>;
.reg .b32 %r<31>;
.reg .b64 %rd<48>;
ld.param.u32 %r5, [__direct_callable__oxMain_param_0];
ld.param.f32 %f33, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f32, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r6), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r7), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd6, [params+72];
cvta.to.global.u64 %rd7, %rd6;
mul.wide.s32 %rd8, %r5, 4;
add.s64 %rd9, %rd7, %rd8;
ld.global.u32 %r3, [%rd9];
setp.eq.s32 %p1, %r3, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd10, [params+480];
cvta.to.global.u64 %rd11, %rd10;
ld.const.u32 %r9, [params+472];
mad.lo.s32 %r10, %r9, %r7, %r6;
cvt.u64.u32 %rd12, %r10;
add.s64 %rd13, %rd11, %rd12;
ld.global.u8 %r11, [%rd13];
mov.u32 %r12, 1;
shl.b32 %r13, %r12, %r11;
and.b32 %r14, %r13, %r3;
setp.eq.s32 %p2, %r14, 0;
mov.f32 %f113, 0f00000000;
mov.f32 %f114, %f113;
mov.f32 %f115, %f113;
mov.f32 %f116, %f113;
mov.f32 %f117, %f113;
mov.f32 %f118, %f113;
@%p2 bra $L__BB0_9;
$L__BB0_2:
ld.const.u64 %rd14, [params+24];
cvta.to.global.u64 %rd15, %rd14;
mul.wide.u32 %rd16, %r5, 12;
add.s64 %rd17, %rd15, %rd16;
ld.global.s32 %rd1, [%rd17];
ld.global.s32 %rd2, [%rd17+4];
ld.global.s32 %rd3, [%rd17+8];
ld.const.u32 %r4, [params+32];
setp.gt.u32 %p3, %r4, %r5;
@%p3 bra $L__BB0_4;
bra.uni $L__BB0_3;
$L__BB0_4:
mov.f32 %f118, 0f3F800000;
sub.f32 %f71, %f118, %f32;
sub.f32 %f109, %f71, %f33;
bra.uni $L__BB0_5;
$L__BB0_3:
sub.s32 %r15, %r5, %r4;
ld.const.v2.u64 {%rd18, %rd19}, [params+48];
cvta.to.global.u64 %rd22, %rd18;
mul.wide.u32 %rd23, %r15, 4;
add.s64 %rd24, %rd22, %rd23;
ld.const.u64 %rd25, [params+40];
cvta.to.global.u64 %rd26, %rd25;
shl.b64 %rd27, %rd1, 3;
add.s64 %rd28, %rd26, %rd27;
ld.global.v2.f32 {%f40, %f41}, [%rd28];
shl.b64 %rd29, %rd2, 3;
add.s64 %rd30, %rd26, %rd29;
ld.global.v2.f32 {%f44, %f45}, [%rd30];
shl.b64 %rd31, %rd3, 3;
add.s64 %rd32, %rd26, %rd31;
ld.global.v2.f32 {%f48, %f49}, [%rd32];
mov.f32 %f52, 0f3F800000;
sub.f32 %f53, %f52, %f32;
sub.f32 %f109, %f53, %f33;
mul.f32 %f54, %f32, %f44;
mul.f32 %f55, %f32, %f45;
fma.rn.f32 %f56, %f109, %f40, %f54;
fma.rn.f32 %f57, %f109, %f41, %f55;
fma.rn.f32 %f58, %f33, %f48, %f56;
fma.rn.f32 %f59, %f33, %f49, %f57;
ld.global.u32 %r16, [%rd24];
shr.u32 %r17, %r16, 16;
abs.f32 %f60, %f58;
cvt.rmi.f32.f32 %f61, %f60;
sub.f32 %f62, %f60, %f61;
abs.f32 %f63, %f59;
cvt.rmi.f32.f32 %f64, %f63;
sub.f32 %f65, %f63, %f64;
cvta.to.global.u64 %rd33, %rd19;
shl.b32 %r18, %r16, 4;
cvt.u64.u32 %rd34, %r18;
and.b64 %rd35, %rd34, 1048560;
add.s64 %rd36, %rd33, %rd35;
ld.global.v2.u32 {%r19, %r20}, [%rd36];
cvt.rn.f32.u32 %f66, %r19;
mul.f32 %f67, %f62, %f66;
cvt.rzi.u32.f32 %r23, %f67;
cvt.rn.f32.u32 %f68, %r20;
mul.f32 %f69, %f65, %f68;
cvt.rzi.u32.f32 %r24, %f69;
mad.lo.s32 %r25, %r19, %r24, %r23;
cvt.u64.u32 %rd37, %r25;
ld.global.u64 %rd38, [%rd36+8];
add.s64 %rd39, %rd38, %rd37;
ld.u8 %r26, [%rd39];
and.b32 %r27, %r17, %r26;
setp.eq.s32 %p4, %r27, 0;
selp.f32 %f118, 0f00000000, 0f3F800000, %p4;
$L__BB0_5:
cvt.u32.u64 %r28, %rd1;
cvt.u32.u64 %r29, %rd2;
cvt.u32.u64 %r30, %rd3;
ld.const.u64 %rd40, [params+16];
cvta.to.global.u64 %rd41, %rd40;
mul.wide.s32 %rd42, %r28, 32;
add.s64 %rd43, %rd41, %rd42;
mul.wide.s32 %rd44, %r29, 32;
add.s64 %rd45, %rd41, %rd44;
add.s64 %rd4, %rd45, 12;
mul.wide.s32 %rd46, %r30, 32;
add.s64 %rd47, %rd41, %rd46;
add.s64 %rd5, %rd47, 12;
ld.global.f32 %f72, [%rd43+12];
ld.global.f32 %f73, [%rd43+16];
ld.global.f32 %f74, [%rd43+20];
ld.global.f32 %f75, [%rd45+12];
mul.f32 %f76, %f32, %f75;
ld.global.f32 %f77, [%rd45+16];
mul.f32 %f78, %f32, %f77;
ld.global.f32 %f79, [%rd45+20];
mul.f32 %f80, %f32, %f79;
fma.rn.f32 %f81, %f109, %f72, %f76;
fma.rn.f32 %f82, %f109, %f73, %f78;
fma.rn.f32 %f83, %f109, %f74, %f80;
ld.global.f32 %f84, [%rd47+12];
ld.global.f32 %f85, [%rd47+16];
ld.global.f32 %f86, [%rd47+20];
fma.rn.f32 %f87, %f33, %f84, %f81;
fma.rn.f32 %f88, %f33, %f85, %f82;
fma.rn.f32 %f89, %f33, %f86, %f83;
mul.f32 %f90, %f88, %f88;
fma.rn.f32 %f91, %f87, %f87, %f90;
fma.rn.f32 %f92, %f89, %f89, %f91;
sqrt.rn.f32 %f93, %f92;
rcp.rn.f32 %f94, %f93;
mul.f32 %f113, %f87, %f94;
mul.f32 %f114, %f88, %f94;
mul.f32 %f115, %f89, %f94;
ld.global.v2.f32 {%f116, %f96}, [%rd43+24];
setp.lt.f32 %p5, %f96, 0f00000000;
@%p5 bra $L__BB0_7;
bra.uni $L__BB0_6;
$L__BB0_7:
add.f32 %f117, %f96, 0f3F800000;
bra.uni $L__BB0_9;
$L__BB0_6:
ld.global.v2.f32 {%f97, %f98}, [%rd4+12];
ld.global.v2.f32 {%f99, %f100}, [%rd5+12];
mul.f32 %f102, %f32, %f97;
mul.f32 %f104, %f32, %f98;
fma.rn.f32 %f105, %f109, %f116, %f102;
fma.rn.f32 %f106, %f109, %f96, %f104;
fma.rn.f32 %f116, %f33, %f99, %f105;
fma.rn.f32 %f117, %f33, %f100, %f106;
$L__BB0_9:
st.param.f32 [func_retval0+0], %f113;
st.param.f32 [func_retval0+4], %f114;
st.param.f32 [func_retval0+8], %f115;
st.param.v4.b8 [func_retval0+12], {%rs9, %rs10, %rs11, %rs12};
st.param.f32 [func_retval0+16], %f116;
st.param.f32 [func_retval0+20], %f117;
st.param.f32 [func_retval0+24], %f118;
st.param.v4.b8 [func_retval0+28], {%rs13, %rs14, %rs15, %rs16};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 6991c3e0a4d45094181fd1cbb01a0cfe
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,220 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<6>;
.reg .b16 %rs<41>;
.reg .f32 %f<119>;
.reg .b32 %r<27>;
.reg .b64 %rd<52>;
ld.param.u32 %r4, [__direct_callable__oxMain_param_0];
ld.param.f32 %f33, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f32, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r5), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r6), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd7, [params+72];
cvta.to.global.u64 %rd8, %rd7;
mul.wide.s32 %rd9, %r4, 8;
add.s64 %rd10, %rd8, %rd9;
ld.global.u64 %rd1, [%rd10];
setp.eq.s64 %p1, %rd1, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd11, [params+480];
cvta.to.global.u64 %rd12, %rd11;
ld.const.u32 %r8, [params+472];
mad.lo.s32 %r9, %r8, %r6, %r5;
cvt.u64.u32 %rd13, %r9;
add.s64 %rd14, %rd12, %rd13;
ld.global.u8 %r10, [%rd14];
mov.u64 %rd15, 1;
shl.b64 %rd16, %rd15, %r10;
and.b64 %rd17, %rd16, %rd1;
setp.eq.s64 %p2, %rd17, 0;
mov.f32 %f113, 0f00000000;
mov.f32 %f114, %f113;
mov.f32 %f115, %f113;
mov.f32 %f116, %f113;
mov.f32 %f117, %f113;
mov.f32 %f118, %f113;
@%p2 bra $L__BB0_9;
$L__BB0_2:
ld.const.u64 %rd18, [params+24];
cvta.to.global.u64 %rd19, %rd18;
mul.wide.u32 %rd20, %r4, 12;
add.s64 %rd21, %rd19, %rd20;
ld.global.s32 %rd2, [%rd21];
ld.global.s32 %rd3, [%rd21+4];
ld.global.s32 %rd4, [%rd21+8];
ld.const.u32 %r3, [params+32];
setp.gt.u32 %p3, %r3, %r4;
@%p3 bra $L__BB0_4;
bra.uni $L__BB0_3;
$L__BB0_4:
mov.f32 %f118, 0f3F800000;
sub.f32 %f71, %f118, %f32;
sub.f32 %f109, %f71, %f33;
bra.uni $L__BB0_5;
$L__BB0_3:
sub.s32 %r11, %r4, %r3;
ld.const.v2.u64 {%rd22, %rd23}, [params+48];
cvta.to.global.u64 %rd26, %rd22;
mul.wide.u32 %rd27, %r11, 4;
add.s64 %rd28, %rd26, %rd27;
ld.const.u64 %rd29, [params+40];
cvta.to.global.u64 %rd30, %rd29;
shl.b64 %rd31, %rd2, 3;
add.s64 %rd32, %rd30, %rd31;
ld.global.v2.f32 {%f40, %f41}, [%rd32];
shl.b64 %rd33, %rd3, 3;
add.s64 %rd34, %rd30, %rd33;
ld.global.v2.f32 {%f44, %f45}, [%rd34];
shl.b64 %rd35, %rd4, 3;
add.s64 %rd36, %rd30, %rd35;
ld.global.v2.f32 {%f48, %f49}, [%rd36];
mov.f32 %f52, 0f3F800000;
sub.f32 %f53, %f52, %f32;
sub.f32 %f109, %f53, %f33;
mul.f32 %f54, %f32, %f44;
mul.f32 %f55, %f32, %f45;
fma.rn.f32 %f56, %f109, %f40, %f54;
fma.rn.f32 %f57, %f109, %f41, %f55;
fma.rn.f32 %f58, %f33, %f48, %f56;
fma.rn.f32 %f59, %f33, %f49, %f57;
ld.global.u32 %r12, [%rd28];
shr.u32 %r13, %r12, 16;
abs.f32 %f60, %f58;
cvt.rmi.f32.f32 %f61, %f60;
sub.f32 %f62, %f60, %f61;
abs.f32 %f63, %f59;
cvt.rmi.f32.f32 %f64, %f63;
sub.f32 %f65, %f63, %f64;
cvta.to.global.u64 %rd37, %rd23;
shl.b32 %r14, %r12, 4;
cvt.u64.u32 %rd38, %r14;
and.b64 %rd39, %rd38, 1048560;
add.s64 %rd40, %rd37, %rd39;
ld.global.v2.u32 {%r15, %r16}, [%rd40];
cvt.rn.f32.u32 %f66, %r15;
mul.f32 %f67, %f62, %f66;
cvt.rzi.u32.f32 %r19, %f67;
cvt.rn.f32.u32 %f68, %r16;
mul.f32 %f69, %f65, %f68;
cvt.rzi.u32.f32 %r20, %f69;
mad.lo.s32 %r21, %r15, %r20, %r19;
cvt.u64.u32 %rd41, %r21;
ld.global.u64 %rd42, [%rd40+8];
add.s64 %rd43, %rd42, %rd41;
ld.u8 %r22, [%rd43];
and.b32 %r23, %r13, %r22;
setp.eq.s32 %p4, %r23, 0;
selp.f32 %f118, 0f00000000, 0f3F800000, %p4;
$L__BB0_5:
cvt.u32.u64 %r24, %rd2;
cvt.u32.u64 %r25, %rd3;
cvt.u32.u64 %r26, %rd4;
ld.const.u64 %rd44, [params+16];
cvta.to.global.u64 %rd45, %rd44;
mul.wide.s32 %rd46, %r24, 32;
add.s64 %rd47, %rd45, %rd46;
mul.wide.s32 %rd48, %r25, 32;
add.s64 %rd49, %rd45, %rd48;
add.s64 %rd5, %rd49, 12;
mul.wide.s32 %rd50, %r26, 32;
add.s64 %rd51, %rd45, %rd50;
add.s64 %rd6, %rd51, 12;
ld.global.f32 %f72, [%rd47+12];
ld.global.f32 %f73, [%rd47+16];
ld.global.f32 %f74, [%rd47+20];
ld.global.f32 %f75, [%rd49+12];
mul.f32 %f76, %f32, %f75;
ld.global.f32 %f77, [%rd49+16];
mul.f32 %f78, %f32, %f77;
ld.global.f32 %f79, [%rd49+20];
mul.f32 %f80, %f32, %f79;
fma.rn.f32 %f81, %f109, %f72, %f76;
fma.rn.f32 %f82, %f109, %f73, %f78;
fma.rn.f32 %f83, %f109, %f74, %f80;
ld.global.f32 %f84, [%rd51+12];
ld.global.f32 %f85, [%rd51+16];
ld.global.f32 %f86, [%rd51+20];
fma.rn.f32 %f87, %f33, %f84, %f81;
fma.rn.f32 %f88, %f33, %f85, %f82;
fma.rn.f32 %f89, %f33, %f86, %f83;
mul.f32 %f90, %f88, %f88;
fma.rn.f32 %f91, %f87, %f87, %f90;
fma.rn.f32 %f92, %f89, %f89, %f91;
sqrt.rn.f32 %f93, %f92;
rcp.rn.f32 %f94, %f93;
mul.f32 %f113, %f87, %f94;
mul.f32 %f114, %f88, %f94;
mul.f32 %f115, %f89, %f94;
ld.global.v2.f32 {%f116, %f96}, [%rd47+24];
setp.lt.f32 %p5, %f96, 0f00000000;
@%p5 bra $L__BB0_7;
bra.uni $L__BB0_6;
$L__BB0_7:
add.f32 %f117, %f96, 0f3F800000;
bra.uni $L__BB0_9;
$L__BB0_6:
ld.global.v2.f32 {%f97, %f98}, [%rd5+12];
ld.global.v2.f32 {%f99, %f100}, [%rd6+12];
mul.f32 %f102, %f32, %f97;
mul.f32 %f104, %f32, %f98;
fma.rn.f32 %f105, %f109, %f116, %f102;
fma.rn.f32 %f106, %f109, %f96, %f104;
fma.rn.f32 %f116, %f33, %f99, %f105;
fma.rn.f32 %f117, %f33, %f100, %f106;
$L__BB0_9:
st.param.f32 [func_retval0+0], %f113;
st.param.f32 [func_retval0+4], %f114;
st.param.f32 [func_retval0+8], %f115;
st.param.v4.b8 [func_retval0+12], {%rs9, %rs10, %rs11, %rs12};
st.param.f32 [func_retval0+16], %f116;
st.param.f32 [func_retval0+20], %f117;
st.param.f32 [func_retval0+24], %f118;
st.param.v4.b8 [func_retval0+28], {%rs13, %rs14, %rs15, %rs16};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 4ca18acc542cd2e48987b274c10415ad
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,252 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<7>;
.reg .b16 %rs<57>;
.reg .f32 %f<140>;
.reg .b32 %r<37>;
.reg .b64 %rd<55>;
ld.param.u32 %r5, [__direct_callable__oxMain_param_0];
ld.param.f32 %f41, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f40, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r6), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r7), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd7, [params+72];
cvta.to.global.u64 %rd8, %rd7;
mul.wide.s32 %rd9, %r5, 8;
add.s64 %rd10, %rd8, %rd9;
ld.global.u64 %rd1, [%rd10];
setp.eq.s64 %p1, %rd1, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd11, [params+480];
cvta.to.global.u64 %rd12, %rd11;
ld.const.u32 %r9, [params+472];
mad.lo.s32 %r10, %r9, %r7, %r6;
cvt.u64.u32 %rd13, %r10;
add.s64 %rd14, %rd12, %rd13;
ld.global.u8 %r11, [%rd14];
mov.u64 %rd15, 1;
shl.b64 %rd16, %rd15, %r11;
and.b64 %rd17, %rd16, %rd1;
setp.eq.s64 %p2, %rd17, 0;
mov.f32 %f134, 0f00000000;
mov.f32 %f135, %f134;
mov.f32 %f136, %f134;
mov.f32 %f137, %f134;
mov.f32 %f138, %f134;
mov.f32 %f139, %f134;
@%p2 bra $L__BB0_11;
$L__BB0_2:
ld.const.u64 %rd18, [params+24];
cvta.to.global.u64 %rd19, %rd18;
mul.wide.u32 %rd20, %r5, 12;
add.s64 %rd21, %rd19, %rd20;
ld.global.s32 %rd2, [%rd21];
ld.global.s32 %rd3, [%rd21+4];
ld.global.s32 %rd4, [%rd21+8];
ld.const.u32 %r3, [params+32];
setp.gt.u32 %p3, %r3, %r5;
@%p3 bra $L__BB0_6;
bra.uni $L__BB0_3;
$L__BB0_6:
mov.f32 %f139, 0f3F800000;
sub.f32 %f92, %f139, %f40;
sub.f32 %f130, %f92, %f41;
bra.uni $L__BB0_7;
$L__BB0_3:
sub.s32 %r12, %r5, %r3;
ld.const.u64 %rd22, [params+48];
cvta.to.global.u64 %rd23, %rd22;
mul.wide.u32 %rd24, %r12, 4;
add.s64 %rd25, %rd23, %rd24;
ld.const.u64 %rd26, [params+40];
cvta.to.global.u64 %rd27, %rd26;
shl.b64 %rd28, %rd2, 3;
add.s64 %rd29, %rd27, %rd28;
ld.global.v2.f32 {%f48, %f49}, [%rd29];
shl.b64 %rd30, %rd3, 3;
add.s64 %rd31, %rd27, %rd30;
ld.global.v2.f32 {%f52, %f53}, [%rd31];
shl.b64 %rd32, %rd4, 3;
add.s64 %rd33, %rd27, %rd32;
ld.global.v2.f32 {%f56, %f57}, [%rd33];
mov.f32 %f60, 0f3F800000;
sub.f32 %f61, %f60, %f40;
sub.f32 %f130, %f61, %f41;
mul.f32 %f62, %f40, %f52;
mul.f32 %f63, %f40, %f53;
fma.rn.f32 %f64, %f130, %f48, %f62;
fma.rn.f32 %f65, %f130, %f49, %f63;
fma.rn.f32 %f4, %f41, %f56, %f64;
fma.rn.f32 %f5, %f41, %f57, %f65;
ld.global.u32 %r4, [%rd25];
and.b32 %r13, %r4, -16384;
setp.eq.s32 %p4, %r13, 16384;
@%p4 bra $L__BB0_5;
bra.uni $L__BB0_4;
$L__BB0_5:
add.s32 %r25, %r4, -16384;
ld.const.u64 %rd42, [params+64];
cvta.to.global.u64 %rd43, %rd42;
mul.wide.u32 %rd44, %r25, 8;
add.s64 %rd45, %rd43, %rd44;
ld.global.u64 %rd46, [%rd45];
tex.2d.v4.f32.f32 {%f76, %f77, %f78, %f79}, [%rd46, {%f4, %f5}];
cvt.sat.f32.f32 %f80, %f76;
mul.f32 %f81, %f80, 0f437F0000;
cvt.rzi.s32.f32 %r26, %f81;
cvt.sat.f32.f32 %f82, %f77;
mul.f32 %f83, %f82, 0f437F0000;
cvt.rzi.s32.f32 %r27, %f83;
cvt.sat.f32.f32 %f84, %f78;
mul.f32 %f85, %f84, 0f437F0000;
cvt.rzi.s32.f32 %r28, %f85;
shl.b32 %r29, %r27, 8;
or.b32 %r30, %r29, %r26;
shl.b32 %r31, %r28, 16;
or.b32 %r32, %r30, %r31;
not.b32 %r33, %r32;
cvt.rn.f32.s32 %f139, %r33;
bra.uni $L__BB0_11;
$L__BB0_4:
abs.f32 %f66, %f4;
cvt.rmi.f32.f32 %f67, %f66;
sub.f32 %f68, %f66, %f67;
abs.f32 %f69, %f5;
cvt.rmi.f32.f32 %f70, %f69;
sub.f32 %f71, %f69, %f70;
ld.const.u64 %rd34, [params+56];
cvta.to.global.u64 %rd35, %rd34;
shl.b32 %r14, %r4, 4;
cvt.u64.u32 %rd36, %r14;
and.b64 %rd37, %rd36, 1048560;
add.s64 %rd38, %rd35, %rd37;
ld.global.v2.u32 {%r15, %r16}, [%rd38];
cvt.rn.f32.u32 %f72, %r15;
mul.f32 %f73, %f68, %f72;
cvt.rzi.u32.f32 %r19, %f73;
cvt.rn.f32.u32 %f74, %r16;
mul.f32 %f75, %f71, %f74;
cvt.rzi.u32.f32 %r20, %f75;
mad.lo.s32 %r21, %r15, %r20, %r19;
cvt.u64.u32 %rd39, %r21;
ld.global.u64 %rd40, [%rd38+8];
add.s64 %rd41, %rd40, %rd39;
ld.u8 %r22, [%rd41];
shr.u32 %r23, %r4, 16;
and.b32 %r24, %r23, %r22;
setp.eq.s32 %p5, %r24, 0;
selp.f32 %f139, 0f00000000, 0f3F800000, %p5;
$L__BB0_7:
cvt.u32.u64 %r34, %rd2;
cvt.u32.u64 %r35, %rd3;
cvt.u32.u64 %r36, %rd4;
ld.const.u64 %rd47, [params+16];
cvta.to.global.u64 %rd48, %rd47;
mul.wide.s32 %rd49, %r34, 32;
add.s64 %rd50, %rd48, %rd49;
mul.wide.s32 %rd51, %r35, 32;
add.s64 %rd52, %rd48, %rd51;
add.s64 %rd5, %rd52, 12;
mul.wide.s32 %rd53, %r36, 32;
add.s64 %rd54, %rd48, %rd53;
add.s64 %rd6, %rd54, 12;
ld.global.f32 %f93, [%rd50+12];
ld.global.f32 %f94, [%rd50+16];
ld.global.f32 %f95, [%rd50+20];
ld.global.f32 %f96, [%rd52+12];
mul.f32 %f97, %f40, %f96;
ld.global.f32 %f98, [%rd52+16];
mul.f32 %f99, %f40, %f98;
ld.global.f32 %f100, [%rd52+20];
mul.f32 %f101, %f40, %f100;
fma.rn.f32 %f102, %f130, %f93, %f97;
fma.rn.f32 %f103, %f130, %f94, %f99;
fma.rn.f32 %f104, %f130, %f95, %f101;
ld.global.f32 %f105, [%rd54+12];
ld.global.f32 %f106, [%rd54+16];
ld.global.f32 %f107, [%rd54+20];
fma.rn.f32 %f108, %f41, %f105, %f102;
fma.rn.f32 %f109, %f41, %f106, %f103;
fma.rn.f32 %f110, %f41, %f107, %f104;
mul.f32 %f111, %f109, %f109;
fma.rn.f32 %f112, %f108, %f108, %f111;
fma.rn.f32 %f113, %f110, %f110, %f112;
sqrt.rn.f32 %f114, %f113;
rcp.rn.f32 %f115, %f114;
mul.f32 %f134, %f108, %f115;
mul.f32 %f135, %f109, %f115;
mul.f32 %f136, %f110, %f115;
ld.global.v2.f32 {%f137, %f117}, [%rd50+24];
setp.lt.f32 %p6, %f117, 0f00000000;
@%p6 bra $L__BB0_9;
bra.uni $L__BB0_8;
$L__BB0_9:
add.f32 %f138, %f117, 0f3F800000;
bra.uni $L__BB0_11;
$L__BB0_8:
ld.global.v2.f32 {%f118, %f119}, [%rd5+12];
ld.global.v2.f32 {%f120, %f121}, [%rd6+12];
mul.f32 %f123, %f40, %f118;
mul.f32 %f125, %f40, %f119;
fma.rn.f32 %f126, %f130, %f137, %f123;
fma.rn.f32 %f127, %f130, %f117, %f125;
fma.rn.f32 %f137, %f41, %f120, %f126;
fma.rn.f32 %f138, %f41, %f121, %f127;
$L__BB0_11:
st.param.f32 [func_retval0+0], %f134;
st.param.f32 [func_retval0+4], %f135;
st.param.f32 [func_retval0+8], %f136;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f137;
st.param.f32 [func_retval0+20], %f138;
st.param.f32 [func_retval0+24], %f139;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 41d8da874c0bc584fab19fc7d7725332
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,252 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<7>;
.reg .b16 %rs<57>;
.reg .f32 %f<140>;
.reg .b32 %r<41>;
.reg .b64 %rd<51>;
ld.param.u32 %r6, [__direct_callable__oxMain_param_0];
ld.param.f32 %f41, [__direct_callable__oxMain_param_1+4];
ld.param.f32 %f40, [__direct_callable__oxMain_param_1];
// begin inline asm
call (%r7), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r8), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd6, [params+72];
cvta.to.global.u64 %rd7, %rd6;
mul.wide.s32 %rd8, %r6, 4;
add.s64 %rd9, %rd7, %rd8;
ld.global.u32 %r3, [%rd9];
setp.eq.s32 %p1, %r3, 0;
@%p1 bra $L__BB0_2;
ld.const.u64 %rd10, [params+480];
cvta.to.global.u64 %rd11, %rd10;
ld.const.u32 %r10, [params+472];
mad.lo.s32 %r11, %r10, %r8, %r7;
cvt.u64.u32 %rd12, %r11;
add.s64 %rd13, %rd11, %rd12;
ld.global.u8 %r12, [%rd13];
mov.u32 %r13, 1;
shl.b32 %r14, %r13, %r12;
and.b32 %r15, %r14, %r3;
setp.eq.s32 %p2, %r15, 0;
mov.f32 %f134, 0f00000000;
mov.f32 %f135, %f134;
mov.f32 %f136, %f134;
mov.f32 %f137, %f134;
mov.f32 %f138, %f134;
mov.f32 %f139, %f134;
@%p2 bra $L__BB0_11;
$L__BB0_2:
ld.const.u64 %rd14, [params+24];
cvta.to.global.u64 %rd15, %rd14;
mul.wide.u32 %rd16, %r6, 12;
add.s64 %rd17, %rd15, %rd16;
ld.global.s32 %rd1, [%rd17];
ld.global.s32 %rd2, [%rd17+4];
ld.global.s32 %rd3, [%rd17+8];
ld.const.u32 %r4, [params+32];
setp.gt.u32 %p3, %r4, %r6;
@%p3 bra $L__BB0_6;
bra.uni $L__BB0_3;
$L__BB0_6:
mov.f32 %f139, 0f3F800000;
sub.f32 %f92, %f139, %f40;
sub.f32 %f130, %f92, %f41;
bra.uni $L__BB0_7;
$L__BB0_3:
sub.s32 %r16, %r6, %r4;
ld.const.u64 %rd18, [params+48];
cvta.to.global.u64 %rd19, %rd18;
mul.wide.u32 %rd20, %r16, 4;
add.s64 %rd21, %rd19, %rd20;
ld.const.u64 %rd22, [params+40];
cvta.to.global.u64 %rd23, %rd22;
shl.b64 %rd24, %rd1, 3;
add.s64 %rd25, %rd23, %rd24;
ld.global.v2.f32 {%f48, %f49}, [%rd25];
shl.b64 %rd26, %rd2, 3;
add.s64 %rd27, %rd23, %rd26;
ld.global.v2.f32 {%f52, %f53}, [%rd27];
shl.b64 %rd28, %rd3, 3;
add.s64 %rd29, %rd23, %rd28;
ld.global.v2.f32 {%f56, %f57}, [%rd29];
mov.f32 %f60, 0f3F800000;
sub.f32 %f61, %f60, %f40;
sub.f32 %f130, %f61, %f41;
mul.f32 %f62, %f40, %f52;
mul.f32 %f63, %f40, %f53;
fma.rn.f32 %f64, %f130, %f48, %f62;
fma.rn.f32 %f65, %f130, %f49, %f63;
fma.rn.f32 %f4, %f41, %f56, %f64;
fma.rn.f32 %f5, %f41, %f57, %f65;
ld.global.u32 %r5, [%rd21];
and.b32 %r17, %r5, -16384;
setp.eq.s32 %p4, %r17, 16384;
@%p4 bra $L__BB0_5;
bra.uni $L__BB0_4;
$L__BB0_5:
add.s32 %r29, %r5, -16384;
ld.const.u64 %rd38, [params+64];
cvta.to.global.u64 %rd39, %rd38;
mul.wide.u32 %rd40, %r29, 8;
add.s64 %rd41, %rd39, %rd40;
ld.global.u64 %rd42, [%rd41];
tex.2d.v4.f32.f32 {%f76, %f77, %f78, %f79}, [%rd42, {%f4, %f5}];
cvt.sat.f32.f32 %f80, %f76;
mul.f32 %f81, %f80, 0f437F0000;
cvt.rzi.s32.f32 %r30, %f81;
cvt.sat.f32.f32 %f82, %f77;
mul.f32 %f83, %f82, 0f437F0000;
cvt.rzi.s32.f32 %r31, %f83;
cvt.sat.f32.f32 %f84, %f78;
mul.f32 %f85, %f84, 0f437F0000;
cvt.rzi.s32.f32 %r32, %f85;
shl.b32 %r33, %r31, 8;
or.b32 %r34, %r33, %r30;
shl.b32 %r35, %r32, 16;
or.b32 %r36, %r34, %r35;
not.b32 %r37, %r36;
cvt.rn.f32.s32 %f139, %r37;
bra.uni $L__BB0_11;
$L__BB0_4:
abs.f32 %f66, %f4;
cvt.rmi.f32.f32 %f67, %f66;
sub.f32 %f68, %f66, %f67;
abs.f32 %f69, %f5;
cvt.rmi.f32.f32 %f70, %f69;
sub.f32 %f71, %f69, %f70;
ld.const.u64 %rd30, [params+56];
cvta.to.global.u64 %rd31, %rd30;
shl.b32 %r18, %r5, 4;
cvt.u64.u32 %rd32, %r18;
and.b64 %rd33, %rd32, 1048560;
add.s64 %rd34, %rd31, %rd33;
ld.global.v2.u32 {%r19, %r20}, [%rd34];
cvt.rn.f32.u32 %f72, %r19;
mul.f32 %f73, %f68, %f72;
cvt.rzi.u32.f32 %r23, %f73;
cvt.rn.f32.u32 %f74, %r20;
mul.f32 %f75, %f71, %f74;
cvt.rzi.u32.f32 %r24, %f75;
mad.lo.s32 %r25, %r19, %r24, %r23;
cvt.u64.u32 %rd35, %r25;
ld.global.u64 %rd36, [%rd34+8];
add.s64 %rd37, %rd36, %rd35;
ld.u8 %r26, [%rd37];
shr.u32 %r27, %r5, 16;
and.b32 %r28, %r27, %r26;
setp.eq.s32 %p5, %r28, 0;
selp.f32 %f139, 0f00000000, 0f3F800000, %p5;
$L__BB0_7:
cvt.u32.u64 %r38, %rd1;
cvt.u32.u64 %r39, %rd2;
cvt.u32.u64 %r40, %rd3;
ld.const.u64 %rd43, [params+16];
cvta.to.global.u64 %rd44, %rd43;
mul.wide.s32 %rd45, %r38, 32;
add.s64 %rd46, %rd44, %rd45;
mul.wide.s32 %rd47, %r39, 32;
add.s64 %rd48, %rd44, %rd47;
add.s64 %rd4, %rd48, 12;
mul.wide.s32 %rd49, %r40, 32;
add.s64 %rd50, %rd44, %rd49;
add.s64 %rd5, %rd50, 12;
ld.global.f32 %f93, [%rd46+12];
ld.global.f32 %f94, [%rd46+16];
ld.global.f32 %f95, [%rd46+20];
ld.global.f32 %f96, [%rd48+12];
mul.f32 %f97, %f40, %f96;
ld.global.f32 %f98, [%rd48+16];
mul.f32 %f99, %f40, %f98;
ld.global.f32 %f100, [%rd48+20];
mul.f32 %f101, %f40, %f100;
fma.rn.f32 %f102, %f130, %f93, %f97;
fma.rn.f32 %f103, %f130, %f94, %f99;
fma.rn.f32 %f104, %f130, %f95, %f101;
ld.global.f32 %f105, [%rd50+12];
ld.global.f32 %f106, [%rd50+16];
ld.global.f32 %f107, [%rd50+20];
fma.rn.f32 %f108, %f41, %f105, %f102;
fma.rn.f32 %f109, %f41, %f106, %f103;
fma.rn.f32 %f110, %f41, %f107, %f104;
mul.f32 %f111, %f109, %f109;
fma.rn.f32 %f112, %f108, %f108, %f111;
fma.rn.f32 %f113, %f110, %f110, %f112;
sqrt.rn.f32 %f114, %f113;
rcp.rn.f32 %f115, %f114;
mul.f32 %f134, %f108, %f115;
mul.f32 %f135, %f109, %f115;
mul.f32 %f136, %f110, %f115;
ld.global.v2.f32 {%f137, %f117}, [%rd46+24];
setp.lt.f32 %p6, %f117, 0f00000000;
@%p6 bra $L__BB0_9;
bra.uni $L__BB0_8;
$L__BB0_9:
add.f32 %f138, %f117, 0f3F800000;
bra.uni $L__BB0_11;
$L__BB0_8:
ld.global.v2.f32 {%f118, %f119}, [%rd4+12];
ld.global.v2.f32 {%f120, %f121}, [%rd5+12];
mul.f32 %f123, %f40, %f118;
mul.f32 %f125, %f40, %f119;
fma.rn.f32 %f126, %f130, %f137, %f123;
fma.rn.f32 %f127, %f130, %f117, %f125;
fma.rn.f32 %f137, %f41, %f120, %f126;
fma.rn.f32 %f138, %f41, %f121, %f127;
$L__BB0_11:
st.param.f32 [func_retval0+0], %f134;
st.param.f32 [func_retval0+4], %f135;
st.param.f32 [func_retval0+8], %f136;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f137;
st.param.f32 [func_retval0+20], %f138;
st.param.f32 [func_retval0+24], %f139;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 66ec841e6e477e949b6703894f93e842
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,218 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<5>;
.reg .b16 %rs<41>;
.reg .f32 %f<132>;
.reg .b32 %r<29>;
.reg .b64 %rd<43>;
ld.param.u32 %r3, [__direct_callable__oxMain_param_0];
ld.param.f32 %f1, [__direct_callable__oxMain_param_1];
ld.param.f32 %f2, [__direct_callable__oxMain_param_1+4];
ld.const.u64 %rd6, [params+24];
cvta.to.global.u64 %rd7, %rd6;
mul.wide.u32 %rd8, %r3, 12;
add.s64 %rd9, %rd7, %rd8;
ld.global.s32 %rd1, [%rd9];
ld.global.s32 %rd2, [%rd9+4];
ld.global.s32 %rd3, [%rd9+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r3;
@%p1 bra $L__BB0_4;
bra.uni $L__BB0_1;
$L__BB0_4:
mov.f32 %f131, 0f3F800000;
sub.f32 %f84, %f131, %f1;
sub.f32 %f122, %f84, %f2;
bra.uni $L__BB0_5;
$L__BB0_1:
sub.s32 %r4, %r3, %r1;
ld.const.u64 %rd10, [params+48];
cvta.to.global.u64 %rd11, %rd10;
mul.wide.u32 %rd12, %r4, 4;
add.s64 %rd13, %rd11, %rd12;
ld.const.u64 %rd14, [params+40];
cvta.to.global.u64 %rd15, %rd14;
shl.b64 %rd16, %rd1, 3;
add.s64 %rd17, %rd15, %rd16;
ld.global.v2.f32 {%f40, %f41}, [%rd17];
shl.b64 %rd18, %rd2, 3;
add.s64 %rd19, %rd15, %rd18;
ld.global.v2.f32 {%f44, %f45}, [%rd19];
shl.b64 %rd20, %rd3, 3;
add.s64 %rd21, %rd15, %rd20;
ld.global.v2.f32 {%f48, %f49}, [%rd21];
mov.f32 %f52, 0f3F800000;
sub.f32 %f53, %f52, %f1;
sub.f32 %f122, %f53, %f2;
mul.f32 %f54, %f1, %f44;
mul.f32 %f55, %f1, %f45;
fma.rn.f32 %f56, %f122, %f40, %f54;
fma.rn.f32 %f57, %f122, %f41, %f55;
fma.rn.f32 %f4, %f2, %f48, %f56;
fma.rn.f32 %f5, %f2, %f49, %f57;
ld.global.u32 %r2, [%rd13];
and.b32 %r5, %r2, -16384;
setp.eq.s32 %p2, %r5, 16384;
@%p2 bra $L__BB0_3;
bra.uni $L__BB0_2;
$L__BB0_3:
add.s32 %r17, %r2, -16384;
ld.const.u64 %rd30, [params+64];
cvta.to.global.u64 %rd31, %rd30;
mul.wide.u32 %rd32, %r17, 8;
add.s64 %rd33, %rd31, %rd32;
ld.global.u64 %rd34, [%rd33];
tex.2d.v4.f32.f32 {%f68, %f69, %f70, %f71}, [%rd34, {%f4, %f5}];
cvt.sat.f32.f32 %f72, %f68;
mul.f32 %f73, %f72, 0f437F0000;
cvt.rzi.s32.f32 %r18, %f73;
cvt.sat.f32.f32 %f74, %f69;
mul.f32 %f75, %f74, 0f437F0000;
cvt.rzi.s32.f32 %r19, %f75;
cvt.sat.f32.f32 %f76, %f70;
mul.f32 %f77, %f76, 0f437F0000;
cvt.rzi.s32.f32 %r20, %f77;
shl.b32 %r21, %r19, 8;
or.b32 %r22, %r21, %r18;
shl.b32 %r23, %r20, 16;
or.b32 %r24, %r22, %r23;
not.b32 %r25, %r24;
cvt.rn.f32.s32 %f131, %r25;
bra.uni $L__BB0_9;
$L__BB0_2:
abs.f32 %f58, %f4;
cvt.rmi.f32.f32 %f59, %f58;
sub.f32 %f60, %f58, %f59;
abs.f32 %f61, %f5;
cvt.rmi.f32.f32 %f62, %f61;
sub.f32 %f63, %f61, %f62;
ld.const.u64 %rd22, [params+56];
cvta.to.global.u64 %rd23, %rd22;
shl.b32 %r6, %r2, 4;
cvt.u64.u32 %rd24, %r6;
and.b64 %rd25, %rd24, 1048560;
add.s64 %rd26, %rd23, %rd25;
ld.global.v2.u32 {%r7, %r8}, [%rd26];
cvt.rn.f32.u32 %f64, %r7;
mul.f32 %f65, %f60, %f64;
cvt.rzi.u32.f32 %r11, %f65;
cvt.rn.f32.u32 %f66, %r8;
mul.f32 %f67, %f63, %f66;
cvt.rzi.u32.f32 %r12, %f67;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd27, %r13;
ld.global.u64 %rd28, [%rd26+8];
add.s64 %rd29, %rd28, %rd27;
ld.u8 %r14, [%rd29];
shr.u32 %r15, %r2, 16;
and.b32 %r16, %r15, %r14;
setp.eq.s32 %p3, %r16, 0;
selp.f32 %f131, 0f00000000, 0f3F800000, %p3;
$L__BB0_5:
cvt.u32.u64 %r26, %rd1;
cvt.u32.u64 %r27, %rd2;
cvt.u32.u64 %r28, %rd3;
ld.const.u64 %rd35, [params+16];
cvta.to.global.u64 %rd36, %rd35;
mul.wide.s32 %rd37, %r26, 32;
add.s64 %rd38, %rd36, %rd37;
mul.wide.s32 %rd39, %r27, 32;
add.s64 %rd40, %rd36, %rd39;
add.s64 %rd4, %rd40, 12;
mul.wide.s32 %rd41, %r28, 32;
add.s64 %rd42, %rd36, %rd41;
add.s64 %rd5, %rd42, 12;
ld.global.f32 %f85, [%rd38+12];
ld.global.f32 %f86, [%rd38+16];
ld.global.f32 %f87, [%rd38+20];
ld.global.f32 %f88, [%rd40+12];
mul.f32 %f89, %f1, %f88;
ld.global.f32 %f90, [%rd40+16];
mul.f32 %f91, %f1, %f90;
ld.global.f32 %f92, [%rd40+20];
mul.f32 %f93, %f1, %f92;
fma.rn.f32 %f94, %f122, %f85, %f89;
fma.rn.f32 %f95, %f122, %f86, %f91;
fma.rn.f32 %f96, %f122, %f87, %f93;
ld.global.f32 %f97, [%rd42+12];
ld.global.f32 %f98, [%rd42+16];
ld.global.f32 %f99, [%rd42+20];
fma.rn.f32 %f100, %f2, %f97, %f94;
fma.rn.f32 %f101, %f2, %f98, %f95;
fma.rn.f32 %f102, %f2, %f99, %f96;
mul.f32 %f103, %f101, %f101;
fma.rn.f32 %f104, %f100, %f100, %f103;
fma.rn.f32 %f105, %f102, %f102, %f104;
sqrt.rn.f32 %f106, %f105;
rcp.rn.f32 %f107, %f106;
mul.f32 %f126, %f100, %f107;
mul.f32 %f127, %f101, %f107;
mul.f32 %f128, %f102, %f107;
ld.global.v2.f32 {%f129, %f109}, [%rd38+24];
setp.lt.f32 %p4, %f109, 0f00000000;
@%p4 bra $L__BB0_7;
bra.uni $L__BB0_6;
$L__BB0_7:
add.f32 %f130, %f109, 0f3F800000;
bra.uni $L__BB0_9;
$L__BB0_6:
ld.global.v2.f32 {%f110, %f111}, [%rd4+12];
ld.global.v2.f32 {%f112, %f113}, [%rd5+12];
mul.f32 %f115, %f1, %f110;
mul.f32 %f117, %f1, %f111;
fma.rn.f32 %f118, %f122, %f129, %f115;
fma.rn.f32 %f119, %f122, %f109, %f117;
fma.rn.f32 %f129, %f2, %f112, %f118;
fma.rn.f32 %f130, %f2, %f113, %f119;
$L__BB0_9:
st.param.f32 [func_retval0+0], %f126;
st.param.f32 [func_retval0+4], %f127;
st.param.f32 [func_retval0+8], %f128;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f129;
st.param.f32 [func_retval0+20], %f130;
st.param.f32 [func_retval0+24], %f131;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 4ffdc380cec82f0499209c71cc127d15
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,198 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
.const .align 16 .b8 params[1184];
.visible .func (.param .align 8 .b8 func_retval0[32]) __direct_callable__oxMain(
.param .b32 __direct_callable__oxMain_param_0,
.param .align 8 .b8 __direct_callable__oxMain_param_1[8]
)
{
.reg .pred %p<4>;
.reg .b16 %rs<41>;
.reg .f32 %f<104>;
.reg .b32 %r<29>;
.reg .b64 %rd<41>;
ld.param.u32 %r3, [__direct_callable__oxMain_param_0];
ld.param.f32 %f1, [__direct_callable__oxMain_param_1];
ld.param.f32 %f2, [__direct_callable__oxMain_param_1+4];
ld.const.u64 %rd4, [params+24];
cvta.to.global.u64 %rd5, %rd4;
mul.wide.u32 %rd6, %r3, 12;
add.s64 %rd7, %rd5, %rd6;
ld.global.s32 %rd1, [%rd7];
ld.global.s32 %rd2, [%rd7+4];
ld.global.s32 %rd3, [%rd7+8];
ld.const.u32 %r1, [params+32];
setp.gt.u32 %p1, %r1, %r3;
@%p1 bra $L__BB0_4;
bra.uni $L__BB0_1;
$L__BB0_4:
mov.f32 %f103, 0f3F800000;
sub.f32 %f72, %f103, %f1;
sub.f32 %f98, %f72, %f2;
bra.uni $L__BB0_5;
$L__BB0_1:
sub.s32 %r4, %r3, %r1;
ld.const.u64 %rd8, [params+48];
cvta.to.global.u64 %rd9, %rd8;
mul.wide.u32 %rd10, %r4, 4;
add.s64 %rd11, %rd9, %rd10;
ld.const.u64 %rd12, [params+40];
cvta.to.global.u64 %rd13, %rd12;
shl.b64 %rd14, %rd1, 3;
add.s64 %rd15, %rd13, %rd14;
ld.global.v2.f32 {%f28, %f29}, [%rd15];
shl.b64 %rd16, %rd2, 3;
add.s64 %rd17, %rd13, %rd16;
ld.global.v2.f32 {%f32, %f33}, [%rd17];
shl.b64 %rd18, %rd3, 3;
add.s64 %rd19, %rd13, %rd18;
ld.global.v2.f32 {%f36, %f37}, [%rd19];
mov.f32 %f40, 0f3F800000;
sub.f32 %f41, %f40, %f1;
sub.f32 %f98, %f41, %f2;
mul.f32 %f42, %f1, %f32;
mul.f32 %f43, %f1, %f33;
fma.rn.f32 %f44, %f98, %f28, %f42;
fma.rn.f32 %f45, %f98, %f29, %f43;
fma.rn.f32 %f4, %f2, %f36, %f44;
fma.rn.f32 %f5, %f2, %f37, %f45;
ld.global.u32 %r2, [%rd11];
and.b32 %r5, %r2, -16384;
setp.eq.s32 %p2, %r5, 16384;
@%p2 bra $L__BB0_3;
bra.uni $L__BB0_2;
$L__BB0_3:
add.s32 %r17, %r2, -16384;
ld.const.u64 %rd28, [params+64];
cvta.to.global.u64 %rd29, %rd28;
mul.wide.u32 %rd30, %r17, 8;
add.s64 %rd31, %rd29, %rd30;
ld.global.u64 %rd32, [%rd31];
tex.2d.v4.f32.f32 {%f56, %f57, %f58, %f59}, [%rd32, {%f4, %f5}];
cvt.sat.f32.f32 %f60, %f56;
mul.f32 %f61, %f60, 0f437F0000;
cvt.rzi.s32.f32 %r18, %f61;
cvt.sat.f32.f32 %f62, %f57;
mul.f32 %f63, %f62, 0f437F0000;
cvt.rzi.s32.f32 %r19, %f63;
cvt.sat.f32.f32 %f64, %f58;
mul.f32 %f65, %f64, 0f437F0000;
cvt.rzi.s32.f32 %r20, %f65;
shl.b32 %r21, %r19, 8;
or.b32 %r22, %r21, %r18;
shl.b32 %r23, %r20, 16;
or.b32 %r24, %r22, %r23;
not.b32 %r25, %r24;
cvt.rn.f32.s32 %f103, %r25;
bra.uni $L__BB0_6;
$L__BB0_2:
abs.f32 %f46, %f4;
cvt.rmi.f32.f32 %f47, %f46;
sub.f32 %f48, %f46, %f47;
abs.f32 %f49, %f5;
cvt.rmi.f32.f32 %f50, %f49;
sub.f32 %f51, %f49, %f50;
ld.const.u64 %rd20, [params+56];
cvta.to.global.u64 %rd21, %rd20;
shl.b32 %r6, %r2, 4;
cvt.u64.u32 %rd22, %r6;
and.b64 %rd23, %rd22, 1048560;
add.s64 %rd24, %rd21, %rd23;
ld.global.v2.u32 {%r7, %r8}, [%rd24];
cvt.rn.f32.u32 %f52, %r7;
mul.f32 %f53, %f48, %f52;
cvt.rzi.u32.f32 %r11, %f53;
cvt.rn.f32.u32 %f54, %r8;
mul.f32 %f55, %f51, %f54;
cvt.rzi.u32.f32 %r12, %f55;
mad.lo.s32 %r13, %r7, %r12, %r11;
cvt.u64.u32 %rd25, %r13;
ld.global.u64 %rd26, [%rd24+8];
add.s64 %rd27, %rd26, %rd25;
ld.u8 %r14, [%rd27];
shr.u32 %r15, %r2, 16;
and.b32 %r16, %r15, %r14;
setp.eq.s32 %p3, %r16, 0;
selp.f32 %f103, 0f00000000, 0f3F800000, %p3;
$L__BB0_5:
cvt.u32.u64 %r26, %rd1;
cvt.u32.u64 %r27, %rd2;
cvt.u32.u64 %r28, %rd3;
ld.const.u64 %rd33, [params+16];
cvta.to.global.u64 %rd34, %rd33;
mul.wide.s32 %rd35, %r26, 24;
add.s64 %rd36, %rd34, %rd35;
mul.wide.s32 %rd37, %r27, 24;
add.s64 %rd38, %rd34, %rd37;
mul.wide.s32 %rd39, %r28, 24;
add.s64 %rd40, %rd34, %rd39;
ld.global.f32 %f73, [%rd36+12];
ld.global.f32 %f74, [%rd36+16];
ld.global.f32 %f75, [%rd36+20];
ld.global.f32 %f76, [%rd38+12];
mul.f32 %f77, %f1, %f76;
ld.global.f32 %f78, [%rd38+16];
mul.f32 %f79, %f1, %f78;
ld.global.f32 %f80, [%rd38+20];
mul.f32 %f81, %f1, %f80;
fma.rn.f32 %f82, %f98, %f73, %f77;
fma.rn.f32 %f83, %f98, %f74, %f79;
fma.rn.f32 %f84, %f98, %f75, %f81;
ld.global.f32 %f85, [%rd40+12];
ld.global.f32 %f86, [%rd40+16];
ld.global.f32 %f87, [%rd40+20];
fma.rn.f32 %f88, %f2, %f85, %f82;
fma.rn.f32 %f89, %f2, %f86, %f83;
fma.rn.f32 %f90, %f2, %f87, %f84;
mul.f32 %f91, %f89, %f89;
fma.rn.f32 %f92, %f88, %f88, %f91;
fma.rn.f32 %f93, %f90, %f90, %f92;
sqrt.rn.f32 %f94, %f93;
rcp.rn.f32 %f95, %f94;
mul.f32 %f102, %f90, %f95;
mul.f32 %f101, %f89, %f95;
mul.f32 %f100, %f88, %f95;
$L__BB0_6:
st.param.f32 [func_retval0+0], %f100;
st.param.f32 [func_retval0+4], %f101;
st.param.f32 [func_retval0+8], %f102;
st.param.v4.b8 [func_retval0+12], {%rs17, %rs18, %rs19, %rs20};
st.param.f32 [func_retval0+16], %f25;
st.param.f32 [func_retval0+20], %f26;
st.param.f32 [func_retval0+24], %f103;
st.param.v4.b8 [func_retval0+28], {%rs21, %rs22, %rs23, %rs24};
ret;
}
// .globl oxMain
.visible .entry oxMain()
{
.reg .b64 %rd<2>;
mov.u64 %rd1, __direct_callable__oxMain;
// begin inline asm
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 3f58da3270e9f6146a743779de88cb7f
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,77 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__dummy
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__dummy()
{
ret;
}
// .globl __anyhit__oxMain
.visible .entry __anyhit__oxMain()
{
.reg .pred %p<2>;
.reg .b16 %rs<9>;
.reg .f32 %f<9>;
.reg .b32 %r<3>;
.reg .b64 %rd<2>;
// begin inline asm
call (%r1), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f1, %f2), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r2, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r2);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r1;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f1, %f2};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f3, %f4}, [retval0+0];
ld.param.f32 %f5, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f6, %f7}, [retval0+16];
ld.param.f32 %f8, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
setp.neu.f32 %p1, %f8, 0f00000000;
@%p1 bra $L__BB1_2;
// begin inline asm
call _optix_ignore_intersection, ();
// end inline asm
$L__BB1_2:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 5113807b3c5b9e84393af21b2f75917a
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,136 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__dummy
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__dummy()
{
ret;
}
// .globl __anyhit__oxMain
.visible .entry __anyhit__oxMain()
{
.reg .pred %p<3>;
.reg .b16 %rs<9>;
.reg .f32 %f<24>;
.reg .b32 %r<24>;
.reg .b64 %rd<2>;
// begin inline asm
call (%r1), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f2, %f3), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r2, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r2);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r1;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f2, %f3};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f4, %f5}, [retval0+0];
ld.param.f32 %f6, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f7, %f8}, [retval0+16];
ld.param.f32 %f1, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
setp.gtu.f32 %p1, %f1, 0f00000000;
@%p1 bra $L__BB1_4;
setp.geu.f32 %p2, %f1, 0f00000000;
@%p2 bra $L__BB1_3;
cvt.rzi.s32.f32 %r19, %f1;
not.b32 %r20, %r19;
and.b32 %r21, %r20, 255;
bfe.u32 %r22, %r20, 8, 8;
bfe.u32 %r23, %r20, 16, 8;
cvt.rn.f32.s32 %f10, %r21;
cvt.rn.f32.s32 %f11, %r22;
cvt.rn.f32.s32 %f12, %r23;
mul.f32 %f13, %f10, 0f3B808081;
mul.f32 %f14, %f11, 0f3B808081;
mul.f32 %f15, %f12, 0f3B808081;
mov.u32 %r11, 0;
// begin inline asm
call (%r3), _optix_get_payload, (%r11);
// end inline asm
mov.b32 %f16, %r3;
mov.u32 %r13, 1;
// begin inline asm
call (%r5), _optix_get_payload, (%r13);
// end inline asm
mov.b32 %f17, %r5;
mov.u32 %r15, 2;
// begin inline asm
call (%r7), _optix_get_payload, (%r15);
// end inline asm
mov.b32 %f18, %r7;
mov.u32 %r17, 3;
// begin inline asm
call (%r9), _optix_get_payload, (%r17);
// end inline asm
mov.b32 %f19, %r9;
mul.f32 %f20, %f13, %f16;
mul.f32 %f21, %f14, %f17;
mul.f32 %f22, %f15, %f18;
// begin inline asm
call (%f9), _optix_get_ray_tmax, ();
// end inline asm
min.f32 %f23, %f19, %f9;
mov.b32 %r12, %f20;
// begin inline asm
call _optix_set_payload, (%r11, %r12);
// end inline asm
mov.b32 %r14, %f21;
// begin inline asm
call _optix_set_payload, (%r13, %r14);
// end inline asm
mov.b32 %r16, %f22;
// begin inline asm
call _optix_set_payload, (%r15, %r16);
// end inline asm
mov.b32 %r18, %f23;
// begin inline asm
call _optix_set_payload, (%r17, %r18);
// end inline asm
$L__BB1_3:
// begin inline asm
call _optix_ignore_intersection, ();
// end inline asm
$L__BB1_4:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 17511e2c968ee5e479d30d11ee6477d2
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
+267
View File
@@ -0,0 +1,267 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<14>;
.reg .b16 %rs<45>;
.reg .f32 %f<158>;
.reg .b32 %r<59>;
.reg .b64 %rd<27>;
mov.u32 %r25, %ctaid.x;
mov.u32 %r1, %ntid.x;
mov.u32 %r26, %tid.x;
mad.lo.s32 %r2, %r25, %r1, %r26;
mov.u32 %r3, %ntid.y;
mov.u32 %r27, %ctaid.y;
mov.u32 %r28, %tid.y;
mad.lo.s32 %r4, %r27, %r3, %r28;
ld.const.u64 %rd10, [params+144];
cvta.to.global.u64 %rd1, %rd10;
ld.const.u32 %r5, [params+136];
mul.lo.s32 %r6, %r5, %r4;
add.s32 %r29, %r6, %r2;
mul.wide.u32 %rd11, %r29, 4;
add.s64 %rd12, %rd1, %rd11;
add.s64 %rd2, %rd12, 3;
ld.global.u8 %rs8, [%rd12+3];
setp.ne.s16 %p1, %rs8, 0;
@%p1 bra $L__BB0_17;
mov.u32 %r53, 0;
ld.global.v4.u8 {%rs9, %rs10, %rs11, %rs12}, [%rd2+-3];
cvt.rn.f32.u16 %f61, %rs11;
div.rn.f32 %f134, %f61, 0f437F0000;
cvt.rn.f32.u16 %f62, %rs10;
div.rn.f32 %f135, %f62, 0f437F0000;
cvt.rn.f32.u16 %f63, %rs9;
div.rn.f32 %f136, %f63, 0f437F0000;
add.s32 %r31, %r2, -1;
setp.eq.s32 %p2, %r2, 0;
selp.b32 %r7, 0, %r31, %p2;
add.s32 %r32, %r4, -1;
setp.eq.s32 %p3, %r4, 0;
selp.b32 %r33, 0, %r32, %p3;
mov.u32 %r34, %nctaid.x;
mad.lo.s32 %r35, %r34, %r1, -1;
setp.eq.s32 %p4, %r2, %r35;
add.s32 %r36, %r2, 1;
selp.b32 %r8, %r35, %r36, %p4;
mov.u32 %r37, %nctaid.y;
mad.lo.s32 %r38, %r37, %r3, -1;
setp.eq.s32 %p5, %r4, %r38;
add.s32 %r39, %r4, 1;
selp.b32 %r9, %r38, %r39, %p5;
mul.lo.s32 %r10, %r5, %r33;
add.s32 %r40, %r10, %r7;
mul.wide.u32 %rd13, %r40, 4;
add.s64 %rd14, %rd1, %rd13;
add.s64 %rd3, %rd14, 3;
ld.global.u8 %rs1, [%rd14+3];
setp.eq.s16 %p6, %rs1, 0;
mov.f32 %f137, 0f00000000;
@%p6 bra $L__BB0_3;
mov.u32 %r53, 1;
ld.global.v4.u8 {%rs13, %rs14, %rs15, %rs16}, [%rd3+-3];
cvt.rn.f32.u16 %f64, %rs15;
div.rn.f32 %f65, %f64, 0f437F0000;
cvt.rn.f32.u16 %f66, %rs14;
div.rn.f32 %f67, %f66, 0f437F0000;
cvt.rn.f32.u16 %f68, %rs13;
div.rn.f32 %f69, %f68, 0f437F0000;
cvt.rn.f32.u16 %f70, %rs1;
div.rn.f32 %f71, %f70, 0f437F0000;
add.f32 %f134, %f134, %f65;
add.f32 %f135, %f135, %f67;
add.f32 %f136, %f136, %f69;
add.f32 %f137, %f71, 0f00000000;
$L__BB0_3:
add.s32 %r42, %r10, %r2;
mul.wide.u32 %rd15, %r42, 4;
add.s64 %rd16, %rd1, %rd15;
add.s64 %rd4, %rd16, 3;
ld.global.u8 %rs2, [%rd16+3];
setp.eq.s16 %p7, %rs2, 0;
@%p7 bra $L__BB0_5;
ld.global.v4.u8 {%rs17, %rs18, %rs19, %rs20}, [%rd4+-3];
cvt.rn.f32.u16 %f72, %rs19;
div.rn.f32 %f73, %f72, 0f437F0000;
cvt.rn.f32.u16 %f74, %rs18;
div.rn.f32 %f75, %f74, 0f437F0000;
cvt.rn.f32.u16 %f76, %rs17;
div.rn.f32 %f77, %f76, 0f437F0000;
cvt.rn.f32.u16 %f78, %rs2;
div.rn.f32 %f79, %f78, 0f437F0000;
add.f32 %f134, %f134, %f73;
add.f32 %f135, %f135, %f75;
add.f32 %f136, %f136, %f77;
add.f32 %f137, %f137, %f79;
add.s32 %r53, %r53, 1;
$L__BB0_5:
add.s32 %r43, %r10, %r8;
mul.wide.u32 %rd17, %r43, 4;
add.s64 %rd18, %rd1, %rd17;
add.s64 %rd5, %rd18, 3;
ld.global.u8 %rs3, [%rd18+3];
setp.eq.s16 %p8, %rs3, 0;
@%p8 bra $L__BB0_7;
ld.global.v4.u8 {%rs21, %rs22, %rs23, %rs24}, [%rd5+-3];
cvt.rn.f32.u16 %f80, %rs23;
div.rn.f32 %f81, %f80, 0f437F0000;
cvt.rn.f32.u16 %f82, %rs22;
div.rn.f32 %f83, %f82, 0f437F0000;
cvt.rn.f32.u16 %f84, %rs21;
div.rn.f32 %f85, %f84, 0f437F0000;
cvt.rn.f32.u16 %f86, %rs3;
div.rn.f32 %f87, %f86, 0f437F0000;
add.f32 %f134, %f134, %f81;
add.f32 %f135, %f135, %f83;
add.f32 %f136, %f136, %f85;
add.f32 %f137, %f137, %f87;
add.s32 %r53, %r53, 1;
$L__BB0_7:
add.s32 %r44, %r6, %r7;
mul.wide.u32 %rd19, %r44, 4;
add.s64 %rd20, %rd1, %rd19;
add.s64 %rd6, %rd20, 3;
ld.global.u8 %rs4, [%rd20+3];
setp.eq.s16 %p9, %rs4, 0;
@%p9 bra $L__BB0_9;
ld.global.v4.u8 {%rs25, %rs26, %rs27, %rs28}, [%rd6+-3];
cvt.rn.f32.u16 %f88, %rs27;
div.rn.f32 %f89, %f88, 0f437F0000;
cvt.rn.f32.u16 %f90, %rs26;
div.rn.f32 %f91, %f90, 0f437F0000;
cvt.rn.f32.u16 %f92, %rs25;
div.rn.f32 %f93, %f92, 0f437F0000;
cvt.rn.f32.u16 %f94, %rs4;
div.rn.f32 %f95, %f94, 0f437F0000;
add.f32 %f134, %f134, %f89;
add.f32 %f135, %f135, %f91;
add.f32 %f136, %f136, %f93;
add.f32 %f137, %f137, %f95;
add.s32 %r53, %r53, 1;
$L__BB0_9:
add.s32 %r45, %r6, %r8;
mul.wide.u32 %rd21, %r45, 4;
add.s64 %rd22, %rd1, %rd21;
add.s64 %rd7, %rd22, 3;
ld.global.u8 %rs5, [%rd22+3];
setp.eq.s16 %p10, %rs5, 0;
@%p10 bra $L__BB0_11;
ld.global.v4.u8 {%rs29, %rs30, %rs31, %rs32}, [%rd7+-3];
cvt.rn.f32.u16 %f96, %rs31;
div.rn.f32 %f97, %f96, 0f437F0000;
cvt.rn.f32.u16 %f98, %rs30;
div.rn.f32 %f99, %f98, 0f437F0000;
cvt.rn.f32.u16 %f100, %rs29;
div.rn.f32 %f101, %f100, 0f437F0000;
cvt.rn.f32.u16 %f102, %rs5;
div.rn.f32 %f103, %f102, 0f437F0000;
add.f32 %f134, %f134, %f97;
add.f32 %f135, %f135, %f99;
add.f32 %f136, %f136, %f101;
add.f32 %f137, %f137, %f103;
add.s32 %r53, %r53, 1;
$L__BB0_11:
mul.lo.s32 %r20, %r5, %r9;
add.s32 %r46, %r20, %r7;
mul.wide.u32 %rd23, %r46, 4;
add.s64 %rd24, %rd1, %rd23;
add.s64 %rd8, %rd24, 3;
ld.global.u8 %rs6, [%rd24+3];
setp.eq.s16 %p11, %rs6, 0;
@%p11 bra $L__BB0_13;
ld.global.v4.u8 {%rs33, %rs34, %rs35, %rs36}, [%rd8+-3];
cvt.rn.f32.u16 %f104, %rs35;
div.rn.f32 %f105, %f104, 0f437F0000;
cvt.rn.f32.u16 %f106, %rs34;
div.rn.f32 %f107, %f106, 0f437F0000;
cvt.rn.f32.u16 %f108, %rs33;
div.rn.f32 %f109, %f108, 0f437F0000;
cvt.rn.f32.u16 %f110, %rs6;
div.rn.f32 %f111, %f110, 0f437F0000;
add.f32 %f134, %f134, %f105;
add.f32 %f135, %f135, %f107;
add.f32 %f136, %f136, %f109;
add.f32 %f137, %f137, %f111;
add.s32 %r53, %r53, 1;
$L__BB0_13:
add.s32 %r47, %r20, %r8;
mul.wide.u32 %rd25, %r47, 4;
add.s64 %rd26, %rd1, %rd25;
add.s64 %rd9, %rd26, 3;
ld.global.u8 %rs7, [%rd26+3];
setp.eq.s16 %p12, %rs7, 0;
@%p12 bra $L__BB0_15;
ld.global.v4.u8 {%rs37, %rs38, %rs39, %rs40}, [%rd9+-3];
cvt.rn.f32.u16 %f112, %rs39;
div.rn.f32 %f113, %f112, 0f437F0000;
cvt.rn.f32.u16 %f114, %rs38;
div.rn.f32 %f115, %f114, 0f437F0000;
cvt.rn.f32.u16 %f116, %rs37;
div.rn.f32 %f117, %f116, 0f437F0000;
cvt.rn.f32.u16 %f118, %rs7;
div.rn.f32 %f119, %f118, 0f437F0000;
add.f32 %f134, %f134, %f113;
add.f32 %f135, %f135, %f115;
add.f32 %f136, %f136, %f117;
add.f32 %f137, %f137, %f119;
add.s32 %r53, %r53, 1;
$L__BB0_15:
setp.eq.s32 %p13, %r53, 0;
@%p13 bra $L__BB0_17;
cvt.rn.f32.u32 %f120, %r53;
rcp.rn.f32 %f121, %f120;
mul.f32 %f122, %f134, %f121;
mul.f32 %f123, %f135, %f121;
mul.f32 %f124, %f136, %f121;
mul.f32 %f125, %f137, %f121;
mul.f32 %f126, %f122, 0f437F0000;
mul.f32 %f127, %f123, 0f437F0000;
mul.f32 %f128, %f124, 0f437F0000;
mul.f32 %f129, %f125, 0f437F0000;
cvt.rzi.u32.f32 %r48, %f128;
cvt.rzi.u32.f32 %r49, %f127;
cvt.rzi.u32.f32 %r50, %f126;
cvt.rzi.u32.f32 %r51, %f129;
cvt.u16.u32 %rs41, %r51;
cvt.u16.u32 %rs42, %r50;
cvt.u16.u32 %rs43, %r49;
cvt.u16.u32 %rs44, %r48;
st.global.v4.u8 [%rd2+-3], {%rs44, %rs43, %rs42, %rs41};
$L__BB0_17:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: a38fcfa136f546f439de0a7efbbca063
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,349 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<14>;
.reg .b16 %rs<45>;
.reg .f32 %f<105>;
.reg .b32 %r<55>;
.reg .b64 %rd<27>;
mov.u32 %r25, %ctaid.x;
mov.u32 %r1, %ntid.x;
mov.u32 %r26, %tid.x;
mad.lo.s32 %r2, %r25, %r1, %r26;
mov.u32 %r3, %ntid.y;
mov.u32 %r27, %ctaid.y;
mov.u32 %r28, %tid.y;
mad.lo.s32 %r4, %r27, %r3, %r28;
ld.const.u64 %rd10, [params+144];
cvta.to.global.u64 %rd1, %rd10;
ld.const.u32 %r5, [params+136];
mul.lo.s32 %r6, %r5, %r4;
add.s32 %r29, %r6, %r2;
mul.wide.u32 %rd11, %r29, 8;
add.s64 %rd12, %rd1, %rd11;
add.s64 %rd2, %rd12, 6;
ld.global.u16 %rs2, [%rd12+6];
mov.f32 %f46, 0f00000000;
// begin inline asm
{ cvt.rn.f16.f32 %rs1, %f46;}
// end inline asm
setp.gt.u16 %p1, %rs2, %rs1;
@%p1 bra $L__BB0_17;
ld.global.u16 %rs3, [%rd2+-6];
// begin inline asm
{ cvt.f32.f16 %f87, %rs3;}
// end inline asm
ld.global.u16 %rs4, [%rd2+-4];
// begin inline asm
{ cvt.f32.f16 %f88, %rs4;}
// end inline asm
ld.global.u16 %rs5, [%rd2+-2];
// begin inline asm
{ cvt.f32.f16 %f89, %rs5;}
// end inline asm
add.s32 %r31, %r2, -1;
setp.eq.s32 %p2, %r2, 0;
mov.u32 %r49, 0;
selp.b32 %r7, 0, %r31, %p2;
add.s32 %r32, %r4, -1;
setp.eq.s32 %p3, %r4, 0;
selp.b32 %r33, 0, %r32, %p3;
mov.u32 %r34, %nctaid.x;
mad.lo.s32 %r35, %r34, %r1, -1;
setp.eq.s32 %p4, %r2, %r35;
add.s32 %r36, %r2, 1;
selp.b32 %r8, %r35, %r36, %p4;
mov.u32 %r37, %nctaid.y;
mad.lo.s32 %r38, %r37, %r3, -1;
setp.eq.s32 %p5, %r4, %r38;
add.s32 %r39, %r4, 1;
selp.b32 %r9, %r38, %r39, %p5;
mul.lo.s32 %r10, %r5, %r33;
add.s32 %r40, %r10, %r7;
mul.wide.u32 %rd13, %r40, 8;
add.s64 %rd14, %rd1, %rd13;
add.s64 %rd3, %rd14, 6;
ld.global.u16 %rs7, [%rd14+6];
// begin inline asm
{ cvt.rn.f16.f32 %rs6, %f46;}
// end inline asm
setp.le.u16 %p6, %rs7, %rs6;
@%p6 bra $L__BB0_3;
ld.global.u16 %rs8, [%rd3+-6];
// begin inline asm
{ cvt.f32.f16 %f51, %rs8;}
// end inline asm
ld.global.u16 %rs9, [%rd3+-4];
// begin inline asm
{ cvt.f32.f16 %f52, %rs9;}
// end inline asm
ld.global.u16 %rs10, [%rd3+-2];
// begin inline asm
{ cvt.f32.f16 %f53, %rs10;}
// end inline asm
add.f32 %f87, %f87, %f51;
add.f32 %f88, %f88, %f52;
add.f32 %f89, %f89, %f53;
mov.u32 %r49, 1;
$L__BB0_3:
add.s32 %r42, %r10, %r2;
mul.wide.u32 %rd15, %r42, 8;
add.s64 %rd16, %rd1, %rd15;
add.s64 %rd4, %rd16, 6;
ld.global.u16 %rs12, [%rd16+6];
mov.f32 %f54, 0f00000000;
// begin inline asm
{ cvt.rn.f16.f32 %rs11, %f54;}
// end inline asm
setp.le.u16 %p7, %rs12, %rs11;
@%p7 bra $L__BB0_5;
ld.global.u16 %rs13, [%rd4+-6];
// begin inline asm
{ cvt.f32.f16 %f55, %rs13;}
// end inline asm
ld.global.u16 %rs14, [%rd4+-4];
// begin inline asm
{ cvt.f32.f16 %f56, %rs14;}
// end inline asm
ld.global.u16 %rs15, [%rd4+-2];
// begin inline asm
{ cvt.f32.f16 %f57, %rs15;}
// end inline asm
add.f32 %f87, %f87, %f55;
add.f32 %f88, %f88, %f56;
add.f32 %f89, %f89, %f57;
add.s32 %r49, %r49, 1;
$L__BB0_5:
add.s32 %r43, %r10, %r8;
mul.wide.u32 %rd17, %r43, 8;
add.s64 %rd18, %rd1, %rd17;
add.s64 %rd5, %rd18, 6;
ld.global.u16 %rs17, [%rd18+6];
// begin inline asm
{ cvt.rn.f16.f32 %rs16, %f54;}
// end inline asm
setp.le.u16 %p8, %rs17, %rs16;
@%p8 bra $L__BB0_7;
ld.global.u16 %rs18, [%rd5+-6];
// begin inline asm
{ cvt.f32.f16 %f59, %rs18;}
// end inline asm
ld.global.u16 %rs19, [%rd5+-4];
// begin inline asm
{ cvt.f32.f16 %f60, %rs19;}
// end inline asm
ld.global.u16 %rs20, [%rd5+-2];
// begin inline asm
{ cvt.f32.f16 %f61, %rs20;}
// end inline asm
add.f32 %f87, %f87, %f59;
add.f32 %f88, %f88, %f60;
add.f32 %f89, %f89, %f61;
add.s32 %r49, %r49, 1;
$L__BB0_7:
add.s32 %r44, %r6, %r7;
mul.wide.u32 %rd19, %r44, 8;
add.s64 %rd20, %rd1, %rd19;
add.s64 %rd6, %rd20, 6;
ld.global.u16 %rs22, [%rd20+6];
mov.f32 %f62, 0f00000000;
// begin inline asm
{ cvt.rn.f16.f32 %rs21, %f62;}
// end inline asm
setp.le.u16 %p9, %rs22, %rs21;
@%p9 bra $L__BB0_9;
ld.global.u16 %rs23, [%rd6+-6];
// begin inline asm
{ cvt.f32.f16 %f63, %rs23;}
// end inline asm
ld.global.u16 %rs24, [%rd6+-4];
// begin inline asm
{ cvt.f32.f16 %f64, %rs24;}
// end inline asm
ld.global.u16 %rs25, [%rd6+-2];
// begin inline asm
{ cvt.f32.f16 %f65, %rs25;}
// end inline asm
add.f32 %f87, %f87, %f63;
add.f32 %f88, %f88, %f64;
add.f32 %f89, %f89, %f65;
add.s32 %r49, %r49, 1;
$L__BB0_9:
add.s32 %r45, %r6, %r8;
mul.wide.u32 %rd21, %r45, 8;
add.s64 %rd22, %rd1, %rd21;
add.s64 %rd7, %rd22, 6;
ld.global.u16 %rs27, [%rd22+6];
// begin inline asm
{ cvt.rn.f16.f32 %rs26, %f62;}
// end inline asm
setp.le.u16 %p10, %rs27, %rs26;
@%p10 bra $L__BB0_11;
ld.global.u16 %rs28, [%rd7+-6];
// begin inline asm
{ cvt.f32.f16 %f67, %rs28;}
// end inline asm
ld.global.u16 %rs29, [%rd7+-4];
// begin inline asm
{ cvt.f32.f16 %f68, %rs29;}
// end inline asm
ld.global.u16 %rs30, [%rd7+-2];
// begin inline asm
{ cvt.f32.f16 %f69, %rs30;}
// end inline asm
add.f32 %f87, %f87, %f67;
add.f32 %f88, %f88, %f68;
add.f32 %f89, %f89, %f69;
add.s32 %r49, %r49, 1;
$L__BB0_11:
mul.lo.s32 %r20, %r5, %r9;
add.s32 %r46, %r20, %r7;
mul.wide.u32 %rd23, %r46, 8;
add.s64 %rd24, %rd1, %rd23;
add.s64 %rd8, %rd24, 6;
ld.global.u16 %rs32, [%rd24+6];
mov.f32 %f70, 0f00000000;
// begin inline asm
{ cvt.rn.f16.f32 %rs31, %f70;}
// end inline asm
setp.le.u16 %p11, %rs32, %rs31;
@%p11 bra $L__BB0_13;
ld.global.u16 %rs33, [%rd8+-6];
// begin inline asm
{ cvt.f32.f16 %f71, %rs33;}
// end inline asm
ld.global.u16 %rs34, [%rd8+-4];
// begin inline asm
{ cvt.f32.f16 %f72, %rs34;}
// end inline asm
ld.global.u16 %rs35, [%rd8+-2];
// begin inline asm
{ cvt.f32.f16 %f73, %rs35;}
// end inline asm
add.f32 %f87, %f87, %f71;
add.f32 %f88, %f88, %f72;
add.f32 %f89, %f89, %f73;
add.s32 %r49, %r49, 1;
$L__BB0_13:
add.s32 %r47, %r20, %r8;
mul.wide.u32 %rd25, %r47, 8;
add.s64 %rd26, %rd1, %rd25;
add.s64 %rd9, %rd26, 6;
ld.global.u16 %rs37, [%rd26+6];
// begin inline asm
{ cvt.rn.f16.f32 %rs36, %f70;}
// end inline asm
setp.le.u16 %p12, %rs37, %rs36;
@%p12 bra $L__BB0_15;
ld.global.u16 %rs38, [%rd9+-6];
// begin inline asm
{ cvt.f32.f16 %f75, %rs38;}
// end inline asm
ld.global.u16 %rs39, [%rd9+-4];
// begin inline asm
{ cvt.f32.f16 %f76, %rs39;}
// end inline asm
ld.global.u16 %rs40, [%rd9+-2];
// begin inline asm
{ cvt.f32.f16 %f77, %rs40;}
// end inline asm
add.f32 %f87, %f87, %f75;
add.f32 %f88, %f88, %f76;
add.f32 %f89, %f89, %f77;
add.s32 %r49, %r49, 1;
$L__BB0_15:
setp.eq.s32 %p13, %r49, 0;
@%p13 bra $L__BB0_17;
cvt.rn.f32.u32 %f82, %r49;
rcp.rn.f32 %f83, %f82;
mov.f32 %f81, 0f3F800000;
mul.f32 %f78, %f87, %f83;
mul.f32 %f79, %f88, %f83;
mul.f32 %f80, %f89, %f83;
// begin inline asm
{ cvt.rn.f16.f32 %rs43, %f80;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs42, %f79;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs41, %f78;}
// end inline asm
// begin inline asm
{ cvt.rn.f16.f32 %rs44, %f81;}
// end inline asm
st.global.v4.u16 [%rd2+-6], {%rs41, %rs42, %rs43, %rs44};
$L__BB0_17:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 392247a8b43930a4988497810f4e1cfd
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,187 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl oxMain
.const .align 16 .b8 params[1184];
.visible .entry oxMain()
{
.reg .pred %p<14>;
.reg .b16 %rs<19>;
.reg .f32 %f<41>;
.reg .b32 %r<56>;
.reg .b64 %rd<27>;
mov.u32 %r25, %ctaid.x;
mov.u32 %r1, %ntid.x;
mov.u32 %r26, %tid.x;
mad.lo.s32 %r2, %r25, %r1, %r26;
mov.u32 %r3, %ntid.y;
mov.u32 %r27, %ctaid.y;
mov.u32 %r28, %tid.y;
mad.lo.s32 %r4, %r27, %r3, %r28;
ld.const.u64 %rd10, [params+144];
cvta.to.global.u64 %rd1, %rd10;
ld.const.u32 %r5, [params+136];
mul.lo.s32 %r6, %r5, %r4;
add.s32 %r29, %r6, %r2;
mul.wide.u32 %rd11, %r29, 2;
add.s64 %rd12, %rd1, %rd11;
add.s64 %rd2, %rd12, 1;
ld.global.u8 %rs1, [%rd12+1];
setp.ne.s16 %p1, %rs1, 0;
@%p1 bra $L__BB0_17;
ld.global.u8 %rs2, [%rd2+-1];
cvt.rn.f32.u16 %f16, %rs2;
div.rn.f32 %f35, %f16, 0f437F0000;
add.s32 %r31, %r2, -1;
setp.eq.s32 %p2, %r2, 0;
mov.u32 %r50, 0;
selp.b32 %r7, 0, %r31, %p2;
add.s32 %r32, %r4, -1;
setp.eq.s32 %p3, %r4, 0;
selp.b32 %r33, 0, %r32, %p3;
mov.u32 %r34, %nctaid.x;
mad.lo.s32 %r35, %r34, %r1, -1;
setp.eq.s32 %p4, %r2, %r35;
add.s32 %r36, %r2, 1;
selp.b32 %r8, %r35, %r36, %p4;
mov.u32 %r37, %nctaid.y;
mad.lo.s32 %r38, %r37, %r3, -1;
setp.eq.s32 %p5, %r4, %r38;
add.s32 %r39, %r4, 1;
selp.b32 %r9, %r38, %r39, %p5;
mul.lo.s32 %r10, %r5, %r33;
add.s32 %r40, %r10, %r7;
mul.wide.u32 %rd13, %r40, 2;
add.s64 %rd14, %rd1, %rd13;
add.s64 %rd3, %rd14, 1;
ld.global.u8 %rs3, [%rd14+1];
setp.eq.s16 %p6, %rs3, 0;
@%p6 bra $L__BB0_3;
ld.global.u8 %rs4, [%rd3+-1];
cvt.rn.f32.u16 %f17, %rs4;
div.rn.f32 %f18, %f17, 0f437F0000;
add.f32 %f35, %f35, %f18;
mov.u32 %r50, 1;
$L__BB0_3:
add.s32 %r42, %r10, %r2;
mul.wide.u32 %rd15, %r42, 2;
add.s64 %rd16, %rd1, %rd15;
add.s64 %rd4, %rd16, 1;
ld.global.u8 %rs5, [%rd16+1];
setp.eq.s16 %p7, %rs5, 0;
@%p7 bra $L__BB0_5;
ld.global.u8 %rs6, [%rd4+-1];
cvt.rn.f32.u16 %f19, %rs6;
div.rn.f32 %f20, %f19, 0f437F0000;
add.f32 %f35, %f35, %f20;
add.s32 %r50, %r50, 1;
$L__BB0_5:
add.s32 %r43, %r10, %r8;
mul.wide.u32 %rd17, %r43, 2;
add.s64 %rd18, %rd1, %rd17;
add.s64 %rd5, %rd18, 1;
ld.global.u8 %rs7, [%rd18+1];
setp.eq.s16 %p8, %rs7, 0;
@%p8 bra $L__BB0_7;
ld.global.u8 %rs8, [%rd5+-1];
cvt.rn.f32.u16 %f21, %rs8;
div.rn.f32 %f22, %f21, 0f437F0000;
add.f32 %f35, %f35, %f22;
add.s32 %r50, %r50, 1;
$L__BB0_7:
add.s32 %r44, %r6, %r7;
mul.wide.u32 %rd19, %r44, 2;
add.s64 %rd20, %rd1, %rd19;
add.s64 %rd6, %rd20, 1;
ld.global.u8 %rs9, [%rd20+1];
setp.eq.s16 %p9, %rs9, 0;
@%p9 bra $L__BB0_9;
ld.global.u8 %rs10, [%rd6+-1];
cvt.rn.f32.u16 %f23, %rs10;
div.rn.f32 %f24, %f23, 0f437F0000;
add.f32 %f35, %f35, %f24;
add.s32 %r50, %r50, 1;
$L__BB0_9:
add.s32 %r45, %r6, %r8;
mul.wide.u32 %rd21, %r45, 2;
add.s64 %rd22, %rd1, %rd21;
add.s64 %rd7, %rd22, 1;
ld.global.u8 %rs11, [%rd22+1];
setp.eq.s16 %p10, %rs11, 0;
@%p10 bra $L__BB0_11;
ld.global.u8 %rs12, [%rd7+-1];
cvt.rn.f32.u16 %f25, %rs12;
div.rn.f32 %f26, %f25, 0f437F0000;
add.f32 %f35, %f35, %f26;
add.s32 %r50, %r50, 1;
$L__BB0_11:
mul.lo.s32 %r20, %r5, %r9;
add.s32 %r46, %r20, %r7;
mul.wide.u32 %rd23, %r46, 2;
add.s64 %rd24, %rd1, %rd23;
add.s64 %rd8, %rd24, 1;
ld.global.u8 %rs13, [%rd24+1];
setp.eq.s16 %p11, %rs13, 0;
@%p11 bra $L__BB0_13;
ld.global.u8 %rs14, [%rd8+-1];
cvt.rn.f32.u16 %f27, %rs14;
div.rn.f32 %f28, %f27, 0f437F0000;
add.f32 %f35, %f35, %f28;
add.s32 %r50, %r50, 1;
$L__BB0_13:
add.s32 %r47, %r20, %r8;
mul.wide.u32 %rd25, %r47, 2;
add.s64 %rd26, %rd1, %rd25;
add.s64 %rd9, %rd26, 1;
ld.global.u8 %rs15, [%rd26+1];
setp.eq.s16 %p12, %rs15, 0;
@%p12 bra $L__BB0_15;
ld.global.u8 %rs16, [%rd9+-1];
cvt.rn.f32.u16 %f29, %rs16;
div.rn.f32 %f30, %f29, 0f437F0000;
add.f32 %f35, %f35, %f30;
add.s32 %r50, %r50, 1;
$L__BB0_15:
setp.eq.s32 %p13, %r50, 0;
@%p13 bra $L__BB0_17;
cvt.rn.f32.u32 %f31, %r50;
div.rn.f32 %f32, %f35, %f31;
mul.f32 %f33, %f32, 0f437F0000;
cvt.rzi.u32.f32 %r48, %f33;
cvt.u16.u32 %rs17, %r48;
mov.u16 %rs18, 255;
st.global.v2.u8 [%rd2+-1], {%rs17, %rs18};
$L__BB0_17:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 9219c4cc72c211644b511e8e96a353e8
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,519 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __raygen__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __raygen__oxMain()
{
.reg .pred %p<34>;
.reg .b16 %rs<20>;
.reg .f32 %f<418>;
.reg .b32 %r<672>;
.reg .b64 %rd<42>;
// begin inline asm
call (%r7), _optix_get_launch_index_x, ();
// end inline asm
// begin inline asm
call (%r8), _optix_get_launch_index_y, ();
// end inline asm
ld.const.u64 %rd6, [params+416];
cvta.to.global.u64 %rd7, %rd6;
ld.const.u32 %r13, [params+408];
mad.lo.s32 %r14, %r13, %r8, %r7;
mul.wide.u32 %rd8, %r14, 4;
add.s64 %rd1, %rd7, %rd8;
ld.global.v2.u8 {%rs7, %rs19}, [%rd1];
or.b16 %rs9, %rs7, %rs19;
and.b16 %rs10, %rs9, 255;
setp.eq.s16 %p1, %rs10, 0;
@%p1 bra $L__BB0_2;
ld.global.u8 %rs18, [%rd1+2];
bra.uni $L__BB0_3;
$L__BB0_2:
ld.global.u8 %rs18, [%rd1+2];
setp.eq.s16 %p2, %rs18, 0;
mov.f32 %f396, 0f00000000;
mov.u16 %rs19, 0;
mov.f32 %f397, %f396;
mov.f32 %f398, %f396;
@%p2 bra $L__BB0_4;
$L__BB0_3:
cvt.rn.f32.u16 %f124, %rs7;
div.rn.f32 %f125, %f124, 0f437F0000;
fma.rn.f32 %f126, %f125, 0f40000000, 0fBF800000;
and.b16 %rs13, %rs19, 255;
cvt.rn.f32.u16 %f127, %rs13;
div.rn.f32 %f128, %f127, 0f437F0000;
fma.rn.f32 %f129, %f128, 0f40000000, 0fBF800000;
cvt.rn.f32.u16 %f130, %rs18;
div.rn.f32 %f131, %f130, 0f437F0000;
fma.rn.f32 %f132, %f131, 0f40000000, 0fBF800000;
mul.f32 %f133, %f129, %f129;
fma.rn.f32 %f134, %f126, %f126, %f133;
fma.rn.f32 %f135, %f132, %f132, %f134;
sqrt.rn.f32 %f136, %f135;
rcp.rn.f32 %f137, %f136;
mul.f32 %f398, %f137, %f132;
mul.f32 %f397, %f137, %f129;
mul.f32 %f396, %f126, %f137;
$L__BB0_4:
ld.const.v2.u32 {%r15, %r16}, [params];
add.s32 %r3, %r15, %r7;
add.s32 %r4, %r16, %r8;
setp.eq.f32 %p3, %f396, 0f00000000;
setp.eq.f32 %p4, %f397, 0f00000000;
and.pred %p5, %p3, %p4;
setp.eq.f32 %p6, %f398, 0f00000000;
and.pred %p7, %p6, %p5;
@%p7 bra $L__BB0_26;
bra.uni $L__BB0_5;
$L__BB0_26:
ld.const.u64 %rd37, [params+224];
cvta.to.global.u64 %rd38, %rd37;
ld.const.u32 %r669, [params+216];
mad.lo.s32 %r670, %r669, %r4, %r3;
mul.wide.u32 %rd39, %r670, 16;
add.s64 %rd40, %rd38, %rd39;
mov.f32 %f391, 0f00000000;
st.global.v4.f32 [%rd40], {%f391, %f391, %f391, %f391};
bra.uni $L__BB0_27;
$L__BB0_5:
ld.const.u64 %rd9, [params+432];
cvta.to.global.u64 %rd10, %rd9;
ld.const.u32 %r19, [params+424];
mad.lo.s32 %r20, %r19, %r8, %r7;
mul.wide.u32 %rd11, %r20, 16;
add.s64 %rd12, %rd10, %rd11;
ld.global.v4.f32 {%f138, %f139, %f140, %f141}, [%rd12];
abs.f32 %f146, %f138;
setp.le.f32 %p8, %f146, 0f7F800000;
selp.f32 %f10, %f138, 0f00000000, %p8;
abs.f32 %f147, %f139;
setp.le.f32 %p9, %f147, 0f7F800000;
selp.f32 %f11, %f139, 0f00000000, %p9;
abs.f32 %f148, %f140;
setp.le.f32 %p10, %f148, 0f7F800000;
selp.f32 %f12, %f140, 0f00000000, %p10;
add.f32 %f13, %f141, 0f38D1B717;
mov.f32 %f149, 0f38D1B717;
mul.f32 %f150, %f10, 0f3456BF95;
mul.f32 %f151, %f11, 0f3456BF95;
mul.f32 %f152, %f12, 0f3456BF95;
abs.f32 %f14, %f396;
div.rn.f32 %f153, %f150, %f14;
abs.f32 %f154, %f397;
div.rn.f32 %f155, %f151, %f154;
abs.f32 %f15, %f398;
div.rn.f32 %f156, %f152, %f15;
abs.f32 %f157, %f153;
abs.f32 %f158, %f155;
abs.f32 %f159, %f156;
max.f32 %f160, %f157, %f149;
max.f32 %f161, %f158, %f149;
max.f32 %f162, %f159, %f149;
mul.f32 %f16, %f396, %f160;
mul.f32 %f17, %f397, %f161;
mul.f32 %f18, %f398, %f162;
add.f32 %f19, %f10, %f16;
add.f32 %f20, %f11, %f17;
add.f32 %f21, %f12, %f18;
ld.const.u64 %rd13, [params+448];
cvta.to.global.u64 %rd14, %rd13;
ld.const.u32 %r21, [params+440];
mad.lo.s32 %r22, %r21, %r8, %r7;
mul.wide.u32 %rd15, %r22, 16;
add.s64 %rd16, %rd14, %rd15;
ld.global.v4.f32 {%f163, %f164, %f165, %f166}, [%rd16];
cvt.rzi.u32.f32 %r23, %f166;
ld.const.u64 %rd17, [params+712];
cvta.to.global.u64 %rd18, %rd17;
cvt.u64.u32 %rd19, %r23;
add.s64 %rd2, %rd18, %rd19;
ld.global.u8 %r671, [%rd2];
sub.f32 %f25, %f163, %f10;
sub.f32 %f26, %f164, %f11;
sub.f32 %f27, %f165, %f12;
mul.f32 %f168, %f26, %f26;
fma.rn.f32 %f169, %f25, %f25, %f168;
fma.rn.f32 %f170, %f27, %f27, %f169;
sqrt.rn.f32 %f28, %f170;
setp.ne.s32 %p11, %r671, 255;
setp.gt.f32 %p12, %f28, 0f3727C5AC;
and.pred %p13, %p11, %p12;
@%p13 bra $L__BB0_7;
bra.uni $L__BB0_6;
$L__BB0_7:
rcp.rn.f32 %f180, %f28;
mul.f32 %f174, %f25, %f180;
mul.f32 %f175, %f26, %f180;
mul.f32 %f176, %f27, %f180;
ld.const.u64 %rd41, [params+96];
mov.f32 %f179, 0f00000000;
mov.u32 %r60, 2;
mov.u32 %r62, 1;
mov.u32 %r63, 1065353216;
mov.u32 %r94, 0;
// begin inline asm
call(%r24,%r25,%r26,%r27,%r28,%r29,%r30,%r31,%r32,%r33,%r34,%r35,%r36,%r37,%r38,%r39,%r40,%r41,%r42,%r43,%r44,%r45,%r46,%r47,%r48,%r49,%r50,%r51,%r52,%r53,%r54,%r55),_optix_trace_typed_32,(%r94,%rd41,%f19,%f20,%f21,%f174,%f175,%f176,%f149,%f28,%f179,%r62,%r94,%r62,%r60,%r62,%r62,%r63,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94,%r94);
// end inline asm
mov.b32 %f181, %r24;
setp.neu.f32 %p14, %f181, 0f00000000;
@%p14 bra $L__BB0_9;
mov.u16 %rs15, 255;
st.global.u8 [%rd2], %rs15;
mov.u32 %r671, 255;
bra.uni $L__BB0_9;
$L__BB0_6:
ld.const.u64 %rd41, [params+96];
$L__BB0_9:
setp.eq.s32 %p15, %r671, 0;
mov.u32 %r166, 0;
selp.f32 %f404, %f163, %f10, %p15;
add.f32 %f182, %f16, %f404;
selp.f32 %f405, %f164, %f11, %p15;
add.f32 %f183, %f17, %f405;
selp.f32 %f406, %f165, %f12, %p15;
add.f32 %f184, %f18, %f406;
neg.f32 %f192, %f397;
setp.gt.f32 %p16, %f14, %f15;
selp.f32 %f193, %f192, 0f00000000, %p16;
mov.f32 %f190, 0f00000000;
neg.f32 %f194, %f398;
selp.f32 %f195, %f396, %f194, %p16;
selp.f32 %f196, 0f00000000, %f397, %p16;
mul.f32 %f197, %f195, %f195;
fma.rn.f32 %f198, %f193, %f193, %f197;
fma.rn.f32 %f199, %f196, %f196, %f198;
sqrt.rn.f32 %f200, %f199;
rcp.rn.f32 %f201, %f200;
mul.f32 %f32, %f193, %f201;
mul.f32 %f33, %f195, %f201;
mul.f32 %f34, %f196, %f201;
mul.f32 %f202, %f398, %f33;
mul.f32 %f203, %f397, %f34;
sub.f32 %f35, %f202, %f203;
mul.f32 %f204, %f396, %f34;
mul.f32 %f205, %f398, %f32;
sub.f32 %f36, %f204, %f205;
mul.f32 %f206, %f397, %f32;
mul.f32 %f207, %f396, %f33;
sub.f32 %f37, %f206, %f207;
mov.f32 %f208, 0f3F8147AE;
sqrt.rn.f32 %f209, %f208;
rcp.rn.f32 %f38, %f209;
mul.f32 %f40, %f38, 0f00000000;
mul.f32 %f210, %f38, 0f3DCCCCCD;
mul.f32 %f211, %f182, 0f3456BF95;
mul.f32 %f212, %f183, 0f3456BF95;
mul.f32 %f213, %f184, 0f3456BF95;
abs.f32 %f214, %f211;
abs.f32 %f215, %f212;
abs.f32 %f216, %f213;
max.f32 %f217, %f214, %f215;
max.f32 %f218, %f217, %f216;
mov.f32 %f219, 0f38D1B717;
max.f32 %f41, %f218, %f219;
mul.f32 %f220, %f35, %f38;
mul.f32 %f221, %f36, %f38;
mul.f32 %f222, %f37, %f38;
mul.f32 %f45, %f32, %f40;
mul.f32 %f46, %f33, %f40;
mul.f32 %f47, %f34, %f40;
sub.f32 %f223, %f45, %f220;
sub.f32 %f224, %f46, %f221;
sub.f32 %f225, %f47, %f222;
mul.f32 %f48, %f396, %f210;
mul.f32 %f49, %f397, %f210;
mul.f32 %f50, %f398, %f210;
add.f32 %f185, %f223, %f48;
add.f32 %f186, %f224, %f49;
add.f32 %f187, %f225, %f50;
mul.f32 %f189, %f13, 0f3FB504F3;
mov.u32 %r129, 1;
mov.u32 %r132, 2;
mov.u32 %r134, 3;
// begin inline asm
call(%r96,%r97,%r98,%r99,%r100,%r101,%r102,%r103,%r104,%r105,%r106,%r107,%r108,%r109,%r110,%r111,%r112,%r113,%r114,%r115,%r116,%r117,%r118,%r119,%r120,%r121,%r122,%r123,%r124,%r125,%r126,%r127),_optix_trace_typed_32,(%r166,%rd41,%f182,%f183,%f184,%f185,%f186,%f187,%f190,%f189,%f190,%r129,%r166,%r166,%r132,%r166,%r134,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166);
// end inline asm
mov.b32 %f55, %r96;
mov.b32 %f56, %r97;
mov.b32 %f57, %r98;
add.f32 %f226, %f55, %f56;
add.f32 %f227, %f226, %f57;
setp.eq.f32 %p17, %f227, 0f00000000;
mov.f32 %f403, 0f47C34F80;
@%p17 bra $L__BB0_11;
mul.f32 %f228, %f56, %f56;
fma.rn.f32 %f229, %f55, %f55, %f228;
fma.rn.f32 %f230, %f57, %f57, %f229;
sqrt.rn.f32 %f231, %f230;
rcp.rn.f32 %f232, %f231;
mul.f32 %f233, %f232, %f55;
mul.f32 %f234, %f232, %f56;
mul.f32 %f235, %f232, %f57;
fma.rn.f32 %f236, %f41, %f233, %f182;
fma.rn.f32 %f237, %f41, %f234, %f183;
fma.rn.f32 %f238, %f41, %f235, %f184;
setp.lt.f32 %p18, %f231, 0f47C34F80;
fma.rn.f32 %f239, %f231, %f185, %f236;
fma.rn.f32 %f240, %f231, %f186, %f237;
fma.rn.f32 %f241, %f231, %f187, %f238;
min.f32 %f403, %f231, 0f47C34F80;
selp.f32 %f406, %f241, %f406, %p18;
selp.f32 %f405, %f240, %f405, %p18;
selp.f32 %f404, %f239, %f404, %p18;
$L__BB0_11:
fma.rn.f32 %f251, %f35, %f38, %f45;
fma.rn.f32 %f252, %f36, %f38, %f46;
fma.rn.f32 %f253, %f37, %f38, %f47;
add.f32 %f245, %f251, %f48;
add.f32 %f246, %f252, %f49;
add.f32 %f247, %f253, %f50;
// begin inline asm
call(%r167,%r168,%r169,%r170,%r171,%r172,%r173,%r174,%r175,%r176,%r177,%r178,%r179,%r180,%r181,%r182,%r183,%r184,%r185,%r186,%r187,%r188,%r189,%r190,%r191,%r192,%r193,%r194,%r195,%r196,%r197,%r198),_optix_trace_typed_32,(%r166,%rd41,%f182,%f183,%f184,%f245,%f246,%f247,%f190,%f189,%f190,%r129,%r166,%r166,%r132,%r166,%r134,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166,%r166);
// end inline asm
mov.b32 %f69, %r167;
mov.b32 %f70, %r168;
mov.b32 %f71, %r169;
add.f32 %f254, %f69, %f70;
add.f32 %f255, %f254, %f71;
setp.eq.f32 %p19, %f255, 0f00000000;
@%p19 bra $L__BB0_13;
mul.f32 %f256, %f70, %f70;
fma.rn.f32 %f257, %f69, %f69, %f256;
fma.rn.f32 %f258, %f71, %f71, %f257;
sqrt.rn.f32 %f259, %f258;
rcp.rn.f32 %f260, %f259;
mul.f32 %f261, %f260, %f69;
mul.f32 %f262, %f260, %f70;
mul.f32 %f263, %f260, %f71;
fma.rn.f32 %f264, %f41, %f261, %f182;
fma.rn.f32 %f265, %f41, %f262, %f183;
fma.rn.f32 %f266, %f41, %f263, %f184;
setp.lt.f32 %p20, %f259, %f403;
fma.rn.f32 %f267, %f259, %f245, %f264;
fma.rn.f32 %f268, %f259, %f246, %f265;
fma.rn.f32 %f269, %f259, %f247, %f266;
selp.f32 %f403, %f259, %f403, %p20;
selp.f32 %f406, %f269, %f406, %p20;
selp.f32 %f405, %f268, %f405, %p20;
selp.f32 %f404, %f267, %f404, %p20;
$L__BB0_13:
neg.f32 %f394, %f38;
mul.f32 %f393, %f38, 0f00000000;
mul.f32 %f80, %f35, %f393;
fma.rn.f32 %f279, %f32, %f394, %f80;
mul.f32 %f81, %f36, %f393;
fma.rn.f32 %f280, %f33, %f394, %f81;
mul.f32 %f82, %f37, %f393;
fma.rn.f32 %f281, %f34, %f394, %f82;
add.f32 %f273, %f279, %f48;
add.f32 %f274, %f280, %f49;
add.f32 %f275, %f281, %f50;
mov.f32 %f278, 0f00000000;
mov.u32 %r271, 1;
mov.u32 %r274, 2;
mov.u32 %r276, 3;
mov.u32 %r308, 0;
// begin inline asm
call(%r238,%r239,%r240,%r241,%r242,%r243,%r244,%r245,%r246,%r247,%r248,%r249,%r250,%r251,%r252,%r253,%r254,%r255,%r256,%r257,%r258,%r259,%r260,%r261,%r262,%r263,%r264,%r265,%r266,%r267,%r268,%r269),_optix_trace_typed_32,(%r308,%rd41,%f182,%f183,%f184,%f273,%f274,%f275,%f278,%f189,%f278,%r271,%r308,%r308,%r274,%r308,%r276,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308);
// end inline asm
mov.b32 %f86, %r238;
mov.b32 %f87, %r239;
mov.b32 %f88, %r240;
add.f32 %f282, %f86, %f87;
add.f32 %f283, %f282, %f88;
setp.eq.f32 %p21, %f283, 0f00000000;
@%p21 bra $L__BB0_15;
mul.f32 %f284, %f87, %f87;
fma.rn.f32 %f285, %f86, %f86, %f284;
fma.rn.f32 %f286, %f88, %f88, %f285;
sqrt.rn.f32 %f287, %f286;
rcp.rn.f32 %f288, %f287;
mul.f32 %f289, %f288, %f86;
mul.f32 %f290, %f288, %f87;
mul.f32 %f291, %f288, %f88;
fma.rn.f32 %f292, %f41, %f289, %f182;
fma.rn.f32 %f293, %f41, %f290, %f183;
fma.rn.f32 %f294, %f41, %f291, %f184;
setp.lt.f32 %p22, %f287, %f403;
fma.rn.f32 %f295, %f287, %f273, %f292;
fma.rn.f32 %f296, %f287, %f274, %f293;
fma.rn.f32 %f297, %f287, %f275, %f294;
selp.f32 %f403, %f287, %f403, %p22;
selp.f32 %f406, %f297, %f406, %p22;
selp.f32 %f405, %f296, %f405, %p22;
selp.f32 %f404, %f295, %f404, %p22;
$L__BB0_15:
fma.rn.f32 %f307, %f32, %f38, %f80;
fma.rn.f32 %f308, %f33, %f38, %f81;
fma.rn.f32 %f309, %f34, %f38, %f82;
add.f32 %f301, %f307, %f48;
add.f32 %f302, %f308, %f49;
add.f32 %f303, %f309, %f50;
// begin inline asm
call(%r309,%r310,%r311,%r312,%r313,%r314,%r315,%r316,%r317,%r318,%r319,%r320,%r321,%r322,%r323,%r324,%r325,%r326,%r327,%r328,%r329,%r330,%r331,%r332,%r333,%r334,%r335,%r336,%r337,%r338,%r339,%r340),_optix_trace_typed_32,(%r308,%rd41,%f182,%f183,%f184,%f301,%f302,%f303,%f278,%f189,%f278,%r271,%r308,%r308,%r274,%r308,%r276,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308,%r308);
// end inline asm
mov.b32 %f100, %r309;
mov.b32 %f101, %r310;
mov.b32 %f102, %r311;
add.f32 %f310, %f100, %f101;
add.f32 %f311, %f310, %f102;
setp.eq.f32 %p23, %f311, 0f00000000;
@%p23 bra $L__BB0_17;
mul.f32 %f312, %f101, %f101;
fma.rn.f32 %f313, %f100, %f100, %f312;
fma.rn.f32 %f314, %f102, %f102, %f313;
sqrt.rn.f32 %f315, %f314;
rcp.rn.f32 %f316, %f315;
mul.f32 %f317, %f316, %f100;
mul.f32 %f318, %f316, %f101;
mul.f32 %f319, %f316, %f102;
fma.rn.f32 %f320, %f41, %f317, %f182;
fma.rn.f32 %f321, %f41, %f318, %f183;
fma.rn.f32 %f322, %f41, %f319, %f184;
setp.lt.f32 %p24, %f315, %f403;
fma.rn.f32 %f323, %f315, %f301, %f320;
fma.rn.f32 %f324, %f315, %f302, %f321;
fma.rn.f32 %f325, %f315, %f303, %f322;
selp.f32 %f406, %f325, %f406, %p24;
selp.f32 %f405, %f324, %f405, %p24;
selp.f32 %f404, %f323, %f404, %p24;
$L__BB0_17:
abs.f32 %f326, %f404;
setp.le.f32 %p25, %f326, 0f7F800000;
selp.f32 %f414, %f404, 0f00000000, %p25;
abs.f32 %f327, %f405;
setp.le.f32 %p26, %f327, 0f7F800000;
selp.f32 %f415, %f405, 0f00000000, %p26;
abs.f32 %f328, %f406;
setp.le.f32 %p27, %f328, 0f7F800000;
selp.f32 %f416, %f406, 0f00000000, %p27;
ld.const.f32 %f112, [params+720];
setp.eq.f32 %p28, %f112, 0f00000000;
@%p28 bra $L__BB0_19;
fma.rn.f32 %f414, %f396, %f112, %f414;
fma.rn.f32 %f415, %f397, %f112, %f415;
fma.rn.f32 %f416, %f398, %f112, %f416;
$L__BB0_19:
ld.const.u64 %rd25, [params+224];
cvta.to.global.u64 %rd26, %rd25;
ld.const.u32 %r380, [params+216];
mad.lo.s32 %r381, %r380, %r4, %r3;
mul.wide.u32 %rd27, %r381, 16;
add.s64 %rd28, %rd26, %rd27;
mov.f32 %f329, 0f3F800000;
st.global.v4.f32 [%rd28], {%f414, %f415, %f416, %f329};
ld.const.u8 %rs16, [params+104];
and.b16 %rs17, %rs16, 32;
setp.eq.s16 %p29, %rs17, 0;
mov.f32 %f417, 0f437F0000;
@%p29 bra $L__BB0_27;
add.f32 %f395, %f141, 0f38D1B717;
mul.f32 %f337, %f395, 0f41000000;
mov.f32 %f336, 0f38D1B717;
mov.f32 %f338, 0f00000000;
mov.u32 %r415, 1;
mov.u32 %r418, 2;
mov.u32 %r420, 3;
mov.u32 %r452, 0;
// begin inline asm
call(%r382,%r383,%r384,%r385,%r386,%r387,%r388,%r389,%r390,%r391,%r392,%r393,%r394,%r395,%r396,%r397,%r398,%r399,%r400,%r401,%r402,%r403,%r404,%r405,%r406,%r407,%r408,%r409,%r410,%r411,%r412,%r413),_optix_trace_typed_32,(%r452,%rd41,%f182,%f183,%f184,%f185,%f186,%f187,%f336,%f337,%f338,%r415,%r452,%r452,%r418,%r452,%r420,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452);
// end inline asm
mov.b32 %f340, %r382;
mov.b32 %f341, %r383;
mov.b32 %f342, %r384;
add.f32 %f343, %f340, %f341;
add.f32 %f344, %f343, %f342;
setp.neu.f32 %p30, %f344, 0f00000000;
@%p30 bra $L__BB0_25;
// begin inline asm
call(%r453,%r454,%r455,%r456,%r457,%r458,%r459,%r460,%r461,%r462,%r463,%r464,%r465,%r466,%r467,%r468,%r469,%r470,%r471,%r472,%r473,%r474,%r475,%r476,%r477,%r478,%r479,%r480,%r481,%r482,%r483,%r484),_optix_trace_typed_32,(%r452,%rd41,%f182,%f183,%f184,%f245,%f246,%f247,%f336,%f337,%f338,%r415,%r452,%r452,%r418,%r452,%r420,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452,%r452);
// end inline asm
mov.b32 %f355, %r453;
mov.b32 %f356, %r454;
mov.b32 %f357, %r455;
add.f32 %f358, %f355, %f356;
add.f32 %f359, %f358, %f357;
setp.neu.f32 %p31, %f359, 0f00000000;
@%p31 bra $L__BB0_25;
mov.f32 %f366, 0f38D1B717;
mov.f32 %f368, 0f00000000;
mov.u32 %r557, 1;
mov.u32 %r560, 2;
mov.u32 %r562, 3;
mov.u32 %r594, 0;
// begin inline asm
call(%r524,%r525,%r526,%r527,%r528,%r529,%r530,%r531,%r532,%r533,%r534,%r535,%r536,%r537,%r538,%r539,%r540,%r541,%r542,%r543,%r544,%r545,%r546,%r547,%r548,%r549,%r550,%r551,%r552,%r553,%r554,%r555),_optix_trace_typed_32,(%r594,%rd41,%f182,%f183,%f184,%f273,%f274,%f275,%f366,%f337,%f368,%r557,%r594,%r594,%r560,%r594,%r562,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594);
// end inline asm
mov.b32 %f370, %r524;
mov.b32 %f371, %r525;
mov.b32 %f372, %r526;
add.f32 %f373, %f370, %f371;
add.f32 %f374, %f373, %f372;
setp.neu.f32 %p32, %f374, 0f00000000;
@%p32 bra $L__BB0_25;
// begin inline asm
call(%r595,%r596,%r597,%r598,%r599,%r600,%r601,%r602,%r603,%r604,%r605,%r606,%r607,%r608,%r609,%r610,%r611,%r612,%r613,%r614,%r615,%r616,%r617,%r618,%r619,%r620,%r621,%r622,%r623,%r624,%r625,%r626),_optix_trace_typed_32,(%r594,%rd41,%f182,%f183,%f184,%f301,%f302,%f303,%f366,%f337,%f368,%r557,%r594,%r594,%r560,%r594,%r562,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594,%r594);
// end inline asm
mov.b32 %f385, %r595;
mov.b32 %f386, %r596;
mov.b32 %f387, %r597;
add.f32 %f388, %f385, %f386;
add.f32 %f389, %f388, %f387;
setp.neu.f32 %p33, %f389, 0f00000000;
@%p33 bra $L__BB0_25;
mov.f32 %f417, 0f00000000;
$L__BB0_25:
ld.const.u64 %rd33, [params+192];
cvta.to.global.u64 %rd34, %rd33;
ld.const.u32 %r666, [params+184];
mad.lo.s32 %r667, %r666, %r4, %r3;
cvt.u64.u32 %rd35, %r667;
cvt.rzi.u32.f32 %r668, %f417;
add.s64 %rd36, %rd34, %rd35;
st.global.u8 [%rd36], %r668;
$L__BB0_27:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: ecbd0cfacea1a7b47bc4b4de26f15c02
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: fbc3585b39fcd3746a69f2ade83e5016
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,261 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<19>;
.reg .b16 %rs<9>;
.reg .f32 %f<128>;
.reg .b32 %r<26>;
.reg .b64 %rd<2>;
// begin inline asm
call (%r1), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f21, %f22), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r3, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r3);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r1;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f21, %f22};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f4, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
// begin inline asm
call (%f23), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f24), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f25), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f27, %f2, %f24;
fma.rn.f32 %f28, %f1, %f23, %f27;
fma.rn.f32 %f29, %f3, %f25, %f28;
setp.gt.f32 %p2, %f29, 0f00000000;
// begin inline asm
call (%f26), _optix_get_ray_tmax, ();
// end inline asm
mov.u32 %r4, -1082130432;
// begin inline asm
call _optix_set_payload, (%r3, %r4);
// end inline asm
@%p2 bra $L__BB0_15;
div.rn.f32 %f30, %f4, 0f41200000;
mov.b32 %r5, %f30;
and.b32 %r6, %r5, -2147483648;
or.b32 %r7, %r6, 1056964608;
mov.b32 %f31, %r7;
add.rz.f32 %f32, %f30, %f31;
cvt.rzi.f32.f32 %f33, %f32;
cvt.rzi.s32.f32 %r8, %f33;
ld.const.u32 %r9, [params+664];
setp.ne.s32 %p3, %r8, %r9;
@%p3 bra $L__BB0_15;
ld.const.f32 %f35, [params+660];
mul.f32 %f8, %f26, %f35;
mov.f32 %f36, 0f40000000;
cvt.rzi.f32.f32 %f37, %f36;
add.f32 %f38, %f37, %f37;
mov.f32 %f39, 0f40800000;
sub.f32 %f40, %f39, %f38;
abs.f32 %f9, %f40;
abs.f32 %f10, %f8;
setp.lt.f32 %p4, %f10, 0f00800000;
mul.f32 %f41, %f10, 0f4B800000;
selp.f32 %f42, %f41, %f10, %p4;
selp.f32 %f43, 0fC3170000, 0fC2FE0000, %p4;
mov.b32 %r10, %f42;
and.b32 %r11, %r10, 8388607;
or.b32 %r12, %r11, 1065353216;
mov.b32 %f44, %r12;
shr.u32 %r13, %r10, 23;
cvt.rn.f32.u32 %f45, %r13;
add.f32 %f46, %f43, %f45;
setp.gt.f32 %p5, %f44, 0f3FB504F3;
mul.f32 %f47, %f44, 0f3F000000;
add.f32 %f48, %f46, 0f3F800000;
selp.f32 %f49, %f48, %f46, %p5;
selp.f32 %f50, %f47, %f44, %p5;
add.f32 %f51, %f50, 0fBF800000;
add.f32 %f52, %f50, 0f3F800000;
rcp.approx.ftz.f32 %f53, %f52;
add.f32 %f54, %f51, %f51;
mul.f32 %f55, %f54, %f53;
mul.f32 %f56, %f55, %f55;
mov.f32 %f57, 0f3C4CAF63;
mov.f32 %f58, 0f3B18F0FE;
fma.rn.f32 %f59, %f58, %f56, %f57;
mov.f32 %f60, 0f3DAAAABD;
fma.rn.f32 %f61, %f59, %f56, %f60;
mul.rn.f32 %f62, %f61, %f56;
mul.rn.f32 %f63, %f62, %f55;
sub.f32 %f64, %f51, %f55;
add.f32 %f65, %f64, %f64;
neg.f32 %f66, %f55;
fma.rn.f32 %f67, %f66, %f51, %f65;
mul.rn.f32 %f68, %f53, %f67;
add.f32 %f69, %f63, %f55;
sub.f32 %f70, %f55, %f69;
add.f32 %f71, %f63, %f70;
add.f32 %f72, %f68, %f71;
add.f32 %f73, %f69, %f72;
sub.f32 %f74, %f69, %f73;
add.f32 %f75, %f72, %f74;
mov.f32 %f76, 0f3F317200;
mul.rn.f32 %f77, %f49, %f76;
mov.f32 %f78, 0f35BFBE8E;
mul.rn.f32 %f79, %f49, %f78;
add.f32 %f80, %f77, %f73;
sub.f32 %f81, %f77, %f80;
add.f32 %f82, %f73, %f81;
add.f32 %f83, %f75, %f82;
add.f32 %f84, %f79, %f83;
add.f32 %f85, %f80, %f84;
sub.f32 %f86, %f80, %f85;
add.f32 %f87, %f84, %f86;
mul.rn.f32 %f88, %f39, %f85;
neg.f32 %f89, %f88;
fma.rn.f32 %f90, %f39, %f85, %f89;
fma.rn.f32 %f91, %f39, %f87, %f90;
mov.f32 %f92, 0f00000000;
fma.rn.f32 %f93, %f92, %f85, %f91;
add.rn.f32 %f94, %f88, %f93;
neg.f32 %f95, %f94;
add.rn.f32 %f96, %f88, %f95;
add.rn.f32 %f97, %f96, %f93;
mov.b32 %r14, %f94;
setp.eq.s32 %p6, %r14, 1118925336;
add.s32 %r15, %r14, -1;
mov.b32 %f98, %r15;
add.f32 %f99, %f97, 0f37000000;
selp.f32 %f11, %f99, %f97, %p6;
selp.f32 %f100, %f98, %f94, %p6;
mov.f32 %f101, 0f3FB8AA3B;
mul.rn.f32 %f102, %f100, %f101;
cvt.rzi.f32.f32 %f103, %f102;
abs.f32 %f104, %f103;
setp.gt.f32 %p7, %f104, 0f42FC0000;
mov.b32 %r16, %f103;
and.b32 %r17, %r16, -2147483648;
or.b32 %r18, %r17, 1123811328;
mov.b32 %f105, %r18;
selp.f32 %f106, %f105, %f103, %p7;
mov.f32 %f107, 0fBF317218;
fma.rn.f32 %f108, %f106, %f107, %f100;
mov.f32 %f109, 0f3102E308;
fma.rn.f32 %f110, %f106, %f109, %f108;
mul.f32 %f111, %f110, 0f3FB8AA3B;
add.f32 %f112, %f106, 0f4B40007F;
mov.b32 %r19, %f112;
shl.b32 %r20, %r19, 23;
mov.b32 %f113, %r20;
ex2.approx.ftz.f32 %f114, %f111;
mul.f32 %f12, %f114, %f113;
setp.eq.f32 %p8, %f12, 0f7F800000;
mov.f32 %f125, 0f7F800000;
@%p8 bra $L__BB0_4;
fma.rn.f32 %f125, %f12, %f11, %f12;
$L__BB0_4:
setp.lt.f32 %p9, %f8, 0f00000000;
setp.eq.f32 %p10, %f9, 0f3F800000;
and.pred %p1, %p9, %p10;
setp.eq.f32 %p11, %f8, 0f00000000;
@%p11 bra $L__BB0_8;
bra.uni $L__BB0_5;
$L__BB0_8:
add.f32 %f119, %f8, %f8;
selp.f32 %f127, %f119, 0f00000000, %p10;
bra.uni $L__BB0_9;
$L__BB0_5:
mov.b32 %r21, %f125;
xor.b32 %r22, %r21, -2147483648;
mov.b32 %f115, %r22;
selp.f32 %f127, %f115, %f125, %p1;
setp.geu.f32 %p12, %f8, 0f00000000;
@%p12 bra $L__BB0_9;
mov.f32 %f116, 0f40800000;
cvt.rzi.f32.f32 %f117, %f116;
setp.eq.f32 %p13, %f117, 0f40800000;
@%p13 bra $L__BB0_9;
mov.f32 %f127, 0f7FFFFFFF;
$L__BB0_9:
add.f32 %f120, %f10, 0f40800000;
mov.b32 %r23, %f120;
setp.lt.s32 %p15, %r23, 2139095040;
@%p15 bra $L__BB0_14;
setp.gtu.f32 %p16, %f10, 0f7F800000;
@%p16 bra $L__BB0_13;
bra.uni $L__BB0_11;
$L__BB0_13:
add.f32 %f127, %f8, 0f40800000;
bra.uni $L__BB0_14;
$L__BB0_11:
setp.neu.f32 %p17, %f10, 0f7F800000;
@%p17 bra $L__BB0_14;
selp.f32 %f127, 0fFF800000, 0f7F800000, %p1;
$L__BB0_14:
mov.f32 %f121, 0f3F800000;
sub.f32 %f122, %f121, %f127;
setp.eq.f32 %p18, %f8, 0f3F800000;
selp.f32 %f123, 0f00000000, %f122, %p18;
cvt.sat.f32.f32 %f124, %f123;
mov.b32 %r25, %f124;
mov.u32 %r24, 0;
// begin inline asm
call _optix_set_payload, (%r24, %r25);
// end inline asm
$L__BB0_15:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 62c9a0b6c1543dc4c95b863a7172ff96
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,312 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<20>;
.reg .b16 %rs<9>;
.reg .f32 %f<139>;
.reg .b32 %r<50>;
.reg .b64 %rd<2>;
// begin inline asm
call (%r5), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f21, %f22), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r20, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r20);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r5;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f21, %f22};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f4, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
mov.u32 %r17, 1;
// begin inline asm
call (%f23), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f24), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f25), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f27, %f2, %f24;
fma.rn.f32 %f28, %f1, %f23, %f27;
fma.rn.f32 %f29, %f3, %f25, %f28;
setp.gt.f32 %p2, %f29, 0f00000000;
// begin inline asm
call (%f26), _optix_get_ray_tmax, ();
// end inline asm
// begin inline asm
call (%r7), _optix_get_payload, (%r20);
// end inline asm
// begin inline asm
call (%r9), _optix_get_payload, (%r17);
// end inline asm
mov.u32 %r19, 2;
// begin inline asm
call (%r11), _optix_get_payload, (%r19);
// end inline asm
mov.u32 %r21, 3;
// begin inline asm
call (%r13), _optix_get_payload, (%r21);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r20, %r20);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r17, %r20);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r19, %r20);
// end inline asm
mov.u32 %r22, 2139095039;
// begin inline asm
call _optix_set_payload, (%r21, %r22);
// end inline asm
@%p2 bra $L__BB0_15;
div.rn.f32 %f30, %f4, 0f41200000;
mov.b32 %r23, %f30;
and.b32 %r24, %r23, -2147483648;
or.b32 %r25, %r24, 1056964608;
mov.b32 %f31, %r25;
add.rz.f32 %f32, %f30, %f31;
cvt.rzi.f32.f32 %f33, %f32;
cvt.rzi.s32.f32 %r26, %f33;
ld.const.u32 %r27, [params+664];
setp.ne.s32 %p3, %r26, %r27;
@%p3 bra $L__BB0_15;
ld.const.f32 %f35, [params+660];
mul.f32 %f8, %f26, %f35;
mov.f32 %f36, 0f40000000;
cvt.rzi.f32.f32 %f37, %f36;
add.f32 %f38, %f37, %f37;
mov.f32 %f39, 0f40800000;
sub.f32 %f40, %f39, %f38;
abs.f32 %f9, %f40;
abs.f32 %f10, %f8;
setp.lt.f32 %p4, %f10, 0f00800000;
mul.f32 %f41, %f10, 0f4B800000;
selp.f32 %f42, %f41, %f10, %p4;
selp.f32 %f43, 0fC3170000, 0fC2FE0000, %p4;
mov.b32 %r28, %f42;
and.b32 %r29, %r28, 8388607;
or.b32 %r30, %r29, 1065353216;
mov.b32 %f44, %r30;
shr.u32 %r31, %r28, 23;
cvt.rn.f32.u32 %f45, %r31;
add.f32 %f46, %f43, %f45;
setp.gt.f32 %p5, %f44, 0f3FB504F3;
mul.f32 %f47, %f44, 0f3F000000;
add.f32 %f48, %f46, 0f3F800000;
selp.f32 %f49, %f48, %f46, %p5;
selp.f32 %f50, %f47, %f44, %p5;
add.f32 %f51, %f50, 0fBF800000;
add.f32 %f52, %f50, 0f3F800000;
rcp.approx.ftz.f32 %f53, %f52;
add.f32 %f54, %f51, %f51;
mul.f32 %f55, %f54, %f53;
mul.f32 %f56, %f55, %f55;
mov.f32 %f57, 0f3C4CAF63;
mov.f32 %f58, 0f3B18F0FE;
fma.rn.f32 %f59, %f58, %f56, %f57;
mov.f32 %f60, 0f3DAAAABD;
fma.rn.f32 %f61, %f59, %f56, %f60;
mul.rn.f32 %f62, %f61, %f56;
mul.rn.f32 %f63, %f62, %f55;
sub.f32 %f64, %f51, %f55;
add.f32 %f65, %f64, %f64;
neg.f32 %f66, %f55;
fma.rn.f32 %f67, %f66, %f51, %f65;
mul.rn.f32 %f68, %f53, %f67;
add.f32 %f69, %f63, %f55;
sub.f32 %f70, %f55, %f69;
add.f32 %f71, %f63, %f70;
add.f32 %f72, %f68, %f71;
add.f32 %f73, %f69, %f72;
sub.f32 %f74, %f69, %f73;
add.f32 %f75, %f72, %f74;
mov.f32 %f76, 0f3F317200;
mul.rn.f32 %f77, %f49, %f76;
mov.f32 %f78, 0f35BFBE8E;
mul.rn.f32 %f79, %f49, %f78;
add.f32 %f80, %f77, %f73;
sub.f32 %f81, %f77, %f80;
add.f32 %f82, %f73, %f81;
add.f32 %f83, %f75, %f82;
add.f32 %f84, %f79, %f83;
add.f32 %f85, %f80, %f84;
sub.f32 %f86, %f80, %f85;
add.f32 %f87, %f84, %f86;
mul.rn.f32 %f88, %f39, %f85;
neg.f32 %f89, %f88;
fma.rn.f32 %f90, %f39, %f85, %f89;
fma.rn.f32 %f91, %f39, %f87, %f90;
mov.f32 %f92, 0f00000000;
fma.rn.f32 %f93, %f92, %f85, %f91;
add.rn.f32 %f94, %f88, %f93;
neg.f32 %f95, %f94;
add.rn.f32 %f96, %f88, %f95;
add.rn.f32 %f97, %f96, %f93;
mov.b32 %r32, %f94;
setp.eq.s32 %p6, %r32, 1118925336;
add.s32 %r33, %r32, -1;
mov.b32 %f98, %r33;
add.f32 %f99, %f97, 0f37000000;
selp.f32 %f11, %f99, %f97, %p6;
selp.f32 %f100, %f98, %f94, %p6;
mov.f32 %f101, 0f3FB8AA3B;
mul.rn.f32 %f102, %f100, %f101;
cvt.rzi.f32.f32 %f103, %f102;
abs.f32 %f104, %f103;
setp.gt.f32 %p7, %f104, 0f42FC0000;
mov.b32 %r34, %f103;
and.b32 %r35, %r34, -2147483648;
or.b32 %r36, %r35, 1123811328;
mov.b32 %f105, %r36;
selp.f32 %f106, %f105, %f103, %p7;
mov.f32 %f107, 0fBF317218;
fma.rn.f32 %f108, %f106, %f107, %f100;
mov.f32 %f109, 0f3102E308;
fma.rn.f32 %f110, %f106, %f109, %f108;
mul.f32 %f111, %f110, 0f3FB8AA3B;
add.f32 %f112, %f106, 0f4B40007F;
mov.b32 %r37, %f112;
shl.b32 %r38, %r37, 23;
mov.b32 %f113, %r38;
ex2.approx.ftz.f32 %f114, %f111;
mul.f32 %f12, %f114, %f113;
setp.eq.f32 %p8, %f12, 0f7F800000;
mov.f32 %f136, 0f7F800000;
@%p8 bra $L__BB0_4;
fma.rn.f32 %f136, %f12, %f11, %f12;
$L__BB0_4:
setp.lt.f32 %p9, %f8, 0f00000000;
setp.eq.f32 %p10, %f9, 0f3F800000;
and.pred %p1, %p9, %p10;
setp.eq.f32 %p11, %f8, 0f00000000;
@%p11 bra $L__BB0_8;
bra.uni $L__BB0_5;
$L__BB0_8:
add.f32 %f119, %f8, %f8;
selp.f32 %f138, %f119, 0f00000000, %p10;
bra.uni $L__BB0_9;
$L__BB0_5:
mov.b32 %r39, %f136;
xor.b32 %r40, %r39, -2147483648;
mov.b32 %f115, %r40;
selp.f32 %f138, %f115, %f136, %p1;
setp.geu.f32 %p12, %f8, 0f00000000;
@%p12 bra $L__BB0_9;
mov.f32 %f116, 0f40800000;
cvt.rzi.f32.f32 %f117, %f116;
setp.eq.f32 %p13, %f117, 0f40800000;
@%p13 bra $L__BB0_9;
mov.f32 %f138, 0f7FFFFFFF;
$L__BB0_9:
add.f32 %f120, %f10, 0f40800000;
mov.b32 %r41, %f120;
setp.lt.s32 %p15, %r41, 2139095040;
@%p15 bra $L__BB0_14;
setp.gtu.f32 %p16, %f10, 0f7F800000;
@%p16 bra $L__BB0_13;
bra.uni $L__BB0_11;
$L__BB0_13:
add.f32 %f138, %f8, 0f40800000;
bra.uni $L__BB0_14;
$L__BB0_11:
setp.neu.f32 %p17, %f10, 0f7F800000;
@%p17 bra $L__BB0_14;
selp.f32 %f138, 0fFF800000, 0f7F800000, %p1;
$L__BB0_14:
mov.f32 %f121, 0f3F800000;
sub.f32 %f122, %f121, %f138;
setp.eq.f32 %p18, %f8, 0f3F800000;
selp.f32 %f123, 0f00000000, %f122, %p18;
cvt.sat.f32.f32 %f124, %f123;
mov.b32 %f125, %r13;
setp.gt.f32 %p19, %f26, %f125;
mov.b32 %f126, %r11;
selp.f32 %f127, %f126, 0f3F800000, %p19;
mov.b32 %f128, %r9;
selp.f32 %f129, %f128, 0f3F800000, %p19;
mov.b32 %f130, %r7;
selp.f32 %f131, %f130, 0f3F800000, %p19;
mul.f32 %f132, %f124, %f131;
mul.f32 %f133, %f124, %f129;
mul.f32 %f134, %f124, %f127;
mov.b32 %r43, %f132;
mov.u32 %r42, 0;
// begin inline asm
call _optix_set_payload, (%r42, %r43);
// end inline asm
mov.b32 %r45, %f133;
mov.u32 %r44, 1;
// begin inline asm
call _optix_set_payload, (%r44, %r45);
// end inline asm
mov.b32 %r47, %f134;
mov.u32 %r46, 2;
// begin inline asm
call _optix_set_payload, (%r46, %r47);
// end inline asm
neg.f32 %f135, %f26;
mov.b32 %r49, %f135;
mov.u32 %r48, 3;
// begin inline asm
call _optix_set_payload, (%r48, %r49);
// end inline asm
$L__BB0_15:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 6d3456f9c0084884687e49fb9d3e5c62
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,101 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<2>;
.reg .b16 %rs<9>;
.reg .f32 %f<29>;
.reg .b32 %r<9>;
.reg .b64 %rd<2>;
// begin inline asm
call (%r1), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f10, %f11), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r2, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r2);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r1;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f10, %f11};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f18, %f19}, [retval0+16];
ld.param.f32 %f20, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
// begin inline asm
call (%f12), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f13), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f14), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f21, %f2, %f13;
fma.rn.f32 %f22, %f1, %f12, %f21;
fma.rn.f32 %f23, %f3, %f14, %f22;
setp.leu.f32 %p1, %f23, 0f00000000;
mov.f32 %f26, 0f00000000;
mov.f32 %f27, %f26;
mov.f32 %f28, %f26;
@%p1 bra $L__BB0_2;
// begin inline asm
call (%f24), _optix_get_ray_tmax, ();
// end inline asm
add.f32 %f25, %f24, 0f38D1B717;
mul.f32 %f28, %f3, %f25;
mul.f32 %f27, %f2, %f25;
mul.f32 %f26, %f1, %f25;
$L__BB0_2:
mov.b32 %r4, %f26;
// begin inline asm
call _optix_set_payload, (%r2, %r4);
// end inline asm
mov.b32 %r6, %f27;
mov.u32 %r5, 1;
// begin inline asm
call _optix_set_payload, (%r5, %r6);
// end inline asm
mov.b32 %r8, %f28;
mov.u32 %r7, 2;
// begin inline asm
call _optix_set_payload, (%r7, %r8);
// end inline asm
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: c455ea55020b1e94788490cef3d12137
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,168 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<3>;
.reg .b16 %rs<12>;
.reg .f32 %f<55>;
.reg .b32 %r<24>;
.reg .b64 %rd<3>;
// begin inline asm
call (%r2), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f10, %f11), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r3, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r3);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r2;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f10, %f11};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f4, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
ld.const.u32 %r1, [params+112];
ld.const.f32 %f7, [params+700];
// begin inline asm
call (%f12), _optix_get_ray_tmax, ();
// end inline asm
// begin inline asm
call (%f13), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f14), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f15), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f16, %f2, %f14;
fma.rn.f32 %f17, %f1, %f13, %f16;
fma.rn.f32 %f18, %f3, %f15, %f17;
setp.ltu.f32 %p1, %f18, 0f00000000;
@%p1 bra $L__BB0_3;
bra.uni $L__BB0_1;
$L__BB0_3:
neg.f32 %f54, %f12;
mov.b32 %r23, %f54;
// begin inline asm
call _optix_set_payload, (%r3, %r23);
// end inline asm
mov.u32 %r20, 1;
// begin inline asm
call _optix_set_payload, (%r20, %r23);
// end inline asm
mov.u32 %r22, 2;
// begin inline asm
call _optix_set_payload, (%r22, %r23);
// end inline asm
bra.uni $L__BB0_4;
$L__BB0_1:
div.rn.f32 %f19, %f4, 0f41200000;
cvt.rzi.s32.f32 %r4, %f19;
setp.ne.s32 %p2, %r4, %r1;
@%p2 bra $L__BB0_4;
cvt.rzi.s32.f32 %r11, %f4;
cvt.rn.f32.s32 %f23, %r11;
sub.f32 %f24, %f4, %f23;
ld.const.u64 %rd2, [params+1120];
tex.2d.v4.u32.f32 {%r12, %r13, %r14, %r15}, [%rd2, {%f24, %f5}];
cvt.u16.u32 %rs9, %r12;
// begin inline asm
{ cvt.f32.f16 %f20, %rs9;}
// end inline asm
cvt.u16.u32 %rs10, %r13;
// begin inline asm
{ cvt.f32.f16 %f21, %rs10;}
// end inline asm
cvt.u16.u32 %rs11, %r14;
// begin inline asm
{ cvt.f32.f16 %f22, %rs11;}
// end inline asm
mul.f32 %f25, %f7, %f12;
neg.f32 %f26, %f25;
mov.f32 %f27, 0f3F000000;
mov.f32 %f28, 0f3BBB989D;
fma.rn.f32 %f29, %f26, %f28, %f27;
mov.f32 %f30, 0f3FB8AA3B;
mov.f32 %f31, 0f437C0000;
cvt.sat.f32.f32 %f32, %f29;
mov.f32 %f33, 0f4B400001;
fma.rm.f32 %f34, %f32, %f31, %f33;
add.f32 %f35, %f34, 0fCB40007F;
neg.f32 %f36, %f35;
fma.rn.f32 %f37, %f26, %f30, %f36;
mov.f32 %f38, 0f32A57060;
fma.rn.f32 %f39, %f26, %f38, %f37;
mov.b32 %r16, %f34;
shl.b32 %r17, %r16, 23;
mov.b32 %f40, %r17;
ex2.approx.ftz.f32 %f41, %f39;
mul.f32 %f42, %f41, %f40;
mul.f32 %f43, %f20, %f42;
mul.f32 %f44, %f21, %f42;
mul.f32 %f45, %f22, %f42;
ld.const.v2.f32 {%f46, %f47}, [params+648];
mov.u32 %r5, 0;
mov.u32 %r7, 1;
mul.f32 %f50, %f46, %f43;
mul.f32 %f51, %f47, %f44;
ld.const.f32 %f52, [params+656];
mul.f32 %f53, %f52, %f45;
mov.b32 %r6, %f50;
// begin inline asm
call _optix_set_payload, (%r5, %r6);
// end inline asm
mov.b32 %r8, %f51;
// begin inline asm
call _optix_set_payload, (%r7, %r8);
// end inline asm
mov.b32 %r10, %f53;
mov.u32 %r9, 2;
// begin inline asm
call _optix_set_payload, (%r9, %r10);
// end inline asm
$L__BB0_4:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: d594e38273c4f7e4b89a4ef41bc51400
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,137 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<3>;
.reg .b16 %rs<12>;
.reg .f32 %f<27>;
.reg .b32 %r<21>;
.reg .b64 %rd<7>;
// begin inline asm
call (%r2), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f9, %f10), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r3, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r3);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r2;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f9, %f10};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f7, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
// begin inline asm
call (%f11), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f12), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f13), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f14, %f2, %f12;
fma.rn.f32 %f15, %f1, %f11, %f14;
fma.rn.f32 %f8, %f3, %f13, %f15;
div.rn.f32 %f16, %f7, 0f41200000;
cvt.rzi.s32.f32 %r1, %f16;
setp.lt.s32 %p1, %r1, 0;
@%p1 bra $L__BB0_2;
cvt.rzi.s32.f32 %r10, %f7;
cvt.rn.f32.s32 %f20, %r10;
sub.f32 %f21, %f7, %f20;
ld.const.u64 %rd2, [params+688];
cvta.to.global.u64 %rd3, %rd2;
mul.wide.s32 %rd4, %r1, 8;
add.s64 %rd5, %rd3, %rd4;
ld.global.u64 %rd6, [%rd5];
tex.2d.v4.u32.f32 {%r11, %r12, %r13, %r14}, [%rd6, {%f21, %f5}];
cvt.u16.u32 %rs9, %r11;
cvt.u16.u32 %rs10, %r12;
cvt.u16.u32 %rs11, %r13;
// begin inline asm
{ cvt.f32.f16 %f17, %rs9;}
// end inline asm
// begin inline asm
{ cvt.f32.f16 %f18, %rs10;}
// end inline asm
// begin inline asm
{ cvt.f32.f16 %f19, %rs11;}
// end inline asm
ld.const.f32 %f22, [params+696];
setp.ltu.f32 %p2, %f8, 0f00000000;
selp.f32 %f23, 0f3F800000, %f22, %p2;
mul.f32 %f24, %f17, %f23;
mul.f32 %f25, %f18, %f23;
mul.f32 %f26, %f19, %f23;
mov.b32 %r5, %f24;
// begin inline asm
call _optix_set_payload, (%r3, %r5);
// end inline asm
mov.b32 %r7, %f25;
mov.u32 %r6, 1;
// begin inline asm
call _optix_set_payload, (%r6, %r7);
// end inline asm
mov.b32 %r9, %f26;
mov.u32 %r8, 2;
// begin inline asm
call _optix_set_payload, (%r8, %r9);
// end inline asm
bra.uni $L__BB0_3;
$L__BB0_2:
// begin inline asm
call _optix_set_payload, (%r3, %r3);
// end inline asm
mov.u32 %r17, 1;
// begin inline asm
call _optix_set_payload, (%r17, %r3);
// end inline asm
mov.u32 %r19, 2;
// begin inline asm
call _optix_set_payload, (%r19, %r3);
// end inline asm
$L__BB0_3:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 97af1589d70b0cd4f9b5967df5be1a1e
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,171 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<4>;
.reg .b16 %rs<12>;
.reg .f32 %f<39>;
.reg .b32 %r<37>;
.reg .b64 %rd<7>;
// begin inline asm
call (%r6), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f9, %f10), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r9, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r9);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r6;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f9, %f10};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f7, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
mov.u32 %r11, 1;
// begin inline asm
call (%f11), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f12), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f13), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f14, %f2, %f12;
fma.rn.f32 %f15, %f1, %f11, %f14;
fma.rn.f32 %f8, %f3, %f13, %f15;
// begin inline asm
call (%r8), _optix_get_payload, (%r9);
// end inline asm
// begin inline asm
call (%r10), _optix_get_payload, (%r11);
// end inline asm
mov.u32 %r13, 2;
// begin inline asm
call (%r12), _optix_get_payload, (%r13);
// end inline asm
mov.u32 %r15, 3;
// begin inline asm
call (%r14), _optix_get_payload, (%r15);
// end inline asm
div.rn.f32 %f16, %f7, 0f41200000;
cvt.rzi.s32.f32 %r5, %f16;
setp.lt.s32 %p1, %r5, 0;
@%p1 bra $L__BB0_2;
mov.b32 %f21, %r12;
cvt.rzi.s32.f32 %r24, %f7;
cvt.rn.f32.s32 %f22, %r24;
sub.f32 %f23, %f7, %f22;
ld.const.u64 %rd2, [params+688];
cvta.to.global.u64 %rd3, %rd2;
mul.wide.s32 %rd4, %r5, 8;
add.s64 %rd5, %rd3, %rd4;
ld.global.u64 %rd6, [%rd5];
tex.2d.v4.u32.f32 {%r25, %r26, %r27, %r28}, [%rd6, {%f23, %f5}];
cvt.u16.u32 %rs9, %r25;
cvt.u16.u32 %rs10, %r26;
cvt.u16.u32 %rs11, %r27;
// begin inline asm
{ cvt.f32.f16 %f17, %rs9;}
// end inline asm
// begin inline asm
{ cvt.f32.f16 %f18, %rs10;}
// end inline asm
// begin inline asm
{ cvt.f32.f16 %f19, %rs11;}
// end inline asm
ld.const.f32 %f24, [params+696];
setp.ltu.f32 %p2, %f8, 0f00000000;
selp.f32 %f25, 0f3F800000, %f24, %p2;
mul.f32 %f26, %f17, %f25;
mul.f32 %f27, %f18, %f25;
mul.f32 %f28, %f19, %f25;
// begin inline asm
call (%f20), _optix_get_ray_tmax, ();
// end inline asm
mov.b32 %f29, %r14;
setp.gt.f32 %p3, %f20, %f29;
selp.f32 %f30, %f21, 0f3F800000, %p3;
mov.b32 %f31, %r10;
selp.f32 %f32, %f31, 0f3F800000, %p3;
mov.b32 %f33, %r8;
selp.f32 %f34, %f33, 0f3F800000, %p3;
mul.f32 %f35, %f26, %f34;
mul.f32 %f36, %f27, %f32;
mul.f32 %f37, %f28, %f30;
neg.f32 %f38, %f20;
mov.b32 %r17, %f35;
// begin inline asm
call _optix_set_payload, (%r9, %r17);
// end inline asm
mov.b32 %r19, %f36;
// begin inline asm
call _optix_set_payload, (%r11, %r19);
// end inline asm
mov.b32 %r21, %f37;
// begin inline asm
call _optix_set_payload, (%r13, %r21);
// end inline asm
mov.b32 %r23, %f38;
// begin inline asm
call _optix_set_payload, (%r15, %r23);
// end inline asm
bra.uni $L__BB0_3;
$L__BB0_2:
// begin inline asm
call _optix_set_payload, (%r9, %r9);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r11, %r9);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r13, %r9);
// end inline asm
mov.u32 %r36, 2139095039;
// begin inline asm
call _optix_set_payload, (%r15, %r36);
// end inline asm
$L__BB0_3:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 7aca77effe139f44fbbace05291eb288
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,288 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<20>;
.reg .b16 %rs<9>;
.reg .f32 %f<141>;
.reg .b32 %r<35>;
.reg .b64 %rd<3>;
// begin inline asm
call (%r2), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f23, %f24), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r4, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r4);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r2;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f23, %f24};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f7, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
mov.u32 %r6, 1;
div.rn.f32 %f29, %f7, 0f41200000;
mov.b32 %r10, %f29;
and.b32 %r11, %r10, -2147483648;
or.b32 %r12, %r11, 1056964608;
mov.b32 %f30, %r12;
add.rz.f32 %f31, %f29, %f30;
cvt.rzi.f32.f32 %f32, %f31;
cvt.rzi.s32.f32 %r1, %f32;
// begin inline asm
call (%f25), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f26), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f27), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f33, %f2, %f26;
fma.rn.f32 %f34, %f1, %f25, %f33;
fma.rn.f32 %f35, %f3, %f27, %f34;
setp.gt.f32 %p2, %f35, 0f00000000;
// begin inline asm
call (%f28), _optix_get_ray_tmax, ();
// end inline asm
mov.u32 %r9, -1082130432;
// begin inline asm
call _optix_set_payload, (%r4, %r9);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r6, %r9);
// end inline asm
mov.u32 %r8, 2;
// begin inline asm
call _optix_set_payload, (%r8, %r9);
// end inline asm
ld.const.u32 %r13, [params+664];
setp.ne.s32 %p3, %r1, %r13;
or.pred %p4, %p2, %p3;
@%p4 bra $L__BB0_14;
ld.const.f32 %f37, [params+660];
mul.f32 %f10, %f28, %f37;
mov.f32 %f38, 0f40000000;
cvt.rzi.f32.f32 %f39, %f38;
add.f32 %f40, %f39, %f39;
mov.f32 %f41, 0f40800000;
sub.f32 %f42, %f41, %f40;
abs.f32 %f11, %f42;
abs.f32 %f12, %f10;
setp.lt.f32 %p5, %f12, 0f00800000;
mul.f32 %f43, %f12, 0f4B800000;
selp.f32 %f44, %f43, %f12, %p5;
selp.f32 %f45, 0fC3170000, 0fC2FE0000, %p5;
mov.b32 %r14, %f44;
and.b32 %r15, %r14, 8388607;
or.b32 %r16, %r15, 1065353216;
mov.b32 %f46, %r16;
shr.u32 %r17, %r14, 23;
cvt.rn.f32.u32 %f47, %r17;
add.f32 %f48, %f45, %f47;
setp.gt.f32 %p6, %f46, 0f3FB504F3;
mul.f32 %f49, %f46, 0f3F000000;
add.f32 %f50, %f48, 0f3F800000;
selp.f32 %f51, %f50, %f48, %p6;
selp.f32 %f52, %f49, %f46, %p6;
add.f32 %f53, %f52, 0fBF800000;
add.f32 %f54, %f52, 0f3F800000;
rcp.approx.ftz.f32 %f55, %f54;
add.f32 %f56, %f53, %f53;
mul.f32 %f57, %f56, %f55;
mul.f32 %f58, %f57, %f57;
mov.f32 %f59, 0f3C4CAF63;
mov.f32 %f60, 0f3B18F0FE;
fma.rn.f32 %f61, %f60, %f58, %f59;
mov.f32 %f62, 0f3DAAAABD;
fma.rn.f32 %f63, %f61, %f58, %f62;
mul.rn.f32 %f64, %f63, %f58;
mul.rn.f32 %f65, %f64, %f57;
sub.f32 %f66, %f53, %f57;
add.f32 %f67, %f66, %f66;
neg.f32 %f68, %f57;
fma.rn.f32 %f69, %f68, %f53, %f67;
mul.rn.f32 %f70, %f55, %f69;
add.f32 %f71, %f65, %f57;
sub.f32 %f72, %f57, %f71;
add.f32 %f73, %f65, %f72;
add.f32 %f74, %f70, %f73;
add.f32 %f75, %f71, %f74;
sub.f32 %f76, %f71, %f75;
add.f32 %f77, %f74, %f76;
mov.f32 %f78, 0f3F317200;
mul.rn.f32 %f79, %f51, %f78;
mov.f32 %f80, 0f35BFBE8E;
mul.rn.f32 %f81, %f51, %f80;
add.f32 %f82, %f79, %f75;
sub.f32 %f83, %f79, %f82;
add.f32 %f84, %f75, %f83;
add.f32 %f85, %f77, %f84;
add.f32 %f86, %f81, %f85;
add.f32 %f87, %f82, %f86;
sub.f32 %f88, %f82, %f87;
add.f32 %f89, %f86, %f88;
mul.rn.f32 %f90, %f41, %f87;
neg.f32 %f91, %f90;
fma.rn.f32 %f92, %f41, %f87, %f91;
fma.rn.f32 %f93, %f41, %f89, %f92;
mov.f32 %f94, 0f00000000;
fma.rn.f32 %f95, %f94, %f87, %f93;
add.rn.f32 %f96, %f90, %f95;
neg.f32 %f97, %f96;
add.rn.f32 %f98, %f90, %f97;
add.rn.f32 %f99, %f98, %f95;
mov.b32 %r18, %f96;
setp.eq.s32 %p7, %r18, 1118925336;
add.s32 %r19, %r18, -1;
mov.b32 %f100, %r19;
add.f32 %f101, %f99, 0f37000000;
selp.f32 %f13, %f101, %f99, %p7;
selp.f32 %f102, %f100, %f96, %p7;
mov.f32 %f103, 0f3FB8AA3B;
mul.rn.f32 %f104, %f102, %f103;
cvt.rzi.f32.f32 %f105, %f104;
abs.f32 %f106, %f105;
setp.gt.f32 %p8, %f106, 0f42FC0000;
mov.b32 %r20, %f105;
and.b32 %r21, %r20, -2147483648;
or.b32 %r22, %r21, 1123811328;
mov.b32 %f107, %r22;
selp.f32 %f108, %f107, %f105, %p8;
mov.f32 %f109, 0fBF317218;
fma.rn.f32 %f110, %f108, %f109, %f102;
mov.f32 %f111, 0f3102E308;
fma.rn.f32 %f112, %f108, %f111, %f110;
mul.f32 %f113, %f112, 0f3FB8AA3B;
add.f32 %f114, %f108, 0f4B40007F;
mov.b32 %r23, %f114;
shl.b32 %r24, %r23, 23;
mov.b32 %f115, %r24;
ex2.approx.ftz.f32 %f116, %f113;
mul.f32 %f14, %f116, %f115;
setp.eq.f32 %p9, %f14, 0f7F800000;
mov.f32 %f138, 0f7F800000;
@%p9 bra $L__BB0_3;
fma.rn.f32 %f138, %f14, %f13, %f14;
$L__BB0_3:
setp.lt.f32 %p10, %f10, 0f00000000;
setp.eq.f32 %p11, %f11, 0f3F800000;
and.pred %p1, %p10, %p11;
setp.eq.f32 %p12, %f10, 0f00000000;
@%p12 bra $L__BB0_7;
bra.uni $L__BB0_4;
$L__BB0_7:
add.f32 %f121, %f10, %f10;
selp.f32 %f140, %f121, 0f00000000, %p11;
bra.uni $L__BB0_8;
$L__BB0_4:
mov.b32 %r25, %f138;
xor.b32 %r26, %r25, -2147483648;
mov.b32 %f117, %r26;
selp.f32 %f140, %f117, %f138, %p1;
setp.geu.f32 %p13, %f10, 0f00000000;
@%p13 bra $L__BB0_8;
mov.f32 %f118, 0f40800000;
cvt.rzi.f32.f32 %f119, %f118;
setp.eq.f32 %p14, %f119, 0f40800000;
@%p14 bra $L__BB0_8;
mov.f32 %f140, 0f7FFFFFFF;
$L__BB0_8:
add.f32 %f122, %f12, 0f40800000;
mov.b32 %r27, %f122;
setp.lt.s32 %p16, %r27, 2139095040;
@%p16 bra $L__BB0_13;
setp.gtu.f32 %p17, %f12, 0f7F800000;
@%p17 bra $L__BB0_12;
bra.uni $L__BB0_10;
$L__BB0_12:
add.f32 %f140, %f10, 0f40800000;
bra.uni $L__BB0_13;
$L__BB0_10:
setp.neu.f32 %p18, %f12, 0f7F800000;
@%p18 bra $L__BB0_13;
selp.f32 %f140, 0fFF800000, 0f7F800000, %p1;
$L__BB0_13:
mov.f32 %f123, 0f3F800000;
sub.f32 %f124, %f123, %f140;
setp.eq.f32 %p19, %f10, 0f3F800000;
selp.f32 %f125, 0f00000000, %f124, %p19;
cvt.sat.f32.f32 %f126, %f125;
ld.const.u64 %rd2, [params+552];
mul.lo.s32 %r34, %r1, 10;
cvt.rn.f32.s32 %f127, %r34;
sub.f32 %f128, %f7, %f127;
mul.f32 %f129, %f128, 0fC1200000;
mul.f32 %f130, %f5, 0f41200000;
tex.2d.v4.f32.f32 {%f131, %f132, %f133, %f134}, [%rd2, {%f129, %f130}];
mul.f32 %f135, %f126, %f131;
mul.f32 %f136, %f126, %f132;
mul.f32 %f137, %f126, %f133;
mov.b32 %r29, %f135;
mov.u32 %r28, 0;
// begin inline asm
call _optix_set_payload, (%r28, %r29);
// end inline asm
mov.b32 %r31, %f136;
mov.u32 %r30, 1;
// begin inline asm
call _optix_set_payload, (%r30, %r31);
// end inline asm
mov.b32 %r33, %f137;
mov.u32 %r32, 2;
// begin inline asm
call _optix_set_payload, (%r32, %r33);
// end inline asm
$L__BB0_14:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: f2166ccb9a1cd7f429e38082140295bd
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
@@ -0,0 +1,321 @@
//
// Generated by NVIDIA NVVM Compiler
//
// Compiler Build ID: CL-31968024
// Cuda compilation tools, release 12.0, V12.0.76
// Based on NVVM 7.0.1
//
.version 8.0
.target sm_52
.address_size 64
// .globl __closesthit__oxMain
.const .align 16 .b8 params[1184];
.visible .entry __closesthit__oxMain()
{
.reg .pred %p<21>;
.reg .b16 %rs<9>;
.reg .f32 %f<152>;
.reg .b32 %r<51>;
.reg .b64 %rd<3>;
// begin inline asm
call (%r6), _optix_read_primitive_idx, ();
// end inline asm
// begin inline asm
call (%f24, %f25), _optix_get_triangle_barycentrics, ();
// end inline asm
mov.u32 %r21, 0;
// begin inline asm
call (%rd1), _optix_call_direct_callable,(%r21);
// end inline asm
{ // callseq 0, 0
.reg .b32 temp_param_reg;
.param .b32 param0;
st.param.b32 [param0+0], %r6;
.param .align 8 .b8 param1[8];
st.param.v2.f32 [param1+0], {%f24, %f25};
.param .align 8 .b8 retval0[32];
prototype_0 : .callprototype (.param .align 8 .b8 _[32]) _ (.param .b32 _, .param .align 8 .b8 _[8]);
call (retval0),
%rd1,
(
param0,
param1
)
, prototype_0;
ld.param.v2.f32 {%f1, %f2}, [retval0+0];
ld.param.f32 %f3, [retval0+8];
ld.param.v4.b8 {%rs1, %rs2, %rs3, %rs4}, [retval0+12];
ld.param.v2.f32 {%f7, %f5}, [retval0+16];
ld.param.f32 %f6, [retval0+24];
ld.param.v4.b8 {%rs5, %rs6, %rs7, %rs8}, [retval0+28];
} // callseq 0
mov.u32 %r18, 1;
div.rn.f32 %f30, %f7, 0f41200000;
mov.b32 %r24, %f30;
and.b32 %r25, %r24, -2147483648;
or.b32 %r26, %r25, 1056964608;
mov.b32 %f31, %r26;
add.rz.f32 %f32, %f30, %f31;
cvt.rzi.f32.f32 %f33, %f32;
cvt.rzi.s32.f32 %r1, %f33;
// begin inline asm
call (%f26), _optix_get_world_ray_direction_x, ();
// end inline asm
// begin inline asm
call (%f27), _optix_get_world_ray_direction_y, ();
// end inline asm
// begin inline asm
call (%f28), _optix_get_world_ray_direction_z, ();
// end inline asm
mul.f32 %f34, %f2, %f27;
fma.rn.f32 %f35, %f1, %f26, %f34;
fma.rn.f32 %f36, %f3, %f28, %f35;
setp.gt.f32 %p2, %f36, 0f00000000;
// begin inline asm
call (%f29), _optix_get_ray_tmax, ();
// end inline asm
// begin inline asm
call (%r8), _optix_get_payload, (%r21);
// end inline asm
// begin inline asm
call (%r10), _optix_get_payload, (%r18);
// end inline asm
mov.u32 %r20, 2;
// begin inline asm
call (%r12), _optix_get_payload, (%r20);
// end inline asm
mov.u32 %r22, 3;
// begin inline asm
call (%r14), _optix_get_payload, (%r22);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r21, %r21);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r18, %r21);
// end inline asm
// begin inline asm
call _optix_set_payload, (%r20, %r21);
// end inline asm
mov.u32 %r23, 2139095039;
// begin inline asm
call _optix_set_payload, (%r22, %r23);
// end inline asm
ld.const.u32 %r27, [params+664];
setp.ne.s32 %p3, %r1, %r27;
or.pred %p4, %p2, %p3;
@%p4 bra $L__BB0_14;
mov.b32 %f9, %r14;
ld.const.f32 %f38, [params+660];
mul.f32 %f11, %f29, %f38;
mov.f32 %f39, 0f40000000;
cvt.rzi.f32.f32 %f40, %f39;
add.f32 %f41, %f40, %f40;
mov.f32 %f42, 0f40800000;
sub.f32 %f43, %f42, %f41;
abs.f32 %f12, %f43;
abs.f32 %f13, %f11;
setp.lt.f32 %p5, %f13, 0f00800000;
mul.f32 %f44, %f13, 0f4B800000;
selp.f32 %f45, %f44, %f13, %p5;
selp.f32 %f46, 0fC3170000, 0fC2FE0000, %p5;
mov.b32 %r28, %f45;
and.b32 %r29, %r28, 8388607;
or.b32 %r30, %r29, 1065353216;
mov.b32 %f47, %r30;
shr.u32 %r31, %r28, 23;
cvt.rn.f32.u32 %f48, %r31;
add.f32 %f49, %f46, %f48;
setp.gt.f32 %p6, %f47, 0f3FB504F3;
mul.f32 %f50, %f47, 0f3F000000;
add.f32 %f51, %f49, 0f3F800000;
selp.f32 %f52, %f51, %f49, %p6;
selp.f32 %f53, %f50, %f47, %p6;
add.f32 %f54, %f53, 0fBF800000;
add.f32 %f55, %f53, 0f3F800000;
rcp.approx.ftz.f32 %f56, %f55;
add.f32 %f57, %f54, %f54;
mul.f32 %f58, %f57, %f56;
mul.f32 %f59, %f58, %f58;
mov.f32 %f60, 0f3C4CAF63;
mov.f32 %f61, 0f3B18F0FE;
fma.rn.f32 %f62, %f61, %f59, %f60;
mov.f32 %f63, 0f3DAAAABD;
fma.rn.f32 %f64, %f62, %f59, %f63;
mul.rn.f32 %f65, %f64, %f59;
mul.rn.f32 %f66, %f65, %f58;
sub.f32 %f67, %f54, %f58;
add.f32 %f68, %f67, %f67;
neg.f32 %f69, %f58;
fma.rn.f32 %f70, %f69, %f54, %f68;
mul.rn.f32 %f71, %f56, %f70;
add.f32 %f72, %f66, %f58;
sub.f32 %f73, %f58, %f72;
add.f32 %f74, %f66, %f73;
add.f32 %f75, %f71, %f74;
add.f32 %f76, %f72, %f75;
sub.f32 %f77, %f72, %f76;
add.f32 %f78, %f75, %f77;
mov.f32 %f79, 0f3F317200;
mul.rn.f32 %f80, %f52, %f79;
mov.f32 %f81, 0f35BFBE8E;
mul.rn.f32 %f82, %f52, %f81;
add.f32 %f83, %f80, %f76;
sub.f32 %f84, %f80, %f83;
add.f32 %f85, %f76, %f84;
add.f32 %f86, %f78, %f85;
add.f32 %f87, %f82, %f86;
add.f32 %f88, %f83, %f87;
sub.f32 %f89, %f83, %f88;
add.f32 %f90, %f87, %f89;
mul.rn.f32 %f91, %f42, %f88;
neg.f32 %f92, %f91;
fma.rn.f32 %f93, %f42, %f88, %f92;
fma.rn.f32 %f94, %f42, %f90, %f93;
mov.f32 %f95, 0f00000000;
fma.rn.f32 %f96, %f95, %f88, %f94;
add.rn.f32 %f97, %f91, %f96;
neg.f32 %f98, %f97;
add.rn.f32 %f99, %f91, %f98;
add.rn.f32 %f100, %f99, %f96;
mov.b32 %r32, %f97;
setp.eq.s32 %p7, %r32, 1118925336;
add.s32 %r33, %r32, -1;
mov.b32 %f101, %r33;
add.f32 %f102, %f100, 0f37000000;
selp.f32 %f14, %f102, %f100, %p7;
selp.f32 %f103, %f101, %f97, %p7;
mov.f32 %f104, 0f3FB8AA3B;
mul.rn.f32 %f105, %f103, %f104;
cvt.rzi.f32.f32 %f106, %f105;
abs.f32 %f107, %f106;
setp.gt.f32 %p8, %f107, 0f42FC0000;
mov.b32 %r34, %f106;
and.b32 %r35, %r34, -2147483648;
or.b32 %r36, %r35, 1123811328;
mov.b32 %f108, %r36;
selp.f32 %f109, %f108, %f106, %p8;
mov.f32 %f110, 0fBF317218;
fma.rn.f32 %f111, %f109, %f110, %f103;
mov.f32 %f112, 0f3102E308;
fma.rn.f32 %f113, %f109, %f112, %f111;
mul.f32 %f114, %f113, 0f3FB8AA3B;
add.f32 %f115, %f109, 0f4B40007F;
mov.b32 %r37, %f115;
shl.b32 %r38, %r37, 23;
mov.b32 %f116, %r38;
ex2.approx.ftz.f32 %f117, %f114;
mul.f32 %f15, %f117, %f116;
setp.eq.f32 %p9, %f15, 0f7F800000;
mov.f32 %f149, 0f7F800000;
@%p9 bra $L__BB0_3;
fma.rn.f32 %f149, %f15, %f14, %f15;
$L__BB0_3:
setp.lt.f32 %p10, %f11, 0f00000000;
setp.eq.f32 %p11, %f12, 0f3F800000;
and.pred %p1, %p10, %p11;
setp.eq.f32 %p12, %f11, 0f00000000;
@%p12 bra $L__BB0_7;
bra.uni $L__BB0_4;
$L__BB0_7:
add.f32 %f122, %f11, %f11;
selp.f32 %f151, %f122, 0f00000000, %p11;
bra.uni $L__BB0_8;
$L__BB0_4:
mov.b32 %r39, %f149;
xor.b32 %r40, %r39, -2147483648;
mov.b32 %f118, %r40;
selp.f32 %f151, %f118, %f149, %p1;
setp.geu.f32 %p13, %f11, 0f00000000;
@%p13 bra $L__BB0_8;
mov.f32 %f119, 0f40800000;
cvt.rzi.f32.f32 %f120, %f119;
setp.eq.f32 %p14, %f120, 0f40800000;
@%p14 bra $L__BB0_8;
mov.f32 %f151, 0f7FFFFFFF;
$L__BB0_8:
add.f32 %f123, %f13, 0f40800000;
mov.b32 %r41, %f123;
setp.lt.s32 %p16, %r41, 2139095040;
@%p16 bra $L__BB0_13;
setp.gtu.f32 %p17, %f13, 0f7F800000;
@%p17 bra $L__BB0_12;
bra.uni $L__BB0_10;
$L__BB0_12:
add.f32 %f151, %f11, 0f40800000;
bra.uni $L__BB0_13;
$L__BB0_10:
setp.neu.f32 %p18, %f13, 0f7F800000;
@%p18 bra $L__BB0_13;
selp.f32 %f151, 0fFF800000, 0f7F800000, %p1;
$L__BB0_13:
mov.f32 %f124, 0f3F800000;
sub.f32 %f125, %f124, %f151;
setp.eq.f32 %p19, %f11, 0f3F800000;
selp.f32 %f126, 0f00000000, %f125, %p19;
cvt.sat.f32.f32 %f127, %f126;
ld.const.u64 %rd2, [params+552];
mul.lo.s32 %r50, %r1, 10;
cvt.rn.f32.s32 %f128, %r50;
sub.f32 %f129, %f7, %f128;
mul.f32 %f130, %f129, 0fC1200000;
mul.f32 %f131, %f5, 0f41200000;
tex.2d.v4.f32.f32 {%f132, %f133, %f134, %f135}, [%rd2, {%f130, %f131}];
mul.f32 %f136, %f127, %f132;
mul.f32 %f137, %f127, %f133;
mul.f32 %f138, %f127, %f134;
setp.gt.f32 %p20, %f29, %f9;
mov.b32 %f139, %r12;
selp.f32 %f140, %f139, 0f3F800000, %p20;
mov.b32 %f141, %r10;
selp.f32 %f142, %f141, 0f3F800000, %p20;
mov.b32 %f143, %r8;
selp.f32 %f144, %f143, 0f3F800000, %p20;
mul.f32 %f145, %f136, %f144;
mul.f32 %f146, %f137, %f142;
mul.f32 %f147, %f138, %f140;
mov.b32 %r43, %f145;
mov.u32 %r42, 0;
// begin inline asm
call _optix_set_payload, (%r42, %r43);
// end inline asm
mov.b32 %r45, %f146;
mov.u32 %r44, 1;
// begin inline asm
call _optix_set_payload, (%r44, %r45);
// end inline asm
mov.b32 %r47, %f147;
mov.u32 %r46, 2;
// begin inline asm
call _optix_set_payload, (%r46, %r47);
// end inline asm
neg.f32 %f148, %f29;
mov.b32 %r49, %f148;
mov.u32 %r48, 3;
// begin inline asm
call _optix_set_payload, (%r48, %r49);
// end inline asm
$L__BB0_14:
ret;
}
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: a0384d744102108429e4f8caa9da7967
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: a7316685f40a094468137a4264dd6c17
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 115fea6515b62454a8bd5ca1cd900caf
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 661d5c0f1e979bb479e69f3c42fa7888
timeCreated: 1765627719
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: d42558f7d8b6e4d449668cf8c38518f0
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 07fc8ef54c564c045828463a467e3104
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 82816e6f83cca5445838f266aebb1de4
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 4355da266d2a7c14cac47b3204397127
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: c4568f6281b7ab947aa21eefbfaeaf53
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 3796116758d26b04bae73a1acee46d47
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 5ac3c7567625cf44d941a03a6f4f3722
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: fbe2a24753e92bb4eabd9c3feb1050c0
timeCreated: 1765543434
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: c3325158e086e584c9706b725881dfba
timeCreated: 1765557579
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 59b88ee6f00ce574aa4705acc2fd6f6a
timeCreated: 1765557579
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 98dd5f3146ae94b47878663a275cce3b
timeCreated: 1765627719
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:
File diff suppressed because it is too large Load Diff
@@ -0,0 +1,8 @@
fileFormatVersion: 2
guid: 47550908fb09a764499b21164c52fbc6
timeCreated: 1765627719
licenseType: Store
DefaultImporter:
userData:
assetBundleName:
assetBundleVariant:

Some files were not shown because too many files have changed in this diff Show More