diff options
author | Mike Klein <mtklein@chromium.org> | 2017-06-05 15:52:35 -0400 |
---|---|---|
committer | Skia Commit-Bot <skia-commit-bot@chromium.org> | 2017-06-05 20:14:59 +0000 |
commit | adff9dc98200b6ffe1f902ef012c410c2424d220 (patch) | |
tree | 9b2a0a1fba91c7c16696518071ef1cd144c1dc24 /src | |
parent | c6e6a5f45e54006e861275a6d5c165830f403dcd (diff) |
SkJumper: only omit leaf frame pointers
This seems to make Instruments work a lot better.
Change-Id: I078f005d32e427b4eb31bc92c731e3444f2faffb
Reviewed-on: https://skia-review.googlesource.com/18635
Reviewed-by: Mike Reed <reed@google.com>
Commit-Queue: Mike Klein <mtklein@chromium.org>
Diffstat (limited to 'src')
-rw-r--r-- | src/jumper/SkJumper_generated.S | 6117 | ||||
-rw-r--r-- | src/jumper/SkJumper_generated_win.S | 6136 | ||||
-rwxr-xr-x | src/jumper/build_stages.py | 2 |
3 files changed, 5989 insertions, 6266 deletions
diff --git a/src/jumper/SkJumper_generated.S b/src/jumper/SkJumper_generated.S index 526c10d728..286d348e61 100644 --- a/src/jumper/SkJumper_generated.S +++ b/src/jumper/SkJumper_generated.S @@ -28,10 +28,10 @@ HIDDEN _sk_start_pipeline_aarch64 .globl _sk_start_pipeline_aarch64 FUNCTION(_sk_start_pipeline_aarch64) _sk_start_pipeline_aarch64: - .long 0xd10103ff // sub sp, sp, #0x40 - .long 0xa9015bf7 // stp x23, x22, [sp, #16] - .long 0xa90253f5 // stp x21, x20, [sp, #32] - .long 0xa9037bf3 // stp x19, x30, [sp, #48] + .long 0xf81c0ff7 // str x23, [sp, #-64]! + .long 0xa90157f6 // stp x22, x21, [sp, #16] + .long 0xa9024ff4 // stp x20, x19, [sp, #32] + .long 0xa9037bfd // stp x29, x30, [sp, #48] .long 0xaa0303f4 // mov x20, x3 .long 0xf8408685 // ldr x5, [x20], #8 .long 0xaa0003f7 // mov x23, x0 @@ -40,9 +40,10 @@ _sk_start_pipeline_aarch64: .long 0xaa0403f3 // mov x19, x4 .long 0xeb16011f // cmp x8, x22 .long 0xaa0103f5 // mov x21, x1 - .long 0x54000069 // b.ls 3c <sk_start_pipeline_aarch64+0x3c> // b.plast + .long 0x9100c3fd // add x29, sp, #0x30 + .long 0x54000069 // b.ls 40 <sk_start_pipeline_aarch64+0x40> // b.plast .long 0xaa1703e2 // mov x2, x23 - .long 0x14000017 // b 94 <sk_start_pipeline_aarch64+0x94> + .long 0x14000017 // b 98 <sk_start_pipeline_aarch64+0x98> .long 0xf90007e5 // str x5, [sp, #8] .long 0xf94007e5 // ldr x5, [sp, #8] .long 0x6f00e400 // movi v0.2d, #0x0 @@ -64,15 +65,15 @@ _sk_start_pipeline_aarch64: .long 0x910022e8 // add x8, x23, #0x8 .long 0xeb16011f // cmp x8, x22 .long 0xaa0203f7 // mov x23, x2 - .long 0x54fffd89 // b.ls 40 <sk_start_pipeline_aarch64+0x40> // b.plast + .long 0x54fffd89 // b.ls 44 <sk_start_pipeline_aarch64+0x44> // b.plast .long 0xcb0202c4 // sub x4, x22, x2 - .long 0xb4000224 // cbz x4, dc <sk_start_pipeline_aarch64+0xdc> + .long 0xb4000224 // cbz x4, e0 <sk_start_pipeline_aarch64+0xe0> .long 0xaa1303e0 // mov x0, x19 .long 0xaa1403e1 // mov x1, x20 .long 0xaa1503e3 // mov x3, x21 - .long 0xa9437bf3 // ldp x19, x30, [sp, #48] - .long 0xa94253f5 // ldp x21, x20, [sp, #32] - .long 0xa9415bf7 // ldp x23, x22, [sp, #16] + .long 0xa9437bfd // ldp x29, x30, [sp, #48] + .long 0xa9424ff4 // ldp x20, x19, [sp, #32] + .long 0xa94157f6 // ldp x22, x21, [sp, #16] .long 0x6f00e400 // movi v0.2d, #0x0 .long 0x6f00e401 // movi v1.2d, #0x0 .long 0x6f00e402 // movi v2.2d, #0x0 @@ -81,12 +82,12 @@ _sk_start_pipeline_aarch64: .long 0x6f00e405 // movi v5.2d, #0x0 .long 0x6f00e406 // movi v6.2d, #0x0 .long 0x6f00e407 // movi v7.2d, #0x0 - .long 0x910103ff // add sp, sp, #0x40 + .long 0xf84407f7 // ldr x23, [sp], #64 .long 0xd61f00a0 // br x5 - .long 0xa9437bf3 // ldp x19, x30, [sp, #48] - .long 0xa94253f5 // ldp x21, x20, [sp, #32] - .long 0xa9415bf7 // ldp x23, x22, [sp, #16] - .long 0x910103ff // add sp, sp, #0x40 + .long 0xa9437bfd // ldp x29, x30, [sp, #48] + .long 0xa9424ff4 // ldp x20, x19, [sp, #32] + .long 0xa94157f6 // ldp x22, x21, [sp, #16] + .long 0xf84407f7 // ldr x23, [sp], #64 .long 0xd65f03c0 // ret HIDDEN _sk_just_return_aarch64 @@ -1268,7 +1269,7 @@ _sk_srcover_rgba_8888_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020908 // add x8, x8, x2, lsl #2 - .long 0xb5000504 // cbnz x4, 1158 <sk_srcover_rgba_8888_aarch64+0xac> + .long 0xb5000504 // cbnz x4, 115c <sk_srcover_rgba_8888_aarch64+0xac> .long 0x3dc00104 // ldr q4, [x8] .long 0x6f00e625 // movi v5.2d, #0xff000000ff .long 0x6f380486 // ushr v6.4s, v4.4s, #8 @@ -1303,7 +1304,7 @@ _sk_srcover_rgba_8888_aarch64: .long 0x6e21a871 // fcvtnu v17.4s, v3.4s .long 0x4f385631 // shl v17.4s, v17.4s, #24 .long 0x4eb11e10 // orr v16.16b, v16.16b, v17.16b - .long 0xb5000284 // cbnz x4, 1194 <sk_srcover_rgba_8888_aarch64+0xe8> + .long 0xb5000284 // cbnz x4, 1198 <sk_srcover_rgba_8888_aarch64+0xe8> .long 0x3d800110 // str q16, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 @@ -1311,31 +1312,31 @@ _sk_srcover_rgba_8888_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x6f00e404 // movi v4.2d, #0x0 - .long 0x54000140 // b.eq 118c <sk_srcover_rgba_8888_aarch64+0xe0> // b.none + .long 0x54000140 // b.eq 1190 <sk_srcover_rgba_8888_aarch64+0xe0> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 1184 <sk_srcover_rgba_8888_aarch64+0xd8> // b.none + .long 0x540000c0 // b.eq 1188 <sk_srcover_rgba_8888_aarch64+0xd8> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffa61 // b.ne 10c0 <sk_srcover_rgba_8888_aarch64+0x14> // b.any + .long 0x54fffa61 // b.ne 10c4 <sk_srcover_rgba_8888_aarch64+0x14> // b.any .long 0x91002109 // add x9, x8, #0x8 .long 0x4e040fe4 // dup v4.4s, wzr .long 0x4d408124 // ld1 {v4.s}[2], [x9] .long 0x91001109 // add x9, x8, #0x4 .long 0x0d409124 // ld1 {v4.s}[1], [x9] .long 0x0d408104 // ld1 {v4.s}[0], [x8] - .long 0x17ffffcc // b 10c0 <sk_srcover_rgba_8888_aarch64+0x14> + .long 0x17ffffcc // b 10c4 <sk_srcover_rgba_8888_aarch64+0x14> .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 - .long 0x54000120 // b.eq 11c0 <sk_srcover_rgba_8888_aarch64+0x114> // b.none + .long 0x54000120 // b.eq 11c4 <sk_srcover_rgba_8888_aarch64+0x114> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000a0 // b.eq 11b8 <sk_srcover_rgba_8888_aarch64+0x10c> // b.none + .long 0x540000a0 // b.eq 11bc <sk_srcover_rgba_8888_aarch64+0x10c> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffd01 // b.ne 114c <sk_srcover_rgba_8888_aarch64+0xa0> // b.any + .long 0x54fffd01 // b.ne 1150 <sk_srcover_rgba_8888_aarch64+0xa0> // b.any .long 0x91002109 // add x9, x8, #0x8 .long 0x4d008130 // st1 {v16.s}[2], [x9] .long 0x91001109 // add x9, x8, #0x4 .long 0x0d009130 // st1 {v16.s}[1], [x9] .long 0x0d008110 // st1 {v16.s}[0], [x8] - .long 0x17ffffe2 // b 114c <sk_srcover_rgba_8888_aarch64+0xa0> + .long 0x17ffffe2 // b 1150 <sk_srcover_rgba_8888_aarch64+0xa0> HIDDEN _sk_clamp_0_aarch64 .globl _sk_clamp_0_aarch64 @@ -1719,7 +1720,7 @@ _sk_scale_u8_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020108 // add x8, x8, x2 - .long 0xb50002e4 // cbnz x4, 16e0 <sk_scale_u8_aarch64+0x68> + .long 0xb50002e4 // cbnz x4, 16e4 <sk_scale_u8_aarch64+0x68> .long 0x39400109 // ldrb w9, [x8] .long 0x3940050a // ldrb w10, [x8, #1] .long 0x3940090b // ldrb w11, [x8, #2] @@ -1745,11 +1746,11 @@ _sk_scale_u8_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e410 // movi d16, #0x0 - .long 0x54000140 // b.eq 1714 <sk_scale_u8_aarch64+0x9c> // b.none + .long 0x54000140 // b.eq 1718 <sk_scale_u8_aarch64+0x9c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 170c <sk_scale_u8_aarch64+0x94> // b.none + .long 0x540000c0 // b.eq 1710 <sk_scale_u8_aarch64+0x94> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffd61 // b.ne 16a8 <sk_scale_u8_aarch64+0x30> // b.any + .long 0x54fffd61 // b.ne 16ac <sk_scale_u8_aarch64+0x30> // b.any .long 0x39400909 // ldrb w9, [x8, #2] .long 0x0e020ff0 // dup v16.4h, wzr .long 0x4e0a1d30 // mov v16.h[2], w9 @@ -1757,7 +1758,7 @@ _sk_scale_u8_aarch64: .long 0x4e061d30 // mov v16.h[1], w9 .long 0x39400108 // ldrb w8, [x8] .long 0x4e021d10 // mov v16.h[0], w8 - .long 0x17ffffe3 // b 16a8 <sk_scale_u8_aarch64+0x30> + .long 0x17ffffe3 // b 16ac <sk_scale_u8_aarch64+0x30> HIDDEN _sk_lerp_1_float_aarch64 .globl _sk_lerp_1_float_aarch64 @@ -1786,7 +1787,7 @@ _sk_lerp_u8_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020108 // add x8, x8, x2 - .long 0xb50003e4 // cbnz x4, 17e4 <sk_lerp_u8_aarch64+0x88> + .long 0xb50003e4 // cbnz x4, 17e8 <sk_lerp_u8_aarch64+0x88> .long 0x39400109 // ldrb w9, [x8] .long 0x3940050a // ldrb w10, [x8, #1] .long 0x3940090b // ldrb w11, [x8, #2] @@ -1820,11 +1821,11 @@ _sk_lerp_u8_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e410 // movi d16, #0x0 - .long 0x54000140 // b.eq 1818 <sk_lerp_u8_aarch64+0xbc> // b.none + .long 0x54000140 // b.eq 181c <sk_lerp_u8_aarch64+0xbc> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 1810 <sk_lerp_u8_aarch64+0xb4> // b.none + .long 0x540000c0 // b.eq 1814 <sk_lerp_u8_aarch64+0xb4> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffc61 // b.ne 178c <sk_lerp_u8_aarch64+0x30> // b.any + .long 0x54fffc61 // b.ne 1790 <sk_lerp_u8_aarch64+0x30> // b.any .long 0x39400909 // ldrb w9, [x8, #2] .long 0x0e020ff0 // dup v16.4h, wzr .long 0x4e0a1d30 // mov v16.h[2], w9 @@ -1832,7 +1833,7 @@ _sk_lerp_u8_aarch64: .long 0x4e061d30 // mov v16.h[1], w9 .long 0x39400108 // ldrb w8, [x8] .long 0x4e021d10 // mov v16.h[0], w8 - .long 0x17ffffdb // b 178c <sk_lerp_u8_aarch64+0x30> + .long 0x17ffffdb // b 1790 <sk_lerp_u8_aarch64+0x30> HIDDEN _sk_lerp_565_aarch64 .globl _sk_lerp_565_aarch64 @@ -1841,7 +1842,7 @@ _sk_lerp_565_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020508 // add x8, x8, x2, lsl #1 - .long 0xb50005c4 // cbnz x4, 18e8 <sk_lerp_565_aarch64+0xc4> + .long 0xb50005c4 // cbnz x4, 18ec <sk_lerp_565_aarch64+0xc4> .long 0xfd400110 // ldr d16, [x8] .long 0x321b17e8 // orr w8, wzr, #0x7e0 .long 0x4e040d12 // dup v18.4s, w8 @@ -1890,18 +1891,18 @@ _sk_lerp_565_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e410 // movi d16, #0x0 - .long 0x54000140 // b.eq 191c <sk_lerp_565_aarch64+0xf8> // b.none + .long 0x54000140 // b.eq 1920 <sk_lerp_565_aarch64+0xf8> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 1914 <sk_lerp_565_aarch64+0xf0> // b.none + .long 0x540000c0 // b.eq 1918 <sk_lerp_565_aarch64+0xf0> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fff9a1 // b.ne 1838 <sk_lerp_565_aarch64+0x14> // b.any + .long 0x54fff9a1 // b.ne 183c <sk_lerp_565_aarch64+0x14> // b.any .long 0x91001109 // add x9, x8, #0x4 .long 0x0e020ff0 // dup v16.4h, wzr .long 0x0d405130 // ld1 {v16.h}[2], [x9] .long 0x91000909 // add x9, x8, #0x2 .long 0x0d404930 // ld1 {v16.h}[1], [x9] .long 0x0d404110 // ld1 {v16.h}[0], [x8] - .long 0x17ffffc6 // b 1838 <sk_lerp_565_aarch64+0x14> + .long 0x17ffffc6 // b 183c <sk_lerp_565_aarch64+0x14> HIDDEN _sk_load_tables_aarch64 .globl _sk_load_tables_aarch64 @@ -1910,7 +1911,7 @@ _sk_load_tables_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400109 // ldr x9, [x8] .long 0x8b020929 // add x9, x9, x2, lsl #2 - .long 0xb50006e4 // cbnz x4, 1a0c <sk_load_tables_aarch64+0xe8> + .long 0xb50006e4 // cbnz x4, 1a10 <sk_load_tables_aarch64+0xe8> .long 0x3dc00122 // ldr q2, [x9] .long 0xa940a909 // ldp x9, x10, [x8, #8] .long 0x6f00e620 // movi v0.2d, #0xff000000ff @@ -1968,18 +1969,18 @@ _sk_load_tables_aarch64: .long 0x1200048a // and w10, w4, #0x3 .long 0x7100055f // cmp w10, #0x1 .long 0x6f00e402 // movi v2.2d, #0x0 - .long 0x54000140 // b.eq 1a40 <sk_load_tables_aarch64+0x11c> // b.none + .long 0x54000140 // b.eq 1a44 <sk_load_tables_aarch64+0x11c> // b.none .long 0x7100095f // cmp w10, #0x2 - .long 0x540000c0 // b.eq 1a38 <sk_load_tables_aarch64+0x114> // b.none + .long 0x540000c0 // b.eq 1a3c <sk_load_tables_aarch64+0x114> // b.none .long 0x71000d5f // cmp w10, #0x3 - .long 0x54fff881 // b.ne 1938 <sk_load_tables_aarch64+0x14> // b.any + .long 0x54fff881 // b.ne 193c <sk_load_tables_aarch64+0x14> // b.any .long 0x9100212a // add x10, x9, #0x8 .long 0x4e040fe2 // dup v2.4s, wzr .long 0x4d408142 // ld1 {v2.s}[2], [x10] .long 0x9100112a // add x10, x9, #0x4 .long 0x0d409142 // ld1 {v2.s}[1], [x10] .long 0x0d408122 // ld1 {v2.s}[0], [x9] - .long 0x17ffffbd // b 1938 <sk_load_tables_aarch64+0x14> + .long 0x17ffffbd // b 193c <sk_load_tables_aarch64+0x14> HIDDEN _sk_load_tables_u16_be_aarch64 .globl _sk_load_tables_u16_be_aarch64 @@ -1988,7 +1989,7 @@ _sk_load_tables_u16_be_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400109 // ldr x9, [x8] .long 0x8b020d29 // add x9, x9, x2, lsl #3 - .long 0xb5000744 // cbnz x4, 1b3c <sk_load_tables_u16_be_aarch64+0xf4> + .long 0xb5000744 // cbnz x4, 1b40 <sk_load_tables_u16_be_aarch64+0xf4> .long 0x0c400520 // ld4 {v0.4h-v3.4h}, [x9] .long 0xa940a909 // ldp x9, x10, [x8, #8] .long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8 @@ -2048,14 +2049,14 @@ _sk_load_tables_u16_be_aarch64: .long 0xd61f00a0 // br x5 .long 0x0d606120 // ld4 {v0.h-v3.h}[0], [x9] .long 0xf100049f // cmp x4, #0x1 - .long 0x54fff8c0 // b.eq 1a5c <sk_load_tables_u16_be_aarch64+0x14> // b.none + .long 0x54fff8c0 // b.eq 1a60 <sk_load_tables_u16_be_aarch64+0x14> // b.none .long 0x9100212a // add x10, x9, #0x8 .long 0x0d606940 // ld4 {v0.h-v3.h}[1], [x10] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fff843 // b.cc 1a5c <sk_load_tables_u16_be_aarch64+0x14> // b.lo, b.ul, b.last + .long 0x54fff843 // b.cc 1a60 <sk_load_tables_u16_be_aarch64+0x14> // b.lo, b.ul, b.last .long 0x91004129 // add x9, x9, #0x10 .long 0x0d607120 // ld4 {v0.h-v3.h}[2], [x9] - .long 0x17ffffbf // b 1a5c <sk_load_tables_u16_be_aarch64+0x14> + .long 0x17ffffbf // b 1a60 <sk_load_tables_u16_be_aarch64+0x14> HIDDEN _sk_load_tables_rgb_u16_be_aarch64 .globl _sk_load_tables_rgb_u16_be_aarch64 @@ -2065,7 +2066,7 @@ _sk_load_tables_rgb_u16_be_aarch64: .long 0x321f07ea // orr w10, wzr, #0x6 .long 0xf9400109 // ldr x9, [x8] .long 0x9b0a2449 // madd x9, x2, x10, x9 - .long 0xb5000664 // cbnz x4, 1c40 <sk_load_tables_rgb_u16_be_aarch64+0xdc> + .long 0xb5000664 // cbnz x4, 1c44 <sk_load_tables_rgb_u16_be_aarch64+0xdc> .long 0x0c404520 // ld3 {v0.4h-v2.4h}, [x9] .long 0xa940a909 // ldp x9, x10, [x8, #8] .long 0x2f07b7e0 // bic v0.4h, #0xff, lsl #8 @@ -2118,14 +2119,14 @@ _sk_load_tables_rgb_u16_be_aarch64: .long 0xd61f00a0 // br x5 .long 0x0d406120 // ld3 {v0.h-v2.h}[0], [x9] .long 0xf100049f // cmp x4, #0x1 - .long 0x54fff9a0 // b.eq 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.none + .long 0x54fff9a0 // b.eq 1b80 <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.none .long 0x9100192a // add x10, x9, #0x6 .long 0x0d406940 // ld3 {v0.h-v2.h}[1], [x10] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fff923 // b.cc 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last + .long 0x54fff923 // b.cc 1b80 <sk_load_tables_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last .long 0x91003129 // add x9, x9, #0xc .long 0x0d407120 // ld3 {v0.h-v2.h}[2], [x9] - .long 0x17ffffc6 // b 1b7c <sk_load_tables_rgb_u16_be_aarch64+0x18> + .long 0x17ffffc6 // b 1b80 <sk_load_tables_rgb_u16_be_aarch64+0x18> HIDDEN _sk_byte_tables_aarch64 .globl _sk_byte_tables_aarch64 @@ -2770,7 +2771,7 @@ _sk_load_a8_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020108 // add x8, x8, x2 - .long 0xb50002e4 // cbnz x4, 25e4 <sk_load_a8_aarch64+0x68> + .long 0xb50002e4 // cbnz x4, 25e8 <sk_load_a8_aarch64+0x68> .long 0x39400109 // ldrb w9, [x8] .long 0x3940050a // ldrb w10, [x8, #1] .long 0x3940090b // ldrb w11, [x8, #2] @@ -2796,11 +2797,11 @@ _sk_load_a8_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e402 // movi d2, #0x0 - .long 0x54000140 // b.eq 2618 <sk_load_a8_aarch64+0x9c> // b.none + .long 0x54000140 // b.eq 261c <sk_load_a8_aarch64+0x9c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 2610 <sk_load_a8_aarch64+0x94> // b.none + .long 0x540000c0 // b.eq 2614 <sk_load_a8_aarch64+0x94> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffd61 // b.ne 25ac <sk_load_a8_aarch64+0x30> // b.any + .long 0x54fffd61 // b.ne 25b0 <sk_load_a8_aarch64+0x30> // b.any .long 0x39400909 // ldrb w9, [x8, #2] .long 0x0e020fe2 // dup v2.4h, wzr .long 0x4e0a1d22 // mov v2.h[2], w9 @@ -2808,7 +2809,7 @@ _sk_load_a8_aarch64: .long 0x4e061d22 // mov v2.h[1], w9 .long 0x39400108 // ldrb w8, [x8] .long 0x4e021d02 // mov v2.h[0], w8 - .long 0x17ffffe3 // b 25ac <sk_load_a8_aarch64+0x30> + .long 0x17ffffe3 // b 25b0 <sk_load_a8_aarch64+0x30> HIDDEN _sk_gather_a8_aarch64 .globl _sk_gather_a8_aarch64 @@ -2857,7 +2858,7 @@ _sk_store_a8_aarch64: .long 0x6e21aa10 // fcvtnu v16.4s, v16.4s .long 0x0e612a10 // xtn v16.4h, v16.4s .long 0x8b020108 // add x8, x8, x2 - .long 0xb5000184 // cbnz x4, 26ec <sk_store_a8_aarch64+0x50> + .long 0xb5000184 // cbnz x4, 26f0 <sk_store_a8_aarch64+0x50> .long 0x0e0e3e09 // umov w9, v16.h[3] .long 0x0e0a3e0a // umov w10, v16.h[2] .long 0x0e063e0b // umov w11, v16.h[1] @@ -2871,18 +2872,18 @@ _sk_store_a8_aarch64: .long 0xd61f00a0 // br x5 .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 - .long 0x54000120 // b.eq 2718 <sk_store_a8_aarch64+0x7c> // b.none + .long 0x54000120 // b.eq 271c <sk_store_a8_aarch64+0x7c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000a0 // b.eq 2710 <sk_store_a8_aarch64+0x74> // b.none + .long 0x540000a0 // b.eq 2714 <sk_store_a8_aarch64+0x74> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffee1 // b.ne 26e0 <sk_store_a8_aarch64+0x44> // b.any + .long 0x54fffee1 // b.ne 26e4 <sk_store_a8_aarch64+0x44> // b.any .long 0x0e0a3e09 // umov w9, v16.h[2] .long 0x39000909 // strb w9, [x8, #2] .long 0x0e063e09 // umov w9, v16.h[1] .long 0x39000509 // strb w9, [x8, #1] .long 0x0e023e09 // umov w9, v16.h[0] .long 0x39000109 // strb w9, [x8] - .long 0x17fffff0 // b 26e0 <sk_store_a8_aarch64+0x44> + .long 0x17fffff0 // b 26e4 <sk_store_a8_aarch64+0x44> HIDDEN _sk_load_g8_aarch64 .globl _sk_load_g8_aarch64 @@ -2891,7 +2892,7 @@ _sk_load_g8_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020108 // add x8, x8, x2 - .long 0xb50002e4 // cbnz x4, 278c <sk_load_g8_aarch64+0x68> + .long 0xb50002e4 // cbnz x4, 2790 <sk_load_g8_aarch64+0x68> .long 0x39400109 // ldrb w9, [x8] .long 0x3940050a // ldrb w10, [x8, #1] .long 0x3940090b // ldrb w11, [x8, #2] @@ -2917,11 +2918,11 @@ _sk_load_g8_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e400 // movi d0, #0x0 - .long 0x54000140 // b.eq 27c0 <sk_load_g8_aarch64+0x9c> // b.none + .long 0x54000140 // b.eq 27c4 <sk_load_g8_aarch64+0x9c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 27b8 <sk_load_g8_aarch64+0x94> // b.none + .long 0x540000c0 // b.eq 27bc <sk_load_g8_aarch64+0x94> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffd61 // b.ne 2754 <sk_load_g8_aarch64+0x30> // b.any + .long 0x54fffd61 // b.ne 2758 <sk_load_g8_aarch64+0x30> // b.any .long 0x39400909 // ldrb w9, [x8, #2] .long 0x0e020fe0 // dup v0.4h, wzr .long 0x4e0a1d20 // mov v0.h[2], w9 @@ -2929,7 +2930,7 @@ _sk_load_g8_aarch64: .long 0x4e061d20 // mov v0.h[1], w9 .long 0x39400108 // ldrb w8, [x8] .long 0x4e021d00 // mov v0.h[0], w8 - .long 0x17ffffe3 // b 2754 <sk_load_g8_aarch64+0x30> + .long 0x17ffffe3 // b 2758 <sk_load_g8_aarch64+0x30> HIDDEN _sk_gather_g8_aarch64 .globl _sk_gather_g8_aarch64 @@ -2972,9 +2973,9 @@ FUNCTION(_sk_gather_i8_aarch64) _sk_gather_i8_aarch64: .long 0xaa0103e8 // mov x8, x1 .long 0xf8408429 // ldr x9, [x1], #8 - .long 0xb4000069 // cbz x9, 2858 <sk_gather_i8_aarch64+0x14> + .long 0xb4000069 // cbz x9, 285c <sk_gather_i8_aarch64+0x14> .long 0xaa0903ea // mov x10, x9 - .long 0x14000003 // b 2860 <sk_gather_i8_aarch64+0x1c> + .long 0x14000003 // b 2864 <sk_gather_i8_aarch64+0x1c> .long 0xf940050a // ldr x10, [x8, #8] .long 0x91004101 // add x1, x8, #0x10 .long 0xf8410548 // ldr x8, [x10], #16 @@ -3037,7 +3038,7 @@ _sk_load_565_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020508 // add x8, x8, x2, lsl #1 - .long 0xb50003c4 // cbnz x4, 29b4 <sk_load_565_aarch64+0x84> + .long 0xb50003c4 // cbnz x4, 29b8 <sk_load_565_aarch64+0x84> .long 0xfd400100 // ldr d0, [x8] .long 0x321b17e8 // orr w8, wzr, #0x7e0 .long 0x4e040d02 // dup v2.4s, w8 @@ -3070,18 +3071,18 @@ _sk_load_565_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e400 // movi d0, #0x0 - .long 0x54000140 // b.eq 29e8 <sk_load_565_aarch64+0xb8> // b.none + .long 0x54000140 // b.eq 29ec <sk_load_565_aarch64+0xb8> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 29e0 <sk_load_565_aarch64+0xb0> // b.none + .long 0x540000c0 // b.eq 29e4 <sk_load_565_aarch64+0xb0> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffba1 // b.ne 2944 <sk_load_565_aarch64+0x14> // b.any + .long 0x54fffba1 // b.ne 2948 <sk_load_565_aarch64+0x14> // b.any .long 0x91001109 // add x9, x8, #0x4 .long 0x0e020fe0 // dup v0.4h, wzr .long 0x0d405120 // ld1 {v0.h}[2], [x9] .long 0x91000909 // add x9, x8, #0x2 .long 0x0d404920 // ld1 {v0.h}[1], [x9] .long 0x0d404100 // ld1 {v0.h}[0], [x8] - .long 0x17ffffd6 // b 2944 <sk_load_565_aarch64+0x14> + .long 0x17ffffd6 // b 2948 <sk_load_565_aarch64+0x14> HIDDEN _sk_gather_565_aarch64 .globl _sk_gather_565_aarch64 @@ -3153,24 +3154,24 @@ _sk_store_565_aarch64: .long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b .long 0x8b020508 // add x8, x8, x2, lsl #1 .long 0x0e612a10 // xtn v16.4h, v16.4s - .long 0xb50000a4 // cbnz x4, 2af8 <sk_store_565_aarch64+0x58> + .long 0xb50000a4 // cbnz x4, 2afc <sk_store_565_aarch64+0x58> .long 0xfd000110 // str d16, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 - .long 0x54000120 // b.eq 2b24 <sk_store_565_aarch64+0x84> // b.none + .long 0x54000120 // b.eq 2b28 <sk_store_565_aarch64+0x84> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000a0 // b.eq 2b1c <sk_store_565_aarch64+0x7c> // b.none + .long 0x540000a0 // b.eq 2b20 <sk_store_565_aarch64+0x7c> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffee1 // b.ne 2aec <sk_store_565_aarch64+0x4c> // b.any + .long 0x54fffee1 // b.ne 2af0 <sk_store_565_aarch64+0x4c> // b.any .long 0x91001109 // add x9, x8, #0x4 .long 0x0d005130 // st1 {v16.h}[2], [x9] .long 0x91000909 // add x9, x8, #0x2 .long 0x0d004930 // st1 {v16.h}[1], [x9] .long 0x0d004110 // st1 {v16.h}[0], [x8] - .long 0x17fffff1 // b 2aec <sk_store_565_aarch64+0x4c> + .long 0x17fffff1 // b 2af0 <sk_store_565_aarch64+0x4c> HIDDEN _sk_load_4444_aarch64 .globl _sk_load_4444_aarch64 @@ -3179,7 +3180,7 @@ _sk_load_4444_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020508 // add x8, x8, x2, lsl #1 - .long 0xb5000444 // cbnz x4, 2bc0 <sk_load_4444_aarch64+0x94> + .long 0xb5000444 // cbnz x4, 2bc4 <sk_load_4444_aarch64+0x94> .long 0xfd400100 // ldr d0, [x8] .long 0x52a6f108 // mov w8, #0x37880000 .long 0x2f10a400 // uxtl v0.4s, v0.4h @@ -3216,18 +3217,18 @@ _sk_load_4444_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x2f00e400 // movi d0, #0x0 - .long 0x54000140 // b.eq 2bf4 <sk_load_4444_aarch64+0xc8> // b.none + .long 0x54000140 // b.eq 2bf8 <sk_load_4444_aarch64+0xc8> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 2bec <sk_load_4444_aarch64+0xc0> // b.none + .long 0x540000c0 // b.eq 2bf0 <sk_load_4444_aarch64+0xc0> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffb21 // b.ne 2b40 <sk_load_4444_aarch64+0x14> // b.any + .long 0x54fffb21 // b.ne 2b44 <sk_load_4444_aarch64+0x14> // b.any .long 0x91001109 // add x9, x8, #0x4 .long 0x0e020fe0 // dup v0.4h, wzr .long 0x0d405120 // ld1 {v0.h}[2], [x9] .long 0x91000909 // add x9, x8, #0x2 .long 0x0d404920 // ld1 {v0.h}[1], [x9] .long 0x0d404100 // ld1 {v0.h}[0], [x8] - .long 0x17ffffd2 // b 2b40 <sk_load_4444_aarch64+0x14> + .long 0x17ffffd2 // b 2b44 <sk_load_4444_aarch64+0x14> HIDDEN _sk_gather_4444_aarch64 .globl _sk_gather_4444_aarch64 @@ -3306,24 +3307,24 @@ _sk_store_4444_aarch64: .long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b .long 0x8b020508 // add x8, x8, x2, lsl #1 .long 0x0e612a10 // xtn v16.4h, v16.4s - .long 0xb50000a4 // cbnz x4, 2d20 <sk_store_4444_aarch64+0x60> + .long 0xb50000a4 // cbnz x4, 2d24 <sk_store_4444_aarch64+0x60> .long 0xfd000110 // str d16, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 - .long 0x54000120 // b.eq 2d4c <sk_store_4444_aarch64+0x8c> // b.none + .long 0x54000120 // b.eq 2d50 <sk_store_4444_aarch64+0x8c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000a0 // b.eq 2d44 <sk_store_4444_aarch64+0x84> // b.none + .long 0x540000a0 // b.eq 2d48 <sk_store_4444_aarch64+0x84> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffee1 // b.ne 2d14 <sk_store_4444_aarch64+0x54> // b.any + .long 0x54fffee1 // b.ne 2d18 <sk_store_4444_aarch64+0x54> // b.any .long 0x91001109 // add x9, x8, #0x4 .long 0x0d005130 // st1 {v16.h}[2], [x9] .long 0x91000909 // add x9, x8, #0x2 .long 0x0d004930 // st1 {v16.h}[1], [x9] .long 0x0d004110 // st1 {v16.h}[0], [x8] - .long 0x17fffff1 // b 2d14 <sk_store_4444_aarch64+0x54> + .long 0x17fffff1 // b 2d18 <sk_store_4444_aarch64+0x54> HIDDEN _sk_load_8888_aarch64 .globl _sk_load_8888_aarch64 @@ -3332,7 +3333,7 @@ _sk_load_8888_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020908 // add x8, x8, x2, lsl #2 - .long 0xb50002e4 // cbnz x4, 2dbc <sk_load_8888_aarch64+0x68> + .long 0xb50002e4 // cbnz x4, 2dc0 <sk_load_8888_aarch64+0x68> .long 0x3dc00100 // ldr q0, [x8] .long 0x6f00e621 // movi v1.2d, #0xff000000ff .long 0x52a77008 // mov w8, #0x3b800000 @@ -3358,18 +3359,18 @@ _sk_load_8888_aarch64: .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 .long 0x6f00e400 // movi v0.2d, #0x0 - .long 0x54000140 // b.eq 2df0 <sk_load_8888_aarch64+0x9c> // b.none + .long 0x54000140 // b.eq 2df4 <sk_load_8888_aarch64+0x9c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000c0 // b.eq 2de8 <sk_load_8888_aarch64+0x94> // b.none + .long 0x540000c0 // b.eq 2dec <sk_load_8888_aarch64+0x94> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffc81 // b.ne 2d68 <sk_load_8888_aarch64+0x14> // b.any + .long 0x54fffc81 // b.ne 2d6c <sk_load_8888_aarch64+0x14> // b.any .long 0x91002109 // add x9, x8, #0x8 .long 0x4e040fe0 // dup v0.4s, wzr .long 0x4d408120 // ld1 {v0.s}[2], [x9] .long 0x91001109 // add x9, x8, #0x4 .long 0x0d409120 // ld1 {v0.s}[1], [x9] .long 0x0d408100 // ld1 {v0.s}[0], [x8] - .long 0x17ffffdd // b 2d68 <sk_load_8888_aarch64+0x14> + .long 0x17ffffdd // b 2d6c <sk_load_8888_aarch64+0x14> HIDDEN _sk_gather_8888_aarch64 .globl _sk_gather_8888_aarch64 @@ -3437,24 +3438,24 @@ _sk_store_8888_aarch64: .long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b .long 0x8b020908 // add x8, x8, x2, lsl #2 .long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b - .long 0xb50000a4 // cbnz x4, 2ef0 <sk_store_8888_aarch64+0x60> + .long 0xb50000a4 // cbnz x4, 2ef4 <sk_store_8888_aarch64+0x60> .long 0x3d800110 // str q16, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0x12000489 // and w9, w4, #0x3 .long 0x7100053f // cmp w9, #0x1 - .long 0x54000120 // b.eq 2f1c <sk_store_8888_aarch64+0x8c> // b.none + .long 0x54000120 // b.eq 2f20 <sk_store_8888_aarch64+0x8c> // b.none .long 0x7100093f // cmp w9, #0x2 - .long 0x540000a0 // b.eq 2f14 <sk_store_8888_aarch64+0x84> // b.none + .long 0x540000a0 // b.eq 2f18 <sk_store_8888_aarch64+0x84> // b.none .long 0x71000d3f // cmp w9, #0x3 - .long 0x54fffee1 // b.ne 2ee4 <sk_store_8888_aarch64+0x54> // b.any + .long 0x54fffee1 // b.ne 2ee8 <sk_store_8888_aarch64+0x54> // b.any .long 0x91002109 // add x9, x8, #0x8 .long 0x4d008130 // st1 {v16.s}[2], [x9] .long 0x91001109 // add x9, x8, #0x4 .long 0x0d009130 // st1 {v16.s}[1], [x9] .long 0x0d008110 // st1 {v16.s}[0], [x8] - .long 0x17fffff1 // b 2ee4 <sk_store_8888_aarch64+0x54> + .long 0x17fffff1 // b 2ee8 <sk_store_8888_aarch64+0x54> HIDDEN _sk_load_f16_aarch64 .globl _sk_load_f16_aarch64 @@ -3463,7 +3464,7 @@ _sk_load_f16_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020d08 // add x8, x8, x2, lsl #3 - .long 0xb5000124 // cbnz x4, 2f54 <sk_load_f16_aarch64+0x30> + .long 0xb5000124 // cbnz x4, 2f58 <sk_load_f16_aarch64+0x30> .long 0x0c400510 // ld4 {v16.4h-v19.4h}, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x0e217a00 // fcvtl v0.4s, v16.4h @@ -3474,14 +3475,14 @@ _sk_load_f16_aarch64: .long 0xd61f00a0 // br x5 .long 0x0d606110 // ld4 {v16.h-v19.h}[0], [x8] .long 0xf100049f // cmp x4, #0x1 - .long 0x54fffee0 // b.eq 2f38 <sk_load_f16_aarch64+0x14> // b.none + .long 0x54fffee0 // b.eq 2f3c <sk_load_f16_aarch64+0x14> // b.none .long 0x91002109 // add x9, x8, #0x8 .long 0x0d606930 // ld4 {v16.h-v19.h}[1], [x9] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fffe63 // b.cc 2f38 <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last + .long 0x54fffe63 // b.cc 2f3c <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last .long 0x91004108 // add x8, x8, #0x10 .long 0x0d607110 // ld4 {v16.h-v19.h}[2], [x8] - .long 0x17fffff0 // b 2f38 <sk_load_f16_aarch64+0x14> + .long 0x17fffff0 // b 2f3c <sk_load_f16_aarch64+0x14> HIDDEN _sk_gather_f16_aarch64 .globl _sk_gather_f16_aarch64 @@ -3535,21 +3536,21 @@ _sk_store_f16_aarch64: .long 0xf9400108 // ldr x8, [x8] .long 0x0e216873 // fcvtn v19.4h, v3.4s .long 0x8b020d08 // add x8, x8, x2, lsl #3 - .long 0xb50000a4 // cbnz x4, 303c <sk_store_f16_aarch64+0x30> + .long 0xb50000a4 // cbnz x4, 3040 <sk_store_f16_aarch64+0x30> .long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0xf100049f // cmp x4, #0x1 .long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8] - .long 0x54ffff60 // b.eq 3030 <sk_store_f16_aarch64+0x24> // b.none + .long 0x54ffff60 // b.eq 3034 <sk_store_f16_aarch64+0x24> // b.none .long 0x91002109 // add x9, x8, #0x8 .long 0xf1000c9f // cmp x4, #0x3 .long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9] - .long 0x54fffee3 // b.cc 3030 <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last + .long 0x54fffee3 // b.cc 3034 <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last .long 0x91004108 // add x8, x8, #0x10 .long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8] - .long 0x17fffff4 // b 3030 <sk_store_f16_aarch64+0x24> + .long 0x17fffff4 // b 3034 <sk_store_f16_aarch64+0x24> HIDDEN _sk_load_u16_be_aarch64 .globl _sk_load_u16_be_aarch64 @@ -3558,7 +3559,7 @@ _sk_load_u16_be_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b020d08 // add x8, x8, x2, lsl #3 - .long 0xb5000404 // cbnz x4, 30f0 <sk_load_u16_be_aarch64+0x8c> + .long 0xb5000404 // cbnz x4, 30f4 <sk_load_u16_be_aarch64+0x8c> .long 0x0c400500 // ld4 {v0.4h-v3.4h}, [x8] .long 0x0f185410 // shl v16.4h, v0.4h, #8 .long 0x2f180411 // ushr v17.4h, v0.4h, #8 @@ -3592,14 +3593,14 @@ _sk_load_u16_be_aarch64: .long 0xd61f00a0 // br x5 .long 0x0d606100 // ld4 {v0.h-v3.h}[0], [x8] .long 0xf100049f // cmp x4, #0x1 - .long 0x54fffc00 // b.eq 3078 <sk_load_u16_be_aarch64+0x14> // b.none + .long 0x54fffc00 // b.eq 307c <sk_load_u16_be_aarch64+0x14> // b.none .long 0x91002109 // add x9, x8, #0x8 .long 0x0d606920 // ld4 {v0.h-v3.h}[1], [x9] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fffb83 // b.cc 3078 <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last + .long 0x54fffb83 // b.cc 307c <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last .long 0x91004108 // add x8, x8, #0x10 .long 0x0d607100 // ld4 {v0.h-v3.h}[2], [x8] - .long 0x17ffffd9 // b 3078 <sk_load_u16_be_aarch64+0x14> + .long 0x17ffffd9 // b 307c <sk_load_u16_be_aarch64+0x14> HIDDEN _sk_load_rgb_u16_be_aarch64 .globl _sk_load_rgb_u16_be_aarch64 @@ -3609,7 +3610,7 @@ _sk_load_rgb_u16_be_aarch64: .long 0x321f07e9 // orr w9, wzr, #0x6 .long 0xf9400108 // ldr x8, [x8] .long 0x9b092048 // madd x8, x2, x9, x8 - .long 0xb5000384 // cbnz x4, 3198 <sk_load_rgb_u16_be_aarch64+0x80> + .long 0xb5000384 // cbnz x4, 319c <sk_load_rgb_u16_be_aarch64+0x80> .long 0x0c404500 // ld3 {v0.4h-v2.4h}, [x8] .long 0x0f185403 // shl v3.4h, v0.4h, #8 .long 0x2f180410 // ushr v16.4h, v0.4h, #8 @@ -3639,14 +3640,14 @@ _sk_load_rgb_u16_be_aarch64: .long 0xd61f00a0 // br x5 .long 0x0d406100 // ld3 {v0.h-v2.h}[0], [x8] .long 0xf100049f // cmp x4, #0x1 - .long 0x54fffc80 // b.eq 3130 <sk_load_rgb_u16_be_aarch64+0x18> // b.none + .long 0x54fffc80 // b.eq 3134 <sk_load_rgb_u16_be_aarch64+0x18> // b.none .long 0x91001909 // add x9, x8, #0x6 .long 0x0d406920 // ld3 {v0.h-v2.h}[1], [x9] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fffc03 // b.cc 3130 <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last + .long 0x54fffc03 // b.cc 3134 <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last .long 0x91003108 // add x8, x8, #0xc .long 0x0d407100 // ld3 {v0.h-v2.h}[2], [x8] - .long 0x17ffffdd // b 3130 <sk_load_rgb_u16_be_aarch64+0x18> + .long 0x17ffffdd // b 3134 <sk_load_rgb_u16_be_aarch64+0x18> HIDDEN _sk_store_u16_be_aarch64 .globl _sk_store_u16_be_aarch64 @@ -3682,21 +3683,21 @@ _sk_store_u16_be_aarch64: .long 0x2f180694 // ushr v20.4h, v20.4h, #8 .long 0x8b020d08 // add x8, x8, x2, lsl #3 .long 0x0eb41eb3 // orr v19.8b, v21.8b, v20.8b - .long 0xb50000a4 // cbnz x4, 324c <sk_store_u16_be_aarch64+0x8c> + .long 0xb50000a4 // cbnz x4, 3250 <sk_store_u16_be_aarch64+0x8c> .long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0xf100049f // cmp x4, #0x1 .long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8] - .long 0x54ffff60 // b.eq 3240 <sk_store_u16_be_aarch64+0x80> // b.none + .long 0x54ffff60 // b.eq 3244 <sk_store_u16_be_aarch64+0x80> // b.none .long 0x91002109 // add x9, x8, #0x8 .long 0xf1000c9f // cmp x4, #0x3 .long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9] - .long 0x54fffee3 // b.cc 3240 <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last + .long 0x54fffee3 // b.cc 3244 <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last .long 0x91004108 // add x8, x8, #0x10 .long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8] - .long 0x17fffff4 // b 3240 <sk_store_u16_be_aarch64+0x80> + .long 0x17fffff4 // b 3244 <sk_store_u16_be_aarch64+0x80> HIDDEN _sk_load_f32_aarch64 .globl _sk_load_f32_aarch64 @@ -3705,21 +3706,21 @@ _sk_load_f32_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b021108 // add x8, x8, x2, lsl #4 - .long 0xb50000a4 // cbnz x4, 3294 <sk_load_f32_aarch64+0x20> + .long 0xb50000a4 // cbnz x4, 3298 <sk_load_f32_aarch64+0x20> .long 0x4c400900 // ld4 {v0.4s-v3.4s}, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0x0d60a100 // ld4 {v0.s-v3.s}[0], [x8] .long 0xf100049f // cmp x4, #0x1 - .long 0x54ffff60 // b.eq 3288 <sk_load_f32_aarch64+0x14> // b.none + .long 0x54ffff60 // b.eq 328c <sk_load_f32_aarch64+0x14> // b.none .long 0x91004109 // add x9, x8, #0x10 .long 0x0d60b120 // ld4 {v0.s-v3.s}[1], [x9] .long 0xf1000c9f // cmp x4, #0x3 - .long 0x54fffee3 // b.cc 3288 <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last + .long 0x54fffee3 // b.cc 328c <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last .long 0x91008108 // add x8, x8, #0x20 .long 0x4d60a100 // ld4 {v0.s-v3.s}[2], [x8] - .long 0x17fffff4 // b 3288 <sk_load_f32_aarch64+0x14> + .long 0x17fffff4 // b 328c <sk_load_f32_aarch64+0x14> HIDDEN _sk_store_f32_aarch64 .globl _sk_store_f32_aarch64 @@ -3728,21 +3729,21 @@ _sk_store_f32_aarch64: .long 0xf9400028 // ldr x8, [x1] .long 0xf9400108 // ldr x8, [x8] .long 0x8b021108 // add x8, x8, x2, lsl #4 - .long 0xb50000a4 // cbnz x4, 32dc <sk_store_f32_aarch64+0x20> + .long 0xb50000a4 // cbnz x4, 32e0 <sk_store_f32_aarch64+0x20> .long 0x4c000900 // st4 {v0.4s-v3.4s}, [x8] .long 0xf9400425 // ldr x5, [x1, #8] .long 0x91004021 // add x1, x1, #0x10 .long 0xd61f00a0 // br x5 .long 0xf100049f // cmp x4, #0x1 .long 0x0d20a100 // st4 {v0.s-v3.s}[0], [x8] - .long 0x54ffff60 // b.eq 32d0 <sk_store_f32_aarch64+0x14> // b.none + .long 0x54ffff60 // b.eq 32d4 <sk_store_f32_aarch64+0x14> // b.none .long 0x91004109 // add x9, x8, #0x10 .long 0xf1000c9f // cmp x4, #0x3 .long 0x0d20b120 // st4 {v0.s-v3.s}[1], [x9] - .long 0x54fffee3 // b.cc 32d0 <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last + .long 0x54fffee3 // b.cc 32d4 <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last .long 0x91008108 // add x8, x8, #0x20 .long 0x4d20a100 // st4 {v0.s-v3.s}[2], [x8] - .long 0x17fffff4 // b 32d0 <sk_store_f32_aarch64+0x14> + .long 0x17fffff4 // b 32d4 <sk_store_f32_aarch64+0x14> HIDDEN _sk_clamp_x_aarch64 .globl _sk_clamp_x_aarch64 @@ -4183,7 +4184,7 @@ _sk_gradient_aarch64: .long 0x6f00e411 // movi v17.2d, #0x0 .long 0xf9400109 // ldr x9, [x8] .long 0xf100093f // cmp x9, #0x2 - .long 0x540001c3 // b.cc 38b4 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last + .long 0x540001c3 // b.cc 38b8 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last .long 0xf940250a // ldr x10, [x8, #72] .long 0xd1000529 // sub x9, x9, #0x1 .long 0x6f00e401 // movi v1.2d, #0x0 @@ -4194,7 +4195,7 @@ _sk_gradient_aarch64: .long 0x6e23e403 // fcmge v3.4s, v0.4s, v3.4s .long 0x4e221c63 // and v3.16b, v3.16b, v2.16b .long 0x4ea18461 // add v1.4s, v3.4s, v1.4s - .long 0xb5ffff69 // cbnz x9, 3894 <sk_gradient_aarch64+0x38> + .long 0xb5ffff69 // cbnz x9, 3898 <sk_gradient_aarch64+0x38> .long 0x6f20a431 // uxtl2 v17.2d, v1.4s .long 0x2f20a421 // uxtl v1.2d, v1.2s .long 0xa940b10a // ldp x10, x12, [x8, #8] @@ -4655,10 +4656,10 @@ HIDDEN _sk_callback_aarch64 FUNCTION(_sk_callback_aarch64) _sk_callback_aarch64: .long 0xd10203ff // sub sp, sp, #0x80 - .long 0xf90023f8 // str x24, [sp, #64] - .long 0xa9055bf7 // stp x23, x22, [sp, #80] - .long 0xa90653f5 // stp x21, x20, [sp, #96] - .long 0xa9077bf3 // stp x19, x30, [sp, #112] + .long 0xa9045ff8 // stp x24, x23, [sp, #64] + .long 0xa90557f6 // stp x22, x21, [sp, #80] + .long 0xa9064ff4 // stp x20, x19, [sp, #96] + .long 0xa9077bfd // stp x29, x30, [sp, #112] .long 0xad011fe6 // stp q6, q7, [sp, #32] .long 0xad0017e4 // stp q4, q5, [sp] .long 0xaa0103f6 // mov x22, x1 @@ -4672,6 +4673,7 @@ _sk_callback_aarch64: .long 0xaa0003f7 // mov x23, x0 .long 0x1a891261 // csel w1, w19, w9, ne // ne = any .long 0xaa1803e0 // mov x0, x24 + .long 0x9101c3fd // add x29, sp, #0x70 .long 0xaa0303f4 // mov x20, x3 .long 0xaa0203f5 // mov x21, x2 .long 0xd63f0100 // blr x8 @@ -4685,10 +4687,10 @@ _sk_callback_aarch64: .long 0xaa1303e4 // mov x4, x19 .long 0xad4017e4 // ldp q4, q5, [sp] .long 0xad411fe6 // ldp q6, q7, [sp, #32] - .long 0xa9477bf3 // ldp x19, x30, [sp, #112] - .long 0xa94653f5 // ldp x21, x20, [sp, #96] - .long 0xa9455bf7 // ldp x23, x22, [sp, #80] - .long 0xf94023f8 // ldr x24, [sp, #64] + .long 0xa9477bfd // ldp x29, x30, [sp, #112] + .long 0xa9464ff4 // ldp x20, x19, [sp, #96] + .long 0xa94557f6 // ldp x22, x21, [sp, #80] + .long 0xa9445ff8 // ldp x24, x23, [sp, #64] .long 0x910203ff // add sp, sp, #0x80 .long 0xd61f00a0 // br x5 #elif defined(__arm__) @@ -4698,17 +4700,18 @@ HIDDEN _sk_start_pipeline_vfp4 .globl _sk_start_pipeline_vfp4 FUNCTION(_sk_start_pipeline_vfp4) _sk_start_pipeline_vfp4: - .long 0xe92d47f0 // push {r4, r5, r6, r7, r8, r9, sl, lr} - .long 0xe24dd008 // sub sp, sp, #8 + .long 0xe92d4ff0 // push {r4, r5, r6, r7, r8, r9, sl, fp, lr} + .long 0xe28db01c // add fp, sp, #28 + .long 0xe24dd004 // sub sp, sp, #4 .long 0xe1a04003 // mov r4, r3 - .long 0xe59d8028 // ldr r8, [sp, #40] + .long 0xe59b8008 // ldr r8, [fp, #8] .long 0xe4949004 // ldr r9, [r4], #4 .long 0xe1a06000 // mov r6, r0 .long 0xe2860002 // add r0, r6, #2 .long 0xe1a07002 // mov r7, r2 .long 0xe1a05001 // mov r5, r1 .long 0xe1500007 // cmp r0, r7 - .long 0x8a000012 // bhi 78 <sk_start_pipeline_vfp4+0x78> + .long 0x8a000012 // bhi 7c <sk_start_pipeline_vfp4+0x7c> .long 0xe3a0a000 // mov sl, #0 .long 0xf2800010 // vmov.i32 d0, #0 .long 0xe1a00008 // mov r0, r8 @@ -4727,9 +4730,9 @@ _sk_start_pipeline_vfp4: .long 0xe2860004 // add r0, r6, #4 .long 0xe2866002 // add r6, r6, #2 .long 0xe1500007 // cmp r0, r7 - .long 0x9affffed // bls 30 <sk_start_pipeline_vfp4+0x30> + .long 0x9affffed // bls 34 <sk_start_pipeline_vfp4+0x34> .long 0xe0570006 // subs r0, r7, r6 - .long 0x0a00000d // beq b8 <sk_start_pipeline_vfp4+0xb8> + .long 0x0a00000d // beq bc <sk_start_pipeline_vfp4+0xbc> .long 0xf2800010 // vmov.i32 d0, #0 .long 0xe58d0000 // str r0, [sp] .long 0xf2801010 // vmov.i32 d1, #0 @@ -4744,8 +4747,8 @@ _sk_start_pipeline_vfp4: .long 0xf2806010 // vmov.i32 d6, #0 .long 0xf2807010 // vmov.i32 d7, #0 .long 0xe12fff39 // blx r9 - .long 0xe28dd008 // add sp, sp, #8 - .long 0xe8bd87f0 // pop {r4, r5, r6, r7, r8, r9, sl, pc} + .long 0xe24bd01c // sub sp, fp, #28 + .long 0xe8bd8ff0 // pop {r4, r5, r6, r7, r8, r9, sl, fp, pc} HIDDEN _sk_just_return_vfp4 .globl _sk_just_return_vfp4 @@ -4774,6 +4777,7 @@ _sk_seed_shader_vfp4: .long 0xf2806010 // vmov.i32 d6, #0 .long 0xf2807010 // vmov.i32 d7, #0 .long 0xe12fff1c // bx ip + .long 0xe320f000 // nop {0} HIDDEN _sk_dither_vfp4 .globl _sk_dither_vfp4 @@ -6102,7 +6106,7 @@ _sk_srcover_rgba_8888_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc102 // add ip, ip, r2, lsl #2 - .long 0x0a00002c // beq 1400 <sk_srcover_rgba_8888_vfp4+0xd0> + .long 0x0a00002c // beq 1408 <sk_srcover_rgba_8888_vfp4+0xd0> .long 0xed9c4b00 // vldr d4, [ip] .long 0xf2c71f10 // vmov.f32 d17, #1 .long 0xeddf6b2f // vldr d22, [pc, #188] @@ -6142,7 +6146,7 @@ _sk_srcover_rgba_8888_vfp4: .long 0xf2f00530 // vshl.s32 d16, d16, #16 .long 0xf26111b2 // vorr d17, d17, d18 .long 0xf26101b0 // vorr d16, d17, d16 - .long 0x0a000007 // beq 140c <sk_srcover_rgba_8888_vfp4+0xdc> + .long 0x0a000007 // beq 1414 <sk_srcover_rgba_8888_vfp4+0xdc> .long 0xedcc0b00 // vstr d16, [ip] .long 0xe591c004 // ldr ip, [r1, #4] .long 0xe2811008 // add r1, r1, #8 @@ -6150,9 +6154,9 @@ _sk_srcover_rgba_8888_vfp4: .long 0xe12fff1c // bx ip .long 0xeddf4a06 // vldr s9, [pc, #24] .long 0xed9c4a00 // vldr s8, [ip] - .long 0xeaffffd0 // b 1350 <sk_srcover_rgba_8888_vfp4+0x20> + .long 0xeaffffd0 // b 1358 <sk_srcover_rgba_8888_vfp4+0x20> .long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32] - .long 0xeafffff6 // b 13f0 <sk_srcover_rgba_8888_vfp4+0xc0> + .long 0xeafffff6 // b 13f8 <sk_srcover_rgba_8888_vfp4+0xc0> .long 0xe320f000 // nop {0} .long 0x437f0000 // .word 0x437f0000 .long 0x437f0000 // .word 0x437f0000 @@ -6596,7 +6600,7 @@ _sk_scale_u8_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc002 // add ip, ip, r2 - .long 0x0a000014 // beq 1a18 <sk_scale_u8_vfp4+0x78> + .long 0x0a000014 // beq 1a20 <sk_scale_u8_vfp4+0x78> .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xe1cdc0b4 // strh ip, [sp, #4] .long 0xe28dc004 // add ip, sp, #4 @@ -6621,7 +6625,7 @@ _sk_scale_u8_vfp4: .long 0xe5dcc000 // ldrb ip, [ip] .long 0xeddf8a03 // vldr s17, [pc, #12] .long 0xee08ca10 // vmov s16, ip - .long 0xeaffffec // b 19dc <sk_scale_u8_vfp4+0x3c> + .long 0xeaffffec // b 19e4 <sk_scale_u8_vfp4+0x3c> .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 .long 0x00000000 // .word 0x00000000 @@ -6662,7 +6666,7 @@ _sk_lerp_u8_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc002 // add ip, ip, r2 - .long 0x0a00001e // beq 1b20 <sk_lerp_u8_vfp4+0xa0> + .long 0x0a00001e // beq 1b28 <sk_lerp_u8_vfp4+0xa0> .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xe1cdc0b4 // strh ip, [sp, #4] .long 0xe28dc004 // add ip, sp, #4 @@ -6697,7 +6701,7 @@ _sk_lerp_u8_vfp4: .long 0xe5dcc000 // ldrb ip, [ip] .long 0xeddf8a03 // vldr s17, [pc, #12] .long 0xee08ca10 // vmov s16, ip - .long 0xeaffffe2 // b 1abc <sk_lerp_u8_vfp4+0x3c> + .long 0xeaffffe2 // b 1ac4 <sk_lerp_u8_vfp4+0x3c> .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 .long 0x00000000 // .word 0x00000000 @@ -6715,7 +6719,7 @@ _sk_lerp_565_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc082 // add ip, ip, r2, lsl #1 - .long 0x0a00002e // beq 1c20 <sk_lerp_565_vfp4+0xe0> + .long 0x0a00002e // beq 1c28 <sk_lerp_565_vfp4+0xe0> .long 0xe59cc000 // ldr ip, [ip] .long 0xe58dc004 // str ip, [sp, #4] .long 0xe28dc004 // add ip, sp, #4 @@ -6766,7 +6770,7 @@ _sk_lerp_565_vfp4: .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xeddf8a07 // vldr s17, [pc, #28] .long 0xee08ca10 // vmov s16, ip - .long 0xeaffffd1 // b 1b78 <sk_lerp_565_vfp4+0x38> + .long 0xeaffffd1 // b 1b80 <sk_lerp_565_vfp4+0x38> .long 0x3d042108 // .word 0x3d042108 .long 0x3d042108 // .word 0x3d042108 .long 0x3a020821 // .word 0x3a020821 @@ -6786,7 +6790,7 @@ _sk_load_tables_vfp4: .long 0xe59ce000 // ldr lr, [ip] .long 0xe3540001 // cmp r4, #1 .long 0xe08ee102 // add lr, lr, r2, lsl #2 - .long 0x0a000023 // beq 1cfc <sk_load_tables_vfp4+0xac> + .long 0x0a000023 // beq 1d04 <sk_load_tables_vfp4+0xac> .long 0xed9e0b00 // vldr d0, [lr] .long 0xf3c7001f // vmov.i32 d16, #255 .long 0xe59c7004 // ldr r7, [ip, #4] @@ -6825,7 +6829,7 @@ _sk_load_tables_vfp4: .long 0xe12fff1c // bx ip .long 0xeddf0a03 // vldr s1, [pc, #12] .long 0xed9e0a00 // vldr s0, [lr] - .long 0xeaffffd9 // b 1c70 <sk_load_tables_vfp4+0x20> + .long 0xeaffffd9 // b 1c78 <sk_load_tables_vfp4+0x20> .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 .long 0x00000000 // .word 0x00000000 @@ -6842,7 +6846,7 @@ _sk_load_tables_u16_be_vfp4: .long 0xe3540000 // cmp r4, #0 .long 0xe08ee182 // add lr, lr, r2, lsl #3 .long 0xf4ee070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [lr] - .long 0x1a000001 // bne 1d40 <sk_load_tables_u16_be_vfp4+0x28> + .long 0x1a000001 // bne 1d48 <sk_load_tables_u16_be_vfp4+0x28> .long 0xe28e4008 // add r4, lr, #8 .long 0xf4e4074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [r4] .long 0xee924bb0 // vmov.u16 r4, d18[0] @@ -6914,7 +6918,7 @@ _sk_load_tables_rgb_u16_be_vfp4: .long 0xe59d4020 // ldr r4, [sp, #32] .long 0xf4ee060f // vld3.16 {d16[0],d17[0],d18[0]}, [lr] .long 0xe3540000 // cmp r4, #0 - .long 0x1a000001 // bne 1e4c <sk_load_tables_rgb_u16_be_vfp4+0x2c> + .long 0x1a000001 // bne 1e54 <sk_load_tables_rgb_u16_be_vfp4+0x2c> .long 0xe28e4006 // add r4, lr, #6 .long 0xf4e4064f // vld3.16 {d16[1],d17[1],d18[1]}, [r4] .long 0xee924bb0 // vmov.u16 r4, d18[0] @@ -7629,7 +7633,7 @@ _sk_load_a8_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc002 // add ip, ip, r2 - .long 0x0a000012 // beq 28cc <sk_load_a8_vfp4+0x6c> + .long 0x0a000012 // beq 28d4 <sk_load_a8_vfp4+0x6c> .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xe1cdc0b0 // strh ip, [sp] .long 0xe1a0c00d // mov ip, sp @@ -7652,7 +7656,7 @@ _sk_load_a8_vfp4: .long 0xe5dcc000 // ldrb ip, [ip] .long 0xeddf0a04 // vldr s1, [pc, #16] .long 0xee00ca10 // vmov s0, ip - .long 0xeaffffee // b 2898 <sk_load_a8_vfp4+0x38> + .long 0xeaffffee // b 28a0 <sk_load_a8_vfp4+0x38> .long 0xe320f000 // nop {0} .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 @@ -7706,7 +7710,7 @@ _sk_store_a8_vfp4: .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc002 // add ip, ip, r2 .long 0xf3fb07a1 // vcvt.u32.f32 d16, d17 - .long 0x0a000007 // beq 29ac <sk_store_a8_vfp4+0x4c> + .long 0x0a000007 // beq 29b4 <sk_store_a8_vfp4+0x4c> .long 0xee30eb90 // vmov.32 lr, d16[1] .long 0xee104b90 // vmov.32 r4, d16[0] .long 0xe5cce001 // strb lr, [ip, #1] @@ -7717,7 +7721,7 @@ _sk_store_a8_vfp4: .long 0xe12fff1c // bx ip .long 0xee10eb90 // vmov.32 lr, d16[0] .long 0xe5cce000 // strb lr, [ip] - .long 0xeafffff8 // b 299c <sk_store_a8_vfp4+0x3c> + .long 0xeafffff8 // b 29a4 <sk_store_a8_vfp4+0x3c> .long 0x437f0000 // .word 0x437f0000 .long 0x437f0000 // .word 0x437f0000 @@ -7732,7 +7736,7 @@ _sk_load_g8_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc002 // add ip, ip, r2 - .long 0x0a000012 // beq 2a2c <sk_load_g8_vfp4+0x6c> + .long 0x0a000012 // beq 2a34 <sk_load_g8_vfp4+0x6c> .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xe1cdc0b0 // strh ip, [sp] .long 0xe1a0c00d // mov ip, sp @@ -7755,7 +7759,7 @@ _sk_load_g8_vfp4: .long 0xe5dcc000 // ldrb ip, [ip] .long 0xeddf0a04 // vldr s1, [pc, #16] .long 0xee00ca10 // vmov s0, ip - .long 0xeaffffee // b 29f8 <sk_load_g8_vfp4+0x38> + .long 0xeaffffee // b 2a00 <sk_load_g8_vfp4+0x38> .long 0xe320f000 // nop {0} .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 @@ -7859,7 +7863,7 @@ _sk_load_565_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc082 // add ip, ip, r2, lsl #1 - .long 0x0a00001a // beq 2c0c <sk_load_565_vfp4+0x8c> + .long 0x0a00001a // beq 2c14 <sk_load_565_vfp4+0x8c> .long 0xe59cc000 // ldr ip, [ip] .long 0xe58dc000 // str ip, [sp] .long 0xe1a0c00d // mov ip, sp @@ -7890,7 +7894,7 @@ _sk_load_565_vfp4: .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xeddf0a08 // vldr s1, [pc, #32] .long 0xee00ca10 // vmov s0, ip - .long 0xeaffffe5 // b 2bb4 <sk_load_565_vfp4+0x34> + .long 0xeaffffe5 // b 2bbc <sk_load_565_vfp4+0x34> .long 0xe320f000 // nop {0} .long 0x37842108 // .word 0x37842108 .long 0x37842108 // .word 0x37842108 @@ -7973,7 +7977,7 @@ _sk_store_565_vfp4: .long 0xf2eb1531 // vshl.s32 d17, d17, #11 .long 0xf26001b1 // vorr d16, d16, d17 .long 0xf26001b2 // vorr d16, d16, d18 - .long 0x0a000005 // beq 2d58 <sk_store_565_vfp4+0x70> + .long 0x0a000005 // beq 2d60 <sk_store_565_vfp4+0x70> .long 0xf3f60121 // vuzp.16 d16, d17 .long 0xf4cc080f // vst1.32 {d16[0]}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] @@ -7982,7 +7986,7 @@ _sk_store_565_vfp4: .long 0xe12fff1c // bx ip .long 0xee10eb90 // vmov.32 lr, d16[0] .long 0xe1cce0b0 // strh lr, [ip] - .long 0xeafffff8 // b 2d48 <sk_store_565_vfp4+0x60> + .long 0xeafffff8 // b 2d50 <sk_store_565_vfp4+0x60> .long 0xe320f000 // nop {0} .long 0x427c0000 // .word 0x427c0000 .long 0x427c0000 // .word 0x427c0000 @@ -7998,7 +8002,7 @@ _sk_load_4444_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc082 // add ip, ip, r2, lsl #1 - .long 0x0a00001d // beq 2e08 <sk_load_4444_vfp4+0x98> + .long 0x0a00001d // beq 2e10 <sk_load_4444_vfp4+0x98> .long 0xe59cc000 // ldr ip, [ip] .long 0xe58dc000 // str ip, [sp] .long 0xe1a0c00d // mov ip, sp @@ -8032,7 +8036,7 @@ _sk_load_4444_vfp4: .long 0xe1dcc0b0 // ldrh ip, [ip] .long 0xeddf0a09 // vldr s1, [pc, #36] .long 0xee00ca10 // vmov s0, ip - .long 0xeaffffe2 // b 2da4 <sk_load_4444_vfp4+0x34> + .long 0xeaffffe2 // b 2dac <sk_load_4444_vfp4+0x34> .long 0x37888889 // .word 0x37888889 .long 0x37888889 // .word 0x37888889 .long 0x39888889 // .word 0x39888889 @@ -8126,7 +8130,7 @@ _sk_store_4444_vfp4: .long 0xf26201b0 // vorr d16, d18, d16 .long 0xf26001b3 // vorr d16, d16, d19 .long 0xf26001b1 // vorr d16, d16, d17 - .long 0x0a000005 // beq 2f80 <sk_store_4444_vfp4+0x80> + .long 0x0a000005 // beq 2f88 <sk_store_4444_vfp4+0x80> .long 0xf3f60121 // vuzp.16 d16, d17 .long 0xf4cc080f // vst1.32 {d16[0]}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] @@ -8135,7 +8139,7 @@ _sk_store_4444_vfp4: .long 0xe12fff1c // bx ip .long 0xee10eb90 // vmov.32 lr, d16[0] .long 0xe1cce0b0 // strh lr, [ip] - .long 0xeafffff8 // b 2f70 <sk_store_4444_vfp4+0x70> + .long 0xeafffff8 // b 2f78 <sk_store_4444_vfp4+0x70> .long 0xe320f000 // nop {0} HIDDEN _sk_load_8888_vfp4 @@ -8148,7 +8152,7 @@ _sk_load_8888_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0001 // cmp lr, #1 .long 0xe08cc102 // add ip, ip, r2, lsl #2 - .long 0x0a000014 // beq 3000 <sk_load_8888_vfp4+0x70> + .long 0x0a000014 // beq 3008 <sk_load_8888_vfp4+0x70> .long 0xed9c0b00 // vldr d0, [ip] .long 0xf3c7001f // vmov.i32 d16, #255 .long 0xe591c004 // ldr ip, [r1, #4] @@ -8172,7 +8176,7 @@ _sk_load_8888_vfp4: .long 0xe12fff1c // bx ip .long 0xeddf0a04 // vldr s1, [pc, #16] .long 0xed9c0a00 // vldr s0, [ip] - .long 0xeaffffe8 // b 2fb0 <sk_load_8888_vfp4+0x20> + .long 0xeaffffe8 // b 2fb8 <sk_load_8888_vfp4+0x20> .long 0xe320f000 // nop {0} .long 0x3b808081 // .word 0x3b808081 .long 0x3b808081 // .word 0x3b808081 @@ -8249,14 +8253,14 @@ _sk_store_8888_vfp4: .long 0xf2f81533 // vshl.s32 d17, d19, #24 .long 0xf26001b2 // vorr d16, d16, d18 .long 0xf26001b1 // vorr d16, d16, d17 - .long 0x0a000004 // beq 312c <sk_store_8888_vfp4+0x7c> + .long 0x0a000004 // beq 3134 <sk_store_8888_vfp4+0x7c> .long 0xedcc0b00 // vstr d16, [ip] .long 0xe591c004 // ldr ip, [r1, #4] .long 0xe2811008 // add r1, r1, #8 .long 0xe8bd4800 // pop {fp, lr} .long 0xe12fff1c // bx ip .long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32] - .long 0xeafffff9 // b 311c <sk_store_8888_vfp4+0x6c> + .long 0xeafffff9 // b 3124 <sk_store_8888_vfp4+0x6c> .long 0xe320f000 // nop {0} .long 0x437f0000 // .word 0x437f0000 .long 0x437f0000 // .word 0x437f0000 @@ -8272,7 +8276,7 @@ _sk_load_f16_vfp4: .long 0xe35e0000 // cmp lr, #0 .long 0xe08cc182 // add ip, ip, r2, lsl #3 .long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip] - .long 0x1a000001 // bne 3168 <sk_load_f16_vfp4+0x28> + .long 0x1a000001 // bne 3170 <sk_load_f16_vfp4+0x28> .long 0xe28cc008 // add ip, ip, #8 .long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip] .long 0xf3b60720 // vcvt.f32.f16 q0, d16 @@ -8342,7 +8346,7 @@ _sk_store_f16_vfp4: .long 0xf3f65622 // vcvt.f16.f32 d21, q9 .long 0xf3f64600 // vcvt.f16.f32 d20, q0 .long 0xf4cc470f // vst4.16 {d20[0],d21[0],d22[0],d23[0]}, [ip] - .long 0x1a000001 // bne 3258 <sk_store_f16_vfp4+0x40> + .long 0x1a000001 // bne 3260 <sk_store_f16_vfp4+0x40> .long 0xe28cc008 // add ip, ip, #8 .long 0xf4cc474f // vst4.16 {d20[1],d21[1],d22[1],d23[1]}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] @@ -8363,7 +8367,7 @@ _sk_load_u16_be_vfp4: .long 0xe35e0000 // cmp lr, #0 .long 0xe08cc182 // add ip, ip, r2, lsl #3 .long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip] - .long 0x1a000001 // bne 3298 <sk_load_u16_be_vfp4+0x28> + .long 0x1a000001 // bne 32a0 <sk_load_u16_be_vfp4+0x28> .long 0xe28cc008 // add ip, ip, #8 .long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip] .long 0xee90cbb0 // vmov.u16 ip, d16[0] @@ -8431,7 +8435,7 @@ _sk_load_rgb_u16_be_vfp4: .long 0xe59de018 // ldr lr, [sp, #24] .long 0xf4ec060f // vld3.16 {d16[0],d17[0],d18[0]}, [ip] .long 0xe35e0000 // cmp lr, #0 - .long 0x1a000001 // bne 3394 <sk_load_rgb_u16_be_vfp4+0x2c> + .long 0x1a000001 // bne 339c <sk_load_rgb_u16_be_vfp4+0x2c> .long 0xe28cc006 // add ip, ip, #6 .long 0xf4ec064f // vld3.16 {d16[1],d17[1],d18[1]}, [ip] .long 0xee90cbb0 // vmov.u16 ip, d16[0] @@ -8523,7 +8527,7 @@ _sk_store_u16_be_vfp4: .long 0xe35e0000 // cmp lr, #0 .long 0xf3f60124 // vuzp.16 d16, d20 .long 0xf4cc070f // vst4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip] - .long 0x1a000001 // bne 34f0 <sk_store_u16_be_vfp4+0xb0> + .long 0x1a000001 // bne 34f8 <sk_store_u16_be_vfp4+0xb0> .long 0xe28cc008 // add ip, ip, #8 .long 0xf4cc074f // vst4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] @@ -8543,14 +8547,14 @@ _sk_load_f32_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0000 // cmp lr, #0 .long 0xe08cc202 // add ip, ip, r2, lsl #4 - .long 0x1a000004 // bne 3538 <sk_load_f32_vfp4+0x30> + .long 0x1a000004 // bne 3540 <sk_load_f32_vfp4+0x30> .long 0xf42c008f // vld4.32 {d0-d3}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] .long 0xe2811008 // add r1, r1, #8 .long 0xe8bd4800 // pop {fp, lr} .long 0xe12fff1c // bx ip .long 0xf4ac0f8f // vld4.32 {d0[]-d3[]}, [ip] - .long 0xeafffff9 // b 3528 <sk_load_f32_vfp4+0x20> + .long 0xeafffff9 // b 3530 <sk_load_f32_vfp4+0x20> HIDDEN _sk_store_f32_vfp4 .globl _sk_store_f32_vfp4 @@ -8562,14 +8566,14 @@ _sk_store_f32_vfp4: .long 0xe59cc000 // ldr ip, [ip] .long 0xe35e0000 // cmp lr, #0 .long 0xe08cc202 // add ip, ip, r2, lsl #4 - .long 0x1a000004 // bne 3570 <sk_store_f32_vfp4+0x30> + .long 0x1a000004 // bne 3578 <sk_store_f32_vfp4+0x30> .long 0xf40c008f // vst4.32 {d0-d3}, [ip] .long 0xe591c004 // ldr ip, [r1, #4] .long 0xe2811008 // add r1, r1, #8 .long 0xe8bd4800 // pop {fp, lr} .long 0xe12fff1c // bx ip .long 0xf48c0b0f // vst4.32 {d0[0],d1[0],d2[0],d3[0]}, [ip] - .long 0xeafffff9 // b 3560 <sk_store_f32_vfp4+0x20> + .long 0xeafffff9 // b 3568 <sk_store_f32_vfp4+0x20> HIDDEN _sk_clamp_x_vfp4 .globl _sk_clamp_x_vfp4 @@ -9129,7 +9133,7 @@ _sk_gradient_vfp4: .long 0xe591c000 // ldr ip, [r1] .long 0xe59c4000 // ldr r4, [ip] .long 0xe3540002 // cmp r4, #2 - .long 0x3a00000b // bcc 3d00 <sk_gradient_vfp4+0x58> + .long 0x3a00000b // bcc 3d08 <sk_gradient_vfp4+0x58> .long 0xe59c5024 // ldr r5, [ip, #36] .long 0xf2c01010 // vmov.i32 d17, #0 .long 0xf2c02011 // vmov.i32 d18, #1 @@ -9141,7 +9145,7 @@ _sk_gradient_vfp4: .long 0xf3403e23 // vcge.f32 d19, d0, d19 .long 0xf35231b1 // vbsl d19, d18, d17 .long 0xf26308a0 // vadd.i32 d16, d19, d16 - .long 0x1afffff9 // bne 3ce8 <sk_gradient_vfp4+0x40> + .long 0x1afffff9 // bne 3cf0 <sk_gradient_vfp4+0x40> .long 0xee304b90 // vmov.32 r4, d16[1] .long 0xe59c6010 // ldr r6, [ip, #16] .long 0xee10eb90 // vmov.32 lr, d16[0] @@ -9670,13 +9674,14 @@ HIDDEN _sk_callback_vfp4 .globl _sk_callback_vfp4 FUNCTION(_sk_callback_vfp4) _sk_callback_vfp4: - .long 0xe92d41f0 // push {r4, r5, r6, r7, r8, lr} + .long 0xe92d4df0 // push {r4, r5, r6, r7, r8, sl, fp, lr} + .long 0xe28db018 // add fp, sp, #24 .long 0xed2d8b08 // vpush {d8-d11} .long 0xe1a06001 // mov r6, r1 .long 0xe1a07000 // mov r7, r0 .long 0xe5964000 // ldr r4, [r6] .long 0xe1a05002 // mov r5, r2 - .long 0xe59d1038 // ldr r1, [sp, #56] + .long 0xe59b1008 // ldr r1, [fp, #8] .long 0xeeb08b47 // vmov.f64 d8, d7 .long 0xe2840004 // add r0, r4, #4 .long 0xe1a08003 // mov r8, r3 @@ -9701,7 +9706,7 @@ _sk_callback_vfp4: .long 0xeeb06b49 // vmov.f64 d6, d9 .long 0xeeb07b48 // vmov.f64 d7, d8 .long 0xecbd8b08 // vpop {d8-d11} - .long 0xe8bd41f0 // pop {r4, r5, r6, r7, r8, lr} + .long 0xe8bd4df0 // pop {r4, r5, r6, r7, r8, sl, fp, lr} .long 0xe12fff1c // bx ip #elif defined(__x86_64__) BALIGN32 @@ -9711,25 +9716,27 @@ HIDDEN _sk_start_pipeline_hsw FUNCTION(_sk_start_pipeline_hsw) _sk_start_pipeline_hsw: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 80 // push %rax - .byte 77,137,198 // mov %r8,%r14 - .byte 72,137,211 // mov %rdx,%rbx - .byte 73,137,247 // mov %rsi,%r15 - .byte 72,137,253 // mov %rdi,%rbp + .byte 76,137,195 // mov %r8,%rbx + .byte 73,137,208 // mov %rdx,%r8 + .byte 73,137,244 // mov %rsi,%r12 + .byte 73,137,254 // mov %rdi,%r14 .byte 72,137,206 // mov %rcx,%rsi .byte 72,173 // lods %ds:(%rsi),%rax - .byte 73,137,196 // mov %rax,%r12 - .byte 73,137,245 // mov %rsi,%r13 - .byte 72,141,69,8 // lea 0x8(%rbp),%rax - .byte 72,57,216 // cmp %rbx,%rax - .byte 118,5 // jbe 30 <_sk_start_pipeline_hsw+0x30> - .byte 72,137,234 // mov %rbp,%rdx - .byte 235,69 // jmp 75 <_sk_start_pipeline_hsw+0x75> + .byte 73,137,197 // mov %rax,%r13 + .byte 73,137,247 // mov %rsi,%r15 + .byte 73,141,78,8 // lea 0x8(%r14),%rcx + .byte 76,57,193 // cmp %r8,%rcx + .byte 118,5 // jbe 33 <_sk_start_pipeline_hsw+0x33> + .byte 76,137,242 // mov %r14,%rdx + .byte 235,77 // jmp 80 <_sk_start_pipeline_hsw+0x80> + .byte 76,137,69,208 // mov %r8,-0x30(%rbp) .byte 65,184,0,0,0,0 // mov $0x0,%r8d .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 @@ -9739,18 +9746,19 @@ _sk_start_pipeline_hsw: .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 .byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6 .byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 72,137,234 // mov %rbp,%rdx - .byte 76,137,249 // mov %r15,%rcx - .byte 65,255,212 // callq *%r12 - .byte 72,141,85,8 // lea 0x8(%rbp),%rdx - .byte 72,131,197,16 // add $0x10,%rbp - .byte 72,57,221 // cmp %rbx,%rbp - .byte 72,137,213 // mov %rdx,%rbp - .byte 118,187 // jbe 30 <_sk_start_pipeline_hsw+0x30> - .byte 72,41,211 // sub %rdx,%rbx - .byte 116,47 // je a9 <_sk_start_pipeline_hsw+0xa9> + .byte 72,137,223 // mov %rbx,%rdi + .byte 76,137,254 // mov %r15,%rsi + .byte 76,137,242 // mov %r14,%rdx + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 + .byte 76,139,69,208 // mov -0x30(%rbp),%r8 + .byte 73,141,86,8 // lea 0x8(%r14),%rdx + .byte 73,131,198,16 // add $0x10,%r14 + .byte 77,57,198 // cmp %r8,%r14 + .byte 73,137,214 // mov %rdx,%r14 + .byte 118,183 // jbe 37 <_sk_start_pipeline_hsw+0x37> + .byte 73,41,208 // sub %rdx,%r8 + .byte 116,44 // je b1 <_sk_start_pipeline_hsw+0xb1> .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2 @@ -9759,11 +9767,10 @@ _sk_start_pipeline_hsw: .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 .byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6 .byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 76,137,249 // mov %r15,%rcx - .byte 73,137,216 // mov %rbx,%r8 - .byte 65,255,212 // callq *%r12 + .byte 72,137,223 // mov %rbx,%rdi + .byte 76,137,254 // mov %r15,%rsi + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 .byte 72,131,196,8 // add $0x8,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -9787,7 +9794,7 @@ _sk_seed_shader_hsw: .byte 197,249,110,194 // vmovd %edx,%xmm0 .byte 196,226,125,88,192 // vpbroadcastd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,10,73,0,0 // vbroadcastss 0x490a(%rip),%ymm1 # 49dc <_sk_callback_hsw+0x130> + .byte 196,226,125,24,13,194,72,0,0 // vbroadcastss 0x48c2(%rip),%ymm1 # 499c <_sk_callback_hsw+0x144> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0 .byte 197,249,110,209 // vmovd %ecx,%xmm2 @@ -9795,7 +9802,7 @@ _sk_seed_shader_hsw: .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,21,234,72,0,0 // vbroadcastss 0x48ea(%rip),%ymm2 # 49e0 <_sk_callback_hsw+0x134> + .byte 196,226,125,24,21,162,72,0,0 // vbroadcastss 0x48a2(%rip),%ymm2 # 49a0 <_sk_callback_hsw+0x148> .byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3 .byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4 .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 @@ -9814,13 +9821,13 @@ _sk_dither_hsw: .byte 197,121,110,201 // vmovd %ecx,%xmm9 .byte 196,66,125,88,201 // vpbroadcastd %xmm9,%ymm9 .byte 196,65,53,239,200 // vpxor %ymm8,%ymm9,%ymm9 - .byte 196,98,125,88,21,177,72,0,0 // vpbroadcastd 0x48b1(%rip),%ymm10 # 49e4 <_sk_callback_hsw+0x138> + .byte 196,98,125,88,21,105,72,0,0 // vpbroadcastd 0x4869(%rip),%ymm10 # 49a4 <_sk_callback_hsw+0x14c> .byte 196,65,53,219,218 // vpand %ymm10,%ymm9,%ymm11 .byte 196,193,37,114,243,5 // vpslld $0x5,%ymm11,%ymm11 .byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10 .byte 196,193,45,114,242,4 // vpslld $0x4,%ymm10,%ymm10 - .byte 196,98,125,88,37,150,72,0,0 // vpbroadcastd 0x4896(%rip),%ymm12 # 49e8 <_sk_callback_hsw+0x13c> - .byte 196,98,125,88,45,145,72,0,0 // vpbroadcastd 0x4891(%rip),%ymm13 # 49ec <_sk_callback_hsw+0x140> + .byte 196,98,125,88,37,78,72,0,0 // vpbroadcastd 0x484e(%rip),%ymm12 # 49a8 <_sk_callback_hsw+0x150> + .byte 196,98,125,88,45,73,72,0,0 // vpbroadcastd 0x4849(%rip),%ymm13 # 49ac <_sk_callback_hsw+0x154> .byte 196,65,53,219,245 // vpand %ymm13,%ymm9,%ymm14 .byte 196,193,13,114,246,2 // vpslld $0x2,%ymm14,%ymm14 .byte 196,65,61,219,237 // vpand %ymm13,%ymm8,%ymm13 @@ -9835,8 +9842,8 @@ _sk_dither_hsw: .byte 196,65,61,235,194 // vpor %ymm10,%ymm8,%ymm8 .byte 196,65,61,235,193 // vpor %ymm9,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,67,72,0,0 // vbroadcastss 0x4843(%rip),%ymm9 # 49f0 <_sk_callback_hsw+0x144> - .byte 196,98,125,24,21,62,72,0,0 // vbroadcastss 0x483e(%rip),%ymm10 # 49f4 <_sk_callback_hsw+0x148> + .byte 196,98,125,24,13,251,71,0,0 // vbroadcastss 0x47fb(%rip),%ymm9 # 49b0 <_sk_callback_hsw+0x158> + .byte 196,98,125,24,21,246,71,0,0 // vbroadcastss 0x47f6(%rip),%ymm10 # 49b4 <_sk_callback_hsw+0x15c> .byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10 .byte 196,98,125,24,0 // vbroadcastss (%rax),%ymm8 .byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8 @@ -9905,7 +9912,7 @@ HIDDEN _sk_srcatop_hsw FUNCTION(_sk_srcatop_hsw) _sk_srcatop_hsw: .byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0 - .byte 196,98,125,24,5,150,71,0,0 // vbroadcastss 0x4796(%rip),%ymm8 # 49f8 <_sk_callback_hsw+0x14c> + .byte 196,98,125,24,5,78,71,0,0 // vbroadcastss 0x474e(%rip),%ymm8 # 49b8 <_sk_callback_hsw+0x160> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,226,61,184,196 // vfmadd231ps %ymm4,%ymm8,%ymm0 .byte 197,244,89,207 // vmulps %ymm7,%ymm1,%ymm1 @@ -9921,7 +9928,7 @@ HIDDEN _sk_dstatop_hsw .globl _sk_dstatop_hsw FUNCTION(_sk_dstatop_hsw) _sk_dstatop_hsw: - .byte 196,98,125,24,5,105,71,0,0 // vbroadcastss 0x4769(%rip),%ymm8 # 49fc <_sk_callback_hsw+0x150> + .byte 196,98,125,24,5,33,71,0,0 // vbroadcastss 0x4721(%rip),%ymm8 # 49bc <_sk_callback_hsw+0x164> .byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 196,226,101,184,196 // vfmadd231ps %ymm4,%ymm3,%ymm0 @@ -9960,7 +9967,7 @@ HIDDEN _sk_srcout_hsw .globl _sk_srcout_hsw FUNCTION(_sk_srcout_hsw) _sk_srcout_hsw: - .byte 196,98,125,24,5,16,71,0,0 // vbroadcastss 0x4710(%rip),%ymm8 # 4a00 <_sk_callback_hsw+0x154> + .byte 196,98,125,24,5,200,70,0,0 // vbroadcastss 0x46c8(%rip),%ymm8 # 49c0 <_sk_callback_hsw+0x168> .byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 @@ -9973,7 +9980,7 @@ HIDDEN _sk_dstout_hsw .globl _sk_dstout_hsw FUNCTION(_sk_dstout_hsw) _sk_dstout_hsw: - .byte 196,226,125,24,5,243,70,0,0 // vbroadcastss 0x46f3(%rip),%ymm0 # 4a04 <_sk_callback_hsw+0x158> + .byte 196,226,125,24,5,171,70,0,0 // vbroadcastss 0x46ab(%rip),%ymm0 # 49c4 <_sk_callback_hsw+0x16c> .byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3 .byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0 .byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1 @@ -9986,7 +9993,7 @@ HIDDEN _sk_srcover_hsw .globl _sk_srcover_hsw FUNCTION(_sk_srcover_hsw) _sk_srcover_hsw: - .byte 196,98,125,24,5,214,70,0,0 // vbroadcastss 0x46d6(%rip),%ymm8 # 4a08 <_sk_callback_hsw+0x15c> + .byte 196,98,125,24,5,142,70,0,0 // vbroadcastss 0x468e(%rip),%ymm8 # 49c8 <_sk_callback_hsw+0x170> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0 .byte 196,194,85,184,200 // vfmadd231ps %ymm8,%ymm5,%ymm1 @@ -9999,7 +10006,7 @@ HIDDEN _sk_dstover_hsw .globl _sk_dstover_hsw FUNCTION(_sk_dstover_hsw) _sk_dstover_hsw: - .byte 196,98,125,24,5,181,70,0,0 // vbroadcastss 0x46b5(%rip),%ymm8 # 4a0c <_sk_callback_hsw+0x160> + .byte 196,98,125,24,5,109,70,0,0 // vbroadcastss 0x466d(%rip),%ymm8 # 49cc <_sk_callback_hsw+0x174> .byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8 .byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0 .byte 196,226,61,168,205 // vfmadd213ps %ymm5,%ymm8,%ymm1 @@ -10023,7 +10030,7 @@ HIDDEN _sk_multiply_hsw .globl _sk_multiply_hsw FUNCTION(_sk_multiply_hsw) _sk_multiply_hsw: - .byte 196,98,125,24,5,128,70,0,0 // vbroadcastss 0x4680(%rip),%ymm8 # 4a10 <_sk_callback_hsw+0x164> + .byte 196,98,125,24,5,56,70,0,0 // vbroadcastss 0x4638(%rip),%ymm8 # 49d0 <_sk_callback_hsw+0x178> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -10071,7 +10078,7 @@ HIDDEN _sk_xor__hsw .globl _sk_xor__hsw FUNCTION(_sk_xor__hsw) _sk_xor__hsw: - .byte 196,98,125,24,5,251,69,0,0 // vbroadcastss 0x45fb(%rip),%ymm8 # 4a14 <_sk_callback_hsw+0x168> + .byte 196,98,125,24,5,179,69,0,0 // vbroadcastss 0x45b3(%rip),%ymm8 # 49d4 <_sk_callback_hsw+0x17c> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -10105,7 +10112,7 @@ _sk_darken_hsw: .byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9 .byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,131,69,0,0 // vbroadcastss 0x4583(%rip),%ymm8 # 4a18 <_sk_callback_hsw+0x16c> + .byte 196,98,125,24,5,59,69,0,0 // vbroadcastss 0x453b(%rip),%ymm8 # 49d8 <_sk_callback_hsw+0x180> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax @@ -10130,7 +10137,7 @@ _sk_lighten_hsw: .byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9 .byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,50,69,0,0 // vbroadcastss 0x4532(%rip),%ymm8 # 4a1c <_sk_callback_hsw+0x170> + .byte 196,98,125,24,5,234,68,0,0 // vbroadcastss 0x44ea(%rip),%ymm8 # 49dc <_sk_callback_hsw+0x184> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax @@ -10158,7 +10165,7 @@ _sk_difference_hsw: .byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2 .byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,213,68,0,0 // vbroadcastss 0x44d5(%rip),%ymm8 # 4a20 <_sk_callback_hsw+0x174> + .byte 196,98,125,24,5,141,68,0,0 // vbroadcastss 0x448d(%rip),%ymm8 # 49e0 <_sk_callback_hsw+0x188> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax @@ -10180,7 +10187,7 @@ _sk_exclusion_hsw: .byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2 .byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,147,68,0,0 // vbroadcastss 0x4493(%rip),%ymm8 # 4a24 <_sk_callback_hsw+0x178> + .byte 196,98,125,24,5,75,68,0,0 // vbroadcastss 0x444b(%rip),%ymm8 # 49e4 <_sk_callback_hsw+0x18c> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax @@ -10190,7 +10197,7 @@ HIDDEN _sk_colorburn_hsw .globl _sk_colorburn_hsw FUNCTION(_sk_colorburn_hsw) _sk_colorburn_hsw: - .byte 196,98,125,24,5,129,68,0,0 // vbroadcastss 0x4481(%rip),%ymm8 # 4a28 <_sk_callback_hsw+0x17c> + .byte 196,98,125,24,5,57,68,0,0 // vbroadcastss 0x4439(%rip),%ymm8 # 49e8 <_sk_callback_hsw+0x190> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11 .byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10 @@ -10248,7 +10255,7 @@ HIDDEN _sk_colordodge_hsw FUNCTION(_sk_colordodge_hsw) _sk_colordodge_hsw: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 - .byte 196,98,125,24,13,140,67,0,0 // vbroadcastss 0x438c(%rip),%ymm9 # 4a2c <_sk_callback_hsw+0x180> + .byte 196,98,125,24,13,68,67,0,0 // vbroadcastss 0x4344(%rip),%ymm9 # 49ec <_sk_callback_hsw+0x194> .byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10 .byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11 .byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9 @@ -10301,7 +10308,7 @@ HIDDEN _sk_hardlight_hsw .globl _sk_hardlight_hsw FUNCTION(_sk_hardlight_hsw) _sk_hardlight_hsw: - .byte 196,98,125,24,5,173,66,0,0 // vbroadcastss 0x42ad(%rip),%ymm8 # 4a30 <_sk_callback_hsw+0x184> + .byte 196,98,125,24,5,101,66,0,0 // vbroadcastss 0x4265(%rip),%ymm8 # 49f0 <_sk_callback_hsw+0x198> .byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10 .byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -10352,7 +10359,7 @@ HIDDEN _sk_overlay_hsw .globl _sk_overlay_hsw FUNCTION(_sk_overlay_hsw) _sk_overlay_hsw: - .byte 196,98,125,24,5,229,65,0,0 // vbroadcastss 0x41e5(%rip),%ymm8 # 4a34 <_sk_callback_hsw+0x188> + .byte 196,98,125,24,5,157,65,0,0 // vbroadcastss 0x419d(%rip),%ymm8 # 49f4 <_sk_callback_hsw+0x19c> .byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10 .byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -10413,10 +10420,10 @@ _sk_softlight_hsw: .byte 196,65,20,88,197 // vaddps %ymm13,%ymm13,%ymm8 .byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8 .byte 196,66,61,168,192 // vfmadd213ps %ymm8,%ymm8,%ymm8 - .byte 196,98,125,24,29,240,64,0,0 // vbroadcastss 0x40f0(%rip),%ymm11 # 4a3c <_sk_callback_hsw+0x190> + .byte 196,98,125,24,29,168,64,0,0 // vbroadcastss 0x40a8(%rip),%ymm11 # 49fc <_sk_callback_hsw+0x1a4> .byte 196,65,20,88,227 // vaddps %ymm11,%ymm13,%ymm12 .byte 196,65,28,89,192 // vmulps %ymm8,%ymm12,%ymm8 - .byte 196,98,125,24,37,225,64,0,0 // vbroadcastss 0x40e1(%rip),%ymm12 # 4a40 <_sk_callback_hsw+0x194> + .byte 196,98,125,24,37,153,64,0,0 // vbroadcastss 0x4099(%rip),%ymm12 # 4a00 <_sk_callback_hsw+0x1a8> .byte 196,66,21,184,196 // vfmadd231ps %ymm12,%ymm13,%ymm8 .byte 196,65,124,82,245 // vrsqrtps %ymm13,%ymm14 .byte 196,65,124,83,246 // vrcpps %ymm14,%ymm14 @@ -10426,7 +10433,7 @@ _sk_softlight_hsw: .byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15 .byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14 .byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15 - .byte 196,98,125,24,5,164,64,0,0 // vbroadcastss 0x40a4(%rip),%ymm8 # 4a38 <_sk_callback_hsw+0x18c> + .byte 196,98,125,24,5,92,64,0,0 // vbroadcastss 0x405c(%rip),%ymm8 # 49f8 <_sk_callback_hsw+0x1a0> .byte 196,65,60,92,237 // vsubps %ymm13,%ymm8,%ymm13 .byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0 .byte 196,98,125,168,235 // vfmadd213ps %ymm3,%ymm0,%ymm13 @@ -10539,11 +10546,11 @@ _sk_hue_hsw: .byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10 .byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10 .byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12 - .byte 196,98,125,24,53,168,62,0,0 // vbroadcastss 0x3ea8(%rip),%ymm14 # 4a44 <_sk_callback_hsw+0x198> - .byte 196,98,125,24,61,163,62,0,0 // vbroadcastss 0x3ea3(%rip),%ymm15 # 4a48 <_sk_callback_hsw+0x19c> + .byte 196,98,125,24,53,96,62,0,0 // vbroadcastss 0x3e60(%rip),%ymm14 # 4a04 <_sk_callback_hsw+0x1ac> + .byte 196,98,125,24,61,91,62,0,0 // vbroadcastss 0x3e5b(%rip),%ymm15 # 4a08 <_sk_callback_hsw+0x1b0> .byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13 .byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13 - .byte 196,226,125,24,5,148,62,0,0 // vbroadcastss 0x3e94(%rip),%ymm0 # 4a4c <_sk_callback_hsw+0x1a0> + .byte 196,226,125,24,5,76,62,0,0 // vbroadcastss 0x3e4c(%rip),%ymm0 # 4a0c <_sk_callback_hsw+0x1b4> .byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13 .byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10 .byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10 @@ -10598,7 +10605,7 @@ _sk_hue_hsw: .byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0 .byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9 .byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8 - .byte 196,226,125,24,13,129,61,0,0 // vbroadcastss 0x3d81(%rip),%ymm1 # 4a50 <_sk_callback_hsw+0x1a4> + .byte 196,226,125,24,13,57,61,0,0 // vbroadcastss 0x3d39(%rip),%ymm1 # 4a10 <_sk_callback_hsw+0x1b8> .byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11 @@ -10652,11 +10659,11 @@ _sk_saturation_hsw: .byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10 .byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10 .byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12 - .byte 196,98,125,24,53,152,60,0,0 // vbroadcastss 0x3c98(%rip),%ymm14 # 4a54 <_sk_callback_hsw+0x1a8> - .byte 196,98,125,24,61,147,60,0,0 // vbroadcastss 0x3c93(%rip),%ymm15 # 4a58 <_sk_callback_hsw+0x1ac> + .byte 196,98,125,24,53,80,60,0,0 // vbroadcastss 0x3c50(%rip),%ymm14 # 4a14 <_sk_callback_hsw+0x1bc> + .byte 196,98,125,24,61,75,60,0,0 // vbroadcastss 0x3c4b(%rip),%ymm15 # 4a18 <_sk_callback_hsw+0x1c0> .byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13 .byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13 - .byte 196,226,125,24,5,132,60,0,0 // vbroadcastss 0x3c84(%rip),%ymm0 # 4a5c <_sk_callback_hsw+0x1b0> + .byte 196,226,125,24,5,60,60,0,0 // vbroadcastss 0x3c3c(%rip),%ymm0 # 4a1c <_sk_callback_hsw+0x1c4> .byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13 .byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10 .byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10 @@ -10711,7 +10718,7 @@ _sk_saturation_hsw: .byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0 .byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9 .byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8 - .byte 196,226,125,24,13,113,59,0,0 // vbroadcastss 0x3b71(%rip),%ymm1 # 4a60 <_sk_callback_hsw+0x1b4> + .byte 196,226,125,24,13,41,59,0,0 // vbroadcastss 0x3b29(%rip),%ymm1 # 4a20 <_sk_callback_hsw+0x1c8> .byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11 @@ -10739,11 +10746,11 @@ _sk_color_hsw: .byte 197,108,89,199 // vmulps %ymm7,%ymm2,%ymm8 .byte 197,116,89,215 // vmulps %ymm7,%ymm1,%ymm10 .byte 197,52,89,223 // vmulps %ymm7,%ymm9,%ymm11 - .byte 196,98,125,24,45,10,59,0,0 // vbroadcastss 0x3b0a(%rip),%ymm13 # 4a64 <_sk_callback_hsw+0x1b8> - .byte 196,98,125,24,53,5,59,0,0 // vbroadcastss 0x3b05(%rip),%ymm14 # 4a68 <_sk_callback_hsw+0x1bc> + .byte 196,98,125,24,45,194,58,0,0 // vbroadcastss 0x3ac2(%rip),%ymm13 # 4a24 <_sk_callback_hsw+0x1cc> + .byte 196,98,125,24,53,189,58,0,0 // vbroadcastss 0x3abd(%rip),%ymm14 # 4a28 <_sk_callback_hsw+0x1d0> .byte 196,65,84,89,230 // vmulps %ymm14,%ymm5,%ymm12 .byte 196,66,93,184,229 // vfmadd231ps %ymm13,%ymm4,%ymm12 - .byte 196,98,125,24,61,246,58,0,0 // vbroadcastss 0x3af6(%rip),%ymm15 # 4a6c <_sk_callback_hsw+0x1c0> + .byte 196,98,125,24,61,174,58,0,0 // vbroadcastss 0x3aae(%rip),%ymm15 # 4a2c <_sk_callback_hsw+0x1d4> .byte 196,66,77,184,231 // vfmadd231ps %ymm15,%ymm6,%ymm12 .byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9 .byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9 @@ -10799,7 +10806,7 @@ _sk_color_hsw: .byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1 .byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8 .byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9 - .byte 196,226,125,24,5,216,57,0,0 // vbroadcastss 0x39d8(%rip),%ymm0 # 4a70 <_sk_callback_hsw+0x1c4> + .byte 196,226,125,24,5,144,57,0,0 // vbroadcastss 0x3990(%rip),%ymm0 # 4a30 <_sk_callback_hsw+0x1d8> .byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11 @@ -10827,11 +10834,11 @@ _sk_luminosity_hsw: .byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8 .byte 197,100,89,213 // vmulps %ymm5,%ymm3,%ymm10 .byte 197,100,89,222 // vmulps %ymm6,%ymm3,%ymm11 - .byte 196,98,125,24,45,113,57,0,0 // vbroadcastss 0x3971(%rip),%ymm13 # 4a74 <_sk_callback_hsw+0x1c8> - .byte 196,98,125,24,53,108,57,0,0 // vbroadcastss 0x396c(%rip),%ymm14 # 4a78 <_sk_callback_hsw+0x1cc> + .byte 196,98,125,24,45,41,57,0,0 // vbroadcastss 0x3929(%rip),%ymm13 # 4a34 <_sk_callback_hsw+0x1dc> + .byte 196,98,125,24,53,36,57,0,0 // vbroadcastss 0x3924(%rip),%ymm14 # 4a38 <_sk_callback_hsw+0x1e0> .byte 196,65,116,89,230 // vmulps %ymm14,%ymm1,%ymm12 .byte 196,66,109,184,229 // vfmadd231ps %ymm13,%ymm2,%ymm12 - .byte 196,98,125,24,61,93,57,0,0 // vbroadcastss 0x395d(%rip),%ymm15 # 4a7c <_sk_callback_hsw+0x1d0> + .byte 196,98,125,24,61,21,57,0,0 // vbroadcastss 0x3915(%rip),%ymm15 # 4a3c <_sk_callback_hsw+0x1e4> .byte 196,66,53,184,231 // vfmadd231ps %ymm15,%ymm9,%ymm12 .byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9 .byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9 @@ -10887,7 +10894,7 @@ _sk_luminosity_hsw: .byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1 .byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8 .byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9 - .byte 196,226,125,24,5,63,56,0,0 // vbroadcastss 0x383f(%rip),%ymm0 # 4a80 <_sk_callback_hsw+0x1d4> + .byte 196,226,125,24,5,247,55,0,0 // vbroadcastss 0x37f7(%rip),%ymm0 # 4a40 <_sk_callback_hsw+0x1e8> .byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11 @@ -10913,19 +10920,19 @@ _sk_srcover_rgba_8888_hsw: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,180,0,0,0 // jne 1350 <_sk_srcover_rgba_8888_hsw+0xcd> + .byte 15,133,180,0,0,0 // jne 1358 <_sk_srcover_rgba_8888_hsw+0xcd> .byte 196,193,124,16,58 // vmovups (%r10),%ymm7 - .byte 197,196,84,37,87,59,0,0 // vandps 0x3b57(%rip),%ymm7,%ymm4 # 4e00 <_sk_callback_hsw+0x554> + .byte 197,196,84,37,15,59,0,0 // vandps 0x3b0f(%rip),%ymm7,%ymm4 # 4dc0 <_sk_callback_hsw+0x568> .byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4 - .byte 196,226,69,0,45,106,59,0,0 // vpshufb 0x3b6a(%rip),%ymm7,%ymm5 # 4e20 <_sk_callback_hsw+0x574> + .byte 196,226,69,0,45,34,59,0,0 // vpshufb 0x3b22(%rip),%ymm7,%ymm5 # 4de0 <_sk_callback_hsw+0x588> .byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5 - .byte 196,226,69,0,53,125,59,0,0 // vpshufb 0x3b7d(%rip),%ymm7,%ymm6 # 4e40 <_sk_callback_hsw+0x594> + .byte 196,226,69,0,53,53,59,0,0 // vpshufb 0x3b35(%rip),%ymm7,%ymm6 # 4e00 <_sk_callback_hsw+0x5a8> .byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6 .byte 197,197,114,215,24 // vpsrld $0x18,%ymm7,%ymm7 .byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7 - .byte 196,98,125,24,5,171,55,0,0 // vbroadcastss 0x37ab(%rip),%ymm8 # 4a84 <_sk_callback_hsw+0x1d8> + .byte 196,98,125,24,5,99,55,0,0 // vbroadcastss 0x3763(%rip),%ymm8 # 4a44 <_sk_callback_hsw+0x1ec> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 - .byte 196,98,125,24,13,162,55,0,0 // vbroadcastss 0x37a2(%rip),%ymm9 # 4a88 <_sk_callback_hsw+0x1dc> + .byte 196,98,125,24,13,90,55,0,0 // vbroadcastss 0x375a(%rip),%ymm9 # 4a48 <_sk_callback_hsw+0x1f0> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0 .byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1 @@ -10945,7 +10952,7 @@ _sk_srcover_rgba_8888_hsw: .byte 196,65,53,235,202 // vpor %ymm10,%ymm9,%ymm9 .byte 196,65,61,235,193 // vpor %ymm9,%ymm8,%ymm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,53 // jne 1379 <_sk_srcover_rgba_8888_hsw+0xf6> + .byte 117,53 // jne 1381 <_sk_srcover_rgba_8888_hsw+0xf6> .byte 196,65,124,17,2 // vmovups %ymm8,(%r10) .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -10958,7 +10965,7 @@ _sk_srcover_rgba_8888_hsw: .byte 196,225,249,110,224 // vmovq %rax,%xmm4 .byte 196,226,125,33,228 // vpmovsxbd %xmm4,%ymm4 .byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7 - .byte 233,40,255,255,255 // jmpq 12a1 <_sk_srcover_rgba_8888_hsw+0x1e> + .byte 233,40,255,255,255 // jmpq 12a9 <_sk_srcover_rgba_8888_hsw+0x1e> .byte 185,8,0,0,0 // mov $0x8,%ecx .byte 68,41,193 // sub %r8d,%ecx .byte 192,225,3 // shl $0x3,%cl @@ -10967,7 +10974,7 @@ _sk_srcover_rgba_8888_hsw: .byte 196,97,249,110,200 // vmovq %rax,%xmm9 .byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9 .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10) - .byte 235,170 // jmp 1349 <_sk_srcover_rgba_8888_hsw+0xc6> + .byte 235,170 // jmp 1351 <_sk_srcover_rgba_8888_hsw+0xc6> HIDDEN _sk_clamp_0_hsw .globl _sk_clamp_0_hsw @@ -10985,7 +10992,7 @@ HIDDEN _sk_clamp_1_hsw .globl _sk_clamp_1_hsw FUNCTION(_sk_clamp_1_hsw) _sk_clamp_1_hsw: - .byte 196,98,125,24,5,199,54,0,0 // vbroadcastss 0x36c7(%rip),%ymm8 # 4a8c <_sk_callback_hsw+0x1e0> + .byte 196,98,125,24,5,127,54,0,0 // vbroadcastss 0x367f(%rip),%ymm8 # 4a4c <_sk_callback_hsw+0x1f4> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1 .byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2 @@ -10997,7 +11004,7 @@ HIDDEN _sk_clamp_a_hsw .globl _sk_clamp_a_hsw FUNCTION(_sk_clamp_a_hsw) _sk_clamp_a_hsw: - .byte 196,98,125,24,5,170,54,0,0 // vbroadcastss 0x36aa(%rip),%ymm8 # 4a90 <_sk_callback_hsw+0x1e4> + .byte 196,98,125,24,5,98,54,0,0 // vbroadcastss 0x3662(%rip),%ymm8 # 4a50 <_sk_callback_hsw+0x1f8> .byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3 .byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0 .byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1 @@ -11083,7 +11090,7 @@ FUNCTION(_sk_unpremul_hsw) _sk_unpremul_hsw: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9 - .byte 196,98,125,24,21,242,53,0,0 // vbroadcastss 0x35f2(%rip),%ymm10 # 4a94 <_sk_callback_hsw+0x1e8> + .byte 196,98,125,24,21,170,53,0,0 // vbroadcastss 0x35aa(%rip),%ymm10 # 4a54 <_sk_callback_hsw+0x1fc> .byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10 .byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 @@ -11096,16 +11103,16 @@ HIDDEN _sk_from_srgb_hsw .globl _sk_from_srgb_hsw FUNCTION(_sk_from_srgb_hsw) _sk_from_srgb_hsw: - .byte 196,98,125,24,5,211,53,0,0 // vbroadcastss 0x35d3(%rip),%ymm8 # 4a98 <_sk_callback_hsw+0x1ec> + .byte 196,98,125,24,5,139,53,0,0 // vbroadcastss 0x358b(%rip),%ymm8 # 4a58 <_sk_callback_hsw+0x200> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10 - .byte 196,98,125,24,29,197,53,0,0 // vbroadcastss 0x35c5(%rip),%ymm11 # 4a9c <_sk_callback_hsw+0x1f0> - .byte 196,98,125,24,37,192,53,0,0 // vbroadcastss 0x35c0(%rip),%ymm12 # 4aa0 <_sk_callback_hsw+0x1f4> + .byte 196,98,125,24,29,125,53,0,0 // vbroadcastss 0x357d(%rip),%ymm11 # 4a5c <_sk_callback_hsw+0x204> + .byte 196,98,125,24,37,120,53,0,0 // vbroadcastss 0x3578(%rip),%ymm12 # 4a60 <_sk_callback_hsw+0x208> .byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13 .byte 196,66,125,168,235 // vfmadd213ps %ymm11,%ymm0,%ymm13 - .byte 196,98,125,24,53,177,53,0,0 // vbroadcastss 0x35b1(%rip),%ymm14 # 4aa4 <_sk_callback_hsw+0x1f8> + .byte 196,98,125,24,53,105,53,0,0 // vbroadcastss 0x3569(%rip),%ymm14 # 4a64 <_sk_callback_hsw+0x20c> .byte 196,66,45,168,238 // vfmadd213ps %ymm14,%ymm10,%ymm13 - .byte 196,98,125,24,21,167,53,0,0 // vbroadcastss 0x35a7(%rip),%ymm10 # 4aa8 <_sk_callback_hsw+0x1fc> + .byte 196,98,125,24,21,95,53,0,0 // vbroadcastss 0x355f(%rip),%ymm10 # 4a68 <_sk_callback_hsw+0x210> .byte 196,193,124,194,194,1 // vcmpltps %ymm10,%ymm0,%ymm0 .byte 196,195,21,74,193,0 // vblendvps %ymm0,%ymm9,%ymm13,%ymm0 .byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9 @@ -11129,19 +11136,19 @@ HIDDEN _sk_to_srgb_hsw FUNCTION(_sk_to_srgb_hsw) _sk_to_srgb_hsw: .byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9 - .byte 196,98,125,24,5,75,53,0,0 // vbroadcastss 0x354b(%rip),%ymm8 # 4aac <_sk_callback_hsw+0x200> + .byte 196,98,125,24,5,3,53,0,0 // vbroadcastss 0x3503(%rip),%ymm8 # 4a6c <_sk_callback_hsw+0x214> .byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10 - .byte 196,98,125,24,29,65,53,0,0 // vbroadcastss 0x3541(%rip),%ymm11 # 4ab0 <_sk_callback_hsw+0x204> - .byte 196,98,125,24,37,60,53,0,0 // vbroadcastss 0x353c(%rip),%ymm12 # 4ab4 <_sk_callback_hsw+0x208> + .byte 196,98,125,24,29,249,52,0,0 // vbroadcastss 0x34f9(%rip),%ymm11 # 4a70 <_sk_callback_hsw+0x218> + .byte 196,98,125,24,37,244,52,0,0 // vbroadcastss 0x34f4(%rip),%ymm12 # 4a74 <_sk_callback_hsw+0x21c> .byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13 .byte 196,66,53,168,235 // vfmadd213ps %ymm11,%ymm9,%ymm13 - .byte 196,98,125,24,53,45,53,0,0 // vbroadcastss 0x352d(%rip),%ymm14 # 4ab8 <_sk_callback_hsw+0x20c> + .byte 196,98,125,24,53,229,52,0,0 // vbroadcastss 0x34e5(%rip),%ymm14 # 4a78 <_sk_callback_hsw+0x220> .byte 196,66,53,168,238 // vfmadd213ps %ymm14,%ymm9,%ymm13 - .byte 196,98,125,24,61,35,53,0,0 // vbroadcastss 0x3523(%rip),%ymm15 # 4abc <_sk_callback_hsw+0x210> + .byte 196,98,125,24,61,219,52,0,0 // vbroadcastss 0x34db(%rip),%ymm15 # 4a7c <_sk_callback_hsw+0x224> .byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9 .byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9 .byte 196,65,20,89,201 // vmulps %ymm9,%ymm13,%ymm9 - .byte 196,98,125,24,45,15,53,0,0 // vbroadcastss 0x350f(%rip),%ymm13 # 4ac0 <_sk_callback_hsw+0x214> + .byte 196,98,125,24,45,199,52,0,0 // vbroadcastss 0x34c7(%rip),%ymm13 # 4a80 <_sk_callback_hsw+0x228> .byte 196,193,124,194,197,1 // vcmpltps %ymm13,%ymm0,%ymm0 .byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0 .byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9 @@ -11175,26 +11182,26 @@ _sk_rgb_to_hsl_hsw: .byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9 .byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9 .byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10 - .byte 196,98,125,24,29,132,52,0,0 // vbroadcastss 0x3484(%rip),%ymm11 # 4ac4 <_sk_callback_hsw+0x218> + .byte 196,98,125,24,29,60,52,0,0 // vbroadcastss 0x343c(%rip),%ymm11 # 4a84 <_sk_callback_hsw+0x22c> .byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11 .byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12 .byte 197,116,194,234,1 // vcmpltps %ymm2,%ymm1,%ymm13 - .byte 196,98,125,24,53,113,52,0,0 // vbroadcastss 0x3471(%rip),%ymm14 # 4ac8 <_sk_callback_hsw+0x21c> + .byte 196,98,125,24,53,41,52,0,0 // vbroadcastss 0x3429(%rip),%ymm14 # 4a88 <_sk_callback_hsw+0x230> .byte 196,65,4,87,255 // vxorps %ymm15,%ymm15,%ymm15 .byte 196,67,5,74,238,208 // vblendvps %ymm13,%ymm14,%ymm15,%ymm13 .byte 196,66,37,168,229 // vfmadd213ps %ymm13,%ymm11,%ymm12 .byte 197,236,92,208 // vsubps %ymm0,%ymm2,%ymm2 .byte 197,124,92,233 // vsubps %ymm1,%ymm0,%ymm13 - .byte 196,98,125,24,53,88,52,0,0 // vbroadcastss 0x3458(%rip),%ymm14 # 4ad0 <_sk_callback_hsw+0x224> + .byte 196,98,125,24,53,16,52,0,0 // vbroadcastss 0x3410(%rip),%ymm14 # 4a90 <_sk_callback_hsw+0x238> .byte 196,66,37,168,238 // vfmadd213ps %ymm14,%ymm11,%ymm13 - .byte 196,98,125,24,53,70,52,0,0 // vbroadcastss 0x3446(%rip),%ymm14 # 4acc <_sk_callback_hsw+0x220> + .byte 196,98,125,24,53,254,51,0,0 // vbroadcastss 0x33fe(%rip),%ymm14 # 4a8c <_sk_callback_hsw+0x234> .byte 196,194,37,168,214 // vfmadd213ps %ymm14,%ymm11,%ymm2 .byte 197,188,194,201,0 // vcmpeqps %ymm1,%ymm8,%ymm1 .byte 196,227,21,74,202,16 // vblendvps %ymm1,%ymm2,%ymm13,%ymm1 .byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0 .byte 196,195,117,74,196,0 // vblendvps %ymm0,%ymm12,%ymm1,%ymm0 .byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1 - .byte 196,98,125,24,29,41,52,0,0 // vbroadcastss 0x3429(%rip),%ymm11 # 4ad8 <_sk_callback_hsw+0x22c> + .byte 196,98,125,24,29,225,51,0,0 // vbroadcastss 0x33e1(%rip),%ymm11 # 4a98 <_sk_callback_hsw+0x240> .byte 196,193,116,89,211 // vmulps %ymm11,%ymm1,%ymm2 .byte 197,36,194,218,1 // vcmpltps %ymm2,%ymm11,%ymm11 .byte 196,65,12,92,224 // vsubps %ymm8,%ymm14,%ymm12 @@ -11204,7 +11211,7 @@ _sk_rgb_to_hsl_hsw: .byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1 .byte 196,195,125,74,199,128 // vblendvps %ymm8,%ymm15,%ymm0,%ymm0 .byte 196,195,117,74,207,128 // vblendvps %ymm8,%ymm15,%ymm1,%ymm1 - .byte 196,98,125,24,5,236,51,0,0 // vbroadcastss 0x33ec(%rip),%ymm8 # 4ad4 <_sk_callback_hsw+0x228> + .byte 196,98,125,24,5,164,51,0,0 // vbroadcastss 0x33a4(%rip),%ymm8 # 4a94 <_sk_callback_hsw+0x23c> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -11221,30 +11228,30 @@ _sk_hsl_to_rgb_hsw: .byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp) .byte 197,252,40,233 // vmovaps %ymm1,%ymm5 .byte 197,252,40,224 // vmovaps %ymm0,%ymm4 - .byte 196,98,125,24,5,185,51,0,0 // vbroadcastss 0x33b9(%rip),%ymm8 # 4adc <_sk_callback_hsw+0x230> + .byte 196,98,125,24,5,113,51,0,0 // vbroadcastss 0x3371(%rip),%ymm8 # 4a9c <_sk_callback_hsw+0x244> .byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9 .byte 197,84,89,210 // vmulps %ymm2,%ymm5,%ymm10 .byte 196,65,84,92,218 // vsubps %ymm10,%ymm5,%ymm11 .byte 196,67,45,74,203,144 // vblendvps %ymm9,%ymm11,%ymm10,%ymm9 .byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10 - .byte 196,98,125,24,13,156,51,0,0 // vbroadcastss 0x339c(%rip),%ymm9 # 4ae0 <_sk_callback_hsw+0x234> + .byte 196,98,125,24,13,84,51,0,0 // vbroadcastss 0x3354(%rip),%ymm9 # 4aa0 <_sk_callback_hsw+0x248> .byte 196,66,109,170,202 // vfmsub213ps %ymm10,%ymm2,%ymm9 - .byte 196,98,125,24,29,146,51,0,0 // vbroadcastss 0x3392(%rip),%ymm11 # 4ae4 <_sk_callback_hsw+0x238> + .byte 196,98,125,24,29,74,51,0,0 // vbroadcastss 0x334a(%rip),%ymm11 # 4aa4 <_sk_callback_hsw+0x24c> .byte 196,65,92,88,219 // vaddps %ymm11,%ymm4,%ymm11 .byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12 .byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15 .byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11 - .byte 196,98,125,24,45,124,51,0,0 // vbroadcastss 0x337c(%rip),%ymm13 # 4aec <_sk_callback_hsw+0x240> + .byte 196,98,125,24,45,52,51,0,0 // vbroadcastss 0x3334(%rip),%ymm13 # 4aac <_sk_callback_hsw+0x254> .byte 196,193,4,89,197 // vmulps %ymm13,%ymm15,%ymm0 - .byte 196,98,125,24,53,114,51,0,0 // vbroadcastss 0x3372(%rip),%ymm14 # 4af0 <_sk_callback_hsw+0x244> + .byte 196,98,125,24,53,42,51,0,0 // vbroadcastss 0x332a(%rip),%ymm14 # 4ab0 <_sk_callback_hsw+0x258> .byte 197,12,92,224 // vsubps %ymm0,%ymm14,%ymm12 .byte 196,66,37,168,225 // vfmadd213ps %ymm9,%ymm11,%ymm12 - .byte 196,226,125,24,29,88,51,0,0 // vbroadcastss 0x3358(%rip),%ymm3 # 4ae8 <_sk_callback_hsw+0x23c> + .byte 196,226,125,24,29,16,51,0,0 // vbroadcastss 0x3310(%rip),%ymm3 # 4aa8 <_sk_callback_hsw+0x250> .byte 196,193,100,194,255,2 // vcmpleps %ymm15,%ymm3,%ymm7 .byte 196,195,29,74,249,112 // vblendvps %ymm7,%ymm9,%ymm12,%ymm7 .byte 196,65,60,194,231,2 // vcmpleps %ymm15,%ymm8,%ymm12 .byte 196,227,45,74,255,192 // vblendvps %ymm12,%ymm7,%ymm10,%ymm7 - .byte 196,98,125,24,37,67,51,0,0 // vbroadcastss 0x3343(%rip),%ymm12 # 4af4 <_sk_callback_hsw+0x248> + .byte 196,98,125,24,37,251,50,0,0 // vbroadcastss 0x32fb(%rip),%ymm12 # 4ab4 <_sk_callback_hsw+0x25c> .byte 196,65,28,194,255,2 // vcmpleps %ymm15,%ymm12,%ymm15 .byte 196,194,37,168,193 // vfmadd213ps %ymm9,%ymm11,%ymm0 .byte 196,99,125,74,255,240 // vblendvps %ymm15,%ymm7,%ymm0,%ymm15 @@ -11260,7 +11267,7 @@ _sk_hsl_to_rgb_hsw: .byte 197,156,194,192,2 // vcmpleps %ymm0,%ymm12,%ymm0 .byte 196,194,37,168,249 // vfmadd213ps %ymm9,%ymm11,%ymm7 .byte 196,227,69,74,201,0 // vblendvps %ymm0,%ymm1,%ymm7,%ymm1 - .byte 196,226,125,24,5,239,50,0,0 // vbroadcastss 0x32ef(%rip),%ymm0 # 4af8 <_sk_callback_hsw+0x24c> + .byte 196,226,125,24,5,167,50,0,0 // vbroadcastss 0x32a7(%rip),%ymm0 # 4ab8 <_sk_callback_hsw+0x260> .byte 197,220,88,192 // vaddps %ymm0,%ymm4,%ymm0 .byte 196,227,125,8,224,1 // vroundps $0x1,%ymm0,%ymm4 .byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0 @@ -11310,11 +11317,11 @@ _sk_scale_u8_hsw: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,51 // jne 18e9 <_sk_scale_u8_hsw+0x43> + .byte 117,51 // jne 18f1 <_sk_scale_u8_hsw+0x43> .byte 197,122,126,0 // vmovq (%rax),%xmm8 .byte 196,66,125,49,192 // vpmovzxbd %xmm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,47,50,0,0 // vbroadcastss 0x322f(%rip),%ymm9 # 4afc <_sk_callback_hsw+0x250> + .byte 196,98,125,24,13,231,49,0,0 // vbroadcastss 0x31e7(%rip),%ymm9 # 4abc <_sk_callback_hsw+0x264> .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 @@ -11333,10 +11340,10 @@ _sk_scale_u8_hsw: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 18f2 <_sk_scale_u8_hsw+0x4c> + .byte 117,235 // jne 18fa <_sk_scale_u8_hsw+0x4c> .byte 196,65,249,110,194 // vmovq %r10,%xmm8 .byte 91 // pop %rbx - .byte 235,171 // jmp 18ba <_sk_scale_u8_hsw+0x14> + .byte 235,171 // jmp 18c2 <_sk_scale_u8_hsw+0x14> HIDDEN _sk_lerp_1_float_hsw .globl _sk_lerp_1_float_hsw @@ -11364,11 +11371,11 @@ _sk_lerp_u8_hsw: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,71 // jne 1995 <_sk_lerp_u8_hsw+0x57> + .byte 117,71 // jne 199d <_sk_lerp_u8_hsw+0x57> .byte 197,122,126,0 // vmovq (%rax),%xmm8 .byte 196,66,125,49,192 // vpmovzxbd %xmm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,155,49,0,0 // vbroadcastss 0x319b(%rip),%ymm9 # 4b00 <_sk_callback_hsw+0x254> + .byte 196,98,125,24,13,83,49,0,0 // vbroadcastss 0x3153(%rip),%ymm9 # 4ac0 <_sk_callback_hsw+0x268> .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 .byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0 .byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0 @@ -11391,10 +11398,10 @@ _sk_lerp_u8_hsw: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 199e <_sk_lerp_u8_hsw+0x60> + .byte 117,235 // jne 19a6 <_sk_lerp_u8_hsw+0x60> .byte 196,65,249,110,194 // vmovq %r10,%xmm8 .byte 91 // pop %rbx - .byte 235,151 // jmp 1952 <_sk_lerp_u8_hsw+0x14> + .byte 235,151 // jmp 195a <_sk_lerp_u8_hsw+0x14> HIDDEN _sk_lerp_565_hsw .globl _sk_lerp_565_hsw @@ -11403,23 +11410,23 @@ _sk_lerp_565_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,169,0,0,0 // jne 1a72 <_sk_lerp_565_hsw+0xb7> + .byte 15,133,169,0,0,0 // jne 1a7a <_sk_lerp_565_hsw+0xb7> .byte 196,65,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm8 .byte 196,66,125,51,192 // vpmovzxwd %xmm8,%ymm8 - .byte 196,98,125,88,13,39,49,0,0 // vpbroadcastd 0x3127(%rip),%ymm9 # 4b04 <_sk_callback_hsw+0x258> + .byte 196,98,125,88,13,223,48,0,0 // vpbroadcastd 0x30df(%rip),%ymm9 # 4ac4 <_sk_callback_hsw+0x26c> .byte 196,65,61,219,201 // vpand %ymm9,%ymm8,%ymm9 .byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9 - .byte 196,98,125,24,21,24,49,0,0 // vbroadcastss 0x3118(%rip),%ymm10 # 4b08 <_sk_callback_hsw+0x25c> + .byte 196,98,125,24,21,208,48,0,0 // vbroadcastss 0x30d0(%rip),%ymm10 # 4ac8 <_sk_callback_hsw+0x270> .byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9 - .byte 196,98,125,88,21,14,49,0,0 // vpbroadcastd 0x310e(%rip),%ymm10 # 4b0c <_sk_callback_hsw+0x260> + .byte 196,98,125,88,21,198,48,0,0 // vpbroadcastd 0x30c6(%rip),%ymm10 # 4acc <_sk_callback_hsw+0x274> .byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10 .byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10 - .byte 196,98,125,24,29,255,48,0,0 // vbroadcastss 0x30ff(%rip),%ymm11 # 4b10 <_sk_callback_hsw+0x264> + .byte 196,98,125,24,29,183,48,0,0 // vbroadcastss 0x30b7(%rip),%ymm11 # 4ad0 <_sk_callback_hsw+0x278> .byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10 - .byte 196,98,125,88,29,245,48,0,0 // vpbroadcastd 0x30f5(%rip),%ymm11 # 4b14 <_sk_callback_hsw+0x268> + .byte 196,98,125,88,29,173,48,0,0 // vpbroadcastd 0x30ad(%rip),%ymm11 # 4ad4 <_sk_callback_hsw+0x27c> .byte 196,65,61,219,195 // vpand %ymm11,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,29,230,48,0,0 // vbroadcastss 0x30e6(%rip),%ymm11 # 4b18 <_sk_callback_hsw+0x26c> + .byte 196,98,125,24,29,158,48,0,0 // vbroadcastss 0x309e(%rip),%ymm11 # 4ad8 <_sk_callback_hsw+0x280> .byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8 .byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0 .byte 196,226,53,168,196 // vfmadd213ps %ymm4,%ymm9,%ymm0 @@ -11440,9 +11447,9 @@ _sk_lerp_565_hsw: .byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,68,255,255,255 // ja 19cf <_sk_lerp_565_hsw+0x14> + .byte 15,135,68,255,255,255 // ja 19d7 <_sk_lerp_565_hsw+0x14> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 1ae0 <_sk_lerp_565_hsw+0x125> + .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 1ae8 <_sk_lerp_565_hsw+0x125> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -11454,7 +11461,7 @@ _sk_lerp_565_hsw: .byte 196,65,57,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8 .byte 196,65,57,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8 .byte 196,65,57,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8 - .byte 233,239,254,255,255 // jmpq 19cf <_sk_lerp_565_hsw+0x14> + .byte 233,239,254,255,255 // jmpq 19d7 <_sk_lerp_565_hsw+0x14> .byte 244 // hlt .byte 255 // (bad) .byte 255 // (bad) @@ -11489,23 +11496,23 @@ _sk_load_tables_hsw: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,105 // jne 1b7a <_sk_load_tables_hsw+0x7e> + .byte 117,105 // jne 1b82 <_sk_load_tables_hsw+0x7e> .byte 196,193,124,16,26 // vmovups (%r10),%ymm3 - .byte 197,228,84,13,66,51,0,0 // vandps 0x3342(%rip),%ymm3,%ymm1 # 4e60 <_sk_callback_hsw+0x5b4> + .byte 197,228,84,13,250,50,0,0 // vandps 0x32fa(%rip),%ymm3,%ymm1 # 4e20 <_sk_callback_hsw+0x5c8> .byte 196,65,61,118,192 // vpcmpeqd %ymm8,%ymm8,%ymm8 .byte 72,139,72,8 // mov 0x8(%rax),%rcx .byte 76,139,80,16 // mov 0x10(%rax),%r10 .byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2 .byte 196,226,109,146,4,137 // vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0 - .byte 196,226,101,0,21,66,51,0,0 // vpshufb 0x3342(%rip),%ymm3,%ymm2 # 4e80 <_sk_callback_hsw+0x5d4> + .byte 196,226,101,0,21,250,50,0,0 // vpshufb 0x32fa(%rip),%ymm3,%ymm2 # 4e40 <_sk_callback_hsw+0x5e8> .byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9 .byte 196,194,53,146,12,146 // vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1 .byte 72,139,64,24 // mov 0x18(%rax),%rax - .byte 196,98,101,0,13,74,51,0,0 // vpshufb 0x334a(%rip),%ymm3,%ymm9 # 4ea0 <_sk_callback_hsw+0x5f4> + .byte 196,98,101,0,13,2,51,0,0 // vpshufb 0x3302(%rip),%ymm3,%ymm9 # 4e60 <_sk_callback_hsw+0x608> .byte 196,162,61,146,20,136 // vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2 .byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,174,47,0,0 // vbroadcastss 0x2fae(%rip),%ymm8 # 4b1c <_sk_callback_hsw+0x270> + .byte 196,98,125,24,5,102,47,0,0 // vbroadcastss 0x2f66(%rip),%ymm8 # 4adc <_sk_callback_hsw+0x284> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -11518,7 +11525,7 @@ _sk_load_tables_hsw: .byte 196,193,249,110,195 // vmovq %r11,%xmm0 .byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0 .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3 - .byte 233,115,255,255,255 // jmpq 1b16 <_sk_load_tables_hsw+0x1a> + .byte 233,115,255,255,255 // jmpq 1b1e <_sk_load_tables_hsw+0x1a> HIDDEN _sk_load_tables_u16_be_hsw .globl _sk_load_tables_u16_be_hsw @@ -11528,7 +11535,7 @@ _sk_load_tables_u16_be_hsw: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,201,0,0,0 // jne 1c82 <_sk_load_tables_u16_be_hsw+0xdf> + .byte 15,133,201,0,0,0 // jne 1c8a <_sk_load_tables_u16_be_hsw+0xdf> .byte 196,1,121,16,4,81 // vmovupd (%r9,%r10,2),%xmm8 .byte 196,129,121,16,84,81,16 // vmovupd 0x10(%r9,%r10,2),%xmm2 .byte 196,129,121,16,92,81,32 // vmovupd 0x20(%r9,%r10,2),%xmm3 @@ -11544,7 +11551,7 @@ _sk_load_tables_u16_be_hsw: .byte 197,185,108,200 // vpunpcklqdq %xmm0,%xmm8,%xmm1 .byte 197,185,109,208 // vpunpckhqdq %xmm0,%xmm8,%xmm2 .byte 197,49,108,195 // vpunpcklqdq %xmm3,%xmm9,%xmm8 - .byte 197,121,111,21,214,51,0,0 // vmovdqa 0x33d6(%rip),%xmm10 # 4fe0 <_sk_callback_hsw+0x734> + .byte 197,121,111,21,142,51,0,0 // vmovdqa 0x338e(%rip),%xmm10 # 4fa0 <_sk_callback_hsw+0x748> .byte 196,193,113,219,194 // vpand %xmm10,%xmm1,%xmm0 .byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1 .byte 196,65,37,118,219 // vpcmpeqd %ymm11,%ymm11,%ymm11 @@ -11566,36 +11573,36 @@ _sk_load_tables_u16_be_hsw: .byte 197,185,235,219 // vpor %xmm3,%xmm8,%xmm3 .byte 196,226,125,51,219 // vpmovzxwd %xmm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,167,46,0,0 // vbroadcastss 0x2ea7(%rip),%ymm8 # 4b20 <_sk_callback_hsw+0x274> + .byte 196,98,125,24,5,95,46,0,0 // vbroadcastss 0x2e5f(%rip),%ymm8 # 4ae0 <_sk_callback_hsw+0x288> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 196,1,123,16,4,81 // vmovsd (%r9,%r10,2),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,85 // je 1ce8 <_sk_load_tables_u16_be_hsw+0x145> + .byte 116,85 // je 1cf0 <_sk_load_tables_u16_be_hsw+0x145> .byte 196,1,57,22,68,81,8 // vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,72 // jb 1ce8 <_sk_load_tables_u16_be_hsw+0x145> + .byte 114,72 // jb 1cf0 <_sk_load_tables_u16_be_hsw+0x145> .byte 196,129,123,16,84,81,16 // vmovsd 0x10(%r9,%r10,2),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,72 // je 1cf5 <_sk_load_tables_u16_be_hsw+0x152> + .byte 116,72 // je 1cfd <_sk_load_tables_u16_be_hsw+0x152> .byte 196,129,105,22,84,81,24 // vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,59 // jb 1cf5 <_sk_load_tables_u16_be_hsw+0x152> + .byte 114,59 // jb 1cfd <_sk_load_tables_u16_be_hsw+0x152> .byte 196,129,123,16,92,81,32 // vmovsd 0x20(%r9,%r10,2),%xmm3 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,9,255,255,255 // je 1bd4 <_sk_load_tables_u16_be_hsw+0x31> + .byte 15,132,9,255,255,255 // je 1bdc <_sk_load_tables_u16_be_hsw+0x31> .byte 196,129,97,22,92,81,40 // vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,248,254,255,255 // jb 1bd4 <_sk_load_tables_u16_be_hsw+0x31> + .byte 15,130,248,254,255,255 // jb 1bdc <_sk_load_tables_u16_be_hsw+0x31> .byte 196,1,122,126,76,81,48 // vmovq 0x30(%r9,%r10,2),%xmm9 - .byte 233,236,254,255,255 // jmpq 1bd4 <_sk_load_tables_u16_be_hsw+0x31> + .byte 233,236,254,255,255 // jmpq 1bdc <_sk_load_tables_u16_be_hsw+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,223,254,255,255 // jmpq 1bd4 <_sk_load_tables_u16_be_hsw+0x31> + .byte 233,223,254,255,255 // jmpq 1bdc <_sk_load_tables_u16_be_hsw+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 - .byte 233,214,254,255,255 // jmpq 1bd4 <_sk_load_tables_u16_be_hsw+0x31> + .byte 233,214,254,255,255 // jmpq 1bdc <_sk_load_tables_u16_be_hsw+0x31> HIDDEN _sk_load_tables_rgb_u16_be_hsw .globl _sk_load_tables_rgb_u16_be_hsw @@ -11605,7 +11612,7 @@ _sk_load_tables_rgb_u16_be_hsw: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,193,0,0,0 // jne 1dd1 <_sk_load_tables_rgb_u16_be_hsw+0xd3> + .byte 15,133,193,0,0,0 // jne 1dd9 <_sk_load_tables_rgb_u16_be_hsw+0xd3> .byte 196,129,122,111,4,81 // vmovdqu (%r9,%r10,2),%xmm0 .byte 196,129,122,111,84,81,12 // vmovdqu 0xc(%r9,%r10,2),%xmm2 .byte 196,129,122,111,76,81,24 // vmovdqu 0x18(%r9,%r10,2),%xmm1 @@ -11626,7 +11633,7 @@ _sk_load_tables_rgb_u16_be_hsw: .byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3 .byte 197,185,109,210 // vpunpckhqdq %xmm2,%xmm8,%xmm2 .byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8 - .byte 197,121,111,13,118,50,0,0 // vmovdqa 0x3276(%rip),%xmm9 # 4ff0 <_sk_callback_hsw+0x744> + .byte 197,121,111,13,46,50,0,0 // vmovdqa 0x322e(%rip),%xmm9 # 4fb0 <_sk_callback_hsw+0x758> .byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0 .byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1 .byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3 @@ -11643,48 +11650,48 @@ _sk_load_tables_rgb_u16_be_hsw: .byte 196,98,125,51,194 // vpmovzxwd %xmm2,%ymm8 .byte 196,162,101,146,20,128 // vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,85,45,0,0 // vbroadcastss 0x2d55(%rip),%ymm3 # 4b24 <_sk_callback_hsw+0x278> + .byte 196,226,125,24,29,13,45,0,0 // vbroadcastss 0x2d0d(%rip),%ymm3 # 4ae4 <_sk_callback_hsw+0x28c> .byte 255,224 // jmpq *%rax .byte 196,129,121,110,4,81 // vmovd (%r9,%r10,2),%xmm0 .byte 196,129,121,196,68,81,4,2 // vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,5 // jne 1dea <_sk_load_tables_rgb_u16_be_hsw+0xec> - .byte 233,90,255,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 117,5 // jne 1df2 <_sk_load_tables_rgb_u16_be_hsw+0xec> + .byte 233,90,255,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> .byte 196,129,121,110,76,81,6 // vmovd 0x6(%r9,%r10,2),%xmm1 .byte 196,1,113,196,68,81,10,2 // vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,26 // jb 1e19 <_sk_load_tables_rgb_u16_be_hsw+0x11b> + .byte 114,26 // jb 1e21 <_sk_load_tables_rgb_u16_be_hsw+0x11b> .byte 196,129,121,110,76,81,12 // vmovd 0xc(%r9,%r10,2),%xmm1 .byte 196,129,113,196,84,81,16,2 // vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 117,10 // jne 1e1e <_sk_load_tables_rgb_u16_be_hsw+0x120> - .byte 233,43,255,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> - .byte 233,38,255,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 117,10 // jne 1e26 <_sk_load_tables_rgb_u16_be_hsw+0x120> + .byte 233,43,255,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 233,38,255,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> .byte 196,129,121,110,76,81,18 // vmovd 0x12(%r9,%r10,2),%xmm1 .byte 196,1,113,196,76,81,22,2 // vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,26 // jb 1e4d <_sk_load_tables_rgb_u16_be_hsw+0x14f> + .byte 114,26 // jb 1e55 <_sk_load_tables_rgb_u16_be_hsw+0x14f> .byte 196,129,121,110,76,81,24 // vmovd 0x18(%r9,%r10,2),%xmm1 .byte 196,129,113,196,76,81,28,2 // vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 117,10 // jne 1e52 <_sk_load_tables_rgb_u16_be_hsw+0x154> - .byte 233,247,254,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> - .byte 233,242,254,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 117,10 // jne 1e5a <_sk_load_tables_rgb_u16_be_hsw+0x154> + .byte 233,247,254,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 233,242,254,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> .byte 196,129,121,110,92,81,30 // vmovd 0x1e(%r9,%r10,2),%xmm3 .byte 196,1,97,196,92,81,34,2 // vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,20 // jb 1e7b <_sk_load_tables_rgb_u16_be_hsw+0x17d> + .byte 114,20 // jb 1e83 <_sk_load_tables_rgb_u16_be_hsw+0x17d> .byte 196,129,121,110,92,81,36 // vmovd 0x24(%r9,%r10,2),%xmm3 .byte 196,129,97,196,92,81,40,2 // vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3 - .byte 233,201,254,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> - .byte 233,196,254,255,255 // jmpq 1d44 <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 233,201,254,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> + .byte 233,196,254,255,255 // jmpq 1d4c <_sk_load_tables_rgb_u16_be_hsw+0x46> HIDDEN _sk_byte_tables_hsw .globl _sk_byte_tables_hsw FUNCTION(_sk_byte_tables_hsw) _sk_byte_tables_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,157,44,0,0 // vbroadcastss 0x2c9d(%rip),%ymm8 # 4b28 <_sk_callback_hsw+0x27c> + .byte 196,98,125,24,5,85,44,0,0 // vbroadcastss 0x2c55(%rip),%ymm8 # 4ae8 <_sk_callback_hsw+0x290> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9 .byte 196,65,249,126,201 // vmovq %xmm9,%r9 @@ -11806,7 +11813,7 @@ _sk_byte_tables_hsw: .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax .byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,66,42,0,0 // vbroadcastss 0x2a42(%rip),%ymm8 # 4b2c <_sk_callback_hsw+0x280> + .byte 196,98,125,24,5,250,41,0,0 // vbroadcastss 0x29fa(%rip),%ymm8 # 4aec <_sk_callback_hsw+0x294> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 @@ -11922,7 +11929,7 @@ _sk_byte_tables_rgb_hsw: .byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax .byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,46,40,0,0 // vbroadcastss 0x282e(%rip),%ymm8 # 4b30 <_sk_callback_hsw+0x284> + .byte 196,98,125,24,5,230,39,0,0 // vbroadcastss 0x27e6(%rip),%ymm8 # 4af0 <_sk_callback_hsw+0x298> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 @@ -12021,33 +12028,33 @@ _sk_parametric_r_hsw: .byte 196,66,125,168,211 // vfmadd213ps %ymm11,%ymm0,%ymm10 .byte 196,226,125,24,0 // vbroadcastss (%rax),%ymm0 .byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11 - .byte 196,98,125,24,37,8,39,0,0 // vbroadcastss 0x2708(%rip),%ymm12 # 4b34 <_sk_callback_hsw+0x288> - .byte 196,98,125,24,45,3,39,0,0 // vbroadcastss 0x2703(%rip),%ymm13 # 4b38 <_sk_callback_hsw+0x28c> + .byte 196,98,125,24,37,192,38,0,0 // vbroadcastss 0x26c0(%rip),%ymm12 # 4af4 <_sk_callback_hsw+0x29c> + .byte 196,98,125,24,45,187,38,0,0 // vbroadcastss 0x26bb(%rip),%ymm13 # 4af8 <_sk_callback_hsw+0x2a0> .byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,249,38,0,0 // vbroadcastss 0x26f9(%rip),%ymm13 # 4b3c <_sk_callback_hsw+0x290> + .byte 196,98,125,24,45,177,38,0,0 // vbroadcastss 0x26b1(%rip),%ymm13 # 4afc <_sk_callback_hsw+0x2a4> .byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,239,38,0,0 // vbroadcastss 0x26ef(%rip),%ymm13 # 4b40 <_sk_callback_hsw+0x294> + .byte 196,98,125,24,45,167,38,0,0 // vbroadcastss 0x26a7(%rip),%ymm13 # 4b00 <_sk_callback_hsw+0x2a8> .byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13 - .byte 196,98,125,24,29,229,38,0,0 // vbroadcastss 0x26e5(%rip),%ymm11 # 4b44 <_sk_callback_hsw+0x298> + .byte 196,98,125,24,29,157,38,0,0 // vbroadcastss 0x269d(%rip),%ymm11 # 4b04 <_sk_callback_hsw+0x2ac> .byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11 - .byte 196,98,125,24,37,219,38,0,0 // vbroadcastss 0x26db(%rip),%ymm12 # 4b48 <_sk_callback_hsw+0x29c> + .byte 196,98,125,24,37,147,38,0,0 // vbroadcastss 0x2693(%rip),%ymm12 # 4b08 <_sk_callback_hsw+0x2b0> .byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,37,209,38,0,0 // vbroadcastss 0x26d1(%rip),%ymm12 # 4b4c <_sk_callback_hsw+0x2a0> + .byte 196,98,125,24,37,137,38,0,0 // vbroadcastss 0x2689(%rip),%ymm12 # 4b0c <_sk_callback_hsw+0x2b4> .byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10 .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 .byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0 .byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10 .byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10 - .byte 196,98,125,24,29,178,38,0,0 // vbroadcastss 0x26b2(%rip),%ymm11 # 4b50 <_sk_callback_hsw+0x2a4> + .byte 196,98,125,24,29,106,38,0,0 // vbroadcastss 0x266a(%rip),%ymm11 # 4b10 <_sk_callback_hsw+0x2b8> .byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0 - .byte 196,98,125,24,29,168,38,0,0 // vbroadcastss 0x26a8(%rip),%ymm11 # 4b54 <_sk_callback_hsw+0x2a8> + .byte 196,98,125,24,29,96,38,0,0 // vbroadcastss 0x2660(%rip),%ymm11 # 4b14 <_sk_callback_hsw+0x2bc> .byte 196,98,45,172,216 // vfnmadd213ps %ymm0,%ymm10,%ymm11 - .byte 196,226,125,24,5,158,38,0,0 // vbroadcastss 0x269e(%rip),%ymm0 # 4b58 <_sk_callback_hsw+0x2ac> + .byte 196,226,125,24,5,86,38,0,0 // vbroadcastss 0x2656(%rip),%ymm0 # 4b18 <_sk_callback_hsw+0x2c0> .byte 196,193,124,92,194 // vsubps %ymm10,%ymm0,%ymm0 - .byte 196,98,125,24,21,148,38,0,0 // vbroadcastss 0x2694(%rip),%ymm10 # 4b5c <_sk_callback_hsw+0x2b0> + .byte 196,98,125,24,21,76,38,0,0 // vbroadcastss 0x264c(%rip),%ymm10 # 4b1c <_sk_callback_hsw+0x2c4> .byte 197,172,94,192 // vdivps %ymm0,%ymm10,%ymm0 .byte 197,164,88,192 // vaddps %ymm0,%ymm11,%ymm0 - .byte 196,98,125,24,21,135,38,0,0 // vbroadcastss 0x2687(%rip),%ymm10 # 4b60 <_sk_callback_hsw+0x2b4> + .byte 196,98,125,24,21,63,38,0,0 // vbroadcastss 0x263f(%rip),%ymm10 # 4b20 <_sk_callback_hsw+0x2c8> .byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0 .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -12055,7 +12062,7 @@ _sk_parametric_r_hsw: .byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,5,94,38,0,0 // vbroadcastss 0x265e(%rip),%ymm8 # 4b64 <_sk_callback_hsw+0x2b8> + .byte 196,98,125,24,5,22,38,0,0 // vbroadcastss 0x2616(%rip),%ymm8 # 4b24 <_sk_callback_hsw+0x2cc> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12075,33 +12082,33 @@ _sk_parametric_g_hsw: .byte 196,66,117,168,211 // vfmadd213ps %ymm11,%ymm1,%ymm10 .byte 196,226,125,24,8 // vbroadcastss (%rax),%ymm1 .byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11 - .byte 196,98,125,24,37,22,38,0,0 // vbroadcastss 0x2616(%rip),%ymm12 # 4b68 <_sk_callback_hsw+0x2bc> - .byte 196,98,125,24,45,17,38,0,0 // vbroadcastss 0x2611(%rip),%ymm13 # 4b6c <_sk_callback_hsw+0x2c0> + .byte 196,98,125,24,37,206,37,0,0 // vbroadcastss 0x25ce(%rip),%ymm12 # 4b28 <_sk_callback_hsw+0x2d0> + .byte 196,98,125,24,45,201,37,0,0 // vbroadcastss 0x25c9(%rip),%ymm13 # 4b2c <_sk_callback_hsw+0x2d4> .byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,7,38,0,0 // vbroadcastss 0x2607(%rip),%ymm13 # 4b70 <_sk_callback_hsw+0x2c4> + .byte 196,98,125,24,45,191,37,0,0 // vbroadcastss 0x25bf(%rip),%ymm13 # 4b30 <_sk_callback_hsw+0x2d8> .byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,253,37,0,0 // vbroadcastss 0x25fd(%rip),%ymm13 # 4b74 <_sk_callback_hsw+0x2c8> + .byte 196,98,125,24,45,181,37,0,0 // vbroadcastss 0x25b5(%rip),%ymm13 # 4b34 <_sk_callback_hsw+0x2dc> .byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13 - .byte 196,98,125,24,29,243,37,0,0 // vbroadcastss 0x25f3(%rip),%ymm11 # 4b78 <_sk_callback_hsw+0x2cc> + .byte 196,98,125,24,29,171,37,0,0 // vbroadcastss 0x25ab(%rip),%ymm11 # 4b38 <_sk_callback_hsw+0x2e0> .byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11 - .byte 196,98,125,24,37,233,37,0,0 // vbroadcastss 0x25e9(%rip),%ymm12 # 4b7c <_sk_callback_hsw+0x2d0> + .byte 196,98,125,24,37,161,37,0,0 // vbroadcastss 0x25a1(%rip),%ymm12 # 4b3c <_sk_callback_hsw+0x2e4> .byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,37,223,37,0,0 // vbroadcastss 0x25df(%rip),%ymm12 # 4b80 <_sk_callback_hsw+0x2d4> + .byte 196,98,125,24,37,151,37,0,0 // vbroadcastss 0x2597(%rip),%ymm12 # 4b40 <_sk_callback_hsw+0x2e8> .byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10 .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 .byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1 .byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10 .byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10 - .byte 196,98,125,24,29,192,37,0,0 // vbroadcastss 0x25c0(%rip),%ymm11 # 4b84 <_sk_callback_hsw+0x2d8> + .byte 196,98,125,24,29,120,37,0,0 // vbroadcastss 0x2578(%rip),%ymm11 # 4b44 <_sk_callback_hsw+0x2ec> .byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,29,182,37,0,0 // vbroadcastss 0x25b6(%rip),%ymm11 # 4b88 <_sk_callback_hsw+0x2dc> + .byte 196,98,125,24,29,110,37,0,0 // vbroadcastss 0x256e(%rip),%ymm11 # 4b48 <_sk_callback_hsw+0x2f0> .byte 196,98,45,172,217 // vfnmadd213ps %ymm1,%ymm10,%ymm11 - .byte 196,226,125,24,13,172,37,0,0 // vbroadcastss 0x25ac(%rip),%ymm1 # 4b8c <_sk_callback_hsw+0x2e0> + .byte 196,226,125,24,13,100,37,0,0 // vbroadcastss 0x2564(%rip),%ymm1 # 4b4c <_sk_callback_hsw+0x2f4> .byte 196,193,116,92,202 // vsubps %ymm10,%ymm1,%ymm1 - .byte 196,98,125,24,21,162,37,0,0 // vbroadcastss 0x25a2(%rip),%ymm10 # 4b90 <_sk_callback_hsw+0x2e4> + .byte 196,98,125,24,21,90,37,0,0 // vbroadcastss 0x255a(%rip),%ymm10 # 4b50 <_sk_callback_hsw+0x2f8> .byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1 .byte 197,164,88,201 // vaddps %ymm1,%ymm11,%ymm1 - .byte 196,98,125,24,21,149,37,0,0 // vbroadcastss 0x2595(%rip),%ymm10 # 4b94 <_sk_callback_hsw+0x2e8> + .byte 196,98,125,24,21,77,37,0,0 // vbroadcastss 0x254d(%rip),%ymm10 # 4b54 <_sk_callback_hsw+0x2fc> .byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1 .byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -12109,7 +12116,7 @@ _sk_parametric_g_hsw: .byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1 - .byte 196,98,125,24,5,108,37,0,0 // vbroadcastss 0x256c(%rip),%ymm8 # 4b98 <_sk_callback_hsw+0x2ec> + .byte 196,98,125,24,5,36,37,0,0 // vbroadcastss 0x2524(%rip),%ymm8 # 4b58 <_sk_callback_hsw+0x300> .byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12129,33 +12136,33 @@ _sk_parametric_b_hsw: .byte 196,66,109,168,211 // vfmadd213ps %ymm11,%ymm2,%ymm10 .byte 196,226,125,24,16 // vbroadcastss (%rax),%ymm2 .byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11 - .byte 196,98,125,24,37,36,37,0,0 // vbroadcastss 0x2524(%rip),%ymm12 # 4b9c <_sk_callback_hsw+0x2f0> - .byte 196,98,125,24,45,31,37,0,0 // vbroadcastss 0x251f(%rip),%ymm13 # 4ba0 <_sk_callback_hsw+0x2f4> + .byte 196,98,125,24,37,220,36,0,0 // vbroadcastss 0x24dc(%rip),%ymm12 # 4b5c <_sk_callback_hsw+0x304> + .byte 196,98,125,24,45,215,36,0,0 // vbroadcastss 0x24d7(%rip),%ymm13 # 4b60 <_sk_callback_hsw+0x308> .byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,21,37,0,0 // vbroadcastss 0x2515(%rip),%ymm13 # 4ba4 <_sk_callback_hsw+0x2f8> + .byte 196,98,125,24,45,205,36,0,0 // vbroadcastss 0x24cd(%rip),%ymm13 # 4b64 <_sk_callback_hsw+0x30c> .byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,11,37,0,0 // vbroadcastss 0x250b(%rip),%ymm13 # 4ba8 <_sk_callback_hsw+0x2fc> + .byte 196,98,125,24,45,195,36,0,0 // vbroadcastss 0x24c3(%rip),%ymm13 # 4b68 <_sk_callback_hsw+0x310> .byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13 - .byte 196,98,125,24,29,1,37,0,0 // vbroadcastss 0x2501(%rip),%ymm11 # 4bac <_sk_callback_hsw+0x300> + .byte 196,98,125,24,29,185,36,0,0 // vbroadcastss 0x24b9(%rip),%ymm11 # 4b6c <_sk_callback_hsw+0x314> .byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11 - .byte 196,98,125,24,37,247,36,0,0 // vbroadcastss 0x24f7(%rip),%ymm12 # 4bb0 <_sk_callback_hsw+0x304> + .byte 196,98,125,24,37,175,36,0,0 // vbroadcastss 0x24af(%rip),%ymm12 # 4b70 <_sk_callback_hsw+0x318> .byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,37,237,36,0,0 // vbroadcastss 0x24ed(%rip),%ymm12 # 4bb4 <_sk_callback_hsw+0x308> + .byte 196,98,125,24,37,165,36,0,0 // vbroadcastss 0x24a5(%rip),%ymm12 # 4b74 <_sk_callback_hsw+0x31c> .byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10 .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 .byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2 .byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10 .byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10 - .byte 196,98,125,24,29,206,36,0,0 // vbroadcastss 0x24ce(%rip),%ymm11 # 4bb8 <_sk_callback_hsw+0x30c> + .byte 196,98,125,24,29,134,36,0,0 // vbroadcastss 0x2486(%rip),%ymm11 # 4b78 <_sk_callback_hsw+0x320> .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 - .byte 196,98,125,24,29,196,36,0,0 // vbroadcastss 0x24c4(%rip),%ymm11 # 4bbc <_sk_callback_hsw+0x310> + .byte 196,98,125,24,29,124,36,0,0 // vbroadcastss 0x247c(%rip),%ymm11 # 4b7c <_sk_callback_hsw+0x324> .byte 196,98,45,172,218 // vfnmadd213ps %ymm2,%ymm10,%ymm11 - .byte 196,226,125,24,21,186,36,0,0 // vbroadcastss 0x24ba(%rip),%ymm2 # 4bc0 <_sk_callback_hsw+0x314> + .byte 196,226,125,24,21,114,36,0,0 // vbroadcastss 0x2472(%rip),%ymm2 # 4b80 <_sk_callback_hsw+0x328> .byte 196,193,108,92,210 // vsubps %ymm10,%ymm2,%ymm2 - .byte 196,98,125,24,21,176,36,0,0 // vbroadcastss 0x24b0(%rip),%ymm10 # 4bc4 <_sk_callback_hsw+0x318> + .byte 196,98,125,24,21,104,36,0,0 // vbroadcastss 0x2468(%rip),%ymm10 # 4b84 <_sk_callback_hsw+0x32c> .byte 197,172,94,210 // vdivps %ymm2,%ymm10,%ymm2 .byte 197,164,88,210 // vaddps %ymm2,%ymm11,%ymm2 - .byte 196,98,125,24,21,163,36,0,0 // vbroadcastss 0x24a3(%rip),%ymm10 # 4bc8 <_sk_callback_hsw+0x31c> + .byte 196,98,125,24,21,91,36,0,0 // vbroadcastss 0x245b(%rip),%ymm10 # 4b88 <_sk_callback_hsw+0x330> .byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2 .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -12163,7 +12170,7 @@ _sk_parametric_b_hsw: .byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,122,36,0,0 // vbroadcastss 0x247a(%rip),%ymm8 # 4bcc <_sk_callback_hsw+0x320> + .byte 196,98,125,24,5,50,36,0,0 // vbroadcastss 0x2432(%rip),%ymm8 # 4b8c <_sk_callback_hsw+0x334> .byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12183,33 +12190,33 @@ _sk_parametric_a_hsw: .byte 196,66,101,168,211 // vfmadd213ps %ymm11,%ymm3,%ymm10 .byte 196,226,125,24,24 // vbroadcastss (%rax),%ymm3 .byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11 - .byte 196,98,125,24,37,50,36,0,0 // vbroadcastss 0x2432(%rip),%ymm12 # 4bd0 <_sk_callback_hsw+0x324> - .byte 196,98,125,24,45,45,36,0,0 // vbroadcastss 0x242d(%rip),%ymm13 # 4bd4 <_sk_callback_hsw+0x328> + .byte 196,98,125,24,37,234,35,0,0 // vbroadcastss 0x23ea(%rip),%ymm12 # 4b90 <_sk_callback_hsw+0x338> + .byte 196,98,125,24,45,229,35,0,0 // vbroadcastss 0x23e5(%rip),%ymm13 # 4b94 <_sk_callback_hsw+0x33c> .byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,35,36,0,0 // vbroadcastss 0x2423(%rip),%ymm13 # 4bd8 <_sk_callback_hsw+0x32c> + .byte 196,98,125,24,45,219,35,0,0 // vbroadcastss 0x23db(%rip),%ymm13 # 4b98 <_sk_callback_hsw+0x340> .byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10 - .byte 196,98,125,24,45,25,36,0,0 // vbroadcastss 0x2419(%rip),%ymm13 # 4bdc <_sk_callback_hsw+0x330> + .byte 196,98,125,24,45,209,35,0,0 // vbroadcastss 0x23d1(%rip),%ymm13 # 4b9c <_sk_callback_hsw+0x344> .byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13 - .byte 196,98,125,24,29,15,36,0,0 // vbroadcastss 0x240f(%rip),%ymm11 # 4be0 <_sk_callback_hsw+0x334> + .byte 196,98,125,24,29,199,35,0,0 // vbroadcastss 0x23c7(%rip),%ymm11 # 4ba0 <_sk_callback_hsw+0x348> .byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11 - .byte 196,98,125,24,37,5,36,0,0 // vbroadcastss 0x2405(%rip),%ymm12 # 4be4 <_sk_callback_hsw+0x338> + .byte 196,98,125,24,37,189,35,0,0 // vbroadcastss 0x23bd(%rip),%ymm12 # 4ba4 <_sk_callback_hsw+0x34c> .byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,37,251,35,0,0 // vbroadcastss 0x23fb(%rip),%ymm12 # 4be8 <_sk_callback_hsw+0x33c> + .byte 196,98,125,24,37,179,35,0,0 // vbroadcastss 0x23b3(%rip),%ymm12 # 4ba8 <_sk_callback_hsw+0x350> .byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10 .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 .byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3 .byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10 .byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10 - .byte 196,98,125,24,29,220,35,0,0 // vbroadcastss 0x23dc(%rip),%ymm11 # 4bec <_sk_callback_hsw+0x340> + .byte 196,98,125,24,29,148,35,0,0 // vbroadcastss 0x2394(%rip),%ymm11 # 4bac <_sk_callback_hsw+0x354> .byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3 - .byte 196,98,125,24,29,210,35,0,0 // vbroadcastss 0x23d2(%rip),%ymm11 # 4bf0 <_sk_callback_hsw+0x344> + .byte 196,98,125,24,29,138,35,0,0 // vbroadcastss 0x238a(%rip),%ymm11 # 4bb0 <_sk_callback_hsw+0x358> .byte 196,98,45,172,219 // vfnmadd213ps %ymm3,%ymm10,%ymm11 - .byte 196,226,125,24,29,200,35,0,0 // vbroadcastss 0x23c8(%rip),%ymm3 # 4bf4 <_sk_callback_hsw+0x348> + .byte 196,226,125,24,29,128,35,0,0 // vbroadcastss 0x2380(%rip),%ymm3 # 4bb4 <_sk_callback_hsw+0x35c> .byte 196,193,100,92,218 // vsubps %ymm10,%ymm3,%ymm3 - .byte 196,98,125,24,21,190,35,0,0 // vbroadcastss 0x23be(%rip),%ymm10 # 4bf8 <_sk_callback_hsw+0x34c> + .byte 196,98,125,24,21,118,35,0,0 // vbroadcastss 0x2376(%rip),%ymm10 # 4bb8 <_sk_callback_hsw+0x360> .byte 197,172,94,219 // vdivps %ymm3,%ymm10,%ymm3 .byte 197,164,88,219 // vaddps %ymm3,%ymm11,%ymm3 - .byte 196,98,125,24,21,177,35,0,0 // vbroadcastss 0x23b1(%rip),%ymm10 # 4bfc <_sk_callback_hsw+0x350> + .byte 196,98,125,24,21,105,35,0,0 // vbroadcastss 0x2369(%rip),%ymm10 # 4bbc <_sk_callback_hsw+0x364> .byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3 .byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -12217,7 +12224,7 @@ _sk_parametric_a_hsw: .byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3 - .byte 196,98,125,24,5,136,35,0,0 // vbroadcastss 0x2388(%rip),%ymm8 # 4c00 <_sk_callback_hsw+0x354> + .byte 196,98,125,24,5,64,35,0,0 // vbroadcastss 0x2340(%rip),%ymm8 # 4bc0 <_sk_callback_hsw+0x368> .byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12226,26 +12233,26 @@ HIDDEN _sk_lab_to_xyz_hsw .globl _sk_lab_to_xyz_hsw FUNCTION(_sk_lab_to_xyz_hsw) _sk_lab_to_xyz_hsw: - .byte 196,98,125,24,5,122,35,0,0 // vbroadcastss 0x237a(%rip),%ymm8 # 4c04 <_sk_callback_hsw+0x358> - .byte 196,98,125,24,13,117,35,0,0 // vbroadcastss 0x2375(%rip),%ymm9 # 4c08 <_sk_callback_hsw+0x35c> - .byte 196,98,125,24,21,112,35,0,0 // vbroadcastss 0x2370(%rip),%ymm10 # 4c0c <_sk_callback_hsw+0x360> + .byte 196,98,125,24,5,50,35,0,0 // vbroadcastss 0x2332(%rip),%ymm8 # 4bc4 <_sk_callback_hsw+0x36c> + .byte 196,98,125,24,13,45,35,0,0 // vbroadcastss 0x232d(%rip),%ymm9 # 4bc8 <_sk_callback_hsw+0x370> + .byte 196,98,125,24,21,40,35,0,0 // vbroadcastss 0x2328(%rip),%ymm10 # 4bcc <_sk_callback_hsw+0x374> .byte 196,194,53,168,202 // vfmadd213ps %ymm10,%ymm9,%ymm1 .byte 196,194,53,168,210 // vfmadd213ps %ymm10,%ymm9,%ymm2 - .byte 196,98,125,24,13,97,35,0,0 // vbroadcastss 0x2361(%rip),%ymm9 # 4c10 <_sk_callback_hsw+0x364> + .byte 196,98,125,24,13,25,35,0,0 // vbroadcastss 0x2319(%rip),%ymm9 # 4bd0 <_sk_callback_hsw+0x378> .byte 196,66,125,184,200 // vfmadd231ps %ymm8,%ymm0,%ymm9 - .byte 196,226,125,24,5,87,35,0,0 // vbroadcastss 0x2357(%rip),%ymm0 # 4c14 <_sk_callback_hsw+0x368> + .byte 196,226,125,24,5,15,35,0,0 // vbroadcastss 0x230f(%rip),%ymm0 # 4bd4 <_sk_callback_hsw+0x37c> .byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0 - .byte 196,98,125,24,5,78,35,0,0 // vbroadcastss 0x234e(%rip),%ymm8 # 4c18 <_sk_callback_hsw+0x36c> + .byte 196,98,125,24,5,6,35,0,0 // vbroadcastss 0x2306(%rip),%ymm8 # 4bd8 <_sk_callback_hsw+0x380> .byte 196,98,117,168,192 // vfmadd213ps %ymm0,%ymm1,%ymm8 - .byte 196,98,125,24,13,68,35,0,0 // vbroadcastss 0x2344(%rip),%ymm9 # 4c1c <_sk_callback_hsw+0x370> + .byte 196,98,125,24,13,252,34,0,0 // vbroadcastss 0x22fc(%rip),%ymm9 # 4bdc <_sk_callback_hsw+0x384> .byte 196,98,109,172,200 // vfnmadd213ps %ymm0,%ymm2,%ymm9 .byte 196,193,60,89,200 // vmulps %ymm8,%ymm8,%ymm1 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 - .byte 196,226,125,24,21,49,35,0,0 // vbroadcastss 0x2331(%rip),%ymm2 # 4c20 <_sk_callback_hsw+0x374> + .byte 196,226,125,24,21,233,34,0,0 // vbroadcastss 0x22e9(%rip),%ymm2 # 4be0 <_sk_callback_hsw+0x388> .byte 197,108,194,209,1 // vcmpltps %ymm1,%ymm2,%ymm10 - .byte 196,98,125,24,29,39,35,0,0 // vbroadcastss 0x2327(%rip),%ymm11 # 4c24 <_sk_callback_hsw+0x378> + .byte 196,98,125,24,29,223,34,0,0 // vbroadcastss 0x22df(%rip),%ymm11 # 4be4 <_sk_callback_hsw+0x38c> .byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8 - .byte 196,98,125,24,37,29,35,0,0 // vbroadcastss 0x231d(%rip),%ymm12 # 4c28 <_sk_callback_hsw+0x37c> + .byte 196,98,125,24,37,213,34,0,0 // vbroadcastss 0x22d5(%rip),%ymm12 # 4be8 <_sk_callback_hsw+0x390> .byte 196,65,60,89,196 // vmulps %ymm12,%ymm8,%ymm8 .byte 196,99,61,74,193,160 // vblendvps %ymm10,%ymm1,%ymm8,%ymm8 .byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1 @@ -12260,9 +12267,9 @@ _sk_lab_to_xyz_hsw: .byte 196,65,52,88,203 // vaddps %ymm11,%ymm9,%ymm9 .byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9 .byte 196,227,53,74,208,32 // vblendvps %ymm2,%ymm0,%ymm9,%ymm2 - .byte 196,226,125,24,5,210,34,0,0 // vbroadcastss 0x22d2(%rip),%ymm0 # 4c2c <_sk_callback_hsw+0x380> + .byte 196,226,125,24,5,138,34,0,0 // vbroadcastss 0x228a(%rip),%ymm0 # 4bec <_sk_callback_hsw+0x394> .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 - .byte 196,98,125,24,5,201,34,0,0 // vbroadcastss 0x22c9(%rip),%ymm8 # 4c30 <_sk_callback_hsw+0x384> + .byte 196,98,125,24,5,129,34,0,0 // vbroadcastss 0x2281(%rip),%ymm8 # 4bf0 <_sk_callback_hsw+0x398> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12276,11 +12283,11 @@ _sk_load_a8_hsw: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,45 // jne 29ad <_sk_load_a8_hsw+0x3d> + .byte 117,45 // jne 29b5 <_sk_load_a8_hsw+0x3d> .byte 197,250,126,0 // vmovq (%rax),%xmm0 .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,158,34,0,0 // vbroadcastss 0x229e(%rip),%ymm1 # 4c34 <_sk_callback_hsw+0x388> + .byte 196,226,125,24,13,86,34,0,0 // vbroadcastss 0x2256(%rip),%ymm1 # 4bf4 <_sk_callback_hsw+0x39c> .byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 @@ -12298,20 +12305,15 @@ _sk_load_a8_hsw: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 29b6 <_sk_load_a8_hsw+0x46> + .byte 117,235 // jne 29be <_sk_load_a8_hsw+0x46> .byte 196,193,249,110,194 // vmovq %r10,%xmm0 .byte 91 // pop %rbx - .byte 235,177 // jmp 2984 <_sk_load_a8_hsw+0x14> + .byte 235,177 // jmp 298c <_sk_load_a8_hsw+0x14> HIDDEN _sk_gather_a8_hsw .globl _sk_gather_a8_hsw FUNCTION(_sk_gather_a8_hsw) _sk_gather_a8_hsw: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -12319,46 +12321,41 @@ _sk_gather_a8_hsw: .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1 .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,12,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm1 .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,113,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1 .byte 65,137,194 // mov %eax,%r10d .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,195 // vmovq %xmm0,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0 - .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,196 // vmovq %xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0 .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d - .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0 + .byte 196,195,113,32,202,2 // vpinsrb $0x2,%r10d,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,4 // vpinsrb $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,182,4,17 // movzbl (%r9,%r10,1),%eax + .byte 196,227,113,32,192,5 // vpinsrb $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax - .byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,41 // movzbl (%r9,%r13,1),%eax - .byte 196,227,121,32,192,4 // vpinsrb $0x4,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,33 // movzbl (%r9,%r12,1),%eax - .byte 196,227,121,32,192,5 // vpinsrb $0x5,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,57 // movzbl (%r9,%r15,1),%eax .byte 196,227,121,32,192,6 // vpinsrb $0x6,%eax,%xmm0,%xmm0 - .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0 .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,166,33,0,0 // vbroadcastss 0x21a6(%rip),%ymm1 # 4c38 <_sk_callback_hsw+0x38c> + .byte 196,226,125,24,13,103,33,0,0 // vbroadcastss 0x2167(%rip),%ymm1 # 4bf8 <_sk_callback_hsw+0x3a0> .byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 197,237,239,210 // vpxor %ymm2,%ymm2,%ymm2 - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_store_a8_hsw @@ -12367,14 +12364,14 @@ FUNCTION(_sk_store_a8_hsw) _sk_store_a8_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,127,33,0,0 // vbroadcastss 0x217f(%rip),%ymm8 # 4c3c <_sk_callback_hsw+0x390> + .byte 196,98,125,24,5,73,33,0,0 // vbroadcastss 0x2149(%rip),%ymm8 # 4bfc <_sk_callback_hsw+0x3a4> .byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8 .byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8 .byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 196,65,57,103,192 // vpackuswb %xmm8,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 2ae6 <_sk_store_a8_hsw+0x37> + .byte 117,10 // jne 2adc <_sk_store_a8_hsw+0x37> .byte 196,65,123,17,4,19 // vmovsd %xmm8,(%r11,%rdx,1) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12382,10 +12379,10 @@ _sk_store_a8_hsw: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 2ae2 <_sk_store_a8_hsw+0x33> + .byte 119,236 // ja 2ad8 <_sk_store_a8_hsw+0x33> .byte 196,66,121,48,192 // vpmovzxbw %xmm8,%xmm8 .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 2b48 <_sk_store_a8_hsw+0x99> + .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 2b40 <_sk_store_a8_hsw+0x9b> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -12396,26 +12393,28 @@ _sk_store_a8_hsw: .byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1) .byte 196,67,121,20,68,19,1,2 // vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1) .byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1) - .byte 235,154 // jmp 2ae2 <_sk_store_a8_hsw+0x33> - .byte 247,255 // idiv %edi + .byte 235,154 // jmp 2ad8 <_sk_store_a8_hsw+0x33> + .byte 102,144 // xchg %ax,%ax + .byte 245 // cmc .byte 255 // (bad) .byte 255 // (bad) - .byte 239 // out %eax,(%dx) .byte 255 // (bad) + .byte 237 // in (%dx),%eax .byte 255 // (bad) - .byte 255,231 // jmpq *%rdi .byte 255 // (bad) + .byte 255,229 // jmpq *%rbp .byte 255 // (bad) .byte 255 // (bad) - .byte 223,255 // (bad) .byte 255 // (bad) - .byte 255,215 // callq *%rdi + .byte 221,255 // (bad) .byte 255 // (bad) + .byte 255,213 // callq *%rbp .byte 255 // (bad) - .byte 255,207 // dec %edi .byte 255 // (bad) + .byte 255,205 // dec %ebp .byte 255 // (bad) - .byte 255,199 // inc %edi + .byte 255 // (bad) + .byte 255,197 // inc %ebp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -12429,14 +12428,14 @@ _sk_load_g8_hsw: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,50 // jne 2ba6 <_sk_load_g8_hsw+0x42> + .byte 117,50 // jne 2b9e <_sk_load_g8_hsw+0x42> .byte 197,250,126,0 // vmovq (%rax),%xmm0 .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,182,32,0,0 // vbroadcastss 0x20b6(%rip),%ymm1 # 4c40 <_sk_callback_hsw+0x394> + .byte 196,226,125,24,13,126,32,0,0 // vbroadcastss 0x207e(%rip),%ymm1 # 4c00 <_sk_callback_hsw+0x3a8> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,171,32,0,0 // vbroadcastss 0x20ab(%rip),%ymm3 # 4c44 <_sk_callback_hsw+0x398> + .byte 196,226,125,24,29,115,32,0,0 // vbroadcastss 0x2073(%rip),%ymm3 # 4c04 <_sk_callback_hsw+0x3ac> .byte 76,137,201 // mov %r9,%rcx .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 .byte 197,252,40,208 // vmovaps %ymm0,%ymm2 @@ -12451,20 +12450,15 @@ _sk_load_g8_hsw: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 2baf <_sk_load_g8_hsw+0x4b> + .byte 117,235 // jne 2ba7 <_sk_load_g8_hsw+0x4b> .byte 196,193,249,110,194 // vmovq %r10,%xmm0 .byte 91 // pop %rbx - .byte 235,172 // jmp 2b78 <_sk_load_g8_hsw+0x14> + .byte 235,172 // jmp 2b70 <_sk_load_g8_hsw+0x14> HIDDEN _sk_gather_g8_hsw .globl _sk_gather_g8_hsw FUNCTION(_sk_gather_g8_hsw) _sk_gather_g8_hsw: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -12472,46 +12466,41 @@ _sk_gather_g8_hsw: .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1 .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,12,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm1 .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,113,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1 .byte 65,137,194 // mov %eax,%r10d .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,195 // vmovq %xmm0,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0 - .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,196 // vmovq %xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,131,121,32,4,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0 .byte 71,15,182,20,17 // movzbl (%r9,%r10,1),%r10d - .byte 196,195,121,32,194,2 // vpinsrb $0x2,%r10d,%xmm0,%xmm0 + .byte 196,195,113,32,202,2 // vpinsrb $0x2,%r10d,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,4 // vpinsrb $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,182,4,17 // movzbl (%r9,%r10,1),%eax + .byte 196,227,113,32,192,5 // vpinsrb $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax - .byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,41 // movzbl (%r9,%r13,1),%eax - .byte 196,227,121,32,192,4 // vpinsrb $0x4,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,33 // movzbl (%r9,%r12,1),%eax - .byte 196,227,121,32,192,5 // vpinsrb $0x5,%eax,%xmm0,%xmm0 - .byte 67,15,182,4,57 // movzbl (%r9,%r15,1),%eax .byte 196,227,121,32,192,6 // vpinsrb $0x6,%eax,%xmm0,%xmm0 - .byte 65,15,182,4,25 // movzbl (%r9,%rbx,1),%eax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0 .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,189,31,0,0 // vbroadcastss 0x1fbd(%rip),%ymm1 # 4c48 <_sk_callback_hsw+0x39c> + .byte 196,226,125,24,13,142,31,0,0 // vbroadcastss 0x1f8e(%rip),%ymm1 # 4c08 <_sk_callback_hsw+0x3b0> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,178,31,0,0 // vbroadcastss 0x1fb2(%rip),%ymm3 # 4c4c <_sk_callback_hsw+0x3a0> + .byte 196,226,125,24,29,131,31,0,0 // vbroadcastss 0x1f83(%rip),%ymm3 # 4c0c <_sk_callback_hsw+0x3b4> .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 .byte 197,252,40,208 // vmovaps %ymm0,%ymm2 - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_gather_i8_hsw @@ -12521,15 +12510,10 @@ _sk_gather_i8_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,137,193 // mov %rax,%r9 .byte 77,133,201 // test %r9,%r9 - .byte 116,5 // je 2cbc <_sk_gather_i8_hsw+0xf> + .byte 116,5 // je 2ca2 <_sk_gather_i8_hsw+0xf> .byte 76,137,200 // mov %r9,%rax - .byte 235,2 // jmp 2cbe <_sk_gather_i8_hsw+0x11> + .byte 235,2 // jmp 2ca4 <_sk_gather_i8_hsw+0x11> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 76,139,16 // mov (%rax),%r10 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -12537,39 +12521,39 @@ _sk_gather_i8_hsw: .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1 .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 + .byte 196,193,249,126,195 // vmovq %xmm0,%r11 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,195,121,32,12,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1 .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,131,113,32,12,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm1,%xmm1 .byte 65,137,195 // mov %eax,%r11d .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,222 // mov %ebx,%r14d - .byte 72,193,235,32 // shr $0x20,%rbx .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0 - .byte 196,195,249,22,199,1 // vpextrq $0x1,%xmm0,%r15 - .byte 69,137,252 // mov %r15d,%r12d - .byte 73,193,239,32 // shr $0x20,%r15 - .byte 196,193,249,126,197 // vmovq %xmm0,%r13 - .byte 68,137,237 // mov %r13d,%ebp - .byte 73,193,237,32 // shr $0x20,%r13 - .byte 196,131,121,32,4,50,0 // vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,26,1 // vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,42,4 // vpinsrb $0x4,(%r10,%rbp,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,42,5 // vpinsrb $0x5,(%r10,%r13,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,34,6 // vpinsrb $0x6,(%r10,%r12,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,58,7 // vpinsrb $0x7,(%r10,%r15,1),%xmm0,%xmm0 + .byte 196,131,113,32,12,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm1,%xmm1 + .byte 196,193,249,126,195 // vmovq %xmm0,%r11 + .byte 196,195,113,32,12,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,195,113,32,12,2,4 // vpinsrb $0x4,(%r10,%rax,1),%xmm1,%xmm1 + .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,131,113,32,4,26,5 // vpinsrb $0x5,(%r10,%r11,1),%xmm1,%xmm0 + .byte 137,216 // mov %ebx,%eax + .byte 196,195,121,32,4,2,6 // vpinsrb $0x6,(%r10,%rax,1),%xmm0,%xmm0 + .byte 72,193,235,32 // shr $0x20,%rbx + .byte 196,195,121,32,4,26,7 // vpinsrb $0x7,(%r10,%rbx,1),%xmm0,%xmm0 .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0 .byte 73,139,65,8 // mov 0x8(%r9),%rax .byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1 .byte 196,226,117,144,28,128 // vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3 - .byte 197,229,219,5,83,33,0,0 // vpand 0x2153(%rip),%ymm3,%ymm0 # 4ec0 <_sk_callback_hsw+0x614> + .byte 197,229,219,5,55,33,0,0 // vpand 0x2137(%rip),%ymm3,%ymm0 # 4e80 <_sk_callback_hsw+0x628> .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,214,30,0,0 // vbroadcastss 0x1ed6(%rip),%ymm8 # 4c50 <_sk_callback_hsw+0x3a4> + .byte 196,98,125,24,5,186,30,0,0 // vbroadcastss 0x1eba(%rip),%ymm8 # 4c10 <_sk_callback_hsw+0x3b8> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 - .byte 196,226,101,0,13,88,33,0,0 // vpshufb 0x2158(%rip),%ymm3,%ymm1 # 4ee0 <_sk_callback_hsw+0x634> + .byte 196,226,101,0,13,60,33,0,0 // vpshufb 0x213c(%rip),%ymm3,%ymm1 # 4ea0 <_sk_callback_hsw+0x648> .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 - .byte 196,226,101,0,21,102,33,0,0 // vpshufb 0x2166(%rip),%ymm3,%ymm2 # 4f00 <_sk_callback_hsw+0x654> + .byte 196,226,101,0,21,74,33,0,0 // vpshufb 0x214a(%rip),%ymm3,%ymm2 # 4ec0 <_sk_callback_hsw+0x668> .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3 @@ -12577,11 +12561,6 @@ _sk_gather_i8_hsw: .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp .byte 255,224 // jmpq *%rax HIDDEN _sk_load_565_hsw @@ -12591,35 +12570,35 @@ _sk_load_565_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 117,114 // jne 2e3b <_sk_load_565_hsw+0x7c> + .byte 117,114 // jne 2e0e <_sk_load_565_hsw+0x7c> .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0 .byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2 - .byte 196,226,125,88,5,119,30,0,0 // vpbroadcastd 0x1e77(%rip),%ymm0 # 4c54 <_sk_callback_hsw+0x3a8> + .byte 196,226,125,88,5,100,30,0,0 // vpbroadcastd 0x1e64(%rip),%ymm0 # 4c14 <_sk_callback_hsw+0x3bc> .byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,106,30,0,0 // vbroadcastss 0x1e6a(%rip),%ymm1 # 4c58 <_sk_callback_hsw+0x3ac> + .byte 196,226,125,24,13,87,30,0,0 // vbroadcastss 0x1e57(%rip),%ymm1 # 4c18 <_sk_callback_hsw+0x3c0> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,88,13,97,30,0,0 // vpbroadcastd 0x1e61(%rip),%ymm1 # 4c5c <_sk_callback_hsw+0x3b0> + .byte 196,226,125,88,13,78,30,0,0 // vpbroadcastd 0x1e4e(%rip),%ymm1 # 4c1c <_sk_callback_hsw+0x3c4> .byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,29,84,30,0,0 // vbroadcastss 0x1e54(%rip),%ymm3 # 4c60 <_sk_callback_hsw+0x3b4> + .byte 196,226,125,24,29,65,30,0,0 // vbroadcastss 0x1e41(%rip),%ymm3 # 4c20 <_sk_callback_hsw+0x3c8> .byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1 - .byte 196,226,125,88,29,75,30,0,0 // vpbroadcastd 0x1e4b(%rip),%ymm3 # 4c64 <_sk_callback_hsw+0x3b8> + .byte 196,226,125,88,29,56,30,0,0 // vpbroadcastd 0x1e38(%rip),%ymm3 # 4c24 <_sk_callback_hsw+0x3cc> .byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,226,125,24,29,62,30,0,0 // vbroadcastss 0x1e3e(%rip),%ymm3 # 4c68 <_sk_callback_hsw+0x3bc> + .byte 196,226,125,24,29,43,30,0,0 // vbroadcastss 0x1e2b(%rip),%ymm3 # 4c28 <_sk_callback_hsw+0x3d0> .byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,51,30,0,0 // vbroadcastss 0x1e33(%rip),%ymm3 # 4c6c <_sk_callback_hsw+0x3c0> + .byte 196,226,125,24,29,32,30,0,0 // vbroadcastss 0x1e20(%rip),%ymm3 # 4c2c <_sk_callback_hsw+0x3d4> .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,7 // and $0x7,%r9b .byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,128 // ja 2dcf <_sk_load_565_hsw+0x10> + .byte 119,128 // ja 2da2 <_sk_load_565_hsw+0x10> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 2ea4 <_sk_load_565_hsw+0xe5> + .byte 76,141,21,75,0,0,0 // lea 0x4b(%rip),%r10 # 2e78 <_sk_load_565_hsw+0xe6> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -12631,27 +12610,28 @@ _sk_load_565_hsw: .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - .byte 233,44,255,255,255 // jmpq 2dcf <_sk_load_565_hsw+0x10> - .byte 144 // nop - .byte 243,255 // repz (bad) + .byte 233,44,255,255,255 // jmpq 2da2 <_sk_load_565_hsw+0x10> + .byte 102,144 // xchg %ax,%ax + .byte 242,255 // repnz (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 235,255 // jmp 2ea9 <_sk_load_565_hsw+0xea> + .byte 234 // (bad) .byte 255 // (bad) - .byte 255,227 // jmpq *%rbx .byte 255 // (bad) + .byte 255,226 // jmpq *%rdx .byte 255 // (bad) .byte 255 // (bad) - .byte 219,255 // (bad) .byte 255 // (bad) - .byte 255,211 // callq *%rbx + .byte 218,255 // (bad) .byte 255 // (bad) + .byte 255,210 // callq *%rdx .byte 255 // (bad) - .byte 255,203 // dec %ebx .byte 255 // (bad) + .byte 255,202 // dec %edx .byte 255 // (bad) .byte 255 // (bad) - .byte 191 // .byte 0xbf + .byte 255 // (bad) + .byte 190 // .byte 0xbe .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -12660,12 +12640,6 @@ HIDDEN _sk_gather_565_hsw .globl _sk_gather_565_hsw FUNCTION(_sk_gather_565_hsw) _sk_gather_565_hsw: - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -12673,59 +12647,53 @@ _sk_gather_565_hsw: .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1 .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 - .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,195 // vmovq %xmm0,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,110,200 // vmovd %eax,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,200,1 // vpinsrw $0x1,%eax,%xmm1,%xmm1 + .byte 68,137,216 // mov %r11d,%eax .byte 73,193,235,32 // shr $0x20,%r11 .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0 - .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,196 // vmovq %xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 71,15,183,28,89 // movzwl (%r9,%r11,2),%r11d - .byte 67,15,183,44,113 // movzwl (%r9,%r14,2),%ebp - .byte 197,249,110,197 // vmovd %ebp,%xmm0 - .byte 196,193,121,196,195,1 // vpinsrw $0x1,%r11d,%xmm0,%xmm0 - .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp - .byte 197,249,196,197,2 // vpinsrw $0x2,%ebp,%xmm0,%xmm0 .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax - .byte 197,249,196,192,3 // vpinsrw $0x3,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,105 // movzwl (%r9,%r13,2),%eax - .byte 197,249,196,192,4 // vpinsrw $0x4,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,97 // movzwl (%r9,%r12,2),%eax - .byte 197,249,196,192,5 // vpinsrw $0x5,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,121 // movzwl (%r9,%r15,2),%eax + .byte 197,241,196,200,2 // vpinsrw $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax + .byte 197,241,196,200,3 // vpinsrw $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,4 // vpinsrw $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,192,5 // vpinsrw $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax .byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0 - .byte 65,15,183,4,89 // movzwl (%r9,%rbx,2),%eax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax .byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0 .byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2 - .byte 196,226,125,88,5,244,28,0,0 // vpbroadcastd 0x1cf4(%rip),%ymm0 # 4c70 <_sk_callback_hsw+0x3c4> + .byte 196,226,125,88,5,235,28,0,0 // vpbroadcastd 0x1ceb(%rip),%ymm0 # 4c30 <_sk_callback_hsw+0x3d8> .byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,231,28,0,0 // vbroadcastss 0x1ce7(%rip),%ymm1 # 4c74 <_sk_callback_hsw+0x3c8> + .byte 196,226,125,24,13,222,28,0,0 // vbroadcastss 0x1cde(%rip),%ymm1 # 4c34 <_sk_callback_hsw+0x3dc> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,88,13,222,28,0,0 // vpbroadcastd 0x1cde(%rip),%ymm1 # 4c78 <_sk_callback_hsw+0x3cc> + .byte 196,226,125,88,13,213,28,0,0 // vpbroadcastd 0x1cd5(%rip),%ymm1 # 4c38 <_sk_callback_hsw+0x3e0> .byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,29,209,28,0,0 // vbroadcastss 0x1cd1(%rip),%ymm3 # 4c7c <_sk_callback_hsw+0x3d0> + .byte 196,226,125,24,29,200,28,0,0 // vbroadcastss 0x1cc8(%rip),%ymm3 # 4c3c <_sk_callback_hsw+0x3e4> .byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1 - .byte 196,226,125,88,29,200,28,0,0 // vpbroadcastd 0x1cc8(%rip),%ymm3 # 4c80 <_sk_callback_hsw+0x3d4> + .byte 196,226,125,88,29,191,28,0,0 // vpbroadcastd 0x1cbf(%rip),%ymm3 # 4c40 <_sk_callback_hsw+0x3e8> .byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,226,125,24,29,187,28,0,0 // vbroadcastss 0x1cbb(%rip),%ymm3 # 4c84 <_sk_callback_hsw+0x3d8> + .byte 196,226,125,24,29,178,28,0,0 // vbroadcastss 0x1cb2(%rip),%ymm3 # 4c44 <_sk_callback_hsw+0x3ec> .byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,176,28,0,0 // vbroadcastss 0x1cb0(%rip),%ymm3 # 4c88 <_sk_callback_hsw+0x3dc> - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp + .byte 196,226,125,24,29,167,28,0,0 // vbroadcastss 0x1ca7(%rip),%ymm3 # 4c48 <_sk_callback_hsw+0x3f0> .byte 255,224 // jmpq *%rax HIDDEN _sk_store_565_hsw @@ -12734,11 +12702,11 @@ FUNCTION(_sk_store_565_hsw) _sk_store_565_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,154,28,0,0 // vbroadcastss 0x1c9a(%rip),%ymm8 # 4c8c <_sk_callback_hsw+0x3e0> + .byte 196,98,125,24,5,155,28,0,0 // vbroadcastss 0x1c9b(%rip),%ymm8 # 4c4c <_sk_callback_hsw+0x3f4> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,193,53,114,241,11 // vpslld $0xb,%ymm9,%ymm9 - .byte 196,98,125,24,21,133,28,0,0 // vbroadcastss 0x1c85(%rip),%ymm10 # 4c90 <_sk_callback_hsw+0x3e4> + .byte 196,98,125,24,21,134,28,0,0 // vbroadcastss 0x1c86(%rip),%ymm10 # 4c50 <_sk_callback_hsw+0x3f8> .byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10 .byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10 .byte 196,193,45,114,242,5 // vpslld $0x5,%ymm10,%ymm10 @@ -12749,7 +12717,7 @@ _sk_store_565_hsw: .byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3049 <_sk_store_565_hsw+0x65> + .byte 117,10 // jne 3008 <_sk_store_565_hsw+0x65> .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12757,9 +12725,9 @@ _sk_store_565_hsw: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 3045 <_sk_store_565_hsw+0x61> + .byte 119,236 // ja 3004 <_sk_store_565_hsw+0x61> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 30a8 <_sk_store_565_hsw+0xc4> + .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 3068 <_sk_store_565_hsw+0xc5> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -12770,28 +12738,28 @@ _sk_store_565_hsw: .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2) - .byte 235,159 // jmp 3045 <_sk_store_565_hsw+0x61> - .byte 102,144 // xchg %ax,%ax - .byte 245 // cmc + .byte 235,159 // jmp 3004 <_sk_store_565_hsw+0x61> + .byte 15,31,0 // nopl (%rax) + .byte 244 // hlt .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 237 // in (%dx),%eax + .byte 236 // in (%dx),%al .byte 255 // (bad) .byte 255 // (bad) - .byte 255,229 // jmpq *%rbp + .byte 255,228 // jmpq *%rsp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 221,255 // (bad) + .byte 220,255 // fdivr %st,%st(7) .byte 255 // (bad) - .byte 255,213 // callq *%rbp + .byte 255,212 // callq *%rsp .byte 255 // (bad) .byte 255 // (bad) - .byte 255,205 // dec %ebp + .byte 255,204 // dec %esp .byte 255 // (bad) .byte 255 // (bad) - .byte 255,197 // inc %ebp + .byte 255,196 // inc %esp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -12803,28 +12771,28 @@ _sk_load_4444_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,138,0,0,0 // jne 315c <_sk_load_4444_hsw+0x98> + .byte 15,133,138,0,0,0 // jne 311c <_sk_load_4444_hsw+0x98> .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0 .byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3 - .byte 196,226,125,88,5,174,27,0,0 // vpbroadcastd 0x1bae(%rip),%ymm0 # 4c94 <_sk_callback_hsw+0x3e8> + .byte 196,226,125,88,5,174,27,0,0 // vpbroadcastd 0x1bae(%rip),%ymm0 # 4c54 <_sk_callback_hsw+0x3fc> .byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,161,27,0,0 // vbroadcastss 0x1ba1(%rip),%ymm1 # 4c98 <_sk_callback_hsw+0x3ec> + .byte 196,226,125,24,13,161,27,0,0 // vbroadcastss 0x1ba1(%rip),%ymm1 # 4c58 <_sk_callback_hsw+0x400> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,88,13,152,27,0,0 // vpbroadcastd 0x1b98(%rip),%ymm1 # 4c9c <_sk_callback_hsw+0x3f0> + .byte 196,226,125,88,13,152,27,0,0 // vpbroadcastd 0x1b98(%rip),%ymm1 # 4c5c <_sk_callback_hsw+0x404> .byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,21,139,27,0,0 // vbroadcastss 0x1b8b(%rip),%ymm2 # 4ca0 <_sk_callback_hsw+0x3f4> + .byte 196,226,125,24,21,139,27,0,0 // vbroadcastss 0x1b8b(%rip),%ymm2 # 4c60 <_sk_callback_hsw+0x408> .byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1 - .byte 196,226,125,88,21,130,27,0,0 // vpbroadcastd 0x1b82(%rip),%ymm2 # 4ca4 <_sk_callback_hsw+0x3f8> + .byte 196,226,125,88,21,130,27,0,0 // vpbroadcastd 0x1b82(%rip),%ymm2 # 4c64 <_sk_callback_hsw+0x40c> .byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,98,125,24,5,117,27,0,0 // vbroadcastss 0x1b75(%rip),%ymm8 # 4ca8 <_sk_callback_hsw+0x3fc> + .byte 196,98,125,24,5,117,27,0,0 // vbroadcastss 0x1b75(%rip),%ymm8 # 4c68 <_sk_callback_hsw+0x410> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,88,5,107,27,0,0 // vpbroadcastd 0x1b6b(%rip),%ymm8 # 4cac <_sk_callback_hsw+0x400> + .byte 196,98,125,88,5,107,27,0,0 // vpbroadcastd 0x1b6b(%rip),%ymm8 # 4c6c <_sk_callback_hsw+0x414> .byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,93,27,0,0 // vbroadcastss 0x1b5d(%rip),%ymm8 # 4cb0 <_sk_callback_hsw+0x404> + .byte 196,98,125,24,5,93,27,0,0 // vbroadcastss 0x1b5d(%rip),%ymm8 # 4c70 <_sk_callback_hsw+0x418> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12833,9 +12801,9 @@ _sk_load_4444_hsw: .byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,100,255,255,255 // ja 30d8 <_sk_load_4444_hsw+0x14> + .byte 15,135,100,255,255,255 // ja 3098 <_sk_load_4444_hsw+0x14> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,73,0,0,0 // lea 0x49(%rip),%r10 # 31c8 <_sk_load_4444_hsw+0x104> + .byte 76,141,21,73,0,0,0 // lea 0x49(%rip),%r10 # 3188 <_sk_load_4444_hsw+0x104> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -12847,7 +12815,7 @@ _sk_load_4444_hsw: .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - .byte 233,16,255,255,255 // jmpq 30d8 <_sk_load_4444_hsw+0x14> + .byte 233,16,255,255,255 // jmpq 3098 <_sk_load_4444_hsw+0x14> .byte 244 // hlt .byte 255 // (bad) .byte 255 // (bad) @@ -12876,12 +12844,6 @@ HIDDEN _sk_gather_4444_hsw .globl _sk_gather_4444_hsw FUNCTION(_sk_gather_4444_hsw) _sk_gather_4444_hsw: - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -12889,63 +12851,57 @@ _sk_gather_4444_hsw: .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1 .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 - .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,195 // vmovq %xmm0,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,110,200 // vmovd %eax,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,200,1 // vpinsrw $0x1,%eax,%xmm1,%xmm1 + .byte 68,137,216 // mov %r11d,%eax .byte 73,193,235,32 // shr $0x20,%r11 .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0 - .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,196 // vmovq %xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 71,15,183,28,89 // movzwl (%r9,%r11,2),%r11d - .byte 67,15,183,44,113 // movzwl (%r9,%r14,2),%ebp - .byte 197,249,110,197 // vmovd %ebp,%xmm0 - .byte 196,193,121,196,195,1 // vpinsrw $0x1,%r11d,%xmm0,%xmm0 - .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp - .byte 197,249,196,197,2 // vpinsrw $0x2,%ebp,%xmm0,%xmm0 .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax - .byte 197,249,196,192,3 // vpinsrw $0x3,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,105 // movzwl (%r9,%r13,2),%eax - .byte 197,249,196,192,4 // vpinsrw $0x4,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,97 // movzwl (%r9,%r12,2),%eax - .byte 197,249,196,192,5 // vpinsrw $0x5,%eax,%xmm0,%xmm0 - .byte 67,15,183,4,121 // movzwl (%r9,%r15,2),%eax + .byte 197,241,196,200,2 // vpinsrw $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax + .byte 197,241,196,200,3 // vpinsrw $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,4 // vpinsrw $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,192,5 // vpinsrw $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax .byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0 - .byte 65,15,183,4,89 // movzwl (%r9,%rbx,2),%eax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax .byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0 .byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3 - .byte 196,226,125,88,5,20,26,0,0 // vpbroadcastd 0x1a14(%rip),%ymm0 # 4cb4 <_sk_callback_hsw+0x408> + .byte 196,226,125,88,5,31,26,0,0 // vpbroadcastd 0x1a1f(%rip),%ymm0 # 4c74 <_sk_callback_hsw+0x41c> .byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,7,26,0,0 // vbroadcastss 0x1a07(%rip),%ymm1 # 4cb8 <_sk_callback_hsw+0x40c> + .byte 196,226,125,24,13,18,26,0,0 // vbroadcastss 0x1a12(%rip),%ymm1 # 4c78 <_sk_callback_hsw+0x420> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,88,13,254,25,0,0 // vpbroadcastd 0x19fe(%rip),%ymm1 # 4cbc <_sk_callback_hsw+0x410> + .byte 196,226,125,88,13,9,26,0,0 // vpbroadcastd 0x1a09(%rip),%ymm1 # 4c7c <_sk_callback_hsw+0x424> .byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,21,241,25,0,0 // vbroadcastss 0x19f1(%rip),%ymm2 # 4cc0 <_sk_callback_hsw+0x414> + .byte 196,226,125,24,21,252,25,0,0 // vbroadcastss 0x19fc(%rip),%ymm2 # 4c80 <_sk_callback_hsw+0x428> .byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1 - .byte 196,226,125,88,21,232,25,0,0 // vpbroadcastd 0x19e8(%rip),%ymm2 # 4cc4 <_sk_callback_hsw+0x418> + .byte 196,226,125,88,21,243,25,0,0 // vpbroadcastd 0x19f3(%rip),%ymm2 # 4c84 <_sk_callback_hsw+0x42c> .byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,98,125,24,5,219,25,0,0 // vbroadcastss 0x19db(%rip),%ymm8 # 4cc8 <_sk_callback_hsw+0x41c> + .byte 196,98,125,24,5,230,25,0,0 // vbroadcastss 0x19e6(%rip),%ymm8 # 4c88 <_sk_callback_hsw+0x430> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,88,5,209,25,0,0 // vpbroadcastd 0x19d1(%rip),%ymm8 # 4ccc <_sk_callback_hsw+0x420> + .byte 196,98,125,88,5,220,25,0,0 // vpbroadcastd 0x19dc(%rip),%ymm8 # 4c8c <_sk_callback_hsw+0x434> .byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,195,25,0,0 // vbroadcastss 0x19c3(%rip),%ymm8 # 4cd0 <_sk_callback_hsw+0x424> + .byte 196,98,125,24,5,206,25,0,0 // vbroadcastss 0x19ce(%rip),%ymm8 # 4c90 <_sk_callback_hsw+0x438> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp .byte 255,224 // jmpq *%rax HIDDEN _sk_store_4444_hsw @@ -12954,7 +12910,7 @@ FUNCTION(_sk_store_4444_hsw) _sk_store_4444_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,166,25,0,0 // vbroadcastss 0x19a6(%rip),%ymm8 # 4cd4 <_sk_callback_hsw+0x428> + .byte 196,98,125,24,5,187,25,0,0 // vbroadcastss 0x19bb(%rip),%ymm8 # 4c94 <_sk_callback_hsw+0x43c> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,193,53,114,241,12 // vpslld $0xc,%ymm9,%ymm9 @@ -12972,7 +12928,7 @@ _sk_store_4444_hsw: .byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3391 <_sk_store_4444_hsw+0x71> + .byte 117,10 // jne 333c <_sk_store_4444_hsw+0x71> .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -12980,9 +12936,9 @@ _sk_store_4444_hsw: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 338d <_sk_store_4444_hsw+0x6d> + .byte 119,236 // ja 3338 <_sk_store_4444_hsw+0x6d> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 33f0 <_sk_store_4444_hsw+0xd0> + .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 339c <_sk_store_4444_hsw+0xd1> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -12993,28 +12949,28 @@ _sk_store_4444_hsw: .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2) - .byte 235,159 // jmp 338d <_sk_store_4444_hsw+0x6d> - .byte 102,144 // xchg %ax,%ax - .byte 245 // cmc + .byte 235,159 // jmp 3338 <_sk_store_4444_hsw+0x6d> + .byte 15,31,0 // nopl (%rax) + .byte 244 // hlt .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 237 // in (%dx),%eax + .byte 236 // in (%dx),%al .byte 255 // (bad) .byte 255 // (bad) - .byte 255,229 // jmpq *%rbp + .byte 255,228 // jmpq *%rsp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 221,255 // (bad) + .byte 220,255 // fdivr %st,%st(7) .byte 255 // (bad) - .byte 255,213 // callq *%rbp + .byte 255,212 // callq *%rsp .byte 255 // (bad) .byte 255 // (bad) - .byte 255,205 // dec %ebp + .byte 255,204 // dec %esp .byte 255 // (bad) .byte 255 // (bad) - .byte 255,197 // inc %ebp + .byte 255,196 // inc %esp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -13028,16 +12984,16 @@ _sk_load_8888_hsw: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,88 // jne 3479 <_sk_load_8888_hsw+0x6d> + .byte 117,88 // jne 3425 <_sk_load_8888_hsw+0x6d> .byte 196,193,124,16,26 // vmovups (%r10),%ymm3 - .byte 197,228,84,5,242,26,0,0 // vandps 0x1af2(%rip),%ymm3,%ymm0 # 4f20 <_sk_callback_hsw+0x674> + .byte 197,228,84,5,6,27,0,0 // vandps 0x1b06(%rip),%ymm3,%ymm0 # 4ee0 <_sk_callback_hsw+0x688> .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,157,24,0,0 // vbroadcastss 0x189d(%rip),%ymm8 # 4cd8 <_sk_callback_hsw+0x42c> + .byte 196,98,125,24,5,177,24,0,0 // vbroadcastss 0x18b1(%rip),%ymm8 # 4c98 <_sk_callback_hsw+0x440> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 - .byte 196,226,101,0,13,247,26,0,0 // vpshufb 0x1af7(%rip),%ymm3,%ymm1 # 4f40 <_sk_callback_hsw+0x694> + .byte 196,226,101,0,13,11,27,0,0 // vpshufb 0x1b0b(%rip),%ymm3,%ymm1 # 4f00 <_sk_callback_hsw+0x6a8> .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 - .byte 196,226,101,0,21,5,27,0,0 // vpshufb 0x1b05(%rip),%ymm3,%ymm2 # 4f60 <_sk_callback_hsw+0x6b4> + .byte 196,226,101,0,21,25,27,0,0 // vpshufb 0x1b19(%rip),%ymm3,%ymm2 # 4f20 <_sk_callback_hsw+0x6c8> .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3 @@ -13054,7 +13010,7 @@ _sk_load_8888_hsw: .byte 196,225,249,110,192 // vmovq %rax,%xmm0 .byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0 .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3 - .byte 235,135 // jmp 3426 <_sk_load_8888_hsw+0x1a> + .byte 235,135 // jmp 33d2 <_sk_load_8888_hsw+0x1a> HIDDEN _sk_gather_8888_hsw .globl _sk_gather_8888_hsw @@ -13069,14 +13025,14 @@ _sk_gather_8888_hsw: .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0 .byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1 .byte 196,194,117,144,28,129 // vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3 - .byte 197,229,219,5,179,26,0,0 // vpand 0x1ab3(%rip),%ymm3,%ymm0 # 4f80 <_sk_callback_hsw+0x6d4> + .byte 197,229,219,5,199,26,0,0 // vpand 0x1ac7(%rip),%ymm3,%ymm0 # 4f40 <_sk_callback_hsw+0x6e8> .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,2,24,0,0 // vbroadcastss 0x1802(%rip),%ymm8 # 4cdc <_sk_callback_hsw+0x430> + .byte 196,98,125,24,5,22,24,0,0 // vbroadcastss 0x1816(%rip),%ymm8 # 4c9c <_sk_callback_hsw+0x444> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 - .byte 196,226,101,0,13,184,26,0,0 // vpshufb 0x1ab8(%rip),%ymm3,%ymm1 # 4fa0 <_sk_callback_hsw+0x6f4> + .byte 196,226,101,0,13,204,26,0,0 // vpshufb 0x1acc(%rip),%ymm3,%ymm1 # 4f60 <_sk_callback_hsw+0x708> .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 - .byte 196,226,101,0,21,198,26,0,0 // vpshufb 0x1ac6(%rip),%ymm3,%ymm2 # 4fc0 <_sk_callback_hsw+0x714> + .byte 196,226,101,0,21,218,26,0,0 // vpshufb 0x1ada(%rip),%ymm3,%ymm2 # 4f80 <_sk_callback_hsw+0x728> .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3 @@ -13093,7 +13049,7 @@ _sk_store_8888_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 - .byte 196,98,125,24,5,178,23,0,0 // vbroadcastss 0x17b2(%rip),%ymm8 # 4ce0 <_sk_callback_hsw+0x434> + .byte 196,98,125,24,5,198,23,0,0 // vbroadcastss 0x17c6(%rip),%ymm8 # 4ca0 <_sk_callback_hsw+0x448> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10 @@ -13109,7 +13065,7 @@ _sk_store_8888_hsw: .byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8 .byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,12 // jne 3588 <_sk_store_8888_hsw+0x73> + .byte 117,12 // jne 3534 <_sk_store_8888_hsw+0x73> .byte 196,65,124,17,2 // vmovups %ymm8,(%r10) .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -13122,7 +13078,7 @@ _sk_store_8888_hsw: .byte 196,97,249,110,200 // vmovq %rax,%xmm9 .byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9 .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10) - .byte 235,211 // jmp 3581 <_sk_store_8888_hsw+0x6c> + .byte 235,211 // jmp 352d <_sk_store_8888_hsw+0x6c> HIDDEN _sk_load_f16_hsw .globl _sk_load_f16_hsw @@ -13131,7 +13087,7 @@ _sk_load_f16_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,97 // jne 3619 <_sk_load_f16_hsw+0x6b> + .byte 117,97 // jne 35c5 <_sk_load_f16_hsw+0x6b> .byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8 .byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2 .byte 197,249,16,92,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm3 @@ -13157,29 +13113,29 @@ _sk_load_f16_hsw: .byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,79 // je 3678 <_sk_load_f16_hsw+0xca> + .byte 116,79 // je 3624 <_sk_load_f16_hsw+0xca> .byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,67 // jb 3678 <_sk_load_f16_hsw+0xca> + .byte 114,67 // jb 3624 <_sk_load_f16_hsw+0xca> .byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,68 // je 3685 <_sk_load_f16_hsw+0xd7> + .byte 116,68 // je 3631 <_sk_load_f16_hsw+0xd7> .byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,56 // jb 3685 <_sk_load_f16_hsw+0xd7> + .byte 114,56 // jb 3631 <_sk_load_f16_hsw+0xd7> .byte 197,251,16,92,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm3 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,114,255,255,255 // je 35cf <_sk_load_f16_hsw+0x21> + .byte 15,132,114,255,255,255 // je 357b <_sk_load_f16_hsw+0x21> .byte 197,225,22,92,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,98,255,255,255 // jb 35cf <_sk_load_f16_hsw+0x21> + .byte 15,130,98,255,255,255 // jb 357b <_sk_load_f16_hsw+0x21> .byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9 - .byte 233,87,255,255,255 // jmpq 35cf <_sk_load_f16_hsw+0x21> + .byte 233,87,255,255,255 // jmpq 357b <_sk_load_f16_hsw+0x21> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,74,255,255,255 // jmpq 35cf <_sk_load_f16_hsw+0x21> + .byte 233,74,255,255,255 // jmpq 357b <_sk_load_f16_hsw+0x21> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 - .byte 233,65,255,255,255 // jmpq 35cf <_sk_load_f16_hsw+0x21> + .byte 233,65,255,255,255 // jmpq 357b <_sk_load_f16_hsw+0x21> HIDDEN _sk_gather_f16_hsw .globl _sk_gather_f16_hsw @@ -13237,7 +13193,7 @@ _sk_store_f16_hsw: .byte 196,65,57,98,205 // vpunpckldq %xmm13,%xmm8,%xmm9 .byte 196,65,57,106,197 // vpunpckhdq %xmm13,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,27 // jne 377d <_sk_store_f16_hsw+0x65> + .byte 117,27 // jne 3729 <_sk_store_f16_hsw+0x65> .byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8) .byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8) .byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8) @@ -13246,22 +13202,22 @@ _sk_store_f16_hsw: .byte 255,224 // jmpq *%rax .byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,241 // je 3779 <_sk_store_f16_hsw+0x61> + .byte 116,241 // je 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,229 // jb 3779 <_sk_store_f16_hsw+0x61> + .byte 114,229 // jb 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8) - .byte 116,221 // je 3779 <_sk_store_f16_hsw+0x61> + .byte 116,221 // je 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,209 // jb 3779 <_sk_store_f16_hsw+0x61> + .byte 114,209 // jb 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8) - .byte 116,201 // je 3779 <_sk_store_f16_hsw+0x61> + .byte 116,201 // je 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,189 // jb 3779 <_sk_store_f16_hsw+0x61> + .byte 114,189 // jb 3725 <_sk_store_f16_hsw+0x61> .byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8) - .byte 235,181 // jmp 3779 <_sk_store_f16_hsw+0x61> + .byte 235,181 // jmp 3725 <_sk_store_f16_hsw+0x61> HIDDEN _sk_load_u16_be_hsw .globl _sk_load_u16_be_hsw @@ -13271,7 +13227,7 @@ _sk_load_u16_be_hsw: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,204,0,0,0 // jne 38a6 <_sk_load_u16_be_hsw+0xe2> + .byte 15,133,204,0,0,0 // jne 3852 <_sk_load_u16_be_hsw+0xe2> .byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8 .byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2 .byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3 @@ -13290,7 +13246,7 @@ _sk_load_u16_be_hsw: .byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0 .byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,21,169,20,0,0 // vbroadcastss 0x14a9(%rip),%ymm10 # 4ce4 <_sk_callback_hsw+0x438> + .byte 196,98,125,24,21,189,20,0,0 // vbroadcastss 0x14bd(%rip),%ymm10 # 4ca4 <_sk_callback_hsw+0x44c> .byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0 .byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1 .byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2 @@ -13318,29 +13274,29 @@ _sk_load_u16_be_hsw: .byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,85 // je 390c <_sk_load_u16_be_hsw+0x148> + .byte 116,85 // je 38b8 <_sk_load_u16_be_hsw+0x148> .byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,72 // jb 390c <_sk_load_u16_be_hsw+0x148> + .byte 114,72 // jb 38b8 <_sk_load_u16_be_hsw+0x148> .byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,72 // je 3919 <_sk_load_u16_be_hsw+0x155> + .byte 116,72 // je 38c5 <_sk_load_u16_be_hsw+0x155> .byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,59 // jb 3919 <_sk_load_u16_be_hsw+0x155> + .byte 114,59 // jb 38c5 <_sk_load_u16_be_hsw+0x155> .byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,6,255,255,255 // je 37f5 <_sk_load_u16_be_hsw+0x31> + .byte 15,132,6,255,255,255 // je 37a1 <_sk_load_u16_be_hsw+0x31> .byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,245,254,255,255 // jb 37f5 <_sk_load_u16_be_hsw+0x31> + .byte 15,130,245,254,255,255 // jb 37a1 <_sk_load_u16_be_hsw+0x31> .byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9 - .byte 233,233,254,255,255 // jmpq 37f5 <_sk_load_u16_be_hsw+0x31> + .byte 233,233,254,255,255 // jmpq 37a1 <_sk_load_u16_be_hsw+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,220,254,255,255 // jmpq 37f5 <_sk_load_u16_be_hsw+0x31> + .byte 233,220,254,255,255 // jmpq 37a1 <_sk_load_u16_be_hsw+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 - .byte 233,211,254,255,255 // jmpq 37f5 <_sk_load_u16_be_hsw+0x31> + .byte 233,211,254,255,255 // jmpq 37a1 <_sk_load_u16_be_hsw+0x31> HIDDEN _sk_load_rgb_u16_be_hsw .globl _sk_load_rgb_u16_be_hsw @@ -13350,7 +13306,7 @@ _sk_load_rgb_u16_be_hsw: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,204,0,0,0 // jne 3a00 <_sk_load_rgb_u16_be_hsw+0xde> + .byte 15,133,204,0,0,0 // jne 39ac <_sk_load_rgb_u16_be_hsw+0xde> .byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0 .byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2 .byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1 @@ -13374,7 +13330,7 @@ _sk_load_rgb_u16_be_hsw: .byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0 .byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,21,58,19,0,0 // vbroadcastss 0x133a(%rip),%ymm10 # 4ce8 <_sk_callback_hsw+0x43c> + .byte 196,98,125,24,21,78,19,0,0 // vbroadcastss 0x134e(%rip),%ymm10 # 4ca8 <_sk_callback_hsw+0x450> .byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0 .byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1 .byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2 @@ -13391,41 +13347,41 @@ _sk_load_rgb_u16_be_hsw: .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,238,18,0,0 // vbroadcastss 0x12ee(%rip),%ymm3 # 4cec <_sk_callback_hsw+0x440> + .byte 196,226,125,24,29,2,19,0,0 // vbroadcastss 0x1302(%rip),%ymm3 # 4cac <_sk_callback_hsw+0x454> .byte 255,224 // jmpq *%rax .byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0 .byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,5 // jne 3a19 <_sk_load_rgb_u16_be_hsw+0xf7> - .byte 233,79,255,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 117,5 // jne 39c5 <_sk_load_rgb_u16_be_hsw+0xf7> + .byte 233,79,255,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> .byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1 .byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,26 // jb 3a48 <_sk_load_rgb_u16_be_hsw+0x126> + .byte 114,26 // jb 39f4 <_sk_load_rgb_u16_be_hsw+0x126> .byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1 .byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 117,10 // jne 3a4d <_sk_load_rgb_u16_be_hsw+0x12b> - .byte 233,32,255,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> - .byte 233,27,255,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 117,10 // jne 39f9 <_sk_load_rgb_u16_be_hsw+0x12b> + .byte 233,32,255,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 233,27,255,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> .byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1 .byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,26 // jb 3a7c <_sk_load_rgb_u16_be_hsw+0x15a> + .byte 114,26 // jb 3a28 <_sk_load_rgb_u16_be_hsw+0x15a> .byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1 .byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 117,10 // jne 3a81 <_sk_load_rgb_u16_be_hsw+0x15f> - .byte 233,236,254,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> - .byte 233,231,254,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 117,10 // jne 3a2d <_sk_load_rgb_u16_be_hsw+0x15f> + .byte 233,236,254,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 233,231,254,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> .byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3 .byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,20 // jb 3aaa <_sk_load_rgb_u16_be_hsw+0x188> + .byte 114,20 // jb 3a56 <_sk_load_rgb_u16_be_hsw+0x188> .byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3 .byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3 - .byte 233,190,254,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> - .byte 233,185,254,255,255 // jmpq 3968 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 233,190,254,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> + .byte 233,185,254,255,255 // jmpq 3914 <_sk_load_rgb_u16_be_hsw+0x46> HIDDEN _sk_store_u16_be_hsw .globl _sk_store_u16_be_hsw @@ -13434,7 +13390,7 @@ _sk_store_u16_be_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax - .byte 196,98,125,24,5,43,18,0,0 // vbroadcastss 0x122b(%rip),%ymm8 # 4cf0 <_sk_callback_hsw+0x444> + .byte 196,98,125,24,5,63,18,0,0 // vbroadcastss 0x123f(%rip),%ymm8 # 4cb0 <_sk_callback_hsw+0x458> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10 @@ -13472,7 +13428,7 @@ _sk_store_u16_be_hsw: .byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9 .byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,31 // jne 3ba9 <_sk_store_u16_be_hsw+0xfa> + .byte 117,31 // jne 3b55 <_sk_store_u16_be_hsw+0xfa> .byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2) .byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2) .byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2) @@ -13481,22 +13437,22 @@ _sk_store_u16_be_hsw: .byte 255,224 // jmpq *%rax .byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 116,240 // je 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 114,227 // jb 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2) - .byte 116,218 // je 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 116,218 // je 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,205 // jb 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 114,205 // jb 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2) - .byte 116,196 // je 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 116,196 // je 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,183 // jb 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 114,183 // jb 3b51 <_sk_store_u16_be_hsw+0xf6> .byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2) - .byte 235,174 // jmp 3ba5 <_sk_store_u16_be_hsw+0xf6> + .byte 235,174 // jmp 3b51 <_sk_store_u16_be_hsw+0xf6> HIDDEN _sk_load_f32_hsw .globl _sk_load_f32_hsw @@ -13504,10 +13460,10 @@ FUNCTION(_sk_load_f32_hsw) _sk_load_f32_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 119,110 // ja 3c6d <_sk_load_f32_hsw+0x76> + .byte 119,110 // ja 3c19 <_sk_load_f32_hsw+0x76> .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 - .byte 76,141,29,135,0,0,0 // lea 0x87(%rip),%r11 # 3c98 <_sk_load_f32_hsw+0xa1> + .byte 76,141,29,135,0,0,0 // lea 0x87(%rip),%r11 # 3c44 <_sk_load_f32_hsw+0xa1> .byte 75,99,4,131 // movslq (%r11,%r8,4),%rax .byte 76,1,216 // add %r11,%rax .byte 255,224 // jmpq *%rax @@ -13568,7 +13524,7 @@ _sk_store_f32_hsw: .byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8 .byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11 .byte 77,133,192 // test %r8,%r8 - .byte 117,55 // jne 3d25 <_sk_store_f32_hsw+0x6d> + .byte 117,55 // jne 3cd1 <_sk_store_f32_hsw+0x6d> .byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12 .byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13 .byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9 @@ -13581,22 +13537,22 @@ _sk_store_f32_hsw: .byte 255,224 // jmpq *%rax .byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 3d21 <_sk_store_f32_hsw+0x69> + .byte 116,240 // je 3ccd <_sk_store_f32_hsw+0x69> .byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 3d21 <_sk_store_f32_hsw+0x69> + .byte 114,227 // jb 3ccd <_sk_store_f32_hsw+0x69> .byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4) - .byte 116,218 // je 3d21 <_sk_store_f32_hsw+0x69> + .byte 116,218 // je 3ccd <_sk_store_f32_hsw+0x69> .byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,205 // jb 3d21 <_sk_store_f32_hsw+0x69> + .byte 114,205 // jb 3ccd <_sk_store_f32_hsw+0x69> .byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4) - .byte 116,195 // je 3d21 <_sk_store_f32_hsw+0x69> + .byte 116,195 // je 3ccd <_sk_store_f32_hsw+0x69> .byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,181 // jb 3d21 <_sk_store_f32_hsw+0x69> + .byte 114,181 // jb 3ccd <_sk_store_f32_hsw+0x69> .byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4) - .byte 235,171 // jmp 3d21 <_sk_store_f32_hsw+0x69> + .byte 235,171 // jmp 3ccd <_sk_store_f32_hsw+0x69> HIDDEN _sk_clamp_x_hsw .globl _sk_clamp_x_hsw @@ -13694,7 +13650,7 @@ FUNCTION(_sk_clamp_x_1_hsw) _sk_clamp_x_1_hsw: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0 - .byte 196,98,125,24,5,126,14,0,0 // vbroadcastss 0xe7e(%rip),%ymm8 # 4cf4 <_sk_callback_hsw+0x448> + .byte 196,98,125,24,5,146,14,0,0 // vbroadcastss 0xe92(%rip),%ymm8 # 4cb4 <_sk_callback_hsw+0x45c> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -13712,9 +13668,9 @@ HIDDEN _sk_mirror_x_1_hsw .globl _sk_mirror_x_1_hsw FUNCTION(_sk_mirror_x_1_hsw) _sk_mirror_x_1_hsw: - .byte 196,98,125,24,5,97,14,0,0 // vbroadcastss 0xe61(%rip),%ymm8 # 4cf8 <_sk_callback_hsw+0x44c> + .byte 196,98,125,24,5,117,14,0,0 // vbroadcastss 0xe75(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x460> .byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,13,87,14,0,0 // vbroadcastss 0xe57(%rip),%ymm9 # 4cfc <_sk_callback_hsw+0x450> + .byte 196,98,125,24,13,107,14,0,0 // vbroadcastss 0xe6b(%rip),%ymm9 # 4cbc <_sk_callback_hsw+0x464> .byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9 .byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9 .byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9 @@ -13730,11 +13686,11 @@ HIDDEN _sk_luminance_to_alpha_hsw .globl _sk_luminance_to_alpha_hsw FUNCTION(_sk_luminance_to_alpha_hsw) _sk_luminance_to_alpha_hsw: - .byte 196,226,125,24,29,39,14,0,0 // vbroadcastss 0xe27(%rip),%ymm3 # 4d00 <_sk_callback_hsw+0x454> - .byte 196,98,125,24,5,34,14,0,0 // vbroadcastss 0xe22(%rip),%ymm8 # 4d04 <_sk_callback_hsw+0x458> + .byte 196,226,125,24,29,59,14,0,0 // vbroadcastss 0xe3b(%rip),%ymm3 # 4cc0 <_sk_callback_hsw+0x468> + .byte 196,98,125,24,5,54,14,0,0 // vbroadcastss 0xe36(%rip),%ymm8 # 4cc4 <_sk_callback_hsw+0x46c> .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 .byte 196,226,125,184,203 // vfmadd231ps %ymm3,%ymm0,%ymm1 - .byte 196,226,125,24,29,19,14,0,0 // vbroadcastss 0xe13(%rip),%ymm3 # 4d08 <_sk_callback_hsw+0x45c> + .byte 196,226,125,24,29,39,14,0,0 // vbroadcastss 0xe27(%rip),%ymm3 # 4cc8 <_sk_callback_hsw+0x470> .byte 196,226,109,168,217 // vfmadd213ps %ymm1,%ymm2,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 @@ -13908,9 +13864,9 @@ _sk_evenly_spaced_gradient_hsw: .byte 76,139,72,8 // mov 0x8(%rax),%r9 .byte 77,137,211 // mov %r10,%r11 .byte 73,255,203 // dec %r11 - .byte 120,7 // js 41ae <_sk_evenly_spaced_gradient_hsw+0x19> + .byte 120,7 // js 415a <_sk_evenly_spaced_gradient_hsw+0x19> .byte 196,193,242,42,203 // vcvtsi2ss %r11,%xmm1,%xmm1 - .byte 235,22 // jmp 41c4 <_sk_evenly_spaced_gradient_hsw+0x2f> + .byte 235,22 // jmp 4170 <_sk_evenly_spaced_gradient_hsw+0x2f> .byte 76,137,219 // mov %r11,%rbx .byte 72,209,235 // shr %rbx .byte 65,131,227,1 // and $0x1,%r11d @@ -13921,7 +13877,7 @@ _sk_evenly_spaced_gradient_hsw: .byte 197,244,89,200 // vmulps %ymm0,%ymm1,%ymm1 .byte 197,126,91,217 // vcvttps2dq %ymm1,%ymm11 .byte 73,131,250,8 // cmp $0x8,%r10 - .byte 119,70 // ja 421d <_sk_evenly_spaced_gradient_hsw+0x88> + .byte 119,70 // ja 41c9 <_sk_evenly_spaced_gradient_hsw+0x88> .byte 196,66,37,22,1 // vpermps (%r9),%ymm11,%ymm8 .byte 72,139,88,40 // mov 0x28(%rax),%rbx .byte 196,98,37,22,11 // vpermps (%rbx),%ymm11,%ymm9 @@ -13937,7 +13893,7 @@ _sk_evenly_spaced_gradient_hsw: .byte 196,226,37,22,27 // vpermps (%rbx),%ymm11,%ymm3 .byte 72,139,64,64 // mov 0x40(%rax),%rax .byte 196,98,37,22,40 // vpermps (%rax),%ymm11,%ymm13 - .byte 235,110 // jmp 428b <_sk_evenly_spaced_gradient_hsw+0xf6> + .byte 235,110 // jmp 4237 <_sk_evenly_spaced_gradient_hsw+0xf6> .byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14 .byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1 .byte 196,2,117,146,4,153 // vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8 @@ -13974,14 +13930,14 @@ HIDDEN _sk_gauss_a_to_rgba_hsw .globl _sk_gauss_a_to_rgba_hsw FUNCTION(_sk_gauss_a_to_rgba_hsw) _sk_gauss_a_to_rgba_hsw: - .byte 196,226,125,24,5,91,10,0,0 // vbroadcastss 0xa5b(%rip),%ymm0 # 4d0c <_sk_callback_hsw+0x460> - .byte 196,226,125,24,13,86,10,0,0 // vbroadcastss 0xa56(%rip),%ymm1 # 4d10 <_sk_callback_hsw+0x464> + .byte 196,226,125,24,5,111,10,0,0 // vbroadcastss 0xa6f(%rip),%ymm0 # 4ccc <_sk_callback_hsw+0x474> + .byte 196,226,125,24,13,106,10,0,0 // vbroadcastss 0xa6a(%rip),%ymm1 # 4cd0 <_sk_callback_hsw+0x478> .byte 196,226,101,168,200 // vfmadd213ps %ymm0,%ymm3,%ymm1 - .byte 196,226,125,24,5,76,10,0,0 // vbroadcastss 0xa4c(%rip),%ymm0 # 4d14 <_sk_callback_hsw+0x468> + .byte 196,226,125,24,5,96,10,0,0 // vbroadcastss 0xa60(%rip),%ymm0 # 4cd4 <_sk_callback_hsw+0x47c> .byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0 - .byte 196,226,125,24,13,66,10,0,0 // vbroadcastss 0xa42(%rip),%ymm1 # 4d18 <_sk_callback_hsw+0x46c> + .byte 196,226,125,24,13,86,10,0,0 // vbroadcastss 0xa56(%rip),%ymm1 # 4cd8 <_sk_callback_hsw+0x480> .byte 196,226,101,184,200 // vfmadd231ps %ymm0,%ymm3,%ymm1 - .byte 196,226,125,24,5,56,10,0,0 // vbroadcastss 0xa38(%rip),%ymm0 # 4d1c <_sk_callback_hsw+0x470> + .byte 196,226,125,24,5,76,10,0,0 // vbroadcastss 0xa4c(%rip),%ymm0 # 4cdc <_sk_callback_hsw+0x484> .byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 @@ -13996,11 +13952,11 @@ _sk_gradient_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 73,131,249,1 // cmp $0x1,%r9 - .byte 15,134,180,0,0,0 // jbe 43bc <_sk_gradient_hsw+0xc3> + .byte 15,134,180,0,0,0 // jbe 4368 <_sk_gradient_hsw+0xc3> .byte 76,139,80,72 // mov 0x48(%rax),%r10 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 65,187,1,0,0,0 // mov $0x1,%r11d - .byte 196,226,125,24,21,1,10,0,0 // vbroadcastss 0xa01(%rip),%ymm2 # 4d20 <_sk_callback_hsw+0x474> + .byte 196,226,125,24,21,21,10,0,0 // vbroadcastss 0xa15(%rip),%ymm2 # 4ce0 <_sk_callback_hsw+0x488> .byte 196,65,53,239,201 // vpxor %ymm9,%ymm9,%ymm9 .byte 196,130,125,24,28,154 // vbroadcastss (%r10,%r11,4),%ymm3 .byte 197,228,194,216,2 // vcmpleps %ymm0,%ymm3,%ymm3 @@ -14008,10 +13964,10 @@ _sk_gradient_hsw: .byte 196,65,101,254,201 // vpaddd %ymm9,%ymm3,%ymm9 .byte 73,255,195 // inc %r11 .byte 77,57,217 // cmp %r11,%r9 - .byte 117,226 // jne 4324 <_sk_gradient_hsw+0x2b> + .byte 117,226 // jne 42d0 <_sk_gradient_hsw+0x2b> .byte 76,139,80,8 // mov 0x8(%rax),%r10 .byte 73,131,249,8 // cmp $0x8,%r9 - .byte 118,121 // jbe 43c5 <_sk_gradient_hsw+0xcc> + .byte 118,121 // jbe 4371 <_sk_gradient_hsw+0xcc> .byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14 .byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1 .byte 196,2,117,146,4,138 // vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8 @@ -14035,7 +13991,7 @@ _sk_gradient_hsw: .byte 196,130,21,146,28,137 // vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3 .byte 72,139,64,64 // mov 0x40(%rax),%rax .byte 196,34,13,146,44,136 // vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13 - .byte 235,77 // jmp 4409 <_sk_gradient_hsw+0x110> + .byte 235,77 // jmp 43b5 <_sk_gradient_hsw+0x110> .byte 76,139,80,8 // mov 0x8(%rax),%r10 .byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9 .byte 196,66,53,22,2 // vpermps (%r10),%ymm9,%ymm8 @@ -14095,24 +14051,24 @@ _sk_xy_to_unit_angle_hsw: .byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12 .byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11 .byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12 - .byte 196,98,125,24,45,128,8,0,0 // vbroadcastss 0x880(%rip),%ymm13 # 4d24 <_sk_callback_hsw+0x478> - .byte 196,98,125,24,53,123,8,0,0 // vbroadcastss 0x87b(%rip),%ymm14 # 4d28 <_sk_callback_hsw+0x47c> + .byte 196,98,125,24,45,148,8,0,0 // vbroadcastss 0x894(%rip),%ymm13 # 4ce4 <_sk_callback_hsw+0x48c> + .byte 196,98,125,24,53,143,8,0,0 // vbroadcastss 0x88f(%rip),%ymm14 # 4ce8 <_sk_callback_hsw+0x490> .byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14 - .byte 196,98,125,24,45,113,8,0,0 // vbroadcastss 0x871(%rip),%ymm13 # 4d2c <_sk_callback_hsw+0x480> + .byte 196,98,125,24,45,133,8,0,0 // vbroadcastss 0x885(%rip),%ymm13 # 4cec <_sk_callback_hsw+0x494> .byte 196,66,29,184,238 // vfmadd231ps %ymm14,%ymm12,%ymm13 - .byte 196,98,125,24,53,103,8,0,0 // vbroadcastss 0x867(%rip),%ymm14 # 4d30 <_sk_callback_hsw+0x484> + .byte 196,98,125,24,53,123,8,0,0 // vbroadcastss 0x87b(%rip),%ymm14 # 4cf0 <_sk_callback_hsw+0x498> .byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14 .byte 196,65,36,89,222 // vmulps %ymm14,%ymm11,%ymm11 .byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9 - .byte 196,98,125,24,21,82,8,0,0 // vbroadcastss 0x852(%rip),%ymm10 # 4d34 <_sk_callback_hsw+0x488> + .byte 196,98,125,24,21,102,8,0,0 // vbroadcastss 0x866(%rip),%ymm10 # 4cf4 <_sk_callback_hsw+0x49c> .byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10 .byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9 .byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,21,60,8,0,0 // vbroadcastss 0x83c(%rip),%ymm10 # 4d38 <_sk_callback_hsw+0x48c> + .byte 196,98,125,24,21,80,8,0,0 // vbroadcastss 0x850(%rip),%ymm10 # 4cf8 <_sk_callback_hsw+0x4a0> .byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10 .byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0 .byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9 - .byte 196,98,125,24,21,38,8,0,0 // vbroadcastss 0x826(%rip),%ymm10 # 4d3c <_sk_callback_hsw+0x490> + .byte 196,98,125,24,21,58,8,0,0 // vbroadcastss 0x83a(%rip),%ymm10 # 4cfc <_sk_callback_hsw+0x4a4> .byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10 .byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0 .byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9 @@ -14135,7 +14091,7 @@ HIDDEN _sk_save_xy_hsw FUNCTION(_sk_save_xy_hsw) _sk_save_xy_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,243,7,0,0 // vbroadcastss 0x7f3(%rip),%ymm8 # 4d40 <_sk_callback_hsw+0x494> + .byte 196,98,125,24,5,7,8,0,0 // vbroadcastss 0x807(%rip),%ymm8 # 4d00 <_sk_callback_hsw+0x4a8> .byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9 .byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10 .byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9 @@ -14169,9 +14125,9 @@ HIDDEN _sk_bilinear_nx_hsw FUNCTION(_sk_bilinear_nx_hsw) _sk_bilinear_nx_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,135,7,0,0 // vbroadcastss 0x787(%rip),%ymm0 # 4d44 <_sk_callback_hsw+0x498> + .byte 196,226,125,24,5,155,7,0,0 // vbroadcastss 0x79b(%rip),%ymm0 # 4d04 <_sk_callback_hsw+0x4ac> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,126,7,0,0 // vbroadcastss 0x77e(%rip),%ymm8 # 4d48 <_sk_callback_hsw+0x49c> + .byte 196,98,125,24,5,146,7,0,0 // vbroadcastss 0x792(%rip),%ymm8 # 4d08 <_sk_callback_hsw+0x4b0> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14182,7 +14138,7 @@ HIDDEN _sk_bilinear_px_hsw FUNCTION(_sk_bilinear_px_hsw) _sk_bilinear_px_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,102,7,0,0 // vbroadcastss 0x766(%rip),%ymm0 # 4d4c <_sk_callback_hsw+0x4a0> + .byte 196,226,125,24,5,122,7,0,0 // vbroadcastss 0x77a(%rip),%ymm0 # 4d0c <_sk_callback_hsw+0x4b4> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 .byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -14194,9 +14150,9 @@ HIDDEN _sk_bilinear_ny_hsw FUNCTION(_sk_bilinear_ny_hsw) _sk_bilinear_ny_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,74,7,0,0 // vbroadcastss 0x74a(%rip),%ymm1 # 4d50 <_sk_callback_hsw+0x4a4> + .byte 196,226,125,24,13,94,7,0,0 // vbroadcastss 0x75e(%rip),%ymm1 # 4d10 <_sk_callback_hsw+0x4b8> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,64,7,0,0 // vbroadcastss 0x740(%rip),%ymm8 # 4d54 <_sk_callback_hsw+0x4a8> + .byte 196,98,125,24,5,84,7,0,0 // vbroadcastss 0x754(%rip),%ymm8 # 4d14 <_sk_callback_hsw+0x4bc> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14207,7 +14163,7 @@ HIDDEN _sk_bilinear_py_hsw FUNCTION(_sk_bilinear_py_hsw) _sk_bilinear_py_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,40,7,0,0 // vbroadcastss 0x728(%rip),%ymm1 # 4d58 <_sk_callback_hsw+0x4ac> + .byte 196,226,125,24,13,60,7,0,0 // vbroadcastss 0x73c(%rip),%ymm1 # 4d18 <_sk_callback_hsw+0x4c0> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 .byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -14219,13 +14175,13 @@ HIDDEN _sk_bicubic_n3x_hsw FUNCTION(_sk_bicubic_n3x_hsw) _sk_bicubic_n3x_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,11,7,0,0 // vbroadcastss 0x70b(%rip),%ymm0 # 4d5c <_sk_callback_hsw+0x4b0> + .byte 196,226,125,24,5,31,7,0,0 // vbroadcastss 0x71f(%rip),%ymm0 # 4d1c <_sk_callback_hsw+0x4c4> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,2,7,0,0 // vbroadcastss 0x702(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x4b4> + .byte 196,98,125,24,5,22,7,0,0 // vbroadcastss 0x716(%rip),%ymm8 # 4d20 <_sk_callback_hsw+0x4c8> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,243,6,0,0 // vbroadcastss 0x6f3(%rip),%ymm10 # 4d64 <_sk_callback_hsw+0x4b8> - .byte 196,98,125,24,29,238,6,0,0 // vbroadcastss 0x6ee(%rip),%ymm11 # 4d68 <_sk_callback_hsw+0x4bc> + .byte 196,98,125,24,21,7,7,0,0 // vbroadcastss 0x707(%rip),%ymm10 # 4d24 <_sk_callback_hsw+0x4cc> + .byte 196,98,125,24,29,2,7,0,0 // vbroadcastss 0x702(%rip),%ymm11 # 4d28 <_sk_callback_hsw+0x4d0> .byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11 .byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -14237,16 +14193,16 @@ HIDDEN _sk_bicubic_n1x_hsw FUNCTION(_sk_bicubic_n1x_hsw) _sk_bicubic_n1x_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,209,6,0,0 // vbroadcastss 0x6d1(%rip),%ymm0 # 4d6c <_sk_callback_hsw+0x4c0> + .byte 196,226,125,24,5,229,6,0,0 // vbroadcastss 0x6e5(%rip),%ymm0 # 4d2c <_sk_callback_hsw+0x4d4> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,200,6,0,0 // vbroadcastss 0x6c8(%rip),%ymm8 # 4d70 <_sk_callback_hsw+0x4c4> + .byte 196,98,125,24,5,220,6,0,0 // vbroadcastss 0x6dc(%rip),%ymm8 # 4d30 <_sk_callback_hsw+0x4d8> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 - .byte 196,98,125,24,13,190,6,0,0 // vbroadcastss 0x6be(%rip),%ymm9 # 4d74 <_sk_callback_hsw+0x4c8> - .byte 196,98,125,24,21,185,6,0,0 // vbroadcastss 0x6b9(%rip),%ymm10 # 4d78 <_sk_callback_hsw+0x4cc> + .byte 196,98,125,24,13,210,6,0,0 // vbroadcastss 0x6d2(%rip),%ymm9 # 4d34 <_sk_callback_hsw+0x4dc> + .byte 196,98,125,24,21,205,6,0,0 // vbroadcastss 0x6cd(%rip),%ymm10 # 4d38 <_sk_callback_hsw+0x4e0> .byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10 - .byte 196,98,125,24,13,175,6,0,0 // vbroadcastss 0x6af(%rip),%ymm9 # 4d7c <_sk_callback_hsw+0x4d0> + .byte 196,98,125,24,13,195,6,0,0 // vbroadcastss 0x6c3(%rip),%ymm9 # 4d3c <_sk_callback_hsw+0x4e4> .byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9 - .byte 196,98,125,24,21,165,6,0,0 // vbroadcastss 0x6a5(%rip),%ymm10 # 4d80 <_sk_callback_hsw+0x4d4> + .byte 196,98,125,24,21,185,6,0,0 // vbroadcastss 0x6b9(%rip),%ymm10 # 4d40 <_sk_callback_hsw+0x4e8> .byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10 .byte 197,124,17,144,128,0,0,0 // vmovups %ymm10,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14257,14 +14213,14 @@ HIDDEN _sk_bicubic_p1x_hsw FUNCTION(_sk_bicubic_p1x_hsw) _sk_bicubic_p1x_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,141,6,0,0 // vbroadcastss 0x68d(%rip),%ymm8 # 4d84 <_sk_callback_hsw+0x4d8> + .byte 196,98,125,24,5,161,6,0,0 // vbroadcastss 0x6a1(%rip),%ymm8 # 4d44 <_sk_callback_hsw+0x4ec> .byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0 .byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9 - .byte 196,98,125,24,21,127,6,0,0 // vbroadcastss 0x67f(%rip),%ymm10 # 4d88 <_sk_callback_hsw+0x4dc> - .byte 196,98,125,24,29,122,6,0,0 // vbroadcastss 0x67a(%rip),%ymm11 # 4d8c <_sk_callback_hsw+0x4e0> + .byte 196,98,125,24,21,147,6,0,0 // vbroadcastss 0x693(%rip),%ymm10 # 4d48 <_sk_callback_hsw+0x4f0> + .byte 196,98,125,24,29,142,6,0,0 // vbroadcastss 0x68e(%rip),%ymm11 # 4d4c <_sk_callback_hsw+0x4f4> .byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11 .byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11 - .byte 196,98,125,24,5,107,6,0,0 // vbroadcastss 0x66b(%rip),%ymm8 # 4d90 <_sk_callback_hsw+0x4e4> + .byte 196,98,125,24,5,127,6,0,0 // vbroadcastss 0x67f(%rip),%ymm8 # 4d50 <_sk_callback_hsw+0x4f8> .byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14275,12 +14231,12 @@ HIDDEN _sk_bicubic_p3x_hsw FUNCTION(_sk_bicubic_p3x_hsw) _sk_bicubic_p3x_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,83,6,0,0 // vbroadcastss 0x653(%rip),%ymm0 # 4d94 <_sk_callback_hsw+0x4e8> + .byte 196,226,125,24,5,103,6,0,0 // vbroadcastss 0x667(%rip),%ymm0 # 4d54 <_sk_callback_hsw+0x4fc> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 .byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,64,6,0,0 // vbroadcastss 0x640(%rip),%ymm10 # 4d98 <_sk_callback_hsw+0x4ec> - .byte 196,98,125,24,29,59,6,0,0 // vbroadcastss 0x63b(%rip),%ymm11 # 4d9c <_sk_callback_hsw+0x4f0> + .byte 196,98,125,24,21,84,6,0,0 // vbroadcastss 0x654(%rip),%ymm10 # 4d58 <_sk_callback_hsw+0x500> + .byte 196,98,125,24,29,79,6,0,0 // vbroadcastss 0x64f(%rip),%ymm11 # 4d5c <_sk_callback_hsw+0x504> .byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11 .byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -14292,13 +14248,13 @@ HIDDEN _sk_bicubic_n3y_hsw FUNCTION(_sk_bicubic_n3y_hsw) _sk_bicubic_n3y_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,30,6,0,0 // vbroadcastss 0x61e(%rip),%ymm1 # 4da0 <_sk_callback_hsw+0x4f4> + .byte 196,226,125,24,13,50,6,0,0 // vbroadcastss 0x632(%rip),%ymm1 # 4d60 <_sk_callback_hsw+0x508> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,20,6,0,0 // vbroadcastss 0x614(%rip),%ymm8 # 4da4 <_sk_callback_hsw+0x4f8> + .byte 196,98,125,24,5,40,6,0,0 // vbroadcastss 0x628(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x50c> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,5,6,0,0 // vbroadcastss 0x605(%rip),%ymm10 # 4da8 <_sk_callback_hsw+0x4fc> - .byte 196,98,125,24,29,0,6,0,0 // vbroadcastss 0x600(%rip),%ymm11 # 4dac <_sk_callback_hsw+0x500> + .byte 196,98,125,24,21,25,6,0,0 // vbroadcastss 0x619(%rip),%ymm10 # 4d68 <_sk_callback_hsw+0x510> + .byte 196,98,125,24,29,20,6,0,0 // vbroadcastss 0x614(%rip),%ymm11 # 4d6c <_sk_callback_hsw+0x514> .byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11 .byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -14310,16 +14266,16 @@ HIDDEN _sk_bicubic_n1y_hsw FUNCTION(_sk_bicubic_n1y_hsw) _sk_bicubic_n1y_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,227,5,0,0 // vbroadcastss 0x5e3(%rip),%ymm1 # 4db0 <_sk_callback_hsw+0x504> + .byte 196,226,125,24,13,247,5,0,0 // vbroadcastss 0x5f7(%rip),%ymm1 # 4d70 <_sk_callback_hsw+0x518> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,217,5,0,0 // vbroadcastss 0x5d9(%rip),%ymm8 # 4db4 <_sk_callback_hsw+0x508> + .byte 196,98,125,24,5,237,5,0,0 // vbroadcastss 0x5ed(%rip),%ymm8 # 4d74 <_sk_callback_hsw+0x51c> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 - .byte 196,98,125,24,13,207,5,0,0 // vbroadcastss 0x5cf(%rip),%ymm9 # 4db8 <_sk_callback_hsw+0x50c> - .byte 196,98,125,24,21,202,5,0,0 // vbroadcastss 0x5ca(%rip),%ymm10 # 4dbc <_sk_callback_hsw+0x510> + .byte 196,98,125,24,13,227,5,0,0 // vbroadcastss 0x5e3(%rip),%ymm9 # 4d78 <_sk_callback_hsw+0x520> + .byte 196,98,125,24,21,222,5,0,0 // vbroadcastss 0x5de(%rip),%ymm10 # 4d7c <_sk_callback_hsw+0x524> .byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10 - .byte 196,98,125,24,13,192,5,0,0 // vbroadcastss 0x5c0(%rip),%ymm9 # 4dc0 <_sk_callback_hsw+0x514> + .byte 196,98,125,24,13,212,5,0,0 // vbroadcastss 0x5d4(%rip),%ymm9 # 4d80 <_sk_callback_hsw+0x528> .byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9 - .byte 196,98,125,24,21,182,5,0,0 // vbroadcastss 0x5b6(%rip),%ymm10 # 4dc4 <_sk_callback_hsw+0x518> + .byte 196,98,125,24,21,202,5,0,0 // vbroadcastss 0x5ca(%rip),%ymm10 # 4d84 <_sk_callback_hsw+0x52c> .byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10 .byte 197,124,17,144,160,0,0,0 // vmovups %ymm10,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14330,14 +14286,14 @@ HIDDEN _sk_bicubic_p1y_hsw FUNCTION(_sk_bicubic_p1y_hsw) _sk_bicubic_p1y_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,158,5,0,0 // vbroadcastss 0x59e(%rip),%ymm8 # 4dc8 <_sk_callback_hsw+0x51c> + .byte 196,98,125,24,5,178,5,0,0 // vbroadcastss 0x5b2(%rip),%ymm8 # 4d88 <_sk_callback_hsw+0x530> .byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1 .byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9 - .byte 196,98,125,24,21,143,5,0,0 // vbroadcastss 0x58f(%rip),%ymm10 # 4dcc <_sk_callback_hsw+0x520> - .byte 196,98,125,24,29,138,5,0,0 // vbroadcastss 0x58a(%rip),%ymm11 # 4dd0 <_sk_callback_hsw+0x524> + .byte 196,98,125,24,21,163,5,0,0 // vbroadcastss 0x5a3(%rip),%ymm10 # 4d8c <_sk_callback_hsw+0x534> + .byte 196,98,125,24,29,158,5,0,0 // vbroadcastss 0x59e(%rip),%ymm11 # 4d90 <_sk_callback_hsw+0x538> .byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11 .byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11 - .byte 196,98,125,24,5,123,5,0,0 // vbroadcastss 0x57b(%rip),%ymm8 # 4dd4 <_sk_callback_hsw+0x528> + .byte 196,98,125,24,5,143,5,0,0 // vbroadcastss 0x58f(%rip),%ymm8 # 4d94 <_sk_callback_hsw+0x53c> .byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -14348,12 +14304,12 @@ HIDDEN _sk_bicubic_p3y_hsw FUNCTION(_sk_bicubic_p3y_hsw) _sk_bicubic_p3y_hsw: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,99,5,0,0 // vbroadcastss 0x563(%rip),%ymm1 # 4dd8 <_sk_callback_hsw+0x52c> + .byte 196,226,125,24,13,119,5,0,0 // vbroadcastss 0x577(%rip),%ymm1 # 4d98 <_sk_callback_hsw+0x540> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 .byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,79,5,0,0 // vbroadcastss 0x54f(%rip),%ymm10 # 4ddc <_sk_callback_hsw+0x530> - .byte 196,98,125,24,29,74,5,0,0 // vbroadcastss 0x54a(%rip),%ymm11 # 4de0 <_sk_callback_hsw+0x534> + .byte 196,98,125,24,21,99,5,0,0 // vbroadcastss 0x563(%rip),%ymm10 # 4d9c <_sk_callback_hsw+0x544> + .byte 196,98,125,24,29,94,5,0,0 // vbroadcastss 0x55e(%rip),%ymm11 # 4da0 <_sk_callback_hsw+0x548> .byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11 .byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -14365,22 +14321,24 @@ HIDDEN _sk_callback_hsw FUNCTION(_sk_callback_hsw) _sk_callback_hsw: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx - .byte 72,129,236,136,0,0,0 // sub $0x88,%rsp - .byte 197,252,17,124,36,96 // vmovups %ymm7,0x60(%rsp) - .byte 197,252,17,116,36,64 // vmovups %ymm6,0x40(%rsp) - .byte 197,252,17,108,36,32 // vmovups %ymm5,0x20(%rsp) - .byte 197,252,17,36,36 // vmovups %ymm4,(%rsp) + .byte 72,131,228,224 // and $0xffffffffffffffe0,%rsp + .byte 72,129,236,192,0,0,0 // sub $0xc0,%rsp + .byte 197,252,41,188,36,128,0,0,0 // vmovaps %ymm7,0x80(%rsp) + .byte 197,252,41,116,36,96 // vmovaps %ymm6,0x60(%rsp) + .byte 197,252,41,108,36,64 // vmovaps %ymm5,0x40(%rsp) + .byte 197,252,41,100,36,32 // vmovaps %ymm4,0x20(%rsp) .byte 76,137,195 // mov %r8,%rbx - .byte 73,137,206 // mov %rcx,%r14 + .byte 72,137,76,36,24 // mov %rcx,0x18(%rsp) .byte 73,137,215 // mov %rdx,%r15 .byte 73,137,252 // mov %rdi,%r12 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 72,137,197 // mov %rax,%rbp + .byte 73,137,198 // mov %rax,%r14 .byte 73,137,245 // mov %rsi,%r13 .byte 197,252,20,225 // vunpcklps %ymm1,%ymm0,%ymm4 .byte 197,252,21,193 // vunpckhps %ymm1,%ymm0,%ymm0 @@ -14394,17 +14352,17 @@ _sk_callback_hsw: .byte 196,227,93,24,232,1 // vinsertf128 $0x1,%xmm0,%ymm4,%ymm5 .byte 196,227,101,6,201,49 // vperm2f128 $0x31,%ymm1,%ymm3,%ymm1 .byte 196,227,93,6,192,49 // vperm2f128 $0x31,%ymm0,%ymm4,%ymm0 - .byte 197,253,17,85,8 // vmovupd %ymm2,0x8(%rbp) - .byte 197,253,17,109,40 // vmovupd %ymm5,0x28(%rbp) - .byte 197,253,17,77,72 // vmovupd %ymm1,0x48(%rbp) - .byte 197,253,17,69,104 // vmovupd %ymm0,0x68(%rbp) + .byte 196,193,125,17,86,8 // vmovupd %ymm2,0x8(%r14) + .byte 196,193,125,17,110,40 // vmovupd %ymm5,0x28(%r14) + .byte 196,193,125,17,78,72 // vmovupd %ymm1,0x48(%r14) + .byte 196,193,125,17,70,104 // vmovupd %ymm0,0x68(%r14) .byte 72,133,219 // test %rbx,%rbx .byte 190,8,0,0,0 // mov $0x8,%esi .byte 15,69,243 // cmovne %ebx,%esi - .byte 72,137,239 // mov %rbp,%rdi + .byte 76,137,247 // mov %r14,%rdi .byte 197,248,119 // vzeroupper - .byte 255,85,0 // callq *0x0(%rbp) - .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax + .byte 65,255,22 // callq *(%r14) + .byte 73,139,134,136,0,0,0 // mov 0x88(%r14),%rax .byte 197,248,16,0 // vmovups (%rax),%xmm0 .byte 197,248,16,72,16 // vmovups 0x10(%rax),%xmm1 .byte 197,248,16,80,32 // vmovups 0x20(%rax),%xmm2 @@ -14425,13 +14383,13 @@ _sk_callback_hsw: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,231 // mov %r12,%rdi .byte 76,137,250 // mov %r15,%rdx - .byte 76,137,241 // mov %r14,%rcx + .byte 72,139,76,36,24 // mov 0x18(%rsp),%rcx .byte 73,137,216 // mov %rbx,%r8 - .byte 197,252,16,36,36 // vmovups (%rsp),%ymm4 - .byte 197,252,16,108,36,32 // vmovups 0x20(%rsp),%ymm5 - .byte 197,252,16,116,36,64 // vmovups 0x40(%rsp),%ymm6 - .byte 197,252,16,124,36,96 // vmovups 0x60(%rsp),%ymm7 - .byte 72,129,196,136,0,0,0 // add $0x88,%rsp + .byte 197,252,40,100,36,32 // vmovaps 0x20(%rsp),%ymm4 + .byte 197,252,40,108,36,64 // vmovaps 0x40(%rsp),%ymm5 + .byte 197,252,40,116,36,96 // vmovaps 0x60(%rsp),%ymm6 + .byte 197,252,40,188,36,128,0,0,0 // vmovaps 0x80(%rsp),%ymm7 + .byte 72,141,101,216 // lea -0x28(%rbp),%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 .byte 65,93 // pop %r13 @@ -14481,25 +14439,25 @@ BALIGN4 .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 4a8d <.literal4+0xb1> + .byte 71,225,61 // rex.RXB loope 4a4d <.literal4+0xb1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 4a9d <.literal4+0xc1> + .byte 71,225,61 // rex.RXB loope 4a5d <.literal4+0xc1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 4aad <.literal4+0xd1> + .byte 71,225,61 // rex.RXB loope 4a6d <.literal4+0xd1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 4abd <.literal4+0xe1> + .byte 71,225,61 // rex.RXB loope 4a7d <.literal4+0xe1> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax) @@ -14549,7 +14507,7 @@ BALIGN4 .byte 190,129,128,128,59 // mov $0x3b808081,%esi .byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 4b15 <.literal4+0x139> + .byte 224,7 // loopne 4ad5 <.literal4+0x139> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -14565,10 +14523,10 @@ BALIGN4 .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) .byte 0,52,255 // add %dh,(%rdi,%rdi,8) .byte 255 // (bad) - .byte 127,0 // jg 4b3c <.literal4+0x160> + .byte 127,0 // jg 4afc <.literal4+0x160> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 4bb5 <.literal4+0x1d9> + .byte 119,115 // ja 4b75 <.literal4+0x1d9> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -14582,10 +14540,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 4b70 <.literal4+0x194> + .byte 127,0 // jg 4b30 <.literal4+0x194> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 4be9 <.literal4+0x20d> + .byte 119,115 // ja 4ba9 <.literal4+0x20d> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -14599,10 +14557,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 4ba4 <.literal4+0x1c8> + .byte 127,0 // jg 4b64 <.literal4+0x1c8> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 4c1d <.literal4+0x241> + .byte 119,115 // ja 4bdd <.literal4+0x241> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -14616,10 +14574,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 4bd8 <.literal4+0x1fc> + .byte 127,0 // jg 4b98 <.literal4+0x1fc> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 4c51 <.literal4+0x275> + .byte 119,115 // ja 4c11 <.literal4+0x275> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -14632,7 +14590,7 @@ BALIGN4 .byte 0,75,0 // add %cl,0x0(%rbx) .byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax) .byte 66,0,0 // rex.X add %al,(%rax) - .byte 127,67 // jg 4c4f <.literal4+0x273> + .byte 127,67 // jg 4c0f <.literal4+0x273> .byte 0,0 // add %al,(%rax) .byte 0,195 // add %al,%bl .byte 0,0 // add %al,(%rax) @@ -14644,10 +14602,10 @@ BALIGN4 .byte 190,80,128,3,62 // mov $0x3e038050,%esi .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 4c6f <.literal4+0x293> + .byte 118,63 // jbe 4c2f <.literal4+0x293> .byte 246,64,83,63 // testb $0x3f,0x53(%rax) .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) - .byte 127,67 // jg 4c83 <.literal4+0x2a7> + .byte 127,67 // jg 4c43 <.literal4+0x2a7> .byte 129,128,128,59,0,0,128,63,129,128 // addl $0x80813f80,0x3b80(%rax) .byte 128,59,0 // cmpb $0x0,(%rbx) .byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax) @@ -14656,7 +14614,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 4c65 <.literal4+0x289> + .byte 224,7 // loopne 4c25 <.literal4+0x289> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -14668,7 +14626,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 4c81 <.literal4+0x2a5> + .byte 224,7 // loopne 4c41 <.literal4+0x2a5> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -14679,7 +14637,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 248 // clc .byte 65,0,0 // add %al,(%r8) - .byte 124,66 // jl 4cd6 <.literal4+0x2fa> + .byte 124,66 // jl 4c96 <.literal4+0x2fa> .byte 0,240 // add %dh,%al .byte 0,0 // add %al,(%rax) .byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax) @@ -14697,9 +14655,9 @@ BALIGN4 .byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax) .byte 0,0 // add %al,(%rax) .byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax) - .byte 112,65 // jo 4d19 <.literal4+0x33d> + .byte 112,65 // jo 4cd9 <.literal4+0x33d> .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) - .byte 127,67 // jg 4d27 <.literal4+0x34b> + .byte 127,67 // jg 4ce7 <.literal4+0x34b> .byte 128,0,128 // addb $0x80,(%rax) .byte 55 // (bad) .byte 128,0,128 // addb $0x80,(%rax) @@ -14707,7 +14665,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 255 // (bad) - .byte 127,71 // jg 4d3b <.literal4+0x35f> + .byte 127,71 // jg 4cfb <.literal4+0x35f> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,191,0,0,0 // add %al,0xbf(%rax) @@ -14815,16 +14773,16 @@ BALIGN32 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e28 <_sk_callback_hsw+0xa00057c> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004de8 <_sk_callback_hsw+0xa000590> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e30 <_sk_callback_hsw+0x12000584> + .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004df0 <_sk_callback_hsw+0x12000598> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e38 <_sk_callback_hsw+0x1a00058c> + .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004df8 <_sk_callback_hsw+0x1a0005a0> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004e40 <_sk_callback_hsw+0x3000594> + .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004e00 <_sk_callback_hsw+0x30005a8> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -14867,16 +14825,16 @@ BALIGN32 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e88 <_sk_callback_hsw+0xa0005dc> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004e48 <_sk_callback_hsw+0xa0005f0> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e90 <_sk_callback_hsw+0x120005e4> + .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004e50 <_sk_callback_hsw+0x120005f8> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e98 <_sk_callback_hsw+0x1a0005ec> + .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004e58 <_sk_callback_hsw+0x1a000600> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004ea0 <_sk_callback_hsw+0x30005f4> + .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004e60 <_sk_callback_hsw+0x3000608> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -14919,16 +14877,16 @@ BALIGN32 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004ee8 <_sk_callback_hsw+0xa00063c> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004ea8 <_sk_callback_hsw+0xa000650> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004ef0 <_sk_callback_hsw+0x12000644> + .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004eb0 <_sk_callback_hsw+0x12000658> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004ef8 <_sk_callback_hsw+0x1a00064c> + .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004eb8 <_sk_callback_hsw+0x1a000660> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f00 <_sk_callback_hsw+0x3000654> + .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004ec0 <_sk_callback_hsw+0x3000668> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -14971,16 +14929,16 @@ BALIGN32 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004f48 <_sk_callback_hsw+0xa00069c> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004f08 <_sk_callback_hsw+0xa0006b0> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004f50 <_sk_callback_hsw+0x120006a4> + .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004f10 <_sk_callback_hsw+0x120006b8> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004f58 <_sk_callback_hsw+0x1a0006ac> + .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004f18 <_sk_callback_hsw+0x1a0006c0> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f60 <_sk_callback_hsw+0x30006b4> + .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f20 <_sk_callback_hsw+0x30006c8> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -15023,16 +14981,16 @@ BALIGN32 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004fa8 <_sk_callback_hsw+0xa0006fc> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a004f68 <_sk_callback_hsw+0xa000710> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004fb0 <_sk_callback_hsw+0x12000704> + .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12004f70 <_sk_callback_hsw+0x12000718> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004fb8 <_sk_callback_hsw+0x1a00070c> + .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a004f78 <_sk_callback_hsw+0x1a000720> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004fc0 <_sk_callback_hsw+0x3000714> + .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3004f80 <_sk_callback_hsw+0x3000728> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -15082,25 +15040,27 @@ HIDDEN _sk_start_pipeline_avx FUNCTION(_sk_start_pipeline_avx) _sk_start_pipeline_avx: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 80 // push %rax - .byte 77,137,198 // mov %r8,%r14 - .byte 72,137,211 // mov %rdx,%rbx - .byte 73,137,247 // mov %rsi,%r15 - .byte 72,137,253 // mov %rdi,%rbp + .byte 76,137,195 // mov %r8,%rbx + .byte 73,137,208 // mov %rdx,%r8 + .byte 73,137,244 // mov %rsi,%r12 + .byte 73,137,254 // mov %rdi,%r14 .byte 72,137,206 // mov %rcx,%rsi .byte 72,173 // lods %ds:(%rsi),%rax - .byte 73,137,196 // mov %rax,%r12 - .byte 73,137,245 // mov %rsi,%r13 - .byte 72,141,69,8 // lea 0x8(%rbp),%rax - .byte 72,57,216 // cmp %rbx,%rax - .byte 118,5 // jbe 30 <_sk_start_pipeline_avx+0x30> - .byte 72,137,234 // mov %rbp,%rdx - .byte 235,69 // jmp 75 <_sk_start_pipeline_avx+0x75> + .byte 73,137,197 // mov %rax,%r13 + .byte 73,137,247 // mov %rsi,%r15 + .byte 73,141,78,8 // lea 0x8(%r14),%rcx + .byte 76,57,193 // cmp %r8,%rcx + .byte 118,5 // jbe 33 <_sk_start_pipeline_avx+0x33> + .byte 76,137,242 // mov %r14,%rdx + .byte 235,77 // jmp 80 <_sk_start_pipeline_avx+0x80> + .byte 76,137,69,208 // mov %r8,-0x30(%rbp) .byte 65,184,0,0,0,0 // mov $0x0,%r8d .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 @@ -15110,18 +15070,19 @@ _sk_start_pipeline_avx: .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 .byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6 .byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 72,137,234 // mov %rbp,%rdx - .byte 76,137,249 // mov %r15,%rcx - .byte 65,255,212 // callq *%r12 - .byte 72,141,85,8 // lea 0x8(%rbp),%rdx - .byte 72,131,197,16 // add $0x10,%rbp - .byte 72,57,221 // cmp %rbx,%rbp - .byte 72,137,213 // mov %rdx,%rbp - .byte 118,187 // jbe 30 <_sk_start_pipeline_avx+0x30> - .byte 72,41,211 // sub %rdx,%rbx - .byte 116,47 // je a9 <_sk_start_pipeline_avx+0xa9> + .byte 72,137,223 // mov %rbx,%rdi + .byte 76,137,254 // mov %r15,%rsi + .byte 76,137,242 // mov %r14,%rdx + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 + .byte 76,139,69,208 // mov -0x30(%rbp),%r8 + .byte 73,141,86,8 // lea 0x8(%r14),%rdx + .byte 73,131,198,16 // add $0x10,%r14 + .byte 77,57,198 // cmp %r8,%r14 + .byte 73,137,214 // mov %rdx,%r14 + .byte 118,183 // jbe 37 <_sk_start_pipeline_avx+0x37> + .byte 73,41,208 // sub %rdx,%r8 + .byte 116,44 // je b1 <_sk_start_pipeline_avx+0xb1> .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2 @@ -15130,11 +15091,10 @@ _sk_start_pipeline_avx: .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 .byte 197,204,87,246 // vxorps %ymm6,%ymm6,%ymm6 .byte 197,196,87,255 // vxorps %ymm7,%ymm7,%ymm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 76,137,249 // mov %r15,%rcx - .byte 73,137,216 // mov %rbx,%r8 - .byte 65,255,212 // callq *%r12 + .byte 72,137,223 // mov %rbx,%rdi + .byte 76,137,254 // mov %r15,%rsi + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 .byte 72,131,196,8 // add $0x8,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -15159,7 +15119,7 @@ _sk_seed_shader_avx: .byte 197,249,112,192,0 // vpshufd $0x0,%xmm0,%xmm0 .byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,20,101,0,0 // vbroadcastss 0x6514(%rip),%ymm1 # 65ec <_sk_callback_avx+0x130> + .byte 196,226,125,24,13,96,100,0,0 // vbroadcastss 0x6460(%rip),%ymm1 # 6540 <_sk_callback_avx+0x144> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0 .byte 197,249,110,209 // vmovd %ecx,%xmm2 @@ -15168,7 +15128,7 @@ _sk_seed_shader_avx: .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,21,238,100,0,0 // vbroadcastss 0x64ee(%rip),%ymm2 # 65f0 <_sk_callback_avx+0x134> + .byte 196,226,125,24,21,58,100,0,0 // vbroadcastss 0x643a(%rip),%ymm2 # 6544 <_sk_callback_avx+0x148> .byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3 .byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4 .byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5 @@ -15192,7 +15152,7 @@ _sk_dither_avx: .byte 196,65,121,112,201,0 // vpshufd $0x0,%xmm9,%xmm9 .byte 196,67,53,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm9,%ymm9 .byte 196,65,52,87,208 // vxorps %ymm8,%ymm9,%ymm10 - .byte 196,98,125,24,29,151,100,0,0 // vbroadcastss 0x6497(%rip),%ymm11 # 65f4 <_sk_callback_avx+0x138> + .byte 196,98,125,24,29,227,99,0,0 // vbroadcastss 0x63e3(%rip),%ymm11 # 6548 <_sk_callback_avx+0x14c> .byte 196,65,44,84,203 // vandps %ymm11,%ymm10,%ymm9 .byte 196,193,25,114,241,5 // vpslld $0x5,%xmm9,%xmm12 .byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9 @@ -15203,8 +15163,8 @@ _sk_dither_avx: .byte 196,67,125,25,219,1 // vextractf128 $0x1,%ymm11,%xmm11 .byte 196,193,33,114,243,4 // vpslld $0x4,%xmm11,%xmm11 .byte 196,67,29,24,219,1 // vinsertf128 $0x1,%xmm11,%ymm12,%ymm11 - .byte 196,98,125,24,37,88,100,0,0 // vbroadcastss 0x6458(%rip),%ymm12 # 65f8 <_sk_callback_avx+0x13c> - .byte 196,98,125,24,45,83,100,0,0 // vbroadcastss 0x6453(%rip),%ymm13 # 65fc <_sk_callback_avx+0x140> + .byte 196,98,125,24,37,164,99,0,0 // vbroadcastss 0x63a4(%rip),%ymm12 # 654c <_sk_callback_avx+0x150> + .byte 196,98,125,24,45,159,99,0,0 // vbroadcastss 0x639f(%rip),%ymm13 # 6550 <_sk_callback_avx+0x154> .byte 196,65,44,84,245 // vandps %ymm13,%ymm10,%ymm14 .byte 196,193,1,114,246,2 // vpslld $0x2,%xmm14,%xmm15 .byte 196,67,125,25,246,1 // vextractf128 $0x1,%ymm14,%xmm14 @@ -15231,9 +15191,9 @@ _sk_dither_avx: .byte 196,65,60,86,193 // vorps %ymm9,%ymm8,%ymm8 .byte 196,65,60,86,194 // vorps %ymm10,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,190,99,0,0 // vbroadcastss 0x63be(%rip),%ymm9 # 6600 <_sk_callback_avx+0x144> + .byte 196,98,125,24,13,10,99,0,0 // vbroadcastss 0x630a(%rip),%ymm9 # 6554 <_sk_callback_avx+0x158> .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 - .byte 196,98,125,24,13,180,99,0,0 // vbroadcastss 0x63b4(%rip),%ymm9 # 6604 <_sk_callback_avx+0x148> + .byte 196,98,125,24,13,0,99,0,0 // vbroadcastss 0x6300(%rip),%ymm9 # 6558 <_sk_callback_avx+0x15c> .byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8 .byte 196,98,125,24,8 // vbroadcastss (%rax),%ymm9 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 @@ -15302,7 +15262,7 @@ HIDDEN _sk_srcatop_avx FUNCTION(_sk_srcatop_avx) _sk_srcatop_avx: .byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0 - .byte 196,98,125,24,5,12,99,0,0 // vbroadcastss 0x630c(%rip),%ymm8 # 6608 <_sk_callback_avx+0x14c> + .byte 196,98,125,24,5,88,98,0,0 // vbroadcastss 0x6258(%rip),%ymm8 # 655c <_sk_callback_avx+0x160> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9 .byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0 @@ -15323,7 +15283,7 @@ HIDDEN _sk_dstatop_avx FUNCTION(_sk_dstatop_avx) _sk_dstatop_avx: .byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8 - .byte 196,98,125,24,13,206,98,0,0 // vbroadcastss 0x62ce(%rip),%ymm9 # 660c <_sk_callback_avx+0x150> + .byte 196,98,125,24,13,26,98,0,0 // vbroadcastss 0x621a(%rip),%ymm9 # 6560 <_sk_callback_avx+0x164> .byte 197,52,92,207 // vsubps %ymm7,%ymm9,%ymm9 .byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0 .byte 197,188,88,192 // vaddps %ymm0,%ymm8,%ymm0 @@ -15365,7 +15325,7 @@ HIDDEN _sk_srcout_avx .globl _sk_srcout_avx FUNCTION(_sk_srcout_avx) _sk_srcout_avx: - .byte 196,98,125,24,5,109,98,0,0 // vbroadcastss 0x626d(%rip),%ymm8 # 6610 <_sk_callback_avx+0x154> + .byte 196,98,125,24,5,185,97,0,0 // vbroadcastss 0x61b9(%rip),%ymm8 # 6564 <_sk_callback_avx+0x168> .byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 @@ -15378,7 +15338,7 @@ HIDDEN _sk_dstout_avx .globl _sk_dstout_avx FUNCTION(_sk_dstout_avx) _sk_dstout_avx: - .byte 196,226,125,24,5,80,98,0,0 // vbroadcastss 0x6250(%rip),%ymm0 # 6614 <_sk_callback_avx+0x158> + .byte 196,226,125,24,5,156,97,0,0 // vbroadcastss 0x619c(%rip),%ymm0 # 6568 <_sk_callback_avx+0x16c> .byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3 .byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0 .byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1 @@ -15391,7 +15351,7 @@ HIDDEN _sk_srcover_avx .globl _sk_srcover_avx FUNCTION(_sk_srcover_avx) _sk_srcover_avx: - .byte 196,98,125,24,5,51,98,0,0 // vbroadcastss 0x6233(%rip),%ymm8 # 6618 <_sk_callback_avx+0x15c> + .byte 196,98,125,24,5,127,97,0,0 // vbroadcastss 0x617f(%rip),%ymm8 # 656c <_sk_callback_avx+0x170> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9 .byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0 @@ -15408,7 +15368,7 @@ HIDDEN _sk_dstover_avx .globl _sk_dstover_avx FUNCTION(_sk_dstover_avx) _sk_dstover_avx: - .byte 196,98,125,24,5,6,98,0,0 // vbroadcastss 0x6206(%rip),%ymm8 # 661c <_sk_callback_avx+0x160> + .byte 196,98,125,24,5,82,97,0,0 // vbroadcastss 0x6152(%rip),%ymm8 # 6570 <_sk_callback_avx+0x174> .byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 197,252,88,196 // vaddps %ymm4,%ymm0,%ymm0 @@ -15436,7 +15396,7 @@ HIDDEN _sk_multiply_avx .globl _sk_multiply_avx FUNCTION(_sk_multiply_avx) _sk_multiply_avx: - .byte 196,98,125,24,5,197,97,0,0 // vbroadcastss 0x61c5(%rip),%ymm8 # 6620 <_sk_callback_avx+0x164> + .byte 196,98,125,24,5,17,97,0,0 // vbroadcastss 0x6111(%rip),%ymm8 # 6574 <_sk_callback_avx+0x178> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -15496,7 +15456,7 @@ HIDDEN _sk_xor__avx .globl _sk_xor__avx FUNCTION(_sk_xor__avx) _sk_xor__avx: - .byte 196,98,125,24,5,20,97,0,0 // vbroadcastss 0x6114(%rip),%ymm8 # 6624 <_sk_callback_avx+0x168> + .byte 196,98,125,24,5,96,96,0,0 // vbroadcastss 0x6060(%rip),%ymm8 # 6578 <_sk_callback_avx+0x17c> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -15533,7 +15493,7 @@ _sk_darken_avx: .byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9 .byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,148,96,0,0 // vbroadcastss 0x6094(%rip),%ymm8 # 6628 <_sk_callback_avx+0x16c> + .byte 196,98,125,24,5,224,95,0,0 // vbroadcastss 0x5fe0(%rip),%ymm8 # 657c <_sk_callback_avx+0x180> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8 .byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3 @@ -15559,7 +15519,7 @@ _sk_lighten_avx: .byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9 .byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,64,96,0,0 // vbroadcastss 0x6040(%rip),%ymm8 # 662c <_sk_callback_avx+0x170> + .byte 196,98,125,24,5,140,95,0,0 // vbroadcastss 0x5f8c(%rip),%ymm8 # 6580 <_sk_callback_avx+0x184> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8 .byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3 @@ -15588,7 +15548,7 @@ _sk_difference_avx: .byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2 .byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,224,95,0,0 // vbroadcastss 0x5fe0(%rip),%ymm8 # 6630 <_sk_callback_avx+0x174> + .byte 196,98,125,24,5,44,95,0,0 // vbroadcastss 0x5f2c(%rip),%ymm8 # 6584 <_sk_callback_avx+0x188> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8 .byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3 @@ -15611,7 +15571,7 @@ _sk_exclusion_avx: .byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2 .byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2 .byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2 - .byte 196,98,125,24,5,155,95,0,0 // vbroadcastss 0x5f9b(%rip),%ymm8 # 6634 <_sk_callback_avx+0x178> + .byte 196,98,125,24,5,231,94,0,0 // vbroadcastss 0x5ee7(%rip),%ymm8 # 6588 <_sk_callback_avx+0x18c> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 .byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8 .byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3 @@ -15622,7 +15582,7 @@ HIDDEN _sk_colorburn_avx .globl _sk_colorburn_avx FUNCTION(_sk_colorburn_avx) _sk_colorburn_avx: - .byte 196,98,125,24,5,134,95,0,0 // vbroadcastss 0x5f86(%rip),%ymm8 # 6638 <_sk_callback_avx+0x17c> + .byte 196,98,125,24,5,210,94,0,0 // vbroadcastss 0x5ed2(%rip),%ymm8 # 658c <_sk_callback_avx+0x190> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11 .byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10 @@ -15684,7 +15644,7 @@ HIDDEN _sk_colordodge_avx FUNCTION(_sk_colordodge_avx) _sk_colordodge_avx: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 - .byte 196,98,125,24,13,130,94,0,0 // vbroadcastss 0x5e82(%rip),%ymm9 # 663c <_sk_callback_avx+0x180> + .byte 196,98,125,24,13,206,93,0,0 // vbroadcastss 0x5dce(%rip),%ymm9 # 6590 <_sk_callback_avx+0x194> .byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10 .byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11 .byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9 @@ -15741,7 +15701,7 @@ HIDDEN _sk_hardlight_avx .globl _sk_hardlight_avx FUNCTION(_sk_hardlight_avx) _sk_hardlight_avx: - .byte 196,98,125,24,5,148,93,0,0 // vbroadcastss 0x5d94(%rip),%ymm8 # 6640 <_sk_callback_avx+0x184> + .byte 196,98,125,24,5,224,92,0,0 // vbroadcastss 0x5ce0(%rip),%ymm8 # 6594 <_sk_callback_avx+0x198> .byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10 .byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -15796,7 +15756,7 @@ HIDDEN _sk_overlay_avx .globl _sk_overlay_avx FUNCTION(_sk_overlay_avx) _sk_overlay_avx: - .byte 196,98,125,24,5,189,92,0,0 // vbroadcastss 0x5cbd(%rip),%ymm8 # 6644 <_sk_callback_avx+0x188> + .byte 196,98,125,24,5,9,92,0,0 // vbroadcastss 0x5c09(%rip),%ymm8 # 6598 <_sk_callback_avx+0x19c> .byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10 .byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -15862,10 +15822,10 @@ _sk_softlight_avx: .byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8 .byte 196,65,60,89,216 // vmulps %ymm8,%ymm8,%ymm11 .byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8 - .byte 196,98,125,24,29,180,91,0,0 // vbroadcastss 0x5bb4(%rip),%ymm11 # 664c <_sk_callback_avx+0x190> + .byte 196,98,125,24,29,0,91,0,0 // vbroadcastss 0x5b00(%rip),%ymm11 # 65a0 <_sk_callback_avx+0x1a4> .byte 196,65,28,88,235 // vaddps %ymm11,%ymm12,%ymm13 .byte 196,65,20,89,192 // vmulps %ymm8,%ymm13,%ymm8 - .byte 196,98,125,24,45,165,91,0,0 // vbroadcastss 0x5ba5(%rip),%ymm13 # 6650 <_sk_callback_avx+0x194> + .byte 196,98,125,24,45,241,90,0,0 // vbroadcastss 0x5af1(%rip),%ymm13 # 65a4 <_sk_callback_avx+0x1a8> .byte 196,65,28,89,245 // vmulps %ymm13,%ymm12,%ymm14 .byte 196,65,12,88,192 // vaddps %ymm8,%ymm14,%ymm8 .byte 196,65,124,82,244 // vrsqrtps %ymm12,%ymm14 @@ -15876,7 +15836,7 @@ _sk_softlight_avx: .byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15 .byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14 .byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15 - .byte 196,98,125,24,5,99,91,0,0 // vbroadcastss 0x5b63(%rip),%ymm8 # 6648 <_sk_callback_avx+0x18c> + .byte 196,98,125,24,5,175,90,0,0 // vbroadcastss 0x5aaf(%rip),%ymm8 # 659c <_sk_callback_avx+0x1a0> .byte 196,65,60,92,228 // vsubps %ymm12,%ymm8,%ymm12 .byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0 .byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12 @@ -16003,12 +15963,12 @@ _sk_hue_avx: .byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11 .byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11 .byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12 - .byte 196,98,125,24,53,50,89,0,0 // vbroadcastss 0x5932(%rip),%ymm14 # 6654 <_sk_callback_avx+0x198> + .byte 196,98,125,24,53,126,88,0,0 // vbroadcastss 0x587e(%rip),%ymm14 # 65a8 <_sk_callback_avx+0x1ac> .byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11 - .byte 196,98,125,24,61,40,89,0,0 // vbroadcastss 0x5928(%rip),%ymm15 # 6658 <_sk_callback_avx+0x19c> + .byte 196,98,125,24,61,116,88,0,0 // vbroadcastss 0x5874(%rip),%ymm15 # 65ac <_sk_callback_avx+0x1b0> .byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13 .byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11 - .byte 196,226,125,24,5,25,89,0,0 // vbroadcastss 0x5919(%rip),%ymm0 # 665c <_sk_callback_avx+0x1a0> + .byte 196,226,125,24,5,101,88,0,0 // vbroadcastss 0x5865(%rip),%ymm0 # 65b0 <_sk_callback_avx+0x1b4> .byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13 .byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11 .byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13 @@ -16069,7 +16029,7 @@ _sk_hue_avx: .byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10 .byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2 .byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,242,87,0,0 // vbroadcastss 0x57f2(%rip),%ymm8 # 6660 <_sk_callback_avx+0x1a4> + .byte 196,98,125,24,5,62,87,0,0 // vbroadcastss 0x573e(%rip),%ymm8 # 65b4 <_sk_callback_avx+0x1b8> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -16126,12 +16086,12 @@ _sk_saturation_avx: .byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11 .byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11 .byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12 - .byte 196,98,125,24,53,0,87,0,0 // vbroadcastss 0x5700(%rip),%ymm14 # 6664 <_sk_callback_avx+0x1a8> + .byte 196,98,125,24,53,76,86,0,0 // vbroadcastss 0x564c(%rip),%ymm14 # 65b8 <_sk_callback_avx+0x1bc> .byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11 - .byte 196,98,125,24,61,246,86,0,0 // vbroadcastss 0x56f6(%rip),%ymm15 # 6668 <_sk_callback_avx+0x1ac> + .byte 196,98,125,24,61,66,86,0,0 // vbroadcastss 0x5642(%rip),%ymm15 # 65bc <_sk_callback_avx+0x1c0> .byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13 .byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11 - .byte 196,226,125,24,5,231,86,0,0 // vbroadcastss 0x56e7(%rip),%ymm0 # 666c <_sk_callback_avx+0x1b0> + .byte 196,226,125,24,5,51,86,0,0 // vbroadcastss 0x5633(%rip),%ymm0 # 65c0 <_sk_callback_avx+0x1c4> .byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13 .byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11 .byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13 @@ -16192,7 +16152,7 @@ _sk_saturation_avx: .byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10 .byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2 .byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,192,85,0,0 // vbroadcastss 0x55c0(%rip),%ymm8 # 6670 <_sk_callback_avx+0x1b4> + .byte 196,98,125,24,5,12,85,0,0 // vbroadcastss 0x550c(%rip),%ymm8 # 65c4 <_sk_callback_avx+0x1c8> .byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9 .byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1 .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 @@ -16221,12 +16181,12 @@ _sk_color_avx: .byte 197,252,17,68,36,168 // vmovups %ymm0,-0x58(%rsp) .byte 197,124,89,199 // vmulps %ymm7,%ymm0,%ymm8 .byte 197,116,89,207 // vmulps %ymm7,%ymm1,%ymm9 - .byte 196,98,125,24,45,86,85,0,0 // vbroadcastss 0x5556(%rip),%ymm13 # 6674 <_sk_callback_avx+0x1b8> + .byte 196,98,125,24,45,162,84,0,0 // vbroadcastss 0x54a2(%rip),%ymm13 # 65c8 <_sk_callback_avx+0x1cc> .byte 196,65,92,89,213 // vmulps %ymm13,%ymm4,%ymm10 - .byte 196,98,125,24,53,76,85,0,0 // vbroadcastss 0x554c(%rip),%ymm14 # 6678 <_sk_callback_avx+0x1bc> + .byte 196,98,125,24,53,152,84,0,0 // vbroadcastss 0x5498(%rip),%ymm14 # 65cc <_sk_callback_avx+0x1d0> .byte 196,65,84,89,222 // vmulps %ymm14,%ymm5,%ymm11 .byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10 - .byte 196,98,125,24,61,61,85,0,0 // vbroadcastss 0x553d(%rip),%ymm15 # 667c <_sk_callback_avx+0x1c0> + .byte 196,98,125,24,61,137,84,0,0 // vbroadcastss 0x5489(%rip),%ymm15 # 65d0 <_sk_callback_avx+0x1d4> .byte 196,65,76,89,223 // vmulps %ymm15,%ymm6,%ymm11 .byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0 .byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11 @@ -16289,7 +16249,7 @@ _sk_color_avx: .byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9 .byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0 .byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8 - .byte 196,226,125,24,5,4,84,0,0 // vbroadcastss 0x5404(%rip),%ymm0 # 6680 <_sk_callback_avx+0x1c4> + .byte 196,226,125,24,5,80,83,0,0 // vbroadcastss 0x5350(%rip),%ymm0 # 65d4 <_sk_callback_avx+0x1d8> .byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10 .byte 197,172,89,84,36,168 // vmulps -0x58(%rsp),%ymm10,%ymm2 .byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11 @@ -16319,12 +16279,12 @@ _sk_luminosity_avx: .byte 197,252,40,208 // vmovaps %ymm0,%ymm2 .byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8 .byte 197,100,89,205 // vmulps %ymm5,%ymm3,%ymm9 - .byte 196,98,125,24,45,150,83,0,0 // vbroadcastss 0x5396(%rip),%ymm13 # 6684 <_sk_callback_avx+0x1c8> + .byte 196,98,125,24,45,226,82,0,0 // vbroadcastss 0x52e2(%rip),%ymm13 # 65d8 <_sk_callback_avx+0x1dc> .byte 196,65,108,89,213 // vmulps %ymm13,%ymm2,%ymm10 - .byte 196,98,125,24,53,140,83,0,0 // vbroadcastss 0x538c(%rip),%ymm14 # 6688 <_sk_callback_avx+0x1cc> + .byte 196,98,125,24,53,216,82,0,0 // vbroadcastss 0x52d8(%rip),%ymm14 # 65dc <_sk_callback_avx+0x1e0> .byte 196,65,116,89,222 // vmulps %ymm14,%ymm1,%ymm11 .byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10 - .byte 196,98,125,24,61,125,83,0,0 // vbroadcastss 0x537d(%rip),%ymm15 # 668c <_sk_callback_avx+0x1d0> + .byte 196,98,125,24,61,201,82,0,0 // vbroadcastss 0x52c9(%rip),%ymm15 # 65e0 <_sk_callback_avx+0x1e4> .byte 196,65,28,89,223 // vmulps %ymm15,%ymm12,%ymm11 .byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0 .byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11 @@ -16387,7 +16347,7 @@ _sk_luminosity_avx: .byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9 .byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0 .byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8 - .byte 196,226,125,24,5,68,82,0,0 // vbroadcastss 0x5244(%rip),%ymm0 # 6690 <_sk_callback_avx+0x1d4> + .byte 196,226,125,24,5,144,81,0,0 // vbroadcastss 0x5190(%rip),%ymm0 # 65e4 <_sk_callback_avx+0x1e8> .byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11 @@ -16416,9 +16376,9 @@ _sk_srcover_rgba_8888_avx: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,43,1,0,0 // jne 15db <_sk_srcover_rgba_8888_avx+0x144> + .byte 15,133,43,1,0,0 // jne 15e3 <_sk_srcover_rgba_8888_avx+0x144> .byte 196,193,124,16,58 // vmovups (%r10),%ymm7 - .byte 197,124,40,13,3,86,0,0 // vmovaps 0x5603(%rip),%ymm9 # 6ac0 <_sk_callback_avx+0x604> + .byte 197,124,40,13,91,85,0,0 // vmovaps 0x555b(%rip),%ymm9 # 6a20 <_sk_callback_avx+0x624> .byte 196,193,68,84,225 // vandps %ymm9,%ymm7,%ymm4 .byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4 .byte 197,209,114,215,8 // vpsrld $0x8,%xmm7,%xmm5 @@ -16436,9 +16396,9 @@ _sk_srcover_rgba_8888_avx: .byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7 .byte 196,227,53,24,255,1 // vinsertf128 $0x1,%xmm7,%ymm9,%ymm7 .byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7 - .byte 196,98,125,24,5,118,81,0,0 // vbroadcastss 0x5176(%rip),%ymm8 # 6694 <_sk_callback_avx+0x1d8> + .byte 196,98,125,24,5,194,80,0,0 // vbroadcastss 0x50c2(%rip),%ymm8 # 65e8 <_sk_callback_avx+0x1ec> .byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8 - .byte 196,98,125,24,13,109,81,0,0 // vbroadcastss 0x516d(%rip),%ymm9 # 6698 <_sk_callback_avx+0x1dc> + .byte 196,98,125,24,13,185,80,0,0 // vbroadcastss 0x50b9(%rip),%ymm9 # 65ec <_sk_callback_avx+0x1f0> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 197,60,89,212 // vmulps %ymm4,%ymm8,%ymm10 .byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0 @@ -16471,7 +16431,7 @@ _sk_srcover_rgba_8888_avx: .byte 196,65,53,86,202 // vorpd %ymm10,%ymm9,%ymm9 .byte 196,65,61,86,193 // vorpd %ymm9,%ymm8,%ymm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,87 // jne 1626 <_sk_srcover_rgba_8888_avx+0x18f> + .byte 117,87 // jne 162e <_sk_srcover_rgba_8888_avx+0x18f> .byte 196,65,124,17,2 // vmovups %ymm8,(%r10) .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -16483,13 +16443,13 @@ _sk_srcover_rgba_8888_avx: .byte 72,211,232 // shr %cl,%rax .byte 196,225,249,110,224 // vmovq %rax,%xmm4 .byte 196,226,121,48,228 // vpmovzxbw %xmm4,%xmm4 - .byte 196,226,89,0,45,29,84,0,0 // vpshufb 0x541d(%rip),%xmm4,%xmm5 # 6a20 <_sk_callback_avx+0x564> + .byte 196,226,89,0,45,101,83,0,0 // vpshufb 0x5365(%rip),%xmm4,%xmm5 # 6970 <_sk_callback_avx+0x574> .byte 196,226,121,33,237 // vpmovsxbd %xmm5,%xmm5 - .byte 196,226,89,0,37,31,84,0,0 // vpshufb 0x541f(%rip),%xmm4,%xmm4 # 6a30 <_sk_callback_avx+0x574> + .byte 196,226,89,0,37,103,83,0,0 // vpshufb 0x5367(%rip),%xmm4,%xmm4 # 6980 <_sk_callback_avx+0x584> .byte 196,226,121,33,228 // vpmovsxbd %xmm4,%xmm4 .byte 196,227,85,24,228,1 // vinsertf128 $0x1,%xmm4,%ymm5,%ymm4 .byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7 - .byte 233,143,254,255,255 // jmpq 14b5 <_sk_srcover_rgba_8888_avx+0x1e> + .byte 233,143,254,255,255 // jmpq 14bd <_sk_srcover_rgba_8888_avx+0x1e> .byte 185,8,0,0,0 // mov $0x8,%ecx .byte 68,41,193 // sub %r8d,%ecx .byte 192,225,3 // shl $0x3,%cl @@ -16497,13 +16457,13 @@ _sk_srcover_rgba_8888_avx: .byte 72,211,232 // shr %cl,%rax .byte 196,97,249,110,200 // vmovq %rax,%xmm9 .byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9 - .byte 196,98,49,0,21,210,83,0,0 // vpshufb 0x53d2(%rip),%xmm9,%xmm10 # 6a20 <_sk_callback_avx+0x564> + .byte 196,98,49,0,21,26,83,0,0 // vpshufb 0x531a(%rip),%xmm9,%xmm10 # 6970 <_sk_callback_avx+0x574> .byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10 - .byte 196,98,49,0,13,212,83,0,0 // vpshufb 0x53d4(%rip),%xmm9,%xmm9 # 6a30 <_sk_callback_avx+0x574> + .byte 196,98,49,0,13,28,83,0,0 // vpshufb 0x531c(%rip),%xmm9,%xmm9 # 6980 <_sk_callback_avx+0x584> .byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9 .byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10) - .byte 233,99,255,255,255 // jmpq 15d4 <_sk_srcover_rgba_8888_avx+0x13d> + .byte 233,99,255,255,255 // jmpq 15dc <_sk_srcover_rgba_8888_avx+0x13d> HIDDEN _sk_clamp_0_avx .globl _sk_clamp_0_avx @@ -16521,7 +16481,7 @@ HIDDEN _sk_clamp_1_avx .globl _sk_clamp_1_avx FUNCTION(_sk_clamp_1_avx) _sk_clamp_1_avx: - .byte 196,98,125,24,5,5,80,0,0 // vbroadcastss 0x5005(%rip),%ymm8 # 669c <_sk_callback_avx+0x1e0> + .byte 196,98,125,24,5,81,79,0,0 // vbroadcastss 0x4f51(%rip),%ymm8 # 65f0 <_sk_callback_avx+0x1f4> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1 .byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2 @@ -16533,7 +16493,7 @@ HIDDEN _sk_clamp_a_avx .globl _sk_clamp_a_avx FUNCTION(_sk_clamp_a_avx) _sk_clamp_a_avx: - .byte 196,98,125,24,5,232,79,0,0 // vbroadcastss 0x4fe8(%rip),%ymm8 # 66a0 <_sk_callback_avx+0x1e4> + .byte 196,98,125,24,5,52,79,0,0 // vbroadcastss 0x4f34(%rip),%ymm8 # 65f4 <_sk_callback_avx+0x1f8> .byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3 .byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0 .byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1 @@ -16619,7 +16579,7 @@ FUNCTION(_sk_unpremul_avx) _sk_unpremul_avx: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9 - .byte 196,98,125,24,21,48,79,0,0 // vbroadcastss 0x4f30(%rip),%ymm10 # 66a4 <_sk_callback_avx+0x1e8> + .byte 196,98,125,24,21,124,78,0,0 // vbroadcastss 0x4e7c(%rip),%ymm10 # 65f8 <_sk_callback_avx+0x1fc> .byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10 .byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 @@ -16632,17 +16592,17 @@ HIDDEN _sk_from_srgb_avx .globl _sk_from_srgb_avx FUNCTION(_sk_from_srgb_avx) _sk_from_srgb_avx: - .byte 196,98,125,24,5,17,79,0,0 // vbroadcastss 0x4f11(%rip),%ymm8 # 66a8 <_sk_callback_avx+0x1ec> + .byte 196,98,125,24,5,93,78,0,0 // vbroadcastss 0x4e5d(%rip),%ymm8 # 65fc <_sk_callback_avx+0x200> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10 - .byte 196,98,125,24,29,3,79,0,0 // vbroadcastss 0x4f03(%rip),%ymm11 # 66ac <_sk_callback_avx+0x1f0> + .byte 196,98,125,24,29,79,78,0,0 // vbroadcastss 0x4e4f(%rip),%ymm11 # 6600 <_sk_callback_avx+0x204> .byte 196,65,124,89,227 // vmulps %ymm11,%ymm0,%ymm12 - .byte 196,98,125,24,45,249,78,0,0 // vbroadcastss 0x4ef9(%rip),%ymm13 # 66b0 <_sk_callback_avx+0x1f4> + .byte 196,98,125,24,45,69,78,0,0 // vbroadcastss 0x4e45(%rip),%ymm13 # 6604 <_sk_callback_avx+0x208> .byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12 .byte 196,65,44,89,212 // vmulps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,37,234,78,0,0 // vbroadcastss 0x4eea(%rip),%ymm12 # 66b4 <_sk_callback_avx+0x1f8> + .byte 196,98,125,24,37,54,78,0,0 // vbroadcastss 0x4e36(%rip),%ymm12 # 6608 <_sk_callback_avx+0x20c> .byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10 - .byte 196,98,125,24,53,224,78,0,0 // vbroadcastss 0x4ee0(%rip),%ymm14 # 66b8 <_sk_callback_avx+0x1fc> + .byte 196,98,125,24,53,44,78,0,0 // vbroadcastss 0x4e2c(%rip),%ymm14 # 660c <_sk_callback_avx+0x210> .byte 196,193,124,194,198,1 // vcmpltps %ymm14,%ymm0,%ymm0 .byte 196,195,45,74,193,0 // vblendvps %ymm0,%ymm9,%ymm10,%ymm0 .byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9 @@ -16669,20 +16629,20 @@ HIDDEN _sk_to_srgb_avx FUNCTION(_sk_to_srgb_avx) _sk_to_srgb_avx: .byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9 - .byte 196,98,125,24,5,117,78,0,0 // vbroadcastss 0x4e75(%rip),%ymm8 # 66bc <_sk_callback_avx+0x200> + .byte 196,98,125,24,5,193,77,0,0 // vbroadcastss 0x4dc1(%rip),%ymm8 # 6610 <_sk_callback_avx+0x214> .byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10 - .byte 196,98,125,24,29,107,78,0,0 // vbroadcastss 0x4e6b(%rip),%ymm11 # 66c0 <_sk_callback_avx+0x204> + .byte 196,98,125,24,29,183,77,0,0 // vbroadcastss 0x4db7(%rip),%ymm11 # 6614 <_sk_callback_avx+0x218> .byte 196,65,52,89,227 // vmulps %ymm11,%ymm9,%ymm12 - .byte 196,98,125,24,45,97,78,0,0 // vbroadcastss 0x4e61(%rip),%ymm13 # 66c4 <_sk_callback_avx+0x208> + .byte 196,98,125,24,45,173,77,0,0 // vbroadcastss 0x4dad(%rip),%ymm13 # 6618 <_sk_callback_avx+0x21c> .byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12 .byte 196,65,52,89,228 // vmulps %ymm12,%ymm9,%ymm12 - .byte 196,98,125,24,53,82,78,0,0 // vbroadcastss 0x4e52(%rip),%ymm14 # 66c8 <_sk_callback_avx+0x20c> + .byte 196,98,125,24,53,158,77,0,0 // vbroadcastss 0x4d9e(%rip),%ymm14 # 661c <_sk_callback_avx+0x220> .byte 196,65,28,88,230 // vaddps %ymm14,%ymm12,%ymm12 - .byte 196,98,125,24,61,72,78,0,0 // vbroadcastss 0x4e48(%rip),%ymm15 # 66cc <_sk_callback_avx+0x210> + .byte 196,98,125,24,61,148,77,0,0 // vbroadcastss 0x4d94(%rip),%ymm15 # 6620 <_sk_callback_avx+0x224> .byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9 .byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9 .byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9 - .byte 196,98,125,24,37,52,78,0,0 // vbroadcastss 0x4e34(%rip),%ymm12 # 66d0 <_sk_callback_avx+0x214> + .byte 196,98,125,24,37,128,77,0,0 // vbroadcastss 0x4d80(%rip),%ymm12 # 6624 <_sk_callback_avx+0x228> .byte 196,193,124,194,196,1 // vcmpltps %ymm12,%ymm0,%ymm0 .byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0 .byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9 @@ -16719,7 +16679,7 @@ _sk_rgb_to_hsl_avx: .byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9 .byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9 .byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10 - .byte 196,98,125,24,29,154,77,0,0 // vbroadcastss 0x4d9a(%rip),%ymm11 # 66d4 <_sk_callback_avx+0x218> + .byte 196,98,125,24,29,230,76,0,0 // vbroadcastss 0x4ce6(%rip),%ymm11 # 6628 <_sk_callback_avx+0x22c> .byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11 .byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12 .byte 196,65,28,89,227 // vmulps %ymm11,%ymm12,%ymm12 @@ -16729,19 +16689,19 @@ _sk_rgb_to_hsl_avx: .byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2 .byte 197,252,92,201 // vsubps %ymm1,%ymm0,%ymm1 .byte 196,193,116,89,203 // vmulps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,29,115,77,0,0 // vbroadcastss 0x4d73(%rip),%ymm11 # 66e0 <_sk_callback_avx+0x224> + .byte 196,98,125,24,29,191,76,0,0 // vbroadcastss 0x4cbf(%rip),%ymm11 # 6634 <_sk_callback_avx+0x238> .byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,29,97,77,0,0 // vbroadcastss 0x4d61(%rip),%ymm11 # 66dc <_sk_callback_avx+0x220> + .byte 196,98,125,24,29,173,76,0,0 // vbroadcastss 0x4cad(%rip),%ymm11 # 6630 <_sk_callback_avx+0x234> .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 .byte 196,227,117,74,202,224 // vblendvps %ymm14,%ymm2,%ymm1,%ymm1 - .byte 196,226,125,24,21,73,77,0,0 // vbroadcastss 0x4d49(%rip),%ymm2 # 66d8 <_sk_callback_avx+0x21c> + .byte 196,226,125,24,21,149,76,0,0 // vbroadcastss 0x4c95(%rip),%ymm2 # 662c <_sk_callback_avx+0x230> .byte 196,65,12,87,246 // vxorps %ymm14,%ymm14,%ymm14 .byte 196,227,13,74,210,208 // vblendvps %ymm13,%ymm2,%ymm14,%ymm2 .byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0 .byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2 .byte 196,227,117,74,194,0 // vblendvps %ymm0,%ymm2,%ymm1,%ymm0 .byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1 - .byte 196,98,125,24,37,48,77,0,0 // vbroadcastss 0x4d30(%rip),%ymm12 # 66e8 <_sk_callback_avx+0x22c> + .byte 196,98,125,24,37,124,76,0,0 // vbroadcastss 0x4c7c(%rip),%ymm12 # 663c <_sk_callback_avx+0x240> .byte 196,193,116,89,212 // vmulps %ymm12,%ymm1,%ymm2 .byte 197,28,194,226,1 // vcmpltps %ymm2,%ymm12,%ymm12 .byte 196,65,36,92,216 // vsubps %ymm8,%ymm11,%ymm11 @@ -16751,7 +16711,7 @@ _sk_rgb_to_hsl_avx: .byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1 .byte 196,195,125,74,198,128 // vblendvps %ymm8,%ymm14,%ymm0,%ymm0 .byte 196,195,117,74,206,128 // vblendvps %ymm8,%ymm14,%ymm1,%ymm1 - .byte 196,98,125,24,5,243,76,0,0 // vbroadcastss 0x4cf3(%rip),%ymm8 # 66e4 <_sk_callback_avx+0x228> + .byte 196,98,125,24,5,63,76,0,0 // vbroadcastss 0x4c3f(%rip),%ymm8 # 6638 <_sk_callback_avx+0x23c> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -16768,7 +16728,7 @@ _sk_hsl_to_rgb_avx: .byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp) .byte 197,252,40,225 // vmovaps %ymm1,%ymm4 .byte 197,252,40,216 // vmovaps %ymm0,%ymm3 - .byte 196,98,125,24,5,192,76,0,0 // vbroadcastss 0x4cc0(%rip),%ymm8 # 66ec <_sk_callback_avx+0x230> + .byte 196,98,125,24,5,12,76,0,0 // vbroadcastss 0x4c0c(%rip),%ymm8 # 6640 <_sk_callback_avx+0x244> .byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9 .byte 197,92,89,210 // vmulps %ymm2,%ymm4,%ymm10 .byte 196,65,92,92,218 // vsubps %ymm10,%ymm4,%ymm11 @@ -16776,23 +16736,23 @@ _sk_hsl_to_rgb_avx: .byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10 .byte 197,108,88,202 // vaddps %ymm2,%ymm2,%ymm9 .byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9 - .byte 196,98,125,24,29,154,76,0,0 // vbroadcastss 0x4c9a(%rip),%ymm11 # 66f0 <_sk_callback_avx+0x234> + .byte 196,98,125,24,29,230,75,0,0 // vbroadcastss 0x4be6(%rip),%ymm11 # 6644 <_sk_callback_avx+0x248> .byte 196,65,100,88,219 // vaddps %ymm11,%ymm3,%ymm11 .byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12 .byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15 .byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11 - .byte 196,98,125,24,37,132,76,0,0 // vbroadcastss 0x4c84(%rip),%ymm12 # 66f8 <_sk_callback_avx+0x23c> + .byte 196,98,125,24,37,208,75,0,0 // vbroadcastss 0x4bd0(%rip),%ymm12 # 664c <_sk_callback_avx+0x250> .byte 196,193,4,89,196 // vmulps %ymm12,%ymm15,%ymm0 - .byte 196,98,125,24,45,122,76,0,0 // vbroadcastss 0x4c7a(%rip),%ymm13 # 66fc <_sk_callback_avx+0x240> + .byte 196,98,125,24,45,198,75,0,0 // vbroadcastss 0x4bc6(%rip),%ymm13 # 6650 <_sk_callback_avx+0x254> .byte 197,20,92,240 // vsubps %ymm0,%ymm13,%ymm14 .byte 196,65,36,89,246 // vmulps %ymm14,%ymm11,%ymm14 .byte 196,65,52,88,246 // vaddps %ymm14,%ymm9,%ymm14 - .byte 196,226,125,24,13,91,76,0,0 // vbroadcastss 0x4c5b(%rip),%ymm1 # 66f4 <_sk_callback_avx+0x238> + .byte 196,226,125,24,13,167,75,0,0 // vbroadcastss 0x4ba7(%rip),%ymm1 # 6648 <_sk_callback_avx+0x24c> .byte 196,193,116,194,255,2 // vcmpleps %ymm15,%ymm1,%ymm7 .byte 196,195,13,74,249,112 // vblendvps %ymm7,%ymm9,%ymm14,%ymm7 .byte 196,65,60,194,247,2 // vcmpleps %ymm15,%ymm8,%ymm14 .byte 196,227,45,74,255,224 // vblendvps %ymm14,%ymm7,%ymm10,%ymm7 - .byte 196,98,125,24,53,70,76,0,0 // vbroadcastss 0x4c46(%rip),%ymm14 # 6700 <_sk_callback_avx+0x244> + .byte 196,98,125,24,53,146,75,0,0 // vbroadcastss 0x4b92(%rip),%ymm14 # 6654 <_sk_callback_avx+0x258> .byte 196,65,12,194,255,2 // vcmpleps %ymm15,%ymm14,%ymm15 .byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0 .byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0 @@ -16811,7 +16771,7 @@ _sk_hsl_to_rgb_avx: .byte 197,164,89,247 // vmulps %ymm7,%ymm11,%ymm6 .byte 197,180,88,246 // vaddps %ymm6,%ymm9,%ymm6 .byte 196,227,77,74,237,0 // vblendvps %ymm0,%ymm5,%ymm6,%ymm5 - .byte 196,226,125,24,5,232,75,0,0 // vbroadcastss 0x4be8(%rip),%ymm0 # 6704 <_sk_callback_avx+0x248> + .byte 196,226,125,24,5,52,75,0,0 // vbroadcastss 0x4b34(%rip),%ymm0 # 6658 <_sk_callback_avx+0x25c> .byte 197,228,88,192 // vaddps %ymm0,%ymm3,%ymm0 .byte 196,227,125,8,216,1 // vroundps $0x1,%ymm0,%ymm3 .byte 197,252,92,195 // vsubps %ymm3,%ymm0,%ymm0 @@ -16863,14 +16823,14 @@ _sk_scale_u8_avx: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,68 // jne 1c13 <_sk_scale_u8_avx+0x54> + .byte 117,68 // jne 1c1b <_sk_scale_u8_avx+0x54> .byte 197,122,126,0 // vmovq (%rax),%xmm8 .byte 196,66,121,49,200 // vpmovzxbd %xmm8,%xmm9 .byte 196,67,121,4,192,229 // vpermilps $0xe5,%xmm8,%xmm8 .byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8 .byte 196,67,53,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm9,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,17,75,0,0 // vbroadcastss 0x4b11(%rip),%ymm9 # 6708 <_sk_callback_avx+0x24c> + .byte 196,98,125,24,13,93,74,0,0 // vbroadcastss 0x4a5d(%rip),%ymm9 # 665c <_sk_callback_avx+0x260> .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 @@ -16889,10 +16849,10 @@ _sk_scale_u8_avx: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 1c1c <_sk_scale_u8_avx+0x5d> + .byte 117,235 // jne 1c24 <_sk_scale_u8_avx+0x5d> .byte 196,65,249,110,194 // vmovq %r10,%xmm8 .byte 91 // pop %rbx - .byte 235,154 // jmp 1bd3 <_sk_scale_u8_avx+0x14> + .byte 235,154 // jmp 1bdb <_sk_scale_u8_avx+0x14> HIDDEN _sk_lerp_1_float_avx .globl _sk_lerp_1_float_avx @@ -16924,14 +16884,14 @@ _sk_lerp_u8_avx: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,104 // jne 1cf0 <_sk_lerp_u8_avx+0x78> + .byte 117,104 // jne 1cf8 <_sk_lerp_u8_avx+0x78> .byte 197,122,126,0 // vmovq (%rax),%xmm8 .byte 196,66,121,49,200 // vpmovzxbd %xmm8,%xmm9 .byte 196,67,121,4,192,229 // vpermilps $0xe5,%xmm8,%xmm8 .byte 196,66,121,49,192 // vpmovzxbd %xmm8,%xmm8 .byte 196,67,53,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm9,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,13,92,74,0,0 // vbroadcastss 0x4a5c(%rip),%ymm9 # 670c <_sk_callback_avx+0x250> + .byte 196,98,125,24,13,168,73,0,0 // vbroadcastss 0x49a8(%rip),%ymm9 # 6660 <_sk_callback_avx+0x264> .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 .byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0 .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 @@ -16958,10 +16918,10 @@ _sk_lerp_u8_avx: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 1cf9 <_sk_lerp_u8_avx+0x81> + .byte 117,235 // jne 1d01 <_sk_lerp_u8_avx+0x81> .byte 196,65,249,110,194 // vmovq %r10,%xmm8 .byte 91 // pop %rbx - .byte 233,115,255,255,255 // jmpq 1c8c <_sk_lerp_u8_avx+0x14> + .byte 233,115,255,255,255 // jmpq 1c94 <_sk_lerp_u8_avx+0x14> HIDDEN _sk_lerp_565_avx .globl _sk_lerp_565_avx @@ -16970,26 +16930,26 @@ _sk_lerp_565_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,208,0,0,0 // jne 1df7 <_sk_lerp_565_avx+0xde> + .byte 15,133,208,0,0,0 // jne 1dff <_sk_lerp_565_avx+0xde> .byte 196,65,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 196,65,57,105,201 // vpunpckhwd %xmm9,%xmm8,%xmm9 .byte 196,66,121,51,192 // vpmovzxwd %xmm8,%xmm8 .byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8 - .byte 196,98,125,24,13,197,73,0,0 // vbroadcastss 0x49c5(%rip),%ymm9 # 6710 <_sk_callback_avx+0x254> + .byte 196,98,125,24,13,17,73,0,0 // vbroadcastss 0x4911(%rip),%ymm9 # 6664 <_sk_callback_avx+0x268> .byte 196,65,60,84,201 // vandps %ymm9,%ymm8,%ymm9 .byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9 - .byte 196,98,125,24,21,182,73,0,0 // vbroadcastss 0x49b6(%rip),%ymm10 # 6714 <_sk_callback_avx+0x258> + .byte 196,98,125,24,21,2,73,0,0 // vbroadcastss 0x4902(%rip),%ymm10 # 6668 <_sk_callback_avx+0x26c> .byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9 - .byte 196,98,125,24,21,172,73,0,0 // vbroadcastss 0x49ac(%rip),%ymm10 # 6718 <_sk_callback_avx+0x25c> + .byte 196,98,125,24,21,248,72,0,0 // vbroadcastss 0x48f8(%rip),%ymm10 # 666c <_sk_callback_avx+0x270> .byte 196,65,60,84,210 // vandps %ymm10,%ymm8,%ymm10 .byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10 - .byte 196,98,125,24,29,157,73,0,0 // vbroadcastss 0x499d(%rip),%ymm11 # 671c <_sk_callback_avx+0x260> + .byte 196,98,125,24,29,233,72,0,0 // vbroadcastss 0x48e9(%rip),%ymm11 # 6670 <_sk_callback_avx+0x274> .byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10 - .byte 196,98,125,24,29,147,73,0,0 // vbroadcastss 0x4993(%rip),%ymm11 # 6720 <_sk_callback_avx+0x264> + .byte 196,98,125,24,29,223,72,0,0 // vbroadcastss 0x48df(%rip),%ymm11 # 6674 <_sk_callback_avx+0x278> .byte 196,65,60,84,195 // vandps %ymm11,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 - .byte 196,98,125,24,29,132,73,0,0 // vbroadcastss 0x4984(%rip),%ymm11 # 6724 <_sk_callback_avx+0x268> + .byte 196,98,125,24,29,208,72,0,0 // vbroadcastss 0x48d0(%rip),%ymm11 # 6678 <_sk_callback_avx+0x27c> .byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8 .byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0 .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 @@ -17016,9 +16976,9 @@ _sk_lerp_565_avx: .byte 196,65,57,239,192 // vpxor %xmm8,%xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,29,255,255,255 // ja 1d2d <_sk_lerp_565_avx+0x14> + .byte 15,135,29,255,255,255 // ja 1d35 <_sk_lerp_565_avx+0x14> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,77,0,0,0 // lea 0x4d(%rip),%r10 # 1e68 <_sk_lerp_565_avx+0x14f> + .byte 76,141,21,77,0,0,0 // lea 0x4d(%rip),%r10 # 1e70 <_sk_lerp_565_avx+0x14f> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -17030,13 +16990,13 @@ _sk_lerp_565_avx: .byte 196,65,57,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8 .byte 196,65,57,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8 .byte 196,65,57,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8 - .byte 233,200,254,255,255 // jmpq 1d2d <_sk_lerp_565_avx+0x14> + .byte 233,200,254,255,255 // jmpq 1d35 <_sk_lerp_565_avx+0x14> .byte 15,31,0 // nopl (%rax) .byte 241 // icebp .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 233,255,255,255,225 // jmpq ffffffffe2001e70 <_sk_callback_avx+0xffffffffe1ffb9b4> + .byte 233,255,255,255,225 // jmpq ffffffffe2001e78 <_sk_callback_avx+0xffffffffe1ffba7c> .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) @@ -17065,9 +17025,9 @@ _sk_load_tables_avx: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,248,1,0,0 // jne 209c <_sk_load_tables_avx+0x218> + .byte 15,133,248,1,0,0 // jne 20a4 <_sk_load_tables_avx+0x218> .byte 196,65,124,16,18 // vmovups (%r10),%ymm10 - .byte 197,124,40,13,47,76,0,0 // vmovaps 0x4c2f(%rip),%ymm9 # 6ae0 <_sk_callback_avx+0x624> + .byte 197,124,40,13,135,75,0,0 // vmovaps 0x4b87(%rip),%ymm9 # 6a40 <_sk_callback_avx+0x644> .byte 196,193,44,84,201 // vandps %ymm9,%ymm10,%ymm1 .byte 196,227,125,25,200,1 // vextractf128 $0x1,%ymm1,%xmm0 .byte 196,193,249,126,195 // vmovq %xmm0,%r11 @@ -17159,7 +17119,7 @@ _sk_load_tables_avx: .byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7 .byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,226,125,24,61,158,70,0,0 // vbroadcastss 0x469e(%rip),%ymm7 # 6728 <_sk_callback_avx+0x26c> + .byte 196,226,125,24,61,234,69,0,0 // vbroadcastss 0x45ea(%rip),%ymm7 # 667c <_sk_callback_avx+0x280> .byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -17173,13 +17133,13 @@ _sk_load_tables_avx: .byte 73,211,235 // shr %cl,%r11 .byte 196,193,249,110,195 // vmovq %r11,%xmm0 .byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0 - .byte 196,226,121,0,13,124,73,0,0 // vpshufb 0x497c(%rip),%xmm0,%xmm1 # 6a40 <_sk_callback_avx+0x584> + .byte 196,226,121,0,13,196,72,0,0 // vpshufb 0x48c4(%rip),%xmm0,%xmm1 # 6990 <_sk_callback_avx+0x594> .byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1 - .byte 196,226,121,0,5,126,73,0,0 // vpshufb 0x497e(%rip),%xmm0,%xmm0 # 6a50 <_sk_callback_avx+0x594> + .byte 196,226,121,0,5,198,72,0,0 // vpshufb 0x48c6(%rip),%xmm0,%xmm0 # 69a0 <_sk_callback_avx+0x5a4> .byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0 .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 196,66,125,44,18 // vmaskmovps (%r10),%ymm0,%ymm10 - .byte 233,194,253,255,255 // jmpq 1ea9 <_sk_load_tables_avx+0x25> + .byte 233,194,253,255,255 // jmpq 1eb1 <_sk_load_tables_avx+0x25> HIDDEN _sk_load_tables_u16_be_avx .globl _sk_load_tables_u16_be_avx @@ -17190,7 +17150,7 @@ _sk_load_tables_u16_be_avx: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 77,133,192 // test %r8,%r8 .byte 197,252,17,124,36,200 // vmovups %ymm7,-0x38(%rsp) - .byte 15,133,84,2,0,0 // jne 2357 <_sk_load_tables_u16_be_avx+0x270> + .byte 15,133,84,2,0,0 // jne 235f <_sk_load_tables_u16_be_avx+0x270> .byte 196,1,121,16,4,81 // vmovupd (%r9,%r10,2),%xmm8 .byte 196,129,121,16,84,81,16 // vmovupd 0x10(%r9,%r10,2),%xmm2 .byte 196,129,121,16,92,81,32 // vmovupd 0x20(%r9,%r10,2),%xmm3 @@ -17205,7 +17165,7 @@ _sk_load_tables_u16_be_avx: .byte 197,113,105,219 // vpunpckhwd %xmm3,%xmm1,%xmm11 .byte 197,177,108,200 // vpunpcklqdq %xmm0,%xmm9,%xmm1 .byte 197,49,109,224 // vpunpckhqdq %xmm0,%xmm9,%xmm12 - .byte 197,121,111,21,16,73,0,0 // vmovdqa 0x4910(%rip),%xmm10 # 6a60 <_sk_callback_avx+0x5a4> + .byte 197,121,111,21,88,72,0,0 // vmovdqa 0x4858(%rip),%xmm10 # 69b0 <_sk_callback_avx+0x5b4> .byte 196,193,113,219,202 // vpand %xmm10,%xmm1,%xmm1 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 196,193,113,105,209 // vpunpckhwd %xmm9,%xmm1,%xmm2 @@ -17303,7 +17263,7 @@ _sk_load_tables_u16_be_avx: .byte 196,226,121,51,219 // vpmovzxwd %xmm3,%xmm3 .byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,226,125,24,61,227,67,0,0 // vbroadcastss 0x43e3(%rip),%ymm7 # 672c <_sk_callback_avx+0x270> + .byte 196,226,125,24,61,47,67,0,0 // vbroadcastss 0x432f(%rip),%ymm7 # 6680 <_sk_callback_avx+0x284> .byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7 @@ -17311,29 +17271,29 @@ _sk_load_tables_u16_be_avx: .byte 196,1,123,16,4,81 // vmovsd (%r9,%r10,2),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,85 // je 23bd <_sk_load_tables_u16_be_avx+0x2d6> + .byte 116,85 // je 23c5 <_sk_load_tables_u16_be_avx+0x2d6> .byte 196,1,57,22,68,81,8 // vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,72 // jb 23bd <_sk_load_tables_u16_be_avx+0x2d6> + .byte 114,72 // jb 23c5 <_sk_load_tables_u16_be_avx+0x2d6> .byte 196,129,123,16,84,81,16 // vmovsd 0x10(%r9,%r10,2),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,72 // je 23ca <_sk_load_tables_u16_be_avx+0x2e3> + .byte 116,72 // je 23d2 <_sk_load_tables_u16_be_avx+0x2e3> .byte 196,129,105,22,84,81,24 // vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,59 // jb 23ca <_sk_load_tables_u16_be_avx+0x2e3> + .byte 114,59 // jb 23d2 <_sk_load_tables_u16_be_avx+0x2e3> .byte 196,129,123,16,92,81,32 // vmovsd 0x20(%r9,%r10,2),%xmm3 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,126,253,255,255 // je 211e <_sk_load_tables_u16_be_avx+0x37> + .byte 15,132,126,253,255,255 // je 2126 <_sk_load_tables_u16_be_avx+0x37> .byte 196,129,97,22,92,81,40 // vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,109,253,255,255 // jb 211e <_sk_load_tables_u16_be_avx+0x37> + .byte 15,130,109,253,255,255 // jb 2126 <_sk_load_tables_u16_be_avx+0x37> .byte 196,1,122,126,76,81,48 // vmovq 0x30(%r9,%r10,2),%xmm9 - .byte 233,97,253,255,255 // jmpq 211e <_sk_load_tables_u16_be_avx+0x37> + .byte 233,97,253,255,255 // jmpq 2126 <_sk_load_tables_u16_be_avx+0x37> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,84,253,255,255 // jmpq 211e <_sk_load_tables_u16_be_avx+0x37> + .byte 233,84,253,255,255 // jmpq 2126 <_sk_load_tables_u16_be_avx+0x37> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 - .byte 233,75,253,255,255 // jmpq 211e <_sk_load_tables_u16_be_avx+0x37> + .byte 233,75,253,255,255 // jmpq 2126 <_sk_load_tables_u16_be_avx+0x37> HIDDEN _sk_load_tables_rgb_u16_be_avx .globl _sk_load_tables_rgb_u16_be_avx @@ -17345,7 +17305,7 @@ _sk_load_tables_rgb_u16_be_avx: .byte 77,133,192 // test %r8,%r8 .byte 197,252,17,124,36,200 // vmovups %ymm7,-0x38(%rsp) .byte 197,252,17,116,36,168 // vmovups %ymm6,-0x58(%rsp) - .byte 15,133,71,2,0,0 // jne 2638 <_sk_load_tables_rgb_u16_be_avx+0x265> + .byte 15,133,71,2,0,0 // jne 2640 <_sk_load_tables_rgb_u16_be_avx+0x265> .byte 196,129,122,111,4,81 // vmovdqu (%r9,%r10,2),%xmm0 .byte 196,129,122,111,84,81,12 // vmovdqu 0xc(%r9,%r10,2),%xmm2 .byte 196,129,122,111,76,81,24 // vmovdqu 0x18(%r9,%r10,2),%xmm1 @@ -17366,7 +17326,7 @@ _sk_load_tables_rgb_u16_be_avx: .byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3 .byte 197,57,109,218 // vpunpckhqdq %xmm2,%xmm8,%xmm11 .byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8 - .byte 197,121,111,13,21,70,0,0 // vmovdqa 0x4615(%rip),%xmm9 # 6a70 <_sk_callback_avx+0x5b4> + .byte 197,121,111,13,93,69,0,0 // vmovdqa 0x455d(%rip),%xmm9 # 69c0 <_sk_callback_avx+0x5c4> .byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0 .byte 196,65,41,239,210 // vpxor %xmm10,%xmm10,%xmm10 .byte 196,193,121,105,202 // vpunpckhwd %xmm10,%xmm0,%xmm1 @@ -17456,50 +17416,50 @@ _sk_load_tables_rgb_u16_be_avx: .byte 196,195,105,33,211,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm2 .byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,6,65,0,0 // vbroadcastss 0x4106(%rip),%ymm3 # 6730 <_sk_callback_avx+0x274> + .byte 196,226,125,24,29,82,64,0,0 // vbroadcastss 0x4052(%rip),%ymm3 # 6684 <_sk_callback_avx+0x288> .byte 197,252,16,116,36,168 // vmovups -0x58(%rsp),%ymm6 .byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7 .byte 255,224 // jmpq *%rax .byte 196,129,121,110,4,81 // vmovd (%r9,%r10,2),%xmm0 .byte 196,129,121,196,68,81,4,2 // vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,5 // jne 2651 <_sk_load_tables_rgb_u16_be_avx+0x27e> - .byte 233,212,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 117,5 // jne 2659 <_sk_load_tables_rgb_u16_be_avx+0x27e> + .byte 233,212,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> .byte 196,129,121,110,76,81,6 // vmovd 0x6(%r9,%r10,2),%xmm1 .byte 196,1,113,196,68,81,10,2 // vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,26 // jb 2680 <_sk_load_tables_rgb_u16_be_avx+0x2ad> + .byte 114,26 // jb 2688 <_sk_load_tables_rgb_u16_be_avx+0x2ad> .byte 196,129,121,110,76,81,12 // vmovd 0xc(%r9,%r10,2),%xmm1 .byte 196,129,113,196,84,81,16,2 // vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 117,10 // jne 2685 <_sk_load_tables_rgb_u16_be_avx+0x2b2> - .byte 233,165,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> - .byte 233,160,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 117,10 // jne 268d <_sk_load_tables_rgb_u16_be_avx+0x2b2> + .byte 233,165,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 233,160,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> .byte 196,129,121,110,76,81,18 // vmovd 0x12(%r9,%r10,2),%xmm1 .byte 196,1,113,196,76,81,22,2 // vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,26 // jb 26b4 <_sk_load_tables_rgb_u16_be_avx+0x2e1> + .byte 114,26 // jb 26bc <_sk_load_tables_rgb_u16_be_avx+0x2e1> .byte 196,129,121,110,76,81,24 // vmovd 0x18(%r9,%r10,2),%xmm1 .byte 196,129,113,196,76,81,28,2 // vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 117,10 // jne 26b9 <_sk_load_tables_rgb_u16_be_avx+0x2e6> - .byte 233,113,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> - .byte 233,108,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 117,10 // jne 26c1 <_sk_load_tables_rgb_u16_be_avx+0x2e6> + .byte 233,113,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 233,108,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> .byte 196,129,121,110,92,81,30 // vmovd 0x1e(%r9,%r10,2),%xmm3 .byte 196,1,97,196,92,81,34,2 // vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,20 // jb 26e2 <_sk_load_tables_rgb_u16_be_avx+0x30f> + .byte 114,20 // jb 26ea <_sk_load_tables_rgb_u16_be_avx+0x30f> .byte 196,129,121,110,92,81,36 // vmovd 0x24(%r9,%r10,2),%xmm3 .byte 196,129,97,196,92,81,40,2 // vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3 - .byte 233,67,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> - .byte 233,62,253,255,255 // jmpq 2425 <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 233,67,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> + .byte 233,62,253,255,255 // jmpq 242d <_sk_load_tables_rgb_u16_be_avx+0x52> HIDDEN _sk_byte_tables_avx .globl _sk_byte_tables_avx FUNCTION(_sk_byte_tables_avx) _sk_byte_tables_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,66,64,0,0 // vbroadcastss 0x4042(%rip),%ymm8 # 6734 <_sk_callback_avx+0x278> + .byte 196,98,125,24,5,142,63,0,0 // vbroadcastss 0x3f8e(%rip),%ymm8 # 6688 <_sk_callback_avx+0x28c> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9 .byte 196,65,249,126,201 // vmovq %xmm9,%r9 @@ -17618,7 +17578,7 @@ _sk_byte_tables_avx: .byte 196,194,121,49,204 // vpmovzxbd %xmm12,%xmm1 .byte 196,194,121,49,213 // vpmovzxbd %xmm13,%xmm2 .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1 - .byte 196,98,125,24,13,236,61,0,0 // vbroadcastss 0x3dec(%rip),%ymm9 # 6738 <_sk_callback_avx+0x27c> + .byte 196,98,125,24,13,56,61,0,0 // vbroadcastss 0x3d38(%rip),%ymm9 # 668c <_sk_callback_avx+0x290> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 .byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1 @@ -17734,7 +17694,7 @@ _sk_byte_tables_rgb_avx: .byte 196,194,121,49,203 // vpmovzxbd %xmm11,%xmm1 .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,13,205,59,0,0 // vbroadcastss 0x3bcd(%rip),%ymm9 # 673c <_sk_callback_avx+0x280> + .byte 196,98,125,24,13,25,59,0,0 // vbroadcastss 0x3b19(%rip),%ymm9 # 6690 <_sk_callback_avx+0x294> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 196,194,121,49,202 // vpmovzxbd %xmm10,%xmm1 .byte 196,194,121,49,212 // vpmovzxbd %xmm12,%xmm2 @@ -17754,11 +17714,6 @@ HIDDEN _sk_table_r_avx .globl _sk_table_r_avx FUNCTION(_sk_table_r_avx) _sk_table_r_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 139,64,8 // mov 0x8(%rax),%eax @@ -17768,50 +17723,40 @@ _sk_table_r_avx: .byte 196,67,61,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 - .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0 - .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,195 // vmovq %xmm0,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 197,125,91,192 // vcvtps2dq %ymm0,%ymm8 + .byte 196,99,125,25,192,1 // vextractf128 $0x1,%ymm8,%xmm0 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,65,122,16,12,129 // vmovss (%r9,%rax,4),%xmm9 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,49,33,12,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,20,129 // vmovss (%r9,%rax,4),%xmm10 + .byte 196,65,249,126,194 // vmovq %xmm8,%r10 .byte 73,193,235,32 // shr $0x20,%r11 - .byte 196,227,125,25,192,1 // vextractf128 $0x1,%ymm0,%xmm0 - .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,196 // vmovq %xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,129,122,16,4,169 // vmovss (%r9,%r13,4),%xmm0 - .byte 196,3,121,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm0,%xmm8 - .byte 196,129,122,16,4,185 // vmovss (%r9,%r15,4),%xmm0 - .byte 196,99,57,33,192,32 // vinsertps $0x20,%xmm0,%xmm8,%xmm8 - .byte 196,193,122,16,4,153 // vmovss (%r9,%rbx,4),%xmm0 - .byte 196,99,57,33,192,48 // vinsertps $0x30,%xmm0,%xmm8,%xmm8 - .byte 196,129,122,16,4,177 // vmovss (%r9,%r14,4),%xmm0 - .byte 196,3,121,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm0,%xmm9 - .byte 196,129,122,16,4,145 // vmovss (%r9,%r10,4),%xmm0 - .byte 196,99,49,33,200,32 // vinsertps $0x20,%xmm0,%xmm9,%xmm9 + .byte 196,1,122,16,28,153 // vmovss (%r9,%r11,4),%xmm11 + .byte 68,137,208 // mov %r10d,%eax .byte 196,193,122,16,4,129 // vmovss (%r9,%rax,4),%xmm0 - .byte 196,227,49,33,192,48 // vinsertps $0x30,%xmm0,%xmm9,%xmm0 - .byte 196,195,125,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm0,%ymm0 + .byte 196,67,249,22,195,1 // vpextrq $0x1,%xmm8,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,121,33,4,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm0,%xmm8 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,36,129 // vmovss (%r9,%rax,4),%xmm12 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,1,122,16,44,153 // vmovss (%r9,%r11,4),%xmm13 + .byte 196,195,49,33,194,32 // vinsertps $0x20,%xmm10,%xmm9,%xmm0 + .byte 196,67,121,33,203,48 // vinsertps $0x30,%xmm11,%xmm0,%xmm9 + .byte 196,195,57,33,196,32 // vinsertps $0x20,%xmm12,%xmm8,%xmm0 + .byte 196,195,121,33,197,48 // vinsertps $0x30,%xmm13,%xmm0,%xmm0 + .byte 196,195,125,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_table_g_avx .globl _sk_table_g_avx FUNCTION(_sk_table_g_avx) _sk_table_g_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 139,64,8 // mov 0x8(%rax),%eax @@ -17821,50 +17766,40 @@ _sk_table_g_avx: .byte 196,67,61,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 .byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1 - .byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1 - .byte 196,227,249,22,200,1 // vpextrq $0x1,%xmm1,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,203 // vmovq %xmm1,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 197,125,91,193 // vcvtps2dq %ymm1,%ymm8 + .byte 196,99,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,65,122,16,12,129 // vmovss (%r9,%rax,4),%xmm9 + .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,49,33,12,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,20,129 // vmovss (%r9,%rax,4),%xmm10 + .byte 196,65,249,126,194 // vmovq %xmm8,%r10 .byte 73,193,235,32 // shr $0x20,%r11 - .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 - .byte 196,227,249,22,203,1 // vpextrq $0x1,%xmm1,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,204 // vmovq %xmm1,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,129,122,16,12,169 // vmovss (%r9,%r13,4),%xmm1 - .byte 196,3,113,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm1,%xmm8 - .byte 196,129,122,16,12,185 // vmovss (%r9,%r15,4),%xmm1 - .byte 196,99,57,33,193,32 // vinsertps $0x20,%xmm1,%xmm8,%xmm8 - .byte 196,193,122,16,12,153 // vmovss (%r9,%rbx,4),%xmm1 - .byte 196,99,57,33,193,48 // vinsertps $0x30,%xmm1,%xmm8,%xmm8 - .byte 196,129,122,16,12,177 // vmovss (%r9,%r14,4),%xmm1 - .byte 196,3,113,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm1,%xmm9 - .byte 196,129,122,16,12,145 // vmovss (%r9,%r10,4),%xmm1 - .byte 196,99,49,33,201,32 // vinsertps $0x20,%xmm1,%xmm9,%xmm9 + .byte 196,1,122,16,28,153 // vmovss (%r9,%r11,4),%xmm11 + .byte 68,137,208 // mov %r10d,%eax .byte 196,193,122,16,12,129 // vmovss (%r9,%rax,4),%xmm1 - .byte 196,227,49,33,201,48 // vinsertps $0x30,%xmm1,%xmm9,%xmm1 - .byte 196,195,117,24,200,1 // vinsertf128 $0x1,%xmm8,%ymm1,%ymm1 + .byte 196,67,249,22,195,1 // vpextrq $0x1,%xmm8,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,113,33,4,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm1,%xmm8 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,36,129 // vmovss (%r9,%rax,4),%xmm12 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,1,122,16,44,153 // vmovss (%r9,%r11,4),%xmm13 + .byte 196,195,49,33,202,32 // vinsertps $0x20,%xmm10,%xmm9,%xmm1 + .byte 196,67,113,33,203,48 // vinsertps $0x30,%xmm11,%xmm1,%xmm9 + .byte 196,195,57,33,204,32 // vinsertps $0x20,%xmm12,%xmm8,%xmm1 + .byte 196,195,113,33,205,48 // vinsertps $0x30,%xmm13,%xmm1,%xmm1 + .byte 196,195,117,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm1,%ymm1 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_table_b_avx .globl _sk_table_b_avx FUNCTION(_sk_table_b_avx) _sk_table_b_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 139,64,8 // mov 0x8(%rax),%eax @@ -17874,50 +17809,40 @@ _sk_table_b_avx: .byte 196,67,61,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 .byte 197,188,89,210 // vmulps %ymm2,%ymm8,%ymm2 - .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 197,125,91,194 // vcvtps2dq %ymm2,%ymm8 + .byte 196,99,125,25,194,1 // vextractf128 $0x1,%ymm8,%xmm2 + .byte 196,193,249,126,210 // vmovq %xmm2,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,65,122,16,12,129 // vmovss (%r9,%rax,4),%xmm9 + .byte 196,195,249,22,211,1 // vpextrq $0x1,%xmm2,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,49,33,12,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,20,129 // vmovss (%r9,%rax,4),%xmm10 + .byte 196,65,249,126,194 // vmovq %xmm8,%r10 .byte 73,193,235,32 // shr $0x20,%r11 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,227,249,22,211,1 // vpextrq $0x1,%xmm2,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,212 // vmovq %xmm2,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,129,122,16,20,169 // vmovss (%r9,%r13,4),%xmm2 - .byte 196,3,105,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm2,%xmm8 - .byte 196,129,122,16,20,185 // vmovss (%r9,%r15,4),%xmm2 - .byte 196,99,57,33,194,32 // vinsertps $0x20,%xmm2,%xmm8,%xmm8 - .byte 196,193,122,16,20,153 // vmovss (%r9,%rbx,4),%xmm2 - .byte 196,99,57,33,194,48 // vinsertps $0x30,%xmm2,%xmm8,%xmm8 - .byte 196,129,122,16,20,177 // vmovss (%r9,%r14,4),%xmm2 - .byte 196,3,105,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm2,%xmm9 - .byte 196,129,122,16,20,145 // vmovss (%r9,%r10,4),%xmm2 - .byte 196,99,49,33,202,32 // vinsertps $0x20,%xmm2,%xmm9,%xmm9 + .byte 196,1,122,16,28,153 // vmovss (%r9,%r11,4),%xmm11 + .byte 68,137,208 // mov %r10d,%eax .byte 196,193,122,16,20,129 // vmovss (%r9,%rax,4),%xmm2 - .byte 196,227,49,33,210,48 // vinsertps $0x30,%xmm2,%xmm9,%xmm2 - .byte 196,195,109,24,208,1 // vinsertf128 $0x1,%xmm8,%ymm2,%ymm2 + .byte 196,67,249,22,195,1 // vpextrq $0x1,%xmm8,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,105,33,4,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm2,%xmm8 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,36,129 // vmovss (%r9,%rax,4),%xmm12 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,1,122,16,44,153 // vmovss (%r9,%r11,4),%xmm13 + .byte 196,195,49,33,210,32 // vinsertps $0x20,%xmm10,%xmm9,%xmm2 + .byte 196,67,105,33,203,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm9 + .byte 196,195,57,33,212,32 // vinsertps $0x20,%xmm12,%xmm8,%xmm2 + .byte 196,195,105,33,213,48 // vinsertps $0x30,%xmm13,%xmm2,%xmm2 + .byte 196,195,109,24,209,1 // vinsertf128 $0x1,%xmm9,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_table_a_avx .globl _sk_table_a_avx FUNCTION(_sk_table_a_avx) _sk_table_a_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 139,64,8 // mov 0x8(%rax),%eax @@ -17927,39 +17852,34 @@ _sk_table_a_avx: .byte 196,67,61,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 .byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8 .byte 197,188,89,219 // vmulps %ymm3,%ymm8,%ymm3 - .byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3 - .byte 196,227,249,22,216,1 // vpextrq $0x1,%xmm3,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,219 // vmovq %xmm3,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 197,125,91,195 // vcvtps2dq %ymm3,%ymm8 + .byte 196,99,125,25,195,1 // vextractf128 $0x1,%ymm8,%xmm3 + .byte 196,193,249,126,218 // vmovq %xmm3,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,65,122,16,12,129 // vmovss (%r9,%rax,4),%xmm9 + .byte 196,195,249,22,219,1 // vpextrq $0x1,%xmm3,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,49,33,12,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,20,129 // vmovss (%r9,%rax,4),%xmm10 + .byte 196,65,249,126,194 // vmovq %xmm8,%r10 .byte 73,193,235,32 // shr $0x20,%r11 - .byte 196,227,125,25,219,1 // vextractf128 $0x1,%ymm3,%xmm3 - .byte 196,227,249,22,219,1 // vpextrq $0x1,%xmm3,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,249,126,220 // vmovq %xmm3,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,129,122,16,28,169 // vmovss (%r9,%r13,4),%xmm3 - .byte 196,3,97,33,4,161,16 // vinsertps $0x10,(%r9,%r12,4),%xmm3,%xmm8 - .byte 196,129,122,16,28,185 // vmovss (%r9,%r15,4),%xmm3 - .byte 196,99,57,33,195,32 // vinsertps $0x20,%xmm3,%xmm8,%xmm8 - .byte 196,193,122,16,28,153 // vmovss (%r9,%rbx,4),%xmm3 - .byte 196,99,57,33,195,48 // vinsertps $0x30,%xmm3,%xmm8,%xmm8 - .byte 196,129,122,16,28,177 // vmovss (%r9,%r14,4),%xmm3 - .byte 196,3,97,33,12,153,16 // vinsertps $0x10,(%r9,%r11,4),%xmm3,%xmm9 - .byte 196,129,122,16,28,145 // vmovss (%r9,%r10,4),%xmm3 - .byte 196,99,49,33,203,32 // vinsertps $0x20,%xmm3,%xmm9,%xmm9 + .byte 196,1,122,16,28,153 // vmovss (%r9,%r11,4),%xmm11 + .byte 68,137,208 // mov %r10d,%eax .byte 196,193,122,16,28,129 // vmovss (%r9,%rax,4),%xmm3 - .byte 196,227,49,33,219,48 // vinsertps $0x30,%xmm3,%xmm9,%xmm3 - .byte 196,195,101,24,216,1 // vinsertf128 $0x1,%xmm8,%ymm3,%ymm3 + .byte 196,67,249,22,195,1 // vpextrq $0x1,%xmm8,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,3,97,33,4,145,16 // vinsertps $0x10,(%r9,%r10,4),%xmm3,%xmm8 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,65,122,16,36,129 // vmovss (%r9,%rax,4),%xmm12 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,1,122,16,44,153 // vmovss (%r9,%r11,4),%xmm13 + .byte 196,195,49,33,218,32 // vinsertps $0x20,%xmm10,%xmm9,%xmm3 + .byte 196,67,97,33,203,48 // vinsertps $0x30,%xmm11,%xmm3,%xmm9 + .byte 196,195,57,33,220,32 // vinsertps $0x20,%xmm12,%xmm8,%xmm3 + .byte 196,195,97,33,221,48 // vinsertps $0x30,%xmm13,%xmm3,%xmm3 + .byte 196,195,101,24,217,1 // vinsertf128 $0x1,%xmm9,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_parametric_r_avx @@ -17979,36 +17899,36 @@ _sk_parametric_r_avx: .byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0 .byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10 .byte 197,124,91,216 // vcvtdq2ps %ymm0,%ymm11 - .byte 196,98,125,24,37,50,56,0,0 // vbroadcastss 0x3832(%rip),%ymm12 # 6740 <_sk_callback_avx+0x284> + .byte 196,98,125,24,37,198,55,0,0 // vbroadcastss 0x37c6(%rip),%ymm12 # 6694 <_sk_callback_avx+0x298> .byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,40,56,0,0 // vbroadcastss 0x3828(%rip),%ymm12 # 6744 <_sk_callback_avx+0x288> + .byte 196,98,125,24,37,188,55,0,0 // vbroadcastss 0x37bc(%rip),%ymm12 # 6698 <_sk_callback_avx+0x29c> .byte 196,193,124,84,196 // vandps %ymm12,%ymm0,%ymm0 - .byte 196,98,125,24,37,30,56,0,0 // vbroadcastss 0x381e(%rip),%ymm12 # 6748 <_sk_callback_avx+0x28c> + .byte 196,98,125,24,37,178,55,0,0 // vbroadcastss 0x37b2(%rip),%ymm12 # 669c <_sk_callback_avx+0x2a0> .byte 196,193,124,86,196 // vorps %ymm12,%ymm0,%ymm0 - .byte 196,98,125,24,37,20,56,0,0 // vbroadcastss 0x3814(%rip),%ymm12 # 674c <_sk_callback_avx+0x290> + .byte 196,98,125,24,37,168,55,0,0 // vbroadcastss 0x37a8(%rip),%ymm12 # 66a0 <_sk_callback_avx+0x2a4> .byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,10,56,0,0 // vbroadcastss 0x380a(%rip),%ymm12 # 6750 <_sk_callback_avx+0x294> + .byte 196,98,125,24,37,158,55,0,0 // vbroadcastss 0x379e(%rip),%ymm12 # 66a4 <_sk_callback_avx+0x2a8> .byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12 .byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,251,55,0,0 // vbroadcastss 0x37fb(%rip),%ymm12 # 6754 <_sk_callback_avx+0x298> + .byte 196,98,125,24,37,143,55,0,0 // vbroadcastss 0x378f(%rip),%ymm12 # 66a8 <_sk_callback_avx+0x2ac> .byte 196,193,124,88,196 // vaddps %ymm12,%ymm0,%ymm0 - .byte 196,98,125,24,37,241,55,0,0 // vbroadcastss 0x37f1(%rip),%ymm12 # 6758 <_sk_callback_avx+0x29c> + .byte 196,98,125,24,37,133,55,0,0 // vbroadcastss 0x3785(%rip),%ymm12 # 66ac <_sk_callback_avx+0x2b0> .byte 197,156,94,192 // vdivps %ymm0,%ymm12,%ymm0 .byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0 .byte 197,172,89,192 // vmulps %ymm0,%ymm10,%ymm0 .byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10 .byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10 - .byte 196,98,125,24,29,213,55,0,0 // vbroadcastss 0x37d5(%rip),%ymm11 # 675c <_sk_callback_avx+0x2a0> + .byte 196,98,125,24,29,105,55,0,0 // vbroadcastss 0x3769(%rip),%ymm11 # 66b0 <_sk_callback_avx+0x2b4> .byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0 - .byte 196,98,125,24,29,203,55,0,0 // vbroadcastss 0x37cb(%rip),%ymm11 # 6760 <_sk_callback_avx+0x2a4> + .byte 196,98,125,24,29,95,55,0,0 // vbroadcastss 0x375f(%rip),%ymm11 # 66b4 <_sk_callback_avx+0x2b8> .byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11 .byte 196,193,124,92,195 // vsubps %ymm11,%ymm0,%ymm0 - .byte 196,98,125,24,29,188,55,0,0 // vbroadcastss 0x37bc(%rip),%ymm11 # 6764 <_sk_callback_avx+0x2a8> + .byte 196,98,125,24,29,80,55,0,0 // vbroadcastss 0x3750(%rip),%ymm11 # 66b8 <_sk_callback_avx+0x2bc> .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 - .byte 196,98,125,24,29,178,55,0,0 // vbroadcastss 0x37b2(%rip),%ymm11 # 6768 <_sk_callback_avx+0x2ac> + .byte 196,98,125,24,29,70,55,0,0 // vbroadcastss 0x3746(%rip),%ymm11 # 66bc <_sk_callback_avx+0x2c0> .byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10 .byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0 - .byte 196,98,125,24,21,163,55,0,0 // vbroadcastss 0x37a3(%rip),%ymm10 # 676c <_sk_callback_avx+0x2b0> + .byte 196,98,125,24,21,55,55,0,0 // vbroadcastss 0x3737(%rip),%ymm10 # 66c0 <_sk_callback_avx+0x2c4> .byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0 .byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -18016,7 +17936,7 @@ _sk_parametric_r_avx: .byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,5,122,55,0,0 // vbroadcastss 0x377a(%rip),%ymm8 # 6770 <_sk_callback_avx+0x2b4> + .byte 196,98,125,24,5,14,55,0,0 // vbroadcastss 0x370e(%rip),%ymm8 # 66c4 <_sk_callback_avx+0x2c8> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18038,36 +17958,36 @@ _sk_parametric_g_avx: .byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1 .byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10 .byte 197,124,91,217 // vcvtdq2ps %ymm1,%ymm11 - .byte 196,98,125,24,37,43,55,0,0 // vbroadcastss 0x372b(%rip),%ymm12 # 6774 <_sk_callback_avx+0x2b8> + .byte 196,98,125,24,37,191,54,0,0 // vbroadcastss 0x36bf(%rip),%ymm12 # 66c8 <_sk_callback_avx+0x2cc> .byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,33,55,0,0 // vbroadcastss 0x3721(%rip),%ymm12 # 6778 <_sk_callback_avx+0x2bc> + .byte 196,98,125,24,37,181,54,0,0 // vbroadcastss 0x36b5(%rip),%ymm12 # 66cc <_sk_callback_avx+0x2d0> .byte 196,193,116,84,204 // vandps %ymm12,%ymm1,%ymm1 - .byte 196,98,125,24,37,23,55,0,0 // vbroadcastss 0x3717(%rip),%ymm12 # 677c <_sk_callback_avx+0x2c0> + .byte 196,98,125,24,37,171,54,0,0 // vbroadcastss 0x36ab(%rip),%ymm12 # 66d0 <_sk_callback_avx+0x2d4> .byte 196,193,116,86,204 // vorps %ymm12,%ymm1,%ymm1 - .byte 196,98,125,24,37,13,55,0,0 // vbroadcastss 0x370d(%rip),%ymm12 # 6780 <_sk_callback_avx+0x2c4> + .byte 196,98,125,24,37,161,54,0,0 // vbroadcastss 0x36a1(%rip),%ymm12 # 66d4 <_sk_callback_avx+0x2d8> .byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,3,55,0,0 // vbroadcastss 0x3703(%rip),%ymm12 # 6784 <_sk_callback_avx+0x2c8> + .byte 196,98,125,24,37,151,54,0,0 // vbroadcastss 0x3697(%rip),%ymm12 # 66d8 <_sk_callback_avx+0x2dc> .byte 196,65,116,89,228 // vmulps %ymm12,%ymm1,%ymm12 .byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,244,54,0,0 // vbroadcastss 0x36f4(%rip),%ymm12 # 6788 <_sk_callback_avx+0x2cc> + .byte 196,98,125,24,37,136,54,0,0 // vbroadcastss 0x3688(%rip),%ymm12 # 66dc <_sk_callback_avx+0x2e0> .byte 196,193,116,88,204 // vaddps %ymm12,%ymm1,%ymm1 - .byte 196,98,125,24,37,234,54,0,0 // vbroadcastss 0x36ea(%rip),%ymm12 # 678c <_sk_callback_avx+0x2d0> + .byte 196,98,125,24,37,126,54,0,0 // vbroadcastss 0x367e(%rip),%ymm12 # 66e0 <_sk_callback_avx+0x2e4> .byte 197,156,94,201 // vdivps %ymm1,%ymm12,%ymm1 .byte 197,164,92,201 // vsubps %ymm1,%ymm11,%ymm1 .byte 197,172,89,201 // vmulps %ymm1,%ymm10,%ymm1 .byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10 .byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10 - .byte 196,98,125,24,29,206,54,0,0 // vbroadcastss 0x36ce(%rip),%ymm11 # 6790 <_sk_callback_avx+0x2d4> + .byte 196,98,125,24,29,98,54,0,0 // vbroadcastss 0x3662(%rip),%ymm11 # 66e4 <_sk_callback_avx+0x2e8> .byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,29,196,54,0,0 // vbroadcastss 0x36c4(%rip),%ymm11 # 6794 <_sk_callback_avx+0x2d8> + .byte 196,98,125,24,29,88,54,0,0 // vbroadcastss 0x3658(%rip),%ymm11 # 66e8 <_sk_callback_avx+0x2ec> .byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11 .byte 196,193,116,92,203 // vsubps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,29,181,54,0,0 // vbroadcastss 0x36b5(%rip),%ymm11 # 6798 <_sk_callback_avx+0x2dc> + .byte 196,98,125,24,29,73,54,0,0 // vbroadcastss 0x3649(%rip),%ymm11 # 66ec <_sk_callback_avx+0x2f0> .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 - .byte 196,98,125,24,29,171,54,0,0 // vbroadcastss 0x36ab(%rip),%ymm11 # 679c <_sk_callback_avx+0x2e0> + .byte 196,98,125,24,29,63,54,0,0 // vbroadcastss 0x363f(%rip),%ymm11 # 66f0 <_sk_callback_avx+0x2f4> .byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10 .byte 196,193,116,88,202 // vaddps %ymm10,%ymm1,%ymm1 - .byte 196,98,125,24,21,156,54,0,0 // vbroadcastss 0x369c(%rip),%ymm10 # 67a0 <_sk_callback_avx+0x2e4> + .byte 196,98,125,24,21,48,54,0,0 // vbroadcastss 0x3630(%rip),%ymm10 # 66f4 <_sk_callback_avx+0x2f8> .byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1 .byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -18075,7 +17995,7 @@ _sk_parametric_g_avx: .byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1 - .byte 196,98,125,24,5,115,54,0,0 // vbroadcastss 0x3673(%rip),%ymm8 # 67a4 <_sk_callback_avx+0x2e8> + .byte 196,98,125,24,5,7,54,0,0 // vbroadcastss 0x3607(%rip),%ymm8 # 66f8 <_sk_callback_avx+0x2fc> .byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18097,36 +18017,36 @@ _sk_parametric_b_avx: .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 .byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10 .byte 197,124,91,218 // vcvtdq2ps %ymm2,%ymm11 - .byte 196,98,125,24,37,36,54,0,0 // vbroadcastss 0x3624(%rip),%ymm12 # 67a8 <_sk_callback_avx+0x2ec> + .byte 196,98,125,24,37,184,53,0,0 // vbroadcastss 0x35b8(%rip),%ymm12 # 66fc <_sk_callback_avx+0x300> .byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,26,54,0,0 // vbroadcastss 0x361a(%rip),%ymm12 # 67ac <_sk_callback_avx+0x2f0> + .byte 196,98,125,24,37,174,53,0,0 // vbroadcastss 0x35ae(%rip),%ymm12 # 6700 <_sk_callback_avx+0x304> .byte 196,193,108,84,212 // vandps %ymm12,%ymm2,%ymm2 - .byte 196,98,125,24,37,16,54,0,0 // vbroadcastss 0x3610(%rip),%ymm12 # 67b0 <_sk_callback_avx+0x2f4> + .byte 196,98,125,24,37,164,53,0,0 // vbroadcastss 0x35a4(%rip),%ymm12 # 6704 <_sk_callback_avx+0x308> .byte 196,193,108,86,212 // vorps %ymm12,%ymm2,%ymm2 - .byte 196,98,125,24,37,6,54,0,0 // vbroadcastss 0x3606(%rip),%ymm12 # 67b4 <_sk_callback_avx+0x2f8> + .byte 196,98,125,24,37,154,53,0,0 // vbroadcastss 0x359a(%rip),%ymm12 # 6708 <_sk_callback_avx+0x30c> .byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,252,53,0,0 // vbroadcastss 0x35fc(%rip),%ymm12 # 67b8 <_sk_callback_avx+0x2fc> + .byte 196,98,125,24,37,144,53,0,0 // vbroadcastss 0x3590(%rip),%ymm12 # 670c <_sk_callback_avx+0x310> .byte 196,65,108,89,228 // vmulps %ymm12,%ymm2,%ymm12 .byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,237,53,0,0 // vbroadcastss 0x35ed(%rip),%ymm12 # 67bc <_sk_callback_avx+0x300> + .byte 196,98,125,24,37,129,53,0,0 // vbroadcastss 0x3581(%rip),%ymm12 # 6710 <_sk_callback_avx+0x314> .byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2 - .byte 196,98,125,24,37,227,53,0,0 // vbroadcastss 0x35e3(%rip),%ymm12 # 67c0 <_sk_callback_avx+0x304> + .byte 196,98,125,24,37,119,53,0,0 // vbroadcastss 0x3577(%rip),%ymm12 # 6714 <_sk_callback_avx+0x318> .byte 197,156,94,210 // vdivps %ymm2,%ymm12,%ymm2 .byte 197,164,92,210 // vsubps %ymm2,%ymm11,%ymm2 .byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2 .byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10 .byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10 - .byte 196,98,125,24,29,199,53,0,0 // vbroadcastss 0x35c7(%rip),%ymm11 # 67c4 <_sk_callback_avx+0x308> + .byte 196,98,125,24,29,91,53,0,0 // vbroadcastss 0x355b(%rip),%ymm11 # 6718 <_sk_callback_avx+0x31c> .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 - .byte 196,98,125,24,29,189,53,0,0 // vbroadcastss 0x35bd(%rip),%ymm11 # 67c8 <_sk_callback_avx+0x30c> + .byte 196,98,125,24,29,81,53,0,0 // vbroadcastss 0x3551(%rip),%ymm11 # 671c <_sk_callback_avx+0x320> .byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11 .byte 196,193,108,92,211 // vsubps %ymm11,%ymm2,%ymm2 - .byte 196,98,125,24,29,174,53,0,0 // vbroadcastss 0x35ae(%rip),%ymm11 # 67cc <_sk_callback_avx+0x310> + .byte 196,98,125,24,29,66,53,0,0 // vbroadcastss 0x3542(%rip),%ymm11 # 6720 <_sk_callback_avx+0x324> .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 - .byte 196,98,125,24,29,164,53,0,0 // vbroadcastss 0x35a4(%rip),%ymm11 # 67d0 <_sk_callback_avx+0x314> + .byte 196,98,125,24,29,56,53,0,0 // vbroadcastss 0x3538(%rip),%ymm11 # 6724 <_sk_callback_avx+0x328> .byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10 .byte 196,193,108,88,210 // vaddps %ymm10,%ymm2,%ymm2 - .byte 196,98,125,24,21,149,53,0,0 // vbroadcastss 0x3595(%rip),%ymm10 # 67d4 <_sk_callback_avx+0x318> + .byte 196,98,125,24,21,41,53,0,0 // vbroadcastss 0x3529(%rip),%ymm10 # 6728 <_sk_callback_avx+0x32c> .byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2 .byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -18134,7 +18054,7 @@ _sk_parametric_b_avx: .byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,108,53,0,0 // vbroadcastss 0x356c(%rip),%ymm8 # 67d8 <_sk_callback_avx+0x31c> + .byte 196,98,125,24,5,0,53,0,0 // vbroadcastss 0x3500(%rip),%ymm8 # 672c <_sk_callback_avx+0x330> .byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18156,36 +18076,36 @@ _sk_parametric_a_avx: .byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3 .byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10 .byte 197,124,91,219 // vcvtdq2ps %ymm3,%ymm11 - .byte 196,98,125,24,37,29,53,0,0 // vbroadcastss 0x351d(%rip),%ymm12 # 67dc <_sk_callback_avx+0x320> + .byte 196,98,125,24,37,177,52,0,0 // vbroadcastss 0x34b1(%rip),%ymm12 # 6730 <_sk_callback_avx+0x334> .byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,19,53,0,0 // vbroadcastss 0x3513(%rip),%ymm12 # 67e0 <_sk_callback_avx+0x324> + .byte 196,98,125,24,37,167,52,0,0 // vbroadcastss 0x34a7(%rip),%ymm12 # 6734 <_sk_callback_avx+0x338> .byte 196,193,100,84,220 // vandps %ymm12,%ymm3,%ymm3 - .byte 196,98,125,24,37,9,53,0,0 // vbroadcastss 0x3509(%rip),%ymm12 # 67e4 <_sk_callback_avx+0x328> + .byte 196,98,125,24,37,157,52,0,0 // vbroadcastss 0x349d(%rip),%ymm12 # 6738 <_sk_callback_avx+0x33c> .byte 196,193,100,86,220 // vorps %ymm12,%ymm3,%ymm3 - .byte 196,98,125,24,37,255,52,0,0 // vbroadcastss 0x34ff(%rip),%ymm12 # 67e8 <_sk_callback_avx+0x32c> + .byte 196,98,125,24,37,147,52,0,0 // vbroadcastss 0x3493(%rip),%ymm12 # 673c <_sk_callback_avx+0x340> .byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,245,52,0,0 // vbroadcastss 0x34f5(%rip),%ymm12 # 67ec <_sk_callback_avx+0x330> + .byte 196,98,125,24,37,137,52,0,0 // vbroadcastss 0x3489(%rip),%ymm12 # 6740 <_sk_callback_avx+0x344> .byte 196,65,100,89,228 // vmulps %ymm12,%ymm3,%ymm12 .byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11 - .byte 196,98,125,24,37,230,52,0,0 // vbroadcastss 0x34e6(%rip),%ymm12 # 67f0 <_sk_callback_avx+0x334> + .byte 196,98,125,24,37,122,52,0,0 // vbroadcastss 0x347a(%rip),%ymm12 # 6744 <_sk_callback_avx+0x348> .byte 196,193,100,88,220 // vaddps %ymm12,%ymm3,%ymm3 - .byte 196,98,125,24,37,220,52,0,0 // vbroadcastss 0x34dc(%rip),%ymm12 # 67f4 <_sk_callback_avx+0x338> + .byte 196,98,125,24,37,112,52,0,0 // vbroadcastss 0x3470(%rip),%ymm12 # 6748 <_sk_callback_avx+0x34c> .byte 197,156,94,219 // vdivps %ymm3,%ymm12,%ymm3 .byte 197,164,92,219 // vsubps %ymm3,%ymm11,%ymm3 .byte 197,172,89,219 // vmulps %ymm3,%ymm10,%ymm3 .byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10 .byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10 - .byte 196,98,125,24,29,192,52,0,0 // vbroadcastss 0x34c0(%rip),%ymm11 # 67f8 <_sk_callback_avx+0x33c> + .byte 196,98,125,24,29,84,52,0,0 // vbroadcastss 0x3454(%rip),%ymm11 # 674c <_sk_callback_avx+0x350> .byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3 - .byte 196,98,125,24,29,182,52,0,0 // vbroadcastss 0x34b6(%rip),%ymm11 # 67fc <_sk_callback_avx+0x340> + .byte 196,98,125,24,29,74,52,0,0 // vbroadcastss 0x344a(%rip),%ymm11 # 6750 <_sk_callback_avx+0x354> .byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11 .byte 196,193,100,92,219 // vsubps %ymm11,%ymm3,%ymm3 - .byte 196,98,125,24,29,167,52,0,0 // vbroadcastss 0x34a7(%rip),%ymm11 # 6800 <_sk_callback_avx+0x344> + .byte 196,98,125,24,29,59,52,0,0 // vbroadcastss 0x343b(%rip),%ymm11 # 6754 <_sk_callback_avx+0x358> .byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10 - .byte 196,98,125,24,29,157,52,0,0 // vbroadcastss 0x349d(%rip),%ymm11 # 6804 <_sk_callback_avx+0x348> + .byte 196,98,125,24,29,49,52,0,0 // vbroadcastss 0x3431(%rip),%ymm11 # 6758 <_sk_callback_avx+0x35c> .byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10 .byte 196,193,100,88,218 // vaddps %ymm10,%ymm3,%ymm3 - .byte 196,98,125,24,21,142,52,0,0 // vbroadcastss 0x348e(%rip),%ymm10 # 6808 <_sk_callback_avx+0x34c> + .byte 196,98,125,24,21,34,52,0,0 // vbroadcastss 0x3422(%rip),%ymm10 # 675c <_sk_callback_avx+0x360> .byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3 .byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3 .byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10 @@ -18193,7 +18113,7 @@ _sk_parametric_a_avx: .byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3 .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3 - .byte 196,98,125,24,5,101,52,0,0 // vbroadcastss 0x3465(%rip),%ymm8 # 680c <_sk_callback_avx+0x350> + .byte 196,98,125,24,5,249,51,0,0 // vbroadcastss 0x33f9(%rip),%ymm8 # 6760 <_sk_callback_avx+0x364> .byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18202,31 +18122,31 @@ HIDDEN _sk_lab_to_xyz_avx .globl _sk_lab_to_xyz_avx FUNCTION(_sk_lab_to_xyz_avx) _sk_lab_to_xyz_avx: - .byte 196,98,125,24,5,87,52,0,0 // vbroadcastss 0x3457(%rip),%ymm8 # 6810 <_sk_callback_avx+0x354> + .byte 196,98,125,24,5,235,51,0,0 // vbroadcastss 0x33eb(%rip),%ymm8 # 6764 <_sk_callback_avx+0x368> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,5,77,52,0,0 // vbroadcastss 0x344d(%rip),%ymm8 # 6814 <_sk_callback_avx+0x358> + .byte 196,98,125,24,5,225,51,0,0 // vbroadcastss 0x33e1(%rip),%ymm8 # 6768 <_sk_callback_avx+0x36c> .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 - .byte 196,98,125,24,13,67,52,0,0 // vbroadcastss 0x3443(%rip),%ymm9 # 6818 <_sk_callback_avx+0x35c> + .byte 196,98,125,24,13,215,51,0,0 // vbroadcastss 0x33d7(%rip),%ymm9 # 676c <_sk_callback_avx+0x370> .byte 196,193,116,88,201 // vaddps %ymm9,%ymm1,%ymm1 .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 196,193,108,88,209 // vaddps %ymm9,%ymm2,%ymm2 - .byte 196,98,125,24,5,47,52,0,0 // vbroadcastss 0x342f(%rip),%ymm8 # 681c <_sk_callback_avx+0x360> + .byte 196,98,125,24,5,195,51,0,0 // vbroadcastss 0x33c3(%rip),%ymm8 # 6770 <_sk_callback_avx+0x374> .byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,5,37,52,0,0 // vbroadcastss 0x3425(%rip),%ymm8 # 6820 <_sk_callback_avx+0x364> + .byte 196,98,125,24,5,185,51,0,0 // vbroadcastss 0x33b9(%rip),%ymm8 # 6774 <_sk_callback_avx+0x378> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,5,27,52,0,0 // vbroadcastss 0x341b(%rip),%ymm8 # 6824 <_sk_callback_avx+0x368> + .byte 196,98,125,24,5,175,51,0,0 // vbroadcastss 0x33af(%rip),%ymm8 # 6778 <_sk_callback_avx+0x37c> .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1 .byte 197,252,88,201 // vaddps %ymm1,%ymm0,%ymm1 - .byte 196,98,125,24,5,13,52,0,0 // vbroadcastss 0x340d(%rip),%ymm8 # 6828 <_sk_callback_avx+0x36c> + .byte 196,98,125,24,5,161,51,0,0 // vbroadcastss 0x33a1(%rip),%ymm8 # 677c <_sk_callback_avx+0x380> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 197,252,92,210 // vsubps %ymm2,%ymm0,%ymm2 .byte 197,116,89,193 // vmulps %ymm1,%ymm1,%ymm8 .byte 196,65,116,89,192 // vmulps %ymm8,%ymm1,%ymm8 - .byte 196,98,125,24,13,246,51,0,0 // vbroadcastss 0x33f6(%rip),%ymm9 # 682c <_sk_callback_avx+0x370> + .byte 196,98,125,24,13,138,51,0,0 // vbroadcastss 0x338a(%rip),%ymm9 # 6780 <_sk_callback_avx+0x384> .byte 196,65,52,194,208,1 // vcmpltps %ymm8,%ymm9,%ymm10 - .byte 196,98,125,24,29,235,51,0,0 // vbroadcastss 0x33eb(%rip),%ymm11 # 6830 <_sk_callback_avx+0x374> + .byte 196,98,125,24,29,127,51,0,0 // vbroadcastss 0x337f(%rip),%ymm11 # 6784 <_sk_callback_avx+0x388> .byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1 - .byte 196,98,125,24,37,225,51,0,0 // vbroadcastss 0x33e1(%rip),%ymm12 # 6834 <_sk_callback_avx+0x378> + .byte 196,98,125,24,37,117,51,0,0 // vbroadcastss 0x3375(%rip),%ymm12 # 6788 <_sk_callback_avx+0x38c> .byte 196,193,116,89,204 // vmulps %ymm12,%ymm1,%ymm1 .byte 196,67,117,74,192,160 // vblendvps %ymm10,%ymm8,%ymm1,%ymm8 .byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1 @@ -18241,9 +18161,9 @@ _sk_lab_to_xyz_avx: .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 .byte 196,193,108,89,212 // vmulps %ymm12,%ymm2,%ymm2 .byte 196,227,109,74,208,144 // vblendvps %ymm9,%ymm0,%ymm2,%ymm2 - .byte 196,226,125,24,5,151,51,0,0 // vbroadcastss 0x3397(%rip),%ymm0 # 6838 <_sk_callback_avx+0x37c> + .byte 196,226,125,24,5,43,51,0,0 // vbroadcastss 0x332b(%rip),%ymm0 # 678c <_sk_callback_avx+0x390> .byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0 - .byte 196,98,125,24,5,142,51,0,0 // vbroadcastss 0x338e(%rip),%ymm8 # 683c <_sk_callback_avx+0x380> + .byte 196,98,125,24,5,34,51,0,0 // vbroadcastss 0x3322(%rip),%ymm8 # 6790 <_sk_callback_avx+0x394> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18257,14 +18177,14 @@ _sk_load_a8_avx: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,62 // jne 3505 <_sk_load_a8_avx+0x4e> + .byte 117,62 // jne 34c5 <_sk_load_a8_avx+0x4e> .byte 197,250,126,0 // vmovq (%rax),%xmm0 .byte 196,226,121,49,200 // vpmovzxbd %xmm0,%xmm1 .byte 196,227,121,4,192,229 // vpermilps $0xe5,%xmm0,%xmm0 .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,82,51,0,0 // vbroadcastss 0x3352(%rip),%ymm1 # 6840 <_sk_callback_avx+0x384> + .byte 196,226,125,24,13,230,50,0,0 // vbroadcastss 0x32e6(%rip),%ymm1 # 6794 <_sk_callback_avx+0x398> .byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 @@ -18282,71 +18202,61 @@ _sk_load_a8_avx: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 350e <_sk_load_a8_avx+0x57> + .byte 117,235 // jne 34ce <_sk_load_a8_avx+0x57> .byte 196,193,249,110,194 // vmovq %r10,%xmm0 .byte 91 // pop %rbx - .byte 235,160 // jmp 34cb <_sk_load_a8_avx+0x14> + .byte 235,160 // jmp 348b <_sk_load_a8_avx+0x14> HIDDEN _sk_gather_a8_avx .globl _sk_gather_a8_avx FUNCTION(_sk_gather_a8_avx) _sk_gather_a8_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 - .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 - .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1 - .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3 - .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 + .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 + .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2 + .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2 + .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,131,121,32,4,57,0 // vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0 - .byte 67,15,182,28,41 // movzbl (%r9,%r13,1),%ebx - .byte 196,227,121,32,195,2 // vpinsrb $0x2,%ebx,%xmm0,%xmm0 - .byte 67,15,182,28,33 // movzbl (%r9,%r12,1),%ebx - .byte 196,227,121,32,195,3 // vpinsrb $0x3,%ebx,%xmm0,%xmm0 - .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 - .byte 196,131,121,32,12,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1 - .byte 196,131,113,32,12,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1 - .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx - .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,20,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,105,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1 + .byte 68,137,216 // mov %r11d,%eax .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,2 // vpinsrb $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,20,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,105,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm0 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,121,32,192,2 // vpinsrb $0x2,%eax,%xmm0,%xmm0 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1 - .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + .byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0 + .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 + .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,68,50,0,0 // vbroadcastss 0x3244(%rip),%ymm1 # 6844 <_sk_callback_avx+0x388> + .byte 196,226,125,24,13,225,49,0,0 // vbroadcastss 0x31e1(%rip),%ymm1 # 6798 <_sk_callback_avx+0x39c> .byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2 - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_store_a8_avx @@ -18355,14 +18265,14 @@ FUNCTION(_sk_store_a8_avx) _sk_store_a8_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,29,50,0,0 // vbroadcastss 0x321d(%rip),%ymm8 # 6848 <_sk_callback_avx+0x38c> + .byte 196,98,125,24,5,195,49,0,0 // vbroadcastss 0x31c3(%rip),%ymm8 # 679c <_sk_callback_avx+0x3a0> .byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8 .byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8 .byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 196,65,57,103,192 // vpackuswb %xmm8,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3654 <_sk_store_a8_avx+0x37> + .byte 117,10 // jne 3602 <_sk_store_a8_avx+0x37> .byte 196,65,123,17,4,19 // vmovsd %xmm8,(%r11,%rdx,1) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18370,10 +18280,10 @@ _sk_store_a8_avx: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 3650 <_sk_store_a8_avx+0x33> + .byte 119,236 // ja 35fe <_sk_store_a8_avx+0x33> .byte 196,66,121,48,192 // vpmovzxbw %xmm8,%xmm8 .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 36b8 <_sk_store_a8_avx+0x9b> + .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 3664 <_sk_store_a8_avx+0x99> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -18384,28 +18294,26 @@ _sk_store_a8_avx: .byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1) .byte 196,67,121,20,68,19,1,2 // vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1) .byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1) - .byte 235,154 // jmp 3650 <_sk_store_a8_avx+0x33> - .byte 102,144 // xchg %ax,%ax - .byte 245 // cmc - .byte 255 // (bad) + .byte 235,154 // jmp 35fe <_sk_store_a8_avx+0x33> + .byte 247,255 // idiv %edi .byte 255 // (bad) .byte 255 // (bad) - .byte 237 // in (%dx),%eax + .byte 239 // out %eax,(%dx) .byte 255 // (bad) .byte 255 // (bad) - .byte 255,229 // jmpq *%rbp + .byte 255,231 // jmpq *%rdi .byte 255 // (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 221,255 // (bad) + .byte 223,255 // (bad) .byte 255 // (bad) - .byte 255,213 // callq *%rbp + .byte 255,215 // callq *%rdi .byte 255 // (bad) .byte 255 // (bad) - .byte 255,205 // dec %ebp + .byte 255,207 // dec %edi .byte 255 // (bad) .byte 255 // (bad) - .byte 255,197 // inc %ebp + .byte 255,199 // inc %edi .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -18419,17 +18327,17 @@ _sk_load_g8_avx: .byte 72,139,0 // mov (%rax),%rax .byte 72,1,208 // add %rdx,%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,67 // jne 3727 <_sk_load_g8_avx+0x53> + .byte 117,67 // jne 36d3 <_sk_load_g8_avx+0x53> .byte 197,250,126,0 // vmovq (%rax),%xmm0 .byte 196,226,121,49,200 // vpmovzxbd %xmm0,%xmm1 .byte 196,227,121,4,192,229 // vpermilps $0xe5,%xmm0,%xmm0 .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,65,49,0,0 // vbroadcastss 0x3141(%rip),%ymm1 # 684c <_sk_callback_avx+0x390> + .byte 196,226,125,24,13,233,48,0,0 // vbroadcastss 0x30e9(%rip),%ymm1 # 67a0 <_sk_callback_avx+0x3a4> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,54,49,0,0 // vbroadcastss 0x3136(%rip),%ymm3 # 6850 <_sk_callback_avx+0x394> + .byte 196,226,125,24,29,222,48,0,0 // vbroadcastss 0x30de(%rip),%ymm3 # 67a4 <_sk_callback_avx+0x3a8> .byte 76,137,201 // mov %r9,%rcx .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 .byte 197,252,40,208 // vmovaps %ymm0,%ymm2 @@ -18444,71 +18352,61 @@ _sk_load_g8_avx: .byte 73,9,218 // or %rbx,%r10 .byte 72,131,193,8 // add $0x8,%rcx .byte 73,255,203 // dec %r11 - .byte 117,235 // jne 3730 <_sk_load_g8_avx+0x5c> + .byte 117,235 // jne 36dc <_sk_load_g8_avx+0x5c> .byte 196,193,249,110,194 // vmovq %r10,%xmm0 .byte 91 // pop %rbx - .byte 235,155 // jmp 36e8 <_sk_load_g8_avx+0x14> + .byte 235,155 // jmp 3694 <_sk_load_g8_avx+0x14> HIDDEN _sk_gather_g8_avx .globl _sk_gather_g8_avx FUNCTION(_sk_gather_g8_avx) _sk_gather_g8_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 - .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 - .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1 - .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3 - .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 + .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 + .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2 + .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2 + .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,131,121,32,4,57,0 // vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,25,1 // vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0 - .byte 67,15,182,28,41 // movzbl (%r9,%r13,1),%ebx - .byte 196,227,121,32,195,2 // vpinsrb $0x2,%ebx,%xmm0,%xmm0 - .byte 67,15,182,28,33 // movzbl (%r9,%r12,1),%ebx - .byte 196,227,121,32,195,3 // vpinsrb $0x3,%ebx,%xmm0,%xmm0 - .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 - .byte 196,131,121,32,12,49,0 // vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1 - .byte 196,131,113,32,12,25,1 // vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1 - .byte 67,15,182,28,17 // movzbl (%r9,%r10,1),%ebx - .byte 196,227,113,32,203,2 // vpinsrb $0x2,%ebx,%xmm1,%xmm1 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,20,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,105,32,12,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1 + .byte 68,137,216 // mov %r11d,%eax .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,113,32,200,2 // vpinsrb $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,227,113,32,200,3 // vpinsrb $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,32,20,1,0 // vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,105,32,4,17,1 // vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm0 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,182,4,1 // movzbl (%r9,%rax,1),%eax + .byte 196,227,121,32,192,2 // vpinsrb $0x2,%eax,%xmm0,%xmm0 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,182,4,25 // movzbl (%r9,%r11,1),%eax .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1 - .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + .byte 196,227,121,32,192,3 // vpinsrb $0x3,%eax,%xmm0,%xmm0 + .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 + .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,50,48,0,0 // vbroadcastss 0x3032(%rip),%ymm1 # 6854 <_sk_callback_avx+0x398> + .byte 196,226,125,24,13,227,47,0,0 // vbroadcastss 0x2fe3(%rip),%ymm1 # 67a8 <_sk_callback_avx+0x3ac> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,39,48,0,0 // vbroadcastss 0x3027(%rip),%ymm3 # 6858 <_sk_callback_avx+0x39c> + .byte 196,226,125,24,29,216,47,0,0 // vbroadcastss 0x2fd8(%rip),%ymm3 # 67ac <_sk_callback_avx+0x3b0> .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 .byte 197,252,40,208 // vmovaps %ymm0,%ymm2 - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_gather_i8_avx @@ -18518,15 +18416,10 @@ _sk_gather_i8_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,137,193 // mov %rax,%r9 .byte 77,133,201 // test %r9,%r9 - .byte 116,5 // je 3853 <_sk_gather_i8_avx+0xf> + .byte 116,5 // je 37ed <_sk_gather_i8_avx+0xf> .byte 76,137,200 // mov %r9,%rax - .byte 235,2 // jmp 3855 <_sk_gather_i8_avx+0x11> + .byte 235,2 // jmp 37ef <_sk_gather_i8_avx+0x11> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 76,139,16 // mov (%rax),%r10 .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 @@ -18538,55 +18431,55 @@ _sk_gather_i8_avx: .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 + .byte 196,193,249,126,211 // vmovq %xmm2,%r11 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,195,121,32,28,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3 .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,131,97,32,20,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm3,%xmm2 .byte 65,137,195 // mov %eax,%r11d .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,225,249,126,211 // vmovq %xmm2,%rbx - .byte 65,137,222 // mov %ebx,%r14d - .byte 72,193,235,32 // shr $0x20,%rbx .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,193,249,126,199 // vmovq %xmm0,%r15 - .byte 69,137,252 // mov %r15d,%r12d - .byte 196,195,249,22,197,1 // vpextrq $0x1,%xmm0,%r13 - .byte 68,137,237 // mov %r13d,%ebp - .byte 73,193,237,32 // shr $0x20,%r13 - .byte 73,193,239,32 // shr $0x20,%r15 - .byte 196,131,121,32,4,50,0 // vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,26,1 // vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0 - .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 - .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 - .byte 196,193,249,126,198 // vmovq %xmm0,%r14 - .byte 196,131,121,32,4,34,0 // vpinsrb $0x0,(%r10,%r12,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,58,1 // vpinsrb $0x1,(%r10,%r15,1),%xmm0,%xmm0 - .byte 196,195,121,32,4,42,2 // vpinsrb $0x2,(%r10,%rbp,1),%xmm0,%xmm0 - .byte 196,131,121,32,4,42,3 // vpinsrb $0x3,(%r10,%r13,1),%xmm0,%xmm0 + .byte 196,131,105,32,12,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm2,%xmm1 + .byte 196,193,249,126,195 // vmovq %xmm0,%r11 + .byte 196,195,113,32,12,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,195,121,32,20,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2 + .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 196,131,105,32,4,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm2,%xmm0 + .byte 137,216 // mov %ebx,%eax + .byte 196,195,121,32,4,2,2 // vpinsrb $0x2,(%r10,%rax,1),%xmm0,%xmm0 + .byte 72,193,235,32 // shr $0x20,%rbx + .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1 + .byte 196,195,121,32,4,26,3 // vpinsrb $0x3,(%r10,%rbx,1),%xmm0,%xmm0 .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0 - .byte 73,139,105,8 // mov 0x8(%r9),%rbp - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,217 // mov %ebx,%r9d + .byte 77,139,89,8 // mov 0x8(%r9),%r11 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 69,137,209 // mov %r10d,%r9d + .byte 73,193,234,30 // shr $0x1e,%r10 + .byte 196,129,121,110,20,139 // vmovd (%r11,%r9,4),%xmm2 + .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx + .byte 196,131,105,34,4,19,1 // vpinsrd $0x1,(%r11,%r10,1),%xmm2,%xmm0 + .byte 137,216 // mov %ebx,%eax + .byte 196,195,121,34,4,131,2 // vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0 + .byte 196,225,249,126,200 // vmovq %xmm1,%rax .byte 72,193,235,30 // shr $0x1e,%rbx - .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax - .byte 65,137,194 // mov %eax,%r10d + .byte 196,67,121,34,4,27,3 // vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm8 + .byte 137,195 // mov %eax,%ebx + .byte 196,193,121,110,4,155 // vmovd (%r11,%rbx,4),%xmm0 + .byte 196,227,249,22,203,1 // vpextrq $0x1,%xmm1,%rbx .byte 72,193,232,30 // shr $0x1e,%rax - .byte 69,137,247 // mov %r14d,%r15d - .byte 73,193,238,30 // shr $0x1e,%r14 - .byte 69,137,220 // mov %r11d,%r12d - .byte 73,193,235,30 // shr $0x1e,%r11 - .byte 196,161,121,110,68,141,0 // vmovd 0x0(%rbp,%r9,4),%xmm0 - .byte 196,227,121,34,68,29,0,1 // vpinsrd $0x1,0x0(%rbp,%rbx,1),%xmm0,%xmm0 - .byte 196,163,121,34,68,149,0,2 // vpinsrd $0x2,0x0(%rbp,%r10,4),%xmm0,%xmm0 - .byte 196,99,121,34,68,5,0,3 // vpinsrd $0x3,0x0(%rbp,%rax,1),%xmm0,%xmm8 - .byte 196,161,121,110,68,189,0 // vmovd 0x0(%rbp,%r15,4),%xmm0 - .byte 196,163,121,34,68,53,0,1 // vpinsrd $0x1,0x0(%rbp,%r14,1),%xmm0,%xmm0 - .byte 196,163,121,34,68,165,0,2 // vpinsrd $0x2,0x0(%rbp,%r12,4),%xmm0,%xmm0 - .byte 196,163,121,34,92,29,0,3 // vpinsrd $0x3,0x0(%rbp,%r11,1),%xmm0,%xmm3 + .byte 196,195,121,34,4,3,1 // vpinsrd $0x1,(%r11,%rax,1),%xmm0,%xmm0 + .byte 137,216 // mov %ebx,%eax + .byte 196,195,121,34,4,131,2 // vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0 + .byte 72,193,235,30 // shr $0x1e,%rbx + .byte 196,195,121,34,28,27,3 // vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm3 .byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0 - .byte 197,124,40,21,120,49,0,0 // vmovaps 0x3178(%rip),%ymm10 # 6b00 <_sk_callback_avx+0x644> + .byte 197,124,40,21,83,49,0,0 // vmovaps 0x3153(%rip),%ymm10 # 6a60 <_sk_callback_avx+0x664> .byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,13,194,46,0,0 // vbroadcastss 0x2ec2(%rip),%ymm9 # 685c <_sk_callback_avx+0x3a0> + .byte 196,98,125,24,13,145,46,0,0 // vbroadcastss 0x2e91(%rip),%ymm9 # 67b0 <_sk_callback_avx+0x3b4> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1 .byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2 @@ -18607,11 +18500,6 @@ _sk_gather_i8_avx: .byte 196,193,100,89,217 // vmulps %ymm9,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp .byte 255,224 // jmpq *%rax HIDDEN _sk_load_565_avx @@ -18621,38 +18509,38 @@ _sk_load_565_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,128,0,0,0 // jne 3a93 <_sk_load_565_avx+0x8e> + .byte 15,133,128,0,0,0 // jne 3a0f <_sk_load_565_avx+0x8e> .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0 .byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1 .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2 - .byte 196,226,125,24,5,43,46,0,0 // vbroadcastss 0x2e2b(%rip),%ymm0 # 6860 <_sk_callback_avx+0x3a4> + .byte 196,226,125,24,5,3,46,0,0 // vbroadcastss 0x2e03(%rip),%ymm0 # 67b4 <_sk_callback_avx+0x3b8> .byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,30,46,0,0 // vbroadcastss 0x2e1e(%rip),%ymm1 # 6864 <_sk_callback_avx+0x3a8> + .byte 196,226,125,24,13,246,45,0,0 // vbroadcastss 0x2df6(%rip),%ymm1 # 67b8 <_sk_callback_avx+0x3bc> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,24,13,21,46,0,0 // vbroadcastss 0x2e15(%rip),%ymm1 # 6868 <_sk_callback_avx+0x3ac> + .byte 196,226,125,24,13,237,45,0,0 // vbroadcastss 0x2ded(%rip),%ymm1 # 67bc <_sk_callback_avx+0x3c0> .byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,29,8,46,0,0 // vbroadcastss 0x2e08(%rip),%ymm3 # 686c <_sk_callback_avx+0x3b0> + .byte 196,226,125,24,29,224,45,0,0 // vbroadcastss 0x2de0(%rip),%ymm3 # 67c0 <_sk_callback_avx+0x3c4> .byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1 - .byte 196,226,125,24,29,255,45,0,0 // vbroadcastss 0x2dff(%rip),%ymm3 # 6870 <_sk_callback_avx+0x3b4> + .byte 196,226,125,24,29,215,45,0,0 // vbroadcastss 0x2dd7(%rip),%ymm3 # 67c4 <_sk_callback_avx+0x3c8> .byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,226,125,24,29,242,45,0,0 // vbroadcastss 0x2df2(%rip),%ymm3 # 6874 <_sk_callback_avx+0x3b8> + .byte 196,226,125,24,29,202,45,0,0 // vbroadcastss 0x2dca(%rip),%ymm3 # 67c8 <_sk_callback_avx+0x3cc> .byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,231,45,0,0 // vbroadcastss 0x2de7(%rip),%ymm3 # 6878 <_sk_callback_avx+0x3bc> + .byte 196,226,125,24,29,191,45,0,0 // vbroadcastss 0x2dbf(%rip),%ymm3 # 67cc <_sk_callback_avx+0x3d0> .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,7 // and $0x7,%r9b .byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,110,255,255,255 // ja 3a19 <_sk_load_565_avx+0x14> + .byte 15,135,110,255,255,255 // ja 3995 <_sk_load_565_avx+0x14> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 3b00 <_sk_load_565_avx+0xfb> + .byte 76,141,21,74,0,0,0 // lea 0x4a(%rip),%r10 # 3a7c <_sk_load_565_avx+0xfb> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -18664,12 +18552,12 @@ _sk_load_565_avx: .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - .byte 233,26,255,255,255 // jmpq 3a19 <_sk_load_565_avx+0x14> + .byte 233,26,255,255,255 // jmpq 3995 <_sk_load_565_avx+0x14> .byte 144 // nop .byte 243,255 // repz (bad) .byte 255 // (bad) .byte 255 // (bad) - .byte 235,255 // jmp 3b05 <_sk_load_565_avx+0x100> + .byte 235,255 // jmp 3a81 <_sk_load_565_avx+0x100> .byte 255 // (bad) .byte 255,227 // jmpq *%rbx .byte 255 // (bad) @@ -18693,79 +18581,67 @@ HIDDEN _sk_gather_565_avx .globl _sk_gather_565_avx FUNCTION(_sk_gather_565_avx) _sk_gather_565_avx: - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 - .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 - .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1 - .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3 - .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 + .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 + .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2 + .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2 + .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 65,15,183,28,89 // movzwl (%r9,%rbx,2),%ebx - .byte 67,15,183,44,121 // movzwl (%r9,%r15,2),%ebp - .byte 197,249,110,197 // vmovd %ebp,%xmm0 - .byte 197,249,196,195,1 // vpinsrw $0x1,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,105 // movzwl (%r9,%r13,2),%ebx - .byte 197,249,196,195,2 // vpinsrw $0x2,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,97 // movzwl (%r9,%r12,2),%ebx - .byte 197,249,196,195,3 // vpinsrw $0x3,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,113 // movzwl (%r9,%r14,2),%ebx - .byte 197,249,196,195,4 // vpinsrw $0x4,%ebx,%xmm0,%xmm0 - .byte 67,15,183,44,89 // movzwl (%r9,%r11,2),%ebp - .byte 197,249,196,197,5 // vpinsrw $0x5,%ebp,%xmm0,%xmm0 - .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp - .byte 197,249,196,197,6 // vpinsrw $0x6,%ebp,%xmm0,%xmm0 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,110,208 // vmovd %eax,%xmm2 + .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,233,196,200,1 // vpinsrw $0x1,%eax,%xmm2,%xmm1 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,2 // vpinsrw $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax + .byte 197,241,196,200,3 // vpinsrw $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,4 // vpinsrw $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,192,5 // vpinsrw $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax .byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0 .byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1 .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2 - .byte 196,226,125,24,5,132,44,0,0 // vbroadcastss 0x2c84(%rip),%ymm0 # 687c <_sk_callback_avx+0x3c0> + .byte 196,226,125,24,5,102,44,0,0 // vbroadcastss 0x2c66(%rip),%ymm0 # 67d0 <_sk_callback_avx+0x3d4> .byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,119,44,0,0 // vbroadcastss 0x2c77(%rip),%ymm1 # 6880 <_sk_callback_avx+0x3c4> + .byte 196,226,125,24,13,89,44,0,0 // vbroadcastss 0x2c59(%rip),%ymm1 # 67d4 <_sk_callback_avx+0x3d8> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,24,13,110,44,0,0 // vbroadcastss 0x2c6e(%rip),%ymm1 # 6884 <_sk_callback_avx+0x3c8> + .byte 196,226,125,24,13,80,44,0,0 // vbroadcastss 0x2c50(%rip),%ymm1 # 67d8 <_sk_callback_avx+0x3dc> .byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,29,97,44,0,0 // vbroadcastss 0x2c61(%rip),%ymm3 # 6888 <_sk_callback_avx+0x3cc> + .byte 196,226,125,24,29,67,44,0,0 // vbroadcastss 0x2c43(%rip),%ymm3 # 67dc <_sk_callback_avx+0x3e0> .byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1 - .byte 196,226,125,24,29,88,44,0,0 // vbroadcastss 0x2c58(%rip),%ymm3 # 688c <_sk_callback_avx+0x3d0> + .byte 196,226,125,24,29,58,44,0,0 // vbroadcastss 0x2c3a(%rip),%ymm3 # 67e0 <_sk_callback_avx+0x3e4> .byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,226,125,24,29,75,44,0,0 // vbroadcastss 0x2c4b(%rip),%ymm3 # 6890 <_sk_callback_avx+0x3d4> + .byte 196,226,125,24,29,45,44,0,0 // vbroadcastss 0x2c2d(%rip),%ymm3 # 67e4 <_sk_callback_avx+0x3e8> .byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,64,44,0,0 // vbroadcastss 0x2c40(%rip),%ymm3 # 6894 <_sk_callback_avx+0x3d8> - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp + .byte 196,226,125,24,29,34,44,0,0 // vbroadcastss 0x2c22(%rip),%ymm3 # 67e8 <_sk_callback_avx+0x3ec> .byte 255,224 // jmpq *%rax HIDDEN _sk_store_565_avx @@ -18774,14 +18650,14 @@ FUNCTION(_sk_store_565_avx) _sk_store_565_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,42,44,0,0 // vbroadcastss 0x2c2a(%rip),%ymm8 # 6898 <_sk_callback_avx+0x3dc> + .byte 196,98,125,24,5,22,44,0,0 // vbroadcastss 0x2c16(%rip),%ymm8 # 67ec <_sk_callback_avx+0x3f0> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,193,41,114,241,11 // vpslld $0xb,%xmm9,%xmm10 .byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9 .byte 196,193,49,114,241,11 // vpslld $0xb,%xmm9,%xmm9 .byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 - .byte 196,98,125,24,21,3,44,0,0 // vbroadcastss 0x2c03(%rip),%ymm10 # 689c <_sk_callback_avx+0x3e0> + .byte 196,98,125,24,21,239,43,0,0 // vbroadcastss 0x2bef(%rip),%ymm10 # 67f0 <_sk_callback_avx+0x3f4> .byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10 .byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10 .byte 196,193,33,114,242,5 // vpslld $0x5,%xmm10,%xmm11 @@ -18795,7 +18671,7 @@ _sk_store_565_avx: .byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3ce9 <_sk_store_565_avx+0x89> + .byte 117,10 // jne 3c51 <_sk_store_565_avx+0x89> .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18803,9 +18679,9 @@ _sk_store_565_avx: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 3ce5 <_sk_store_565_avx+0x85> + .byte 119,236 // ja 3c4d <_sk_store_565_avx+0x85> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 3d48 <_sk_store_565_avx+0xe8> + .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 3cb0 <_sk_store_565_avx+0xe8> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -18816,7 +18692,7 @@ _sk_store_565_avx: .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2) - .byte 235,159 // jmp 3ce5 <_sk_store_565_avx+0x85> + .byte 235,159 // jmp 3c4d <_sk_store_565_avx+0x85> .byte 102,144 // xchg %ax,%ax .byte 245 // cmc .byte 255 // (bad) @@ -18849,31 +18725,31 @@ _sk_load_4444_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,152,0,0,0 // jne 3e0a <_sk_load_4444_avx+0xa6> + .byte 15,133,152,0,0,0 // jne 3d72 <_sk_load_4444_avx+0xa6> .byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0 .byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1 .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3 - .byte 196,226,125,24,5,12,43,0,0 // vbroadcastss 0x2b0c(%rip),%ymm0 # 68a0 <_sk_callback_avx+0x3e4> + .byte 196,226,125,24,5,248,42,0,0 // vbroadcastss 0x2af8(%rip),%ymm0 # 67f4 <_sk_callback_avx+0x3f8> .byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,255,42,0,0 // vbroadcastss 0x2aff(%rip),%ymm1 # 68a4 <_sk_callback_avx+0x3e8> + .byte 196,226,125,24,13,235,42,0,0 // vbroadcastss 0x2aeb(%rip),%ymm1 # 67f8 <_sk_callback_avx+0x3fc> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,24,13,246,42,0,0 // vbroadcastss 0x2af6(%rip),%ymm1 # 68a8 <_sk_callback_avx+0x3ec> + .byte 196,226,125,24,13,226,42,0,0 // vbroadcastss 0x2ae2(%rip),%ymm1 # 67fc <_sk_callback_avx+0x400> .byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,21,233,42,0,0 // vbroadcastss 0x2ae9(%rip),%ymm2 # 68ac <_sk_callback_avx+0x3f0> + .byte 196,226,125,24,21,213,42,0,0 // vbroadcastss 0x2ad5(%rip),%ymm2 # 6800 <_sk_callback_avx+0x404> .byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1 - .byte 196,226,125,24,21,224,42,0,0 // vbroadcastss 0x2ae0(%rip),%ymm2 # 68b0 <_sk_callback_avx+0x3f4> + .byte 196,226,125,24,21,204,42,0,0 // vbroadcastss 0x2acc(%rip),%ymm2 # 6804 <_sk_callback_avx+0x408> .byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,98,125,24,5,211,42,0,0 // vbroadcastss 0x2ad3(%rip),%ymm8 # 68b4 <_sk_callback_avx+0x3f8> + .byte 196,98,125,24,5,191,42,0,0 // vbroadcastss 0x2abf(%rip),%ymm8 # 6808 <_sk_callback_avx+0x40c> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,201,42,0,0 // vbroadcastss 0x2ac9(%rip),%ymm8 # 68b8 <_sk_callback_avx+0x3fc> + .byte 196,98,125,24,5,181,42,0,0 // vbroadcastss 0x2ab5(%rip),%ymm8 # 680c <_sk_callback_avx+0x410> .byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,187,42,0,0 // vbroadcastss 0x2abb(%rip),%ymm8 # 68bc <_sk_callback_avx+0x400> + .byte 196,98,125,24,5,167,42,0,0 // vbroadcastss 0x2aa7(%rip),%ymm8 # 6810 <_sk_callback_avx+0x414> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -18882,9 +18758,9 @@ _sk_load_4444_avx: .byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,86,255,255,255 // ja 3d78 <_sk_load_4444_avx+0x14> + .byte 15,135,86,255,255,255 // ja 3ce0 <_sk_load_4444_avx+0x14> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,75,0,0,0 // lea 0x4b(%rip),%r10 # 3e78 <_sk_load_4444_avx+0x114> + .byte 76,141,21,75,0,0,0 // lea 0x4b(%rip),%r10 # 3de0 <_sk_load_4444_avx+0x114> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -18896,7 +18772,7 @@ _sk_load_4444_avx: .byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,68,83,2,1 // vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 .byte 196,193,121,196,4,83,0 // vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - .byte 233,2,255,255,255 // jmpq 3d78 <_sk_load_4444_avx+0x14> + .byte 233,2,255,255,255 // jmpq 3ce0 <_sk_load_4444_avx+0x14> .byte 102,144 // xchg %ax,%ax .byte 242,255 // repnz (bad) .byte 255 // (bad) @@ -18926,83 +18802,71 @@ HIDDEN _sk_gather_4444_avx .globl _sk_gather_4444_avx FUNCTION(_sk_gather_4444_avx) _sk_gather_4444_avx: - .byte 85 // push %rbp - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 - .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 - .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1 - .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3 - .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 + .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 + .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2 + .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2 + .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 65,15,183,28,89 // movzwl (%r9,%rbx,2),%ebx - .byte 67,15,183,44,121 // movzwl (%r9,%r15,2),%ebp - .byte 197,249,110,197 // vmovd %ebp,%xmm0 - .byte 197,249,196,195,1 // vpinsrw $0x1,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,105 // movzwl (%r9,%r13,2),%ebx - .byte 197,249,196,195,2 // vpinsrw $0x2,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,97 // movzwl (%r9,%r12,2),%ebx - .byte 197,249,196,195,3 // vpinsrw $0x3,%ebx,%xmm0,%xmm0 - .byte 67,15,183,28,113 // movzwl (%r9,%r14,2),%ebx - .byte 197,249,196,195,4 // vpinsrw $0x4,%ebx,%xmm0,%xmm0 - .byte 67,15,183,44,89 // movzwl (%r9,%r11,2),%ebp - .byte 197,249,196,197,5 // vpinsrw $0x5,%ebp,%xmm0,%xmm0 - .byte 67,15,183,44,81 // movzwl (%r9,%r10,2),%ebp - .byte 197,249,196,197,6 // vpinsrw $0x6,%ebp,%xmm0,%xmm0 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,110,208 // vmovd %eax,%xmm2 + .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,233,196,200,1 // vpinsrw $0x1,%eax,%xmm2,%xmm1 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,2 // vpinsrw $0x2,%eax,%xmm1,%xmm1 + .byte 196,193,249,126,194 // vmovq %xmm0,%r10 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax + .byte 197,241,196,200,3 // vpinsrw $0x3,%eax,%xmm1,%xmm1 + .byte 68,137,208 // mov %r10d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,241,196,200,4 // vpinsrw $0x4,%eax,%xmm1,%xmm1 + .byte 196,195,249,22,195,1 // vpextrq $0x1,%xmm0,%r11 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 67,15,183,4,81 // movzwl (%r9,%r10,2),%eax + .byte 197,241,196,192,5 // vpinsrw $0x5,%eax,%xmm1,%xmm0 + .byte 68,137,216 // mov %r11d,%eax + .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax + .byte 197,249,196,192,6 // vpinsrw $0x6,%eax,%xmm0,%xmm0 + .byte 73,193,235,32 // shr $0x20,%r11 + .byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax .byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0 .byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1 .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3 - .byte 196,226,125,24,5,80,41,0,0 // vbroadcastss 0x2950(%rip),%ymm0 # 68c0 <_sk_callback_avx+0x404> + .byte 196,226,125,24,5,70,41,0,0 // vbroadcastss 0x2946(%rip),%ymm0 # 6814 <_sk_callback_avx+0x418> .byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,226,125,24,13,67,41,0,0 // vbroadcastss 0x2943(%rip),%ymm1 # 68c4 <_sk_callback_avx+0x408> + .byte 196,226,125,24,13,57,41,0,0 // vbroadcastss 0x2939(%rip),%ymm1 # 6818 <_sk_callback_avx+0x41c> .byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,24,13,58,41,0,0 // vbroadcastss 0x293a(%rip),%ymm1 # 68c8 <_sk_callback_avx+0x40c> + .byte 196,226,125,24,13,48,41,0,0 // vbroadcastss 0x2930(%rip),%ymm1 # 681c <_sk_callback_avx+0x420> .byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1 .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1 - .byte 196,226,125,24,21,45,41,0,0 // vbroadcastss 0x292d(%rip),%ymm2 # 68cc <_sk_callback_avx+0x410> + .byte 196,226,125,24,21,35,41,0,0 // vbroadcastss 0x2923(%rip),%ymm2 # 6820 <_sk_callback_avx+0x424> .byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1 - .byte 196,226,125,24,21,36,41,0,0 // vbroadcastss 0x2924(%rip),%ymm2 # 68d0 <_sk_callback_avx+0x414> + .byte 196,226,125,24,21,26,41,0,0 // vbroadcastss 0x291a(%rip),%ymm2 # 6824 <_sk_callback_avx+0x428> .byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2 .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 - .byte 196,98,125,24,5,23,41,0,0 // vbroadcastss 0x2917(%rip),%ymm8 # 68d4 <_sk_callback_avx+0x418> + .byte 196,98,125,24,5,13,41,0,0 // vbroadcastss 0x290d(%rip),%ymm8 # 6828 <_sk_callback_avx+0x42c> .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2 - .byte 196,98,125,24,5,13,41,0,0 // vbroadcastss 0x290d(%rip),%ymm8 # 68d8 <_sk_callback_avx+0x41c> + .byte 196,98,125,24,5,3,41,0,0 // vbroadcastss 0x2903(%rip),%ymm8 # 682c <_sk_callback_avx+0x430> .byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3 .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 - .byte 196,98,125,24,5,255,40,0,0 // vbroadcastss 0x28ff(%rip),%ymm8 # 68dc <_sk_callback_avx+0x420> + .byte 196,98,125,24,5,245,40,0,0 // vbroadcastss 0x28f5(%rip),%ymm8 # 6830 <_sk_callback_avx+0x434> .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 - .byte 93 // pop %rbp .byte 255,224 // jmpq *%rax HIDDEN _sk_store_4444_avx @@ -19011,7 +18875,7 @@ FUNCTION(_sk_store_4444_avx) _sk_store_4444_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 - .byte 196,98,125,24,5,226,40,0,0 // vbroadcastss 0x28e2(%rip),%ymm8 # 68e0 <_sk_callback_avx+0x424> + .byte 196,98,125,24,5,226,40,0,0 // vbroadcastss 0x28e2(%rip),%ymm8 # 6834 <_sk_callback_avx+0x438> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,193,41,114,241,12 // vpslld $0xc,%xmm9,%xmm10 @@ -19038,7 +18902,7 @@ _sk_store_4444_avx: .byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9 .byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 4097 <_sk_store_4444_avx+0xa7> + .byte 117,10 // jne 3feb <_sk_store_4444_avx+0xa7> .byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -19046,9 +18910,9 @@ _sk_store_4444_avx: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 4093 <_sk_store_4444_avx+0xa3> + .byte 119,236 // ja 3fe7 <_sk_store_4444_avx+0xa3> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 40f4 <_sk_store_4444_avx+0x104> + .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 4048 <_sk_store_4444_avx+0x104> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -19059,7 +18923,7 @@ _sk_store_4444_avx: .byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) .byte 196,67,121,21,68,83,2,1 // vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) .byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2) - .byte 235,159 // jmp 4093 <_sk_store_4444_avx+0xa3> + .byte 235,159 // jmp 3fe7 <_sk_store_4444_avx+0xa3> .byte 247,255 // idiv %edi .byte 255 // (bad) .byte 255 // (bad) @@ -19092,12 +18956,12 @@ _sk_load_8888_avx: .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,137,0,0,0 // jne 41b2 <_sk_load_8888_avx+0xa2> + .byte 15,133,137,0,0,0 // jne 4106 <_sk_load_8888_avx+0xa2> .byte 196,193,124,16,26 // vmovups (%r10),%ymm3 - .byte 197,124,40,21,234,41,0,0 // vmovaps 0x29ea(%rip),%ymm10 # 6b20 <_sk_callback_avx+0x664> + .byte 197,124,40,21,246,41,0,0 // vmovaps 0x29f6(%rip),%ymm10 # 6a80 <_sk_callback_avx+0x684> .byte 196,193,100,84,194 // vandps %ymm10,%ymm3,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,5,156,39,0,0 // vbroadcastss 0x279c(%rip),%ymm8 # 68e4 <_sk_callback_avx+0x428> + .byte 196,98,125,24,5,156,39,0,0 // vbroadcastss 0x279c(%rip),%ymm8 # 6838 <_sk_callback_avx+0x43c> .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0 .byte 197,241,114,211,8 // vpsrld $0x8,%xmm3,%xmm1 .byte 196,195,125,25,217,1 // vextractf128 $0x1,%ymm3,%xmm9 @@ -19127,23 +18991,18 @@ _sk_load_8888_avx: .byte 72,211,232 // shr %cl,%rax .byte 196,225,249,110,192 // vmovq %rax,%xmm0 .byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0 - .byte 196,226,121,0,13,166,40,0,0 // vpshufb 0x28a6(%rip),%xmm0,%xmm1 # 6a80 <_sk_callback_avx+0x5c4> + .byte 196,226,121,0,13,162,40,0,0 // vpshufb 0x28a2(%rip),%xmm0,%xmm1 # 69d0 <_sk_callback_avx+0x5d4> .byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1 - .byte 196,226,121,0,5,168,40,0,0 // vpshufb 0x28a8(%rip),%xmm0,%xmm0 # 6a90 <_sk_callback_avx+0x5d4> + .byte 196,226,121,0,5,164,40,0,0 // vpshufb 0x28a4(%rip),%xmm0,%xmm0 # 69e0 <_sk_callback_avx+0x5e4> .byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0 .byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 .byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3 - .byte 233,49,255,255,255 // jmpq 412e <_sk_load_8888_avx+0x1e> + .byte 233,49,255,255,255 // jmpq 4082 <_sk_load_8888_avx+0x1e> HIDDEN _sk_gather_8888_avx .globl _sk_gather_8888_avx FUNCTION(_sk_gather_8888_avx) _sk_gather_8888_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 @@ -19152,35 +19011,35 @@ _sk_gather_8888_avx: .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,194,1 // vextractf128 $0x1,%ymm0,%xmm2 - .byte 197,241,254,202 // vpaddd %xmm2,%xmm1,%xmm1 - .byte 196,225,249,126,200 // vmovq %xmm1,%rax - .byte 65,137,194 // mov %eax,%r10d - .byte 72,193,232,32 // shr $0x20,%rax + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 + .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,193,249,126,202 // vmovq %xmm1,%r10 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,193,121,110,20,129 // vmovd (%r9,%rax,4),%xmm2 .byte 196,195,249,22,203,1 // vpextrq $0x1,%xmm1,%r11 - .byte 69,137,222 // mov %r11d,%r14d + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,105,34,12,145,1 // vpinsrd $0x1,(%r9,%r10,4),%xmm2,%xmm1 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,195,113,34,12,129,2 // vpinsrd $0x2,(%r9,%rax,4),%xmm1,%xmm1 + .byte 196,225,249,126,192 // vmovq %xmm0,%rax .byte 73,193,235,32 // shr $0x20,%r11 - .byte 197,225,254,192 // vpaddd %xmm0,%xmm3,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 196,129,121,110,4,185 // vmovd (%r9,%r15,4),%xmm0 - .byte 196,195,121,34,4,153,1 // vpinsrd $0x1,(%r9,%rbx,4),%xmm0,%xmm0 - .byte 196,131,121,34,4,169,2 // vpinsrd $0x2,(%r9,%r13,4),%xmm0,%xmm0 - .byte 196,3,121,34,4,161,3 // vpinsrd $0x3,(%r9,%r12,4),%xmm0,%xmm8 - .byte 196,129,121,110,4,145 // vmovd (%r9,%r10,4),%xmm0 - .byte 196,195,121,34,4,129,1 // vpinsrd $0x1,(%r9,%rax,4),%xmm0,%xmm0 - .byte 196,131,121,34,4,177,2 // vpinsrd $0x2,(%r9,%r14,4),%xmm0,%xmm0 - .byte 196,131,121,34,28,153,3 // vpinsrd $0x3,(%r9,%r11,4),%xmm0,%xmm3 + .byte 196,3,113,34,4,153,3 // vpinsrd $0x3,(%r9,%r11,4),%xmm1,%xmm8 + .byte 65,137,194 // mov %eax,%r10d + .byte 72,193,232,32 // shr $0x20,%rax + .byte 196,129,121,110,12,145 // vmovd (%r9,%r10,4),%xmm1 + .byte 196,195,249,22,194,1 // vpextrq $0x1,%xmm0,%r10 + .byte 196,195,113,34,4,129,1 // vpinsrd $0x1,(%r9,%rax,4),%xmm1,%xmm0 + .byte 68,137,208 // mov %r10d,%eax + .byte 196,195,121,34,4,129,2 // vpinsrd $0x2,(%r9,%rax,4),%xmm0,%xmm0 + .byte 73,193,234,32 // shr $0x20,%r10 + .byte 196,131,121,34,28,145,3 // vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3 .byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0 - .byte 197,124,40,21,143,40,0,0 // vmovaps 0x288f(%rip),%ymm10 # 6b40 <_sk_callback_avx+0x684> + .byte 197,124,40,21,164,40,0,0 // vmovaps 0x28a4(%rip),%ymm10 # 6aa0 <_sk_callback_avx+0x6a4> .byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,13,37,38,0,0 // vbroadcastss 0x2625(%rip),%ymm9 # 68e8 <_sk_callback_avx+0x42c> + .byte 196,98,125,24,13,46,38,0,0 // vbroadcastss 0x262e(%rip),%ymm9 # 683c <_sk_callback_avx+0x440> .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0 .byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1 .byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2 @@ -19200,11 +19059,6 @@ _sk_gather_8888_avx: .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3 .byte 196,193,100,89,217 // vmulps %ymm9,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 .byte 255,224 // jmpq *%rax HIDDEN _sk_store_8888_avx @@ -19215,7 +19069,7 @@ _sk_store_8888_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 76,3,16 // add (%rax),%r10 - .byte 196,98,125,24,5,166,37,0,0 // vbroadcastss 0x25a6(%rip),%ymm8 # 68ec <_sk_callback_avx+0x430> + .byte 196,98,125,24,5,184,37,0,0 // vbroadcastss 0x25b8(%rip),%ymm8 # 6840 <_sk_callback_avx+0x444> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10 @@ -19240,7 +19094,7 @@ _sk_store_8888_avx: .byte 196,65,45,86,192 // vorpd %ymm8,%ymm10,%ymm8 .byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,12 // jne 43d6 <_sk_store_8888_avx+0xa9> + .byte 117,12 // jne 4318 <_sk_store_8888_avx+0xa9> .byte 196,65,124,17,2 // vmovups %ymm8,(%r10) .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,201 // mov %r9,%rcx @@ -19252,13 +19106,13 @@ _sk_store_8888_avx: .byte 72,211,232 // shr %cl,%rax .byte 196,97,249,110,200 // vmovq %rax,%xmm9 .byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9 - .byte 196,98,49,0,21,162,38,0,0 // vpshufb 0x26a2(%rip),%xmm9,%xmm10 # 6aa0 <_sk_callback_avx+0x5e4> + .byte 196,98,49,0,21,176,38,0,0 // vpshufb 0x26b0(%rip),%xmm9,%xmm10 # 69f0 <_sk_callback_avx+0x5f4> .byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10 - .byte 196,98,49,0,13,164,38,0,0 // vpshufb 0x26a4(%rip),%xmm9,%xmm9 # 6ab0 <_sk_callback_avx+0x5f4> + .byte 196,98,49,0,13,178,38,0,0 // vpshufb 0x26b2(%rip),%xmm9,%xmm9 # 6a00 <_sk_callback_avx+0x604> .byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9 .byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 .byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10) - .byte 235,177 // jmp 43cf <_sk_store_8888_avx+0xa2> + .byte 235,177 // jmp 4311 <_sk_store_8888_avx+0xa2> HIDDEN _sk_load_f16_avx .globl _sk_load_f16_avx @@ -19272,7 +19126,7 @@ _sk_load_f16_avx: .byte 197,252,17,116,36,192 // vmovups %ymm6,-0x40(%rsp) .byte 197,252,17,108,36,160 // vmovups %ymm5,-0x60(%rsp) .byte 197,254,127,100,36,128 // vmovdqu %ymm4,-0x80(%rsp) - .byte 15,133,141,2,0,0 // jne 46d5 <_sk_load_f16_avx+0x2b7> + .byte 15,133,141,2,0,0 // jne 4617 <_sk_load_f16_avx+0x2b7> .byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8 .byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2 .byte 197,249,16,76,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm1 @@ -19290,13 +19144,13 @@ _sk_load_f16_avx: .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 - .byte 196,98,125,24,37,79,36,0,0 // vbroadcastss 0x244f(%rip),%ymm12 # 68f0 <_sk_callback_avx+0x434> + .byte 196,98,125,24,37,97,36,0,0 // vbroadcastss 0x2461(%rip),%ymm12 # 6844 <_sk_callback_avx+0x448> .byte 196,193,124,84,204 // vandps %ymm12,%ymm0,%ymm1 .byte 197,252,87,193 // vxorps %ymm1,%ymm0,%ymm0 .byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14 - .byte 196,98,121,24,29,59,36,0,0 // vbroadcastss 0x243b(%rip),%xmm11 # 68f4 <_sk_callback_avx+0x438> + .byte 196,98,121,24,29,77,36,0,0 // vbroadcastss 0x244d(%rip),%xmm11 # 6848 <_sk_callback_avx+0x44c> .byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3 - .byte 196,98,121,24,45,49,36,0,0 // vbroadcastss 0x2431(%rip),%xmm13 # 68f8 <_sk_callback_avx+0x43c> + .byte 196,98,121,24,45,67,36,0,0 // vbroadcastss 0x2443(%rip),%xmm13 # 684c <_sk_callback_avx+0x450> .byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3 .byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10 .byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10 @@ -19310,7 +19164,7 @@ _sk_load_f16_avx: .byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0 .byte 197,252,86,193 // vorps %ymm1,%ymm0,%ymm0 .byte 196,227,125,25,193,1 // vextractf128 $0x1,%ymm0,%xmm1 - .byte 196,226,121,24,29,231,35,0,0 // vbroadcastss 0x23e7(%rip),%xmm3 # 68fc <_sk_callback_avx+0x440> + .byte 196,226,121,24,29,249,35,0,0 // vbroadcastss 0x23f9(%rip),%xmm3 # 6850 <_sk_callback_avx+0x454> .byte 197,241,254,203 // vpaddd %xmm3,%xmm1,%xmm1 .byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0 .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 @@ -19403,120 +19257,116 @@ _sk_load_f16_avx: .byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,79 // je 4734 <_sk_load_f16_avx+0x316> + .byte 116,79 // je 4676 <_sk_load_f16_avx+0x316> .byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,67 // jb 4734 <_sk_load_f16_avx+0x316> + .byte 114,67 // jb 4676 <_sk_load_f16_avx+0x316> .byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,68 // je 4741 <_sk_load_f16_avx+0x323> + .byte 116,68 // je 4683 <_sk_load_f16_avx+0x323> .byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,56 // jb 4741 <_sk_load_f16_avx+0x323> + .byte 114,56 // jb 4683 <_sk_load_f16_avx+0x323> .byte 197,251,16,76,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm1 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,70,253,255,255 // je 445f <_sk_load_f16_avx+0x41> + .byte 15,132,70,253,255,255 // je 43a1 <_sk_load_f16_avx+0x41> .byte 197,241,22,76,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,54,253,255,255 // jb 445f <_sk_load_f16_avx+0x41> + .byte 15,130,54,253,255,255 // jb 43a1 <_sk_load_f16_avx+0x41> .byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9 - .byte 233,43,253,255,255 // jmpq 445f <_sk_load_f16_avx+0x41> + .byte 233,43,253,255,255 // jmpq 43a1 <_sk_load_f16_avx+0x41> .byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,30,253,255,255 // jmpq 445f <_sk_load_f16_avx+0x41> + .byte 233,30,253,255,255 // jmpq 43a1 <_sk_load_f16_avx+0x41> .byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1 - .byte 233,21,253,255,255 // jmpq 445f <_sk_load_f16_avx+0x41> + .byte 233,21,253,255,255 // jmpq 43a1 <_sk_load_f16_avx+0x41> HIDDEN _sk_gather_f16_avx .globl _sk_gather_f16_avx FUNCTION(_sk_gather_f16_avx) _sk_gather_f16_avx: - .byte 65,87 // push %r15 - .byte 65,86 // push %r14 - .byte 65,85 // push %r13 - .byte 65,84 // push %r12 - .byte 83 // push %rbx - .byte 72,131,236,16 // sub $0x10,%rsp + .byte 72,131,236,24 // sub $0x18,%rsp .byte 197,252,17,124,36,224 // vmovups %ymm7,-0x20(%rsp) .byte 197,252,17,116,36,192 // vmovups %ymm6,-0x40(%rsp) .byte 197,252,17,108,36,160 // vmovups %ymm5,-0x60(%rsp) .byte 197,254,127,100,36,128 // vmovdqu %ymm4,-0x80(%rsp) .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 - .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2 - .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1 - .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3 - .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2 - .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0 - .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3 - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 - .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax + .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1 + .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2 + .byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2 + .byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 196,226,105,64,201 // vpmulld %xmm1,%xmm2,%xmm1 + .byte 197,254,91,208 // vcvttps2dq %ymm0,%ymm2 + .byte 196,227,125,25,208,1 // vextractf128 $0x1,%ymm2,%xmm0 + .byte 197,113,254,192 // vpaddd %xmm0,%xmm1,%xmm8 + .byte 197,225,254,202 // vpaddd %xmm2,%xmm3,%xmm1 + .byte 196,225,249,126,200 // vmovq %xmm1,%rax .byte 65,137,194 // mov %eax,%r10d .byte 72,193,232,32 // shr $0x20,%rax - .byte 196,193,249,126,211 // vmovq %xmm2,%r11 - .byte 69,137,222 // mov %r11d,%r14d - .byte 73,193,235,32 // shr $0x20,%r11 - .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0 - .byte 196,225,249,126,195 // vmovq %xmm0,%rbx - .byte 65,137,223 // mov %ebx,%r15d - .byte 196,195,249,22,196,1 // vpextrq $0x1,%xmm0,%r12 - .byte 69,137,229 // mov %r12d,%r13d - .byte 73,193,236,32 // shr $0x20,%r12 - .byte 72,193,235,32 // shr $0x20,%rbx - .byte 196,193,122,126,4,217 // vmovq (%r9,%rbx,8),%xmm0 - .byte 196,129,122,126,12,249 // vmovq (%r9,%r15,8),%xmm1 - .byte 197,113,108,200 // vpunpcklqdq %xmm0,%xmm1,%xmm9 - .byte 196,129,122,126,12,225 // vmovq (%r9,%r12,8),%xmm1 - .byte 196,129,122,126,20,233 // vmovq (%r9,%r13,8),%xmm2 - .byte 197,233,108,201 // vpunpcklqdq %xmm1,%xmm2,%xmm1 - .byte 196,129,122,126,20,217 // vmovq (%r9,%r11,8),%xmm2 - .byte 196,129,122,126,28,241 // vmovq (%r9,%r14,8),%xmm3 - .byte 197,97,108,210 // vpunpcklqdq %xmm2,%xmm3,%xmm10 - .byte 196,65,122,126,4,193 // vmovq (%r9,%rax,8),%xmm8 - .byte 196,129,122,126,28,209 // vmovq (%r9,%r10,8),%xmm3 - .byte 196,193,97,108,216 // vpunpcklqdq %xmm8,%xmm3,%xmm3 - .byte 197,177,97,193 // vpunpcklwd %xmm1,%xmm9,%xmm0 - .byte 197,177,105,201 // vpunpckhwd %xmm1,%xmm9,%xmm1 - .byte 197,169,97,211 // vpunpcklwd %xmm3,%xmm10,%xmm2 - .byte 197,169,105,219 // vpunpckhwd %xmm3,%xmm10,%xmm3 - .byte 197,121,97,249 // vpunpcklwd %xmm1,%xmm0,%xmm15 - .byte 197,121,105,193 // vpunpckhwd %xmm1,%xmm0,%xmm8 - .byte 197,233,97,203 // vpunpcklwd %xmm3,%xmm2,%xmm1 - .byte 197,105,105,203 // vpunpckhwd %xmm3,%xmm2,%xmm9 - .byte 197,129,108,193 // vpunpcklqdq %xmm1,%xmm15,%xmm0 - .byte 197,233,239,210 // vpxor %xmm2,%xmm2,%xmm2 - .byte 197,249,105,210 // vpunpckhwd %xmm2,%xmm0,%xmm2 + .byte 196,65,122,126,12,193 // vmovq (%r9,%rax,8),%xmm9 + .byte 196,227,249,22,200,1 // vpextrq $0x1,%xmm1,%rax + .byte 196,1,122,126,20,209 // vmovq (%r9,%r10,8),%xmm10 + .byte 65,137,194 // mov %eax,%r10d + .byte 72,193,232,32 // shr $0x20,%rax + .byte 196,65,122,126,28,193 // vmovq (%r9,%rax,8),%xmm11 + .byte 196,97,249,126,192 // vmovq %xmm8,%rax + .byte 196,1,122,126,36,209 // vmovq (%r9,%r10,8),%xmm12 + .byte 65,137,194 // mov %eax,%r10d + .byte 72,193,232,32 // shr $0x20,%rax + .byte 196,65,122,126,44,193 // vmovq (%r9,%rax,8),%xmm13 + .byte 196,67,249,22,195,1 // vpextrq $0x1,%xmm8,%r11 + .byte 196,1,122,126,4,209 // vmovq (%r9,%r10,8),%xmm8 + .byte 76,137,216 // mov %r11,%rax + .byte 72,193,232,32 // shr $0x20,%rax + .byte 196,65,122,126,52,193 // vmovq (%r9,%rax,8),%xmm14 + .byte 68,137,216 // mov %r11d,%eax + .byte 196,193,122,126,4,193 // vmovq (%r9,%rax,8),%xmm0 + .byte 196,193,41,108,209 // vpunpcklqdq %xmm9,%xmm10,%xmm2 + .byte 196,193,25,108,203 // vpunpcklqdq %xmm11,%xmm12,%xmm1 + .byte 196,193,57,108,221 // vpunpcklqdq %xmm13,%xmm8,%xmm3 + .byte 196,193,121,108,198 // vpunpcklqdq %xmm14,%xmm0,%xmm0 + .byte 197,105,97,193 // vpunpcklwd %xmm1,%xmm2,%xmm8 + .byte 197,233,105,209 // vpunpckhwd %xmm1,%xmm2,%xmm2 + .byte 197,225,97,200 // vpunpcklwd %xmm0,%xmm3,%xmm1 + .byte 197,225,105,192 // vpunpckhwd %xmm0,%xmm3,%xmm0 + .byte 197,57,97,250 // vpunpcklwd %xmm2,%xmm8,%xmm15 + .byte 197,57,105,194 // vpunpckhwd %xmm2,%xmm8,%xmm8 + .byte 197,241,97,208 // vpunpcklwd %xmm0,%xmm1,%xmm2 + .byte 197,113,105,200 // vpunpckhwd %xmm0,%xmm1,%xmm9 + .byte 197,129,108,194 // vpunpcklqdq %xmm2,%xmm15,%xmm0 + .byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1 + .byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1 .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 - .byte 196,227,125,24,194,1 // vinsertf128 $0x1,%xmm2,%ymm0,%ymm0 - .byte 196,98,125,24,37,169,32,0,0 // vbroadcastss 0x20a9(%rip),%ymm12 # 6900 <_sk_callback_avx+0x444> - .byte 196,193,124,84,212 // vandps %ymm12,%ymm0,%ymm2 - .byte 197,252,87,194 // vxorps %ymm2,%ymm0,%ymm0 + .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + .byte 196,98,125,24,37,190,32,0,0 // vbroadcastss 0x20be(%rip),%ymm12 # 6854 <_sk_callback_avx+0x458> + .byte 196,193,124,84,204 // vandps %ymm12,%ymm0,%ymm1 + .byte 197,252,87,193 // vxorps %ymm1,%ymm0,%ymm0 .byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14 - .byte 196,98,121,24,29,149,32,0,0 // vbroadcastss 0x2095(%rip),%xmm11 # 6904 <_sk_callback_avx+0x448> + .byte 196,98,121,24,29,170,32,0,0 // vbroadcastss 0x20aa(%rip),%xmm11 # 6858 <_sk_callback_avx+0x45c> .byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3 - .byte 196,98,121,24,45,139,32,0,0 // vbroadcastss 0x208b(%rip),%xmm13 # 6908 <_sk_callback_avx+0x44c> + .byte 196,98,121,24,45,160,32,0,0 // vbroadcastss 0x20a0(%rip),%xmm13 # 685c <_sk_callback_avx+0x460> .byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3 .byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10 .byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10 .byte 196,99,45,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm10,%ymm10 - .byte 197,225,114,242,16 // vpslld $0x10,%xmm2,%xmm3 - .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2 - .byte 197,233,114,242,16 // vpslld $0x10,%xmm2,%xmm2 - .byte 196,227,101,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm3,%ymm2 + .byte 197,225,114,241,16 // vpslld $0x10,%xmm1,%xmm3 + .byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1 + .byte 197,241,114,241,16 // vpslld $0x10,%xmm1,%xmm1 + .byte 196,227,101,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm3,%ymm1 .byte 197,249,114,240,13 // vpslld $0xd,%xmm0,%xmm0 .byte 196,193,97,114,246,13 // vpslld $0xd,%xmm14,%xmm3 .byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0 - .byte 197,252,86,194 // vorps %ymm2,%ymm0,%ymm0 - .byte 196,227,125,25,194,1 // vextractf128 $0x1,%ymm0,%xmm2 - .byte 196,226,121,24,29,65,32,0,0 // vbroadcastss 0x2041(%rip),%xmm3 # 690c <_sk_callback_avx+0x450> - .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2 + .byte 197,252,86,193 // vorps %ymm1,%ymm0,%ymm0 + .byte 196,227,125,25,193,1 // vextractf128 $0x1,%ymm0,%xmm1 + .byte 196,226,121,24,29,86,32,0,0 // vbroadcastss 0x2056(%rip),%xmm3 # 6860 <_sk_callback_avx+0x464> + .byte 197,241,254,203 // vpaddd %xmm3,%xmm1,%xmm1 .byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0 - .byte 196,227,125,24,194,1 // vinsertf128 $0x1,%xmm2,%ymm0,%ymm0 + .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 .byte 196,65,12,87,246 // vxorps %ymm14,%ymm14,%ymm14 .byte 196,195,125,74,198,160 // vblendvps %ymm10,%ymm14,%ymm0,%ymm0 - .byte 197,129,109,201 // vpunpckhqdq %xmm1,%xmm15,%xmm1 + .byte 197,129,109,202 // vpunpckhqdq %xmm2,%xmm15,%xmm1 .byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4 .byte 197,241,105,212 // vpunpckhwd %xmm4,%xmm1,%xmm2 .byte 196,226,121,51,201 // vpmovzxwd %xmm1,%xmm1 @@ -19598,12 +19448,7 @@ _sk_gather_f16_avx: .byte 197,252,16,108,36,160 // vmovups -0x60(%rsp),%ymm5 .byte 197,252,16,116,36,192 // vmovups -0x40(%rsp),%ymm6 .byte 197,252,16,124,36,224 // vmovups -0x20(%rsp),%ymm7 - .byte 72,131,196,16 // add $0x10,%rsp - .byte 91 // pop %rbx - .byte 65,92 // pop %r12 - .byte 65,93 // pop %r13 - .byte 65,94 // pop %r14 - .byte 65,95 // pop %r15 + .byte 72,131,196,24 // add $0x18,%rsp .byte 255,224 // jmpq *%rax HIDDEN _sk_store_f16_avx @@ -19615,12 +19460,12 @@ _sk_store_f16_avx: .byte 197,252,17,52,36 // vmovups %ymm6,(%rsp) .byte 197,252,17,108,36,224 // vmovups %ymm5,-0x20(%rsp) .byte 197,252,17,100,36,192 // vmovups %ymm4,-0x40(%rsp) - .byte 196,98,125,24,13,88,30,0,0 // vbroadcastss 0x1e58(%rip),%ymm9 # 6910 <_sk_callback_avx+0x454> + .byte 196,98,125,24,13,118,30,0,0 // vbroadcastss 0x1e76(%rip),%ymm9 # 6864 <_sk_callback_avx+0x468> .byte 196,65,124,84,209 // vandps %ymm9,%ymm0,%ymm10 .byte 197,252,17,68,36,128 // vmovups %ymm0,-0x80(%rsp) .byte 196,65,124,87,218 // vxorps %ymm10,%ymm0,%ymm11 .byte 196,67,125,25,220,1 // vextractf128 $0x1,%ymm11,%xmm12 - .byte 196,98,121,24,5,61,30,0,0 // vbroadcastss 0x1e3d(%rip),%xmm8 # 6914 <_sk_callback_avx+0x458> + .byte 196,98,121,24,5,91,30,0,0 // vbroadcastss 0x1e5b(%rip),%xmm8 # 6868 <_sk_callback_avx+0x46c> .byte 196,65,57,102,236 // vpcmpgtd %xmm12,%xmm8,%xmm13 .byte 196,65,57,102,243 // vpcmpgtd %xmm11,%xmm8,%xmm14 .byte 196,67,13,24,237,1 // vinsertf128 $0x1,%xmm13,%ymm14,%ymm13 @@ -19630,7 +19475,7 @@ _sk_store_f16_avx: .byte 196,67,13,24,242,1 // vinsertf128 $0x1,%xmm10,%ymm14,%ymm14 .byte 196,193,33,114,211,13 // vpsrld $0xd,%xmm11,%xmm11 .byte 196,193,25,114,212,13 // vpsrld $0xd,%xmm12,%xmm12 - .byte 196,98,125,24,21,4,30,0,0 // vbroadcastss 0x1e04(%rip),%ymm10 # 6918 <_sk_callback_avx+0x45c> + .byte 196,98,125,24,21,34,30,0,0 // vbroadcastss 0x1e22(%rip),%ymm10 # 686c <_sk_callback_avx+0x470> .byte 196,65,12,86,242 // vorps %ymm10,%ymm14,%ymm14 .byte 196,67,125,25,247,1 // vextractf128 $0x1,%ymm14,%xmm15 .byte 196,65,1,254,228 // vpaddd %xmm12,%xmm15,%xmm12 @@ -19712,7 +19557,7 @@ _sk_store_f16_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,66 // jne 4cf2 <_sk_store_f16_avx+0x25e> + .byte 117,66 // jne 4c28 <_sk_store_f16_avx+0x25e> .byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8) .byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8) .byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8) @@ -19728,22 +19573,22 @@ _sk_store_f16_avx: .byte 255,224 // jmpq *%rax .byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,202 // je 4cc7 <_sk_store_f16_avx+0x233> + .byte 116,202 // je 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,190 // jb 4cc7 <_sk_store_f16_avx+0x233> + .byte 114,190 // jb 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8) - .byte 116,182 // je 4cc7 <_sk_store_f16_avx+0x233> + .byte 116,182 // je 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,170 // jb 4cc7 <_sk_store_f16_avx+0x233> + .byte 114,170 // jb 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8) - .byte 116,162 // je 4cc7 <_sk_store_f16_avx+0x233> + .byte 116,162 // je 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,150 // jb 4cc7 <_sk_store_f16_avx+0x233> + .byte 114,150 // jb 4bfd <_sk_store_f16_avx+0x233> .byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8) - .byte 235,142 // jmp 4cc7 <_sk_store_f16_avx+0x233> + .byte 235,142 // jmp 4bfd <_sk_store_f16_avx+0x233> HIDDEN _sk_load_u16_be_avx .globl _sk_load_u16_be_avx @@ -19753,7 +19598,7 @@ _sk_load_u16_be_avx: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,253,0,0,0 // jne 4e4c <_sk_load_u16_be_avx+0x113> + .byte 15,133,253,0,0,0 // jne 4d82 <_sk_load_u16_be_avx+0x113> .byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8 .byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2 .byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3 @@ -19775,7 +19620,7 @@ _sk_load_u16_be_avx: .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,29,92,27,0,0 // vbroadcastss 0x1b5c(%rip),%ymm11 # 691c <_sk_callback_avx+0x460> + .byte 196,98,125,24,29,122,27,0,0 // vbroadcastss 0x1b7a(%rip),%ymm11 # 6870 <_sk_callback_avx+0x474> .byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0 .byte 197,177,109,202 // vpunpckhqdq %xmm2,%xmm9,%xmm1 .byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2 @@ -19809,29 +19654,29 @@ _sk_load_u16_be_avx: .byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8 .byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,85 // je 4eb2 <_sk_load_u16_be_avx+0x179> + .byte 116,85 // je 4de8 <_sk_load_u16_be_avx+0x179> .byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,72 // jb 4eb2 <_sk_load_u16_be_avx+0x179> + .byte 114,72 // jb 4de8 <_sk_load_u16_be_avx+0x179> .byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 116,72 // je 4ebf <_sk_load_u16_be_avx+0x186> + .byte 116,72 // je 4df5 <_sk_load_u16_be_avx+0x186> .byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,59 // jb 4ebf <_sk_load_u16_be_avx+0x186> + .byte 114,59 // jb 4df5 <_sk_load_u16_be_avx+0x186> .byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 15,132,213,254,255,255 // je 4d6a <_sk_load_u16_be_avx+0x31> + .byte 15,132,213,254,255,255 // je 4ca0 <_sk_load_u16_be_avx+0x31> .byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 15,130,196,254,255,255 // jb 4d6a <_sk_load_u16_be_avx+0x31> + .byte 15,130,196,254,255,255 // jb 4ca0 <_sk_load_u16_be_avx+0x31> .byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9 - .byte 233,184,254,255,255 // jmpq 4d6a <_sk_load_u16_be_avx+0x31> + .byte 233,184,254,255,255 // jmpq 4ca0 <_sk_load_u16_be_avx+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 .byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2 - .byte 233,171,254,255,255 // jmpq 4d6a <_sk_load_u16_be_avx+0x31> + .byte 233,171,254,255,255 // jmpq 4ca0 <_sk_load_u16_be_avx+0x31> .byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3 - .byte 233,162,254,255,255 // jmpq 4d6a <_sk_load_u16_be_avx+0x31> + .byte 233,162,254,255,255 // jmpq 4ca0 <_sk_load_u16_be_avx+0x31> HIDDEN _sk_load_rgb_u16_be_avx .globl _sk_load_rgb_u16_be_avx @@ -19841,7 +19686,7 @@ _sk_load_rgb_u16_be_avx: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,243,0,0,0 // jne 4fcd <_sk_load_rgb_u16_be_avx+0x105> + .byte 15,133,243,0,0,0 // jne 4f03 <_sk_load_rgb_u16_be_avx+0x105> .byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0 .byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2 .byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1 @@ -19868,7 +19713,7 @@ _sk_load_rgb_u16_be_avx: .byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0 .byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0 - .byte 196,98,125,24,29,188,25,0,0 // vbroadcastss 0x19bc(%rip),%ymm11 # 6920 <_sk_callback_avx+0x464> + .byte 196,98,125,24,29,218,25,0,0 // vbroadcastss 0x19da(%rip),%ymm11 # 6874 <_sk_callback_avx+0x478> .byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0 .byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1 .byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2 @@ -19889,41 +19734,41 @@ _sk_load_rgb_u16_be_avx: .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2 .byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,29,89,25,0,0 // vbroadcastss 0x1959(%rip),%ymm3 # 6924 <_sk_callback_avx+0x468> + .byte 196,226,125,24,29,119,25,0,0 // vbroadcastss 0x1977(%rip),%ymm3 # 6878 <_sk_callback_avx+0x47c> .byte 255,224 // jmpq *%rax .byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0 .byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,5 // jne 4fe6 <_sk_load_rgb_u16_be_avx+0x11e> - .byte 233,40,255,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> + .byte 117,5 // jne 4f1c <_sk_load_rgb_u16_be_avx+0x11e> + .byte 233,40,255,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> .byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1 .byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,26 // jb 5015 <_sk_load_rgb_u16_be_avx+0x14d> + .byte 114,26 // jb 4f4b <_sk_load_rgb_u16_be_avx+0x14d> .byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1 .byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 117,10 // jne 501a <_sk_load_rgb_u16_be_avx+0x152> - .byte 233,249,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> - .byte 233,244,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> + .byte 117,10 // jne 4f50 <_sk_load_rgb_u16_be_avx+0x152> + .byte 233,249,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> + .byte 233,244,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> .byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1 .byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,26 // jb 5049 <_sk_load_rgb_u16_be_avx+0x181> + .byte 114,26 // jb 4f7f <_sk_load_rgb_u16_be_avx+0x181> .byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1 .byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1 .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 117,10 // jne 504e <_sk_load_rgb_u16_be_avx+0x186> - .byte 233,197,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> - .byte 233,192,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> + .byte 117,10 // jne 4f84 <_sk_load_rgb_u16_be_avx+0x186> + .byte 233,197,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> + .byte 233,192,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> .byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3 .byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11 .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,20 // jb 5077 <_sk_load_rgb_u16_be_avx+0x1af> + .byte 114,20 // jb 4fad <_sk_load_rgb_u16_be_avx+0x1af> .byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3 .byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3 - .byte 233,151,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> - .byte 233,146,254,255,255 // jmpq 4f0e <_sk_load_rgb_u16_be_avx+0x46> + .byte 233,151,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> + .byte 233,146,254,255,255 // jmpq 4e44 <_sk_load_rgb_u16_be_avx+0x46> HIDDEN _sk_store_u16_be_avx .globl _sk_store_u16_be_avx @@ -19932,7 +19777,7 @@ _sk_store_u16_be_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax - .byte 196,98,125,24,5,150,24,0,0 // vbroadcastss 0x1896(%rip),%ymm8 # 6928 <_sk_callback_avx+0x46c> + .byte 196,98,125,24,5,180,24,0,0 // vbroadcastss 0x18b4(%rip),%ymm8 # 687c <_sk_callback_avx+0x480> .byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9 .byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9 .byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10 @@ -19970,7 +19815,7 @@ _sk_store_u16_be_avx: .byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9 .byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,31 // jne 5176 <_sk_store_u16_be_avx+0xfa> + .byte 117,31 // jne 50ac <_sk_store_u16_be_avx+0xfa> .byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2) .byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2) .byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2) @@ -19979,22 +19824,22 @@ _sk_store_u16_be_avx: .byte 255,224 // jmpq *%rax .byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 5172 <_sk_store_u16_be_avx+0xf6> + .byte 116,240 // je 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 5172 <_sk_store_u16_be_avx+0xf6> + .byte 114,227 // jb 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2) - .byte 116,218 // je 5172 <_sk_store_u16_be_avx+0xf6> + .byte 116,218 // je 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,205 // jb 5172 <_sk_store_u16_be_avx+0xf6> + .byte 114,205 // jb 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2) - .byte 116,196 // je 5172 <_sk_store_u16_be_avx+0xf6> + .byte 116,196 // je 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,183 // jb 5172 <_sk_store_u16_be_avx+0xf6> + .byte 114,183 // jb 50a8 <_sk_store_u16_be_avx+0xf6> .byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2) - .byte 235,174 // jmp 5172 <_sk_store_u16_be_avx+0xf6> + .byte 235,174 // jmp 50a8 <_sk_store_u16_be_avx+0xf6> HIDDEN _sk_load_f32_avx .globl _sk_load_f32_avx @@ -20002,10 +19847,10 @@ FUNCTION(_sk_load_f32_avx) _sk_load_f32_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 119,110 // ja 523a <_sk_load_f32_avx+0x76> + .byte 119,110 // ja 5170 <_sk_load_f32_avx+0x76> .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 - .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 5264 <_sk_load_f32_avx+0xa0> + .byte 76,141,29,132,0,0,0 // lea 0x84(%rip),%r11 # 5198 <_sk_load_f32_avx+0x9e> .byte 75,99,4,131 // movslq (%r11,%r8,4),%rax .byte 76,1,216 // add %r11,%rax .byte 255,224 // jmpq *%rax @@ -20031,19 +19876,19 @@ _sk_load_f32_avx: .byte 196,193,101,21,216 // vunpckhpd %ymm8,%ymm3,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax - .byte 102,144 // xchg %ax,%ax - .byte 131,255,255 // cmp $0xffffffff,%edi - .byte 255,202 // dec %edx + .byte 133,255 // test %edi,%edi .byte 255 // (bad) + .byte 255,204 // dec %esp .byte 255 // (bad) .byte 255 // (bad) - .byte 189,255,255,255,176 // mov $0xb0ffffff,%ebp .byte 255 // (bad) + .byte 191,255,255,255,178 // mov $0xb2ffffff,%edi .byte 255 // (bad) - .byte 255,163,255,255,255,155 // jmpq *-0x64000001(%rbx) .byte 255 // (bad) + .byte 255,165,255,255,255,157 // jmpq *-0x62000001(%rbp) .byte 255 // (bad) - .byte 255,147,255,255,255,139 // callq *-0x74000001(%rbx) + .byte 255 // (bad) + .byte 255,149,255,255,255,141 // callq *-0x72000001(%rbp) .byte 255 // (bad) .byte 255 // (bad) .byte 255 // .byte 0xff @@ -20064,7 +19909,7 @@ _sk_store_f32_avx: .byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8 .byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11 .byte 77,133,192 // test %r8,%r8 - .byte 117,55 // jne 52f1 <_sk_store_f32_avx+0x6d> + .byte 117,55 // jne 5225 <_sk_store_f32_avx+0x6d> .byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12 .byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13 .byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9 @@ -20077,22 +19922,22 @@ _sk_store_f32_avx: .byte 255,224 // jmpq *%rax .byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 52ed <_sk_store_f32_avx+0x69> + .byte 116,240 // je 5221 <_sk_store_f32_avx+0x69> .byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 52ed <_sk_store_f32_avx+0x69> + .byte 114,227 // jb 5221 <_sk_store_f32_avx+0x69> .byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4) - .byte 116,218 // je 52ed <_sk_store_f32_avx+0x69> + .byte 116,218 // je 5221 <_sk_store_f32_avx+0x69> .byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4) .byte 73,131,248,5 // cmp $0x5,%r8 - .byte 114,205 // jb 52ed <_sk_store_f32_avx+0x69> + .byte 114,205 // jb 5221 <_sk_store_f32_avx+0x69> .byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4) - .byte 116,195 // je 52ed <_sk_store_f32_avx+0x69> + .byte 116,195 // je 5221 <_sk_store_f32_avx+0x69> .byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4) .byte 73,131,248,7 // cmp $0x7,%r8 - .byte 114,181 // jb 52ed <_sk_store_f32_avx+0x69> + .byte 114,181 // jb 5221 <_sk_store_f32_avx+0x69> .byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4) - .byte 235,171 // jmp 52ed <_sk_store_f32_avx+0x69> + .byte 235,171 // jmp 5221 <_sk_store_f32_avx+0x69> HIDDEN _sk_clamp_x_avx .globl _sk_clamp_x_avx @@ -20196,7 +20041,7 @@ FUNCTION(_sk_clamp_x_1_avx) _sk_clamp_x_1_avx: .byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8 .byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0 - .byte 196,98,125,24,5,198,20,0,0 // vbroadcastss 0x14c6(%rip),%ymm8 # 692c <_sk_callback_avx+0x470> + .byte 196,98,125,24,5,230,20,0,0 // vbroadcastss 0x14e6(%rip),%ymm8 # 6880 <_sk_callback_avx+0x484> .byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -20214,9 +20059,9 @@ HIDDEN _sk_mirror_x_1_avx .globl _sk_mirror_x_1_avx FUNCTION(_sk_mirror_x_1_avx) _sk_mirror_x_1_avx: - .byte 196,98,125,24,5,169,20,0,0 // vbroadcastss 0x14a9(%rip),%ymm8 # 6930 <_sk_callback_avx+0x474> + .byte 196,98,125,24,5,201,20,0,0 // vbroadcastss 0x14c9(%rip),%ymm8 # 6884 <_sk_callback_avx+0x488> .byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,13,159,20,0,0 // vbroadcastss 0x149f(%rip),%ymm9 # 6934 <_sk_callback_avx+0x478> + .byte 196,98,125,24,13,191,20,0,0 // vbroadcastss 0x14bf(%rip),%ymm9 # 6888 <_sk_callback_avx+0x48c> .byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9 .byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9 .byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9 @@ -20232,12 +20077,12 @@ HIDDEN _sk_luminance_to_alpha_avx .globl _sk_luminance_to_alpha_avx FUNCTION(_sk_luminance_to_alpha_avx) _sk_luminance_to_alpha_avx: - .byte 196,226,125,24,29,111,20,0,0 // vbroadcastss 0x146f(%rip),%ymm3 # 6938 <_sk_callback_avx+0x47c> + .byte 196,226,125,24,29,143,20,0,0 // vbroadcastss 0x148f(%rip),%ymm3 # 688c <_sk_callback_avx+0x490> .byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0 - .byte 196,226,125,24,29,102,20,0,0 // vbroadcastss 0x1466(%rip),%ymm3 # 693c <_sk_callback_avx+0x480> + .byte 196,226,125,24,29,134,20,0,0 // vbroadcastss 0x1486(%rip),%ymm3 # 6890 <_sk_callback_avx+0x494> .byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1 .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 - .byte 196,226,125,24,13,89,20,0,0 // vbroadcastss 0x1459(%rip),%ymm1 # 6940 <_sk_callback_avx+0x484> + .byte 196,226,125,24,13,121,20,0,0 // vbroadcastss 0x1479(%rip),%ymm1 # 6894 <_sk_callback_avx+0x498> .byte 197,236,89,201 // vmulps %ymm1,%ymm2,%ymm1 .byte 197,252,88,217 // vaddps %ymm1,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax @@ -20452,13 +20297,14 @@ _sk_evenly_spaced_gradient_avx: .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx + .byte 197,252,17,124,36,216 // vmovups %ymm7,-0x28(%rsp) .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,24 // mov (%rax),%rbx .byte 72,139,104,8 // mov 0x8(%rax),%rbp .byte 72,255,203 // dec %rbx - .byte 120,7 // js 583d <_sk_evenly_spaced_gradient_avx+0x1f> + .byte 120,7 // js 5777 <_sk_evenly_spaced_gradient_avx+0x25> .byte 196,225,242,42,203 // vcvtsi2ss %rbx,%xmm1,%xmm1 - .byte 235,21 // jmp 5852 <_sk_evenly_spaced_gradient_avx+0x34> + .byte 235,21 // jmp 578c <_sk_evenly_spaced_gradient_avx+0x3a> .byte 73,137,217 // mov %rbx,%r9 .byte 73,209,233 // shr %r9 .byte 131,227,1 // and $0x1,%ebx @@ -20485,124 +20331,125 @@ _sk_evenly_spaced_gradient_avx: .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 - .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,99,109,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm8 + .byte 196,33,122,16,68,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm8 + .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 + .byte 196,35,97,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm9 + .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 + .byte 196,33,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm11 + .byte 196,99,113,33,226,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm12 .byte 72,139,104,40 // mov 0x28(%rax),%rbp .byte 196,161,122,16,84,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm2 - .byte 196,227,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm2 + .byte 196,99,105,33,108,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm13 .byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 - .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1 - .byte 196,227,97,33,201,32 // vinsertps $0x20,%xmm1,%xmm3,%xmm1 - .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1 - .byte 196,99,117,24,226,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm12 + .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1 + .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 + .byte 196,35,105,33,116,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm14 + .byte 196,33,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm15 + .byte 196,33,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm10 + .byte 196,67,25,33,192,48 // vinsertps $0x30,%xmm8,%xmm12,%xmm8 + .byte 196,227,49,33,215,32 // vinsertps $0x20,%xmm7,%xmm9,%xmm2 + .byte 196,195,105,33,211,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm2 + .byte 196,67,109,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm2,%ymm8 + .byte 196,227,17,33,211,32 // vinsertps $0x20,%xmm3,%xmm13,%xmm2 + .byte 196,99,105,33,201,48 // vinsertps $0x30,%xmm1,%xmm2,%xmm9 .byte 72,139,104,16 // mov 0x10(%rax),%rbp - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3 - .byte 196,227,113,33,203,32 // vinsertps $0x20,%xmm3,%xmm1,%xmm1 - .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3 - .byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1 - .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 - .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - .byte 196,161,122,16,84,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm2 - .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2 - .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,99,109,24,233,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm13 + .byte 196,161,122,16,84,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm2 + .byte 196,99,105,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1 + .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7 + .byte 196,163,65,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 + .byte 196,33,122,16,108,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm13 + .byte 196,195,9,33,215,32 // vinsertps $0x20,%xmm15,%xmm14,%xmm2 + .byte 196,195,105,33,210,48 // vinsertps $0x30,%xmm10,%xmm2,%xmm2 + .byte 196,67,109,24,241,1 // vinsertf128 $0x1,%xmm9,%ymm2,%ymm14 + .byte 196,195,33,33,212,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm2 + .byte 196,99,105,33,201,48 // vinsertps $0x30,%xmm1,%xmm2,%xmm9 + .byte 196,99,65,33,211,32 // vinsertps $0x20,%xmm3,%xmm7,%xmm10 .byte 72,139,104,48 // mov 0x30(%rax),%rbp - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 + .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3 + .byte 196,99,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + .byte 196,33,122,16,124,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm15 + .byte 196,33,122,16,100,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm12 .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 + .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,99,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm9 + .byte 196,67,41,33,213,48 // vinsertps $0x30,%xmm13,%xmm10,%xmm10 + .byte 196,67,45,24,233,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm13 + .byte 196,195,33,33,207,32 // vinsertps $0x20,%xmm15,%xmm11,%xmm1 + .byte 196,67,113,33,204,48 // vinsertps $0x30,%xmm12,%xmm1,%xmm9 + .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2 + .byte 196,99,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm10 .byte 72,139,104,24 // mov 0x18(%rax),%rbp - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 + .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3 + .byte 196,99,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15 .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 + .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 + .byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 + .byte 196,195,33,33,204,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm1 + .byte 196,195,113,33,207,48 // vinsertps $0x30,%xmm15,%xmm1,%xmm1 .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 + .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 .byte 196,99,109,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm10 .byte 72,139,104,56 // mov 0x38(%rax),%rbp .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 + .byte 196,99,113,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15 + .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7 + .byte 196,163,65,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1 + .byte 196,161,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm2 + .byte 196,195,33,33,220,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm3 + .byte 196,195,97,33,223,48 // vinsertps $0x30,%xmm15,%xmm3,%xmm3 + .byte 196,227,65,33,201,32 // vinsertps $0x20,%xmm1,%xmm7,%xmm1 .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 - .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,99,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm11 + .byte 196,99,117,24,219,1 // vinsertf128 $0x1,%xmm3,%ymm1,%ymm11 .byte 72,139,104,32 // mov 0x20(%rax),%rbp .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 - .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 + .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 + .byte 196,35,97,33,100,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm12 + .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 - .byte 196,99,109,24,241,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm14 + .byte 196,99,113,33,250,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm15 .byte 72,139,64,64 // mov 0x40(%rax),%rax - .byte 196,161,122,16,12,168 // vmovss (%rax,%r13,4),%xmm1 - .byte 196,227,113,33,12,152,16 // vinsertps $0x10,(%rax,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,20,184 // vmovss (%rax,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,20,160 // vmovss (%rax,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,20,176 // vmovss (%rax,%r14,4),%xmm2 - .byte 196,163,105,33,20,152,16 // vinsertps $0x10,(%rax,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,28,144 // vmovss (%rax,%r10,4),%xmm3 - .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 - .byte 196,161,122,16,28,136 // vmovss (%rax,%r9,4),%xmm3 - .byte 196,227,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm2 + .byte 196,161,122,16,20,168 // vmovss (%rax,%r13,4),%xmm2 + .byte 196,227,105,33,20,152,16 // vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2 + .byte 196,227,25,33,255,32 // vinsertps $0x20,%xmm7,%xmm12,%xmm7 + .byte 196,161,122,16,12,184 // vmovss (%rax,%r15,4),%xmm1 + .byte 196,227,65,33,219,48 // vinsertps $0x30,%xmm3,%xmm7,%xmm3 + .byte 196,161,122,16,60,160 // vmovss (%rax,%r12,4),%xmm7 + .byte 196,67,101,24,231,1 // vinsertf128 $0x1,%xmm15,%ymm3,%ymm12 + .byte 196,161,122,16,28,176 // vmovss (%rax,%r14,4),%xmm3 + .byte 196,163,97,33,28,152,16 // vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3 + .byte 196,227,105,33,201,32 // vinsertps $0x20,%xmm1,%xmm2,%xmm1 + .byte 196,161,122,16,20,144 // vmovss (%rax,%r10,4),%xmm2 + .byte 196,227,113,33,207,48 // vinsertps $0x30,%xmm7,%xmm1,%xmm1 + .byte 196,161,122,16,60,136 // vmovss (%rax,%r9,4),%xmm7 + .byte 196,227,97,33,210,32 // vinsertps $0x20,%xmm2,%xmm3,%xmm2 + .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 .byte 196,227,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm3 .byte 197,188,89,200 // vmulps %ymm0,%ymm8,%ymm1 - .byte 196,65,116,88,196 // vaddps %ymm12,%ymm1,%ymm8 + .byte 196,65,116,88,198 // vaddps %ymm14,%ymm1,%ymm8 .byte 197,148,89,200 // vmulps %ymm0,%ymm13,%ymm1 .byte 196,193,116,88,201 // vaddps %ymm9,%ymm1,%ymm1 .byte 197,172,89,208 // vmulps %ymm0,%ymm10,%ymm2 .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 - .byte 197,140,89,192 // vmulps %ymm0,%ymm14,%ymm0 + .byte 197,156,89,192 // vmulps %ymm0,%ymm12,%ymm0 .byte 197,252,88,219 // vaddps %ymm3,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,124,41,192 // vmovaps %ymm8,%ymm0 + .byte 197,252,16,124,36,216 // vmovups -0x28(%rsp),%ymm7 .byte 91 // pop %rbx .byte 65,92 // pop %r12 .byte 65,93 // pop %r13 @@ -20615,18 +20462,18 @@ HIDDEN _sk_gauss_a_to_rgba_avx .globl _sk_gauss_a_to_rgba_avx FUNCTION(_sk_gauss_a_to_rgba_avx) _sk_gauss_a_to_rgba_avx: - .byte 196,226,125,24,5,148,13,0,0 // vbroadcastss 0xd94(%rip),%ymm0 # 6944 <_sk_callback_avx+0x488> + .byte 196,226,125,24,5,168,13,0,0 // vbroadcastss 0xda8(%rip),%ymm0 # 6898 <_sk_callback_avx+0x49c> .byte 197,228,89,192 // vmulps %ymm0,%ymm3,%ymm0 - .byte 196,226,125,24,13,139,13,0,0 // vbroadcastss 0xd8b(%rip),%ymm1 # 6948 <_sk_callback_avx+0x48c> + .byte 196,226,125,24,13,159,13,0,0 // vbroadcastss 0xd9f(%rip),%ymm1 # 689c <_sk_callback_avx+0x4a0> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0 - .byte 196,226,125,24,13,126,13,0,0 // vbroadcastss 0xd7e(%rip),%ymm1 # 694c <_sk_callback_avx+0x490> + .byte 196,226,125,24,13,146,13,0,0 // vbroadcastss 0xd92(%rip),%ymm1 # 68a0 <_sk_callback_avx+0x4a4> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0 - .byte 196,226,125,24,13,113,13,0,0 // vbroadcastss 0xd71(%rip),%ymm1 # 6950 <_sk_callback_avx+0x494> + .byte 196,226,125,24,13,133,13,0,0 // vbroadcastss 0xd85(%rip),%ymm1 # 68a4 <_sk_callback_avx+0x4a8> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0 - .byte 196,226,125,24,13,100,13,0,0 // vbroadcastss 0xd64(%rip),%ymm1 # 6954 <_sk_callback_avx+0x498> + .byte 196,226,125,24,13,120,13,0,0 // vbroadcastss 0xd78(%rip),%ymm1 # 68a8 <_sk_callback_avx+0x4ac> .byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,252,40,200 // vmovaps %ymm0,%ymm1 @@ -20649,12 +20496,12 @@ _sk_gradient_avx: .byte 76,139,8 // mov (%rax),%r9 .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 73,131,249,2 // cmp $0x2,%r9 - .byte 114,80 // jb 5c73 <_sk_gradient_avx+0x6f> + .byte 114,80 // jb 5bb3 <_sk_gradient_avx+0x6f> .byte 72,139,88,72 // mov 0x48(%rax),%rbx .byte 73,255,201 // dec %r9 .byte 72,131,195,4 // add $0x4,%rbx .byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9 - .byte 196,98,125,24,21,28,13,0,0 // vbroadcastss 0xd1c(%rip),%ymm10 # 6958 <_sk_callback_avx+0x49c> + .byte 196,98,125,24,21,48,13,0,0 // vbroadcastss 0xd30(%rip),%ymm10 # 68ac <_sk_callback_avx+0x4b0> .byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1 .byte 196,98,125,24,3 // vbroadcastss (%rbx),%ymm8 .byte 197,60,194,192,2 // vcmpleps %ymm0,%ymm8,%ymm8 @@ -20666,7 +20513,7 @@ _sk_gradient_avx: .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1 .byte 72,131,195,4 // add $0x4,%rbx .byte 73,255,201 // dec %r9 - .byte 117,205 // jne 5c40 <_sk_gradient_avx+0x3c> + .byte 117,205 // jne 5b80 <_sk_gradient_avx+0x3c> .byte 196,195,249,22,201,1 // vpextrq $0x1,%xmm1,%r9 .byte 69,137,202 // mov %r9d,%r10d .byte 73,193,233,32 // shr $0x20,%r9 @@ -20684,105 +20531,105 @@ _sk_gradient_avx: .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,99,113,33,194,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm8 - .byte 196,33,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm9 + .byte 196,33,122,16,68,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm8 .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 - .byte 196,35,97,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm10 - .byte 196,33,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm11 - .byte 196,33,122,16,100,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm12 + .byte 196,35,97,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm9 + .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 + .byte 196,33,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm11 + .byte 196,99,113,33,226,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm12 .byte 72,139,104,40 // mov 0x28(%rax),%rbp - .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3 - .byte 196,99,97,33,108,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm13 - .byte 196,33,122,16,116,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm14 - .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15 - .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 - .byte 196,163,97,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm7 - .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1 - .byte 196,161,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm2 - .byte 72,139,104,16 // mov 0x10(%rax),%rbp - .byte 196,67,57,33,193,48 // vinsertps $0x30,%xmm9,%xmm8,%xmm8 - .byte 196,195,41,33,219,32 // vinsertps $0x20,%xmm11,%xmm10,%xmm3 - .byte 196,195,97,33,220,48 // vinsertps $0x30,%xmm12,%xmm3,%xmm3 - .byte 196,67,101,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm3,%ymm8 - .byte 196,195,17,33,222,32 // vinsertps $0x20,%xmm14,%xmm13,%xmm3 - .byte 196,195,97,33,223,48 // vinsertps $0x30,%xmm15,%xmm3,%xmm3 - .byte 196,227,65,33,201,32 // vinsertps $0x20,%xmm1,%xmm7,%xmm1 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,99,117,24,227,1 // vinsertf128 $0x1,%xmm3,%ymm1,%ymm12 - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 + .byte 196,161,122,16,84,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm2 + .byte 196,99,105,33,108,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm13 .byte 196,161,122,16,92,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm3 - .byte 196,227,113,33,203,32 // vinsertps $0x20,%xmm3,%xmm1,%xmm1 - .byte 196,161,122,16,92,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm3 - .byte 196,227,113,33,203,48 // vinsertps $0x30,%xmm3,%xmm1,%xmm1 - .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 - .byte 196,163,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 - .byte 196,227,97,33,223,32 // vinsertps $0x20,%xmm7,%xmm3,%xmm3 - .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 - .byte 196,227,97,33,223,48 // vinsertps $0x30,%xmm7,%xmm3,%xmm3 - .byte 196,99,101,24,233,1 // vinsertf128 $0x1,%xmm1,%ymm3,%ymm13 - .byte 72,139,104,48 // mov 0x30(%rax),%rbp - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,124,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm7 - .byte 196,227,113,33,207,32 // vinsertps $0x20,%xmm7,%xmm1,%xmm1 - .byte 196,161,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm7 - .byte 196,227,113,33,207,48 // vinsertps $0x30,%xmm7,%xmm1,%xmm1 + .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1 + .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 + .byte 196,35,105,33,116,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm14 + .byte 196,33,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm15 + .byte 196,33,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm10 + .byte 196,67,25,33,192,48 // vinsertps $0x30,%xmm8,%xmm12,%xmm8 + .byte 196,227,49,33,215,32 // vinsertps $0x20,%xmm7,%xmm9,%xmm2 + .byte 196,195,105,33,211,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm2 + .byte 196,67,109,24,192,1 // vinsertf128 $0x1,%xmm8,%ymm2,%ymm8 + .byte 196,227,17,33,211,32 // vinsertps $0x20,%xmm3,%xmm13,%xmm2 + .byte 196,99,105,33,201,48 // vinsertps $0x30,%xmm1,%xmm2,%xmm9 + .byte 72,139,104,16 // mov 0x10(%rax),%rbp + .byte 196,161,122,16,84,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm2 + .byte 196,99,105,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,161,122,16,76,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm1 .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7 .byte 196,163,65,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 - .byte 196,161,122,16,84,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm2 - .byte 196,227,65,33,210,32 // vinsertps $0x20,%xmm2,%xmm7,%xmm2 - .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 - .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 - .byte 196,99,109,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm9 - .byte 72,139,104,24 // mov 0x18(%rax),%rbp - .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 + .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 + .byte 196,33,122,16,108,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm13 + .byte 196,195,9,33,215,32 // vinsertps $0x20,%xmm15,%xmm14,%xmm2 + .byte 196,195,105,33,210,48 // vinsertps $0x30,%xmm10,%xmm2,%xmm2 + .byte 196,67,109,24,241,1 // vinsertf128 $0x1,%xmm9,%ymm2,%ymm14 + .byte 196,195,33,33,212,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm2 + .byte 196,99,105,33,201,48 // vinsertps $0x30,%xmm1,%xmm2,%xmm9 + .byte 196,99,65,33,211,32 // vinsertps $0x20,%xmm3,%xmm7,%xmm10 + .byte 72,139,104,48 // mov 0x30(%rax),%rbp + .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3 + .byte 196,99,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + .byte 196,33,122,16,124,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm15 + .byte 196,33,122,16,100,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm12 .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 + .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 + .byte 196,67,41,33,213,48 // vinsertps $0x30,%xmm13,%xmm10,%xmm10 + .byte 196,67,45,24,233,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm13 + .byte 196,195,33,33,207,32 // vinsertps $0x20,%xmm15,%xmm11,%xmm1 + .byte 196,67,113,33,204,48 // vinsertps $0x30,%xmm12,%xmm1,%xmm9 .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2 + .byte 196,99,105,33,211,48 // vinsertps $0x30,%xmm3,%xmm2,%xmm10 + .byte 72,139,104,24 // mov 0x18(%rax),%rbp + .byte 196,161,122,16,92,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm3 + .byte 196,99,97,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15 + .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 + .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 + .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 + .byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 + .byte 196,195,33,33,204,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm1 + .byte 196,195,113,33,207,48 // vinsertps $0x30,%xmm15,%xmm1,%xmm1 + .byte 196,227,105,33,211,32 // vinsertps $0x20,%xmm3,%xmm2,%xmm2 .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 .byte 196,99,109,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm10 .byte 72,139,104,56 // mov 0x38(%rax),%rbp .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 - .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 - .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 + .byte 196,99,113,33,92,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm11 + .byte 196,33,122,16,100,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm12 + .byte 196,33,122,16,124,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm15 + .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7 + .byte 196,163,65,33,124,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + .byte 196,161,122,16,76,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm1 + .byte 196,161,122,16,84,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm2 + .byte 196,195,33,33,220,32 // vinsertps $0x20,%xmm12,%xmm11,%xmm3 + .byte 196,195,97,33,223,48 // vinsertps $0x30,%xmm15,%xmm3,%xmm3 + .byte 196,227,65,33,201,32 // vinsertps $0x20,%xmm1,%xmm7,%xmm1 .byte 196,227,113,33,202,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm1 - .byte 196,161,122,16,84,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm2 - .byte 196,163,105,33,84,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 - .byte 196,227,105,33,215,32 // vinsertps $0x20,%xmm7,%xmm2,%xmm2 - .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 - .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 - .byte 196,99,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm11 + .byte 196,99,117,24,219,1 // vinsertf128 $0x1,%xmm3,%ymm1,%ymm11 .byte 72,139,104,32 // mov 0x20(%rax),%rbp .byte 196,161,122,16,76,173,0 // vmovss 0x0(%rbp,%r13,4),%xmm1 .byte 196,227,113,33,76,157,0,16 // vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 .byte 196,161,122,16,84,189,0 // vmovss 0x0(%rbp,%r15,4),%xmm2 .byte 196,227,113,33,202,32 // vinsertps $0x20,%xmm2,%xmm1,%xmm1 .byte 196,161,122,16,84,165,0 // vmovss 0x0(%rbp,%r12,4),%xmm2 - .byte 196,161,122,16,124,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm7 - .byte 196,35,65,33,116,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm14 - .byte 196,161,122,16,92,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm3 - .byte 196,161,122,16,124,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm7 + .byte 196,161,122,16,92,181,0 // vmovss 0x0(%rbp,%r14,4),%xmm3 + .byte 196,35,97,33,100,157,0,16 // vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm12 + .byte 196,161,122,16,124,149,0 // vmovss 0x0(%rbp,%r10,4),%xmm7 + .byte 196,161,122,16,92,141,0 // vmovss 0x0(%rbp,%r9,4),%xmm3 .byte 196,99,113,33,250,48 // vinsertps $0x30,%xmm2,%xmm1,%xmm15 .byte 72,139,64,64 // mov 0x40(%rax),%rax .byte 196,161,122,16,20,168 // vmovss (%rax,%r13,4),%xmm2 .byte 196,227,105,33,20,152,16 // vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2 - .byte 196,227,9,33,219,32 // vinsertps $0x20,%xmm3,%xmm14,%xmm3 + .byte 196,227,25,33,255,32 // vinsertps $0x20,%xmm7,%xmm12,%xmm7 .byte 196,161,122,16,12,184 // vmovss (%rax,%r15,4),%xmm1 - .byte 196,227,97,33,223,48 // vinsertps $0x30,%xmm7,%xmm3,%xmm3 + .byte 196,227,65,33,219,48 // vinsertps $0x30,%xmm3,%xmm7,%xmm3 .byte 196,161,122,16,60,160 // vmovss (%rax,%r12,4),%xmm7 - .byte 196,67,101,24,247,1 // vinsertf128 $0x1,%xmm15,%ymm3,%ymm14 + .byte 196,67,101,24,231,1 // vinsertf128 $0x1,%xmm15,%ymm3,%ymm12 .byte 196,161,122,16,28,176 // vmovss (%rax,%r14,4),%xmm3 .byte 196,163,97,33,28,152,16 // vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3 .byte 196,227,105,33,201,32 // vinsertps $0x20,%xmm1,%xmm2,%xmm1 @@ -20793,12 +20640,12 @@ _sk_gradient_avx: .byte 196,227,105,33,215,48 // vinsertps $0x30,%xmm7,%xmm2,%xmm2 .byte 196,227,109,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm2,%ymm3 .byte 197,188,89,200 // vmulps %ymm0,%ymm8,%ymm1 - .byte 196,65,116,88,196 // vaddps %ymm12,%ymm1,%ymm8 + .byte 196,65,116,88,198 // vaddps %ymm14,%ymm1,%ymm8 .byte 197,148,89,200 // vmulps %ymm0,%ymm13,%ymm1 .byte 196,193,116,88,201 // vaddps %ymm9,%ymm1,%ymm1 .byte 197,172,89,208 // vmulps %ymm0,%ymm10,%ymm2 .byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2 - .byte 197,140,89,192 // vmulps %ymm0,%ymm14,%ymm0 + .byte 197,156,89,192 // vmulps %ymm0,%ymm12,%ymm0 .byte 197,252,88,219 // vaddps %ymm3,%ymm0,%ymm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 197,124,41,192 // vmovaps %ymm8,%ymm0 @@ -20849,27 +20696,27 @@ _sk_xy_to_unit_angle_avx: .byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12 .byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11 .byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12 - .byte 196,98,125,24,45,18,9,0,0 // vbroadcastss 0x912(%rip),%ymm13 # 695c <_sk_callback_avx+0x4a0> + .byte 196,98,125,24,45,38,9,0,0 // vbroadcastss 0x926(%rip),%ymm13 # 68b0 <_sk_callback_avx+0x4b4> .byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13 - .byte 196,98,125,24,53,8,9,0,0 // vbroadcastss 0x908(%rip),%ymm14 # 6960 <_sk_callback_avx+0x4a4> + .byte 196,98,125,24,53,28,9,0,0 // vbroadcastss 0x91c(%rip),%ymm14 # 68b4 <_sk_callback_avx+0x4b8> .byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13 .byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13 - .byte 196,98,125,24,53,249,8,0,0 // vbroadcastss 0x8f9(%rip),%ymm14 # 6964 <_sk_callback_avx+0x4a8> + .byte 196,98,125,24,53,13,9,0,0 // vbroadcastss 0x90d(%rip),%ymm14 # 68b8 <_sk_callback_avx+0x4bc> .byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13 .byte 196,65,28,89,229 // vmulps %ymm13,%ymm12,%ymm12 - .byte 196,98,125,24,45,234,8,0,0 // vbroadcastss 0x8ea(%rip),%ymm13 # 6968 <_sk_callback_avx+0x4ac> + .byte 196,98,125,24,45,254,8,0,0 // vbroadcastss 0x8fe(%rip),%ymm13 # 68bc <_sk_callback_avx+0x4c0> .byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12 .byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11 .byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9 - .byte 196,98,125,24,21,213,8,0,0 // vbroadcastss 0x8d5(%rip),%ymm10 # 696c <_sk_callback_avx+0x4b0> + .byte 196,98,125,24,21,233,8,0,0 // vbroadcastss 0x8e9(%rip),%ymm10 # 68c0 <_sk_callback_avx+0x4c4> .byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10 .byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9 .byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0 - .byte 196,98,125,24,21,191,8,0,0 // vbroadcastss 0x8bf(%rip),%ymm10 # 6970 <_sk_callback_avx+0x4b4> + .byte 196,98,125,24,21,211,8,0,0 // vbroadcastss 0x8d3(%rip),%ymm10 # 68c4 <_sk_callback_avx+0x4c8> .byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10 .byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0 .byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9 - .byte 196,98,125,24,21,169,8,0,0 // vbroadcastss 0x8a9(%rip),%ymm10 # 6974 <_sk_callback_avx+0x4b8> + .byte 196,98,125,24,21,189,8,0,0 // vbroadcastss 0x8bd(%rip),%ymm10 # 68c8 <_sk_callback_avx+0x4cc> .byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10 .byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0 .byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9 @@ -20893,7 +20740,7 @@ HIDDEN _sk_save_xy_avx FUNCTION(_sk_save_xy_avx) _sk_save_xy_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,115,8,0,0 // vbroadcastss 0x873(%rip),%ymm8 # 6978 <_sk_callback_avx+0x4bc> + .byte 196,98,125,24,5,135,8,0,0 // vbroadcastss 0x887(%rip),%ymm8 # 68cc <_sk_callback_avx+0x4d0> .byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9 .byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10 .byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9 @@ -20930,9 +20777,9 @@ HIDDEN _sk_bilinear_nx_avx FUNCTION(_sk_bilinear_nx_avx) _sk_bilinear_nx_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,255,7,0,0 // vbroadcastss 0x7ff(%rip),%ymm0 # 697c <_sk_callback_avx+0x4c0> + .byte 196,226,125,24,5,19,8,0,0 // vbroadcastss 0x813(%rip),%ymm0 # 68d0 <_sk_callback_avx+0x4d4> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,246,7,0,0 // vbroadcastss 0x7f6(%rip),%ymm8 # 6980 <_sk_callback_avx+0x4c4> + .byte 196,98,125,24,5,10,8,0,0 // vbroadcastss 0x80a(%rip),%ymm8 # 68d4 <_sk_callback_avx+0x4d8> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -20943,7 +20790,7 @@ HIDDEN _sk_bilinear_px_avx FUNCTION(_sk_bilinear_px_avx) _sk_bilinear_px_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,222,7,0,0 // vbroadcastss 0x7de(%rip),%ymm0 # 6984 <_sk_callback_avx+0x4c8> + .byte 196,226,125,24,5,242,7,0,0 // vbroadcastss 0x7f2(%rip),%ymm0 # 68d8 <_sk_callback_avx+0x4dc> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 .byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -20955,9 +20802,9 @@ HIDDEN _sk_bilinear_ny_avx FUNCTION(_sk_bilinear_ny_avx) _sk_bilinear_ny_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,194,7,0,0 // vbroadcastss 0x7c2(%rip),%ymm1 # 6988 <_sk_callback_avx+0x4cc> + .byte 196,226,125,24,13,214,7,0,0 // vbroadcastss 0x7d6(%rip),%ymm1 # 68dc <_sk_callback_avx+0x4e0> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,184,7,0,0 // vbroadcastss 0x7b8(%rip),%ymm8 # 698c <_sk_callback_avx+0x4d0> + .byte 196,98,125,24,5,204,7,0,0 // vbroadcastss 0x7cc(%rip),%ymm8 # 68e0 <_sk_callback_avx+0x4e4> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -20968,7 +20815,7 @@ HIDDEN _sk_bilinear_py_avx FUNCTION(_sk_bilinear_py_avx) _sk_bilinear_py_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,160,7,0,0 // vbroadcastss 0x7a0(%rip),%ymm1 # 6990 <_sk_callback_avx+0x4d4> + .byte 196,226,125,24,13,180,7,0,0 // vbroadcastss 0x7b4(%rip),%ymm1 # 68e4 <_sk_callback_avx+0x4e8> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 .byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -20980,14 +20827,14 @@ HIDDEN _sk_bicubic_n3x_avx FUNCTION(_sk_bicubic_n3x_avx) _sk_bicubic_n3x_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,131,7,0,0 // vbroadcastss 0x783(%rip),%ymm0 # 6994 <_sk_callback_avx+0x4d8> + .byte 196,226,125,24,5,151,7,0,0 // vbroadcastss 0x797(%rip),%ymm0 # 68e8 <_sk_callback_avx+0x4ec> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,122,7,0,0 // vbroadcastss 0x77a(%rip),%ymm8 # 6998 <_sk_callback_avx+0x4dc> + .byte 196,98,125,24,5,142,7,0,0 // vbroadcastss 0x78e(%rip),%ymm8 # 68ec <_sk_callback_avx+0x4f0> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,107,7,0,0 // vbroadcastss 0x76b(%rip),%ymm10 # 699c <_sk_callback_avx+0x4e0> + .byte 196,98,125,24,21,127,7,0,0 // vbroadcastss 0x77f(%rip),%ymm10 # 68f0 <_sk_callback_avx+0x4f4> .byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8 - .byte 196,98,125,24,21,97,7,0,0 // vbroadcastss 0x761(%rip),%ymm10 # 69a0 <_sk_callback_avx+0x4e4> + .byte 196,98,125,24,21,117,7,0,0 // vbroadcastss 0x775(%rip),%ymm10 # 68f4 <_sk_callback_avx+0x4f8> .byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -20999,19 +20846,19 @@ HIDDEN _sk_bicubic_n1x_avx FUNCTION(_sk_bicubic_n1x_avx) _sk_bicubic_n1x_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,68,7,0,0 // vbroadcastss 0x744(%rip),%ymm0 # 69a4 <_sk_callback_avx+0x4e8> + .byte 196,226,125,24,5,88,7,0,0 // vbroadcastss 0x758(%rip),%ymm0 # 68f8 <_sk_callback_avx+0x4fc> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 - .byte 196,98,125,24,5,59,7,0,0 // vbroadcastss 0x73b(%rip),%ymm8 # 69a8 <_sk_callback_avx+0x4ec> + .byte 196,98,125,24,5,79,7,0,0 // vbroadcastss 0x74f(%rip),%ymm8 # 68fc <_sk_callback_avx+0x500> .byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8 - .byte 196,98,125,24,13,49,7,0,0 // vbroadcastss 0x731(%rip),%ymm9 # 69ac <_sk_callback_avx+0x4f0> + .byte 196,98,125,24,13,69,7,0,0 // vbroadcastss 0x745(%rip),%ymm9 # 6900 <_sk_callback_avx+0x504> .byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9 - .byte 196,98,125,24,21,39,7,0,0 // vbroadcastss 0x727(%rip),%ymm10 # 69b0 <_sk_callback_avx+0x4f4> + .byte 196,98,125,24,21,59,7,0,0 // vbroadcastss 0x73b(%rip),%ymm10 # 6904 <_sk_callback_avx+0x508> .byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9 .byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9 - .byte 196,98,125,24,21,24,7,0,0 // vbroadcastss 0x718(%rip),%ymm10 # 69b4 <_sk_callback_avx+0x4f8> + .byte 196,98,125,24,21,44,7,0,0 // vbroadcastss 0x72c(%rip),%ymm10 # 6908 <_sk_callback_avx+0x50c> .byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9 .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 - .byte 196,98,125,24,13,9,7,0,0 // vbroadcastss 0x709(%rip),%ymm9 # 69b8 <_sk_callback_avx+0x4fc> + .byte 196,98,125,24,13,29,7,0,0 // vbroadcastss 0x71d(%rip),%ymm9 # 690c <_sk_callback_avx+0x510> .byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -21022,17 +20869,17 @@ HIDDEN _sk_bicubic_p1x_avx FUNCTION(_sk_bicubic_p1x_avx) _sk_bicubic_p1x_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,241,6,0,0 // vbroadcastss 0x6f1(%rip),%ymm8 # 69bc <_sk_callback_avx+0x500> + .byte 196,98,125,24,5,5,7,0,0 // vbroadcastss 0x705(%rip),%ymm8 # 6910 <_sk_callback_avx+0x514> .byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0 .byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9 - .byte 196,98,125,24,21,227,6,0,0 // vbroadcastss 0x6e3(%rip),%ymm10 # 69c0 <_sk_callback_avx+0x504> + .byte 196,98,125,24,21,247,6,0,0 // vbroadcastss 0x6f7(%rip),%ymm10 # 6914 <_sk_callback_avx+0x518> .byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10 - .byte 196,98,125,24,29,217,6,0,0 // vbroadcastss 0x6d9(%rip),%ymm11 # 69c4 <_sk_callback_avx+0x508> + .byte 196,98,125,24,29,237,6,0,0 // vbroadcastss 0x6ed(%rip),%ymm11 # 6918 <_sk_callback_avx+0x51c> .byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10 .byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10 .byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 - .byte 196,98,125,24,13,192,6,0,0 // vbroadcastss 0x6c0(%rip),%ymm9 # 69c8 <_sk_callback_avx+0x50c> + .byte 196,98,125,24,13,212,6,0,0 // vbroadcastss 0x6d4(%rip),%ymm9 # 691c <_sk_callback_avx+0x520> .byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -21043,13 +20890,13 @@ HIDDEN _sk_bicubic_p3x_avx FUNCTION(_sk_bicubic_p3x_avx) _sk_bicubic_p3x_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,5,168,6,0,0 // vbroadcastss 0x6a8(%rip),%ymm0 # 69cc <_sk_callback_avx+0x510> + .byte 196,226,125,24,5,188,6,0,0 // vbroadcastss 0x6bc(%rip),%ymm0 # 6920 <_sk_callback_avx+0x524> .byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0 .byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,149,6,0,0 // vbroadcastss 0x695(%rip),%ymm10 # 69d0 <_sk_callback_avx+0x514> + .byte 196,98,125,24,21,169,6,0,0 // vbroadcastss 0x6a9(%rip),%ymm10 # 6924 <_sk_callback_avx+0x528> .byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8 - .byte 196,98,125,24,21,139,6,0,0 // vbroadcastss 0x68b(%rip),%ymm10 # 69d4 <_sk_callback_avx+0x518> + .byte 196,98,125,24,21,159,6,0,0 // vbroadcastss 0x69f(%rip),%ymm10 # 6928 <_sk_callback_avx+0x52c> .byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 .byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax) @@ -21061,14 +20908,14 @@ HIDDEN _sk_bicubic_n3y_avx FUNCTION(_sk_bicubic_n3y_avx) _sk_bicubic_n3y_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,110,6,0,0 // vbroadcastss 0x66e(%rip),%ymm1 # 69d8 <_sk_callback_avx+0x51c> + .byte 196,226,125,24,13,130,6,0,0 // vbroadcastss 0x682(%rip),%ymm1 # 692c <_sk_callback_avx+0x530> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,100,6,0,0 // vbroadcastss 0x664(%rip),%ymm8 # 69dc <_sk_callback_avx+0x520> + .byte 196,98,125,24,5,120,6,0,0 // vbroadcastss 0x678(%rip),%ymm8 # 6930 <_sk_callback_avx+0x534> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,85,6,0,0 // vbroadcastss 0x655(%rip),%ymm10 # 69e0 <_sk_callback_avx+0x524> + .byte 196,98,125,24,21,105,6,0,0 // vbroadcastss 0x669(%rip),%ymm10 # 6934 <_sk_callback_avx+0x538> .byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8 - .byte 196,98,125,24,21,75,6,0,0 // vbroadcastss 0x64b(%rip),%ymm10 # 69e4 <_sk_callback_avx+0x528> + .byte 196,98,125,24,21,95,6,0,0 // vbroadcastss 0x65f(%rip),%ymm10 # 6938 <_sk_callback_avx+0x53c> .byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -21080,19 +20927,19 @@ HIDDEN _sk_bicubic_n1y_avx FUNCTION(_sk_bicubic_n1y_avx) _sk_bicubic_n1y_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,46,6,0,0 // vbroadcastss 0x62e(%rip),%ymm1 # 69e8 <_sk_callback_avx+0x52c> + .byte 196,226,125,24,13,66,6,0,0 // vbroadcastss 0x642(%rip),%ymm1 # 693c <_sk_callback_avx+0x540> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 - .byte 196,98,125,24,5,36,6,0,0 // vbroadcastss 0x624(%rip),%ymm8 # 69ec <_sk_callback_avx+0x530> + .byte 196,98,125,24,5,56,6,0,0 // vbroadcastss 0x638(%rip),%ymm8 # 6940 <_sk_callback_avx+0x544> .byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8 - .byte 196,98,125,24,13,26,6,0,0 // vbroadcastss 0x61a(%rip),%ymm9 # 69f0 <_sk_callback_avx+0x534> + .byte 196,98,125,24,13,46,6,0,0 // vbroadcastss 0x62e(%rip),%ymm9 # 6944 <_sk_callback_avx+0x548> .byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9 - .byte 196,98,125,24,21,16,6,0,0 // vbroadcastss 0x610(%rip),%ymm10 # 69f4 <_sk_callback_avx+0x538> + .byte 196,98,125,24,21,36,6,0,0 // vbroadcastss 0x624(%rip),%ymm10 # 6948 <_sk_callback_avx+0x54c> .byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9 .byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9 - .byte 196,98,125,24,21,1,6,0,0 // vbroadcastss 0x601(%rip),%ymm10 # 69f8 <_sk_callback_avx+0x53c> + .byte 196,98,125,24,21,21,6,0,0 // vbroadcastss 0x615(%rip),%ymm10 # 694c <_sk_callback_avx+0x550> .byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9 .byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8 - .byte 196,98,125,24,13,242,5,0,0 // vbroadcastss 0x5f2(%rip),%ymm9 # 69fc <_sk_callback_avx+0x540> + .byte 196,98,125,24,13,6,6,0,0 // vbroadcastss 0x606(%rip),%ymm9 # 6950 <_sk_callback_avx+0x554> .byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -21103,17 +20950,17 @@ HIDDEN _sk_bicubic_p1y_avx FUNCTION(_sk_bicubic_p1y_avx) _sk_bicubic_p1y_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,98,125,24,5,218,5,0,0 // vbroadcastss 0x5da(%rip),%ymm8 # 6a00 <_sk_callback_avx+0x544> + .byte 196,98,125,24,5,238,5,0,0 // vbroadcastss 0x5ee(%rip),%ymm8 # 6954 <_sk_callback_avx+0x558> .byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1 .byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9 - .byte 196,98,125,24,21,203,5,0,0 // vbroadcastss 0x5cb(%rip),%ymm10 # 6a04 <_sk_callback_avx+0x548> + .byte 196,98,125,24,21,223,5,0,0 // vbroadcastss 0x5df(%rip),%ymm10 # 6958 <_sk_callback_avx+0x55c> .byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10 - .byte 196,98,125,24,29,193,5,0,0 // vbroadcastss 0x5c1(%rip),%ymm11 # 6a08 <_sk_callback_avx+0x54c> + .byte 196,98,125,24,29,213,5,0,0 // vbroadcastss 0x5d5(%rip),%ymm11 # 695c <_sk_callback_avx+0x560> .byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10 .byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10 .byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 - .byte 196,98,125,24,13,168,5,0,0 // vbroadcastss 0x5a8(%rip),%ymm9 # 6a0c <_sk_callback_avx+0x550> + .byte 196,98,125,24,13,188,5,0,0 // vbroadcastss 0x5bc(%rip),%ymm9 # 6960 <_sk_callback_avx+0x564> .byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -21124,13 +20971,13 @@ HIDDEN _sk_bicubic_p3y_avx FUNCTION(_sk_bicubic_p3y_avx) _sk_bicubic_p3y_avx: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 196,226,125,24,13,144,5,0,0 // vbroadcastss 0x590(%rip),%ymm1 # 6a10 <_sk_callback_avx+0x554> + .byte 196,226,125,24,13,164,5,0,0 // vbroadcastss 0x5a4(%rip),%ymm1 # 6964 <_sk_callback_avx+0x568> .byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1 .byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8 .byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9 - .byte 196,98,125,24,21,124,5,0,0 // vbroadcastss 0x57c(%rip),%ymm10 # 6a14 <_sk_callback_avx+0x558> + .byte 196,98,125,24,21,144,5,0,0 // vbroadcastss 0x590(%rip),%ymm10 # 6968 <_sk_callback_avx+0x56c> .byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8 - .byte 196,98,125,24,21,114,5,0,0 // vbroadcastss 0x572(%rip),%ymm10 # 6a18 <_sk_callback_avx+0x55c> + .byte 196,98,125,24,21,134,5,0,0 // vbroadcastss 0x586(%rip),%ymm10 # 696c <_sk_callback_avx+0x570> .byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8 .byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8 .byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax) @@ -21142,22 +20989,24 @@ HIDDEN _sk_callback_avx FUNCTION(_sk_callback_avx) _sk_callback_avx: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx - .byte 72,129,236,136,0,0,0 // sub $0x88,%rsp - .byte 197,252,17,124,36,96 // vmovups %ymm7,0x60(%rsp) - .byte 197,252,17,116,36,64 // vmovups %ymm6,0x40(%rsp) - .byte 197,252,17,108,36,32 // vmovups %ymm5,0x20(%rsp) - .byte 197,252,17,36,36 // vmovups %ymm4,(%rsp) + .byte 72,131,228,224 // and $0xffffffffffffffe0,%rsp + .byte 72,129,236,192,0,0,0 // sub $0xc0,%rsp + .byte 197,252,41,188,36,128,0,0,0 // vmovaps %ymm7,0x80(%rsp) + .byte 197,252,41,116,36,96 // vmovaps %ymm6,0x60(%rsp) + .byte 197,252,41,108,36,64 // vmovaps %ymm5,0x40(%rsp) + .byte 197,252,41,100,36,32 // vmovaps %ymm4,0x20(%rsp) .byte 76,137,195 // mov %r8,%rbx - .byte 73,137,206 // mov %rcx,%r14 + .byte 72,137,76,36,24 // mov %rcx,0x18(%rsp) .byte 73,137,215 // mov %rdx,%r15 .byte 73,137,252 // mov %rdi,%r12 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 72,137,197 // mov %rax,%rbp + .byte 73,137,198 // mov %rax,%r14 .byte 73,137,245 // mov %rsi,%r13 .byte 197,252,20,225 // vunpcklps %ymm1,%ymm0,%ymm4 .byte 197,252,21,193 // vunpckhps %ymm1,%ymm0,%ymm0 @@ -21171,17 +21020,17 @@ _sk_callback_avx: .byte 196,227,93,24,232,1 // vinsertf128 $0x1,%xmm0,%ymm4,%ymm5 .byte 196,227,101,6,201,49 // vperm2f128 $0x31,%ymm1,%ymm3,%ymm1 .byte 196,227,93,6,192,49 // vperm2f128 $0x31,%ymm0,%ymm4,%ymm0 - .byte 197,253,17,85,8 // vmovupd %ymm2,0x8(%rbp) - .byte 197,253,17,109,40 // vmovupd %ymm5,0x28(%rbp) - .byte 197,253,17,77,72 // vmovupd %ymm1,0x48(%rbp) - .byte 197,253,17,69,104 // vmovupd %ymm0,0x68(%rbp) + .byte 196,193,125,17,86,8 // vmovupd %ymm2,0x8(%r14) + .byte 196,193,125,17,110,40 // vmovupd %ymm5,0x28(%r14) + .byte 196,193,125,17,78,72 // vmovupd %ymm1,0x48(%r14) + .byte 196,193,125,17,70,104 // vmovupd %ymm0,0x68(%r14) .byte 72,133,219 // test %rbx,%rbx .byte 190,8,0,0,0 // mov $0x8,%esi .byte 15,69,243 // cmovne %ebx,%esi - .byte 72,137,239 // mov %rbp,%rdi + .byte 76,137,247 // mov %r14,%rdi .byte 197,248,119 // vzeroupper - .byte 255,85,0 // callq *0x0(%rbp) - .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax + .byte 65,255,22 // callq *(%r14) + .byte 73,139,134,136,0,0,0 // mov 0x88(%r14),%rax .byte 197,248,16,0 // vmovups (%rax),%xmm0 .byte 197,248,16,72,16 // vmovups 0x10(%rax),%xmm1 .byte 197,248,16,80,32 // vmovups 0x20(%rax),%xmm2 @@ -21202,13 +21051,13 @@ _sk_callback_avx: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,231 // mov %r12,%rdi .byte 76,137,250 // mov %r15,%rdx - .byte 76,137,241 // mov %r14,%rcx + .byte 72,139,76,36,24 // mov 0x18(%rsp),%rcx .byte 73,137,216 // mov %rbx,%r8 - .byte 197,252,16,36,36 // vmovups (%rsp),%ymm4 - .byte 197,252,16,108,36,32 // vmovups 0x20(%rsp),%ymm5 - .byte 197,252,16,116,36,64 // vmovups 0x40(%rsp),%ymm6 - .byte 197,252,16,124,36,96 // vmovups 0x60(%rsp),%ymm7 - .byte 72,129,196,136,0,0,0 // add $0x88,%rsp + .byte 197,252,40,100,36,32 // vmovaps 0x20(%rsp),%ymm4 + .byte 197,252,40,108,36,64 // vmovaps 0x40(%rsp),%ymm5 + .byte 197,252,40,116,36,96 // vmovaps 0x60(%rsp),%ymm6 + .byte 197,252,40,188,36,128,0,0,0 // vmovaps 0x80(%rsp),%ymm7 + .byte 72,141,101,216 // lea -0x28(%rbp),%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 .byte 65,93 // pop %r13 @@ -21258,25 +21107,25 @@ BALIGN4 .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 669d <.literal4+0xb1> + .byte 71,225,61 // rex.RXB loope 65f1 <.literal4+0xb1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 66ad <.literal4+0xc1> + .byte 71,225,61 // rex.RXB loope 6601 <.literal4+0xc1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 66bd <.literal4+0xd1> + .byte 71,225,61 // rex.RXB loope 6611 <.literal4+0xd1> .byte 0,0 // add %al,(%rax) .byte 128,63,154 // cmpb $0x9a,(%rdi) .byte 153 // cltd .byte 153 // cltd .byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax - .byte 71,225,61 // rex.RXB loope 66cd <.literal4+0xe1> + .byte 71,225,61 // rex.RXB loope 6621 <.literal4+0xe1> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax) @@ -21328,7 +21177,7 @@ BALIGN4 .byte 190,129,128,128,59 // mov $0x3b808081,%esi .byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 6721 <.literal4+0x135> + .byte 224,7 // loopne 6675 <.literal4+0x135> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -21344,10 +21193,10 @@ BALIGN4 .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) .byte 0,52,255 // add %dh,(%rdi,%rdi,8) .byte 255 // (bad) - .byte 127,0 // jg 6748 <.literal4+0x15c> + .byte 127,0 // jg 669c <.literal4+0x15c> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 67c1 <.literal4+0x1d5> + .byte 119,115 // ja 6715 <.literal4+0x1d5> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -21361,10 +21210,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 677c <.literal4+0x190> + .byte 127,0 // jg 66d0 <.literal4+0x190> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 67f5 <.literal4+0x209> + .byte 119,115 // ja 6749 <.literal4+0x209> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -21378,10 +21227,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 67b0 <.literal4+0x1c4> + .byte 127,0 // jg 6704 <.literal4+0x1c4> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 6829 <.literal4+0x23d> + .byte 119,115 // ja 677d <.literal4+0x23d> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -21395,10 +21244,10 @@ BALIGN4 .byte 0,128,63,0,0,0 // add %al,0x3f(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 67e4 <.literal4+0x1f8> + .byte 127,0 // jg 6738 <.literal4+0x1f8> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 685d <.literal4+0x271> + .byte 119,115 // ja 67b1 <.literal4+0x271> .byte 248 // clc .byte 194,117,191 // retq $0xbf75 .byte 191,63,249,68,180 // mov $0xb444f93f,%edi @@ -21411,7 +21260,7 @@ BALIGN4 .byte 0,75,0 // add %cl,0x0(%rbx) .byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax) .byte 66,0,0 // rex.X add %al,(%rax) - .byte 127,67 // jg 685b <.literal4+0x26f> + .byte 127,67 // jg 67af <.literal4+0x26f> .byte 0,0 // add %al,(%rax) .byte 0,195 // add %al,%bl .byte 0,0 // add %al,(%rax) @@ -21423,10 +21272,10 @@ BALIGN4 .byte 190,80,128,3,62 // mov $0x3e038050,%esi .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 687b <.literal4+0x28f> + .byte 118,63 // jbe 67cf <.literal4+0x28f> .byte 246,64,83,63 // testb $0x3f,0x53(%rax) .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) - .byte 127,67 // jg 688f <.literal4+0x2a3> + .byte 127,67 // jg 67e3 <.literal4+0x2a3> .byte 129,128,128,59,0,0,128,63,129,128 // addl $0x80813f80,0x3b80(%rax) .byte 128,59,0 // cmpb $0x0,(%rbx) .byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax) @@ -21435,7 +21284,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 6871 <.literal4+0x285> + .byte 224,7 // loopne 67c5 <.literal4+0x285> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -21447,7 +21296,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 688d <.literal4+0x2a1> + .byte 224,7 // loopne 67e1 <.literal4+0x2a1> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -21458,7 +21307,7 @@ BALIGN4 .byte 0,0 // add %al,(%rax) .byte 248 // clc .byte 65,0,0 // add %al,(%r8) - .byte 124,66 // jl 68e2 <.literal4+0x2f6> + .byte 124,66 // jl 6836 <.literal4+0x2f6> .byte 0,240 // add %dh,%al .byte 0,0 // add %al,(%rax) .byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax) @@ -21476,9 +21325,9 @@ BALIGN4 .byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax) .byte 0,0 // add %al,(%rax) .byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax) - .byte 112,65 // jo 6925 <.literal4+0x339> + .byte 112,65 // jo 6879 <.literal4+0x339> .byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax) - .byte 127,67 // jg 6933 <.literal4+0x347> + .byte 127,67 // jg 6887 <.literal4+0x347> .byte 0,128,0,0,0,0 // add %al,0x0(%rax) .byte 0,128,0,4,0,128 // add %al,-0x7ffffc00(%rax) .byte 0,0 // add %al,(%rax) @@ -21494,7 +21343,7 @@ BALIGN4 .byte 0,128,55,0,0,128 // add %al,-0x7fffffc9(%rax) .byte 63 // (bad) .byte 0,255 // add %bh,%bh - .byte 127,71 // jg 6973 <.literal4+0x387> + .byte 127,71 // jg 68c7 <.literal4+0x387> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,191,0,0,0 // add %al,0xbf(%rax) @@ -21760,24 +21609,26 @@ HIDDEN _sk_start_pipeline_sse41 FUNCTION(_sk_start_pipeline_sse41) _sk_start_pipeline_sse41: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 80 // push %rax - .byte 77,137,198 // mov %r8,%r14 - .byte 73,137,213 // mov %rdx,%r13 - .byte 73,137,247 // mov %rsi,%r15 + .byte 77,137,199 // mov %r8,%r15 + .byte 73,137,208 // mov %rdx,%r8 + .byte 73,137,244 // mov %rsi,%r12 .byte 72,137,251 // mov %rdi,%rbx .byte 72,137,206 // mov %rcx,%rsi .byte 72,173 // lods %ds:(%rsi),%rax - .byte 73,137,244 // mov %rsi,%r12 + .byte 73,137,245 // mov %rsi,%r13 .byte 72,141,75,4 // lea 0x4(%rbx),%rcx - .byte 76,57,233 // cmp %r13,%rcx - .byte 118,5 // jbe 2d <_sk_start_pipeline_sse41+0x2d> + .byte 76,57,193 // cmp %r8,%rcx + .byte 118,5 // jbe 30 <_sk_start_pipeline_sse41+0x30> .byte 72,137,218 // mov %rbx,%rdx - .byte 235,66 // jmp 6f <_sk_start_pipeline_sse41+0x6f> + .byte 235,75 // jmp 7b <_sk_start_pipeline_sse41+0x7b> + .byte 76,137,69,208 // mov %r8,-0x30(%rbp) .byte 65,184,0,0,0,0 // mov $0x0,%r8d .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 @@ -21787,20 +21638,21 @@ _sk_start_pipeline_sse41: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,230 // mov %r12,%rsi + .byte 76,137,255 // mov %r15,%rdi + .byte 76,137,238 // mov %r13,%rsi .byte 72,137,218 // mov %rbx,%rdx - .byte 76,137,249 // mov %r15,%rcx - .byte 72,137,197 // mov %rax,%rbp - .byte 255,213 // callq *%rbp - .byte 72,137,232 // mov %rbp,%rax + .byte 76,137,225 // mov %r12,%rcx + .byte 73,137,198 // mov %rax,%r14 + .byte 65,255,214 // callq *%r14 + .byte 76,139,69,208 // mov -0x30(%rbp),%r8 + .byte 76,137,240 // mov %r14,%rax .byte 72,141,83,4 // lea 0x4(%rbx),%rdx .byte 72,131,195,8 // add $0x8,%rbx - .byte 76,57,235 // cmp %r13,%rbx + .byte 76,57,195 // cmp %r8,%rbx .byte 72,137,211 // mov %rdx,%rbx - .byte 118,190 // jbe 2d <_sk_start_pipeline_sse41+0x2d> - .byte 73,41,213 // sub %rdx,%r13 - .byte 116,52 // je a8 <_sk_start_pipeline_sse41+0xa8> + .byte 118,185 // jbe 34 <_sk_start_pipeline_sse41+0x34> + .byte 73,41,208 // sub %rdx,%r8 + .byte 116,49 // je b1 <_sk_start_pipeline_sse41+0xb1> .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 .byte 15,87,210 // xorps %xmm2,%xmm2 @@ -21809,10 +21661,9 @@ _sk_start_pipeline_sse41: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,230 // mov %r12,%rsi - .byte 76,137,249 // mov %r15,%rcx - .byte 77,137,232 // mov %r13,%r8 + .byte 76,137,255 // mov %r15,%rdi + .byte 76,137,238 // mov %r13,%rsi + .byte 76,137,225 // mov %r12,%rcx .byte 72,131,196,8 // add $0x8,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -21843,7 +21694,7 @@ _sk_seed_shader_sse41: .byte 102,15,110,194 // movd %edx,%xmm0 .byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0 .byte 15,91,200 // cvtdq2ps %xmm0,%xmm1 - .byte 15,40,21,5,80,0,0 // movaps 0x5005(%rip),%xmm2 # 50d0 <_sk_callback_sse41+0xfc> + .byte 15,40,21,252,79,0,0 // movaps 0x4ffc(%rip),%xmm2 # 50d0 <_sk_callback_sse41+0xf3> .byte 15,88,202 // addps %xmm2,%xmm1 .byte 15,16,7 // movups (%rdi),%xmm0 .byte 15,88,193 // addps %xmm1,%xmm0 @@ -21852,7 +21703,7 @@ _sk_seed_shader_sse41: .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 15,88,202 // addps %xmm2,%xmm1 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,21,244,79,0,0 // movaps 0x4ff4(%rip),%xmm2 # 50e0 <_sk_callback_sse41+0x10c> + .byte 15,40,21,235,79,0,0 // movaps 0x4feb(%rip),%xmm2 # 50e0 <_sk_callback_sse41+0x103> .byte 15,87,219 // xorps %xmm3,%xmm3 .byte 15,87,228 // xorps %xmm4,%xmm4 .byte 15,87,237 // xorps %xmm5,%xmm5 @@ -21872,14 +21723,14 @@ _sk_dither_sse41: .byte 102,68,15,110,193 // movd %ecx,%xmm8 .byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8 .byte 102,69,15,239,193 // pxor %xmm9,%xmm8 - .byte 102,68,15,111,21,194,79,0,0 // movdqa 0x4fc2(%rip),%xmm10 # 50f0 <_sk_callback_sse41+0x11c> + .byte 102,68,15,111,21,185,79,0,0 // movdqa 0x4fb9(%rip),%xmm10 # 50f0 <_sk_callback_sse41+0x113> .byte 102,69,15,111,216 // movdqa %xmm8,%xmm11 .byte 102,69,15,219,218 // pand %xmm10,%xmm11 .byte 102,65,15,114,243,5 // pslld $0x5,%xmm11 .byte 102,69,15,219,209 // pand %xmm9,%xmm10 .byte 102,65,15,114,242,4 // pslld $0x4,%xmm10 - .byte 102,68,15,111,37,174,79,0,0 // movdqa 0x4fae(%rip),%xmm12 # 5100 <_sk_callback_sse41+0x12c> - .byte 102,68,15,111,45,181,79,0,0 // movdqa 0x4fb5(%rip),%xmm13 # 5110 <_sk_callback_sse41+0x13c> + .byte 102,68,15,111,37,165,79,0,0 // movdqa 0x4fa5(%rip),%xmm12 # 5100 <_sk_callback_sse41+0x123> + .byte 102,68,15,111,45,172,79,0,0 // movdqa 0x4fac(%rip),%xmm13 # 5110 <_sk_callback_sse41+0x133> .byte 102,69,15,111,240 // movdqa %xmm8,%xmm14 .byte 102,69,15,219,245 // pand %xmm13,%xmm14 .byte 102,65,15,114,246,2 // pslld $0x2,%xmm14 @@ -21895,8 +21746,8 @@ _sk_dither_sse41: .byte 102,69,15,235,245 // por %xmm13,%xmm14 .byte 102,69,15,235,240 // por %xmm8,%xmm14 .byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8 - .byte 68,15,89,5,112,79,0,0 // mulps 0x4f70(%rip),%xmm8 # 5120 <_sk_callback_sse41+0x14c> - .byte 68,15,88,5,120,79,0,0 // addps 0x4f78(%rip),%xmm8 # 5130 <_sk_callback_sse41+0x15c> + .byte 68,15,89,5,103,79,0,0 // mulps 0x4f67(%rip),%xmm8 # 5120 <_sk_callback_sse41+0x143> + .byte 68,15,88,5,111,79,0,0 // addps 0x4f6f(%rip),%xmm8 # 5130 <_sk_callback_sse41+0x153> .byte 243,68,15,16,16 // movss (%rax),%xmm10 .byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10 .byte 69,15,89,208 // mulps %xmm8,%xmm10 @@ -21973,7 +21824,7 @@ HIDDEN _sk_srcatop_sse41 FUNCTION(_sk_srcatop_sse41) _sk_srcatop_sse41: .byte 15,89,199 // mulps %xmm7,%xmm0 - .byte 68,15,40,5,210,78,0,0 // movaps 0x4ed2(%rip),%xmm8 # 5140 <_sk_callback_sse41+0x16c> + .byte 68,15,40,5,201,78,0,0 // movaps 0x4ec9(%rip),%xmm8 # 5140 <_sk_callback_sse41+0x163> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -21998,7 +21849,7 @@ FUNCTION(_sk_dstatop_sse41) _sk_dstatop_sse41: .byte 68,15,40,195 // movaps %xmm3,%xmm8 .byte 68,15,89,196 // mulps %xmm4,%xmm8 - .byte 68,15,40,13,149,78,0,0 // movaps 0x4e95(%rip),%xmm9 # 5150 <_sk_callback_sse41+0x17c> + .byte 68,15,40,13,140,78,0,0 // movaps 0x4e8c(%rip),%xmm9 # 5150 <_sk_callback_sse41+0x173> .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 65,15,89,193 // mulps %xmm9,%xmm0 .byte 65,15,88,192 // addps %xmm8,%xmm0 @@ -22045,7 +21896,7 @@ HIDDEN _sk_srcout_sse41 .globl _sk_srcout_sse41 FUNCTION(_sk_srcout_sse41) _sk_srcout_sse41: - .byte 68,15,40,5,57,78,0,0 // movaps 0x4e39(%rip),%xmm8 # 5160 <_sk_callback_sse41+0x18c> + .byte 68,15,40,5,48,78,0,0 // movaps 0x4e30(%rip),%xmm8 # 5160 <_sk_callback_sse41+0x183> .byte 68,15,92,199 // subps %xmm7,%xmm8 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 @@ -22058,7 +21909,7 @@ HIDDEN _sk_dstout_sse41 .globl _sk_dstout_sse41 FUNCTION(_sk_dstout_sse41) _sk_dstout_sse41: - .byte 68,15,40,5,41,78,0,0 // movaps 0x4e29(%rip),%xmm8 # 5170 <_sk_callback_sse41+0x19c> + .byte 68,15,40,5,32,78,0,0 // movaps 0x4e20(%rip),%xmm8 # 5170 <_sk_callback_sse41+0x193> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 15,89,196 // mulps %xmm4,%xmm0 @@ -22075,7 +21926,7 @@ HIDDEN _sk_srcover_sse41 .globl _sk_srcover_sse41 FUNCTION(_sk_srcover_sse41) _sk_srcover_sse41: - .byte 68,15,40,5,12,78,0,0 // movaps 0x4e0c(%rip),%xmm8 # 5180 <_sk_callback_sse41+0x1ac> + .byte 68,15,40,5,3,78,0,0 // movaps 0x4e03(%rip),%xmm8 # 5180 <_sk_callback_sse41+0x1a3> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -22095,7 +21946,7 @@ HIDDEN _sk_dstover_sse41 .globl _sk_dstover_sse41 FUNCTION(_sk_dstover_sse41) _sk_dstover_sse41: - .byte 68,15,40,5,224,77,0,0 // movaps 0x4de0(%rip),%xmm8 # 5190 <_sk_callback_sse41+0x1bc> + .byte 68,15,40,5,215,77,0,0 // movaps 0x4dd7(%rip),%xmm8 # 5190 <_sk_callback_sse41+0x1b3> .byte 68,15,92,199 // subps %xmm7,%xmm8 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -22123,7 +21974,7 @@ HIDDEN _sk_multiply_sse41 .globl _sk_multiply_sse41 FUNCTION(_sk_multiply_sse41) _sk_multiply_sse41: - .byte 68,15,40,5,180,77,0,0 // movaps 0x4db4(%rip),%xmm8 # 51a0 <_sk_callback_sse41+0x1cc> + .byte 68,15,40,5,171,77,0,0 // movaps 0x4dab(%rip),%xmm8 # 51a0 <_sk_callback_sse41+0x1c3> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 69,15,40,209 // movaps %xmm9,%xmm10 @@ -22198,7 +22049,7 @@ HIDDEN _sk_xor__sse41 FUNCTION(_sk_xor__sse41) _sk_xor__sse41: .byte 68,15,40,195 // movaps %xmm3,%xmm8 - .byte 15,40,29,233,76,0,0 // movaps 0x4ce9(%rip),%xmm3 # 51b0 <_sk_callback_sse41+0x1dc> + .byte 15,40,29,224,76,0,0 // movaps 0x4ce0(%rip),%xmm3 # 51b0 <_sk_callback_sse41+0x1d3> .byte 68,15,40,203 // movaps %xmm3,%xmm9 .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 65,15,89,193 // mulps %xmm9,%xmm0 @@ -22246,7 +22097,7 @@ _sk_darken_sse41: .byte 68,15,89,206 // mulps %xmm6,%xmm9 .byte 65,15,95,209 // maxps %xmm9,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,84,76,0,0 // movaps 0x4c54(%rip),%xmm2 # 51c0 <_sk_callback_sse41+0x1ec> + .byte 15,40,21,75,76,0,0 // movaps 0x4c4b(%rip),%xmm2 # 51c0 <_sk_callback_sse41+0x1e3> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -22280,7 +22131,7 @@ _sk_lighten_sse41: .byte 68,15,89,206 // mulps %xmm6,%xmm9 .byte 65,15,93,209 // minps %xmm9,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,249,75,0,0 // movaps 0x4bf9(%rip),%xmm2 # 51d0 <_sk_callback_sse41+0x1fc> + .byte 15,40,21,240,75,0,0 // movaps 0x4bf0(%rip),%xmm2 # 51d0 <_sk_callback_sse41+0x1f3> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -22317,7 +22168,7 @@ _sk_difference_sse41: .byte 65,15,93,209 // minps %xmm9,%xmm2 .byte 15,88,210 // addps %xmm2,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,147,75,0,0 // movaps 0x4b93(%rip),%xmm2 # 51e0 <_sk_callback_sse41+0x20c> + .byte 15,40,21,138,75,0,0 // movaps 0x4b8a(%rip),%xmm2 # 51e0 <_sk_callback_sse41+0x203> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -22345,7 +22196,7 @@ _sk_exclusion_sse41: .byte 15,89,214 // mulps %xmm6,%xmm2 .byte 15,88,210 // addps %xmm2,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,83,75,0,0 // movaps 0x4b53(%rip),%xmm2 # 51f0 <_sk_callback_sse41+0x21c> + .byte 15,40,21,74,75,0,0 // movaps 0x4b4a(%rip),%xmm2 # 51f0 <_sk_callback_sse41+0x213> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -22358,7 +22209,7 @@ HIDDEN _sk_colorburn_sse41 FUNCTION(_sk_colorburn_sse41) _sk_colorburn_sse41: .byte 68,15,40,192 // movaps %xmm0,%xmm8 - .byte 68,15,40,21,70,75,0,0 // movaps 0x4b46(%rip),%xmm10 # 5200 <_sk_callback_sse41+0x22c> + .byte 68,15,40,21,61,75,0,0 // movaps 0x4b3d(%rip),%xmm10 # 5200 <_sk_callback_sse41+0x223> .byte 69,15,40,218 // movaps %xmm10,%xmm11 .byte 68,15,92,223 // subps %xmm7,%xmm11 .byte 69,15,40,203 // movaps %xmm11,%xmm9 @@ -22440,7 +22291,7 @@ HIDDEN _sk_colordodge_sse41 FUNCTION(_sk_colordodge_sse41) _sk_colordodge_sse41: .byte 68,15,40,192 // movaps %xmm0,%xmm8 - .byte 68,15,40,21,36,74,0,0 // movaps 0x4a24(%rip),%xmm10 # 5210 <_sk_callback_sse41+0x23c> + .byte 68,15,40,21,27,74,0,0 // movaps 0x4a1b(%rip),%xmm10 # 5210 <_sk_callback_sse41+0x233> .byte 69,15,40,218 // movaps %xmm10,%xmm11 .byte 68,15,92,223 // subps %xmm7,%xmm11 .byte 69,15,40,227 // movaps %xmm11,%xmm12 @@ -22522,7 +22373,7 @@ _sk_hardlight_sse41: .byte 15,40,244 // movaps %xmm4,%xmm6 .byte 15,40,227 // movaps %xmm3,%xmm4 .byte 68,15,40,200 // movaps %xmm0,%xmm9 - .byte 68,15,40,21,253,72,0,0 // movaps 0x48fd(%rip),%xmm10 # 5220 <_sk_callback_sse41+0x24c> + .byte 68,15,40,21,244,72,0,0 // movaps 0x48f4(%rip),%xmm10 # 5220 <_sk_callback_sse41+0x243> .byte 65,15,40,234 // movaps %xmm10,%xmm5 .byte 15,92,239 // subps %xmm7,%xmm5 .byte 15,40,197 // movaps %xmm5,%xmm0 @@ -22605,7 +22456,7 @@ FUNCTION(_sk_overlay_sse41) _sk_overlay_sse41: .byte 68,15,40,201 // movaps %xmm1,%xmm9 .byte 68,15,40,240 // movaps %xmm0,%xmm14 - .byte 68,15,40,21,226,71,0,0 // movaps 0x47e2(%rip),%xmm10 # 5230 <_sk_callback_sse41+0x25c> + .byte 68,15,40,21,217,71,0,0 // movaps 0x47d9(%rip),%xmm10 # 5230 <_sk_callback_sse41+0x253> .byte 69,15,40,218 // movaps %xmm10,%xmm11 .byte 68,15,92,223 // subps %xmm7,%xmm11 .byte 65,15,40,195 // movaps %xmm11,%xmm0 @@ -22690,7 +22541,7 @@ _sk_softlight_sse41: .byte 15,40,198 // movaps %xmm6,%xmm0 .byte 15,94,199 // divps %xmm7,%xmm0 .byte 65,15,84,193 // andps %xmm9,%xmm0 - .byte 15,40,13,185,70,0,0 // movaps 0x46b9(%rip),%xmm1 # 5240 <_sk_callback_sse41+0x26c> + .byte 15,40,13,176,70,0,0 // movaps 0x46b0(%rip),%xmm1 # 5240 <_sk_callback_sse41+0x263> .byte 68,15,40,209 // movaps %xmm1,%xmm10 .byte 68,15,92,208 // subps %xmm0,%xmm10 .byte 68,15,40,240 // movaps %xmm0,%xmm14 @@ -22703,10 +22554,10 @@ _sk_softlight_sse41: .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 15,89,210 // mulps %xmm2,%xmm2 .byte 15,88,208 // addps %xmm0,%xmm2 - .byte 68,15,40,45,151,70,0,0 // movaps 0x4697(%rip),%xmm13 # 5250 <_sk_callback_sse41+0x27c> + .byte 68,15,40,45,142,70,0,0 // movaps 0x468e(%rip),%xmm13 # 5250 <_sk_callback_sse41+0x273> .byte 69,15,88,245 // addps %xmm13,%xmm14 .byte 68,15,89,242 // mulps %xmm2,%xmm14 - .byte 68,15,40,37,151,70,0,0 // movaps 0x4697(%rip),%xmm12 # 5260 <_sk_callback_sse41+0x28c> + .byte 68,15,40,37,142,70,0,0 // movaps 0x468e(%rip),%xmm12 # 5260 <_sk_callback_sse41+0x283> .byte 69,15,89,252 // mulps %xmm12,%xmm15 .byte 69,15,88,254 // addps %xmm14,%xmm15 .byte 15,40,198 // movaps %xmm6,%xmm0 @@ -22892,12 +22743,12 @@ _sk_hue_sse41: .byte 68,15,84,208 // andps %xmm0,%xmm10 .byte 15,84,200 // andps %xmm0,%xmm1 .byte 68,15,84,232 // andps %xmm0,%xmm13 - .byte 15,40,5,2,68,0,0 // movaps 0x4402(%rip),%xmm0 # 5270 <_sk_callback_sse41+0x29c> + .byte 15,40,5,249,67,0,0 // movaps 0x43f9(%rip),%xmm0 # 5270 <_sk_callback_sse41+0x293> .byte 68,15,89,224 // mulps %xmm0,%xmm12 - .byte 15,40,21,7,68,0,0 // movaps 0x4407(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x2ac> + .byte 15,40,21,254,67,0,0 // movaps 0x43fe(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x2a3> .byte 15,89,250 // mulps %xmm2,%xmm7 .byte 65,15,88,252 // addps %xmm12,%xmm7 - .byte 68,15,40,53,8,68,0,0 // movaps 0x4408(%rip),%xmm14 # 5290 <_sk_callback_sse41+0x2bc> + .byte 68,15,40,53,255,67,0,0 // movaps 0x43ff(%rip),%xmm14 # 5290 <_sk_callback_sse41+0x2b3> .byte 68,15,40,252 // movaps %xmm4,%xmm15 .byte 69,15,89,254 // mulps %xmm14,%xmm15 .byte 68,15,88,255 // addps %xmm7,%xmm15 @@ -22980,7 +22831,7 @@ _sk_hue_sse41: .byte 65,15,88,214 // addps %xmm14,%xmm2 .byte 15,40,196 // movaps %xmm4,%xmm0 .byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1 - .byte 68,15,40,13,204,66,0,0 // movaps 0x42cc(%rip),%xmm9 # 52a0 <_sk_callback_sse41+0x2cc> + .byte 68,15,40,13,195,66,0,0 // movaps 0x42c3(%rip),%xmm9 # 52a0 <_sk_callback_sse41+0x2c3> .byte 65,15,40,225 // movaps %xmm9,%xmm4 .byte 15,92,229 // subps %xmm5,%xmm4 .byte 15,40,68,36,200 // movaps -0x38(%rsp),%xmm0 @@ -23074,14 +22925,14 @@ _sk_saturation_sse41: .byte 68,15,84,215 // andps %xmm7,%xmm10 .byte 68,15,84,223 // andps %xmm7,%xmm11 .byte 68,15,84,199 // andps %xmm7,%xmm8 - .byte 15,40,21,134,65,0,0 // movaps 0x4186(%rip),%xmm2 # 52b0 <_sk_callback_sse41+0x2dc> + .byte 15,40,21,125,65,0,0 // movaps 0x417d(%rip),%xmm2 # 52b0 <_sk_callback_sse41+0x2d3> .byte 15,40,221 // movaps %xmm5,%xmm3 .byte 15,89,218 // mulps %xmm2,%xmm3 - .byte 15,40,13,137,65,0,0 // movaps 0x4189(%rip),%xmm1 # 52c0 <_sk_callback_sse41+0x2ec> + .byte 15,40,13,128,65,0,0 // movaps 0x4180(%rip),%xmm1 # 52c0 <_sk_callback_sse41+0x2e3> .byte 15,40,254 // movaps %xmm6,%xmm7 .byte 15,89,249 // mulps %xmm1,%xmm7 .byte 15,88,251 // addps %xmm3,%xmm7 - .byte 68,15,40,45,136,65,0,0 // movaps 0x4188(%rip),%xmm13 # 52d0 <_sk_callback_sse41+0x2fc> + .byte 68,15,40,45,127,65,0,0 // movaps 0x417f(%rip),%xmm13 # 52d0 <_sk_callback_sse41+0x2f3> .byte 69,15,89,245 // mulps %xmm13,%xmm14 .byte 68,15,88,247 // addps %xmm7,%xmm14 .byte 65,15,40,218 // movaps %xmm10,%xmm3 @@ -23162,7 +23013,7 @@ _sk_saturation_sse41: .byte 65,15,88,253 // addps %xmm13,%xmm7 .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 102,68,15,56,20,223 // blendvps %xmm0,%xmm7,%xmm11 - .byte 68,15,40,13,78,64,0,0 // movaps 0x404e(%rip),%xmm9 # 52e0 <_sk_callback_sse41+0x30c> + .byte 68,15,40,13,69,64,0,0 // movaps 0x4045(%rip),%xmm9 # 52e0 <_sk_callback_sse41+0x303> .byte 69,15,40,193 // movaps %xmm9,%xmm8 .byte 68,15,92,204 // subps %xmm4,%xmm9 .byte 15,40,124,36,168 // movaps -0x58(%rsp),%xmm7 @@ -23217,14 +23068,14 @@ _sk_color_sse41: .byte 15,40,231 // movaps %xmm7,%xmm4 .byte 68,15,89,244 // mulps %xmm4,%xmm14 .byte 15,89,204 // mulps %xmm4,%xmm1 - .byte 68,15,40,13,153,63,0,0 // movaps 0x3f99(%rip),%xmm9 # 52f0 <_sk_callback_sse41+0x31c> + .byte 68,15,40,13,144,63,0,0 // movaps 0x3f90(%rip),%xmm9 # 52f0 <_sk_callback_sse41+0x313> .byte 65,15,40,250 // movaps %xmm10,%xmm7 .byte 65,15,89,249 // mulps %xmm9,%xmm7 - .byte 68,15,40,21,153,63,0,0 // movaps 0x3f99(%rip),%xmm10 # 5300 <_sk_callback_sse41+0x32c> + .byte 68,15,40,21,144,63,0,0 // movaps 0x3f90(%rip),%xmm10 # 5300 <_sk_callback_sse41+0x323> .byte 65,15,40,219 // movaps %xmm11,%xmm3 .byte 65,15,89,218 // mulps %xmm10,%xmm3 .byte 15,88,223 // addps %xmm7,%xmm3 - .byte 68,15,40,29,150,63,0,0 // movaps 0x3f96(%rip),%xmm11 # 5310 <_sk_callback_sse41+0x33c> + .byte 68,15,40,29,141,63,0,0 // movaps 0x3f8d(%rip),%xmm11 # 5310 <_sk_callback_sse41+0x333> .byte 69,15,40,236 // movaps %xmm12,%xmm13 .byte 69,15,89,235 // mulps %xmm11,%xmm13 .byte 68,15,88,235 // addps %xmm3,%xmm13 @@ -23309,7 +23160,7 @@ _sk_color_sse41: .byte 65,15,88,251 // addps %xmm11,%xmm7 .byte 65,15,40,194 // movaps %xmm10,%xmm0 .byte 102,15,56,20,207 // blendvps %xmm0,%xmm7,%xmm1 - .byte 68,15,40,13,82,62,0,0 // movaps 0x3e52(%rip),%xmm9 # 5320 <_sk_callback_sse41+0x34c> + .byte 68,15,40,13,73,62,0,0 // movaps 0x3e49(%rip),%xmm9 # 5320 <_sk_callback_sse41+0x343> .byte 65,15,40,193 // movaps %xmm9,%xmm0 .byte 15,92,196 // subps %xmm4,%xmm0 .byte 68,15,89,192 // mulps %xmm0,%xmm8 @@ -23361,13 +23212,13 @@ _sk_luminosity_sse41: .byte 69,15,89,216 // mulps %xmm8,%xmm11 .byte 68,15,40,203 // movaps %xmm3,%xmm9 .byte 68,15,89,205 // mulps %xmm5,%xmm9 - .byte 68,15,40,5,170,61,0,0 // movaps 0x3daa(%rip),%xmm8 # 5330 <_sk_callback_sse41+0x35c> + .byte 68,15,40,5,161,61,0,0 // movaps 0x3da1(%rip),%xmm8 # 5330 <_sk_callback_sse41+0x353> .byte 65,15,89,192 // mulps %xmm8,%xmm0 - .byte 68,15,40,21,174,61,0,0 // movaps 0x3dae(%rip),%xmm10 # 5340 <_sk_callback_sse41+0x36c> + .byte 68,15,40,21,165,61,0,0 // movaps 0x3da5(%rip),%xmm10 # 5340 <_sk_callback_sse41+0x363> .byte 15,40,233 // movaps %xmm1,%xmm5 .byte 65,15,89,234 // mulps %xmm10,%xmm5 .byte 15,88,232 // addps %xmm0,%xmm5 - .byte 68,15,40,37,172,61,0,0 // movaps 0x3dac(%rip),%xmm12 # 5350 <_sk_callback_sse41+0x37c> + .byte 68,15,40,37,163,61,0,0 // movaps 0x3da3(%rip),%xmm12 # 5350 <_sk_callback_sse41+0x373> .byte 68,15,40,242 // movaps %xmm2,%xmm14 .byte 69,15,89,244 // mulps %xmm12,%xmm14 .byte 68,15,88,245 // addps %xmm5,%xmm14 @@ -23452,7 +23303,7 @@ _sk_luminosity_sse41: .byte 65,15,88,244 // addps %xmm12,%xmm6 .byte 65,15,40,195 // movaps %xmm11,%xmm0 .byte 102,68,15,56,20,206 // blendvps %xmm0,%xmm6,%xmm9 - .byte 15,40,5,98,60,0,0 // movaps 0x3c62(%rip),%xmm0 # 5360 <_sk_callback_sse41+0x38c> + .byte 15,40,5,89,60,0,0 // movaps 0x3c59(%rip),%xmm0 # 5360 <_sk_callback_sse41+0x383> .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 15,92,215 // subps %xmm7,%xmm2 .byte 15,89,226 // mulps %xmm2,%xmm4 @@ -23492,23 +23343,23 @@ _sk_srcover_rgba_8888_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,217,0,0,0 // jne 1852 <_sk_srcover_rgba_8888_sse41+0xe7> + .byte 15,133,217,0,0,0 // jne 185b <_sk_srcover_rgba_8888_sse41+0xe7> .byte 243,15,111,60,144 // movdqu (%rax,%rdx,4),%xmm7 .byte 77,133,192 // test %r8,%r8 - .byte 102,15,111,37,231,59,0,0 // movdqa 0x3be7(%rip),%xmm4 # 5370 <_sk_callback_sse41+0x39c> + .byte 102,15,111,37,222,59,0,0 // movdqa 0x3bde(%rip),%xmm4 # 5370 <_sk_callback_sse41+0x393> .byte 102,15,219,231 // pand %xmm7,%xmm4 .byte 15,91,228 // cvtdq2ps %xmm4,%xmm4 .byte 102,15,111,239 // movdqa %xmm7,%xmm5 - .byte 102,15,56,0,45,227,59,0,0 // pshufb 0x3be3(%rip),%xmm5 # 5380 <_sk_callback_sse41+0x3ac> + .byte 102,15,56,0,45,218,59,0,0 // pshufb 0x3bda(%rip),%xmm5 # 5380 <_sk_callback_sse41+0x3a3> .byte 15,91,237 // cvtdq2ps %xmm5,%xmm5 .byte 102,15,111,247 // movdqa %xmm7,%xmm6 - .byte 102,15,56,0,53,227,59,0,0 // pshufb 0x3be3(%rip),%xmm6 # 5390 <_sk_callback_sse41+0x3bc> + .byte 102,15,56,0,53,218,59,0,0 // pshufb 0x3bda(%rip),%xmm6 # 5390 <_sk_callback_sse41+0x3b3> .byte 15,91,246 // cvtdq2ps %xmm6,%xmm6 .byte 102,15,114,215,24 // psrld $0x18,%xmm7 .byte 15,91,255 // cvtdq2ps %xmm7,%xmm7 - .byte 68,15,40,5,224,59,0,0 // movaps 0x3be0(%rip),%xmm8 # 53a0 <_sk_callback_sse41+0x3cc> + .byte 68,15,40,5,215,59,0,0 // movaps 0x3bd7(%rip),%xmm8 # 53a0 <_sk_callback_sse41+0x3c3> .byte 68,15,92,195 // subps %xmm3,%xmm8 - .byte 68,15,40,37,228,59,0,0 // movaps 0x3be4(%rip),%xmm12 # 53b0 <_sk_callback_sse41+0x3dc> + .byte 68,15,40,37,219,59,0,0 // movaps 0x3bdb(%rip),%xmm12 # 53b0 <_sk_callback_sse41+0x3d3> .byte 65,15,89,196 // mulps %xmm12,%xmm0 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -23534,7 +23385,7 @@ _sk_srcover_rgba_8888_sse41: .byte 102,15,114,240,24 // pslld $0x18,%xmm0 .byte 102,15,235,194 // por %xmm2,%xmm0 .byte 102,15,235,193 // por %xmm1,%xmm0 - .byte 117,89 // jne 1892 <_sk_srcover_rgba_8888_sse41+0x127> + .byte 117,89 // jne 189b <_sk_srcover_rgba_8888_sse41+0x127> .byte 243,15,127,4,144 // movdqu %xmm0,(%rax,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,193 // movaps %xmm9,%xmm0 @@ -23546,28 +23397,28 @@ _sk_srcover_rgba_8888_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,255 // pxor %xmm7,%xmm7 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,35 // je 1886 <_sk_srcover_rgba_8888_sse41+0x11b> + .byte 116,35 // je 188f <_sk_srcover_rgba_8888_sse41+0x11b> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 187e <_sk_srcover_rgba_8888_sse41+0x113> + .byte 116,21 // je 1887 <_sk_srcover_rgba_8888_sse41+0x113> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 15,133,11,255,255,255 // jne 177e <_sk_srcover_rgba_8888_sse41+0x13> + .byte 15,133,11,255,255,255 // jne 1787 <_sk_srcover_rgba_8888_sse41+0x13> .byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4 .byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7 .byte 102,15,58,34,124,144,4,1 // pinsrd $0x1,0x4(%rax,%rdx,4),%xmm7 .byte 102,15,58,34,60,144,0 // pinsrd $0x0,(%rax,%rdx,4),%xmm7 - .byte 233,236,254,255,255 // jmpq 177e <_sk_srcover_rgba_8888_sse41+0x13> + .byte 233,236,254,255,255 // jmpq 1787 <_sk_srcover_rgba_8888_sse41+0x13> .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,28 // je 18bb <_sk_srcover_rgba_8888_sse41+0x150> + .byte 116,28 // je 18c4 <_sk_srcover_rgba_8888_sse41+0x150> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,14 // je 18b3 <_sk_srcover_rgba_8888_sse41+0x148> + .byte 116,14 // je 18bc <_sk_srcover_rgba_8888_sse41+0x148> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,147 // jne 183e <_sk_srcover_rgba_8888_sse41+0xd3> + .byte 117,147 // jne 1847 <_sk_srcover_rgba_8888_sse41+0xd3> .byte 102,15,58,22,68,144,8,2 // pextrd $0x2,%xmm0,0x8(%rax,%rdx,4) .byte 102,15,58,22,68,144,4,1 // pextrd $0x1,%xmm0,0x4(%rax,%rdx,4) .byte 102,15,126,4,144 // movd %xmm0,(%rax,%rdx,4) - .byte 233,121,255,255,255 // jmpq 183e <_sk_srcover_rgba_8888_sse41+0xd3> + .byte 233,121,255,255,255 // jmpq 1847 <_sk_srcover_rgba_8888_sse41+0xd3> HIDDEN _sk_clamp_0_sse41 .globl _sk_clamp_0_sse41 @@ -23585,7 +23436,7 @@ HIDDEN _sk_clamp_1_sse41 .globl _sk_clamp_1_sse41 FUNCTION(_sk_clamp_1_sse41) _sk_clamp_1_sse41: - .byte 68,15,40,5,219,58,0,0 // movaps 0x3adb(%rip),%xmm8 # 53c0 <_sk_callback_sse41+0x3ec> + .byte 68,15,40,5,210,58,0,0 // movaps 0x3ad2(%rip),%xmm8 # 53c0 <_sk_callback_sse41+0x3e3> .byte 65,15,93,192 // minps %xmm8,%xmm0 .byte 65,15,93,200 // minps %xmm8,%xmm1 .byte 65,15,93,208 // minps %xmm8,%xmm2 @@ -23597,7 +23448,7 @@ HIDDEN _sk_clamp_a_sse41 .globl _sk_clamp_a_sse41 FUNCTION(_sk_clamp_a_sse41) _sk_clamp_a_sse41: - .byte 15,93,29,208,58,0,0 // minps 0x3ad0(%rip),%xmm3 # 53d0 <_sk_callback_sse41+0x3fc> + .byte 15,93,29,199,58,0,0 // minps 0x3ac7(%rip),%xmm3 # 53d0 <_sk_callback_sse41+0x3f3> .byte 15,93,195 // minps %xmm3,%xmm0 .byte 15,93,203 // minps %xmm3,%xmm1 .byte 15,93,211 // minps %xmm3,%xmm2 @@ -23684,7 +23535,7 @@ HIDDEN _sk_unpremul_sse41 FUNCTION(_sk_unpremul_sse41) _sk_unpremul_sse41: .byte 69,15,87,192 // xorps %xmm8,%xmm8 - .byte 68,15,40,13,59,58,0,0 // movaps 0x3a3b(%rip),%xmm9 # 53e0 <_sk_callback_sse41+0x40c> + .byte 68,15,40,13,50,58,0,0 // movaps 0x3a32(%rip),%xmm9 # 53e0 <_sk_callback_sse41+0x403> .byte 68,15,94,203 // divps %xmm3,%xmm9 .byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8 .byte 69,15,84,193 // andps %xmm9,%xmm8 @@ -23698,20 +23549,20 @@ HIDDEN _sk_from_srgb_sse41 .globl _sk_from_srgb_sse41 FUNCTION(_sk_from_srgb_sse41) _sk_from_srgb_sse41: - .byte 68,15,40,29,38,58,0,0 // movaps 0x3a26(%rip),%xmm11 # 53f0 <_sk_callback_sse41+0x41c> + .byte 68,15,40,29,29,58,0,0 // movaps 0x3a1d(%rip),%xmm11 # 53f0 <_sk_callback_sse41+0x413> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 .byte 68,15,40,208 // movaps %xmm0,%xmm10 .byte 69,15,89,210 // mulps %xmm10,%xmm10 - .byte 68,15,40,37,30,58,0,0 // movaps 0x3a1e(%rip),%xmm12 # 5400 <_sk_callback_sse41+0x42c> + .byte 68,15,40,37,21,58,0,0 // movaps 0x3a15(%rip),%xmm12 # 5400 <_sk_callback_sse41+0x423> .byte 68,15,40,192 // movaps %xmm0,%xmm8 .byte 69,15,89,196 // mulps %xmm12,%xmm8 - .byte 68,15,40,45,30,58,0,0 // movaps 0x3a1e(%rip),%xmm13 # 5410 <_sk_callback_sse41+0x43c> + .byte 68,15,40,45,21,58,0,0 // movaps 0x3a15(%rip),%xmm13 # 5410 <_sk_callback_sse41+0x433> .byte 69,15,88,197 // addps %xmm13,%xmm8 .byte 69,15,89,194 // mulps %xmm10,%xmm8 - .byte 68,15,40,53,30,58,0,0 // movaps 0x3a1e(%rip),%xmm14 # 5420 <_sk_callback_sse41+0x44c> + .byte 68,15,40,53,21,58,0,0 // movaps 0x3a15(%rip),%xmm14 # 5420 <_sk_callback_sse41+0x443> .byte 69,15,88,198 // addps %xmm14,%xmm8 - .byte 68,15,40,61,34,58,0,0 // movaps 0x3a22(%rip),%xmm15 # 5430 <_sk_callback_sse41+0x45c> + .byte 68,15,40,61,25,58,0,0 // movaps 0x3a19(%rip),%xmm15 # 5430 <_sk_callback_sse41+0x453> .byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0 .byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8 .byte 68,15,40,209 // movaps %xmm1,%xmm10 @@ -23754,22 +23605,22 @@ _sk_to_srgb_sse41: .byte 15,40,218 // movaps %xmm2,%xmm3 .byte 15,40,209 // movaps %xmm1,%xmm2 .byte 68,15,82,192 // rsqrtps %xmm0,%xmm8 - .byte 68,15,40,29,154,57,0,0 // movaps 0x399a(%rip),%xmm11 # 5440 <_sk_callback_sse41+0x46c> + .byte 68,15,40,29,145,57,0,0 // movaps 0x3991(%rip),%xmm11 # 5440 <_sk_callback_sse41+0x463> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 - .byte 68,15,40,37,154,57,0,0 // movaps 0x399a(%rip),%xmm12 # 5450 <_sk_callback_sse41+0x47c> + .byte 68,15,40,37,145,57,0,0 // movaps 0x3991(%rip),%xmm12 # 5450 <_sk_callback_sse41+0x473> .byte 69,15,40,248 // movaps %xmm8,%xmm15 .byte 69,15,89,252 // mulps %xmm12,%xmm15 - .byte 68,15,40,21,154,57,0,0 // movaps 0x399a(%rip),%xmm10 # 5460 <_sk_callback_sse41+0x48c> + .byte 68,15,40,21,145,57,0,0 // movaps 0x3991(%rip),%xmm10 # 5460 <_sk_callback_sse41+0x483> .byte 69,15,88,250 // addps %xmm10,%xmm15 .byte 69,15,89,248 // mulps %xmm8,%xmm15 - .byte 68,15,40,45,154,57,0,0 // movaps 0x399a(%rip),%xmm13 # 5470 <_sk_callback_sse41+0x49c> + .byte 68,15,40,45,145,57,0,0 // movaps 0x3991(%rip),%xmm13 # 5470 <_sk_callback_sse41+0x493> .byte 69,15,88,253 // addps %xmm13,%xmm15 - .byte 68,15,40,53,158,57,0,0 // movaps 0x399e(%rip),%xmm14 # 5480 <_sk_callback_sse41+0x4ac> + .byte 68,15,40,53,149,57,0,0 // movaps 0x3995(%rip),%xmm14 # 5480 <_sk_callback_sse41+0x4a3> .byte 69,15,88,198 // addps %xmm14,%xmm8 .byte 69,15,83,192 // rcpps %xmm8,%xmm8 .byte 69,15,89,199 // mulps %xmm15,%xmm8 - .byte 68,15,40,61,154,57,0,0 // movaps 0x399a(%rip),%xmm15 # 5490 <_sk_callback_sse41+0x4bc> + .byte 68,15,40,61,145,57,0,0 // movaps 0x3991(%rip),%xmm15 # 5490 <_sk_callback_sse41+0x4b3> .byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0 .byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8 .byte 68,15,82,202 // rsqrtps %xmm2,%xmm9 @@ -23822,7 +23673,7 @@ _sk_rgb_to_hsl_sse41: .byte 68,15,93,226 // minps %xmm2,%xmm12 .byte 65,15,40,203 // movaps %xmm11,%xmm1 .byte 65,15,92,204 // subps %xmm12,%xmm1 - .byte 68,15,40,53,231,56,0,0 // movaps 0x38e7(%rip),%xmm14 # 54a0 <_sk_callback_sse41+0x4cc> + .byte 68,15,40,53,222,56,0,0 // movaps 0x38de(%rip),%xmm14 # 54a0 <_sk_callback_sse41+0x4c3> .byte 68,15,94,241 // divps %xmm1,%xmm14 .byte 69,15,40,211 // movaps %xmm11,%xmm10 .byte 69,15,194,208,0 // cmpeqps %xmm8,%xmm10 @@ -23831,27 +23682,27 @@ _sk_rgb_to_hsl_sse41: .byte 65,15,89,198 // mulps %xmm14,%xmm0 .byte 69,15,40,249 // movaps %xmm9,%xmm15 .byte 68,15,194,250,1 // cmpltps %xmm2,%xmm15 - .byte 68,15,84,61,206,56,0,0 // andps 0x38ce(%rip),%xmm15 # 54b0 <_sk_callback_sse41+0x4dc> + .byte 68,15,84,61,197,56,0,0 // andps 0x38c5(%rip),%xmm15 # 54b0 <_sk_callback_sse41+0x4d3> .byte 68,15,88,248 // addps %xmm0,%xmm15 .byte 65,15,40,195 // movaps %xmm11,%xmm0 .byte 65,15,194,193,0 // cmpeqps %xmm9,%xmm0 .byte 65,15,92,208 // subps %xmm8,%xmm2 .byte 65,15,89,214 // mulps %xmm14,%xmm2 - .byte 68,15,40,45,193,56,0,0 // movaps 0x38c1(%rip),%xmm13 # 54c0 <_sk_callback_sse41+0x4ec> + .byte 68,15,40,45,184,56,0,0 // movaps 0x38b8(%rip),%xmm13 # 54c0 <_sk_callback_sse41+0x4e3> .byte 65,15,88,213 // addps %xmm13,%xmm2 .byte 69,15,92,193 // subps %xmm9,%xmm8 .byte 69,15,89,198 // mulps %xmm14,%xmm8 - .byte 68,15,88,5,189,56,0,0 // addps 0x38bd(%rip),%xmm8 # 54d0 <_sk_callback_sse41+0x4fc> + .byte 68,15,88,5,180,56,0,0 // addps 0x38b4(%rip),%xmm8 # 54d0 <_sk_callback_sse41+0x4f3> .byte 102,68,15,56,20,194 // blendvps %xmm0,%xmm2,%xmm8 .byte 65,15,40,194 // movaps %xmm10,%xmm0 .byte 102,69,15,56,20,199 // blendvps %xmm0,%xmm15,%xmm8 - .byte 68,15,89,5,181,56,0,0 // mulps 0x38b5(%rip),%xmm8 # 54e0 <_sk_callback_sse41+0x50c> + .byte 68,15,89,5,172,56,0,0 // mulps 0x38ac(%rip),%xmm8 # 54e0 <_sk_callback_sse41+0x503> .byte 69,15,40,203 // movaps %xmm11,%xmm9 .byte 69,15,194,204,4 // cmpneqps %xmm12,%xmm9 .byte 69,15,84,193 // andps %xmm9,%xmm8 .byte 69,15,92,235 // subps %xmm11,%xmm13 .byte 69,15,88,220 // addps %xmm12,%xmm11 - .byte 15,40,5,169,56,0,0 // movaps 0x38a9(%rip),%xmm0 # 54f0 <_sk_callback_sse41+0x51c> + .byte 15,40,5,160,56,0,0 // movaps 0x38a0(%rip),%xmm0 # 54f0 <_sk_callback_sse41+0x513> .byte 65,15,40,211 // movaps %xmm11,%xmm2 .byte 15,89,208 // mulps %xmm0,%xmm2 .byte 15,194,194,1 // cmpltps %xmm2,%xmm0 @@ -23873,7 +23724,7 @@ _sk_hsl_to_rgb_sse41: .byte 15,41,100,36,184 // movaps %xmm4,-0x48(%rsp) .byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp) .byte 68,15,40,208 // movaps %xmm0,%xmm10 - .byte 68,15,40,13,111,56,0,0 // movaps 0x386f(%rip),%xmm9 # 5500 <_sk_callback_sse41+0x52c> + .byte 68,15,40,13,102,56,0,0 // movaps 0x3866(%rip),%xmm9 # 5500 <_sk_callback_sse41+0x523> .byte 65,15,40,193 // movaps %xmm9,%xmm0 .byte 15,194,194,2 // cmpleps %xmm2,%xmm0 .byte 15,40,217 // movaps %xmm1,%xmm3 @@ -23886,19 +23737,19 @@ _sk_hsl_to_rgb_sse41: .byte 15,41,84,36,152 // movaps %xmm2,-0x68(%rsp) .byte 69,15,88,192 // addps %xmm8,%xmm8 .byte 68,15,92,197 // subps %xmm5,%xmm8 - .byte 68,15,40,53,74,56,0,0 // movaps 0x384a(%rip),%xmm14 # 5510 <_sk_callback_sse41+0x53c> + .byte 68,15,40,53,65,56,0,0 // movaps 0x3841(%rip),%xmm14 # 5510 <_sk_callback_sse41+0x533> .byte 69,15,88,242 // addps %xmm10,%xmm14 .byte 102,65,15,58,8,198,1 // roundps $0x1,%xmm14,%xmm0 .byte 68,15,92,240 // subps %xmm0,%xmm14 - .byte 68,15,40,29,67,56,0,0 // movaps 0x3843(%rip),%xmm11 # 5520 <_sk_callback_sse41+0x54c> + .byte 68,15,40,29,58,56,0,0 // movaps 0x383a(%rip),%xmm11 # 5520 <_sk_callback_sse41+0x543> .byte 65,15,40,195 // movaps %xmm11,%xmm0 .byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0 .byte 15,40,245 // movaps %xmm5,%xmm6 .byte 65,15,92,240 // subps %xmm8,%xmm6 - .byte 15,40,61,60,56,0,0 // movaps 0x383c(%rip),%xmm7 # 5530 <_sk_callback_sse41+0x55c> + .byte 15,40,61,51,56,0,0 // movaps 0x3833(%rip),%xmm7 # 5530 <_sk_callback_sse41+0x553> .byte 69,15,40,238 // movaps %xmm14,%xmm13 .byte 68,15,89,239 // mulps %xmm7,%xmm13 - .byte 15,40,29,61,56,0,0 // movaps 0x383d(%rip),%xmm3 # 5540 <_sk_callback_sse41+0x56c> + .byte 15,40,29,52,56,0,0 // movaps 0x3834(%rip),%xmm3 # 5540 <_sk_callback_sse41+0x563> .byte 68,15,40,227 // movaps %xmm3,%xmm12 .byte 69,15,92,229 // subps %xmm13,%xmm12 .byte 68,15,89,230 // mulps %xmm6,%xmm12 @@ -23908,7 +23759,7 @@ _sk_hsl_to_rgb_sse41: .byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0 .byte 68,15,40,253 // movaps %xmm5,%xmm15 .byte 102,69,15,56,20,252 // blendvps %xmm0,%xmm12,%xmm15 - .byte 68,15,40,37,28,56,0,0 // movaps 0x381c(%rip),%xmm12 # 5550 <_sk_callback_sse41+0x57c> + .byte 68,15,40,37,19,56,0,0 // movaps 0x3813(%rip),%xmm12 # 5550 <_sk_callback_sse41+0x573> .byte 65,15,40,196 // movaps %xmm12,%xmm0 .byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0 .byte 68,15,89,238 // mulps %xmm6,%xmm13 @@ -23942,7 +23793,7 @@ _sk_hsl_to_rgb_sse41: .byte 65,15,40,198 // movaps %xmm14,%xmm0 .byte 15,40,84,36,152 // movaps -0x68(%rsp),%xmm2 .byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1 - .byte 68,15,88,21,148,55,0,0 // addps 0x3794(%rip),%xmm10 # 5560 <_sk_callback_sse41+0x58c> + .byte 68,15,88,21,139,55,0,0 // addps 0x378b(%rip),%xmm10 # 5560 <_sk_callback_sse41+0x583> .byte 102,65,15,58,8,194,1 // roundps $0x1,%xmm10,%xmm0 .byte 68,15,92,208 // subps %xmm0,%xmm10 .byte 69,15,194,218,2 // cmpleps %xmm10,%xmm11 @@ -23993,11 +23844,11 @@ _sk_scale_u8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,52 // jne 1ea5 <_sk_scale_u8_sse41+0x3e> + .byte 117,52 // jne 1eae <_sk_scale_u8_sse41+0x3e> .byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8 - .byte 102,68,15,219,5,239,54,0,0 // pand 0x36ef(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x59c> + .byte 102,68,15,219,5,230,54,0,0 // pand 0x36e6(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x593> .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,243,54,0,0 // mulps 0x36f3(%rip),%xmm8 # 5580 <_sk_callback_sse41+0x5ac> + .byte 68,15,89,5,234,54,0,0 // mulps 0x36ea(%rip),%xmm8 # 5580 <_sk_callback_sse41+0x5a3> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 65,15,89,208 // mulps %xmm8,%xmm2 @@ -24009,11 +23860,11 @@ _sk_scale_u8_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,42 // je 1ee1 <_sk_scale_u8_sse41+0x7a> + .byte 116,42 // je 1eea <_sk_scale_u8_sse41+0x7a> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,23 // je 1ed4 <_sk_scale_u8_sse41+0x6d> + .byte 116,23 // je 1edd <_sk_scale_u8_sse41+0x6d> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,181 // jne 1e78 <_sk_scale_u8_sse41+0x11> + .byte 117,181 // jne 1e81 <_sk_scale_u8_sse41+0x11> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8 @@ -24021,7 +23872,7 @@ _sk_scale_u8_sse41: .byte 102,68,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm8 .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,68,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm8 - .byte 235,137 // jmp 1e78 <_sk_scale_u8_sse41+0x11> + .byte 235,137 // jmp 1e81 <_sk_scale_u8_sse41+0x11> HIDDEN _sk_lerp_1_float_sse41 .globl _sk_lerp_1_float_sse41 @@ -24052,11 +23903,11 @@ _sk_lerp_u8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,72 // jne 1f79 <_sk_lerp_u8_sse41+0x52> + .byte 117,72 // jne 1f82 <_sk_lerp_u8_sse41+0x52> .byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8 - .byte 102,68,15,219,5,79,54,0,0 // pand 0x364f(%rip),%xmm8 # 5590 <_sk_callback_sse41+0x5bc> + .byte 102,68,15,219,5,70,54,0,0 // pand 0x3646(%rip),%xmm8 # 5590 <_sk_callback_sse41+0x5b3> .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,83,54,0,0 // mulps 0x3653(%rip),%xmm8 # 55a0 <_sk_callback_sse41+0x5cc> + .byte 68,15,89,5,74,54,0,0 // mulps 0x364a(%rip),%xmm8 # 55a0 <_sk_callback_sse41+0x5c3> .byte 15,92,196 // subps %xmm4,%xmm0 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -24075,11 +23926,11 @@ _sk_lerp_u8_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,42 // je 1fb5 <_sk_lerp_u8_sse41+0x8e> + .byte 116,42 // je 1fbe <_sk_lerp_u8_sse41+0x8e> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,23 // je 1fa8 <_sk_lerp_u8_sse41+0x81> + .byte 116,23 // je 1fb1 <_sk_lerp_u8_sse41+0x81> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,161 // jne 1f38 <_sk_lerp_u8_sse41+0x11> + .byte 117,161 // jne 1f41 <_sk_lerp_u8_sse41+0x11> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8 @@ -24087,7 +23938,7 @@ _sk_lerp_u8_sse41: .byte 102,68,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm8 .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,68,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm8 - .byte 233,114,255,255,255 // jmpq 1f38 <_sk_lerp_u8_sse41+0x11> + .byte 233,114,255,255,255 // jmpq 1f41 <_sk_lerp_u8_sse41+0x11> HIDDEN _sk_lerp_565_sse41 .globl _sk_lerp_565_sse41 @@ -24096,19 +23947,19 @@ _sk_lerp_565_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,152,0,0,0 // jne 206c <_sk_lerp_565_sse41+0xa6> + .byte 15,133,152,0,0,0 // jne 2075 <_sk_lerp_565_sse41+0xa6> .byte 102,69,15,56,51,12,82 // pmovzxwd (%r10,%rdx,2),%xmm9 - .byte 102,68,15,111,5,204,53,0,0 // movdqa 0x35cc(%rip),%xmm8 # 55b0 <_sk_callback_sse41+0x5dc> + .byte 102,68,15,111,5,195,53,0,0 // movdqa 0x35c3(%rip),%xmm8 # 55b0 <_sk_callback_sse41+0x5d3> .byte 102,69,15,219,193 // pand %xmm9,%xmm8 .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,203,53,0,0 // mulps 0x35cb(%rip),%xmm8 # 55c0 <_sk_callback_sse41+0x5ec> - .byte 102,68,15,111,21,210,53,0,0 // movdqa 0x35d2(%rip),%xmm10 # 55d0 <_sk_callback_sse41+0x5fc> + .byte 68,15,89,5,194,53,0,0 // mulps 0x35c2(%rip),%xmm8 # 55c0 <_sk_callback_sse41+0x5e3> + .byte 102,68,15,111,21,201,53,0,0 // movdqa 0x35c9(%rip),%xmm10 # 55d0 <_sk_callback_sse41+0x5f3> .byte 102,69,15,219,209 // pand %xmm9,%xmm10 .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 - .byte 68,15,89,21,209,53,0,0 // mulps 0x35d1(%rip),%xmm10 # 55e0 <_sk_callback_sse41+0x60c> - .byte 102,68,15,219,13,216,53,0,0 // pand 0x35d8(%rip),%xmm9 # 55f0 <_sk_callback_sse41+0x61c> + .byte 68,15,89,21,200,53,0,0 // mulps 0x35c8(%rip),%xmm10 # 55e0 <_sk_callback_sse41+0x603> + .byte 102,68,15,219,13,207,53,0,0 // pand 0x35cf(%rip),%xmm9 # 55f0 <_sk_callback_sse41+0x613> .byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9 - .byte 68,15,89,13,220,53,0,0 // mulps 0x35dc(%rip),%xmm9 # 5600 <_sk_callback_sse41+0x62c> + .byte 68,15,89,13,211,53,0,0 // mulps 0x35d3(%rip),%xmm9 # 5600 <_sk_callback_sse41+0x623> .byte 15,92,196 // subps %xmm4,%xmm0 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -24134,11 +23985,11 @@ _sk_lerp_565_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,46 // je 20ac <_sk_lerp_565_sse41+0xe6> + .byte 116,46 // je 20b5 <_sk_lerp_565_sse41+0xe6> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,27 // je 209f <_sk_lerp_565_sse41+0xd9> + .byte 116,27 // je 20a8 <_sk_lerp_565_sse41+0xd9> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 15,133,77,255,255,255 // jne 1fdb <_sk_lerp_565_sse41+0x15> + .byte 15,133,77,255,255,255 // jne 1fe4 <_sk_lerp_565_sse41+0x15> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,200,69 // pshufd $0x45,%xmm8,%xmm9 @@ -24146,7 +23997,7 @@ _sk_lerp_565_sse41: .byte 102,68,15,58,34,200,1 // pinsrd $0x1,%eax,%xmm9 .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,68,15,58,34,200,0 // pinsrd $0x0,%eax,%xmm9 - .byte 233,30,255,255,255 // jmpq 1fdb <_sk_lerp_565_sse41+0x15> + .byte 233,30,255,255,255 // jmpq 1fe4 <_sk_lerp_565_sse41+0x15> HIDDEN _sk_load_tables_sse41 .globl _sk_load_tables_sse41 @@ -24155,12 +24006,12 @@ _sk_load_tables_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,24,1,0,0 // jne 21e3 <_sk_load_tables_sse41+0x126> + .byte 15,133,24,1,0,0 // jne 21ec <_sk_load_tables_sse41+0x126> .byte 243,69,15,111,4,145 // movdqu (%r9,%rdx,4),%xmm8 .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 83 // push %rbx - .byte 102,15,111,5,50,53,0,0 // movdqa 0x3532(%rip),%xmm0 # 5610 <_sk_callback_sse41+0x63c> + .byte 102,15,111,5,41,53,0,0 // movdqa 0x3529(%rip),%xmm0 # 5610 <_sk_callback_sse41+0x633> .byte 102,65,15,219,192 // pand %xmm8,%xmm0 .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9 .byte 102,73,15,126,194 // movq %xmm0,%r10 @@ -24175,7 +24026,7 @@ _sk_load_tables_sse41: .byte 102,66,15,58,33,4,179,32 // insertps $0x20,(%rbx,%r14,4),%xmm0 .byte 102,66,15,58,33,4,11,48 // insertps $0x30,(%rbx,%r9,1),%xmm0 .byte 102,65,15,111,200 // movdqa %xmm8,%xmm1 - .byte 102,15,56,0,13,237,52,0,0 // pshufb 0x34ed(%rip),%xmm1 # 5620 <_sk_callback_sse41+0x64c> + .byte 102,15,56,0,13,228,52,0,0 // pshufb 0x34e4(%rip),%xmm1 # 5620 <_sk_callback_sse41+0x643> .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9 .byte 102,72,15,126,203 // movq %xmm1,%rbx .byte 68,15,182,211 // movzbl %bl,%r10d @@ -24190,7 +24041,7 @@ _sk_load_tables_sse41: .byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1 .byte 76,139,72,24 // mov 0x18(%rax),%r9 .byte 102,65,15,111,208 // movdqa %xmm8,%xmm2 - .byte 102,15,56,0,21,169,52,0,0 // pshufb 0x34a9(%rip),%xmm2 # 5630 <_sk_callback_sse41+0x65c> + .byte 102,15,56,0,21,160,52,0,0 // pshufb 0x34a0(%rip),%xmm2 # 5630 <_sk_callback_sse41+0x653> .byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx .byte 102,72,15,126,208 // movq %xmm2,%rax .byte 68,15,182,208 // movzbl %al,%r10d @@ -24205,7 +24056,7 @@ _sk_load_tables_sse41: .byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2 .byte 102,65,15,114,208,24 // psrld $0x18,%xmm8 .byte 65,15,91,216 // cvtdq2ps %xmm8,%xmm3 - .byte 15,89,29,102,52,0,0 // mulps 0x3466(%rip),%xmm3 # 5640 <_sk_callback_sse41+0x66c> + .byte 15,89,29,93,52,0,0 // mulps 0x345d(%rip),%xmm3 # 5640 <_sk_callback_sse41+0x663> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 65,94 // pop %r14 @@ -24215,16 +24066,16 @@ _sk_load_tables_sse41: .byte 65,128,226,3 // and $0x3,%r10b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,250,1 // cmp $0x1,%r10b - .byte 116,38 // je 221b <_sk_load_tables_sse41+0x15e> + .byte 116,38 // je 2224 <_sk_load_tables_sse41+0x15e> .byte 65,128,250,2 // cmp $0x2,%r10b - .byte 116,23 // je 2212 <_sk_load_tables_sse41+0x155> + .byte 116,23 // je 221b <_sk_load_tables_sse41+0x155> .byte 65,128,250,3 // cmp $0x3,%r10b - .byte 15,133,204,254,255,255 // jne 20d1 <_sk_load_tables_sse41+0x14> + .byte 15,133,204,254,255,255 // jne 20da <_sk_load_tables_sse41+0x14> .byte 102,65,15,110,68,145,8 // movd 0x8(%r9,%rdx,4),%xmm0 .byte 102,68,15,112,192,69 // pshufd $0x45,%xmm0,%xmm8 .byte 102,69,15,58,34,68,145,4,1 // pinsrd $0x1,0x4(%r9,%rdx,4),%xmm8 .byte 102,69,15,58,34,4,145,0 // pinsrd $0x0,(%r9,%rdx,4),%xmm8 - .byte 233,169,254,255,255 // jmpq 20d1 <_sk_load_tables_sse41+0x14> + .byte 233,169,254,255,255 // jmpq 20da <_sk_load_tables_sse41+0x14> HIDDEN _sk_load_tables_u16_be_sse41 .globl _sk_load_tables_u16_be_sse41 @@ -24234,7 +24085,7 @@ _sk_load_tables_u16_be_sse41: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,99,1,0,0 // jne 23a1 <_sk_load_tables_u16_be_sse41+0x179> + .byte 15,133,99,1,0,0 // jne 23aa <_sk_load_tables_u16_be_sse41+0x179> .byte 102,67,15,16,4,81 // movupd (%r9,%r10,2),%xmm0 .byte 243,67,15,111,76,81,16 // movdqu 0x10(%r9,%r10,2),%xmm1 .byte 65,87 // push %r15 @@ -24246,7 +24097,7 @@ _sk_load_tables_u16_be_sse41: .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1 .byte 102,15,97,200 // punpcklwd %xmm0,%xmm1 .byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9 - .byte 102,68,15,111,5,219,51,0,0 // movdqa 0x33db(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x67c> + .byte 102,68,15,111,5,210,51,0,0 // movdqa 0x33d2(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x673> .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,65,15,219,192 // pand %xmm8,%xmm0 .byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0 @@ -24264,7 +24115,7 @@ _sk_load_tables_u16_be_sse41: .byte 102,15,58,33,194,32 // insertps $0x20,%xmm2,%xmm0 .byte 243,66,15,16,20,11 // movss (%rbx,%r9,1),%xmm2 .byte 102,15,58,33,194,48 // insertps $0x30,%xmm2,%xmm0 - .byte 102,15,56,0,13,138,51,0,0 // pshufb 0x338a(%rip),%xmm1 # 5660 <_sk_callback_sse41+0x68c> + .byte 102,15,56,0,13,129,51,0,0 // pshufb 0x3381(%rip),%xmm1 # 5660 <_sk_callback_sse41+0x683> .byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1 .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9 .byte 102,72,15,126,203 // movq %xmm1,%rbx @@ -24300,7 +24151,7 @@ _sk_load_tables_u16_be_sse41: .byte 102,65,15,235,216 // por %xmm8,%xmm3 .byte 102,15,56,51,219 // pmovzxwd %xmm3,%xmm3 .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,216,50,0,0 // mulps 0x32d8(%rip),%xmm3 # 5670 <_sk_callback_sse41+0x69c> + .byte 15,89,29,207,50,0,0 // mulps 0x32cf(%rip),%xmm3 # 5670 <_sk_callback_sse41+0x693> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 65,94 // pop %r14 @@ -24308,16 +24159,16 @@ _sk_load_tables_u16_be_sse41: .byte 255,224 // jmpq *%rax .byte 242,67,15,16,4,81 // movsd (%r9,%r10,2),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,13 // jne 23ba <_sk_load_tables_u16_be_sse41+0x192> + .byte 117,13 // jne 23c3 <_sk_load_tables_u16_be_sse41+0x192> .byte 243,15,126,192 // movq %xmm0,%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,145,254,255,255 // jmpq 224b <_sk_load_tables_u16_be_sse41+0x23> + .byte 233,145,254,255,255 // jmpq 2254 <_sk_load_tables_u16_be_sse41+0x23> .byte 102,67,15,22,68,81,8 // movhpd 0x8(%r9,%r10,2),%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,124,254,255,255 // jb 224b <_sk_load_tables_u16_be_sse41+0x23> + .byte 15,130,124,254,255,255 // jb 2254 <_sk_load_tables_u16_be_sse41+0x23> .byte 243,67,15,126,76,81,16 // movq 0x10(%r9,%r10,2),%xmm1 - .byte 233,112,254,255,255 // jmpq 224b <_sk_load_tables_u16_be_sse41+0x23> + .byte 233,112,254,255,255 // jmpq 2254 <_sk_load_tables_u16_be_sse41+0x23> HIDDEN _sk_load_tables_rgb_u16_be_sse41 .globl _sk_load_tables_rgb_u16_be_sse41 @@ -24327,7 +24178,7 @@ _sk_load_tables_rgb_u16_be_sse41: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,83,1,0,0 // jne 2540 <_sk_load_tables_rgb_u16_be_sse41+0x165> + .byte 15,133,83,1,0,0 // jne 2549 <_sk_load_tables_rgb_u16_be_sse41+0x165> .byte 243,67,15,111,20,81 // movdqu (%r9,%r10,2),%xmm2 .byte 243,67,15,111,76,81,8 // movdqu 0x8(%r9,%r10,2),%xmm1 .byte 102,15,115,217,4 // psrldq $0x4,%xmm1 @@ -24342,7 +24193,7 @@ _sk_load_tables_rgb_u16_be_sse41: .byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9 .byte 102,15,111,202 // movdqa %xmm2,%xmm1 .byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1 - .byte 102,68,15,111,5,77,50,0,0 // movdqa 0x324d(%rip),%xmm8 # 5680 <_sk_callback_sse41+0x6ac> + .byte 102,68,15,111,5,68,50,0,0 // movdqa 0x3244(%rip),%xmm8 # 5680 <_sk_callback_sse41+0x6a3> .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,65,15,219,192 // pand %xmm8,%xmm0 .byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0 @@ -24360,7 +24211,7 @@ _sk_load_tables_rgb_u16_be_sse41: .byte 102,15,58,33,195,32 // insertps $0x20,%xmm3,%xmm0 .byte 243,66,15,16,28,11 // movss (%rbx,%r9,1),%xmm3 .byte 102,15,58,33,195,48 // insertps $0x30,%xmm3,%xmm0 - .byte 102,15,56,0,13,252,49,0,0 // pshufb 0x31fc(%rip),%xmm1 # 5690 <_sk_callback_sse41+0x6bc> + .byte 102,15,56,0,13,243,49,0,0 // pshufb 0x31f3(%rip),%xmm1 # 5690 <_sk_callback_sse41+0x6b3> .byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1 .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9 .byte 102,72,15,126,203 // movq %xmm1,%rbx @@ -24391,7 +24242,7 @@ _sk_load_tables_rgb_u16_be_sse41: .byte 243,65,15,16,28,25 // movss (%r9,%rbx,1),%xmm3 .byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,103,49,0,0 // movaps 0x3167(%rip),%xmm3 # 56a0 <_sk_callback_sse41+0x6cc> + .byte 15,40,29,94,49,0,0 // movaps 0x315e(%rip),%xmm3 # 56a0 <_sk_callback_sse41+0x6c3> .byte 91 // pop %rbx .byte 65,94 // pop %r14 .byte 65,95 // pop %r15 @@ -24400,21 +24251,21 @@ _sk_load_tables_rgb_u16_be_sse41: .byte 102,67,15,196,84,81,4,2 // pinsrw $0x2,0x4(%r9,%r10,2),%xmm2 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,14 // jne 2566 <_sk_load_tables_rgb_u16_be_sse41+0x18b> + .byte 117,14 // jne 256f <_sk_load_tables_rgb_u16_be_sse41+0x18b> .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 - .byte 233,173,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38> + .byte 233,173,254,255,255 // jmpq 241c <_sk_load_tables_rgb_u16_be_sse41+0x38> .byte 102,71,15,110,76,81,6 // movd 0x6(%r9,%r10,2),%xmm9 .byte 102,71,15,196,76,81,10,2 // pinsrw $0x2,0xa(%r9,%r10,2),%xmm9 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,24 // jb 2597 <_sk_load_tables_rgb_u16_be_sse41+0x1bc> + .byte 114,24 // jb 25a0 <_sk_load_tables_rgb_u16_be_sse41+0x1bc> .byte 102,67,15,110,76,81,12 // movd 0xc(%r9,%r10,2),%xmm1 .byte 102,67,15,196,76,81,16,2 // pinsrw $0x2,0x10(%r9,%r10,2),%xmm1 .byte 102,15,239,192 // pxor %xmm0,%xmm0 - .byte 233,124,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38> + .byte 233,124,254,255,255 // jmpq 241c <_sk_load_tables_rgb_u16_be_sse41+0x38> .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,115,254,255,255 // jmpq 2413 <_sk_load_tables_rgb_u16_be_sse41+0x38> + .byte 233,115,254,255,255 // jmpq 241c <_sk_load_tables_rgb_u16_be_sse41+0x38> HIDDEN _sk_byte_tables_sse41 .globl _sk_byte_tables_sse41 @@ -24425,7 +24276,7 @@ _sk_byte_tables_sse41: .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,255,48,0,0 // movaps 0x30ff(%rip),%xmm8 # 56b0 <_sk_callback_sse41+0x6dc> + .byte 68,15,40,5,246,48,0,0 // movaps 0x30f6(%rip),%xmm8 # 56b0 <_sk_callback_sse41+0x6d3> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0 .byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9 @@ -24444,7 +24295,7 @@ _sk_byte_tables_sse41: .byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0 .byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,13,176,48,0,0 // movaps 0x30b0(%rip),%xmm9 # 56c0 <_sk_callback_sse41+0x6ec> + .byte 68,15,40,13,167,48,0,0 // movaps 0x30a7(%rip),%xmm9 # 56c0 <_sk_callback_sse41+0x6e3> .byte 65,15,89,193 // mulps %xmm9,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1 @@ -24540,7 +24391,7 @@ _sk_byte_tables_rgb_sse41: .byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0 .byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,13,40,47,0,0 // movaps 0x2f28(%rip),%xmm9 # 56d0 <_sk_callback_sse41+0x6fc> + .byte 68,15,40,13,31,47,0,0 // movaps 0x2f1f(%rip),%xmm9 # 56d0 <_sk_callback_sse41+0x6f3> .byte 65,15,89,193 // mulps %xmm9,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1 @@ -24727,31 +24578,31 @@ _sk_parametric_r_sse41: .byte 69,15,88,208 // addps %xmm8,%xmm10 .byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11 .byte 69,15,91,194 // cvtdq2ps %xmm10,%xmm8 - .byte 68,15,89,5,112,44,0,0 // mulps 0x2c70(%rip),%xmm8 # 56e0 <_sk_callback_sse41+0x70c> - .byte 68,15,84,21,120,44,0,0 // andps 0x2c78(%rip),%xmm10 # 56f0 <_sk_callback_sse41+0x71c> - .byte 68,15,86,21,128,44,0,0 // orps 0x2c80(%rip),%xmm10 # 5700 <_sk_callback_sse41+0x72c> - .byte 68,15,88,5,136,44,0,0 // addps 0x2c88(%rip),%xmm8 # 5710 <_sk_callback_sse41+0x73c> - .byte 68,15,40,37,144,44,0,0 // movaps 0x2c90(%rip),%xmm12 # 5720 <_sk_callback_sse41+0x74c> + .byte 68,15,89,5,103,44,0,0 // mulps 0x2c67(%rip),%xmm8 # 56e0 <_sk_callback_sse41+0x703> + .byte 68,15,84,21,111,44,0,0 // andps 0x2c6f(%rip),%xmm10 # 56f0 <_sk_callback_sse41+0x713> + .byte 68,15,86,21,119,44,0,0 // orps 0x2c77(%rip),%xmm10 # 5700 <_sk_callback_sse41+0x723> + .byte 68,15,88,5,127,44,0,0 // addps 0x2c7f(%rip),%xmm8 # 5710 <_sk_callback_sse41+0x733> + .byte 68,15,40,37,135,44,0,0 // movaps 0x2c87(%rip),%xmm12 # 5720 <_sk_callback_sse41+0x743> .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 69,15,92,196 // subps %xmm12,%xmm8 - .byte 68,15,88,21,144,44,0,0 // addps 0x2c90(%rip),%xmm10 # 5730 <_sk_callback_sse41+0x75c> - .byte 68,15,40,37,152,44,0,0 // movaps 0x2c98(%rip),%xmm12 # 5740 <_sk_callback_sse41+0x76c> + .byte 68,15,88,21,135,44,0,0 // addps 0x2c87(%rip),%xmm10 # 5730 <_sk_callback_sse41+0x753> + .byte 68,15,40,37,143,44,0,0 // movaps 0x2c8f(%rip),%xmm12 # 5740 <_sk_callback_sse41+0x763> .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,92,196 // subps %xmm12,%xmm8 .byte 69,15,89,195 // mulps %xmm11,%xmm8 .byte 102,69,15,58,8,208,1 // roundps $0x1,%xmm8,%xmm10 .byte 69,15,40,216 // movaps %xmm8,%xmm11 .byte 69,15,92,218 // subps %xmm10,%xmm11 - .byte 68,15,88,5,133,44,0,0 // addps 0x2c85(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x77c> - .byte 68,15,40,21,141,44,0,0 // movaps 0x2c8d(%rip),%xmm10 # 5760 <_sk_callback_sse41+0x78c> + .byte 68,15,88,5,124,44,0,0 // addps 0x2c7c(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x773> + .byte 68,15,40,21,132,44,0,0 // movaps 0x2c84(%rip),%xmm10 # 5760 <_sk_callback_sse41+0x783> .byte 69,15,89,211 // mulps %xmm11,%xmm10 .byte 69,15,92,194 // subps %xmm10,%xmm8 - .byte 68,15,40,21,141,44,0,0 // movaps 0x2c8d(%rip),%xmm10 # 5770 <_sk_callback_sse41+0x79c> + .byte 68,15,40,21,132,44,0,0 // movaps 0x2c84(%rip),%xmm10 # 5770 <_sk_callback_sse41+0x793> .byte 69,15,92,211 // subps %xmm11,%xmm10 - .byte 68,15,40,29,145,44,0,0 // movaps 0x2c91(%rip),%xmm11 # 5780 <_sk_callback_sse41+0x7ac> + .byte 68,15,40,29,136,44,0,0 // movaps 0x2c88(%rip),%xmm11 # 5780 <_sk_callback_sse41+0x7a3> .byte 69,15,94,218 // divps %xmm10,%xmm11 .byte 69,15,88,216 // addps %xmm8,%xmm11 - .byte 68,15,89,29,145,44,0,0 // mulps 0x2c91(%rip),%xmm11 # 5790 <_sk_callback_sse41+0x7bc> + .byte 68,15,89,29,136,44,0,0 // mulps 0x2c88(%rip),%xmm11 # 5790 <_sk_callback_sse41+0x7b3> .byte 102,69,15,91,211 // cvtps2dq %xmm11,%xmm10 .byte 243,68,15,16,64,20 // movss 0x14(%rax),%xmm8 .byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8 @@ -24759,7 +24610,7 @@ _sk_parametric_r_sse41: .byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8 .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 68,15,95,192 // maxps %xmm0,%xmm8 - .byte 68,15,93,5,120,44,0,0 // minps 0x2c78(%rip),%xmm8 # 57a0 <_sk_callback_sse41+0x7cc> + .byte 68,15,93,5,111,44,0,0 // minps 0x2c6f(%rip),%xmm8 # 57a0 <_sk_callback_sse41+0x7c3> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -24789,31 +24640,31 @@ _sk_parametric_g_sse41: .byte 68,15,88,217 // addps %xmm1,%xmm11 .byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10 .byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12 - .byte 68,15,89,37,25,44,0,0 // mulps 0x2c19(%rip),%xmm12 # 57b0 <_sk_callback_sse41+0x7dc> - .byte 68,15,84,29,33,44,0,0 // andps 0x2c21(%rip),%xmm11 # 57c0 <_sk_callback_sse41+0x7ec> - .byte 68,15,86,29,41,44,0,0 // orps 0x2c29(%rip),%xmm11 # 57d0 <_sk_callback_sse41+0x7fc> - .byte 68,15,88,37,49,44,0,0 // addps 0x2c31(%rip),%xmm12 # 57e0 <_sk_callback_sse41+0x80c> - .byte 15,40,13,58,44,0,0 // movaps 0x2c3a(%rip),%xmm1 # 57f0 <_sk_callback_sse41+0x81c> + .byte 68,15,89,37,16,44,0,0 // mulps 0x2c10(%rip),%xmm12 # 57b0 <_sk_callback_sse41+0x7d3> + .byte 68,15,84,29,24,44,0,0 // andps 0x2c18(%rip),%xmm11 # 57c0 <_sk_callback_sse41+0x7e3> + .byte 68,15,86,29,32,44,0,0 // orps 0x2c20(%rip),%xmm11 # 57d0 <_sk_callback_sse41+0x7f3> + .byte 68,15,88,37,40,44,0,0 // addps 0x2c28(%rip),%xmm12 # 57e0 <_sk_callback_sse41+0x803> + .byte 15,40,13,49,44,0,0 // movaps 0x2c31(%rip),%xmm1 # 57f0 <_sk_callback_sse41+0x813> .byte 65,15,89,203 // mulps %xmm11,%xmm1 .byte 68,15,92,225 // subps %xmm1,%xmm12 - .byte 68,15,88,29,58,44,0,0 // addps 0x2c3a(%rip),%xmm11 # 5800 <_sk_callback_sse41+0x82c> - .byte 15,40,13,67,44,0,0 // movaps 0x2c43(%rip),%xmm1 # 5810 <_sk_callback_sse41+0x83c> + .byte 68,15,88,29,49,44,0,0 // addps 0x2c31(%rip),%xmm11 # 5800 <_sk_callback_sse41+0x823> + .byte 15,40,13,58,44,0,0 // movaps 0x2c3a(%rip),%xmm1 # 5810 <_sk_callback_sse41+0x833> .byte 65,15,94,203 // divps %xmm11,%xmm1 .byte 68,15,92,225 // subps %xmm1,%xmm12 .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10 .byte 69,15,40,220 // movaps %xmm12,%xmm11 .byte 69,15,92,218 // subps %xmm10,%xmm11 - .byte 68,15,88,37,48,44,0,0 // addps 0x2c30(%rip),%xmm12 # 5820 <_sk_callback_sse41+0x84c> - .byte 15,40,13,57,44,0,0 // movaps 0x2c39(%rip),%xmm1 # 5830 <_sk_callback_sse41+0x85c> + .byte 68,15,88,37,39,44,0,0 // addps 0x2c27(%rip),%xmm12 # 5820 <_sk_callback_sse41+0x843> + .byte 15,40,13,48,44,0,0 // movaps 0x2c30(%rip),%xmm1 # 5830 <_sk_callback_sse41+0x853> .byte 65,15,89,203 // mulps %xmm11,%xmm1 .byte 68,15,92,225 // subps %xmm1,%xmm12 - .byte 68,15,40,21,57,44,0,0 // movaps 0x2c39(%rip),%xmm10 # 5840 <_sk_callback_sse41+0x86c> + .byte 68,15,40,21,48,44,0,0 // movaps 0x2c30(%rip),%xmm10 # 5840 <_sk_callback_sse41+0x863> .byte 69,15,92,211 // subps %xmm11,%xmm10 - .byte 15,40,13,62,44,0,0 // movaps 0x2c3e(%rip),%xmm1 # 5850 <_sk_callback_sse41+0x87c> + .byte 15,40,13,53,44,0,0 // movaps 0x2c35(%rip),%xmm1 # 5850 <_sk_callback_sse41+0x873> .byte 65,15,94,202 // divps %xmm10,%xmm1 .byte 65,15,88,204 // addps %xmm12,%xmm1 - .byte 15,89,13,63,44,0,0 // mulps 0x2c3f(%rip),%xmm1 # 5860 <_sk_callback_sse41+0x88c> + .byte 15,89,13,54,44,0,0 // mulps 0x2c36(%rip),%xmm1 # 5860 <_sk_callback_sse41+0x883> .byte 102,68,15,91,209 // cvtps2dq %xmm1,%xmm10 .byte 243,15,16,72,20 // movss 0x14(%rax),%xmm1 .byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1 @@ -24821,7 +24672,7 @@ _sk_parametric_g_sse41: .byte 102,65,15,56,20,201 // blendvps %xmm0,%xmm9,%xmm1 .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,95,200 // maxps %xmm0,%xmm1 - .byte 15,93,13,42,44,0,0 // minps 0x2c2a(%rip),%xmm1 # 5870 <_sk_callback_sse41+0x89c> + .byte 15,93,13,33,44,0,0 // minps 0x2c21(%rip),%xmm1 # 5870 <_sk_callback_sse41+0x893> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -24851,31 +24702,31 @@ _sk_parametric_b_sse41: .byte 68,15,88,218 // addps %xmm2,%xmm11 .byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10 .byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12 - .byte 68,15,89,37,203,43,0,0 // mulps 0x2bcb(%rip),%xmm12 # 5880 <_sk_callback_sse41+0x8ac> - .byte 68,15,84,29,211,43,0,0 // andps 0x2bd3(%rip),%xmm11 # 5890 <_sk_callback_sse41+0x8bc> - .byte 68,15,86,29,219,43,0,0 // orps 0x2bdb(%rip),%xmm11 # 58a0 <_sk_callback_sse41+0x8cc> - .byte 68,15,88,37,227,43,0,0 // addps 0x2be3(%rip),%xmm12 # 58b0 <_sk_callback_sse41+0x8dc> - .byte 15,40,21,236,43,0,0 // movaps 0x2bec(%rip),%xmm2 # 58c0 <_sk_callback_sse41+0x8ec> + .byte 68,15,89,37,194,43,0,0 // mulps 0x2bc2(%rip),%xmm12 # 5880 <_sk_callback_sse41+0x8a3> + .byte 68,15,84,29,202,43,0,0 // andps 0x2bca(%rip),%xmm11 # 5890 <_sk_callback_sse41+0x8b3> + .byte 68,15,86,29,210,43,0,0 // orps 0x2bd2(%rip),%xmm11 # 58a0 <_sk_callback_sse41+0x8c3> + .byte 68,15,88,37,218,43,0,0 // addps 0x2bda(%rip),%xmm12 # 58b0 <_sk_callback_sse41+0x8d3> + .byte 15,40,21,227,43,0,0 // movaps 0x2be3(%rip),%xmm2 # 58c0 <_sk_callback_sse41+0x8e3> .byte 65,15,89,211 // mulps %xmm11,%xmm2 .byte 68,15,92,226 // subps %xmm2,%xmm12 - .byte 68,15,88,29,236,43,0,0 // addps 0x2bec(%rip),%xmm11 # 58d0 <_sk_callback_sse41+0x8fc> - .byte 15,40,21,245,43,0,0 // movaps 0x2bf5(%rip),%xmm2 # 58e0 <_sk_callback_sse41+0x90c> + .byte 68,15,88,29,227,43,0,0 // addps 0x2be3(%rip),%xmm11 # 58d0 <_sk_callback_sse41+0x8f3> + .byte 15,40,21,236,43,0,0 // movaps 0x2bec(%rip),%xmm2 # 58e0 <_sk_callback_sse41+0x903> .byte 65,15,94,211 // divps %xmm11,%xmm2 .byte 68,15,92,226 // subps %xmm2,%xmm12 .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10 .byte 69,15,40,220 // movaps %xmm12,%xmm11 .byte 69,15,92,218 // subps %xmm10,%xmm11 - .byte 68,15,88,37,226,43,0,0 // addps 0x2be2(%rip),%xmm12 # 58f0 <_sk_callback_sse41+0x91c> - .byte 15,40,21,235,43,0,0 // movaps 0x2beb(%rip),%xmm2 # 5900 <_sk_callback_sse41+0x92c> + .byte 68,15,88,37,217,43,0,0 // addps 0x2bd9(%rip),%xmm12 # 58f0 <_sk_callback_sse41+0x913> + .byte 15,40,21,226,43,0,0 // movaps 0x2be2(%rip),%xmm2 # 5900 <_sk_callback_sse41+0x923> .byte 65,15,89,211 // mulps %xmm11,%xmm2 .byte 68,15,92,226 // subps %xmm2,%xmm12 - .byte 68,15,40,21,235,43,0,0 // movaps 0x2beb(%rip),%xmm10 # 5910 <_sk_callback_sse41+0x93c> + .byte 68,15,40,21,226,43,0,0 // movaps 0x2be2(%rip),%xmm10 # 5910 <_sk_callback_sse41+0x933> .byte 69,15,92,211 // subps %xmm11,%xmm10 - .byte 15,40,21,240,43,0,0 // movaps 0x2bf0(%rip),%xmm2 # 5920 <_sk_callback_sse41+0x94c> + .byte 15,40,21,231,43,0,0 // movaps 0x2be7(%rip),%xmm2 # 5920 <_sk_callback_sse41+0x943> .byte 65,15,94,210 // divps %xmm10,%xmm2 .byte 65,15,88,212 // addps %xmm12,%xmm2 - .byte 15,89,21,241,43,0,0 // mulps 0x2bf1(%rip),%xmm2 # 5930 <_sk_callback_sse41+0x95c> + .byte 15,89,21,232,43,0,0 // mulps 0x2be8(%rip),%xmm2 # 5930 <_sk_callback_sse41+0x953> .byte 102,68,15,91,210 // cvtps2dq %xmm2,%xmm10 .byte 243,15,16,80,20 // movss 0x14(%rax),%xmm2 .byte 15,198,210,0 // shufps $0x0,%xmm2,%xmm2 @@ -24883,7 +24734,7 @@ _sk_parametric_b_sse41: .byte 102,65,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm2 .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,95,208 // maxps %xmm0,%xmm2 - .byte 15,93,21,220,43,0,0 // minps 0x2bdc(%rip),%xmm2 # 5940 <_sk_callback_sse41+0x96c> + .byte 15,93,21,211,43,0,0 // minps 0x2bd3(%rip),%xmm2 # 5940 <_sk_callback_sse41+0x963> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -24913,31 +24764,31 @@ _sk_parametric_a_sse41: .byte 68,15,88,219 // addps %xmm3,%xmm11 .byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10 .byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12 - .byte 68,15,89,37,125,43,0,0 // mulps 0x2b7d(%rip),%xmm12 # 5950 <_sk_callback_sse41+0x97c> - .byte 68,15,84,29,133,43,0,0 // andps 0x2b85(%rip),%xmm11 # 5960 <_sk_callback_sse41+0x98c> - .byte 68,15,86,29,141,43,0,0 // orps 0x2b8d(%rip),%xmm11 # 5970 <_sk_callback_sse41+0x99c> - .byte 68,15,88,37,149,43,0,0 // addps 0x2b95(%rip),%xmm12 # 5980 <_sk_callback_sse41+0x9ac> - .byte 15,40,29,158,43,0,0 // movaps 0x2b9e(%rip),%xmm3 # 5990 <_sk_callback_sse41+0x9bc> + .byte 68,15,89,37,116,43,0,0 // mulps 0x2b74(%rip),%xmm12 # 5950 <_sk_callback_sse41+0x973> + .byte 68,15,84,29,124,43,0,0 // andps 0x2b7c(%rip),%xmm11 # 5960 <_sk_callback_sse41+0x983> + .byte 68,15,86,29,132,43,0,0 // orps 0x2b84(%rip),%xmm11 # 5970 <_sk_callback_sse41+0x993> + .byte 68,15,88,37,140,43,0,0 // addps 0x2b8c(%rip),%xmm12 # 5980 <_sk_callback_sse41+0x9a3> + .byte 15,40,29,149,43,0,0 // movaps 0x2b95(%rip),%xmm3 # 5990 <_sk_callback_sse41+0x9b3> .byte 65,15,89,219 // mulps %xmm11,%xmm3 .byte 68,15,92,227 // subps %xmm3,%xmm12 - .byte 68,15,88,29,158,43,0,0 // addps 0x2b9e(%rip),%xmm11 # 59a0 <_sk_callback_sse41+0x9cc> - .byte 15,40,29,167,43,0,0 // movaps 0x2ba7(%rip),%xmm3 # 59b0 <_sk_callback_sse41+0x9dc> + .byte 68,15,88,29,149,43,0,0 // addps 0x2b95(%rip),%xmm11 # 59a0 <_sk_callback_sse41+0x9c3> + .byte 15,40,29,158,43,0,0 // movaps 0x2b9e(%rip),%xmm3 # 59b0 <_sk_callback_sse41+0x9d3> .byte 65,15,94,219 // divps %xmm11,%xmm3 .byte 68,15,92,227 // subps %xmm3,%xmm12 .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10 .byte 69,15,40,220 // movaps %xmm12,%xmm11 .byte 69,15,92,218 // subps %xmm10,%xmm11 - .byte 68,15,88,37,148,43,0,0 // addps 0x2b94(%rip),%xmm12 # 59c0 <_sk_callback_sse41+0x9ec> - .byte 15,40,29,157,43,0,0 // movaps 0x2b9d(%rip),%xmm3 # 59d0 <_sk_callback_sse41+0x9fc> + .byte 68,15,88,37,139,43,0,0 // addps 0x2b8b(%rip),%xmm12 # 59c0 <_sk_callback_sse41+0x9e3> + .byte 15,40,29,148,43,0,0 // movaps 0x2b94(%rip),%xmm3 # 59d0 <_sk_callback_sse41+0x9f3> .byte 65,15,89,219 // mulps %xmm11,%xmm3 .byte 68,15,92,227 // subps %xmm3,%xmm12 - .byte 68,15,40,21,157,43,0,0 // movaps 0x2b9d(%rip),%xmm10 # 59e0 <_sk_callback_sse41+0xa0c> + .byte 68,15,40,21,148,43,0,0 // movaps 0x2b94(%rip),%xmm10 # 59e0 <_sk_callback_sse41+0xa03> .byte 69,15,92,211 // subps %xmm11,%xmm10 - .byte 15,40,29,162,43,0,0 // movaps 0x2ba2(%rip),%xmm3 # 59f0 <_sk_callback_sse41+0xa1c> + .byte 15,40,29,153,43,0,0 // movaps 0x2b99(%rip),%xmm3 # 59f0 <_sk_callback_sse41+0xa13> .byte 65,15,94,218 // divps %xmm10,%xmm3 .byte 65,15,88,220 // addps %xmm12,%xmm3 - .byte 15,89,29,163,43,0,0 // mulps 0x2ba3(%rip),%xmm3 # 5a00 <_sk_callback_sse41+0xa2c> + .byte 15,89,29,154,43,0,0 // mulps 0x2b9a(%rip),%xmm3 # 5a00 <_sk_callback_sse41+0xa23> .byte 102,68,15,91,211 // cvtps2dq %xmm3,%xmm10 .byte 243,15,16,88,20 // movss 0x14(%rax),%xmm3 .byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3 @@ -24945,7 +24796,7 @@ _sk_parametric_a_sse41: .byte 102,65,15,56,20,217 // blendvps %xmm0,%xmm9,%xmm3 .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,95,216 // maxps %xmm0,%xmm3 - .byte 15,93,29,142,43,0,0 // minps 0x2b8e(%rip),%xmm3 # 5a10 <_sk_callback_sse41+0xa3c> + .byte 15,93,29,133,43,0,0 // minps 0x2b85(%rip),%xmm3 # 5a10 <_sk_callback_sse41+0xa33> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -24955,29 +24806,29 @@ HIDDEN _sk_lab_to_xyz_sse41 FUNCTION(_sk_lab_to_xyz_sse41) _sk_lab_to_xyz_sse41: .byte 68,15,40,192 // movaps %xmm0,%xmm8 - .byte 68,15,89,5,138,43,0,0 // mulps 0x2b8a(%rip),%xmm8 # 5a20 <_sk_callback_sse41+0xa4c> - .byte 68,15,40,13,146,43,0,0 // movaps 0x2b92(%rip),%xmm9 # 5a30 <_sk_callback_sse41+0xa5c> + .byte 68,15,89,5,129,43,0,0 // mulps 0x2b81(%rip),%xmm8 # 5a20 <_sk_callback_sse41+0xa43> + .byte 68,15,40,13,137,43,0,0 // movaps 0x2b89(%rip),%xmm9 # 5a30 <_sk_callback_sse41+0xa53> .byte 65,15,89,201 // mulps %xmm9,%xmm1 - .byte 15,40,5,151,43,0,0 // movaps 0x2b97(%rip),%xmm0 # 5a40 <_sk_callback_sse41+0xa6c> + .byte 15,40,5,142,43,0,0 // movaps 0x2b8e(%rip),%xmm0 # 5a40 <_sk_callback_sse41+0xa63> .byte 15,88,200 // addps %xmm0,%xmm1 .byte 65,15,89,209 // mulps %xmm9,%xmm2 .byte 15,88,208 // addps %xmm0,%xmm2 - .byte 68,15,88,5,149,43,0,0 // addps 0x2b95(%rip),%xmm8 # 5a50 <_sk_callback_sse41+0xa7c> - .byte 68,15,89,5,157,43,0,0 // mulps 0x2b9d(%rip),%xmm8 # 5a60 <_sk_callback_sse41+0xa8c> - .byte 15,89,13,166,43,0,0 // mulps 0x2ba6(%rip),%xmm1 # 5a70 <_sk_callback_sse41+0xa9c> + .byte 68,15,88,5,140,43,0,0 // addps 0x2b8c(%rip),%xmm8 # 5a50 <_sk_callback_sse41+0xa73> + .byte 68,15,89,5,148,43,0,0 // mulps 0x2b94(%rip),%xmm8 # 5a60 <_sk_callback_sse41+0xa83> + .byte 15,89,13,157,43,0,0 // mulps 0x2b9d(%rip),%xmm1 # 5a70 <_sk_callback_sse41+0xa93> .byte 65,15,88,200 // addps %xmm8,%xmm1 - .byte 15,89,21,171,43,0,0 // mulps 0x2bab(%rip),%xmm2 # 5a80 <_sk_callback_sse41+0xaac> + .byte 15,89,21,162,43,0,0 // mulps 0x2ba2(%rip),%xmm2 # 5a80 <_sk_callback_sse41+0xaa3> .byte 69,15,40,208 // movaps %xmm8,%xmm10 .byte 68,15,92,210 // subps %xmm2,%xmm10 .byte 68,15,40,217 // movaps %xmm1,%xmm11 .byte 69,15,89,219 // mulps %xmm11,%xmm11 .byte 68,15,89,217 // mulps %xmm1,%xmm11 - .byte 68,15,40,13,159,43,0,0 // movaps 0x2b9f(%rip),%xmm9 # 5a90 <_sk_callback_sse41+0xabc> + .byte 68,15,40,13,150,43,0,0 // movaps 0x2b96(%rip),%xmm9 # 5a90 <_sk_callback_sse41+0xab3> .byte 65,15,40,193 // movaps %xmm9,%xmm0 .byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0 - .byte 15,40,21,159,43,0,0 // movaps 0x2b9f(%rip),%xmm2 # 5aa0 <_sk_callback_sse41+0xacc> + .byte 15,40,21,150,43,0,0 // movaps 0x2b96(%rip),%xmm2 # 5aa0 <_sk_callback_sse41+0xac3> .byte 15,88,202 // addps %xmm2,%xmm1 - .byte 68,15,40,37,164,43,0,0 // movaps 0x2ba4(%rip),%xmm12 # 5ab0 <_sk_callback_sse41+0xadc> + .byte 68,15,40,37,155,43,0,0 // movaps 0x2b9b(%rip),%xmm12 # 5ab0 <_sk_callback_sse41+0xad3> .byte 65,15,89,204 // mulps %xmm12,%xmm1 .byte 102,65,15,56,20,203 // blendvps %xmm0,%xmm11,%xmm1 .byte 69,15,40,216 // movaps %xmm8,%xmm11 @@ -24996,8 +24847,8 @@ _sk_lab_to_xyz_sse41: .byte 65,15,89,212 // mulps %xmm12,%xmm2 .byte 65,15,40,193 // movaps %xmm9,%xmm0 .byte 102,65,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm2 - .byte 15,89,13,93,43,0,0 // mulps 0x2b5d(%rip),%xmm1 # 5ac0 <_sk_callback_sse41+0xaec> - .byte 15,89,21,102,43,0,0 // mulps 0x2b66(%rip),%xmm2 # 5ad0 <_sk_callback_sse41+0xafc> + .byte 15,89,13,84,43,0,0 // mulps 0x2b54(%rip),%xmm1 # 5ac0 <_sk_callback_sse41+0xae3> + .byte 15,89,21,93,43,0,0 // mulps 0x2b5d(%rip),%xmm2 # 5ad0 <_sk_callback_sse41+0xaf3> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,40,193 // movaps %xmm1,%xmm0 .byte 65,15,40,200 // movaps %xmm8,%xmm1 @@ -25010,11 +24861,11 @@ _sk_load_a8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,38 // jne 2fa5 <_sk_load_a8_sse41+0x30> + .byte 117,38 // jne 2fae <_sk_load_a8_sse41+0x30> .byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0 - .byte 102,15,219,5,82,43,0,0 // pand 0x2b52(%rip),%xmm0 # 5ae0 <_sk_callback_sse41+0xb0c> + .byte 102,15,219,5,73,43,0,0 // pand 0x2b49(%rip),%xmm0 # 5ae0 <_sk_callback_sse41+0xb03> .byte 15,91,216 // cvtdq2ps %xmm0,%xmm3 - .byte 15,89,29,88,43,0,0 // mulps 0x2b58(%rip),%xmm3 # 5af0 <_sk_callback_sse41+0xb1c> + .byte 15,89,29,79,43,0,0 // mulps 0x2b4f(%rip),%xmm3 # 5af0 <_sk_callback_sse41+0xb13> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 @@ -25024,11 +24875,11 @@ _sk_load_a8_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,39 // je 2fdd <_sk_load_a8_sse41+0x68> + .byte 116,39 // je 2fe6 <_sk_load_a8_sse41+0x68> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 2fd1 <_sk_load_a8_sse41+0x5c> + .byte 116,21 // je 2fda <_sk_load_a8_sse41+0x5c> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,196 // jne 2f86 <_sk_load_a8_sse41+0x11> + .byte 117,196 // jne 2f8f <_sk_load_a8_sse41+0x11> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0 @@ -25036,7 +24887,7 @@ _sk_load_a8_sse41: .byte 102,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm0 .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm0 - .byte 235,156 // jmp 2f86 <_sk_load_a8_sse41+0x11> + .byte 235,156 // jmp 2f8f <_sk_load_a8_sse41+0x11> HIDDEN _sk_gather_a8_sse41 .globl _sk_gather_a8_sse41 @@ -25065,7 +24916,7 @@ _sk_gather_a8_sse41: .byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0 .byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0 .byte 15,91,216 // cvtdq2ps %xmm0,%xmm3 - .byte 15,89,29,166,42,0,0 // mulps 0x2aa6(%rip),%xmm3 # 5b00 <_sk_callback_sse41+0xb2c> + .byte 15,89,29,157,42,0,0 // mulps 0x2a9d(%rip),%xmm3 # 5b00 <_sk_callback_sse41+0xb23> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 @@ -25079,13 +24930,13 @@ FUNCTION(_sk_store_a8_sse41) _sk_store_a8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 - .byte 68,15,40,5,153,42,0,0 // movaps 0x2a99(%rip),%xmm8 # 5b10 <_sk_callback_sse41+0xb3c> + .byte 68,15,40,5,144,42,0,0 // movaps 0x2a90(%rip),%xmm8 # 5b10 <_sk_callback_sse41+0xb33> .byte 68,15,89,195 // mulps %xmm3,%xmm8 .byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8 .byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8 .byte 102,69,15,103,192 // packuswb %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,13 // jne 309d <_sk_store_a8_sse41+0x33> + .byte 117,13 // jne 30a6 <_sk_store_a8_sse41+0x33> .byte 102,68,15,126,192 // movd %xmm8,%eax .byte 65,137,4,18 // mov %eax,(%r10,%rdx,1) .byte 72,173 // lods %ds:(%rsi),%rax @@ -25094,15 +24945,15 @@ _sk_store_a8_sse41: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,30 // je 30ce <_sk_store_a8_sse41+0x64> + .byte 116,30 // je 30d7 <_sk_store_a8_sse41+0x64> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,15 // je 30c5 <_sk_store_a8_sse41+0x5b> + .byte 116,15 // je 30ce <_sk_store_a8_sse41+0x5b> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,221 // jne 3099 <_sk_store_a8_sse41+0x2f> + .byte 117,221 // jne 30a2 <_sk_store_a8_sse41+0x2f> .byte 102,69,15,58,20,68,18,2,8 // pextrb $0x8,%xmm8,0x2(%r10,%rdx,1) .byte 102,69,15,58,20,68,18,1,4 // pextrb $0x4,%xmm8,0x1(%r10,%rdx,1) .byte 102,69,15,58,20,4,18,0 // pextrb $0x0,%xmm8,(%r10,%rdx,1) - .byte 235,193 // jmp 3099 <_sk_store_a8_sse41+0x2f> + .byte 235,193 // jmp 30a2 <_sk_store_a8_sse41+0x2f> HIDDEN _sk_load_g8_sse41 .globl _sk_load_g8_sse41 @@ -25111,13 +24962,13 @@ _sk_load_g8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,42 // jne 310c <_sk_load_g8_sse41+0x34> + .byte 117,42 // jne 3115 <_sk_load_g8_sse41+0x34> .byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0 - .byte 102,15,219,5,47,42,0,0 // pand 0x2a2f(%rip),%xmm0 # 5b20 <_sk_callback_sse41+0xb4c> + .byte 102,15,219,5,38,42,0,0 // pand 0x2a26(%rip),%xmm0 # 5b20 <_sk_callback_sse41+0xb43> .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,53,42,0,0 // mulps 0x2a35(%rip),%xmm0 # 5b30 <_sk_callback_sse41+0xb5c> + .byte 15,89,5,44,42,0,0 // mulps 0x2a2c(%rip),%xmm0 # 5b30 <_sk_callback_sse41+0xb53> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,60,42,0,0 // movaps 0x2a3c(%rip),%xmm3 # 5b40 <_sk_callback_sse41+0xb6c> + .byte 15,40,29,51,42,0,0 // movaps 0x2a33(%rip),%xmm3 # 5b40 <_sk_callback_sse41+0xb63> .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 255,224 // jmpq *%rax @@ -25125,11 +24976,11 @@ _sk_load_g8_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,39 // je 3144 <_sk_load_g8_sse41+0x6c> + .byte 116,39 // je 314d <_sk_load_g8_sse41+0x6c> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 3138 <_sk_load_g8_sse41+0x60> + .byte 116,21 // je 3141 <_sk_load_g8_sse41+0x60> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,192 // jne 30e9 <_sk_load_g8_sse41+0x11> + .byte 117,192 // jne 30f2 <_sk_load_g8_sse41+0x11> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0 @@ -25137,7 +24988,7 @@ _sk_load_g8_sse41: .byte 102,15,58,34,192,1 // pinsrd $0x1,%eax,%xmm0 .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,15,58,34,192,0 // pinsrd $0x0,%eax,%xmm0 - .byte 235,152 // jmp 30e9 <_sk_load_g8_sse41+0x11> + .byte 235,152 // jmp 30f2 <_sk_load_g8_sse41+0x11> HIDDEN _sk_gather_g8_sse41 .globl _sk_gather_g8_sse41 @@ -25166,9 +25017,9 @@ _sk_gather_g8_sse41: .byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0 .byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,143,41,0,0 // mulps 0x298f(%rip),%xmm0 # 5b50 <_sk_callback_sse41+0xb7c> + .byte 15,89,5,134,41,0,0 // mulps 0x2986(%rip),%xmm0 # 5b50 <_sk_callback_sse41+0xb73> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,150,41,0,0 // movaps 0x2996(%rip),%xmm3 # 5b60 <_sk_callback_sse41+0xb8c> + .byte 15,40,29,141,41,0,0 // movaps 0x298d(%rip),%xmm3 # 5b60 <_sk_callback_sse41+0xb83> .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 91 // pop %rbx @@ -25181,9 +25032,9 @@ _sk_gather_i8_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,137,193 // mov %rax,%r9 .byte 77,133,201 // test %r9,%r9 - .byte 116,5 // je 31e2 <_sk_gather_i8_sse41+0xf> + .byte 116,5 // je 31eb <_sk_gather_i8_sse41+0xf> .byte 76,137,200 // mov %r9,%rax - .byte 235,2 // jmp 31e4 <_sk_gather_i8_sse41+0x11> + .byte 235,2 // jmp 31ed <_sk_gather_i8_sse41+0x11> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,86 // push %r14 .byte 83 // push %rbx @@ -25216,17 +25067,17 @@ _sk_gather_i8_sse41: .byte 102,15,58,34,28,24,1 // pinsrd $0x1,(%rax,%rbx,1),%xmm3 .byte 102,66,15,58,34,28,152,2 // pinsrd $0x2,(%rax,%r11,4),%xmm3 .byte 102,66,15,58,34,28,16,3 // pinsrd $0x3,(%rax,%r10,1),%xmm3 - .byte 102,15,111,5,233,40,0,0 // movdqa 0x28e9(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xb9c> + .byte 102,15,111,5,224,40,0,0 // movdqa 0x28e0(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xb93> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,234,40,0,0 // movaps 0x28ea(%rip),%xmm8 # 5b80 <_sk_callback_sse41+0xbac> + .byte 68,15,40,5,225,40,0,0 // movaps 0x28e1(%rip),%xmm8 # 5b80 <_sk_callback_sse41+0xba3> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 - .byte 102,15,56,0,13,233,40,0,0 // pshufb 0x28e9(%rip),%xmm1 # 5b90 <_sk_callback_sse41+0xbbc> + .byte 102,15,56,0,13,224,40,0,0 // pshufb 0x28e0(%rip),%xmm1 # 5b90 <_sk_callback_sse41+0xbb3> .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,111,211 // movdqa %xmm3,%xmm2 - .byte 102,15,56,0,21,229,40,0,0 // pshufb 0x28e5(%rip),%xmm2 # 5ba0 <_sk_callback_sse41+0xbcc> + .byte 102,15,56,0,21,220,40,0,0 // pshufb 0x28dc(%rip),%xmm2 # 5ba0 <_sk_callback_sse41+0xbc3> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 .byte 65,15,89,208 // mulps %xmm8,%xmm2 .byte 102,15,114,211,24 // psrld $0x18,%xmm3 @@ -25244,31 +25095,31 @@ _sk_load_565_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,80 // jne 332f <_sk_load_565_sse41+0x5a> + .byte 117,80 // jne 3338 <_sk_load_565_sse41+0x5a> .byte 102,65,15,56,51,20,82 // pmovzxwd (%r10,%rdx,2),%xmm2 - .byte 102,15,111,5,194,40,0,0 // movdqa 0x28c2(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xbdc> + .byte 102,15,111,5,185,40,0,0 // movdqa 0x28b9(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xbd3> .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,196,40,0,0 // mulps 0x28c4(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xbec> - .byte 102,15,111,13,204,40,0,0 // movdqa 0x28cc(%rip),%xmm1 # 5bd0 <_sk_callback_sse41+0xbfc> + .byte 15,89,5,187,40,0,0 // mulps 0x28bb(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xbe3> + .byte 102,15,111,13,195,40,0,0 // movdqa 0x28c3(%rip),%xmm1 # 5bd0 <_sk_callback_sse41+0xbf3> .byte 102,15,219,202 // pand %xmm2,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,206,40,0,0 // mulps 0x28ce(%rip),%xmm1 # 5be0 <_sk_callback_sse41+0xc0c> - .byte 102,15,219,21,214,40,0,0 // pand 0x28d6(%rip),%xmm2 # 5bf0 <_sk_callback_sse41+0xc1c> + .byte 15,89,13,197,40,0,0 // mulps 0x28c5(%rip),%xmm1 # 5be0 <_sk_callback_sse41+0xc03> + .byte 102,15,219,21,205,40,0,0 // pand 0x28cd(%rip),%xmm2 # 5bf0 <_sk_callback_sse41+0xc13> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,220,40,0,0 // mulps 0x28dc(%rip),%xmm2 # 5c00 <_sk_callback_sse41+0xc2c> + .byte 15,89,21,211,40,0,0 // mulps 0x28d3(%rip),%xmm2 # 5c00 <_sk_callback_sse41+0xc23> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,227,40,0,0 // movaps 0x28e3(%rip),%xmm3 # 5c10 <_sk_callback_sse41+0xc3c> + .byte 15,40,29,218,40,0,0 // movaps 0x28da(%rip),%xmm3 # 5c10 <_sk_callback_sse41+0xc33> .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,210 // pxor %xmm2,%xmm2 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,39 // je 3367 <_sk_load_565_sse41+0x92> + .byte 116,39 // je 3370 <_sk_load_565_sse41+0x92> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 335b <_sk_load_565_sse41+0x86> + .byte 116,21 // je 3364 <_sk_load_565_sse41+0x86> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,154 // jne 32e6 <_sk_load_565_sse41+0x11> + .byte 117,154 // jne 32ef <_sk_load_565_sse41+0x11> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2 @@ -25276,7 +25127,7 @@ _sk_load_565_sse41: .byte 102,15,58,34,208,1 // pinsrd $0x1,%eax,%xmm2 .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,15,58,34,208,0 // pinsrd $0x0,%eax,%xmm2 - .byte 233,111,255,255,255 // jmpq 32e6 <_sk_load_565_sse41+0x11> + .byte 233,111,255,255,255 // jmpq 32ef <_sk_load_565_sse41+0x11> HIDDEN _sk_gather_565_sse41 .globl _sk_gather_565_sse41 @@ -25304,19 +25155,19 @@ _sk_gather_565_sse41: .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax .byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0 .byte 102,15,56,51,208 // pmovzxwd %xmm0,%xmm2 - .byte 102,15,111,5,63,40,0,0 // movdqa 0x283f(%rip),%xmm0 # 5c20 <_sk_callback_sse41+0xc4c> + .byte 102,15,111,5,54,40,0,0 // movdqa 0x2836(%rip),%xmm0 # 5c20 <_sk_callback_sse41+0xc43> .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,65,40,0,0 // mulps 0x2841(%rip),%xmm0 # 5c30 <_sk_callback_sse41+0xc5c> - .byte 102,15,111,13,73,40,0,0 // movdqa 0x2849(%rip),%xmm1 # 5c40 <_sk_callback_sse41+0xc6c> + .byte 15,89,5,56,40,0,0 // mulps 0x2838(%rip),%xmm0 # 5c30 <_sk_callback_sse41+0xc53> + .byte 102,15,111,13,64,40,0,0 // movdqa 0x2840(%rip),%xmm1 # 5c40 <_sk_callback_sse41+0xc63> .byte 102,15,219,202 // pand %xmm2,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,75,40,0,0 // mulps 0x284b(%rip),%xmm1 # 5c50 <_sk_callback_sse41+0xc7c> - .byte 102,15,219,21,83,40,0,0 // pand 0x2853(%rip),%xmm2 # 5c60 <_sk_callback_sse41+0xc8c> + .byte 15,89,13,66,40,0,0 // mulps 0x2842(%rip),%xmm1 # 5c50 <_sk_callback_sse41+0xc73> + .byte 102,15,219,21,74,40,0,0 // pand 0x284a(%rip),%xmm2 # 5c60 <_sk_callback_sse41+0xc83> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,89,40,0,0 // mulps 0x2859(%rip),%xmm2 # 5c70 <_sk_callback_sse41+0xc9c> + .byte 15,89,21,80,40,0,0 // mulps 0x2850(%rip),%xmm2 # 5c70 <_sk_callback_sse41+0xc93> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,96,40,0,0 // movaps 0x2860(%rip),%xmm3 # 5c80 <_sk_callback_sse41+0xcac> + .byte 15,40,29,87,40,0,0 // movaps 0x2857(%rip),%xmm3 # 5c80 <_sk_callback_sse41+0xca3> .byte 91 // pop %rbx .byte 255,224 // jmpq *%rax @@ -25326,12 +25177,12 @@ FUNCTION(_sk_store_565_sse41) _sk_store_565_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 68,15,40,5,96,40,0,0 // movaps 0x2860(%rip),%xmm8 # 5c90 <_sk_callback_sse41+0xcbc> + .byte 68,15,40,5,87,40,0,0 // movaps 0x2857(%rip),%xmm8 # 5c90 <_sk_callback_sse41+0xcb3> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 .byte 102,65,15,114,241,11 // pslld $0xb,%xmm9 - .byte 68,15,40,21,85,40,0,0 // movaps 0x2855(%rip),%xmm10 # 5ca0 <_sk_callback_sse41+0xccc> + .byte 68,15,40,21,76,40,0,0 // movaps 0x284c(%rip),%xmm10 # 5ca0 <_sk_callback_sse41+0xcc3> .byte 68,15,89,209 // mulps %xmm1,%xmm10 .byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10 .byte 102,65,15,114,242,5 // pslld $0x5,%xmm10 @@ -25341,7 +25192,7 @@ _sk_store_565_sse41: .byte 102,69,15,86,194 // orpd %xmm10,%xmm8 .byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3482 <_sk_store_565_sse41+0x5f> + .byte 117,10 // jne 348b <_sk_store_565_sse41+0x5f> .byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -25349,15 +25200,15 @@ _sk_store_565_sse41: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,30 // je 34b3 <_sk_store_565_sse41+0x90> + .byte 116,30 // je 34bc <_sk_store_565_sse41+0x90> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,15 // je 34aa <_sk_store_565_sse41+0x87> + .byte 116,15 // je 34b3 <_sk_store_565_sse41+0x87> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,221 // jne 347e <_sk_store_565_sse41+0x5b> + .byte 117,221 // jne 3487 <_sk_store_565_sse41+0x5b> .byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2) .byte 102,68,15,58,21,68,80,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdx,2) .byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2) - .byte 235,193 // jmp 347e <_sk_store_565_sse41+0x5b> + .byte 235,193 // jmp 3487 <_sk_store_565_sse41+0x5b> HIDDEN _sk_load_4444_sse41 .globl _sk_load_4444_sse41 @@ -25366,34 +25217,34 @@ _sk_load_4444_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,95 // jne 3526 <_sk_load_4444_sse41+0x69> + .byte 117,95 // jne 352f <_sk_load_4444_sse41+0x69> .byte 102,65,15,56,51,28,82 // pmovzxwd (%r10,%rdx,2),%xmm3 - .byte 102,15,111,5,218,39,0,0 // movdqa 0x27da(%rip),%xmm0 # 5cb0 <_sk_callback_sse41+0xcdc> + .byte 102,15,111,5,209,39,0,0 // movdqa 0x27d1(%rip),%xmm0 # 5cb0 <_sk_callback_sse41+0xcd3> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,220,39,0,0 // mulps 0x27dc(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xcec> - .byte 102,15,111,13,228,39,0,0 // movdqa 0x27e4(%rip),%xmm1 # 5cd0 <_sk_callback_sse41+0xcfc> + .byte 15,89,5,211,39,0,0 // mulps 0x27d3(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xce3> + .byte 102,15,111,13,219,39,0,0 // movdqa 0x27db(%rip),%xmm1 # 5cd0 <_sk_callback_sse41+0xcf3> .byte 102,15,219,203 // pand %xmm3,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,230,39,0,0 // mulps 0x27e6(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xd0c> - .byte 102,15,111,21,238,39,0,0 // movdqa 0x27ee(%rip),%xmm2 # 5cf0 <_sk_callback_sse41+0xd1c> + .byte 15,89,13,221,39,0,0 // mulps 0x27dd(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xd03> + .byte 102,15,111,21,229,39,0,0 // movdqa 0x27e5(%rip),%xmm2 # 5cf0 <_sk_callback_sse41+0xd13> .byte 102,15,219,211 // pand %xmm3,%xmm2 .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,240,39,0,0 // mulps 0x27f0(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xd2c> - .byte 102,15,219,29,248,39,0,0 // pand 0x27f8(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0xd3c> + .byte 15,89,21,231,39,0,0 // mulps 0x27e7(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xd23> + .byte 102,15,219,29,239,39,0,0 // pand 0x27ef(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0xd33> .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,254,39,0,0 // mulps 0x27fe(%rip),%xmm3 # 5d20 <_sk_callback_sse41+0xd4c> + .byte 15,89,29,245,39,0,0 // mulps 0x27f5(%rip),%xmm3 # 5d20 <_sk_callback_sse41+0xd43> .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,219 // pxor %xmm3,%xmm3 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,39 // je 355e <_sk_load_4444_sse41+0xa1> + .byte 116,39 // je 3567 <_sk_load_4444_sse41+0xa1> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 3552 <_sk_load_4444_sse41+0x95> + .byte 116,21 // je 355b <_sk_load_4444_sse41+0x95> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,139 // jne 34ce <_sk_load_4444_sse41+0x11> + .byte 117,139 // jne 34d7 <_sk_load_4444_sse41+0x11> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3 @@ -25401,7 +25252,7 @@ _sk_load_4444_sse41: .byte 102,15,58,34,216,1 // pinsrd $0x1,%eax,%xmm3 .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,15,58,34,216,0 // pinsrd $0x0,%eax,%xmm3 - .byte 233,96,255,255,255 // jmpq 34ce <_sk_load_4444_sse41+0x11> + .byte 233,96,255,255,255 // jmpq 34d7 <_sk_load_4444_sse41+0x11> HIDDEN _sk_gather_4444_sse41 .globl _sk_gather_4444_sse41 @@ -25429,21 +25280,21 @@ _sk_gather_4444_sse41: .byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax .byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0 .byte 102,15,56,51,216 // pmovzxwd %xmm0,%xmm3 - .byte 102,15,111,5,88,39,0,0 // movdqa 0x2758(%rip),%xmm0 # 5d30 <_sk_callback_sse41+0xd5c> + .byte 102,15,111,5,79,39,0,0 // movdqa 0x274f(%rip),%xmm0 # 5d30 <_sk_callback_sse41+0xd53> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,90,39,0,0 // mulps 0x275a(%rip),%xmm0 # 5d40 <_sk_callback_sse41+0xd6c> - .byte 102,15,111,13,98,39,0,0 // movdqa 0x2762(%rip),%xmm1 # 5d50 <_sk_callback_sse41+0xd7c> + .byte 15,89,5,81,39,0,0 // mulps 0x2751(%rip),%xmm0 # 5d40 <_sk_callback_sse41+0xd63> + .byte 102,15,111,13,89,39,0,0 // movdqa 0x2759(%rip),%xmm1 # 5d50 <_sk_callback_sse41+0xd73> .byte 102,15,219,203 // pand %xmm3,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,100,39,0,0 // mulps 0x2764(%rip),%xmm1 # 5d60 <_sk_callback_sse41+0xd8c> - .byte 102,15,111,21,108,39,0,0 // movdqa 0x276c(%rip),%xmm2 # 5d70 <_sk_callback_sse41+0xd9c> + .byte 15,89,13,91,39,0,0 // mulps 0x275b(%rip),%xmm1 # 5d60 <_sk_callback_sse41+0xd83> + .byte 102,15,111,21,99,39,0,0 // movdqa 0x2763(%rip),%xmm2 # 5d70 <_sk_callback_sse41+0xd93> .byte 102,15,219,211 // pand %xmm3,%xmm2 .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,110,39,0,0 // mulps 0x276e(%rip),%xmm2 # 5d80 <_sk_callback_sse41+0xdac> - .byte 102,15,219,29,118,39,0,0 // pand 0x2776(%rip),%xmm3 # 5d90 <_sk_callback_sse41+0xdbc> + .byte 15,89,21,101,39,0,0 // mulps 0x2765(%rip),%xmm2 # 5d80 <_sk_callback_sse41+0xda3> + .byte 102,15,219,29,109,39,0,0 // pand 0x276d(%rip),%xmm3 # 5d90 <_sk_callback_sse41+0xdb3> .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,124,39,0,0 // mulps 0x277c(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0xdcc> + .byte 15,89,29,115,39,0,0 // mulps 0x2773(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0xdc3> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 255,224 // jmpq *%rax @@ -25454,7 +25305,7 @@ FUNCTION(_sk_store_4444_sse41) _sk_store_4444_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 68,15,40,5,122,39,0,0 // movaps 0x277a(%rip),%xmm8 # 5db0 <_sk_callback_sse41+0xddc> + .byte 68,15,40,5,113,39,0,0 // movaps 0x2771(%rip),%xmm8 # 5db0 <_sk_callback_sse41+0xdd3> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 @@ -25474,7 +25325,7 @@ _sk_store_4444_sse41: .byte 102,69,15,86,194 // orpd %xmm10,%xmm8 .byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 369c <_sk_store_4444_sse41+0x73> + .byte 117,10 // jne 36a5 <_sk_store_4444_sse41+0x73> .byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -25482,15 +25333,15 @@ _sk_store_4444_sse41: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,30 // je 36cd <_sk_store_4444_sse41+0xa4> + .byte 116,30 // je 36d6 <_sk_store_4444_sse41+0xa4> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,15 // je 36c4 <_sk_store_4444_sse41+0x9b> + .byte 116,15 // je 36cd <_sk_store_4444_sse41+0x9b> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,221 // jne 3698 <_sk_store_4444_sse41+0x6f> + .byte 117,221 // jne 36a1 <_sk_store_4444_sse41+0x6f> .byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2) .byte 102,68,15,58,21,68,80,2,2 // pextrw $0x2,%xmm8,0x2(%rax,%rdx,2) .byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2) - .byte 235,193 // jmp 3698 <_sk_store_4444_sse41+0x6f> + .byte 235,193 // jmp 36a1 <_sk_store_4444_sse41+0x6f> HIDDEN _sk_load_8888_sse41 .globl _sk_load_8888_sse41 @@ -25499,19 +25350,19 @@ _sk_load_8888_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,88 // jne 3739 <_sk_load_8888_sse41+0x62> + .byte 117,88 // jne 3742 <_sk_load_8888_sse41+0x62> .byte 243,15,111,28,144 // movdqu (%rax,%rdx,4),%xmm3 - .byte 102,15,111,5,210,38,0,0 // movdqa 0x26d2(%rip),%xmm0 # 5dc0 <_sk_callback_sse41+0xdec> + .byte 102,15,111,5,201,38,0,0 // movdqa 0x26c9(%rip),%xmm0 # 5dc0 <_sk_callback_sse41+0xde3> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,211,38,0,0 // movaps 0x26d3(%rip),%xmm8 # 5dd0 <_sk_callback_sse41+0xdfc> + .byte 68,15,40,5,202,38,0,0 // movaps 0x26ca(%rip),%xmm8 # 5dd0 <_sk_callback_sse41+0xdf3> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 - .byte 102,15,56,0,13,210,38,0,0 // pshufb 0x26d2(%rip),%xmm1 # 5de0 <_sk_callback_sse41+0xe0c> + .byte 102,15,56,0,13,201,38,0,0 // pshufb 0x26c9(%rip),%xmm1 # 5de0 <_sk_callback_sse41+0xe03> .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,111,211 // movdqa %xmm3,%xmm2 - .byte 102,15,56,0,21,206,38,0,0 // pshufb 0x26ce(%rip),%xmm2 # 5df0 <_sk_callback_sse41+0xe1c> + .byte 102,15,56,0,21,197,38,0,0 // pshufb 0x26c5(%rip),%xmm2 # 5df0 <_sk_callback_sse41+0xe13> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 .byte 65,15,89,208 // mulps %xmm8,%xmm2 .byte 102,15,114,211,24 // psrld $0x18,%xmm3 @@ -25523,16 +25374,16 @@ _sk_load_8888_sse41: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,219 // pxor %xmm3,%xmm3 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,31 // je 3769 <_sk_load_8888_sse41+0x92> + .byte 116,31 // je 3772 <_sk_load_8888_sse41+0x92> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,17 // je 3761 <_sk_load_8888_sse41+0x8a> + .byte 116,17 // je 376a <_sk_load_8888_sse41+0x8a> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,144 // jne 36e6 <_sk_load_8888_sse41+0xf> + .byte 117,144 // jne 36ef <_sk_load_8888_sse41+0xf> .byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0 .byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3 .byte 102,15,58,34,92,144,4,1 // pinsrd $0x1,0x4(%rax,%rdx,4),%xmm3 .byte 102,15,58,34,28,144,0 // pinsrd $0x0,(%rax,%rdx,4),%xmm3 - .byte 233,113,255,255,255 // jmpq 36e6 <_sk_load_8888_sse41+0xf> + .byte 233,113,255,255,255 // jmpq 36ef <_sk_load_8888_sse41+0xf> HIDDEN _sk_gather_8888_sse41 .globl _sk_gather_8888_sse41 @@ -25557,17 +25408,17 @@ _sk_gather_8888_sse41: .byte 102,65,15,58,34,28,129,1 // pinsrd $0x1,(%r9,%rax,4),%xmm3 .byte 102,65,15,58,34,28,153,2 // pinsrd $0x2,(%r9,%rbx,4),%xmm3 .byte 102,67,15,58,34,28,153,3 // pinsrd $0x3,(%r9,%r11,4),%xmm3 - .byte 102,15,111,5,42,38,0,0 // movdqa 0x262a(%rip),%xmm0 # 5e00 <_sk_callback_sse41+0xe2c> + .byte 102,15,111,5,33,38,0,0 // movdqa 0x2621(%rip),%xmm0 # 5e00 <_sk_callback_sse41+0xe23> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,43,38,0,0 // movaps 0x262b(%rip),%xmm8 # 5e10 <_sk_callback_sse41+0xe3c> + .byte 68,15,40,5,34,38,0,0 // movaps 0x2622(%rip),%xmm8 # 5e10 <_sk_callback_sse41+0xe33> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 - .byte 102,15,56,0,13,42,38,0,0 // pshufb 0x262a(%rip),%xmm1 # 5e20 <_sk_callback_sse41+0xe4c> + .byte 102,15,56,0,13,33,38,0,0 // pshufb 0x2621(%rip),%xmm1 # 5e20 <_sk_callback_sse41+0xe43> .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,111,211 // movdqa %xmm3,%xmm2 - .byte 102,15,56,0,21,38,38,0,0 // pshufb 0x2626(%rip),%xmm2 # 5e30 <_sk_callback_sse41+0xe5c> + .byte 102,15,56,0,21,29,38,0,0 // pshufb 0x261d(%rip),%xmm2 # 5e30 <_sk_callback_sse41+0xe53> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 .byte 65,15,89,208 // mulps %xmm8,%xmm2 .byte 102,15,114,211,24 // psrld $0x18,%xmm3 @@ -25583,7 +25434,7 @@ FUNCTION(_sk_store_8888_sse41) _sk_store_8888_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 68,15,40,5,17,38,0,0 // movaps 0x2611(%rip),%xmm8 # 5e40 <_sk_callback_sse41+0xe6c> + .byte 68,15,40,5,8,38,0,0 // movaps 0x2608(%rip),%xmm8 # 5e40 <_sk_callback_sse41+0xe63> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 @@ -25602,22 +25453,22 @@ _sk_store_8888_sse41: .byte 102,69,15,235,193 // por %xmm9,%xmm8 .byte 102,69,15,235,194 // por %xmm10,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 388f <_sk_store_8888_sse41+0x6d> + .byte 117,10 // jne 3898 <_sk_store_8888_sse41+0x6d> .byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,30 // je 38ba <_sk_store_8888_sse41+0x98> + .byte 116,30 // je 38c3 <_sk_store_8888_sse41+0x98> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,15 // je 38b1 <_sk_store_8888_sse41+0x8f> + .byte 116,15 // je 38ba <_sk_store_8888_sse41+0x8f> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,227 // jne 388b <_sk_store_8888_sse41+0x69> + .byte 117,227 // jne 3894 <_sk_store_8888_sse41+0x69> .byte 102,68,15,58,22,68,144,8,2 // pextrd $0x2,%xmm8,0x8(%rax,%rdx,4) .byte 102,68,15,58,22,68,144,4,1 // pextrd $0x1,%xmm8,0x4(%rax,%rdx,4) .byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4) - .byte 235,201 // jmp 388b <_sk_store_8888_sse41+0x69> + .byte 235,201 // jmp 3894 <_sk_store_8888_sse41+0x69> HIDDEN _sk_load_f16_sse41 .globl _sk_load_f16_sse41 @@ -25626,7 +25477,7 @@ _sk_load_f16_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,60,1,0,0 // jne 3a0c <_sk_load_f16_sse41+0x14a> + .byte 15,133,60,1,0,0 // jne 3a15 <_sk_load_f16_sse41+0x14a> .byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0 .byte 243,15,111,76,208,16 // movdqu 0x10(%rax,%rdx,8),%xmm1 .byte 102,68,15,40,200 // movapd %xmm0,%xmm9 @@ -25636,18 +25487,18 @@ _sk_load_f16_sse41: .byte 102,68,15,97,216 // punpcklwd %xmm0,%xmm11 .byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9 .byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1 - .byte 102,68,15,111,5,73,37,0,0 // movdqa 0x2549(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0xe7c> + .byte 102,68,15,111,5,64,37,0,0 // movdqa 0x2540(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0xe73> .byte 102,15,111,209 // movdqa %xmm1,%xmm2 .byte 102,65,15,219,208 // pand %xmm8,%xmm2 .byte 102,15,239,202 // pxor %xmm2,%xmm1 - .byte 102,15,111,29,68,37,0,0 // movdqa 0x2544(%rip),%xmm3 # 5e60 <_sk_callback_sse41+0xe8c> + .byte 102,15,111,29,59,37,0,0 // movdqa 0x253b(%rip),%xmm3 # 5e60 <_sk_callback_sse41+0xe83> .byte 102,15,114,242,16 // pslld $0x10,%xmm2 .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0 .byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0 .byte 102,15,114,241,13 // pslld $0xd,%xmm1 .byte 102,15,235,202 // por %xmm2,%xmm1 - .byte 102,68,15,111,21,48,37,0,0 // movdqa 0x2530(%rip),%xmm10 # 5e70 <_sk_callback_sse41+0xe9c> + .byte 102,68,15,111,21,39,37,0,0 // movdqa 0x2527(%rip),%xmm10 # 5e70 <_sk_callback_sse41+0xe93> .byte 102,65,15,254,202 // paddd %xmm10,%xmm1 .byte 102,15,219,193 // pand %xmm1,%xmm0 .byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11 @@ -25690,16 +25541,16 @@ _sk_load_f16_sse41: .byte 255,224 // jmpq *%rax .byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,13 // jne 3a24 <_sk_load_f16_sse41+0x162> + .byte 117,13 // jne 3a2d <_sk_load_f16_sse41+0x162> .byte 243,15,126,192 // movq %xmm0,%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,183,254,255,255 // jmpq 38db <_sk_load_f16_sse41+0x19> + .byte 233,183,254,255,255 // jmpq 38e4 <_sk_load_f16_sse41+0x19> .byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,163,254,255,255 // jb 38db <_sk_load_f16_sse41+0x19> + .byte 15,130,163,254,255,255 // jb 38e4 <_sk_load_f16_sse41+0x19> .byte 243,15,126,76,208,16 // movq 0x10(%rax,%rdx,8),%xmm1 - .byte 233,152,254,255,255 // jmpq 38db <_sk_load_f16_sse41+0x19> + .byte 233,152,254,255,255 // jmpq 38e4 <_sk_load_f16_sse41+0x19> HIDDEN _sk_gather_f16_sse41 .globl _sk_gather_f16_sse41 @@ -25733,18 +25584,18 @@ _sk_gather_f16_sse41: .byte 102,68,15,97,218 // punpcklwd %xmm2,%xmm11 .byte 102,68,15,105,202 // punpckhwd %xmm2,%xmm9 .byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1 - .byte 102,68,15,111,5,182,35,0,0 // movdqa 0x23b6(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0xeac> + .byte 102,68,15,111,5,173,35,0,0 // movdqa 0x23ad(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0xea3> .byte 102,15,111,209 // movdqa %xmm1,%xmm2 .byte 102,65,15,219,208 // pand %xmm8,%xmm2 .byte 102,15,239,202 // pxor %xmm2,%xmm1 - .byte 102,15,111,29,177,35,0,0 // movdqa 0x23b1(%rip),%xmm3 # 5e90 <_sk_callback_sse41+0xebc> + .byte 102,15,111,29,168,35,0,0 // movdqa 0x23a8(%rip),%xmm3 # 5e90 <_sk_callback_sse41+0xeb3> .byte 102,15,114,242,16 // pslld $0x10,%xmm2 .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0 .byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0 .byte 102,15,114,241,13 // pslld $0xd,%xmm1 .byte 102,15,235,202 // por %xmm2,%xmm1 - .byte 102,68,15,111,21,157,35,0,0 // movdqa 0x239d(%rip),%xmm10 # 5ea0 <_sk_callback_sse41+0xecc> + .byte 102,68,15,111,21,148,35,0,0 // movdqa 0x2394(%rip),%xmm10 # 5ea0 <_sk_callback_sse41+0xec3> .byte 102,65,15,254,202 // paddd %xmm10,%xmm1 .byte 102,15,219,193 // pand %xmm1,%xmm0 .byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11 @@ -25793,17 +25644,17 @@ FUNCTION(_sk_store_f16_sse41) _sk_store_f16_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 102,68,15,111,21,210,34,0,0 // movdqa 0x22d2(%rip),%xmm10 # 5eb0 <_sk_callback_sse41+0xedc> + .byte 102,68,15,111,21,201,34,0,0 // movdqa 0x22c9(%rip),%xmm10 # 5eb0 <_sk_callback_sse41+0xed3> .byte 102,68,15,111,216 // movdqa %xmm0,%xmm11 .byte 102,69,15,219,218 // pand %xmm10,%xmm11 .byte 102,68,15,111,232 // movdqa %xmm0,%xmm13 .byte 102,69,15,239,235 // pxor %xmm11,%xmm13 - .byte 102,68,15,111,13,197,34,0,0 // movdqa 0x22c5(%rip),%xmm9 # 5ec0 <_sk_callback_sse41+0xeec> + .byte 102,68,15,111,13,188,34,0,0 // movdqa 0x22bc(%rip),%xmm9 # 5ec0 <_sk_callback_sse41+0xee3> .byte 102,65,15,114,211,16 // psrld $0x10,%xmm11 .byte 102,69,15,111,193 // movdqa %xmm9,%xmm8 .byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8 .byte 102,65,15,114,213,13 // psrld $0xd,%xmm13 - .byte 102,68,15,111,37,182,34,0,0 // movdqa 0x22b6(%rip),%xmm12 # 5ed0 <_sk_callback_sse41+0xefc> + .byte 102,68,15,111,37,173,34,0,0 // movdqa 0x22ad(%rip),%xmm12 # 5ed0 <_sk_callback_sse41+0xef3> .byte 102,69,15,235,220 // por %xmm12,%xmm11 .byte 102,69,15,254,221 // paddd %xmm13,%xmm11 .byte 102,69,15,223,195 // pandn %xmm11,%xmm8 @@ -25847,7 +25698,7 @@ _sk_store_f16_sse41: .byte 102,69,15,111,200 // movdqa %xmm8,%xmm9 .byte 102,69,15,98,203 // punpckldq %xmm11,%xmm9 .byte 77,133,192 // test %r8,%r8 - .byte 117,21 // jne 3d10 <_sk_store_f16_sse41+0x140> + .byte 117,21 // jne 3d19 <_sk_store_f16_sse41+0x140> .byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8) .byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8 .byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8) @@ -25855,13 +25706,13 @@ _sk_store_f16_sse41: .byte 255,224 // jmpq *%rax .byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 3d0c <_sk_store_f16_sse41+0x13c> + .byte 116,240 // je 3d15 <_sk_store_f16_sse41+0x13c> .byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 3d0c <_sk_store_f16_sse41+0x13c> + .byte 114,227 // jb 3d15 <_sk_store_f16_sse41+0x13c> .byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8 .byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8) - .byte 235,213 // jmp 3d0c <_sk_store_f16_sse41+0x13c> + .byte 235,213 // jmp 3d15 <_sk_store_f16_sse41+0x13c> HIDDEN _sk_load_u16_be_sse41 .globl _sk_load_u16_be_sse41 @@ -25871,7 +25722,7 @@ _sk_load_u16_be_sse41: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,185,0,0,0 // jne 3e06 <_sk_load_u16_be_sse41+0xcf> + .byte 15,133,185,0,0,0 // jne 3e0f <_sk_load_u16_be_sse41+0xcf> .byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0 .byte 243,65,15,111,76,65,16 // movdqu 0x10(%r9,%rax,2),%xmm1 .byte 102,15,40,208 // movapd %xmm0,%xmm2 @@ -25887,7 +25738,7 @@ _sk_load_u16_be_sse41: .byte 102,15,235,200 // por %xmm0,%xmm1 .byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,71,33,0,0 // movaps 0x2147(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xf0c> + .byte 68,15,40,5,62,33,0,0 // movaps 0x213e(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xf03> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 .byte 102,15,113,241,8 // psllw $0x8,%xmm1 @@ -25915,16 +25766,16 @@ _sk_load_u16_be_sse41: .byte 255,224 // jmpq *%rax .byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,13 // jne 3e1f <_sk_load_u16_be_sse41+0xe8> + .byte 117,13 // jne 3e28 <_sk_load_u16_be_sse41+0xe8> .byte 243,15,126,192 // movq %xmm0,%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,59,255,255,255 // jmpq 3d5a <_sk_load_u16_be_sse41+0x23> + .byte 233,59,255,255,255 // jmpq 3d63 <_sk_load_u16_be_sse41+0x23> .byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,38,255,255,255 // jb 3d5a <_sk_load_u16_be_sse41+0x23> + .byte 15,130,38,255,255,255 // jb 3d63 <_sk_load_u16_be_sse41+0x23> .byte 243,65,15,126,76,65,16 // movq 0x10(%r9,%rax,2),%xmm1 - .byte 233,26,255,255,255 // jmpq 3d5a <_sk_load_u16_be_sse41+0x23> + .byte 233,26,255,255,255 // jmpq 3d63 <_sk_load_u16_be_sse41+0x23> HIDDEN _sk_load_rgb_u16_be_sse41 .globl _sk_load_rgb_u16_be_sse41 @@ -25934,7 +25785,7 @@ _sk_load_rgb_u16_be_sse41: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,170,0,0,0 // jne 3efc <_sk_load_rgb_u16_be_sse41+0xbc> + .byte 15,133,170,0,0,0 // jne 3f05 <_sk_load_rgb_u16_be_sse41+0xbc> .byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2 .byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3 .byte 102,15,115,219,4 // psrldq $0x4,%xmm3 @@ -25954,7 +25805,7 @@ _sk_load_rgb_u16_be_sse41: .byte 102,15,235,200 // por %xmm0,%xmm1 .byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,63,32,0,0 // movaps 0x203f(%rip),%xmm8 # 5ef0 <_sk_callback_sse41+0xf1c> + .byte 68,15,40,5,54,32,0,0 // movaps 0x2036(%rip),%xmm8 # 5ef0 <_sk_callback_sse41+0xf13> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 .byte 102,15,113,241,8 // psllw $0x8,%xmm1 @@ -25971,27 +25822,27 @@ _sk_load_rgb_u16_be_sse41: .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 .byte 65,15,89,208 // mulps %xmm8,%xmm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,6,32,0,0 // movaps 0x2006(%rip),%xmm3 # 5f00 <_sk_callback_sse41+0xf2c> + .byte 15,40,29,253,31,0,0 // movaps 0x1ffd(%rip),%xmm3 # 5f00 <_sk_callback_sse41+0xf23> .byte 255,224 // jmpq *%rax .byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2 .byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,13 // jne 3f21 <_sk_load_rgb_u16_be_sse41+0xe1> + .byte 117,13 // jne 3f2a <_sk_load_rgb_u16_be_sse41+0xe1> .byte 102,15,239,219 // pxor %xmm3,%xmm3 .byte 102,15,239,192 // pxor %xmm0,%xmm0 - .byte 233,85,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36> + .byte 233,85,255,255,255 // jmpq 3e7f <_sk_load_rgb_u16_be_sse41+0x36> .byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0 .byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,24 // jb 3f52 <_sk_load_rgb_u16_be_sse41+0x112> + .byte 114,24 // jb 3f5b <_sk_load_rgb_u16_be_sse41+0x112> .byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3 .byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3 .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,36,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36> + .byte 233,36,255,255,255 // jmpq 3e7f <_sk_load_rgb_u16_be_sse41+0x36> .byte 102,15,239,219 // pxor %xmm3,%xmm3 - .byte 233,27,255,255,255 // jmpq 3e76 <_sk_load_rgb_u16_be_sse41+0x36> + .byte 233,27,255,255,255 // jmpq 3e7f <_sk_load_rgb_u16_be_sse41+0x36> HIDDEN _sk_store_u16_be_sse41 .globl _sk_store_u16_be_sse41 @@ -26000,7 +25851,7 @@ _sk_store_u16_be_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax - .byte 68,15,40,21,160,31,0,0 // movaps 0x1fa0(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0xf3c> + .byte 68,15,40,21,151,31,0,0 // movaps 0x1f97(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0xf33> .byte 68,15,40,192 // movaps %xmm0,%xmm8 .byte 69,15,89,194 // mulps %xmm10,%xmm8 .byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8 @@ -26037,7 +25888,7 @@ _sk_store_u16_be_sse41: .byte 102,69,15,111,208 // movdqa %xmm8,%xmm10 .byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10 .byte 77,133,192 // test %r8,%r8 - .byte 117,21 // jne 403e <_sk_store_u16_be_sse41+0xe3> + .byte 117,21 // jne 4047 <_sk_store_u16_be_sse41+0xe3> .byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2) .byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8 .byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2) @@ -26045,13 +25896,13 @@ _sk_store_u16_be_sse41: .byte 255,224 // jmpq *%rax .byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 403a <_sk_store_u16_be_sse41+0xdf> + .byte 116,240 // je 4043 <_sk_store_u16_be_sse41+0xdf> .byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 403a <_sk_store_u16_be_sse41+0xdf> + .byte 114,227 // jb 4043 <_sk_store_u16_be_sse41+0xdf> .byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8 .byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2) - .byte 235,213 // jmp 403a <_sk_store_u16_be_sse41+0xdf> + .byte 235,213 // jmp 4043 <_sk_store_u16_be_sse41+0xdf> HIDDEN _sk_load_f32_sse41 .globl _sk_load_f32_sse41 @@ -26064,7 +25915,7 @@ _sk_load_f32_sse41: .byte 72,193,224,4 // shl $0x4,%rax .byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,66 // jne 40c5 <_sk_load_f32_sse41+0x60> + .byte 117,66 // jne 40ce <_sk_load_f32_sse41+0x60> .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0 .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3 .byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9 @@ -26084,17 +25935,17 @@ _sk_load_f32_sse41: .byte 255,224 // jmpq *%rax .byte 69,15,87,201 // xorps %xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,8 // jne 40d7 <_sk_load_f32_sse41+0x72> + .byte 117,8 // jne 40e0 <_sk_load_f32_sse41+0x72> .byte 15,87,219 // xorps %xmm3,%xmm3 .byte 15,87,192 // xorps %xmm0,%xmm0 - .byte 235,190 // jmp 4095 <_sk_load_f32_sse41+0x30> + .byte 235,190 // jmp 409e <_sk_load_f32_sse41+0x30> .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,8 // jb 40eb <_sk_load_f32_sse41+0x86> + .byte 114,8 // jb 40f4 <_sk_load_f32_sse41+0x86> .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3 - .byte 235,170 // jmp 4095 <_sk_load_f32_sse41+0x30> + .byte 235,170 // jmp 409e <_sk_load_f32_sse41+0x30> .byte 15,87,219 // xorps %xmm3,%xmm3 - .byte 235,165 // jmp 4095 <_sk_load_f32_sse41+0x30> + .byte 235,165 // jmp 409e <_sk_load_f32_sse41+0x30> HIDDEN _sk_store_f32_sse41 .globl _sk_store_f32_sse41 @@ -26120,7 +25971,7 @@ _sk_store_f32_sse41: .byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9 .byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1) .byte 77,133,192 // test %r8,%r8 - .byte 117,29 // jne 4162 <_sk_store_f32_sse41+0x72> + .byte 117,29 // jne 416b <_sk_store_f32_sse41+0x72> .byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10 .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4) .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4) @@ -26128,12 +25979,12 @@ _sk_store_f32_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,246 // je 415e <_sk_store_f32_sse41+0x6e> + .byte 116,246 // je 4167 <_sk_store_f32_sse41+0x6e> .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,234 // jb 415e <_sk_store_f32_sse41+0x6e> + .byte 114,234 // jb 4167 <_sk_store_f32_sse41+0x6e> .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4) - .byte 235,225 // jmp 415e <_sk_store_f32_sse41+0x6e> + .byte 235,225 // jmp 4167 <_sk_store_f32_sse41+0x6e> HIDDEN _sk_clamp_x_sse41 .globl _sk_clamp_x_sse41 @@ -26245,7 +26096,7 @@ FUNCTION(_sk_clamp_x_1_sse41) _sk_clamp_x_1_sse41: .byte 69,15,87,192 // xorps %xmm8,%xmm8 .byte 68,15,95,192 // maxps %xmm0,%xmm8 - .byte 68,15,93,5,119,28,0,0 // minps 0x1c77(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0xf4c> + .byte 68,15,93,5,110,28,0,0 // minps 0x1c6e(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0xf43> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -26263,9 +26114,9 @@ HIDDEN _sk_mirror_x_1_sse41 .globl _sk_mirror_x_1_sse41 FUNCTION(_sk_mirror_x_1_sse41) _sk_mirror_x_1_sse41: - .byte 68,15,40,5,104,28,0,0 // movaps 0x1c68(%rip),%xmm8 # 5f30 <_sk_callback_sse41+0xf5c> + .byte 68,15,40,5,95,28,0,0 // movaps 0x1c5f(%rip),%xmm8 # 5f30 <_sk_callback_sse41+0xf53> .byte 65,15,88,192 // addps %xmm8,%xmm0 - .byte 68,15,40,13,108,28,0,0 // movaps 0x1c6c(%rip),%xmm9 # 5f40 <_sk_callback_sse41+0xf6c> + .byte 68,15,40,13,99,28,0,0 // movaps 0x1c63(%rip),%xmm9 # 5f40 <_sk_callback_sse41+0xf63> .byte 68,15,89,200 // mulps %xmm0,%xmm9 .byte 102,69,15,58,8,201,1 // roundps $0x1,%xmm9,%xmm9 .byte 69,15,88,201 // addps %xmm9,%xmm9 @@ -26282,10 +26133,10 @@ HIDDEN _sk_luminance_to_alpha_sse41 FUNCTION(_sk_luminance_to_alpha_sse41) _sk_luminance_to_alpha_sse41: .byte 15,40,218 // movaps %xmm2,%xmm3 - .byte 15,89,5,75,28,0,0 // mulps 0x1c4b(%rip),%xmm0 # 5f50 <_sk_callback_sse41+0xf7c> - .byte 15,89,13,84,28,0,0 // mulps 0x1c54(%rip),%xmm1 # 5f60 <_sk_callback_sse41+0xf8c> + .byte 15,89,5,66,28,0,0 // mulps 0x1c42(%rip),%xmm0 # 5f50 <_sk_callback_sse41+0xf73> + .byte 15,89,13,75,28,0,0 // mulps 0x1c4b(%rip),%xmm1 # 5f60 <_sk_callback_sse41+0xf83> .byte 15,88,200 // addps %xmm0,%xmm1 - .byte 15,89,29,90,28,0,0 // mulps 0x1c5a(%rip),%xmm3 # 5f70 <_sk_callback_sse41+0xf9c> + .byte 15,89,29,81,28,0,0 // mulps 0x1c51(%rip),%xmm3 # 5f70 <_sk_callback_sse41+0xf93> .byte 15,88,217 // addps %xmm1,%xmm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 @@ -26564,9 +26415,9 @@ _sk_evenly_spaced_gradient_sse41: .byte 72,139,24 // mov (%rax),%rbx .byte 76,139,112,8 // mov 0x8(%rax),%r14 .byte 72,255,203 // dec %rbx - .byte 120,7 // js 4754 <_sk_evenly_spaced_gradient_sse41+0x1a> + .byte 120,7 // js 475d <_sk_evenly_spaced_gradient_sse41+0x1a> .byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1 - .byte 235,21 // jmp 4769 <_sk_evenly_spaced_gradient_sse41+0x2f> + .byte 235,21 // jmp 4772 <_sk_evenly_spaced_gradient_sse41+0x2f> .byte 73,137,217 // mov %rbx,%r9 .byte 73,209,233 // shr %r9 .byte 131,227,1 // and $0x1,%ebx @@ -26656,15 +26507,15 @@ HIDDEN _sk_gauss_a_to_rgba_sse41 .globl _sk_gauss_a_to_rgba_sse41 FUNCTION(_sk_gauss_a_to_rgba_sse41) _sk_gauss_a_to_rgba_sse41: - .byte 15,40,5,105,22,0,0 // movaps 0x1669(%rip),%xmm0 # 5f80 <_sk_callback_sse41+0xfac> + .byte 15,40,5,96,22,0,0 // movaps 0x1660(%rip),%xmm0 # 5f80 <_sk_callback_sse41+0xfa3> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,111,22,0,0 // addps 0x166f(%rip),%xmm0 # 5f90 <_sk_callback_sse41+0xfbc> + .byte 15,88,5,102,22,0,0 // addps 0x1666(%rip),%xmm0 # 5f90 <_sk_callback_sse41+0xfb3> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,117,22,0,0 // addps 0x1675(%rip),%xmm0 # 5fa0 <_sk_callback_sse41+0xfcc> + .byte 15,88,5,108,22,0,0 // addps 0x166c(%rip),%xmm0 # 5fa0 <_sk_callback_sse41+0xfc3> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,123,22,0,0 // addps 0x167b(%rip),%xmm0 # 5fb0 <_sk_callback_sse41+0xfdc> + .byte 15,88,5,114,22,0,0 // addps 0x1672(%rip),%xmm0 # 5fb0 <_sk_callback_sse41+0xfd3> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,129,22,0,0 // addps 0x1681(%rip),%xmm0 # 5fc0 <_sk_callback_sse41+0xfec> + .byte 15,88,5,120,22,0,0 // addps 0x1678(%rip),%xmm0 # 5fc0 <_sk_callback_sse41+0xfe3> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 @@ -26682,12 +26533,12 @@ _sk_gradient_sse41: .byte 76,139,8 // mov (%rax),%r9 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,249,2 // cmp $0x2,%r9 - .byte 114,50 // jb 4992 <_sk_gradient_sse41+0x46> + .byte 114,50 // jb 499b <_sk_gradient_sse41+0x46> .byte 72,139,88,72 // mov 0x48(%rax),%rbx .byte 73,255,201 // dec %r9 .byte 72,131,195,4 // add $0x4,%rbx .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 15,40,21,90,22,0,0 // movaps 0x165a(%rip),%xmm2 # 5fd0 <_sk_callback_sse41+0xffc> + .byte 15,40,21,81,22,0,0 // movaps 0x1651(%rip),%xmm2 # 5fd0 <_sk_callback_sse41+0xff3> .byte 243,15,16,27 // movss (%rbx),%xmm3 .byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3 .byte 15,194,216,2 // cmpleps %xmm0,%xmm3 @@ -26695,7 +26546,7 @@ _sk_gradient_sse41: .byte 102,15,254,203 // paddd %xmm3,%xmm1 .byte 72,131,195,4 // add $0x4,%rbx .byte 73,255,201 // dec %r9 - .byte 117,228 // jne 4976 <_sk_gradient_sse41+0x2a> + .byte 117,228 // jne 497f <_sk_gradient_sse41+0x2a> .byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9 .byte 69,137,202 // mov %r9d,%r10d .byte 73,193,233,32 // shr $0x20,%r9 @@ -26825,26 +26676,26 @@ _sk_xy_to_unit_angle_sse41: .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,40,236 // movaps %xmm12,%xmm13 .byte 69,15,89,237 // mulps %xmm13,%xmm13 - .byte 68,15,40,21,251,19,0,0 // movaps 0x13fb(%rip),%xmm10 # 5fe0 <_sk_callback_sse41+0x100c> + .byte 68,15,40,21,242,19,0,0 // movaps 0x13f2(%rip),%xmm10 # 5fe0 <_sk_callback_sse41+0x1003> .byte 69,15,89,213 // mulps %xmm13,%xmm10 - .byte 68,15,88,21,255,19,0,0 // addps 0x13ff(%rip),%xmm10 # 5ff0 <_sk_callback_sse41+0x101c> + .byte 68,15,88,21,246,19,0,0 // addps 0x13f6(%rip),%xmm10 # 5ff0 <_sk_callback_sse41+0x1013> .byte 69,15,89,213 // mulps %xmm13,%xmm10 - .byte 68,15,88,21,3,20,0,0 // addps 0x1403(%rip),%xmm10 # 6000 <_sk_callback_sse41+0x102c> + .byte 68,15,88,21,250,19,0,0 // addps 0x13fa(%rip),%xmm10 # 6000 <_sk_callback_sse41+0x1023> .byte 69,15,89,213 // mulps %xmm13,%xmm10 - .byte 68,15,88,21,7,20,0,0 // addps 0x1407(%rip),%xmm10 # 6010 <_sk_callback_sse41+0x103c> + .byte 68,15,88,21,254,19,0,0 // addps 0x13fe(%rip),%xmm10 # 6010 <_sk_callback_sse41+0x1033> .byte 69,15,89,212 // mulps %xmm12,%xmm10 .byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0 - .byte 68,15,40,29,6,20,0,0 // movaps 0x1406(%rip),%xmm11 # 6020 <_sk_callback_sse41+0x104c> + .byte 68,15,40,29,253,19,0,0 // movaps 0x13fd(%rip),%xmm11 # 6020 <_sk_callback_sse41+0x1043> .byte 69,15,92,218 // subps %xmm10,%xmm11 .byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10 .byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9 - .byte 68,15,40,29,255,19,0,0 // movaps 0x13ff(%rip),%xmm11 # 6030 <_sk_callback_sse41+0x105c> + .byte 68,15,40,29,246,19,0,0 // movaps 0x13f6(%rip),%xmm11 # 6030 <_sk_callback_sse41+0x1053> .byte 69,15,92,218 // subps %xmm10,%xmm11 .byte 65,15,40,193 // movaps %xmm9,%xmm0 .byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10 .byte 15,40,193 // movaps %xmm1,%xmm0 .byte 65,15,194,192,1 // cmpltps %xmm8,%xmm0 - .byte 68,15,40,13,241,19,0,0 // movaps 0x13f1(%rip),%xmm9 # 6040 <_sk_callback_sse41+0x106c> + .byte 68,15,40,13,232,19,0,0 // movaps 0x13e8(%rip),%xmm9 # 6040 <_sk_callback_sse41+0x1063> .byte 69,15,92,202 // subps %xmm10,%xmm9 .byte 102,69,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm10 .byte 69,15,194,194,7 // cmpordps %xmm10,%xmm8 @@ -26870,7 +26721,7 @@ HIDDEN _sk_save_xy_sse41 FUNCTION(_sk_save_xy_sse41) _sk_save_xy_sse41: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,197,19,0,0 // movaps 0x13c5(%rip),%xmm8 # 6050 <_sk_callback_sse41+0x107c> + .byte 68,15,40,5,188,19,0,0 // movaps 0x13bc(%rip),%xmm8 # 6050 <_sk_callback_sse41+0x1073> .byte 15,17,0 // movups %xmm0,(%rax) .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,88,200 // addps %xmm8,%xmm9 @@ -26914,8 +26765,8 @@ _sk_bilinear_nx_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,71,19,0,0 // addps 0x1347(%rip),%xmm0 # 6060 <_sk_callback_sse41+0x108c> - .byte 68,15,40,13,79,19,0,0 // movaps 0x134f(%rip),%xmm9 # 6070 <_sk_callback_sse41+0x109c> + .byte 15,88,5,62,19,0,0 // addps 0x133e(%rip),%xmm0 # 6060 <_sk_callback_sse41+0x1083> + .byte 68,15,40,13,70,19,0,0 // movaps 0x1346(%rip),%xmm9 # 6070 <_sk_callback_sse41+0x1093> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -26928,7 +26779,7 @@ _sk_bilinear_px_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,62,19,0,0 // addps 0x133e(%rip),%xmm0 # 6080 <_sk_callback_sse41+0x10ac> + .byte 15,88,5,53,19,0,0 // addps 0x1335(%rip),%xmm0 # 6080 <_sk_callback_sse41+0x10a3> .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -26940,8 +26791,8 @@ _sk_bilinear_ny_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,48,19,0,0 // addps 0x1330(%rip),%xmm1 # 6090 <_sk_callback_sse41+0x10bc> - .byte 68,15,40,13,56,19,0,0 // movaps 0x1338(%rip),%xmm9 # 60a0 <_sk_callback_sse41+0x10cc> + .byte 15,88,13,39,19,0,0 // addps 0x1327(%rip),%xmm1 # 6090 <_sk_callback_sse41+0x10b3> + .byte 68,15,40,13,47,19,0,0 // movaps 0x132f(%rip),%xmm9 # 60a0 <_sk_callback_sse41+0x10c3> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -26954,7 +26805,7 @@ _sk_bilinear_py_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,38,19,0,0 // addps 0x1326(%rip),%xmm1 # 60b0 <_sk_callback_sse41+0x10dc> + .byte 15,88,13,29,19,0,0 // addps 0x131d(%rip),%xmm1 # 60b0 <_sk_callback_sse41+0x10d3> .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -26966,13 +26817,13 @@ _sk_bicubic_n3x_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,25,19,0,0 // addps 0x1319(%rip),%xmm0 # 60c0 <_sk_callback_sse41+0x10ec> - .byte 68,15,40,13,33,19,0,0 // movaps 0x1321(%rip),%xmm9 # 60d0 <_sk_callback_sse41+0x10fc> + .byte 15,88,5,16,19,0,0 // addps 0x1310(%rip),%xmm0 # 60c0 <_sk_callback_sse41+0x10e3> + .byte 68,15,40,13,24,19,0,0 // movaps 0x1318(%rip),%xmm9 # 60d0 <_sk_callback_sse41+0x10f3> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 69,15,40,193 // movaps %xmm9,%xmm8 .byte 69,15,89,192 // mulps %xmm8,%xmm8 - .byte 68,15,89,13,29,19,0,0 // mulps 0x131d(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x110c> - .byte 68,15,88,13,37,19,0,0 // addps 0x1325(%rip),%xmm9 # 60f0 <_sk_callback_sse41+0x111c> + .byte 68,15,89,13,20,19,0,0 // mulps 0x1314(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x1103> + .byte 68,15,88,13,28,19,0,0 // addps 0x131c(%rip),%xmm9 # 60f0 <_sk_callback_sse41+0x1113> .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -26985,16 +26836,16 @@ _sk_bicubic_n1x_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,20,19,0,0 // addps 0x1314(%rip),%xmm0 # 6100 <_sk_callback_sse41+0x112c> - .byte 68,15,40,13,28,19,0,0 // movaps 0x131c(%rip),%xmm9 # 6110 <_sk_callback_sse41+0x113c> + .byte 15,88,5,11,19,0,0 // addps 0x130b(%rip),%xmm0 # 6100 <_sk_callback_sse41+0x1123> + .byte 68,15,40,13,19,19,0,0 // movaps 0x1313(%rip),%xmm9 # 6110 <_sk_callback_sse41+0x1133> .byte 69,15,92,200 // subps %xmm8,%xmm9 - .byte 68,15,40,5,32,19,0,0 // movaps 0x1320(%rip),%xmm8 # 6120 <_sk_callback_sse41+0x114c> + .byte 68,15,40,5,23,19,0,0 // movaps 0x1317(%rip),%xmm8 # 6120 <_sk_callback_sse41+0x1143> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,36,19,0,0 // addps 0x1324(%rip),%xmm8 # 6130 <_sk_callback_sse41+0x115c> + .byte 68,15,88,5,27,19,0,0 // addps 0x131b(%rip),%xmm8 # 6130 <_sk_callback_sse41+0x1153> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,40,19,0,0 // addps 0x1328(%rip),%xmm8 # 6140 <_sk_callback_sse41+0x116c> + .byte 68,15,88,5,31,19,0,0 // addps 0x131f(%rip),%xmm8 # 6140 <_sk_callback_sse41+0x1163> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,44,19,0,0 // addps 0x132c(%rip),%xmm8 # 6150 <_sk_callback_sse41+0x117c> + .byte 68,15,88,5,35,19,0,0 // addps 0x1323(%rip),%xmm8 # 6150 <_sk_callback_sse41+0x1173> .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -27004,17 +26855,17 @@ HIDDEN _sk_bicubic_p1x_sse41 FUNCTION(_sk_bicubic_p1x_sse41) _sk_bicubic_p1x_sse41: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,38,19,0,0 // movaps 0x1326(%rip),%xmm8 # 6160 <_sk_callback_sse41+0x118c> + .byte 68,15,40,5,29,19,0,0 // movaps 0x131d(%rip),%xmm8 # 6160 <_sk_callback_sse41+0x1183> .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9 .byte 65,15,88,192 // addps %xmm8,%xmm0 - .byte 68,15,40,21,34,19,0,0 // movaps 0x1322(%rip),%xmm10 # 6170 <_sk_callback_sse41+0x119c> + .byte 68,15,40,21,25,19,0,0 // movaps 0x1319(%rip),%xmm10 # 6170 <_sk_callback_sse41+0x1193> .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,38,19,0,0 // addps 0x1326(%rip),%xmm10 # 6180 <_sk_callback_sse41+0x11ac> + .byte 68,15,88,21,29,19,0,0 // addps 0x131d(%rip),%xmm10 # 6180 <_sk_callback_sse41+0x11a3> .byte 69,15,89,209 // mulps %xmm9,%xmm10 .byte 69,15,88,208 // addps %xmm8,%xmm10 .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,34,19,0,0 // addps 0x1322(%rip),%xmm10 # 6190 <_sk_callback_sse41+0x11bc> + .byte 68,15,88,21,25,19,0,0 // addps 0x1319(%rip),%xmm10 # 6190 <_sk_callback_sse41+0x11b3> .byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -27026,11 +26877,11 @@ _sk_bicubic_p3x_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,21,19,0,0 // addps 0x1315(%rip),%xmm0 # 61a0 <_sk_callback_sse41+0x11cc> + .byte 15,88,5,12,19,0,0 // addps 0x130c(%rip),%xmm0 # 61a0 <_sk_callback_sse41+0x11c3> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 69,15,89,201 // mulps %xmm9,%xmm9 - .byte 68,15,89,5,21,19,0,0 // mulps 0x1315(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x11dc> - .byte 68,15,88,5,29,19,0,0 // addps 0x131d(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x11ec> + .byte 68,15,89,5,12,19,0,0 // mulps 0x130c(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x11d3> + .byte 68,15,88,5,20,19,0,0 // addps 0x1314(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x11e3> .byte 69,15,89,193 // mulps %xmm9,%xmm8 .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -27043,13 +26894,13 @@ _sk_bicubic_n3y_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,11,19,0,0 // addps 0x130b(%rip),%xmm1 # 61d0 <_sk_callback_sse41+0x11fc> - .byte 68,15,40,13,19,19,0,0 // movaps 0x1313(%rip),%xmm9 # 61e0 <_sk_callback_sse41+0x120c> + .byte 15,88,13,2,19,0,0 // addps 0x1302(%rip),%xmm1 # 61d0 <_sk_callback_sse41+0x11f3> + .byte 68,15,40,13,10,19,0,0 // movaps 0x130a(%rip),%xmm9 # 61e0 <_sk_callback_sse41+0x1203> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 69,15,40,193 // movaps %xmm9,%xmm8 .byte 69,15,89,192 // mulps %xmm8,%xmm8 - .byte 68,15,89,13,15,19,0,0 // mulps 0x130f(%rip),%xmm9 # 61f0 <_sk_callback_sse41+0x121c> - .byte 68,15,88,13,23,19,0,0 // addps 0x1317(%rip),%xmm9 # 6200 <_sk_callback_sse41+0x122c> + .byte 68,15,89,13,6,19,0,0 // mulps 0x1306(%rip),%xmm9 # 61f0 <_sk_callback_sse41+0x1213> + .byte 68,15,88,13,14,19,0,0 // addps 0x130e(%rip),%xmm9 # 6200 <_sk_callback_sse41+0x1223> .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -27062,16 +26913,16 @@ _sk_bicubic_n1y_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,5,19,0,0 // addps 0x1305(%rip),%xmm1 # 6210 <_sk_callback_sse41+0x123c> - .byte 68,15,40,13,13,19,0,0 // movaps 0x130d(%rip),%xmm9 # 6220 <_sk_callback_sse41+0x124c> + .byte 15,88,13,252,18,0,0 // addps 0x12fc(%rip),%xmm1 # 6210 <_sk_callback_sse41+0x1233> + .byte 68,15,40,13,4,19,0,0 // movaps 0x1304(%rip),%xmm9 # 6220 <_sk_callback_sse41+0x1243> .byte 69,15,92,200 // subps %xmm8,%xmm9 - .byte 68,15,40,5,17,19,0,0 // movaps 0x1311(%rip),%xmm8 # 6230 <_sk_callback_sse41+0x125c> + .byte 68,15,40,5,8,19,0,0 // movaps 0x1308(%rip),%xmm8 # 6230 <_sk_callback_sse41+0x1253> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,21,19,0,0 // addps 0x1315(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x126c> + .byte 68,15,88,5,12,19,0,0 // addps 0x130c(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x1263> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,25,19,0,0 // addps 0x1319(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x127c> + .byte 68,15,88,5,16,19,0,0 // addps 0x1310(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x1273> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,29,19,0,0 // addps 0x131d(%rip),%xmm8 # 6260 <_sk_callback_sse41+0x128c> + .byte 68,15,88,5,20,19,0,0 // addps 0x1314(%rip),%xmm8 # 6260 <_sk_callback_sse41+0x1283> .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -27081,17 +26932,17 @@ HIDDEN _sk_bicubic_p1y_sse41 FUNCTION(_sk_bicubic_p1y_sse41) _sk_bicubic_p1y_sse41: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,23,19,0,0 // movaps 0x1317(%rip),%xmm8 # 6270 <_sk_callback_sse41+0x129c> + .byte 68,15,40,5,14,19,0,0 // movaps 0x130e(%rip),%xmm8 # 6270 <_sk_callback_sse41+0x1293> .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9 .byte 65,15,88,200 // addps %xmm8,%xmm1 - .byte 68,15,40,21,18,19,0,0 // movaps 0x1312(%rip),%xmm10 # 6280 <_sk_callback_sse41+0x12ac> + .byte 68,15,40,21,9,19,0,0 // movaps 0x1309(%rip),%xmm10 # 6280 <_sk_callback_sse41+0x12a3> .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,22,19,0,0 // addps 0x1316(%rip),%xmm10 # 6290 <_sk_callback_sse41+0x12bc> + .byte 68,15,88,21,13,19,0,0 // addps 0x130d(%rip),%xmm10 # 6290 <_sk_callback_sse41+0x12b3> .byte 69,15,89,209 // mulps %xmm9,%xmm10 .byte 69,15,88,208 // addps %xmm8,%xmm10 .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,18,19,0,0 // addps 0x1312(%rip),%xmm10 # 62a0 <_sk_callback_sse41+0x12cc> + .byte 68,15,88,21,9,19,0,0 // addps 0x1309(%rip),%xmm10 # 62a0 <_sk_callback_sse41+0x12c3> .byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -27103,11 +26954,11 @@ _sk_bicubic_p3y_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,4,19,0,0 // addps 0x1304(%rip),%xmm1 # 62b0 <_sk_callback_sse41+0x12dc> + .byte 15,88,13,251,18,0,0 // addps 0x12fb(%rip),%xmm1 # 62b0 <_sk_callback_sse41+0x12d3> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 69,15,89,201 // mulps %xmm9,%xmm9 - .byte 68,15,89,5,4,19,0,0 // mulps 0x1304(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x12ec> - .byte 68,15,88,5,12,19,0,0 // addps 0x130c(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x12fc> + .byte 68,15,89,5,251,18,0,0 // mulps 0x12fb(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x12e3> + .byte 68,15,88,5,3,19,0,0 // addps 0x1303(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x12f3> .byte 69,15,89,193 // mulps %xmm9,%xmm8 .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -27118,22 +26969,23 @@ HIDDEN _sk_callback_sse41 FUNCTION(_sk_callback_sse41) _sk_callback_sse41: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 72,131,236,72 // sub $0x48,%rsp - .byte 15,41,124,36,48 // movaps %xmm7,0x30(%rsp) - .byte 15,41,116,36,32 // movaps %xmm6,0x20(%rsp) - .byte 15,41,108,36,16 // movaps %xmm5,0x10(%rsp) - .byte 15,41,36,36 // movaps %xmm4,(%rsp) + .byte 15,41,125,144 // movaps %xmm7,-0x70(%rbp) + .byte 15,41,117,160 // movaps %xmm6,-0x60(%rbp) + .byte 15,41,109,176 // movaps %xmm5,-0x50(%rbp) + .byte 15,41,101,192 // movaps %xmm4,-0x40(%rbp) .byte 76,137,195 // mov %r8,%rbx - .byte 73,137,206 // mov %rcx,%r14 + .byte 72,137,77,208 // mov %rcx,-0x30(%rbp) .byte 73,137,215 // mov %rdx,%r15 .byte 73,137,252 // mov %rdi,%r12 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 72,137,197 // mov %rax,%rbp + .byte 73,137,198 // mov %rax,%r14 .byte 73,137,245 // mov %rsi,%r13 .byte 15,40,224 // movaps %xmm0,%xmm4 .byte 15,20,225 // unpcklps %xmm1,%xmm4 @@ -27146,17 +26998,17 @@ _sk_callback_sse41: .byte 15,18,236 // movhlps %xmm4,%xmm5 .byte 15,40,216 // movaps %xmm0,%xmm3 .byte 102,15,20,218 // unpcklpd %xmm2,%xmm3 - .byte 102,15,17,77,8 // movupd %xmm1,0x8(%rbp) + .byte 102,65,15,17,78,8 // movupd %xmm1,0x8(%r14) .byte 15,18,208 // movhlps %xmm0,%xmm2 - .byte 15,17,109,24 // movups %xmm5,0x18(%rbp) - .byte 102,15,17,93,40 // movupd %xmm3,0x28(%rbp) - .byte 15,17,85,56 // movups %xmm2,0x38(%rbp) + .byte 65,15,17,110,24 // movups %xmm5,0x18(%r14) + .byte 102,65,15,17,94,40 // movupd %xmm3,0x28(%r14) + .byte 65,15,17,86,56 // movups %xmm2,0x38(%r14) .byte 72,133,219 // test %rbx,%rbx .byte 190,4,0,0,0 // mov $0x4,%esi .byte 15,69,243 // cmovne %ebx,%esi - .byte 72,137,239 // mov %rbp,%rdi - .byte 255,85,0 // callq *0x0(%rbp) - .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax + .byte 76,137,247 // mov %r14,%rdi + .byte 65,255,22 // callq *(%r14) + .byte 73,139,134,136,0,0,0 // mov 0x88(%r14),%rax .byte 15,16,32 // movups (%rax),%xmm4 .byte 15,16,64,16 // movups 0x10(%rax),%xmm0 .byte 15,16,88,32 // movups 0x20(%rax),%xmm3 @@ -27177,12 +27029,12 @@ _sk_callback_sse41: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,231 // mov %r12,%rdi .byte 76,137,250 // mov %r15,%rdx - .byte 76,137,241 // mov %r14,%rcx + .byte 72,139,77,208 // mov -0x30(%rbp),%rcx .byte 73,137,216 // mov %rbx,%r8 - .byte 15,40,36,36 // movaps (%rsp),%xmm4 - .byte 15,40,108,36,16 // movaps 0x10(%rsp),%xmm5 - .byte 15,40,116,36,32 // movaps 0x20(%rsp),%xmm6 - .byte 15,40,124,36,48 // movaps 0x30(%rsp),%xmm7 + .byte 15,40,101,192 // movaps -0x40(%rbp),%xmm4 + .byte 15,40,109,176 // movaps -0x50(%rbp),%xmm5 + .byte 15,40,117,160 // movaps -0x60(%rbp),%xmm6 + .byte 15,40,125,144 // movaps -0x70(%rbp),%xmm7 .byte 72,131,196,72 // add $0x48,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -27476,10 +27328,10 @@ BALIGN16 .byte 0,1 // add %al,(%rcx) .byte 255 // (bad) .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005388 <_sk_callback_sse41+0xa0003b4> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005388 <_sk_callback_sse41+0xa0003ab> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005390 <_sk_callback_sse41+0x30003bc> + .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005390 <_sk_callback_sse41+0x30003b3> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -27777,10 +27629,10 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 1,255 // add %edi,%edi .byte 255 // (bad) - .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005628 <_sk_callback_sse41+0xa000654> + .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005628 <_sk_callback_sse41+0xa00064b> .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005630 <_sk_callback_sse41+0x300065c> + .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005630 <_sk_callback_sse41+0x3000653> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -27895,7 +27747,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a3972a <_sk_callback_sse41+0xffffffffe9a34756> + .byte 233,220,63,163,233 // jmpq ffffffffe9a3972a <_sk_callback_sse41+0xffffffffe9a3474d> .byte 220,63 // fdivrl (%rdi) .byte 81 // push %rcx .byte 140,242 // mov %?,%edx @@ -27991,7 +27843,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a397fa <_sk_callback_sse41+0xffffffffe9a34826> + .byte 233,220,63,163,233 // jmpq ffffffffe9a397fa <_sk_callback_sse41+0xffffffffe9a3481d> .byte 220,63 // fdivrl (%rdi) .byte 81 // push %rcx .byte 140,242 // mov %?,%edx @@ -28087,7 +27939,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a398ca <_sk_callback_sse41+0xffffffffe9a348f6> + .byte 233,220,63,163,233 // jmpq ffffffffe9a398ca <_sk_callback_sse41+0xffffffffe9a348ed> .byte 220,63 // fdivrl (%rdi) .byte 81 // push %rcx .byte 140,242 // mov %?,%edx @@ -28183,7 +28035,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a3999a <_sk_callback_sse41+0xffffffffe9a349c6> + .byte 233,220,63,163,233 // jmpq ffffffffe9a3999a <_sk_callback_sse41+0xffffffffe9a349bd> .byte 220,63 // fdivrl (%rdi) .byte 81 // push %rcx .byte 140,242 // mov %?,%edx @@ -28357,7 +28209,7 @@ BALIGN16 .byte 5,255,255,255,9 // add $0x9ffffff,%eax .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005ba0 <_sk_callback_sse41+0x3000bcc> + .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005ba0 <_sk_callback_sse41+0x3000bc3> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -28599,7 +28451,7 @@ BALIGN16 .byte 5,255,255,255,9 // add $0x9ffffff,%eax .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005df0 <_sk_callback_sse41+0x3000e1c> + .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005df0 <_sk_callback_sse41+0x3000e13> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -28626,7 +28478,7 @@ BALIGN16 .byte 5,255,255,255,9 // add $0x9ffffff,%eax .byte 255 // (bad) .byte 255 // (bad) - .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005e30 <_sk_callback_sse41+0x3000e5c> + .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005e30 <_sk_callback_sse41+0x3000e53> .byte 255 // (bad) .byte 255 // (bad) .byte 255,6 // incl (%rsi) @@ -28773,7 +28625,7 @@ BALIGN16 .byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax .byte 152 // cwtl .byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx) - .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0709a <_sk_callback_sse41+0x2dc020c6> + .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0709a <_sk_callback_sse41+0x2dc020bd> .byte 17,192 // adc %eax,%eax .byte 45,16,17,192,18 // sub $0x12c01110,%eax .byte 120,57 // js 5fcc <.literal16+0xefc> @@ -28946,7 +28798,7 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ef95 <_sk_callback_sse41+0x3d639fc1> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ef95 <_sk_callback_sse41+0x3d639fb8> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -28972,7 +28824,7 @@ BALIGN16 .byte 0,192 // add %al,%al .byte 63 // (bad) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63efd5 <_sk_callback_sse41+0x3d63a001> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63efd5 <_sk_callback_sse41+0x3d639ff8> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al @@ -29056,7 +28908,7 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0a5 <_sk_callback_sse41+0x3d63a0d1> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0a5 <_sk_callback_sse41+0x3d63a0c8> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -29082,7 +28934,7 @@ BALIGN16 .byte 0,192 // add %al,%al .byte 63 // (bad) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0e5 <_sk_callback_sse41+0x3d63a111> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f0e5 <_sk_callback_sse41+0x3d63a108> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al @@ -29093,11 +28945,11 @@ BALIGN16 .byte 63 // (bad) .byte 114,28 // jb 62de <.literal16+0x120e> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 62e2 <_sk_callback_sse41+0x130e> + .byte 62,114,28 // jb,pt 62e2 <_sk_callback_sse41+0x1305> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 62e6 <_sk_callback_sse41+0x1312> + .byte 62,114,28 // jb,pt 62e6 <_sk_callback_sse41+0x1309> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 62ea <_sk_callback_sse41+0x1316> + .byte 62,114,28 // jb,pt 62ea <_sk_callback_sse41+0x130d> .byte 199 // (bad) .byte 62,171 // ds stos %eax,%es:(%rdi) .byte 170 // stos %al,%es:(%rdi) @@ -29114,24 +28966,26 @@ HIDDEN _sk_start_pipeline_sse2 FUNCTION(_sk_start_pipeline_sse2) _sk_start_pipeline_sse2: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 80 // push %rax - .byte 77,137,198 // mov %r8,%r14 - .byte 73,137,213 // mov %rdx,%r13 - .byte 73,137,247 // mov %rsi,%r15 + .byte 77,137,199 // mov %r8,%r15 + .byte 73,137,208 // mov %rdx,%r8 + .byte 73,137,244 // mov %rsi,%r12 .byte 72,137,251 // mov %rdi,%rbx .byte 72,137,206 // mov %rcx,%rsi .byte 72,173 // lods %ds:(%rsi),%rax - .byte 73,137,244 // mov %rsi,%r12 + .byte 73,137,245 // mov %rsi,%r13 .byte 72,141,75,4 // lea 0x4(%rbx),%rcx - .byte 76,57,233 // cmp %r13,%rcx - .byte 118,5 // jbe 2d <_sk_start_pipeline_sse2+0x2d> + .byte 76,57,193 // cmp %r8,%rcx + .byte 118,5 // jbe 30 <_sk_start_pipeline_sse2+0x30> .byte 72,137,218 // mov %rbx,%rdx - .byte 235,66 // jmp 6f <_sk_start_pipeline_sse2+0x6f> + .byte 235,75 // jmp 7b <_sk_start_pipeline_sse2+0x7b> + .byte 76,137,69,208 // mov %r8,-0x30(%rbp) .byte 65,184,0,0,0,0 // mov $0x0,%r8d .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 @@ -29141,20 +28995,21 @@ _sk_start_pipeline_sse2: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,230 // mov %r12,%rsi + .byte 76,137,255 // mov %r15,%rdi + .byte 76,137,238 // mov %r13,%rsi .byte 72,137,218 // mov %rbx,%rdx - .byte 76,137,249 // mov %r15,%rcx - .byte 72,137,197 // mov %rax,%rbp - .byte 255,213 // callq *%rbp - .byte 72,137,232 // mov %rbp,%rax + .byte 76,137,225 // mov %r12,%rcx + .byte 73,137,198 // mov %rax,%r14 + .byte 65,255,214 // callq *%r14 + .byte 76,139,69,208 // mov -0x30(%rbp),%r8 + .byte 76,137,240 // mov %r14,%rax .byte 72,141,83,4 // lea 0x4(%rbx),%rdx .byte 72,131,195,8 // add $0x8,%rbx - .byte 76,57,235 // cmp %r13,%rbx + .byte 76,57,195 // cmp %r8,%rbx .byte 72,137,211 // mov %rdx,%rbx - .byte 118,190 // jbe 2d <_sk_start_pipeline_sse2+0x2d> - .byte 73,41,213 // sub %rdx,%r13 - .byte 116,52 // je a8 <_sk_start_pipeline_sse2+0xa8> + .byte 118,185 // jbe 34 <_sk_start_pipeline_sse2+0x34> + .byte 73,41,208 // sub %rdx,%r8 + .byte 116,49 // je b1 <_sk_start_pipeline_sse2+0xb1> .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 .byte 15,87,210 // xorps %xmm2,%xmm2 @@ -29163,10 +29018,9 @@ _sk_start_pipeline_sse2: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,230 // mov %r12,%rsi - .byte 76,137,249 // mov %r15,%rcx - .byte 77,137,232 // mov %r13,%r8 + .byte 76,137,255 // mov %r15,%rdi + .byte 76,137,238 // mov %r13,%rsi + .byte 76,137,225 // mov %r12,%rcx .byte 72,131,196,8 // add $0x8,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -29197,7 +29051,7 @@ _sk_seed_shader_sse2: .byte 102,15,110,194 // movd %edx,%xmm0 .byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0 .byte 15,91,200 // cvtdq2ps %xmm0,%xmm1 - .byte 15,40,21,85,85,0,0 // movaps 0x5555(%rip),%xmm2 # 5620 <_sk_callback_sse2+0xf5> + .byte 15,40,21,92,85,0,0 // movaps 0x555c(%rip),%xmm2 # 5630 <_sk_callback_sse2+0xfc> .byte 15,88,202 // addps %xmm2,%xmm1 .byte 15,16,7 // movups (%rdi),%xmm0 .byte 15,88,193 // addps %xmm1,%xmm0 @@ -29206,7 +29060,7 @@ _sk_seed_shader_sse2: .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 15,88,202 // addps %xmm2,%xmm1 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,21,68,85,0,0 // movaps 0x5544(%rip),%xmm2 # 5630 <_sk_callback_sse2+0x105> + .byte 15,40,21,75,85,0,0 // movaps 0x554b(%rip),%xmm2 # 5640 <_sk_callback_sse2+0x10c> .byte 15,87,219 // xorps %xmm3,%xmm3 .byte 15,87,228 // xorps %xmm4,%xmm4 .byte 15,87,237 // xorps %xmm5,%xmm5 @@ -29226,14 +29080,14 @@ _sk_dither_sse2: .byte 102,68,15,110,193 // movd %ecx,%xmm8 .byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8 .byte 102,69,15,239,193 // pxor %xmm9,%xmm8 - .byte 102,68,15,111,21,18,85,0,0 // movdqa 0x5512(%rip),%xmm10 # 5640 <_sk_callback_sse2+0x115> + .byte 102,68,15,111,21,25,85,0,0 // movdqa 0x5519(%rip),%xmm10 # 5650 <_sk_callback_sse2+0x11c> .byte 102,69,15,111,216 // movdqa %xmm8,%xmm11 .byte 102,69,15,219,218 // pand %xmm10,%xmm11 .byte 102,65,15,114,243,5 // pslld $0x5,%xmm11 .byte 102,69,15,219,209 // pand %xmm9,%xmm10 .byte 102,65,15,114,242,4 // pslld $0x4,%xmm10 - .byte 102,68,15,111,37,254,84,0,0 // movdqa 0x54fe(%rip),%xmm12 # 5650 <_sk_callback_sse2+0x125> - .byte 102,68,15,111,45,5,85,0,0 // movdqa 0x5505(%rip),%xmm13 # 5660 <_sk_callback_sse2+0x135> + .byte 102,68,15,111,37,5,85,0,0 // movdqa 0x5505(%rip),%xmm12 # 5660 <_sk_callback_sse2+0x12c> + .byte 102,68,15,111,45,12,85,0,0 // movdqa 0x550c(%rip),%xmm13 # 5670 <_sk_callback_sse2+0x13c> .byte 102,69,15,111,240 // movdqa %xmm8,%xmm14 .byte 102,69,15,219,245 // pand %xmm13,%xmm14 .byte 102,65,15,114,246,2 // pslld $0x2,%xmm14 @@ -29249,8 +29103,8 @@ _sk_dither_sse2: .byte 102,69,15,235,245 // por %xmm13,%xmm14 .byte 102,69,15,235,240 // por %xmm8,%xmm14 .byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8 - .byte 68,15,89,5,192,84,0,0 // mulps 0x54c0(%rip),%xmm8 # 5670 <_sk_callback_sse2+0x145> - .byte 68,15,88,5,200,84,0,0 // addps 0x54c8(%rip),%xmm8 # 5680 <_sk_callback_sse2+0x155> + .byte 68,15,89,5,199,84,0,0 // mulps 0x54c7(%rip),%xmm8 # 5680 <_sk_callback_sse2+0x14c> + .byte 68,15,88,5,207,84,0,0 // addps 0x54cf(%rip),%xmm8 # 5690 <_sk_callback_sse2+0x15c> .byte 243,68,15,16,16 // movss (%rax),%xmm10 .byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10 .byte 69,15,89,208 // mulps %xmm8,%xmm10 @@ -29327,7 +29181,7 @@ HIDDEN _sk_srcatop_sse2 FUNCTION(_sk_srcatop_sse2) _sk_srcatop_sse2: .byte 15,89,199 // mulps %xmm7,%xmm0 - .byte 68,15,40,5,34,84,0,0 // movaps 0x5422(%rip),%xmm8 # 5690 <_sk_callback_sse2+0x165> + .byte 68,15,40,5,41,84,0,0 // movaps 0x5429(%rip),%xmm8 # 56a0 <_sk_callback_sse2+0x16c> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -29352,7 +29206,7 @@ FUNCTION(_sk_dstatop_sse2) _sk_dstatop_sse2: .byte 68,15,40,195 // movaps %xmm3,%xmm8 .byte 68,15,89,196 // mulps %xmm4,%xmm8 - .byte 68,15,40,13,229,83,0,0 // movaps 0x53e5(%rip),%xmm9 # 56a0 <_sk_callback_sse2+0x175> + .byte 68,15,40,13,236,83,0,0 // movaps 0x53ec(%rip),%xmm9 # 56b0 <_sk_callback_sse2+0x17c> .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 65,15,89,193 // mulps %xmm9,%xmm0 .byte 65,15,88,192 // addps %xmm8,%xmm0 @@ -29399,7 +29253,7 @@ HIDDEN _sk_srcout_sse2 .globl _sk_srcout_sse2 FUNCTION(_sk_srcout_sse2) _sk_srcout_sse2: - .byte 68,15,40,5,137,83,0,0 // movaps 0x5389(%rip),%xmm8 # 56b0 <_sk_callback_sse2+0x185> + .byte 68,15,40,5,144,83,0,0 // movaps 0x5390(%rip),%xmm8 # 56c0 <_sk_callback_sse2+0x18c> .byte 68,15,92,199 // subps %xmm7,%xmm8 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 @@ -29412,7 +29266,7 @@ HIDDEN _sk_dstout_sse2 .globl _sk_dstout_sse2 FUNCTION(_sk_dstout_sse2) _sk_dstout_sse2: - .byte 68,15,40,5,121,83,0,0 // movaps 0x5379(%rip),%xmm8 # 56c0 <_sk_callback_sse2+0x195> + .byte 68,15,40,5,128,83,0,0 // movaps 0x5380(%rip),%xmm8 # 56d0 <_sk_callback_sse2+0x19c> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 15,89,196 // mulps %xmm4,%xmm0 @@ -29429,7 +29283,7 @@ HIDDEN _sk_srcover_sse2 .globl _sk_srcover_sse2 FUNCTION(_sk_srcover_sse2) _sk_srcover_sse2: - .byte 68,15,40,5,92,83,0,0 // movaps 0x535c(%rip),%xmm8 # 56d0 <_sk_callback_sse2+0x1a5> + .byte 68,15,40,5,99,83,0,0 // movaps 0x5363(%rip),%xmm8 # 56e0 <_sk_callback_sse2+0x1ac> .byte 68,15,92,195 // subps %xmm3,%xmm8 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -29449,7 +29303,7 @@ HIDDEN _sk_dstover_sse2 .globl _sk_dstover_sse2 FUNCTION(_sk_dstover_sse2) _sk_dstover_sse2: - .byte 68,15,40,5,48,83,0,0 // movaps 0x5330(%rip),%xmm8 # 56e0 <_sk_callback_sse2+0x1b5> + .byte 68,15,40,5,55,83,0,0 // movaps 0x5337(%rip),%xmm8 # 56f0 <_sk_callback_sse2+0x1bc> .byte 68,15,92,199 // subps %xmm7,%xmm8 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -29477,7 +29331,7 @@ HIDDEN _sk_multiply_sse2 .globl _sk_multiply_sse2 FUNCTION(_sk_multiply_sse2) _sk_multiply_sse2: - .byte 68,15,40,5,4,83,0,0 // movaps 0x5304(%rip),%xmm8 # 56f0 <_sk_callback_sse2+0x1c5> + .byte 68,15,40,5,11,83,0,0 // movaps 0x530b(%rip),%xmm8 # 5700 <_sk_callback_sse2+0x1cc> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 69,15,40,209 // movaps %xmm9,%xmm10 @@ -29552,7 +29406,7 @@ HIDDEN _sk_xor__sse2 FUNCTION(_sk_xor__sse2) _sk_xor__sse2: .byte 68,15,40,195 // movaps %xmm3,%xmm8 - .byte 15,40,29,57,82,0,0 // movaps 0x5239(%rip),%xmm3 # 5700 <_sk_callback_sse2+0x1d5> + .byte 15,40,29,64,82,0,0 // movaps 0x5240(%rip),%xmm3 # 5710 <_sk_callback_sse2+0x1dc> .byte 68,15,40,203 // movaps %xmm3,%xmm9 .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 65,15,89,193 // mulps %xmm9,%xmm0 @@ -29600,7 +29454,7 @@ _sk_darken_sse2: .byte 68,15,89,206 // mulps %xmm6,%xmm9 .byte 65,15,95,209 // maxps %xmm9,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,164,81,0,0 // movaps 0x51a4(%rip),%xmm2 # 5710 <_sk_callback_sse2+0x1e5> + .byte 15,40,21,171,81,0,0 // movaps 0x51ab(%rip),%xmm2 # 5720 <_sk_callback_sse2+0x1ec> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -29634,7 +29488,7 @@ _sk_lighten_sse2: .byte 68,15,89,206 // mulps %xmm6,%xmm9 .byte 65,15,93,209 // minps %xmm9,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,73,81,0,0 // movaps 0x5149(%rip),%xmm2 # 5720 <_sk_callback_sse2+0x1f5> + .byte 15,40,21,80,81,0,0 // movaps 0x5150(%rip),%xmm2 # 5730 <_sk_callback_sse2+0x1fc> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -29671,7 +29525,7 @@ _sk_difference_sse2: .byte 65,15,93,209 // minps %xmm9,%xmm2 .byte 15,88,210 // addps %xmm2,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,227,80,0,0 // movaps 0x50e3(%rip),%xmm2 # 5730 <_sk_callback_sse2+0x205> + .byte 15,40,21,234,80,0,0 // movaps 0x50ea(%rip),%xmm2 # 5740 <_sk_callback_sse2+0x20c> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -29699,7 +29553,7 @@ _sk_exclusion_sse2: .byte 15,89,214 // mulps %xmm6,%xmm2 .byte 15,88,210 // addps %xmm2,%xmm2 .byte 68,15,92,194 // subps %xmm2,%xmm8 - .byte 15,40,21,163,80,0,0 // movaps 0x50a3(%rip),%xmm2 # 5740 <_sk_callback_sse2+0x215> + .byte 15,40,21,170,80,0,0 // movaps 0x50aa(%rip),%xmm2 # 5750 <_sk_callback_sse2+0x21c> .byte 15,92,211 // subps %xmm3,%xmm2 .byte 15,89,215 // mulps %xmm7,%xmm2 .byte 15,88,218 // addps %xmm2,%xmm3 @@ -29712,7 +29566,7 @@ HIDDEN _sk_colorburn_sse2 FUNCTION(_sk_colorburn_sse2) _sk_colorburn_sse2: .byte 68,15,40,192 // movaps %xmm0,%xmm8 - .byte 68,15,40,21,150,80,0,0 // movaps 0x5096(%rip),%xmm10 # 5750 <_sk_callback_sse2+0x225> + .byte 68,15,40,21,157,80,0,0 // movaps 0x509d(%rip),%xmm10 # 5760 <_sk_callback_sse2+0x22c> .byte 69,15,40,202 // movaps %xmm10,%xmm9 .byte 68,15,92,207 // subps %xmm7,%xmm9 .byte 69,15,40,217 // movaps %xmm9,%xmm11 @@ -29806,7 +29660,7 @@ HIDDEN _sk_colordodge_sse2 FUNCTION(_sk_colordodge_sse2) _sk_colordodge_sse2: .byte 68,15,40,200 // movaps %xmm0,%xmm9 - .byte 68,15,40,21,76,79,0,0 // movaps 0x4f4c(%rip),%xmm10 # 5760 <_sk_callback_sse2+0x235> + .byte 68,15,40,21,83,79,0,0 // movaps 0x4f53(%rip),%xmm10 # 5770 <_sk_callback_sse2+0x23c> .byte 69,15,40,218 // movaps %xmm10,%xmm11 .byte 68,15,92,223 // subps %xmm7,%xmm11 .byte 69,15,40,227 // movaps %xmm11,%xmm12 @@ -29900,7 +29754,7 @@ _sk_hardlight_sse2: .byte 15,41,116,36,232 // movaps %xmm6,-0x18(%rsp) .byte 15,40,245 // movaps %xmm5,%xmm6 .byte 15,40,236 // movaps %xmm4,%xmm5 - .byte 68,15,40,29,1,78,0,0 // movaps 0x4e01(%rip),%xmm11 # 5770 <_sk_callback_sse2+0x245> + .byte 68,15,40,29,8,78,0,0 // movaps 0x4e08(%rip),%xmm11 # 5780 <_sk_callback_sse2+0x24c> .byte 69,15,40,211 // movaps %xmm11,%xmm10 .byte 68,15,92,215 // subps %xmm7,%xmm10 .byte 69,15,40,194 // movaps %xmm10,%xmm8 @@ -29988,7 +29842,7 @@ FUNCTION(_sk_overlay_sse2) _sk_overlay_sse2: .byte 68,15,40,193 // movaps %xmm1,%xmm8 .byte 68,15,40,232 // movaps %xmm0,%xmm13 - .byte 68,15,40,13,207,76,0,0 // movaps 0x4ccf(%rip),%xmm9 # 5780 <_sk_callback_sse2+0x255> + .byte 68,15,40,13,214,76,0,0 // movaps 0x4cd6(%rip),%xmm9 # 5790 <_sk_callback_sse2+0x25c> .byte 69,15,40,209 // movaps %xmm9,%xmm10 .byte 68,15,92,215 // subps %xmm7,%xmm10 .byte 69,15,40,218 // movaps %xmm10,%xmm11 @@ -30079,7 +29933,7 @@ _sk_softlight_sse2: .byte 68,15,40,213 // movaps %xmm5,%xmm10 .byte 68,15,94,215 // divps %xmm7,%xmm10 .byte 69,15,84,212 // andps %xmm12,%xmm10 - .byte 68,15,40,13,140,75,0,0 // movaps 0x4b8c(%rip),%xmm9 # 5790 <_sk_callback_sse2+0x265> + .byte 68,15,40,13,147,75,0,0 // movaps 0x4b93(%rip),%xmm9 # 57a0 <_sk_callback_sse2+0x26c> .byte 69,15,40,249 // movaps %xmm9,%xmm15 .byte 69,15,92,250 // subps %xmm10,%xmm15 .byte 69,15,40,218 // movaps %xmm10,%xmm11 @@ -30092,10 +29946,10 @@ _sk_softlight_sse2: .byte 65,15,40,194 // movaps %xmm10,%xmm0 .byte 15,89,192 // mulps %xmm0,%xmm0 .byte 65,15,88,194 // addps %xmm10,%xmm0 - .byte 68,15,40,53,102,75,0,0 // movaps 0x4b66(%rip),%xmm14 # 57a0 <_sk_callback_sse2+0x275> + .byte 68,15,40,53,109,75,0,0 // movaps 0x4b6d(%rip),%xmm14 # 57b0 <_sk_callback_sse2+0x27c> .byte 69,15,88,222 // addps %xmm14,%xmm11 .byte 68,15,89,216 // mulps %xmm0,%xmm11 - .byte 68,15,40,21,102,75,0,0 // movaps 0x4b66(%rip),%xmm10 # 57b0 <_sk_callback_sse2+0x285> + .byte 68,15,40,21,109,75,0,0 // movaps 0x4b6d(%rip),%xmm10 # 57c0 <_sk_callback_sse2+0x28c> .byte 69,15,89,234 // mulps %xmm10,%xmm13 .byte 69,15,88,235 // addps %xmm11,%xmm13 .byte 15,88,228 // addps %xmm4,%xmm4 @@ -30240,7 +30094,7 @@ _sk_hue_sse2: .byte 68,15,40,209 // movaps %xmm1,%xmm10 .byte 68,15,40,225 // movaps %xmm1,%xmm12 .byte 68,15,89,211 // mulps %xmm3,%xmm10 - .byte 68,15,40,5,169,73,0,0 // movaps 0x49a9(%rip),%xmm8 # 57f0 <_sk_callback_sse2+0x2c5> + .byte 68,15,40,5,176,73,0,0 // movaps 0x49b0(%rip),%xmm8 # 5800 <_sk_callback_sse2+0x2cc> .byte 69,15,40,216 // movaps %xmm8,%xmm11 .byte 15,40,207 // movaps %xmm7,%xmm1 .byte 68,15,92,217 // subps %xmm1,%xmm11 @@ -30288,12 +30142,12 @@ _sk_hue_sse2: .byte 69,15,84,206 // andps %xmm14,%xmm9 .byte 69,15,84,214 // andps %xmm14,%xmm10 .byte 65,15,84,214 // andps %xmm14,%xmm2 - .byte 68,15,40,61,182,72,0,0 // movaps 0x48b6(%rip),%xmm15 # 57c0 <_sk_callback_sse2+0x295> + .byte 68,15,40,61,189,72,0,0 // movaps 0x48bd(%rip),%xmm15 # 57d0 <_sk_callback_sse2+0x29c> .byte 65,15,89,231 // mulps %xmm15,%xmm4 - .byte 15,40,5,187,72,0,0 // movaps 0x48bb(%rip),%xmm0 # 57d0 <_sk_callback_sse2+0x2a5> + .byte 15,40,5,194,72,0,0 // movaps 0x48c2(%rip),%xmm0 # 57e0 <_sk_callback_sse2+0x2ac> .byte 15,89,240 // mulps %xmm0,%xmm6 .byte 15,88,244 // addps %xmm4,%xmm6 - .byte 68,15,40,53,189,72,0,0 // movaps 0x48bd(%rip),%xmm14 # 57e0 <_sk_callback_sse2+0x2b5> + .byte 68,15,40,53,196,72,0,0 // movaps 0x48c4(%rip),%xmm14 # 57f0 <_sk_callback_sse2+0x2bc> .byte 68,15,40,239 // movaps %xmm7,%xmm13 .byte 69,15,89,238 // mulps %xmm14,%xmm13 .byte 68,15,88,238 // addps %xmm6,%xmm13 @@ -30471,14 +30325,14 @@ _sk_saturation_sse2: .byte 68,15,84,211 // andps %xmm3,%xmm10 .byte 68,15,84,203 // andps %xmm3,%xmm9 .byte 15,84,195 // andps %xmm3,%xmm0 - .byte 68,15,40,5,79,70,0,0 // movaps 0x464f(%rip),%xmm8 # 5800 <_sk_callback_sse2+0x2d5> + .byte 68,15,40,5,86,70,0,0 // movaps 0x4656(%rip),%xmm8 # 5810 <_sk_callback_sse2+0x2dc> .byte 15,40,214 // movaps %xmm6,%xmm2 .byte 65,15,89,208 // mulps %xmm8,%xmm2 - .byte 15,40,13,81,70,0,0 // movaps 0x4651(%rip),%xmm1 # 5810 <_sk_callback_sse2+0x2e5> + .byte 15,40,13,88,70,0,0 // movaps 0x4658(%rip),%xmm1 # 5820 <_sk_callback_sse2+0x2ec> .byte 15,40,221 // movaps %xmm5,%xmm3 .byte 15,89,217 // mulps %xmm1,%xmm3 .byte 15,88,218 // addps %xmm2,%xmm3 - .byte 68,15,40,37,80,70,0,0 // movaps 0x4650(%rip),%xmm12 # 5820 <_sk_callback_sse2+0x2f5> + .byte 68,15,40,37,87,70,0,0 // movaps 0x4657(%rip),%xmm12 # 5830 <_sk_callback_sse2+0x2fc> .byte 69,15,89,236 // mulps %xmm12,%xmm13 .byte 68,15,88,235 // addps %xmm3,%xmm13 .byte 65,15,40,210 // movaps %xmm10,%xmm2 @@ -30523,7 +30377,7 @@ _sk_saturation_sse2: .byte 15,40,223 // movaps %xmm7,%xmm3 .byte 15,40,236 // movaps %xmm4,%xmm5 .byte 15,89,221 // mulps %xmm5,%xmm3 - .byte 68,15,40,5,181,69,0,0 // movaps 0x45b5(%rip),%xmm8 # 5830 <_sk_callback_sse2+0x305> + .byte 68,15,40,5,188,69,0,0 // movaps 0x45bc(%rip),%xmm8 # 5840 <_sk_callback_sse2+0x30c> .byte 65,15,40,224 // movaps %xmm8,%xmm4 .byte 68,15,92,199 // subps %xmm7,%xmm8 .byte 15,88,253 // addps %xmm5,%xmm7 @@ -30624,14 +30478,14 @@ _sk_color_sse2: .byte 68,15,40,213 // movaps %xmm5,%xmm10 .byte 69,15,89,208 // mulps %xmm8,%xmm10 .byte 65,15,40,208 // movaps %xmm8,%xmm2 - .byte 68,15,40,45,83,68,0,0 // movaps 0x4453(%rip),%xmm13 # 5840 <_sk_callback_sse2+0x315> + .byte 68,15,40,45,90,68,0,0 // movaps 0x445a(%rip),%xmm13 # 5850 <_sk_callback_sse2+0x31c> .byte 68,15,40,198 // movaps %xmm6,%xmm8 .byte 69,15,89,197 // mulps %xmm13,%xmm8 - .byte 68,15,40,53,83,68,0,0 // movaps 0x4453(%rip),%xmm14 # 5850 <_sk_callback_sse2+0x325> + .byte 68,15,40,53,90,68,0,0 // movaps 0x445a(%rip),%xmm14 # 5860 <_sk_callback_sse2+0x32c> .byte 65,15,40,195 // movaps %xmm11,%xmm0 .byte 65,15,89,198 // mulps %xmm14,%xmm0 .byte 65,15,88,192 // addps %xmm8,%xmm0 - .byte 68,15,40,29,79,68,0,0 // movaps 0x444f(%rip),%xmm11 # 5860 <_sk_callback_sse2+0x335> + .byte 68,15,40,29,86,68,0,0 // movaps 0x4456(%rip),%xmm11 # 5870 <_sk_callback_sse2+0x33c> .byte 69,15,89,227 // mulps %xmm11,%xmm12 .byte 68,15,88,224 // addps %xmm0,%xmm12 .byte 65,15,40,193 // movaps %xmm9,%xmm0 @@ -30639,7 +30493,7 @@ _sk_color_sse2: .byte 69,15,40,250 // movaps %xmm10,%xmm15 .byte 69,15,89,254 // mulps %xmm14,%xmm15 .byte 68,15,88,248 // addps %xmm0,%xmm15 - .byte 68,15,40,5,59,68,0,0 // movaps 0x443b(%rip),%xmm8 # 5870 <_sk_callback_sse2+0x345> + .byte 68,15,40,5,66,68,0,0 // movaps 0x4442(%rip),%xmm8 # 5880 <_sk_callback_sse2+0x34c> .byte 65,15,40,224 // movaps %xmm8,%xmm4 .byte 15,92,226 // subps %xmm2,%xmm4 .byte 15,89,252 // mulps %xmm4,%xmm7 @@ -30775,15 +30629,15 @@ _sk_luminosity_sse2: .byte 68,15,40,205 // movaps %xmm5,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 .byte 15,89,222 // mulps %xmm6,%xmm3 - .byte 68,15,40,37,82,66,0,0 // movaps 0x4252(%rip),%xmm12 # 5880 <_sk_callback_sse2+0x355> + .byte 68,15,40,37,89,66,0,0 // movaps 0x4259(%rip),%xmm12 # 5890 <_sk_callback_sse2+0x35c> .byte 68,15,40,199 // movaps %xmm7,%xmm8 .byte 69,15,89,196 // mulps %xmm12,%xmm8 - .byte 68,15,40,45,82,66,0,0 // movaps 0x4252(%rip),%xmm13 # 5890 <_sk_callback_sse2+0x365> + .byte 68,15,40,45,89,66,0,0 // movaps 0x4259(%rip),%xmm13 # 58a0 <_sk_callback_sse2+0x36c> .byte 68,15,40,241 // movaps %xmm1,%xmm14 .byte 69,15,89,245 // mulps %xmm13,%xmm14 .byte 69,15,88,240 // addps %xmm8,%xmm14 - .byte 68,15,40,29,78,66,0,0 // movaps 0x424e(%rip),%xmm11 # 58a0 <_sk_callback_sse2+0x375> - .byte 68,15,40,5,86,66,0,0 // movaps 0x4256(%rip),%xmm8 # 58b0 <_sk_callback_sse2+0x385> + .byte 68,15,40,29,85,66,0,0 // movaps 0x4255(%rip),%xmm11 # 58b0 <_sk_callback_sse2+0x37c> + .byte 68,15,40,5,93,66,0,0 // movaps 0x425d(%rip),%xmm8 # 58c0 <_sk_callback_sse2+0x38c> .byte 69,15,40,248 // movaps %xmm8,%xmm15 .byte 65,15,40,194 // movaps %xmm10,%xmm0 .byte 68,15,92,248 // subps %xmm0,%xmm15 @@ -30919,10 +30773,10 @@ _sk_srcover_rgba_8888_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,227,0,0,0 // jne 1932 <_sk_srcover_rgba_8888_sse2+0xf1> + .byte 15,133,227,0,0,0 // jne 193b <_sk_srcover_rgba_8888_sse2+0xf1> .byte 243,68,15,111,4,144 // movdqu (%rax,%rdx,4),%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 102,15,111,53,96,64,0,0 // movdqa 0x4060(%rip),%xmm6 # 58c0 <_sk_callback_sse2+0x395> + .byte 102,15,111,53,103,64,0,0 // movdqa 0x4067(%rip),%xmm6 # 58d0 <_sk_callback_sse2+0x39c> .byte 102,65,15,111,224 // movdqa %xmm8,%xmm4 .byte 102,15,219,230 // pand %xmm6,%xmm4 .byte 15,91,228 // cvtdq2ps %xmm4,%xmm4 @@ -30936,9 +30790,9 @@ _sk_srcover_rgba_8888_sse2: .byte 15,91,247 // cvtdq2ps %xmm7,%xmm6 .byte 102,65,15,114,208,24 // psrld $0x18,%xmm8 .byte 65,15,91,248 // cvtdq2ps %xmm8,%xmm7 - .byte 68,15,40,5,48,64,0,0 // movaps 0x4030(%rip),%xmm8 # 58d0 <_sk_callback_sse2+0x3a5> + .byte 68,15,40,5,55,64,0,0 // movaps 0x4037(%rip),%xmm8 # 58e0 <_sk_callback_sse2+0x3ac> .byte 68,15,92,195 // subps %xmm3,%xmm8 - .byte 68,15,40,37,52,64,0,0 // movaps 0x4034(%rip),%xmm12 # 58e0 <_sk_callback_sse2+0x3b5> + .byte 68,15,40,37,59,64,0,0 // movaps 0x403b(%rip),%xmm12 # 58f0 <_sk_callback_sse2+0x3bc> .byte 65,15,89,196 // mulps %xmm12,%xmm0 .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 68,15,89,204 // mulps %xmm4,%xmm9 @@ -30964,7 +30818,7 @@ _sk_srcover_rgba_8888_sse2: .byte 102,15,114,240,24 // pslld $0x18,%xmm0 .byte 102,15,235,194 // por %xmm2,%xmm0 .byte 102,15,235,193 // por %xmm1,%xmm0 - .byte 117,106 // jne 1983 <_sk_srcover_rgba_8888_sse2+0x142> + .byte 117,106 // jne 198c <_sk_srcover_rgba_8888_sse2+0x142> .byte 243,15,127,4,144 // movdqu %xmm0,(%rax,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,193 // movaps %xmm9,%xmm0 @@ -30976,11 +30830,11 @@ _sk_srcover_rgba_8888_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,48 // je 1974 <_sk_srcover_rgba_8888_sse2+0x133> + .byte 116,48 // je 197d <_sk_srcover_rgba_8888_sse2+0x133> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,22 // je 1960 <_sk_srcover_rgba_8888_sse2+0x11f> + .byte 116,22 // je 1969 <_sk_srcover_rgba_8888_sse2+0x11f> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 15,133,1,255,255,255 // jne 1855 <_sk_srcover_rgba_8888_sse2+0x14> + .byte 15,133,1,255,255,255 // jne 185e <_sk_srcover_rgba_8888_sse2+0x14> .byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4 .byte 102,68,15,112,196,69 // pshufd $0x45,%xmm4,%xmm8 .byte 243,15,16,100,144,4 // movss 0x4(%rax,%rdx,4),%xmm4 @@ -30989,21 +30843,21 @@ _sk_srcover_rgba_8888_sse2: .byte 68,15,40,196 // movaps %xmm4,%xmm8 .byte 243,15,16,36,144 // movss (%rax,%rdx,4),%xmm4 .byte 243,68,15,16,196 // movss %xmm4,%xmm8 - .byte 233,210,254,255,255 // jmpq 1855 <_sk_srcover_rgba_8888_sse2+0x14> + .byte 233,210,254,255,255 // jmpq 185e <_sk_srcover_rgba_8888_sse2+0x14> .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,34 // je 19b2 <_sk_srcover_rgba_8888_sse2+0x171> + .byte 116,34 // je 19bb <_sk_srcover_rgba_8888_sse2+0x171> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,17 // je 19a7 <_sk_srcover_rgba_8888_sse2+0x166> + .byte 116,17 // je 19b0 <_sk_srcover_rgba_8888_sse2+0x166> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,130 // jne 191e <_sk_srcover_rgba_8888_sse2+0xdd> + .byte 117,130 // jne 1927 <_sk_srcover_rgba_8888_sse2+0xdd> .byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1 .byte 102,15,126,76,144,8 // movd %xmm1,0x8(%rax,%rdx,4) .byte 102,15,112,200,229 // pshufd $0xe5,%xmm0,%xmm1 .byte 102,15,126,76,144,4 // movd %xmm1,0x4(%rax,%rdx,4) .byte 102,15,126,4,144 // movd %xmm0,(%rax,%rdx,4) - .byte 233,98,255,255,255 // jmpq 191e <_sk_srcover_rgba_8888_sse2+0xdd> + .byte 233,98,255,255,255 // jmpq 1927 <_sk_srcover_rgba_8888_sse2+0xdd> HIDDEN _sk_clamp_0_sse2 .globl _sk_clamp_0_sse2 @@ -31021,7 +30875,7 @@ HIDDEN _sk_clamp_1_sse2 .globl _sk_clamp_1_sse2 FUNCTION(_sk_clamp_1_sse2) _sk_clamp_1_sse2: - .byte 68,15,40,5,20,63,0,0 // movaps 0x3f14(%rip),%xmm8 # 58f0 <_sk_callback_sse2+0x3c5> + .byte 68,15,40,5,27,63,0,0 // movaps 0x3f1b(%rip),%xmm8 # 5900 <_sk_callback_sse2+0x3cc> .byte 65,15,93,192 // minps %xmm8,%xmm0 .byte 65,15,93,200 // minps %xmm8,%xmm1 .byte 65,15,93,208 // minps %xmm8,%xmm2 @@ -31033,7 +30887,7 @@ HIDDEN _sk_clamp_a_sse2 .globl _sk_clamp_a_sse2 FUNCTION(_sk_clamp_a_sse2) _sk_clamp_a_sse2: - .byte 15,93,29,9,63,0,0 // minps 0x3f09(%rip),%xmm3 # 5900 <_sk_callback_sse2+0x3d5> + .byte 15,93,29,16,63,0,0 // minps 0x3f10(%rip),%xmm3 # 5910 <_sk_callback_sse2+0x3dc> .byte 15,93,195 // minps %xmm3,%xmm0 .byte 15,93,203 // minps %xmm3,%xmm1 .byte 15,93,211 // minps %xmm3,%xmm2 @@ -31120,7 +30974,7 @@ HIDDEN _sk_unpremul_sse2 FUNCTION(_sk_unpremul_sse2) _sk_unpremul_sse2: .byte 69,15,87,192 // xorps %xmm8,%xmm8 - .byte 68,15,40,13,116,62,0,0 // movaps 0x3e74(%rip),%xmm9 # 5910 <_sk_callback_sse2+0x3e5> + .byte 68,15,40,13,123,62,0,0 // movaps 0x3e7b(%rip),%xmm9 # 5920 <_sk_callback_sse2+0x3ec> .byte 68,15,94,203 // divps %xmm3,%xmm9 .byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8 .byte 69,15,84,193 // andps %xmm9,%xmm8 @@ -31134,20 +30988,20 @@ HIDDEN _sk_from_srgb_sse2 .globl _sk_from_srgb_sse2 FUNCTION(_sk_from_srgb_sse2) _sk_from_srgb_sse2: - .byte 68,15,40,5,95,62,0,0 // movaps 0x3e5f(%rip),%xmm8 # 5920 <_sk_callback_sse2+0x3f5> + .byte 68,15,40,5,102,62,0,0 // movaps 0x3e66(%rip),%xmm8 # 5930 <_sk_callback_sse2+0x3fc> .byte 68,15,40,232 // movaps %xmm0,%xmm13 .byte 69,15,89,232 // mulps %xmm8,%xmm13 .byte 68,15,40,216 // movaps %xmm0,%xmm11 .byte 69,15,89,219 // mulps %xmm11,%xmm11 - .byte 68,15,40,13,87,62,0,0 // movaps 0x3e57(%rip),%xmm9 # 5930 <_sk_callback_sse2+0x405> + .byte 68,15,40,13,94,62,0,0 // movaps 0x3e5e(%rip),%xmm9 # 5940 <_sk_callback_sse2+0x40c> .byte 68,15,40,240 // movaps %xmm0,%xmm14 .byte 69,15,89,241 // mulps %xmm9,%xmm14 - .byte 68,15,40,21,87,62,0,0 // movaps 0x3e57(%rip),%xmm10 # 5940 <_sk_callback_sse2+0x415> + .byte 68,15,40,21,94,62,0,0 // movaps 0x3e5e(%rip),%xmm10 # 5950 <_sk_callback_sse2+0x41c> .byte 69,15,88,242 // addps %xmm10,%xmm14 .byte 69,15,89,243 // mulps %xmm11,%xmm14 - .byte 68,15,40,29,87,62,0,0 // movaps 0x3e57(%rip),%xmm11 # 5950 <_sk_callback_sse2+0x425> + .byte 68,15,40,29,94,62,0,0 // movaps 0x3e5e(%rip),%xmm11 # 5960 <_sk_callback_sse2+0x42c> .byte 69,15,88,243 // addps %xmm11,%xmm14 - .byte 68,15,40,37,91,62,0,0 // movaps 0x3e5b(%rip),%xmm12 # 5960 <_sk_callback_sse2+0x435> + .byte 68,15,40,37,98,62,0,0 // movaps 0x3e62(%rip),%xmm12 # 5970 <_sk_callback_sse2+0x43c> .byte 65,15,194,196,1 // cmpltps %xmm12,%xmm0 .byte 68,15,84,232 // andps %xmm0,%xmm13 .byte 65,15,85,198 // andnps %xmm14,%xmm0 @@ -31184,22 +31038,22 @@ HIDDEN _sk_to_srgb_sse2 FUNCTION(_sk_to_srgb_sse2) _sk_to_srgb_sse2: .byte 68,15,82,232 // rsqrtps %xmm0,%xmm13 - .byte 68,15,40,5,232,61,0,0 // movaps 0x3de8(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x445> + .byte 68,15,40,5,239,61,0,0 // movaps 0x3def(%rip),%xmm8 # 5980 <_sk_callback_sse2+0x44c> .byte 68,15,40,240 // movaps %xmm0,%xmm14 .byte 69,15,89,240 // mulps %xmm8,%xmm14 - .byte 68,15,40,13,232,61,0,0 // movaps 0x3de8(%rip),%xmm9 # 5980 <_sk_callback_sse2+0x455> + .byte 68,15,40,13,239,61,0,0 // movaps 0x3def(%rip),%xmm9 # 5990 <_sk_callback_sse2+0x45c> .byte 69,15,40,253 // movaps %xmm13,%xmm15 .byte 69,15,89,249 // mulps %xmm9,%xmm15 - .byte 68,15,40,21,232,61,0,0 // movaps 0x3de8(%rip),%xmm10 # 5990 <_sk_callback_sse2+0x465> + .byte 68,15,40,21,239,61,0,0 // movaps 0x3def(%rip),%xmm10 # 59a0 <_sk_callback_sse2+0x46c> .byte 69,15,88,250 // addps %xmm10,%xmm15 .byte 69,15,89,253 // mulps %xmm13,%xmm15 - .byte 68,15,40,29,232,61,0,0 // movaps 0x3de8(%rip),%xmm11 # 59a0 <_sk_callback_sse2+0x475> + .byte 68,15,40,29,239,61,0,0 // movaps 0x3def(%rip),%xmm11 # 59b0 <_sk_callback_sse2+0x47c> .byte 69,15,88,251 // addps %xmm11,%xmm15 - .byte 68,15,40,37,236,61,0,0 // movaps 0x3dec(%rip),%xmm12 # 59b0 <_sk_callback_sse2+0x485> + .byte 68,15,40,37,243,61,0,0 // movaps 0x3df3(%rip),%xmm12 # 59c0 <_sk_callback_sse2+0x48c> .byte 69,15,88,236 // addps %xmm12,%xmm13 .byte 69,15,83,237 // rcpps %xmm13,%xmm13 .byte 69,15,89,239 // mulps %xmm15,%xmm13 - .byte 68,15,40,61,232,61,0,0 // movaps 0x3de8(%rip),%xmm15 # 59c0 <_sk_callback_sse2+0x495> + .byte 68,15,40,61,239,61,0,0 // movaps 0x3def(%rip),%xmm15 # 59d0 <_sk_callback_sse2+0x49c> .byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0 .byte 68,15,84,240 // andps %xmm0,%xmm14 .byte 65,15,85,197 // andnps %xmm13,%xmm0 @@ -31249,7 +31103,7 @@ _sk_rgb_to_hsl_sse2: .byte 68,15,93,218 // minps %xmm2,%xmm11 .byte 65,15,40,202 // movaps %xmm10,%xmm1 .byte 65,15,92,203 // subps %xmm11,%xmm1 - .byte 68,15,40,45,65,61,0,0 // movaps 0x3d41(%rip),%xmm13 # 59d0 <_sk_callback_sse2+0x4a5> + .byte 68,15,40,45,72,61,0,0 // movaps 0x3d48(%rip),%xmm13 # 59e0 <_sk_callback_sse2+0x4ac> .byte 68,15,94,233 // divps %xmm1,%xmm13 .byte 65,15,40,194 // movaps %xmm10,%xmm0 .byte 65,15,194,192,0 // cmpeqps %xmm8,%xmm0 @@ -31258,30 +31112,30 @@ _sk_rgb_to_hsl_sse2: .byte 69,15,89,229 // mulps %xmm13,%xmm12 .byte 69,15,40,241 // movaps %xmm9,%xmm14 .byte 68,15,194,242,1 // cmpltps %xmm2,%xmm14 - .byte 68,15,84,53,39,61,0,0 // andps 0x3d27(%rip),%xmm14 # 59e0 <_sk_callback_sse2+0x4b5> + .byte 68,15,84,53,46,61,0,0 // andps 0x3d2e(%rip),%xmm14 # 59f0 <_sk_callback_sse2+0x4bc> .byte 69,15,88,244 // addps %xmm12,%xmm14 .byte 69,15,40,250 // movaps %xmm10,%xmm15 .byte 69,15,194,249,0 // cmpeqps %xmm9,%xmm15 .byte 65,15,92,208 // subps %xmm8,%xmm2 .byte 65,15,89,213 // mulps %xmm13,%xmm2 - .byte 68,15,40,37,26,61,0,0 // movaps 0x3d1a(%rip),%xmm12 # 59f0 <_sk_callback_sse2+0x4c5> + .byte 68,15,40,37,33,61,0,0 // movaps 0x3d21(%rip),%xmm12 # 5a00 <_sk_callback_sse2+0x4cc> .byte 65,15,88,212 // addps %xmm12,%xmm2 .byte 69,15,92,193 // subps %xmm9,%xmm8 .byte 69,15,89,197 // mulps %xmm13,%xmm8 - .byte 68,15,88,5,22,61,0,0 // addps 0x3d16(%rip),%xmm8 # 5a00 <_sk_callback_sse2+0x4d5> + .byte 68,15,88,5,29,61,0,0 // addps 0x3d1d(%rip),%xmm8 # 5a10 <_sk_callback_sse2+0x4dc> .byte 65,15,84,215 // andps %xmm15,%xmm2 .byte 69,15,85,248 // andnps %xmm8,%xmm15 .byte 68,15,86,250 // orps %xmm2,%xmm15 .byte 68,15,84,240 // andps %xmm0,%xmm14 .byte 65,15,85,199 // andnps %xmm15,%xmm0 .byte 65,15,86,198 // orps %xmm14,%xmm0 - .byte 15,89,5,7,61,0,0 // mulps 0x3d07(%rip),%xmm0 # 5a10 <_sk_callback_sse2+0x4e5> + .byte 15,89,5,14,61,0,0 // mulps 0x3d0e(%rip),%xmm0 # 5a20 <_sk_callback_sse2+0x4ec> .byte 69,15,40,194 // movaps %xmm10,%xmm8 .byte 69,15,194,195,4 // cmpneqps %xmm11,%xmm8 .byte 65,15,84,192 // andps %xmm8,%xmm0 .byte 69,15,92,226 // subps %xmm10,%xmm12 .byte 69,15,88,211 // addps %xmm11,%xmm10 - .byte 68,15,40,13,250,60,0,0 // movaps 0x3cfa(%rip),%xmm9 # 5a20 <_sk_callback_sse2+0x4f5> + .byte 68,15,40,13,1,61,0,0 // movaps 0x3d01(%rip),%xmm9 # 5a30 <_sk_callback_sse2+0x4fc> .byte 65,15,40,210 // movaps %xmm10,%xmm2 .byte 65,15,89,209 // mulps %xmm9,%xmm2 .byte 68,15,194,202,1 // cmpltps %xmm2,%xmm9 @@ -31305,7 +31159,7 @@ _sk_hsl_to_rgb_sse2: .byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp) .byte 68,15,40,218 // movaps %xmm2,%xmm11 .byte 15,40,240 // movaps %xmm0,%xmm6 - .byte 68,15,40,13,185,60,0,0 // movaps 0x3cb9(%rip),%xmm9 # 5a30 <_sk_callback_sse2+0x505> + .byte 68,15,40,13,192,60,0,0 // movaps 0x3cc0(%rip),%xmm9 # 5a40 <_sk_callback_sse2+0x50c> .byte 69,15,40,209 // movaps %xmm9,%xmm10 .byte 69,15,194,211,2 // cmpleps %xmm11,%xmm10 .byte 15,40,193 // movaps %xmm1,%xmm0 @@ -31322,28 +31176,28 @@ _sk_hsl_to_rgb_sse2: .byte 69,15,88,211 // addps %xmm11,%xmm10 .byte 69,15,88,219 // addps %xmm11,%xmm11 .byte 69,15,92,218 // subps %xmm10,%xmm11 - .byte 15,40,5,130,60,0,0 // movaps 0x3c82(%rip),%xmm0 # 5a40 <_sk_callback_sse2+0x515> + .byte 15,40,5,137,60,0,0 // movaps 0x3c89(%rip),%xmm0 # 5a50 <_sk_callback_sse2+0x51c> .byte 15,88,198 // addps %xmm6,%xmm0 .byte 243,15,91,200 // cvttps2dq %xmm0,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 .byte 15,40,216 // movaps %xmm0,%xmm3 .byte 15,194,217,1 // cmpltps %xmm1,%xmm3 - .byte 15,84,29,122,60,0,0 // andps 0x3c7a(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525> + .byte 15,84,29,129,60,0,0 // andps 0x3c81(%rip),%xmm3 # 5a60 <_sk_callback_sse2+0x52c> .byte 15,92,203 // subps %xmm3,%xmm1 .byte 15,92,193 // subps %xmm1,%xmm0 - .byte 68,15,40,45,124,60,0,0 // movaps 0x3c7c(%rip),%xmm13 # 5a60 <_sk_callback_sse2+0x535> + .byte 68,15,40,45,131,60,0,0 // movaps 0x3c83(%rip),%xmm13 # 5a70 <_sk_callback_sse2+0x53c> .byte 69,15,40,197 // movaps %xmm13,%xmm8 .byte 68,15,194,192,2 // cmpleps %xmm0,%xmm8 .byte 69,15,40,242 // movaps %xmm10,%xmm14 .byte 69,15,92,243 // subps %xmm11,%xmm14 .byte 65,15,40,217 // movaps %xmm9,%xmm3 .byte 15,194,216,2 // cmpleps %xmm0,%xmm3 - .byte 15,40,21,140,60,0,0 // movaps 0x3c8c(%rip),%xmm2 # 5a90 <_sk_callback_sse2+0x565> + .byte 15,40,21,147,60,0,0 // movaps 0x3c93(%rip),%xmm2 # 5aa0 <_sk_callback_sse2+0x56c> .byte 68,15,40,250 // movaps %xmm2,%xmm15 .byte 68,15,194,248,2 // cmpleps %xmm0,%xmm15 - .byte 15,40,13,92,60,0,0 // movaps 0x3c5c(%rip),%xmm1 # 5a70 <_sk_callback_sse2+0x545> + .byte 15,40,13,99,60,0,0 // movaps 0x3c63(%rip),%xmm1 # 5a80 <_sk_callback_sse2+0x54c> .byte 15,89,193 // mulps %xmm1,%xmm0 - .byte 15,40,45,98,60,0,0 // movaps 0x3c62(%rip),%xmm5 # 5a80 <_sk_callback_sse2+0x555> + .byte 15,40,45,105,60,0,0 // movaps 0x3c69(%rip),%xmm5 # 5a90 <_sk_callback_sse2+0x55c> .byte 15,40,229 // movaps %xmm5,%xmm4 .byte 15,92,224 // subps %xmm0,%xmm4 .byte 65,15,89,230 // mulps %xmm14,%xmm4 @@ -31366,7 +31220,7 @@ _sk_hsl_to_rgb_sse2: .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 .byte 15,40,222 // movaps %xmm6,%xmm3 .byte 15,194,216,1 // cmpltps %xmm0,%xmm3 - .byte 15,84,29,215,59,0,0 // andps 0x3bd7(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525> + .byte 15,84,29,222,59,0,0 // andps 0x3bde(%rip),%xmm3 # 5a60 <_sk_callback_sse2+0x52c> .byte 15,92,195 // subps %xmm3,%xmm0 .byte 68,15,40,230 // movaps %xmm6,%xmm12 .byte 68,15,92,224 // subps %xmm0,%xmm12 @@ -31396,12 +31250,12 @@ _sk_hsl_to_rgb_sse2: .byte 15,40,124,36,136 // movaps -0x78(%rsp),%xmm7 .byte 15,40,231 // movaps %xmm7,%xmm4 .byte 15,85,227 // andnps %xmm3,%xmm4 - .byte 15,88,53,175,59,0,0 // addps 0x3baf(%rip),%xmm6 # 5aa0 <_sk_callback_sse2+0x575> + .byte 15,88,53,182,59,0,0 // addps 0x3bb6(%rip),%xmm6 # 5ab0 <_sk_callback_sse2+0x57c> .byte 243,15,91,198 // cvttps2dq %xmm6,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 .byte 15,40,222 // movaps %xmm6,%xmm3 .byte 15,194,216,1 // cmpltps %xmm0,%xmm3 - .byte 15,84,29,74,59,0,0 // andps 0x3b4a(%rip),%xmm3 # 5a50 <_sk_callback_sse2+0x525> + .byte 15,84,29,81,59,0,0 // andps 0x3b51(%rip),%xmm3 # 5a60 <_sk_callback_sse2+0x52c> .byte 15,92,195 // subps %xmm3,%xmm0 .byte 15,92,240 // subps %xmm0,%xmm6 .byte 15,89,206 // mulps %xmm6,%xmm1 @@ -31461,13 +31315,13 @@ _sk_scale_u8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,61 // jne 1ff9 <_sk_scale_u8_sse2+0x47> + .byte 117,61 // jne 2002 <_sk_scale_u8_sse2+0x47> .byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8 .byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8 .byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8 - .byte 102,68,15,219,5,219,58,0,0 // pand 0x3adb(%rip),%xmm8 # 5ab0 <_sk_callback_sse2+0x585> + .byte 102,68,15,219,5,226,58,0,0 // pand 0x3ae2(%rip),%xmm8 # 5ac0 <_sk_callback_sse2+0x58c> .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,223,58,0,0 // mulps 0x3adf(%rip),%xmm8 # 5ac0 <_sk_callback_sse2+0x595> + .byte 68,15,89,5,230,58,0,0 // mulps 0x3ae6(%rip),%xmm8 # 5ad0 <_sk_callback_sse2+0x59c> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 65,15,89,208 // mulps %xmm8,%xmm2 @@ -31479,11 +31333,11 @@ _sk_scale_u8_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,54 // je 2041 <_sk_scale_u8_sse2+0x8f> + .byte 116,54 // je 204a <_sk_scale_u8_sse2+0x8f> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,23 // je 2028 <_sk_scale_u8_sse2+0x76> + .byte 116,23 // je 2031 <_sk_scale_u8_sse2+0x76> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,181 // jne 1fcc <_sk_scale_u8_sse2+0x1a> + .byte 117,181 // jne 1fd5 <_sk_scale_u8_sse2+0x1a> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8 @@ -31495,7 +31349,7 @@ _sk_scale_u8_sse2: .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,68,15,110,200 // movd %eax,%xmm9 .byte 243,69,15,16,193 // movss %xmm9,%xmm8 - .byte 233,119,255,255,255 // jmpq 1fcc <_sk_scale_u8_sse2+0x1a> + .byte 233,119,255,255,255 // jmpq 1fd5 <_sk_scale_u8_sse2+0x1a> HIDDEN _sk_lerp_1_float_sse2 .globl _sk_lerp_1_float_sse2 @@ -31526,13 +31380,13 @@ _sk_lerp_u8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,81 // jne 20e8 <_sk_lerp_u8_sse2+0x5b> + .byte 117,81 // jne 20f1 <_sk_lerp_u8_sse2+0x5b> .byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8 .byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8 .byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8 - .byte 102,68,15,219,5,32,58,0,0 // pand 0x3a20(%rip),%xmm8 # 5ad0 <_sk_callback_sse2+0x5a5> + .byte 102,68,15,219,5,39,58,0,0 // pand 0x3a27(%rip),%xmm8 # 5ae0 <_sk_callback_sse2+0x5ac> .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,36,58,0,0 // mulps 0x3a24(%rip),%xmm8 # 5ae0 <_sk_callback_sse2+0x5b5> + .byte 68,15,89,5,43,58,0,0 // mulps 0x3a2b(%rip),%xmm8 # 5af0 <_sk_callback_sse2+0x5bc> .byte 15,92,196 // subps %xmm4,%xmm0 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -31551,11 +31405,11 @@ _sk_lerp_u8_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,54 // je 2130 <_sk_lerp_u8_sse2+0xa3> + .byte 116,54 // je 2139 <_sk_lerp_u8_sse2+0xa3> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,23 // je 2117 <_sk_lerp_u8_sse2+0x8a> + .byte 116,23 // je 2120 <_sk_lerp_u8_sse2+0x8a> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,161 // jne 20a7 <_sk_lerp_u8_sse2+0x1a> + .byte 117,161 // jne 20b0 <_sk_lerp_u8_sse2+0x1a> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,192,69 // pshufd $0x45,%xmm8,%xmm8 @@ -31567,7 +31421,7 @@ _sk_lerp_u8_sse2: .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,68,15,110,200 // movd %eax,%xmm9 .byte 243,69,15,16,193 // movss %xmm9,%xmm8 - .byte 233,99,255,255,255 // jmpq 20a7 <_sk_lerp_u8_sse2+0x1a> + .byte 233,99,255,255,255 // jmpq 20b0 <_sk_lerp_u8_sse2+0x1a> HIDDEN _sk_lerp_565_sse2 .globl _sk_lerp_565_sse2 @@ -31576,20 +31430,20 @@ _sk_lerp_565_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,156,0,0,0 // jne 21ee <_sk_lerp_565_sse2+0xaa> + .byte 15,133,156,0,0,0 // jne 21f7 <_sk_lerp_565_sse2+0xaa> .byte 243,69,15,126,12,82 // movq (%r10,%rdx,2),%xmm9 .byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9 - .byte 102,68,15,111,5,138,57,0,0 // movdqa 0x398a(%rip),%xmm8 # 5af0 <_sk_callback_sse2+0x5c5> + .byte 102,68,15,111,5,145,57,0,0 // movdqa 0x3991(%rip),%xmm8 # 5b00 <_sk_callback_sse2+0x5cc> .byte 102,69,15,219,193 // pand %xmm9,%xmm8 .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 - .byte 68,15,89,5,137,57,0,0 // mulps 0x3989(%rip),%xmm8 # 5b00 <_sk_callback_sse2+0x5d5> - .byte 102,68,15,111,21,144,57,0,0 // movdqa 0x3990(%rip),%xmm10 # 5b10 <_sk_callback_sse2+0x5e5> + .byte 68,15,89,5,144,57,0,0 // mulps 0x3990(%rip),%xmm8 # 5b10 <_sk_callback_sse2+0x5dc> + .byte 102,68,15,111,21,151,57,0,0 // movdqa 0x3997(%rip),%xmm10 # 5b20 <_sk_callback_sse2+0x5ec> .byte 102,69,15,219,209 // pand %xmm9,%xmm10 .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 - .byte 68,15,89,21,143,57,0,0 // mulps 0x398f(%rip),%xmm10 # 5b20 <_sk_callback_sse2+0x5f5> - .byte 102,68,15,219,13,150,57,0,0 // pand 0x3996(%rip),%xmm9 # 5b30 <_sk_callback_sse2+0x605> + .byte 68,15,89,21,150,57,0,0 // mulps 0x3996(%rip),%xmm10 # 5b30 <_sk_callback_sse2+0x5fc> + .byte 102,68,15,219,13,157,57,0,0 // pand 0x399d(%rip),%xmm9 # 5b40 <_sk_callback_sse2+0x60c> .byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9 - .byte 68,15,89,13,154,57,0,0 // mulps 0x399a(%rip),%xmm9 # 5b40 <_sk_callback_sse2+0x615> + .byte 68,15,89,13,161,57,0,0 // mulps 0x39a1(%rip),%xmm9 # 5b50 <_sk_callback_sse2+0x61c> .byte 15,92,196 // subps %xmm4,%xmm0 .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 15,88,196 // addps %xmm4,%xmm0 @@ -31615,11 +31469,11 @@ _sk_lerp_565_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,58 // je 223a <_sk_lerp_565_sse2+0xf6> + .byte 116,58 // je 2243 <_sk_lerp_565_sse2+0xf6> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,27 // je 2221 <_sk_lerp_565_sse2+0xdd> + .byte 116,27 // je 222a <_sk_lerp_565_sse2+0xdd> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 15,133,77,255,255,255 // jne 215d <_sk_lerp_565_sse2+0x19> + .byte 15,133,77,255,255,255 // jne 2166 <_sk_lerp_565_sse2+0x19> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 102,69,15,112,200,69 // pshufd $0x45,%xmm8,%xmm9 @@ -31631,7 +31485,7 @@ _sk_lerp_565_sse2: .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 243,69,15,16,200 // movss %xmm8,%xmm9 - .byte 233,15,255,255,255 // jmpq 215d <_sk_lerp_565_sse2+0x19> + .byte 233,15,255,255,255 // jmpq 2166 <_sk_lerp_565_sse2+0x19> HIDDEN _sk_load_tables_sse2 .globl _sk_load_tables_sse2 @@ -31640,12 +31494,12 @@ _sk_load_tables_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,36,1,0,0 // jne 2380 <_sk_load_tables_sse2+0x132> + .byte 15,133,36,1,0,0 // jne 2389 <_sk_load_tables_sse2+0x132> .byte 243,69,15,111,12,145 // movdqu (%r9,%rdx,4),%xmm9 .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 83 // push %rbx - .byte 102,68,15,111,5,224,56,0,0 // movdqa 0x38e0(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x625> + .byte 102,68,15,111,5,231,56,0,0 // movdqa 0x38e7(%rip),%xmm8 # 5b60 <_sk_callback_sse2+0x62c> .byte 102,65,15,111,193 // movdqa %xmm9,%xmm0 .byte 102,65,15,219,192 // pand %xmm8,%xmm0 .byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1 @@ -31701,7 +31555,7 @@ _sk_load_tables_sse2: .byte 65,15,20,208 // unpcklps %xmm8,%xmm2 .byte 102,65,15,114,209,24 // psrld $0x18,%xmm9 .byte 65,15,91,217 // cvtdq2ps %xmm9,%xmm3 - .byte 15,89,29,233,55,0,0 // mulps 0x37e9(%rip),%xmm3 # 5b60 <_sk_callback_sse2+0x635> + .byte 15,89,29,240,55,0,0 // mulps 0x37f0(%rip),%xmm3 # 5b70 <_sk_callback_sse2+0x63c> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 65,94 // pop %r14 @@ -31711,11 +31565,11 @@ _sk_load_tables_sse2: .byte 65,128,226,3 // and $0x3,%r10b .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 .byte 65,128,250,1 // cmp $0x1,%r10b - .byte 116,50 // je 23c4 <_sk_load_tables_sse2+0x176> + .byte 116,50 // je 23cd <_sk_load_tables_sse2+0x176> .byte 65,128,250,2 // cmp $0x2,%r10b - .byte 116,23 // je 23af <_sk_load_tables_sse2+0x161> + .byte 116,23 // je 23b8 <_sk_load_tables_sse2+0x161> .byte 65,128,250,3 // cmp $0x3,%r10b - .byte 15,133,192,254,255,255 // jne 2262 <_sk_load_tables_sse2+0x14> + .byte 15,133,192,254,255,255 // jne 226b <_sk_load_tables_sse2+0x14> .byte 102,65,15,110,68,145,8 // movd 0x8(%r9,%rdx,4),%xmm0 .byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9 .byte 243,65,15,16,68,145,4 // movss 0x4(%r9,%rdx,4),%xmm0 @@ -31724,7 +31578,7 @@ _sk_load_tables_sse2: .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 243,65,15,16,4,145 // movss (%r9,%rdx,4),%xmm0 .byte 243,68,15,16,200 // movss %xmm0,%xmm9 - .byte 233,142,254,255,255 // jmpq 2262 <_sk_load_tables_sse2+0x14> + .byte 233,142,254,255,255 // jmpq 226b <_sk_load_tables_sse2+0x14> HIDDEN _sk_load_tables_u16_be_sse2 .globl _sk_load_tables_u16_be_sse2 @@ -31734,7 +31588,7 @@ _sk_load_tables_u16_be_sse2: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,101,1,0,0 // jne 254f <_sk_load_tables_u16_be_sse2+0x17b> + .byte 15,133,101,1,0,0 // jne 2558 <_sk_load_tables_u16_be_sse2+0x17b> .byte 102,67,15,16,4,81 // movupd (%r9,%r10,2),%xmm0 .byte 102,67,15,16,76,81,16 // movupd 0x10(%r9,%r10,2),%xmm1 .byte 65,87 // push %r15 @@ -31746,7 +31600,7 @@ _sk_load_tables_u16_be_sse2: .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1 .byte 102,15,97,200 // punpcklwd %xmm0,%xmm1 .byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9 - .byte 102,68,15,111,21,79,55,0,0 // movdqa 0x374f(%rip),%xmm10 # 5b70 <_sk_callback_sse2+0x645> + .byte 102,68,15,111,21,86,55,0,0 // movdqa 0x3756(%rip),%xmm10 # 5b80 <_sk_callback_sse2+0x64c> .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,65,15,219,194 // pand %xmm10,%xmm0 .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 @@ -31808,7 +31662,7 @@ _sk_load_tables_u16_be_sse2: .byte 102,65,15,235,217 // por %xmm9,%xmm3 .byte 102,65,15,97,216 // punpcklwd %xmm8,%xmm3 .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,58,54,0,0 // mulps 0x363a(%rip),%xmm3 # 5b80 <_sk_callback_sse2+0x655> + .byte 15,89,29,65,54,0,0 // mulps 0x3641(%rip),%xmm3 # 5b90 <_sk_callback_sse2+0x65c> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 65,94 // pop %r14 @@ -31816,17 +31670,17 @@ _sk_load_tables_u16_be_sse2: .byte 255,224 // jmpq *%rax .byte 242,67,15,16,4,81 // movsd (%r9,%r10,2),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,17 // jne 256c <_sk_load_tables_u16_be_sse2+0x198> + .byte 117,17 // jne 2575 <_sk_load_tables_u16_be_sse2+0x198> .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 102,15,20,193 // unpcklpd %xmm1,%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 - .byte 233,139,254,255,255 // jmpq 23f7 <_sk_load_tables_u16_be_sse2+0x23> + .byte 233,139,254,255,255 // jmpq 2400 <_sk_load_tables_u16_be_sse2+0x23> .byte 102,67,15,22,68,81,8 // movhpd 0x8(%r9,%r10,2),%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,118,254,255,255 // jb 23f7 <_sk_load_tables_u16_be_sse2+0x23> + .byte 15,130,118,254,255,255 // jb 2400 <_sk_load_tables_u16_be_sse2+0x23> .byte 242,67,15,16,76,81,16 // movsd 0x10(%r9,%r10,2),%xmm1 - .byte 233,106,254,255,255 // jmpq 23f7 <_sk_load_tables_u16_be_sse2+0x23> + .byte 233,106,254,255,255 // jmpq 2400 <_sk_load_tables_u16_be_sse2+0x23> HIDDEN _sk_load_tables_rgb_u16_be_sse2 .globl _sk_load_tables_rgb_u16_be_sse2 @@ -31836,7 +31690,7 @@ _sk_load_tables_rgb_u16_be_sse2: .byte 76,139,8 // mov (%rax),%r9 .byte 76,141,20,82 // lea (%rdx,%rdx,2),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,84,1,0,0 // jne 26f3 <_sk_load_tables_rgb_u16_be_sse2+0x166> + .byte 15,133,84,1,0,0 // jne 26fc <_sk_load_tables_rgb_u16_be_sse2+0x166> .byte 243,71,15,111,28,81 // movdqu (%r9,%r10,2),%xmm11 .byte 243,67,15,111,76,81,8 // movdqu 0x8(%r9,%r10,2),%xmm1 .byte 102,15,115,217,4 // psrldq $0x4,%xmm1 @@ -31851,7 +31705,7 @@ _sk_load_tables_rgb_u16_be_sse2: .byte 102,68,15,97,208 // punpcklwd %xmm0,%xmm10 .byte 102,65,15,111,195 // movdqa %xmm11,%xmm0 .byte 102,65,15,97,194 // punpcklwd %xmm10,%xmm0 - .byte 102,68,15,111,5,169,53,0,0 // movdqa 0x35a9(%rip),%xmm8 # 5b90 <_sk_callback_sse2+0x665> + .byte 102,68,15,111,5,176,53,0,0 // movdqa 0x35b0(%rip),%xmm8 # 5ba0 <_sk_callback_sse2+0x66c> .byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1 .byte 102,65,15,219,192 // pand %xmm8,%xmm0 .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 @@ -31907,7 +31761,7 @@ _sk_load_tables_rgb_u16_be_sse2: .byte 15,20,211 // unpcklps %xmm3,%xmm2 .byte 65,15,20,208 // unpcklps %xmm8,%xmm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,180,52,0,0 // movaps 0x34b4(%rip),%xmm3 # 5ba0 <_sk_callback_sse2+0x675> + .byte 15,40,29,187,52,0,0 // movaps 0x34bb(%rip),%xmm3 # 5bb0 <_sk_callback_sse2+0x67c> .byte 91 // pop %rbx .byte 65,94 // pop %r14 .byte 65,95 // pop %r15 @@ -31916,21 +31770,21 @@ _sk_load_tables_rgb_u16_be_sse2: .byte 102,71,15,196,92,81,4,2 // pinsrw $0x2,0x4(%r9,%r10,2),%xmm11 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,14 // jne 2719 <_sk_load_tables_rgb_u16_be_sse2+0x18c> + .byte 117,14 // jne 2722 <_sk_load_tables_rgb_u16_be_sse2+0x18c> .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 102,69,15,239,210 // pxor %xmm10,%xmm10 - .byte 233,172,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38> + .byte 233,172,254,255,255 // jmpq 25ce <_sk_load_tables_rgb_u16_be_sse2+0x38> .byte 102,71,15,110,84,81,6 // movd 0x6(%r9,%r10,2),%xmm10 .byte 102,71,15,196,84,81,10,2 // pinsrw $0x2,0xa(%r9,%r10,2),%xmm10 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,24 // jb 274a <_sk_load_tables_rgb_u16_be_sse2+0x1bd> + .byte 114,24 // jb 2753 <_sk_load_tables_rgb_u16_be_sse2+0x1bd> .byte 102,67,15,110,76,81,12 // movd 0xc(%r9,%r10,2),%xmm1 .byte 102,67,15,196,76,81,16,2 // pinsrw $0x2,0x10(%r9,%r10,2),%xmm1 .byte 102,15,239,192 // pxor %xmm0,%xmm0 - .byte 233,123,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38> + .byte 233,123,254,255,255 // jmpq 25ce <_sk_load_tables_rgb_u16_be_sse2+0x38> .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,114,254,255,255 // jmpq 25c5 <_sk_load_tables_rgb_u16_be_sse2+0x38> + .byte 233,114,254,255,255 // jmpq 25ce <_sk_load_tables_rgb_u16_be_sse2+0x38> HIDDEN _sk_byte_tables_sse2 .globl _sk_byte_tables_sse2 @@ -31941,7 +31795,7 @@ _sk_byte_tables_sse2: .byte 65,86 // push %r14 .byte 83 // push %rbx .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,77,52,0,0 // movaps 0x344d(%rip),%xmm8 # 5bb0 <_sk_callback_sse2+0x685> + .byte 68,15,40,5,84,52,0,0 // movaps 0x3454(%rip),%xmm8 # 5bc0 <_sk_callback_sse2+0x68c> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0 .byte 102,73,15,126,193 // movq %xmm0,%r9 @@ -31969,7 +31823,7 @@ _sk_byte_tables_sse2: .byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0 .byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,21,231,51,0,0 // movaps 0x33e7(%rip),%xmm10 # 5bc0 <_sk_callback_sse2+0x695> + .byte 68,15,40,21,238,51,0,0 // movaps 0x33ee(%rip),%xmm10 # 5bd0 <_sk_callback_sse2+0x69c> .byte 65,15,89,194 // mulps %xmm10,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1 @@ -32090,7 +31944,7 @@ _sk_byte_tables_rgb_sse2: .byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0 .byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,21,47,50,0,0 // movaps 0x322f(%rip),%xmm10 # 5bd0 <_sk_callback_sse2+0x6a5> + .byte 68,15,40,21,54,50,0,0 // movaps 0x3236(%rip),%xmm10 # 5be0 <_sk_callback_sse2+0x6ac> .byte 65,15,89,194 // mulps %xmm10,%xmm0 .byte 65,15,89,200 // mulps %xmm8,%xmm1 .byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1 @@ -32297,15 +32151,15 @@ _sk_parametric_r_sse2: .byte 69,15,88,209 // addps %xmm9,%xmm10 .byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11 .byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9 - .byte 68,15,89,13,99,47,0,0 // mulps 0x2f63(%rip),%xmm9 # 5be0 <_sk_callback_sse2+0x6b5> - .byte 68,15,84,21,107,47,0,0 // andps 0x2f6b(%rip),%xmm10 # 5bf0 <_sk_callback_sse2+0x6c5> - .byte 68,15,86,21,115,47,0,0 // orps 0x2f73(%rip),%xmm10 # 5c00 <_sk_callback_sse2+0x6d5> - .byte 68,15,88,13,123,47,0,0 // addps 0x2f7b(%rip),%xmm9 # 5c10 <_sk_callback_sse2+0x6e5> - .byte 68,15,40,37,131,47,0,0 // movaps 0x2f83(%rip),%xmm12 # 5c20 <_sk_callback_sse2+0x6f5> + .byte 68,15,89,13,106,47,0,0 // mulps 0x2f6a(%rip),%xmm9 # 5bf0 <_sk_callback_sse2+0x6bc> + .byte 68,15,84,21,114,47,0,0 // andps 0x2f72(%rip),%xmm10 # 5c00 <_sk_callback_sse2+0x6cc> + .byte 68,15,86,21,122,47,0,0 // orps 0x2f7a(%rip),%xmm10 # 5c10 <_sk_callback_sse2+0x6dc> + .byte 68,15,88,13,130,47,0,0 // addps 0x2f82(%rip),%xmm9 # 5c20 <_sk_callback_sse2+0x6ec> + .byte 68,15,40,37,138,47,0,0 // movaps 0x2f8a(%rip),%xmm12 # 5c30 <_sk_callback_sse2+0x6fc> .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,88,21,131,47,0,0 // addps 0x2f83(%rip),%xmm10 # 5c30 <_sk_callback_sse2+0x705> - .byte 68,15,40,37,139,47,0,0 // movaps 0x2f8b(%rip),%xmm12 # 5c40 <_sk_callback_sse2+0x715> + .byte 68,15,88,21,138,47,0,0 // addps 0x2f8a(%rip),%xmm10 # 5c40 <_sk_callback_sse2+0x70c> + .byte 68,15,40,37,146,47,0,0 // movaps 0x2f92(%rip),%xmm12 # 5c50 <_sk_callback_sse2+0x71c> .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 @@ -32313,22 +32167,22 @@ _sk_parametric_r_sse2: .byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13 - .byte 68,15,40,21,117,47,0,0 // movaps 0x2f75(%rip),%xmm10 # 5c50 <_sk_callback_sse2+0x725> + .byte 68,15,40,21,124,47,0,0 // movaps 0x2f7c(%rip),%xmm10 # 5c60 <_sk_callback_sse2+0x72c> .byte 69,15,84,234 // andps %xmm10,%xmm13 .byte 69,15,87,219 // xorps %xmm11,%xmm11 .byte 69,15,92,229 // subps %xmm13,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,92,236 // subps %xmm12,%xmm13 - .byte 68,15,88,13,105,47,0,0 // addps 0x2f69(%rip),%xmm9 # 5c60 <_sk_callback_sse2+0x735> - .byte 68,15,40,37,113,47,0,0 // movaps 0x2f71(%rip),%xmm12 # 5c70 <_sk_callback_sse2+0x745> + .byte 68,15,88,13,112,47,0,0 // addps 0x2f70(%rip),%xmm9 # 5c70 <_sk_callback_sse2+0x73c> + .byte 68,15,40,37,120,47,0,0 // movaps 0x2f78(%rip),%xmm12 # 5c80 <_sk_callback_sse2+0x74c> .byte 69,15,89,229 // mulps %xmm13,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,40,37,113,47,0,0 // movaps 0x2f71(%rip),%xmm12 # 5c80 <_sk_callback_sse2+0x755> + .byte 68,15,40,37,120,47,0,0 // movaps 0x2f78(%rip),%xmm12 # 5c90 <_sk_callback_sse2+0x75c> .byte 69,15,92,229 // subps %xmm13,%xmm12 - .byte 68,15,40,45,117,47,0,0 // movaps 0x2f75(%rip),%xmm13 # 5c90 <_sk_callback_sse2+0x765> + .byte 68,15,40,45,124,47,0,0 // movaps 0x2f7c(%rip),%xmm13 # 5ca0 <_sk_callback_sse2+0x76c> .byte 69,15,94,236 // divps %xmm12,%xmm13 .byte 69,15,88,233 // addps %xmm9,%xmm13 - .byte 68,15,89,45,117,47,0,0 // mulps 0x2f75(%rip),%xmm13 # 5ca0 <_sk_callback_sse2+0x775> + .byte 68,15,89,45,124,47,0,0 // mulps 0x2f7c(%rip),%xmm13 # 5cb0 <_sk_callback_sse2+0x77c> .byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9 .byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12 .byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12 @@ -32364,15 +32218,15 @@ _sk_parametric_g_sse2: .byte 69,15,88,209 // addps %xmm9,%xmm10 .byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11 .byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9 - .byte 68,15,89,13,245,46,0,0 // mulps 0x2ef5(%rip),%xmm9 # 5cb0 <_sk_callback_sse2+0x785> - .byte 68,15,84,21,253,46,0,0 // andps 0x2efd(%rip),%xmm10 # 5cc0 <_sk_callback_sse2+0x795> - .byte 68,15,86,21,5,47,0,0 // orps 0x2f05(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x7a5> - .byte 68,15,88,13,13,47,0,0 // addps 0x2f0d(%rip),%xmm9 # 5ce0 <_sk_callback_sse2+0x7b5> - .byte 68,15,40,37,21,47,0,0 // movaps 0x2f15(%rip),%xmm12 # 5cf0 <_sk_callback_sse2+0x7c5> + .byte 68,15,89,13,252,46,0,0 // mulps 0x2efc(%rip),%xmm9 # 5cc0 <_sk_callback_sse2+0x78c> + .byte 68,15,84,21,4,47,0,0 // andps 0x2f04(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x79c> + .byte 68,15,86,21,12,47,0,0 // orps 0x2f0c(%rip),%xmm10 # 5ce0 <_sk_callback_sse2+0x7ac> + .byte 68,15,88,13,20,47,0,0 // addps 0x2f14(%rip),%xmm9 # 5cf0 <_sk_callback_sse2+0x7bc> + .byte 68,15,40,37,28,47,0,0 // movaps 0x2f1c(%rip),%xmm12 # 5d00 <_sk_callback_sse2+0x7cc> .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,88,21,21,47,0,0 // addps 0x2f15(%rip),%xmm10 # 5d00 <_sk_callback_sse2+0x7d5> - .byte 68,15,40,37,29,47,0,0 // movaps 0x2f1d(%rip),%xmm12 # 5d10 <_sk_callback_sse2+0x7e5> + .byte 68,15,88,21,28,47,0,0 // addps 0x2f1c(%rip),%xmm10 # 5d10 <_sk_callback_sse2+0x7dc> + .byte 68,15,40,37,36,47,0,0 // movaps 0x2f24(%rip),%xmm12 # 5d20 <_sk_callback_sse2+0x7ec> .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 @@ -32380,22 +32234,22 @@ _sk_parametric_g_sse2: .byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13 - .byte 68,15,40,21,7,47,0,0 // movaps 0x2f07(%rip),%xmm10 # 5d20 <_sk_callback_sse2+0x7f5> + .byte 68,15,40,21,14,47,0,0 // movaps 0x2f0e(%rip),%xmm10 # 5d30 <_sk_callback_sse2+0x7fc> .byte 69,15,84,234 // andps %xmm10,%xmm13 .byte 69,15,87,219 // xorps %xmm11,%xmm11 .byte 69,15,92,229 // subps %xmm13,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,92,236 // subps %xmm12,%xmm13 - .byte 68,15,88,13,251,46,0,0 // addps 0x2efb(%rip),%xmm9 # 5d30 <_sk_callback_sse2+0x805> - .byte 68,15,40,37,3,47,0,0 // movaps 0x2f03(%rip),%xmm12 # 5d40 <_sk_callback_sse2+0x815> + .byte 68,15,88,13,2,47,0,0 // addps 0x2f02(%rip),%xmm9 # 5d40 <_sk_callback_sse2+0x80c> + .byte 68,15,40,37,10,47,0,0 // movaps 0x2f0a(%rip),%xmm12 # 5d50 <_sk_callback_sse2+0x81c> .byte 69,15,89,229 // mulps %xmm13,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,40,37,3,47,0,0 // movaps 0x2f03(%rip),%xmm12 # 5d50 <_sk_callback_sse2+0x825> + .byte 68,15,40,37,10,47,0,0 // movaps 0x2f0a(%rip),%xmm12 # 5d60 <_sk_callback_sse2+0x82c> .byte 69,15,92,229 // subps %xmm13,%xmm12 - .byte 68,15,40,45,7,47,0,0 // movaps 0x2f07(%rip),%xmm13 # 5d60 <_sk_callback_sse2+0x835> + .byte 68,15,40,45,14,47,0,0 // movaps 0x2f0e(%rip),%xmm13 # 5d70 <_sk_callback_sse2+0x83c> .byte 69,15,94,236 // divps %xmm12,%xmm13 .byte 69,15,88,233 // addps %xmm9,%xmm13 - .byte 68,15,89,45,7,47,0,0 // mulps 0x2f07(%rip),%xmm13 # 5d70 <_sk_callback_sse2+0x845> + .byte 68,15,89,45,14,47,0,0 // mulps 0x2f0e(%rip),%xmm13 # 5d80 <_sk_callback_sse2+0x84c> .byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9 .byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12 .byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12 @@ -32431,15 +32285,15 @@ _sk_parametric_b_sse2: .byte 69,15,88,209 // addps %xmm9,%xmm10 .byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11 .byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9 - .byte 68,15,89,13,135,46,0,0 // mulps 0x2e87(%rip),%xmm9 # 5d80 <_sk_callback_sse2+0x855> - .byte 68,15,84,21,143,46,0,0 // andps 0x2e8f(%rip),%xmm10 # 5d90 <_sk_callback_sse2+0x865> - .byte 68,15,86,21,151,46,0,0 // orps 0x2e97(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x875> - .byte 68,15,88,13,159,46,0,0 // addps 0x2e9f(%rip),%xmm9 # 5db0 <_sk_callback_sse2+0x885> - .byte 68,15,40,37,167,46,0,0 // movaps 0x2ea7(%rip),%xmm12 # 5dc0 <_sk_callback_sse2+0x895> + .byte 68,15,89,13,142,46,0,0 // mulps 0x2e8e(%rip),%xmm9 # 5d90 <_sk_callback_sse2+0x85c> + .byte 68,15,84,21,150,46,0,0 // andps 0x2e96(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x86c> + .byte 68,15,86,21,158,46,0,0 // orps 0x2e9e(%rip),%xmm10 # 5db0 <_sk_callback_sse2+0x87c> + .byte 68,15,88,13,166,46,0,0 // addps 0x2ea6(%rip),%xmm9 # 5dc0 <_sk_callback_sse2+0x88c> + .byte 68,15,40,37,174,46,0,0 // movaps 0x2eae(%rip),%xmm12 # 5dd0 <_sk_callback_sse2+0x89c> .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,88,21,167,46,0,0 // addps 0x2ea7(%rip),%xmm10 # 5dd0 <_sk_callback_sse2+0x8a5> - .byte 68,15,40,37,175,46,0,0 // movaps 0x2eaf(%rip),%xmm12 # 5de0 <_sk_callback_sse2+0x8b5> + .byte 68,15,88,21,174,46,0,0 // addps 0x2eae(%rip),%xmm10 # 5de0 <_sk_callback_sse2+0x8ac> + .byte 68,15,40,37,182,46,0,0 // movaps 0x2eb6(%rip),%xmm12 # 5df0 <_sk_callback_sse2+0x8bc> .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 @@ -32447,22 +32301,22 @@ _sk_parametric_b_sse2: .byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13 - .byte 68,15,40,21,153,46,0,0 // movaps 0x2e99(%rip),%xmm10 # 5df0 <_sk_callback_sse2+0x8c5> + .byte 68,15,40,21,160,46,0,0 // movaps 0x2ea0(%rip),%xmm10 # 5e00 <_sk_callback_sse2+0x8cc> .byte 69,15,84,234 // andps %xmm10,%xmm13 .byte 69,15,87,219 // xorps %xmm11,%xmm11 .byte 69,15,92,229 // subps %xmm13,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,92,236 // subps %xmm12,%xmm13 - .byte 68,15,88,13,141,46,0,0 // addps 0x2e8d(%rip),%xmm9 # 5e00 <_sk_callback_sse2+0x8d5> - .byte 68,15,40,37,149,46,0,0 // movaps 0x2e95(%rip),%xmm12 # 5e10 <_sk_callback_sse2+0x8e5> + .byte 68,15,88,13,148,46,0,0 // addps 0x2e94(%rip),%xmm9 # 5e10 <_sk_callback_sse2+0x8dc> + .byte 68,15,40,37,156,46,0,0 // movaps 0x2e9c(%rip),%xmm12 # 5e20 <_sk_callback_sse2+0x8ec> .byte 69,15,89,229 // mulps %xmm13,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,40,37,149,46,0,0 // movaps 0x2e95(%rip),%xmm12 # 5e20 <_sk_callback_sse2+0x8f5> + .byte 68,15,40,37,156,46,0,0 // movaps 0x2e9c(%rip),%xmm12 # 5e30 <_sk_callback_sse2+0x8fc> .byte 69,15,92,229 // subps %xmm13,%xmm12 - .byte 68,15,40,45,153,46,0,0 // movaps 0x2e99(%rip),%xmm13 # 5e30 <_sk_callback_sse2+0x905> + .byte 68,15,40,45,160,46,0,0 // movaps 0x2ea0(%rip),%xmm13 # 5e40 <_sk_callback_sse2+0x90c> .byte 69,15,94,236 // divps %xmm12,%xmm13 .byte 69,15,88,233 // addps %xmm9,%xmm13 - .byte 68,15,89,45,153,46,0,0 // mulps 0x2e99(%rip),%xmm13 # 5e40 <_sk_callback_sse2+0x915> + .byte 68,15,89,45,160,46,0,0 // mulps 0x2ea0(%rip),%xmm13 # 5e50 <_sk_callback_sse2+0x91c> .byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9 .byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12 .byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12 @@ -32498,15 +32352,15 @@ _sk_parametric_a_sse2: .byte 69,15,88,209 // addps %xmm9,%xmm10 .byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11 .byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9 - .byte 68,15,89,13,25,46,0,0 // mulps 0x2e19(%rip),%xmm9 # 5e50 <_sk_callback_sse2+0x925> - .byte 68,15,84,21,33,46,0,0 // andps 0x2e21(%rip),%xmm10 # 5e60 <_sk_callback_sse2+0x935> - .byte 68,15,86,21,41,46,0,0 // orps 0x2e29(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x945> - .byte 68,15,88,13,49,46,0,0 // addps 0x2e31(%rip),%xmm9 # 5e80 <_sk_callback_sse2+0x955> - .byte 68,15,40,37,57,46,0,0 // movaps 0x2e39(%rip),%xmm12 # 5e90 <_sk_callback_sse2+0x965> + .byte 68,15,89,13,32,46,0,0 // mulps 0x2e20(%rip),%xmm9 # 5e60 <_sk_callback_sse2+0x92c> + .byte 68,15,84,21,40,46,0,0 // andps 0x2e28(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x93c> + .byte 68,15,86,21,48,46,0,0 // orps 0x2e30(%rip),%xmm10 # 5e80 <_sk_callback_sse2+0x94c> + .byte 68,15,88,13,56,46,0,0 // addps 0x2e38(%rip),%xmm9 # 5e90 <_sk_callback_sse2+0x95c> + .byte 68,15,40,37,64,46,0,0 // movaps 0x2e40(%rip),%xmm12 # 5ea0 <_sk_callback_sse2+0x96c> .byte 69,15,89,226 // mulps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,88,21,57,46,0,0 // addps 0x2e39(%rip),%xmm10 # 5ea0 <_sk_callback_sse2+0x975> - .byte 68,15,40,37,65,46,0,0 // movaps 0x2e41(%rip),%xmm12 # 5eb0 <_sk_callback_sse2+0x985> + .byte 68,15,88,21,64,46,0,0 // addps 0x2e40(%rip),%xmm10 # 5eb0 <_sk_callback_sse2+0x97c> + .byte 68,15,40,37,72,46,0,0 // movaps 0x2e48(%rip),%xmm12 # 5ec0 <_sk_callback_sse2+0x98c> .byte 69,15,94,226 // divps %xmm10,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 .byte 69,15,89,203 // mulps %xmm11,%xmm9 @@ -32514,22 +32368,22 @@ _sk_parametric_a_sse2: .byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13 - .byte 68,15,40,21,43,46,0,0 // movaps 0x2e2b(%rip),%xmm10 # 5ec0 <_sk_callback_sse2+0x995> + .byte 68,15,40,21,50,46,0,0 // movaps 0x2e32(%rip),%xmm10 # 5ed0 <_sk_callback_sse2+0x99c> .byte 69,15,84,234 // andps %xmm10,%xmm13 .byte 69,15,87,219 // xorps %xmm11,%xmm11 .byte 69,15,92,229 // subps %xmm13,%xmm12 .byte 69,15,40,233 // movaps %xmm9,%xmm13 .byte 69,15,92,236 // subps %xmm12,%xmm13 - .byte 68,15,88,13,31,46,0,0 // addps 0x2e1f(%rip),%xmm9 # 5ed0 <_sk_callback_sse2+0x9a5> - .byte 68,15,40,37,39,46,0,0 // movaps 0x2e27(%rip),%xmm12 # 5ee0 <_sk_callback_sse2+0x9b5> + .byte 68,15,88,13,38,46,0,0 // addps 0x2e26(%rip),%xmm9 # 5ee0 <_sk_callback_sse2+0x9ac> + .byte 68,15,40,37,46,46,0,0 // movaps 0x2e2e(%rip),%xmm12 # 5ef0 <_sk_callback_sse2+0x9bc> .byte 69,15,89,229 // mulps %xmm13,%xmm12 .byte 69,15,92,204 // subps %xmm12,%xmm9 - .byte 68,15,40,37,39,46,0,0 // movaps 0x2e27(%rip),%xmm12 # 5ef0 <_sk_callback_sse2+0x9c5> + .byte 68,15,40,37,46,46,0,0 // movaps 0x2e2e(%rip),%xmm12 # 5f00 <_sk_callback_sse2+0x9cc> .byte 69,15,92,229 // subps %xmm13,%xmm12 - .byte 68,15,40,45,43,46,0,0 // movaps 0x2e2b(%rip),%xmm13 # 5f00 <_sk_callback_sse2+0x9d5> + .byte 68,15,40,45,50,46,0,0 // movaps 0x2e32(%rip),%xmm13 # 5f10 <_sk_callback_sse2+0x9dc> .byte 69,15,94,236 // divps %xmm12,%xmm13 .byte 69,15,88,233 // addps %xmm9,%xmm13 - .byte 68,15,89,45,43,46,0,0 // mulps 0x2e2b(%rip),%xmm13 # 5f10 <_sk_callback_sse2+0x9e5> + .byte 68,15,89,45,50,46,0,0 // mulps 0x2e32(%rip),%xmm13 # 5f20 <_sk_callback_sse2+0x9ec> .byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9 .byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12 .byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12 @@ -32546,29 +32400,29 @@ HIDDEN _sk_lab_to_xyz_sse2 .globl _sk_lab_to_xyz_sse2 FUNCTION(_sk_lab_to_xyz_sse2) _sk_lab_to_xyz_sse2: - .byte 15,89,5,8,46,0,0 // mulps 0x2e08(%rip),%xmm0 # 5f20 <_sk_callback_sse2+0x9f5> - .byte 68,15,40,5,16,46,0,0 // movaps 0x2e10(%rip),%xmm8 # 5f30 <_sk_callback_sse2+0xa05> + .byte 15,89,5,15,46,0,0 // mulps 0x2e0f(%rip),%xmm0 # 5f30 <_sk_callback_sse2+0x9fc> + .byte 68,15,40,5,23,46,0,0 // movaps 0x2e17(%rip),%xmm8 # 5f40 <_sk_callback_sse2+0xa0c> .byte 65,15,89,200 // mulps %xmm8,%xmm1 - .byte 68,15,40,13,20,46,0,0 // movaps 0x2e14(%rip),%xmm9 # 5f40 <_sk_callback_sse2+0xa15> + .byte 68,15,40,13,27,46,0,0 // movaps 0x2e1b(%rip),%xmm9 # 5f50 <_sk_callback_sse2+0xa1c> .byte 65,15,88,201 // addps %xmm9,%xmm1 .byte 65,15,89,208 // mulps %xmm8,%xmm2 .byte 65,15,88,209 // addps %xmm9,%xmm2 - .byte 15,88,5,17,46,0,0 // addps 0x2e11(%rip),%xmm0 # 5f50 <_sk_callback_sse2+0xa25> - .byte 15,89,5,26,46,0,0 // mulps 0x2e1a(%rip),%xmm0 # 5f60 <_sk_callback_sse2+0xa35> - .byte 15,89,13,35,46,0,0 // mulps 0x2e23(%rip),%xmm1 # 5f70 <_sk_callback_sse2+0xa45> + .byte 15,88,5,24,46,0,0 // addps 0x2e18(%rip),%xmm0 # 5f60 <_sk_callback_sse2+0xa2c> + .byte 15,89,5,33,46,0,0 // mulps 0x2e21(%rip),%xmm0 # 5f70 <_sk_callback_sse2+0xa3c> + .byte 15,89,13,42,46,0,0 // mulps 0x2e2a(%rip),%xmm1 # 5f80 <_sk_callback_sse2+0xa4c> .byte 15,88,200 // addps %xmm0,%xmm1 - .byte 15,89,21,41,46,0,0 // mulps 0x2e29(%rip),%xmm2 # 5f80 <_sk_callback_sse2+0xa55> + .byte 15,89,21,48,46,0,0 // mulps 0x2e30(%rip),%xmm2 # 5f90 <_sk_callback_sse2+0xa5c> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 68,15,92,202 // subps %xmm2,%xmm9 .byte 68,15,40,225 // movaps %xmm1,%xmm12 .byte 69,15,89,228 // mulps %xmm12,%xmm12 .byte 68,15,89,225 // mulps %xmm1,%xmm12 - .byte 15,40,21,30,46,0,0 // movaps 0x2e1e(%rip),%xmm2 # 5f90 <_sk_callback_sse2+0xa65> + .byte 15,40,21,37,46,0,0 // movaps 0x2e25(%rip),%xmm2 # 5fa0 <_sk_callback_sse2+0xa6c> .byte 68,15,40,194 // movaps %xmm2,%xmm8 .byte 69,15,194,196,1 // cmpltps %xmm12,%xmm8 - .byte 68,15,40,21,29,46,0,0 // movaps 0x2e1d(%rip),%xmm10 # 5fa0 <_sk_callback_sse2+0xa75> + .byte 68,15,40,21,36,46,0,0 // movaps 0x2e24(%rip),%xmm10 # 5fb0 <_sk_callback_sse2+0xa7c> .byte 65,15,88,202 // addps %xmm10,%xmm1 - .byte 68,15,40,29,33,46,0,0 // movaps 0x2e21(%rip),%xmm11 # 5fb0 <_sk_callback_sse2+0xa85> + .byte 68,15,40,29,40,46,0,0 // movaps 0x2e28(%rip),%xmm11 # 5fc0 <_sk_callback_sse2+0xa8c> .byte 65,15,89,203 // mulps %xmm11,%xmm1 .byte 69,15,84,224 // andps %xmm8,%xmm12 .byte 68,15,85,193 // andnps %xmm1,%xmm8 @@ -32592,8 +32446,8 @@ _sk_lab_to_xyz_sse2: .byte 15,84,194 // andps %xmm2,%xmm0 .byte 65,15,85,209 // andnps %xmm9,%xmm2 .byte 15,86,208 // orps %xmm0,%xmm2 - .byte 68,15,89,5,209,45,0,0 // mulps 0x2dd1(%rip),%xmm8 # 5fc0 <_sk_callback_sse2+0xa95> - .byte 15,89,21,218,45,0,0 // mulps 0x2dda(%rip),%xmm2 # 5fd0 <_sk_callback_sse2+0xaa5> + .byte 68,15,89,5,216,45,0,0 // mulps 0x2dd8(%rip),%xmm8 # 5fd0 <_sk_callback_sse2+0xa9c> + .byte 15,89,21,225,45,0,0 // mulps 0x2de1(%rip),%xmm2 # 5fe0 <_sk_callback_sse2+0xaac> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -32605,13 +32459,13 @@ _sk_load_a8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,45 // jne 3235 <_sk_load_a8_sse2+0x37> + .byte 117,45 // jne 323e <_sk_load_a8_sse2+0x37> .byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0 .byte 102,15,96,192 // punpcklbw %xmm0,%xmm0 .byte 102,15,97,192 // punpcklwd %xmm0,%xmm0 - .byte 102,15,219,5,194,45,0,0 // pand 0x2dc2(%rip),%xmm0 # 5fe0 <_sk_callback_sse2+0xab5> + .byte 102,15,219,5,201,45,0,0 // pand 0x2dc9(%rip),%xmm0 # 5ff0 <_sk_callback_sse2+0xabc> .byte 15,91,216 // cvtdq2ps %xmm0,%xmm3 - .byte 15,89,29,200,45,0,0 // mulps 0x2dc8(%rip),%xmm3 # 5ff0 <_sk_callback_sse2+0xac5> + .byte 15,89,29,207,45,0,0 // mulps 0x2dcf(%rip),%xmm3 # 6000 <_sk_callback_sse2+0xacc> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 @@ -32621,11 +32475,11 @@ _sk_load_a8_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,48 // je 3276 <_sk_load_a8_sse2+0x78> + .byte 116,48 // je 327f <_sk_load_a8_sse2+0x78> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 3261 <_sk_load_a8_sse2+0x63> + .byte 116,21 // je 326a <_sk_load_a8_sse2+0x63> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,196 // jne 3216 <_sk_load_a8_sse2+0x18> + .byte 117,196 // jne 321f <_sk_load_a8_sse2+0x18> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0 @@ -32637,7 +32491,7 @@ _sk_load_a8_sse2: .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,15,110,200 // movd %eax,%xmm1 .byte 243,15,16,193 // movss %xmm1,%xmm0 - .byte 235,145 // jmp 3216 <_sk_load_a8_sse2+0x18> + .byte 235,145 // jmp 321f <_sk_load_a8_sse2+0x18> HIDDEN _sk_gather_a8_sse2 .globl _sk_gather_a8_sse2 @@ -32679,7 +32533,7 @@ _sk_gather_a8_sse2: .byte 102,15,96,193 // punpcklbw %xmm1,%xmm0 .byte 102,15,97,193 // punpcklwd %xmm1,%xmm0 .byte 15,91,216 // cvtdq2ps %xmm0,%xmm3 - .byte 15,89,29,232,44,0,0 // mulps 0x2ce8(%rip),%xmm3 # 6000 <_sk_callback_sse2+0xad5> + .byte 15,89,29,239,44,0,0 // mulps 0x2cef(%rip),%xmm3 # 6010 <_sk_callback_sse2+0xadc> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 @@ -32694,7 +32548,7 @@ FUNCTION(_sk_store_a8_sse2) _sk_store_a8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 - .byte 68,15,40,5,218,44,0,0 // movaps 0x2cda(%rip),%xmm8 # 6010 <_sk_callback_sse2+0xae5> + .byte 68,15,40,5,225,44,0,0 // movaps 0x2ce1(%rip),%xmm8 # 6020 <_sk_callback_sse2+0xaec> .byte 68,15,89,195 // mulps %xmm3,%xmm8 .byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8 .byte 102,65,15,114,240,16 // pslld $0x10,%xmm8 @@ -32702,7 +32556,7 @@ _sk_store_a8_sse2: .byte 102,69,15,107,192 // packssdw %xmm8,%xmm8 .byte 102,69,15,103,192 // packuswb %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,13 // jne 3367 <_sk_store_a8_sse2+0x3e> + .byte 117,13 // jne 3370 <_sk_store_a8_sse2+0x3e> .byte 102,68,15,126,192 // movd %xmm8,%eax .byte 65,137,4,18 // mov %eax,(%r10,%rdx,1) .byte 72,173 // lods %ds:(%rsi),%rax @@ -32712,11 +32566,11 @@ _sk_store_a8_sse2: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,44 // je 33aa <_sk_store_a8_sse2+0x81> + .byte 116,44 // je 33b3 <_sk_store_a8_sse2+0x81> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,22 // je 339a <_sk_store_a8_sse2+0x71> + .byte 116,22 // je 33a3 <_sk_store_a8_sse2+0x71> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,217 // jne 3363 <_sk_store_a8_sse2+0x3a> + .byte 117,217 // jne 336c <_sk_store_a8_sse2+0x3a> .byte 102,68,15,127,68,36,232 // movdqa %xmm8,-0x18(%rsp) .byte 138,68,36,240 // mov -0x10(%rsp),%al .byte 65,136,68,18,2 // mov %al,0x2(%r10,%rdx,1) @@ -32726,7 +32580,7 @@ _sk_store_a8_sse2: .byte 102,68,15,127,68,36,200 // movdqa %xmm8,-0x38(%rsp) .byte 138,68,36,200 // mov -0x38(%rsp),%al .byte 65,136,4,18 // mov %al,(%r10,%rdx,1) - .byte 235,168 // jmp 3363 <_sk_store_a8_sse2+0x3a> + .byte 235,168 // jmp 336c <_sk_store_a8_sse2+0x3a> HIDDEN _sk_load_g8_sse2 .globl _sk_load_g8_sse2 @@ -32735,15 +32589,15 @@ _sk_load_g8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,49 // jne 33f6 <_sk_load_g8_sse2+0x3b> + .byte 117,49 // jne 33ff <_sk_load_g8_sse2+0x3b> .byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0 .byte 102,15,96,192 // punpcklbw %xmm0,%xmm0 .byte 102,15,97,192 // punpcklwd %xmm0,%xmm0 - .byte 102,15,219,5,69,44,0,0 // pand 0x2c45(%rip),%xmm0 # 6020 <_sk_callback_sse2+0xaf5> + .byte 102,15,219,5,76,44,0,0 // pand 0x2c4c(%rip),%xmm0 # 6030 <_sk_callback_sse2+0xafc> .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,75,44,0,0 // mulps 0x2c4b(%rip),%xmm0 # 6030 <_sk_callback_sse2+0xb05> + .byte 15,89,5,82,44,0,0 // mulps 0x2c52(%rip),%xmm0 # 6040 <_sk_callback_sse2+0xb0c> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,82,44,0,0 // movaps 0x2c52(%rip),%xmm3 # 6040 <_sk_callback_sse2+0xb15> + .byte 15,40,29,89,44,0,0 // movaps 0x2c59(%rip),%xmm3 # 6050 <_sk_callback_sse2+0xb1c> .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 255,224 // jmpq *%rax @@ -32751,11 +32605,11 @@ _sk_load_g8_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,48 // je 3437 <_sk_load_g8_sse2+0x7c> + .byte 116,48 // je 3440 <_sk_load_g8_sse2+0x7c> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 3422 <_sk_load_g8_sse2+0x67> + .byte 116,21 // je 342b <_sk_load_g8_sse2+0x67> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,192 // jne 33d3 <_sk_load_g8_sse2+0x18> + .byte 117,192 // jne 33dc <_sk_load_g8_sse2+0x18> .byte 65,15,182,68,18,2 // movzbl 0x2(%r10,%rdx,1),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,192,69 // pshufd $0x45,%xmm0,%xmm0 @@ -32767,7 +32621,7 @@ _sk_load_g8_sse2: .byte 65,15,182,4,18 // movzbl (%r10,%rdx,1),%eax .byte 102,15,110,200 // movd %eax,%xmm1 .byte 243,15,16,193 // movss %xmm1,%xmm0 - .byte 235,141 // jmp 33d3 <_sk_load_g8_sse2+0x18> + .byte 235,141 // jmp 33dc <_sk_load_g8_sse2+0x18> HIDDEN _sk_gather_g8_sse2 .globl _sk_gather_g8_sse2 @@ -32809,9 +32663,9 @@ _sk_gather_g8_sse2: .byte 102,15,96,193 // punpcklbw %xmm1,%xmm0 .byte 102,15,97,193 // punpcklwd %xmm1,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,119,43,0,0 // mulps 0x2b77(%rip),%xmm0 # 6050 <_sk_callback_sse2+0xb25> + .byte 15,89,5,126,43,0,0 // mulps 0x2b7e(%rip),%xmm0 # 6060 <_sk_callback_sse2+0xb2c> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,126,43,0,0 // movaps 0x2b7e(%rip),%xmm3 # 6060 <_sk_callback_sse2+0xb35> + .byte 15,40,29,133,43,0,0 // movaps 0x2b85(%rip),%xmm3 # 6070 <_sk_callback_sse2+0xb3c> .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 .byte 91 // pop %rbx @@ -32825,9 +32679,9 @@ _sk_gather_i8_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 73,137,193 // mov %rax,%r9 .byte 77,133,201 // test %r9,%r9 - .byte 116,5 // je 34fb <_sk_gather_i8_sse2+0xf> + .byte 116,5 // je 3504 <_sk_gather_i8_sse2+0xf> .byte 76,137,200 // mov %r9,%rax - .byte 235,2 // jmp 34fd <_sk_gather_i8_sse2+0x11> + .byte 235,2 // jmp 3506 <_sk_gather_i8_sse2+0x11> .byte 72,173 // lods %ds:(%rsi),%rax .byte 85 // push %rbp .byte 65,86 // push %r14 @@ -32879,11 +32733,11 @@ _sk_gather_i8_sse2: .byte 102,66,15,110,76,149,0 // movd 0x0(%rbp,%r10,4),%xmm1 .byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9 .byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9 - .byte 102,15,111,21,151,42,0,0 // movdqa 0x2a97(%rip),%xmm2 # 6070 <_sk_callback_sse2+0xb45> + .byte 102,15,111,21,158,42,0,0 // movdqa 0x2a9e(%rip),%xmm2 # 6080 <_sk_callback_sse2+0xb4c> .byte 102,65,15,111,193 // movdqa %xmm9,%xmm0 .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,147,42,0,0 // movaps 0x2a93(%rip),%xmm8 # 6080 <_sk_callback_sse2+0xb55> + .byte 68,15,40,5,154,42,0,0 // movaps 0x2a9a(%rip),%xmm8 # 6090 <_sk_callback_sse2+0xb5c> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1 .byte 102,15,114,209,8 // psrld $0x8,%xmm1 @@ -32911,32 +32765,32 @@ _sk_load_565_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,83 // jne 368e <_sk_load_565_sse2+0x5d> + .byte 117,83 // jne 3697 <_sk_load_565_sse2+0x5d> .byte 243,65,15,126,20,82 // movq (%r10,%rdx,2),%xmm2 .byte 102,15,97,208 // punpcklwd %xmm0,%xmm2 - .byte 102,15,111,5,67,42,0,0 // movdqa 0x2a43(%rip),%xmm0 # 6090 <_sk_callback_sse2+0xb65> + .byte 102,15,111,5,74,42,0,0 // movdqa 0x2a4a(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xb6c> .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,69,42,0,0 // mulps 0x2a45(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xb75> - .byte 102,15,111,13,77,42,0,0 // movdqa 0x2a4d(%rip),%xmm1 # 60b0 <_sk_callback_sse2+0xb85> + .byte 15,89,5,76,42,0,0 // mulps 0x2a4c(%rip),%xmm0 # 60b0 <_sk_callback_sse2+0xb7c> + .byte 102,15,111,13,84,42,0,0 // movdqa 0x2a54(%rip),%xmm1 # 60c0 <_sk_callback_sse2+0xb8c> .byte 102,15,219,202 // pand %xmm2,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,79,42,0,0 // mulps 0x2a4f(%rip),%xmm1 # 60c0 <_sk_callback_sse2+0xb95> - .byte 102,15,219,21,87,42,0,0 // pand 0x2a57(%rip),%xmm2 # 60d0 <_sk_callback_sse2+0xba5> + .byte 15,89,13,86,42,0,0 // mulps 0x2a56(%rip),%xmm1 # 60d0 <_sk_callback_sse2+0xb9c> + .byte 102,15,219,21,94,42,0,0 // pand 0x2a5e(%rip),%xmm2 # 60e0 <_sk_callback_sse2+0xbac> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,93,42,0,0 // mulps 0x2a5d(%rip),%xmm2 # 60e0 <_sk_callback_sse2+0xbb5> + .byte 15,89,21,100,42,0,0 // mulps 0x2a64(%rip),%xmm2 # 60f0 <_sk_callback_sse2+0xbbc> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,100,42,0,0 // movaps 0x2a64(%rip),%xmm3 # 60f0 <_sk_callback_sse2+0xbc5> + .byte 15,40,29,107,42,0,0 // movaps 0x2a6b(%rip),%xmm3 # 6100 <_sk_callback_sse2+0xbcc> .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,210 // pxor %xmm2,%xmm2 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,48 // je 36cf <_sk_load_565_sse2+0x9e> + .byte 116,48 // je 36d8 <_sk_load_565_sse2+0x9e> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 36ba <_sk_load_565_sse2+0x89> + .byte 116,21 // je 36c3 <_sk_load_565_sse2+0x89> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,154 // jne 3645 <_sk_load_565_sse2+0x14> + .byte 117,154 // jne 364e <_sk_load_565_sse2+0x14> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2 @@ -32948,7 +32802,7 @@ _sk_load_565_sse2: .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 243,15,16,208 // movss %xmm0,%xmm2 - .byte 233,100,255,255,255 // jmpq 3645 <_sk_load_565_sse2+0x14> + .byte 233,100,255,255,255 // jmpq 364e <_sk_load_565_sse2+0x14> HIDDEN _sk_gather_565_sse2 .globl _sk_gather_565_sse2 @@ -32983,19 +32837,19 @@ _sk_gather_565_sse2: .byte 102,15,196,208,3 // pinsrw $0x3,%eax,%xmm2 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 102,15,97,208 // punpcklwd %xmm0,%xmm2 - .byte 102,15,111,5,153,41,0,0 // movdqa 0x2999(%rip),%xmm0 # 6100 <_sk_callback_sse2+0xbd5> + .byte 102,15,111,5,160,41,0,0 // movdqa 0x29a0(%rip),%xmm0 # 6110 <_sk_callback_sse2+0xbdc> .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,155,41,0,0 // mulps 0x299b(%rip),%xmm0 # 6110 <_sk_callback_sse2+0xbe5> - .byte 102,15,111,13,163,41,0,0 // movdqa 0x29a3(%rip),%xmm1 # 6120 <_sk_callback_sse2+0xbf5> + .byte 15,89,5,162,41,0,0 // mulps 0x29a2(%rip),%xmm0 # 6120 <_sk_callback_sse2+0xbec> + .byte 102,15,111,13,170,41,0,0 // movdqa 0x29aa(%rip),%xmm1 # 6130 <_sk_callback_sse2+0xbfc> .byte 102,15,219,202 // pand %xmm2,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,165,41,0,0 // mulps 0x29a5(%rip),%xmm1 # 6130 <_sk_callback_sse2+0xc05> - .byte 102,15,219,21,173,41,0,0 // pand 0x29ad(%rip),%xmm2 # 6140 <_sk_callback_sse2+0xc15> + .byte 15,89,13,172,41,0,0 // mulps 0x29ac(%rip),%xmm1 # 6140 <_sk_callback_sse2+0xc0c> + .byte 102,15,219,21,180,41,0,0 // pand 0x29b4(%rip),%xmm2 # 6150 <_sk_callback_sse2+0xc1c> .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,179,41,0,0 // mulps 0x29b3(%rip),%xmm2 # 6150 <_sk_callback_sse2+0xc25> + .byte 15,89,21,186,41,0,0 // mulps 0x29ba(%rip),%xmm2 # 6160 <_sk_callback_sse2+0xc2c> .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,186,41,0,0 // movaps 0x29ba(%rip),%xmm3 # 6160 <_sk_callback_sse2+0xc35> + .byte 15,40,29,193,41,0,0 // movaps 0x29c1(%rip),%xmm3 # 6170 <_sk_callback_sse2+0xc3c> .byte 91 // pop %rbx .byte 255,224 // jmpq *%rax @@ -33005,12 +32859,12 @@ FUNCTION(_sk_store_565_sse2) _sk_store_565_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 - .byte 68,15,40,5,186,41,0,0 // movaps 0x29ba(%rip),%xmm8 # 6170 <_sk_callback_sse2+0xc45> + .byte 68,15,40,5,193,41,0,0 // movaps 0x29c1(%rip),%xmm8 # 6180 <_sk_callback_sse2+0xc4c> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 .byte 102,65,15,114,241,11 // pslld $0xb,%xmm9 - .byte 68,15,40,21,175,41,0,0 // movaps 0x29af(%rip),%xmm10 # 6180 <_sk_callback_sse2+0xc55> + .byte 68,15,40,21,182,41,0,0 // movaps 0x29b6(%rip),%xmm10 # 6190 <_sk_callback_sse2+0xc5c> .byte 68,15,89,209 // mulps %xmm1,%xmm10 .byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10 .byte 102,65,15,114,242,5 // pslld $0x5,%xmm10 @@ -33022,7 +32876,7 @@ _sk_store_565_sse2: .byte 102,65,15,114,224,16 // psrad $0x10,%xmm8 .byte 102,69,15,107,192 // packssdw %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3813 <_sk_store_565_sse2+0x6a> + .byte 117,10 // jne 381c <_sk_store_565_sse2+0x6a> .byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -33030,18 +32884,18 @@ _sk_store_565_sse2: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,36 // je 3849 <_sk_store_565_sse2+0xa0> + .byte 116,36 // je 3852 <_sk_store_565_sse2+0xa0> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,18 // je 383d <_sk_store_565_sse2+0x94> + .byte 116,18 // je 3846 <_sk_store_565_sse2+0x94> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,222 // jne 380f <_sk_store_565_sse2+0x66> + .byte 117,222 // jne 3818 <_sk_store_565_sse2+0x66> .byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax .byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2) .byte 102,65,15,197,192,2 // pextrw $0x2,%xmm8,%eax .byte 102,65,137,68,82,2 // mov %ax,0x2(%r10,%rdx,2) .byte 102,68,15,126,192 // movd %xmm8,%eax .byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2) - .byte 235,186 // jmp 380f <_sk_store_565_sse2+0x66> + .byte 235,186 // jmp 3818 <_sk_store_565_sse2+0x66> HIDDEN _sk_load_4444_sse2 .globl _sk_load_4444_sse2 @@ -33050,35 +32904,35 @@ _sk_load_4444_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 .byte 77,133,192 // test %r8,%r8 - .byte 117,98 // jne 38c1 <_sk_load_4444_sse2+0x6c> + .byte 117,98 // jne 38ca <_sk_load_4444_sse2+0x6c> .byte 243,65,15,126,28,82 // movq (%r10,%rdx,2),%xmm3 .byte 102,15,97,216 // punpcklwd %xmm0,%xmm3 - .byte 102,15,111,5,31,41,0,0 // movdqa 0x291f(%rip),%xmm0 # 6190 <_sk_callback_sse2+0xc65> + .byte 102,15,111,5,38,41,0,0 // movdqa 0x2926(%rip),%xmm0 # 61a0 <_sk_callback_sse2+0xc6c> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,33,41,0,0 // mulps 0x2921(%rip),%xmm0 # 61a0 <_sk_callback_sse2+0xc75> - .byte 102,15,111,13,41,41,0,0 // movdqa 0x2929(%rip),%xmm1 # 61b0 <_sk_callback_sse2+0xc85> + .byte 15,89,5,40,41,0,0 // mulps 0x2928(%rip),%xmm0 # 61b0 <_sk_callback_sse2+0xc7c> + .byte 102,15,111,13,48,41,0,0 // movdqa 0x2930(%rip),%xmm1 # 61c0 <_sk_callback_sse2+0xc8c> .byte 102,15,219,203 // pand %xmm3,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,43,41,0,0 // mulps 0x292b(%rip),%xmm1 # 61c0 <_sk_callback_sse2+0xc95> - .byte 102,15,111,21,51,41,0,0 // movdqa 0x2933(%rip),%xmm2 # 61d0 <_sk_callback_sse2+0xca5> + .byte 15,89,13,50,41,0,0 // mulps 0x2932(%rip),%xmm1 # 61d0 <_sk_callback_sse2+0xc9c> + .byte 102,15,111,21,58,41,0,0 // movdqa 0x293a(%rip),%xmm2 # 61e0 <_sk_callback_sse2+0xcac> .byte 102,15,219,211 // pand %xmm3,%xmm2 .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,53,41,0,0 // mulps 0x2935(%rip),%xmm2 # 61e0 <_sk_callback_sse2+0xcb5> - .byte 102,15,219,29,61,41,0,0 // pand 0x293d(%rip),%xmm3 # 61f0 <_sk_callback_sse2+0xcc5> + .byte 15,89,21,60,41,0,0 // mulps 0x293c(%rip),%xmm2 # 61f0 <_sk_callback_sse2+0xcbc> + .byte 102,15,219,29,68,41,0,0 // pand 0x2944(%rip),%xmm3 # 6200 <_sk_callback_sse2+0xccc> .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,67,41,0,0 // mulps 0x2943(%rip),%xmm3 # 6200 <_sk_callback_sse2+0xcd5> + .byte 15,89,29,74,41,0,0 // mulps 0x294a(%rip),%xmm3 # 6210 <_sk_callback_sse2+0xcdc> .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 102,15,239,219 // pxor %xmm3,%xmm3 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,48 // je 3902 <_sk_load_4444_sse2+0xad> + .byte 116,48 // je 390b <_sk_load_4444_sse2+0xad> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,21 // je 38ed <_sk_load_4444_sse2+0x98> + .byte 116,21 // je 38f6 <_sk_load_4444_sse2+0x98> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,139 // jne 3869 <_sk_load_4444_sse2+0x14> + .byte 117,139 // jne 3872 <_sk_load_4444_sse2+0x14> .byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3 @@ -33090,7 +32944,7 @@ _sk_load_4444_sse2: .byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax .byte 102,15,110,192 // movd %eax,%xmm0 .byte 243,15,16,216 // movss %xmm0,%xmm3 - .byte 233,85,255,255,255 // jmpq 3869 <_sk_load_4444_sse2+0x14> + .byte 233,85,255,255,255 // jmpq 3872 <_sk_load_4444_sse2+0x14> HIDDEN _sk_gather_4444_sse2 .globl _sk_gather_4444_sse2 @@ -33125,21 +32979,21 @@ _sk_gather_4444_sse2: .byte 102,15,196,216,3 // pinsrw $0x3,%eax,%xmm3 .byte 102,15,239,192 // pxor %xmm0,%xmm0 .byte 102,15,97,216 // punpcklwd %xmm0,%xmm3 - .byte 102,15,111,5,118,40,0,0 // movdqa 0x2876(%rip),%xmm0 # 6210 <_sk_callback_sse2+0xce5> + .byte 102,15,111,5,125,40,0,0 // movdqa 0x287d(%rip),%xmm0 # 6220 <_sk_callback_sse2+0xcec> .byte 102,15,219,195 // pand %xmm3,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 15,89,5,120,40,0,0 // mulps 0x2878(%rip),%xmm0 # 6220 <_sk_callback_sse2+0xcf5> - .byte 102,15,111,13,128,40,0,0 // movdqa 0x2880(%rip),%xmm1 # 6230 <_sk_callback_sse2+0xd05> + .byte 15,89,5,127,40,0,0 // mulps 0x287f(%rip),%xmm0 # 6230 <_sk_callback_sse2+0xcfc> + .byte 102,15,111,13,135,40,0,0 // movdqa 0x2887(%rip),%xmm1 # 6240 <_sk_callback_sse2+0xd0c> .byte 102,15,219,203 // pand %xmm3,%xmm1 .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1 - .byte 15,89,13,130,40,0,0 // mulps 0x2882(%rip),%xmm1 # 6240 <_sk_callback_sse2+0xd15> - .byte 102,15,111,21,138,40,0,0 // movdqa 0x288a(%rip),%xmm2 # 6250 <_sk_callback_sse2+0xd25> + .byte 15,89,13,137,40,0,0 // mulps 0x2889(%rip),%xmm1 # 6250 <_sk_callback_sse2+0xd1c> + .byte 102,15,111,21,145,40,0,0 // movdqa 0x2891(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xd2c> .byte 102,15,219,211 // pand %xmm3,%xmm2 .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 - .byte 15,89,21,140,40,0,0 // mulps 0x288c(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xd35> - .byte 102,15,219,29,148,40,0,0 // pand 0x2894(%rip),%xmm3 # 6270 <_sk_callback_sse2+0xd45> + .byte 15,89,21,147,40,0,0 // mulps 0x2893(%rip),%xmm2 # 6270 <_sk_callback_sse2+0xd3c> + .byte 102,15,219,29,155,40,0,0 // pand 0x289b(%rip),%xmm3 # 6280 <_sk_callback_sse2+0xd4c> .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3 - .byte 15,89,29,154,40,0,0 // mulps 0x289a(%rip),%xmm3 # 6280 <_sk_callback_sse2+0xd55> + .byte 15,89,29,161,40,0,0 // mulps 0x28a1(%rip),%xmm3 # 6290 <_sk_callback_sse2+0xd5c> .byte 72,173 // lods %ds:(%rsi),%rax .byte 91 // pop %rbx .byte 255,224 // jmpq *%rax @@ -33150,7 +33004,7 @@ FUNCTION(_sk_store_4444_sse2) _sk_store_4444_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,16 // mov (%rax),%r10 - .byte 68,15,40,5,152,40,0,0 // movaps 0x2898(%rip),%xmm8 # 6290 <_sk_callback_sse2+0xd65> + .byte 68,15,40,5,159,40,0,0 // movaps 0x289f(%rip),%xmm8 # 62a0 <_sk_callback_sse2+0xd6c> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 @@ -33172,7 +33026,7 @@ _sk_store_4444_sse2: .byte 102,65,15,114,224,16 // psrad $0x10,%xmm8 .byte 102,69,15,107,192 // packssdw %xmm8,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3a69 <_sk_store_4444_sse2+0x7e> + .byte 117,10 // jne 3a72 <_sk_store_4444_sse2+0x7e> .byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -33180,18 +33034,18 @@ _sk_store_4444_sse2: .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,36 // je 3a9f <_sk_store_4444_sse2+0xb4> + .byte 116,36 // je 3aa8 <_sk_store_4444_sse2+0xb4> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,18 // je 3a93 <_sk_store_4444_sse2+0xa8> + .byte 116,18 // je 3a9c <_sk_store_4444_sse2+0xa8> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,222 // jne 3a65 <_sk_store_4444_sse2+0x7a> + .byte 117,222 // jne 3a6e <_sk_store_4444_sse2+0x7a> .byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax .byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2) .byte 102,65,15,197,192,2 // pextrw $0x2,%xmm8,%eax .byte 102,65,137,68,82,2 // mov %ax,0x2(%r10,%rdx,2) .byte 102,68,15,126,192 // movd %xmm8,%eax .byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2) - .byte 235,186 // jmp 3a65 <_sk_store_4444_sse2+0x7a> + .byte 235,186 // jmp 3a6e <_sk_store_4444_sse2+0x7a> HIDDEN _sk_load_8888_sse2 .globl _sk_load_8888_sse2 @@ -33200,13 +33054,13 @@ _sk_load_8888_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 117,98 // jne 3b17 <_sk_load_8888_sse2+0x6c> + .byte 117,98 // jne 3b20 <_sk_load_8888_sse2+0x6c> .byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9 - .byte 102,15,111,21,221,39,0,0 // movdqa 0x27dd(%rip),%xmm2 # 62a0 <_sk_callback_sse2+0xd75> + .byte 102,15,111,21,228,39,0,0 // movdqa 0x27e4(%rip),%xmm2 # 62b0 <_sk_callback_sse2+0xd7c> .byte 102,65,15,111,193 // movdqa %xmm9,%xmm0 .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,217,39,0,0 // movaps 0x27d9(%rip),%xmm8 # 62b0 <_sk_callback_sse2+0xd85> + .byte 68,15,40,5,224,39,0,0 // movaps 0x27e0(%rip),%xmm8 # 62c0 <_sk_callback_sse2+0xd8c> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1 .byte 102,15,114,209,8 // psrld $0x8,%xmm1 @@ -33227,11 +33081,11 @@ _sk_load_8888_sse2: .byte 65,128,225,3 // and $0x3,%r9b .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,44 // je 3b55 <_sk_load_8888_sse2+0xaa> + .byte 116,44 // je 3b5e <_sk_load_8888_sse2+0xaa> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,18 // je 3b41 <_sk_load_8888_sse2+0x96> + .byte 116,18 // je 3b4a <_sk_load_8888_sse2+0x96> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,134 // jne 3abb <_sk_load_8888_sse2+0x10> + .byte 117,134 // jne 3ac4 <_sk_load_8888_sse2+0x10> .byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0 .byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9 .byte 243,15,16,68,144,4 // movss 0x4(%rax,%rdx,4),%xmm0 @@ -33240,7 +33094,7 @@ _sk_load_8888_sse2: .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 243,15,16,4,144 // movss (%rax,%rdx,4),%xmm0 .byte 243,68,15,16,200 // movss %xmm0,%xmm9 - .byte 233,87,255,255,255 // jmpq 3abb <_sk_load_8888_sse2+0x10> + .byte 233,87,255,255,255 // jmpq 3ac4 <_sk_load_8888_sse2+0x10> HIDDEN _sk_gather_8888_sse2 .globl _sk_gather_8888_sse2 @@ -33274,11 +33128,11 @@ _sk_gather_8888_sse2: .byte 102,67,15,110,12,145 // movd (%r9,%r10,4),%xmm1 .byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9 .byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9 - .byte 102,15,111,21,218,38,0,0 // movdqa 0x26da(%rip),%xmm2 # 62c0 <_sk_callback_sse2+0xd95> + .byte 102,15,111,21,225,38,0,0 // movdqa 0x26e1(%rip),%xmm2 # 62d0 <_sk_callback_sse2+0xd9c> .byte 102,65,15,111,193 // movdqa %xmm9,%xmm0 .byte 102,15,219,194 // pand %xmm2,%xmm0 .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0 - .byte 68,15,40,5,214,38,0,0 // movaps 0x26d6(%rip),%xmm8 # 62d0 <_sk_callback_sse2+0xda5> + .byte 68,15,40,5,221,38,0,0 // movaps 0x26dd(%rip),%xmm8 # 62e0 <_sk_callback_sse2+0xdac> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1 .byte 102,15,114,209,8 // psrld $0x8,%xmm1 @@ -33303,7 +33157,7 @@ FUNCTION(_sk_store_8888_sse2) _sk_store_8888_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 68,15,40,5,152,38,0,0 // movaps 0x2698(%rip),%xmm8 # 62e0 <_sk_callback_sse2+0xdb5> + .byte 68,15,40,5,159,38,0,0 // movaps 0x269f(%rip),%xmm8 # 62f0 <_sk_callback_sse2+0xdbc> .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9 @@ -33322,24 +33176,24 @@ _sk_store_8888_sse2: .byte 102,69,15,235,193 // por %xmm9,%xmm8 .byte 102,69,15,235,194 // por %xmm10,%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,10 // jne 3ca8 <_sk_store_8888_sse2+0x6d> + .byte 117,10 // jne 3cb1 <_sk_store_8888_sse2+0x6d> .byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,3 // and $0x3,%r9b .byte 65,128,249,1 // cmp $0x1,%r9b - .byte 116,38 // je 3cdb <_sk_store_8888_sse2+0xa0> + .byte 116,38 // je 3ce4 <_sk_store_8888_sse2+0xa0> .byte 65,128,249,2 // cmp $0x2,%r9b - .byte 116,19 // je 3cce <_sk_store_8888_sse2+0x93> + .byte 116,19 // je 3cd7 <_sk_store_8888_sse2+0x93> .byte 65,128,249,3 // cmp $0x3,%r9b - .byte 117,227 // jne 3ca4 <_sk_store_8888_sse2+0x69> + .byte 117,227 // jne 3cad <_sk_store_8888_sse2+0x69> .byte 102,69,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm9 .byte 102,68,15,126,76,144,8 // movd %xmm9,0x8(%rax,%rdx,4) .byte 102,69,15,112,200,229 // pshufd $0xe5,%xmm8,%xmm9 .byte 102,68,15,126,76,144,4 // movd %xmm9,0x4(%rax,%rdx,4) .byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4) - .byte 235,193 // jmp 3ca4 <_sk_store_8888_sse2+0x69> + .byte 235,193 // jmp 3cad <_sk_store_8888_sse2+0x69> HIDDEN _sk_load_f16_sse2 .globl _sk_load_f16_sse2 @@ -33348,7 +33202,7 @@ _sk_load_f16_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,96,1,0,0 // jne 3e51 <_sk_load_f16_sse2+0x16e> + .byte 15,133,96,1,0,0 // jne 3e5a <_sk_load_f16_sse2+0x16e> .byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0 .byte 102,15,16,76,208,16 // movupd 0x10(%rax,%rdx,8),%xmm1 .byte 102,68,15,40,192 // movapd %xmm0,%xmm8 @@ -33360,7 +33214,7 @@ _sk_load_f16_sse2: .byte 102,69,15,239,210 // pxor %xmm10,%xmm10 .byte 102,65,15,111,206 // movdqa %xmm14,%xmm1 .byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1 - .byte 102,68,15,111,13,191,37,0,0 // movdqa 0x25bf(%rip),%xmm9 # 62f0 <_sk_callback_sse2+0xdc5> + .byte 102,68,15,111,13,198,37,0,0 // movdqa 0x25c6(%rip),%xmm9 # 6300 <_sk_callback_sse2+0xdcc> .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,65,15,219,193 // pand %xmm9,%xmm0 .byte 102,15,239,200 // pxor %xmm0,%xmm1 @@ -33368,11 +33222,11 @@ _sk_load_f16_sse2: .byte 102,68,15,111,233 // movdqa %xmm1,%xmm13 .byte 102,65,15,114,245,13 // pslld $0xd,%xmm13 .byte 102,68,15,235,232 // por %xmm0,%xmm13 - .byte 102,68,15,111,29,164,37,0,0 // movdqa 0x25a4(%rip),%xmm11 # 6300 <_sk_callback_sse2+0xdd5> + .byte 102,68,15,111,29,171,37,0,0 // movdqa 0x25ab(%rip),%xmm11 # 6310 <_sk_callback_sse2+0xddc> .byte 102,69,15,254,235 // paddd %xmm11,%xmm13 - .byte 102,68,15,111,37,166,37,0,0 // movdqa 0x25a6(%rip),%xmm12 # 6310 <_sk_callback_sse2+0xde5> + .byte 102,68,15,111,37,173,37,0,0 // movdqa 0x25ad(%rip),%xmm12 # 6320 <_sk_callback_sse2+0xdec> .byte 102,65,15,239,204 // pxor %xmm12,%xmm1 - .byte 102,15,111,29,169,37,0,0 // movdqa 0x25a9(%rip),%xmm3 # 6320 <_sk_callback_sse2+0xdf5> + .byte 102,15,111,29,176,37,0,0 // movdqa 0x25b0(%rip),%xmm3 # 6330 <_sk_callback_sse2+0xdfc> .byte 102,15,111,195 // movdqa %xmm3,%xmm0 .byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0 .byte 102,65,15,223,197 // pandn %xmm13,%xmm0 @@ -33420,17 +33274,17 @@ _sk_load_f16_sse2: .byte 255,224 // jmpq *%rax .byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,17 // jne 3e6d <_sk_load_f16_sse2+0x18a> + .byte 117,17 // jne 3e76 <_sk_load_f16_sse2+0x18a> .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 102,15,20,193 // unpcklpd %xmm1,%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 - .byte 233,143,254,255,255 // jmpq 3cfc <_sk_load_f16_sse2+0x19> + .byte 233,143,254,255,255 // jmpq 3d05 <_sk_load_f16_sse2+0x19> .byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,123,254,255,255 // jb 3cfc <_sk_load_f16_sse2+0x19> + .byte 15,130,123,254,255,255 // jb 3d05 <_sk_load_f16_sse2+0x19> .byte 242,15,16,76,208,16 // movsd 0x10(%rax,%rdx,8),%xmm1 - .byte 233,112,254,255,255 // jmpq 3cfc <_sk_load_f16_sse2+0x19> + .byte 233,112,254,255,255 // jmpq 3d05 <_sk_load_f16_sse2+0x19> HIDDEN _sk_gather_f16_sse2 .globl _sk_gather_f16_sse2 @@ -33472,7 +33326,7 @@ _sk_gather_f16_sse2: .byte 102,69,15,239,210 // pxor %xmm10,%xmm10 .byte 102,65,15,111,206 // movdqa %xmm14,%xmm1 .byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1 - .byte 102,68,15,111,13,251,35,0,0 // movdqa 0x23fb(%rip),%xmm9 # 6330 <_sk_callback_sse2+0xe05> + .byte 102,68,15,111,13,2,36,0,0 // movdqa 0x2402(%rip),%xmm9 # 6340 <_sk_callback_sse2+0xe0c> .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,65,15,219,193 // pand %xmm9,%xmm0 .byte 102,15,239,200 // pxor %xmm0,%xmm1 @@ -33480,11 +33334,11 @@ _sk_gather_f16_sse2: .byte 102,68,15,111,233 // movdqa %xmm1,%xmm13 .byte 102,65,15,114,245,13 // pslld $0xd,%xmm13 .byte 102,68,15,235,232 // por %xmm0,%xmm13 - .byte 102,68,15,111,29,224,35,0,0 // movdqa 0x23e0(%rip),%xmm11 # 6340 <_sk_callback_sse2+0xe15> + .byte 102,68,15,111,29,231,35,0,0 // movdqa 0x23e7(%rip),%xmm11 # 6350 <_sk_callback_sse2+0xe1c> .byte 102,69,15,254,235 // paddd %xmm11,%xmm13 - .byte 102,68,15,111,37,226,35,0,0 // movdqa 0x23e2(%rip),%xmm12 # 6350 <_sk_callback_sse2+0xe25> + .byte 102,68,15,111,37,233,35,0,0 // movdqa 0x23e9(%rip),%xmm12 # 6360 <_sk_callback_sse2+0xe2c> .byte 102,65,15,239,204 // pxor %xmm12,%xmm1 - .byte 102,15,111,29,229,35,0,0 // movdqa 0x23e5(%rip),%xmm3 # 6360 <_sk_callback_sse2+0xe35> + .byte 102,15,111,29,236,35,0,0 // movdqa 0x23ec(%rip),%xmm3 # 6370 <_sk_callback_sse2+0xe3c> .byte 102,15,111,195 // movdqa %xmm3,%xmm0 .byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0 .byte 102,65,15,223,197 // pandn %xmm13,%xmm0 @@ -33538,17 +33392,17 @@ FUNCTION(_sk_store_f16_sse2) _sk_store_f16_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 72,139,0 // mov (%rax),%rax - .byte 102,68,15,111,21,12,35,0,0 // movdqa 0x230c(%rip),%xmm10 # 6370 <_sk_callback_sse2+0xe45> + .byte 102,68,15,111,21,19,35,0,0 // movdqa 0x2313(%rip),%xmm10 # 6380 <_sk_callback_sse2+0xe4c> .byte 102,68,15,111,224 // movdqa %xmm0,%xmm12 .byte 102,69,15,219,226 // pand %xmm10,%xmm12 .byte 102,68,15,111,232 // movdqa %xmm0,%xmm13 .byte 102,69,15,239,236 // pxor %xmm12,%xmm13 - .byte 102,68,15,111,13,255,34,0,0 // movdqa 0x22ff(%rip),%xmm9 # 6380 <_sk_callback_sse2+0xe55> + .byte 102,68,15,111,13,6,35,0,0 // movdqa 0x2306(%rip),%xmm9 # 6390 <_sk_callback_sse2+0xe5c> .byte 102,65,15,114,212,16 // psrld $0x10,%xmm12 .byte 102,69,15,111,193 // movdqa %xmm9,%xmm8 .byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8 .byte 102,65,15,114,213,13 // psrld $0xd,%xmm13 - .byte 102,68,15,111,29,240,34,0,0 // movdqa 0x22f0(%rip),%xmm11 # 6390 <_sk_callback_sse2+0xe65> + .byte 102,68,15,111,29,247,34,0,0 // movdqa 0x22f7(%rip),%xmm11 # 63a0 <_sk_callback_sse2+0xe6c> .byte 102,69,15,235,227 // por %xmm11,%xmm12 .byte 102,69,15,254,229 // paddd %xmm13,%xmm12 .byte 102,65,15,114,244,16 // pslld $0x10,%xmm12 @@ -33600,7 +33454,7 @@ _sk_store_f16_sse2: .byte 102,69,15,111,200 // movdqa %xmm8,%xmm9 .byte 102,69,15,98,204 // punpckldq %xmm12,%xmm9 .byte 77,133,192 // test %r8,%r8 - .byte 117,21 // jne 41c2 <_sk_store_f16_sse2+0x16c> + .byte 117,21 // jne 41cb <_sk_store_f16_sse2+0x16c> .byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8) .byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8 .byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8) @@ -33608,13 +33462,13 @@ _sk_store_f16_sse2: .byte 255,224 // jmpq *%rax .byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 41be <_sk_store_f16_sse2+0x168> + .byte 116,240 // je 41c7 <_sk_store_f16_sse2+0x168> .byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 41be <_sk_store_f16_sse2+0x168> + .byte 114,227 // jb 41c7 <_sk_store_f16_sse2+0x168> .byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8 .byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8) - .byte 235,213 // jmp 41be <_sk_store_f16_sse2+0x168> + .byte 235,213 // jmp 41c7 <_sk_store_f16_sse2+0x168> HIDDEN _sk_load_u16_be_sse2 .globl _sk_load_u16_be_sse2 @@ -33624,7 +33478,7 @@ _sk_load_u16_be_sse2: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,190,0,0,0 // jne 42bd <_sk_load_u16_be_sse2+0xd4> + .byte 15,133,190,0,0,0 // jne 42c6 <_sk_load_u16_be_sse2+0xd4> .byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0 .byte 102,65,15,16,76,65,16 // movupd 0x10(%r9,%rax,2),%xmm1 .byte 102,15,40,208 // movapd %xmm0,%xmm2 @@ -33641,7 +33495,7 @@ _sk_load_u16_be_sse2: .byte 102,69,15,239,201 // pxor %xmm9,%xmm9 .byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1 .byte 15,91,193 // cvtdq2ps %xmm1,%xmm0 - .byte 68,15,40,5,80,33,0,0 // movaps 0x2150(%rip),%xmm8 # 63a0 <_sk_callback_sse2+0xe75> + .byte 68,15,40,5,87,33,0,0 // movaps 0x2157(%rip),%xmm8 # 63b0 <_sk_callback_sse2+0xe7c> .byte 65,15,89,192 // mulps %xmm8,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 .byte 102,15,113,241,8 // psllw $0x8,%xmm1 @@ -33669,17 +33523,17 @@ _sk_load_u16_be_sse2: .byte 255,224 // jmpq *%rax .byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,17 // jne 42da <_sk_load_u16_be_sse2+0xf1> + .byte 117,17 // jne 42e3 <_sk_load_u16_be_sse2+0xf1> .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 102,15,20,193 // unpcklpd %xmm1,%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 - .byte 233,50,255,255,255 // jmpq 420c <_sk_load_u16_be_sse2+0x23> + .byte 233,50,255,255,255 // jmpq 4215 <_sk_load_u16_be_sse2+0x23> .byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0 .byte 102,15,87,201 // xorpd %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 15,130,29,255,255,255 // jb 420c <_sk_load_u16_be_sse2+0x23> + .byte 15,130,29,255,255,255 // jb 4215 <_sk_load_u16_be_sse2+0x23> .byte 242,65,15,16,76,65,16 // movsd 0x10(%r9,%rax,2),%xmm1 - .byte 233,17,255,255,255 // jmpq 420c <_sk_load_u16_be_sse2+0x23> + .byte 233,17,255,255,255 // jmpq 4215 <_sk_load_u16_be_sse2+0x23> HIDDEN _sk_load_rgb_u16_be_sse2 .globl _sk_load_rgb_u16_be_sse2 @@ -33689,7 +33543,7 @@ _sk_load_rgb_u16_be_sse2: .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax .byte 77,133,192 // test %r8,%r8 - .byte 15,133,175,0,0,0 // jne 43bc <_sk_load_rgb_u16_be_sse2+0xc1> + .byte 15,133,175,0,0,0 // jne 43c5 <_sk_load_rgb_u16_be_sse2+0xc1> .byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2 .byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3 .byte 102,15,115,219,4 // psrldq $0x4,%xmm3 @@ -33710,7 +33564,7 @@ _sk_load_rgb_u16_be_sse2: .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 102,65,15,97,200 // punpcklwd %xmm8,%xmm1 .byte 15,91,193 // cvtdq2ps %xmm1,%xmm0 - .byte 68,15,40,13,63,32,0,0 // movaps 0x203f(%rip),%xmm9 # 63b0 <_sk_callback_sse2+0xe85> + .byte 68,15,40,13,70,32,0,0 // movaps 0x2046(%rip),%xmm9 # 63c0 <_sk_callback_sse2+0xe8c> .byte 65,15,89,193 // mulps %xmm9,%xmm0 .byte 102,15,111,203 // movdqa %xmm3,%xmm1 .byte 102,15,113,241,8 // psllw $0x8,%xmm1 @@ -33727,27 +33581,27 @@ _sk_load_rgb_u16_be_sse2: .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2 .byte 65,15,89,209 // mulps %xmm9,%xmm2 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 15,40,29,6,32,0,0 // movaps 0x2006(%rip),%xmm3 # 63c0 <_sk_callback_sse2+0xe95> + .byte 15,40,29,13,32,0,0 // movaps 0x200d(%rip),%xmm3 # 63d0 <_sk_callback_sse2+0xe9c> .byte 255,224 // jmpq *%rax .byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2 .byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,13 // jne 43e1 <_sk_load_rgb_u16_be_sse2+0xe6> + .byte 117,13 // jne 43ea <_sk_load_rgb_u16_be_sse2+0xe6> .byte 102,15,239,219 // pxor %xmm3,%xmm3 .byte 102,15,239,192 // pxor %xmm0,%xmm0 - .byte 233,80,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36> + .byte 233,80,255,255,255 // jmpq 433a <_sk_load_rgb_u16_be_sse2+0x36> .byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0 .byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,24 // jb 4412 <_sk_load_rgb_u16_be_sse2+0x117> + .byte 114,24 // jb 441b <_sk_load_rgb_u16_be_sse2+0x117> .byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3 .byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3 .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 233,31,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36> + .byte 233,31,255,255,255 // jmpq 433a <_sk_load_rgb_u16_be_sse2+0x36> .byte 102,15,239,219 // pxor %xmm3,%xmm3 - .byte 233,22,255,255,255 // jmpq 4331 <_sk_load_rgb_u16_be_sse2+0x36> + .byte 233,22,255,255,255 // jmpq 433a <_sk_load_rgb_u16_be_sse2+0x36> HIDDEN _sk_store_u16_be_sse2 .globl _sk_store_u16_be_sse2 @@ -33756,7 +33610,7 @@ _sk_store_u16_be_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,8 // mov (%rax),%r9 .byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax - .byte 68,15,40,21,160,31,0,0 // movaps 0x1fa0(%rip),%xmm10 # 63d0 <_sk_callback_sse2+0xea5> + .byte 68,15,40,21,167,31,0,0 // movaps 0x1fa7(%rip),%xmm10 # 63e0 <_sk_callback_sse2+0xeac> .byte 68,15,40,192 // movaps %xmm0,%xmm8 .byte 69,15,89,194 // mulps %xmm10,%xmm8 .byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8 @@ -33801,7 +33655,7 @@ _sk_store_u16_be_sse2: .byte 102,69,15,111,208 // movdqa %xmm8,%xmm10 .byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10 .byte 77,133,192 // test %r8,%r8 - .byte 117,21 // jne 452a <_sk_store_u16_be_sse2+0x10f> + .byte 117,21 // jne 4533 <_sk_store_u16_be_sse2+0x10f> .byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2) .byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8 .byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2) @@ -33809,13 +33663,13 @@ _sk_store_u16_be_sse2: .byte 255,224 // jmpq *%rax .byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2) .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,240 // je 4526 <_sk_store_u16_be_sse2+0x10b> + .byte 116,240 // je 452f <_sk_store_u16_be_sse2+0x10b> .byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,227 // jb 4526 <_sk_store_u16_be_sse2+0x10b> + .byte 114,227 // jb 452f <_sk_store_u16_be_sse2+0x10b> .byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8 .byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2) - .byte 235,213 // jmp 4526 <_sk_store_u16_be_sse2+0x10b> + .byte 235,213 // jmp 452f <_sk_store_u16_be_sse2+0x10b> HIDDEN _sk_load_f32_sse2 .globl _sk_load_f32_sse2 @@ -33828,7 +33682,7 @@ _sk_load_f32_sse2: .byte 72,193,224,4 // shl $0x4,%rax .byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 117,66 // jne 45b1 <_sk_load_f32_sse2+0x60> + .byte 117,66 // jne 45ba <_sk_load_f32_sse2+0x60> .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0 .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3 .byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9 @@ -33848,17 +33702,17 @@ _sk_load_f32_sse2: .byte 255,224 // jmpq *%rax .byte 69,15,87,201 // xorps %xmm9,%xmm9 .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 117,8 // jne 45c3 <_sk_load_f32_sse2+0x72> + .byte 117,8 // jne 45cc <_sk_load_f32_sse2+0x72> .byte 15,87,219 // xorps %xmm3,%xmm3 .byte 15,87,192 // xorps %xmm0,%xmm0 - .byte 235,190 // jmp 4581 <_sk_load_f32_sse2+0x30> + .byte 235,190 // jmp 458a <_sk_load_f32_sse2+0x30> .byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0 .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,8 // jb 45d7 <_sk_load_f32_sse2+0x86> + .byte 114,8 // jb 45e0 <_sk_load_f32_sse2+0x86> .byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3 - .byte 235,170 // jmp 4581 <_sk_load_f32_sse2+0x30> + .byte 235,170 // jmp 458a <_sk_load_f32_sse2+0x30> .byte 15,87,219 // xorps %xmm3,%xmm3 - .byte 235,165 // jmp 4581 <_sk_load_f32_sse2+0x30> + .byte 235,165 // jmp 458a <_sk_load_f32_sse2+0x30> HIDDEN _sk_store_f32_sse2 .globl _sk_store_f32_sse2 @@ -33884,7 +33738,7 @@ _sk_store_f32_sse2: .byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9 .byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1) .byte 77,133,192 // test %r8,%r8 - .byte 117,29 // jne 464e <_sk_store_f32_sse2+0x72> + .byte 117,29 // jne 4657 <_sk_store_f32_sse2+0x72> .byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10 .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4) .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4) @@ -33892,12 +33746,12 @@ _sk_store_f32_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax .byte 73,131,248,1 // cmp $0x1,%r8 - .byte 116,246 // je 464a <_sk_store_f32_sse2+0x6e> + .byte 116,246 // je 4653 <_sk_store_f32_sse2+0x6e> .byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4) .byte 73,131,248,3 // cmp $0x3,%r8 - .byte 114,234 // jb 464a <_sk_store_f32_sse2+0x6e> + .byte 114,234 // jb 4653 <_sk_store_f32_sse2+0x6e> .byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4) - .byte 235,225 // jmp 464a <_sk_store_f32_sse2+0x6e> + .byte 235,225 // jmp 4653 <_sk_store_f32_sse2+0x6e> HIDDEN _sk_clamp_x_sse2 .globl _sk_clamp_x_sse2 @@ -33939,7 +33793,7 @@ _sk_repeat_x_sse2: .byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10 .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 .byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9 - .byte 68,15,84,13,17,29,0,0 // andps 0x1d11(%rip),%xmm9 # 63e0 <_sk_callback_sse2+0xeb5> + .byte 68,15,84,13,24,29,0,0 // andps 0x1d18(%rip),%xmm9 # 63f0 <_sk_callback_sse2+0xebc> .byte 69,15,92,209 // subps %xmm9,%xmm10 .byte 69,15,89,208 // mulps %xmm8,%xmm10 .byte 65,15,92,194 // subps %xmm10,%xmm0 @@ -33958,7 +33812,7 @@ _sk_repeat_y_sse2: .byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10 .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 .byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9 - .byte 68,15,84,13,231,28,0,0 // andps 0x1ce7(%rip),%xmm9 # 63f0 <_sk_callback_sse2+0xec5> + .byte 68,15,84,13,238,28,0,0 // andps 0x1cee(%rip),%xmm9 # 6400 <_sk_callback_sse2+0xecc> .byte 69,15,92,209 // subps %xmm9,%xmm10 .byte 69,15,89,208 // mulps %xmm8,%xmm10 .byte 65,15,92,202 // subps %xmm10,%xmm1 @@ -33981,7 +33835,7 @@ _sk_mirror_x_sse2: .byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11 .byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11 .byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10 - .byte 68,15,84,21,171,28,0,0 // andps 0x1cab(%rip),%xmm10 # 6400 <_sk_callback_sse2+0xed5> + .byte 68,15,84,21,178,28,0,0 // andps 0x1cb2(%rip),%xmm10 # 6410 <_sk_callback_sse2+0xedc> .byte 69,15,87,228 // xorps %xmm12,%xmm12 .byte 69,15,92,218 // subps %xmm10,%xmm11 .byte 69,15,89,216 // mulps %xmm8,%xmm11 @@ -34008,7 +33862,7 @@ _sk_mirror_y_sse2: .byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11 .byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11 .byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10 - .byte 68,15,84,21,95,28,0,0 // andps 0x1c5f(%rip),%xmm10 # 6410 <_sk_callback_sse2+0xee5> + .byte 68,15,84,21,102,28,0,0 // andps 0x1c66(%rip),%xmm10 # 6420 <_sk_callback_sse2+0xeec> .byte 69,15,87,228 // xorps %xmm12,%xmm12 .byte 69,15,92,218 // subps %xmm10,%xmm11 .byte 69,15,89,216 // mulps %xmm8,%xmm11 @@ -34025,7 +33879,7 @@ FUNCTION(_sk_clamp_x_1_sse2) _sk_clamp_x_1_sse2: .byte 69,15,87,192 // xorps %xmm8,%xmm8 .byte 68,15,95,192 // maxps %xmm0,%xmm8 - .byte 68,15,93,5,63,28,0,0 // minps 0x1c3f(%rip),%xmm8 # 6420 <_sk_callback_sse2+0xef5> + .byte 68,15,93,5,70,28,0,0 // minps 0x1c46(%rip),%xmm8 # 6430 <_sk_callback_sse2+0xefc> .byte 72,173 // lods %ds:(%rsi),%rax .byte 65,15,40,192 // movaps %xmm8,%xmm0 .byte 255,224 // jmpq *%rax @@ -34038,7 +33892,7 @@ _sk_repeat_x_1_sse2: .byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8 .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9 - .byte 68,15,84,13,45,28,0,0 // andps 0x1c2d(%rip),%xmm9 # 6430 <_sk_callback_sse2+0xf05> + .byte 68,15,84,13,52,28,0,0 // andps 0x1c34(%rip),%xmm9 # 6440 <_sk_callback_sse2+0xf0c> .byte 69,15,92,193 // subps %xmm9,%xmm8 .byte 65,15,92,192 // subps %xmm8,%xmm0 .byte 72,173 // lods %ds:(%rsi),%rax @@ -34048,14 +33902,14 @@ HIDDEN _sk_mirror_x_1_sse2 .globl _sk_mirror_x_1_sse2 FUNCTION(_sk_mirror_x_1_sse2) _sk_mirror_x_1_sse2: - .byte 68,15,40,5,41,28,0,0 // movaps 0x1c29(%rip),%xmm8 # 6440 <_sk_callback_sse2+0xf15> + .byte 68,15,40,5,48,28,0,0 // movaps 0x1c30(%rip),%xmm8 # 6450 <_sk_callback_sse2+0xf1c> .byte 65,15,88,192 // addps %xmm8,%xmm0 - .byte 68,15,40,13,45,28,0,0 // movaps 0x1c2d(%rip),%xmm9 # 6450 <_sk_callback_sse2+0xf25> + .byte 68,15,40,13,52,28,0,0 // movaps 0x1c34(%rip),%xmm9 # 6460 <_sk_callback_sse2+0xf2c> .byte 68,15,89,200 // mulps %xmm0,%xmm9 .byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10 .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 .byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9 - .byte 68,15,84,13,35,28,0,0 // andps 0x1c23(%rip),%xmm9 # 6460 <_sk_callback_sse2+0xf35> + .byte 68,15,84,13,42,28,0,0 // andps 0x1c2a(%rip),%xmm9 # 6470 <_sk_callback_sse2+0xf3c> .byte 69,15,87,219 // xorps %xmm11,%xmm11 .byte 69,15,92,209 // subps %xmm9,%xmm10 .byte 69,15,88,210 // addps %xmm10,%xmm10 @@ -34071,10 +33925,10 @@ HIDDEN _sk_luminance_to_alpha_sse2 FUNCTION(_sk_luminance_to_alpha_sse2) _sk_luminance_to_alpha_sse2: .byte 15,40,218 // movaps %xmm2,%xmm3 - .byte 15,89,5,9,28,0,0 // mulps 0x1c09(%rip),%xmm0 # 6470 <_sk_callback_sse2+0xf45> - .byte 15,89,13,18,28,0,0 // mulps 0x1c12(%rip),%xmm1 # 6480 <_sk_callback_sse2+0xf55> + .byte 15,89,5,16,28,0,0 // mulps 0x1c10(%rip),%xmm0 # 6480 <_sk_callback_sse2+0xf4c> + .byte 15,89,13,25,28,0,0 // mulps 0x1c19(%rip),%xmm1 # 6490 <_sk_callback_sse2+0xf5c> .byte 15,88,200 // addps %xmm0,%xmm1 - .byte 15,89,29,24,28,0,0 // mulps 0x1c18(%rip),%xmm3 # 6490 <_sk_callback_sse2+0xf65> + .byte 15,89,29,31,28,0,0 // mulps 0x1c1f(%rip),%xmm3 # 64a0 <_sk_callback_sse2+0xf6c> .byte 15,88,217 // addps %xmm1,%xmm3 .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,87,192 // xorps %xmm0,%xmm0 @@ -34352,9 +34206,9 @@ _sk_evenly_spaced_gradient_sse2: .byte 72,139,24 // mov (%rax),%rbx .byte 76,139,112,8 // mov 0x8(%rax),%r14 .byte 72,255,203 // dec %rbx - .byte 120,7 // js 4cb4 <_sk_evenly_spaced_gradient_sse2+0x18> + .byte 120,7 // js 4cbd <_sk_evenly_spaced_gradient_sse2+0x18> .byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1 - .byte 235,21 // jmp 4cc9 <_sk_evenly_spaced_gradient_sse2+0x2d> + .byte 235,21 // jmp 4cd2 <_sk_evenly_spaced_gradient_sse2+0x2d> .byte 73,137,217 // mov %rbx,%r9 .byte 73,209,233 // shr %r9 .byte 131,227,1 // and $0x1,%ebx @@ -34452,15 +34306,15 @@ HIDDEN _sk_gauss_a_to_rgba_sse2 .globl _sk_gauss_a_to_rgba_sse2 FUNCTION(_sk_gauss_a_to_rgba_sse2) _sk_gauss_a_to_rgba_sse2: - .byte 15,40,5,75,22,0,0 // movaps 0x164b(%rip),%xmm0 # 64a0 <_sk_callback_sse2+0xf75> + .byte 15,40,5,82,22,0,0 // movaps 0x1652(%rip),%xmm0 # 64b0 <_sk_callback_sse2+0xf7c> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,81,22,0,0 // addps 0x1651(%rip),%xmm0 # 64b0 <_sk_callback_sse2+0xf85> + .byte 15,88,5,88,22,0,0 // addps 0x1658(%rip),%xmm0 # 64c0 <_sk_callback_sse2+0xf8c> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,87,22,0,0 // addps 0x1657(%rip),%xmm0 # 64c0 <_sk_callback_sse2+0xf95> + .byte 15,88,5,94,22,0,0 // addps 0x165e(%rip),%xmm0 # 64d0 <_sk_callback_sse2+0xf9c> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,93,22,0,0 // addps 0x165d(%rip),%xmm0 # 64d0 <_sk_callback_sse2+0xfa5> + .byte 15,88,5,100,22,0,0 // addps 0x1664(%rip),%xmm0 # 64e0 <_sk_callback_sse2+0xfac> .byte 15,89,195 // mulps %xmm3,%xmm0 - .byte 15,88,5,99,22,0,0 // addps 0x1663(%rip),%xmm0 # 64e0 <_sk_callback_sse2+0xfb5> + .byte 15,88,5,106,22,0,0 // addps 0x166a(%rip),%xmm0 # 64f0 <_sk_callback_sse2+0xfbc> .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,40,200 // movaps %xmm0,%xmm1 .byte 15,40,208 // movaps %xmm0,%xmm2 @@ -34478,12 +34332,12 @@ _sk_gradient_sse2: .byte 76,139,8 // mov (%rax),%r9 .byte 102,15,239,201 // pxor %xmm1,%xmm1 .byte 73,131,249,2 // cmp $0x2,%r9 - .byte 114,50 // jb 4ed0 <_sk_gradient_sse2+0x46> + .byte 114,50 // jb 4ed9 <_sk_gradient_sse2+0x46> .byte 72,139,88,72 // mov 0x48(%rax),%rbx .byte 73,255,201 // dec %r9 .byte 72,131,195,4 // add $0x4,%rbx .byte 102,15,239,201 // pxor %xmm1,%xmm1 - .byte 15,40,21,60,22,0,0 // movaps 0x163c(%rip),%xmm2 # 64f0 <_sk_callback_sse2+0xfc5> + .byte 15,40,21,67,22,0,0 // movaps 0x1643(%rip),%xmm2 # 6500 <_sk_callback_sse2+0xfcc> .byte 243,15,16,27 // movss (%rbx),%xmm3 .byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3 .byte 15,194,216,2 // cmpleps %xmm0,%xmm3 @@ -34491,7 +34345,7 @@ _sk_gradient_sse2: .byte 102,15,254,203 // paddd %xmm3,%xmm1 .byte 72,131,195,4 // add $0x4,%rbx .byte 73,255,201 // dec %r9 - .byte 117,228 // jne 4eb4 <_sk_gradient_sse2+0x2a> + .byte 117,228 // jne 4ebd <_sk_gradient_sse2+0x2a> .byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2 .byte 102,73,15,126,211 // movq %xmm2,%r11 .byte 69,137,217 // mov %r11d,%r9d @@ -34630,29 +34484,29 @@ _sk_xy_to_unit_angle_sse2: .byte 69,15,94,220 // divps %xmm12,%xmm11 .byte 69,15,40,227 // movaps %xmm11,%xmm12 .byte 69,15,89,228 // mulps %xmm12,%xmm12 - .byte 68,15,40,45,253,19,0,0 // movaps 0x13fd(%rip),%xmm13 # 6500 <_sk_callback_sse2+0xfd5> + .byte 68,15,40,45,4,20,0,0 // movaps 0x1404(%rip),%xmm13 # 6510 <_sk_callback_sse2+0xfdc> .byte 69,15,89,236 // mulps %xmm12,%xmm13 - .byte 68,15,88,45,1,20,0,0 // addps 0x1401(%rip),%xmm13 # 6510 <_sk_callback_sse2+0xfe5> + .byte 68,15,88,45,8,20,0,0 // addps 0x1408(%rip),%xmm13 # 6520 <_sk_callback_sse2+0xfec> .byte 69,15,89,236 // mulps %xmm12,%xmm13 - .byte 68,15,88,45,5,20,0,0 // addps 0x1405(%rip),%xmm13 # 6520 <_sk_callback_sse2+0xff5> + .byte 68,15,88,45,12,20,0,0 // addps 0x140c(%rip),%xmm13 # 6530 <_sk_callback_sse2+0xffc> .byte 69,15,89,236 // mulps %xmm12,%xmm13 - .byte 68,15,88,45,9,20,0,0 // addps 0x1409(%rip),%xmm13 # 6530 <_sk_callback_sse2+0x1005> + .byte 68,15,88,45,16,20,0,0 // addps 0x1410(%rip),%xmm13 # 6540 <_sk_callback_sse2+0x100c> .byte 69,15,89,235 // mulps %xmm11,%xmm13 .byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9 - .byte 68,15,40,21,8,20,0,0 // movaps 0x1408(%rip),%xmm10 # 6540 <_sk_callback_sse2+0x1015> + .byte 68,15,40,21,15,20,0,0 // movaps 0x140f(%rip),%xmm10 # 6550 <_sk_callback_sse2+0x101c> .byte 69,15,92,213 // subps %xmm13,%xmm10 .byte 69,15,84,209 // andps %xmm9,%xmm10 .byte 69,15,85,205 // andnps %xmm13,%xmm9 .byte 69,15,86,202 // orps %xmm10,%xmm9 .byte 68,15,194,192,1 // cmpltps %xmm0,%xmm8 - .byte 68,15,40,21,251,19,0,0 // movaps 0x13fb(%rip),%xmm10 # 6550 <_sk_callback_sse2+0x1025> + .byte 68,15,40,21,2,20,0,0 // movaps 0x1402(%rip),%xmm10 # 6560 <_sk_callback_sse2+0x102c> .byte 69,15,92,209 // subps %xmm9,%xmm10 .byte 69,15,84,208 // andps %xmm8,%xmm10 .byte 69,15,85,193 // andnps %xmm9,%xmm8 .byte 69,15,86,194 // orps %xmm10,%xmm8 .byte 68,15,40,201 // movaps %xmm1,%xmm9 .byte 68,15,194,200,1 // cmpltps %xmm0,%xmm9 - .byte 68,15,40,21,234,19,0,0 // movaps 0x13ea(%rip),%xmm10 # 6560 <_sk_callback_sse2+0x1035> + .byte 68,15,40,21,241,19,0,0 // movaps 0x13f1(%rip),%xmm10 # 6570 <_sk_callback_sse2+0x103c> .byte 69,15,92,208 // subps %xmm8,%xmm10 .byte 69,15,84,209 // andps %xmm9,%xmm10 .byte 69,15,85,200 // andnps %xmm8,%xmm9 @@ -34679,7 +34533,7 @@ HIDDEN _sk_save_xy_sse2 FUNCTION(_sk_save_xy_sse2) _sk_save_xy_sse2: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,188,19,0,0 // movaps 0x13bc(%rip),%xmm8 # 6570 <_sk_callback_sse2+0x1045> + .byte 68,15,40,5,195,19,0,0 // movaps 0x13c3(%rip),%xmm8 # 6580 <_sk_callback_sse2+0x104c> .byte 15,17,0 // movups %xmm0,(%rax) .byte 68,15,40,200 // movaps %xmm0,%xmm9 .byte 69,15,88,200 // addps %xmm8,%xmm9 @@ -34687,7 +34541,7 @@ _sk_save_xy_sse2: .byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10 .byte 69,15,40,217 // movaps %xmm9,%xmm11 .byte 69,15,194,218,1 // cmpltps %xmm10,%xmm11 - .byte 68,15,40,37,167,19,0,0 // movaps 0x13a7(%rip),%xmm12 # 6580 <_sk_callback_sse2+0x1055> + .byte 68,15,40,37,174,19,0,0 // movaps 0x13ae(%rip),%xmm12 # 6590 <_sk_callback_sse2+0x105c> .byte 69,15,84,220 // andps %xmm12,%xmm11 .byte 69,15,92,211 // subps %xmm11,%xmm10 .byte 69,15,92,202 // subps %xmm10,%xmm9 @@ -34734,8 +34588,8 @@ _sk_bilinear_nx_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,32,19,0,0 // addps 0x1320(%rip),%xmm0 # 6590 <_sk_callback_sse2+0x1065> - .byte 68,15,40,13,40,19,0,0 // movaps 0x1328(%rip),%xmm9 # 65a0 <_sk_callback_sse2+0x1075> + .byte 15,88,5,39,19,0,0 // addps 0x1327(%rip),%xmm0 # 65a0 <_sk_callback_sse2+0x106c> + .byte 68,15,40,13,47,19,0,0 // movaps 0x132f(%rip),%xmm9 # 65b0 <_sk_callback_sse2+0x107c> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34748,7 +34602,7 @@ _sk_bilinear_px_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,23,19,0,0 // addps 0x1317(%rip),%xmm0 # 65b0 <_sk_callback_sse2+0x1085> + .byte 15,88,5,30,19,0,0 // addps 0x131e(%rip),%xmm0 # 65c0 <_sk_callback_sse2+0x108c> .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34760,8 +34614,8 @@ _sk_bilinear_ny_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,9,19,0,0 // addps 0x1309(%rip),%xmm1 # 65c0 <_sk_callback_sse2+0x1095> - .byte 68,15,40,13,17,19,0,0 // movaps 0x1311(%rip),%xmm9 # 65d0 <_sk_callback_sse2+0x10a5> + .byte 15,88,13,16,19,0,0 // addps 0x1310(%rip),%xmm1 # 65d0 <_sk_callback_sse2+0x109c> + .byte 68,15,40,13,24,19,0,0 // movaps 0x1318(%rip),%xmm9 # 65e0 <_sk_callback_sse2+0x10ac> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34774,7 +34628,7 @@ _sk_bilinear_py_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,255,18,0,0 // addps 0x12ff(%rip),%xmm1 # 65e0 <_sk_callback_sse2+0x10b5> + .byte 15,88,13,6,19,0,0 // addps 0x1306(%rip),%xmm1 # 65f0 <_sk_callback_sse2+0x10bc> .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34786,13 +34640,13 @@ _sk_bicubic_n3x_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,242,18,0,0 // addps 0x12f2(%rip),%xmm0 # 65f0 <_sk_callback_sse2+0x10c5> - .byte 68,15,40,13,250,18,0,0 // movaps 0x12fa(%rip),%xmm9 # 6600 <_sk_callback_sse2+0x10d5> + .byte 15,88,5,249,18,0,0 // addps 0x12f9(%rip),%xmm0 # 6600 <_sk_callback_sse2+0x10cc> + .byte 68,15,40,13,1,19,0,0 // movaps 0x1301(%rip),%xmm9 # 6610 <_sk_callback_sse2+0x10dc> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 69,15,40,193 // movaps %xmm9,%xmm8 .byte 69,15,89,192 // mulps %xmm8,%xmm8 - .byte 68,15,89,13,246,18,0,0 // mulps 0x12f6(%rip),%xmm9 # 6610 <_sk_callback_sse2+0x10e5> - .byte 68,15,88,13,254,18,0,0 // addps 0x12fe(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x10f5> + .byte 68,15,89,13,253,18,0,0 // mulps 0x12fd(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x10ec> + .byte 68,15,88,13,5,19,0,0 // addps 0x1305(%rip),%xmm9 # 6630 <_sk_callback_sse2+0x10fc> .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34805,16 +34659,16 @@ _sk_bicubic_n1x_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,237,18,0,0 // addps 0x12ed(%rip),%xmm0 # 6630 <_sk_callback_sse2+0x1105> - .byte 68,15,40,13,245,18,0,0 // movaps 0x12f5(%rip),%xmm9 # 6640 <_sk_callback_sse2+0x1115> + .byte 15,88,5,244,18,0,0 // addps 0x12f4(%rip),%xmm0 # 6640 <_sk_callback_sse2+0x110c> + .byte 68,15,40,13,252,18,0,0 // movaps 0x12fc(%rip),%xmm9 # 6650 <_sk_callback_sse2+0x111c> .byte 69,15,92,200 // subps %xmm8,%xmm9 - .byte 68,15,40,5,249,18,0,0 // movaps 0x12f9(%rip),%xmm8 # 6650 <_sk_callback_sse2+0x1125> + .byte 68,15,40,5,0,19,0,0 // movaps 0x1300(%rip),%xmm8 # 6660 <_sk_callback_sse2+0x112c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,253,18,0,0 // addps 0x12fd(%rip),%xmm8 # 6660 <_sk_callback_sse2+0x1135> + .byte 68,15,88,5,4,19,0,0 // addps 0x1304(%rip),%xmm8 # 6670 <_sk_callback_sse2+0x113c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,1,19,0,0 // addps 0x1301(%rip),%xmm8 # 6670 <_sk_callback_sse2+0x1145> + .byte 68,15,88,5,8,19,0,0 // addps 0x1308(%rip),%xmm8 # 6680 <_sk_callback_sse2+0x114c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,5,19,0,0 // addps 0x1305(%rip),%xmm8 # 6680 <_sk_callback_sse2+0x1155> + .byte 68,15,88,5,12,19,0,0 // addps 0x130c(%rip),%xmm8 # 6690 <_sk_callback_sse2+0x115c> .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34824,17 +34678,17 @@ HIDDEN _sk_bicubic_p1x_sse2 FUNCTION(_sk_bicubic_p1x_sse2) _sk_bicubic_p1x_sse2: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,255,18,0,0 // movaps 0x12ff(%rip),%xmm8 # 6690 <_sk_callback_sse2+0x1165> + .byte 68,15,40,5,6,19,0,0 // movaps 0x1306(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x116c> .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9 .byte 65,15,88,192 // addps %xmm8,%xmm0 - .byte 68,15,40,21,251,18,0,0 // movaps 0x12fb(%rip),%xmm10 # 66a0 <_sk_callback_sse2+0x1175> + .byte 68,15,40,21,2,19,0,0 // movaps 0x1302(%rip),%xmm10 # 66b0 <_sk_callback_sse2+0x117c> .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,255,18,0,0 // addps 0x12ff(%rip),%xmm10 # 66b0 <_sk_callback_sse2+0x1185> + .byte 68,15,88,21,6,19,0,0 // addps 0x1306(%rip),%xmm10 # 66c0 <_sk_callback_sse2+0x118c> .byte 69,15,89,209 // mulps %xmm9,%xmm10 .byte 69,15,88,208 // addps %xmm8,%xmm10 .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,251,18,0,0 // addps 0x12fb(%rip),%xmm10 # 66c0 <_sk_callback_sse2+0x1195> + .byte 68,15,88,21,2,19,0,0 // addps 0x1302(%rip),%xmm10 # 66d0 <_sk_callback_sse2+0x119c> .byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34846,11 +34700,11 @@ _sk_bicubic_p3x_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,0 // movups (%rax),%xmm0 .byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8 - .byte 15,88,5,238,18,0,0 // addps 0x12ee(%rip),%xmm0 # 66d0 <_sk_callback_sse2+0x11a5> + .byte 15,88,5,245,18,0,0 // addps 0x12f5(%rip),%xmm0 # 66e0 <_sk_callback_sse2+0x11ac> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 69,15,89,201 // mulps %xmm9,%xmm9 - .byte 68,15,89,5,238,18,0,0 // mulps 0x12ee(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x11b5> - .byte 68,15,88,5,246,18,0,0 // addps 0x12f6(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x11c5> + .byte 68,15,89,5,245,18,0,0 // mulps 0x12f5(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x11bc> + .byte 68,15,88,5,253,18,0,0 // addps 0x12fd(%rip),%xmm8 # 6700 <_sk_callback_sse2+0x11cc> .byte 69,15,89,193 // mulps %xmm9,%xmm8 .byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34863,13 +34717,13 @@ _sk_bicubic_n3y_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,228,18,0,0 // addps 0x12e4(%rip),%xmm1 # 6700 <_sk_callback_sse2+0x11d5> - .byte 68,15,40,13,236,18,0,0 // movaps 0x12ec(%rip),%xmm9 # 6710 <_sk_callback_sse2+0x11e5> + .byte 15,88,13,235,18,0,0 // addps 0x12eb(%rip),%xmm1 # 6710 <_sk_callback_sse2+0x11dc> + .byte 68,15,40,13,243,18,0,0 // movaps 0x12f3(%rip),%xmm9 # 6720 <_sk_callback_sse2+0x11ec> .byte 69,15,92,200 // subps %xmm8,%xmm9 .byte 69,15,40,193 // movaps %xmm9,%xmm8 .byte 69,15,89,192 // mulps %xmm8,%xmm8 - .byte 68,15,89,13,232,18,0,0 // mulps 0x12e8(%rip),%xmm9 # 6720 <_sk_callback_sse2+0x11f5> - .byte 68,15,88,13,240,18,0,0 // addps 0x12f0(%rip),%xmm9 # 6730 <_sk_callback_sse2+0x1205> + .byte 68,15,89,13,239,18,0,0 // mulps 0x12ef(%rip),%xmm9 # 6730 <_sk_callback_sse2+0x11fc> + .byte 68,15,88,13,247,18,0,0 // addps 0x12f7(%rip),%xmm9 # 6740 <_sk_callback_sse2+0x120c> .byte 69,15,89,200 // mulps %xmm8,%xmm9 .byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34882,16 +34736,16 @@ _sk_bicubic_n1y_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,222,18,0,0 // addps 0x12de(%rip),%xmm1 # 6740 <_sk_callback_sse2+0x1215> - .byte 68,15,40,13,230,18,0,0 // movaps 0x12e6(%rip),%xmm9 # 6750 <_sk_callback_sse2+0x1225> + .byte 15,88,13,229,18,0,0 // addps 0x12e5(%rip),%xmm1 # 6750 <_sk_callback_sse2+0x121c> + .byte 68,15,40,13,237,18,0,0 // movaps 0x12ed(%rip),%xmm9 # 6760 <_sk_callback_sse2+0x122c> .byte 69,15,92,200 // subps %xmm8,%xmm9 - .byte 68,15,40,5,234,18,0,0 // movaps 0x12ea(%rip),%xmm8 # 6760 <_sk_callback_sse2+0x1235> + .byte 68,15,40,5,241,18,0,0 // movaps 0x12f1(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x123c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,238,18,0,0 // addps 0x12ee(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x1245> + .byte 68,15,88,5,245,18,0,0 // addps 0x12f5(%rip),%xmm8 # 6780 <_sk_callback_sse2+0x124c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,242,18,0,0 // addps 0x12f2(%rip),%xmm8 # 6780 <_sk_callback_sse2+0x1255> + .byte 68,15,88,5,249,18,0,0 // addps 0x12f9(%rip),%xmm8 # 6790 <_sk_callback_sse2+0x125c> .byte 69,15,89,193 // mulps %xmm9,%xmm8 - .byte 68,15,88,5,246,18,0,0 // addps 0x12f6(%rip),%xmm8 # 6790 <_sk_callback_sse2+0x1265> + .byte 68,15,88,5,253,18,0,0 // addps 0x12fd(%rip),%xmm8 # 67a0 <_sk_callback_sse2+0x126c> .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34901,17 +34755,17 @@ HIDDEN _sk_bicubic_p1y_sse2 FUNCTION(_sk_bicubic_p1y_sse2) _sk_bicubic_p1y_sse2: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 68,15,40,5,240,18,0,0 // movaps 0x12f0(%rip),%xmm8 # 67a0 <_sk_callback_sse2+0x1275> + .byte 68,15,40,5,247,18,0,0 // movaps 0x12f7(%rip),%xmm8 # 67b0 <_sk_callback_sse2+0x127c> .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9 .byte 65,15,88,200 // addps %xmm8,%xmm1 - .byte 68,15,40,21,235,18,0,0 // movaps 0x12eb(%rip),%xmm10 # 67b0 <_sk_callback_sse2+0x1285> + .byte 68,15,40,21,242,18,0,0 // movaps 0x12f2(%rip),%xmm10 # 67c0 <_sk_callback_sse2+0x128c> .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,239,18,0,0 // addps 0x12ef(%rip),%xmm10 # 67c0 <_sk_callback_sse2+0x1295> + .byte 68,15,88,21,246,18,0,0 // addps 0x12f6(%rip),%xmm10 # 67d0 <_sk_callback_sse2+0x129c> .byte 69,15,89,209 // mulps %xmm9,%xmm10 .byte 69,15,88,208 // addps %xmm8,%xmm10 .byte 69,15,89,209 // mulps %xmm9,%xmm10 - .byte 68,15,88,21,235,18,0,0 // addps 0x12eb(%rip),%xmm10 # 67d0 <_sk_callback_sse2+0x12a5> + .byte 68,15,88,21,242,18,0,0 // addps 0x12f2(%rip),%xmm10 # 67e0 <_sk_callback_sse2+0x12ac> .byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax .byte 255,224 // jmpq *%rax @@ -34923,11 +34777,11 @@ _sk_bicubic_p3y_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 15,16,72,32 // movups 0x20(%rax),%xmm1 .byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8 - .byte 15,88,13,221,18,0,0 // addps 0x12dd(%rip),%xmm1 # 67e0 <_sk_callback_sse2+0x12b5> + .byte 15,88,13,228,18,0,0 // addps 0x12e4(%rip),%xmm1 # 67f0 <_sk_callback_sse2+0x12bc> .byte 69,15,40,200 // movaps %xmm8,%xmm9 .byte 69,15,89,201 // mulps %xmm9,%xmm9 - .byte 68,15,89,5,221,18,0,0 // mulps 0x12dd(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x12c5> - .byte 68,15,88,5,229,18,0,0 // addps 0x12e5(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x12d5> + .byte 68,15,89,5,228,18,0,0 // mulps 0x12e4(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x12cc> + .byte 68,15,88,5,236,18,0,0 // addps 0x12ec(%rip),%xmm8 # 6810 <_sk_callback_sse2+0x12dc> .byte 69,15,89,193 // mulps %xmm9,%xmm8 .byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax) .byte 72,173 // lods %ds:(%rsi),%rax @@ -34938,22 +34792,23 @@ HIDDEN _sk_callback_sse2 FUNCTION(_sk_callback_sse2) _sk_callback_sse2: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 72,131,236,72 // sub $0x48,%rsp - .byte 15,41,124,36,48 // movaps %xmm7,0x30(%rsp) - .byte 15,41,116,36,32 // movaps %xmm6,0x20(%rsp) - .byte 15,41,108,36,16 // movaps %xmm5,0x10(%rsp) - .byte 15,41,36,36 // movaps %xmm4,(%rsp) + .byte 15,41,125,144 // movaps %xmm7,-0x70(%rbp) + .byte 15,41,117,160 // movaps %xmm6,-0x60(%rbp) + .byte 15,41,109,176 // movaps %xmm5,-0x50(%rbp) + .byte 15,41,101,192 // movaps %xmm4,-0x40(%rbp) .byte 76,137,195 // mov %r8,%rbx - .byte 73,137,206 // mov %rcx,%r14 + .byte 72,137,77,208 // mov %rcx,-0x30(%rbp) .byte 73,137,215 // mov %rdx,%r15 .byte 73,137,252 // mov %rdi,%r12 .byte 72,173 // lods %ds:(%rsi),%rax - .byte 72,137,197 // mov %rax,%rbp + .byte 73,137,198 // mov %rax,%r14 .byte 73,137,245 // mov %rsi,%r13 .byte 15,40,224 // movaps %xmm0,%xmm4 .byte 15,20,225 // unpcklps %xmm1,%xmm4 @@ -34966,17 +34821,17 @@ _sk_callback_sse2: .byte 15,18,236 // movhlps %xmm4,%xmm5 .byte 15,40,216 // movaps %xmm0,%xmm3 .byte 102,15,20,218 // unpcklpd %xmm2,%xmm3 - .byte 102,15,17,77,8 // movupd %xmm1,0x8(%rbp) + .byte 102,65,15,17,78,8 // movupd %xmm1,0x8(%r14) .byte 15,18,208 // movhlps %xmm0,%xmm2 - .byte 15,17,109,24 // movups %xmm5,0x18(%rbp) - .byte 102,15,17,93,40 // movupd %xmm3,0x28(%rbp) - .byte 15,17,85,56 // movups %xmm2,0x38(%rbp) + .byte 65,15,17,110,24 // movups %xmm5,0x18(%r14) + .byte 102,65,15,17,94,40 // movupd %xmm3,0x28(%r14) + .byte 65,15,17,86,56 // movups %xmm2,0x38(%r14) .byte 72,133,219 // test %rbx,%rbx .byte 190,4,0,0,0 // mov $0x4,%esi .byte 15,69,243 // cmovne %ebx,%esi - .byte 72,137,239 // mov %rbp,%rdi - .byte 255,85,0 // callq *0x0(%rbp) - .byte 72,139,133,136,0,0,0 // mov 0x88(%rbp),%rax + .byte 76,137,247 // mov %r14,%rdi + .byte 65,255,22 // callq *(%r14) + .byte 73,139,134,136,0,0,0 // mov 0x88(%r14),%rax .byte 15,16,32 // movups (%rax),%xmm4 .byte 15,16,64,16 // movups 0x10(%rax),%xmm0 .byte 15,16,88,32 // movups 0x20(%rax),%xmm3 @@ -34997,12 +34852,12 @@ _sk_callback_sse2: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,137,231 // mov %r12,%rdi .byte 76,137,250 // mov %r15,%rdx - .byte 76,137,241 // mov %r14,%rcx + .byte 72,139,77,208 // mov -0x30(%rbp),%rcx .byte 73,137,216 // mov %rbx,%r8 - .byte 15,40,36,36 // movaps (%rsp),%xmm4 - .byte 15,40,108,36,16 // movaps 0x10(%rsp),%xmm5 - .byte 15,40,116,36,32 // movaps 0x20(%rsp),%xmm6 - .byte 15,40,124,36,48 // movaps 0x30(%rsp),%xmm7 + .byte 15,40,101,192 // movaps -0x40(%rbp),%xmm4 + .byte 15,40,109,176 // movaps -0x50(%rbp),%xmm5 + .byte 15,40,117,160 // movaps -0x60(%rbp),%xmm6 + .byte 15,40,125,144 // movaps -0x70(%rbp),%xmm7 .byte 72,131,196,72 // add $0x48,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -35156,11 +35011,11 @@ BALIGN16 .byte 128,191,0,0,128,191,0 // cmpb $0x0,-0x40800000(%rdi) .byte 0,224 // add %ah,%al .byte 64,0,0 // add %al,(%rax) - .byte 224,64 // loopne 57f8 <.literal16+0x1d8> + .byte 224,64 // loopne 5808 <.literal16+0x1d8> .byte 0,0 // add %al,(%rax) - .byte 224,64 // loopne 57fc <.literal16+0x1dc> + .byte 224,64 // loopne 580c <.literal16+0x1dc> .byte 0,0 // add %al,(%rax) - .byte 224,64 // loopne 5800 <.literal16+0x1e0> + .byte 224,64 // loopne 5810 <.literal16+0x1e0> .byte 154 // (bad) .byte 153 // cltd .byte 153 // cltd @@ -35180,13 +35035,13 @@ BALIGN16 .byte 10,23 // or (%rdi),%dl .byte 63 // (bad) .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5821 <.literal16+0x201> + .byte 71,225,61 // rex.RXB loope 5831 <.literal16+0x201> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5825 <.literal16+0x205> + .byte 71,225,61 // rex.RXB loope 5835 <.literal16+0x205> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5829 <.literal16+0x209> + .byte 71,225,61 // rex.RXB loope 5839 <.literal16+0x209> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 582d <.literal16+0x20d> + .byte 71,225,61 // rex.RXB loope 583d <.literal16+0x20d> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -35211,13 +35066,13 @@ BALIGN16 .byte 10,23 // or (%rdi),%dl .byte 63 // (bad) .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5861 <.literal16+0x241> + .byte 71,225,61 // rex.RXB loope 5871 <.literal16+0x241> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5865 <.literal16+0x245> + .byte 71,225,61 // rex.RXB loope 5875 <.literal16+0x245> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 5869 <.literal16+0x249> + .byte 71,225,61 // rex.RXB loope 5879 <.literal16+0x249> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 586d <.literal16+0x24d> + .byte 71,225,61 // rex.RXB loope 587d <.literal16+0x24d> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -35242,13 +35097,13 @@ BALIGN16 .byte 10,23 // or (%rdi),%dl .byte 63 // (bad) .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58a1 <.literal16+0x281> + .byte 71,225,61 // rex.RXB loope 58b1 <.literal16+0x281> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58a5 <.literal16+0x285> + .byte 71,225,61 // rex.RXB loope 58b5 <.literal16+0x285> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58a9 <.literal16+0x289> + .byte 71,225,61 // rex.RXB loope 58b9 <.literal16+0x289> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58ad <.literal16+0x28d> + .byte 71,225,61 // rex.RXB loope 58bd <.literal16+0x28d> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -35273,13 +35128,13 @@ BALIGN16 .byte 10,23 // or (%rdi),%dl .byte 63 // (bad) .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58e1 <.literal16+0x2c1> + .byte 71,225,61 // rex.RXB loope 58f1 <.literal16+0x2c1> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58e5 <.literal16+0x2c5> + .byte 71,225,61 // rex.RXB loope 58f5 <.literal16+0x2c5> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58e9 <.literal16+0x2c9> + .byte 71,225,61 // rex.RXB loope 58f9 <.literal16+0x2c9> .byte 174 // scas %es:(%rdi),%al - .byte 71,225,61 // rex.RXB loope 58ed <.literal16+0x2cd> + .byte 71,225,61 // rex.RXB loope 58fd <.literal16+0x2cd> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -35300,11 +35155,11 @@ BALIGN16 .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax) .byte 67,0,0 // rex.XB add %al,(%r8) - .byte 127,67 // jg 592b <.literal16+0x30b> + .byte 127,67 // jg 593b <.literal16+0x30b> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 592f <.literal16+0x30f> + .byte 127,67 // jg 593f <.literal16+0x30f> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5933 <.literal16+0x313> + .byte 127,67 // jg 5943 <.literal16+0x313> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -35544,13 +35399,13 @@ BALIGN16 .byte 132,55 // test %dh,(%rdi) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 5b19 <.literal16+0x4f9> + .byte 224,7 // loopne 5b29 <.literal16+0x4f9> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 5b1d <.literal16+0x4fd> + .byte 224,7 // loopne 5b2d <.literal16+0x4fd> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 5b21 <.literal16+0x501> + .byte 224,7 // loopne 5b31 <.literal16+0x501> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 5b25 <.literal16+0x505> + .byte 224,7 // loopne 5b35 <.literal16+0x505> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -35615,11 +35470,11 @@ BALIGN16 .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,127,67 // add %bh,0x43(%rdi) .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5bfb <.literal16+0x5db> + .byte 127,67 // jg 5c0b <.literal16+0x5db> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5bff <.literal16+0x5df> + .byte 127,67 // jg 5c0f <.literal16+0x5df> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5c03 <.literal16+0x5e3> + .byte 127,67 // jg 5c13 <.literal16+0x5e3> .byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax) .byte 128,59,129 // cmpb $0x81,(%rbx) .byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%rax) @@ -35634,16 +35489,16 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 5bf4 <.literal16+0x5d4> + .byte 127,0 // jg 5c04 <.literal16+0x5d4> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5bf8 <.literal16+0x5d8> + .byte 127,0 // jg 5c08 <.literal16+0x5d8> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5bfc <.literal16+0x5dc> + .byte 127,0 // jg 5c0c <.literal16+0x5dc> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5c00 <.literal16+0x5e0> + .byte 127,0 // jg 5c10 <.literal16+0x5e0> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -35652,7 +35507,7 @@ BALIGN16 .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 5c85 <.literal16+0x665> + .byte 119,115 // ja 5c95 <.literal16+0x665> .byte 248 // clc .byte 194,119,115 // retq $0x7377 .byte 248 // clc @@ -35663,7 +35518,7 @@ BALIGN16 .byte 194,117,191 // retq $0xbf75 .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) - .byte 117,191 // jne 5be9 <.literal16+0x5c9> + .byte 117,191 // jne 5bf9 <.literal16+0x5c9> .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) .byte 249 // stc @@ -35675,7 +35530,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a39c2a <_sk_callback_sse2+0xffffffffe9a346ff> + .byte 233,220,63,163,233 // jmpq ffffffffe9a39c3a <_sk_callback_sse2+0xffffffffe9a34706> .byte 220,63 // fdivrl (%rdi) .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) @@ -35729,16 +35584,16 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 5cc4 <.literal16+0x6a4> + .byte 127,0 // jg 5cd4 <.literal16+0x6a4> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5cc8 <.literal16+0x6a8> + .byte 127,0 // jg 5cd8 <.literal16+0x6a8> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5ccc <.literal16+0x6ac> + .byte 127,0 // jg 5cdc <.literal16+0x6ac> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5cd0 <.literal16+0x6b0> + .byte 127,0 // jg 5ce0 <.literal16+0x6b0> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -35747,7 +35602,7 @@ BALIGN16 .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 5d55 <.literal16+0x735> + .byte 119,115 // ja 5d65 <.literal16+0x735> .byte 248 // clc .byte 194,119,115 // retq $0x7377 .byte 248 // clc @@ -35758,7 +35613,7 @@ BALIGN16 .byte 194,117,191 // retq $0xbf75 .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) - .byte 117,191 // jne 5cb9 <.literal16+0x699> + .byte 117,191 // jne 5cc9 <.literal16+0x699> .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) .byte 249 // stc @@ -35770,7 +35625,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a39cfa <_sk_callback_sse2+0xffffffffe9a347cf> + .byte 233,220,63,163,233 // jmpq ffffffffe9a39d0a <_sk_callback_sse2+0xffffffffe9a347d6> .byte 220,63 // fdivrl (%rdi) .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) @@ -35824,16 +35679,16 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 5d94 <.literal16+0x774> + .byte 127,0 // jg 5da4 <.literal16+0x774> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5d98 <.literal16+0x778> + .byte 127,0 // jg 5da8 <.literal16+0x778> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5d9c <.literal16+0x77c> + .byte 127,0 // jg 5dac <.literal16+0x77c> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5da0 <.literal16+0x780> + .byte 127,0 // jg 5db0 <.literal16+0x780> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -35842,7 +35697,7 @@ BALIGN16 .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 5e25 <.literal16+0x805> + .byte 119,115 // ja 5e35 <.literal16+0x805> .byte 248 // clc .byte 194,119,115 // retq $0x7377 .byte 248 // clc @@ -35853,7 +35708,7 @@ BALIGN16 .byte 194,117,191 // retq $0xbf75 .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) - .byte 117,191 // jne 5d89 <.literal16+0x769> + .byte 117,191 // jne 5d99 <.literal16+0x769> .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) .byte 249 // stc @@ -35865,7 +35720,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a39dca <_sk_callback_sse2+0xffffffffe9a3489f> + .byte 233,220,63,163,233 // jmpq ffffffffe9a39dda <_sk_callback_sse2+0xffffffffe9a348a6> .byte 220,63 // fdivrl (%rdi) .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) @@ -35919,16 +35774,16 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 52,255 // xor $0xff,%al .byte 255 // (bad) - .byte 127,0 // jg 5e64 <.literal16+0x844> + .byte 127,0 // jg 5e74 <.literal16+0x844> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5e68 <.literal16+0x848> + .byte 127,0 // jg 5e78 <.literal16+0x848> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5e6c <.literal16+0x84c> + .byte 127,0 // jg 5e7c <.literal16+0x84c> .byte 255 // (bad) .byte 255 // (bad) - .byte 127,0 // jg 5e70 <.literal16+0x850> + .byte 127,0 // jg 5e80 <.literal16+0x850> .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -35937,7 +35792,7 @@ BALIGN16 .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) - .byte 119,115 // ja 5ef5 <.literal16+0x8d5> + .byte 119,115 // ja 5f05 <.literal16+0x8d5> .byte 248 // clc .byte 194,119,115 // retq $0x7377 .byte 248 // clc @@ -35948,7 +35803,7 @@ BALIGN16 .byte 194,117,191 // retq $0xbf75 .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) - .byte 117,191 // jne 5e59 <.literal16+0x839> + .byte 117,191 // jne 5e69 <.literal16+0x839> .byte 191,63,117,191,191 // mov $0xbfbf753f,%edi .byte 63 // (bad) .byte 249 // stc @@ -35960,7 +35815,7 @@ BALIGN16 .byte 249 // stc .byte 68,180,62 // rex.R mov $0x3e,%spl .byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9 - .byte 233,220,63,163,233 // jmpq ffffffffe9a39e9a <_sk_callback_sse2+0xffffffffe9a3496f> + .byte 233,220,63,163,233 // jmpq ffffffffe9a39eaa <_sk_callback_sse2+0xffffffffe9a34976> .byte 220,63 // fdivrl (%rdi) .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) @@ -36010,13 +35865,13 @@ BALIGN16 .byte 200,66,0,0 // enterq $0x42,$0x0 .byte 200,66,0,0 // enterq $0x42,$0x0 .byte 200,66,0,0 // enterq $0x42,$0x0 - .byte 127,67 // jg 5f77 <.literal16+0x957> + .byte 127,67 // jg 5f87 <.literal16+0x957> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5f7b <.literal16+0x95b> + .byte 127,67 // jg 5f8b <.literal16+0x95b> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5f7f <.literal16+0x95f> + .byte 127,67 // jg 5f8f <.literal16+0x95f> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 5f83 <.literal16+0x963> + .byte 127,67 // jg 5f93 <.literal16+0x963> .byte 0,0 // add %al,(%rax) .byte 0,195 // add %al,%bl .byte 0,0 // add %al,(%rax) @@ -36063,16 +35918,16 @@ BALIGN16 .byte 128,3,62 // addb $0x3e,(%rbx) .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 6003 <.literal16+0x9e3> + .byte 118,63 // jbe 6013 <.literal16+0x9e3> .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 6007 <.literal16+0x9e7> + .byte 118,63 // jbe 6017 <.literal16+0x9e7> .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 600b <.literal16+0x9eb> + .byte 118,63 // jbe 601b <.literal16+0x9eb> .byte 31 // (bad) .byte 215 // xlat %ds:(%rbx) - .byte 118,63 // jbe 600f <.literal16+0x9ef> + .byte 118,63 // jbe 601f <.literal16+0x9ef> .byte 246,64,83,63 // testb $0x3f,0x53(%rax) .byte 246,64,83,63 // testb $0x3f,0x53(%rax) .byte 246,64,83,63 // testb $0x3f,0x53(%rax) @@ -36092,11 +35947,11 @@ BALIGN16 .byte 128,59,0 // cmpb $0x0,(%rbx) .byte 0,127,67 // add %bh,0x43(%rdi) .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 605b <.literal16+0xa3b> + .byte 127,67 // jg 606b <.literal16+0xa3b> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 605f <.literal16+0xa3f> + .byte 127,67 // jg 606f <.literal16+0xa3f> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 6063 <.literal16+0xa43> + .byte 127,67 // jg 6073 <.literal16+0xa43> .byte 255,0 // incl (%rax) .byte 0,0 // add %al,(%rax) .byte 255,0 // incl (%rax) @@ -36144,13 +35999,13 @@ BALIGN16 .byte 132,55 // test %dh,(%rdi) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 60b9 <.literal16+0xa99> + .byte 224,7 // loopne 60c9 <.literal16+0xa99> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 60bd <.literal16+0xa9d> + .byte 224,7 // loopne 60cd <.literal16+0xa9d> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 60c1 <.literal16+0xaa1> + .byte 224,7 // loopne 60d1 <.literal16+0xaa1> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 60c5 <.literal16+0xaa5> + .byte 224,7 // loopne 60d5 <.literal16+0xaa5> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -36196,13 +36051,13 @@ BALIGN16 .byte 132,55 // test %dh,(%rdi) .byte 8,33 // or %ah,(%rcx) .byte 132,55 // test %dh,(%rdi) - .byte 224,7 // loopne 6129 <.literal16+0xb09> + .byte 224,7 // loopne 6139 <.literal16+0xb09> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 612d <.literal16+0xb0d> + .byte 224,7 // loopne 613d <.literal16+0xb0d> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 6131 <.literal16+0xb11> + .byte 224,7 // loopne 6141 <.literal16+0xb11> .byte 0,0 // add %al,(%rax) - .byte 224,7 // loopne 6135 <.literal16+0xb15> + .byte 224,7 // loopne 6145 <.literal16+0xb15> .byte 0,0 // add %al,(%rax) .byte 33,8 // and %ecx,(%rax) .byte 2,58 // add (%rdx),%bh @@ -36240,13 +36095,13 @@ BALIGN16 .byte 65,0,0 // add %al,(%r8) .byte 248 // clc .byte 65,0,0 // add %al,(%r8) - .byte 124,66 // jl 61c6 <.literal16+0xba6> + .byte 124,66 // jl 61d6 <.literal16+0xba6> .byte 0,0 // add %al,(%rax) - .byte 124,66 // jl 61ca <.literal16+0xbaa> + .byte 124,66 // jl 61da <.literal16+0xbaa> .byte 0,0 // add %al,(%rax) - .byte 124,66 // jl 61ce <.literal16+0xbae> + .byte 124,66 // jl 61de <.literal16+0xbae> .byte 0,0 // add %al,(%rax) - .byte 124,66 // jl 61d2 <.literal16+0xbb2> + .byte 124,66 // jl 61e2 <.literal16+0xbb2> .byte 0,240 // add %dh,%al .byte 0,0 // add %al,(%rax) .byte 0,240 // add %dh,%al @@ -36336,13 +36191,13 @@ BALIGN16 .byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%rax) .byte 61,137,136,136,61 // cmp $0x3d888889,%eax .byte 0,0 // add %al,(%rax) - .byte 112,65 // jo 62d5 <.literal16+0xcb5> + .byte 112,65 // jo 62e5 <.literal16+0xcb5> .byte 0,0 // add %al,(%rax) - .byte 112,65 // jo 62d9 <.literal16+0xcb9> + .byte 112,65 // jo 62e9 <.literal16+0xcb9> .byte 0,0 // add %al,(%rax) - .byte 112,65 // jo 62dd <.literal16+0xcbd> + .byte 112,65 // jo 62ed <.literal16+0xcbd> .byte 0,0 // add %al,(%rax) - .byte 112,65 // jo 62e1 <.literal16+0xcc1> + .byte 112,65 // jo 62f1 <.literal16+0xcc1> .byte 255,0 // incl (%rax) .byte 0,0 // add %al,(%rax) .byte 255,0 // incl (%rax) @@ -36364,11 +36219,11 @@ BALIGN16 .byte 128,59,129 // cmpb $0x81,(%rbx) .byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%rax) .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 632b <.literal16+0xd0b> + .byte 127,67 // jg 633b <.literal16+0xd0b> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 632f <.literal16+0xd0f> + .byte 127,67 // jg 633f <.literal16+0xd0f> .byte 0,0 // add %al,(%rax) - .byte 127,67 // jg 6333 <.literal16+0xd13> + .byte 127,67 // jg 6343 <.literal16+0xd13> .byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax) .byte 0,0 // add %al,(%rax) .byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax) @@ -36444,13 +36299,13 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 255 // (bad) - .byte 127,71 // jg 641b <.literal16+0xdfb> + .byte 127,71 // jg 642b <.literal16+0xdfb> .byte 0,255 // add %bh,%bh - .byte 127,71 // jg 641f <.literal16+0xdff> + .byte 127,71 // jg 642f <.literal16+0xdff> .byte 0,255 // add %bh,%bh - .byte 127,71 // jg 6423 <.literal16+0xe03> + .byte 127,71 // jg 6433 <.literal16+0xe03> .byte 0,255 // add %bh,%bh - .byte 127,71 // jg 6427 <.literal16+0xe07> + .byte 127,71 // jg 6437 <.literal16+0xe07> .byte 0,0 // add %al,(%rax) .byte 128,63,0 // cmpb $0x0,(%rdi) .byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax) @@ -36527,10 +36382,10 @@ BALIGN16 .byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax .byte 152 // cwtl .byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx) - .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc075ba <_sk_callback_sse2+0x2dc0208f> + .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc075ca <_sk_callback_sse2+0x2dc02096> .byte 17,192 // adc %eax,%eax .byte 45,16,17,192,18 // sub $0x12c01110,%eax - .byte 120,57 // js 64ec <.literal16+0xecc> + .byte 120,57 // js 64fc <.literal16+0xecc> .byte 64,18,120,57 // adc 0x39(%rax),%dil .byte 64,18,120,57 // adc 0x39(%rax),%dil .byte 64,18,120,57 // adc 0x39(%rax),%dil @@ -36658,11 +36513,11 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 128,63,114 // cmpb $0x72,(%rdi) .byte 28,199 // sbb $0xc7,%al - .byte 62,114,28 // jb,pt 6632 <.literal16+0x1012> + .byte 62,114,28 // jb,pt 6642 <.literal16+0x1012> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6636 <.literal16+0x1016> + .byte 62,114,28 // jb,pt 6646 <.literal16+0x1016> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 663a <.literal16+0x101a> + .byte 62,114,28 // jb,pt 664a <.literal16+0x101a> .byte 199 // (bad) .byte 62,171 // ds stos %eax,%es:(%rdi) .byte 170 // stos %al,%es:(%rdi) @@ -36706,7 +36561,7 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f4c5 <_sk_callback_sse2+0x3d639f9a> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f4d5 <_sk_callback_sse2+0x3d639fa1> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -36732,7 +36587,7 @@ BALIGN16 .byte 0,192 // add %al,%al .byte 63 // (bad) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f505 <_sk_callback_sse2+0x3d639fda> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f515 <_sk_callback_sse2+0x3d639fe1> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al @@ -36741,13 +36596,13 @@ BALIGN16 .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al .byte 63 // (bad) - .byte 114,28 // jb 66fe <.literal16+0x10de> + .byte 114,28 // jb 670e <.literal16+0x10de> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6702 <.literal16+0x10e2> + .byte 62,114,28 // jb,pt 6712 <.literal16+0x10e2> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6706 <.literal16+0x10e6> + .byte 62,114,28 // jb,pt 6716 <.literal16+0x10e6> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 670a <.literal16+0x10ea> + .byte 62,114,28 // jb,pt 671a <.literal16+0x10ea> .byte 199 // (bad) .byte 62,171 // ds stos %eax,%es:(%rdi) .byte 170 // stos %al,%es:(%rdi) @@ -36768,11 +36623,11 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 128,63,114 // cmpb $0x72,(%rdi) .byte 28,199 // sbb $0xc7,%al - .byte 62,114,28 // jb,pt 6742 <.literal16+0x1122> + .byte 62,114,28 // jb,pt 6752 <.literal16+0x1122> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6746 <.literal16+0x1126> + .byte 62,114,28 // jb,pt 6756 <.literal16+0x1126> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 674a <.literal16+0x112a> + .byte 62,114,28 // jb,pt 675a <.literal16+0x112a> .byte 199 // (bad) .byte 62,171 // ds stos %eax,%es:(%rdi) .byte 170 // stos %al,%es:(%rdi) @@ -36816,7 +36671,7 @@ BALIGN16 .byte 0,0 // add %al,(%rax) .byte 0,63 // add %bh,(%rdi) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f5d5 <_sk_callback_sse2+0x3d63a0aa> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f5e5 <_sk_callback_sse2+0x3d63a0b1> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 0,63 // add %bh,(%rdi) .byte 0,0 // add %al,(%rax) @@ -36842,7 +36697,7 @@ BALIGN16 .byte 0,192 // add %al,%al .byte 63 // (bad) .byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi) - .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f615 <_sk_callback_sse2+0x3d63a0ea> + .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63f625 <_sk_callback_sse2+0x3d63a0f1> .byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi) .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al @@ -36851,13 +36706,13 @@ BALIGN16 .byte 192,63,0 // sarb $0x0,(%rdi) .byte 0,192 // add %al,%al .byte 63 // (bad) - .byte 114,28 // jb 680e <.literal16+0x11ee> + .byte 114,28 // jb 681e <.literal16+0x11ee> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6812 <_sk_callback_sse2+0x12e7> + .byte 62,114,28 // jb,pt 6822 <_sk_callback_sse2+0x12ee> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 6816 <_sk_callback_sse2+0x12eb> + .byte 62,114,28 // jb,pt 6826 <_sk_callback_sse2+0x12f2> .byte 199 // (bad) - .byte 62,114,28 // jb,pt 681a <_sk_callback_sse2+0x12ef> + .byte 62,114,28 // jb,pt 682a <_sk_callback_sse2+0x12f6> .byte 199 // (bad) .byte 62,171 // ds stos %eax,%es:(%rdi) .byte 170 // stos %al,%es:(%rdi) @@ -36874,25 +36729,26 @@ HIDDEN _sk_start_pipeline_ssse3_lowp FUNCTION(_sk_start_pipeline_ssse3_lowp) _sk_start_pipeline_ssse3_lowp: .byte 85 // push %rbp + .byte 72,137,229 // mov %rsp,%rbp .byte 65,87 // push %r15 .byte 65,86 // push %r14 .byte 65,85 // push %r13 .byte 65,84 // push %r12 .byte 83 // push %rbx .byte 80 // push %rax - .byte 77,137,198 // mov %r8,%r14 - .byte 72,137,211 // mov %rdx,%rbx - .byte 73,137,247 // mov %rsi,%r15 - .byte 72,137,253 // mov %rdi,%rbp + .byte 76,137,195 // mov %r8,%rbx + .byte 73,137,215 // mov %rdx,%r15 + .byte 73,137,244 // mov %rsi,%r12 + .byte 73,137,254 // mov %rdi,%r14 .byte 72,137,206 // mov %rcx,%rsi .byte 72,173 // lods %ds:(%rsi),%rax - .byte 73,137,196 // mov %rax,%r12 - .byte 73,137,245 // mov %rsi,%r13 - .byte 72,141,69,8 // lea 0x8(%rbp),%rax - .byte 72,57,216 // cmp %rbx,%rax + .byte 73,137,197 // mov %rax,%r13 + .byte 73,141,78,8 // lea 0x8(%r14),%rcx + .byte 76,57,249 // cmp %r15,%rcx .byte 118,5 // jbe 30 <_sk_start_pipeline_ssse3_lowp+0x30> - .byte 72,137,234 // mov %rbp,%rdx - .byte 235,61 // jmp 6d <_sk_start_pipeline_ssse3_lowp+0x6d> + .byte 76,137,242 // mov %r14,%rdx + .byte 235,72 // jmp 78 <_sk_start_pipeline_ssse3_lowp+0x78> + .byte 76,137,125,208 // mov %r15,-0x30(%rbp) .byte 65,184,0,0,0,0 // mov $0x0,%r8d .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 @@ -36902,19 +36758,21 @@ _sk_start_pipeline_ssse3_lowp: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 72,137,234 // mov %rbp,%rdx - .byte 76,137,249 // mov %r15,%rcx - .byte 65,255,212 // callq *%r12 - .byte 72,141,85,8 // lea 0x8(%rbp),%rdx - .byte 72,131,197,16 // add $0x10,%rbp - .byte 72,57,221 // cmp %rbx,%rbp - .byte 72,137,213 // mov %rdx,%rbp - .byte 118,195 // jbe 30 <_sk_start_pipeline_ssse3_lowp+0x30> - .byte 73,137,216 // mov %rbx,%r8 + .byte 72,137,223 // mov %rbx,%rdi + .byte 73,137,247 // mov %rsi,%r15 + .byte 76,137,242 // mov %r14,%rdx + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 + .byte 76,137,254 // mov %r15,%rsi + .byte 76,139,125,208 // mov -0x30(%rbp),%r15 + .byte 73,141,86,8 // lea 0x8(%r14),%rdx + .byte 73,131,198,16 // add $0x10,%r14 + .byte 77,57,254 // cmp %r15,%r14 + .byte 73,137,214 // mov %rdx,%r14 + .byte 118,188 // jbe 34 <_sk_start_pipeline_ssse3_lowp+0x34> + .byte 77,137,248 // mov %r15,%r8 .byte 73,41,208 // sub %rdx,%r8 - .byte 116,36 // je 99 <_sk_start_pipeline_ssse3_lowp+0x99> + .byte 116,33 // je a1 <_sk_start_pipeline_ssse3_lowp+0xa1> .byte 15,87,192 // xorps %xmm0,%xmm0 .byte 15,87,201 // xorps %xmm1,%xmm1 .byte 15,87,210 // xorps %xmm2,%xmm2 @@ -36923,11 +36781,10 @@ _sk_start_pipeline_ssse3_lowp: .byte 15,87,237 // xorps %xmm5,%xmm5 .byte 15,87,246 // xorps %xmm6,%xmm6 .byte 15,87,255 // xorps %xmm7,%xmm7 - .byte 76,137,247 // mov %r14,%rdi - .byte 76,137,238 // mov %r13,%rsi - .byte 76,137,249 // mov %r15,%rcx - .byte 65,255,212 // callq *%r12 - .byte 72,137,216 // mov %rbx,%rax + .byte 72,137,223 // mov %rbx,%rdi + .byte 76,137,225 // mov %r12,%rcx + .byte 65,255,213 // callq *%r13 + .byte 76,137,248 // mov %r15,%rax .byte 72,131,196,8 // add $0x8,%rsp .byte 91 // pop %rbx .byte 65,92 // pop %r12 @@ -36948,7 +36805,7 @@ HIDDEN _sk_constant_color_ssse3_lowp FUNCTION(_sk_constant_color_ssse3_lowp) _sk_constant_color_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax - .byte 243,15,16,29,34,14,0,0 // movss 0xe22(%rip),%xmm3 # ed8 <_sk_xor__ssse3_lowp+0x9b> + .byte 243,15,16,29,34,14,0,0 // movss 0xe22(%rip),%xmm3 # ee0 <_sk_xor__ssse3_lowp+0x9b> .byte 243,15,16,0 // movss (%rax),%xmm0 .byte 243,15,89,195 // mulss %xmm3,%xmm0 .byte 243,68,15,44,200 // cvttss2si %xmm0,%r9d @@ -36982,10 +36839,10 @@ _sk_load_8888_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 117,113 // jne 1a2 <_sk_load_8888_ssse3_lowp+0x7b> + .byte 117,113 // jne 1aa <_sk_load_8888_ssse3_lowp+0x7b> .byte 69,15,16,76,147,16 // movups 0x10(%r11,%rdx,4),%xmm9 .byte 69,15,16,4,147 // movups (%r11,%rdx,4),%xmm8 - .byte 102,15,111,5,172,13,0,0 // movdqa 0xdac(%rip),%xmm0 # ef0 <_sk_xor__ssse3_lowp+0xb3> + .byte 102,15,111,5,164,13,0,0 // movdqa 0xda4(%rip),%xmm0 # ef0 <_sk_xor__ssse3_lowp+0xab> .byte 102,68,15,56,0,192 // pshufb %xmm0,%xmm8 .byte 102,68,15,56,0,200 // pshufb %xmm0,%xmm9 .byte 102,65,15,111,208 // movdqa %xmm8,%xmm2 @@ -36999,7 +36856,7 @@ _sk_load_8888_ssse3_lowp: .byte 102,15,239,210 // pxor %xmm2,%xmm2 .byte 102,65,15,96,208 // punpcklbw %xmm8,%xmm2 .byte 102,65,15,104,216 // punpckhbw %xmm8,%xmm3 - .byte 102,68,15,111,5,118,13,0,0 // movdqa 0xd76(%rip),%xmm8 # f00 <_sk_xor__ssse3_lowp+0xc3> + .byte 102,68,15,111,5,110,13,0,0 // movdqa 0xd6e(%rip),%xmm8 # f00 <_sk_xor__ssse3_lowp+0xbb> .byte 102,65,15,228,192 // pmulhuw %xmm8,%xmm0 .byte 102,65,15,228,200 // pmulhuw %xmm8,%xmm1 .byte 102,65,15,228,208 // pmulhuw %xmm8,%xmm2 @@ -37012,9 +36869,9 @@ _sk_load_8888_ssse3_lowp: .byte 69,15,87,192 // xorps %xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,129 // ja 13c <_sk_load_8888_ssse3_lowp+0x15> + .byte 119,129 // ja 144 <_sk_load_8888_ssse3_lowp+0x15> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,130,0,0,0 // lea 0x82(%rip),%r10 # 248 <_sk_load_8888_ssse3_lowp+0x121> + .byte 76,141,21,130,0,0,0 // lea 0x82(%rip),%r10 # 250 <_sk_load_8888_ssse3_lowp+0x121> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -37039,7 +36896,7 @@ _sk_load_8888_ssse3_lowp: .byte 68,15,40,192 // movaps %xmm0,%xmm8 .byte 243,65,15,16,4,147 // movss (%r11,%rdx,4),%xmm0 .byte 243,68,15,16,192 // movss %xmm0,%xmm8 - .byte 233,244,254,255,255 // jmpq 13c <_sk_load_8888_ssse3_lowp+0x15> + .byte 233,244,254,255,255 // jmpq 144 <_sk_load_8888_ssse3_lowp+0x15> .byte 240,255 // lock (bad) .byte 255 // (bad) .byte 255 // (bad) @@ -37080,7 +36937,7 @@ _sk_store_8888_ssse3_lowp: .byte 102,69,15,97,194 // punpcklwd %xmm10,%xmm8 .byte 102,69,15,105,202 // punpckhwd %xmm10,%xmm9 .byte 77,133,192 // test %r8,%r8 - .byte 117,17 // jne 2d3 <_sk_store_8888_ssse3_lowp+0x6f> + .byte 117,17 // jne 2db <_sk_store_8888_ssse3_lowp+0x6f> .byte 243,69,15,127,76,147,16 // movdqu %xmm9,0x10(%r11,%rdx,4) .byte 243,69,15,127,4,147 // movdqu %xmm8,(%r11,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax @@ -37089,9 +36946,9 @@ _sk_store_8888_ssse3_lowp: .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,236 // ja 2cf <_sk_store_8888_ssse3_lowp+0x6b> + .byte 119,236 // ja 2d7 <_sk_store_8888_ssse3_lowp+0x6b> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,90,0,0,0 // lea 0x5a(%rip),%r10 # 348 <_sk_store_8888_ssse3_lowp+0xe4> + .byte 76,141,21,90,0,0,0 // lea 0x5a(%rip),%r10 # 350 <_sk_store_8888_ssse3_lowp+0xe4> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -37107,7 +36964,7 @@ _sk_store_8888_ssse3_lowp: .byte 102,69,15,112,200,229 // pshufd $0xe5,%xmm8,%xmm9 .byte 102,69,15,126,76,147,4 // movd %xmm9,0x4(%r11,%rdx,4) .byte 102,69,15,126,4,147 // movd %xmm8,(%r11,%rdx,4) - .byte 235,136 // jmp 2cf <_sk_store_8888_ssse3_lowp+0x6b> + .byte 235,136 // jmp 2d7 <_sk_store_8888_ssse3_lowp+0x6b> .byte 144 // nop .byte 247,255 // idiv %edi .byte 255 // (bad) @@ -37137,11 +36994,11 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,66,1,0,0 // jne 4b4 <_sk_srcover_rgba_8888_ssse3_lowp+0x150> + .byte 15,133,66,1,0,0 // jne 4bc <_sk_srcover_rgba_8888_ssse3_lowp+0x150> .byte 69,15,16,76,147,16 // movups 0x10(%r11,%rdx,4),%xmm9 .byte 69,15,16,4,147 // movups (%r11,%rdx,4),%xmm8 .byte 77,133,192 // test %r8,%r8 - .byte 102,15,111,37,136,11,0,0 // movdqa 0xb88(%rip),%xmm4 # f10 <_sk_xor__ssse3_lowp+0xd3> + .byte 102,15,111,37,128,11,0,0 // movdqa 0xb80(%rip),%xmm4 # f10 <_sk_xor__ssse3_lowp+0xcb> .byte 102,68,15,56,0,196 // pshufb %xmm4,%xmm8 .byte 102,68,15,56,0,204 // pshufb %xmm4,%xmm9 .byte 102,65,15,111,240 // movdqa %xmm8,%xmm6 @@ -37155,12 +37012,12 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 102,15,239,246 // pxor %xmm6,%xmm6 .byte 102,65,15,96,240 // punpcklbw %xmm8,%xmm6 .byte 102,65,15,104,248 // punpckhbw %xmm8,%xmm7 - .byte 102,68,15,111,5,82,11,0,0 // movdqa 0xb52(%rip),%xmm8 # f20 <_sk_xor__ssse3_lowp+0xe3> + .byte 102,68,15,111,5,74,11,0,0 // movdqa 0xb4a(%rip),%xmm8 # f20 <_sk_xor__ssse3_lowp+0xdb> .byte 102,65,15,228,224 // pmulhuw %xmm8,%xmm4 .byte 102,65,15,228,232 // pmulhuw %xmm8,%xmm5 .byte 102,65,15,228,240 // pmulhuw %xmm8,%xmm6 .byte 102,65,15,228,248 // pmulhuw %xmm8,%xmm7 - .byte 102,68,15,111,29,69,11,0,0 // movdqa 0xb45(%rip),%xmm11 # f30 <_sk_xor__ssse3_lowp+0xf3> + .byte 102,68,15,111,29,61,11,0,0 // movdqa 0xb3d(%rip),%xmm11 # f30 <_sk_xor__ssse3_lowp+0xeb> .byte 102,68,15,249,219 // psubw %xmm3,%xmm11 .byte 102,68,15,111,196 // movdqa %xmm4,%xmm8 .byte 102,69,15,56,11,195 // pmulhrsw %xmm11,%xmm8 @@ -37193,7 +37050,7 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 102,15,111,193 // movdqa %xmm1,%xmm0 .byte 102,15,97,194 // punpcklwd %xmm2,%xmm0 .byte 102,15,105,202 // punpckhwd %xmm2,%xmm1 - .byte 15,133,207,0,0,0 // jne 55e <_sk_srcover_rgba_8888_ssse3_lowp+0x1fa> + .byte 15,133,207,0,0,0 // jne 566 <_sk_srcover_rgba_8888_ssse3_lowp+0x1fa> .byte 243,65,15,127,76,147,16 // movdqu %xmm1,0x10(%r11,%rdx,4) .byte 243,65,15,127,4,147 // movdqu %xmm0,(%r11,%rdx,4) .byte 72,173 // lods %ds:(%rsi),%rax @@ -37208,9 +37065,9 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 69,15,87,192 // xorps %xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,172,254,255,255 // ja 37d <_sk_srcover_rgba_8888_ssse3_lowp+0x19> + .byte 15,135,172,254,255,255 // ja 385 <_sk_srcover_rgba_8888_ssse3_lowp+0x19> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,248,0,0,0 // lea 0xf8(%rip),%r10 # 5d4 <_sk_srcover_rgba_8888_ssse3_lowp+0x270> + .byte 76,141,21,248,0,0,0 // lea 0xf8(%rip),%r10 # 5dc <_sk_srcover_rgba_8888_ssse3_lowp+0x270> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -37235,14 +37092,14 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 68,15,40,196 // movaps %xmm4,%xmm8 .byte 243,65,15,16,36,147 // movss (%r11,%rdx,4),%xmm4 .byte 243,68,15,16,196 // movss %xmm4,%xmm8 - .byte 233,31,254,255,255 // jmpq 37d <_sk_srcover_rgba_8888_ssse3_lowp+0x19> + .byte 233,31,254,255,255 // jmpq 385 <_sk_srcover_rgba_8888_ssse3_lowp+0x19> .byte 69,137,193 // mov %r8d,%r9d .byte 65,128,225,7 // and $0x7,%r9b .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,42,255,255,255 // ja 49c <_sk_srcover_rgba_8888_ssse3_lowp+0x138> + .byte 15,135,42,255,255,255 // ja 4a4 <_sk_srcover_rgba_8888_ssse3_lowp+0x138> .byte 65,15,182,193 // movzbl %r9b,%eax - .byte 76,141,13,115,0,0,0 // lea 0x73(%rip),%r9 # 5f0 <_sk_srcover_rgba_8888_ssse3_lowp+0x28c> + .byte 76,141,13,115,0,0,0 // lea 0x73(%rip),%r9 # 5f8 <_sk_srcover_rgba_8888_ssse3_lowp+0x28c> .byte 73,99,4,129 // movslq (%r9,%rax,4),%rax .byte 76,1,200 // add %r9,%rax .byte 255,224 // jmpq *%rax @@ -37258,8 +37115,8 @@ _sk_srcover_rgba_8888_ssse3_lowp: .byte 102,15,112,200,229 // pshufd $0xe5,%xmm0,%xmm1 .byte 102,65,15,126,76,147,4 // movd %xmm1,0x4(%r11,%rdx,4) .byte 102,65,15,126,4,147 // movd %xmm0,(%r11,%rdx,4) - .byte 233,200,254,255,255 // jmpq 49c <_sk_srcover_rgba_8888_ssse3_lowp+0x138> - .byte 122,255 // jp 5d5 <_sk_srcover_rgba_8888_ssse3_lowp+0x271> + .byte 233,200,254,255,255 // jmpq 4a4 <_sk_srcover_rgba_8888_ssse3_lowp+0x138> + .byte 122,255 // jp 5dd <_sk_srcover_rgba_8888_ssse3_lowp+0x271> .byte 255 // (bad) .byte 255,101,255 // jmpq *-0x1(%rbp) .byte 255 // (bad) @@ -37298,7 +37155,7 @@ FUNCTION(_sk_scale_1_float_ssse3_lowp) _sk_scale_1_float_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 243,68,15,16,0 // movss (%rax),%xmm8 - .byte 243,68,15,89,5,192,8,0,0 // mulss 0x8c0(%rip),%xmm8 # edc <_sk_xor__ssse3_lowp+0x9f> + .byte 243,68,15,89,5,192,8,0,0 // mulss 0x8c0(%rip),%xmm8 # ee4 <_sk_xor__ssse3_lowp+0x9f> .byte 243,65,15,44,192 // cvttss2si %xmm8,%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 242,69,15,112,192,0 // pshuflw $0x0,%xmm8,%xmm8 @@ -37321,11 +37178,11 @@ _sk_scale_u8_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 117,74 // jne 6b6 <_sk_scale_u8_ssse3_lowp+0x54> + .byte 117,74 // jne 6be <_sk_scale_u8_ssse3_lowp+0x54> .byte 243,69,15,126,4,19 // movq (%r11,%rdx,1),%xmm8 .byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8 .byte 102,65,15,113,240,8 // psllw $0x8,%xmm8 - .byte 102,68,15,228,5,186,8,0,0 // pmulhuw 0x8ba(%rip),%xmm8 # f40 <_sk_xor__ssse3_lowp+0x103> + .byte 102,68,15,228,5,178,8,0,0 // pmulhuw 0x8b2(%rip),%xmm8 # f40 <_sk_xor__ssse3_lowp+0xfb> .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 .byte 102,15,56,29,192 // pabsw %xmm0,%xmm0 .byte 102,65,15,56,11,200 // pmulhrsw %xmm8,%xmm1 @@ -37341,9 +37198,9 @@ _sk_scale_u8_ssse3_lowp: .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 119,172 // ja 677 <_sk_scale_u8_ssse3_lowp+0x15> + .byte 119,172 // ja 67f <_sk_scale_u8_ssse3_lowp+0x15> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,102,0,0,0 // lea 0x66(%rip),%r10 # 73c <_sk_scale_u8_ssse3_lowp+0xda> + .byte 76,141,21,102,0,0,0 // lea 0x66(%rip),%r10 # 744 <_sk_scale_u8_ssse3_lowp+0xda> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -37362,7 +37219,7 @@ _sk_scale_u8_ssse3_lowp: .byte 102,68,15,196,192,1 // pinsrw $0x1,%eax,%xmm8 .byte 65,15,182,4,19 // movzbl (%r11,%rdx,1),%eax .byte 102,68,15,196,192,0 // pinsrw $0x0,%eax,%xmm8 - .byte 233,59,255,255,255 // jmpq 677 <_sk_scale_u8_ssse3_lowp+0x15> + .byte 233,59,255,255,255 // jmpq 67f <_sk_scale_u8_ssse3_lowp+0x15> .byte 240,255 // lock (bad) .byte 255 // (bad) .byte 255,228 // jmpq *%rsp @@ -37387,14 +37244,14 @@ FUNCTION(_sk_lerp_1_float_ssse3_lowp) _sk_lerp_1_float_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 243,68,15,16,0 // movss (%rax),%xmm8 - .byte 243,68,15,89,5,120,7,0,0 // mulss 0x778(%rip),%xmm8 # ee0 <_sk_xor__ssse3_lowp+0xa3> + .byte 243,68,15,89,5,120,7,0,0 // mulss 0x778(%rip),%xmm8 # ee8 <_sk_xor__ssse3_lowp+0xa3> .byte 243,65,15,44,192 // cvttss2si %xmm8,%eax .byte 102,68,15,110,192 // movd %eax,%xmm8 .byte 242,69,15,112,192,0 // pshuflw $0x0,%xmm8,%xmm8 .byte 102,69,15,112,192,80 // pshufd $0x50,%xmm8,%xmm8 .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 .byte 102,68,15,56,29,200 // pabsw %xmm0,%xmm9 - .byte 102,68,15,111,21,189,7,0,0 // movdqa 0x7bd(%rip),%xmm10 # f50 <_sk_xor__ssse3_lowp+0x113> + .byte 102,68,15,111,21,181,7,0,0 // movdqa 0x7b5(%rip),%xmm10 # f50 <_sk_xor__ssse3_lowp+0x10b> .byte 102,69,15,249,208 // psubw %xmm8,%xmm10 .byte 102,15,111,196 // movdqa %xmm4,%xmm0 .byte 102,65,15,56,11,194 // pmulhrsw %xmm10,%xmm0 @@ -37427,14 +37284,14 @@ _sk_lerp_u8_ssse3_lowp: .byte 72,173 // lods %ds:(%rsi),%rax .byte 76,139,24 // mov (%rax),%r11 .byte 77,133,192 // test %r8,%r8 - .byte 15,133,169,0,0,0 // jne 8c4 <_sk_lerp_u8_ssse3_lowp+0xb7> + .byte 15,133,169,0,0,0 // jne 8cc <_sk_lerp_u8_ssse3_lowp+0xb7> .byte 243,69,15,126,4,19 // movq (%r11,%rdx,1),%xmm8 .byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8 .byte 102,65,15,113,240,8 // psllw $0x8,%xmm8 - .byte 102,68,15,228,5,43,7,0,0 // pmulhuw 0x72b(%rip),%xmm8 # f60 <_sk_xor__ssse3_lowp+0x123> + .byte 102,68,15,228,5,35,7,0,0 // pmulhuw 0x723(%rip),%xmm8 # f60 <_sk_xor__ssse3_lowp+0x11b> .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 .byte 102,68,15,56,29,200 // pabsw %xmm0,%xmm9 - .byte 102,68,15,111,21,38,7,0,0 // movdqa 0x726(%rip),%xmm10 # f70 <_sk_xor__ssse3_lowp+0x133> + .byte 102,68,15,111,21,30,7,0,0 // movdqa 0x71e(%rip),%xmm10 # f70 <_sk_xor__ssse3_lowp+0x12b> .byte 102,69,15,249,208 // psubw %xmm8,%xmm10 .byte 102,15,111,196 // movdqa %xmm4,%xmm0 .byte 102,65,15,56,11,194 // pmulhrsw %xmm10,%xmm0 @@ -37464,9 +37321,9 @@ _sk_lerp_u8_ssse3_lowp: .byte 102,69,15,239,192 // pxor %xmm8,%xmm8 .byte 65,254,201 // dec %r9b .byte 65,128,249,6 // cmp $0x6,%r9b - .byte 15,135,73,255,255,255 // ja 826 <_sk_lerp_u8_ssse3_lowp+0x19> + .byte 15,135,73,255,255,255 // ja 82e <_sk_lerp_u8_ssse3_lowp+0x19> .byte 69,15,182,201 // movzbl %r9b,%r9d - .byte 76,141,21,104,0,0,0 // lea 0x68(%rip),%r10 # 950 <_sk_lerp_u8_ssse3_lowp+0x143> + .byte 76,141,21,104,0,0,0 // lea 0x68(%rip),%r10 # 958 <_sk_lerp_u8_ssse3_lowp+0x143> .byte 75,99,4,138 // movslq (%r10,%r9,4),%rax .byte 76,1,208 // add %r10,%rax .byte 255,224 // jmpq *%rax @@ -37485,7 +37342,7 @@ _sk_lerp_u8_ssse3_lowp: .byte 102,68,15,196,192,1 // pinsrw $0x1,%eax,%xmm8 .byte 65,15,182,4,19 // movzbl (%r11,%rdx,1),%eax .byte 102,68,15,196,192,0 // pinsrw $0x0,%eax,%xmm8 - .byte 233,216,254,255,255 // jmpq 826 <_sk_lerp_u8_ssse3_lowp+0x19> + .byte 233,216,254,255,255 // jmpq 82e <_sk_lerp_u8_ssse3_lowp+0x19> .byte 102,144 // xchg %ax,%ax .byte 238 // out %al,(%dx) .byte 255 // (bad) @@ -37577,7 +37434,7 @@ FUNCTION(_sk_srcatop_ssse3_lowp) _sk_srcatop_ssse3_lowp: .byte 102,15,56,11,199 // pmulhrsw %xmm7,%xmm0 .byte 102,68,15,56,29,192 // pabsw %xmm0,%xmm8 - .byte 102,68,15,111,13,145,5,0,0 // movdqa 0x591(%rip),%xmm9 # f80 <_sk_xor__ssse3_lowp+0x143> + .byte 102,68,15,111,13,137,5,0,0 // movdqa 0x589(%rip),%xmm9 # f80 <_sk_xor__ssse3_lowp+0x13b> .byte 102,68,15,249,203 // psubw %xmm3,%xmm9 .byte 102,15,111,196 // movdqa %xmm4,%xmm0 .byte 102,65,15,56,11,193 // pmulhrsw %xmm9,%xmm0 @@ -37610,7 +37467,7 @@ _sk_dstatop_ssse3_lowp: .byte 102,68,15,111,196 // movdqa %xmm4,%xmm8 .byte 102,68,15,56,11,195 // pmulhrsw %xmm3,%xmm8 .byte 102,69,15,56,29,192 // pabsw %xmm8,%xmm8 - .byte 102,68,15,111,13,16,5,0,0 // movdqa 0x510(%rip),%xmm9 # f90 <_sk_xor__ssse3_lowp+0x153> + .byte 102,68,15,111,13,8,5,0,0 // movdqa 0x508(%rip),%xmm9 # f90 <_sk_xor__ssse3_lowp+0x14b> .byte 102,68,15,249,207 // psubw %xmm7,%xmm9 .byte 102,65,15,56,11,193 // pmulhrsw %xmm9,%xmm0 .byte 102,15,56,29,192 // pabsw %xmm0,%xmm0 @@ -37673,7 +37530,7 @@ HIDDEN _sk_srcout_ssse3_lowp .globl _sk_srcout_ssse3_lowp FUNCTION(_sk_srcout_ssse3_lowp) _sk_srcout_ssse3_lowp: - .byte 102,68,15,111,5,54,4,0,0 // movdqa 0x436(%rip),%xmm8 # fa0 <_sk_xor__ssse3_lowp+0x163> + .byte 102,68,15,111,5,46,4,0,0 // movdqa 0x42e(%rip),%xmm8 # fa0 <_sk_xor__ssse3_lowp+0x15b> .byte 102,68,15,249,199 // psubw %xmm7,%xmm8 .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 .byte 102,15,56,29,192 // pabsw %xmm0,%xmm0 @@ -37690,7 +37547,7 @@ HIDDEN _sk_dstout_ssse3_lowp .globl _sk_dstout_ssse3_lowp FUNCTION(_sk_dstout_ssse3_lowp) _sk_dstout_ssse3_lowp: - .byte 102,68,15,111,5,7,4,0,0 // movdqa 0x407(%rip),%xmm8 # fb0 <_sk_xor__ssse3_lowp+0x173> + .byte 102,68,15,111,5,255,3,0,0 // movdqa 0x3ff(%rip),%xmm8 # fb0 <_sk_xor__ssse3_lowp+0x16b> .byte 102,68,15,249,195 // psubw %xmm3,%xmm8 .byte 102,15,111,196 // movdqa %xmm4,%xmm0 .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 @@ -37710,7 +37567,7 @@ HIDDEN _sk_srcover_ssse3_lowp .globl _sk_srcover_ssse3_lowp FUNCTION(_sk_srcover_ssse3_lowp) _sk_srcover_ssse3_lowp: - .byte 102,68,15,111,5,204,3,0,0 // movdqa 0x3cc(%rip),%xmm8 # fc0 <_sk_xor__ssse3_lowp+0x183> + .byte 102,68,15,111,5,196,3,0,0 // movdqa 0x3c4(%rip),%xmm8 # fc0 <_sk_xor__ssse3_lowp+0x17b> .byte 102,68,15,249,195 // psubw %xmm3,%xmm8 .byte 102,68,15,111,204 // movdqa %xmm4,%xmm9 .byte 102,69,15,56,11,200 // pmulhrsw %xmm8,%xmm9 @@ -37734,7 +37591,7 @@ HIDDEN _sk_dstover_ssse3_lowp .globl _sk_dstover_ssse3_lowp FUNCTION(_sk_dstover_ssse3_lowp) _sk_dstover_ssse3_lowp: - .byte 102,68,15,111,5,119,3,0,0 // movdqa 0x377(%rip),%xmm8 # fd0 <_sk_xor__ssse3_lowp+0x193> + .byte 102,68,15,111,5,111,3,0,0 // movdqa 0x36f(%rip),%xmm8 # fd0 <_sk_xor__ssse3_lowp+0x18b> .byte 102,68,15,249,199 // psubw %xmm7,%xmm8 .byte 102,65,15,56,11,192 // pmulhrsw %xmm8,%xmm0 .byte 102,15,56,29,192 // pabsw %xmm0,%xmm0 @@ -37770,7 +37627,7 @@ HIDDEN _sk_multiply_ssse3_lowp .globl _sk_multiply_ssse3_lowp FUNCTION(_sk_multiply_ssse3_lowp) _sk_multiply_ssse3_lowp: - .byte 102,68,15,111,5,12,3,0,0 // movdqa 0x30c(%rip),%xmm8 # fe0 <_sk_xor__ssse3_lowp+0x1a3> + .byte 102,68,15,111,5,4,3,0,0 // movdqa 0x304(%rip),%xmm8 # fe0 <_sk_xor__ssse3_lowp+0x19b> .byte 102,69,15,111,200 // movdqa %xmm8,%xmm9 .byte 102,68,15,249,207 // psubw %xmm7,%xmm9 .byte 102,68,15,111,208 // movdqa %xmm0,%xmm10 @@ -37830,7 +37687,7 @@ HIDDEN _sk_screen_ssse3_lowp .globl _sk_screen_ssse3_lowp FUNCTION(_sk_screen_ssse3_lowp) _sk_screen_ssse3_lowp: - .byte 102,68,15,111,5,30,2,0,0 // movdqa 0x21e(%rip),%xmm8 # ff0 <_sk_xor__ssse3_lowp+0x1b3> + .byte 102,68,15,111,5,22,2,0,0 // movdqa 0x216(%rip),%xmm8 # ff0 <_sk_xor__ssse3_lowp+0x1ab> .byte 102,69,15,111,200 // movdqa %xmm8,%xmm9 .byte 102,68,15,249,200 // psubw %xmm0,%xmm9 .byte 102,68,15,56,11,204 // pmulhrsw %xmm4,%xmm9 @@ -37857,7 +37714,7 @@ HIDDEN _sk_xor__ssse3_lowp .globl _sk_xor__ssse3_lowp FUNCTION(_sk_xor__ssse3_lowp) _sk_xor__ssse3_lowp: - .byte 102,68,15,111,5,186,1,0,0 // movdqa 0x1ba(%rip),%xmm8 # 1000 <_sk_xor__ssse3_lowp+0x1c3> + .byte 102,68,15,111,5,178,1,0,0 // movdqa 0x1b2(%rip),%xmm8 # 1000 <_sk_xor__ssse3_lowp+0x1bb> .byte 102,69,15,111,200 // movdqa %xmm8,%xmm9 .byte 102,68,15,249,207 // psubw %xmm7,%xmm9 .byte 102,65,15,56,11,193 // pmulhrsw %xmm9,%xmm0 @@ -37904,7 +37761,7 @@ BALIGN16 .byte 11,15 // or (%rdi),%ecx .byte 129,128,129,128,129,128,129,128,129,128// addl $0x80818081,-0x7f7e7f7f(%rax) .byte 129,128,129,128,129,128,0,4,8,12 // addl $0xc080400,-0x7f7e7f7f(%rax) - .byte 1,5,9,13,2,6 // add %eax,0x6020d09(%rip) # 6021c23 <_sk_xor__ssse3_lowp+0x6020de6> + .byte 1,5,9,13,2,6 // add %eax,0x6020d09(%rip) # 6021c23 <_sk_xor__ssse3_lowp+0x6020dde> .byte 10,14 // or (%rsi),%cl .byte 3,7 // add (%rdi),%eax .byte 11,15 // or (%rdi),%ecx diff --git a/src/jumper/SkJumper_generated_win.S b/src/jumper/SkJumper_generated_win.S index 1368f2b8ce..4c82299b8f 100644 --- a/src/jumper/SkJumper_generated_win.S +++ b/src/jumper/SkJumper_generated_win.S @@ -12,38 +12,39 @@ ALIGN 32 PUBLIC _sk_start_pipeline_hsw _sk_start_pipeline_hsw LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 86 ; push %rsi DB 87 ; push %rdi - DB 85 ; push %rbp DB 83 ; push %rbx - DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp - DB 197,120,41,188,36,144,0,0,0 ; vmovaps %xmm15,0x90(%rsp) - DB 197,120,41,180,36,128,0,0,0 ; vmovaps %xmm14,0x80(%rsp) - DB 197,120,41,108,36,112 ; vmovaps %xmm13,0x70(%rsp) - DB 197,120,41,100,36,96 ; vmovaps %xmm12,0x60(%rsp) - DB 197,120,41,92,36,80 ; vmovaps %xmm11,0x50(%rsp) - DB 197,120,41,84,36,64 ; vmovaps %xmm10,0x40(%rsp) - DB 197,120,41,76,36,48 ; vmovaps %xmm9,0x30(%rsp) - DB 197,120,41,68,36,32 ; vmovaps %xmm8,0x20(%rsp) - DB 197,248,41,124,36,16 ; vmovaps %xmm7,0x10(%rsp) - DB 197,248,41,52,36 ; vmovaps %xmm6,(%rsp) - DB 76,137,195 ; mov %r8,%rbx - DB 73,137,214 ; mov %rdx,%r14 - DB 72,137,205 ; mov %rcx,%rbp - DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15 + DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp + DB 197,120,41,125,176 ; vmovaps %xmm15,-0x50(%rbp) + DB 197,120,41,117,160 ; vmovaps %xmm14,-0x60(%rbp) + DB 197,120,41,109,144 ; vmovaps %xmm13,-0x70(%rbp) + DB 197,120,41,101,128 ; vmovaps %xmm12,-0x80(%rbp) + DB 197,120,41,157,112,255,255,255 ; vmovaps %xmm11,-0x90(%rbp) + DB 197,120,41,149,96,255,255,255 ; vmovaps %xmm10,-0xa0(%rbp) + DB 197,120,41,141,80,255,255,255 ; vmovaps %xmm9,-0xb0(%rbp) + DB 197,120,41,133,64,255,255,255 ; vmovaps %xmm8,-0xc0(%rbp) + DB 197,248,41,189,48,255,255,255 ; vmovaps %xmm7,-0xd0(%rbp) + DB 197,248,41,181,32,255,255,255 ; vmovaps %xmm6,-0xe0(%rbp) + DB 72,137,211 ; mov %rdx,%rbx + DB 73,137,207 ; mov %rcx,%r15 + DB 76,139,117,48 ; mov 0x30(%rbp),%r14 DB 76,137,206 ; mov %r9,%rsi DB 72,173 ; lods %ds:(%rsi),%rax - DB 73,137,196 ; mov %rax,%r12 - DB 73,137,245 ; mov %rsi,%r13 - DB 72,141,69,8 ; lea 0x8(%rbp),%rax - DB 72,57,216 ; cmp %rbx,%rax - DB 118,5 ; jbe 7e <_sk_start_pipeline_hsw+0x7e> - DB 72,137,234 ; mov %rbp,%rdx - DB 235,69 ; jmp c3 <_sk_start_pipeline_hsw+0xc3> + DB 73,137,197 ; mov %rax,%r13 + DB 73,137,244 ; mov %rsi,%r12 + DB 73,141,79,8 ; lea 0x8(%r15),%rcx + DB 76,57,193 ; cmp %r8,%rcx + DB 118,5 ; jbe 7d <_sk_start_pipeline_hsw+0x7d> + DB 76,137,250 ; mov %r15,%rdx + DB 235,83 ; jmp d0 <_sk_start_pipeline_hsw+0xd0> + DB 76,137,133,24,255,255,255 ; mov %r8,-0xe8(%rbp) DB 65,184,0,0,0,0 ; mov $0x0,%r8d DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 @@ -53,18 +54,19 @@ _sk_start_pipeline_hsw LABEL PROC DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6 DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 72,137,234 ; mov %rbp,%rdx - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 - DB 72,141,85,8 ; lea 0x8(%rbp),%rdx - DB 72,131,197,16 ; add $0x10,%rbp - DB 72,57,221 ; cmp %rbx,%rbp - DB 72,137,213 ; mov %rdx,%rbp - DB 118,187 ; jbe 7e <_sk_start_pipeline_hsw+0x7e> - DB 72,41,211 ; sub %rdx,%rbx - DB 116,47 ; je f7 <_sk_start_pipeline_hsw+0xf7> + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,250 ; mov %r15,%rdx + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 76,139,133,24,255,255,255 ; mov -0xe8(%rbp),%r8 + DB 73,141,87,8 ; lea 0x8(%r15),%rdx + DB 73,131,199,16 ; add $0x10,%r15 + DB 77,57,199 ; cmp %r8,%r15 + DB 73,137,215 ; mov %rdx,%r15 + DB 118,180 ; jbe 84 <_sk_start_pipeline_hsw+0x84> + DB 73,41,208 ; sub %rdx,%r8 + DB 116,44 ; je 101 <_sk_start_pipeline_hsw+0x101> DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2 @@ -73,30 +75,29 @@ _sk_start_pipeline_hsw LABEL PROC DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6 DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 76,137,241 ; mov %r14,%rcx - DB 73,137,216 ; mov %rbx,%r8 - DB 65,255,212 ; callq *%r12 - DB 197,248,40,52,36 ; vmovaps (%rsp),%xmm6 - DB 197,248,40,124,36,16 ; vmovaps 0x10(%rsp),%xmm7 - DB 197,120,40,68,36,32 ; vmovaps 0x20(%rsp),%xmm8 - DB 197,120,40,76,36,48 ; vmovaps 0x30(%rsp),%xmm9 - DB 197,120,40,84,36,64 ; vmovaps 0x40(%rsp),%xmm10 - DB 197,120,40,92,36,80 ; vmovaps 0x50(%rsp),%xmm11 - DB 197,120,40,100,36,96 ; vmovaps 0x60(%rsp),%xmm12 - DB 197,120,40,108,36,112 ; vmovaps 0x70(%rsp),%xmm13 - DB 197,120,40,180,36,128,0,0,0 ; vmovaps 0x80(%rsp),%xmm14 - DB 197,120,40,188,36,144,0,0,0 ; vmovaps 0x90(%rsp),%xmm15 - DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 197,248,40,181,32,255,255,255 ; vmovaps -0xe0(%rbp),%xmm6 + DB 197,248,40,189,48,255,255,255 ; vmovaps -0xd0(%rbp),%xmm7 + DB 197,120,40,133,64,255,255,255 ; vmovaps -0xc0(%rbp),%xmm8 + DB 197,120,40,141,80,255,255,255 ; vmovaps -0xb0(%rbp),%xmm9 + DB 197,120,40,149,96,255,255,255 ; vmovaps -0xa0(%rbp),%xmm10 + DB 197,120,40,157,112,255,255,255 ; vmovaps -0x90(%rbp),%xmm11 + DB 197,120,40,101,128 ; vmovaps -0x80(%rbp),%xmm12 + DB 197,120,40,109,144 ; vmovaps -0x70(%rbp),%xmm13 + DB 197,120,40,117,160 ; vmovaps -0x60(%rbp),%xmm14 + DB 197,120,40,125,176 ; vmovaps -0x50(%rbp),%xmm15 + DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp DB 91 ; pop %rbx - DB 93 ; pop %rbp DB 95 ; pop %rdi DB 94 ; pop %rsi DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 197,248,119 ; vzeroupper DB 195 ; retq @@ -109,7 +110,7 @@ _sk_seed_shader_hsw LABEL PROC DB 197,249,110,194 ; vmovd %edx,%xmm0 DB 196,226,125,88,192 ; vpbroadcastd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,42,73,0,0 ; vbroadcastss 0x492a(%rip),%ymm1 # 4a90 <_sk_callback_hsw+0x124> + DB 196,226,125,24,13,213,72,0,0 ; vbroadcastss 0x48d5(%rip),%ymm1 # 4a48 <_sk_callback_hsw+0x12c> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0 DB 197,249,110,209 ; vmovd %ecx,%xmm2 @@ -117,7 +118,7 @@ _sk_seed_shader_hsw LABEL PROC DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,21,10,73,0,0 ; vbroadcastss 0x490a(%rip),%ymm2 # 4a94 <_sk_callback_hsw+0x128> + DB 196,226,125,24,21,181,72,0,0 ; vbroadcastss 0x48b5(%rip),%ymm2 # 4a4c <_sk_callback_hsw+0x130> DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3 DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4 DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 @@ -134,13 +135,13 @@ _sk_dither_hsw LABEL PROC DB 197,121,110,201 ; vmovd %ecx,%xmm9 DB 196,66,125,88,201 ; vpbroadcastd %xmm9,%ymm9 DB 196,65,53,239,200 ; vpxor %ymm8,%ymm9,%ymm9 - DB 196,98,125,88,21,209,72,0,0 ; vpbroadcastd 0x48d1(%rip),%ymm10 # 4a98 <_sk_callback_hsw+0x12c> + DB 196,98,125,88,21,124,72,0,0 ; vpbroadcastd 0x487c(%rip),%ymm10 # 4a50 <_sk_callback_hsw+0x134> DB 196,65,53,219,218 ; vpand %ymm10,%ymm9,%ymm11 DB 196,193,37,114,243,5 ; vpslld $0x5,%ymm11,%ymm11 DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10 DB 196,193,45,114,242,4 ; vpslld $0x4,%ymm10,%ymm10 - DB 196,98,125,88,37,182,72,0,0 ; vpbroadcastd 0x48b6(%rip),%ymm12 # 4a9c <_sk_callback_hsw+0x130> - DB 196,98,125,88,45,177,72,0,0 ; vpbroadcastd 0x48b1(%rip),%ymm13 # 4aa0 <_sk_callback_hsw+0x134> + DB 196,98,125,88,37,97,72,0,0 ; vpbroadcastd 0x4861(%rip),%ymm12 # 4a54 <_sk_callback_hsw+0x138> + DB 196,98,125,88,45,92,72,0,0 ; vpbroadcastd 0x485c(%rip),%ymm13 # 4a58 <_sk_callback_hsw+0x13c> DB 196,65,53,219,245 ; vpand %ymm13,%ymm9,%ymm14 DB 196,193,13,114,246,2 ; vpslld $0x2,%ymm14,%ymm14 DB 196,65,61,219,237 ; vpand %ymm13,%ymm8,%ymm13 @@ -155,8 +156,8 @@ _sk_dither_hsw LABEL PROC DB 196,65,61,235,194 ; vpor %ymm10,%ymm8,%ymm8 DB 196,65,61,235,193 ; vpor %ymm9,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,99,72,0,0 ; vbroadcastss 0x4863(%rip),%ymm9 # 4aa4 <_sk_callback_hsw+0x138> - DB 196,98,125,24,21,94,72,0,0 ; vbroadcastss 0x485e(%rip),%ymm10 # 4aa8 <_sk_callback_hsw+0x13c> + DB 196,98,125,24,13,14,72,0,0 ; vbroadcastss 0x480e(%rip),%ymm9 # 4a5c <_sk_callback_hsw+0x140> + DB 196,98,125,24,21,9,72,0,0 ; vbroadcastss 0x4809(%rip),%ymm10 # 4a60 <_sk_callback_hsw+0x144> DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10 DB 196,98,125,24,0 ; vbroadcastss (%rax),%ymm8 DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8 @@ -215,7 +216,7 @@ _sk_clear_hsw LABEL PROC PUBLIC _sk_srcatop_hsw _sk_srcatop_hsw LABEL PROC DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0 - DB 196,98,125,24,5,182,71,0,0 ; vbroadcastss 0x47b6(%rip),%ymm8 # 4aac <_sk_callback_hsw+0x140> + DB 196,98,125,24,5,97,71,0,0 ; vbroadcastss 0x4761(%rip),%ymm8 # 4a64 <_sk_callback_hsw+0x148> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,226,61,184,196 ; vfmadd231ps %ymm4,%ymm8,%ymm0 DB 197,244,89,207 ; vmulps %ymm7,%ymm1,%ymm1 @@ -229,7 +230,7 @@ _sk_srcatop_hsw LABEL PROC PUBLIC _sk_dstatop_hsw _sk_dstatop_hsw LABEL PROC - DB 196,98,125,24,5,137,71,0,0 ; vbroadcastss 0x4789(%rip),%ymm8 # 4ab0 <_sk_callback_hsw+0x144> + DB 196,98,125,24,5,52,71,0,0 ; vbroadcastss 0x4734(%rip),%ymm8 # 4a68 <_sk_callback_hsw+0x14c> DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 196,226,101,184,196 ; vfmadd231ps %ymm4,%ymm3,%ymm0 @@ -262,7 +263,7 @@ _sk_dstin_hsw LABEL PROC PUBLIC _sk_srcout_hsw _sk_srcout_hsw LABEL PROC - DB 196,98,125,24,5,48,71,0,0 ; vbroadcastss 0x4730(%rip),%ymm8 # 4ab4 <_sk_callback_hsw+0x148> + DB 196,98,125,24,5,219,70,0,0 ; vbroadcastss 0x46db(%rip),%ymm8 # 4a6c <_sk_callback_hsw+0x150> DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 @@ -273,7 +274,7 @@ _sk_srcout_hsw LABEL PROC PUBLIC _sk_dstout_hsw _sk_dstout_hsw LABEL PROC - DB 196,226,125,24,5,19,71,0,0 ; vbroadcastss 0x4713(%rip),%ymm0 # 4ab8 <_sk_callback_hsw+0x14c> + DB 196,226,125,24,5,190,70,0,0 ; vbroadcastss 0x46be(%rip),%ymm0 # 4a70 <_sk_callback_hsw+0x154> DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3 DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0 DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1 @@ -284,7 +285,7 @@ _sk_dstout_hsw LABEL PROC PUBLIC _sk_srcover_hsw _sk_srcover_hsw LABEL PROC - DB 196,98,125,24,5,246,70,0,0 ; vbroadcastss 0x46f6(%rip),%ymm8 # 4abc <_sk_callback_hsw+0x150> + DB 196,98,125,24,5,161,70,0,0 ; vbroadcastss 0x46a1(%rip),%ymm8 # 4a74 <_sk_callback_hsw+0x158> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0 DB 196,194,85,184,200 ; vfmadd231ps %ymm8,%ymm5,%ymm1 @@ -295,7 +296,7 @@ _sk_srcover_hsw LABEL PROC PUBLIC _sk_dstover_hsw _sk_dstover_hsw LABEL PROC - DB 196,98,125,24,5,213,70,0,0 ; vbroadcastss 0x46d5(%rip),%ymm8 # 4ac0 <_sk_callback_hsw+0x154> + DB 196,98,125,24,5,128,70,0,0 ; vbroadcastss 0x4680(%rip),%ymm8 # 4a78 <_sk_callback_hsw+0x15c> DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8 DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0 DB 196,226,61,168,205 ; vfmadd213ps %ymm5,%ymm8,%ymm1 @@ -315,7 +316,7 @@ _sk_modulate_hsw LABEL PROC PUBLIC _sk_multiply_hsw _sk_multiply_hsw LABEL PROC - DB 196,98,125,24,5,160,70,0,0 ; vbroadcastss 0x46a0(%rip),%ymm8 # 4ac4 <_sk_callback_hsw+0x158> + DB 196,98,125,24,5,75,70,0,0 ; vbroadcastss 0x464b(%rip),%ymm8 # 4a7c <_sk_callback_hsw+0x160> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -357,7 +358,7 @@ _sk_screen_hsw LABEL PROC PUBLIC _sk_xor__hsw _sk_xor__hsw LABEL PROC - DB 196,98,125,24,5,27,70,0,0 ; vbroadcastss 0x461b(%rip),%ymm8 # 4ac8 <_sk_callback_hsw+0x15c> + DB 196,98,125,24,5,198,69,0,0 ; vbroadcastss 0x45c6(%rip),%ymm8 # 4a80 <_sk_callback_hsw+0x164> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -389,7 +390,7 @@ _sk_darken_hsw LABEL PROC DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9 DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,163,69,0,0 ; vbroadcastss 0x45a3(%rip),%ymm8 # 4acc <_sk_callback_hsw+0x160> + DB 196,98,125,24,5,78,69,0,0 ; vbroadcastss 0x454e(%rip),%ymm8 # 4a84 <_sk_callback_hsw+0x168> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax @@ -412,7 +413,7 @@ _sk_lighten_hsw LABEL PROC DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9 DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,82,69,0,0 ; vbroadcastss 0x4552(%rip),%ymm8 # 4ad0 <_sk_callback_hsw+0x164> + DB 196,98,125,24,5,253,68,0,0 ; vbroadcastss 0x44fd(%rip),%ymm8 # 4a88 <_sk_callback_hsw+0x16c> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax @@ -438,7 +439,7 @@ _sk_difference_hsw LABEL PROC DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2 DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,245,68,0,0 ; vbroadcastss 0x44f5(%rip),%ymm8 # 4ad4 <_sk_callback_hsw+0x168> + DB 196,98,125,24,5,160,68,0,0 ; vbroadcastss 0x44a0(%rip),%ymm8 # 4a8c <_sk_callback_hsw+0x170> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax @@ -458,7 +459,7 @@ _sk_exclusion_hsw LABEL PROC DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2 DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,179,68,0,0 ; vbroadcastss 0x44b3(%rip),%ymm8 # 4ad8 <_sk_callback_hsw+0x16c> + DB 196,98,125,24,5,94,68,0,0 ; vbroadcastss 0x445e(%rip),%ymm8 # 4a90 <_sk_callback_hsw+0x174> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax @@ -466,7 +467,7 @@ _sk_exclusion_hsw LABEL PROC PUBLIC _sk_colorburn_hsw _sk_colorburn_hsw LABEL PROC - DB 196,98,125,24,5,161,68,0,0 ; vbroadcastss 0x44a1(%rip),%ymm8 # 4adc <_sk_callback_hsw+0x170> + DB 196,98,125,24,5,76,68,0,0 ; vbroadcastss 0x444c(%rip),%ymm8 # 4a94 <_sk_callback_hsw+0x178> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11 DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10 @@ -522,7 +523,7 @@ _sk_colorburn_hsw LABEL PROC PUBLIC _sk_colordodge_hsw _sk_colordodge_hsw LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 - DB 196,98,125,24,13,172,67,0,0 ; vbroadcastss 0x43ac(%rip),%ymm9 # 4ae0 <_sk_callback_hsw+0x174> + DB 196,98,125,24,13,87,67,0,0 ; vbroadcastss 0x4357(%rip),%ymm9 # 4a98 <_sk_callback_hsw+0x17c> DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10 DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11 DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9 @@ -573,7 +574,7 @@ _sk_colordodge_hsw LABEL PROC PUBLIC _sk_hardlight_hsw _sk_hardlight_hsw LABEL PROC - DB 196,98,125,24,5,205,66,0,0 ; vbroadcastss 0x42cd(%rip),%ymm8 # 4ae4 <_sk_callback_hsw+0x178> + DB 196,98,125,24,5,120,66,0,0 ; vbroadcastss 0x4278(%rip),%ymm8 # 4a9c <_sk_callback_hsw+0x180> DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10 DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -622,7 +623,7 @@ _sk_hardlight_hsw LABEL PROC PUBLIC _sk_overlay_hsw _sk_overlay_hsw LABEL PROC - DB 196,98,125,24,5,5,66,0,0 ; vbroadcastss 0x4205(%rip),%ymm8 # 4ae8 <_sk_callback_hsw+0x17c> + DB 196,98,125,24,5,176,65,0,0 ; vbroadcastss 0x41b0(%rip),%ymm8 # 4aa0 <_sk_callback_hsw+0x184> DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10 DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -682,10 +683,10 @@ _sk_softlight_hsw LABEL PROC DB 196,65,20,88,197 ; vaddps %ymm13,%ymm13,%ymm8 DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8 DB 196,66,61,168,192 ; vfmadd213ps %ymm8,%ymm8,%ymm8 - DB 196,98,125,24,29,12,65,0,0 ; vbroadcastss 0x410c(%rip),%ymm11 # 4af0 <_sk_callback_hsw+0x184> + DB 196,98,125,24,29,183,64,0,0 ; vbroadcastss 0x40b7(%rip),%ymm11 # 4aa8 <_sk_callback_hsw+0x18c> DB 196,65,20,88,227 ; vaddps %ymm11,%ymm13,%ymm12 DB 196,65,28,89,192 ; vmulps %ymm8,%ymm12,%ymm8 - DB 196,98,125,24,37,253,64,0,0 ; vbroadcastss 0x40fd(%rip),%ymm12 # 4af4 <_sk_callback_hsw+0x188> + DB 196,98,125,24,37,168,64,0,0 ; vbroadcastss 0x40a8(%rip),%ymm12 # 4aac <_sk_callback_hsw+0x190> DB 196,66,21,184,196 ; vfmadd231ps %ymm12,%ymm13,%ymm8 DB 196,65,124,82,245 ; vrsqrtps %ymm13,%ymm14 DB 196,65,124,83,246 ; vrcpps %ymm14,%ymm14 @@ -695,7 +696,7 @@ _sk_softlight_hsw LABEL PROC DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15 DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14 DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15 - DB 196,98,125,24,5,192,64,0,0 ; vbroadcastss 0x40c0(%rip),%ymm8 # 4aec <_sk_callback_hsw+0x180> + DB 196,98,125,24,5,107,64,0,0 ; vbroadcastss 0x406b(%rip),%ymm8 # 4aa4 <_sk_callback_hsw+0x188> DB 196,65,60,92,237 ; vsubps %ymm13,%ymm8,%ymm13 DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0 DB 196,98,125,168,235 ; vfmadd213ps %ymm3,%ymm0,%ymm13 @@ -808,11 +809,11 @@ _sk_hue_hsw LABEL PROC DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10 DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10 DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12 - DB 196,98,125,24,53,191,62,0,0 ; vbroadcastss 0x3ebf(%rip),%ymm14 # 4af8 <_sk_callback_hsw+0x18c> - DB 196,98,125,24,61,186,62,0,0 ; vbroadcastss 0x3eba(%rip),%ymm15 # 4afc <_sk_callback_hsw+0x190> + DB 196,98,125,24,53,106,62,0,0 ; vbroadcastss 0x3e6a(%rip),%ymm14 # 4ab0 <_sk_callback_hsw+0x194> + DB 196,98,125,24,61,101,62,0,0 ; vbroadcastss 0x3e65(%rip),%ymm15 # 4ab4 <_sk_callback_hsw+0x198> DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13 DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13 - DB 196,226,125,24,5,171,62,0,0 ; vbroadcastss 0x3eab(%rip),%ymm0 # 4b00 <_sk_callback_hsw+0x194> + DB 196,226,125,24,5,86,62,0,0 ; vbroadcastss 0x3e56(%rip),%ymm0 # 4ab8 <_sk_callback_hsw+0x19c> DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13 DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10 DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10 @@ -867,7 +868,7 @@ _sk_hue_hsw LABEL PROC DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0 DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9 DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8 - DB 196,226,125,24,13,152,61,0,0 ; vbroadcastss 0x3d98(%rip),%ymm1 # 4b04 <_sk_callback_hsw+0x198> + DB 196,226,125,24,13,67,61,0,0 ; vbroadcastss 0x3d43(%rip),%ymm1 # 4abc <_sk_callback_hsw+0x1a0> DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11 @@ -921,11 +922,11 @@ _sk_saturation_hsw LABEL PROC DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10 DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10 DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12 - DB 196,98,125,24,53,169,60,0,0 ; vbroadcastss 0x3ca9(%rip),%ymm14 # 4b08 <_sk_callback_hsw+0x19c> - DB 196,98,125,24,61,164,60,0,0 ; vbroadcastss 0x3ca4(%rip),%ymm15 # 4b0c <_sk_callback_hsw+0x1a0> + DB 196,98,125,24,53,84,60,0,0 ; vbroadcastss 0x3c54(%rip),%ymm14 # 4ac0 <_sk_callback_hsw+0x1a4> + DB 196,98,125,24,61,79,60,0,0 ; vbroadcastss 0x3c4f(%rip),%ymm15 # 4ac4 <_sk_callback_hsw+0x1a8> DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13 DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13 - DB 196,226,125,24,5,149,60,0,0 ; vbroadcastss 0x3c95(%rip),%ymm0 # 4b10 <_sk_callback_hsw+0x1a4> + DB 196,226,125,24,5,64,60,0,0 ; vbroadcastss 0x3c40(%rip),%ymm0 # 4ac8 <_sk_callback_hsw+0x1ac> DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13 DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10 DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10 @@ -980,7 +981,7 @@ _sk_saturation_hsw LABEL PROC DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0 DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9 DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8 - DB 196,226,125,24,13,130,59,0,0 ; vbroadcastss 0x3b82(%rip),%ymm1 # 4b14 <_sk_callback_hsw+0x1a8> + DB 196,226,125,24,13,45,59,0,0 ; vbroadcastss 0x3b2d(%rip),%ymm1 # 4acc <_sk_callback_hsw+0x1b0> DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11 @@ -1008,11 +1009,11 @@ _sk_color_hsw LABEL PROC DB 197,108,89,199 ; vmulps %ymm7,%ymm2,%ymm8 DB 197,116,89,215 ; vmulps %ymm7,%ymm1,%ymm10 DB 197,52,89,223 ; vmulps %ymm7,%ymm9,%ymm11 - DB 196,98,125,24,45,21,59,0,0 ; vbroadcastss 0x3b15(%rip),%ymm13 # 4b18 <_sk_callback_hsw+0x1ac> - DB 196,98,125,24,53,16,59,0,0 ; vbroadcastss 0x3b10(%rip),%ymm14 # 4b1c <_sk_callback_hsw+0x1b0> + DB 196,98,125,24,45,192,58,0,0 ; vbroadcastss 0x3ac0(%rip),%ymm13 # 4ad0 <_sk_callback_hsw+0x1b4> + DB 196,98,125,24,53,187,58,0,0 ; vbroadcastss 0x3abb(%rip),%ymm14 # 4ad4 <_sk_callback_hsw+0x1b8> DB 196,65,84,89,230 ; vmulps %ymm14,%ymm5,%ymm12 DB 196,66,93,184,229 ; vfmadd231ps %ymm13,%ymm4,%ymm12 - DB 196,98,125,24,61,1,59,0,0 ; vbroadcastss 0x3b01(%rip),%ymm15 # 4b20 <_sk_callback_hsw+0x1b4> + DB 196,98,125,24,61,172,58,0,0 ; vbroadcastss 0x3aac(%rip),%ymm15 # 4ad8 <_sk_callback_hsw+0x1bc> DB 196,66,77,184,231 ; vfmadd231ps %ymm15,%ymm6,%ymm12 DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9 DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9 @@ -1068,7 +1069,7 @@ _sk_color_hsw LABEL PROC DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1 DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8 DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9 - DB 196,226,125,24,5,227,57,0,0 ; vbroadcastss 0x39e3(%rip),%ymm0 # 4b24 <_sk_callback_hsw+0x1b8> + DB 196,226,125,24,5,142,57,0,0 ; vbroadcastss 0x398e(%rip),%ymm0 # 4adc <_sk_callback_hsw+0x1c0> DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11 @@ -1096,11 +1097,11 @@ _sk_luminosity_hsw LABEL PROC DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8 DB 197,100,89,213 ; vmulps %ymm5,%ymm3,%ymm10 DB 197,100,89,222 ; vmulps %ymm6,%ymm3,%ymm11 - DB 196,98,125,24,45,118,57,0,0 ; vbroadcastss 0x3976(%rip),%ymm13 # 4b28 <_sk_callback_hsw+0x1bc> - DB 196,98,125,24,53,113,57,0,0 ; vbroadcastss 0x3971(%rip),%ymm14 # 4b2c <_sk_callback_hsw+0x1c0> + DB 196,98,125,24,45,33,57,0,0 ; vbroadcastss 0x3921(%rip),%ymm13 # 4ae0 <_sk_callback_hsw+0x1c4> + DB 196,98,125,24,53,28,57,0,0 ; vbroadcastss 0x391c(%rip),%ymm14 # 4ae4 <_sk_callback_hsw+0x1c8> DB 196,65,116,89,230 ; vmulps %ymm14,%ymm1,%ymm12 DB 196,66,109,184,229 ; vfmadd231ps %ymm13,%ymm2,%ymm12 - DB 196,98,125,24,61,98,57,0,0 ; vbroadcastss 0x3962(%rip),%ymm15 # 4b30 <_sk_callback_hsw+0x1c4> + DB 196,98,125,24,61,13,57,0,0 ; vbroadcastss 0x390d(%rip),%ymm15 # 4ae8 <_sk_callback_hsw+0x1cc> DB 196,66,53,184,231 ; vfmadd231ps %ymm15,%ymm9,%ymm12 DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9 DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9 @@ -1156,7 +1157,7 @@ _sk_luminosity_hsw LABEL PROC DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1 DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8 DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9 - DB 196,226,125,24,5,68,56,0,0 ; vbroadcastss 0x3844(%rip),%ymm0 # 4b34 <_sk_callback_hsw+0x1c8> + DB 196,226,125,24,5,239,55,0,0 ; vbroadcastss 0x37ef(%rip),%ymm0 # 4aec <_sk_callback_hsw+0x1d0> DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11 @@ -1181,19 +1182,19 @@ _sk_srcover_rgba_8888_hsw LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,180,0,0,0 ; jne 1402 <_sk_srcover_rgba_8888_hsw+0xcd> + DB 15,133,180,0,0,0 ; jne 140f <_sk_srcover_rgba_8888_hsw+0xcd> DB 196,193,124,16,58 ; vmovups (%r10),%ymm7 - DB 197,196,84,37,69,59,0,0 ; vandps 0x3b45(%rip),%ymm7,%ymm4 # 4ea0 <_sk_callback_hsw+0x534> + DB 197,196,84,37,248,58,0,0 ; vandps 0x3af8(%rip),%ymm7,%ymm4 # 4e60 <_sk_callback_hsw+0x544> DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4 - DB 196,226,69,0,45,88,59,0,0 ; vpshufb 0x3b58(%rip),%ymm7,%ymm5 # 4ec0 <_sk_callback_hsw+0x554> + DB 196,226,69,0,45,11,59,0,0 ; vpshufb 0x3b0b(%rip),%ymm7,%ymm5 # 4e80 <_sk_callback_hsw+0x564> DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5 - DB 196,226,69,0,53,107,59,0,0 ; vpshufb 0x3b6b(%rip),%ymm7,%ymm6 # 4ee0 <_sk_callback_hsw+0x574> + DB 196,226,69,0,53,30,59,0,0 ; vpshufb 0x3b1e(%rip),%ymm7,%ymm6 # 4ea0 <_sk_callback_hsw+0x584> DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6 DB 197,197,114,215,24 ; vpsrld $0x18,%ymm7,%ymm7 DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7 - DB 196,98,125,24,5,173,55,0,0 ; vbroadcastss 0x37ad(%rip),%ymm8 # 4b38 <_sk_callback_hsw+0x1cc> + DB 196,98,125,24,5,88,55,0,0 ; vbroadcastss 0x3758(%rip),%ymm8 # 4af0 <_sk_callback_hsw+0x1d4> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 - DB 196,98,125,24,13,164,55,0,0 ; vbroadcastss 0x37a4(%rip),%ymm9 # 4b3c <_sk_callback_hsw+0x1d0> + DB 196,98,125,24,13,79,55,0,0 ; vbroadcastss 0x374f(%rip),%ymm9 # 4af4 <_sk_callback_hsw+0x1d8> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0 DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1 @@ -1213,7 +1214,7 @@ _sk_srcover_rgba_8888_hsw LABEL PROC DB 196,65,53,235,202 ; vpor %ymm10,%ymm9,%ymm9 DB 196,65,61,235,193 ; vpor %ymm9,%ymm8,%ymm8 DB 77,133,192 ; test %r8,%r8 - DB 117,53 ; jne 142b <_sk_srcover_rgba_8888_hsw+0xf6> + DB 117,53 ; jne 1438 <_sk_srcover_rgba_8888_hsw+0xf6> DB 196,65,124,17,2 ; vmovups %ymm8,(%r10) DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -1226,7 +1227,7 @@ _sk_srcover_rgba_8888_hsw LABEL PROC DB 196,225,249,110,224 ; vmovq %rax,%xmm4 DB 196,226,125,33,228 ; vpmovsxbd %xmm4,%ymm4 DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7 - DB 233,40,255,255,255 ; jmpq 1353 <_sk_srcover_rgba_8888_hsw+0x1e> + DB 233,40,255,255,255 ; jmpq 1360 <_sk_srcover_rgba_8888_hsw+0x1e> DB 185,8,0,0,0 ; mov $0x8,%ecx DB 68,41,193 ; sub %r8d,%ecx DB 192,225,3 ; shl $0x3,%cl @@ -1235,7 +1236,7 @@ _sk_srcover_rgba_8888_hsw LABEL PROC DB 196,97,249,110,200 ; vmovq %rax,%xmm9 DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9 DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10) - DB 235,170 ; jmp 13fb <_sk_srcover_rgba_8888_hsw+0xc6> + DB 235,170 ; jmp 1408 <_sk_srcover_rgba_8888_hsw+0xc6> PUBLIC _sk_clamp_0_hsw _sk_clamp_0_hsw LABEL PROC @@ -1249,7 +1250,7 @@ _sk_clamp_0_hsw LABEL PROC PUBLIC _sk_clamp_1_hsw _sk_clamp_1_hsw LABEL PROC - DB 196,98,125,24,5,201,54,0,0 ; vbroadcastss 0x36c9(%rip),%ymm8 # 4b40 <_sk_callback_hsw+0x1d4> + DB 196,98,125,24,5,116,54,0,0 ; vbroadcastss 0x3674(%rip),%ymm8 # 4af8 <_sk_callback_hsw+0x1dc> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1 DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2 @@ -1259,7 +1260,7 @@ _sk_clamp_1_hsw LABEL PROC PUBLIC _sk_clamp_a_hsw _sk_clamp_a_hsw LABEL PROC - DB 196,98,125,24,5,172,54,0,0 ; vbroadcastss 0x36ac(%rip),%ymm8 # 4b44 <_sk_callback_hsw+0x1d8> + DB 196,98,125,24,5,87,54,0,0 ; vbroadcastss 0x3657(%rip),%ymm8 # 4afc <_sk_callback_hsw+0x1e0> DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3 DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0 DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1 @@ -1331,7 +1332,7 @@ PUBLIC _sk_unpremul_hsw _sk_unpremul_hsw LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9 - DB 196,98,125,24,21,244,53,0,0 ; vbroadcastss 0x35f4(%rip),%ymm10 # 4b48 <_sk_callback_hsw+0x1dc> + DB 196,98,125,24,21,159,53,0,0 ; vbroadcastss 0x359f(%rip),%ymm10 # 4b00 <_sk_callback_hsw+0x1e4> DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10 DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 @@ -1342,16 +1343,16 @@ _sk_unpremul_hsw LABEL PROC PUBLIC _sk_from_srgb_hsw _sk_from_srgb_hsw LABEL PROC - DB 196,98,125,24,5,213,53,0,0 ; vbroadcastss 0x35d5(%rip),%ymm8 # 4b4c <_sk_callback_hsw+0x1e0> + DB 196,98,125,24,5,128,53,0,0 ; vbroadcastss 0x3580(%rip),%ymm8 # 4b04 <_sk_callback_hsw+0x1e8> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10 - DB 196,98,125,24,29,199,53,0,0 ; vbroadcastss 0x35c7(%rip),%ymm11 # 4b50 <_sk_callback_hsw+0x1e4> - DB 196,98,125,24,37,194,53,0,0 ; vbroadcastss 0x35c2(%rip),%ymm12 # 4b54 <_sk_callback_hsw+0x1e8> + DB 196,98,125,24,29,114,53,0,0 ; vbroadcastss 0x3572(%rip),%ymm11 # 4b08 <_sk_callback_hsw+0x1ec> + DB 196,98,125,24,37,109,53,0,0 ; vbroadcastss 0x356d(%rip),%ymm12 # 4b0c <_sk_callback_hsw+0x1f0> DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13 DB 196,66,125,168,235 ; vfmadd213ps %ymm11,%ymm0,%ymm13 - DB 196,98,125,24,53,179,53,0,0 ; vbroadcastss 0x35b3(%rip),%ymm14 # 4b58 <_sk_callback_hsw+0x1ec> + DB 196,98,125,24,53,94,53,0,0 ; vbroadcastss 0x355e(%rip),%ymm14 # 4b10 <_sk_callback_hsw+0x1f4> DB 196,66,45,168,238 ; vfmadd213ps %ymm14,%ymm10,%ymm13 - DB 196,98,125,24,21,169,53,0,0 ; vbroadcastss 0x35a9(%rip),%ymm10 # 4b5c <_sk_callback_hsw+0x1f0> + DB 196,98,125,24,21,84,53,0,0 ; vbroadcastss 0x3554(%rip),%ymm10 # 4b14 <_sk_callback_hsw+0x1f8> DB 196,193,124,194,194,1 ; vcmpltps %ymm10,%ymm0,%ymm0 DB 196,195,21,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm13,%ymm0 DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9 @@ -1373,19 +1374,19 @@ _sk_from_srgb_hsw LABEL PROC PUBLIC _sk_to_srgb_hsw _sk_to_srgb_hsw LABEL PROC DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9 - DB 196,98,125,24,5,77,53,0,0 ; vbroadcastss 0x354d(%rip),%ymm8 # 4b60 <_sk_callback_hsw+0x1f4> + DB 196,98,125,24,5,248,52,0,0 ; vbroadcastss 0x34f8(%rip),%ymm8 # 4b18 <_sk_callback_hsw+0x1fc> DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10 - DB 196,98,125,24,29,67,53,0,0 ; vbroadcastss 0x3543(%rip),%ymm11 # 4b64 <_sk_callback_hsw+0x1f8> - DB 196,98,125,24,37,62,53,0,0 ; vbroadcastss 0x353e(%rip),%ymm12 # 4b68 <_sk_callback_hsw+0x1fc> + DB 196,98,125,24,29,238,52,0,0 ; vbroadcastss 0x34ee(%rip),%ymm11 # 4b1c <_sk_callback_hsw+0x200> + DB 196,98,125,24,37,233,52,0,0 ; vbroadcastss 0x34e9(%rip),%ymm12 # 4b20 <_sk_callback_hsw+0x204> DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13 DB 196,66,53,168,235 ; vfmadd213ps %ymm11,%ymm9,%ymm13 - DB 196,98,125,24,53,47,53,0,0 ; vbroadcastss 0x352f(%rip),%ymm14 # 4b6c <_sk_callback_hsw+0x200> + DB 196,98,125,24,53,218,52,0,0 ; vbroadcastss 0x34da(%rip),%ymm14 # 4b24 <_sk_callback_hsw+0x208> DB 196,66,53,168,238 ; vfmadd213ps %ymm14,%ymm9,%ymm13 - DB 196,98,125,24,61,37,53,0,0 ; vbroadcastss 0x3525(%rip),%ymm15 # 4b70 <_sk_callback_hsw+0x204> + DB 196,98,125,24,61,208,52,0,0 ; vbroadcastss 0x34d0(%rip),%ymm15 # 4b28 <_sk_callback_hsw+0x20c> DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9 DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9 DB 196,65,20,89,201 ; vmulps %ymm9,%ymm13,%ymm9 - DB 196,98,125,24,45,17,53,0,0 ; vbroadcastss 0x3511(%rip),%ymm13 # 4b74 <_sk_callback_hsw+0x208> + DB 196,98,125,24,45,188,52,0,0 ; vbroadcastss 0x34bc(%rip),%ymm13 # 4b2c <_sk_callback_hsw+0x210> DB 196,193,124,194,197,1 ; vcmpltps %ymm13,%ymm0,%ymm0 DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0 DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9 @@ -1417,26 +1418,26 @@ _sk_rgb_to_hsl_hsw LABEL PROC DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9 DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9 DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10 - DB 196,98,125,24,29,134,52,0,0 ; vbroadcastss 0x3486(%rip),%ymm11 # 4b78 <_sk_callback_hsw+0x20c> + DB 196,98,125,24,29,49,52,0,0 ; vbroadcastss 0x3431(%rip),%ymm11 # 4b30 <_sk_callback_hsw+0x214> DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11 DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12 DB 197,116,194,234,1 ; vcmpltps %ymm2,%ymm1,%ymm13 - DB 196,98,125,24,53,115,52,0,0 ; vbroadcastss 0x3473(%rip),%ymm14 # 4b7c <_sk_callback_hsw+0x210> + DB 196,98,125,24,53,30,52,0,0 ; vbroadcastss 0x341e(%rip),%ymm14 # 4b34 <_sk_callback_hsw+0x218> DB 196,65,4,87,255 ; vxorps %ymm15,%ymm15,%ymm15 DB 196,67,5,74,238,208 ; vblendvps %ymm13,%ymm14,%ymm15,%ymm13 DB 196,66,37,168,229 ; vfmadd213ps %ymm13,%ymm11,%ymm12 DB 197,236,92,208 ; vsubps %ymm0,%ymm2,%ymm2 DB 197,124,92,233 ; vsubps %ymm1,%ymm0,%ymm13 - DB 196,98,125,24,53,90,52,0,0 ; vbroadcastss 0x345a(%rip),%ymm14 # 4b84 <_sk_callback_hsw+0x218> + DB 196,98,125,24,53,5,52,0,0 ; vbroadcastss 0x3405(%rip),%ymm14 # 4b3c <_sk_callback_hsw+0x220> DB 196,66,37,168,238 ; vfmadd213ps %ymm14,%ymm11,%ymm13 - DB 196,98,125,24,53,72,52,0,0 ; vbroadcastss 0x3448(%rip),%ymm14 # 4b80 <_sk_callback_hsw+0x214> + DB 196,98,125,24,53,243,51,0,0 ; vbroadcastss 0x33f3(%rip),%ymm14 # 4b38 <_sk_callback_hsw+0x21c> DB 196,194,37,168,214 ; vfmadd213ps %ymm14,%ymm11,%ymm2 DB 197,188,194,201,0 ; vcmpeqps %ymm1,%ymm8,%ymm1 DB 196,227,21,74,202,16 ; vblendvps %ymm1,%ymm2,%ymm13,%ymm1 DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0 DB 196,195,117,74,196,0 ; vblendvps %ymm0,%ymm12,%ymm1,%ymm0 DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1 - DB 196,98,125,24,29,43,52,0,0 ; vbroadcastss 0x342b(%rip),%ymm11 # 4b8c <_sk_callback_hsw+0x220> + DB 196,98,125,24,29,214,51,0,0 ; vbroadcastss 0x33d6(%rip),%ymm11 # 4b44 <_sk_callback_hsw+0x228> DB 196,193,116,89,211 ; vmulps %ymm11,%ymm1,%ymm2 DB 197,36,194,218,1 ; vcmpltps %ymm2,%ymm11,%ymm11 DB 196,65,12,92,224 ; vsubps %ymm8,%ymm14,%ymm12 @@ -1446,7 +1447,7 @@ _sk_rgb_to_hsl_hsw LABEL PROC DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1 DB 196,195,125,74,199,128 ; vblendvps %ymm8,%ymm15,%ymm0,%ymm0 DB 196,195,117,74,207,128 ; vblendvps %ymm8,%ymm15,%ymm1,%ymm1 - DB 196,98,125,24,5,238,51,0,0 ; vbroadcastss 0x33ee(%rip),%ymm8 # 4b88 <_sk_callback_hsw+0x21c> + DB 196,98,125,24,5,153,51,0,0 ; vbroadcastss 0x3399(%rip),%ymm8 # 4b40 <_sk_callback_hsw+0x224> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -1461,30 +1462,30 @@ _sk_hsl_to_rgb_hsw LABEL PROC DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp) DB 197,252,40,233 ; vmovaps %ymm1,%ymm5 DB 197,252,40,224 ; vmovaps %ymm0,%ymm4 - DB 196,98,125,24,5,181,51,0,0 ; vbroadcastss 0x33b5(%rip),%ymm8 # 4b90 <_sk_callback_hsw+0x224> + DB 196,98,125,24,5,96,51,0,0 ; vbroadcastss 0x3360(%rip),%ymm8 # 4b48 <_sk_callback_hsw+0x22c> DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9 DB 197,84,89,210 ; vmulps %ymm2,%ymm5,%ymm10 DB 196,65,84,92,218 ; vsubps %ymm10,%ymm5,%ymm11 DB 196,67,45,74,203,144 ; vblendvps %ymm9,%ymm11,%ymm10,%ymm9 DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10 - DB 196,98,125,24,13,152,51,0,0 ; vbroadcastss 0x3398(%rip),%ymm9 # 4b94 <_sk_callback_hsw+0x228> + DB 196,98,125,24,13,67,51,0,0 ; vbroadcastss 0x3343(%rip),%ymm9 # 4b4c <_sk_callback_hsw+0x230> DB 196,66,109,170,202 ; vfmsub213ps %ymm10,%ymm2,%ymm9 - DB 196,98,125,24,29,142,51,0,0 ; vbroadcastss 0x338e(%rip),%ymm11 # 4b98 <_sk_callback_hsw+0x22c> + DB 196,98,125,24,29,57,51,0,0 ; vbroadcastss 0x3339(%rip),%ymm11 # 4b50 <_sk_callback_hsw+0x234> DB 196,65,92,88,219 ; vaddps %ymm11,%ymm4,%ymm11 DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12 DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15 DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11 - DB 196,98,125,24,45,120,51,0,0 ; vbroadcastss 0x3378(%rip),%ymm13 # 4ba0 <_sk_callback_hsw+0x234> + DB 196,98,125,24,45,35,51,0,0 ; vbroadcastss 0x3323(%rip),%ymm13 # 4b58 <_sk_callback_hsw+0x23c> DB 196,193,4,89,197 ; vmulps %ymm13,%ymm15,%ymm0 - DB 196,98,125,24,53,110,51,0,0 ; vbroadcastss 0x336e(%rip),%ymm14 # 4ba4 <_sk_callback_hsw+0x238> + DB 196,98,125,24,53,25,51,0,0 ; vbroadcastss 0x3319(%rip),%ymm14 # 4b5c <_sk_callback_hsw+0x240> DB 197,12,92,224 ; vsubps %ymm0,%ymm14,%ymm12 DB 196,66,37,168,225 ; vfmadd213ps %ymm9,%ymm11,%ymm12 - DB 196,226,125,24,29,84,51,0,0 ; vbroadcastss 0x3354(%rip),%ymm3 # 4b9c <_sk_callback_hsw+0x230> + DB 196,226,125,24,29,255,50,0,0 ; vbroadcastss 0x32ff(%rip),%ymm3 # 4b54 <_sk_callback_hsw+0x238> DB 196,193,100,194,255,2 ; vcmpleps %ymm15,%ymm3,%ymm7 DB 196,195,29,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm12,%ymm7 DB 196,65,60,194,231,2 ; vcmpleps %ymm15,%ymm8,%ymm12 DB 196,227,45,74,255,192 ; vblendvps %ymm12,%ymm7,%ymm10,%ymm7 - DB 196,98,125,24,37,63,51,0,0 ; vbroadcastss 0x333f(%rip),%ymm12 # 4ba8 <_sk_callback_hsw+0x23c> + DB 196,98,125,24,37,234,50,0,0 ; vbroadcastss 0x32ea(%rip),%ymm12 # 4b60 <_sk_callback_hsw+0x244> DB 196,65,28,194,255,2 ; vcmpleps %ymm15,%ymm12,%ymm15 DB 196,194,37,168,193 ; vfmadd213ps %ymm9,%ymm11,%ymm0 DB 196,99,125,74,255,240 ; vblendvps %ymm15,%ymm7,%ymm0,%ymm15 @@ -1500,7 +1501,7 @@ _sk_hsl_to_rgb_hsw LABEL PROC DB 197,156,194,192,2 ; vcmpleps %ymm0,%ymm12,%ymm0 DB 196,194,37,168,249 ; vfmadd213ps %ymm9,%ymm11,%ymm7 DB 196,227,69,74,201,0 ; vblendvps %ymm0,%ymm1,%ymm7,%ymm1 - DB 196,226,125,24,5,235,50,0,0 ; vbroadcastss 0x32eb(%rip),%ymm0 # 4bac <_sk_callback_hsw+0x240> + DB 196,226,125,24,5,150,50,0,0 ; vbroadcastss 0x3296(%rip),%ymm0 # 4b64 <_sk_callback_hsw+0x248> DB 197,220,88,192 ; vaddps %ymm0,%ymm4,%ymm0 DB 196,227,125,8,224,1 ; vroundps $0x1,%ymm0,%ymm4 DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0 @@ -1546,11 +1547,11 @@ _sk_scale_u8_hsw LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,51 ; jne 19a7 <_sk_scale_u8_hsw+0x43> + DB 117,51 ; jne 19b4 <_sk_scale_u8_hsw+0x43> DB 197,122,126,0 ; vmovq (%rax),%xmm8 DB 196,66,125,49,192 ; vpmovzxbd %xmm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,37,50,0,0 ; vbroadcastss 0x3225(%rip),%ymm9 # 4bb0 <_sk_callback_hsw+0x244> + DB 196,98,125,24,13,208,49,0,0 ; vbroadcastss 0x31d0(%rip),%ymm9 # 4b68 <_sk_callback_hsw+0x24c> DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 @@ -1569,10 +1570,10 @@ _sk_scale_u8_hsw LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 19b0 <_sk_scale_u8_hsw+0x4c> + DB 117,235 ; jne 19bd <_sk_scale_u8_hsw+0x4c> DB 196,65,249,110,194 ; vmovq %r10,%xmm8 DB 91 ; pop %rbx - DB 235,171 ; jmp 1978 <_sk_scale_u8_hsw+0x14> + DB 235,171 ; jmp 1985 <_sk_scale_u8_hsw+0x14> PUBLIC _sk_lerp_1_float_hsw _sk_lerp_1_float_hsw LABEL PROC @@ -1596,11 +1597,11 @@ _sk_lerp_u8_hsw LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,71 ; jne 1a53 <_sk_lerp_u8_hsw+0x57> + DB 117,71 ; jne 1a60 <_sk_lerp_u8_hsw+0x57> DB 197,122,126,0 ; vmovq (%rax),%xmm8 DB 196,66,125,49,192 ; vpmovzxbd %xmm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,145,49,0,0 ; vbroadcastss 0x3191(%rip),%ymm9 # 4bb4 <_sk_callback_hsw+0x248> + DB 196,98,125,24,13,60,49,0,0 ; vbroadcastss 0x313c(%rip),%ymm9 # 4b6c <_sk_callback_hsw+0x250> DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0 DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0 @@ -1623,33 +1624,33 @@ _sk_lerp_u8_hsw LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 1a5c <_sk_lerp_u8_hsw+0x60> + DB 117,235 ; jne 1a69 <_sk_lerp_u8_hsw+0x60> DB 196,65,249,110,194 ; vmovq %r10,%xmm8 DB 91 ; pop %rbx - DB 235,151 ; jmp 1a10 <_sk_lerp_u8_hsw+0x14> + DB 235,151 ; jmp 1a1d <_sk_lerp_u8_hsw+0x14> PUBLIC _sk_lerp_565_hsw _sk_lerp_565_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,169,0,0,0 ; jne 1b30 <_sk_lerp_565_hsw+0xb7> + DB 15,133,169,0,0,0 ; jne 1b3d <_sk_lerp_565_hsw+0xb7> DB 196,65,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm8 DB 196,66,125,51,192 ; vpmovzxwd %xmm8,%ymm8 - DB 196,98,125,88,13,29,49,0,0 ; vpbroadcastd 0x311d(%rip),%ymm9 # 4bb8 <_sk_callback_hsw+0x24c> + DB 196,98,125,88,13,200,48,0,0 ; vpbroadcastd 0x30c8(%rip),%ymm9 # 4b70 <_sk_callback_hsw+0x254> DB 196,65,61,219,201 ; vpand %ymm9,%ymm8,%ymm9 DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9 - DB 196,98,125,24,21,14,49,0,0 ; vbroadcastss 0x310e(%rip),%ymm10 # 4bbc <_sk_callback_hsw+0x250> + DB 196,98,125,24,21,185,48,0,0 ; vbroadcastss 0x30b9(%rip),%ymm10 # 4b74 <_sk_callback_hsw+0x258> DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9 - DB 196,98,125,88,21,4,49,0,0 ; vpbroadcastd 0x3104(%rip),%ymm10 # 4bc0 <_sk_callback_hsw+0x254> + DB 196,98,125,88,21,175,48,0,0 ; vpbroadcastd 0x30af(%rip),%ymm10 # 4b78 <_sk_callback_hsw+0x25c> DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10 DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10 - DB 196,98,125,24,29,245,48,0,0 ; vbroadcastss 0x30f5(%rip),%ymm11 # 4bc4 <_sk_callback_hsw+0x258> + DB 196,98,125,24,29,160,48,0,0 ; vbroadcastss 0x30a0(%rip),%ymm11 # 4b7c <_sk_callback_hsw+0x260> DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10 - DB 196,98,125,88,29,235,48,0,0 ; vpbroadcastd 0x30eb(%rip),%ymm11 # 4bc8 <_sk_callback_hsw+0x25c> + DB 196,98,125,88,29,150,48,0,0 ; vpbroadcastd 0x3096(%rip),%ymm11 # 4b80 <_sk_callback_hsw+0x264> DB 196,65,61,219,195 ; vpand %ymm11,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,29,220,48,0,0 ; vbroadcastss 0x30dc(%rip),%ymm11 # 4bcc <_sk_callback_hsw+0x260> + DB 196,98,125,24,29,135,48,0,0 ; vbroadcastss 0x3087(%rip),%ymm11 # 4b84 <_sk_callback_hsw+0x268> DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8 DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0 DB 196,226,53,168,196 ; vfmadd213ps %ymm4,%ymm9,%ymm0 @@ -1670,9 +1671,9 @@ _sk_lerp_565_hsw LABEL PROC DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,68,255,255,255 ; ja 1a8d <_sk_lerp_565_hsw+0x14> + DB 15,135,68,255,255,255 ; ja 1a9a <_sk_lerp_565_hsw+0x14> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,76,0,0,0 ; lea 0x4c(%rip),%r10 # 1ba0 <_sk_lerp_565_hsw+0x127> + DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 1bac <_sk_lerp_565_hsw+0x126> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -1684,28 +1685,27 @@ _sk_lerp_565_hsw LABEL PROC DB 196,65,57,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8 DB 196,65,57,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8 DB 196,65,57,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8 - DB 233,239,254,255,255 ; jmpq 1a8d <_sk_lerp_565_hsw+0x14> - DB 102,144 ; xchg %ax,%ax - DB 242,255 ; repnz (bad) - DB 255 ; (bad) + DB 233,239,254,255,255 ; jmpq 1a9a <_sk_lerp_565_hsw+0x14> + DB 144 ; nop + DB 243,255 ; repz (bad) DB 255 ; (bad) - DB 234 ; (bad) DB 255 ; (bad) + DB 235,255 ; jmp 1bb1 <_sk_lerp_565_hsw+0x12b> DB 255 ; (bad) - DB 255,226 ; jmpq *%rdx + DB 255,227 ; jmpq *%rbx DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 218,255 ; (bad) + DB 219,255 ; (bad) DB 255 ; (bad) - DB 255,210 ; callq *%rdx + DB 255,211 ; callq *%rbx DB 255 ; (bad) DB 255 ; (bad) - DB 255,202 ; dec %edx + DB 255,203 ; dec %ebx DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 189 ; .byte 0xbd + DB 190 ; .byte 0xbe DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -1717,23 +1717,23 @@ _sk_load_tables_hsw LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,105 ; jne 1c3a <_sk_load_tables_hsw+0x7e> + DB 117,105 ; jne 1c46 <_sk_load_tables_hsw+0x7e> DB 196,193,124,16,26 ; vmovups (%r10),%ymm3 - DB 197,228,84,13,34,51,0,0 ; vandps 0x3322(%rip),%ymm3,%ymm1 # 4f00 <_sk_callback_hsw+0x594> + DB 197,228,84,13,214,50,0,0 ; vandps 0x32d6(%rip),%ymm3,%ymm1 # 4ec0 <_sk_callback_hsw+0x5a4> DB 196,65,61,118,192 ; vpcmpeqd %ymm8,%ymm8,%ymm8 DB 72,139,72,8 ; mov 0x8(%rax),%rcx DB 76,139,80,16 ; mov 0x10(%rax),%r10 DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2 DB 196,226,109,146,4,137 ; vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0 - DB 196,226,101,0,21,34,51,0,0 ; vpshufb 0x3322(%rip),%ymm3,%ymm2 # 4f20 <_sk_callback_hsw+0x5b4> + DB 196,226,101,0,21,214,50,0,0 ; vpshufb 0x32d6(%rip),%ymm3,%ymm2 # 4ee0 <_sk_callback_hsw+0x5c4> DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9 DB 196,194,53,146,12,146 ; vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1 DB 72,139,64,24 ; mov 0x18(%rax),%rax - DB 196,98,101,0,13,42,51,0,0 ; vpshufb 0x332a(%rip),%ymm3,%ymm9 # 4f40 <_sk_callback_hsw+0x5d4> + DB 196,98,101,0,13,222,50,0,0 ; vpshufb 0x32de(%rip),%ymm3,%ymm9 # 4f00 <_sk_callback_hsw+0x5e4> DB 196,162,61,146,20,136 ; vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2 DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,162,47,0,0 ; vbroadcastss 0x2fa2(%rip),%ymm8 # 4bd0 <_sk_callback_hsw+0x264> + DB 196,98,125,24,5,78,47,0,0 ; vbroadcastss 0x2f4e(%rip),%ymm8 # 4b88 <_sk_callback_hsw+0x26c> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -1746,7 +1746,7 @@ _sk_load_tables_hsw LABEL PROC DB 196,193,249,110,195 ; vmovq %r11,%xmm0 DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0 DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3 - DB 233,115,255,255,255 ; jmpq 1bd6 <_sk_load_tables_hsw+0x1a> + DB 233,115,255,255,255 ; jmpq 1be2 <_sk_load_tables_hsw+0x1a> PUBLIC _sk_load_tables_u16_be_hsw _sk_load_tables_u16_be_hsw LABEL PROC @@ -1754,7 +1754,7 @@ _sk_load_tables_u16_be_hsw LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,201,0,0,0 ; jne 1d42 <_sk_load_tables_u16_be_hsw+0xdf> + DB 15,133,201,0,0,0 ; jne 1d4e <_sk_load_tables_u16_be_hsw+0xdf> DB 196,1,121,16,4,81 ; vmovupd (%r9,%r10,2),%xmm8 DB 196,129,121,16,84,81,16 ; vmovupd 0x10(%r9,%r10,2),%xmm2 DB 196,129,121,16,92,81,32 ; vmovupd 0x20(%r9,%r10,2),%xmm3 @@ -1770,7 +1770,7 @@ _sk_load_tables_u16_be_hsw LABEL PROC DB 197,185,108,200 ; vpunpcklqdq %xmm0,%xmm8,%xmm1 DB 197,185,109,208 ; vpunpckhqdq %xmm0,%xmm8,%xmm2 DB 197,49,108,195 ; vpunpcklqdq %xmm3,%xmm9,%xmm8 - DB 197,121,111,21,182,51,0,0 ; vmovdqa 0x33b6(%rip),%xmm10 # 5080 <_sk_callback_hsw+0x714> + DB 197,121,111,21,106,51,0,0 ; vmovdqa 0x336a(%rip),%xmm10 # 5040 <_sk_callback_hsw+0x724> DB 196,193,113,219,194 ; vpand %xmm10,%xmm1,%xmm0 DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1 DB 196,65,37,118,219 ; vpcmpeqd %ymm11,%ymm11,%ymm11 @@ -1792,36 +1792,36 @@ _sk_load_tables_u16_be_hsw LABEL PROC DB 197,185,235,219 ; vpor %xmm3,%xmm8,%xmm3 DB 196,226,125,51,219 ; vpmovzxwd %xmm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,155,46,0,0 ; vbroadcastss 0x2e9b(%rip),%ymm8 # 4bd4 <_sk_callback_hsw+0x268> + DB 196,98,125,24,5,71,46,0,0 ; vbroadcastss 0x2e47(%rip),%ymm8 # 4b8c <_sk_callback_hsw+0x270> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 196,1,123,16,4,81 ; vmovsd (%r9,%r10,2),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,85 ; je 1da8 <_sk_load_tables_u16_be_hsw+0x145> + DB 116,85 ; je 1db4 <_sk_load_tables_u16_be_hsw+0x145> DB 196,1,57,22,68,81,8 ; vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,72 ; jb 1da8 <_sk_load_tables_u16_be_hsw+0x145> + DB 114,72 ; jb 1db4 <_sk_load_tables_u16_be_hsw+0x145> DB 196,129,123,16,84,81,16 ; vmovsd 0x10(%r9,%r10,2),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,72 ; je 1db5 <_sk_load_tables_u16_be_hsw+0x152> + DB 116,72 ; je 1dc1 <_sk_load_tables_u16_be_hsw+0x152> DB 196,129,105,22,84,81,24 ; vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,59 ; jb 1db5 <_sk_load_tables_u16_be_hsw+0x152> + DB 114,59 ; jb 1dc1 <_sk_load_tables_u16_be_hsw+0x152> DB 196,129,123,16,92,81,32 ; vmovsd 0x20(%r9,%r10,2),%xmm3 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,9,255,255,255 ; je 1c94 <_sk_load_tables_u16_be_hsw+0x31> + DB 15,132,9,255,255,255 ; je 1ca0 <_sk_load_tables_u16_be_hsw+0x31> DB 196,129,97,22,92,81,40 ; vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,248,254,255,255 ; jb 1c94 <_sk_load_tables_u16_be_hsw+0x31> + DB 15,130,248,254,255,255 ; jb 1ca0 <_sk_load_tables_u16_be_hsw+0x31> DB 196,1,122,126,76,81,48 ; vmovq 0x30(%r9,%r10,2),%xmm9 - DB 233,236,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31> + DB 233,236,254,255,255 ; jmpq 1ca0 <_sk_load_tables_u16_be_hsw+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,223,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31> + DB 233,223,254,255,255 ; jmpq 1ca0 <_sk_load_tables_u16_be_hsw+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 - DB 233,214,254,255,255 ; jmpq 1c94 <_sk_load_tables_u16_be_hsw+0x31> + DB 233,214,254,255,255 ; jmpq 1ca0 <_sk_load_tables_u16_be_hsw+0x31> PUBLIC _sk_load_tables_rgb_u16_be_hsw _sk_load_tables_rgb_u16_be_hsw LABEL PROC @@ -1829,7 +1829,7 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,193,0,0,0 ; jne 1e91 <_sk_load_tables_rgb_u16_be_hsw+0xd3> + DB 15,133,193,0,0,0 ; jne 1e9d <_sk_load_tables_rgb_u16_be_hsw+0xd3> DB 196,129,122,111,4,81 ; vmovdqu (%r9,%r10,2),%xmm0 DB 196,129,122,111,84,81,12 ; vmovdqu 0xc(%r9,%r10,2),%xmm2 DB 196,129,122,111,76,81,24 ; vmovdqu 0x18(%r9,%r10,2),%xmm1 @@ -1850,7 +1850,7 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3 DB 197,185,109,210 ; vpunpckhqdq %xmm2,%xmm8,%xmm2 DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8 - DB 197,121,111,13,86,50,0,0 ; vmovdqa 0x3256(%rip),%xmm9 # 5090 <_sk_callback_hsw+0x724> + DB 197,121,111,13,10,50,0,0 ; vmovdqa 0x320a(%rip),%xmm9 # 5050 <_sk_callback_hsw+0x734> DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0 DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1 DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3 @@ -1867,46 +1867,46 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC DB 196,98,125,51,194 ; vpmovzxwd %xmm2,%ymm8 DB 196,162,101,146,20,128 ; vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,73,45,0,0 ; vbroadcastss 0x2d49(%rip),%ymm3 # 4bd8 <_sk_callback_hsw+0x26c> + DB 196,226,125,24,29,245,44,0,0 ; vbroadcastss 0x2cf5(%rip),%ymm3 # 4b90 <_sk_callback_hsw+0x274> DB 255,224 ; jmpq *%rax DB 196,129,121,110,4,81 ; vmovd (%r9,%r10,2),%xmm0 DB 196,129,121,196,68,81,4,2 ; vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,5 ; jne 1eaa <_sk_load_tables_rgb_u16_be_hsw+0xec> - DB 233,90,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 117,5 ; jne 1eb6 <_sk_load_tables_rgb_u16_be_hsw+0xec> + DB 233,90,255,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> DB 196,129,121,110,76,81,6 ; vmovd 0x6(%r9,%r10,2),%xmm1 DB 196,1,113,196,68,81,10,2 ; vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,26 ; jb 1ed9 <_sk_load_tables_rgb_u16_be_hsw+0x11b> + DB 114,26 ; jb 1ee5 <_sk_load_tables_rgb_u16_be_hsw+0x11b> DB 196,129,121,110,76,81,12 ; vmovd 0xc(%r9,%r10,2),%xmm1 DB 196,129,113,196,84,81,16,2 ; vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 117,10 ; jne 1ede <_sk_load_tables_rgb_u16_be_hsw+0x120> - DB 233,43,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> - DB 233,38,255,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 117,10 ; jne 1eea <_sk_load_tables_rgb_u16_be_hsw+0x120> + DB 233,43,255,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 233,38,255,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> DB 196,129,121,110,76,81,18 ; vmovd 0x12(%r9,%r10,2),%xmm1 DB 196,1,113,196,76,81,22,2 ; vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,26 ; jb 1f0d <_sk_load_tables_rgb_u16_be_hsw+0x14f> + DB 114,26 ; jb 1f19 <_sk_load_tables_rgb_u16_be_hsw+0x14f> DB 196,129,121,110,76,81,24 ; vmovd 0x18(%r9,%r10,2),%xmm1 DB 196,129,113,196,76,81,28,2 ; vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 117,10 ; jne 1f12 <_sk_load_tables_rgb_u16_be_hsw+0x154> - DB 233,247,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> - DB 233,242,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 117,10 ; jne 1f1e <_sk_load_tables_rgb_u16_be_hsw+0x154> + DB 233,247,254,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 233,242,254,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> DB 196,129,121,110,92,81,30 ; vmovd 0x1e(%r9,%r10,2),%xmm3 DB 196,1,97,196,92,81,34,2 ; vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,20 ; jb 1f3b <_sk_load_tables_rgb_u16_be_hsw+0x17d> + DB 114,20 ; jb 1f47 <_sk_load_tables_rgb_u16_be_hsw+0x17d> DB 196,129,121,110,92,81,36 ; vmovd 0x24(%r9,%r10,2),%xmm3 DB 196,129,97,196,92,81,40,2 ; vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3 - DB 233,201,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> - DB 233,196,254,255,255 ; jmpq 1e04 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 233,201,254,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> + DB 233,196,254,255,255 ; jmpq 1e10 <_sk_load_tables_rgb_u16_be_hsw+0x46> PUBLIC _sk_byte_tables_hsw _sk_byte_tables_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,145,44,0,0 ; vbroadcastss 0x2c91(%rip),%ymm8 # 4bdc <_sk_callback_hsw+0x270> + DB 196,98,125,24,5,61,44,0,0 ; vbroadcastss 0x2c3d(%rip),%ymm8 # 4b94 <_sk_callback_hsw+0x278> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9 DB 196,65,249,126,201 ; vmovq %xmm9,%r9 @@ -2028,7 +2028,7 @@ _sk_byte_tables_hsw LABEL PROC DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,54,42,0,0 ; vbroadcastss 0x2a36(%rip),%ymm8 # 4be0 <_sk_callback_hsw+0x274> + DB 196,98,125,24,5,226,41,0,0 ; vbroadcastss 0x29e2(%rip),%ymm8 # 4b98 <_sk_callback_hsw+0x27c> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 @@ -2142,7 +2142,7 @@ _sk_byte_tables_rgb_hsw LABEL PROC DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,34,40,0,0 ; vbroadcastss 0x2822(%rip),%ymm8 # 4be4 <_sk_callback_hsw+0x278> + DB 196,98,125,24,5,206,39,0,0 ; vbroadcastss 0x27ce(%rip),%ymm8 # 4b9c <_sk_callback_hsw+0x280> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 @@ -2231,33 +2231,33 @@ _sk_parametric_r_hsw LABEL PROC DB 196,66,125,168,211 ; vfmadd213ps %ymm11,%ymm0,%ymm10 DB 196,226,125,24,0 ; vbroadcastss (%rax),%ymm0 DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11 - DB 196,98,125,24,37,252,38,0,0 ; vbroadcastss 0x26fc(%rip),%ymm12 # 4be8 <_sk_callback_hsw+0x27c> - DB 196,98,125,24,45,247,38,0,0 ; vbroadcastss 0x26f7(%rip),%ymm13 # 4bec <_sk_callback_hsw+0x280> + DB 196,98,125,24,37,168,38,0,0 ; vbroadcastss 0x26a8(%rip),%ymm12 # 4ba0 <_sk_callback_hsw+0x284> + DB 196,98,125,24,45,163,38,0,0 ; vbroadcastss 0x26a3(%rip),%ymm13 # 4ba4 <_sk_callback_hsw+0x288> DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,237,38,0,0 ; vbroadcastss 0x26ed(%rip),%ymm13 # 4bf0 <_sk_callback_hsw+0x284> + DB 196,98,125,24,45,153,38,0,0 ; vbroadcastss 0x2699(%rip),%ymm13 # 4ba8 <_sk_callback_hsw+0x28c> DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,227,38,0,0 ; vbroadcastss 0x26e3(%rip),%ymm13 # 4bf4 <_sk_callback_hsw+0x288> + DB 196,98,125,24,45,143,38,0,0 ; vbroadcastss 0x268f(%rip),%ymm13 # 4bac <_sk_callback_hsw+0x290> DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13 - DB 196,98,125,24,29,217,38,0,0 ; vbroadcastss 0x26d9(%rip),%ymm11 # 4bf8 <_sk_callback_hsw+0x28c> + DB 196,98,125,24,29,133,38,0,0 ; vbroadcastss 0x2685(%rip),%ymm11 # 4bb0 <_sk_callback_hsw+0x294> DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11 - DB 196,98,125,24,37,207,38,0,0 ; vbroadcastss 0x26cf(%rip),%ymm12 # 4bfc <_sk_callback_hsw+0x290> + DB 196,98,125,24,37,123,38,0,0 ; vbroadcastss 0x267b(%rip),%ymm12 # 4bb4 <_sk_callback_hsw+0x298> DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,37,197,38,0,0 ; vbroadcastss 0x26c5(%rip),%ymm12 # 4c00 <_sk_callback_hsw+0x294> + DB 196,98,125,24,37,113,38,0,0 ; vbroadcastss 0x2671(%rip),%ymm12 # 4bb8 <_sk_callback_hsw+0x29c> DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10 DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0 DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10 DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10 - DB 196,98,125,24,29,166,38,0,0 ; vbroadcastss 0x26a6(%rip),%ymm11 # 4c04 <_sk_callback_hsw+0x298> + DB 196,98,125,24,29,82,38,0,0 ; vbroadcastss 0x2652(%rip),%ymm11 # 4bbc <_sk_callback_hsw+0x2a0> DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0 - DB 196,98,125,24,29,156,38,0,0 ; vbroadcastss 0x269c(%rip),%ymm11 # 4c08 <_sk_callback_hsw+0x29c> + DB 196,98,125,24,29,72,38,0,0 ; vbroadcastss 0x2648(%rip),%ymm11 # 4bc0 <_sk_callback_hsw+0x2a4> DB 196,98,45,172,216 ; vfnmadd213ps %ymm0,%ymm10,%ymm11 - DB 196,226,125,24,5,146,38,0,0 ; vbroadcastss 0x2692(%rip),%ymm0 # 4c0c <_sk_callback_hsw+0x2a0> + DB 196,226,125,24,5,62,38,0,0 ; vbroadcastss 0x263e(%rip),%ymm0 # 4bc4 <_sk_callback_hsw+0x2a8> DB 196,193,124,92,194 ; vsubps %ymm10,%ymm0,%ymm0 - DB 196,98,125,24,21,136,38,0,0 ; vbroadcastss 0x2688(%rip),%ymm10 # 4c10 <_sk_callback_hsw+0x2a4> + DB 196,98,125,24,21,52,38,0,0 ; vbroadcastss 0x2634(%rip),%ymm10 # 4bc8 <_sk_callback_hsw+0x2ac> DB 197,172,94,192 ; vdivps %ymm0,%ymm10,%ymm0 DB 197,164,88,192 ; vaddps %ymm0,%ymm11,%ymm0 - DB 196,98,125,24,21,123,38,0,0 ; vbroadcastss 0x267b(%rip),%ymm10 # 4c14 <_sk_callback_hsw+0x2a8> + DB 196,98,125,24,21,39,38,0,0 ; vbroadcastss 0x2627(%rip),%ymm10 # 4bcc <_sk_callback_hsw+0x2b0> DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0 DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -2265,7 +2265,7 @@ _sk_parametric_r_hsw LABEL PROC DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,5,82,38,0,0 ; vbroadcastss 0x2652(%rip),%ymm8 # 4c18 <_sk_callback_hsw+0x2ac> + DB 196,98,125,24,5,254,37,0,0 ; vbroadcastss 0x25fe(%rip),%ymm8 # 4bd0 <_sk_callback_hsw+0x2b4> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2283,33 +2283,33 @@ _sk_parametric_g_hsw LABEL PROC DB 196,66,117,168,211 ; vfmadd213ps %ymm11,%ymm1,%ymm10 DB 196,226,125,24,8 ; vbroadcastss (%rax),%ymm1 DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11 - DB 196,98,125,24,37,10,38,0,0 ; vbroadcastss 0x260a(%rip),%ymm12 # 4c1c <_sk_callback_hsw+0x2b0> - DB 196,98,125,24,45,5,38,0,0 ; vbroadcastss 0x2605(%rip),%ymm13 # 4c20 <_sk_callback_hsw+0x2b4> + DB 196,98,125,24,37,182,37,0,0 ; vbroadcastss 0x25b6(%rip),%ymm12 # 4bd4 <_sk_callback_hsw+0x2b8> + DB 196,98,125,24,45,177,37,0,0 ; vbroadcastss 0x25b1(%rip),%ymm13 # 4bd8 <_sk_callback_hsw+0x2bc> DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,251,37,0,0 ; vbroadcastss 0x25fb(%rip),%ymm13 # 4c24 <_sk_callback_hsw+0x2b8> + DB 196,98,125,24,45,167,37,0,0 ; vbroadcastss 0x25a7(%rip),%ymm13 # 4bdc <_sk_callback_hsw+0x2c0> DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,241,37,0,0 ; vbroadcastss 0x25f1(%rip),%ymm13 # 4c28 <_sk_callback_hsw+0x2bc> + DB 196,98,125,24,45,157,37,0,0 ; vbroadcastss 0x259d(%rip),%ymm13 # 4be0 <_sk_callback_hsw+0x2c4> DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13 - DB 196,98,125,24,29,231,37,0,0 ; vbroadcastss 0x25e7(%rip),%ymm11 # 4c2c <_sk_callback_hsw+0x2c0> + DB 196,98,125,24,29,147,37,0,0 ; vbroadcastss 0x2593(%rip),%ymm11 # 4be4 <_sk_callback_hsw+0x2c8> DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11 - DB 196,98,125,24,37,221,37,0,0 ; vbroadcastss 0x25dd(%rip),%ymm12 # 4c30 <_sk_callback_hsw+0x2c4> + DB 196,98,125,24,37,137,37,0,0 ; vbroadcastss 0x2589(%rip),%ymm12 # 4be8 <_sk_callback_hsw+0x2cc> DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,37,211,37,0,0 ; vbroadcastss 0x25d3(%rip),%ymm12 # 4c34 <_sk_callback_hsw+0x2c8> + DB 196,98,125,24,37,127,37,0,0 ; vbroadcastss 0x257f(%rip),%ymm12 # 4bec <_sk_callback_hsw+0x2d0> DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10 DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1 DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10 DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10 - DB 196,98,125,24,29,180,37,0,0 ; vbroadcastss 0x25b4(%rip),%ymm11 # 4c38 <_sk_callback_hsw+0x2cc> + DB 196,98,125,24,29,96,37,0,0 ; vbroadcastss 0x2560(%rip),%ymm11 # 4bf0 <_sk_callback_hsw+0x2d4> DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,29,170,37,0,0 ; vbroadcastss 0x25aa(%rip),%ymm11 # 4c3c <_sk_callback_hsw+0x2d0> + DB 196,98,125,24,29,86,37,0,0 ; vbroadcastss 0x2556(%rip),%ymm11 # 4bf4 <_sk_callback_hsw+0x2d8> DB 196,98,45,172,217 ; vfnmadd213ps %ymm1,%ymm10,%ymm11 - DB 196,226,125,24,13,160,37,0,0 ; vbroadcastss 0x25a0(%rip),%ymm1 # 4c40 <_sk_callback_hsw+0x2d4> + DB 196,226,125,24,13,76,37,0,0 ; vbroadcastss 0x254c(%rip),%ymm1 # 4bf8 <_sk_callback_hsw+0x2dc> DB 196,193,116,92,202 ; vsubps %ymm10,%ymm1,%ymm1 - DB 196,98,125,24,21,150,37,0,0 ; vbroadcastss 0x2596(%rip),%ymm10 # 4c44 <_sk_callback_hsw+0x2d8> + DB 196,98,125,24,21,66,37,0,0 ; vbroadcastss 0x2542(%rip),%ymm10 # 4bfc <_sk_callback_hsw+0x2e0> DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1 DB 197,164,88,201 ; vaddps %ymm1,%ymm11,%ymm1 - DB 196,98,125,24,21,137,37,0,0 ; vbroadcastss 0x2589(%rip),%ymm10 # 4c48 <_sk_callback_hsw+0x2dc> + DB 196,98,125,24,21,53,37,0,0 ; vbroadcastss 0x2535(%rip),%ymm10 # 4c00 <_sk_callback_hsw+0x2e4> DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1 DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -2317,7 +2317,7 @@ _sk_parametric_g_hsw LABEL PROC DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1 - DB 196,98,125,24,5,96,37,0,0 ; vbroadcastss 0x2560(%rip),%ymm8 # 4c4c <_sk_callback_hsw+0x2e0> + DB 196,98,125,24,5,12,37,0,0 ; vbroadcastss 0x250c(%rip),%ymm8 # 4c04 <_sk_callback_hsw+0x2e8> DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2335,33 +2335,33 @@ _sk_parametric_b_hsw LABEL PROC DB 196,66,109,168,211 ; vfmadd213ps %ymm11,%ymm2,%ymm10 DB 196,226,125,24,16 ; vbroadcastss (%rax),%ymm2 DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11 - DB 196,98,125,24,37,24,37,0,0 ; vbroadcastss 0x2518(%rip),%ymm12 # 4c50 <_sk_callback_hsw+0x2e4> - DB 196,98,125,24,45,19,37,0,0 ; vbroadcastss 0x2513(%rip),%ymm13 # 4c54 <_sk_callback_hsw+0x2e8> + DB 196,98,125,24,37,196,36,0,0 ; vbroadcastss 0x24c4(%rip),%ymm12 # 4c08 <_sk_callback_hsw+0x2ec> + DB 196,98,125,24,45,191,36,0,0 ; vbroadcastss 0x24bf(%rip),%ymm13 # 4c0c <_sk_callback_hsw+0x2f0> DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,9,37,0,0 ; vbroadcastss 0x2509(%rip),%ymm13 # 4c58 <_sk_callback_hsw+0x2ec> + DB 196,98,125,24,45,181,36,0,0 ; vbroadcastss 0x24b5(%rip),%ymm13 # 4c10 <_sk_callback_hsw+0x2f4> DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,255,36,0,0 ; vbroadcastss 0x24ff(%rip),%ymm13 # 4c5c <_sk_callback_hsw+0x2f0> + DB 196,98,125,24,45,171,36,0,0 ; vbroadcastss 0x24ab(%rip),%ymm13 # 4c14 <_sk_callback_hsw+0x2f8> DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13 - DB 196,98,125,24,29,245,36,0,0 ; vbroadcastss 0x24f5(%rip),%ymm11 # 4c60 <_sk_callback_hsw+0x2f4> + DB 196,98,125,24,29,161,36,0,0 ; vbroadcastss 0x24a1(%rip),%ymm11 # 4c18 <_sk_callback_hsw+0x2fc> DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11 - DB 196,98,125,24,37,235,36,0,0 ; vbroadcastss 0x24eb(%rip),%ymm12 # 4c64 <_sk_callback_hsw+0x2f8> + DB 196,98,125,24,37,151,36,0,0 ; vbroadcastss 0x2497(%rip),%ymm12 # 4c1c <_sk_callback_hsw+0x300> DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,37,225,36,0,0 ; vbroadcastss 0x24e1(%rip),%ymm12 # 4c68 <_sk_callback_hsw+0x2fc> + DB 196,98,125,24,37,141,36,0,0 ; vbroadcastss 0x248d(%rip),%ymm12 # 4c20 <_sk_callback_hsw+0x304> DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10 DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2 DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10 DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10 - DB 196,98,125,24,29,194,36,0,0 ; vbroadcastss 0x24c2(%rip),%ymm11 # 4c6c <_sk_callback_hsw+0x300> + DB 196,98,125,24,29,110,36,0,0 ; vbroadcastss 0x246e(%rip),%ymm11 # 4c24 <_sk_callback_hsw+0x308> DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 - DB 196,98,125,24,29,184,36,0,0 ; vbroadcastss 0x24b8(%rip),%ymm11 # 4c70 <_sk_callback_hsw+0x304> + DB 196,98,125,24,29,100,36,0,0 ; vbroadcastss 0x2464(%rip),%ymm11 # 4c28 <_sk_callback_hsw+0x30c> DB 196,98,45,172,218 ; vfnmadd213ps %ymm2,%ymm10,%ymm11 - DB 196,226,125,24,21,174,36,0,0 ; vbroadcastss 0x24ae(%rip),%ymm2 # 4c74 <_sk_callback_hsw+0x308> + DB 196,226,125,24,21,90,36,0,0 ; vbroadcastss 0x245a(%rip),%ymm2 # 4c2c <_sk_callback_hsw+0x310> DB 196,193,108,92,210 ; vsubps %ymm10,%ymm2,%ymm2 - DB 196,98,125,24,21,164,36,0,0 ; vbroadcastss 0x24a4(%rip),%ymm10 # 4c78 <_sk_callback_hsw+0x30c> + DB 196,98,125,24,21,80,36,0,0 ; vbroadcastss 0x2450(%rip),%ymm10 # 4c30 <_sk_callback_hsw+0x314> DB 197,172,94,210 ; vdivps %ymm2,%ymm10,%ymm2 DB 197,164,88,210 ; vaddps %ymm2,%ymm11,%ymm2 - DB 196,98,125,24,21,151,36,0,0 ; vbroadcastss 0x2497(%rip),%ymm10 # 4c7c <_sk_callback_hsw+0x310> + DB 196,98,125,24,21,67,36,0,0 ; vbroadcastss 0x2443(%rip),%ymm10 # 4c34 <_sk_callback_hsw+0x318> DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2 DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -2369,7 +2369,7 @@ _sk_parametric_b_hsw LABEL PROC DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,110,36,0,0 ; vbroadcastss 0x246e(%rip),%ymm8 # 4c80 <_sk_callback_hsw+0x314> + DB 196,98,125,24,5,26,36,0,0 ; vbroadcastss 0x241a(%rip),%ymm8 # 4c38 <_sk_callback_hsw+0x31c> DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2387,33 +2387,33 @@ _sk_parametric_a_hsw LABEL PROC DB 196,66,101,168,211 ; vfmadd213ps %ymm11,%ymm3,%ymm10 DB 196,226,125,24,24 ; vbroadcastss (%rax),%ymm3 DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11 - DB 196,98,125,24,37,38,36,0,0 ; vbroadcastss 0x2426(%rip),%ymm12 # 4c84 <_sk_callback_hsw+0x318> - DB 196,98,125,24,45,33,36,0,0 ; vbroadcastss 0x2421(%rip),%ymm13 # 4c88 <_sk_callback_hsw+0x31c> + DB 196,98,125,24,37,210,35,0,0 ; vbroadcastss 0x23d2(%rip),%ymm12 # 4c3c <_sk_callback_hsw+0x320> + DB 196,98,125,24,45,205,35,0,0 ; vbroadcastss 0x23cd(%rip),%ymm13 # 4c40 <_sk_callback_hsw+0x324> DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,23,36,0,0 ; vbroadcastss 0x2417(%rip),%ymm13 # 4c8c <_sk_callback_hsw+0x320> + DB 196,98,125,24,45,195,35,0,0 ; vbroadcastss 0x23c3(%rip),%ymm13 # 4c44 <_sk_callback_hsw+0x328> DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10 - DB 196,98,125,24,45,13,36,0,0 ; vbroadcastss 0x240d(%rip),%ymm13 # 4c90 <_sk_callback_hsw+0x324> + DB 196,98,125,24,45,185,35,0,0 ; vbroadcastss 0x23b9(%rip),%ymm13 # 4c48 <_sk_callback_hsw+0x32c> DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13 - DB 196,98,125,24,29,3,36,0,0 ; vbroadcastss 0x2403(%rip),%ymm11 # 4c94 <_sk_callback_hsw+0x328> + DB 196,98,125,24,29,175,35,0,0 ; vbroadcastss 0x23af(%rip),%ymm11 # 4c4c <_sk_callback_hsw+0x330> DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11 - DB 196,98,125,24,37,249,35,0,0 ; vbroadcastss 0x23f9(%rip),%ymm12 # 4c98 <_sk_callback_hsw+0x32c> + DB 196,98,125,24,37,165,35,0,0 ; vbroadcastss 0x23a5(%rip),%ymm12 # 4c50 <_sk_callback_hsw+0x334> DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,37,239,35,0,0 ; vbroadcastss 0x23ef(%rip),%ymm12 # 4c9c <_sk_callback_hsw+0x330> + DB 196,98,125,24,37,155,35,0,0 ; vbroadcastss 0x239b(%rip),%ymm12 # 4c54 <_sk_callback_hsw+0x338> DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10 DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3 DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10 DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10 - DB 196,98,125,24,29,208,35,0,0 ; vbroadcastss 0x23d0(%rip),%ymm11 # 4ca0 <_sk_callback_hsw+0x334> + DB 196,98,125,24,29,124,35,0,0 ; vbroadcastss 0x237c(%rip),%ymm11 # 4c58 <_sk_callback_hsw+0x33c> DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3 - DB 196,98,125,24,29,198,35,0,0 ; vbroadcastss 0x23c6(%rip),%ymm11 # 4ca4 <_sk_callback_hsw+0x338> + DB 196,98,125,24,29,114,35,0,0 ; vbroadcastss 0x2372(%rip),%ymm11 # 4c5c <_sk_callback_hsw+0x340> DB 196,98,45,172,219 ; vfnmadd213ps %ymm3,%ymm10,%ymm11 - DB 196,226,125,24,29,188,35,0,0 ; vbroadcastss 0x23bc(%rip),%ymm3 # 4ca8 <_sk_callback_hsw+0x33c> + DB 196,226,125,24,29,104,35,0,0 ; vbroadcastss 0x2368(%rip),%ymm3 # 4c60 <_sk_callback_hsw+0x344> DB 196,193,100,92,218 ; vsubps %ymm10,%ymm3,%ymm3 - DB 196,98,125,24,21,178,35,0,0 ; vbroadcastss 0x23b2(%rip),%ymm10 # 4cac <_sk_callback_hsw+0x340> + DB 196,98,125,24,21,94,35,0,0 ; vbroadcastss 0x235e(%rip),%ymm10 # 4c64 <_sk_callback_hsw+0x348> DB 197,172,94,219 ; vdivps %ymm3,%ymm10,%ymm3 DB 197,164,88,219 ; vaddps %ymm3,%ymm11,%ymm3 - DB 196,98,125,24,21,165,35,0,0 ; vbroadcastss 0x23a5(%rip),%ymm10 # 4cb0 <_sk_callback_hsw+0x344> + DB 196,98,125,24,21,81,35,0,0 ; vbroadcastss 0x2351(%rip),%ymm10 # 4c68 <_sk_callback_hsw+0x34c> DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3 DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -2421,33 +2421,33 @@ _sk_parametric_a_hsw LABEL PROC DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3 - DB 196,98,125,24,5,124,35,0,0 ; vbroadcastss 0x237c(%rip),%ymm8 # 4cb4 <_sk_callback_hsw+0x348> + DB 196,98,125,24,5,40,35,0,0 ; vbroadcastss 0x2328(%rip),%ymm8 # 4c6c <_sk_callback_hsw+0x350> DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax PUBLIC _sk_lab_to_xyz_hsw _sk_lab_to_xyz_hsw LABEL PROC - DB 196,98,125,24,5,110,35,0,0 ; vbroadcastss 0x236e(%rip),%ymm8 # 4cb8 <_sk_callback_hsw+0x34c> - DB 196,98,125,24,13,105,35,0,0 ; vbroadcastss 0x2369(%rip),%ymm9 # 4cbc <_sk_callback_hsw+0x350> - DB 196,98,125,24,21,100,35,0,0 ; vbroadcastss 0x2364(%rip),%ymm10 # 4cc0 <_sk_callback_hsw+0x354> + DB 196,98,125,24,5,26,35,0,0 ; vbroadcastss 0x231a(%rip),%ymm8 # 4c70 <_sk_callback_hsw+0x354> + DB 196,98,125,24,13,21,35,0,0 ; vbroadcastss 0x2315(%rip),%ymm9 # 4c74 <_sk_callback_hsw+0x358> + DB 196,98,125,24,21,16,35,0,0 ; vbroadcastss 0x2310(%rip),%ymm10 # 4c78 <_sk_callback_hsw+0x35c> DB 196,194,53,168,202 ; vfmadd213ps %ymm10,%ymm9,%ymm1 DB 196,194,53,168,210 ; vfmadd213ps %ymm10,%ymm9,%ymm2 - DB 196,98,125,24,13,85,35,0,0 ; vbroadcastss 0x2355(%rip),%ymm9 # 4cc4 <_sk_callback_hsw+0x358> + DB 196,98,125,24,13,1,35,0,0 ; vbroadcastss 0x2301(%rip),%ymm9 # 4c7c <_sk_callback_hsw+0x360> DB 196,66,125,184,200 ; vfmadd231ps %ymm8,%ymm0,%ymm9 - DB 196,226,125,24,5,75,35,0,0 ; vbroadcastss 0x234b(%rip),%ymm0 # 4cc8 <_sk_callback_hsw+0x35c> + DB 196,226,125,24,5,247,34,0,0 ; vbroadcastss 0x22f7(%rip),%ymm0 # 4c80 <_sk_callback_hsw+0x364> DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0 - DB 196,98,125,24,5,66,35,0,0 ; vbroadcastss 0x2342(%rip),%ymm8 # 4ccc <_sk_callback_hsw+0x360> + DB 196,98,125,24,5,238,34,0,0 ; vbroadcastss 0x22ee(%rip),%ymm8 # 4c84 <_sk_callback_hsw+0x368> DB 196,98,117,168,192 ; vfmadd213ps %ymm0,%ymm1,%ymm8 - DB 196,98,125,24,13,56,35,0,0 ; vbroadcastss 0x2338(%rip),%ymm9 # 4cd0 <_sk_callback_hsw+0x364> + DB 196,98,125,24,13,228,34,0,0 ; vbroadcastss 0x22e4(%rip),%ymm9 # 4c88 <_sk_callback_hsw+0x36c> DB 196,98,109,172,200 ; vfnmadd213ps %ymm0,%ymm2,%ymm9 DB 196,193,60,89,200 ; vmulps %ymm8,%ymm8,%ymm1 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 - DB 196,226,125,24,21,37,35,0,0 ; vbroadcastss 0x2325(%rip),%ymm2 # 4cd4 <_sk_callback_hsw+0x368> + DB 196,226,125,24,21,209,34,0,0 ; vbroadcastss 0x22d1(%rip),%ymm2 # 4c8c <_sk_callback_hsw+0x370> DB 197,108,194,209,1 ; vcmpltps %ymm1,%ymm2,%ymm10 - DB 196,98,125,24,29,27,35,0,0 ; vbroadcastss 0x231b(%rip),%ymm11 # 4cd8 <_sk_callback_hsw+0x36c> + DB 196,98,125,24,29,199,34,0,0 ; vbroadcastss 0x22c7(%rip),%ymm11 # 4c90 <_sk_callback_hsw+0x374> DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8 - DB 196,98,125,24,37,17,35,0,0 ; vbroadcastss 0x2311(%rip),%ymm12 # 4cdc <_sk_callback_hsw+0x370> + DB 196,98,125,24,37,189,34,0,0 ; vbroadcastss 0x22bd(%rip),%ymm12 # 4c94 <_sk_callback_hsw+0x378> DB 196,65,60,89,196 ; vmulps %ymm12,%ymm8,%ymm8 DB 196,99,61,74,193,160 ; vblendvps %ymm10,%ymm1,%ymm8,%ymm8 DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1 @@ -2462,9 +2462,9 @@ _sk_lab_to_xyz_hsw LABEL PROC DB 196,65,52,88,203 ; vaddps %ymm11,%ymm9,%ymm9 DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9 DB 196,227,53,74,208,32 ; vblendvps %ymm2,%ymm0,%ymm9,%ymm2 - DB 196,226,125,24,5,198,34,0,0 ; vbroadcastss 0x22c6(%rip),%ymm0 # 4ce0 <_sk_callback_hsw+0x374> + DB 196,226,125,24,5,114,34,0,0 ; vbroadcastss 0x2272(%rip),%ymm0 # 4c98 <_sk_callback_hsw+0x37c> DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 - DB 196,98,125,24,5,189,34,0,0 ; vbroadcastss 0x22bd(%rip),%ymm8 # 4ce4 <_sk_callback_hsw+0x378> + DB 196,98,125,24,5,105,34,0,0 ; vbroadcastss 0x2269(%rip),%ymm8 # 4c9c <_sk_callback_hsw+0x380> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2476,11 +2476,11 @@ _sk_load_a8_hsw LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,45 ; jne 2a6d <_sk_load_a8_hsw+0x3d> + DB 117,45 ; jne 2a79 <_sk_load_a8_hsw+0x3d> DB 197,250,126,0 ; vmovq (%rax),%xmm0 DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,146,34,0,0 ; vbroadcastss 0x2292(%rip),%ymm1 # 4ce8 <_sk_callback_hsw+0x37c> + DB 196,226,125,24,13,62,34,0,0 ; vbroadcastss 0x223e(%rip),%ymm1 # 4ca0 <_sk_callback_hsw+0x384> DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 @@ -2498,18 +2498,13 @@ _sk_load_a8_hsw LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 2a76 <_sk_load_a8_hsw+0x46> + DB 117,235 ; jne 2a82 <_sk_load_a8_hsw+0x46> DB 196,193,249,110,194 ; vmovq %r10,%xmm0 DB 91 ; pop %rbx - DB 235,177 ; jmp 2a44 <_sk_load_a8_hsw+0x14> + DB 235,177 ; jmp 2a50 <_sk_load_a8_hsw+0x14> PUBLIC _sk_gather_a8_hsw _sk_gather_a8_hsw LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -2517,60 +2512,55 @@ _sk_gather_a8_hsw LABEL PROC DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1 DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,12,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm1 DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,113,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1 DB 65,137,194 ; mov %eax,%r10d DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,195 ; vmovq %xmm0,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0 - DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,196 ; vmovq %xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0 - DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0 DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d - DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0 + DB 196,195,113,32,202,2 ; vpinsrb $0x2,%r10d,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,4 ; vpinsrb $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,182,4,17 ; movzbl (%r9,%r10,1),%eax + DB 196,227,113,32,192,5 ; vpinsrb $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax - DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0 - DB 67,15,182,4,41 ; movzbl (%r9,%r13,1),%eax - DB 196,227,121,32,192,4 ; vpinsrb $0x4,%eax,%xmm0,%xmm0 - DB 67,15,182,4,33 ; movzbl (%r9,%r12,1),%eax - DB 196,227,121,32,192,5 ; vpinsrb $0x5,%eax,%xmm0,%xmm0 - DB 67,15,182,4,57 ; movzbl (%r9,%r15,1),%eax DB 196,227,121,32,192,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm0 - DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0 DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,154,33,0,0 ; vbroadcastss 0x219a(%rip),%ymm1 # 4cec <_sk_callback_hsw+0x380> + DB 196,226,125,24,13,79,33,0,0 ; vbroadcastss 0x214f(%rip),%ymm1 # 4ca4 <_sk_callback_hsw+0x388> DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 197,237,239,210 ; vpxor %ymm2,%ymm2,%ymm2 - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_store_a8_hsw _sk_store_a8_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,115,33,0,0 ; vbroadcastss 0x2173(%rip),%ymm8 # 4cf0 <_sk_callback_hsw+0x384> + DB 196,98,125,24,5,49,33,0,0 ; vbroadcastss 0x2131(%rip),%ymm8 # 4ca8 <_sk_callback_hsw+0x38c> DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8 DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8 DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 196,65,57,103,192 ; vpackuswb %xmm8,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 2ba6 <_sk_store_a8_hsw+0x37> + DB 117,10 ; jne 2ba0 <_sk_store_a8_hsw+0x37> DB 196,65,123,17,4,19 ; vmovsd %xmm8,(%r11,%rdx,1) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2578,10 +2568,10 @@ _sk_store_a8_hsw LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 2ba2 <_sk_store_a8_hsw+0x33> + DB 119,236 ; ja 2b9c <_sk_store_a8_hsw+0x33> DB 196,66,121,48,192 ; vpmovzxbw %xmm8,%xmm8 DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 2c08 <_sk_store_a8_hsw+0x99> + DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 2c04 <_sk_store_a8_hsw+0x9b> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -2592,26 +2582,28 @@ _sk_store_a8_hsw LABEL PROC DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1) DB 196,67,121,20,68,19,1,2 ; vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1) DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1) - DB 235,154 ; jmp 2ba2 <_sk_store_a8_hsw+0x33> - DB 247,255 ; idiv %edi + DB 235,154 ; jmp 2b9c <_sk_store_a8_hsw+0x33> + DB 102,144 ; xchg %ax,%ax + DB 245 ; cmc DB 255 ; (bad) DB 255 ; (bad) - DB 239 ; out %eax,(%dx) DB 255 ; (bad) + DB 237 ; in (%dx),%eax DB 255 ; (bad) - DB 255,231 ; jmpq *%rdi DB 255 ; (bad) + DB 255,229 ; jmpq *%rbp DB 255 ; (bad) DB 255 ; (bad) - DB 223,255 ; (bad) DB 255 ; (bad) - DB 255,215 ; callq *%rdi + DB 221,255 ; (bad) + DB 255 ; (bad) + DB 255,213 ; callq *%rbp DB 255 ; (bad) DB 255 ; (bad) - DB 255,207 ; dec %edi + DB 255,205 ; dec %ebp DB 255 ; (bad) DB 255 ; (bad) - DB 255,199 ; inc %edi + DB 255,197 ; inc %ebp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -2623,14 +2615,14 @@ _sk_load_g8_hsw LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,50 ; jne 2c66 <_sk_load_g8_hsw+0x42> + DB 117,50 ; jne 2c62 <_sk_load_g8_hsw+0x42> DB 197,250,126,0 ; vmovq (%rax),%xmm0 DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,170,32,0,0 ; vbroadcastss 0x20aa(%rip),%ymm1 # 4cf4 <_sk_callback_hsw+0x388> + DB 196,226,125,24,13,102,32,0,0 ; vbroadcastss 0x2066(%rip),%ymm1 # 4cac <_sk_callback_hsw+0x390> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,159,32,0,0 ; vbroadcastss 0x209f(%rip),%ymm3 # 4cf8 <_sk_callback_hsw+0x38c> + DB 196,226,125,24,29,91,32,0,0 ; vbroadcastss 0x205b(%rip),%ymm3 # 4cb0 <_sk_callback_hsw+0x394> DB 76,137,201 ; mov %r9,%rcx DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 DB 197,252,40,208 ; vmovaps %ymm0,%ymm2 @@ -2645,18 +2637,13 @@ _sk_load_g8_hsw LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 2c6f <_sk_load_g8_hsw+0x4b> + DB 117,235 ; jne 2c6b <_sk_load_g8_hsw+0x4b> DB 196,193,249,110,194 ; vmovq %r10,%xmm0 DB 91 ; pop %rbx - DB 235,172 ; jmp 2c38 <_sk_load_g8_hsw+0x14> + DB 235,172 ; jmp 2c34 <_sk_load_g8_hsw+0x14> PUBLIC _sk_gather_g8_hsw _sk_gather_g8_hsw LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -2664,46 +2651,41 @@ _sk_gather_g8_hsw LABEL PROC DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1 DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,12,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm1 DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,113,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm1,%xmm1 DB 65,137,194 ; mov %eax,%r10d DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,195 ; vmovq %xmm0,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0 - DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,196 ; vmovq %xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,131,121,32,4,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm0 - DB 196,131,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm0,%xmm0 DB 71,15,182,20,17 ; movzbl (%r9,%r10,1),%r10d - DB 196,195,121,32,194,2 ; vpinsrb $0x2,%r10d,%xmm0,%xmm0 + DB 196,195,113,32,202,2 ; vpinsrb $0x2,%r10d,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,4 ; vpinsrb $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,182,4,17 ; movzbl (%r9,%r10,1),%eax + DB 196,227,113,32,192,5 ; vpinsrb $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax - DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0 - DB 67,15,182,4,41 ; movzbl (%r9,%r13,1),%eax - DB 196,227,121,32,192,4 ; vpinsrb $0x4,%eax,%xmm0,%xmm0 - DB 67,15,182,4,33 ; movzbl (%r9,%r12,1),%eax - DB 196,227,121,32,192,5 ; vpinsrb $0x5,%eax,%xmm0,%xmm0 - DB 67,15,182,4,57 ; movzbl (%r9,%r15,1),%eax DB 196,227,121,32,192,6 ; vpinsrb $0x6,%eax,%xmm0,%xmm0 - DB 65,15,182,4,25 ; movzbl (%r9,%rbx,1),%eax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0 DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,177,31,0,0 ; vbroadcastss 0x1fb1(%rip),%ymm1 # 4cfc <_sk_callback_hsw+0x390> + DB 196,226,125,24,13,118,31,0,0 ; vbroadcastss 0x1f76(%rip),%ymm1 # 4cb4 <_sk_callback_hsw+0x398> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,166,31,0,0 ; vbroadcastss 0x1fa6(%rip),%ymm3 # 4d00 <_sk_callback_hsw+0x394> + DB 196,226,125,24,29,107,31,0,0 ; vbroadcastss 0x1f6b(%rip),%ymm3 # 4cb8 <_sk_callback_hsw+0x39c> DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 DB 197,252,40,208 ; vmovaps %ymm0,%ymm2 - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_gather_i8_hsw @@ -2711,15 +2693,10 @@ _sk_gather_i8_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,137,193 ; mov %rax,%r9 DB 77,133,201 ; test %r9,%r9 - DB 116,5 ; je 2d7c <_sk_gather_i8_hsw+0xf> + DB 116,5 ; je 2d66 <_sk_gather_i8_hsw+0xf> DB 76,137,200 ; mov %r9,%rax - DB 235,2 ; jmp 2d7e <_sk_gather_i8_hsw+0x11> + DB 235,2 ; jmp 2d68 <_sk_gather_i8_hsw+0x11> DB 72,173 ; lods %ds:(%rsi),%rax - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 DB 83 ; push %rbx DB 76,139,16 ; mov (%rax),%r10 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -2727,39 +2704,39 @@ _sk_gather_i8_hsw LABEL PROC DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1 DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 + DB 196,193,249,126,195 ; vmovq %xmm0,%r11 + DB 68,137,216 ; mov %r11d,%eax + DB 196,195,121,32,12,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1 DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,131,113,32,12,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm1,%xmm1 DB 65,137,195 ; mov %eax,%r11d DB 72,193,232,32 ; shr $0x20,%rax - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,222 ; mov %ebx,%r14d - DB 72,193,235,32 ; shr $0x20,%rbx DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0 - DB 196,195,249,22,199,1 ; vpextrq $0x1,%xmm0,%r15 - DB 69,137,252 ; mov %r15d,%r12d - DB 73,193,239,32 ; shr $0x20,%r15 - DB 196,193,249,126,197 ; vmovq %xmm0,%r13 - DB 68,137,237 ; mov %r13d,%ebp - DB 73,193,237,32 ; shr $0x20,%r13 - DB 196,131,121,32,4,50,0 ; vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0 - DB 196,195,121,32,4,26,1 ; vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0 - DB 196,131,121,32,4,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0 - DB 196,195,121,32,4,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0 - DB 196,195,121,32,4,42,4 ; vpinsrb $0x4,(%r10,%rbp,1),%xmm0,%xmm0 - DB 196,131,121,32,4,42,5 ; vpinsrb $0x5,(%r10,%r13,1),%xmm0,%xmm0 - DB 196,131,121,32,4,34,6 ; vpinsrb $0x6,(%r10,%r12,1),%xmm0,%xmm0 - DB 196,131,121,32,4,58,7 ; vpinsrb $0x7,(%r10,%r15,1),%xmm0,%xmm0 + DB 196,131,113,32,12,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm1,%xmm1 + DB 196,193,249,126,195 ; vmovq %xmm0,%r11 + DB 196,195,113,32,12,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1 + DB 68,137,216 ; mov %r11d,%eax + DB 196,195,113,32,12,2,4 ; vpinsrb $0x4,(%r10,%rax,1),%xmm1,%xmm1 + DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,131,113,32,4,26,5 ; vpinsrb $0x5,(%r10,%r11,1),%xmm1,%xmm0 + DB 137,216 ; mov %ebx,%eax + DB 196,195,121,32,4,2,6 ; vpinsrb $0x6,(%r10,%rax,1),%xmm0,%xmm0 + DB 72,193,235,32 ; shr $0x20,%rbx + DB 196,195,121,32,4,26,7 ; vpinsrb $0x7,(%r10,%rbx,1),%xmm0,%xmm0 DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0 DB 73,139,65,8 ; mov 0x8(%r9),%rax DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1 DB 196,226,117,144,28,128 ; vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3 - DB 197,229,219,5,51,33,0,0 ; vpand 0x2133(%rip),%ymm3,%ymm0 # 4f60 <_sk_callback_hsw+0x5f4> + DB 197,229,219,5,19,33,0,0 ; vpand 0x2113(%rip),%ymm3,%ymm0 # 4f20 <_sk_callback_hsw+0x604> DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,202,30,0,0 ; vbroadcastss 0x1eca(%rip),%ymm8 # 4d04 <_sk_callback_hsw+0x398> + DB 196,98,125,24,5,162,30,0,0 ; vbroadcastss 0x1ea2(%rip),%ymm8 # 4cbc <_sk_callback_hsw+0x3a0> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 - DB 196,226,101,0,13,56,33,0,0 ; vpshufb 0x2138(%rip),%ymm3,%ymm1 # 4f80 <_sk_callback_hsw+0x614> + DB 196,226,101,0,13,24,33,0,0 ; vpshufb 0x2118(%rip),%ymm3,%ymm1 # 4f40 <_sk_callback_hsw+0x624> DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 - DB 196,226,101,0,21,70,33,0,0 ; vpshufb 0x2146(%rip),%ymm3,%ymm2 # 4fa0 <_sk_callback_hsw+0x634> + DB 196,226,101,0,21,38,33,0,0 ; vpshufb 0x2126(%rip),%ymm3,%ymm2 # 4f60 <_sk_callback_hsw+0x644> DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3 @@ -2767,11 +2744,6 @@ _sk_gather_i8_hsw LABEL PROC DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax PUBLIC _sk_load_565_hsw @@ -2779,35 +2751,35 @@ _sk_load_565_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 117,114 ; jne 2efb <_sk_load_565_hsw+0x7c> + DB 117,114 ; jne 2ed2 <_sk_load_565_hsw+0x7c> DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0 DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2 - DB 196,226,125,88,5,107,30,0,0 ; vpbroadcastd 0x1e6b(%rip),%ymm0 # 4d08 <_sk_callback_hsw+0x39c> + DB 196,226,125,88,5,76,30,0,0 ; vpbroadcastd 0x1e4c(%rip),%ymm0 # 4cc0 <_sk_callback_hsw+0x3a4> DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,94,30,0,0 ; vbroadcastss 0x1e5e(%rip),%ymm1 # 4d0c <_sk_callback_hsw+0x3a0> + DB 196,226,125,24,13,63,30,0,0 ; vbroadcastss 0x1e3f(%rip),%ymm1 # 4cc4 <_sk_callback_hsw+0x3a8> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,88,13,85,30,0,0 ; vpbroadcastd 0x1e55(%rip),%ymm1 # 4d10 <_sk_callback_hsw+0x3a4> + DB 196,226,125,88,13,54,30,0,0 ; vpbroadcastd 0x1e36(%rip),%ymm1 # 4cc8 <_sk_callback_hsw+0x3ac> DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,29,72,30,0,0 ; vbroadcastss 0x1e48(%rip),%ymm3 # 4d14 <_sk_callback_hsw+0x3a8> + DB 196,226,125,24,29,41,30,0,0 ; vbroadcastss 0x1e29(%rip),%ymm3 # 4ccc <_sk_callback_hsw+0x3b0> DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1 - DB 196,226,125,88,29,63,30,0,0 ; vpbroadcastd 0x1e3f(%rip),%ymm3 # 4d18 <_sk_callback_hsw+0x3ac> + DB 196,226,125,88,29,32,30,0,0 ; vpbroadcastd 0x1e20(%rip),%ymm3 # 4cd0 <_sk_callback_hsw+0x3b4> DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,226,125,24,29,50,30,0,0 ; vbroadcastss 0x1e32(%rip),%ymm3 # 4d1c <_sk_callback_hsw+0x3b0> + DB 196,226,125,24,29,19,30,0,0 ; vbroadcastss 0x1e13(%rip),%ymm3 # 4cd4 <_sk_callback_hsw+0x3b8> DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,39,30,0,0 ; vbroadcastss 0x1e27(%rip),%ymm3 # 4d20 <_sk_callback_hsw+0x3b4> + DB 196,226,125,24,29,8,30,0,0 ; vbroadcastss 0x1e08(%rip),%ymm3 # 4cd8 <_sk_callback_hsw+0x3bc> DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,7 ; and $0x7,%r9b DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,128 ; ja 2e8f <_sk_load_565_hsw+0x10> + DB 119,128 ; ja 2e66 <_sk_load_565_hsw+0x10> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 2f64 <_sk_load_565_hsw+0xe5> + DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 2f3c <_sk_load_565_hsw+0xe6> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -2819,39 +2791,34 @@ _sk_load_565_hsw LABEL PROC DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - DB 233,44,255,255,255 ; jmpq 2e8f <_sk_load_565_hsw+0x10> - DB 144 ; nop - DB 243,255 ; repz (bad) + DB 233,44,255,255,255 ; jmpq 2e66 <_sk_load_565_hsw+0x10> + DB 102,144 ; xchg %ax,%ax + DB 242,255 ; repnz (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 235,255 ; jmp 2f69 <_sk_load_565_hsw+0xea> + DB 234 ; (bad) DB 255 ; (bad) - DB 255,227 ; jmpq *%rbx DB 255 ; (bad) + DB 255,226 ; jmpq *%rdx DB 255 ; (bad) DB 255 ; (bad) - DB 219,255 ; (bad) DB 255 ; (bad) - DB 255,211 ; callq *%rbx + DB 218,255 ; (bad) DB 255 ; (bad) + DB 255,210 ; callq *%rdx DB 255 ; (bad) - DB 255,203 ; dec %ebx + DB 255 ; (bad) + DB 255,202 ; dec %edx DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 191 ; .byte 0xbf + DB 190 ; .byte 0xbe DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff PUBLIC _sk_gather_565_hsw _sk_gather_565_hsw LABEL PROC - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -2859,70 +2826,64 @@ _sk_gather_565_hsw LABEL PROC DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1 DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 - DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,195 ; vmovq %xmm0,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,110,200 ; vmovd %eax,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,200,1 ; vpinsrw $0x1,%eax,%xmm1,%xmm1 + DB 68,137,216 ; mov %r11d,%eax DB 73,193,235,32 ; shr $0x20,%r11 DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0 - DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,196 ; vmovq %xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 71,15,183,28,89 ; movzwl (%r9,%r11,2),%r11d - DB 67,15,183,44,113 ; movzwl (%r9,%r14,2),%ebp - DB 197,249,110,197 ; vmovd %ebp,%xmm0 - DB 196,193,121,196,195,1 ; vpinsrw $0x1,%r11d,%xmm0,%xmm0 - DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp - DB 197,249,196,197,2 ; vpinsrw $0x2,%ebp,%xmm0,%xmm0 DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax - DB 197,249,196,192,3 ; vpinsrw $0x3,%eax,%xmm0,%xmm0 - DB 67,15,183,4,105 ; movzwl (%r9,%r13,2),%eax - DB 197,249,196,192,4 ; vpinsrw $0x4,%eax,%xmm0,%xmm0 - DB 67,15,183,4,97 ; movzwl (%r9,%r12,2),%eax - DB 197,249,196,192,5 ; vpinsrw $0x5,%eax,%xmm0,%xmm0 - DB 67,15,183,4,121 ; movzwl (%r9,%r15,2),%eax + DB 197,241,196,200,2 ; vpinsrw $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax + DB 197,241,196,200,3 ; vpinsrw $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,4 ; vpinsrw $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,192,5 ; vpinsrw $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0 - DB 65,15,183,4,89 ; movzwl (%r9,%rbx,2),%eax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0 DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2 - DB 196,226,125,88,5,232,28,0,0 ; vpbroadcastd 0x1ce8(%rip),%ymm0 # 4d24 <_sk_callback_hsw+0x3b8> + DB 196,226,125,88,5,211,28,0,0 ; vpbroadcastd 0x1cd3(%rip),%ymm0 # 4cdc <_sk_callback_hsw+0x3c0> DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,219,28,0,0 ; vbroadcastss 0x1cdb(%rip),%ymm1 # 4d28 <_sk_callback_hsw+0x3bc> + DB 196,226,125,24,13,198,28,0,0 ; vbroadcastss 0x1cc6(%rip),%ymm1 # 4ce0 <_sk_callback_hsw+0x3c4> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,88,13,210,28,0,0 ; vpbroadcastd 0x1cd2(%rip),%ymm1 # 4d2c <_sk_callback_hsw+0x3c0> + DB 196,226,125,88,13,189,28,0,0 ; vpbroadcastd 0x1cbd(%rip),%ymm1 # 4ce4 <_sk_callback_hsw+0x3c8> DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,29,197,28,0,0 ; vbroadcastss 0x1cc5(%rip),%ymm3 # 4d30 <_sk_callback_hsw+0x3c4> + DB 196,226,125,24,29,176,28,0,0 ; vbroadcastss 0x1cb0(%rip),%ymm3 # 4ce8 <_sk_callback_hsw+0x3cc> DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1 - DB 196,226,125,88,29,188,28,0,0 ; vpbroadcastd 0x1cbc(%rip),%ymm3 # 4d34 <_sk_callback_hsw+0x3c8> + DB 196,226,125,88,29,167,28,0,0 ; vpbroadcastd 0x1ca7(%rip),%ymm3 # 4cec <_sk_callback_hsw+0x3d0> DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,226,125,24,29,175,28,0,0 ; vbroadcastss 0x1caf(%rip),%ymm3 # 4d38 <_sk_callback_hsw+0x3cc> + DB 196,226,125,24,29,154,28,0,0 ; vbroadcastss 0x1c9a(%rip),%ymm3 # 4cf0 <_sk_callback_hsw+0x3d4> DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,164,28,0,0 ; vbroadcastss 0x1ca4(%rip),%ymm3 # 4d3c <_sk_callback_hsw+0x3d0> - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp + DB 196,226,125,24,29,143,28,0,0 ; vbroadcastss 0x1c8f(%rip),%ymm3 # 4cf4 <_sk_callback_hsw+0x3d8> DB 255,224 ; jmpq *%rax PUBLIC _sk_store_565_hsw _sk_store_565_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,142,28,0,0 ; vbroadcastss 0x1c8e(%rip),%ymm8 # 4d40 <_sk_callback_hsw+0x3d4> + DB 196,98,125,24,5,131,28,0,0 ; vbroadcastss 0x1c83(%rip),%ymm8 # 4cf8 <_sk_callback_hsw+0x3dc> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,193,53,114,241,11 ; vpslld $0xb,%ymm9,%ymm9 - DB 196,98,125,24,21,121,28,0,0 ; vbroadcastss 0x1c79(%rip),%ymm10 # 4d44 <_sk_callback_hsw+0x3d8> + DB 196,98,125,24,21,110,28,0,0 ; vbroadcastss 0x1c6e(%rip),%ymm10 # 4cfc <_sk_callback_hsw+0x3e0> DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10 DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10 DB 196,193,45,114,242,5 ; vpslld $0x5,%ymm10,%ymm10 @@ -2933,7 +2894,7 @@ _sk_store_565_hsw LABEL PROC DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3109 <_sk_store_565_hsw+0x65> + DB 117,10 ; jne 30cc <_sk_store_565_hsw+0x65> DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -2941,9 +2902,9 @@ _sk_store_565_hsw LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 3105 <_sk_store_565_hsw+0x61> + DB 119,236 ; ja 30c8 <_sk_store_565_hsw+0x61> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3168 <_sk_store_565_hsw+0xc4> + DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 312c <_sk_store_565_hsw+0xc5> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -2954,28 +2915,28 @@ _sk_store_565_hsw LABEL PROC DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2) - DB 235,159 ; jmp 3105 <_sk_store_565_hsw+0x61> - DB 102,144 ; xchg %ax,%ax - DB 245 ; cmc + DB 235,159 ; jmp 30c8 <_sk_store_565_hsw+0x61> + DB 15,31,0 ; nopl (%rax) + DB 244 ; hlt DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 237 ; in (%dx),%eax + DB 236 ; in (%dx),%al DB 255 ; (bad) DB 255 ; (bad) - DB 255,229 ; jmpq *%rbp + DB 255,228 ; jmpq *%rsp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 221,255 ; (bad) + DB 220,255 ; fdivr %st,%st(7) DB 255 ; (bad) - DB 255,213 ; callq *%rbp + DB 255,212 ; callq *%rsp DB 255 ; (bad) DB 255 ; (bad) - DB 255,205 ; dec %ebp + DB 255,204 ; dec %esp DB 255 ; (bad) DB 255 ; (bad) - DB 255,197 ; inc %ebp + DB 255,196 ; inc %esp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -2985,28 +2946,28 @@ _sk_load_4444_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,138,0,0,0 ; jne 321c <_sk_load_4444_hsw+0x98> + DB 15,133,138,0,0,0 ; jne 31e0 <_sk_load_4444_hsw+0x98> DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0 DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3 - DB 196,226,125,88,5,162,27,0,0 ; vpbroadcastd 0x1ba2(%rip),%ymm0 # 4d48 <_sk_callback_hsw+0x3dc> + DB 196,226,125,88,5,150,27,0,0 ; vpbroadcastd 0x1b96(%rip),%ymm0 # 4d00 <_sk_callback_hsw+0x3e4> DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,149,27,0,0 ; vbroadcastss 0x1b95(%rip),%ymm1 # 4d4c <_sk_callback_hsw+0x3e0> + DB 196,226,125,24,13,137,27,0,0 ; vbroadcastss 0x1b89(%rip),%ymm1 # 4d04 <_sk_callback_hsw+0x3e8> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,88,13,140,27,0,0 ; vpbroadcastd 0x1b8c(%rip),%ymm1 # 4d50 <_sk_callback_hsw+0x3e4> + DB 196,226,125,88,13,128,27,0,0 ; vpbroadcastd 0x1b80(%rip),%ymm1 # 4d08 <_sk_callback_hsw+0x3ec> DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,21,127,27,0,0 ; vbroadcastss 0x1b7f(%rip),%ymm2 # 4d54 <_sk_callback_hsw+0x3e8> + DB 196,226,125,24,21,115,27,0,0 ; vbroadcastss 0x1b73(%rip),%ymm2 # 4d0c <_sk_callback_hsw+0x3f0> DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1 - DB 196,226,125,88,21,118,27,0,0 ; vpbroadcastd 0x1b76(%rip),%ymm2 # 4d58 <_sk_callback_hsw+0x3ec> + DB 196,226,125,88,21,106,27,0,0 ; vpbroadcastd 0x1b6a(%rip),%ymm2 # 4d10 <_sk_callback_hsw+0x3f4> DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,98,125,24,5,105,27,0,0 ; vbroadcastss 0x1b69(%rip),%ymm8 # 4d5c <_sk_callback_hsw+0x3f0> + DB 196,98,125,24,5,93,27,0,0 ; vbroadcastss 0x1b5d(%rip),%ymm8 # 4d14 <_sk_callback_hsw+0x3f8> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 - DB 196,98,125,88,5,95,27,0,0 ; vpbroadcastd 0x1b5f(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x3f4> + DB 196,98,125,88,5,83,27,0,0 ; vpbroadcastd 0x1b53(%rip),%ymm8 # 4d18 <_sk_callback_hsw+0x3fc> DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,81,27,0,0 ; vbroadcastss 0x1b51(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x3f8> + DB 196,98,125,24,5,69,27,0,0 ; vbroadcastss 0x1b45(%rip),%ymm8 # 4d1c <_sk_callback_hsw+0x400> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -3015,9 +2976,9 @@ _sk_load_4444_hsw LABEL PROC DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,100,255,255,255 ; ja 3198 <_sk_load_4444_hsw+0x14> + DB 15,135,100,255,255,255 ; ja 315c <_sk_load_4444_hsw+0x14> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,73,0,0,0 ; lea 0x49(%rip),%r10 # 3288 <_sk_load_4444_hsw+0x104> + DB 76,141,21,73,0,0,0 ; lea 0x49(%rip),%r10 # 324c <_sk_load_4444_hsw+0x104> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -3029,7 +2990,7 @@ _sk_load_4444_hsw LABEL PROC DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - DB 233,16,255,255,255 ; jmpq 3198 <_sk_load_4444_hsw+0x14> + DB 233,16,255,255,255 ; jmpq 315c <_sk_load_4444_hsw+0x14> DB 244 ; hlt DB 255 ; (bad) DB 255 ; (bad) @@ -3056,12 +3017,6 @@ _sk_load_4444_hsw LABEL PROC PUBLIC _sk_gather_4444_hsw _sk_gather_4444_hsw LABEL PROC - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -3069,70 +3024,64 @@ _sk_gather_4444_hsw LABEL PROC DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1 DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 - DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,195 ; vmovq %xmm0,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,110,200 ; vmovd %eax,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,200,1 ; vpinsrw $0x1,%eax,%xmm1,%xmm1 + DB 68,137,216 ; mov %r11d,%eax DB 73,193,235,32 ; shr $0x20,%r11 DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0 - DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,196 ; vmovq %xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 71,15,183,28,89 ; movzwl (%r9,%r11,2),%r11d - DB 67,15,183,44,113 ; movzwl (%r9,%r14,2),%ebp - DB 197,249,110,197 ; vmovd %ebp,%xmm0 - DB 196,193,121,196,195,1 ; vpinsrw $0x1,%r11d,%xmm0,%xmm0 - DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp - DB 197,249,196,197,2 ; vpinsrw $0x2,%ebp,%xmm0,%xmm0 DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax - DB 197,249,196,192,3 ; vpinsrw $0x3,%eax,%xmm0,%xmm0 - DB 67,15,183,4,105 ; movzwl (%r9,%r13,2),%eax - DB 197,249,196,192,4 ; vpinsrw $0x4,%eax,%xmm0,%xmm0 - DB 67,15,183,4,97 ; movzwl (%r9,%r12,2),%eax - DB 197,249,196,192,5 ; vpinsrw $0x5,%eax,%xmm0,%xmm0 - DB 67,15,183,4,121 ; movzwl (%r9,%r15,2),%eax + DB 197,241,196,200,2 ; vpinsrw $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax + DB 197,241,196,200,3 ; vpinsrw $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,4 ; vpinsrw $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,192,5 ; vpinsrw $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0 - DB 65,15,183,4,89 ; movzwl (%r9,%rbx,2),%eax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0 DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3 - DB 196,226,125,88,5,8,26,0,0 ; vpbroadcastd 0x1a08(%rip),%ymm0 # 4d68 <_sk_callback_hsw+0x3fc> + DB 196,226,125,88,5,7,26,0,0 ; vpbroadcastd 0x1a07(%rip),%ymm0 # 4d20 <_sk_callback_hsw+0x404> DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,251,25,0,0 ; vbroadcastss 0x19fb(%rip),%ymm1 # 4d6c <_sk_callback_hsw+0x400> + DB 196,226,125,24,13,250,25,0,0 ; vbroadcastss 0x19fa(%rip),%ymm1 # 4d24 <_sk_callback_hsw+0x408> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,88,13,242,25,0,0 ; vpbroadcastd 0x19f2(%rip),%ymm1 # 4d70 <_sk_callback_hsw+0x404> + DB 196,226,125,88,13,241,25,0,0 ; vpbroadcastd 0x19f1(%rip),%ymm1 # 4d28 <_sk_callback_hsw+0x40c> DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,21,229,25,0,0 ; vbroadcastss 0x19e5(%rip),%ymm2 # 4d74 <_sk_callback_hsw+0x408> + DB 196,226,125,24,21,228,25,0,0 ; vbroadcastss 0x19e4(%rip),%ymm2 # 4d2c <_sk_callback_hsw+0x410> DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1 - DB 196,226,125,88,21,220,25,0,0 ; vpbroadcastd 0x19dc(%rip),%ymm2 # 4d78 <_sk_callback_hsw+0x40c> + DB 196,226,125,88,21,219,25,0,0 ; vpbroadcastd 0x19db(%rip),%ymm2 # 4d30 <_sk_callback_hsw+0x414> DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,98,125,24,5,207,25,0,0 ; vbroadcastss 0x19cf(%rip),%ymm8 # 4d7c <_sk_callback_hsw+0x410> + DB 196,98,125,24,5,206,25,0,0 ; vbroadcastss 0x19ce(%rip),%ymm8 # 4d34 <_sk_callback_hsw+0x418> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 - DB 196,98,125,88,5,197,25,0,0 ; vpbroadcastd 0x19c5(%rip),%ymm8 # 4d80 <_sk_callback_hsw+0x414> + DB 196,98,125,88,5,196,25,0,0 ; vpbroadcastd 0x19c4(%rip),%ymm8 # 4d38 <_sk_callback_hsw+0x41c> DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,183,25,0,0 ; vbroadcastss 0x19b7(%rip),%ymm8 # 4d84 <_sk_callback_hsw+0x418> + DB 196,98,125,24,5,182,25,0,0 ; vbroadcastss 0x19b6(%rip),%ymm8 # 4d3c <_sk_callback_hsw+0x420> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax PUBLIC _sk_store_4444_hsw _sk_store_4444_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,154,25,0,0 ; vbroadcastss 0x199a(%rip),%ymm8 # 4d88 <_sk_callback_hsw+0x41c> + DB 196,98,125,24,5,163,25,0,0 ; vbroadcastss 0x19a3(%rip),%ymm8 # 4d40 <_sk_callback_hsw+0x424> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,193,53,114,241,12 ; vpslld $0xc,%ymm9,%ymm9 @@ -3150,7 +3099,7 @@ _sk_store_4444_hsw LABEL PROC DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3451 <_sk_store_4444_hsw+0x71> + DB 117,10 ; jne 3400 <_sk_store_4444_hsw+0x71> DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -3158,9 +3107,9 @@ _sk_store_4444_hsw LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 344d <_sk_store_4444_hsw+0x6d> + DB 119,236 ; ja 33fc <_sk_store_4444_hsw+0x6d> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 34b0 <_sk_store_4444_hsw+0xd0> + DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 3460 <_sk_store_4444_hsw+0xd1> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -3171,28 +3120,28 @@ _sk_store_4444_hsw LABEL PROC DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2) - DB 235,159 ; jmp 344d <_sk_store_4444_hsw+0x6d> - DB 102,144 ; xchg %ax,%ax - DB 245 ; cmc + DB 235,159 ; jmp 33fc <_sk_store_4444_hsw+0x6d> + DB 15,31,0 ; nopl (%rax) + DB 244 ; hlt DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 237 ; in (%dx),%eax + DB 236 ; in (%dx),%al DB 255 ; (bad) DB 255 ; (bad) - DB 255,229 ; jmpq *%rbp + DB 255,228 ; jmpq *%rsp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 221,255 ; (bad) + DB 220,255 ; fdivr %st,%st(7) DB 255 ; (bad) - DB 255,213 ; callq *%rbp + DB 255,212 ; callq *%rsp DB 255 ; (bad) DB 255 ; (bad) - DB 255,205 ; dec %ebp + DB 255,204 ; dec %esp DB 255 ; (bad) DB 255 ; (bad) - DB 255,197 ; inc %ebp + DB 255,196 ; inc %esp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -3204,16 +3153,16 @@ _sk_load_8888_hsw LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,88 ; jne 3539 <_sk_load_8888_hsw+0x6d> + DB 117,88 ; jne 34e9 <_sk_load_8888_hsw+0x6d> DB 196,193,124,16,26 ; vmovups (%r10),%ymm3 - DB 197,228,84,5,210,26,0,0 ; vandps 0x1ad2(%rip),%ymm3,%ymm0 # 4fc0 <_sk_callback_hsw+0x654> + DB 197,228,84,5,226,26,0,0 ; vandps 0x1ae2(%rip),%ymm3,%ymm0 # 4f80 <_sk_callback_hsw+0x664> DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,145,24,0,0 ; vbroadcastss 0x1891(%rip),%ymm8 # 4d8c <_sk_callback_hsw+0x420> + DB 196,98,125,24,5,153,24,0,0 ; vbroadcastss 0x1899(%rip),%ymm8 # 4d44 <_sk_callback_hsw+0x428> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 - DB 196,226,101,0,13,215,26,0,0 ; vpshufb 0x1ad7(%rip),%ymm3,%ymm1 # 4fe0 <_sk_callback_hsw+0x674> + DB 196,226,101,0,13,231,26,0,0 ; vpshufb 0x1ae7(%rip),%ymm3,%ymm1 # 4fa0 <_sk_callback_hsw+0x684> DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 - DB 196,226,101,0,21,229,26,0,0 ; vpshufb 0x1ae5(%rip),%ymm3,%ymm2 # 5000 <_sk_callback_hsw+0x694> + DB 196,226,101,0,21,245,26,0,0 ; vpshufb 0x1af5(%rip),%ymm3,%ymm2 # 4fc0 <_sk_callback_hsw+0x6a4> DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3 @@ -3230,7 +3179,7 @@ _sk_load_8888_hsw LABEL PROC DB 196,225,249,110,192 ; vmovq %rax,%xmm0 DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0 DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3 - DB 235,135 ; jmp 34e6 <_sk_load_8888_hsw+0x1a> + DB 235,135 ; jmp 3496 <_sk_load_8888_hsw+0x1a> PUBLIC _sk_gather_8888_hsw _sk_gather_8888_hsw LABEL PROC @@ -3243,14 +3192,14 @@ _sk_gather_8888_hsw LABEL PROC DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0 DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1 DB 196,194,117,144,28,129 ; vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3 - DB 197,229,219,5,147,26,0,0 ; vpand 0x1a93(%rip),%ymm3,%ymm0 # 5020 <_sk_callback_hsw+0x6b4> + DB 197,229,219,5,163,26,0,0 ; vpand 0x1aa3(%rip),%ymm3,%ymm0 # 4fe0 <_sk_callback_hsw+0x6c4> DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,246,23,0,0 ; vbroadcastss 0x17f6(%rip),%ymm8 # 4d90 <_sk_callback_hsw+0x424> + DB 196,98,125,24,5,254,23,0,0 ; vbroadcastss 0x17fe(%rip),%ymm8 # 4d48 <_sk_callback_hsw+0x42c> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 - DB 196,226,101,0,13,152,26,0,0 ; vpshufb 0x1a98(%rip),%ymm3,%ymm1 # 5040 <_sk_callback_hsw+0x6d4> + DB 196,226,101,0,13,168,26,0,0 ; vpshufb 0x1aa8(%rip),%ymm3,%ymm1 # 5000 <_sk_callback_hsw+0x6e4> DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 - DB 196,226,101,0,21,166,26,0,0 ; vpshufb 0x1aa6(%rip),%ymm3,%ymm2 # 5060 <_sk_callback_hsw+0x6f4> + DB 196,226,101,0,21,182,26,0,0 ; vpshufb 0x1ab6(%rip),%ymm3,%ymm2 # 5020 <_sk_callback_hsw+0x704> DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3 @@ -3265,7 +3214,7 @@ _sk_store_8888_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 - DB 196,98,125,24,5,166,23,0,0 ; vbroadcastss 0x17a6(%rip),%ymm8 # 4d94 <_sk_callback_hsw+0x428> + DB 196,98,125,24,5,174,23,0,0 ; vbroadcastss 0x17ae(%rip),%ymm8 # 4d4c <_sk_callback_hsw+0x430> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10 @@ -3281,7 +3230,7 @@ _sk_store_8888_hsw LABEL PROC DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8 DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8 DB 77,133,192 ; test %r8,%r8 - DB 117,12 ; jne 3648 <_sk_store_8888_hsw+0x73> + DB 117,12 ; jne 35f8 <_sk_store_8888_hsw+0x73> DB 196,65,124,17,2 ; vmovups %ymm8,(%r10) DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -3294,14 +3243,14 @@ _sk_store_8888_hsw LABEL PROC DB 196,97,249,110,200 ; vmovq %rax,%xmm9 DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9 DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10) - DB 235,211 ; jmp 3641 <_sk_store_8888_hsw+0x6c> + DB 235,211 ; jmp 35f1 <_sk_store_8888_hsw+0x6c> PUBLIC _sk_load_f16_hsw _sk_load_f16_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 117,97 ; jne 36d9 <_sk_load_f16_hsw+0x6b> + DB 117,97 ; jne 3689 <_sk_load_f16_hsw+0x6b> DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8 DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2 DB 197,249,16,92,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm3 @@ -3327,29 +3276,29 @@ _sk_load_f16_hsw LABEL PROC DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,79 ; je 3738 <_sk_load_f16_hsw+0xca> + DB 116,79 ; je 36e8 <_sk_load_f16_hsw+0xca> DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,67 ; jb 3738 <_sk_load_f16_hsw+0xca> + DB 114,67 ; jb 36e8 <_sk_load_f16_hsw+0xca> DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,68 ; je 3745 <_sk_load_f16_hsw+0xd7> + DB 116,68 ; je 36f5 <_sk_load_f16_hsw+0xd7> DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,56 ; jb 3745 <_sk_load_f16_hsw+0xd7> + DB 114,56 ; jb 36f5 <_sk_load_f16_hsw+0xd7> DB 197,251,16,92,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm3 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,114,255,255,255 ; je 368f <_sk_load_f16_hsw+0x21> + DB 15,132,114,255,255,255 ; je 363f <_sk_load_f16_hsw+0x21> DB 197,225,22,92,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,98,255,255,255 ; jb 368f <_sk_load_f16_hsw+0x21> + DB 15,130,98,255,255,255 ; jb 363f <_sk_load_f16_hsw+0x21> DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9 - DB 233,87,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21> + DB 233,87,255,255,255 ; jmpq 363f <_sk_load_f16_hsw+0x21> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,74,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21> + DB 233,74,255,255,255 ; jmpq 363f <_sk_load_f16_hsw+0x21> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 - DB 233,65,255,255,255 ; jmpq 368f <_sk_load_f16_hsw+0x21> + DB 233,65,255,255,255 ; jmpq 363f <_sk_load_f16_hsw+0x21> PUBLIC _sk_gather_f16_hsw _sk_gather_f16_hsw LABEL PROC @@ -3403,7 +3352,7 @@ _sk_store_f16_hsw LABEL PROC DB 196,65,57,98,205 ; vpunpckldq %xmm13,%xmm8,%xmm9 DB 196,65,57,106,197 ; vpunpckhdq %xmm13,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,27 ; jne 383d <_sk_store_f16_hsw+0x65> + DB 117,27 ; jne 37ed <_sk_store_f16_hsw+0x65> DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8) DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8) DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8) @@ -3412,22 +3361,22 @@ _sk_store_f16_hsw LABEL PROC DB 255,224 ; jmpq *%rax DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,241 ; je 3839 <_sk_store_f16_hsw+0x61> + DB 116,241 ; je 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,229 ; jb 3839 <_sk_store_f16_hsw+0x61> + DB 114,229 ; jb 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8) - DB 116,221 ; je 3839 <_sk_store_f16_hsw+0x61> + DB 116,221 ; je 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,209 ; jb 3839 <_sk_store_f16_hsw+0x61> + DB 114,209 ; jb 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8) - DB 116,201 ; je 3839 <_sk_store_f16_hsw+0x61> + DB 116,201 ; je 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,189 ; jb 3839 <_sk_store_f16_hsw+0x61> + DB 114,189 ; jb 37e9 <_sk_store_f16_hsw+0x61> DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8) - DB 235,181 ; jmp 3839 <_sk_store_f16_hsw+0x61> + DB 235,181 ; jmp 37e9 <_sk_store_f16_hsw+0x61> PUBLIC _sk_load_u16_be_hsw _sk_load_u16_be_hsw LABEL PROC @@ -3435,7 +3384,7 @@ _sk_load_u16_be_hsw LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,204,0,0,0 ; jne 3966 <_sk_load_u16_be_hsw+0xe2> + DB 15,133,204,0,0,0 ; jne 3916 <_sk_load_u16_be_hsw+0xe2> DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8 DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2 DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3 @@ -3454,7 +3403,7 @@ _sk_load_u16_be_hsw LABEL PROC DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0 DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,21,157,20,0,0 ; vbroadcastss 0x149d(%rip),%ymm10 # 4d98 <_sk_callback_hsw+0x42c> + DB 196,98,125,24,21,165,20,0,0 ; vbroadcastss 0x14a5(%rip),%ymm10 # 4d50 <_sk_callback_hsw+0x434> DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0 DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1 DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2 @@ -3482,29 +3431,29 @@ _sk_load_u16_be_hsw LABEL PROC DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,85 ; je 39cc <_sk_load_u16_be_hsw+0x148> + DB 116,85 ; je 397c <_sk_load_u16_be_hsw+0x148> DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,72 ; jb 39cc <_sk_load_u16_be_hsw+0x148> + DB 114,72 ; jb 397c <_sk_load_u16_be_hsw+0x148> DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,72 ; je 39d9 <_sk_load_u16_be_hsw+0x155> + DB 116,72 ; je 3989 <_sk_load_u16_be_hsw+0x155> DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,59 ; jb 39d9 <_sk_load_u16_be_hsw+0x155> + DB 114,59 ; jb 3989 <_sk_load_u16_be_hsw+0x155> DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,6,255,255,255 ; je 38b5 <_sk_load_u16_be_hsw+0x31> + DB 15,132,6,255,255,255 ; je 3865 <_sk_load_u16_be_hsw+0x31> DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,245,254,255,255 ; jb 38b5 <_sk_load_u16_be_hsw+0x31> + DB 15,130,245,254,255,255 ; jb 3865 <_sk_load_u16_be_hsw+0x31> DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9 - DB 233,233,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31> + DB 233,233,254,255,255 ; jmpq 3865 <_sk_load_u16_be_hsw+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,220,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31> + DB 233,220,254,255,255 ; jmpq 3865 <_sk_load_u16_be_hsw+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 - DB 233,211,254,255,255 ; jmpq 38b5 <_sk_load_u16_be_hsw+0x31> + DB 233,211,254,255,255 ; jmpq 3865 <_sk_load_u16_be_hsw+0x31> PUBLIC _sk_load_rgb_u16_be_hsw _sk_load_rgb_u16_be_hsw LABEL PROC @@ -3512,7 +3461,7 @@ _sk_load_rgb_u16_be_hsw LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,204,0,0,0 ; jne 3ac0 <_sk_load_rgb_u16_be_hsw+0xde> + DB 15,133,204,0,0,0 ; jne 3a70 <_sk_load_rgb_u16_be_hsw+0xde> DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0 DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2 DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1 @@ -3536,7 +3485,7 @@ _sk_load_rgb_u16_be_hsw LABEL PROC DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0 DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,21,46,19,0,0 ; vbroadcastss 0x132e(%rip),%ymm10 # 4d9c <_sk_callback_hsw+0x430> + DB 196,98,125,24,21,54,19,0,0 ; vbroadcastss 0x1336(%rip),%ymm10 # 4d54 <_sk_callback_hsw+0x438> DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0 DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1 DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2 @@ -3553,48 +3502,48 @@ _sk_load_rgb_u16_be_hsw LABEL PROC DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,226,18,0,0 ; vbroadcastss 0x12e2(%rip),%ymm3 # 4da0 <_sk_callback_hsw+0x434> + DB 196,226,125,24,29,234,18,0,0 ; vbroadcastss 0x12ea(%rip),%ymm3 # 4d58 <_sk_callback_hsw+0x43c> DB 255,224 ; jmpq *%rax DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0 DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,5 ; jne 3ad9 <_sk_load_rgb_u16_be_hsw+0xf7> - DB 233,79,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> + DB 117,5 ; jne 3a89 <_sk_load_rgb_u16_be_hsw+0xf7> + DB 233,79,255,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1 DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,26 ; jb 3b08 <_sk_load_rgb_u16_be_hsw+0x126> + DB 114,26 ; jb 3ab8 <_sk_load_rgb_u16_be_hsw+0x126> DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1 DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 117,10 ; jne 3b0d <_sk_load_rgb_u16_be_hsw+0x12b> - DB 233,32,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> - DB 233,27,255,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> + DB 117,10 ; jne 3abd <_sk_load_rgb_u16_be_hsw+0x12b> + DB 233,32,255,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> + DB 233,27,255,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1 DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,26 ; jb 3b3c <_sk_load_rgb_u16_be_hsw+0x15a> + DB 114,26 ; jb 3aec <_sk_load_rgb_u16_be_hsw+0x15a> DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1 DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 117,10 ; jne 3b41 <_sk_load_rgb_u16_be_hsw+0x15f> - DB 233,236,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> - DB 233,231,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> + DB 117,10 ; jne 3af1 <_sk_load_rgb_u16_be_hsw+0x15f> + DB 233,236,254,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> + DB 233,231,254,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3 DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,20 ; jb 3b6a <_sk_load_rgb_u16_be_hsw+0x188> + DB 114,20 ; jb 3b1a <_sk_load_rgb_u16_be_hsw+0x188> DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3 DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3 - DB 233,190,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> - DB 233,185,254,255,255 ; jmpq 3a28 <_sk_load_rgb_u16_be_hsw+0x46> + DB 233,190,254,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> + DB 233,185,254,255,255 ; jmpq 39d8 <_sk_load_rgb_u16_be_hsw+0x46> PUBLIC _sk_store_u16_be_hsw _sk_store_u16_be_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax - DB 196,98,125,24,5,31,18,0,0 ; vbroadcastss 0x121f(%rip),%ymm8 # 4da4 <_sk_callback_hsw+0x438> + DB 196,98,125,24,5,39,18,0,0 ; vbroadcastss 0x1227(%rip),%ymm8 # 4d5c <_sk_callback_hsw+0x440> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10 @@ -3632,7 +3581,7 @@ _sk_store_u16_be_hsw LABEL PROC DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9 DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,31 ; jne 3c69 <_sk_store_u16_be_hsw+0xfa> + DB 117,31 ; jne 3c19 <_sk_store_u16_be_hsw+0xfa> DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2) DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2) DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2) @@ -3641,31 +3590,31 @@ _sk_store_u16_be_hsw LABEL PROC DB 255,224 ; jmpq *%rax DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 116,240 ; je 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 114,227 ; jb 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2) - DB 116,218 ; je 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 116,218 ; je 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,205 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 114,205 ; jb 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2) - DB 116,196 ; je 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 116,196 ; je 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,183 ; jb 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 114,183 ; jb 3c15 <_sk_store_u16_be_hsw+0xf6> DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2) - DB 235,174 ; jmp 3c65 <_sk_store_u16_be_hsw+0xf6> + DB 235,174 ; jmp 3c15 <_sk_store_u16_be_hsw+0xf6> PUBLIC _sk_load_f32_hsw _sk_load_f32_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,131,248,7 ; cmp $0x7,%r8 - DB 119,110 ; ja 3d2d <_sk_load_f32_hsw+0x76> + DB 119,110 ; ja 3cdd <_sk_load_f32_hsw+0x76> DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 - DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 3d58 <_sk_load_f32_hsw+0xa1> + DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 3d08 <_sk_load_f32_hsw+0xa1> DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax DB 76,1,216 ; add %r11,%rax DB 255,224 ; jmpq *%rax @@ -3724,7 +3673,7 @@ _sk_store_f32_hsw LABEL PROC DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8 DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11 DB 77,133,192 ; test %r8,%r8 - DB 117,55 ; jne 3de5 <_sk_store_f32_hsw+0x6d> + DB 117,55 ; jne 3d95 <_sk_store_f32_hsw+0x6d> DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12 DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13 DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9 @@ -3737,22 +3686,22 @@ _sk_store_f32_hsw LABEL PROC DB 255,224 ; jmpq *%rax DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 3de1 <_sk_store_f32_hsw+0x69> + DB 116,240 ; je 3d91 <_sk_store_f32_hsw+0x69> DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 3de1 <_sk_store_f32_hsw+0x69> + DB 114,227 ; jb 3d91 <_sk_store_f32_hsw+0x69> DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4) - DB 116,218 ; je 3de1 <_sk_store_f32_hsw+0x69> + DB 116,218 ; je 3d91 <_sk_store_f32_hsw+0x69> DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,205 ; jb 3de1 <_sk_store_f32_hsw+0x69> + DB 114,205 ; jb 3d91 <_sk_store_f32_hsw+0x69> DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4) - DB 116,195 ; je 3de1 <_sk_store_f32_hsw+0x69> + DB 116,195 ; je 3d91 <_sk_store_f32_hsw+0x69> DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,181 ; jb 3de1 <_sk_store_f32_hsw+0x69> + DB 114,181 ; jb 3d91 <_sk_store_f32_hsw+0x69> DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4) - DB 235,171 ; jmp 3de1 <_sk_store_f32_hsw+0x69> + DB 235,171 ; jmp 3d91 <_sk_store_f32_hsw+0x69> PUBLIC _sk_clamp_x_hsw _sk_clamp_x_hsw LABEL PROC @@ -3836,7 +3785,7 @@ PUBLIC _sk_clamp_x_1_hsw _sk_clamp_x_1_hsw LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0 - DB 196,98,125,24,5,114,14,0,0 ; vbroadcastss 0xe72(%rip),%ymm8 # 4da8 <_sk_callback_hsw+0x43c> + DB 196,98,125,24,5,122,14,0,0 ; vbroadcastss 0xe7a(%rip),%ymm8 # 4d60 <_sk_callback_hsw+0x444> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -3850,9 +3799,9 @@ _sk_repeat_x_1_hsw LABEL PROC PUBLIC _sk_mirror_x_1_hsw _sk_mirror_x_1_hsw LABEL PROC - DB 196,98,125,24,5,85,14,0,0 ; vbroadcastss 0xe55(%rip),%ymm8 # 4dac <_sk_callback_hsw+0x440> + DB 196,98,125,24,5,93,14,0,0 ; vbroadcastss 0xe5d(%rip),%ymm8 # 4d64 <_sk_callback_hsw+0x448> DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,13,75,14,0,0 ; vbroadcastss 0xe4b(%rip),%ymm9 # 4db0 <_sk_callback_hsw+0x444> + DB 196,98,125,24,13,83,14,0,0 ; vbroadcastss 0xe53(%rip),%ymm9 # 4d68 <_sk_callback_hsw+0x44c> DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9 DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9 DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9 @@ -3866,11 +3815,11 @@ _sk_mirror_x_1_hsw LABEL PROC PUBLIC _sk_luminance_to_alpha_hsw _sk_luminance_to_alpha_hsw LABEL PROC - DB 196,226,125,24,29,27,14,0,0 ; vbroadcastss 0xe1b(%rip),%ymm3 # 4db4 <_sk_callback_hsw+0x448> - DB 196,98,125,24,5,22,14,0,0 ; vbroadcastss 0xe16(%rip),%ymm8 # 4db8 <_sk_callback_hsw+0x44c> + DB 196,226,125,24,29,35,14,0,0 ; vbroadcastss 0xe23(%rip),%ymm3 # 4d6c <_sk_callback_hsw+0x450> + DB 196,98,125,24,5,30,14,0,0 ; vbroadcastss 0xe1e(%rip),%ymm8 # 4d70 <_sk_callback_hsw+0x454> DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 DB 196,226,125,184,203 ; vfmadd231ps %ymm3,%ymm0,%ymm1 - DB 196,226,125,24,29,7,14,0,0 ; vbroadcastss 0xe07(%rip),%ymm3 # 4dbc <_sk_callback_hsw+0x450> + DB 196,226,125,24,29,15,14,0,0 ; vbroadcastss 0xe0f(%rip),%ymm3 # 4d74 <_sk_callback_hsw+0x458> DB 196,226,109,168,217 ; vfmadd213ps %ymm1,%ymm2,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 @@ -4032,9 +3981,9 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC DB 76,139,72,8 ; mov 0x8(%rax),%r9 DB 77,137,211 ; mov %r10,%r11 DB 73,255,203 ; dec %r11 - DB 120,7 ; js 426e <_sk_evenly_spaced_gradient_hsw+0x19> + DB 120,7 ; js 421e <_sk_evenly_spaced_gradient_hsw+0x19> DB 196,193,242,42,203 ; vcvtsi2ss %r11,%xmm1,%xmm1 - DB 235,22 ; jmp 4284 <_sk_evenly_spaced_gradient_hsw+0x2f> + DB 235,22 ; jmp 4234 <_sk_evenly_spaced_gradient_hsw+0x2f> DB 76,137,219 ; mov %r11,%rbx DB 72,209,235 ; shr %rbx DB 65,131,227,1 ; and $0x1,%r11d @@ -4045,7 +3994,7 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC DB 197,244,89,200 ; vmulps %ymm0,%ymm1,%ymm1 DB 197,126,91,217 ; vcvttps2dq %ymm1,%ymm11 DB 73,131,250,8 ; cmp $0x8,%r10 - DB 119,70 ; ja 42dd <_sk_evenly_spaced_gradient_hsw+0x88> + DB 119,70 ; ja 428d <_sk_evenly_spaced_gradient_hsw+0x88> DB 196,66,37,22,1 ; vpermps (%r9),%ymm11,%ymm8 DB 72,139,88,40 ; mov 0x28(%rax),%rbx DB 196,98,37,22,11 ; vpermps (%rbx),%ymm11,%ymm9 @@ -4061,7 +4010,7 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC DB 196,226,37,22,27 ; vpermps (%rbx),%ymm11,%ymm3 DB 72,139,64,64 ; mov 0x40(%rax),%rax DB 196,98,37,22,40 ; vpermps (%rax),%ymm11,%ymm13 - DB 235,110 ; jmp 434b <_sk_evenly_spaced_gradient_hsw+0xf6> + DB 235,110 ; jmp 42fb <_sk_evenly_spaced_gradient_hsw+0xf6> DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14 DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1 DB 196,2,117,146,4,153 ; vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8 @@ -4096,14 +4045,14 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC PUBLIC _sk_gauss_a_to_rgba_hsw _sk_gauss_a_to_rgba_hsw LABEL PROC - DB 196,226,125,24,5,79,10,0,0 ; vbroadcastss 0xa4f(%rip),%ymm0 # 4dc0 <_sk_callback_hsw+0x454> - DB 196,226,125,24,13,74,10,0,0 ; vbroadcastss 0xa4a(%rip),%ymm1 # 4dc4 <_sk_callback_hsw+0x458> + DB 196,226,125,24,5,87,10,0,0 ; vbroadcastss 0xa57(%rip),%ymm0 # 4d78 <_sk_callback_hsw+0x45c> + DB 196,226,125,24,13,82,10,0,0 ; vbroadcastss 0xa52(%rip),%ymm1 # 4d7c <_sk_callback_hsw+0x460> DB 196,226,101,168,200 ; vfmadd213ps %ymm0,%ymm3,%ymm1 - DB 196,226,125,24,5,64,10,0,0 ; vbroadcastss 0xa40(%rip),%ymm0 # 4dc8 <_sk_callback_hsw+0x45c> + DB 196,226,125,24,5,72,10,0,0 ; vbroadcastss 0xa48(%rip),%ymm0 # 4d80 <_sk_callback_hsw+0x464> DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0 - DB 196,226,125,24,13,54,10,0,0 ; vbroadcastss 0xa36(%rip),%ymm1 # 4dcc <_sk_callback_hsw+0x460> + DB 196,226,125,24,13,62,10,0,0 ; vbroadcastss 0xa3e(%rip),%ymm1 # 4d84 <_sk_callback_hsw+0x468> DB 196,226,101,184,200 ; vfmadd231ps %ymm0,%ymm3,%ymm1 - DB 196,226,125,24,5,44,10,0,0 ; vbroadcastss 0xa2c(%rip),%ymm0 # 4dd0 <_sk_callback_hsw+0x464> + DB 196,226,125,24,5,52,10,0,0 ; vbroadcastss 0xa34(%rip),%ymm0 # 4d88 <_sk_callback_hsw+0x46c> DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 @@ -4116,11 +4065,11 @@ _sk_gradient_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 73,131,249,1 ; cmp $0x1,%r9 - DB 15,134,180,0,0,0 ; jbe 447c <_sk_gradient_hsw+0xc3> + DB 15,134,180,0,0,0 ; jbe 442c <_sk_gradient_hsw+0xc3> DB 76,139,80,72 ; mov 0x48(%rax),%r10 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 65,187,1,0,0,0 ; mov $0x1,%r11d - DB 196,226,125,24,21,245,9,0,0 ; vbroadcastss 0x9f5(%rip),%ymm2 # 4dd4 <_sk_callback_hsw+0x468> + DB 196,226,125,24,21,253,9,0,0 ; vbroadcastss 0x9fd(%rip),%ymm2 # 4d8c <_sk_callback_hsw+0x470> DB 196,65,53,239,201 ; vpxor %ymm9,%ymm9,%ymm9 DB 196,130,125,24,28,154 ; vbroadcastss (%r10,%r11,4),%ymm3 DB 197,228,194,216,2 ; vcmpleps %ymm0,%ymm3,%ymm3 @@ -4128,10 +4077,10 @@ _sk_gradient_hsw LABEL PROC DB 196,65,101,254,201 ; vpaddd %ymm9,%ymm3,%ymm9 DB 73,255,195 ; inc %r11 DB 77,57,217 ; cmp %r11,%r9 - DB 117,226 ; jne 43e4 <_sk_gradient_hsw+0x2b> + DB 117,226 ; jne 4394 <_sk_gradient_hsw+0x2b> DB 76,139,80,8 ; mov 0x8(%rax),%r10 DB 73,131,249,8 ; cmp $0x8,%r9 - DB 118,121 ; jbe 4485 <_sk_gradient_hsw+0xcc> + DB 118,121 ; jbe 4435 <_sk_gradient_hsw+0xcc> DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14 DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1 DB 196,2,117,146,4,138 ; vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8 @@ -4155,7 +4104,7 @@ _sk_gradient_hsw LABEL PROC DB 196,130,21,146,28,137 ; vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3 DB 72,139,64,64 ; mov 0x40(%rax),%rax DB 196,34,13,146,44,136 ; vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13 - DB 235,77 ; jmp 44c9 <_sk_gradient_hsw+0x110> + DB 235,77 ; jmp 4479 <_sk_gradient_hsw+0x110> DB 76,139,80,8 ; mov 0x8(%rax),%r10 DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9 DB 196,66,53,22,2 ; vpermps (%r10),%ymm9,%ymm8 @@ -4211,24 +4160,24 @@ _sk_xy_to_unit_angle_hsw LABEL PROC DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12 DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11 DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12 - DB 196,98,125,24,45,116,8,0,0 ; vbroadcastss 0x874(%rip),%ymm13 # 4dd8 <_sk_callback_hsw+0x46c> - DB 196,98,125,24,53,111,8,0,0 ; vbroadcastss 0x86f(%rip),%ymm14 # 4ddc <_sk_callback_hsw+0x470> + DB 196,98,125,24,45,124,8,0,0 ; vbroadcastss 0x87c(%rip),%ymm13 # 4d90 <_sk_callback_hsw+0x474> + DB 196,98,125,24,53,119,8,0,0 ; vbroadcastss 0x877(%rip),%ymm14 # 4d94 <_sk_callback_hsw+0x478> DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14 - DB 196,98,125,24,45,101,8,0,0 ; vbroadcastss 0x865(%rip),%ymm13 # 4de0 <_sk_callback_hsw+0x474> + DB 196,98,125,24,45,109,8,0,0 ; vbroadcastss 0x86d(%rip),%ymm13 # 4d98 <_sk_callback_hsw+0x47c> DB 196,66,29,184,238 ; vfmadd231ps %ymm14,%ymm12,%ymm13 - DB 196,98,125,24,53,91,8,0,0 ; vbroadcastss 0x85b(%rip),%ymm14 # 4de4 <_sk_callback_hsw+0x478> + DB 196,98,125,24,53,99,8,0,0 ; vbroadcastss 0x863(%rip),%ymm14 # 4d9c <_sk_callback_hsw+0x480> DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14 DB 196,65,36,89,222 ; vmulps %ymm14,%ymm11,%ymm11 DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9 - DB 196,98,125,24,21,70,8,0,0 ; vbroadcastss 0x846(%rip),%ymm10 # 4de8 <_sk_callback_hsw+0x47c> + DB 196,98,125,24,21,78,8,0,0 ; vbroadcastss 0x84e(%rip),%ymm10 # 4da0 <_sk_callback_hsw+0x484> DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10 DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9 DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,21,48,8,0,0 ; vbroadcastss 0x830(%rip),%ymm10 # 4dec <_sk_callback_hsw+0x480> + DB 196,98,125,24,21,56,8,0,0 ; vbroadcastss 0x838(%rip),%ymm10 # 4da4 <_sk_callback_hsw+0x488> DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10 DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0 DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9 - DB 196,98,125,24,21,26,8,0,0 ; vbroadcastss 0x81a(%rip),%ymm10 # 4df0 <_sk_callback_hsw+0x484> + DB 196,98,125,24,21,34,8,0,0 ; vbroadcastss 0x822(%rip),%ymm10 # 4da8 <_sk_callback_hsw+0x48c> DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10 DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0 DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9 @@ -4247,7 +4196,7 @@ _sk_xy_to_radius_hsw LABEL PROC PUBLIC _sk_save_xy_hsw _sk_save_xy_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,231,7,0,0 ; vbroadcastss 0x7e7(%rip),%ymm8 # 4df4 <_sk_callback_hsw+0x488> + DB 196,98,125,24,5,239,7,0,0 ; vbroadcastss 0x7ef(%rip),%ymm8 # 4dac <_sk_callback_hsw+0x490> DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9 DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10 DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9 @@ -4277,9 +4226,9 @@ _sk_accumulate_hsw LABEL PROC PUBLIC _sk_bilinear_nx_hsw _sk_bilinear_nx_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,123,7,0,0 ; vbroadcastss 0x77b(%rip),%ymm0 # 4df8 <_sk_callback_hsw+0x48c> + DB 196,226,125,24,5,131,7,0,0 ; vbroadcastss 0x783(%rip),%ymm0 # 4db0 <_sk_callback_hsw+0x494> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,114,7,0,0 ; vbroadcastss 0x772(%rip),%ymm8 # 4dfc <_sk_callback_hsw+0x490> + DB 196,98,125,24,5,122,7,0,0 ; vbroadcastss 0x77a(%rip),%ymm8 # 4db4 <_sk_callback_hsw+0x498> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4288,7 +4237,7 @@ _sk_bilinear_nx_hsw LABEL PROC PUBLIC _sk_bilinear_px_hsw _sk_bilinear_px_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,90,7,0,0 ; vbroadcastss 0x75a(%rip),%ymm0 # 4e00 <_sk_callback_hsw+0x494> + DB 196,226,125,24,5,98,7,0,0 ; vbroadcastss 0x762(%rip),%ymm0 # 4db8 <_sk_callback_hsw+0x49c> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -4298,9 +4247,9 @@ _sk_bilinear_px_hsw LABEL PROC PUBLIC _sk_bilinear_ny_hsw _sk_bilinear_ny_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,62,7,0,0 ; vbroadcastss 0x73e(%rip),%ymm1 # 4e04 <_sk_callback_hsw+0x498> + DB 196,226,125,24,13,70,7,0,0 ; vbroadcastss 0x746(%rip),%ymm1 # 4dbc <_sk_callback_hsw+0x4a0> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,52,7,0,0 ; vbroadcastss 0x734(%rip),%ymm8 # 4e08 <_sk_callback_hsw+0x49c> + DB 196,98,125,24,5,60,7,0,0 ; vbroadcastss 0x73c(%rip),%ymm8 # 4dc0 <_sk_callback_hsw+0x4a4> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4309,7 +4258,7 @@ _sk_bilinear_ny_hsw LABEL PROC PUBLIC _sk_bilinear_py_hsw _sk_bilinear_py_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,28,7,0,0 ; vbroadcastss 0x71c(%rip),%ymm1 # 4e0c <_sk_callback_hsw+0x4a0> + DB 196,226,125,24,13,36,7,0,0 ; vbroadcastss 0x724(%rip),%ymm1 # 4dc4 <_sk_callback_hsw+0x4a8> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -4319,13 +4268,13 @@ _sk_bilinear_py_hsw LABEL PROC PUBLIC _sk_bicubic_n3x_hsw _sk_bicubic_n3x_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,255,6,0,0 ; vbroadcastss 0x6ff(%rip),%ymm0 # 4e10 <_sk_callback_hsw+0x4a4> + DB 196,226,125,24,5,7,7,0,0 ; vbroadcastss 0x707(%rip),%ymm0 # 4dc8 <_sk_callback_hsw+0x4ac> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,246,6,0,0 ; vbroadcastss 0x6f6(%rip),%ymm8 # 4e14 <_sk_callback_hsw+0x4a8> + DB 196,98,125,24,5,254,6,0,0 ; vbroadcastss 0x6fe(%rip),%ymm8 # 4dcc <_sk_callback_hsw+0x4b0> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,231,6,0,0 ; vbroadcastss 0x6e7(%rip),%ymm10 # 4e18 <_sk_callback_hsw+0x4ac> - DB 196,98,125,24,29,226,6,0,0 ; vbroadcastss 0x6e2(%rip),%ymm11 # 4e1c <_sk_callback_hsw+0x4b0> + DB 196,98,125,24,21,239,6,0,0 ; vbroadcastss 0x6ef(%rip),%ymm10 # 4dd0 <_sk_callback_hsw+0x4b4> + DB 196,98,125,24,29,234,6,0,0 ; vbroadcastss 0x6ea(%rip),%ymm11 # 4dd4 <_sk_callback_hsw+0x4b8> DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11 DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -4335,16 +4284,16 @@ _sk_bicubic_n3x_hsw LABEL PROC PUBLIC _sk_bicubic_n1x_hsw _sk_bicubic_n1x_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,197,6,0,0 ; vbroadcastss 0x6c5(%rip),%ymm0 # 4e20 <_sk_callback_hsw+0x4b4> + DB 196,226,125,24,5,205,6,0,0 ; vbroadcastss 0x6cd(%rip),%ymm0 # 4dd8 <_sk_callback_hsw+0x4bc> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,188,6,0,0 ; vbroadcastss 0x6bc(%rip),%ymm8 # 4e24 <_sk_callback_hsw+0x4b8> + DB 196,98,125,24,5,196,6,0,0 ; vbroadcastss 0x6c4(%rip),%ymm8 # 4ddc <_sk_callback_hsw+0x4c0> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 - DB 196,98,125,24,13,178,6,0,0 ; vbroadcastss 0x6b2(%rip),%ymm9 # 4e28 <_sk_callback_hsw+0x4bc> - DB 196,98,125,24,21,173,6,0,0 ; vbroadcastss 0x6ad(%rip),%ymm10 # 4e2c <_sk_callback_hsw+0x4c0> + DB 196,98,125,24,13,186,6,0,0 ; vbroadcastss 0x6ba(%rip),%ymm9 # 4de0 <_sk_callback_hsw+0x4c4> + DB 196,98,125,24,21,181,6,0,0 ; vbroadcastss 0x6b5(%rip),%ymm10 # 4de4 <_sk_callback_hsw+0x4c8> DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10 - DB 196,98,125,24,13,163,6,0,0 ; vbroadcastss 0x6a3(%rip),%ymm9 # 4e30 <_sk_callback_hsw+0x4c4> + DB 196,98,125,24,13,171,6,0,0 ; vbroadcastss 0x6ab(%rip),%ymm9 # 4de8 <_sk_callback_hsw+0x4cc> DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9 - DB 196,98,125,24,21,153,6,0,0 ; vbroadcastss 0x699(%rip),%ymm10 # 4e34 <_sk_callback_hsw+0x4c8> + DB 196,98,125,24,21,161,6,0,0 ; vbroadcastss 0x6a1(%rip),%ymm10 # 4dec <_sk_callback_hsw+0x4d0> DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10 DB 197,124,17,144,128,0,0,0 ; vmovups %ymm10,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4353,14 +4302,14 @@ _sk_bicubic_n1x_hsw LABEL PROC PUBLIC _sk_bicubic_p1x_hsw _sk_bicubic_p1x_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm8 # 4e38 <_sk_callback_hsw+0x4cc> + DB 196,98,125,24,5,137,6,0,0 ; vbroadcastss 0x689(%rip),%ymm8 # 4df0 <_sk_callback_hsw+0x4d4> DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0 DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9 - DB 196,98,125,24,21,115,6,0,0 ; vbroadcastss 0x673(%rip),%ymm10 # 4e3c <_sk_callback_hsw+0x4d0> - DB 196,98,125,24,29,110,6,0,0 ; vbroadcastss 0x66e(%rip),%ymm11 # 4e40 <_sk_callback_hsw+0x4d4> + DB 196,98,125,24,21,123,6,0,0 ; vbroadcastss 0x67b(%rip),%ymm10 # 4df4 <_sk_callback_hsw+0x4d8> + DB 196,98,125,24,29,118,6,0,0 ; vbroadcastss 0x676(%rip),%ymm11 # 4df8 <_sk_callback_hsw+0x4dc> DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11 DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11 - DB 196,98,125,24,5,95,6,0,0 ; vbroadcastss 0x65f(%rip),%ymm8 # 4e44 <_sk_callback_hsw+0x4d8> + DB 196,98,125,24,5,103,6,0,0 ; vbroadcastss 0x667(%rip),%ymm8 # 4dfc <_sk_callback_hsw+0x4e0> DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4369,12 +4318,12 @@ _sk_bicubic_p1x_hsw LABEL PROC PUBLIC _sk_bicubic_p3x_hsw _sk_bicubic_p3x_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,71,6,0,0 ; vbroadcastss 0x647(%rip),%ymm0 # 4e48 <_sk_callback_hsw+0x4dc> + DB 196,226,125,24,5,79,6,0,0 ; vbroadcastss 0x64f(%rip),%ymm0 # 4e00 <_sk_callback_hsw+0x4e4> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,52,6,0,0 ; vbroadcastss 0x634(%rip),%ymm10 # 4e4c <_sk_callback_hsw+0x4e0> - DB 196,98,125,24,29,47,6,0,0 ; vbroadcastss 0x62f(%rip),%ymm11 # 4e50 <_sk_callback_hsw+0x4e4> + DB 196,98,125,24,21,60,6,0,0 ; vbroadcastss 0x63c(%rip),%ymm10 # 4e04 <_sk_callback_hsw+0x4e8> + DB 196,98,125,24,29,55,6,0,0 ; vbroadcastss 0x637(%rip),%ymm11 # 4e08 <_sk_callback_hsw+0x4ec> DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11 DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -4384,13 +4333,13 @@ _sk_bicubic_p3x_hsw LABEL PROC PUBLIC _sk_bicubic_n3y_hsw _sk_bicubic_n3y_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,18,6,0,0 ; vbroadcastss 0x612(%rip),%ymm1 # 4e54 <_sk_callback_hsw+0x4e8> + DB 196,226,125,24,13,26,6,0,0 ; vbroadcastss 0x61a(%rip),%ymm1 # 4e0c <_sk_callback_hsw+0x4f0> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,8,6,0,0 ; vbroadcastss 0x608(%rip),%ymm8 # 4e58 <_sk_callback_hsw+0x4ec> + DB 196,98,125,24,5,16,6,0,0 ; vbroadcastss 0x610(%rip),%ymm8 # 4e10 <_sk_callback_hsw+0x4f4> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,249,5,0,0 ; vbroadcastss 0x5f9(%rip),%ymm10 # 4e5c <_sk_callback_hsw+0x4f0> - DB 196,98,125,24,29,244,5,0,0 ; vbroadcastss 0x5f4(%rip),%ymm11 # 4e60 <_sk_callback_hsw+0x4f4> + DB 196,98,125,24,21,1,6,0,0 ; vbroadcastss 0x601(%rip),%ymm10 # 4e14 <_sk_callback_hsw+0x4f8> + DB 196,98,125,24,29,252,5,0,0 ; vbroadcastss 0x5fc(%rip),%ymm11 # 4e18 <_sk_callback_hsw+0x4fc> DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11 DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -4400,16 +4349,16 @@ _sk_bicubic_n3y_hsw LABEL PROC PUBLIC _sk_bicubic_n1y_hsw _sk_bicubic_n1y_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,215,5,0,0 ; vbroadcastss 0x5d7(%rip),%ymm1 # 4e64 <_sk_callback_hsw+0x4f8> + DB 196,226,125,24,13,223,5,0,0 ; vbroadcastss 0x5df(%rip),%ymm1 # 4e1c <_sk_callback_hsw+0x500> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,205,5,0,0 ; vbroadcastss 0x5cd(%rip),%ymm8 # 4e68 <_sk_callback_hsw+0x4fc> + DB 196,98,125,24,5,213,5,0,0 ; vbroadcastss 0x5d5(%rip),%ymm8 # 4e20 <_sk_callback_hsw+0x504> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 - DB 196,98,125,24,13,195,5,0,0 ; vbroadcastss 0x5c3(%rip),%ymm9 # 4e6c <_sk_callback_hsw+0x500> - DB 196,98,125,24,21,190,5,0,0 ; vbroadcastss 0x5be(%rip),%ymm10 # 4e70 <_sk_callback_hsw+0x504> + DB 196,98,125,24,13,203,5,0,0 ; vbroadcastss 0x5cb(%rip),%ymm9 # 4e24 <_sk_callback_hsw+0x508> + DB 196,98,125,24,21,198,5,0,0 ; vbroadcastss 0x5c6(%rip),%ymm10 # 4e28 <_sk_callback_hsw+0x50c> DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10 - DB 196,98,125,24,13,180,5,0,0 ; vbroadcastss 0x5b4(%rip),%ymm9 # 4e74 <_sk_callback_hsw+0x508> + DB 196,98,125,24,13,188,5,0,0 ; vbroadcastss 0x5bc(%rip),%ymm9 # 4e2c <_sk_callback_hsw+0x510> DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9 - DB 196,98,125,24,21,170,5,0,0 ; vbroadcastss 0x5aa(%rip),%ymm10 # 4e78 <_sk_callback_hsw+0x50c> + DB 196,98,125,24,21,178,5,0,0 ; vbroadcastss 0x5b2(%rip),%ymm10 # 4e30 <_sk_callback_hsw+0x514> DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10 DB 197,124,17,144,160,0,0,0 ; vmovups %ymm10,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4418,14 +4367,14 @@ _sk_bicubic_n1y_hsw LABEL PROC PUBLIC _sk_bicubic_p1y_hsw _sk_bicubic_p1y_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,146,5,0,0 ; vbroadcastss 0x592(%rip),%ymm8 # 4e7c <_sk_callback_hsw+0x510> + DB 196,98,125,24,5,154,5,0,0 ; vbroadcastss 0x59a(%rip),%ymm8 # 4e34 <_sk_callback_hsw+0x518> DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1 DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9 - DB 196,98,125,24,21,131,5,0,0 ; vbroadcastss 0x583(%rip),%ymm10 # 4e80 <_sk_callback_hsw+0x514> - DB 196,98,125,24,29,126,5,0,0 ; vbroadcastss 0x57e(%rip),%ymm11 # 4e84 <_sk_callback_hsw+0x518> + DB 196,98,125,24,21,139,5,0,0 ; vbroadcastss 0x58b(%rip),%ymm10 # 4e38 <_sk_callback_hsw+0x51c> + DB 196,98,125,24,29,134,5,0,0 ; vbroadcastss 0x586(%rip),%ymm11 # 4e3c <_sk_callback_hsw+0x520> DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11 DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11 - DB 196,98,125,24,5,111,5,0,0 ; vbroadcastss 0x56f(%rip),%ymm8 # 4e88 <_sk_callback_hsw+0x51c> + DB 196,98,125,24,5,119,5,0,0 ; vbroadcastss 0x577(%rip),%ymm8 # 4e40 <_sk_callback_hsw+0x524> DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -4434,12 +4383,12 @@ _sk_bicubic_p1y_hsw LABEL PROC PUBLIC _sk_bicubic_p3y_hsw _sk_bicubic_p3y_hsw LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,87,5,0,0 ; vbroadcastss 0x557(%rip),%ymm1 # 4e8c <_sk_callback_hsw+0x520> + DB 196,226,125,24,13,95,5,0,0 ; vbroadcastss 0x55f(%rip),%ymm1 # 4e44 <_sk_callback_hsw+0x528> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,67,5,0,0 ; vbroadcastss 0x543(%rip),%ymm10 # 4e90 <_sk_callback_hsw+0x524> - DB 196,98,125,24,29,62,5,0,0 ; vbroadcastss 0x53e(%rip),%ymm11 # 4e94 <_sk_callback_hsw+0x528> + DB 196,98,125,24,21,75,5,0,0 ; vbroadcastss 0x54b(%rip),%ymm10 # 4e48 <_sk_callback_hsw+0x52c> + DB 196,98,125,24,29,70,5,0,0 ; vbroadcastss 0x546(%rip),%ymm11 # 4e4c <_sk_callback_hsw+0x530> DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11 DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -4448,15 +4397,18 @@ _sk_bicubic_p3y_hsw LABEL PROC PUBLIC _sk_callback_hsw _sk_callback_hsw LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,84 ; push %r12 DB 83 ; push %rbx - DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp - DB 197,252,17,188,36,128,0,0,0 ; vmovups %ymm7,0x80(%rsp) - DB 197,252,17,116,36,96 ; vmovups %ymm6,0x60(%rsp) - DB 197,252,17,108,36,64 ; vmovups %ymm5,0x40(%rsp) - DB 197,252,17,100,36,32 ; vmovups %ymm4,0x20(%rsp) + DB 72,131,228,224 ; and $0xffffffffffffffe0,%rsp + DB 72,129,236,192,0,0,0 ; sub $0xc0,%rsp + DB 197,252,41,188,36,128,0,0,0 ; vmovaps %ymm7,0x80(%rsp) + DB 197,252,41,116,36,96 ; vmovaps %ymm6,0x60(%rsp) + DB 197,252,41,108,36,64 ; vmovaps %ymm5,0x40(%rsp) + DB 197,252,41,100,36,32 ; vmovaps %ymm4,0x20(%rsp) DB 77,137,196 ; mov %r8,%r12 DB 73,137,206 ; mov %rcx,%r14 DB 73,137,215 ; mov %rdx,%r15 @@ -4505,15 +4457,16 @@ _sk_callback_hsw LABEL PROC DB 76,137,250 ; mov %r15,%rdx DB 76,137,241 ; mov %r14,%rcx DB 77,137,224 ; mov %r12,%r8 - DB 197,252,16,100,36,32 ; vmovups 0x20(%rsp),%ymm4 - DB 197,252,16,108,36,64 ; vmovups 0x40(%rsp),%ymm5 - DB 197,252,16,116,36,96 ; vmovups 0x60(%rsp),%ymm6 - DB 197,252,16,188,36,128,0,0,0 ; vmovups 0x80(%rsp),%ymm7 - DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp + DB 197,252,40,100,36,32 ; vmovaps 0x20(%rsp),%ymm4 + DB 197,252,40,108,36,64 ; vmovaps 0x40(%rsp),%ymm5 + DB 197,252,40,116,36,96 ; vmovaps 0x60(%rsp),%ymm6 + DB 197,252,40,188,36,128,0,0,0 ; vmovaps 0x80(%rsp),%ymm7 + DB 72,141,101,224 ; lea -0x20(%rbp),%rsp DB 91 ; pop %rbx DB 65,92 ; pop %r12 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax ALIGN 4 @@ -4557,25 +4510,25 @@ ALIGN 4 DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 4b41 <.literal4+0xb1> + DB 71,225,61 ; rex.RXB loope 4af9 <.literal4+0xb1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 4b51 <.literal4+0xc1> + DB 71,225,61 ; rex.RXB loope 4b09 <.literal4+0xc1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 4b61 <.literal4+0xd1> + DB 71,225,61 ; rex.RXB loope 4b19 <.literal4+0xd1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 4b71 <.literal4+0xe1> + DB 71,225,61 ; rex.RXB loope 4b29 <.literal4+0xe1> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax) @@ -4625,7 +4578,7 @@ ALIGN 4 DB 190,129,128,128,59 ; mov $0x3b808081,%esi DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 4bc9 <.literal4+0x139> + DB 224,7 ; loopne 4b81 <.literal4+0x139> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -4641,10 +4594,10 @@ ALIGN 4 DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) DB 0,52,255 ; add %dh,(%rdi,%rdi,8) DB 255 ; (bad) - DB 127,0 ; jg 4bf0 <.literal4+0x160> + DB 127,0 ; jg 4ba8 <.literal4+0x160> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 4c69 <.literal4+0x1d9> + DB 119,115 ; ja 4c21 <.literal4+0x1d9> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -4658,10 +4611,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 4c24 <.literal4+0x194> + DB 127,0 ; jg 4bdc <.literal4+0x194> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 4c9d <.literal4+0x20d> + DB 119,115 ; ja 4c55 <.literal4+0x20d> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -4675,10 +4628,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 4c58 <.literal4+0x1c8> + DB 127,0 ; jg 4c10 <.literal4+0x1c8> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 4cd1 <.literal4+0x241> + DB 119,115 ; ja 4c89 <.literal4+0x241> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -4692,10 +4645,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 4c8c <.literal4+0x1fc> + DB 127,0 ; jg 4c44 <.literal4+0x1fc> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 4d05 <.literal4+0x275> + DB 119,115 ; ja 4cbd <.literal4+0x275> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -4708,7 +4661,7 @@ ALIGN 4 DB 0,75,0 ; add %cl,0x0(%rbx) DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax) DB 66,0,0 ; rex.X add %al,(%rax) - DB 127,67 ; jg 4d03 <.literal4+0x273> + DB 127,67 ; jg 4cbb <.literal4+0x273> DB 0,0 ; add %al,(%rax) DB 0,195 ; add %al,%bl DB 0,0 ; add %al,(%rax) @@ -4720,10 +4673,10 @@ ALIGN 4 DB 190,80,128,3,62 ; mov $0x3e038050,%esi DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 4d23 <.literal4+0x293> + DB 118,63 ; jbe 4cdb <.literal4+0x293> DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) - DB 127,67 ; jg 4d37 <.literal4+0x2a7> + DB 127,67 ; jg 4cef <.literal4+0x2a7> DB 129,128,128,59,0,0,128,63,129,128 ; addl $0x80813f80,0x3b80(%rax) DB 128,59,0 ; cmpb $0x0,(%rbx) DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax) @@ -4732,7 +4685,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 4d19 <.literal4+0x289> + DB 224,7 ; loopne 4cd1 <.literal4+0x289> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -4744,7 +4697,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 4d35 <.literal4+0x2a5> + DB 224,7 ; loopne 4ced <.literal4+0x2a5> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -4755,7 +4708,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 248 ; clc DB 65,0,0 ; add %al,(%r8) - DB 124,66 ; jl 4d8a <.literal4+0x2fa> + DB 124,66 ; jl 4d42 <.literal4+0x2fa> DB 0,240 ; add %dh,%al DB 0,0 ; add %al,(%rax) DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax) @@ -4773,9 +4726,9 @@ ALIGN 4 DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax) DB 0,0 ; add %al,(%rax) DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax) - DB 112,65 ; jo 4dcd <.literal4+0x33d> + DB 112,65 ; jo 4d85 <.literal4+0x33d> DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) - DB 127,67 ; jg 4ddb <.literal4+0x34b> + DB 127,67 ; jg 4d93 <.literal4+0x34b> DB 128,0,128 ; addb $0x80,(%rax) DB 55 ; (bad) DB 128,0,128 ; addb $0x80,(%rax) @@ -4783,7 +4736,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 255 ; (bad) - DB 127,71 ; jg 4def <.literal4+0x35f> + DB 127,71 ; jg 4da7 <.literal4+0x35f> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,191,0,0,0 ; add %al,0xbf(%rax) @@ -4891,16 +4844,16 @@ ALIGN 32 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004ec8 <_sk_callback_hsw+0xa00055c> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004e88 <_sk_callback_hsw+0xa00056c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ed0 <_sk_callback_hsw+0x12000564> + DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004e90 <_sk_callback_hsw+0x12000574> DB 255 ; (bad) DB 255 ; (bad) - DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ed8 <_sk_callback_hsw+0x1a00056c> + DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004e98 <_sk_callback_hsw+0x1a00057c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004ee0 <_sk_callback_hsw+0x3000574> + DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004ea0 <_sk_callback_hsw+0x3000584> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -4943,16 +4896,16 @@ ALIGN 32 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f28 <_sk_callback_hsw+0xa0005bc> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004ee8 <_sk_callback_hsw+0xa0005cc> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f30 <_sk_callback_hsw+0x120005c4> + DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ef0 <_sk_callback_hsw+0x120005d4> DB 255 ; (bad) DB 255 ; (bad) - DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f38 <_sk_callback_hsw+0x1a0005cc> + DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ef8 <_sk_callback_hsw+0x1a0005dc> DB 255 ; (bad) DB 255 ; (bad) - DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004f40 <_sk_callback_hsw+0x30005d4> + DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004f00 <_sk_callback_hsw+0x30005e4> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -4995,16 +4948,16 @@ ALIGN 32 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f88 <_sk_callback_hsw+0xa00061c> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004f48 <_sk_callback_hsw+0xa00062c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f90 <_sk_callback_hsw+0x12000624> + DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004f50 <_sk_callback_hsw+0x12000634> DB 255 ; (bad) DB 255 ; (bad) - DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f98 <_sk_callback_hsw+0x1a00062c> + DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004f58 <_sk_callback_hsw+0x1a00063c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004fa0 <_sk_callback_hsw+0x3000634> + DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004f60 <_sk_callback_hsw+0x3000644> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -5047,16 +5000,16 @@ ALIGN 32 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004fe8 <_sk_callback_hsw+0xa00067c> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a004fa8 <_sk_callback_hsw+0xa00068c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004ff0 <_sk_callback_hsw+0x12000684> + DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12004fb0 <_sk_callback_hsw+0x12000694> DB 255 ; (bad) DB 255 ; (bad) - DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004ff8 <_sk_callback_hsw+0x1a00068c> + DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a004fb8 <_sk_callback_hsw+0x1a00069c> DB 255 ; (bad) DB 255 ; (bad) - DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005000 <_sk_callback_hsw+0x3000694> + DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3004fc0 <_sk_callback_hsw+0x30006a4> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -5099,16 +5052,16 @@ ALIGN 32 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005048 <_sk_callback_hsw+0xa0006dc> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005008 <_sk_callback_hsw+0xa0006ec> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005050 <_sk_callback_hsw+0x120006e4> + DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005010 <_sk_callback_hsw+0x120006f4> DB 255 ; (bad) DB 255 ; (bad) - DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005058 <_sk_callback_hsw+0x1a0006ec> + DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005018 <_sk_callback_hsw+0x1a0006fc> DB 255 ; (bad) DB 255 ; (bad) - DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005060 <_sk_callback_hsw+0x30006f4> + DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005020 <_sk_callback_hsw+0x3000704> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -5155,38 +5108,39 @@ ALIGN 32 PUBLIC _sk_start_pipeline_avx _sk_start_pipeline_avx LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 86 ; push %rsi DB 87 ; push %rdi - DB 85 ; push %rbp DB 83 ; push %rbx - DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp - DB 197,120,41,188,36,144,0,0,0 ; vmovaps %xmm15,0x90(%rsp) - DB 197,120,41,180,36,128,0,0,0 ; vmovaps %xmm14,0x80(%rsp) - DB 197,120,41,108,36,112 ; vmovaps %xmm13,0x70(%rsp) - DB 197,120,41,100,36,96 ; vmovaps %xmm12,0x60(%rsp) - DB 197,120,41,92,36,80 ; vmovaps %xmm11,0x50(%rsp) - DB 197,120,41,84,36,64 ; vmovaps %xmm10,0x40(%rsp) - DB 197,120,41,76,36,48 ; vmovaps %xmm9,0x30(%rsp) - DB 197,120,41,68,36,32 ; vmovaps %xmm8,0x20(%rsp) - DB 197,248,41,124,36,16 ; vmovaps %xmm7,0x10(%rsp) - DB 197,248,41,52,36 ; vmovaps %xmm6,(%rsp) - DB 76,137,195 ; mov %r8,%rbx - DB 73,137,214 ; mov %rdx,%r14 - DB 72,137,205 ; mov %rcx,%rbp - DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15 + DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp + DB 197,120,41,125,176 ; vmovaps %xmm15,-0x50(%rbp) + DB 197,120,41,117,160 ; vmovaps %xmm14,-0x60(%rbp) + DB 197,120,41,109,144 ; vmovaps %xmm13,-0x70(%rbp) + DB 197,120,41,101,128 ; vmovaps %xmm12,-0x80(%rbp) + DB 197,120,41,157,112,255,255,255 ; vmovaps %xmm11,-0x90(%rbp) + DB 197,120,41,149,96,255,255,255 ; vmovaps %xmm10,-0xa0(%rbp) + DB 197,120,41,141,80,255,255,255 ; vmovaps %xmm9,-0xb0(%rbp) + DB 197,120,41,133,64,255,255,255 ; vmovaps %xmm8,-0xc0(%rbp) + DB 197,248,41,189,48,255,255,255 ; vmovaps %xmm7,-0xd0(%rbp) + DB 197,248,41,181,32,255,255,255 ; vmovaps %xmm6,-0xe0(%rbp) + DB 72,137,211 ; mov %rdx,%rbx + DB 73,137,207 ; mov %rcx,%r15 + DB 76,139,117,48 ; mov 0x30(%rbp),%r14 DB 76,137,206 ; mov %r9,%rsi DB 72,173 ; lods %ds:(%rsi),%rax - DB 73,137,196 ; mov %rax,%r12 - DB 73,137,245 ; mov %rsi,%r13 - DB 72,141,69,8 ; lea 0x8(%rbp),%rax - DB 72,57,216 ; cmp %rbx,%rax - DB 118,5 ; jbe 7e <_sk_start_pipeline_avx+0x7e> - DB 72,137,234 ; mov %rbp,%rdx - DB 235,69 ; jmp c3 <_sk_start_pipeline_avx+0xc3> + DB 73,137,197 ; mov %rax,%r13 + DB 73,137,244 ; mov %rsi,%r12 + DB 73,141,79,8 ; lea 0x8(%r15),%rcx + DB 76,57,193 ; cmp %r8,%rcx + DB 118,5 ; jbe 7d <_sk_start_pipeline_avx+0x7d> + DB 76,137,250 ; mov %r15,%rdx + DB 235,83 ; jmp d0 <_sk_start_pipeline_avx+0xd0> + DB 76,137,133,24,255,255,255 ; mov %r8,-0xe8(%rbp) DB 65,184,0,0,0,0 ; mov $0x0,%r8d DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 @@ -5196,18 +5150,19 @@ _sk_start_pipeline_avx LABEL PROC DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6 DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 72,137,234 ; mov %rbp,%rdx - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 - DB 72,141,85,8 ; lea 0x8(%rbp),%rdx - DB 72,131,197,16 ; add $0x10,%rbp - DB 72,57,221 ; cmp %rbx,%rbp - DB 72,137,213 ; mov %rdx,%rbp - DB 118,187 ; jbe 7e <_sk_start_pipeline_avx+0x7e> - DB 72,41,211 ; sub %rdx,%rbx - DB 116,47 ; je f7 <_sk_start_pipeline_avx+0xf7> + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,250 ; mov %r15,%rdx + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 76,139,133,24,255,255,255 ; mov -0xe8(%rbp),%r8 + DB 73,141,87,8 ; lea 0x8(%r15),%rdx + DB 73,131,199,16 ; add $0x10,%r15 + DB 77,57,199 ; cmp %r8,%r15 + DB 73,137,215 ; mov %rdx,%r15 + DB 118,180 ; jbe 84 <_sk_start_pipeline_avx+0x84> + DB 73,41,208 ; sub %rdx,%r8 + DB 116,44 ; je 101 <_sk_start_pipeline_avx+0x101> DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2 @@ -5216,30 +5171,29 @@ _sk_start_pipeline_avx LABEL PROC DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 DB 197,204,87,246 ; vxorps %ymm6,%ymm6,%ymm6 DB 197,196,87,255 ; vxorps %ymm7,%ymm7,%ymm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 76,137,241 ; mov %r14,%rcx - DB 73,137,216 ; mov %rbx,%r8 - DB 65,255,212 ; callq *%r12 - DB 197,248,40,52,36 ; vmovaps (%rsp),%xmm6 - DB 197,248,40,124,36,16 ; vmovaps 0x10(%rsp),%xmm7 - DB 197,120,40,68,36,32 ; vmovaps 0x20(%rsp),%xmm8 - DB 197,120,40,76,36,48 ; vmovaps 0x30(%rsp),%xmm9 - DB 197,120,40,84,36,64 ; vmovaps 0x40(%rsp),%xmm10 - DB 197,120,40,92,36,80 ; vmovaps 0x50(%rsp),%xmm11 - DB 197,120,40,100,36,96 ; vmovaps 0x60(%rsp),%xmm12 - DB 197,120,40,108,36,112 ; vmovaps 0x70(%rsp),%xmm13 - DB 197,120,40,180,36,128,0,0,0 ; vmovaps 0x80(%rsp),%xmm14 - DB 197,120,40,188,36,144,0,0,0 ; vmovaps 0x90(%rsp),%xmm15 - DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 197,248,40,181,32,255,255,255 ; vmovaps -0xe0(%rbp),%xmm6 + DB 197,248,40,189,48,255,255,255 ; vmovaps -0xd0(%rbp),%xmm7 + DB 197,120,40,133,64,255,255,255 ; vmovaps -0xc0(%rbp),%xmm8 + DB 197,120,40,141,80,255,255,255 ; vmovaps -0xb0(%rbp),%xmm9 + DB 197,120,40,149,96,255,255,255 ; vmovaps -0xa0(%rbp),%xmm10 + DB 197,120,40,157,112,255,255,255 ; vmovaps -0x90(%rbp),%xmm11 + DB 197,120,40,101,128 ; vmovaps -0x80(%rbp),%xmm12 + DB 197,120,40,109,144 ; vmovaps -0x70(%rbp),%xmm13 + DB 197,120,40,117,160 ; vmovaps -0x60(%rbp),%xmm14 + DB 197,120,40,125,176 ; vmovaps -0x50(%rbp),%xmm15 + DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp DB 91 ; pop %rbx - DB 93 ; pop %rbp DB 95 ; pop %rdi DB 94 ; pop %rsi DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 197,248,119 ; vzeroupper DB 195 ; retq @@ -5253,7 +5207,7 @@ _sk_seed_shader_avx LABEL PROC DB 197,249,112,192,0 ; vpshufd $0x0,%xmm0,%xmm0 DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,112,101,0,0 ; vbroadcastss 0x6570(%rip),%ymm1 # 66dc <_sk_callback_avx+0x126> + DB 196,226,125,24,13,183,100,0,0 ; vbroadcastss 0x64b7(%rip),%ymm1 # 6630 <_sk_callback_avx+0x12c> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0 DB 197,249,110,209 ; vmovd %ecx,%xmm2 @@ -5262,7 +5216,7 @@ _sk_seed_shader_avx LABEL PROC DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,21,74,101,0,0 ; vbroadcastss 0x654a(%rip),%ymm2 # 66e0 <_sk_callback_avx+0x12a> + DB 196,226,125,24,21,145,100,0,0 ; vbroadcastss 0x6491(%rip),%ymm2 # 6634 <_sk_callback_avx+0x130> DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3 DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4 DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5 @@ -5284,7 +5238,7 @@ _sk_dither_avx LABEL PROC DB 196,65,121,112,201,0 ; vpshufd $0x0,%xmm9,%xmm9 DB 196,67,53,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm9,%ymm9 DB 196,65,52,87,208 ; vxorps %ymm8,%ymm9,%ymm10 - DB 196,98,125,24,29,243,100,0,0 ; vbroadcastss 0x64f3(%rip),%ymm11 # 66e4 <_sk_callback_avx+0x12e> + DB 196,98,125,24,29,58,100,0,0 ; vbroadcastss 0x643a(%rip),%ymm11 # 6638 <_sk_callback_avx+0x134> DB 196,65,44,84,203 ; vandps %ymm11,%ymm10,%ymm9 DB 196,193,25,114,241,5 ; vpslld $0x5,%xmm9,%xmm12 DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9 @@ -5295,8 +5249,8 @@ _sk_dither_avx LABEL PROC DB 196,67,125,25,219,1 ; vextractf128 $0x1,%ymm11,%xmm11 DB 196,193,33,114,243,4 ; vpslld $0x4,%xmm11,%xmm11 DB 196,67,29,24,219,1 ; vinsertf128 $0x1,%xmm11,%ymm12,%ymm11 - DB 196,98,125,24,37,180,100,0,0 ; vbroadcastss 0x64b4(%rip),%ymm12 # 66e8 <_sk_callback_avx+0x132> - DB 196,98,125,24,45,175,100,0,0 ; vbroadcastss 0x64af(%rip),%ymm13 # 66ec <_sk_callback_avx+0x136> + DB 196,98,125,24,37,251,99,0,0 ; vbroadcastss 0x63fb(%rip),%ymm12 # 663c <_sk_callback_avx+0x138> + DB 196,98,125,24,45,246,99,0,0 ; vbroadcastss 0x63f6(%rip),%ymm13 # 6640 <_sk_callback_avx+0x13c> DB 196,65,44,84,245 ; vandps %ymm13,%ymm10,%ymm14 DB 196,193,1,114,246,2 ; vpslld $0x2,%xmm14,%xmm15 DB 196,67,125,25,246,1 ; vextractf128 $0x1,%ymm14,%xmm14 @@ -5323,9 +5277,9 @@ _sk_dither_avx LABEL PROC DB 196,65,60,86,193 ; vorps %ymm9,%ymm8,%ymm8 DB 196,65,60,86,194 ; vorps %ymm10,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,26,100,0,0 ; vbroadcastss 0x641a(%rip),%ymm9 # 66f0 <_sk_callback_avx+0x13a> + DB 196,98,125,24,13,97,99,0,0 ; vbroadcastss 0x6361(%rip),%ymm9 # 6644 <_sk_callback_avx+0x140> DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 - DB 196,98,125,24,13,16,100,0,0 ; vbroadcastss 0x6410(%rip),%ymm9 # 66f4 <_sk_callback_avx+0x13e> + DB 196,98,125,24,13,87,99,0,0 ; vbroadcastss 0x6357(%rip),%ymm9 # 6648 <_sk_callback_avx+0x144> DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8 DB 196,98,125,24,8 ; vbroadcastss (%rax),%ymm9 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 @@ -5384,7 +5338,7 @@ _sk_clear_avx LABEL PROC PUBLIC _sk_srcatop_avx _sk_srcatop_avx LABEL PROC DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0 - DB 196,98,125,24,5,104,99,0,0 ; vbroadcastss 0x6368(%rip),%ymm8 # 66f8 <_sk_callback_avx+0x142> + DB 196,98,125,24,5,175,98,0,0 ; vbroadcastss 0x62af(%rip),%ymm8 # 664c <_sk_callback_avx+0x148> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9 DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0 @@ -5403,7 +5357,7 @@ _sk_srcatop_avx LABEL PROC PUBLIC _sk_dstatop_avx _sk_dstatop_avx LABEL PROC DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8 - DB 196,98,125,24,13,42,99,0,0 ; vbroadcastss 0x632a(%rip),%ymm9 # 66fc <_sk_callback_avx+0x146> + DB 196,98,125,24,13,113,98,0,0 ; vbroadcastss 0x6271(%rip),%ymm9 # 6650 <_sk_callback_avx+0x14c> DB 197,52,92,207 ; vsubps %ymm7,%ymm9,%ymm9 DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0 DB 197,188,88,192 ; vaddps %ymm0,%ymm8,%ymm0 @@ -5439,7 +5393,7 @@ _sk_dstin_avx LABEL PROC PUBLIC _sk_srcout_avx _sk_srcout_avx LABEL PROC - DB 196,98,125,24,5,201,98,0,0 ; vbroadcastss 0x62c9(%rip),%ymm8 # 6700 <_sk_callback_avx+0x14a> + DB 196,98,125,24,5,16,98,0,0 ; vbroadcastss 0x6210(%rip),%ymm8 # 6654 <_sk_callback_avx+0x150> DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 @@ -5450,7 +5404,7 @@ _sk_srcout_avx LABEL PROC PUBLIC _sk_dstout_avx _sk_dstout_avx LABEL PROC - DB 196,226,125,24,5,172,98,0,0 ; vbroadcastss 0x62ac(%rip),%ymm0 # 6704 <_sk_callback_avx+0x14e> + DB 196,226,125,24,5,243,97,0,0 ; vbroadcastss 0x61f3(%rip),%ymm0 # 6658 <_sk_callback_avx+0x154> DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3 DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0 DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1 @@ -5461,7 +5415,7 @@ _sk_dstout_avx LABEL PROC PUBLIC _sk_srcover_avx _sk_srcover_avx LABEL PROC - DB 196,98,125,24,5,143,98,0,0 ; vbroadcastss 0x628f(%rip),%ymm8 # 6708 <_sk_callback_avx+0x152> + DB 196,98,125,24,5,214,97,0,0 ; vbroadcastss 0x61d6(%rip),%ymm8 # 665c <_sk_callback_avx+0x158> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9 DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0 @@ -5476,7 +5430,7 @@ _sk_srcover_avx LABEL PROC PUBLIC _sk_dstover_avx _sk_dstover_avx LABEL PROC - DB 196,98,125,24,5,98,98,0,0 ; vbroadcastss 0x6262(%rip),%ymm8 # 670c <_sk_callback_avx+0x156> + DB 196,98,125,24,5,169,97,0,0 ; vbroadcastss 0x61a9(%rip),%ymm8 # 6660 <_sk_callback_avx+0x15c> DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 197,252,88,196 ; vaddps %ymm4,%ymm0,%ymm0 @@ -5500,7 +5454,7 @@ _sk_modulate_avx LABEL PROC PUBLIC _sk_multiply_avx _sk_multiply_avx LABEL PROC - DB 196,98,125,24,5,33,98,0,0 ; vbroadcastss 0x6221(%rip),%ymm8 # 6710 <_sk_callback_avx+0x15a> + DB 196,98,125,24,5,104,97,0,0 ; vbroadcastss 0x6168(%rip),%ymm8 # 6664 <_sk_callback_avx+0x160> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -5554,7 +5508,7 @@ _sk_screen_avx LABEL PROC PUBLIC _sk_xor__avx _sk_xor__avx LABEL PROC - DB 196,98,125,24,5,112,97,0,0 ; vbroadcastss 0x6170(%rip),%ymm8 # 6714 <_sk_callback_avx+0x15e> + DB 196,98,125,24,5,183,96,0,0 ; vbroadcastss 0x60b7(%rip),%ymm8 # 6668 <_sk_callback_avx+0x164> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -5589,7 +5543,7 @@ _sk_darken_avx LABEL PROC DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9 DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,240,96,0,0 ; vbroadcastss 0x60f0(%rip),%ymm8 # 6718 <_sk_callback_avx+0x162> + DB 196,98,125,24,5,55,96,0,0 ; vbroadcastss 0x6037(%rip),%ymm8 # 666c <_sk_callback_avx+0x168> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8 DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3 @@ -5613,7 +5567,7 @@ _sk_lighten_avx LABEL PROC DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9 DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,156,96,0,0 ; vbroadcastss 0x609c(%rip),%ymm8 # 671c <_sk_callback_avx+0x166> + DB 196,98,125,24,5,227,95,0,0 ; vbroadcastss 0x5fe3(%rip),%ymm8 # 6670 <_sk_callback_avx+0x16c> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8 DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3 @@ -5640,7 +5594,7 @@ _sk_difference_avx LABEL PROC DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2 DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,60,96,0,0 ; vbroadcastss 0x603c(%rip),%ymm8 # 6720 <_sk_callback_avx+0x16a> + DB 196,98,125,24,5,131,95,0,0 ; vbroadcastss 0x5f83(%rip),%ymm8 # 6674 <_sk_callback_avx+0x170> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8 DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3 @@ -5661,7 +5615,7 @@ _sk_exclusion_avx LABEL PROC DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2 DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2 DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2 - DB 196,98,125,24,5,247,95,0,0 ; vbroadcastss 0x5ff7(%rip),%ymm8 # 6724 <_sk_callback_avx+0x16e> + DB 196,98,125,24,5,62,95,0,0 ; vbroadcastss 0x5f3e(%rip),%ymm8 # 6678 <_sk_callback_avx+0x174> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8 DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3 @@ -5670,7 +5624,7 @@ _sk_exclusion_avx LABEL PROC PUBLIC _sk_colorburn_avx _sk_colorburn_avx LABEL PROC - DB 196,98,125,24,5,226,95,0,0 ; vbroadcastss 0x5fe2(%rip),%ymm8 # 6728 <_sk_callback_avx+0x172> + DB 196,98,125,24,5,41,95,0,0 ; vbroadcastss 0x5f29(%rip),%ymm8 # 667c <_sk_callback_avx+0x178> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11 DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10 @@ -5730,7 +5684,7 @@ _sk_colorburn_avx LABEL PROC PUBLIC _sk_colordodge_avx _sk_colordodge_avx LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 - DB 196,98,125,24,13,222,94,0,0 ; vbroadcastss 0x5ede(%rip),%ymm9 # 672c <_sk_callback_avx+0x176> + DB 196,98,125,24,13,37,94,0,0 ; vbroadcastss 0x5e25(%rip),%ymm9 # 6680 <_sk_callback_avx+0x17c> DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10 DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11 DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9 @@ -5785,7 +5739,7 @@ _sk_colordodge_avx LABEL PROC PUBLIC _sk_hardlight_avx _sk_hardlight_avx LABEL PROC - DB 196,98,125,24,5,240,93,0,0 ; vbroadcastss 0x5df0(%rip),%ymm8 # 6730 <_sk_callback_avx+0x17a> + DB 196,98,125,24,5,55,93,0,0 ; vbroadcastss 0x5d37(%rip),%ymm8 # 6684 <_sk_callback_avx+0x180> DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10 DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -5838,7 +5792,7 @@ _sk_hardlight_avx LABEL PROC PUBLIC _sk_overlay_avx _sk_overlay_avx LABEL PROC - DB 196,98,125,24,5,25,93,0,0 ; vbroadcastss 0x5d19(%rip),%ymm8 # 6734 <_sk_callback_avx+0x17e> + DB 196,98,125,24,5,96,92,0,0 ; vbroadcastss 0x5c60(%rip),%ymm8 # 6688 <_sk_callback_avx+0x184> DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10 DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -5903,10 +5857,10 @@ _sk_softlight_avx LABEL PROC DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8 DB 196,65,60,89,216 ; vmulps %ymm8,%ymm8,%ymm11 DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8 - DB 196,98,125,24,29,12,92,0,0 ; vbroadcastss 0x5c0c(%rip),%ymm11 # 673c <_sk_callback_avx+0x186> + DB 196,98,125,24,29,83,91,0,0 ; vbroadcastss 0x5b53(%rip),%ymm11 # 6690 <_sk_callback_avx+0x18c> DB 196,65,28,88,235 ; vaddps %ymm11,%ymm12,%ymm13 DB 196,65,20,89,192 ; vmulps %ymm8,%ymm13,%ymm8 - DB 196,98,125,24,45,253,91,0,0 ; vbroadcastss 0x5bfd(%rip),%ymm13 # 6740 <_sk_callback_avx+0x18a> + DB 196,98,125,24,45,68,91,0,0 ; vbroadcastss 0x5b44(%rip),%ymm13 # 6694 <_sk_callback_avx+0x190> DB 196,65,28,89,245 ; vmulps %ymm13,%ymm12,%ymm14 DB 196,65,12,88,192 ; vaddps %ymm8,%ymm14,%ymm8 DB 196,65,124,82,244 ; vrsqrtps %ymm12,%ymm14 @@ -5917,7 +5871,7 @@ _sk_softlight_avx LABEL PROC DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15 DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14 DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15 - DB 196,98,125,24,5,187,91,0,0 ; vbroadcastss 0x5bbb(%rip),%ymm8 # 6738 <_sk_callback_avx+0x182> + DB 196,98,125,24,5,2,91,0,0 ; vbroadcastss 0x5b02(%rip),%ymm8 # 668c <_sk_callback_avx+0x188> DB 196,65,60,92,228 ; vsubps %ymm12,%ymm8,%ymm12 DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0 DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12 @@ -6044,12 +5998,12 @@ _sk_hue_avx LABEL PROC DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11 DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11 DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12 - DB 196,98,125,24,53,133,89,0,0 ; vbroadcastss 0x5985(%rip),%ymm14 # 6744 <_sk_callback_avx+0x18e> + DB 196,98,125,24,53,204,88,0,0 ; vbroadcastss 0x58cc(%rip),%ymm14 # 6698 <_sk_callback_avx+0x194> DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11 - DB 196,98,125,24,61,123,89,0,0 ; vbroadcastss 0x597b(%rip),%ymm15 # 6748 <_sk_callback_avx+0x192> + DB 196,98,125,24,61,194,88,0,0 ; vbroadcastss 0x58c2(%rip),%ymm15 # 669c <_sk_callback_avx+0x198> DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13 DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11 - DB 196,226,125,24,5,108,89,0,0 ; vbroadcastss 0x596c(%rip),%ymm0 # 674c <_sk_callback_avx+0x196> + DB 196,226,125,24,5,179,88,0,0 ; vbroadcastss 0x58b3(%rip),%ymm0 # 66a0 <_sk_callback_avx+0x19c> DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13 DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11 DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13 @@ -6110,7 +6064,7 @@ _sk_hue_avx LABEL PROC DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10 DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2 DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,69,88,0,0 ; vbroadcastss 0x5845(%rip),%ymm8 # 6750 <_sk_callback_avx+0x19a> + DB 196,98,125,24,5,140,87,0,0 ; vbroadcastss 0x578c(%rip),%ymm8 # 66a4 <_sk_callback_avx+0x1a0> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -6167,12 +6121,12 @@ _sk_saturation_avx LABEL PROC DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11 DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11 DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12 - DB 196,98,125,24,53,77,87,0,0 ; vbroadcastss 0x574d(%rip),%ymm14 # 6754 <_sk_callback_avx+0x19e> + DB 196,98,125,24,53,148,86,0,0 ; vbroadcastss 0x5694(%rip),%ymm14 # 66a8 <_sk_callback_avx+0x1a4> DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11 - DB 196,98,125,24,61,67,87,0,0 ; vbroadcastss 0x5743(%rip),%ymm15 # 6758 <_sk_callback_avx+0x1a2> + DB 196,98,125,24,61,138,86,0,0 ; vbroadcastss 0x568a(%rip),%ymm15 # 66ac <_sk_callback_avx+0x1a8> DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13 DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11 - DB 196,226,125,24,5,52,87,0,0 ; vbroadcastss 0x5734(%rip),%ymm0 # 675c <_sk_callback_avx+0x1a6> + DB 196,226,125,24,5,123,86,0,0 ; vbroadcastss 0x567b(%rip),%ymm0 # 66b0 <_sk_callback_avx+0x1ac> DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13 DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11 DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13 @@ -6233,7 +6187,7 @@ _sk_saturation_avx LABEL PROC DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10 DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2 DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,13,86,0,0 ; vbroadcastss 0x560d(%rip),%ymm8 # 6760 <_sk_callback_avx+0x1aa> + DB 196,98,125,24,5,84,85,0,0 ; vbroadcastss 0x5554(%rip),%ymm8 # 66b4 <_sk_callback_avx+0x1b0> DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9 DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1 DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 @@ -6262,12 +6216,12 @@ _sk_color_avx LABEL PROC DB 197,252,17,68,36,32 ; vmovups %ymm0,0x20(%rsp) DB 197,124,89,199 ; vmulps %ymm7,%ymm0,%ymm8 DB 197,116,89,207 ; vmulps %ymm7,%ymm1,%ymm9 - DB 196,98,125,24,45,157,85,0,0 ; vbroadcastss 0x559d(%rip),%ymm13 # 6764 <_sk_callback_avx+0x1ae> + DB 196,98,125,24,45,228,84,0,0 ; vbroadcastss 0x54e4(%rip),%ymm13 # 66b8 <_sk_callback_avx+0x1b4> DB 196,65,92,89,213 ; vmulps %ymm13,%ymm4,%ymm10 - DB 196,98,125,24,53,147,85,0,0 ; vbroadcastss 0x5593(%rip),%ymm14 # 6768 <_sk_callback_avx+0x1b2> + DB 196,98,125,24,53,218,84,0,0 ; vbroadcastss 0x54da(%rip),%ymm14 # 66bc <_sk_callback_avx+0x1b8> DB 196,65,84,89,222 ; vmulps %ymm14,%ymm5,%ymm11 DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10 - DB 196,98,125,24,61,132,85,0,0 ; vbroadcastss 0x5584(%rip),%ymm15 # 676c <_sk_callback_avx+0x1b6> + DB 196,98,125,24,61,203,84,0,0 ; vbroadcastss 0x54cb(%rip),%ymm15 # 66c0 <_sk_callback_avx+0x1bc> DB 196,65,76,89,223 ; vmulps %ymm15,%ymm6,%ymm11 DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0 DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11 @@ -6330,7 +6284,7 @@ _sk_color_avx LABEL PROC DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9 DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0 DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8 - DB 196,226,125,24,5,75,84,0,0 ; vbroadcastss 0x544b(%rip),%ymm0 # 6770 <_sk_callback_avx+0x1ba> + DB 196,226,125,24,5,146,83,0,0 ; vbroadcastss 0x5392(%rip),%ymm0 # 66c4 <_sk_callback_avx+0x1c0> DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10 DB 197,172,89,84,36,32 ; vmulps 0x20(%rsp),%ymm10,%ymm2 DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11 @@ -6360,12 +6314,12 @@ _sk_luminosity_avx LABEL PROC DB 197,252,40,208 ; vmovaps %ymm0,%ymm2 DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8 DB 197,100,89,205 ; vmulps %ymm5,%ymm3,%ymm9 - DB 196,98,125,24,45,215,83,0,0 ; vbroadcastss 0x53d7(%rip),%ymm13 # 6774 <_sk_callback_avx+0x1be> + DB 196,98,125,24,45,30,83,0,0 ; vbroadcastss 0x531e(%rip),%ymm13 # 66c8 <_sk_callback_avx+0x1c4> DB 196,65,108,89,213 ; vmulps %ymm13,%ymm2,%ymm10 - DB 196,98,125,24,53,205,83,0,0 ; vbroadcastss 0x53cd(%rip),%ymm14 # 6778 <_sk_callback_avx+0x1c2> + DB 196,98,125,24,53,20,83,0,0 ; vbroadcastss 0x5314(%rip),%ymm14 # 66cc <_sk_callback_avx+0x1c8> DB 196,65,116,89,222 ; vmulps %ymm14,%ymm1,%ymm11 DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10 - DB 196,98,125,24,61,190,83,0,0 ; vbroadcastss 0x53be(%rip),%ymm15 # 677c <_sk_callback_avx+0x1c6> + DB 196,98,125,24,61,5,83,0,0 ; vbroadcastss 0x5305(%rip),%ymm15 # 66d0 <_sk_callback_avx+0x1cc> DB 196,65,28,89,223 ; vmulps %ymm15,%ymm12,%ymm11 DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0 DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11 @@ -6428,7 +6382,7 @@ _sk_luminosity_avx LABEL PROC DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9 DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0 DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8 - DB 196,226,125,24,5,133,82,0,0 ; vbroadcastss 0x5285(%rip),%ymm0 # 6780 <_sk_callback_avx+0x1ca> + DB 196,226,125,24,5,204,81,0,0 ; vbroadcastss 0x51cc(%rip),%ymm0 # 66d4 <_sk_callback_avx+0x1d0> DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11 @@ -6457,9 +6411,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,47,1,0,0 ; jne 1695 <_sk_srcover_rgba_8888_avx+0x14c> + DB 15,133,47,1,0,0 ; jne 16a2 <_sk_srcover_rgba_8888_avx+0x14c> DB 196,193,124,16,58 ; vmovups (%r10),%ymm7 - DB 197,124,40,13,77,86,0,0 ; vmovaps 0x564d(%rip),%ymm9 # 6bc0 <_sk_callback_avx+0x60a> + DB 197,124,40,13,128,85,0,0 ; vmovaps 0x5580(%rip),%ymm9 # 6b00 <_sk_callback_avx+0x5fc> DB 196,193,68,84,225 ; vandps %ymm9,%ymm7,%ymm4 DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4 DB 197,209,114,215,8 ; vpsrld $0x8,%xmm7,%xmm5 @@ -6477,9 +6431,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7 DB 196,227,53,24,255,1 ; vinsertf128 $0x1,%xmm7,%ymm9,%ymm7 DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7 - DB 196,98,125,24,5,176,81,0,0 ; vbroadcastss 0x51b0(%rip),%ymm8 # 6784 <_sk_callback_avx+0x1ce> + DB 196,98,125,24,5,247,80,0,0 ; vbroadcastss 0x50f7(%rip),%ymm8 # 66d8 <_sk_callback_avx+0x1d4> DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8 - DB 196,98,125,24,13,167,81,0,0 ; vbroadcastss 0x51a7(%rip),%ymm9 # 6788 <_sk_callback_avx+0x1d2> + DB 196,98,125,24,13,238,80,0,0 ; vbroadcastss 0x50ee(%rip),%ymm9 # 66dc <_sk_callback_avx+0x1d8> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 197,60,89,212 ; vmulps %ymm4,%ymm8,%ymm10 DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0 @@ -6512,7 +6466,7 @@ _sk_srcover_rgba_8888_avx LABEL PROC DB 196,65,53,86,202 ; vorpd %ymm10,%ymm9,%ymm9 DB 196,65,61,86,193 ; vorpd %ymm9,%ymm8,%ymm8 DB 77,133,192 ; test %r8,%r8 - DB 117,91 ; jne 16e0 <_sk_srcover_rgba_8888_avx+0x197> + DB 117,91 ; jne 16ed <_sk_srcover_rgba_8888_avx+0x197> DB 196,65,124,17,2 ; vmovups %ymm8,(%r10) DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -6525,13 +6479,13 @@ _sk_srcover_rgba_8888_avx LABEL PROC DB 72,211,232 ; shr %cl,%rax DB 196,225,249,110,224 ; vmovq %rax,%xmm4 DB 196,226,121,48,228 ; vpmovzxbw %xmm4,%xmm4 - DB 196,226,89,0,45,83,84,0,0 ; vpshufb 0x5453(%rip),%xmm4,%xmm5 # 6b10 <_sk_callback_avx+0x55a> + DB 196,226,89,0,45,150,83,0,0 ; vpshufb 0x5396(%rip),%xmm4,%xmm5 # 6a60 <_sk_callback_avx+0x55c> DB 196,226,121,33,237 ; vpmovsxbd %xmm5,%xmm5 - DB 196,226,89,0,37,85,84,0,0 ; vpshufb 0x5455(%rip),%xmm4,%xmm4 # 6b20 <_sk_callback_avx+0x56a> + DB 196,226,89,0,37,152,83,0,0 ; vpshufb 0x5398(%rip),%xmm4,%xmm4 # 6a70 <_sk_callback_avx+0x56c> DB 196,226,121,33,228 ; vpmovsxbd %xmm4,%xmm4 DB 196,227,85,24,228,1 ; vinsertf128 $0x1,%xmm4,%ymm5,%ymm4 DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7 - DB 233,139,254,255,255 ; jmpq 156b <_sk_srcover_rgba_8888_avx+0x22> + DB 233,139,254,255,255 ; jmpq 1578 <_sk_srcover_rgba_8888_avx+0x22> DB 185,8,0,0,0 ; mov $0x8,%ecx DB 68,41,193 ; sub %r8d,%ecx DB 192,225,3 ; shl $0x3,%cl @@ -6539,13 +6493,13 @@ _sk_srcover_rgba_8888_avx LABEL PROC DB 72,211,232 ; shr %cl,%rax DB 196,97,249,110,200 ; vmovq %rax,%xmm9 DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9 - DB 196,98,49,0,21,8,84,0,0 ; vpshufb 0x5408(%rip),%xmm9,%xmm10 # 6b10 <_sk_callback_avx+0x55a> + DB 196,98,49,0,21,75,83,0,0 ; vpshufb 0x534b(%rip),%xmm9,%xmm10 # 6a60 <_sk_callback_avx+0x55c> DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10 - DB 196,98,49,0,13,10,84,0,0 ; vpshufb 0x540a(%rip),%xmm9,%xmm9 # 6b20 <_sk_callback_avx+0x56a> + DB 196,98,49,0,13,77,83,0,0 ; vpshufb 0x534d(%rip),%xmm9,%xmm9 # 6a70 <_sk_callback_avx+0x56c> DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9 DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10) - DB 233,95,255,255,255 ; jmpq 168a <_sk_srcover_rgba_8888_avx+0x141> + DB 233,95,255,255,255 ; jmpq 1697 <_sk_srcover_rgba_8888_avx+0x141> PUBLIC _sk_clamp_0_avx _sk_clamp_0_avx LABEL PROC @@ -6559,7 +6513,7 @@ _sk_clamp_0_avx LABEL PROC PUBLIC _sk_clamp_1_avx _sk_clamp_1_avx LABEL PROC - DB 196,98,125,24,5,59,80,0,0 ; vbroadcastss 0x503b(%rip),%ymm8 # 678c <_sk_callback_avx+0x1d6> + DB 196,98,125,24,5,130,79,0,0 ; vbroadcastss 0x4f82(%rip),%ymm8 # 66e0 <_sk_callback_avx+0x1dc> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1 DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2 @@ -6569,7 +6523,7 @@ _sk_clamp_1_avx LABEL PROC PUBLIC _sk_clamp_a_avx _sk_clamp_a_avx LABEL PROC - DB 196,98,125,24,5,30,80,0,0 ; vbroadcastss 0x501e(%rip),%ymm8 # 6790 <_sk_callback_avx+0x1da> + DB 196,98,125,24,5,101,79,0,0 ; vbroadcastss 0x4f65(%rip),%ymm8 # 66e4 <_sk_callback_avx+0x1e0> DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3 DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0 DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1 @@ -6641,7 +6595,7 @@ PUBLIC _sk_unpremul_avx _sk_unpremul_avx LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9 - DB 196,98,125,24,21,102,79,0,0 ; vbroadcastss 0x4f66(%rip),%ymm10 # 6794 <_sk_callback_avx+0x1de> + DB 196,98,125,24,21,173,78,0,0 ; vbroadcastss 0x4ead(%rip),%ymm10 # 66e8 <_sk_callback_avx+0x1e4> DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10 DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 @@ -6652,17 +6606,17 @@ _sk_unpremul_avx LABEL PROC PUBLIC _sk_from_srgb_avx _sk_from_srgb_avx LABEL PROC - DB 196,98,125,24,5,71,79,0,0 ; vbroadcastss 0x4f47(%rip),%ymm8 # 6798 <_sk_callback_avx+0x1e2> + DB 196,98,125,24,5,142,78,0,0 ; vbroadcastss 0x4e8e(%rip),%ymm8 # 66ec <_sk_callback_avx+0x1e8> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10 - DB 196,98,125,24,29,57,79,0,0 ; vbroadcastss 0x4f39(%rip),%ymm11 # 679c <_sk_callback_avx+0x1e6> + DB 196,98,125,24,29,128,78,0,0 ; vbroadcastss 0x4e80(%rip),%ymm11 # 66f0 <_sk_callback_avx+0x1ec> DB 196,65,124,89,227 ; vmulps %ymm11,%ymm0,%ymm12 - DB 196,98,125,24,45,47,79,0,0 ; vbroadcastss 0x4f2f(%rip),%ymm13 # 67a0 <_sk_callback_avx+0x1ea> + DB 196,98,125,24,45,118,78,0,0 ; vbroadcastss 0x4e76(%rip),%ymm13 # 66f4 <_sk_callback_avx+0x1f0> DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12 DB 196,65,44,89,212 ; vmulps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,37,32,79,0,0 ; vbroadcastss 0x4f20(%rip),%ymm12 # 67a4 <_sk_callback_avx+0x1ee> + DB 196,98,125,24,37,103,78,0,0 ; vbroadcastss 0x4e67(%rip),%ymm12 # 66f8 <_sk_callback_avx+0x1f4> DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10 - DB 196,98,125,24,53,22,79,0,0 ; vbroadcastss 0x4f16(%rip),%ymm14 # 67a8 <_sk_callback_avx+0x1f2> + DB 196,98,125,24,53,93,78,0,0 ; vbroadcastss 0x4e5d(%rip),%ymm14 # 66fc <_sk_callback_avx+0x1f8> DB 196,193,124,194,198,1 ; vcmpltps %ymm14,%ymm0,%ymm0 DB 196,195,45,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm10,%ymm0 DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9 @@ -6687,20 +6641,20 @@ _sk_from_srgb_avx LABEL PROC PUBLIC _sk_to_srgb_avx _sk_to_srgb_avx LABEL PROC DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9 - DB 196,98,125,24,5,171,78,0,0 ; vbroadcastss 0x4eab(%rip),%ymm8 # 67ac <_sk_callback_avx+0x1f6> + DB 196,98,125,24,5,242,77,0,0 ; vbroadcastss 0x4df2(%rip),%ymm8 # 6700 <_sk_callback_avx+0x1fc> DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10 - DB 196,98,125,24,29,161,78,0,0 ; vbroadcastss 0x4ea1(%rip),%ymm11 # 67b0 <_sk_callback_avx+0x1fa> + DB 196,98,125,24,29,232,77,0,0 ; vbroadcastss 0x4de8(%rip),%ymm11 # 6704 <_sk_callback_avx+0x200> DB 196,65,52,89,227 ; vmulps %ymm11,%ymm9,%ymm12 - DB 196,98,125,24,45,151,78,0,0 ; vbroadcastss 0x4e97(%rip),%ymm13 # 67b4 <_sk_callback_avx+0x1fe> + DB 196,98,125,24,45,222,77,0,0 ; vbroadcastss 0x4dde(%rip),%ymm13 # 6708 <_sk_callback_avx+0x204> DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12 DB 196,65,52,89,228 ; vmulps %ymm12,%ymm9,%ymm12 - DB 196,98,125,24,53,136,78,0,0 ; vbroadcastss 0x4e88(%rip),%ymm14 # 67b8 <_sk_callback_avx+0x202> + DB 196,98,125,24,53,207,77,0,0 ; vbroadcastss 0x4dcf(%rip),%ymm14 # 670c <_sk_callback_avx+0x208> DB 196,65,28,88,230 ; vaddps %ymm14,%ymm12,%ymm12 - DB 196,98,125,24,61,126,78,0,0 ; vbroadcastss 0x4e7e(%rip),%ymm15 # 67bc <_sk_callback_avx+0x206> + DB 196,98,125,24,61,197,77,0,0 ; vbroadcastss 0x4dc5(%rip),%ymm15 # 6710 <_sk_callback_avx+0x20c> DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9 DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9 DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9 - DB 196,98,125,24,37,106,78,0,0 ; vbroadcastss 0x4e6a(%rip),%ymm12 # 67c0 <_sk_callback_avx+0x20a> + DB 196,98,125,24,37,177,77,0,0 ; vbroadcastss 0x4db1(%rip),%ymm12 # 6714 <_sk_callback_avx+0x210> DB 196,193,124,194,196,1 ; vcmpltps %ymm12,%ymm0,%ymm0 DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0 DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9 @@ -6735,7 +6689,7 @@ _sk_rgb_to_hsl_avx LABEL PROC DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9 DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9 DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10 - DB 196,98,125,24,29,208,77,0,0 ; vbroadcastss 0x4dd0(%rip),%ymm11 # 67c4 <_sk_callback_avx+0x20e> + DB 196,98,125,24,29,23,77,0,0 ; vbroadcastss 0x4d17(%rip),%ymm11 # 6718 <_sk_callback_avx+0x214> DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11 DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12 DB 196,65,28,89,227 ; vmulps %ymm11,%ymm12,%ymm12 @@ -6745,19 +6699,19 @@ _sk_rgb_to_hsl_avx LABEL PROC DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2 DB 197,252,92,201 ; vsubps %ymm1,%ymm0,%ymm1 DB 196,193,116,89,203 ; vmulps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,29,169,77,0,0 ; vbroadcastss 0x4da9(%rip),%ymm11 # 67d0 <_sk_callback_avx+0x21a> + DB 196,98,125,24,29,240,76,0,0 ; vbroadcastss 0x4cf0(%rip),%ymm11 # 6724 <_sk_callback_avx+0x220> DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,29,151,77,0,0 ; vbroadcastss 0x4d97(%rip),%ymm11 # 67cc <_sk_callback_avx+0x216> + DB 196,98,125,24,29,222,76,0,0 ; vbroadcastss 0x4cde(%rip),%ymm11 # 6720 <_sk_callback_avx+0x21c> DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 DB 196,227,117,74,202,224 ; vblendvps %ymm14,%ymm2,%ymm1,%ymm1 - DB 196,226,125,24,21,127,77,0,0 ; vbroadcastss 0x4d7f(%rip),%ymm2 # 67c8 <_sk_callback_avx+0x212> + DB 196,226,125,24,21,198,76,0,0 ; vbroadcastss 0x4cc6(%rip),%ymm2 # 671c <_sk_callback_avx+0x218> DB 196,65,12,87,246 ; vxorps %ymm14,%ymm14,%ymm14 DB 196,227,13,74,210,208 ; vblendvps %ymm13,%ymm2,%ymm14,%ymm2 DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0 DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2 DB 196,227,117,74,194,0 ; vblendvps %ymm0,%ymm2,%ymm1,%ymm0 DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1 - DB 196,98,125,24,37,102,77,0,0 ; vbroadcastss 0x4d66(%rip),%ymm12 # 67d8 <_sk_callback_avx+0x222> + DB 196,98,125,24,37,173,76,0,0 ; vbroadcastss 0x4cad(%rip),%ymm12 # 672c <_sk_callback_avx+0x228> DB 196,193,116,89,212 ; vmulps %ymm12,%ymm1,%ymm2 DB 197,28,194,226,1 ; vcmpltps %ymm2,%ymm12,%ymm12 DB 196,65,36,92,216 ; vsubps %ymm8,%ymm11,%ymm11 @@ -6767,7 +6721,7 @@ _sk_rgb_to_hsl_avx LABEL PROC DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1 DB 196,195,125,74,198,128 ; vblendvps %ymm8,%ymm14,%ymm0,%ymm0 DB 196,195,117,74,206,128 ; vblendvps %ymm8,%ymm14,%ymm1,%ymm1 - DB 196,98,125,24,5,41,77,0,0 ; vbroadcastss 0x4d29(%rip),%ymm8 # 67d4 <_sk_callback_avx+0x21e> + DB 196,98,125,24,5,112,76,0,0 ; vbroadcastss 0x4c70(%rip),%ymm8 # 6728 <_sk_callback_avx+0x224> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -6782,7 +6736,7 @@ _sk_hsl_to_rgb_avx LABEL PROC DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp) DB 197,252,40,225 ; vmovaps %ymm1,%ymm4 DB 197,252,40,216 ; vmovaps %ymm0,%ymm3 - DB 196,98,125,24,5,240,76,0,0 ; vbroadcastss 0x4cf0(%rip),%ymm8 # 67dc <_sk_callback_avx+0x226> + DB 196,98,125,24,5,55,76,0,0 ; vbroadcastss 0x4c37(%rip),%ymm8 # 6730 <_sk_callback_avx+0x22c> DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9 DB 197,92,89,210 ; vmulps %ymm2,%ymm4,%ymm10 DB 196,65,92,92,218 ; vsubps %ymm10,%ymm4,%ymm11 @@ -6790,23 +6744,23 @@ _sk_hsl_to_rgb_avx LABEL PROC DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10 DB 197,108,88,202 ; vaddps %ymm2,%ymm2,%ymm9 DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9 - DB 196,98,125,24,29,202,76,0,0 ; vbroadcastss 0x4cca(%rip),%ymm11 # 67e0 <_sk_callback_avx+0x22a> + DB 196,98,125,24,29,17,76,0,0 ; vbroadcastss 0x4c11(%rip),%ymm11 # 6734 <_sk_callback_avx+0x230> DB 196,65,100,88,219 ; vaddps %ymm11,%ymm3,%ymm11 DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12 DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15 DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11 - DB 196,98,125,24,37,180,76,0,0 ; vbroadcastss 0x4cb4(%rip),%ymm12 # 67e8 <_sk_callback_avx+0x232> + DB 196,98,125,24,37,251,75,0,0 ; vbroadcastss 0x4bfb(%rip),%ymm12 # 673c <_sk_callback_avx+0x238> DB 196,193,4,89,196 ; vmulps %ymm12,%ymm15,%ymm0 - DB 196,98,125,24,45,170,76,0,0 ; vbroadcastss 0x4caa(%rip),%ymm13 # 67ec <_sk_callback_avx+0x236> + DB 196,98,125,24,45,241,75,0,0 ; vbroadcastss 0x4bf1(%rip),%ymm13 # 6740 <_sk_callback_avx+0x23c> DB 197,20,92,240 ; vsubps %ymm0,%ymm13,%ymm14 DB 196,65,36,89,246 ; vmulps %ymm14,%ymm11,%ymm14 DB 196,65,52,88,246 ; vaddps %ymm14,%ymm9,%ymm14 - DB 196,226,125,24,13,139,76,0,0 ; vbroadcastss 0x4c8b(%rip),%ymm1 # 67e4 <_sk_callback_avx+0x22e> + DB 196,226,125,24,13,210,75,0,0 ; vbroadcastss 0x4bd2(%rip),%ymm1 # 6738 <_sk_callback_avx+0x234> DB 196,193,116,194,255,2 ; vcmpleps %ymm15,%ymm1,%ymm7 DB 196,195,13,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm14,%ymm7 DB 196,65,60,194,247,2 ; vcmpleps %ymm15,%ymm8,%ymm14 DB 196,227,45,74,255,224 ; vblendvps %ymm14,%ymm7,%ymm10,%ymm7 - DB 196,98,125,24,53,118,76,0,0 ; vbroadcastss 0x4c76(%rip),%ymm14 # 67f0 <_sk_callback_avx+0x23a> + DB 196,98,125,24,53,189,75,0,0 ; vbroadcastss 0x4bbd(%rip),%ymm14 # 6744 <_sk_callback_avx+0x240> DB 196,65,12,194,255,2 ; vcmpleps %ymm15,%ymm14,%ymm15 DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0 DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0 @@ -6825,7 +6779,7 @@ _sk_hsl_to_rgb_avx LABEL PROC DB 197,164,89,247 ; vmulps %ymm7,%ymm11,%ymm6 DB 197,180,88,246 ; vaddps %ymm6,%ymm9,%ymm6 DB 196,227,77,74,237,0 ; vblendvps %ymm0,%ymm5,%ymm6,%ymm5 - DB 196,226,125,24,5,24,76,0,0 ; vbroadcastss 0x4c18(%rip),%ymm0 # 67f4 <_sk_callback_avx+0x23e> + DB 196,226,125,24,5,95,75,0,0 ; vbroadcastss 0x4b5f(%rip),%ymm0 # 6748 <_sk_callback_avx+0x244> DB 197,228,88,192 ; vaddps %ymm0,%ymm3,%ymm0 DB 196,227,125,8,216,1 ; vroundps $0x1,%ymm0,%ymm3 DB 197,252,92,195 ; vsubps %ymm3,%ymm0,%ymm0 @@ -6873,14 +6827,14 @@ _sk_scale_u8_avx LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,68 ; jne 1cd9 <_sk_scale_u8_avx+0x54> + DB 117,68 ; jne 1ce6 <_sk_scale_u8_avx+0x54> DB 197,122,126,0 ; vmovq (%rax),%xmm8 DB 196,66,121,49,200 ; vpmovzxbd %xmm8,%xmm9 DB 196,67,121,4,192,229 ; vpermilps $0xe5,%xmm8,%xmm8 DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8 DB 196,67,53,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm9,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,59,75,0,0 ; vbroadcastss 0x4b3b(%rip),%ymm9 # 67f8 <_sk_callback_avx+0x242> + DB 196,98,125,24,13,130,74,0,0 ; vbroadcastss 0x4a82(%rip),%ymm9 # 674c <_sk_callback_avx+0x248> DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 @@ -6899,10 +6853,10 @@ _sk_scale_u8_avx LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 1ce2 <_sk_scale_u8_avx+0x5d> + DB 117,235 ; jne 1cef <_sk_scale_u8_avx+0x5d> DB 196,65,249,110,194 ; vmovq %r10,%xmm8 DB 91 ; pop %rbx - DB 235,154 ; jmp 1c99 <_sk_scale_u8_avx+0x14> + DB 235,154 ; jmp 1ca6 <_sk_scale_u8_avx+0x14> PUBLIC _sk_lerp_1_float_avx _sk_lerp_1_float_avx LABEL PROC @@ -6930,14 +6884,14 @@ _sk_lerp_u8_avx LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,104 ; jne 1db6 <_sk_lerp_u8_avx+0x78> + DB 117,104 ; jne 1dc3 <_sk_lerp_u8_avx+0x78> DB 197,122,126,0 ; vmovq (%rax),%xmm8 DB 196,66,121,49,200 ; vpmovzxbd %xmm8,%xmm9 DB 196,67,121,4,192,229 ; vpermilps $0xe5,%xmm8,%xmm8 DB 196,66,121,49,192 ; vpmovzxbd %xmm8,%xmm8 DB 196,67,53,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm9,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,13,134,74,0,0 ; vbroadcastss 0x4a86(%rip),%ymm9 # 67fc <_sk_callback_avx+0x246> + DB 196,98,125,24,13,205,73,0,0 ; vbroadcastss 0x49cd(%rip),%ymm9 # 6750 <_sk_callback_avx+0x24c> DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0 DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 @@ -6964,36 +6918,36 @@ _sk_lerp_u8_avx LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 1dbf <_sk_lerp_u8_avx+0x81> + DB 117,235 ; jne 1dcc <_sk_lerp_u8_avx+0x81> DB 196,65,249,110,194 ; vmovq %r10,%xmm8 DB 91 ; pop %rbx - DB 233,115,255,255,255 ; jmpq 1d52 <_sk_lerp_u8_avx+0x14> + DB 233,115,255,255,255 ; jmpq 1d5f <_sk_lerp_u8_avx+0x14> PUBLIC _sk_lerp_565_avx _sk_lerp_565_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,208,0,0,0 ; jne 1ebd <_sk_lerp_565_avx+0xde> + DB 15,133,208,0,0,0 ; jne 1eca <_sk_lerp_565_avx+0xde> DB 196,65,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 196,65,57,105,201 ; vpunpckhwd %xmm9,%xmm8,%xmm9 DB 196,66,121,51,192 ; vpmovzxwd %xmm8,%xmm8 DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8 - DB 196,98,125,24,13,239,73,0,0 ; vbroadcastss 0x49ef(%rip),%ymm9 # 6800 <_sk_callback_avx+0x24a> + DB 196,98,125,24,13,54,73,0,0 ; vbroadcastss 0x4936(%rip),%ymm9 # 6754 <_sk_callback_avx+0x250> DB 196,65,60,84,201 ; vandps %ymm9,%ymm8,%ymm9 DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9 - DB 196,98,125,24,21,224,73,0,0 ; vbroadcastss 0x49e0(%rip),%ymm10 # 6804 <_sk_callback_avx+0x24e> + DB 196,98,125,24,21,39,73,0,0 ; vbroadcastss 0x4927(%rip),%ymm10 # 6758 <_sk_callback_avx+0x254> DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9 - DB 196,98,125,24,21,214,73,0,0 ; vbroadcastss 0x49d6(%rip),%ymm10 # 6808 <_sk_callback_avx+0x252> + DB 196,98,125,24,21,29,73,0,0 ; vbroadcastss 0x491d(%rip),%ymm10 # 675c <_sk_callback_avx+0x258> DB 196,65,60,84,210 ; vandps %ymm10,%ymm8,%ymm10 DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10 - DB 196,98,125,24,29,199,73,0,0 ; vbroadcastss 0x49c7(%rip),%ymm11 # 680c <_sk_callback_avx+0x256> + DB 196,98,125,24,29,14,73,0,0 ; vbroadcastss 0x490e(%rip),%ymm11 # 6760 <_sk_callback_avx+0x25c> DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10 - DB 196,98,125,24,29,189,73,0,0 ; vbroadcastss 0x49bd(%rip),%ymm11 # 6810 <_sk_callback_avx+0x25a> + DB 196,98,125,24,29,4,73,0,0 ; vbroadcastss 0x4904(%rip),%ymm11 # 6764 <_sk_callback_avx+0x260> DB 196,65,60,84,195 ; vandps %ymm11,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 - DB 196,98,125,24,29,174,73,0,0 ; vbroadcastss 0x49ae(%rip),%ymm11 # 6814 <_sk_callback_avx+0x25e> + DB 196,98,125,24,29,245,72,0,0 ; vbroadcastss 0x48f5(%rip),%ymm11 # 6768 <_sk_callback_avx+0x264> DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8 DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0 DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 @@ -7020,9 +6974,9 @@ _sk_lerp_565_avx LABEL PROC DB 196,65,57,239,192 ; vpxor %xmm8,%xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,29,255,255,255 ; ja 1df3 <_sk_lerp_565_avx+0x14> + DB 15,135,29,255,255,255 ; ja 1e00 <_sk_lerp_565_avx+0x14> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 1f2c <_sk_lerp_565_avx+0x14d> + DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 1f38 <_sk_lerp_565_avx+0x14c> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -7034,27 +6988,28 @@ _sk_lerp_565_avx LABEL PROC DB 196,65,57,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm8,%xmm8 DB 196,65,57,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm8,%xmm8 DB 196,65,57,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm8,%xmm8 - DB 233,200,254,255,255 ; jmpq 1df3 <_sk_lerp_565_avx+0x14> - DB 144 ; nop - DB 243,255 ; repz (bad) + DB 233,200,254,255,255 ; jmpq 1e00 <_sk_lerp_565_avx+0x14> + DB 244 ; hlt DB 255 ; (bad) DB 255 ; (bad) - DB 235,255 ; jmp 1f31 <_sk_lerp_565_avx+0x152> DB 255 ; (bad) - DB 255,227 ; jmpq *%rbx + DB 236 ; in (%dx),%al DB 255 ; (bad) DB 255 ; (bad) + DB 255,228 ; jmpq *%rsp DB 255 ; (bad) - DB 219,255 ; (bad) DB 255 ; (bad) - DB 255,211 ; callq *%rbx DB 255 ; (bad) + DB 220,255 ; fdivr %st,%st(7) + DB 255 ; (bad) + DB 255,212 ; callq *%rsp DB 255 ; (bad) - DB 255,203 ; dec %ebx DB 255 ; (bad) + DB 255,204 ; dec %esp DB 255 ; (bad) DB 255 ; (bad) - DB 190 ; .byte 0xbe + DB 255 ; (bad) + DB 191 ; .byte 0xbf DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -7069,9 +7024,9 @@ _sk_load_tables_avx LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,251,1,0,0 ; jne 2166 <_sk_load_tables_avx+0x21e> + DB 15,133,251,1,0,0 ; jne 2172 <_sk_load_tables_avx+0x21e> DB 196,65,124,16,18 ; vmovups (%r10),%ymm10 - DB 197,124,40,13,104,76,0,0 ; vmovaps 0x4c68(%rip),%ymm9 # 6be0 <_sk_callback_avx+0x62a> + DB 197,124,40,13,156,75,0,0 ; vmovaps 0x4b9c(%rip),%ymm9 # 6b20 <_sk_callback_avx+0x61c> DB 196,193,44,84,201 ; vandps %ymm9,%ymm10,%ymm1 DB 196,227,125,25,200,1 ; vextractf128 $0x1,%ymm1,%xmm0 DB 196,193,249,126,195 ; vmovq %xmm0,%r11 @@ -7163,7 +7118,7 @@ _sk_load_tables_avx LABEL PROC DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7 DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,226,125,24,61,199,70,0,0 ; vbroadcastss 0x46c7(%rip),%ymm7 # 6818 <_sk_callback_avx+0x262> + DB 196,226,125,24,61,15,70,0,0 ; vbroadcastss 0x460f(%rip),%ymm7 # 676c <_sk_callback_avx+0x268> DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -7178,13 +7133,13 @@ _sk_load_tables_avx LABEL PROC DB 73,211,235 ; shr %cl,%r11 DB 196,193,249,110,195 ; vmovq %r11,%xmm0 DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0 - DB 196,226,121,0,13,162,73,0,0 ; vpshufb 0x49a2(%rip),%xmm0,%xmm1 # 6b30 <_sk_callback_avx+0x57a> + DB 196,226,121,0,13,230,72,0,0 ; vpshufb 0x48e6(%rip),%xmm0,%xmm1 # 6a80 <_sk_callback_avx+0x57c> DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1 - DB 196,226,121,0,5,164,73,0,0 ; vpshufb 0x49a4(%rip),%xmm0,%xmm0 # 6b40 <_sk_callback_avx+0x58a> + DB 196,226,121,0,5,232,72,0,0 ; vpshufb 0x48e8(%rip),%xmm0,%xmm0 # 6a90 <_sk_callback_avx+0x58c> DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0 DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 196,66,125,44,18 ; vmaskmovps (%r10),%ymm0,%ymm10 - DB 233,191,253,255,255 ; jmpq 1f70 <_sk_load_tables_avx+0x28> + DB 233,191,253,255,255 ; jmpq 1f7c <_sk_load_tables_avx+0x28> PUBLIC _sk_load_tables_u16_be_avx _sk_load_tables_u16_be_avx LABEL PROC @@ -7194,7 +7149,7 @@ _sk_load_tables_u16_be_avx LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 77,133,192 ; test %r8,%r8 DB 197,252,17,60,36 ; vmovups %ymm7,(%rsp) - DB 15,133,87,2,0,0 ; jne 2427 <_sk_load_tables_u16_be_avx+0x276> + DB 15,133,87,2,0,0 ; jne 2433 <_sk_load_tables_u16_be_avx+0x276> DB 196,1,121,16,4,81 ; vmovupd (%r9,%r10,2),%xmm8 DB 196,129,121,16,84,81,16 ; vmovupd 0x10(%r9,%r10,2),%xmm2 DB 196,129,121,16,92,81,32 ; vmovupd 0x20(%r9,%r10,2),%xmm3 @@ -7209,7 +7164,7 @@ _sk_load_tables_u16_be_avx LABEL PROC DB 197,113,105,219 ; vpunpckhwd %xmm3,%xmm1,%xmm11 DB 197,177,108,200 ; vpunpcklqdq %xmm0,%xmm9,%xmm1 DB 197,49,109,224 ; vpunpckhqdq %xmm0,%xmm9,%xmm12 - DB 197,121,111,21,51,73,0,0 ; vmovdqa 0x4933(%rip),%xmm10 # 6b50 <_sk_callback_avx+0x59a> + DB 197,121,111,21,119,72,0,0 ; vmovdqa 0x4877(%rip),%xmm10 # 6aa0 <_sk_callback_avx+0x59c> DB 196,193,113,219,202 ; vpand %xmm10,%xmm1,%xmm1 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 196,193,113,105,209 ; vpunpckhwd %xmm9,%xmm1,%xmm2 @@ -7307,7 +7262,7 @@ _sk_load_tables_u16_be_avx LABEL PROC DB 196,226,121,51,219 ; vpmovzxwd %xmm3,%xmm3 DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,226,125,24,61,6,68,0,0 ; vbroadcastss 0x4406(%rip),%ymm7 # 681c <_sk_callback_avx+0x266> + DB 196,226,125,24,61,78,67,0,0 ; vbroadcastss 0x434e(%rip),%ymm7 # 6770 <_sk_callback_avx+0x26c> DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7 @@ -7316,29 +7271,29 @@ _sk_load_tables_u16_be_avx LABEL PROC DB 196,1,123,16,4,81 ; vmovsd (%r9,%r10,2),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,85 ; je 248d <_sk_load_tables_u16_be_avx+0x2dc> + DB 116,85 ; je 2499 <_sk_load_tables_u16_be_avx+0x2dc> DB 196,1,57,22,68,81,8 ; vmovhpd 0x8(%r9,%r10,2),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,72 ; jb 248d <_sk_load_tables_u16_be_avx+0x2dc> + DB 114,72 ; jb 2499 <_sk_load_tables_u16_be_avx+0x2dc> DB 196,129,123,16,84,81,16 ; vmovsd 0x10(%r9,%r10,2),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,72 ; je 249a <_sk_load_tables_u16_be_avx+0x2e9> + DB 116,72 ; je 24a6 <_sk_load_tables_u16_be_avx+0x2e9> DB 196,129,105,22,84,81,24 ; vmovhpd 0x18(%r9,%r10,2),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,59 ; jb 249a <_sk_load_tables_u16_be_avx+0x2e9> + DB 114,59 ; jb 24a6 <_sk_load_tables_u16_be_avx+0x2e9> DB 196,129,123,16,92,81,32 ; vmovsd 0x20(%r9,%r10,2),%xmm3 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,123,253,255,255 ; je 21eb <_sk_load_tables_u16_be_avx+0x3a> + DB 15,132,123,253,255,255 ; je 21f7 <_sk_load_tables_u16_be_avx+0x3a> DB 196,129,97,22,92,81,40 ; vmovhpd 0x28(%r9,%r10,2),%xmm3,%xmm3 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,106,253,255,255 ; jb 21eb <_sk_load_tables_u16_be_avx+0x3a> + DB 15,130,106,253,255,255 ; jb 21f7 <_sk_load_tables_u16_be_avx+0x3a> DB 196,1,122,126,76,81,48 ; vmovq 0x30(%r9,%r10,2),%xmm9 - DB 233,94,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a> + DB 233,94,253,255,255 ; jmpq 21f7 <_sk_load_tables_u16_be_avx+0x3a> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,81,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a> + DB 233,81,253,255,255 ; jmpq 21f7 <_sk_load_tables_u16_be_avx+0x3a> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 - DB 233,72,253,255,255 ; jmpq 21eb <_sk_load_tables_u16_be_avx+0x3a> + DB 233,72,253,255,255 ; jmpq 21f7 <_sk_load_tables_u16_be_avx+0x3a> PUBLIC _sk_load_tables_rgb_u16_be_avx _sk_load_tables_rgb_u16_be_avx LABEL PROC @@ -7349,7 +7304,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC DB 77,133,192 ; test %r8,%r8 DB 197,252,17,124,36,32 ; vmovups %ymm7,0x20(%rsp) DB 197,252,17,52,36 ; vmovups %ymm6,(%rsp) - DB 15,133,74,2,0,0 ; jne 270e <_sk_load_tables_rgb_u16_be_avx+0x26b> + DB 15,133,74,2,0,0 ; jne 271a <_sk_load_tables_rgb_u16_be_avx+0x26b> DB 196,129,122,111,4,81 ; vmovdqu (%r9,%r10,2),%xmm0 DB 196,129,122,111,84,81,12 ; vmovdqu 0xc(%r9,%r10,2),%xmm2 DB 196,129,122,111,76,81,24 ; vmovdqu 0x18(%r9,%r10,2),%xmm1 @@ -7370,7 +7325,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3 DB 197,57,109,218 ; vpunpckhqdq %xmm2,%xmm8,%xmm11 DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8 - DB 197,121,111,13,50,70,0,0 ; vmovdqa 0x4632(%rip),%xmm9 # 6b60 <_sk_callback_avx+0x5aa> + DB 197,121,111,13,118,69,0,0 ; vmovdqa 0x4576(%rip),%xmm9 # 6ab0 <_sk_callback_avx+0x5ac> DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0 DB 196,65,41,239,210 ; vpxor %xmm10,%xmm10,%xmm10 DB 196,193,121,105,202 ; vpunpckhwd %xmm10,%xmm0,%xmm1 @@ -7460,7 +7415,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC DB 196,195,105,33,211,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm2 DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,35,65,0,0 ; vbroadcastss 0x4123(%rip),%ymm3 # 6820 <_sk_callback_avx+0x26a> + DB 196,226,125,24,29,107,64,0,0 ; vbroadcastss 0x406b(%rip),%ymm3 # 6774 <_sk_callback_avx+0x270> DB 197,252,16,52,36 ; vmovups (%rsp),%ymm6 DB 197,252,16,124,36,32 ; vmovups 0x20(%rsp),%ymm7 DB 72,131,196,88 ; add $0x58,%rsp @@ -7468,41 +7423,41 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC DB 196,129,121,110,4,81 ; vmovd (%r9,%r10,2),%xmm0 DB 196,129,121,196,68,81,4,2 ; vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,5 ; jne 2727 <_sk_load_tables_rgb_u16_be_avx+0x284> - DB 233,209,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 117,5 ; jne 2733 <_sk_load_tables_rgb_u16_be_avx+0x284> + DB 233,209,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> DB 196,129,121,110,76,81,6 ; vmovd 0x6(%r9,%r10,2),%xmm1 DB 196,1,113,196,68,81,10,2 ; vpinsrw $0x2,0xa(%r9,%r10,2),%xmm1,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,26 ; jb 2756 <_sk_load_tables_rgb_u16_be_avx+0x2b3> + DB 114,26 ; jb 2762 <_sk_load_tables_rgb_u16_be_avx+0x2b3> DB 196,129,121,110,76,81,12 ; vmovd 0xc(%r9,%r10,2),%xmm1 DB 196,129,113,196,84,81,16,2 ; vpinsrw $0x2,0x10(%r9,%r10,2),%xmm1,%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 117,10 ; jne 275b <_sk_load_tables_rgb_u16_be_avx+0x2b8> - DB 233,162,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> - DB 233,157,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 117,10 ; jne 2767 <_sk_load_tables_rgb_u16_be_avx+0x2b8> + DB 233,162,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 233,157,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> DB 196,129,121,110,76,81,18 ; vmovd 0x12(%r9,%r10,2),%xmm1 DB 196,1,113,196,76,81,22,2 ; vpinsrw $0x2,0x16(%r9,%r10,2),%xmm1,%xmm9 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,26 ; jb 278a <_sk_load_tables_rgb_u16_be_avx+0x2e7> + DB 114,26 ; jb 2796 <_sk_load_tables_rgb_u16_be_avx+0x2e7> DB 196,129,121,110,76,81,24 ; vmovd 0x18(%r9,%r10,2),%xmm1 DB 196,129,113,196,76,81,28,2 ; vpinsrw $0x2,0x1c(%r9,%r10,2),%xmm1,%xmm1 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 117,10 ; jne 278f <_sk_load_tables_rgb_u16_be_avx+0x2ec> - DB 233,110,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> - DB 233,105,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 117,10 ; jne 279b <_sk_load_tables_rgb_u16_be_avx+0x2ec> + DB 233,110,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 233,105,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> DB 196,129,121,110,92,81,30 ; vmovd 0x1e(%r9,%r10,2),%xmm3 DB 196,1,97,196,92,81,34,2 ; vpinsrw $0x2,0x22(%r9,%r10,2),%xmm3,%xmm11 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,20 ; jb 27b8 <_sk_load_tables_rgb_u16_be_avx+0x315> + DB 114,20 ; jb 27c4 <_sk_load_tables_rgb_u16_be_avx+0x315> DB 196,129,121,110,92,81,36 ; vmovd 0x24(%r9,%r10,2),%xmm3 DB 196,129,97,196,92,81,40,2 ; vpinsrw $0x2,0x28(%r9,%r10,2),%xmm3,%xmm3 - DB 233,64,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> - DB 233,59,253,255,255 ; jmpq 24f8 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 233,64,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> + DB 233,59,253,255,255 ; jmpq 2504 <_sk_load_tables_rgb_u16_be_avx+0x55> PUBLIC _sk_byte_tables_avx _sk_byte_tables_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,92,64,0,0 ; vbroadcastss 0x405c(%rip),%ymm8 # 6824 <_sk_callback_avx+0x26e> + DB 196,98,125,24,5,164,63,0,0 ; vbroadcastss 0x3fa4(%rip),%ymm8 # 6778 <_sk_callback_avx+0x274> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9 DB 196,65,249,126,201 ; vmovq %xmm9,%r9 @@ -7621,7 +7576,7 @@ _sk_byte_tables_avx LABEL PROC DB 196,194,121,49,204 ; vpmovzxbd %xmm12,%xmm1 DB 196,194,121,49,213 ; vpmovzxbd %xmm13,%xmm2 DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1 - DB 196,98,125,24,13,6,62,0,0 ; vbroadcastss 0x3e06(%rip),%ymm9 # 6828 <_sk_callback_avx+0x272> + DB 196,98,125,24,13,78,61,0,0 ; vbroadcastss 0x3d4e(%rip),%ymm9 # 677c <_sk_callback_avx+0x278> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1 @@ -7735,7 +7690,7 @@ _sk_byte_tables_rgb_avx LABEL PROC DB 196,194,121,49,203 ; vpmovzxbd %xmm11,%xmm1 DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,13,231,59,0,0 ; vbroadcastss 0x3be7(%rip),%ymm9 # 682c <_sk_callback_avx+0x276> + DB 196,98,125,24,13,47,59,0,0 ; vbroadcastss 0x3b2f(%rip),%ymm9 # 6780 <_sk_callback_avx+0x27c> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 196,194,121,49,202 ; vpmovzxbd %xmm10,%xmm1 DB 196,194,121,49,212 ; vpmovzxbd %xmm12,%xmm2 @@ -7753,11 +7708,6 @@ _sk_byte_tables_rgb_avx LABEL PROC PUBLIC _sk_table_r_avx _sk_table_r_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 139,64,8 ; mov 0x8(%rax),%eax @@ -7767,48 +7717,38 @@ _sk_table_r_avx LABEL PROC DB 196,67,61,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 - DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0 - DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,195 ; vmovq %xmm0,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 197,125,91,192 ; vcvtps2dq %ymm0,%ymm8 + DB 196,99,125,25,192,1 ; vextractf128 $0x1,%ymm8,%xmm0 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,65,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm9 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,49,33,12,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm10 + DB 196,65,249,126,194 ; vmovq %xmm8,%r10 DB 73,193,235,32 ; shr $0x20,%r11 - DB 196,227,125,25,192,1 ; vextractf128 $0x1,%ymm0,%xmm0 - DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,196 ; vmovq %xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,129,122,16,4,169 ; vmovss (%r9,%r13,4),%xmm0 - DB 196,3,121,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm0,%xmm8 - DB 196,129,122,16,4,185 ; vmovss (%r9,%r15,4),%xmm0 - DB 196,99,57,33,192,32 ; vinsertps $0x20,%xmm0,%xmm8,%xmm8 - DB 196,193,122,16,4,153 ; vmovss (%r9,%rbx,4),%xmm0 - DB 196,99,57,33,192,48 ; vinsertps $0x30,%xmm0,%xmm8,%xmm8 - DB 196,129,122,16,4,177 ; vmovss (%r9,%r14,4),%xmm0 - DB 196,3,121,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm0,%xmm9 - DB 196,129,122,16,4,145 ; vmovss (%r9,%r10,4),%xmm0 - DB 196,99,49,33,200,32 ; vinsertps $0x20,%xmm0,%xmm9,%xmm9 + DB 196,1,122,16,28,153 ; vmovss (%r9,%r11,4),%xmm11 + DB 68,137,208 ; mov %r10d,%eax DB 196,193,122,16,4,129 ; vmovss (%r9,%rax,4),%xmm0 - DB 196,227,49,33,192,48 ; vinsertps $0x30,%xmm0,%xmm9,%xmm0 - DB 196,195,125,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm0,%ymm0 + DB 196,67,249,22,195,1 ; vpextrq $0x1,%xmm8,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,121,33,4,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm0,%xmm8 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,36,129 ; vmovss (%r9,%rax,4),%xmm12 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,1,122,16,44,153 ; vmovss (%r9,%r11,4),%xmm13 + DB 196,195,49,33,194,32 ; vinsertps $0x20,%xmm10,%xmm9,%xmm0 + DB 196,67,121,33,203,48 ; vinsertps $0x30,%xmm11,%xmm0,%xmm9 + DB 196,195,57,33,196,32 ; vinsertps $0x20,%xmm12,%xmm8,%xmm0 + DB 196,195,121,33,197,48 ; vinsertps $0x30,%xmm13,%xmm0,%xmm0 + DB 196,195,125,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_table_g_avx _sk_table_g_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 139,64,8 ; mov 0x8(%rax),%eax @@ -7818,48 +7758,38 @@ _sk_table_g_avx LABEL PROC DB 196,67,61,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1 - DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1 - DB 196,227,249,22,200,1 ; vpextrq $0x1,%xmm1,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,203 ; vmovq %xmm1,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 197,125,91,193 ; vcvtps2dq %ymm1,%ymm8 + DB 196,99,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,65,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm9 + DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,49,33,12,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm10 + DB 196,65,249,126,194 ; vmovq %xmm8,%r10 DB 73,193,235,32 ; shr $0x20,%r11 - DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 - DB 196,227,249,22,203,1 ; vpextrq $0x1,%xmm1,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,204 ; vmovq %xmm1,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,129,122,16,12,169 ; vmovss (%r9,%r13,4),%xmm1 - DB 196,3,113,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm1,%xmm8 - DB 196,129,122,16,12,185 ; vmovss (%r9,%r15,4),%xmm1 - DB 196,99,57,33,193,32 ; vinsertps $0x20,%xmm1,%xmm8,%xmm8 - DB 196,193,122,16,12,153 ; vmovss (%r9,%rbx,4),%xmm1 - DB 196,99,57,33,193,48 ; vinsertps $0x30,%xmm1,%xmm8,%xmm8 - DB 196,129,122,16,12,177 ; vmovss (%r9,%r14,4),%xmm1 - DB 196,3,113,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm1,%xmm9 - DB 196,129,122,16,12,145 ; vmovss (%r9,%r10,4),%xmm1 - DB 196,99,49,33,201,32 ; vinsertps $0x20,%xmm1,%xmm9,%xmm9 + DB 196,1,122,16,28,153 ; vmovss (%r9,%r11,4),%xmm11 + DB 68,137,208 ; mov %r10d,%eax DB 196,193,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm1 - DB 196,227,49,33,201,48 ; vinsertps $0x30,%xmm1,%xmm9,%xmm1 - DB 196,195,117,24,200,1 ; vinsertf128 $0x1,%xmm8,%ymm1,%ymm1 + DB 196,67,249,22,195,1 ; vpextrq $0x1,%xmm8,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,113,33,4,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm1,%xmm8 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,36,129 ; vmovss (%r9,%rax,4),%xmm12 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,1,122,16,44,153 ; vmovss (%r9,%r11,4),%xmm13 + DB 196,195,49,33,202,32 ; vinsertps $0x20,%xmm10,%xmm9,%xmm1 + DB 196,67,113,33,203,48 ; vinsertps $0x30,%xmm11,%xmm1,%xmm9 + DB 196,195,57,33,204,32 ; vinsertps $0x20,%xmm12,%xmm8,%xmm1 + DB 196,195,113,33,205,48 ; vinsertps $0x30,%xmm13,%xmm1,%xmm1 + DB 196,195,117,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm1,%ymm1 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_table_b_avx _sk_table_b_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 139,64,8 ; mov 0x8(%rax),%eax @@ -7869,48 +7799,38 @@ _sk_table_b_avx LABEL PROC DB 196,67,61,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 DB 197,188,89,210 ; vmulps %ymm2,%ymm8,%ymm2 - DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 197,125,91,194 ; vcvtps2dq %ymm2,%ymm8 + DB 196,99,125,25,194,1 ; vextractf128 $0x1,%ymm8,%xmm2 + DB 196,193,249,126,210 ; vmovq %xmm2,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,65,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm9 + DB 196,195,249,22,211,1 ; vpextrq $0x1,%xmm2,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,49,33,12,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm10 + DB 196,65,249,126,194 ; vmovq %xmm8,%r10 DB 73,193,235,32 ; shr $0x20,%r11 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,227,249,22,211,1 ; vpextrq $0x1,%xmm2,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,212 ; vmovq %xmm2,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,129,122,16,20,169 ; vmovss (%r9,%r13,4),%xmm2 - DB 196,3,105,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm2,%xmm8 - DB 196,129,122,16,20,185 ; vmovss (%r9,%r15,4),%xmm2 - DB 196,99,57,33,194,32 ; vinsertps $0x20,%xmm2,%xmm8,%xmm8 - DB 196,193,122,16,20,153 ; vmovss (%r9,%rbx,4),%xmm2 - DB 196,99,57,33,194,48 ; vinsertps $0x30,%xmm2,%xmm8,%xmm8 - DB 196,129,122,16,20,177 ; vmovss (%r9,%r14,4),%xmm2 - DB 196,3,105,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm2,%xmm9 - DB 196,129,122,16,20,145 ; vmovss (%r9,%r10,4),%xmm2 - DB 196,99,49,33,202,32 ; vinsertps $0x20,%xmm2,%xmm9,%xmm9 + DB 196,1,122,16,28,153 ; vmovss (%r9,%r11,4),%xmm11 + DB 68,137,208 ; mov %r10d,%eax DB 196,193,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm2 - DB 196,227,49,33,210,48 ; vinsertps $0x30,%xmm2,%xmm9,%xmm2 - DB 196,195,109,24,208,1 ; vinsertf128 $0x1,%xmm8,%ymm2,%ymm2 + DB 196,67,249,22,195,1 ; vpextrq $0x1,%xmm8,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,105,33,4,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm2,%xmm8 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,36,129 ; vmovss (%r9,%rax,4),%xmm12 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,1,122,16,44,153 ; vmovss (%r9,%r11,4),%xmm13 + DB 196,195,49,33,210,32 ; vinsertps $0x20,%xmm10,%xmm9,%xmm2 + DB 196,67,105,33,203,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm9 + DB 196,195,57,33,212,32 ; vinsertps $0x20,%xmm12,%xmm8,%xmm2 + DB 196,195,105,33,213,48 ; vinsertps $0x30,%xmm13,%xmm2,%xmm2 + DB 196,195,109,24,209,1 ; vinsertf128 $0x1,%xmm9,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_table_a_avx _sk_table_a_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 139,64,8 ; mov 0x8(%rax),%eax @@ -7920,39 +7840,34 @@ _sk_table_a_avx LABEL PROC DB 196,67,61,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm8,%ymm8 DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8 DB 197,188,89,219 ; vmulps %ymm3,%ymm8,%ymm3 - DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3 - DB 196,227,249,22,216,1 ; vpextrq $0x1,%xmm3,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,219 ; vmovq %xmm3,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 197,125,91,195 ; vcvtps2dq %ymm3,%ymm8 + DB 196,99,125,25,195,1 ; vextractf128 $0x1,%ymm8,%xmm3 + DB 196,193,249,126,218 ; vmovq %xmm3,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,65,122,16,12,129 ; vmovss (%r9,%rax,4),%xmm9 + DB 196,195,249,22,219,1 ; vpextrq $0x1,%xmm3,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,49,33,12,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm9,%xmm9 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,20,129 ; vmovss (%r9,%rax,4),%xmm10 + DB 196,65,249,126,194 ; vmovq %xmm8,%r10 DB 73,193,235,32 ; shr $0x20,%r11 - DB 196,227,125,25,219,1 ; vextractf128 $0x1,%ymm3,%xmm3 - DB 196,227,249,22,219,1 ; vpextrq $0x1,%xmm3,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,249,126,220 ; vmovq %xmm3,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,129,122,16,28,169 ; vmovss (%r9,%r13,4),%xmm3 - DB 196,3,97,33,4,161,16 ; vinsertps $0x10,(%r9,%r12,4),%xmm3,%xmm8 - DB 196,129,122,16,28,185 ; vmovss (%r9,%r15,4),%xmm3 - DB 196,99,57,33,195,32 ; vinsertps $0x20,%xmm3,%xmm8,%xmm8 - DB 196,193,122,16,28,153 ; vmovss (%r9,%rbx,4),%xmm3 - DB 196,99,57,33,195,48 ; vinsertps $0x30,%xmm3,%xmm8,%xmm8 - DB 196,129,122,16,28,177 ; vmovss (%r9,%r14,4),%xmm3 - DB 196,3,97,33,12,153,16 ; vinsertps $0x10,(%r9,%r11,4),%xmm3,%xmm9 - DB 196,129,122,16,28,145 ; vmovss (%r9,%r10,4),%xmm3 - DB 196,99,49,33,203,32 ; vinsertps $0x20,%xmm3,%xmm9,%xmm9 + DB 196,1,122,16,28,153 ; vmovss (%r9,%r11,4),%xmm11 + DB 68,137,208 ; mov %r10d,%eax DB 196,193,122,16,28,129 ; vmovss (%r9,%rax,4),%xmm3 - DB 196,227,49,33,219,48 ; vinsertps $0x30,%xmm3,%xmm9,%xmm3 - DB 196,195,101,24,216,1 ; vinsertf128 $0x1,%xmm8,%ymm3,%ymm3 + DB 196,67,249,22,195,1 ; vpextrq $0x1,%xmm8,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,3,97,33,4,145,16 ; vinsertps $0x10,(%r9,%r10,4),%xmm3,%xmm8 + DB 68,137,216 ; mov %r11d,%eax + DB 196,65,122,16,36,129 ; vmovss (%r9,%rax,4),%xmm12 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,1,122,16,44,153 ; vmovss (%r9,%r11,4),%xmm13 + DB 196,195,49,33,218,32 ; vinsertps $0x20,%xmm10,%xmm9,%xmm3 + DB 196,67,97,33,203,48 ; vinsertps $0x30,%xmm11,%xmm3,%xmm9 + DB 196,195,57,33,220,32 ; vinsertps $0x20,%xmm12,%xmm8,%xmm3 + DB 196,195,97,33,221,48 ; vinsertps $0x30,%xmm13,%xmm3,%xmm3 + DB 196,195,101,24,217,1 ; vinsertf128 $0x1,%xmm9,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_parametric_r_avx @@ -7970,36 +7885,36 @@ _sk_parametric_r_avx LABEL PROC DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0 DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10 DB 197,124,91,216 ; vcvtdq2ps %ymm0,%ymm11 - DB 196,98,125,24,37,76,56,0,0 ; vbroadcastss 0x384c(%rip),%ymm12 # 6830 <_sk_callback_avx+0x27a> + DB 196,98,125,24,37,220,55,0,0 ; vbroadcastss 0x37dc(%rip),%ymm12 # 6784 <_sk_callback_avx+0x280> DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,66,56,0,0 ; vbroadcastss 0x3842(%rip),%ymm12 # 6834 <_sk_callback_avx+0x27e> + DB 196,98,125,24,37,210,55,0,0 ; vbroadcastss 0x37d2(%rip),%ymm12 # 6788 <_sk_callback_avx+0x284> DB 196,193,124,84,196 ; vandps %ymm12,%ymm0,%ymm0 - DB 196,98,125,24,37,56,56,0,0 ; vbroadcastss 0x3838(%rip),%ymm12 # 6838 <_sk_callback_avx+0x282> + DB 196,98,125,24,37,200,55,0,0 ; vbroadcastss 0x37c8(%rip),%ymm12 # 678c <_sk_callback_avx+0x288> DB 196,193,124,86,196 ; vorps %ymm12,%ymm0,%ymm0 - DB 196,98,125,24,37,46,56,0,0 ; vbroadcastss 0x382e(%rip),%ymm12 # 683c <_sk_callback_avx+0x286> + DB 196,98,125,24,37,190,55,0,0 ; vbroadcastss 0x37be(%rip),%ymm12 # 6790 <_sk_callback_avx+0x28c> DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,36,56,0,0 ; vbroadcastss 0x3824(%rip),%ymm12 # 6840 <_sk_callback_avx+0x28a> + DB 196,98,125,24,37,180,55,0,0 ; vbroadcastss 0x37b4(%rip),%ymm12 # 6794 <_sk_callback_avx+0x290> DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12 DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,21,56,0,0 ; vbroadcastss 0x3815(%rip),%ymm12 # 6844 <_sk_callback_avx+0x28e> + DB 196,98,125,24,37,165,55,0,0 ; vbroadcastss 0x37a5(%rip),%ymm12 # 6798 <_sk_callback_avx+0x294> DB 196,193,124,88,196 ; vaddps %ymm12,%ymm0,%ymm0 - DB 196,98,125,24,37,11,56,0,0 ; vbroadcastss 0x380b(%rip),%ymm12 # 6848 <_sk_callback_avx+0x292> + DB 196,98,125,24,37,155,55,0,0 ; vbroadcastss 0x379b(%rip),%ymm12 # 679c <_sk_callback_avx+0x298> DB 197,156,94,192 ; vdivps %ymm0,%ymm12,%ymm0 DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0 DB 197,172,89,192 ; vmulps %ymm0,%ymm10,%ymm0 DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10 DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10 - DB 196,98,125,24,29,239,55,0,0 ; vbroadcastss 0x37ef(%rip),%ymm11 # 684c <_sk_callback_avx+0x296> + DB 196,98,125,24,29,127,55,0,0 ; vbroadcastss 0x377f(%rip),%ymm11 # 67a0 <_sk_callback_avx+0x29c> DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0 - DB 196,98,125,24,29,229,55,0,0 ; vbroadcastss 0x37e5(%rip),%ymm11 # 6850 <_sk_callback_avx+0x29a> + DB 196,98,125,24,29,117,55,0,0 ; vbroadcastss 0x3775(%rip),%ymm11 # 67a4 <_sk_callback_avx+0x2a0> DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11 DB 196,193,124,92,195 ; vsubps %ymm11,%ymm0,%ymm0 - DB 196,98,125,24,29,214,55,0,0 ; vbroadcastss 0x37d6(%rip),%ymm11 # 6854 <_sk_callback_avx+0x29e> + DB 196,98,125,24,29,102,55,0,0 ; vbroadcastss 0x3766(%rip),%ymm11 # 67a8 <_sk_callback_avx+0x2a4> DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 - DB 196,98,125,24,29,204,55,0,0 ; vbroadcastss 0x37cc(%rip),%ymm11 # 6858 <_sk_callback_avx+0x2a2> + DB 196,98,125,24,29,92,55,0,0 ; vbroadcastss 0x375c(%rip),%ymm11 # 67ac <_sk_callback_avx+0x2a8> DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10 DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0 - DB 196,98,125,24,21,189,55,0,0 ; vbroadcastss 0x37bd(%rip),%ymm10 # 685c <_sk_callback_avx+0x2a6> + DB 196,98,125,24,21,77,55,0,0 ; vbroadcastss 0x374d(%rip),%ymm10 # 67b0 <_sk_callback_avx+0x2ac> DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0 DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -8007,7 +7922,7 @@ _sk_parametric_r_avx LABEL PROC DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,5,148,55,0,0 ; vbroadcastss 0x3794(%rip),%ymm8 # 6860 <_sk_callback_avx+0x2aa> + DB 196,98,125,24,5,36,55,0,0 ; vbroadcastss 0x3724(%rip),%ymm8 # 67b4 <_sk_callback_avx+0x2b0> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8027,36 +7942,36 @@ _sk_parametric_g_avx LABEL PROC DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1 DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10 DB 197,124,91,217 ; vcvtdq2ps %ymm1,%ymm11 - DB 196,98,125,24,37,69,55,0,0 ; vbroadcastss 0x3745(%rip),%ymm12 # 6864 <_sk_callback_avx+0x2ae> + DB 196,98,125,24,37,213,54,0,0 ; vbroadcastss 0x36d5(%rip),%ymm12 # 67b8 <_sk_callback_avx+0x2b4> DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,59,55,0,0 ; vbroadcastss 0x373b(%rip),%ymm12 # 6868 <_sk_callback_avx+0x2b2> + DB 196,98,125,24,37,203,54,0,0 ; vbroadcastss 0x36cb(%rip),%ymm12 # 67bc <_sk_callback_avx+0x2b8> DB 196,193,116,84,204 ; vandps %ymm12,%ymm1,%ymm1 - DB 196,98,125,24,37,49,55,0,0 ; vbroadcastss 0x3731(%rip),%ymm12 # 686c <_sk_callback_avx+0x2b6> + DB 196,98,125,24,37,193,54,0,0 ; vbroadcastss 0x36c1(%rip),%ymm12 # 67c0 <_sk_callback_avx+0x2bc> DB 196,193,116,86,204 ; vorps %ymm12,%ymm1,%ymm1 - DB 196,98,125,24,37,39,55,0,0 ; vbroadcastss 0x3727(%rip),%ymm12 # 6870 <_sk_callback_avx+0x2ba> + DB 196,98,125,24,37,183,54,0,0 ; vbroadcastss 0x36b7(%rip),%ymm12 # 67c4 <_sk_callback_avx+0x2c0> DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,29,55,0,0 ; vbroadcastss 0x371d(%rip),%ymm12 # 6874 <_sk_callback_avx+0x2be> + DB 196,98,125,24,37,173,54,0,0 ; vbroadcastss 0x36ad(%rip),%ymm12 # 67c8 <_sk_callback_avx+0x2c4> DB 196,65,116,89,228 ; vmulps %ymm12,%ymm1,%ymm12 DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,14,55,0,0 ; vbroadcastss 0x370e(%rip),%ymm12 # 6878 <_sk_callback_avx+0x2c2> + DB 196,98,125,24,37,158,54,0,0 ; vbroadcastss 0x369e(%rip),%ymm12 # 67cc <_sk_callback_avx+0x2c8> DB 196,193,116,88,204 ; vaddps %ymm12,%ymm1,%ymm1 - DB 196,98,125,24,37,4,55,0,0 ; vbroadcastss 0x3704(%rip),%ymm12 # 687c <_sk_callback_avx+0x2c6> + DB 196,98,125,24,37,148,54,0,0 ; vbroadcastss 0x3694(%rip),%ymm12 # 67d0 <_sk_callback_avx+0x2cc> DB 197,156,94,201 ; vdivps %ymm1,%ymm12,%ymm1 DB 197,164,92,201 ; vsubps %ymm1,%ymm11,%ymm1 DB 197,172,89,201 ; vmulps %ymm1,%ymm10,%ymm1 DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10 DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10 - DB 196,98,125,24,29,232,54,0,0 ; vbroadcastss 0x36e8(%rip),%ymm11 # 6880 <_sk_callback_avx+0x2ca> + DB 196,98,125,24,29,120,54,0,0 ; vbroadcastss 0x3678(%rip),%ymm11 # 67d4 <_sk_callback_avx+0x2d0> DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,29,222,54,0,0 ; vbroadcastss 0x36de(%rip),%ymm11 # 6884 <_sk_callback_avx+0x2ce> + DB 196,98,125,24,29,110,54,0,0 ; vbroadcastss 0x366e(%rip),%ymm11 # 67d8 <_sk_callback_avx+0x2d4> DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11 DB 196,193,116,92,203 ; vsubps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,29,207,54,0,0 ; vbroadcastss 0x36cf(%rip),%ymm11 # 6888 <_sk_callback_avx+0x2d2> + DB 196,98,125,24,29,95,54,0,0 ; vbroadcastss 0x365f(%rip),%ymm11 # 67dc <_sk_callback_avx+0x2d8> DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 - DB 196,98,125,24,29,197,54,0,0 ; vbroadcastss 0x36c5(%rip),%ymm11 # 688c <_sk_callback_avx+0x2d6> + DB 196,98,125,24,29,85,54,0,0 ; vbroadcastss 0x3655(%rip),%ymm11 # 67e0 <_sk_callback_avx+0x2dc> DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10 DB 196,193,116,88,202 ; vaddps %ymm10,%ymm1,%ymm1 - DB 196,98,125,24,21,182,54,0,0 ; vbroadcastss 0x36b6(%rip),%ymm10 # 6890 <_sk_callback_avx+0x2da> + DB 196,98,125,24,21,70,54,0,0 ; vbroadcastss 0x3646(%rip),%ymm10 # 67e4 <_sk_callback_avx+0x2e0> DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1 DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -8064,7 +7979,7 @@ _sk_parametric_g_avx LABEL PROC DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1 - DB 196,98,125,24,5,141,54,0,0 ; vbroadcastss 0x368d(%rip),%ymm8 # 6894 <_sk_callback_avx+0x2de> + DB 196,98,125,24,5,29,54,0,0 ; vbroadcastss 0x361d(%rip),%ymm8 # 67e8 <_sk_callback_avx+0x2e4> DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8084,36 +7999,36 @@ _sk_parametric_b_avx LABEL PROC DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10 DB 197,124,91,218 ; vcvtdq2ps %ymm2,%ymm11 - DB 196,98,125,24,37,62,54,0,0 ; vbroadcastss 0x363e(%rip),%ymm12 # 6898 <_sk_callback_avx+0x2e2> + DB 196,98,125,24,37,206,53,0,0 ; vbroadcastss 0x35ce(%rip),%ymm12 # 67ec <_sk_callback_avx+0x2e8> DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,52,54,0,0 ; vbroadcastss 0x3634(%rip),%ymm12 # 689c <_sk_callback_avx+0x2e6> + DB 196,98,125,24,37,196,53,0,0 ; vbroadcastss 0x35c4(%rip),%ymm12 # 67f0 <_sk_callback_avx+0x2ec> DB 196,193,108,84,212 ; vandps %ymm12,%ymm2,%ymm2 - DB 196,98,125,24,37,42,54,0,0 ; vbroadcastss 0x362a(%rip),%ymm12 # 68a0 <_sk_callback_avx+0x2ea> + DB 196,98,125,24,37,186,53,0,0 ; vbroadcastss 0x35ba(%rip),%ymm12 # 67f4 <_sk_callback_avx+0x2f0> DB 196,193,108,86,212 ; vorps %ymm12,%ymm2,%ymm2 - DB 196,98,125,24,37,32,54,0,0 ; vbroadcastss 0x3620(%rip),%ymm12 # 68a4 <_sk_callback_avx+0x2ee> + DB 196,98,125,24,37,176,53,0,0 ; vbroadcastss 0x35b0(%rip),%ymm12 # 67f8 <_sk_callback_avx+0x2f4> DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,22,54,0,0 ; vbroadcastss 0x3616(%rip),%ymm12 # 68a8 <_sk_callback_avx+0x2f2> + DB 196,98,125,24,37,166,53,0,0 ; vbroadcastss 0x35a6(%rip),%ymm12 # 67fc <_sk_callback_avx+0x2f8> DB 196,65,108,89,228 ; vmulps %ymm12,%ymm2,%ymm12 DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,7,54,0,0 ; vbroadcastss 0x3607(%rip),%ymm12 # 68ac <_sk_callback_avx+0x2f6> + DB 196,98,125,24,37,151,53,0,0 ; vbroadcastss 0x3597(%rip),%ymm12 # 6800 <_sk_callback_avx+0x2fc> DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2 - DB 196,98,125,24,37,253,53,0,0 ; vbroadcastss 0x35fd(%rip),%ymm12 # 68b0 <_sk_callback_avx+0x2fa> + DB 196,98,125,24,37,141,53,0,0 ; vbroadcastss 0x358d(%rip),%ymm12 # 6804 <_sk_callback_avx+0x300> DB 197,156,94,210 ; vdivps %ymm2,%ymm12,%ymm2 DB 197,164,92,210 ; vsubps %ymm2,%ymm11,%ymm2 DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2 DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10 DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10 - DB 196,98,125,24,29,225,53,0,0 ; vbroadcastss 0x35e1(%rip),%ymm11 # 68b4 <_sk_callback_avx+0x2fe> + DB 196,98,125,24,29,113,53,0,0 ; vbroadcastss 0x3571(%rip),%ymm11 # 6808 <_sk_callback_avx+0x304> DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 - DB 196,98,125,24,29,215,53,0,0 ; vbroadcastss 0x35d7(%rip),%ymm11 # 68b8 <_sk_callback_avx+0x302> + DB 196,98,125,24,29,103,53,0,0 ; vbroadcastss 0x3567(%rip),%ymm11 # 680c <_sk_callback_avx+0x308> DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11 DB 196,193,108,92,211 ; vsubps %ymm11,%ymm2,%ymm2 - DB 196,98,125,24,29,200,53,0,0 ; vbroadcastss 0x35c8(%rip),%ymm11 # 68bc <_sk_callback_avx+0x306> + DB 196,98,125,24,29,88,53,0,0 ; vbroadcastss 0x3558(%rip),%ymm11 # 6810 <_sk_callback_avx+0x30c> DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 - DB 196,98,125,24,29,190,53,0,0 ; vbroadcastss 0x35be(%rip),%ymm11 # 68c0 <_sk_callback_avx+0x30a> + DB 196,98,125,24,29,78,53,0,0 ; vbroadcastss 0x354e(%rip),%ymm11 # 6814 <_sk_callback_avx+0x310> DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10 DB 196,193,108,88,210 ; vaddps %ymm10,%ymm2,%ymm2 - DB 196,98,125,24,21,175,53,0,0 ; vbroadcastss 0x35af(%rip),%ymm10 # 68c4 <_sk_callback_avx+0x30e> + DB 196,98,125,24,21,63,53,0,0 ; vbroadcastss 0x353f(%rip),%ymm10 # 6818 <_sk_callback_avx+0x314> DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2 DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -8121,7 +8036,7 @@ _sk_parametric_b_avx LABEL PROC DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,134,53,0,0 ; vbroadcastss 0x3586(%rip),%ymm8 # 68c8 <_sk_callback_avx+0x312> + DB 196,98,125,24,5,22,53,0,0 ; vbroadcastss 0x3516(%rip),%ymm8 # 681c <_sk_callback_avx+0x318> DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8141,36 +8056,36 @@ _sk_parametric_a_avx LABEL PROC DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3 DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10 DB 197,124,91,219 ; vcvtdq2ps %ymm3,%ymm11 - DB 196,98,125,24,37,55,53,0,0 ; vbroadcastss 0x3537(%rip),%ymm12 # 68cc <_sk_callback_avx+0x316> + DB 196,98,125,24,37,199,52,0,0 ; vbroadcastss 0x34c7(%rip),%ymm12 # 6820 <_sk_callback_avx+0x31c> DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,45,53,0,0 ; vbroadcastss 0x352d(%rip),%ymm12 # 68d0 <_sk_callback_avx+0x31a> + DB 196,98,125,24,37,189,52,0,0 ; vbroadcastss 0x34bd(%rip),%ymm12 # 6824 <_sk_callback_avx+0x320> DB 196,193,100,84,220 ; vandps %ymm12,%ymm3,%ymm3 - DB 196,98,125,24,37,35,53,0,0 ; vbroadcastss 0x3523(%rip),%ymm12 # 68d4 <_sk_callback_avx+0x31e> + DB 196,98,125,24,37,179,52,0,0 ; vbroadcastss 0x34b3(%rip),%ymm12 # 6828 <_sk_callback_avx+0x324> DB 196,193,100,86,220 ; vorps %ymm12,%ymm3,%ymm3 - DB 196,98,125,24,37,25,53,0,0 ; vbroadcastss 0x3519(%rip),%ymm12 # 68d8 <_sk_callback_avx+0x322> + DB 196,98,125,24,37,169,52,0,0 ; vbroadcastss 0x34a9(%rip),%ymm12 # 682c <_sk_callback_avx+0x328> DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,15,53,0,0 ; vbroadcastss 0x350f(%rip),%ymm12 # 68dc <_sk_callback_avx+0x326> + DB 196,98,125,24,37,159,52,0,0 ; vbroadcastss 0x349f(%rip),%ymm12 # 6830 <_sk_callback_avx+0x32c> DB 196,65,100,89,228 ; vmulps %ymm12,%ymm3,%ymm12 DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11 - DB 196,98,125,24,37,0,53,0,0 ; vbroadcastss 0x3500(%rip),%ymm12 # 68e0 <_sk_callback_avx+0x32a> + DB 196,98,125,24,37,144,52,0,0 ; vbroadcastss 0x3490(%rip),%ymm12 # 6834 <_sk_callback_avx+0x330> DB 196,193,100,88,220 ; vaddps %ymm12,%ymm3,%ymm3 - DB 196,98,125,24,37,246,52,0,0 ; vbroadcastss 0x34f6(%rip),%ymm12 # 68e4 <_sk_callback_avx+0x32e> + DB 196,98,125,24,37,134,52,0,0 ; vbroadcastss 0x3486(%rip),%ymm12 # 6838 <_sk_callback_avx+0x334> DB 197,156,94,219 ; vdivps %ymm3,%ymm12,%ymm3 DB 197,164,92,219 ; vsubps %ymm3,%ymm11,%ymm3 DB 197,172,89,219 ; vmulps %ymm3,%ymm10,%ymm3 DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10 DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10 - DB 196,98,125,24,29,218,52,0,0 ; vbroadcastss 0x34da(%rip),%ymm11 # 68e8 <_sk_callback_avx+0x332> + DB 196,98,125,24,29,106,52,0,0 ; vbroadcastss 0x346a(%rip),%ymm11 # 683c <_sk_callback_avx+0x338> DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3 - DB 196,98,125,24,29,208,52,0,0 ; vbroadcastss 0x34d0(%rip),%ymm11 # 68ec <_sk_callback_avx+0x336> + DB 196,98,125,24,29,96,52,0,0 ; vbroadcastss 0x3460(%rip),%ymm11 # 6840 <_sk_callback_avx+0x33c> DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11 DB 196,193,100,92,219 ; vsubps %ymm11,%ymm3,%ymm3 - DB 196,98,125,24,29,193,52,0,0 ; vbroadcastss 0x34c1(%rip),%ymm11 # 68f0 <_sk_callback_avx+0x33a> + DB 196,98,125,24,29,81,52,0,0 ; vbroadcastss 0x3451(%rip),%ymm11 # 6844 <_sk_callback_avx+0x340> DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10 - DB 196,98,125,24,29,183,52,0,0 ; vbroadcastss 0x34b7(%rip),%ymm11 # 68f4 <_sk_callback_avx+0x33e> + DB 196,98,125,24,29,71,52,0,0 ; vbroadcastss 0x3447(%rip),%ymm11 # 6848 <_sk_callback_avx+0x344> DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10 DB 196,193,100,88,218 ; vaddps %ymm10,%ymm3,%ymm3 - DB 196,98,125,24,21,168,52,0,0 ; vbroadcastss 0x34a8(%rip),%ymm10 # 68f8 <_sk_callback_avx+0x342> + DB 196,98,125,24,21,56,52,0,0 ; vbroadcastss 0x3438(%rip),%ymm10 # 684c <_sk_callback_avx+0x348> DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3 DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3 DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10 @@ -8178,38 +8093,38 @@ _sk_parametric_a_avx LABEL PROC DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3 DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3 - DB 196,98,125,24,5,127,52,0,0 ; vbroadcastss 0x347f(%rip),%ymm8 # 68fc <_sk_callback_avx+0x346> + DB 196,98,125,24,5,15,52,0,0 ; vbroadcastss 0x340f(%rip),%ymm8 # 6850 <_sk_callback_avx+0x34c> DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax PUBLIC _sk_lab_to_xyz_avx _sk_lab_to_xyz_avx LABEL PROC - DB 196,98,125,24,5,113,52,0,0 ; vbroadcastss 0x3471(%rip),%ymm8 # 6900 <_sk_callback_avx+0x34a> + DB 196,98,125,24,5,1,52,0,0 ; vbroadcastss 0x3401(%rip),%ymm8 # 6854 <_sk_callback_avx+0x350> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,5,103,52,0,0 ; vbroadcastss 0x3467(%rip),%ymm8 # 6904 <_sk_callback_avx+0x34e> + DB 196,98,125,24,5,247,51,0,0 ; vbroadcastss 0x33f7(%rip),%ymm8 # 6858 <_sk_callback_avx+0x354> DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 - DB 196,98,125,24,13,93,52,0,0 ; vbroadcastss 0x345d(%rip),%ymm9 # 6908 <_sk_callback_avx+0x352> + DB 196,98,125,24,13,237,51,0,0 ; vbroadcastss 0x33ed(%rip),%ymm9 # 685c <_sk_callback_avx+0x358> DB 196,193,116,88,201 ; vaddps %ymm9,%ymm1,%ymm1 DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 196,193,108,88,209 ; vaddps %ymm9,%ymm2,%ymm2 - DB 196,98,125,24,5,73,52,0,0 ; vbroadcastss 0x3449(%rip),%ymm8 # 690c <_sk_callback_avx+0x356> + DB 196,98,125,24,5,217,51,0,0 ; vbroadcastss 0x33d9(%rip),%ymm8 # 6860 <_sk_callback_avx+0x35c> DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,5,63,52,0,0 ; vbroadcastss 0x343f(%rip),%ymm8 # 6910 <_sk_callback_avx+0x35a> + DB 196,98,125,24,5,207,51,0,0 ; vbroadcastss 0x33cf(%rip),%ymm8 # 6864 <_sk_callback_avx+0x360> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,5,53,52,0,0 ; vbroadcastss 0x3435(%rip),%ymm8 # 6914 <_sk_callback_avx+0x35e> + DB 196,98,125,24,5,197,51,0,0 ; vbroadcastss 0x33c5(%rip),%ymm8 # 6868 <_sk_callback_avx+0x364> DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1 DB 197,252,88,201 ; vaddps %ymm1,%ymm0,%ymm1 - DB 196,98,125,24,5,39,52,0,0 ; vbroadcastss 0x3427(%rip),%ymm8 # 6918 <_sk_callback_avx+0x362> + DB 196,98,125,24,5,183,51,0,0 ; vbroadcastss 0x33b7(%rip),%ymm8 # 686c <_sk_callback_avx+0x368> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 197,252,92,210 ; vsubps %ymm2,%ymm0,%ymm2 DB 197,116,89,193 ; vmulps %ymm1,%ymm1,%ymm8 DB 196,65,116,89,192 ; vmulps %ymm8,%ymm1,%ymm8 - DB 196,98,125,24,13,16,52,0,0 ; vbroadcastss 0x3410(%rip),%ymm9 # 691c <_sk_callback_avx+0x366> + DB 196,98,125,24,13,160,51,0,0 ; vbroadcastss 0x33a0(%rip),%ymm9 # 6870 <_sk_callback_avx+0x36c> DB 196,65,52,194,208,1 ; vcmpltps %ymm8,%ymm9,%ymm10 - DB 196,98,125,24,29,5,52,0,0 ; vbroadcastss 0x3405(%rip),%ymm11 # 6920 <_sk_callback_avx+0x36a> + DB 196,98,125,24,29,149,51,0,0 ; vbroadcastss 0x3395(%rip),%ymm11 # 6874 <_sk_callback_avx+0x370> DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1 - DB 196,98,125,24,37,251,51,0,0 ; vbroadcastss 0x33fb(%rip),%ymm12 # 6924 <_sk_callback_avx+0x36e> + DB 196,98,125,24,37,139,51,0,0 ; vbroadcastss 0x338b(%rip),%ymm12 # 6878 <_sk_callback_avx+0x374> DB 196,193,116,89,204 ; vmulps %ymm12,%ymm1,%ymm1 DB 196,67,117,74,192,160 ; vblendvps %ymm10,%ymm8,%ymm1,%ymm8 DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1 @@ -8224,9 +8139,9 @@ _sk_lab_to_xyz_avx LABEL PROC DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 DB 196,193,108,89,212 ; vmulps %ymm12,%ymm2,%ymm2 DB 196,227,109,74,208,144 ; vblendvps %ymm9,%ymm0,%ymm2,%ymm2 - DB 196,226,125,24,5,177,51,0,0 ; vbroadcastss 0x33b1(%rip),%ymm0 # 6928 <_sk_callback_avx+0x372> + DB 196,226,125,24,5,65,51,0,0 ; vbroadcastss 0x3341(%rip),%ymm0 # 687c <_sk_callback_avx+0x378> DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0 - DB 196,98,125,24,5,168,51,0,0 ; vbroadcastss 0x33a8(%rip),%ymm8 # 692c <_sk_callback_avx+0x376> + DB 196,98,125,24,5,56,51,0,0 ; vbroadcastss 0x3338(%rip),%ymm8 # 6880 <_sk_callback_avx+0x37c> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8238,14 +8153,14 @@ _sk_load_a8_avx LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,62 ; jne 35db <_sk_load_a8_avx+0x4e> + DB 117,62 ; jne 359f <_sk_load_a8_avx+0x4e> DB 197,250,126,0 ; vmovq (%rax),%xmm0 DB 196,226,121,49,200 ; vpmovzxbd %xmm0,%xmm1 DB 196,227,121,4,192,229 ; vpermilps $0xe5,%xmm0,%xmm0 DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,108,51,0,0 ; vbroadcastss 0x336c(%rip),%ymm1 # 6930 <_sk_callback_avx+0x37a> + DB 196,226,125,24,13,252,50,0,0 ; vbroadcastss 0x32fc(%rip),%ymm1 # 6884 <_sk_callback_avx+0x380> DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 @@ -8263,83 +8178,73 @@ _sk_load_a8_avx LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 35e4 <_sk_load_a8_avx+0x57> + DB 117,235 ; jne 35a8 <_sk_load_a8_avx+0x57> DB 196,193,249,110,194 ; vmovq %r10,%xmm0 DB 91 ; pop %rbx - DB 235,160 ; jmp 35a1 <_sk_load_a8_avx+0x14> + DB 235,160 ; jmp 3565 <_sk_load_a8_avx+0x14> PUBLIC _sk_gather_a8_avx _sk_gather_a8_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 - DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 - DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1 - DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3 - DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 + DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 + DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2 + DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2 + DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,131,121,32,4,57,0 ; vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0 - DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0 - DB 67,15,182,28,41 ; movzbl (%r9,%r13,1),%ebx - DB 196,227,121,32,195,2 ; vpinsrb $0x2,%ebx,%xmm0,%xmm0 - DB 67,15,182,28,33 ; movzbl (%r9,%r12,1),%ebx - DB 196,227,121,32,195,3 ; vpinsrb $0x3,%ebx,%xmm0,%xmm0 - DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 - DB 196,131,121,32,12,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1 - DB 196,131,113,32,12,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1 - DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx - DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,20,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,105,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1 + DB 68,137,216 ; mov %r11d,%eax DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,2 ; vpinsrb $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,20,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,105,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm0 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,121,32,192,2 ; vpinsrb $0x2,%eax,%xmm0,%xmm0 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1 - DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0 + DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 + DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,94,50,0,0 ; vbroadcastss 0x325e(%rip),%ymm1 # 6934 <_sk_callback_avx+0x37e> + DB 196,226,125,24,13,247,49,0,0 ; vbroadcastss 0x31f7(%rip),%ymm1 # 6888 <_sk_callback_avx+0x384> DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2 - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_store_a8_avx _sk_store_a8_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,55,50,0,0 ; vbroadcastss 0x3237(%rip),%ymm8 # 6938 <_sk_callback_avx+0x382> + DB 196,98,125,24,5,217,49,0,0 ; vbroadcastss 0x31d9(%rip),%ymm8 # 688c <_sk_callback_avx+0x388> DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8 DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8 DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 196,65,57,103,192 ; vpackuswb %xmm8,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 372a <_sk_store_a8_avx+0x37> + DB 117,10 ; jne 36dc <_sk_store_a8_avx+0x37> DB 196,65,123,17,4,19 ; vmovsd %xmm8,(%r11,%rdx,1) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8347,10 +8252,10 @@ _sk_store_a8_avx LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 3726 <_sk_store_a8_avx+0x33> + DB 119,236 ; ja 36d8 <_sk_store_a8_avx+0x33> DB 196,66,121,48,192 ; vpmovzxbw %xmm8,%xmm8 DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 378c <_sk_store_a8_avx+0x99> + DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3740 <_sk_store_a8_avx+0x9b> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -8361,26 +8266,28 @@ _sk_store_a8_avx LABEL PROC DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1) DB 196,67,121,20,68,19,1,2 ; vpextrb $0x2,%xmm8,0x1(%r11,%rdx,1) DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1) - DB 235,154 ; jmp 3726 <_sk_store_a8_avx+0x33> - DB 247,255 ; idiv %edi + DB 235,154 ; jmp 36d8 <_sk_store_a8_avx+0x33> + DB 102,144 ; xchg %ax,%ax + DB 245 ; cmc DB 255 ; (bad) DB 255 ; (bad) - DB 239 ; out %eax,(%dx) DB 255 ; (bad) + DB 237 ; in (%dx),%eax DB 255 ; (bad) - DB 255,231 ; jmpq *%rdi DB 255 ; (bad) + DB 255,229 ; jmpq *%rbp DB 255 ; (bad) DB 255 ; (bad) - DB 223,255 ; (bad) DB 255 ; (bad) - DB 255,215 ; callq *%rdi + DB 221,255 ; (bad) DB 255 ; (bad) + DB 255,213 ; callq *%rbp DB 255 ; (bad) - DB 255,207 ; dec %edi DB 255 ; (bad) + DB 255,205 ; dec %ebp DB 255 ; (bad) - DB 255,199 ; inc %edi + DB 255 ; (bad) + DB 255,197 ; inc %ebp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -8392,17 +8299,17 @@ _sk_load_g8_avx LABEL PROC DB 72,139,0 ; mov (%rax),%rax DB 72,1,208 ; add %rdx,%rax DB 77,133,192 ; test %r8,%r8 - DB 117,67 ; jne 37fb <_sk_load_g8_avx+0x53> + DB 117,67 ; jne 37af <_sk_load_g8_avx+0x53> DB 197,250,126,0 ; vmovq (%rax),%xmm0 DB 196,226,121,49,200 ; vpmovzxbd %xmm0,%xmm1 DB 196,227,121,4,192,229 ; vpermilps $0xe5,%xmm0,%xmm0 DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,93,49,0,0 ; vbroadcastss 0x315d(%rip),%ymm1 # 693c <_sk_callback_avx+0x386> + DB 196,226,125,24,13,253,48,0,0 ; vbroadcastss 0x30fd(%rip),%ymm1 # 6890 <_sk_callback_avx+0x38c> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,82,49,0,0 ; vbroadcastss 0x3152(%rip),%ymm3 # 6940 <_sk_callback_avx+0x38a> + DB 196,226,125,24,29,242,48,0,0 ; vbroadcastss 0x30f2(%rip),%ymm3 # 6894 <_sk_callback_avx+0x390> DB 76,137,201 ; mov %r9,%rcx DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 DB 197,252,40,208 ; vmovaps %ymm0,%ymm2 @@ -8417,69 +8324,59 @@ _sk_load_g8_avx LABEL PROC DB 73,9,218 ; or %rbx,%r10 DB 72,131,193,8 ; add $0x8,%rcx DB 73,255,203 ; dec %r11 - DB 117,235 ; jne 3804 <_sk_load_g8_avx+0x5c> + DB 117,235 ; jne 37b8 <_sk_load_g8_avx+0x5c> DB 196,193,249,110,194 ; vmovq %r10,%xmm0 DB 91 ; pop %rbx - DB 235,155 ; jmp 37bc <_sk_load_g8_avx+0x14> + DB 235,155 ; jmp 3770 <_sk_load_g8_avx+0x14> PUBLIC _sk_gather_g8_avx _sk_gather_g8_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 - DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 - DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1 - DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3 - DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 + DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 + DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2 + DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2 + DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,131,121,32,4,57,0 ; vpinsrb $0x0,(%r9,%r15,1),%xmm0,%xmm0 - DB 196,195,121,32,4,25,1 ; vpinsrb $0x1,(%r9,%rbx,1),%xmm0,%xmm0 - DB 67,15,182,28,41 ; movzbl (%r9,%r13,1),%ebx - DB 196,227,121,32,195,2 ; vpinsrb $0x2,%ebx,%xmm0,%xmm0 - DB 67,15,182,28,33 ; movzbl (%r9,%r12,1),%ebx - DB 196,227,121,32,195,3 ; vpinsrb $0x3,%ebx,%xmm0,%xmm0 - DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 - DB 196,131,121,32,12,49,0 ; vpinsrb $0x0,(%r9,%r14,1),%xmm0,%xmm1 - DB 196,131,113,32,12,25,1 ; vpinsrb $0x1,(%r9,%r11,1),%xmm1,%xmm1 - DB 67,15,182,28,17 ; movzbl (%r9,%r10,1),%ebx - DB 196,227,113,32,203,2 ; vpinsrb $0x2,%ebx,%xmm1,%xmm1 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,20,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,105,32,12,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm1 + DB 68,137,216 ; mov %r11d,%eax DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,113,32,200,2 ; vpinsrb $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,227,113,32,200,3 ; vpinsrb $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,32,20,1,0 ; vpinsrb $0x0,(%r9,%rax,1),%xmm0,%xmm2 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,105,32,4,17,1 ; vpinsrb $0x1,(%r9,%r10,1),%xmm2,%xmm0 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,182,4,1 ; movzbl (%r9,%rax,1),%eax + DB 196,227,121,32,192,2 ; vpinsrb $0x2,%eax,%xmm0,%xmm0 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,182,4,25 ; movzbl (%r9,%r11,1),%eax DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1 - DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + DB 196,227,121,32,192,3 ; vpinsrb $0x3,%eax,%xmm0,%xmm0 + DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 + DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,78,48,0,0 ; vbroadcastss 0x304e(%rip),%ymm1 # 6944 <_sk_callback_avx+0x38e> + DB 196,226,125,24,13,247,47,0,0 ; vbroadcastss 0x2ff7(%rip),%ymm1 # 6898 <_sk_callback_avx+0x394> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,67,48,0,0 ; vbroadcastss 0x3043(%rip),%ymm3 # 6948 <_sk_callback_avx+0x392> + DB 196,226,125,24,29,236,47,0,0 ; vbroadcastss 0x2fec(%rip),%ymm3 # 689c <_sk_callback_avx+0x398> DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 DB 197,252,40,208 ; vmovaps %ymm0,%ymm2 - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_gather_i8_avx @@ -8487,15 +8384,10 @@ _sk_gather_i8_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,137,193 ; mov %rax,%r9 DB 77,133,201 ; test %r9,%r9 - DB 116,5 ; je 3927 <_sk_gather_i8_avx+0xf> + DB 116,5 ; je 38c9 <_sk_gather_i8_avx+0xf> DB 76,137,200 ; mov %r9,%rax - DB 235,2 ; jmp 3929 <_sk_gather_i8_avx+0x11> + DB 235,2 ; jmp 38cb <_sk_gather_i8_avx+0x11> DB 72,173 ; lods %ds:(%rsi),%rax - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 DB 83 ; push %rbx DB 76,139,16 ; mov (%rax),%r10 DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 @@ -8507,55 +8399,55 @@ _sk_gather_i8_avx LABEL PROC DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 + DB 196,193,249,126,211 ; vmovq %xmm2,%r11 + DB 68,137,216 ; mov %r11d,%eax + DB 196,195,121,32,28,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3 DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,131,97,32,20,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm3,%xmm2 DB 65,137,195 ; mov %eax,%r11d DB 72,193,232,32 ; shr $0x20,%rax - DB 196,225,249,126,211 ; vmovq %xmm2,%rbx - DB 65,137,222 ; mov %ebx,%r14d - DB 72,193,235,32 ; shr $0x20,%rbx DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,193,249,126,199 ; vmovq %xmm0,%r15 - DB 69,137,252 ; mov %r15d,%r12d - DB 196,195,249,22,197,1 ; vpextrq $0x1,%xmm0,%r13 - DB 68,137,237 ; mov %r13d,%ebp - DB 73,193,237,32 ; shr $0x20,%r13 - DB 73,193,239,32 ; shr $0x20,%r15 - DB 196,131,121,32,4,50,0 ; vpinsrb $0x0,(%r10,%r14,1),%xmm0,%xmm0 - DB 196,195,121,32,4,26,1 ; vpinsrb $0x1,(%r10,%rbx,1),%xmm0,%xmm0 - DB 196,131,121,32,4,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm0,%xmm0 - DB 196,195,121,32,4,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm0,%xmm0 - DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 - DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 - DB 196,193,249,126,198 ; vmovq %xmm0,%r14 - DB 196,131,121,32,4,34,0 ; vpinsrb $0x0,(%r10,%r12,1),%xmm0,%xmm0 - DB 196,131,121,32,4,58,1 ; vpinsrb $0x1,(%r10,%r15,1),%xmm0,%xmm0 - DB 196,195,121,32,4,42,2 ; vpinsrb $0x2,(%r10,%rbp,1),%xmm0,%xmm0 - DB 196,131,121,32,4,42,3 ; vpinsrb $0x3,(%r10,%r13,1),%xmm0,%xmm0 + DB 196,131,105,32,12,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm2,%xmm1 + DB 196,193,249,126,195 ; vmovq %xmm0,%r11 + DB 196,195,113,32,12,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1 + DB 68,137,216 ; mov %r11d,%eax + DB 196,195,121,32,20,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2 + DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx + DB 73,193,235,32 ; shr $0x20,%r11 + DB 196,131,105,32,4,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm2,%xmm0 + DB 137,216 ; mov %ebx,%eax + DB 196,195,121,32,4,2,2 ; vpinsrb $0x2,(%r10,%rax,1),%xmm0,%xmm0 + DB 72,193,235,32 ; shr $0x20,%rbx + DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1 + DB 196,195,121,32,4,26,3 ; vpinsrb $0x3,(%r10,%rbx,1),%xmm0,%xmm0 DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0 - DB 73,139,105,8 ; mov 0x8(%r9),%rbp - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,217 ; mov %ebx,%r9d + DB 77,139,89,8 ; mov 0x8(%r9),%r11 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 69,137,209 ; mov %r10d,%r9d + DB 73,193,234,30 ; shr $0x1e,%r10 + DB 196,129,121,110,20,139 ; vmovd (%r11,%r9,4),%xmm2 + DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx + DB 196,131,105,34,4,19,1 ; vpinsrd $0x1,(%r11,%r10,1),%xmm2,%xmm0 + DB 137,216 ; mov %ebx,%eax + DB 196,195,121,34,4,131,2 ; vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0 + DB 196,225,249,126,200 ; vmovq %xmm1,%rax DB 72,193,235,30 ; shr $0x1e,%rbx - DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax - DB 65,137,194 ; mov %eax,%r10d + DB 196,67,121,34,4,27,3 ; vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm8 + DB 137,195 ; mov %eax,%ebx + DB 196,193,121,110,4,155 ; vmovd (%r11,%rbx,4),%xmm0 + DB 196,227,249,22,203,1 ; vpextrq $0x1,%xmm1,%rbx DB 72,193,232,30 ; shr $0x1e,%rax - DB 69,137,247 ; mov %r14d,%r15d - DB 73,193,238,30 ; shr $0x1e,%r14 - DB 69,137,220 ; mov %r11d,%r12d - DB 73,193,235,30 ; shr $0x1e,%r11 - DB 196,161,121,110,68,141,0 ; vmovd 0x0(%rbp,%r9,4),%xmm0 - DB 196,227,121,34,68,29,0,1 ; vpinsrd $0x1,0x0(%rbp,%rbx,1),%xmm0,%xmm0 - DB 196,163,121,34,68,149,0,2 ; vpinsrd $0x2,0x0(%rbp,%r10,4),%xmm0,%xmm0 - DB 196,99,121,34,68,5,0,3 ; vpinsrd $0x3,0x0(%rbp,%rax,1),%xmm0,%xmm8 - DB 196,161,121,110,68,189,0 ; vmovd 0x0(%rbp,%r15,4),%xmm0 - DB 196,163,121,34,68,53,0,1 ; vpinsrd $0x1,0x0(%rbp,%r14,1),%xmm0,%xmm0 - DB 196,163,121,34,68,165,0,2 ; vpinsrd $0x2,0x0(%rbp,%r12,4),%xmm0,%xmm0 - DB 196,163,121,34,92,29,0,3 ; vpinsrd $0x3,0x0(%rbp,%r11,1),%xmm0,%xmm3 + DB 196,195,121,34,4,3,1 ; vpinsrd $0x1,(%r11,%rax,1),%xmm0,%xmm0 + DB 137,216 ; mov %ebx,%eax + DB 196,195,121,34,4,131,2 ; vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0 + DB 72,193,235,30 ; shr $0x1e,%rbx + DB 196,195,121,34,28,27,3 ; vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm3 DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0 - DB 197,124,40,21,164,49,0,0 ; vmovaps 0x31a4(%rip),%ymm10 # 6c00 <_sk_callback_avx+0x64a> + DB 197,124,40,21,87,49,0,0 ; vmovaps 0x3157(%rip),%ymm10 # 6b40 <_sk_callback_avx+0x63c> DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,13,222,46,0,0 ; vbroadcastss 0x2ede(%rip),%ymm9 # 694c <_sk_callback_avx+0x396> + DB 196,98,125,24,13,165,46,0,0 ; vbroadcastss 0x2ea5(%rip),%ymm9 # 68a0 <_sk_callback_avx+0x39c> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1 DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2 @@ -8576,11 +8468,6 @@ _sk_gather_i8_avx LABEL PROC DB 196,193,100,89,217 ; vmulps %ymm9,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax PUBLIC _sk_load_565_avx @@ -8588,38 +8475,38 @@ _sk_load_565_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,128,0,0,0 ; jne 3b67 <_sk_load_565_avx+0x8e> + DB 15,133,128,0,0,0 ; jne 3aeb <_sk_load_565_avx+0x8e> DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0 DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1 DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2 - DB 196,226,125,24,5,71,46,0,0 ; vbroadcastss 0x2e47(%rip),%ymm0 # 6950 <_sk_callback_avx+0x39a> + DB 196,226,125,24,5,23,46,0,0 ; vbroadcastss 0x2e17(%rip),%ymm0 # 68a4 <_sk_callback_avx+0x3a0> DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,58,46,0,0 ; vbroadcastss 0x2e3a(%rip),%ymm1 # 6954 <_sk_callback_avx+0x39e> + DB 196,226,125,24,13,10,46,0,0 ; vbroadcastss 0x2e0a(%rip),%ymm1 # 68a8 <_sk_callback_avx+0x3a4> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,24,13,49,46,0,0 ; vbroadcastss 0x2e31(%rip),%ymm1 # 6958 <_sk_callback_avx+0x3a2> + DB 196,226,125,24,13,1,46,0,0 ; vbroadcastss 0x2e01(%rip),%ymm1 # 68ac <_sk_callback_avx+0x3a8> DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,29,36,46,0,0 ; vbroadcastss 0x2e24(%rip),%ymm3 # 695c <_sk_callback_avx+0x3a6> + DB 196,226,125,24,29,244,45,0,0 ; vbroadcastss 0x2df4(%rip),%ymm3 # 68b0 <_sk_callback_avx+0x3ac> DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1 - DB 196,226,125,24,29,27,46,0,0 ; vbroadcastss 0x2e1b(%rip),%ymm3 # 6960 <_sk_callback_avx+0x3aa> + DB 196,226,125,24,29,235,45,0,0 ; vbroadcastss 0x2deb(%rip),%ymm3 # 68b4 <_sk_callback_avx+0x3b0> DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,226,125,24,29,14,46,0,0 ; vbroadcastss 0x2e0e(%rip),%ymm3 # 6964 <_sk_callback_avx+0x3ae> + DB 196,226,125,24,29,222,45,0,0 ; vbroadcastss 0x2dde(%rip),%ymm3 # 68b8 <_sk_callback_avx+0x3b4> DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,3,46,0,0 ; vbroadcastss 0x2e03(%rip),%ymm3 # 6968 <_sk_callback_avx+0x3b2> + DB 196,226,125,24,29,211,45,0,0 ; vbroadcastss 0x2dd3(%rip),%ymm3 # 68bc <_sk_callback_avx+0x3b8> DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,7 ; and $0x7,%r9b DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,110,255,255,255 ; ja 3aed <_sk_load_565_avx+0x14> + DB 15,135,110,255,255,255 ; ja 3a71 <_sk_load_565_avx+0x14> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 3bd4 <_sk_load_565_avx+0xfb> + DB 76,141,21,74,0,0,0 ; lea 0x4a(%rip),%r10 # 3b58 <_sk_load_565_avx+0xfb> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -8631,12 +8518,12 @@ _sk_load_565_avx LABEL PROC DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - DB 233,26,255,255,255 ; jmpq 3aed <_sk_load_565_avx+0x14> + DB 233,26,255,255,255 ; jmpq 3a71 <_sk_load_565_avx+0x14> DB 144 ; nop DB 243,255 ; repz (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 235,255 ; jmp 3bd9 <_sk_load_565_avx+0x100> + DB 235,255 ; jmp 3b5d <_sk_load_565_avx+0x100> DB 255 ; (bad) DB 255,227 ; jmpq *%rbx DB 255 ; (bad) @@ -8658,93 +8545,81 @@ _sk_load_565_avx LABEL PROC PUBLIC _sk_gather_565_avx _sk_gather_565_avx LABEL PROC - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 - DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 - DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1 - DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3 - DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 + DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 + DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2 + DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2 + DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 72,193,235,32 ; shr $0x20,%rbx - DB 65,15,183,28,89 ; movzwl (%r9,%rbx,2),%ebx - DB 67,15,183,44,121 ; movzwl (%r9,%r15,2),%ebp - DB 197,249,110,197 ; vmovd %ebp,%xmm0 - DB 197,249,196,195,1 ; vpinsrw $0x1,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,105 ; movzwl (%r9,%r13,2),%ebx - DB 197,249,196,195,2 ; vpinsrw $0x2,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,97 ; movzwl (%r9,%r12,2),%ebx - DB 197,249,196,195,3 ; vpinsrw $0x3,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,113 ; movzwl (%r9,%r14,2),%ebx - DB 197,249,196,195,4 ; vpinsrw $0x4,%ebx,%xmm0,%xmm0 - DB 67,15,183,44,89 ; movzwl (%r9,%r11,2),%ebp - DB 197,249,196,197,5 ; vpinsrw $0x5,%ebp,%xmm0,%xmm0 - DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp - DB 197,249,196,197,6 ; vpinsrw $0x6,%ebp,%xmm0,%xmm0 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,110,208 ; vmovd %eax,%xmm2 + DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,233,196,200,1 ; vpinsrw $0x1,%eax,%xmm2,%xmm1 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,2 ; vpinsrw $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax + DB 197,241,196,200,3 ; vpinsrw $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,4 ; vpinsrw $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,192,5 ; vpinsrw $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0 DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1 DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2 - DB 196,226,125,24,5,160,44,0,0 ; vbroadcastss 0x2ca0(%rip),%ymm0 # 696c <_sk_callback_avx+0x3b6> + DB 196,226,125,24,5,122,44,0,0 ; vbroadcastss 0x2c7a(%rip),%ymm0 # 68c0 <_sk_callback_avx+0x3bc> DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,147,44,0,0 ; vbroadcastss 0x2c93(%rip),%ymm1 # 6970 <_sk_callback_avx+0x3ba> + DB 196,226,125,24,13,109,44,0,0 ; vbroadcastss 0x2c6d(%rip),%ymm1 # 68c4 <_sk_callback_avx+0x3c0> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,24,13,138,44,0,0 ; vbroadcastss 0x2c8a(%rip),%ymm1 # 6974 <_sk_callback_avx+0x3be> + DB 196,226,125,24,13,100,44,0,0 ; vbroadcastss 0x2c64(%rip),%ymm1 # 68c8 <_sk_callback_avx+0x3c4> DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,29,125,44,0,0 ; vbroadcastss 0x2c7d(%rip),%ymm3 # 6978 <_sk_callback_avx+0x3c2> + DB 196,226,125,24,29,87,44,0,0 ; vbroadcastss 0x2c57(%rip),%ymm3 # 68cc <_sk_callback_avx+0x3c8> DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1 - DB 196,226,125,24,29,116,44,0,0 ; vbroadcastss 0x2c74(%rip),%ymm3 # 697c <_sk_callback_avx+0x3c6> + DB 196,226,125,24,29,78,44,0,0 ; vbroadcastss 0x2c4e(%rip),%ymm3 # 68d0 <_sk_callback_avx+0x3cc> DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,226,125,24,29,103,44,0,0 ; vbroadcastss 0x2c67(%rip),%ymm3 # 6980 <_sk_callback_avx+0x3ca> + DB 196,226,125,24,29,65,44,0,0 ; vbroadcastss 0x2c41(%rip),%ymm3 # 68d4 <_sk_callback_avx+0x3d0> DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,92,44,0,0 ; vbroadcastss 0x2c5c(%rip),%ymm3 # 6984 <_sk_callback_avx+0x3ce> - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp + DB 196,226,125,24,29,54,44,0,0 ; vbroadcastss 0x2c36(%rip),%ymm3 # 68d8 <_sk_callback_avx+0x3d4> DB 255,224 ; jmpq *%rax PUBLIC _sk_store_565_avx _sk_store_565_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,70,44,0,0 ; vbroadcastss 0x2c46(%rip),%ymm8 # 6988 <_sk_callback_avx+0x3d2> + DB 196,98,125,24,5,42,44,0,0 ; vbroadcastss 0x2c2a(%rip),%ymm8 # 68dc <_sk_callback_avx+0x3d8> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,193,41,114,241,11 ; vpslld $0xb,%xmm9,%xmm10 DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9 DB 196,193,49,114,241,11 ; vpslld $0xb,%xmm9,%xmm9 DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 - DB 196,98,125,24,21,31,44,0,0 ; vbroadcastss 0x2c1f(%rip),%ymm10 # 698c <_sk_callback_avx+0x3d6> + DB 196,98,125,24,21,3,44,0,0 ; vbroadcastss 0x2c03(%rip),%ymm10 # 68e0 <_sk_callback_avx+0x3dc> DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10 DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10 DB 196,193,33,114,242,5 ; vpslld $0x5,%xmm10,%xmm11 @@ -8758,7 +8633,7 @@ _sk_store_565_avx LABEL PROC DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3dbd <_sk_store_565_avx+0x89> + DB 117,10 ; jne 3d2d <_sk_store_565_avx+0x89> DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8766,9 +8641,9 @@ _sk_store_565_avx LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 3db9 <_sk_store_565_avx+0x85> + DB 119,236 ; ja 3d29 <_sk_store_565_avx+0x85> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3e1c <_sk_store_565_avx+0xe8> + DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 3d8c <_sk_store_565_avx+0xe8> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -8779,7 +8654,7 @@ _sk_store_565_avx LABEL PROC DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2) - DB 235,159 ; jmp 3db9 <_sk_store_565_avx+0x85> + DB 235,159 ; jmp 3d29 <_sk_store_565_avx+0x85> DB 102,144 ; xchg %ax,%ax DB 245 ; cmc DB 255 ; (bad) @@ -8810,31 +8685,31 @@ _sk_load_4444_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,152,0,0,0 ; jne 3ede <_sk_load_4444_avx+0xa6> + DB 15,133,152,0,0,0 ; jne 3e4e <_sk_load_4444_avx+0xa6> DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0 DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1 DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3 - DB 196,226,125,24,5,40,43,0,0 ; vbroadcastss 0x2b28(%rip),%ymm0 # 6990 <_sk_callback_avx+0x3da> + DB 196,226,125,24,5,12,43,0,0 ; vbroadcastss 0x2b0c(%rip),%ymm0 # 68e4 <_sk_callback_avx+0x3e0> DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,27,43,0,0 ; vbroadcastss 0x2b1b(%rip),%ymm1 # 6994 <_sk_callback_avx+0x3de> + DB 196,226,125,24,13,255,42,0,0 ; vbroadcastss 0x2aff(%rip),%ymm1 # 68e8 <_sk_callback_avx+0x3e4> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,24,13,18,43,0,0 ; vbroadcastss 0x2b12(%rip),%ymm1 # 6998 <_sk_callback_avx+0x3e2> + DB 196,226,125,24,13,246,42,0,0 ; vbroadcastss 0x2af6(%rip),%ymm1 # 68ec <_sk_callback_avx+0x3e8> DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,21,5,43,0,0 ; vbroadcastss 0x2b05(%rip),%ymm2 # 699c <_sk_callback_avx+0x3e6> + DB 196,226,125,24,21,233,42,0,0 ; vbroadcastss 0x2ae9(%rip),%ymm2 # 68f0 <_sk_callback_avx+0x3ec> DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1 - DB 196,226,125,24,21,252,42,0,0 ; vbroadcastss 0x2afc(%rip),%ymm2 # 69a0 <_sk_callback_avx+0x3ea> + DB 196,226,125,24,21,224,42,0,0 ; vbroadcastss 0x2ae0(%rip),%ymm2 # 68f4 <_sk_callback_avx+0x3f0> DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,98,125,24,5,239,42,0,0 ; vbroadcastss 0x2aef(%rip),%ymm8 # 69a4 <_sk_callback_avx+0x3ee> + DB 196,98,125,24,5,211,42,0,0 ; vbroadcastss 0x2ad3(%rip),%ymm8 # 68f8 <_sk_callback_avx+0x3f4> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,229,42,0,0 ; vbroadcastss 0x2ae5(%rip),%ymm8 # 69a8 <_sk_callback_avx+0x3f2> + DB 196,98,125,24,5,201,42,0,0 ; vbroadcastss 0x2ac9(%rip),%ymm8 # 68fc <_sk_callback_avx+0x3f8> DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,215,42,0,0 ; vbroadcastss 0x2ad7(%rip),%ymm8 # 69ac <_sk_callback_avx+0x3f6> + DB 196,98,125,24,5,187,42,0,0 ; vbroadcastss 0x2abb(%rip),%ymm8 # 6900 <_sk_callback_avx+0x3fc> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -8843,9 +8718,9 @@ _sk_load_4444_avx LABEL PROC DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,86,255,255,255 ; ja 3e4c <_sk_load_4444_avx+0x14> + DB 15,135,86,255,255,255 ; ja 3dbc <_sk_load_4444_avx+0x14> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 3f4c <_sk_load_4444_avx+0x114> + DB 76,141,21,75,0,0,0 ; lea 0x4b(%rip),%r10 # 3ebc <_sk_load_4444_avx+0x114> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -8857,7 +8732,7 @@ _sk_load_4444_avx LABEL PROC DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,68,83,2,1 ; vpinsrw $0x1,0x2(%r11,%rdx,2),%xmm0,%xmm0 DB 196,193,121,196,4,83,0 ; vpinsrw $0x0,(%r11,%rdx,2),%xmm0,%xmm0 - DB 233,2,255,255,255 ; jmpq 3e4c <_sk_load_4444_avx+0x14> + DB 233,2,255,255,255 ; jmpq 3dbc <_sk_load_4444_avx+0x14> DB 102,144 ; xchg %ax,%ax DB 242,255 ; repnz (bad) DB 255 ; (bad) @@ -8885,90 +8760,78 @@ _sk_load_4444_avx LABEL PROC PUBLIC _sk_gather_4444_avx _sk_gather_4444_avx LABEL PROC - DB 85 ; push %rbp - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 - DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 - DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1 - DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3 - DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 + DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 + DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2 + DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2 + DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 72,193,235,32 ; shr $0x20,%rbx - DB 65,15,183,28,89 ; movzwl (%r9,%rbx,2),%ebx - DB 67,15,183,44,121 ; movzwl (%r9,%r15,2),%ebp - DB 197,249,110,197 ; vmovd %ebp,%xmm0 - DB 197,249,196,195,1 ; vpinsrw $0x1,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,105 ; movzwl (%r9,%r13,2),%ebx - DB 197,249,196,195,2 ; vpinsrw $0x2,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,97 ; movzwl (%r9,%r12,2),%ebx - DB 197,249,196,195,3 ; vpinsrw $0x3,%ebx,%xmm0,%xmm0 - DB 67,15,183,28,113 ; movzwl (%r9,%r14,2),%ebx - DB 197,249,196,195,4 ; vpinsrw $0x4,%ebx,%xmm0,%xmm0 - DB 67,15,183,44,89 ; movzwl (%r9,%r11,2),%ebp - DB 197,249,196,197,5 ; vpinsrw $0x5,%ebp,%xmm0,%xmm0 - DB 67,15,183,44,81 ; movzwl (%r9,%r10,2),%ebp - DB 197,249,196,197,6 ; vpinsrw $0x6,%ebp,%xmm0,%xmm0 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,110,208 ; vmovd %eax,%xmm2 + DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,233,196,200,1 ; vpinsrw $0x1,%eax,%xmm2,%xmm1 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,2 ; vpinsrw $0x2,%eax,%xmm1,%xmm1 + DB 196,193,249,126,194 ; vmovq %xmm0,%r10 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax + DB 197,241,196,200,3 ; vpinsrw $0x3,%eax,%xmm1,%xmm1 + DB 68,137,208 ; mov %r10d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,241,196,200,4 ; vpinsrw $0x4,%eax,%xmm1,%xmm1 + DB 196,195,249,22,195,1 ; vpextrq $0x1,%xmm0,%r11 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 67,15,183,4,81 ; movzwl (%r9,%r10,2),%eax + DB 197,241,196,192,5 ; vpinsrw $0x5,%eax,%xmm1,%xmm0 + DB 68,137,216 ; mov %r11d,%eax + DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax + DB 197,249,196,192,6 ; vpinsrw $0x6,%eax,%xmm0,%xmm0 + DB 73,193,235,32 ; shr $0x20,%r11 + DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0 DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1 DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3 - DB 196,226,125,24,5,108,41,0,0 ; vbroadcastss 0x296c(%rip),%ymm0 # 69b0 <_sk_callback_avx+0x3fa> + DB 196,226,125,24,5,90,41,0,0 ; vbroadcastss 0x295a(%rip),%ymm0 # 6904 <_sk_callback_avx+0x400> DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,226,125,24,13,95,41,0,0 ; vbroadcastss 0x295f(%rip),%ymm1 # 69b4 <_sk_callback_avx+0x3fe> + DB 196,226,125,24,13,77,41,0,0 ; vbroadcastss 0x294d(%rip),%ymm1 # 6908 <_sk_callback_avx+0x404> DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0 - DB 196,226,125,24,13,86,41,0,0 ; vbroadcastss 0x2956(%rip),%ymm1 # 69b8 <_sk_callback_avx+0x402> + DB 196,226,125,24,13,68,41,0,0 ; vbroadcastss 0x2944(%rip),%ymm1 # 690c <_sk_callback_avx+0x408> DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1 DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1 - DB 196,226,125,24,21,73,41,0,0 ; vbroadcastss 0x2949(%rip),%ymm2 # 69bc <_sk_callback_avx+0x406> + DB 196,226,125,24,21,55,41,0,0 ; vbroadcastss 0x2937(%rip),%ymm2 # 6910 <_sk_callback_avx+0x40c> DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1 - DB 196,226,125,24,21,64,41,0,0 ; vbroadcastss 0x2940(%rip),%ymm2 # 69c0 <_sk_callback_avx+0x40a> + DB 196,226,125,24,21,46,41,0,0 ; vbroadcastss 0x292e(%rip),%ymm2 # 6914 <_sk_callback_avx+0x410> DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2 DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 - DB 196,98,125,24,5,51,41,0,0 ; vbroadcastss 0x2933(%rip),%ymm8 # 69c4 <_sk_callback_avx+0x40e> + DB 196,98,125,24,5,33,41,0,0 ; vbroadcastss 0x2921(%rip),%ymm8 # 6918 <_sk_callback_avx+0x414> DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2 - DB 196,98,125,24,5,41,41,0,0 ; vbroadcastss 0x2929(%rip),%ymm8 # 69c8 <_sk_callback_avx+0x412> + DB 196,98,125,24,5,23,41,0,0 ; vbroadcastss 0x2917(%rip),%ymm8 # 691c <_sk_callback_avx+0x418> DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3 DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 - DB 196,98,125,24,5,27,41,0,0 ; vbroadcastss 0x291b(%rip),%ymm8 # 69cc <_sk_callback_avx+0x416> + DB 196,98,125,24,5,9,41,0,0 ; vbroadcastss 0x2909(%rip),%ymm8 # 6920 <_sk_callback_avx+0x41c> DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 - DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax PUBLIC _sk_store_4444_avx _sk_store_4444_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 - DB 196,98,125,24,5,254,40,0,0 ; vbroadcastss 0x28fe(%rip),%ymm8 # 69d0 <_sk_callback_avx+0x41a> + DB 196,98,125,24,5,246,40,0,0 ; vbroadcastss 0x28f6(%rip),%ymm8 # 6924 <_sk_callback_avx+0x420> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,193,41,114,241,12 ; vpslld $0xc,%xmm9,%xmm10 @@ -8995,7 +8858,7 @@ _sk_store_4444_avx LABEL PROC DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9 DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 416b <_sk_store_4444_avx+0xa7> + DB 117,10 ; jne 40c7 <_sk_store_4444_avx+0xa7> DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -9003,9 +8866,9 @@ _sk_store_4444_avx LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 4167 <_sk_store_4444_avx+0xa3> + DB 119,236 ; ja 40c3 <_sk_store_4444_avx+0xa3> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 41c8 <_sk_store_4444_avx+0x104> + DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 4124 <_sk_store_4444_avx+0x104> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -9016,7 +8879,7 @@ _sk_store_4444_avx LABEL PROC DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2) DB 196,67,121,21,68,83,2,1 ; vpextrw $0x1,%xmm8,0x2(%r11,%rdx,2) DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2) - DB 235,159 ; jmp 4167 <_sk_store_4444_avx+0xa3> + DB 235,159 ; jmp 40c3 <_sk_store_4444_avx+0xa3> DB 247,255 ; idiv %edi DB 255 ; (bad) DB 255 ; (bad) @@ -9048,12 +8911,12 @@ _sk_load_8888_avx LABEL PROC DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,139,0,0,0 ; jne 4289 <_sk_load_8888_avx+0xa5> + DB 15,133,139,0,0,0 ; jne 41e5 <_sk_load_8888_avx+0xa5> DB 196,193,124,16,26 ; vmovups (%r10),%ymm3 - DB 197,124,40,21,21,42,0,0 ; vmovaps 0x2a15(%rip),%ymm10 # 6c20 <_sk_callback_avx+0x66a> + DB 197,124,40,21,249,41,0,0 ; vmovaps 0x29f9(%rip),%ymm10 # 6b60 <_sk_callback_avx+0x65c> DB 196,193,100,84,194 ; vandps %ymm10,%ymm3,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,5,183,39,0,0 ; vbroadcastss 0x27b7(%rip),%ymm8 # 69d4 <_sk_callback_avx+0x41e> + DB 196,98,125,24,5,175,39,0,0 ; vbroadcastss 0x27af(%rip),%ymm8 # 6928 <_sk_callback_avx+0x424> DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0 DB 197,241,114,211,8 ; vpsrld $0x8,%xmm3,%xmm1 DB 196,195,125,25,217,1 ; vextractf128 $0x1,%ymm3,%xmm9 @@ -9084,21 +8947,16 @@ _sk_load_8888_avx LABEL PROC DB 72,211,232 ; shr %cl,%rax DB 196,225,249,110,192 ; vmovq %rax,%xmm0 DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0 - DB 196,226,121,0,13,191,40,0,0 ; vpshufb 0x28bf(%rip),%xmm0,%xmm1 # 6b70 <_sk_callback_avx+0x5ba> + DB 196,226,121,0,13,179,40,0,0 ; vpshufb 0x28b3(%rip),%xmm0,%xmm1 # 6ac0 <_sk_callback_avx+0x5bc> DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1 - DB 196,226,121,0,5,193,40,0,0 ; vpshufb 0x28c1(%rip),%xmm0,%xmm0 # 6b80 <_sk_callback_avx+0x5ca> + DB 196,226,121,0,5,181,40,0,0 ; vpshufb 0x28b5(%rip),%xmm0,%xmm0 # 6ad0 <_sk_callback_avx+0x5cc> DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0 DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0 DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3 - DB 233,47,255,255,255 ; jmpq 4203 <_sk_load_8888_avx+0x1f> + DB 233,47,255,255,255 ; jmpq 415f <_sk_load_8888_avx+0x1f> PUBLIC _sk_gather_8888_avx _sk_gather_8888_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 @@ -9107,35 +8965,35 @@ _sk_gather_8888_avx LABEL PROC DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,194,1 ; vextractf128 $0x1,%ymm0,%xmm2 - DB 197,241,254,202 ; vpaddd %xmm2,%xmm1,%xmm1 - DB 196,225,249,126,200 ; vmovq %xmm1,%rax - DB 65,137,194 ; mov %eax,%r10d - DB 72,193,232,32 ; shr $0x20,%rax + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 + DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,193,249,126,202 ; vmovq %xmm1,%r10 + DB 68,137,208 ; mov %r10d,%eax + DB 196,193,121,110,20,129 ; vmovd (%r9,%rax,4),%xmm2 DB 196,195,249,22,203,1 ; vpextrq $0x1,%xmm1,%r11 - DB 69,137,222 ; mov %r11d,%r14d + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,105,34,12,145,1 ; vpinsrd $0x1,(%r9,%r10,4),%xmm2,%xmm1 + DB 68,137,216 ; mov %r11d,%eax + DB 196,195,113,34,12,129,2 ; vpinsrd $0x2,(%r9,%rax,4),%xmm1,%xmm1 + DB 196,225,249,126,192 ; vmovq %xmm0,%rax DB 73,193,235,32 ; shr $0x20,%r11 - DB 197,225,254,192 ; vpaddd %xmm0,%xmm3,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 72,193,235,32 ; shr $0x20,%rbx - DB 73,193,236,32 ; shr $0x20,%r12 - DB 196,129,121,110,4,185 ; vmovd (%r9,%r15,4),%xmm0 - DB 196,195,121,34,4,153,1 ; vpinsrd $0x1,(%r9,%rbx,4),%xmm0,%xmm0 - DB 196,131,121,34,4,169,2 ; vpinsrd $0x2,(%r9,%r13,4),%xmm0,%xmm0 - DB 196,3,121,34,4,161,3 ; vpinsrd $0x3,(%r9,%r12,4),%xmm0,%xmm8 - DB 196,129,121,110,4,145 ; vmovd (%r9,%r10,4),%xmm0 - DB 196,195,121,34,4,129,1 ; vpinsrd $0x1,(%r9,%rax,4),%xmm0,%xmm0 - DB 196,131,121,34,4,177,2 ; vpinsrd $0x2,(%r9,%r14,4),%xmm0,%xmm0 - DB 196,131,121,34,28,153,3 ; vpinsrd $0x3,(%r9,%r11,4),%xmm0,%xmm3 + DB 196,3,113,34,4,153,3 ; vpinsrd $0x3,(%r9,%r11,4),%xmm1,%xmm8 + DB 65,137,194 ; mov %eax,%r10d + DB 72,193,232,32 ; shr $0x20,%rax + DB 196,129,121,110,12,145 ; vmovd (%r9,%r10,4),%xmm1 + DB 196,195,249,22,194,1 ; vpextrq $0x1,%xmm0,%r10 + DB 196,195,113,34,4,129,1 ; vpinsrd $0x1,(%r9,%rax,4),%xmm1,%xmm0 + DB 68,137,208 ; mov %r10d,%eax + DB 196,195,121,34,4,129,2 ; vpinsrd $0x2,(%r9,%rax,4),%xmm0,%xmm0 + DB 73,193,234,32 ; shr $0x20,%r10 + DB 196,131,121,34,28,145,3 ; vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3 DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0 - DB 197,124,40,21,184,40,0,0 ; vmovaps 0x28b8(%rip),%ymm10 # 6c40 <_sk_callback_avx+0x68a> + DB 197,124,40,21,165,40,0,0 ; vmovaps 0x28a5(%rip),%ymm10 # 6b80 <_sk_callback_avx+0x67c> DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,13,62,38,0,0 ; vbroadcastss 0x263e(%rip),%ymm9 # 69d8 <_sk_callback_avx+0x422> + DB 196,98,125,24,13,63,38,0,0 ; vbroadcastss 0x263f(%rip),%ymm9 # 692c <_sk_callback_avx+0x428> DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0 DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1 DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2 @@ -9155,11 +9013,6 @@ _sk_gather_8888_avx LABEL PROC DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3 DB 196,193,100,89,217 ; vmulps %ymm9,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 DB 255,224 ; jmpq *%rax PUBLIC _sk_store_8888_avx @@ -9169,7 +9022,7 @@ _sk_store_8888_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 76,3,16 ; add (%rax),%r10 - DB 196,98,125,24,5,190,37,0,0 ; vbroadcastss 0x25be(%rip),%ymm8 # 69dc <_sk_callback_avx+0x426> + DB 196,98,125,24,5,200,37,0,0 ; vbroadcastss 0x25c8(%rip),%ymm8 # 6930 <_sk_callback_avx+0x42c> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10 @@ -9194,7 +9047,7 @@ _sk_store_8888_avx LABEL PROC DB 196,65,45,86,192 ; vorpd %ymm8,%ymm10,%ymm8 DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8 DB 77,133,192 ; test %r8,%r8 - DB 117,14 ; jne 44b0 <_sk_store_8888_avx+0xac> + DB 117,14 ; jne 43fa <_sk_store_8888_avx+0xac> DB 196,65,124,17,2 ; vmovups %ymm8,(%r10) DB 72,173 ; lods %ds:(%rsi),%rax DB 76,137,201 ; mov %r9,%rcx @@ -9207,13 +9060,13 @@ _sk_store_8888_avx LABEL PROC DB 72,211,232 ; shr %cl,%rax DB 196,97,249,110,200 ; vmovq %rax,%xmm9 DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9 - DB 196,98,49,0,21,184,38,0,0 ; vpshufb 0x26b8(%rip),%xmm9,%xmm10 # 6b90 <_sk_callback_avx+0x5da> + DB 196,98,49,0,21,190,38,0,0 ; vpshufb 0x26be(%rip),%xmm9,%xmm10 # 6ae0 <_sk_callback_avx+0x5dc> DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10 - DB 196,98,49,0,13,186,38,0,0 ; vpshufb 0x26ba(%rip),%xmm9,%xmm9 # 6ba0 <_sk_callback_avx+0x5ea> + DB 196,98,49,0,13,192,38,0,0 ; vpshufb 0x26c0(%rip),%xmm9,%xmm9 # 6af0 <_sk_callback_avx+0x5ec> DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9 DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10) - DB 235,175 ; jmp 44a7 <_sk_store_8888_avx+0xa3> + DB 235,175 ; jmp 43f1 <_sk_store_8888_avx+0xa3> PUBLIC _sk_load_f16_avx _sk_load_f16_avx LABEL PROC @@ -9225,7 +9078,7 @@ _sk_load_f16_avx LABEL PROC DB 197,252,17,116,36,64 ; vmovups %ymm6,0x40(%rsp) DB 197,252,17,108,36,32 ; vmovups %ymm5,0x20(%rsp) DB 197,254,127,36,36 ; vmovdqu %ymm4,(%rsp) - DB 15,133,143,2,0,0 ; jne 47b3 <_sk_load_f16_avx+0x2bb> + DB 15,133,143,2,0,0 ; jne 46fd <_sk_load_f16_avx+0x2bb> DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8 DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2 DB 197,249,16,76,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm1 @@ -9243,13 +9096,13 @@ _sk_load_f16_avx LABEL PROC DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 - DB 196,98,125,24,37,99,36,0,0 ; vbroadcastss 0x2463(%rip),%ymm12 # 69e0 <_sk_callback_avx+0x42a> + DB 196,98,125,24,37,109,36,0,0 ; vbroadcastss 0x246d(%rip),%ymm12 # 6934 <_sk_callback_avx+0x430> DB 196,193,124,84,204 ; vandps %ymm12,%ymm0,%ymm1 DB 197,252,87,193 ; vxorps %ymm1,%ymm0,%ymm0 DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14 - DB 196,98,121,24,29,79,36,0,0 ; vbroadcastss 0x244f(%rip),%xmm11 # 69e4 <_sk_callback_avx+0x42e> + DB 196,98,121,24,29,89,36,0,0 ; vbroadcastss 0x2459(%rip),%xmm11 # 6938 <_sk_callback_avx+0x434> DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3 - DB 196,98,121,24,45,69,36,0,0 ; vbroadcastss 0x2445(%rip),%xmm13 # 69e8 <_sk_callback_avx+0x432> + DB 196,98,121,24,45,79,36,0,0 ; vbroadcastss 0x244f(%rip),%xmm13 # 693c <_sk_callback_avx+0x438> DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3 DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10 DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10 @@ -9263,7 +9116,7 @@ _sk_load_f16_avx LABEL PROC DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0 DB 197,252,86,193 ; vorps %ymm1,%ymm0,%ymm0 DB 196,227,125,25,193,1 ; vextractf128 $0x1,%ymm0,%xmm1 - DB 196,226,121,24,29,251,35,0,0 ; vbroadcastss 0x23fb(%rip),%xmm3 # 69ec <_sk_callback_avx+0x436> + DB 196,226,121,24,29,5,36,0,0 ; vbroadcastss 0x2405(%rip),%xmm3 # 6940 <_sk_callback_avx+0x43c> DB 197,241,254,203 ; vpaddd %xmm3,%xmm1,%xmm1 DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0 DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 @@ -9356,118 +9209,114 @@ _sk_load_f16_avx LABEL PROC DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,79 ; je 4812 <_sk_load_f16_avx+0x31a> + DB 116,79 ; je 475c <_sk_load_f16_avx+0x31a> DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,67 ; jb 4812 <_sk_load_f16_avx+0x31a> + DB 114,67 ; jb 475c <_sk_load_f16_avx+0x31a> DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,68 ; je 481f <_sk_load_f16_avx+0x327> + DB 116,68 ; je 4769 <_sk_load_f16_avx+0x327> DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,56 ; jb 481f <_sk_load_f16_avx+0x327> + DB 114,56 ; jb 4769 <_sk_load_f16_avx+0x327> DB 197,251,16,76,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm1 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,68,253,255,255 ; je 453b <_sk_load_f16_avx+0x43> + DB 15,132,68,253,255,255 ; je 4485 <_sk_load_f16_avx+0x43> DB 197,241,22,76,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,52,253,255,255 ; jb 453b <_sk_load_f16_avx+0x43> + DB 15,130,52,253,255,255 ; jb 4485 <_sk_load_f16_avx+0x43> DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9 - DB 233,41,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43> + DB 233,41,253,255,255 ; jmpq 4485 <_sk_load_f16_avx+0x43> DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,28,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43> + DB 233,28,253,255,255 ; jmpq 4485 <_sk_load_f16_avx+0x43> DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1 - DB 233,19,253,255,255 ; jmpq 453b <_sk_load_f16_avx+0x43> + DB 233,19,253,255,255 ; jmpq 4485 <_sk_load_f16_avx+0x43> PUBLIC _sk_gather_f16_avx _sk_gather_f16_avx LABEL PROC - DB 65,87 ; push %r15 - DB 65,86 ; push %r14 - DB 65,85 ; push %r13 - DB 65,84 ; push %r12 - DB 83 ; push %rbx - DB 72,129,236,144,0,0,0 ; sub $0x90,%rsp + DB 72,129,236,152,0,0,0 ; sub $0x98,%rsp DB 197,252,17,124,36,96 ; vmovups %ymm7,0x60(%rsp) DB 197,252,17,116,36,64 ; vmovups %ymm6,0x40(%rsp) DB 197,252,17,108,36,32 ; vmovups %ymm5,0x20(%rsp) DB 197,254,127,36,36 ; vmovdqu %ymm4,(%rsp) DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 - DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2 - DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1 - DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3 - DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2 - DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0 - DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3 - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 - DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax + DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1 + DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2 + DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2 + DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 196,226,105,64,201 ; vpmulld %xmm1,%xmm2,%xmm1 + DB 197,254,91,208 ; vcvttps2dq %ymm0,%ymm2 + DB 196,227,125,25,208,1 ; vextractf128 $0x1,%ymm2,%xmm0 + DB 197,113,254,192 ; vpaddd %xmm0,%xmm1,%xmm8 + DB 197,225,254,202 ; vpaddd %xmm2,%xmm3,%xmm1 + DB 196,225,249,126,200 ; vmovq %xmm1,%rax DB 65,137,194 ; mov %eax,%r10d DB 72,193,232,32 ; shr $0x20,%rax - DB 196,193,249,126,211 ; vmovq %xmm2,%r11 - DB 69,137,222 ; mov %r11d,%r14d - DB 73,193,235,32 ; shr $0x20,%r11 - DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0 - DB 196,225,249,126,195 ; vmovq %xmm0,%rbx - DB 65,137,223 ; mov %ebx,%r15d - DB 196,195,249,22,196,1 ; vpextrq $0x1,%xmm0,%r12 - DB 69,137,229 ; mov %r12d,%r13d - DB 73,193,236,32 ; shr $0x20,%r12 - DB 72,193,235,32 ; shr $0x20,%rbx - DB 196,193,122,126,4,217 ; vmovq (%r9,%rbx,8),%xmm0 - DB 196,129,122,126,12,249 ; vmovq (%r9,%r15,8),%xmm1 - DB 197,113,108,200 ; vpunpcklqdq %xmm0,%xmm1,%xmm9 - DB 196,129,122,126,12,225 ; vmovq (%r9,%r12,8),%xmm1 - DB 196,129,122,126,20,233 ; vmovq (%r9,%r13,8),%xmm2 - DB 197,233,108,201 ; vpunpcklqdq %xmm1,%xmm2,%xmm1 - DB 196,129,122,126,20,217 ; vmovq (%r9,%r11,8),%xmm2 - DB 196,129,122,126,28,241 ; vmovq (%r9,%r14,8),%xmm3 - DB 197,97,108,210 ; vpunpcklqdq %xmm2,%xmm3,%xmm10 - DB 196,65,122,126,4,193 ; vmovq (%r9,%rax,8),%xmm8 - DB 196,129,122,126,28,209 ; vmovq (%r9,%r10,8),%xmm3 - DB 196,193,97,108,216 ; vpunpcklqdq %xmm8,%xmm3,%xmm3 - DB 197,177,97,193 ; vpunpcklwd %xmm1,%xmm9,%xmm0 - DB 197,177,105,201 ; vpunpckhwd %xmm1,%xmm9,%xmm1 - DB 197,169,97,211 ; vpunpcklwd %xmm3,%xmm10,%xmm2 - DB 197,169,105,219 ; vpunpckhwd %xmm3,%xmm10,%xmm3 - DB 197,121,97,249 ; vpunpcklwd %xmm1,%xmm0,%xmm15 - DB 197,121,105,193 ; vpunpckhwd %xmm1,%xmm0,%xmm8 - DB 197,233,97,203 ; vpunpcklwd %xmm3,%xmm2,%xmm1 - DB 197,105,105,203 ; vpunpckhwd %xmm3,%xmm2,%xmm9 - DB 197,129,108,193 ; vpunpcklqdq %xmm1,%xmm15,%xmm0 - DB 197,233,239,210 ; vpxor %xmm2,%xmm2,%xmm2 - DB 197,249,105,210 ; vpunpckhwd %xmm2,%xmm0,%xmm2 + DB 196,65,122,126,12,193 ; vmovq (%r9,%rax,8),%xmm9 + DB 196,227,249,22,200,1 ; vpextrq $0x1,%xmm1,%rax + DB 196,1,122,126,20,209 ; vmovq (%r9,%r10,8),%xmm10 + DB 65,137,194 ; mov %eax,%r10d + DB 72,193,232,32 ; shr $0x20,%rax + DB 196,65,122,126,28,193 ; vmovq (%r9,%rax,8),%xmm11 + DB 196,97,249,126,192 ; vmovq %xmm8,%rax + DB 196,1,122,126,36,209 ; vmovq (%r9,%r10,8),%xmm12 + DB 65,137,194 ; mov %eax,%r10d + DB 72,193,232,32 ; shr $0x20,%rax + DB 196,65,122,126,44,193 ; vmovq (%r9,%rax,8),%xmm13 + DB 196,67,249,22,195,1 ; vpextrq $0x1,%xmm8,%r11 + DB 196,1,122,126,4,209 ; vmovq (%r9,%r10,8),%xmm8 + DB 76,137,216 ; mov %r11,%rax + DB 72,193,232,32 ; shr $0x20,%rax + DB 196,65,122,126,52,193 ; vmovq (%r9,%rax,8),%xmm14 + DB 68,137,216 ; mov %r11d,%eax + DB 196,193,122,126,4,193 ; vmovq (%r9,%rax,8),%xmm0 + DB 196,193,41,108,209 ; vpunpcklqdq %xmm9,%xmm10,%xmm2 + DB 196,193,25,108,203 ; vpunpcklqdq %xmm11,%xmm12,%xmm1 + DB 196,193,57,108,221 ; vpunpcklqdq %xmm13,%xmm8,%xmm3 + DB 196,193,121,108,198 ; vpunpcklqdq %xmm14,%xmm0,%xmm0 + DB 197,105,97,193 ; vpunpcklwd %xmm1,%xmm2,%xmm8 + DB 197,233,105,209 ; vpunpckhwd %xmm1,%xmm2,%xmm2 + DB 197,225,97,200 ; vpunpcklwd %xmm0,%xmm3,%xmm1 + DB 197,225,105,192 ; vpunpckhwd %xmm0,%xmm3,%xmm0 + DB 197,57,97,250 ; vpunpcklwd %xmm2,%xmm8,%xmm15 + DB 197,57,105,194 ; vpunpckhwd %xmm2,%xmm8,%xmm8 + DB 197,241,97,208 ; vpunpcklwd %xmm0,%xmm1,%xmm2 + DB 197,113,105,200 ; vpunpckhwd %xmm0,%xmm1,%xmm9 + DB 197,129,108,194 ; vpunpcklqdq %xmm2,%xmm15,%xmm0 + DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1 + DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1 DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 - DB 196,227,125,24,194,1 ; vinsertf128 $0x1,%xmm2,%ymm0,%ymm0 - DB 196,98,125,24,37,185,32,0,0 ; vbroadcastss 0x20b9(%rip),%ymm12 # 69f0 <_sk_callback_avx+0x43a> - DB 196,193,124,84,212 ; vandps %ymm12,%ymm0,%ymm2 - DB 197,252,87,194 ; vxorps %ymm2,%ymm0,%ymm0 + DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 + DB 196,98,125,24,37,198,32,0,0 ; vbroadcastss 0x20c6(%rip),%ymm12 # 6944 <_sk_callback_avx+0x440> + DB 196,193,124,84,204 ; vandps %ymm12,%ymm0,%ymm1 + DB 197,252,87,193 ; vxorps %ymm1,%ymm0,%ymm0 DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14 - DB 196,98,121,24,29,165,32,0,0 ; vbroadcastss 0x20a5(%rip),%xmm11 # 69f4 <_sk_callback_avx+0x43e> + DB 196,98,121,24,29,178,32,0,0 ; vbroadcastss 0x20b2(%rip),%xmm11 # 6948 <_sk_callback_avx+0x444> DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3 - DB 196,98,121,24,45,155,32,0,0 ; vbroadcastss 0x209b(%rip),%xmm13 # 69f8 <_sk_callback_avx+0x442> + DB 196,98,121,24,45,168,32,0,0 ; vbroadcastss 0x20a8(%rip),%xmm13 # 694c <_sk_callback_avx+0x448> DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3 DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10 DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10 DB 196,99,45,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm10,%ymm10 - DB 197,225,114,242,16 ; vpslld $0x10,%xmm2,%xmm3 - DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2 - DB 197,233,114,242,16 ; vpslld $0x10,%xmm2,%xmm2 - DB 196,227,101,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm3,%ymm2 + DB 197,225,114,241,16 ; vpslld $0x10,%xmm1,%xmm3 + DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1 + DB 197,241,114,241,16 ; vpslld $0x10,%xmm1,%xmm1 + DB 196,227,101,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm3,%ymm1 DB 197,249,114,240,13 ; vpslld $0xd,%xmm0,%xmm0 DB 196,193,97,114,246,13 ; vpslld $0xd,%xmm14,%xmm3 DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0 - DB 197,252,86,194 ; vorps %ymm2,%ymm0,%ymm0 - DB 196,227,125,25,194,1 ; vextractf128 $0x1,%ymm0,%xmm2 - DB 196,226,121,24,29,81,32,0,0 ; vbroadcastss 0x2051(%rip),%xmm3 # 69fc <_sk_callback_avx+0x446> - DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2 + DB 197,252,86,193 ; vorps %ymm1,%ymm0,%ymm0 + DB 196,227,125,25,193,1 ; vextractf128 $0x1,%ymm0,%xmm1 + DB 196,226,121,24,29,94,32,0,0 ; vbroadcastss 0x205e(%rip),%xmm3 # 6950 <_sk_callback_avx+0x44c> + DB 197,241,254,203 ; vpaddd %xmm3,%xmm1,%xmm1 DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0 - DB 196,227,125,24,194,1 ; vinsertf128 $0x1,%xmm2,%ymm0,%ymm0 + DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 DB 196,65,12,87,246 ; vxorps %ymm14,%ymm14,%ymm14 DB 196,195,125,74,198,160 ; vblendvps %ymm10,%ymm14,%ymm0,%ymm0 - DB 197,129,109,201 ; vpunpckhqdq %xmm1,%xmm15,%xmm1 + DB 197,129,109,202 ; vpunpckhqdq %xmm2,%xmm15,%xmm1 DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4 DB 197,241,105,212 ; vpunpckhwd %xmm4,%xmm1,%xmm2 DB 196,226,121,51,201 ; vpmovzxwd %xmm1,%xmm1 @@ -9549,12 +9398,7 @@ _sk_gather_f16_avx LABEL PROC DB 197,252,16,108,36,32 ; vmovups 0x20(%rsp),%ymm5 DB 197,252,16,116,36,64 ; vmovups 0x40(%rsp),%ymm6 DB 197,252,16,124,36,96 ; vmovups 0x60(%rsp),%ymm7 - DB 72,129,196,144,0,0,0 ; add $0x90,%rsp - DB 91 ; pop %rbx - DB 65,92 ; pop %r12 - DB 65,93 ; pop %r13 - DB 65,94 ; pop %r14 - DB 65,95 ; pop %r15 + DB 72,129,196,152,0,0,0 ; add $0x98,%rsp DB 255,224 ; jmpq *%rax PUBLIC _sk_store_f16_avx @@ -9564,12 +9408,12 @@ _sk_store_f16_avx LABEL PROC DB 197,252,17,180,36,128,0,0,0 ; vmovups %ymm6,0x80(%rsp) DB 197,252,17,108,36,96 ; vmovups %ymm5,0x60(%rsp) DB 197,252,17,100,36,64 ; vmovups %ymm4,0x40(%rsp) - DB 196,98,125,24,13,92,30,0,0 ; vbroadcastss 0x1e5c(%rip),%ymm9 # 6a00 <_sk_callback_avx+0x44a> + DB 196,98,125,24,13,114,30,0,0 ; vbroadcastss 0x1e72(%rip),%ymm9 # 6954 <_sk_callback_avx+0x450> DB 196,65,124,84,209 ; vandps %ymm9,%ymm0,%ymm10 DB 197,252,17,4,36 ; vmovups %ymm0,(%rsp) DB 196,65,124,87,218 ; vxorps %ymm10,%ymm0,%ymm11 DB 196,67,125,25,220,1 ; vextractf128 $0x1,%ymm11,%xmm12 - DB 196,98,121,24,5,66,30,0,0 ; vbroadcastss 0x1e42(%rip),%xmm8 # 6a04 <_sk_callback_avx+0x44e> + DB 196,98,121,24,5,88,30,0,0 ; vbroadcastss 0x1e58(%rip),%xmm8 # 6958 <_sk_callback_avx+0x454> DB 196,65,57,102,236 ; vpcmpgtd %xmm12,%xmm8,%xmm13 DB 196,65,57,102,243 ; vpcmpgtd %xmm11,%xmm8,%xmm14 DB 196,67,13,24,237,1 ; vinsertf128 $0x1,%xmm13,%ymm14,%ymm13 @@ -9579,7 +9423,7 @@ _sk_store_f16_avx LABEL PROC DB 196,67,13,24,242,1 ; vinsertf128 $0x1,%xmm10,%ymm14,%ymm14 DB 196,193,33,114,211,13 ; vpsrld $0xd,%xmm11,%xmm11 DB 196,193,25,114,212,13 ; vpsrld $0xd,%xmm12,%xmm12 - DB 196,98,125,24,21,9,30,0,0 ; vbroadcastss 0x1e09(%rip),%ymm10 # 6a08 <_sk_callback_avx+0x452> + DB 196,98,125,24,21,31,30,0,0 ; vbroadcastss 0x1e1f(%rip),%ymm10 # 695c <_sk_callback_avx+0x458> DB 196,65,12,86,242 ; vorps %ymm10,%ymm14,%ymm14 DB 196,67,125,25,247,1 ; vextractf128 $0x1,%ymm14,%xmm15 DB 196,65,1,254,228 ; vpaddd %xmm12,%xmm15,%xmm12 @@ -9661,7 +9505,7 @@ _sk_store_f16_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 117,75 ; jne 4de6 <_sk_store_f16_avx+0x270> + DB 117,75 ; jne 4d24 <_sk_store_f16_avx+0x270> DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8) DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8) DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8) @@ -9677,22 +9521,22 @@ _sk_store_f16_avx LABEL PROC DB 255,224 ; jmpq *%rax DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,193 ; je 4db2 <_sk_store_f16_avx+0x23c> + DB 116,193 ; je 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,181 ; jb 4db2 <_sk_store_f16_avx+0x23c> + DB 114,181 ; jb 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8) - DB 116,173 ; je 4db2 <_sk_store_f16_avx+0x23c> + DB 116,173 ; je 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,161 ; jb 4db2 <_sk_store_f16_avx+0x23c> + DB 114,161 ; jb 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8) - DB 116,153 ; je 4db2 <_sk_store_f16_avx+0x23c> + DB 116,153 ; je 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,141 ; jb 4db2 <_sk_store_f16_avx+0x23c> + DB 114,141 ; jb 4cf0 <_sk_store_f16_avx+0x23c> DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8) - DB 235,133 ; jmp 4db2 <_sk_store_f16_avx+0x23c> + DB 235,133 ; jmp 4cf0 <_sk_store_f16_avx+0x23c> PUBLIC _sk_load_u16_be_avx _sk_load_u16_be_avx LABEL PROC @@ -9700,7 +9544,7 @@ _sk_load_u16_be_avx LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,253,0,0,0 ; jne 4f40 <_sk_load_u16_be_avx+0x113> + DB 15,133,253,0,0,0 ; jne 4e7e <_sk_load_u16_be_avx+0x113> DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8 DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2 DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3 @@ -9722,7 +9566,7 @@ _sk_load_u16_be_avx LABEL PROC DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,29,88,27,0,0 ; vbroadcastss 0x1b58(%rip),%ymm11 # 6a0c <_sk_callback_avx+0x456> + DB 196,98,125,24,29,110,27,0,0 ; vbroadcastss 0x1b6e(%rip),%ymm11 # 6960 <_sk_callback_avx+0x45c> DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0 DB 197,177,109,202 ; vpunpckhqdq %xmm2,%xmm9,%xmm1 DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2 @@ -9756,29 +9600,29 @@ _sk_load_u16_be_avx LABEL PROC DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8 DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,85 ; je 4fa6 <_sk_load_u16_be_avx+0x179> + DB 116,85 ; je 4ee4 <_sk_load_u16_be_avx+0x179> DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,72 ; jb 4fa6 <_sk_load_u16_be_avx+0x179> + DB 114,72 ; jb 4ee4 <_sk_load_u16_be_avx+0x179> DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 116,72 ; je 4fb3 <_sk_load_u16_be_avx+0x186> + DB 116,72 ; je 4ef1 <_sk_load_u16_be_avx+0x186> DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,59 ; jb 4fb3 <_sk_load_u16_be_avx+0x186> + DB 114,59 ; jb 4ef1 <_sk_load_u16_be_avx+0x186> DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 15,132,213,254,255,255 ; je 4e5e <_sk_load_u16_be_avx+0x31> + DB 15,132,213,254,255,255 ; je 4d9c <_sk_load_u16_be_avx+0x31> DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 15,130,196,254,255,255 ; jb 4e5e <_sk_load_u16_be_avx+0x31> + DB 15,130,196,254,255,255 ; jb 4d9c <_sk_load_u16_be_avx+0x31> DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9 - DB 233,184,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31> + DB 233,184,254,255,255 ; jmpq 4d9c <_sk_load_u16_be_avx+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2 - DB 233,171,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31> + DB 233,171,254,255,255 ; jmpq 4d9c <_sk_load_u16_be_avx+0x31> DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3 - DB 233,162,254,255,255 ; jmpq 4e5e <_sk_load_u16_be_avx+0x31> + DB 233,162,254,255,255 ; jmpq 4d9c <_sk_load_u16_be_avx+0x31> PUBLIC _sk_load_rgb_u16_be_avx _sk_load_rgb_u16_be_avx LABEL PROC @@ -9786,7 +9630,7 @@ _sk_load_rgb_u16_be_avx LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,243,0,0,0 ; jne 50c1 <_sk_load_rgb_u16_be_avx+0x105> + DB 15,133,243,0,0,0 ; jne 4fff <_sk_load_rgb_u16_be_avx+0x105> DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0 DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2 DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1 @@ -9813,7 +9657,7 @@ _sk_load_rgb_u16_be_avx LABEL PROC DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0 DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0 DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0 - DB 196,98,125,24,29,184,25,0,0 ; vbroadcastss 0x19b8(%rip),%ymm11 # 6a10 <_sk_callback_avx+0x45a> + DB 196,98,125,24,29,206,25,0,0 ; vbroadcastss 0x19ce(%rip),%ymm11 # 6964 <_sk_callback_avx+0x460> DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0 DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1 DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2 @@ -9834,48 +9678,48 @@ _sk_load_rgb_u16_be_avx LABEL PROC DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2 DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,29,85,25,0,0 ; vbroadcastss 0x1955(%rip),%ymm3 # 6a14 <_sk_callback_avx+0x45e> + DB 196,226,125,24,29,107,25,0,0 ; vbroadcastss 0x196b(%rip),%ymm3 # 6968 <_sk_callback_avx+0x464> DB 255,224 ; jmpq *%rax DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0 DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,5 ; jne 50da <_sk_load_rgb_u16_be_avx+0x11e> - DB 233,40,255,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> + DB 117,5 ; jne 5018 <_sk_load_rgb_u16_be_avx+0x11e> + DB 233,40,255,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1 DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,26 ; jb 5109 <_sk_load_rgb_u16_be_avx+0x14d> + DB 114,26 ; jb 5047 <_sk_load_rgb_u16_be_avx+0x14d> DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1 DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 117,10 ; jne 510e <_sk_load_rgb_u16_be_avx+0x152> - DB 233,249,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> - DB 233,244,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> + DB 117,10 ; jne 504c <_sk_load_rgb_u16_be_avx+0x152> + DB 233,249,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> + DB 233,244,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1 DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,26 ; jb 513d <_sk_load_rgb_u16_be_avx+0x181> + DB 114,26 ; jb 507b <_sk_load_rgb_u16_be_avx+0x181> DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1 DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1 DB 73,131,248,5 ; cmp $0x5,%r8 - DB 117,10 ; jne 5142 <_sk_load_rgb_u16_be_avx+0x186> - DB 233,197,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> - DB 233,192,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> + DB 117,10 ; jne 5080 <_sk_load_rgb_u16_be_avx+0x186> + DB 233,197,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> + DB 233,192,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3 DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11 DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,20 ; jb 516b <_sk_load_rgb_u16_be_avx+0x1af> + DB 114,20 ; jb 50a9 <_sk_load_rgb_u16_be_avx+0x1af> DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3 DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3 - DB 233,151,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> - DB 233,146,254,255,255 ; jmpq 5002 <_sk_load_rgb_u16_be_avx+0x46> + DB 233,151,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> + DB 233,146,254,255,255 ; jmpq 4f40 <_sk_load_rgb_u16_be_avx+0x46> PUBLIC _sk_store_u16_be_avx _sk_store_u16_be_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax - DB 196,98,125,24,5,146,24,0,0 ; vbroadcastss 0x1892(%rip),%ymm8 # 6a18 <_sk_callback_avx+0x462> + DB 196,98,125,24,5,168,24,0,0 ; vbroadcastss 0x18a8(%rip),%ymm8 # 696c <_sk_callback_avx+0x468> DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9 DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9 DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10 @@ -9913,7 +9757,7 @@ _sk_store_u16_be_avx LABEL PROC DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9 DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,31 ; jne 526a <_sk_store_u16_be_avx+0xfa> + DB 117,31 ; jne 51a8 <_sk_store_u16_be_avx+0xfa> DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2) DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2) DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2) @@ -9922,31 +9766,31 @@ _sk_store_u16_be_avx LABEL PROC DB 255,224 ; jmpq *%rax DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 5266 <_sk_store_u16_be_avx+0xf6> + DB 116,240 ; je 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 5266 <_sk_store_u16_be_avx+0xf6> + DB 114,227 ; jb 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2) - DB 116,218 ; je 5266 <_sk_store_u16_be_avx+0xf6> + DB 116,218 ; je 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,205 ; jb 5266 <_sk_store_u16_be_avx+0xf6> + DB 114,205 ; jb 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2) - DB 116,196 ; je 5266 <_sk_store_u16_be_avx+0xf6> + DB 116,196 ; je 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,183 ; jb 5266 <_sk_store_u16_be_avx+0xf6> + DB 114,183 ; jb 51a4 <_sk_store_u16_be_avx+0xf6> DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2) - DB 235,174 ; jmp 5266 <_sk_store_u16_be_avx+0xf6> + DB 235,174 ; jmp 51a4 <_sk_store_u16_be_avx+0xf6> PUBLIC _sk_load_f32_avx _sk_load_f32_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,131,248,7 ; cmp $0x7,%r8 - DB 119,110 ; ja 532e <_sk_load_f32_avx+0x76> + DB 119,110 ; ja 526c <_sk_load_f32_avx+0x76> DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 - DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 5358 <_sk_load_f32_avx+0xa0> + DB 76,141,29,132,0,0,0 ; lea 0x84(%rip),%r11 # 5294 <_sk_load_f32_avx+0x9e> DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax DB 76,1,216 ; add %r11,%rax DB 255,224 ; jmpq *%rax @@ -9972,19 +9816,19 @@ _sk_load_f32_avx LABEL PROC DB 196,193,101,21,216 ; vunpckhpd %ymm8,%ymm3,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax - DB 102,144 ; xchg %ax,%ax - DB 131,255,255 ; cmp $0xffffffff,%edi - DB 255,202 ; dec %edx + DB 133,255 ; test %edi,%edi + DB 255 ; (bad) + DB 255,204 ; dec %esp DB 255 ; (bad) DB 255 ; (bad) DB 255 ; (bad) - DB 189,255,255,255,176 ; mov $0xb0ffffff,%ebp + DB 191,255,255,255,178 ; mov $0xb2ffffff,%edi DB 255 ; (bad) DB 255 ; (bad) - DB 255,163,255,255,255,155 ; jmpq *-0x64000001(%rbx) + DB 255,165,255,255,255,157 ; jmpq *-0x62000001(%rbp) DB 255 ; (bad) DB 255 ; (bad) - DB 255,147,255,255,255,139 ; callq *-0x74000001(%rbx) + DB 255,149,255,255,255,141 ; callq *-0x72000001(%rbp) DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -10003,7 +9847,7 @@ _sk_store_f32_avx LABEL PROC DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8 DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11 DB 77,133,192 ; test %r8,%r8 - DB 117,55 ; jne 53e5 <_sk_store_f32_avx+0x6d> + DB 117,55 ; jne 5321 <_sk_store_f32_avx+0x6d> DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12 DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13 DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9 @@ -10016,22 +9860,22 @@ _sk_store_f32_avx LABEL PROC DB 255,224 ; jmpq *%rax DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 53e1 <_sk_store_f32_avx+0x69> + DB 116,240 ; je 531d <_sk_store_f32_avx+0x69> DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 53e1 <_sk_store_f32_avx+0x69> + DB 114,227 ; jb 531d <_sk_store_f32_avx+0x69> DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4) - DB 116,218 ; je 53e1 <_sk_store_f32_avx+0x69> + DB 116,218 ; je 531d <_sk_store_f32_avx+0x69> DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4) DB 73,131,248,5 ; cmp $0x5,%r8 - DB 114,205 ; jb 53e1 <_sk_store_f32_avx+0x69> + DB 114,205 ; jb 531d <_sk_store_f32_avx+0x69> DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4) - DB 116,195 ; je 53e1 <_sk_store_f32_avx+0x69> + DB 116,195 ; je 531d <_sk_store_f32_avx+0x69> DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4) DB 73,131,248,7 ; cmp $0x7,%r8 - DB 114,181 ; jb 53e1 <_sk_store_f32_avx+0x69> + DB 114,181 ; jb 531d <_sk_store_f32_avx+0x69> DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4) - DB 235,171 ; jmp 53e1 <_sk_store_f32_avx+0x69> + DB 235,171 ; jmp 531d <_sk_store_f32_avx+0x69> PUBLIC _sk_clamp_x_avx _sk_clamp_x_avx LABEL PROC @@ -10121,7 +9965,7 @@ PUBLIC _sk_clamp_x_1_avx _sk_clamp_x_1_avx LABEL PROC DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8 DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0 - DB 196,98,125,24,5,194,20,0,0 ; vbroadcastss 0x14c2(%rip),%ymm8 # 6a1c <_sk_callback_avx+0x466> + DB 196,98,125,24,5,218,20,0,0 ; vbroadcastss 0x14da(%rip),%ymm8 # 6970 <_sk_callback_avx+0x46c> DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -10135,9 +9979,9 @@ _sk_repeat_x_1_avx LABEL PROC PUBLIC _sk_mirror_x_1_avx _sk_mirror_x_1_avx LABEL PROC - DB 196,98,125,24,5,165,20,0,0 ; vbroadcastss 0x14a5(%rip),%ymm8 # 6a20 <_sk_callback_avx+0x46a> + DB 196,98,125,24,5,189,20,0,0 ; vbroadcastss 0x14bd(%rip),%ymm8 # 6974 <_sk_callback_avx+0x470> DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,13,155,20,0,0 ; vbroadcastss 0x149b(%rip),%ymm9 # 6a24 <_sk_callback_avx+0x46e> + DB 196,98,125,24,13,179,20,0,0 ; vbroadcastss 0x14b3(%rip),%ymm9 # 6978 <_sk_callback_avx+0x474> DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9 DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9 DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9 @@ -10151,12 +9995,12 @@ _sk_mirror_x_1_avx LABEL PROC PUBLIC _sk_luminance_to_alpha_avx _sk_luminance_to_alpha_avx LABEL PROC - DB 196,226,125,24,29,107,20,0,0 ; vbroadcastss 0x146b(%rip),%ymm3 # 6a28 <_sk_callback_avx+0x472> + DB 196,226,125,24,29,131,20,0,0 ; vbroadcastss 0x1483(%rip),%ymm3 # 697c <_sk_callback_avx+0x478> DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0 - DB 196,226,125,24,29,98,20,0,0 ; vbroadcastss 0x1462(%rip),%ymm3 # 6a2c <_sk_callback_avx+0x476> + DB 196,226,125,24,29,122,20,0,0 ; vbroadcastss 0x147a(%rip),%ymm3 # 6980 <_sk_callback_avx+0x47c> DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1 DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 - DB 196,226,125,24,13,85,20,0,0 ; vbroadcastss 0x1455(%rip),%ymm1 # 6a30 <_sk_callback_avx+0x47a> + DB 196,226,125,24,13,109,20,0,0 ; vbroadcastss 0x146d(%rip),%ymm1 # 6984 <_sk_callback_avx+0x480> DB 197,236,89,201 ; vmulps %ymm1,%ymm2,%ymm1 DB 197,252,88,217 ; vaddps %ymm1,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax @@ -10359,13 +10203,15 @@ _sk_evenly_spaced_gradient_avx LABEL PROC DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 83 ; push %rbx + DB 72,131,236,40 ; sub $0x28,%rsp + DB 197,252,17,60,36 ; vmovups %ymm7,(%rsp) DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,24 ; mov (%rax),%rbx DB 72,139,104,8 ; mov 0x8(%rax),%rbp DB 72,255,203 ; dec %rbx - DB 120,7 ; js 5931 <_sk_evenly_spaced_gradient_avx+0x1f> + DB 120,7 ; js 5876 <_sk_evenly_spaced_gradient_avx+0x28> DB 196,225,242,42,203 ; vcvtsi2ss %rbx,%xmm1,%xmm1 - DB 235,21 ; jmp 5946 <_sk_evenly_spaced_gradient_avx+0x34> + DB 235,21 ; jmp 588b <_sk_evenly_spaced_gradient_avx+0x3d> DB 73,137,217 ; mov %rbx,%r9 DB 73,209,233 ; shr %r9 DB 131,227,1 ; and $0x1,%ebx @@ -10392,124 +10238,126 @@ _sk_evenly_spaced_gradient_avx LABEL PROC DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 - DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,99,109,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm8 + DB 196,33,122,16,68,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm8 + DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 + DB 196,35,97,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm9 + DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 + DB 196,33,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm11 + DB 196,99,113,33,226,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm12 DB 72,139,104,40 ; mov 0x28(%rax),%rbp DB 196,161,122,16,84,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm2 - DB 196,227,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm2 + DB 196,99,105,33,108,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm13 DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 - DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1 - DB 196,227,97,33,201,32 ; vinsertps $0x20,%xmm1,%xmm3,%xmm1 - DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1 - DB 196,99,117,24,226,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm12 + DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1 + DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 + DB 196,35,105,33,116,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm14 + DB 196,33,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm15 + DB 196,33,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm10 + DB 196,67,25,33,192,48 ; vinsertps $0x30,%xmm8,%xmm12,%xmm8 + DB 196,227,49,33,215,32 ; vinsertps $0x20,%xmm7,%xmm9,%xmm2 + DB 196,195,105,33,211,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm2 + DB 196,67,109,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm2,%ymm8 + DB 196,227,17,33,211,32 ; vinsertps $0x20,%xmm3,%xmm13,%xmm2 + DB 196,99,105,33,201,48 ; vinsertps $0x30,%xmm1,%xmm2,%xmm9 DB 72,139,104,16 ; mov 0x10(%rax),%rbp - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3 - DB 196,227,113,33,203,32 ; vinsertps $0x20,%xmm3,%xmm1,%xmm1 - DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3 - DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1 - DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 - DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - DB 196,161,122,16,84,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm2 - DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2 - DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,99,109,24,233,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm13 + DB 196,161,122,16,84,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm2 + DB 196,99,105,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1 + DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7 + DB 196,163,65,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 + DB 196,33,122,16,108,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm13 + DB 196,195,9,33,215,32 ; vinsertps $0x20,%xmm15,%xmm14,%xmm2 + DB 196,195,105,33,210,48 ; vinsertps $0x30,%xmm10,%xmm2,%xmm2 + DB 196,67,109,24,241,1 ; vinsertf128 $0x1,%xmm9,%ymm2,%ymm14 + DB 196,195,33,33,212,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm2 + DB 196,99,105,33,201,48 ; vinsertps $0x30,%xmm1,%xmm2,%xmm9 + DB 196,99,65,33,211,32 ; vinsertps $0x20,%xmm3,%xmm7,%xmm10 DB 72,139,104,48 ; mov 0x30(%rax),%rbp - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 + DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3 + DB 196,99,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + DB 196,33,122,16,124,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm15 + DB 196,33,122,16,100,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm12 DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 + DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,99,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm9 + DB 196,67,41,33,213,48 ; vinsertps $0x30,%xmm13,%xmm10,%xmm10 + DB 196,67,45,24,233,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm13 + DB 196,195,33,33,207,32 ; vinsertps $0x20,%xmm15,%xmm11,%xmm1 + DB 196,67,113,33,204,48 ; vinsertps $0x30,%xmm12,%xmm1,%xmm9 + DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2 + DB 196,99,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm10 DB 72,139,104,24 ; mov 0x18(%rax),%rbp - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 + DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3 + DB 196,99,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15 DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 + DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 + DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 + DB 196,195,33,33,204,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm1 + DB 196,195,113,33,207,48 ; vinsertps $0x30,%xmm15,%xmm1,%xmm1 DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 + DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 DB 196,99,109,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm10 DB 72,139,104,56 ; mov 0x38(%rax),%rbp DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 + DB 196,99,113,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15 + DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7 + DB 196,163,65,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1 + DB 196,161,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm2 + DB 196,195,33,33,220,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm3 + DB 196,195,97,33,223,48 ; vinsertps $0x30,%xmm15,%xmm3,%xmm3 + DB 196,227,65,33,201,32 ; vinsertps $0x20,%xmm1,%xmm7,%xmm1 DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 - DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,99,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm11 + DB 196,99,117,24,219,1 ; vinsertf128 $0x1,%xmm3,%ymm1,%ymm11 DB 72,139,104,32 ; mov 0x20(%rax),%rbp DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 - DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 + DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 + DB 196,35,97,33,100,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm12 + DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 - DB 196,99,109,24,241,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm14 + DB 196,99,113,33,250,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm15 DB 72,139,64,64 ; mov 0x40(%rax),%rax - DB 196,161,122,16,12,168 ; vmovss (%rax,%r13,4),%xmm1 - DB 196,227,113,33,12,152,16 ; vinsertps $0x10,(%rax,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,20,184 ; vmovss (%rax,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,20,160 ; vmovss (%rax,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,20,176 ; vmovss (%rax,%r14,4),%xmm2 - DB 196,163,105,33,20,152,16 ; vinsertps $0x10,(%rax,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,28,144 ; vmovss (%rax,%r10,4),%xmm3 - DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 - DB 196,161,122,16,28,136 ; vmovss (%rax,%r9,4),%xmm3 - DB 196,227,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm2 + DB 196,161,122,16,20,168 ; vmovss (%rax,%r13,4),%xmm2 + DB 196,227,105,33,20,152,16 ; vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2 + DB 196,227,25,33,255,32 ; vinsertps $0x20,%xmm7,%xmm12,%xmm7 + DB 196,161,122,16,12,184 ; vmovss (%rax,%r15,4),%xmm1 + DB 196,227,65,33,219,48 ; vinsertps $0x30,%xmm3,%xmm7,%xmm3 + DB 196,161,122,16,60,160 ; vmovss (%rax,%r12,4),%xmm7 + DB 196,67,101,24,231,1 ; vinsertf128 $0x1,%xmm15,%ymm3,%ymm12 + DB 196,161,122,16,28,176 ; vmovss (%rax,%r14,4),%xmm3 + DB 196,163,97,33,28,152,16 ; vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3 + DB 196,227,105,33,201,32 ; vinsertps $0x20,%xmm1,%xmm2,%xmm1 + DB 196,161,122,16,20,144 ; vmovss (%rax,%r10,4),%xmm2 + DB 196,227,113,33,207,48 ; vinsertps $0x30,%xmm7,%xmm1,%xmm1 + DB 196,161,122,16,60,136 ; vmovss (%rax,%r9,4),%xmm7 + DB 196,227,97,33,210,32 ; vinsertps $0x20,%xmm2,%xmm3,%xmm2 + DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 DB 196,227,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm3 DB 197,188,89,200 ; vmulps %ymm0,%ymm8,%ymm1 - DB 196,65,116,88,196 ; vaddps %ymm12,%ymm1,%ymm8 + DB 196,65,116,88,198 ; vaddps %ymm14,%ymm1,%ymm8 DB 197,148,89,200 ; vmulps %ymm0,%ymm13,%ymm1 DB 196,193,116,88,201 ; vaddps %ymm9,%ymm1,%ymm1 DB 197,172,89,208 ; vmulps %ymm0,%ymm10,%ymm2 DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 - DB 197,140,89,192 ; vmulps %ymm0,%ymm14,%ymm0 + DB 197,156,89,192 ; vmulps %ymm0,%ymm12,%ymm0 DB 197,252,88,219 ; vaddps %ymm3,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,124,41,192 ; vmovaps %ymm8,%ymm0 + DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7 + DB 72,131,196,40 ; add $0x28,%rsp DB 91 ; pop %rbx DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 @@ -10520,18 +10368,18 @@ _sk_evenly_spaced_gradient_avx LABEL PROC PUBLIC _sk_gauss_a_to_rgba_avx _sk_gauss_a_to_rgba_avx LABEL PROC - DB 196,226,125,24,5,144,13,0,0 ; vbroadcastss 0xd90(%rip),%ymm0 # 6a34 <_sk_callback_avx+0x47e> + DB 196,226,125,24,5,150,13,0,0 ; vbroadcastss 0xd96(%rip),%ymm0 # 6988 <_sk_callback_avx+0x484> DB 197,228,89,192 ; vmulps %ymm0,%ymm3,%ymm0 - DB 196,226,125,24,13,135,13,0,0 ; vbroadcastss 0xd87(%rip),%ymm1 # 6a38 <_sk_callback_avx+0x482> + DB 196,226,125,24,13,141,13,0,0 ; vbroadcastss 0xd8d(%rip),%ymm1 # 698c <_sk_callback_avx+0x488> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0 - DB 196,226,125,24,13,122,13,0,0 ; vbroadcastss 0xd7a(%rip),%ymm1 # 6a3c <_sk_callback_avx+0x486> + DB 196,226,125,24,13,128,13,0,0 ; vbroadcastss 0xd80(%rip),%ymm1 # 6990 <_sk_callback_avx+0x48c> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0 - DB 196,226,125,24,13,109,13,0,0 ; vbroadcastss 0xd6d(%rip),%ymm1 # 6a40 <_sk_callback_avx+0x48a> + DB 196,226,125,24,13,115,13,0,0 ; vbroadcastss 0xd73(%rip),%ymm1 # 6994 <_sk_callback_avx+0x490> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0 - DB 196,226,125,24,13,96,13,0,0 ; vbroadcastss 0xd60(%rip),%ymm1 # 6a44 <_sk_callback_avx+0x48e> + DB 196,226,125,24,13,102,13,0,0 ; vbroadcastss 0xd66(%rip),%ymm1 # 6998 <_sk_callback_avx+0x494> DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,252,40,200 ; vmovaps %ymm0,%ymm1 @@ -10553,12 +10401,12 @@ _sk_gradient_avx LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 73,131,249,2 ; cmp $0x2,%r9 - DB 114,80 ; jb 5d6a <_sk_gradient_avx+0x72> + DB 114,80 ; jb 5cb8 <_sk_gradient_avx+0x72> DB 72,139,88,72 ; mov 0x48(%rax),%rbx DB 73,255,201 ; dec %r9 DB 72,131,195,4 ; add $0x4,%rbx DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9 - DB 196,98,125,24,21,21,13,0,0 ; vbroadcastss 0xd15(%rip),%ymm10 # 6a48 <_sk_callback_avx+0x492> + DB 196,98,125,24,21,27,13,0,0 ; vbroadcastss 0xd1b(%rip),%ymm10 # 699c <_sk_callback_avx+0x498> DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1 DB 196,98,125,24,3 ; vbroadcastss (%rbx),%ymm8 DB 197,60,194,192,2 ; vcmpleps %ymm0,%ymm8,%ymm8 @@ -10570,7 +10418,7 @@ _sk_gradient_avx LABEL PROC DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1 DB 72,131,195,4 ; add $0x4,%rbx DB 73,255,201 ; dec %r9 - DB 117,205 ; jne 5d37 <_sk_gradient_avx+0x3f> + DB 117,205 ; jne 5c85 <_sk_gradient_avx+0x3f> DB 196,195,249,22,201,1 ; vpextrq $0x1,%xmm1,%r9 DB 69,137,202 ; mov %r9d,%r10d DB 73,193,233,32 ; shr $0x20,%r9 @@ -10588,105 +10436,105 @@ _sk_gradient_avx LABEL PROC DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,99,113,33,194,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm8 - DB 196,33,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm9 + DB 196,33,122,16,68,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm8 DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 - DB 196,35,97,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm10 - DB 196,33,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm11 - DB 196,33,122,16,100,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm12 + DB 196,35,97,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm9 + DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 + DB 196,33,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm11 + DB 196,99,113,33,226,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm12 DB 72,139,104,40 ; mov 0x28(%rax),%rbp - DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3 - DB 196,99,97,33,108,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm13 - DB 196,33,122,16,116,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm14 - DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15 - DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 - DB 196,163,97,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm7 - DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1 - DB 196,161,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm2 - DB 72,139,104,16 ; mov 0x10(%rax),%rbp - DB 196,67,57,33,193,48 ; vinsertps $0x30,%xmm9,%xmm8,%xmm8 - DB 196,195,41,33,219,32 ; vinsertps $0x20,%xmm11,%xmm10,%xmm3 - DB 196,195,97,33,220,48 ; vinsertps $0x30,%xmm12,%xmm3,%xmm3 - DB 196,67,101,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm3,%ymm8 - DB 196,195,17,33,222,32 ; vinsertps $0x20,%xmm14,%xmm13,%xmm3 - DB 196,195,97,33,223,48 ; vinsertps $0x30,%xmm15,%xmm3,%xmm3 - DB 196,227,65,33,201,32 ; vinsertps $0x20,%xmm1,%xmm7,%xmm1 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,99,117,24,227,1 ; vinsertf128 $0x1,%xmm3,%ymm1,%ymm12 - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 + DB 196,161,122,16,84,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm2 + DB 196,99,105,33,108,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm13 DB 196,161,122,16,92,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm3 - DB 196,227,113,33,203,32 ; vinsertps $0x20,%xmm3,%xmm1,%xmm1 - DB 196,161,122,16,92,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm3 - DB 196,227,113,33,203,48 ; vinsertps $0x30,%xmm3,%xmm1,%xmm1 - DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 - DB 196,163,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm3 - DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 - DB 196,227,97,33,223,32 ; vinsertps $0x20,%xmm7,%xmm3,%xmm3 - DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 - DB 196,227,97,33,223,48 ; vinsertps $0x30,%xmm7,%xmm3,%xmm3 - DB 196,99,101,24,233,1 ; vinsertf128 $0x1,%xmm1,%ymm3,%ymm13 - DB 72,139,104,48 ; mov 0x30(%rax),%rbp - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,124,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm7 - DB 196,227,113,33,207,32 ; vinsertps $0x20,%xmm7,%xmm1,%xmm1 - DB 196,161,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm7 - DB 196,227,113,33,207,48 ; vinsertps $0x30,%xmm7,%xmm1,%xmm1 + DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1 + DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 + DB 196,35,105,33,116,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm14 + DB 196,33,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm15 + DB 196,33,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm10 + DB 196,67,25,33,192,48 ; vinsertps $0x30,%xmm8,%xmm12,%xmm8 + DB 196,227,49,33,215,32 ; vinsertps $0x20,%xmm7,%xmm9,%xmm2 + DB 196,195,105,33,211,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm2 + DB 196,67,109,24,192,1 ; vinsertf128 $0x1,%xmm8,%ymm2,%ymm8 + DB 196,227,17,33,211,32 ; vinsertps $0x20,%xmm3,%xmm13,%xmm2 + DB 196,99,105,33,201,48 ; vinsertps $0x30,%xmm1,%xmm2,%xmm9 + DB 72,139,104,16 ; mov 0x10(%rax),%rbp + DB 196,161,122,16,84,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm2 + DB 196,99,105,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm2,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,161,122,16,76,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm1 DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7 DB 196,163,65,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 - DB 196,161,122,16,84,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm2 - DB 196,227,65,33,210,32 ; vinsertps $0x20,%xmm2,%xmm7,%xmm2 - DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 - DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 - DB 196,99,109,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm9 - DB 72,139,104,24 ; mov 0x18(%rax),%rbp - DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 + DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 + DB 196,33,122,16,108,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm13 + DB 196,195,9,33,215,32 ; vinsertps $0x20,%xmm15,%xmm14,%xmm2 + DB 196,195,105,33,210,48 ; vinsertps $0x30,%xmm10,%xmm2,%xmm2 + DB 196,67,109,24,241,1 ; vinsertf128 $0x1,%xmm9,%ymm2,%ymm14 + DB 196,195,33,33,212,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm2 + DB 196,99,105,33,201,48 ; vinsertps $0x30,%xmm1,%xmm2,%xmm9 + DB 196,99,65,33,211,32 ; vinsertps $0x20,%xmm3,%xmm7,%xmm10 + DB 72,139,104,48 ; mov 0x30(%rax),%rbp + DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3 + DB 196,99,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + DB 196,33,122,16,124,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm15 + DB 196,33,122,16,100,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm12 DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 + DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 + DB 196,67,41,33,213,48 ; vinsertps $0x30,%xmm13,%xmm10,%xmm10 + DB 196,67,45,24,233,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm13 + DB 196,195,33,33,207,32 ; vinsertps $0x20,%xmm15,%xmm11,%xmm1 + DB 196,67,113,33,204,48 ; vinsertps $0x30,%xmm12,%xmm1,%xmm9 DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2 + DB 196,99,105,33,211,48 ; vinsertps $0x30,%xmm3,%xmm2,%xmm10 + DB 72,139,104,24 ; mov 0x18(%rax),%rbp + DB 196,161,122,16,92,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm3 + DB 196,99,97,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm3,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15 + DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 + DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 + DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 + DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9 + DB 196,195,33,33,204,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm1 + DB 196,195,113,33,207,48 ; vinsertps $0x30,%xmm15,%xmm1,%xmm1 + DB 196,227,105,33,211,32 ; vinsertps $0x20,%xmm3,%xmm2,%xmm2 DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 DB 196,99,109,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm10 DB 72,139,104,56 ; mov 0x38(%rax),%rbp DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 - DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 - DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 - DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 + DB 196,99,113,33,92,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm11 + DB 196,33,122,16,100,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm12 + DB 196,33,122,16,124,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm15 + DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7 + DB 196,163,65,33,124,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm7 + DB 196,161,122,16,76,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm1 + DB 196,161,122,16,84,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm2 + DB 196,195,33,33,220,32 ; vinsertps $0x20,%xmm12,%xmm11,%xmm3 + DB 196,195,97,33,223,48 ; vinsertps $0x30,%xmm15,%xmm3,%xmm3 + DB 196,227,65,33,201,32 ; vinsertps $0x20,%xmm1,%xmm7,%xmm1 DB 196,227,113,33,202,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm1 - DB 196,161,122,16,84,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm2 - DB 196,163,105,33,84,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm2,%xmm2 - DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 - DB 196,227,105,33,215,32 ; vinsertps $0x20,%xmm7,%xmm2,%xmm2 - DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 - DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 - DB 196,99,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm11 + DB 196,99,117,24,219,1 ; vinsertf128 $0x1,%xmm3,%ymm1,%ymm11 DB 72,139,104,32 ; mov 0x20(%rax),%rbp DB 196,161,122,16,76,173,0 ; vmovss 0x0(%rbp,%r13,4),%xmm1 DB 196,227,113,33,76,157,0,16 ; vinsertps $0x10,0x0(%rbp,%rbx,4),%xmm1,%xmm1 DB 196,161,122,16,84,189,0 ; vmovss 0x0(%rbp,%r15,4),%xmm2 DB 196,227,113,33,202,32 ; vinsertps $0x20,%xmm2,%xmm1,%xmm1 DB 196,161,122,16,84,165,0 ; vmovss 0x0(%rbp,%r12,4),%xmm2 - DB 196,161,122,16,124,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm7 - DB 196,35,65,33,116,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm7,%xmm14 - DB 196,161,122,16,92,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm3 - DB 196,161,122,16,124,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm7 + DB 196,161,122,16,92,181,0 ; vmovss 0x0(%rbp,%r14,4),%xmm3 + DB 196,35,97,33,100,157,0,16 ; vinsertps $0x10,0x0(%rbp,%r11,4),%xmm3,%xmm12 + DB 196,161,122,16,124,149,0 ; vmovss 0x0(%rbp,%r10,4),%xmm7 + DB 196,161,122,16,92,141,0 ; vmovss 0x0(%rbp,%r9,4),%xmm3 DB 196,99,113,33,250,48 ; vinsertps $0x30,%xmm2,%xmm1,%xmm15 DB 72,139,64,64 ; mov 0x40(%rax),%rax DB 196,161,122,16,20,168 ; vmovss (%rax,%r13,4),%xmm2 DB 196,227,105,33,20,152,16 ; vinsertps $0x10,(%rax,%rbx,4),%xmm2,%xmm2 - DB 196,227,9,33,219,32 ; vinsertps $0x20,%xmm3,%xmm14,%xmm3 + DB 196,227,25,33,255,32 ; vinsertps $0x20,%xmm7,%xmm12,%xmm7 DB 196,161,122,16,12,184 ; vmovss (%rax,%r15,4),%xmm1 - DB 196,227,97,33,223,48 ; vinsertps $0x30,%xmm7,%xmm3,%xmm3 + DB 196,227,65,33,219,48 ; vinsertps $0x30,%xmm3,%xmm7,%xmm3 DB 196,161,122,16,60,160 ; vmovss (%rax,%r12,4),%xmm7 - DB 196,67,101,24,247,1 ; vinsertf128 $0x1,%xmm15,%ymm3,%ymm14 + DB 196,67,101,24,231,1 ; vinsertf128 $0x1,%xmm15,%ymm3,%ymm12 DB 196,161,122,16,28,176 ; vmovss (%rax,%r14,4),%xmm3 DB 196,163,97,33,28,152,16 ; vinsertps $0x10,(%rax,%r11,4),%xmm3,%xmm3 DB 196,227,105,33,201,32 ; vinsertps $0x20,%xmm1,%xmm2,%xmm1 @@ -10697,12 +10545,12 @@ _sk_gradient_avx LABEL PROC DB 196,227,105,33,215,48 ; vinsertps $0x30,%xmm7,%xmm2,%xmm2 DB 196,227,109,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm2,%ymm3 DB 197,188,89,200 ; vmulps %ymm0,%ymm8,%ymm1 - DB 196,65,116,88,196 ; vaddps %ymm12,%ymm1,%ymm8 + DB 196,65,116,88,198 ; vaddps %ymm14,%ymm1,%ymm8 DB 197,148,89,200 ; vmulps %ymm0,%ymm13,%ymm1 DB 196,193,116,88,201 ; vaddps %ymm9,%ymm1,%ymm1 DB 197,172,89,208 ; vmulps %ymm0,%ymm10,%ymm2 DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2 - DB 197,140,89,192 ; vmulps %ymm0,%ymm14,%ymm0 + DB 197,156,89,192 ; vmulps %ymm0,%ymm12,%ymm0 DB 197,252,88,219 ; vaddps %ymm3,%ymm0,%ymm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 197,124,41,192 ; vmovaps %ymm8,%ymm0 @@ -10750,27 +10598,27 @@ _sk_xy_to_unit_angle_avx LABEL PROC DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12 DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11 DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12 - DB 196,98,125,24,45,8,9,0,0 ; vbroadcastss 0x908(%rip),%ymm13 # 6a4c <_sk_callback_avx+0x496> + DB 196,98,125,24,45,14,9,0,0 ; vbroadcastss 0x90e(%rip),%ymm13 # 69a0 <_sk_callback_avx+0x49c> DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13 - DB 196,98,125,24,53,254,8,0,0 ; vbroadcastss 0x8fe(%rip),%ymm14 # 6a50 <_sk_callback_avx+0x49a> + DB 196,98,125,24,53,4,9,0,0 ; vbroadcastss 0x904(%rip),%ymm14 # 69a4 <_sk_callback_avx+0x4a0> DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13 DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13 - DB 196,98,125,24,53,239,8,0,0 ; vbroadcastss 0x8ef(%rip),%ymm14 # 6a54 <_sk_callback_avx+0x49e> + DB 196,98,125,24,53,245,8,0,0 ; vbroadcastss 0x8f5(%rip),%ymm14 # 69a8 <_sk_callback_avx+0x4a4> DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13 DB 196,65,28,89,229 ; vmulps %ymm13,%ymm12,%ymm12 - DB 196,98,125,24,45,224,8,0,0 ; vbroadcastss 0x8e0(%rip),%ymm13 # 6a58 <_sk_callback_avx+0x4a2> + DB 196,98,125,24,45,230,8,0,0 ; vbroadcastss 0x8e6(%rip),%ymm13 # 69ac <_sk_callback_avx+0x4a8> DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12 DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11 DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9 - DB 196,98,125,24,21,203,8,0,0 ; vbroadcastss 0x8cb(%rip),%ymm10 # 6a5c <_sk_callback_avx+0x4a6> + DB 196,98,125,24,21,209,8,0,0 ; vbroadcastss 0x8d1(%rip),%ymm10 # 69b0 <_sk_callback_avx+0x4ac> DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10 DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9 DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0 - DB 196,98,125,24,21,181,8,0,0 ; vbroadcastss 0x8b5(%rip),%ymm10 # 6a60 <_sk_callback_avx+0x4aa> + DB 196,98,125,24,21,187,8,0,0 ; vbroadcastss 0x8bb(%rip),%ymm10 # 69b4 <_sk_callback_avx+0x4b0> DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10 DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0 DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9 - DB 196,98,125,24,21,159,8,0,0 ; vbroadcastss 0x89f(%rip),%ymm10 # 6a64 <_sk_callback_avx+0x4ae> + DB 196,98,125,24,21,165,8,0,0 ; vbroadcastss 0x8a5(%rip),%ymm10 # 69b8 <_sk_callback_avx+0x4b4> DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10 DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0 DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9 @@ -10790,7 +10638,7 @@ _sk_xy_to_radius_avx LABEL PROC PUBLIC _sk_save_xy_avx _sk_save_xy_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,105,8,0,0 ; vbroadcastss 0x869(%rip),%ymm8 # 6a68 <_sk_callback_avx+0x4b2> + DB 196,98,125,24,5,111,8,0,0 ; vbroadcastss 0x86f(%rip),%ymm8 # 69bc <_sk_callback_avx+0x4b8> DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9 DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10 DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9 @@ -10823,9 +10671,9 @@ _sk_accumulate_avx LABEL PROC PUBLIC _sk_bilinear_nx_avx _sk_bilinear_nx_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,245,7,0,0 ; vbroadcastss 0x7f5(%rip),%ymm0 # 6a6c <_sk_callback_avx+0x4b6> + DB 196,226,125,24,5,251,7,0,0 ; vbroadcastss 0x7fb(%rip),%ymm0 # 69c0 <_sk_callback_avx+0x4bc> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,236,7,0,0 ; vbroadcastss 0x7ec(%rip),%ymm8 # 6a70 <_sk_callback_avx+0x4ba> + DB 196,98,125,24,5,242,7,0,0 ; vbroadcastss 0x7f2(%rip),%ymm8 # 69c4 <_sk_callback_avx+0x4c0> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10834,7 +10682,7 @@ _sk_bilinear_nx_avx LABEL PROC PUBLIC _sk_bilinear_px_avx _sk_bilinear_px_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,212,7,0,0 ; vbroadcastss 0x7d4(%rip),%ymm0 # 6a74 <_sk_callback_avx+0x4be> + DB 196,226,125,24,5,218,7,0,0 ; vbroadcastss 0x7da(%rip),%ymm0 # 69c8 <_sk_callback_avx+0x4c4> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -10844,9 +10692,9 @@ _sk_bilinear_px_avx LABEL PROC PUBLIC _sk_bilinear_ny_avx _sk_bilinear_ny_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,184,7,0,0 ; vbroadcastss 0x7b8(%rip),%ymm1 # 6a78 <_sk_callback_avx+0x4c2> + DB 196,226,125,24,13,190,7,0,0 ; vbroadcastss 0x7be(%rip),%ymm1 # 69cc <_sk_callback_avx+0x4c8> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,174,7,0,0 ; vbroadcastss 0x7ae(%rip),%ymm8 # 6a7c <_sk_callback_avx+0x4c6> + DB 196,98,125,24,5,180,7,0,0 ; vbroadcastss 0x7b4(%rip),%ymm8 # 69d0 <_sk_callback_avx+0x4cc> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10855,7 +10703,7 @@ _sk_bilinear_ny_avx LABEL PROC PUBLIC _sk_bilinear_py_avx _sk_bilinear_py_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,150,7,0,0 ; vbroadcastss 0x796(%rip),%ymm1 # 6a80 <_sk_callback_avx+0x4ca> + DB 196,226,125,24,13,156,7,0,0 ; vbroadcastss 0x79c(%rip),%ymm1 # 69d4 <_sk_callback_avx+0x4d0> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -10865,14 +10713,14 @@ _sk_bilinear_py_avx LABEL PROC PUBLIC _sk_bicubic_n3x_avx _sk_bicubic_n3x_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,121,7,0,0 ; vbroadcastss 0x779(%rip),%ymm0 # 6a84 <_sk_callback_avx+0x4ce> + DB 196,226,125,24,5,127,7,0,0 ; vbroadcastss 0x77f(%rip),%ymm0 # 69d8 <_sk_callback_avx+0x4d4> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,112,7,0,0 ; vbroadcastss 0x770(%rip),%ymm8 # 6a88 <_sk_callback_avx+0x4d2> + DB 196,98,125,24,5,118,7,0,0 ; vbroadcastss 0x776(%rip),%ymm8 # 69dc <_sk_callback_avx+0x4d8> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,97,7,0,0 ; vbroadcastss 0x761(%rip),%ymm10 # 6a8c <_sk_callback_avx+0x4d6> + DB 196,98,125,24,21,103,7,0,0 ; vbroadcastss 0x767(%rip),%ymm10 # 69e0 <_sk_callback_avx+0x4dc> DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8 - DB 196,98,125,24,21,87,7,0,0 ; vbroadcastss 0x757(%rip),%ymm10 # 6a90 <_sk_callback_avx+0x4da> + DB 196,98,125,24,21,93,7,0,0 ; vbroadcastss 0x75d(%rip),%ymm10 # 69e4 <_sk_callback_avx+0x4e0> DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -10882,19 +10730,19 @@ _sk_bicubic_n3x_avx LABEL PROC PUBLIC _sk_bicubic_n1x_avx _sk_bicubic_n1x_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,58,7,0,0 ; vbroadcastss 0x73a(%rip),%ymm0 # 6a94 <_sk_callback_avx+0x4de> + DB 196,226,125,24,5,64,7,0,0 ; vbroadcastss 0x740(%rip),%ymm0 # 69e8 <_sk_callback_avx+0x4e4> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 - DB 196,98,125,24,5,49,7,0,0 ; vbroadcastss 0x731(%rip),%ymm8 # 6a98 <_sk_callback_avx+0x4e2> + DB 196,98,125,24,5,55,7,0,0 ; vbroadcastss 0x737(%rip),%ymm8 # 69ec <_sk_callback_avx+0x4e8> DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8 - DB 196,98,125,24,13,39,7,0,0 ; vbroadcastss 0x727(%rip),%ymm9 # 6a9c <_sk_callback_avx+0x4e6> + DB 196,98,125,24,13,45,7,0,0 ; vbroadcastss 0x72d(%rip),%ymm9 # 69f0 <_sk_callback_avx+0x4ec> DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9 - DB 196,98,125,24,21,29,7,0,0 ; vbroadcastss 0x71d(%rip),%ymm10 # 6aa0 <_sk_callback_avx+0x4ea> + DB 196,98,125,24,21,35,7,0,0 ; vbroadcastss 0x723(%rip),%ymm10 # 69f4 <_sk_callback_avx+0x4f0> DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9 DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9 - DB 196,98,125,24,21,14,7,0,0 ; vbroadcastss 0x70e(%rip),%ymm10 # 6aa4 <_sk_callback_avx+0x4ee> + DB 196,98,125,24,21,20,7,0,0 ; vbroadcastss 0x714(%rip),%ymm10 # 69f8 <_sk_callback_avx+0x4f4> DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9 DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 - DB 196,98,125,24,13,255,6,0,0 ; vbroadcastss 0x6ff(%rip),%ymm9 # 6aa8 <_sk_callback_avx+0x4f2> + DB 196,98,125,24,13,5,7,0,0 ; vbroadcastss 0x705(%rip),%ymm9 # 69fc <_sk_callback_avx+0x4f8> DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10903,17 +10751,17 @@ _sk_bicubic_n1x_avx LABEL PROC PUBLIC _sk_bicubic_p1x_avx _sk_bicubic_p1x_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,231,6,0,0 ; vbroadcastss 0x6e7(%rip),%ymm8 # 6aac <_sk_callback_avx+0x4f6> + DB 196,98,125,24,5,237,6,0,0 ; vbroadcastss 0x6ed(%rip),%ymm8 # 6a00 <_sk_callback_avx+0x4fc> DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0 DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9 - DB 196,98,125,24,21,217,6,0,0 ; vbroadcastss 0x6d9(%rip),%ymm10 # 6ab0 <_sk_callback_avx+0x4fa> + DB 196,98,125,24,21,223,6,0,0 ; vbroadcastss 0x6df(%rip),%ymm10 # 6a04 <_sk_callback_avx+0x500> DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10 - DB 196,98,125,24,29,207,6,0,0 ; vbroadcastss 0x6cf(%rip),%ymm11 # 6ab4 <_sk_callback_avx+0x4fe> + DB 196,98,125,24,29,213,6,0,0 ; vbroadcastss 0x6d5(%rip),%ymm11 # 6a08 <_sk_callback_avx+0x504> DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10 DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10 DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 - DB 196,98,125,24,13,182,6,0,0 ; vbroadcastss 0x6b6(%rip),%ymm9 # 6ab8 <_sk_callback_avx+0x502> + DB 196,98,125,24,13,188,6,0,0 ; vbroadcastss 0x6bc(%rip),%ymm9 # 6a0c <_sk_callback_avx+0x508> DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10922,13 +10770,13 @@ _sk_bicubic_p1x_avx LABEL PROC PUBLIC _sk_bicubic_p3x_avx _sk_bicubic_p3x_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,5,158,6,0,0 ; vbroadcastss 0x69e(%rip),%ymm0 # 6abc <_sk_callback_avx+0x506> + DB 196,226,125,24,5,164,6,0,0 ; vbroadcastss 0x6a4(%rip),%ymm0 # 6a10 <_sk_callback_avx+0x50c> DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0 DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,139,6,0,0 ; vbroadcastss 0x68b(%rip),%ymm10 # 6ac0 <_sk_callback_avx+0x50a> + DB 196,98,125,24,21,145,6,0,0 ; vbroadcastss 0x691(%rip),%ymm10 # 6a14 <_sk_callback_avx+0x510> DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8 - DB 196,98,125,24,21,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm10 # 6ac4 <_sk_callback_avx+0x50e> + DB 196,98,125,24,21,135,6,0,0 ; vbroadcastss 0x687(%rip),%ymm10 # 6a18 <_sk_callback_avx+0x514> DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax) @@ -10938,14 +10786,14 @@ _sk_bicubic_p3x_avx LABEL PROC PUBLIC _sk_bicubic_n3y_avx _sk_bicubic_n3y_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,100,6,0,0 ; vbroadcastss 0x664(%rip),%ymm1 # 6ac8 <_sk_callback_avx+0x512> + DB 196,226,125,24,13,106,6,0,0 ; vbroadcastss 0x66a(%rip),%ymm1 # 6a1c <_sk_callback_avx+0x518> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,90,6,0,0 ; vbroadcastss 0x65a(%rip),%ymm8 # 6acc <_sk_callback_avx+0x516> + DB 196,98,125,24,5,96,6,0,0 ; vbroadcastss 0x660(%rip),%ymm8 # 6a20 <_sk_callback_avx+0x51c> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,75,6,0,0 ; vbroadcastss 0x64b(%rip),%ymm10 # 6ad0 <_sk_callback_avx+0x51a> + DB 196,98,125,24,21,81,6,0,0 ; vbroadcastss 0x651(%rip),%ymm10 # 6a24 <_sk_callback_avx+0x520> DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8 - DB 196,98,125,24,21,65,6,0,0 ; vbroadcastss 0x641(%rip),%ymm10 # 6ad4 <_sk_callback_avx+0x51e> + DB 196,98,125,24,21,71,6,0,0 ; vbroadcastss 0x647(%rip),%ymm10 # 6a28 <_sk_callback_avx+0x524> DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -10955,19 +10803,19 @@ _sk_bicubic_n3y_avx LABEL PROC PUBLIC _sk_bicubic_n1y_avx _sk_bicubic_n1y_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,36,6,0,0 ; vbroadcastss 0x624(%rip),%ymm1 # 6ad8 <_sk_callback_avx+0x522> + DB 196,226,125,24,13,42,6,0,0 ; vbroadcastss 0x62a(%rip),%ymm1 # 6a2c <_sk_callback_avx+0x528> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 - DB 196,98,125,24,5,26,6,0,0 ; vbroadcastss 0x61a(%rip),%ymm8 # 6adc <_sk_callback_avx+0x526> + DB 196,98,125,24,5,32,6,0,0 ; vbroadcastss 0x620(%rip),%ymm8 # 6a30 <_sk_callback_avx+0x52c> DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8 - DB 196,98,125,24,13,16,6,0,0 ; vbroadcastss 0x610(%rip),%ymm9 # 6ae0 <_sk_callback_avx+0x52a> + DB 196,98,125,24,13,22,6,0,0 ; vbroadcastss 0x616(%rip),%ymm9 # 6a34 <_sk_callback_avx+0x530> DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9 - DB 196,98,125,24,21,6,6,0,0 ; vbroadcastss 0x606(%rip),%ymm10 # 6ae4 <_sk_callback_avx+0x52e> + DB 196,98,125,24,21,12,6,0,0 ; vbroadcastss 0x60c(%rip),%ymm10 # 6a38 <_sk_callback_avx+0x534> DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9 DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9 - DB 196,98,125,24,21,247,5,0,0 ; vbroadcastss 0x5f7(%rip),%ymm10 # 6ae8 <_sk_callback_avx+0x532> + DB 196,98,125,24,21,253,5,0,0 ; vbroadcastss 0x5fd(%rip),%ymm10 # 6a3c <_sk_callback_avx+0x538> DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9 DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8 - DB 196,98,125,24,13,232,5,0,0 ; vbroadcastss 0x5e8(%rip),%ymm9 # 6aec <_sk_callback_avx+0x536> + DB 196,98,125,24,13,238,5,0,0 ; vbroadcastss 0x5ee(%rip),%ymm9 # 6a40 <_sk_callback_avx+0x53c> DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10976,17 +10824,17 @@ _sk_bicubic_n1y_avx LABEL PROC PUBLIC _sk_bicubic_p1y_avx _sk_bicubic_p1y_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,98,125,24,5,208,5,0,0 ; vbroadcastss 0x5d0(%rip),%ymm8 # 6af0 <_sk_callback_avx+0x53a> + DB 196,98,125,24,5,214,5,0,0 ; vbroadcastss 0x5d6(%rip),%ymm8 # 6a44 <_sk_callback_avx+0x540> DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1 DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9 - DB 196,98,125,24,21,193,5,0,0 ; vbroadcastss 0x5c1(%rip),%ymm10 # 6af4 <_sk_callback_avx+0x53e> + DB 196,98,125,24,21,199,5,0,0 ; vbroadcastss 0x5c7(%rip),%ymm10 # 6a48 <_sk_callback_avx+0x544> DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10 - DB 196,98,125,24,29,183,5,0,0 ; vbroadcastss 0x5b7(%rip),%ymm11 # 6af8 <_sk_callback_avx+0x542> + DB 196,98,125,24,29,189,5,0,0 ; vbroadcastss 0x5bd(%rip),%ymm11 # 6a4c <_sk_callback_avx+0x548> DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10 DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10 DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 - DB 196,98,125,24,13,158,5,0,0 ; vbroadcastss 0x59e(%rip),%ymm9 # 6afc <_sk_callback_avx+0x546> + DB 196,98,125,24,13,164,5,0,0 ; vbroadcastss 0x5a4(%rip),%ymm9 # 6a50 <_sk_callback_avx+0x54c> DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -10995,13 +10843,13 @@ _sk_bicubic_p1y_avx LABEL PROC PUBLIC _sk_bicubic_p3y_avx _sk_bicubic_p3y_avx LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 196,226,125,24,13,134,5,0,0 ; vbroadcastss 0x586(%rip),%ymm1 # 6b00 <_sk_callback_avx+0x54a> + DB 196,226,125,24,13,140,5,0,0 ; vbroadcastss 0x58c(%rip),%ymm1 # 6a54 <_sk_callback_avx+0x550> DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1 DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8 DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9 - DB 196,98,125,24,21,114,5,0,0 ; vbroadcastss 0x572(%rip),%ymm10 # 6b04 <_sk_callback_avx+0x54e> + DB 196,98,125,24,21,120,5,0,0 ; vbroadcastss 0x578(%rip),%ymm10 # 6a58 <_sk_callback_avx+0x554> DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8 - DB 196,98,125,24,21,104,5,0,0 ; vbroadcastss 0x568(%rip),%ymm10 # 6b08 <_sk_callback_avx+0x552> + DB 196,98,125,24,21,110,5,0,0 ; vbroadcastss 0x56e(%rip),%ymm10 # 6a5c <_sk_callback_avx+0x558> DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8 DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8 DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax) @@ -11010,15 +10858,18 @@ _sk_bicubic_p3y_avx LABEL PROC PUBLIC _sk_callback_avx _sk_callback_avx LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,84 ; push %r12 DB 83 ; push %rbx - DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp - DB 197,252,17,188,36,128,0,0,0 ; vmovups %ymm7,0x80(%rsp) - DB 197,252,17,116,36,96 ; vmovups %ymm6,0x60(%rsp) - DB 197,252,17,108,36,64 ; vmovups %ymm5,0x40(%rsp) - DB 197,252,17,100,36,32 ; vmovups %ymm4,0x20(%rsp) + DB 72,131,228,224 ; and $0xffffffffffffffe0,%rsp + DB 72,129,236,192,0,0,0 ; sub $0xc0,%rsp + DB 197,252,41,188,36,128,0,0,0 ; vmovaps %ymm7,0x80(%rsp) + DB 197,252,41,116,36,96 ; vmovaps %ymm6,0x60(%rsp) + DB 197,252,41,108,36,64 ; vmovaps %ymm5,0x40(%rsp) + DB 197,252,41,100,36,32 ; vmovaps %ymm4,0x20(%rsp) DB 77,137,196 ; mov %r8,%r12 DB 73,137,206 ; mov %rcx,%r14 DB 73,137,215 ; mov %rdx,%r15 @@ -11067,15 +10918,16 @@ _sk_callback_avx LABEL PROC DB 76,137,250 ; mov %r15,%rdx DB 76,137,241 ; mov %r14,%rcx DB 77,137,224 ; mov %r12,%r8 - DB 197,252,16,100,36,32 ; vmovups 0x20(%rsp),%ymm4 - DB 197,252,16,108,36,64 ; vmovups 0x40(%rsp),%ymm5 - DB 197,252,16,116,36,96 ; vmovups 0x60(%rsp),%ymm6 - DB 197,252,16,188,36,128,0,0,0 ; vmovups 0x80(%rsp),%ymm7 - DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp + DB 197,252,40,100,36,32 ; vmovaps 0x20(%rsp),%ymm4 + DB 197,252,40,108,36,64 ; vmovaps 0x40(%rsp),%ymm5 + DB 197,252,40,116,36,96 ; vmovaps 0x60(%rsp),%ymm6 + DB 197,252,40,188,36,128,0,0,0 ; vmovaps 0x80(%rsp),%ymm7 + DB 72,141,101,224 ; lea -0x20(%rbp),%rsp DB 91 ; pop %rbx DB 65,92 ; pop %r12 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax ALIGN 4 @@ -11119,25 +10971,25 @@ ALIGN 4 DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 678d <.literal4+0xb1> + DB 71,225,61 ; rex.RXB loope 66e1 <.literal4+0xb1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 679d <.literal4+0xc1> + DB 71,225,61 ; rex.RXB loope 66f1 <.literal4+0xc1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 67ad <.literal4+0xd1> + DB 71,225,61 ; rex.RXB loope 6701 <.literal4+0xd1> DB 0,0 ; add %al,(%rax) DB 128,63,154 ; cmpb $0x9a,(%rdi) DB 153 ; cltd DB 153 ; cltd DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax - DB 71,225,61 ; rex.RXB loope 67bd <.literal4+0xe1> + DB 71,225,61 ; rex.RXB loope 6711 <.literal4+0xe1> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax) @@ -11189,7 +11041,7 @@ ALIGN 4 DB 190,129,128,128,59 ; mov $0x3b808081,%esi DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 6811 <.literal4+0x135> + DB 224,7 ; loopne 6765 <.literal4+0x135> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -11205,10 +11057,10 @@ ALIGN 4 DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) DB 0,52,255 ; add %dh,(%rdi,%rdi,8) DB 255 ; (bad) - DB 127,0 ; jg 6838 <.literal4+0x15c> + DB 127,0 ; jg 678c <.literal4+0x15c> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 68b1 <.literal4+0x1d5> + DB 119,115 ; ja 6805 <.literal4+0x1d5> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -11222,10 +11074,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 686c <.literal4+0x190> + DB 127,0 ; jg 67c0 <.literal4+0x190> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 68e5 <.literal4+0x209> + DB 119,115 ; ja 6839 <.literal4+0x209> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -11239,10 +11091,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 68a0 <.literal4+0x1c4> + DB 127,0 ; jg 67f4 <.literal4+0x1c4> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 6919 <.literal4+0x23d> + DB 119,115 ; ja 686d <.literal4+0x23d> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -11256,10 +11108,10 @@ ALIGN 4 DB 0,128,63,0,0,0 ; add %al,0x3f(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 68d4 <.literal4+0x1f8> + DB 127,0 ; jg 6828 <.literal4+0x1f8> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 694d <.literal4+0x271> + DB 119,115 ; ja 68a1 <.literal4+0x271> DB 248 ; clc DB 194,117,191 ; retq $0xbf75 DB 191,63,249,68,180 ; mov $0xb444f93f,%edi @@ -11272,7 +11124,7 @@ ALIGN 4 DB 0,75,0 ; add %cl,0x0(%rbx) DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax) DB 66,0,0 ; rex.X add %al,(%rax) - DB 127,67 ; jg 694b <.literal4+0x26f> + DB 127,67 ; jg 689f <.literal4+0x26f> DB 0,0 ; add %al,(%rax) DB 0,195 ; add %al,%bl DB 0,0 ; add %al,(%rax) @@ -11284,10 +11136,10 @@ ALIGN 4 DB 190,80,128,3,62 ; mov $0x3e038050,%esi DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 696b <.literal4+0x28f> + DB 118,63 ; jbe 68bf <.literal4+0x28f> DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) - DB 127,67 ; jg 697f <.literal4+0x2a3> + DB 127,67 ; jg 68d3 <.literal4+0x2a3> DB 129,128,128,59,0,0,128,63,129,128 ; addl $0x80813f80,0x3b80(%rax) DB 128,59,0 ; cmpb $0x0,(%rbx) DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax) @@ -11296,7 +11148,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 6961 <.literal4+0x285> + DB 224,7 ; loopne 68b5 <.literal4+0x285> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -11308,7 +11160,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 697d <.literal4+0x2a1> + DB 224,7 ; loopne 68d1 <.literal4+0x2a1> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -11319,7 +11171,7 @@ ALIGN 4 DB 0,0 ; add %al,(%rax) DB 248 ; clc DB 65,0,0 ; add %al,(%r8) - DB 124,66 ; jl 69d2 <.literal4+0x2f6> + DB 124,66 ; jl 6926 <.literal4+0x2f6> DB 0,240 ; add %dh,%al DB 0,0 ; add %al,(%rax) DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax) @@ -11337,9 +11189,9 @@ ALIGN 4 DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax) DB 0,0 ; add %al,(%rax) DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax) - DB 112,65 ; jo 6a15 <.literal4+0x339> + DB 112,65 ; jo 6969 <.literal4+0x339> DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax) - DB 127,67 ; jg 6a23 <.literal4+0x347> + DB 127,67 ; jg 6977 <.literal4+0x347> DB 0,128,0,0,0,0 ; add %al,0x0(%rax) DB 0,128,0,4,0,128 ; add %al,-0x7ffffc00(%rax) DB 0,0 ; add %al,(%rax) @@ -11355,7 +11207,7 @@ ALIGN 4 DB 0,128,55,0,0,128 ; add %al,-0x7fffffc9(%rax) DB 63 ; (bad) DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 6a63 <.literal4+0x387> + DB 127,71 ; jg 69b7 <.literal4+0x387> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,191,0,0,0 ; add %al,0xbf(%rax) @@ -11618,38 +11470,39 @@ ALIGN 32 PUBLIC _sk_start_pipeline_sse41 _sk_start_pipeline_sse41 LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 86 ; push %rsi DB 87 ; push %rdi - DB 85 ; push %rbp DB 83 ; push %rbx - DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp - DB 68,15,41,188,36,144,0,0,0 ; movaps %xmm15,0x90(%rsp) - DB 68,15,41,180,36,128,0,0,0 ; movaps %xmm14,0x80(%rsp) - DB 68,15,41,108,36,112 ; movaps %xmm13,0x70(%rsp) - DB 68,15,41,100,36,96 ; movaps %xmm12,0x60(%rsp) - DB 68,15,41,92,36,80 ; movaps %xmm11,0x50(%rsp) - DB 68,15,41,84,36,64 ; movaps %xmm10,0x40(%rsp) - DB 68,15,41,76,36,48 ; movaps %xmm9,0x30(%rsp) - DB 68,15,41,68,36,32 ; movaps %xmm8,0x20(%rsp) - DB 15,41,124,36,16 ; movaps %xmm7,0x10(%rsp) - DB 15,41,52,36 ; movaps %xmm6,(%rsp) - DB 76,137,195 ; mov %r8,%rbx - DB 73,137,214 ; mov %rdx,%r14 - DB 72,137,205 ; mov %rcx,%rbp - DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15 + DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp + DB 68,15,41,125,176 ; movaps %xmm15,-0x50(%rbp) + DB 68,15,41,117,160 ; movaps %xmm14,-0x60(%rbp) + DB 68,15,41,109,144 ; movaps %xmm13,-0x70(%rbp) + DB 68,15,41,101,128 ; movaps %xmm12,-0x80(%rbp) + DB 68,15,41,157,112,255,255,255 ; movaps %xmm11,-0x90(%rbp) + DB 68,15,41,149,96,255,255,255 ; movaps %xmm10,-0xa0(%rbp) + DB 68,15,41,141,80,255,255,255 ; movaps %xmm9,-0xb0(%rbp) + DB 68,15,41,133,64,255,255,255 ; movaps %xmm8,-0xc0(%rbp) + DB 15,41,189,48,255,255,255 ; movaps %xmm7,-0xd0(%rbp) + DB 15,41,181,32,255,255,255 ; movaps %xmm6,-0xe0(%rbp) + DB 72,137,211 ; mov %rdx,%rbx + DB 73,137,207 ; mov %rcx,%r15 + DB 76,139,117,48 ; mov 0x30(%rbp),%r14 DB 76,137,206 ; mov %r9,%rsi DB 72,173 ; lods %ds:(%rsi),%rax - DB 73,137,196 ; mov %rax,%r12 - DB 73,137,245 ; mov %rsi,%r13 - DB 72,141,69,4 ; lea 0x4(%rbp),%rax - DB 72,57,216 ; cmp %rbx,%rax - DB 118,5 ; jbe 7c <_sk_start_pipeline_sse41+0x7c> - DB 72,137,234 ; mov %rbp,%rdx - DB 235,61 ; jmp b9 <_sk_start_pipeline_sse41+0xb9> + DB 73,137,197 ; mov %rax,%r13 + DB 73,137,244 ; mov %rsi,%r12 + DB 73,141,79,4 ; lea 0x4(%r15),%rcx + DB 76,57,193 ; cmp %r8,%rcx + DB 118,5 ; jbe 7b <_sk_start_pipeline_sse41+0x7b> + DB 76,137,250 ; mov %r15,%rdx + DB 235,75 ; jmp c6 <_sk_start_pipeline_sse41+0xc6> + DB 76,137,133,24,255,255,255 ; mov %r8,-0xe8(%rbp) DB 65,184,0,0,0,0 ; mov $0x0,%r8d DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 @@ -11659,18 +11512,19 @@ _sk_start_pipeline_sse41 LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 72,137,234 ; mov %rbp,%rdx - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 - DB 72,141,85,4 ; lea 0x4(%rbp),%rdx - DB 72,131,197,8 ; add $0x8,%rbp - DB 72,57,221 ; cmp %rbx,%rbp - DB 72,137,213 ; mov %rdx,%rbp - DB 118,195 ; jbe 7c <_sk_start_pipeline_sse41+0x7c> - DB 72,41,211 ; sub %rdx,%rbx - DB 116,39 ; je e5 <_sk_start_pipeline_sse41+0xe5> + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,250 ; mov %r15,%rdx + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 76,139,133,24,255,255,255 ; mov -0xe8(%rbp),%r8 + DB 73,141,87,4 ; lea 0x4(%r15),%rdx + DB 73,131,199,8 ; add $0x8,%r15 + DB 77,57,199 ; cmp %r8,%r15 + DB 73,137,215 ; mov %rdx,%r15 + DB 118,188 ; jbe 82 <_sk_start_pipeline_sse41+0x82> + DB 73,41,208 ; sub %rdx,%r8 + DB 116,36 ; je ef <_sk_start_pipeline_sse41+0xef> DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 DB 15,87,210 ; xorps %xmm2,%xmm2 @@ -11679,30 +11533,29 @@ _sk_start_pipeline_sse41 LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 76,137,241 ; mov %r14,%rcx - DB 73,137,216 ; mov %rbx,%r8 - DB 65,255,212 ; callq *%r12 - DB 15,40,52,36 ; movaps (%rsp),%xmm6 - DB 15,40,124,36,16 ; movaps 0x10(%rsp),%xmm7 - DB 68,15,40,68,36,32 ; movaps 0x20(%rsp),%xmm8 - DB 68,15,40,76,36,48 ; movaps 0x30(%rsp),%xmm9 - DB 68,15,40,84,36,64 ; movaps 0x40(%rsp),%xmm10 - DB 68,15,40,92,36,80 ; movaps 0x50(%rsp),%xmm11 - DB 68,15,40,100,36,96 ; movaps 0x60(%rsp),%xmm12 - DB 68,15,40,108,36,112 ; movaps 0x70(%rsp),%xmm13 - DB 68,15,40,180,36,128,0,0,0 ; movaps 0x80(%rsp),%xmm14 - DB 68,15,40,188,36,144,0,0,0 ; movaps 0x90(%rsp),%xmm15 - DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 15,40,181,32,255,255,255 ; movaps -0xe0(%rbp),%xmm6 + DB 15,40,189,48,255,255,255 ; movaps -0xd0(%rbp),%xmm7 + DB 68,15,40,133,64,255,255,255 ; movaps -0xc0(%rbp),%xmm8 + DB 68,15,40,141,80,255,255,255 ; movaps -0xb0(%rbp),%xmm9 + DB 68,15,40,149,96,255,255,255 ; movaps -0xa0(%rbp),%xmm10 + DB 68,15,40,157,112,255,255,255 ; movaps -0x90(%rbp),%xmm11 + DB 68,15,40,101,128 ; movaps -0x80(%rbp),%xmm12 + DB 68,15,40,109,144 ; movaps -0x70(%rbp),%xmm13 + DB 68,15,40,117,160 ; movaps -0x60(%rbp),%xmm14 + DB 68,15,40,125,176 ; movaps -0x50(%rbp),%xmm15 + DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp DB 91 ; pop %rbx - DB 93 ; pop %rbp DB 95 ; pop %rdi DB 94 ; pop %rsi DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 195 ; retq PUBLIC _sk_just_return_sse41 @@ -11714,7 +11567,7 @@ _sk_seed_shader_sse41 LABEL PROC DB 102,15,110,194 ; movd %edx,%xmm0 DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0 DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1 - DB 15,40,21,20,80,0,0 ; movaps 0x5014(%rip),%xmm2 # 5160 <_sk_callback_sse41+0xd3> + DB 15,40,21,23,80,0,0 ; movaps 0x5017(%rip),%xmm2 # 5170 <_sk_callback_sse41+0xd6> DB 15,88,202 ; addps %xmm2,%xmm1 DB 15,16,7 ; movups (%rdi),%xmm0 DB 15,88,193 ; addps %xmm1,%xmm0 @@ -11723,7 +11576,7 @@ _sk_seed_shader_sse41 LABEL PROC DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 15,88,202 ; addps %xmm2,%xmm1 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,21,3,80,0,0 ; movaps 0x5003(%rip),%xmm2 # 5170 <_sk_callback_sse41+0xe3> + DB 15,40,21,6,80,0,0 ; movaps 0x5006(%rip),%xmm2 # 5180 <_sk_callback_sse41+0xe6> DB 15,87,219 ; xorps %xmm3,%xmm3 DB 15,87,228 ; xorps %xmm4,%xmm4 DB 15,87,237 ; xorps %xmm5,%xmm5 @@ -11741,14 +11594,14 @@ _sk_dither_sse41 LABEL PROC DB 102,68,15,110,193 ; movd %ecx,%xmm8 DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8 DB 102,69,15,239,193 ; pxor %xmm9,%xmm8 - DB 102,68,15,111,21,209,79,0,0 ; movdqa 0x4fd1(%rip),%xmm10 # 5180 <_sk_callback_sse41+0xf3> + DB 102,68,15,111,21,212,79,0,0 ; movdqa 0x4fd4(%rip),%xmm10 # 5190 <_sk_callback_sse41+0xf6> DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11 DB 102,69,15,219,218 ; pand %xmm10,%xmm11 DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11 DB 102,69,15,219,209 ; pand %xmm9,%xmm10 DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10 - DB 102,68,15,111,37,189,79,0,0 ; movdqa 0x4fbd(%rip),%xmm12 # 5190 <_sk_callback_sse41+0x103> - DB 102,68,15,111,45,196,79,0,0 ; movdqa 0x4fc4(%rip),%xmm13 # 51a0 <_sk_callback_sse41+0x113> + DB 102,68,15,111,37,192,79,0,0 ; movdqa 0x4fc0(%rip),%xmm12 # 51a0 <_sk_callback_sse41+0x106> + DB 102,68,15,111,45,199,79,0,0 ; movdqa 0x4fc7(%rip),%xmm13 # 51b0 <_sk_callback_sse41+0x116> DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14 DB 102,69,15,219,245 ; pand %xmm13,%xmm14 DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14 @@ -11764,8 +11617,8 @@ _sk_dither_sse41 LABEL PROC DB 102,69,15,235,245 ; por %xmm13,%xmm14 DB 102,69,15,235,240 ; por %xmm8,%xmm14 DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8 - DB 68,15,89,5,127,79,0,0 ; mulps 0x4f7f(%rip),%xmm8 # 51b0 <_sk_callback_sse41+0x123> - DB 68,15,88,5,135,79,0,0 ; addps 0x4f87(%rip),%xmm8 # 51c0 <_sk_callback_sse41+0x133> + DB 68,15,89,5,130,79,0,0 ; mulps 0x4f82(%rip),%xmm8 # 51c0 <_sk_callback_sse41+0x126> + DB 68,15,88,5,138,79,0,0 ; addps 0x4f8a(%rip),%xmm8 # 51d0 <_sk_callback_sse41+0x136> DB 243,68,15,16,16 ; movss (%rax),%xmm10 DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10 DB 69,15,89,208 ; mulps %xmm8,%xmm10 @@ -11832,7 +11685,7 @@ _sk_clear_sse41 LABEL PROC PUBLIC _sk_srcatop_sse41 _sk_srcatop_sse41 LABEL PROC DB 15,89,199 ; mulps %xmm7,%xmm0 - DB 68,15,40,5,225,78,0,0 ; movaps 0x4ee1(%rip),%xmm8 # 51d0 <_sk_callback_sse41+0x143> + DB 68,15,40,5,228,78,0,0 ; movaps 0x4ee4(%rip),%xmm8 # 51e0 <_sk_callback_sse41+0x146> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -11855,7 +11708,7 @@ PUBLIC _sk_dstatop_sse41 _sk_dstatop_sse41 LABEL PROC DB 68,15,40,195 ; movaps %xmm3,%xmm8 DB 68,15,89,196 ; mulps %xmm4,%xmm8 - DB 68,15,40,13,164,78,0,0 ; movaps 0x4ea4(%rip),%xmm9 # 51e0 <_sk_callback_sse41+0x153> + DB 68,15,40,13,167,78,0,0 ; movaps 0x4ea7(%rip),%xmm9 # 51f0 <_sk_callback_sse41+0x156> DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 65,15,89,193 ; mulps %xmm9,%xmm0 DB 65,15,88,192 ; addps %xmm8,%xmm0 @@ -11896,7 +11749,7 @@ _sk_dstin_sse41 LABEL PROC PUBLIC _sk_srcout_sse41 _sk_srcout_sse41 LABEL PROC - DB 68,15,40,5,72,78,0,0 ; movaps 0x4e48(%rip),%xmm8 # 51f0 <_sk_callback_sse41+0x163> + DB 68,15,40,5,75,78,0,0 ; movaps 0x4e4b(%rip),%xmm8 # 5200 <_sk_callback_sse41+0x166> DB 68,15,92,199 ; subps %xmm7,%xmm8 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 @@ -11907,7 +11760,7 @@ _sk_srcout_sse41 LABEL PROC PUBLIC _sk_dstout_sse41 _sk_dstout_sse41 LABEL PROC - DB 68,15,40,5,56,78,0,0 ; movaps 0x4e38(%rip),%xmm8 # 5200 <_sk_callback_sse41+0x173> + DB 68,15,40,5,59,78,0,0 ; movaps 0x4e3b(%rip),%xmm8 # 5210 <_sk_callback_sse41+0x176> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 15,89,196 ; mulps %xmm4,%xmm0 @@ -11922,7 +11775,7 @@ _sk_dstout_sse41 LABEL PROC PUBLIC _sk_srcover_sse41 _sk_srcover_sse41 LABEL PROC - DB 68,15,40,5,27,78,0,0 ; movaps 0x4e1b(%rip),%xmm8 # 5210 <_sk_callback_sse41+0x183> + DB 68,15,40,5,30,78,0,0 ; movaps 0x4e1e(%rip),%xmm8 # 5220 <_sk_callback_sse41+0x186> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -11940,7 +11793,7 @@ _sk_srcover_sse41 LABEL PROC PUBLIC _sk_dstover_sse41 _sk_dstover_sse41 LABEL PROC - DB 68,15,40,5,239,77,0,0 ; movaps 0x4def(%rip),%xmm8 # 5220 <_sk_callback_sse41+0x193> + DB 68,15,40,5,242,77,0,0 ; movaps 0x4df2(%rip),%xmm8 # 5230 <_sk_callback_sse41+0x196> DB 68,15,92,199 ; subps %xmm7,%xmm8 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -11964,7 +11817,7 @@ _sk_modulate_sse41 LABEL PROC PUBLIC _sk_multiply_sse41 _sk_multiply_sse41 LABEL PROC - DB 68,15,40,5,195,77,0,0 ; movaps 0x4dc3(%rip),%xmm8 # 5230 <_sk_callback_sse41+0x1a3> + DB 68,15,40,5,198,77,0,0 ; movaps 0x4dc6(%rip),%xmm8 # 5240 <_sk_callback_sse41+0x1a6> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 69,15,40,209 ; movaps %xmm9,%xmm10 @@ -12033,7 +11886,7 @@ _sk_screen_sse41 LABEL PROC PUBLIC _sk_xor__sse41 _sk_xor__sse41 LABEL PROC DB 68,15,40,195 ; movaps %xmm3,%xmm8 - DB 15,40,29,248,76,0,0 ; movaps 0x4cf8(%rip),%xmm3 # 5240 <_sk_callback_sse41+0x1b3> + DB 15,40,29,251,76,0,0 ; movaps 0x4cfb(%rip),%xmm3 # 5250 <_sk_callback_sse41+0x1b6> DB 68,15,40,203 ; movaps %xmm3,%xmm9 DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 65,15,89,193 ; mulps %xmm9,%xmm0 @@ -12079,7 +11932,7 @@ _sk_darken_sse41 LABEL PROC DB 68,15,89,206 ; mulps %xmm6,%xmm9 DB 65,15,95,209 ; maxps %xmm9,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,99,76,0,0 ; movaps 0x4c63(%rip),%xmm2 # 5250 <_sk_callback_sse41+0x1c3> + DB 15,40,21,102,76,0,0 ; movaps 0x4c66(%rip),%xmm2 # 5260 <_sk_callback_sse41+0x1c6> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -12111,7 +11964,7 @@ _sk_lighten_sse41 LABEL PROC DB 68,15,89,206 ; mulps %xmm6,%xmm9 DB 65,15,93,209 ; minps %xmm9,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,8,76,0,0 ; movaps 0x4c08(%rip),%xmm2 # 5260 <_sk_callback_sse41+0x1d3> + DB 15,40,21,11,76,0,0 ; movaps 0x4c0b(%rip),%xmm2 # 5270 <_sk_callback_sse41+0x1d6> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -12146,7 +11999,7 @@ _sk_difference_sse41 LABEL PROC DB 65,15,93,209 ; minps %xmm9,%xmm2 DB 15,88,210 ; addps %xmm2,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,162,75,0,0 ; movaps 0x4ba2(%rip),%xmm2 # 5270 <_sk_callback_sse41+0x1e3> + DB 15,40,21,165,75,0,0 ; movaps 0x4ba5(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x1e6> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -12172,7 +12025,7 @@ _sk_exclusion_sse41 LABEL PROC DB 15,89,214 ; mulps %xmm6,%xmm2 DB 15,88,210 ; addps %xmm2,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,98,75,0,0 ; movaps 0x4b62(%rip),%xmm2 # 5280 <_sk_callback_sse41+0x1f3> + DB 15,40,21,101,75,0,0 ; movaps 0x4b65(%rip),%xmm2 # 5290 <_sk_callback_sse41+0x1f6> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -12183,7 +12036,7 @@ _sk_exclusion_sse41 LABEL PROC PUBLIC _sk_colorburn_sse41 _sk_colorburn_sse41 LABEL PROC DB 68,15,40,192 ; movaps %xmm0,%xmm8 - DB 68,15,40,21,85,75,0,0 ; movaps 0x4b55(%rip),%xmm10 # 5290 <_sk_callback_sse41+0x203> + DB 68,15,40,21,88,75,0,0 ; movaps 0x4b58(%rip),%xmm10 # 52a0 <_sk_callback_sse41+0x206> DB 69,15,40,218 ; movaps %xmm10,%xmm11 DB 68,15,92,223 ; subps %xmm7,%xmm11 DB 69,15,40,203 ; movaps %xmm11,%xmm9 @@ -12263,7 +12116,7 @@ _sk_colorburn_sse41 LABEL PROC PUBLIC _sk_colordodge_sse41 _sk_colordodge_sse41 LABEL PROC DB 68,15,40,192 ; movaps %xmm0,%xmm8 - DB 68,15,40,21,51,74,0,0 ; movaps 0x4a33(%rip),%xmm10 # 52a0 <_sk_callback_sse41+0x213> + DB 68,15,40,21,54,74,0,0 ; movaps 0x4a36(%rip),%xmm10 # 52b0 <_sk_callback_sse41+0x216> DB 69,15,40,218 ; movaps %xmm10,%xmm11 DB 68,15,92,223 ; subps %xmm7,%xmm11 DB 69,15,40,227 ; movaps %xmm11,%xmm12 @@ -12344,7 +12197,7 @@ _sk_hardlight_sse41 LABEL PROC DB 15,40,244 ; movaps %xmm4,%xmm6 DB 15,40,227 ; movaps %xmm3,%xmm4 DB 68,15,40,200 ; movaps %xmm0,%xmm9 - DB 68,15,40,21,9,73,0,0 ; movaps 0x4909(%rip),%xmm10 # 52b0 <_sk_callback_sse41+0x223> + DB 68,15,40,21,12,73,0,0 ; movaps 0x490c(%rip),%xmm10 # 52c0 <_sk_callback_sse41+0x226> DB 65,15,40,234 ; movaps %xmm10,%xmm5 DB 15,92,239 ; subps %xmm7,%xmm5 DB 15,40,197 ; movaps %xmm5,%xmm0 @@ -12426,7 +12279,7 @@ PUBLIC _sk_overlay_sse41 _sk_overlay_sse41 LABEL PROC DB 68,15,40,201 ; movaps %xmm1,%xmm9 DB 68,15,40,240 ; movaps %xmm0,%xmm14 - DB 68,15,40,21,235,71,0,0 ; movaps 0x47eb(%rip),%xmm10 # 52c0 <_sk_callback_sse41+0x233> + DB 68,15,40,21,238,71,0,0 ; movaps 0x47ee(%rip),%xmm10 # 52d0 <_sk_callback_sse41+0x236> DB 69,15,40,218 ; movaps %xmm10,%xmm11 DB 68,15,92,223 ; subps %xmm7,%xmm11 DB 65,15,40,195 ; movaps %xmm11,%xmm0 @@ -12510,7 +12363,7 @@ _sk_softlight_sse41 LABEL PROC DB 15,40,198 ; movaps %xmm6,%xmm0 DB 15,94,199 ; divps %xmm7,%xmm0 DB 65,15,84,193 ; andps %xmm9,%xmm0 - DB 15,40,13,190,70,0,0 ; movaps 0x46be(%rip),%xmm1 # 52d0 <_sk_callback_sse41+0x243> + DB 15,40,13,193,70,0,0 ; movaps 0x46c1(%rip),%xmm1 # 52e0 <_sk_callback_sse41+0x246> DB 68,15,40,209 ; movaps %xmm1,%xmm10 DB 68,15,92,208 ; subps %xmm0,%xmm10 DB 68,15,40,240 ; movaps %xmm0,%xmm14 @@ -12523,10 +12376,10 @@ _sk_softlight_sse41 LABEL PROC DB 15,40,208 ; movaps %xmm0,%xmm2 DB 15,89,210 ; mulps %xmm2,%xmm2 DB 15,88,208 ; addps %xmm0,%xmm2 - DB 68,15,40,45,156,70,0,0 ; movaps 0x469c(%rip),%xmm13 # 52e0 <_sk_callback_sse41+0x253> + DB 68,15,40,45,159,70,0,0 ; movaps 0x469f(%rip),%xmm13 # 52f0 <_sk_callback_sse41+0x256> DB 69,15,88,245 ; addps %xmm13,%xmm14 DB 68,15,89,242 ; mulps %xmm2,%xmm14 - DB 68,15,40,37,156,70,0,0 ; movaps 0x469c(%rip),%xmm12 # 52f0 <_sk_callback_sse41+0x263> + DB 68,15,40,37,159,70,0,0 ; movaps 0x469f(%rip),%xmm12 # 5300 <_sk_callback_sse41+0x266> DB 69,15,89,252 ; mulps %xmm12,%xmm15 DB 69,15,88,254 ; addps %xmm14,%xmm15 DB 15,40,198 ; movaps %xmm6,%xmm0 @@ -12712,12 +12565,12 @@ _sk_hue_sse41 LABEL PROC DB 68,15,84,208 ; andps %xmm0,%xmm10 DB 15,84,200 ; andps %xmm0,%xmm1 DB 68,15,84,232 ; andps %xmm0,%xmm13 - DB 15,40,5,2,68,0,0 ; movaps 0x4402(%rip),%xmm0 # 5300 <_sk_callback_sse41+0x273> + DB 15,40,5,5,68,0,0 ; movaps 0x4405(%rip),%xmm0 # 5310 <_sk_callback_sse41+0x276> DB 68,15,89,224 ; mulps %xmm0,%xmm12 - DB 15,40,21,7,68,0,0 ; movaps 0x4407(%rip),%xmm2 # 5310 <_sk_callback_sse41+0x283> + DB 15,40,21,10,68,0,0 ; movaps 0x440a(%rip),%xmm2 # 5320 <_sk_callback_sse41+0x286> DB 15,89,250 ; mulps %xmm2,%xmm7 DB 65,15,88,252 ; addps %xmm12,%xmm7 - DB 68,15,40,53,8,68,0,0 ; movaps 0x4408(%rip),%xmm14 # 5320 <_sk_callback_sse41+0x293> + DB 68,15,40,53,11,68,0,0 ; movaps 0x440b(%rip),%xmm14 # 5330 <_sk_callback_sse41+0x296> DB 68,15,40,252 ; movaps %xmm4,%xmm15 DB 69,15,89,254 ; mulps %xmm14,%xmm15 DB 68,15,88,255 ; addps %xmm7,%xmm15 @@ -12800,7 +12653,7 @@ _sk_hue_sse41 LABEL PROC DB 65,15,88,214 ; addps %xmm14,%xmm2 DB 15,40,196 ; movaps %xmm4,%xmm0 DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1 - DB 68,15,40,13,205,66,0,0 ; movaps 0x42cd(%rip),%xmm9 # 5330 <_sk_callback_sse41+0x2a3> + DB 68,15,40,13,208,66,0,0 ; movaps 0x42d0(%rip),%xmm9 # 5340 <_sk_callback_sse41+0x2a6> DB 65,15,40,225 ; movaps %xmm9,%xmm4 DB 15,92,229 ; subps %xmm5,%xmm4 DB 15,40,68,36,48 ; movaps 0x30(%rsp),%xmm0 @@ -12894,14 +12747,14 @@ _sk_saturation_sse41 LABEL PROC DB 68,15,84,215 ; andps %xmm7,%xmm10 DB 68,15,84,223 ; andps %xmm7,%xmm11 DB 68,15,84,199 ; andps %xmm7,%xmm8 - DB 15,40,21,128,65,0,0 ; movaps 0x4180(%rip),%xmm2 # 5340 <_sk_callback_sse41+0x2b3> + DB 15,40,21,131,65,0,0 ; movaps 0x4183(%rip),%xmm2 # 5350 <_sk_callback_sse41+0x2b6> DB 15,40,221 ; movaps %xmm5,%xmm3 DB 15,89,218 ; mulps %xmm2,%xmm3 - DB 15,40,13,131,65,0,0 ; movaps 0x4183(%rip),%xmm1 # 5350 <_sk_callback_sse41+0x2c3> + DB 15,40,13,134,65,0,0 ; movaps 0x4186(%rip),%xmm1 # 5360 <_sk_callback_sse41+0x2c6> DB 15,40,254 ; movaps %xmm6,%xmm7 DB 15,89,249 ; mulps %xmm1,%xmm7 DB 15,88,251 ; addps %xmm3,%xmm7 - DB 68,15,40,45,130,65,0,0 ; movaps 0x4182(%rip),%xmm13 # 5360 <_sk_callback_sse41+0x2d3> + DB 68,15,40,45,133,65,0,0 ; movaps 0x4185(%rip),%xmm13 # 5370 <_sk_callback_sse41+0x2d6> DB 69,15,89,245 ; mulps %xmm13,%xmm14 DB 68,15,88,247 ; addps %xmm7,%xmm14 DB 65,15,40,218 ; movaps %xmm10,%xmm3 @@ -12982,7 +12835,7 @@ _sk_saturation_sse41 LABEL PROC DB 65,15,88,253 ; addps %xmm13,%xmm7 DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 102,68,15,56,20,223 ; blendvps %xmm0,%xmm7,%xmm11 - DB 68,15,40,13,72,64,0,0 ; movaps 0x4048(%rip),%xmm9 # 5370 <_sk_callback_sse41+0x2e3> + DB 68,15,40,13,75,64,0,0 ; movaps 0x404b(%rip),%xmm9 # 5380 <_sk_callback_sse41+0x2e6> DB 69,15,40,193 ; movaps %xmm9,%xmm8 DB 68,15,92,204 ; subps %xmm4,%xmm9 DB 15,40,60,36 ; movaps (%rsp),%xmm7 @@ -13037,14 +12890,14 @@ _sk_color_sse41 LABEL PROC DB 15,40,231 ; movaps %xmm7,%xmm4 DB 68,15,89,244 ; mulps %xmm4,%xmm14 DB 15,89,204 ; mulps %xmm4,%xmm1 - DB 68,15,40,13,141,63,0,0 ; movaps 0x3f8d(%rip),%xmm9 # 5380 <_sk_callback_sse41+0x2f3> + DB 68,15,40,13,144,63,0,0 ; movaps 0x3f90(%rip),%xmm9 # 5390 <_sk_callback_sse41+0x2f6> DB 65,15,40,250 ; movaps %xmm10,%xmm7 DB 65,15,89,249 ; mulps %xmm9,%xmm7 - DB 68,15,40,21,141,63,0,0 ; movaps 0x3f8d(%rip),%xmm10 # 5390 <_sk_callback_sse41+0x303> + DB 68,15,40,21,144,63,0,0 ; movaps 0x3f90(%rip),%xmm10 # 53a0 <_sk_callback_sse41+0x306> DB 65,15,40,219 ; movaps %xmm11,%xmm3 DB 65,15,89,218 ; mulps %xmm10,%xmm3 DB 15,88,223 ; addps %xmm7,%xmm3 - DB 68,15,40,29,138,63,0,0 ; movaps 0x3f8a(%rip),%xmm11 # 53a0 <_sk_callback_sse41+0x313> + DB 68,15,40,29,141,63,0,0 ; movaps 0x3f8d(%rip),%xmm11 # 53b0 <_sk_callback_sse41+0x316> DB 69,15,40,236 ; movaps %xmm12,%xmm13 DB 69,15,89,235 ; mulps %xmm11,%xmm13 DB 68,15,88,235 ; addps %xmm3,%xmm13 @@ -13129,7 +12982,7 @@ _sk_color_sse41 LABEL PROC DB 65,15,88,251 ; addps %xmm11,%xmm7 DB 65,15,40,194 ; movaps %xmm10,%xmm0 DB 102,15,56,20,207 ; blendvps %xmm0,%xmm7,%xmm1 - DB 68,15,40,13,70,62,0,0 ; movaps 0x3e46(%rip),%xmm9 # 53b0 <_sk_callback_sse41+0x323> + DB 68,15,40,13,73,62,0,0 ; movaps 0x3e49(%rip),%xmm9 # 53c0 <_sk_callback_sse41+0x326> DB 65,15,40,193 ; movaps %xmm9,%xmm0 DB 15,92,196 ; subps %xmm4,%xmm0 DB 68,15,89,192 ; mulps %xmm0,%xmm8 @@ -13181,13 +13034,13 @@ _sk_luminosity_sse41 LABEL PROC DB 69,15,89,216 ; mulps %xmm8,%xmm11 DB 68,15,40,203 ; movaps %xmm3,%xmm9 DB 68,15,89,205 ; mulps %xmm5,%xmm9 - DB 68,15,40,5,152,61,0,0 ; movaps 0x3d98(%rip),%xmm8 # 53c0 <_sk_callback_sse41+0x333> + DB 68,15,40,5,155,61,0,0 ; movaps 0x3d9b(%rip),%xmm8 # 53d0 <_sk_callback_sse41+0x336> DB 65,15,89,192 ; mulps %xmm8,%xmm0 - DB 68,15,40,21,156,61,0,0 ; movaps 0x3d9c(%rip),%xmm10 # 53d0 <_sk_callback_sse41+0x343> + DB 68,15,40,21,159,61,0,0 ; movaps 0x3d9f(%rip),%xmm10 # 53e0 <_sk_callback_sse41+0x346> DB 15,40,233 ; movaps %xmm1,%xmm5 DB 65,15,89,234 ; mulps %xmm10,%xmm5 DB 15,88,232 ; addps %xmm0,%xmm5 - DB 68,15,40,37,154,61,0,0 ; movaps 0x3d9a(%rip),%xmm12 # 53e0 <_sk_callback_sse41+0x353> + DB 68,15,40,37,157,61,0,0 ; movaps 0x3d9d(%rip),%xmm12 # 53f0 <_sk_callback_sse41+0x356> DB 68,15,40,242 ; movaps %xmm2,%xmm14 DB 69,15,89,244 ; mulps %xmm12,%xmm14 DB 68,15,88,245 ; addps %xmm5,%xmm14 @@ -13272,7 +13125,7 @@ _sk_luminosity_sse41 LABEL PROC DB 65,15,88,244 ; addps %xmm12,%xmm6 DB 65,15,40,195 ; movaps %xmm11,%xmm0 DB 102,68,15,56,20,206 ; blendvps %xmm0,%xmm6,%xmm9 - DB 15,40,5,80,60,0,0 ; movaps 0x3c50(%rip),%xmm0 # 53f0 <_sk_callback_sse41+0x363> + DB 15,40,5,83,60,0,0 ; movaps 0x3c53(%rip),%xmm0 # 5400 <_sk_callback_sse41+0x366> DB 15,40,208 ; movaps %xmm0,%xmm2 DB 15,92,215 ; subps %xmm7,%xmm2 DB 15,89,226 ; mulps %xmm2,%xmm4 @@ -13311,23 +13164,23 @@ _sk_srcover_rgba_8888_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,217,0,0,0 ; jne 18f7 <_sk_srcover_rgba_8888_sse41+0xe7> + DB 15,133,217,0,0,0 ; jne 1904 <_sk_srcover_rgba_8888_sse41+0xe7> DB 243,15,111,60,144 ; movdqu (%rax,%rdx,4),%xmm7 DB 77,133,192 ; test %r8,%r8 - DB 102,15,111,37,210,59,0,0 ; movdqa 0x3bd2(%rip),%xmm4 # 5400 <_sk_callback_sse41+0x373> + DB 102,15,111,37,213,59,0,0 ; movdqa 0x3bd5(%rip),%xmm4 # 5410 <_sk_callback_sse41+0x376> DB 102,15,219,231 ; pand %xmm7,%xmm4 DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4 DB 102,15,111,239 ; movdqa %xmm7,%xmm5 - DB 102,15,56,0,45,206,59,0,0 ; pshufb 0x3bce(%rip),%xmm5 # 5410 <_sk_callback_sse41+0x383> + DB 102,15,56,0,45,209,59,0,0 ; pshufb 0x3bd1(%rip),%xmm5 # 5420 <_sk_callback_sse41+0x386> DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5 DB 102,15,111,247 ; movdqa %xmm7,%xmm6 - DB 102,15,56,0,53,206,59,0,0 ; pshufb 0x3bce(%rip),%xmm6 # 5420 <_sk_callback_sse41+0x393> + DB 102,15,56,0,53,209,59,0,0 ; pshufb 0x3bd1(%rip),%xmm6 # 5430 <_sk_callback_sse41+0x396> DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6 DB 102,15,114,215,24 ; psrld $0x18,%xmm7 DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7 - DB 68,15,40,5,203,59,0,0 ; movaps 0x3bcb(%rip),%xmm8 # 5430 <_sk_callback_sse41+0x3a3> + DB 68,15,40,5,206,59,0,0 ; movaps 0x3bce(%rip),%xmm8 # 5440 <_sk_callback_sse41+0x3a6> DB 68,15,92,195 ; subps %xmm3,%xmm8 - DB 68,15,40,37,207,59,0,0 ; movaps 0x3bcf(%rip),%xmm12 # 5440 <_sk_callback_sse41+0x3b3> + DB 68,15,40,37,210,59,0,0 ; movaps 0x3bd2(%rip),%xmm12 # 5450 <_sk_callback_sse41+0x3b6> DB 65,15,89,196 ; mulps %xmm12,%xmm0 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -13353,7 +13206,7 @@ _sk_srcover_rgba_8888_sse41 LABEL PROC DB 102,15,114,240,24 ; pslld $0x18,%xmm0 DB 102,15,235,194 ; por %xmm2,%xmm0 DB 102,15,235,193 ; por %xmm1,%xmm0 - DB 117,89 ; jne 1937 <_sk_srcover_rgba_8888_sse41+0x127> + DB 117,89 ; jne 1944 <_sk_srcover_rgba_8888_sse41+0x127> DB 243,15,127,4,144 ; movdqu %xmm0,(%rax,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,193 ; movaps %xmm9,%xmm0 @@ -13365,28 +13218,28 @@ _sk_srcover_rgba_8888_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,255 ; pxor %xmm7,%xmm7 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,35 ; je 192b <_sk_srcover_rgba_8888_sse41+0x11b> + DB 116,35 ; je 1938 <_sk_srcover_rgba_8888_sse41+0x11b> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 1923 <_sk_srcover_rgba_8888_sse41+0x113> + DB 116,21 ; je 1930 <_sk_srcover_rgba_8888_sse41+0x113> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 15,133,11,255,255,255 ; jne 1823 <_sk_srcover_rgba_8888_sse41+0x13> + DB 15,133,11,255,255,255 ; jne 1830 <_sk_srcover_rgba_8888_sse41+0x13> DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4 DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7 DB 102,15,58,34,124,144,4,1 ; pinsrd $0x1,0x4(%rax,%rdx,4),%xmm7 DB 102,15,58,34,60,144,0 ; pinsrd $0x0,(%rax,%rdx,4),%xmm7 - DB 233,236,254,255,255 ; jmpq 1823 <_sk_srcover_rgba_8888_sse41+0x13> + DB 233,236,254,255,255 ; jmpq 1830 <_sk_srcover_rgba_8888_sse41+0x13> DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,28 ; je 1960 <_sk_srcover_rgba_8888_sse41+0x150> + DB 116,28 ; je 196d <_sk_srcover_rgba_8888_sse41+0x150> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,14 ; je 1958 <_sk_srcover_rgba_8888_sse41+0x148> + DB 116,14 ; je 1965 <_sk_srcover_rgba_8888_sse41+0x148> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,147 ; jne 18e3 <_sk_srcover_rgba_8888_sse41+0xd3> + DB 117,147 ; jne 18f0 <_sk_srcover_rgba_8888_sse41+0xd3> DB 102,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm0,0x8(%rax,%rdx,4) DB 102,15,58,22,68,144,4,1 ; pextrd $0x1,%xmm0,0x4(%rax,%rdx,4) DB 102,15,126,4,144 ; movd %xmm0,(%rax,%rdx,4) - DB 233,121,255,255,255 ; jmpq 18e3 <_sk_srcover_rgba_8888_sse41+0xd3> + DB 233,121,255,255,255 ; jmpq 18f0 <_sk_srcover_rgba_8888_sse41+0xd3> PUBLIC _sk_clamp_0_sse41 _sk_clamp_0_sse41 LABEL PROC @@ -13400,7 +13253,7 @@ _sk_clamp_0_sse41 LABEL PROC PUBLIC _sk_clamp_1_sse41 _sk_clamp_1_sse41 LABEL PROC - DB 68,15,40,5,198,58,0,0 ; movaps 0x3ac6(%rip),%xmm8 # 5450 <_sk_callback_sse41+0x3c3> + DB 68,15,40,5,201,58,0,0 ; movaps 0x3ac9(%rip),%xmm8 # 5460 <_sk_callback_sse41+0x3c6> DB 65,15,93,192 ; minps %xmm8,%xmm0 DB 65,15,93,200 ; minps %xmm8,%xmm1 DB 65,15,93,208 ; minps %xmm8,%xmm2 @@ -13410,7 +13263,7 @@ _sk_clamp_1_sse41 LABEL PROC PUBLIC _sk_clamp_a_sse41 _sk_clamp_a_sse41 LABEL PROC - DB 15,93,29,187,58,0,0 ; minps 0x3abb(%rip),%xmm3 # 5460 <_sk_callback_sse41+0x3d3> + DB 15,93,29,190,58,0,0 ; minps 0x3abe(%rip),%xmm3 # 5470 <_sk_callback_sse41+0x3d6> DB 15,93,195 ; minps %xmm3,%xmm0 DB 15,93,203 ; minps %xmm3,%xmm1 DB 15,93,211 ; minps %xmm3,%xmm2 @@ -13483,7 +13336,7 @@ _sk_premul_sse41 LABEL PROC PUBLIC _sk_unpremul_sse41 _sk_unpremul_sse41 LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 - DB 68,15,40,13,38,58,0,0 ; movaps 0x3a26(%rip),%xmm9 # 5470 <_sk_callback_sse41+0x3e3> + DB 68,15,40,13,41,58,0,0 ; movaps 0x3a29(%rip),%xmm9 # 5480 <_sk_callback_sse41+0x3e6> DB 68,15,94,203 ; divps %xmm3,%xmm9 DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8 DB 69,15,84,193 ; andps %xmm9,%xmm8 @@ -13495,20 +13348,20 @@ _sk_unpremul_sse41 LABEL PROC PUBLIC _sk_from_srgb_sse41 _sk_from_srgb_sse41 LABEL PROC - DB 68,15,40,29,17,58,0,0 ; movaps 0x3a11(%rip),%xmm11 # 5480 <_sk_callback_sse41+0x3f3> + DB 68,15,40,29,20,58,0,0 ; movaps 0x3a14(%rip),%xmm11 # 5490 <_sk_callback_sse41+0x3f6> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 DB 68,15,40,208 ; movaps %xmm0,%xmm10 DB 69,15,89,210 ; mulps %xmm10,%xmm10 - DB 68,15,40,37,9,58,0,0 ; movaps 0x3a09(%rip),%xmm12 # 5490 <_sk_callback_sse41+0x403> + DB 68,15,40,37,12,58,0,0 ; movaps 0x3a0c(%rip),%xmm12 # 54a0 <_sk_callback_sse41+0x406> DB 68,15,40,192 ; movaps %xmm0,%xmm8 DB 69,15,89,196 ; mulps %xmm12,%xmm8 - DB 68,15,40,45,9,58,0,0 ; movaps 0x3a09(%rip),%xmm13 # 54a0 <_sk_callback_sse41+0x413> + DB 68,15,40,45,12,58,0,0 ; movaps 0x3a0c(%rip),%xmm13 # 54b0 <_sk_callback_sse41+0x416> DB 69,15,88,197 ; addps %xmm13,%xmm8 DB 69,15,89,194 ; mulps %xmm10,%xmm8 - DB 68,15,40,53,9,58,0,0 ; movaps 0x3a09(%rip),%xmm14 # 54b0 <_sk_callback_sse41+0x423> + DB 68,15,40,53,12,58,0,0 ; movaps 0x3a0c(%rip),%xmm14 # 54c0 <_sk_callback_sse41+0x426> DB 69,15,88,198 ; addps %xmm14,%xmm8 - DB 68,15,40,61,13,58,0,0 ; movaps 0x3a0d(%rip),%xmm15 # 54c0 <_sk_callback_sse41+0x433> + DB 68,15,40,61,16,58,0,0 ; movaps 0x3a10(%rip),%xmm15 # 54d0 <_sk_callback_sse41+0x436> DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0 DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8 DB 68,15,40,209 ; movaps %xmm1,%xmm10 @@ -13550,22 +13403,22 @@ _sk_to_srgb_sse41 LABEL PROC DB 15,40,218 ; movaps %xmm2,%xmm3 DB 15,40,209 ; movaps %xmm1,%xmm2 DB 68,15,82,192 ; rsqrtps %xmm0,%xmm8 - DB 68,15,40,29,130,57,0,0 ; movaps 0x3982(%rip),%xmm11 # 54d0 <_sk_callback_sse41+0x443> + DB 68,15,40,29,133,57,0,0 ; movaps 0x3985(%rip),%xmm11 # 54e0 <_sk_callback_sse41+0x446> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 - DB 68,15,40,37,130,57,0,0 ; movaps 0x3982(%rip),%xmm12 # 54e0 <_sk_callback_sse41+0x453> + DB 68,15,40,37,133,57,0,0 ; movaps 0x3985(%rip),%xmm12 # 54f0 <_sk_callback_sse41+0x456> DB 69,15,40,248 ; movaps %xmm8,%xmm15 DB 69,15,89,252 ; mulps %xmm12,%xmm15 - DB 68,15,40,21,130,57,0,0 ; movaps 0x3982(%rip),%xmm10 # 54f0 <_sk_callback_sse41+0x463> + DB 68,15,40,21,133,57,0,0 ; movaps 0x3985(%rip),%xmm10 # 5500 <_sk_callback_sse41+0x466> DB 69,15,88,250 ; addps %xmm10,%xmm15 DB 69,15,89,248 ; mulps %xmm8,%xmm15 - DB 68,15,40,45,130,57,0,0 ; movaps 0x3982(%rip),%xmm13 # 5500 <_sk_callback_sse41+0x473> + DB 68,15,40,45,133,57,0,0 ; movaps 0x3985(%rip),%xmm13 # 5510 <_sk_callback_sse41+0x476> DB 69,15,88,253 ; addps %xmm13,%xmm15 - DB 68,15,40,53,134,57,0,0 ; movaps 0x3986(%rip),%xmm14 # 5510 <_sk_callback_sse41+0x483> + DB 68,15,40,53,137,57,0,0 ; movaps 0x3989(%rip),%xmm14 # 5520 <_sk_callback_sse41+0x486> DB 69,15,88,198 ; addps %xmm14,%xmm8 DB 69,15,83,192 ; rcpps %xmm8,%xmm8 DB 69,15,89,199 ; mulps %xmm15,%xmm8 - DB 68,15,40,61,130,57,0,0 ; movaps 0x3982(%rip),%xmm15 # 5520 <_sk_callback_sse41+0x493> + DB 68,15,40,61,133,57,0,0 ; movaps 0x3985(%rip),%xmm15 # 5530 <_sk_callback_sse41+0x496> DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0 DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8 DB 68,15,82,202 ; rsqrtps %xmm2,%xmm9 @@ -13617,7 +13470,7 @@ _sk_rgb_to_hsl_sse41 LABEL PROC DB 68,15,93,226 ; minps %xmm2,%xmm12 DB 65,15,40,203 ; movaps %xmm11,%xmm1 DB 65,15,92,204 ; subps %xmm12,%xmm1 - DB 68,15,40,53,204,56,0,0 ; movaps 0x38cc(%rip),%xmm14 # 5530 <_sk_callback_sse41+0x4a3> + DB 68,15,40,53,207,56,0,0 ; movaps 0x38cf(%rip),%xmm14 # 5540 <_sk_callback_sse41+0x4a6> DB 68,15,94,241 ; divps %xmm1,%xmm14 DB 69,15,40,211 ; movaps %xmm11,%xmm10 DB 69,15,194,208,0 ; cmpeqps %xmm8,%xmm10 @@ -13626,27 +13479,27 @@ _sk_rgb_to_hsl_sse41 LABEL PROC DB 65,15,89,198 ; mulps %xmm14,%xmm0 DB 69,15,40,249 ; movaps %xmm9,%xmm15 DB 68,15,194,250,1 ; cmpltps %xmm2,%xmm15 - DB 68,15,84,61,179,56,0,0 ; andps 0x38b3(%rip),%xmm15 # 5540 <_sk_callback_sse41+0x4b3> + DB 68,15,84,61,182,56,0,0 ; andps 0x38b6(%rip),%xmm15 # 5550 <_sk_callback_sse41+0x4b6> DB 68,15,88,248 ; addps %xmm0,%xmm15 DB 65,15,40,195 ; movaps %xmm11,%xmm0 DB 65,15,194,193,0 ; cmpeqps %xmm9,%xmm0 DB 65,15,92,208 ; subps %xmm8,%xmm2 DB 65,15,89,214 ; mulps %xmm14,%xmm2 - DB 68,15,40,45,166,56,0,0 ; movaps 0x38a6(%rip),%xmm13 # 5550 <_sk_callback_sse41+0x4c3> + DB 68,15,40,45,169,56,0,0 ; movaps 0x38a9(%rip),%xmm13 # 5560 <_sk_callback_sse41+0x4c6> DB 65,15,88,213 ; addps %xmm13,%xmm2 DB 69,15,92,193 ; subps %xmm9,%xmm8 DB 69,15,89,198 ; mulps %xmm14,%xmm8 - DB 68,15,88,5,162,56,0,0 ; addps 0x38a2(%rip),%xmm8 # 5560 <_sk_callback_sse41+0x4d3> + DB 68,15,88,5,165,56,0,0 ; addps 0x38a5(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x4d6> DB 102,68,15,56,20,194 ; blendvps %xmm0,%xmm2,%xmm8 DB 65,15,40,194 ; movaps %xmm10,%xmm0 DB 102,69,15,56,20,199 ; blendvps %xmm0,%xmm15,%xmm8 - DB 68,15,89,5,154,56,0,0 ; mulps 0x389a(%rip),%xmm8 # 5570 <_sk_callback_sse41+0x4e3> + DB 68,15,89,5,157,56,0,0 ; mulps 0x389d(%rip),%xmm8 # 5580 <_sk_callback_sse41+0x4e6> DB 69,15,40,203 ; movaps %xmm11,%xmm9 DB 69,15,194,204,4 ; cmpneqps %xmm12,%xmm9 DB 69,15,84,193 ; andps %xmm9,%xmm8 DB 69,15,92,235 ; subps %xmm11,%xmm13 DB 69,15,88,220 ; addps %xmm12,%xmm11 - DB 15,40,5,142,56,0,0 ; movaps 0x388e(%rip),%xmm0 # 5580 <_sk_callback_sse41+0x4f3> + DB 15,40,5,145,56,0,0 ; movaps 0x3891(%rip),%xmm0 # 5590 <_sk_callback_sse41+0x4f6> DB 65,15,40,211 ; movaps %xmm11,%xmm2 DB 15,89,208 ; mulps %xmm0,%xmm2 DB 15,194,194,1 ; cmpltps %xmm2,%xmm0 @@ -13667,7 +13520,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC DB 15,41,100,36,32 ; movaps %xmm4,0x20(%rsp) DB 15,41,92,36,16 ; movaps %xmm3,0x10(%rsp) DB 68,15,40,208 ; movaps %xmm0,%xmm10 - DB 68,15,40,13,80,56,0,0 ; movaps 0x3850(%rip),%xmm9 # 5590 <_sk_callback_sse41+0x503> + DB 68,15,40,13,83,56,0,0 ; movaps 0x3853(%rip),%xmm9 # 55a0 <_sk_callback_sse41+0x506> DB 65,15,40,193 ; movaps %xmm9,%xmm0 DB 15,194,194,2 ; cmpleps %xmm2,%xmm0 DB 15,40,217 ; movaps %xmm1,%xmm3 @@ -13680,19 +13533,19 @@ _sk_hsl_to_rgb_sse41 LABEL PROC DB 15,41,20,36 ; movaps %xmm2,(%rsp) DB 69,15,88,192 ; addps %xmm8,%xmm8 DB 68,15,92,197 ; subps %xmm5,%xmm8 - DB 68,15,40,53,44,56,0,0 ; movaps 0x382c(%rip),%xmm14 # 55a0 <_sk_callback_sse41+0x513> + DB 68,15,40,53,47,56,0,0 ; movaps 0x382f(%rip),%xmm14 # 55b0 <_sk_callback_sse41+0x516> DB 69,15,88,242 ; addps %xmm10,%xmm14 DB 102,65,15,58,8,198,1 ; roundps $0x1,%xmm14,%xmm0 DB 68,15,92,240 ; subps %xmm0,%xmm14 - DB 68,15,40,29,37,56,0,0 ; movaps 0x3825(%rip),%xmm11 # 55b0 <_sk_callback_sse41+0x523> + DB 68,15,40,29,40,56,0,0 ; movaps 0x3828(%rip),%xmm11 # 55c0 <_sk_callback_sse41+0x526> DB 65,15,40,195 ; movaps %xmm11,%xmm0 DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0 DB 15,40,245 ; movaps %xmm5,%xmm6 DB 65,15,92,240 ; subps %xmm8,%xmm6 - DB 15,40,61,30,56,0,0 ; movaps 0x381e(%rip),%xmm7 # 55c0 <_sk_callback_sse41+0x533> + DB 15,40,61,33,56,0,0 ; movaps 0x3821(%rip),%xmm7 # 55d0 <_sk_callback_sse41+0x536> DB 69,15,40,238 ; movaps %xmm14,%xmm13 DB 68,15,89,239 ; mulps %xmm7,%xmm13 - DB 15,40,29,31,56,0,0 ; movaps 0x381f(%rip),%xmm3 # 55d0 <_sk_callback_sse41+0x543> + DB 15,40,29,34,56,0,0 ; movaps 0x3822(%rip),%xmm3 # 55e0 <_sk_callback_sse41+0x546> DB 68,15,40,227 ; movaps %xmm3,%xmm12 DB 69,15,92,229 ; subps %xmm13,%xmm12 DB 68,15,89,230 ; mulps %xmm6,%xmm12 @@ -13702,7 +13555,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0 DB 68,15,40,253 ; movaps %xmm5,%xmm15 DB 102,69,15,56,20,252 ; blendvps %xmm0,%xmm12,%xmm15 - DB 68,15,40,37,254,55,0,0 ; movaps 0x37fe(%rip),%xmm12 # 55e0 <_sk_callback_sse41+0x553> + DB 68,15,40,37,1,56,0,0 ; movaps 0x3801(%rip),%xmm12 # 55f0 <_sk_callback_sse41+0x556> DB 65,15,40,196 ; movaps %xmm12,%xmm0 DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0 DB 68,15,89,238 ; mulps %xmm6,%xmm13 @@ -13736,7 +13589,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC DB 65,15,40,198 ; movaps %xmm14,%xmm0 DB 15,40,20,36 ; movaps (%rsp),%xmm2 DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1 - DB 68,15,88,21,119,55,0,0 ; addps 0x3777(%rip),%xmm10 # 55f0 <_sk_callback_sse41+0x563> + DB 68,15,88,21,122,55,0,0 ; addps 0x377a(%rip),%xmm10 # 5600 <_sk_callback_sse41+0x566> DB 102,65,15,58,8,194,1 ; roundps $0x1,%xmm10,%xmm0 DB 68,15,92,208 ; subps %xmm0,%xmm10 DB 69,15,194,218,2 ; cmpleps %xmm10,%xmm11 @@ -13784,11 +13637,11 @@ _sk_scale_u8_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,52 ; jne 1f56 <_sk_scale_u8_sse41+0x3e> + DB 117,52 ; jne 1f63 <_sk_scale_u8_sse41+0x3e> DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8 - DB 102,68,15,219,5,206,54,0,0 ; pand 0x36ce(%rip),%xmm8 # 5600 <_sk_callback_sse41+0x573> + DB 102,68,15,219,5,209,54,0,0 ; pand 0x36d1(%rip),%xmm8 # 5610 <_sk_callback_sse41+0x576> DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,210,54,0,0 ; mulps 0x36d2(%rip),%xmm8 # 5610 <_sk_callback_sse41+0x583> + DB 68,15,89,5,213,54,0,0 ; mulps 0x36d5(%rip),%xmm8 # 5620 <_sk_callback_sse41+0x586> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 65,15,89,208 ; mulps %xmm8,%xmm2 @@ -13800,11 +13653,11 @@ _sk_scale_u8_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,42 ; je 1f92 <_sk_scale_u8_sse41+0x7a> + DB 116,42 ; je 1f9f <_sk_scale_u8_sse41+0x7a> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,23 ; je 1f85 <_sk_scale_u8_sse41+0x6d> + DB 116,23 ; je 1f92 <_sk_scale_u8_sse41+0x6d> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,181 ; jne 1f29 <_sk_scale_u8_sse41+0x11> + DB 117,181 ; jne 1f36 <_sk_scale_u8_sse41+0x11> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8 @@ -13812,7 +13665,7 @@ _sk_scale_u8_sse41 LABEL PROC DB 102,68,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm8 DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,68,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm8 - DB 235,137 ; jmp 1f29 <_sk_scale_u8_sse41+0x11> + DB 235,137 ; jmp 1f36 <_sk_scale_u8_sse41+0x11> PUBLIC _sk_lerp_1_float_sse41 _sk_lerp_1_float_sse41 LABEL PROC @@ -13839,11 +13692,11 @@ _sk_lerp_u8_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,72 ; jne 202a <_sk_lerp_u8_sse41+0x52> + DB 117,72 ; jne 2037 <_sk_lerp_u8_sse41+0x52> DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8 - DB 102,68,15,219,5,46,54,0,0 ; pand 0x362e(%rip),%xmm8 # 5620 <_sk_callback_sse41+0x593> + DB 102,68,15,219,5,49,54,0,0 ; pand 0x3631(%rip),%xmm8 # 5630 <_sk_callback_sse41+0x596> DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,50,54,0,0 ; mulps 0x3632(%rip),%xmm8 # 5630 <_sk_callback_sse41+0x5a3> + DB 68,15,89,5,53,54,0,0 ; mulps 0x3635(%rip),%xmm8 # 5640 <_sk_callback_sse41+0x5a6> DB 15,92,196 ; subps %xmm4,%xmm0 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -13862,11 +13715,11 @@ _sk_lerp_u8_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,42 ; je 2066 <_sk_lerp_u8_sse41+0x8e> + DB 116,42 ; je 2073 <_sk_lerp_u8_sse41+0x8e> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,23 ; je 2059 <_sk_lerp_u8_sse41+0x81> + DB 116,23 ; je 2066 <_sk_lerp_u8_sse41+0x81> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,161 ; jne 1fe9 <_sk_lerp_u8_sse41+0x11> + DB 117,161 ; jne 1ff6 <_sk_lerp_u8_sse41+0x11> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8 @@ -13874,26 +13727,26 @@ _sk_lerp_u8_sse41 LABEL PROC DB 102,68,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm8 DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,68,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm8 - DB 233,114,255,255,255 ; jmpq 1fe9 <_sk_lerp_u8_sse41+0x11> + DB 233,114,255,255,255 ; jmpq 1ff6 <_sk_lerp_u8_sse41+0x11> PUBLIC _sk_lerp_565_sse41 _sk_lerp_565_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,152,0,0,0 ; jne 211d <_sk_lerp_565_sse41+0xa6> + DB 15,133,152,0,0,0 ; jne 212a <_sk_lerp_565_sse41+0xa6> DB 102,69,15,56,51,12,82 ; pmovzxwd (%r10,%rdx,2),%xmm9 - DB 102,68,15,111,5,171,53,0,0 ; movdqa 0x35ab(%rip),%xmm8 # 5640 <_sk_callback_sse41+0x5b3> + DB 102,68,15,111,5,174,53,0,0 ; movdqa 0x35ae(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x5b6> DB 102,69,15,219,193 ; pand %xmm9,%xmm8 DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,170,53,0,0 ; mulps 0x35aa(%rip),%xmm8 # 5650 <_sk_callback_sse41+0x5c3> - DB 102,68,15,111,21,177,53,0,0 ; movdqa 0x35b1(%rip),%xmm10 # 5660 <_sk_callback_sse41+0x5d3> + DB 68,15,89,5,173,53,0,0 ; mulps 0x35ad(%rip),%xmm8 # 5660 <_sk_callback_sse41+0x5c6> + DB 102,68,15,111,21,180,53,0,0 ; movdqa 0x35b4(%rip),%xmm10 # 5670 <_sk_callback_sse41+0x5d6> DB 102,69,15,219,209 ; pand %xmm9,%xmm10 DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 - DB 68,15,89,21,176,53,0,0 ; mulps 0x35b0(%rip),%xmm10 # 5670 <_sk_callback_sse41+0x5e3> - DB 102,68,15,219,13,183,53,0,0 ; pand 0x35b7(%rip),%xmm9 # 5680 <_sk_callback_sse41+0x5f3> + DB 68,15,89,21,179,53,0,0 ; mulps 0x35b3(%rip),%xmm10 # 5680 <_sk_callback_sse41+0x5e6> + DB 102,68,15,219,13,186,53,0,0 ; pand 0x35ba(%rip),%xmm9 # 5690 <_sk_callback_sse41+0x5f6> DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9 - DB 68,15,89,13,187,53,0,0 ; mulps 0x35bb(%rip),%xmm9 # 5690 <_sk_callback_sse41+0x603> + DB 68,15,89,13,190,53,0,0 ; mulps 0x35be(%rip),%xmm9 # 56a0 <_sk_callback_sse41+0x606> DB 15,92,196 ; subps %xmm4,%xmm0 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -13919,11 +13772,11 @@ _sk_lerp_565_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,46 ; je 215d <_sk_lerp_565_sse41+0xe6> + DB 116,46 ; je 216a <_sk_lerp_565_sse41+0xe6> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,27 ; je 2150 <_sk_lerp_565_sse41+0xd9> + DB 116,27 ; je 215d <_sk_lerp_565_sse41+0xd9> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 15,133,77,255,255,255 ; jne 208c <_sk_lerp_565_sse41+0x15> + DB 15,133,77,255,255,255 ; jne 2099 <_sk_lerp_565_sse41+0x15> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,200,69 ; pshufd $0x45,%xmm8,%xmm9 @@ -13931,19 +13784,19 @@ _sk_lerp_565_sse41 LABEL PROC DB 102,68,15,58,34,200,1 ; pinsrd $0x1,%eax,%xmm9 DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,68,15,58,34,200,0 ; pinsrd $0x0,%eax,%xmm9 - DB 233,30,255,255,255 ; jmpq 208c <_sk_lerp_565_sse41+0x15> + DB 233,30,255,255,255 ; jmpq 2099 <_sk_lerp_565_sse41+0x15> PUBLIC _sk_load_tables_sse41 _sk_load_tables_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 77,133,192 ; test %r8,%r8 - DB 15,133,24,1,0,0 ; jne 2294 <_sk_load_tables_sse41+0x126> + DB 15,133,24,1,0,0 ; jne 22a1 <_sk_load_tables_sse41+0x126> DB 243,69,15,111,4,145 ; movdqu (%r9,%rdx,4),%xmm8 DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 83 ; push %rbx - DB 102,15,111,5,17,53,0,0 ; movdqa 0x3511(%rip),%xmm0 # 56a0 <_sk_callback_sse41+0x613> + DB 102,15,111,5,20,53,0,0 ; movdqa 0x3514(%rip),%xmm0 # 56b0 <_sk_callback_sse41+0x616> DB 102,65,15,219,192 ; pand %xmm8,%xmm0 DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9 DB 102,73,15,126,194 ; movq %xmm0,%r10 @@ -13958,7 +13811,7 @@ _sk_load_tables_sse41 LABEL PROC DB 102,66,15,58,33,4,179,32 ; insertps $0x20,(%rbx,%r14,4),%xmm0 DB 102,66,15,58,33,4,11,48 ; insertps $0x30,(%rbx,%r9,1),%xmm0 DB 102,65,15,111,200 ; movdqa %xmm8,%xmm1 - DB 102,15,56,0,13,204,52,0,0 ; pshufb 0x34cc(%rip),%xmm1 # 56b0 <_sk_callback_sse41+0x623> + DB 102,15,56,0,13,207,52,0,0 ; pshufb 0x34cf(%rip),%xmm1 # 56c0 <_sk_callback_sse41+0x626> DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9 DB 102,72,15,126,203 ; movq %xmm1,%rbx DB 68,15,182,211 ; movzbl %bl,%r10d @@ -13973,7 +13826,7 @@ _sk_load_tables_sse41 LABEL PROC DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1 DB 76,139,72,24 ; mov 0x18(%rax),%r9 DB 102,65,15,111,208 ; movdqa %xmm8,%xmm2 - DB 102,15,56,0,21,136,52,0,0 ; pshufb 0x3488(%rip),%xmm2 # 56c0 <_sk_callback_sse41+0x633> + DB 102,15,56,0,21,139,52,0,0 ; pshufb 0x348b(%rip),%xmm2 # 56d0 <_sk_callback_sse41+0x636> DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx DB 102,72,15,126,208 ; movq %xmm2,%rax DB 68,15,182,208 ; movzbl %al,%r10d @@ -13988,7 +13841,7 @@ _sk_load_tables_sse41 LABEL PROC DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2 DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8 DB 65,15,91,216 ; cvtdq2ps %xmm8,%xmm3 - DB 15,89,29,69,52,0,0 ; mulps 0x3445(%rip),%xmm3 # 56d0 <_sk_callback_sse41+0x643> + DB 15,89,29,72,52,0,0 ; mulps 0x3448(%rip),%xmm3 # 56e0 <_sk_callback_sse41+0x646> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 65,94 ; pop %r14 @@ -13998,16 +13851,16 @@ _sk_load_tables_sse41 LABEL PROC DB 65,128,226,3 ; and $0x3,%r10b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,250,1 ; cmp $0x1,%r10b - DB 116,38 ; je 22cc <_sk_load_tables_sse41+0x15e> + DB 116,38 ; je 22d9 <_sk_load_tables_sse41+0x15e> DB 65,128,250,2 ; cmp $0x2,%r10b - DB 116,23 ; je 22c3 <_sk_load_tables_sse41+0x155> + DB 116,23 ; je 22d0 <_sk_load_tables_sse41+0x155> DB 65,128,250,3 ; cmp $0x3,%r10b - DB 15,133,204,254,255,255 ; jne 2182 <_sk_load_tables_sse41+0x14> + DB 15,133,204,254,255,255 ; jne 218f <_sk_load_tables_sse41+0x14> DB 102,65,15,110,68,145,8 ; movd 0x8(%r9,%rdx,4),%xmm0 DB 102,68,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm8 DB 102,69,15,58,34,68,145,4,1 ; pinsrd $0x1,0x4(%r9,%rdx,4),%xmm8 DB 102,69,15,58,34,4,145,0 ; pinsrd $0x0,(%r9,%rdx,4),%xmm8 - DB 233,169,254,255,255 ; jmpq 2182 <_sk_load_tables_sse41+0x14> + DB 233,169,254,255,255 ; jmpq 218f <_sk_load_tables_sse41+0x14> PUBLIC _sk_load_tables_u16_be_sse41 _sk_load_tables_u16_be_sse41 LABEL PROC @@ -14015,7 +13868,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,99,1,0,0 ; jne 2452 <_sk_load_tables_u16_be_sse41+0x179> + DB 15,133,99,1,0,0 ; jne 245f <_sk_load_tables_u16_be_sse41+0x179> DB 102,67,15,16,4,81 ; movupd (%r9,%r10,2),%xmm0 DB 243,67,15,111,76,81,16 ; movdqu 0x10(%r9,%r10,2),%xmm1 DB 65,87 ; push %r15 @@ -14027,7 +13880,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1 DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1 DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9 - DB 102,68,15,111,5,186,51,0,0 ; movdqa 0x33ba(%rip),%xmm8 # 56e0 <_sk_callback_sse41+0x653> + DB 102,68,15,111,5,189,51,0,0 ; movdqa 0x33bd(%rip),%xmm8 # 56f0 <_sk_callback_sse41+0x656> DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,65,15,219,192 ; pand %xmm8,%xmm0 DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0 @@ -14045,7 +13898,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC DB 102,15,58,33,194,32 ; insertps $0x20,%xmm2,%xmm0 DB 243,66,15,16,20,11 ; movss (%rbx,%r9,1),%xmm2 DB 102,15,58,33,194,48 ; insertps $0x30,%xmm2,%xmm0 - DB 102,15,56,0,13,105,51,0,0 ; pshufb 0x3369(%rip),%xmm1 # 56f0 <_sk_callback_sse41+0x663> + DB 102,15,56,0,13,108,51,0,0 ; pshufb 0x336c(%rip),%xmm1 # 5700 <_sk_callback_sse41+0x666> DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1 DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9 DB 102,72,15,126,203 ; movq %xmm1,%rbx @@ -14081,7 +13934,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC DB 102,65,15,235,216 ; por %xmm8,%xmm3 DB 102,15,56,51,219 ; pmovzxwd %xmm3,%xmm3 DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,183,50,0,0 ; mulps 0x32b7(%rip),%xmm3 # 5700 <_sk_callback_sse41+0x673> + DB 15,89,29,186,50,0,0 ; mulps 0x32ba(%rip),%xmm3 # 5710 <_sk_callback_sse41+0x676> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 65,94 ; pop %r14 @@ -14089,16 +13942,16 @@ _sk_load_tables_u16_be_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,67,15,16,4,81 ; movsd (%r9,%r10,2),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,13 ; jne 246b <_sk_load_tables_u16_be_sse41+0x192> + DB 117,13 ; jne 2478 <_sk_load_tables_u16_be_sse41+0x192> DB 243,15,126,192 ; movq %xmm0,%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,145,254,255,255 ; jmpq 22fc <_sk_load_tables_u16_be_sse41+0x23> + DB 233,145,254,255,255 ; jmpq 2309 <_sk_load_tables_u16_be_sse41+0x23> DB 102,67,15,22,68,81,8 ; movhpd 0x8(%r9,%r10,2),%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,124,254,255,255 ; jb 22fc <_sk_load_tables_u16_be_sse41+0x23> + DB 15,130,124,254,255,255 ; jb 2309 <_sk_load_tables_u16_be_sse41+0x23> DB 243,67,15,126,76,81,16 ; movq 0x10(%r9,%r10,2),%xmm1 - DB 233,112,254,255,255 ; jmpq 22fc <_sk_load_tables_u16_be_sse41+0x23> + DB 233,112,254,255,255 ; jmpq 2309 <_sk_load_tables_u16_be_sse41+0x23> PUBLIC _sk_load_tables_rgb_u16_be_sse41 _sk_load_tables_rgb_u16_be_sse41 LABEL PROC @@ -14106,7 +13959,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,83,1,0,0 ; jne 25f1 <_sk_load_tables_rgb_u16_be_sse41+0x165> + DB 15,133,83,1,0,0 ; jne 25fe <_sk_load_tables_rgb_u16_be_sse41+0x165> DB 243,67,15,111,20,81 ; movdqu (%r9,%r10,2),%xmm2 DB 243,67,15,111,76,81,8 ; movdqu 0x8(%r9,%r10,2),%xmm1 DB 102,15,115,217,4 ; psrldq $0x4,%xmm1 @@ -14121,7 +13974,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9 DB 102,15,111,202 ; movdqa %xmm2,%xmm1 DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1 - DB 102,68,15,111,5,44,50,0,0 ; movdqa 0x322c(%rip),%xmm8 # 5710 <_sk_callback_sse41+0x683> + DB 102,68,15,111,5,47,50,0,0 ; movdqa 0x322f(%rip),%xmm8 # 5720 <_sk_callback_sse41+0x686> DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,65,15,219,192 ; pand %xmm8,%xmm0 DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0 @@ -14139,7 +13992,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC DB 102,15,58,33,195,32 ; insertps $0x20,%xmm3,%xmm0 DB 243,66,15,16,28,11 ; movss (%rbx,%r9,1),%xmm3 DB 102,15,58,33,195,48 ; insertps $0x30,%xmm3,%xmm0 - DB 102,15,56,0,13,219,49,0,0 ; pshufb 0x31db(%rip),%xmm1 # 5720 <_sk_callback_sse41+0x693> + DB 102,15,56,0,13,222,49,0,0 ; pshufb 0x31de(%rip),%xmm1 # 5730 <_sk_callback_sse41+0x696> DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1 DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9 DB 102,72,15,126,203 ; movq %xmm1,%rbx @@ -14170,7 +14023,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC DB 243,65,15,16,28,25 ; movss (%r9,%rbx,1),%xmm3 DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,70,49,0,0 ; movaps 0x3146(%rip),%xmm3 # 5730 <_sk_callback_sse41+0x6a3> + DB 15,40,29,73,49,0,0 ; movaps 0x3149(%rip),%xmm3 # 5740 <_sk_callback_sse41+0x6a6> DB 91 ; pop %rbx DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 @@ -14179,21 +14032,21 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC DB 102,67,15,196,84,81,4,2 ; pinsrw $0x2,0x4(%r9,%r10,2),%xmm2 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,14 ; jne 2617 <_sk_load_tables_rgb_u16_be_sse41+0x18b> + DB 117,14 ; jne 2624 <_sk_load_tables_rgb_u16_be_sse41+0x18b> DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 - DB 233,173,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38> + DB 233,173,254,255,255 ; jmpq 24d1 <_sk_load_tables_rgb_u16_be_sse41+0x38> DB 102,71,15,110,76,81,6 ; movd 0x6(%r9,%r10,2),%xmm9 DB 102,71,15,196,76,81,10,2 ; pinsrw $0x2,0xa(%r9,%r10,2),%xmm9 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,24 ; jb 2648 <_sk_load_tables_rgb_u16_be_sse41+0x1bc> + DB 114,24 ; jb 2655 <_sk_load_tables_rgb_u16_be_sse41+0x1bc> DB 102,67,15,110,76,81,12 ; movd 0xc(%r9,%r10,2),%xmm1 DB 102,67,15,196,76,81,16,2 ; pinsrw $0x2,0x10(%r9,%r10,2),%xmm1 DB 102,15,239,192 ; pxor %xmm0,%xmm0 - DB 233,124,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38> + DB 233,124,254,255,255 ; jmpq 24d1 <_sk_load_tables_rgb_u16_be_sse41+0x38> DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,115,254,255,255 ; jmpq 24c4 <_sk_load_tables_rgb_u16_be_sse41+0x38> + DB 233,115,254,255,255 ; jmpq 24d1 <_sk_load_tables_rgb_u16_be_sse41+0x38> PUBLIC _sk_byte_tables_sse41 _sk_byte_tables_sse41 LABEL PROC @@ -14202,7 +14055,7 @@ _sk_byte_tables_sse41 LABEL PROC DB 65,84 ; push %r12 DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,222,48,0,0 ; movaps 0x30de(%rip),%xmm8 # 5740 <_sk_callback_sse41+0x6b3> + DB 68,15,40,5,225,48,0,0 ; movaps 0x30e1(%rip),%xmm8 # 5750 <_sk_callback_sse41+0x6b6> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0 DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9 @@ -14221,7 +14074,7 @@ _sk_byte_tables_sse41 LABEL PROC DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0 DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,13,143,48,0,0 ; movaps 0x308f(%rip),%xmm9 # 5750 <_sk_callback_sse41+0x6c3> + DB 68,15,40,13,146,48,0,0 ; movaps 0x3092(%rip),%xmm9 # 5760 <_sk_callback_sse41+0x6c6> DB 65,15,89,193 ; mulps %xmm9,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1 @@ -14315,7 +14168,7 @@ _sk_byte_tables_rgb_sse41 LABEL PROC DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0 DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,13,7,47,0,0 ; movaps 0x2f07(%rip),%xmm9 # 5760 <_sk_callback_sse41+0x6d3> + DB 68,15,40,13,10,47,0,0 ; movaps 0x2f0a(%rip),%xmm9 # 5770 <_sk_callback_sse41+0x6d6> DB 65,15,89,193 ; mulps %xmm9,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1 @@ -14492,31 +14345,31 @@ _sk_parametric_r_sse41 LABEL PROC DB 69,15,88,208 ; addps %xmm8,%xmm10 DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11 DB 69,15,91,194 ; cvtdq2ps %xmm10,%xmm8 - DB 68,15,89,5,79,44,0,0 ; mulps 0x2c4f(%rip),%xmm8 # 5770 <_sk_callback_sse41+0x6e3> - DB 68,15,84,21,87,44,0,0 ; andps 0x2c57(%rip),%xmm10 # 5780 <_sk_callback_sse41+0x6f3> - DB 68,15,86,21,95,44,0,0 ; orps 0x2c5f(%rip),%xmm10 # 5790 <_sk_callback_sse41+0x703> - DB 68,15,88,5,103,44,0,0 ; addps 0x2c67(%rip),%xmm8 # 57a0 <_sk_callback_sse41+0x713> - DB 68,15,40,37,111,44,0,0 ; movaps 0x2c6f(%rip),%xmm12 # 57b0 <_sk_callback_sse41+0x723> + DB 68,15,89,5,82,44,0,0 ; mulps 0x2c52(%rip),%xmm8 # 5780 <_sk_callback_sse41+0x6e6> + DB 68,15,84,21,90,44,0,0 ; andps 0x2c5a(%rip),%xmm10 # 5790 <_sk_callback_sse41+0x6f6> + DB 68,15,86,21,98,44,0,0 ; orps 0x2c62(%rip),%xmm10 # 57a0 <_sk_callback_sse41+0x706> + DB 68,15,88,5,106,44,0,0 ; addps 0x2c6a(%rip),%xmm8 # 57b0 <_sk_callback_sse41+0x716> + DB 68,15,40,37,114,44,0,0 ; movaps 0x2c72(%rip),%xmm12 # 57c0 <_sk_callback_sse41+0x726> DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 69,15,92,196 ; subps %xmm12,%xmm8 - DB 68,15,88,21,111,44,0,0 ; addps 0x2c6f(%rip),%xmm10 # 57c0 <_sk_callback_sse41+0x733> - DB 68,15,40,37,119,44,0,0 ; movaps 0x2c77(%rip),%xmm12 # 57d0 <_sk_callback_sse41+0x743> + DB 68,15,88,21,114,44,0,0 ; addps 0x2c72(%rip),%xmm10 # 57d0 <_sk_callback_sse41+0x736> + DB 68,15,40,37,122,44,0,0 ; movaps 0x2c7a(%rip),%xmm12 # 57e0 <_sk_callback_sse41+0x746> DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,92,196 ; subps %xmm12,%xmm8 DB 69,15,89,195 ; mulps %xmm11,%xmm8 DB 102,69,15,58,8,208,1 ; roundps $0x1,%xmm8,%xmm10 DB 69,15,40,216 ; movaps %xmm8,%xmm11 DB 69,15,92,218 ; subps %xmm10,%xmm11 - DB 68,15,88,5,100,44,0,0 ; addps 0x2c64(%rip),%xmm8 # 57e0 <_sk_callback_sse41+0x753> - DB 68,15,40,21,108,44,0,0 ; movaps 0x2c6c(%rip),%xmm10 # 57f0 <_sk_callback_sse41+0x763> + DB 68,15,88,5,103,44,0,0 ; addps 0x2c67(%rip),%xmm8 # 57f0 <_sk_callback_sse41+0x756> + DB 68,15,40,21,111,44,0,0 ; movaps 0x2c6f(%rip),%xmm10 # 5800 <_sk_callback_sse41+0x766> DB 69,15,89,211 ; mulps %xmm11,%xmm10 DB 69,15,92,194 ; subps %xmm10,%xmm8 - DB 68,15,40,21,108,44,0,0 ; movaps 0x2c6c(%rip),%xmm10 # 5800 <_sk_callback_sse41+0x773> + DB 68,15,40,21,111,44,0,0 ; movaps 0x2c6f(%rip),%xmm10 # 5810 <_sk_callback_sse41+0x776> DB 69,15,92,211 ; subps %xmm11,%xmm10 - DB 68,15,40,29,112,44,0,0 ; movaps 0x2c70(%rip),%xmm11 # 5810 <_sk_callback_sse41+0x783> + DB 68,15,40,29,115,44,0,0 ; movaps 0x2c73(%rip),%xmm11 # 5820 <_sk_callback_sse41+0x786> DB 69,15,94,218 ; divps %xmm10,%xmm11 DB 69,15,88,216 ; addps %xmm8,%xmm11 - DB 68,15,89,29,112,44,0,0 ; mulps 0x2c70(%rip),%xmm11 # 5820 <_sk_callback_sse41+0x793> + DB 68,15,89,29,115,44,0,0 ; mulps 0x2c73(%rip),%xmm11 # 5830 <_sk_callback_sse41+0x796> DB 102,69,15,91,211 ; cvtps2dq %xmm11,%xmm10 DB 243,68,15,16,64,20 ; movss 0x14(%rax),%xmm8 DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8 @@ -14524,7 +14377,7 @@ _sk_parametric_r_sse41 LABEL PROC DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8 DB 15,87,192 ; xorps %xmm0,%xmm0 DB 68,15,95,192 ; maxps %xmm0,%xmm8 - DB 68,15,93,5,87,44,0,0 ; minps 0x2c57(%rip),%xmm8 # 5830 <_sk_callback_sse41+0x7a3> + DB 68,15,93,5,90,44,0,0 ; minps 0x2c5a(%rip),%xmm8 # 5840 <_sk_callback_sse41+0x7a6> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -14552,31 +14405,31 @@ _sk_parametric_g_sse41 LABEL PROC DB 68,15,88,217 ; addps %xmm1,%xmm11 DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10 DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12 - DB 68,15,89,37,248,43,0,0 ; mulps 0x2bf8(%rip),%xmm12 # 5840 <_sk_callback_sse41+0x7b3> - DB 68,15,84,29,0,44,0,0 ; andps 0x2c00(%rip),%xmm11 # 5850 <_sk_callback_sse41+0x7c3> - DB 68,15,86,29,8,44,0,0 ; orps 0x2c08(%rip),%xmm11 # 5860 <_sk_callback_sse41+0x7d3> - DB 68,15,88,37,16,44,0,0 ; addps 0x2c10(%rip),%xmm12 # 5870 <_sk_callback_sse41+0x7e3> - DB 15,40,13,25,44,0,0 ; movaps 0x2c19(%rip),%xmm1 # 5880 <_sk_callback_sse41+0x7f3> + DB 68,15,89,37,251,43,0,0 ; mulps 0x2bfb(%rip),%xmm12 # 5850 <_sk_callback_sse41+0x7b6> + DB 68,15,84,29,3,44,0,0 ; andps 0x2c03(%rip),%xmm11 # 5860 <_sk_callback_sse41+0x7c6> + DB 68,15,86,29,11,44,0,0 ; orps 0x2c0b(%rip),%xmm11 # 5870 <_sk_callback_sse41+0x7d6> + DB 68,15,88,37,19,44,0,0 ; addps 0x2c13(%rip),%xmm12 # 5880 <_sk_callback_sse41+0x7e6> + DB 15,40,13,28,44,0,0 ; movaps 0x2c1c(%rip),%xmm1 # 5890 <_sk_callback_sse41+0x7f6> DB 65,15,89,203 ; mulps %xmm11,%xmm1 DB 68,15,92,225 ; subps %xmm1,%xmm12 - DB 68,15,88,29,25,44,0,0 ; addps 0x2c19(%rip),%xmm11 # 5890 <_sk_callback_sse41+0x803> - DB 15,40,13,34,44,0,0 ; movaps 0x2c22(%rip),%xmm1 # 58a0 <_sk_callback_sse41+0x813> + DB 68,15,88,29,28,44,0,0 ; addps 0x2c1c(%rip),%xmm11 # 58a0 <_sk_callback_sse41+0x806> + DB 15,40,13,37,44,0,0 ; movaps 0x2c25(%rip),%xmm1 # 58b0 <_sk_callback_sse41+0x816> DB 65,15,94,203 ; divps %xmm11,%xmm1 DB 68,15,92,225 ; subps %xmm1,%xmm12 DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10 DB 69,15,40,220 ; movaps %xmm12,%xmm11 DB 69,15,92,218 ; subps %xmm10,%xmm11 - DB 68,15,88,37,15,44,0,0 ; addps 0x2c0f(%rip),%xmm12 # 58b0 <_sk_callback_sse41+0x823> - DB 15,40,13,24,44,0,0 ; movaps 0x2c18(%rip),%xmm1 # 58c0 <_sk_callback_sse41+0x833> + DB 68,15,88,37,18,44,0,0 ; addps 0x2c12(%rip),%xmm12 # 58c0 <_sk_callback_sse41+0x826> + DB 15,40,13,27,44,0,0 ; movaps 0x2c1b(%rip),%xmm1 # 58d0 <_sk_callback_sse41+0x836> DB 65,15,89,203 ; mulps %xmm11,%xmm1 DB 68,15,92,225 ; subps %xmm1,%xmm12 - DB 68,15,40,21,24,44,0,0 ; movaps 0x2c18(%rip),%xmm10 # 58d0 <_sk_callback_sse41+0x843> + DB 68,15,40,21,27,44,0,0 ; movaps 0x2c1b(%rip),%xmm10 # 58e0 <_sk_callback_sse41+0x846> DB 69,15,92,211 ; subps %xmm11,%xmm10 - DB 15,40,13,29,44,0,0 ; movaps 0x2c1d(%rip),%xmm1 # 58e0 <_sk_callback_sse41+0x853> + DB 15,40,13,32,44,0,0 ; movaps 0x2c20(%rip),%xmm1 # 58f0 <_sk_callback_sse41+0x856> DB 65,15,94,202 ; divps %xmm10,%xmm1 DB 65,15,88,204 ; addps %xmm12,%xmm1 - DB 15,89,13,30,44,0,0 ; mulps 0x2c1e(%rip),%xmm1 # 58f0 <_sk_callback_sse41+0x863> + DB 15,89,13,33,44,0,0 ; mulps 0x2c21(%rip),%xmm1 # 5900 <_sk_callback_sse41+0x866> DB 102,68,15,91,209 ; cvtps2dq %xmm1,%xmm10 DB 243,15,16,72,20 ; movss 0x14(%rax),%xmm1 DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1 @@ -14584,7 +14437,7 @@ _sk_parametric_g_sse41 LABEL PROC DB 102,65,15,56,20,201 ; blendvps %xmm0,%xmm9,%xmm1 DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,95,200 ; maxps %xmm0,%xmm1 - DB 15,93,13,9,44,0,0 ; minps 0x2c09(%rip),%xmm1 # 5900 <_sk_callback_sse41+0x873> + DB 15,93,13,12,44,0,0 ; minps 0x2c0c(%rip),%xmm1 # 5910 <_sk_callback_sse41+0x876> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -14612,31 +14465,31 @@ _sk_parametric_b_sse41 LABEL PROC DB 68,15,88,218 ; addps %xmm2,%xmm11 DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10 DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12 - DB 68,15,89,37,170,43,0,0 ; mulps 0x2baa(%rip),%xmm12 # 5910 <_sk_callback_sse41+0x883> - DB 68,15,84,29,178,43,0,0 ; andps 0x2bb2(%rip),%xmm11 # 5920 <_sk_callback_sse41+0x893> - DB 68,15,86,29,186,43,0,0 ; orps 0x2bba(%rip),%xmm11 # 5930 <_sk_callback_sse41+0x8a3> - DB 68,15,88,37,194,43,0,0 ; addps 0x2bc2(%rip),%xmm12 # 5940 <_sk_callback_sse41+0x8b3> - DB 15,40,21,203,43,0,0 ; movaps 0x2bcb(%rip),%xmm2 # 5950 <_sk_callback_sse41+0x8c3> + DB 68,15,89,37,173,43,0,0 ; mulps 0x2bad(%rip),%xmm12 # 5920 <_sk_callback_sse41+0x886> + DB 68,15,84,29,181,43,0,0 ; andps 0x2bb5(%rip),%xmm11 # 5930 <_sk_callback_sse41+0x896> + DB 68,15,86,29,189,43,0,0 ; orps 0x2bbd(%rip),%xmm11 # 5940 <_sk_callback_sse41+0x8a6> + DB 68,15,88,37,197,43,0,0 ; addps 0x2bc5(%rip),%xmm12 # 5950 <_sk_callback_sse41+0x8b6> + DB 15,40,21,206,43,0,0 ; movaps 0x2bce(%rip),%xmm2 # 5960 <_sk_callback_sse41+0x8c6> DB 65,15,89,211 ; mulps %xmm11,%xmm2 DB 68,15,92,226 ; subps %xmm2,%xmm12 - DB 68,15,88,29,203,43,0,0 ; addps 0x2bcb(%rip),%xmm11 # 5960 <_sk_callback_sse41+0x8d3> - DB 15,40,21,212,43,0,0 ; movaps 0x2bd4(%rip),%xmm2 # 5970 <_sk_callback_sse41+0x8e3> + DB 68,15,88,29,206,43,0,0 ; addps 0x2bce(%rip),%xmm11 # 5970 <_sk_callback_sse41+0x8d6> + DB 15,40,21,215,43,0,0 ; movaps 0x2bd7(%rip),%xmm2 # 5980 <_sk_callback_sse41+0x8e6> DB 65,15,94,211 ; divps %xmm11,%xmm2 DB 68,15,92,226 ; subps %xmm2,%xmm12 DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10 DB 69,15,40,220 ; movaps %xmm12,%xmm11 DB 69,15,92,218 ; subps %xmm10,%xmm11 - DB 68,15,88,37,193,43,0,0 ; addps 0x2bc1(%rip),%xmm12 # 5980 <_sk_callback_sse41+0x8f3> - DB 15,40,21,202,43,0,0 ; movaps 0x2bca(%rip),%xmm2 # 5990 <_sk_callback_sse41+0x903> + DB 68,15,88,37,196,43,0,0 ; addps 0x2bc4(%rip),%xmm12 # 5990 <_sk_callback_sse41+0x8f6> + DB 15,40,21,205,43,0,0 ; movaps 0x2bcd(%rip),%xmm2 # 59a0 <_sk_callback_sse41+0x906> DB 65,15,89,211 ; mulps %xmm11,%xmm2 DB 68,15,92,226 ; subps %xmm2,%xmm12 - DB 68,15,40,21,202,43,0,0 ; movaps 0x2bca(%rip),%xmm10 # 59a0 <_sk_callback_sse41+0x913> + DB 68,15,40,21,205,43,0,0 ; movaps 0x2bcd(%rip),%xmm10 # 59b0 <_sk_callback_sse41+0x916> DB 69,15,92,211 ; subps %xmm11,%xmm10 - DB 15,40,21,207,43,0,0 ; movaps 0x2bcf(%rip),%xmm2 # 59b0 <_sk_callback_sse41+0x923> + DB 15,40,21,210,43,0,0 ; movaps 0x2bd2(%rip),%xmm2 # 59c0 <_sk_callback_sse41+0x926> DB 65,15,94,210 ; divps %xmm10,%xmm2 DB 65,15,88,212 ; addps %xmm12,%xmm2 - DB 15,89,21,208,43,0,0 ; mulps 0x2bd0(%rip),%xmm2 # 59c0 <_sk_callback_sse41+0x933> + DB 15,89,21,211,43,0,0 ; mulps 0x2bd3(%rip),%xmm2 # 59d0 <_sk_callback_sse41+0x936> DB 102,68,15,91,210 ; cvtps2dq %xmm2,%xmm10 DB 243,15,16,80,20 ; movss 0x14(%rax),%xmm2 DB 15,198,210,0 ; shufps $0x0,%xmm2,%xmm2 @@ -14644,7 +14497,7 @@ _sk_parametric_b_sse41 LABEL PROC DB 102,65,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm2 DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,95,208 ; maxps %xmm0,%xmm2 - DB 15,93,21,187,43,0,0 ; minps 0x2bbb(%rip),%xmm2 # 59d0 <_sk_callback_sse41+0x943> + DB 15,93,21,190,43,0,0 ; minps 0x2bbe(%rip),%xmm2 # 59e0 <_sk_callback_sse41+0x946> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -14672,31 +14525,31 @@ _sk_parametric_a_sse41 LABEL PROC DB 68,15,88,219 ; addps %xmm3,%xmm11 DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10 DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12 - DB 68,15,89,37,92,43,0,0 ; mulps 0x2b5c(%rip),%xmm12 # 59e0 <_sk_callback_sse41+0x953> - DB 68,15,84,29,100,43,0,0 ; andps 0x2b64(%rip),%xmm11 # 59f0 <_sk_callback_sse41+0x963> - DB 68,15,86,29,108,43,0,0 ; orps 0x2b6c(%rip),%xmm11 # 5a00 <_sk_callback_sse41+0x973> - DB 68,15,88,37,116,43,0,0 ; addps 0x2b74(%rip),%xmm12 # 5a10 <_sk_callback_sse41+0x983> - DB 15,40,29,125,43,0,0 ; movaps 0x2b7d(%rip),%xmm3 # 5a20 <_sk_callback_sse41+0x993> + DB 68,15,89,37,95,43,0,0 ; mulps 0x2b5f(%rip),%xmm12 # 59f0 <_sk_callback_sse41+0x956> + DB 68,15,84,29,103,43,0,0 ; andps 0x2b67(%rip),%xmm11 # 5a00 <_sk_callback_sse41+0x966> + DB 68,15,86,29,111,43,0,0 ; orps 0x2b6f(%rip),%xmm11 # 5a10 <_sk_callback_sse41+0x976> + DB 68,15,88,37,119,43,0,0 ; addps 0x2b77(%rip),%xmm12 # 5a20 <_sk_callback_sse41+0x986> + DB 15,40,29,128,43,0,0 ; movaps 0x2b80(%rip),%xmm3 # 5a30 <_sk_callback_sse41+0x996> DB 65,15,89,219 ; mulps %xmm11,%xmm3 DB 68,15,92,227 ; subps %xmm3,%xmm12 - DB 68,15,88,29,125,43,0,0 ; addps 0x2b7d(%rip),%xmm11 # 5a30 <_sk_callback_sse41+0x9a3> - DB 15,40,29,134,43,0,0 ; movaps 0x2b86(%rip),%xmm3 # 5a40 <_sk_callback_sse41+0x9b3> + DB 68,15,88,29,128,43,0,0 ; addps 0x2b80(%rip),%xmm11 # 5a40 <_sk_callback_sse41+0x9a6> + DB 15,40,29,137,43,0,0 ; movaps 0x2b89(%rip),%xmm3 # 5a50 <_sk_callback_sse41+0x9b6> DB 65,15,94,219 ; divps %xmm11,%xmm3 DB 68,15,92,227 ; subps %xmm3,%xmm12 DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10 DB 69,15,40,220 ; movaps %xmm12,%xmm11 DB 69,15,92,218 ; subps %xmm10,%xmm11 - DB 68,15,88,37,115,43,0,0 ; addps 0x2b73(%rip),%xmm12 # 5a50 <_sk_callback_sse41+0x9c3> - DB 15,40,29,124,43,0,0 ; movaps 0x2b7c(%rip),%xmm3 # 5a60 <_sk_callback_sse41+0x9d3> + DB 68,15,88,37,118,43,0,0 ; addps 0x2b76(%rip),%xmm12 # 5a60 <_sk_callback_sse41+0x9c6> + DB 15,40,29,127,43,0,0 ; movaps 0x2b7f(%rip),%xmm3 # 5a70 <_sk_callback_sse41+0x9d6> DB 65,15,89,219 ; mulps %xmm11,%xmm3 DB 68,15,92,227 ; subps %xmm3,%xmm12 - DB 68,15,40,21,124,43,0,0 ; movaps 0x2b7c(%rip),%xmm10 # 5a70 <_sk_callback_sse41+0x9e3> + DB 68,15,40,21,127,43,0,0 ; movaps 0x2b7f(%rip),%xmm10 # 5a80 <_sk_callback_sse41+0x9e6> DB 69,15,92,211 ; subps %xmm11,%xmm10 - DB 15,40,29,129,43,0,0 ; movaps 0x2b81(%rip),%xmm3 # 5a80 <_sk_callback_sse41+0x9f3> + DB 15,40,29,132,43,0,0 ; movaps 0x2b84(%rip),%xmm3 # 5a90 <_sk_callback_sse41+0x9f6> DB 65,15,94,218 ; divps %xmm10,%xmm3 DB 65,15,88,220 ; addps %xmm12,%xmm3 - DB 15,89,29,130,43,0,0 ; mulps 0x2b82(%rip),%xmm3 # 5a90 <_sk_callback_sse41+0xa03> + DB 15,89,29,133,43,0,0 ; mulps 0x2b85(%rip),%xmm3 # 5aa0 <_sk_callback_sse41+0xa06> DB 102,68,15,91,211 ; cvtps2dq %xmm3,%xmm10 DB 243,15,16,88,20 ; movss 0x14(%rax),%xmm3 DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3 @@ -14704,7 +14557,7 @@ _sk_parametric_a_sse41 LABEL PROC DB 102,65,15,56,20,217 ; blendvps %xmm0,%xmm9,%xmm3 DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,95,216 ; maxps %xmm0,%xmm3 - DB 15,93,29,109,43,0,0 ; minps 0x2b6d(%rip),%xmm3 # 5aa0 <_sk_callback_sse41+0xa13> + DB 15,93,29,112,43,0,0 ; minps 0x2b70(%rip),%xmm3 # 5ab0 <_sk_callback_sse41+0xa16> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -14712,29 +14565,29 @@ _sk_parametric_a_sse41 LABEL PROC PUBLIC _sk_lab_to_xyz_sse41 _sk_lab_to_xyz_sse41 LABEL PROC DB 68,15,40,192 ; movaps %xmm0,%xmm8 - DB 68,15,89,5,105,43,0,0 ; mulps 0x2b69(%rip),%xmm8 # 5ab0 <_sk_callback_sse41+0xa23> - DB 68,15,40,13,113,43,0,0 ; movaps 0x2b71(%rip),%xmm9 # 5ac0 <_sk_callback_sse41+0xa33> + DB 68,15,89,5,108,43,0,0 ; mulps 0x2b6c(%rip),%xmm8 # 5ac0 <_sk_callback_sse41+0xa26> + DB 68,15,40,13,116,43,0,0 ; movaps 0x2b74(%rip),%xmm9 # 5ad0 <_sk_callback_sse41+0xa36> DB 65,15,89,201 ; mulps %xmm9,%xmm1 - DB 15,40,5,118,43,0,0 ; movaps 0x2b76(%rip),%xmm0 # 5ad0 <_sk_callback_sse41+0xa43> + DB 15,40,5,121,43,0,0 ; movaps 0x2b79(%rip),%xmm0 # 5ae0 <_sk_callback_sse41+0xa46> DB 15,88,200 ; addps %xmm0,%xmm1 DB 65,15,89,209 ; mulps %xmm9,%xmm2 DB 15,88,208 ; addps %xmm0,%xmm2 - DB 68,15,88,5,116,43,0,0 ; addps 0x2b74(%rip),%xmm8 # 5ae0 <_sk_callback_sse41+0xa53> - DB 68,15,89,5,124,43,0,0 ; mulps 0x2b7c(%rip),%xmm8 # 5af0 <_sk_callback_sse41+0xa63> - DB 15,89,13,133,43,0,0 ; mulps 0x2b85(%rip),%xmm1 # 5b00 <_sk_callback_sse41+0xa73> + DB 68,15,88,5,119,43,0,0 ; addps 0x2b77(%rip),%xmm8 # 5af0 <_sk_callback_sse41+0xa56> + DB 68,15,89,5,127,43,0,0 ; mulps 0x2b7f(%rip),%xmm8 # 5b00 <_sk_callback_sse41+0xa66> + DB 15,89,13,136,43,0,0 ; mulps 0x2b88(%rip),%xmm1 # 5b10 <_sk_callback_sse41+0xa76> DB 65,15,88,200 ; addps %xmm8,%xmm1 - DB 15,89,21,138,43,0,0 ; mulps 0x2b8a(%rip),%xmm2 # 5b10 <_sk_callback_sse41+0xa83> + DB 15,89,21,141,43,0,0 ; mulps 0x2b8d(%rip),%xmm2 # 5b20 <_sk_callback_sse41+0xa86> DB 69,15,40,208 ; movaps %xmm8,%xmm10 DB 68,15,92,210 ; subps %xmm2,%xmm10 DB 68,15,40,217 ; movaps %xmm1,%xmm11 DB 69,15,89,219 ; mulps %xmm11,%xmm11 DB 68,15,89,217 ; mulps %xmm1,%xmm11 - DB 68,15,40,13,126,43,0,0 ; movaps 0x2b7e(%rip),%xmm9 # 5b20 <_sk_callback_sse41+0xa93> + DB 68,15,40,13,129,43,0,0 ; movaps 0x2b81(%rip),%xmm9 # 5b30 <_sk_callback_sse41+0xa96> DB 65,15,40,193 ; movaps %xmm9,%xmm0 DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0 - DB 15,40,21,126,43,0,0 ; movaps 0x2b7e(%rip),%xmm2 # 5b30 <_sk_callback_sse41+0xaa3> + DB 15,40,21,129,43,0,0 ; movaps 0x2b81(%rip),%xmm2 # 5b40 <_sk_callback_sse41+0xaa6> DB 15,88,202 ; addps %xmm2,%xmm1 - DB 68,15,40,37,131,43,0,0 ; movaps 0x2b83(%rip),%xmm12 # 5b40 <_sk_callback_sse41+0xab3> + DB 68,15,40,37,134,43,0,0 ; movaps 0x2b86(%rip),%xmm12 # 5b50 <_sk_callback_sse41+0xab6> DB 65,15,89,204 ; mulps %xmm12,%xmm1 DB 102,65,15,56,20,203 ; blendvps %xmm0,%xmm11,%xmm1 DB 69,15,40,216 ; movaps %xmm8,%xmm11 @@ -14753,8 +14606,8 @@ _sk_lab_to_xyz_sse41 LABEL PROC DB 65,15,89,212 ; mulps %xmm12,%xmm2 DB 65,15,40,193 ; movaps %xmm9,%xmm0 DB 102,65,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm2 - DB 15,89,13,60,43,0,0 ; mulps 0x2b3c(%rip),%xmm1 # 5b50 <_sk_callback_sse41+0xac3> - DB 15,89,21,69,43,0,0 ; mulps 0x2b45(%rip),%xmm2 # 5b60 <_sk_callback_sse41+0xad3> + DB 15,89,13,63,43,0,0 ; mulps 0x2b3f(%rip),%xmm1 # 5b60 <_sk_callback_sse41+0xac6> + DB 15,89,21,72,43,0,0 ; mulps 0x2b48(%rip),%xmm2 # 5b70 <_sk_callback_sse41+0xad6> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,40,193 ; movaps %xmm1,%xmm0 DB 65,15,40,200 ; movaps %xmm8,%xmm1 @@ -14765,11 +14618,11 @@ _sk_load_a8_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,38 ; jne 3056 <_sk_load_a8_sse41+0x30> + DB 117,38 ; jne 3063 <_sk_load_a8_sse41+0x30> DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0 - DB 102,15,219,5,49,43,0,0 ; pand 0x2b31(%rip),%xmm0 # 5b70 <_sk_callback_sse41+0xae3> + DB 102,15,219,5,52,43,0,0 ; pand 0x2b34(%rip),%xmm0 # 5b80 <_sk_callback_sse41+0xae6> DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3 - DB 15,89,29,55,43,0,0 ; mulps 0x2b37(%rip),%xmm3 # 5b80 <_sk_callback_sse41+0xaf3> + DB 15,89,29,58,43,0,0 ; mulps 0x2b3a(%rip),%xmm3 # 5b90 <_sk_callback_sse41+0xaf6> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 @@ -14779,11 +14632,11 @@ _sk_load_a8_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,39 ; je 308e <_sk_load_a8_sse41+0x68> + DB 116,39 ; je 309b <_sk_load_a8_sse41+0x68> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 3082 <_sk_load_a8_sse41+0x5c> + DB 116,21 ; je 308f <_sk_load_a8_sse41+0x5c> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,196 ; jne 3037 <_sk_load_a8_sse41+0x11> + DB 117,196 ; jne 3044 <_sk_load_a8_sse41+0x11> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0 @@ -14791,7 +14644,7 @@ _sk_load_a8_sse41 LABEL PROC DB 102,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm0 DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm0 - DB 235,156 ; jmp 3037 <_sk_load_a8_sse41+0x11> + DB 235,156 ; jmp 3044 <_sk_load_a8_sse41+0x11> PUBLIC _sk_gather_a8_sse41 _sk_gather_a8_sse41 LABEL PROC @@ -14818,7 +14671,7 @@ _sk_gather_a8_sse41 LABEL PROC DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0 DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0 DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3 - DB 15,89,29,133,42,0,0 ; mulps 0x2a85(%rip),%xmm3 # 5b90 <_sk_callback_sse41+0xb03> + DB 15,89,29,136,42,0,0 ; mulps 0x2a88(%rip),%xmm3 # 5ba0 <_sk_callback_sse41+0xb06> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 @@ -14831,13 +14684,13 @@ _sk_store_a8_sse41 LABEL PROC DB 72,131,236,4 ; sub $0x4,%rsp DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 - DB 68,15,40,5,116,42,0,0 ; movaps 0x2a74(%rip),%xmm8 # 5ba0 <_sk_callback_sse41+0xb13> + DB 68,15,40,5,119,42,0,0 ; movaps 0x2a77(%rip),%xmm8 # 5bb0 <_sk_callback_sse41+0xb16> DB 68,15,89,195 ; mulps %xmm3,%xmm8 DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8 DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8 DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,17 ; jne 3156 <_sk_store_a8_sse41+0x3b> + DB 117,17 ; jne 3163 <_sk_store_a8_sse41+0x3b> DB 102,68,15,126,192 ; movd %xmm8,%eax DB 65,137,4,18 ; mov %eax,(%r10,%rdx,1) DB 72,173 ; lods %ds:(%rsi),%rax @@ -14847,28 +14700,28 @@ _sk_store_a8_sse41 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,30 ; je 3187 <_sk_store_a8_sse41+0x6c> + DB 116,30 ; je 3194 <_sk_store_a8_sse41+0x6c> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,15 ; je 317e <_sk_store_a8_sse41+0x63> + DB 116,15 ; je 318b <_sk_store_a8_sse41+0x63> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,217 ; jne 314e <_sk_store_a8_sse41+0x33> + DB 117,217 ; jne 315b <_sk_store_a8_sse41+0x33> DB 102,69,15,58,20,68,18,2,8 ; pextrb $0x8,%xmm8,0x2(%r10,%rdx,1) DB 102,69,15,58,20,68,18,1,4 ; pextrb $0x4,%xmm8,0x1(%r10,%rdx,1) DB 102,69,15,58,20,4,18,0 ; pextrb $0x0,%xmm8,(%r10,%rdx,1) - DB 235,189 ; jmp 314e <_sk_store_a8_sse41+0x33> + DB 235,189 ; jmp 315b <_sk_store_a8_sse41+0x33> PUBLIC _sk_load_g8_sse41 _sk_load_g8_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,42 ; jne 31c5 <_sk_load_g8_sse41+0x34> + DB 117,42 ; jne 31d2 <_sk_load_g8_sse41+0x34> DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0 - DB 102,15,219,5,6,42,0,0 ; pand 0x2a06(%rip),%xmm0 # 5bb0 <_sk_callback_sse41+0xb23> + DB 102,15,219,5,9,42,0,0 ; pand 0x2a09(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xb26> DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,12,42,0,0 ; mulps 0x2a0c(%rip),%xmm0 # 5bc0 <_sk_callback_sse41+0xb33> + DB 15,89,5,15,42,0,0 ; mulps 0x2a0f(%rip),%xmm0 # 5bd0 <_sk_callback_sse41+0xb36> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,19,42,0,0 ; movaps 0x2a13(%rip),%xmm3 # 5bd0 <_sk_callback_sse41+0xb43> + DB 15,40,29,22,42,0,0 ; movaps 0x2a16(%rip),%xmm3 # 5be0 <_sk_callback_sse41+0xb46> DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 DB 255,224 ; jmpq *%rax @@ -14876,11 +14729,11 @@ _sk_load_g8_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,39 ; je 31fd <_sk_load_g8_sse41+0x6c> + DB 116,39 ; je 320a <_sk_load_g8_sse41+0x6c> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 31f1 <_sk_load_g8_sse41+0x60> + DB 116,21 ; je 31fe <_sk_load_g8_sse41+0x60> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,192 ; jne 31a2 <_sk_load_g8_sse41+0x11> + DB 117,192 ; jne 31af <_sk_load_g8_sse41+0x11> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0 @@ -14888,7 +14741,7 @@ _sk_load_g8_sse41 LABEL PROC DB 102,15,58,34,192,1 ; pinsrd $0x1,%eax,%xmm0 DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,15,58,34,192,0 ; pinsrd $0x0,%eax,%xmm0 - DB 235,152 ; jmp 31a2 <_sk_load_g8_sse41+0x11> + DB 235,152 ; jmp 31af <_sk_load_g8_sse41+0x11> PUBLIC _sk_gather_g8_sse41 _sk_gather_g8_sse41 LABEL PROC @@ -14915,9 +14768,9 @@ _sk_gather_g8_sse41 LABEL PROC DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0 DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,102,41,0,0 ; mulps 0x2966(%rip),%xmm0 # 5be0 <_sk_callback_sse41+0xb53> + DB 15,89,5,105,41,0,0 ; mulps 0x2969(%rip),%xmm0 # 5bf0 <_sk_callback_sse41+0xb56> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,109,41,0,0 ; movaps 0x296d(%rip),%xmm3 # 5bf0 <_sk_callback_sse41+0xb63> + DB 15,40,29,112,41,0,0 ; movaps 0x2970(%rip),%xmm3 # 5c00 <_sk_callback_sse41+0xb66> DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 DB 91 ; pop %rbx @@ -14928,9 +14781,9 @@ _sk_gather_i8_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,137,193 ; mov %rax,%r9 DB 77,133,201 ; test %r9,%r9 - DB 116,5 ; je 329b <_sk_gather_i8_sse41+0xf> + DB 116,5 ; je 32a8 <_sk_gather_i8_sse41+0xf> DB 76,137,200 ; mov %r9,%rax - DB 235,2 ; jmp 329d <_sk_gather_i8_sse41+0x11> + DB 235,2 ; jmp 32aa <_sk_gather_i8_sse41+0x11> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,86 ; push %r14 DB 83 ; push %rbx @@ -14963,17 +14816,17 @@ _sk_gather_i8_sse41 LABEL PROC DB 102,15,58,34,28,24,1 ; pinsrd $0x1,(%rax,%rbx,1),%xmm3 DB 102,66,15,58,34,28,152,2 ; pinsrd $0x2,(%rax,%r11,4),%xmm3 DB 102,66,15,58,34,28,16,3 ; pinsrd $0x3,(%rax,%r10,1),%xmm3 - DB 102,15,111,5,192,40,0,0 ; movdqa 0x28c0(%rip),%xmm0 # 5c00 <_sk_callback_sse41+0xb73> + DB 102,15,111,5,195,40,0,0 ; movdqa 0x28c3(%rip),%xmm0 # 5c10 <_sk_callback_sse41+0xb76> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,193,40,0,0 ; movaps 0x28c1(%rip),%xmm8 # 5c10 <_sk_callback_sse41+0xb83> + DB 68,15,40,5,196,40,0,0 ; movaps 0x28c4(%rip),%xmm8 # 5c20 <_sk_callback_sse41+0xb86> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 - DB 102,15,56,0,13,192,40,0,0 ; pshufb 0x28c0(%rip),%xmm1 # 5c20 <_sk_callback_sse41+0xb93> + DB 102,15,56,0,13,195,40,0,0 ; pshufb 0x28c3(%rip),%xmm1 # 5c30 <_sk_callback_sse41+0xb96> DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,111,211 ; movdqa %xmm3,%xmm2 - DB 102,15,56,0,21,188,40,0,0 ; pshufb 0x28bc(%rip),%xmm2 # 5c30 <_sk_callback_sse41+0xba3> + DB 102,15,56,0,21,191,40,0,0 ; pshufb 0x28bf(%rip),%xmm2 # 5c40 <_sk_callback_sse41+0xba6> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 DB 65,15,89,208 ; mulps %xmm8,%xmm2 DB 102,15,114,211,24 ; psrld $0x18,%xmm3 @@ -14989,31 +14842,31 @@ _sk_load_565_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,80 ; jne 33e8 <_sk_load_565_sse41+0x5a> + DB 117,80 ; jne 33f5 <_sk_load_565_sse41+0x5a> DB 102,65,15,56,51,20,82 ; pmovzxwd (%r10,%rdx,2),%xmm2 - DB 102,15,111,5,153,40,0,0 ; movdqa 0x2899(%rip),%xmm0 # 5c40 <_sk_callback_sse41+0xbb3> + DB 102,15,111,5,156,40,0,0 ; movdqa 0x289c(%rip),%xmm0 # 5c50 <_sk_callback_sse41+0xbb6> DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,155,40,0,0 ; mulps 0x289b(%rip),%xmm0 # 5c50 <_sk_callback_sse41+0xbc3> - DB 102,15,111,13,163,40,0,0 ; movdqa 0x28a3(%rip),%xmm1 # 5c60 <_sk_callback_sse41+0xbd3> + DB 15,89,5,158,40,0,0 ; mulps 0x289e(%rip),%xmm0 # 5c60 <_sk_callback_sse41+0xbc6> + DB 102,15,111,13,166,40,0,0 ; movdqa 0x28a6(%rip),%xmm1 # 5c70 <_sk_callback_sse41+0xbd6> DB 102,15,219,202 ; pand %xmm2,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,165,40,0,0 ; mulps 0x28a5(%rip),%xmm1 # 5c70 <_sk_callback_sse41+0xbe3> - DB 102,15,219,21,173,40,0,0 ; pand 0x28ad(%rip),%xmm2 # 5c80 <_sk_callback_sse41+0xbf3> + DB 15,89,13,168,40,0,0 ; mulps 0x28a8(%rip),%xmm1 # 5c80 <_sk_callback_sse41+0xbe6> + DB 102,15,219,21,176,40,0,0 ; pand 0x28b0(%rip),%xmm2 # 5c90 <_sk_callback_sse41+0xbf6> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,179,40,0,0 ; mulps 0x28b3(%rip),%xmm2 # 5c90 <_sk_callback_sse41+0xc03> + DB 15,89,21,182,40,0,0 ; mulps 0x28b6(%rip),%xmm2 # 5ca0 <_sk_callback_sse41+0xc06> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,186,40,0,0 ; movaps 0x28ba(%rip),%xmm3 # 5ca0 <_sk_callback_sse41+0xc13> + DB 15,40,29,189,40,0,0 ; movaps 0x28bd(%rip),%xmm3 # 5cb0 <_sk_callback_sse41+0xc16> DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,210 ; pxor %xmm2,%xmm2 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,39 ; je 3420 <_sk_load_565_sse41+0x92> + DB 116,39 ; je 342d <_sk_load_565_sse41+0x92> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 3414 <_sk_load_565_sse41+0x86> + DB 116,21 ; je 3421 <_sk_load_565_sse41+0x86> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,154 ; jne 339f <_sk_load_565_sse41+0x11> + DB 117,154 ; jne 33ac <_sk_load_565_sse41+0x11> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2 @@ -15021,7 +14874,7 @@ _sk_load_565_sse41 LABEL PROC DB 102,15,58,34,208,1 ; pinsrd $0x1,%eax,%xmm2 DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,15,58,34,208,0 ; pinsrd $0x0,%eax,%xmm2 - DB 233,111,255,255,255 ; jmpq 339f <_sk_load_565_sse41+0x11> + DB 233,111,255,255,255 ; jmpq 33ac <_sk_load_565_sse41+0x11> PUBLIC _sk_gather_565_sse41 _sk_gather_565_sse41 LABEL PROC @@ -15047,19 +14900,19 @@ _sk_gather_565_sse41 LABEL PROC DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0 DB 102,15,56,51,208 ; pmovzxwd %xmm0,%xmm2 - DB 102,15,111,5,22,40,0,0 ; movdqa 0x2816(%rip),%xmm0 # 5cb0 <_sk_callback_sse41+0xc23> + DB 102,15,111,5,25,40,0,0 ; movdqa 0x2819(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xc26> DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,24,40,0,0 ; mulps 0x2818(%rip),%xmm0 # 5cc0 <_sk_callback_sse41+0xc33> - DB 102,15,111,13,32,40,0,0 ; movdqa 0x2820(%rip),%xmm1 # 5cd0 <_sk_callback_sse41+0xc43> + DB 15,89,5,27,40,0,0 ; mulps 0x281b(%rip),%xmm0 # 5cd0 <_sk_callback_sse41+0xc36> + DB 102,15,111,13,35,40,0,0 ; movdqa 0x2823(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xc46> DB 102,15,219,202 ; pand %xmm2,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,34,40,0,0 ; mulps 0x2822(%rip),%xmm1 # 5ce0 <_sk_callback_sse41+0xc53> - DB 102,15,219,21,42,40,0,0 ; pand 0x282a(%rip),%xmm2 # 5cf0 <_sk_callback_sse41+0xc63> + DB 15,89,13,37,40,0,0 ; mulps 0x2825(%rip),%xmm1 # 5cf0 <_sk_callback_sse41+0xc56> + DB 102,15,219,21,45,40,0,0 ; pand 0x282d(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xc66> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,48,40,0,0 ; mulps 0x2830(%rip),%xmm2 # 5d00 <_sk_callback_sse41+0xc73> + DB 15,89,21,51,40,0,0 ; mulps 0x2833(%rip),%xmm2 # 5d10 <_sk_callback_sse41+0xc76> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,55,40,0,0 ; movaps 0x2837(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0xc83> + DB 15,40,29,58,40,0,0 ; movaps 0x283a(%rip),%xmm3 # 5d20 <_sk_callback_sse41+0xc86> DB 91 ; pop %rbx DB 255,224 ; jmpq *%rax @@ -15067,12 +14920,12 @@ PUBLIC _sk_store_565_sse41 _sk_store_565_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 68,15,40,5,55,40,0,0 ; movaps 0x2837(%rip),%xmm8 # 5d20 <_sk_callback_sse41+0xc93> + DB 68,15,40,5,58,40,0,0 ; movaps 0x283a(%rip),%xmm8 # 5d30 <_sk_callback_sse41+0xc96> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9 - DB 68,15,40,21,44,40,0,0 ; movaps 0x282c(%rip),%xmm10 # 5d30 <_sk_callback_sse41+0xca3> + DB 68,15,40,21,47,40,0,0 ; movaps 0x282f(%rip),%xmm10 # 5d40 <_sk_callback_sse41+0xca6> DB 68,15,89,209 ; mulps %xmm1,%xmm10 DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10 DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10 @@ -15082,7 +14935,7 @@ _sk_store_565_sse41 LABEL PROC DB 102,69,15,86,194 ; orpd %xmm10,%xmm8 DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 353b <_sk_store_565_sse41+0x5f> + DB 117,10 ; jne 3548 <_sk_store_565_sse41+0x5f> DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -15090,49 +14943,49 @@ _sk_store_565_sse41 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,30 ; je 356c <_sk_store_565_sse41+0x90> + DB 116,30 ; je 3579 <_sk_store_565_sse41+0x90> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,15 ; je 3563 <_sk_store_565_sse41+0x87> + DB 116,15 ; je 3570 <_sk_store_565_sse41+0x87> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,221 ; jne 3537 <_sk_store_565_sse41+0x5b> + DB 117,221 ; jne 3544 <_sk_store_565_sse41+0x5b> DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2) DB 102,68,15,58,21,68,80,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdx,2) DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2) - DB 235,193 ; jmp 3537 <_sk_store_565_sse41+0x5b> + DB 235,193 ; jmp 3544 <_sk_store_565_sse41+0x5b> PUBLIC _sk_load_4444_sse41 _sk_load_4444_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,95 ; jne 35df <_sk_load_4444_sse41+0x69> + DB 117,95 ; jne 35ec <_sk_load_4444_sse41+0x69> DB 102,65,15,56,51,28,82 ; pmovzxwd (%r10,%rdx,2),%xmm3 - DB 102,15,111,5,177,39,0,0 ; movdqa 0x27b1(%rip),%xmm0 # 5d40 <_sk_callback_sse41+0xcb3> + DB 102,15,111,5,180,39,0,0 ; movdqa 0x27b4(%rip),%xmm0 # 5d50 <_sk_callback_sse41+0xcb6> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,179,39,0,0 ; mulps 0x27b3(%rip),%xmm0 # 5d50 <_sk_callback_sse41+0xcc3> - DB 102,15,111,13,187,39,0,0 ; movdqa 0x27bb(%rip),%xmm1 # 5d60 <_sk_callback_sse41+0xcd3> + DB 15,89,5,182,39,0,0 ; mulps 0x27b6(%rip),%xmm0 # 5d60 <_sk_callback_sse41+0xcc6> + DB 102,15,111,13,190,39,0,0 ; movdqa 0x27be(%rip),%xmm1 # 5d70 <_sk_callback_sse41+0xcd6> DB 102,15,219,203 ; pand %xmm3,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,189,39,0,0 ; mulps 0x27bd(%rip),%xmm1 # 5d70 <_sk_callback_sse41+0xce3> - DB 102,15,111,21,197,39,0,0 ; movdqa 0x27c5(%rip),%xmm2 # 5d80 <_sk_callback_sse41+0xcf3> + DB 15,89,13,192,39,0,0 ; mulps 0x27c0(%rip),%xmm1 # 5d80 <_sk_callback_sse41+0xce6> + DB 102,15,111,21,200,39,0,0 ; movdqa 0x27c8(%rip),%xmm2 # 5d90 <_sk_callback_sse41+0xcf6> DB 102,15,219,211 ; pand %xmm3,%xmm2 DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,199,39,0,0 ; mulps 0x27c7(%rip),%xmm2 # 5d90 <_sk_callback_sse41+0xd03> - DB 102,15,219,29,207,39,0,0 ; pand 0x27cf(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0xd13> + DB 15,89,21,202,39,0,0 ; mulps 0x27ca(%rip),%xmm2 # 5da0 <_sk_callback_sse41+0xd06> + DB 102,15,219,29,210,39,0,0 ; pand 0x27d2(%rip),%xmm3 # 5db0 <_sk_callback_sse41+0xd16> DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,213,39,0,0 ; mulps 0x27d5(%rip),%xmm3 # 5db0 <_sk_callback_sse41+0xd23> + DB 15,89,29,216,39,0,0 ; mulps 0x27d8(%rip),%xmm3 # 5dc0 <_sk_callback_sse41+0xd26> DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,219 ; pxor %xmm3,%xmm3 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,39 ; je 3617 <_sk_load_4444_sse41+0xa1> + DB 116,39 ; je 3624 <_sk_load_4444_sse41+0xa1> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 360b <_sk_load_4444_sse41+0x95> + DB 116,21 ; je 3618 <_sk_load_4444_sse41+0x95> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,139 ; jne 3587 <_sk_load_4444_sse41+0x11> + DB 117,139 ; jne 3594 <_sk_load_4444_sse41+0x11> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3 @@ -15140,7 +14993,7 @@ _sk_load_4444_sse41 LABEL PROC DB 102,15,58,34,216,1 ; pinsrd $0x1,%eax,%xmm3 DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,15,58,34,216,0 ; pinsrd $0x0,%eax,%xmm3 - DB 233,96,255,255,255 ; jmpq 3587 <_sk_load_4444_sse41+0x11> + DB 233,96,255,255,255 ; jmpq 3594 <_sk_load_4444_sse41+0x11> PUBLIC _sk_gather_4444_sse41 _sk_gather_4444_sse41 LABEL PROC @@ -15166,21 +15019,21 @@ _sk_gather_4444_sse41 LABEL PROC DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0 DB 102,15,56,51,216 ; pmovzxwd %xmm0,%xmm3 - DB 102,15,111,5,47,39,0,0 ; movdqa 0x272f(%rip),%xmm0 # 5dc0 <_sk_callback_sse41+0xd33> + DB 102,15,111,5,50,39,0,0 ; movdqa 0x2732(%rip),%xmm0 # 5dd0 <_sk_callback_sse41+0xd36> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,49,39,0,0 ; mulps 0x2731(%rip),%xmm0 # 5dd0 <_sk_callback_sse41+0xd43> - DB 102,15,111,13,57,39,0,0 ; movdqa 0x2739(%rip),%xmm1 # 5de0 <_sk_callback_sse41+0xd53> + DB 15,89,5,52,39,0,0 ; mulps 0x2734(%rip),%xmm0 # 5de0 <_sk_callback_sse41+0xd46> + DB 102,15,111,13,60,39,0,0 ; movdqa 0x273c(%rip),%xmm1 # 5df0 <_sk_callback_sse41+0xd56> DB 102,15,219,203 ; pand %xmm3,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,59,39,0,0 ; mulps 0x273b(%rip),%xmm1 # 5df0 <_sk_callback_sse41+0xd63> - DB 102,15,111,21,67,39,0,0 ; movdqa 0x2743(%rip),%xmm2 # 5e00 <_sk_callback_sse41+0xd73> + DB 15,89,13,62,39,0,0 ; mulps 0x273e(%rip),%xmm1 # 5e00 <_sk_callback_sse41+0xd66> + DB 102,15,111,21,70,39,0,0 ; movdqa 0x2746(%rip),%xmm2 # 5e10 <_sk_callback_sse41+0xd76> DB 102,15,219,211 ; pand %xmm3,%xmm2 DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,69,39,0,0 ; mulps 0x2745(%rip),%xmm2 # 5e10 <_sk_callback_sse41+0xd83> - DB 102,15,219,29,77,39,0,0 ; pand 0x274d(%rip),%xmm3 # 5e20 <_sk_callback_sse41+0xd93> + DB 15,89,21,72,39,0,0 ; mulps 0x2748(%rip),%xmm2 # 5e20 <_sk_callback_sse41+0xd86> + DB 102,15,219,29,80,39,0,0 ; pand 0x2750(%rip),%xmm3 # 5e30 <_sk_callback_sse41+0xd96> DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,83,39,0,0 ; mulps 0x2753(%rip),%xmm3 # 5e30 <_sk_callback_sse41+0xda3> + DB 15,89,29,86,39,0,0 ; mulps 0x2756(%rip),%xmm3 # 5e40 <_sk_callback_sse41+0xda6> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 255,224 ; jmpq *%rax @@ -15189,7 +15042,7 @@ PUBLIC _sk_store_4444_sse41 _sk_store_4444_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 68,15,40,5,81,39,0,0 ; movaps 0x2751(%rip),%xmm8 # 5e40 <_sk_callback_sse41+0xdb3> + DB 68,15,40,5,84,39,0,0 ; movaps 0x2754(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0xdb6> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 @@ -15209,7 +15062,7 @@ _sk_store_4444_sse41 LABEL PROC DB 102,69,15,86,194 ; orpd %xmm10,%xmm8 DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3755 <_sk_store_4444_sse41+0x73> + DB 117,10 ; jne 3762 <_sk_store_4444_sse41+0x73> DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -15217,34 +15070,34 @@ _sk_store_4444_sse41 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,30 ; je 3786 <_sk_store_4444_sse41+0xa4> + DB 116,30 ; je 3793 <_sk_store_4444_sse41+0xa4> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,15 ; je 377d <_sk_store_4444_sse41+0x9b> + DB 116,15 ; je 378a <_sk_store_4444_sse41+0x9b> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,221 ; jne 3751 <_sk_store_4444_sse41+0x6f> + DB 117,221 ; jne 375e <_sk_store_4444_sse41+0x6f> DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2) DB 102,68,15,58,21,68,80,2,2 ; pextrw $0x2,%xmm8,0x2(%rax,%rdx,2) DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2) - DB 235,193 ; jmp 3751 <_sk_store_4444_sse41+0x6f> + DB 235,193 ; jmp 375e <_sk_store_4444_sse41+0x6f> PUBLIC _sk_load_8888_sse41 _sk_load_8888_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 117,88 ; jne 37f2 <_sk_load_8888_sse41+0x62> + DB 117,88 ; jne 37ff <_sk_load_8888_sse41+0x62> DB 243,15,111,28,144 ; movdqu (%rax,%rdx,4),%xmm3 - DB 102,15,111,5,169,38,0,0 ; movdqa 0x26a9(%rip),%xmm0 # 5e50 <_sk_callback_sse41+0xdc3> + DB 102,15,111,5,172,38,0,0 ; movdqa 0x26ac(%rip),%xmm0 # 5e60 <_sk_callback_sse41+0xdc6> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,170,38,0,0 ; movaps 0x26aa(%rip),%xmm8 # 5e60 <_sk_callback_sse41+0xdd3> + DB 68,15,40,5,173,38,0,0 ; movaps 0x26ad(%rip),%xmm8 # 5e70 <_sk_callback_sse41+0xdd6> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 - DB 102,15,56,0,13,169,38,0,0 ; pshufb 0x26a9(%rip),%xmm1 # 5e70 <_sk_callback_sse41+0xde3> + DB 102,15,56,0,13,172,38,0,0 ; pshufb 0x26ac(%rip),%xmm1 # 5e80 <_sk_callback_sse41+0xde6> DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,111,211 ; movdqa %xmm3,%xmm2 - DB 102,15,56,0,21,165,38,0,0 ; pshufb 0x26a5(%rip),%xmm2 # 5e80 <_sk_callback_sse41+0xdf3> + DB 102,15,56,0,21,168,38,0,0 ; pshufb 0x26a8(%rip),%xmm2 # 5e90 <_sk_callback_sse41+0xdf6> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 DB 65,15,89,208 ; mulps %xmm8,%xmm2 DB 102,15,114,211,24 ; psrld $0x18,%xmm3 @@ -15256,16 +15109,16 @@ _sk_load_8888_sse41 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,219 ; pxor %xmm3,%xmm3 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,31 ; je 3822 <_sk_load_8888_sse41+0x92> + DB 116,31 ; je 382f <_sk_load_8888_sse41+0x92> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,17 ; je 381a <_sk_load_8888_sse41+0x8a> + DB 116,17 ; je 3827 <_sk_load_8888_sse41+0x8a> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,144 ; jne 379f <_sk_load_8888_sse41+0xf> + DB 117,144 ; jne 37ac <_sk_load_8888_sse41+0xf> DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0 DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3 DB 102,15,58,34,92,144,4,1 ; pinsrd $0x1,0x4(%rax,%rdx,4),%xmm3 DB 102,15,58,34,28,144,0 ; pinsrd $0x0,(%rax,%rdx,4),%xmm3 - DB 233,113,255,255,255 ; jmpq 379f <_sk_load_8888_sse41+0xf> + DB 233,113,255,255,255 ; jmpq 37ac <_sk_load_8888_sse41+0xf> PUBLIC _sk_gather_8888_sse41 _sk_gather_8888_sse41 LABEL PROC @@ -15288,17 +15141,17 @@ _sk_gather_8888_sse41 LABEL PROC DB 102,65,15,58,34,28,129,1 ; pinsrd $0x1,(%r9,%rax,4),%xmm3 DB 102,65,15,58,34,28,153,2 ; pinsrd $0x2,(%r9,%rbx,4),%xmm3 DB 102,67,15,58,34,28,153,3 ; pinsrd $0x3,(%r9,%r11,4),%xmm3 - DB 102,15,111,5,1,38,0,0 ; movdqa 0x2601(%rip),%xmm0 # 5e90 <_sk_callback_sse41+0xe03> + DB 102,15,111,5,4,38,0,0 ; movdqa 0x2604(%rip),%xmm0 # 5ea0 <_sk_callback_sse41+0xe06> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,2,38,0,0 ; movaps 0x2602(%rip),%xmm8 # 5ea0 <_sk_callback_sse41+0xe13> + DB 68,15,40,5,5,38,0,0 ; movaps 0x2605(%rip),%xmm8 # 5eb0 <_sk_callback_sse41+0xe16> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 - DB 102,15,56,0,13,1,38,0,0 ; pshufb 0x2601(%rip),%xmm1 # 5eb0 <_sk_callback_sse41+0xe23> + DB 102,15,56,0,13,4,38,0,0 ; pshufb 0x2604(%rip),%xmm1 # 5ec0 <_sk_callback_sse41+0xe26> DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,111,211 ; movdqa %xmm3,%xmm2 - DB 102,15,56,0,21,253,37,0,0 ; pshufb 0x25fd(%rip),%xmm2 # 5ec0 <_sk_callback_sse41+0xe33> + DB 102,15,56,0,21,0,38,0,0 ; pshufb 0x2600(%rip),%xmm2 # 5ed0 <_sk_callback_sse41+0xe36> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 DB 65,15,89,208 ; mulps %xmm8,%xmm2 DB 102,15,114,211,24 ; psrld $0x18,%xmm3 @@ -15312,7 +15165,7 @@ PUBLIC _sk_store_8888_sse41 _sk_store_8888_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 68,15,40,5,232,37,0,0 ; movaps 0x25e8(%rip),%xmm8 # 5ed0 <_sk_callback_sse41+0xe43> + DB 68,15,40,5,235,37,0,0 ; movaps 0x25eb(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xe46> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 @@ -15331,29 +15184,29 @@ _sk_store_8888_sse41 LABEL PROC DB 102,69,15,235,193 ; por %xmm9,%xmm8 DB 102,69,15,235,194 ; por %xmm10,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3948 <_sk_store_8888_sse41+0x6d> + DB 117,10 ; jne 3955 <_sk_store_8888_sse41+0x6d> DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,30 ; je 3973 <_sk_store_8888_sse41+0x98> + DB 116,30 ; je 3980 <_sk_store_8888_sse41+0x98> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,15 ; je 396a <_sk_store_8888_sse41+0x8f> + DB 116,15 ; je 3977 <_sk_store_8888_sse41+0x8f> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,227 ; jne 3944 <_sk_store_8888_sse41+0x69> + DB 117,227 ; jne 3951 <_sk_store_8888_sse41+0x69> DB 102,68,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm8,0x8(%rax,%rdx,4) DB 102,68,15,58,22,68,144,4,1 ; pextrd $0x1,%xmm8,0x4(%rax,%rdx,4) DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4) - DB 235,201 ; jmp 3944 <_sk_store_8888_sse41+0x69> + DB 235,201 ; jmp 3951 <_sk_store_8888_sse41+0x69> PUBLIC _sk_load_f16_sse41 _sk_load_f16_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,60,1,0,0 ; jne 3ac5 <_sk_load_f16_sse41+0x14a> + DB 15,133,60,1,0,0 ; jne 3ad2 <_sk_load_f16_sse41+0x14a> DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0 DB 243,15,111,76,208,16 ; movdqu 0x10(%rax,%rdx,8),%xmm1 DB 102,68,15,40,200 ; movapd %xmm0,%xmm9 @@ -15363,18 +15216,18 @@ _sk_load_f16_sse41 LABEL PROC DB 102,68,15,97,216 ; punpcklwd %xmm0,%xmm11 DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9 DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1 - DB 102,68,15,111,5,32,37,0,0 ; movdqa 0x2520(%rip),%xmm8 # 5ee0 <_sk_callback_sse41+0xe53> + DB 102,68,15,111,5,35,37,0,0 ; movdqa 0x2523(%rip),%xmm8 # 5ef0 <_sk_callback_sse41+0xe56> DB 102,15,111,209 ; movdqa %xmm1,%xmm2 DB 102,65,15,219,208 ; pand %xmm8,%xmm2 DB 102,15,239,202 ; pxor %xmm2,%xmm1 - DB 102,15,111,29,27,37,0,0 ; movdqa 0x251b(%rip),%xmm3 # 5ef0 <_sk_callback_sse41+0xe63> + DB 102,15,111,29,30,37,0,0 ; movdqa 0x251e(%rip),%xmm3 # 5f00 <_sk_callback_sse41+0xe66> DB 102,15,114,242,16 ; pslld $0x10,%xmm2 DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0 DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0 DB 102,15,114,241,13 ; pslld $0xd,%xmm1 DB 102,15,235,202 ; por %xmm2,%xmm1 - DB 102,68,15,111,21,7,37,0,0 ; movdqa 0x2507(%rip),%xmm10 # 5f00 <_sk_callback_sse41+0xe73> + DB 102,68,15,111,21,10,37,0,0 ; movdqa 0x250a(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0xe76> DB 102,65,15,254,202 ; paddd %xmm10,%xmm1 DB 102,15,219,193 ; pand %xmm1,%xmm0 DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11 @@ -15417,16 +15270,16 @@ _sk_load_f16_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,13 ; jne 3add <_sk_load_f16_sse41+0x162> + DB 117,13 ; jne 3aea <_sk_load_f16_sse41+0x162> DB 243,15,126,192 ; movq %xmm0,%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,183,254,255,255 ; jmpq 3994 <_sk_load_f16_sse41+0x19> + DB 233,183,254,255,255 ; jmpq 39a1 <_sk_load_f16_sse41+0x19> DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,163,254,255,255 ; jb 3994 <_sk_load_f16_sse41+0x19> + DB 15,130,163,254,255,255 ; jb 39a1 <_sk_load_f16_sse41+0x19> DB 243,15,126,76,208,16 ; movq 0x10(%rax,%rdx,8),%xmm1 - DB 233,152,254,255,255 ; jmpq 3994 <_sk_load_f16_sse41+0x19> + DB 233,152,254,255,255 ; jmpq 39a1 <_sk_load_f16_sse41+0x19> PUBLIC _sk_gather_f16_sse41 _sk_gather_f16_sse41 LABEL PROC @@ -15458,18 +15311,18 @@ _sk_gather_f16_sse41 LABEL PROC DB 102,68,15,97,218 ; punpcklwd %xmm2,%xmm11 DB 102,68,15,105,202 ; punpckhwd %xmm2,%xmm9 DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1 - DB 102,68,15,111,5,141,35,0,0 ; movdqa 0x238d(%rip),%xmm8 # 5f10 <_sk_callback_sse41+0xe83> + DB 102,68,15,111,5,144,35,0,0 ; movdqa 0x2390(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0xe86> DB 102,15,111,209 ; movdqa %xmm1,%xmm2 DB 102,65,15,219,208 ; pand %xmm8,%xmm2 DB 102,15,239,202 ; pxor %xmm2,%xmm1 - DB 102,15,111,29,136,35,0,0 ; movdqa 0x2388(%rip),%xmm3 # 5f20 <_sk_callback_sse41+0xe93> + DB 102,15,111,29,139,35,0,0 ; movdqa 0x238b(%rip),%xmm3 # 5f30 <_sk_callback_sse41+0xe96> DB 102,15,114,242,16 ; pslld $0x10,%xmm2 DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0 DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0 DB 102,15,114,241,13 ; pslld $0xd,%xmm1 DB 102,15,235,202 ; por %xmm2,%xmm1 - DB 102,68,15,111,21,116,35,0,0 ; movdqa 0x2374(%rip),%xmm10 # 5f30 <_sk_callback_sse41+0xea3> + DB 102,68,15,111,21,119,35,0,0 ; movdqa 0x2377(%rip),%xmm10 # 5f40 <_sk_callback_sse41+0xea6> DB 102,65,15,254,202 ; paddd %xmm10,%xmm1 DB 102,15,219,193 ; pand %xmm1,%xmm0 DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11 @@ -15516,17 +15369,17 @@ PUBLIC _sk_store_f16_sse41 _sk_store_f16_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 102,68,15,111,21,169,34,0,0 ; movdqa 0x22a9(%rip),%xmm10 # 5f40 <_sk_callback_sse41+0xeb3> + DB 102,68,15,111,21,172,34,0,0 ; movdqa 0x22ac(%rip),%xmm10 # 5f50 <_sk_callback_sse41+0xeb6> DB 102,68,15,111,216 ; movdqa %xmm0,%xmm11 DB 102,69,15,219,218 ; pand %xmm10,%xmm11 DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13 DB 102,69,15,239,235 ; pxor %xmm11,%xmm13 - DB 102,68,15,111,13,156,34,0,0 ; movdqa 0x229c(%rip),%xmm9 # 5f50 <_sk_callback_sse41+0xec3> + DB 102,68,15,111,13,159,34,0,0 ; movdqa 0x229f(%rip),%xmm9 # 5f60 <_sk_callback_sse41+0xec6> DB 102,65,15,114,211,16 ; psrld $0x10,%xmm11 DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8 DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8 DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13 - DB 102,68,15,111,37,141,34,0,0 ; movdqa 0x228d(%rip),%xmm12 # 5f60 <_sk_callback_sse41+0xed3> + DB 102,68,15,111,37,144,34,0,0 ; movdqa 0x2290(%rip),%xmm12 # 5f70 <_sk_callback_sse41+0xed6> DB 102,69,15,235,220 ; por %xmm12,%xmm11 DB 102,69,15,254,221 ; paddd %xmm13,%xmm11 DB 102,69,15,223,195 ; pandn %xmm11,%xmm8 @@ -15570,7 +15423,7 @@ _sk_store_f16_sse41 LABEL PROC DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9 DB 102,69,15,98,203 ; punpckldq %xmm11,%xmm9 DB 77,133,192 ; test %r8,%r8 - DB 117,21 ; jne 3dc9 <_sk_store_f16_sse41+0x140> + DB 117,21 ; jne 3dd6 <_sk_store_f16_sse41+0x140> DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8) DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8 DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8) @@ -15578,13 +15431,13 @@ _sk_store_f16_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 3dc5 <_sk_store_f16_sse41+0x13c> + DB 116,240 ; je 3dd2 <_sk_store_f16_sse41+0x13c> DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 3dc5 <_sk_store_f16_sse41+0x13c> + DB 114,227 ; jb 3dd2 <_sk_store_f16_sse41+0x13c> DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8 DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8) - DB 235,213 ; jmp 3dc5 <_sk_store_f16_sse41+0x13c> + DB 235,213 ; jmp 3dd2 <_sk_store_f16_sse41+0x13c> PUBLIC _sk_load_u16_be_sse41 _sk_load_u16_be_sse41 LABEL PROC @@ -15592,7 +15445,7 @@ _sk_load_u16_be_sse41 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,185,0,0,0 ; jne 3ebf <_sk_load_u16_be_sse41+0xcf> + DB 15,133,185,0,0,0 ; jne 3ecc <_sk_load_u16_be_sse41+0xcf> DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0 DB 243,65,15,111,76,65,16 ; movdqu 0x10(%r9,%rax,2),%xmm1 DB 102,15,40,208 ; movapd %xmm0,%xmm2 @@ -15608,7 +15461,7 @@ _sk_load_u16_be_sse41 LABEL PROC DB 102,15,235,200 ; por %xmm0,%xmm1 DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,30,33,0,0 ; movaps 0x211e(%rip),%xmm8 # 5f70 <_sk_callback_sse41+0xee3> + DB 68,15,40,5,33,33,0,0 ; movaps 0x2121(%rip),%xmm8 # 5f80 <_sk_callback_sse41+0xee6> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 DB 102,15,113,241,8 ; psllw $0x8,%xmm1 @@ -15636,16 +15489,16 @@ _sk_load_u16_be_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,13 ; jne 3ed8 <_sk_load_u16_be_sse41+0xe8> + DB 117,13 ; jne 3ee5 <_sk_load_u16_be_sse41+0xe8> DB 243,15,126,192 ; movq %xmm0,%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,59,255,255,255 ; jmpq 3e13 <_sk_load_u16_be_sse41+0x23> + DB 233,59,255,255,255 ; jmpq 3e20 <_sk_load_u16_be_sse41+0x23> DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,38,255,255,255 ; jb 3e13 <_sk_load_u16_be_sse41+0x23> + DB 15,130,38,255,255,255 ; jb 3e20 <_sk_load_u16_be_sse41+0x23> DB 243,65,15,126,76,65,16 ; movq 0x10(%r9,%rax,2),%xmm1 - DB 233,26,255,255,255 ; jmpq 3e13 <_sk_load_u16_be_sse41+0x23> + DB 233,26,255,255,255 ; jmpq 3e20 <_sk_load_u16_be_sse41+0x23> PUBLIC _sk_load_rgb_u16_be_sse41 _sk_load_rgb_u16_be_sse41 LABEL PROC @@ -15653,7 +15506,7 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,170,0,0,0 ; jne 3fb5 <_sk_load_rgb_u16_be_sse41+0xbc> + DB 15,133,170,0,0,0 ; jne 3fc2 <_sk_load_rgb_u16_be_sse41+0xbc> DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2 DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3 DB 102,15,115,219,4 ; psrldq $0x4,%xmm3 @@ -15673,7 +15526,7 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC DB 102,15,235,200 ; por %xmm0,%xmm1 DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,22,32,0,0 ; movaps 0x2016(%rip),%xmm8 # 5f80 <_sk_callback_sse41+0xef3> + DB 68,15,40,5,25,32,0,0 ; movaps 0x2019(%rip),%xmm8 # 5f90 <_sk_callback_sse41+0xef6> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 DB 102,15,113,241,8 ; psllw $0x8,%xmm1 @@ -15690,34 +15543,34 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 DB 65,15,89,208 ; mulps %xmm8,%xmm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,221,31,0,0 ; movaps 0x1fdd(%rip),%xmm3 # 5f90 <_sk_callback_sse41+0xf03> + DB 15,40,29,224,31,0,0 ; movaps 0x1fe0(%rip),%xmm3 # 5fa0 <_sk_callback_sse41+0xf06> DB 255,224 ; jmpq *%rax DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2 DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,13 ; jne 3fda <_sk_load_rgb_u16_be_sse41+0xe1> + DB 117,13 ; jne 3fe7 <_sk_load_rgb_u16_be_sse41+0xe1> DB 102,15,239,219 ; pxor %xmm3,%xmm3 DB 102,15,239,192 ; pxor %xmm0,%xmm0 - DB 233,85,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36> + DB 233,85,255,255,255 ; jmpq 3f3c <_sk_load_rgb_u16_be_sse41+0x36> DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0 DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,24 ; jb 400b <_sk_load_rgb_u16_be_sse41+0x112> + DB 114,24 ; jb 4018 <_sk_load_rgb_u16_be_sse41+0x112> DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3 DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3 DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,36,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36> + DB 233,36,255,255,255 ; jmpq 3f3c <_sk_load_rgb_u16_be_sse41+0x36> DB 102,15,239,219 ; pxor %xmm3,%xmm3 - DB 233,27,255,255,255 ; jmpq 3f2f <_sk_load_rgb_u16_be_sse41+0x36> + DB 233,27,255,255,255 ; jmpq 3f3c <_sk_load_rgb_u16_be_sse41+0x36> PUBLIC _sk_store_u16_be_sse41 _sk_store_u16_be_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax - DB 68,15,40,21,119,31,0,0 ; movaps 0x1f77(%rip),%xmm10 # 5fa0 <_sk_callback_sse41+0xf13> + DB 68,15,40,21,122,31,0,0 ; movaps 0x1f7a(%rip),%xmm10 # 5fb0 <_sk_callback_sse41+0xf16> DB 68,15,40,192 ; movaps %xmm0,%xmm8 DB 69,15,89,194 ; mulps %xmm10,%xmm8 DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8 @@ -15754,7 +15607,7 @@ _sk_store_u16_be_sse41 LABEL PROC DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10 DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10 DB 77,133,192 ; test %r8,%r8 - DB 117,21 ; jne 40f7 <_sk_store_u16_be_sse41+0xe3> + DB 117,21 ; jne 4104 <_sk_store_u16_be_sse41+0xe3> DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2) DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8 DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2) @@ -15762,13 +15615,13 @@ _sk_store_u16_be_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 40f3 <_sk_store_u16_be_sse41+0xdf> + DB 116,240 ; je 4100 <_sk_store_u16_be_sse41+0xdf> DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 40f3 <_sk_store_u16_be_sse41+0xdf> + DB 114,227 ; jb 4100 <_sk_store_u16_be_sse41+0xdf> DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8 DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2) - DB 235,213 ; jmp 40f3 <_sk_store_u16_be_sse41+0xdf> + DB 235,213 ; jmp 4100 <_sk_store_u16_be_sse41+0xdf> PUBLIC _sk_load_f32_sse41 _sk_load_f32_sse41 LABEL PROC @@ -15779,7 +15632,7 @@ _sk_load_f32_sse41 LABEL PROC DB 72,193,224,4 ; shl $0x4,%rax DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,66 ; jne 417e <_sk_load_f32_sse41+0x60> + DB 117,66 ; jne 418b <_sk_load_f32_sse41+0x60> DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0 DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3 DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9 @@ -15799,17 +15652,17 @@ _sk_load_f32_sse41 LABEL PROC DB 255,224 ; jmpq *%rax DB 69,15,87,201 ; xorps %xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,8 ; jne 4190 <_sk_load_f32_sse41+0x72> + DB 117,8 ; jne 419d <_sk_load_f32_sse41+0x72> DB 15,87,219 ; xorps %xmm3,%xmm3 DB 15,87,192 ; xorps %xmm0,%xmm0 - DB 235,190 ; jmp 414e <_sk_load_f32_sse41+0x30> + DB 235,190 ; jmp 415b <_sk_load_f32_sse41+0x30> DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,8 ; jb 41a4 <_sk_load_f32_sse41+0x86> + DB 114,8 ; jb 41b1 <_sk_load_f32_sse41+0x86> DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3 - DB 235,170 ; jmp 414e <_sk_load_f32_sse41+0x30> + DB 235,170 ; jmp 415b <_sk_load_f32_sse41+0x30> DB 15,87,219 ; xorps %xmm3,%xmm3 - DB 235,165 ; jmp 414e <_sk_load_f32_sse41+0x30> + DB 235,165 ; jmp 415b <_sk_load_f32_sse41+0x30> PUBLIC _sk_store_f32_sse41 _sk_store_f32_sse41 LABEL PROC @@ -15833,7 +15686,7 @@ _sk_store_f32_sse41 LABEL PROC DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9 DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1) DB 77,133,192 ; test %r8,%r8 - DB 117,29 ; jne 421b <_sk_store_f32_sse41+0x72> + DB 117,29 ; jne 4228 <_sk_store_f32_sse41+0x72> DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10 DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4) DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4) @@ -15841,12 +15694,12 @@ _sk_store_f32_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,246 ; je 4217 <_sk_store_f32_sse41+0x6e> + DB 116,246 ; je 4224 <_sk_store_f32_sse41+0x6e> DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,234 ; jb 4217 <_sk_store_f32_sse41+0x6e> + DB 114,234 ; jb 4224 <_sk_store_f32_sse41+0x6e> DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4) - DB 235,225 ; jmp 4217 <_sk_store_f32_sse41+0x6e> + DB 235,225 ; jmp 4224 <_sk_store_f32_sse41+0x6e> PUBLIC _sk_clamp_x_sse41 _sk_clamp_x_sse41 LABEL PROC @@ -15944,7 +15797,7 @@ PUBLIC _sk_clamp_x_1_sse41 _sk_clamp_x_1_sse41 LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 DB 68,15,95,192 ; maxps %xmm0,%xmm8 - DB 68,15,93,5,78,28,0,0 ; minps 0x1c4e(%rip),%xmm8 # 5fb0 <_sk_callback_sse41+0xf23> + DB 68,15,93,5,81,28,0,0 ; minps 0x1c51(%rip),%xmm8 # 5fc0 <_sk_callback_sse41+0xf26> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -15958,9 +15811,9 @@ _sk_repeat_x_1_sse41 LABEL PROC PUBLIC _sk_mirror_x_1_sse41 _sk_mirror_x_1_sse41 LABEL PROC - DB 68,15,40,5,63,28,0,0 ; movaps 0x1c3f(%rip),%xmm8 # 5fc0 <_sk_callback_sse41+0xf33> + DB 68,15,40,5,66,28,0,0 ; movaps 0x1c42(%rip),%xmm8 # 5fd0 <_sk_callback_sse41+0xf36> DB 65,15,88,192 ; addps %xmm8,%xmm0 - DB 68,15,40,13,67,28,0,0 ; movaps 0x1c43(%rip),%xmm9 # 5fd0 <_sk_callback_sse41+0xf43> + DB 68,15,40,13,70,28,0,0 ; movaps 0x1c46(%rip),%xmm9 # 5fe0 <_sk_callback_sse41+0xf46> DB 68,15,89,200 ; mulps %xmm0,%xmm9 DB 102,69,15,58,8,201,1 ; roundps $0x1,%xmm9,%xmm9 DB 69,15,88,201 ; addps %xmm9,%xmm9 @@ -15975,10 +15828,10 @@ _sk_mirror_x_1_sse41 LABEL PROC PUBLIC _sk_luminance_to_alpha_sse41 _sk_luminance_to_alpha_sse41 LABEL PROC DB 15,40,218 ; movaps %xmm2,%xmm3 - DB 15,89,5,34,28,0,0 ; mulps 0x1c22(%rip),%xmm0 # 5fe0 <_sk_callback_sse41+0xf53> - DB 15,89,13,43,28,0,0 ; mulps 0x1c2b(%rip),%xmm1 # 5ff0 <_sk_callback_sse41+0xf63> + DB 15,89,5,37,28,0,0 ; mulps 0x1c25(%rip),%xmm0 # 5ff0 <_sk_callback_sse41+0xf56> + DB 15,89,13,46,28,0,0 ; mulps 0x1c2e(%rip),%xmm1 # 6000 <_sk_callback_sse41+0xf66> DB 15,88,200 ; addps %xmm0,%xmm1 - DB 15,89,29,49,28,0,0 ; mulps 0x1c31(%rip),%xmm3 # 6000 <_sk_callback_sse41+0xf73> + DB 15,89,29,52,28,0,0 ; mulps 0x1c34(%rip),%xmm3 # 6010 <_sk_callback_sse41+0xf76> DB 15,88,217 ; addps %xmm1,%xmm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 @@ -16245,9 +16098,9 @@ _sk_evenly_spaced_gradient_sse41 LABEL PROC DB 72,139,24 ; mov (%rax),%rbx DB 76,139,112,8 ; mov 0x8(%rax),%r14 DB 72,255,203 ; dec %rbx - DB 120,7 ; js 480d <_sk_evenly_spaced_gradient_sse41+0x1a> + DB 120,7 ; js 481a <_sk_evenly_spaced_gradient_sse41+0x1a> DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1 - DB 235,21 ; jmp 4822 <_sk_evenly_spaced_gradient_sse41+0x2f> + DB 235,21 ; jmp 482f <_sk_evenly_spaced_gradient_sse41+0x2f> DB 73,137,217 ; mov %rbx,%r9 DB 73,209,233 ; shr %r9 DB 131,227,1 ; and $0x1,%ebx @@ -16335,15 +16188,15 @@ _sk_evenly_spaced_gradient_sse41 LABEL PROC PUBLIC _sk_gauss_a_to_rgba_sse41 _sk_gauss_a_to_rgba_sse41 LABEL PROC - DB 15,40,5,64,22,0,0 ; movaps 0x1640(%rip),%xmm0 # 6010 <_sk_callback_sse41+0xf83> + DB 15,40,5,67,22,0,0 ; movaps 0x1643(%rip),%xmm0 # 6020 <_sk_callback_sse41+0xf86> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,70,22,0,0 ; addps 0x1646(%rip),%xmm0 # 6020 <_sk_callback_sse41+0xf93> + DB 15,88,5,73,22,0,0 ; addps 0x1649(%rip),%xmm0 # 6030 <_sk_callback_sse41+0xf96> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,76,22,0,0 ; addps 0x164c(%rip),%xmm0 # 6030 <_sk_callback_sse41+0xfa3> + DB 15,88,5,79,22,0,0 ; addps 0x164f(%rip),%xmm0 # 6040 <_sk_callback_sse41+0xfa6> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,82,22,0,0 ; addps 0x1652(%rip),%xmm0 # 6040 <_sk_callback_sse41+0xfb3> + DB 15,88,5,85,22,0,0 ; addps 0x1655(%rip),%xmm0 # 6050 <_sk_callback_sse41+0xfb6> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,88,22,0,0 ; addps 0x1658(%rip),%xmm0 # 6050 <_sk_callback_sse41+0xfc3> + DB 15,88,5,91,22,0,0 ; addps 0x165b(%rip),%xmm0 # 6060 <_sk_callback_sse41+0xfc6> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 @@ -16359,12 +16212,12 @@ _sk_gradient_sse41 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,249,2 ; cmp $0x2,%r9 - DB 114,50 ; jb 4a4b <_sk_gradient_sse41+0x46> + DB 114,50 ; jb 4a58 <_sk_gradient_sse41+0x46> DB 72,139,88,72 ; mov 0x48(%rax),%rbx DB 73,255,201 ; dec %r9 DB 72,131,195,4 ; add $0x4,%rbx DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 15,40,21,49,22,0,0 ; movaps 0x1631(%rip),%xmm2 # 6060 <_sk_callback_sse41+0xfd3> + DB 15,40,21,52,22,0,0 ; movaps 0x1634(%rip),%xmm2 # 6070 <_sk_callback_sse41+0xfd6> DB 243,15,16,27 ; movss (%rbx),%xmm3 DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3 DB 15,194,216,2 ; cmpleps %xmm0,%xmm3 @@ -16372,7 +16225,7 @@ _sk_gradient_sse41 LABEL PROC DB 102,15,254,203 ; paddd %xmm3,%xmm1 DB 72,131,195,4 ; add $0x4,%rbx DB 73,255,201 ; dec %r9 - DB 117,228 ; jne 4a2f <_sk_gradient_sse41+0x2a> + DB 117,228 ; jne 4a3c <_sk_gradient_sse41+0x2a> DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9 DB 69,137,202 ; mov %r9d,%r10d DB 73,193,233,32 ; shr $0x20,%r9 @@ -16498,26 +16351,26 @@ _sk_xy_to_unit_angle_sse41 LABEL PROC DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,40,236 ; movaps %xmm12,%xmm13 DB 69,15,89,237 ; mulps %xmm13,%xmm13 - DB 68,15,40,21,210,19,0,0 ; movaps 0x13d2(%rip),%xmm10 # 6070 <_sk_callback_sse41+0xfe3> + DB 68,15,40,21,213,19,0,0 ; movaps 0x13d5(%rip),%xmm10 # 6080 <_sk_callback_sse41+0xfe6> DB 69,15,89,213 ; mulps %xmm13,%xmm10 - DB 68,15,88,21,214,19,0,0 ; addps 0x13d6(%rip),%xmm10 # 6080 <_sk_callback_sse41+0xff3> + DB 68,15,88,21,217,19,0,0 ; addps 0x13d9(%rip),%xmm10 # 6090 <_sk_callback_sse41+0xff6> DB 69,15,89,213 ; mulps %xmm13,%xmm10 - DB 68,15,88,21,218,19,0,0 ; addps 0x13da(%rip),%xmm10 # 6090 <_sk_callback_sse41+0x1003> + DB 68,15,88,21,221,19,0,0 ; addps 0x13dd(%rip),%xmm10 # 60a0 <_sk_callback_sse41+0x1006> DB 69,15,89,213 ; mulps %xmm13,%xmm10 - DB 68,15,88,21,222,19,0,0 ; addps 0x13de(%rip),%xmm10 # 60a0 <_sk_callback_sse41+0x1013> + DB 68,15,88,21,225,19,0,0 ; addps 0x13e1(%rip),%xmm10 # 60b0 <_sk_callback_sse41+0x1016> DB 69,15,89,212 ; mulps %xmm12,%xmm10 DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0 - DB 68,15,40,29,221,19,0,0 ; movaps 0x13dd(%rip),%xmm11 # 60b0 <_sk_callback_sse41+0x1023> + DB 68,15,40,29,224,19,0,0 ; movaps 0x13e0(%rip),%xmm11 # 60c0 <_sk_callback_sse41+0x1026> DB 69,15,92,218 ; subps %xmm10,%xmm11 DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10 DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9 - DB 68,15,40,29,214,19,0,0 ; movaps 0x13d6(%rip),%xmm11 # 60c0 <_sk_callback_sse41+0x1033> + DB 68,15,40,29,217,19,0,0 ; movaps 0x13d9(%rip),%xmm11 # 60d0 <_sk_callback_sse41+0x1036> DB 69,15,92,218 ; subps %xmm10,%xmm11 DB 65,15,40,193 ; movaps %xmm9,%xmm0 DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10 DB 15,40,193 ; movaps %xmm1,%xmm0 DB 65,15,194,192,1 ; cmpltps %xmm8,%xmm0 - DB 68,15,40,13,200,19,0,0 ; movaps 0x13c8(%rip),%xmm9 # 60d0 <_sk_callback_sse41+0x1043> + DB 68,15,40,13,203,19,0,0 ; movaps 0x13cb(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x1046> DB 69,15,92,202 ; subps %xmm10,%xmm9 DB 102,69,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm10 DB 69,15,194,194,7 ; cmpordps %xmm10,%xmm8 @@ -16539,7 +16392,7 @@ _sk_xy_to_radius_sse41 LABEL PROC PUBLIC _sk_save_xy_sse41 _sk_save_xy_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,156,19,0,0 ; movaps 0x139c(%rip),%xmm8 # 60e0 <_sk_callback_sse41+0x1053> + DB 68,15,40,5,159,19,0,0 ; movaps 0x139f(%rip),%xmm8 # 60f0 <_sk_callback_sse41+0x1056> DB 15,17,0 ; movups %xmm0,(%rax) DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,88,200 ; addps %xmm8,%xmm9 @@ -16579,8 +16432,8 @@ _sk_bilinear_nx_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,30,19,0,0 ; addps 0x131e(%rip),%xmm0 # 60f0 <_sk_callback_sse41+0x1063> - DB 68,15,40,13,38,19,0,0 ; movaps 0x1326(%rip),%xmm9 # 6100 <_sk_callback_sse41+0x1073> + DB 15,88,5,33,19,0,0 ; addps 0x1321(%rip),%xmm0 # 6100 <_sk_callback_sse41+0x1066> + DB 68,15,40,13,41,19,0,0 ; movaps 0x1329(%rip),%xmm9 # 6110 <_sk_callback_sse41+0x1076> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16591,7 +16444,7 @@ _sk_bilinear_px_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,21,19,0,0 ; addps 0x1315(%rip),%xmm0 # 6110 <_sk_callback_sse41+0x1083> + DB 15,88,5,24,19,0,0 ; addps 0x1318(%rip),%xmm0 # 6120 <_sk_callback_sse41+0x1086> DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16601,8 +16454,8 @@ _sk_bilinear_ny_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,7,19,0,0 ; addps 0x1307(%rip),%xmm1 # 6120 <_sk_callback_sse41+0x1093> - DB 68,15,40,13,15,19,0,0 ; movaps 0x130f(%rip),%xmm9 # 6130 <_sk_callback_sse41+0x10a3> + DB 15,88,13,10,19,0,0 ; addps 0x130a(%rip),%xmm1 # 6130 <_sk_callback_sse41+0x1096> + DB 68,15,40,13,18,19,0,0 ; movaps 0x1312(%rip),%xmm9 # 6140 <_sk_callback_sse41+0x10a6> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16613,7 +16466,7 @@ _sk_bilinear_py_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,253,18,0,0 ; addps 0x12fd(%rip),%xmm1 # 6140 <_sk_callback_sse41+0x10b3> + DB 15,88,13,0,19,0,0 ; addps 0x1300(%rip),%xmm1 # 6150 <_sk_callback_sse41+0x10b6> DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16623,13 +16476,13 @@ _sk_bicubic_n3x_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,240,18,0,0 ; addps 0x12f0(%rip),%xmm0 # 6150 <_sk_callback_sse41+0x10c3> - DB 68,15,40,13,248,18,0,0 ; movaps 0x12f8(%rip),%xmm9 # 6160 <_sk_callback_sse41+0x10d3> + DB 15,88,5,243,18,0,0 ; addps 0x12f3(%rip),%xmm0 # 6160 <_sk_callback_sse41+0x10c6> + DB 68,15,40,13,251,18,0,0 ; movaps 0x12fb(%rip),%xmm9 # 6170 <_sk_callback_sse41+0x10d6> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 69,15,40,193 ; movaps %xmm9,%xmm8 DB 69,15,89,192 ; mulps %xmm8,%xmm8 - DB 68,15,89,13,244,18,0,0 ; mulps 0x12f4(%rip),%xmm9 # 6170 <_sk_callback_sse41+0x10e3> - DB 68,15,88,13,252,18,0,0 ; addps 0x12fc(%rip),%xmm9 # 6180 <_sk_callback_sse41+0x10f3> + DB 68,15,89,13,247,18,0,0 ; mulps 0x12f7(%rip),%xmm9 # 6180 <_sk_callback_sse41+0x10e6> + DB 68,15,88,13,255,18,0,0 ; addps 0x12ff(%rip),%xmm9 # 6190 <_sk_callback_sse41+0x10f6> DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16640,16 +16493,16 @@ _sk_bicubic_n1x_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,235,18,0,0 ; addps 0x12eb(%rip),%xmm0 # 6190 <_sk_callback_sse41+0x1103> - DB 68,15,40,13,243,18,0,0 ; movaps 0x12f3(%rip),%xmm9 # 61a0 <_sk_callback_sse41+0x1113> + DB 15,88,5,238,18,0,0 ; addps 0x12ee(%rip),%xmm0 # 61a0 <_sk_callback_sse41+0x1106> + DB 68,15,40,13,246,18,0,0 ; movaps 0x12f6(%rip),%xmm9 # 61b0 <_sk_callback_sse41+0x1116> DB 69,15,92,200 ; subps %xmm8,%xmm9 - DB 68,15,40,5,247,18,0,0 ; movaps 0x12f7(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x1123> + DB 68,15,40,5,250,18,0,0 ; movaps 0x12fa(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x1126> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,251,18,0,0 ; addps 0x12fb(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x1133> + DB 68,15,88,5,254,18,0,0 ; addps 0x12fe(%rip),%xmm8 # 61d0 <_sk_callback_sse41+0x1136> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,255,18,0,0 ; addps 0x12ff(%rip),%xmm8 # 61d0 <_sk_callback_sse41+0x1143> + DB 68,15,88,5,2,19,0,0 ; addps 0x1302(%rip),%xmm8 # 61e0 <_sk_callback_sse41+0x1146> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,3,19,0,0 ; addps 0x1303(%rip),%xmm8 # 61e0 <_sk_callback_sse41+0x1153> + DB 68,15,88,5,6,19,0,0 ; addps 0x1306(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x1156> DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16657,17 +16510,17 @@ _sk_bicubic_n1x_sse41 LABEL PROC PUBLIC _sk_bicubic_p1x_sse41 _sk_bicubic_p1x_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,253,18,0,0 ; movaps 0x12fd(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x1163> + DB 68,15,40,5,0,19,0,0 ; movaps 0x1300(%rip),%xmm8 # 6200 <_sk_callback_sse41+0x1166> DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9 DB 65,15,88,192 ; addps %xmm8,%xmm0 - DB 68,15,40,21,249,18,0,0 ; movaps 0x12f9(%rip),%xmm10 # 6200 <_sk_callback_sse41+0x1173> + DB 68,15,40,21,252,18,0,0 ; movaps 0x12fc(%rip),%xmm10 # 6210 <_sk_callback_sse41+0x1176> DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,253,18,0,0 ; addps 0x12fd(%rip),%xmm10 # 6210 <_sk_callback_sse41+0x1183> + DB 68,15,88,21,0,19,0,0 ; addps 0x1300(%rip),%xmm10 # 6220 <_sk_callback_sse41+0x1186> DB 69,15,89,209 ; mulps %xmm9,%xmm10 DB 69,15,88,208 ; addps %xmm8,%xmm10 DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,249,18,0,0 ; addps 0x12f9(%rip),%xmm10 # 6220 <_sk_callback_sse41+0x1193> + DB 68,15,88,21,252,18,0,0 ; addps 0x12fc(%rip),%xmm10 # 6230 <_sk_callback_sse41+0x1196> DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16677,11 +16530,11 @@ _sk_bicubic_p3x_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,236,18,0,0 ; addps 0x12ec(%rip),%xmm0 # 6230 <_sk_callback_sse41+0x11a3> + DB 15,88,5,239,18,0,0 ; addps 0x12ef(%rip),%xmm0 # 6240 <_sk_callback_sse41+0x11a6> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 69,15,89,201 ; mulps %xmm9,%xmm9 - DB 68,15,89,5,236,18,0,0 ; mulps 0x12ec(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x11b3> - DB 68,15,88,5,244,18,0,0 ; addps 0x12f4(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x11c3> + DB 68,15,89,5,239,18,0,0 ; mulps 0x12ef(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x11b6> + DB 68,15,88,5,247,18,0,0 ; addps 0x12f7(%rip),%xmm8 # 6260 <_sk_callback_sse41+0x11c6> DB 69,15,89,193 ; mulps %xmm9,%xmm8 DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16692,13 +16545,13 @@ _sk_bicubic_n3y_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,226,18,0,0 ; addps 0x12e2(%rip),%xmm1 # 6260 <_sk_callback_sse41+0x11d3> - DB 68,15,40,13,234,18,0,0 ; movaps 0x12ea(%rip),%xmm9 # 6270 <_sk_callback_sse41+0x11e3> + DB 15,88,13,229,18,0,0 ; addps 0x12e5(%rip),%xmm1 # 6270 <_sk_callback_sse41+0x11d6> + DB 68,15,40,13,237,18,0,0 ; movaps 0x12ed(%rip),%xmm9 # 6280 <_sk_callback_sse41+0x11e6> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 69,15,40,193 ; movaps %xmm9,%xmm8 DB 69,15,89,192 ; mulps %xmm8,%xmm8 - DB 68,15,89,13,230,18,0,0 ; mulps 0x12e6(%rip),%xmm9 # 6280 <_sk_callback_sse41+0x11f3> - DB 68,15,88,13,238,18,0,0 ; addps 0x12ee(%rip),%xmm9 # 6290 <_sk_callback_sse41+0x1203> + DB 68,15,89,13,233,18,0,0 ; mulps 0x12e9(%rip),%xmm9 # 6290 <_sk_callback_sse41+0x11f6> + DB 68,15,88,13,241,18,0,0 ; addps 0x12f1(%rip),%xmm9 # 62a0 <_sk_callback_sse41+0x1206> DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16709,16 +16562,16 @@ _sk_bicubic_n1y_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,220,18,0,0 ; addps 0x12dc(%rip),%xmm1 # 62a0 <_sk_callback_sse41+0x1213> - DB 68,15,40,13,228,18,0,0 ; movaps 0x12e4(%rip),%xmm9 # 62b0 <_sk_callback_sse41+0x1223> + DB 15,88,13,223,18,0,0 ; addps 0x12df(%rip),%xmm1 # 62b0 <_sk_callback_sse41+0x1216> + DB 68,15,40,13,231,18,0,0 ; movaps 0x12e7(%rip),%xmm9 # 62c0 <_sk_callback_sse41+0x1226> DB 69,15,92,200 ; subps %xmm8,%xmm9 - DB 68,15,40,5,232,18,0,0 ; movaps 0x12e8(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x1233> + DB 68,15,40,5,235,18,0,0 ; movaps 0x12eb(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x1236> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,236,18,0,0 ; addps 0x12ec(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x1243> + DB 68,15,88,5,239,18,0,0 ; addps 0x12ef(%rip),%xmm8 # 62e0 <_sk_callback_sse41+0x1246> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,240,18,0,0 ; addps 0x12f0(%rip),%xmm8 # 62e0 <_sk_callback_sse41+0x1253> + DB 68,15,88,5,243,18,0,0 ; addps 0x12f3(%rip),%xmm8 # 62f0 <_sk_callback_sse41+0x1256> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,244,18,0,0 ; addps 0x12f4(%rip),%xmm8 # 62f0 <_sk_callback_sse41+0x1263> + DB 68,15,88,5,247,18,0,0 ; addps 0x12f7(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x1266> DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16726,17 +16579,17 @@ _sk_bicubic_n1y_sse41 LABEL PROC PUBLIC _sk_bicubic_p1y_sse41 _sk_bicubic_p1y_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,238,18,0,0 ; movaps 0x12ee(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x1273> + DB 68,15,40,5,241,18,0,0 ; movaps 0x12f1(%rip),%xmm8 # 6310 <_sk_callback_sse41+0x1276> DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9 DB 65,15,88,200 ; addps %xmm8,%xmm1 - DB 68,15,40,21,233,18,0,0 ; movaps 0x12e9(%rip),%xmm10 # 6310 <_sk_callback_sse41+0x1283> + DB 68,15,40,21,236,18,0,0 ; movaps 0x12ec(%rip),%xmm10 # 6320 <_sk_callback_sse41+0x1286> DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,237,18,0,0 ; addps 0x12ed(%rip),%xmm10 # 6320 <_sk_callback_sse41+0x1293> + DB 68,15,88,21,240,18,0,0 ; addps 0x12f0(%rip),%xmm10 # 6330 <_sk_callback_sse41+0x1296> DB 69,15,89,209 ; mulps %xmm9,%xmm10 DB 69,15,88,208 ; addps %xmm8,%xmm10 DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,233,18,0,0 ; addps 0x12e9(%rip),%xmm10 # 6330 <_sk_callback_sse41+0x12a3> + DB 68,15,88,21,236,18,0,0 ; addps 0x12ec(%rip),%xmm10 # 6340 <_sk_callback_sse41+0x12a6> DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -16746,11 +16599,11 @@ _sk_bicubic_p3y_sse41 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,219,18,0,0 ; addps 0x12db(%rip),%xmm1 # 6340 <_sk_callback_sse41+0x12b3> + DB 15,88,13,222,18,0,0 ; addps 0x12de(%rip),%xmm1 # 6350 <_sk_callback_sse41+0x12b6> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 69,15,89,201 ; mulps %xmm9,%xmm9 - DB 68,15,89,5,219,18,0,0 ; mulps 0x12db(%rip),%xmm8 # 6350 <_sk_callback_sse41+0x12c3> - DB 68,15,88,5,227,18,0,0 ; addps 0x12e3(%rip),%xmm8 # 6360 <_sk_callback_sse41+0x12d3> + DB 68,15,89,5,222,18,0,0 ; mulps 0x12de(%rip),%xmm8 # 6360 <_sk_callback_sse41+0x12c6> + DB 68,15,88,5,230,18,0,0 ; addps 0x12e6(%rip),%xmm8 # 6370 <_sk_callback_sse41+0x12d6> DB 69,15,89,193 ; mulps %xmm9,%xmm8 DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -16758,11 +16611,13 @@ _sk_bicubic_p3y_sse41 LABEL PROC PUBLIC _sk_callback_sse41 _sk_callback_sse41 LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,84 ; push %r12 DB 83 ; push %rbx - DB 72,131,236,40 ; sub $0x28,%rsp + DB 72,131,236,32 ; sub $0x20,%rsp DB 68,15,40,197 ; movaps %xmm5,%xmm8 DB 68,15,40,204 ; movaps %xmm4,%xmm9 DB 77,137,196 ; mov %r8,%r12 @@ -16814,11 +16669,12 @@ _sk_callback_sse41 LABEL PROC DB 77,137,224 ; mov %r12,%r8 DB 65,15,40,225 ; movaps %xmm9,%xmm4 DB 65,15,40,232 ; movaps %xmm8,%xmm5 - DB 72,131,196,40 ; add $0x28,%rsp + DB 72,131,196,32 ; add $0x20,%rsp DB 91 ; pop %rbx DB 65,92 ; pop %r12 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax ALIGN 16 @@ -16965,11 +16821,11 @@ ALIGN 16 DB 128,191,0,0,128,191,0 ; cmpb $0x0,-0x40800000(%rdi) DB 0,224 ; add %ah,%al DB 64,0,0 ; add %al,(%rax) - DB 224,64 ; loopne 5338 <.literal16+0x1d8> + DB 224,64 ; loopne 5348 <.literal16+0x1d8> DB 0,0 ; add %al,(%rax) - DB 224,64 ; loopne 533c <.literal16+0x1dc> + DB 224,64 ; loopne 534c <.literal16+0x1dc> DB 0,0 ; add %al,(%rax) - DB 224,64 ; loopne 5340 <.literal16+0x1e0> + DB 224,64 ; loopne 5350 <.literal16+0x1e0> DB 154 ; (bad) DB 153 ; cltd DB 153 ; cltd @@ -16989,13 +16845,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5361 <.literal16+0x201> + DB 71,225,61 ; rex.RXB loope 5371 <.literal16+0x201> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5365 <.literal16+0x205> + DB 71,225,61 ; rex.RXB loope 5375 <.literal16+0x205> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5369 <.literal16+0x209> + DB 71,225,61 ; rex.RXB loope 5379 <.literal16+0x209> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 536d <.literal16+0x20d> + DB 71,225,61 ; rex.RXB loope 537d <.literal16+0x20d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -17020,13 +16876,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53a1 <.literal16+0x241> + DB 71,225,61 ; rex.RXB loope 53b1 <.literal16+0x241> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53a5 <.literal16+0x245> + DB 71,225,61 ; rex.RXB loope 53b5 <.literal16+0x245> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53a9 <.literal16+0x249> + DB 71,225,61 ; rex.RXB loope 53b9 <.literal16+0x249> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53ad <.literal16+0x24d> + DB 71,225,61 ; rex.RXB loope 53bd <.literal16+0x24d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -17051,13 +16907,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53e1 <.literal16+0x281> + DB 71,225,61 ; rex.RXB loope 53f1 <.literal16+0x281> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53e5 <.literal16+0x285> + DB 71,225,61 ; rex.RXB loope 53f5 <.literal16+0x285> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53e9 <.literal16+0x289> + DB 71,225,61 ; rex.RXB loope 53f9 <.literal16+0x289> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 53ed <.literal16+0x28d> + DB 71,225,61 ; rex.RXB loope 53fd <.literal16+0x28d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -17082,13 +16938,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5421 <.literal16+0x2c1> + DB 71,225,61 ; rex.RXB loope 5431 <.literal16+0x2c1> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5425 <.literal16+0x2c5> + DB 71,225,61 ; rex.RXB loope 5435 <.literal16+0x2c5> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5429 <.literal16+0x2c9> + DB 71,225,61 ; rex.RXB loope 5439 <.literal16+0x2c9> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 542d <.literal16+0x2cd> + DB 71,225,61 ; rex.RXB loope 543d <.literal16+0x2cd> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -17105,10 +16961,10 @@ ALIGN 16 DB 0,1 ; add %al,(%rcx) DB 255 ; (bad) DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005418 <_sk_callback_sse41+0xa00038b> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005428 <_sk_callback_sse41+0xa00038e> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005420 <_sk_callback_sse41+0x3000393> + DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005430 <_sk_callback_sse41+0x3000396> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -17127,11 +16983,11 @@ ALIGN 16 DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax) DB 67,0,0 ; rex.XB add %al,(%r8) - DB 127,67 ; jg 548b <.literal16+0x32b> + DB 127,67 ; jg 549b <.literal16+0x32b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 548f <.literal16+0x32f> + DB 127,67 ; jg 549f <.literal16+0x32f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5493 <.literal16+0x333> + DB 127,67 ; jg 54a3 <.literal16+0x333> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -17366,13 +17222,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 5669 <.literal16+0x509> + DB 224,7 ; loopne 5679 <.literal16+0x509> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 566d <.literal16+0x50d> + DB 224,7 ; loopne 567d <.literal16+0x50d> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5671 <.literal16+0x511> + DB 224,7 ; loopne 5681 <.literal16+0x511> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5675 <.literal16+0x515> + DB 224,7 ; loopne 5685 <.literal16+0x515> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -17406,10 +17262,10 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 1,255 ; add %edi,%edi DB 255 ; (bad) - DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0056b8 <_sk_callback_sse41+0xa00062b> + DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0056c8 <_sk_callback_sse41+0xa00062e> DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30056c0 <_sk_callback_sse41+0x3000633> + DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30056d0 <_sk_callback_sse41+0x3000636> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -17464,11 +17320,11 @@ ALIGN 16 DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,127,67 ; add %bh,0x43(%rdi) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 578b <.literal16+0x62b> + DB 127,67 ; jg 579b <.literal16+0x62b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 578f <.literal16+0x62f> + DB 127,67 ; jg 579f <.literal16+0x62f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5793 <.literal16+0x633> + DB 127,67 ; jg 57a3 <.literal16+0x633> DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax) DB 128,59,129 ; cmpb $0x81,(%rbx) DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax) @@ -17483,16 +17339,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5784 <.literal16+0x624> + DB 127,0 ; jg 5794 <.literal16+0x624> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5788 <.literal16+0x628> + DB 127,0 ; jg 5798 <.literal16+0x628> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 578c <.literal16+0x62c> + DB 127,0 ; jg 579c <.literal16+0x62c> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5790 <.literal16+0x630> + DB 127,0 ; jg 57a0 <.literal16+0x630> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -17501,7 +17357,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5815 <.literal16+0x6b5> + DB 119,115 ; ja 5825 <.literal16+0x6b5> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -17512,7 +17368,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5779 <.literal16+0x619> + DB 117,191 ; jne 5789 <.literal16+0x619> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -17524,7 +17380,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a397ba <_sk_callback_sse41+0xffffffffe9a3472d> + DB 233,220,63,163,233 ; jmpq ffffffffe9a397ca <_sk_callback_sse41+0xffffffffe9a34730> DB 220,63 ; fdivrl (%rdi) DB 81 ; push %rcx DB 140,242 ; mov %?,%edx @@ -17579,16 +17435,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5854 <.literal16+0x6f4> + DB 127,0 ; jg 5864 <.literal16+0x6f4> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5858 <.literal16+0x6f8> + DB 127,0 ; jg 5868 <.literal16+0x6f8> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 585c <.literal16+0x6fc> + DB 127,0 ; jg 586c <.literal16+0x6fc> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5860 <.literal16+0x700> + DB 127,0 ; jg 5870 <.literal16+0x700> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -17597,7 +17453,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 58e5 <.literal16+0x785> + DB 119,115 ; ja 58f5 <.literal16+0x785> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -17608,7 +17464,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5849 <.literal16+0x6e9> + DB 117,191 ; jne 5859 <.literal16+0x6e9> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -17620,7 +17476,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a3988a <_sk_callback_sse41+0xffffffffe9a347fd> + DB 233,220,63,163,233 ; jmpq ffffffffe9a3989a <_sk_callback_sse41+0xffffffffe9a34800> DB 220,63 ; fdivrl (%rdi) DB 81 ; push %rcx DB 140,242 ; mov %?,%edx @@ -17675,16 +17531,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5924 <.literal16+0x7c4> + DB 127,0 ; jg 5934 <.literal16+0x7c4> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5928 <.literal16+0x7c8> + DB 127,0 ; jg 5938 <.literal16+0x7c8> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 592c <.literal16+0x7cc> + DB 127,0 ; jg 593c <.literal16+0x7cc> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5930 <.literal16+0x7d0> + DB 127,0 ; jg 5940 <.literal16+0x7d0> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -17693,7 +17549,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 59b5 <.literal16+0x855> + DB 119,115 ; ja 59c5 <.literal16+0x855> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -17704,7 +17560,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5919 <.literal16+0x7b9> + DB 117,191 ; jne 5929 <.literal16+0x7b9> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -17716,7 +17572,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a3995a <_sk_callback_sse41+0xffffffffe9a348cd> + DB 233,220,63,163,233 ; jmpq ffffffffe9a3996a <_sk_callback_sse41+0xffffffffe9a348d0> DB 220,63 ; fdivrl (%rdi) DB 81 ; push %rcx DB 140,242 ; mov %?,%edx @@ -17771,16 +17627,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 59f4 <.literal16+0x894> + DB 127,0 ; jg 5a04 <.literal16+0x894> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 59f8 <.literal16+0x898> + DB 127,0 ; jg 5a08 <.literal16+0x898> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 59fc <.literal16+0x89c> + DB 127,0 ; jg 5a0c <.literal16+0x89c> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5a00 <.literal16+0x8a0> + DB 127,0 ; jg 5a10 <.literal16+0x8a0> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -17789,7 +17645,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5a85 <.literal16+0x925> + DB 119,115 ; ja 5a95 <.literal16+0x925> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -17800,7 +17656,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 59e9 <.literal16+0x889> + DB 117,191 ; jne 59f9 <.literal16+0x889> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -17812,7 +17668,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a39a2a <_sk_callback_sse41+0xffffffffe9a3499d> + DB 233,220,63,163,233 ; jmpq ffffffffe9a39a3a <_sk_callback_sse41+0xffffffffe9a349a0> DB 220,63 ; fdivrl (%rdi) DB 81 ; push %rcx DB 140,242 ; mov %?,%edx @@ -17863,13 +17719,13 @@ ALIGN 16 DB 200,66,0,0 ; enterq $0x42,$0x0 DB 200,66,0,0 ; enterq $0x42,$0x0 DB 200,66,0,0 ; enterq $0x42,$0x0 - DB 127,67 ; jg 5b07 <.literal16+0x9a7> + DB 127,67 ; jg 5b17 <.literal16+0x9a7> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5b0b <.literal16+0x9ab> + DB 127,67 ; jg 5b1b <.literal16+0x9ab> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5b0f <.literal16+0x9af> + DB 127,67 ; jg 5b1f <.literal16+0x9af> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5b13 <.literal16+0x9b3> + DB 127,67 ; jg 5b23 <.literal16+0x9b3> DB 0,0 ; add %al,(%rax) DB 0,195 ; add %al,%bl DB 0,0 ; add %al,(%rax) @@ -17916,16 +17772,16 @@ ALIGN 16 DB 128,3,62 ; addb $0x3e,(%rbx) DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 5b93 <.literal16+0xa33> + DB 118,63 ; jbe 5ba3 <.literal16+0xa33> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 5b97 <.literal16+0xa37> + DB 118,63 ; jbe 5ba7 <.literal16+0xa37> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 5b9b <.literal16+0xa3b> + DB 118,63 ; jbe 5bab <.literal16+0xa3b> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 5b9f <.literal16+0xa3f> + DB 118,63 ; jbe 5baf <.literal16+0xa3f> DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 246,64,83,63 ; testb $0x3f,0x53(%rax) @@ -17945,11 +17801,11 @@ ALIGN 16 DB 128,59,0 ; cmpb $0x0,(%rbx) DB 0,127,67 ; add %bh,0x43(%rdi) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5beb <.literal16+0xa8b> + DB 127,67 ; jg 5bfb <.literal16+0xa8b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5bef <.literal16+0xa8f> + DB 127,67 ; jg 5bff <.literal16+0xa8f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5bf3 <.literal16+0xa93> + DB 127,67 ; jg 5c03 <.literal16+0xa93> DB 255,0 ; incl (%rax) DB 0,0 ; add %al,(%rax) DB 255,0 ; incl (%rax) @@ -17986,7 +17842,7 @@ ALIGN 16 DB 5,255,255,255,9 ; add $0x9ffffff,%eax DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005c30 <_sk_callback_sse41+0x3000ba3> + DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005c40 <_sk_callback_sse41+0x3000ba6> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -18015,13 +17871,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 5c69 <.literal16+0xb09> + DB 224,7 ; loopne 5c79 <.literal16+0xb09> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5c6d <.literal16+0xb0d> + DB 224,7 ; loopne 5c7d <.literal16+0xb0d> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5c71 <.literal16+0xb11> + DB 224,7 ; loopne 5c81 <.literal16+0xb11> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5c75 <.literal16+0xb15> + DB 224,7 ; loopne 5c85 <.literal16+0xb15> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -18067,13 +17923,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 5cd9 <.literal16+0xb79> + DB 224,7 ; loopne 5ce9 <.literal16+0xb79> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5cdd <.literal16+0xb7d> + DB 224,7 ; loopne 5ced <.literal16+0xb7d> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5ce1 <.literal16+0xb81> + DB 224,7 ; loopne 5cf1 <.literal16+0xb81> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5ce5 <.literal16+0xb85> + DB 224,7 ; loopne 5cf5 <.literal16+0xb85> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -18111,13 +17967,13 @@ ALIGN 16 DB 65,0,0 ; add %al,(%r8) DB 248 ; clc DB 65,0,0 ; add %al,(%r8) - DB 124,66 ; jl 5d76 <.literal16+0xc16> + DB 124,66 ; jl 5d86 <.literal16+0xc16> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 5d7a <.literal16+0xc1a> + DB 124,66 ; jl 5d8a <.literal16+0xc1a> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 5d7e <.literal16+0xc1e> + DB 124,66 ; jl 5d8e <.literal16+0xc1e> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 5d82 <.literal16+0xc22> + DB 124,66 ; jl 5d92 <.literal16+0xc22> DB 0,240 ; add %dh,%al DB 0,0 ; add %al,(%rax) DB 0,240 ; add %dh,%al @@ -18207,13 +18063,13 @@ ALIGN 16 DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax) DB 61,137,136,136,61 ; cmp $0x3d888889,%eax DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 5e85 <.literal16+0xd25> + DB 112,65 ; jo 5e95 <.literal16+0xd25> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 5e89 <.literal16+0xd29> + DB 112,65 ; jo 5e99 <.literal16+0xd29> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 5e8d <.literal16+0xd2d> + DB 112,65 ; jo 5e9d <.literal16+0xd2d> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 5e91 <.literal16+0xd31> + DB 112,65 ; jo 5ea1 <.literal16+0xd31> DB 255,0 ; incl (%rax) DB 0,0 ; add %al,(%rax) DB 255,0 ; incl (%rax) @@ -18228,7 +18084,7 @@ ALIGN 16 DB 5,255,255,255,9 ; add $0x9ffffff,%eax DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005e80 <_sk_callback_sse41+0x3000df3> + DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005e90 <_sk_callback_sse41+0x3000df6> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -18255,7 +18111,7 @@ ALIGN 16 DB 5,255,255,255,9 ; add $0x9ffffff,%eax DB 255 ; (bad) DB 255 ; (bad) - DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005ec0 <_sk_callback_sse41+0x3000e33> + DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3005ed0 <_sk_callback_sse41+0x3000e36> DB 255 ; (bad) DB 255 ; (bad) DB 255,6 ; incl (%rsi) @@ -18270,11 +18126,11 @@ ALIGN 16 DB 255,0 ; incl (%rax) DB 0,127,67 ; add %bh,0x43(%rdi) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5f1b <.literal16+0xdbb> + DB 127,67 ; jg 5f2b <.literal16+0xdbb> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5f1f <.literal16+0xdbf> + DB 127,67 ; jg 5f2f <.literal16+0xdbf> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5f23 <.literal16+0xdc3> + DB 127,67 ; jg 5f33 <.literal16+0xdc3> DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax) DB 0,0 ; add %al,(%rax) DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax) @@ -18350,13 +18206,13 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 255 ; (bad) - DB 127,71 ; jg 5feb <.literal16+0xe8b> + DB 127,71 ; jg 5ffb <.literal16+0xe8b> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 5fef <.literal16+0xe8f> + DB 127,71 ; jg 5fff <.literal16+0xe8f> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 5ff3 <.literal16+0xe93> + DB 127,71 ; jg 6003 <.literal16+0xe93> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 5ff7 <.literal16+0xe97> + DB 127,71 ; jg 6007 <.literal16+0xe97> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -18402,10 +18258,10 @@ ALIGN 16 DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax DB 152 ; cwtl DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx) - DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0712a <_sk_callback_sse41+0x2dc0209d> + DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0713a <_sk_callback_sse41+0x2dc020a0> DB 17,192 ; adc %eax,%eax DB 45,16,17,192,18 ; sub $0x12c01110,%eax - DB 120,57 ; js 605c <.literal16+0xefc> + DB 120,57 ; js 606c <.literal16+0xefc> DB 64,18,120,57 ; adc 0x39(%rax),%dil DB 64,18,120,57 ; adc 0x39(%rax),%dil DB 64,18,120,57 ; adc 0x39(%rax),%dil @@ -18527,11 +18383,11 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,114 ; cmpb $0x72,(%rdi) DB 28,199 ; sbb $0xc7,%al - DB 62,114,28 ; jb,pt 6192 <.literal16+0x1032> + DB 62,114,28 ; jb,pt 61a2 <.literal16+0x1032> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6196 <.literal16+0x1036> + DB 62,114,28 ; jb,pt 61a6 <.literal16+0x1036> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 619a <.literal16+0x103a> + DB 62,114,28 ; jb,pt 61aa <.literal16+0x103a> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -18575,7 +18431,7 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f025 <_sk_callback_sse41+0x3d639f98> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f035 <_sk_callback_sse41+0x3d639f9b> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -18601,7 +18457,7 @@ ALIGN 16 DB 0,192 ; add %al,%al DB 63 ; (bad) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f065 <_sk_callback_sse41+0x3d639fd8> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f075 <_sk_callback_sse41+0x3d639fdb> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al @@ -18610,13 +18466,13 @@ ALIGN 16 DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al DB 63 ; (bad) - DB 114,28 ; jb 625e <.literal16+0x10fe> + DB 114,28 ; jb 626e <.literal16+0x10fe> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6262 <.literal16+0x1102> + DB 62,114,28 ; jb,pt 6272 <.literal16+0x1102> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6266 <.literal16+0x1106> + DB 62,114,28 ; jb,pt 6276 <.literal16+0x1106> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 626a <.literal16+0x110a> + DB 62,114,28 ; jb,pt 627a <.literal16+0x110a> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -18637,11 +18493,11 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,114 ; cmpb $0x72,(%rdi) DB 28,199 ; sbb $0xc7,%al - DB 62,114,28 ; jb,pt 62a2 <.literal16+0x1142> + DB 62,114,28 ; jb,pt 62b2 <.literal16+0x1142> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 62a6 <.literal16+0x1146> + DB 62,114,28 ; jb,pt 62b6 <.literal16+0x1146> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 62aa <.literal16+0x114a> + DB 62,114,28 ; jb,pt 62ba <.literal16+0x114a> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -18685,7 +18541,7 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f135 <_sk_callback_sse41+0x3d63a0a8> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f145 <_sk_callback_sse41+0x3d63a0ab> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -18711,7 +18567,7 @@ ALIGN 16 DB 0,192 ; add %al,%al DB 63 ; (bad) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f175 <_sk_callback_sse41+0x3d63a0e8> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f185 <_sk_callback_sse41+0x3d63a0eb> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al @@ -18720,13 +18576,13 @@ ALIGN 16 DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al DB 63 ; (bad) - DB 114,28 ; jb 636e <.literal16+0x120e> + DB 114,28 ; jb 637e <.literal16+0x120e> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6372 <_sk_callback_sse41+0x12e5> + DB 62,114,28 ; jb,pt 6382 <_sk_callback_sse41+0x12e8> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6376 <_sk_callback_sse41+0x12e9> + DB 62,114,28 ; jb,pt 6386 <_sk_callback_sse41+0x12ec> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 637a <_sk_callback_sse41+0x12ed> + DB 62,114,28 ; jb,pt 638a <_sk_callback_sse41+0x12f0> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -18740,38 +18596,39 @@ ALIGN 32 PUBLIC _sk_start_pipeline_sse2 _sk_start_pipeline_sse2 LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 86 ; push %rsi DB 87 ; push %rdi - DB 85 ; push %rbp DB 83 ; push %rbx - DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp - DB 68,15,41,188,36,144,0,0,0 ; movaps %xmm15,0x90(%rsp) - DB 68,15,41,180,36,128,0,0,0 ; movaps %xmm14,0x80(%rsp) - DB 68,15,41,108,36,112 ; movaps %xmm13,0x70(%rsp) - DB 68,15,41,100,36,96 ; movaps %xmm12,0x60(%rsp) - DB 68,15,41,92,36,80 ; movaps %xmm11,0x50(%rsp) - DB 68,15,41,84,36,64 ; movaps %xmm10,0x40(%rsp) - DB 68,15,41,76,36,48 ; movaps %xmm9,0x30(%rsp) - DB 68,15,41,68,36,32 ; movaps %xmm8,0x20(%rsp) - DB 15,41,124,36,16 ; movaps %xmm7,0x10(%rsp) - DB 15,41,52,36 ; movaps %xmm6,(%rsp) - DB 76,137,195 ; mov %r8,%rbx - DB 73,137,214 ; mov %rdx,%r14 - DB 72,137,205 ; mov %rcx,%rbp - DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15 + DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp + DB 68,15,41,125,176 ; movaps %xmm15,-0x50(%rbp) + DB 68,15,41,117,160 ; movaps %xmm14,-0x60(%rbp) + DB 68,15,41,109,144 ; movaps %xmm13,-0x70(%rbp) + DB 68,15,41,101,128 ; movaps %xmm12,-0x80(%rbp) + DB 68,15,41,157,112,255,255,255 ; movaps %xmm11,-0x90(%rbp) + DB 68,15,41,149,96,255,255,255 ; movaps %xmm10,-0xa0(%rbp) + DB 68,15,41,141,80,255,255,255 ; movaps %xmm9,-0xb0(%rbp) + DB 68,15,41,133,64,255,255,255 ; movaps %xmm8,-0xc0(%rbp) + DB 15,41,189,48,255,255,255 ; movaps %xmm7,-0xd0(%rbp) + DB 15,41,181,32,255,255,255 ; movaps %xmm6,-0xe0(%rbp) + DB 72,137,211 ; mov %rdx,%rbx + DB 73,137,207 ; mov %rcx,%r15 + DB 76,139,117,48 ; mov 0x30(%rbp),%r14 DB 76,137,206 ; mov %r9,%rsi DB 72,173 ; lods %ds:(%rsi),%rax - DB 73,137,196 ; mov %rax,%r12 - DB 73,137,245 ; mov %rsi,%r13 - DB 72,141,69,4 ; lea 0x4(%rbp),%rax - DB 72,57,216 ; cmp %rbx,%rax - DB 118,5 ; jbe 7c <_sk_start_pipeline_sse2+0x7c> - DB 72,137,234 ; mov %rbp,%rdx - DB 235,61 ; jmp b9 <_sk_start_pipeline_sse2+0xb9> + DB 73,137,197 ; mov %rax,%r13 + DB 73,137,244 ; mov %rsi,%r12 + DB 73,141,79,4 ; lea 0x4(%r15),%rcx + DB 76,57,193 ; cmp %r8,%rcx + DB 118,5 ; jbe 7b <_sk_start_pipeline_sse2+0x7b> + DB 76,137,250 ; mov %r15,%rdx + DB 235,75 ; jmp c6 <_sk_start_pipeline_sse2+0xc6> + DB 76,137,133,24,255,255,255 ; mov %r8,-0xe8(%rbp) DB 65,184,0,0,0,0 ; mov $0x0,%r8d DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 @@ -18781,18 +18638,19 @@ _sk_start_pipeline_sse2 LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 72,137,234 ; mov %rbp,%rdx - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 - DB 72,141,85,4 ; lea 0x4(%rbp),%rdx - DB 72,131,197,8 ; add $0x8,%rbp - DB 72,57,221 ; cmp %rbx,%rbp - DB 72,137,213 ; mov %rdx,%rbp - DB 118,195 ; jbe 7c <_sk_start_pipeline_sse2+0x7c> - DB 72,41,211 ; sub %rdx,%rbx - DB 116,39 ; je e5 <_sk_start_pipeline_sse2+0xe5> + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,250 ; mov %r15,%rdx + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 76,139,133,24,255,255,255 ; mov -0xe8(%rbp),%r8 + DB 73,141,87,4 ; lea 0x4(%r15),%rdx + DB 73,131,199,8 ; add $0x8,%r15 + DB 77,57,199 ; cmp %r8,%r15 + DB 73,137,215 ; mov %rdx,%r15 + DB 118,188 ; jbe 82 <_sk_start_pipeline_sse2+0x82> + DB 73,41,208 ; sub %rdx,%r8 + DB 116,36 ; je ef <_sk_start_pipeline_sse2+0xef> DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 DB 15,87,210 ; xorps %xmm2,%xmm2 @@ -18801,30 +18659,29 @@ _sk_start_pipeline_sse2 LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 76,137,241 ; mov %r14,%rcx - DB 73,137,216 ; mov %rbx,%r8 - DB 65,255,212 ; callq *%r12 - DB 15,40,52,36 ; movaps (%rsp),%xmm6 - DB 15,40,124,36,16 ; movaps 0x10(%rsp),%xmm7 - DB 68,15,40,68,36,32 ; movaps 0x20(%rsp),%xmm8 - DB 68,15,40,76,36,48 ; movaps 0x30(%rsp),%xmm9 - DB 68,15,40,84,36,64 ; movaps 0x40(%rsp),%xmm10 - DB 68,15,40,92,36,80 ; movaps 0x50(%rsp),%xmm11 - DB 68,15,40,100,36,96 ; movaps 0x60(%rsp),%xmm12 - DB 68,15,40,108,36,112 ; movaps 0x70(%rsp),%xmm13 - DB 68,15,40,180,36,128,0,0,0 ; movaps 0x80(%rsp),%xmm14 - DB 68,15,40,188,36,144,0,0,0 ; movaps 0x90(%rsp),%xmm15 - DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 72,137,217 ; mov %rbx,%rcx + DB 65,255,213 ; callq *%r13 + DB 15,40,181,32,255,255,255 ; movaps -0xe0(%rbp),%xmm6 + DB 15,40,189,48,255,255,255 ; movaps -0xd0(%rbp),%xmm7 + DB 68,15,40,133,64,255,255,255 ; movaps -0xc0(%rbp),%xmm8 + DB 68,15,40,141,80,255,255,255 ; movaps -0xb0(%rbp),%xmm9 + DB 68,15,40,149,96,255,255,255 ; movaps -0xa0(%rbp),%xmm10 + DB 68,15,40,157,112,255,255,255 ; movaps -0x90(%rbp),%xmm11 + DB 68,15,40,101,128 ; movaps -0x80(%rbp),%xmm12 + DB 68,15,40,109,144 ; movaps -0x70(%rbp),%xmm13 + DB 68,15,40,117,160 ; movaps -0x60(%rbp),%xmm14 + DB 68,15,40,125,176 ; movaps -0x50(%rbp),%xmm15 + DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp DB 91 ; pop %rbx - DB 93 ; pop %rbp DB 95 ; pop %rdi DB 94 ; pop %rsi DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 195 ; retq PUBLIC _sk_just_return_sse2 @@ -18836,7 +18693,7 @@ _sk_seed_shader_sse2 LABEL PROC DB 102,15,110,194 ; movd %edx,%xmm0 DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0 DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1 - DB 15,40,21,84,85,0,0 ; movaps 0x5554(%rip),%xmm2 # 56a0 <_sk_callback_sse2+0xc6> + DB 15,40,21,103,85,0,0 ; movaps 0x5567(%rip),%xmm2 # 56c0 <_sk_callback_sse2+0xd9> DB 15,88,202 ; addps %xmm2,%xmm1 DB 15,16,7 ; movups (%rdi),%xmm0 DB 15,88,193 ; addps %xmm1,%xmm0 @@ -18845,7 +18702,7 @@ _sk_seed_shader_sse2 LABEL PROC DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 15,88,202 ; addps %xmm2,%xmm1 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,21,67,85,0,0 ; movaps 0x5543(%rip),%xmm2 # 56b0 <_sk_callback_sse2+0xd6> + DB 15,40,21,86,85,0,0 ; movaps 0x5556(%rip),%xmm2 # 56d0 <_sk_callback_sse2+0xe9> DB 15,87,219 ; xorps %xmm3,%xmm3 DB 15,87,228 ; xorps %xmm4,%xmm4 DB 15,87,237 ; xorps %xmm5,%xmm5 @@ -18863,14 +18720,14 @@ _sk_dither_sse2 LABEL PROC DB 102,68,15,110,193 ; movd %ecx,%xmm8 DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8 DB 102,69,15,239,193 ; pxor %xmm9,%xmm8 - DB 102,68,15,111,21,17,85,0,0 ; movdqa 0x5511(%rip),%xmm10 # 56c0 <_sk_callback_sse2+0xe6> + DB 102,68,15,111,21,36,85,0,0 ; movdqa 0x5524(%rip),%xmm10 # 56e0 <_sk_callback_sse2+0xf9> DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11 DB 102,69,15,219,218 ; pand %xmm10,%xmm11 DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11 DB 102,69,15,219,209 ; pand %xmm9,%xmm10 DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10 - DB 102,68,15,111,37,253,84,0,0 ; movdqa 0x54fd(%rip),%xmm12 # 56d0 <_sk_callback_sse2+0xf6> - DB 102,68,15,111,45,4,85,0,0 ; movdqa 0x5504(%rip),%xmm13 # 56e0 <_sk_callback_sse2+0x106> + DB 102,68,15,111,37,16,85,0,0 ; movdqa 0x5510(%rip),%xmm12 # 56f0 <_sk_callback_sse2+0x109> + DB 102,68,15,111,45,23,85,0,0 ; movdqa 0x5517(%rip),%xmm13 # 5700 <_sk_callback_sse2+0x119> DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14 DB 102,69,15,219,245 ; pand %xmm13,%xmm14 DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14 @@ -18886,8 +18743,8 @@ _sk_dither_sse2 LABEL PROC DB 102,69,15,235,245 ; por %xmm13,%xmm14 DB 102,69,15,235,240 ; por %xmm8,%xmm14 DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8 - DB 68,15,89,5,191,84,0,0 ; mulps 0x54bf(%rip),%xmm8 # 56f0 <_sk_callback_sse2+0x116> - DB 68,15,88,5,199,84,0,0 ; addps 0x54c7(%rip),%xmm8 # 5700 <_sk_callback_sse2+0x126> + DB 68,15,89,5,210,84,0,0 ; mulps 0x54d2(%rip),%xmm8 # 5710 <_sk_callback_sse2+0x129> + DB 68,15,88,5,218,84,0,0 ; addps 0x54da(%rip),%xmm8 # 5720 <_sk_callback_sse2+0x139> DB 243,68,15,16,16 ; movss (%rax),%xmm10 DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10 DB 69,15,89,208 ; mulps %xmm8,%xmm10 @@ -18954,7 +18811,7 @@ _sk_clear_sse2 LABEL PROC PUBLIC _sk_srcatop_sse2 _sk_srcatop_sse2 LABEL PROC DB 15,89,199 ; mulps %xmm7,%xmm0 - DB 68,15,40,5,33,84,0,0 ; movaps 0x5421(%rip),%xmm8 # 5710 <_sk_callback_sse2+0x136> + DB 68,15,40,5,52,84,0,0 ; movaps 0x5434(%rip),%xmm8 # 5730 <_sk_callback_sse2+0x149> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -18977,7 +18834,7 @@ PUBLIC _sk_dstatop_sse2 _sk_dstatop_sse2 LABEL PROC DB 68,15,40,195 ; movaps %xmm3,%xmm8 DB 68,15,89,196 ; mulps %xmm4,%xmm8 - DB 68,15,40,13,228,83,0,0 ; movaps 0x53e4(%rip),%xmm9 # 5720 <_sk_callback_sse2+0x146> + DB 68,15,40,13,247,83,0,0 ; movaps 0x53f7(%rip),%xmm9 # 5740 <_sk_callback_sse2+0x159> DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 65,15,89,193 ; mulps %xmm9,%xmm0 DB 65,15,88,192 ; addps %xmm8,%xmm0 @@ -19018,7 +18875,7 @@ _sk_dstin_sse2 LABEL PROC PUBLIC _sk_srcout_sse2 _sk_srcout_sse2 LABEL PROC - DB 68,15,40,5,136,83,0,0 ; movaps 0x5388(%rip),%xmm8 # 5730 <_sk_callback_sse2+0x156> + DB 68,15,40,5,155,83,0,0 ; movaps 0x539b(%rip),%xmm8 # 5750 <_sk_callback_sse2+0x169> DB 68,15,92,199 ; subps %xmm7,%xmm8 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 @@ -19029,7 +18886,7 @@ _sk_srcout_sse2 LABEL PROC PUBLIC _sk_dstout_sse2 _sk_dstout_sse2 LABEL PROC - DB 68,15,40,5,120,83,0,0 ; movaps 0x5378(%rip),%xmm8 # 5740 <_sk_callback_sse2+0x166> + DB 68,15,40,5,139,83,0,0 ; movaps 0x538b(%rip),%xmm8 # 5760 <_sk_callback_sse2+0x179> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 15,89,196 ; mulps %xmm4,%xmm0 @@ -19044,7 +18901,7 @@ _sk_dstout_sse2 LABEL PROC PUBLIC _sk_srcover_sse2 _sk_srcover_sse2 LABEL PROC - DB 68,15,40,5,91,83,0,0 ; movaps 0x535b(%rip),%xmm8 # 5750 <_sk_callback_sse2+0x176> + DB 68,15,40,5,110,83,0,0 ; movaps 0x536e(%rip),%xmm8 # 5770 <_sk_callback_sse2+0x189> DB 68,15,92,195 ; subps %xmm3,%xmm8 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -19062,7 +18919,7 @@ _sk_srcover_sse2 LABEL PROC PUBLIC _sk_dstover_sse2 _sk_dstover_sse2 LABEL PROC - DB 68,15,40,5,47,83,0,0 ; movaps 0x532f(%rip),%xmm8 # 5760 <_sk_callback_sse2+0x186> + DB 68,15,40,5,66,83,0,0 ; movaps 0x5342(%rip),%xmm8 # 5780 <_sk_callback_sse2+0x199> DB 68,15,92,199 ; subps %xmm7,%xmm8 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -19086,7 +18943,7 @@ _sk_modulate_sse2 LABEL PROC PUBLIC _sk_multiply_sse2 _sk_multiply_sse2 LABEL PROC - DB 68,15,40,5,3,83,0,0 ; movaps 0x5303(%rip),%xmm8 # 5770 <_sk_callback_sse2+0x196> + DB 68,15,40,5,22,83,0,0 ; movaps 0x5316(%rip),%xmm8 # 5790 <_sk_callback_sse2+0x1a9> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 69,15,40,209 ; movaps %xmm9,%xmm10 @@ -19155,7 +19012,7 @@ _sk_screen_sse2 LABEL PROC PUBLIC _sk_xor__sse2 _sk_xor__sse2 LABEL PROC DB 68,15,40,195 ; movaps %xmm3,%xmm8 - DB 15,40,29,56,82,0,0 ; movaps 0x5238(%rip),%xmm3 # 5780 <_sk_callback_sse2+0x1a6> + DB 15,40,29,75,82,0,0 ; movaps 0x524b(%rip),%xmm3 # 57a0 <_sk_callback_sse2+0x1b9> DB 68,15,40,203 ; movaps %xmm3,%xmm9 DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 65,15,89,193 ; mulps %xmm9,%xmm0 @@ -19201,7 +19058,7 @@ _sk_darken_sse2 LABEL PROC DB 68,15,89,206 ; mulps %xmm6,%xmm9 DB 65,15,95,209 ; maxps %xmm9,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,163,81,0,0 ; movaps 0x51a3(%rip),%xmm2 # 5790 <_sk_callback_sse2+0x1b6> + DB 15,40,21,182,81,0,0 ; movaps 0x51b6(%rip),%xmm2 # 57b0 <_sk_callback_sse2+0x1c9> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -19233,7 +19090,7 @@ _sk_lighten_sse2 LABEL PROC DB 68,15,89,206 ; mulps %xmm6,%xmm9 DB 65,15,93,209 ; minps %xmm9,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,72,81,0,0 ; movaps 0x5148(%rip),%xmm2 # 57a0 <_sk_callback_sse2+0x1c6> + DB 15,40,21,91,81,0,0 ; movaps 0x515b(%rip),%xmm2 # 57c0 <_sk_callback_sse2+0x1d9> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -19268,7 +19125,7 @@ _sk_difference_sse2 LABEL PROC DB 65,15,93,209 ; minps %xmm9,%xmm2 DB 15,88,210 ; addps %xmm2,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,226,80,0,0 ; movaps 0x50e2(%rip),%xmm2 # 57b0 <_sk_callback_sse2+0x1d6> + DB 15,40,21,245,80,0,0 ; movaps 0x50f5(%rip),%xmm2 # 57d0 <_sk_callback_sse2+0x1e9> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -19294,7 +19151,7 @@ _sk_exclusion_sse2 LABEL PROC DB 15,89,214 ; mulps %xmm6,%xmm2 DB 15,88,210 ; addps %xmm2,%xmm2 DB 68,15,92,194 ; subps %xmm2,%xmm8 - DB 15,40,21,162,80,0,0 ; movaps 0x50a2(%rip),%xmm2 # 57c0 <_sk_callback_sse2+0x1e6> + DB 15,40,21,181,80,0,0 ; movaps 0x50b5(%rip),%xmm2 # 57e0 <_sk_callback_sse2+0x1f9> DB 15,92,211 ; subps %xmm3,%xmm2 DB 15,89,215 ; mulps %xmm7,%xmm2 DB 15,88,218 ; addps %xmm2,%xmm3 @@ -19305,7 +19162,7 @@ _sk_exclusion_sse2 LABEL PROC PUBLIC _sk_colorburn_sse2 _sk_colorburn_sse2 LABEL PROC DB 68,15,40,192 ; movaps %xmm0,%xmm8 - DB 68,15,40,21,149,80,0,0 ; movaps 0x5095(%rip),%xmm10 # 57d0 <_sk_callback_sse2+0x1f6> + DB 68,15,40,21,168,80,0,0 ; movaps 0x50a8(%rip),%xmm10 # 57f0 <_sk_callback_sse2+0x209> DB 69,15,40,202 ; movaps %xmm10,%xmm9 DB 68,15,92,207 ; subps %xmm7,%xmm9 DB 69,15,40,217 ; movaps %xmm9,%xmm11 @@ -19397,7 +19254,7 @@ _sk_colorburn_sse2 LABEL PROC PUBLIC _sk_colordodge_sse2 _sk_colordodge_sse2 LABEL PROC DB 68,15,40,200 ; movaps %xmm0,%xmm9 - DB 68,15,40,21,75,79,0,0 ; movaps 0x4f4b(%rip),%xmm10 # 57e0 <_sk_callback_sse2+0x206> + DB 68,15,40,21,94,79,0,0 ; movaps 0x4f5e(%rip),%xmm10 # 5800 <_sk_callback_sse2+0x219> DB 69,15,40,218 ; movaps %xmm10,%xmm11 DB 68,15,92,223 ; subps %xmm7,%xmm11 DB 69,15,40,227 ; movaps %xmm11,%xmm12 @@ -19490,7 +19347,7 @@ _sk_hardlight_sse2 LABEL PROC DB 15,41,52,36 ; movaps %xmm6,(%rsp) DB 15,40,245 ; movaps %xmm5,%xmm6 DB 15,40,236 ; movaps %xmm4,%xmm5 - DB 68,15,40,29,253,77,0,0 ; movaps 0x4dfd(%rip),%xmm11 # 57f0 <_sk_callback_sse2+0x216> + DB 68,15,40,29,16,78,0,0 ; movaps 0x4e10(%rip),%xmm11 # 5810 <_sk_callback_sse2+0x229> DB 69,15,40,211 ; movaps %xmm11,%xmm10 DB 68,15,92,215 ; subps %xmm7,%xmm10 DB 69,15,40,194 ; movaps %xmm10,%xmm8 @@ -19577,7 +19434,7 @@ PUBLIC _sk_overlay_sse2 _sk_overlay_sse2 LABEL PROC DB 68,15,40,193 ; movaps %xmm1,%xmm8 DB 68,15,40,232 ; movaps %xmm0,%xmm13 - DB 68,15,40,13,200,76,0,0 ; movaps 0x4cc8(%rip),%xmm9 # 5800 <_sk_callback_sse2+0x226> + DB 68,15,40,13,219,76,0,0 ; movaps 0x4cdb(%rip),%xmm9 # 5820 <_sk_callback_sse2+0x239> DB 69,15,40,209 ; movaps %xmm9,%xmm10 DB 68,15,92,215 ; subps %xmm7,%xmm10 DB 69,15,40,218 ; movaps %xmm10,%xmm11 @@ -19667,7 +19524,7 @@ _sk_softlight_sse2 LABEL PROC DB 68,15,40,213 ; movaps %xmm5,%xmm10 DB 68,15,94,215 ; divps %xmm7,%xmm10 DB 69,15,84,212 ; andps %xmm12,%xmm10 - DB 68,15,40,13,130,75,0,0 ; movaps 0x4b82(%rip),%xmm9 # 5810 <_sk_callback_sse2+0x236> + DB 68,15,40,13,149,75,0,0 ; movaps 0x4b95(%rip),%xmm9 # 5830 <_sk_callback_sse2+0x249> DB 69,15,40,249 ; movaps %xmm9,%xmm15 DB 69,15,92,250 ; subps %xmm10,%xmm15 DB 69,15,40,218 ; movaps %xmm10,%xmm11 @@ -19680,10 +19537,10 @@ _sk_softlight_sse2 LABEL PROC DB 65,15,40,194 ; movaps %xmm10,%xmm0 DB 15,89,192 ; mulps %xmm0,%xmm0 DB 65,15,88,194 ; addps %xmm10,%xmm0 - DB 68,15,40,53,92,75,0,0 ; movaps 0x4b5c(%rip),%xmm14 # 5820 <_sk_callback_sse2+0x246> + DB 68,15,40,53,111,75,0,0 ; movaps 0x4b6f(%rip),%xmm14 # 5840 <_sk_callback_sse2+0x259> DB 69,15,88,222 ; addps %xmm14,%xmm11 DB 68,15,89,216 ; mulps %xmm0,%xmm11 - DB 68,15,40,21,92,75,0,0 ; movaps 0x4b5c(%rip),%xmm10 # 5830 <_sk_callback_sse2+0x256> + DB 68,15,40,21,111,75,0,0 ; movaps 0x4b6f(%rip),%xmm10 # 5850 <_sk_callback_sse2+0x269> DB 69,15,89,234 ; mulps %xmm10,%xmm13 DB 69,15,88,235 ; addps %xmm11,%xmm13 DB 15,88,228 ; addps %xmm4,%xmm4 @@ -19828,7 +19685,7 @@ _sk_hue_sse2 LABEL PROC DB 68,15,40,209 ; movaps %xmm1,%xmm10 DB 68,15,40,225 ; movaps %xmm1,%xmm12 DB 68,15,89,211 ; mulps %xmm3,%xmm10 - DB 68,15,40,5,152,73,0,0 ; movaps 0x4998(%rip),%xmm8 # 5870 <_sk_callback_sse2+0x296> + DB 68,15,40,5,171,73,0,0 ; movaps 0x49ab(%rip),%xmm8 # 5890 <_sk_callback_sse2+0x2a9> DB 69,15,40,216 ; movaps %xmm8,%xmm11 DB 15,40,207 ; movaps %xmm7,%xmm1 DB 68,15,92,217 ; subps %xmm1,%xmm11 @@ -19876,12 +19733,12 @@ _sk_hue_sse2 LABEL PROC DB 69,15,84,206 ; andps %xmm14,%xmm9 DB 69,15,84,214 ; andps %xmm14,%xmm10 DB 65,15,84,214 ; andps %xmm14,%xmm2 - DB 68,15,40,61,165,72,0,0 ; movaps 0x48a5(%rip),%xmm15 # 5840 <_sk_callback_sse2+0x266> + DB 68,15,40,61,184,72,0,0 ; movaps 0x48b8(%rip),%xmm15 # 5860 <_sk_callback_sse2+0x279> DB 65,15,89,231 ; mulps %xmm15,%xmm4 - DB 15,40,5,170,72,0,0 ; movaps 0x48aa(%rip),%xmm0 # 5850 <_sk_callback_sse2+0x276> + DB 15,40,5,189,72,0,0 ; movaps 0x48bd(%rip),%xmm0 # 5870 <_sk_callback_sse2+0x289> DB 15,89,240 ; mulps %xmm0,%xmm6 DB 15,88,244 ; addps %xmm4,%xmm6 - DB 68,15,40,53,172,72,0,0 ; movaps 0x48ac(%rip),%xmm14 # 5860 <_sk_callback_sse2+0x286> + DB 68,15,40,53,191,72,0,0 ; movaps 0x48bf(%rip),%xmm14 # 5880 <_sk_callback_sse2+0x299> DB 68,15,40,239 ; movaps %xmm7,%xmm13 DB 69,15,89,238 ; mulps %xmm14,%xmm13 DB 68,15,88,238 ; addps %xmm6,%xmm13 @@ -20059,14 +19916,14 @@ _sk_saturation_sse2 LABEL PROC DB 68,15,84,211 ; andps %xmm3,%xmm10 DB 68,15,84,203 ; andps %xmm3,%xmm9 DB 15,84,195 ; andps %xmm3,%xmm0 - DB 68,15,40,5,57,70,0,0 ; movaps 0x4639(%rip),%xmm8 # 5880 <_sk_callback_sse2+0x2a6> + DB 68,15,40,5,76,70,0,0 ; movaps 0x464c(%rip),%xmm8 # 58a0 <_sk_callback_sse2+0x2b9> DB 15,40,214 ; movaps %xmm6,%xmm2 DB 65,15,89,208 ; mulps %xmm8,%xmm2 - DB 15,40,13,59,70,0,0 ; movaps 0x463b(%rip),%xmm1 # 5890 <_sk_callback_sse2+0x2b6> + DB 15,40,13,78,70,0,0 ; movaps 0x464e(%rip),%xmm1 # 58b0 <_sk_callback_sse2+0x2c9> DB 15,40,221 ; movaps %xmm5,%xmm3 DB 15,89,217 ; mulps %xmm1,%xmm3 DB 15,88,218 ; addps %xmm2,%xmm3 - DB 68,15,40,37,58,70,0,0 ; movaps 0x463a(%rip),%xmm12 # 58a0 <_sk_callback_sse2+0x2c6> + DB 68,15,40,37,77,70,0,0 ; movaps 0x464d(%rip),%xmm12 # 58c0 <_sk_callback_sse2+0x2d9> DB 69,15,89,236 ; mulps %xmm12,%xmm13 DB 68,15,88,235 ; addps %xmm3,%xmm13 DB 65,15,40,210 ; movaps %xmm10,%xmm2 @@ -20111,7 +19968,7 @@ _sk_saturation_sse2 LABEL PROC DB 15,40,223 ; movaps %xmm7,%xmm3 DB 15,40,236 ; movaps %xmm4,%xmm5 DB 15,89,221 ; mulps %xmm5,%xmm3 - DB 68,15,40,5,159,69,0,0 ; movaps 0x459f(%rip),%xmm8 # 58b0 <_sk_callback_sse2+0x2d6> + DB 68,15,40,5,178,69,0,0 ; movaps 0x45b2(%rip),%xmm8 # 58d0 <_sk_callback_sse2+0x2e9> DB 65,15,40,224 ; movaps %xmm8,%xmm4 DB 68,15,92,199 ; subps %xmm7,%xmm8 DB 15,88,253 ; addps %xmm5,%xmm7 @@ -20212,14 +20069,14 @@ _sk_color_sse2 LABEL PROC DB 68,15,40,213 ; movaps %xmm5,%xmm10 DB 69,15,89,208 ; mulps %xmm8,%xmm10 DB 65,15,40,208 ; movaps %xmm8,%xmm2 - DB 68,15,40,45,55,68,0,0 ; movaps 0x4437(%rip),%xmm13 # 58c0 <_sk_callback_sse2+0x2e6> + DB 68,15,40,45,74,68,0,0 ; movaps 0x444a(%rip),%xmm13 # 58e0 <_sk_callback_sse2+0x2f9> DB 68,15,40,198 ; movaps %xmm6,%xmm8 DB 69,15,89,197 ; mulps %xmm13,%xmm8 - DB 68,15,40,53,55,68,0,0 ; movaps 0x4437(%rip),%xmm14 # 58d0 <_sk_callback_sse2+0x2f6> + DB 68,15,40,53,74,68,0,0 ; movaps 0x444a(%rip),%xmm14 # 58f0 <_sk_callback_sse2+0x309> DB 65,15,40,195 ; movaps %xmm11,%xmm0 DB 65,15,89,198 ; mulps %xmm14,%xmm0 DB 65,15,88,192 ; addps %xmm8,%xmm0 - DB 68,15,40,29,51,68,0,0 ; movaps 0x4433(%rip),%xmm11 # 58e0 <_sk_callback_sse2+0x306> + DB 68,15,40,29,70,68,0,0 ; movaps 0x4446(%rip),%xmm11 # 5900 <_sk_callback_sse2+0x319> DB 69,15,89,227 ; mulps %xmm11,%xmm12 DB 68,15,88,224 ; addps %xmm0,%xmm12 DB 65,15,40,193 ; movaps %xmm9,%xmm0 @@ -20227,7 +20084,7 @@ _sk_color_sse2 LABEL PROC DB 69,15,40,250 ; movaps %xmm10,%xmm15 DB 69,15,89,254 ; mulps %xmm14,%xmm15 DB 68,15,88,248 ; addps %xmm0,%xmm15 - DB 68,15,40,5,31,68,0,0 ; movaps 0x441f(%rip),%xmm8 # 58f0 <_sk_callback_sse2+0x316> + DB 68,15,40,5,50,68,0,0 ; movaps 0x4432(%rip),%xmm8 # 5910 <_sk_callback_sse2+0x329> DB 65,15,40,224 ; movaps %xmm8,%xmm4 DB 15,92,226 ; subps %xmm2,%xmm4 DB 15,89,252 ; mulps %xmm4,%xmm7 @@ -20363,15 +20220,15 @@ _sk_luminosity_sse2 LABEL PROC DB 68,15,40,205 ; movaps %xmm5,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 DB 15,89,222 ; mulps %xmm6,%xmm3 - DB 68,15,40,37,49,66,0,0 ; movaps 0x4231(%rip),%xmm12 # 5900 <_sk_callback_sse2+0x326> + DB 68,15,40,37,68,66,0,0 ; movaps 0x4244(%rip),%xmm12 # 5920 <_sk_callback_sse2+0x339> DB 68,15,40,199 ; movaps %xmm7,%xmm8 DB 69,15,89,196 ; mulps %xmm12,%xmm8 - DB 68,15,40,45,49,66,0,0 ; movaps 0x4231(%rip),%xmm13 # 5910 <_sk_callback_sse2+0x336> + DB 68,15,40,45,68,66,0,0 ; movaps 0x4244(%rip),%xmm13 # 5930 <_sk_callback_sse2+0x349> DB 68,15,40,241 ; movaps %xmm1,%xmm14 DB 69,15,89,245 ; mulps %xmm13,%xmm14 DB 69,15,88,240 ; addps %xmm8,%xmm14 - DB 68,15,40,29,45,66,0,0 ; movaps 0x422d(%rip),%xmm11 # 5920 <_sk_callback_sse2+0x346> - DB 68,15,40,5,53,66,0,0 ; movaps 0x4235(%rip),%xmm8 # 5930 <_sk_callback_sse2+0x356> + DB 68,15,40,29,64,66,0,0 ; movaps 0x4240(%rip),%xmm11 # 5940 <_sk_callback_sse2+0x359> + DB 68,15,40,5,72,66,0,0 ; movaps 0x4248(%rip),%xmm8 # 5950 <_sk_callback_sse2+0x369> DB 69,15,40,248 ; movaps %xmm8,%xmm15 DB 65,15,40,194 ; movaps %xmm10,%xmm0 DB 68,15,92,248 ; subps %xmm0,%xmm15 @@ -20506,10 +20363,10 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,227,0,0,0 ; jne 19d5 <_sk_srcover_rgba_8888_sse2+0xf1> + DB 15,133,227,0,0,0 ; jne 19e2 <_sk_srcover_rgba_8888_sse2+0xf1> DB 243,68,15,111,4,144 ; movdqu (%rax,%rdx,4),%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 102,15,111,53,61,64,0,0 ; movdqa 0x403d(%rip),%xmm6 # 5940 <_sk_callback_sse2+0x366> + DB 102,15,111,53,80,64,0,0 ; movdqa 0x4050(%rip),%xmm6 # 5960 <_sk_callback_sse2+0x379> DB 102,65,15,111,224 ; movdqa %xmm8,%xmm4 DB 102,15,219,230 ; pand %xmm6,%xmm4 DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4 @@ -20523,9 +20380,9 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC DB 15,91,247 ; cvtdq2ps %xmm7,%xmm6 DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8 DB 65,15,91,248 ; cvtdq2ps %xmm8,%xmm7 - DB 68,15,40,5,13,64,0,0 ; movaps 0x400d(%rip),%xmm8 # 5950 <_sk_callback_sse2+0x376> + DB 68,15,40,5,32,64,0,0 ; movaps 0x4020(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x389> DB 68,15,92,195 ; subps %xmm3,%xmm8 - DB 68,15,40,37,17,64,0,0 ; movaps 0x4011(%rip),%xmm12 # 5960 <_sk_callback_sse2+0x386> + DB 68,15,40,37,36,64,0,0 ; movaps 0x4024(%rip),%xmm12 # 5980 <_sk_callback_sse2+0x399> DB 65,15,89,196 ; mulps %xmm12,%xmm0 DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 68,15,89,204 ; mulps %xmm4,%xmm9 @@ -20551,7 +20408,7 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC DB 102,15,114,240,24 ; pslld $0x18,%xmm0 DB 102,15,235,194 ; por %xmm2,%xmm0 DB 102,15,235,193 ; por %xmm1,%xmm0 - DB 117,106 ; jne 1a26 <_sk_srcover_rgba_8888_sse2+0x142> + DB 117,106 ; jne 1a33 <_sk_srcover_rgba_8888_sse2+0x142> DB 243,15,127,4,144 ; movdqu %xmm0,(%rax,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,193 ; movaps %xmm9,%xmm0 @@ -20563,11 +20420,11 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,48 ; je 1a17 <_sk_srcover_rgba_8888_sse2+0x133> + DB 116,48 ; je 1a24 <_sk_srcover_rgba_8888_sse2+0x133> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,22 ; je 1a03 <_sk_srcover_rgba_8888_sse2+0x11f> + DB 116,22 ; je 1a10 <_sk_srcover_rgba_8888_sse2+0x11f> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 15,133,1,255,255,255 ; jne 18f8 <_sk_srcover_rgba_8888_sse2+0x14> + DB 15,133,1,255,255,255 ; jne 1905 <_sk_srcover_rgba_8888_sse2+0x14> DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4 DB 102,68,15,112,196,69 ; pshufd $0x45,%xmm4,%xmm8 DB 243,15,16,100,144,4 ; movss 0x4(%rax,%rdx,4),%xmm4 @@ -20576,21 +20433,21 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC DB 68,15,40,196 ; movaps %xmm4,%xmm8 DB 243,15,16,36,144 ; movss (%rax,%rdx,4),%xmm4 DB 243,68,15,16,196 ; movss %xmm4,%xmm8 - DB 233,210,254,255,255 ; jmpq 18f8 <_sk_srcover_rgba_8888_sse2+0x14> + DB 233,210,254,255,255 ; jmpq 1905 <_sk_srcover_rgba_8888_sse2+0x14> DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,34 ; je 1a55 <_sk_srcover_rgba_8888_sse2+0x171> + DB 116,34 ; je 1a62 <_sk_srcover_rgba_8888_sse2+0x171> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,17 ; je 1a4a <_sk_srcover_rgba_8888_sse2+0x166> + DB 116,17 ; je 1a57 <_sk_srcover_rgba_8888_sse2+0x166> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,130 ; jne 19c1 <_sk_srcover_rgba_8888_sse2+0xdd> + DB 117,130 ; jne 19ce <_sk_srcover_rgba_8888_sse2+0xdd> DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1 DB 102,15,126,76,144,8 ; movd %xmm1,0x8(%rax,%rdx,4) DB 102,15,112,200,229 ; pshufd $0xe5,%xmm0,%xmm1 DB 102,15,126,76,144,4 ; movd %xmm1,0x4(%rax,%rdx,4) DB 102,15,126,4,144 ; movd %xmm0,(%rax,%rdx,4) - DB 233,98,255,255,255 ; jmpq 19c1 <_sk_srcover_rgba_8888_sse2+0xdd> + DB 233,98,255,255,255 ; jmpq 19ce <_sk_srcover_rgba_8888_sse2+0xdd> PUBLIC _sk_clamp_0_sse2 _sk_clamp_0_sse2 LABEL PROC @@ -20604,7 +20461,7 @@ _sk_clamp_0_sse2 LABEL PROC PUBLIC _sk_clamp_1_sse2 _sk_clamp_1_sse2 LABEL PROC - DB 68,15,40,5,241,62,0,0 ; movaps 0x3ef1(%rip),%xmm8 # 5970 <_sk_callback_sse2+0x396> + DB 68,15,40,5,4,63,0,0 ; movaps 0x3f04(%rip),%xmm8 # 5990 <_sk_callback_sse2+0x3a9> DB 65,15,93,192 ; minps %xmm8,%xmm0 DB 65,15,93,200 ; minps %xmm8,%xmm1 DB 65,15,93,208 ; minps %xmm8,%xmm2 @@ -20614,7 +20471,7 @@ _sk_clamp_1_sse2 LABEL PROC PUBLIC _sk_clamp_a_sse2 _sk_clamp_a_sse2 LABEL PROC - DB 15,93,29,230,62,0,0 ; minps 0x3ee6(%rip),%xmm3 # 5980 <_sk_callback_sse2+0x3a6> + DB 15,93,29,249,62,0,0 ; minps 0x3ef9(%rip),%xmm3 # 59a0 <_sk_callback_sse2+0x3b9> DB 15,93,195 ; minps %xmm3,%xmm0 DB 15,93,203 ; minps %xmm3,%xmm1 DB 15,93,211 ; minps %xmm3,%xmm2 @@ -20687,7 +20544,7 @@ _sk_premul_sse2 LABEL PROC PUBLIC _sk_unpremul_sse2 _sk_unpremul_sse2 LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 - DB 68,15,40,13,81,62,0,0 ; movaps 0x3e51(%rip),%xmm9 # 5990 <_sk_callback_sse2+0x3b6> + DB 68,15,40,13,100,62,0,0 ; movaps 0x3e64(%rip),%xmm9 # 59b0 <_sk_callback_sse2+0x3c9> DB 68,15,94,203 ; divps %xmm3,%xmm9 DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8 DB 69,15,84,193 ; andps %xmm9,%xmm8 @@ -20699,20 +20556,20 @@ _sk_unpremul_sse2 LABEL PROC PUBLIC _sk_from_srgb_sse2 _sk_from_srgb_sse2 LABEL PROC - DB 68,15,40,5,60,62,0,0 ; movaps 0x3e3c(%rip),%xmm8 # 59a0 <_sk_callback_sse2+0x3c6> + DB 68,15,40,5,79,62,0,0 ; movaps 0x3e4f(%rip),%xmm8 # 59c0 <_sk_callback_sse2+0x3d9> DB 68,15,40,232 ; movaps %xmm0,%xmm13 DB 69,15,89,232 ; mulps %xmm8,%xmm13 DB 68,15,40,216 ; movaps %xmm0,%xmm11 DB 69,15,89,219 ; mulps %xmm11,%xmm11 - DB 68,15,40,13,52,62,0,0 ; movaps 0x3e34(%rip),%xmm9 # 59b0 <_sk_callback_sse2+0x3d6> + DB 68,15,40,13,71,62,0,0 ; movaps 0x3e47(%rip),%xmm9 # 59d0 <_sk_callback_sse2+0x3e9> DB 68,15,40,240 ; movaps %xmm0,%xmm14 DB 69,15,89,241 ; mulps %xmm9,%xmm14 - DB 68,15,40,21,52,62,0,0 ; movaps 0x3e34(%rip),%xmm10 # 59c0 <_sk_callback_sse2+0x3e6> + DB 68,15,40,21,71,62,0,0 ; movaps 0x3e47(%rip),%xmm10 # 59e0 <_sk_callback_sse2+0x3f9> DB 69,15,88,242 ; addps %xmm10,%xmm14 DB 69,15,89,243 ; mulps %xmm11,%xmm14 - DB 68,15,40,29,52,62,0,0 ; movaps 0x3e34(%rip),%xmm11 # 59d0 <_sk_callback_sse2+0x3f6> + DB 68,15,40,29,71,62,0,0 ; movaps 0x3e47(%rip),%xmm11 # 59f0 <_sk_callback_sse2+0x409> DB 69,15,88,243 ; addps %xmm11,%xmm14 - DB 68,15,40,37,56,62,0,0 ; movaps 0x3e38(%rip),%xmm12 # 59e0 <_sk_callback_sse2+0x406> + DB 68,15,40,37,75,62,0,0 ; movaps 0x3e4b(%rip),%xmm12 # 5a00 <_sk_callback_sse2+0x419> DB 65,15,194,196,1 ; cmpltps %xmm12,%xmm0 DB 68,15,84,232 ; andps %xmm0,%xmm13 DB 65,15,85,198 ; andnps %xmm14,%xmm0 @@ -20747,22 +20604,22 @@ _sk_from_srgb_sse2 LABEL PROC PUBLIC _sk_to_srgb_sse2 _sk_to_srgb_sse2 LABEL PROC DB 68,15,82,232 ; rsqrtps %xmm0,%xmm13 - DB 68,15,40,5,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm8 # 59f0 <_sk_callback_sse2+0x416> + DB 68,15,40,5,216,61,0,0 ; movaps 0x3dd8(%rip),%xmm8 # 5a10 <_sk_callback_sse2+0x429> DB 68,15,40,240 ; movaps %xmm0,%xmm14 DB 69,15,89,240 ; mulps %xmm8,%xmm14 - DB 68,15,40,13,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm9 # 5a00 <_sk_callback_sse2+0x426> + DB 68,15,40,13,216,61,0,0 ; movaps 0x3dd8(%rip),%xmm9 # 5a20 <_sk_callback_sse2+0x439> DB 69,15,40,253 ; movaps %xmm13,%xmm15 DB 69,15,89,249 ; mulps %xmm9,%xmm15 - DB 68,15,40,21,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm10 # 5a10 <_sk_callback_sse2+0x436> + DB 68,15,40,21,216,61,0,0 ; movaps 0x3dd8(%rip),%xmm10 # 5a30 <_sk_callback_sse2+0x449> DB 69,15,88,250 ; addps %xmm10,%xmm15 DB 69,15,89,253 ; mulps %xmm13,%xmm15 - DB 68,15,40,29,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm11 # 5a20 <_sk_callback_sse2+0x446> + DB 68,15,40,29,216,61,0,0 ; movaps 0x3dd8(%rip),%xmm11 # 5a40 <_sk_callback_sse2+0x459> DB 69,15,88,251 ; addps %xmm11,%xmm15 - DB 68,15,40,37,201,61,0,0 ; movaps 0x3dc9(%rip),%xmm12 # 5a30 <_sk_callback_sse2+0x456> + DB 68,15,40,37,220,61,0,0 ; movaps 0x3ddc(%rip),%xmm12 # 5a50 <_sk_callback_sse2+0x469> DB 69,15,88,236 ; addps %xmm12,%xmm13 DB 69,15,83,237 ; rcpps %xmm13,%xmm13 DB 69,15,89,239 ; mulps %xmm15,%xmm13 - DB 68,15,40,61,197,61,0,0 ; movaps 0x3dc5(%rip),%xmm15 # 5a40 <_sk_callback_sse2+0x466> + DB 68,15,40,61,216,61,0,0 ; movaps 0x3dd8(%rip),%xmm15 # 5a60 <_sk_callback_sse2+0x479> DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0 DB 68,15,84,240 ; andps %xmm0,%xmm14 DB 65,15,85,197 ; andnps %xmm13,%xmm0 @@ -20810,7 +20667,7 @@ _sk_rgb_to_hsl_sse2 LABEL PROC DB 68,15,93,218 ; minps %xmm2,%xmm11 DB 65,15,40,202 ; movaps %xmm10,%xmm1 DB 65,15,92,203 ; subps %xmm11,%xmm1 - DB 68,15,40,45,30,61,0,0 ; movaps 0x3d1e(%rip),%xmm13 # 5a50 <_sk_callback_sse2+0x476> + DB 68,15,40,45,49,61,0,0 ; movaps 0x3d31(%rip),%xmm13 # 5a70 <_sk_callback_sse2+0x489> DB 68,15,94,233 ; divps %xmm1,%xmm13 DB 65,15,40,194 ; movaps %xmm10,%xmm0 DB 65,15,194,192,0 ; cmpeqps %xmm8,%xmm0 @@ -20819,30 +20676,30 @@ _sk_rgb_to_hsl_sse2 LABEL PROC DB 69,15,89,229 ; mulps %xmm13,%xmm12 DB 69,15,40,241 ; movaps %xmm9,%xmm14 DB 68,15,194,242,1 ; cmpltps %xmm2,%xmm14 - DB 68,15,84,53,4,61,0,0 ; andps 0x3d04(%rip),%xmm14 # 5a60 <_sk_callback_sse2+0x486> + DB 68,15,84,53,23,61,0,0 ; andps 0x3d17(%rip),%xmm14 # 5a80 <_sk_callback_sse2+0x499> DB 69,15,88,244 ; addps %xmm12,%xmm14 DB 69,15,40,250 ; movaps %xmm10,%xmm15 DB 69,15,194,249,0 ; cmpeqps %xmm9,%xmm15 DB 65,15,92,208 ; subps %xmm8,%xmm2 DB 65,15,89,213 ; mulps %xmm13,%xmm2 - DB 68,15,40,37,247,60,0,0 ; movaps 0x3cf7(%rip),%xmm12 # 5a70 <_sk_callback_sse2+0x496> + DB 68,15,40,37,10,61,0,0 ; movaps 0x3d0a(%rip),%xmm12 # 5a90 <_sk_callback_sse2+0x4a9> DB 65,15,88,212 ; addps %xmm12,%xmm2 DB 69,15,92,193 ; subps %xmm9,%xmm8 DB 69,15,89,197 ; mulps %xmm13,%xmm8 - DB 68,15,88,5,243,60,0,0 ; addps 0x3cf3(%rip),%xmm8 # 5a80 <_sk_callback_sse2+0x4a6> + DB 68,15,88,5,6,61,0,0 ; addps 0x3d06(%rip),%xmm8 # 5aa0 <_sk_callback_sse2+0x4b9> DB 65,15,84,215 ; andps %xmm15,%xmm2 DB 69,15,85,248 ; andnps %xmm8,%xmm15 DB 68,15,86,250 ; orps %xmm2,%xmm15 DB 68,15,84,240 ; andps %xmm0,%xmm14 DB 65,15,85,199 ; andnps %xmm15,%xmm0 DB 65,15,86,198 ; orps %xmm14,%xmm0 - DB 15,89,5,228,60,0,0 ; mulps 0x3ce4(%rip),%xmm0 # 5a90 <_sk_callback_sse2+0x4b6> + DB 15,89,5,247,60,0,0 ; mulps 0x3cf7(%rip),%xmm0 # 5ab0 <_sk_callback_sse2+0x4c9> DB 69,15,40,194 ; movaps %xmm10,%xmm8 DB 69,15,194,195,4 ; cmpneqps %xmm11,%xmm8 DB 65,15,84,192 ; andps %xmm8,%xmm0 DB 69,15,92,226 ; subps %xmm10,%xmm12 DB 69,15,88,211 ; addps %xmm11,%xmm10 - DB 68,15,40,13,215,60,0,0 ; movaps 0x3cd7(%rip),%xmm9 # 5aa0 <_sk_callback_sse2+0x4c6> + DB 68,15,40,13,234,60,0,0 ; movaps 0x3cea(%rip),%xmm9 # 5ac0 <_sk_callback_sse2+0x4d9> DB 65,15,40,210 ; movaps %xmm10,%xmm2 DB 65,15,89,209 ; mulps %xmm9,%xmm2 DB 68,15,194,202,1 ; cmpltps %xmm2,%xmm9 @@ -20865,7 +20722,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC DB 15,41,92,36,32 ; movaps %xmm3,0x20(%rsp) DB 68,15,40,218 ; movaps %xmm2,%xmm11 DB 15,40,240 ; movaps %xmm0,%xmm6 - DB 68,15,40,13,146,60,0,0 ; movaps 0x3c92(%rip),%xmm9 # 5ab0 <_sk_callback_sse2+0x4d6> + DB 68,15,40,13,165,60,0,0 ; movaps 0x3ca5(%rip),%xmm9 # 5ad0 <_sk_callback_sse2+0x4e9> DB 69,15,40,209 ; movaps %xmm9,%xmm10 DB 69,15,194,211,2 ; cmpleps %xmm11,%xmm10 DB 15,40,193 ; movaps %xmm1,%xmm0 @@ -20882,28 +20739,28 @@ _sk_hsl_to_rgb_sse2 LABEL PROC DB 69,15,88,211 ; addps %xmm11,%xmm10 DB 69,15,88,219 ; addps %xmm11,%xmm11 DB 69,15,92,218 ; subps %xmm10,%xmm11 - DB 15,40,5,92,60,0,0 ; movaps 0x3c5c(%rip),%xmm0 # 5ac0 <_sk_callback_sse2+0x4e6> + DB 15,40,5,111,60,0,0 ; movaps 0x3c6f(%rip),%xmm0 # 5ae0 <_sk_callback_sse2+0x4f9> DB 15,88,198 ; addps %xmm6,%xmm0 DB 243,15,91,200 ; cvttps2dq %xmm0,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 DB 15,40,216 ; movaps %xmm0,%xmm3 DB 15,194,217,1 ; cmpltps %xmm1,%xmm3 - DB 15,84,29,84,60,0,0 ; andps 0x3c54(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6> + DB 15,84,29,103,60,0,0 ; andps 0x3c67(%rip),%xmm3 # 5af0 <_sk_callback_sse2+0x509> DB 15,92,203 ; subps %xmm3,%xmm1 DB 15,92,193 ; subps %xmm1,%xmm0 - DB 68,15,40,45,86,60,0,0 ; movaps 0x3c56(%rip),%xmm13 # 5ae0 <_sk_callback_sse2+0x506> + DB 68,15,40,45,105,60,0,0 ; movaps 0x3c69(%rip),%xmm13 # 5b00 <_sk_callback_sse2+0x519> DB 69,15,40,197 ; movaps %xmm13,%xmm8 DB 68,15,194,192,2 ; cmpleps %xmm0,%xmm8 DB 69,15,40,242 ; movaps %xmm10,%xmm14 DB 69,15,92,243 ; subps %xmm11,%xmm14 DB 65,15,40,217 ; movaps %xmm9,%xmm3 DB 15,194,216,2 ; cmpleps %xmm0,%xmm3 - DB 15,40,21,102,60,0,0 ; movaps 0x3c66(%rip),%xmm2 # 5b10 <_sk_callback_sse2+0x536> + DB 15,40,21,121,60,0,0 ; movaps 0x3c79(%rip),%xmm2 # 5b30 <_sk_callback_sse2+0x549> DB 68,15,40,250 ; movaps %xmm2,%xmm15 DB 68,15,194,248,2 ; cmpleps %xmm0,%xmm15 - DB 15,40,13,54,60,0,0 ; movaps 0x3c36(%rip),%xmm1 # 5af0 <_sk_callback_sse2+0x516> + DB 15,40,13,73,60,0,0 ; movaps 0x3c49(%rip),%xmm1 # 5b10 <_sk_callback_sse2+0x529> DB 15,89,193 ; mulps %xmm1,%xmm0 - DB 15,40,45,60,60,0,0 ; movaps 0x3c3c(%rip),%xmm5 # 5b00 <_sk_callback_sse2+0x526> + DB 15,40,45,79,60,0,0 ; movaps 0x3c4f(%rip),%xmm5 # 5b20 <_sk_callback_sse2+0x539> DB 15,40,229 ; movaps %xmm5,%xmm4 DB 15,92,224 ; subps %xmm0,%xmm4 DB 65,15,89,230 ; mulps %xmm14,%xmm4 @@ -20926,7 +20783,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 DB 15,40,222 ; movaps %xmm6,%xmm3 DB 15,194,216,1 ; cmpltps %xmm0,%xmm3 - DB 15,84,29,177,59,0,0 ; andps 0x3bb1(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6> + DB 15,84,29,196,59,0,0 ; andps 0x3bc4(%rip),%xmm3 # 5af0 <_sk_callback_sse2+0x509> DB 15,92,195 ; subps %xmm3,%xmm0 DB 68,15,40,230 ; movaps %xmm6,%xmm12 DB 68,15,92,224 ; subps %xmm0,%xmm12 @@ -20956,12 +20813,12 @@ _sk_hsl_to_rgb_sse2 LABEL PROC DB 15,40,60,36 ; movaps (%rsp),%xmm7 DB 15,40,231 ; movaps %xmm7,%xmm4 DB 15,85,227 ; andnps %xmm3,%xmm4 - DB 15,88,53,138,59,0,0 ; addps 0x3b8a(%rip),%xmm6 # 5b20 <_sk_callback_sse2+0x546> + DB 15,88,53,157,59,0,0 ; addps 0x3b9d(%rip),%xmm6 # 5b40 <_sk_callback_sse2+0x559> DB 243,15,91,198 ; cvttps2dq %xmm6,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 DB 15,40,222 ; movaps %xmm6,%xmm3 DB 15,194,216,1 ; cmpltps %xmm0,%xmm3 - DB 15,84,29,37,59,0,0 ; andps 0x3b25(%rip),%xmm3 # 5ad0 <_sk_callback_sse2+0x4f6> + DB 15,84,29,56,59,0,0 ; andps 0x3b38(%rip),%xmm3 # 5af0 <_sk_callback_sse2+0x509> DB 15,92,195 ; subps %xmm3,%xmm0 DB 15,92,240 ; subps %xmm0,%xmm6 DB 15,89,206 ; mulps %xmm6,%xmm1 @@ -21018,13 +20875,13 @@ _sk_scale_u8_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,61 ; jne 20a2 <_sk_scale_u8_sse2+0x47> + DB 117,61 ; jne 20af <_sk_scale_u8_sse2+0x47> DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8 DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8 DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8 - DB 102,68,15,219,5,178,58,0,0 ; pand 0x3ab2(%rip),%xmm8 # 5b30 <_sk_callback_sse2+0x556> + DB 102,68,15,219,5,197,58,0,0 ; pand 0x3ac5(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x569> DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,182,58,0,0 ; mulps 0x3ab6(%rip),%xmm8 # 5b40 <_sk_callback_sse2+0x566> + DB 68,15,89,5,201,58,0,0 ; mulps 0x3ac9(%rip),%xmm8 # 5b60 <_sk_callback_sse2+0x579> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 65,15,89,208 ; mulps %xmm8,%xmm2 @@ -21036,11 +20893,11 @@ _sk_scale_u8_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,54 ; je 20ea <_sk_scale_u8_sse2+0x8f> + DB 116,54 ; je 20f7 <_sk_scale_u8_sse2+0x8f> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,23 ; je 20d1 <_sk_scale_u8_sse2+0x76> + DB 116,23 ; je 20de <_sk_scale_u8_sse2+0x76> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,181 ; jne 2075 <_sk_scale_u8_sse2+0x1a> + DB 117,181 ; jne 2082 <_sk_scale_u8_sse2+0x1a> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8 @@ -21052,7 +20909,7 @@ _sk_scale_u8_sse2 LABEL PROC DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,68,15,110,200 ; movd %eax,%xmm9 DB 243,69,15,16,193 ; movss %xmm9,%xmm8 - DB 233,119,255,255,255 ; jmpq 2075 <_sk_scale_u8_sse2+0x1a> + DB 233,119,255,255,255 ; jmpq 2082 <_sk_scale_u8_sse2+0x1a> PUBLIC _sk_lerp_1_float_sse2 _sk_lerp_1_float_sse2 LABEL PROC @@ -21079,13 +20936,13 @@ _sk_lerp_u8_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,81 ; jne 2191 <_sk_lerp_u8_sse2+0x5b> + DB 117,81 ; jne 219e <_sk_lerp_u8_sse2+0x5b> DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8 DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8 DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8 - DB 102,68,15,219,5,247,57,0,0 ; pand 0x39f7(%rip),%xmm8 # 5b50 <_sk_callback_sse2+0x576> + DB 102,68,15,219,5,10,58,0,0 ; pand 0x3a0a(%rip),%xmm8 # 5b70 <_sk_callback_sse2+0x589> DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,251,57,0,0 ; mulps 0x39fb(%rip),%xmm8 # 5b60 <_sk_callback_sse2+0x586> + DB 68,15,89,5,14,58,0,0 ; mulps 0x3a0e(%rip),%xmm8 # 5b80 <_sk_callback_sse2+0x599> DB 15,92,196 ; subps %xmm4,%xmm0 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -21104,11 +20961,11 @@ _sk_lerp_u8_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,54 ; je 21d9 <_sk_lerp_u8_sse2+0xa3> + DB 116,54 ; je 21e6 <_sk_lerp_u8_sse2+0xa3> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,23 ; je 21c0 <_sk_lerp_u8_sse2+0x8a> + DB 116,23 ; je 21cd <_sk_lerp_u8_sse2+0x8a> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,161 ; jne 2150 <_sk_lerp_u8_sse2+0x1a> + DB 117,161 ; jne 215d <_sk_lerp_u8_sse2+0x1a> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,192,69 ; pshufd $0x45,%xmm8,%xmm8 @@ -21120,27 +20977,27 @@ _sk_lerp_u8_sse2 LABEL PROC DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,68,15,110,200 ; movd %eax,%xmm9 DB 243,69,15,16,193 ; movss %xmm9,%xmm8 - DB 233,99,255,255,255 ; jmpq 2150 <_sk_lerp_u8_sse2+0x1a> + DB 233,99,255,255,255 ; jmpq 215d <_sk_lerp_u8_sse2+0x1a> PUBLIC _sk_lerp_565_sse2 _sk_lerp_565_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,156,0,0,0 ; jne 2297 <_sk_lerp_565_sse2+0xaa> + DB 15,133,156,0,0,0 ; jne 22a4 <_sk_lerp_565_sse2+0xaa> DB 243,69,15,126,12,82 ; movq (%r10,%rdx,2),%xmm9 DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9 - DB 102,68,15,111,5,97,57,0,0 ; movdqa 0x3961(%rip),%xmm8 # 5b70 <_sk_callback_sse2+0x596> + DB 102,68,15,111,5,116,57,0,0 ; movdqa 0x3974(%rip),%xmm8 # 5b90 <_sk_callback_sse2+0x5a9> DB 102,69,15,219,193 ; pand %xmm9,%xmm8 DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 - DB 68,15,89,5,96,57,0,0 ; mulps 0x3960(%rip),%xmm8 # 5b80 <_sk_callback_sse2+0x5a6> - DB 102,68,15,111,21,103,57,0,0 ; movdqa 0x3967(%rip),%xmm10 # 5b90 <_sk_callback_sse2+0x5b6> + DB 68,15,89,5,115,57,0,0 ; mulps 0x3973(%rip),%xmm8 # 5ba0 <_sk_callback_sse2+0x5b9> + DB 102,68,15,111,21,122,57,0,0 ; movdqa 0x397a(%rip),%xmm10 # 5bb0 <_sk_callback_sse2+0x5c9> DB 102,69,15,219,209 ; pand %xmm9,%xmm10 DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 - DB 68,15,89,21,102,57,0,0 ; mulps 0x3966(%rip),%xmm10 # 5ba0 <_sk_callback_sse2+0x5c6> - DB 102,68,15,219,13,109,57,0,0 ; pand 0x396d(%rip),%xmm9 # 5bb0 <_sk_callback_sse2+0x5d6> + DB 68,15,89,21,121,57,0,0 ; mulps 0x3979(%rip),%xmm10 # 5bc0 <_sk_callback_sse2+0x5d9> + DB 102,68,15,219,13,128,57,0,0 ; pand 0x3980(%rip),%xmm9 # 5bd0 <_sk_callback_sse2+0x5e9> DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9 - DB 68,15,89,13,113,57,0,0 ; mulps 0x3971(%rip),%xmm9 # 5bc0 <_sk_callback_sse2+0x5e6> + DB 68,15,89,13,132,57,0,0 ; mulps 0x3984(%rip),%xmm9 # 5be0 <_sk_callback_sse2+0x5f9> DB 15,92,196 ; subps %xmm4,%xmm0 DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 15,88,196 ; addps %xmm4,%xmm0 @@ -21166,11 +21023,11 @@ _sk_lerp_565_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,58 ; je 22e3 <_sk_lerp_565_sse2+0xf6> + DB 116,58 ; je 22f0 <_sk_lerp_565_sse2+0xf6> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,27 ; je 22ca <_sk_lerp_565_sse2+0xdd> + DB 116,27 ; je 22d7 <_sk_lerp_565_sse2+0xdd> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 15,133,77,255,255,255 ; jne 2206 <_sk_lerp_565_sse2+0x19> + DB 15,133,77,255,255,255 ; jne 2213 <_sk_lerp_565_sse2+0x19> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 102,69,15,112,200,69 ; pshufd $0x45,%xmm8,%xmm9 @@ -21182,19 +21039,19 @@ _sk_lerp_565_sse2 LABEL PROC DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 243,69,15,16,200 ; movss %xmm8,%xmm9 - DB 233,15,255,255,255 ; jmpq 2206 <_sk_lerp_565_sse2+0x19> + DB 233,15,255,255,255 ; jmpq 2213 <_sk_lerp_565_sse2+0x19> PUBLIC _sk_load_tables_sse2 _sk_load_tables_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 77,133,192 ; test %r8,%r8 - DB 15,133,36,1,0,0 ; jne 2429 <_sk_load_tables_sse2+0x132> + DB 15,133,36,1,0,0 ; jne 2436 <_sk_load_tables_sse2+0x132> DB 243,69,15,111,12,145 ; movdqu (%r9,%rdx,4),%xmm9 DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 83 ; push %rbx - DB 102,68,15,111,5,183,56,0,0 ; movdqa 0x38b7(%rip),%xmm8 # 5bd0 <_sk_callback_sse2+0x5f6> + DB 102,68,15,111,5,202,56,0,0 ; movdqa 0x38ca(%rip),%xmm8 # 5bf0 <_sk_callback_sse2+0x609> DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0 DB 102,65,15,219,192 ; pand %xmm8,%xmm0 DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1 @@ -21250,7 +21107,7 @@ _sk_load_tables_sse2 LABEL PROC DB 65,15,20,208 ; unpcklps %xmm8,%xmm2 DB 102,65,15,114,209,24 ; psrld $0x18,%xmm9 DB 65,15,91,217 ; cvtdq2ps %xmm9,%xmm3 - DB 15,89,29,192,55,0,0 ; mulps 0x37c0(%rip),%xmm3 # 5be0 <_sk_callback_sse2+0x606> + DB 15,89,29,211,55,0,0 ; mulps 0x37d3(%rip),%xmm3 # 5c00 <_sk_callback_sse2+0x619> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 65,94 ; pop %r14 @@ -21260,11 +21117,11 @@ _sk_load_tables_sse2 LABEL PROC DB 65,128,226,3 ; and $0x3,%r10b DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 DB 65,128,250,1 ; cmp $0x1,%r10b - DB 116,50 ; je 246d <_sk_load_tables_sse2+0x176> + DB 116,50 ; je 247a <_sk_load_tables_sse2+0x176> DB 65,128,250,2 ; cmp $0x2,%r10b - DB 116,23 ; je 2458 <_sk_load_tables_sse2+0x161> + DB 116,23 ; je 2465 <_sk_load_tables_sse2+0x161> DB 65,128,250,3 ; cmp $0x3,%r10b - DB 15,133,192,254,255,255 ; jne 230b <_sk_load_tables_sse2+0x14> + DB 15,133,192,254,255,255 ; jne 2318 <_sk_load_tables_sse2+0x14> DB 102,65,15,110,68,145,8 ; movd 0x8(%r9,%rdx,4),%xmm0 DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9 DB 243,65,15,16,68,145,4 ; movss 0x4(%r9,%rdx,4),%xmm0 @@ -21273,7 +21130,7 @@ _sk_load_tables_sse2 LABEL PROC DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 243,65,15,16,4,145 ; movss (%r9,%rdx,4),%xmm0 DB 243,68,15,16,200 ; movss %xmm0,%xmm9 - DB 233,142,254,255,255 ; jmpq 230b <_sk_load_tables_sse2+0x14> + DB 233,142,254,255,255 ; jmpq 2318 <_sk_load_tables_sse2+0x14> PUBLIC _sk_load_tables_u16_be_sse2 _sk_load_tables_u16_be_sse2 LABEL PROC @@ -21281,7 +21138,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,101,1,0,0 ; jne 25f8 <_sk_load_tables_u16_be_sse2+0x17b> + DB 15,133,101,1,0,0 ; jne 2605 <_sk_load_tables_u16_be_sse2+0x17b> DB 102,67,15,16,4,81 ; movupd (%r9,%r10,2),%xmm0 DB 102,67,15,16,76,81,16 ; movupd 0x10(%r9,%r10,2),%xmm1 DB 65,87 ; push %r15 @@ -21293,7 +21150,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1 DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1 DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9 - DB 102,68,15,111,21,38,55,0,0 ; movdqa 0x3726(%rip),%xmm10 # 5bf0 <_sk_callback_sse2+0x616> + DB 102,68,15,111,21,57,55,0,0 ; movdqa 0x3739(%rip),%xmm10 # 5c10 <_sk_callback_sse2+0x629> DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,65,15,219,194 ; pand %xmm10,%xmm0 DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 @@ -21355,7 +21212,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC DB 102,65,15,235,217 ; por %xmm9,%xmm3 DB 102,65,15,97,216 ; punpcklwd %xmm8,%xmm3 DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,17,54,0,0 ; mulps 0x3611(%rip),%xmm3 # 5c00 <_sk_callback_sse2+0x626> + DB 15,89,29,36,54,0,0 ; mulps 0x3624(%rip),%xmm3 # 5c20 <_sk_callback_sse2+0x639> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 65,94 ; pop %r14 @@ -21363,17 +21220,17 @@ _sk_load_tables_u16_be_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,67,15,16,4,81 ; movsd (%r9,%r10,2),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,17 ; jne 2615 <_sk_load_tables_u16_be_sse2+0x198> + DB 117,17 ; jne 2622 <_sk_load_tables_u16_be_sse2+0x198> DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 - DB 233,139,254,255,255 ; jmpq 24a0 <_sk_load_tables_u16_be_sse2+0x23> + DB 233,139,254,255,255 ; jmpq 24ad <_sk_load_tables_u16_be_sse2+0x23> DB 102,67,15,22,68,81,8 ; movhpd 0x8(%r9,%r10,2),%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,118,254,255,255 ; jb 24a0 <_sk_load_tables_u16_be_sse2+0x23> + DB 15,130,118,254,255,255 ; jb 24ad <_sk_load_tables_u16_be_sse2+0x23> DB 242,67,15,16,76,81,16 ; movsd 0x10(%r9,%r10,2),%xmm1 - DB 233,106,254,255,255 ; jmpq 24a0 <_sk_load_tables_u16_be_sse2+0x23> + DB 233,106,254,255,255 ; jmpq 24ad <_sk_load_tables_u16_be_sse2+0x23> PUBLIC _sk_load_tables_rgb_u16_be_sse2 _sk_load_tables_rgb_u16_be_sse2 LABEL PROC @@ -21381,7 +21238,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 76,141,20,82 ; lea (%rdx,%rdx,2),%r10 DB 77,133,192 ; test %r8,%r8 - DB 15,133,84,1,0,0 ; jne 279c <_sk_load_tables_rgb_u16_be_sse2+0x166> + DB 15,133,84,1,0,0 ; jne 27a9 <_sk_load_tables_rgb_u16_be_sse2+0x166> DB 243,71,15,111,28,81 ; movdqu (%r9,%r10,2),%xmm11 DB 243,67,15,111,76,81,8 ; movdqu 0x8(%r9,%r10,2),%xmm1 DB 102,15,115,217,4 ; psrldq $0x4,%xmm1 @@ -21396,7 +21253,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC DB 102,68,15,97,208 ; punpcklwd %xmm0,%xmm10 DB 102,65,15,111,195 ; movdqa %xmm11,%xmm0 DB 102,65,15,97,194 ; punpcklwd %xmm10,%xmm0 - DB 102,68,15,111,5,128,53,0,0 ; movdqa 0x3580(%rip),%xmm8 # 5c10 <_sk_callback_sse2+0x636> + DB 102,68,15,111,5,147,53,0,0 ; movdqa 0x3593(%rip),%xmm8 # 5c30 <_sk_callback_sse2+0x649> DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1 DB 102,65,15,219,192 ; pand %xmm8,%xmm0 DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 @@ -21452,7 +21309,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC DB 15,20,211 ; unpcklps %xmm3,%xmm2 DB 65,15,20,208 ; unpcklps %xmm8,%xmm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,139,52,0,0 ; movaps 0x348b(%rip),%xmm3 # 5c20 <_sk_callback_sse2+0x646> + DB 15,40,29,158,52,0,0 ; movaps 0x349e(%rip),%xmm3 # 5c40 <_sk_callback_sse2+0x659> DB 91 ; pop %rbx DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 @@ -21461,21 +21318,21 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC DB 102,71,15,196,92,81,4,2 ; pinsrw $0x2,0x4(%r9,%r10,2),%xmm11 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,14 ; jne 27c2 <_sk_load_tables_rgb_u16_be_sse2+0x18c> + DB 117,14 ; jne 27cf <_sk_load_tables_rgb_u16_be_sse2+0x18c> DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 102,69,15,239,210 ; pxor %xmm10,%xmm10 - DB 233,172,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38> + DB 233,172,254,255,255 ; jmpq 267b <_sk_load_tables_rgb_u16_be_sse2+0x38> DB 102,71,15,110,84,81,6 ; movd 0x6(%r9,%r10,2),%xmm10 DB 102,71,15,196,84,81,10,2 ; pinsrw $0x2,0xa(%r9,%r10,2),%xmm10 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,24 ; jb 27f3 <_sk_load_tables_rgb_u16_be_sse2+0x1bd> + DB 114,24 ; jb 2800 <_sk_load_tables_rgb_u16_be_sse2+0x1bd> DB 102,67,15,110,76,81,12 ; movd 0xc(%r9,%r10,2),%xmm1 DB 102,67,15,196,76,81,16,2 ; pinsrw $0x2,0x10(%r9,%r10,2),%xmm1 DB 102,15,239,192 ; pxor %xmm0,%xmm0 - DB 233,123,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38> + DB 233,123,254,255,255 ; jmpq 267b <_sk_load_tables_rgb_u16_be_sse2+0x38> DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,114,254,255,255 ; jmpq 266e <_sk_load_tables_rgb_u16_be_sse2+0x38> + DB 233,114,254,255,255 ; jmpq 267b <_sk_load_tables_rgb_u16_be_sse2+0x38> PUBLIC _sk_byte_tables_sse2 _sk_byte_tables_sse2 LABEL PROC @@ -21484,7 +21341,7 @@ _sk_byte_tables_sse2 LABEL PROC DB 65,86 ; push %r14 DB 83 ; push %rbx DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,36,52,0,0 ; movaps 0x3424(%rip),%xmm8 # 5c30 <_sk_callback_sse2+0x656> + DB 68,15,40,5,55,52,0,0 ; movaps 0x3437(%rip),%xmm8 # 5c50 <_sk_callback_sse2+0x669> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0 DB 102,73,15,126,193 ; movq %xmm0,%r9 @@ -21512,7 +21369,7 @@ _sk_byte_tables_sse2 LABEL PROC DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0 DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,21,190,51,0,0 ; movaps 0x33be(%rip),%xmm10 # 5c40 <_sk_callback_sse2+0x666> + DB 68,15,40,21,209,51,0,0 ; movaps 0x33d1(%rip),%xmm10 # 5c60 <_sk_callback_sse2+0x679> DB 65,15,89,194 ; mulps %xmm10,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1 @@ -21631,7 +21488,7 @@ _sk_byte_tables_rgb_sse2 LABEL PROC DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0 DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,21,6,50,0,0 ; movaps 0x3206(%rip),%xmm10 # 5c50 <_sk_callback_sse2+0x676> + DB 68,15,40,21,25,50,0,0 ; movaps 0x3219(%rip),%xmm10 # 5c70 <_sk_callback_sse2+0x689> DB 65,15,89,194 ; mulps %xmm10,%xmm0 DB 65,15,89,200 ; mulps %xmm8,%xmm1 DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1 @@ -21828,15 +21685,15 @@ _sk_parametric_r_sse2 LABEL PROC DB 69,15,88,209 ; addps %xmm9,%xmm10 DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11 DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9 - DB 68,15,89,13,58,47,0,0 ; mulps 0x2f3a(%rip),%xmm9 # 5c60 <_sk_callback_sse2+0x686> - DB 68,15,84,21,66,47,0,0 ; andps 0x2f42(%rip),%xmm10 # 5c70 <_sk_callback_sse2+0x696> - DB 68,15,86,21,74,47,0,0 ; orps 0x2f4a(%rip),%xmm10 # 5c80 <_sk_callback_sse2+0x6a6> - DB 68,15,88,13,82,47,0,0 ; addps 0x2f52(%rip),%xmm9 # 5c90 <_sk_callback_sse2+0x6b6> - DB 68,15,40,37,90,47,0,0 ; movaps 0x2f5a(%rip),%xmm12 # 5ca0 <_sk_callback_sse2+0x6c6> + DB 68,15,89,13,77,47,0,0 ; mulps 0x2f4d(%rip),%xmm9 # 5c80 <_sk_callback_sse2+0x699> + DB 68,15,84,21,85,47,0,0 ; andps 0x2f55(%rip),%xmm10 # 5c90 <_sk_callback_sse2+0x6a9> + DB 68,15,86,21,93,47,0,0 ; orps 0x2f5d(%rip),%xmm10 # 5ca0 <_sk_callback_sse2+0x6b9> + DB 68,15,88,13,101,47,0,0 ; addps 0x2f65(%rip),%xmm9 # 5cb0 <_sk_callback_sse2+0x6c9> + DB 68,15,40,37,109,47,0,0 ; movaps 0x2f6d(%rip),%xmm12 # 5cc0 <_sk_callback_sse2+0x6d9> DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,88,21,90,47,0,0 ; addps 0x2f5a(%rip),%xmm10 # 5cb0 <_sk_callback_sse2+0x6d6> - DB 68,15,40,37,98,47,0,0 ; movaps 0x2f62(%rip),%xmm12 # 5cc0 <_sk_callback_sse2+0x6e6> + DB 68,15,88,21,109,47,0,0 ; addps 0x2f6d(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x6e9> + DB 68,15,40,37,117,47,0,0 ; movaps 0x2f75(%rip),%xmm12 # 5ce0 <_sk_callback_sse2+0x6f9> DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 @@ -21844,22 +21701,22 @@ _sk_parametric_r_sse2 LABEL PROC DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13 - DB 68,15,40,21,76,47,0,0 ; movaps 0x2f4c(%rip),%xmm10 # 5cd0 <_sk_callback_sse2+0x6f6> + DB 68,15,40,21,95,47,0,0 ; movaps 0x2f5f(%rip),%xmm10 # 5cf0 <_sk_callback_sse2+0x709> DB 69,15,84,234 ; andps %xmm10,%xmm13 DB 69,15,87,219 ; xorps %xmm11,%xmm11 DB 69,15,92,229 ; subps %xmm13,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,92,236 ; subps %xmm12,%xmm13 - DB 68,15,88,13,64,47,0,0 ; addps 0x2f40(%rip),%xmm9 # 5ce0 <_sk_callback_sse2+0x706> - DB 68,15,40,37,72,47,0,0 ; movaps 0x2f48(%rip),%xmm12 # 5cf0 <_sk_callback_sse2+0x716> + DB 68,15,88,13,83,47,0,0 ; addps 0x2f53(%rip),%xmm9 # 5d00 <_sk_callback_sse2+0x719> + DB 68,15,40,37,91,47,0,0 ; movaps 0x2f5b(%rip),%xmm12 # 5d10 <_sk_callback_sse2+0x729> DB 69,15,89,229 ; mulps %xmm13,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,40,37,72,47,0,0 ; movaps 0x2f48(%rip),%xmm12 # 5d00 <_sk_callback_sse2+0x726> + DB 68,15,40,37,91,47,0,0 ; movaps 0x2f5b(%rip),%xmm12 # 5d20 <_sk_callback_sse2+0x739> DB 69,15,92,229 ; subps %xmm13,%xmm12 - DB 68,15,40,45,76,47,0,0 ; movaps 0x2f4c(%rip),%xmm13 # 5d10 <_sk_callback_sse2+0x736> + DB 68,15,40,45,95,47,0,0 ; movaps 0x2f5f(%rip),%xmm13 # 5d30 <_sk_callback_sse2+0x749> DB 69,15,94,236 ; divps %xmm12,%xmm13 DB 69,15,88,233 ; addps %xmm9,%xmm13 - DB 68,15,89,45,76,47,0,0 ; mulps 0x2f4c(%rip),%xmm13 # 5d20 <_sk_callback_sse2+0x746> + DB 68,15,89,45,95,47,0,0 ; mulps 0x2f5f(%rip),%xmm13 # 5d40 <_sk_callback_sse2+0x759> DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9 DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12 DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12 @@ -21893,15 +21750,15 @@ _sk_parametric_g_sse2 LABEL PROC DB 69,15,88,209 ; addps %xmm9,%xmm10 DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11 DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9 - DB 68,15,89,13,204,46,0,0 ; mulps 0x2ecc(%rip),%xmm9 # 5d30 <_sk_callback_sse2+0x756> - DB 68,15,84,21,212,46,0,0 ; andps 0x2ed4(%rip),%xmm10 # 5d40 <_sk_callback_sse2+0x766> - DB 68,15,86,21,220,46,0,0 ; orps 0x2edc(%rip),%xmm10 # 5d50 <_sk_callback_sse2+0x776> - DB 68,15,88,13,228,46,0,0 ; addps 0x2ee4(%rip),%xmm9 # 5d60 <_sk_callback_sse2+0x786> - DB 68,15,40,37,236,46,0,0 ; movaps 0x2eec(%rip),%xmm12 # 5d70 <_sk_callback_sse2+0x796> + DB 68,15,89,13,223,46,0,0 ; mulps 0x2edf(%rip),%xmm9 # 5d50 <_sk_callback_sse2+0x769> + DB 68,15,84,21,231,46,0,0 ; andps 0x2ee7(%rip),%xmm10 # 5d60 <_sk_callback_sse2+0x779> + DB 68,15,86,21,239,46,0,0 ; orps 0x2eef(%rip),%xmm10 # 5d70 <_sk_callback_sse2+0x789> + DB 68,15,88,13,247,46,0,0 ; addps 0x2ef7(%rip),%xmm9 # 5d80 <_sk_callback_sse2+0x799> + DB 68,15,40,37,255,46,0,0 ; movaps 0x2eff(%rip),%xmm12 # 5d90 <_sk_callback_sse2+0x7a9> DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,88,21,236,46,0,0 ; addps 0x2eec(%rip),%xmm10 # 5d80 <_sk_callback_sse2+0x7a6> - DB 68,15,40,37,244,46,0,0 ; movaps 0x2ef4(%rip),%xmm12 # 5d90 <_sk_callback_sse2+0x7b6> + DB 68,15,88,21,255,46,0,0 ; addps 0x2eff(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x7b9> + DB 68,15,40,37,7,47,0,0 ; movaps 0x2f07(%rip),%xmm12 # 5db0 <_sk_callback_sse2+0x7c9> DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 @@ -21909,22 +21766,22 @@ _sk_parametric_g_sse2 LABEL PROC DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13 - DB 68,15,40,21,222,46,0,0 ; movaps 0x2ede(%rip),%xmm10 # 5da0 <_sk_callback_sse2+0x7c6> + DB 68,15,40,21,241,46,0,0 ; movaps 0x2ef1(%rip),%xmm10 # 5dc0 <_sk_callback_sse2+0x7d9> DB 69,15,84,234 ; andps %xmm10,%xmm13 DB 69,15,87,219 ; xorps %xmm11,%xmm11 DB 69,15,92,229 ; subps %xmm13,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,92,236 ; subps %xmm12,%xmm13 - DB 68,15,88,13,210,46,0,0 ; addps 0x2ed2(%rip),%xmm9 # 5db0 <_sk_callback_sse2+0x7d6> - DB 68,15,40,37,218,46,0,0 ; movaps 0x2eda(%rip),%xmm12 # 5dc0 <_sk_callback_sse2+0x7e6> + DB 68,15,88,13,229,46,0,0 ; addps 0x2ee5(%rip),%xmm9 # 5dd0 <_sk_callback_sse2+0x7e9> + DB 68,15,40,37,237,46,0,0 ; movaps 0x2eed(%rip),%xmm12 # 5de0 <_sk_callback_sse2+0x7f9> DB 69,15,89,229 ; mulps %xmm13,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,40,37,218,46,0,0 ; movaps 0x2eda(%rip),%xmm12 # 5dd0 <_sk_callback_sse2+0x7f6> + DB 68,15,40,37,237,46,0,0 ; movaps 0x2eed(%rip),%xmm12 # 5df0 <_sk_callback_sse2+0x809> DB 69,15,92,229 ; subps %xmm13,%xmm12 - DB 68,15,40,45,222,46,0,0 ; movaps 0x2ede(%rip),%xmm13 # 5de0 <_sk_callback_sse2+0x806> + DB 68,15,40,45,241,46,0,0 ; movaps 0x2ef1(%rip),%xmm13 # 5e00 <_sk_callback_sse2+0x819> DB 69,15,94,236 ; divps %xmm12,%xmm13 DB 69,15,88,233 ; addps %xmm9,%xmm13 - DB 68,15,89,45,222,46,0,0 ; mulps 0x2ede(%rip),%xmm13 # 5df0 <_sk_callback_sse2+0x816> + DB 68,15,89,45,241,46,0,0 ; mulps 0x2ef1(%rip),%xmm13 # 5e10 <_sk_callback_sse2+0x829> DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9 DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12 DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12 @@ -21958,15 +21815,15 @@ _sk_parametric_b_sse2 LABEL PROC DB 69,15,88,209 ; addps %xmm9,%xmm10 DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11 DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9 - DB 68,15,89,13,94,46,0,0 ; mulps 0x2e5e(%rip),%xmm9 # 5e00 <_sk_callback_sse2+0x826> - DB 68,15,84,21,102,46,0,0 ; andps 0x2e66(%rip),%xmm10 # 5e10 <_sk_callback_sse2+0x836> - DB 68,15,86,21,110,46,0,0 ; orps 0x2e6e(%rip),%xmm10 # 5e20 <_sk_callback_sse2+0x846> - DB 68,15,88,13,118,46,0,0 ; addps 0x2e76(%rip),%xmm9 # 5e30 <_sk_callback_sse2+0x856> - DB 68,15,40,37,126,46,0,0 ; movaps 0x2e7e(%rip),%xmm12 # 5e40 <_sk_callback_sse2+0x866> + DB 68,15,89,13,113,46,0,0 ; mulps 0x2e71(%rip),%xmm9 # 5e20 <_sk_callback_sse2+0x839> + DB 68,15,84,21,121,46,0,0 ; andps 0x2e79(%rip),%xmm10 # 5e30 <_sk_callback_sse2+0x849> + DB 68,15,86,21,129,46,0,0 ; orps 0x2e81(%rip),%xmm10 # 5e40 <_sk_callback_sse2+0x859> + DB 68,15,88,13,137,46,0,0 ; addps 0x2e89(%rip),%xmm9 # 5e50 <_sk_callback_sse2+0x869> + DB 68,15,40,37,145,46,0,0 ; movaps 0x2e91(%rip),%xmm12 # 5e60 <_sk_callback_sse2+0x879> DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,88,21,126,46,0,0 ; addps 0x2e7e(%rip),%xmm10 # 5e50 <_sk_callback_sse2+0x876> - DB 68,15,40,37,134,46,0,0 ; movaps 0x2e86(%rip),%xmm12 # 5e60 <_sk_callback_sse2+0x886> + DB 68,15,88,21,145,46,0,0 ; addps 0x2e91(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x889> + DB 68,15,40,37,153,46,0,0 ; movaps 0x2e99(%rip),%xmm12 # 5e80 <_sk_callback_sse2+0x899> DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 @@ -21974,22 +21831,22 @@ _sk_parametric_b_sse2 LABEL PROC DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13 - DB 68,15,40,21,112,46,0,0 ; movaps 0x2e70(%rip),%xmm10 # 5e70 <_sk_callback_sse2+0x896> + DB 68,15,40,21,131,46,0,0 ; movaps 0x2e83(%rip),%xmm10 # 5e90 <_sk_callback_sse2+0x8a9> DB 69,15,84,234 ; andps %xmm10,%xmm13 DB 69,15,87,219 ; xorps %xmm11,%xmm11 DB 69,15,92,229 ; subps %xmm13,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,92,236 ; subps %xmm12,%xmm13 - DB 68,15,88,13,100,46,0,0 ; addps 0x2e64(%rip),%xmm9 # 5e80 <_sk_callback_sse2+0x8a6> - DB 68,15,40,37,108,46,0,0 ; movaps 0x2e6c(%rip),%xmm12 # 5e90 <_sk_callback_sse2+0x8b6> + DB 68,15,88,13,119,46,0,0 ; addps 0x2e77(%rip),%xmm9 # 5ea0 <_sk_callback_sse2+0x8b9> + DB 68,15,40,37,127,46,0,0 ; movaps 0x2e7f(%rip),%xmm12 # 5eb0 <_sk_callback_sse2+0x8c9> DB 69,15,89,229 ; mulps %xmm13,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,40,37,108,46,0,0 ; movaps 0x2e6c(%rip),%xmm12 # 5ea0 <_sk_callback_sse2+0x8c6> + DB 68,15,40,37,127,46,0,0 ; movaps 0x2e7f(%rip),%xmm12 # 5ec0 <_sk_callback_sse2+0x8d9> DB 69,15,92,229 ; subps %xmm13,%xmm12 - DB 68,15,40,45,112,46,0,0 ; movaps 0x2e70(%rip),%xmm13 # 5eb0 <_sk_callback_sse2+0x8d6> + DB 68,15,40,45,131,46,0,0 ; movaps 0x2e83(%rip),%xmm13 # 5ed0 <_sk_callback_sse2+0x8e9> DB 69,15,94,236 ; divps %xmm12,%xmm13 DB 69,15,88,233 ; addps %xmm9,%xmm13 - DB 68,15,89,45,112,46,0,0 ; mulps 0x2e70(%rip),%xmm13 # 5ec0 <_sk_callback_sse2+0x8e6> + DB 68,15,89,45,131,46,0,0 ; mulps 0x2e83(%rip),%xmm13 # 5ee0 <_sk_callback_sse2+0x8f9> DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9 DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12 DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12 @@ -22023,15 +21880,15 @@ _sk_parametric_a_sse2 LABEL PROC DB 69,15,88,209 ; addps %xmm9,%xmm10 DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11 DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9 - DB 68,15,89,13,240,45,0,0 ; mulps 0x2df0(%rip),%xmm9 # 5ed0 <_sk_callback_sse2+0x8f6> - DB 68,15,84,21,248,45,0,0 ; andps 0x2df8(%rip),%xmm10 # 5ee0 <_sk_callback_sse2+0x906> - DB 68,15,86,21,0,46,0,0 ; orps 0x2e00(%rip),%xmm10 # 5ef0 <_sk_callback_sse2+0x916> - DB 68,15,88,13,8,46,0,0 ; addps 0x2e08(%rip),%xmm9 # 5f00 <_sk_callback_sse2+0x926> - DB 68,15,40,37,16,46,0,0 ; movaps 0x2e10(%rip),%xmm12 # 5f10 <_sk_callback_sse2+0x936> + DB 68,15,89,13,3,46,0,0 ; mulps 0x2e03(%rip),%xmm9 # 5ef0 <_sk_callback_sse2+0x909> + DB 68,15,84,21,11,46,0,0 ; andps 0x2e0b(%rip),%xmm10 # 5f00 <_sk_callback_sse2+0x919> + DB 68,15,86,21,19,46,0,0 ; orps 0x2e13(%rip),%xmm10 # 5f10 <_sk_callback_sse2+0x929> + DB 68,15,88,13,27,46,0,0 ; addps 0x2e1b(%rip),%xmm9 # 5f20 <_sk_callback_sse2+0x939> + DB 68,15,40,37,35,46,0,0 ; movaps 0x2e23(%rip),%xmm12 # 5f30 <_sk_callback_sse2+0x949> DB 69,15,89,226 ; mulps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,88,21,16,46,0,0 ; addps 0x2e10(%rip),%xmm10 # 5f20 <_sk_callback_sse2+0x946> - DB 68,15,40,37,24,46,0,0 ; movaps 0x2e18(%rip),%xmm12 # 5f30 <_sk_callback_sse2+0x956> + DB 68,15,88,21,35,46,0,0 ; addps 0x2e23(%rip),%xmm10 # 5f40 <_sk_callback_sse2+0x959> + DB 68,15,40,37,43,46,0,0 ; movaps 0x2e2b(%rip),%xmm12 # 5f50 <_sk_callback_sse2+0x969> DB 69,15,94,226 ; divps %xmm10,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 DB 69,15,89,203 ; mulps %xmm11,%xmm9 @@ -22039,22 +21896,22 @@ _sk_parametric_a_sse2 LABEL PROC DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13 - DB 68,15,40,21,2,46,0,0 ; movaps 0x2e02(%rip),%xmm10 # 5f40 <_sk_callback_sse2+0x966> + DB 68,15,40,21,21,46,0,0 ; movaps 0x2e15(%rip),%xmm10 # 5f60 <_sk_callback_sse2+0x979> DB 69,15,84,234 ; andps %xmm10,%xmm13 DB 69,15,87,219 ; xorps %xmm11,%xmm11 DB 69,15,92,229 ; subps %xmm13,%xmm12 DB 69,15,40,233 ; movaps %xmm9,%xmm13 DB 69,15,92,236 ; subps %xmm12,%xmm13 - DB 68,15,88,13,246,45,0,0 ; addps 0x2df6(%rip),%xmm9 # 5f50 <_sk_callback_sse2+0x976> - DB 68,15,40,37,254,45,0,0 ; movaps 0x2dfe(%rip),%xmm12 # 5f60 <_sk_callback_sse2+0x986> + DB 68,15,88,13,9,46,0,0 ; addps 0x2e09(%rip),%xmm9 # 5f70 <_sk_callback_sse2+0x989> + DB 68,15,40,37,17,46,0,0 ; movaps 0x2e11(%rip),%xmm12 # 5f80 <_sk_callback_sse2+0x999> DB 69,15,89,229 ; mulps %xmm13,%xmm12 DB 69,15,92,204 ; subps %xmm12,%xmm9 - DB 68,15,40,37,254,45,0,0 ; movaps 0x2dfe(%rip),%xmm12 # 5f70 <_sk_callback_sse2+0x996> + DB 68,15,40,37,17,46,0,0 ; movaps 0x2e11(%rip),%xmm12 # 5f90 <_sk_callback_sse2+0x9a9> DB 69,15,92,229 ; subps %xmm13,%xmm12 - DB 68,15,40,45,2,46,0,0 ; movaps 0x2e02(%rip),%xmm13 # 5f80 <_sk_callback_sse2+0x9a6> + DB 68,15,40,45,21,46,0,0 ; movaps 0x2e15(%rip),%xmm13 # 5fa0 <_sk_callback_sse2+0x9b9> DB 69,15,94,236 ; divps %xmm12,%xmm13 DB 69,15,88,233 ; addps %xmm9,%xmm13 - DB 68,15,89,45,2,46,0,0 ; mulps 0x2e02(%rip),%xmm13 # 5f90 <_sk_callback_sse2+0x9b6> + DB 68,15,89,45,21,46,0,0 ; mulps 0x2e15(%rip),%xmm13 # 5fb0 <_sk_callback_sse2+0x9c9> DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9 DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12 DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12 @@ -22069,29 +21926,29 @@ _sk_parametric_a_sse2 LABEL PROC PUBLIC _sk_lab_to_xyz_sse2 _sk_lab_to_xyz_sse2 LABEL PROC - DB 15,89,5,223,45,0,0 ; mulps 0x2ddf(%rip),%xmm0 # 5fa0 <_sk_callback_sse2+0x9c6> - DB 68,15,40,5,231,45,0,0 ; movaps 0x2de7(%rip),%xmm8 # 5fb0 <_sk_callback_sse2+0x9d6> + DB 15,89,5,242,45,0,0 ; mulps 0x2df2(%rip),%xmm0 # 5fc0 <_sk_callback_sse2+0x9d9> + DB 68,15,40,5,250,45,0,0 ; movaps 0x2dfa(%rip),%xmm8 # 5fd0 <_sk_callback_sse2+0x9e9> DB 65,15,89,200 ; mulps %xmm8,%xmm1 - DB 68,15,40,13,235,45,0,0 ; movaps 0x2deb(%rip),%xmm9 # 5fc0 <_sk_callback_sse2+0x9e6> + DB 68,15,40,13,254,45,0,0 ; movaps 0x2dfe(%rip),%xmm9 # 5fe0 <_sk_callback_sse2+0x9f9> DB 65,15,88,201 ; addps %xmm9,%xmm1 DB 65,15,89,208 ; mulps %xmm8,%xmm2 DB 65,15,88,209 ; addps %xmm9,%xmm2 - DB 15,88,5,232,45,0,0 ; addps 0x2de8(%rip),%xmm0 # 5fd0 <_sk_callback_sse2+0x9f6> - DB 15,89,5,241,45,0,0 ; mulps 0x2df1(%rip),%xmm0 # 5fe0 <_sk_callback_sse2+0xa06> - DB 15,89,13,250,45,0,0 ; mulps 0x2dfa(%rip),%xmm1 # 5ff0 <_sk_callback_sse2+0xa16> + DB 15,88,5,251,45,0,0 ; addps 0x2dfb(%rip),%xmm0 # 5ff0 <_sk_callback_sse2+0xa09> + DB 15,89,5,4,46,0,0 ; mulps 0x2e04(%rip),%xmm0 # 6000 <_sk_callback_sse2+0xa19> + DB 15,89,13,13,46,0,0 ; mulps 0x2e0d(%rip),%xmm1 # 6010 <_sk_callback_sse2+0xa29> DB 15,88,200 ; addps %xmm0,%xmm1 - DB 15,89,21,0,46,0,0 ; mulps 0x2e00(%rip),%xmm2 # 6000 <_sk_callback_sse2+0xa26> + DB 15,89,21,19,46,0,0 ; mulps 0x2e13(%rip),%xmm2 # 6020 <_sk_callback_sse2+0xa39> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 68,15,92,202 ; subps %xmm2,%xmm9 DB 68,15,40,225 ; movaps %xmm1,%xmm12 DB 69,15,89,228 ; mulps %xmm12,%xmm12 DB 68,15,89,225 ; mulps %xmm1,%xmm12 - DB 15,40,21,245,45,0,0 ; movaps 0x2df5(%rip),%xmm2 # 6010 <_sk_callback_sse2+0xa36> + DB 15,40,21,8,46,0,0 ; movaps 0x2e08(%rip),%xmm2 # 6030 <_sk_callback_sse2+0xa49> DB 68,15,40,194 ; movaps %xmm2,%xmm8 DB 69,15,194,196,1 ; cmpltps %xmm12,%xmm8 - DB 68,15,40,21,244,45,0,0 ; movaps 0x2df4(%rip),%xmm10 # 6020 <_sk_callback_sse2+0xa46> + DB 68,15,40,21,7,46,0,0 ; movaps 0x2e07(%rip),%xmm10 # 6040 <_sk_callback_sse2+0xa59> DB 65,15,88,202 ; addps %xmm10,%xmm1 - DB 68,15,40,29,248,45,0,0 ; movaps 0x2df8(%rip),%xmm11 # 6030 <_sk_callback_sse2+0xa56> + DB 68,15,40,29,11,46,0,0 ; movaps 0x2e0b(%rip),%xmm11 # 6050 <_sk_callback_sse2+0xa69> DB 65,15,89,203 ; mulps %xmm11,%xmm1 DB 69,15,84,224 ; andps %xmm8,%xmm12 DB 68,15,85,193 ; andnps %xmm1,%xmm8 @@ -22115,8 +21972,8 @@ _sk_lab_to_xyz_sse2 LABEL PROC DB 15,84,194 ; andps %xmm2,%xmm0 DB 65,15,85,209 ; andnps %xmm9,%xmm2 DB 15,86,208 ; orps %xmm0,%xmm2 - DB 68,15,89,5,168,45,0,0 ; mulps 0x2da8(%rip),%xmm8 # 6040 <_sk_callback_sse2+0xa66> - DB 15,89,21,177,45,0,0 ; mulps 0x2db1(%rip),%xmm2 # 6050 <_sk_callback_sse2+0xa76> + DB 68,15,89,5,187,45,0,0 ; mulps 0x2dbb(%rip),%xmm8 # 6060 <_sk_callback_sse2+0xa79> + DB 15,89,21,196,45,0,0 ; mulps 0x2dc4(%rip),%xmm2 # 6070 <_sk_callback_sse2+0xa89> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -22126,13 +21983,13 @@ _sk_load_a8_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,45 ; jne 32de <_sk_load_a8_sse2+0x37> + DB 117,45 ; jne 32eb <_sk_load_a8_sse2+0x37> DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0 DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0 DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0 - DB 102,15,219,5,153,45,0,0 ; pand 0x2d99(%rip),%xmm0 # 6060 <_sk_callback_sse2+0xa86> + DB 102,15,219,5,172,45,0,0 ; pand 0x2dac(%rip),%xmm0 # 6080 <_sk_callback_sse2+0xa99> DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3 - DB 15,89,29,159,45,0,0 ; mulps 0x2d9f(%rip),%xmm3 # 6070 <_sk_callback_sse2+0xa96> + DB 15,89,29,178,45,0,0 ; mulps 0x2db2(%rip),%xmm3 # 6090 <_sk_callback_sse2+0xaa9> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 @@ -22142,11 +21999,11 @@ _sk_load_a8_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,48 ; je 331f <_sk_load_a8_sse2+0x78> + DB 116,48 ; je 332c <_sk_load_a8_sse2+0x78> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 330a <_sk_load_a8_sse2+0x63> + DB 116,21 ; je 3317 <_sk_load_a8_sse2+0x63> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,196 ; jne 32bf <_sk_load_a8_sse2+0x18> + DB 117,196 ; jne 32cc <_sk_load_a8_sse2+0x18> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0 @@ -22158,7 +22015,7 @@ _sk_load_a8_sse2 LABEL PROC DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,15,110,200 ; movd %eax,%xmm1 DB 243,15,16,193 ; movss %xmm1,%xmm0 - DB 235,145 ; jmp 32bf <_sk_load_a8_sse2+0x18> + DB 235,145 ; jmp 32cc <_sk_load_a8_sse2+0x18> PUBLIC _sk_gather_a8_sse2 _sk_gather_a8_sse2 LABEL PROC @@ -22198,7 +22055,7 @@ _sk_gather_a8_sse2 LABEL PROC DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0 DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0 DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3 - DB 15,89,29,191,44,0,0 ; mulps 0x2cbf(%rip),%xmm3 # 6080 <_sk_callback_sse2+0xaa6> + DB 15,89,29,210,44,0,0 ; mulps 0x2cd2(%rip),%xmm3 # 60a0 <_sk_callback_sse2+0xab9> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 @@ -22212,7 +22069,7 @@ _sk_store_a8_sse2 LABEL PROC DB 72,131,236,56 ; sub $0x38,%rsp DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 - DB 68,15,40,5,173,44,0,0 ; movaps 0x2cad(%rip),%xmm8 # 6090 <_sk_callback_sse2+0xab6> + DB 68,15,40,5,192,44,0,0 ; movaps 0x2cc0(%rip),%xmm8 # 60b0 <_sk_callback_sse2+0xac9> DB 68,15,89,195 ; mulps %xmm3,%xmm8 DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8 DB 102,65,15,114,240,16 ; pslld $0x10,%xmm8 @@ -22220,7 +22077,7 @@ _sk_store_a8_sse2 LABEL PROC DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8 DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,17 ; jne 3418 <_sk_store_a8_sse2+0x46> + DB 117,17 ; jne 3425 <_sk_store_a8_sse2+0x46> DB 102,68,15,126,192 ; movd %xmm8,%eax DB 65,137,4,18 ; mov %eax,(%r10,%rdx,1) DB 72,173 ; lods %ds:(%rsi),%rax @@ -22231,11 +22088,11 @@ _sk_store_a8_sse2 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,44 ; je 345b <_sk_store_a8_sse2+0x89> + DB 116,44 ; je 3468 <_sk_store_a8_sse2+0x89> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,22 ; je 344b <_sk_store_a8_sse2+0x79> + DB 116,22 ; je 3458 <_sk_store_a8_sse2+0x79> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,213 ; jne 3410 <_sk_store_a8_sse2+0x3e> + DB 117,213 ; jne 341d <_sk_store_a8_sse2+0x3e> DB 102,68,15,127,68,36,32 ; movdqa %xmm8,0x20(%rsp) DB 138,68,36,40 ; mov 0x28(%rsp),%al DB 65,136,68,18,2 ; mov %al,0x2(%r10,%rdx,1) @@ -22245,22 +22102,22 @@ _sk_store_a8_sse2 LABEL PROC DB 102,68,15,127,4,36 ; movdqa %xmm8,(%rsp) DB 138,4,36 ; mov (%rsp),%al DB 65,136,4,18 ; mov %al,(%r10,%rdx,1) - DB 235,166 ; jmp 3410 <_sk_store_a8_sse2+0x3e> + DB 235,166 ; jmp 341d <_sk_store_a8_sse2+0x3e> PUBLIC _sk_load_g8_sse2 _sk_load_g8_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,49 ; jne 34a5 <_sk_load_g8_sse2+0x3b> + DB 117,49 ; jne 34b2 <_sk_load_g8_sse2+0x3b> DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0 DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0 DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0 - DB 102,15,219,5,22,44,0,0 ; pand 0x2c16(%rip),%xmm0 # 60a0 <_sk_callback_sse2+0xac6> + DB 102,15,219,5,41,44,0,0 ; pand 0x2c29(%rip),%xmm0 # 60c0 <_sk_callback_sse2+0xad9> DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,28,44,0,0 ; mulps 0x2c1c(%rip),%xmm0 # 60b0 <_sk_callback_sse2+0xad6> + DB 15,89,5,47,44,0,0 ; mulps 0x2c2f(%rip),%xmm0 # 60d0 <_sk_callback_sse2+0xae9> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,35,44,0,0 ; movaps 0x2c23(%rip),%xmm3 # 60c0 <_sk_callback_sse2+0xae6> + DB 15,40,29,54,44,0,0 ; movaps 0x2c36(%rip),%xmm3 # 60e0 <_sk_callback_sse2+0xaf9> DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 DB 255,224 ; jmpq *%rax @@ -22268,11 +22125,11 @@ _sk_load_g8_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,48 ; je 34e6 <_sk_load_g8_sse2+0x7c> + DB 116,48 ; je 34f3 <_sk_load_g8_sse2+0x7c> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 34d1 <_sk_load_g8_sse2+0x67> + DB 116,21 ; je 34de <_sk_load_g8_sse2+0x67> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,192 ; jne 3482 <_sk_load_g8_sse2+0x18> + DB 117,192 ; jne 348f <_sk_load_g8_sse2+0x18> DB 65,15,182,68,18,2 ; movzbl 0x2(%r10,%rdx,1),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,192,69 ; pshufd $0x45,%xmm0,%xmm0 @@ -22284,7 +22141,7 @@ _sk_load_g8_sse2 LABEL PROC DB 65,15,182,4,18 ; movzbl (%r10,%rdx,1),%eax DB 102,15,110,200 ; movd %eax,%xmm1 DB 243,15,16,193 ; movss %xmm1,%xmm0 - DB 235,141 ; jmp 3482 <_sk_load_g8_sse2+0x18> + DB 235,141 ; jmp 348f <_sk_load_g8_sse2+0x18> PUBLIC _sk_gather_g8_sse2 _sk_gather_g8_sse2 LABEL PROC @@ -22324,9 +22181,9 @@ _sk_gather_g8_sse2 LABEL PROC DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0 DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,72,43,0,0 ; mulps 0x2b48(%rip),%xmm0 # 60d0 <_sk_callback_sse2+0xaf6> + DB 15,89,5,91,43,0,0 ; mulps 0x2b5b(%rip),%xmm0 # 60f0 <_sk_callback_sse2+0xb09> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,79,43,0,0 ; movaps 0x2b4f(%rip),%xmm3 # 60e0 <_sk_callback_sse2+0xb06> + DB 15,40,29,98,43,0,0 ; movaps 0x2b62(%rip),%xmm3 # 6100 <_sk_callback_sse2+0xb19> DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 DB 91 ; pop %rbx @@ -22338,9 +22195,9 @@ _sk_gather_i8_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 73,137,193 ; mov %rax,%r9 DB 77,133,201 ; test %r9,%r9 - DB 116,5 ; je 35aa <_sk_gather_i8_sse2+0xf> + DB 116,5 ; je 35b7 <_sk_gather_i8_sse2+0xf> DB 76,137,200 ; mov %r9,%rax - DB 235,2 ; jmp 35ac <_sk_gather_i8_sse2+0x11> + DB 235,2 ; jmp 35b9 <_sk_gather_i8_sse2+0x11> DB 72,173 ; lods %ds:(%rsi),%rax DB 85 ; push %rbp DB 65,86 ; push %r14 @@ -22392,11 +22249,11 @@ _sk_gather_i8_sse2 LABEL PROC DB 102,66,15,110,76,149,0 ; movd 0x0(%rbp,%r10,4),%xmm1 DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9 DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9 - DB 102,15,111,21,104,42,0,0 ; movdqa 0x2a68(%rip),%xmm2 # 60f0 <_sk_callback_sse2+0xb16> + DB 102,15,111,21,123,42,0,0 ; movdqa 0x2a7b(%rip),%xmm2 # 6110 <_sk_callback_sse2+0xb29> DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0 DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,100,42,0,0 ; movaps 0x2a64(%rip),%xmm8 # 6100 <_sk_callback_sse2+0xb26> + DB 68,15,40,5,119,42,0,0 ; movaps 0x2a77(%rip),%xmm8 # 6120 <_sk_callback_sse2+0xb39> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1 DB 102,15,114,209,8 ; psrld $0x8,%xmm1 @@ -22422,32 +22279,32 @@ _sk_load_565_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,83 ; jne 373d <_sk_load_565_sse2+0x5d> + DB 117,83 ; jne 374a <_sk_load_565_sse2+0x5d> DB 243,65,15,126,20,82 ; movq (%r10,%rdx,2),%xmm2 DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2 - DB 102,15,111,5,20,42,0,0 ; movdqa 0x2a14(%rip),%xmm0 # 6110 <_sk_callback_sse2+0xb36> + DB 102,15,111,5,39,42,0,0 ; movdqa 0x2a27(%rip),%xmm0 # 6130 <_sk_callback_sse2+0xb49> DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,22,42,0,0 ; mulps 0x2a16(%rip),%xmm0 # 6120 <_sk_callback_sse2+0xb46> - DB 102,15,111,13,30,42,0,0 ; movdqa 0x2a1e(%rip),%xmm1 # 6130 <_sk_callback_sse2+0xb56> + DB 15,89,5,41,42,0,0 ; mulps 0x2a29(%rip),%xmm0 # 6140 <_sk_callback_sse2+0xb59> + DB 102,15,111,13,49,42,0,0 ; movdqa 0x2a31(%rip),%xmm1 # 6150 <_sk_callback_sse2+0xb69> DB 102,15,219,202 ; pand %xmm2,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,32,42,0,0 ; mulps 0x2a20(%rip),%xmm1 # 6140 <_sk_callback_sse2+0xb66> - DB 102,15,219,21,40,42,0,0 ; pand 0x2a28(%rip),%xmm2 # 6150 <_sk_callback_sse2+0xb76> + DB 15,89,13,51,42,0,0 ; mulps 0x2a33(%rip),%xmm1 # 6160 <_sk_callback_sse2+0xb79> + DB 102,15,219,21,59,42,0,0 ; pand 0x2a3b(%rip),%xmm2 # 6170 <_sk_callback_sse2+0xb89> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,46,42,0,0 ; mulps 0x2a2e(%rip),%xmm2 # 6160 <_sk_callback_sse2+0xb86> + DB 15,89,21,65,42,0,0 ; mulps 0x2a41(%rip),%xmm2 # 6180 <_sk_callback_sse2+0xb99> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,53,42,0,0 ; movaps 0x2a35(%rip),%xmm3 # 6170 <_sk_callback_sse2+0xb96> + DB 15,40,29,72,42,0,0 ; movaps 0x2a48(%rip),%xmm3 # 6190 <_sk_callback_sse2+0xba9> DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,210 ; pxor %xmm2,%xmm2 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,48 ; je 377e <_sk_load_565_sse2+0x9e> + DB 116,48 ; je 378b <_sk_load_565_sse2+0x9e> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 3769 <_sk_load_565_sse2+0x89> + DB 116,21 ; je 3776 <_sk_load_565_sse2+0x89> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,154 ; jne 36f4 <_sk_load_565_sse2+0x14> + DB 117,154 ; jne 3701 <_sk_load_565_sse2+0x14> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2 @@ -22459,7 +22316,7 @@ _sk_load_565_sse2 LABEL PROC DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 243,15,16,208 ; movss %xmm0,%xmm2 - DB 233,100,255,255,255 ; jmpq 36f4 <_sk_load_565_sse2+0x14> + DB 233,100,255,255,255 ; jmpq 3701 <_sk_load_565_sse2+0x14> PUBLIC _sk_gather_565_sse2 _sk_gather_565_sse2 LABEL PROC @@ -22492,19 +22349,19 @@ _sk_gather_565_sse2 LABEL PROC DB 102,15,196,208,3 ; pinsrw $0x3,%eax,%xmm2 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2 - DB 102,15,111,5,106,41,0,0 ; movdqa 0x296a(%rip),%xmm0 # 6180 <_sk_callback_sse2+0xba6> + DB 102,15,111,5,125,41,0,0 ; movdqa 0x297d(%rip),%xmm0 # 61a0 <_sk_callback_sse2+0xbb9> DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,108,41,0,0 ; mulps 0x296c(%rip),%xmm0 # 6190 <_sk_callback_sse2+0xbb6> - DB 102,15,111,13,116,41,0,0 ; movdqa 0x2974(%rip),%xmm1 # 61a0 <_sk_callback_sse2+0xbc6> + DB 15,89,5,127,41,0,0 ; mulps 0x297f(%rip),%xmm0 # 61b0 <_sk_callback_sse2+0xbc9> + DB 102,15,111,13,135,41,0,0 ; movdqa 0x2987(%rip),%xmm1 # 61c0 <_sk_callback_sse2+0xbd9> DB 102,15,219,202 ; pand %xmm2,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,118,41,0,0 ; mulps 0x2976(%rip),%xmm1 # 61b0 <_sk_callback_sse2+0xbd6> - DB 102,15,219,21,126,41,0,0 ; pand 0x297e(%rip),%xmm2 # 61c0 <_sk_callback_sse2+0xbe6> + DB 15,89,13,137,41,0,0 ; mulps 0x2989(%rip),%xmm1 # 61d0 <_sk_callback_sse2+0xbe9> + DB 102,15,219,21,145,41,0,0 ; pand 0x2991(%rip),%xmm2 # 61e0 <_sk_callback_sse2+0xbf9> DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,132,41,0,0 ; mulps 0x2984(%rip),%xmm2 # 61d0 <_sk_callback_sse2+0xbf6> + DB 15,89,21,151,41,0,0 ; mulps 0x2997(%rip),%xmm2 # 61f0 <_sk_callback_sse2+0xc09> DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,139,41,0,0 ; movaps 0x298b(%rip),%xmm3 # 61e0 <_sk_callback_sse2+0xc06> + DB 15,40,29,158,41,0,0 ; movaps 0x299e(%rip),%xmm3 # 6200 <_sk_callback_sse2+0xc19> DB 91 ; pop %rbx DB 255,224 ; jmpq *%rax @@ -22512,12 +22369,12 @@ PUBLIC _sk_store_565_sse2 _sk_store_565_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 - DB 68,15,40,5,139,41,0,0 ; movaps 0x298b(%rip),%xmm8 # 61f0 <_sk_callback_sse2+0xc16> + DB 68,15,40,5,158,41,0,0 ; movaps 0x299e(%rip),%xmm8 # 6210 <_sk_callback_sse2+0xc29> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9 - DB 68,15,40,21,128,41,0,0 ; movaps 0x2980(%rip),%xmm10 # 6200 <_sk_callback_sse2+0xc26> + DB 68,15,40,21,147,41,0,0 ; movaps 0x2993(%rip),%xmm10 # 6220 <_sk_callback_sse2+0xc39> DB 68,15,89,209 ; mulps %xmm1,%xmm10 DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10 DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10 @@ -22529,7 +22386,7 @@ _sk_store_565_sse2 LABEL PROC DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8 DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 38c2 <_sk_store_565_sse2+0x6a> + DB 117,10 ; jne 38cf <_sk_store_565_sse2+0x6a> DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -22537,53 +22394,53 @@ _sk_store_565_sse2 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,36 ; je 38f8 <_sk_store_565_sse2+0xa0> + DB 116,36 ; je 3905 <_sk_store_565_sse2+0xa0> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,18 ; je 38ec <_sk_store_565_sse2+0x94> + DB 116,18 ; je 38f9 <_sk_store_565_sse2+0x94> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,222 ; jne 38be <_sk_store_565_sse2+0x66> + DB 117,222 ; jne 38cb <_sk_store_565_sse2+0x66> DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2) DB 102,65,15,197,192,2 ; pextrw $0x2,%xmm8,%eax DB 102,65,137,68,82,2 ; mov %ax,0x2(%r10,%rdx,2) DB 102,68,15,126,192 ; movd %xmm8,%eax DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2) - DB 235,186 ; jmp 38be <_sk_store_565_sse2+0x66> + DB 235,186 ; jmp 38cb <_sk_store_565_sse2+0x66> PUBLIC _sk_load_4444_sse2 _sk_load_4444_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 DB 77,133,192 ; test %r8,%r8 - DB 117,98 ; jne 3970 <_sk_load_4444_sse2+0x6c> + DB 117,98 ; jne 397d <_sk_load_4444_sse2+0x6c> DB 243,65,15,126,28,82 ; movq (%r10,%rdx,2),%xmm3 DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3 - DB 102,15,111,5,240,40,0,0 ; movdqa 0x28f0(%rip),%xmm0 # 6210 <_sk_callback_sse2+0xc36> + DB 102,15,111,5,3,41,0,0 ; movdqa 0x2903(%rip),%xmm0 # 6230 <_sk_callback_sse2+0xc49> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,242,40,0,0 ; mulps 0x28f2(%rip),%xmm0 # 6220 <_sk_callback_sse2+0xc46> - DB 102,15,111,13,250,40,0,0 ; movdqa 0x28fa(%rip),%xmm1 # 6230 <_sk_callback_sse2+0xc56> + DB 15,89,5,5,41,0,0 ; mulps 0x2905(%rip),%xmm0 # 6240 <_sk_callback_sse2+0xc59> + DB 102,15,111,13,13,41,0,0 ; movdqa 0x290d(%rip),%xmm1 # 6250 <_sk_callback_sse2+0xc69> DB 102,15,219,203 ; pand %xmm3,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,252,40,0,0 ; mulps 0x28fc(%rip),%xmm1 # 6240 <_sk_callback_sse2+0xc66> - DB 102,15,111,21,4,41,0,0 ; movdqa 0x2904(%rip),%xmm2 # 6250 <_sk_callback_sse2+0xc76> + DB 15,89,13,15,41,0,0 ; mulps 0x290f(%rip),%xmm1 # 6260 <_sk_callback_sse2+0xc79> + DB 102,15,111,21,23,41,0,0 ; movdqa 0x2917(%rip),%xmm2 # 6270 <_sk_callback_sse2+0xc89> DB 102,15,219,211 ; pand %xmm3,%xmm2 DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,6,41,0,0 ; mulps 0x2906(%rip),%xmm2 # 6260 <_sk_callback_sse2+0xc86> - DB 102,15,219,29,14,41,0,0 ; pand 0x290e(%rip),%xmm3 # 6270 <_sk_callback_sse2+0xc96> + DB 15,89,21,25,41,0,0 ; mulps 0x2919(%rip),%xmm2 # 6280 <_sk_callback_sse2+0xc99> + DB 102,15,219,29,33,41,0,0 ; pand 0x2921(%rip),%xmm3 # 6290 <_sk_callback_sse2+0xca9> DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,20,41,0,0 ; mulps 0x2914(%rip),%xmm3 # 6280 <_sk_callback_sse2+0xca6> + DB 15,89,29,39,41,0,0 ; mulps 0x2927(%rip),%xmm3 # 62a0 <_sk_callback_sse2+0xcb9> DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 102,15,239,219 ; pxor %xmm3,%xmm3 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,48 ; je 39b1 <_sk_load_4444_sse2+0xad> + DB 116,48 ; je 39be <_sk_load_4444_sse2+0xad> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,21 ; je 399c <_sk_load_4444_sse2+0x98> + DB 116,21 ; je 39a9 <_sk_load_4444_sse2+0x98> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,139 ; jne 3918 <_sk_load_4444_sse2+0x14> + DB 117,139 ; jne 3925 <_sk_load_4444_sse2+0x14> DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3 @@ -22595,7 +22452,7 @@ _sk_load_4444_sse2 LABEL PROC DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax DB 102,15,110,192 ; movd %eax,%xmm0 DB 243,15,16,216 ; movss %xmm0,%xmm3 - DB 233,85,255,255,255 ; jmpq 3918 <_sk_load_4444_sse2+0x14> + DB 233,85,255,255,255 ; jmpq 3925 <_sk_load_4444_sse2+0x14> PUBLIC _sk_gather_4444_sse2 _sk_gather_4444_sse2 LABEL PROC @@ -22628,21 +22485,21 @@ _sk_gather_4444_sse2 LABEL PROC DB 102,15,196,216,3 ; pinsrw $0x3,%eax,%xmm3 DB 102,15,239,192 ; pxor %xmm0,%xmm0 DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3 - DB 102,15,111,5,71,40,0,0 ; movdqa 0x2847(%rip),%xmm0 # 6290 <_sk_callback_sse2+0xcb6> + DB 102,15,111,5,90,40,0,0 ; movdqa 0x285a(%rip),%xmm0 # 62b0 <_sk_callback_sse2+0xcc9> DB 102,15,219,195 ; pand %xmm3,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 15,89,5,73,40,0,0 ; mulps 0x2849(%rip),%xmm0 # 62a0 <_sk_callback_sse2+0xcc6> - DB 102,15,111,13,81,40,0,0 ; movdqa 0x2851(%rip),%xmm1 # 62b0 <_sk_callback_sse2+0xcd6> + DB 15,89,5,92,40,0,0 ; mulps 0x285c(%rip),%xmm0 # 62c0 <_sk_callback_sse2+0xcd9> + DB 102,15,111,13,100,40,0,0 ; movdqa 0x2864(%rip),%xmm1 # 62d0 <_sk_callback_sse2+0xce9> DB 102,15,219,203 ; pand %xmm3,%xmm1 DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1 - DB 15,89,13,83,40,0,0 ; mulps 0x2853(%rip),%xmm1 # 62c0 <_sk_callback_sse2+0xce6> - DB 102,15,111,21,91,40,0,0 ; movdqa 0x285b(%rip),%xmm2 # 62d0 <_sk_callback_sse2+0xcf6> + DB 15,89,13,102,40,0,0 ; mulps 0x2866(%rip),%xmm1 # 62e0 <_sk_callback_sse2+0xcf9> + DB 102,15,111,21,110,40,0,0 ; movdqa 0x286e(%rip),%xmm2 # 62f0 <_sk_callback_sse2+0xd09> DB 102,15,219,211 ; pand %xmm3,%xmm2 DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 - DB 15,89,21,93,40,0,0 ; mulps 0x285d(%rip),%xmm2 # 62e0 <_sk_callback_sse2+0xd06> - DB 102,15,219,29,101,40,0,0 ; pand 0x2865(%rip),%xmm3 # 62f0 <_sk_callback_sse2+0xd16> + DB 15,89,21,112,40,0,0 ; mulps 0x2870(%rip),%xmm2 # 6300 <_sk_callback_sse2+0xd19> + DB 102,15,219,29,120,40,0,0 ; pand 0x2878(%rip),%xmm3 # 6310 <_sk_callback_sse2+0xd29> DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3 - DB 15,89,29,107,40,0,0 ; mulps 0x286b(%rip),%xmm3 # 6300 <_sk_callback_sse2+0xd26> + DB 15,89,29,126,40,0,0 ; mulps 0x287e(%rip),%xmm3 # 6320 <_sk_callback_sse2+0xd39> DB 72,173 ; lods %ds:(%rsi),%rax DB 91 ; pop %rbx DB 255,224 ; jmpq *%rax @@ -22651,7 +22508,7 @@ PUBLIC _sk_store_4444_sse2 _sk_store_4444_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,16 ; mov (%rax),%r10 - DB 68,15,40,5,105,40,0,0 ; movaps 0x2869(%rip),%xmm8 # 6310 <_sk_callback_sse2+0xd36> + DB 68,15,40,5,124,40,0,0 ; movaps 0x287c(%rip),%xmm8 # 6330 <_sk_callback_sse2+0xd49> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 @@ -22673,7 +22530,7 @@ _sk_store_4444_sse2 LABEL PROC DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8 DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3b18 <_sk_store_4444_sse2+0x7e> + DB 117,10 ; jne 3b25 <_sk_store_4444_sse2+0x7e> DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -22681,31 +22538,31 @@ _sk_store_4444_sse2 LABEL PROC DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,36 ; je 3b4e <_sk_store_4444_sse2+0xb4> + DB 116,36 ; je 3b5b <_sk_store_4444_sse2+0xb4> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,18 ; je 3b42 <_sk_store_4444_sse2+0xa8> + DB 116,18 ; je 3b4f <_sk_store_4444_sse2+0xa8> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,222 ; jne 3b14 <_sk_store_4444_sse2+0x7a> + DB 117,222 ; jne 3b21 <_sk_store_4444_sse2+0x7a> DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2) DB 102,65,15,197,192,2 ; pextrw $0x2,%xmm8,%eax DB 102,65,137,68,82,2 ; mov %ax,0x2(%r10,%rdx,2) DB 102,68,15,126,192 ; movd %xmm8,%eax DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2) - DB 235,186 ; jmp 3b14 <_sk_store_4444_sse2+0x7a> + DB 235,186 ; jmp 3b21 <_sk_store_4444_sse2+0x7a> PUBLIC _sk_load_8888_sse2 _sk_load_8888_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 117,98 ; jne 3bc6 <_sk_load_8888_sse2+0x6c> + DB 117,98 ; jne 3bd3 <_sk_load_8888_sse2+0x6c> DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9 - DB 102,15,111,21,174,39,0,0 ; movdqa 0x27ae(%rip),%xmm2 # 6320 <_sk_callback_sse2+0xd46> + DB 102,15,111,21,193,39,0,0 ; movdqa 0x27c1(%rip),%xmm2 # 6340 <_sk_callback_sse2+0xd59> DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0 DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,170,39,0,0 ; movaps 0x27aa(%rip),%xmm8 # 6330 <_sk_callback_sse2+0xd56> + DB 68,15,40,5,189,39,0,0 ; movaps 0x27bd(%rip),%xmm8 # 6350 <_sk_callback_sse2+0xd69> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1 DB 102,15,114,209,8 ; psrld $0x8,%xmm1 @@ -22726,11 +22583,11 @@ _sk_load_8888_sse2 LABEL PROC DB 65,128,225,3 ; and $0x3,%r9b DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,44 ; je 3c04 <_sk_load_8888_sse2+0xaa> + DB 116,44 ; je 3c11 <_sk_load_8888_sse2+0xaa> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,18 ; je 3bf0 <_sk_load_8888_sse2+0x96> + DB 116,18 ; je 3bfd <_sk_load_8888_sse2+0x96> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,134 ; jne 3b6a <_sk_load_8888_sse2+0x10> + DB 117,134 ; jne 3b77 <_sk_load_8888_sse2+0x10> DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0 DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9 DB 243,15,16,68,144,4 ; movss 0x4(%rax,%rdx,4),%xmm0 @@ -22739,7 +22596,7 @@ _sk_load_8888_sse2 LABEL PROC DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 243,15,16,4,144 ; movss (%rax,%rdx,4),%xmm0 DB 243,68,15,16,200 ; movss %xmm0,%xmm9 - DB 233,87,255,255,255 ; jmpq 3b6a <_sk_load_8888_sse2+0x10> + DB 233,87,255,255,255 ; jmpq 3b77 <_sk_load_8888_sse2+0x10> PUBLIC _sk_gather_8888_sse2 _sk_gather_8888_sse2 LABEL PROC @@ -22771,11 +22628,11 @@ _sk_gather_8888_sse2 LABEL PROC DB 102,67,15,110,12,145 ; movd (%r9,%r10,4),%xmm1 DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9 DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9 - DB 102,15,111,21,171,38,0,0 ; movdqa 0x26ab(%rip),%xmm2 # 6340 <_sk_callback_sse2+0xd66> + DB 102,15,111,21,190,38,0,0 ; movdqa 0x26be(%rip),%xmm2 # 6360 <_sk_callback_sse2+0xd79> DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0 DB 102,15,219,194 ; pand %xmm2,%xmm0 DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0 - DB 68,15,40,5,167,38,0,0 ; movaps 0x26a7(%rip),%xmm8 # 6350 <_sk_callback_sse2+0xd76> + DB 68,15,40,5,186,38,0,0 ; movaps 0x26ba(%rip),%xmm8 # 6370 <_sk_callback_sse2+0xd89> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1 DB 102,15,114,209,8 ; psrld $0x8,%xmm1 @@ -22798,7 +22655,7 @@ PUBLIC _sk_store_8888_sse2 _sk_store_8888_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 68,15,40,5,105,38,0,0 ; movaps 0x2669(%rip),%xmm8 # 6360 <_sk_callback_sse2+0xd86> + DB 68,15,40,5,124,38,0,0 ; movaps 0x267c(%rip),%xmm8 # 6380 <_sk_callback_sse2+0xd99> DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9 @@ -22817,31 +22674,31 @@ _sk_store_8888_sse2 LABEL PROC DB 102,69,15,235,193 ; por %xmm9,%xmm8 DB 102,69,15,235,194 ; por %xmm10,%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,10 ; jne 3d57 <_sk_store_8888_sse2+0x6d> + DB 117,10 ; jne 3d64 <_sk_store_8888_sse2+0x6d> DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,3 ; and $0x3,%r9b DB 65,128,249,1 ; cmp $0x1,%r9b - DB 116,38 ; je 3d8a <_sk_store_8888_sse2+0xa0> + DB 116,38 ; je 3d97 <_sk_store_8888_sse2+0xa0> DB 65,128,249,2 ; cmp $0x2,%r9b - DB 116,19 ; je 3d7d <_sk_store_8888_sse2+0x93> + DB 116,19 ; je 3d8a <_sk_store_8888_sse2+0x93> DB 65,128,249,3 ; cmp $0x3,%r9b - DB 117,227 ; jne 3d53 <_sk_store_8888_sse2+0x69> + DB 117,227 ; jne 3d60 <_sk_store_8888_sse2+0x69> DB 102,69,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm9 DB 102,68,15,126,76,144,8 ; movd %xmm9,0x8(%rax,%rdx,4) DB 102,69,15,112,200,229 ; pshufd $0xe5,%xmm8,%xmm9 DB 102,68,15,126,76,144,4 ; movd %xmm9,0x4(%rax,%rdx,4) DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4) - DB 235,193 ; jmp 3d53 <_sk_store_8888_sse2+0x69> + DB 235,193 ; jmp 3d60 <_sk_store_8888_sse2+0x69> PUBLIC _sk_load_f16_sse2 _sk_load_f16_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,96,1,0,0 ; jne 3f00 <_sk_load_f16_sse2+0x16e> + DB 15,133,96,1,0,0 ; jne 3f0d <_sk_load_f16_sse2+0x16e> DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0 DB 102,15,16,76,208,16 ; movupd 0x10(%rax,%rdx,8),%xmm1 DB 102,68,15,40,192 ; movapd %xmm0,%xmm8 @@ -22853,7 +22710,7 @@ _sk_load_f16_sse2 LABEL PROC DB 102,69,15,239,210 ; pxor %xmm10,%xmm10 DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1 DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1 - DB 102,68,15,111,13,144,37,0,0 ; movdqa 0x2590(%rip),%xmm9 # 6370 <_sk_callback_sse2+0xd96> + DB 102,68,15,111,13,163,37,0,0 ; movdqa 0x25a3(%rip),%xmm9 # 6390 <_sk_callback_sse2+0xda9> DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,65,15,219,193 ; pand %xmm9,%xmm0 DB 102,15,239,200 ; pxor %xmm0,%xmm1 @@ -22861,11 +22718,11 @@ _sk_load_f16_sse2 LABEL PROC DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13 DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13 DB 102,68,15,235,232 ; por %xmm0,%xmm13 - DB 102,68,15,111,29,117,37,0,0 ; movdqa 0x2575(%rip),%xmm11 # 6380 <_sk_callback_sse2+0xda6> + DB 102,68,15,111,29,136,37,0,0 ; movdqa 0x2588(%rip),%xmm11 # 63a0 <_sk_callback_sse2+0xdb9> DB 102,69,15,254,235 ; paddd %xmm11,%xmm13 - DB 102,68,15,111,37,119,37,0,0 ; movdqa 0x2577(%rip),%xmm12 # 6390 <_sk_callback_sse2+0xdb6> + DB 102,68,15,111,37,138,37,0,0 ; movdqa 0x258a(%rip),%xmm12 # 63b0 <_sk_callback_sse2+0xdc9> DB 102,65,15,239,204 ; pxor %xmm12,%xmm1 - DB 102,15,111,29,122,37,0,0 ; movdqa 0x257a(%rip),%xmm3 # 63a0 <_sk_callback_sse2+0xdc6> + DB 102,15,111,29,141,37,0,0 ; movdqa 0x258d(%rip),%xmm3 # 63c0 <_sk_callback_sse2+0xdd9> DB 102,15,111,195 ; movdqa %xmm3,%xmm0 DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0 DB 102,65,15,223,197 ; pandn %xmm13,%xmm0 @@ -22913,17 +22770,17 @@ _sk_load_f16_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,17 ; jne 3f1c <_sk_load_f16_sse2+0x18a> + DB 117,17 ; jne 3f29 <_sk_load_f16_sse2+0x18a> DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 - DB 233,143,254,255,255 ; jmpq 3dab <_sk_load_f16_sse2+0x19> + DB 233,143,254,255,255 ; jmpq 3db8 <_sk_load_f16_sse2+0x19> DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,123,254,255,255 ; jb 3dab <_sk_load_f16_sse2+0x19> + DB 15,130,123,254,255,255 ; jb 3db8 <_sk_load_f16_sse2+0x19> DB 242,15,16,76,208,16 ; movsd 0x10(%rax,%rdx,8),%xmm1 - DB 233,112,254,255,255 ; jmpq 3dab <_sk_load_f16_sse2+0x19> + DB 233,112,254,255,255 ; jmpq 3db8 <_sk_load_f16_sse2+0x19> PUBLIC _sk_gather_f16_sse2 _sk_gather_f16_sse2 LABEL PROC @@ -22963,7 +22820,7 @@ _sk_gather_f16_sse2 LABEL PROC DB 102,69,15,239,210 ; pxor %xmm10,%xmm10 DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1 DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1 - DB 102,68,15,111,13,204,35,0,0 ; movdqa 0x23cc(%rip),%xmm9 # 63b0 <_sk_callback_sse2+0xdd6> + DB 102,68,15,111,13,223,35,0,0 ; movdqa 0x23df(%rip),%xmm9 # 63d0 <_sk_callback_sse2+0xde9> DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,65,15,219,193 ; pand %xmm9,%xmm0 DB 102,15,239,200 ; pxor %xmm0,%xmm1 @@ -22971,11 +22828,11 @@ _sk_gather_f16_sse2 LABEL PROC DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13 DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13 DB 102,68,15,235,232 ; por %xmm0,%xmm13 - DB 102,68,15,111,29,177,35,0,0 ; movdqa 0x23b1(%rip),%xmm11 # 63c0 <_sk_callback_sse2+0xde6> + DB 102,68,15,111,29,196,35,0,0 ; movdqa 0x23c4(%rip),%xmm11 # 63e0 <_sk_callback_sse2+0xdf9> DB 102,69,15,254,235 ; paddd %xmm11,%xmm13 - DB 102,68,15,111,37,179,35,0,0 ; movdqa 0x23b3(%rip),%xmm12 # 63d0 <_sk_callback_sse2+0xdf6> + DB 102,68,15,111,37,198,35,0,0 ; movdqa 0x23c6(%rip),%xmm12 # 63f0 <_sk_callback_sse2+0xe09> DB 102,65,15,239,204 ; pxor %xmm12,%xmm1 - DB 102,15,111,29,182,35,0,0 ; movdqa 0x23b6(%rip),%xmm3 # 63e0 <_sk_callback_sse2+0xe06> + DB 102,15,111,29,201,35,0,0 ; movdqa 0x23c9(%rip),%xmm3 # 6400 <_sk_callback_sse2+0xe19> DB 102,15,111,195 ; movdqa %xmm3,%xmm0 DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0 DB 102,65,15,223,197 ; pandn %xmm13,%xmm0 @@ -23027,17 +22884,17 @@ PUBLIC _sk_store_f16_sse2 _sk_store_f16_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 72,139,0 ; mov (%rax),%rax - DB 102,68,15,111,21,221,34,0,0 ; movdqa 0x22dd(%rip),%xmm10 # 63f0 <_sk_callback_sse2+0xe16> + DB 102,68,15,111,21,240,34,0,0 ; movdqa 0x22f0(%rip),%xmm10 # 6410 <_sk_callback_sse2+0xe29> DB 102,68,15,111,224 ; movdqa %xmm0,%xmm12 DB 102,69,15,219,226 ; pand %xmm10,%xmm12 DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13 DB 102,69,15,239,236 ; pxor %xmm12,%xmm13 - DB 102,68,15,111,13,208,34,0,0 ; movdqa 0x22d0(%rip),%xmm9 # 6400 <_sk_callback_sse2+0xe26> + DB 102,68,15,111,13,227,34,0,0 ; movdqa 0x22e3(%rip),%xmm9 # 6420 <_sk_callback_sse2+0xe39> DB 102,65,15,114,212,16 ; psrld $0x10,%xmm12 DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8 DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8 DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13 - DB 102,68,15,111,29,193,34,0,0 ; movdqa 0x22c1(%rip),%xmm11 # 6410 <_sk_callback_sse2+0xe36> + DB 102,68,15,111,29,212,34,0,0 ; movdqa 0x22d4(%rip),%xmm11 # 6430 <_sk_callback_sse2+0xe49> DB 102,69,15,235,227 ; por %xmm11,%xmm12 DB 102,69,15,254,229 ; paddd %xmm13,%xmm12 DB 102,65,15,114,244,16 ; pslld $0x10,%xmm12 @@ -23089,7 +22946,7 @@ _sk_store_f16_sse2 LABEL PROC DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9 DB 102,69,15,98,204 ; punpckldq %xmm12,%xmm9 DB 77,133,192 ; test %r8,%r8 - DB 117,21 ; jne 4271 <_sk_store_f16_sse2+0x16c> + DB 117,21 ; jne 427e <_sk_store_f16_sse2+0x16c> DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8) DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8 DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8) @@ -23097,13 +22954,13 @@ _sk_store_f16_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 426d <_sk_store_f16_sse2+0x168> + DB 116,240 ; je 427a <_sk_store_f16_sse2+0x168> DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 426d <_sk_store_f16_sse2+0x168> + DB 114,227 ; jb 427a <_sk_store_f16_sse2+0x168> DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8 DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8) - DB 235,213 ; jmp 426d <_sk_store_f16_sse2+0x168> + DB 235,213 ; jmp 427a <_sk_store_f16_sse2+0x168> PUBLIC _sk_load_u16_be_sse2 _sk_load_u16_be_sse2 LABEL PROC @@ -23111,7 +22968,7 @@ _sk_load_u16_be_sse2 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,190,0,0,0 ; jne 436c <_sk_load_u16_be_sse2+0xd4> + DB 15,133,190,0,0,0 ; jne 4379 <_sk_load_u16_be_sse2+0xd4> DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0 DB 102,65,15,16,76,65,16 ; movupd 0x10(%r9,%rax,2),%xmm1 DB 102,15,40,208 ; movapd %xmm0,%xmm2 @@ -23128,7 +22985,7 @@ _sk_load_u16_be_sse2 LABEL PROC DB 102,69,15,239,201 ; pxor %xmm9,%xmm9 DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1 DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0 - DB 68,15,40,5,33,33,0,0 ; movaps 0x2121(%rip),%xmm8 # 6420 <_sk_callback_sse2+0xe46> + DB 68,15,40,5,52,33,0,0 ; movaps 0x2134(%rip),%xmm8 # 6440 <_sk_callback_sse2+0xe59> DB 65,15,89,192 ; mulps %xmm8,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 DB 102,15,113,241,8 ; psllw $0x8,%xmm1 @@ -23156,17 +23013,17 @@ _sk_load_u16_be_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,17 ; jne 4389 <_sk_load_u16_be_sse2+0xf1> + DB 117,17 ; jne 4396 <_sk_load_u16_be_sse2+0xf1> DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 - DB 233,50,255,255,255 ; jmpq 42bb <_sk_load_u16_be_sse2+0x23> + DB 233,50,255,255,255 ; jmpq 42c8 <_sk_load_u16_be_sse2+0x23> DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0 DB 102,15,87,201 ; xorpd %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 15,130,29,255,255,255 ; jb 42bb <_sk_load_u16_be_sse2+0x23> + DB 15,130,29,255,255,255 ; jb 42c8 <_sk_load_u16_be_sse2+0x23> DB 242,65,15,16,76,65,16 ; movsd 0x10(%r9,%rax,2),%xmm1 - DB 233,17,255,255,255 ; jmpq 42bb <_sk_load_u16_be_sse2+0x23> + DB 233,17,255,255,255 ; jmpq 42c8 <_sk_load_u16_be_sse2+0x23> PUBLIC _sk_load_rgb_u16_be_sse2 _sk_load_rgb_u16_be_sse2 LABEL PROC @@ -23174,7 +23031,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax DB 77,133,192 ; test %r8,%r8 - DB 15,133,175,0,0,0 ; jne 446b <_sk_load_rgb_u16_be_sse2+0xc1> + DB 15,133,175,0,0,0 ; jne 4478 <_sk_load_rgb_u16_be_sse2+0xc1> DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2 DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3 DB 102,15,115,219,4 ; psrldq $0x4,%xmm3 @@ -23195,7 +23052,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 102,65,15,97,200 ; punpcklwd %xmm8,%xmm1 DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0 - DB 68,15,40,13,16,32,0,0 ; movaps 0x2010(%rip),%xmm9 # 6430 <_sk_callback_sse2+0xe56> + DB 68,15,40,13,35,32,0,0 ; movaps 0x2023(%rip),%xmm9 # 6450 <_sk_callback_sse2+0xe69> DB 65,15,89,193 ; mulps %xmm9,%xmm0 DB 102,15,111,203 ; movdqa %xmm3,%xmm1 DB 102,15,113,241,8 ; psllw $0x8,%xmm1 @@ -23212,34 +23069,34 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2 DB 65,15,89,209 ; mulps %xmm9,%xmm2 DB 72,173 ; lods %ds:(%rsi),%rax - DB 15,40,29,215,31,0,0 ; movaps 0x1fd7(%rip),%xmm3 # 6440 <_sk_callback_sse2+0xe66> + DB 15,40,29,234,31,0,0 ; movaps 0x1fea(%rip),%xmm3 # 6460 <_sk_callback_sse2+0xe79> DB 255,224 ; jmpq *%rax DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2 DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,13 ; jne 4490 <_sk_load_rgb_u16_be_sse2+0xe6> + DB 117,13 ; jne 449d <_sk_load_rgb_u16_be_sse2+0xe6> DB 102,15,239,219 ; pxor %xmm3,%xmm3 DB 102,15,239,192 ; pxor %xmm0,%xmm0 - DB 233,80,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36> + DB 233,80,255,255,255 ; jmpq 43ed <_sk_load_rgb_u16_be_sse2+0x36> DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0 DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,24 ; jb 44c1 <_sk_load_rgb_u16_be_sse2+0x117> + DB 114,24 ; jb 44ce <_sk_load_rgb_u16_be_sse2+0x117> DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3 DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3 DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 233,31,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36> + DB 233,31,255,255,255 ; jmpq 43ed <_sk_load_rgb_u16_be_sse2+0x36> DB 102,15,239,219 ; pxor %xmm3,%xmm3 - DB 233,22,255,255,255 ; jmpq 43e0 <_sk_load_rgb_u16_be_sse2+0x36> + DB 233,22,255,255,255 ; jmpq 43ed <_sk_load_rgb_u16_be_sse2+0x36> PUBLIC _sk_store_u16_be_sse2 _sk_store_u16_be_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,8 ; mov (%rax),%r9 DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax - DB 68,15,40,21,113,31,0,0 ; movaps 0x1f71(%rip),%xmm10 # 6450 <_sk_callback_sse2+0xe76> + DB 68,15,40,21,132,31,0,0 ; movaps 0x1f84(%rip),%xmm10 # 6470 <_sk_callback_sse2+0xe89> DB 68,15,40,192 ; movaps %xmm0,%xmm8 DB 69,15,89,194 ; mulps %xmm10,%xmm8 DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8 @@ -23284,7 +23141,7 @@ _sk_store_u16_be_sse2 LABEL PROC DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10 DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10 DB 77,133,192 ; test %r8,%r8 - DB 117,21 ; jne 45d9 <_sk_store_u16_be_sse2+0x10f> + DB 117,21 ; jne 45e6 <_sk_store_u16_be_sse2+0x10f> DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2) DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8 DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2) @@ -23292,13 +23149,13 @@ _sk_store_u16_be_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2) DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,240 ; je 45d5 <_sk_store_u16_be_sse2+0x10b> + DB 116,240 ; je 45e2 <_sk_store_u16_be_sse2+0x10b> DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,227 ; jb 45d5 <_sk_store_u16_be_sse2+0x10b> + DB 114,227 ; jb 45e2 <_sk_store_u16_be_sse2+0x10b> DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8 DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2) - DB 235,213 ; jmp 45d5 <_sk_store_u16_be_sse2+0x10b> + DB 235,213 ; jmp 45e2 <_sk_store_u16_be_sse2+0x10b> PUBLIC _sk_load_f32_sse2 _sk_load_f32_sse2 LABEL PROC @@ -23309,7 +23166,7 @@ _sk_load_f32_sse2 LABEL PROC DB 72,193,224,4 ; shl $0x4,%rax DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 117,66 ; jne 4660 <_sk_load_f32_sse2+0x60> + DB 117,66 ; jne 466d <_sk_load_f32_sse2+0x60> DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0 DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3 DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9 @@ -23329,17 +23186,17 @@ _sk_load_f32_sse2 LABEL PROC DB 255,224 ; jmpq *%rax DB 69,15,87,201 ; xorps %xmm9,%xmm9 DB 73,131,248,1 ; cmp $0x1,%r8 - DB 117,8 ; jne 4672 <_sk_load_f32_sse2+0x72> + DB 117,8 ; jne 467f <_sk_load_f32_sse2+0x72> DB 15,87,219 ; xorps %xmm3,%xmm3 DB 15,87,192 ; xorps %xmm0,%xmm0 - DB 235,190 ; jmp 4630 <_sk_load_f32_sse2+0x30> + DB 235,190 ; jmp 463d <_sk_load_f32_sse2+0x30> DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0 DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,8 ; jb 4686 <_sk_load_f32_sse2+0x86> + DB 114,8 ; jb 4693 <_sk_load_f32_sse2+0x86> DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3 - DB 235,170 ; jmp 4630 <_sk_load_f32_sse2+0x30> + DB 235,170 ; jmp 463d <_sk_load_f32_sse2+0x30> DB 15,87,219 ; xorps %xmm3,%xmm3 - DB 235,165 ; jmp 4630 <_sk_load_f32_sse2+0x30> + DB 235,165 ; jmp 463d <_sk_load_f32_sse2+0x30> PUBLIC _sk_store_f32_sse2 _sk_store_f32_sse2 LABEL PROC @@ -23363,7 +23220,7 @@ _sk_store_f32_sse2 LABEL PROC DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9 DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1) DB 77,133,192 ; test %r8,%r8 - DB 117,29 ; jne 46fd <_sk_store_f32_sse2+0x72> + DB 117,29 ; jne 470a <_sk_store_f32_sse2+0x72> DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10 DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4) DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4) @@ -23371,12 +23228,12 @@ _sk_store_f32_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax DB 73,131,248,1 ; cmp $0x1,%r8 - DB 116,246 ; je 46f9 <_sk_store_f32_sse2+0x6e> + DB 116,246 ; je 4706 <_sk_store_f32_sse2+0x6e> DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4) DB 73,131,248,3 ; cmp $0x3,%r8 - DB 114,234 ; jb 46f9 <_sk_store_f32_sse2+0x6e> + DB 114,234 ; jb 4706 <_sk_store_f32_sse2+0x6e> DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4) - DB 235,225 ; jmp 46f9 <_sk_store_f32_sse2+0x6e> + DB 235,225 ; jmp 4706 <_sk_store_f32_sse2+0x6e> PUBLIC _sk_clamp_x_sse2 _sk_clamp_x_sse2 LABEL PROC @@ -23412,7 +23269,7 @@ _sk_repeat_x_sse2 LABEL PROC DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10 DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9 - DB 68,15,84,13,226,28,0,0 ; andps 0x1ce2(%rip),%xmm9 # 6460 <_sk_callback_sse2+0xe86> + DB 68,15,84,13,245,28,0,0 ; andps 0x1cf5(%rip),%xmm9 # 6480 <_sk_callback_sse2+0xe99> DB 69,15,92,209 ; subps %xmm9,%xmm10 DB 69,15,89,208 ; mulps %xmm8,%xmm10 DB 65,15,92,194 ; subps %xmm10,%xmm0 @@ -23429,7 +23286,7 @@ _sk_repeat_y_sse2 LABEL PROC DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10 DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9 - DB 68,15,84,13,184,28,0,0 ; andps 0x1cb8(%rip),%xmm9 # 6470 <_sk_callback_sse2+0xe96> + DB 68,15,84,13,203,28,0,0 ; andps 0x1ccb(%rip),%xmm9 # 6490 <_sk_callback_sse2+0xea9> DB 69,15,92,209 ; subps %xmm9,%xmm10 DB 69,15,89,208 ; mulps %xmm8,%xmm10 DB 65,15,92,202 ; subps %xmm10,%xmm1 @@ -23450,7 +23307,7 @@ _sk_mirror_x_sse2 LABEL PROC DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11 DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11 DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10 - DB 68,15,84,21,124,28,0,0 ; andps 0x1c7c(%rip),%xmm10 # 6480 <_sk_callback_sse2+0xea6> + DB 68,15,84,21,143,28,0,0 ; andps 0x1c8f(%rip),%xmm10 # 64a0 <_sk_callback_sse2+0xeb9> DB 69,15,87,228 ; xorps %xmm12,%xmm12 DB 69,15,92,218 ; subps %xmm10,%xmm11 DB 69,15,89,216 ; mulps %xmm8,%xmm11 @@ -23475,7 +23332,7 @@ _sk_mirror_y_sse2 LABEL PROC DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11 DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11 DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10 - DB 68,15,84,21,48,28,0,0 ; andps 0x1c30(%rip),%xmm10 # 6490 <_sk_callback_sse2+0xeb6> + DB 68,15,84,21,67,28,0,0 ; andps 0x1c43(%rip),%xmm10 # 64b0 <_sk_callback_sse2+0xec9> DB 69,15,87,228 ; xorps %xmm12,%xmm12 DB 69,15,92,218 ; subps %xmm10,%xmm11 DB 69,15,89,216 ; mulps %xmm8,%xmm11 @@ -23490,7 +23347,7 @@ PUBLIC _sk_clamp_x_1_sse2 _sk_clamp_x_1_sse2 LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 DB 68,15,95,192 ; maxps %xmm0,%xmm8 - DB 68,15,93,5,16,28,0,0 ; minps 0x1c10(%rip),%xmm8 # 64a0 <_sk_callback_sse2+0xec6> + DB 68,15,93,5,35,28,0,0 ; minps 0x1c23(%rip),%xmm8 # 64c0 <_sk_callback_sse2+0xed9> DB 72,173 ; lods %ds:(%rsi),%rax DB 65,15,40,192 ; movaps %xmm8,%xmm0 DB 255,224 ; jmpq *%rax @@ -23501,7 +23358,7 @@ _sk_repeat_x_1_sse2 LABEL PROC DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8 DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9 - DB 68,15,84,13,254,27,0,0 ; andps 0x1bfe(%rip),%xmm9 # 64b0 <_sk_callback_sse2+0xed6> + DB 68,15,84,13,17,28,0,0 ; andps 0x1c11(%rip),%xmm9 # 64d0 <_sk_callback_sse2+0xee9> DB 69,15,92,193 ; subps %xmm9,%xmm8 DB 65,15,92,192 ; subps %xmm8,%xmm0 DB 72,173 ; lods %ds:(%rsi),%rax @@ -23509,14 +23366,14 @@ _sk_repeat_x_1_sse2 LABEL PROC PUBLIC _sk_mirror_x_1_sse2 _sk_mirror_x_1_sse2 LABEL PROC - DB 68,15,40,5,250,27,0,0 ; movaps 0x1bfa(%rip),%xmm8 # 64c0 <_sk_callback_sse2+0xee6> + DB 68,15,40,5,13,28,0,0 ; movaps 0x1c0d(%rip),%xmm8 # 64e0 <_sk_callback_sse2+0xef9> DB 65,15,88,192 ; addps %xmm8,%xmm0 - DB 68,15,40,13,254,27,0,0 ; movaps 0x1bfe(%rip),%xmm9 # 64d0 <_sk_callback_sse2+0xef6> + DB 68,15,40,13,17,28,0,0 ; movaps 0x1c11(%rip),%xmm9 # 64f0 <_sk_callback_sse2+0xf09> DB 68,15,89,200 ; mulps %xmm0,%xmm9 DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10 DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9 - DB 68,15,84,13,244,27,0,0 ; andps 0x1bf4(%rip),%xmm9 # 64e0 <_sk_callback_sse2+0xf06> + DB 68,15,84,13,7,28,0,0 ; andps 0x1c07(%rip),%xmm9 # 6500 <_sk_callback_sse2+0xf19> DB 69,15,87,219 ; xorps %xmm11,%xmm11 DB 69,15,92,209 ; subps %xmm9,%xmm10 DB 69,15,88,210 ; addps %xmm10,%xmm10 @@ -23530,10 +23387,10 @@ _sk_mirror_x_1_sse2 LABEL PROC PUBLIC _sk_luminance_to_alpha_sse2 _sk_luminance_to_alpha_sse2 LABEL PROC DB 15,40,218 ; movaps %xmm2,%xmm3 - DB 15,89,5,218,27,0,0 ; mulps 0x1bda(%rip),%xmm0 # 64f0 <_sk_callback_sse2+0xf16> - DB 15,89,13,227,27,0,0 ; mulps 0x1be3(%rip),%xmm1 # 6500 <_sk_callback_sse2+0xf26> + DB 15,89,5,237,27,0,0 ; mulps 0x1bed(%rip),%xmm0 # 6510 <_sk_callback_sse2+0xf29> + DB 15,89,13,246,27,0,0 ; mulps 0x1bf6(%rip),%xmm1 # 6520 <_sk_callback_sse2+0xf39> DB 15,88,200 ; addps %xmm0,%xmm1 - DB 15,89,29,233,27,0,0 ; mulps 0x1be9(%rip),%xmm3 # 6510 <_sk_callback_sse2+0xf36> + DB 15,89,29,252,27,0,0 ; mulps 0x1bfc(%rip),%xmm3 # 6530 <_sk_callback_sse2+0xf49> DB 15,88,217 ; addps %xmm1,%xmm3 DB 72,173 ; lods %ds:(%rsi),%rax DB 15,87,192 ; xorps %xmm0,%xmm0 @@ -23799,9 +23656,9 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC DB 72,139,24 ; mov (%rax),%rbx DB 76,139,112,8 ; mov 0x8(%rax),%r14 DB 72,255,203 ; dec %rbx - DB 120,7 ; js 4d63 <_sk_evenly_spaced_gradient_sse2+0x18> + DB 120,7 ; js 4d70 <_sk_evenly_spaced_gradient_sse2+0x18> DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1 - DB 235,21 ; jmp 4d78 <_sk_evenly_spaced_gradient_sse2+0x2d> + DB 235,21 ; jmp 4d85 <_sk_evenly_spaced_gradient_sse2+0x2d> DB 73,137,217 ; mov %rbx,%r9 DB 73,209,233 ; shr %r9 DB 131,227,1 ; and $0x1,%ebx @@ -23897,15 +23754,15 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC PUBLIC _sk_gauss_a_to_rgba_sse2 _sk_gauss_a_to_rgba_sse2 LABEL PROC - DB 15,40,5,28,22,0,0 ; movaps 0x161c(%rip),%xmm0 # 6520 <_sk_callback_sse2+0xf46> + DB 15,40,5,47,22,0,0 ; movaps 0x162f(%rip),%xmm0 # 6540 <_sk_callback_sse2+0xf59> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,34,22,0,0 ; addps 0x1622(%rip),%xmm0 # 6530 <_sk_callback_sse2+0xf56> + DB 15,88,5,53,22,0,0 ; addps 0x1635(%rip),%xmm0 # 6550 <_sk_callback_sse2+0xf69> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,40,22,0,0 ; addps 0x1628(%rip),%xmm0 # 6540 <_sk_callback_sse2+0xf66> + DB 15,88,5,59,22,0,0 ; addps 0x163b(%rip),%xmm0 # 6560 <_sk_callback_sse2+0xf79> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,46,22,0,0 ; addps 0x162e(%rip),%xmm0 # 6550 <_sk_callback_sse2+0xf76> + DB 15,88,5,65,22,0,0 ; addps 0x1641(%rip),%xmm0 # 6570 <_sk_callback_sse2+0xf89> DB 15,89,195 ; mulps %xmm3,%xmm0 - DB 15,88,5,52,22,0,0 ; addps 0x1634(%rip),%xmm0 # 6560 <_sk_callback_sse2+0xf86> + DB 15,88,5,71,22,0,0 ; addps 0x1647(%rip),%xmm0 # 6580 <_sk_callback_sse2+0xf99> DB 72,173 ; lods %ds:(%rsi),%rax DB 15,40,200 ; movaps %xmm0,%xmm1 DB 15,40,208 ; movaps %xmm0,%xmm2 @@ -23921,12 +23778,12 @@ _sk_gradient_sse2 LABEL PROC DB 76,139,8 ; mov (%rax),%r9 DB 102,15,239,201 ; pxor %xmm1,%xmm1 DB 73,131,249,2 ; cmp $0x2,%r9 - DB 114,50 ; jb 4f7f <_sk_gradient_sse2+0x46> + DB 114,50 ; jb 4f8c <_sk_gradient_sse2+0x46> DB 72,139,88,72 ; mov 0x48(%rax),%rbx DB 73,255,201 ; dec %r9 DB 72,131,195,4 ; add $0x4,%rbx DB 102,15,239,201 ; pxor %xmm1,%xmm1 - DB 15,40,21,13,22,0,0 ; movaps 0x160d(%rip),%xmm2 # 6570 <_sk_callback_sse2+0xf96> + DB 15,40,21,32,22,0,0 ; movaps 0x1620(%rip),%xmm2 # 6590 <_sk_callback_sse2+0xfa9> DB 243,15,16,27 ; movss (%rbx),%xmm3 DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3 DB 15,194,216,2 ; cmpleps %xmm0,%xmm3 @@ -23934,7 +23791,7 @@ _sk_gradient_sse2 LABEL PROC DB 102,15,254,203 ; paddd %xmm3,%xmm1 DB 72,131,195,4 ; add $0x4,%rbx DB 73,255,201 ; dec %r9 - DB 117,228 ; jne 4f63 <_sk_gradient_sse2+0x2a> + DB 117,228 ; jne 4f70 <_sk_gradient_sse2+0x2a> DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2 DB 102,73,15,126,211 ; movq %xmm2,%r11 DB 69,137,217 ; mov %r11d,%r9d @@ -24069,29 +23926,29 @@ _sk_xy_to_unit_angle_sse2 LABEL PROC DB 69,15,94,220 ; divps %xmm12,%xmm11 DB 69,15,40,227 ; movaps %xmm11,%xmm12 DB 69,15,89,228 ; mulps %xmm12,%xmm12 - DB 68,15,40,45,206,19,0,0 ; movaps 0x13ce(%rip),%xmm13 # 6580 <_sk_callback_sse2+0xfa6> + DB 68,15,40,45,225,19,0,0 ; movaps 0x13e1(%rip),%xmm13 # 65a0 <_sk_callback_sse2+0xfb9> DB 69,15,89,236 ; mulps %xmm12,%xmm13 - DB 68,15,88,45,210,19,0,0 ; addps 0x13d2(%rip),%xmm13 # 6590 <_sk_callback_sse2+0xfb6> + DB 68,15,88,45,229,19,0,0 ; addps 0x13e5(%rip),%xmm13 # 65b0 <_sk_callback_sse2+0xfc9> DB 69,15,89,236 ; mulps %xmm12,%xmm13 - DB 68,15,88,45,214,19,0,0 ; addps 0x13d6(%rip),%xmm13 # 65a0 <_sk_callback_sse2+0xfc6> + DB 68,15,88,45,233,19,0,0 ; addps 0x13e9(%rip),%xmm13 # 65c0 <_sk_callback_sse2+0xfd9> DB 69,15,89,236 ; mulps %xmm12,%xmm13 - DB 68,15,88,45,218,19,0,0 ; addps 0x13da(%rip),%xmm13 # 65b0 <_sk_callback_sse2+0xfd6> + DB 68,15,88,45,237,19,0,0 ; addps 0x13ed(%rip),%xmm13 # 65d0 <_sk_callback_sse2+0xfe9> DB 69,15,89,235 ; mulps %xmm11,%xmm13 DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9 - DB 68,15,40,21,217,19,0,0 ; movaps 0x13d9(%rip),%xmm10 # 65c0 <_sk_callback_sse2+0xfe6> + DB 68,15,40,21,236,19,0,0 ; movaps 0x13ec(%rip),%xmm10 # 65e0 <_sk_callback_sse2+0xff9> DB 69,15,92,213 ; subps %xmm13,%xmm10 DB 69,15,84,209 ; andps %xmm9,%xmm10 DB 69,15,85,205 ; andnps %xmm13,%xmm9 DB 69,15,86,202 ; orps %xmm10,%xmm9 DB 68,15,194,192,1 ; cmpltps %xmm0,%xmm8 - DB 68,15,40,21,204,19,0,0 ; movaps 0x13cc(%rip),%xmm10 # 65d0 <_sk_callback_sse2+0xff6> + DB 68,15,40,21,223,19,0,0 ; movaps 0x13df(%rip),%xmm10 # 65f0 <_sk_callback_sse2+0x1009> DB 69,15,92,209 ; subps %xmm9,%xmm10 DB 69,15,84,208 ; andps %xmm8,%xmm10 DB 69,15,85,193 ; andnps %xmm9,%xmm8 DB 69,15,86,194 ; orps %xmm10,%xmm8 DB 68,15,40,201 ; movaps %xmm1,%xmm9 DB 68,15,194,200,1 ; cmpltps %xmm0,%xmm9 - DB 68,15,40,21,187,19,0,0 ; movaps 0x13bb(%rip),%xmm10 # 65e0 <_sk_callback_sse2+0x1006> + DB 68,15,40,21,206,19,0,0 ; movaps 0x13ce(%rip),%xmm10 # 6600 <_sk_callback_sse2+0x1019> DB 69,15,92,208 ; subps %xmm8,%xmm10 DB 69,15,84,209 ; andps %xmm9,%xmm10 DB 69,15,85,200 ; andnps %xmm8,%xmm9 @@ -24114,7 +23971,7 @@ _sk_xy_to_radius_sse2 LABEL PROC PUBLIC _sk_save_xy_sse2 _sk_save_xy_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,141,19,0,0 ; movaps 0x138d(%rip),%xmm8 # 65f0 <_sk_callback_sse2+0x1016> + DB 68,15,40,5,160,19,0,0 ; movaps 0x13a0(%rip),%xmm8 # 6610 <_sk_callback_sse2+0x1029> DB 15,17,0 ; movups %xmm0,(%rax) DB 68,15,40,200 ; movaps %xmm0,%xmm9 DB 69,15,88,200 ; addps %xmm8,%xmm9 @@ -24122,7 +23979,7 @@ _sk_save_xy_sse2 LABEL PROC DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10 DB 69,15,40,217 ; movaps %xmm9,%xmm11 DB 69,15,194,218,1 ; cmpltps %xmm10,%xmm11 - DB 68,15,40,37,120,19,0,0 ; movaps 0x1378(%rip),%xmm12 # 6600 <_sk_callback_sse2+0x1026> + DB 68,15,40,37,139,19,0,0 ; movaps 0x138b(%rip),%xmm12 # 6620 <_sk_callback_sse2+0x1039> DB 69,15,84,220 ; andps %xmm12,%xmm11 DB 69,15,92,211 ; subps %xmm11,%xmm10 DB 69,15,92,202 ; subps %xmm10,%xmm9 @@ -24165,8 +24022,8 @@ _sk_bilinear_nx_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,241,18,0,0 ; addps 0x12f1(%rip),%xmm0 # 6610 <_sk_callback_sse2+0x1036> - DB 68,15,40,13,249,18,0,0 ; movaps 0x12f9(%rip),%xmm9 # 6620 <_sk_callback_sse2+0x1046> + DB 15,88,5,4,19,0,0 ; addps 0x1304(%rip),%xmm0 # 6630 <_sk_callback_sse2+0x1049> + DB 68,15,40,13,12,19,0,0 ; movaps 0x130c(%rip),%xmm9 # 6640 <_sk_callback_sse2+0x1059> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24177,7 +24034,7 @@ _sk_bilinear_px_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,232,18,0,0 ; addps 0x12e8(%rip),%xmm0 # 6630 <_sk_callback_sse2+0x1056> + DB 15,88,5,251,18,0,0 ; addps 0x12fb(%rip),%xmm0 # 6650 <_sk_callback_sse2+0x1069> DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24187,8 +24044,8 @@ _sk_bilinear_ny_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,218,18,0,0 ; addps 0x12da(%rip),%xmm1 # 6640 <_sk_callback_sse2+0x1066> - DB 68,15,40,13,226,18,0,0 ; movaps 0x12e2(%rip),%xmm9 # 6650 <_sk_callback_sse2+0x1076> + DB 15,88,13,237,18,0,0 ; addps 0x12ed(%rip),%xmm1 # 6660 <_sk_callback_sse2+0x1079> + DB 68,15,40,13,245,18,0,0 ; movaps 0x12f5(%rip),%xmm9 # 6670 <_sk_callback_sse2+0x1089> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24199,7 +24056,7 @@ _sk_bilinear_py_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,208,18,0,0 ; addps 0x12d0(%rip),%xmm1 # 6660 <_sk_callback_sse2+0x1086> + DB 15,88,13,227,18,0,0 ; addps 0x12e3(%rip),%xmm1 # 6680 <_sk_callback_sse2+0x1099> DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24209,13 +24066,13 @@ _sk_bicubic_n3x_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm0 # 6670 <_sk_callback_sse2+0x1096> - DB 68,15,40,13,203,18,0,0 ; movaps 0x12cb(%rip),%xmm9 # 6680 <_sk_callback_sse2+0x10a6> + DB 15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm0 # 6690 <_sk_callback_sse2+0x10a9> + DB 68,15,40,13,222,18,0,0 ; movaps 0x12de(%rip),%xmm9 # 66a0 <_sk_callback_sse2+0x10b9> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 69,15,40,193 ; movaps %xmm9,%xmm8 DB 69,15,89,192 ; mulps %xmm8,%xmm8 - DB 68,15,89,13,199,18,0,0 ; mulps 0x12c7(%rip),%xmm9 # 6690 <_sk_callback_sse2+0x10b6> - DB 68,15,88,13,207,18,0,0 ; addps 0x12cf(%rip),%xmm9 # 66a0 <_sk_callback_sse2+0x10c6> + DB 68,15,89,13,218,18,0,0 ; mulps 0x12da(%rip),%xmm9 # 66b0 <_sk_callback_sse2+0x10c9> + DB 68,15,88,13,226,18,0,0 ; addps 0x12e2(%rip),%xmm9 # 66c0 <_sk_callback_sse2+0x10d9> DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24226,16 +24083,16 @@ _sk_bicubic_n1x_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,190,18,0,0 ; addps 0x12be(%rip),%xmm0 # 66b0 <_sk_callback_sse2+0x10d6> - DB 68,15,40,13,198,18,0,0 ; movaps 0x12c6(%rip),%xmm9 # 66c0 <_sk_callback_sse2+0x10e6> + DB 15,88,5,209,18,0,0 ; addps 0x12d1(%rip),%xmm0 # 66d0 <_sk_callback_sse2+0x10e9> + DB 68,15,40,13,217,18,0,0 ; movaps 0x12d9(%rip),%xmm9 # 66e0 <_sk_callback_sse2+0x10f9> DB 69,15,92,200 ; subps %xmm8,%xmm9 - DB 68,15,40,5,202,18,0,0 ; movaps 0x12ca(%rip),%xmm8 # 66d0 <_sk_callback_sse2+0x10f6> + DB 68,15,40,5,221,18,0,0 ; movaps 0x12dd(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x1109> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,206,18,0,0 ; addps 0x12ce(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x1106> + DB 68,15,88,5,225,18,0,0 ; addps 0x12e1(%rip),%xmm8 # 6700 <_sk_callback_sse2+0x1119> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,210,18,0,0 ; addps 0x12d2(%rip),%xmm8 # 66f0 <_sk_callback_sse2+0x1116> + DB 68,15,88,5,229,18,0,0 ; addps 0x12e5(%rip),%xmm8 # 6710 <_sk_callback_sse2+0x1129> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm8 # 6700 <_sk_callback_sse2+0x1126> + DB 68,15,88,5,233,18,0,0 ; addps 0x12e9(%rip),%xmm8 # 6720 <_sk_callback_sse2+0x1139> DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24243,17 +24100,17 @@ _sk_bicubic_n1x_sse2 LABEL PROC PUBLIC _sk_bicubic_p1x_sse2 _sk_bicubic_p1x_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,208,18,0,0 ; movaps 0x12d0(%rip),%xmm8 # 6710 <_sk_callback_sse2+0x1136> + DB 68,15,40,5,227,18,0,0 ; movaps 0x12e3(%rip),%xmm8 # 6730 <_sk_callback_sse2+0x1149> DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9 DB 65,15,88,192 ; addps %xmm8,%xmm0 - DB 68,15,40,21,204,18,0,0 ; movaps 0x12cc(%rip),%xmm10 # 6720 <_sk_callback_sse2+0x1146> + DB 68,15,40,21,223,18,0,0 ; movaps 0x12df(%rip),%xmm10 # 6740 <_sk_callback_sse2+0x1159> DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,208,18,0,0 ; addps 0x12d0(%rip),%xmm10 # 6730 <_sk_callback_sse2+0x1156> + DB 68,15,88,21,227,18,0,0 ; addps 0x12e3(%rip),%xmm10 # 6750 <_sk_callback_sse2+0x1169> DB 69,15,89,209 ; mulps %xmm9,%xmm10 DB 69,15,88,208 ; addps %xmm8,%xmm10 DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,204,18,0,0 ; addps 0x12cc(%rip),%xmm10 # 6740 <_sk_callback_sse2+0x1166> + DB 68,15,88,21,223,18,0,0 ; addps 0x12df(%rip),%xmm10 # 6760 <_sk_callback_sse2+0x1179> DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24263,11 +24120,11 @@ _sk_bicubic_p3x_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,0 ; movups (%rax),%xmm0 DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8 - DB 15,88,5,191,18,0,0 ; addps 0x12bf(%rip),%xmm0 # 6750 <_sk_callback_sse2+0x1176> + DB 15,88,5,210,18,0,0 ; addps 0x12d2(%rip),%xmm0 # 6770 <_sk_callback_sse2+0x1189> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 69,15,89,201 ; mulps %xmm9,%xmm9 - DB 68,15,89,5,191,18,0,0 ; mulps 0x12bf(%rip),%xmm8 # 6760 <_sk_callback_sse2+0x1186> - DB 68,15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x1196> + DB 68,15,89,5,210,18,0,0 ; mulps 0x12d2(%rip),%xmm8 # 6780 <_sk_callback_sse2+0x1199> + DB 68,15,88,5,218,18,0,0 ; addps 0x12da(%rip),%xmm8 # 6790 <_sk_callback_sse2+0x11a9> DB 69,15,89,193 ; mulps %xmm9,%xmm8 DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24278,13 +24135,13 @@ _sk_bicubic_n3y_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,181,18,0,0 ; addps 0x12b5(%rip),%xmm1 # 6780 <_sk_callback_sse2+0x11a6> - DB 68,15,40,13,189,18,0,0 ; movaps 0x12bd(%rip),%xmm9 # 6790 <_sk_callback_sse2+0x11b6> + DB 15,88,13,200,18,0,0 ; addps 0x12c8(%rip),%xmm1 # 67a0 <_sk_callback_sse2+0x11b9> + DB 68,15,40,13,208,18,0,0 ; movaps 0x12d0(%rip),%xmm9 # 67b0 <_sk_callback_sse2+0x11c9> DB 69,15,92,200 ; subps %xmm8,%xmm9 DB 69,15,40,193 ; movaps %xmm9,%xmm8 DB 69,15,89,192 ; mulps %xmm8,%xmm8 - DB 68,15,89,13,185,18,0,0 ; mulps 0x12b9(%rip),%xmm9 # 67a0 <_sk_callback_sse2+0x11c6> - DB 68,15,88,13,193,18,0,0 ; addps 0x12c1(%rip),%xmm9 # 67b0 <_sk_callback_sse2+0x11d6> + DB 68,15,89,13,204,18,0,0 ; mulps 0x12cc(%rip),%xmm9 # 67c0 <_sk_callback_sse2+0x11d9> + DB 68,15,88,13,212,18,0,0 ; addps 0x12d4(%rip),%xmm9 # 67d0 <_sk_callback_sse2+0x11e9> DB 69,15,89,200 ; mulps %xmm8,%xmm9 DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24295,16 +24152,16 @@ _sk_bicubic_n1y_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,175,18,0,0 ; addps 0x12af(%rip),%xmm1 # 67c0 <_sk_callback_sse2+0x11e6> - DB 68,15,40,13,183,18,0,0 ; movaps 0x12b7(%rip),%xmm9 # 67d0 <_sk_callback_sse2+0x11f6> + DB 15,88,13,194,18,0,0 ; addps 0x12c2(%rip),%xmm1 # 67e0 <_sk_callback_sse2+0x11f9> + DB 68,15,40,13,202,18,0,0 ; movaps 0x12ca(%rip),%xmm9 # 67f0 <_sk_callback_sse2+0x1209> DB 69,15,92,200 ; subps %xmm8,%xmm9 - DB 68,15,40,5,187,18,0,0 ; movaps 0x12bb(%rip),%xmm8 # 67e0 <_sk_callback_sse2+0x1206> + DB 68,15,40,5,206,18,0,0 ; movaps 0x12ce(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x1219> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,191,18,0,0 ; addps 0x12bf(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x1216> + DB 68,15,88,5,210,18,0,0 ; addps 0x12d2(%rip),%xmm8 # 6810 <_sk_callback_sse2+0x1229> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,195,18,0,0 ; addps 0x12c3(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x1226> + DB 68,15,88,5,214,18,0,0 ; addps 0x12d6(%rip),%xmm8 # 6820 <_sk_callback_sse2+0x1239> DB 69,15,89,193 ; mulps %xmm9,%xmm8 - DB 68,15,88,5,199,18,0,0 ; addps 0x12c7(%rip),%xmm8 # 6810 <_sk_callback_sse2+0x1236> + DB 68,15,88,5,218,18,0,0 ; addps 0x12da(%rip),%xmm8 # 6830 <_sk_callback_sse2+0x1249> DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24312,17 +24169,17 @@ _sk_bicubic_n1y_sse2 LABEL PROC PUBLIC _sk_bicubic_p1y_sse2 _sk_bicubic_p1y_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 68,15,40,5,193,18,0,0 ; movaps 0x12c1(%rip),%xmm8 # 6820 <_sk_callback_sse2+0x1246> + DB 68,15,40,5,212,18,0,0 ; movaps 0x12d4(%rip),%xmm8 # 6840 <_sk_callback_sse2+0x1259> DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9 DB 65,15,88,200 ; addps %xmm8,%xmm1 - DB 68,15,40,21,188,18,0,0 ; movaps 0x12bc(%rip),%xmm10 # 6830 <_sk_callback_sse2+0x1256> + DB 68,15,40,21,207,18,0,0 ; movaps 0x12cf(%rip),%xmm10 # 6850 <_sk_callback_sse2+0x1269> DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,192,18,0,0 ; addps 0x12c0(%rip),%xmm10 # 6840 <_sk_callback_sse2+0x1266> + DB 68,15,88,21,211,18,0,0 ; addps 0x12d3(%rip),%xmm10 # 6860 <_sk_callback_sse2+0x1279> DB 69,15,89,209 ; mulps %xmm9,%xmm10 DB 69,15,88,208 ; addps %xmm8,%xmm10 DB 69,15,89,209 ; mulps %xmm9,%xmm10 - DB 68,15,88,21,188,18,0,0 ; addps 0x12bc(%rip),%xmm10 # 6850 <_sk_callback_sse2+0x1276> + DB 68,15,88,21,207,18,0,0 ; addps 0x12cf(%rip),%xmm10 # 6870 <_sk_callback_sse2+0x1289> DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax DB 255,224 ; jmpq *%rax @@ -24332,11 +24189,11 @@ _sk_bicubic_p3y_sse2 LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 15,16,72,32 ; movups 0x20(%rax),%xmm1 DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8 - DB 15,88,13,174,18,0,0 ; addps 0x12ae(%rip),%xmm1 # 6860 <_sk_callback_sse2+0x1286> + DB 15,88,13,193,18,0,0 ; addps 0x12c1(%rip),%xmm1 # 6880 <_sk_callback_sse2+0x1299> DB 69,15,40,200 ; movaps %xmm8,%xmm9 DB 69,15,89,201 ; mulps %xmm9,%xmm9 - DB 68,15,89,5,174,18,0,0 ; mulps 0x12ae(%rip),%xmm8 # 6870 <_sk_callback_sse2+0x1296> - DB 68,15,88,5,182,18,0,0 ; addps 0x12b6(%rip),%xmm8 # 6880 <_sk_callback_sse2+0x12a6> + DB 68,15,89,5,193,18,0,0 ; mulps 0x12c1(%rip),%xmm8 # 6890 <_sk_callback_sse2+0x12a9> + DB 68,15,88,5,201,18,0,0 ; addps 0x12c9(%rip),%xmm8 # 68a0 <_sk_callback_sse2+0x12b9> DB 69,15,89,193 ; mulps %xmm9,%xmm8 DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax) DB 72,173 ; lods %ds:(%rsi),%rax @@ -24344,11 +24201,13 @@ _sk_bicubic_p3y_sse2 LABEL PROC PUBLIC _sk_callback_sse2 _sk_callback_sse2 LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,84 ; push %r12 DB 83 ; push %rbx - DB 72,131,236,40 ; sub $0x28,%rsp + DB 72,131,236,32 ; sub $0x20,%rsp DB 68,15,40,197 ; movaps %xmm5,%xmm8 DB 68,15,40,204 ; movaps %xmm4,%xmm9 DB 77,137,196 ; mov %r8,%r12 @@ -24400,11 +24259,12 @@ _sk_callback_sse2 LABEL PROC DB 77,137,224 ; mov %r12,%r8 DB 65,15,40,225 ; movaps %xmm9,%xmm4 DB 65,15,40,232 ; movaps %xmm8,%xmm5 - DB 72,131,196,40 ; add $0x28,%rsp + DB 72,131,196,32 ; add $0x20,%rsp DB 91 ; pop %rbx DB 65,92 ; pop %r12 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 255,224 ; jmpq *%rax ALIGN 16 @@ -24551,11 +24411,11 @@ ALIGN 16 DB 128,191,0,0,128,191,0 ; cmpb $0x0,-0x40800000(%rdi) DB 0,224 ; add %ah,%al DB 64,0,0 ; add %al,(%rax) - DB 224,64 ; loopne 5878 <.literal16+0x1d8> + DB 224,64 ; loopne 5898 <.literal16+0x1d8> DB 0,0 ; add %al,(%rax) - DB 224,64 ; loopne 587c <.literal16+0x1dc> + DB 224,64 ; loopne 589c <.literal16+0x1dc> DB 0,0 ; add %al,(%rax) - DB 224,64 ; loopne 5880 <.literal16+0x1e0> + DB 224,64 ; loopne 58a0 <.literal16+0x1e0> DB 154 ; (bad) DB 153 ; cltd DB 153 ; cltd @@ -24575,13 +24435,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58a1 <.literal16+0x201> + DB 71,225,61 ; rex.RXB loope 58c1 <.literal16+0x201> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58a5 <.literal16+0x205> + DB 71,225,61 ; rex.RXB loope 58c5 <.literal16+0x205> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58a9 <.literal16+0x209> + DB 71,225,61 ; rex.RXB loope 58c9 <.literal16+0x209> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58ad <.literal16+0x20d> + DB 71,225,61 ; rex.RXB loope 58cd <.literal16+0x20d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -24606,13 +24466,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58e1 <.literal16+0x241> + DB 71,225,61 ; rex.RXB loope 5901 <.literal16+0x241> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58e5 <.literal16+0x245> + DB 71,225,61 ; rex.RXB loope 5905 <.literal16+0x245> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58e9 <.literal16+0x249> + DB 71,225,61 ; rex.RXB loope 5909 <.literal16+0x249> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 58ed <.literal16+0x24d> + DB 71,225,61 ; rex.RXB loope 590d <.literal16+0x24d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -24637,13 +24497,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5921 <.literal16+0x281> + DB 71,225,61 ; rex.RXB loope 5941 <.literal16+0x281> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5925 <.literal16+0x285> + DB 71,225,61 ; rex.RXB loope 5945 <.literal16+0x285> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5929 <.literal16+0x289> + DB 71,225,61 ; rex.RXB loope 5949 <.literal16+0x289> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 592d <.literal16+0x28d> + DB 71,225,61 ; rex.RXB loope 594d <.literal16+0x28d> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -24668,13 +24528,13 @@ ALIGN 16 DB 10,23 ; or (%rdi),%dl DB 63 ; (bad) DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5961 <.literal16+0x2c1> + DB 71,225,61 ; rex.RXB loope 5981 <.literal16+0x2c1> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5965 <.literal16+0x2c5> + DB 71,225,61 ; rex.RXB loope 5985 <.literal16+0x2c5> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 5969 <.literal16+0x2c9> + DB 71,225,61 ; rex.RXB loope 5989 <.literal16+0x2c9> DB 174 ; scas %es:(%rdi),%al - DB 71,225,61 ; rex.RXB loope 596d <.literal16+0x2cd> + DB 71,225,61 ; rex.RXB loope 598d <.literal16+0x2cd> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -24695,11 +24555,11 @@ ALIGN 16 DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax) DB 67,0,0 ; rex.XB add %al,(%r8) - DB 127,67 ; jg 59ab <.literal16+0x30b> + DB 127,67 ; jg 59cb <.literal16+0x30b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 59af <.literal16+0x30f> + DB 127,67 ; jg 59cf <.literal16+0x30f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 59b3 <.literal16+0x313> + DB 127,67 ; jg 59d3 <.literal16+0x313> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -24939,13 +24799,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 5b99 <.literal16+0x4f9> + DB 224,7 ; loopne 5bb9 <.literal16+0x4f9> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5b9d <.literal16+0x4fd> + DB 224,7 ; loopne 5bbd <.literal16+0x4fd> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5ba1 <.literal16+0x501> + DB 224,7 ; loopne 5bc1 <.literal16+0x501> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 5ba5 <.literal16+0x505> + DB 224,7 ; loopne 5bc5 <.literal16+0x505> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -25010,11 +24870,11 @@ ALIGN 16 DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,127,67 ; add %bh,0x43(%rdi) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5c7b <.literal16+0x5db> + DB 127,67 ; jg 5c9b <.literal16+0x5db> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5c7f <.literal16+0x5df> + DB 127,67 ; jg 5c9f <.literal16+0x5df> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5c83 <.literal16+0x5e3> + DB 127,67 ; jg 5ca3 <.literal16+0x5e3> DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax) DB 128,59,129 ; cmpb $0x81,(%rbx) DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax) @@ -25029,16 +24889,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5c74 <.literal16+0x5d4> + DB 127,0 ; jg 5c94 <.literal16+0x5d4> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5c78 <.literal16+0x5d8> + DB 127,0 ; jg 5c98 <.literal16+0x5d8> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5c7c <.literal16+0x5dc> + DB 127,0 ; jg 5c9c <.literal16+0x5dc> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5c80 <.literal16+0x5e0> + DB 127,0 ; jg 5ca0 <.literal16+0x5e0> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -25047,7 +24907,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5d05 <.literal16+0x665> + DB 119,115 ; ja 5d25 <.literal16+0x665> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -25058,7 +24918,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5c69 <.literal16+0x5c9> + DB 117,191 ; jne 5c89 <.literal16+0x5c9> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -25070,7 +24930,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a39caa <_sk_callback_sse2+0xffffffffe9a346d0> + DB 233,220,63,163,233 ; jmpq ffffffffe9a39cca <_sk_callback_sse2+0xffffffffe9a346e3> DB 220,63 ; fdivrl (%rdi) DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) @@ -25124,16 +24984,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5d44 <.literal16+0x6a4> + DB 127,0 ; jg 5d64 <.literal16+0x6a4> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5d48 <.literal16+0x6a8> + DB 127,0 ; jg 5d68 <.literal16+0x6a8> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5d4c <.literal16+0x6ac> + DB 127,0 ; jg 5d6c <.literal16+0x6ac> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5d50 <.literal16+0x6b0> + DB 127,0 ; jg 5d70 <.literal16+0x6b0> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -25142,7 +25002,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5dd5 <.literal16+0x735> + DB 119,115 ; ja 5df5 <.literal16+0x735> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -25153,7 +25013,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5d39 <.literal16+0x699> + DB 117,191 ; jne 5d59 <.literal16+0x699> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -25165,7 +25025,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a39d7a <_sk_callback_sse2+0xffffffffe9a347a0> + DB 233,220,63,163,233 ; jmpq ffffffffe9a39d9a <_sk_callback_sse2+0xffffffffe9a347b3> DB 220,63 ; fdivrl (%rdi) DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) @@ -25219,16 +25079,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5e14 <.literal16+0x774> + DB 127,0 ; jg 5e34 <.literal16+0x774> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5e18 <.literal16+0x778> + DB 127,0 ; jg 5e38 <.literal16+0x778> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5e1c <.literal16+0x77c> + DB 127,0 ; jg 5e3c <.literal16+0x77c> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5e20 <.literal16+0x780> + DB 127,0 ; jg 5e40 <.literal16+0x780> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -25237,7 +25097,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5ea5 <.literal16+0x805> + DB 119,115 ; ja 5ec5 <.literal16+0x805> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -25248,7 +25108,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5e09 <.literal16+0x769> + DB 117,191 ; jne 5e29 <.literal16+0x769> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -25260,7 +25120,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a39e4a <_sk_callback_sse2+0xffffffffe9a34870> + DB 233,220,63,163,233 ; jmpq ffffffffe9a39e6a <_sk_callback_sse2+0xffffffffe9a34883> DB 220,63 ; fdivrl (%rdi) DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) @@ -25314,16 +25174,16 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 52,255 ; xor $0xff,%al DB 255 ; (bad) - DB 127,0 ; jg 5ee4 <.literal16+0x844> + DB 127,0 ; jg 5f04 <.literal16+0x844> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5ee8 <.literal16+0x848> + DB 127,0 ; jg 5f08 <.literal16+0x848> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5eec <.literal16+0x84c> + DB 127,0 ; jg 5f0c <.literal16+0x84c> DB 255 ; (bad) DB 255 ; (bad) - DB 127,0 ; jg 5ef0 <.literal16+0x850> + DB 127,0 ; jg 5f10 <.literal16+0x850> DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -25332,7 +25192,7 @@ ALIGN 16 DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) - DB 119,115 ; ja 5f75 <.literal16+0x8d5> + DB 119,115 ; ja 5f95 <.literal16+0x8d5> DB 248 ; clc DB 194,119,115 ; retq $0x7377 DB 248 ; clc @@ -25343,7 +25203,7 @@ ALIGN 16 DB 194,117,191 ; retq $0xbf75 DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) - DB 117,191 ; jne 5ed9 <.literal16+0x839> + DB 117,191 ; jne 5ef9 <.literal16+0x839> DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi DB 63 ; (bad) DB 249 ; stc @@ -25355,7 +25215,7 @@ ALIGN 16 DB 249 ; stc DB 68,180,62 ; rex.R mov $0x3e,%spl DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9 - DB 233,220,63,163,233 ; jmpq ffffffffe9a39f1a <_sk_callback_sse2+0xffffffffe9a34940> + DB 233,220,63,163,233 ; jmpq ffffffffe9a39f3a <_sk_callback_sse2+0xffffffffe9a34953> DB 220,63 ; fdivrl (%rdi) DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) @@ -25405,13 +25265,13 @@ ALIGN 16 DB 200,66,0,0 ; enterq $0x42,$0x0 DB 200,66,0,0 ; enterq $0x42,$0x0 DB 200,66,0,0 ; enterq $0x42,$0x0 - DB 127,67 ; jg 5ff7 <.literal16+0x957> + DB 127,67 ; jg 6017 <.literal16+0x957> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5ffb <.literal16+0x95b> + DB 127,67 ; jg 601b <.literal16+0x95b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 5fff <.literal16+0x95f> + DB 127,67 ; jg 601f <.literal16+0x95f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 6003 <.literal16+0x963> + DB 127,67 ; jg 6023 <.literal16+0x963> DB 0,0 ; add %al,(%rax) DB 0,195 ; add %al,%bl DB 0,0 ; add %al,(%rax) @@ -25458,16 +25318,16 @@ ALIGN 16 DB 128,3,62 ; addb $0x3e,(%rbx) DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 6083 <.literal16+0x9e3> + DB 118,63 ; jbe 60a3 <.literal16+0x9e3> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 6087 <.literal16+0x9e7> + DB 118,63 ; jbe 60a7 <.literal16+0x9e7> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 608b <.literal16+0x9eb> + DB 118,63 ; jbe 60ab <.literal16+0x9eb> DB 31 ; (bad) DB 215 ; xlat %ds:(%rbx) - DB 118,63 ; jbe 608f <.literal16+0x9ef> + DB 118,63 ; jbe 60af <.literal16+0x9ef> DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 246,64,83,63 ; testb $0x3f,0x53(%rax) DB 246,64,83,63 ; testb $0x3f,0x53(%rax) @@ -25487,11 +25347,11 @@ ALIGN 16 DB 128,59,0 ; cmpb $0x0,(%rbx) DB 0,127,67 ; add %bh,0x43(%rdi) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 60db <.literal16+0xa3b> + DB 127,67 ; jg 60fb <.literal16+0xa3b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 60df <.literal16+0xa3f> + DB 127,67 ; jg 60ff <.literal16+0xa3f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 60e3 <.literal16+0xa43> + DB 127,67 ; jg 6103 <.literal16+0xa43> DB 255,0 ; incl (%rax) DB 0,0 ; add %al,(%rax) DB 255,0 ; incl (%rax) @@ -25539,13 +25399,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 6139 <.literal16+0xa99> + DB 224,7 ; loopne 6159 <.literal16+0xa99> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 613d <.literal16+0xa9d> + DB 224,7 ; loopne 615d <.literal16+0xa9d> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 6141 <.literal16+0xaa1> + DB 224,7 ; loopne 6161 <.literal16+0xaa1> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 6145 <.literal16+0xaa5> + DB 224,7 ; loopne 6165 <.literal16+0xaa5> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -25591,13 +25451,13 @@ ALIGN 16 DB 132,55 ; test %dh,(%rdi) DB 8,33 ; or %ah,(%rcx) DB 132,55 ; test %dh,(%rdi) - DB 224,7 ; loopne 61a9 <.literal16+0xb09> + DB 224,7 ; loopne 61c9 <.literal16+0xb09> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 61ad <.literal16+0xb0d> + DB 224,7 ; loopne 61cd <.literal16+0xb0d> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 61b1 <.literal16+0xb11> + DB 224,7 ; loopne 61d1 <.literal16+0xb11> DB 0,0 ; add %al,(%rax) - DB 224,7 ; loopne 61b5 <.literal16+0xb15> + DB 224,7 ; loopne 61d5 <.literal16+0xb15> DB 0,0 ; add %al,(%rax) DB 33,8 ; and %ecx,(%rax) DB 2,58 ; add (%rdx),%bh @@ -25635,13 +25495,13 @@ ALIGN 16 DB 65,0,0 ; add %al,(%r8) DB 248 ; clc DB 65,0,0 ; add %al,(%r8) - DB 124,66 ; jl 6246 <.literal16+0xba6> + DB 124,66 ; jl 6266 <.literal16+0xba6> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 624a <.literal16+0xbaa> + DB 124,66 ; jl 626a <.literal16+0xbaa> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 624e <.literal16+0xbae> + DB 124,66 ; jl 626e <.literal16+0xbae> DB 0,0 ; add %al,(%rax) - DB 124,66 ; jl 6252 <.literal16+0xbb2> + DB 124,66 ; jl 6272 <.literal16+0xbb2> DB 0,240 ; add %dh,%al DB 0,0 ; add %al,(%rax) DB 0,240 ; add %dh,%al @@ -25731,13 +25591,13 @@ ALIGN 16 DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax) DB 61,137,136,136,61 ; cmp $0x3d888889,%eax DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 6355 <.literal16+0xcb5> + DB 112,65 ; jo 6375 <.literal16+0xcb5> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 6359 <.literal16+0xcb9> + DB 112,65 ; jo 6379 <.literal16+0xcb9> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 635d <.literal16+0xcbd> + DB 112,65 ; jo 637d <.literal16+0xcbd> DB 0,0 ; add %al,(%rax) - DB 112,65 ; jo 6361 <.literal16+0xcc1> + DB 112,65 ; jo 6381 <.literal16+0xcc1> DB 255,0 ; incl (%rax) DB 0,0 ; add %al,(%rax) DB 255,0 ; incl (%rax) @@ -25759,11 +25619,11 @@ ALIGN 16 DB 128,59,129 ; cmpb $0x81,(%rbx) DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%rax) DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 63ab <.literal16+0xd0b> + DB 127,67 ; jg 63cb <.literal16+0xd0b> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 63af <.literal16+0xd0f> + DB 127,67 ; jg 63cf <.literal16+0xd0f> DB 0,0 ; add %al,(%rax) - DB 127,67 ; jg 63b3 <.literal16+0xd13> + DB 127,67 ; jg 63d3 <.literal16+0xd13> DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax) DB 0,0 ; add %al,(%rax) DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax) @@ -25839,13 +25699,13 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 255 ; (bad) - DB 127,71 ; jg 649b <.literal16+0xdfb> + DB 127,71 ; jg 64bb <.literal16+0xdfb> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 649f <.literal16+0xdff> + DB 127,71 ; jg 64bf <.literal16+0xdff> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 64a3 <.literal16+0xe03> + DB 127,71 ; jg 64c3 <.literal16+0xe03> DB 0,255 ; add %bh,%bh - DB 127,71 ; jg 64a7 <.literal16+0xe07> + DB 127,71 ; jg 64c7 <.literal16+0xe07> DB 0,0 ; add %al,(%rax) DB 128,63,0 ; cmpb $0x0,(%rdi) DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax) @@ -25922,10 +25782,10 @@ ALIGN 16 DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax DB 152 ; cwtl DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx) - DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0763a <_sk_callback_sse2+0x2dc02060> + DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0765a <_sk_callback_sse2+0x2dc02073> DB 17,192 ; adc %eax,%eax DB 45,16,17,192,18 ; sub $0x12c01110,%eax - DB 120,57 ; js 656c <.literal16+0xecc> + DB 120,57 ; js 658c <.literal16+0xecc> DB 64,18,120,57 ; adc 0x39(%rax),%dil DB 64,18,120,57 ; adc 0x39(%rax),%dil DB 64,18,120,57 ; adc 0x39(%rax),%dil @@ -26053,11 +25913,11 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,114 ; cmpb $0x72,(%rdi) DB 28,199 ; sbb $0xc7,%al - DB 62,114,28 ; jb,pt 66b2 <.literal16+0x1012> + DB 62,114,28 ; jb,pt 66d2 <.literal16+0x1012> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 66b6 <.literal16+0x1016> + DB 62,114,28 ; jb,pt 66d6 <.literal16+0x1016> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 66ba <.literal16+0x101a> + DB 62,114,28 ; jb,pt 66da <.literal16+0x101a> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -26101,7 +25961,7 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f545 <_sk_callback_sse2+0x3d639f6b> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f565 <_sk_callback_sse2+0x3d639f7e> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -26127,7 +25987,7 @@ ALIGN 16 DB 0,192 ; add %al,%al DB 63 ; (bad) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f585 <_sk_callback_sse2+0x3d639fab> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f5a5 <_sk_callback_sse2+0x3d639fbe> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al @@ -26136,13 +25996,13 @@ ALIGN 16 DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al DB 63 ; (bad) - DB 114,28 ; jb 677e <.literal16+0x10de> + DB 114,28 ; jb 679e <.literal16+0x10de> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6782 <.literal16+0x10e2> + DB 62,114,28 ; jb,pt 67a2 <.literal16+0x10e2> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6786 <.literal16+0x10e6> + DB 62,114,28 ; jb,pt 67a6 <.literal16+0x10e6> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 678a <.literal16+0x10ea> + DB 62,114,28 ; jb,pt 67aa <.literal16+0x10ea> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -26163,11 +26023,11 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 128,63,114 ; cmpb $0x72,(%rdi) DB 28,199 ; sbb $0xc7,%al - DB 62,114,28 ; jb,pt 67c2 <.literal16+0x1122> + DB 62,114,28 ; jb,pt 67e2 <.literal16+0x1122> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 67c6 <.literal16+0x1126> + DB 62,114,28 ; jb,pt 67e6 <.literal16+0x1126> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 67ca <.literal16+0x112a> + DB 62,114,28 ; jb,pt 67ea <.literal16+0x112a> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -26211,7 +26071,7 @@ ALIGN 16 DB 0,0 ; add %al,(%rax) DB 0,63 ; add %bh,(%rdi) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f655 <_sk_callback_sse2+0x3d63a07b> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f675 <_sk_callback_sse2+0x3d63a08e> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 0,63 ; add %bh,(%rdi) DB 0,0 ; add %al,(%rax) @@ -26237,7 +26097,7 @@ ALIGN 16 DB 0,192 ; add %al,%al DB 63 ; (bad) DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi) - DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f695 <_sk_callback_sse2+0x3d63a0bb> + DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d63f6b5 <_sk_callback_sse2+0x3d63a0ce> DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi) DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al @@ -26246,13 +26106,13 @@ ALIGN 16 DB 192,63,0 ; sarb $0x0,(%rdi) DB 0,192 ; add %al,%al DB 63 ; (bad) - DB 114,28 ; jb 688e <.literal16+0x11ee> + DB 114,28 ; jb 68ae <.literal16+0x11ee> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6892 <_sk_callback_sse2+0x12b8> + DB 62,114,28 ; jb,pt 68b2 <_sk_callback_sse2+0x12cb> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 6896 <_sk_callback_sse2+0x12bc> + DB 62,114,28 ; jb,pt 68b6 <_sk_callback_sse2+0x12cf> DB 199 ; (bad) - DB 62,114,28 ; jb,pt 689a <_sk_callback_sse2+0x12c0> + DB 62,114,28 ; jb,pt 68ba <_sk_callback_sse2+0x12d3> DB 199 ; (bad) DB 62,171 ; ds stos %eax,%es:(%rdi) DB 170 ; stos %al,%es:(%rdi) @@ -26266,38 +26126,40 @@ ALIGN 32 PUBLIC _sk_start_pipeline_ssse3_lowp _sk_start_pipeline_ssse3_lowp LABEL PROC + DB 85 ; push %rbp + DB 72,137,229 ; mov %rsp,%rbp DB 65,87 ; push %r15 DB 65,86 ; push %r14 DB 65,85 ; push %r13 DB 65,84 ; push %r12 DB 86 ; push %rsi DB 87 ; push %rdi - DB 85 ; push %rbp DB 83 ; push %rbx - DB 72,129,236,168,0,0,0 ; sub $0xa8,%rsp - DB 68,15,41,188,36,144,0,0,0 ; movaps %xmm15,0x90(%rsp) - DB 68,15,41,180,36,128,0,0,0 ; movaps %xmm14,0x80(%rsp) - DB 68,15,41,108,36,112 ; movaps %xmm13,0x70(%rsp) - DB 68,15,41,100,36,96 ; movaps %xmm12,0x60(%rsp) - DB 68,15,41,92,36,80 ; movaps %xmm11,0x50(%rsp) - DB 68,15,41,84,36,64 ; movaps %xmm10,0x40(%rsp) - DB 68,15,41,76,36,48 ; movaps %xmm9,0x30(%rsp) - DB 68,15,41,68,36,32 ; movaps %xmm8,0x20(%rsp) - DB 15,41,124,36,16 ; movaps %xmm7,0x10(%rsp) - DB 15,41,52,36 ; movaps %xmm6,(%rsp) + DB 72,129,236,184,0,0,0 ; sub $0xb8,%rsp + DB 68,15,41,125,176 ; movaps %xmm15,-0x50(%rbp) + DB 68,15,41,117,160 ; movaps %xmm14,-0x60(%rbp) + DB 68,15,41,109,144 ; movaps %xmm13,-0x70(%rbp) + DB 68,15,41,101,128 ; movaps %xmm12,-0x80(%rbp) + DB 68,15,41,157,112,255,255,255 ; movaps %xmm11,-0x90(%rbp) + DB 68,15,41,149,96,255,255,255 ; movaps %xmm10,-0xa0(%rbp) + DB 68,15,41,141,80,255,255,255 ; movaps %xmm9,-0xb0(%rbp) + DB 68,15,41,133,64,255,255,255 ; movaps %xmm8,-0xc0(%rbp) + DB 15,41,189,48,255,255,255 ; movaps %xmm7,-0xd0(%rbp) + DB 15,41,181,32,255,255,255 ; movaps %xmm6,-0xe0(%rbp) DB 76,137,195 ; mov %r8,%rbx - DB 73,137,214 ; mov %rdx,%r14 - DB 72,137,205 ; mov %rcx,%rbp - DB 76,139,188,36,16,1,0,0 ; mov 0x110(%rsp),%r15 + DB 73,137,210 ; mov %rdx,%r10 + DB 73,137,207 ; mov %rcx,%r15 + DB 76,139,117,48 ; mov 0x30(%rbp),%r14 DB 76,137,206 ; mov %r9,%rsi DB 72,173 ; lods %ds:(%rsi),%rax - DB 73,137,196 ; mov %rax,%r12 - DB 73,137,245 ; mov %rsi,%r13 - DB 72,141,69,8 ; lea 0x8(%rbp),%rax - DB 72,57,216 ; cmp %rbx,%rax - DB 118,5 ; jbe 7c <_sk_start_pipeline_ssse3_lowp+0x7c> - DB 72,137,234 ; mov %rbp,%rdx - DB 235,61 ; jmp b9 <_sk_start_pipeline_ssse3_lowp+0xb9> + DB 73,137,197 ; mov %rax,%r13 + DB 73,137,244 ; mov %rsi,%r12 + DB 73,141,79,8 ; lea 0x8(%r15),%rcx + DB 72,57,217 ; cmp %rbx,%rcx + DB 118,5 ; jbe 7e <_sk_start_pipeline_ssse3_lowp+0x7e> + DB 76,137,250 ; mov %r15,%rdx + DB 235,81 ; jmp cf <_sk_start_pipeline_ssse3_lowp+0xcf> + DB 72,137,157,24,255,255,255 ; mov %rbx,-0xe8(%rbp) DB 65,184,0,0,0,0 ; mov $0x0,%r8d DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 @@ -26307,19 +26169,22 @@ _sk_start_pipeline_ssse3_lowp LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 72,137,234 ; mov %rbp,%rdx - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 - DB 72,141,85,8 ; lea 0x8(%rbp),%rdx - DB 72,131,197,16 ; add $0x10,%rbp - DB 72,57,221 ; cmp %rbx,%rbp - DB 72,137,213 ; mov %rdx,%rbp - DB 118,195 ; jbe 7c <_sk_start_pipeline_ssse3_lowp+0x7c> + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,250 ; mov %r15,%rdx + DB 76,137,209 ; mov %r10,%rcx + DB 76,137,211 ; mov %r10,%rbx + DB 65,255,213 ; callq *%r13 + DB 73,137,218 ; mov %rbx,%r10 + DB 72,139,157,24,255,255,255 ; mov -0xe8(%rbp),%rbx + DB 73,141,87,8 ; lea 0x8(%r15),%rdx + DB 73,131,199,16 ; add $0x10,%r15 + DB 73,57,223 ; cmp %rbx,%r15 + DB 73,137,215 ; mov %rdx,%r15 + DB 118,182 ; jbe 85 <_sk_start_pipeline_ssse3_lowp+0x85> DB 73,137,216 ; mov %rbx,%r8 DB 73,41,208 ; sub %rdx,%r8 - DB 116,36 ; je e5 <_sk_start_pipeline_ssse3_lowp+0xe5> + DB 116,36 ; je fb <_sk_start_pipeline_ssse3_lowp+0xfb> DB 15,87,192 ; xorps %xmm0,%xmm0 DB 15,87,201 ; xorps %xmm1,%xmm1 DB 15,87,210 ; xorps %xmm2,%xmm2 @@ -26328,30 +26193,30 @@ _sk_start_pipeline_ssse3_lowp LABEL PROC DB 15,87,237 ; xorps %xmm5,%xmm5 DB 15,87,246 ; xorps %xmm6,%xmm6 DB 15,87,255 ; xorps %xmm7,%xmm7 - DB 76,137,255 ; mov %r15,%rdi - DB 76,137,238 ; mov %r13,%rsi - DB 76,137,241 ; mov %r14,%rcx - DB 65,255,212 ; callq *%r12 + DB 76,137,247 ; mov %r14,%rdi + DB 76,137,230 ; mov %r12,%rsi + DB 76,137,209 ; mov %r10,%rcx + DB 65,255,213 ; callq *%r13 DB 72,137,216 ; mov %rbx,%rax - DB 15,40,52,36 ; movaps (%rsp),%xmm6 - DB 15,40,124,36,16 ; movaps 0x10(%rsp),%xmm7 - DB 68,15,40,68,36,32 ; movaps 0x20(%rsp),%xmm8 - DB 68,15,40,76,36,48 ; movaps 0x30(%rsp),%xmm9 - DB 68,15,40,84,36,64 ; movaps 0x40(%rsp),%xmm10 - DB 68,15,40,92,36,80 ; movaps 0x50(%rsp),%xmm11 - DB 68,15,40,100,36,96 ; movaps 0x60(%rsp),%xmm12 - DB 68,15,40,108,36,112 ; movaps 0x70(%rsp),%xmm13 - DB 68,15,40,180,36,128,0,0,0 ; movaps 0x80(%rsp),%xmm14 - DB 68,15,40,188,36,144,0,0,0 ; movaps 0x90(%rsp),%xmm15 - DB 72,129,196,168,0,0,0 ; add $0xa8,%rsp + DB 15,40,181,32,255,255,255 ; movaps -0xe0(%rbp),%xmm6 + DB 15,40,189,48,255,255,255 ; movaps -0xd0(%rbp),%xmm7 + DB 68,15,40,133,64,255,255,255 ; movaps -0xc0(%rbp),%xmm8 + DB 68,15,40,141,80,255,255,255 ; movaps -0xb0(%rbp),%xmm9 + DB 68,15,40,149,96,255,255,255 ; movaps -0xa0(%rbp),%xmm10 + DB 68,15,40,157,112,255,255,255 ; movaps -0x90(%rbp),%xmm11 + DB 68,15,40,101,128 ; movaps -0x80(%rbp),%xmm12 + DB 68,15,40,109,144 ; movaps -0x70(%rbp),%xmm13 + DB 68,15,40,117,160 ; movaps -0x60(%rbp),%xmm14 + DB 68,15,40,125,176 ; movaps -0x50(%rbp),%xmm15 + DB 72,129,196,184,0,0,0 ; add $0xb8,%rsp DB 91 ; pop %rbx - DB 93 ; pop %rbp DB 95 ; pop %rdi DB 94 ; pop %rsi DB 65,92 ; pop %r12 DB 65,93 ; pop %r13 DB 65,94 ; pop %r14 DB 65,95 ; pop %r15 + DB 93 ; pop %rbp DB 195 ; retq PUBLIC _sk_just_return_ssse3_lowp @@ -26361,7 +26226,7 @@ _sk_just_return_ssse3_lowp LABEL PROC PUBLIC _sk_constant_color_ssse3_lowp _sk_constant_color_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax - DB 243,15,16,29,42,14,0,0 ; movss 0xe2a(%rip),%xmm3 # f70 <_sk_xor__ssse3_lowp+0x9b> + DB 243,15,16,29,45,14,0,0 ; movss 0xe2d(%rip),%xmm3 # f8c <_sk_xor__ssse3_lowp+0x9b> DB 243,15,16,0 ; movss (%rax),%xmm0 DB 243,15,89,195 ; mulss %xmm3,%xmm0 DB 243,68,15,44,200 ; cvttss2si %xmm0,%r9d @@ -26393,10 +26258,10 @@ _sk_load_8888_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 117,113 ; jne 232 <_sk_load_8888_ssse3_lowp+0x7b> + DB 117,113 ; jne 24b <_sk_load_8888_ssse3_lowp+0x7b> DB 69,15,16,76,147,16 ; movups 0x10(%r11,%rdx,4),%xmm9 DB 69,15,16,4,147 ; movups (%r11,%rdx,4),%xmm8 - DB 102,15,111,5,172,13,0,0 ; movdqa 0xdac(%rip),%xmm0 # f80 <_sk_xor__ssse3_lowp+0xab> + DB 102,15,111,5,179,13,0,0 ; movdqa 0xdb3(%rip),%xmm0 # fa0 <_sk_xor__ssse3_lowp+0xaf> DB 102,68,15,56,0,192 ; pshufb %xmm0,%xmm8 DB 102,68,15,56,0,200 ; pshufb %xmm0,%xmm9 DB 102,65,15,111,208 ; movdqa %xmm8,%xmm2 @@ -26410,7 +26275,7 @@ _sk_load_8888_ssse3_lowp LABEL PROC DB 102,15,239,210 ; pxor %xmm2,%xmm2 DB 102,65,15,96,208 ; punpcklbw %xmm8,%xmm2 DB 102,65,15,104,216 ; punpckhbw %xmm8,%xmm3 - DB 102,68,15,111,5,118,13,0,0 ; movdqa 0xd76(%rip),%xmm8 # f90 <_sk_xor__ssse3_lowp+0xbb> + DB 102,68,15,111,5,125,13,0,0 ; movdqa 0xd7d(%rip),%xmm8 # fb0 <_sk_xor__ssse3_lowp+0xbf> DB 102,65,15,228,192 ; pmulhuw %xmm8,%xmm0 DB 102,65,15,228,200 ; pmulhuw %xmm8,%xmm1 DB 102,65,15,228,208 ; pmulhuw %xmm8,%xmm2 @@ -26423,9 +26288,9 @@ _sk_load_8888_ssse3_lowp LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,129 ; ja 1cc <_sk_load_8888_ssse3_lowp+0x15> + DB 119,129 ; ja 1e5 <_sk_load_8888_ssse3_lowp+0x15> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,130,0,0,0 ; lea 0x82(%rip),%r10 # 2d8 <_sk_load_8888_ssse3_lowp+0x121> + DB 76,141,21,133,0,0,0 ; lea 0x85(%rip),%r10 # 2f4 <_sk_load_8888_ssse3_lowp+0x124> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -26450,20 +26315,21 @@ _sk_load_8888_ssse3_lowp LABEL PROC DB 68,15,40,192 ; movaps %xmm0,%xmm8 DB 243,65,15,16,4,147 ; movss (%r11,%rdx,4),%xmm0 DB 243,68,15,16,192 ; movss %xmm0,%xmm8 - DB 233,244,254,255,255 ; jmpq 1cc <_sk_load_8888_ssse3_lowp+0x15> - DB 240,255 ; lock (bad) + DB 233,244,254,255,255 ; jmpq 1e5 <_sk_load_8888_ssse3_lowp+0x15> + DB 15,31,0 ; nopl (%rax) + DB 237 ; in (%dx),%eax DB 255 ; (bad) DB 255 ; (bad) - DB 219,255 ; (bad) DB 255 ; (bad) - DB 255,202 ; dec %edx + DB 216,255 ; fdivr %st(7),%st DB 255 ; (bad) + DB 255,199 ; inc %edi DB 255 ; (bad) DB 255 ; (bad) - DB 185,255,255,255,173 ; mov $0xadffffff,%ecx + DB 255,182,255,255,255,170 ; pushq -0x55000001(%rsi) DB 255 ; (bad) DB 255 ; (bad) - DB 255,152,255,255,255,135 ; lcall *-0x78000001(%rax) + DB 255,149,255,255,255,132 ; callq *-0x7b000001(%rbp) DB 255 ; (bad) DB 255 ; (bad) DB 255 ; .byte 0xff @@ -26489,7 +26355,7 @@ _sk_store_8888_ssse3_lowp LABEL PROC DB 102,69,15,97,194 ; punpcklwd %xmm10,%xmm8 DB 102,69,15,105,202 ; punpckhwd %xmm10,%xmm9 DB 77,133,192 ; test %r8,%r8 - DB 117,17 ; jne 363 <_sk_store_8888_ssse3_lowp+0x6f> + DB 117,17 ; jne 37f <_sk_store_8888_ssse3_lowp+0x6f> DB 243,69,15,127,76,147,16 ; movdqu %xmm9,0x10(%r11,%rdx,4) DB 243,69,15,127,4,147 ; movdqu %xmm8,(%r11,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax @@ -26498,9 +26364,9 @@ _sk_store_8888_ssse3_lowp LABEL PROC DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,236 ; ja 35f <_sk_store_8888_ssse3_lowp+0x6b> + DB 119,236 ; ja 37b <_sk_store_8888_ssse3_lowp+0x6b> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,90,0,0,0 ; lea 0x5a(%rip),%r10 # 3d8 <_sk_store_8888_ssse3_lowp+0xe4> + DB 76,141,21,90,0,0,0 ; lea 0x5a(%rip),%r10 # 3f4 <_sk_store_8888_ssse3_lowp+0xe4> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -26516,7 +26382,7 @@ _sk_store_8888_ssse3_lowp LABEL PROC DB 102,69,15,112,200,229 ; pshufd $0xe5,%xmm8,%xmm9 DB 102,69,15,126,76,147,4 ; movd %xmm9,0x4(%r11,%rdx,4) DB 102,69,15,126,4,147 ; movd %xmm8,(%r11,%rdx,4) - DB 235,136 ; jmp 35f <_sk_store_8888_ssse3_lowp+0x6b> + DB 235,136 ; jmp 37b <_sk_store_8888_ssse3_lowp+0x6b> DB 144 ; nop DB 247,255 ; idiv %edi DB 255 ; (bad) @@ -26544,11 +26410,11 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,66,1,0,0 ; jne 544 <_sk_srcover_rgba_8888_ssse3_lowp+0x150> + DB 15,133,66,1,0,0 ; jne 560 <_sk_srcover_rgba_8888_ssse3_lowp+0x150> DB 69,15,16,76,147,16 ; movups 0x10(%r11,%rdx,4),%xmm9 DB 69,15,16,4,147 ; movups (%r11,%rdx,4),%xmm8 DB 77,133,192 ; test %r8,%r8 - DB 102,15,111,37,136,11,0,0 ; movdqa 0xb88(%rip),%xmm4 # fa0 <_sk_xor__ssse3_lowp+0xcb> + DB 102,15,111,37,140,11,0,0 ; movdqa 0xb8c(%rip),%xmm4 # fc0 <_sk_xor__ssse3_lowp+0xcf> DB 102,68,15,56,0,196 ; pshufb %xmm4,%xmm8 DB 102,68,15,56,0,204 ; pshufb %xmm4,%xmm9 DB 102,65,15,111,240 ; movdqa %xmm8,%xmm6 @@ -26562,12 +26428,12 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 102,15,239,246 ; pxor %xmm6,%xmm6 DB 102,65,15,96,240 ; punpcklbw %xmm8,%xmm6 DB 102,65,15,104,248 ; punpckhbw %xmm8,%xmm7 - DB 102,68,15,111,5,82,11,0,0 ; movdqa 0xb52(%rip),%xmm8 # fb0 <_sk_xor__ssse3_lowp+0xdb> + DB 102,68,15,111,5,86,11,0,0 ; movdqa 0xb56(%rip),%xmm8 # fd0 <_sk_xor__ssse3_lowp+0xdf> DB 102,65,15,228,224 ; pmulhuw %xmm8,%xmm4 DB 102,65,15,228,232 ; pmulhuw %xmm8,%xmm5 DB 102,65,15,228,240 ; pmulhuw %xmm8,%xmm6 DB 102,65,15,228,248 ; pmulhuw %xmm8,%xmm7 - DB 102,68,15,111,29,69,11,0,0 ; movdqa 0xb45(%rip),%xmm11 # fc0 <_sk_xor__ssse3_lowp+0xeb> + DB 102,68,15,111,29,73,11,0,0 ; movdqa 0xb49(%rip),%xmm11 # fe0 <_sk_xor__ssse3_lowp+0xef> DB 102,68,15,249,219 ; psubw %xmm3,%xmm11 DB 102,68,15,111,196 ; movdqa %xmm4,%xmm8 DB 102,69,15,56,11,195 ; pmulhrsw %xmm11,%xmm8 @@ -26600,7 +26466,7 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 102,15,111,193 ; movdqa %xmm1,%xmm0 DB 102,15,97,194 ; punpcklwd %xmm2,%xmm0 DB 102,15,105,202 ; punpckhwd %xmm2,%xmm1 - DB 15,133,207,0,0,0 ; jne 5ee <_sk_srcover_rgba_8888_ssse3_lowp+0x1fa> + DB 15,133,207,0,0,0 ; jne 60a <_sk_srcover_rgba_8888_ssse3_lowp+0x1fa> DB 243,65,15,127,76,147,16 ; movdqu %xmm1,0x10(%r11,%rdx,4) DB 243,65,15,127,4,147 ; movdqu %xmm0,(%r11,%rdx,4) DB 72,173 ; lods %ds:(%rsi),%rax @@ -26615,9 +26481,9 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 69,15,87,192 ; xorps %xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,172,254,255,255 ; ja 40d <_sk_srcover_rgba_8888_ssse3_lowp+0x19> + DB 15,135,172,254,255,255 ; ja 429 <_sk_srcover_rgba_8888_ssse3_lowp+0x19> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,248,0,0,0 ; lea 0xf8(%rip),%r10 # 664 <_sk_srcover_rgba_8888_ssse3_lowp+0x270> + DB 76,141,21,248,0,0,0 ; lea 0xf8(%rip),%r10 # 680 <_sk_srcover_rgba_8888_ssse3_lowp+0x270> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -26642,14 +26508,14 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 68,15,40,196 ; movaps %xmm4,%xmm8 DB 243,65,15,16,36,147 ; movss (%r11,%rdx,4),%xmm4 DB 243,68,15,16,196 ; movss %xmm4,%xmm8 - DB 233,31,254,255,255 ; jmpq 40d <_sk_srcover_rgba_8888_ssse3_lowp+0x19> + DB 233,31,254,255,255 ; jmpq 429 <_sk_srcover_rgba_8888_ssse3_lowp+0x19> DB 69,137,193 ; mov %r8d,%r9d DB 65,128,225,7 ; and $0x7,%r9b DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,42,255,255,255 ; ja 52c <_sk_srcover_rgba_8888_ssse3_lowp+0x138> + DB 15,135,42,255,255,255 ; ja 548 <_sk_srcover_rgba_8888_ssse3_lowp+0x138> DB 65,15,182,193 ; movzbl %r9b,%eax - DB 76,141,13,115,0,0,0 ; lea 0x73(%rip),%r9 # 680 <_sk_srcover_rgba_8888_ssse3_lowp+0x28c> + DB 76,141,13,115,0,0,0 ; lea 0x73(%rip),%r9 # 69c <_sk_srcover_rgba_8888_ssse3_lowp+0x28c> DB 73,99,4,129 ; movslq (%r9,%rax,4),%rax DB 76,1,200 ; add %r9,%rax DB 255,224 ; jmpq *%rax @@ -26665,8 +26531,8 @@ _sk_srcover_rgba_8888_ssse3_lowp LABEL PROC DB 102,15,112,200,229 ; pshufd $0xe5,%xmm0,%xmm1 DB 102,65,15,126,76,147,4 ; movd %xmm1,0x4(%r11,%rdx,4) DB 102,65,15,126,4,147 ; movd %xmm0,(%r11,%rdx,4) - DB 233,200,254,255,255 ; jmpq 52c <_sk_srcover_rgba_8888_ssse3_lowp+0x138> - DB 122,255 ; jp 665 <_sk_srcover_rgba_8888_ssse3_lowp+0x271> + DB 233,200,254,255,255 ; jmpq 548 <_sk_srcover_rgba_8888_ssse3_lowp+0x138> + DB 122,255 ; jp 681 <_sk_srcover_rgba_8888_ssse3_lowp+0x271> DB 255 ; (bad) DB 255,101,255 ; jmpq *-0x1(%rbp) DB 255 ; (bad) @@ -26703,7 +26569,7 @@ PUBLIC _sk_scale_1_float_ssse3_lowp _sk_scale_1_float_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 243,68,15,16,0 ; movss (%rax),%xmm8 - DB 243,68,15,89,5,200,8,0,0 ; mulss 0x8c8(%rip),%xmm8 # f74 <_sk_xor__ssse3_lowp+0x9f> + DB 243,68,15,89,5,200,8,0,0 ; mulss 0x8c8(%rip),%xmm8 # f90 <_sk_xor__ssse3_lowp+0x9f> DB 243,65,15,44,192 ; cvttss2si %xmm8,%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 242,69,15,112,192,0 ; pshuflw $0x0,%xmm8,%xmm8 @@ -26725,11 +26591,11 @@ _sk_scale_u8_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 117,76 ; jne 749 <_sk_scale_u8_ssse3_lowp+0x57> + DB 117,76 ; jne 765 <_sk_scale_u8_ssse3_lowp+0x57> DB 243,69,15,126,4,19 ; movq (%r11,%rdx,1),%xmm8 DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8 DB 102,65,15,113,240,8 ; psllw $0x8,%xmm8 - DB 102,68,15,228,5,185,8,0,0 ; pmulhuw 0x8b9(%rip),%xmm8 # fd0 <_sk_xor__ssse3_lowp+0xfb> + DB 102,68,15,228,5,189,8,0,0 ; pmulhuw 0x8bd(%rip),%xmm8 # ff0 <_sk_xor__ssse3_lowp+0xff> DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 DB 102,15,56,29,192 ; pabsw %xmm0,%xmm0 DB 102,65,15,56,11,200 ; pmulhrsw %xmm8,%xmm1 @@ -26746,9 +26612,9 @@ _sk_scale_u8_ssse3_lowp LABEL PROC DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 119,170 ; ja 708 <_sk_scale_u8_ssse3_lowp+0x16> + DB 119,170 ; ja 724 <_sk_scale_u8_ssse3_lowp+0x16> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,103,0,0,0 ; lea 0x67(%rip),%r10 # 7d0 <_sk_scale_u8_ssse3_lowp+0xde> + DB 76,141,21,103,0,0,0 ; lea 0x67(%rip),%r10 # 7ec <_sk_scale_u8_ssse3_lowp+0xde> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -26767,7 +26633,7 @@ _sk_scale_u8_ssse3_lowp LABEL PROC DB 102,68,15,196,192,1 ; pinsrw $0x1,%eax,%xmm8 DB 65,15,182,4,19 ; movzbl (%r11,%rdx,1),%eax DB 102,68,15,196,192,0 ; pinsrw $0x0,%eax,%xmm8 - DB 233,57,255,255,255 ; jmpq 708 <_sk_scale_u8_ssse3_lowp+0x16> + DB 233,57,255,255,255 ; jmpq 724 <_sk_scale_u8_ssse3_lowp+0x16> DB 144 ; nop DB 239 ; out %eax,(%dx) DB 255 ; (bad) @@ -26795,14 +26661,14 @@ PUBLIC _sk_lerp_1_float_ssse3_lowp _sk_lerp_1_float_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 243,68,15,16,0 ; movss (%rax),%xmm8 - DB 243,68,15,89,5,124,7,0,0 ; mulss 0x77c(%rip),%xmm8 # f78 <_sk_xor__ssse3_lowp+0xa3> + DB 243,68,15,89,5,124,7,0,0 ; mulss 0x77c(%rip),%xmm8 # f94 <_sk_xor__ssse3_lowp+0xa3> DB 243,65,15,44,192 ; cvttss2si %xmm8,%eax DB 102,68,15,110,192 ; movd %eax,%xmm8 DB 242,69,15,112,192,0 ; pshuflw $0x0,%xmm8,%xmm8 DB 102,69,15,112,192,80 ; pshufd $0x50,%xmm8,%xmm8 DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 DB 102,68,15,56,29,200 ; pabsw %xmm0,%xmm9 - DB 102,68,15,111,21,185,7,0,0 ; movdqa 0x7b9(%rip),%xmm10 # fe0 <_sk_xor__ssse3_lowp+0x10b> + DB 102,68,15,111,21,189,7,0,0 ; movdqa 0x7bd(%rip),%xmm10 # 1000 <_sk_xor__ssse3_lowp+0x10f> DB 102,69,15,249,208 ; psubw %xmm8,%xmm10 DB 102,15,111,196 ; movdqa %xmm4,%xmm0 DB 102,65,15,56,11,194 ; pmulhrsw %xmm10,%xmm0 @@ -26834,14 +26700,14 @@ _sk_lerp_u8_ssse3_lowp LABEL PROC DB 72,173 ; lods %ds:(%rsi),%rax DB 76,139,24 ; mov (%rax),%r11 DB 77,133,192 ; test %r8,%r8 - DB 15,133,171,0,0,0 ; jne 95b <_sk_lerp_u8_ssse3_lowp+0xba> + DB 15,133,171,0,0,0 ; jne 977 <_sk_lerp_u8_ssse3_lowp+0xba> DB 243,69,15,126,4,19 ; movq (%r11,%rdx,1),%xmm8 DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8 DB 102,65,15,113,240,8 ; psllw $0x8,%xmm8 - DB 102,68,15,228,5,38,7,0,0 ; pmulhuw 0x726(%rip),%xmm8 # ff0 <_sk_xor__ssse3_lowp+0x11b> + DB 102,68,15,228,5,42,7,0,0 ; pmulhuw 0x72a(%rip),%xmm8 # 1010 <_sk_xor__ssse3_lowp+0x11f> DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 DB 102,68,15,56,29,200 ; pabsw %xmm0,%xmm9 - DB 102,68,15,111,21,33,7,0,0 ; movdqa 0x721(%rip),%xmm10 # 1000 <_sk_xor__ssse3_lowp+0x12b> + DB 102,68,15,111,21,37,7,0,0 ; movdqa 0x725(%rip),%xmm10 # 1020 <_sk_xor__ssse3_lowp+0x12f> DB 102,69,15,249,208 ; psubw %xmm8,%xmm10 DB 102,15,111,196 ; movdqa %xmm4,%xmm0 DB 102,65,15,56,11,194 ; pmulhrsw %xmm10,%xmm0 @@ -26872,9 +26738,9 @@ _sk_lerp_u8_ssse3_lowp LABEL PROC DB 102,69,15,239,192 ; pxor %xmm8,%xmm8 DB 65,254,201 ; dec %r9b DB 65,128,249,6 ; cmp $0x6,%r9b - DB 15,135,71,255,255,255 ; ja 8bb <_sk_lerp_u8_ssse3_lowp+0x1a> + DB 15,135,71,255,255,255 ; ja 8d7 <_sk_lerp_u8_ssse3_lowp+0x1a> DB 69,15,182,201 ; movzbl %r9b,%r9d - DB 76,141,21,105,0,0,0 ; lea 0x69(%rip),%r10 # 9e8 <_sk_lerp_u8_ssse3_lowp+0x147> + DB 76,141,21,105,0,0,0 ; lea 0x69(%rip),%r10 # a04 <_sk_lerp_u8_ssse3_lowp+0x147> DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax DB 76,1,208 ; add %r10,%rax DB 255,224 ; jmpq *%rax @@ -26893,7 +26759,7 @@ _sk_lerp_u8_ssse3_lowp LABEL PROC DB 102,68,15,196,192,1 ; pinsrw $0x1,%eax,%xmm8 DB 65,15,182,4,19 ; movzbl (%r11,%rdx,1),%eax DB 102,68,15,196,192,0 ; pinsrw $0x0,%eax,%xmm8 - DB 233,214,254,255,255 ; jmpq 8bb <_sk_lerp_u8_ssse3_lowp+0x1a> + DB 233,214,254,255,255 ; jmpq 8d7 <_sk_lerp_u8_ssse3_lowp+0x1a> DB 15,31,0 ; nopl (%rax) DB 237 ; in (%dx),%eax DB 255 ; (bad) @@ -26973,7 +26839,7 @@ PUBLIC _sk_srcatop_ssse3_lowp _sk_srcatop_ssse3_lowp LABEL PROC DB 102,15,56,11,199 ; pmulhrsw %xmm7,%xmm0 DB 102,68,15,56,29,192 ; pabsw %xmm0,%xmm8 - DB 102,68,15,111,13,137,5,0,0 ; movdqa 0x589(%rip),%xmm9 # 1010 <_sk_xor__ssse3_lowp+0x13b> + DB 102,68,15,111,13,141,5,0,0 ; movdqa 0x58d(%rip),%xmm9 # 1030 <_sk_xor__ssse3_lowp+0x13f> DB 102,68,15,249,203 ; psubw %xmm3,%xmm9 DB 102,15,111,196 ; movdqa %xmm4,%xmm0 DB 102,65,15,56,11,193 ; pmulhrsw %xmm9,%xmm0 @@ -27004,7 +26870,7 @@ _sk_dstatop_ssse3_lowp LABEL PROC DB 102,68,15,111,196 ; movdqa %xmm4,%xmm8 DB 102,68,15,56,11,195 ; pmulhrsw %xmm3,%xmm8 DB 102,69,15,56,29,192 ; pabsw %xmm8,%xmm8 - DB 102,68,15,111,13,8,5,0,0 ; movdqa 0x508(%rip),%xmm9 # 1020 <_sk_xor__ssse3_lowp+0x14b> + DB 102,68,15,111,13,12,5,0,0 ; movdqa 0x50c(%rip),%xmm9 # 1040 <_sk_xor__ssse3_lowp+0x14f> DB 102,68,15,249,207 ; psubw %xmm7,%xmm9 DB 102,65,15,56,11,193 ; pmulhrsw %xmm9,%xmm0 DB 102,15,56,29,192 ; pabsw %xmm0,%xmm0 @@ -27061,7 +26927,7 @@ _sk_dstin_ssse3_lowp LABEL PROC PUBLIC _sk_srcout_ssse3_lowp _sk_srcout_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,46,4,0,0 ; movdqa 0x42e(%rip),%xmm8 # 1030 <_sk_xor__ssse3_lowp+0x15b> + DB 102,68,15,111,5,50,4,0,0 ; movdqa 0x432(%rip),%xmm8 # 1050 <_sk_xor__ssse3_lowp+0x15f> DB 102,68,15,249,199 ; psubw %xmm7,%xmm8 DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 DB 102,15,56,29,192 ; pabsw %xmm0,%xmm0 @@ -27076,7 +26942,7 @@ _sk_srcout_ssse3_lowp LABEL PROC PUBLIC _sk_dstout_ssse3_lowp _sk_dstout_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,255,3,0,0 ; movdqa 0x3ff(%rip),%xmm8 # 1040 <_sk_xor__ssse3_lowp+0x16b> + DB 102,68,15,111,5,3,4,0,0 ; movdqa 0x403(%rip),%xmm8 # 1060 <_sk_xor__ssse3_lowp+0x16f> DB 102,68,15,249,195 ; psubw %xmm3,%xmm8 DB 102,15,111,196 ; movdqa %xmm4,%xmm0 DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 @@ -27094,7 +26960,7 @@ _sk_dstout_ssse3_lowp LABEL PROC PUBLIC _sk_srcover_ssse3_lowp _sk_srcover_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,196,3,0,0 ; movdqa 0x3c4(%rip),%xmm8 # 1050 <_sk_xor__ssse3_lowp+0x17b> + DB 102,68,15,111,5,200,3,0,0 ; movdqa 0x3c8(%rip),%xmm8 # 1070 <_sk_xor__ssse3_lowp+0x17f> DB 102,68,15,249,195 ; psubw %xmm3,%xmm8 DB 102,68,15,111,204 ; movdqa %xmm4,%xmm9 DB 102,69,15,56,11,200 ; pmulhrsw %xmm8,%xmm9 @@ -27116,7 +26982,7 @@ _sk_srcover_ssse3_lowp LABEL PROC PUBLIC _sk_dstover_ssse3_lowp _sk_dstover_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,111,3,0,0 ; movdqa 0x36f(%rip),%xmm8 # 1060 <_sk_xor__ssse3_lowp+0x18b> + DB 102,68,15,111,5,115,3,0,0 ; movdqa 0x373(%rip),%xmm8 # 1080 <_sk_xor__ssse3_lowp+0x18f> DB 102,68,15,249,199 ; psubw %xmm7,%xmm8 DB 102,65,15,56,11,192 ; pmulhrsw %xmm8,%xmm0 DB 102,15,56,29,192 ; pabsw %xmm0,%xmm0 @@ -27148,7 +27014,7 @@ _sk_modulate_ssse3_lowp LABEL PROC PUBLIC _sk_multiply_ssse3_lowp _sk_multiply_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,4,3,0,0 ; movdqa 0x304(%rip),%xmm8 # 1070 <_sk_xor__ssse3_lowp+0x19b> + DB 102,68,15,111,5,8,3,0,0 ; movdqa 0x308(%rip),%xmm8 # 1090 <_sk_xor__ssse3_lowp+0x19f> DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9 DB 102,68,15,249,207 ; psubw %xmm7,%xmm9 DB 102,68,15,111,208 ; movdqa %xmm0,%xmm10 @@ -27204,7 +27070,7 @@ _sk_plus__ssse3_lowp LABEL PROC PUBLIC _sk_screen_ssse3_lowp _sk_screen_ssse3_lowp LABEL PROC - DB 102,68,15,111,5,22,2,0,0 ; movdqa 0x216(%rip),%xmm8 # 1080 <_sk_xor__ssse3_lowp+0x1ab> + DB 102,68,15,111,5,26,2,0,0 ; movdqa 0x21a(%rip),%xmm8 # 10a0 <_sk_xor__ssse3_lowp+0x1af> DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9 DB 102,68,15,249,200 ; psubw %xmm0,%xmm9 DB 102,68,15,56,11,204 ; pmulhrsw %xmm4,%xmm9 @@ -27229,7 +27095,7 @@ _sk_screen_ssse3_lowp LABEL PROC PUBLIC _sk_xor__ssse3_lowp _sk_xor__ssse3_lowp LABEL PROC - DB 102,68,15,111,5,178,1,0,0 ; movdqa 0x1b2(%rip),%xmm8 # 1090 <_sk_xor__ssse3_lowp+0x1bb> + DB 102,68,15,111,5,182,1,0,0 ; movdqa 0x1b6(%rip),%xmm8 # 10b0 <_sk_xor__ssse3_lowp+0x1bf> DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9 DB 102,68,15,249,207 ; psubw %xmm7,%xmm9 DB 102,65,15,56,11,193 ; pmulhrsw %xmm9,%xmm0 @@ -27276,7 +27142,7 @@ ALIGN 16 DB 11,15 ; or (%rdi),%ecx DB 129,128,129,128,129,128,129,128,129,128; addl $0x80818081,-0x7f7e7f7f(%rax) DB 129,128,129,128,129,128,0,4,8,12 ; addl $0xc080400,-0x7f7e7f7f(%rax) - DB 1,5,9,13,2,6 ; add %eax,0x6020d09(%rip) # 6021cb3 <_sk_xor__ssse3_lowp+0x6020dde> + DB 1,5,9,13,2,6 ; add %eax,0x6020d09(%rip) # 6021cd3 <_sk_xor__ssse3_lowp+0x6020de2> DB 10,14 ; or (%rsi),%cl DB 3,7 ; add (%rdi),%eax DB 11,15 ; or (%rdi),%ecx diff --git a/src/jumper/build_stages.py b/src/jumper/build_stages.py index 971087b3d5..02ebab0110 100755 --- a/src/jumper/build_stages.py +++ b/src/jumper/build_stages.py @@ -17,7 +17,7 @@ clang = [ccache, clang, '-x', 'c++'] cflags = ['-std=c++11', '-Os', '-DJUMPER', - '-fomit-frame-pointer', '-ffp-contract=fast', + '-momit-leaf-frame-pointer', '-ffp-contract=fast', '-fno-exceptions', '-fno-rtti', '-fno-unwind-tables'] win = ['-DWIN', '-mno-red-zone'] |