aboutsummaryrefslogtreecommitdiffhomepage
diff options
context:
space:
mode:
-rw-r--r--src/core/SkRasterPipeline.h1
-rw-r--r--src/jumper/SkJumper.h12
-rw-r--r--src/jumper/SkJumper_generated.S6842
-rw-r--r--src/jumper/SkJumper_generated_win.S6374
-rw-r--r--src/jumper/SkJumper_stages.cpp14
-rw-r--r--src/shaders/SkImageShader.cpp7
-rw-r--r--tests/SkRasterPipelineTest.cpp2
7 files changed, 6027 insertions, 7225 deletions
diff --git a/src/core/SkRasterPipeline.h b/src/core/SkRasterPipeline.h
index c7ff7704ba..b08cd3e00f 100644
--- a/src/core/SkRasterPipeline.h
+++ b/src/core/SkRasterPipeline.h
@@ -46,7 +46,6 @@ struct SkPM4f;
M(from_srgb) M(from_srgb_dst) M(to_srgb) \
M(black_color) M(white_color) M(uniform_color) \
M(seed_shader) M(dither) \
- M(gather_i8) \
M(load_a8) M(load_a8_dst) M(store_a8) M(gather_a8) \
M(load_g8) M(load_g8_dst) M(gather_g8) \
M(load_565) M(load_565_dst) M(store_565) M(gather_565) \
diff --git a/src/jumper/SkJumper.h b/src/jumper/SkJumper.h
index 2ad4ad993a..60e1156e3f 100644
--- a/src/jumper/SkJumper.h
+++ b/src/jumper/SkJumper.h
@@ -57,10 +57,9 @@ struct SkJumper_constants {
uint32_t iota_U32[SkJumper_kMaxStride]; // 0,1,2,3,4,...
};
-struct SkJumper_GatherCtx {
- const void* pixels;
- const uint32_t* ctable;
- int stride;
+struct SkJumper_MemoryCtx {
+ void* pixels;
+ int stride;
};
// State shared by save_xy, accumulate, and bilinear_* / bicubic_*.
@@ -117,9 +116,4 @@ struct SkJumper_2PtConicalCtx {
fDR;
};
-struct SkJumper_PtrStride {
- void* ptr;
- size_t stride;
-};
-
#endif//SkJumper_DEFINED
diff --git a/src/jumper/SkJumper_generated.S b/src/jumper/SkJumper_generated.S
index ba751fd41a..f2d3f7792a 100644
--- a/src/jumper/SkJumper_generated.S
+++ b/src/jumper/SkJumper_generated.S
@@ -3003,7 +3003,7 @@ _sk_gather_a8_aarch64:
.long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x52a77009 // mov w9, #0x3b800000
@@ -3188,7 +3188,7 @@ _sk_gather_g8_aarch64:
.long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x52a77009 // mov w9, #0x3b800000
@@ -3216,70 +3216,6 @@ _sk_gather_g8_aarch64:
.long 0x4ea01c02 // mov v2.16b, v0.16b
.long 0xd61f00a0 // br x5
-HIDDEN _sk_gather_i8_aarch64
-.globl _sk_gather_i8_aarch64
-FUNCTION(_sk_gather_i8_aarch64)
-_sk_gather_i8_aarch64:
- .long 0xaa0103e8 // mov x8, x1
- .long 0xf8408429 // ldr x9, [x1], #8
- .long 0xb4000069 // cbz x9, 2bc8 <sk_gather_i8_aarch64+0x14>
- .long 0xaa0903ea // mov x10, x9
- .long 0x14000003 // b 2bd0 <sk_gather_i8_aarch64+0x1c>
- .long 0xf940050a // ldr x10, [x8, #8]
- .long 0x91004101 // add x1, x8, #0x10
- .long 0xf8410548 // ldr x8, [x10], #16
- .long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
- .long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0xf9400529 // ldr x9, [x9, #8]
- .long 0x4d40c942 // ld1r {v2.4s}, [x10]
- .long 0x6f00e623 // movi v3.2d, #0xff000000ff
- .long 0x4ea19440 // mla v0.4s, v2.4s, v1.4s
- .long 0x1e26000d // fmov w13, s0
- .long 0x0e0c3c0a // mov w10, v0.s[1]
- .long 0x386d490d // ldrb w13, [x8, w13, uxtw]
- .long 0x0e143c0b // mov w11, v0.s[2]
- .long 0x386a490a // ldrb w10, [x8, w10, uxtw]
- .long 0x0e1c3c0c // mov w12, v0.s[3]
- .long 0x386b490b // ldrb w11, [x8, w11, uxtw]
- .long 0x386c4908 // ldrb w8, [x8, w12, uxtw]
- .long 0x4e021da0 // mov v0.h[0], w13
- .long 0x4e061d40 // mov v0.h[1], w10
- .long 0x4e0a1d60 // mov v0.h[2], w11
- .long 0x4e0e1d00 // mov v0.h[3], w8
- .long 0x2f10a400 // uxtl v0.4s, v0.4h
- .long 0x4e231c00 // and v0.16b, v0.16b, v3.16b
- .long 0x1e26000c // fmov w12, s0
- .long 0x8b2c492c // add x12, x9, w12, uxtw #2
- .long 0x0e0c3c08 // mov w8, v0.s[1]
- .long 0x0e143c0a // mov w10, v0.s[2]
- .long 0x0e1c3c0b // mov w11, v0.s[3]
- .long 0x0d408180 // ld1 {v0.s}[0], [x12]
- .long 0x8b284928 // add x8, x9, w8, uxtw #2
- .long 0xb86a592a // ldr w10, [x9, w10, uxtw #2]
- .long 0x52a7700c // mov w12, #0x3b800000
- .long 0x0d409100 // ld1 {v0.s}[1], [x8]
- .long 0xb86b5928 // ldr w8, [x9, w11, uxtw #2]
- .long 0x7290102c // movk w12, #0x8081
- .long 0xf8408425 // ldr x5, [x1], #8
- .long 0x4e141d40 // mov v0.s[2], w10
- .long 0x4e1c1d00 // mov v0.s[3], w8
- .long 0x4e231c01 // and v1.16b, v0.16b, v3.16b
- .long 0x6f380402 // ushr v2.4s, v0.4s, #8
- .long 0x6f300411 // ushr v17.4s, v0.4s, #16
- .long 0x4e040d90 // dup v16.4s, w12
- .long 0x6f280400 // ushr v0.4s, v0.4s, #24
- .long 0x4e21d821 // scvtf v1.4s, v1.4s
- .long 0x4e231c42 // and v2.16b, v2.16b, v3.16b
- .long 0x4e231e23 // and v3.16b, v17.16b, v3.16b
- .long 0x4e21d811 // scvtf v17.4s, v0.4s
- .long 0x6e30dc20 // fmul v0.4s, v1.4s, v16.4s
- .long 0x4e21d841 // scvtf v1.4s, v2.4s
- .long 0x4e21d862 // scvtf v2.4s, v3.4s
- .long 0x6e30dc21 // fmul v1.4s, v1.4s, v16.4s
- .long 0x6e30dc42 // fmul v2.4s, v2.4s, v16.4s
- .long 0x6e30de23 // fmul v3.4s, v17.4s, v16.4s
- .long 0xd61f00a0 // br x5
-
HIDDEN _sk_load_565_aarch64
.globl _sk_load_565_aarch64
FUNCTION(_sk_load_565_aarch64)
@@ -3287,7 +3223,7 @@ _sk_load_565_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020508 // add x8, x8, x2, lsl #1
- .long 0xb50003c4 // cbnz x4, 2d24 <sk_load_565_aarch64+0x84>
+ .long 0xb50003c4 // cbnz x4, 2c38 <sk_load_565_aarch64+0x84>
.long 0xfd400100 // ldr d0, [x8]
.long 0x321b17e8 // orr w8, wzr, #0x7e0
.long 0x4e040d02 // dup v2.4s, w8
@@ -3319,12 +3255,12 @@ _sk_load_565_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000220 // b.eq 2d70 <sk_load_565_aarch64+0xd0> // b.none
+ .long 0x54000220 // b.eq 2c84 <sk_load_565_aarch64+0xd0> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x2f00e400 // movi d0, #0x0
- .long 0x540000c0 // b.eq 2d50 <sk_load_565_aarch64+0xb0> // b.none
+ .long 0x540000c0 // b.eq 2c64 <sk_load_565_aarch64+0xb0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffba1 // b.ne 2cb4 <sk_load_565_aarch64+0x14> // b.any
+ .long 0x54fffba1 // b.ne 2bc8 <sk_load_565_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d405120 // ld1 {v0.h}[2], [x9]
@@ -3335,10 +3271,10 @@ _sk_load_565_aarch64:
.long 0x0e401821 // uzp1 v1.4h, v1.4h, v0.4h
.long 0x2e012000 // ext v0.8b, v0.8b, v1.8b, #4
.long 0x2e002000 // ext v0.8b, v0.8b, v0.8b, #4
- .long 0x17ffffd2 // b 2cb4 <sk_load_565_aarch64+0x14>
+ .long 0x17ffffd2 // b 2bc8 <sk_load_565_aarch64+0x14>
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d404100 // ld1 {v0.h}[0], [x8]
- .long 0x17ffffcf // b 2cb4 <sk_load_565_aarch64+0x14>
+ .long 0x17ffffcf // b 2bc8 <sk_load_565_aarch64+0x14>
HIDDEN _sk_load_565_dst_aarch64
.globl _sk_load_565_dst_aarch64
@@ -3347,7 +3283,7 @@ _sk_load_565_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020508 // add x8, x8, x2, lsl #1
- .long 0xb50003c4 // cbnz x4, 2e00 <sk_load_565_dst_aarch64+0x84>
+ .long 0xb50003c4 // cbnz x4, 2d14 <sk_load_565_dst_aarch64+0x84>
.long 0xfd400104 // ldr d4, [x8]
.long 0x321b17e8 // orr w8, wzr, #0x7e0
.long 0x4e040d06 // dup v6.4s, w8
@@ -3379,12 +3315,12 @@ _sk_load_565_dst_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000220 // b.eq 2e4c <sk_load_565_dst_aarch64+0xd0> // b.none
+ .long 0x54000220 // b.eq 2d60 <sk_load_565_dst_aarch64+0xd0> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x2f00e404 // movi d4, #0x0
- .long 0x540000c0 // b.eq 2e2c <sk_load_565_dst_aarch64+0xb0> // b.none
+ .long 0x540000c0 // b.eq 2d40 <sk_load_565_dst_aarch64+0xb0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffba1 // b.ne 2d90 <sk_load_565_dst_aarch64+0x14> // b.any
+ .long 0x54fffba1 // b.ne 2ca4 <sk_load_565_dst_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe4 // dup v4.4h, wzr
.long 0x0d405124 // ld1 {v4.h}[2], [x9]
@@ -3395,10 +3331,10 @@ _sk_load_565_dst_aarch64:
.long 0x0e4018a5 // uzp1 v5.4h, v5.4h, v0.4h
.long 0x2e052084 // ext v4.8b, v4.8b, v5.8b, #4
.long 0x2e042084 // ext v4.8b, v4.8b, v4.8b, #4
- .long 0x17ffffd2 // b 2d90 <sk_load_565_dst_aarch64+0x14>
+ .long 0x17ffffd2 // b 2ca4 <sk_load_565_dst_aarch64+0x14>
.long 0x0e020fe4 // dup v4.4h, wzr
.long 0x0d404104 // ld1 {v4.h}[0], [x8]
- .long 0x17ffffcf // b 2d90 <sk_load_565_dst_aarch64+0x14>
+ .long 0x17ffffcf // b 2ca4 <sk_load_565_dst_aarch64+0x14>
HIDDEN _sk_gather_565_aarch64
.globl _sk_gather_565_aarch64
@@ -3407,7 +3343,7 @@ _sk_gather_565_aarch64:
.long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x321b17e9 // orr w9, wzr, #0x7e0
@@ -3470,24 +3406,24 @@ _sk_store_565_aarch64:
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
.long 0x8b020508 // add x8, x8, x2, lsl #1
.long 0x0e612a10 // xtn v16.4h, v16.4s
- .long 0xb50000a4 // cbnz x4, 2f60 <sk_store_565_aarch64+0x58>
+ .long 0xb50000a4 // cbnz x4, 2e74 <sk_store_565_aarch64+0x58>
.long 0xfd000110 // str d16, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 2f8c <sk_store_565_aarch64+0x84> // b.none
+ .long 0x54000120 // b.eq 2ea0 <sk_store_565_aarch64+0x84> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 2f84 <sk_store_565_aarch64+0x7c> // b.none
+ .long 0x540000a0 // b.eq 2e98 <sk_store_565_aarch64+0x7c> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 2f54 <sk_store_565_aarch64+0x4c> // b.any
+ .long 0x54fffee1 // b.ne 2e68 <sk_store_565_aarch64+0x4c> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d005130 // st1 {v16.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d004930 // st1 {v16.h}[1], [x9]
.long 0x0d004110 // st1 {v16.h}[0], [x8]
- .long 0x17fffff1 // b 2f54 <sk_store_565_aarch64+0x4c>
+ .long 0x17fffff1 // b 2e68 <sk_store_565_aarch64+0x4c>
HIDDEN _sk_load_4444_aarch64
.globl _sk_load_4444_aarch64
@@ -3496,7 +3432,7 @@ _sk_load_4444_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020508 // add x8, x8, x2, lsl #1
- .long 0xb5000444 // cbnz x4, 3028 <sk_load_4444_aarch64+0x94>
+ .long 0xb5000444 // cbnz x4, 2f3c <sk_load_4444_aarch64+0x94>
.long 0xfd400100 // ldr d0, [x8]
.long 0x52a6f108 // mov w8, #0x37880000
.long 0x2f10a400 // uxtl v0.4s, v0.4h
@@ -3532,12 +3468,12 @@ _sk_load_4444_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000220 // b.eq 3074 <sk_load_4444_aarch64+0xe0> // b.none
+ .long 0x54000220 // b.eq 2f88 <sk_load_4444_aarch64+0xe0> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x2f00e400 // movi d0, #0x0
- .long 0x540000c0 // b.eq 3054 <sk_load_4444_aarch64+0xc0> // b.none
+ .long 0x540000c0 // b.eq 2f68 <sk_load_4444_aarch64+0xc0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffb21 // b.ne 2fa8 <sk_load_4444_aarch64+0x14> // b.any
+ .long 0x54fffb21 // b.ne 2ebc <sk_load_4444_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d405120 // ld1 {v0.h}[2], [x9]
@@ -3548,10 +3484,10 @@ _sk_load_4444_aarch64:
.long 0x0e401821 // uzp1 v1.4h, v1.4h, v0.4h
.long 0x2e012000 // ext v0.8b, v0.8b, v1.8b, #4
.long 0x2e002000 // ext v0.8b, v0.8b, v0.8b, #4
- .long 0x17ffffce // b 2fa8 <sk_load_4444_aarch64+0x14>
+ .long 0x17ffffce // b 2ebc <sk_load_4444_aarch64+0x14>
.long 0x0e020fe0 // dup v0.4h, wzr
.long 0x0d404100 // ld1 {v0.h}[0], [x8]
- .long 0x17ffffcb // b 2fa8 <sk_load_4444_aarch64+0x14>
+ .long 0x17ffffcb // b 2ebc <sk_load_4444_aarch64+0x14>
HIDDEN _sk_load_4444_dst_aarch64
.globl _sk_load_4444_dst_aarch64
@@ -3560,7 +3496,7 @@ _sk_load_4444_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020508 // add x8, x8, x2, lsl #1
- .long 0xb5000444 // cbnz x4, 3114 <sk_load_4444_dst_aarch64+0x94>
+ .long 0xb5000444 // cbnz x4, 3028 <sk_load_4444_dst_aarch64+0x94>
.long 0xfd400104 // ldr d4, [x8]
.long 0x52a6f108 // mov w8, #0x37880000
.long 0x2f10a484 // uxtl v4.4s, v4.4h
@@ -3596,12 +3532,12 @@ _sk_load_4444_dst_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000220 // b.eq 3160 <sk_load_4444_dst_aarch64+0xe0> // b.none
+ .long 0x54000220 // b.eq 3074 <sk_load_4444_dst_aarch64+0xe0> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x2f00e404 // movi d4, #0x0
- .long 0x540000c0 // b.eq 3140 <sk_load_4444_dst_aarch64+0xc0> // b.none
+ .long 0x540000c0 // b.eq 3054 <sk_load_4444_dst_aarch64+0xc0> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffb21 // b.ne 3094 <sk_load_4444_dst_aarch64+0x14> // b.any
+ .long 0x54fffb21 // b.ne 2fa8 <sk_load_4444_dst_aarch64+0x14> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0e020fe4 // dup v4.4h, wzr
.long 0x0d405124 // ld1 {v4.h}[2], [x9]
@@ -3612,10 +3548,10 @@ _sk_load_4444_dst_aarch64:
.long 0x0e4018a5 // uzp1 v5.4h, v5.4h, v0.4h
.long 0x2e052084 // ext v4.8b, v4.8b, v5.8b, #4
.long 0x2e042084 // ext v4.8b, v4.8b, v4.8b, #4
- .long 0x17ffffce // b 3094 <sk_load_4444_dst_aarch64+0x14>
+ .long 0x17ffffce // b 2fa8 <sk_load_4444_dst_aarch64+0x14>
.long 0x0e020fe4 // dup v4.4h, wzr
.long 0x0d404104 // ld1 {v4.h}[0], [x8]
- .long 0x17ffffcb // b 3094 <sk_load_4444_dst_aarch64+0x14>
+ .long 0x17ffffcb // b 2fa8 <sk_load_4444_dst_aarch64+0x14>
HIDDEN _sk_gather_4444_aarch64
.globl _sk_gather_4444_aarch64
@@ -3625,7 +3561,7 @@ _sk_gather_4444_aarch64:
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
.long 0x4f070603 // movi v3.4s, #0xf0
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x4f0005f0 // movi v16.4s, #0xf
@@ -3694,24 +3630,24 @@ _sk_store_4444_aarch64:
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
.long 0x8b020508 // add x8, x8, x2, lsl #1
.long 0x0e612a10 // xtn v16.4h, v16.4s
- .long 0xb50000a4 // cbnz x4, 3290 <sk_store_4444_aarch64+0x60>
+ .long 0xb50000a4 // cbnz x4, 31a4 <sk_store_4444_aarch64+0x60>
.long 0xfd000110 // str d16, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 32bc <sk_store_4444_aarch64+0x8c> // b.none
+ .long 0x54000120 // b.eq 31d0 <sk_store_4444_aarch64+0x8c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 32b4 <sk_store_4444_aarch64+0x84> // b.none
+ .long 0x540000a0 // b.eq 31c8 <sk_store_4444_aarch64+0x84> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 3284 <sk_store_4444_aarch64+0x54> // b.any
+ .long 0x54fffee1 // b.ne 3198 <sk_store_4444_aarch64+0x54> // b.any
.long 0x91001109 // add x9, x8, #0x4
.long 0x0d005130 // st1 {v16.h}[2], [x9]
.long 0x91000909 // add x9, x8, #0x2
.long 0x0d004930 // st1 {v16.h}[1], [x9]
.long 0x0d004110 // st1 {v16.h}[0], [x8]
- .long 0x17fffff1 // b 3284 <sk_store_4444_aarch64+0x54>
+ .long 0x17fffff1 // b 3198 <sk_store_4444_aarch64+0x54>
HIDDEN _sk_load_8888_aarch64
.globl _sk_load_8888_aarch64
@@ -3720,7 +3656,7 @@ _sk_load_8888_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020908 // add x8, x8, x2, lsl #2
- .long 0xb50002e4 // cbnz x4, 332c <sk_load_8888_aarch64+0x68>
+ .long 0xb50002e4 // cbnz x4, 3240 <sk_load_8888_aarch64+0x68>
.long 0x3dc00100 // ldr q0, [x8]
.long 0x6f00e621 // movi v1.2d, #0xff000000ff
.long 0x52a77008 // mov w8, #0x3b800000
@@ -3745,22 +3681,22 @@ _sk_load_8888_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x540001a0 // b.eq 3368 <sk_load_8888_aarch64+0xa4> // b.none
+ .long 0x540001a0 // b.eq 327c <sk_load_8888_aarch64+0xa4> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x6f00e400 // movi v0.2d, #0x0
- .long 0x540000c0 // b.eq 3358 <sk_load_8888_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 326c <sk_load_8888_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc81 // b.ne 32d8 <sk_load_8888_aarch64+0x14> // b.any
+ .long 0x54fffc81 // b.ne 31ec <sk_load_8888_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe0 // dup v0.4s, wzr
.long 0x4d408120 // ld1 {v0.s}[2], [x9]
.long 0xfd400101 // ldr d1, [x8]
.long 0x6e014000 // ext v0.16b, v0.16b, v1.16b, #8
.long 0x6e004000 // ext v0.16b, v0.16b, v0.16b, #8
- .long 0x17ffffdd // b 32d8 <sk_load_8888_aarch64+0x14>
+ .long 0x17ffffdd // b 31ec <sk_load_8888_aarch64+0x14>
.long 0x4e040fe0 // dup v0.4s, wzr
.long 0x0d408100 // ld1 {v0.s}[0], [x8]
- .long 0x17ffffda // b 32d8 <sk_load_8888_aarch64+0x14>
+ .long 0x17ffffda // b 31ec <sk_load_8888_aarch64+0x14>
HIDDEN _sk_load_8888_dst_aarch64
.globl _sk_load_8888_dst_aarch64
@@ -3769,7 +3705,7 @@ _sk_load_8888_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020908 // add x8, x8, x2, lsl #2
- .long 0xb50002e4 // cbnz x4, 33dc <sk_load_8888_dst_aarch64+0x68>
+ .long 0xb50002e4 // cbnz x4, 32f0 <sk_load_8888_dst_aarch64+0x68>
.long 0x3dc00104 // ldr q4, [x8]
.long 0x6f00e625 // movi v5.2d, #0xff000000ff
.long 0x52a77008 // mov w8, #0x3b800000
@@ -3794,22 +3730,22 @@ _sk_load_8888_dst_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x540001a0 // b.eq 3418 <sk_load_8888_dst_aarch64+0xa4> // b.none
+ .long 0x540001a0 // b.eq 332c <sk_load_8888_dst_aarch64+0xa4> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x6f00e404 // movi v4.2d, #0x0
- .long 0x540000c0 // b.eq 3408 <sk_load_8888_dst_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 331c <sk_load_8888_dst_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc81 // b.ne 3388 <sk_load_8888_dst_aarch64+0x14> // b.any
+ .long 0x54fffc81 // b.ne 329c <sk_load_8888_dst_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe4 // dup v4.4s, wzr
.long 0x4d408124 // ld1 {v4.s}[2], [x9]
.long 0xfd400105 // ldr d5, [x8]
.long 0x6e054084 // ext v4.16b, v4.16b, v5.16b, #8
.long 0x6e044084 // ext v4.16b, v4.16b, v4.16b, #8
- .long 0x17ffffdd // b 3388 <sk_load_8888_dst_aarch64+0x14>
+ .long 0x17ffffdd // b 329c <sk_load_8888_dst_aarch64+0x14>
.long 0x4e040fe4 // dup v4.4s, wzr
.long 0x0d408104 // ld1 {v4.s}[0], [x8]
- .long 0x17ffffda // b 3388 <sk_load_8888_dst_aarch64+0x14>
+ .long 0x17ffffda // b 329c <sk_load_8888_dst_aarch64+0x14>
HIDDEN _sk_gather_8888_aarch64
.globl _sk_gather_8888_aarch64
@@ -3818,7 +3754,7 @@ _sk_gather_8888_aarch64:
.long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x4ea19440 // mla v0.4s, v2.4s, v1.4s
@@ -3877,24 +3813,24 @@ _sk_store_8888_aarch64:
.long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b
.long 0x8b020908 // add x8, x8, x2, lsl #2
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0xb50000a4 // cbnz x4, 351c <sk_store_8888_aarch64+0x60>
+ .long 0xb50000a4 // cbnz x4, 3430 <sk_store_8888_aarch64+0x60>
.long 0x3d800110 // str q16, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 3548 <sk_store_8888_aarch64+0x8c> // b.none
+ .long 0x54000120 // b.eq 345c <sk_store_8888_aarch64+0x8c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 3540 <sk_store_8888_aarch64+0x84> // b.none
+ .long 0x540000a0 // b.eq 3454 <sk_store_8888_aarch64+0x84> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 3510 <sk_store_8888_aarch64+0x54> // b.any
+ .long 0x54fffee1 // b.ne 3424 <sk_store_8888_aarch64+0x54> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4d008130 // st1 {v16.s}[2], [x9]
.long 0xfd000110 // str d16, [x8]
- .long 0x17fffff3 // b 3510 <sk_store_8888_aarch64+0x54>
+ .long 0x17fffff3 // b 3424 <sk_store_8888_aarch64+0x54>
.long 0x0d008110 // st1 {v16.s}[0], [x8]
- .long 0x17fffff1 // b 3510 <sk_store_8888_aarch64+0x54>
+ .long 0x17fffff1 // b 3424 <sk_store_8888_aarch64+0x54>
HIDDEN _sk_store_8888_2d_aarch64
.globl _sk_store_8888_2d_aarch64
@@ -3906,7 +3842,8 @@ _sk_store_8888_2d_aarch64:
.long 0x6e30dc32 // fmul v18.4s, v1.4s, v16.4s
.long 0x6e30dc11 // fmul v17.4s, v0.4s, v16.4s
.long 0x6e21aa52 // fcvtnu v18.4s, v18.4s
- .long 0xa9402109 // ldp x9, x8, [x8]
+ .long 0xf9400109 // ldr x9, [x8]
+ .long 0xb9800908 // ldrsw x8, [x8, #8]
.long 0x6e21aa31 // fcvtnu v17.4s, v17.4s
.long 0x4f285652 // shl v18.4s, v18.4s, #8
.long 0x4eb11e51 // orr v17.16b, v18.16b, v17.16b
@@ -3921,24 +3858,24 @@ _sk_store_8888_2d_aarch64:
.long 0x8b080928 // add x8, x9, x8, lsl #2
.long 0x8b020908 // add x8, x8, x2, lsl #2
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0xb50000a4 // cbnz x4, 35b8 <sk_store_8888_2d_aarch64+0x68>
+ .long 0xb50000a4 // cbnz x4, 34d0 <sk_store_8888_2d_aarch64+0x6c>
.long 0x3d800110 // str q16, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 35e4 <sk_store_8888_2d_aarch64+0x94> // b.none
+ .long 0x54000120 // b.eq 34fc <sk_store_8888_2d_aarch64+0x98> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 35dc <sk_store_8888_2d_aarch64+0x8c> // b.none
+ .long 0x540000a0 // b.eq 34f4 <sk_store_8888_2d_aarch64+0x90> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 35ac <sk_store_8888_2d_aarch64+0x5c> // b.any
+ .long 0x54fffee1 // b.ne 34c4 <sk_store_8888_2d_aarch64+0x60> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4d008130 // st1 {v16.s}[2], [x9]
.long 0xfd000110 // str d16, [x8]
- .long 0x17fffff3 // b 35ac <sk_store_8888_2d_aarch64+0x5c>
+ .long 0x17fffff3 // b 34c4 <sk_store_8888_2d_aarch64+0x60>
.long 0x0d008110 // st1 {v16.s}[0], [x8]
- .long 0x17fffff1 // b 35ac <sk_store_8888_2d_aarch64+0x5c>
+ .long 0x17fffff1 // b 34c4 <sk_store_8888_2d_aarch64+0x60>
HIDDEN _sk_load_bgra_aarch64
.globl _sk_load_bgra_aarch64
@@ -3947,7 +3884,7 @@ _sk_load_bgra_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020908 // add x8, x8, x2, lsl #2
- .long 0xb50002e4 // cbnz x4, 3654 <sk_load_bgra_aarch64+0x68>
+ .long 0xb50002e4 // cbnz x4, 356c <sk_load_bgra_aarch64+0x68>
.long 0x3dc00100 // ldr q0, [x8]
.long 0x6f00e621 // movi v1.2d, #0xff000000ff
.long 0x52a77008 // mov w8, #0x3b800000
@@ -3972,22 +3909,22 @@ _sk_load_bgra_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x540001a0 // b.eq 3690 <sk_load_bgra_aarch64+0xa4> // b.none
+ .long 0x540001a0 // b.eq 35a8 <sk_load_bgra_aarch64+0xa4> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x6f00e400 // movi v0.2d, #0x0
- .long 0x540000c0 // b.eq 3680 <sk_load_bgra_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 3598 <sk_load_bgra_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc81 // b.ne 3600 <sk_load_bgra_aarch64+0x14> // b.any
+ .long 0x54fffc81 // b.ne 3518 <sk_load_bgra_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe0 // dup v0.4s, wzr
.long 0x4d408120 // ld1 {v0.s}[2], [x9]
.long 0xfd400101 // ldr d1, [x8]
.long 0x6e014000 // ext v0.16b, v0.16b, v1.16b, #8
.long 0x6e004000 // ext v0.16b, v0.16b, v0.16b, #8
- .long 0x17ffffdd // b 3600 <sk_load_bgra_aarch64+0x14>
+ .long 0x17ffffdd // b 3518 <sk_load_bgra_aarch64+0x14>
.long 0x4e040fe0 // dup v0.4s, wzr
.long 0x0d408100 // ld1 {v0.s}[0], [x8]
- .long 0x17ffffda // b 3600 <sk_load_bgra_aarch64+0x14>
+ .long 0x17ffffda // b 3518 <sk_load_bgra_aarch64+0x14>
HIDDEN _sk_load_bgra_dst_aarch64
.globl _sk_load_bgra_dst_aarch64
@@ -3996,7 +3933,7 @@ _sk_load_bgra_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020908 // add x8, x8, x2, lsl #2
- .long 0xb50002e4 // cbnz x4, 3704 <sk_load_bgra_dst_aarch64+0x68>
+ .long 0xb50002e4 // cbnz x4, 361c <sk_load_bgra_dst_aarch64+0x68>
.long 0x3dc00104 // ldr q4, [x8]
.long 0x6f00e625 // movi v5.2d, #0xff000000ff
.long 0x52a77008 // mov w8, #0x3b800000
@@ -4021,22 +3958,22 @@ _sk_load_bgra_dst_aarch64:
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x540001a0 // b.eq 3740 <sk_load_bgra_dst_aarch64+0xa4> // b.none
+ .long 0x540001a0 // b.eq 3658 <sk_load_bgra_dst_aarch64+0xa4> // b.none
.long 0x7100093f // cmp w9, #0x2
.long 0x6f00e404 // movi v4.2d, #0x0
- .long 0x540000c0 // b.eq 3730 <sk_load_bgra_dst_aarch64+0x94> // b.none
+ .long 0x540000c0 // b.eq 3648 <sk_load_bgra_dst_aarch64+0x94> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffc81 // b.ne 36b0 <sk_load_bgra_dst_aarch64+0x14> // b.any
+ .long 0x54fffc81 // b.ne 35c8 <sk_load_bgra_dst_aarch64+0x14> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4e040fe4 // dup v4.4s, wzr
.long 0x4d408124 // ld1 {v4.s}[2], [x9]
.long 0xfd400105 // ldr d5, [x8]
.long 0x6e054084 // ext v4.16b, v4.16b, v5.16b, #8
.long 0x6e044084 // ext v4.16b, v4.16b, v4.16b, #8
- .long 0x17ffffdd // b 36b0 <sk_load_bgra_dst_aarch64+0x14>
+ .long 0x17ffffdd // b 35c8 <sk_load_bgra_dst_aarch64+0x14>
.long 0x4e040fe4 // dup v4.4s, wzr
.long 0x0d408104 // ld1 {v4.s}[0], [x8]
- .long 0x17ffffda // b 36b0 <sk_load_bgra_dst_aarch64+0x14>
+ .long 0x17ffffda // b 35c8 <sk_load_bgra_dst_aarch64+0x14>
HIDDEN _sk_gather_bgra_aarch64
.globl _sk_gather_bgra_aarch64
@@ -4045,7 +3982,7 @@ _sk_gather_bgra_aarch64:
.long 0xa8c11428 // ldp x8, x5, [x1], #16
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x4ea19440 // mla v0.4s, v2.4s, v1.4s
@@ -4104,24 +4041,24 @@ _sk_store_bgra_aarch64:
.long 0x4eb21e31 // orr v17.16b, v17.16b, v18.16b
.long 0x8b020908 // add x8, x8, x2, lsl #2
.long 0x4eb01e30 // orr v16.16b, v17.16b, v16.16b
- .long 0xb50000a4 // cbnz x4, 3844 <sk_store_bgra_aarch64+0x60>
+ .long 0xb50000a4 // cbnz x4, 375c <sk_store_bgra_aarch64+0x60>
.long 0x3d800110 // str q16, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x12000489 // and w9, w4, #0x3
.long 0x7100053f // cmp w9, #0x1
- .long 0x54000120 // b.eq 3870 <sk_store_bgra_aarch64+0x8c> // b.none
+ .long 0x54000120 // b.eq 3788 <sk_store_bgra_aarch64+0x8c> // b.none
.long 0x7100093f // cmp w9, #0x2
- .long 0x540000a0 // b.eq 3868 <sk_store_bgra_aarch64+0x84> // b.none
+ .long 0x540000a0 // b.eq 3780 <sk_store_bgra_aarch64+0x84> // b.none
.long 0x71000d3f // cmp w9, #0x3
- .long 0x54fffee1 // b.ne 3838 <sk_store_bgra_aarch64+0x54> // b.any
+ .long 0x54fffee1 // b.ne 3750 <sk_store_bgra_aarch64+0x54> // b.any
.long 0x91002109 // add x9, x8, #0x8
.long 0x4d008130 // st1 {v16.s}[2], [x9]
.long 0xfd000110 // str d16, [x8]
- .long 0x17fffff3 // b 3838 <sk_store_bgra_aarch64+0x54>
+ .long 0x17fffff3 // b 3750 <sk_store_bgra_aarch64+0x54>
.long 0x0d008110 // st1 {v16.s}[0], [x8]
- .long 0x17fffff1 // b 3838 <sk_store_bgra_aarch64+0x54>
+ .long 0x17fffff1 // b 3750 <sk_store_bgra_aarch64+0x54>
HIDDEN _sk_load_f16_aarch64
.globl _sk_load_f16_aarch64
@@ -4130,7 +4067,7 @@ _sk_load_f16_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020d08 // add x8, x8, x2, lsl #3
- .long 0xb5000124 // cbnz x4, 38a8 <sk_load_f16_aarch64+0x30>
+ .long 0xb5000124 // cbnz x4, 37c0 <sk_load_f16_aarch64+0x30>
.long 0x0c400510 // ld4 {v16.4h-v19.4h}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x0e217a00 // fcvtl v0.4s, v16.4h
@@ -4141,14 +4078,14 @@ _sk_load_f16_aarch64:
.long 0xd61f00a0 // br x5
.long 0x0d606110 // ld4 {v16.h-v19.h}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54fffee0 // b.eq 388c <sk_load_f16_aarch64+0x14> // b.none
+ .long 0x54fffee0 // b.eq 37a4 <sk_load_f16_aarch64+0x14> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0x0d606930 // ld4 {v16.h-v19.h}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffe63 // b.cc 388c <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffe63 // b.cc 37a4 <sk_load_f16_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d607110 // ld4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff0 // b 388c <sk_load_f16_aarch64+0x14>
+ .long 0x17fffff0 // b 37a4 <sk_load_f16_aarch64+0x14>
HIDDEN _sk_load_f16_dst_aarch64
.globl _sk_load_f16_dst_aarch64
@@ -4157,7 +4094,7 @@ _sk_load_f16_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020d08 // add x8, x8, x2, lsl #3
- .long 0xb5000124 // cbnz x4, 3900 <sk_load_f16_dst_aarch64+0x30>
+ .long 0xb5000124 // cbnz x4, 3818 <sk_load_f16_dst_aarch64+0x30>
.long 0x0c400510 // ld4 {v16.4h-v19.4h}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x0e217a04 // fcvtl v4.4s, v16.4h
@@ -4168,14 +4105,14 @@ _sk_load_f16_dst_aarch64:
.long 0xd61f00a0 // br x5
.long 0x0d606110 // ld4 {v16.h-v19.h}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54fffee0 // b.eq 38e4 <sk_load_f16_dst_aarch64+0x14> // b.none
+ .long 0x54fffee0 // b.eq 37fc <sk_load_f16_dst_aarch64+0x14> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0x0d606930 // ld4 {v16.h-v19.h}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffe63 // b.cc 38e4 <sk_load_f16_dst_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffe63 // b.cc 37fc <sk_load_f16_dst_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d607110 // ld4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff0 // b 38e4 <sk_load_f16_dst_aarch64+0x14>
+ .long 0x17fffff0 // b 37fc <sk_load_f16_dst_aarch64+0x14>
HIDDEN _sk_gather_f16_aarch64
.globl _sk_gather_f16_aarch64
@@ -4188,7 +4125,7 @@ _sk_gather_f16_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0x4ea1b821 // fcvtzs v1.4s, v1.4s
.long 0x4ea1b800 // fcvtzs v0.4s, v0.4s
- .long 0x91004109 // add x9, x8, #0x10
+ .long 0x91002109 // add x9, x8, #0x8
.long 0x4d40c922 // ld1r {v2.4s}, [x9]
.long 0xf9400108 // ldr x8, [x8]
.long 0x4ea19440 // mla v0.4s, v2.4s, v1.4s
@@ -4229,21 +4166,21 @@ _sk_store_f16_aarch64:
.long 0xf9400108 // ldr x8, [x8]
.long 0x0e216873 // fcvtn v19.4h, v3.4s
.long 0x8b020d08 // add x8, x8, x2, lsl #3
- .long 0xb50000a4 // cbnz x4, 39e8 <sk_store_f16_aarch64+0x30>
+ .long 0xb50000a4 // cbnz x4, 3900 <sk_store_f16_aarch64+0x30>
.long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0xf100049f // cmp x4, #0x1
.long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8]
- .long 0x54ffff60 // b.eq 39dc <sk_store_f16_aarch64+0x24> // b.none
+ .long 0x54ffff60 // b.eq 38f4 <sk_store_f16_aarch64+0x24> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0xf1000c9f // cmp x4, #0x3
.long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9]
- .long 0x54fffee3 // b.cc 39dc <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 38f4 <sk_store_f16_aarch64+0x24> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff4 // b 39dc <sk_store_f16_aarch64+0x24>
+ .long 0x17fffff4 // b 38f4 <sk_store_f16_aarch64+0x24>
HIDDEN _sk_load_u16_be_aarch64
.globl _sk_load_u16_be_aarch64
@@ -4252,7 +4189,7 @@ _sk_load_u16_be_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b020d08 // add x8, x8, x2, lsl #3
- .long 0xb5000404 // cbnz x4, 3a9c <sk_load_u16_be_aarch64+0x8c>
+ .long 0xb5000404 // cbnz x4, 39b4 <sk_load_u16_be_aarch64+0x8c>
.long 0x0c400500 // ld4 {v0.4h-v3.4h}, [x8]
.long 0x0f185410 // shl v16.4h, v0.4h, #8
.long 0x2f180411 // ushr v17.4h, v0.4h, #8
@@ -4286,14 +4223,14 @@ _sk_load_u16_be_aarch64:
.long 0xd61f00a0 // br x5
.long 0x0d606100 // ld4 {v0.h-v3.h}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54fffc00 // b.eq 3a24 <sk_load_u16_be_aarch64+0x14> // b.none
+ .long 0x54fffc00 // b.eq 393c <sk_load_u16_be_aarch64+0x14> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0x0d606920 // ld4 {v0.h-v3.h}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffb83 // b.cc 3a24 <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffb83 // b.cc 393c <sk_load_u16_be_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d607100 // ld4 {v0.h-v3.h}[2], [x8]
- .long 0x17ffffd9 // b 3a24 <sk_load_u16_be_aarch64+0x14>
+ .long 0x17ffffd9 // b 393c <sk_load_u16_be_aarch64+0x14>
HIDDEN _sk_load_rgb_u16_be_aarch64
.globl _sk_load_rgb_u16_be_aarch64
@@ -4303,7 +4240,7 @@ _sk_load_rgb_u16_be_aarch64:
.long 0x321f07e9 // orr w9, wzr, #0x6
.long 0xf9400108 // ldr x8, [x8]
.long 0x9b092048 // madd x8, x2, x9, x8
- .long 0xb5000384 // cbnz x4, 3b44 <sk_load_rgb_u16_be_aarch64+0x80>
+ .long 0xb5000384 // cbnz x4, 3a5c <sk_load_rgb_u16_be_aarch64+0x80>
.long 0x0c404500 // ld3 {v0.4h-v2.4h}, [x8]
.long 0x0f185403 // shl v3.4h, v0.4h, #8
.long 0x2f180410 // ushr v16.4h, v0.4h, #8
@@ -4333,14 +4270,14 @@ _sk_load_rgb_u16_be_aarch64:
.long 0xd61f00a0 // br x5
.long 0x0d406100 // ld3 {v0.h-v2.h}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54fffc80 // b.eq 3adc <sk_load_rgb_u16_be_aarch64+0x18> // b.none
+ .long 0x54fffc80 // b.eq 39f4 <sk_load_rgb_u16_be_aarch64+0x18> // b.none
.long 0x91001909 // add x9, x8, #0x6
.long 0x0d406920 // ld3 {v0.h-v2.h}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffc03 // b.cc 3adc <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
+ .long 0x54fffc03 // b.cc 39f4 <sk_load_rgb_u16_be_aarch64+0x18> // b.lo, b.ul, b.last
.long 0x91003108 // add x8, x8, #0xc
.long 0x0d407100 // ld3 {v0.h-v2.h}[2], [x8]
- .long 0x17ffffdd // b 3adc <sk_load_rgb_u16_be_aarch64+0x18>
+ .long 0x17ffffdd // b 39f4 <sk_load_rgb_u16_be_aarch64+0x18>
HIDDEN _sk_store_u16_be_aarch64
.globl _sk_store_u16_be_aarch64
@@ -4376,21 +4313,21 @@ _sk_store_u16_be_aarch64:
.long 0x2f180694 // ushr v20.4h, v20.4h, #8
.long 0x8b020d08 // add x8, x8, x2, lsl #3
.long 0x0eb41eb3 // orr v19.8b, v21.8b, v20.8b
- .long 0xb50000a4 // cbnz x4, 3bf8 <sk_store_u16_be_aarch64+0x8c>
+ .long 0xb50000a4 // cbnz x4, 3b10 <sk_store_u16_be_aarch64+0x8c>
.long 0x0c000510 // st4 {v16.4h-v19.4h}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0xf100049f // cmp x4, #0x1
.long 0x0d206110 // st4 {v16.h-v19.h}[0], [x8]
- .long 0x54ffff60 // b.eq 3bec <sk_store_u16_be_aarch64+0x80> // b.none
+ .long 0x54ffff60 // b.eq 3b04 <sk_store_u16_be_aarch64+0x80> // b.none
.long 0x91002109 // add x9, x8, #0x8
.long 0xf1000c9f // cmp x4, #0x3
.long 0x0d206930 // st4 {v16.h-v19.h}[1], [x9]
- .long 0x54fffee3 // b.cc 3bec <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3b04 <sk_store_u16_be_aarch64+0x80> // b.lo, b.ul, b.last
.long 0x91004108 // add x8, x8, #0x10
.long 0x0d207110 // st4 {v16.h-v19.h}[2], [x8]
- .long 0x17fffff4 // b 3bec <sk_store_u16_be_aarch64+0x80>
+ .long 0x17fffff4 // b 3b04 <sk_store_u16_be_aarch64+0x80>
HIDDEN _sk_load_f32_aarch64
.globl _sk_load_f32_aarch64
@@ -4399,21 +4336,21 @@ _sk_load_f32_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b021108 // add x8, x8, x2, lsl #4
- .long 0xb50000a4 // cbnz x4, 3c40 <sk_load_f32_aarch64+0x20>
+ .long 0xb50000a4 // cbnz x4, 3b58 <sk_load_f32_aarch64+0x20>
.long 0x4c400900 // ld4 {v0.4s-v3.4s}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x0d60a100 // ld4 {v0.s-v3.s}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54ffff60 // b.eq 3c34 <sk_load_f32_aarch64+0x14> // b.none
+ .long 0x54ffff60 // b.eq 3b4c <sk_load_f32_aarch64+0x14> // b.none
.long 0x91004109 // add x9, x8, #0x10
.long 0x0d60b120 // ld4 {v0.s-v3.s}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffee3 // b.cc 3c34 <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3b4c <sk_load_f32_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91008108 // add x8, x8, #0x20
.long 0x4d60a100 // ld4 {v0.s-v3.s}[2], [x8]
- .long 0x17fffff4 // b 3c34 <sk_load_f32_aarch64+0x14>
+ .long 0x17fffff4 // b 3b4c <sk_load_f32_aarch64+0x14>
HIDDEN _sk_load_f32_dst_aarch64
.globl _sk_load_f32_dst_aarch64
@@ -4422,21 +4359,21 @@ _sk_load_f32_dst_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b021108 // add x8, x8, x2, lsl #4
- .long 0xb50000a4 // cbnz x4, 3c88 <sk_load_f32_dst_aarch64+0x20>
+ .long 0xb50000a4 // cbnz x4, 3ba0 <sk_load_f32_dst_aarch64+0x20>
.long 0x4c400904 // ld4 {v4.4s-v7.4s}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0x0d60a104 // ld4 {v4.s-v7.s}[0], [x8]
.long 0xf100049f // cmp x4, #0x1
- .long 0x54ffff60 // b.eq 3c7c <sk_load_f32_dst_aarch64+0x14> // b.none
+ .long 0x54ffff60 // b.eq 3b94 <sk_load_f32_dst_aarch64+0x14> // b.none
.long 0x91004109 // add x9, x8, #0x10
.long 0x0d60b124 // ld4 {v4.s-v7.s}[1], [x9]
.long 0xf1000c9f // cmp x4, #0x3
- .long 0x54fffee3 // b.cc 3c7c <sk_load_f32_dst_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3b94 <sk_load_f32_dst_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91008108 // add x8, x8, #0x20
.long 0x4d60a104 // ld4 {v4.s-v7.s}[2], [x8]
- .long 0x17fffff4 // b 3c7c <sk_load_f32_dst_aarch64+0x14>
+ .long 0x17fffff4 // b 3b94 <sk_load_f32_dst_aarch64+0x14>
HIDDEN _sk_store_f32_aarch64
.globl _sk_store_f32_aarch64
@@ -4445,21 +4382,21 @@ _sk_store_f32_aarch64:
.long 0xf9400028 // ldr x8, [x1]
.long 0xf9400108 // ldr x8, [x8]
.long 0x8b021108 // add x8, x8, x2, lsl #4
- .long 0xb50000a4 // cbnz x4, 3cd0 <sk_store_f32_aarch64+0x20>
+ .long 0xb50000a4 // cbnz x4, 3be8 <sk_store_f32_aarch64+0x20>
.long 0x4c000900 // st4 {v0.4s-v3.4s}, [x8]
.long 0xf9400425 // ldr x5, [x1, #8]
.long 0x91004021 // add x1, x1, #0x10
.long 0xd61f00a0 // br x5
.long 0xf100049f // cmp x4, #0x1
.long 0x0d20a100 // st4 {v0.s-v3.s}[0], [x8]
- .long 0x54ffff60 // b.eq 3cc4 <sk_store_f32_aarch64+0x14> // b.none
+ .long 0x54ffff60 // b.eq 3bdc <sk_store_f32_aarch64+0x14> // b.none
.long 0x91004109 // add x9, x8, #0x10
.long 0xf1000c9f // cmp x4, #0x3
.long 0x0d20b120 // st4 {v0.s-v3.s}[1], [x9]
- .long 0x54fffee3 // b.cc 3cc4 <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last
+ .long 0x54fffee3 // b.cc 3bdc <sk_store_f32_aarch64+0x14> // b.lo, b.ul, b.last
.long 0x91008108 // add x8, x8, #0x20
.long 0x4d20a100 // st4 {v0.s-v3.s}[2], [x8]
- .long 0x17fffff4 // b 3cc4 <sk_store_f32_aarch64+0x14>
+ .long 0x17fffff4 // b 3bdc <sk_store_f32_aarch64+0x14>
HIDDEN _sk_clamp_x_aarch64
.globl _sk_clamp_x_aarch64
@@ -4944,7 +4881,7 @@ _sk_gradient_aarch64:
.long 0x6f00e411 // movi v17.2d, #0x0
.long 0xf9400109 // ldr x9, [x8]
.long 0xf100093f // cmp x9, #0x2
- .long 0x540001c3 // b.cc 4330 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last
+ .long 0x540001c3 // b.cc 4248 <sk_gradient_aarch64+0x58> // b.lo, b.ul, b.last
.long 0xf940250a // ldr x10, [x8, #72]
.long 0xd1000529 // sub x9, x9, #0x1
.long 0x6f00e401 // movi v1.2d, #0x0
@@ -4955,7 +4892,7 @@ _sk_gradient_aarch64:
.long 0x6e23e403 // fcmge v3.4s, v0.4s, v3.4s
.long 0x4e221c63 // and v3.16b, v3.16b, v2.16b
.long 0x4ea18461 // add v1.4s, v3.4s, v1.4s
- .long 0xb5ffff69 // cbnz x9, 4310 <sk_gradient_aarch64+0x38>
+ .long 0xb5ffff69 // cbnz x9, 4228 <sk_gradient_aarch64+0x38>
.long 0x6f20a431 // uxtl2 v17.2d, v1.4s
.long 0x2f20a421 // uxtl v1.2d, v1.2s
.long 0xa940b10a // ldp x10, x12, [x8, #8]
@@ -8691,7 +8628,7 @@ _sk_gather_a8_vfp4:
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xf2800010 // vmov.i32 d0, #0
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xf2801010 // vmov.i32 d1, #0
.long 0xf2802010 // vmov.i32 d2, #0
.long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
@@ -8835,7 +8772,7 @@ _sk_gather_g8_vfp4:
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xf2873f10 // vmov.f32 d3, #1
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
.long 0xf26219a0 // vmla.i32 d17, d18, d16
.long 0xee11eb90 // vmov.32 lr, d17[0]
@@ -8857,59 +8794,6 @@ _sk_gather_g8_vfp4:
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
-HIDDEN _sk_gather_i8_vfp4
-.globl _sk_gather_i8_vfp4
-FUNCTION(_sk_gather_i8_vfp4)
-_sk_gather_i8_vfp4:
- .long 0xe92d4830 // push {r4, r5, fp, lr}
- .long 0xe1a0c001 // mov ip, r1
- .long 0xe491e004 // ldr lr, [r1], #4
- .long 0xf3fb0701 // vcvt.s32.f32 d16, d1
- .long 0xe35e0000 // cmp lr, #0
- .long 0xf3fb1700 // vcvt.s32.f32 d17, d0
- .long 0xe1a0400e // mov r4, lr
- .long 0x028c1008 // addeq r1, ip, #8
- .long 0x059c4004 // ldreq r4, [ip, #4]
- .long 0xe494c008 // ldr ip, [r4], #8
- .long 0xf4e42c9f // vld1.32 {d18[]}, [r4 :32]
- .long 0xf26219a0 // vmla.i32 d17, d18, d16
- .long 0xee114b90 // vmov.32 r4, d17[0]
- .long 0xee315b90 // vmov.32 r5, d17[1]
- .long 0xf3c7101f // vmov.i32 d17, #255
- .long 0xe7dc4004 // ldrb r4, [ip, r4]
- .long 0xe7dc5005 // ldrb r5, [ip, r5]
- .long 0xee004b90 // vmov.32 d16[0], r4
- .long 0xe59e4004 // ldr r4, [lr, #4]
- .long 0xee205b90 // vmov.32 d16[1], r5
- .long 0xf24001b1 // vand d16, d16, d17
- .long 0xee105b90 // vmov.32 r5, d16[0]
- .long 0xee30cb90 // vmov.32 ip, d16[1]
- .long 0xe0845105 // add r5, r4, r5, lsl #2
- .long 0xf4e5083f // vld1.32 {d16[0]}, [r5 :32]
- .long 0xe084510c // add r5, r4, ip, lsl #2
- .long 0xf4e508bf // vld1.32 {d16[1]}, [r5 :32]
- .long 0xf24021b1 // vand d18, d16, d17
- .long 0xf3f83030 // vshr.u32 d19, d16, #8
- .long 0xf3e84030 // vshr.u32 d20, d16, #24
- .long 0xe491c004 // ldr ip, [r1], #4
- .long 0xf3f00030 // vshr.u32 d16, d16, #16
- .long 0xf24331b1 // vand d19, d19, d17
- .long 0xf24001b1 // vand d16, d16, d17
- .long 0xeddf1b0a // vldr d17, [pc, #40]
- .long 0xf3fb2622 // vcvt.f32.s32 d18, d18
- .long 0xf3fb4624 // vcvt.f32.s32 d20, d20
- .long 0xf3fb3623 // vcvt.f32.s32 d19, d19
- .long 0xf3fb0620 // vcvt.f32.s32 d16, d16
- .long 0xf3020db1 // vmul.f32 d0, d18, d17
- .long 0xf3043db1 // vmul.f32 d3, d20, d17
- .long 0xf3031db1 // vmul.f32 d1, d19, d17
- .long 0xf3002db1 // vmul.f32 d2, d16, d17
- .long 0xe8bd4830 // pop {r4, r5, fp, lr}
- .long 0xe12fff1c // bx ip
- .long 0xe320f000 // nop {0}
- .long 0x3b808081 // .word 0x3b808081
- .long 0x3b808081 // .word 0x3b808081
-
HIDDEN _sk_load_565_vfp4
.globl _sk_load_565_vfp4
FUNCTION(_sk_load_565_vfp4)
@@ -8921,7 +8805,7 @@ _sk_load_565_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc082 // add ip, ip, r2, lsl #1
- .long 0x0a00001a // beq 2e64 <sk_load_565_vfp4+0x8c>
+ .long 0x0a00001a // beq 2da4 <sk_load_565_vfp4+0x8c>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
@@ -8952,7 +8836,7 @@ _sk_load_565_vfp4:
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xeddf0a08 // vldr s1, [pc, #32]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeaffffe5 // b 2e0c <sk_load_565_vfp4+0x34>
+ .long 0xeaffffe5 // b 2d4c <sk_load_565_vfp4+0x34>
.long 0xe320f000 // nop {0}
.long 0x37842108 // .word 0x37842108
.long 0x37842108 // .word 0x37842108
@@ -8974,7 +8858,7 @@ _sk_load_565_dst_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc082 // add ip, ip, r2, lsl #1
- .long 0x0a00001a // beq 2f24 <sk_load_565_dst_vfp4+0x8c>
+ .long 0x0a00001a // beq 2e64 <sk_load_565_dst_vfp4+0x8c>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
@@ -9005,7 +8889,7 @@ _sk_load_565_dst_vfp4:
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xeddf4a08 // vldr s9, [pc, #32]
.long 0xee04ca10 // vmov s8, ip
- .long 0xeaffffe5 // b 2ecc <sk_load_565_dst_vfp4+0x34>
+ .long 0xeaffffe5 // b 2e0c <sk_load_565_dst_vfp4+0x34>
.long 0xe320f000 // nop {0}
.long 0x37842108 // .word 0x37842108
.long 0x37842108 // .word 0x37842108
@@ -9027,7 +8911,7 @@ _sk_gather_565_vfp4:
.long 0xeddf4b20 // vldr d20, [pc, #128]
.long 0xeddf5b21 // vldr d21, [pc, #132]
.long 0xf2873f10 // vmov.f32 d3, #1
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
@@ -9088,7 +8972,7 @@ _sk_store_565_vfp4:
.long 0xf2eb1531 // vshl.s32 d17, d17, #11
.long 0xf26001b1 // vorr d16, d16, d17
.long 0xf26001b2 // vorr d16, d16, d18
- .long 0x0a000005 // beq 3070 <sk_store_565_vfp4+0x70>
+ .long 0x0a000005 // beq 2fb0 <sk_store_565_vfp4+0x70>
.long 0xf3f60121 // vuzp.16 d16, d17
.long 0xf4cc080f // vst1.32 {d16[0]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9097,7 +8981,7 @@ _sk_store_565_vfp4:
.long 0xe12fff1c // bx ip
.long 0xee10eb90 // vmov.32 lr, d16[0]
.long 0xe1cce0b0 // strh lr, [ip]
- .long 0xeafffff8 // b 3060 <sk_store_565_vfp4+0x60>
+ .long 0xeafffff8 // b 2fa0 <sk_store_565_vfp4+0x60>
.long 0xe320f000 // nop {0}
.long 0x427c0000 // .word 0x427c0000
.long 0x427c0000 // .word 0x427c0000
@@ -9113,7 +8997,7 @@ _sk_load_4444_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc082 // add ip, ip, r2, lsl #1
- .long 0x0a00001d // beq 3120 <sk_load_4444_vfp4+0x98>
+ .long 0x0a00001d // beq 3060 <sk_load_4444_vfp4+0x98>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
@@ -9147,7 +9031,7 @@ _sk_load_4444_vfp4:
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xeddf0a09 // vldr s1, [pc, #36]
.long 0xee00ca10 // vmov s0, ip
- .long 0xeaffffe2 // b 30bc <sk_load_4444_vfp4+0x34>
+ .long 0xeaffffe2 // b 2ffc <sk_load_4444_vfp4+0x34>
.long 0x37888889 // .word 0x37888889
.long 0x37888889 // .word 0x37888889
.long 0x39888889 // .word 0x39888889
@@ -9170,7 +9054,7 @@ _sk_load_4444_dst_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc082 // add ip, ip, r2, lsl #1
- .long 0x0a00001d // beq 31f0 <sk_load_4444_dst_vfp4+0x98>
+ .long 0x0a00001d // beq 3130 <sk_load_4444_dst_vfp4+0x98>
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe58dc000 // str ip, [sp]
.long 0xe1a0c00d // mov ip, sp
@@ -9204,7 +9088,7 @@ _sk_load_4444_dst_vfp4:
.long 0xe1dcc0b0 // ldrh ip, [ip]
.long 0xeddf4a09 // vldr s9, [pc, #36]
.long 0xee04ca10 // vmov s8, ip
- .long 0xeaffffe2 // b 318c <sk_load_4444_dst_vfp4+0x34>
+ .long 0xeaffffe2 // b 30cc <sk_load_4444_dst_vfp4+0x34>
.long 0x37888889 // .word 0x37888889
.long 0x37888889 // .word 0x37888889
.long 0x39888889 // .word 0x39888889
@@ -9227,7 +9111,7 @@ _sk_gather_4444_vfp4:
.long 0xeddf5b24 // vldr d21, [pc, #144]
.long 0xf3c73010 // vmov.i32 d19, #240
.long 0xeddf6b24 // vldr d22, [pc, #144]
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xf2c0401f // vmov.i32 d20, #15
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
@@ -9298,7 +9182,7 @@ _sk_store_4444_vfp4:
.long 0xf26201b0 // vorr d16, d18, d16
.long 0xf26001b3 // vorr d16, d16, d19
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000005 // beq 3368 <sk_store_4444_vfp4+0x80>
+ .long 0x0a000005 // beq 32a8 <sk_store_4444_vfp4+0x80>
.long 0xf3f60121 // vuzp.16 d16, d17
.long 0xf4cc080f // vst1.32 {d16[0]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9307,7 +9191,7 @@ _sk_store_4444_vfp4:
.long 0xe12fff1c // bx ip
.long 0xee10eb90 // vmov.32 lr, d16[0]
.long 0xe1cce0b0 // strh lr, [ip]
- .long 0xeafffff8 // b 3358 <sk_store_4444_vfp4+0x70>
+ .long 0xeafffff8 // b 3298 <sk_store_4444_vfp4+0x70>
.long 0xe320f000 // nop {0}
HIDDEN _sk_load_8888_vfp4
@@ -9320,7 +9204,7 @@ _sk_load_8888_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc102 // add ip, ip, r2, lsl #2
- .long 0x0a000014 // beq 33e8 <sk_load_8888_vfp4+0x70>
+ .long 0x0a000014 // beq 3328 <sk_load_8888_vfp4+0x70>
.long 0xed9c0b00 // vldr d0, [ip]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9344,7 +9228,7 @@ _sk_load_8888_vfp4:
.long 0xe12fff1c // bx ip
.long 0xeddf0a04 // vldr s1, [pc, #16]
.long 0xed9c0a00 // vldr s0, [ip]
- .long 0xeaffffe8 // b 3398 <sk_load_8888_vfp4+0x20>
+ .long 0xeaffffe8 // b 32d8 <sk_load_8888_vfp4+0x20>
.long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
@@ -9361,7 +9245,7 @@ _sk_load_8888_dst_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc102 // add ip, ip, r2, lsl #2
- .long 0x0a000014 // beq 3478 <sk_load_8888_dst_vfp4+0x70>
+ .long 0x0a000014 // beq 33b8 <sk_load_8888_dst_vfp4+0x70>
.long 0xed9c4b00 // vldr d4, [ip]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9385,7 +9269,7 @@ _sk_load_8888_dst_vfp4:
.long 0xe12fff1c // bx ip
.long 0xeddf4a04 // vldr s9, [pc, #16]
.long 0xed9c4a00 // vldr s8, [ip]
- .long 0xeaffffe8 // b 3428 <sk_load_8888_dst_vfp4+0x20>
+ .long 0xeaffffe8 // b 3368 <sk_load_8888_dst_vfp4+0x20>
.long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
@@ -9402,7 +9286,7 @@ _sk_gather_8888_vfp4:
.long 0xf3fb1700 // vcvt.s32.f32 d17, d0
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
.long 0xf26219a0 // vmla.i32 d17, d18, d16
.long 0xee11eb90 // vmov.32 lr, d17[0]
@@ -9462,14 +9346,14 @@ _sk_store_8888_vfp4:
.long 0xf2f81533 // vshl.s32 d17, d19, #24
.long 0xf26001b2 // vorr d16, d16, d18
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000004 // beq 35a4 <sk_store_8888_vfp4+0x7c>
+ .long 0x0a000004 // beq 34e4 <sk_store_8888_vfp4+0x7c>
.long 0xedcc0b00 // vstr d16, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32]
- .long 0xeafffff9 // b 3594 <sk_store_8888_vfp4+0x6c>
+ .long 0xeafffff9 // b 34d4 <sk_store_8888_vfp4+0x6c>
.long 0xe320f000 // nop {0}
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
@@ -9506,14 +9390,14 @@ _sk_store_8888_2d_vfp4:
.long 0xf2f81533 // vshl.s32 d17, d19, #24
.long 0xf26001b2 // vorr d16, d16, d18
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000004 // beq 3640 <sk_store_8888_2d_vfp4+0x88>
+ .long 0x0a000004 // beq 3580 <sk_store_8888_2d_vfp4+0x88>
.long 0xedcc0b00 // vstr d16, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4830 // pop {r4, r5, fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32]
- .long 0xeafffff9 // b 3630 <sk_store_8888_2d_vfp4+0x78>
+ .long 0xeafffff9 // b 3570 <sk_store_8888_2d_vfp4+0x78>
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
@@ -9527,7 +9411,7 @@ _sk_load_bgra_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc102 // add ip, ip, r2, lsl #2
- .long 0x0a000014 // beq 36c0 <sk_load_bgra_vfp4+0x70>
+ .long 0x0a000014 // beq 3600 <sk_load_bgra_vfp4+0x70>
.long 0xed9c0b00 // vldr d0, [ip]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9551,7 +9435,7 @@ _sk_load_bgra_vfp4:
.long 0xe12fff1c // bx ip
.long 0xeddf0a04 // vldr s1, [pc, #16]
.long 0xed9c0a00 // vldr s0, [ip]
- .long 0xeaffffe8 // b 3670 <sk_load_bgra_vfp4+0x20>
+ .long 0xeaffffe8 // b 35b0 <sk_load_bgra_vfp4+0x20>
.long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
@@ -9568,7 +9452,7 @@ _sk_load_bgra_dst_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0001 // cmp lr, #1
.long 0xe08cc102 // add ip, ip, r2, lsl #2
- .long 0x0a000014 // beq 3750 <sk_load_bgra_dst_vfp4+0x70>
+ .long 0x0a000014 // beq 3690 <sk_load_bgra_dst_vfp4+0x70>
.long 0xed9c4b00 // vldr d4, [ip]
.long 0xf3c7001f // vmov.i32 d16, #255
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9592,7 +9476,7 @@ _sk_load_bgra_dst_vfp4:
.long 0xe12fff1c // bx ip
.long 0xeddf4a04 // vldr s9, [pc, #16]
.long 0xed9c4a00 // vldr s8, [ip]
- .long 0xeaffffe8 // b 3700 <sk_load_bgra_dst_vfp4+0x20>
+ .long 0xeaffffe8 // b 3640 <sk_load_bgra_dst_vfp4+0x20>
.long 0xe320f000 // nop {0}
.long 0x3b808081 // .word 0x3b808081
.long 0x3b808081 // .word 0x3b808081
@@ -9609,7 +9493,7 @@ _sk_gather_bgra_vfp4:
.long 0xf3fb1700 // vcvt.s32.f32 d17, d0
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
- .long 0xe49e4008 // ldr r4, [lr], #8
+ .long 0xe49e4004 // ldr r4, [lr], #4
.long 0xf4ee2c9f // vld1.32 {d18[]}, [lr :32]
.long 0xf26219a0 // vmla.i32 d17, d18, d16
.long 0xee11eb90 // vmov.32 lr, d17[0]
@@ -9669,14 +9553,14 @@ _sk_store_bgra_vfp4:
.long 0xf2f81533 // vshl.s32 d17, d19, #24
.long 0xf26001b2 // vorr d16, d16, d18
.long 0xf26001b1 // vorr d16, d16, d17
- .long 0x0a000004 // beq 387c <sk_store_bgra_vfp4+0x7c>
+ .long 0x0a000004 // beq 37bc <sk_store_bgra_vfp4+0x7c>
.long 0xedcc0b00 // vstr d16, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4cc083f // vst1.32 {d16[0]}, [ip :32]
- .long 0xeafffff9 // b 386c <sk_store_bgra_vfp4+0x6c>
+ .long 0xeafffff9 // b 37ac <sk_store_bgra_vfp4+0x6c>
.long 0xe320f000 // nop {0}
.long 0x437f0000 // .word 0x437f0000
.long 0x437f0000 // .word 0x437f0000
@@ -9692,7 +9576,7 @@ _sk_load_f16_vfp4:
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 38b8 <sk_load_f16_vfp4+0x28>
+ .long 0x1a000001 // bne 37f8 <sk_load_f16_vfp4+0x28>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xf3b60720 // vcvt.f32.f16 q0, d16
@@ -9717,7 +9601,7 @@ _sk_load_f16_dst_vfp4:
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 3908 <sk_load_f16_dst_vfp4+0x28>
+ .long 0x1a000001 // bne 3848 <sk_load_f16_dst_vfp4+0x28>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xf3b64720 // vcvt.f32.f16 q2, d16
@@ -9742,7 +9626,7 @@ _sk_gather_f16_vfp4:
.long 0xe591c000 // ldr ip, [r1]
.long 0xf3fb0701 // vcvt.s32.f32 d16, d1
.long 0xf3fb1700 // vcvt.s32.f32 d17, d0
- .long 0xe49ce008 // ldr lr, [ip], #8
+ .long 0xe49ce004 // ldr lr, [ip], #4
.long 0xf4ec2c9f // vld1.32 {d18[]}, [ip :32]
.long 0xf26219a0 // vmla.i32 d17, d18, d16
.long 0xee314b90 // vmov.32 r4, d17[1]
@@ -9787,7 +9671,7 @@ _sk_store_f16_vfp4:
.long 0xf3f65622 // vcvt.f16.f32 d21, q9
.long 0xf3f64600 // vcvt.f16.f32 d20, q0
.long 0xf4cc470f // vst4.16 {d20[0],d21[0],d22[0],d23[0]}, [ip]
- .long 0x1a000001 // bne 39f8 <sk_store_f16_vfp4+0x40>
+ .long 0x1a000001 // bne 3938 <sk_store_f16_vfp4+0x40>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4cc474f // vst4.16 {d20[1],d21[1],d22[1],d23[1]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9808,7 +9692,7 @@ _sk_load_u16_be_vfp4:
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc182 // add ip, ip, r2, lsl #3
.long 0xf4ec070f // vld4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 3a38 <sk_load_u16_be_vfp4+0x28>
+ .long 0x1a000001 // bne 3978 <sk_load_u16_be_vfp4+0x28>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4ec074f // vld4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xee90cbb0 // vmov.u16 ip, d16[0]
@@ -9876,7 +9760,7 @@ _sk_load_rgb_u16_be_vfp4:
.long 0xe59de018 // ldr lr, [sp, #24]
.long 0xf4ec060f // vld3.16 {d16[0],d17[0],d18[0]}, [ip]
.long 0xe35e0000 // cmp lr, #0
- .long 0x1a000001 // bne 3b34 <sk_load_rgb_u16_be_vfp4+0x2c>
+ .long 0x1a000001 // bne 3a74 <sk_load_rgb_u16_be_vfp4+0x2c>
.long 0xe28cc006 // add ip, ip, #6
.long 0xf4ec064f // vld3.16 {d16[1],d17[1],d18[1]}, [ip]
.long 0xee90cbb0 // vmov.u16 ip, d16[0]
@@ -9968,7 +9852,7 @@ _sk_store_u16_be_vfp4:
.long 0xe35e0000 // cmp lr, #0
.long 0xf3f60124 // vuzp.16 d16, d20
.long 0xf4cc070f // vst4.16 {d16[0],d17[0],d18[0],d19[0]}, [ip]
- .long 0x1a000001 // bne 3c90 <sk_store_u16_be_vfp4+0xb0>
+ .long 0x1a000001 // bne 3bd0 <sk_store_u16_be_vfp4+0xb0>
.long 0xe28cc008 // add ip, ip, #8
.long 0xf4cc074f // vst4.16 {d16[1],d17[1],d18[1],d19[1]}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
@@ -9988,14 +9872,14 @@ _sk_load_f32_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc202 // add ip, ip, r2, lsl #4
- .long 0x1a000004 // bne 3cd8 <sk_load_f32_vfp4+0x30>
+ .long 0x1a000004 // bne 3c18 <sk_load_f32_vfp4+0x30>
.long 0xf42c008f // vld4.32 {d0-d3}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4ac0f8f // vld4.32 {d0[]-d3[]}, [ip]
- .long 0xeafffff9 // b 3cc8 <sk_load_f32_vfp4+0x20>
+ .long 0xeafffff9 // b 3c08 <sk_load_f32_vfp4+0x20>
HIDDEN _sk_load_f32_dst_vfp4
.globl _sk_load_f32_dst_vfp4
@@ -10007,14 +9891,14 @@ _sk_load_f32_dst_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc202 // add ip, ip, r2, lsl #4
- .long 0x1a000004 // bne 3d10 <sk_load_f32_dst_vfp4+0x30>
+ .long 0x1a000004 // bne 3c50 <sk_load_f32_dst_vfp4+0x30>
.long 0xf42c408f // vld4.32 {d4-d7}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf4ac4f8f // vld4.32 {d4[]-d7[]}, [ip]
- .long 0xeafffff9 // b 3d00 <sk_load_f32_dst_vfp4+0x20>
+ .long 0xeafffff9 // b 3c40 <sk_load_f32_dst_vfp4+0x20>
HIDDEN _sk_store_f32_vfp4
.globl _sk_store_f32_vfp4
@@ -10026,14 +9910,14 @@ _sk_store_f32_vfp4:
.long 0xe59cc000 // ldr ip, [ip]
.long 0xe35e0000 // cmp lr, #0
.long 0xe08cc202 // add ip, ip, r2, lsl #4
- .long 0x1a000004 // bne 3d48 <sk_store_f32_vfp4+0x30>
+ .long 0x1a000004 // bne 3c88 <sk_store_f32_vfp4+0x30>
.long 0xf40c008f // vst4.32 {d0-d3}, [ip]
.long 0xe591c004 // ldr ip, [r1, #4]
.long 0xe2811008 // add r1, r1, #8
.long 0xe8bd4800 // pop {fp, lr}
.long 0xe12fff1c // bx ip
.long 0xf48c0b0f // vst4.32 {d0[0],d1[0],d2[0],d3[0]}, [ip]
- .long 0xeafffff9 // b 3d38 <sk_store_f32_vfp4+0x20>
+ .long 0xeafffff9 // b 3c78 <sk_store_f32_vfp4+0x20>
HIDDEN _sk_clamp_x_vfp4
.globl _sk_clamp_x_vfp4
@@ -10647,7 +10531,7 @@ _sk_gradient_vfp4:
.long 0xe591c000 // ldr ip, [r1]
.long 0xe59c4000 // ldr r4, [ip]
.long 0xe3540002 // cmp r4, #2
- .long 0x3a00000b // bcc 4588 <sk_gradient_vfp4+0x58>
+ .long 0x3a00000b // bcc 44c8 <sk_gradient_vfp4+0x58>
.long 0xe59c5024 // ldr r5, [ip, #36]
.long 0xf2c01010 // vmov.i32 d17, #0
.long 0xf2c02011 // vmov.i32 d18, #1
@@ -10659,7 +10543,7 @@ _sk_gradient_vfp4:
.long 0xf3403e23 // vcge.f32 d19, d0, d19
.long 0xf35231b1 // vbsl d19, d18, d17
.long 0xf26308a0 // vadd.i32 d16, d19, d16
- .long 0x1afffff9 // bne 4570 <sk_gradient_vfp4+0x40>
+ .long 0x1afffff9 // bne 44b0 <sk_gradient_vfp4+0x40>
.long 0xee304b90 // vmov.32 r4, d16[1]
.long 0xe59c6010 // ldr r6, [ip, #16]
.long 0xee10eb90 // vmov.32 lr, d16[0]
@@ -11527,7 +11411,7 @@ _sk_seed_shader_hsw:
.byte 197,249,110,194 // vmovd %edx,%xmm0
.byte 196,226,125,88,192 // vpbroadcastd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,207,87,0,0 // vbroadcastss 0x57cf(%rip),%ymm1 # 5918 <_sk_callback_hsw+0x144>
+ .byte 196,226,125,24,13,207,86,0,0 // vbroadcastss 0x56cf(%rip),%ymm1 # 5818 <_sk_callback_hsw+0x144>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0
.byte 197,249,110,209 // vmovd %ecx,%xmm2
@@ -11535,7 +11419,7 @@ _sk_seed_shader_hsw:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,21,175,87,0,0 // vbroadcastss 0x57af(%rip),%ymm2 # 591c <_sk_callback_hsw+0x148>
+ .byte 196,226,125,24,21,175,86,0,0 // vbroadcastss 0x56af(%rip),%ymm2 # 581c <_sk_callback_hsw+0x148>
.byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
@@ -11554,13 +11438,13 @@ _sk_dither_hsw:
.byte 197,121,110,201 // vmovd %ecx,%xmm9
.byte 196,66,125,88,201 // vpbroadcastd %xmm9,%ymm9
.byte 196,65,53,239,200 // vpxor %ymm8,%ymm9,%ymm9
- .byte 196,98,125,88,21,118,87,0,0 // vpbroadcastd 0x5776(%rip),%ymm10 # 5920 <_sk_callback_hsw+0x14c>
+ .byte 196,98,125,88,21,118,86,0,0 // vpbroadcastd 0x5676(%rip),%ymm10 # 5820 <_sk_callback_hsw+0x14c>
.byte 196,65,53,219,218 // vpand %ymm10,%ymm9,%ymm11
.byte 196,193,37,114,243,5 // vpslld $0x5,%ymm11,%ymm11
.byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10
.byte 196,193,45,114,242,4 // vpslld $0x4,%ymm10,%ymm10
- .byte 196,98,125,88,37,91,87,0,0 // vpbroadcastd 0x575b(%rip),%ymm12 # 5924 <_sk_callback_hsw+0x150>
- .byte 196,98,125,88,45,86,87,0,0 // vpbroadcastd 0x5756(%rip),%ymm13 # 5928 <_sk_callback_hsw+0x154>
+ .byte 196,98,125,88,37,91,86,0,0 // vpbroadcastd 0x565b(%rip),%ymm12 # 5824 <_sk_callback_hsw+0x150>
+ .byte 196,98,125,88,45,86,86,0,0 // vpbroadcastd 0x5656(%rip),%ymm13 # 5828 <_sk_callback_hsw+0x154>
.byte 196,65,53,219,245 // vpand %ymm13,%ymm9,%ymm14
.byte 196,193,13,114,246,2 // vpslld $0x2,%ymm14,%ymm14
.byte 196,65,61,219,237 // vpand %ymm13,%ymm8,%ymm13
@@ -11575,8 +11459,8 @@ _sk_dither_hsw:
.byte 196,65,61,235,194 // vpor %ymm10,%ymm8,%ymm8
.byte 196,65,61,235,193 // vpor %ymm9,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,8,87,0,0 // vbroadcastss 0x5708(%rip),%ymm9 # 592c <_sk_callback_hsw+0x158>
- .byte 196,98,125,24,21,3,87,0,0 // vbroadcastss 0x5703(%rip),%ymm10 # 5930 <_sk_callback_hsw+0x15c>
+ .byte 196,98,125,24,13,8,86,0,0 // vbroadcastss 0x5608(%rip),%ymm9 # 582c <_sk_callback_hsw+0x158>
+ .byte 196,98,125,24,21,3,86,0,0 // vbroadcastss 0x5603(%rip),%ymm10 # 5830 <_sk_callback_hsw+0x15c>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
.byte 196,98,125,24,0 // vbroadcastss (%rax),%ymm8
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
@@ -11610,7 +11494,7 @@ HIDDEN _sk_black_color_hsw
FUNCTION(_sk_black_color_hsw)
_sk_black_color_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,163,86,0,0 // vbroadcastss 0x56a3(%rip),%ymm3 # 5934 <_sk_callback_hsw+0x160>
+ .byte 196,226,125,24,29,163,85,0,0 // vbroadcastss 0x55a3(%rip),%ymm3 # 5834 <_sk_callback_hsw+0x160>
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -11621,7 +11505,7 @@ HIDDEN _sk_white_color_hsw
FUNCTION(_sk_white_color_hsw)
_sk_white_color_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,142,86,0,0 // vbroadcastss 0x568e(%rip),%ymm0 # 5938 <_sk_callback_hsw+0x164>
+ .byte 196,226,125,24,5,142,85,0,0 // vbroadcastss 0x558e(%rip),%ymm0 # 5838 <_sk_callback_hsw+0x164>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 197,252,40,216 // vmovaps %ymm0,%ymm3
@@ -11667,7 +11551,7 @@ HIDDEN _sk_srcatop_hsw
FUNCTION(_sk_srcatop_hsw)
_sk_srcatop_hsw:
.byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0
- .byte 196,98,125,24,5,49,86,0,0 // vbroadcastss 0x5631(%rip),%ymm8 # 593c <_sk_callback_hsw+0x168>
+ .byte 196,98,125,24,5,49,85,0,0 // vbroadcastss 0x5531(%rip),%ymm8 # 583c <_sk_callback_hsw+0x168>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,226,61,184,196 // vfmadd231ps %ymm4,%ymm8,%ymm0
.byte 197,244,89,207 // vmulps %ymm7,%ymm1,%ymm1
@@ -11683,7 +11567,7 @@ HIDDEN _sk_dstatop_hsw
.globl _sk_dstatop_hsw
FUNCTION(_sk_dstatop_hsw)
_sk_dstatop_hsw:
- .byte 196,98,125,24,5,4,86,0,0 // vbroadcastss 0x5604(%rip),%ymm8 # 5940 <_sk_callback_hsw+0x16c>
+ .byte 196,98,125,24,5,4,85,0,0 // vbroadcastss 0x5504(%rip),%ymm8 # 5840 <_sk_callback_hsw+0x16c>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,226,101,184,196 // vfmadd231ps %ymm4,%ymm3,%ymm0
@@ -11722,7 +11606,7 @@ HIDDEN _sk_srcout_hsw
.globl _sk_srcout_hsw
FUNCTION(_sk_srcout_hsw)
_sk_srcout_hsw:
- .byte 196,98,125,24,5,171,85,0,0 // vbroadcastss 0x55ab(%rip),%ymm8 # 5944 <_sk_callback_hsw+0x170>
+ .byte 196,98,125,24,5,171,84,0,0 // vbroadcastss 0x54ab(%rip),%ymm8 # 5844 <_sk_callback_hsw+0x170>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -11735,7 +11619,7 @@ HIDDEN _sk_dstout_hsw
.globl _sk_dstout_hsw
FUNCTION(_sk_dstout_hsw)
_sk_dstout_hsw:
- .byte 196,226,125,24,5,142,85,0,0 // vbroadcastss 0x558e(%rip),%ymm0 # 5948 <_sk_callback_hsw+0x174>
+ .byte 196,226,125,24,5,142,84,0,0 // vbroadcastss 0x548e(%rip),%ymm0 # 5848 <_sk_callback_hsw+0x174>
.byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3
.byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0
.byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1
@@ -11748,7 +11632,7 @@ HIDDEN _sk_srcover_hsw
.globl _sk_srcover_hsw
FUNCTION(_sk_srcover_hsw)
_sk_srcover_hsw:
- .byte 196,98,125,24,5,113,85,0,0 // vbroadcastss 0x5571(%rip),%ymm8 # 594c <_sk_callback_hsw+0x178>
+ .byte 196,98,125,24,5,113,84,0,0 // vbroadcastss 0x5471(%rip),%ymm8 # 584c <_sk_callback_hsw+0x178>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0
.byte 196,194,85,184,200 // vfmadd231ps %ymm8,%ymm5,%ymm1
@@ -11761,7 +11645,7 @@ HIDDEN _sk_dstover_hsw
.globl _sk_dstover_hsw
FUNCTION(_sk_dstover_hsw)
_sk_dstover_hsw:
- .byte 196,98,125,24,5,80,85,0,0 // vbroadcastss 0x5550(%rip),%ymm8 # 5950 <_sk_callback_hsw+0x17c>
+ .byte 196,98,125,24,5,80,84,0,0 // vbroadcastss 0x5450(%rip),%ymm8 # 5850 <_sk_callback_hsw+0x17c>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0
.byte 196,226,61,168,205 // vfmadd213ps %ymm5,%ymm8,%ymm1
@@ -11785,7 +11669,7 @@ HIDDEN _sk_multiply_hsw
.globl _sk_multiply_hsw
FUNCTION(_sk_multiply_hsw)
_sk_multiply_hsw:
- .byte 196,98,125,24,5,27,85,0,0 // vbroadcastss 0x551b(%rip),%ymm8 # 5954 <_sk_callback_hsw+0x180>
+ .byte 196,98,125,24,5,27,84,0,0 // vbroadcastss 0x541b(%rip),%ymm8 # 5854 <_sk_callback_hsw+0x180>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -11833,7 +11717,7 @@ HIDDEN _sk_xor__hsw
.globl _sk_xor__hsw
FUNCTION(_sk_xor__hsw)
_sk_xor__hsw:
- .byte 196,98,125,24,5,150,84,0,0 // vbroadcastss 0x5496(%rip),%ymm8 # 5958 <_sk_callback_hsw+0x184>
+ .byte 196,98,125,24,5,150,83,0,0 // vbroadcastss 0x5396(%rip),%ymm8 # 5858 <_sk_callback_hsw+0x184>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -11867,7 +11751,7 @@ _sk_darken_hsw:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,30,84,0,0 // vbroadcastss 0x541e(%rip),%ymm8 # 595c <_sk_callback_hsw+0x188>
+ .byte 196,98,125,24,5,30,83,0,0 // vbroadcastss 0x531e(%rip),%ymm8 # 585c <_sk_callback_hsw+0x188>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -11892,7 +11776,7 @@ _sk_lighten_hsw:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,205,83,0,0 // vbroadcastss 0x53cd(%rip),%ymm8 # 5960 <_sk_callback_hsw+0x18c>
+ .byte 196,98,125,24,5,205,82,0,0 // vbroadcastss 0x52cd(%rip),%ymm8 # 5860 <_sk_callback_hsw+0x18c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -11920,7 +11804,7 @@ _sk_difference_hsw:
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,112,83,0,0 // vbroadcastss 0x5370(%rip),%ymm8 # 5964 <_sk_callback_hsw+0x190>
+ .byte 196,98,125,24,5,112,82,0,0 // vbroadcastss 0x5270(%rip),%ymm8 # 5864 <_sk_callback_hsw+0x190>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -11942,7 +11826,7 @@ _sk_exclusion_hsw:
.byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,46,83,0,0 // vbroadcastss 0x532e(%rip),%ymm8 # 5968 <_sk_callback_hsw+0x194>
+ .byte 196,98,125,24,5,46,82,0,0 // vbroadcastss 0x522e(%rip),%ymm8 # 5868 <_sk_callback_hsw+0x194>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 196,194,69,184,216 // vfmadd231ps %ymm8,%ymm7,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -11952,7 +11836,7 @@ HIDDEN _sk_colorburn_hsw
.globl _sk_colorburn_hsw
FUNCTION(_sk_colorburn_hsw)
_sk_colorburn_hsw:
- .byte 196,98,125,24,5,28,83,0,0 // vbroadcastss 0x531c(%rip),%ymm8 # 596c <_sk_callback_hsw+0x198>
+ .byte 196,98,125,24,5,28,82,0,0 // vbroadcastss 0x521c(%rip),%ymm8 # 586c <_sk_callback_hsw+0x198>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11
.byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10
@@ -12010,7 +11894,7 @@ HIDDEN _sk_colordodge_hsw
FUNCTION(_sk_colordodge_hsw)
_sk_colordodge_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,13,39,82,0,0 // vbroadcastss 0x5227(%rip),%ymm9 # 5970 <_sk_callback_hsw+0x19c>
+ .byte 196,98,125,24,13,39,81,0,0 // vbroadcastss 0x5127(%rip),%ymm9 # 5870 <_sk_callback_hsw+0x19c>
.byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9
@@ -12063,7 +11947,7 @@ HIDDEN _sk_hardlight_hsw
.globl _sk_hardlight_hsw
FUNCTION(_sk_hardlight_hsw)
_sk_hardlight_hsw:
- .byte 196,98,125,24,5,72,81,0,0 // vbroadcastss 0x5148(%rip),%ymm8 # 5974 <_sk_callback_hsw+0x1a0>
+ .byte 196,98,125,24,5,72,80,0,0 // vbroadcastss 0x5048(%rip),%ymm8 # 5874 <_sk_callback_hsw+0x1a0>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -12114,7 +11998,7 @@ HIDDEN _sk_overlay_hsw
.globl _sk_overlay_hsw
FUNCTION(_sk_overlay_hsw)
_sk_overlay_hsw:
- .byte 196,98,125,24,5,128,80,0,0 // vbroadcastss 0x5080(%rip),%ymm8 # 5978 <_sk_callback_hsw+0x1a4>
+ .byte 196,98,125,24,5,128,79,0,0 // vbroadcastss 0x4f80(%rip),%ymm8 # 5878 <_sk_callback_hsw+0x1a4>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -12175,10 +12059,10 @@ _sk_softlight_hsw:
.byte 196,65,20,88,197 // vaddps %ymm13,%ymm13,%ymm8
.byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8
.byte 196,66,61,168,192 // vfmadd213ps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,29,139,79,0,0 // vbroadcastss 0x4f8b(%rip),%ymm11 # 5980 <_sk_callback_hsw+0x1ac>
+ .byte 196,98,125,24,29,139,78,0,0 // vbroadcastss 0x4e8b(%rip),%ymm11 # 5880 <_sk_callback_hsw+0x1ac>
.byte 196,65,20,88,227 // vaddps %ymm11,%ymm13,%ymm12
.byte 196,65,28,89,192 // vmulps %ymm8,%ymm12,%ymm8
- .byte 196,98,125,24,37,124,79,0,0 // vbroadcastss 0x4f7c(%rip),%ymm12 # 5984 <_sk_callback_hsw+0x1b0>
+ .byte 196,98,125,24,37,124,78,0,0 // vbroadcastss 0x4e7c(%rip),%ymm12 # 5884 <_sk_callback_hsw+0x1b0>
.byte 196,66,21,184,196 // vfmadd231ps %ymm12,%ymm13,%ymm8
.byte 196,65,124,82,245 // vrsqrtps %ymm13,%ymm14
.byte 196,65,124,83,246 // vrcpps %ymm14,%ymm14
@@ -12188,7 +12072,7 @@ _sk_softlight_hsw:
.byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15
.byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14
.byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15
- .byte 196,98,125,24,5,63,79,0,0 // vbroadcastss 0x4f3f(%rip),%ymm8 # 597c <_sk_callback_hsw+0x1a8>
+ .byte 196,98,125,24,5,63,78,0,0 // vbroadcastss 0x4e3f(%rip),%ymm8 # 587c <_sk_callback_hsw+0x1a8>
.byte 196,65,60,92,237 // vsubps %ymm13,%ymm8,%ymm13
.byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0
.byte 196,98,125,168,235 // vfmadd213ps %ymm3,%ymm0,%ymm13
@@ -12301,11 +12185,11 @@ _sk_hue_hsw:
.byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10
.byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10
.byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- .byte 196,98,125,24,53,67,77,0,0 // vbroadcastss 0x4d43(%rip),%ymm14 # 5988 <_sk_callback_hsw+0x1b4>
- .byte 196,98,125,24,61,62,77,0,0 // vbroadcastss 0x4d3e(%rip),%ymm15 # 598c <_sk_callback_hsw+0x1b8>
+ .byte 196,98,125,24,53,67,76,0,0 // vbroadcastss 0x4c43(%rip),%ymm14 # 5888 <_sk_callback_hsw+0x1b4>
+ .byte 196,98,125,24,61,62,76,0,0 // vbroadcastss 0x4c3e(%rip),%ymm15 # 588c <_sk_callback_hsw+0x1b8>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13
- .byte 196,226,125,24,5,47,77,0,0 // vbroadcastss 0x4d2f(%rip),%ymm0 # 5990 <_sk_callback_hsw+0x1bc>
+ .byte 196,226,125,24,5,47,76,0,0 // vbroadcastss 0x4c2f(%rip),%ymm0 # 5890 <_sk_callback_hsw+0x1bc>
.byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13
.byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10
.byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -12360,7 +12244,7 @@ _sk_hue_hsw:
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
.byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9
.byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8
- .byte 196,226,125,24,13,28,76,0,0 // vbroadcastss 0x4c1c(%rip),%ymm1 # 5994 <_sk_callback_hsw+0x1c0>
+ .byte 196,226,125,24,13,28,75,0,0 // vbroadcastss 0x4b1c(%rip),%ymm1 # 5894 <_sk_callback_hsw+0x1c0>
.byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11
@@ -12414,11 +12298,11 @@ _sk_saturation_hsw:
.byte 196,65,28,89,210 // vmulps %ymm10,%ymm12,%ymm10
.byte 196,65,44,94,214 // vdivps %ymm14,%ymm10,%ymm10
.byte 196,67,45,74,224,240 // vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- .byte 196,98,125,24,53,51,75,0,0 // vbroadcastss 0x4b33(%rip),%ymm14 # 5998 <_sk_callback_hsw+0x1c4>
- .byte 196,98,125,24,61,46,75,0,0 // vbroadcastss 0x4b2e(%rip),%ymm15 # 599c <_sk_callback_hsw+0x1c8>
+ .byte 196,98,125,24,53,51,74,0,0 // vbroadcastss 0x4a33(%rip),%ymm14 # 5898 <_sk_callback_hsw+0x1c4>
+ .byte 196,98,125,24,61,46,74,0,0 // vbroadcastss 0x4a2e(%rip),%ymm15 # 589c <_sk_callback_hsw+0x1c8>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,66,93,184,238 // vfmadd231ps %ymm14,%ymm4,%ymm13
- .byte 196,226,125,24,5,31,75,0,0 // vbroadcastss 0x4b1f(%rip),%ymm0 # 59a0 <_sk_callback_hsw+0x1cc>
+ .byte 196,226,125,24,5,31,74,0,0 // vbroadcastss 0x4a1f(%rip),%ymm0 # 58a0 <_sk_callback_hsw+0x1cc>
.byte 196,98,77,184,232 // vfmadd231ps %ymm0,%ymm6,%ymm13
.byte 196,65,116,89,215 // vmulps %ymm15,%ymm1,%ymm10
.byte 196,66,53,184,214 // vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -12473,7 +12357,7 @@ _sk_saturation_hsw:
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
.byte 196,65,36,95,200 // vmaxps %ymm8,%ymm11,%ymm9
.byte 196,65,116,95,192 // vmaxps %ymm8,%ymm1,%ymm8
- .byte 196,226,125,24,13,12,74,0,0 // vbroadcastss 0x4a0c(%rip),%ymm1 # 59a4 <_sk_callback_hsw+0x1d0>
+ .byte 196,226,125,24,13,12,73,0,0 // vbroadcastss 0x490c(%rip),%ymm1 # 58a4 <_sk_callback_hsw+0x1d0>
.byte 197,116,92,215 // vsubps %ymm7,%ymm1,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,116,92,219 // vsubps %ymm3,%ymm1,%ymm11
@@ -12501,11 +12385,11 @@ _sk_color_hsw:
.byte 197,108,89,199 // vmulps %ymm7,%ymm2,%ymm8
.byte 197,116,89,215 // vmulps %ymm7,%ymm1,%ymm10
.byte 197,52,89,223 // vmulps %ymm7,%ymm9,%ymm11
- .byte 196,98,125,24,45,165,73,0,0 // vbroadcastss 0x49a5(%rip),%ymm13 # 59a8 <_sk_callback_hsw+0x1d4>
- .byte 196,98,125,24,53,160,73,0,0 // vbroadcastss 0x49a0(%rip),%ymm14 # 59ac <_sk_callback_hsw+0x1d8>
+ .byte 196,98,125,24,45,165,72,0,0 // vbroadcastss 0x48a5(%rip),%ymm13 # 58a8 <_sk_callback_hsw+0x1d4>
+ .byte 196,98,125,24,53,160,72,0,0 // vbroadcastss 0x48a0(%rip),%ymm14 # 58ac <_sk_callback_hsw+0x1d8>
.byte 196,65,84,89,230 // vmulps %ymm14,%ymm5,%ymm12
.byte 196,66,93,184,229 // vfmadd231ps %ymm13,%ymm4,%ymm12
- .byte 196,98,125,24,61,145,73,0,0 // vbroadcastss 0x4991(%rip),%ymm15 # 59b0 <_sk_callback_hsw+0x1dc>
+ .byte 196,98,125,24,61,145,72,0,0 // vbroadcastss 0x4891(%rip),%ymm15 # 58b0 <_sk_callback_hsw+0x1dc>
.byte 196,66,77,184,231 // vfmadd231ps %ymm15,%ymm6,%ymm12
.byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9
.byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -12561,7 +12445,7 @@ _sk_color_hsw:
.byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1
.byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8
.byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9
- .byte 196,226,125,24,5,115,72,0,0 // vbroadcastss 0x4873(%rip),%ymm0 # 59b4 <_sk_callback_hsw+0x1e0>
+ .byte 196,226,125,24,5,115,71,0,0 // vbroadcastss 0x4773(%rip),%ymm0 # 58b4 <_sk_callback_hsw+0x1e0>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -12589,11 +12473,11 @@ _sk_luminosity_hsw:
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
.byte 197,100,89,213 // vmulps %ymm5,%ymm3,%ymm10
.byte 197,100,89,222 // vmulps %ymm6,%ymm3,%ymm11
- .byte 196,98,125,24,45,12,72,0,0 // vbroadcastss 0x480c(%rip),%ymm13 # 59b8 <_sk_callback_hsw+0x1e4>
- .byte 196,98,125,24,53,7,72,0,0 // vbroadcastss 0x4807(%rip),%ymm14 # 59bc <_sk_callback_hsw+0x1e8>
+ .byte 196,98,125,24,45,12,71,0,0 // vbroadcastss 0x470c(%rip),%ymm13 # 58b8 <_sk_callback_hsw+0x1e4>
+ .byte 196,98,125,24,53,7,71,0,0 // vbroadcastss 0x4707(%rip),%ymm14 # 58bc <_sk_callback_hsw+0x1e8>
.byte 196,65,116,89,230 // vmulps %ymm14,%ymm1,%ymm12
.byte 196,66,109,184,229 // vfmadd231ps %ymm13,%ymm2,%ymm12
- .byte 196,98,125,24,61,248,71,0,0 // vbroadcastss 0x47f8(%rip),%ymm15 # 59c0 <_sk_callback_hsw+0x1ec>
+ .byte 196,98,125,24,61,248,70,0,0 // vbroadcastss 0x46f8(%rip),%ymm15 # 58c0 <_sk_callback_hsw+0x1ec>
.byte 196,66,53,184,231 // vfmadd231ps %ymm15,%ymm9,%ymm12
.byte 196,65,44,89,206 // vmulps %ymm14,%ymm10,%ymm9
.byte 196,66,61,184,205 // vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -12649,7 +12533,7 @@ _sk_luminosity_hsw:
.byte 196,193,116,95,206 // vmaxps %ymm14,%ymm1,%ymm1
.byte 196,65,44,95,198 // vmaxps %ymm14,%ymm10,%ymm8
.byte 196,65,124,95,206 // vmaxps %ymm14,%ymm0,%ymm9
- .byte 196,226,125,24,5,218,70,0,0 // vbroadcastss 0x46da(%rip),%ymm0 # 59c4 <_sk_callback_hsw+0x1f0>
+ .byte 196,226,125,24,5,218,69,0,0 // vbroadcastss 0x45da(%rip),%ymm0 # 58c4 <_sk_callback_hsw+0x1f0>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -12677,17 +12561,17 @@ _sk_srcover_rgba_8888_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 15,133,180,0,0,0 // jne 13f9 <_sk_srcover_rgba_8888_hsw+0xcd>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,196,84,37,142,74,0,0 // vandps 0x4a8e(%rip),%ymm7,%ymm4 # 5de0 <_sk_callback_hsw+0x60c>
+ .byte 197,196,84,37,142,73,0,0 // vandps 0x498e(%rip),%ymm7,%ymm4 # 5ce0 <_sk_callback_hsw+0x60c>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,69,0,45,161,74,0,0 // vpshufb 0x4aa1(%rip),%ymm7,%ymm5 # 5e00 <_sk_callback_hsw+0x62c>
+ .byte 196,226,69,0,45,161,73,0,0 // vpshufb 0x49a1(%rip),%ymm7,%ymm5 # 5d00 <_sk_callback_hsw+0x62c>
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,69,0,53,180,74,0,0 // vpshufb 0x4ab4(%rip),%ymm7,%ymm6 # 5e20 <_sk_callback_hsw+0x64c>
+ .byte 196,226,69,0,53,180,73,0,0 // vpshufb 0x49b4(%rip),%ymm7,%ymm6 # 5d20 <_sk_callback_hsw+0x64c>
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
.byte 197,197,114,215,24 // vpsrld $0x18,%ymm7,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,70,70,0,0 // vbroadcastss 0x4646(%rip),%ymm8 # 59c8 <_sk_callback_hsw+0x1f4>
+ .byte 196,98,125,24,5,70,69,0,0 // vbroadcastss 0x4546(%rip),%ymm8 # 58c8 <_sk_callback_hsw+0x1f4>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
- .byte 196,98,125,24,13,61,70,0,0 // vbroadcastss 0x463d(%rip),%ymm9 # 59cc <_sk_callback_hsw+0x1f8>
+ .byte 196,98,125,24,13,61,69,0,0 // vbroadcastss 0x453d(%rip),%ymm9 # 58cc <_sk_callback_hsw+0x1f8>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,194,93,184,192 // vfmadd231ps %ymm8,%ymm4,%ymm0
.byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
@@ -12747,7 +12631,7 @@ HIDDEN _sk_clamp_1_hsw
.globl _sk_clamp_1_hsw
FUNCTION(_sk_clamp_1_hsw)
_sk_clamp_1_hsw:
- .byte 196,98,125,24,5,98,69,0,0 // vbroadcastss 0x4562(%rip),%ymm8 # 59d0 <_sk_callback_hsw+0x1fc>
+ .byte 196,98,125,24,5,98,68,0,0 // vbroadcastss 0x4462(%rip),%ymm8 # 58d0 <_sk_callback_hsw+0x1fc>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
@@ -12759,7 +12643,7 @@ HIDDEN _sk_clamp_a_hsw
.globl _sk_clamp_a_hsw
FUNCTION(_sk_clamp_a_hsw)
_sk_clamp_a_hsw:
- .byte 196,98,125,24,5,69,69,0,0 // vbroadcastss 0x4545(%rip),%ymm8 # 59d4 <_sk_callback_hsw+0x200>
+ .byte 196,98,125,24,5,69,68,0,0 // vbroadcastss 0x4445(%rip),%ymm8 # 58d4 <_sk_callback_hsw+0x200>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0
.byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1
@@ -12771,7 +12655,7 @@ HIDDEN _sk_clamp_a_dst_hsw
.globl _sk_clamp_a_dst_hsw
FUNCTION(_sk_clamp_a_dst_hsw)
_sk_clamp_a_dst_hsw:
- .byte 196,98,125,24,5,43,69,0,0 // vbroadcastss 0x452b(%rip),%ymm8 # 59d8 <_sk_callback_hsw+0x204>
+ .byte 196,98,125,24,5,43,68,0,0 // vbroadcastss 0x442b(%rip),%ymm8 # 58d8 <_sk_callback_hsw+0x204>
.byte 196,193,68,93,248 // vminps %ymm8,%ymm7,%ymm7
.byte 197,220,93,231 // vminps %ymm7,%ymm4,%ymm4
.byte 197,212,93,239 // vminps %ymm7,%ymm5,%ymm5
@@ -12838,7 +12722,7 @@ FUNCTION(_sk_unpremul_hsw)
_sk_unpremul_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9
- .byte 196,98,125,24,21,167,68,0,0 // vbroadcastss 0x44a7(%rip),%ymm10 # 59dc <_sk_callback_hsw+0x208>
+ .byte 196,98,125,24,21,167,67,0,0 // vbroadcastss 0x43a7(%rip),%ymm10 # 58dc <_sk_callback_hsw+0x208>
.byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10
.byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
@@ -12851,16 +12735,16 @@ HIDDEN _sk_from_srgb_hsw
.globl _sk_from_srgb_hsw
FUNCTION(_sk_from_srgb_hsw)
_sk_from_srgb_hsw:
- .byte 196,98,125,24,5,136,68,0,0 // vbroadcastss 0x4488(%rip),%ymm8 # 59e0 <_sk_callback_hsw+0x20c>
+ .byte 196,98,125,24,5,136,67,0,0 // vbroadcastss 0x4388(%rip),%ymm8 # 58e0 <_sk_callback_hsw+0x20c>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10
- .byte 196,98,125,24,29,122,68,0,0 // vbroadcastss 0x447a(%rip),%ymm11 # 59e4 <_sk_callback_hsw+0x210>
- .byte 196,98,125,24,37,117,68,0,0 // vbroadcastss 0x4475(%rip),%ymm12 # 59e8 <_sk_callback_hsw+0x214>
+ .byte 196,98,125,24,29,122,67,0,0 // vbroadcastss 0x437a(%rip),%ymm11 # 58e4 <_sk_callback_hsw+0x210>
+ .byte 196,98,125,24,37,117,67,0,0 // vbroadcastss 0x4375(%rip),%ymm12 # 58e8 <_sk_callback_hsw+0x214>
.byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13
.byte 196,66,125,168,235 // vfmadd213ps %ymm11,%ymm0,%ymm13
- .byte 196,98,125,24,53,102,68,0,0 // vbroadcastss 0x4466(%rip),%ymm14 # 59ec <_sk_callback_hsw+0x218>
+ .byte 196,98,125,24,53,102,67,0,0 // vbroadcastss 0x4366(%rip),%ymm14 # 58ec <_sk_callback_hsw+0x218>
.byte 196,66,45,168,238 // vfmadd213ps %ymm14,%ymm10,%ymm13
- .byte 196,98,125,24,21,92,68,0,0 // vbroadcastss 0x445c(%rip),%ymm10 # 59f0 <_sk_callback_hsw+0x21c>
+ .byte 196,98,125,24,21,92,67,0,0 // vbroadcastss 0x435c(%rip),%ymm10 # 58f0 <_sk_callback_hsw+0x21c>
.byte 196,193,124,194,194,1 // vcmpltps %ymm10,%ymm0,%ymm0
.byte 196,195,21,74,193,0 // vblendvps %ymm0,%ymm9,%ymm13,%ymm0
.byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9
@@ -12883,16 +12767,16 @@ HIDDEN _sk_from_srgb_dst_hsw
.globl _sk_from_srgb_dst_hsw
FUNCTION(_sk_from_srgb_dst_hsw)
_sk_from_srgb_dst_hsw:
- .byte 196,98,125,24,5,4,68,0,0 // vbroadcastss 0x4404(%rip),%ymm8 # 59f4 <_sk_callback_hsw+0x220>
+ .byte 196,98,125,24,5,4,67,0,0 // vbroadcastss 0x4304(%rip),%ymm8 # 58f4 <_sk_callback_hsw+0x220>
.byte 196,65,92,89,200 // vmulps %ymm8,%ymm4,%ymm9
.byte 197,92,89,212 // vmulps %ymm4,%ymm4,%ymm10
- .byte 196,98,125,24,29,246,67,0,0 // vbroadcastss 0x43f6(%rip),%ymm11 # 59f8 <_sk_callback_hsw+0x224>
- .byte 196,98,125,24,37,241,67,0,0 // vbroadcastss 0x43f1(%rip),%ymm12 # 59fc <_sk_callback_hsw+0x228>
+ .byte 196,98,125,24,29,246,66,0,0 // vbroadcastss 0x42f6(%rip),%ymm11 # 58f8 <_sk_callback_hsw+0x224>
+ .byte 196,98,125,24,37,241,66,0,0 // vbroadcastss 0x42f1(%rip),%ymm12 # 58fc <_sk_callback_hsw+0x228>
.byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13
.byte 196,66,93,168,235 // vfmadd213ps %ymm11,%ymm4,%ymm13
- .byte 196,98,125,24,53,226,67,0,0 // vbroadcastss 0x43e2(%rip),%ymm14 # 5a00 <_sk_callback_hsw+0x22c>
+ .byte 196,98,125,24,53,226,66,0,0 // vbroadcastss 0x42e2(%rip),%ymm14 # 5900 <_sk_callback_hsw+0x22c>
.byte 196,66,45,168,238 // vfmadd213ps %ymm14,%ymm10,%ymm13
- .byte 196,98,125,24,21,216,67,0,0 // vbroadcastss 0x43d8(%rip),%ymm10 # 5a04 <_sk_callback_hsw+0x230>
+ .byte 196,98,125,24,21,216,66,0,0 // vbroadcastss 0x42d8(%rip),%ymm10 # 5904 <_sk_callback_hsw+0x230>
.byte 196,193,92,194,226,1 // vcmpltps %ymm10,%ymm4,%ymm4
.byte 196,195,21,74,225,64 // vblendvps %ymm4,%ymm9,%ymm13,%ymm4
.byte 196,65,84,89,200 // vmulps %ymm8,%ymm5,%ymm9
@@ -12916,19 +12800,19 @@ HIDDEN _sk_to_srgb_hsw
FUNCTION(_sk_to_srgb_hsw)
_sk_to_srgb_hsw:
.byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9
- .byte 196,98,125,24,5,124,67,0,0 // vbroadcastss 0x437c(%rip),%ymm8 # 5a08 <_sk_callback_hsw+0x234>
+ .byte 196,98,125,24,5,124,66,0,0 // vbroadcastss 0x427c(%rip),%ymm8 # 5908 <_sk_callback_hsw+0x234>
.byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10
- .byte 196,98,125,24,29,114,67,0,0 // vbroadcastss 0x4372(%rip),%ymm11 # 5a0c <_sk_callback_hsw+0x238>
- .byte 196,98,125,24,37,109,67,0,0 // vbroadcastss 0x436d(%rip),%ymm12 # 5a10 <_sk_callback_hsw+0x23c>
+ .byte 196,98,125,24,29,114,66,0,0 // vbroadcastss 0x4272(%rip),%ymm11 # 590c <_sk_callback_hsw+0x238>
+ .byte 196,98,125,24,37,109,66,0,0 // vbroadcastss 0x426d(%rip),%ymm12 # 5910 <_sk_callback_hsw+0x23c>
.byte 196,65,124,40,236 // vmovaps %ymm12,%ymm13
.byte 196,66,53,168,235 // vfmadd213ps %ymm11,%ymm9,%ymm13
- .byte 196,98,125,24,53,94,67,0,0 // vbroadcastss 0x435e(%rip),%ymm14 # 5a14 <_sk_callback_hsw+0x240>
+ .byte 196,98,125,24,53,94,66,0,0 // vbroadcastss 0x425e(%rip),%ymm14 # 5914 <_sk_callback_hsw+0x240>
.byte 196,66,53,168,238 // vfmadd213ps %ymm14,%ymm9,%ymm13
- .byte 196,98,125,24,61,84,67,0,0 // vbroadcastss 0x4354(%rip),%ymm15 # 5a18 <_sk_callback_hsw+0x244>
+ .byte 196,98,125,24,61,84,66,0,0 // vbroadcastss 0x4254(%rip),%ymm15 # 5918 <_sk_callback_hsw+0x244>
.byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9
.byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9
.byte 196,65,20,89,201 // vmulps %ymm9,%ymm13,%ymm9
- .byte 196,98,125,24,45,64,67,0,0 // vbroadcastss 0x4340(%rip),%ymm13 # 5a1c <_sk_callback_hsw+0x248>
+ .byte 196,98,125,24,45,64,66,0,0 // vbroadcastss 0x4240(%rip),%ymm13 # 591c <_sk_callback_hsw+0x248>
.byte 196,193,124,194,197,1 // vcmpltps %ymm13,%ymm0,%ymm0
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9
@@ -12962,26 +12846,26 @@ _sk_rgb_to_hsl_hsw:
.byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9
.byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9
.byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,29,181,66,0,0 // vbroadcastss 0x42b5(%rip),%ymm11 # 5a20 <_sk_callback_hsw+0x24c>
+ .byte 196,98,125,24,29,181,65,0,0 // vbroadcastss 0x41b5(%rip),%ymm11 # 5920 <_sk_callback_hsw+0x24c>
.byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11
.byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12
.byte 197,116,194,234,1 // vcmpltps %ymm2,%ymm1,%ymm13
- .byte 196,98,125,24,53,162,66,0,0 // vbroadcastss 0x42a2(%rip),%ymm14 # 5a24 <_sk_callback_hsw+0x250>
+ .byte 196,98,125,24,53,162,65,0,0 // vbroadcastss 0x41a2(%rip),%ymm14 # 5924 <_sk_callback_hsw+0x250>
.byte 196,65,4,87,255 // vxorps %ymm15,%ymm15,%ymm15
.byte 196,67,5,74,238,208 // vblendvps %ymm13,%ymm14,%ymm15,%ymm13
.byte 196,66,37,168,229 // vfmadd213ps %ymm13,%ymm11,%ymm12
.byte 197,236,92,208 // vsubps %ymm0,%ymm2,%ymm2
.byte 197,124,92,233 // vsubps %ymm1,%ymm0,%ymm13
- .byte 196,98,125,24,53,137,66,0,0 // vbroadcastss 0x4289(%rip),%ymm14 # 5a2c <_sk_callback_hsw+0x258>
+ .byte 196,98,125,24,53,137,65,0,0 // vbroadcastss 0x4189(%rip),%ymm14 # 592c <_sk_callback_hsw+0x258>
.byte 196,66,37,168,238 // vfmadd213ps %ymm14,%ymm11,%ymm13
- .byte 196,98,125,24,53,119,66,0,0 // vbroadcastss 0x4277(%rip),%ymm14 # 5a28 <_sk_callback_hsw+0x254>
+ .byte 196,98,125,24,53,119,65,0,0 // vbroadcastss 0x4177(%rip),%ymm14 # 5928 <_sk_callback_hsw+0x254>
.byte 196,194,37,168,214 // vfmadd213ps %ymm14,%ymm11,%ymm2
.byte 197,188,194,201,0 // vcmpeqps %ymm1,%ymm8,%ymm1
.byte 196,227,21,74,202,16 // vblendvps %ymm1,%ymm2,%ymm13,%ymm1
.byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0
.byte 196,195,117,74,196,0 // vblendvps %ymm0,%ymm12,%ymm1,%ymm0
.byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1
- .byte 196,98,125,24,29,90,66,0,0 // vbroadcastss 0x425a(%rip),%ymm11 # 5a34 <_sk_callback_hsw+0x260>
+ .byte 196,98,125,24,29,90,65,0,0 // vbroadcastss 0x415a(%rip),%ymm11 # 5934 <_sk_callback_hsw+0x260>
.byte 196,193,116,89,211 // vmulps %ymm11,%ymm1,%ymm2
.byte 197,36,194,218,1 // vcmpltps %ymm2,%ymm11,%ymm11
.byte 196,65,12,92,224 // vsubps %ymm8,%ymm14,%ymm12
@@ -12991,7 +12875,7 @@ _sk_rgb_to_hsl_hsw:
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 196,195,125,74,199,128 // vblendvps %ymm8,%ymm15,%ymm0,%ymm0
.byte 196,195,117,74,207,128 // vblendvps %ymm8,%ymm15,%ymm1,%ymm1
- .byte 196,98,125,24,5,29,66,0,0 // vbroadcastss 0x421d(%rip),%ymm8 # 5a30 <_sk_callback_hsw+0x25c>
+ .byte 196,98,125,24,5,29,65,0,0 // vbroadcastss 0x411d(%rip),%ymm8 # 5930 <_sk_callback_hsw+0x25c>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -13008,30 +12892,30 @@ _sk_hsl_to_rgb_hsw:
.byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp)
.byte 197,252,40,233 // vmovaps %ymm1,%ymm5
.byte 197,252,40,224 // vmovaps %ymm0,%ymm4
- .byte 196,98,125,24,5,234,65,0,0 // vbroadcastss 0x41ea(%rip),%ymm8 # 5a38 <_sk_callback_hsw+0x264>
+ .byte 196,98,125,24,5,234,64,0,0 // vbroadcastss 0x40ea(%rip),%ymm8 # 5938 <_sk_callback_hsw+0x264>
.byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9
.byte 197,84,89,210 // vmulps %ymm2,%ymm5,%ymm10
.byte 196,65,84,92,218 // vsubps %ymm10,%ymm5,%ymm11
.byte 196,67,45,74,203,144 // vblendvps %ymm9,%ymm11,%ymm10,%ymm9
.byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10
- .byte 196,98,125,24,13,205,65,0,0 // vbroadcastss 0x41cd(%rip),%ymm9 # 5a3c <_sk_callback_hsw+0x268>
+ .byte 196,98,125,24,13,205,64,0,0 // vbroadcastss 0x40cd(%rip),%ymm9 # 593c <_sk_callback_hsw+0x268>
.byte 196,66,109,170,202 // vfmsub213ps %ymm10,%ymm2,%ymm9
- .byte 196,98,125,24,29,195,65,0,0 // vbroadcastss 0x41c3(%rip),%ymm11 # 5a40 <_sk_callback_hsw+0x26c>
+ .byte 196,98,125,24,29,195,64,0,0 // vbroadcastss 0x40c3(%rip),%ymm11 # 5940 <_sk_callback_hsw+0x26c>
.byte 196,65,92,88,219 // vaddps %ymm11,%ymm4,%ymm11
.byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12
.byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15
.byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11
- .byte 196,98,125,24,45,173,65,0,0 // vbroadcastss 0x41ad(%rip),%ymm13 # 5a48 <_sk_callback_hsw+0x274>
+ .byte 196,98,125,24,45,173,64,0,0 // vbroadcastss 0x40ad(%rip),%ymm13 # 5948 <_sk_callback_hsw+0x274>
.byte 196,193,4,89,197 // vmulps %ymm13,%ymm15,%ymm0
- .byte 196,98,125,24,53,163,65,0,0 // vbroadcastss 0x41a3(%rip),%ymm14 # 5a4c <_sk_callback_hsw+0x278>
+ .byte 196,98,125,24,53,163,64,0,0 // vbroadcastss 0x40a3(%rip),%ymm14 # 594c <_sk_callback_hsw+0x278>
.byte 197,12,92,224 // vsubps %ymm0,%ymm14,%ymm12
.byte 196,66,37,168,225 // vfmadd213ps %ymm9,%ymm11,%ymm12
- .byte 196,226,125,24,29,137,65,0,0 // vbroadcastss 0x4189(%rip),%ymm3 # 5a44 <_sk_callback_hsw+0x270>
+ .byte 196,226,125,24,29,137,64,0,0 // vbroadcastss 0x4089(%rip),%ymm3 # 5944 <_sk_callback_hsw+0x270>
.byte 196,193,100,194,255,2 // vcmpleps %ymm15,%ymm3,%ymm7
.byte 196,195,29,74,249,112 // vblendvps %ymm7,%ymm9,%ymm12,%ymm7
.byte 196,65,60,194,231,2 // vcmpleps %ymm15,%ymm8,%ymm12
.byte 196,227,45,74,255,192 // vblendvps %ymm12,%ymm7,%ymm10,%ymm7
- .byte 196,98,125,24,37,116,65,0,0 // vbroadcastss 0x4174(%rip),%ymm12 # 5a50 <_sk_callback_hsw+0x27c>
+ .byte 196,98,125,24,37,116,64,0,0 // vbroadcastss 0x4074(%rip),%ymm12 # 5950 <_sk_callback_hsw+0x27c>
.byte 196,65,28,194,255,2 // vcmpleps %ymm15,%ymm12,%ymm15
.byte 196,194,37,168,193 // vfmadd213ps %ymm9,%ymm11,%ymm0
.byte 196,99,125,74,255,240 // vblendvps %ymm15,%ymm7,%ymm0,%ymm15
@@ -13047,7 +12931,7 @@ _sk_hsl_to_rgb_hsw:
.byte 197,156,194,192,2 // vcmpleps %ymm0,%ymm12,%ymm0
.byte 196,194,37,168,249 // vfmadd213ps %ymm9,%ymm11,%ymm7
.byte 196,227,69,74,201,0 // vblendvps %ymm0,%ymm1,%ymm7,%ymm1
- .byte 196,226,125,24,5,32,65,0,0 // vbroadcastss 0x4120(%rip),%ymm0 # 5a54 <_sk_callback_hsw+0x280>
+ .byte 196,226,125,24,5,32,64,0,0 // vbroadcastss 0x4020(%rip),%ymm0 # 5954 <_sk_callback_hsw+0x280>
.byte 197,220,88,192 // vaddps %ymm0,%ymm4,%ymm0
.byte 196,227,125,8,224,1 // vroundps $0x1,%ymm0,%ymm4
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
@@ -13097,10 +12981,10 @@ _sk_scale_u8_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,58 // jne 1a15 <_sk_scale_u8_hsw+0x44>
.byte 196,66,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm8
- .byte 197,57,219,5,87,71,0,0 // vpand 0x4757(%rip),%xmm8,%xmm8 # 6140 <_sk_callback_hsw+0x96c>
+ .byte 197,57,219,5,247,69,0,0 // vpand 0x45f7(%rip),%xmm8,%xmm8 # 5fe0 <_sk_callback_hsw+0x90c>
.byte 196,66,125,51,192 // vpmovzxwd %xmm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,92,64,0,0 // vbroadcastss 0x405c(%rip),%ymm9 # 5a58 <_sk_callback_hsw+0x284>
+ .byte 196,98,125,24,13,92,63,0,0 // vbroadcastss 0x3f5c(%rip),%ymm9 # 5958 <_sk_callback_hsw+0x284>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -13148,7 +13032,7 @@ _sk_scale_u8_hsw:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 232,255,255,255,221 // callq ffffffffde001ac0 <_sk_callback_hsw+0xffffffffddffc2ec>
+ .byte 232,255,255,255,221 // callq ffffffffde001ac0 <_sk_callback_hsw+0xffffffffddffc3ec>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,210 // callq *%rdx
@@ -13185,10 +13069,10 @@ _sk_lerp_u8_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,78 // jne 1b53 <_sk_lerp_u8_hsw+0x58>
.byte 196,66,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm8
- .byte 197,57,219,5,61,70,0,0 // vpand 0x463d(%rip),%xmm8,%xmm8 # 6150 <_sk_callback_hsw+0x97c>
+ .byte 197,57,219,5,221,68,0,0 // vpand 0x44dd(%rip),%xmm8,%xmm8 # 5ff0 <_sk_callback_hsw+0x91c>
.byte 196,66,125,51,192 // vpmovzxwd %xmm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,54,63,0,0 // vbroadcastss 0x3f36(%rip),%ymm9 # 5a5c <_sk_callback_hsw+0x288>
+ .byte 196,98,125,24,13,54,62,0,0 // vbroadcastss 0x3e36(%rip),%ymm9 # 595c <_sk_callback_hsw+0x288>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,226,61,168,196 // vfmadd213ps %ymm4,%ymm8,%ymm0
@@ -13264,20 +13148,20 @@ _sk_lerp_565_hsw:
.byte 15,133,169,0,0,0 // jne 1cbf <_sk_lerp_565_hsw+0xb7>
.byte 196,65,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm8
.byte 196,66,125,51,192 // vpmovzxwd %xmm8,%ymm8
- .byte 196,98,125,88,13,54,62,0,0 // vpbroadcastd 0x3e36(%rip),%ymm9 # 5a60 <_sk_callback_hsw+0x28c>
+ .byte 196,98,125,88,13,54,61,0,0 // vpbroadcastd 0x3d36(%rip),%ymm9 # 5960 <_sk_callback_hsw+0x28c>
.byte 196,65,61,219,201 // vpand %ymm9,%ymm8,%ymm9
.byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9
- .byte 196,98,125,24,21,39,62,0,0 // vbroadcastss 0x3e27(%rip),%ymm10 # 5a64 <_sk_callback_hsw+0x290>
+ .byte 196,98,125,24,21,39,61,0,0 // vbroadcastss 0x3d27(%rip),%ymm10 # 5964 <_sk_callback_hsw+0x290>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,88,21,29,62,0,0 // vpbroadcastd 0x3e1d(%rip),%ymm10 # 5a68 <_sk_callback_hsw+0x294>
+ .byte 196,98,125,88,21,29,61,0,0 // vpbroadcastd 0x3d1d(%rip),%ymm10 # 5968 <_sk_callback_hsw+0x294>
.byte 196,65,61,219,210 // vpand %ymm10,%ymm8,%ymm10
.byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10
- .byte 196,98,125,24,29,14,62,0,0 // vbroadcastss 0x3e0e(%rip),%ymm11 # 5a6c <_sk_callback_hsw+0x298>
+ .byte 196,98,125,24,29,14,61,0,0 // vbroadcastss 0x3d0e(%rip),%ymm11 # 596c <_sk_callback_hsw+0x298>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,88,29,4,62,0,0 // vpbroadcastd 0x3e04(%rip),%ymm11 # 5a70 <_sk_callback_hsw+0x29c>
+ .byte 196,98,125,88,29,4,61,0,0 // vpbroadcastd 0x3d04(%rip),%ymm11 # 5970 <_sk_callback_hsw+0x29c>
.byte 196,65,61,219,195 // vpand %ymm11,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,29,245,61,0,0 // vbroadcastss 0x3df5(%rip),%ymm11 # 5a74 <_sk_callback_hsw+0x2a0>
+ .byte 196,98,125,24,29,245,60,0,0 // vbroadcastss 0x3cf5(%rip),%ymm11 # 5974 <_sk_callback_hsw+0x2a0>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,226,53,168,196 // vfmadd213ps %ymm4,%ymm9,%ymm0
@@ -13353,21 +13237,21 @@ _sk_load_tables_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,105 // jne 1de2 <_sk_load_tables_hsw+0x7e>
.byte 196,193,124,16,26 // vmovups (%r10),%ymm3
- .byte 197,228,84,13,186,64,0,0 // vandps 0x40ba(%rip),%ymm3,%ymm1 # 5e40 <_sk_callback_hsw+0x66c>
+ .byte 197,228,84,13,186,63,0,0 // vandps 0x3fba(%rip),%ymm3,%ymm1 # 5d40 <_sk_callback_hsw+0x66c>
.byte 196,65,61,118,192 // vpcmpeqd %ymm8,%ymm8,%ymm8
.byte 72,139,72,8 // mov 0x8(%rax),%rcx
.byte 76,139,80,16 // mov 0x10(%rax),%r10
.byte 197,237,118,210 // vpcmpeqd %ymm2,%ymm2,%ymm2
.byte 196,226,109,146,4,137 // vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0
- .byte 196,226,101,0,21,186,64,0,0 // vpshufb 0x40ba(%rip),%ymm3,%ymm2 # 5e60 <_sk_callback_hsw+0x68c>
+ .byte 196,226,101,0,21,186,63,0,0 // vpshufb 0x3fba(%rip),%ymm3,%ymm2 # 5d60 <_sk_callback_hsw+0x68c>
.byte 196,65,53,118,201 // vpcmpeqd %ymm9,%ymm9,%ymm9
.byte 196,194,53,146,12,146 // vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1
.byte 72,139,64,24 // mov 0x18(%rax),%rax
- .byte 196,98,101,0,13,194,64,0,0 // vpshufb 0x40c2(%rip),%ymm3,%ymm9 # 5e80 <_sk_callback_hsw+0x6ac>
+ .byte 196,98,101,0,13,194,63,0,0 // vpshufb 0x3fc2(%rip),%ymm3,%ymm9 # 5d80 <_sk_callback_hsw+0x6ac>
.byte 196,162,61,146,20,136 // vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,162,60,0,0 // vbroadcastss 0x3ca2(%rip),%ymm8 # 5a78 <_sk_callback_hsw+0x2a4>
+ .byte 196,98,125,24,5,162,59,0,0 // vbroadcastss 0x3ba2(%rip),%ymm8 # 5978 <_sk_callback_hsw+0x2a4>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -13406,7 +13290,7 @@ _sk_load_tables_u16_be_hsw:
.byte 197,185,108,200 // vpunpcklqdq %xmm0,%xmm8,%xmm1
.byte 197,185,109,208 // vpunpckhqdq %xmm0,%xmm8,%xmm2
.byte 197,49,108,195 // vpunpcklqdq %xmm3,%xmm9,%xmm8
- .byte 197,121,111,21,238,66,0,0 // vmovdqa 0x42ee(%rip),%xmm10 # 6160 <_sk_callback_hsw+0x98c>
+ .byte 197,121,111,21,142,65,0,0 // vmovdqa 0x418e(%rip),%xmm10 # 6000 <_sk_callback_hsw+0x92c>
.byte 196,193,113,219,194 // vpand %xmm10,%xmm1,%xmm0
.byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1
.byte 196,65,37,118,219 // vpcmpeqd %ymm11,%ymm11,%ymm11
@@ -13428,7 +13312,7 @@ _sk_load_tables_u16_be_hsw:
.byte 197,185,235,219 // vpor %xmm3,%xmm8,%xmm3
.byte 196,226,125,51,219 // vpmovzxwd %xmm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,155,59,0,0 // vbroadcastss 0x3b9b(%rip),%ymm8 # 5a7c <_sk_callback_hsw+0x2a8>
+ .byte 196,98,125,24,5,155,58,0,0 // vbroadcastss 0x3a9b(%rip),%ymm8 # 597c <_sk_callback_hsw+0x2a8>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -13488,7 +13372,7 @@ _sk_load_tables_rgb_u16_be_hsw:
.byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3
.byte 197,185,109,210 // vpunpckhqdq %xmm2,%xmm8,%xmm2
.byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8
- .byte 197,121,111,13,142,65,0,0 // vmovdqa 0x418e(%rip),%xmm9 # 6170 <_sk_callback_hsw+0x99c>
+ .byte 197,121,111,13,46,64,0,0 // vmovdqa 0x402e(%rip),%xmm9 # 6010 <_sk_callback_hsw+0x93c>
.byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0
.byte 196,226,125,51,200 // vpmovzxwd %xmm0,%ymm1
.byte 197,229,118,219 // vpcmpeqd %ymm3,%ymm3,%ymm3
@@ -13505,7 +13389,7 @@ _sk_load_tables_rgb_u16_be_hsw:
.byte 196,98,125,51,194 // vpmovzxwd %xmm2,%ymm8
.byte 196,162,101,146,20,128 // vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,73,58,0,0 // vbroadcastss 0x3a49(%rip),%ymm3 # 5a80 <_sk_callback_hsw+0x2ac>
+ .byte 196,226,125,24,29,73,57,0,0 // vbroadcastss 0x3949(%rip),%ymm3 # 5980 <_sk_callback_hsw+0x2ac>
.byte 255,224 // jmpq *%rax
.byte 196,129,121,110,4,81 // vmovd (%r9,%r10,2),%xmm0
.byte 196,129,121,196,68,81,4,2 // vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
@@ -13546,7 +13430,7 @@ HIDDEN _sk_byte_tables_hsw
FUNCTION(_sk_byte_tables_hsw)
_sk_byte_tables_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,145,57,0,0 // vbroadcastss 0x3991(%rip),%ymm8 # 5a84 <_sk_callback_hsw+0x2b0>
+ .byte 196,98,125,24,5,145,56,0,0 // vbroadcastss 0x3891(%rip),%ymm8 # 5984 <_sk_callback_hsw+0x2b0>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
.byte 196,65,249,126,201 // vmovq %xmm9,%r9
@@ -13668,7 +13552,7 @@ _sk_byte_tables_hsw:
.byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
.byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,54,55,0,0 // vbroadcastss 0x3736(%rip),%ymm8 # 5a88 <_sk_callback_hsw+0x2b4>
+ .byte 196,98,125,24,5,54,54,0,0 // vbroadcastss 0x3636(%rip),%ymm8 # 5988 <_sk_callback_hsw+0x2b4>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
@@ -13784,7 +13668,7 @@ _sk_byte_tables_rgb_hsw:
.byte 67,15,182,4,26 // movzbl (%r10,%r11,1),%eax
.byte 196,194,125,49,193 // vpmovzxbd %xmm9,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,34,53,0,0 // vbroadcastss 0x3522(%rip),%ymm8 # 5a8c <_sk_callback_hsw+0x2b8>
+ .byte 196,98,125,24,5,34,52,0,0 // vbroadcastss 0x3422(%rip),%ymm8 # 598c <_sk_callback_hsw+0x2b8>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 196,226,125,49,201 // vpmovzxbd %xmm1,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
@@ -13883,33 +13767,33 @@ _sk_parametric_r_hsw:
.byte 196,66,125,168,211 // vfmadd213ps %ymm11,%ymm0,%ymm10
.byte 196,226,125,24,0 // vbroadcastss (%rax),%ymm0
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,252,51,0,0 // vbroadcastss 0x33fc(%rip),%ymm12 # 5a90 <_sk_callback_hsw+0x2bc>
- .byte 196,98,125,24,45,247,51,0,0 // vbroadcastss 0x33f7(%rip),%ymm13 # 5a94 <_sk_callback_hsw+0x2c0>
+ .byte 196,98,125,24,37,252,50,0,0 // vbroadcastss 0x32fc(%rip),%ymm12 # 5990 <_sk_callback_hsw+0x2bc>
+ .byte 196,98,125,24,45,247,50,0,0 // vbroadcastss 0x32f7(%rip),%ymm13 # 5994 <_sk_callback_hsw+0x2c0>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,237,51,0,0 // vbroadcastss 0x33ed(%rip),%ymm13 # 5a98 <_sk_callback_hsw+0x2c4>
+ .byte 196,98,125,24,45,237,50,0,0 // vbroadcastss 0x32ed(%rip),%ymm13 # 5998 <_sk_callback_hsw+0x2c4>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,227,51,0,0 // vbroadcastss 0x33e3(%rip),%ymm13 # 5a9c <_sk_callback_hsw+0x2c8>
+ .byte 196,98,125,24,45,227,50,0,0 // vbroadcastss 0x32e3(%rip),%ymm13 # 599c <_sk_callback_hsw+0x2c8>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,217,51,0,0 // vbroadcastss 0x33d9(%rip),%ymm11 # 5aa0 <_sk_callback_hsw+0x2cc>
+ .byte 196,98,125,24,29,217,50,0,0 // vbroadcastss 0x32d9(%rip),%ymm11 # 59a0 <_sk_callback_hsw+0x2cc>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,207,51,0,0 // vbroadcastss 0x33cf(%rip),%ymm12 # 5aa4 <_sk_callback_hsw+0x2d0>
+ .byte 196,98,125,24,37,207,50,0,0 // vbroadcastss 0x32cf(%rip),%ymm12 # 59a4 <_sk_callback_hsw+0x2d0>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,197,51,0,0 // vbroadcastss 0x33c5(%rip),%ymm12 # 5aa8 <_sk_callback_hsw+0x2d4>
+ .byte 196,98,125,24,37,197,50,0,0 // vbroadcastss 0x32c5(%rip),%ymm12 # 59a8 <_sk_callback_hsw+0x2d4>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,166,51,0,0 // vbroadcastss 0x33a6(%rip),%ymm11 # 5aac <_sk_callback_hsw+0x2d8>
+ .byte 196,98,125,24,29,166,50,0,0 // vbroadcastss 0x32a6(%rip),%ymm11 # 59ac <_sk_callback_hsw+0x2d8>
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,156,51,0,0 // vbroadcastss 0x339c(%rip),%ymm11 # 5ab0 <_sk_callback_hsw+0x2dc>
+ .byte 196,98,125,24,29,156,50,0,0 // vbroadcastss 0x329c(%rip),%ymm11 # 59b0 <_sk_callback_hsw+0x2dc>
.byte 196,98,45,172,216 // vfnmadd213ps %ymm0,%ymm10,%ymm11
- .byte 196,226,125,24,5,146,51,0,0 // vbroadcastss 0x3392(%rip),%ymm0 # 5ab4 <_sk_callback_hsw+0x2e0>
+ .byte 196,226,125,24,5,146,50,0,0 // vbroadcastss 0x3292(%rip),%ymm0 # 59b4 <_sk_callback_hsw+0x2e0>
.byte 196,193,124,92,194 // vsubps %ymm10,%ymm0,%ymm0
- .byte 196,98,125,24,21,136,51,0,0 // vbroadcastss 0x3388(%rip),%ymm10 # 5ab8 <_sk_callback_hsw+0x2e4>
+ .byte 196,98,125,24,21,136,50,0,0 // vbroadcastss 0x3288(%rip),%ymm10 # 59b8 <_sk_callback_hsw+0x2e4>
.byte 197,172,94,192 // vdivps %ymm0,%ymm10,%ymm0
.byte 197,164,88,192 // vaddps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,21,123,51,0,0 // vbroadcastss 0x337b(%rip),%ymm10 # 5abc <_sk_callback_hsw+0x2e8>
+ .byte 196,98,125,24,21,123,50,0,0 // vbroadcastss 0x327b(%rip),%ymm10 # 59bc <_sk_callback_hsw+0x2e8>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -13917,7 +13801,7 @@ _sk_parametric_r_hsw:
.byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,82,51,0,0 // vbroadcastss 0x3352(%rip),%ymm8 # 5ac0 <_sk_callback_hsw+0x2ec>
+ .byte 196,98,125,24,5,82,50,0,0 // vbroadcastss 0x3252(%rip),%ymm8 # 59c0 <_sk_callback_hsw+0x2ec>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -13937,33 +13821,33 @@ _sk_parametric_g_hsw:
.byte 196,66,117,168,211 // vfmadd213ps %ymm11,%ymm1,%ymm10
.byte 196,226,125,24,8 // vbroadcastss (%rax),%ymm1
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,10,51,0,0 // vbroadcastss 0x330a(%rip),%ymm12 # 5ac4 <_sk_callback_hsw+0x2f0>
- .byte 196,98,125,24,45,5,51,0,0 // vbroadcastss 0x3305(%rip),%ymm13 # 5ac8 <_sk_callback_hsw+0x2f4>
+ .byte 196,98,125,24,37,10,50,0,0 // vbroadcastss 0x320a(%rip),%ymm12 # 59c4 <_sk_callback_hsw+0x2f0>
+ .byte 196,98,125,24,45,5,50,0,0 // vbroadcastss 0x3205(%rip),%ymm13 # 59c8 <_sk_callback_hsw+0x2f4>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,251,50,0,0 // vbroadcastss 0x32fb(%rip),%ymm13 # 5acc <_sk_callback_hsw+0x2f8>
+ .byte 196,98,125,24,45,251,49,0,0 // vbroadcastss 0x31fb(%rip),%ymm13 # 59cc <_sk_callback_hsw+0x2f8>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,241,50,0,0 // vbroadcastss 0x32f1(%rip),%ymm13 # 5ad0 <_sk_callback_hsw+0x2fc>
+ .byte 196,98,125,24,45,241,49,0,0 // vbroadcastss 0x31f1(%rip),%ymm13 # 59d0 <_sk_callback_hsw+0x2fc>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,231,50,0,0 // vbroadcastss 0x32e7(%rip),%ymm11 # 5ad4 <_sk_callback_hsw+0x300>
+ .byte 196,98,125,24,29,231,49,0,0 // vbroadcastss 0x31e7(%rip),%ymm11 # 59d4 <_sk_callback_hsw+0x300>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,221,50,0,0 // vbroadcastss 0x32dd(%rip),%ymm12 # 5ad8 <_sk_callback_hsw+0x304>
+ .byte 196,98,125,24,37,221,49,0,0 // vbroadcastss 0x31dd(%rip),%ymm12 # 59d8 <_sk_callback_hsw+0x304>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,211,50,0,0 // vbroadcastss 0x32d3(%rip),%ymm12 # 5adc <_sk_callback_hsw+0x308>
+ .byte 196,98,125,24,37,211,49,0,0 // vbroadcastss 0x31d3(%rip),%ymm12 # 59dc <_sk_callback_hsw+0x308>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10
.byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10
- .byte 196,98,125,24,29,180,50,0,0 // vbroadcastss 0x32b4(%rip),%ymm11 # 5ae0 <_sk_callback_hsw+0x30c>
+ .byte 196,98,125,24,29,180,49,0,0 // vbroadcastss 0x31b4(%rip),%ymm11 # 59e0 <_sk_callback_hsw+0x30c>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,170,50,0,0 // vbroadcastss 0x32aa(%rip),%ymm11 # 5ae4 <_sk_callback_hsw+0x310>
+ .byte 196,98,125,24,29,170,49,0,0 // vbroadcastss 0x31aa(%rip),%ymm11 # 59e4 <_sk_callback_hsw+0x310>
.byte 196,98,45,172,217 // vfnmadd213ps %ymm1,%ymm10,%ymm11
- .byte 196,226,125,24,13,160,50,0,0 // vbroadcastss 0x32a0(%rip),%ymm1 # 5ae8 <_sk_callback_hsw+0x314>
+ .byte 196,226,125,24,13,160,49,0,0 // vbroadcastss 0x31a0(%rip),%ymm1 # 59e8 <_sk_callback_hsw+0x314>
.byte 196,193,116,92,202 // vsubps %ymm10,%ymm1,%ymm1
- .byte 196,98,125,24,21,150,50,0,0 // vbroadcastss 0x3296(%rip),%ymm10 # 5aec <_sk_callback_hsw+0x318>
+ .byte 196,98,125,24,21,150,49,0,0 // vbroadcastss 0x3196(%rip),%ymm10 # 59ec <_sk_callback_hsw+0x318>
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 197,164,88,201 // vaddps %ymm1,%ymm11,%ymm1
- .byte 196,98,125,24,21,137,50,0,0 // vbroadcastss 0x3289(%rip),%ymm10 # 5af0 <_sk_callback_hsw+0x31c>
+ .byte 196,98,125,24,21,137,49,0,0 // vbroadcastss 0x3189(%rip),%ymm10 # 59f0 <_sk_callback_hsw+0x31c>
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -13971,7 +13855,7 @@ _sk_parametric_g_hsw:
.byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,5,96,50,0,0 // vbroadcastss 0x3260(%rip),%ymm8 # 5af4 <_sk_callback_hsw+0x320>
+ .byte 196,98,125,24,5,96,49,0,0 // vbroadcastss 0x3160(%rip),%ymm8 # 59f4 <_sk_callback_hsw+0x320>
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -13991,33 +13875,33 @@ _sk_parametric_b_hsw:
.byte 196,66,109,168,211 // vfmadd213ps %ymm11,%ymm2,%ymm10
.byte 196,226,125,24,16 // vbroadcastss (%rax),%ymm2
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,24,50,0,0 // vbroadcastss 0x3218(%rip),%ymm12 # 5af8 <_sk_callback_hsw+0x324>
- .byte 196,98,125,24,45,19,50,0,0 // vbroadcastss 0x3213(%rip),%ymm13 # 5afc <_sk_callback_hsw+0x328>
+ .byte 196,98,125,24,37,24,49,0,0 // vbroadcastss 0x3118(%rip),%ymm12 # 59f8 <_sk_callback_hsw+0x324>
+ .byte 196,98,125,24,45,19,49,0,0 // vbroadcastss 0x3113(%rip),%ymm13 # 59fc <_sk_callback_hsw+0x328>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,9,50,0,0 // vbroadcastss 0x3209(%rip),%ymm13 # 5b00 <_sk_callback_hsw+0x32c>
+ .byte 196,98,125,24,45,9,49,0,0 // vbroadcastss 0x3109(%rip),%ymm13 # 5a00 <_sk_callback_hsw+0x32c>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,255,49,0,0 // vbroadcastss 0x31ff(%rip),%ymm13 # 5b04 <_sk_callback_hsw+0x330>
+ .byte 196,98,125,24,45,255,48,0,0 // vbroadcastss 0x30ff(%rip),%ymm13 # 5a04 <_sk_callback_hsw+0x330>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,245,49,0,0 // vbroadcastss 0x31f5(%rip),%ymm11 # 5b08 <_sk_callback_hsw+0x334>
+ .byte 196,98,125,24,29,245,48,0,0 // vbroadcastss 0x30f5(%rip),%ymm11 # 5a08 <_sk_callback_hsw+0x334>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,235,49,0,0 // vbroadcastss 0x31eb(%rip),%ymm12 # 5b0c <_sk_callback_hsw+0x338>
+ .byte 196,98,125,24,37,235,48,0,0 // vbroadcastss 0x30eb(%rip),%ymm12 # 5a0c <_sk_callback_hsw+0x338>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,225,49,0,0 // vbroadcastss 0x31e1(%rip),%ymm12 # 5b10 <_sk_callback_hsw+0x33c>
+ .byte 196,98,125,24,37,225,48,0,0 // vbroadcastss 0x30e1(%rip),%ymm12 # 5a10 <_sk_callback_hsw+0x33c>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10
.byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10
- .byte 196,98,125,24,29,194,49,0,0 // vbroadcastss 0x31c2(%rip),%ymm11 # 5b14 <_sk_callback_hsw+0x340>
+ .byte 196,98,125,24,29,194,48,0,0 // vbroadcastss 0x30c2(%rip),%ymm11 # 5a14 <_sk_callback_hsw+0x340>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,184,49,0,0 // vbroadcastss 0x31b8(%rip),%ymm11 # 5b18 <_sk_callback_hsw+0x344>
+ .byte 196,98,125,24,29,184,48,0,0 // vbroadcastss 0x30b8(%rip),%ymm11 # 5a18 <_sk_callback_hsw+0x344>
.byte 196,98,45,172,218 // vfnmadd213ps %ymm2,%ymm10,%ymm11
- .byte 196,226,125,24,21,174,49,0,0 // vbroadcastss 0x31ae(%rip),%ymm2 # 5b1c <_sk_callback_hsw+0x348>
+ .byte 196,226,125,24,21,174,48,0,0 // vbroadcastss 0x30ae(%rip),%ymm2 # 5a1c <_sk_callback_hsw+0x348>
.byte 196,193,108,92,210 // vsubps %ymm10,%ymm2,%ymm2
- .byte 196,98,125,24,21,164,49,0,0 // vbroadcastss 0x31a4(%rip),%ymm10 # 5b20 <_sk_callback_hsw+0x34c>
+ .byte 196,98,125,24,21,164,48,0,0 // vbroadcastss 0x30a4(%rip),%ymm10 # 5a20 <_sk_callback_hsw+0x34c>
.byte 197,172,94,210 // vdivps %ymm2,%ymm10,%ymm2
.byte 197,164,88,210 // vaddps %ymm2,%ymm11,%ymm2
- .byte 196,98,125,24,21,151,49,0,0 // vbroadcastss 0x3197(%rip),%ymm10 # 5b24 <_sk_callback_hsw+0x350>
+ .byte 196,98,125,24,21,151,48,0,0 // vbroadcastss 0x3097(%rip),%ymm10 # 5a24 <_sk_callback_hsw+0x350>
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -14025,7 +13909,7 @@ _sk_parametric_b_hsw:
.byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,110,49,0,0 // vbroadcastss 0x316e(%rip),%ymm8 # 5b28 <_sk_callback_hsw+0x354>
+ .byte 196,98,125,24,5,110,48,0,0 // vbroadcastss 0x306e(%rip),%ymm8 # 5a28 <_sk_callback_hsw+0x354>
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -14045,33 +13929,33 @@ _sk_parametric_a_hsw:
.byte 196,66,101,168,211 // vfmadd213ps %ymm11,%ymm3,%ymm10
.byte 196,226,125,24,24 // vbroadcastss (%rax),%ymm3
.byte 196,65,124,91,218 // vcvtdq2ps %ymm10,%ymm11
- .byte 196,98,125,24,37,38,49,0,0 // vbroadcastss 0x3126(%rip),%ymm12 # 5b2c <_sk_callback_hsw+0x358>
- .byte 196,98,125,24,45,33,49,0,0 // vbroadcastss 0x3121(%rip),%ymm13 # 5b30 <_sk_callback_hsw+0x35c>
+ .byte 196,98,125,24,37,38,48,0,0 // vbroadcastss 0x3026(%rip),%ymm12 # 5a2c <_sk_callback_hsw+0x358>
+ .byte 196,98,125,24,45,33,48,0,0 // vbroadcastss 0x3021(%rip),%ymm13 # 5a30 <_sk_callback_hsw+0x35c>
.byte 196,65,44,84,213 // vandps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,23,49,0,0 // vbroadcastss 0x3117(%rip),%ymm13 # 5b34 <_sk_callback_hsw+0x360>
+ .byte 196,98,125,24,45,23,48,0,0 // vbroadcastss 0x3017(%rip),%ymm13 # 5a34 <_sk_callback_hsw+0x360>
.byte 196,65,44,86,213 // vorps %ymm13,%ymm10,%ymm10
- .byte 196,98,125,24,45,13,49,0,0 // vbroadcastss 0x310d(%rip),%ymm13 # 5b38 <_sk_callback_hsw+0x364>
+ .byte 196,98,125,24,45,13,48,0,0 // vbroadcastss 0x300d(%rip),%ymm13 # 5a38 <_sk_callback_hsw+0x364>
.byte 196,66,37,184,236 // vfmadd231ps %ymm12,%ymm11,%ymm13
- .byte 196,98,125,24,29,3,49,0,0 // vbroadcastss 0x3103(%rip),%ymm11 # 5b3c <_sk_callback_hsw+0x368>
+ .byte 196,98,125,24,29,3,48,0,0 // vbroadcastss 0x3003(%rip),%ymm11 # 5a3c <_sk_callback_hsw+0x368>
.byte 196,66,45,172,221 // vfnmadd213ps %ymm13,%ymm10,%ymm11
- .byte 196,98,125,24,37,249,48,0,0 // vbroadcastss 0x30f9(%rip),%ymm12 # 5b40 <_sk_callback_hsw+0x36c>
+ .byte 196,98,125,24,37,249,47,0,0 // vbroadcastss 0x2ff9(%rip),%ymm12 # 5a40 <_sk_callback_hsw+0x36c>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,239,48,0,0 // vbroadcastss 0x30ef(%rip),%ymm12 # 5b44 <_sk_callback_hsw+0x370>
+ .byte 196,98,125,24,37,239,47,0,0 // vbroadcastss 0x2fef(%rip),%ymm12 # 5a44 <_sk_callback_hsw+0x370>
.byte 196,65,28,94,210 // vdivps %ymm10,%ymm12,%ymm10
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10
.byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10
- .byte 196,98,125,24,29,208,48,0,0 // vbroadcastss 0x30d0(%rip),%ymm11 # 5b48 <_sk_callback_hsw+0x374>
+ .byte 196,98,125,24,29,208,47,0,0 // vbroadcastss 0x2fd0(%rip),%ymm11 # 5a48 <_sk_callback_hsw+0x374>
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,198,48,0,0 // vbroadcastss 0x30c6(%rip),%ymm11 # 5b4c <_sk_callback_hsw+0x378>
+ .byte 196,98,125,24,29,198,47,0,0 // vbroadcastss 0x2fc6(%rip),%ymm11 # 5a4c <_sk_callback_hsw+0x378>
.byte 196,98,45,172,219 // vfnmadd213ps %ymm3,%ymm10,%ymm11
- .byte 196,226,125,24,29,188,48,0,0 // vbroadcastss 0x30bc(%rip),%ymm3 # 5b50 <_sk_callback_hsw+0x37c>
+ .byte 196,226,125,24,29,188,47,0,0 // vbroadcastss 0x2fbc(%rip),%ymm3 # 5a50 <_sk_callback_hsw+0x37c>
.byte 196,193,100,92,218 // vsubps %ymm10,%ymm3,%ymm3
- .byte 196,98,125,24,21,178,48,0,0 // vbroadcastss 0x30b2(%rip),%ymm10 # 5b54 <_sk_callback_hsw+0x380>
+ .byte 196,98,125,24,21,178,47,0,0 // vbroadcastss 0x2fb2(%rip),%ymm10 # 5a54 <_sk_callback_hsw+0x380>
.byte 197,172,94,219 // vdivps %ymm3,%ymm10,%ymm3
.byte 197,164,88,219 // vaddps %ymm3,%ymm11,%ymm3
- .byte 196,98,125,24,21,165,48,0,0 // vbroadcastss 0x30a5(%rip),%ymm10 # 5b58 <_sk_callback_hsw+0x384>
+ .byte 196,98,125,24,21,165,47,0,0 // vbroadcastss 0x2fa5(%rip),%ymm10 # 5a58 <_sk_callback_hsw+0x384>
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -14079,7 +13963,7 @@ _sk_parametric_a_hsw:
.byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3
- .byte 196,98,125,24,5,124,48,0,0 // vbroadcastss 0x307c(%rip),%ymm8 # 5b5c <_sk_callback_hsw+0x388>
+ .byte 196,98,125,24,5,124,47,0,0 // vbroadcastss 0x2f7c(%rip),%ymm8 # 5a5c <_sk_callback_hsw+0x388>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -14088,26 +13972,26 @@ HIDDEN _sk_lab_to_xyz_hsw
.globl _sk_lab_to_xyz_hsw
FUNCTION(_sk_lab_to_xyz_hsw)
_sk_lab_to_xyz_hsw:
- .byte 196,98,125,24,5,110,48,0,0 // vbroadcastss 0x306e(%rip),%ymm8 # 5b60 <_sk_callback_hsw+0x38c>
- .byte 196,98,125,24,13,105,48,0,0 // vbroadcastss 0x3069(%rip),%ymm9 # 5b64 <_sk_callback_hsw+0x390>
- .byte 196,98,125,24,21,100,48,0,0 // vbroadcastss 0x3064(%rip),%ymm10 # 5b68 <_sk_callback_hsw+0x394>
+ .byte 196,98,125,24,5,110,47,0,0 // vbroadcastss 0x2f6e(%rip),%ymm8 # 5a60 <_sk_callback_hsw+0x38c>
+ .byte 196,98,125,24,13,105,47,0,0 // vbroadcastss 0x2f69(%rip),%ymm9 # 5a64 <_sk_callback_hsw+0x390>
+ .byte 196,98,125,24,21,100,47,0,0 // vbroadcastss 0x2f64(%rip),%ymm10 # 5a68 <_sk_callback_hsw+0x394>
.byte 196,194,53,168,202 // vfmadd213ps %ymm10,%ymm9,%ymm1
.byte 196,194,53,168,210 // vfmadd213ps %ymm10,%ymm9,%ymm2
- .byte 196,98,125,24,13,85,48,0,0 // vbroadcastss 0x3055(%rip),%ymm9 # 5b6c <_sk_callback_hsw+0x398>
+ .byte 196,98,125,24,13,85,47,0,0 // vbroadcastss 0x2f55(%rip),%ymm9 # 5a6c <_sk_callback_hsw+0x398>
.byte 196,66,125,184,200 // vfmadd231ps %ymm8,%ymm0,%ymm9
- .byte 196,226,125,24,5,75,48,0,0 // vbroadcastss 0x304b(%rip),%ymm0 # 5b70 <_sk_callback_hsw+0x39c>
+ .byte 196,226,125,24,5,75,47,0,0 // vbroadcastss 0x2f4b(%rip),%ymm0 # 5a70 <_sk_callback_hsw+0x39c>
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
- .byte 196,98,125,24,5,66,48,0,0 // vbroadcastss 0x3042(%rip),%ymm8 # 5b74 <_sk_callback_hsw+0x3a0>
+ .byte 196,98,125,24,5,66,47,0,0 // vbroadcastss 0x2f42(%rip),%ymm8 # 5a74 <_sk_callback_hsw+0x3a0>
.byte 196,98,117,168,192 // vfmadd213ps %ymm0,%ymm1,%ymm8
- .byte 196,98,125,24,13,56,48,0,0 // vbroadcastss 0x3038(%rip),%ymm9 # 5b78 <_sk_callback_hsw+0x3a4>
+ .byte 196,98,125,24,13,56,47,0,0 // vbroadcastss 0x2f38(%rip),%ymm9 # 5a78 <_sk_callback_hsw+0x3a4>
.byte 196,98,109,172,200 // vfnmadd213ps %ymm0,%ymm2,%ymm9
.byte 196,193,60,89,200 // vmulps %ymm8,%ymm8,%ymm1
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
- .byte 196,226,125,24,21,37,48,0,0 // vbroadcastss 0x3025(%rip),%ymm2 # 5b7c <_sk_callback_hsw+0x3a8>
+ .byte 196,226,125,24,21,37,47,0,0 // vbroadcastss 0x2f25(%rip),%ymm2 # 5a7c <_sk_callback_hsw+0x3a8>
.byte 197,108,194,209,1 // vcmpltps %ymm1,%ymm2,%ymm10
- .byte 196,98,125,24,29,27,48,0,0 // vbroadcastss 0x301b(%rip),%ymm11 # 5b80 <_sk_callback_hsw+0x3ac>
+ .byte 196,98,125,24,29,27,47,0,0 // vbroadcastss 0x2f1b(%rip),%ymm11 # 5a80 <_sk_callback_hsw+0x3ac>
.byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8
- .byte 196,98,125,24,37,17,48,0,0 // vbroadcastss 0x3011(%rip),%ymm12 # 5b84 <_sk_callback_hsw+0x3b0>
+ .byte 196,98,125,24,37,17,47,0,0 // vbroadcastss 0x2f11(%rip),%ymm12 # 5a84 <_sk_callback_hsw+0x3b0>
.byte 196,65,60,89,196 // vmulps %ymm12,%ymm8,%ymm8
.byte 196,99,61,74,193,160 // vblendvps %ymm10,%ymm1,%ymm8,%ymm8
.byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1
@@ -14122,9 +14006,9 @@ _sk_lab_to_xyz_hsw:
.byte 196,65,52,88,203 // vaddps %ymm11,%ymm9,%ymm9
.byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9
.byte 196,227,53,74,208,32 // vblendvps %ymm2,%ymm0,%ymm9,%ymm2
- .byte 196,226,125,24,5,198,47,0,0 // vbroadcastss 0x2fc6(%rip),%ymm0 # 5b88 <_sk_callback_hsw+0x3b4>
+ .byte 196,226,125,24,5,198,46,0,0 // vbroadcastss 0x2ec6(%rip),%ymm0 # 5a88 <_sk_callback_hsw+0x3b4>
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,189,47,0,0 // vbroadcastss 0x2fbd(%rip),%ymm8 # 5b8c <_sk_callback_hsw+0x3b8>
+ .byte 196,98,125,24,5,189,46,0,0 // vbroadcastss 0x2ebd(%rip),%ymm8 # 5a8c <_sk_callback_hsw+0x3b8>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -14138,10 +14022,10 @@ _sk_load_a8_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,52 // jne 2c16 <_sk_load_a8_hsw+0x3e>
.byte 196,194,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm0
- .byte 197,249,219,5,144,53,0,0 // vpand 0x3590(%rip),%xmm0,%xmm0 # 6180 <_sk_callback_hsw+0x9ac>
+ .byte 197,249,219,5,48,52,0,0 // vpand 0x3430(%rip),%xmm0,%xmm0 # 6020 <_sk_callback_hsw+0x94c>
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,142,47,0,0 // vbroadcastss 0x2f8e(%rip),%ymm1 # 5b90 <_sk_callback_hsw+0x3bc>
+ .byte 196,226,125,24,13,142,46,0,0 // vbroadcastss 0x2e8e(%rip),%ymm1 # 5a90 <_sk_callback_hsw+0x3bc>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -14210,10 +14094,10 @@ _sk_load_a8_dst_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,52 // jne 2d06 <_sk_load_a8_dst_hsw+0x3e>
.byte 196,194,121,48,36,19 // vpmovzxbw (%r11,%rdx,1),%xmm4
- .byte 197,217,219,37,176,52,0,0 // vpand 0x34b0(%rip),%xmm4,%xmm4 # 6190 <_sk_callback_hsw+0x9bc>
+ .byte 197,217,219,37,80,51,0,0 // vpand 0x3350(%rip),%xmm4,%xmm4 # 6030 <_sk_callback_hsw+0x95c>
.byte 196,226,125,51,228 // vpmovzxwd %xmm4,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,162,46,0,0 // vbroadcastss 0x2ea2(%rip),%ymm5 # 5b94 <_sk_callback_hsw+0x3c0>
+ .byte 196,226,125,24,45,162,45,0,0 // vbroadcastss 0x2da2(%rip),%ymm5 # 5a94 <_sk_callback_hsw+0x3c0>
.byte 197,220,89,253 // vmulps %ymm5,%ymm4,%ymm7
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
@@ -14280,7 +14164,7 @@ _sk_gather_a8_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
@@ -14313,7 +14197,7 @@ _sk_gather_a8_hsw:
.byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,42,45,0,0 // vbroadcastss 0x2d2a(%rip),%ymm1 # 5b98 <_sk_callback_hsw+0x3c4>
+ .byte 196,226,125,24,13,42,44,0,0 // vbroadcastss 0x2c2a(%rip),%ymm1 # 5a98 <_sk_callback_hsw+0x3c4>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -14327,7 +14211,7 @@ FUNCTION(_sk_store_a8_hsw)
_sk_store_a8_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,12,45,0,0 // vbroadcastss 0x2d0c(%rip),%ymm8 # 5b9c <_sk_callback_hsw+0x3c8>
+ .byte 196,98,125,24,5,12,44,0,0 // vbroadcastss 0x2c0c(%rip),%ymm8 # 5a9c <_sk_callback_hsw+0x3c8>
.byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8
.byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
@@ -14352,13 +14236,13 @@ _sk_store_a8_hsw:
.byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1)
.byte 235,202 // jmp 2eb5 <_sk_store_a8_hsw+0x33>
.byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
- .byte 196,98,57,0,5,164,50,0,0 // vpshufb 0x32a4(%rip),%xmm8,%xmm8 # 61a0 <_sk_callback_hsw+0x9cc>
+ .byte 196,98,57,0,5,68,49,0,0 // vpshufb 0x3144(%rip),%xmm8,%xmm8 # 6040 <_sk_callback_hsw+0x96c>
.byte 196,67,121,21,4,19,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,1)
.byte 235,176 // jmp 2eb5 <_sk_store_a8_hsw+0x33>
.byte 196,67,121,20,68,19,6,12 // vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
.byte 196,67,121,20,68,19,5,10 // vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
.byte 196,67,121,20,68,19,4,8 // vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
- .byte 196,98,57,0,5,138,50,0,0 // vpshufb 0x328a(%rip),%xmm8,%xmm8 # 61b0 <_sk_callback_hsw+0x9dc>
+ .byte 196,98,57,0,5,42,49,0,0 // vpshufb 0x312a(%rip),%xmm8,%xmm8 # 6050 <_sk_callback_hsw+0x97c>
.byte 196,65,121,126,4,19 // vmovd %xmm8,(%r11,%rdx,1)
.byte 235,135 // jmp 2eb5 <_sk_store_a8_hsw+0x33>
.byte 102,144 // xchg %ax,%ax
@@ -14391,13 +14275,13 @@ _sk_load_g8_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,57 // jne 2f8f <_sk_load_g8_hsw+0x43>
.byte 196,194,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm0
- .byte 197,249,219,5,92,50,0,0 // vpand 0x325c(%rip),%xmm0,%xmm0 # 61c0 <_sk_callback_hsw+0x9ec>
+ .byte 197,249,219,5,252,48,0,0 // vpand 0x30fc(%rip),%xmm0,%xmm0 # 6060 <_sk_callback_hsw+0x98c>
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,42,44,0,0 // vbroadcastss 0x2c2a(%rip),%ymm1 # 5ba0 <_sk_callback_hsw+0x3cc>
+ .byte 196,226,125,24,13,42,43,0,0 // vbroadcastss 0x2b2a(%rip),%ymm1 # 5aa0 <_sk_callback_hsw+0x3cc>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,31,44,0,0 // vbroadcastss 0x2c1f(%rip),%ymm3 # 5ba4 <_sk_callback_hsw+0x3d0>
+ .byte 196,226,125,24,29,31,43,0,0 // vbroadcastss 0x2b1f(%rip),%ymm3 # 5aa4 <_sk_callback_hsw+0x3d0>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
@@ -14464,13 +14348,13 @@ _sk_load_g8_dst_hsw:
.byte 77,133,192 // test %r8,%r8
.byte 117,57 // jne 3087 <_sk_load_g8_dst_hsw+0x43>
.byte 196,194,121,48,36,19 // vpmovzxbw (%r11,%rdx,1),%xmm4
- .byte 197,217,219,37,116,49,0,0 // vpand 0x3174(%rip),%xmm4,%xmm4 # 61d0 <_sk_callback_hsw+0x9fc>
+ .byte 197,217,219,37,20,48,0,0 // vpand 0x3014(%rip),%xmm4,%xmm4 # 6070 <_sk_callback_hsw+0x99c>
.byte 196,226,125,51,228 // vpmovzxwd %xmm4,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,58,43,0,0 // vbroadcastss 0x2b3a(%rip),%ymm5 # 5ba8 <_sk_callback_hsw+0x3d4>
+ .byte 196,226,125,24,45,58,42,0,0 // vbroadcastss 0x2a3a(%rip),%ymm5 # 5aa8 <_sk_callback_hsw+0x3d4>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,61,47,43,0,0 // vbroadcastss 0x2b2f(%rip),%ymm7 # 5bac <_sk_callback_hsw+0x3d8>
+ .byte 196,226,125,24,61,47,42,0,0 // vbroadcastss 0x2a2f(%rip),%ymm7 # 5aac <_sk_callback_hsw+0x3d8>
.byte 197,252,40,236 // vmovaps %ymm4,%ymm5
.byte 197,252,40,244 // vmovaps %ymm4,%ymm6
.byte 255,224 // jmpq *%rax
@@ -14535,7 +14419,7 @@ _sk_gather_g8_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
@@ -14568,74 +14452,14 @@ _sk_gather_g8_hsw:
.byte 196,227,121,32,192,7 // vpinsrb $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,190,41,0,0 // vbroadcastss 0x29be(%rip),%ymm1 # 5bb0 <_sk_callback_hsw+0x3dc>
+ .byte 196,226,125,24,13,190,40,0,0 // vbroadcastss 0x28be(%rip),%ymm1 # 5ab0 <_sk_callback_hsw+0x3dc>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,179,41,0,0 // vbroadcastss 0x29b3(%rip),%ymm3 # 5bb4 <_sk_callback_hsw+0x3e0>
+ .byte 196,226,125,24,29,179,40,0,0 // vbroadcastss 0x28b3(%rip),%ymm3 # 5ab4 <_sk_callback_hsw+0x3e0>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
-HIDDEN _sk_gather_i8_hsw
-.globl _sk_gather_i8_hsw
-FUNCTION(_sk_gather_i8_hsw)
-_sk_gather_i8_hsw:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,193 // mov %rax,%r9
- .byte 77,133,201 // test %r9,%r9
- .byte 116,5 // je 321a <_sk_gather_i8_hsw+0xf>
- .byte 76,137,200 // mov %r9,%rax
- .byte 235,2 // jmp 321c <_sk_gather_i8_hsw+0x11>
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 83 // push %rbx
- .byte 76,139,16 // mov (%rax),%r10
- .byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
- .byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
- .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
- .byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
- .byte 196,193,249,126,195 // vmovq %xmm0,%r11
- .byte 68,137,216 // mov %r11d,%eax
- .byte 196,195,121,32,12,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1
- .byte 196,227,249,22,192,1 // vpextrq $0x1,%xmm0,%rax
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,131,113,32,12,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm1,%xmm1
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,32 // shr $0x20,%rax
- .byte 196,227,125,57,192,1 // vextracti128 $0x1,%ymm0,%xmm0
- .byte 196,131,113,32,12,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm1,%xmm1
- .byte 196,193,249,126,195 // vmovq %xmm0,%r11
- .byte 196,195,113,32,12,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1
- .byte 68,137,216 // mov %r11d,%eax
- .byte 196,195,113,32,12,2,4 // vpinsrb $0x4,(%r10,%rax,1),%xmm1,%xmm1
- .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,131,113,32,4,26,5 // vpinsrb $0x5,(%r10,%r11,1),%xmm1,%xmm0
- .byte 137,216 // mov %ebx,%eax
- .byte 196,195,121,32,4,2,6 // vpinsrb $0x6,(%r10,%rax,1),%xmm0,%xmm0
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,195,121,32,4,26,7 // vpinsrb $0x7,(%r10,%rbx,1),%xmm0,%xmm0
- .byte 196,226,125,49,192 // vpmovzxbd %xmm0,%ymm0
- .byte 73,139,65,8 // mov 0x8(%r9),%rax
- .byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
- .byte 196,226,117,144,28,128 // vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3
- .byte 197,229,219,5,223,43,0,0 // vpand 0x2bdf(%rip),%ymm3,%ymm0 # 5ea0 <_sk_callback_hsw+0x6cc>
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,234,40,0,0 // vbroadcastss 0x28ea(%rip),%ymm8 # 5bb8 <_sk_callback_hsw+0x3e4>
- .byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,228,43,0,0 // vpshufb 0x2be4(%rip),%ymm3,%ymm1 # 5ec0 <_sk_callback_hsw+0x6ec>
- .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,242,43,0,0 // vpshufb 0x2bf2(%rip),%ymm3,%ymm2 # 5ee0 <_sk_callback_hsw+0x70c>
- .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
- .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 255,224 // jmpq *%rax
-
HIDDEN _sk_load_565_hsw
.globl _sk_load_565_hsw
FUNCTION(_sk_load_565_hsw)
@@ -14643,69 +14467,70 @@ _sk_load_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 117,114 // jne 3386 <_sk_load_565_hsw+0x7c>
+ .byte 117,114 // jne 3287 <_sk_load_565_hsw+0x7c>
.byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2
- .byte 196,226,125,88,5,148,40,0,0 // vpbroadcastd 0x2894(%rip),%ymm0 # 5bbc <_sk_callback_hsw+0x3e8>
+ .byte 196,226,125,88,5,143,40,0,0 // vpbroadcastd 0x288f(%rip),%ymm0 # 5ab8 <_sk_callback_hsw+0x3e4>
.byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,135,40,0,0 // vbroadcastss 0x2887(%rip),%ymm1 # 5bc0 <_sk_callback_hsw+0x3ec>
+ .byte 196,226,125,24,13,130,40,0,0 // vbroadcastss 0x2882(%rip),%ymm1 # 5abc <_sk_callback_hsw+0x3e8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,126,40,0,0 // vpbroadcastd 0x287e(%rip),%ymm1 # 5bc4 <_sk_callback_hsw+0x3f0>
+ .byte 196,226,125,88,13,121,40,0,0 // vpbroadcastd 0x2879(%rip),%ymm1 # 5ac0 <_sk_callback_hsw+0x3ec>
.byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,113,40,0,0 // vbroadcastss 0x2871(%rip),%ymm3 # 5bc8 <_sk_callback_hsw+0x3f4>
+ .byte 196,226,125,24,29,108,40,0,0 // vbroadcastss 0x286c(%rip),%ymm3 # 5ac4 <_sk_callback_hsw+0x3f0>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,88,29,104,40,0,0 // vpbroadcastd 0x2868(%rip),%ymm3 # 5bcc <_sk_callback_hsw+0x3f8>
+ .byte 196,226,125,88,29,99,40,0,0 // vpbroadcastd 0x2863(%rip),%ymm3 # 5ac8 <_sk_callback_hsw+0x3f4>
.byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,91,40,0,0 // vbroadcastss 0x285b(%rip),%ymm3 # 5bd0 <_sk_callback_hsw+0x3fc>
+ .byte 196,226,125,24,29,86,40,0,0 // vbroadcastss 0x2856(%rip),%ymm3 # 5acc <_sk_callback_hsw+0x3f8>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,80,40,0,0 // vbroadcastss 0x2850(%rip),%ymm3 # 5bd4 <_sk_callback_hsw+0x400>
+ .byte 196,226,125,24,29,75,40,0,0 // vbroadcastss 0x284b(%rip),%ymm3 # 5ad0 <_sk_callback_hsw+0x3fc>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,128 // ja 331a <_sk_load_565_hsw+0x10>
+ .byte 119,128 // ja 321b <_sk_load_565_hsw+0x10>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 3408 <_sk_load_565_hsw+0xfe>
+ .byte 76,141,21,98,0,0,0 // lea 0x62(%rip),%r10 # 3308 <_sk_load_565_hsw+0xfd>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,192 // vmovd %eax,%xmm0
- .byte 233,94,255,255,255 // jmpq 331a <_sk_load_565_hsw+0x10>
+ .byte 233,94,255,255,255 // jmpq 321b <_sk_load_565_hsw+0x10>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,110,12,83 // vmovd (%r11,%rdx,2),%xmm1
.byte 196,227,121,2,193,1 // vpblendd $0x1,%xmm1,%xmm0,%xmm0
- .byte 233,65,255,255,255 // jmpq 331a <_sk_load_565_hsw+0x10>
+ .byte 233,65,255,255,255 // jmpq 321b <_sk_load_565_hsw+0x10>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,122,126,12,83 // vmovq (%r11,%rdx,2),%xmm1
.byte 196,227,113,2,192,12 // vpblendd $0xc,%xmm0,%xmm1,%xmm0
- .byte 233,20,255,255,255 // jmpq 331a <_sk_load_565_hsw+0x10>
- .byte 102,144 // xchg %ax,%ax
- .byte 166 // cmpsb %es:(%rdi),%ds:(%rsi)
+ .byte 233,20,255,255,255 // jmpq 321b <_sk_load_565_hsw+0x10>
+ .byte 144 // nop
+ .byte 167 // cmpsl %es:(%rdi),%ds:(%rsi)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,192 // inc %eax
+ .byte 255,193 // inc %ecx
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,180,255,255,255,237,255 // pushq -0x120001(%rdi,%rdi,8)
+ .byte 255,181,255,255,255,238 // pushq -0x11000001(%rbp)
.byte 255 // (bad)
- .byte 255,229 // jmpq *%rbp
.byte 255 // (bad)
+ .byte 255,230 // jmpq *%rsi
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 221,255 // (bad)
.byte 255 // (bad)
- .byte 255,209 // callq *%rcx
+ .byte 222,255 // fdivrp %st,%st(7)
+ .byte 255 // (bad)
+ .byte 255,210 // callq *%rdx
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -14717,53 +14542,53 @@ _sk_load_565_dst_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 117,114 // jne 34a0 <_sk_load_565_dst_hsw+0x7c>
+ .byte 117,114 // jne 33a0 <_sk_load_565_dst_hsw+0x7c>
.byte 196,193,122,111,36,83 // vmovdqu (%r11,%rdx,2),%xmm4
.byte 196,226,125,51,244 // vpmovzxwd %xmm4,%ymm6
- .byte 196,226,125,88,37,150,39,0,0 // vpbroadcastd 0x2796(%rip),%ymm4 # 5bd8 <_sk_callback_hsw+0x404>
+ .byte 196,226,125,88,37,146,39,0,0 // vpbroadcastd 0x2792(%rip),%ymm4 # 5ad4 <_sk_callback_hsw+0x400>
.byte 197,205,219,228 // vpand %ymm4,%ymm6,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,137,39,0,0 // vbroadcastss 0x2789(%rip),%ymm5 # 5bdc <_sk_callback_hsw+0x408>
+ .byte 196,226,125,24,45,133,39,0,0 // vbroadcastss 0x2785(%rip),%ymm5 # 5ad8 <_sk_callback_hsw+0x404>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
- .byte 196,226,125,88,45,128,39,0,0 // vpbroadcastd 0x2780(%rip),%ymm5 # 5be0 <_sk_callback_hsw+0x40c>
+ .byte 196,226,125,88,45,124,39,0,0 // vpbroadcastd 0x277c(%rip),%ymm5 # 5adc <_sk_callback_hsw+0x408>
.byte 197,205,219,237 // vpand %ymm5,%ymm6,%ymm5
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,125,24,61,115,39,0,0 // vbroadcastss 0x2773(%rip),%ymm7 # 5be4 <_sk_callback_hsw+0x410>
+ .byte 196,226,125,24,61,111,39,0,0 // vbroadcastss 0x276f(%rip),%ymm7 # 5ae0 <_sk_callback_hsw+0x40c>
.byte 197,212,89,239 // vmulps %ymm7,%ymm5,%ymm5
- .byte 196,226,125,88,61,106,39,0,0 // vpbroadcastd 0x276a(%rip),%ymm7 # 5be8 <_sk_callback_hsw+0x414>
+ .byte 196,226,125,88,61,102,39,0,0 // vpbroadcastd 0x2766(%rip),%ymm7 # 5ae4 <_sk_callback_hsw+0x410>
.byte 197,205,219,247 // vpand %ymm7,%ymm6,%ymm6
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
- .byte 196,226,125,24,61,93,39,0,0 // vbroadcastss 0x275d(%rip),%ymm7 # 5bec <_sk_callback_hsw+0x418>
+ .byte 196,226,125,24,61,89,39,0,0 // vbroadcastss 0x2759(%rip),%ymm7 # 5ae8 <_sk_callback_hsw+0x414>
.byte 197,204,89,247 // vmulps %ymm7,%ymm6,%ymm6
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,61,82,39,0,0 // vbroadcastss 0x2752(%rip),%ymm7 # 5bf0 <_sk_callback_hsw+0x41c>
+ .byte 196,226,125,24,61,78,39,0,0 // vbroadcastss 0x274e(%rip),%ymm7 # 5aec <_sk_callback_hsw+0x418>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,7 // and $0x7,%r9b
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,128 // ja 3434 <_sk_load_565_dst_hsw+0x10>
+ .byte 119,128 // ja 3334 <_sk_load_565_dst_hsw+0x10>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3520 <_sk_load_565_dst_hsw+0xfc>
+ .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3420 <_sk_load_565_dst_hsw+0xfc>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,224 // vmovd %eax,%xmm4
- .byte 233,94,255,255,255 // jmpq 3434 <_sk_load_565_dst_hsw+0x10>
+ .byte 233,94,255,255,255 // jmpq 3334 <_sk_load_565_dst_hsw+0x10>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,121,110,44,83 // vmovd (%r11,%rdx,2),%xmm5
.byte 196,227,89,2,229,1 // vpblendd $0x1,%xmm5,%xmm4,%xmm4
- .byte 233,65,255,255,255 // jmpq 3434 <_sk_load_565_dst_hsw+0x10>
+ .byte 233,65,255,255,255 // jmpq 3334 <_sk_load_565_dst_hsw+0x10>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,122,126,44,83 // vmovq (%r11,%rdx,2),%xmm5
.byte 196,227,81,2,228,12 // vpblendd $0xc,%xmm4,%xmm5,%xmm4
- .byte 233,20,255,255,255 // jmpq 3434 <_sk_load_565_dst_hsw+0x10>
+ .byte 233,20,255,255,255 // jmpq 3334 <_sk_load_565_dst_hsw+0x10>
.byte 168,255 // test $0xff,%al
.byte 255 // (bad)
.byte 255,194 // inc %edx
@@ -14790,7 +14615,7 @@ _sk_gather_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
@@ -14824,23 +14649,23 @@ _sk_gather_565_hsw:
.byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,51,208 // vpmovzxwd %xmm0,%ymm2
- .byte 196,226,125,88,5,7,38,0,0 // vpbroadcastd 0x2607(%rip),%ymm0 # 5bf4 <_sk_callback_hsw+0x420>
+ .byte 196,226,125,88,5,3,38,0,0 // vpbroadcastd 0x2603(%rip),%ymm0 # 5af0 <_sk_callback_hsw+0x41c>
.byte 197,237,219,192 // vpand %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,250,37,0,0 // vbroadcastss 0x25fa(%rip),%ymm1 # 5bf8 <_sk_callback_hsw+0x424>
+ .byte 196,226,125,24,13,246,37,0,0 // vbroadcastss 0x25f6(%rip),%ymm1 # 5af4 <_sk_callback_hsw+0x420>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,241,37,0,0 // vpbroadcastd 0x25f1(%rip),%ymm1 # 5bfc <_sk_callback_hsw+0x428>
+ .byte 196,226,125,88,13,237,37,0,0 // vpbroadcastd 0x25ed(%rip),%ymm1 # 5af8 <_sk_callback_hsw+0x424>
.byte 197,237,219,201 // vpand %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,228,37,0,0 // vbroadcastss 0x25e4(%rip),%ymm3 # 5c00 <_sk_callback_hsw+0x42c>
+ .byte 196,226,125,24,29,224,37,0,0 // vbroadcastss 0x25e0(%rip),%ymm3 # 5afc <_sk_callback_hsw+0x428>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,88,29,219,37,0,0 // vpbroadcastd 0x25db(%rip),%ymm3 # 5c04 <_sk_callback_hsw+0x430>
+ .byte 196,226,125,88,29,215,37,0,0 // vpbroadcastd 0x25d7(%rip),%ymm3 # 5b00 <_sk_callback_hsw+0x42c>
.byte 197,237,219,211 // vpand %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,206,37,0,0 // vbroadcastss 0x25ce(%rip),%ymm3 # 5c08 <_sk_callback_hsw+0x434>
+ .byte 196,226,125,24,29,202,37,0,0 // vbroadcastss 0x25ca(%rip),%ymm3 # 5b04 <_sk_callback_hsw+0x430>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,195,37,0,0 // vbroadcastss 0x25c3(%rip),%ymm3 # 5c0c <_sk_callback_hsw+0x438>
+ .byte 196,226,125,24,29,191,37,0,0 // vbroadcastss 0x25bf(%rip),%ymm3 # 5b08 <_sk_callback_hsw+0x434>
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_565_hsw
@@ -14849,11 +14674,11 @@ FUNCTION(_sk_store_565_hsw)
_sk_store_565_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,183,37,0,0 // vbroadcastss 0x25b7(%rip),%ymm8 # 5c10 <_sk_callback_hsw+0x43c>
+ .byte 196,98,125,24,5,179,37,0,0 // vbroadcastss 0x25b3(%rip),%ymm8 # 5b0c <_sk_callback_hsw+0x438>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,53,114,241,11 // vpslld $0xb,%ymm9,%ymm9
- .byte 196,98,125,24,21,162,37,0,0 // vbroadcastss 0x25a2(%rip),%ymm10 # 5c14 <_sk_callback_hsw+0x440>
+ .byte 196,98,125,24,21,158,37,0,0 // vbroadcastss 0x259e(%rip),%ymm10 # 5b10 <_sk_callback_hsw+0x43c>
.byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10
.byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10
.byte 196,193,45,114,242,5 // vpslld $0x5,%ymm10,%ymm10
@@ -14864,7 +14689,7 @@ _sk_store_565_hsw:
.byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 36b0 <_sk_store_565_hsw+0x65>
+ .byte 117,10 // jne 35b0 <_sk_store_565_hsw+0x65>
.byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -14872,22 +14697,22 @@ _sk_store_565_hsw:
.byte 65,128,225,7 // and $0x7,%r9b
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,236 // ja 36ac <_sk_store_565_hsw+0x61>
+ .byte 119,236 // ja 35ac <_sk_store_565_hsw+0x61>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 3710 <_sk_store_565_hsw+0xc5>
+ .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 3610 <_sk_store_565_hsw+0xc5>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- .byte 235,207 // jmp 36ac <_sk_store_565_hsw+0x61>
+ .byte 235,207 // jmp 35ac <_sk_store_565_hsw+0x61>
.byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
.byte 196,65,121,126,4,83 // vmovd %xmm8,(%r11,%rdx,2)
- .byte 235,191 // jmp 36ac <_sk_store_565_hsw+0x61>
+ .byte 235,191 // jmp 35ac <_sk_store_565_hsw+0x61>
.byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
.byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
.byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
.byte 196,65,121,214,4,83 // vmovq %xmm8,(%r11,%rdx,2)
- .byte 235,159 // jmp 36ac <_sk_store_565_hsw+0x61>
+ .byte 235,159 // jmp 35ac <_sk_store_565_hsw+0x61>
.byte 15,31,0 // nopl (%rax)
.byte 196 // (bad)
.byte 255 // (bad)
@@ -14920,28 +14745,28 @@ _sk_load_4444_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,138,0,0,0 // jne 37c4 <_sk_load_4444_hsw+0x98>
+ .byte 15,133,138,0,0,0 // jne 36c4 <_sk_load_4444_hsw+0x98>
.byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3
- .byte 196,226,125,88,5,202,36,0,0 // vpbroadcastd 0x24ca(%rip),%ymm0 # 5c18 <_sk_callback_hsw+0x444>
+ .byte 196,226,125,88,5,198,36,0,0 // vpbroadcastd 0x24c6(%rip),%ymm0 # 5b14 <_sk_callback_hsw+0x440>
.byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,189,36,0,0 // vbroadcastss 0x24bd(%rip),%ymm1 # 5c1c <_sk_callback_hsw+0x448>
+ .byte 196,226,125,24,13,185,36,0,0 // vbroadcastss 0x24b9(%rip),%ymm1 # 5b18 <_sk_callback_hsw+0x444>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,180,36,0,0 // vpbroadcastd 0x24b4(%rip),%ymm1 # 5c20 <_sk_callback_hsw+0x44c>
+ .byte 196,226,125,88,13,176,36,0,0 // vpbroadcastd 0x24b0(%rip),%ymm1 # 5b1c <_sk_callback_hsw+0x448>
.byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,167,36,0,0 // vbroadcastss 0x24a7(%rip),%ymm2 # 5c24 <_sk_callback_hsw+0x450>
+ .byte 196,226,125,24,21,163,36,0,0 // vbroadcastss 0x24a3(%rip),%ymm2 # 5b20 <_sk_callback_hsw+0x44c>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,88,21,158,36,0,0 // vpbroadcastd 0x249e(%rip),%ymm2 # 5c28 <_sk_callback_hsw+0x454>
+ .byte 196,226,125,88,21,154,36,0,0 // vpbroadcastd 0x249a(%rip),%ymm2 # 5b24 <_sk_callback_hsw+0x450>
.byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,145,36,0,0 // vbroadcastss 0x2491(%rip),%ymm8 # 5c2c <_sk_callback_hsw+0x458>
+ .byte 196,98,125,24,5,141,36,0,0 // vbroadcastss 0x248d(%rip),%ymm8 # 5b28 <_sk_callback_hsw+0x454>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,88,5,135,36,0,0 // vpbroadcastd 0x2487(%rip),%ymm8 # 5c30 <_sk_callback_hsw+0x45c>
+ .byte 196,98,125,88,5,131,36,0,0 // vpbroadcastd 0x2483(%rip),%ymm8 # 5b2c <_sk_callback_hsw+0x458>
.byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,121,36,0,0 // vbroadcastss 0x2479(%rip),%ymm8 # 5c34 <_sk_callback_hsw+0x460>
+ .byte 196,98,125,24,5,117,36,0,0 // vbroadcastss 0x2475(%rip),%ymm8 # 5b30 <_sk_callback_hsw+0x45c>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -14950,27 +14775,27 @@ _sk_load_4444_hsw:
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,100,255,255,255 // ja 3740 <_sk_load_4444_hsw+0x14>
+ .byte 15,135,100,255,255,255 // ja 3640 <_sk_load_4444_hsw+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3848 <_sk_load_4444_hsw+0x11c>
+ .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3748 <_sk_load_4444_hsw+0x11c>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,192 // vmovd %eax,%xmm0
- .byte 233,66,255,255,255 // jmpq 3740 <_sk_load_4444_hsw+0x14>
+ .byte 233,66,255,255,255 // jmpq 3640 <_sk_load_4444_hsw+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,110,12,83 // vmovd (%r11,%rdx,2),%xmm1
.byte 196,227,121,2,193,1 // vpblendd $0x1,%xmm1,%xmm0,%xmm0
- .byte 233,37,255,255,255 // jmpq 3740 <_sk_load_4444_hsw+0x14>
+ .byte 233,37,255,255,255 // jmpq 3640 <_sk_load_4444_hsw+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,122,126,12,83 // vmovq (%r11,%rdx,2),%xmm1
.byte 196,227,113,2,192,12 // vpblendd $0xc,%xmm0,%xmm1,%xmm0
- .byte 233,248,254,255,255 // jmpq 3740 <_sk_load_4444_hsw+0x14>
+ .byte 233,248,254,255,255 // jmpq 3640 <_sk_load_4444_hsw+0x14>
.byte 168,255 // test $0xff,%al
.byte 255 // (bad)
.byte 255,194 // inc %edx
@@ -14997,28 +14822,28 @@ _sk_load_4444_dst_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,138,0,0,0 // jne 38fc <_sk_load_4444_dst_hsw+0x98>
+ .byte 15,133,138,0,0,0 // jne 37fc <_sk_load_4444_dst_hsw+0x98>
.byte 196,193,122,111,36,83 // vmovdqu (%r11,%rdx,2),%xmm4
.byte 196,226,125,51,252 // vpmovzxwd %xmm4,%ymm7
- .byte 196,226,125,88,37,178,35,0,0 // vpbroadcastd 0x23b2(%rip),%ymm4 # 5c38 <_sk_callback_hsw+0x464>
+ .byte 196,226,125,88,37,174,35,0,0 // vpbroadcastd 0x23ae(%rip),%ymm4 # 5b34 <_sk_callback_hsw+0x460>
.byte 197,197,219,228 // vpand %ymm4,%ymm7,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,165,35,0,0 // vbroadcastss 0x23a5(%rip),%ymm5 # 5c3c <_sk_callback_hsw+0x468>
+ .byte 196,226,125,24,45,161,35,0,0 // vbroadcastss 0x23a1(%rip),%ymm5 # 5b38 <_sk_callback_hsw+0x464>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
- .byte 196,226,125,88,45,156,35,0,0 // vpbroadcastd 0x239c(%rip),%ymm5 # 5c40 <_sk_callback_hsw+0x46c>
+ .byte 196,226,125,88,45,152,35,0,0 // vpbroadcastd 0x2398(%rip),%ymm5 # 5b3c <_sk_callback_hsw+0x468>
.byte 197,197,219,237 // vpand %ymm5,%ymm7,%ymm5
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,125,24,53,143,35,0,0 // vbroadcastss 0x238f(%rip),%ymm6 # 5c44 <_sk_callback_hsw+0x470>
+ .byte 196,226,125,24,53,139,35,0,0 // vbroadcastss 0x238b(%rip),%ymm6 # 5b40 <_sk_callback_hsw+0x46c>
.byte 197,212,89,238 // vmulps %ymm6,%ymm5,%ymm5
- .byte 196,226,125,88,53,134,35,0,0 // vpbroadcastd 0x2386(%rip),%ymm6 # 5c48 <_sk_callback_hsw+0x474>
+ .byte 196,226,125,88,53,130,35,0,0 // vpbroadcastd 0x2382(%rip),%ymm6 # 5b44 <_sk_callback_hsw+0x470>
.byte 197,197,219,246 // vpand %ymm6,%ymm7,%ymm6
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
- .byte 196,98,125,24,5,121,35,0,0 // vbroadcastss 0x2379(%rip),%ymm8 # 5c4c <_sk_callback_hsw+0x478>
+ .byte 196,98,125,24,5,117,35,0,0 // vbroadcastss 0x2375(%rip),%ymm8 # 5b48 <_sk_callback_hsw+0x474>
.byte 196,193,76,89,240 // vmulps %ymm8,%ymm6,%ymm6
- .byte 196,98,125,88,5,111,35,0,0 // vpbroadcastd 0x236f(%rip),%ymm8 # 5c50 <_sk_callback_hsw+0x47c>
+ .byte 196,98,125,88,5,107,35,0,0 // vpbroadcastd 0x236b(%rip),%ymm8 # 5b4c <_sk_callback_hsw+0x478>
.byte 196,193,69,219,248 // vpand %ymm8,%ymm7,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,97,35,0,0 // vbroadcastss 0x2361(%rip),%ymm8 # 5c54 <_sk_callback_hsw+0x480>
+ .byte 196,98,125,24,5,93,35,0,0 // vbroadcastss 0x235d(%rip),%ymm8 # 5b50 <_sk_callback_hsw+0x47c>
.byte 196,193,68,89,248 // vmulps %ymm8,%ymm7,%ymm7
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -15027,27 +14852,27 @@ _sk_load_4444_dst_hsw:
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,100,255,255,255 // ja 3878 <_sk_load_4444_dst_hsw+0x14>
+ .byte 15,135,100,255,255,255 // ja 3778 <_sk_load_4444_dst_hsw+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3980 <_sk_load_4444_dst_hsw+0x11c>
+ .byte 76,141,21,97,0,0,0 // lea 0x61(%rip),%r10 # 3880 <_sk_load_4444_dst_hsw+0x11c>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,224 // vmovd %eax,%xmm4
- .byte 233,66,255,255,255 // jmpq 3878 <_sk_load_4444_dst_hsw+0x14>
+ .byte 233,66,255,255,255 // jmpq 3778 <_sk_load_4444_dst_hsw+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,121,110,44,83 // vmovd (%r11,%rdx,2),%xmm5
.byte 196,227,89,2,229,1 // vpblendd $0x1,%xmm5,%xmm4,%xmm4
- .byte 233,37,255,255,255 // jmpq 3878 <_sk_load_4444_dst_hsw+0x14>
+ .byte 233,37,255,255,255 // jmpq 3778 <_sk_load_4444_dst_hsw+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,122,126,44,83 // vmovq (%r11,%rdx,2),%xmm5
.byte 196,227,81,2,228,12 // vpblendd $0xc,%xmm4,%xmm5,%xmm4
- .byte 233,248,254,255,255 // jmpq 3878 <_sk_load_4444_dst_hsw+0x14>
+ .byte 233,248,254,255,255 // jmpq 3778 <_sk_load_4444_dst_hsw+0x14>
.byte 168,255 // test $0xff,%al
.byte 255 // (bad)
.byte 255,194 // inc %edx
@@ -15074,7 +14899,7 @@ _sk_gather_4444_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
@@ -15108,25 +14933,25 @@ _sk_gather_4444_hsw:
.byte 67,15,183,4,89 // movzwl (%r9,%r11,2),%eax
.byte 197,249,196,192,7 // vpinsrw $0x7,%eax,%xmm0,%xmm0
.byte 196,226,125,51,216 // vpmovzxwd %xmm0,%ymm3
- .byte 196,226,125,88,5,11,34,0,0 // vpbroadcastd 0x220b(%rip),%ymm0 # 5c58 <_sk_callback_hsw+0x484>
+ .byte 196,226,125,88,5,7,34,0,0 // vpbroadcastd 0x2207(%rip),%ymm0 # 5b54 <_sk_callback_hsw+0x480>
.byte 197,229,219,192 // vpand %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,254,33,0,0 // vbroadcastss 0x21fe(%rip),%ymm1 # 5c5c <_sk_callback_hsw+0x488>
+ .byte 196,226,125,24,13,250,33,0,0 // vbroadcastss 0x21fa(%rip),%ymm1 # 5b58 <_sk_callback_hsw+0x484>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,88,13,245,33,0,0 // vpbroadcastd 0x21f5(%rip),%ymm1 # 5c60 <_sk_callback_hsw+0x48c>
+ .byte 196,226,125,88,13,241,33,0,0 // vpbroadcastd 0x21f1(%rip),%ymm1 # 5b5c <_sk_callback_hsw+0x488>
.byte 197,229,219,201 // vpand %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,232,33,0,0 // vbroadcastss 0x21e8(%rip),%ymm2 # 5c64 <_sk_callback_hsw+0x490>
+ .byte 196,226,125,24,21,228,33,0,0 // vbroadcastss 0x21e4(%rip),%ymm2 # 5b60 <_sk_callback_hsw+0x48c>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,88,21,223,33,0,0 // vpbroadcastd 0x21df(%rip),%ymm2 # 5c68 <_sk_callback_hsw+0x494>
+ .byte 196,226,125,88,21,219,33,0,0 // vpbroadcastd 0x21db(%rip),%ymm2 # 5b64 <_sk_callback_hsw+0x490>
.byte 197,229,219,210 // vpand %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,210,33,0,0 // vbroadcastss 0x21d2(%rip),%ymm8 # 5c6c <_sk_callback_hsw+0x498>
+ .byte 196,98,125,24,5,206,33,0,0 // vbroadcastss 0x21ce(%rip),%ymm8 # 5b68 <_sk_callback_hsw+0x494>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,88,5,200,33,0,0 // vpbroadcastd 0x21c8(%rip),%ymm8 # 5c70 <_sk_callback_hsw+0x49c>
+ .byte 196,98,125,88,5,196,33,0,0 // vpbroadcastd 0x21c4(%rip),%ymm8 # 5b6c <_sk_callback_hsw+0x498>
.byte 196,193,101,219,216 // vpand %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,186,33,0,0 // vbroadcastss 0x21ba(%rip),%ymm8 # 5c74 <_sk_callback_hsw+0x4a0>
+ .byte 196,98,125,24,5,182,33,0,0 // vbroadcastss 0x21b6(%rip),%ymm8 # 5b70 <_sk_callback_hsw+0x49c>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -15137,7 +14962,7 @@ FUNCTION(_sk_store_4444_hsw)
_sk_store_4444_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,167,33,0,0 // vbroadcastss 0x21a7(%rip),%ymm8 # 5c78 <_sk_callback_hsw+0x4a4>
+ .byte 196,98,125,24,5,163,33,0,0 // vbroadcastss 0x21a3(%rip),%ymm8 # 5b74 <_sk_callback_hsw+0x4a0>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,53,114,241,12 // vpslld $0xc,%ymm9,%ymm9
@@ -15155,7 +14980,7 @@ _sk_store_4444_hsw:
.byte 196,67,125,57,193,1 // vextracti128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3b34 <_sk_store_4444_hsw+0x71>
+ .byte 117,10 // jne 3a34 <_sk_store_4444_hsw+0x71>
.byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -15163,22 +14988,22 @@ _sk_store_4444_hsw:
.byte 65,128,225,7 // and $0x7,%r9b
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,236 // ja 3b30 <_sk_store_4444_hsw+0x6d>
+ .byte 119,236 // ja 3a30 <_sk_store_4444_hsw+0x6d>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 3b94 <_sk_store_4444_hsw+0xd1>
+ .byte 76,141,21,69,0,0,0 // lea 0x45(%rip),%r10 # 3a94 <_sk_store_4444_hsw+0xd1>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- .byte 235,207 // jmp 3b30 <_sk_store_4444_hsw+0x6d>
+ .byte 235,207 // jmp 3a30 <_sk_store_4444_hsw+0x6d>
.byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
.byte 196,65,121,126,4,83 // vmovd %xmm8,(%r11,%rdx,2)
- .byte 235,191 // jmp 3b30 <_sk_store_4444_hsw+0x6d>
+ .byte 235,191 // jmp 3a30 <_sk_store_4444_hsw+0x6d>
.byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
.byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
.byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
.byte 196,65,121,214,4,83 // vmovq %xmm8,(%r11,%rdx,2)
- .byte 235,159 // jmp 3b30 <_sk_store_4444_hsw+0x6d>
+ .byte 235,159 // jmp 3a30 <_sk_store_4444_hsw+0x6d>
.byte 15,31,0 // nopl (%rax)
.byte 196 // (bad)
.byte 255 // (bad)
@@ -15213,16 +15038,16 @@ _sk_load_8888_hsw:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3c1d <_sk_load_8888_hsw+0x6d>
+ .byte 117,88 // jne 3b1d <_sk_load_8888_hsw+0x6d>
.byte 196,193,124,16,26 // vmovups (%r10),%ymm3
- .byte 197,228,84,5,46,35,0,0 // vandps 0x232e(%rip),%ymm3,%ymm0 # 5f00 <_sk_callback_hsw+0x72c>
+ .byte 197,228,84,5,206,34,0,0 // vandps 0x22ce(%rip),%ymm3,%ymm0 # 5da0 <_sk_callback_hsw+0x6cc>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,157,32,0,0 // vbroadcastss 0x209d(%rip),%ymm8 # 5c7c <_sk_callback_hsw+0x4a8>
+ .byte 196,98,125,24,5,153,32,0,0 // vbroadcastss 0x2099(%rip),%ymm8 # 5b78 <_sk_callback_hsw+0x4a4>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,51,35,0,0 // vpshufb 0x2333(%rip),%ymm3,%ymm1 # 5f20 <_sk_callback_hsw+0x74c>
+ .byte 196,226,101,0,13,211,34,0,0 // vpshufb 0x22d3(%rip),%ymm3,%ymm1 # 5dc0 <_sk_callback_hsw+0x6ec>
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,65,35,0,0 // vpshufb 0x2341(%rip),%ymm3,%ymm2 # 5f40 <_sk_callback_hsw+0x76c>
+ .byte 196,226,101,0,21,225,34,0,0 // vpshufb 0x22e1(%rip),%ymm3,%ymm2 # 5de0 <_sk_callback_hsw+0x70c>
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -15239,7 +15064,7 @@ _sk_load_8888_hsw:
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0
.byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
- .byte 235,135 // jmp 3bca <_sk_load_8888_hsw+0x1a>
+ .byte 235,135 // jmp 3aca <_sk_load_8888_hsw+0x1a>
HIDDEN _sk_load_8888_dst_hsw
.globl _sk_load_8888_dst_hsw
@@ -15250,16 +15075,16 @@ _sk_load_8888_dst_hsw:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3cb0 <_sk_load_8888_dst_hsw+0x6d>
+ .byte 117,88 // jne 3bb0 <_sk_load_8888_dst_hsw+0x6d>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,196,84,37,251,34,0,0 // vandps 0x22fb(%rip),%ymm7,%ymm4 # 5f60 <_sk_callback_hsw+0x78c>
+ .byte 197,196,84,37,155,34,0,0 // vandps 0x229b(%rip),%ymm7,%ymm4 # 5e00 <_sk_callback_hsw+0x72c>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,98,125,24,5,14,32,0,0 // vbroadcastss 0x200e(%rip),%ymm8 # 5c80 <_sk_callback_hsw+0x4ac>
+ .byte 196,98,125,24,5,10,32,0,0 // vbroadcastss 0x200a(%rip),%ymm8 # 5b7c <_sk_callback_hsw+0x4a8>
.byte 196,193,92,89,224 // vmulps %ymm8,%ymm4,%ymm4
- .byte 196,226,69,0,45,0,35,0,0 // vpshufb 0x2300(%rip),%ymm7,%ymm5 # 5f80 <_sk_callback_hsw+0x7ac>
+ .byte 196,226,69,0,45,160,34,0,0 // vpshufb 0x22a0(%rip),%ymm7,%ymm5 # 5e20 <_sk_callback_hsw+0x74c>
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
.byte 196,193,84,89,232 // vmulps %ymm8,%ymm5,%ymm5
- .byte 196,226,69,0,53,14,35,0,0 // vpshufb 0x230e(%rip),%ymm7,%ymm6 # 5fa0 <_sk_callback_hsw+0x7cc>
+ .byte 196,226,69,0,53,174,34,0,0 // vpshufb 0x22ae(%rip),%ymm7,%ymm6 # 5e40 <_sk_callback_hsw+0x76c>
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
.byte 196,193,76,89,240 // vmulps %ymm8,%ymm6,%ymm6
.byte 197,197,114,215,24 // vpsrld $0x18,%ymm7,%ymm7
@@ -15276,7 +15101,7 @@ _sk_load_8888_dst_hsw:
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,125,33,228 // vpmovsxbd %xmm4,%ymm4
.byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
- .byte 235,135 // jmp 3c5d <_sk_load_8888_dst_hsw+0x1a>
+ .byte 235,135 // jmp 3b5d <_sk_load_8888_dst_hsw+0x1a>
HIDDEN _sk_gather_8888_hsw
.globl _sk_gather_8888_hsw
@@ -15285,20 +15110,20 @@ _sk_gather_8888_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 196,194,117,144,28,129 // vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
- .byte 197,229,219,5,188,34,0,0 // vpand 0x22bc(%rip),%ymm3,%ymm0 # 5fc0 <_sk_callback_hsw+0x7ec>
+ .byte 197,229,219,5,92,34,0,0 // vpand 0x225c(%rip),%ymm3,%ymm0 # 5e60 <_sk_callback_hsw+0x78c>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,115,31,0,0 // vbroadcastss 0x1f73(%rip),%ymm8 # 5c84 <_sk_callback_hsw+0x4b0>
+ .byte 196,98,125,24,5,111,31,0,0 // vbroadcastss 0x1f6f(%rip),%ymm8 # 5b80 <_sk_callback_hsw+0x4ac>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,226,101,0,13,193,34,0,0 // vpshufb 0x22c1(%rip),%ymm3,%ymm1 # 5fe0 <_sk_callback_hsw+0x80c>
+ .byte 196,226,101,0,13,97,34,0,0 // vpshufb 0x2261(%rip),%ymm3,%ymm1 # 5e80 <_sk_callback_hsw+0x7ac>
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,226,101,0,21,207,34,0,0 // vpshufb 0x22cf(%rip),%ymm3,%ymm2 # 6000 <_sk_callback_hsw+0x82c>
+ .byte 196,226,101,0,21,111,34,0,0 // vpshufb 0x226f(%rip),%ymm3,%ymm2 # 5ea0 <_sk_callback_hsw+0x7cc>
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -15315,7 +15140,7 @@ _sk_store_8888_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
- .byte 196,98,125,24,5,35,31,0,0 // vbroadcastss 0x1f23(%rip),%ymm8 # 5c88 <_sk_callback_hsw+0x4b4>
+ .byte 196,98,125,24,5,31,31,0,0 // vbroadcastss 0x1f1f(%rip),%ymm8 # 5b84 <_sk_callback_hsw+0x4b0>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -15331,7 +15156,7 @@ _sk_store_8888_hsw:
.byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 3dbf <_sk_store_8888_hsw+0x73>
+ .byte 117,12 // jne 3cbf <_sk_store_8888_hsw+0x73>
.byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -15344,7 +15169,7 @@ _sk_store_8888_hsw:
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9
.byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
- .byte 235,211 // jmp 3db8 <_sk_store_8888_hsw+0x6c>
+ .byte 235,211 // jmp 3cb8 <_sk_store_8888_hsw+0x6c>
HIDDEN _sk_store_8888_2d_hsw
.globl _sk_store_8888_2d_hsw
@@ -15352,12 +15177,12 @@ FUNCTION(_sk_store_8888_2d_hsw)
_sk_store_8888_2d_hsw:
.byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,139,72,8 // mov 0x8(%rax),%rcx
+ .byte 72,99,72,8 // movslq 0x8(%rax),%rcx
.byte 73,15,175,201 // imul %r9,%rcx
.byte 72,193,225,2 // shl $0x2,%rcx
.byte 72,3,8 // add (%rax),%rcx
.byte 72,141,4,145 // lea (%rcx,%rdx,4),%rax
- .byte 196,98,125,24,5,134,30,0,0 // vbroadcastss 0x1e86(%rip),%ymm8 # 5c8c <_sk_callback_hsw+0x4b8>
+ .byte 196,98,125,24,5,130,30,0,0 // vbroadcastss 0x1e82(%rip),%ymm8 # 5b88 <_sk_callback_hsw+0x4b4>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -15373,7 +15198,7 @@ _sk_store_8888_2d_hsw:
.byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,11 // jne 3e5f <_sk_store_8888_2d_hsw+0x7a>
+ .byte 117,11 // jne 3d5f <_sk_store_8888_2d_hsw+0x7a>
.byte 197,124,17,0 // vmovups %ymm8,(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -15386,7 +15211,7 @@ _sk_store_8888_2d_hsw:
.byte 196,65,249,110,202 // vmovq %r10,%xmm9
.byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9
.byte 196,98,53,46,0 // vmaskmovps %ymm8,%ymm9,(%rax)
- .byte 235,211 // jmp 3e58 <_sk_store_8888_2d_hsw+0x73>
+ .byte 235,211 // jmp 3d58 <_sk_store_8888_2d_hsw+0x73>
HIDDEN _sk_load_bgra_hsw
.globl _sk_load_bgra_hsw
@@ -15397,16 +15222,16 @@ _sk_load_bgra_hsw:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3ef2 <_sk_load_bgra_hsw+0x6d>
+ .byte 117,88 // jne 3df2 <_sk_load_bgra_hsw+0x6d>
.byte 196,193,124,16,26 // vmovups (%r10),%ymm3
- .byte 197,228,84,5,121,33,0,0 // vandps 0x2179(%rip),%ymm3,%ymm0 # 6020 <_sk_callback_hsw+0x84c>
+ .byte 197,228,84,5,25,33,0,0 // vandps 0x2119(%rip),%ymm3,%ymm0 # 5ec0 <_sk_callback_hsw+0x7ec>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,220,29,0,0 // vbroadcastss 0x1ddc(%rip),%ymm8 # 5c90 <_sk_callback_hsw+0x4bc>
+ .byte 196,98,125,24,5,216,29,0,0 // vbroadcastss 0x1dd8(%rip),%ymm8 # 5b8c <_sk_callback_hsw+0x4b8>
.byte 196,193,124,89,208 // vmulps %ymm8,%ymm0,%ymm2
- .byte 196,226,101,0,5,126,33,0,0 // vpshufb 0x217e(%rip),%ymm3,%ymm0 # 6040 <_sk_callback_hsw+0x86c>
+ .byte 196,226,101,0,5,30,33,0,0 // vpshufb 0x211e(%rip),%ymm3,%ymm0 # 5ee0 <_sk_callback_hsw+0x80c>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
.byte 196,193,124,89,200 // vmulps %ymm8,%ymm0,%ymm1
- .byte 196,226,101,0,5,140,33,0,0 // vpshufb 0x218c(%rip),%ymm3,%ymm0 # 6060 <_sk_callback_hsw+0x88c>
+ .byte 196,226,101,0,5,44,33,0,0 // vpshufb 0x212c(%rip),%ymm3,%ymm0 # 5f00 <_sk_callback_hsw+0x82c>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -15423,7 +15248,7 @@ _sk_load_bgra_hsw:
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,125,33,192 // vpmovsxbd %xmm0,%ymm0
.byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
- .byte 235,135 // jmp 3e9f <_sk_load_bgra_hsw+0x1a>
+ .byte 235,135 // jmp 3d9f <_sk_load_bgra_hsw+0x1a>
HIDDEN _sk_load_bgra_dst_hsw
.globl _sk_load_bgra_dst_hsw
@@ -15434,16 +15259,16 @@ _sk_load_bgra_dst_hsw:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3f85 <_sk_load_bgra_dst_hsw+0x6d>
+ .byte 117,88 // jne 3e85 <_sk_load_bgra_dst_hsw+0x6d>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,196,84,37,70,33,0,0 // vandps 0x2146(%rip),%ymm7,%ymm4 # 6080 <_sk_callback_hsw+0x8ac>
+ .byte 197,196,84,37,230,32,0,0 // vandps 0x20e6(%rip),%ymm7,%ymm4 # 5f20 <_sk_callback_hsw+0x84c>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,98,125,24,5,77,29,0,0 // vbroadcastss 0x1d4d(%rip),%ymm8 # 5c94 <_sk_callback_hsw+0x4c0>
+ .byte 196,98,125,24,5,73,29,0,0 // vbroadcastss 0x1d49(%rip),%ymm8 # 5b90 <_sk_callback_hsw+0x4bc>
.byte 196,193,92,89,240 // vmulps %ymm8,%ymm4,%ymm6
- .byte 196,226,69,0,37,75,33,0,0 // vpshufb 0x214b(%rip),%ymm7,%ymm4 # 60a0 <_sk_callback_hsw+0x8cc>
+ .byte 196,226,69,0,37,235,32,0,0 // vpshufb 0x20eb(%rip),%ymm7,%ymm4 # 5f40 <_sk_callback_hsw+0x86c>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
.byte 196,193,92,89,232 // vmulps %ymm8,%ymm4,%ymm5
- .byte 196,226,69,0,37,89,33,0,0 // vpshufb 0x2159(%rip),%ymm7,%ymm4 # 60c0 <_sk_callback_hsw+0x8ec>
+ .byte 196,226,69,0,37,249,32,0,0 // vpshufb 0x20f9(%rip),%ymm7,%ymm4 # 5f60 <_sk_callback_hsw+0x88c>
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
.byte 196,193,92,89,224 // vmulps %ymm8,%ymm4,%ymm4
.byte 197,197,114,215,24 // vpsrld $0x18,%ymm7,%ymm7
@@ -15460,7 +15285,7 @@ _sk_load_bgra_dst_hsw:
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,125,33,228 // vpmovsxbd %xmm4,%ymm4
.byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
- .byte 235,135 // jmp 3f32 <_sk_load_bgra_dst_hsw+0x1a>
+ .byte 235,135 // jmp 3e32 <_sk_load_bgra_dst_hsw+0x1a>
HIDDEN _sk_gather_bgra_hsw
.globl _sk_gather_bgra_hsw
@@ -15469,20 +15294,20 @@ _sk_gather_bgra_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 196,194,117,144,28,129 // vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
- .byte 197,229,219,5,7,33,0,0 // vpand 0x2107(%rip),%ymm3,%ymm0 # 60e0 <_sk_callback_hsw+0x90c>
+ .byte 197,229,219,5,167,32,0,0 // vpand 0x20a7(%rip),%ymm3,%ymm0 # 5f80 <_sk_callback_hsw+0x8ac>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,178,28,0,0 // vbroadcastss 0x1cb2(%rip),%ymm8 # 5c98 <_sk_callback_hsw+0x4c4>
+ .byte 196,98,125,24,5,174,28,0,0 // vbroadcastss 0x1cae(%rip),%ymm8 # 5b94 <_sk_callback_hsw+0x4c0>
.byte 196,193,124,89,208 // vmulps %ymm8,%ymm0,%ymm2
- .byte 196,226,101,0,5,12,33,0,0 // vpshufb 0x210c(%rip),%ymm3,%ymm0 # 6100 <_sk_callback_hsw+0x92c>
+ .byte 196,226,101,0,5,172,32,0,0 // vpshufb 0x20ac(%rip),%ymm3,%ymm0 # 5fa0 <_sk_callback_hsw+0x8cc>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
.byte 196,193,124,89,200 // vmulps %ymm8,%ymm0,%ymm1
- .byte 196,226,101,0,5,26,33,0,0 // vpshufb 0x211a(%rip),%ymm3,%ymm0 # 6120 <_sk_callback_hsw+0x94c>
+ .byte 196,226,101,0,5,186,32,0,0 // vpshufb 0x20ba(%rip),%ymm3,%ymm0 # 5fc0 <_sk_callback_hsw+0x8ec>
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,229,114,211,24 // vpsrld $0x18,%ymm3,%ymm3
@@ -15499,7 +15324,7 @@ _sk_store_bgra_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
- .byte 196,98,125,24,5,98,28,0,0 // vbroadcastss 0x1c62(%rip),%ymm8 # 5c9c <_sk_callback_hsw+0x4c8>
+ .byte 196,98,125,24,5,94,28,0,0 // vbroadcastss 0x1c5e(%rip),%ymm8 # 5b98 <_sk_callback_hsw+0x4c4>
.byte 196,65,108,89,200 // vmulps %ymm8,%ymm2,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -15515,7 +15340,7 @@ _sk_store_bgra_hsw:
.byte 196,65,45,235,192 // vpor %ymm8,%ymm10,%ymm8
.byte 196,65,53,235,192 // vpor %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 4094 <_sk_store_bgra_hsw+0x73>
+ .byte 117,12 // jne 3f94 <_sk_store_bgra_hsw+0x73>
.byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -15528,7 +15353,7 @@ _sk_store_bgra_hsw:
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,125,33,201 // vpmovsxbd %xmm9,%ymm9
.byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
- .byte 235,211 // jmp 408d <_sk_store_bgra_hsw+0x6c>
+ .byte 235,211 // jmp 3f8d <_sk_store_bgra_hsw+0x6c>
HIDDEN _sk_load_f16_hsw
.globl _sk_load_f16_hsw
@@ -15537,7 +15362,7 @@ _sk_load_f16_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,97 // jne 4125 <_sk_load_f16_hsw+0x6b>
+ .byte 117,97 // jne 4025 <_sk_load_f16_hsw+0x6b>
.byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
.byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2
.byte 197,249,16,92,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm3
@@ -15563,29 +15388,29 @@ _sk_load_f16_hsw:
.byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,79 // je 4184 <_sk_load_f16_hsw+0xca>
+ .byte 116,79 // je 4084 <_sk_load_f16_hsw+0xca>
.byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,67 // jb 4184 <_sk_load_f16_hsw+0xca>
+ .byte 114,67 // jb 4084 <_sk_load_f16_hsw+0xca>
.byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,68 // je 4191 <_sk_load_f16_hsw+0xd7>
+ .byte 116,68 // je 4091 <_sk_load_f16_hsw+0xd7>
.byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,56 // jb 4191 <_sk_load_f16_hsw+0xd7>
+ .byte 114,56 // jb 4091 <_sk_load_f16_hsw+0xd7>
.byte 197,251,16,92,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm3
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,114,255,255,255 // je 40db <_sk_load_f16_hsw+0x21>
+ .byte 15,132,114,255,255,255 // je 3fdb <_sk_load_f16_hsw+0x21>
.byte 197,225,22,92,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,98,255,255,255 // jb 40db <_sk_load_f16_hsw+0x21>
+ .byte 15,130,98,255,255,255 // jb 3fdb <_sk_load_f16_hsw+0x21>
.byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
- .byte 233,87,255,255,255 // jmpq 40db <_sk_load_f16_hsw+0x21>
+ .byte 233,87,255,255,255 // jmpq 3fdb <_sk_load_f16_hsw+0x21>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,74,255,255,255 // jmpq 40db <_sk_load_f16_hsw+0x21>
+ .byte 233,74,255,255,255 // jmpq 3fdb <_sk_load_f16_hsw+0x21>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,65,255,255,255 // jmpq 40db <_sk_load_f16_hsw+0x21>
+ .byte 233,65,255,255,255 // jmpq 3fdb <_sk_load_f16_hsw+0x21>
HIDDEN _sk_load_f16_dst_hsw
.globl _sk_load_f16_dst_hsw
@@ -15594,7 +15419,7 @@ _sk_load_f16_dst_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,97 // jne 4205 <_sk_load_f16_dst_hsw+0x6b>
+ .byte 117,97 // jne 4105 <_sk_load_f16_dst_hsw+0x6b>
.byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
.byte 197,249,16,116,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm6
.byte 197,249,16,124,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm7
@@ -15620,29 +15445,29 @@ _sk_load_f16_dst_hsw:
.byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,79 // je 4264 <_sk_load_f16_dst_hsw+0xca>
+ .byte 116,79 // je 4164 <_sk_load_f16_dst_hsw+0xca>
.byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,67 // jb 4264 <_sk_load_f16_dst_hsw+0xca>
+ .byte 114,67 // jb 4164 <_sk_load_f16_dst_hsw+0xca>
.byte 197,251,16,116,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm6
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,68 // je 4271 <_sk_load_f16_dst_hsw+0xd7>
+ .byte 116,68 // je 4171 <_sk_load_f16_dst_hsw+0xd7>
.byte 197,201,22,116,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm6,%xmm6
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,56 // jb 4271 <_sk_load_f16_dst_hsw+0xd7>
+ .byte 114,56 // jb 4171 <_sk_load_f16_dst_hsw+0xd7>
.byte 197,251,16,124,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm7
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,114,255,255,255 // je 41bb <_sk_load_f16_dst_hsw+0x21>
+ .byte 15,132,114,255,255,255 // je 40bb <_sk_load_f16_dst_hsw+0x21>
.byte 197,193,22,124,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm7,%xmm7
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,98,255,255,255 // jb 41bb <_sk_load_f16_dst_hsw+0x21>
+ .byte 15,130,98,255,255,255 // jb 40bb <_sk_load_f16_dst_hsw+0x21>
.byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
- .byte 233,87,255,255,255 // jmpq 41bb <_sk_load_f16_dst_hsw+0x21>
+ .byte 233,87,255,255,255 // jmpq 40bb <_sk_load_f16_dst_hsw+0x21>
.byte 197,193,87,255 // vxorpd %xmm7,%xmm7,%xmm7
.byte 197,201,87,246 // vxorpd %xmm6,%xmm6,%xmm6
- .byte 233,74,255,255,255 // jmpq 41bb <_sk_load_f16_dst_hsw+0x21>
+ .byte 233,74,255,255,255 // jmpq 40bb <_sk_load_f16_dst_hsw+0x21>
.byte 197,193,87,255 // vxorpd %xmm7,%xmm7,%xmm7
- .byte 233,65,255,255,255 // jmpq 41bb <_sk_load_f16_dst_hsw+0x21>
+ .byte 233,65,255,255,255 // jmpq 40bb <_sk_load_f16_dst_hsw+0x21>
HIDDEN _sk_gather_f16_hsw
.globl _sk_gather_f16_hsw
@@ -15651,7 +15476,7 @@ _sk_gather_f16_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 196,226,125,88,80,16 // vpbroadcastd 0x10(%rax),%ymm2
+ .byte 196,226,125,88,80,8 // vpbroadcastd 0x8(%rax),%ymm2
.byte 196,226,109,64,201 // vpmulld %ymm1,%ymm2,%ymm1
.byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
.byte 197,245,254,192 // vpaddd %ymm0,%ymm1,%ymm0
@@ -15700,7 +15525,7 @@ _sk_store_f16_hsw:
.byte 196,65,57,98,205 // vpunpckldq %xmm13,%xmm8,%xmm9
.byte 196,65,57,106,197 // vpunpckhdq %xmm13,%xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,27 // jne 4369 <_sk_store_f16_hsw+0x65>
+ .byte 117,27 // jne 4269 <_sk_store_f16_hsw+0x65>
.byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8)
.byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8)
.byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8)
@@ -15709,22 +15534,22 @@ _sk_store_f16_hsw:
.byte 255,224 // jmpq *%rax
.byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,241 // je 4365 <_sk_store_f16_hsw+0x61>
+ .byte 116,241 // je 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,229 // jb 4365 <_sk_store_f16_hsw+0x61>
+ .byte 114,229 // jb 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8)
- .byte 116,221 // je 4365 <_sk_store_f16_hsw+0x61>
+ .byte 116,221 // je 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,209 // jb 4365 <_sk_store_f16_hsw+0x61>
+ .byte 114,209 // jb 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8)
- .byte 116,201 // je 4365 <_sk_store_f16_hsw+0x61>
+ .byte 116,201 // je 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,189 // jb 4365 <_sk_store_f16_hsw+0x61>
+ .byte 114,189 // jb 4265 <_sk_store_f16_hsw+0x61>
.byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8)
- .byte 235,181 // jmp 4365 <_sk_store_f16_hsw+0x61>
+ .byte 235,181 // jmp 4265 <_sk_store_f16_hsw+0x61>
HIDDEN _sk_load_u16_be_hsw
.globl _sk_load_u16_be_hsw
@@ -15734,7 +15559,7 @@ _sk_load_u16_be_hsw:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,204,0,0,0 // jne 4492 <_sk_load_u16_be_hsw+0xe2>
+ .byte 15,133,204,0,0,0 // jne 4392 <_sk_load_u16_be_hsw+0xe2>
.byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8
.byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2
.byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3
@@ -15753,7 +15578,7 @@ _sk_load_u16_be_hsw:
.byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,21,121,24,0,0 // vbroadcastss 0x1879(%rip),%ymm10 # 5ca0 <_sk_callback_hsw+0x4cc>
+ .byte 196,98,125,24,21,117,24,0,0 // vbroadcastss 0x1875(%rip),%ymm10 # 5b9c <_sk_callback_hsw+0x4c8>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -15781,29 +15606,29 @@ _sk_load_u16_be_hsw:
.byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,85 // je 44f8 <_sk_load_u16_be_hsw+0x148>
+ .byte 116,85 // je 43f8 <_sk_load_u16_be_hsw+0x148>
.byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,72 // jb 44f8 <_sk_load_u16_be_hsw+0x148>
+ .byte 114,72 // jb 43f8 <_sk_load_u16_be_hsw+0x148>
.byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,72 // je 4505 <_sk_load_u16_be_hsw+0x155>
+ .byte 116,72 // je 4405 <_sk_load_u16_be_hsw+0x155>
.byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,59 // jb 4505 <_sk_load_u16_be_hsw+0x155>
+ .byte 114,59 // jb 4405 <_sk_load_u16_be_hsw+0x155>
.byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,6,255,255,255 // je 43e1 <_sk_load_u16_be_hsw+0x31>
+ .byte 15,132,6,255,255,255 // je 42e1 <_sk_load_u16_be_hsw+0x31>
.byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,245,254,255,255 // jb 43e1 <_sk_load_u16_be_hsw+0x31>
+ .byte 15,130,245,254,255,255 // jb 42e1 <_sk_load_u16_be_hsw+0x31>
.byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9
- .byte 233,233,254,255,255 // jmpq 43e1 <_sk_load_u16_be_hsw+0x31>
+ .byte 233,233,254,255,255 // jmpq 42e1 <_sk_load_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,220,254,255,255 // jmpq 43e1 <_sk_load_u16_be_hsw+0x31>
+ .byte 233,220,254,255,255 // jmpq 42e1 <_sk_load_u16_be_hsw+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,211,254,255,255 // jmpq 43e1 <_sk_load_u16_be_hsw+0x31>
+ .byte 233,211,254,255,255 // jmpq 42e1 <_sk_load_u16_be_hsw+0x31>
HIDDEN _sk_load_rgb_u16_be_hsw
.globl _sk_load_rgb_u16_be_hsw
@@ -15813,7 +15638,7 @@ _sk_load_rgb_u16_be_hsw:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,204,0,0,0 // jne 45ec <_sk_load_rgb_u16_be_hsw+0xde>
+ .byte 15,133,204,0,0,0 // jne 44ec <_sk_load_rgb_u16_be_hsw+0xde>
.byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0
.byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2
.byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1
@@ -15837,7 +15662,7 @@ _sk_load_rgb_u16_be_hsw:
.byte 197,241,235,192 // vpor %xmm0,%xmm1,%xmm0
.byte 196,226,125,51,192 // vpmovzxwd %xmm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,21,10,23,0,0 // vbroadcastss 0x170a(%rip),%ymm10 # 5ca4 <_sk_callback_hsw+0x4d0>
+ .byte 196,98,125,24,21,6,23,0,0 // vbroadcastss 0x1706(%rip),%ymm10 # 5ba0 <_sk_callback_hsw+0x4cc>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -15854,41 +15679,41 @@ _sk_load_rgb_u16_be_hsw:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,190,22,0,0 // vbroadcastss 0x16be(%rip),%ymm3 # 5ca8 <_sk_callback_hsw+0x4d4>
+ .byte 196,226,125,24,29,186,22,0,0 // vbroadcastss 0x16ba(%rip),%ymm3 # 5ba4 <_sk_callback_hsw+0x4d0>
.byte 255,224 // jmpq *%rax
.byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0
.byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,5 // jne 4605 <_sk_load_rgb_u16_be_hsw+0xf7>
- .byte 233,79,255,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 117,5 // jne 4505 <_sk_load_rgb_u16_be_hsw+0xf7>
+ .byte 233,79,255,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
.byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1
.byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,26 // jb 4634 <_sk_load_rgb_u16_be_hsw+0x126>
+ .byte 114,26 // jb 4534 <_sk_load_rgb_u16_be_hsw+0x126>
.byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1
.byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 117,10 // jne 4639 <_sk_load_rgb_u16_be_hsw+0x12b>
- .byte 233,32,255,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,27,255,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 117,10 // jne 4539 <_sk_load_rgb_u16_be_hsw+0x12b>
+ .byte 233,32,255,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,27,255,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
.byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1
.byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,26 // jb 4668 <_sk_load_rgb_u16_be_hsw+0x15a>
+ .byte 114,26 // jb 4568 <_sk_load_rgb_u16_be_hsw+0x15a>
.byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1
.byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 117,10 // jne 466d <_sk_load_rgb_u16_be_hsw+0x15f>
- .byte 233,236,254,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,231,254,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 117,10 // jne 456d <_sk_load_rgb_u16_be_hsw+0x15f>
+ .byte 233,236,254,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,231,254,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
.byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3
.byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,20 // jb 4696 <_sk_load_rgb_u16_be_hsw+0x188>
+ .byte 114,20 // jb 4596 <_sk_load_rgb_u16_be_hsw+0x188>
.byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3
.byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
- .byte 233,190,254,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
- .byte 233,185,254,255,255 // jmpq 4554 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,190,254,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
+ .byte 233,185,254,255,255 // jmpq 4454 <_sk_load_rgb_u16_be_hsw+0x46>
HIDDEN _sk_store_u16_be_hsw
.globl _sk_store_u16_be_hsw
@@ -15897,7 +15722,7 @@ _sk_store_u16_be_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
- .byte 196,98,125,24,5,251,21,0,0 // vbroadcastss 0x15fb(%rip),%ymm8 # 5cac <_sk_callback_hsw+0x4d8>
+ .byte 196,98,125,24,5,247,21,0,0 // vbroadcastss 0x15f7(%rip),%ymm8 # 5ba8 <_sk_callback_hsw+0x4d4>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10
@@ -15935,7 +15760,7 @@ _sk_store_u16_be_hsw:
.byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9
.byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,31 // jne 4795 <_sk_store_u16_be_hsw+0xfa>
+ .byte 117,31 // jne 4695 <_sk_store_u16_be_hsw+0xfa>
.byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2)
.byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2)
.byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2)
@@ -15944,22 +15769,22 @@ _sk_store_u16_be_hsw:
.byte 255,224 // jmpq *%rax
.byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 116,240 // je 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 114,227 // jb 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2)
- .byte 116,218 // je 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 116,218 // je 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,205 // jb 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 114,205 // jb 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2)
- .byte 116,196 // je 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 116,196 // je 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,183 // jb 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 114,183 // jb 4691 <_sk_store_u16_be_hsw+0xf6>
.byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2)
- .byte 235,174 // jmp 4791 <_sk_store_u16_be_hsw+0xf6>
+ .byte 235,174 // jmp 4691 <_sk_store_u16_be_hsw+0xf6>
HIDDEN _sk_load_f32_hsw
.globl _sk_load_f32_hsw
@@ -15967,10 +15792,10 @@ FUNCTION(_sk_load_f32_hsw)
_sk_load_f32_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 119,110 // ja 4859 <_sk_load_f32_hsw+0x76>
+ .byte 119,110 // ja 4759 <_sk_load_f32_hsw+0x76>
.byte 76,139,8 // mov (%rax),%r9
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
- .byte 76,141,29,135,0,0,0 // lea 0x87(%rip),%r11 # 4884 <_sk_load_f32_hsw+0xa1>
+ .byte 76,141,29,135,0,0,0 // lea 0x87(%rip),%r11 # 4784 <_sk_load_f32_hsw+0xa1>
.byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
.byte 76,1,216 // add %r11,%rax
.byte 255,224 // jmpq *%rax
@@ -16021,10 +15846,10 @@ FUNCTION(_sk_load_f32_dst_hsw)
_sk_load_f32_dst_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 119,110 // ja 491a <_sk_load_f32_dst_hsw+0x76>
+ .byte 119,110 // ja 481a <_sk_load_f32_dst_hsw+0x76>
.byte 76,139,8 // mov (%rax),%r9
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
- .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 4944 <_sk_load_f32_dst_hsw+0xa0>
+ .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 4844 <_sk_load_f32_dst_hsw+0xa0>
.byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
.byte 76,1,216 // add %r11,%rax
.byte 255,224 // jmpq *%rax
@@ -16083,7 +15908,7 @@ _sk_store_f32_hsw:
.byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8
.byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11
.byte 77,133,192 // test %r8,%r8
- .byte 117,55 // jne 49d1 <_sk_store_f32_hsw+0x6d>
+ .byte 117,55 // jne 48d1 <_sk_store_f32_hsw+0x6d>
.byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
.byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
.byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
@@ -16096,22 +15921,22 @@ _sk_store_f32_hsw:
.byte 255,224 // jmpq *%rax
.byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 49cd <_sk_store_f32_hsw+0x69>
+ .byte 116,240 // je 48cd <_sk_store_f32_hsw+0x69>
.byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 49cd <_sk_store_f32_hsw+0x69>
+ .byte 114,227 // jb 48cd <_sk_store_f32_hsw+0x69>
.byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4)
- .byte 116,218 // je 49cd <_sk_store_f32_hsw+0x69>
+ .byte 116,218 // je 48cd <_sk_store_f32_hsw+0x69>
.byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,205 // jb 49cd <_sk_store_f32_hsw+0x69>
+ .byte 114,205 // jb 48cd <_sk_store_f32_hsw+0x69>
.byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
- .byte 116,195 // je 49cd <_sk_store_f32_hsw+0x69>
+ .byte 116,195 // je 48cd <_sk_store_f32_hsw+0x69>
.byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,181 // jb 49cd <_sk_store_f32_hsw+0x69>
+ .byte 114,181 // jb 48cd <_sk_store_f32_hsw+0x69>
.byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
- .byte 235,171 // jmp 49cd <_sk_store_f32_hsw+0x69>
+ .byte 235,171 // jmp 48cd <_sk_store_f32_hsw+0x69>
HIDDEN _sk_clamp_x_hsw
.globl _sk_clamp_x_hsw
@@ -16184,7 +16009,7 @@ _sk_mirror_x_hsw:
.byte 196,65,124,92,218 // vsubps %ymm10,%ymm0,%ymm11
.byte 196,193,58,88,192 // vaddss %xmm8,%xmm8,%xmm0
.byte 196,98,125,24,192 // vbroadcastss %xmm0,%ymm8
- .byte 197,178,89,5,201,17,0,0 // vmulss 0x11c9(%rip),%xmm9,%xmm0 # 5cb0 <_sk_callback_hsw+0x4dc>
+ .byte 197,178,89,5,197,17,0,0 // vmulss 0x11c5(%rip),%xmm9,%xmm0 # 5bac <_sk_callback_hsw+0x4d8>
.byte 196,226,125,24,192 // vbroadcastss %xmm0,%ymm0
.byte 197,164,89,192 // vmulps %ymm0,%ymm11,%ymm0
.byte 196,227,125,8,192,1 // vroundps $0x1,%ymm0,%ymm0
@@ -16210,7 +16035,7 @@ _sk_mirror_y_hsw:
.byte 196,65,116,92,218 // vsubps %ymm10,%ymm1,%ymm11
.byte 196,193,58,88,200 // vaddss %xmm8,%xmm8,%xmm1
.byte 196,98,125,24,193 // vbroadcastss %xmm1,%ymm8
- .byte 197,178,89,13,109,17,0,0 // vmulss 0x116d(%rip),%xmm9,%xmm1 # 5cb4 <_sk_callback_hsw+0x4e0>
+ .byte 197,178,89,13,105,17,0,0 // vmulss 0x1169(%rip),%xmm9,%xmm1 # 5bb0 <_sk_callback_hsw+0x4dc>
.byte 196,226,125,24,201 // vbroadcastss %xmm1,%ymm1
.byte 197,164,89,201 // vmulps %ymm1,%ymm11,%ymm1
.byte 196,227,125,8,201,1 // vroundps $0x1,%ymm1,%ymm1
@@ -16231,7 +16056,7 @@ FUNCTION(_sk_clamp_x_1_hsw)
_sk_clamp_x_1_hsw:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,38,17,0,0 // vbroadcastss 0x1126(%rip),%ymm8 # 5cb8 <_sk_callback_hsw+0x4e4>
+ .byte 196,98,125,24,5,34,17,0,0 // vbroadcastss 0x1122(%rip),%ymm8 # 5bb4 <_sk_callback_hsw+0x4e0>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -16249,9 +16074,9 @@ HIDDEN _sk_mirror_x_1_hsw
.globl _sk_mirror_x_1_hsw
FUNCTION(_sk_mirror_x_1_hsw)
_sk_mirror_x_1_hsw:
- .byte 196,98,125,24,5,9,17,0,0 // vbroadcastss 0x1109(%rip),%ymm8 # 5cbc <_sk_callback_hsw+0x4e8>
+ .byte 196,98,125,24,5,5,17,0,0 // vbroadcastss 0x1105(%rip),%ymm8 # 5bb8 <_sk_callback_hsw+0x4e4>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,13,255,16,0,0 // vbroadcastss 0x10ff(%rip),%ymm9 # 5cc0 <_sk_callback_hsw+0x4ec>
+ .byte 196,98,125,24,13,251,16,0,0 // vbroadcastss 0x10fb(%rip),%ymm9 # 5bbc <_sk_callback_hsw+0x4e8>
.byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9
.byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9
.byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9
@@ -16267,11 +16092,11 @@ HIDDEN _sk_luminance_to_alpha_hsw
.globl _sk_luminance_to_alpha_hsw
FUNCTION(_sk_luminance_to_alpha_hsw)
_sk_luminance_to_alpha_hsw:
- .byte 196,226,125,24,29,207,16,0,0 // vbroadcastss 0x10cf(%rip),%ymm3 # 5cc4 <_sk_callback_hsw+0x4f0>
- .byte 196,98,125,24,5,202,16,0,0 // vbroadcastss 0x10ca(%rip),%ymm8 # 5cc8 <_sk_callback_hsw+0x4f4>
+ .byte 196,226,125,24,29,203,16,0,0 // vbroadcastss 0x10cb(%rip),%ymm3 # 5bc0 <_sk_callback_hsw+0x4ec>
+ .byte 196,98,125,24,5,198,16,0,0 // vbroadcastss 0x10c6(%rip),%ymm8 # 5bc4 <_sk_callback_hsw+0x4f0>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 196,226,125,184,203 // vfmadd231ps %ymm3,%ymm0,%ymm1
- .byte 196,226,125,24,29,187,16,0,0 // vbroadcastss 0x10bb(%rip),%ymm3 # 5ccc <_sk_callback_hsw+0x4f8>
+ .byte 196,226,125,24,29,183,16,0,0 // vbroadcastss 0x10b7(%rip),%ymm3 # 5bc8 <_sk_callback_hsw+0x4f4>
.byte 196,226,109,168,217 // vfmadd213ps %ymm1,%ymm2,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -16471,9 +16296,9 @@ _sk_evenly_spaced_gradient_hsw:
.byte 76,139,72,8 // mov 0x8(%rax),%r9
.byte 77,137,211 // mov %r10,%r11
.byte 73,255,203 // dec %r11
- .byte 120,7 // js 4f0a <_sk_evenly_spaced_gradient_hsw+0x19>
+ .byte 120,7 // js 4e0a <_sk_evenly_spaced_gradient_hsw+0x19>
.byte 196,193,242,42,203 // vcvtsi2ss %r11,%xmm1,%xmm1
- .byte 235,22 // jmp 4f20 <_sk_evenly_spaced_gradient_hsw+0x2f>
+ .byte 235,22 // jmp 4e20 <_sk_evenly_spaced_gradient_hsw+0x2f>
.byte 76,137,219 // mov %r11,%rbx
.byte 72,209,235 // shr %rbx
.byte 65,131,227,1 // and $0x1,%r11d
@@ -16484,7 +16309,7 @@ _sk_evenly_spaced_gradient_hsw:
.byte 197,244,89,200 // vmulps %ymm0,%ymm1,%ymm1
.byte 197,126,91,217 // vcvttps2dq %ymm1,%ymm11
.byte 73,131,250,8 // cmp $0x8,%r10
- .byte 119,70 // ja 4f79 <_sk_evenly_spaced_gradient_hsw+0x88>
+ .byte 119,70 // ja 4e79 <_sk_evenly_spaced_gradient_hsw+0x88>
.byte 196,66,37,22,1 // vpermps (%r9),%ymm11,%ymm8
.byte 72,139,88,40 // mov 0x28(%rax),%rbx
.byte 196,98,37,22,11 // vpermps (%rbx),%ymm11,%ymm9
@@ -16500,7 +16325,7 @@ _sk_evenly_spaced_gradient_hsw:
.byte 196,226,37,22,27 // vpermps (%rbx),%ymm11,%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,98,37,22,40 // vpermps (%rax),%ymm11,%ymm13
- .byte 235,110 // jmp 4fe7 <_sk_evenly_spaced_gradient_hsw+0xf6>
+ .byte 235,110 // jmp 4ee7 <_sk_evenly_spaced_gradient_hsw+0xf6>
.byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 196,2,117,146,4,153 // vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8
@@ -16537,14 +16362,14 @@ HIDDEN _sk_gauss_a_to_rgba_hsw
.globl _sk_gauss_a_to_rgba_hsw
FUNCTION(_sk_gauss_a_to_rgba_hsw)
_sk_gauss_a_to_rgba_hsw:
- .byte 196,226,125,24,5,195,12,0,0 // vbroadcastss 0xcc3(%rip),%ymm0 # 5cd0 <_sk_callback_hsw+0x4fc>
- .byte 196,226,125,24,13,190,12,0,0 // vbroadcastss 0xcbe(%rip),%ymm1 # 5cd4 <_sk_callback_hsw+0x500>
+ .byte 196,226,125,24,5,191,12,0,0 // vbroadcastss 0xcbf(%rip),%ymm0 # 5bcc <_sk_callback_hsw+0x4f8>
+ .byte 196,226,125,24,13,186,12,0,0 // vbroadcastss 0xcba(%rip),%ymm1 # 5bd0 <_sk_callback_hsw+0x4fc>
.byte 196,226,101,168,200 // vfmadd213ps %ymm0,%ymm3,%ymm1
- .byte 196,226,125,24,5,180,12,0,0 // vbroadcastss 0xcb4(%rip),%ymm0 # 5cd8 <_sk_callback_hsw+0x504>
+ .byte 196,226,125,24,5,176,12,0,0 // vbroadcastss 0xcb0(%rip),%ymm0 # 5bd4 <_sk_callback_hsw+0x500>
.byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0
- .byte 196,226,125,24,13,170,12,0,0 // vbroadcastss 0xcaa(%rip),%ymm1 # 5cdc <_sk_callback_hsw+0x508>
+ .byte 196,226,125,24,13,166,12,0,0 // vbroadcastss 0xca6(%rip),%ymm1 # 5bd8 <_sk_callback_hsw+0x504>
.byte 196,226,101,184,200 // vfmadd231ps %ymm0,%ymm3,%ymm1
- .byte 196,226,125,24,5,160,12,0,0 // vbroadcastss 0xca0(%rip),%ymm0 # 5ce0 <_sk_callback_hsw+0x50c>
+ .byte 196,226,125,24,5,156,12,0,0 // vbroadcastss 0xc9c(%rip),%ymm0 # 5bdc <_sk_callback_hsw+0x508>
.byte 196,226,101,184,193 // vfmadd231ps %ymm1,%ymm3,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
@@ -16559,11 +16384,11 @@ _sk_gradient_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 73,131,249,1 // cmp $0x1,%r9
- .byte 15,134,180,0,0,0 // jbe 5118 <_sk_gradient_hsw+0xc3>
+ .byte 15,134,180,0,0,0 // jbe 5018 <_sk_gradient_hsw+0xc3>
.byte 76,139,80,72 // mov 0x48(%rax),%r10
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 65,187,1,0,0,0 // mov $0x1,%r11d
- .byte 196,226,125,24,21,105,12,0,0 // vbroadcastss 0xc69(%rip),%ymm2 # 5ce4 <_sk_callback_hsw+0x510>
+ .byte 196,226,125,24,21,101,12,0,0 // vbroadcastss 0xc65(%rip),%ymm2 # 5be0 <_sk_callback_hsw+0x50c>
.byte 196,65,53,239,201 // vpxor %ymm9,%ymm9,%ymm9
.byte 196,130,125,24,28,154 // vbroadcastss (%r10,%r11,4),%ymm3
.byte 197,228,194,216,2 // vcmpleps %ymm0,%ymm3,%ymm3
@@ -16571,10 +16396,10 @@ _sk_gradient_hsw:
.byte 196,65,101,254,201 // vpaddd %ymm9,%ymm3,%ymm9
.byte 73,255,195 // inc %r11
.byte 77,57,217 // cmp %r11,%r9
- .byte 117,226 // jne 5080 <_sk_gradient_hsw+0x2b>
+ .byte 117,226 // jne 4f80 <_sk_gradient_hsw+0x2b>
.byte 76,139,80,8 // mov 0x8(%rax),%r10
.byte 73,131,249,8 // cmp $0x8,%r9
- .byte 118,121 // jbe 5121 <_sk_gradient_hsw+0xcc>
+ .byte 118,121 // jbe 5021 <_sk_gradient_hsw+0xcc>
.byte 196,65,13,118,246 // vpcmpeqd %ymm14,%ymm14,%ymm14
.byte 197,245,118,201 // vpcmpeqd %ymm1,%ymm1,%ymm1
.byte 196,2,117,146,4,138 // vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8
@@ -16598,7 +16423,7 @@ _sk_gradient_hsw:
.byte 196,130,21,146,28,137 // vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3
.byte 72,139,64,64 // mov 0x40(%rax),%rax
.byte 196,34,13,146,44,136 // vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13
- .byte 235,77 // jmp 5165 <_sk_gradient_hsw+0x110>
+ .byte 235,77 // jmp 5065 <_sk_gradient_hsw+0x110>
.byte 76,139,80,8 // mov 0x8(%rax),%r10
.byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9
.byte 196,66,53,22,2 // vpermps (%r10),%ymm9,%ymm8
@@ -16658,24 +16483,24 @@ _sk_xy_to_unit_angle_hsw:
.byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12
.byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11
.byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12
- .byte 196,98,125,24,45,232,10,0,0 // vbroadcastss 0xae8(%rip),%ymm13 # 5ce8 <_sk_callback_hsw+0x514>
- .byte 196,98,125,24,53,227,10,0,0 // vbroadcastss 0xae3(%rip),%ymm14 # 5cec <_sk_callback_hsw+0x518>
+ .byte 196,98,125,24,45,228,10,0,0 // vbroadcastss 0xae4(%rip),%ymm13 # 5be4 <_sk_callback_hsw+0x510>
+ .byte 196,98,125,24,53,223,10,0,0 // vbroadcastss 0xadf(%rip),%ymm14 # 5be8 <_sk_callback_hsw+0x514>
.byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14
- .byte 196,98,125,24,45,217,10,0,0 // vbroadcastss 0xad9(%rip),%ymm13 # 5cf0 <_sk_callback_hsw+0x51c>
+ .byte 196,98,125,24,45,213,10,0,0 // vbroadcastss 0xad5(%rip),%ymm13 # 5bec <_sk_callback_hsw+0x518>
.byte 196,66,29,184,238 // vfmadd231ps %ymm14,%ymm12,%ymm13
- .byte 196,98,125,24,53,207,10,0,0 // vbroadcastss 0xacf(%rip),%ymm14 # 5cf4 <_sk_callback_hsw+0x520>
+ .byte 196,98,125,24,53,203,10,0,0 // vbroadcastss 0xacb(%rip),%ymm14 # 5bf0 <_sk_callback_hsw+0x51c>
.byte 196,66,29,184,245 // vfmadd231ps %ymm13,%ymm12,%ymm14
.byte 196,65,36,89,222 // vmulps %ymm14,%ymm11,%ymm11
.byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,186,10,0,0 // vbroadcastss 0xaba(%rip),%ymm10 # 5cf8 <_sk_callback_hsw+0x524>
+ .byte 196,98,125,24,21,182,10,0,0 // vbroadcastss 0xab6(%rip),%ymm10 # 5bf4 <_sk_callback_hsw+0x520>
.byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10
.byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9
.byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,21,164,10,0,0 // vbroadcastss 0xaa4(%rip),%ymm10 # 5cfc <_sk_callback_hsw+0x528>
+ .byte 196,98,125,24,21,160,10,0,0 // vbroadcastss 0xaa0(%rip),%ymm10 # 5bf8 <_sk_callback_hsw+0x524>
.byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9
- .byte 196,98,125,24,21,142,10,0,0 // vbroadcastss 0xa8e(%rip),%ymm10 # 5d00 <_sk_callback_hsw+0x52c>
+ .byte 196,98,125,24,21,138,10,0,0 // vbroadcastss 0xa8a(%rip),%ymm10 # 5bfc <_sk_callback_hsw+0x528>
.byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10
.byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0
.byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9
@@ -16703,23 +16528,23 @@ _sk_xy_to_2pt_conical_quadratic_max_hsw:
.byte 197,50,89,80,44 // vmulss 0x2c(%rax),%xmm9,%xmm10
.byte 196,66,125,24,210 // vbroadcastss %xmm10,%ymm10
.byte 197,44,88,208 // vaddps %ymm0,%ymm10,%ymm10
- .byte 196,98,125,24,29,66,10,0,0 // vbroadcastss 0xa42(%rip),%ymm11 # 5d04 <_sk_callback_hsw+0x530>
+ .byte 196,98,125,24,29,62,10,0,0 // vbroadcastss 0xa3e(%rip),%ymm11 # 5c00 <_sk_callback_hsw+0x52c>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
.byte 197,116,89,217 // vmulps %ymm1,%ymm1,%ymm11
.byte 196,98,125,184,216 // vfmadd231ps %ymm0,%ymm0,%ymm11
.byte 196,193,50,89,193 // vmulss %xmm9,%xmm9,%xmm0
.byte 196,226,125,24,192 // vbroadcastss %xmm0,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,13,33,10,0,0 // vbroadcastss 0xa21(%rip),%ymm9 # 5d08 <_sk_callback_hsw+0x534>
+ .byte 196,98,125,24,13,29,10,0,0 // vbroadcastss 0xa1d(%rip),%ymm9 # 5c04 <_sk_callback_hsw+0x530>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,194,45,184,194 // vfmadd231ps %ymm10,%ymm10,%ymm0
.byte 197,252,81,192 // vsqrtps %ymm0,%ymm0
.byte 196,98,125,24,64,36 // vbroadcastss 0x24(%rax),%ymm8
- .byte 196,98,125,24,13,4,10,0,0 // vbroadcastss 0xa04(%rip),%ymm9 # 5d0c <_sk_callback_hsw+0x538>
+ .byte 196,98,125,24,13,0,10,0,0 // vbroadcastss 0xa00(%rip),%ymm9 # 5c08 <_sk_callback_hsw+0x534>
.byte 196,65,44,87,201 // vxorps %ymm9,%ymm10,%ymm9
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,245,9,0,0 // vbroadcastss 0x9f5(%rip),%ymm11 # 5d10 <_sk_callback_hsw+0x53c>
+ .byte 196,98,125,24,29,241,9,0,0 // vbroadcastss 0x9f1(%rip),%ymm11 # 5c0c <_sk_callback_hsw+0x538>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 196,65,44,89,208 // vmulps %ymm8,%ymm10,%ymm10
.byte 197,180,92,192 // vsubps %ymm0,%ymm9,%ymm0
@@ -16738,23 +16563,23 @@ _sk_xy_to_2pt_conical_quadratic_min_hsw:
.byte 197,50,89,80,44 // vmulss 0x2c(%rax),%xmm9,%xmm10
.byte 196,66,125,24,210 // vbroadcastss %xmm10,%ymm10
.byte 197,44,88,208 // vaddps %ymm0,%ymm10,%ymm10
- .byte 196,98,125,24,29,186,9,0,0 // vbroadcastss 0x9ba(%rip),%ymm11 # 5d14 <_sk_callback_hsw+0x540>
+ .byte 196,98,125,24,29,182,9,0,0 // vbroadcastss 0x9b6(%rip),%ymm11 # 5c10 <_sk_callback_hsw+0x53c>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
.byte 197,116,89,217 // vmulps %ymm1,%ymm1,%ymm11
.byte 196,98,125,184,216 // vfmadd231ps %ymm0,%ymm0,%ymm11
.byte 196,193,50,89,193 // vmulss %xmm9,%xmm9,%xmm0
.byte 196,226,125,24,192 // vbroadcastss %xmm0,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,13,153,9,0,0 // vbroadcastss 0x999(%rip),%ymm9 # 5d18 <_sk_callback_hsw+0x544>
+ .byte 196,98,125,24,13,149,9,0,0 // vbroadcastss 0x995(%rip),%ymm9 # 5c14 <_sk_callback_hsw+0x540>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,194,45,184,194 // vfmadd231ps %ymm10,%ymm10,%ymm0
.byte 197,252,81,192 // vsqrtps %ymm0,%ymm0
.byte 196,98,125,24,64,36 // vbroadcastss 0x24(%rax),%ymm8
- .byte 196,98,125,24,13,124,9,0,0 // vbroadcastss 0x97c(%rip),%ymm9 # 5d1c <_sk_callback_hsw+0x548>
+ .byte 196,98,125,24,13,120,9,0,0 // vbroadcastss 0x978(%rip),%ymm9 # 5c18 <_sk_callback_hsw+0x544>
.byte 196,65,44,87,201 // vxorps %ymm9,%ymm10,%ymm9
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,109,9,0,0 // vbroadcastss 0x96d(%rip),%ymm11 # 5d20 <_sk_callback_hsw+0x54c>
+ .byte 196,98,125,24,29,105,9,0,0 // vbroadcastss 0x969(%rip),%ymm11 # 5c1c <_sk_callback_hsw+0x548>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 196,65,44,89,208 // vmulps %ymm8,%ymm10,%ymm10
.byte 197,180,92,192 // vsubps %ymm0,%ymm9,%ymm0
@@ -16772,14 +16597,14 @@ _sk_xy_to_2pt_conical_linear_hsw:
.byte 197,58,89,72,44 // vmulss 0x2c(%rax),%xmm8,%xmm9
.byte 196,66,125,24,201 // vbroadcastss %xmm9,%ymm9
.byte 197,52,88,200 // vaddps %ymm0,%ymm9,%ymm9
- .byte 196,98,125,24,21,56,9,0,0 // vbroadcastss 0x938(%rip),%ymm10 # 5d24 <_sk_callback_hsw+0x550>
+ .byte 196,98,125,24,21,52,9,0,0 // vbroadcastss 0x934(%rip),%ymm10 # 5c20 <_sk_callback_hsw+0x54c>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
.byte 197,116,89,209 // vmulps %ymm1,%ymm1,%ymm10
.byte 196,98,125,184,208 // vfmadd231ps %ymm0,%ymm0,%ymm10
.byte 196,193,58,89,192 // vmulss %xmm8,%xmm8,%xmm0
.byte 196,226,125,24,192 // vbroadcastss %xmm0,%ymm0
.byte 197,172,92,192 // vsubps %ymm0,%ymm10,%ymm0
- .byte 196,98,125,24,5,23,9,0,0 // vbroadcastss 0x917(%rip),%ymm8 # 5d28 <_sk_callback_hsw+0x554>
+ .byte 196,98,125,24,5,19,9,0,0 // vbroadcastss 0x913(%rip),%ymm8 # 5c24 <_sk_callback_hsw+0x550>
.byte 196,193,124,87,192 // vxorps %ymm8,%ymm0,%ymm0
.byte 196,193,124,94,193 // vdivps %ymm9,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -16819,7 +16644,7 @@ HIDDEN _sk_save_xy_hsw
FUNCTION(_sk_save_xy_hsw)
_sk_save_xy_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,183,8,0,0 // vbroadcastss 0x8b7(%rip),%ymm8 # 5d2c <_sk_callback_hsw+0x558>
+ .byte 196,98,125,24,5,179,8,0,0 // vbroadcastss 0x8b3(%rip),%ymm8 # 5c28 <_sk_callback_hsw+0x554>
.byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9
.byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
@@ -16853,9 +16678,9 @@ HIDDEN _sk_bilinear_nx_hsw
FUNCTION(_sk_bilinear_nx_hsw)
_sk_bilinear_nx_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,75,8,0,0 // vbroadcastss 0x84b(%rip),%ymm0 # 5d30 <_sk_callback_hsw+0x55c>
+ .byte 196,226,125,24,5,71,8,0,0 // vbroadcastss 0x847(%rip),%ymm0 # 5c2c <_sk_callback_hsw+0x558>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,66,8,0,0 // vbroadcastss 0x842(%rip),%ymm8 # 5d34 <_sk_callback_hsw+0x560>
+ .byte 196,98,125,24,5,62,8,0,0 // vbroadcastss 0x83e(%rip),%ymm8 # 5c30 <_sk_callback_hsw+0x55c>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -16866,7 +16691,7 @@ HIDDEN _sk_bilinear_px_hsw
FUNCTION(_sk_bilinear_px_hsw)
_sk_bilinear_px_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,42,8,0,0 // vbroadcastss 0x82a(%rip),%ymm0 # 5d38 <_sk_callback_hsw+0x564>
+ .byte 196,226,125,24,5,38,8,0,0 // vbroadcastss 0x826(%rip),%ymm0 # 5c34 <_sk_callback_hsw+0x560>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -16878,9 +16703,9 @@ HIDDEN _sk_bilinear_ny_hsw
FUNCTION(_sk_bilinear_ny_hsw)
_sk_bilinear_ny_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,14,8,0,0 // vbroadcastss 0x80e(%rip),%ymm1 # 5d3c <_sk_callback_hsw+0x568>
+ .byte 196,226,125,24,13,10,8,0,0 // vbroadcastss 0x80a(%rip),%ymm1 # 5c38 <_sk_callback_hsw+0x564>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,4,8,0,0 // vbroadcastss 0x804(%rip),%ymm8 # 5d40 <_sk_callback_hsw+0x56c>
+ .byte 196,98,125,24,5,0,8,0,0 // vbroadcastss 0x800(%rip),%ymm8 # 5c3c <_sk_callback_hsw+0x568>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -16891,7 +16716,7 @@ HIDDEN _sk_bilinear_py_hsw
FUNCTION(_sk_bilinear_py_hsw)
_sk_bilinear_py_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,236,7,0,0 // vbroadcastss 0x7ec(%rip),%ymm1 # 5d44 <_sk_callback_hsw+0x570>
+ .byte 196,226,125,24,13,232,7,0,0 // vbroadcastss 0x7e8(%rip),%ymm1 # 5c40 <_sk_callback_hsw+0x56c>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -16903,13 +16728,13 @@ HIDDEN _sk_bicubic_n3x_hsw
FUNCTION(_sk_bicubic_n3x_hsw)
_sk_bicubic_n3x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,207,7,0,0 // vbroadcastss 0x7cf(%rip),%ymm0 # 5d48 <_sk_callback_hsw+0x574>
+ .byte 196,226,125,24,5,203,7,0,0 // vbroadcastss 0x7cb(%rip),%ymm0 # 5c44 <_sk_callback_hsw+0x570>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,198,7,0,0 // vbroadcastss 0x7c6(%rip),%ymm8 # 5d4c <_sk_callback_hsw+0x578>
+ .byte 196,98,125,24,5,194,7,0,0 // vbroadcastss 0x7c2(%rip),%ymm8 # 5c48 <_sk_callback_hsw+0x574>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,183,7,0,0 // vbroadcastss 0x7b7(%rip),%ymm10 # 5d50 <_sk_callback_hsw+0x57c>
- .byte 196,98,125,24,29,178,7,0,0 // vbroadcastss 0x7b2(%rip),%ymm11 # 5d54 <_sk_callback_hsw+0x580>
+ .byte 196,98,125,24,21,179,7,0,0 // vbroadcastss 0x7b3(%rip),%ymm10 # 5c4c <_sk_callback_hsw+0x578>
+ .byte 196,98,125,24,29,174,7,0,0 // vbroadcastss 0x7ae(%rip),%ymm11 # 5c50 <_sk_callback_hsw+0x57c>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -16921,16 +16746,16 @@ HIDDEN _sk_bicubic_n1x_hsw
FUNCTION(_sk_bicubic_n1x_hsw)
_sk_bicubic_n1x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,149,7,0,0 // vbroadcastss 0x795(%rip),%ymm0 # 5d58 <_sk_callback_hsw+0x584>
+ .byte 196,226,125,24,5,145,7,0,0 // vbroadcastss 0x791(%rip),%ymm0 # 5c54 <_sk_callback_hsw+0x580>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,140,7,0,0 // vbroadcastss 0x78c(%rip),%ymm8 # 5d5c <_sk_callback_hsw+0x588>
+ .byte 196,98,125,24,5,136,7,0,0 // vbroadcastss 0x788(%rip),%ymm8 # 5c58 <_sk_callback_hsw+0x584>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,130,7,0,0 // vbroadcastss 0x782(%rip),%ymm9 # 5d60 <_sk_callback_hsw+0x58c>
- .byte 196,98,125,24,21,125,7,0,0 // vbroadcastss 0x77d(%rip),%ymm10 # 5d64 <_sk_callback_hsw+0x590>
+ .byte 196,98,125,24,13,126,7,0,0 // vbroadcastss 0x77e(%rip),%ymm9 # 5c5c <_sk_callback_hsw+0x588>
+ .byte 196,98,125,24,21,121,7,0,0 // vbroadcastss 0x779(%rip),%ymm10 # 5c60 <_sk_callback_hsw+0x58c>
.byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,13,115,7,0,0 // vbroadcastss 0x773(%rip),%ymm9 # 5d68 <_sk_callback_hsw+0x594>
+ .byte 196,98,125,24,13,111,7,0,0 // vbroadcastss 0x76f(%rip),%ymm9 # 5c64 <_sk_callback_hsw+0x590>
.byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9
- .byte 196,98,125,24,21,105,7,0,0 // vbroadcastss 0x769(%rip),%ymm10 # 5d6c <_sk_callback_hsw+0x598>
+ .byte 196,98,125,24,21,101,7,0,0 // vbroadcastss 0x765(%rip),%ymm10 # 5c68 <_sk_callback_hsw+0x594>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
.byte 197,124,17,144,128,0,0,0 // vmovups %ymm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -16941,14 +16766,14 @@ HIDDEN _sk_bicubic_p1x_hsw
FUNCTION(_sk_bicubic_p1x_hsw)
_sk_bicubic_p1x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,81,7,0,0 // vbroadcastss 0x751(%rip),%ymm8 # 5d70 <_sk_callback_hsw+0x59c>
+ .byte 196,98,125,24,5,77,7,0,0 // vbroadcastss 0x74d(%rip),%ymm8 # 5c6c <_sk_callback_hsw+0x598>
.byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0
.byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9
- .byte 196,98,125,24,21,67,7,0,0 // vbroadcastss 0x743(%rip),%ymm10 # 5d74 <_sk_callback_hsw+0x5a0>
- .byte 196,98,125,24,29,62,7,0,0 // vbroadcastss 0x73e(%rip),%ymm11 # 5d78 <_sk_callback_hsw+0x5a4>
+ .byte 196,98,125,24,21,63,7,0,0 // vbroadcastss 0x73f(%rip),%ymm10 # 5c70 <_sk_callback_hsw+0x59c>
+ .byte 196,98,125,24,29,58,7,0,0 // vbroadcastss 0x73a(%rip),%ymm11 # 5c74 <_sk_callback_hsw+0x5a0>
.byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11
.byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11
- .byte 196,98,125,24,5,47,7,0,0 // vbroadcastss 0x72f(%rip),%ymm8 # 5d7c <_sk_callback_hsw+0x5a8>
+ .byte 196,98,125,24,5,43,7,0,0 // vbroadcastss 0x72b(%rip),%ymm8 # 5c78 <_sk_callback_hsw+0x5a4>
.byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -16959,12 +16784,12 @@ HIDDEN _sk_bicubic_p3x_hsw
FUNCTION(_sk_bicubic_p3x_hsw)
_sk_bicubic_p3x_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,23,7,0,0 // vbroadcastss 0x717(%rip),%ymm0 # 5d80 <_sk_callback_hsw+0x5ac>
+ .byte 196,226,125,24,5,19,7,0,0 // vbroadcastss 0x713(%rip),%ymm0 # 5c7c <_sk_callback_hsw+0x5a8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,4,7,0,0 // vbroadcastss 0x704(%rip),%ymm10 # 5d84 <_sk_callback_hsw+0x5b0>
- .byte 196,98,125,24,29,255,6,0,0 // vbroadcastss 0x6ff(%rip),%ymm11 # 5d88 <_sk_callback_hsw+0x5b4>
+ .byte 196,98,125,24,21,0,7,0,0 // vbroadcastss 0x700(%rip),%ymm10 # 5c80 <_sk_callback_hsw+0x5ac>
+ .byte 196,98,125,24,29,251,6,0,0 // vbroadcastss 0x6fb(%rip),%ymm11 # 5c84 <_sk_callback_hsw+0x5b0>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -16976,13 +16801,13 @@ HIDDEN _sk_bicubic_n3y_hsw
FUNCTION(_sk_bicubic_n3y_hsw)
_sk_bicubic_n3y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,226,6,0,0 // vbroadcastss 0x6e2(%rip),%ymm1 # 5d8c <_sk_callback_hsw+0x5b8>
+ .byte 196,226,125,24,13,222,6,0,0 // vbroadcastss 0x6de(%rip),%ymm1 # 5c88 <_sk_callback_hsw+0x5b4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,216,6,0,0 // vbroadcastss 0x6d8(%rip),%ymm8 # 5d90 <_sk_callback_hsw+0x5bc>
+ .byte 196,98,125,24,5,212,6,0,0 // vbroadcastss 0x6d4(%rip),%ymm8 # 5c8c <_sk_callback_hsw+0x5b8>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,201,6,0,0 // vbroadcastss 0x6c9(%rip),%ymm10 # 5d94 <_sk_callback_hsw+0x5c0>
- .byte 196,98,125,24,29,196,6,0,0 // vbroadcastss 0x6c4(%rip),%ymm11 # 5d98 <_sk_callback_hsw+0x5c4>
+ .byte 196,98,125,24,21,197,6,0,0 // vbroadcastss 0x6c5(%rip),%ymm10 # 5c90 <_sk_callback_hsw+0x5bc>
+ .byte 196,98,125,24,29,192,6,0,0 // vbroadcastss 0x6c0(%rip),%ymm11 # 5c94 <_sk_callback_hsw+0x5c0>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,36,89,193 // vmulps %ymm9,%ymm11,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -16994,16 +16819,16 @@ HIDDEN _sk_bicubic_n1y_hsw
FUNCTION(_sk_bicubic_n1y_hsw)
_sk_bicubic_n1y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,167,6,0,0 // vbroadcastss 0x6a7(%rip),%ymm1 # 5d9c <_sk_callback_hsw+0x5c8>
+ .byte 196,226,125,24,13,163,6,0,0 // vbroadcastss 0x6a3(%rip),%ymm1 # 5c98 <_sk_callback_hsw+0x5c4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,157,6,0,0 // vbroadcastss 0x69d(%rip),%ymm8 # 5da0 <_sk_callback_hsw+0x5cc>
+ .byte 196,98,125,24,5,153,6,0,0 // vbroadcastss 0x699(%rip),%ymm8 # 5c9c <_sk_callback_hsw+0x5c8>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,147,6,0,0 // vbroadcastss 0x693(%rip),%ymm9 # 5da4 <_sk_callback_hsw+0x5d0>
- .byte 196,98,125,24,21,142,6,0,0 // vbroadcastss 0x68e(%rip),%ymm10 # 5da8 <_sk_callback_hsw+0x5d4>
+ .byte 196,98,125,24,13,143,6,0,0 // vbroadcastss 0x68f(%rip),%ymm9 # 5ca0 <_sk_callback_hsw+0x5cc>
+ .byte 196,98,125,24,21,138,6,0,0 // vbroadcastss 0x68a(%rip),%ymm10 # 5ca4 <_sk_callback_hsw+0x5d0>
.byte 196,66,61,168,209 // vfmadd213ps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,13,132,6,0,0 // vbroadcastss 0x684(%rip),%ymm9 # 5dac <_sk_callback_hsw+0x5d8>
+ .byte 196,98,125,24,13,128,6,0,0 // vbroadcastss 0x680(%rip),%ymm9 # 5ca8 <_sk_callback_hsw+0x5d4>
.byte 196,66,61,184,202 // vfmadd231ps %ymm10,%ymm8,%ymm9
- .byte 196,98,125,24,21,122,6,0,0 // vbroadcastss 0x67a(%rip),%ymm10 # 5db0 <_sk_callback_hsw+0x5dc>
+ .byte 196,98,125,24,21,118,6,0,0 // vbroadcastss 0x676(%rip),%ymm10 # 5cac <_sk_callback_hsw+0x5d8>
.byte 196,66,61,184,209 // vfmadd231ps %ymm9,%ymm8,%ymm10
.byte 197,124,17,144,160,0,0,0 // vmovups %ymm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -17014,14 +16839,14 @@ HIDDEN _sk_bicubic_p1y_hsw
FUNCTION(_sk_bicubic_p1y_hsw)
_sk_bicubic_p1y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,98,6,0,0 // vbroadcastss 0x662(%rip),%ymm8 # 5db4 <_sk_callback_hsw+0x5e0>
+ .byte 196,98,125,24,5,94,6,0,0 // vbroadcastss 0x65e(%rip),%ymm8 # 5cb0 <_sk_callback_hsw+0x5dc>
.byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1
.byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9
- .byte 196,98,125,24,21,83,6,0,0 // vbroadcastss 0x653(%rip),%ymm10 # 5db8 <_sk_callback_hsw+0x5e4>
- .byte 196,98,125,24,29,78,6,0,0 // vbroadcastss 0x64e(%rip),%ymm11 # 5dbc <_sk_callback_hsw+0x5e8>
+ .byte 196,98,125,24,21,79,6,0,0 // vbroadcastss 0x64f(%rip),%ymm10 # 5cb4 <_sk_callback_hsw+0x5e0>
+ .byte 196,98,125,24,29,74,6,0,0 // vbroadcastss 0x64a(%rip),%ymm11 # 5cb8 <_sk_callback_hsw+0x5e4>
.byte 196,66,53,168,218 // vfmadd213ps %ymm10,%ymm9,%ymm11
.byte 196,66,53,168,216 // vfmadd213ps %ymm8,%ymm9,%ymm11
- .byte 196,98,125,24,5,63,6,0,0 // vbroadcastss 0x63f(%rip),%ymm8 # 5dc0 <_sk_callback_hsw+0x5ec>
+ .byte 196,98,125,24,5,59,6,0,0 // vbroadcastss 0x63b(%rip),%ymm8 # 5cbc <_sk_callback_hsw+0x5e8>
.byte 196,66,53,184,195 // vfmadd231ps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -17032,12 +16857,12 @@ HIDDEN _sk_bicubic_p3y_hsw
FUNCTION(_sk_bicubic_p3y_hsw)
_sk_bicubic_p3y_hsw:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,39,6,0,0 // vbroadcastss 0x627(%rip),%ymm1 # 5dc4 <_sk_callback_hsw+0x5f0>
+ .byte 196,226,125,24,13,35,6,0,0 // vbroadcastss 0x623(%rip),%ymm1 # 5cc0 <_sk_callback_hsw+0x5ec>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,19,6,0,0 // vbroadcastss 0x613(%rip),%ymm10 # 5dc8 <_sk_callback_hsw+0x5f4>
- .byte 196,98,125,24,29,14,6,0,0 // vbroadcastss 0x60e(%rip),%ymm11 # 5dcc <_sk_callback_hsw+0x5f8>
+ .byte 196,98,125,24,21,15,6,0,0 // vbroadcastss 0x60f(%rip),%ymm10 # 5cc4 <_sk_callback_hsw+0x5f0>
+ .byte 196,98,125,24,29,10,6,0,0 // vbroadcastss 0x60a(%rip),%ymm11 # 5cc8 <_sk_callback_hsw+0x5f4>
.byte 196,66,61,168,218 // vfmadd213ps %ymm10,%ymm8,%ymm11
.byte 196,65,52,89,195 // vmulps %ymm11,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -17169,25 +16994,25 @@ BALIGN4
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 59d1 <.literal4+0xb9>
+ .byte 71,225,61 // rex.RXB loope 58d1 <.literal4+0xb9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 59e1 <.literal4+0xc9>
+ .byte 71,225,61 // rex.RXB loope 58e1 <.literal4+0xc9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 59f1 <.literal4+0xd9>
+ .byte 71,225,61 // rex.RXB loope 58f1 <.literal4+0xd9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 5a01 <.literal4+0xe9>
+ .byte 71,225,61 // rex.RXB loope 5901 <.literal4+0xe9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
@@ -17249,7 +17074,7 @@ BALIGN4
.byte 190,129,128,128,59 // mov $0x3b808081,%esi
.byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5a71 <.literal4+0x159>
+ .byte 224,7 // loopne 5971 <.literal4+0x159>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -17265,10 +17090,10 @@ BALIGN4
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
.byte 0,52,255 // add %dh,(%rdi,%rdi,8)
.byte 255 // (bad)
- .byte 127,0 // jg 5a98 <.literal4+0x180>
+ .byte 127,0 // jg 5998 <.literal4+0x180>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5b11 <.literal4+0x1f9>
+ .byte 119,115 // ja 5a11 <.literal4+0x1f9>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -17282,10 +17107,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5acc <.literal4+0x1b4>
+ .byte 127,0 // jg 59cc <.literal4+0x1b4>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5b45 <.literal4+0x22d>
+ .byte 119,115 // ja 5a45 <.literal4+0x22d>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -17299,10 +17124,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5b00 <.literal4+0x1e8>
+ .byte 127,0 // jg 5a00 <.literal4+0x1e8>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5b79 <.literal4+0x261>
+ .byte 119,115 // ja 5a79 <.literal4+0x261>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -17316,10 +17141,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 5b34 <.literal4+0x21c>
+ .byte 127,0 // jg 5a34 <.literal4+0x21c>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 5bad <.literal4+0x295>
+ .byte 119,115 // ja 5aad <.literal4+0x295>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -17332,7 +17157,7 @@ BALIGN4
.byte 0,75,0 // add %cl,0x0(%rbx)
.byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax)
.byte 66,0,0 // rex.X add %al,(%rax)
- .byte 127,67 // jg 5bab <.literal4+0x293>
+ .byte 127,67 // jg 5aab <.literal4+0x293>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -17344,7 +17169,7 @@ BALIGN4
.byte 190,80,128,3,62 // mov $0x3e038050,%esi
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 5bcb <.literal4+0x2b3>
+ .byte 118,63 // jbe 5acb <.literal4+0x2b3>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
@@ -17353,14 +17178,9 @@ BALIGN4
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
.byte 59,0 // cmp (%rax),%eax
- .byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
- .byte 59,0 // cmp (%rax),%eax
- .byte 248 // clc
- .byte 0,0 // add %al,(%rax)
- .byte 8,33 // or %ah,(%rcx)
- .byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5bcd <.literal4+0x2b5>
- .byte 0,0 // add %al,(%rax)
+ .byte 0,128,63,0,248,0 // add %al,0xf8003f(%rax)
+ .byte 0,8 // add %cl,(%rax)
+ .byte 33,132,55,224,7,0,0 // and %eax,0x7e0(%rdi,%rsi,1)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
.byte 31 // (bad)
@@ -17371,7 +17191,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5be9 <.literal4+0x2d1>
+ .byte 224,7 // loopne 5ae5 <.literal4+0x2cd>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -17383,7 +17203,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 5c05 <.literal4+0x2ed>
+ .byte 224,7 // loopne 5b01 <.literal4+0x2e9>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -17394,7 +17214,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 5c5a <.literal4+0x342>
+ .byte 124,66 // jl 5b56 <.literal4+0x33e>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax)
@@ -17420,12 +17240,12 @@ BALIGN4
.byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax)
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax)
- .byte 112,65 // jo 5cbd <.literal4+0x3a5>
+ .byte 112,65 // jo 5bb9 <.literal4+0x3a1>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 5cd3 <.literal4+0x3bb>
+ .byte 127,67 // jg 5bcf <.literal4+0x3b7>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
@@ -17436,7 +17256,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 5cf7 <.literal4+0x3df>
+ .byte 127,71 // jg 5bf3 <.literal4+0x3db>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -17563,68 +17383,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005e08 <_sk_callback_hsw+0xa000634>
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005e10 <_sk_callback_hsw+0x1200063c>
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005e18 <_sk_callback_hsw+0x1a000644>
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005e20 <_sk_callback_hsw+0x300064c>
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,6 // incl (%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,10 // decl (%rdx)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,14 // decl (%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,18 // callq *(%rdx)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,22 // callq *(%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,26 // lcall *(%rdx)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,30 // lcall *(%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 1,255 // add %edi,%edi
- .byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005e68 <_sk_callback_hsw+0xa000694>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005d08 <_sk_callback_hsw+0xa000634>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005e70 <_sk_callback_hsw+0x1200069c>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005d10 <_sk_callback_hsw+0x1200063c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005e78 <_sk_callback_hsw+0x1a0006a4>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005d18 <_sk_callback_hsw+0x1a000644>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005e80 <_sk_callback_hsw+0x30006ac>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005d20 <_sk_callback_hsw+0x300064c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17667,16 +17435,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005ec8 <_sk_callback_hsw+0xa0006f4>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005d68 <_sk_callback_hsw+0xa000694>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005ed0 <_sk_callback_hsw+0x120006fc>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005d70 <_sk_callback_hsw+0x1200069c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005ed8 <_sk_callback_hsw+0x1a000704>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005d78 <_sk_callback_hsw+0x1a0006a4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005ee0 <_sk_callback_hsw+0x300070c>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005d80 <_sk_callback_hsw+0x30006ac>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17719,16 +17487,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005f28 <_sk_callback_hsw+0xa000754>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005dc8 <_sk_callback_hsw+0xa0006f4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005f30 <_sk_callback_hsw+0x1200075c>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005dd0 <_sk_callback_hsw+0x120006fc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005f38 <_sk_callback_hsw+0x1a000764>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005dd8 <_sk_callback_hsw+0x1a000704>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005f40 <_sk_callback_hsw+0x300076c>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005de0 <_sk_callback_hsw+0x300070c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17771,16 +17539,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005f88 <_sk_callback_hsw+0xa0007b4>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005e28 <_sk_callback_hsw+0xa000754>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005f90 <_sk_callback_hsw+0x120007bc>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005e30 <_sk_callback_hsw+0x1200075c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005f98 <_sk_callback_hsw+0x1a0007c4>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005e38 <_sk_callback_hsw+0x1a000764>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005fa0 <_sk_callback_hsw+0x30007cc>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005e40 <_sk_callback_hsw+0x300076c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17823,16 +17591,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005fe8 <_sk_callback_hsw+0xa000814>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005e88 <_sk_callback_hsw+0xa0007b4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005ff0 <_sk_callback_hsw+0x1200081c>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005e90 <_sk_callback_hsw+0x120007bc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005ff8 <_sk_callback_hsw+0x1a000824>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005e98 <_sk_callback_hsw+0x1a0007c4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3006000 <_sk_callback_hsw+0x300082c>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005ea0 <_sk_callback_hsw+0x30007cc>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17875,16 +17643,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a006048 <_sk_callback_hsw+0xa000874>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005ee8 <_sk_callback_hsw+0xa000814>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12006050 <_sk_callback_hsw+0x1200087c>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005ef0 <_sk_callback_hsw+0x1200081c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a006058 <_sk_callback_hsw+0x1a000884>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005ef8 <_sk_callback_hsw+0x1a000824>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3006060 <_sk_callback_hsw+0x300088c>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005f00 <_sk_callback_hsw+0x300082c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17927,16 +17695,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a0060a8 <_sk_callback_hsw+0xa0008d4>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005f48 <_sk_callback_hsw+0xa000874>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 120060b0 <_sk_callback_hsw+0x120008dc>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005f50 <_sk_callback_hsw+0x1200087c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a0060b8 <_sk_callback_hsw+0x1a0008e4>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005f58 <_sk_callback_hsw+0x1a000884>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 30060c0 <_sk_callback_hsw+0x30008ec>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005f60 <_sk_callback_hsw+0x300088c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -17979,16 +17747,16 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a006108 <_sk_callback_hsw+0xa000934>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005fa8 <_sk_callback_hsw+0xa0008d4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12006110 <_sk_callback_hsw+0x1200093c>
+ .byte 255,13,255,255,255,17 // decl 0x11ffffff(%rip) # 12005fb0 <_sk_callback_hsw+0x120008dc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a006118 <_sk_callback_hsw+0x1a000944>
+ .byte 255,21,255,255,255,25 // callq *0x19ffffff(%rip) # 1a005fb8 <_sk_callback_hsw+0x1a0008e4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3006120 <_sk_callback_hsw+0x300094c>
+ .byte 255,29,255,255,255,2 // lcall *0x2ffffff(%rip) # 3005fc0 <_sk_callback_hsw+0x30008ec>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -18231,7 +17999,7 @@ _sk_seed_shader_avx:
.byte 197,249,112,192,0 // vpshufd $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,57,121,0,0 // vbroadcastss 0x7939(%rip),%ymm1 # 7a88 <_sk_callback_avx+0x144>
+ .byte 196,226,125,24,13,149,119,0,0 // vbroadcastss 0x7795(%rip),%ymm1 # 78e4 <_sk_callback_avx+0x144>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,88,7 // vaddps (%rdi),%ymm0,%ymm0
.byte 197,249,110,209 // vmovd %ecx,%xmm2
@@ -18240,7 +18008,7 @@ _sk_seed_shader_avx:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 197,236,88,201 // vaddps %ymm1,%ymm2,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,21,19,121,0,0 // vbroadcastss 0x7913(%rip),%ymm2 # 7a8c <_sk_callback_avx+0x148>
+ .byte 196,226,125,24,21,111,119,0,0 // vbroadcastss 0x776f(%rip),%ymm2 # 78e8 <_sk_callback_avx+0x148>
.byte 197,228,87,219 // vxorps %ymm3,%ymm3,%ymm3
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
.byte 197,212,87,237 // vxorps %ymm5,%ymm5,%ymm5
@@ -18264,7 +18032,7 @@ _sk_dither_avx:
.byte 196,65,121,112,201,0 // vpshufd $0x0,%xmm9,%xmm9
.byte 196,67,53,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
.byte 196,65,52,87,208 // vxorps %ymm8,%ymm9,%ymm10
- .byte 196,98,125,24,29,188,120,0,0 // vbroadcastss 0x78bc(%rip),%ymm11 # 7a90 <_sk_callback_avx+0x14c>
+ .byte 196,98,125,24,29,24,119,0,0 // vbroadcastss 0x7718(%rip),%ymm11 # 78ec <_sk_callback_avx+0x14c>
.byte 196,65,44,84,203 // vandps %ymm11,%ymm10,%ymm9
.byte 196,193,25,114,241,5 // vpslld $0x5,%xmm9,%xmm12
.byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9
@@ -18275,8 +18043,8 @@ _sk_dither_avx:
.byte 196,67,125,25,219,1 // vextractf128 $0x1,%ymm11,%xmm11
.byte 196,193,33,114,243,4 // vpslld $0x4,%xmm11,%xmm11
.byte 196,67,29,24,219,1 // vinsertf128 $0x1,%xmm11,%ymm12,%ymm11
- .byte 196,98,125,24,37,125,120,0,0 // vbroadcastss 0x787d(%rip),%ymm12 # 7a94 <_sk_callback_avx+0x150>
- .byte 196,98,125,24,45,120,120,0,0 // vbroadcastss 0x7878(%rip),%ymm13 # 7a98 <_sk_callback_avx+0x154>
+ .byte 196,98,125,24,37,217,118,0,0 // vbroadcastss 0x76d9(%rip),%ymm12 # 78f0 <_sk_callback_avx+0x150>
+ .byte 196,98,125,24,45,212,118,0,0 // vbroadcastss 0x76d4(%rip),%ymm13 # 78f4 <_sk_callback_avx+0x154>
.byte 196,65,44,84,245 // vandps %ymm13,%ymm10,%ymm14
.byte 196,193,1,114,246,2 // vpslld $0x2,%xmm14,%xmm15
.byte 196,67,125,25,246,1 // vextractf128 $0x1,%ymm14,%xmm14
@@ -18303,9 +18071,9 @@ _sk_dither_avx:
.byte 196,65,60,86,193 // vorps %ymm9,%ymm8,%ymm8
.byte 196,65,60,86,194 // vorps %ymm10,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,227,119,0,0 // vbroadcastss 0x77e3(%rip),%ymm9 # 7a9c <_sk_callback_avx+0x158>
+ .byte 196,98,125,24,13,63,118,0,0 // vbroadcastss 0x763f(%rip),%ymm9 # 78f8 <_sk_callback_avx+0x158>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,217,119,0,0 // vbroadcastss 0x77d9(%rip),%ymm9 # 7aa0 <_sk_callback_avx+0x15c>
+ .byte 196,98,125,24,13,53,118,0,0 // vbroadcastss 0x7635(%rip),%ymm9 # 78fc <_sk_callback_avx+0x15c>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 196,98,125,24,8 // vbroadcastss (%rax),%ymm9
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
@@ -18339,7 +18107,7 @@ HIDDEN _sk_black_color_avx
FUNCTION(_sk_black_color_avx)
_sk_black_color_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,121,119,0,0 // vbroadcastss 0x7779(%rip),%ymm3 # 7aa4 <_sk_callback_avx+0x160>
+ .byte 196,226,125,24,29,213,117,0,0 // vbroadcastss 0x75d5(%rip),%ymm3 # 7900 <_sk_callback_avx+0x160>
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 197,236,87,210 // vxorps %ymm2,%ymm2,%ymm2
@@ -18350,7 +18118,7 @@ HIDDEN _sk_white_color_avx
FUNCTION(_sk_white_color_avx)
_sk_white_color_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,100,119,0,0 // vbroadcastss 0x7764(%rip),%ymm0 # 7aa8 <_sk_callback_avx+0x164>
+ .byte 196,226,125,24,5,192,117,0,0 // vbroadcastss 0x75c0(%rip),%ymm0 # 7904 <_sk_callback_avx+0x164>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 197,252,40,216 // vmovaps %ymm0,%ymm3
@@ -18396,7 +18164,7 @@ HIDDEN _sk_srcatop_avx
FUNCTION(_sk_srcatop_avx)
_sk_srcatop_avx:
.byte 197,252,89,199 // vmulps %ymm7,%ymm0,%ymm0
- .byte 196,98,125,24,5,7,119,0,0 // vbroadcastss 0x7707(%rip),%ymm8 # 7aac <_sk_callback_avx+0x168>
+ .byte 196,98,125,24,5,99,117,0,0 // vbroadcastss 0x7563(%rip),%ymm8 # 7908 <_sk_callback_avx+0x168>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -18417,7 +18185,7 @@ HIDDEN _sk_dstatop_avx
FUNCTION(_sk_dstatop_avx)
_sk_dstatop_avx:
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
- .byte 196,98,125,24,13,201,118,0,0 // vbroadcastss 0x76c9(%rip),%ymm9 # 7ab0 <_sk_callback_avx+0x16c>
+ .byte 196,98,125,24,13,37,117,0,0 // vbroadcastss 0x7525(%rip),%ymm9 # 790c <_sk_callback_avx+0x16c>
.byte 197,52,92,207 // vsubps %ymm7,%ymm9,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,188,88,192 // vaddps %ymm0,%ymm8,%ymm0
@@ -18459,7 +18227,7 @@ HIDDEN _sk_srcout_avx
.globl _sk_srcout_avx
FUNCTION(_sk_srcout_avx)
_sk_srcout_avx:
- .byte 196,98,125,24,5,104,118,0,0 // vbroadcastss 0x7668(%rip),%ymm8 # 7ab4 <_sk_callback_avx+0x170>
+ .byte 196,98,125,24,5,196,116,0,0 // vbroadcastss 0x74c4(%rip),%ymm8 # 7910 <_sk_callback_avx+0x170>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -18472,7 +18240,7 @@ HIDDEN _sk_dstout_avx
.globl _sk_dstout_avx
FUNCTION(_sk_dstout_avx)
_sk_dstout_avx:
- .byte 196,226,125,24,5,75,118,0,0 // vbroadcastss 0x764b(%rip),%ymm0 # 7ab8 <_sk_callback_avx+0x174>
+ .byte 196,226,125,24,5,167,116,0,0 // vbroadcastss 0x74a7(%rip),%ymm0 # 7914 <_sk_callback_avx+0x174>
.byte 197,252,92,219 // vsubps %ymm3,%ymm0,%ymm3
.byte 197,228,89,196 // vmulps %ymm4,%ymm3,%ymm0
.byte 197,228,89,205 // vmulps %ymm5,%ymm3,%ymm1
@@ -18485,7 +18253,7 @@ HIDDEN _sk_srcover_avx
.globl _sk_srcover_avx
FUNCTION(_sk_srcover_avx)
_sk_srcover_avx:
- .byte 196,98,125,24,5,46,118,0,0 // vbroadcastss 0x762e(%rip),%ymm8 # 7abc <_sk_callback_avx+0x178>
+ .byte 196,98,125,24,5,138,116,0,0 // vbroadcastss 0x748a(%rip),%ymm8 # 7918 <_sk_callback_avx+0x178>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,204 // vmulps %ymm4,%ymm8,%ymm9
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -18502,7 +18270,7 @@ HIDDEN _sk_dstover_avx
.globl _sk_dstover_avx
FUNCTION(_sk_dstover_avx)
_sk_dstover_avx:
- .byte 196,98,125,24,5,1,118,0,0 // vbroadcastss 0x7601(%rip),%ymm8 # 7ac0 <_sk_callback_avx+0x17c>
+ .byte 196,98,125,24,5,93,116,0,0 // vbroadcastss 0x745d(%rip),%ymm8 # 791c <_sk_callback_avx+0x17c>
.byte 197,60,92,199 // vsubps %ymm7,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,252,88,196 // vaddps %ymm4,%ymm0,%ymm0
@@ -18530,7 +18298,7 @@ HIDDEN _sk_multiply_avx
.globl _sk_multiply_avx
FUNCTION(_sk_multiply_avx)
_sk_multiply_avx:
- .byte 196,98,125,24,5,192,117,0,0 // vbroadcastss 0x75c0(%rip),%ymm8 # 7ac4 <_sk_callback_avx+0x180>
+ .byte 196,98,125,24,5,28,116,0,0 // vbroadcastss 0x741c(%rip),%ymm8 # 7920 <_sk_callback_avx+0x180>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,208 // vmulps %ymm0,%ymm9,%ymm10
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -18590,7 +18358,7 @@ HIDDEN _sk_xor__avx
.globl _sk_xor__avx
FUNCTION(_sk_xor__avx)
_sk_xor__avx:
- .byte 196,98,125,24,5,15,117,0,0 // vbroadcastss 0x750f(%rip),%ymm8 # 7ac8 <_sk_callback_avx+0x184>
+ .byte 196,98,125,24,5,107,115,0,0 // vbroadcastss 0x736b(%rip),%ymm8 # 7924 <_sk_callback_avx+0x184>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,192 // vmulps %ymm0,%ymm9,%ymm0
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -18627,7 +18395,7 @@ _sk_darken_avx:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,95,209 // vmaxps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,143,116,0,0 // vbroadcastss 0x748f(%rip),%ymm8 # 7acc <_sk_callback_avx+0x188>
+ .byte 196,98,125,24,5,235,114,0,0 // vbroadcastss 0x72eb(%rip),%ymm8 # 7928 <_sk_callback_avx+0x188>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -18653,7 +18421,7 @@ _sk_lighten_avx:
.byte 197,100,89,206 // vmulps %ymm6,%ymm3,%ymm9
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,59,116,0,0 // vbroadcastss 0x743b(%rip),%ymm8 # 7ad0 <_sk_callback_avx+0x18c>
+ .byte 196,98,125,24,5,151,114,0,0 // vbroadcastss 0x7297(%rip),%ymm8 # 792c <_sk_callback_avx+0x18c>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -18682,7 +18450,7 @@ _sk_difference_avx:
.byte 196,193,108,93,209 // vminps %ymm9,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,219,115,0,0 // vbroadcastss 0x73db(%rip),%ymm8 # 7ad4 <_sk_callback_avx+0x190>
+ .byte 196,98,125,24,5,55,114,0,0 // vbroadcastss 0x7237(%rip),%ymm8 # 7930 <_sk_callback_avx+0x190>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -18705,7 +18473,7 @@ _sk_exclusion_avx:
.byte 197,236,89,214 // vmulps %ymm6,%ymm2,%ymm2
.byte 197,236,88,210 // vaddps %ymm2,%ymm2,%ymm2
.byte 197,188,92,210 // vsubps %ymm2,%ymm8,%ymm2
- .byte 196,98,125,24,5,150,115,0,0 // vbroadcastss 0x7396(%rip),%ymm8 # 7ad8 <_sk_callback_avx+0x194>
+ .byte 196,98,125,24,5,242,113,0,0 // vbroadcastss 0x71f2(%rip),%ymm8 # 7934 <_sk_callback_avx+0x194>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
.byte 197,60,89,199 // vmulps %ymm7,%ymm8,%ymm8
.byte 197,188,88,219 // vaddps %ymm3,%ymm8,%ymm3
@@ -18716,7 +18484,7 @@ HIDDEN _sk_colorburn_avx
.globl _sk_colorburn_avx
FUNCTION(_sk_colorburn_avx)
_sk_colorburn_avx:
- .byte 196,98,125,24,5,129,115,0,0 // vbroadcastss 0x7381(%rip),%ymm8 # 7adc <_sk_callback_avx+0x198>
+ .byte 196,98,125,24,5,221,113,0,0 // vbroadcastss 0x71dd(%rip),%ymm8 # 7938 <_sk_callback_avx+0x198>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,52,89,216 // vmulps %ymm0,%ymm9,%ymm11
.byte 196,65,44,87,210 // vxorps %ymm10,%ymm10,%ymm10
@@ -18778,7 +18546,7 @@ HIDDEN _sk_colordodge_avx
FUNCTION(_sk_colordodge_avx)
_sk_colordodge_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
- .byte 196,98,125,24,13,125,114,0,0 // vbroadcastss 0x727d(%rip),%ymm9 # 7ae0 <_sk_callback_avx+0x19c>
+ .byte 196,98,125,24,13,217,112,0,0 // vbroadcastss 0x70d9(%rip),%ymm9 # 793c <_sk_callback_avx+0x19c>
.byte 197,52,92,215 // vsubps %ymm7,%ymm9,%ymm10
.byte 197,44,89,216 // vmulps %ymm0,%ymm10,%ymm11
.byte 197,52,92,203 // vsubps %ymm3,%ymm9,%ymm9
@@ -18835,7 +18603,7 @@ HIDDEN _sk_hardlight_avx
.globl _sk_hardlight_avx
FUNCTION(_sk_hardlight_avx)
_sk_hardlight_avx:
- .byte 196,98,125,24,5,143,113,0,0 // vbroadcastss 0x718f(%rip),%ymm8 # 7ae4 <_sk_callback_avx+0x1a0>
+ .byte 196,98,125,24,5,235,111,0,0 // vbroadcastss 0x6feb(%rip),%ymm8 # 7940 <_sk_callback_avx+0x1a0>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -18890,7 +18658,7 @@ HIDDEN _sk_overlay_avx
.globl _sk_overlay_avx
FUNCTION(_sk_overlay_avx)
_sk_overlay_avx:
- .byte 196,98,125,24,5,184,112,0,0 // vbroadcastss 0x70b8(%rip),%ymm8 # 7ae8 <_sk_callback_avx+0x1a4>
+ .byte 196,98,125,24,5,20,111,0,0 // vbroadcastss 0x6f14(%rip),%ymm8 # 7944 <_sk_callback_avx+0x1a4>
.byte 197,60,92,215 // vsubps %ymm7,%ymm8,%ymm10
.byte 197,44,89,200 // vmulps %ymm0,%ymm10,%ymm9
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -18956,10 +18724,10 @@ _sk_softlight_avx:
.byte 196,65,60,88,192 // vaddps %ymm8,%ymm8,%ymm8
.byte 196,65,60,89,216 // vmulps %ymm8,%ymm8,%ymm11
.byte 196,65,60,88,195 // vaddps %ymm11,%ymm8,%ymm8
- .byte 196,98,125,24,29,175,111,0,0 // vbroadcastss 0x6faf(%rip),%ymm11 # 7af0 <_sk_callback_avx+0x1ac>
+ .byte 196,98,125,24,29,11,110,0,0 // vbroadcastss 0x6e0b(%rip),%ymm11 # 794c <_sk_callback_avx+0x1ac>
.byte 196,65,28,88,235 // vaddps %ymm11,%ymm12,%ymm13
.byte 196,65,20,89,192 // vmulps %ymm8,%ymm13,%ymm8
- .byte 196,98,125,24,45,160,111,0,0 // vbroadcastss 0x6fa0(%rip),%ymm13 # 7af4 <_sk_callback_avx+0x1b0>
+ .byte 196,98,125,24,45,252,109,0,0 // vbroadcastss 0x6dfc(%rip),%ymm13 # 7950 <_sk_callback_avx+0x1b0>
.byte 196,65,28,89,245 // vmulps %ymm13,%ymm12,%ymm14
.byte 196,65,12,88,192 // vaddps %ymm8,%ymm14,%ymm8
.byte 196,65,124,82,244 // vrsqrtps %ymm12,%ymm14
@@ -18970,7 +18738,7 @@ _sk_softlight_avx:
.byte 197,4,194,255,2 // vcmpleps %ymm7,%ymm15,%ymm15
.byte 196,67,13,74,240,240 // vblendvps %ymm15,%ymm8,%ymm14,%ymm14
.byte 197,116,88,249 // vaddps %ymm1,%ymm1,%ymm15
- .byte 196,98,125,24,5,94,111,0,0 // vbroadcastss 0x6f5e(%rip),%ymm8 # 7aec <_sk_callback_avx+0x1a8>
+ .byte 196,98,125,24,5,186,109,0,0 // vbroadcastss 0x6dba(%rip),%ymm8 # 7948 <_sk_callback_avx+0x1a8>
.byte 196,65,60,92,228 // vsubps %ymm12,%ymm8,%ymm12
.byte 197,132,92,195 // vsubps %ymm3,%ymm15,%ymm0
.byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12
@@ -19097,12 +18865,12 @@ _sk_hue_avx:
.byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11
.byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11
.byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- .byte 196,98,125,24,53,45,109,0,0 // vbroadcastss 0x6d2d(%rip),%ymm14 # 7af8 <_sk_callback_avx+0x1b4>
+ .byte 196,98,125,24,53,137,107,0,0 // vbroadcastss 0x6b89(%rip),%ymm14 # 7954 <_sk_callback_avx+0x1b4>
.byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11
- .byte 196,98,125,24,61,35,109,0,0 // vbroadcastss 0x6d23(%rip),%ymm15 # 7afc <_sk_callback_avx+0x1b8>
+ .byte 196,98,125,24,61,127,107,0,0 // vbroadcastss 0x6b7f(%rip),%ymm15 # 7958 <_sk_callback_avx+0x1b8>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
- .byte 196,226,125,24,5,20,109,0,0 // vbroadcastss 0x6d14(%rip),%ymm0 # 7b00 <_sk_callback_avx+0x1bc>
+ .byte 196,226,125,24,5,112,107,0,0 // vbroadcastss 0x6b70(%rip),%ymm0 # 795c <_sk_callback_avx+0x1bc>
.byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
.byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13
@@ -19163,7 +18931,7 @@ _sk_hue_avx:
.byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10
.byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,237,107,0,0 // vbroadcastss 0x6bed(%rip),%ymm8 # 7b04 <_sk_callback_avx+0x1c0>
+ .byte 196,98,125,24,5,73,106,0,0 // vbroadcastss 0x6a49(%rip),%ymm8 # 7960 <_sk_callback_avx+0x1c0>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -19220,12 +18988,12 @@ _sk_saturation_avx:
.byte 196,65,28,89,219 // vmulps %ymm11,%ymm12,%ymm11
.byte 196,65,36,94,222 // vdivps %ymm14,%ymm11,%ymm11
.byte 196,67,37,74,224,240 // vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- .byte 196,98,125,24,53,251,106,0,0 // vbroadcastss 0x6afb(%rip),%ymm14 # 7b08 <_sk_callback_avx+0x1c4>
+ .byte 196,98,125,24,53,87,105,0,0 // vbroadcastss 0x6957(%rip),%ymm14 # 7964 <_sk_callback_avx+0x1c4>
.byte 196,65,92,89,222 // vmulps %ymm14,%ymm4,%ymm11
- .byte 196,98,125,24,61,241,106,0,0 // vbroadcastss 0x6af1(%rip),%ymm15 # 7b0c <_sk_callback_avx+0x1c8>
+ .byte 196,98,125,24,61,77,105,0,0 // vbroadcastss 0x694d(%rip),%ymm15 # 7968 <_sk_callback_avx+0x1c8>
.byte 196,65,84,89,239 // vmulps %ymm15,%ymm5,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
- .byte 196,226,125,24,5,226,106,0,0 // vbroadcastss 0x6ae2(%rip),%ymm0 # 7b10 <_sk_callback_avx+0x1cc>
+ .byte 196,226,125,24,5,62,105,0,0 // vbroadcastss 0x693e(%rip),%ymm0 # 796c <_sk_callback_avx+0x1cc>
.byte 197,76,89,232 // vmulps %ymm0,%ymm6,%ymm13
.byte 196,65,36,88,221 // vaddps %ymm13,%ymm11,%ymm11
.byte 196,65,52,89,238 // vmulps %ymm14,%ymm9,%ymm13
@@ -19286,7 +19054,7 @@ _sk_saturation_avx:
.byte 196,65,36,95,208 // vmaxps %ymm8,%ymm11,%ymm10
.byte 196,195,109,74,209,240 // vblendvps %ymm15,%ymm9,%ymm2,%ymm2
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,187,105,0,0 // vbroadcastss 0x69bb(%rip),%ymm8 # 7b14 <_sk_callback_avx+0x1d0>
+ .byte 196,98,125,24,5,23,104,0,0 // vbroadcastss 0x6817(%rip),%ymm8 # 7970 <_sk_callback_avx+0x1d0>
.byte 197,60,92,207 // vsubps %ymm7,%ymm8,%ymm9
.byte 197,180,89,201 // vmulps %ymm1,%ymm9,%ymm1
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
@@ -19315,12 +19083,12 @@ _sk_color_avx:
.byte 197,252,17,68,36,168 // vmovups %ymm0,-0x58(%rsp)
.byte 197,124,89,199 // vmulps %ymm7,%ymm0,%ymm8
.byte 197,116,89,207 // vmulps %ymm7,%ymm1,%ymm9
- .byte 196,98,125,24,45,81,105,0,0 // vbroadcastss 0x6951(%rip),%ymm13 # 7b18 <_sk_callback_avx+0x1d4>
+ .byte 196,98,125,24,45,173,103,0,0 // vbroadcastss 0x67ad(%rip),%ymm13 # 7974 <_sk_callback_avx+0x1d4>
.byte 196,65,92,89,213 // vmulps %ymm13,%ymm4,%ymm10
- .byte 196,98,125,24,53,71,105,0,0 // vbroadcastss 0x6947(%rip),%ymm14 # 7b1c <_sk_callback_avx+0x1d8>
+ .byte 196,98,125,24,53,163,103,0,0 // vbroadcastss 0x67a3(%rip),%ymm14 # 7978 <_sk_callback_avx+0x1d8>
.byte 196,65,84,89,222 // vmulps %ymm14,%ymm5,%ymm11
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,61,56,105,0,0 // vbroadcastss 0x6938(%rip),%ymm15 # 7b20 <_sk_callback_avx+0x1dc>
+ .byte 196,98,125,24,61,148,103,0,0 // vbroadcastss 0x6794(%rip),%ymm15 # 797c <_sk_callback_avx+0x1dc>
.byte 196,65,76,89,223 // vmulps %ymm15,%ymm6,%ymm11
.byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0
.byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11
@@ -19383,7 +19151,7 @@ _sk_color_avx:
.byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9
.byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0
.byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8
- .byte 196,226,125,24,5,255,103,0,0 // vbroadcastss 0x67ff(%rip),%ymm0 # 7b24 <_sk_callback_avx+0x1e0>
+ .byte 196,226,125,24,5,91,102,0,0 // vbroadcastss 0x665b(%rip),%ymm0 # 7980 <_sk_callback_avx+0x1e0>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,84,36,168 // vmulps -0x58(%rsp),%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -19413,12 +19181,12 @@ _sk_luminosity_avx:
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 197,100,89,196 // vmulps %ymm4,%ymm3,%ymm8
.byte 197,100,89,205 // vmulps %ymm5,%ymm3,%ymm9
- .byte 196,98,125,24,45,145,103,0,0 // vbroadcastss 0x6791(%rip),%ymm13 # 7b28 <_sk_callback_avx+0x1e4>
+ .byte 196,98,125,24,45,237,101,0,0 // vbroadcastss 0x65ed(%rip),%ymm13 # 7984 <_sk_callback_avx+0x1e4>
.byte 196,65,108,89,213 // vmulps %ymm13,%ymm2,%ymm10
- .byte 196,98,125,24,53,135,103,0,0 // vbroadcastss 0x6787(%rip),%ymm14 # 7b2c <_sk_callback_avx+0x1e8>
+ .byte 196,98,125,24,53,227,101,0,0 // vbroadcastss 0x65e3(%rip),%ymm14 # 7988 <_sk_callback_avx+0x1e8>
.byte 196,65,116,89,222 // vmulps %ymm14,%ymm1,%ymm11
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,61,120,103,0,0 // vbroadcastss 0x6778(%rip),%ymm15 # 7b30 <_sk_callback_avx+0x1ec>
+ .byte 196,98,125,24,61,212,101,0,0 // vbroadcastss 0x65d4(%rip),%ymm15 # 798c <_sk_callback_avx+0x1ec>
.byte 196,65,28,89,223 // vmulps %ymm15,%ymm12,%ymm11
.byte 196,193,44,88,195 // vaddps %ymm11,%ymm10,%ymm0
.byte 196,65,60,89,221 // vmulps %ymm13,%ymm8,%ymm11
@@ -19481,7 +19249,7 @@ _sk_luminosity_avx:
.byte 196,65,44,95,207 // vmaxps %ymm15,%ymm10,%ymm9
.byte 196,195,37,74,192,0 // vblendvps %ymm0,%ymm8,%ymm11,%ymm0
.byte 196,65,124,95,199 // vmaxps %ymm15,%ymm0,%ymm8
- .byte 196,226,125,24,5,63,102,0,0 // vbroadcastss 0x663f(%rip),%ymm0 # 7b34 <_sk_callback_avx+0x1f0>
+ .byte 196,226,125,24,5,155,100,0,0 // vbroadcastss 0x649b(%rip),%ymm0 # 7990 <_sk_callback_avx+0x1f0>
.byte 197,124,92,215 // vsubps %ymm7,%ymm0,%ymm10
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 197,124,92,219 // vsubps %ymm3,%ymm0,%ymm11
@@ -19512,7 +19280,7 @@ _sk_srcover_rgba_8888_avx:
.byte 77,133,192 // test %r8,%r8
.byte 15,133,43,1,0,0 // jne 1684 <_sk_srcover_rgba_8888_avx+0x144>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,124,40,13,218,107,0,0 // vmovaps 0x6bda(%rip),%ymm9 # 8140 <_sk_callback_avx+0x7fc>
+ .byte 197,124,40,13,58,106,0,0 // vmovaps 0x6a3a(%rip),%ymm9 # 7fa0 <_sk_callback_avx+0x800>
.byte 196,193,68,84,225 // vandps %ymm9,%ymm7,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
.byte 197,209,114,215,8 // vpsrld $0x8,%xmm7,%xmm5
@@ -19530,9 +19298,9 @@ _sk_srcover_rgba_8888_avx:
.byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7
.byte 196,227,53,24,255,1 // vinsertf128 $0x1,%xmm7,%ymm9,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,113,101,0,0 // vbroadcastss 0x6571(%rip),%ymm8 # 7b38 <_sk_callback_avx+0x1f4>
+ .byte 196,98,125,24,5,205,99,0,0 // vbroadcastss 0x63cd(%rip),%ymm8 # 7994 <_sk_callback_avx+0x1f4>
.byte 197,60,92,195 // vsubps %ymm3,%ymm8,%ymm8
- .byte 196,98,125,24,13,104,101,0,0 // vbroadcastss 0x6568(%rip),%ymm9 # 7b3c <_sk_callback_avx+0x1f8>
+ .byte 196,98,125,24,13,196,99,0,0 // vbroadcastss 0x63c4(%rip),%ymm9 # 7998 <_sk_callback_avx+0x1f8>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 197,60,89,212 // vmulps %ymm4,%ymm8,%ymm10
.byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0
@@ -19577,9 +19345,9 @@ _sk_srcover_rgba_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,121,48,228 // vpmovzxbw %xmm4,%xmm4
- .byte 196,226,89,0,45,212,104,0,0 // vpshufb 0x68d4(%rip),%xmm4,%xmm5 # 7f80 <_sk_callback_avx+0x63c>
+ .byte 196,226,89,0,45,36,103,0,0 // vpshufb 0x6724(%rip),%xmm4,%xmm5 # 7dd0 <_sk_callback_avx+0x630>
.byte 196,226,121,33,237 // vpmovsxbd %xmm5,%xmm5
- .byte 196,226,89,0,37,214,104,0,0 // vpshufb 0x68d6(%rip),%xmm4,%xmm4 # 7f90 <_sk_callback_avx+0x64c>
+ .byte 196,226,89,0,37,38,103,0,0 // vpshufb 0x6726(%rip),%xmm4,%xmm4 # 7de0 <_sk_callback_avx+0x640>
.byte 196,226,121,33,228 // vpmovsxbd %xmm4,%xmm4
.byte 196,227,85,24,228,1 // vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
.byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
@@ -19591,9 +19359,9 @@ _sk_srcover_rgba_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,137,104,0,0 // vpshufb 0x6889(%rip),%xmm9,%xmm10 # 7f80 <_sk_callback_avx+0x63c>
+ .byte 196,98,49,0,21,217,102,0,0 // vpshufb 0x66d9(%rip),%xmm9,%xmm10 # 7dd0 <_sk_callback_avx+0x630>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,139,104,0,0 // vpshufb 0x688b(%rip),%xmm9,%xmm9 # 7f90 <_sk_callback_avx+0x64c>
+ .byte 196,98,49,0,13,219,102,0,0 // vpshufb 0x66db(%rip),%xmm9,%xmm9 # 7de0 <_sk_callback_avx+0x640>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
.byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
@@ -19615,7 +19383,7 @@ HIDDEN _sk_clamp_1_avx
.globl _sk_clamp_1_avx
FUNCTION(_sk_clamp_1_avx)
_sk_clamp_1_avx:
- .byte 196,98,125,24,5,0,100,0,0 // vbroadcastss 0x6400(%rip),%ymm8 # 7b40 <_sk_callback_avx+0x1fc>
+ .byte 196,98,125,24,5,92,98,0,0 // vbroadcastss 0x625c(%rip),%ymm8 # 799c <_sk_callback_avx+0x1fc>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
@@ -19627,7 +19395,7 @@ HIDDEN _sk_clamp_a_avx
.globl _sk_clamp_a_avx
FUNCTION(_sk_clamp_a_avx)
_sk_clamp_a_avx:
- .byte 196,98,125,24,5,227,99,0,0 // vbroadcastss 0x63e3(%rip),%ymm8 # 7b44 <_sk_callback_avx+0x200>
+ .byte 196,98,125,24,5,63,98,0,0 // vbroadcastss 0x623f(%rip),%ymm8 # 79a0 <_sk_callback_avx+0x200>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 197,252,93,195 // vminps %ymm3,%ymm0,%ymm0
.byte 197,244,93,203 // vminps %ymm3,%ymm1,%ymm1
@@ -19639,7 +19407,7 @@ HIDDEN _sk_clamp_a_dst_avx
.globl _sk_clamp_a_dst_avx
FUNCTION(_sk_clamp_a_dst_avx)
_sk_clamp_a_dst_avx:
- .byte 196,98,125,24,5,201,99,0,0 // vbroadcastss 0x63c9(%rip),%ymm8 # 7b48 <_sk_callback_avx+0x204>
+ .byte 196,98,125,24,5,37,98,0,0 // vbroadcastss 0x6225(%rip),%ymm8 # 79a4 <_sk_callback_avx+0x204>
.byte 196,193,68,93,248 // vminps %ymm8,%ymm7,%ymm7
.byte 197,220,93,231 // vminps %ymm7,%ymm4,%ymm4
.byte 197,212,93,239 // vminps %ymm7,%ymm5,%ymm5
@@ -19706,7 +19474,7 @@ FUNCTION(_sk_unpremul_avx)
_sk_unpremul_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,65,100,194,200,0 // vcmpeqps %ymm8,%ymm3,%ymm9
- .byte 196,98,125,24,21,69,99,0,0 // vbroadcastss 0x6345(%rip),%ymm10 # 7b4c <_sk_callback_avx+0x208>
+ .byte 196,98,125,24,21,161,97,0,0 // vbroadcastss 0x61a1(%rip),%ymm10 # 79a8 <_sk_callback_avx+0x208>
.byte 197,44,94,211 // vdivps %ymm3,%ymm10,%ymm10
.byte 196,67,45,74,192,144 // vblendvps %ymm9,%ymm8,%ymm10,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
@@ -19719,17 +19487,17 @@ HIDDEN _sk_from_srgb_avx
.globl _sk_from_srgb_avx
FUNCTION(_sk_from_srgb_avx)
_sk_from_srgb_avx:
- .byte 196,98,125,24,5,38,99,0,0 // vbroadcastss 0x6326(%rip),%ymm8 # 7b50 <_sk_callback_avx+0x20c>
+ .byte 196,98,125,24,5,130,97,0,0 // vbroadcastss 0x6182(%rip),%ymm8 # 79ac <_sk_callback_avx+0x20c>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 197,124,89,208 // vmulps %ymm0,%ymm0,%ymm10
- .byte 196,98,125,24,29,24,99,0,0 // vbroadcastss 0x6318(%rip),%ymm11 # 7b54 <_sk_callback_avx+0x210>
+ .byte 196,98,125,24,29,116,97,0,0 // vbroadcastss 0x6174(%rip),%ymm11 # 79b0 <_sk_callback_avx+0x210>
.byte 196,65,124,89,227 // vmulps %ymm11,%ymm0,%ymm12
- .byte 196,98,125,24,45,14,99,0,0 // vbroadcastss 0x630e(%rip),%ymm13 # 7b58 <_sk_callback_avx+0x214>
+ .byte 196,98,125,24,45,106,97,0,0 // vbroadcastss 0x616a(%rip),%ymm13 # 79b4 <_sk_callback_avx+0x214>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,44,89,212 // vmulps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,255,98,0,0 // vbroadcastss 0x62ff(%rip),%ymm12 # 7b5c <_sk_callback_avx+0x218>
+ .byte 196,98,125,24,37,91,97,0,0 // vbroadcastss 0x615b(%rip),%ymm12 # 79b8 <_sk_callback_avx+0x218>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,53,245,98,0,0 // vbroadcastss 0x62f5(%rip),%ymm14 # 7b60 <_sk_callback_avx+0x21c>
+ .byte 196,98,125,24,53,81,97,0,0 // vbroadcastss 0x6151(%rip),%ymm14 # 79bc <_sk_callback_avx+0x21c>
.byte 196,193,124,194,198,1 // vcmpltps %ymm14,%ymm0,%ymm0
.byte 196,195,45,74,193,0 // vblendvps %ymm0,%ymm9,%ymm10,%ymm0
.byte 196,65,116,89,200 // vmulps %ymm8,%ymm1,%ymm9
@@ -19755,17 +19523,17 @@ HIDDEN _sk_from_srgb_dst_avx
.globl _sk_from_srgb_dst_avx
FUNCTION(_sk_from_srgb_dst_avx)
_sk_from_srgb_dst_avx:
- .byte 196,98,125,24,5,142,98,0,0 // vbroadcastss 0x628e(%rip),%ymm8 # 7b64 <_sk_callback_avx+0x220>
+ .byte 196,98,125,24,5,234,96,0,0 // vbroadcastss 0x60ea(%rip),%ymm8 # 79c0 <_sk_callback_avx+0x220>
.byte 196,65,92,89,200 // vmulps %ymm8,%ymm4,%ymm9
.byte 197,92,89,212 // vmulps %ymm4,%ymm4,%ymm10
- .byte 196,98,125,24,29,128,98,0,0 // vbroadcastss 0x6280(%rip),%ymm11 # 7b68 <_sk_callback_avx+0x224>
+ .byte 196,98,125,24,29,220,96,0,0 // vbroadcastss 0x60dc(%rip),%ymm11 # 79c4 <_sk_callback_avx+0x224>
.byte 196,65,92,89,227 // vmulps %ymm11,%ymm4,%ymm12
- .byte 196,98,125,24,45,118,98,0,0 // vbroadcastss 0x6276(%rip),%ymm13 # 7b6c <_sk_callback_avx+0x228>
+ .byte 196,98,125,24,45,210,96,0,0 // vbroadcastss 0x60d2(%rip),%ymm13 # 79c8 <_sk_callback_avx+0x228>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,44,89,212 // vmulps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,37,103,98,0,0 // vbroadcastss 0x6267(%rip),%ymm12 # 7b70 <_sk_callback_avx+0x22c>
+ .byte 196,98,125,24,37,195,96,0,0 // vbroadcastss 0x60c3(%rip),%ymm12 # 79cc <_sk_callback_avx+0x22c>
.byte 196,65,44,88,212 // vaddps %ymm12,%ymm10,%ymm10
- .byte 196,98,125,24,53,93,98,0,0 // vbroadcastss 0x625d(%rip),%ymm14 # 7b74 <_sk_callback_avx+0x230>
+ .byte 196,98,125,24,53,185,96,0,0 // vbroadcastss 0x60b9(%rip),%ymm14 # 79d0 <_sk_callback_avx+0x230>
.byte 196,193,92,194,230,1 // vcmpltps %ymm14,%ymm4,%ymm4
.byte 196,195,45,74,225,64 // vblendvps %ymm4,%ymm9,%ymm10,%ymm4
.byte 196,65,84,89,200 // vmulps %ymm8,%ymm5,%ymm9
@@ -19792,20 +19560,20 @@ HIDDEN _sk_to_srgb_avx
FUNCTION(_sk_to_srgb_avx)
_sk_to_srgb_avx:
.byte 197,124,82,200 // vrsqrtps %ymm0,%ymm9
- .byte 196,98,125,24,5,242,97,0,0 // vbroadcastss 0x61f2(%rip),%ymm8 # 7b78 <_sk_callback_avx+0x234>
+ .byte 196,98,125,24,5,78,96,0,0 // vbroadcastss 0x604e(%rip),%ymm8 # 79d4 <_sk_callback_avx+0x234>
.byte 196,65,124,89,208 // vmulps %ymm8,%ymm0,%ymm10
- .byte 196,98,125,24,29,232,97,0,0 // vbroadcastss 0x61e8(%rip),%ymm11 # 7b7c <_sk_callback_avx+0x238>
+ .byte 196,98,125,24,29,68,96,0,0 // vbroadcastss 0x6044(%rip),%ymm11 # 79d8 <_sk_callback_avx+0x238>
.byte 196,65,52,89,227 // vmulps %ymm11,%ymm9,%ymm12
- .byte 196,98,125,24,45,222,97,0,0 // vbroadcastss 0x61de(%rip),%ymm13 # 7b80 <_sk_callback_avx+0x23c>
+ .byte 196,98,125,24,45,58,96,0,0 // vbroadcastss 0x603a(%rip),%ymm13 # 79dc <_sk_callback_avx+0x23c>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,52,89,228 // vmulps %ymm12,%ymm9,%ymm12
- .byte 196,98,125,24,53,207,97,0,0 // vbroadcastss 0x61cf(%rip),%ymm14 # 7b84 <_sk_callback_avx+0x240>
+ .byte 196,98,125,24,53,43,96,0,0 // vbroadcastss 0x602b(%rip),%ymm14 # 79e0 <_sk_callback_avx+0x240>
.byte 196,65,28,88,230 // vaddps %ymm14,%ymm12,%ymm12
- .byte 196,98,125,24,61,197,97,0,0 // vbroadcastss 0x61c5(%rip),%ymm15 # 7b88 <_sk_callback_avx+0x244>
+ .byte 196,98,125,24,61,33,96,0,0 // vbroadcastss 0x6021(%rip),%ymm15 # 79e4 <_sk_callback_avx+0x244>
.byte 196,65,52,88,207 // vaddps %ymm15,%ymm9,%ymm9
.byte 196,65,124,83,201 // vrcpps %ymm9,%ymm9
.byte 196,65,52,89,204 // vmulps %ymm12,%ymm9,%ymm9
- .byte 196,98,125,24,37,177,97,0,0 // vbroadcastss 0x61b1(%rip),%ymm12 # 7b8c <_sk_callback_avx+0x248>
+ .byte 196,98,125,24,37,13,96,0,0 // vbroadcastss 0x600d(%rip),%ymm12 # 79e8 <_sk_callback_avx+0x248>
.byte 196,193,124,194,196,1 // vcmpltps %ymm12,%ymm0,%ymm0
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 197,124,82,201 // vrsqrtps %ymm1,%ymm9
@@ -19842,7 +19610,7 @@ _sk_rgb_to_hsl_avx:
.byte 197,124,93,201 // vminps %ymm1,%ymm0,%ymm9
.byte 197,52,93,202 // vminps %ymm2,%ymm9,%ymm9
.byte 196,65,60,92,209 // vsubps %ymm9,%ymm8,%ymm10
- .byte 196,98,125,24,29,23,97,0,0 // vbroadcastss 0x6117(%rip),%ymm11 # 7b90 <_sk_callback_avx+0x24c>
+ .byte 196,98,125,24,29,115,95,0,0 // vbroadcastss 0x5f73(%rip),%ymm11 # 79ec <_sk_callback_avx+0x24c>
.byte 196,65,36,94,218 // vdivps %ymm10,%ymm11,%ymm11
.byte 197,116,92,226 // vsubps %ymm2,%ymm1,%ymm12
.byte 196,65,28,89,227 // vmulps %ymm11,%ymm12,%ymm12
@@ -19852,19 +19620,19 @@ _sk_rgb_to_hsl_avx:
.byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2
.byte 197,252,92,201 // vsubps %ymm1,%ymm0,%ymm1
.byte 196,193,116,89,203 // vmulps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,240,96,0,0 // vbroadcastss 0x60f0(%rip),%ymm11 # 7b9c <_sk_callback_avx+0x258>
+ .byte 196,98,125,24,29,76,95,0,0 // vbroadcastss 0x5f4c(%rip),%ymm11 # 79f8 <_sk_callback_avx+0x258>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,222,96,0,0 // vbroadcastss 0x60de(%rip),%ymm11 # 7b98 <_sk_callback_avx+0x254>
+ .byte 196,98,125,24,29,58,95,0,0 // vbroadcastss 0x5f3a(%rip),%ymm11 # 79f4 <_sk_callback_avx+0x254>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,227,117,74,202,224 // vblendvps %ymm14,%ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,198,96,0,0 // vbroadcastss 0x60c6(%rip),%ymm2 # 7b94 <_sk_callback_avx+0x250>
+ .byte 196,226,125,24,21,34,95,0,0 // vbroadcastss 0x5f22(%rip),%ymm2 # 79f0 <_sk_callback_avx+0x250>
.byte 196,65,12,87,246 // vxorps %ymm14,%ymm14,%ymm14
.byte 196,227,13,74,210,208 // vblendvps %ymm13,%ymm2,%ymm14,%ymm2
.byte 197,188,194,192,0 // vcmpeqps %ymm0,%ymm8,%ymm0
.byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2
.byte 196,227,117,74,194,0 // vblendvps %ymm0,%ymm2,%ymm1,%ymm0
.byte 196,193,60,88,201 // vaddps %ymm9,%ymm8,%ymm1
- .byte 196,98,125,24,37,173,96,0,0 // vbroadcastss 0x60ad(%rip),%ymm12 # 7ba4 <_sk_callback_avx+0x260>
+ .byte 196,98,125,24,37,9,95,0,0 // vbroadcastss 0x5f09(%rip),%ymm12 # 7a00 <_sk_callback_avx+0x260>
.byte 196,193,116,89,212 // vmulps %ymm12,%ymm1,%ymm2
.byte 197,28,194,226,1 // vcmpltps %ymm2,%ymm12,%ymm12
.byte 196,65,36,92,216 // vsubps %ymm8,%ymm11,%ymm11
@@ -19874,7 +19642,7 @@ _sk_rgb_to_hsl_avx:
.byte 197,172,94,201 // vdivps %ymm1,%ymm10,%ymm1
.byte 196,195,125,74,198,128 // vblendvps %ymm8,%ymm14,%ymm0,%ymm0
.byte 196,195,117,74,206,128 // vblendvps %ymm8,%ymm14,%ymm1,%ymm1
- .byte 196,98,125,24,5,112,96,0,0 // vbroadcastss 0x6070(%rip),%ymm8 # 7ba0 <_sk_callback_avx+0x25c>
+ .byte 196,98,125,24,5,204,94,0,0 // vbroadcastss 0x5ecc(%rip),%ymm8 # 79fc <_sk_callback_avx+0x25c>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -19891,7 +19659,7 @@ _sk_hsl_to_rgb_avx:
.byte 197,252,17,92,36,128 // vmovups %ymm3,-0x80(%rsp)
.byte 197,252,40,225 // vmovaps %ymm1,%ymm4
.byte 197,252,40,216 // vmovaps %ymm0,%ymm3
- .byte 196,98,125,24,5,61,96,0,0 // vbroadcastss 0x603d(%rip),%ymm8 # 7ba8 <_sk_callback_avx+0x264>
+ .byte 196,98,125,24,5,153,94,0,0 // vbroadcastss 0x5e99(%rip),%ymm8 # 7a04 <_sk_callback_avx+0x264>
.byte 197,60,194,202,2 // vcmpleps %ymm2,%ymm8,%ymm9
.byte 197,92,89,210 // vmulps %ymm2,%ymm4,%ymm10
.byte 196,65,92,92,218 // vsubps %ymm10,%ymm4,%ymm11
@@ -19899,23 +19667,23 @@ _sk_hsl_to_rgb_avx:
.byte 197,52,88,210 // vaddps %ymm2,%ymm9,%ymm10
.byte 197,108,88,202 // vaddps %ymm2,%ymm2,%ymm9
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,29,23,96,0,0 // vbroadcastss 0x6017(%rip),%ymm11 # 7bac <_sk_callback_avx+0x268>
+ .byte 196,98,125,24,29,115,94,0,0 // vbroadcastss 0x5e73(%rip),%ymm11 # 7a08 <_sk_callback_avx+0x268>
.byte 196,65,100,88,219 // vaddps %ymm11,%ymm3,%ymm11
.byte 196,67,125,8,227,1 // vroundps $0x1,%ymm11,%ymm12
.byte 196,65,36,92,252 // vsubps %ymm12,%ymm11,%ymm15
.byte 196,65,44,92,217 // vsubps %ymm9,%ymm10,%ymm11
- .byte 196,98,125,24,37,1,96,0,0 // vbroadcastss 0x6001(%rip),%ymm12 # 7bb4 <_sk_callback_avx+0x270>
+ .byte 196,98,125,24,37,93,94,0,0 // vbroadcastss 0x5e5d(%rip),%ymm12 # 7a10 <_sk_callback_avx+0x270>
.byte 196,193,4,89,196 // vmulps %ymm12,%ymm15,%ymm0
- .byte 196,98,125,24,45,247,95,0,0 // vbroadcastss 0x5ff7(%rip),%ymm13 # 7bb8 <_sk_callback_avx+0x274>
+ .byte 196,98,125,24,45,83,94,0,0 // vbroadcastss 0x5e53(%rip),%ymm13 # 7a14 <_sk_callback_avx+0x274>
.byte 197,20,92,240 // vsubps %ymm0,%ymm13,%ymm14
.byte 196,65,36,89,246 // vmulps %ymm14,%ymm11,%ymm14
.byte 196,65,52,88,246 // vaddps %ymm14,%ymm9,%ymm14
- .byte 196,226,125,24,13,216,95,0,0 // vbroadcastss 0x5fd8(%rip),%ymm1 # 7bb0 <_sk_callback_avx+0x26c>
+ .byte 196,226,125,24,13,52,94,0,0 // vbroadcastss 0x5e34(%rip),%ymm1 # 7a0c <_sk_callback_avx+0x26c>
.byte 196,193,116,194,255,2 // vcmpleps %ymm15,%ymm1,%ymm7
.byte 196,195,13,74,249,112 // vblendvps %ymm7,%ymm9,%ymm14,%ymm7
.byte 196,65,60,194,247,2 // vcmpleps %ymm15,%ymm8,%ymm14
.byte 196,227,45,74,255,224 // vblendvps %ymm14,%ymm7,%ymm10,%ymm7
- .byte 196,98,125,24,53,195,95,0,0 // vbroadcastss 0x5fc3(%rip),%ymm14 # 7bbc <_sk_callback_avx+0x278>
+ .byte 196,98,125,24,53,31,94,0,0 // vbroadcastss 0x5e1f(%rip),%ymm14 # 7a18 <_sk_callback_avx+0x278>
.byte 196,65,12,194,255,2 // vcmpleps %ymm15,%ymm14,%ymm15
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,180,88,192 // vaddps %ymm0,%ymm9,%ymm0
@@ -19934,7 +19702,7 @@ _sk_hsl_to_rgb_avx:
.byte 197,164,89,247 // vmulps %ymm7,%ymm11,%ymm6
.byte 197,180,88,246 // vaddps %ymm6,%ymm9,%ymm6
.byte 196,227,77,74,237,0 // vblendvps %ymm0,%ymm5,%ymm6,%ymm5
- .byte 196,226,125,24,5,101,95,0,0 // vbroadcastss 0x5f65(%rip),%ymm0 # 7bc0 <_sk_callback_avx+0x27c>
+ .byte 196,226,125,24,5,193,93,0,0 // vbroadcastss 0x5dc1(%rip),%ymm0 # 7a1c <_sk_callback_avx+0x27c>
.byte 197,228,88,192 // vaddps %ymm0,%ymm3,%ymm0
.byte 196,227,125,8,216,1 // vroundps $0x1,%ymm0,%ymm3
.byte 197,252,92,195 // vsubps %ymm3,%ymm0,%ymm0
@@ -19986,13 +19754,13 @@ _sk_scale_u8_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,74 // jne 1d52 <_sk_scale_u8_avx+0x54>
.byte 196,66,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm8
- .byte 197,57,219,5,138,98,0,0 // vpand 0x628a(%rip),%xmm8,%xmm8 # 7fa0 <_sk_callback_avx+0x65c>
+ .byte 197,57,219,5,218,96,0,0 // vpand 0x60da(%rip),%xmm8,%xmm8 # 7df0 <_sk_callback_avx+0x650>
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 196,65,57,105,201 // vpunpckhwd %xmm9,%xmm8,%xmm9
.byte 196,66,121,51,192 // vpmovzxwd %xmm8,%xmm8
.byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,139,94,0,0 // vbroadcastss 0x5e8b(%rip),%ymm9 # 7bc4 <_sk_callback_avx+0x280>
+ .byte 196,98,125,24,13,231,92,0,0 // vbroadcastss 0x5ce7(%rip),%ymm9 # 7a20 <_sk_callback_avx+0x280>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 197,188,89,201 // vmulps %ymm1,%ymm8,%ymm1
@@ -20041,7 +19809,7 @@ _sk_scale_u8_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 233,255,255,255,222 // jmpq ffffffffdf001dfc <_sk_callback_avx+0xffffffffdeffa4b8>
+ .byte 233,255,255,255,222 // jmpq ffffffffdf001dfc <_sk_callback_avx+0xffffffffdeffa65c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,211 // callq *%rbx
@@ -20082,13 +19850,13 @@ _sk_lerp_u8_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,110 // jne 1ebf <_sk_lerp_u8_avx+0x78>
.byte 196,66,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm8
- .byte 197,57,219,5,81,97,0,0 // vpand 0x6151(%rip),%xmm8,%xmm8 # 7fb0 <_sk_callback_avx+0x66c>
+ .byte 197,57,219,5,161,95,0,0 // vpand 0x5fa1(%rip),%xmm8,%xmm8 # 7e00 <_sk_callback_avx+0x660>
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 196,65,57,105,201 // vpunpckhwd %xmm9,%xmm8,%xmm9
.byte 196,66,121,51,192 // vpmovzxwd %xmm8,%xmm8
.byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,13,70,93,0,0 // vbroadcastss 0x5d46(%rip),%ymm9 # 7bc8 <_sk_callback_avx+0x284>
+ .byte 196,98,125,24,13,162,91,0,0 // vbroadcastss 0x5ba2(%rip),%ymm9 # 7a24 <_sk_callback_avx+0x284>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
@@ -20144,7 +19912,7 @@ _sk_lerp_u8_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 233,255,255,255,222 // jmpq ffffffffdf001f6c <_sk_callback_avx+0xffffffffdeffa628>
+ .byte 233,255,255,255,222 // jmpq ffffffffdf001f6c <_sk_callback_avx+0xffffffffdeffa7cc>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,211 // callq *%rbx
@@ -20168,20 +19936,20 @@ _sk_lerp_565_avx:
.byte 196,65,57,105,201 // vpunpckhwd %xmm9,%xmm8,%xmm9
.byte 196,66,121,51,192 // vpmovzxwd %xmm8,%xmm8
.byte 196,67,61,24,193,1 // vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,34,92,0,0 // vbroadcastss 0x5c22(%rip),%ymm9 # 7bcc <_sk_callback_avx+0x288>
+ .byte 196,98,125,24,13,126,90,0,0 // vbroadcastss 0x5a7e(%rip),%ymm9 # 7a28 <_sk_callback_avx+0x288>
.byte 196,65,60,84,201 // vandps %ymm9,%ymm8,%ymm9
.byte 196,65,124,91,201 // vcvtdq2ps %ymm9,%ymm9
- .byte 196,98,125,24,21,19,92,0,0 // vbroadcastss 0x5c13(%rip),%ymm10 # 7bd0 <_sk_callback_avx+0x28c>
+ .byte 196,98,125,24,21,111,90,0,0 // vbroadcastss 0x5a6f(%rip),%ymm10 # 7a2c <_sk_callback_avx+0x28c>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,9,92,0,0 // vbroadcastss 0x5c09(%rip),%ymm10 # 7bd4 <_sk_callback_avx+0x290>
+ .byte 196,98,125,24,21,101,90,0,0 // vbroadcastss 0x5a65(%rip),%ymm10 # 7a30 <_sk_callback_avx+0x290>
.byte 196,65,60,84,210 // vandps %ymm10,%ymm8,%ymm10
.byte 196,65,124,91,210 // vcvtdq2ps %ymm10,%ymm10
- .byte 196,98,125,24,29,250,91,0,0 // vbroadcastss 0x5bfa(%rip),%ymm11 # 7bd8 <_sk_callback_avx+0x294>
+ .byte 196,98,125,24,29,86,90,0,0 // vbroadcastss 0x5a56(%rip),%ymm11 # 7a34 <_sk_callback_avx+0x294>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
- .byte 196,98,125,24,29,240,91,0,0 // vbroadcastss 0x5bf0(%rip),%ymm11 # 7bdc <_sk_callback_avx+0x298>
+ .byte 196,98,125,24,29,76,90,0,0 // vbroadcastss 0x5a4c(%rip),%ymm11 # 7a38 <_sk_callback_avx+0x298>
.byte 196,65,60,84,195 // vandps %ymm11,%ymm8,%ymm8
.byte 196,65,124,91,192 // vcvtdq2ps %ymm8,%ymm8
- .byte 196,98,125,24,29,225,91,0,0 // vbroadcastss 0x5be1(%rip),%ymm11 # 7be0 <_sk_callback_avx+0x29c>
+ .byte 196,98,125,24,29,61,90,0,0 // vbroadcastss 0x5a3d(%rip),%ymm11 # 7a3c <_sk_callback_avx+0x29c>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 197,252,92,196 // vsubps %ymm4,%ymm0,%ymm0
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
@@ -20261,7 +20029,7 @@ _sk_load_tables_avx:
.byte 77,133,192 // test %r8,%r8
.byte 15,133,248,1,0,0 // jne 2314 <_sk_load_tables_avx+0x218>
.byte 196,65,124,16,18 // vmovups (%r10),%ymm10
- .byte 197,124,40,13,55,96,0,0 // vmovaps 0x6037(%rip),%ymm9 # 8160 <_sk_callback_avx+0x81c>
+ .byte 197,124,40,13,151,94,0,0 // vmovaps 0x5e97(%rip),%ymm9 # 7fc0 <_sk_callback_avx+0x820>
.byte 196,193,44,84,201 // vandps %ymm9,%ymm10,%ymm1
.byte 196,227,125,25,200,1 // vextractf128 $0x1,%ymm1,%xmm0
.byte 196,193,249,126,195 // vmovq %xmm0,%r11
@@ -20353,7 +20121,7 @@ _sk_load_tables_avx:
.byte 196,193,65,114,208,24 // vpsrld $0x18,%xmm8,%xmm7
.byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,226,125,24,61,226,88,0,0 // vbroadcastss 0x58e2(%rip),%ymm7 # 7be4 <_sk_callback_avx+0x2a0>
+ .byte 196,226,125,24,61,62,87,0,0 // vbroadcastss 0x573e(%rip),%ymm7 # 7a40 <_sk_callback_avx+0x2a0>
.byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -20367,9 +20135,9 @@ _sk_load_tables_avx:
.byte 73,211,235 // shr %cl,%r11
.byte 196,193,249,110,195 // vmovq %r11,%xmm0
.byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0
- .byte 196,226,121,0,13,132,92,0,0 // vpshufb 0x5c84(%rip),%xmm0,%xmm1 # 7fc0 <_sk_callback_avx+0x67c>
+ .byte 196,226,121,0,13,212,90,0,0 // vpshufb 0x5ad4(%rip),%xmm0,%xmm1 # 7e10 <_sk_callback_avx+0x670>
.byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1
- .byte 196,226,121,0,5,134,92,0,0 // vpshufb 0x5c86(%rip),%xmm0,%xmm0 # 7fd0 <_sk_callback_avx+0x68c>
+ .byte 196,226,121,0,5,214,90,0,0 // vpshufb 0x5ad6(%rip),%xmm0,%xmm0 # 7e20 <_sk_callback_avx+0x680>
.byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 196,66,125,44,18 // vmaskmovps (%r10),%ymm0,%ymm10
@@ -20399,7 +20167,7 @@ _sk_load_tables_u16_be_avx:
.byte 197,113,105,219 // vpunpckhwd %xmm3,%xmm1,%xmm11
.byte 197,177,108,200 // vpunpcklqdq %xmm0,%xmm9,%xmm1
.byte 197,49,109,224 // vpunpckhqdq %xmm0,%xmm9,%xmm12
- .byte 197,121,111,21,24,92,0,0 // vmovdqa 0x5c18(%rip),%xmm10 # 7fe0 <_sk_callback_avx+0x69c>
+ .byte 197,121,111,21,104,90,0,0 // vmovdqa 0x5a68(%rip),%xmm10 # 7e30 <_sk_callback_avx+0x690>
.byte 196,193,113,219,202 // vpand %xmm10,%xmm1,%xmm1
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 196,193,113,105,209 // vpunpckhwd %xmm9,%xmm1,%xmm2
@@ -20497,7 +20265,7 @@ _sk_load_tables_u16_be_avx:
.byte 196,226,121,51,219 // vpmovzxwd %xmm3,%xmm3
.byte 196,227,101,24,223,1 // vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,226,125,24,61,39,86,0,0 // vbroadcastss 0x5627(%rip),%ymm7 # 7be8 <_sk_callback_avx+0x2a4>
+ .byte 196,226,125,24,61,131,84,0,0 // vbroadcastss 0x5483(%rip),%ymm7 # 7a44 <_sk_callback_avx+0x2a4>
.byte 197,228,89,223 // vmulps %ymm7,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7
@@ -20560,7 +20328,7 @@ _sk_load_tables_rgb_u16_be_avx:
.byte 197,185,108,218 // vpunpcklqdq %xmm2,%xmm8,%xmm3
.byte 197,57,109,218 // vpunpckhqdq %xmm2,%xmm8,%xmm11
.byte 197,121,108,193 // vpunpcklqdq %xmm1,%xmm0,%xmm8
- .byte 197,121,111,13,29,89,0,0 // vmovdqa 0x591d(%rip),%xmm9 # 7ff0 <_sk_callback_avx+0x6ac>
+ .byte 197,121,111,13,109,87,0,0 // vmovdqa 0x576d(%rip),%xmm9 # 7e40 <_sk_callback_avx+0x6a0>
.byte 196,193,97,219,193 // vpand %xmm9,%xmm3,%xmm0
.byte 196,65,41,239,210 // vpxor %xmm10,%xmm10,%xmm10
.byte 196,193,121,105,202 // vpunpckhwd %xmm10,%xmm0,%xmm1
@@ -20650,7 +20418,7 @@ _sk_load_tables_rgb_u16_be_avx:
.byte 196,195,105,33,211,48 // vinsertps $0x30,%xmm11,%xmm2,%xmm2
.byte 196,227,109,24,211,1 // vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,74,83,0,0 // vbroadcastss 0x534a(%rip),%ymm3 # 7bec <_sk_callback_avx+0x2a8>
+ .byte 196,226,125,24,29,166,81,0,0 // vbroadcastss 0x51a6(%rip),%ymm3 # 7a48 <_sk_callback_avx+0x2a8>
.byte 197,252,16,116,36,168 // vmovups -0x58(%rsp),%ymm6
.byte 197,252,16,124,36,200 // vmovups -0x38(%rsp),%ymm7
.byte 255,224 // jmpq *%rax
@@ -20693,7 +20461,7 @@ HIDDEN _sk_byte_tables_avx
FUNCTION(_sk_byte_tables_avx)
_sk_byte_tables_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,134,82,0,0 // vbroadcastss 0x5286(%rip),%ymm8 # 7bf0 <_sk_callback_avx+0x2ac>
+ .byte 196,98,125,24,5,226,80,0,0 // vbroadcastss 0x50e2(%rip),%ymm8 # 7a4c <_sk_callback_avx+0x2ac>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,125,91,200 // vcvtps2dq %ymm0,%ymm9
.byte 196,65,249,126,201 // vmovq %xmm9,%r9
@@ -20812,7 +20580,7 @@ _sk_byte_tables_avx:
.byte 196,194,121,49,204 // vpmovzxbd %xmm12,%xmm1
.byte 196,194,121,49,213 // vpmovzxbd %xmm13,%xmm2
.byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- .byte 196,98,125,24,13,48,80,0,0 // vbroadcastss 0x5030(%rip),%ymm9 # 7bf4 <_sk_callback_avx+0x2b0>
+ .byte 196,98,125,24,13,140,78,0,0 // vbroadcastss 0x4e8c(%rip),%ymm9 # 7a50 <_sk_callback_avx+0x2b0>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
.byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
@@ -20928,7 +20696,7 @@ _sk_byte_tables_rgb_avx:
.byte 196,194,121,49,203 // vpmovzxbd %xmm11,%xmm1
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,17,78,0,0 // vbroadcastss 0x4e11(%rip),%ymm9 # 7bf8 <_sk_callback_avx+0x2b4>
+ .byte 196,98,125,24,13,109,76,0,0 // vbroadcastss 0x4c6d(%rip),%ymm9 # 7a54 <_sk_callback_avx+0x2b4>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,194,121,49,202 // vpmovzxbd %xmm10,%xmm1
.byte 196,194,121,49,212 // vpmovzxbd %xmm12,%xmm2
@@ -21133,36 +20901,36 @@ _sk_parametric_r_avx:
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,216 // vcvtdq2ps %ymm0,%ymm11
- .byte 196,98,125,24,37,190,74,0,0 // vbroadcastss 0x4abe(%rip),%ymm12 # 7bfc <_sk_callback_avx+0x2b8>
+ .byte 196,98,125,24,37,26,73,0,0 // vbroadcastss 0x491a(%rip),%ymm12 # 7a58 <_sk_callback_avx+0x2b8>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,180,74,0,0 // vbroadcastss 0x4ab4(%rip),%ymm12 # 7c00 <_sk_callback_avx+0x2bc>
+ .byte 196,98,125,24,37,16,73,0,0 // vbroadcastss 0x4910(%rip),%ymm12 # 7a5c <_sk_callback_avx+0x2bc>
.byte 196,193,124,84,196 // vandps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,170,74,0,0 // vbroadcastss 0x4aaa(%rip),%ymm12 # 7c04 <_sk_callback_avx+0x2c0>
+ .byte 196,98,125,24,37,6,73,0,0 // vbroadcastss 0x4906(%rip),%ymm12 # 7a60 <_sk_callback_avx+0x2c0>
.byte 196,193,124,86,196 // vorps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,160,74,0,0 // vbroadcastss 0x4aa0(%rip),%ymm12 # 7c08 <_sk_callback_avx+0x2c4>
+ .byte 196,98,125,24,37,252,72,0,0 // vbroadcastss 0x48fc(%rip),%ymm12 # 7a64 <_sk_callback_avx+0x2c4>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,150,74,0,0 // vbroadcastss 0x4a96(%rip),%ymm12 # 7c0c <_sk_callback_avx+0x2c8>
+ .byte 196,98,125,24,37,242,72,0,0 // vbroadcastss 0x48f2(%rip),%ymm12 # 7a68 <_sk_callback_avx+0x2c8>
.byte 196,65,124,89,228 // vmulps %ymm12,%ymm0,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,135,74,0,0 // vbroadcastss 0x4a87(%rip),%ymm12 # 7c10 <_sk_callback_avx+0x2cc>
+ .byte 196,98,125,24,37,227,72,0,0 // vbroadcastss 0x48e3(%rip),%ymm12 # 7a6c <_sk_callback_avx+0x2cc>
.byte 196,193,124,88,196 // vaddps %ymm12,%ymm0,%ymm0
- .byte 196,98,125,24,37,125,74,0,0 // vbroadcastss 0x4a7d(%rip),%ymm12 # 7c14 <_sk_callback_avx+0x2d0>
+ .byte 196,98,125,24,37,217,72,0,0 // vbroadcastss 0x48d9(%rip),%ymm12 # 7a70 <_sk_callback_avx+0x2d0>
.byte 197,156,94,192 // vdivps %ymm0,%ymm12,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
.byte 197,172,89,192 // vmulps %ymm0,%ymm10,%ymm0
.byte 196,99,125,8,208,1 // vroundps $0x1,%ymm0,%ymm10
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,97,74,0,0 // vbroadcastss 0x4a61(%rip),%ymm11 # 7c18 <_sk_callback_avx+0x2d4>
+ .byte 196,98,125,24,29,189,72,0,0 // vbroadcastss 0x48bd(%rip),%ymm11 # 7a74 <_sk_callback_avx+0x2d4>
.byte 196,193,124,88,195 // vaddps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,87,74,0,0 // vbroadcastss 0x4a57(%rip),%ymm11 # 7c1c <_sk_callback_avx+0x2d8>
+ .byte 196,98,125,24,29,179,72,0,0 // vbroadcastss 0x48b3(%rip),%ymm11 # 7a78 <_sk_callback_avx+0x2d8>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,124,92,195 // vsubps %ymm11,%ymm0,%ymm0
- .byte 196,98,125,24,29,72,74,0,0 // vbroadcastss 0x4a48(%rip),%ymm11 # 7c20 <_sk_callback_avx+0x2dc>
+ .byte 196,98,125,24,29,164,72,0,0 // vbroadcastss 0x48a4(%rip),%ymm11 # 7a7c <_sk_callback_avx+0x2dc>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,62,74,0,0 // vbroadcastss 0x4a3e(%rip),%ymm11 # 7c24 <_sk_callback_avx+0x2e0>
+ .byte 196,98,125,24,29,154,72,0,0 // vbroadcastss 0x489a(%rip),%ymm11 # 7a80 <_sk_callback_avx+0x2e0>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,124,88,194 // vaddps %ymm10,%ymm0,%ymm0
- .byte 196,98,125,24,21,47,74,0,0 // vbroadcastss 0x4a2f(%rip),%ymm10 # 7c28 <_sk_callback_avx+0x2e4>
+ .byte 196,98,125,24,21,139,72,0,0 // vbroadcastss 0x488b(%rip),%ymm10 # 7a84 <_sk_callback_avx+0x2e4>
.byte 196,193,124,89,194 // vmulps %ymm10,%ymm0,%ymm0
.byte 197,253,91,192 // vcvtps2dq %ymm0,%ymm0
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -21170,7 +20938,7 @@ _sk_parametric_r_avx:
.byte 196,195,125,74,193,128 // vblendvps %ymm8,%ymm9,%ymm0,%ymm0
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,124,95,192 // vmaxps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,6,74,0,0 // vbroadcastss 0x4a06(%rip),%ymm8 # 7c2c <_sk_callback_avx+0x2e8>
+ .byte 196,98,125,24,5,98,72,0,0 // vbroadcastss 0x4862(%rip),%ymm8 # 7a88 <_sk_callback_avx+0x2e8>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -21192,36 +20960,36 @@ _sk_parametric_g_avx:
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,217 // vcvtdq2ps %ymm1,%ymm11
- .byte 196,98,125,24,37,183,73,0,0 // vbroadcastss 0x49b7(%rip),%ymm12 # 7c30 <_sk_callback_avx+0x2ec>
+ .byte 196,98,125,24,37,19,72,0,0 // vbroadcastss 0x4813(%rip),%ymm12 # 7a8c <_sk_callback_avx+0x2ec>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,173,73,0,0 // vbroadcastss 0x49ad(%rip),%ymm12 # 7c34 <_sk_callback_avx+0x2f0>
+ .byte 196,98,125,24,37,9,72,0,0 // vbroadcastss 0x4809(%rip),%ymm12 # 7a90 <_sk_callback_avx+0x2f0>
.byte 196,193,116,84,204 // vandps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,163,73,0,0 // vbroadcastss 0x49a3(%rip),%ymm12 # 7c38 <_sk_callback_avx+0x2f4>
+ .byte 196,98,125,24,37,255,71,0,0 // vbroadcastss 0x47ff(%rip),%ymm12 # 7a94 <_sk_callback_avx+0x2f4>
.byte 196,193,116,86,204 // vorps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,153,73,0,0 // vbroadcastss 0x4999(%rip),%ymm12 # 7c3c <_sk_callback_avx+0x2f8>
+ .byte 196,98,125,24,37,245,71,0,0 // vbroadcastss 0x47f5(%rip),%ymm12 # 7a98 <_sk_callback_avx+0x2f8>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,143,73,0,0 // vbroadcastss 0x498f(%rip),%ymm12 # 7c40 <_sk_callback_avx+0x2fc>
+ .byte 196,98,125,24,37,235,71,0,0 // vbroadcastss 0x47eb(%rip),%ymm12 # 7a9c <_sk_callback_avx+0x2fc>
.byte 196,65,116,89,228 // vmulps %ymm12,%ymm1,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,128,73,0,0 // vbroadcastss 0x4980(%rip),%ymm12 # 7c44 <_sk_callback_avx+0x300>
+ .byte 196,98,125,24,37,220,71,0,0 // vbroadcastss 0x47dc(%rip),%ymm12 # 7aa0 <_sk_callback_avx+0x300>
.byte 196,193,116,88,204 // vaddps %ymm12,%ymm1,%ymm1
- .byte 196,98,125,24,37,118,73,0,0 // vbroadcastss 0x4976(%rip),%ymm12 # 7c48 <_sk_callback_avx+0x304>
+ .byte 196,98,125,24,37,210,71,0,0 // vbroadcastss 0x47d2(%rip),%ymm12 # 7aa4 <_sk_callback_avx+0x304>
.byte 197,156,94,201 // vdivps %ymm1,%ymm12,%ymm1
.byte 197,164,92,201 // vsubps %ymm1,%ymm11,%ymm1
.byte 197,172,89,201 // vmulps %ymm1,%ymm10,%ymm1
.byte 196,99,125,8,209,1 // vroundps $0x1,%ymm1,%ymm10
.byte 196,65,116,92,210 // vsubps %ymm10,%ymm1,%ymm10
- .byte 196,98,125,24,29,90,73,0,0 // vbroadcastss 0x495a(%rip),%ymm11 # 7c4c <_sk_callback_avx+0x308>
+ .byte 196,98,125,24,29,182,71,0,0 // vbroadcastss 0x47b6(%rip),%ymm11 # 7aa8 <_sk_callback_avx+0x308>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,80,73,0,0 // vbroadcastss 0x4950(%rip),%ymm11 # 7c50 <_sk_callback_avx+0x30c>
+ .byte 196,98,125,24,29,172,71,0,0 // vbroadcastss 0x47ac(%rip),%ymm11 # 7aac <_sk_callback_avx+0x30c>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,116,92,203 // vsubps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,29,65,73,0,0 // vbroadcastss 0x4941(%rip),%ymm11 # 7c54 <_sk_callback_avx+0x310>
+ .byte 196,98,125,24,29,157,71,0,0 // vbroadcastss 0x479d(%rip),%ymm11 # 7ab0 <_sk_callback_avx+0x310>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,55,73,0,0 // vbroadcastss 0x4937(%rip),%ymm11 # 7c58 <_sk_callback_avx+0x314>
+ .byte 196,98,125,24,29,147,71,0,0 // vbroadcastss 0x4793(%rip),%ymm11 # 7ab4 <_sk_callback_avx+0x314>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,116,88,202 // vaddps %ymm10,%ymm1,%ymm1
- .byte 196,98,125,24,21,40,73,0,0 // vbroadcastss 0x4928(%rip),%ymm10 # 7c5c <_sk_callback_avx+0x318>
+ .byte 196,98,125,24,21,132,71,0,0 // vbroadcastss 0x4784(%rip),%ymm10 # 7ab8 <_sk_callback_avx+0x318>
.byte 196,193,116,89,202 // vmulps %ymm10,%ymm1,%ymm1
.byte 197,253,91,201 // vcvtps2dq %ymm1,%ymm1
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -21229,7 +20997,7 @@ _sk_parametric_g_avx:
.byte 196,195,117,74,201,128 // vblendvps %ymm8,%ymm9,%ymm1,%ymm1
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,116,95,200 // vmaxps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,5,255,72,0,0 // vbroadcastss 0x48ff(%rip),%ymm8 # 7c60 <_sk_callback_avx+0x31c>
+ .byte 196,98,125,24,5,91,71,0,0 // vbroadcastss 0x475b(%rip),%ymm8 # 7abc <_sk_callback_avx+0x31c>
.byte 196,193,116,93,200 // vminps %ymm8,%ymm1,%ymm1
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -21251,36 +21019,36 @@ _sk_parametric_b_avx:
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,218 // vcvtdq2ps %ymm2,%ymm11
- .byte 196,98,125,24,37,176,72,0,0 // vbroadcastss 0x48b0(%rip),%ymm12 # 7c64 <_sk_callback_avx+0x320>
+ .byte 196,98,125,24,37,12,71,0,0 // vbroadcastss 0x470c(%rip),%ymm12 # 7ac0 <_sk_callback_avx+0x320>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,166,72,0,0 // vbroadcastss 0x48a6(%rip),%ymm12 # 7c68 <_sk_callback_avx+0x324>
+ .byte 196,98,125,24,37,2,71,0,0 // vbroadcastss 0x4702(%rip),%ymm12 # 7ac4 <_sk_callback_avx+0x324>
.byte 196,193,108,84,212 // vandps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,156,72,0,0 // vbroadcastss 0x489c(%rip),%ymm12 # 7c6c <_sk_callback_avx+0x328>
+ .byte 196,98,125,24,37,248,70,0,0 // vbroadcastss 0x46f8(%rip),%ymm12 # 7ac8 <_sk_callback_avx+0x328>
.byte 196,193,108,86,212 // vorps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,146,72,0,0 // vbroadcastss 0x4892(%rip),%ymm12 # 7c70 <_sk_callback_avx+0x32c>
+ .byte 196,98,125,24,37,238,70,0,0 // vbroadcastss 0x46ee(%rip),%ymm12 # 7acc <_sk_callback_avx+0x32c>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,136,72,0,0 // vbroadcastss 0x4888(%rip),%ymm12 # 7c74 <_sk_callback_avx+0x330>
+ .byte 196,98,125,24,37,228,70,0,0 // vbroadcastss 0x46e4(%rip),%ymm12 # 7ad0 <_sk_callback_avx+0x330>
.byte 196,65,108,89,228 // vmulps %ymm12,%ymm2,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,121,72,0,0 // vbroadcastss 0x4879(%rip),%ymm12 # 7c78 <_sk_callback_avx+0x334>
+ .byte 196,98,125,24,37,213,70,0,0 // vbroadcastss 0x46d5(%rip),%ymm12 # 7ad4 <_sk_callback_avx+0x334>
.byte 196,193,108,88,212 // vaddps %ymm12,%ymm2,%ymm2
- .byte 196,98,125,24,37,111,72,0,0 // vbroadcastss 0x486f(%rip),%ymm12 # 7c7c <_sk_callback_avx+0x338>
+ .byte 196,98,125,24,37,203,70,0,0 // vbroadcastss 0x46cb(%rip),%ymm12 # 7ad8 <_sk_callback_avx+0x338>
.byte 197,156,94,210 // vdivps %ymm2,%ymm12,%ymm2
.byte 197,164,92,210 // vsubps %ymm2,%ymm11,%ymm2
.byte 197,172,89,210 // vmulps %ymm2,%ymm10,%ymm2
.byte 196,99,125,8,210,1 // vroundps $0x1,%ymm2,%ymm10
.byte 196,65,108,92,210 // vsubps %ymm10,%ymm2,%ymm10
- .byte 196,98,125,24,29,83,72,0,0 // vbroadcastss 0x4853(%rip),%ymm11 # 7c80 <_sk_callback_avx+0x33c>
+ .byte 196,98,125,24,29,175,70,0,0 // vbroadcastss 0x46af(%rip),%ymm11 # 7adc <_sk_callback_avx+0x33c>
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,73,72,0,0 // vbroadcastss 0x4849(%rip),%ymm11 # 7c84 <_sk_callback_avx+0x340>
+ .byte 196,98,125,24,29,165,70,0,0 // vbroadcastss 0x46a5(%rip),%ymm11 # 7ae0 <_sk_callback_avx+0x340>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,108,92,211 // vsubps %ymm11,%ymm2,%ymm2
- .byte 196,98,125,24,29,58,72,0,0 // vbroadcastss 0x483a(%rip),%ymm11 # 7c88 <_sk_callback_avx+0x344>
+ .byte 196,98,125,24,29,150,70,0,0 // vbroadcastss 0x4696(%rip),%ymm11 # 7ae4 <_sk_callback_avx+0x344>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,48,72,0,0 // vbroadcastss 0x4830(%rip),%ymm11 # 7c8c <_sk_callback_avx+0x348>
+ .byte 196,98,125,24,29,140,70,0,0 // vbroadcastss 0x468c(%rip),%ymm11 # 7ae8 <_sk_callback_avx+0x348>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,108,88,210 // vaddps %ymm10,%ymm2,%ymm2
- .byte 196,98,125,24,21,33,72,0,0 // vbroadcastss 0x4821(%rip),%ymm10 # 7c90 <_sk_callback_avx+0x34c>
+ .byte 196,98,125,24,21,125,70,0,0 // vbroadcastss 0x467d(%rip),%ymm10 # 7aec <_sk_callback_avx+0x34c>
.byte 196,193,108,89,210 // vmulps %ymm10,%ymm2,%ymm2
.byte 197,253,91,210 // vcvtps2dq %ymm2,%ymm2
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -21288,7 +21056,7 @@ _sk_parametric_b_avx:
.byte 196,195,109,74,209,128 // vblendvps %ymm8,%ymm9,%ymm2,%ymm2
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,108,95,208 // vmaxps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,248,71,0,0 // vbroadcastss 0x47f8(%rip),%ymm8 # 7c94 <_sk_callback_avx+0x350>
+ .byte 196,98,125,24,5,84,70,0,0 // vbroadcastss 0x4654(%rip),%ymm8 # 7af0 <_sk_callback_avx+0x350>
.byte 196,193,108,93,208 // vminps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -21310,36 +21078,36 @@ _sk_parametric_a_avx:
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
.byte 196,98,125,24,16 // vbroadcastss (%rax),%ymm10
.byte 197,124,91,219 // vcvtdq2ps %ymm3,%ymm11
- .byte 196,98,125,24,37,169,71,0,0 // vbroadcastss 0x47a9(%rip),%ymm12 # 7c98 <_sk_callback_avx+0x354>
+ .byte 196,98,125,24,37,5,70,0,0 // vbroadcastss 0x4605(%rip),%ymm12 # 7af4 <_sk_callback_avx+0x354>
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,159,71,0,0 // vbroadcastss 0x479f(%rip),%ymm12 # 7c9c <_sk_callback_avx+0x358>
+ .byte 196,98,125,24,37,251,69,0,0 // vbroadcastss 0x45fb(%rip),%ymm12 # 7af8 <_sk_callback_avx+0x358>
.byte 196,193,100,84,220 // vandps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,149,71,0,0 // vbroadcastss 0x4795(%rip),%ymm12 # 7ca0 <_sk_callback_avx+0x35c>
+ .byte 196,98,125,24,37,241,69,0,0 // vbroadcastss 0x45f1(%rip),%ymm12 # 7afc <_sk_callback_avx+0x35c>
.byte 196,193,100,86,220 // vorps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,139,71,0,0 // vbroadcastss 0x478b(%rip),%ymm12 # 7ca4 <_sk_callback_avx+0x360>
+ .byte 196,98,125,24,37,231,69,0,0 // vbroadcastss 0x45e7(%rip),%ymm12 # 7b00 <_sk_callback_avx+0x360>
.byte 196,65,36,88,220 // vaddps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,129,71,0,0 // vbroadcastss 0x4781(%rip),%ymm12 # 7ca8 <_sk_callback_avx+0x364>
+ .byte 196,98,125,24,37,221,69,0,0 // vbroadcastss 0x45dd(%rip),%ymm12 # 7b04 <_sk_callback_avx+0x364>
.byte 196,65,100,89,228 // vmulps %ymm12,%ymm3,%ymm12
.byte 196,65,36,92,220 // vsubps %ymm12,%ymm11,%ymm11
- .byte 196,98,125,24,37,114,71,0,0 // vbroadcastss 0x4772(%rip),%ymm12 # 7cac <_sk_callback_avx+0x368>
+ .byte 196,98,125,24,37,206,69,0,0 // vbroadcastss 0x45ce(%rip),%ymm12 # 7b08 <_sk_callback_avx+0x368>
.byte 196,193,100,88,220 // vaddps %ymm12,%ymm3,%ymm3
- .byte 196,98,125,24,37,104,71,0,0 // vbroadcastss 0x4768(%rip),%ymm12 # 7cb0 <_sk_callback_avx+0x36c>
+ .byte 196,98,125,24,37,196,69,0,0 // vbroadcastss 0x45c4(%rip),%ymm12 # 7b0c <_sk_callback_avx+0x36c>
.byte 197,156,94,219 // vdivps %ymm3,%ymm12,%ymm3
.byte 197,164,92,219 // vsubps %ymm3,%ymm11,%ymm3
.byte 197,172,89,219 // vmulps %ymm3,%ymm10,%ymm3
.byte 196,99,125,8,211,1 // vroundps $0x1,%ymm3,%ymm10
.byte 196,65,100,92,210 // vsubps %ymm10,%ymm3,%ymm10
- .byte 196,98,125,24,29,76,71,0,0 // vbroadcastss 0x474c(%rip),%ymm11 # 7cb4 <_sk_callback_avx+0x370>
+ .byte 196,98,125,24,29,168,69,0,0 // vbroadcastss 0x45a8(%rip),%ymm11 # 7b10 <_sk_callback_avx+0x370>
.byte 196,193,100,88,219 // vaddps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,66,71,0,0 // vbroadcastss 0x4742(%rip),%ymm11 # 7cb8 <_sk_callback_avx+0x374>
+ .byte 196,98,125,24,29,158,69,0,0 // vbroadcastss 0x459e(%rip),%ymm11 # 7b14 <_sk_callback_avx+0x374>
.byte 196,65,44,89,219 // vmulps %ymm11,%ymm10,%ymm11
.byte 196,193,100,92,219 // vsubps %ymm11,%ymm3,%ymm3
- .byte 196,98,125,24,29,51,71,0,0 // vbroadcastss 0x4733(%rip),%ymm11 # 7cbc <_sk_callback_avx+0x378>
+ .byte 196,98,125,24,29,143,69,0,0 // vbroadcastss 0x458f(%rip),%ymm11 # 7b18 <_sk_callback_avx+0x378>
.byte 196,65,36,92,210 // vsubps %ymm10,%ymm11,%ymm10
- .byte 196,98,125,24,29,41,71,0,0 // vbroadcastss 0x4729(%rip),%ymm11 # 7cc0 <_sk_callback_avx+0x37c>
+ .byte 196,98,125,24,29,133,69,0,0 // vbroadcastss 0x4585(%rip),%ymm11 # 7b1c <_sk_callback_avx+0x37c>
.byte 196,65,36,94,210 // vdivps %ymm10,%ymm11,%ymm10
.byte 196,193,100,88,218 // vaddps %ymm10,%ymm3,%ymm3
- .byte 196,98,125,24,21,26,71,0,0 // vbroadcastss 0x471a(%rip),%ymm10 # 7cc4 <_sk_callback_avx+0x380>
+ .byte 196,98,125,24,21,118,69,0,0 // vbroadcastss 0x4576(%rip),%ymm10 # 7b20 <_sk_callback_avx+0x380>
.byte 196,193,100,89,218 // vmulps %ymm10,%ymm3,%ymm3
.byte 197,253,91,219 // vcvtps2dq %ymm3,%ymm3
.byte 196,98,125,24,80,20 // vbroadcastss 0x14(%rax),%ymm10
@@ -21347,7 +21115,7 @@ _sk_parametric_a_avx:
.byte 196,195,101,74,217,128 // vblendvps %ymm8,%ymm9,%ymm3,%ymm3
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 196,193,100,95,216 // vmaxps %ymm8,%ymm3,%ymm3
- .byte 196,98,125,24,5,241,70,0,0 // vbroadcastss 0x46f1(%rip),%ymm8 # 7cc8 <_sk_callback_avx+0x384>
+ .byte 196,98,125,24,5,77,69,0,0 // vbroadcastss 0x454d(%rip),%ymm8 # 7b24 <_sk_callback_avx+0x384>
.byte 196,193,100,93,216 // vminps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -21356,31 +21124,31 @@ HIDDEN _sk_lab_to_xyz_avx
.globl _sk_lab_to_xyz_avx
FUNCTION(_sk_lab_to_xyz_avx)
_sk_lab_to_xyz_avx:
- .byte 196,98,125,24,5,227,70,0,0 // vbroadcastss 0x46e3(%rip),%ymm8 # 7ccc <_sk_callback_avx+0x388>
+ .byte 196,98,125,24,5,63,69,0,0 // vbroadcastss 0x453f(%rip),%ymm8 # 7b28 <_sk_callback_avx+0x388>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,217,70,0,0 // vbroadcastss 0x46d9(%rip),%ymm8 # 7cd0 <_sk_callback_avx+0x38c>
+ .byte 196,98,125,24,5,53,69,0,0 // vbroadcastss 0x4535(%rip),%ymm8 # 7b2c <_sk_callback_avx+0x38c>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
- .byte 196,98,125,24,13,207,70,0,0 // vbroadcastss 0x46cf(%rip),%ymm9 # 7cd4 <_sk_callback_avx+0x390>
+ .byte 196,98,125,24,13,43,69,0,0 // vbroadcastss 0x452b(%rip),%ymm9 # 7b30 <_sk_callback_avx+0x390>
.byte 196,193,116,88,201 // vaddps %ymm9,%ymm1,%ymm1
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 196,193,108,88,209 // vaddps %ymm9,%ymm2,%ymm2
- .byte 196,98,125,24,5,187,70,0,0 // vbroadcastss 0x46bb(%rip),%ymm8 # 7cd8 <_sk_callback_avx+0x394>
+ .byte 196,98,125,24,5,23,69,0,0 // vbroadcastss 0x4517(%rip),%ymm8 # 7b34 <_sk_callback_avx+0x394>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,177,70,0,0 // vbroadcastss 0x46b1(%rip),%ymm8 # 7cdc <_sk_callback_avx+0x398>
+ .byte 196,98,125,24,5,13,69,0,0 // vbroadcastss 0x450d(%rip),%ymm8 # 7b38 <_sk_callback_avx+0x398>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,5,167,70,0,0 // vbroadcastss 0x46a7(%rip),%ymm8 # 7ce0 <_sk_callback_avx+0x39c>
+ .byte 196,98,125,24,5,3,69,0,0 // vbroadcastss 0x4503(%rip),%ymm8 # 7b3c <_sk_callback_avx+0x39c>
.byte 196,193,116,89,200 // vmulps %ymm8,%ymm1,%ymm1
.byte 197,252,88,201 // vaddps %ymm1,%ymm0,%ymm1
- .byte 196,98,125,24,5,153,70,0,0 // vbroadcastss 0x4699(%rip),%ymm8 # 7ce4 <_sk_callback_avx+0x3a0>
+ .byte 196,98,125,24,5,245,68,0,0 // vbroadcastss 0x44f5(%rip),%ymm8 # 7b40 <_sk_callback_avx+0x3a0>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 197,252,92,210 // vsubps %ymm2,%ymm0,%ymm2
.byte 197,116,89,193 // vmulps %ymm1,%ymm1,%ymm8
.byte 196,65,116,89,192 // vmulps %ymm8,%ymm1,%ymm8
- .byte 196,98,125,24,13,130,70,0,0 // vbroadcastss 0x4682(%rip),%ymm9 # 7ce8 <_sk_callback_avx+0x3a4>
+ .byte 196,98,125,24,13,222,68,0,0 // vbroadcastss 0x44de(%rip),%ymm9 # 7b44 <_sk_callback_avx+0x3a4>
.byte 196,65,52,194,208,1 // vcmpltps %ymm8,%ymm9,%ymm10
- .byte 196,98,125,24,29,119,70,0,0 // vbroadcastss 0x4677(%rip),%ymm11 # 7cec <_sk_callback_avx+0x3a8>
+ .byte 196,98,125,24,29,211,68,0,0 // vbroadcastss 0x44d3(%rip),%ymm11 # 7b48 <_sk_callback_avx+0x3a8>
.byte 196,193,116,88,203 // vaddps %ymm11,%ymm1,%ymm1
- .byte 196,98,125,24,37,109,70,0,0 // vbroadcastss 0x466d(%rip),%ymm12 # 7cf0 <_sk_callback_avx+0x3ac>
+ .byte 196,98,125,24,37,201,68,0,0 // vbroadcastss 0x44c9(%rip),%ymm12 # 7b4c <_sk_callback_avx+0x3ac>
.byte 196,193,116,89,204 // vmulps %ymm12,%ymm1,%ymm1
.byte 196,67,117,74,192,160 // vblendvps %ymm10,%ymm8,%ymm1,%ymm8
.byte 197,252,89,200 // vmulps %ymm0,%ymm0,%ymm1
@@ -21395,9 +21163,9 @@ _sk_lab_to_xyz_avx:
.byte 196,193,108,88,211 // vaddps %ymm11,%ymm2,%ymm2
.byte 196,193,108,89,212 // vmulps %ymm12,%ymm2,%ymm2
.byte 196,227,109,74,208,144 // vblendvps %ymm9,%ymm0,%ymm2,%ymm2
- .byte 196,226,125,24,5,35,70,0,0 // vbroadcastss 0x4623(%rip),%ymm0 # 7cf4 <_sk_callback_avx+0x3b0>
+ .byte 196,226,125,24,5,127,68,0,0 // vbroadcastss 0x447f(%rip),%ymm0 # 7b50 <_sk_callback_avx+0x3b0>
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,26,70,0,0 // vbroadcastss 0x461a(%rip),%ymm8 # 7cf8 <_sk_callback_avx+0x3b4>
+ .byte 196,98,125,24,5,118,68,0,0 // vbroadcastss 0x4476(%rip),%ymm8 # 7b54 <_sk_callback_avx+0x3b4>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -21411,13 +21179,13 @@ _sk_load_a8_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,66 // jne 3733 <_sk_load_a8_avx+0x4c>
.byte 196,194,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm0
- .byte 197,249,219,5,1,73,0,0 // vpand 0x4901(%rip),%xmm0,%xmm0 # 8000 <_sk_callback_avx+0x6bc>
+ .byte 197,249,219,5,81,71,0,0 // vpand 0x4751(%rip),%xmm0,%xmm0 # 7e50 <_sk_callback_avx+0x6b0>
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,221,69,0,0 // vbroadcastss 0x45dd(%rip),%ymm1 # 7cfc <_sk_callback_avx+0x3b8>
+ .byte 196,226,125,24,13,57,68,0,0 // vbroadcastss 0x4439(%rip),%ymm1 # 7b58 <_sk_callback_avx+0x3b8>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -21487,13 +21255,13 @@ _sk_load_a8_dst_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,66 // jne 3834 <_sk_load_a8_dst_avx+0x4c>
.byte 196,194,121,48,36,19 // vpmovzxbw (%r11,%rdx,1),%xmm4
- .byte 197,217,219,37,16,72,0,0 // vpand 0x4810(%rip),%xmm4,%xmm4 # 8010 <_sk_callback_avx+0x6cc>
+ .byte 197,217,219,37,96,70,0,0 // vpand 0x4660(%rip),%xmm4,%xmm4 # 7e60 <_sk_callback_avx+0x6c0>
.byte 197,209,239,237 // vpxor %xmm5,%xmm5,%xmm5
.byte 197,217,105,237 // vpunpckhwd %xmm5,%xmm4,%xmm5
.byte 196,226,121,51,228 // vpmovzxwd %xmm4,%xmm4
.byte 196,227,93,24,229,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,224,68,0,0 // vbroadcastss 0x44e0(%rip),%ymm5 # 7d00 <_sk_callback_avx+0x3bc>
+ .byte 196,226,125,24,45,60,67,0,0 // vbroadcastss 0x433c(%rip),%ymm5 # 7b5c <_sk_callback_avx+0x3bc>
.byte 197,220,89,253 // vmulps %ymm5,%ymm4,%ymm7
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,220,87,228 // vxorps %ymm4,%ymm4,%ymm4
@@ -21541,7 +21309,7 @@ _sk_load_a8_dst_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 232,255,255,255,221 // callq ffffffffde0038dc <_sk_callback_avx+0xffffffffddffbf98>
+ .byte 232,255,255,255,221 // callq ffffffffde0038dc <_sk_callback_avx+0xffffffffddffc13c>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,210 // callq *%rdx
@@ -21559,7 +21327,7 @@ _sk_gather_a8_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -21596,7 +21364,7 @@ _sk_gather_a8_avx:
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,80,67,0,0 // vbroadcastss 0x4350(%rip),%ymm1 # 7d04 <_sk_callback_avx+0x3c0>
+ .byte 196,226,125,24,13,172,65,0,0 // vbroadcastss 0x41ac(%rip),%ymm1 # 7b60 <_sk_callback_avx+0x3c0>
.byte 197,252,89,217 // vmulps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,87,192 // vxorps %ymm0,%ymm0,%ymm0
@@ -21610,7 +21378,7 @@ FUNCTION(_sk_store_a8_avx)
_sk_store_a8_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,50,67,0,0 // vbroadcastss 0x4332(%rip),%ymm8 # 7d08 <_sk_callback_avx+0x3c4>
+ .byte 196,98,125,24,5,142,65,0,0 // vbroadcastss 0x418e(%rip),%ymm8 # 7b64 <_sk_callback_avx+0x3c4>
.byte 196,65,100,89,192 // vmulps %ymm8,%ymm3,%ymm8
.byte 196,65,125,91,192 // vcvtps2dq %ymm8,%ymm8
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
@@ -21635,13 +21403,13 @@ _sk_store_a8_avx:
.byte 196,67,121,20,4,19,0 // vpextrb $0x0,%xmm8,(%r11,%rdx,1)
.byte 235,202 // jmp 39fb <_sk_store_a8_avx+0x33>
.byte 196,67,121,20,68,19,2,4 // vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
- .byte 196,98,57,0,5,222,69,0,0 // vpshufb 0x45de(%rip),%xmm8,%xmm8 # 8020 <_sk_callback_avx+0x6dc>
+ .byte 196,98,57,0,5,46,68,0,0 // vpshufb 0x442e(%rip),%xmm8,%xmm8 # 7e70 <_sk_callback_avx+0x6d0>
.byte 196,67,121,21,4,19,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,1)
.byte 235,176 // jmp 39fb <_sk_store_a8_avx+0x33>
.byte 196,67,121,20,68,19,6,12 // vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
.byte 196,67,121,20,68,19,5,10 // vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
.byte 196,67,121,20,68,19,4,8 // vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
- .byte 196,98,57,0,5,196,69,0,0 // vpshufb 0x45c4(%rip),%xmm8,%xmm8 # 8030 <_sk_callback_avx+0x6ec>
+ .byte 196,98,57,0,5,20,68,0,0 // vpshufb 0x4414(%rip),%xmm8,%xmm8 # 7e80 <_sk_callback_avx+0x6e0>
.byte 196,65,121,126,4,19 // vmovd %xmm8,(%r11,%rdx,1)
.byte 235,135 // jmp 39fb <_sk_store_a8_avx+0x33>
.byte 180,255 // mov $0xff,%ah
@@ -21673,16 +21441,16 @@ _sk_load_g8_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,71 // jne 3ae1 <_sk_load_g8_avx+0x51>
.byte 196,194,121,48,4,19 // vpmovzxbw (%r11,%rdx,1),%xmm0
- .byte 197,249,219,5,152,69,0,0 // vpand 0x4598(%rip),%xmm0,%xmm0 # 8040 <_sk_callback_avx+0x6fc>
+ .byte 197,249,219,5,232,67,0,0 // vpand 0x43e8(%rip),%xmm0,%xmm0 # 7e90 <_sk_callback_avx+0x6f0>
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,68,66,0,0 // vbroadcastss 0x4244(%rip),%ymm1 # 7d0c <_sk_callback_avx+0x3c8>
+ .byte 196,226,125,24,13,160,64,0,0 // vbroadcastss 0x40a0(%rip),%ymm1 # 7b68 <_sk_callback_avx+0x3c8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,57,66,0,0 // vbroadcastss 0x4239(%rip),%ymm3 # 7d10 <_sk_callback_avx+0x3cc>
+ .byte 196,226,125,24,29,149,64,0,0 // vbroadcastss 0x4095(%rip),%ymm3 # 7b6c <_sk_callback_avx+0x3cc>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
@@ -21727,7 +21495,7 @@ _sk_load_g8_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 233,255,255,255,222 // jmpq ffffffffdf003b88 <_sk_callback_avx+0xffffffffdeffc244>
+ .byte 233,255,255,255,222 // jmpq ffffffffdf003b88 <_sk_callback_avx+0xffffffffdeffc3e8>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,211 // callq *%rbx
@@ -21747,16 +21515,16 @@ _sk_load_g8_dst_avx:
.byte 77,133,192 // test %r8,%r8
.byte 117,71 // jne 3be5 <_sk_load_g8_dst_avx+0x51>
.byte 196,194,121,48,36,19 // vpmovzxbw (%r11,%rdx,1),%xmm4
- .byte 197,217,219,37,164,68,0,0 // vpand 0x44a4(%rip),%xmm4,%xmm4 # 8050 <_sk_callback_avx+0x70c>
+ .byte 197,217,219,37,244,66,0,0 // vpand 0x42f4(%rip),%xmm4,%xmm4 # 7ea0 <_sk_callback_avx+0x700>
.byte 197,209,239,237 // vpxor %xmm5,%xmm5,%xmm5
.byte 197,217,105,237 // vpunpckhwd %xmm5,%xmm4,%xmm5
.byte 196,226,121,51,228 // vpmovzxwd %xmm4,%xmm4
.byte 196,227,93,24,229,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,72,65,0,0 // vbroadcastss 0x4148(%rip),%ymm5 # 7d14 <_sk_callback_avx+0x3d0>
+ .byte 196,226,125,24,45,164,63,0,0 // vbroadcastss 0x3fa4(%rip),%ymm5 # 7b70 <_sk_callback_avx+0x3d0>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,61,61,65,0,0 // vbroadcastss 0x413d(%rip),%ymm7 # 7d18 <_sk_callback_avx+0x3d4>
+ .byte 196,226,125,24,61,153,63,0,0 // vbroadcastss 0x3f99(%rip),%ymm7 # 7b74 <_sk_callback_avx+0x3d4>
.byte 197,252,40,236 // vmovaps %ymm4,%ymm5
.byte 197,252,40,244 // vmovaps %ymm4,%ymm6
.byte 255,224 // jmpq *%rax
@@ -21801,7 +21569,7 @@ _sk_load_g8_dst_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 233,255,255,255,222 // jmpq ffffffffdf003c8c <_sk_callback_avx+0xffffffffdeffc348>
+ .byte 233,255,255,255,222 // jmpq ffffffffdf003c8c <_sk_callback_avx+0xffffffffdeffc4ec>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,211 // callq *%rbx
@@ -21819,7 +21587,7 @@ _sk_gather_g8_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -21856,107 +21624,14 @@ _sk_gather_g8_avx:
.byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,184,63,0,0 // vbroadcastss 0x3fb8(%rip),%ymm1 # 7d1c <_sk_callback_avx+0x3d8>
+ .byte 196,226,125,24,13,20,62,0,0 // vbroadcastss 0x3e14(%rip),%ymm1 # 7b78 <_sk_callback_avx+0x3d8>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,173,63,0,0 // vbroadcastss 0x3fad(%rip),%ymm3 # 7d20 <_sk_callback_avx+0x3dc>
+ .byte 196,226,125,24,29,9,62,0,0 // vbroadcastss 0x3e09(%rip),%ymm3 # 7b7c <_sk_callback_avx+0x3dc>
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
.byte 197,252,40,208 // vmovaps %ymm0,%ymm2
.byte 255,224 // jmpq *%rax
-HIDDEN _sk_gather_i8_avx
-.globl _sk_gather_i8_avx
-FUNCTION(_sk_gather_i8_avx)
-_sk_gather_i8_avx:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,193 // mov %rax,%r9
- .byte 77,133,201 // test %r9,%r9
- .byte 116,5 // je 3d8c <_sk_gather_i8_avx+0xf>
- .byte 76,137,200 // mov %r9,%rax
- .byte 235,2 // jmp 3d8e <_sk_gather_i8_avx+0x11>
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 83 // push %rbx
- .byte 76,139,16 // mov (%rax),%r10
- .byte 197,254,91,209 // vcvttps2dq %ymm1,%ymm2
- .byte 197,249,110,72,16 // vmovd 0x10(%rax),%xmm1
- .byte 197,249,112,217,0 // vpshufd $0x0,%xmm1,%xmm3
- .byte 196,226,97,64,202 // vpmulld %xmm2,%xmm3,%xmm1
- .byte 196,227,125,25,210,1 // vextractf128 $0x1,%ymm2,%xmm2
- .byte 196,226,97,64,210 // vpmulld %xmm2,%xmm3,%xmm2
- .byte 197,254,91,192 // vcvttps2dq %ymm0,%ymm0
- .byte 196,227,125,25,195,1 // vextractf128 $0x1,%ymm0,%xmm3
- .byte 197,233,254,211 // vpaddd %xmm3,%xmm2,%xmm2
- .byte 196,193,249,126,211 // vmovq %xmm2,%r11
- .byte 68,137,216 // mov %r11d,%eax
- .byte 196,195,121,32,28,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
- .byte 196,227,249,22,208,1 // vpextrq $0x1,%xmm2,%rax
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,131,97,32,20,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm3,%xmm2
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,32 // shr $0x20,%rax
- .byte 197,241,254,192 // vpaddd %xmm0,%xmm1,%xmm0
- .byte 196,131,105,32,12,26,2 // vpinsrb $0x2,(%r10,%r11,1),%xmm2,%xmm1
- .byte 196,193,249,126,195 // vmovq %xmm0,%r11
- .byte 196,195,113,32,12,2,3 // vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1
- .byte 68,137,216 // mov %r11d,%eax
- .byte 196,195,121,32,20,2,0 // vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
- .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 73,193,235,32 // shr $0x20,%r11
- .byte 196,131,105,32,4,26,1 // vpinsrb $0x1,(%r10,%r11,1),%xmm2,%xmm0
- .byte 137,216 // mov %ebx,%eax
- .byte 196,195,121,32,4,2,2 // vpinsrb $0x2,(%r10,%rax,1),%xmm0,%xmm0
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 196,226,121,49,201 // vpmovzxbd %xmm1,%xmm1
- .byte 196,195,121,32,4,26,3 // vpinsrb $0x3,(%r10,%rbx,1),%xmm0,%xmm0
- .byte 196,226,121,49,192 // vpmovzxbd %xmm0,%xmm0
- .byte 77,139,89,8 // mov 0x8(%r9),%r11
- .byte 196,193,249,126,194 // vmovq %xmm0,%r10
- .byte 69,137,209 // mov %r10d,%r9d
- .byte 73,193,234,30 // shr $0x1e,%r10
- .byte 196,129,121,110,20,139 // vmovd (%r11,%r9,4),%xmm2
- .byte 196,227,249,22,195,1 // vpextrq $0x1,%xmm0,%rbx
- .byte 196,131,105,34,4,19,1 // vpinsrd $0x1,(%r11,%r10,1),%xmm2,%xmm0
- .byte 137,216 // mov %ebx,%eax
- .byte 196,195,121,34,4,131,2 // vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0
- .byte 196,225,249,126,200 // vmovq %xmm1,%rax
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 196,67,121,34,4,27,3 // vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm8
- .byte 137,195 // mov %eax,%ebx
- .byte 196,193,121,110,4,155 // vmovd (%r11,%rbx,4),%xmm0
- .byte 196,227,249,22,203,1 // vpextrq $0x1,%xmm1,%rbx
- .byte 72,193,232,30 // shr $0x1e,%rax
- .byte 196,195,121,34,4,3,1 // vpinsrd $0x1,(%r11,%rax,1),%xmm0,%xmm0
- .byte 137,216 // mov %ebx,%eax
- .byte 196,195,121,34,4,131,2 // vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 196,195,121,34,28,27,3 // vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm3
- .byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- .byte 197,124,40,21,212,66,0,0 // vmovaps 0x42d4(%rip),%ymm10 # 8180 <_sk_callback_avx+0x83c>
- .byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0
- .byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,102,62,0,0 // vbroadcastss 0x3e66(%rip),%ymm9 # 7d24 <_sk_callback_avx+0x3e0>
- .byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
- .byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1
- .byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2
- .byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- .byte 196,193,116,84,202 // vandps %ymm10,%ymm1,%ymm1
- .byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,193,116,89,201 // vmulps %ymm9,%ymm1,%ymm1
- .byte 196,193,33,114,208,16 // vpsrld $0x10,%xmm8,%xmm11
- .byte 197,233,114,211,16 // vpsrld $0x10,%xmm3,%xmm2
- .byte 196,227,37,24,210,1 // vinsertf128 $0x1,%xmm2,%ymm11,%ymm2
- .byte 196,193,108,84,210 // vandps %ymm10,%ymm2,%ymm2
- .byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,193,108,89,209 // vmulps %ymm9,%ymm2,%ymm2
- .byte 196,193,57,114,208,24 // vpsrld $0x18,%xmm8,%xmm8
- .byte 197,225,114,211,24 // vpsrld $0x18,%xmm3,%xmm3
- .byte 196,227,61,24,219,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm3
- .byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,193,100,89,217 // vmulps %ymm9,%ymm3,%ymm3
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 255,224 // jmpq *%rax
-
HIDDEN _sk_load_565_avx
.globl _sk_load_565_avx
FUNCTION(_sk_load_565_avx)
@@ -21964,72 +21639,73 @@ _sk_load_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,128,0,0,0 // jne 3fae <_sk_load_565_avx+0x8e>
+ .byte 15,133,128,0,0,0 // jne 3e0b <_sk_load_565_avx+0x8e>
.byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- .byte 196,226,125,24,5,216,61,0,0 // vbroadcastss 0x3dd8(%rip),%ymm0 # 7d28 <_sk_callback_avx+0x3e4>
+ .byte 196,226,125,24,5,211,61,0,0 // vbroadcastss 0x3dd3(%rip),%ymm0 # 7b80 <_sk_callback_avx+0x3e0>
.byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,203,61,0,0 // vbroadcastss 0x3dcb(%rip),%ymm1 # 7d2c <_sk_callback_avx+0x3e8>
+ .byte 196,226,125,24,13,198,61,0,0 // vbroadcastss 0x3dc6(%rip),%ymm1 # 7b84 <_sk_callback_avx+0x3e4>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,194,61,0,0 // vbroadcastss 0x3dc2(%rip),%ymm1 # 7d30 <_sk_callback_avx+0x3ec>
+ .byte 196,226,125,24,13,189,61,0,0 // vbroadcastss 0x3dbd(%rip),%ymm1 # 7b88 <_sk_callback_avx+0x3e8>
.byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,181,61,0,0 // vbroadcastss 0x3db5(%rip),%ymm3 # 7d34 <_sk_callback_avx+0x3f0>
+ .byte 196,226,125,24,29,176,61,0,0 // vbroadcastss 0x3db0(%rip),%ymm3 # 7b8c <_sk_callback_avx+0x3ec>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,24,29,172,61,0,0 // vbroadcastss 0x3dac(%rip),%ymm3 # 7d38 <_sk_callback_avx+0x3f4>
+ .byte 196,226,125,24,29,167,61,0,0 // vbroadcastss 0x3da7(%rip),%ymm3 # 7b90 <_sk_callback_avx+0x3f0>
.byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,159,61,0,0 // vbroadcastss 0x3d9f(%rip),%ymm3 # 7d3c <_sk_callback_avx+0x3f8>
+ .byte 196,226,125,24,29,154,61,0,0 // vbroadcastss 0x3d9a(%rip),%ymm3 # 7b94 <_sk_callback_avx+0x3f4>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,148,61,0,0 // vbroadcastss 0x3d94(%rip),%ymm3 # 7d40 <_sk_callback_avx+0x3fc>
+ .byte 196,226,125,24,29,143,61,0,0 // vbroadcastss 0x3d8f(%rip),%ymm3 # 7b98 <_sk_callback_avx+0x3f8>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,7 // and $0x7,%r9b
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,110,255,255,255 // ja 3f34 <_sk_load_565_avx+0x14>
+ .byte 15,135,110,255,255,255 // ja 3d91 <_sk_load_565_avx+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 4034 <_sk_load_565_avx+0x114>
+ .byte 76,141,21,98,0,0,0 // lea 0x62(%rip),%r10 # 3e90 <_sk_load_565_avx+0x113>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,192 // vmovd %eax,%xmm0
- .byte 233,76,255,255,255 // jmpq 3f34 <_sk_load_565_avx+0x14>
+ .byte 233,76,255,255,255 // jmpq 3d91 <_sk_load_565_avx+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,110,12,83 // vmovd (%r11,%rdx,2),%xmm1
.byte 196,227,121,14,193,3 // vpblendw $0x3,%xmm1,%xmm0,%xmm0
- .byte 233,47,255,255,255 // jmpq 3f34 <_sk_load_565_avx+0x14>
+ .byte 233,47,255,255,255 // jmpq 3d91 <_sk_load_565_avx+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,122,126,12,83 // vmovq (%r11,%rdx,2),%xmm1
.byte 196,227,113,14,192,240 // vpblendw $0xf0,%xmm0,%xmm1,%xmm0
- .byte 233,2,255,255,255 // jmpq 3f34 <_sk_load_565_avx+0x14>
- .byte 102,144 // xchg %ax,%ax
- .byte 166 // cmpsb %es:(%rdi),%ds:(%rsi)
+ .byte 233,2,255,255,255 // jmpq 3d91 <_sk_load_565_avx+0x14>
+ .byte 144 // nop
+ .byte 167 // cmpsl %es:(%rdi),%ds:(%rsi)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,192 // inc %eax
+ .byte 255,193 // inc %ecx
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,180,255,255,255,237,255 // pushq -0x120001(%rdi,%rdi,8)
+ .byte 255,181,255,255,255,238 // pushq -0x11000001(%rbp)
.byte 255 // (bad)
- .byte 255,229 // jmpq *%rbp
+ .byte 255 // (bad)
+ .byte 255,230 // jmpq *%rsi
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 221,255 // (bad)
+ .byte 222,255 // fdivrp %st,%st(7)
.byte 255 // (bad)
- .byte 255,209 // callq *%rcx
+ .byte 255,210 // callq *%rdx
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -22041,56 +21717,56 @@ _sk_load_565_dst_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,128,0,0,0 // jne 40de <_sk_load_565_dst_avx+0x8e>
+ .byte 15,133,128,0,0,0 // jne 3f3a <_sk_load_565_dst_avx+0x8e>
.byte 196,193,122,111,36,83 // vmovdqu (%r11,%rdx,2),%xmm4
.byte 197,209,239,237 // vpxor %xmm5,%xmm5,%xmm5
.byte 197,217,105,237 // vpunpckhwd %xmm5,%xmm4,%xmm5
.byte 196,226,121,51,228 // vpmovzxwd %xmm4,%xmm4
.byte 196,227,93,24,245,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm6
- .byte 196,226,125,24,37,196,60,0,0 // vbroadcastss 0x3cc4(%rip),%ymm4 # 7d44 <_sk_callback_avx+0x400>
+ .byte 196,226,125,24,37,192,60,0,0 // vbroadcastss 0x3cc0(%rip),%ymm4 # 7b9c <_sk_callback_avx+0x3fc>
.byte 197,204,84,228 // vandps %ymm4,%ymm6,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,183,60,0,0 // vbroadcastss 0x3cb7(%rip),%ymm5 # 7d48 <_sk_callback_avx+0x404>
+ .byte 196,226,125,24,45,179,60,0,0 // vbroadcastss 0x3cb3(%rip),%ymm5 # 7ba0 <_sk_callback_avx+0x400>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
- .byte 196,226,125,24,45,174,60,0,0 // vbroadcastss 0x3cae(%rip),%ymm5 # 7d4c <_sk_callback_avx+0x408>
+ .byte 196,226,125,24,45,170,60,0,0 // vbroadcastss 0x3caa(%rip),%ymm5 # 7ba4 <_sk_callback_avx+0x404>
.byte 197,204,84,237 // vandps %ymm5,%ymm6,%ymm5
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,125,24,61,161,60,0,0 // vbroadcastss 0x3ca1(%rip),%ymm7 # 7d50 <_sk_callback_avx+0x40c>
+ .byte 196,226,125,24,61,157,60,0,0 // vbroadcastss 0x3c9d(%rip),%ymm7 # 7ba8 <_sk_callback_avx+0x408>
.byte 197,212,89,239 // vmulps %ymm7,%ymm5,%ymm5
- .byte 196,226,125,24,61,152,60,0,0 // vbroadcastss 0x3c98(%rip),%ymm7 # 7d54 <_sk_callback_avx+0x410>
+ .byte 196,226,125,24,61,148,60,0,0 // vbroadcastss 0x3c94(%rip),%ymm7 # 7bac <_sk_callback_avx+0x40c>
.byte 197,204,84,247 // vandps %ymm7,%ymm6,%ymm6
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
- .byte 196,226,125,24,61,139,60,0,0 // vbroadcastss 0x3c8b(%rip),%ymm7 # 7d58 <_sk_callback_avx+0x414>
+ .byte 196,226,125,24,61,135,60,0,0 // vbroadcastss 0x3c87(%rip),%ymm7 # 7bb0 <_sk_callback_avx+0x410>
.byte 197,204,89,247 // vmulps %ymm7,%ymm6,%ymm6
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,61,128,60,0,0 // vbroadcastss 0x3c80(%rip),%ymm7 # 7d5c <_sk_callback_avx+0x418>
+ .byte 196,226,125,24,61,124,60,0,0 // vbroadcastss 0x3c7c(%rip),%ymm7 # 7bb4 <_sk_callback_avx+0x414>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,7 // and $0x7,%r9b
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,110,255,255,255 // ja 4064 <_sk_load_565_dst_avx+0x14>
+ .byte 15,135,110,255,255,255 // ja 3ec0 <_sk_load_565_dst_avx+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 4164 <_sk_load_565_dst_avx+0x114>
+ .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 3fc0 <_sk_load_565_dst_avx+0x114>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,224 // vmovd %eax,%xmm4
- .byte 233,76,255,255,255 // jmpq 4064 <_sk_load_565_dst_avx+0x14>
+ .byte 233,76,255,255,255 // jmpq 3ec0 <_sk_load_565_dst_avx+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,121,110,44,83 // vmovd (%r11,%rdx,2),%xmm5
.byte 196,227,89,14,229,3 // vpblendw $0x3,%xmm5,%xmm4,%xmm4
- .byte 233,47,255,255,255 // jmpq 4064 <_sk_load_565_dst_avx+0x14>
+ .byte 233,47,255,255,255 // jmpq 3ec0 <_sk_load_565_dst_avx+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,122,126,44,83 // vmovq (%r11,%rdx,2),%xmm5
.byte 196,227,81,14,228,240 // vpblendw $0xf0,%xmm4,%xmm5,%xmm4
- .byte 233,2,255,255,255 // jmpq 4064 <_sk_load_565_dst_avx+0x14>
+ .byte 233,2,255,255,255 // jmpq 3ec0 <_sk_load_565_dst_avx+0x14>
.byte 102,144 // xchg %ax,%ax
.byte 166 // cmpsb %es:(%rdi),%ds:(%rsi)
.byte 255 // (bad)
@@ -22118,7 +21794,7 @@ _sk_gather_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -22159,23 +21835,23 @@ _sk_gather_565_avx:
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,209,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- .byte 196,226,125,24,5,14,59,0,0 // vbroadcastss 0x3b0e(%rip),%ymm0 # 7d60 <_sk_callback_avx+0x41c>
+ .byte 196,226,125,24,5,10,59,0,0 // vbroadcastss 0x3b0a(%rip),%ymm0 # 7bb8 <_sk_callback_avx+0x418>
.byte 197,236,84,192 // vandps %ymm0,%ymm2,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,1,59,0,0 // vbroadcastss 0x3b01(%rip),%ymm1 # 7d64 <_sk_callback_avx+0x420>
+ .byte 196,226,125,24,13,253,58,0,0 // vbroadcastss 0x3afd(%rip),%ymm1 # 7bbc <_sk_callback_avx+0x41c>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,248,58,0,0 // vbroadcastss 0x3af8(%rip),%ymm1 # 7d68 <_sk_callback_avx+0x424>
+ .byte 196,226,125,24,13,244,58,0,0 // vbroadcastss 0x3af4(%rip),%ymm1 # 7bc0 <_sk_callback_avx+0x420>
.byte 197,236,84,201 // vandps %ymm1,%ymm2,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,29,235,58,0,0 // vbroadcastss 0x3aeb(%rip),%ymm3 # 7d6c <_sk_callback_avx+0x428>
+ .byte 196,226,125,24,29,231,58,0,0 // vbroadcastss 0x3ae7(%rip),%ymm3 # 7bc4 <_sk_callback_avx+0x424>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
- .byte 196,226,125,24,29,226,58,0,0 // vbroadcastss 0x3ae2(%rip),%ymm3 # 7d70 <_sk_callback_avx+0x42c>
+ .byte 196,226,125,24,29,222,58,0,0 // vbroadcastss 0x3ade(%rip),%ymm3 # 7bc8 <_sk_callback_avx+0x428>
.byte 197,236,84,211 // vandps %ymm3,%ymm2,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,226,125,24,29,213,58,0,0 // vbroadcastss 0x3ad5(%rip),%ymm3 # 7d74 <_sk_callback_avx+0x430>
+ .byte 196,226,125,24,29,209,58,0,0 // vbroadcastss 0x3ad1(%rip),%ymm3 # 7bcc <_sk_callback_avx+0x42c>
.byte 197,236,89,211 // vmulps %ymm3,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,202,58,0,0 // vbroadcastss 0x3aca(%rip),%ymm3 # 7d78 <_sk_callback_avx+0x434>
+ .byte 196,226,125,24,29,198,58,0,0 // vbroadcastss 0x3ac6(%rip),%ymm3 # 7bd0 <_sk_callback_avx+0x430>
.byte 255,224 // jmpq *%rax
HIDDEN _sk_store_565_avx
@@ -22184,14 +21860,14 @@ FUNCTION(_sk_store_565_avx)
_sk_store_565_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,190,58,0,0 // vbroadcastss 0x3abe(%rip),%ymm8 # 7d7c <_sk_callback_avx+0x438>
+ .byte 196,98,125,24,5,186,58,0,0 // vbroadcastss 0x3aba(%rip),%ymm8 # 7bd4 <_sk_callback_avx+0x434>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,41,114,241,11 // vpslld $0xb,%xmm9,%xmm10
.byte 196,67,125,25,201,1 // vextractf128 $0x1,%ymm9,%xmm9
.byte 196,193,49,114,241,11 // vpslld $0xb,%xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- .byte 196,98,125,24,21,151,58,0,0 // vbroadcastss 0x3a97(%rip),%ymm10 # 7d80 <_sk_callback_avx+0x43c>
+ .byte 196,98,125,24,21,147,58,0,0 // vbroadcastss 0x3a93(%rip),%ymm10 # 7bd8 <_sk_callback_avx+0x438>
.byte 196,65,116,89,210 // vmulps %ymm10,%ymm1,%ymm10
.byte 196,65,125,91,210 // vcvtps2dq %ymm10,%ymm10
.byte 196,193,33,114,242,5 // vpslld $0x5,%xmm10,%xmm11
@@ -22205,7 +21881,7 @@ _sk_store_565_avx:
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 4339 <_sk_store_565_avx+0x89>
+ .byte 117,10 // jne 4195 <_sk_store_565_avx+0x89>
.byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -22213,22 +21889,22 @@ _sk_store_565_avx:
.byte 65,128,225,7 // and $0x7,%r9b
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,236 // ja 4335 <_sk_store_565_avx+0x85>
+ .byte 119,236 // ja 4191 <_sk_store_565_avx+0x85>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 4398 <_sk_store_565_avx+0xe8>
+ .byte 76,141,21,68,0,0,0 // lea 0x44(%rip),%r10 # 41f4 <_sk_store_565_avx+0xe8>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- .byte 235,207 // jmp 4335 <_sk_store_565_avx+0x85>
+ .byte 235,207 // jmp 4191 <_sk_store_565_avx+0x85>
.byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
.byte 196,65,121,126,4,83 // vmovd %xmm8,(%r11,%rdx,2)
- .byte 235,191 // jmp 4335 <_sk_store_565_avx+0x85>
+ .byte 235,191 // jmp 4191 <_sk_store_565_avx+0x85>
.byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
.byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
.byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
.byte 196,65,121,214,4,83 // vmovq %xmm8,(%r11,%rdx,2)
- .byte 235,159 // jmp 4335 <_sk_store_565_avx+0x85>
+ .byte 235,159 // jmp 4191 <_sk_store_565_avx+0x85>
.byte 102,144 // xchg %ax,%ax
.byte 197,255,255 // (bad)
.byte 255,214 // callq *%rsi
@@ -22259,31 +21935,31 @@ _sk_load_4444_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,152,0,0,0 // jne 445a <_sk_load_4444_avx+0xa6>
+ .byte 15,133,152,0,0,0 // jne 42b6 <_sk_load_4444_avx+0xa6>
.byte 196,193,122,111,4,83 // vmovdqu (%r11,%rdx,2),%xmm0
.byte 197,241,239,201 // vpxor %xmm1,%xmm1,%xmm1
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- .byte 196,226,125,24,5,160,57,0,0 // vbroadcastss 0x39a0(%rip),%ymm0 # 7d84 <_sk_callback_avx+0x440>
+ .byte 196,226,125,24,5,156,57,0,0 // vbroadcastss 0x399c(%rip),%ymm0 # 7bdc <_sk_callback_avx+0x43c>
.byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,147,57,0,0 // vbroadcastss 0x3993(%rip),%ymm1 # 7d88 <_sk_callback_avx+0x444>
+ .byte 196,226,125,24,13,143,57,0,0 // vbroadcastss 0x398f(%rip),%ymm1 # 7be0 <_sk_callback_avx+0x440>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,138,57,0,0 // vbroadcastss 0x398a(%rip),%ymm1 # 7d8c <_sk_callback_avx+0x448>
+ .byte 196,226,125,24,13,134,57,0,0 // vbroadcastss 0x3986(%rip),%ymm1 # 7be4 <_sk_callback_avx+0x444>
.byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,125,57,0,0 // vbroadcastss 0x397d(%rip),%ymm2 # 7d90 <_sk_callback_avx+0x44c>
+ .byte 196,226,125,24,21,121,57,0,0 // vbroadcastss 0x3979(%rip),%ymm2 # 7be8 <_sk_callback_avx+0x448>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,116,57,0,0 // vbroadcastss 0x3974(%rip),%ymm2 # 7d94 <_sk_callback_avx+0x450>
+ .byte 196,226,125,24,21,112,57,0,0 // vbroadcastss 0x3970(%rip),%ymm2 # 7bec <_sk_callback_avx+0x44c>
.byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,103,57,0,0 // vbroadcastss 0x3967(%rip),%ymm8 # 7d98 <_sk_callback_avx+0x454>
+ .byte 196,98,125,24,5,99,57,0,0 // vbroadcastss 0x3963(%rip),%ymm8 # 7bf0 <_sk_callback_avx+0x450>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,93,57,0,0 // vbroadcastss 0x395d(%rip),%ymm8 # 7d9c <_sk_callback_avx+0x458>
+ .byte 196,98,125,24,5,89,57,0,0 // vbroadcastss 0x3959(%rip),%ymm8 # 7bf4 <_sk_callback_avx+0x454>
.byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,79,57,0,0 // vbroadcastss 0x394f(%rip),%ymm8 # 7da0 <_sk_callback_avx+0x45c>
+ .byte 196,98,125,24,5,75,57,0,0 // vbroadcastss 0x394b(%rip),%ymm8 # 7bf8 <_sk_callback_avx+0x458>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -22292,27 +21968,27 @@ _sk_load_4444_avx:
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,86,255,255,255 // ja 43c8 <_sk_load_4444_avx+0x14>
+ .byte 15,135,86,255,255,255 // ja 4224 <_sk_load_4444_avx+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 44e0 <_sk_load_4444_avx+0x12c>
+ .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 433c <_sk_load_4444_avx+0x12c>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,192 // vmovd %eax,%xmm0
- .byte 233,52,255,255,255 // jmpq 43c8 <_sk_load_4444_avx+0x14>
+ .byte 233,52,255,255,255 // jmpq 4224 <_sk_load_4444_avx+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,110,12,83 // vmovd (%r11,%rdx,2),%xmm1
.byte 196,227,121,14,193,3 // vpblendw $0x3,%xmm1,%xmm0,%xmm0
- .byte 233,23,255,255,255 // jmpq 43c8 <_sk_load_4444_avx+0x14>
+ .byte 233,23,255,255,255 // jmpq 4224 <_sk_load_4444_avx+0x14>
.byte 197,249,239,192 // vpxor %xmm0,%xmm0,%xmm0
.byte 196,193,121,196,68,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,121,196,68,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
.byte 196,193,122,126,12,83 // vmovq (%r11,%rdx,2),%xmm1
.byte 196,227,113,14,192,240 // vpblendw $0xf0,%xmm0,%xmm1,%xmm0
- .byte 233,234,254,255,255 // jmpq 43c8 <_sk_load_4444_avx+0x14>
+ .byte 233,234,254,255,255 // jmpq 4224 <_sk_load_4444_avx+0x14>
.byte 102,144 // xchg %ax,%ax
.byte 166 // cmpsb %es:(%rdi),%ds:(%rsi)
.byte 255 // (bad)
@@ -22340,31 +22016,31 @@ _sk_load_4444_dst_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,152,0,0,0 // jne 45a2 <_sk_load_4444_dst_avx+0xa6>
+ .byte 15,133,152,0,0,0 // jne 43fe <_sk_load_4444_dst_avx+0xa6>
.byte 196,193,122,111,36,83 // vmovdqu (%r11,%rdx,2),%xmm4
.byte 197,209,239,237 // vpxor %xmm5,%xmm5,%xmm5
.byte 197,217,105,237 // vpunpckhwd %xmm5,%xmm4,%xmm5
.byte 196,226,121,51,228 // vpmovzxwd %xmm4,%xmm4
.byte 196,227,93,24,253,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm7
- .byte 196,226,125,24,37,120,56,0,0 // vbroadcastss 0x3878(%rip),%ymm4 # 7da4 <_sk_callback_avx+0x460>
+ .byte 196,226,125,24,37,116,56,0,0 // vbroadcastss 0x3874(%rip),%ymm4 # 7bfc <_sk_callback_avx+0x45c>
.byte 197,196,84,228 // vandps %ymm4,%ymm7,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,226,125,24,45,107,56,0,0 // vbroadcastss 0x386b(%rip),%ymm5 # 7da8 <_sk_callback_avx+0x464>
+ .byte 196,226,125,24,45,103,56,0,0 // vbroadcastss 0x3867(%rip),%ymm5 # 7c00 <_sk_callback_avx+0x460>
.byte 197,220,89,229 // vmulps %ymm5,%ymm4,%ymm4
- .byte 196,226,125,24,45,98,56,0,0 // vbroadcastss 0x3862(%rip),%ymm5 # 7dac <_sk_callback_avx+0x468>
+ .byte 196,226,125,24,45,94,56,0,0 // vbroadcastss 0x385e(%rip),%ymm5 # 7c04 <_sk_callback_avx+0x464>
.byte 197,196,84,237 // vandps %ymm5,%ymm7,%ymm5
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,226,125,24,53,85,56,0,0 // vbroadcastss 0x3855(%rip),%ymm6 # 7db0 <_sk_callback_avx+0x46c>
+ .byte 196,226,125,24,53,81,56,0,0 // vbroadcastss 0x3851(%rip),%ymm6 # 7c08 <_sk_callback_avx+0x468>
.byte 197,212,89,238 // vmulps %ymm6,%ymm5,%ymm5
- .byte 196,226,125,24,53,76,56,0,0 // vbroadcastss 0x384c(%rip),%ymm6 # 7db4 <_sk_callback_avx+0x470>
+ .byte 196,226,125,24,53,72,56,0,0 // vbroadcastss 0x3848(%rip),%ymm6 # 7c0c <_sk_callback_avx+0x46c>
.byte 197,196,84,246 // vandps %ymm6,%ymm7,%ymm6
.byte 197,252,91,246 // vcvtdq2ps %ymm6,%ymm6
- .byte 196,98,125,24,5,63,56,0,0 // vbroadcastss 0x383f(%rip),%ymm8 # 7db8 <_sk_callback_avx+0x474>
+ .byte 196,98,125,24,5,59,56,0,0 // vbroadcastss 0x383b(%rip),%ymm8 # 7c10 <_sk_callback_avx+0x470>
.byte 196,193,76,89,240 // vmulps %ymm8,%ymm6,%ymm6
- .byte 196,98,125,24,5,53,56,0,0 // vbroadcastss 0x3835(%rip),%ymm8 # 7dbc <_sk_callback_avx+0x478>
+ .byte 196,98,125,24,5,49,56,0,0 // vbroadcastss 0x3831(%rip),%ymm8 # 7c14 <_sk_callback_avx+0x474>
.byte 196,193,68,84,248 // vandps %ymm8,%ymm7,%ymm7
.byte 197,252,91,255 // vcvtdq2ps %ymm7,%ymm7
- .byte 196,98,125,24,5,39,56,0,0 // vbroadcastss 0x3827(%rip),%ymm8 # 7dc0 <_sk_callback_avx+0x47c>
+ .byte 196,98,125,24,5,35,56,0,0 // vbroadcastss 0x3823(%rip),%ymm8 # 7c18 <_sk_callback_avx+0x478>
.byte 196,193,68,89,248 // vmulps %ymm8,%ymm7,%ymm7
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -22373,27 +22049,27 @@ _sk_load_4444_dst_avx:
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 15,135,86,255,255,255 // ja 4510 <_sk_load_4444_dst_avx+0x14>
+ .byte 15,135,86,255,255,255 // ja 436c <_sk_load_4444_dst_avx+0x14>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 4628 <_sk_load_4444_dst_avx+0x12c>
+ .byte 76,141,21,99,0,0,0 // lea 0x63(%rip),%r10 # 4484 <_sk_load_4444_dst_avx+0x12c>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 65,15,183,4,83 // movzwl (%r11,%rdx,2),%eax
.byte 197,249,110,224 // vmovd %eax,%xmm4
- .byte 233,52,255,255,255 // jmpq 4510 <_sk_load_4444_dst_avx+0x14>
+ .byte 233,52,255,255,255 // jmpq 436c <_sk_load_4444_dst_avx+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,4,2 // vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,121,110,44,83 // vmovd (%r11,%rdx,2),%xmm5
.byte 196,227,89,14,229,3 // vpblendw $0x3,%xmm5,%xmm4,%xmm4
- .byte 233,23,255,255,255 // jmpq 4510 <_sk_load_4444_dst_avx+0x14>
+ .byte 233,23,255,255,255 // jmpq 436c <_sk_load_4444_dst_avx+0x14>
.byte 197,217,239,228 // vpxor %xmm4,%xmm4,%xmm4
.byte 196,193,89,196,100,83,12,6 // vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,10,5 // vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,89,196,100,83,8,4 // vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
.byte 196,193,122,126,44,83 // vmovq (%r11,%rdx,2),%xmm5
.byte 196,227,81,14,228,240 // vpblendw $0xf0,%xmm4,%xmm5,%xmm4
- .byte 233,234,254,255,255 // jmpq 4510 <_sk_load_4444_dst_avx+0x14>
+ .byte 233,234,254,255,255 // jmpq 436c <_sk_load_4444_dst_avx+0x14>
.byte 102,144 // xchg %ax,%ax
.byte 166 // cmpsb %es:(%rdi),%ds:(%rsi)
.byte 255 // (bad)
@@ -22421,7 +22097,7 @@ _sk_gather_4444_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -22462,25 +22138,25 @@ _sk_gather_4444_avx:
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,217,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- .byte 196,226,125,24,5,174,54,0,0 // vbroadcastss 0x36ae(%rip),%ymm0 # 7dc4 <_sk_callback_avx+0x480>
+ .byte 196,226,125,24,5,170,54,0,0 // vbroadcastss 0x36aa(%rip),%ymm0 # 7c1c <_sk_callback_avx+0x47c>
.byte 197,228,84,192 // vandps %ymm0,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,226,125,24,13,161,54,0,0 // vbroadcastss 0x36a1(%rip),%ymm1 # 7dc8 <_sk_callback_avx+0x484>
+ .byte 196,226,125,24,13,157,54,0,0 // vbroadcastss 0x369d(%rip),%ymm1 # 7c20 <_sk_callback_avx+0x480>
.byte 197,252,89,193 // vmulps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,152,54,0,0 // vbroadcastss 0x3698(%rip),%ymm1 # 7dcc <_sk_callback_avx+0x488>
+ .byte 196,226,125,24,13,148,54,0,0 // vbroadcastss 0x3694(%rip),%ymm1 # 7c24 <_sk_callback_avx+0x484>
.byte 197,228,84,201 // vandps %ymm1,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,226,125,24,21,139,54,0,0 // vbroadcastss 0x368b(%rip),%ymm2 # 7dd0 <_sk_callback_avx+0x48c>
+ .byte 196,226,125,24,21,135,54,0,0 // vbroadcastss 0x3687(%rip),%ymm2 # 7c28 <_sk_callback_avx+0x488>
.byte 197,244,89,202 // vmulps %ymm2,%ymm1,%ymm1
- .byte 196,226,125,24,21,130,54,0,0 // vbroadcastss 0x3682(%rip),%ymm2 # 7dd4 <_sk_callback_avx+0x490>
+ .byte 196,226,125,24,21,126,54,0,0 // vbroadcastss 0x367e(%rip),%ymm2 # 7c2c <_sk_callback_avx+0x48c>
.byte 197,228,84,210 // vandps %ymm2,%ymm3,%ymm2
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
- .byte 196,98,125,24,5,117,54,0,0 // vbroadcastss 0x3675(%rip),%ymm8 # 7dd8 <_sk_callback_avx+0x494>
+ .byte 196,98,125,24,5,113,54,0,0 // vbroadcastss 0x3671(%rip),%ymm8 # 7c30 <_sk_callback_avx+0x490>
.byte 196,193,108,89,208 // vmulps %ymm8,%ymm2,%ymm2
- .byte 196,98,125,24,5,107,54,0,0 // vbroadcastss 0x366b(%rip),%ymm8 # 7ddc <_sk_callback_avx+0x498>
+ .byte 196,98,125,24,5,103,54,0,0 // vbroadcastss 0x3667(%rip),%ymm8 # 7c34 <_sk_callback_avx+0x494>
.byte 196,193,100,84,216 // vandps %ymm8,%ymm3,%ymm3
.byte 197,252,91,219 // vcvtdq2ps %ymm3,%ymm3
- .byte 196,98,125,24,5,93,54,0,0 // vbroadcastss 0x365d(%rip),%ymm8 # 7de0 <_sk_callback_avx+0x49c>
+ .byte 196,98,125,24,5,89,54,0,0 // vbroadcastss 0x3659(%rip),%ymm8 # 7c38 <_sk_callback_avx+0x498>
.byte 196,193,100,89,216 // vmulps %ymm8,%ymm3,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -22491,7 +22167,7 @@ FUNCTION(_sk_store_4444_avx)
_sk_store_4444_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,24 // mov (%rax),%r11
- .byte 196,98,125,24,5,74,54,0,0 // vbroadcastss 0x364a(%rip),%ymm8 # 7de4 <_sk_callback_avx+0x4a0>
+ .byte 196,98,125,24,5,70,54,0,0 // vbroadcastss 0x3646(%rip),%ymm8 # 7c3c <_sk_callback_avx+0x49c>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,193,41,114,241,12 // vpslld $0xc,%xmm9,%xmm10
@@ -22518,7 +22194,7 @@ _sk_store_4444_avx:
.byte 196,67,125,25,193,1 // vextractf128 $0x1,%ymm8,%xmm9
.byte 196,66,57,43,193 // vpackusdw %xmm9,%xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 4833 <_sk_store_4444_avx+0xa7>
+ .byte 117,10 // jne 468f <_sk_store_4444_avx+0xa7>
.byte 196,65,122,127,4,83 // vmovdqu %xmm8,(%r11,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -22526,22 +22202,22 @@ _sk_store_4444_avx:
.byte 65,128,225,7 // and $0x7,%r9b
.byte 65,254,201 // dec %r9b
.byte 65,128,249,6 // cmp $0x6,%r9b
- .byte 119,236 // ja 482f <_sk_store_4444_avx+0xa3>
+ .byte 119,236 // ja 468b <_sk_store_4444_avx+0xa3>
.byte 69,15,182,201 // movzbl %r9b,%r9d
- .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 4890 <_sk_store_4444_avx+0x104>
+ .byte 76,141,21,66,0,0,0 // lea 0x42(%rip),%r10 # 46ec <_sk_store_4444_avx+0x104>
.byte 75,99,4,138 // movslq (%r10,%r9,4),%rax
.byte 76,1,208 // add %r10,%rax
.byte 255,224 // jmpq *%rax
.byte 196,67,121,21,4,83,0 // vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- .byte 235,207 // jmp 482f <_sk_store_4444_avx+0xa3>
+ .byte 235,207 // jmp 468b <_sk_store_4444_avx+0xa3>
.byte 196,67,121,21,68,83,4,2 // vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
.byte 196,65,121,126,4,83 // vmovd %xmm8,(%r11,%rdx,2)
- .byte 235,191 // jmp 482f <_sk_store_4444_avx+0xa3>
+ .byte 235,191 // jmp 468b <_sk_store_4444_avx+0xa3>
.byte 196,67,121,21,68,83,12,6 // vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
.byte 196,67,121,21,68,83,10,5 // vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
.byte 196,67,121,21,68,83,8,4 // vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
.byte 196,65,121,214,4,83 // vmovq %xmm8,(%r11,%rdx,2)
- .byte 235,159 // jmp 482f <_sk_store_4444_avx+0xa3>
+ .byte 235,159 // jmp 468b <_sk_store_4444_avx+0xa3>
.byte 199 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
@@ -22559,7 +22235,7 @@ _sk_store_4444_avx:
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 232,255,255,255,224 // callq ffffffffe10048a8 <_sk_callback_avx+0xffffffffe0ffcf64>
+ .byte 232,255,255,255,224 // callq ffffffffe1004704 <_sk_callback_avx+0xffffffffe0ffcf64>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255 // .byte 0xff
@@ -22573,12 +22249,12 @@ _sk_load_8888_avx:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,137,0,0,0 // jne 494e <_sk_load_8888_avx+0xa2>
+ .byte 15,133,137,0,0,0 // jne 47aa <_sk_load_8888_avx+0xa2>
.byte 196,193,124,16,26 // vmovups (%r10),%ymm3
- .byte 197,124,40,21,206,56,0,0 // vmovaps 0x38ce(%rip),%ymm10 # 81a0 <_sk_callback_avx+0x85c>
+ .byte 197,124,40,21,178,56,0,0 // vmovaps 0x38b2(%rip),%ymm10 # 7fe0 <_sk_callback_avx+0x840>
.byte 196,193,100,84,194 // vandps %ymm10,%ymm3,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,5,4,53,0,0 // vbroadcastss 0x3504(%rip),%ymm8 # 7de8 <_sk_callback_avx+0x4a4>
+ .byte 196,98,125,24,5,0,53,0,0 // vbroadcastss 0x3500(%rip),%ymm8 # 7c40 <_sk_callback_avx+0x4a0>
.byte 196,193,124,89,192 // vmulps %ymm8,%ymm0,%ymm0
.byte 197,241,114,211,8 // vpsrld $0x8,%xmm3,%xmm1
.byte 196,195,125,25,217,1 // vextractf128 $0x1,%ymm3,%xmm9
@@ -22608,13 +22284,13 @@ _sk_load_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0
- .byte 196,226,121,0,13,234,54,0,0 // vpshufb 0x36ea(%rip),%xmm0,%xmm1 # 8060 <_sk_callback_avx+0x71c>
+ .byte 196,226,121,0,13,222,54,0,0 // vpshufb 0x36de(%rip),%xmm0,%xmm1 # 7eb0 <_sk_callback_avx+0x710>
.byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1
- .byte 196,226,121,0,5,236,54,0,0 // vpshufb 0x36ec(%rip),%xmm0,%xmm0 # 8070 <_sk_callback_avx+0x72c>
+ .byte 196,226,121,0,5,224,54,0,0 // vpshufb 0x36e0(%rip),%xmm0,%xmm0 # 7ec0 <_sk_callback_avx+0x720>
.byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
- .byte 233,49,255,255,255 // jmpq 48ca <_sk_load_8888_avx+0x1e>
+ .byte 233,49,255,255,255 // jmpq 4726 <_sk_load_8888_avx+0x1e>
HIDDEN _sk_load_8888_dst_avx
.globl _sk_load_8888_dst_avx
@@ -22625,12 +22301,12 @@ _sk_load_8888_dst_avx:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,137,0,0,0 // jne 4a3b <_sk_load_8888_dst_avx+0xa2>
+ .byte 15,133,137,0,0,0 // jne 4897 <_sk_load_8888_dst_avx+0xa2>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,124,40,21,1,56,0,0 // vmovaps 0x3801(%rip),%ymm10 # 81c0 <_sk_callback_avx+0x87c>
+ .byte 197,124,40,21,229,55,0,0 // vmovaps 0x37e5(%rip),%ymm10 # 8000 <_sk_callback_avx+0x860>
.byte 196,193,68,84,226 // vandps %ymm10,%ymm7,%ymm4
.byte 197,252,91,228 // vcvtdq2ps %ymm4,%ymm4
- .byte 196,98,125,24,5,27,52,0,0 // vbroadcastss 0x341b(%rip),%ymm8 # 7dec <_sk_callback_avx+0x4a8>
+ .byte 196,98,125,24,5,23,52,0,0 // vbroadcastss 0x3417(%rip),%ymm8 # 7c44 <_sk_callback_avx+0x4a4>
.byte 196,193,92,89,224 // vmulps %ymm8,%ymm4,%ymm4
.byte 197,209,114,215,8 // vpsrld $0x8,%xmm7,%xmm5
.byte 196,195,125,25,249,1 // vextractf128 $0x1,%ymm7,%xmm9
@@ -22660,13 +22336,13 @@ _sk_load_8888_dst_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,121,48,228 // vpmovzxbw %xmm4,%xmm4
- .byte 196,226,89,0,45,29,54,0,0 // vpshufb 0x361d(%rip),%xmm4,%xmm5 # 8080 <_sk_callback_avx+0x73c>
+ .byte 196,226,89,0,45,17,54,0,0 // vpshufb 0x3611(%rip),%xmm4,%xmm5 # 7ed0 <_sk_callback_avx+0x730>
.byte 196,226,121,33,237 // vpmovsxbd %xmm5,%xmm5
- .byte 196,226,89,0,37,31,54,0,0 // vpshufb 0x361f(%rip),%xmm4,%xmm4 # 8090 <_sk_callback_avx+0x74c>
+ .byte 196,226,89,0,37,19,54,0,0 // vpshufb 0x3613(%rip),%xmm4,%xmm4 # 7ee0 <_sk_callback_avx+0x740>
.byte 196,226,121,33,228 // vpmovsxbd %xmm4,%xmm4
.byte 196,227,85,24,228,1 // vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
.byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
- .byte 233,49,255,255,255 // jmpq 49b7 <_sk_load_8888_dst_avx+0x1e>
+ .byte 233,49,255,255,255 // jmpq 4813 <_sk_load_8888_dst_avx+0x1e>
HIDDEN _sk_gather_8888_avx
.globl _sk_gather_8888_avx
@@ -22675,7 +22351,7 @@ _sk_gather_8888_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -22705,10 +22381,10 @@ _sk_gather_8888_avx:
.byte 73,193,234,32 // shr $0x20,%r10
.byte 196,131,121,34,28,145,3 // vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3
.byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- .byte 197,124,40,21,175,54,0,0 // vmovaps 0x36af(%rip),%ymm10 # 81e0 <_sk_callback_avx+0x89c>
+ .byte 197,124,40,21,147,54,0,0 // vmovaps 0x3693(%rip),%ymm10 # 8020 <_sk_callback_avx+0x880>
.byte 196,193,124,84,194 // vandps %ymm10,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,13,173,50,0,0 // vbroadcastss 0x32ad(%rip),%ymm9 # 7df0 <_sk_callback_avx+0x4ac>
+ .byte 196,98,125,24,13,169,50,0,0 // vbroadcastss 0x32a9(%rip),%ymm9 # 7c48 <_sk_callback_avx+0x4a8>
.byte 196,193,124,89,193 // vmulps %ymm9,%ymm0,%ymm0
.byte 196,193,113,114,208,8 // vpsrld $0x8,%xmm8,%xmm1
.byte 197,233,114,211,8 // vpsrld $0x8,%xmm3,%xmm2
@@ -22738,7 +22414,7 @@ _sk_store_8888_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
- .byte 196,98,125,24,5,55,50,0,0 // vbroadcastss 0x3237(%rip),%ymm8 # 7df4 <_sk_callback_avx+0x4b0>
+ .byte 196,98,125,24,5,51,50,0,0 // vbroadcastss 0x3233(%rip),%ymm8 # 7c4c <_sk_callback_avx+0x4ac>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -22763,7 +22439,7 @@ _sk_store_8888_avx:
.byte 196,65,45,86,192 // vorpd %ymm8,%ymm10,%ymm8
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 4c4d <_sk_store_8888_avx+0xa9>
+ .byte 117,12 // jne 4aa9 <_sk_store_8888_avx+0xa9>
.byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -22775,13 +22451,13 @@ _sk_store_8888_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,43,52,0,0 // vpshufb 0x342b(%rip),%xmm9,%xmm10 # 80a0 <_sk_callback_avx+0x75c>
+ .byte 196,98,49,0,21,31,52,0,0 // vpshufb 0x341f(%rip),%xmm9,%xmm10 # 7ef0 <_sk_callback_avx+0x750>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,45,52,0,0 // vpshufb 0x342d(%rip),%xmm9,%xmm9 # 80b0 <_sk_callback_avx+0x76c>
+ .byte 196,98,49,0,13,33,52,0,0 // vpshufb 0x3421(%rip),%xmm9,%xmm9 # 7f00 <_sk_callback_avx+0x760>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
.byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
- .byte 235,177 // jmp 4c46 <_sk_store_8888_avx+0xa2>
+ .byte 235,177 // jmp 4aa2 <_sk_store_8888_avx+0xa2>
HIDDEN _sk_store_8888_2d_avx
.globl _sk_store_8888_2d_avx
@@ -22789,12 +22465,12 @@ FUNCTION(_sk_store_8888_2d_avx)
_sk_store_8888_2d_avx:
.byte 73,137,201 // mov %rcx,%r9
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 72,139,72,8 // mov 0x8(%rax),%rcx
+ .byte 72,99,72,8 // movslq 0x8(%rax),%rcx
.byte 73,15,175,201 // imul %r9,%rcx
.byte 72,193,225,2 // shl $0x2,%rcx
.byte 72,3,8 // add (%rax),%rcx
.byte 72,141,4,145 // lea (%rcx,%rdx,4),%rax
- .byte 196,98,125,24,5,66,49,0,0 // vbroadcastss 0x3142(%rip),%ymm8 # 7df8 <_sk_callback_avx+0x4b4>
+ .byte 196,98,125,24,5,62,49,0,0 // vbroadcastss 0x313e(%rip),%ymm8 # 7c50 <_sk_callback_avx+0x4b0>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -22819,7 +22495,7 @@ _sk_store_8888_2d_avx:
.byte 196,65,45,86,192 // vorpd %ymm8,%ymm10,%ymm8
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,11 // jne 4d45 <_sk_store_8888_2d_avx+0xb0>
+ .byte 117,11 // jne 4ba1 <_sk_store_8888_2d_avx+0xb0>
.byte 197,124,17,0 // vmovups %ymm8,(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -22831,13 +22507,13 @@ _sk_store_8888_2d_avx:
.byte 73,211,234 // shr %cl,%r10
.byte 196,65,249,110,202 // vmovq %r10,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,83,51,0,0 // vpshufb 0x3353(%rip),%xmm9,%xmm10 # 80c0 <_sk_callback_avx+0x77c>
+ .byte 196,98,49,0,21,71,51,0,0 // vpshufb 0x3347(%rip),%xmm9,%xmm10 # 7f10 <_sk_callback_avx+0x770>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,85,51,0,0 // vpshufb 0x3355(%rip),%xmm9,%xmm9 # 80d0 <_sk_callback_avx+0x78c>
+ .byte 196,98,49,0,13,73,51,0,0 // vpshufb 0x3349(%rip),%xmm9,%xmm9 # 7f20 <_sk_callback_avx+0x780>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
.byte 196,98,53,46,0 // vmaskmovps %ymm8,%ymm9,(%rax)
- .byte 235,177 // jmp 4d3e <_sk_store_8888_2d_avx+0xa9>
+ .byte 235,177 // jmp 4b9a <_sk_store_8888_2d_avx+0xa9>
HIDDEN _sk_load_bgra_avx
.globl _sk_load_bgra_avx
@@ -22848,12 +22524,12 @@ _sk_load_bgra_avx:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,137,0,0,0 // jne 4e2f <_sk_load_bgra_avx+0xa2>
+ .byte 15,133,137,0,0,0 // jne 4c8b <_sk_load_bgra_avx+0xa2>
.byte 196,193,124,16,26 // vmovups (%r10),%ymm3
- .byte 197,124,40,21,77,52,0,0 // vmovaps 0x344d(%rip),%ymm10 # 8200 <_sk_callback_avx+0x8bc>
+ .byte 197,124,40,21,49,52,0,0 // vmovaps 0x3431(%rip),%ymm10 # 8040 <_sk_callback_avx+0x8a0>
.byte 196,193,100,84,202 // vandps %ymm10,%ymm3,%ymm1
.byte 197,252,91,201 // vcvtdq2ps %ymm1,%ymm1
- .byte 196,98,125,24,5,55,48,0,0 // vbroadcastss 0x3037(%rip),%ymm8 # 7dfc <_sk_callback_avx+0x4b8>
+ .byte 196,98,125,24,5,51,48,0,0 // vbroadcastss 0x3033(%rip),%ymm8 # 7c54 <_sk_callback_avx+0x4b4>
.byte 196,193,116,89,208 // vmulps %ymm8,%ymm1,%ymm2
.byte 197,241,114,211,8 // vpsrld $0x8,%xmm3,%xmm1
.byte 196,195,125,25,217,1 // vextractf128 $0x1,%ymm3,%xmm9
@@ -22883,13 +22559,13 @@ _sk_load_bgra_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,192 // vmovq %rax,%xmm0
.byte 196,226,121,48,192 // vpmovzxbw %xmm0,%xmm0
- .byte 196,226,121,0,13,137,50,0,0 // vpshufb 0x3289(%rip),%xmm0,%xmm1 # 80e0 <_sk_callback_avx+0x79c>
+ .byte 196,226,121,0,13,125,50,0,0 // vpshufb 0x327d(%rip),%xmm0,%xmm1 # 7f30 <_sk_callback_avx+0x790>
.byte 196,226,121,33,201 // vpmovsxbd %xmm1,%xmm1
- .byte 196,226,121,0,5,139,50,0,0 // vpshufb 0x328b(%rip),%xmm0,%xmm0 # 80f0 <_sk_callback_avx+0x7ac>
+ .byte 196,226,121,0,5,127,50,0,0 // vpshufb 0x327f(%rip),%xmm0,%xmm0 # 7f40 <_sk_callback_avx+0x7a0>
.byte 196,226,121,33,192 // vpmovsxbd %xmm0,%xmm0
.byte 196,227,117,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
.byte 196,194,125,44,26 // vmaskmovps (%r10),%ymm0,%ymm3
- .byte 233,49,255,255,255 // jmpq 4dab <_sk_load_bgra_avx+0x1e>
+ .byte 233,49,255,255,255 // jmpq 4c07 <_sk_load_bgra_avx+0x1e>
HIDDEN _sk_load_bgra_dst_avx
.globl _sk_load_bgra_dst_avx
@@ -22900,12 +22576,12 @@ _sk_load_bgra_dst_avx:
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,137,0,0,0 // jne 4f1c <_sk_load_bgra_dst_avx+0xa2>
+ .byte 15,133,137,0,0,0 // jne 4d78 <_sk_load_bgra_dst_avx+0xa2>
.byte 196,193,124,16,58 // vmovups (%r10),%ymm7
- .byte 197,124,40,21,128,51,0,0 // vmovaps 0x3380(%rip),%ymm10 # 8220 <_sk_callback_avx+0x8dc>
+ .byte 197,124,40,21,100,51,0,0 // vmovaps 0x3364(%rip),%ymm10 # 8060 <_sk_callback_avx+0x8c0>
.byte 196,193,68,84,234 // vandps %ymm10,%ymm7,%ymm5
.byte 197,252,91,237 // vcvtdq2ps %ymm5,%ymm5
- .byte 196,98,125,24,5,78,47,0,0 // vbroadcastss 0x2f4e(%rip),%ymm8 # 7e00 <_sk_callback_avx+0x4bc>
+ .byte 196,98,125,24,5,74,47,0,0 // vbroadcastss 0x2f4a(%rip),%ymm8 # 7c58 <_sk_callback_avx+0x4b8>
.byte 196,193,84,89,240 // vmulps %ymm8,%ymm5,%ymm6
.byte 197,209,114,215,8 // vpsrld $0x8,%xmm7,%xmm5
.byte 196,195,125,25,249,1 // vextractf128 $0x1,%ymm7,%xmm9
@@ -22935,13 +22611,13 @@ _sk_load_bgra_dst_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,225,249,110,224 // vmovq %rax,%xmm4
.byte 196,226,121,48,228 // vpmovzxbw %xmm4,%xmm4
- .byte 196,226,89,0,45,188,49,0,0 // vpshufb 0x31bc(%rip),%xmm4,%xmm5 # 8100 <_sk_callback_avx+0x7bc>
+ .byte 196,226,89,0,45,176,49,0,0 // vpshufb 0x31b0(%rip),%xmm4,%xmm5 # 7f50 <_sk_callback_avx+0x7b0>
.byte 196,226,121,33,237 // vpmovsxbd %xmm5,%xmm5
- .byte 196,226,89,0,37,190,49,0,0 // vpshufb 0x31be(%rip),%xmm4,%xmm4 # 8110 <_sk_callback_avx+0x7cc>
+ .byte 196,226,89,0,37,178,49,0,0 // vpshufb 0x31b2(%rip),%xmm4,%xmm4 # 7f60 <_sk_callback_avx+0x7c0>
.byte 196,226,121,33,228 // vpmovsxbd %xmm4,%xmm4
.byte 196,227,85,24,228,1 // vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
.byte 196,194,93,44,58 // vmaskmovps (%r10),%ymm4,%ymm7
- .byte 233,49,255,255,255 // jmpq 4e98 <_sk_load_bgra_dst_avx+0x1e>
+ .byte 233,49,255,255,255 // jmpq 4cf4 <_sk_load_bgra_dst_avx+0x1e>
HIDDEN _sk_gather_bgra_avx
.globl _sk_gather_bgra_avx
@@ -22950,7 +22626,7 @@ _sk_gather_bgra_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -22980,10 +22656,10 @@ _sk_gather_bgra_avx:
.byte 73,193,234,32 // shr $0x20,%r10
.byte 196,131,121,34,28,145,3 // vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3
.byte 196,227,61,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- .byte 197,124,40,13,46,50,0,0 // vmovaps 0x322e(%rip),%ymm9 # 8240 <_sk_callback_avx+0x8fc>
+ .byte 197,124,40,13,18,50,0,0 // vmovaps 0x3212(%rip),%ymm9 # 8080 <_sk_callback_avx+0x8e0>
.byte 196,193,124,84,193 // vandps %ymm9,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,21,224,45,0,0 // vbroadcastss 0x2de0(%rip),%ymm10 # 7e04 <_sk_callback_avx+0x4c0>
+ .byte 196,98,125,24,21,220,45,0,0 // vbroadcastss 0x2ddc(%rip),%ymm10 # 7c5c <_sk_callback_avx+0x4bc>
.byte 196,193,124,89,210 // vmulps %ymm10,%ymm0,%ymm2
.byte 196,193,121,114,208,8 // vpsrld $0x8,%xmm8,%xmm0
.byte 197,241,114,211,8 // vpsrld $0x8,%xmm3,%xmm1
@@ -23013,7 +22689,7 @@ _sk_store_bgra_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
.byte 76,3,16 // add (%rax),%r10
- .byte 196,98,125,24,5,106,45,0,0 // vbroadcastss 0x2d6a(%rip),%ymm8 # 7e08 <_sk_callback_avx+0x4c4>
+ .byte 196,98,125,24,5,102,45,0,0 // vbroadcastss 0x2d66(%rip),%ymm8 # 7c60 <_sk_callback_avx+0x4c0>
.byte 196,65,108,89,200 // vmulps %ymm8,%ymm2,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,65,116,89,208 // vmulps %ymm8,%ymm1,%ymm10
@@ -23038,7 +22714,7 @@ _sk_store_bgra_avx:
.byte 196,65,45,86,192 // vorpd %ymm8,%ymm10,%ymm8
.byte 196,65,53,86,192 // vorpd %ymm8,%ymm9,%ymm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,12 // jne 512e <_sk_store_bgra_avx+0xa9>
+ .byte 117,12 // jne 4f8a <_sk_store_bgra_avx+0xa9>
.byte 196,65,124,17,2 // vmovups %ymm8,(%r10)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,137,201 // mov %r9,%rcx
@@ -23050,13 +22726,13 @@ _sk_store_bgra_avx:
.byte 72,211,232 // shr %cl,%rax
.byte 196,97,249,110,200 // vmovq %rax,%xmm9
.byte 196,66,121,48,201 // vpmovzxbw %xmm9,%xmm9
- .byte 196,98,49,0,21,202,47,0,0 // vpshufb 0x2fca(%rip),%xmm9,%xmm10 # 8120 <_sk_callback_avx+0x7dc>
+ .byte 196,98,49,0,21,190,47,0,0 // vpshufb 0x2fbe(%rip),%xmm9,%xmm10 # 7f70 <_sk_callback_avx+0x7d0>
.byte 196,66,121,33,210 // vpmovsxbd %xmm10,%xmm10
- .byte 196,98,49,0,13,204,47,0,0 // vpshufb 0x2fcc(%rip),%xmm9,%xmm9 # 8130 <_sk_callback_avx+0x7ec>
+ .byte 196,98,49,0,13,192,47,0,0 // vpshufb 0x2fc0(%rip),%xmm9,%xmm9 # 7f80 <_sk_callback_avx+0x7e0>
.byte 196,66,121,33,201 // vpmovsxbd %xmm9,%xmm9
.byte 196,67,45,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
.byte 196,66,53,46,2 // vmaskmovps %ymm8,%ymm9,(%r10)
- .byte 235,177 // jmp 5127 <_sk_store_bgra_avx+0xa2>
+ .byte 235,177 // jmp 4f83 <_sk_store_bgra_avx+0xa2>
HIDDEN _sk_load_f16_avx
.globl _sk_load_f16_avx
@@ -23070,7 +22746,7 @@ _sk_load_f16_avx:
.byte 197,252,17,116,36,192 // vmovups %ymm6,-0x40(%rsp)
.byte 197,252,17,108,36,160 // vmovups %ymm5,-0x60(%rsp)
.byte 197,254,127,100,36,128 // vmovdqu %ymm4,-0x80(%rsp)
- .byte 15,133,141,2,0,0 // jne 542d <_sk_load_f16_avx+0x2b7>
+ .byte 15,133,141,2,0,0 // jne 5289 <_sk_load_f16_avx+0x2b7>
.byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
.byte 197,249,16,84,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm2
.byte 197,249,16,76,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm1
@@ -23088,13 +22764,13 @@ _sk_load_f16_avx:
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- .byte 196,98,125,24,37,19,44,0,0 // vbroadcastss 0x2c13(%rip),%ymm12 # 7e0c <_sk_callback_avx+0x4c8>
+ .byte 196,98,125,24,37,15,44,0,0 // vbroadcastss 0x2c0f(%rip),%ymm12 # 7c64 <_sk_callback_avx+0x4c4>
.byte 196,193,124,84,204 // vandps %ymm12,%ymm0,%ymm1
.byte 197,252,87,193 // vxorps %ymm1,%ymm0,%ymm0
.byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14
- .byte 196,98,121,24,29,255,43,0,0 // vbroadcastss 0x2bff(%rip),%xmm11 # 7e10 <_sk_callback_avx+0x4cc>
+ .byte 196,98,121,24,29,251,43,0,0 // vbroadcastss 0x2bfb(%rip),%xmm11 # 7c68 <_sk_callback_avx+0x4c8>
.byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3
- .byte 196,98,121,24,45,245,43,0,0 // vbroadcastss 0x2bf5(%rip),%xmm13 # 7e14 <_sk_callback_avx+0x4d0>
+ .byte 196,98,121,24,45,241,43,0,0 // vbroadcastss 0x2bf1(%rip),%xmm13 # 7c6c <_sk_callback_avx+0x4cc>
.byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3
.byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10
.byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -23108,7 +22784,7 @@ _sk_load_f16_avx:
.byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
.byte 197,252,86,193 // vorps %ymm1,%ymm0,%ymm0
.byte 196,227,125,25,193,1 // vextractf128 $0x1,%ymm0,%xmm1
- .byte 196,226,121,24,29,171,43,0,0 // vbroadcastss 0x2bab(%rip),%xmm3 # 7e18 <_sk_callback_avx+0x4d4>
+ .byte 196,226,121,24,29,167,43,0,0 // vbroadcastss 0x2ba7(%rip),%xmm3 # 7c70 <_sk_callback_avx+0x4d0>
.byte 197,241,254,203 // vpaddd %xmm3,%xmm1,%xmm1
.byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -23201,29 +22877,29 @@ _sk_load_f16_avx:
.byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,79 // je 548c <_sk_load_f16_avx+0x316>
+ .byte 116,79 // je 52e8 <_sk_load_f16_avx+0x316>
.byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,67 // jb 548c <_sk_load_f16_avx+0x316>
+ .byte 114,67 // jb 52e8 <_sk_load_f16_avx+0x316>
.byte 197,251,16,84,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,68 // je 5499 <_sk_load_f16_avx+0x323>
+ .byte 116,68 // je 52f5 <_sk_load_f16_avx+0x323>
.byte 197,233,22,84,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,56 // jb 5499 <_sk_load_f16_avx+0x323>
+ .byte 114,56 // jb 52f5 <_sk_load_f16_avx+0x323>
.byte 197,251,16,76,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm1
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,70,253,255,255 // je 51b7 <_sk_load_f16_avx+0x41>
+ .byte 15,132,70,253,255,255 // je 5013 <_sk_load_f16_avx+0x41>
.byte 197,241,22,76,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,54,253,255,255 // jb 51b7 <_sk_load_f16_avx+0x41>
+ .byte 15,130,54,253,255,255 // jb 5013 <_sk_load_f16_avx+0x41>
.byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
- .byte 233,43,253,255,255 // jmpq 51b7 <_sk_load_f16_avx+0x41>
+ .byte 233,43,253,255,255 // jmpq 5013 <_sk_load_f16_avx+0x41>
.byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,30,253,255,255 // jmpq 51b7 <_sk_load_f16_avx+0x41>
+ .byte 233,30,253,255,255 // jmpq 5013 <_sk_load_f16_avx+0x41>
.byte 197,241,87,201 // vxorpd %xmm1,%xmm1,%xmm1
- .byte 233,21,253,255,255 // jmpq 51b7 <_sk_load_f16_avx+0x41>
+ .byte 233,21,253,255,255 // jmpq 5013 <_sk_load_f16_avx+0x41>
HIDDEN _sk_load_f16_dst_avx
.globl _sk_load_f16_dst_avx
@@ -23237,7 +22913,7 @@ _sk_load_f16_dst_avx:
.byte 197,252,17,84,36,192 // vmovups %ymm2,-0x40(%rsp)
.byte 197,252,17,76,36,160 // vmovups %ymm1,-0x60(%rsp)
.byte 197,254,127,68,36,128 // vmovdqu %ymm0,-0x80(%rsp)
- .byte 15,133,141,2,0,0 // jne 5759 <_sk_load_f16_dst_avx+0x2b7>
+ .byte 15,133,141,2,0,0 // jne 55b5 <_sk_load_f16_dst_avx+0x2b7>
.byte 197,121,16,4,208 // vmovupd (%rax,%rdx,8),%xmm8
.byte 197,249,16,116,208,16 // vmovupd 0x10(%rax,%rdx,8),%xmm6
.byte 197,249,16,108,208,32 // vmovupd 0x20(%rax,%rdx,8),%xmm5
@@ -23255,13 +22931,13 @@ _sk_load_f16_dst_avx:
.byte 197,217,105,232 // vpunpckhwd %xmm0,%xmm4,%xmm5
.byte 196,226,121,51,228 // vpmovzxwd %xmm4,%xmm4
.byte 196,227,93,24,229,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
- .byte 196,98,125,24,37,247,40,0,0 // vbroadcastss 0x28f7(%rip),%ymm12 # 7e1c <_sk_callback_avx+0x4d8>
+ .byte 196,98,125,24,37,243,40,0,0 // vbroadcastss 0x28f3(%rip),%ymm12 # 7c74 <_sk_callback_avx+0x4d4>
.byte 196,193,92,84,236 // vandps %ymm12,%ymm4,%ymm5
.byte 197,220,87,229 // vxorps %ymm5,%ymm4,%ymm4
.byte 196,195,125,25,230,1 // vextractf128 $0x1,%ymm4,%xmm14
- .byte 196,98,121,24,29,227,40,0,0 // vbroadcastss 0x28e3(%rip),%xmm11 # 7e20 <_sk_callback_avx+0x4dc>
+ .byte 196,98,121,24,29,223,40,0,0 // vbroadcastss 0x28df(%rip),%xmm11 # 7c78 <_sk_callback_avx+0x4d8>
.byte 196,193,8,87,251 // vxorps %xmm11,%xmm14,%xmm7
- .byte 196,98,121,24,45,217,40,0,0 // vbroadcastss 0x28d9(%rip),%xmm13 # 7e24 <_sk_callback_avx+0x4e0>
+ .byte 196,98,121,24,45,213,40,0,0 // vbroadcastss 0x28d5(%rip),%xmm13 # 7c7c <_sk_callback_avx+0x4dc>
.byte 197,145,102,255 // vpcmpgtd %xmm7,%xmm13,%xmm7
.byte 196,65,88,87,211 // vxorps %xmm11,%xmm4,%xmm10
.byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -23275,7 +22951,7 @@ _sk_load_f16_dst_avx:
.byte 196,227,93,24,231,1 // vinsertf128 $0x1,%xmm7,%ymm4,%ymm4
.byte 197,220,86,229 // vorps %ymm5,%ymm4,%ymm4
.byte 196,227,125,25,229,1 // vextractf128 $0x1,%ymm4,%xmm5
- .byte 196,226,121,24,61,143,40,0,0 // vbroadcastss 0x288f(%rip),%xmm7 # 7e28 <_sk_callback_avx+0x4e4>
+ .byte 196,226,121,24,61,139,40,0,0 // vbroadcastss 0x288b(%rip),%xmm7 # 7c80 <_sk_callback_avx+0x4e0>
.byte 197,209,254,239 // vpaddd %xmm7,%xmm5,%xmm5
.byte 197,217,254,231 // vpaddd %xmm7,%xmm4,%xmm4
.byte 196,227,93,24,229,1 // vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
@@ -23368,29 +23044,29 @@ _sk_load_f16_dst_avx:
.byte 197,123,16,4,208 // vmovsd (%rax,%rdx,8),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,79 // je 57b8 <_sk_load_f16_dst_avx+0x316>
+ .byte 116,79 // je 5614 <_sk_load_f16_dst_avx+0x316>
.byte 197,57,22,68,208,8 // vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,67 // jb 57b8 <_sk_load_f16_dst_avx+0x316>
+ .byte 114,67 // jb 5614 <_sk_load_f16_dst_avx+0x316>
.byte 197,251,16,116,208,16 // vmovsd 0x10(%rax,%rdx,8),%xmm6
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,68 // je 57c5 <_sk_load_f16_dst_avx+0x323>
+ .byte 116,68 // je 5621 <_sk_load_f16_dst_avx+0x323>
.byte 197,201,22,116,208,24 // vmovhpd 0x18(%rax,%rdx,8),%xmm6,%xmm6
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,56 // jb 57c5 <_sk_load_f16_dst_avx+0x323>
+ .byte 114,56 // jb 5621 <_sk_load_f16_dst_avx+0x323>
.byte 197,251,16,108,208,32 // vmovsd 0x20(%rax,%rdx,8),%xmm5
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,70,253,255,255 // je 54e3 <_sk_load_f16_dst_avx+0x41>
+ .byte 15,132,70,253,255,255 // je 533f <_sk_load_f16_dst_avx+0x41>
.byte 197,209,22,108,208,40 // vmovhpd 0x28(%rax,%rdx,8),%xmm5,%xmm5
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,54,253,255,255 // jb 54e3 <_sk_load_f16_dst_avx+0x41>
+ .byte 15,130,54,253,255,255 // jb 533f <_sk_load_f16_dst_avx+0x41>
.byte 197,122,126,76,208,48 // vmovq 0x30(%rax,%rdx,8),%xmm9
- .byte 233,43,253,255,255 // jmpq 54e3 <_sk_load_f16_dst_avx+0x41>
+ .byte 233,43,253,255,255 // jmpq 533f <_sk_load_f16_dst_avx+0x41>
.byte 197,209,87,237 // vxorpd %xmm5,%xmm5,%xmm5
.byte 197,201,87,246 // vxorpd %xmm6,%xmm6,%xmm6
- .byte 233,30,253,255,255 // jmpq 54e3 <_sk_load_f16_dst_avx+0x41>
+ .byte 233,30,253,255,255 // jmpq 533f <_sk_load_f16_dst_avx+0x41>
.byte 197,209,87,237 // vxorpd %xmm5,%xmm5,%xmm5
- .byte 233,21,253,255,255 // jmpq 54e3 <_sk_load_f16_dst_avx+0x41>
+ .byte 233,21,253,255,255 // jmpq 533f <_sk_load_f16_dst_avx+0x41>
HIDDEN _sk_gather_f16_avx
.globl _sk_gather_f16_avx
@@ -23404,7 +23080,7 @@ _sk_gather_f16_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 197,254,91,201 // vcvttps2dq %ymm1,%ymm1
- .byte 197,249,110,80,16 // vmovd 0x10(%rax),%xmm2
+ .byte 197,249,110,80,8 // vmovd 0x8(%rax),%xmm2
.byte 197,249,112,210,0 // vpshufd $0x0,%xmm2,%xmm2
.byte 196,226,105,64,217 // vpmulld %xmm1,%xmm2,%xmm3
.byte 196,227,125,25,201,1 // vextractf128 $0x1,%ymm1,%xmm1
@@ -23451,13 +23127,13 @@ _sk_gather_f16_avx:
.byte 197,249,105,201 // vpunpckhwd %xmm1,%xmm0,%xmm1
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- .byte 196,98,125,24,37,84,37,0,0 // vbroadcastss 0x2554(%rip),%ymm12 # 7e2c <_sk_callback_avx+0x4e8>
+ .byte 196,98,125,24,37,80,37,0,0 // vbroadcastss 0x2550(%rip),%ymm12 # 7c84 <_sk_callback_avx+0x4e4>
.byte 196,193,124,84,204 // vandps %ymm12,%ymm0,%ymm1
.byte 197,252,87,193 // vxorps %ymm1,%ymm0,%ymm0
.byte 196,195,125,25,198,1 // vextractf128 $0x1,%ymm0,%xmm14
- .byte 196,98,121,24,29,64,37,0,0 // vbroadcastss 0x2540(%rip),%xmm11 # 7e30 <_sk_callback_avx+0x4ec>
+ .byte 196,98,121,24,29,60,37,0,0 // vbroadcastss 0x253c(%rip),%xmm11 # 7c88 <_sk_callback_avx+0x4e8>
.byte 196,193,8,87,219 // vxorps %xmm11,%xmm14,%xmm3
- .byte 196,98,121,24,45,54,37,0,0 // vbroadcastss 0x2536(%rip),%xmm13 # 7e34 <_sk_callback_avx+0x4f0>
+ .byte 196,98,121,24,45,50,37,0,0 // vbroadcastss 0x2532(%rip),%xmm13 # 7c8c <_sk_callback_avx+0x4ec>
.byte 197,145,102,219 // vpcmpgtd %xmm3,%xmm13,%xmm3
.byte 196,65,120,87,211 // vxorps %xmm11,%xmm0,%xmm10
.byte 196,65,17,102,210 // vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -23471,7 +23147,7 @@ _sk_gather_f16_avx:
.byte 196,227,125,24,195,1 // vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
.byte 197,252,86,193 // vorps %ymm1,%ymm0,%ymm0
.byte 196,227,125,25,193,1 // vextractf128 $0x1,%ymm0,%xmm1
- .byte 196,226,121,24,29,236,36,0,0 // vbroadcastss 0x24ec(%rip),%xmm3 # 7e38 <_sk_callback_avx+0x4f4>
+ .byte 196,226,121,24,29,232,36,0,0 // vbroadcastss 0x24e8(%rip),%xmm3 # 7c90 <_sk_callback_avx+0x4f0>
.byte 197,241,254,203 // vpaddd %xmm3,%xmm1,%xmm1
.byte 197,249,254,195 // vpaddd %xmm3,%xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -23571,12 +23247,12 @@ _sk_store_f16_avx:
.byte 197,252,17,52,36 // vmovups %ymm6,(%rsp)
.byte 197,252,17,108,36,224 // vmovups %ymm5,-0x20(%rsp)
.byte 197,252,17,100,36,192 // vmovups %ymm4,-0x40(%rsp)
- .byte 196,98,125,24,13,12,35,0,0 // vbroadcastss 0x230c(%rip),%ymm9 # 7e3c <_sk_callback_avx+0x4f8>
+ .byte 196,98,125,24,13,8,35,0,0 // vbroadcastss 0x2308(%rip),%ymm9 # 7c94 <_sk_callback_avx+0x4f4>
.byte 196,65,124,84,209 // vandps %ymm9,%ymm0,%ymm10
.byte 197,252,17,68,36,128 // vmovups %ymm0,-0x80(%rsp)
.byte 196,65,124,87,218 // vxorps %ymm10,%ymm0,%ymm11
.byte 196,67,125,25,220,1 // vextractf128 $0x1,%ymm11,%xmm12
- .byte 196,98,121,24,5,241,34,0,0 // vbroadcastss 0x22f1(%rip),%xmm8 # 7e40 <_sk_callback_avx+0x4fc>
+ .byte 196,98,121,24,5,237,34,0,0 // vbroadcastss 0x22ed(%rip),%xmm8 # 7c98 <_sk_callback_avx+0x4f8>
.byte 196,65,57,102,236 // vpcmpgtd %xmm12,%xmm8,%xmm13
.byte 196,65,57,102,243 // vpcmpgtd %xmm11,%xmm8,%xmm14
.byte 196,67,13,24,237,1 // vinsertf128 $0x1,%xmm13,%ymm14,%ymm13
@@ -23586,7 +23262,7 @@ _sk_store_f16_avx:
.byte 196,67,13,24,242,1 // vinsertf128 $0x1,%xmm10,%ymm14,%ymm14
.byte 196,193,33,114,211,13 // vpsrld $0xd,%xmm11,%xmm11
.byte 196,193,25,114,212,13 // vpsrld $0xd,%xmm12,%xmm12
- .byte 196,98,125,24,21,184,34,0,0 // vbroadcastss 0x22b8(%rip),%ymm10 # 7e44 <_sk_callback_avx+0x500>
+ .byte 196,98,125,24,21,180,34,0,0 // vbroadcastss 0x22b4(%rip),%ymm10 # 7c9c <_sk_callback_avx+0x4fc>
.byte 196,65,12,86,242 // vorps %ymm10,%ymm14,%ymm14
.byte 196,67,125,25,247,1 // vextractf128 $0x1,%ymm14,%xmm15
.byte 196,65,1,254,228 // vpaddd %xmm12,%xmm15,%xmm12
@@ -23668,7 +23344,7 @@ _sk_store_f16_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,66 // jne 5d6a <_sk_store_f16_avx+0x25e>
+ .byte 117,66 // jne 5bc6 <_sk_store_f16_avx+0x25e>
.byte 197,120,17,28,208 // vmovups %xmm11,(%rax,%rdx,8)
.byte 197,120,17,84,208,16 // vmovups %xmm10,0x10(%rax,%rdx,8)
.byte 197,120,17,76,208,32 // vmovups %xmm9,0x20(%rax,%rdx,8)
@@ -23684,22 +23360,22 @@ _sk_store_f16_avx:
.byte 255,224 // jmpq *%rax
.byte 197,121,214,28,208 // vmovq %xmm11,(%rax,%rdx,8)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,202 // je 5d3f <_sk_store_f16_avx+0x233>
+ .byte 116,202 // je 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,23,92,208,8 // vmovhpd %xmm11,0x8(%rax,%rdx,8)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,190 // jb 5d3f <_sk_store_f16_avx+0x233>
+ .byte 114,190 // jb 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,214,84,208,16 // vmovq %xmm10,0x10(%rax,%rdx,8)
- .byte 116,182 // je 5d3f <_sk_store_f16_avx+0x233>
+ .byte 116,182 // je 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,23,84,208,24 // vmovhpd %xmm10,0x18(%rax,%rdx,8)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,170 // jb 5d3f <_sk_store_f16_avx+0x233>
+ .byte 114,170 // jb 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,214,76,208,32 // vmovq %xmm9,0x20(%rax,%rdx,8)
- .byte 116,162 // je 5d3f <_sk_store_f16_avx+0x233>
+ .byte 116,162 // je 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,23,76,208,40 // vmovhpd %xmm9,0x28(%rax,%rdx,8)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,150 // jb 5d3f <_sk_store_f16_avx+0x233>
+ .byte 114,150 // jb 5b9b <_sk_store_f16_avx+0x233>
.byte 197,121,214,68,208,48 // vmovq %xmm8,0x30(%rax,%rdx,8)
- .byte 235,142 // jmp 5d3f <_sk_store_f16_avx+0x233>
+ .byte 235,142 // jmp 5b9b <_sk_store_f16_avx+0x233>
HIDDEN _sk_load_u16_be_avx
.globl _sk_load_u16_be_avx
@@ -23709,7 +23385,7 @@ _sk_load_u16_be_avx:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,253,0,0,0 // jne 5ec4 <_sk_load_u16_be_avx+0x113>
+ .byte 15,133,253,0,0,0 // jne 5d20 <_sk_load_u16_be_avx+0x113>
.byte 196,65,121,16,4,65 // vmovupd (%r9,%rax,2),%xmm8
.byte 196,193,121,16,84,65,16 // vmovupd 0x10(%r9,%rax,2),%xmm2
.byte 196,193,121,16,92,65,32 // vmovupd 0x20(%r9,%rax,2),%xmm3
@@ -23731,7 +23407,7 @@ _sk_load_u16_be_avx:
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,29,16,32,0,0 // vbroadcastss 0x2010(%rip),%ymm11 # 7e48 <_sk_callback_avx+0x504>
+ .byte 196,98,125,24,29,12,32,0,0 // vbroadcastss 0x200c(%rip),%ymm11 # 7ca0 <_sk_callback_avx+0x500>
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,177,109,202 // vpunpckhqdq %xmm2,%xmm9,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -23765,29 +23441,29 @@ _sk_load_u16_be_avx:
.byte 196,65,123,16,4,65 // vmovsd (%r9,%rax,2),%xmm8
.byte 196,65,49,239,201 // vpxor %xmm9,%xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,85 // je 5f2a <_sk_load_u16_be_avx+0x179>
+ .byte 116,85 // je 5d86 <_sk_load_u16_be_avx+0x179>
.byte 196,65,57,22,68,65,8 // vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,72 // jb 5f2a <_sk_load_u16_be_avx+0x179>
+ .byte 114,72 // jb 5d86 <_sk_load_u16_be_avx+0x179>
.byte 196,193,123,16,84,65,16 // vmovsd 0x10(%r9,%rax,2),%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 116,72 // je 5f37 <_sk_load_u16_be_avx+0x186>
+ .byte 116,72 // je 5d93 <_sk_load_u16_be_avx+0x186>
.byte 196,193,105,22,84,65,24 // vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,59 // jb 5f37 <_sk_load_u16_be_avx+0x186>
+ .byte 114,59 // jb 5d93 <_sk_load_u16_be_avx+0x186>
.byte 196,193,123,16,92,65,32 // vmovsd 0x20(%r9,%rax,2),%xmm3
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 15,132,213,254,255,255 // je 5de2 <_sk_load_u16_be_avx+0x31>
+ .byte 15,132,213,254,255,255 // je 5c3e <_sk_load_u16_be_avx+0x31>
.byte 196,193,97,22,92,65,40 // vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 15,130,196,254,255,255 // jb 5de2 <_sk_load_u16_be_avx+0x31>
+ .byte 15,130,196,254,255,255 // jb 5c3e <_sk_load_u16_be_avx+0x31>
.byte 196,65,122,126,76,65,48 // vmovq 0x30(%r9,%rax,2),%xmm9
- .byte 233,184,254,255,255 // jmpq 5de2 <_sk_load_u16_be_avx+0x31>
+ .byte 233,184,254,255,255 // jmpq 5c3e <_sk_load_u16_be_avx+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
.byte 197,233,87,210 // vxorpd %xmm2,%xmm2,%xmm2
- .byte 233,171,254,255,255 // jmpq 5de2 <_sk_load_u16_be_avx+0x31>
+ .byte 233,171,254,255,255 // jmpq 5c3e <_sk_load_u16_be_avx+0x31>
.byte 197,225,87,219 // vxorpd %xmm3,%xmm3,%xmm3
- .byte 233,162,254,255,255 // jmpq 5de2 <_sk_load_u16_be_avx+0x31>
+ .byte 233,162,254,255,255 // jmpq 5c3e <_sk_load_u16_be_avx+0x31>
HIDDEN _sk_load_rgb_u16_be_avx
.globl _sk_load_rgb_u16_be_avx
@@ -23797,7 +23473,7 @@ _sk_load_rgb_u16_be_avx:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,243,0,0,0 // jne 6045 <_sk_load_rgb_u16_be_avx+0x105>
+ .byte 15,133,243,0,0,0 // jne 5ea1 <_sk_load_rgb_u16_be_avx+0x105>
.byte 196,193,122,111,4,65 // vmovdqu (%r9,%rax,2),%xmm0
.byte 196,193,122,111,84,65,12 // vmovdqu 0xc(%r9,%rax,2),%xmm2
.byte 196,193,122,111,76,65,24 // vmovdqu 0x18(%r9,%rax,2),%xmm1
@@ -23824,7 +23500,7 @@ _sk_load_rgb_u16_be_avx:
.byte 196,226,121,51,192 // vpmovzxwd %xmm0,%xmm0
.byte 196,227,125,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
.byte 197,252,91,192 // vcvtdq2ps %ymm0,%ymm0
- .byte 196,98,125,24,29,112,30,0,0 // vbroadcastss 0x1e70(%rip),%ymm11 # 7e4c <_sk_callback_avx+0x508>
+ .byte 196,98,125,24,29,108,30,0,0 // vbroadcastss 0x1e6c(%rip),%ymm11 # 7ca4 <_sk_callback_avx+0x504>
.byte 196,193,124,89,195 // vmulps %ymm11,%ymm0,%ymm0
.byte 197,185,109,202 // vpunpckhqdq %xmm2,%xmm8,%xmm1
.byte 197,233,113,241,8 // vpsllw $0x8,%xmm1,%xmm2
@@ -23845,41 +23521,41 @@ _sk_load_rgb_u16_be_avx:
.byte 197,252,91,210 // vcvtdq2ps %ymm2,%ymm2
.byte 196,193,108,89,211 // vmulps %ymm11,%ymm2,%ymm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,29,13,30,0,0 // vbroadcastss 0x1e0d(%rip),%ymm3 # 7e50 <_sk_callback_avx+0x50c>
+ .byte 196,226,125,24,29,9,30,0,0 // vbroadcastss 0x1e09(%rip),%ymm3 # 7ca8 <_sk_callback_avx+0x508>
.byte 255,224 // jmpq *%rax
.byte 196,193,121,110,4,65 // vmovd (%r9,%rax,2),%xmm0
.byte 196,193,121,196,68,65,4,2 // vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,5 // jne 605e <_sk_load_rgb_u16_be_avx+0x11e>
- .byte 233,40,255,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 117,5 // jne 5eba <_sk_load_rgb_u16_be_avx+0x11e>
+ .byte 233,40,255,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
.byte 196,193,121,110,76,65,6 // vmovd 0x6(%r9,%rax,2),%xmm1
.byte 196,65,113,196,68,65,10,2 // vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,26 // jb 608d <_sk_load_rgb_u16_be_avx+0x14d>
+ .byte 114,26 // jb 5ee9 <_sk_load_rgb_u16_be_avx+0x14d>
.byte 196,193,121,110,76,65,12 // vmovd 0xc(%r9,%rax,2),%xmm1
.byte 196,193,113,196,84,65,16,2 // vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 117,10 // jne 6092 <_sk_load_rgb_u16_be_avx+0x152>
- .byte 233,249,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,244,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 117,10 // jne 5eee <_sk_load_rgb_u16_be_avx+0x152>
+ .byte 233,249,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,244,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
.byte 196,193,121,110,76,65,18 // vmovd 0x12(%r9,%rax,2),%xmm1
.byte 196,65,113,196,76,65,22,2 // vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,26 // jb 60c1 <_sk_load_rgb_u16_be_avx+0x181>
+ .byte 114,26 // jb 5f1d <_sk_load_rgb_u16_be_avx+0x181>
.byte 196,193,121,110,76,65,24 // vmovd 0x18(%r9,%rax,2),%xmm1
.byte 196,193,113,196,76,65,28,2 // vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 117,10 // jne 60c6 <_sk_load_rgb_u16_be_avx+0x186>
- .byte 233,197,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,192,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 117,10 // jne 5f22 <_sk_load_rgb_u16_be_avx+0x186>
+ .byte 233,197,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,192,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
.byte 196,193,121,110,92,65,30 // vmovd 0x1e(%r9,%rax,2),%xmm3
.byte 196,65,97,196,92,65,34,2 // vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,20 // jb 60ef <_sk_load_rgb_u16_be_avx+0x1af>
+ .byte 114,20 // jb 5f4b <_sk_load_rgb_u16_be_avx+0x1af>
.byte 196,193,121,110,92,65,36 // vmovd 0x24(%r9,%rax,2),%xmm3
.byte 196,193,97,196,92,65,40,2 // vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
- .byte 233,151,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
- .byte 233,146,254,255,255 // jmpq 5f86 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,151,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
+ .byte 233,146,254,255,255 // jmpq 5de2 <_sk_load_rgb_u16_be_avx+0x46>
HIDDEN _sk_store_u16_be_avx
.globl _sk_store_u16_be_avx
@@ -23888,7 +23564,7 @@ _sk_store_u16_be_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
- .byte 196,98,125,24,5,74,29,0,0 // vbroadcastss 0x1d4a(%rip),%ymm8 # 7e54 <_sk_callback_avx+0x510>
+ .byte 196,98,125,24,5,70,29,0,0 // vbroadcastss 0x1d46(%rip),%ymm8 # 7cac <_sk_callback_avx+0x50c>
.byte 196,65,124,89,200 // vmulps %ymm8,%ymm0,%ymm9
.byte 196,65,125,91,201 // vcvtps2dq %ymm9,%ymm9
.byte 196,67,125,25,202,1 // vextractf128 $0x1,%ymm9,%xmm10
@@ -23926,7 +23602,7 @@ _sk_store_u16_be_avx:
.byte 196,65,17,98,200 // vpunpckldq %xmm8,%xmm13,%xmm9
.byte 196,65,17,106,192 // vpunpckhdq %xmm8,%xmm13,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,31 // jne 61ee <_sk_store_u16_be_avx+0xfa>
+ .byte 117,31 // jne 604a <_sk_store_u16_be_avx+0xfa>
.byte 196,65,120,17,28,65 // vmovups %xmm11,(%r9,%rax,2)
.byte 196,65,120,17,84,65,16 // vmovups %xmm10,0x10(%r9,%rax,2)
.byte 196,65,120,17,76,65,32 // vmovups %xmm9,0x20(%r9,%rax,2)
@@ -23935,22 +23611,22 @@ _sk_store_u16_be_avx:
.byte 255,224 // jmpq *%rax
.byte 196,65,121,214,28,65 // vmovq %xmm11,(%r9,%rax,2)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 116,240 // je 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,23,92,65,8 // vmovhpd %xmm11,0x8(%r9,%rax,2)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 114,227 // jb 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,214,84,65,16 // vmovq %xmm10,0x10(%r9,%rax,2)
- .byte 116,218 // je 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 116,218 // je 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,23,84,65,24 // vmovhpd %xmm10,0x18(%r9,%rax,2)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,205 // jb 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 114,205 // jb 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,214,76,65,32 // vmovq %xmm9,0x20(%r9,%rax,2)
- .byte 116,196 // je 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 116,196 // je 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,23,76,65,40 // vmovhpd %xmm9,0x28(%r9,%rax,2)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,183 // jb 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 114,183 // jb 6046 <_sk_store_u16_be_avx+0xf6>
.byte 196,65,121,214,68,65,48 // vmovq %xmm8,0x30(%r9,%rax,2)
- .byte 235,174 // jmp 61ea <_sk_store_u16_be_avx+0xf6>
+ .byte 235,174 // jmp 6046 <_sk_store_u16_be_avx+0xf6>
HIDDEN _sk_load_f32_avx
.globl _sk_load_f32_avx
@@ -23958,10 +23634,10 @@ FUNCTION(_sk_load_f32_avx)
_sk_load_f32_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 119,110 // ja 62b2 <_sk_load_f32_avx+0x76>
+ .byte 119,110 // ja 610e <_sk_load_f32_avx+0x76>
.byte 76,139,8 // mov (%rax),%r9
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
- .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 62dc <_sk_load_f32_avx+0xa0>
+ .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 6138 <_sk_load_f32_avx+0xa0>
.byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
.byte 76,1,216 // add %r11,%rax
.byte 255,224 // jmpq *%rax
@@ -24010,10 +23686,10 @@ FUNCTION(_sk_load_f32_dst_avx)
_sk_load_f32_dst_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 119,110 // ja 6372 <_sk_load_f32_dst_avx+0x76>
+ .byte 119,110 // ja 61ce <_sk_load_f32_dst_avx+0x76>
.byte 76,139,8 // mov (%rax),%r9
.byte 76,141,20,149,0,0,0,0 // lea 0x0(,%rdx,4),%r10
- .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 639c <_sk_load_f32_dst_avx+0xa0>
+ .byte 76,141,29,134,0,0,0 // lea 0x86(%rip),%r11 # 61f8 <_sk_load_f32_dst_avx+0xa0>
.byte 75,99,4,131 // movslq (%r11,%r8,4),%rax
.byte 76,1,216 // add %r11,%rax
.byte 255,224 // jmpq *%rax
@@ -24072,7 +23748,7 @@ _sk_store_f32_avx:
.byte 196,65,37,20,196 // vunpcklpd %ymm12,%ymm11,%ymm8
.byte 196,65,37,21,220 // vunpckhpd %ymm12,%ymm11,%ymm11
.byte 77,133,192 // test %r8,%r8
- .byte 117,55 // jne 6429 <_sk_store_f32_avx+0x6d>
+ .byte 117,55 // jne 6285 <_sk_store_f32_avx+0x6d>
.byte 196,67,45,24,225,1 // vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
.byte 196,67,61,24,235,1 // vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
.byte 196,67,45,6,201,49 // vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
@@ -24085,22 +23761,22 @@ _sk_store_f32_avx:
.byte 255,224 // jmpq *%rax
.byte 196,65,121,17,20,129 // vmovupd %xmm10,(%r9,%rax,4)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 6425 <_sk_store_f32_avx+0x69>
+ .byte 116,240 // je 6281 <_sk_store_f32_avx+0x69>
.byte 196,65,121,17,76,129,16 // vmovupd %xmm9,0x10(%r9,%rax,4)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 6425 <_sk_store_f32_avx+0x69>
+ .byte 114,227 // jb 6281 <_sk_store_f32_avx+0x69>
.byte 196,65,121,17,68,129,32 // vmovupd %xmm8,0x20(%r9,%rax,4)
- .byte 116,218 // je 6425 <_sk_store_f32_avx+0x69>
+ .byte 116,218 // je 6281 <_sk_store_f32_avx+0x69>
.byte 196,65,121,17,92,129,48 // vmovupd %xmm11,0x30(%r9,%rax,4)
.byte 73,131,248,5 // cmp $0x5,%r8
- .byte 114,205 // jb 6425 <_sk_store_f32_avx+0x69>
+ .byte 114,205 // jb 6281 <_sk_store_f32_avx+0x69>
.byte 196,67,125,25,84,129,64,1 // vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
- .byte 116,195 // je 6425 <_sk_store_f32_avx+0x69>
+ .byte 116,195 // je 6281 <_sk_store_f32_avx+0x69>
.byte 196,67,125,25,76,129,80,1 // vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
.byte 73,131,248,7 // cmp $0x7,%r8
- .byte 114,181 // jb 6425 <_sk_store_f32_avx+0x69>
+ .byte 114,181 // jb 6281 <_sk_store_f32_avx+0x69>
.byte 196,67,125,25,68,129,96,1 // vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
- .byte 235,171 // jmp 6425 <_sk_store_f32_avx+0x69>
+ .byte 235,171 // jmp 6281 <_sk_store_f32_avx+0x69>
HIDDEN _sk_clamp_x_avx
.globl _sk_clamp_x_avx
@@ -24189,7 +23865,7 @@ _sk_mirror_x_avx:
.byte 196,193,58,88,192 // vaddss %xmm8,%xmm8,%xmm0
.byte 196,227,121,4,192,0 // vpermilps $0x0,%xmm0,%xmm0
.byte 196,99,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm8
- .byte 197,178,89,5,187,24,0,0 // vmulss 0x18bb(%rip),%xmm9,%xmm0 # 7e58 <_sk_callback_avx+0x514>
+ .byte 197,178,89,5,183,24,0,0 // vmulss 0x18b7(%rip),%xmm9,%xmm0 # 7cb0 <_sk_callback_avx+0x510>
.byte 196,227,121,4,192,0 // vpermilps $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,164,89,192 // vmulps %ymm0,%ymm11,%ymm0
@@ -24222,7 +23898,7 @@ _sk_mirror_y_avx:
.byte 196,193,58,88,200 // vaddss %xmm8,%xmm8,%xmm1
.byte 196,227,121,4,201,0 // vpermilps $0x0,%xmm1,%xmm1
.byte 196,99,117,24,193,1 // vinsertf128 $0x1,%xmm1,%ymm1,%ymm8
- .byte 197,178,89,13,54,24,0,0 // vmulss 0x1836(%rip),%xmm9,%xmm1 # 7e5c <_sk_callback_avx+0x518>
+ .byte 197,178,89,13,50,24,0,0 // vmulss 0x1832(%rip),%xmm9,%xmm1 # 7cb4 <_sk_callback_avx+0x514>
.byte 196,227,121,4,201,0 // vpermilps $0x0,%xmm1,%xmm1
.byte 196,227,117,24,201,1 // vinsertf128 $0x1,%xmm1,%ymm1,%ymm1
.byte 197,164,89,201 // vmulps %ymm1,%ymm11,%ymm1
@@ -24248,7 +23924,7 @@ FUNCTION(_sk_clamp_x_1_avx)
_sk_clamp_x_1_avx:
.byte 196,65,60,87,192 // vxorps %ymm8,%ymm8,%ymm8
.byte 197,188,95,192 // vmaxps %ymm0,%ymm8,%ymm0
- .byte 196,98,125,24,5,212,23,0,0 // vbroadcastss 0x17d4(%rip),%ymm8 # 7e60 <_sk_callback_avx+0x51c>
+ .byte 196,98,125,24,5,208,23,0,0 // vbroadcastss 0x17d0(%rip),%ymm8 # 7cb8 <_sk_callback_avx+0x518>
.byte 196,193,124,93,192 // vminps %ymm8,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -24266,9 +23942,9 @@ HIDDEN _sk_mirror_x_1_avx
.globl _sk_mirror_x_1_avx
FUNCTION(_sk_mirror_x_1_avx)
_sk_mirror_x_1_avx:
- .byte 196,98,125,24,5,183,23,0,0 // vbroadcastss 0x17b7(%rip),%ymm8 # 7e64 <_sk_callback_avx+0x520>
+ .byte 196,98,125,24,5,179,23,0,0 // vbroadcastss 0x17b3(%rip),%ymm8 # 7cbc <_sk_callback_avx+0x51c>
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,13,173,23,0,0 // vbroadcastss 0x17ad(%rip),%ymm9 # 7e68 <_sk_callback_avx+0x524>
+ .byte 196,98,125,24,13,169,23,0,0 // vbroadcastss 0x17a9(%rip),%ymm9 # 7cc0 <_sk_callback_avx+0x520>
.byte 196,65,124,89,201 // vmulps %ymm9,%ymm0,%ymm9
.byte 196,67,125,8,201,1 // vroundps $0x1,%ymm9,%ymm9
.byte 196,65,52,88,201 // vaddps %ymm9,%ymm9,%ymm9
@@ -24284,12 +23960,12 @@ HIDDEN _sk_luminance_to_alpha_avx
.globl _sk_luminance_to_alpha_avx
FUNCTION(_sk_luminance_to_alpha_avx)
_sk_luminance_to_alpha_avx:
- .byte 196,226,125,24,29,125,23,0,0 // vbroadcastss 0x177d(%rip),%ymm3 # 7e6c <_sk_callback_avx+0x528>
+ .byte 196,226,125,24,29,121,23,0,0 // vbroadcastss 0x1779(%rip),%ymm3 # 7cc4 <_sk_callback_avx+0x524>
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,29,116,23,0,0 // vbroadcastss 0x1774(%rip),%ymm3 # 7e70 <_sk_callback_avx+0x52c>
+ .byte 196,226,125,24,29,112,23,0,0 // vbroadcastss 0x1770(%rip),%ymm3 # 7cc8 <_sk_callback_avx+0x528>
.byte 197,244,89,203 // vmulps %ymm3,%ymm1,%ymm1
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
- .byte 196,226,125,24,13,103,23,0,0 // vbroadcastss 0x1767(%rip),%ymm1 # 7e74 <_sk_callback_avx+0x530>
+ .byte 196,226,125,24,13,99,23,0,0 // vbroadcastss 0x1763(%rip),%ymm1 # 7ccc <_sk_callback_avx+0x52c>
.byte 197,236,89,201 // vmulps %ymm1,%ymm2,%ymm1
.byte 197,252,88,217 // vaddps %ymm1,%ymm0,%ymm3
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -24537,9 +24213,9 @@ _sk_evenly_spaced_gradient_avx:
.byte 72,139,24 // mov (%rax),%rbx
.byte 72,139,104,8 // mov 0x8(%rax),%rbp
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 6ab1 <_sk_evenly_spaced_gradient_avx+0x25>
+ .byte 120,7 // js 690d <_sk_evenly_spaced_gradient_avx+0x25>
.byte 196,225,242,42,203 // vcvtsi2ss %rbx,%xmm1,%xmm1
- .byte 235,21 // jmp 6ac6 <_sk_evenly_spaced_gradient_avx+0x3a>
+ .byte 235,21 // jmp 6922 <_sk_evenly_spaced_gradient_avx+0x3a>
.byte 73,137,217 // mov %rbx,%r9
.byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
@@ -24697,18 +24373,18 @@ HIDDEN _sk_gauss_a_to_rgba_avx
.globl _sk_gauss_a_to_rgba_avx
FUNCTION(_sk_gauss_a_to_rgba_avx)
_sk_gauss_a_to_rgba_avx:
- .byte 196,226,125,24,5,78,16,0,0 // vbroadcastss 0x104e(%rip),%ymm0 # 7e78 <_sk_callback_avx+0x534>
+ .byte 196,226,125,24,5,74,16,0,0 // vbroadcastss 0x104a(%rip),%ymm0 # 7cd0 <_sk_callback_avx+0x530>
.byte 197,228,89,192 // vmulps %ymm0,%ymm3,%ymm0
- .byte 196,226,125,24,13,69,16,0,0 // vbroadcastss 0x1045(%rip),%ymm1 # 7e7c <_sk_callback_avx+0x538>
+ .byte 196,226,125,24,13,65,16,0,0 // vbroadcastss 0x1041(%rip),%ymm1 # 7cd4 <_sk_callback_avx+0x534>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,56,16,0,0 // vbroadcastss 0x1038(%rip),%ymm1 # 7e80 <_sk_callback_avx+0x53c>
+ .byte 196,226,125,24,13,52,16,0,0 // vbroadcastss 0x1034(%rip),%ymm1 # 7cd8 <_sk_callback_avx+0x538>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,43,16,0,0 // vbroadcastss 0x102b(%rip),%ymm1 # 7e84 <_sk_callback_avx+0x540>
+ .byte 196,226,125,24,13,39,16,0,0 // vbroadcastss 0x1027(%rip),%ymm1 # 7cdc <_sk_callback_avx+0x53c>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 197,252,89,195 // vmulps %ymm3,%ymm0,%ymm0
- .byte 196,226,125,24,13,30,16,0,0 // vbroadcastss 0x101e(%rip),%ymm1 # 7e88 <_sk_callback_avx+0x544>
+ .byte 196,226,125,24,13,26,16,0,0 // vbroadcastss 0x101a(%rip),%ymm1 # 7ce0 <_sk_callback_avx+0x540>
.byte 197,252,88,193 // vaddps %ymm1,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 197,252,40,200 // vmovaps %ymm0,%ymm1
@@ -24731,12 +24407,12 @@ _sk_gradient_avx:
.byte 76,139,8 // mov (%rax),%r9
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 73,131,249,2 // cmp $0x2,%r9
- .byte 114,80 // jb 6eed <_sk_gradient_avx+0x6f>
+ .byte 114,80 // jb 6d49 <_sk_gradient_avx+0x6f>
.byte 72,139,88,72 // mov 0x48(%rax),%rbx
.byte 73,255,201 // dec %r9
.byte 72,131,195,4 // add $0x4,%rbx
.byte 196,65,52,87,201 // vxorps %ymm9,%ymm9,%ymm9
- .byte 196,98,125,24,21,214,15,0,0 // vbroadcastss 0xfd6(%rip),%ymm10 # 7e8c <_sk_callback_avx+0x548>
+ .byte 196,98,125,24,21,210,15,0,0 // vbroadcastss 0xfd2(%rip),%ymm10 # 7ce4 <_sk_callback_avx+0x544>
.byte 197,244,87,201 // vxorps %ymm1,%ymm1,%ymm1
.byte 196,98,125,24,3 // vbroadcastss (%rbx),%ymm8
.byte 197,60,194,192,2 // vcmpleps %ymm0,%ymm8,%ymm8
@@ -24748,7 +24424,7 @@ _sk_gradient_avx:
.byte 196,227,117,24,202,1 // vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
.byte 72,131,195,4 // add $0x4,%rbx
.byte 73,255,201 // dec %r9
- .byte 117,205 // jne 6eba <_sk_gradient_avx+0x3c>
+ .byte 117,205 // jne 6d16 <_sk_gradient_avx+0x3c>
.byte 196,195,249,22,201,1 // vpextrq $0x1,%xmm1,%r9
.byte 69,137,202 // mov %r9d,%r10d
.byte 73,193,233,32 // shr $0x20,%r9
@@ -24931,27 +24607,27 @@ _sk_xy_to_unit_angle_avx:
.byte 196,65,52,95,226 // vmaxps %ymm10,%ymm9,%ymm12
.byte 196,65,36,94,220 // vdivps %ymm12,%ymm11,%ymm11
.byte 196,65,36,89,227 // vmulps %ymm11,%ymm11,%ymm12
- .byte 196,98,125,24,45,204,11,0,0 // vbroadcastss 0xbcc(%rip),%ymm13 # 7e90 <_sk_callback_avx+0x54c>
+ .byte 196,98,125,24,45,200,11,0,0 // vbroadcastss 0xbc8(%rip),%ymm13 # 7ce8 <_sk_callback_avx+0x548>
.byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13
- .byte 196,98,125,24,53,194,11,0,0 // vbroadcastss 0xbc2(%rip),%ymm14 # 7e94 <_sk_callback_avx+0x550>
+ .byte 196,98,125,24,53,190,11,0,0 // vbroadcastss 0xbbe(%rip),%ymm14 # 7cec <_sk_callback_avx+0x54c>
.byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13
.byte 196,65,28,89,237 // vmulps %ymm13,%ymm12,%ymm13
- .byte 196,98,125,24,53,179,11,0,0 // vbroadcastss 0xbb3(%rip),%ymm14 # 7e98 <_sk_callback_avx+0x554>
+ .byte 196,98,125,24,53,175,11,0,0 // vbroadcastss 0xbaf(%rip),%ymm14 # 7cf0 <_sk_callback_avx+0x550>
.byte 196,65,20,88,238 // vaddps %ymm14,%ymm13,%ymm13
.byte 196,65,28,89,229 // vmulps %ymm13,%ymm12,%ymm12
- .byte 196,98,125,24,45,164,11,0,0 // vbroadcastss 0xba4(%rip),%ymm13 # 7e9c <_sk_callback_avx+0x558>
+ .byte 196,98,125,24,45,160,11,0,0 // vbroadcastss 0xba0(%rip),%ymm13 # 7cf4 <_sk_callback_avx+0x554>
.byte 196,65,28,88,229 // vaddps %ymm13,%ymm12,%ymm12
.byte 196,65,36,89,220 // vmulps %ymm12,%ymm11,%ymm11
.byte 196,65,52,194,202,1 // vcmpltps %ymm10,%ymm9,%ymm9
- .byte 196,98,125,24,21,143,11,0,0 // vbroadcastss 0xb8f(%rip),%ymm10 # 7ea0 <_sk_callback_avx+0x55c>
+ .byte 196,98,125,24,21,139,11,0,0 // vbroadcastss 0xb8b(%rip),%ymm10 # 7cf8 <_sk_callback_avx+0x558>
.byte 196,65,44,92,211 // vsubps %ymm11,%ymm10,%ymm10
.byte 196,67,37,74,202,144 // vblendvps %ymm9,%ymm10,%ymm11,%ymm9
.byte 196,193,124,194,192,1 // vcmpltps %ymm8,%ymm0,%ymm0
- .byte 196,98,125,24,21,121,11,0,0 // vbroadcastss 0xb79(%rip),%ymm10 # 7ea4 <_sk_callback_avx+0x560>
+ .byte 196,98,125,24,21,117,11,0,0 // vbroadcastss 0xb75(%rip),%ymm10 # 7cfc <_sk_callback_avx+0x55c>
.byte 196,65,44,92,209 // vsubps %ymm9,%ymm10,%ymm10
.byte 196,195,53,74,194,0 // vblendvps %ymm0,%ymm10,%ymm9,%ymm0
.byte 196,65,116,194,200,1 // vcmpltps %ymm8,%ymm1,%ymm9
- .byte 196,98,125,24,21,99,11,0,0 // vbroadcastss 0xb63(%rip),%ymm10 # 7ea8 <_sk_callback_avx+0x564>
+ .byte 196,98,125,24,21,95,11,0,0 // vbroadcastss 0xb5f(%rip),%ymm10 # 7d00 <_sk_callback_avx+0x560>
.byte 197,44,92,208 // vsubps %ymm0,%ymm10,%ymm10
.byte 196,195,125,74,194,144 // vblendvps %ymm9,%ymm10,%ymm0,%ymm0
.byte 196,65,124,194,200,3 // vcmpunordps %ymm8,%ymm0,%ymm9
@@ -24981,7 +24657,7 @@ _sk_xy_to_2pt_conical_quadratic_max_avx:
.byte 196,67,121,4,210,0 // vpermilps $0x0,%xmm10,%xmm10
.byte 196,67,45,24,210,1 // vinsertf128 $0x1,%xmm10,%ymm10,%ymm10
.byte 197,44,88,208 // vaddps %ymm0,%ymm10,%ymm10
- .byte 196,98,125,24,29,13,11,0,0 // vbroadcastss 0xb0d(%rip),%ymm11 # 7eac <_sk_callback_avx+0x568>
+ .byte 196,98,125,24,29,9,11,0,0 // vbroadcastss 0xb09(%rip),%ymm11 # 7d04 <_sk_callback_avx+0x564>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
.byte 197,252,89,192 // vmulps %ymm0,%ymm0,%ymm0
.byte 197,116,89,217 // vmulps %ymm1,%ymm1,%ymm11
@@ -24990,17 +24666,17 @@ _sk_xy_to_2pt_conical_quadratic_max_avx:
.byte 196,227,121,4,192,0 // vpermilps $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,13,225,10,0,0 // vbroadcastss 0xae1(%rip),%ymm9 # 7eb0 <_sk_callback_avx+0x56c>
+ .byte 196,98,125,24,13,221,10,0,0 // vbroadcastss 0xadd(%rip),%ymm9 # 7d08 <_sk_callback_avx+0x568>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,65,44,89,194 // vmulps %ymm10,%ymm10,%ymm8
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
.byte 197,252,81,192 // vsqrtps %ymm0,%ymm0
.byte 196,98,125,24,64,36 // vbroadcastss 0x24(%rax),%ymm8
- .byte 196,98,125,24,13,191,10,0,0 // vbroadcastss 0xabf(%rip),%ymm9 # 7eb4 <_sk_callback_avx+0x570>
+ .byte 196,98,125,24,13,187,10,0,0 // vbroadcastss 0xabb(%rip),%ymm9 # 7d0c <_sk_callback_avx+0x56c>
.byte 196,65,44,87,201 // vxorps %ymm9,%ymm10,%ymm9
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,176,10,0,0 // vbroadcastss 0xab0(%rip),%ymm11 # 7eb8 <_sk_callback_avx+0x574>
+ .byte 196,98,125,24,29,172,10,0,0 // vbroadcastss 0xaac(%rip),%ymm11 # 7d10 <_sk_callback_avx+0x570>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 196,65,60,89,210 // vmulps %ymm10,%ymm8,%ymm10
.byte 197,180,92,192 // vsubps %ymm0,%ymm9,%ymm0
@@ -25020,7 +24696,7 @@ _sk_xy_to_2pt_conical_quadratic_min_avx:
.byte 196,67,121,4,210,0 // vpermilps $0x0,%xmm10,%xmm10
.byte 196,67,45,24,210,1 // vinsertf128 $0x1,%xmm10,%ymm10,%ymm10
.byte 197,44,88,208 // vaddps %ymm0,%ymm10,%ymm10
- .byte 196,98,125,24,29,111,10,0,0 // vbroadcastss 0xa6f(%rip),%ymm11 # 7ebc <_sk_callback_avx+0x578>
+ .byte 196,98,125,24,29,107,10,0,0 // vbroadcastss 0xa6b(%rip),%ymm11 # 7d14 <_sk_callback_avx+0x574>
.byte 196,65,44,89,211 // vmulps %ymm11,%ymm10,%ymm10
.byte 197,252,89,192 // vmulps %ymm0,%ymm0,%ymm0
.byte 197,116,89,217 // vmulps %ymm1,%ymm1,%ymm11
@@ -25029,17 +24705,17 @@ _sk_xy_to_2pt_conical_quadratic_min_avx:
.byte 196,227,121,4,192,0 // vpermilps $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,164,92,192 // vsubps %ymm0,%ymm11,%ymm0
- .byte 196,98,125,24,13,67,10,0,0 // vbroadcastss 0xa43(%rip),%ymm9 # 7ec0 <_sk_callback_avx+0x57c>
+ .byte 196,98,125,24,13,63,10,0,0 // vbroadcastss 0xa3f(%rip),%ymm9 # 7d18 <_sk_callback_avx+0x578>
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
.byte 197,188,89,192 // vmulps %ymm0,%ymm8,%ymm0
.byte 196,65,44,89,194 // vmulps %ymm10,%ymm10,%ymm8
.byte 196,193,124,88,192 // vaddps %ymm8,%ymm0,%ymm0
.byte 197,252,81,192 // vsqrtps %ymm0,%ymm0
.byte 196,98,125,24,64,36 // vbroadcastss 0x24(%rax),%ymm8
- .byte 196,98,125,24,13,33,10,0,0 // vbroadcastss 0xa21(%rip),%ymm9 # 7ec4 <_sk_callback_avx+0x580>
+ .byte 196,98,125,24,13,29,10,0,0 // vbroadcastss 0xa1d(%rip),%ymm9 # 7d1c <_sk_callback_avx+0x57c>
.byte 196,65,44,87,201 // vxorps %ymm9,%ymm10,%ymm9
.byte 196,65,124,92,210 // vsubps %ymm10,%ymm0,%ymm10
- .byte 196,98,125,24,29,18,10,0,0 // vbroadcastss 0xa12(%rip),%ymm11 # 7ec8 <_sk_callback_avx+0x584>
+ .byte 196,98,125,24,29,14,10,0,0 // vbroadcastss 0xa0e(%rip),%ymm11 # 7d20 <_sk_callback_avx+0x580>
.byte 196,65,60,89,195 // vmulps %ymm11,%ymm8,%ymm8
.byte 196,65,60,89,210 // vmulps %ymm10,%ymm8,%ymm10
.byte 197,180,92,192 // vsubps %ymm0,%ymm9,%ymm0
@@ -25058,7 +24734,7 @@ _sk_xy_to_2pt_conical_linear_avx:
.byte 196,67,121,4,201,0 // vpermilps $0x0,%xmm9,%xmm9
.byte 196,67,53,24,201,1 // vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
.byte 197,52,88,200 // vaddps %ymm0,%ymm9,%ymm9
- .byte 196,98,125,24,21,215,9,0,0 // vbroadcastss 0x9d7(%rip),%ymm10 # 7ecc <_sk_callback_avx+0x588>
+ .byte 196,98,125,24,21,211,9,0,0 // vbroadcastss 0x9d3(%rip),%ymm10 # 7d24 <_sk_callback_avx+0x584>
.byte 196,65,52,89,202 // vmulps %ymm10,%ymm9,%ymm9
.byte 197,252,89,192 // vmulps %ymm0,%ymm0,%ymm0
.byte 197,116,89,209 // vmulps %ymm1,%ymm1,%ymm10
@@ -25067,7 +24743,7 @@ _sk_xy_to_2pt_conical_linear_avx:
.byte 196,227,121,4,192,0 // vpermilps $0x0,%xmm0,%xmm0
.byte 196,227,125,24,192,1 // vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
.byte 197,172,92,192 // vsubps %ymm0,%ymm10,%ymm0
- .byte 196,98,125,24,5,171,9,0,0 // vbroadcastss 0x9ab(%rip),%ymm8 # 7ed0 <_sk_callback_avx+0x58c>
+ .byte 196,98,125,24,5,167,9,0,0 // vbroadcastss 0x9a7(%rip),%ymm8 # 7d28 <_sk_callback_avx+0x588>
.byte 196,193,124,87,192 // vxorps %ymm8,%ymm0,%ymm0
.byte 196,193,124,94,193 // vdivps %ymm9,%ymm0,%ymm0
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25108,7 +24784,7 @@ HIDDEN _sk_save_xy_avx
FUNCTION(_sk_save_xy_avx)
_sk_save_xy_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,71,9,0,0 // vbroadcastss 0x947(%rip),%ymm8 # 7ed4 <_sk_callback_avx+0x590>
+ .byte 196,98,125,24,5,67,9,0,0 // vbroadcastss 0x943(%rip),%ymm8 # 7d2c <_sk_callback_avx+0x58c>
.byte 196,65,124,88,200 // vaddps %ymm8,%ymm0,%ymm9
.byte 196,67,125,8,209,1 // vroundps $0x1,%ymm9,%ymm10
.byte 196,65,52,92,202 // vsubps %ymm10,%ymm9,%ymm9
@@ -25145,9 +24821,9 @@ HIDDEN _sk_bilinear_nx_avx
FUNCTION(_sk_bilinear_nx_avx)
_sk_bilinear_nx_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,211,8,0,0 // vbroadcastss 0x8d3(%rip),%ymm0 # 7ed8 <_sk_callback_avx+0x594>
+ .byte 196,226,125,24,5,207,8,0,0 // vbroadcastss 0x8cf(%rip),%ymm0 # 7d30 <_sk_callback_avx+0x590>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,202,8,0,0 // vbroadcastss 0x8ca(%rip),%ymm8 # 7edc <_sk_callback_avx+0x598>
+ .byte 196,98,125,24,5,198,8,0,0 // vbroadcastss 0x8c6(%rip),%ymm8 # 7d34 <_sk_callback_avx+0x594>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25158,7 +24834,7 @@ HIDDEN _sk_bilinear_px_avx
FUNCTION(_sk_bilinear_px_avx)
_sk_bilinear_px_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,178,8,0,0 // vbroadcastss 0x8b2(%rip),%ymm0 # 7ee0 <_sk_callback_avx+0x59c>
+ .byte 196,226,125,24,5,174,8,0,0 // vbroadcastss 0x8ae(%rip),%ymm0 # 7d38 <_sk_callback_avx+0x598>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -25170,9 +24846,9 @@ HIDDEN _sk_bilinear_ny_avx
FUNCTION(_sk_bilinear_ny_avx)
_sk_bilinear_ny_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,150,8,0,0 // vbroadcastss 0x896(%rip),%ymm1 # 7ee4 <_sk_callback_avx+0x5a0>
+ .byte 196,226,125,24,13,146,8,0,0 // vbroadcastss 0x892(%rip),%ymm1 # 7d3c <_sk_callback_avx+0x59c>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,140,8,0,0 // vbroadcastss 0x88c(%rip),%ymm8 # 7ee8 <_sk_callback_avx+0x5a4>
+ .byte 196,98,125,24,5,136,8,0,0 // vbroadcastss 0x888(%rip),%ymm8 # 7d40 <_sk_callback_avx+0x5a0>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25183,7 +24859,7 @@ HIDDEN _sk_bilinear_py_avx
FUNCTION(_sk_bilinear_py_avx)
_sk_bilinear_py_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,116,8,0,0 // vbroadcastss 0x874(%rip),%ymm1 # 7eec <_sk_callback_avx+0x5a8>
+ .byte 196,226,125,24,13,112,8,0,0 // vbroadcastss 0x870(%rip),%ymm1 # 7d44 <_sk_callback_avx+0x5a4>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -25195,14 +24871,14 @@ HIDDEN _sk_bicubic_n3x_avx
FUNCTION(_sk_bicubic_n3x_avx)
_sk_bicubic_n3x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,87,8,0,0 // vbroadcastss 0x857(%rip),%ymm0 # 7ef0 <_sk_callback_avx+0x5ac>
+ .byte 196,226,125,24,5,83,8,0,0 // vbroadcastss 0x853(%rip),%ymm0 # 7d48 <_sk_callback_avx+0x5a8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,78,8,0,0 // vbroadcastss 0x84e(%rip),%ymm8 # 7ef4 <_sk_callback_avx+0x5b0>
+ .byte 196,98,125,24,5,74,8,0,0 // vbroadcastss 0x84a(%rip),%ymm8 # 7d4c <_sk_callback_avx+0x5ac>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,63,8,0,0 // vbroadcastss 0x83f(%rip),%ymm10 # 7ef8 <_sk_callback_avx+0x5b4>
+ .byte 196,98,125,24,21,59,8,0,0 // vbroadcastss 0x83b(%rip),%ymm10 # 7d50 <_sk_callback_avx+0x5b0>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,53,8,0,0 // vbroadcastss 0x835(%rip),%ymm10 # 7efc <_sk_callback_avx+0x5b8>
+ .byte 196,98,125,24,21,49,8,0,0 // vbroadcastss 0x831(%rip),%ymm10 # 7d54 <_sk_callback_avx+0x5b4>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -25214,19 +24890,19 @@ HIDDEN _sk_bicubic_n1x_avx
FUNCTION(_sk_bicubic_n1x_avx)
_sk_bicubic_n1x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,24,8,0,0 // vbroadcastss 0x818(%rip),%ymm0 # 7f00 <_sk_callback_avx+0x5bc>
+ .byte 196,226,125,24,5,20,8,0,0 // vbroadcastss 0x814(%rip),%ymm0 # 7d58 <_sk_callback_avx+0x5b8>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
- .byte 196,98,125,24,5,15,8,0,0 // vbroadcastss 0x80f(%rip),%ymm8 # 7f04 <_sk_callback_avx+0x5c0>
+ .byte 196,98,125,24,5,11,8,0,0 // vbroadcastss 0x80b(%rip),%ymm8 # 7d5c <_sk_callback_avx+0x5bc>
.byte 197,60,92,64,64 // vsubps 0x40(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,5,8,0,0 // vbroadcastss 0x805(%rip),%ymm9 # 7f08 <_sk_callback_avx+0x5c4>
+ .byte 196,98,125,24,13,1,8,0,0 // vbroadcastss 0x801(%rip),%ymm9 # 7d60 <_sk_callback_avx+0x5c0>
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,251,7,0,0 // vbroadcastss 0x7fb(%rip),%ymm10 # 7f0c <_sk_callback_avx+0x5c8>
+ .byte 196,98,125,24,21,247,7,0,0 // vbroadcastss 0x7f7(%rip),%ymm10 # 7d64 <_sk_callback_avx+0x5c4>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,236,7,0,0 // vbroadcastss 0x7ec(%rip),%ymm10 # 7f10 <_sk_callback_avx+0x5cc>
+ .byte 196,98,125,24,21,232,7,0,0 // vbroadcastss 0x7e8(%rip),%ymm10 # 7d68 <_sk_callback_avx+0x5c8>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,221,7,0,0 // vbroadcastss 0x7dd(%rip),%ymm9 # 7f14 <_sk_callback_avx+0x5d0>
+ .byte 196,98,125,24,13,217,7,0,0 // vbroadcastss 0x7d9(%rip),%ymm9 # 7d6c <_sk_callback_avx+0x5cc>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25237,17 +24913,17 @@ HIDDEN _sk_bicubic_p1x_avx
FUNCTION(_sk_bicubic_p1x_avx)
_sk_bicubic_p1x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,197,7,0,0 // vbroadcastss 0x7c5(%rip),%ymm8 # 7f18 <_sk_callback_avx+0x5d4>
+ .byte 196,98,125,24,5,193,7,0,0 // vbroadcastss 0x7c1(%rip),%ymm8 # 7d70 <_sk_callback_avx+0x5d0>
.byte 197,188,88,0 // vaddps (%rax),%ymm8,%ymm0
.byte 197,124,16,72,64 // vmovups 0x40(%rax),%ymm9
- .byte 196,98,125,24,21,183,7,0,0 // vbroadcastss 0x7b7(%rip),%ymm10 # 7f1c <_sk_callback_avx+0x5d8>
+ .byte 196,98,125,24,21,179,7,0,0 // vbroadcastss 0x7b3(%rip),%ymm10 # 7d74 <_sk_callback_avx+0x5d4>
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
- .byte 196,98,125,24,29,173,7,0,0 // vbroadcastss 0x7ad(%rip),%ymm11 # 7f20 <_sk_callback_avx+0x5dc>
+ .byte 196,98,125,24,29,169,7,0,0 // vbroadcastss 0x7a9(%rip),%ymm11 # 7d78 <_sk_callback_avx+0x5d8>
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
.byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
- .byte 196,98,125,24,13,148,7,0,0 // vbroadcastss 0x794(%rip),%ymm9 # 7f24 <_sk_callback_avx+0x5e0>
+ .byte 196,98,125,24,13,144,7,0,0 // vbroadcastss 0x790(%rip),%ymm9 # 7d7c <_sk_callback_avx+0x5dc>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25258,13 +24934,13 @@ HIDDEN _sk_bicubic_p3x_avx
FUNCTION(_sk_bicubic_p3x_avx)
_sk_bicubic_p3x_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,5,124,7,0,0 // vbroadcastss 0x77c(%rip),%ymm0 # 7f28 <_sk_callback_avx+0x5e4>
+ .byte 196,226,125,24,5,120,7,0,0 // vbroadcastss 0x778(%rip),%ymm0 # 7d80 <_sk_callback_avx+0x5e0>
.byte 197,252,88,0 // vaddps (%rax),%ymm0,%ymm0
.byte 197,124,16,64,64 // vmovups 0x40(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,105,7,0,0 // vbroadcastss 0x769(%rip),%ymm10 # 7f2c <_sk_callback_avx+0x5e8>
+ .byte 196,98,125,24,21,101,7,0,0 // vbroadcastss 0x765(%rip),%ymm10 # 7d84 <_sk_callback_avx+0x5e4>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,95,7,0,0 // vbroadcastss 0x75f(%rip),%ymm10 # 7f30 <_sk_callback_avx+0x5ec>
+ .byte 196,98,125,24,21,91,7,0,0 // vbroadcastss 0x75b(%rip),%ymm10 # 7d88 <_sk_callback_avx+0x5e8>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,128,0,0,0 // vmovups %ymm8,0x80(%rax)
@@ -25276,14 +24952,14 @@ HIDDEN _sk_bicubic_n3y_avx
FUNCTION(_sk_bicubic_n3y_avx)
_sk_bicubic_n3y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,66,7,0,0 // vbroadcastss 0x742(%rip),%ymm1 # 7f34 <_sk_callback_avx+0x5f0>
+ .byte 196,226,125,24,13,62,7,0,0 // vbroadcastss 0x73e(%rip),%ymm1 # 7d8c <_sk_callback_avx+0x5ec>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,56,7,0,0 // vbroadcastss 0x738(%rip),%ymm8 # 7f38 <_sk_callback_avx+0x5f4>
+ .byte 196,98,125,24,5,52,7,0,0 // vbroadcastss 0x734(%rip),%ymm8 # 7d90 <_sk_callback_avx+0x5f0>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,41,7,0,0 // vbroadcastss 0x729(%rip),%ymm10 # 7f3c <_sk_callback_avx+0x5f8>
+ .byte 196,98,125,24,21,37,7,0,0 // vbroadcastss 0x725(%rip),%ymm10 # 7d94 <_sk_callback_avx+0x5f4>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,31,7,0,0 // vbroadcastss 0x71f(%rip),%ymm10 # 7f40 <_sk_callback_avx+0x5fc>
+ .byte 196,98,125,24,21,27,7,0,0 // vbroadcastss 0x71b(%rip),%ymm10 # 7d98 <_sk_callback_avx+0x5f8>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -25295,19 +24971,19 @@ HIDDEN _sk_bicubic_n1y_avx
FUNCTION(_sk_bicubic_n1y_avx)
_sk_bicubic_n1y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,2,7,0,0 // vbroadcastss 0x702(%rip),%ymm1 # 7f44 <_sk_callback_avx+0x600>
+ .byte 196,226,125,24,13,254,6,0,0 // vbroadcastss 0x6fe(%rip),%ymm1 # 7d9c <_sk_callback_avx+0x5fc>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
- .byte 196,98,125,24,5,248,6,0,0 // vbroadcastss 0x6f8(%rip),%ymm8 # 7f48 <_sk_callback_avx+0x604>
+ .byte 196,98,125,24,5,244,6,0,0 // vbroadcastss 0x6f4(%rip),%ymm8 # 7da0 <_sk_callback_avx+0x600>
.byte 197,60,92,64,96 // vsubps 0x60(%rax),%ymm8,%ymm8
- .byte 196,98,125,24,13,238,6,0,0 // vbroadcastss 0x6ee(%rip),%ymm9 # 7f4c <_sk_callback_avx+0x608>
+ .byte 196,98,125,24,13,234,6,0,0 // vbroadcastss 0x6ea(%rip),%ymm9 # 7da4 <_sk_callback_avx+0x604>
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,228,6,0,0 // vbroadcastss 0x6e4(%rip),%ymm10 # 7f50 <_sk_callback_avx+0x60c>
+ .byte 196,98,125,24,21,224,6,0,0 // vbroadcastss 0x6e0(%rip),%ymm10 # 7da8 <_sk_callback_avx+0x608>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,201 // vmulps %ymm9,%ymm8,%ymm9
- .byte 196,98,125,24,21,213,6,0,0 // vbroadcastss 0x6d5(%rip),%ymm10 # 7f54 <_sk_callback_avx+0x610>
+ .byte 196,98,125,24,21,209,6,0,0 // vbroadcastss 0x6d1(%rip),%ymm10 # 7dac <_sk_callback_avx+0x60c>
.byte 196,65,52,88,202 // vaddps %ymm10,%ymm9,%ymm9
.byte 196,65,60,89,193 // vmulps %ymm9,%ymm8,%ymm8
- .byte 196,98,125,24,13,198,6,0,0 // vbroadcastss 0x6c6(%rip),%ymm9 # 7f58 <_sk_callback_avx+0x614>
+ .byte 196,98,125,24,13,194,6,0,0 // vbroadcastss 0x6c2(%rip),%ymm9 # 7db0 <_sk_callback_avx+0x610>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25318,17 +24994,17 @@ HIDDEN _sk_bicubic_p1y_avx
FUNCTION(_sk_bicubic_p1y_avx)
_sk_bicubic_p1y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,98,125,24,5,174,6,0,0 // vbroadcastss 0x6ae(%rip),%ymm8 # 7f5c <_sk_callback_avx+0x618>
+ .byte 196,98,125,24,5,170,6,0,0 // vbroadcastss 0x6aa(%rip),%ymm8 # 7db4 <_sk_callback_avx+0x614>
.byte 197,188,88,72,32 // vaddps 0x20(%rax),%ymm8,%ymm1
.byte 197,124,16,72,96 // vmovups 0x60(%rax),%ymm9
- .byte 196,98,125,24,21,159,6,0,0 // vbroadcastss 0x69f(%rip),%ymm10 # 7f60 <_sk_callback_avx+0x61c>
+ .byte 196,98,125,24,21,155,6,0,0 // vbroadcastss 0x69b(%rip),%ymm10 # 7db8 <_sk_callback_avx+0x618>
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
- .byte 196,98,125,24,29,149,6,0,0 // vbroadcastss 0x695(%rip),%ymm11 # 7f64 <_sk_callback_avx+0x620>
+ .byte 196,98,125,24,29,145,6,0,0 // vbroadcastss 0x691(%rip),%ymm11 # 7dbc <_sk_callback_avx+0x61c>
.byte 196,65,44,88,211 // vaddps %ymm11,%ymm10,%ymm10
.byte 196,65,52,89,210 // vmulps %ymm10,%ymm9,%ymm10
.byte 196,65,44,88,192 // vaddps %ymm8,%ymm10,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
- .byte 196,98,125,24,13,124,6,0,0 // vbroadcastss 0x67c(%rip),%ymm9 # 7f68 <_sk_callback_avx+0x624>
+ .byte 196,98,125,24,13,120,6,0,0 // vbroadcastss 0x678(%rip),%ymm9 # 7dc0 <_sk_callback_avx+0x620>
.byte 196,65,60,88,193 // vaddps %ymm9,%ymm8,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -25339,13 +25015,13 @@ HIDDEN _sk_bicubic_p3y_avx
FUNCTION(_sk_bicubic_p3y_avx)
_sk_bicubic_p3y_avx:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 196,226,125,24,13,100,6,0,0 // vbroadcastss 0x664(%rip),%ymm1 # 7f6c <_sk_callback_avx+0x628>
+ .byte 196,226,125,24,13,96,6,0,0 // vbroadcastss 0x660(%rip),%ymm1 # 7dc4 <_sk_callback_avx+0x624>
.byte 197,244,88,72,32 // vaddps 0x20(%rax),%ymm1,%ymm1
.byte 197,124,16,64,96 // vmovups 0x60(%rax),%ymm8
.byte 196,65,60,89,200 // vmulps %ymm8,%ymm8,%ymm9
- .byte 196,98,125,24,21,80,6,0,0 // vbroadcastss 0x650(%rip),%ymm10 # 7f70 <_sk_callback_avx+0x62c>
+ .byte 196,98,125,24,21,76,6,0,0 // vbroadcastss 0x64c(%rip),%ymm10 # 7dc8 <_sk_callback_avx+0x628>
.byte 196,65,60,89,194 // vmulps %ymm10,%ymm8,%ymm8
- .byte 196,98,125,24,21,70,6,0,0 // vbroadcastss 0x646(%rip),%ymm10 # 7f74 <_sk_callback_avx+0x630>
+ .byte 196,98,125,24,21,66,6,0,0 // vbroadcastss 0x642(%rip),%ymm10 # 7dcc <_sk_callback_avx+0x62c>
.byte 196,65,60,88,194 // vaddps %ymm10,%ymm8,%ymm8
.byte 196,65,52,89,192 // vmulps %ymm8,%ymm9,%ymm8
.byte 197,124,17,128,160,0,0,0 // vmovups %ymm8,0xa0(%rax)
@@ -25477,25 +25153,25 @@ BALIGN4
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 7b41 <.literal4+0xb9>
+ .byte 71,225,61 // rex.RXB loope 799d <.literal4+0xb9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 7b51 <.literal4+0xc9>
+ .byte 71,225,61 // rex.RXB loope 79ad <.literal4+0xc9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 7b61 <.literal4+0xd9>
+ .byte 71,225,61 // rex.RXB loope 79bd <.literal4+0xd9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,154 // cmpb $0x9a,(%rdi)
.byte 153 // cltd
.byte 153 // cltd
.byte 62,61,10,23,63,174 // ds cmp $0xae3f170a,%eax
- .byte 71,225,61 // rex.RXB loope 7b71 <.literal4+0xe9>
+ .byte 71,225,61 // rex.RXB loope 79cd <.literal4+0xe9>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
@@ -25559,7 +25235,7 @@ BALIGN4
.byte 190,129,128,128,59 // mov $0x3b808081,%esi
.byte 129,128,128,59,0,248,0,0,8,33 // addl $0x21080000,-0x7ffc480(%rax)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 7bdd <.literal4+0x155>
+ .byte 224,7 // loopne 7a39 <.literal4+0x155>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -25575,10 +25251,10 @@ BALIGN4
.byte 129,128,128,59,129,128,128,59,0,0 // addl $0x3b80,-0x7f7ec480(%rax)
.byte 0,52,255 // add %dh,(%rdi,%rdi,8)
.byte 255 // (bad)
- .byte 127,0 // jg 7c04 <.literal4+0x17c>
+ .byte 127,0 // jg 7a60 <.literal4+0x17c>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 7c7d <.literal4+0x1f5>
+ .byte 119,115 // ja 7ad9 <.literal4+0x1f5>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -25592,10 +25268,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 7c38 <.literal4+0x1b0>
+ .byte 127,0 // jg 7a94 <.literal4+0x1b0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 7cb1 <.literal4+0x229>
+ .byte 119,115 // ja 7b0d <.literal4+0x229>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -25609,10 +25285,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 7c6c <.literal4+0x1e4>
+ .byte 127,0 // jg 7ac8 <.literal4+0x1e4>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 7ce5 <.literal4+0x25d>
+ .byte 119,115 // ja 7b41 <.literal4+0x25d>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -25626,10 +25302,10 @@ BALIGN4
.byte 0,128,63,0,0,0 // add %al,0x3f(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 7ca0 <.literal4+0x218>
+ .byte 127,0 // jg 7afc <.literal4+0x218>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 7d19 <.literal4+0x291>
+ .byte 119,115 // ja 7b75 <.literal4+0x291>
.byte 248 // clc
.byte 194,117,191 // retq $0xbf75
.byte 191,63,249,68,180 // mov $0xb444f93f,%edi
@@ -25642,7 +25318,7 @@ BALIGN4
.byte 0,75,0 // add %cl,0x0(%rbx)
.byte 0,128,63,0,0,200 // add %al,-0x37ffffc1(%rax)
.byte 66,0,0 // rex.X add %al,(%rax)
- .byte 127,67 // jg 7d17 <.literal4+0x28f>
+ .byte 127,67 // jg 7b73 <.literal4+0x28f>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -25654,7 +25330,7 @@ BALIGN4
.byte 190,80,128,3,62 // mov $0x3e038050,%esi
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 7d37 <.literal4+0x2af>
+ .byte 118,63 // jbe 7b93 <.literal4+0x2af>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
@@ -25663,14 +25339,9 @@ BALIGN4
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
.byte 59,0 // cmp (%rax),%eax
- .byte 0,128,63,129,128,128 // add %al,-0x7f7f7ec1(%rax)
- .byte 59,0 // cmp (%rax),%eax
- .byte 248 // clc
- .byte 0,0 // add %al,(%rax)
- .byte 8,33 // or %ah,(%rcx)
- .byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 7d39 <.literal4+0x2b1>
- .byte 0,0 // add %al,(%rax)
+ .byte 0,128,63,0,248,0 // add %al,0xf8003f(%rax)
+ .byte 0,8 // add %cl,(%rax)
+ .byte 33,132,55,224,7,0,0 // and %eax,0x7e0(%rdi,%rsi,1)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
.byte 31 // (bad)
@@ -25681,7 +25352,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 7d55 <.literal4+0x2cd>
+ .byte 224,7 // loopne 7bad <.literal4+0x2c9>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -25693,7 +25364,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 7d71 <.literal4+0x2e9>
+ .byte 224,7 // loopne 7bc9 <.literal4+0x2e5>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -25704,7 +25375,7 @@ BALIGN4
.byte 0,0 // add %al,(%rax)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 7dc6 <.literal4+0x33e>
+ .byte 124,66 // jl 7c1e <.literal4+0x33a>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,55,0,15 // mov %ecx,0xf003788(%rax)
@@ -25730,12 +25401,12 @@ BALIGN4
.byte 137,136,136,59,15,0 // mov %ecx,0xf3b88(%rax)
.byte 0,0 // add %al,(%rax)
.byte 137,136,136,61,0,0 // mov %ecx,0x3d88(%rax)
- .byte 112,65 // jo 7e29 <.literal4+0x3a1>
+ .byte 112,65 // jo 7c81 <.literal4+0x39d>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 7e3f <.literal4+0x3b7>
+ .byte 127,67 // jg 7c97 <.literal4+0x3b3>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
@@ -25758,7 +25429,7 @@ BALIGN4
.byte 0,128,55,0,0,128 // add %al,-0x7fffffc9(%rax)
.byte 63 // (bad)
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 7e9f <.literal4+0x417>
+ .byte 127,71 // jg 7cf7 <.literal4+0x413>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -26228,22 +25899,6 @@ BALIGN32
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
BALIGN32
HIDDEN _sk_start_pipeline_sse41
@@ -26385,7 +26040,7 @@ _sk_seed_shader_sse41:
.byte 102,15,110,194 // movd %edx,%xmm0
.byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
- .byte 15,40,21,80,92,0,0 // movaps 0x5c50(%rip),%xmm2 # 5da0 <_sk_callback_sse41+0xfd>
+ .byte 15,40,21,80,91,0,0 // movaps 0x5b50(%rip),%xmm2 # 5ca0 <_sk_callback_sse41+0xff>
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 15,16,7 // movups (%rdi),%xmm0
.byte 15,88,193 // addps %xmm1,%xmm0
@@ -26394,7 +26049,7 @@ _sk_seed_shader_sse41:
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,21,63,92,0,0 // movaps 0x5c3f(%rip),%xmm2 # 5db0 <_sk_callback_sse41+0x10d>
+ .byte 15,40,21,63,91,0,0 // movaps 0x5b3f(%rip),%xmm2 # 5cb0 <_sk_callback_sse41+0x10f>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,87,237 // xorps %xmm5,%xmm5
@@ -26414,14 +26069,14 @@ _sk_dither_sse41:
.byte 102,68,15,110,193 // movd %ecx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 102,69,15,239,193 // pxor %xmm9,%xmm8
- .byte 102,68,15,111,21,13,92,0,0 // movdqa 0x5c0d(%rip),%xmm10 # 5dc0 <_sk_callback_sse41+0x11d>
+ .byte 102,68,15,111,21,13,91,0,0 // movdqa 0x5b0d(%rip),%xmm10 # 5cc0 <_sk_callback_sse41+0x11f>
.byte 102,69,15,111,216 // movdqa %xmm8,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,65,15,114,243,5 // pslld $0x5,%xmm11
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 102,65,15,114,242,4 // pslld $0x4,%xmm10
- .byte 102,68,15,111,37,249,91,0,0 // movdqa 0x5bf9(%rip),%xmm12 # 5dd0 <_sk_callback_sse41+0x12d>
- .byte 102,68,15,111,45,0,92,0,0 // movdqa 0x5c00(%rip),%xmm13 # 5de0 <_sk_callback_sse41+0x13d>
+ .byte 102,68,15,111,37,249,90,0,0 // movdqa 0x5af9(%rip),%xmm12 # 5cd0 <_sk_callback_sse41+0x12f>
+ .byte 102,68,15,111,45,0,91,0,0 // movdqa 0x5b00(%rip),%xmm13 # 5ce0 <_sk_callback_sse41+0x13f>
.byte 102,69,15,111,240 // movdqa %xmm8,%xmm14
.byte 102,69,15,219,245 // pand %xmm13,%xmm14
.byte 102,65,15,114,246,2 // pslld $0x2,%xmm14
@@ -26437,8 +26092,8 @@ _sk_dither_sse41:
.byte 102,69,15,235,245 // por %xmm13,%xmm14
.byte 102,69,15,235,240 // por %xmm8,%xmm14
.byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8
- .byte 68,15,89,5,187,91,0,0 // mulps 0x5bbb(%rip),%xmm8 # 5df0 <_sk_callback_sse41+0x14d>
- .byte 68,15,88,5,195,91,0,0 // addps 0x5bc3(%rip),%xmm8 # 5e00 <_sk_callback_sse41+0x15d>
+ .byte 68,15,89,5,187,90,0,0 // mulps 0x5abb(%rip),%xmm8 # 5cf0 <_sk_callback_sse41+0x14f>
+ .byte 68,15,88,5,195,90,0,0 // addps 0x5ac3(%rip),%xmm8 # 5d00 <_sk_callback_sse41+0x15f>
.byte 243,68,15,16,16 // movss (%rax),%xmm10
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
@@ -26480,7 +26135,7 @@ HIDDEN _sk_black_color_sse41
FUNCTION(_sk_black_color_sse41)
_sk_black_color_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,89,91,0,0 // movaps 0x5b59(%rip),%xmm3 # 5e10 <_sk_callback_sse41+0x16d>
+ .byte 15,40,29,89,90,0,0 // movaps 0x5a59(%rip),%xmm3 # 5d10 <_sk_callback_sse41+0x16f>
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -26491,7 +26146,7 @@ HIDDEN _sk_white_color_sse41
FUNCTION(_sk_white_color_sse41)
_sk_white_color_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,5,85,91,0,0 // movaps 0x5b55(%rip),%xmm0 # 5e20 <_sk_callback_sse41+0x17d>
+ .byte 15,40,5,85,90,0,0 // movaps 0x5a55(%rip),%xmm0 # 5d20 <_sk_callback_sse41+0x17f>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,40,216 // movaps %xmm0,%xmm3
@@ -26537,7 +26192,7 @@ HIDDEN _sk_srcatop_sse41
FUNCTION(_sk_srcatop_sse41)
_sk_srcatop_sse41:
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 68,15,40,5,21,91,0,0 // movaps 0x5b15(%rip),%xmm8 # 5e30 <_sk_callback_sse41+0x18d>
+ .byte 68,15,40,5,21,90,0,0 // movaps 0x5a15(%rip),%xmm8 # 5d30 <_sk_callback_sse41+0x18f>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -26562,7 +26217,7 @@ FUNCTION(_sk_dstatop_sse41)
_sk_dstatop_sse41:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
.byte 68,15,89,196 // mulps %xmm4,%xmm8
- .byte 68,15,40,13,216,90,0,0 // movaps 0x5ad8(%rip),%xmm9 # 5e40 <_sk_callback_sse41+0x19d>
+ .byte 68,15,40,13,216,89,0,0 // movaps 0x59d8(%rip),%xmm9 # 5d40 <_sk_callback_sse41+0x19f>
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
@@ -26609,7 +26264,7 @@ HIDDEN _sk_srcout_sse41
.globl _sk_srcout_sse41
FUNCTION(_sk_srcout_sse41)
_sk_srcout_sse41:
- .byte 68,15,40,5,124,90,0,0 // movaps 0x5a7c(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0x1ad>
+ .byte 68,15,40,5,124,89,0,0 // movaps 0x597c(%rip),%xmm8 # 5d50 <_sk_callback_sse41+0x1af>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
@@ -26622,7 +26277,7 @@ HIDDEN _sk_dstout_sse41
.globl _sk_dstout_sse41
FUNCTION(_sk_dstout_sse41)
_sk_dstout_sse41:
- .byte 68,15,40,5,108,90,0,0 // movaps 0x5a6c(%rip),%xmm8 # 5e60 <_sk_callback_sse41+0x1bd>
+ .byte 68,15,40,5,108,89,0,0 // movaps 0x596c(%rip),%xmm8 # 5d60 <_sk_callback_sse41+0x1bf>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
@@ -26639,7 +26294,7 @@ HIDDEN _sk_srcover_sse41
.globl _sk_srcover_sse41
FUNCTION(_sk_srcover_sse41)
_sk_srcover_sse41:
- .byte 68,15,40,5,79,90,0,0 // movaps 0x5a4f(%rip),%xmm8 # 5e70 <_sk_callback_sse41+0x1cd>
+ .byte 68,15,40,5,79,89,0,0 // movaps 0x594f(%rip),%xmm8 # 5d70 <_sk_callback_sse41+0x1cf>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -26659,7 +26314,7 @@ HIDDEN _sk_dstover_sse41
.globl _sk_dstover_sse41
FUNCTION(_sk_dstover_sse41)
_sk_dstover_sse41:
- .byte 68,15,40,5,35,90,0,0 // movaps 0x5a23(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0x1dd>
+ .byte 68,15,40,5,35,89,0,0 // movaps 0x5923(%rip),%xmm8 # 5d80 <_sk_callback_sse41+0x1df>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -26687,7 +26342,7 @@ HIDDEN _sk_multiply_sse41
.globl _sk_multiply_sse41
FUNCTION(_sk_multiply_sse41)
_sk_multiply_sse41:
- .byte 68,15,40,5,247,89,0,0 // movaps 0x59f7(%rip),%xmm8 # 5e90 <_sk_callback_sse41+0x1ed>
+ .byte 68,15,40,5,247,88,0,0 // movaps 0x58f7(%rip),%xmm8 # 5d90 <_sk_callback_sse41+0x1ef>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,209 // movaps %xmm9,%xmm10
@@ -26762,7 +26417,7 @@ HIDDEN _sk_xor__sse41
FUNCTION(_sk_xor__sse41)
_sk_xor__sse41:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
- .byte 15,40,29,44,89,0,0 // movaps 0x592c(%rip),%xmm3 # 5ea0 <_sk_callback_sse41+0x1fd>
+ .byte 15,40,29,44,88,0,0 // movaps 0x582c(%rip),%xmm3 # 5da0 <_sk_callback_sse41+0x1ff>
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
@@ -26810,7 +26465,7 @@ _sk_darken_sse41:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,95,209 // maxps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,151,88,0,0 // movaps 0x5897(%rip),%xmm2 # 5eb0 <_sk_callback_sse41+0x20d>
+ .byte 15,40,21,151,87,0,0 // movaps 0x5797(%rip),%xmm2 # 5db0 <_sk_callback_sse41+0x20f>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -26844,7 +26499,7 @@ _sk_lighten_sse41:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,60,88,0,0 // movaps 0x583c(%rip),%xmm2 # 5ec0 <_sk_callback_sse41+0x21d>
+ .byte 15,40,21,60,87,0,0 // movaps 0x573c(%rip),%xmm2 # 5dc0 <_sk_callback_sse41+0x21f>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -26881,7 +26536,7 @@ _sk_difference_sse41:
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,214,87,0,0 // movaps 0x57d6(%rip),%xmm2 # 5ed0 <_sk_callback_sse41+0x22d>
+ .byte 15,40,21,214,86,0,0 // movaps 0x56d6(%rip),%xmm2 # 5dd0 <_sk_callback_sse41+0x22f>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -26909,7 +26564,7 @@ _sk_exclusion_sse41:
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,150,87,0,0 // movaps 0x5796(%rip),%xmm2 # 5ee0 <_sk_callback_sse41+0x23d>
+ .byte 15,40,21,150,86,0,0 // movaps 0x5696(%rip),%xmm2 # 5de0 <_sk_callback_sse41+0x23f>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -26922,7 +26577,7 @@ HIDDEN _sk_colorburn_sse41
FUNCTION(_sk_colorburn_sse41)
_sk_colorburn_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,137,87,0,0 // movaps 0x5789(%rip),%xmm10 # 5ef0 <_sk_callback_sse41+0x24d>
+ .byte 68,15,40,21,137,86,0,0 // movaps 0x5689(%rip),%xmm10 # 5df0 <_sk_callback_sse41+0x24f>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,203 // movaps %xmm11,%xmm9
@@ -27004,7 +26659,7 @@ HIDDEN _sk_colordodge_sse41
FUNCTION(_sk_colordodge_sse41)
_sk_colordodge_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,103,86,0,0 // movaps 0x5667(%rip),%xmm10 # 5f00 <_sk_callback_sse41+0x25d>
+ .byte 68,15,40,21,103,85,0,0 // movaps 0x5567(%rip),%xmm10 # 5e00 <_sk_callback_sse41+0x25f>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
@@ -27086,7 +26741,7 @@ _sk_hardlight_sse41:
.byte 15,40,244 // movaps %xmm4,%xmm6
.byte 15,40,227 // movaps %xmm3,%xmm4
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 68,15,40,21,64,85,0,0 // movaps 0x5540(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0x26d>
+ .byte 68,15,40,21,64,84,0,0 // movaps 0x5440(%rip),%xmm10 # 5e10 <_sk_callback_sse41+0x26f>
.byte 65,15,40,234 // movaps %xmm10,%xmm5
.byte 15,92,239 // subps %xmm7,%xmm5
.byte 15,40,197 // movaps %xmm5,%xmm0
@@ -27169,7 +26824,7 @@ FUNCTION(_sk_overlay_sse41)
_sk_overlay_sse41:
.byte 68,15,40,201 // movaps %xmm1,%xmm9
.byte 68,15,40,240 // movaps %xmm0,%xmm14
- .byte 68,15,40,21,37,84,0,0 // movaps 0x5425(%rip),%xmm10 # 5f20 <_sk_callback_sse41+0x27d>
+ .byte 68,15,40,21,37,83,0,0 // movaps 0x5325(%rip),%xmm10 # 5e20 <_sk_callback_sse41+0x27f>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 65,15,40,195 // movaps %xmm11,%xmm0
@@ -27254,7 +26909,7 @@ _sk_softlight_sse41:
.byte 15,40,198 // movaps %xmm6,%xmm0
.byte 15,94,199 // divps %xmm7,%xmm0
.byte 65,15,84,193 // andps %xmm9,%xmm0
- .byte 15,40,13,252,82,0,0 // movaps 0x52fc(%rip),%xmm1 # 5f30 <_sk_callback_sse41+0x28d>
+ .byte 15,40,13,252,81,0,0 // movaps 0x51fc(%rip),%xmm1 # 5e30 <_sk_callback_sse41+0x28f>
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 68,15,92,208 // subps %xmm0,%xmm10
.byte 68,15,40,240 // movaps %xmm0,%xmm14
@@ -27267,10 +26922,10 @@ _sk_softlight_sse41:
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,89,210 // mulps %xmm2,%xmm2
.byte 15,88,208 // addps %xmm0,%xmm2
- .byte 68,15,40,45,218,82,0,0 // movaps 0x52da(%rip),%xmm13 # 5f40 <_sk_callback_sse41+0x29d>
+ .byte 68,15,40,45,218,81,0,0 // movaps 0x51da(%rip),%xmm13 # 5e40 <_sk_callback_sse41+0x29f>
.byte 69,15,88,245 // addps %xmm13,%xmm14
.byte 68,15,89,242 // mulps %xmm2,%xmm14
- .byte 68,15,40,37,218,82,0,0 // movaps 0x52da(%rip),%xmm12 # 5f50 <_sk_callback_sse41+0x2ad>
+ .byte 68,15,40,37,218,81,0,0 // movaps 0x51da(%rip),%xmm12 # 5e50 <_sk_callback_sse41+0x2af>
.byte 69,15,89,252 // mulps %xmm12,%xmm15
.byte 69,15,88,254 // addps %xmm14,%xmm15
.byte 15,40,198 // movaps %xmm6,%xmm0
@@ -27456,12 +27111,12 @@ _sk_hue_sse41:
.byte 68,15,84,208 // andps %xmm0,%xmm10
.byte 15,84,200 // andps %xmm0,%xmm1
.byte 68,15,84,232 // andps %xmm0,%xmm13
- .byte 15,40,5,69,80,0,0 // movaps 0x5045(%rip),%xmm0 # 5f60 <_sk_callback_sse41+0x2bd>
+ .byte 15,40,5,69,79,0,0 // movaps 0x4f45(%rip),%xmm0 # 5e60 <_sk_callback_sse41+0x2bf>
.byte 68,15,89,224 // mulps %xmm0,%xmm12
- .byte 15,40,21,74,80,0,0 // movaps 0x504a(%rip),%xmm2 # 5f70 <_sk_callback_sse41+0x2cd>
+ .byte 15,40,21,74,79,0,0 // movaps 0x4f4a(%rip),%xmm2 # 5e70 <_sk_callback_sse41+0x2cf>
.byte 15,89,250 // mulps %xmm2,%xmm7
.byte 65,15,88,252 // addps %xmm12,%xmm7
- .byte 68,15,40,53,75,80,0,0 // movaps 0x504b(%rip),%xmm14 # 5f80 <_sk_callback_sse41+0x2dd>
+ .byte 68,15,40,53,75,79,0,0 // movaps 0x4f4b(%rip),%xmm14 # 5e80 <_sk_callback_sse41+0x2df>
.byte 68,15,40,252 // movaps %xmm4,%xmm15
.byte 69,15,89,254 // mulps %xmm14,%xmm15
.byte 68,15,88,255 // addps %xmm7,%xmm15
@@ -27544,7 +27199,7 @@ _sk_hue_sse41:
.byte 65,15,88,214 // addps %xmm14,%xmm2
.byte 15,40,196 // movaps %xmm4,%xmm0
.byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1
- .byte 68,15,40,13,15,79,0,0 // movaps 0x4f0f(%rip),%xmm9 # 5f90 <_sk_callback_sse41+0x2ed>
+ .byte 68,15,40,13,15,78,0,0 // movaps 0x4e0f(%rip),%xmm9 # 5e90 <_sk_callback_sse41+0x2ef>
.byte 65,15,40,225 // movaps %xmm9,%xmm4
.byte 15,92,229 // subps %xmm5,%xmm4
.byte 15,40,68,36,200 // movaps -0x38(%rsp),%xmm0
@@ -27638,14 +27293,14 @@ _sk_saturation_sse41:
.byte 68,15,84,215 // andps %xmm7,%xmm10
.byte 68,15,84,223 // andps %xmm7,%xmm11
.byte 68,15,84,199 // andps %xmm7,%xmm8
- .byte 15,40,21,201,77,0,0 // movaps 0x4dc9(%rip),%xmm2 # 5fa0 <_sk_callback_sse41+0x2fd>
+ .byte 15,40,21,201,76,0,0 // movaps 0x4cc9(%rip),%xmm2 # 5ea0 <_sk_callback_sse41+0x2ff>
.byte 15,40,221 // movaps %xmm5,%xmm3
.byte 15,89,218 // mulps %xmm2,%xmm3
- .byte 15,40,13,204,77,0,0 // movaps 0x4dcc(%rip),%xmm1 # 5fb0 <_sk_callback_sse41+0x30d>
+ .byte 15,40,13,204,76,0,0 // movaps 0x4ccc(%rip),%xmm1 # 5eb0 <_sk_callback_sse41+0x30f>
.byte 15,40,254 // movaps %xmm6,%xmm7
.byte 15,89,249 // mulps %xmm1,%xmm7
.byte 15,88,251 // addps %xmm3,%xmm7
- .byte 68,15,40,45,203,77,0,0 // movaps 0x4dcb(%rip),%xmm13 # 5fc0 <_sk_callback_sse41+0x31d>
+ .byte 68,15,40,45,203,76,0,0 // movaps 0x4ccb(%rip),%xmm13 # 5ec0 <_sk_callback_sse41+0x31f>
.byte 69,15,89,245 // mulps %xmm13,%xmm14
.byte 68,15,88,247 // addps %xmm7,%xmm14
.byte 65,15,40,218 // movaps %xmm10,%xmm3
@@ -27726,7 +27381,7 @@ _sk_saturation_sse41:
.byte 65,15,88,253 // addps %xmm13,%xmm7
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 102,68,15,56,20,223 // blendvps %xmm0,%xmm7,%xmm11
- .byte 68,15,40,13,145,76,0,0 // movaps 0x4c91(%rip),%xmm9 # 5fd0 <_sk_callback_sse41+0x32d>
+ .byte 68,15,40,13,145,75,0,0 // movaps 0x4b91(%rip),%xmm9 # 5ed0 <_sk_callback_sse41+0x32f>
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 68,15,92,204 // subps %xmm4,%xmm9
.byte 15,40,124,36,168 // movaps -0x58(%rsp),%xmm7
@@ -27781,14 +27436,14 @@ _sk_color_sse41:
.byte 15,40,231 // movaps %xmm7,%xmm4
.byte 68,15,89,244 // mulps %xmm4,%xmm14
.byte 15,89,204 // mulps %xmm4,%xmm1
- .byte 68,15,40,13,220,75,0,0 // movaps 0x4bdc(%rip),%xmm9 # 5fe0 <_sk_callback_sse41+0x33d>
+ .byte 68,15,40,13,220,74,0,0 // movaps 0x4adc(%rip),%xmm9 # 5ee0 <_sk_callback_sse41+0x33f>
.byte 65,15,40,250 // movaps %xmm10,%xmm7
.byte 65,15,89,249 // mulps %xmm9,%xmm7
- .byte 68,15,40,21,220,75,0,0 // movaps 0x4bdc(%rip),%xmm10 # 5ff0 <_sk_callback_sse41+0x34d>
+ .byte 68,15,40,21,220,74,0,0 // movaps 0x4adc(%rip),%xmm10 # 5ef0 <_sk_callback_sse41+0x34f>
.byte 65,15,40,219 // movaps %xmm11,%xmm3
.byte 65,15,89,218 // mulps %xmm10,%xmm3
.byte 15,88,223 // addps %xmm7,%xmm3
- .byte 68,15,40,29,217,75,0,0 // movaps 0x4bd9(%rip),%xmm11 # 6000 <_sk_callback_sse41+0x35d>
+ .byte 68,15,40,29,217,74,0,0 // movaps 0x4ad9(%rip),%xmm11 # 5f00 <_sk_callback_sse41+0x35f>
.byte 69,15,40,236 // movaps %xmm12,%xmm13
.byte 69,15,89,235 // mulps %xmm11,%xmm13
.byte 68,15,88,235 // addps %xmm3,%xmm13
@@ -27873,7 +27528,7 @@ _sk_color_sse41:
.byte 65,15,88,251 // addps %xmm11,%xmm7
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 102,15,56,20,207 // blendvps %xmm0,%xmm7,%xmm1
- .byte 68,15,40,13,149,74,0,0 // movaps 0x4a95(%rip),%xmm9 # 6010 <_sk_callback_sse41+0x36d>
+ .byte 68,15,40,13,149,73,0,0 // movaps 0x4995(%rip),%xmm9 # 5f10 <_sk_callback_sse41+0x36f>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 68,15,89,192 // mulps %xmm0,%xmm8
@@ -27925,13 +27580,13 @@ _sk_luminosity_sse41:
.byte 69,15,89,216 // mulps %xmm8,%xmm11
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,89,205 // mulps %xmm5,%xmm9
- .byte 68,15,40,5,237,73,0,0 // movaps 0x49ed(%rip),%xmm8 # 6020 <_sk_callback_sse41+0x37d>
+ .byte 68,15,40,5,237,72,0,0 // movaps 0x48ed(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0x37f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
- .byte 68,15,40,21,241,73,0,0 // movaps 0x49f1(%rip),%xmm10 # 6030 <_sk_callback_sse41+0x38d>
+ .byte 68,15,40,21,241,72,0,0 // movaps 0x48f1(%rip),%xmm10 # 5f30 <_sk_callback_sse41+0x38f>
.byte 15,40,233 // movaps %xmm1,%xmm5
.byte 65,15,89,234 // mulps %xmm10,%xmm5
.byte 15,88,232 // addps %xmm0,%xmm5
- .byte 68,15,40,37,239,73,0,0 // movaps 0x49ef(%rip),%xmm12 # 6040 <_sk_callback_sse41+0x39d>
+ .byte 68,15,40,37,239,72,0,0 // movaps 0x48ef(%rip),%xmm12 # 5f40 <_sk_callback_sse41+0x39f>
.byte 68,15,40,242 // movaps %xmm2,%xmm14
.byte 69,15,89,244 // mulps %xmm12,%xmm14
.byte 68,15,88,245 // addps %xmm5,%xmm14
@@ -28016,7 +27671,7 @@ _sk_luminosity_sse41:
.byte 65,15,88,244 // addps %xmm12,%xmm6
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 102,68,15,56,20,206 // blendvps %xmm0,%xmm6,%xmm9
- .byte 15,40,5,165,72,0,0 // movaps 0x48a5(%rip),%xmm0 # 6050 <_sk_callback_sse41+0x3ad>
+ .byte 15,40,5,165,71,0,0 // movaps 0x47a5(%rip),%xmm0 # 5f50 <_sk_callback_sse41+0x3af>
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,92,215 // subps %xmm7,%xmm2
.byte 15,89,226 // mulps %xmm2,%xmm4
@@ -28059,20 +27714,20 @@ _sk_srcover_rgba_8888_sse41:
.byte 15,133,217,0,0,0 // jne 18ff <_sk_srcover_rgba_8888_sse41+0xe7>
.byte 243,15,111,60,144 // movdqu (%rax,%rdx,4),%xmm7
.byte 77,133,192 // test %r8,%r8
- .byte 102,15,111,37,42,72,0,0 // movdqa 0x482a(%rip),%xmm4 # 6060 <_sk_callback_sse41+0x3bd>
+ .byte 102,15,111,37,42,71,0,0 // movdqa 0x472a(%rip),%xmm4 # 5f60 <_sk_callback_sse41+0x3bf>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
.byte 102,15,111,239 // movdqa %xmm7,%xmm5
- .byte 102,15,56,0,45,38,72,0,0 // pshufb 0x4826(%rip),%xmm5 # 6070 <_sk_callback_sse41+0x3cd>
+ .byte 102,15,56,0,45,38,71,0,0 // pshufb 0x4726(%rip),%xmm5 # 5f70 <_sk_callback_sse41+0x3cf>
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
.byte 102,15,111,247 // movdqa %xmm7,%xmm6
- .byte 102,15,56,0,53,38,72,0,0 // pshufb 0x4826(%rip),%xmm6 # 6080 <_sk_callback_sse41+0x3dd>
+ .byte 102,15,56,0,53,38,71,0,0 // pshufb 0x4726(%rip),%xmm6 # 5f80 <_sk_callback_sse41+0x3df>
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 102,15,114,215,24 // psrld $0x18,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 68,15,40,5,35,72,0,0 // movaps 0x4823(%rip),%xmm8 # 6090 <_sk_callback_sse41+0x3ed>
+ .byte 68,15,40,5,35,71,0,0 // movaps 0x4723(%rip),%xmm8 # 5f90 <_sk_callback_sse41+0x3ef>
.byte 68,15,92,195 // subps %xmm3,%xmm8
- .byte 68,15,40,37,39,72,0,0 // movaps 0x4827(%rip),%xmm12 # 60a0 <_sk_callback_sse41+0x3fd>
+ .byte 68,15,40,37,39,71,0,0 // movaps 0x4727(%rip),%xmm12 # 5fa0 <_sk_callback_sse41+0x3ff>
.byte 65,15,89,196 // mulps %xmm12,%xmm0
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -28152,7 +27807,7 @@ HIDDEN _sk_clamp_1_sse41
.globl _sk_clamp_1_sse41
FUNCTION(_sk_clamp_1_sse41)
_sk_clamp_1_sse41:
- .byte 68,15,40,5,25,71,0,0 // movaps 0x4719(%rip),%xmm8 # 60b0 <_sk_callback_sse41+0x40d>
+ .byte 68,15,40,5,25,70,0,0 // movaps 0x4619(%rip),%xmm8 # 5fb0 <_sk_callback_sse41+0x40f>
.byte 65,15,93,192 // minps %xmm8,%xmm0
.byte 65,15,93,200 // minps %xmm8,%xmm1
.byte 65,15,93,208 // minps %xmm8,%xmm2
@@ -28164,7 +27819,7 @@ HIDDEN _sk_clamp_a_sse41
.globl _sk_clamp_a_sse41
FUNCTION(_sk_clamp_a_sse41)
_sk_clamp_a_sse41:
- .byte 15,93,29,14,71,0,0 // minps 0x470e(%rip),%xmm3 # 60c0 <_sk_callback_sse41+0x41d>
+ .byte 15,93,29,14,70,0,0 // minps 0x460e(%rip),%xmm3 # 5fc0 <_sk_callback_sse41+0x41f>
.byte 15,93,195 // minps %xmm3,%xmm0
.byte 15,93,203 // minps %xmm3,%xmm1
.byte 15,93,211 // minps %xmm3,%xmm2
@@ -28175,7 +27830,7 @@ HIDDEN _sk_clamp_a_dst_sse41
.globl _sk_clamp_a_dst_sse41
FUNCTION(_sk_clamp_a_dst_sse41)
_sk_clamp_a_dst_sse41:
- .byte 15,93,61,10,71,0,0 // minps 0x470a(%rip),%xmm7 # 60d0 <_sk_callback_sse41+0x42d>
+ .byte 15,93,61,10,70,0,0 // minps 0x460a(%rip),%xmm7 # 5fd0 <_sk_callback_sse41+0x42f>
.byte 15,93,231 // minps %xmm7,%xmm4
.byte 15,93,239 // minps %xmm7,%xmm5
.byte 15,93,247 // minps %xmm7,%xmm6
@@ -28243,7 +27898,7 @@ HIDDEN _sk_unpremul_sse41
FUNCTION(_sk_unpremul_sse41)
_sk_unpremul_sse41:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
- .byte 68,15,40,13,165,70,0,0 // movaps 0x46a5(%rip),%xmm9 # 60e0 <_sk_callback_sse41+0x43d>
+ .byte 68,15,40,13,165,69,0,0 // movaps 0x45a5(%rip),%xmm9 # 5fe0 <_sk_callback_sse41+0x43f>
.byte 68,15,94,203 // divps %xmm3,%xmm9
.byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8
.byte 69,15,84,193 // andps %xmm9,%xmm8
@@ -28257,20 +27912,20 @@ HIDDEN _sk_from_srgb_sse41
.globl _sk_from_srgb_sse41
FUNCTION(_sk_from_srgb_sse41)
_sk_from_srgb_sse41:
- .byte 68,15,40,29,144,70,0,0 // movaps 0x4690(%rip),%xmm11 # 60f0 <_sk_callback_sse41+0x44d>
+ .byte 68,15,40,29,144,69,0,0 // movaps 0x4590(%rip),%xmm11 # 5ff0 <_sk_callback_sse41+0x44f>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
.byte 68,15,40,208 // movaps %xmm0,%xmm10
.byte 69,15,89,210 // mulps %xmm10,%xmm10
- .byte 68,15,40,37,136,70,0,0 // movaps 0x4688(%rip),%xmm12 # 6100 <_sk_callback_sse41+0x45d>
+ .byte 68,15,40,37,136,69,0,0 // movaps 0x4588(%rip),%xmm12 # 6000 <_sk_callback_sse41+0x45f>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,196 // mulps %xmm12,%xmm8
- .byte 68,15,40,45,136,70,0,0 // movaps 0x4688(%rip),%xmm13 # 6110 <_sk_callback_sse41+0x46d>
+ .byte 68,15,40,45,136,69,0,0 // movaps 0x4588(%rip),%xmm13 # 6010 <_sk_callback_sse41+0x46f>
.byte 69,15,88,197 // addps %xmm13,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
- .byte 68,15,40,53,136,70,0,0 // movaps 0x4688(%rip),%xmm14 # 6120 <_sk_callback_sse41+0x47d>
+ .byte 68,15,40,53,136,69,0,0 // movaps 0x4588(%rip),%xmm14 # 6020 <_sk_callback_sse41+0x47f>
.byte 69,15,88,198 // addps %xmm14,%xmm8
- .byte 68,15,40,61,140,70,0,0 // movaps 0x468c(%rip),%xmm15 # 6130 <_sk_callback_sse41+0x48d>
+ .byte 68,15,40,61,140,69,0,0 // movaps 0x458c(%rip),%xmm15 # 6030 <_sk_callback_sse41+0x48f>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 68,15,40,209 // movaps %xmm1,%xmm10
@@ -28307,19 +27962,19 @@ FUNCTION(_sk_from_srgb_dst_sse41)
_sk_from_srgb_dst_sse41:
.byte 68,15,40,204 // movaps %xmm4,%xmm9
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,29,23,70,0,0 // movaps 0x4617(%rip),%xmm11 # 6140 <_sk_callback_sse41+0x49d>
+ .byte 68,15,40,29,23,69,0,0 // movaps 0x4517(%rip),%xmm11 # 6040 <_sk_callback_sse41+0x49f>
.byte 69,15,40,209 // movaps %xmm9,%xmm10
.byte 69,15,89,211 // mulps %xmm11,%xmm10
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
- .byte 68,15,40,37,16,70,0,0 // movaps 0x4610(%rip),%xmm12 # 6150 <_sk_callback_sse41+0x4ad>
+ .byte 68,15,40,37,16,69,0,0 // movaps 0x4510(%rip),%xmm12 # 6050 <_sk_callback_sse41+0x4af>
.byte 65,15,89,228 // mulps %xmm12,%xmm4
- .byte 68,15,40,45,20,70,0,0 // movaps 0x4614(%rip),%xmm13 # 6160 <_sk_callback_sse41+0x4bd>
+ .byte 68,15,40,45,20,69,0,0 // movaps 0x4514(%rip),%xmm13 # 6060 <_sk_callback_sse41+0x4bf>
.byte 65,15,88,229 // addps %xmm13,%xmm4
.byte 15,89,224 // mulps %xmm0,%xmm4
- .byte 68,15,40,53,21,70,0,0 // movaps 0x4615(%rip),%xmm14 # 6170 <_sk_callback_sse41+0x4cd>
+ .byte 68,15,40,53,21,69,0,0 // movaps 0x4515(%rip),%xmm14 # 6070 <_sk_callback_sse41+0x4cf>
.byte 65,15,88,230 // addps %xmm14,%xmm4
- .byte 68,15,40,61,25,70,0,0 // movaps 0x4619(%rip),%xmm15 # 6180 <_sk_callback_sse41+0x4dd>
+ .byte 68,15,40,61,25,69,0,0 // movaps 0x4519(%rip),%xmm15 # 6080 <_sk_callback_sse41+0x4df>
.byte 69,15,194,207,1 // cmpltps %xmm15,%xmm9
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 102,65,15,56,20,226 // blendvps %xmm0,%xmm10,%xmm4
@@ -28363,22 +28018,22 @@ _sk_to_srgb_sse41:
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 68,15,82,192 // rsqrtps %xmm0,%xmm8
- .byte 68,15,40,29,141,69,0,0 // movaps 0x458d(%rip),%xmm11 # 6190 <_sk_callback_sse41+0x4ed>
+ .byte 68,15,40,29,141,68,0,0 // movaps 0x448d(%rip),%xmm11 # 6090 <_sk_callback_sse41+0x4ef>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
- .byte 68,15,40,37,141,69,0,0 // movaps 0x458d(%rip),%xmm12 # 61a0 <_sk_callback_sse41+0x4fd>
+ .byte 68,15,40,37,141,68,0,0 // movaps 0x448d(%rip),%xmm12 # 60a0 <_sk_callback_sse41+0x4ff>
.byte 69,15,40,248 // movaps %xmm8,%xmm15
.byte 69,15,89,252 // mulps %xmm12,%xmm15
- .byte 68,15,40,21,141,69,0,0 // movaps 0x458d(%rip),%xmm10 # 61b0 <_sk_callback_sse41+0x50d>
+ .byte 68,15,40,21,141,68,0,0 // movaps 0x448d(%rip),%xmm10 # 60b0 <_sk_callback_sse41+0x50f>
.byte 69,15,88,250 // addps %xmm10,%xmm15
.byte 69,15,89,248 // mulps %xmm8,%xmm15
- .byte 68,15,40,45,141,69,0,0 // movaps 0x458d(%rip),%xmm13 # 61c0 <_sk_callback_sse41+0x51d>
+ .byte 68,15,40,45,141,68,0,0 // movaps 0x448d(%rip),%xmm13 # 60c0 <_sk_callback_sse41+0x51f>
.byte 69,15,88,253 // addps %xmm13,%xmm15
- .byte 68,15,40,53,145,69,0,0 // movaps 0x4591(%rip),%xmm14 # 61d0 <_sk_callback_sse41+0x52d>
+ .byte 68,15,40,53,145,68,0,0 // movaps 0x4491(%rip),%xmm14 # 60d0 <_sk_callback_sse41+0x52f>
.byte 69,15,88,198 // addps %xmm14,%xmm8
.byte 69,15,83,192 // rcpps %xmm8,%xmm8
.byte 69,15,89,199 // mulps %xmm15,%xmm8
- .byte 68,15,40,61,141,69,0,0 // movaps 0x458d(%rip),%xmm15 # 61e0 <_sk_callback_sse41+0x53d>
+ .byte 68,15,40,61,141,68,0,0 // movaps 0x448d(%rip),%xmm15 # 60e0 <_sk_callback_sse41+0x53f>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 68,15,82,202 // rsqrtps %xmm2,%xmm9
@@ -28431,7 +28086,7 @@ _sk_rgb_to_hsl_sse41:
.byte 68,15,93,226 // minps %xmm2,%xmm12
.byte 65,15,40,203 // movaps %xmm11,%xmm1
.byte 65,15,92,204 // subps %xmm12,%xmm1
- .byte 68,15,40,53,218,68,0,0 // movaps 0x44da(%rip),%xmm14 # 61f0 <_sk_callback_sse41+0x54d>
+ .byte 68,15,40,53,218,67,0,0 // movaps 0x43da(%rip),%xmm14 # 60f0 <_sk_callback_sse41+0x54f>
.byte 68,15,94,241 // divps %xmm1,%xmm14
.byte 69,15,40,211 // movaps %xmm11,%xmm10
.byte 69,15,194,208,0 // cmpeqps %xmm8,%xmm10
@@ -28440,27 +28095,27 @@ _sk_rgb_to_hsl_sse41:
.byte 65,15,89,198 // mulps %xmm14,%xmm0
.byte 69,15,40,249 // movaps %xmm9,%xmm15
.byte 68,15,194,250,1 // cmpltps %xmm2,%xmm15
- .byte 68,15,84,61,193,68,0,0 // andps 0x44c1(%rip),%xmm15 # 6200 <_sk_callback_sse41+0x55d>
+ .byte 68,15,84,61,193,67,0,0 // andps 0x43c1(%rip),%xmm15 # 6100 <_sk_callback_sse41+0x55f>
.byte 68,15,88,248 // addps %xmm0,%xmm15
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,194,193,0 // cmpeqps %xmm9,%xmm0
.byte 65,15,92,208 // subps %xmm8,%xmm2
.byte 65,15,89,214 // mulps %xmm14,%xmm2
- .byte 68,15,40,45,180,68,0,0 // movaps 0x44b4(%rip),%xmm13 # 6210 <_sk_callback_sse41+0x56d>
+ .byte 68,15,40,45,180,67,0,0 // movaps 0x43b4(%rip),%xmm13 # 6110 <_sk_callback_sse41+0x56f>
.byte 65,15,88,213 // addps %xmm13,%xmm2
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 69,15,89,198 // mulps %xmm14,%xmm8
- .byte 68,15,88,5,176,68,0,0 // addps 0x44b0(%rip),%xmm8 # 6220 <_sk_callback_sse41+0x57d>
+ .byte 68,15,88,5,176,67,0,0 // addps 0x43b0(%rip),%xmm8 # 6120 <_sk_callback_sse41+0x57f>
.byte 102,68,15,56,20,194 // blendvps %xmm0,%xmm2,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 102,69,15,56,20,199 // blendvps %xmm0,%xmm15,%xmm8
- .byte 68,15,89,5,168,68,0,0 // mulps 0x44a8(%rip),%xmm8 # 6230 <_sk_callback_sse41+0x58d>
+ .byte 68,15,89,5,168,67,0,0 // mulps 0x43a8(%rip),%xmm8 # 6130 <_sk_callback_sse41+0x58f>
.byte 69,15,40,203 // movaps %xmm11,%xmm9
.byte 69,15,194,204,4 // cmpneqps %xmm12,%xmm9
.byte 69,15,84,193 // andps %xmm9,%xmm8
.byte 69,15,92,235 // subps %xmm11,%xmm13
.byte 69,15,88,220 // addps %xmm12,%xmm11
- .byte 15,40,5,156,68,0,0 // movaps 0x449c(%rip),%xmm0 # 6240 <_sk_callback_sse41+0x59d>
+ .byte 15,40,5,156,67,0,0 // movaps 0x439c(%rip),%xmm0 # 6140 <_sk_callback_sse41+0x59f>
.byte 65,15,40,211 // movaps %xmm11,%xmm2
.byte 15,89,208 // mulps %xmm0,%xmm2
.byte 15,194,194,1 // cmpltps %xmm2,%xmm0
@@ -28482,7 +28137,7 @@ _sk_hsl_to_rgb_sse41:
.byte 15,41,100,36,184 // movaps %xmm4,-0x48(%rsp)
.byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp)
.byte 68,15,40,208 // movaps %xmm0,%xmm10
- .byte 68,15,40,13,98,68,0,0 // movaps 0x4462(%rip),%xmm9 # 6250 <_sk_callback_sse41+0x5ad>
+ .byte 68,15,40,13,98,67,0,0 // movaps 0x4362(%rip),%xmm9 # 6150 <_sk_callback_sse41+0x5af>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,194,194,2 // cmpleps %xmm2,%xmm0
.byte 15,40,217 // movaps %xmm1,%xmm3
@@ -28495,19 +28150,19 @@ _sk_hsl_to_rgb_sse41:
.byte 15,41,84,36,152 // movaps %xmm2,-0x68(%rsp)
.byte 69,15,88,192 // addps %xmm8,%xmm8
.byte 68,15,92,197 // subps %xmm5,%xmm8
- .byte 68,15,40,53,61,68,0,0 // movaps 0x443d(%rip),%xmm14 # 6260 <_sk_callback_sse41+0x5bd>
+ .byte 68,15,40,53,61,67,0,0 // movaps 0x433d(%rip),%xmm14 # 6160 <_sk_callback_sse41+0x5bf>
.byte 69,15,88,242 // addps %xmm10,%xmm14
.byte 102,65,15,58,8,198,1 // roundps $0x1,%xmm14,%xmm0
.byte 68,15,92,240 // subps %xmm0,%xmm14
- .byte 68,15,40,29,54,68,0,0 // movaps 0x4436(%rip),%xmm11 # 6270 <_sk_callback_sse41+0x5cd>
+ .byte 68,15,40,29,54,67,0,0 // movaps 0x4336(%rip),%xmm11 # 6170 <_sk_callback_sse41+0x5cf>
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 15,40,245 // movaps %xmm5,%xmm6
.byte 65,15,92,240 // subps %xmm8,%xmm6
- .byte 15,40,61,47,68,0,0 // movaps 0x442f(%rip),%xmm7 # 6280 <_sk_callback_sse41+0x5dd>
+ .byte 15,40,61,47,67,0,0 // movaps 0x432f(%rip),%xmm7 # 6180 <_sk_callback_sse41+0x5df>
.byte 69,15,40,238 // movaps %xmm14,%xmm13
.byte 68,15,89,239 // mulps %xmm7,%xmm13
- .byte 15,40,29,48,68,0,0 // movaps 0x4430(%rip),%xmm3 # 6290 <_sk_callback_sse41+0x5ed>
+ .byte 15,40,29,48,67,0,0 // movaps 0x4330(%rip),%xmm3 # 6190 <_sk_callback_sse41+0x5ef>
.byte 68,15,40,227 // movaps %xmm3,%xmm12
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 68,15,89,230 // mulps %xmm6,%xmm12
@@ -28517,7 +28172,7 @@ _sk_hsl_to_rgb_sse41:
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 68,15,40,253 // movaps %xmm5,%xmm15
.byte 102,69,15,56,20,252 // blendvps %xmm0,%xmm12,%xmm15
- .byte 68,15,40,37,15,68,0,0 // movaps 0x440f(%rip),%xmm12 # 62a0 <_sk_callback_sse41+0x5fd>
+ .byte 68,15,40,37,15,67,0,0 // movaps 0x430f(%rip),%xmm12 # 61a0 <_sk_callback_sse41+0x5ff>
.byte 65,15,40,196 // movaps %xmm12,%xmm0
.byte 65,15,194,198,2 // cmpleps %xmm14,%xmm0
.byte 68,15,89,238 // mulps %xmm6,%xmm13
@@ -28551,7 +28206,7 @@ _sk_hsl_to_rgb_sse41:
.byte 65,15,40,198 // movaps %xmm14,%xmm0
.byte 15,40,84,36,152 // movaps -0x68(%rsp),%xmm2
.byte 102,15,56,20,202 // blendvps %xmm0,%xmm2,%xmm1
- .byte 68,15,88,21,135,67,0,0 // addps 0x4387(%rip),%xmm10 # 62b0 <_sk_callback_sse41+0x60d>
+ .byte 68,15,88,21,135,66,0,0 // addps 0x4287(%rip),%xmm10 # 61b0 <_sk_callback_sse41+0x60f>
.byte 102,65,15,58,8,194,1 // roundps $0x1,%xmm10,%xmm0
.byte 68,15,92,208 // subps %xmm0,%xmm10
.byte 69,15,194,218,2 // cmpleps %xmm10,%xmm11
@@ -28604,9 +28259,9 @@ _sk_scale_u8_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,52 // jne 2002 <_sk_scale_u8_sse41+0x3e>
.byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8
- .byte 102,68,15,219,5,226,66,0,0 // pand 0x42e2(%rip),%xmm8 # 62c0 <_sk_callback_sse41+0x61d>
+ .byte 102,68,15,219,5,226,65,0,0 // pand 0x41e2(%rip),%xmm8 # 61c0 <_sk_callback_sse41+0x61f>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,230,66,0,0 // mulps 0x42e6(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x62d>
+ .byte 68,15,89,5,230,65,0,0 // mulps 0x41e6(%rip),%xmm8 # 61d0 <_sk_callback_sse41+0x62f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
@@ -28666,9 +28321,9 @@ _sk_lerp_u8_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,72 // jne 20e3 <_sk_lerp_u8_sse41+0x52>
.byte 102,69,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm8
- .byte 102,68,15,219,5,53,66,0,0 // pand 0x4235(%rip),%xmm8 # 62e0 <_sk_callback_sse41+0x63d>
+ .byte 102,68,15,219,5,53,65,0,0 // pand 0x4135(%rip),%xmm8 # 61e0 <_sk_callback_sse41+0x63f>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,57,66,0,0 // mulps 0x4239(%rip),%xmm8 # 62f0 <_sk_callback_sse41+0x64d>
+ .byte 68,15,89,5,57,65,0,0 // mulps 0x4139(%rip),%xmm8 # 61f0 <_sk_callback_sse41+0x64f>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -28713,17 +28368,17 @@ _sk_lerp_565_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 15,133,152,0,0,0 // jne 21e3 <_sk_lerp_565_sse41+0xa6>
.byte 102,69,15,56,51,20,82 // pmovzxwd (%r10,%rdx,2),%xmm10
- .byte 102,68,15,111,5,165,65,0,0 // movdqa 0x41a5(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x65d>
+ .byte 102,68,15,111,5,165,64,0,0 // movdqa 0x40a5(%rip),%xmm8 # 6200 <_sk_callback_sse41+0x65f>
.byte 102,69,15,219,194 // pand %xmm10,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,164,65,0,0 // mulps 0x41a4(%rip),%xmm8 # 6310 <_sk_callback_sse41+0x66d>
- .byte 102,68,15,111,13,171,65,0,0 // movdqa 0x41ab(%rip),%xmm9 # 6320 <_sk_callback_sse41+0x67d>
+ .byte 68,15,89,5,164,64,0,0 // mulps 0x40a4(%rip),%xmm8 # 6210 <_sk_callback_sse41+0x66f>
+ .byte 102,68,15,111,13,171,64,0,0 // movdqa 0x40ab(%rip),%xmm9 # 6220 <_sk_callback_sse41+0x67f>
.byte 102,69,15,219,202 // pand %xmm10,%xmm9
.byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9
- .byte 68,15,89,13,170,65,0,0 // mulps 0x41aa(%rip),%xmm9 # 6330 <_sk_callback_sse41+0x68d>
- .byte 102,68,15,219,21,177,65,0,0 // pand 0x41b1(%rip),%xmm10 # 6340 <_sk_callback_sse41+0x69d>
+ .byte 68,15,89,13,170,64,0,0 // mulps 0x40aa(%rip),%xmm9 # 6230 <_sk_callback_sse41+0x68f>
+ .byte 102,68,15,219,21,177,64,0,0 // pand 0x40b1(%rip),%xmm10 # 6240 <_sk_callback_sse41+0x69f>
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
- .byte 68,15,89,21,181,65,0,0 // mulps 0x41b5(%rip),%xmm10 # 6350 <_sk_callback_sse41+0x6ad>
+ .byte 68,15,89,21,181,64,0,0 // mulps 0x40b5(%rip),%xmm10 # 6250 <_sk_callback_sse41+0x6af>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -28777,7 +28432,7 @@ _sk_load_tables_sse41:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 102,15,111,5,2,65,0,0 // movdqa 0x4102(%rip),%xmm0 # 6360 <_sk_callback_sse41+0x6bd>
+ .byte 102,15,111,5,2,64,0,0 // movdqa 0x4002(%rip),%xmm0 # 6260 <_sk_callback_sse41+0x6bf>
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
.byte 102,73,15,126,194 // movq %xmm0,%r10
@@ -28792,7 +28447,7 @@ _sk_load_tables_sse41:
.byte 102,66,15,58,33,4,179,32 // insertps $0x20,(%rbx,%r14,4),%xmm0
.byte 102,66,15,58,33,4,11,48 // insertps $0x30,(%rbx,%r9,1),%xmm0
.byte 102,65,15,111,200 // movdqa %xmm8,%xmm1
- .byte 102,15,56,0,13,189,64,0,0 // pshufb 0x40bd(%rip),%xmm1 # 6370 <_sk_callback_sse41+0x6cd>
+ .byte 102,15,56,0,13,189,63,0,0 // pshufb 0x3fbd(%rip),%xmm1 # 6270 <_sk_callback_sse41+0x6cf>
.byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
.byte 68,15,182,211 // movzbl %bl,%r10d
@@ -28807,7 +28462,7 @@ _sk_load_tables_sse41:
.byte 102,15,58,33,202,48 // insertps $0x30,%xmm2,%xmm1
.byte 76,139,72,24 // mov 0x18(%rax),%r9
.byte 102,65,15,111,208 // movdqa %xmm8,%xmm2
- .byte 102,15,56,0,21,121,64,0,0 // pshufb 0x4079(%rip),%xmm2 # 6380 <_sk_callback_sse41+0x6dd>
+ .byte 102,15,56,0,21,121,63,0,0 // pshufb 0x3f79(%rip),%xmm2 # 6280 <_sk_callback_sse41+0x6df>
.byte 102,72,15,58,22,211,1 // pextrq $0x1,%xmm2,%rbx
.byte 102,72,15,126,208 // movq %xmm2,%rax
.byte 68,15,182,208 // movzbl %al,%r10d
@@ -28822,7 +28477,7 @@ _sk_load_tables_sse41:
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 102,65,15,114,208,24 // psrld $0x18,%xmm8
.byte 65,15,91,216 // cvtdq2ps %xmm8,%xmm3
- .byte 15,89,29,54,64,0,0 // mulps 0x4036(%rip),%xmm3 # 6390 <_sk_callback_sse41+0x6ed>
+ .byte 15,89,29,54,63,0,0 // mulps 0x3f36(%rip),%xmm3 # 6290 <_sk_callback_sse41+0x6ef>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
@@ -28865,7 +28520,7 @@ _sk_load_tables_u16_be_sse41:
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,97,200 // punpcklwd %xmm0,%xmm1
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
- .byte 102,68,15,111,5,164,63,0,0 // movdqa 0x3fa4(%rip),%xmm8 # 63a0 <_sk_callback_sse41+0x6fd>
+ .byte 102,68,15,111,5,164,62,0,0 // movdqa 0x3ea4(%rip),%xmm8 # 62a0 <_sk_callback_sse41+0x6ff>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
@@ -28883,7 +28538,7 @@ _sk_load_tables_u16_be_sse41:
.byte 102,15,58,33,194,32 // insertps $0x20,%xmm2,%xmm0
.byte 243,66,15,16,20,11 // movss (%rbx,%r9,1),%xmm2
.byte 102,15,58,33,194,48 // insertps $0x30,%xmm2,%xmm0
- .byte 102,15,56,0,13,83,63,0,0 // pshufb 0x3f53(%rip),%xmm1 # 63b0 <_sk_callback_sse41+0x70d>
+ .byte 102,15,56,0,13,83,62,0,0 // pshufb 0x3e53(%rip),%xmm1 # 62b0 <_sk_callback_sse41+0x70f>
.byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1
.byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
@@ -28919,7 +28574,7 @@ _sk_load_tables_u16_be_sse41:
.byte 102,65,15,235,216 // por %xmm8,%xmm3
.byte 102,15,56,51,219 // pmovzxwd %xmm3,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,161,62,0,0 // mulps 0x3ea1(%rip),%xmm3 # 63c0 <_sk_callback_sse41+0x71d>
+ .byte 15,89,29,161,61,0,0 // mulps 0x3da1(%rip),%xmm3 # 62c0 <_sk_callback_sse41+0x71f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
@@ -28961,7 +28616,7 @@ _sk_load_tables_rgb_u16_be_sse41:
.byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9
.byte 102,15,111,202 // movdqa %xmm2,%xmm1
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
- .byte 102,68,15,111,5,22,62,0,0 // movdqa 0x3e16(%rip),%xmm8 # 63d0 <_sk_callback_sse41+0x72d>
+ .byte 102,68,15,111,5,22,61,0,0 // movdqa 0x3d16(%rip),%xmm8 # 62d0 <_sk_callback_sse41+0x72f>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
@@ -28979,7 +28634,7 @@ _sk_load_tables_rgb_u16_be_sse41:
.byte 102,15,58,33,195,32 // insertps $0x20,%xmm3,%xmm0
.byte 243,66,15,16,28,11 // movss (%rbx,%r9,1),%xmm3
.byte 102,15,58,33,195,48 // insertps $0x30,%xmm3,%xmm0
- .byte 102,15,56,0,13,197,61,0,0 // pshufb 0x3dc5(%rip),%xmm1 # 63e0 <_sk_callback_sse41+0x73d>
+ .byte 102,15,56,0,13,197,60,0,0 // pshufb 0x3cc5(%rip),%xmm1 # 62e0 <_sk_callback_sse41+0x73f>
.byte 102,15,56,51,201 // pmovzxwd %xmm1,%xmm1
.byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 102,72,15,126,203 // movq %xmm1,%rbx
@@ -29010,7 +28665,7 @@ _sk_load_tables_rgb_u16_be_sse41:
.byte 243,65,15,16,28,25 // movss (%r9,%rbx,1),%xmm3
.byte 102,15,58,33,211,48 // insertps $0x30,%xmm3,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,48,61,0,0 // movaps 0x3d30(%rip),%xmm3 # 63f0 <_sk_callback_sse41+0x74d>
+ .byte 15,40,29,48,60,0,0 // movaps 0x3c30(%rip),%xmm3 # 62f0 <_sk_callback_sse41+0x74f>
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
@@ -29044,7 +28699,7 @@ _sk_byte_tables_sse41:
.byte 65,84 // push %r12
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,200,60,0,0 // movaps 0x3cc8(%rip),%xmm8 # 6400 <_sk_callback_sse41+0x75d>
+ .byte 68,15,40,5,200,59,0,0 // movaps 0x3bc8(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x75f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
.byte 102,73,15,58,22,193,1 // pextrq $0x1,%xmm0,%r9
@@ -29063,7 +28718,7 @@ _sk_byte_tables_sse41:
.byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,13,121,60,0,0 // movaps 0x3c79(%rip),%xmm9 # 6410 <_sk_callback_sse41+0x76d>
+ .byte 68,15,40,13,121,59,0,0 // movaps 0x3b79(%rip),%xmm9 # 6310 <_sk_callback_sse41+0x76f>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
@@ -29159,7 +28814,7 @@ _sk_byte_tables_rgb_sse41:
.byte 102,15,58,32,195,3 // pinsrb $0x3,%ebx,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,13,241,58,0,0 // movaps 0x3af1(%rip),%xmm9 # 6420 <_sk_callback_sse41+0x77d>
+ .byte 68,15,40,13,241,57,0,0 // movaps 0x39f1(%rip),%xmm9 # 6320 <_sk_callback_sse41+0x77f>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
@@ -29346,31 +29001,31 @@ _sk_parametric_r_sse41:
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,194 // cvtdq2ps %xmm10,%xmm8
- .byte 68,15,89,5,57,56,0,0 // mulps 0x3839(%rip),%xmm8 # 6430 <_sk_callback_sse41+0x78d>
- .byte 68,15,84,21,65,56,0,0 // andps 0x3841(%rip),%xmm10 # 6440 <_sk_callback_sse41+0x79d>
- .byte 68,15,86,21,73,56,0,0 // orps 0x3849(%rip),%xmm10 # 6450 <_sk_callback_sse41+0x7ad>
- .byte 68,15,88,5,81,56,0,0 // addps 0x3851(%rip),%xmm8 # 6460 <_sk_callback_sse41+0x7bd>
- .byte 68,15,40,37,89,56,0,0 // movaps 0x3859(%rip),%xmm12 # 6470 <_sk_callback_sse41+0x7cd>
+ .byte 68,15,89,5,57,55,0,0 // mulps 0x3739(%rip),%xmm8 # 6330 <_sk_callback_sse41+0x78f>
+ .byte 68,15,84,21,65,55,0,0 // andps 0x3741(%rip),%xmm10 # 6340 <_sk_callback_sse41+0x79f>
+ .byte 68,15,86,21,73,55,0,0 // orps 0x3749(%rip),%xmm10 # 6350 <_sk_callback_sse41+0x7af>
+ .byte 68,15,88,5,81,55,0,0 // addps 0x3751(%rip),%xmm8 # 6360 <_sk_callback_sse41+0x7bf>
+ .byte 68,15,40,37,89,55,0,0 // movaps 0x3759(%rip),%xmm12 # 6370 <_sk_callback_sse41+0x7cf>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,196 // subps %xmm12,%xmm8
- .byte 68,15,88,21,89,56,0,0 // addps 0x3859(%rip),%xmm10 # 6480 <_sk_callback_sse41+0x7dd>
- .byte 68,15,40,37,97,56,0,0 // movaps 0x3861(%rip),%xmm12 # 6490 <_sk_callback_sse41+0x7ed>
+ .byte 68,15,88,21,89,55,0,0 // addps 0x3759(%rip),%xmm10 # 6380 <_sk_callback_sse41+0x7df>
+ .byte 68,15,40,37,97,55,0,0 // movaps 0x3761(%rip),%xmm12 # 6390 <_sk_callback_sse41+0x7ef>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,196 // subps %xmm12,%xmm8
.byte 69,15,89,195 // mulps %xmm11,%xmm8
.byte 102,69,15,58,8,208,1 // roundps $0x1,%xmm8,%xmm10
.byte 69,15,40,216 // movaps %xmm8,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,5,78,56,0,0 // addps 0x384e(%rip),%xmm8 # 64a0 <_sk_callback_sse41+0x7fd>
- .byte 68,15,40,21,86,56,0,0 // movaps 0x3856(%rip),%xmm10 # 64b0 <_sk_callback_sse41+0x80d>
+ .byte 68,15,88,5,78,55,0,0 // addps 0x374e(%rip),%xmm8 # 63a0 <_sk_callback_sse41+0x7ff>
+ .byte 68,15,40,21,86,55,0,0 // movaps 0x3756(%rip),%xmm10 # 63b0 <_sk_callback_sse41+0x80f>
.byte 69,15,89,211 // mulps %xmm11,%xmm10
.byte 69,15,92,194 // subps %xmm10,%xmm8
- .byte 68,15,40,21,86,56,0,0 // movaps 0x3856(%rip),%xmm10 # 64c0 <_sk_callback_sse41+0x81d>
+ .byte 68,15,40,21,86,55,0,0 // movaps 0x3756(%rip),%xmm10 # 63c0 <_sk_callback_sse41+0x81f>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 68,15,40,29,90,56,0,0 // movaps 0x385a(%rip),%xmm11 # 64d0 <_sk_callback_sse41+0x82d>
+ .byte 68,15,40,29,90,55,0,0 // movaps 0x375a(%rip),%xmm11 # 63d0 <_sk_callback_sse41+0x82f>
.byte 69,15,94,218 // divps %xmm10,%xmm11
.byte 69,15,88,216 // addps %xmm8,%xmm11
- .byte 68,15,89,29,90,56,0,0 // mulps 0x385a(%rip),%xmm11 # 64e0 <_sk_callback_sse41+0x83d>
+ .byte 68,15,89,29,90,55,0,0 // mulps 0x375a(%rip),%xmm11 # 63e0 <_sk_callback_sse41+0x83f>
.byte 102,69,15,91,211 // cvtps2dq %xmm11,%xmm10
.byte 243,68,15,16,64,20 // movss 0x14(%rax),%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
@@ -29378,7 +29033,7 @@ _sk_parametric_r_sse41:
.byte 102,69,15,56,20,193 // blendvps %xmm0,%xmm9,%xmm8
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,65,56,0,0 // minps 0x3841(%rip),%xmm8 # 64f0 <_sk_callback_sse41+0x84d>
+ .byte 68,15,93,5,65,55,0,0 // minps 0x3741(%rip),%xmm8 # 63f0 <_sk_callback_sse41+0x84f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -29408,31 +29063,31 @@ _sk_parametric_g_sse41:
.byte 68,15,88,217 // addps %xmm1,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,226,55,0,0 // mulps 0x37e2(%rip),%xmm12 # 6500 <_sk_callback_sse41+0x85d>
- .byte 68,15,84,29,234,55,0,0 // andps 0x37ea(%rip),%xmm11 # 6510 <_sk_callback_sse41+0x86d>
- .byte 68,15,86,29,242,55,0,0 // orps 0x37f2(%rip),%xmm11 # 6520 <_sk_callback_sse41+0x87d>
- .byte 68,15,88,37,250,55,0,0 // addps 0x37fa(%rip),%xmm12 # 6530 <_sk_callback_sse41+0x88d>
- .byte 15,40,13,3,56,0,0 // movaps 0x3803(%rip),%xmm1 # 6540 <_sk_callback_sse41+0x89d>
+ .byte 68,15,89,37,226,54,0,0 // mulps 0x36e2(%rip),%xmm12 # 6400 <_sk_callback_sse41+0x85f>
+ .byte 68,15,84,29,234,54,0,0 // andps 0x36ea(%rip),%xmm11 # 6410 <_sk_callback_sse41+0x86f>
+ .byte 68,15,86,29,242,54,0,0 // orps 0x36f2(%rip),%xmm11 # 6420 <_sk_callback_sse41+0x87f>
+ .byte 68,15,88,37,250,54,0,0 // addps 0x36fa(%rip),%xmm12 # 6430 <_sk_callback_sse41+0x88f>
+ .byte 15,40,13,3,55,0,0 // movaps 0x3703(%rip),%xmm1 # 6440 <_sk_callback_sse41+0x89f>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
- .byte 68,15,88,29,3,56,0,0 // addps 0x3803(%rip),%xmm11 # 6550 <_sk_callback_sse41+0x8ad>
- .byte 15,40,13,12,56,0,0 // movaps 0x380c(%rip),%xmm1 # 6560 <_sk_callback_sse41+0x8bd>
+ .byte 68,15,88,29,3,55,0,0 // addps 0x3703(%rip),%xmm11 # 6450 <_sk_callback_sse41+0x8af>
+ .byte 15,40,13,12,55,0,0 // movaps 0x370c(%rip),%xmm1 # 6460 <_sk_callback_sse41+0x8bf>
.byte 65,15,94,203 // divps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,249,55,0,0 // addps 0x37f9(%rip),%xmm12 # 6570 <_sk_callback_sse41+0x8cd>
- .byte 15,40,13,2,56,0,0 // movaps 0x3802(%rip),%xmm1 # 6580 <_sk_callback_sse41+0x8dd>
+ .byte 68,15,88,37,249,54,0,0 // addps 0x36f9(%rip),%xmm12 # 6470 <_sk_callback_sse41+0x8cf>
+ .byte 15,40,13,2,55,0,0 // movaps 0x3702(%rip),%xmm1 # 6480 <_sk_callback_sse41+0x8df>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 68,15,92,225 // subps %xmm1,%xmm12
- .byte 68,15,40,21,2,56,0,0 // movaps 0x3802(%rip),%xmm10 # 6590 <_sk_callback_sse41+0x8ed>
+ .byte 68,15,40,21,2,55,0,0 // movaps 0x3702(%rip),%xmm10 # 6490 <_sk_callback_sse41+0x8ef>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,13,7,56,0,0 // movaps 0x3807(%rip),%xmm1 # 65a0 <_sk_callback_sse41+0x8fd>
+ .byte 15,40,13,7,55,0,0 // movaps 0x3707(%rip),%xmm1 # 64a0 <_sk_callback_sse41+0x8ff>
.byte 65,15,94,202 // divps %xmm10,%xmm1
.byte 65,15,88,204 // addps %xmm12,%xmm1
- .byte 15,89,13,8,56,0,0 // mulps 0x3808(%rip),%xmm1 # 65b0 <_sk_callback_sse41+0x90d>
+ .byte 15,89,13,8,55,0,0 // mulps 0x3708(%rip),%xmm1 # 64b0 <_sk_callback_sse41+0x90f>
.byte 102,68,15,91,209 // cvtps2dq %xmm1,%xmm10
.byte 243,15,16,72,20 // movss 0x14(%rax),%xmm1
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
@@ -29440,7 +29095,7 @@ _sk_parametric_g_sse41:
.byte 102,65,15,56,20,201 // blendvps %xmm0,%xmm9,%xmm1
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,200 // maxps %xmm0,%xmm1
- .byte 15,93,13,243,55,0,0 // minps 0x37f3(%rip),%xmm1 # 65c0 <_sk_callback_sse41+0x91d>
+ .byte 15,93,13,243,54,0,0 // minps 0x36f3(%rip),%xmm1 # 64c0 <_sk_callback_sse41+0x91f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -29470,31 +29125,31 @@ _sk_parametric_b_sse41:
.byte 68,15,88,218 // addps %xmm2,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,148,55,0,0 // mulps 0x3794(%rip),%xmm12 # 65d0 <_sk_callback_sse41+0x92d>
- .byte 68,15,84,29,156,55,0,0 // andps 0x379c(%rip),%xmm11 # 65e0 <_sk_callback_sse41+0x93d>
- .byte 68,15,86,29,164,55,0,0 // orps 0x37a4(%rip),%xmm11 # 65f0 <_sk_callback_sse41+0x94d>
- .byte 68,15,88,37,172,55,0,0 // addps 0x37ac(%rip),%xmm12 # 6600 <_sk_callback_sse41+0x95d>
- .byte 15,40,21,181,55,0,0 // movaps 0x37b5(%rip),%xmm2 # 6610 <_sk_callback_sse41+0x96d>
+ .byte 68,15,89,37,148,54,0,0 // mulps 0x3694(%rip),%xmm12 # 64d0 <_sk_callback_sse41+0x92f>
+ .byte 68,15,84,29,156,54,0,0 // andps 0x369c(%rip),%xmm11 # 64e0 <_sk_callback_sse41+0x93f>
+ .byte 68,15,86,29,164,54,0,0 // orps 0x36a4(%rip),%xmm11 # 64f0 <_sk_callback_sse41+0x94f>
+ .byte 68,15,88,37,172,54,0,0 // addps 0x36ac(%rip),%xmm12 # 6500 <_sk_callback_sse41+0x95f>
+ .byte 15,40,21,181,54,0,0 // movaps 0x36b5(%rip),%xmm2 # 6510 <_sk_callback_sse41+0x96f>
.byte 65,15,89,211 // mulps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
- .byte 68,15,88,29,181,55,0,0 // addps 0x37b5(%rip),%xmm11 # 6620 <_sk_callback_sse41+0x97d>
- .byte 15,40,21,190,55,0,0 // movaps 0x37be(%rip),%xmm2 # 6630 <_sk_callback_sse41+0x98d>
+ .byte 68,15,88,29,181,54,0,0 // addps 0x36b5(%rip),%xmm11 # 6520 <_sk_callback_sse41+0x97f>
+ .byte 15,40,21,190,54,0,0 // movaps 0x36be(%rip),%xmm2 # 6530 <_sk_callback_sse41+0x98f>
.byte 65,15,94,211 // divps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,171,55,0,0 // addps 0x37ab(%rip),%xmm12 # 6640 <_sk_callback_sse41+0x99d>
- .byte 15,40,21,180,55,0,0 // movaps 0x37b4(%rip),%xmm2 # 6650 <_sk_callback_sse41+0x9ad>
+ .byte 68,15,88,37,171,54,0,0 // addps 0x36ab(%rip),%xmm12 # 6540 <_sk_callback_sse41+0x99f>
+ .byte 15,40,21,180,54,0,0 // movaps 0x36b4(%rip),%xmm2 # 6550 <_sk_callback_sse41+0x9af>
.byte 65,15,89,211 // mulps %xmm11,%xmm2
.byte 68,15,92,226 // subps %xmm2,%xmm12
- .byte 68,15,40,21,180,55,0,0 // movaps 0x37b4(%rip),%xmm10 # 6660 <_sk_callback_sse41+0x9bd>
+ .byte 68,15,40,21,180,54,0,0 // movaps 0x36b4(%rip),%xmm10 # 6560 <_sk_callback_sse41+0x9bf>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,21,185,55,0,0 // movaps 0x37b9(%rip),%xmm2 # 6670 <_sk_callback_sse41+0x9cd>
+ .byte 15,40,21,185,54,0,0 // movaps 0x36b9(%rip),%xmm2 # 6570 <_sk_callback_sse41+0x9cf>
.byte 65,15,94,210 // divps %xmm10,%xmm2
.byte 65,15,88,212 // addps %xmm12,%xmm2
- .byte 15,89,21,186,55,0,0 // mulps 0x37ba(%rip),%xmm2 # 6680 <_sk_callback_sse41+0x9dd>
+ .byte 15,89,21,186,54,0,0 // mulps 0x36ba(%rip),%xmm2 # 6580 <_sk_callback_sse41+0x9df>
.byte 102,68,15,91,210 // cvtps2dq %xmm2,%xmm10
.byte 243,15,16,80,20 // movss 0x14(%rax),%xmm2
.byte 15,198,210,0 // shufps $0x0,%xmm2,%xmm2
@@ -29502,7 +29157,7 @@ _sk_parametric_b_sse41:
.byte 102,65,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm2
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,208 // maxps %xmm0,%xmm2
- .byte 15,93,21,165,55,0,0 // minps 0x37a5(%rip),%xmm2 # 6690 <_sk_callback_sse41+0x9ed>
+ .byte 15,93,21,165,54,0,0 // minps 0x36a5(%rip),%xmm2 # 6590 <_sk_callback_sse41+0x9ef>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -29532,31 +29187,31 @@ _sk_parametric_a_sse41:
.byte 68,15,88,219 // addps %xmm3,%xmm11
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,91,227 // cvtdq2ps %xmm11,%xmm12
- .byte 68,15,89,37,70,55,0,0 // mulps 0x3746(%rip),%xmm12 # 66a0 <_sk_callback_sse41+0x9fd>
- .byte 68,15,84,29,78,55,0,0 // andps 0x374e(%rip),%xmm11 # 66b0 <_sk_callback_sse41+0xa0d>
- .byte 68,15,86,29,86,55,0,0 // orps 0x3756(%rip),%xmm11 # 66c0 <_sk_callback_sse41+0xa1d>
- .byte 68,15,88,37,94,55,0,0 // addps 0x375e(%rip),%xmm12 # 66d0 <_sk_callback_sse41+0xa2d>
- .byte 15,40,29,103,55,0,0 // movaps 0x3767(%rip),%xmm3 # 66e0 <_sk_callback_sse41+0xa3d>
+ .byte 68,15,89,37,70,54,0,0 // mulps 0x3646(%rip),%xmm12 # 65a0 <_sk_callback_sse41+0x9ff>
+ .byte 68,15,84,29,78,54,0,0 // andps 0x364e(%rip),%xmm11 # 65b0 <_sk_callback_sse41+0xa0f>
+ .byte 68,15,86,29,86,54,0,0 // orps 0x3656(%rip),%xmm11 # 65c0 <_sk_callback_sse41+0xa1f>
+ .byte 68,15,88,37,94,54,0,0 // addps 0x365e(%rip),%xmm12 # 65d0 <_sk_callback_sse41+0xa2f>
+ .byte 15,40,29,103,54,0,0 // movaps 0x3667(%rip),%xmm3 # 65e0 <_sk_callback_sse41+0xa3f>
.byte 65,15,89,219 // mulps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
- .byte 68,15,88,29,103,55,0,0 // addps 0x3767(%rip),%xmm11 # 66f0 <_sk_callback_sse41+0xa4d>
- .byte 15,40,29,112,55,0,0 // movaps 0x3770(%rip),%xmm3 # 6700 <_sk_callback_sse41+0xa5d>
+ .byte 68,15,88,29,103,54,0,0 // addps 0x3667(%rip),%xmm11 # 65f0 <_sk_callback_sse41+0xa4f>
+ .byte 15,40,29,112,54,0,0 // movaps 0x3670(%rip),%xmm3 # 6600 <_sk_callback_sse41+0xa5f>
.byte 65,15,94,219 // divps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 102,69,15,58,8,212,1 // roundps $0x1,%xmm12,%xmm10
.byte 69,15,40,220 // movaps %xmm12,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 68,15,88,37,93,55,0,0 // addps 0x375d(%rip),%xmm12 # 6710 <_sk_callback_sse41+0xa6d>
- .byte 15,40,29,102,55,0,0 // movaps 0x3766(%rip),%xmm3 # 6720 <_sk_callback_sse41+0xa7d>
+ .byte 68,15,88,37,93,54,0,0 // addps 0x365d(%rip),%xmm12 # 6610 <_sk_callback_sse41+0xa6f>
+ .byte 15,40,29,102,54,0,0 // movaps 0x3666(%rip),%xmm3 # 6620 <_sk_callback_sse41+0xa7f>
.byte 65,15,89,219 // mulps %xmm11,%xmm3
.byte 68,15,92,227 // subps %xmm3,%xmm12
- .byte 68,15,40,21,102,55,0,0 // movaps 0x3766(%rip),%xmm10 # 6730 <_sk_callback_sse41+0xa8d>
+ .byte 68,15,40,21,102,54,0,0 // movaps 0x3666(%rip),%xmm10 # 6630 <_sk_callback_sse41+0xa8f>
.byte 69,15,92,211 // subps %xmm11,%xmm10
- .byte 15,40,29,107,55,0,0 // movaps 0x376b(%rip),%xmm3 # 6740 <_sk_callback_sse41+0xa9d>
+ .byte 15,40,29,107,54,0,0 // movaps 0x366b(%rip),%xmm3 # 6640 <_sk_callback_sse41+0xa9f>
.byte 65,15,94,218 // divps %xmm10,%xmm3
.byte 65,15,88,220 // addps %xmm12,%xmm3
- .byte 15,89,29,108,55,0,0 // mulps 0x376c(%rip),%xmm3 # 6750 <_sk_callback_sse41+0xaad>
+ .byte 15,89,29,108,54,0,0 // mulps 0x366c(%rip),%xmm3 # 6650 <_sk_callback_sse41+0xaaf>
.byte 102,68,15,91,211 // cvtps2dq %xmm3,%xmm10
.byte 243,15,16,88,20 // movss 0x14(%rax),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
@@ -29564,7 +29219,7 @@ _sk_parametric_a_sse41:
.byte 102,65,15,56,20,217 // blendvps %xmm0,%xmm9,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,95,216 // maxps %xmm0,%xmm3
- .byte 15,93,29,87,55,0,0 // minps 0x3757(%rip),%xmm3 # 6760 <_sk_callback_sse41+0xabd>
+ .byte 15,93,29,87,54,0,0 // minps 0x3657(%rip),%xmm3 # 6660 <_sk_callback_sse41+0xabf>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -29574,29 +29229,29 @@ HIDDEN _sk_lab_to_xyz_sse41
FUNCTION(_sk_lab_to_xyz_sse41)
_sk_lab_to_xyz_sse41:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,89,5,83,55,0,0 // mulps 0x3753(%rip),%xmm8 # 6770 <_sk_callback_sse41+0xacd>
- .byte 68,15,40,13,91,55,0,0 // movaps 0x375b(%rip),%xmm9 # 6780 <_sk_callback_sse41+0xadd>
+ .byte 68,15,89,5,83,54,0,0 // mulps 0x3653(%rip),%xmm8 # 6670 <_sk_callback_sse41+0xacf>
+ .byte 68,15,40,13,91,54,0,0 // movaps 0x365b(%rip),%xmm9 # 6680 <_sk_callback_sse41+0xadf>
.byte 65,15,89,201 // mulps %xmm9,%xmm1
- .byte 15,40,5,96,55,0,0 // movaps 0x3760(%rip),%xmm0 # 6790 <_sk_callback_sse41+0xaed>
+ .byte 15,40,5,96,54,0,0 // movaps 0x3660(%rip),%xmm0 # 6690 <_sk_callback_sse41+0xaef>
.byte 15,88,200 // addps %xmm0,%xmm1
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 15,88,208 // addps %xmm0,%xmm2
- .byte 68,15,88,5,94,55,0,0 // addps 0x375e(%rip),%xmm8 # 67a0 <_sk_callback_sse41+0xafd>
- .byte 68,15,89,5,102,55,0,0 // mulps 0x3766(%rip),%xmm8 # 67b0 <_sk_callback_sse41+0xb0d>
- .byte 15,89,13,111,55,0,0 // mulps 0x376f(%rip),%xmm1 # 67c0 <_sk_callback_sse41+0xb1d>
+ .byte 68,15,88,5,94,54,0,0 // addps 0x365e(%rip),%xmm8 # 66a0 <_sk_callback_sse41+0xaff>
+ .byte 68,15,89,5,102,54,0,0 // mulps 0x3666(%rip),%xmm8 # 66b0 <_sk_callback_sse41+0xb0f>
+ .byte 15,89,13,111,54,0,0 // mulps 0x366f(%rip),%xmm1 # 66c0 <_sk_callback_sse41+0xb1f>
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 15,89,21,116,55,0,0 // mulps 0x3774(%rip),%xmm2 # 67d0 <_sk_callback_sse41+0xb2d>
+ .byte 15,89,21,116,54,0,0 // mulps 0x3674(%rip),%xmm2 # 66d0 <_sk_callback_sse41+0xb2f>
.byte 69,15,40,208 // movaps %xmm8,%xmm10
.byte 68,15,92,210 // subps %xmm2,%xmm10
.byte 68,15,40,217 // movaps %xmm1,%xmm11
.byte 69,15,89,219 // mulps %xmm11,%xmm11
.byte 68,15,89,217 // mulps %xmm1,%xmm11
- .byte 68,15,40,13,104,55,0,0 // movaps 0x3768(%rip),%xmm9 # 67e0 <_sk_callback_sse41+0xb3d>
+ .byte 68,15,40,13,104,54,0,0 // movaps 0x3668(%rip),%xmm9 # 66e0 <_sk_callback_sse41+0xb3f>
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0
- .byte 15,40,21,104,55,0,0 // movaps 0x3768(%rip),%xmm2 # 67f0 <_sk_callback_sse41+0xb4d>
+ .byte 15,40,21,104,54,0,0 // movaps 0x3668(%rip),%xmm2 # 66f0 <_sk_callback_sse41+0xb4f>
.byte 15,88,202 // addps %xmm2,%xmm1
- .byte 68,15,40,37,109,55,0,0 // movaps 0x376d(%rip),%xmm12 # 6800 <_sk_callback_sse41+0xb5d>
+ .byte 68,15,40,37,109,54,0,0 // movaps 0x366d(%rip),%xmm12 # 6700 <_sk_callback_sse41+0xb5f>
.byte 65,15,89,204 // mulps %xmm12,%xmm1
.byte 102,65,15,56,20,203 // blendvps %xmm0,%xmm11,%xmm1
.byte 69,15,40,216 // movaps %xmm8,%xmm11
@@ -29615,8 +29270,8 @@ _sk_lab_to_xyz_sse41:
.byte 65,15,89,212 // mulps %xmm12,%xmm2
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 102,65,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm2
- .byte 15,89,13,38,55,0,0 // mulps 0x3726(%rip),%xmm1 # 6810 <_sk_callback_sse41+0xb6d>
- .byte 15,89,21,47,55,0,0 // mulps 0x372f(%rip),%xmm2 # 6820 <_sk_callback_sse41+0xb7d>
+ .byte 15,89,13,38,54,0,0 // mulps 0x3626(%rip),%xmm1 # 6710 <_sk_callback_sse41+0xb6f>
+ .byte 15,89,21,47,54,0,0 // mulps 0x362f(%rip),%xmm2 # 6720 <_sk_callback_sse41+0xb7f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 65,15,40,200 // movaps %xmm8,%xmm1
@@ -29631,9 +29286,9 @@ _sk_load_a8_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,39 // jne 312d <_sk_load_a8_sse41+0x31>
.byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0
- .byte 102,15,219,5,27,55,0,0 // pand 0x371b(%rip),%xmm0 # 6830 <_sk_callback_sse41+0xb8d>
+ .byte 102,15,219,5,27,54,0,0 // pand 0x361b(%rip),%xmm0 # 6730 <_sk_callback_sse41+0xb8f>
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,33,55,0,0 // mulps 0x3721(%rip),%xmm3 # 6840 <_sk_callback_sse41+0xb9d>
+ .byte 15,89,29,33,54,0,0 // mulps 0x3621(%rip),%xmm3 # 6740 <_sk_callback_sse41+0xb9f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
@@ -29669,9 +29324,9 @@ _sk_load_a8_dst_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,39 // jne 31ab <_sk_load_a8_dst_sse41+0x31>
.byte 102,65,15,56,49,36,18 // pmovzxbd (%r10,%rdx,1),%xmm4
- .byte 102,15,219,37,189,54,0,0 // pand 0x36bd(%rip),%xmm4 # 6850 <_sk_callback_sse41+0xbad>
+ .byte 102,15,219,37,189,53,0,0 // pand 0x35bd(%rip),%xmm4 # 6750 <_sk_callback_sse41+0xbaf>
.byte 15,91,252 // cvtdq2ps %xmm4,%xmm7
- .byte 15,89,61,195,54,0,0 // mulps 0x36c3(%rip),%xmm7 # 6860 <_sk_callback_sse41+0xbbd>
+ .byte 15,89,61,195,53,0,0 // mulps 0x35c3(%rip),%xmm7 # 6760 <_sk_callback_sse41+0xbbf>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 102,15,239,237 // pxor %xmm5,%xmm5
@@ -29706,7 +29361,7 @@ _sk_gather_a8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -29725,7 +29380,7 @@ _sk_gather_a8_sse41:
.byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,8,54,0,0 // mulps 0x3608(%rip),%xmm3 # 6870 <_sk_callback_sse41+0xbcd>
+ .byte 15,89,29,8,53,0,0 // mulps 0x3508(%rip),%xmm3 # 6770 <_sk_callback_sse41+0xbcf>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
@@ -29739,7 +29394,7 @@ FUNCTION(_sk_store_a8_sse41)
_sk_store_a8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
- .byte 68,15,40,5,251,53,0,0 // movaps 0x35fb(%rip),%xmm8 # 6880 <_sk_callback_sse41+0xbdd>
+ .byte 68,15,40,5,251,52,0,0 // movaps 0x34fb(%rip),%xmm8 # 6780 <_sk_callback_sse41+0xbdf>
.byte 68,15,89,195 // mulps %xmm3,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
@@ -29760,7 +29415,7 @@ _sk_store_a8_sse41:
.byte 65,128,249,3 // cmp $0x3,%r9b
.byte 117,221 // jne 32a7 <_sk_store_a8_sse41+0x2f>
.byte 102,69,15,58,20,68,18,2,8 // pextrb $0x8,%xmm8,0x2(%r10,%rdx,1)
- .byte 102,68,15,56,0,5,179,53,0,0 // pshufb 0x35b3(%rip),%xmm8 # 6890 <_sk_callback_sse41+0xbed>
+ .byte 102,68,15,56,0,5,179,52,0,0 // pshufb 0x34b3(%rip),%xmm8 # 6790 <_sk_callback_sse41+0xbef>
.byte 102,69,15,58,21,4,18,0 // pextrw $0x0,%xmm8,(%r10,%rdx,1)
.byte 235,192 // jmp 32a7 <_sk_store_a8_sse41+0x2f>
.byte 102,69,15,58,20,4,18,0 // pextrb $0x0,%xmm8,(%r10,%rdx,1)
@@ -29775,11 +29430,11 @@ _sk_load_g8_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,42 // jne 3325 <_sk_load_g8_sse41+0x34>
.byte 102,65,15,56,49,4,18 // pmovzxbd (%r10,%rdx,1),%xmm0
- .byte 102,15,219,5,150,53,0,0 // pand 0x3596(%rip),%xmm0 # 68a0 <_sk_callback_sse41+0xbfd>
+ .byte 102,15,219,5,150,52,0,0 // pand 0x3496(%rip),%xmm0 # 67a0 <_sk_callback_sse41+0xbff>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,156,53,0,0 // mulps 0x359c(%rip),%xmm0 # 68b0 <_sk_callback_sse41+0xc0d>
+ .byte 15,89,5,156,52,0,0 // mulps 0x349c(%rip),%xmm0 # 67b0 <_sk_callback_sse41+0xc0f>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,163,53,0,0 // movaps 0x35a3(%rip),%xmm3 # 68c0 <_sk_callback_sse41+0xc1d>
+ .byte 15,40,29,163,52,0,0 // movaps 0x34a3(%rip),%xmm3 # 67c0 <_sk_callback_sse41+0xc1f>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,224 // jmpq *%rax
@@ -29813,11 +29468,11 @@ _sk_load_g8_dst_sse41:
.byte 77,133,192 // test %r8,%r8
.byte 117,42 // jne 33a6 <_sk_load_g8_dst_sse41+0x34>
.byte 102,65,15,56,49,36,18 // pmovzxbd (%r10,%rdx,1),%xmm4
- .byte 102,15,219,37,69,53,0,0 // pand 0x3545(%rip),%xmm4 # 68d0 <_sk_callback_sse41+0xc2d>
+ .byte 102,15,219,37,69,52,0,0 // pand 0x3445(%rip),%xmm4 # 67d0 <_sk_callback_sse41+0xc2f>
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,75,53,0,0 // mulps 0x354b(%rip),%xmm4 # 68e0 <_sk_callback_sse41+0xc3d>
+ .byte 15,89,37,75,52,0,0 // mulps 0x344b(%rip),%xmm4 # 67e0 <_sk_callback_sse41+0xc3f>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,61,82,53,0,0 // movaps 0x3552(%rip),%xmm7 # 68f0 <_sk_callback_sse41+0xc4d>
+ .byte 15,40,61,82,52,0,0 // movaps 0x3452(%rip),%xmm7 # 67f0 <_sk_callback_sse41+0xc4f>
.byte 15,40,236 // movaps %xmm4,%xmm5
.byte 15,40,244 // movaps %xmm4,%xmm6
.byte 255,224 // jmpq *%rax
@@ -29850,7 +29505,7 @@ _sk_gather_g8_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -29869,77 +29524,14 @@ _sk_gather_g8_sse41:
.byte 102,15,58,32,192,3 // pinsrb $0x3,%eax,%xmm0
.byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,157,52,0,0 // mulps 0x349d(%rip),%xmm0 # 6900 <_sk_callback_sse41+0xc5d>
+ .byte 15,89,5,157,51,0,0 // mulps 0x339d(%rip),%xmm0 # 6800 <_sk_callback_sse41+0xc5f>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,164,52,0,0 // movaps 0x34a4(%rip),%xmm3 # 6910 <_sk_callback_sse41+0xc6d>
+ .byte 15,40,29,164,51,0,0 // movaps 0x33a4(%rip),%xmm3 # 6810 <_sk_callback_sse41+0xc6f>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
-HIDDEN _sk_gather_i8_sse41
-.globl _sk_gather_i8_sse41
-FUNCTION(_sk_gather_i8_sse41)
-_sk_gather_i8_sse41:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,193 // mov %rax,%r9
- .byte 77,133,201 // test %r9,%r9
- .byte 116,5 // je 3484 <_sk_gather_i8_sse41+0xf>
- .byte 76,137,200 // mov %r9,%rax
- .byte 235,2 // jmp 3486 <_sk_gather_i8_sse41+0x11>
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 65,86 // push %r14
- .byte 83 // push %rbx
- .byte 76,139,16 // mov (%rax),%r10
- .byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
- .byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
- .byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
- .byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
- .byte 102,15,254,194 // paddd %xmm2,%xmm0
- .byte 102,72,15,58,22,192,1 // pextrq $0x1,%xmm0,%rax
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 102,67,15,58,32,4,50,0 // pinsrb $0x0,(%r10,%r14,1),%xmm0
- .byte 102,65,15,58,32,4,26,1 // pinsrb $0x1,(%r10,%rbx,1),%xmm0
- .byte 102,67,15,58,32,4,26,2 // pinsrb $0x2,(%r10,%r11,1),%xmm0
- .byte 102,65,15,58,32,4,2,3 // pinsrb $0x3,(%r10,%rax,1),%xmm0
- .byte 102,15,56,49,192 // pmovzxbd %xmm0,%xmm0
- .byte 102,73,15,58,22,194,1 // pextrq $0x1,%xmm0,%r10
- .byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 73,139,65,8 // mov 0x8(%r9),%rax
- .byte 65,137,217 // mov %ebx,%r9d
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 69,137,211 // mov %r10d,%r11d
- .byte 73,193,234,30 // shr $0x1e,%r10
- .byte 102,66,15,110,28,136 // movd (%rax,%r9,4),%xmm3
- .byte 102,15,58,34,28,24,1 // pinsrd $0x1,(%rax,%rbx,1),%xmm3
- .byte 102,66,15,58,34,28,152,2 // pinsrd $0x2,(%rax,%r11,4),%xmm3
- .byte 102,66,15,58,34,28,16,3 // pinsrd $0x3,(%rax,%r10,1),%xmm3
- .byte 102,15,111,5,247,51,0,0 // movdqa 0x33f7(%rip),%xmm0 # 6920 <_sk_callback_sse41+0xc7d>
- .byte 102,15,219,195 // pand %xmm3,%xmm0
- .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,248,51,0,0 // movaps 0x33f8(%rip),%xmm8 # 6930 <_sk_callback_sse41+0xc8d>
- .byte 65,15,89,192 // mulps %xmm8,%xmm0
- .byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,247,51,0,0 // pshufb 0x33f7(%rip),%xmm1 # 6940 <_sk_callback_sse41+0xc9d>
- .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 65,15,89,200 // mulps %xmm8,%xmm1
- .byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,243,51,0,0 // pshufb 0x33f3(%rip),%xmm2 # 6950 <_sk_callback_sse41+0xcad>
- .byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 65,15,89,208 // mulps %xmm8,%xmm2
- .byte 102,15,114,211,24 // psrld $0x18,%xmm3
- .byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 65,15,89,216 // mulps %xmm8,%xmm3
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,94 // pop %r14
- .byte 255,224 // jmpq *%rax
-
HIDDEN _sk_load_565_sse41
.globl _sk_load_565_sse41
FUNCTION(_sk_load_565_sse41)
@@ -29947,41 +29539,41 @@ _sk_load_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,80 // jne 35d1 <_sk_load_565_sse41+0x5a>
+ .byte 117,80 // jne 34cf <_sk_load_565_sse41+0x5a>
.byte 102,65,15,56,51,20,82 // pmovzxwd (%r10,%rdx,2),%xmm2
- .byte 102,15,111,5,208,51,0,0 // movdqa 0x33d0(%rip),%xmm0 # 6960 <_sk_callback_sse41+0xcbd>
+ .byte 102,15,111,5,146,51,0,0 // movdqa 0x3392(%rip),%xmm0 # 6820 <_sk_callback_sse41+0xc7f>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,210,51,0,0 // mulps 0x33d2(%rip),%xmm0 # 6970 <_sk_callback_sse41+0xccd>
- .byte 102,15,111,13,218,51,0,0 // movdqa 0x33da(%rip),%xmm1 # 6980 <_sk_callback_sse41+0xcdd>
+ .byte 15,89,5,148,51,0,0 // mulps 0x3394(%rip),%xmm0 # 6830 <_sk_callback_sse41+0xc8f>
+ .byte 102,15,111,13,156,51,0,0 // movdqa 0x339c(%rip),%xmm1 # 6840 <_sk_callback_sse41+0xc9f>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,220,51,0,0 // mulps 0x33dc(%rip),%xmm1 # 6990 <_sk_callback_sse41+0xced>
- .byte 102,15,219,21,228,51,0,0 // pand 0x33e4(%rip),%xmm2 # 69a0 <_sk_callback_sse41+0xcfd>
+ .byte 15,89,13,158,51,0,0 // mulps 0x339e(%rip),%xmm1 # 6850 <_sk_callback_sse41+0xcaf>
+ .byte 102,15,219,21,166,51,0,0 // pand 0x33a6(%rip),%xmm2 # 6860 <_sk_callback_sse41+0xcbf>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,234,51,0,0 // mulps 0x33ea(%rip),%xmm2 # 69b0 <_sk_callback_sse41+0xd0d>
+ .byte 15,89,21,172,51,0,0 // mulps 0x33ac(%rip),%xmm2 # 6870 <_sk_callback_sse41+0xccf>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,241,51,0,0 // movaps 0x33f1(%rip),%xmm3 # 69c0 <_sk_callback_sse41+0xd1d>
+ .byte 15,40,29,179,51,0,0 // movaps 0x33b3(%rip),%xmm3 # 6880 <_sk_callback_sse41+0xcdf>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,53 // je 3613 <_sk_load_565_sse41+0x9c>
+ .byte 116,53 // je 3511 <_sk_load_565_sse41+0x9c>
.byte 102,15,239,210 // pxor %xmm2,%xmm2
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 35fd <_sk_load_565_sse41+0x86>
+ .byte 116,21 // je 34fb <_sk_load_565_sse41+0x86>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,154 // jne 3588 <_sk_load_565_sse41+0x11>
+ .byte 117,154 // jne 3486 <_sk_load_565_sse41+0x11>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2
.byte 102,65,15,110,4,82 // movd (%r10,%rdx,2),%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
.byte 102,15,58,14,208,15 // pblendw $0xf,%xmm0,%xmm2
- .byte 233,117,255,255,255 // jmpq 3588 <_sk_load_565_sse41+0x11>
+ .byte 233,117,255,255,255 // jmpq 3486 <_sk_load_565_sse41+0x11>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,208 // movd %eax,%xmm2
- .byte 233,103,255,255,255 // jmpq 3588 <_sk_load_565_sse41+0x11>
+ .byte 233,103,255,255,255 // jmpq 3486 <_sk_load_565_sse41+0x11>
HIDDEN _sk_load_565_dst_sse41
.globl _sk_load_565_dst_sse41
@@ -29990,41 +29582,41 @@ _sk_load_565_dst_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,80 // jne 367b <_sk_load_565_dst_sse41+0x5a>
+ .byte 117,80 // jne 3579 <_sk_load_565_dst_sse41+0x5a>
.byte 102,65,15,56,51,52,82 // pmovzxwd (%r10,%rdx,2),%xmm6
- .byte 102,15,111,37,150,51,0,0 // movdqa 0x3396(%rip),%xmm4 # 69d0 <_sk_callback_sse41+0xd2d>
+ .byte 102,15,111,37,88,51,0,0 // movdqa 0x3358(%rip),%xmm4 # 6890 <_sk_callback_sse41+0xcef>
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,152,51,0,0 // mulps 0x3398(%rip),%xmm4 # 69e0 <_sk_callback_sse41+0xd3d>
- .byte 102,15,111,45,160,51,0,0 // movdqa 0x33a0(%rip),%xmm5 # 69f0 <_sk_callback_sse41+0xd4d>
+ .byte 15,89,37,90,51,0,0 // mulps 0x335a(%rip),%xmm4 # 68a0 <_sk_callback_sse41+0xcff>
+ .byte 102,15,111,45,98,51,0,0 // movdqa 0x3362(%rip),%xmm5 # 68b0 <_sk_callback_sse41+0xd0f>
.byte 102,15,219,238 // pand %xmm6,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,45,162,51,0,0 // mulps 0x33a2(%rip),%xmm5 # 6a00 <_sk_callback_sse41+0xd5d>
- .byte 102,15,219,53,170,51,0,0 // pand 0x33aa(%rip),%xmm6 # 6a10 <_sk_callback_sse41+0xd6d>
+ .byte 15,89,45,100,51,0,0 // mulps 0x3364(%rip),%xmm5 # 68c0 <_sk_callback_sse41+0xd1f>
+ .byte 102,15,219,53,108,51,0,0 // pand 0x336c(%rip),%xmm6 # 68d0 <_sk_callback_sse41+0xd2f>
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,53,176,51,0,0 // mulps 0x33b0(%rip),%xmm6 # 6a20 <_sk_callback_sse41+0xd7d>
+ .byte 15,89,53,114,51,0,0 // mulps 0x3372(%rip),%xmm6 # 68e0 <_sk_callback_sse41+0xd3f>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,61,183,51,0,0 // movaps 0x33b7(%rip),%xmm7 # 6a30 <_sk_callback_sse41+0xd8d>
+ .byte 15,40,61,121,51,0,0 // movaps 0x3379(%rip),%xmm7 # 68f0 <_sk_callback_sse41+0xd4f>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,53 // je 36bd <_sk_load_565_dst_sse41+0x9c>
+ .byte 116,53 // je 35bb <_sk_load_565_dst_sse41+0x9c>
.byte 102,15,239,246 // pxor %xmm6,%xmm6
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 36a7 <_sk_load_565_dst_sse41+0x86>
+ .byte 116,21 // je 35a5 <_sk_load_565_dst_sse41+0x86>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,154 // jne 3632 <_sk_load_565_dst_sse41+0x11>
+ .byte 117,154 // jne 3530 <_sk_load_565_dst_sse41+0x11>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,224 // movd %eax,%xmm4
.byte 102,15,112,244,69 // pshufd $0x45,%xmm4,%xmm6
.byte 102,65,15,110,36,82 // movd (%r10,%rdx,2),%xmm4
.byte 102,15,56,51,228 // pmovzxwd %xmm4,%xmm4
.byte 102,15,58,14,244,15 // pblendw $0xf,%xmm4,%xmm6
- .byte 233,117,255,255,255 // jmpq 3632 <_sk_load_565_dst_sse41+0x11>
+ .byte 233,117,255,255,255 // jmpq 3530 <_sk_load_565_dst_sse41+0x11>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,240 // movd %eax,%xmm6
- .byte 233,103,255,255,255 // jmpq 3632 <_sk_load_565_dst_sse41+0x11>
+ .byte 233,103,255,255,255 // jmpq 3530 <_sk_load_565_dst_sse41+0x11>
HIDDEN _sk_gather_565_sse41
.globl _sk_gather_565_sse41
@@ -30034,7 +29626,7 @@ _sk_gather_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -30052,19 +29644,19 @@ _sk_gather_565_sse41:
.byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0
.byte 102,15,56,51,208 // pmovzxwd %xmm0,%xmm2
- .byte 102,15,111,5,11,51,0,0 // movdqa 0x330b(%rip),%xmm0 # 6a40 <_sk_callback_sse41+0xd9d>
+ .byte 102,15,111,5,205,50,0,0 // movdqa 0x32cd(%rip),%xmm0 # 6900 <_sk_callback_sse41+0xd5f>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,13,51,0,0 // mulps 0x330d(%rip),%xmm0 # 6a50 <_sk_callback_sse41+0xdad>
- .byte 102,15,111,13,21,51,0,0 // movdqa 0x3315(%rip),%xmm1 # 6a60 <_sk_callback_sse41+0xdbd>
+ .byte 15,89,5,207,50,0,0 // mulps 0x32cf(%rip),%xmm0 # 6910 <_sk_callback_sse41+0xd6f>
+ .byte 102,15,111,13,215,50,0,0 // movdqa 0x32d7(%rip),%xmm1 # 6920 <_sk_callback_sse41+0xd7f>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,23,51,0,0 // mulps 0x3317(%rip),%xmm1 # 6a70 <_sk_callback_sse41+0xdcd>
- .byte 102,15,219,21,31,51,0,0 // pand 0x331f(%rip),%xmm2 # 6a80 <_sk_callback_sse41+0xddd>
+ .byte 15,89,13,217,50,0,0 // mulps 0x32d9(%rip),%xmm1 # 6930 <_sk_callback_sse41+0xd8f>
+ .byte 102,15,219,21,225,50,0,0 // pand 0x32e1(%rip),%xmm2 # 6940 <_sk_callback_sse41+0xd9f>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,37,51,0,0 // mulps 0x3325(%rip),%xmm2 # 6a90 <_sk_callback_sse41+0xded>
+ .byte 15,89,21,231,50,0,0 // mulps 0x32e7(%rip),%xmm2 # 6950 <_sk_callback_sse41+0xdaf>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,44,51,0,0 // movaps 0x332c(%rip),%xmm3 # 6aa0 <_sk_callback_sse41+0xdfd>
+ .byte 15,40,29,238,50,0,0 // movaps 0x32ee(%rip),%xmm3 # 6960 <_sk_callback_sse41+0xdbf>
.byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
@@ -30074,12 +29666,12 @@ FUNCTION(_sk_store_565_sse41)
_sk_store_565_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,44,51,0,0 // movaps 0x332c(%rip),%xmm8 # 6ab0 <_sk_callback_sse41+0xe0d>
+ .byte 68,15,40,5,238,50,0,0 // movaps 0x32ee(%rip),%xmm8 # 6970 <_sk_callback_sse41+0xdcf>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
.byte 102,65,15,114,241,11 // pslld $0xb,%xmm9
- .byte 68,15,40,21,33,51,0,0 // movaps 0x3321(%rip),%xmm10 # 6ac0 <_sk_callback_sse41+0xe1d>
+ .byte 68,15,40,21,227,50,0,0 // movaps 0x32e3(%rip),%xmm10 # 6980 <_sk_callback_sse41+0xddf>
.byte 68,15,89,209 // mulps %xmm1,%xmm10
.byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10
.byte 102,65,15,114,242,5 // pslld $0x5,%xmm10
@@ -30089,7 +29681,7 @@ _sk_store_565_sse41:
.byte 102,69,15,86,194 // orpd %xmm10,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 37d6 <_sk_store_565_sse41+0x5f>
+ .byte 117,10 // jne 36d4 <_sk_store_565_sse41+0x5f>
.byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -30097,17 +29689,17 @@ _sk_store_565_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,35 // je 380c <_sk_store_565_sse41+0x95>
+ .byte 116,35 // je 370a <_sk_store_565_sse41+0x95>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,15 // je 37fe <_sk_store_565_sse41+0x87>
+ .byte 116,15 // je 36fc <_sk_store_565_sse41+0x87>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,221 // jne 37d2 <_sk_store_565_sse41+0x5b>
+ .byte 117,221 // jne 36d0 <_sk_store_565_sse41+0x5b>
.byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
.byte 242,69,15,112,192,232 // pshuflw $0xe8,%xmm8,%xmm8
.byte 102,68,15,126,4,80 // movd %xmm8,(%rax,%rdx,2)
- .byte 235,198 // jmp 37d2 <_sk_store_565_sse41+0x5b>
+ .byte 235,198 // jmp 36d0 <_sk_store_565_sse41+0x5b>
.byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2)
- .byte 235,188 // jmp 37d2 <_sk_store_565_sse41+0x5b>
+ .byte 235,188 // jmp 36d0 <_sk_store_565_sse41+0x5b>
HIDDEN _sk_load_4444_sse41
.globl _sk_load_4444_sse41
@@ -30116,44 +29708,44 @@ _sk_load_4444_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,95 // jne 387f <_sk_load_4444_sse41+0x69>
+ .byte 117,95 // jne 377d <_sk_load_4444_sse41+0x69>
.byte 102,65,15,56,51,28,82 // pmovzxwd (%r10,%rdx,2),%xmm3
- .byte 102,15,111,5,161,50,0,0 // movdqa 0x32a1(%rip),%xmm0 # 6ad0 <_sk_callback_sse41+0xe2d>
+ .byte 102,15,111,5,99,50,0,0 // movdqa 0x3263(%rip),%xmm0 # 6990 <_sk_callback_sse41+0xdef>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,163,50,0,0 // mulps 0x32a3(%rip),%xmm0 # 6ae0 <_sk_callback_sse41+0xe3d>
- .byte 102,15,111,13,171,50,0,0 // movdqa 0x32ab(%rip),%xmm1 # 6af0 <_sk_callback_sse41+0xe4d>
+ .byte 15,89,5,101,50,0,0 // mulps 0x3265(%rip),%xmm0 # 69a0 <_sk_callback_sse41+0xdff>
+ .byte 102,15,111,13,109,50,0,0 // movdqa 0x326d(%rip),%xmm1 # 69b0 <_sk_callback_sse41+0xe0f>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,173,50,0,0 // mulps 0x32ad(%rip),%xmm1 # 6b00 <_sk_callback_sse41+0xe5d>
- .byte 102,15,111,21,181,50,0,0 // movdqa 0x32b5(%rip),%xmm2 # 6b10 <_sk_callback_sse41+0xe6d>
+ .byte 15,89,13,111,50,0,0 // mulps 0x326f(%rip),%xmm1 # 69c0 <_sk_callback_sse41+0xe1f>
+ .byte 102,15,111,21,119,50,0,0 // movdqa 0x3277(%rip),%xmm2 # 69d0 <_sk_callback_sse41+0xe2f>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,183,50,0,0 // mulps 0x32b7(%rip),%xmm2 # 6b20 <_sk_callback_sse41+0xe7d>
- .byte 102,15,219,29,191,50,0,0 // pand 0x32bf(%rip),%xmm3 # 6b30 <_sk_callback_sse41+0xe8d>
+ .byte 15,89,21,121,50,0,0 // mulps 0x3279(%rip),%xmm2 # 69e0 <_sk_callback_sse41+0xe3f>
+ .byte 102,15,219,29,129,50,0,0 // pand 0x3281(%rip),%xmm3 # 69f0 <_sk_callback_sse41+0xe4f>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,197,50,0,0 // mulps 0x32c5(%rip),%xmm3 # 6b40 <_sk_callback_sse41+0xe9d>
+ .byte 15,89,29,135,50,0,0 // mulps 0x3287(%rip),%xmm3 # 6a00 <_sk_callback_sse41+0xe5f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,53 // je 38c1 <_sk_load_4444_sse41+0xab>
+ .byte 116,53 // je 37bf <_sk_load_4444_sse41+0xab>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 38ab <_sk_load_4444_sse41+0x95>
+ .byte 116,21 // je 37a9 <_sk_load_4444_sse41+0x95>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,139 // jne 3827 <_sk_load_4444_sse41+0x11>
+ .byte 117,139 // jne 3725 <_sk_load_4444_sse41+0x11>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
.byte 102,65,15,110,4,82 // movd (%r10,%rdx,2),%xmm0
.byte 102,15,56,51,192 // pmovzxwd %xmm0,%xmm0
.byte 102,15,58,14,216,15 // pblendw $0xf,%xmm0,%xmm3
- .byte 233,102,255,255,255 // jmpq 3827 <_sk_load_4444_sse41+0x11>
+ .byte 233,102,255,255,255 // jmpq 3725 <_sk_load_4444_sse41+0x11>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,216 // movd %eax,%xmm3
- .byte 233,88,255,255,255 // jmpq 3827 <_sk_load_4444_sse41+0x11>
+ .byte 233,88,255,255,255 // jmpq 3725 <_sk_load_4444_sse41+0x11>
HIDDEN _sk_load_4444_dst_sse41
.globl _sk_load_4444_dst_sse41
@@ -30162,44 +29754,44 @@ _sk_load_4444_dst_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,95 // jne 3938 <_sk_load_4444_dst_sse41+0x69>
+ .byte 117,95 // jne 3836 <_sk_load_4444_dst_sse41+0x69>
.byte 102,65,15,56,51,60,82 // pmovzxwd (%r10,%rdx,2),%xmm7
- .byte 102,15,111,37,104,50,0,0 // movdqa 0x3268(%rip),%xmm4 # 6b50 <_sk_callback_sse41+0xead>
+ .byte 102,15,111,37,42,50,0,0 // movdqa 0x322a(%rip),%xmm4 # 6a10 <_sk_callback_sse41+0xe6f>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,106,50,0,0 // mulps 0x326a(%rip),%xmm4 # 6b60 <_sk_callback_sse41+0xebd>
- .byte 102,15,111,45,114,50,0,0 // movdqa 0x3272(%rip),%xmm5 # 6b70 <_sk_callback_sse41+0xecd>
+ .byte 15,89,37,44,50,0,0 // mulps 0x322c(%rip),%xmm4 # 6a20 <_sk_callback_sse41+0xe7f>
+ .byte 102,15,111,45,52,50,0,0 // movdqa 0x3234(%rip),%xmm5 # 6a30 <_sk_callback_sse41+0xe8f>
.byte 102,15,219,239 // pand %xmm7,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,45,116,50,0,0 // mulps 0x3274(%rip),%xmm5 # 6b80 <_sk_callback_sse41+0xedd>
- .byte 102,15,111,53,124,50,0,0 // movdqa 0x327c(%rip),%xmm6 # 6b90 <_sk_callback_sse41+0xeed>
+ .byte 15,89,45,54,50,0,0 // mulps 0x3236(%rip),%xmm5 # 6a40 <_sk_callback_sse41+0xe9f>
+ .byte 102,15,111,53,62,50,0,0 // movdqa 0x323e(%rip),%xmm6 # 6a50 <_sk_callback_sse41+0xeaf>
.byte 102,15,219,247 // pand %xmm7,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,53,126,50,0,0 // mulps 0x327e(%rip),%xmm6 # 6ba0 <_sk_callback_sse41+0xefd>
- .byte 102,15,219,61,134,50,0,0 // pand 0x3286(%rip),%xmm7 # 6bb0 <_sk_callback_sse41+0xf0d>
+ .byte 15,89,53,64,50,0,0 // mulps 0x3240(%rip),%xmm6 # 6a60 <_sk_callback_sse41+0xebf>
+ .byte 102,15,219,61,72,50,0,0 // pand 0x3248(%rip),%xmm7 # 6a70 <_sk_callback_sse41+0xecf>
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 15,89,61,140,50,0,0 // mulps 0x328c(%rip),%xmm7 # 6bc0 <_sk_callback_sse41+0xf1d>
+ .byte 15,89,61,78,50,0,0 // mulps 0x324e(%rip),%xmm7 # 6a80 <_sk_callback_sse41+0xedf>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,53 // je 397a <_sk_load_4444_dst_sse41+0xab>
+ .byte 116,53 // je 3878 <_sk_load_4444_dst_sse41+0xab>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 3964 <_sk_load_4444_dst_sse41+0x95>
+ .byte 116,21 // je 3862 <_sk_load_4444_dst_sse41+0x95>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,139 // jne 38e0 <_sk_load_4444_dst_sse41+0x11>
+ .byte 117,139 // jne 37de <_sk_load_4444_dst_sse41+0x11>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,224 // movd %eax,%xmm4
.byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7
.byte 102,65,15,110,36,82 // movd (%r10,%rdx,2),%xmm4
.byte 102,15,56,51,228 // pmovzxwd %xmm4,%xmm4
.byte 102,15,58,14,252,15 // pblendw $0xf,%xmm4,%xmm7
- .byte 233,102,255,255,255 // jmpq 38e0 <_sk_load_4444_dst_sse41+0x11>
+ .byte 233,102,255,255,255 // jmpq 37de <_sk_load_4444_dst_sse41+0x11>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,248 // movd %eax,%xmm7
- .byte 233,88,255,255,255 // jmpq 38e0 <_sk_load_4444_dst_sse41+0x11>
+ .byte 233,88,255,255,255 // jmpq 37de <_sk_load_4444_dst_sse41+0x11>
HIDDEN _sk_gather_4444_sse41
.globl _sk_gather_4444_sse41
@@ -30209,7 +29801,7 @@ _sk_gather_4444_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -30227,21 +29819,21 @@ _sk_gather_4444_sse41:
.byte 65,15,183,4,65 // movzwl (%r9,%rax,2),%eax
.byte 102,15,196,192,3 // pinsrw $0x3,%eax,%xmm0
.byte 102,15,56,51,216 // pmovzxwd %xmm0,%xmm3
- .byte 102,15,111,5,222,49,0,0 // movdqa 0x31de(%rip),%xmm0 # 6bd0 <_sk_callback_sse41+0xf2d>
+ .byte 102,15,111,5,160,49,0,0 // movdqa 0x31a0(%rip),%xmm0 # 6a90 <_sk_callback_sse41+0xeef>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,224,49,0,0 // mulps 0x31e0(%rip),%xmm0 # 6be0 <_sk_callback_sse41+0xf3d>
- .byte 102,15,111,13,232,49,0,0 // movdqa 0x31e8(%rip),%xmm1 # 6bf0 <_sk_callback_sse41+0xf4d>
+ .byte 15,89,5,162,49,0,0 // mulps 0x31a2(%rip),%xmm0 # 6aa0 <_sk_callback_sse41+0xeff>
+ .byte 102,15,111,13,170,49,0,0 // movdqa 0x31aa(%rip),%xmm1 # 6ab0 <_sk_callback_sse41+0xf0f>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,234,49,0,0 // mulps 0x31ea(%rip),%xmm1 # 6c00 <_sk_callback_sse41+0xf5d>
- .byte 102,15,111,21,242,49,0,0 // movdqa 0x31f2(%rip),%xmm2 # 6c10 <_sk_callback_sse41+0xf6d>
+ .byte 15,89,13,172,49,0,0 // mulps 0x31ac(%rip),%xmm1 # 6ac0 <_sk_callback_sse41+0xf1f>
+ .byte 102,15,111,21,180,49,0,0 // movdqa 0x31b4(%rip),%xmm2 # 6ad0 <_sk_callback_sse41+0xf2f>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,244,49,0,0 // mulps 0x31f4(%rip),%xmm2 # 6c20 <_sk_callback_sse41+0xf7d>
- .byte 102,15,219,29,252,49,0,0 // pand 0x31fc(%rip),%xmm3 # 6c30 <_sk_callback_sse41+0xf8d>
+ .byte 15,89,21,182,49,0,0 // mulps 0x31b6(%rip),%xmm2 # 6ae0 <_sk_callback_sse41+0xf3f>
+ .byte 102,15,219,29,190,49,0,0 // pand 0x31be(%rip),%xmm3 # 6af0 <_sk_callback_sse41+0xf4f>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,2,50,0,0 // mulps 0x3202(%rip),%xmm3 # 6c40 <_sk_callback_sse41+0xf9d>
+ .byte 15,89,29,196,49,0,0 // mulps 0x31c4(%rip),%xmm3 # 6b00 <_sk_callback_sse41+0xf5f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
@@ -30252,7 +29844,7 @@ FUNCTION(_sk_store_4444_sse41)
_sk_store_4444_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,0,50,0,0 // movaps 0x3200(%rip),%xmm8 # 6c50 <_sk_callback_sse41+0xfad>
+ .byte 68,15,40,5,194,49,0,0 // movaps 0x31c2(%rip),%xmm8 # 6b10 <_sk_callback_sse41+0xf6f>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -30272,7 +29864,7 @@ _sk_store_4444_sse41:
.byte 102,69,15,86,194 // orpd %xmm10,%xmm8
.byte 102,69,15,56,43,192 // packusdw %xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3ab6 <_sk_store_4444_sse41+0x73>
+ .byte 117,10 // jne 39b4 <_sk_store_4444_sse41+0x73>
.byte 242,68,15,17,4,80 // movsd %xmm8,(%rax,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -30280,17 +29872,17 @@ _sk_store_4444_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,35 // je 3aec <_sk_store_4444_sse41+0xa9>
+ .byte 116,35 // je 39ea <_sk_store_4444_sse41+0xa9>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,15 // je 3ade <_sk_store_4444_sse41+0x9b>
+ .byte 116,15 // je 39dc <_sk_store_4444_sse41+0x9b>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,221 // jne 3ab2 <_sk_store_4444_sse41+0x6f>
+ .byte 117,221 // jne 39b0 <_sk_store_4444_sse41+0x6f>
.byte 102,68,15,58,21,68,80,4,4 // pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
.byte 242,69,15,112,192,232 // pshuflw $0xe8,%xmm8,%xmm8
.byte 102,68,15,126,4,80 // movd %xmm8,(%rax,%rdx,2)
- .byte 235,198 // jmp 3ab2 <_sk_store_4444_sse41+0x6f>
+ .byte 235,198 // jmp 39b0 <_sk_store_4444_sse41+0x6f>
.byte 102,68,15,58,21,4,80,0 // pextrw $0x0,%xmm8,(%rax,%rdx,2)
- .byte 235,188 // jmp 3ab2 <_sk_store_4444_sse41+0x6f>
+ .byte 235,188 // jmp 39b0 <_sk_store_4444_sse41+0x6f>
HIDDEN _sk_load_8888_sse41
.globl _sk_load_8888_sse41
@@ -30299,19 +29891,19 @@ _sk_load_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3b58 <_sk_load_8888_sse41+0x62>
+ .byte 117,88 // jne 3a56 <_sk_load_8888_sse41+0x62>
.byte 243,15,111,28,144 // movdqu (%rax,%rdx,4),%xmm3
- .byte 102,15,111,5,83,49,0,0 // movdqa 0x3153(%rip),%xmm0 # 6c60 <_sk_callback_sse41+0xfbd>
+ .byte 102,15,111,5,21,49,0,0 // movdqa 0x3115(%rip),%xmm0 # 6b20 <_sk_callback_sse41+0xf7f>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,84,49,0,0 // movaps 0x3154(%rip),%xmm8 # 6c70 <_sk_callback_sse41+0xfcd>
+ .byte 68,15,40,5,22,49,0,0 // movaps 0x3116(%rip),%xmm8 # 6b30 <_sk_callback_sse41+0xf8f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,83,49,0,0 // pshufb 0x3153(%rip),%xmm1 # 6c80 <_sk_callback_sse41+0xfdd>
+ .byte 102,15,56,0,13,21,49,0,0 // pshufb 0x3115(%rip),%xmm1 # 6b40 <_sk_callback_sse41+0xf9f>
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,79,49,0,0 // pshufb 0x314f(%rip),%xmm2 # 6c90 <_sk_callback_sse41+0xfed>
+ .byte 102,15,56,0,21,17,49,0,0 // pshufb 0x3111(%rip),%xmm2 # 6b50 <_sk_callback_sse41+0xfaf>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -30322,19 +29914,19 @@ _sk_load_8888_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,43 // je 3b90 <_sk_load_8888_sse41+0x9a>
+ .byte 116,43 // je 3a8e <_sk_load_8888_sse41+0x9a>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,17 // je 3b80 <_sk_load_8888_sse41+0x8a>
+ .byte 116,17 // je 3a7e <_sk_load_8888_sse41+0x8a>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,144 // jne 3b05 <_sk_load_8888_sse41+0xf>
+ .byte 117,144 // jne 3a03 <_sk_load_8888_sse41+0xf>
.byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
.byte 243,15,126,4,144 // movq (%rax,%rdx,4),%xmm0
.byte 102,15,58,14,216,15 // pblendw $0xf,%xmm0,%xmm3
- .byte 233,117,255,255,255 // jmpq 3b05 <_sk_load_8888_sse41+0xf>
+ .byte 233,117,255,255,255 // jmpq 3a03 <_sk_load_8888_sse41+0xf>
.byte 102,15,110,28,144 // movd (%rax,%rdx,4),%xmm3
- .byte 233,107,255,255,255 // jmpq 3b05 <_sk_load_8888_sse41+0xf>
+ .byte 233,107,255,255,255 // jmpq 3a03 <_sk_load_8888_sse41+0xf>
HIDDEN _sk_load_8888_dst_sse41
.globl _sk_load_8888_dst_sse41
@@ -30343,19 +29935,19 @@ _sk_load_8888_dst_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3bfc <_sk_load_8888_dst_sse41+0x62>
+ .byte 117,88 // jne 3afa <_sk_load_8888_dst_sse41+0x62>
.byte 243,15,111,60,144 // movdqu (%rax,%rdx,4),%xmm7
- .byte 102,15,111,37,239,48,0,0 // movdqa 0x30ef(%rip),%xmm4 # 6ca0 <_sk_callback_sse41+0xffd>
+ .byte 102,15,111,37,177,48,0,0 // movdqa 0x30b1(%rip),%xmm4 # 6b60 <_sk_callback_sse41+0xfbf>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 68,15,40,5,240,48,0,0 // movaps 0x30f0(%rip),%xmm8 # 6cb0 <_sk_callback_sse41+0x100d>
+ .byte 68,15,40,5,178,48,0,0 // movaps 0x30b2(%rip),%xmm8 # 6b70 <_sk_callback_sse41+0xfcf>
.byte 65,15,89,224 // mulps %xmm8,%xmm4
.byte 102,15,111,239 // movdqa %xmm7,%xmm5
- .byte 102,15,56,0,45,239,48,0,0 // pshufb 0x30ef(%rip),%xmm5 # 6cc0 <_sk_callback_sse41+0x101d>
+ .byte 102,15,56,0,45,177,48,0,0 // pshufb 0x30b1(%rip),%xmm5 # 6b80 <_sk_callback_sse41+0xfdf>
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
.byte 65,15,89,232 // mulps %xmm8,%xmm5
.byte 102,15,111,247 // movdqa %xmm7,%xmm6
- .byte 102,15,56,0,53,235,48,0,0 // pshufb 0x30eb(%rip),%xmm6 # 6cd0 <_sk_callback_sse41+0x102d>
+ .byte 102,15,56,0,53,173,48,0,0 // pshufb 0x30ad(%rip),%xmm6 # 6b90 <_sk_callback_sse41+0xfef>
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 65,15,89,240 // mulps %xmm8,%xmm6
.byte 102,15,114,215,24 // psrld $0x18,%xmm7
@@ -30366,19 +29958,19 @@ _sk_load_8888_dst_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,43 // je 3c34 <_sk_load_8888_dst_sse41+0x9a>
+ .byte 116,43 // je 3b32 <_sk_load_8888_dst_sse41+0x9a>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,17 // je 3c24 <_sk_load_8888_dst_sse41+0x8a>
+ .byte 116,17 // je 3b22 <_sk_load_8888_dst_sse41+0x8a>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,144 // jne 3ba9 <_sk_load_8888_dst_sse41+0xf>
+ .byte 117,144 // jne 3aa7 <_sk_load_8888_dst_sse41+0xf>
.byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7
.byte 243,15,126,36,144 // movq (%rax,%rdx,4),%xmm4
.byte 102,15,58,14,252,15 // pblendw $0xf,%xmm4,%xmm7
- .byte 233,117,255,255,255 // jmpq 3ba9 <_sk_load_8888_dst_sse41+0xf>
+ .byte 233,117,255,255,255 // jmpq 3aa7 <_sk_load_8888_dst_sse41+0xf>
.byte 102,15,110,60,144 // movd (%rax,%rdx,4),%xmm7
- .byte 233,107,255,255,255 // jmpq 3ba9 <_sk_load_8888_dst_sse41+0xf>
+ .byte 233,107,255,255,255 // jmpq 3aa7 <_sk_load_8888_dst_sse41+0xf>
HIDDEN _sk_gather_8888_sse41
.globl _sk_gather_8888_sse41
@@ -30388,7 +29980,7 @@ _sk_gather_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -30403,17 +29995,17 @@ _sk_gather_8888_sse41:
.byte 102,65,15,58,34,28,129,1 // pinsrd $0x1,(%r9,%rax,4),%xmm3
.byte 102,65,15,58,34,28,153,2 // pinsrd $0x2,(%r9,%rbx,4),%xmm3
.byte 102,67,15,58,34,28,153,3 // pinsrd $0x3,(%r9,%r11,4),%xmm3
- .byte 102,15,111,5,65,48,0,0 // movdqa 0x3041(%rip),%xmm0 # 6ce0 <_sk_callback_sse41+0x103d>
+ .byte 102,15,111,5,3,48,0,0 // movdqa 0x3003(%rip),%xmm0 # 6ba0 <_sk_callback_sse41+0xfff>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,66,48,0,0 // movaps 0x3042(%rip),%xmm8 # 6cf0 <_sk_callback_sse41+0x104d>
+ .byte 68,15,40,5,4,48,0,0 // movaps 0x3004(%rip),%xmm8 # 6bb0 <_sk_callback_sse41+0x100f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
- .byte 102,15,56,0,13,65,48,0,0 // pshufb 0x3041(%rip),%xmm1 # 6d00 <_sk_callback_sse41+0x105d>
+ .byte 102,15,56,0,13,3,48,0,0 // pshufb 0x3003(%rip),%xmm1 # 6bc0 <_sk_callback_sse41+0x101f>
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,211 // movdqa %xmm3,%xmm2
- .byte 102,15,56,0,21,61,48,0,0 // pshufb 0x303d(%rip),%xmm2 # 6d10 <_sk_callback_sse41+0x106d>
+ .byte 102,15,56,0,21,255,47,0,0 // pshufb 0x2fff(%rip),%xmm2 # 6bd0 <_sk_callback_sse41+0x102f>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -30429,7 +30021,7 @@ FUNCTION(_sk_store_8888_sse41)
_sk_store_8888_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,40,48,0,0 // movaps 0x3028(%rip),%xmm8 # 6d20 <_sk_callback_sse41+0x107d>
+ .byte 68,15,40,5,234,47,0,0 // movaps 0x2fea(%rip),%xmm8 # 6be0 <_sk_callback_sse41+0x103f>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -30448,34 +30040,34 @@ _sk_store_8888_sse41:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3d58 <_sk_store_8888_sse41+0x6d>
+ .byte 117,10 // jne 3c56 <_sk_store_8888_sse41+0x6d>
.byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,29 // je 3d82 <_sk_store_8888_sse41+0x97>
+ .byte 116,29 // je 3c80 <_sk_store_8888_sse41+0x97>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,15 // je 3d7a <_sk_store_8888_sse41+0x8f>
+ .byte 116,15 // je 3c78 <_sk_store_8888_sse41+0x8f>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,227 // jne 3d54 <_sk_store_8888_sse41+0x69>
+ .byte 117,227 // jne 3c52 <_sk_store_8888_sse41+0x69>
.byte 102,68,15,58,22,68,144,8,2 // pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
.byte 102,68,15,214,4,144 // movq %xmm8,(%rax,%rdx,4)
- .byte 235,210 // jmp 3d54 <_sk_store_8888_sse41+0x69>
+ .byte 235,210 // jmp 3c52 <_sk_store_8888_sse41+0x69>
.byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
- .byte 235,202 // jmp 3d54 <_sk_store_8888_sse41+0x69>
+ .byte 235,202 // jmp 3c52 <_sk_store_8888_sse41+0x69>
HIDDEN _sk_store_8888_2d_sse41
.globl _sk_store_8888_2d_sse41
FUNCTION(_sk_store_8888_2d_sse41)
_sk_store_8888_2d_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 76,99,72,8 // movslq 0x8(%rax),%r9
.byte 76,15,175,201 // imul %rcx,%r9
.byte 73,193,225,2 // shl $0x2,%r9
.byte 76,3,8 // add (%rax),%r9
- .byte 68,15,40,5,141,47,0,0 // movaps 0x2f8d(%rip),%xmm8 # 6d30 <_sk_callback_sse41+0x108d>
+ .byte 68,15,40,5,79,47,0,0 // movaps 0x2f4f(%rip),%xmm8 # 6bf0 <_sk_callback_sse41+0x104f>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -30494,23 +30086,23 @@ _sk_store_8888_2d_sse41:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3e03 <_sk_store_8888_2d_sse41+0x79>
+ .byte 117,10 // jne 3d01 <_sk_store_8888_2d_sse41+0x79>
.byte 243,69,15,127,4,145 // movdqu %xmm8,(%r9,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 68,137,192 // mov %r8d,%eax
.byte 36,3 // and $0x3,%al
.byte 60,1 // cmp $0x1,%al
- .byte 116,25 // je 3e25 <_sk_store_8888_2d_sse41+0x9b>
+ .byte 116,25 // je 3d23 <_sk_store_8888_2d_sse41+0x9b>
.byte 60,2 // cmp $0x2,%al
- .byte 116,13 // je 3e1d <_sk_store_8888_2d_sse41+0x93>
+ .byte 116,13 // je 3d1b <_sk_store_8888_2d_sse41+0x93>
.byte 60,3 // cmp $0x3,%al
- .byte 117,235 // jne 3dff <_sk_store_8888_2d_sse41+0x75>
+ .byte 117,235 // jne 3cfd <_sk_store_8888_2d_sse41+0x75>
.byte 102,69,15,58,22,68,145,8,2 // pextrd $0x2,%xmm8,0x8(%r9,%rdx,4)
.byte 102,69,15,214,4,145 // movq %xmm8,(%r9,%rdx,4)
- .byte 235,218 // jmp 3dff <_sk_store_8888_2d_sse41+0x75>
+ .byte 235,218 // jmp 3cfd <_sk_store_8888_2d_sse41+0x75>
.byte 102,69,15,126,4,145 // movd %xmm8,(%r9,%rdx,4)
- .byte 235,210 // jmp 3dff <_sk_store_8888_2d_sse41+0x75>
+ .byte 235,210 // jmp 3cfd <_sk_store_8888_2d_sse41+0x75>
HIDDEN _sk_load_bgra_sse41
.globl _sk_load_bgra_sse41
@@ -30519,19 +30111,19 @@ _sk_load_bgra_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3e8f <_sk_load_bgra_sse41+0x62>
+ .byte 117,88 // jne 3d8d <_sk_load_bgra_sse41+0x62>
.byte 243,15,111,28,144 // movdqu (%rax,%rdx,4),%xmm3
- .byte 102,15,111,5,252,46,0,0 // movdqa 0x2efc(%rip),%xmm0 # 6d40 <_sk_callback_sse41+0x109d>
+ .byte 102,15,111,5,190,46,0,0 // movdqa 0x2ebe(%rip),%xmm0 # 6c00 <_sk_callback_sse41+0x105f>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,208 // cvtdq2ps %xmm0,%xmm2
- .byte 68,15,40,5,253,46,0,0 // movaps 0x2efd(%rip),%xmm8 # 6d50 <_sk_callback_sse41+0x10ad>
+ .byte 68,15,40,5,191,46,0,0 // movaps 0x2ebf(%rip),%xmm8 # 6c10 <_sk_callback_sse41+0x106f>
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
- .byte 102,15,56,0,5,252,46,0,0 // pshufb 0x2efc(%rip),%xmm0 # 6d60 <_sk_callback_sse41+0x10bd>
+ .byte 102,15,56,0,5,190,46,0,0 // pshufb 0x2ebe(%rip),%xmm0 # 6c20 <_sk_callback_sse41+0x107f>
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
- .byte 102,15,56,0,5,248,46,0,0 // pshufb 0x2ef8(%rip),%xmm0 # 6d70 <_sk_callback_sse41+0x10cd>
+ .byte 102,15,56,0,5,186,46,0,0 // pshufb 0x2eba(%rip),%xmm0 # 6c30 <_sk_callback_sse41+0x108f>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -30542,19 +30134,19 @@ _sk_load_bgra_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,43 // je 3ec7 <_sk_load_bgra_sse41+0x9a>
+ .byte 116,43 // je 3dc5 <_sk_load_bgra_sse41+0x9a>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,17 // je 3eb7 <_sk_load_bgra_sse41+0x8a>
+ .byte 116,17 // je 3db5 <_sk_load_bgra_sse41+0x8a>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,144 // jne 3e3c <_sk_load_bgra_sse41+0xf>
+ .byte 117,144 // jne 3d3a <_sk_load_bgra_sse41+0xf>
.byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
.byte 243,15,126,4,144 // movq (%rax,%rdx,4),%xmm0
.byte 102,15,58,14,216,15 // pblendw $0xf,%xmm0,%xmm3
- .byte 233,117,255,255,255 // jmpq 3e3c <_sk_load_bgra_sse41+0xf>
+ .byte 233,117,255,255,255 // jmpq 3d3a <_sk_load_bgra_sse41+0xf>
.byte 102,15,110,28,144 // movd (%rax,%rdx,4),%xmm3
- .byte 233,107,255,255,255 // jmpq 3e3c <_sk_load_bgra_sse41+0xf>
+ .byte 233,107,255,255,255 // jmpq 3d3a <_sk_load_bgra_sse41+0xf>
HIDDEN _sk_load_bgra_dst_sse41
.globl _sk_load_bgra_dst_sse41
@@ -30563,19 +30155,19 @@ _sk_load_bgra_dst_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,88 // jne 3f33 <_sk_load_bgra_dst_sse41+0x62>
+ .byte 117,88 // jne 3e31 <_sk_load_bgra_dst_sse41+0x62>
.byte 243,15,111,60,144 // movdqu (%rax,%rdx,4),%xmm7
- .byte 102,15,111,37,152,46,0,0 // movdqa 0x2e98(%rip),%xmm4 # 6d80 <_sk_callback_sse41+0x10dd>
+ .byte 102,15,111,37,90,46,0,0 // movdqa 0x2e5a(%rip),%xmm4 # 6c40 <_sk_callback_sse41+0x109f>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,244 // cvtdq2ps %xmm4,%xmm6
- .byte 68,15,40,5,153,46,0,0 // movaps 0x2e99(%rip),%xmm8 # 6d90 <_sk_callback_sse41+0x10ed>
+ .byte 68,15,40,5,91,46,0,0 // movaps 0x2e5b(%rip),%xmm8 # 6c50 <_sk_callback_sse41+0x10af>
.byte 65,15,89,240 // mulps %xmm8,%xmm6
.byte 102,15,111,231 // movdqa %xmm7,%xmm4
- .byte 102,15,56,0,37,152,46,0,0 // pshufb 0x2e98(%rip),%xmm4 # 6da0 <_sk_callback_sse41+0x10fd>
+ .byte 102,15,56,0,37,90,46,0,0 // pshufb 0x2e5a(%rip),%xmm4 # 6c60 <_sk_callback_sse41+0x10bf>
.byte 15,91,236 // cvtdq2ps %xmm4,%xmm5
.byte 65,15,89,232 // mulps %xmm8,%xmm5
.byte 102,15,111,231 // movdqa %xmm7,%xmm4
- .byte 102,15,56,0,37,148,46,0,0 // pshufb 0x2e94(%rip),%xmm4 # 6db0 <_sk_callback_sse41+0x110d>
+ .byte 102,15,56,0,37,86,46,0,0 // pshufb 0x2e56(%rip),%xmm4 # 6c70 <_sk_callback_sse41+0x10cf>
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
.byte 65,15,89,224 // mulps %xmm8,%xmm4
.byte 102,15,114,215,24 // psrld $0x18,%xmm7
@@ -30586,19 +30178,19 @@ _sk_load_bgra_dst_sse41:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,43 // je 3f6b <_sk_load_bgra_dst_sse41+0x9a>
+ .byte 116,43 // je 3e69 <_sk_load_bgra_dst_sse41+0x9a>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,17 // je 3f5b <_sk_load_bgra_dst_sse41+0x8a>
+ .byte 116,17 // je 3e59 <_sk_load_bgra_dst_sse41+0x8a>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,144 // jne 3ee0 <_sk_load_bgra_dst_sse41+0xf>
+ .byte 117,144 // jne 3dde <_sk_load_bgra_dst_sse41+0xf>
.byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7
.byte 243,15,126,36,144 // movq (%rax,%rdx,4),%xmm4
.byte 102,15,58,14,252,15 // pblendw $0xf,%xmm4,%xmm7
- .byte 233,117,255,255,255 // jmpq 3ee0 <_sk_load_bgra_dst_sse41+0xf>
+ .byte 233,117,255,255,255 // jmpq 3dde <_sk_load_bgra_dst_sse41+0xf>
.byte 102,15,110,60,144 // movd (%rax,%rdx,4),%xmm7
- .byte 233,107,255,255,255 // jmpq 3ee0 <_sk_load_bgra_dst_sse41+0xf>
+ .byte 233,107,255,255,255 // jmpq 3dde <_sk_load_bgra_dst_sse41+0xf>
HIDDEN _sk_gather_bgra_sse41
.globl _sk_gather_bgra_sse41
@@ -30608,7 +30200,7 @@ _sk_gather_bgra_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -30623,17 +30215,17 @@ _sk_gather_bgra_sse41:
.byte 102,65,15,58,34,28,129,1 // pinsrd $0x1,(%r9,%rax,4),%xmm3
.byte 102,65,15,58,34,28,153,2 // pinsrd $0x2,(%r9,%rbx,4),%xmm3
.byte 102,67,15,58,34,28,153,3 // pinsrd $0x3,(%r9,%r11,4),%xmm3
- .byte 102,15,111,5,234,45,0,0 // movdqa 0x2dea(%rip),%xmm0 # 6dc0 <_sk_callback_sse41+0x111d>
+ .byte 102,15,111,5,172,45,0,0 // movdqa 0x2dac(%rip),%xmm0 # 6c80 <_sk_callback_sse41+0x10df>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,208 // cvtdq2ps %xmm0,%xmm2
- .byte 68,15,40,5,235,45,0,0 // movaps 0x2deb(%rip),%xmm8 # 6dd0 <_sk_callback_sse41+0x112d>
+ .byte 68,15,40,5,173,45,0,0 // movaps 0x2dad(%rip),%xmm8 # 6c90 <_sk_callback_sse41+0x10ef>
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
- .byte 102,15,56,0,5,234,45,0,0 // pshufb 0x2dea(%rip),%xmm0 # 6de0 <_sk_callback_sse41+0x113d>
+ .byte 102,15,56,0,5,172,45,0,0 // pshufb 0x2dac(%rip),%xmm0 # 6ca0 <_sk_callback_sse41+0x10ff>
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
- .byte 102,15,56,0,5,230,45,0,0 // pshufb 0x2de6(%rip),%xmm0 # 6df0 <_sk_callback_sse41+0x114d>
+ .byte 102,15,56,0,5,168,45,0,0 // pshufb 0x2da8(%rip),%xmm0 # 6cb0 <_sk_callback_sse41+0x110f>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
@@ -30649,7 +30241,7 @@ FUNCTION(_sk_store_bgra_sse41)
_sk_store_bgra_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,209,45,0,0 // movaps 0x2dd1(%rip),%xmm8 # 6e00 <_sk_callback_sse41+0x115d>
+ .byte 68,15,40,5,147,45,0,0 // movaps 0x2d93(%rip),%xmm8 # 6cc0 <_sk_callback_sse41+0x111f>
.byte 68,15,40,202 // movaps %xmm2,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -30668,23 +30260,23 @@ _sk_store_bgra_sse41:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 408f <_sk_store_bgra_sse41+0x6d>
+ .byte 117,10 // jne 3f8d <_sk_store_bgra_sse41+0x6d>
.byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,29 // je 40b9 <_sk_store_bgra_sse41+0x97>
+ .byte 116,29 // je 3fb7 <_sk_store_bgra_sse41+0x97>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,15 // je 40b1 <_sk_store_bgra_sse41+0x8f>
+ .byte 116,15 // je 3faf <_sk_store_bgra_sse41+0x8f>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,227 // jne 408b <_sk_store_bgra_sse41+0x69>
+ .byte 117,227 // jne 3f89 <_sk_store_bgra_sse41+0x69>
.byte 102,68,15,58,22,68,144,8,2 // pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
.byte 102,68,15,214,4,144 // movq %xmm8,(%rax,%rdx,4)
- .byte 235,210 // jmp 408b <_sk_store_bgra_sse41+0x69>
+ .byte 235,210 // jmp 3f89 <_sk_store_bgra_sse41+0x69>
.byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
- .byte 235,202 // jmp 408b <_sk_store_bgra_sse41+0x69>
+ .byte 235,202 // jmp 3f89 <_sk_store_bgra_sse41+0x69>
HIDDEN _sk_load_f16_sse41
.globl _sk_load_f16_sse41
@@ -30693,7 +30285,7 @@ _sk_load_f16_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,60,1,0,0 // jne 420b <_sk_load_f16_sse41+0x14a>
+ .byte 15,133,60,1,0,0 // jne 4109 <_sk_load_f16_sse41+0x14a>
.byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0
.byte 243,15,111,76,208,16 // movdqu 0x10(%rax,%rdx,8),%xmm1
.byte 102,68,15,40,200 // movapd %xmm0,%xmm9
@@ -30703,18 +30295,18 @@ _sk_load_f16_sse41:
.byte 102,68,15,97,216 // punpcklwd %xmm0,%xmm11
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
.byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1
- .byte 102,68,15,111,5,10,45,0,0 // movdqa 0x2d0a(%rip),%xmm8 # 6e10 <_sk_callback_sse41+0x116d>
+ .byte 102,68,15,111,5,204,44,0,0 // movdqa 0x2ccc(%rip),%xmm8 # 6cd0 <_sk_callback_sse41+0x112f>
.byte 102,15,111,209 // movdqa %xmm1,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,239,202 // pxor %xmm2,%xmm1
- .byte 102,15,111,29,5,45,0,0 // movdqa 0x2d05(%rip),%xmm3 # 6e20 <_sk_callback_sse41+0x117d>
+ .byte 102,15,111,29,199,44,0,0 // movdqa 0x2cc7(%rip),%xmm3 # 6ce0 <_sk_callback_sse41+0x113f>
.byte 102,15,114,242,16 // pslld $0x10,%xmm2
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0
.byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0
.byte 102,15,114,241,13 // pslld $0xd,%xmm1
.byte 102,15,235,202 // por %xmm2,%xmm1
- .byte 102,68,15,111,21,241,44,0,0 // movdqa 0x2cf1(%rip),%xmm10 # 6e30 <_sk_callback_sse41+0x118d>
+ .byte 102,68,15,111,21,179,44,0,0 // movdqa 0x2cb3(%rip),%xmm10 # 6cf0 <_sk_callback_sse41+0x114f>
.byte 102,65,15,254,202 // paddd %xmm10,%xmm1
.byte 102,15,219,193 // pand %xmm1,%xmm0
.byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11
@@ -30757,16 +30349,16 @@ _sk_load_f16_sse41:
.byte 255,224 // jmpq *%rax
.byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,13 // jne 4223 <_sk_load_f16_sse41+0x162>
+ .byte 117,13 // jne 4121 <_sk_load_f16_sse41+0x162>
.byte 243,15,126,192 // movq %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,183,254,255,255 // jmpq 40da <_sk_load_f16_sse41+0x19>
+ .byte 233,183,254,255,255 // jmpq 3fd8 <_sk_load_f16_sse41+0x19>
.byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,163,254,255,255 // jb 40da <_sk_load_f16_sse41+0x19>
+ .byte 15,130,163,254,255,255 // jb 3fd8 <_sk_load_f16_sse41+0x19>
.byte 243,15,126,76,208,16 // movq 0x10(%rax,%rdx,8),%xmm1
- .byte 233,152,254,255,255 // jmpq 40da <_sk_load_f16_sse41+0x19>
+ .byte 233,152,254,255,255 // jmpq 3fd8 <_sk_load_f16_sse41+0x19>
HIDDEN _sk_load_f16_dst_sse41
.globl _sk_load_f16_dst_sse41
@@ -30775,7 +30367,7 @@ _sk_load_f16_dst_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,60,1,0,0 // jne 438c <_sk_load_f16_dst_sse41+0x14a>
+ .byte 15,133,60,1,0,0 // jne 428a <_sk_load_f16_dst_sse41+0x14a>
.byte 102,15,16,36,208 // movupd (%rax,%rdx,8),%xmm4
.byte 243,15,111,108,208,16 // movdqu 0x10(%rax,%rdx,8),%xmm5
.byte 102,68,15,40,204 // movapd %xmm4,%xmm9
@@ -30785,18 +30377,18 @@ _sk_load_f16_dst_sse41:
.byte 102,68,15,97,220 // punpcklwd %xmm4,%xmm11
.byte 102,68,15,105,204 // punpckhwd %xmm4,%xmm9
.byte 102,65,15,56,51,235 // pmovzxwd %xmm11,%xmm5
- .byte 102,68,15,111,5,185,43,0,0 // movdqa 0x2bb9(%rip),%xmm8 # 6e40 <_sk_callback_sse41+0x119d>
+ .byte 102,68,15,111,5,123,43,0,0 // movdqa 0x2b7b(%rip),%xmm8 # 6d00 <_sk_callback_sse41+0x115f>
.byte 102,15,111,245 // movdqa %xmm5,%xmm6
.byte 102,65,15,219,240 // pand %xmm8,%xmm6
.byte 102,15,239,238 // pxor %xmm6,%xmm5
- .byte 102,15,111,61,180,43,0,0 // movdqa 0x2bb4(%rip),%xmm7 # 6e50 <_sk_callback_sse41+0x11ad>
+ .byte 102,15,111,61,118,43,0,0 // movdqa 0x2b76(%rip),%xmm7 # 6d10 <_sk_callback_sse41+0x116f>
.byte 102,15,114,246,16 // pslld $0x10,%xmm6
.byte 102,15,111,229 // movdqa %xmm5,%xmm4
.byte 102,15,56,63,231 // pmaxud %xmm7,%xmm4
.byte 102,15,118,229 // pcmpeqd %xmm5,%xmm4
.byte 102,15,114,245,13 // pslld $0xd,%xmm5
.byte 102,15,235,238 // por %xmm6,%xmm5
- .byte 102,68,15,111,21,160,43,0,0 // movdqa 0x2ba0(%rip),%xmm10 # 6e60 <_sk_callback_sse41+0x11bd>
+ .byte 102,68,15,111,21,98,43,0,0 // movdqa 0x2b62(%rip),%xmm10 # 6d20 <_sk_callback_sse41+0x117f>
.byte 102,65,15,254,234 // paddd %xmm10,%xmm5
.byte 102,15,219,229 // pand %xmm5,%xmm4
.byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11
@@ -30839,16 +30431,16 @@ _sk_load_f16_dst_sse41:
.byte 255,224 // jmpq *%rax
.byte 242,15,16,36,208 // movsd (%rax,%rdx,8),%xmm4
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,13 // jne 43a4 <_sk_load_f16_dst_sse41+0x162>
+ .byte 117,13 // jne 42a2 <_sk_load_f16_dst_sse41+0x162>
.byte 243,15,126,228 // movq %xmm4,%xmm4
.byte 102,15,239,237 // pxor %xmm5,%xmm5
- .byte 233,183,254,255,255 // jmpq 425b <_sk_load_f16_dst_sse41+0x19>
+ .byte 233,183,254,255,255 // jmpq 4159 <_sk_load_f16_dst_sse41+0x19>
.byte 102,15,22,100,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm4
.byte 102,15,239,237 // pxor %xmm5,%xmm5
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,163,254,255,255 // jb 425b <_sk_load_f16_dst_sse41+0x19>
+ .byte 15,130,163,254,255,255 // jb 4159 <_sk_load_f16_dst_sse41+0x19>
.byte 243,15,126,108,208,16 // movq 0x10(%rax,%rdx,8),%xmm5
- .byte 233,152,254,255,255 // jmpq 425b <_sk_load_f16_dst_sse41+0x19>
+ .byte 233,152,254,255,255 // jmpq 4159 <_sk_load_f16_dst_sse41+0x19>
HIDDEN _sk_gather_f16_sse41
.globl _sk_gather_f16_sse41
@@ -30858,7 +30450,7 @@ _sk_gather_f16_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,56,64,209 // pmulld %xmm1,%xmm2
.byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
@@ -30882,18 +30474,18 @@ _sk_gather_f16_sse41:
.byte 102,68,15,97,218 // punpcklwd %xmm2,%xmm11
.byte 102,68,15,105,202 // punpckhwd %xmm2,%xmm9
.byte 102,65,15,56,51,203 // pmovzxwd %xmm11,%xmm1
- .byte 102,68,15,111,5,38,42,0,0 // movdqa 0x2a26(%rip),%xmm8 # 6e70 <_sk_callback_sse41+0x11cd>
+ .byte 102,68,15,111,5,232,41,0,0 // movdqa 0x29e8(%rip),%xmm8 # 6d30 <_sk_callback_sse41+0x118f>
.byte 102,15,111,209 // movdqa %xmm1,%xmm2
.byte 102,65,15,219,208 // pand %xmm8,%xmm2
.byte 102,15,239,202 // pxor %xmm2,%xmm1
- .byte 102,15,111,29,33,42,0,0 // movdqa 0x2a21(%rip),%xmm3 # 6e80 <_sk_callback_sse41+0x11dd>
+ .byte 102,15,111,29,227,41,0,0 // movdqa 0x29e3(%rip),%xmm3 # 6d40 <_sk_callback_sse41+0x119f>
.byte 102,15,114,242,16 // pslld $0x10,%xmm2
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,15,56,63,195 // pmaxud %xmm3,%xmm0
.byte 102,15,118,193 // pcmpeqd %xmm1,%xmm0
.byte 102,15,114,241,13 // pslld $0xd,%xmm1
.byte 102,15,235,202 // por %xmm2,%xmm1
- .byte 102,68,15,111,21,13,42,0,0 // movdqa 0x2a0d(%rip),%xmm10 # 6e90 <_sk_callback_sse41+0x11ed>
+ .byte 102,68,15,111,21,207,41,0,0 // movdqa 0x29cf(%rip),%xmm10 # 6d50 <_sk_callback_sse41+0x11af>
.byte 102,65,15,254,202 // paddd %xmm10,%xmm1
.byte 102,15,219,193 // pand %xmm1,%xmm0
.byte 102,65,15,115,219,8 // psrldq $0x8,%xmm11
@@ -30942,17 +30534,17 @@ FUNCTION(_sk_store_f16_sse41)
_sk_store_f16_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 102,68,15,111,21,66,41,0,0 // movdqa 0x2942(%rip),%xmm10 # 6ea0 <_sk_callback_sse41+0x11fd>
+ .byte 102,68,15,111,21,4,41,0,0 // movdqa 0x2904(%rip),%xmm10 # 6d60 <_sk_callback_sse41+0x11bf>
.byte 102,68,15,111,216 // movdqa %xmm0,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,68,15,111,232 // movdqa %xmm0,%xmm13
.byte 102,69,15,239,235 // pxor %xmm11,%xmm13
- .byte 102,68,15,111,13,53,41,0,0 // movdqa 0x2935(%rip),%xmm9 # 6eb0 <_sk_callback_sse41+0x120d>
+ .byte 102,68,15,111,13,247,40,0,0 // movdqa 0x28f7(%rip),%xmm9 # 6d70 <_sk_callback_sse41+0x11cf>
.byte 102,65,15,114,211,16 // psrld $0x10,%xmm11
.byte 102,69,15,111,193 // movdqa %xmm9,%xmm8
.byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8
.byte 102,65,15,114,213,13 // psrld $0xd,%xmm13
- .byte 102,68,15,111,37,38,41,0,0 // movdqa 0x2926(%rip),%xmm12 # 6ec0 <_sk_callback_sse41+0x121d>
+ .byte 102,68,15,111,37,232,40,0,0 // movdqa 0x28e8(%rip),%xmm12 # 6d80 <_sk_callback_sse41+0x11df>
.byte 102,69,15,235,220 // por %xmm12,%xmm11
.byte 102,69,15,254,221 // paddd %xmm13,%xmm11
.byte 102,69,15,223,195 // pandn %xmm11,%xmm8
@@ -30996,7 +30588,7 @@ _sk_store_f16_sse41:
.byte 102,69,15,111,200 // movdqa %xmm8,%xmm9
.byte 102,69,15,98,203 // punpckldq %xmm11,%xmm9
.byte 77,133,192 // test %r8,%r8
- .byte 117,21 // jne 4690 <_sk_store_f16_sse41+0x140>
+ .byte 117,21 // jne 458e <_sk_store_f16_sse41+0x140>
.byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8)
.byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8
.byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8)
@@ -31004,13 +30596,13 @@ _sk_store_f16_sse41:
.byte 255,224 // jmpq *%rax
.byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 468c <_sk_store_f16_sse41+0x13c>
+ .byte 116,240 // je 458a <_sk_store_f16_sse41+0x13c>
.byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 468c <_sk_store_f16_sse41+0x13c>
+ .byte 114,227 // jb 458a <_sk_store_f16_sse41+0x13c>
.byte 102,69,15,106,195 // punpckhdq %xmm11,%xmm8
.byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8)
- .byte 235,213 // jmp 468c <_sk_store_f16_sse41+0x13c>
+ .byte 235,213 // jmp 458a <_sk_store_f16_sse41+0x13c>
HIDDEN _sk_load_u16_be_sse41
.globl _sk_load_u16_be_sse41
@@ -31020,7 +30612,7 @@ _sk_load_u16_be_sse41:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,185,0,0,0 // jne 4786 <_sk_load_u16_be_sse41+0xcf>
+ .byte 15,133,185,0,0,0 // jne 4684 <_sk_load_u16_be_sse41+0xcf>
.byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0
.byte 243,65,15,111,76,65,16 // movdqu 0x10(%r9,%rax,2),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
@@ -31036,7 +30628,7 @@ _sk_load_u16_be_sse41:
.byte 102,15,235,200 // por %xmm0,%xmm1
.byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,183,39,0,0 // movaps 0x27b7(%rip),%xmm8 # 6ed0 <_sk_callback_sse41+0x122d>
+ .byte 68,15,40,5,121,39,0,0 // movaps 0x2779(%rip),%xmm8 # 6d90 <_sk_callback_sse41+0x11ef>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -31064,16 +30656,16 @@ _sk_load_u16_be_sse41:
.byte 255,224 // jmpq *%rax
.byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,13 // jne 479f <_sk_load_u16_be_sse41+0xe8>
+ .byte 117,13 // jne 469d <_sk_load_u16_be_sse41+0xe8>
.byte 243,15,126,192 // movq %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,59,255,255,255 // jmpq 46da <_sk_load_u16_be_sse41+0x23>
+ .byte 233,59,255,255,255 // jmpq 45d8 <_sk_load_u16_be_sse41+0x23>
.byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,38,255,255,255 // jb 46da <_sk_load_u16_be_sse41+0x23>
+ .byte 15,130,38,255,255,255 // jb 45d8 <_sk_load_u16_be_sse41+0x23>
.byte 243,65,15,126,76,65,16 // movq 0x10(%r9,%rax,2),%xmm1
- .byte 233,26,255,255,255 // jmpq 46da <_sk_load_u16_be_sse41+0x23>
+ .byte 233,26,255,255,255 // jmpq 45d8 <_sk_load_u16_be_sse41+0x23>
HIDDEN _sk_load_rgb_u16_be_sse41
.globl _sk_load_rgb_u16_be_sse41
@@ -31083,7 +30675,7 @@ _sk_load_rgb_u16_be_sse41:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,170,0,0,0 // jne 487c <_sk_load_rgb_u16_be_sse41+0xbc>
+ .byte 15,133,170,0,0,0 // jne 477a <_sk_load_rgb_u16_be_sse41+0xbc>
.byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2
.byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3
.byte 102,15,115,219,4 // psrldq $0x4,%xmm3
@@ -31103,7 +30695,7 @@ _sk_load_rgb_u16_be_sse41:
.byte 102,15,235,200 // por %xmm0,%xmm1
.byte 102,15,56,51,193 // pmovzxwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,175,38,0,0 // movaps 0x26af(%rip),%xmm8 # 6ee0 <_sk_callback_sse41+0x123d>
+ .byte 68,15,40,5,113,38,0,0 // movaps 0x2671(%rip),%xmm8 # 6da0 <_sk_callback_sse41+0x11ff>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -31120,27 +30712,27 @@ _sk_load_rgb_u16_be_sse41:
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,118,38,0,0 // movaps 0x2676(%rip),%xmm3 # 6ef0 <_sk_callback_sse41+0x124d>
+ .byte 15,40,29,56,38,0,0 // movaps 0x2638(%rip),%xmm3 # 6db0 <_sk_callback_sse41+0x120f>
.byte 255,224 // jmpq *%rax
.byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2
.byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,13 // jne 48a1 <_sk_load_rgb_u16_be_sse41+0xe1>
+ .byte 117,13 // jne 479f <_sk_load_rgb_u16_be_sse41+0xe1>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,85,255,255,255 // jmpq 47f6 <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 233,85,255,255,255 // jmpq 46f4 <_sk_load_rgb_u16_be_sse41+0x36>
.byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0
.byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,24 // jb 48d2 <_sk_load_rgb_u16_be_sse41+0x112>
+ .byte 114,24 // jb 47d0 <_sk_load_rgb_u16_be_sse41+0x112>
.byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3
.byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,36,255,255,255 // jmpq 47f6 <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 233,36,255,255,255 // jmpq 46f4 <_sk_load_rgb_u16_be_sse41+0x36>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 233,27,255,255,255 // jmpq 47f6 <_sk_load_rgb_u16_be_sse41+0x36>
+ .byte 233,27,255,255,255 // jmpq 46f4 <_sk_load_rgb_u16_be_sse41+0x36>
HIDDEN _sk_store_u16_be_sse41
.globl _sk_store_u16_be_sse41
@@ -31149,7 +30741,7 @@ _sk_store_u16_be_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
- .byte 68,15,40,21,16,38,0,0 // movaps 0x2610(%rip),%xmm10 # 6f00 <_sk_callback_sse41+0x125d>
+ .byte 68,15,40,21,210,37,0,0 // movaps 0x25d2(%rip),%xmm10 # 6dc0 <_sk_callback_sse41+0x121f>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
@@ -31186,7 +30778,7 @@ _sk_store_u16_be_sse41:
.byte 102,69,15,111,208 // movdqa %xmm8,%xmm10
.byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10
.byte 77,133,192 // test %r8,%r8
- .byte 117,21 // jne 49be <_sk_store_u16_be_sse41+0xe3>
+ .byte 117,21 // jne 48bc <_sk_store_u16_be_sse41+0xe3>
.byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2)
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
.byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2)
@@ -31194,13 +30786,13 @@ _sk_store_u16_be_sse41:
.byte 255,224 // jmpq *%rax
.byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 49ba <_sk_store_u16_be_sse41+0xdf>
+ .byte 116,240 // je 48b8 <_sk_store_u16_be_sse41+0xdf>
.byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 49ba <_sk_store_u16_be_sse41+0xdf>
+ .byte 114,227 // jb 48b8 <_sk_store_u16_be_sse41+0xdf>
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
.byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2)
- .byte 235,213 // jmp 49ba <_sk_store_u16_be_sse41+0xdf>
+ .byte 235,213 // jmp 48b8 <_sk_store_u16_be_sse41+0xdf>
HIDDEN _sk_load_f32_sse41
.globl _sk_load_f32_sse41
@@ -31213,7 +30805,7 @@ _sk_load_f32_sse41:
.byte 72,193,224,4 // shl $0x4,%rax
.byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,66 // jne 4a45 <_sk_load_f32_sse41+0x60>
+ .byte 117,66 // jne 4943 <_sk_load_f32_sse41+0x60>
.byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
.byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
.byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
@@ -31233,17 +30825,17 @@ _sk_load_f32_sse41:
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,8 // jne 4a57 <_sk_load_f32_sse41+0x72>
+ .byte 117,8 // jne 4955 <_sk_load_f32_sse41+0x72>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
- .byte 235,190 // jmp 4a15 <_sk_load_f32_sse41+0x30>
+ .byte 235,190 // jmp 4913 <_sk_load_f32_sse41+0x30>
.byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,8 // jb 4a6b <_sk_load_f32_sse41+0x86>
+ .byte 114,8 // jb 4969 <_sk_load_f32_sse41+0x86>
.byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
- .byte 235,170 // jmp 4a15 <_sk_load_f32_sse41+0x30>
+ .byte 235,170 // jmp 4913 <_sk_load_f32_sse41+0x30>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 235,165 // jmp 4a15 <_sk_load_f32_sse41+0x30>
+ .byte 235,165 // jmp 4913 <_sk_load_f32_sse41+0x30>
HIDDEN _sk_load_f32_dst_sse41
.globl _sk_load_f32_dst_sse41
@@ -31256,7 +30848,7 @@ _sk_load_f32_dst_sse41:
.byte 72,193,224,4 // shl $0x4,%rax
.byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,66 // jne 4ad0 <_sk_load_f32_dst_sse41+0x60>
+ .byte 117,66 // jne 49ce <_sk_load_f32_dst_sse41+0x60>
.byte 67,15,16,100,138,16 // movups 0x10(%r10,%r9,4),%xmm4
.byte 67,15,16,124,138,32 // movups 0x20(%r10,%r9,4),%xmm7
.byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
@@ -31276,17 +30868,17 @@ _sk_load_f32_dst_sse41:
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,8 // jne 4ae2 <_sk_load_f32_dst_sse41+0x72>
+ .byte 117,8 // jne 49e0 <_sk_load_f32_dst_sse41+0x72>
.byte 15,87,255 // xorps %xmm7,%xmm7
.byte 15,87,228 // xorps %xmm4,%xmm4
- .byte 235,190 // jmp 4aa0 <_sk_load_f32_dst_sse41+0x30>
+ .byte 235,190 // jmp 499e <_sk_load_f32_dst_sse41+0x30>
.byte 67,15,16,100,138,16 // movups 0x10(%r10,%r9,4),%xmm4
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,8 // jb 4af6 <_sk_load_f32_dst_sse41+0x86>
+ .byte 114,8 // jb 49f4 <_sk_load_f32_dst_sse41+0x86>
.byte 67,15,16,124,138,32 // movups 0x20(%r10,%r9,4),%xmm7
- .byte 235,170 // jmp 4aa0 <_sk_load_f32_dst_sse41+0x30>
+ .byte 235,170 // jmp 499e <_sk_load_f32_dst_sse41+0x30>
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 235,165 // jmp 4aa0 <_sk_load_f32_dst_sse41+0x30>
+ .byte 235,165 // jmp 499e <_sk_load_f32_dst_sse41+0x30>
HIDDEN _sk_store_f32_sse41
.globl _sk_store_f32_sse41
@@ -31312,7 +30904,7 @@ _sk_store_f32_sse41:
.byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9
.byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1)
.byte 77,133,192 // test %r8,%r8
- .byte 117,29 // jne 4b6d <_sk_store_f32_sse41+0x72>
+ .byte 117,29 // jne 4a6b <_sk_store_f32_sse41+0x72>
.byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10
.byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
.byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
@@ -31320,12 +30912,12 @@ _sk_store_f32_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,246 // je 4b69 <_sk_store_f32_sse41+0x6e>
+ .byte 116,246 // je 4a67 <_sk_store_f32_sse41+0x6e>
.byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,234 // jb 4b69 <_sk_store_f32_sse41+0x6e>
+ .byte 114,234 // jb 4a67 <_sk_store_f32_sse41+0x6e>
.byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
- .byte 235,225 // jmp 4b69 <_sk_store_f32_sse41+0x6e>
+ .byte 235,225 // jmp 4a67 <_sk_store_f32_sse41+0x6e>
HIDDEN _sk_clamp_x_sse41
.globl _sk_clamp_x_sse41
@@ -31409,7 +31001,7 @@ _sk_mirror_x_sse41:
.byte 65,15,92,194 // subps %xmm10,%xmm0
.byte 243,69,15,88,192 // addss %xmm8,%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
- .byte 243,68,15,89,13,241,38,0,0 // mulss 0x26f1(%rip),%xmm9 # 7370 <_sk_callback_sse41+0x16cd>
+ .byte 243,68,15,89,13,179,38,0,0 // mulss 0x26b3(%rip),%xmm9 # 7230 <_sk_callback_sse41+0x168f>
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,89,200 // mulps %xmm0,%xmm9
.byte 102,69,15,58,8,201,1 // roundps $0x1,%xmm9,%xmm9
@@ -31437,7 +31029,7 @@ _sk_mirror_y_sse41:
.byte 65,15,92,202 // subps %xmm10,%xmm1
.byte 243,69,15,88,192 // addss %xmm8,%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
- .byte 243,68,15,89,13,142,38,0,0 // mulss 0x268e(%rip),%xmm9 # 7374 <_sk_callback_sse41+0x16d1>
+ .byte 243,68,15,89,13,80,38,0,0 // mulss 0x2650(%rip),%xmm9 # 7234 <_sk_callback_sse41+0x1693>
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,89,201 // mulps %xmm1,%xmm9
.byte 102,69,15,58,8,201,1 // roundps $0x1,%xmm9,%xmm9
@@ -31459,7 +31051,7 @@ FUNCTION(_sk_clamp_x_1_sse41)
_sk_clamp_x_1_sse41:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,224,33,0,0 // minps 0x21e0(%rip),%xmm8 # 6f10 <_sk_callback_sse41+0x126d>
+ .byte 68,15,93,5,162,33,0,0 // minps 0x21a2(%rip),%xmm8 # 6dd0 <_sk_callback_sse41+0x122f>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -31477,9 +31069,9 @@ HIDDEN _sk_mirror_x_1_sse41
.globl _sk_mirror_x_1_sse41
FUNCTION(_sk_mirror_x_1_sse41)
_sk_mirror_x_1_sse41:
- .byte 68,15,40,5,209,33,0,0 // movaps 0x21d1(%rip),%xmm8 # 6f20 <_sk_callback_sse41+0x127d>
+ .byte 68,15,40,5,147,33,0,0 // movaps 0x2193(%rip),%xmm8 # 6de0 <_sk_callback_sse41+0x123f>
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,13,213,33,0,0 // movaps 0x21d5(%rip),%xmm9 # 6f30 <_sk_callback_sse41+0x128d>
+ .byte 68,15,40,13,151,33,0,0 // movaps 0x2197(%rip),%xmm9 # 6df0 <_sk_callback_sse41+0x124f>
.byte 68,15,89,200 // mulps %xmm0,%xmm9
.byte 102,69,15,58,8,201,1 // roundps $0x1,%xmm9,%xmm9
.byte 69,15,88,201 // addps %xmm9,%xmm9
@@ -31496,10 +31088,10 @@ HIDDEN _sk_luminance_to_alpha_sse41
FUNCTION(_sk_luminance_to_alpha_sse41)
_sk_luminance_to_alpha_sse41:
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 15,89,5,180,33,0,0 // mulps 0x21b4(%rip),%xmm0 # 6f40 <_sk_callback_sse41+0x129d>
- .byte 15,89,13,189,33,0,0 // mulps 0x21bd(%rip),%xmm1 # 6f50 <_sk_callback_sse41+0x12ad>
+ .byte 15,89,5,118,33,0,0 // mulps 0x2176(%rip),%xmm0 # 6e00 <_sk_callback_sse41+0x125f>
+ .byte 15,89,13,127,33,0,0 // mulps 0x217f(%rip),%xmm1 # 6e10 <_sk_callback_sse41+0x126f>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,29,195,33,0,0 // mulps 0x21c3(%rip),%xmm3 # 6f60 <_sk_callback_sse41+0x12bd>
+ .byte 15,89,29,133,33,0,0 // mulps 0x2185(%rip),%xmm3 # 6e20 <_sk_callback_sse41+0x127f>
.byte 15,88,217 // addps %xmm1,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
@@ -31812,9 +31404,9 @@ _sk_evenly_spaced_gradient_sse41:
.byte 72,139,24 // mov (%rax),%rbx
.byte 76,139,112,8 // mov 0x8(%rax),%r14
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 523f <_sk_evenly_spaced_gradient_sse41+0x1a>
+ .byte 120,7 // js 513d <_sk_evenly_spaced_gradient_sse41+0x1a>
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
- .byte 235,21 // jmp 5254 <_sk_evenly_spaced_gradient_sse41+0x2f>
+ .byte 235,21 // jmp 5152 <_sk_evenly_spaced_gradient_sse41+0x2f>
.byte 73,137,217 // mov %rbx,%r9
.byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
@@ -31904,15 +31496,15 @@ HIDDEN _sk_gauss_a_to_rgba_sse41
.globl _sk_gauss_a_to_rgba_sse41
FUNCTION(_sk_gauss_a_to_rgba_sse41)
_sk_gauss_a_to_rgba_sse41:
- .byte 15,40,5,110,27,0,0 // movaps 0x1b6e(%rip),%xmm0 # 6f70 <_sk_callback_sse41+0x12cd>
+ .byte 15,40,5,48,27,0,0 // movaps 0x1b30(%rip),%xmm0 # 6e30 <_sk_callback_sse41+0x128f>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,116,27,0,0 // addps 0x1b74(%rip),%xmm0 # 6f80 <_sk_callback_sse41+0x12dd>
+ .byte 15,88,5,54,27,0,0 // addps 0x1b36(%rip),%xmm0 # 6e40 <_sk_callback_sse41+0x129f>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,122,27,0,0 // addps 0x1b7a(%rip),%xmm0 # 6f90 <_sk_callback_sse41+0x12ed>
+ .byte 15,88,5,60,27,0,0 // addps 0x1b3c(%rip),%xmm0 # 6e50 <_sk_callback_sse41+0x12af>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,128,27,0,0 // addps 0x1b80(%rip),%xmm0 # 6fa0 <_sk_callback_sse41+0x12fd>
+ .byte 15,88,5,66,27,0,0 // addps 0x1b42(%rip),%xmm0 # 6e60 <_sk_callback_sse41+0x12bf>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,134,27,0,0 // addps 0x1b86(%rip),%xmm0 # 6fb0 <_sk_callback_sse41+0x130d>
+ .byte 15,88,5,72,27,0,0 // addps 0x1b48(%rip),%xmm0 # 6e70 <_sk_callback_sse41+0x12cf>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
@@ -31930,12 +31522,12 @@ _sk_gradient_sse41:
.byte 76,139,8 // mov (%rax),%r9
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,249,2 // cmp $0x2,%r9
- .byte 114,50 // jb 547d <_sk_gradient_sse41+0x46>
+ .byte 114,50 // jb 537b <_sk_gradient_sse41+0x46>
.byte 72,139,88,72 // mov 0x48(%rax),%rbx
.byte 73,255,201 // dec %r9
.byte 72,131,195,4 // add $0x4,%rbx
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 15,40,21,95,27,0,0 // movaps 0x1b5f(%rip),%xmm2 # 6fc0 <_sk_callback_sse41+0x131d>
+ .byte 15,40,21,33,27,0,0 // movaps 0x1b21(%rip),%xmm2 # 6e80 <_sk_callback_sse41+0x12df>
.byte 243,15,16,27 // movss (%rbx),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
@@ -31943,7 +31535,7 @@ _sk_gradient_sse41:
.byte 102,15,254,203 // paddd %xmm3,%xmm1
.byte 72,131,195,4 // add $0x4,%rbx
.byte 73,255,201 // dec %r9
- .byte 117,228 // jne 5461 <_sk_gradient_sse41+0x2a>
+ .byte 117,228 // jne 535f <_sk_gradient_sse41+0x2a>
.byte 102,73,15,58,22,201,1 // pextrq $0x1,%xmm1,%r9
.byte 69,137,202 // mov %r9d,%r10d
.byte 73,193,233,32 // shr $0x20,%r9
@@ -32073,26 +31665,26 @@ _sk_xy_to_unit_angle_sse41:
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,40,236 // movaps %xmm12,%xmm13
.byte 69,15,89,237 // mulps %xmm13,%xmm13
- .byte 68,15,40,21,0,25,0,0 // movaps 0x1900(%rip),%xmm10 # 6fd0 <_sk_callback_sse41+0x132d>
+ .byte 68,15,40,21,194,24,0,0 // movaps 0x18c2(%rip),%xmm10 # 6e90 <_sk_callback_sse41+0x12ef>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,4,25,0,0 // addps 0x1904(%rip),%xmm10 # 6fe0 <_sk_callback_sse41+0x133d>
+ .byte 68,15,88,21,198,24,0,0 // addps 0x18c6(%rip),%xmm10 # 6ea0 <_sk_callback_sse41+0x12ff>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,8,25,0,0 // addps 0x1908(%rip),%xmm10 # 6ff0 <_sk_callback_sse41+0x134d>
+ .byte 68,15,88,21,202,24,0,0 // addps 0x18ca(%rip),%xmm10 # 6eb0 <_sk_callback_sse41+0x130f>
.byte 69,15,89,213 // mulps %xmm13,%xmm10
- .byte 68,15,88,21,12,25,0,0 // addps 0x190c(%rip),%xmm10 # 7000 <_sk_callback_sse41+0x135d>
+ .byte 68,15,88,21,206,24,0,0 // addps 0x18ce(%rip),%xmm10 # 6ec0 <_sk_callback_sse41+0x131f>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,194,195,1 // cmpltps %xmm11,%xmm0
- .byte 68,15,40,29,11,25,0,0 // movaps 0x190b(%rip),%xmm11 # 7010 <_sk_callback_sse41+0x136d>
+ .byte 68,15,40,29,205,24,0,0 // movaps 0x18cd(%rip),%xmm11 # 6ed0 <_sk_callback_sse41+0x132f>
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10
.byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9
- .byte 68,15,40,29,4,25,0,0 // movaps 0x1904(%rip),%xmm11 # 7020 <_sk_callback_sse41+0x137d>
+ .byte 68,15,40,29,198,24,0,0 // movaps 0x18c6(%rip),%xmm11 # 6ee0 <_sk_callback_sse41+0x133f>
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 102,69,15,56,20,211 // blendvps %xmm0,%xmm11,%xmm10
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 65,15,194,192,1 // cmpltps %xmm8,%xmm0
- .byte 68,15,40,13,246,24,0,0 // movaps 0x18f6(%rip),%xmm9 # 7030 <_sk_callback_sse41+0x138d>
+ .byte 68,15,40,13,184,24,0,0 // movaps 0x18b8(%rip),%xmm9 # 6ef0 <_sk_callback_sse41+0x134f>
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 102,69,15,56,20,209 // blendvps %xmm0,%xmm9,%xmm10
.byte 69,15,194,194,7 // cmpordps %xmm10,%xmm8
@@ -32126,7 +31718,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41:
.byte 243,69,15,89,203 // mulss %xmm11,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,159,24,0,0 // mulps 0x189f(%rip),%xmm9 # 7040 <_sk_callback_sse41+0x139d>
+ .byte 68,15,89,13,97,24,0,0 // mulps 0x1861(%rip),%xmm9 # 6f00 <_sk_callback_sse41+0x135f>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
@@ -32134,7 +31726,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41:
.byte 243,69,15,89,219 // mulss %xmm11,%xmm11
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,92,227 // subps %xmm11,%xmm12
- .byte 68,15,89,21,138,24,0,0 // mulps 0x188a(%rip),%xmm10 # 7050 <_sk_callback_sse41+0x13ad>
+ .byte 68,15,89,21,76,24,0,0 // mulps 0x184c(%rip),%xmm10 # 6f10 <_sk_callback_sse41+0x136f>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -32143,8 +31735,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41:
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,92,193 // subps %xmm9,%xmm0
- .byte 68,15,87,13,114,24,0,0 // xorps 0x1872(%rip),%xmm9 # 7060 <_sk_callback_sse41+0x13bd>
- .byte 68,15,89,5,122,24,0,0 // mulps 0x187a(%rip),%xmm8 # 7070 <_sk_callback_sse41+0x13cd>
+ .byte 68,15,87,13,52,24,0,0 // xorps 0x1834(%rip),%xmm9 # 6f20 <_sk_callback_sse41+0x137f>
+ .byte 68,15,89,5,60,24,0,0 // mulps 0x183c(%rip),%xmm8 # 6f30 <_sk_callback_sse41+0x138f>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
@@ -32165,7 +31757,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41:
.byte 243,69,15,89,203 // mulss %xmm11,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,65,24,0,0 // mulps 0x1841(%rip),%xmm9 # 7080 <_sk_callback_sse41+0x13dd>
+ .byte 68,15,89,13,3,24,0,0 // mulps 0x1803(%rip),%xmm9 # 6f40 <_sk_callback_sse41+0x139f>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
@@ -32173,7 +31765,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41:
.byte 243,69,15,89,219 // mulss %xmm11,%xmm11
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,92,227 // subps %xmm11,%xmm12
- .byte 68,15,89,21,44,24,0,0 // mulps 0x182c(%rip),%xmm10 # 7090 <_sk_callback_sse41+0x13ed>
+ .byte 68,15,89,21,238,23,0,0 // mulps 0x17ee(%rip),%xmm10 # 6f50 <_sk_callback_sse41+0x13af>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -32182,8 +31774,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41:
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,92,193 // subps %xmm9,%xmm0
- .byte 68,15,87,13,20,24,0,0 // xorps 0x1814(%rip),%xmm9 # 70a0 <_sk_callback_sse41+0x13fd>
- .byte 68,15,89,5,28,24,0,0 // mulps 0x181c(%rip),%xmm8 # 70b0 <_sk_callback_sse41+0x140d>
+ .byte 68,15,87,13,214,23,0,0 // xorps 0x17d6(%rip),%xmm9 # 6f60 <_sk_callback_sse41+0x13bf>
+ .byte 68,15,89,5,222,23,0,0 // mulps 0x17de(%rip),%xmm8 # 6f70 <_sk_callback_sse41+0x13cf>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
@@ -32201,7 +31793,7 @@ _sk_xy_to_2pt_conical_linear_sse41:
.byte 243,69,15,89,200 // mulss %xmm8,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,244,23,0,0 // mulps 0x17f4(%rip),%xmm9 # 70c0 <_sk_callback_sse41+0x141d>
+ .byte 68,15,89,13,182,23,0,0 // mulps 0x17b6(%rip),%xmm9 # 6f80 <_sk_callback_sse41+0x13df>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 69,15,89,210 // mulps %xmm10,%xmm10
@@ -32209,7 +31801,7 @@ _sk_xy_to_2pt_conical_linear_sse41:
.byte 243,69,15,89,192 // mulss %xmm8,%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,92,192 // subps %xmm8,%xmm0
- .byte 15,87,5,224,23,0,0 // xorps 0x17e0(%rip),%xmm0 # 70d0 <_sk_callback_sse41+0x142d>
+ .byte 15,87,5,162,23,0,0 // xorps 0x17a2(%rip),%xmm0 # 6f90 <_sk_callback_sse41+0x13ef>
.byte 65,15,94,193 // divps %xmm9,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32252,7 +31844,7 @@ HIDDEN _sk_save_xy_sse41
FUNCTION(_sk_save_xy_sse41)
_sk_save_xy_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,134,23,0,0 // movaps 0x1786(%rip),%xmm8 # 70e0 <_sk_callback_sse41+0x143d>
+ .byte 68,15,40,5,72,23,0,0 // movaps 0x1748(%rip),%xmm8 # 6fa0 <_sk_callback_sse41+0x13ff>
.byte 15,17,0 // movups %xmm0,(%rax)
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,88,200 // addps %xmm8,%xmm9
@@ -32296,8 +31888,8 @@ _sk_bilinear_nx_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,8,23,0,0 // addps 0x1708(%rip),%xmm0 # 70f0 <_sk_callback_sse41+0x144d>
- .byte 68,15,40,13,16,23,0,0 // movaps 0x1710(%rip),%xmm9 # 7100 <_sk_callback_sse41+0x145d>
+ .byte 15,88,5,202,22,0,0 // addps 0x16ca(%rip),%xmm0 # 6fb0 <_sk_callback_sse41+0x140f>
+ .byte 68,15,40,13,210,22,0,0 // movaps 0x16d2(%rip),%xmm9 # 6fc0 <_sk_callback_sse41+0x141f>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32310,7 +31902,7 @@ _sk_bilinear_px_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,255,22,0,0 // addps 0x16ff(%rip),%xmm0 # 7110 <_sk_callback_sse41+0x146d>
+ .byte 15,88,5,193,22,0,0 // addps 0x16c1(%rip),%xmm0 # 6fd0 <_sk_callback_sse41+0x142f>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32322,8 +31914,8 @@ _sk_bilinear_ny_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,241,22,0,0 // addps 0x16f1(%rip),%xmm1 # 7120 <_sk_callback_sse41+0x147d>
- .byte 68,15,40,13,249,22,0,0 // movaps 0x16f9(%rip),%xmm9 # 7130 <_sk_callback_sse41+0x148d>
+ .byte 15,88,13,179,22,0,0 // addps 0x16b3(%rip),%xmm1 # 6fe0 <_sk_callback_sse41+0x143f>
+ .byte 68,15,40,13,187,22,0,0 // movaps 0x16bb(%rip),%xmm9 # 6ff0 <_sk_callback_sse41+0x144f>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32336,7 +31928,7 @@ _sk_bilinear_py_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,231,22,0,0 // addps 0x16e7(%rip),%xmm1 # 7140 <_sk_callback_sse41+0x149d>
+ .byte 15,88,13,169,22,0,0 // addps 0x16a9(%rip),%xmm1 # 7000 <_sk_callback_sse41+0x145f>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32348,13 +31940,13 @@ _sk_bicubic_n3x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,218,22,0,0 // addps 0x16da(%rip),%xmm0 # 7150 <_sk_callback_sse41+0x14ad>
- .byte 68,15,40,13,226,22,0,0 // movaps 0x16e2(%rip),%xmm9 # 7160 <_sk_callback_sse41+0x14bd>
+ .byte 15,88,5,156,22,0,0 // addps 0x169c(%rip),%xmm0 # 7010 <_sk_callback_sse41+0x146f>
+ .byte 68,15,40,13,164,22,0,0 // movaps 0x16a4(%rip),%xmm9 # 7020 <_sk_callback_sse41+0x147f>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,222,22,0,0 // mulps 0x16de(%rip),%xmm9 # 7170 <_sk_callback_sse41+0x14cd>
- .byte 68,15,88,13,230,22,0,0 // addps 0x16e6(%rip),%xmm9 # 7180 <_sk_callback_sse41+0x14dd>
+ .byte 68,15,89,13,160,22,0,0 // mulps 0x16a0(%rip),%xmm9 # 7030 <_sk_callback_sse41+0x148f>
+ .byte 68,15,88,13,168,22,0,0 // addps 0x16a8(%rip),%xmm9 # 7040 <_sk_callback_sse41+0x149f>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32367,16 +31959,16 @@ _sk_bicubic_n1x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,213,22,0,0 // addps 0x16d5(%rip),%xmm0 # 7190 <_sk_callback_sse41+0x14ed>
- .byte 68,15,40,13,221,22,0,0 // movaps 0x16dd(%rip),%xmm9 # 71a0 <_sk_callback_sse41+0x14fd>
+ .byte 15,88,5,151,22,0,0 // addps 0x1697(%rip),%xmm0 # 7050 <_sk_callback_sse41+0x14af>
+ .byte 68,15,40,13,159,22,0,0 // movaps 0x169f(%rip),%xmm9 # 7060 <_sk_callback_sse41+0x14bf>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,225,22,0,0 // movaps 0x16e1(%rip),%xmm8 # 71b0 <_sk_callback_sse41+0x150d>
+ .byte 68,15,40,5,163,22,0,0 // movaps 0x16a3(%rip),%xmm8 # 7070 <_sk_callback_sse41+0x14cf>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,229,22,0,0 // addps 0x16e5(%rip),%xmm8 # 71c0 <_sk_callback_sse41+0x151d>
+ .byte 68,15,88,5,167,22,0,0 // addps 0x16a7(%rip),%xmm8 # 7080 <_sk_callback_sse41+0x14df>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,233,22,0,0 // addps 0x16e9(%rip),%xmm8 # 71d0 <_sk_callback_sse41+0x152d>
+ .byte 68,15,88,5,171,22,0,0 // addps 0x16ab(%rip),%xmm8 # 7090 <_sk_callback_sse41+0x14ef>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,237,22,0,0 // addps 0x16ed(%rip),%xmm8 # 71e0 <_sk_callback_sse41+0x153d>
+ .byte 68,15,88,5,175,22,0,0 // addps 0x16af(%rip),%xmm8 # 70a0 <_sk_callback_sse41+0x14ff>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32386,17 +31978,17 @@ HIDDEN _sk_bicubic_p1x_sse41
FUNCTION(_sk_bicubic_p1x_sse41)
_sk_bicubic_p1x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,231,22,0,0 // movaps 0x16e7(%rip),%xmm8 # 71f0 <_sk_callback_sse41+0x154d>
+ .byte 68,15,40,5,169,22,0,0 // movaps 0x16a9(%rip),%xmm8 # 70b0 <_sk_callback_sse41+0x150f>
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,21,227,22,0,0 // movaps 0x16e3(%rip),%xmm10 # 7200 <_sk_callback_sse41+0x155d>
+ .byte 68,15,40,21,165,22,0,0 // movaps 0x16a5(%rip),%xmm10 # 70c0 <_sk_callback_sse41+0x151f>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,231,22,0,0 // addps 0x16e7(%rip),%xmm10 # 7210 <_sk_callback_sse41+0x156d>
+ .byte 68,15,88,21,169,22,0,0 // addps 0x16a9(%rip),%xmm10 # 70d0 <_sk_callback_sse41+0x152f>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,227,22,0,0 // addps 0x16e3(%rip),%xmm10 # 7220 <_sk_callback_sse41+0x157d>
+ .byte 68,15,88,21,165,22,0,0 // addps 0x16a5(%rip),%xmm10 # 70e0 <_sk_callback_sse41+0x153f>
.byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32408,11 +32000,11 @@ _sk_bicubic_p3x_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,214,22,0,0 // addps 0x16d6(%rip),%xmm0 # 7230 <_sk_callback_sse41+0x158d>
+ .byte 15,88,5,152,22,0,0 // addps 0x1698(%rip),%xmm0 # 70f0 <_sk_callback_sse41+0x154f>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,214,22,0,0 // mulps 0x16d6(%rip),%xmm8 # 7240 <_sk_callback_sse41+0x159d>
- .byte 68,15,88,5,222,22,0,0 // addps 0x16de(%rip),%xmm8 # 7250 <_sk_callback_sse41+0x15ad>
+ .byte 68,15,89,5,152,22,0,0 // mulps 0x1698(%rip),%xmm8 # 7100 <_sk_callback_sse41+0x155f>
+ .byte 68,15,88,5,160,22,0,0 // addps 0x16a0(%rip),%xmm8 # 7110 <_sk_callback_sse41+0x156f>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32425,13 +32017,13 @@ _sk_bicubic_n3y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,204,22,0,0 // addps 0x16cc(%rip),%xmm1 # 7260 <_sk_callback_sse41+0x15bd>
- .byte 68,15,40,13,212,22,0,0 // movaps 0x16d4(%rip),%xmm9 # 7270 <_sk_callback_sse41+0x15cd>
+ .byte 15,88,13,142,22,0,0 // addps 0x168e(%rip),%xmm1 # 7120 <_sk_callback_sse41+0x157f>
+ .byte 68,15,40,13,150,22,0,0 // movaps 0x1696(%rip),%xmm9 # 7130 <_sk_callback_sse41+0x158f>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,208,22,0,0 // mulps 0x16d0(%rip),%xmm9 # 7280 <_sk_callback_sse41+0x15dd>
- .byte 68,15,88,13,216,22,0,0 // addps 0x16d8(%rip),%xmm9 # 7290 <_sk_callback_sse41+0x15ed>
+ .byte 68,15,89,13,146,22,0,0 // mulps 0x1692(%rip),%xmm9 # 7140 <_sk_callback_sse41+0x159f>
+ .byte 68,15,88,13,154,22,0,0 // addps 0x169a(%rip),%xmm9 # 7150 <_sk_callback_sse41+0x15af>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32444,16 +32036,16 @@ _sk_bicubic_n1y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,198,22,0,0 // addps 0x16c6(%rip),%xmm1 # 72a0 <_sk_callback_sse41+0x15fd>
- .byte 68,15,40,13,206,22,0,0 // movaps 0x16ce(%rip),%xmm9 # 72b0 <_sk_callback_sse41+0x160d>
+ .byte 15,88,13,136,22,0,0 // addps 0x1688(%rip),%xmm1 # 7160 <_sk_callback_sse41+0x15bf>
+ .byte 68,15,40,13,144,22,0,0 // movaps 0x1690(%rip),%xmm9 # 7170 <_sk_callback_sse41+0x15cf>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,210,22,0,0 // movaps 0x16d2(%rip),%xmm8 # 72c0 <_sk_callback_sse41+0x161d>
+ .byte 68,15,40,5,148,22,0,0 // movaps 0x1694(%rip),%xmm8 # 7180 <_sk_callback_sse41+0x15df>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,214,22,0,0 // addps 0x16d6(%rip),%xmm8 # 72d0 <_sk_callback_sse41+0x162d>
+ .byte 68,15,88,5,152,22,0,0 // addps 0x1698(%rip),%xmm8 # 7190 <_sk_callback_sse41+0x15ef>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,218,22,0,0 // addps 0x16da(%rip),%xmm8 # 72e0 <_sk_callback_sse41+0x163d>
+ .byte 68,15,88,5,156,22,0,0 // addps 0x169c(%rip),%xmm8 # 71a0 <_sk_callback_sse41+0x15ff>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,222,22,0,0 // addps 0x16de(%rip),%xmm8 # 72f0 <_sk_callback_sse41+0x164d>
+ .byte 68,15,88,5,160,22,0,0 // addps 0x16a0(%rip),%xmm8 # 71b0 <_sk_callback_sse41+0x160f>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32463,17 +32055,17 @@ HIDDEN _sk_bicubic_p1y_sse41
FUNCTION(_sk_bicubic_p1y_sse41)
_sk_bicubic_p1y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,216,22,0,0 // movaps 0x16d8(%rip),%xmm8 # 7300 <_sk_callback_sse41+0x165d>
+ .byte 68,15,40,5,154,22,0,0 // movaps 0x169a(%rip),%xmm8 # 71c0 <_sk_callback_sse41+0x161f>
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 68,15,40,21,211,22,0,0 // movaps 0x16d3(%rip),%xmm10 # 7310 <_sk_callback_sse41+0x166d>
+ .byte 68,15,40,21,149,22,0,0 // movaps 0x1695(%rip),%xmm10 # 71d0 <_sk_callback_sse41+0x162f>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,215,22,0,0 // addps 0x16d7(%rip),%xmm10 # 7320 <_sk_callback_sse41+0x167d>
+ .byte 68,15,88,21,153,22,0,0 // addps 0x1699(%rip),%xmm10 # 71e0 <_sk_callback_sse41+0x163f>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,211,22,0,0 // addps 0x16d3(%rip),%xmm10 # 7330 <_sk_callback_sse41+0x168d>
+ .byte 68,15,88,21,149,22,0,0 // addps 0x1695(%rip),%xmm10 # 71f0 <_sk_callback_sse41+0x164f>
.byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -32485,11 +32077,11 @@ _sk_bicubic_p3y_sse41:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,197,22,0,0 // addps 0x16c5(%rip),%xmm1 # 7340 <_sk_callback_sse41+0x169d>
+ .byte 15,88,13,135,22,0,0 // addps 0x1687(%rip),%xmm1 # 7200 <_sk_callback_sse41+0x165f>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,197,22,0,0 // mulps 0x16c5(%rip),%xmm8 # 7350 <_sk_callback_sse41+0x16ad>
- .byte 68,15,88,5,205,22,0,0 // addps 0x16cd(%rip),%xmm8 # 7360 <_sk_callback_sse41+0x16bd>
+ .byte 68,15,89,5,135,22,0,0 // mulps 0x1687(%rip),%xmm8 # 7210 <_sk_callback_sse41+0x166f>
+ .byte 68,15,88,5,143,22,0,0 // addps 0x168f(%rip),%xmm8 # 7220 <_sk_callback_sse41+0x167f>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -32731,9 +32323,9 @@ BALIGN16
.byte 128,191,0,0,224,64,0 // cmpb $0x0,0x40e00000(%rdi)
.byte 0,224 // add %ah,%al
.byte 64,0,0 // add %al,(%rax)
- .byte 224,64 // loopne 5f9c <.literal16+0x1fc>
+ .byte 224,64 // loopne 5e9c <.literal16+0x1fc>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 5fa0 <.literal16+0x200>
+ .byte 224,64 // loopne 5ea0 <.literal16+0x200>
.byte 154 // (bad)
.byte 153 // cltd
.byte 153 // cltd
@@ -32753,13 +32345,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5fc1 <.literal16+0x221>
+ .byte 71,225,61 // rex.RXB loope 5ec1 <.literal16+0x221>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5fc5 <.literal16+0x225>
+ .byte 71,225,61 // rex.RXB loope 5ec5 <.literal16+0x225>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5fc9 <.literal16+0x229>
+ .byte 71,225,61 // rex.RXB loope 5ec9 <.literal16+0x229>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 5fcd <.literal16+0x22d>
+ .byte 71,225,61 // rex.RXB loope 5ecd <.literal16+0x22d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -32784,13 +32376,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6001 <.literal16+0x261>
+ .byte 71,225,61 // rex.RXB loope 5f01 <.literal16+0x261>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6005 <.literal16+0x265>
+ .byte 71,225,61 // rex.RXB loope 5f05 <.literal16+0x265>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6009 <.literal16+0x269>
+ .byte 71,225,61 // rex.RXB loope 5f09 <.literal16+0x269>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 600d <.literal16+0x26d>
+ .byte 71,225,61 // rex.RXB loope 5f0d <.literal16+0x26d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -32815,13 +32407,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6041 <.literal16+0x2a1>
+ .byte 71,225,61 // rex.RXB loope 5f41 <.literal16+0x2a1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6045 <.literal16+0x2a5>
+ .byte 71,225,61 // rex.RXB loope 5f45 <.literal16+0x2a5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6049 <.literal16+0x2a9>
+ .byte 71,225,61 // rex.RXB loope 5f49 <.literal16+0x2a9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 604d <.literal16+0x2ad>
+ .byte 71,225,61 // rex.RXB loope 5f4d <.literal16+0x2ad>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -32846,13 +32438,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6081 <.literal16+0x2e1>
+ .byte 71,225,61 // rex.RXB loope 5f81 <.literal16+0x2e1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6085 <.literal16+0x2e5>
+ .byte 71,225,61 // rex.RXB loope 5f85 <.literal16+0x2e5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6089 <.literal16+0x2e9>
+ .byte 71,225,61 // rex.RXB loope 5f89 <.literal16+0x2e9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 608d <.literal16+0x2ed>
+ .byte 71,225,61 // rex.RXB loope 5f8d <.literal16+0x2ed>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -32869,10 +32461,10 @@ BALIGN16
.byte 0,1 // add %al,(%rcx)
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a006078 <_sk_callback_sse41+0xa0003d5>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a005f78 <_sk_callback_sse41+0xa0003d7>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006080 <_sk_callback_sse41+0x30003dd>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3005f80 <_sk_callback_sse41+0x30003df>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -32891,11 +32483,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
.byte 67,0,0 // rex.XB add %al,(%r8)
- .byte 127,67 // jg 60eb <.literal16+0x34b>
+ .byte 127,67 // jg 5feb <.literal16+0x34b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 60ef <.literal16+0x34f>
+ .byte 127,67 // jg 5fef <.literal16+0x34f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 60f3 <.literal16+0x353>
+ .byte 127,67 // jg 5ff3 <.literal16+0x353>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -33177,13 +32769,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6329 <.literal16+0x589>
+ .byte 224,7 // loopne 6229 <.literal16+0x589>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 632d <.literal16+0x58d>
+ .byte 224,7 // loopne 622d <.literal16+0x58d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6331 <.literal16+0x591>
+ .byte 224,7 // loopne 6231 <.literal16+0x591>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6335 <.literal16+0x595>
+ .byte 224,7 // loopne 6235 <.literal16+0x595>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -33217,10 +32809,10 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 1,255 // add %edi,%edi
.byte 255 // (bad)
- .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a006378 <_sk_callback_sse41+0xa0006d5>
+ .byte 255,5,255,255,255,9 // incl 0x9ffffff(%rip) # a006278 <_sk_callback_sse41+0xa0006d7>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006380 <_sk_callback_sse41+0x30006dd>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006280 <_sk_callback_sse41+0x30006df>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -33275,11 +32867,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 644b <.literal16+0x6ab>
+ .byte 127,67 // jg 634b <.literal16+0x6ab>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 644f <.literal16+0x6af>
+ .byte 127,67 // jg 634f <.literal16+0x6af>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6453 <.literal16+0x6b3>
+ .byte 127,67 // jg 6353 <.literal16+0x6b3>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%rax)
@@ -33294,16 +32886,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6444 <.literal16+0x6a4>
+ .byte 127,0 // jg 6344 <.literal16+0x6a4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6448 <.literal16+0x6a8>
+ .byte 127,0 // jg 6348 <.literal16+0x6a8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 644c <.literal16+0x6ac>
+ .byte 127,0 // jg 634c <.literal16+0x6ac>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6450 <.literal16+0x6b0>
+ .byte 127,0 // jg 6350 <.literal16+0x6b0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -33312,7 +32904,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 64d5 <.literal16+0x735>
+ .byte 119,115 // ja 63d5 <.literal16+0x735>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -33323,7 +32915,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 6439 <.literal16+0x699>
+ .byte 117,191 // jne 6339 <.literal16+0x699>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -33335,7 +32927,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3a47a <_sk_callback_sse41+0xffffffffe9a347d7>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a37a <_sk_callback_sse41+0xffffffffe9a347d9>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -33390,16 +32982,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6514 <.literal16+0x774>
+ .byte 127,0 // jg 6414 <.literal16+0x774>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6518 <.literal16+0x778>
+ .byte 127,0 // jg 6418 <.literal16+0x778>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 651c <.literal16+0x77c>
+ .byte 127,0 // jg 641c <.literal16+0x77c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6520 <.literal16+0x780>
+ .byte 127,0 // jg 6420 <.literal16+0x780>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -33408,7 +33000,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 65a5 <.literal16+0x805>
+ .byte 119,115 // ja 64a5 <.literal16+0x805>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -33419,7 +33011,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 6509 <.literal16+0x769>
+ .byte 117,191 // jne 6409 <.literal16+0x769>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -33431,7 +33023,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3a54a <_sk_callback_sse41+0xffffffffe9a348a7>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a44a <_sk_callback_sse41+0xffffffffe9a348a9>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -33486,16 +33078,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 65e4 <.literal16+0x844>
+ .byte 127,0 // jg 64e4 <.literal16+0x844>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 65e8 <.literal16+0x848>
+ .byte 127,0 // jg 64e8 <.literal16+0x848>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 65ec <.literal16+0x84c>
+ .byte 127,0 // jg 64ec <.literal16+0x84c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 65f0 <.literal16+0x850>
+ .byte 127,0 // jg 64f0 <.literal16+0x850>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -33504,7 +33096,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6675 <.literal16+0x8d5>
+ .byte 119,115 // ja 6575 <.literal16+0x8d5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -33515,7 +33107,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 65d9 <.literal16+0x839>
+ .byte 117,191 // jne 64d9 <.literal16+0x839>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -33527,7 +33119,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3a61a <_sk_callback_sse41+0xffffffffe9a34977>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a51a <_sk_callback_sse41+0xffffffffe9a34979>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -33582,16 +33174,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 66b4 <.literal16+0x914>
+ .byte 127,0 // jg 65b4 <.literal16+0x914>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 66b8 <.literal16+0x918>
+ .byte 127,0 // jg 65b8 <.literal16+0x918>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 66bc <.literal16+0x91c>
+ .byte 127,0 // jg 65bc <.literal16+0x91c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 66c0 <.literal16+0x920>
+ .byte 127,0 // jg 65c0 <.literal16+0x920>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -33600,7 +33192,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6745 <.literal16+0x9a5>
+ .byte 119,115 // ja 6645 <.literal16+0x9a5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -33611,7 +33203,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 66a9 <.literal16+0x909>
+ .byte 117,191 // jne 65a9 <.literal16+0x909>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -33623,7 +33215,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3a6ea <_sk_callback_sse41+0xffffffffe9a34a47>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a5ea <_sk_callback_sse41+0xffffffffe9a34a49>
.byte 220,63 // fdivrl (%rdi)
.byte 81 // push %rcx
.byte 140,242 // mov %?,%edx
@@ -33674,13 +33266,13 @@ BALIGN16
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
- .byte 127,67 // jg 67c7 <.literal16+0xa27>
+ .byte 127,67 // jg 66c7 <.literal16+0xa27>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 67cb <.literal16+0xa2b>
+ .byte 127,67 // jg 66cb <.literal16+0xa2b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 67cf <.literal16+0xa2f>
+ .byte 127,67 // jg 66cf <.literal16+0xa2f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 67d3 <.literal16+0xa33>
+ .byte 127,67 // jg 66d3 <.literal16+0xa33>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -33727,16 +33319,16 @@ BALIGN16
.byte 128,3,62 // addb $0x3e,(%rbx)
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6853 <.literal16+0xab3>
+ .byte 118,63 // jbe 6753 <.literal16+0xab3>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6857 <.literal16+0xab7>
+ .byte 118,63 // jbe 6757 <.literal16+0xab7>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 685b <.literal16+0xabb>
+ .byte 118,63 // jbe 675b <.literal16+0xabb>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 685f <.literal16+0xabf>
+ .byte 118,63 // jbe 675f <.literal16+0xabf>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
@@ -33765,11 +33357,11 @@ BALIGN16
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 68cb <.literal16+0xb2b>
+ .byte 127,67 // jg 67cb <.literal16+0xb2b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 68cf <.literal16+0xb2f>
+ .byte 127,67 // jg 67cf <.literal16+0xb2f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 68d3 <.literal16+0xb33>
+ .byte 127,67 // jg 67d3 <.literal16+0xb33>
.byte 0,4,0 // add %al,(%rax,%rax,1)
.byte 0,0 // add %al,(%rax)
.byte 0,0 // add %al,(%rax)
@@ -33813,34 +33405,7 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
.byte 63 // (bad)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
- .byte 128,59,129 // cmpb $0x81,(%rbx)
- .byte 128,128,59,1,255,255,255 // addb $0xff,-0xfec5(%rax)
- .byte 5,255,255,255,9 // add $0x9ffffff,%eax
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006950 <_sk_callback_sse41+0x3000cad>
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,6 // incl (%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,10 // decl (%rdx)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,14 // decl (%rsi)
- .byte 255 // (bad)
- .byte 255 // (bad)
- .byte 255,0 // incl (%rax)
- .byte 248 // clc
+ .byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%rax)
@@ -33856,13 +33421,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6989 <.literal16+0xbe9>
+ .byte 224,7 // loopne 6849 <.literal16+0xba9>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 698d <.literal16+0xbed>
+ .byte 224,7 // loopne 684d <.literal16+0xbad>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6991 <.literal16+0xbf1>
+ .byte 224,7 // loopne 6851 <.literal16+0xbb1>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6995 <.literal16+0xbf5>
+ .byte 224,7 // loopne 6855 <.literal16+0xbb5>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -33908,13 +33473,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 69f9 <.literal16+0xc59>
+ .byte 224,7 // loopne 68b9 <.literal16+0xc19>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 69fd <.literal16+0xc5d>
+ .byte 224,7 // loopne 68bd <.literal16+0xc1d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6a01 <.literal16+0xc61>
+ .byte 224,7 // loopne 68c1 <.literal16+0xc21>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6a05 <.literal16+0xc65>
+ .byte 224,7 // loopne 68c5 <.literal16+0xc25>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -33960,13 +33525,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6a69 <.literal16+0xcc9>
+ .byte 224,7 // loopne 6929 <.literal16+0xc89>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6a6d <.literal16+0xccd>
+ .byte 224,7 // loopne 692d <.literal16+0xc8d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6a71 <.literal16+0xcd1>
+ .byte 224,7 // loopne 6931 <.literal16+0xc91>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6a75 <.literal16+0xcd5>
+ .byte 224,7 // loopne 6935 <.literal16+0xc95>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -34004,13 +33569,13 @@ BALIGN16
.byte 65,0,0 // add %al,(%r8)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 6b06 <.literal16+0xd66>
+ .byte 124,66 // jl 69c6 <.literal16+0xd26>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6b0a <.literal16+0xd6a>
+ .byte 124,66 // jl 69ca <.literal16+0xd2a>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6b0e <.literal16+0xd6e>
+ .byte 124,66 // jl 69ce <.literal16+0xd2e>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6b12 <.literal16+0xd72>
+ .byte 124,66 // jl 69d2 <.literal16+0xd32>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,240 // add %dh,%al
@@ -34144,13 +33709,13 @@ BALIGN16
.byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%rax)
.byte 61,137,136,136,61 // cmp $0x3d888889,%eax
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6c95 <.literal16+0xef5>
+ .byte 112,65 // jo 6b55 <.literal16+0xeb5>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6c99 <.literal16+0xef9>
+ .byte 112,65 // jo 6b59 <.literal16+0xeb9>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6c9d <.literal16+0xefd>
+ .byte 112,65 // jo 6b5d <.literal16+0xebd>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 6ca1 <.literal16+0xf01>
+ .byte 112,65 // jo 6b61 <.literal16+0xec1>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -34165,7 +33730,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006c90 <_sk_callback_sse41+0x3000fed>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006b50 <_sk_callback_sse41+0x3000faf>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34192,7 +33757,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006cd0 <_sk_callback_sse41+0x300102d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006b90 <_sk_callback_sse41+0x3000fef>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34219,7 +33784,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006d10 <_sk_callback_sse41+0x300106d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006bd0 <_sk_callback_sse41+0x300102f>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34234,19 +33799,19 @@ BALIGN16
.byte 255,0 // incl (%rax)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d6b <.literal16+0xfcb>
+ .byte 127,67 // jg 6c2b <.literal16+0xf8b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d6f <.literal16+0xfcf>
+ .byte 127,67 // jg 6c2f <.literal16+0xf8f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d73 <.literal16+0xfd3>
+ .byte 127,67 // jg 6c33 <.literal16+0xf93>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d77 <.literal16+0xfd7>
+ .byte 127,67 // jg 6c37 <.literal16+0xf97>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d7b <.literal16+0xfdb>
+ .byte 127,67 // jg 6c3b <.literal16+0xf9b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d7f <.literal16+0xfdf>
+ .byte 127,67 // jg 6c3f <.literal16+0xf9f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6d83 <.literal16+0xfe3>
+ .byte 127,67 // jg 6c43 <.literal16+0xfa3>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -34261,7 +33826,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006d70 <_sk_callback_sse41+0x30010cd>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006c30 <_sk_callback_sse41+0x300108f>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34288,7 +33853,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006db0 <_sk_callback_sse41+0x300110d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006c70 <_sk_callback_sse41+0x30010cf>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34315,7 +33880,7 @@ BALIGN16
.byte 5,255,255,255,9 // add $0x9ffffff,%eax
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006df0 <_sk_callback_sse41+0x300114d>
+ .byte 255,13,255,255,255,2 // decl 0x2ffffff(%rip) # 3006cb0 <_sk_callback_sse41+0x300110f>
.byte 255 // (bad)
.byte 255 // (bad)
.byte 255,6 // incl (%rsi)
@@ -34330,11 +33895,11 @@ BALIGN16
.byte 255,0 // incl (%rax)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6e4b <.literal16+0x10ab>
+ .byte 127,67 // jg 6d0b <.literal16+0x106b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6e4f <.literal16+0x10af>
+ .byte 127,67 // jg 6d0f <.literal16+0x106f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6e53 <.literal16+0x10b3>
+ .byte 127,67 // jg 6d13 <.literal16+0x1073>
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
.byte 0,0 // add %al,(%rax)
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
@@ -34429,13 +33994,13 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 6f4b <.literal16+0x11ab>
+ .byte 127,71 // jg 6e0b <.literal16+0x116b>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 6f4f <.literal16+0x11af>
+ .byte 127,71 // jg 6e0f <.literal16+0x116f>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 6f53 <.literal16+0x11b3>
+ .byte 127,71 // jg 6e13 <.literal16+0x1173>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 6f57 <.literal16+0x11b7>
+ .byte 127,71 // jg 6e17 <.literal16+0x1177>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -34481,10 +34046,10 @@ BALIGN16
.byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax
.byte 152 // cwtl
.byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx)
- .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0808a <_sk_callback_sse41+0x2dc023e7>
+ .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc07f4a <_sk_callback_sse41+0x2dc023a9>
.byte 17,192 // adc %eax,%eax
.byte 45,16,17,192,18 // sub $0x12c01110,%eax
- .byte 120,57 // js 6fbc <.literal16+0x121c>
+ .byte 120,57 // js 6e7c <.literal16+0x11dc>
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
@@ -34665,11 +34230,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 7192 <.literal16+0x13f2>
+ .byte 62,114,28 // jb,pt 7052 <.literal16+0x13b2>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7196 <.literal16+0x13f6>
+ .byte 62,114,28 // jb,pt 7056 <.literal16+0x13b6>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 719a <.literal16+0x13fa>
+ .byte 62,114,28 // jb,pt 705a <.literal16+0x13ba>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -34713,7 +34278,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640025 <_sk_callback_sse41+0x3d63a382>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63fee5 <_sk_callback_sse41+0x3d63a344>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -34739,7 +34304,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640065 <_sk_callback_sse41+0x3d63a3c2>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63ff25 <_sk_callback_sse41+0x3d63a384>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -34748,13 +34313,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 725e <.literal16+0x14be>
+ .byte 114,28 // jb 711e <.literal16+0x147e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7262 <.literal16+0x14c2>
+ .byte 62,114,28 // jb,pt 7122 <.literal16+0x1482>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7266 <.literal16+0x14c6>
+ .byte 62,114,28 // jb,pt 7126 <.literal16+0x1486>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 726a <.literal16+0x14ca>
+ .byte 62,114,28 // jb,pt 712a <.literal16+0x148a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -34775,11 +34340,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 72a2 <.literal16+0x1502>
+ .byte 62,114,28 // jb,pt 7162 <.literal16+0x14c2>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 72a6 <.literal16+0x1506>
+ .byte 62,114,28 // jb,pt 7166 <.literal16+0x14c6>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 72aa <.literal16+0x150a>
+ .byte 62,114,28 // jb,pt 716a <.literal16+0x14ca>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -34823,7 +34388,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640135 <_sk_callback_sse41+0x3d63a492>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d63fff5 <_sk_callback_sse41+0x3d63a454>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -34849,7 +34414,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640175 <_sk_callback_sse41+0x3d63a4d2>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640035 <_sk_callback_sse41+0x3d63a494>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -34858,13 +34423,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 736e <.literal16+0x15ce>
+ .byte 114,28 // jb 722e <.literal16+0x158e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7372 <_sk_callback_sse41+0x16cf>
+ .byte 62,114,28 // jb,pt 7232 <_sk_callback_sse41+0x1691>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7376 <_sk_callback_sse41+0x16d3>
+ .byte 62,114,28 // jb,pt 7236 <_sk_callback_sse41+0x1695>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 737a <_sk_callback_sse41+0x16d7>
+ .byte 62,114,28 // jb,pt 723a <_sk_callback_sse41+0x1699>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -35021,7 +34586,7 @@ _sk_seed_shader_sse2:
.byte 102,15,110,194 // movd %edx,%xmm0
.byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
- .byte 15,40,21,128,97,0,0 // movaps 0x6180(%rip),%xmm2 # 62d0 <_sk_callback_sse2+0xfc>
+ .byte 15,40,21,48,96,0,0 // movaps 0x6030(%rip),%xmm2 # 6180 <_sk_callback_sse2+0xf1>
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 15,16,7 // movups (%rdi),%xmm0
.byte 15,88,193 // addps %xmm1,%xmm0
@@ -35030,7 +34595,7 @@ _sk_seed_shader_sse2:
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,21,111,97,0,0 // movaps 0x616f(%rip),%xmm2 # 62e0 <_sk_callback_sse2+0x10c>
+ .byte 15,40,21,31,96,0,0 // movaps 0x601f(%rip),%xmm2 # 6190 <_sk_callback_sse2+0x101>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,87,237 // xorps %xmm5,%xmm5
@@ -35050,14 +34615,14 @@ _sk_dither_sse2:
.byte 102,68,15,110,193 // movd %ecx,%xmm8
.byte 102,69,15,112,192,0 // pshufd $0x0,%xmm8,%xmm8
.byte 102,69,15,239,193 // pxor %xmm9,%xmm8
- .byte 102,68,15,111,21,61,97,0,0 // movdqa 0x613d(%rip),%xmm10 # 62f0 <_sk_callback_sse2+0x11c>
+ .byte 102,68,15,111,21,237,95,0,0 // movdqa 0x5fed(%rip),%xmm10 # 61a0 <_sk_callback_sse2+0x111>
.byte 102,69,15,111,216 // movdqa %xmm8,%xmm11
.byte 102,69,15,219,218 // pand %xmm10,%xmm11
.byte 102,65,15,114,243,5 // pslld $0x5,%xmm11
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 102,65,15,114,242,4 // pslld $0x4,%xmm10
- .byte 102,68,15,111,37,41,97,0,0 // movdqa 0x6129(%rip),%xmm12 # 6300 <_sk_callback_sse2+0x12c>
- .byte 102,68,15,111,45,48,97,0,0 // movdqa 0x6130(%rip),%xmm13 # 6310 <_sk_callback_sse2+0x13c>
+ .byte 102,68,15,111,37,217,95,0,0 // movdqa 0x5fd9(%rip),%xmm12 # 61b0 <_sk_callback_sse2+0x121>
+ .byte 102,68,15,111,45,224,95,0,0 // movdqa 0x5fe0(%rip),%xmm13 # 61c0 <_sk_callback_sse2+0x131>
.byte 102,69,15,111,240 // movdqa %xmm8,%xmm14
.byte 102,69,15,219,245 // pand %xmm13,%xmm14
.byte 102,65,15,114,246,2 // pslld $0x2,%xmm14
@@ -35073,8 +34638,8 @@ _sk_dither_sse2:
.byte 102,69,15,235,245 // por %xmm13,%xmm14
.byte 102,69,15,235,240 // por %xmm8,%xmm14
.byte 69,15,91,198 // cvtdq2ps %xmm14,%xmm8
- .byte 68,15,89,5,235,96,0,0 // mulps 0x60eb(%rip),%xmm8 # 6320 <_sk_callback_sse2+0x14c>
- .byte 68,15,88,5,243,96,0,0 // addps 0x60f3(%rip),%xmm8 # 6330 <_sk_callback_sse2+0x15c>
+ .byte 68,15,89,5,155,95,0,0 // mulps 0x5f9b(%rip),%xmm8 # 61d0 <_sk_callback_sse2+0x141>
+ .byte 68,15,88,5,163,95,0,0 // addps 0x5fa3(%rip),%xmm8 # 61e0 <_sk_callback_sse2+0x151>
.byte 243,68,15,16,16 // movss (%rax),%xmm10
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
@@ -35116,7 +34681,7 @@ HIDDEN _sk_black_color_sse2
FUNCTION(_sk_black_color_sse2)
_sk_black_color_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,137,96,0,0 // movaps 0x6089(%rip),%xmm3 # 6340 <_sk_callback_sse2+0x16c>
+ .byte 15,40,29,57,95,0,0 // movaps 0x5f39(%rip),%xmm3 # 61f0 <_sk_callback_sse2+0x161>
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -35127,7 +34692,7 @@ HIDDEN _sk_white_color_sse2
FUNCTION(_sk_white_color_sse2)
_sk_white_color_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,5,133,96,0,0 // movaps 0x6085(%rip),%xmm0 # 6350 <_sk_callback_sse2+0x17c>
+ .byte 15,40,5,53,95,0,0 // movaps 0x5f35(%rip),%xmm0 # 6200 <_sk_callback_sse2+0x171>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,40,216 // movaps %xmm0,%xmm3
@@ -35173,7 +34738,7 @@ HIDDEN _sk_srcatop_sse2
FUNCTION(_sk_srcatop_sse2)
_sk_srcatop_sse2:
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 68,15,40,5,69,96,0,0 // movaps 0x6045(%rip),%xmm8 # 6360 <_sk_callback_sse2+0x18c>
+ .byte 68,15,40,5,245,94,0,0 // movaps 0x5ef5(%rip),%xmm8 # 6210 <_sk_callback_sse2+0x181>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -35198,7 +34763,7 @@ FUNCTION(_sk_dstatop_sse2)
_sk_dstatop_sse2:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
.byte 68,15,89,196 // mulps %xmm4,%xmm8
- .byte 68,15,40,13,8,96,0,0 // movaps 0x6008(%rip),%xmm9 # 6370 <_sk_callback_sse2+0x19c>
+ .byte 68,15,40,13,184,94,0,0 // movaps 0x5eb8(%rip),%xmm9 # 6220 <_sk_callback_sse2+0x191>
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
@@ -35245,7 +34810,7 @@ HIDDEN _sk_srcout_sse2
.globl _sk_srcout_sse2
FUNCTION(_sk_srcout_sse2)
_sk_srcout_sse2:
- .byte 68,15,40,5,172,95,0,0 // movaps 0x5fac(%rip),%xmm8 # 6380 <_sk_callback_sse2+0x1ac>
+ .byte 68,15,40,5,92,94,0,0 // movaps 0x5e5c(%rip),%xmm8 # 6230 <_sk_callback_sse2+0x1a1>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
@@ -35258,7 +34823,7 @@ HIDDEN _sk_dstout_sse2
.globl _sk_dstout_sse2
FUNCTION(_sk_dstout_sse2)
_sk_dstout_sse2:
- .byte 68,15,40,5,156,95,0,0 // movaps 0x5f9c(%rip),%xmm8 # 6390 <_sk_callback_sse2+0x1bc>
+ .byte 68,15,40,5,76,94,0,0 // movaps 0x5e4c(%rip),%xmm8 # 6240 <_sk_callback_sse2+0x1b1>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
@@ -35275,7 +34840,7 @@ HIDDEN _sk_srcover_sse2
.globl _sk_srcover_sse2
FUNCTION(_sk_srcover_sse2)
_sk_srcover_sse2:
- .byte 68,15,40,5,127,95,0,0 // movaps 0x5f7f(%rip),%xmm8 # 63a0 <_sk_callback_sse2+0x1cc>
+ .byte 68,15,40,5,47,94,0,0 // movaps 0x5e2f(%rip),%xmm8 # 6250 <_sk_callback_sse2+0x1c1>
.byte 68,15,92,195 // subps %xmm3,%xmm8
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -35295,7 +34860,7 @@ HIDDEN _sk_dstover_sse2
.globl _sk_dstover_sse2
FUNCTION(_sk_dstover_sse2)
_sk_dstover_sse2:
- .byte 68,15,40,5,83,95,0,0 // movaps 0x5f53(%rip),%xmm8 # 63b0 <_sk_callback_sse2+0x1dc>
+ .byte 68,15,40,5,3,94,0,0 // movaps 0x5e03(%rip),%xmm8 # 6260 <_sk_callback_sse2+0x1d1>
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -35323,7 +34888,7 @@ HIDDEN _sk_multiply_sse2
.globl _sk_multiply_sse2
FUNCTION(_sk_multiply_sse2)
_sk_multiply_sse2:
- .byte 68,15,40,5,39,95,0,0 // movaps 0x5f27(%rip),%xmm8 # 63c0 <_sk_callback_sse2+0x1ec>
+ .byte 68,15,40,5,215,93,0,0 // movaps 0x5dd7(%rip),%xmm8 # 6270 <_sk_callback_sse2+0x1e1>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,209 // movaps %xmm9,%xmm10
@@ -35398,7 +34963,7 @@ HIDDEN _sk_xor__sse2
FUNCTION(_sk_xor__sse2)
_sk_xor__sse2:
.byte 68,15,40,195 // movaps %xmm3,%xmm8
- .byte 15,40,29,92,94,0,0 // movaps 0x5e5c(%rip),%xmm3 # 63d0 <_sk_callback_sse2+0x1fc>
+ .byte 15,40,29,12,93,0,0 // movaps 0x5d0c(%rip),%xmm3 # 6280 <_sk_callback_sse2+0x1f1>
.byte 68,15,40,203 // movaps %xmm3,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 65,15,89,193 // mulps %xmm9,%xmm0
@@ -35446,7 +35011,7 @@ _sk_darken_sse2:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,95,209 // maxps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,199,93,0,0 // movaps 0x5dc7(%rip),%xmm2 # 63e0 <_sk_callback_sse2+0x20c>
+ .byte 15,40,21,119,92,0,0 // movaps 0x5c77(%rip),%xmm2 # 6290 <_sk_callback_sse2+0x201>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -35480,7 +35045,7 @@ _sk_lighten_sse2:
.byte 68,15,89,206 // mulps %xmm6,%xmm9
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,108,93,0,0 // movaps 0x5d6c(%rip),%xmm2 # 63f0 <_sk_callback_sse2+0x21c>
+ .byte 15,40,21,28,92,0,0 // movaps 0x5c1c(%rip),%xmm2 # 62a0 <_sk_callback_sse2+0x211>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -35517,7 +35082,7 @@ _sk_difference_sse2:
.byte 65,15,93,209 // minps %xmm9,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,6,93,0,0 // movaps 0x5d06(%rip),%xmm2 # 6400 <_sk_callback_sse2+0x22c>
+ .byte 15,40,21,182,91,0,0 // movaps 0x5bb6(%rip),%xmm2 # 62b0 <_sk_callback_sse2+0x221>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -35545,7 +35110,7 @@ _sk_exclusion_sse2:
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 68,15,92,194 // subps %xmm2,%xmm8
- .byte 15,40,21,198,92,0,0 // movaps 0x5cc6(%rip),%xmm2 # 6410 <_sk_callback_sse2+0x23c>
+ .byte 15,40,21,118,91,0,0 // movaps 0x5b76(%rip),%xmm2 # 62c0 <_sk_callback_sse2+0x231>
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,89,215 // mulps %xmm7,%xmm2
.byte 15,88,218 // addps %xmm2,%xmm3
@@ -35558,7 +35123,7 @@ HIDDEN _sk_colorburn_sse2
FUNCTION(_sk_colorburn_sse2)
_sk_colorburn_sse2:
.byte 68,15,40,192 // movaps %xmm0,%xmm8
- .byte 68,15,40,21,185,92,0,0 // movaps 0x5cb9(%rip),%xmm10 # 6420 <_sk_callback_sse2+0x24c>
+ .byte 68,15,40,21,105,91,0,0 // movaps 0x5b69(%rip),%xmm10 # 62d0 <_sk_callback_sse2+0x241>
.byte 69,15,40,202 // movaps %xmm10,%xmm9
.byte 68,15,92,207 // subps %xmm7,%xmm9
.byte 69,15,40,217 // movaps %xmm9,%xmm11
@@ -35652,7 +35217,7 @@ HIDDEN _sk_colordodge_sse2
FUNCTION(_sk_colordodge_sse2)
_sk_colordodge_sse2:
.byte 68,15,40,200 // movaps %xmm0,%xmm9
- .byte 68,15,40,21,111,91,0,0 // movaps 0x5b6f(%rip),%xmm10 # 6430 <_sk_callback_sse2+0x25c>
+ .byte 68,15,40,21,31,90,0,0 // movaps 0x5a1f(%rip),%xmm10 # 62e0 <_sk_callback_sse2+0x251>
.byte 69,15,40,218 // movaps %xmm10,%xmm11
.byte 68,15,92,223 // subps %xmm7,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
@@ -35746,7 +35311,7 @@ _sk_hardlight_sse2:
.byte 15,41,116,36,232 // movaps %xmm6,-0x18(%rsp)
.byte 15,40,245 // movaps %xmm5,%xmm6
.byte 15,40,236 // movaps %xmm4,%xmm5
- .byte 68,15,40,29,36,90,0,0 // movaps 0x5a24(%rip),%xmm11 # 6440 <_sk_callback_sse2+0x26c>
+ .byte 68,15,40,29,212,88,0,0 // movaps 0x58d4(%rip),%xmm11 # 62f0 <_sk_callback_sse2+0x261>
.byte 69,15,40,211 // movaps %xmm11,%xmm10
.byte 68,15,92,215 // subps %xmm7,%xmm10
.byte 69,15,40,194 // movaps %xmm10,%xmm8
@@ -35834,7 +35399,7 @@ FUNCTION(_sk_overlay_sse2)
_sk_overlay_sse2:
.byte 68,15,40,193 // movaps %xmm1,%xmm8
.byte 68,15,40,232 // movaps %xmm0,%xmm13
- .byte 68,15,40,13,242,88,0,0 // movaps 0x58f2(%rip),%xmm9 # 6450 <_sk_callback_sse2+0x27c>
+ .byte 68,15,40,13,162,87,0,0 // movaps 0x57a2(%rip),%xmm9 # 6300 <_sk_callback_sse2+0x271>
.byte 69,15,40,209 // movaps %xmm9,%xmm10
.byte 68,15,92,215 // subps %xmm7,%xmm10
.byte 69,15,40,218 // movaps %xmm10,%xmm11
@@ -35925,7 +35490,7 @@ _sk_softlight_sse2:
.byte 68,15,40,213 // movaps %xmm5,%xmm10
.byte 68,15,94,215 // divps %xmm7,%xmm10
.byte 69,15,84,212 // andps %xmm12,%xmm10
- .byte 68,15,40,13,175,87,0,0 // movaps 0x57af(%rip),%xmm9 # 6460 <_sk_callback_sse2+0x28c>
+ .byte 68,15,40,13,95,86,0,0 // movaps 0x565f(%rip),%xmm9 # 6310 <_sk_callback_sse2+0x281>
.byte 69,15,40,249 // movaps %xmm9,%xmm15
.byte 69,15,92,250 // subps %xmm10,%xmm15
.byte 69,15,40,218 // movaps %xmm10,%xmm11
@@ -35938,10 +35503,10 @@ _sk_softlight_sse2:
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 65,15,88,194 // addps %xmm10,%xmm0
- .byte 68,15,40,53,137,87,0,0 // movaps 0x5789(%rip),%xmm14 # 6470 <_sk_callback_sse2+0x29c>
+ .byte 68,15,40,53,57,86,0,0 // movaps 0x5639(%rip),%xmm14 # 6320 <_sk_callback_sse2+0x291>
.byte 69,15,88,222 // addps %xmm14,%xmm11
.byte 68,15,89,216 // mulps %xmm0,%xmm11
- .byte 68,15,40,21,137,87,0,0 // movaps 0x5789(%rip),%xmm10 # 6480 <_sk_callback_sse2+0x2ac>
+ .byte 68,15,40,21,57,86,0,0 // movaps 0x5639(%rip),%xmm10 # 6330 <_sk_callback_sse2+0x2a1>
.byte 69,15,89,234 // mulps %xmm10,%xmm13
.byte 69,15,88,235 // addps %xmm11,%xmm13
.byte 15,88,228 // addps %xmm4,%xmm4
@@ -36086,7 +35651,7 @@ _sk_hue_sse2:
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 68,15,89,211 // mulps %xmm3,%xmm10
- .byte 68,15,40,5,204,85,0,0 // movaps 0x55cc(%rip),%xmm8 # 64c0 <_sk_callback_sse2+0x2ec>
+ .byte 68,15,40,5,124,84,0,0 // movaps 0x547c(%rip),%xmm8 # 6370 <_sk_callback_sse2+0x2e1>
.byte 69,15,40,216 // movaps %xmm8,%xmm11
.byte 15,40,207 // movaps %xmm7,%xmm1
.byte 68,15,92,217 // subps %xmm1,%xmm11
@@ -36134,12 +35699,12 @@ _sk_hue_sse2:
.byte 69,15,84,206 // andps %xmm14,%xmm9
.byte 69,15,84,214 // andps %xmm14,%xmm10
.byte 65,15,84,214 // andps %xmm14,%xmm2
- .byte 68,15,40,61,217,84,0,0 // movaps 0x54d9(%rip),%xmm15 # 6490 <_sk_callback_sse2+0x2bc>
+ .byte 68,15,40,61,137,83,0,0 // movaps 0x5389(%rip),%xmm15 # 6340 <_sk_callback_sse2+0x2b1>
.byte 65,15,89,231 // mulps %xmm15,%xmm4
- .byte 15,40,5,222,84,0,0 // movaps 0x54de(%rip),%xmm0 # 64a0 <_sk_callback_sse2+0x2cc>
+ .byte 15,40,5,142,83,0,0 // movaps 0x538e(%rip),%xmm0 # 6350 <_sk_callback_sse2+0x2c1>
.byte 15,89,240 // mulps %xmm0,%xmm6
.byte 15,88,244 // addps %xmm4,%xmm6
- .byte 68,15,40,53,224,84,0,0 // movaps 0x54e0(%rip),%xmm14 # 64b0 <_sk_callback_sse2+0x2dc>
+ .byte 68,15,40,53,144,83,0,0 // movaps 0x5390(%rip),%xmm14 # 6360 <_sk_callback_sse2+0x2d1>
.byte 68,15,40,239 // movaps %xmm7,%xmm13
.byte 69,15,89,238 // mulps %xmm14,%xmm13
.byte 68,15,88,238 // addps %xmm6,%xmm13
@@ -36317,14 +35882,14 @@ _sk_saturation_sse2:
.byte 68,15,84,211 // andps %xmm3,%xmm10
.byte 68,15,84,203 // andps %xmm3,%xmm9
.byte 15,84,195 // andps %xmm3,%xmm0
- .byte 68,15,40,5,114,82,0,0 // movaps 0x5272(%rip),%xmm8 # 64d0 <_sk_callback_sse2+0x2fc>
+ .byte 68,15,40,5,34,81,0,0 // movaps 0x5122(%rip),%xmm8 # 6380 <_sk_callback_sse2+0x2f1>
.byte 15,40,214 // movaps %xmm6,%xmm2
.byte 65,15,89,208 // mulps %xmm8,%xmm2
- .byte 15,40,13,116,82,0,0 // movaps 0x5274(%rip),%xmm1 # 64e0 <_sk_callback_sse2+0x30c>
+ .byte 15,40,13,36,81,0,0 // movaps 0x5124(%rip),%xmm1 # 6390 <_sk_callback_sse2+0x301>
.byte 15,40,221 // movaps %xmm5,%xmm3
.byte 15,89,217 // mulps %xmm1,%xmm3
.byte 15,88,218 // addps %xmm2,%xmm3
- .byte 68,15,40,37,115,82,0,0 // movaps 0x5273(%rip),%xmm12 # 64f0 <_sk_callback_sse2+0x31c>
+ .byte 68,15,40,37,35,81,0,0 // movaps 0x5123(%rip),%xmm12 # 63a0 <_sk_callback_sse2+0x311>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
.byte 68,15,88,235 // addps %xmm3,%xmm13
.byte 65,15,40,210 // movaps %xmm10,%xmm2
@@ -36369,7 +35934,7 @@ _sk_saturation_sse2:
.byte 15,40,223 // movaps %xmm7,%xmm3
.byte 15,40,236 // movaps %xmm4,%xmm5
.byte 15,89,221 // mulps %xmm5,%xmm3
- .byte 68,15,40,5,216,81,0,0 // movaps 0x51d8(%rip),%xmm8 # 6500 <_sk_callback_sse2+0x32c>
+ .byte 68,15,40,5,136,80,0,0 // movaps 0x5088(%rip),%xmm8 # 63b0 <_sk_callback_sse2+0x321>
.byte 65,15,40,224 // movaps %xmm8,%xmm4
.byte 68,15,92,199 // subps %xmm7,%xmm8
.byte 15,88,253 // addps %xmm5,%xmm7
@@ -36470,14 +36035,14 @@ _sk_color_sse2:
.byte 68,15,40,213 // movaps %xmm5,%xmm10
.byte 69,15,89,208 // mulps %xmm8,%xmm10
.byte 65,15,40,208 // movaps %xmm8,%xmm2
- .byte 68,15,40,45,118,80,0,0 // movaps 0x5076(%rip),%xmm13 # 6510 <_sk_callback_sse2+0x33c>
+ .byte 68,15,40,45,38,79,0,0 // movaps 0x4f26(%rip),%xmm13 # 63c0 <_sk_callback_sse2+0x331>
.byte 68,15,40,198 // movaps %xmm6,%xmm8
.byte 69,15,89,197 // mulps %xmm13,%xmm8
- .byte 68,15,40,53,118,80,0,0 // movaps 0x5076(%rip),%xmm14 # 6520 <_sk_callback_sse2+0x34c>
+ .byte 68,15,40,53,38,79,0,0 // movaps 0x4f26(%rip),%xmm14 # 63d0 <_sk_callback_sse2+0x341>
.byte 65,15,40,195 // movaps %xmm11,%xmm0
.byte 65,15,89,198 // mulps %xmm14,%xmm0
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,29,114,80,0,0 // movaps 0x5072(%rip),%xmm11 # 6530 <_sk_callback_sse2+0x35c>
+ .byte 68,15,40,29,34,79,0,0 // movaps 0x4f22(%rip),%xmm11 # 63e0 <_sk_callback_sse2+0x351>
.byte 69,15,89,227 // mulps %xmm11,%xmm12
.byte 68,15,88,224 // addps %xmm0,%xmm12
.byte 65,15,40,193 // movaps %xmm9,%xmm0
@@ -36485,7 +36050,7 @@ _sk_color_sse2:
.byte 69,15,40,250 // movaps %xmm10,%xmm15
.byte 69,15,89,254 // mulps %xmm14,%xmm15
.byte 68,15,88,248 // addps %xmm0,%xmm15
- .byte 68,15,40,5,94,80,0,0 // movaps 0x505e(%rip),%xmm8 # 6540 <_sk_callback_sse2+0x36c>
+ .byte 68,15,40,5,14,79,0,0 // movaps 0x4f0e(%rip),%xmm8 # 63f0 <_sk_callback_sse2+0x361>
.byte 65,15,40,224 // movaps %xmm8,%xmm4
.byte 15,92,226 // subps %xmm2,%xmm4
.byte 15,89,252 // mulps %xmm4,%xmm7
@@ -36621,15 +36186,15 @@ _sk_luminosity_sse2:
.byte 68,15,40,205 // movaps %xmm5,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
.byte 15,89,222 // mulps %xmm6,%xmm3
- .byte 68,15,40,37,117,78,0,0 // movaps 0x4e75(%rip),%xmm12 # 6550 <_sk_callback_sse2+0x37c>
+ .byte 68,15,40,37,37,77,0,0 // movaps 0x4d25(%rip),%xmm12 # 6400 <_sk_callback_sse2+0x371>
.byte 68,15,40,199 // movaps %xmm7,%xmm8
.byte 69,15,89,196 // mulps %xmm12,%xmm8
- .byte 68,15,40,45,117,78,0,0 // movaps 0x4e75(%rip),%xmm13 # 6560 <_sk_callback_sse2+0x38c>
+ .byte 68,15,40,45,37,77,0,0 // movaps 0x4d25(%rip),%xmm13 # 6410 <_sk_callback_sse2+0x381>
.byte 68,15,40,241 // movaps %xmm1,%xmm14
.byte 69,15,89,245 // mulps %xmm13,%xmm14
.byte 69,15,88,240 // addps %xmm8,%xmm14
- .byte 68,15,40,29,113,78,0,0 // movaps 0x4e71(%rip),%xmm11 # 6570 <_sk_callback_sse2+0x39c>
- .byte 68,15,40,5,121,78,0,0 // movaps 0x4e79(%rip),%xmm8 # 6580 <_sk_callback_sse2+0x3ac>
+ .byte 68,15,40,29,33,77,0,0 // movaps 0x4d21(%rip),%xmm11 # 6420 <_sk_callback_sse2+0x391>
+ .byte 68,15,40,5,41,77,0,0 // movaps 0x4d29(%rip),%xmm8 # 6430 <_sk_callback_sse2+0x3a1>
.byte 69,15,40,248 // movaps %xmm8,%xmm15
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 68,15,92,248 // subps %xmm0,%xmm15
@@ -36768,7 +36333,7 @@ _sk_srcover_rgba_8888_sse2:
.byte 15,133,227,0,0,0 // jne 19df <_sk_srcover_rgba_8888_sse2+0xf1>
.byte 243,68,15,111,4,144 // movdqu (%rax,%rdx,4),%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 102,15,111,53,131,76,0,0 // movdqa 0x4c83(%rip),%xmm6 # 6590 <_sk_callback_sse2+0x3bc>
+ .byte 102,15,111,53,51,75,0,0 // movdqa 0x4b33(%rip),%xmm6 # 6440 <_sk_callback_sse2+0x3b1>
.byte 102,65,15,111,224 // movdqa %xmm8,%xmm4
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
@@ -36782,9 +36347,9 @@ _sk_srcover_rgba_8888_sse2:
.byte 15,91,247 // cvtdq2ps %xmm7,%xmm6
.byte 102,65,15,114,208,24 // psrld $0x18,%xmm8
.byte 65,15,91,248 // cvtdq2ps %xmm8,%xmm7
- .byte 68,15,40,5,83,76,0,0 // movaps 0x4c53(%rip),%xmm8 # 65a0 <_sk_callback_sse2+0x3cc>
+ .byte 68,15,40,5,3,75,0,0 // movaps 0x4b03(%rip),%xmm8 # 6450 <_sk_callback_sse2+0x3c1>
.byte 68,15,92,195 // subps %xmm3,%xmm8
- .byte 68,15,40,37,87,76,0,0 // movaps 0x4c57(%rip),%xmm12 # 65b0 <_sk_callback_sse2+0x3dc>
+ .byte 68,15,40,37,7,75,0,0 // movaps 0x4b07(%rip),%xmm12 # 6460 <_sk_callback_sse2+0x3d1>
.byte 65,15,89,196 // mulps %xmm12,%xmm0
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 68,15,89,204 // mulps %xmm4,%xmm9
@@ -36864,7 +36429,7 @@ HIDDEN _sk_clamp_1_sse2
.globl _sk_clamp_1_sse2
FUNCTION(_sk_clamp_1_sse2)
_sk_clamp_1_sse2:
- .byte 68,15,40,5,72,75,0,0 // movaps 0x4b48(%rip),%xmm8 # 65c0 <_sk_callback_sse2+0x3ec>
+ .byte 68,15,40,5,248,73,0,0 // movaps 0x49f8(%rip),%xmm8 # 6470 <_sk_callback_sse2+0x3e1>
.byte 65,15,93,192 // minps %xmm8,%xmm0
.byte 65,15,93,200 // minps %xmm8,%xmm1
.byte 65,15,93,208 // minps %xmm8,%xmm2
@@ -36876,7 +36441,7 @@ HIDDEN _sk_clamp_a_sse2
.globl _sk_clamp_a_sse2
FUNCTION(_sk_clamp_a_sse2)
_sk_clamp_a_sse2:
- .byte 15,93,29,61,75,0,0 // minps 0x4b3d(%rip),%xmm3 # 65d0 <_sk_callback_sse2+0x3fc>
+ .byte 15,93,29,237,73,0,0 // minps 0x49ed(%rip),%xmm3 # 6480 <_sk_callback_sse2+0x3f1>
.byte 15,93,195 // minps %xmm3,%xmm0
.byte 15,93,203 // minps %xmm3,%xmm1
.byte 15,93,211 // minps %xmm3,%xmm2
@@ -36887,7 +36452,7 @@ HIDDEN _sk_clamp_a_dst_sse2
.globl _sk_clamp_a_dst_sse2
FUNCTION(_sk_clamp_a_dst_sse2)
_sk_clamp_a_dst_sse2:
- .byte 15,93,61,57,75,0,0 // minps 0x4b39(%rip),%xmm7 # 65e0 <_sk_callback_sse2+0x40c>
+ .byte 15,93,61,233,73,0,0 // minps 0x49e9(%rip),%xmm7 # 6490 <_sk_callback_sse2+0x401>
.byte 15,93,231 // minps %xmm7,%xmm4
.byte 15,93,239 // minps %xmm7,%xmm5
.byte 15,93,247 // minps %xmm7,%xmm6
@@ -36955,7 +36520,7 @@ HIDDEN _sk_unpremul_sse2
FUNCTION(_sk_unpremul_sse2)
_sk_unpremul_sse2:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
- .byte 68,15,40,13,212,74,0,0 // movaps 0x4ad4(%rip),%xmm9 # 65f0 <_sk_callback_sse2+0x41c>
+ .byte 68,15,40,13,132,73,0,0 // movaps 0x4984(%rip),%xmm9 # 64a0 <_sk_callback_sse2+0x411>
.byte 68,15,94,203 // divps %xmm3,%xmm9
.byte 68,15,194,195,4 // cmpneqps %xmm3,%xmm8
.byte 69,15,84,193 // andps %xmm9,%xmm8
@@ -36969,20 +36534,20 @@ HIDDEN _sk_from_srgb_sse2
.globl _sk_from_srgb_sse2
FUNCTION(_sk_from_srgb_sse2)
_sk_from_srgb_sse2:
- .byte 68,15,40,5,191,74,0,0 // movaps 0x4abf(%rip),%xmm8 # 6600 <_sk_callback_sse2+0x42c>
+ .byte 68,15,40,5,111,73,0,0 // movaps 0x496f(%rip),%xmm8 # 64b0 <_sk_callback_sse2+0x421>
.byte 68,15,40,232 // movaps %xmm0,%xmm13
.byte 69,15,89,232 // mulps %xmm8,%xmm13
.byte 68,15,40,216 // movaps %xmm0,%xmm11
.byte 69,15,89,219 // mulps %xmm11,%xmm11
- .byte 68,15,40,13,183,74,0,0 // movaps 0x4ab7(%rip),%xmm9 # 6610 <_sk_callback_sse2+0x43c>
+ .byte 68,15,40,13,103,73,0,0 // movaps 0x4967(%rip),%xmm9 # 64c0 <_sk_callback_sse2+0x431>
.byte 68,15,40,240 // movaps %xmm0,%xmm14
.byte 69,15,89,241 // mulps %xmm9,%xmm14
- .byte 68,15,40,21,183,74,0,0 // movaps 0x4ab7(%rip),%xmm10 # 6620 <_sk_callback_sse2+0x44c>
+ .byte 68,15,40,21,103,73,0,0 // movaps 0x4967(%rip),%xmm10 # 64d0 <_sk_callback_sse2+0x441>
.byte 69,15,88,242 // addps %xmm10,%xmm14
.byte 69,15,89,243 // mulps %xmm11,%xmm14
- .byte 68,15,40,29,183,74,0,0 // movaps 0x4ab7(%rip),%xmm11 # 6630 <_sk_callback_sse2+0x45c>
+ .byte 68,15,40,29,103,73,0,0 // movaps 0x4967(%rip),%xmm11 # 64e0 <_sk_callback_sse2+0x451>
.byte 69,15,88,243 // addps %xmm11,%xmm14
- .byte 68,15,40,37,187,74,0,0 // movaps 0x4abb(%rip),%xmm12 # 6640 <_sk_callback_sse2+0x46c>
+ .byte 68,15,40,37,107,73,0,0 // movaps 0x496b(%rip),%xmm12 # 64f0 <_sk_callback_sse2+0x461>
.byte 65,15,194,196,1 // cmpltps %xmm12,%xmm0
.byte 68,15,84,232 // andps %xmm0,%xmm13
.byte 65,15,85,198 // andnps %xmm14,%xmm0
@@ -37018,20 +36583,20 @@ HIDDEN _sk_from_srgb_dst_sse2
.globl _sk_from_srgb_dst_sse2
FUNCTION(_sk_from_srgb_dst_sse2)
_sk_from_srgb_dst_sse2:
- .byte 68,15,40,5,76,74,0,0 // movaps 0x4a4c(%rip),%xmm8 # 6650 <_sk_callback_sse2+0x47c>
+ .byte 68,15,40,5,252,72,0,0 // movaps 0x48fc(%rip),%xmm8 # 6500 <_sk_callback_sse2+0x471>
.byte 68,15,40,236 // movaps %xmm4,%xmm13
.byte 69,15,89,232 // mulps %xmm8,%xmm13
.byte 68,15,40,220 // movaps %xmm4,%xmm11
.byte 69,15,89,219 // mulps %xmm11,%xmm11
- .byte 68,15,40,13,68,74,0,0 // movaps 0x4a44(%rip),%xmm9 # 6660 <_sk_callback_sse2+0x48c>
+ .byte 68,15,40,13,244,72,0,0 // movaps 0x48f4(%rip),%xmm9 # 6510 <_sk_callback_sse2+0x481>
.byte 68,15,40,244 // movaps %xmm4,%xmm14
.byte 69,15,89,241 // mulps %xmm9,%xmm14
- .byte 68,15,40,21,68,74,0,0 // movaps 0x4a44(%rip),%xmm10 # 6670 <_sk_callback_sse2+0x49c>
+ .byte 68,15,40,21,244,72,0,0 // movaps 0x48f4(%rip),%xmm10 # 6520 <_sk_callback_sse2+0x491>
.byte 69,15,88,242 // addps %xmm10,%xmm14
.byte 69,15,89,243 // mulps %xmm11,%xmm14
- .byte 68,15,40,29,68,74,0,0 // movaps 0x4a44(%rip),%xmm11 # 6680 <_sk_callback_sse2+0x4ac>
+ .byte 68,15,40,29,244,72,0,0 // movaps 0x48f4(%rip),%xmm11 # 6530 <_sk_callback_sse2+0x4a1>
.byte 69,15,88,243 // addps %xmm11,%xmm14
- .byte 68,15,40,37,72,74,0,0 // movaps 0x4a48(%rip),%xmm12 # 6690 <_sk_callback_sse2+0x4bc>
+ .byte 68,15,40,37,248,72,0,0 // movaps 0x48f8(%rip),%xmm12 # 6540 <_sk_callback_sse2+0x4b1>
.byte 65,15,194,228,1 // cmpltps %xmm12,%xmm4
.byte 68,15,84,236 // andps %xmm4,%xmm13
.byte 65,15,85,230 // andnps %xmm14,%xmm4
@@ -37068,22 +36633,22 @@ HIDDEN _sk_to_srgb_sse2
FUNCTION(_sk_to_srgb_sse2)
_sk_to_srgb_sse2:
.byte 68,15,82,232 // rsqrtps %xmm0,%xmm13
- .byte 68,15,40,5,213,73,0,0 // movaps 0x49d5(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x4cc>
+ .byte 68,15,40,5,133,72,0,0 // movaps 0x4885(%rip),%xmm8 # 6550 <_sk_callback_sse2+0x4c1>
.byte 68,15,40,240 // movaps %xmm0,%xmm14
.byte 69,15,89,240 // mulps %xmm8,%xmm14
- .byte 68,15,40,13,213,73,0,0 // movaps 0x49d5(%rip),%xmm9 # 66b0 <_sk_callback_sse2+0x4dc>
+ .byte 68,15,40,13,133,72,0,0 // movaps 0x4885(%rip),%xmm9 # 6560 <_sk_callback_sse2+0x4d1>
.byte 69,15,40,253 // movaps %xmm13,%xmm15
.byte 69,15,89,249 // mulps %xmm9,%xmm15
- .byte 68,15,40,21,213,73,0,0 // movaps 0x49d5(%rip),%xmm10 # 66c0 <_sk_callback_sse2+0x4ec>
+ .byte 68,15,40,21,133,72,0,0 // movaps 0x4885(%rip),%xmm10 # 6570 <_sk_callback_sse2+0x4e1>
.byte 69,15,88,250 // addps %xmm10,%xmm15
.byte 69,15,89,253 // mulps %xmm13,%xmm15
- .byte 68,15,40,29,213,73,0,0 // movaps 0x49d5(%rip),%xmm11 # 66d0 <_sk_callback_sse2+0x4fc>
+ .byte 68,15,40,29,133,72,0,0 // movaps 0x4885(%rip),%xmm11 # 6580 <_sk_callback_sse2+0x4f1>
.byte 69,15,88,251 // addps %xmm11,%xmm15
- .byte 68,15,40,37,217,73,0,0 // movaps 0x49d9(%rip),%xmm12 # 66e0 <_sk_callback_sse2+0x50c>
+ .byte 68,15,40,37,137,72,0,0 // movaps 0x4889(%rip),%xmm12 # 6590 <_sk_callback_sse2+0x501>
.byte 69,15,88,236 // addps %xmm12,%xmm13
.byte 69,15,83,237 // rcpps %xmm13,%xmm13
.byte 69,15,89,239 // mulps %xmm15,%xmm13
- .byte 68,15,40,61,213,73,0,0 // movaps 0x49d5(%rip),%xmm15 # 66f0 <_sk_callback_sse2+0x51c>
+ .byte 68,15,40,61,133,72,0,0 // movaps 0x4885(%rip),%xmm15 # 65a0 <_sk_callback_sse2+0x511>
.byte 65,15,194,199,1 // cmpltps %xmm15,%xmm0
.byte 68,15,84,240 // andps %xmm0,%xmm14
.byte 65,15,85,197 // andnps %xmm13,%xmm0
@@ -37133,7 +36698,7 @@ _sk_rgb_to_hsl_sse2:
.byte 68,15,93,218 // minps %xmm2,%xmm11
.byte 65,15,40,202 // movaps %xmm10,%xmm1
.byte 65,15,92,203 // subps %xmm11,%xmm1
- .byte 68,15,40,45,46,73,0,0 // movaps 0x492e(%rip),%xmm13 # 6700 <_sk_callback_sse2+0x52c>
+ .byte 68,15,40,45,222,71,0,0 // movaps 0x47de(%rip),%xmm13 # 65b0 <_sk_callback_sse2+0x521>
.byte 68,15,94,233 // divps %xmm1,%xmm13
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,194,192,0 // cmpeqps %xmm8,%xmm0
@@ -37142,30 +36707,30 @@ _sk_rgb_to_hsl_sse2:
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,40,241 // movaps %xmm9,%xmm14
.byte 68,15,194,242,1 // cmpltps %xmm2,%xmm14
- .byte 68,15,84,53,20,73,0,0 // andps 0x4914(%rip),%xmm14 # 6710 <_sk_callback_sse2+0x53c>
+ .byte 68,15,84,53,196,71,0,0 // andps 0x47c4(%rip),%xmm14 # 65c0 <_sk_callback_sse2+0x531>
.byte 69,15,88,244 // addps %xmm12,%xmm14
.byte 69,15,40,250 // movaps %xmm10,%xmm15
.byte 69,15,194,249,0 // cmpeqps %xmm9,%xmm15
.byte 65,15,92,208 // subps %xmm8,%xmm2
.byte 65,15,89,213 // mulps %xmm13,%xmm2
- .byte 68,15,40,37,7,73,0,0 // movaps 0x4907(%rip),%xmm12 # 6720 <_sk_callback_sse2+0x54c>
+ .byte 68,15,40,37,183,71,0,0 // movaps 0x47b7(%rip),%xmm12 # 65d0 <_sk_callback_sse2+0x541>
.byte 65,15,88,212 // addps %xmm12,%xmm2
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 69,15,89,197 // mulps %xmm13,%xmm8
- .byte 68,15,88,5,3,73,0,0 // addps 0x4903(%rip),%xmm8 # 6730 <_sk_callback_sse2+0x55c>
+ .byte 68,15,88,5,179,71,0,0 // addps 0x47b3(%rip),%xmm8 # 65e0 <_sk_callback_sse2+0x551>
.byte 65,15,84,215 // andps %xmm15,%xmm2
.byte 69,15,85,248 // andnps %xmm8,%xmm15
.byte 68,15,86,250 // orps %xmm2,%xmm15
.byte 68,15,84,240 // andps %xmm0,%xmm14
.byte 65,15,85,199 // andnps %xmm15,%xmm0
.byte 65,15,86,198 // orps %xmm14,%xmm0
- .byte 15,89,5,244,72,0,0 // mulps 0x48f4(%rip),%xmm0 # 6740 <_sk_callback_sse2+0x56c>
+ .byte 15,89,5,164,71,0,0 // mulps 0x47a4(%rip),%xmm0 # 65f0 <_sk_callback_sse2+0x561>
.byte 69,15,40,194 // movaps %xmm10,%xmm8
.byte 69,15,194,195,4 // cmpneqps %xmm11,%xmm8
.byte 65,15,84,192 // andps %xmm8,%xmm0
.byte 69,15,92,226 // subps %xmm10,%xmm12
.byte 69,15,88,211 // addps %xmm11,%xmm10
- .byte 68,15,40,13,231,72,0,0 // movaps 0x48e7(%rip),%xmm9 # 6750 <_sk_callback_sse2+0x57c>
+ .byte 68,15,40,13,151,71,0,0 // movaps 0x4797(%rip),%xmm9 # 6600 <_sk_callback_sse2+0x571>
.byte 65,15,40,210 // movaps %xmm10,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 68,15,194,202,1 // cmpltps %xmm2,%xmm9
@@ -37189,7 +36754,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,41,92,36,168 // movaps %xmm3,-0x58(%rsp)
.byte 68,15,40,218 // movaps %xmm2,%xmm11
.byte 15,40,240 // movaps %xmm0,%xmm6
- .byte 68,15,40,13,166,72,0,0 // movaps 0x48a6(%rip),%xmm9 # 6760 <_sk_callback_sse2+0x58c>
+ .byte 68,15,40,13,86,71,0,0 // movaps 0x4756(%rip),%xmm9 # 6610 <_sk_callback_sse2+0x581>
.byte 69,15,40,209 // movaps %xmm9,%xmm10
.byte 69,15,194,211,2 // cmpleps %xmm11,%xmm10
.byte 15,40,193 // movaps %xmm1,%xmm0
@@ -37206,28 +36771,28 @@ _sk_hsl_to_rgb_sse2:
.byte 69,15,88,211 // addps %xmm11,%xmm10
.byte 69,15,88,219 // addps %xmm11,%xmm11
.byte 69,15,92,218 // subps %xmm10,%xmm11
- .byte 15,40,5,111,72,0,0 // movaps 0x486f(%rip),%xmm0 # 6770 <_sk_callback_sse2+0x59c>
+ .byte 15,40,5,31,71,0,0 // movaps 0x471f(%rip),%xmm0 # 6620 <_sk_callback_sse2+0x591>
.byte 15,88,198 // addps %xmm6,%xmm0
.byte 243,15,91,200 // cvttps2dq %xmm0,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
.byte 15,40,216 // movaps %xmm0,%xmm3
.byte 15,194,217,1 // cmpltps %xmm1,%xmm3
- .byte 15,84,29,103,72,0,0 // andps 0x4867(%rip),%xmm3 # 6780 <_sk_callback_sse2+0x5ac>
+ .byte 15,84,29,23,71,0,0 // andps 0x4717(%rip),%xmm3 # 6630 <_sk_callback_sse2+0x5a1>
.byte 15,92,203 // subps %xmm3,%xmm1
.byte 15,92,193 // subps %xmm1,%xmm0
- .byte 68,15,40,45,105,72,0,0 // movaps 0x4869(%rip),%xmm13 # 6790 <_sk_callback_sse2+0x5bc>
+ .byte 68,15,40,45,25,71,0,0 // movaps 0x4719(%rip),%xmm13 # 6640 <_sk_callback_sse2+0x5b1>
.byte 69,15,40,197 // movaps %xmm13,%xmm8
.byte 68,15,194,192,2 // cmpleps %xmm0,%xmm8
.byte 69,15,40,242 // movaps %xmm10,%xmm14
.byte 69,15,92,243 // subps %xmm11,%xmm14
.byte 65,15,40,217 // movaps %xmm9,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
- .byte 15,40,21,121,72,0,0 // movaps 0x4879(%rip),%xmm2 # 67c0 <_sk_callback_sse2+0x5ec>
+ .byte 15,40,21,41,71,0,0 // movaps 0x4729(%rip),%xmm2 # 6670 <_sk_callback_sse2+0x5e1>
.byte 68,15,40,250 // movaps %xmm2,%xmm15
.byte 68,15,194,248,2 // cmpleps %xmm0,%xmm15
- .byte 15,40,13,73,72,0,0 // movaps 0x4849(%rip),%xmm1 # 67a0 <_sk_callback_sse2+0x5cc>
+ .byte 15,40,13,249,70,0,0 // movaps 0x46f9(%rip),%xmm1 # 6650 <_sk_callback_sse2+0x5c1>
.byte 15,89,193 // mulps %xmm1,%xmm0
- .byte 15,40,45,79,72,0,0 // movaps 0x484f(%rip),%xmm5 # 67b0 <_sk_callback_sse2+0x5dc>
+ .byte 15,40,45,255,70,0,0 // movaps 0x46ff(%rip),%xmm5 # 6660 <_sk_callback_sse2+0x5d1>
.byte 15,40,229 // movaps %xmm5,%xmm4
.byte 15,92,224 // subps %xmm0,%xmm4
.byte 65,15,89,230 // mulps %xmm14,%xmm4
@@ -37250,7 +36815,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,222 // movaps %xmm6,%xmm3
.byte 15,194,216,1 // cmpltps %xmm0,%xmm3
- .byte 15,84,29,196,71,0,0 // andps 0x47c4(%rip),%xmm3 # 6780 <_sk_callback_sse2+0x5ac>
+ .byte 15,84,29,116,70,0,0 // andps 0x4674(%rip),%xmm3 # 6630 <_sk_callback_sse2+0x5a1>
.byte 15,92,195 // subps %xmm3,%xmm0
.byte 68,15,40,230 // movaps %xmm6,%xmm12
.byte 68,15,92,224 // subps %xmm0,%xmm12
@@ -37280,12 +36845,12 @@ _sk_hsl_to_rgb_sse2:
.byte 15,40,124,36,136 // movaps -0x78(%rsp),%xmm7
.byte 15,40,231 // movaps %xmm7,%xmm4
.byte 15,85,227 // andnps %xmm3,%xmm4
- .byte 15,88,53,156,71,0,0 // addps 0x479c(%rip),%xmm6 # 67d0 <_sk_callback_sse2+0x5fc>
+ .byte 15,88,53,76,70,0,0 // addps 0x464c(%rip),%xmm6 # 6680 <_sk_callback_sse2+0x5f1>
.byte 243,15,91,198 // cvttps2dq %xmm6,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,222 // movaps %xmm6,%xmm3
.byte 15,194,216,1 // cmpltps %xmm0,%xmm3
- .byte 15,84,29,55,71,0,0 // andps 0x4737(%rip),%xmm3 # 6780 <_sk_callback_sse2+0x5ac>
+ .byte 15,84,29,231,69,0,0 // andps 0x45e7(%rip),%xmm3 # 6630 <_sk_callback_sse2+0x5a1>
.byte 15,92,195 // subps %xmm3,%xmm0
.byte 15,92,240 // subps %xmm0,%xmm6
.byte 15,89,206 // mulps %xmm6,%xmm1
@@ -37349,9 +36914,9 @@ _sk_scale_u8_sse2:
.byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8
.byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 102,68,15,219,5,200,70,0,0 // pand 0x46c8(%rip),%xmm8 # 67e0 <_sk_callback_sse2+0x60c>
+ .byte 102,68,15,219,5,120,69,0,0 // pand 0x4578(%rip),%xmm8 # 6690 <_sk_callback_sse2+0x601>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,204,70,0,0 // mulps 0x46cc(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x61c>
+ .byte 68,15,89,5,124,69,0,0 // mulps 0x457c(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x611>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
@@ -37414,9 +36979,9 @@ _sk_lerp_u8_sse2:
.byte 102,69,15,110,4,18 // movd (%r10,%rdx,1),%xmm8
.byte 102,68,15,96,192 // punpcklbw %xmm0,%xmm8
.byte 102,68,15,97,192 // punpcklwd %xmm0,%xmm8
- .byte 102,68,15,219,5,16,70,0,0 // pand 0x4610(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x62c>
+ .byte 102,68,15,219,5,192,68,0,0 // pand 0x44c0(%rip),%xmm8 # 66b0 <_sk_callback_sse2+0x621>
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,20,70,0,0 // mulps 0x4614(%rip),%xmm8 # 6810 <_sk_callback_sse2+0x63c>
+ .byte 68,15,89,5,196,68,0,0 // mulps 0x44c4(%rip),%xmm8 # 66c0 <_sk_callback_sse2+0x631>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -37463,17 +37028,17 @@ _sk_lerp_565_sse2:
.byte 15,133,156,0,0,0 // jne 232e <_sk_lerp_565_sse2+0xaa>
.byte 243,69,15,126,12,82 // movq (%r10,%rdx,2),%xmm9
.byte 102,68,15,97,200 // punpcklwd %xmm0,%xmm9
- .byte 102,68,15,111,5,122,69,0,0 // movdqa 0x457a(%rip),%xmm8 # 6820 <_sk_callback_sse2+0x64c>
+ .byte 102,68,15,111,5,42,68,0,0 // movdqa 0x442a(%rip),%xmm8 # 66d0 <_sk_callback_sse2+0x641>
.byte 102,69,15,219,193 // pand %xmm9,%xmm8
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
- .byte 68,15,89,5,121,69,0,0 // mulps 0x4579(%rip),%xmm8 # 6830 <_sk_callback_sse2+0x65c>
- .byte 102,68,15,111,21,128,69,0,0 // movdqa 0x4580(%rip),%xmm10 # 6840 <_sk_callback_sse2+0x66c>
+ .byte 68,15,89,5,41,68,0,0 // mulps 0x4429(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x651>
+ .byte 102,68,15,111,21,48,68,0,0 // movdqa 0x4430(%rip),%xmm10 # 66f0 <_sk_callback_sse2+0x661>
.byte 102,69,15,219,209 // pand %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
- .byte 68,15,89,21,127,69,0,0 // mulps 0x457f(%rip),%xmm10 # 6850 <_sk_callback_sse2+0x67c>
- .byte 102,68,15,219,13,134,69,0,0 // pand 0x4586(%rip),%xmm9 # 6860 <_sk_callback_sse2+0x68c>
+ .byte 68,15,89,21,47,68,0,0 // mulps 0x442f(%rip),%xmm10 # 6700 <_sk_callback_sse2+0x671>
+ .byte 102,68,15,219,13,54,68,0,0 // pand 0x4436(%rip),%xmm9 # 6710 <_sk_callback_sse2+0x681>
.byte 69,15,91,201 // cvtdq2ps %xmm9,%xmm9
- .byte 68,15,89,13,138,69,0,0 // mulps 0x458a(%rip),%xmm9 # 6870 <_sk_callback_sse2+0x69c>
+ .byte 68,15,89,13,58,68,0,0 // mulps 0x443a(%rip),%xmm9 # 6720 <_sk_callback_sse2+0x691>
.byte 15,92,196 // subps %xmm4,%xmm0
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
@@ -37527,7 +37092,7 @@ _sk_load_tables_sse2:
.byte 65,87 // push %r15
.byte 65,86 // push %r14
.byte 83 // push %rbx
- .byte 102,68,15,111,5,217,68,0,0 // movdqa 0x44d9(%rip),%xmm8 # 6880 <_sk_callback_sse2+0x6ac>
+ .byte 102,68,15,111,5,137,67,0,0 // movdqa 0x4389(%rip),%xmm8 # 6730 <_sk_callback_sse2+0x6a1>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
@@ -37583,7 +37148,7 @@ _sk_load_tables_sse2:
.byte 65,15,20,208 // unpcklps %xmm8,%xmm2
.byte 102,65,15,114,209,24 // psrld $0x18,%xmm9
.byte 65,15,91,217 // cvtdq2ps %xmm9,%xmm3
- .byte 15,89,29,226,67,0,0 // mulps 0x43e2(%rip),%xmm3 # 6890 <_sk_callback_sse2+0x6bc>
+ .byte 15,89,29,146,66,0,0 // mulps 0x4292(%rip),%xmm3 # 6740 <_sk_callback_sse2+0x6b1>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
@@ -37625,7 +37190,7 @@ _sk_load_tables_u16_be_sse2:
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,97,200 // punpcklwd %xmm0,%xmm1
.byte 102,68,15,105,200 // punpckhwd %xmm0,%xmm9
- .byte 102,68,15,111,21,87,67,0,0 // movdqa 0x4357(%rip),%xmm10 # 68a0 <_sk_callback_sse2+0x6cc>
+ .byte 102,68,15,111,21,7,66,0,0 // movdqa 0x4207(%rip),%xmm10 # 6750 <_sk_callback_sse2+0x6c1>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,194 // pand %xmm10,%xmm0
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
@@ -37687,7 +37252,7 @@ _sk_load_tables_u16_be_sse2:
.byte 102,65,15,235,217 // por %xmm9,%xmm3
.byte 102,65,15,97,216 // punpcklwd %xmm8,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,66,66,0,0 // mulps 0x4242(%rip),%xmm3 # 68b0 <_sk_callback_sse2+0x6dc>
+ .byte 15,89,29,242,64,0,0 // mulps 0x40f2(%rip),%xmm3 # 6760 <_sk_callback_sse2+0x6d1>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
@@ -37730,7 +37295,7 @@ _sk_load_tables_rgb_u16_be_sse2:
.byte 102,68,15,97,208 // punpcklwd %xmm0,%xmm10
.byte 102,65,15,111,195 // movdqa %xmm11,%xmm0
.byte 102,65,15,97,194 // punpcklwd %xmm10,%xmm0
- .byte 102,68,15,111,5,177,65,0,0 // movdqa 0x41b1(%rip),%xmm8 # 68c0 <_sk_callback_sse2+0x6ec>
+ .byte 102,68,15,111,5,97,64,0,0 // movdqa 0x4061(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x6e1>
.byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
.byte 102,65,15,219,192 // pand %xmm8,%xmm0
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
@@ -37786,7 +37351,7 @@ _sk_load_tables_rgb_u16_be_sse2:
.byte 15,20,211 // unpcklps %xmm3,%xmm2
.byte 65,15,20,208 // unpcklps %xmm8,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,188,64,0,0 // movaps 0x40bc(%rip),%xmm3 # 68d0 <_sk_callback_sse2+0x6fc>
+ .byte 15,40,29,108,63,0,0 // movaps 0x3f6c(%rip),%xmm3 # 6780 <_sk_callback_sse2+0x6f1>
.byte 91 // pop %rbx
.byte 65,94 // pop %r14
.byte 65,95 // pop %r15
@@ -37820,7 +37385,7 @@ _sk_byte_tables_sse2:
.byte 65,86 // push %r14
.byte 83 // push %rbx
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,85,64,0,0 // movaps 0x4055(%rip),%xmm8 # 68e0 <_sk_callback_sse2+0x70c>
+ .byte 68,15,40,5,5,63,0,0 // movaps 0x3f05(%rip),%xmm8 # 6790 <_sk_callback_sse2+0x701>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
.byte 102,73,15,126,193 // movq %xmm0,%r9
@@ -37848,7 +37413,7 @@ _sk_byte_tables_sse2:
.byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0
.byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,21,239,63,0,0 // movaps 0x3fef(%rip),%xmm10 # 68f0 <_sk_callback_sse2+0x71c>
+ .byte 68,15,40,21,159,62,0,0 // movaps 0x3e9f(%rip),%xmm10 # 67a0 <_sk_callback_sse2+0x711>
.byte 65,15,89,194 // mulps %xmm10,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
@@ -37969,7 +37534,7 @@ _sk_byte_tables_rgb_sse2:
.byte 102,65,15,96,193 // punpcklbw %xmm9,%xmm0
.byte 102,65,15,97,193 // punpcklwd %xmm9,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,21,55,62,0,0 // movaps 0x3e37(%rip),%xmm10 # 6900 <_sk_callback_sse2+0x72c>
+ .byte 68,15,40,21,231,60,0,0 // movaps 0x3ce7(%rip),%xmm10 # 67b0 <_sk_callback_sse2+0x721>
.byte 65,15,89,194 // mulps %xmm10,%xmm0
.byte 65,15,89,200 // mulps %xmm8,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
@@ -38176,15 +37741,15 @@ _sk_parametric_r_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,107,59,0,0 // mulps 0x3b6b(%rip),%xmm9 # 6910 <_sk_callback_sse2+0x73c>
- .byte 68,15,84,21,115,59,0,0 // andps 0x3b73(%rip),%xmm10 # 6920 <_sk_callback_sse2+0x74c>
- .byte 68,15,86,21,123,59,0,0 // orps 0x3b7b(%rip),%xmm10 # 6930 <_sk_callback_sse2+0x75c>
- .byte 68,15,88,13,131,59,0,0 // addps 0x3b83(%rip),%xmm9 # 6940 <_sk_callback_sse2+0x76c>
- .byte 68,15,40,37,139,59,0,0 // movaps 0x3b8b(%rip),%xmm12 # 6950 <_sk_callback_sse2+0x77c>
+ .byte 68,15,89,13,27,58,0,0 // mulps 0x3a1b(%rip),%xmm9 # 67c0 <_sk_callback_sse2+0x731>
+ .byte 68,15,84,21,35,58,0,0 // andps 0x3a23(%rip),%xmm10 # 67d0 <_sk_callback_sse2+0x741>
+ .byte 68,15,86,21,43,58,0,0 // orps 0x3a2b(%rip),%xmm10 # 67e0 <_sk_callback_sse2+0x751>
+ .byte 68,15,88,13,51,58,0,0 // addps 0x3a33(%rip),%xmm9 # 67f0 <_sk_callback_sse2+0x761>
+ .byte 68,15,40,37,59,58,0,0 // movaps 0x3a3b(%rip),%xmm12 # 6800 <_sk_callback_sse2+0x771>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,139,59,0,0 // addps 0x3b8b(%rip),%xmm10 # 6960 <_sk_callback_sse2+0x78c>
- .byte 68,15,40,37,147,59,0,0 // movaps 0x3b93(%rip),%xmm12 # 6970 <_sk_callback_sse2+0x79c>
+ .byte 68,15,88,21,59,58,0,0 // addps 0x3a3b(%rip),%xmm10 # 6810 <_sk_callback_sse2+0x781>
+ .byte 68,15,40,37,67,58,0,0 // movaps 0x3a43(%rip),%xmm12 # 6820 <_sk_callback_sse2+0x791>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -38192,22 +37757,22 @@ _sk_parametric_r_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,125,59,0,0 // movaps 0x3b7d(%rip),%xmm10 # 6980 <_sk_callback_sse2+0x7ac>
+ .byte 68,15,40,21,45,58,0,0 // movaps 0x3a2d(%rip),%xmm10 # 6830 <_sk_callback_sse2+0x7a1>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,113,59,0,0 // addps 0x3b71(%rip),%xmm9 # 6990 <_sk_callback_sse2+0x7bc>
- .byte 68,15,40,37,121,59,0,0 // movaps 0x3b79(%rip),%xmm12 # 69a0 <_sk_callback_sse2+0x7cc>
+ .byte 68,15,88,13,33,58,0,0 // addps 0x3a21(%rip),%xmm9 # 6840 <_sk_callback_sse2+0x7b1>
+ .byte 68,15,40,37,41,58,0,0 // movaps 0x3a29(%rip),%xmm12 # 6850 <_sk_callback_sse2+0x7c1>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,121,59,0,0 // movaps 0x3b79(%rip),%xmm12 # 69b0 <_sk_callback_sse2+0x7dc>
+ .byte 68,15,40,37,41,58,0,0 // movaps 0x3a29(%rip),%xmm12 # 6860 <_sk_callback_sse2+0x7d1>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,125,59,0,0 // movaps 0x3b7d(%rip),%xmm13 # 69c0 <_sk_callback_sse2+0x7ec>
+ .byte 68,15,40,45,45,58,0,0 // movaps 0x3a2d(%rip),%xmm13 # 6870 <_sk_callback_sse2+0x7e1>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,125,59,0,0 // mulps 0x3b7d(%rip),%xmm13 # 69d0 <_sk_callback_sse2+0x7fc>
+ .byte 68,15,89,45,45,58,0,0 // mulps 0x3a2d(%rip),%xmm13 # 6880 <_sk_callback_sse2+0x7f1>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -38243,15 +37808,15 @@ _sk_parametric_g_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,253,58,0,0 // mulps 0x3afd(%rip),%xmm9 # 69e0 <_sk_callback_sse2+0x80c>
- .byte 68,15,84,21,5,59,0,0 // andps 0x3b05(%rip),%xmm10 # 69f0 <_sk_callback_sse2+0x81c>
- .byte 68,15,86,21,13,59,0,0 // orps 0x3b0d(%rip),%xmm10 # 6a00 <_sk_callback_sse2+0x82c>
- .byte 68,15,88,13,21,59,0,0 // addps 0x3b15(%rip),%xmm9 # 6a10 <_sk_callback_sse2+0x83c>
- .byte 68,15,40,37,29,59,0,0 // movaps 0x3b1d(%rip),%xmm12 # 6a20 <_sk_callback_sse2+0x84c>
+ .byte 68,15,89,13,173,57,0,0 // mulps 0x39ad(%rip),%xmm9 # 6890 <_sk_callback_sse2+0x801>
+ .byte 68,15,84,21,181,57,0,0 // andps 0x39b5(%rip),%xmm10 # 68a0 <_sk_callback_sse2+0x811>
+ .byte 68,15,86,21,189,57,0,0 // orps 0x39bd(%rip),%xmm10 # 68b0 <_sk_callback_sse2+0x821>
+ .byte 68,15,88,13,197,57,0,0 // addps 0x39c5(%rip),%xmm9 # 68c0 <_sk_callback_sse2+0x831>
+ .byte 68,15,40,37,205,57,0,0 // movaps 0x39cd(%rip),%xmm12 # 68d0 <_sk_callback_sse2+0x841>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,29,59,0,0 // addps 0x3b1d(%rip),%xmm10 # 6a30 <_sk_callback_sse2+0x85c>
- .byte 68,15,40,37,37,59,0,0 // movaps 0x3b25(%rip),%xmm12 # 6a40 <_sk_callback_sse2+0x86c>
+ .byte 68,15,88,21,205,57,0,0 // addps 0x39cd(%rip),%xmm10 # 68e0 <_sk_callback_sse2+0x851>
+ .byte 68,15,40,37,213,57,0,0 // movaps 0x39d5(%rip),%xmm12 # 68f0 <_sk_callback_sse2+0x861>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -38259,22 +37824,22 @@ _sk_parametric_g_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,15,59,0,0 // movaps 0x3b0f(%rip),%xmm10 # 6a50 <_sk_callback_sse2+0x87c>
+ .byte 68,15,40,21,191,57,0,0 // movaps 0x39bf(%rip),%xmm10 # 6900 <_sk_callback_sse2+0x871>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,3,59,0,0 // addps 0x3b03(%rip),%xmm9 # 6a60 <_sk_callback_sse2+0x88c>
- .byte 68,15,40,37,11,59,0,0 // movaps 0x3b0b(%rip),%xmm12 # 6a70 <_sk_callback_sse2+0x89c>
+ .byte 68,15,88,13,179,57,0,0 // addps 0x39b3(%rip),%xmm9 # 6910 <_sk_callback_sse2+0x881>
+ .byte 68,15,40,37,187,57,0,0 // movaps 0x39bb(%rip),%xmm12 # 6920 <_sk_callback_sse2+0x891>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,11,59,0,0 // movaps 0x3b0b(%rip),%xmm12 # 6a80 <_sk_callback_sse2+0x8ac>
+ .byte 68,15,40,37,187,57,0,0 // movaps 0x39bb(%rip),%xmm12 # 6930 <_sk_callback_sse2+0x8a1>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,15,59,0,0 // movaps 0x3b0f(%rip),%xmm13 # 6a90 <_sk_callback_sse2+0x8bc>
+ .byte 68,15,40,45,191,57,0,0 // movaps 0x39bf(%rip),%xmm13 # 6940 <_sk_callback_sse2+0x8b1>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,15,59,0,0 // mulps 0x3b0f(%rip),%xmm13 # 6aa0 <_sk_callback_sse2+0x8cc>
+ .byte 68,15,89,45,191,57,0,0 // mulps 0x39bf(%rip),%xmm13 # 6950 <_sk_callback_sse2+0x8c1>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -38310,15 +37875,15 @@ _sk_parametric_b_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,143,58,0,0 // mulps 0x3a8f(%rip),%xmm9 # 6ab0 <_sk_callback_sse2+0x8dc>
- .byte 68,15,84,21,151,58,0,0 // andps 0x3a97(%rip),%xmm10 # 6ac0 <_sk_callback_sse2+0x8ec>
- .byte 68,15,86,21,159,58,0,0 // orps 0x3a9f(%rip),%xmm10 # 6ad0 <_sk_callback_sse2+0x8fc>
- .byte 68,15,88,13,167,58,0,0 // addps 0x3aa7(%rip),%xmm9 # 6ae0 <_sk_callback_sse2+0x90c>
- .byte 68,15,40,37,175,58,0,0 // movaps 0x3aaf(%rip),%xmm12 # 6af0 <_sk_callback_sse2+0x91c>
+ .byte 68,15,89,13,63,57,0,0 // mulps 0x393f(%rip),%xmm9 # 6960 <_sk_callback_sse2+0x8d1>
+ .byte 68,15,84,21,71,57,0,0 // andps 0x3947(%rip),%xmm10 # 6970 <_sk_callback_sse2+0x8e1>
+ .byte 68,15,86,21,79,57,0,0 // orps 0x394f(%rip),%xmm10 # 6980 <_sk_callback_sse2+0x8f1>
+ .byte 68,15,88,13,87,57,0,0 // addps 0x3957(%rip),%xmm9 # 6990 <_sk_callback_sse2+0x901>
+ .byte 68,15,40,37,95,57,0,0 // movaps 0x395f(%rip),%xmm12 # 69a0 <_sk_callback_sse2+0x911>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,175,58,0,0 // addps 0x3aaf(%rip),%xmm10 # 6b00 <_sk_callback_sse2+0x92c>
- .byte 68,15,40,37,183,58,0,0 // movaps 0x3ab7(%rip),%xmm12 # 6b10 <_sk_callback_sse2+0x93c>
+ .byte 68,15,88,21,95,57,0,0 // addps 0x395f(%rip),%xmm10 # 69b0 <_sk_callback_sse2+0x921>
+ .byte 68,15,40,37,103,57,0,0 // movaps 0x3967(%rip),%xmm12 # 69c0 <_sk_callback_sse2+0x931>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -38326,22 +37891,22 @@ _sk_parametric_b_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,161,58,0,0 // movaps 0x3aa1(%rip),%xmm10 # 6b20 <_sk_callback_sse2+0x94c>
+ .byte 68,15,40,21,81,57,0,0 // movaps 0x3951(%rip),%xmm10 # 69d0 <_sk_callback_sse2+0x941>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,149,58,0,0 // addps 0x3a95(%rip),%xmm9 # 6b30 <_sk_callback_sse2+0x95c>
- .byte 68,15,40,37,157,58,0,0 // movaps 0x3a9d(%rip),%xmm12 # 6b40 <_sk_callback_sse2+0x96c>
+ .byte 68,15,88,13,69,57,0,0 // addps 0x3945(%rip),%xmm9 # 69e0 <_sk_callback_sse2+0x951>
+ .byte 68,15,40,37,77,57,0,0 // movaps 0x394d(%rip),%xmm12 # 69f0 <_sk_callback_sse2+0x961>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,157,58,0,0 // movaps 0x3a9d(%rip),%xmm12 # 6b50 <_sk_callback_sse2+0x97c>
+ .byte 68,15,40,37,77,57,0,0 // movaps 0x394d(%rip),%xmm12 # 6a00 <_sk_callback_sse2+0x971>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,161,58,0,0 // movaps 0x3aa1(%rip),%xmm13 # 6b60 <_sk_callback_sse2+0x98c>
+ .byte 68,15,40,45,81,57,0,0 // movaps 0x3951(%rip),%xmm13 # 6a10 <_sk_callback_sse2+0x981>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,161,58,0,0 // mulps 0x3aa1(%rip),%xmm13 # 6b70 <_sk_callback_sse2+0x99c>
+ .byte 68,15,89,45,81,57,0,0 // mulps 0x3951(%rip),%xmm13 # 6a20 <_sk_callback_sse2+0x991>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -38377,15 +37942,15 @@ _sk_parametric_a_sse2:
.byte 69,15,88,209 // addps %xmm9,%xmm10
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,91,202 // cvtdq2ps %xmm10,%xmm9
- .byte 68,15,89,13,33,58,0,0 // mulps 0x3a21(%rip),%xmm9 # 6b80 <_sk_callback_sse2+0x9ac>
- .byte 68,15,84,21,41,58,0,0 // andps 0x3a29(%rip),%xmm10 # 6b90 <_sk_callback_sse2+0x9bc>
- .byte 68,15,86,21,49,58,0,0 // orps 0x3a31(%rip),%xmm10 # 6ba0 <_sk_callback_sse2+0x9cc>
- .byte 68,15,88,13,57,58,0,0 // addps 0x3a39(%rip),%xmm9 # 6bb0 <_sk_callback_sse2+0x9dc>
- .byte 68,15,40,37,65,58,0,0 // movaps 0x3a41(%rip),%xmm12 # 6bc0 <_sk_callback_sse2+0x9ec>
+ .byte 68,15,89,13,209,56,0,0 // mulps 0x38d1(%rip),%xmm9 # 6a30 <_sk_callback_sse2+0x9a1>
+ .byte 68,15,84,21,217,56,0,0 // andps 0x38d9(%rip),%xmm10 # 6a40 <_sk_callback_sse2+0x9b1>
+ .byte 68,15,86,21,225,56,0,0 // orps 0x38e1(%rip),%xmm10 # 6a50 <_sk_callback_sse2+0x9c1>
+ .byte 68,15,88,13,233,56,0,0 // addps 0x38e9(%rip),%xmm9 # 6a60 <_sk_callback_sse2+0x9d1>
+ .byte 68,15,40,37,241,56,0,0 // movaps 0x38f1(%rip),%xmm12 # 6a70 <_sk_callback_sse2+0x9e1>
.byte 69,15,89,226 // mulps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,88,21,65,58,0,0 // addps 0x3a41(%rip),%xmm10 # 6bd0 <_sk_callback_sse2+0x9fc>
- .byte 68,15,40,37,73,58,0,0 // movaps 0x3a49(%rip),%xmm12 # 6be0 <_sk_callback_sse2+0xa0c>
+ .byte 68,15,88,21,241,56,0,0 // addps 0x38f1(%rip),%xmm10 # 6a80 <_sk_callback_sse2+0x9f1>
+ .byte 68,15,40,37,249,56,0,0 // movaps 0x38f9(%rip),%xmm12 # 6a90 <_sk_callback_sse2+0xa01>
.byte 69,15,94,226 // divps %xmm10,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
.byte 69,15,89,203 // mulps %xmm11,%xmm9
@@ -38393,22 +37958,22 @@ _sk_parametric_a_sse2:
.byte 69,15,91,226 // cvtdq2ps %xmm10,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,194,236,1 // cmpltps %xmm12,%xmm13
- .byte 68,15,40,21,51,58,0,0 // movaps 0x3a33(%rip),%xmm10 # 6bf0 <_sk_callback_sse2+0xa1c>
+ .byte 68,15,40,21,227,56,0,0 // movaps 0x38e3(%rip),%xmm10 # 6aa0 <_sk_callback_sse2+0xa11>
.byte 69,15,84,234 // andps %xmm10,%xmm13
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,229 // subps %xmm13,%xmm12
.byte 69,15,40,233 // movaps %xmm9,%xmm13
.byte 69,15,92,236 // subps %xmm12,%xmm13
- .byte 68,15,88,13,39,58,0,0 // addps 0x3a27(%rip),%xmm9 # 6c00 <_sk_callback_sse2+0xa2c>
- .byte 68,15,40,37,47,58,0,0 // movaps 0x3a2f(%rip),%xmm12 # 6c10 <_sk_callback_sse2+0xa3c>
+ .byte 68,15,88,13,215,56,0,0 // addps 0x38d7(%rip),%xmm9 # 6ab0 <_sk_callback_sse2+0xa21>
+ .byte 68,15,40,37,223,56,0,0 // movaps 0x38df(%rip),%xmm12 # 6ac0 <_sk_callback_sse2+0xa31>
.byte 69,15,89,229 // mulps %xmm13,%xmm12
.byte 69,15,92,204 // subps %xmm12,%xmm9
- .byte 68,15,40,37,47,58,0,0 // movaps 0x3a2f(%rip),%xmm12 # 6c20 <_sk_callback_sse2+0xa4c>
+ .byte 68,15,40,37,223,56,0,0 // movaps 0x38df(%rip),%xmm12 # 6ad0 <_sk_callback_sse2+0xa41>
.byte 69,15,92,229 // subps %xmm13,%xmm12
- .byte 68,15,40,45,51,58,0,0 // movaps 0x3a33(%rip),%xmm13 # 6c30 <_sk_callback_sse2+0xa5c>
+ .byte 68,15,40,45,227,56,0,0 // movaps 0x38e3(%rip),%xmm13 # 6ae0 <_sk_callback_sse2+0xa51>
.byte 69,15,94,236 // divps %xmm12,%xmm13
.byte 69,15,88,233 // addps %xmm9,%xmm13
- .byte 68,15,89,45,51,58,0,0 // mulps 0x3a33(%rip),%xmm13 # 6c40 <_sk_callback_sse2+0xa6c>
+ .byte 68,15,89,45,227,56,0,0 // mulps 0x38e3(%rip),%xmm13 # 6af0 <_sk_callback_sse2+0xa61>
.byte 102,69,15,91,205 // cvtps2dq %xmm13,%xmm9
.byte 243,68,15,16,96,20 // movss 0x14(%rax),%xmm12
.byte 69,15,198,228,0 // shufps $0x0,%xmm12,%xmm12
@@ -38425,29 +37990,29 @@ HIDDEN _sk_lab_to_xyz_sse2
.globl _sk_lab_to_xyz_sse2
FUNCTION(_sk_lab_to_xyz_sse2)
_sk_lab_to_xyz_sse2:
- .byte 15,89,5,16,58,0,0 // mulps 0x3a10(%rip),%xmm0 # 6c50 <_sk_callback_sse2+0xa7c>
- .byte 68,15,40,5,24,58,0,0 // movaps 0x3a18(%rip),%xmm8 # 6c60 <_sk_callback_sse2+0xa8c>
+ .byte 15,89,5,192,56,0,0 // mulps 0x38c0(%rip),%xmm0 # 6b00 <_sk_callback_sse2+0xa71>
+ .byte 68,15,40,5,200,56,0,0 // movaps 0x38c8(%rip),%xmm8 # 6b10 <_sk_callback_sse2+0xa81>
.byte 65,15,89,200 // mulps %xmm8,%xmm1
- .byte 68,15,40,13,28,58,0,0 // movaps 0x3a1c(%rip),%xmm9 # 6c70 <_sk_callback_sse2+0xa9c>
+ .byte 68,15,40,13,204,56,0,0 // movaps 0x38cc(%rip),%xmm9 # 6b20 <_sk_callback_sse2+0xa91>
.byte 65,15,88,201 // addps %xmm9,%xmm1
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 65,15,88,209 // addps %xmm9,%xmm2
- .byte 15,88,5,25,58,0,0 // addps 0x3a19(%rip),%xmm0 # 6c80 <_sk_callback_sse2+0xaac>
- .byte 15,89,5,34,58,0,0 // mulps 0x3a22(%rip),%xmm0 # 6c90 <_sk_callback_sse2+0xabc>
- .byte 15,89,13,43,58,0,0 // mulps 0x3a2b(%rip),%xmm1 # 6ca0 <_sk_callback_sse2+0xacc>
+ .byte 15,88,5,201,56,0,0 // addps 0x38c9(%rip),%xmm0 # 6b30 <_sk_callback_sse2+0xaa1>
+ .byte 15,89,5,210,56,0,0 // mulps 0x38d2(%rip),%xmm0 # 6b40 <_sk_callback_sse2+0xab1>
+ .byte 15,89,13,219,56,0,0 // mulps 0x38db(%rip),%xmm1 # 6b50 <_sk_callback_sse2+0xac1>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,21,49,58,0,0 // mulps 0x3a31(%rip),%xmm2 # 6cb0 <_sk_callback_sse2+0xadc>
+ .byte 15,89,21,225,56,0,0 // mulps 0x38e1(%rip),%xmm2 # 6b60 <_sk_callback_sse2+0xad1>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 68,15,92,202 // subps %xmm2,%xmm9
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
.byte 68,15,89,225 // mulps %xmm1,%xmm12
- .byte 15,40,21,38,58,0,0 // movaps 0x3a26(%rip),%xmm2 # 6cc0 <_sk_callback_sse2+0xaec>
+ .byte 15,40,21,214,56,0,0 // movaps 0x38d6(%rip),%xmm2 # 6b70 <_sk_callback_sse2+0xae1>
.byte 68,15,40,194 // movaps %xmm2,%xmm8
.byte 69,15,194,196,1 // cmpltps %xmm12,%xmm8
- .byte 68,15,40,21,37,58,0,0 // movaps 0x3a25(%rip),%xmm10 # 6cd0 <_sk_callback_sse2+0xafc>
+ .byte 68,15,40,21,213,56,0,0 // movaps 0x38d5(%rip),%xmm10 # 6b80 <_sk_callback_sse2+0xaf1>
.byte 65,15,88,202 // addps %xmm10,%xmm1
- .byte 68,15,40,29,41,58,0,0 // movaps 0x3a29(%rip),%xmm11 # 6ce0 <_sk_callback_sse2+0xb0c>
+ .byte 68,15,40,29,217,56,0,0 // movaps 0x38d9(%rip),%xmm11 # 6b90 <_sk_callback_sse2+0xb01>
.byte 65,15,89,203 // mulps %xmm11,%xmm1
.byte 69,15,84,224 // andps %xmm8,%xmm12
.byte 68,15,85,193 // andnps %xmm1,%xmm8
@@ -38471,8 +38036,8 @@ _sk_lab_to_xyz_sse2:
.byte 15,84,194 // andps %xmm2,%xmm0
.byte 65,15,85,209 // andnps %xmm9,%xmm2
.byte 15,86,208 // orps %xmm0,%xmm2
- .byte 68,15,89,5,217,57,0,0 // mulps 0x39d9(%rip),%xmm8 # 6cf0 <_sk_callback_sse2+0xb1c>
- .byte 15,89,21,226,57,0,0 // mulps 0x39e2(%rip),%xmm2 # 6d00 <_sk_callback_sse2+0xb2c>
+ .byte 68,15,89,5,137,56,0,0 // mulps 0x3889(%rip),%xmm8 # 6ba0 <_sk_callback_sse2+0xb11>
+ .byte 15,89,21,146,56,0,0 // mulps 0x3892(%rip),%xmm2 # 6bb0 <_sk_callback_sse2+0xb21>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -38488,9 +38053,9 @@ _sk_load_a8_sse2:
.byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0
.byte 102,15,96,192 // punpcklbw %xmm0,%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
- .byte 102,15,219,5,202,57,0,0 // pand 0x39ca(%rip),%xmm0 # 6d10 <_sk_callback_sse2+0xb3c>
+ .byte 102,15,219,5,122,56,0,0 // pand 0x387a(%rip),%xmm0 # 6bc0 <_sk_callback_sse2+0xb31>
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,208,57,0,0 // mulps 0x39d0(%rip),%xmm3 # 6d20 <_sk_callback_sse2+0xb4c>
+ .byte 15,89,29,128,56,0,0 // mulps 0x3880(%rip),%xmm3 # 6bd0 <_sk_callback_sse2+0xb41>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
@@ -38529,9 +38094,9 @@ _sk_load_a8_dst_sse2:
.byte 102,65,15,110,36,18 // movd (%r10,%rdx,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,37,100,57,0,0 // pand 0x3964(%rip),%xmm4 # 6d30 <_sk_callback_sse2+0xb5c>
+ .byte 102,15,219,37,20,56,0,0 // pand 0x3814(%rip),%xmm4 # 6be0 <_sk_callback_sse2+0xb51>
.byte 15,91,252 // cvtdq2ps %xmm4,%xmm7
- .byte 15,89,61,106,57,0,0 // mulps 0x396a(%rip),%xmm7 # 6d40 <_sk_callback_sse2+0xb6c>
+ .byte 15,89,61,26,56,0,0 // mulps 0x381a(%rip),%xmm7 # 6bf0 <_sk_callback_sse2+0xb61>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 102,15,87,237 // xorpd %xmm5,%xmm5
@@ -38568,7 +38133,7 @@ _sk_gather_a8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -38599,7 +38164,7 @@ _sk_gather_a8_sse2:
.byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,29,139,56,0,0 // mulps 0x388b(%rip),%xmm3 # 6d50 <_sk_callback_sse2+0xb7c>
+ .byte 15,89,29,59,55,0,0 // mulps 0x373b(%rip),%xmm3 # 6c00 <_sk_callback_sse2+0xb71>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
@@ -38614,7 +38179,7 @@ FUNCTION(_sk_store_a8_sse2)
_sk_store_a8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
- .byte 68,15,40,5,125,56,0,0 // movaps 0x387d(%rip),%xmm8 # 6d60 <_sk_callback_sse2+0xb8c>
+ .byte 68,15,40,5,45,55,0,0 // movaps 0x372d(%rip),%xmm8 # 6c10 <_sk_callback_sse2+0xb81>
.byte 68,15,89,195 // mulps %xmm3,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
.byte 102,65,15,114,240,16 // pslld $0x10,%xmm8
@@ -38640,7 +38205,7 @@ _sk_store_a8_sse2:
.byte 102,68,15,127,68,36,232 // movdqa %xmm8,-0x18(%rsp)
.byte 138,68,36,240 // mov -0x10(%rsp),%al
.byte 65,136,68,18,2 // mov %al,0x2(%r10,%rdx,1)
- .byte 102,68,15,219,5,32,56,0,0 // pand 0x3820(%rip),%xmm8 # 6d70 <_sk_callback_sse2+0xb9c>
+ .byte 102,68,15,219,5,208,54,0,0 // pand 0x36d0(%rip),%xmm8 # 6c20 <_sk_callback_sse2+0xb91>
.byte 102,69,15,103,192 // packuswb %xmm8,%xmm8
.byte 102,69,15,103,192 // packuswb %xmm8,%xmm8
.byte 102,68,15,126,192 // movd %xmm8,%eax
@@ -38662,11 +38227,11 @@ _sk_load_g8_sse2:
.byte 102,65,15,110,4,18 // movd (%r10,%rdx,1),%xmm0
.byte 102,15,96,192 // punpcklbw %xmm0,%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
- .byte 102,15,219,5,233,55,0,0 // pand 0x37e9(%rip),%xmm0 # 6d80 <_sk_callback_sse2+0xbac>
+ .byte 102,15,219,5,153,54,0,0 // pand 0x3699(%rip),%xmm0 # 6c30 <_sk_callback_sse2+0xba1>
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,239,55,0,0 // mulps 0x37ef(%rip),%xmm0 # 6d90 <_sk_callback_sse2+0xbbc>
+ .byte 15,89,5,159,54,0,0 // mulps 0x369f(%rip),%xmm0 # 6c40 <_sk_callback_sse2+0xbb1>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,246,55,0,0 // movaps 0x37f6(%rip),%xmm3 # 6da0 <_sk_callback_sse2+0xbcc>
+ .byte 15,40,29,166,54,0,0 // movaps 0x36a6(%rip),%xmm3 # 6c50 <_sk_callback_sse2+0xbc1>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,224 // jmpq *%rax
@@ -38703,11 +38268,11 @@ _sk_load_g8_dst_sse2:
.byte 102,65,15,110,36,18 // movd (%r10,%rdx,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,37,144,55,0,0 // pand 0x3790(%rip),%xmm4 # 6db0 <_sk_callback_sse2+0xbdc>
+ .byte 102,15,219,37,64,54,0,0 // pand 0x3640(%rip),%xmm4 # 6c60 <_sk_callback_sse2+0xbd1>
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,150,55,0,0 // mulps 0x3796(%rip),%xmm4 # 6dc0 <_sk_callback_sse2+0xbec>
+ .byte 15,89,37,70,54,0,0 // mulps 0x3646(%rip),%xmm4 # 6c70 <_sk_callback_sse2+0xbe1>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,61,157,55,0,0 // movaps 0x379d(%rip),%xmm7 # 6dd0 <_sk_callback_sse2+0xbfc>
+ .byte 15,40,61,77,54,0,0 // movaps 0x364d(%rip),%xmm7 # 6c80 <_sk_callback_sse2+0xbf1>
.byte 15,40,236 // movaps %xmm4,%xmm5
.byte 15,40,244 // movaps %xmm4,%xmm6
.byte 255,224 // jmpq *%rax
@@ -38742,7 +38307,7 @@ _sk_gather_g8_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -38773,101 +38338,15 @@ _sk_gather_g8_sse2:
.byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,196,54,0,0 // mulps 0x36c4(%rip),%xmm0 # 6de0 <_sk_callback_sse2+0xc0c>
+ .byte 15,89,5,116,53,0,0 // mulps 0x3574(%rip),%xmm0 # 6c90 <_sk_callback_sse2+0xc01>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,203,54,0,0 // movaps 0x36cb(%rip),%xmm3 # 6df0 <_sk_callback_sse2+0xc1c>
+ .byte 15,40,29,123,53,0,0 // movaps 0x357b(%rip),%xmm3 # 6ca0 <_sk_callback_sse2+0xc11>
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 91 // pop %rbx
.byte 93 // pop %rbp
.byte 255,224 // jmpq *%rax
-HIDDEN _sk_gather_i8_sse2
-.globl _sk_gather_i8_sse2
-FUNCTION(_sk_gather_i8_sse2)
-_sk_gather_i8_sse2:
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 73,137,193 // mov %rax,%r9
- .byte 77,133,201 // test %r9,%r9
- .byte 116,5 // je 373e <_sk_gather_i8_sse2+0xf>
- .byte 76,137,200 // mov %r9,%rax
- .byte 235,2 // jmp 3740 <_sk_gather_i8_sse2+0x11>
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 85 // push %rbp
- .byte 65,86 // push %r14
- .byte 83 // push %rbx
- .byte 76,139,16 // mov (%rax),%r10
- .byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
- .byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
- .byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
- .byte 102,15,244,218 // pmuludq %xmm2,%xmm3
- .byte 102,15,112,219,232 // pshufd $0xe8,%xmm3,%xmm3
- .byte 102,15,244,209 // pmuludq %xmm1,%xmm2
- .byte 102,15,112,202,232 // pshufd $0xe8,%xmm2,%xmm1
- .byte 102,15,98,203 // punpckldq %xmm3,%xmm1
- .byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
- .byte 102,15,254,193 // paddd %xmm1,%xmm0
- .byte 102,72,15,126,192 // movq %xmm0,%rax
- .byte 65,137,195 // mov %eax,%r11d
- .byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 65,137,222 // mov %ebx,%r14d
- .byte 72,193,235,32 // shr $0x20,%rbx
- .byte 67,15,182,44,50 // movzbl (%r10,%r14,1),%ebp
- .byte 65,15,182,28,26 // movzbl (%r10,%rbx,1),%ebx
- .byte 193,227,8 // shl $0x8,%ebx
- .byte 9,235 // or %ebp,%ebx
- .byte 67,15,182,44,26 // movzbl (%r10,%r11,1),%ebp
- .byte 65,15,182,4,2 // movzbl (%r10,%rax,1),%eax
- .byte 193,224,8 // shl $0x8,%eax
- .byte 9,232 // or %ebp,%eax
- .byte 102,15,196,192,0 // pinsrw $0x0,%eax,%xmm0
- .byte 102,15,196,195,1 // pinsrw $0x1,%ebx,%xmm0
- .byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
- .byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
- .byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
- .byte 102,72,15,126,200 // movq %xmm1,%rax
- .byte 68,15,182,208 // movzbl %al,%r10d
- .byte 72,193,232,32 // shr $0x20,%rax
- .byte 102,72,15,126,195 // movq %xmm0,%rbx
- .byte 73,139,105,8 // mov 0x8(%r9),%rbp
- .byte 68,15,182,203 // movzbl %bl,%r9d
- .byte 72,193,235,30 // shr $0x1e,%rbx
- .byte 102,15,110,68,29,0 // movd 0x0(%rbp,%rbx,1),%xmm0
- .byte 102,15,110,76,133,0 // movd 0x0(%rbp,%rax,4),%xmm1
- .byte 102,15,98,193 // punpckldq %xmm1,%xmm0
- .byte 102,70,15,110,76,141,0 // movd 0x0(%rbp,%r9,4),%xmm9
- .byte 102,66,15,110,76,149,0 // movd 0x0(%rbp,%r10,4),%xmm1
- .byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9
- .byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9
- .byte 102,15,111,21,228,53,0,0 // movdqa 0x35e4(%rip),%xmm2 # 6e00 <_sk_callback_sse2+0xc2c>
- .byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
- .byte 102,15,219,194 // pand %xmm2,%xmm0
- .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,224,53,0,0 // movaps 0x35e0(%rip),%xmm8 # 6e10 <_sk_callback_sse2+0xc3c>
- .byte 65,15,89,192 // mulps %xmm8,%xmm0
- .byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
- .byte 102,15,114,209,8 // psrld $0x8,%xmm1
- .byte 102,15,219,202 // pand %xmm2,%xmm1
- .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 65,15,89,200 // mulps %xmm8,%xmm1
- .byte 102,65,15,111,217 // movdqa %xmm9,%xmm3
- .byte 102,15,114,211,16 // psrld $0x10,%xmm3
- .byte 102,15,219,218 // pand %xmm2,%xmm3
- .byte 15,91,211 // cvtdq2ps %xmm3,%xmm2
- .byte 65,15,89,208 // mulps %xmm8,%xmm2
- .byte 102,65,15,114,209,24 // psrld $0x18,%xmm9
- .byte 65,15,91,217 // cvtdq2ps %xmm9,%xmm3
- .byte 65,15,89,216 // mulps %xmm8,%xmm3
- .byte 72,173 // lods %ds:(%rsi),%rax
- .byte 91 // pop %rbx
- .byte 65,94 // pop %r14
- .byte 93 // pop %rbp
- .byte 255,224 // jmpq *%rax
-
HIDDEN _sk_load_565_sse2
.globl _sk_load_565_sse2
FUNCTION(_sk_load_565_sse2)
@@ -38875,42 +38354,42 @@ _sk_load_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,83 // jne 38d1 <_sk_load_565_sse2+0x5d>
+ .byte 117,83 // jne 378c <_sk_load_565_sse2+0x5d>
.byte 243,65,15,126,20,82 // movq (%r10,%rdx,2),%xmm2
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,5,144,53,0,0 // movdqa 0x3590(%rip),%xmm0 # 6e20 <_sk_callback_sse2+0xc4c>
+ .byte 102,15,111,5,101,53,0,0 // movdqa 0x3565(%rip),%xmm0 # 6cb0 <_sk_callback_sse2+0xc21>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,146,53,0,0 // mulps 0x3592(%rip),%xmm0 # 6e30 <_sk_callback_sse2+0xc5c>
- .byte 102,15,111,13,154,53,0,0 // movdqa 0x359a(%rip),%xmm1 # 6e40 <_sk_callback_sse2+0xc6c>
+ .byte 15,89,5,103,53,0,0 // mulps 0x3567(%rip),%xmm0 # 6cc0 <_sk_callback_sse2+0xc31>
+ .byte 102,15,111,13,111,53,0,0 // movdqa 0x356f(%rip),%xmm1 # 6cd0 <_sk_callback_sse2+0xc41>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,156,53,0,0 // mulps 0x359c(%rip),%xmm1 # 6e50 <_sk_callback_sse2+0xc7c>
- .byte 102,15,219,21,164,53,0,0 // pand 0x35a4(%rip),%xmm2 # 6e60 <_sk_callback_sse2+0xc8c>
+ .byte 15,89,13,113,53,0,0 // mulps 0x3571(%rip),%xmm1 # 6ce0 <_sk_callback_sse2+0xc51>
+ .byte 102,15,219,21,121,53,0,0 // pand 0x3579(%rip),%xmm2 # 6cf0 <_sk_callback_sse2+0xc61>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,170,53,0,0 // mulps 0x35aa(%rip),%xmm2 # 6e70 <_sk_callback_sse2+0xc9c>
+ .byte 15,89,21,127,53,0,0 // mulps 0x357f(%rip),%xmm2 # 6d00 <_sk_callback_sse2+0xc71>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,177,53,0,0 // movaps 0x35b1(%rip),%xmm3 # 6e80 <_sk_callback_sse2+0xcac>
+ .byte 15,40,29,134,53,0,0 // movaps 0x3586(%rip),%xmm3 # 6d10 <_sk_callback_sse2+0xc81>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,50 // je 3910 <_sk_load_565_sse2+0x9c>
+ .byte 116,50 // je 37cb <_sk_load_565_sse2+0x9c>
.byte 102,15,239,210 // pxor %xmm2,%xmm2
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 38fd <_sk_load_565_sse2+0x89>
+ .byte 116,21 // je 37b8 <_sk_load_565_sse2+0x89>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,154 // jne 3888 <_sk_load_565_sse2+0x14>
+ .byte 117,154 // jne 3743 <_sk_load_565_sse2+0x14>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,208,69 // pshufd $0x45,%xmm0,%xmm2
.byte 102,65,15,110,4,82 // movd (%r10,%rdx,2),%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
.byte 242,15,16,208 // movsd %xmm0,%xmm2
- .byte 233,120,255,255,255 // jmpq 3888 <_sk_load_565_sse2+0x14>
+ .byte 233,120,255,255,255 // jmpq 3743 <_sk_load_565_sse2+0x14>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,208 // movd %eax,%xmm2
- .byte 233,106,255,255,255 // jmpq 3888 <_sk_load_565_sse2+0x14>
+ .byte 233,106,255,255,255 // jmpq 3743 <_sk_load_565_sse2+0x14>
HIDDEN _sk_load_565_dst_sse2
.globl _sk_load_565_dst_sse2
@@ -38919,42 +38398,42 @@ _sk_load_565_dst_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,83 // jne 397b <_sk_load_565_dst_sse2+0x5d>
+ .byte 117,83 // jne 3836 <_sk_load_565_dst_sse2+0x5d>
.byte 243,65,15,126,52,82 // movq (%r10,%rdx,2),%xmm6
.byte 102,15,97,240 // punpcklwd %xmm0,%xmm6
- .byte 102,15,111,37,86,53,0,0 // movdqa 0x3556(%rip),%xmm4 # 6e90 <_sk_callback_sse2+0xcbc>
+ .byte 102,15,111,37,43,53,0,0 // movdqa 0x352b(%rip),%xmm4 # 6d20 <_sk_callback_sse2+0xc91>
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,88,53,0,0 // mulps 0x3558(%rip),%xmm4 # 6ea0 <_sk_callback_sse2+0xccc>
- .byte 102,15,111,45,96,53,0,0 // movdqa 0x3560(%rip),%xmm5 # 6eb0 <_sk_callback_sse2+0xcdc>
+ .byte 15,89,37,45,53,0,0 // mulps 0x352d(%rip),%xmm4 # 6d30 <_sk_callback_sse2+0xca1>
+ .byte 102,15,111,45,53,53,0,0 // movdqa 0x3535(%rip),%xmm5 # 6d40 <_sk_callback_sse2+0xcb1>
.byte 102,15,219,238 // pand %xmm6,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,45,98,53,0,0 // mulps 0x3562(%rip),%xmm5 # 6ec0 <_sk_callback_sse2+0xcec>
- .byte 102,15,219,53,106,53,0,0 // pand 0x356a(%rip),%xmm6 # 6ed0 <_sk_callback_sse2+0xcfc>
+ .byte 15,89,45,55,53,0,0 // mulps 0x3537(%rip),%xmm5 # 6d50 <_sk_callback_sse2+0xcc1>
+ .byte 102,15,219,53,63,53,0,0 // pand 0x353f(%rip),%xmm6 # 6d60 <_sk_callback_sse2+0xcd1>
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,53,112,53,0,0 // mulps 0x3570(%rip),%xmm6 # 6ee0 <_sk_callback_sse2+0xd0c>
+ .byte 15,89,53,69,53,0,0 // mulps 0x3545(%rip),%xmm6 # 6d70 <_sk_callback_sse2+0xce1>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,61,119,53,0,0 // movaps 0x3577(%rip),%xmm7 # 6ef0 <_sk_callback_sse2+0xd1c>
+ .byte 15,40,61,76,53,0,0 // movaps 0x354c(%rip),%xmm7 # 6d80 <_sk_callback_sse2+0xcf1>
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,50 // je 39ba <_sk_load_565_dst_sse2+0x9c>
+ .byte 116,50 // je 3875 <_sk_load_565_dst_sse2+0x9c>
.byte 102,15,239,246 // pxor %xmm6,%xmm6
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 39a7 <_sk_load_565_dst_sse2+0x89>
+ .byte 116,21 // je 3862 <_sk_load_565_dst_sse2+0x89>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,154 // jne 3932 <_sk_load_565_dst_sse2+0x14>
+ .byte 117,154 // jne 37ed <_sk_load_565_dst_sse2+0x14>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,224 // movd %eax,%xmm4
.byte 102,15,112,244,69 // pshufd $0x45,%xmm4,%xmm6
.byte 102,65,15,110,36,82 // movd (%r10,%rdx,2),%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
.byte 242,15,16,244 // movsd %xmm4,%xmm6
- .byte 233,120,255,255,255 // jmpq 3932 <_sk_load_565_dst_sse2+0x14>
+ .byte 233,120,255,255,255 // jmpq 37ed <_sk_load_565_dst_sse2+0x14>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,240 // movd %eax,%xmm6
- .byte 233,106,255,255,255 // jmpq 3932 <_sk_load_565_dst_sse2+0x14>
+ .byte 233,106,255,255,255 // jmpq 37ed <_sk_load_565_dst_sse2+0x14>
HIDDEN _sk_gather_565_sse2
.globl _sk_gather_565_sse2
@@ -38964,7 +38443,7 @@ _sk_gather_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -38989,19 +38468,19 @@ _sk_gather_565_sse2:
.byte 102,15,196,208,3 // pinsrw $0x3,%eax,%xmm2
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,5,178,52,0,0 // movdqa 0x34b2(%rip),%xmm0 # 6f00 <_sk_callback_sse2+0xd2c>
+ .byte 102,15,111,5,135,52,0,0 // movdqa 0x3487(%rip),%xmm0 # 6d90 <_sk_callback_sse2+0xd01>
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,180,52,0,0 // mulps 0x34b4(%rip),%xmm0 # 6f10 <_sk_callback_sse2+0xd3c>
- .byte 102,15,111,13,188,52,0,0 // movdqa 0x34bc(%rip),%xmm1 # 6f20 <_sk_callback_sse2+0xd4c>
+ .byte 15,89,5,137,52,0,0 // mulps 0x3489(%rip),%xmm0 # 6da0 <_sk_callback_sse2+0xd11>
+ .byte 102,15,111,13,145,52,0,0 // movdqa 0x3491(%rip),%xmm1 # 6db0 <_sk_callback_sse2+0xd21>
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,190,52,0,0 // mulps 0x34be(%rip),%xmm1 # 6f30 <_sk_callback_sse2+0xd5c>
- .byte 102,15,219,21,198,52,0,0 // pand 0x34c6(%rip),%xmm2 # 6f40 <_sk_callback_sse2+0xd6c>
+ .byte 15,89,13,147,52,0,0 // mulps 0x3493(%rip),%xmm1 # 6dc0 <_sk_callback_sse2+0xd31>
+ .byte 102,15,219,21,155,52,0,0 // pand 0x349b(%rip),%xmm2 # 6dd0 <_sk_callback_sse2+0xd41>
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,204,52,0,0 // mulps 0x34cc(%rip),%xmm2 # 6f50 <_sk_callback_sse2+0xd7c>
+ .byte 15,89,21,161,52,0,0 // mulps 0x34a1(%rip),%xmm2 # 6de0 <_sk_callback_sse2+0xd51>
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,211,52,0,0 // movaps 0x34d3(%rip),%xmm3 # 6f60 <_sk_callback_sse2+0xd8c>
+ .byte 15,40,29,168,52,0,0 // movaps 0x34a8(%rip),%xmm3 # 6df0 <_sk_callback_sse2+0xd61>
.byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
@@ -39011,12 +38490,12 @@ FUNCTION(_sk_store_565_sse2)
_sk_store_565_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
- .byte 68,15,40,5,211,52,0,0 // movaps 0x34d3(%rip),%xmm8 # 6f70 <_sk_callback_sse2+0xd9c>
+ .byte 68,15,40,5,168,52,0,0 // movaps 0x34a8(%rip),%xmm8 # 6e00 <_sk_callback_sse2+0xd71>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
.byte 102,65,15,114,241,11 // pslld $0xb,%xmm9
- .byte 68,15,40,21,200,52,0,0 // movaps 0x34c8(%rip),%xmm10 # 6f80 <_sk_callback_sse2+0xdac>
+ .byte 68,15,40,21,157,52,0,0 // movaps 0x349d(%rip),%xmm10 # 6e10 <_sk_callback_sse2+0xd81>
.byte 68,15,89,209 // mulps %xmm1,%xmm10
.byte 102,69,15,91,210 // cvtps2dq %xmm10,%xmm10
.byte 102,65,15,114,242,5 // pslld $0x5,%xmm10
@@ -39028,7 +38507,7 @@ _sk_store_565_sse2:
.byte 102,65,15,114,224,16 // psrad $0x10,%xmm8
.byte 102,69,15,107,192 // packssdw %xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3afa <_sk_store_565_sse2+0x6a>
+ .byte 117,10 // jne 39b5 <_sk_store_565_sse2+0x6a>
.byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -39036,19 +38515,19 @@ _sk_store_565_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,38 // je 3b32 <_sk_store_565_sse2+0xa2>
+ .byte 116,38 // je 39ed <_sk_store_565_sse2+0xa2>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 3b24 <_sk_store_565_sse2+0x94>
+ .byte 116,18 // je 39df <_sk_store_565_sse2+0x94>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,222 // jne 3af6 <_sk_store_565_sse2+0x66>
+ .byte 117,222 // jne 39b1 <_sk_store_565_sse2+0x66>
.byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax
.byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2)
.byte 242,69,15,112,192,232 // pshuflw $0xe8,%xmm8,%xmm8
.byte 102,69,15,126,4,82 // movd %xmm8,(%r10,%rdx,2)
- .byte 235,196 // jmp 3af6 <_sk_store_565_sse2+0x66>
+ .byte 235,196 // jmp 39b1 <_sk_store_565_sse2+0x66>
.byte 102,68,15,126,192 // movd %xmm8,%eax
.byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2)
- .byte 235,184 // jmp 3af6 <_sk_store_565_sse2+0x66>
+ .byte 235,184 // jmp 39b1 <_sk_store_565_sse2+0x66>
HIDDEN _sk_load_4444_sse2
.globl _sk_load_4444_sse2
@@ -39057,45 +38536,45 @@ _sk_load_4444_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 3baa <_sk_load_4444_sse2+0x6c>
+ .byte 117,98 // jne 3a65 <_sk_load_4444_sse2+0x6c>
.byte 243,65,15,126,28,82 // movq (%r10,%rdx,2),%xmm3
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,5,54,52,0,0 // movdqa 0x3436(%rip),%xmm0 # 6f90 <_sk_callback_sse2+0xdbc>
+ .byte 102,15,111,5,11,52,0,0 // movdqa 0x340b(%rip),%xmm0 # 6e20 <_sk_callback_sse2+0xd91>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,56,52,0,0 // mulps 0x3438(%rip),%xmm0 # 6fa0 <_sk_callback_sse2+0xdcc>
- .byte 102,15,111,13,64,52,0,0 // movdqa 0x3440(%rip),%xmm1 # 6fb0 <_sk_callback_sse2+0xddc>
+ .byte 15,89,5,13,52,0,0 // mulps 0x340d(%rip),%xmm0 # 6e30 <_sk_callback_sse2+0xda1>
+ .byte 102,15,111,13,21,52,0,0 // movdqa 0x3415(%rip),%xmm1 # 6e40 <_sk_callback_sse2+0xdb1>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,66,52,0,0 // mulps 0x3442(%rip),%xmm1 # 6fc0 <_sk_callback_sse2+0xdec>
- .byte 102,15,111,21,74,52,0,0 // movdqa 0x344a(%rip),%xmm2 # 6fd0 <_sk_callback_sse2+0xdfc>
+ .byte 15,89,13,23,52,0,0 // mulps 0x3417(%rip),%xmm1 # 6e50 <_sk_callback_sse2+0xdc1>
+ .byte 102,15,111,21,31,52,0,0 // movdqa 0x341f(%rip),%xmm2 # 6e60 <_sk_callback_sse2+0xdd1>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,76,52,0,0 // mulps 0x344c(%rip),%xmm2 # 6fe0 <_sk_callback_sse2+0xe0c>
- .byte 102,15,219,29,84,52,0,0 // pand 0x3454(%rip),%xmm3 # 6ff0 <_sk_callback_sse2+0xe1c>
+ .byte 15,89,21,33,52,0,0 // mulps 0x3421(%rip),%xmm2 # 6e70 <_sk_callback_sse2+0xde1>
+ .byte 102,15,219,29,41,52,0,0 // pand 0x3429(%rip),%xmm3 # 6e80 <_sk_callback_sse2+0xdf1>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,90,52,0,0 // mulps 0x345a(%rip),%xmm3 # 7000 <_sk_callback_sse2+0xe2c>
+ .byte 15,89,29,47,52,0,0 // mulps 0x342f(%rip),%xmm3 # 6e90 <_sk_callback_sse2+0xe01>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,50 // je 3be9 <_sk_load_4444_sse2+0xab>
+ .byte 116,50 // je 3aa4 <_sk_load_4444_sse2+0xab>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 3bd6 <_sk_load_4444_sse2+0x98>
+ .byte 116,21 // je 3a91 <_sk_load_4444_sse2+0x98>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,139 // jne 3b52 <_sk_load_4444_sse2+0x14>
+ .byte 117,139 // jne 3a0d <_sk_load_4444_sse2+0x14>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,192 // movd %eax,%xmm0
.byte 102,15,112,216,69 // pshufd $0x45,%xmm0,%xmm3
.byte 102,65,15,110,4,82 // movd (%r10,%rdx,2),%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
.byte 242,15,16,216 // movsd %xmm0,%xmm3
- .byte 233,105,255,255,255 // jmpq 3b52 <_sk_load_4444_sse2+0x14>
+ .byte 233,105,255,255,255 // jmpq 3a0d <_sk_load_4444_sse2+0x14>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,216 // movd %eax,%xmm3
- .byte 233,91,255,255,255 // jmpq 3b52 <_sk_load_4444_sse2+0x14>
+ .byte 233,91,255,255,255 // jmpq 3a0d <_sk_load_4444_sse2+0x14>
HIDDEN _sk_load_4444_dst_sse2
.globl _sk_load_4444_dst_sse2
@@ -39104,45 +38583,45 @@ _sk_load_4444_dst_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 3c63 <_sk_load_4444_dst_sse2+0x6c>
+ .byte 117,98 // jne 3b1e <_sk_load_4444_dst_sse2+0x6c>
.byte 243,65,15,126,60,82 // movq (%r10,%rdx,2),%xmm7
.byte 102,15,97,248 // punpcklwd %xmm0,%xmm7
- .byte 102,15,111,37,253,51,0,0 // movdqa 0x33fd(%rip),%xmm4 # 7010 <_sk_callback_sse2+0xe3c>
+ .byte 102,15,111,37,210,51,0,0 // movdqa 0x33d2(%rip),%xmm4 # 6ea0 <_sk_callback_sse2+0xe11>
.byte 102,15,219,231 // pand %xmm7,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,37,255,51,0,0 // mulps 0x33ff(%rip),%xmm4 # 7020 <_sk_callback_sse2+0xe4c>
- .byte 102,15,111,45,7,52,0,0 // movdqa 0x3407(%rip),%xmm5 # 7030 <_sk_callback_sse2+0xe5c>
+ .byte 15,89,37,212,51,0,0 // mulps 0x33d4(%rip),%xmm4 # 6eb0 <_sk_callback_sse2+0xe21>
+ .byte 102,15,111,45,220,51,0,0 // movdqa 0x33dc(%rip),%xmm5 # 6ec0 <_sk_callback_sse2+0xe31>
.byte 102,15,219,239 // pand %xmm7,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,45,9,52,0,0 // mulps 0x3409(%rip),%xmm5 # 7040 <_sk_callback_sse2+0xe6c>
- .byte 102,15,111,53,17,52,0,0 // movdqa 0x3411(%rip),%xmm6 # 7050 <_sk_callback_sse2+0xe7c>
+ .byte 15,89,45,222,51,0,0 // mulps 0x33de(%rip),%xmm5 # 6ed0 <_sk_callback_sse2+0xe41>
+ .byte 102,15,111,53,230,51,0,0 // movdqa 0x33e6(%rip),%xmm6 # 6ee0 <_sk_callback_sse2+0xe51>
.byte 102,15,219,247 // pand %xmm7,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,53,19,52,0,0 // mulps 0x3413(%rip),%xmm6 # 7060 <_sk_callback_sse2+0xe8c>
- .byte 102,15,219,61,27,52,0,0 // pand 0x341b(%rip),%xmm7 # 7070 <_sk_callback_sse2+0xe9c>
+ .byte 15,89,53,232,51,0,0 // mulps 0x33e8(%rip),%xmm6 # 6ef0 <_sk_callback_sse2+0xe61>
+ .byte 102,15,219,61,240,51,0,0 // pand 0x33f0(%rip),%xmm7 # 6f00 <_sk_callback_sse2+0xe71>
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 15,89,61,33,52,0,0 // mulps 0x3421(%rip),%xmm7 # 7080 <_sk_callback_sse2+0xeac>
+ .byte 15,89,61,246,51,0,0 // mulps 0x33f6(%rip),%xmm7 # 6f10 <_sk_callback_sse2+0xe81>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,50 // je 3ca2 <_sk_load_4444_dst_sse2+0xab>
+ .byte 116,50 // je 3b5d <_sk_load_4444_dst_sse2+0xab>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,21 // je 3c8f <_sk_load_4444_dst_sse2+0x98>
+ .byte 116,21 // je 3b4a <_sk_load_4444_dst_sse2+0x98>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,139 // jne 3c0b <_sk_load_4444_dst_sse2+0x14>
+ .byte 117,139 // jne 3ac6 <_sk_load_4444_dst_sse2+0x14>
.byte 65,15,183,68,82,4 // movzwl 0x4(%r10,%rdx,2),%eax
.byte 102,15,110,224 // movd %eax,%xmm4
.byte 102,15,112,252,69 // pshufd $0x45,%xmm4,%xmm7
.byte 102,65,15,110,36,82 // movd (%r10,%rdx,2),%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
.byte 242,15,16,252 // movsd %xmm4,%xmm7
- .byte 233,105,255,255,255 // jmpq 3c0b <_sk_load_4444_dst_sse2+0x14>
+ .byte 233,105,255,255,255 // jmpq 3ac6 <_sk_load_4444_dst_sse2+0x14>
.byte 65,15,183,4,82 // movzwl (%r10,%rdx,2),%eax
.byte 102,15,110,248 // movd %eax,%xmm7
- .byte 233,91,255,255,255 // jmpq 3c0b <_sk_load_4444_dst_sse2+0x14>
+ .byte 233,91,255,255,255 // jmpq 3ac6 <_sk_load_4444_dst_sse2+0x14>
HIDDEN _sk_gather_4444_sse2
.globl _sk_gather_4444_sse2
@@ -39152,7 +38631,7 @@ _sk_gather_4444_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -39177,21 +38656,21 @@ _sk_gather_4444_sse2:
.byte 102,15,196,216,3 // pinsrw $0x3,%eax,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,5,90,51,0,0 // movdqa 0x335a(%rip),%xmm0 # 7090 <_sk_callback_sse2+0xebc>
+ .byte 102,15,111,5,47,51,0,0 // movdqa 0x332f(%rip),%xmm0 # 6f20 <_sk_callback_sse2+0xe91>
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,5,92,51,0,0 // mulps 0x335c(%rip),%xmm0 # 70a0 <_sk_callback_sse2+0xecc>
- .byte 102,15,111,13,100,51,0,0 // movdqa 0x3364(%rip),%xmm1 # 70b0 <_sk_callback_sse2+0xedc>
+ .byte 15,89,5,49,51,0,0 // mulps 0x3331(%rip),%xmm0 # 6f30 <_sk_callback_sse2+0xea1>
+ .byte 102,15,111,13,57,51,0,0 // movdqa 0x3339(%rip),%xmm1 # 6f40 <_sk_callback_sse2+0xeb1>
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,13,102,51,0,0 // mulps 0x3366(%rip),%xmm1 # 70c0 <_sk_callback_sse2+0xeec>
- .byte 102,15,111,21,110,51,0,0 // movdqa 0x336e(%rip),%xmm2 # 70d0 <_sk_callback_sse2+0xefc>
+ .byte 15,89,13,59,51,0,0 // mulps 0x333b(%rip),%xmm1 # 6f50 <_sk_callback_sse2+0xec1>
+ .byte 102,15,111,21,67,51,0,0 // movdqa 0x3343(%rip),%xmm2 # 6f60 <_sk_callback_sse2+0xed1>
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,21,112,51,0,0 // mulps 0x3370(%rip),%xmm2 # 70e0 <_sk_callback_sse2+0xf0c>
- .byte 102,15,219,29,120,51,0,0 // pand 0x3378(%rip),%xmm3 # 70f0 <_sk_callback_sse2+0xf1c>
+ .byte 15,89,21,69,51,0,0 // mulps 0x3345(%rip),%xmm2 # 6f70 <_sk_callback_sse2+0xee1>
+ .byte 102,15,219,29,77,51,0,0 // pand 0x334d(%rip),%xmm3 # 6f80 <_sk_callback_sse2+0xef1>
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,29,126,51,0,0 // mulps 0x337e(%rip),%xmm3 # 7100 <_sk_callback_sse2+0xf2c>
+ .byte 15,89,29,83,51,0,0 // mulps 0x3353(%rip),%xmm3 # 6f90 <_sk_callback_sse2+0xf01>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 91 // pop %rbx
.byte 255,224 // jmpq *%rax
@@ -39202,7 +38681,7 @@ FUNCTION(_sk_store_4444_sse2)
_sk_store_4444_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,16 // mov (%rax),%r10
- .byte 68,15,40,5,124,51,0,0 // movaps 0x337c(%rip),%xmm8 # 7110 <_sk_callback_sse2+0xf3c>
+ .byte 68,15,40,5,81,51,0,0 // movaps 0x3351(%rip),%xmm8 # 6fa0 <_sk_callback_sse2+0xf11>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -39224,7 +38703,7 @@ _sk_store_4444_sse2:
.byte 102,65,15,114,224,16 // psrad $0x10,%xmm8
.byte 102,69,15,107,192 // packssdw %xmm8,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 3e05 <_sk_store_4444_sse2+0x7e>
+ .byte 117,10 // jne 3cc0 <_sk_store_4444_sse2+0x7e>
.byte 242,69,15,17,4,82 // movsd %xmm8,(%r10,%rdx,2)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -39232,19 +38711,19 @@ _sk_store_4444_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,38 // je 3e3d <_sk_store_4444_sse2+0xb6>
+ .byte 116,38 // je 3cf8 <_sk_store_4444_sse2+0xb6>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 3e2f <_sk_store_4444_sse2+0xa8>
+ .byte 116,18 // je 3cea <_sk_store_4444_sse2+0xa8>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,222 // jne 3e01 <_sk_store_4444_sse2+0x7a>
+ .byte 117,222 // jne 3cbc <_sk_store_4444_sse2+0x7a>
.byte 102,65,15,197,192,4 // pextrw $0x4,%xmm8,%eax
.byte 102,65,137,68,82,4 // mov %ax,0x4(%r10,%rdx,2)
.byte 242,69,15,112,192,232 // pshuflw $0xe8,%xmm8,%xmm8
.byte 102,69,15,126,4,82 // movd %xmm8,(%r10,%rdx,2)
- .byte 235,196 // jmp 3e01 <_sk_store_4444_sse2+0x7a>
+ .byte 235,196 // jmp 3cbc <_sk_store_4444_sse2+0x7a>
.byte 102,68,15,126,192 // movd %xmm8,%eax
.byte 102,65,137,4,82 // mov %ax,(%r10,%rdx,2)
- .byte 235,184 // jmp 3e01 <_sk_store_4444_sse2+0x7a>
+ .byte 235,184 // jmp 3cbc <_sk_store_4444_sse2+0x7a>
HIDDEN _sk_load_8888_sse2
.globl _sk_load_8888_sse2
@@ -39253,13 +38732,13 @@ _sk_load_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 3eb5 <_sk_load_8888_sse2+0x6c>
+ .byte 117,98 // jne 3d70 <_sk_load_8888_sse2+0x6c>
.byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9
- .byte 102,15,111,21,191,50,0,0 // movdqa 0x32bf(%rip),%xmm2 # 7120 <_sk_callback_sse2+0xf4c>
+ .byte 102,15,111,21,148,50,0,0 // movdqa 0x3294(%rip),%xmm2 # 6fb0 <_sk_callback_sse2+0xf21>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,187,50,0,0 // movaps 0x32bb(%rip),%xmm8 # 7130 <_sk_callback_sse2+0xf5c>
+ .byte 68,15,40,5,144,50,0,0 // movaps 0x3290(%rip),%xmm8 # 6fc0 <_sk_callback_sse2+0xf31>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -39279,18 +38758,18 @@ _sk_load_8888_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,40 // je 3eea <_sk_load_8888_sse2+0xa1>
+ .byte 116,40 // je 3da5 <_sk_load_8888_sse2+0xa1>
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 3edf <_sk_load_8888_sse2+0x96>
+ .byte 116,18 // je 3d9a <_sk_load_8888_sse2+0x96>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,134 // jne 3e59 <_sk_load_8888_sse2+0x10>
+ .byte 117,134 // jne 3d14 <_sk_load_8888_sse2+0x10>
.byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9
.byte 102,68,15,18,12,144 // movlpd (%rax,%rdx,4),%xmm9
- .byte 233,111,255,255,255 // jmpq 3e59 <_sk_load_8888_sse2+0x10>
+ .byte 233,111,255,255,255 // jmpq 3d14 <_sk_load_8888_sse2+0x10>
.byte 102,68,15,110,12,144 // movd (%rax,%rdx,4),%xmm9
- .byte 233,100,255,255,255 // jmpq 3e59 <_sk_load_8888_sse2+0x10>
+ .byte 233,100,255,255,255 // jmpq 3d14 <_sk_load_8888_sse2+0x10>
HIDDEN _sk_load_8888_dst_sse2
.globl _sk_load_8888_dst_sse2
@@ -39299,13 +38778,13 @@ _sk_load_8888_dst_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 3f61 <_sk_load_8888_dst_sse2+0x6c>
+ .byte 117,98 // jne 3e1c <_sk_load_8888_dst_sse2+0x6c>
.byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9
- .byte 102,15,111,53,51,50,0,0 // movdqa 0x3233(%rip),%xmm6 # 7140 <_sk_callback_sse2+0xf6c>
+ .byte 102,15,111,53,8,50,0,0 // movdqa 0x3208(%rip),%xmm6 # 6fd0 <_sk_callback_sse2+0xf41>
.byte 102,65,15,111,225 // movdqa %xmm9,%xmm4
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 68,15,40,5,47,50,0,0 // movaps 0x322f(%rip),%xmm8 # 7150 <_sk_callback_sse2+0xf7c>
+ .byte 68,15,40,5,4,50,0,0 // movaps 0x3204(%rip),%xmm8 # 6fe0 <_sk_callback_sse2+0xf51>
.byte 65,15,89,224 // mulps %xmm8,%xmm4
.byte 102,65,15,111,233 // movdqa %xmm9,%xmm5
.byte 102,15,114,213,8 // psrld $0x8,%xmm5
@@ -39325,18 +38804,18 @@ _sk_load_8888_dst_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,40 // je 3f96 <_sk_load_8888_dst_sse2+0xa1>
+ .byte 116,40 // je 3e51 <_sk_load_8888_dst_sse2+0xa1>
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 3f8b <_sk_load_8888_dst_sse2+0x96>
+ .byte 116,18 // je 3e46 <_sk_load_8888_dst_sse2+0x96>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,134 // jne 3f05 <_sk_load_8888_dst_sse2+0x10>
+ .byte 117,134 // jne 3dc0 <_sk_load_8888_dst_sse2+0x10>
.byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,68,15,112,204,69 // pshufd $0x45,%xmm4,%xmm9
.byte 102,68,15,18,12,144 // movlpd (%rax,%rdx,4),%xmm9
- .byte 233,111,255,255,255 // jmpq 3f05 <_sk_load_8888_dst_sse2+0x10>
+ .byte 233,111,255,255,255 // jmpq 3dc0 <_sk_load_8888_dst_sse2+0x10>
.byte 102,68,15,110,12,144 // movd (%rax,%rdx,4),%xmm9
- .byte 233,100,255,255,255 // jmpq 3f05 <_sk_load_8888_dst_sse2+0x10>
+ .byte 233,100,255,255,255 // jmpq 3dc0 <_sk_load_8888_dst_sse2+0x10>
HIDDEN _sk_gather_8888_sse2
.globl _sk_gather_8888_sse2
@@ -39346,7 +38825,7 @@ _sk_gather_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -39370,11 +38849,11 @@ _sk_gather_8888_sse2:
.byte 102,67,15,110,12,145 // movd (%r9,%r10,4),%xmm1
.byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9
.byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9
- .byte 102,15,111,21,61,49,0,0 // movdqa 0x313d(%rip),%xmm2 # 7160 <_sk_callback_sse2+0xf8c>
+ .byte 102,15,111,21,18,49,0,0 // movdqa 0x3112(%rip),%xmm2 # 6ff0 <_sk_callback_sse2+0xf61>
.byte 102,65,15,111,193 // movdqa %xmm9,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 68,15,40,5,57,49,0,0 // movaps 0x3139(%rip),%xmm8 # 7170 <_sk_callback_sse2+0xf9c>
+ .byte 68,15,40,5,14,49,0,0 // movaps 0x310e(%rip),%xmm8 # 7000 <_sk_callback_sse2+0xf71>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -39399,7 +38878,7 @@ FUNCTION(_sk_store_8888_sse2)
_sk_store_8888_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,251,48,0,0 // movaps 0x30fb(%rip),%xmm8 # 7180 <_sk_callback_sse2+0xfac>
+ .byte 68,15,40,5,208,48,0,0 // movaps 0x30d0(%rip),%xmm8 # 7010 <_sk_callback_sse2+0xf81>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -39418,35 +38897,35 @@ _sk_store_8888_sse2:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 40e5 <_sk_store_8888_sse2+0x6d>
+ .byte 117,10 // jne 3fa0 <_sk_store_8888_sse2+0x6d>
.byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,33 // je 4113 <_sk_store_8888_sse2+0x9b>
+ .byte 116,33 // je 3fce <_sk_store_8888_sse2+0x9b>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,19 // je 410b <_sk_store_8888_sse2+0x93>
+ .byte 116,19 // je 3fc6 <_sk_store_8888_sse2+0x93>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,227 // jne 40e1 <_sk_store_8888_sse2+0x69>
+ .byte 117,227 // jne 3f9c <_sk_store_8888_sse2+0x69>
.byte 102,69,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm9
.byte 102,68,15,126,76,144,8 // movd %xmm9,0x8(%rax,%rdx,4)
.byte 102,68,15,214,4,144 // movq %xmm8,(%rax,%rdx,4)
- .byte 235,206 // jmp 40e1 <_sk_store_8888_sse2+0x69>
+ .byte 235,206 // jmp 3f9c <_sk_store_8888_sse2+0x69>
.byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
- .byte 235,198 // jmp 40e1 <_sk_store_8888_sse2+0x69>
+ .byte 235,198 // jmp 3f9c <_sk_store_8888_sse2+0x69>
HIDDEN _sk_store_8888_2d_sse2
.globl _sk_store_8888_2d_sse2
FUNCTION(_sk_store_8888_2d_sse2)
_sk_store_8888_2d_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 76,139,72,8 // mov 0x8(%rax),%r9
+ .byte 76,99,72,8 // movslq 0x8(%rax),%r9
.byte 76,15,175,201 // imul %rcx,%r9
.byte 73,193,225,2 // shl $0x2,%r9
.byte 76,3,8 // add (%rax),%r9
- .byte 68,15,40,5,92,48,0,0 // movaps 0x305c(%rip),%xmm8 # 7190 <_sk_callback_sse2+0xfbc>
+ .byte 68,15,40,5,49,48,0,0 // movaps 0x3031(%rip),%xmm8 # 7020 <_sk_callback_sse2+0xf91>
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -39465,24 +38944,24 @@ _sk_store_8888_2d_sse2:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 4194 <_sk_store_8888_2d_sse2+0x79>
+ .byte 117,10 // jne 404f <_sk_store_8888_2d_sse2+0x79>
.byte 243,69,15,127,4,145 // movdqu %xmm8,(%r9,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 68,137,192 // mov %r8d,%eax
.byte 36,3 // and $0x3,%al
.byte 60,1 // cmp $0x1,%al
- .byte 116,29 // je 41ba <_sk_store_8888_2d_sse2+0x9f>
+ .byte 116,29 // je 4075 <_sk_store_8888_2d_sse2+0x9f>
.byte 60,2 // cmp $0x2,%al
- .byte 116,17 // je 41b2 <_sk_store_8888_2d_sse2+0x97>
+ .byte 116,17 // je 406d <_sk_store_8888_2d_sse2+0x97>
.byte 60,3 // cmp $0x3,%al
- .byte 117,235 // jne 4190 <_sk_store_8888_2d_sse2+0x75>
+ .byte 117,235 // jne 404b <_sk_store_8888_2d_sse2+0x75>
.byte 102,69,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm9
.byte 102,69,15,126,76,145,8 // movd %xmm9,0x8(%r9,%rdx,4)
.byte 102,69,15,214,4,145 // movq %xmm8,(%r9,%rdx,4)
- .byte 235,214 // jmp 4190 <_sk_store_8888_2d_sse2+0x75>
+ .byte 235,214 // jmp 404b <_sk_store_8888_2d_sse2+0x75>
.byte 102,69,15,126,4,145 // movd %xmm8,(%r9,%rdx,4)
- .byte 235,206 // jmp 4190 <_sk_store_8888_2d_sse2+0x75>
+ .byte 235,206 // jmp 404b <_sk_store_8888_2d_sse2+0x75>
HIDDEN _sk_load_bgra_sse2
.globl _sk_load_bgra_sse2
@@ -39491,13 +38970,13 @@ _sk_load_bgra_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 422e <_sk_load_bgra_sse2+0x6c>
+ .byte 117,98 // jne 40e9 <_sk_load_bgra_sse2+0x6c>
.byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9
- .byte 102,15,111,5,198,47,0,0 // movdqa 0x2fc6(%rip),%xmm0 # 71a0 <_sk_callback_sse2+0xfcc>
+ .byte 102,15,111,5,155,47,0,0 // movdqa 0x2f9b(%rip),%xmm0 # 7030 <_sk_callback_sse2+0xfa1>
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,219,200 // pand %xmm0,%xmm1
.byte 15,91,209 // cvtdq2ps %xmm1,%xmm2
- .byte 68,15,40,5,194,47,0,0 // movaps 0x2fc2(%rip),%xmm8 # 71b0 <_sk_callback_sse2+0xfdc>
+ .byte 68,15,40,5,151,47,0,0 // movaps 0x2f97(%rip),%xmm8 # 7040 <_sk_callback_sse2+0xfb1>
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -39517,18 +38996,18 @@ _sk_load_bgra_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,40 // je 4263 <_sk_load_bgra_sse2+0xa1>
+ .byte 116,40 // je 411e <_sk_load_bgra_sse2+0xa1>
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 4258 <_sk_load_bgra_sse2+0x96>
+ .byte 116,18 // je 4113 <_sk_load_bgra_sse2+0x96>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,134 // jne 41d2 <_sk_load_bgra_sse2+0x10>
+ .byte 117,134 // jne 408d <_sk_load_bgra_sse2+0x10>
.byte 102,15,110,68,144,8 // movd 0x8(%rax,%rdx,4),%xmm0
.byte 102,68,15,112,200,69 // pshufd $0x45,%xmm0,%xmm9
.byte 102,68,15,18,12,144 // movlpd (%rax,%rdx,4),%xmm9
- .byte 233,111,255,255,255 // jmpq 41d2 <_sk_load_bgra_sse2+0x10>
+ .byte 233,111,255,255,255 // jmpq 408d <_sk_load_bgra_sse2+0x10>
.byte 102,68,15,110,12,144 // movd (%rax,%rdx,4),%xmm9
- .byte 233,100,255,255,255 // jmpq 41d2 <_sk_load_bgra_sse2+0x10>
+ .byte 233,100,255,255,255 // jmpq 408d <_sk_load_bgra_sse2+0x10>
HIDDEN _sk_load_bgra_dst_sse2
.globl _sk_load_bgra_dst_sse2
@@ -39537,13 +39016,13 @@ _sk_load_bgra_dst_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 117,98 // jne 42da <_sk_load_bgra_dst_sse2+0x6c>
+ .byte 117,98 // jne 4195 <_sk_load_bgra_dst_sse2+0x6c>
.byte 243,68,15,111,12,144 // movdqu (%rax,%rdx,4),%xmm9
- .byte 102,15,111,37,58,47,0,0 // movdqa 0x2f3a(%rip),%xmm4 # 71c0 <_sk_callback_sse2+0xfec>
+ .byte 102,15,111,37,15,47,0,0 // movdqa 0x2f0f(%rip),%xmm4 # 7050 <_sk_callback_sse2+0xfc1>
.byte 102,65,15,111,233 // movdqa %xmm9,%xmm5
.byte 102,15,219,236 // pand %xmm4,%xmm5
.byte 15,91,245 // cvtdq2ps %xmm5,%xmm6
- .byte 68,15,40,5,54,47,0,0 // movaps 0x2f36(%rip),%xmm8 # 71d0 <_sk_callback_sse2+0xffc>
+ .byte 68,15,40,5,11,47,0,0 // movaps 0x2f0b(%rip),%xmm8 # 7060 <_sk_callback_sse2+0xfd1>
.byte 65,15,89,240 // mulps %xmm8,%xmm6
.byte 102,65,15,111,233 // movdqa %xmm9,%xmm5
.byte 102,15,114,213,8 // psrld $0x8,%xmm5
@@ -39563,18 +39042,18 @@ _sk_load_bgra_dst_sse2:
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,40 // je 430f <_sk_load_bgra_dst_sse2+0xa1>
+ .byte 116,40 // je 41ca <_sk_load_bgra_dst_sse2+0xa1>
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,18 // je 4304 <_sk_load_bgra_dst_sse2+0x96>
+ .byte 116,18 // je 41bf <_sk_load_bgra_dst_sse2+0x96>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,134 // jne 427e <_sk_load_bgra_dst_sse2+0x10>
+ .byte 117,134 // jne 4139 <_sk_load_bgra_dst_sse2+0x10>
.byte 102,15,110,100,144,8 // movd 0x8(%rax,%rdx,4),%xmm4
.byte 102,68,15,112,204,69 // pshufd $0x45,%xmm4,%xmm9
.byte 102,68,15,18,12,144 // movlpd (%rax,%rdx,4),%xmm9
- .byte 233,111,255,255,255 // jmpq 427e <_sk_load_bgra_dst_sse2+0x10>
+ .byte 233,111,255,255,255 // jmpq 4139 <_sk_load_bgra_dst_sse2+0x10>
.byte 102,68,15,110,12,144 // movd (%rax,%rdx,4),%xmm9
- .byte 233,100,255,255,255 // jmpq 427e <_sk_load_bgra_dst_sse2+0x10>
+ .byte 233,100,255,255,255 // jmpq 4139 <_sk_load_bgra_dst_sse2+0x10>
HIDDEN _sk_gather_bgra_sse2
.globl _sk_gather_bgra_sse2
@@ -39584,7 +39063,7 @@ _sk_gather_bgra_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -39608,11 +39087,11 @@ _sk_gather_bgra_sse2:
.byte 102,67,15,110,12,145 // movd (%r9,%r10,4),%xmm1
.byte 102,68,15,98,201 // punpckldq %xmm1,%xmm9
.byte 102,68,15,98,200 // punpckldq %xmm0,%xmm9
- .byte 102,15,111,5,68,46,0,0 // movdqa 0x2e44(%rip),%xmm0 # 71e0 <_sk_callback_sse2+0x100c>
+ .byte 102,15,111,5,25,46,0,0 // movdqa 0x2e19(%rip),%xmm0 # 7070 <_sk_callback_sse2+0xfe1>
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,219,200 // pand %xmm0,%xmm1
.byte 15,91,209 // cvtdq2ps %xmm1,%xmm2
- .byte 68,15,40,5,64,46,0,0 // movaps 0x2e40(%rip),%xmm8 # 71f0 <_sk_callback_sse2+0x101c>
+ .byte 68,15,40,5,21,46,0,0 // movaps 0x2e15(%rip),%xmm8 # 7080 <_sk_callback_sse2+0xff1>
.byte 65,15,89,208 // mulps %xmm8,%xmm2
.byte 102,65,15,111,201 // movdqa %xmm9,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -39637,7 +39116,7 @@ FUNCTION(_sk_store_bgra_sse2)
_sk_store_bgra_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 68,15,40,5,2,46,0,0 // movaps 0x2e02(%rip),%xmm8 # 7200 <_sk_callback_sse2+0x102c>
+ .byte 68,15,40,5,215,45,0,0 // movaps 0x2dd7(%rip),%xmm8 # 7090 <_sk_callback_sse2+0x1001>
.byte 68,15,40,202 // movaps %xmm2,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 102,69,15,91,201 // cvtps2dq %xmm9,%xmm9
@@ -39656,24 +39135,24 @@ _sk_store_bgra_sse2:
.byte 102,69,15,235,193 // por %xmm9,%xmm8
.byte 102,69,15,235,194 // por %xmm10,%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,10 // jne 445e <_sk_store_bgra_sse2+0x6d>
+ .byte 117,10 // jne 4319 <_sk_store_bgra_sse2+0x6d>
.byte 243,68,15,127,4,144 // movdqu %xmm8,(%rax,%rdx,4)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 69,137,193 // mov %r8d,%r9d
.byte 65,128,225,3 // and $0x3,%r9b
.byte 65,128,249,1 // cmp $0x1,%r9b
- .byte 116,33 // je 448c <_sk_store_bgra_sse2+0x9b>
+ .byte 116,33 // je 4347 <_sk_store_bgra_sse2+0x9b>
.byte 65,128,249,2 // cmp $0x2,%r9b
- .byte 116,19 // je 4484 <_sk_store_bgra_sse2+0x93>
+ .byte 116,19 // je 433f <_sk_store_bgra_sse2+0x93>
.byte 65,128,249,3 // cmp $0x3,%r9b
- .byte 117,227 // jne 445a <_sk_store_bgra_sse2+0x69>
+ .byte 117,227 // jne 4315 <_sk_store_bgra_sse2+0x69>
.byte 102,69,15,112,200,78 // pshufd $0x4e,%xmm8,%xmm9
.byte 102,68,15,126,76,144,8 // movd %xmm9,0x8(%rax,%rdx,4)
.byte 102,68,15,214,4,144 // movq %xmm8,(%rax,%rdx,4)
- .byte 235,206 // jmp 445a <_sk_store_bgra_sse2+0x69>
+ .byte 235,206 // jmp 4315 <_sk_store_bgra_sse2+0x69>
.byte 102,68,15,126,4,144 // movd %xmm8,(%rax,%rdx,4)
- .byte 235,198 // jmp 445a <_sk_store_bgra_sse2+0x69>
+ .byte 235,198 // jmp 4315 <_sk_store_bgra_sse2+0x69>
HIDDEN _sk_load_f16_sse2
.globl _sk_load_f16_sse2
@@ -39682,7 +39161,7 @@ _sk_load_f16_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,96,1,0,0 // jne 4602 <_sk_load_f16_sse2+0x16e>
+ .byte 15,133,96,1,0,0 // jne 44bd <_sk_load_f16_sse2+0x16e>
.byte 102,15,16,4,208 // movupd (%rax,%rdx,8),%xmm0
.byte 102,15,16,76,208,16 // movupd 0x10(%rax,%rdx,8),%xmm1
.byte 102,68,15,40,192 // movapd %xmm0,%xmm8
@@ -39694,7 +39173,7 @@ _sk_load_f16_sse2:
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
.byte 102,65,15,111,206 // movdqa %xmm14,%xmm1
.byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1
- .byte 102,68,15,111,13,46,45,0,0 // movdqa 0x2d2e(%rip),%xmm9 # 7210 <_sk_callback_sse2+0x103c>
+ .byte 102,68,15,111,13,3,45,0,0 // movdqa 0x2d03(%rip),%xmm9 # 70a0 <_sk_callback_sse2+0x1011>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,193 // pand %xmm9,%xmm0
.byte 102,15,239,200 // pxor %xmm0,%xmm1
@@ -39702,11 +39181,11 @@ _sk_load_f16_sse2:
.byte 102,68,15,111,233 // movdqa %xmm1,%xmm13
.byte 102,65,15,114,245,13 // pslld $0xd,%xmm13
.byte 102,68,15,235,232 // por %xmm0,%xmm13
- .byte 102,68,15,111,29,19,45,0,0 // movdqa 0x2d13(%rip),%xmm11 # 7220 <_sk_callback_sse2+0x104c>
+ .byte 102,68,15,111,29,232,44,0,0 // movdqa 0x2ce8(%rip),%xmm11 # 70b0 <_sk_callback_sse2+0x1021>
.byte 102,69,15,254,235 // paddd %xmm11,%xmm13
- .byte 102,68,15,111,37,21,45,0,0 // movdqa 0x2d15(%rip),%xmm12 # 7230 <_sk_callback_sse2+0x105c>
+ .byte 102,68,15,111,37,234,44,0,0 // movdqa 0x2cea(%rip),%xmm12 # 70c0 <_sk_callback_sse2+0x1031>
.byte 102,65,15,239,204 // pxor %xmm12,%xmm1
- .byte 102,15,111,29,24,45,0,0 // movdqa 0x2d18(%rip),%xmm3 # 7240 <_sk_callback_sse2+0x106c>
+ .byte 102,15,111,29,237,44,0,0 // movdqa 0x2ced(%rip),%xmm3 # 70d0 <_sk_callback_sse2+0x1041>
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
.byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0
.byte 102,65,15,223,197 // pandn %xmm13,%xmm0
@@ -39754,17 +39233,17 @@ _sk_load_f16_sse2:
.byte 255,224 // jmpq *%rax
.byte 242,15,16,4,208 // movsd (%rax,%rdx,8),%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,17 // jne 461e <_sk_load_f16_sse2+0x18a>
+ .byte 117,17 // jne 44d9 <_sk_load_f16_sse2+0x18a>
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 102,15,20,193 // unpcklpd %xmm1,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 233,143,254,255,255 // jmpq 44ad <_sk_load_f16_sse2+0x19>
+ .byte 233,143,254,255,255 // jmpq 4368 <_sk_load_f16_sse2+0x19>
.byte 102,15,22,68,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,123,254,255,255 // jb 44ad <_sk_load_f16_sse2+0x19>
+ .byte 15,130,123,254,255,255 // jb 4368 <_sk_load_f16_sse2+0x19>
.byte 242,15,16,76,208,16 // movsd 0x10(%rax,%rdx,8),%xmm1
- .byte 233,112,254,255,255 // jmpq 44ad <_sk_load_f16_sse2+0x19>
+ .byte 233,112,254,255,255 // jmpq 4368 <_sk_load_f16_sse2+0x19>
HIDDEN _sk_load_f16_dst_sse2
.globl _sk_load_f16_dst_sse2
@@ -39773,7 +39252,7 @@ _sk_load_f16_dst_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,96,1,0,0 // jne 47ab <_sk_load_f16_dst_sse2+0x16e>
+ .byte 15,133,96,1,0,0 // jne 4666 <_sk_load_f16_dst_sse2+0x16e>
.byte 102,15,16,36,208 // movupd (%rax,%rdx,8),%xmm4
.byte 102,15,16,108,208,16 // movupd 0x10(%rax,%rdx,8),%xmm5
.byte 102,68,15,40,196 // movapd %xmm4,%xmm8
@@ -39785,7 +39264,7 @@ _sk_load_f16_dst_sse2:
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
.byte 102,65,15,111,238 // movdqa %xmm14,%xmm5
.byte 102,65,15,97,234 // punpcklwd %xmm10,%xmm5
- .byte 102,68,15,111,13,197,43,0,0 // movdqa 0x2bc5(%rip),%xmm9 # 7250 <_sk_callback_sse2+0x107c>
+ .byte 102,68,15,111,13,154,43,0,0 // movdqa 0x2b9a(%rip),%xmm9 # 70e0 <_sk_callback_sse2+0x1051>
.byte 102,15,111,229 // movdqa %xmm5,%xmm4
.byte 102,65,15,219,225 // pand %xmm9,%xmm4
.byte 102,15,239,236 // pxor %xmm4,%xmm5
@@ -39793,11 +39272,11 @@ _sk_load_f16_dst_sse2:
.byte 102,68,15,111,237 // movdqa %xmm5,%xmm13
.byte 102,65,15,114,245,13 // pslld $0xd,%xmm13
.byte 102,68,15,235,236 // por %xmm4,%xmm13
- .byte 102,68,15,111,29,170,43,0,0 // movdqa 0x2baa(%rip),%xmm11 # 7260 <_sk_callback_sse2+0x108c>
+ .byte 102,68,15,111,29,127,43,0,0 // movdqa 0x2b7f(%rip),%xmm11 # 70f0 <_sk_callback_sse2+0x1061>
.byte 102,69,15,254,235 // paddd %xmm11,%xmm13
- .byte 102,68,15,111,37,172,43,0,0 // movdqa 0x2bac(%rip),%xmm12 # 7270 <_sk_callback_sse2+0x109c>
+ .byte 102,68,15,111,37,129,43,0,0 // movdqa 0x2b81(%rip),%xmm12 # 7100 <_sk_callback_sse2+0x1071>
.byte 102,65,15,239,236 // pxor %xmm12,%xmm5
- .byte 102,15,111,61,175,43,0,0 // movdqa 0x2baf(%rip),%xmm7 # 7280 <_sk_callback_sse2+0x10ac>
+ .byte 102,15,111,61,132,43,0,0 // movdqa 0x2b84(%rip),%xmm7 # 7110 <_sk_callback_sse2+0x1081>
.byte 102,15,111,231 // movdqa %xmm7,%xmm4
.byte 102,15,102,229 // pcmpgtd %xmm5,%xmm4
.byte 102,65,15,223,229 // pandn %xmm13,%xmm4
@@ -39845,17 +39324,17 @@ _sk_load_f16_dst_sse2:
.byte 255,224 // jmpq *%rax
.byte 242,15,16,36,208 // movsd (%rax,%rdx,8),%xmm4
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,17 // jne 47c7 <_sk_load_f16_dst_sse2+0x18a>
+ .byte 117,17 // jne 4682 <_sk_load_f16_dst_sse2+0x18a>
.byte 102,15,87,237 // xorpd %xmm5,%xmm5
.byte 102,15,20,229 // unpcklpd %xmm5,%xmm4
.byte 102,15,87,237 // xorpd %xmm5,%xmm5
- .byte 233,143,254,255,255 // jmpq 4656 <_sk_load_f16_dst_sse2+0x19>
+ .byte 233,143,254,255,255 // jmpq 4511 <_sk_load_f16_dst_sse2+0x19>
.byte 102,15,22,100,208,8 // movhpd 0x8(%rax,%rdx,8),%xmm4
.byte 102,15,87,237 // xorpd %xmm5,%xmm5
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,123,254,255,255 // jb 4656 <_sk_load_f16_dst_sse2+0x19>
+ .byte 15,130,123,254,255,255 // jb 4511 <_sk_load_f16_dst_sse2+0x19>
.byte 242,15,16,108,208,16 // movsd 0x10(%rax,%rdx,8),%xmm5
- .byte 233,112,254,255,255 // jmpq 4656 <_sk_load_f16_dst_sse2+0x19>
+ .byte 233,112,254,255,255 // jmpq 4511 <_sk_load_f16_dst_sse2+0x19>
HIDDEN _sk_gather_f16_sse2
.globl _sk_gather_f16_sse2
@@ -39865,7 +39344,7 @@ _sk_gather_f16_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,80,16 // movd 0x10(%rax),%xmm2
+ .byte 102,15,110,80,8 // movd 0x8(%rax),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -39897,7 +39376,7 @@ _sk_gather_f16_sse2:
.byte 102,69,15,239,210 // pxor %xmm10,%xmm10
.byte 102,65,15,111,206 // movdqa %xmm14,%xmm1
.byte 102,65,15,97,202 // punpcklwd %xmm10,%xmm1
- .byte 102,68,15,111,13,1,42,0,0 // movdqa 0x2a01(%rip),%xmm9 # 7290 <_sk_callback_sse2+0x10bc>
+ .byte 102,68,15,111,13,214,41,0,0 // movdqa 0x29d6(%rip),%xmm9 # 7120 <_sk_callback_sse2+0x1091>
.byte 102,15,111,193 // movdqa %xmm1,%xmm0
.byte 102,65,15,219,193 // pand %xmm9,%xmm0
.byte 102,15,239,200 // pxor %xmm0,%xmm1
@@ -39905,11 +39384,11 @@ _sk_gather_f16_sse2:
.byte 102,68,15,111,233 // movdqa %xmm1,%xmm13
.byte 102,65,15,114,245,13 // pslld $0xd,%xmm13
.byte 102,68,15,235,232 // por %xmm0,%xmm13
- .byte 102,68,15,111,29,230,41,0,0 // movdqa 0x29e6(%rip),%xmm11 # 72a0 <_sk_callback_sse2+0x10cc>
+ .byte 102,68,15,111,29,187,41,0,0 // movdqa 0x29bb(%rip),%xmm11 # 7130 <_sk_callback_sse2+0x10a1>
.byte 102,69,15,254,235 // paddd %xmm11,%xmm13
- .byte 102,68,15,111,37,232,41,0,0 // movdqa 0x29e8(%rip),%xmm12 # 72b0 <_sk_callback_sse2+0x10dc>
+ .byte 102,68,15,111,37,189,41,0,0 // movdqa 0x29bd(%rip),%xmm12 # 7140 <_sk_callback_sse2+0x10b1>
.byte 102,65,15,239,204 // pxor %xmm12,%xmm1
- .byte 102,15,111,29,235,41,0,0 // movdqa 0x29eb(%rip),%xmm3 # 72c0 <_sk_callback_sse2+0x10ec>
+ .byte 102,15,111,29,192,41,0,0 // movdqa 0x29c0(%rip),%xmm3 # 7150 <_sk_callback_sse2+0x10c1>
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
.byte 102,15,102,193 // pcmpgtd %xmm1,%xmm0
.byte 102,65,15,223,197 // pandn %xmm13,%xmm0
@@ -39963,17 +39442,17 @@ FUNCTION(_sk_store_f16_sse2)
_sk_store_f16_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 72,139,0 // mov (%rax),%rax
- .byte 102,68,15,111,21,18,41,0,0 // movdqa 0x2912(%rip),%xmm10 # 72d0 <_sk_callback_sse2+0x10fc>
+ .byte 102,68,15,111,21,231,40,0,0 // movdqa 0x28e7(%rip),%xmm10 # 7160 <_sk_callback_sse2+0x10d1>
.byte 102,68,15,111,224 // movdqa %xmm0,%xmm12
.byte 102,69,15,219,226 // pand %xmm10,%xmm12
.byte 102,68,15,111,232 // movdqa %xmm0,%xmm13
.byte 102,69,15,239,236 // pxor %xmm12,%xmm13
- .byte 102,68,15,111,13,5,41,0,0 // movdqa 0x2905(%rip),%xmm9 # 72e0 <_sk_callback_sse2+0x110c>
+ .byte 102,68,15,111,13,218,40,0,0 // movdqa 0x28da(%rip),%xmm9 # 7170 <_sk_callback_sse2+0x10e1>
.byte 102,65,15,114,212,16 // psrld $0x10,%xmm12
.byte 102,69,15,111,193 // movdqa %xmm9,%xmm8
.byte 102,69,15,102,197 // pcmpgtd %xmm13,%xmm8
.byte 102,65,15,114,213,13 // psrld $0xd,%xmm13
- .byte 102,68,15,111,29,246,40,0,0 // movdqa 0x28f6(%rip),%xmm11 # 72f0 <_sk_callback_sse2+0x111c>
+ .byte 102,68,15,111,29,203,40,0,0 // movdqa 0x28cb(%rip),%xmm11 # 7180 <_sk_callback_sse2+0x10f1>
.byte 102,69,15,235,227 // por %xmm11,%xmm12
.byte 102,69,15,254,229 // paddd %xmm13,%xmm12
.byte 102,65,15,114,244,16 // pslld $0x10,%xmm12
@@ -40025,7 +39504,7 @@ _sk_store_f16_sse2:
.byte 102,69,15,111,200 // movdqa %xmm8,%xmm9
.byte 102,69,15,98,204 // punpckldq %xmm12,%xmm9
.byte 77,133,192 // test %r8,%r8
- .byte 117,21 // jne 4b1c <_sk_store_f16_sse2+0x16c>
+ .byte 117,21 // jne 49d7 <_sk_store_f16_sse2+0x16c>
.byte 68,15,17,12,208 // movups %xmm9,(%rax,%rdx,8)
.byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8
.byte 243,68,15,127,68,208,16 // movdqu %xmm8,0x10(%rax,%rdx,8)
@@ -40033,13 +39512,13 @@ _sk_store_f16_sse2:
.byte 255,224 // jmpq *%rax
.byte 102,68,15,214,12,208 // movq %xmm9,(%rax,%rdx,8)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 4b18 <_sk_store_f16_sse2+0x168>
+ .byte 116,240 // je 49d3 <_sk_store_f16_sse2+0x168>
.byte 102,68,15,23,76,208,8 // movhpd %xmm9,0x8(%rax,%rdx,8)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 4b18 <_sk_store_f16_sse2+0x168>
+ .byte 114,227 // jb 49d3 <_sk_store_f16_sse2+0x168>
.byte 102,69,15,106,196 // punpckhdq %xmm12,%xmm8
.byte 102,68,15,214,68,208,16 // movq %xmm8,0x10(%rax,%rdx,8)
- .byte 235,213 // jmp 4b18 <_sk_store_f16_sse2+0x168>
+ .byte 235,213 // jmp 49d3 <_sk_store_f16_sse2+0x168>
HIDDEN _sk_load_u16_be_sse2
.globl _sk_load_u16_be_sse2
@@ -40049,7 +39528,7 @@ _sk_load_u16_be_sse2:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,190,0,0,0 // jne 4c17 <_sk_load_u16_be_sse2+0xd4>
+ .byte 15,133,190,0,0,0 // jne 4ad2 <_sk_load_u16_be_sse2+0xd4>
.byte 102,65,15,16,4,65 // movupd (%r9,%rax,2),%xmm0
.byte 102,65,15,16,76,65,16 // movupd 0x10(%r9,%rax,2),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
@@ -40066,7 +39545,7 @@ _sk_load_u16_be_sse2:
.byte 102,69,15,239,201 // pxor %xmm9,%xmm9
.byte 102,65,15,97,201 // punpcklwd %xmm9,%xmm1
.byte 15,91,193 // cvtdq2ps %xmm1,%xmm0
- .byte 68,15,40,5,86,39,0,0 // movaps 0x2756(%rip),%xmm8 # 7300 <_sk_callback_sse2+0x112c>
+ .byte 68,15,40,5,43,39,0,0 // movaps 0x272b(%rip),%xmm8 # 7190 <_sk_callback_sse2+0x1101>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -40094,17 +39573,17 @@ _sk_load_u16_be_sse2:
.byte 255,224 // jmpq *%rax
.byte 242,65,15,16,4,65 // movsd (%r9,%rax,2),%xmm0
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,17 // jne 4c34 <_sk_load_u16_be_sse2+0xf1>
+ .byte 117,17 // jne 4aef <_sk_load_u16_be_sse2+0xf1>
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 102,15,20,193 // unpcklpd %xmm1,%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
- .byte 233,50,255,255,255 // jmpq 4b66 <_sk_load_u16_be_sse2+0x23>
+ .byte 233,50,255,255,255 // jmpq 4a21 <_sk_load_u16_be_sse2+0x23>
.byte 102,65,15,22,68,65,8 // movhpd 0x8(%r9,%rax,2),%xmm0
.byte 102,15,87,201 // xorpd %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 15,130,29,255,255,255 // jb 4b66 <_sk_load_u16_be_sse2+0x23>
+ .byte 15,130,29,255,255,255 // jb 4a21 <_sk_load_u16_be_sse2+0x23>
.byte 242,65,15,16,76,65,16 // movsd 0x10(%r9,%rax,2),%xmm1
- .byte 233,17,255,255,255 // jmpq 4b66 <_sk_load_u16_be_sse2+0x23>
+ .byte 233,17,255,255,255 // jmpq 4a21 <_sk_load_u16_be_sse2+0x23>
HIDDEN _sk_load_rgb_u16_be_sse2
.globl _sk_load_rgb_u16_be_sse2
@@ -40114,7 +39593,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,82 // lea (%rdx,%rdx,2),%rax
.byte 77,133,192 // test %r8,%r8
- .byte 15,133,175,0,0,0 // jne 4d16 <_sk_load_rgb_u16_be_sse2+0xc1>
+ .byte 15,133,175,0,0,0 // jne 4bd1 <_sk_load_rgb_u16_be_sse2+0xc1>
.byte 243,65,15,111,20,65 // movdqu (%r9,%rax,2),%xmm2
.byte 243,65,15,111,92,65,8 // movdqu 0x8(%r9,%rax,2),%xmm3
.byte 102,15,115,219,4 // psrldq $0x4,%xmm3
@@ -40135,7 +39614,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 102,69,15,239,192 // pxor %xmm8,%xmm8
.byte 102,65,15,97,200 // punpcklwd %xmm8,%xmm1
.byte 15,91,193 // cvtdq2ps %xmm1,%xmm0
- .byte 68,15,40,13,69,38,0,0 // movaps 0x2645(%rip),%xmm9 # 7310 <_sk_callback_sse2+0x113c>
+ .byte 68,15,40,13,26,38,0,0 // movaps 0x261a(%rip),%xmm9 # 71a0 <_sk_callback_sse2+0x1111>
.byte 65,15,89,193 // mulps %xmm9,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -40152,27 +39631,27 @@ _sk_load_rgb_u16_be_sse2:
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
.byte 65,15,89,209 // mulps %xmm9,%xmm2
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 15,40,29,12,38,0,0 // movaps 0x260c(%rip),%xmm3 # 7320 <_sk_callback_sse2+0x114c>
+ .byte 15,40,29,225,37,0,0 // movaps 0x25e1(%rip),%xmm3 # 71b0 <_sk_callback_sse2+0x1121>
.byte 255,224 // jmpq *%rax
.byte 102,65,15,110,20,65 // movd (%r9,%rax,2),%xmm2
.byte 102,65,15,196,84,65,4,2 // pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,13 // jne 4d3b <_sk_load_rgb_u16_be_sse2+0xe6>
+ .byte 117,13 // jne 4bf6 <_sk_load_rgb_u16_be_sse2+0xe6>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,80,255,255,255 // jmpq 4c8b <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 233,80,255,255,255 // jmpq 4b46 <_sk_load_rgb_u16_be_sse2+0x36>
.byte 102,65,15,110,68,65,6 // movd 0x6(%r9,%rax,2),%xmm0
.byte 102,65,15,196,68,65,10,2 // pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,24 // jb 4d6c <_sk_load_rgb_u16_be_sse2+0x117>
+ .byte 114,24 // jb 4c27 <_sk_load_rgb_u16_be_sse2+0x117>
.byte 102,65,15,110,92,65,12 // movd 0xc(%r9,%rax,2),%xmm3
.byte 102,65,15,196,92,65,16,2 // pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 233,31,255,255,255 // jmpq 4c8b <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 233,31,255,255,255 // jmpq 4b46 <_sk_load_rgb_u16_be_sse2+0x36>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
- .byte 233,22,255,255,255 // jmpq 4c8b <_sk_load_rgb_u16_be_sse2+0x36>
+ .byte 233,22,255,255,255 // jmpq 4b46 <_sk_load_rgb_u16_be_sse2+0x36>
HIDDEN _sk_store_u16_be_sse2
.globl _sk_store_u16_be_sse2
@@ -40181,7 +39660,7 @@ _sk_store_u16_be_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 76,139,8 // mov (%rax),%r9
.byte 72,141,4,149,0,0,0,0 // lea 0x0(,%rdx,4),%rax
- .byte 68,15,40,21,166,37,0,0 // movaps 0x25a6(%rip),%xmm10 # 7330 <_sk_callback_sse2+0x115c>
+ .byte 68,15,40,21,123,37,0,0 // movaps 0x257b(%rip),%xmm10 # 71c0 <_sk_callback_sse2+0x1131>
.byte 68,15,40,192 // movaps %xmm0,%xmm8
.byte 69,15,89,194 // mulps %xmm10,%xmm8
.byte 102,69,15,91,192 // cvtps2dq %xmm8,%xmm8
@@ -40226,7 +39705,7 @@ _sk_store_u16_be_sse2:
.byte 102,69,15,111,208 // movdqa %xmm8,%xmm10
.byte 102,69,15,98,209 // punpckldq %xmm9,%xmm10
.byte 77,133,192 // test %r8,%r8
- .byte 117,21 // jne 4e84 <_sk_store_u16_be_sse2+0x10f>
+ .byte 117,21 // jne 4d3f <_sk_store_u16_be_sse2+0x10f>
.byte 69,15,17,20,65 // movups %xmm10,(%r9,%rax,2)
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
.byte 243,69,15,127,68,65,16 // movdqu %xmm8,0x10(%r9,%rax,2)
@@ -40234,13 +39713,13 @@ _sk_store_u16_be_sse2:
.byte 255,224 // jmpq *%rax
.byte 102,69,15,214,20,65 // movq %xmm10,(%r9,%rax,2)
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,240 // je 4e80 <_sk_store_u16_be_sse2+0x10b>
+ .byte 116,240 // je 4d3b <_sk_store_u16_be_sse2+0x10b>
.byte 102,69,15,23,84,65,8 // movhpd %xmm10,0x8(%r9,%rax,2)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,227 // jb 4e80 <_sk_store_u16_be_sse2+0x10b>
+ .byte 114,227 // jb 4d3b <_sk_store_u16_be_sse2+0x10b>
.byte 102,69,15,106,193 // punpckhdq %xmm9,%xmm8
.byte 102,69,15,214,68,65,16 // movq %xmm8,0x10(%r9,%rax,2)
- .byte 235,213 // jmp 4e80 <_sk_store_u16_be_sse2+0x10b>
+ .byte 235,213 // jmp 4d3b <_sk_store_u16_be_sse2+0x10b>
HIDDEN _sk_load_f32_sse2
.globl _sk_load_f32_sse2
@@ -40253,7 +39732,7 @@ _sk_load_f32_sse2:
.byte 72,193,224,4 // shl $0x4,%rax
.byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,66 // jne 4f0b <_sk_load_f32_sse2+0x60>
+ .byte 117,66 // jne 4dc6 <_sk_load_f32_sse2+0x60>
.byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
.byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
.byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
@@ -40273,17 +39752,17 @@ _sk_load_f32_sse2:
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,8 // jne 4f1d <_sk_load_f32_sse2+0x72>
+ .byte 117,8 // jne 4dd8 <_sk_load_f32_sse2+0x72>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
- .byte 235,190 // jmp 4edb <_sk_load_f32_sse2+0x30>
+ .byte 235,190 // jmp 4d96 <_sk_load_f32_sse2+0x30>
.byte 67,15,16,68,138,16 // movups 0x10(%r10,%r9,4),%xmm0
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,8 // jb 4f31 <_sk_load_f32_sse2+0x86>
+ .byte 114,8 // jb 4dec <_sk_load_f32_sse2+0x86>
.byte 67,15,16,92,138,32 // movups 0x20(%r10,%r9,4),%xmm3
- .byte 235,170 // jmp 4edb <_sk_load_f32_sse2+0x30>
+ .byte 235,170 // jmp 4d96 <_sk_load_f32_sse2+0x30>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 235,165 // jmp 4edb <_sk_load_f32_sse2+0x30>
+ .byte 235,165 // jmp 4d96 <_sk_load_f32_sse2+0x30>
HIDDEN _sk_load_f32_dst_sse2
.globl _sk_load_f32_dst_sse2
@@ -40296,7 +39775,7 @@ _sk_load_f32_dst_sse2:
.byte 72,193,224,4 // shl $0x4,%rax
.byte 69,15,16,4,2 // movups (%r10,%rax,1),%xmm8
.byte 77,133,192 // test %r8,%r8
- .byte 117,66 // jne 4f96 <_sk_load_f32_dst_sse2+0x60>
+ .byte 117,66 // jne 4e51 <_sk_load_f32_dst_sse2+0x60>
.byte 67,15,16,100,138,16 // movups 0x10(%r10,%r9,4),%xmm4
.byte 67,15,16,124,138,32 // movups 0x20(%r10,%r9,4),%xmm7
.byte 71,15,16,76,138,48 // movups 0x30(%r10,%r9,4),%xmm9
@@ -40316,17 +39795,17 @@ _sk_load_f32_dst_sse2:
.byte 255,224 // jmpq *%rax
.byte 69,15,87,201 // xorps %xmm9,%xmm9
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 117,8 // jne 4fa8 <_sk_load_f32_dst_sse2+0x72>
+ .byte 117,8 // jne 4e63 <_sk_load_f32_dst_sse2+0x72>
.byte 15,87,255 // xorps %xmm7,%xmm7
.byte 15,87,228 // xorps %xmm4,%xmm4
- .byte 235,190 // jmp 4f66 <_sk_load_f32_dst_sse2+0x30>
+ .byte 235,190 // jmp 4e21 <_sk_load_f32_dst_sse2+0x30>
.byte 67,15,16,100,138,16 // movups 0x10(%r10,%r9,4),%xmm4
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,8 // jb 4fbc <_sk_load_f32_dst_sse2+0x86>
+ .byte 114,8 // jb 4e77 <_sk_load_f32_dst_sse2+0x86>
.byte 67,15,16,124,138,32 // movups 0x20(%r10,%r9,4),%xmm7
- .byte 235,170 // jmp 4f66 <_sk_load_f32_dst_sse2+0x30>
+ .byte 235,170 // jmp 4e21 <_sk_load_f32_dst_sse2+0x30>
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 235,165 // jmp 4f66 <_sk_load_f32_dst_sse2+0x30>
+ .byte 235,165 // jmp 4e21 <_sk_load_f32_dst_sse2+0x30>
HIDDEN _sk_store_f32_sse2
.globl _sk_store_f32_sse2
@@ -40352,7 +39831,7 @@ _sk_store_f32_sse2:
.byte 102,69,15,20,203 // unpcklpd %xmm11,%xmm9
.byte 102,69,15,17,36,2 // movupd %xmm12,(%r10,%rax,1)
.byte 77,133,192 // test %r8,%r8
- .byte 117,29 // jne 5033 <_sk_store_f32_sse2+0x72>
+ .byte 117,29 // jne 4eee <_sk_store_f32_sse2+0x72>
.byte 102,69,15,21,211 // unpckhpd %xmm11,%xmm10
.byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
.byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
@@ -40360,12 +39839,12 @@ _sk_store_f32_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
.byte 73,131,248,1 // cmp $0x1,%r8
- .byte 116,246 // je 502f <_sk_store_f32_sse2+0x6e>
+ .byte 116,246 // je 4eea <_sk_store_f32_sse2+0x6e>
.byte 71,15,17,68,138,16 // movups %xmm8,0x10(%r10,%r9,4)
.byte 73,131,248,3 // cmp $0x3,%r8
- .byte 114,234 // jb 502f <_sk_store_f32_sse2+0x6e>
+ .byte 114,234 // jb 4eea <_sk_store_f32_sse2+0x6e>
.byte 102,71,15,17,76,138,32 // movupd %xmm9,0x20(%r10,%r9,4)
- .byte 235,225 // jmp 502f <_sk_store_f32_sse2+0x6e>
+ .byte 235,225 // jmp 4eea <_sk_store_f32_sse2+0x6e>
HIDDEN _sk_clamp_x_sse2
.globl _sk_clamp_x_sse2
@@ -40411,7 +39890,7 @@ _sk_repeat_x_sse2:
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,116,34,0,0 // andps 0x2274(%rip),%xmm9 # 7340 <_sk_callback_sse2+0x116c>
+ .byte 68,15,84,13,73,34,0,0 // andps 0x2249(%rip),%xmm9 # 71d0 <_sk_callback_sse2+0x1141>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 69,15,89,208 // mulps %xmm8,%xmm10
@@ -40434,7 +39913,7 @@ _sk_repeat_y_sse2:
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,53,34,0,0 // andps 0x2235(%rip),%xmm9 # 7350 <_sk_callback_sse2+0x117c>
+ .byte 68,15,84,13,10,34,0,0 // andps 0x220a(%rip),%xmm9 # 71e0 <_sk_callback_sse2+0x1151>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 69,15,89,208 // mulps %xmm8,%xmm10
@@ -40457,13 +39936,13 @@ _sk_mirror_x_sse2:
.byte 65,15,92,192 // subps %xmm8,%xmm0
.byte 243,69,15,88,201 // addss %xmm9,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
- .byte 243,68,15,89,21,165,38,0,0 // mulss 0x26a5(%rip),%xmm10 # 7810 <_sk_callback_sse2+0x163c>
+ .byte 243,68,15,89,21,122,38,0,0 // mulss 0x267a(%rip),%xmm10 # 76a0 <_sk_callback_sse2+0x1611>
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 68,15,89,208 // mulps %xmm0,%xmm10
.byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11
.byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11
.byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10
- .byte 68,15,84,21,214,33,0,0 // andps 0x21d6(%rip),%xmm10 # 7360 <_sk_callback_sse2+0x118c>
+ .byte 68,15,84,21,171,33,0,0 // andps 0x21ab(%rip),%xmm10 # 71f0 <_sk_callback_sse2+0x1161>
.byte 69,15,87,228 // xorps %xmm12,%xmm12
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 69,15,89,217 // mulps %xmm9,%xmm11
@@ -40489,13 +39968,13 @@ _sk_mirror_y_sse2:
.byte 65,15,92,200 // subps %xmm8,%xmm1
.byte 243,69,15,88,201 // addss %xmm9,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
- .byte 243,68,15,89,21,47,38,0,0 // mulss 0x262f(%rip),%xmm10 # 7814 <_sk_callback_sse2+0x1640>
+ .byte 243,68,15,89,21,4,38,0,0 // mulss 0x2604(%rip),%xmm10 # 76a4 <_sk_callback_sse2+0x1615>
.byte 69,15,198,210,0 // shufps $0x0,%xmm10,%xmm10
.byte 68,15,89,209 // mulps %xmm1,%xmm10
.byte 243,69,15,91,218 // cvttps2dq %xmm10,%xmm11
.byte 69,15,91,219 // cvtdq2ps %xmm11,%xmm11
.byte 69,15,194,211,1 // cmpltps %xmm11,%xmm10
- .byte 68,15,84,21,108,33,0,0 // andps 0x216c(%rip),%xmm10 # 7370 <_sk_callback_sse2+0x119c>
+ .byte 68,15,84,21,65,33,0,0 // andps 0x2141(%rip),%xmm10 # 7200 <_sk_callback_sse2+0x1171>
.byte 69,15,87,228 // xorps %xmm12,%xmm12
.byte 69,15,92,218 // subps %xmm10,%xmm11
.byte 69,15,89,217 // mulps %xmm9,%xmm11
@@ -40515,7 +39994,7 @@ FUNCTION(_sk_clamp_x_1_sse2)
_sk_clamp_x_1_sse2:
.byte 69,15,87,192 // xorps %xmm8,%xmm8
.byte 68,15,95,192 // maxps %xmm0,%xmm8
- .byte 68,15,93,5,62,33,0,0 // minps 0x213e(%rip),%xmm8 # 7380 <_sk_callback_sse2+0x11ac>
+ .byte 68,15,93,5,19,33,0,0 // minps 0x2113(%rip),%xmm8 # 7210 <_sk_callback_sse2+0x1181>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 65,15,40,192 // movaps %xmm8,%xmm0
.byte 255,224 // jmpq *%rax
@@ -40528,7 +40007,7 @@ _sk_repeat_x_1_sse2:
.byte 69,15,91,192 // cvtdq2ps %xmm8,%xmm8
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,194,200,1 // cmpltps %xmm8,%xmm9
- .byte 68,15,84,13,44,33,0,0 // andps 0x212c(%rip),%xmm9 # 7390 <_sk_callback_sse2+0x11bc>
+ .byte 68,15,84,13,1,33,0,0 // andps 0x2101(%rip),%xmm9 # 7220 <_sk_callback_sse2+0x1191>
.byte 69,15,92,193 // subps %xmm9,%xmm8
.byte 65,15,92,192 // subps %xmm8,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -40538,14 +40017,14 @@ HIDDEN _sk_mirror_x_1_sse2
.globl _sk_mirror_x_1_sse2
FUNCTION(_sk_mirror_x_1_sse2)
_sk_mirror_x_1_sse2:
- .byte 68,15,40,5,40,33,0,0 // movaps 0x2128(%rip),%xmm8 # 73a0 <_sk_callback_sse2+0x11cc>
+ .byte 68,15,40,5,253,32,0,0 // movaps 0x20fd(%rip),%xmm8 # 7230 <_sk_callback_sse2+0x11a1>
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,13,44,33,0,0 // movaps 0x212c(%rip),%xmm9 # 73b0 <_sk_callback_sse2+0x11dc>
+ .byte 68,15,40,13,1,33,0,0 // movaps 0x2101(%rip),%xmm9 # 7240 <_sk_callback_sse2+0x11b1>
.byte 68,15,89,200 // mulps %xmm0,%xmm9
.byte 243,69,15,91,209 // cvttps2dq %xmm9,%xmm10
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,84,13,34,33,0,0 // andps 0x2122(%rip),%xmm9 # 73c0 <_sk_callback_sse2+0x11ec>
+ .byte 68,15,84,13,247,32,0,0 // andps 0x20f7(%rip),%xmm9 # 7250 <_sk_callback_sse2+0x11c1>
.byte 69,15,87,219 // xorps %xmm11,%xmm11
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,88,210 // addps %xmm10,%xmm10
@@ -40561,10 +40040,10 @@ HIDDEN _sk_luminance_to_alpha_sse2
FUNCTION(_sk_luminance_to_alpha_sse2)
_sk_luminance_to_alpha_sse2:
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 15,89,5,8,33,0,0 // mulps 0x2108(%rip),%xmm0 # 73d0 <_sk_callback_sse2+0x11fc>
- .byte 15,89,13,17,33,0,0 // mulps 0x2111(%rip),%xmm1 # 73e0 <_sk_callback_sse2+0x120c>
+ .byte 15,89,5,221,32,0,0 // mulps 0x20dd(%rip),%xmm0 # 7260 <_sk_callback_sse2+0x11d1>
+ .byte 15,89,13,230,32,0,0 // mulps 0x20e6(%rip),%xmm1 # 7270 <_sk_callback_sse2+0x11e1>
.byte 15,88,200 // addps %xmm0,%xmm1
- .byte 15,89,29,23,33,0,0 // mulps 0x2117(%rip),%xmm3 # 73f0 <_sk_callback_sse2+0x121c>
+ .byte 15,89,29,236,32,0,0 // mulps 0x20ec(%rip),%xmm3 # 7280 <_sk_callback_sse2+0x11f1>
.byte 15,88,217 // addps %xmm1,%xmm3
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,87,192 // xorps %xmm0,%xmm0
@@ -40876,9 +40355,9 @@ _sk_evenly_spaced_gradient_sse2:
.byte 72,139,24 // mov (%rax),%rbx
.byte 76,139,112,8 // mov 0x8(%rax),%r14
.byte 72,255,203 // dec %rbx
- .byte 120,7 // js 5779 <_sk_evenly_spaced_gradient_sse2+0x18>
+ .byte 120,7 // js 5634 <_sk_evenly_spaced_gradient_sse2+0x18>
.byte 243,72,15,42,203 // cvtsi2ss %rbx,%xmm1
- .byte 235,21 // jmp 578e <_sk_evenly_spaced_gradient_sse2+0x2d>
+ .byte 235,21 // jmp 5649 <_sk_evenly_spaced_gradient_sse2+0x2d>
.byte 73,137,217 // mov %rbx,%r9
.byte 73,209,233 // shr %r9
.byte 131,227,1 // and $0x1,%ebx
@@ -40976,15 +40455,15 @@ HIDDEN _sk_gauss_a_to_rgba_sse2
.globl _sk_gauss_a_to_rgba_sse2
FUNCTION(_sk_gauss_a_to_rgba_sse2)
_sk_gauss_a_to_rgba_sse2:
- .byte 15,40,5,230,26,0,0 // movaps 0x1ae6(%rip),%xmm0 # 7400 <_sk_callback_sse2+0x122c>
+ .byte 15,40,5,187,26,0,0 // movaps 0x1abb(%rip),%xmm0 # 7290 <_sk_callback_sse2+0x1201>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,236,26,0,0 // addps 0x1aec(%rip),%xmm0 # 7410 <_sk_callback_sse2+0x123c>
+ .byte 15,88,5,193,26,0,0 // addps 0x1ac1(%rip),%xmm0 # 72a0 <_sk_callback_sse2+0x1211>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,242,26,0,0 // addps 0x1af2(%rip),%xmm0 # 7420 <_sk_callback_sse2+0x124c>
+ .byte 15,88,5,199,26,0,0 // addps 0x1ac7(%rip),%xmm0 # 72b0 <_sk_callback_sse2+0x1221>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,248,26,0,0 // addps 0x1af8(%rip),%xmm0 # 7430 <_sk_callback_sse2+0x125c>
+ .byte 15,88,5,205,26,0,0 // addps 0x1acd(%rip),%xmm0 # 72c0 <_sk_callback_sse2+0x1231>
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,5,254,26,0,0 // addps 0x1afe(%rip),%xmm0 # 7440 <_sk_callback_sse2+0x126c>
+ .byte 15,88,5,211,26,0,0 // addps 0x1ad3(%rip),%xmm0 # 72d0 <_sk_callback_sse2+0x1241>
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
@@ -41002,12 +40481,12 @@ _sk_gradient_sse2:
.byte 76,139,8 // mov (%rax),%r9
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 73,131,249,2 // cmp $0x2,%r9
- .byte 114,50 // jb 5995 <_sk_gradient_sse2+0x46>
+ .byte 114,50 // jb 5850 <_sk_gradient_sse2+0x46>
.byte 72,139,88,72 // mov 0x48(%rax),%rbx
.byte 73,255,201 // dec %r9
.byte 72,131,195,4 // add $0x4,%rbx
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 15,40,21,215,26,0,0 // movaps 0x1ad7(%rip),%xmm2 # 7450 <_sk_callback_sse2+0x127c>
+ .byte 15,40,21,172,26,0,0 // movaps 0x1aac(%rip),%xmm2 # 72e0 <_sk_callback_sse2+0x1251>
.byte 243,15,16,27 // movss (%rbx),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
@@ -41015,7 +40494,7 @@ _sk_gradient_sse2:
.byte 102,15,254,203 // paddd %xmm3,%xmm1
.byte 72,131,195,4 // add $0x4,%rbx
.byte 73,255,201 // dec %r9
- .byte 117,228 // jne 5979 <_sk_gradient_sse2+0x2a>
+ .byte 117,228 // jne 5834 <_sk_gradient_sse2+0x2a>
.byte 102,15,112,209,78 // pshufd $0x4e,%xmm1,%xmm2
.byte 102,73,15,126,211 // movq %xmm2,%r11
.byte 69,137,217 // mov %r11d,%r9d
@@ -41154,29 +40633,29 @@ _sk_xy_to_unit_angle_sse2:
.byte 69,15,94,220 // divps %xmm12,%xmm11
.byte 69,15,40,227 // movaps %xmm11,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
- .byte 68,15,40,45,152,24,0,0 // movaps 0x1898(%rip),%xmm13 # 7460 <_sk_callback_sse2+0x128c>
+ .byte 68,15,40,45,109,24,0,0 // movaps 0x186d(%rip),%xmm13 # 72f0 <_sk_callback_sse2+0x1261>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,156,24,0,0 // addps 0x189c(%rip),%xmm13 # 7470 <_sk_callback_sse2+0x129c>
+ .byte 68,15,88,45,113,24,0,0 // addps 0x1871(%rip),%xmm13 # 7300 <_sk_callback_sse2+0x1271>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,160,24,0,0 // addps 0x18a0(%rip),%xmm13 # 7480 <_sk_callback_sse2+0x12ac>
+ .byte 68,15,88,45,117,24,0,0 // addps 0x1875(%rip),%xmm13 # 7310 <_sk_callback_sse2+0x1281>
.byte 69,15,89,236 // mulps %xmm12,%xmm13
- .byte 68,15,88,45,164,24,0,0 // addps 0x18a4(%rip),%xmm13 # 7490 <_sk_callback_sse2+0x12bc>
+ .byte 68,15,88,45,121,24,0,0 // addps 0x1879(%rip),%xmm13 # 7320 <_sk_callback_sse2+0x1291>
.byte 69,15,89,235 // mulps %xmm11,%xmm13
.byte 69,15,194,202,1 // cmpltps %xmm10,%xmm9
- .byte 68,15,40,21,163,24,0,0 // movaps 0x18a3(%rip),%xmm10 # 74a0 <_sk_callback_sse2+0x12cc>
+ .byte 68,15,40,21,120,24,0,0 // movaps 0x1878(%rip),%xmm10 # 7330 <_sk_callback_sse2+0x12a1>
.byte 69,15,92,213 // subps %xmm13,%xmm10
.byte 69,15,84,209 // andps %xmm9,%xmm10
.byte 69,15,85,205 // andnps %xmm13,%xmm9
.byte 69,15,86,202 // orps %xmm10,%xmm9
.byte 68,15,194,192,1 // cmpltps %xmm0,%xmm8
- .byte 68,15,40,21,150,24,0,0 // movaps 0x1896(%rip),%xmm10 # 74b0 <_sk_callback_sse2+0x12dc>
+ .byte 68,15,40,21,107,24,0,0 // movaps 0x186b(%rip),%xmm10 # 7340 <_sk_callback_sse2+0x12b1>
.byte 69,15,92,209 // subps %xmm9,%xmm10
.byte 69,15,84,208 // andps %xmm8,%xmm10
.byte 69,15,85,193 // andnps %xmm9,%xmm8
.byte 69,15,86,194 // orps %xmm10,%xmm8
.byte 68,15,40,201 // movaps %xmm1,%xmm9
.byte 68,15,194,200,1 // cmpltps %xmm0,%xmm9
- .byte 68,15,40,21,133,24,0,0 // movaps 0x1885(%rip),%xmm10 # 74c0 <_sk_callback_sse2+0x12ec>
+ .byte 68,15,40,21,90,24,0,0 // movaps 0x185a(%rip),%xmm10 # 7350 <_sk_callback_sse2+0x12c1>
.byte 69,15,92,208 // subps %xmm8,%xmm10
.byte 69,15,84,209 // andps %xmm9,%xmm10
.byte 69,15,85,200 // andnps %xmm8,%xmm9
@@ -41211,7 +40690,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 243,69,15,89,203 // mulss %xmm11,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,44,24,0,0 // mulps 0x182c(%rip),%xmm9 # 74d0 <_sk_callback_sse2+0x12fc>
+ .byte 68,15,89,13,1,24,0,0 // mulps 0x1801(%rip),%xmm9 # 7360 <_sk_callback_sse2+0x12d1>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
@@ -41219,7 +40698,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 243,69,15,89,219 // mulss %xmm11,%xmm11
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,92,227 // subps %xmm11,%xmm12
- .byte 68,15,89,21,23,24,0,0 // mulps 0x1817(%rip),%xmm10 # 74e0 <_sk_callback_sse2+0x130c>
+ .byte 68,15,89,21,236,23,0,0 // mulps 0x17ec(%rip),%xmm10 # 7370 <_sk_callback_sse2+0x12e1>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -41228,8 +40707,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,92,193 // subps %xmm9,%xmm0
- .byte 68,15,87,13,255,23,0,0 // xorps 0x17ff(%rip),%xmm9 # 74f0 <_sk_callback_sse2+0x131c>
- .byte 68,15,89,5,7,24,0,0 // mulps 0x1807(%rip),%xmm8 # 7500 <_sk_callback_sse2+0x132c>
+ .byte 68,15,87,13,212,23,0,0 // xorps 0x17d4(%rip),%xmm9 # 7380 <_sk_callback_sse2+0x12f1>
+ .byte 68,15,89,5,220,23,0,0 // mulps 0x17dc(%rip),%xmm8 # 7390 <_sk_callback_sse2+0x1301>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
@@ -41250,7 +40729,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 243,69,15,89,203 // mulss %xmm11,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,206,23,0,0 // mulps 0x17ce(%rip),%xmm9 # 7510 <_sk_callback_sse2+0x133c>
+ .byte 68,15,89,13,163,23,0,0 // mulps 0x17a3(%rip),%xmm9 # 73a0 <_sk_callback_sse2+0x1311>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,225 // movaps %xmm1,%xmm12
.byte 69,15,89,228 // mulps %xmm12,%xmm12
@@ -41258,7 +40737,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 243,69,15,89,219 // mulss %xmm11,%xmm11
.byte 69,15,198,219,0 // shufps $0x0,%xmm11,%xmm11
.byte 69,15,92,227 // subps %xmm11,%xmm12
- .byte 68,15,89,21,185,23,0,0 // mulps 0x17b9(%rip),%xmm10 # 7520 <_sk_callback_sse2+0x134c>
+ .byte 68,15,89,21,142,23,0,0 // mulps 0x178e(%rip),%xmm10 # 73b0 <_sk_callback_sse2+0x1321>
.byte 69,15,89,212 // mulps %xmm12,%xmm10
.byte 65,15,40,193 // movaps %xmm9,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -41267,8 +40746,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,40,194 // movaps %xmm10,%xmm0
.byte 65,15,92,193 // subps %xmm9,%xmm0
- .byte 68,15,87,13,161,23,0,0 // xorps 0x17a1(%rip),%xmm9 # 7530 <_sk_callback_sse2+0x135c>
- .byte 68,15,89,5,169,23,0,0 // mulps 0x17a9(%rip),%xmm8 # 7540 <_sk_callback_sse2+0x136c>
+ .byte 68,15,87,13,118,23,0,0 // xorps 0x1776(%rip),%xmm9 # 73c0 <_sk_callback_sse2+0x1331>
+ .byte 68,15,89,5,126,23,0,0 // mulps 0x177e(%rip),%xmm8 # 73d0 <_sk_callback_sse2+0x1341>
.byte 65,15,89,192 // mulps %xmm8,%xmm0
.byte 69,15,92,202 // subps %xmm10,%xmm9
.byte 69,15,89,200 // mulps %xmm8,%xmm9
@@ -41286,7 +40765,7 @@ _sk_xy_to_2pt_conical_linear_sse2:
.byte 243,69,15,89,200 // mulss %xmm8,%xmm9
.byte 69,15,198,201,0 // shufps $0x0,%xmm9,%xmm9
.byte 68,15,88,200 // addps %xmm0,%xmm9
- .byte 68,15,89,13,129,23,0,0 // mulps 0x1781(%rip),%xmm9 # 7550 <_sk_callback_sse2+0x137c>
+ .byte 68,15,89,13,86,23,0,0 // mulps 0x1756(%rip),%xmm9 # 73e0 <_sk_callback_sse2+0x1351>
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 68,15,40,209 // movaps %xmm1,%xmm10
.byte 69,15,89,210 // mulps %xmm10,%xmm10
@@ -41294,7 +40773,7 @@ _sk_xy_to_2pt_conical_linear_sse2:
.byte 243,69,15,89,192 // mulss %xmm8,%xmm8
.byte 69,15,198,192,0 // shufps $0x0,%xmm8,%xmm8
.byte 65,15,92,192 // subps %xmm8,%xmm0
- .byte 15,87,5,109,23,0,0 // xorps 0x176d(%rip),%xmm0 # 7560 <_sk_callback_sse2+0x138c>
+ .byte 15,87,5,66,23,0,0 // xorps 0x1742(%rip),%xmm0 # 73f0 <_sk_callback_sse2+0x1361>
.byte 65,15,94,193 // divps %xmm9,%xmm0
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41337,7 +40816,7 @@ HIDDEN _sk_save_xy_sse2
FUNCTION(_sk_save_xy_sse2)
_sk_save_xy_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,19,23,0,0 // movaps 0x1713(%rip),%xmm8 # 7570 <_sk_callback_sse2+0x139c>
+ .byte 68,15,40,5,232,22,0,0 // movaps 0x16e8(%rip),%xmm8 # 7400 <_sk_callback_sse2+0x1371>
.byte 15,17,0 // movups %xmm0,(%rax)
.byte 68,15,40,200 // movaps %xmm0,%xmm9
.byte 69,15,88,200 // addps %xmm8,%xmm9
@@ -41345,7 +40824,7 @@ _sk_save_xy_sse2:
.byte 69,15,91,210 // cvtdq2ps %xmm10,%xmm10
.byte 69,15,40,217 // movaps %xmm9,%xmm11
.byte 69,15,194,218,1 // cmpltps %xmm10,%xmm11
- .byte 68,15,40,37,254,22,0,0 // movaps 0x16fe(%rip),%xmm12 # 7580 <_sk_callback_sse2+0x13ac>
+ .byte 68,15,40,37,211,22,0,0 // movaps 0x16d3(%rip),%xmm12 # 7410 <_sk_callback_sse2+0x1381>
.byte 69,15,84,220 // andps %xmm12,%xmm11
.byte 69,15,92,211 // subps %xmm11,%xmm10
.byte 69,15,92,202 // subps %xmm10,%xmm9
@@ -41392,8 +40871,8 @@ _sk_bilinear_nx_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,119,22,0,0 // addps 0x1677(%rip),%xmm0 # 7590 <_sk_callback_sse2+0x13bc>
- .byte 68,15,40,13,127,22,0,0 // movaps 0x167f(%rip),%xmm9 # 75a0 <_sk_callback_sse2+0x13cc>
+ .byte 15,88,5,76,22,0,0 // addps 0x164c(%rip),%xmm0 # 7420 <_sk_callback_sse2+0x1391>
+ .byte 68,15,40,13,84,22,0,0 // movaps 0x1654(%rip),%xmm9 # 7430 <_sk_callback_sse2+0x13a1>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41406,7 +40885,7 @@ _sk_bilinear_px_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,110,22,0,0 // addps 0x166e(%rip),%xmm0 # 75b0 <_sk_callback_sse2+0x13dc>
+ .byte 15,88,5,67,22,0,0 // addps 0x1643(%rip),%xmm0 # 7440 <_sk_callback_sse2+0x13b1>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41418,8 +40897,8 @@ _sk_bilinear_ny_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,96,22,0,0 // addps 0x1660(%rip),%xmm1 # 75c0 <_sk_callback_sse2+0x13ec>
- .byte 68,15,40,13,104,22,0,0 // movaps 0x1668(%rip),%xmm9 # 75d0 <_sk_callback_sse2+0x13fc>
+ .byte 15,88,13,53,22,0,0 // addps 0x1635(%rip),%xmm1 # 7450 <_sk_callback_sse2+0x13c1>
+ .byte 68,15,40,13,61,22,0,0 // movaps 0x163d(%rip),%xmm9 # 7460 <_sk_callback_sse2+0x13d1>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41432,7 +40911,7 @@ _sk_bilinear_py_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,86,22,0,0 // addps 0x1656(%rip),%xmm1 # 75e0 <_sk_callback_sse2+0x140c>
+ .byte 15,88,13,43,22,0,0 // addps 0x162b(%rip),%xmm1 # 7470 <_sk_callback_sse2+0x13e1>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41444,13 +40923,13 @@ _sk_bicubic_n3x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,73,22,0,0 // addps 0x1649(%rip),%xmm0 # 75f0 <_sk_callback_sse2+0x141c>
- .byte 68,15,40,13,81,22,0,0 // movaps 0x1651(%rip),%xmm9 # 7600 <_sk_callback_sse2+0x142c>
+ .byte 15,88,5,30,22,0,0 // addps 0x161e(%rip),%xmm0 # 7480 <_sk_callback_sse2+0x13f1>
+ .byte 68,15,40,13,38,22,0,0 // movaps 0x1626(%rip),%xmm9 # 7490 <_sk_callback_sse2+0x1401>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,77,22,0,0 // mulps 0x164d(%rip),%xmm9 # 7610 <_sk_callback_sse2+0x143c>
- .byte 68,15,88,13,85,22,0,0 // addps 0x1655(%rip),%xmm9 # 7620 <_sk_callback_sse2+0x144c>
+ .byte 68,15,89,13,34,22,0,0 // mulps 0x1622(%rip),%xmm9 # 74a0 <_sk_callback_sse2+0x1411>
+ .byte 68,15,88,13,42,22,0,0 // addps 0x162a(%rip),%xmm9 # 74b0 <_sk_callback_sse2+0x1421>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,128,0,0,0 // movups %xmm9,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41463,16 +40942,16 @@ _sk_bicubic_n1x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,68,22,0,0 // addps 0x1644(%rip),%xmm0 # 7630 <_sk_callback_sse2+0x145c>
- .byte 68,15,40,13,76,22,0,0 // movaps 0x164c(%rip),%xmm9 # 7640 <_sk_callback_sse2+0x146c>
+ .byte 15,88,5,25,22,0,0 // addps 0x1619(%rip),%xmm0 # 74c0 <_sk_callback_sse2+0x1431>
+ .byte 68,15,40,13,33,22,0,0 // movaps 0x1621(%rip),%xmm9 # 74d0 <_sk_callback_sse2+0x1441>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,80,22,0,0 // movaps 0x1650(%rip),%xmm8 # 7650 <_sk_callback_sse2+0x147c>
+ .byte 68,15,40,5,37,22,0,0 // movaps 0x1625(%rip),%xmm8 # 74e0 <_sk_callback_sse2+0x1451>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,84,22,0,0 // addps 0x1654(%rip),%xmm8 # 7660 <_sk_callback_sse2+0x148c>
+ .byte 68,15,88,5,41,22,0,0 // addps 0x1629(%rip),%xmm8 # 74f0 <_sk_callback_sse2+0x1461>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,88,22,0,0 // addps 0x1658(%rip),%xmm8 # 7670 <_sk_callback_sse2+0x149c>
+ .byte 68,15,88,5,45,22,0,0 // addps 0x162d(%rip),%xmm8 # 7500 <_sk_callback_sse2+0x1471>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,92,22,0,0 // addps 0x165c(%rip),%xmm8 # 7680 <_sk_callback_sse2+0x14ac>
+ .byte 68,15,88,5,49,22,0,0 // addps 0x1631(%rip),%xmm8 # 7510 <_sk_callback_sse2+0x1481>
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41482,17 +40961,17 @@ HIDDEN _sk_bicubic_p1x_sse2
FUNCTION(_sk_bicubic_p1x_sse2)
_sk_bicubic_p1x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,86,22,0,0 // movaps 0x1656(%rip),%xmm8 # 7690 <_sk_callback_sse2+0x14bc>
+ .byte 68,15,40,5,43,22,0,0 // movaps 0x162b(%rip),%xmm8 # 7520 <_sk_callback_sse2+0x1491>
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,72,64 // movups 0x40(%rax),%xmm9
.byte 65,15,88,192 // addps %xmm8,%xmm0
- .byte 68,15,40,21,82,22,0,0 // movaps 0x1652(%rip),%xmm10 # 76a0 <_sk_callback_sse2+0x14cc>
+ .byte 68,15,40,21,39,22,0,0 // movaps 0x1627(%rip),%xmm10 # 7530 <_sk_callback_sse2+0x14a1>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,86,22,0,0 // addps 0x1656(%rip),%xmm10 # 76b0 <_sk_callback_sse2+0x14dc>
+ .byte 68,15,88,21,43,22,0,0 // addps 0x162b(%rip),%xmm10 # 7540 <_sk_callback_sse2+0x14b1>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,82,22,0,0 // addps 0x1652(%rip),%xmm10 # 76c0 <_sk_callback_sse2+0x14ec>
+ .byte 68,15,88,21,39,22,0,0 // addps 0x1627(%rip),%xmm10 # 7550 <_sk_callback_sse2+0x14c1>
.byte 68,15,17,144,128,0,0,0 // movups %xmm10,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41504,11 +40983,11 @@ _sk_bicubic_p3x_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,0 // movups (%rax),%xmm0
.byte 68,15,16,64,64 // movups 0x40(%rax),%xmm8
- .byte 15,88,5,69,22,0,0 // addps 0x1645(%rip),%xmm0 # 76d0 <_sk_callback_sse2+0x14fc>
+ .byte 15,88,5,26,22,0,0 // addps 0x161a(%rip),%xmm0 # 7560 <_sk_callback_sse2+0x14d1>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,69,22,0,0 // mulps 0x1645(%rip),%xmm8 # 76e0 <_sk_callback_sse2+0x150c>
- .byte 68,15,88,5,77,22,0,0 // addps 0x164d(%rip),%xmm8 # 76f0 <_sk_callback_sse2+0x151c>
+ .byte 68,15,89,5,26,22,0,0 // mulps 0x161a(%rip),%xmm8 # 7570 <_sk_callback_sse2+0x14e1>
+ .byte 68,15,88,5,34,22,0,0 // addps 0x1622(%rip),%xmm8 # 7580 <_sk_callback_sse2+0x14f1>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,128,0,0,0 // movups %xmm8,0x80(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41521,13 +41000,13 @@ _sk_bicubic_n3y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,59,22,0,0 // addps 0x163b(%rip),%xmm1 # 7700 <_sk_callback_sse2+0x152c>
- .byte 68,15,40,13,67,22,0,0 // movaps 0x1643(%rip),%xmm9 # 7710 <_sk_callback_sse2+0x153c>
+ .byte 15,88,13,16,22,0,0 // addps 0x1610(%rip),%xmm1 # 7590 <_sk_callback_sse2+0x1501>
+ .byte 68,15,40,13,24,22,0,0 // movaps 0x1618(%rip),%xmm9 # 75a0 <_sk_callback_sse2+0x1511>
.byte 69,15,92,200 // subps %xmm8,%xmm9
.byte 69,15,40,193 // movaps %xmm9,%xmm8
.byte 69,15,89,192 // mulps %xmm8,%xmm8
- .byte 68,15,89,13,63,22,0,0 // mulps 0x163f(%rip),%xmm9 # 7720 <_sk_callback_sse2+0x154c>
- .byte 68,15,88,13,71,22,0,0 // addps 0x1647(%rip),%xmm9 # 7730 <_sk_callback_sse2+0x155c>
+ .byte 68,15,89,13,20,22,0,0 // mulps 0x1614(%rip),%xmm9 # 75b0 <_sk_callback_sse2+0x1521>
+ .byte 68,15,88,13,28,22,0,0 // addps 0x161c(%rip),%xmm9 # 75c0 <_sk_callback_sse2+0x1531>
.byte 69,15,89,200 // mulps %xmm8,%xmm9
.byte 68,15,17,136,160,0,0,0 // movups %xmm9,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41540,16 +41019,16 @@ _sk_bicubic_n1y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,53,22,0,0 // addps 0x1635(%rip),%xmm1 # 7740 <_sk_callback_sse2+0x156c>
- .byte 68,15,40,13,61,22,0,0 // movaps 0x163d(%rip),%xmm9 # 7750 <_sk_callback_sse2+0x157c>
+ .byte 15,88,13,10,22,0,0 // addps 0x160a(%rip),%xmm1 # 75d0 <_sk_callback_sse2+0x1541>
+ .byte 68,15,40,13,18,22,0,0 // movaps 0x1612(%rip),%xmm9 # 75e0 <_sk_callback_sse2+0x1551>
.byte 69,15,92,200 // subps %xmm8,%xmm9
- .byte 68,15,40,5,65,22,0,0 // movaps 0x1641(%rip),%xmm8 # 7760 <_sk_callback_sse2+0x158c>
+ .byte 68,15,40,5,22,22,0,0 // movaps 0x1616(%rip),%xmm8 # 75f0 <_sk_callback_sse2+0x1561>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,69,22,0,0 // addps 0x1645(%rip),%xmm8 # 7770 <_sk_callback_sse2+0x159c>
+ .byte 68,15,88,5,26,22,0,0 // addps 0x161a(%rip),%xmm8 # 7600 <_sk_callback_sse2+0x1571>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,73,22,0,0 // addps 0x1649(%rip),%xmm8 # 7780 <_sk_callback_sse2+0x15ac>
+ .byte 68,15,88,5,30,22,0,0 // addps 0x161e(%rip),%xmm8 # 7610 <_sk_callback_sse2+0x1581>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
- .byte 68,15,88,5,77,22,0,0 // addps 0x164d(%rip),%xmm8 # 7790 <_sk_callback_sse2+0x15bc>
+ .byte 68,15,88,5,34,22,0,0 // addps 0x1622(%rip),%xmm8 # 7620 <_sk_callback_sse2+0x1591>
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41559,17 +41038,17 @@ HIDDEN _sk_bicubic_p1y_sse2
FUNCTION(_sk_bicubic_p1y_sse2)
_sk_bicubic_p1y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
- .byte 68,15,40,5,71,22,0,0 // movaps 0x1647(%rip),%xmm8 # 77a0 <_sk_callback_sse2+0x15cc>
+ .byte 68,15,40,5,28,22,0,0 // movaps 0x161c(%rip),%xmm8 # 7630 <_sk_callback_sse2+0x15a1>
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,72,96 // movups 0x60(%rax),%xmm9
.byte 65,15,88,200 // addps %xmm8,%xmm1
- .byte 68,15,40,21,66,22,0,0 // movaps 0x1642(%rip),%xmm10 # 77b0 <_sk_callback_sse2+0x15dc>
+ .byte 68,15,40,21,23,22,0,0 // movaps 0x1617(%rip),%xmm10 # 7640 <_sk_callback_sse2+0x15b1>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,70,22,0,0 // addps 0x1646(%rip),%xmm10 # 77c0 <_sk_callback_sse2+0x15ec>
+ .byte 68,15,88,21,27,22,0,0 // addps 0x161b(%rip),%xmm10 # 7650 <_sk_callback_sse2+0x15c1>
.byte 69,15,89,209 // mulps %xmm9,%xmm10
.byte 69,15,88,208 // addps %xmm8,%xmm10
.byte 69,15,89,209 // mulps %xmm9,%xmm10
- .byte 68,15,88,21,66,22,0,0 // addps 0x1642(%rip),%xmm10 # 77d0 <_sk_callback_sse2+0x15fc>
+ .byte 68,15,88,21,23,22,0,0 // addps 0x1617(%rip),%xmm10 # 7660 <_sk_callback_sse2+0x15d1>
.byte 68,15,17,144,160,0,0,0 // movups %xmm10,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 255,224 // jmpq *%rax
@@ -41581,11 +41060,11 @@ _sk_bicubic_p3y_sse2:
.byte 72,173 // lods %ds:(%rsi),%rax
.byte 15,16,72,32 // movups 0x20(%rax),%xmm1
.byte 68,15,16,64,96 // movups 0x60(%rax),%xmm8
- .byte 15,88,13,52,22,0,0 // addps 0x1634(%rip),%xmm1 # 77e0 <_sk_callback_sse2+0x160c>
+ .byte 15,88,13,9,22,0,0 // addps 0x1609(%rip),%xmm1 # 7670 <_sk_callback_sse2+0x15e1>
.byte 69,15,40,200 // movaps %xmm8,%xmm9
.byte 69,15,89,201 // mulps %xmm9,%xmm9
- .byte 68,15,89,5,52,22,0,0 // mulps 0x1634(%rip),%xmm8 # 77f0 <_sk_callback_sse2+0x161c>
- .byte 68,15,88,5,60,22,0,0 // addps 0x163c(%rip),%xmm8 # 7800 <_sk_callback_sse2+0x162c>
+ .byte 68,15,89,5,9,22,0,0 // mulps 0x1609(%rip),%xmm8 # 7680 <_sk_callback_sse2+0x15f1>
+ .byte 68,15,88,5,17,22,0,0 // addps 0x1611(%rip),%xmm8 # 7690 <_sk_callback_sse2+0x1601>
.byte 69,15,89,193 // mulps %xmm9,%xmm8
.byte 68,15,17,128,160,0,0,0 // movups %xmm8,0xa0(%rax)
.byte 72,173 // lods %ds:(%rsi),%rax
@@ -41827,9 +41306,9 @@ BALIGN16
.byte 128,191,0,0,224,64,0 // cmpb $0x0,0x40e00000(%rdi)
.byte 0,224 // add %ah,%al
.byte 64,0,0 // add %al,(%rax)
- .byte 224,64 // loopne 64cc <.literal16+0x1fc>
+ .byte 224,64 // loopne 637c <.literal16+0x1fc>
.byte 0,0 // add %al,(%rax)
- .byte 224,64 // loopne 64d0 <.literal16+0x200>
+ .byte 224,64 // loopne 6380 <.literal16+0x200>
.byte 154 // (bad)
.byte 153 // cltd
.byte 153 // cltd
@@ -41849,13 +41328,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 64f1 <.literal16+0x221>
+ .byte 71,225,61 // rex.RXB loope 63a1 <.literal16+0x221>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 64f5 <.literal16+0x225>
+ .byte 71,225,61 // rex.RXB loope 63a5 <.literal16+0x225>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 64f9 <.literal16+0x229>
+ .byte 71,225,61 // rex.RXB loope 63a9 <.literal16+0x229>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 64fd <.literal16+0x22d>
+ .byte 71,225,61 // rex.RXB loope 63ad <.literal16+0x22d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -41880,13 +41359,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6531 <.literal16+0x261>
+ .byte 71,225,61 // rex.RXB loope 63e1 <.literal16+0x261>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6535 <.literal16+0x265>
+ .byte 71,225,61 // rex.RXB loope 63e5 <.literal16+0x265>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6539 <.literal16+0x269>
+ .byte 71,225,61 // rex.RXB loope 63e9 <.literal16+0x269>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 653d <.literal16+0x26d>
+ .byte 71,225,61 // rex.RXB loope 63ed <.literal16+0x26d>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -41911,13 +41390,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6571 <.literal16+0x2a1>
+ .byte 71,225,61 // rex.RXB loope 6421 <.literal16+0x2a1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6575 <.literal16+0x2a5>
+ .byte 71,225,61 // rex.RXB loope 6425 <.literal16+0x2a5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 6579 <.literal16+0x2a9>
+ .byte 71,225,61 // rex.RXB loope 6429 <.literal16+0x2a9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 657d <.literal16+0x2ad>
+ .byte 71,225,61 // rex.RXB loope 642d <.literal16+0x2ad>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -41942,13 +41421,13 @@ BALIGN16
.byte 10,23 // or (%rdi),%dl
.byte 63 // (bad)
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 65b1 <.literal16+0x2e1>
+ .byte 71,225,61 // rex.RXB loope 6461 <.literal16+0x2e1>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 65b5 <.literal16+0x2e5>
+ .byte 71,225,61 // rex.RXB loope 6465 <.literal16+0x2e5>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 65b9 <.literal16+0x2e9>
+ .byte 71,225,61 // rex.RXB loope 6469 <.literal16+0x2e9>
.byte 174 // scas %es:(%rdi),%al
- .byte 71,225,61 // rex.RXB loope 65bd <.literal16+0x2ed>
+ .byte 71,225,61 // rex.RXB loope 646d <.literal16+0x2ed>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -41969,11 +41448,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%rax)
.byte 67,0,0 // rex.XB add %al,(%r8)
- .byte 127,67 // jg 65fb <.literal16+0x32b>
+ .byte 127,67 // jg 64ab <.literal16+0x32b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 65ff <.literal16+0x32f>
+ .byte 127,67 // jg 64af <.literal16+0x32f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6603 <.literal16+0x333>
+ .byte 127,67 // jg 64b3 <.literal16+0x333>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -42260,13 +41739,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6849 <.literal16+0x579>
+ .byte 224,7 // loopne 66f9 <.literal16+0x579>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 684d <.literal16+0x57d>
+ .byte 224,7 // loopne 66fd <.literal16+0x57d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6851 <.literal16+0x581>
+ .byte 224,7 // loopne 6701 <.literal16+0x581>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6855 <.literal16+0x585>
+ .byte 224,7 // loopne 6705 <.literal16+0x585>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -42331,11 +41810,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 692b <.literal16+0x65b>
+ .byte 127,67 // jg 67db <.literal16+0x65b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 692f <.literal16+0x65f>
+ .byte 127,67 // jg 67df <.literal16+0x65f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6933 <.literal16+0x663>
+ .byte 127,67 // jg 67e3 <.literal16+0x663>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%rax)
@@ -42350,16 +41829,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6924 <.literal16+0x654>
+ .byte 127,0 // jg 67d4 <.literal16+0x654>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6928 <.literal16+0x658>
+ .byte 127,0 // jg 67d8 <.literal16+0x658>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 692c <.literal16+0x65c>
+ .byte 127,0 // jg 67dc <.literal16+0x65c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6930 <.literal16+0x660>
+ .byte 127,0 // jg 67e0 <.literal16+0x660>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -42368,7 +41847,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 69b5 <.literal16+0x6e5>
+ .byte 119,115 // ja 6865 <.literal16+0x6e5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -42379,7 +41858,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 6919 <.literal16+0x649>
+ .byte 117,191 // jne 67c9 <.literal16+0x649>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -42391,7 +41870,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3a95a <_sk_callback_sse2+0xffffffffe9a34786>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a80a <_sk_callback_sse2+0xffffffffe9a3477b>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -42445,16 +41924,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 69f4 <.literal16+0x724>
+ .byte 127,0 // jg 68a4 <.literal16+0x724>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 69f8 <.literal16+0x728>
+ .byte 127,0 // jg 68a8 <.literal16+0x728>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 69fc <.literal16+0x72c>
+ .byte 127,0 // jg 68ac <.literal16+0x72c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6a00 <.literal16+0x730>
+ .byte 127,0 // jg 68b0 <.literal16+0x730>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -42463,7 +41942,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6a85 <.literal16+0x7b5>
+ .byte 119,115 // ja 6935 <.literal16+0x7b5>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -42474,7 +41953,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 69e9 <.literal16+0x719>
+ .byte 117,191 // jne 6899 <.literal16+0x719>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -42486,7 +41965,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3aa2a <_sk_callback_sse2+0xffffffffe9a34856>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a8da <_sk_callback_sse2+0xffffffffe9a3484b>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -42540,16 +42019,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6ac4 <.literal16+0x7f4>
+ .byte 127,0 // jg 6974 <.literal16+0x7f4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6ac8 <.literal16+0x7f8>
+ .byte 127,0 // jg 6978 <.literal16+0x7f8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6acc <.literal16+0x7fc>
+ .byte 127,0 // jg 697c <.literal16+0x7fc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6ad0 <.literal16+0x800>
+ .byte 127,0 // jg 6980 <.literal16+0x800>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -42558,7 +42037,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6b55 <.literal16+0x885>
+ .byte 119,115 // ja 6a05 <.literal16+0x885>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -42569,7 +42048,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 6ab9 <.literal16+0x7e9>
+ .byte 117,191 // jne 6969 <.literal16+0x7e9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -42581,7 +42060,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3aafa <_sk_callback_sse2+0xffffffffe9a34926>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3a9aa <_sk_callback_sse2+0xffffffffe9a3491b>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -42635,16 +42114,16 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 6b94 <.literal16+0x8c4>
+ .byte 127,0 // jg 6a44 <.literal16+0x8c4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6b98 <.literal16+0x8c8>
+ .byte 127,0 // jg 6a48 <.literal16+0x8c8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6b9c <.literal16+0x8cc>
+ .byte 127,0 // jg 6a4c <.literal16+0x8cc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 6ba0 <.literal16+0x8d0>
+ .byte 127,0 // jg 6a50 <.literal16+0x8d0>
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -42653,7 +42132,7 @@ BALIGN16
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
- .byte 119,115 // ja 6c25 <.literal16+0x955>
+ .byte 119,115 // ja 6ad5 <.literal16+0x955>
.byte 248 // clc
.byte 194,119,115 // retq $0x7377
.byte 248 // clc
@@ -42664,7 +42143,7 @@ BALIGN16
.byte 194,117,191 // retq $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
- .byte 117,191 // jne 6b89 <.literal16+0x8b9>
+ .byte 117,191 // jne 6a39 <.literal16+0x8b9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // (bad)
.byte 249 // stc
@@ -42676,7 +42155,7 @@ BALIGN16
.byte 249 // stc
.byte 68,180,62 // rex.R mov $0x3e,%spl
.byte 163,233,220,63,163,233,220,63,163 // movabs %eax,0xa33fdce9a33fdce9
- .byte 233,220,63,163,233 // jmpq ffffffffe9a3abca <_sk_callback_sse2+0xffffffffe9a349f6>
+ .byte 233,220,63,163,233 // jmpq ffffffffe9a3aa7a <_sk_callback_sse2+0xffffffffe9a349eb>
.byte 220,63 // fdivrl (%rdi)
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
@@ -42726,13 +42205,13 @@ BALIGN16
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
.byte 200,66,0,0 // enterq $0x42,$0x0
- .byte 127,67 // jg 6ca7 <.literal16+0x9d7>
+ .byte 127,67 // jg 6b57 <.literal16+0x9d7>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6cab <.literal16+0x9db>
+ .byte 127,67 // jg 6b5b <.literal16+0x9db>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6caf <.literal16+0x9df>
+ .byte 127,67 // jg 6b5f <.literal16+0x9df>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6cb3 <.literal16+0x9e3>
+ .byte 127,67 // jg 6b63 <.literal16+0x9e3>
.byte 0,0 // add %al,(%rax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%rax)
@@ -42779,16 +42258,16 @@ BALIGN16
.byte 128,3,62 // addb $0x3e,(%rbx)
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6d33 <.literal16+0xa63>
+ .byte 118,63 // jbe 6be3 <.literal16+0xa63>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6d37 <.literal16+0xa67>
+ .byte 118,63 // jbe 6be7 <.literal16+0xa67>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6d3b <.literal16+0xa6b>
+ .byte 118,63 // jbe 6beb <.literal16+0xa6b>
.byte 31 // (bad)
.byte 215 // xlat %ds:(%rbx)
- .byte 118,63 // jbe 6d3f <.literal16+0xa6f>
+ .byte 118,63 // jbe 6bef <.literal16+0xa6f>
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
.byte 246,64,83,63 // testb $0x3f,0x53(%rax)
@@ -42817,11 +42296,11 @@ BALIGN16
.byte 128,59,0 // cmpb $0x0,(%rbx)
.byte 0,127,67 // add %bh,0x43(%rdi)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6dab <.literal16+0xadb>
+ .byte 127,67 // jg 6c5b <.literal16+0xadb>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6daf <.literal16+0xadf>
+ .byte 127,67 // jg 6c5f <.literal16+0xadf>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 6db3 <.literal16+0xae3>
+ .byte 127,67 // jg 6c63 <.literal16+0xae3>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -42867,17 +42346,8 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
.byte 63 // (bad)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
- .byte 0,0 // add %al,(%rax)
- .byte 255,0 // incl (%rax)
+ .byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%rax)
- .byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%rax)
- .byte 128,59,129 // cmpb $0x81,(%rbx)
- .byte 128,128,59,0,248,0,0 // addb $0x0,0xf8003b(%rax)
.byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,248 // add %bh,%al
@@ -42892,13 +42362,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6e49 <.literal16+0xb79>
+ .byte 224,7 // loopne 6cd9 <.literal16+0xb59>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6e4d <.literal16+0xb7d>
+ .byte 224,7 // loopne 6cdd <.literal16+0xb5d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6e51 <.literal16+0xb81>
+ .byte 224,7 // loopne 6ce1 <.literal16+0xb61>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6e55 <.literal16+0xb85>
+ .byte 224,7 // loopne 6ce5 <.literal16+0xb65>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -42944,13 +42414,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6eb9 <.literal16+0xbe9>
+ .byte 224,7 // loopne 6d49 <.literal16+0xbc9>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6ebd <.literal16+0xbed>
+ .byte 224,7 // loopne 6d4d <.literal16+0xbcd>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6ec1 <.literal16+0xbf1>
+ .byte 224,7 // loopne 6d51 <.literal16+0xbd1>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6ec5 <.literal16+0xbf5>
+ .byte 224,7 // loopne 6d55 <.literal16+0xbd5>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -42996,13 +42466,13 @@ BALIGN16
.byte 132,55 // test %dh,(%rdi)
.byte 8,33 // or %ah,(%rcx)
.byte 132,55 // test %dh,(%rdi)
- .byte 224,7 // loopne 6f29 <.literal16+0xc59>
+ .byte 224,7 // loopne 6db9 <.literal16+0xc39>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6f2d <.literal16+0xc5d>
+ .byte 224,7 // loopne 6dbd <.literal16+0xc3d>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6f31 <.literal16+0xc61>
+ .byte 224,7 // loopne 6dc1 <.literal16+0xc41>
.byte 0,0 // add %al,(%rax)
- .byte 224,7 // loopne 6f35 <.literal16+0xc65>
+ .byte 224,7 // loopne 6dc5 <.literal16+0xc45>
.byte 0,0 // add %al,(%rax)
.byte 33,8 // and %ecx,(%rax)
.byte 2,58 // add (%rdx),%bh
@@ -43040,13 +42510,13 @@ BALIGN16
.byte 65,0,0 // add %al,(%r8)
.byte 248 // clc
.byte 65,0,0 // add %al,(%r8)
- .byte 124,66 // jl 6fc6 <.literal16+0xcf6>
+ .byte 124,66 // jl 6e56 <.literal16+0xcd6>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6fca <.literal16+0xcfa>
+ .byte 124,66 // jl 6e5a <.literal16+0xcda>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6fce <.literal16+0xcfe>
+ .byte 124,66 // jl 6e5e <.literal16+0xcde>
.byte 0,0 // add %al,(%rax)
- .byte 124,66 // jl 6fd2 <.literal16+0xd02>
+ .byte 124,66 // jl 6e62 <.literal16+0xce2>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%rax)
.byte 0,240 // add %dh,%al
@@ -43180,13 +42650,13 @@ BALIGN16
.byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%rax)
.byte 61,137,136,136,61 // cmp $0x3d888889,%eax
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 7155 <.literal16+0xe85>
+ .byte 112,65 // jo 6fe5 <.literal16+0xe65>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 7159 <.literal16+0xe89>
+ .byte 112,65 // jo 6fe9 <.literal16+0xe69>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 715d <.literal16+0xe8d>
+ .byte 112,65 // jo 6fed <.literal16+0xe6d>
.byte 0,0 // add %al,(%rax)
- .byte 112,65 // jo 7161 <.literal16+0xe91>
+ .byte 112,65 // jo 6ff1 <.literal16+0xe71>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -43217,19 +42687,19 @@ BALIGN16
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%rax)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71cb <.literal16+0xefb>
+ .byte 127,67 // jg 705b <.literal16+0xedb>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71cf <.literal16+0xeff>
+ .byte 127,67 // jg 705f <.literal16+0xedf>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71d3 <.literal16+0xf03>
+ .byte 127,67 // jg 7063 <.literal16+0xee3>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71d7 <.literal16+0xf07>
+ .byte 127,67 // jg 7067 <.literal16+0xee7>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71db <.literal16+0xf0b>
+ .byte 127,67 // jg 706b <.literal16+0xeeb>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71df <.literal16+0xf0f>
+ .byte 127,67 // jg 706f <.literal16+0xeef>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 71e3 <.literal16+0xf13>
+ .byte 127,67 // jg 7073 <.literal16+0xef3>
.byte 255,0 // incl (%rax)
.byte 0,0 // add %al,(%rax)
.byte 255,0 // incl (%rax)
@@ -43260,11 +42730,11 @@ BALIGN16
.byte 128,59,129 // cmpb $0x81,(%rbx)
.byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%rax)
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 724b <.literal16+0xf7b>
+ .byte 127,67 // jg 70db <.literal16+0xf5b>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 724f <.literal16+0xf7f>
+ .byte 127,67 // jg 70df <.literal16+0xf5f>
.byte 0,0 // add %al,(%rax)
- .byte 127,67 // jg 7253 <.literal16+0xf83>
+ .byte 127,67 // jg 70e3 <.literal16+0xf63>
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
.byte 0,0 // add %al,(%rax)
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%rax)
@@ -43360,13 +42830,13 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 255 // (bad)
- .byte 127,71 // jg 737b <.literal16+0x10ab>
+ .byte 127,71 // jg 720b <.literal16+0x108b>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 737f <.literal16+0x10af>
+ .byte 127,71 // jg 720f <.literal16+0x108f>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 7383 <.literal16+0x10b3>
+ .byte 127,71 // jg 7213 <.literal16+0x1093>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg 7387 <.literal16+0x10b7>
+ .byte 127,71 // jg 7217 <.literal16+0x1097>
.byte 0,0 // add %al,(%rax)
.byte 128,63,0 // cmpb $0x0,(%rdi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%rax)
@@ -43443,10 +42913,10 @@ BALIGN16
.byte 61,152,221,147,61 // cmp $0x3d93dd98,%eax
.byte 152 // cwtl
.byte 221,147,61,45,16,17 // fstl 0x11102d3d(%rbx)
- .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc0851a <_sk_callback_sse2+0x2dc02346>
+ .byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110(%rip) # 2dc083aa <_sk_callback_sse2+0x2dc0231b>
.byte 17,192 // adc %eax,%eax
.byte 45,16,17,192,18 // sub $0x12c01110,%eax
- .byte 120,57 // js 744c <.literal16+0x117c>
+ .byte 120,57 // js 72dc <.literal16+0x115c>
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
.byte 64,18,120,57 // adc 0x39(%rax),%dil
@@ -43633,11 +43103,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 7632 <.literal16+0x1362>
+ .byte 62,114,28 // jb,pt 74c2 <.literal16+0x1342>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7636 <.literal16+0x1366>
+ .byte 62,114,28 // jb,pt 74c6 <.literal16+0x1346>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 763a <.literal16+0x136a>
+ .byte 62,114,28 // jb,pt 74ca <.literal16+0x134a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -43681,7 +43151,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d6404c5 <_sk_callback_sse2+0x3d63a2f1>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640355 <_sk_callback_sse2+0x3d63a2c6>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -43707,7 +43177,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640505 <_sk_callback_sse2+0x3d63a331>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640395 <_sk_callback_sse2+0x3d63a306>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -43716,13 +43186,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 76fe <.literal16+0x142e>
+ .byte 114,28 // jb 758e <.literal16+0x140e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7702 <.literal16+0x1432>
+ .byte 62,114,28 // jb,pt 7592 <.literal16+0x1412>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7706 <.literal16+0x1436>
+ .byte 62,114,28 // jb,pt 7596 <.literal16+0x1416>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 770a <.literal16+0x143a>
+ .byte 62,114,28 // jb,pt 759a <.literal16+0x141a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -43743,11 +43213,11 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 128,63,114 // cmpb $0x72,(%rdi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt 7742 <.literal16+0x1472>
+ .byte 62,114,28 // jb,pt 75d2 <.literal16+0x1452>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7746 <.literal16+0x1476>
+ .byte 62,114,28 // jb,pt 75d6 <.literal16+0x1456>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 774a <.literal16+0x147a>
+ .byte 62,114,28 // jb,pt 75da <.literal16+0x145a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -43791,7 +43261,7 @@ BALIGN16
.byte 0,0 // add %al,(%rax)
.byte 0,63 // add %bh,(%rdi)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d6405d5 <_sk_callback_sse2+0x3d63a401>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640465 <_sk_callback_sse2+0x3d63a3d6>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 0,63 // add %bh,(%rdi)
.byte 0,0 // add %al,(%rax)
@@ -43817,7 +43287,7 @@ BALIGN16
.byte 0,192 // add %al,%al
.byte 63 // (bad)
.byte 57,142,99,61,57,142 // cmp %ecx,-0x71c6c29d(%rsi)
- .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d640615 <_sk_callback_sse2+0x3d63a441>
+ .byte 99,61,57,142,99,61 // movslq 0x3d638e39(%rip),%edi # 3d6404a5 <_sk_callback_sse2+0x3d63a416>
.byte 57,142,99,61,0,0 // cmp %ecx,0x3d63(%rsi)
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
@@ -43826,13 +43296,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%rdi)
.byte 0,192 // add %al,%al
.byte 63 // (bad)
- .byte 114,28 // jb 780e <.literal16+0x153e>
+ .byte 114,28 // jb 769e <.literal16+0x151e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7812 <_sk_callback_sse2+0x163e>
+ .byte 62,114,28 // jb,pt 76a2 <_sk_callback_sse2+0x1613>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 7816 <_sk_callback_sse2+0x1642>
+ .byte 62,114,28 // jb,pt 76a6 <_sk_callback_sse2+0x1617>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt 781a <_sk_callback_sse2+0x1646>
+ .byte 62,114,28 // jb,pt 76aa <_sk_callback_sse2+0x161b>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%rdi)
.byte 170 // stos %al,%es:(%rdi)
@@ -48965,7 +48435,7 @@ _sk_seed_shader_sse2:
.byte 102,15,110,199 // movd %edi,%xmm0
.byte 102,15,112,192,0 // pshufd $0x0,%xmm0,%xmm0
.byte 15,91,200 // cvtdq2ps %xmm0,%xmm1
- .byte 15,40,145,97,146,0,0 // movaps 0x9261(%ecx),%xmm2
+ .byte 15,40,145,225,144,0,0 // movaps 0x90e1(%ecx),%xmm2
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 15,16,0 // movups (%eax),%xmm0
.byte 15,88,193 // addps %xmm1,%xmm0
@@ -48987,7 +48457,7 @@ _sk_seed_shader_sse2:
.byte 137,68,36,4 // mov %eax,0x4(%esp)
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 137,4,36 // mov %eax,(%esp)
- .byte 15,40,145,113,146,0,0 // movaps 0x9271(%ecx),%xmm2
+ .byte 15,40,145,241,144,0,0 // movaps 0x90f1(%ecx),%xmm2
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 255,19 // call *(%ebx)
.byte 131,196,108 // add $0x6c,%esp
@@ -49023,15 +48493,15 @@ _sk_dither_sse2:
.byte 102,15,110,225 // movd %ecx,%xmm4
.byte 102,15,112,252,0 // pshufd $0x0,%xmm4,%xmm7
.byte 102,15,239,253 // pxor %xmm5,%xmm7
- .byte 102,15,111,182,226,145,0,0 // movdqa 0x91e2(%esi),%xmm6
+ .byte 102,15,111,182,98,144,0,0 // movdqa 0x9062(%esi),%xmm6
.byte 102,15,111,207 // movdqa %xmm7,%xmm1
.byte 102,15,219,206 // pand %xmm6,%xmm1
.byte 102,15,219,245 // pand %xmm5,%xmm6
- .byte 102,15,111,134,2,146,0,0 // movdqa 0x9202(%esi),%xmm0
+ .byte 102,15,111,134,130,144,0,0 // movdqa 0x9082(%esi),%xmm0
.byte 102,15,111,231 // movdqa %xmm7,%xmm4
.byte 102,15,219,224 // pand %xmm0,%xmm4
.byte 102,15,219,197 // pand %xmm5,%xmm0
- .byte 102,15,111,158,242,145,0,0 // movdqa 0x91f2(%esi),%xmm3
+ .byte 102,15,111,158,114,144,0,0 // movdqa 0x9072(%esi),%xmm3
.byte 102,15,219,251 // pand %xmm3,%xmm7
.byte 102,15,219,235 // pand %xmm3,%xmm5
.byte 102,15,114,246,4 // pslld $0x4,%xmm6
@@ -49047,8 +48517,8 @@ _sk_dither_sse2:
.byte 102,15,235,224 // por %xmm0,%xmm4
.byte 102,15,235,231 // por %xmm7,%xmm4
.byte 15,91,196 // cvtdq2ps %xmm4,%xmm0
- .byte 15,89,134,18,146,0,0 // mulps 0x9212(%esi),%xmm0
- .byte 15,88,134,34,146,0,0 // addps 0x9222(%esi),%xmm0
+ .byte 15,89,134,146,144,0,0 // mulps 0x9092(%esi),%xmm0
+ .byte 15,88,134,162,144,0,0 // addps 0x90a2(%esi),%xmm0
.byte 139,55 // mov (%edi),%esi
.byte 243,15,16,14 // movss (%esi),%xmm1
.byte 139,117,24 // mov 0x18(%ebp),%esi
@@ -49170,7 +48640,7 @@ _sk_black_color_sse2:
.byte 137,68,36,4 // mov %eax,0x4(%esp)
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 137,4,36 // mov %eax,(%esp)
- .byte 15,40,153,109,144,0,0 // movaps 0x906d(%ecx),%xmm3
+ .byte 15,40,153,237,142,0,0 // movaps 0x8eed(%ecx),%xmm3
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 15,87,201 // xorps %xmm1,%xmm1
.byte 15,87,210 // xorps %xmm2,%xmm2
@@ -49213,7 +48683,7 @@ _sk_white_color_sse2:
.byte 137,68,36,4 // mov %eax,0x4(%esp)
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 137,4,36 // mov %eax,(%esp)
- .byte 15,40,129,11,144,0,0 // movaps 0x900b(%ecx),%xmm0
+ .byte 15,40,129,139,142,0,0 // movaps 0x8e8b(%ecx),%xmm0
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 15,40,216 // movaps %xmm0,%xmm3
@@ -49367,7 +48837,7 @@ _sk_srcatop_sse2:
.byte 88 // pop %eax
.byte 15,40,69,88 // movaps 0x58(%ebp),%xmm0
.byte 15,89,208 // mulps %xmm0,%xmm2
- .byte 15,40,136,92,142,0,0 // movaps 0x8e5c(%eax),%xmm1
+ .byte 15,40,136,220,140,0,0 // movaps 0x8cdc(%eax),%xmm1
.byte 15,92,203 // subps %xmm3,%xmm1
.byte 15,40,249 // movaps %xmm1,%xmm7
.byte 15,89,125,40 // mulps 0x28(%ebp),%xmm7
@@ -49428,7 +48898,7 @@ _sk_dstatop_sse2:
.byte 88 // pop %eax
.byte 15,40,245 // movaps %xmm5,%xmm6
.byte 15,89,117,40 // mulps 0x28(%ebp),%xmm6
- .byte 15,40,184,194,141,0,0 // movaps 0x8dc2(%eax),%xmm7
+ .byte 15,40,184,66,140,0,0 // movaps 0x8c42(%eax),%xmm7
.byte 15,92,125,88 // subps 0x58(%ebp),%xmm7
.byte 15,89,199 // mulps %xmm7,%xmm0
.byte 15,88,198 // addps %xmm6,%xmm0
@@ -49574,7 +49044,7 @@ _sk_srcout_sse2:
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 15,40,109,56 // movaps 0x38(%ebp),%xmm5
.byte 15,40,117,88 // movaps 0x58(%ebp),%xmm6
- .byte 15,40,184,94,140,0,0 // movaps 0x8c5e(%eax),%xmm7
+ .byte 15,40,184,222,138,0,0 // movaps 0x8ade(%eax),%xmm7
.byte 15,92,254 // subps %xmm6,%xmm7
.byte 15,89,199 // mulps %xmm7,%xmm0
.byte 15,89,207 // mulps %xmm7,%xmm1
@@ -49616,7 +49086,7 @@ _sk_dstout_sse2:
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 139,125,24 // mov 0x18(%ebp),%edi
- .byte 15,40,160,246,139,0,0 // movaps 0x8bf6(%eax),%xmm4
+ .byte 15,40,160,118,138,0,0 // movaps 0x8a76(%eax),%xmm4
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
@@ -49666,7 +49136,7 @@ _sk_srcover_sse2:
.byte 232,0,0,0,0 // call 8ba <_sk_srcover_sse2+0x17>
.byte 88 // pop %eax
.byte 15,40,109,40 // movaps 0x28(%ebp),%xmm5
- .byte 15,40,128,118,139,0,0 // movaps 0x8b76(%eax),%xmm0
+ .byte 15,40,128,246,137,0,0 // movaps 0x89f6(%eax),%xmm0
.byte 15,92,195 // subps %xmm3,%xmm0
.byte 15,40,248 // movaps %xmm0,%xmm7
.byte 15,89,253 // mulps %xmm5,%xmm7
@@ -49724,7 +49194,7 @@ _sk_dstover_sse2:
.byte 139,77,16 // mov 0x10(%ebp),%ecx
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 139,125,24 // mov 0x18(%ebp),%edi
- .byte 15,40,162,239,138,0,0 // movaps 0x8aef(%edx),%xmm4
+ .byte 15,40,162,111,137,0,0 // movaps 0x896f(%edx),%xmm4
.byte 139,85,12 // mov 0xc(%ebp),%edx
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 15,40,117,56 // movaps 0x38(%ebp),%xmm6
@@ -49812,7 +49282,7 @@ _sk_multiply_sse2:
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 232,0,0,0,0 // call a47 <_sk_multiply_sse2+0x18>
.byte 88 // pop %eax
- .byte 15,40,144,9,138,0,0 // movaps 0x8a09(%eax),%xmm2
+ .byte 15,40,144,137,136,0,0 // movaps 0x8889(%eax),%xmm2
.byte 15,40,250 // movaps %xmm2,%xmm7
.byte 15,92,125,88 // subps 0x58(%ebp),%xmm7
.byte 15,40,231 // movaps %xmm7,%xmm4
@@ -49988,7 +49458,7 @@ _sk_xor__sse2:
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
.byte 232,0,0,0,0 // call c2e <_sk_xor__sse2+0x12>
.byte 88 // pop %eax
- .byte 15,40,176,50,136,0,0 // movaps 0x8832(%eax),%xmm6
+ .byte 15,40,176,178,134,0,0 // movaps 0x86b2(%eax),%xmm6
.byte 15,40,254 // movaps %xmm6,%xmm7
.byte 15,92,125,88 // subps 0x58(%ebp),%xmm7
.byte 15,89,199 // mulps %xmm7,%xmm0
@@ -50074,7 +49544,7 @@ _sk_darken_sse2:
.byte 15,92,226 // subps %xmm2,%xmm4
.byte 232,0,0,0,0 // call d28 <_sk_darken_sse2+0x63>
.byte 88 // pop %eax
- .byte 15,40,144,72,135,0,0 // movaps 0x8748(%eax),%xmm2
+ .byte 15,40,144,200,133,0,0 // movaps 0x85c8(%eax),%xmm2
.byte 15,92,214 // subps %xmm6,%xmm2
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
.byte 15,89,213 // mulps %xmm5,%xmm2
@@ -50144,7 +49614,7 @@ _sk_lighten_sse2:
.byte 15,92,226 // subps %xmm2,%xmm4
.byte 232,0,0,0,0 // call ded <_sk_lighten_sse2+0x63>
.byte 88 // pop %eax
- .byte 15,40,144,147,134,0,0 // movaps 0x8693(%eax),%xmm2
+ .byte 15,40,144,19,133,0,0 // movaps 0x8513(%eax),%xmm2
.byte 15,92,214 // subps %xmm6,%xmm2
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
.byte 15,89,213 // mulps %xmm5,%xmm2
@@ -50217,7 +49687,7 @@ _sk_difference_sse2:
.byte 15,92,226 // subps %xmm2,%xmm4
.byte 232,0,0,0,0 // call ebb <_sk_difference_sse2+0x6c>
.byte 88 // pop %eax
- .byte 15,40,144,213,133,0,0 // movaps 0x85d5(%eax),%xmm2
+ .byte 15,40,144,85,132,0,0 // movaps 0x8455(%eax),%xmm2
.byte 15,92,214 // subps %xmm6,%xmm2
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
.byte 15,89,213 // mulps %xmm5,%xmm2
@@ -50279,7 +49749,7 @@ _sk_exclusion_sse2:
.byte 15,89,213 // mulps %xmm5,%xmm2
.byte 15,88,210 // addps %xmm2,%xmm2
.byte 15,92,226 // subps %xmm2,%xmm4
- .byte 15,40,144,111,133,0,0 // movaps 0x856f(%eax),%xmm2
+ .byte 15,40,144,239,131,0,0 // movaps 0x83ef(%eax),%xmm2
.byte 15,92,211 // subps %xmm3,%xmm2
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
.byte 15,89,213 // mulps %xmm5,%xmm2
@@ -50335,7 +49805,7 @@ _sk_colorburn_sse2:
.byte 15,40,196 // movaps %xmm4,%xmm0
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,92,238 // subps %xmm6,%xmm5
- .byte 15,40,176,206,132,0,0 // movaps 0x84ce(%eax),%xmm6
+ .byte 15,40,176,78,131,0,0 // movaps 0x834e(%eax),%xmm6
.byte 15,40,230 // movaps %xmm6,%xmm4
.byte 15,92,224 // subps %xmm0,%xmm4
.byte 15,40,220 // movaps %xmm4,%xmm3
@@ -50478,7 +49948,7 @@ _sk_colordodge_sse2:
.byte 15,94,212 // divps %xmm4,%xmm2
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 15,93,226 // minps %xmm2,%xmm4
- .byte 15,40,152,28,131,0,0 // movaps 0x831c(%eax),%xmm3
+ .byte 15,40,152,156,129,0,0 // movaps 0x819c(%eax),%xmm3
.byte 15,40,211 // movaps %xmm3,%xmm2
.byte 15,92,208 // subps %xmm0,%xmm2
.byte 15,41,85,216 // movaps %xmm2,-0x28(%ebp)
@@ -50604,7 +50074,7 @@ _sk_hardlight_sse2:
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 232,0,0,0,0 // call 1346 <_sk_hardlight_sse2+0x1a>
.byte 88 // pop %eax
- .byte 15,40,176,138,129,0,0 // movaps 0x818a(%eax),%xmm6
+ .byte 15,40,176,10,128,0,0 // movaps 0x800a(%eax),%xmm6
.byte 15,40,206 // movaps %xmm6,%xmm1
.byte 15,92,77,88 // subps 0x58(%ebp),%xmm1
.byte 15,41,77,184 // movaps %xmm1,-0x48(%ebp)
@@ -50731,7 +50201,7 @@ _sk_overlay_sse2:
.byte 232,0,0,0,0 // call 14d1 <_sk_overlay_sse2+0x18>
.byte 88 // pop %eax
.byte 15,40,69,88 // movaps 0x58(%ebp),%xmm0
- .byte 15,40,144,15,128,0,0 // movaps 0x800f(%eax),%xmm2
+ .byte 15,40,144,143,126,0,0 // movaps 0x7e8f(%eax),%xmm2
.byte 15,40,234 // movaps %xmm2,%xmm5
.byte 15,92,232 // subps %xmm0,%xmm5
.byte 15,40,248 // movaps %xmm0,%xmm7
@@ -50875,17 +50345,17 @@ _sk_softlight_sse2:
.byte 232,0,0,0,0 // call 16a0 <_sk_softlight_sse2+0x51>
.byte 88 // pop %eax
.byte 15,40,233 // movaps %xmm1,%xmm5
- .byte 15,40,128,96,126,0,0 // movaps 0x7e60(%eax),%xmm0
+ .byte 15,40,128,224,124,0,0 // movaps 0x7ce0(%eax),%xmm0
.byte 15,41,133,120,255,255,255 // movaps %xmm0,-0x88(%ebp)
.byte 15,88,232 // addps %xmm0,%xmm5
.byte 15,89,234 // mulps %xmm2,%xmm5
- .byte 15,40,184,80,126,0,0 // movaps 0x7e50(%eax),%xmm7
+ .byte 15,40,184,208,124,0,0 // movaps 0x7cd0(%eax),%xmm7
.byte 15,41,125,216 // movaps %xmm7,-0x28(%ebp)
.byte 15,92,249 // subps %xmm1,%xmm7
.byte 15,82,209 // rsqrtps %xmm1,%xmm2
.byte 15,83,242 // rcpps %xmm2,%xmm6
.byte 15,92,241 // subps %xmm1,%xmm6
- .byte 15,40,128,112,126,0,0 // movaps 0x7e70(%eax),%xmm0
+ .byte 15,40,128,240,124,0,0 // movaps 0x7cf0(%eax),%xmm0
.byte 15,41,69,168 // movaps %xmm0,-0x58(%ebp)
.byte 15,89,200 // mulps %xmm0,%xmm1
.byte 15,88,205 // addps %xmm5,%xmm1
@@ -51098,7 +50568,7 @@ _sk_hue_sse2:
.byte 15,41,101,200 // movaps %xmm4,-0x38(%ebp)
.byte 15,40,233 // movaps %xmm1,%xmm5
.byte 15,89,238 // mulps %xmm6,%xmm5
- .byte 15,40,184,223,123,0,0 // movaps 0x7bdf(%eax),%xmm7
+ .byte 15,40,184,95,122,0,0 // movaps 0x7a5f(%eax),%xmm7
.byte 15,41,125,168 // movaps %xmm7,-0x58(%ebp)
.byte 15,92,125,88 // subps 0x58(%ebp),%xmm7
.byte 15,89,199 // mulps %xmm7,%xmm0
@@ -51128,15 +50598,15 @@ _sk_hue_sse2:
.byte 15,89,243 // mulps %xmm3,%xmm6
.byte 15,89,235 // mulps %xmm3,%xmm5
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,40,152,175,123,0,0 // movaps 0x7baf(%eax),%xmm3
+ .byte 15,40,152,47,122,0,0 // movaps 0x7a2f(%eax),%xmm3
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
.byte 15,40,77,40 // movaps 0x28(%ebp),%xmm1
.byte 15,89,203 // mulps %xmm3,%xmm1
- .byte 15,40,160,191,123,0,0 // movaps 0x7bbf(%eax),%xmm4
+ .byte 15,40,160,63,122,0,0 // movaps 0x7a3f(%eax),%xmm4
.byte 15,40,125,56 // movaps 0x38(%ebp),%xmm7
.byte 15,89,252 // mulps %xmm4,%xmm7
.byte 15,88,249 // addps %xmm1,%xmm7
- .byte 15,40,152,207,123,0,0 // movaps 0x7bcf(%eax),%xmm3
+ .byte 15,40,152,79,122,0,0 // movaps 0x7a4f(%eax),%xmm3
.byte 15,40,77,72 // movaps 0x48(%ebp),%xmm1
.byte 15,89,203 // mulps %xmm3,%xmm1
.byte 15,88,207 // addps %xmm7,%xmm1
@@ -51351,15 +50821,15 @@ _sk_saturation_sse2:
.byte 15,89,254 // mulps %xmm6,%xmm7
.byte 232,0,0,0,0 // call 1cbf <_sk_saturation_sse2+0x8e>
.byte 88 // pop %eax
- .byte 15,40,176,161,120,0,0 // movaps 0x78a1(%eax),%xmm6
+ .byte 15,40,176,33,119,0,0 // movaps 0x7721(%eax),%xmm6
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 15,89,214 // mulps %xmm6,%xmm2
- .byte 15,40,160,177,120,0,0 // movaps 0x78b1(%eax),%xmm4
+ .byte 15,40,160,49,119,0,0 // movaps 0x7731(%eax),%xmm4
.byte 15,40,77,56 // movaps 0x38(%ebp),%xmm1
.byte 15,89,204 // mulps %xmm4,%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 15,40,85,72 // movaps 0x48(%ebp),%xmm2
- .byte 15,89,144,193,120,0,0 // mulps 0x78c1(%eax),%xmm2
+ .byte 15,89,144,65,119,0,0 // mulps 0x7741(%eax),%xmm2
.byte 15,88,209 // addps %xmm1,%xmm2
.byte 15,94,232 // divps %xmm0,%xmm5
.byte 15,94,216 // divps %xmm0,%xmm3
@@ -51375,7 +50845,7 @@ _sk_saturation_sse2:
.byte 15,89,252 // mulps %xmm4,%xmm7
.byte 15,88,249 // addps %xmm1,%xmm7
.byte 15,40,200 // movaps %xmm0,%xmm1
- .byte 15,89,136,193,120,0,0 // mulps 0x78c1(%eax),%xmm1
+ .byte 15,89,136,65,119,0,0 // mulps 0x7741(%eax),%xmm1
.byte 15,88,207 // addps %xmm7,%xmm1
.byte 15,89,85,216 // mulps -0x28(%ebp),%xmm2
.byte 15,92,209 // subps %xmm1,%xmm2
@@ -51395,7 +50865,7 @@ _sk_saturation_sse2:
.byte 15,89,245 // mulps %xmm5,%xmm6
.byte 15,89,227 // mulps %xmm3,%xmm4
.byte 15,88,230 // addps %xmm6,%xmm4
- .byte 15,40,128,193,120,0,0 // movaps 0x78c1(%eax),%xmm0
+ .byte 15,40,128,65,119,0,0 // movaps 0x7741(%eax),%xmm0
.byte 15,89,194 // mulps %xmm2,%xmm0
.byte 15,88,196 // addps %xmm4,%xmm0
.byte 15,41,69,136 // movaps %xmm0,-0x78(%ebp)
@@ -51418,7 +50888,7 @@ _sk_saturation_sse2:
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 15,40,69,88 // movaps 0x58(%ebp),%xmm0
.byte 15,89,200 // mulps %xmm0,%xmm1
- .byte 15,40,144,209,120,0,0 // movaps 0x78d1(%eax),%xmm2
+ .byte 15,40,144,81,119,0,0 // movaps 0x7751(%eax),%xmm2
.byte 15,41,85,152 // movaps %xmm2,-0x68(%ebp)
.byte 15,92,212 // subps %xmm4,%xmm2
.byte 15,41,85,168 // movaps %xmm2,-0x58(%ebp)
@@ -51548,15 +51018,15 @@ _sk_color_sse2:
.byte 88 // pop %eax
.byte 15,40,85,56 // movaps 0x38(%ebp),%xmm2
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
- .byte 15,40,152,90,118,0,0 // movaps 0x765a(%eax),%xmm3
+ .byte 15,40,152,218,116,0,0 // movaps 0x74da(%eax),%xmm3
.byte 15,89,227 // mulps %xmm3,%xmm4
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
- .byte 15,40,176,106,118,0,0 // movaps 0x766a(%eax),%xmm6
+ .byte 15,40,176,234,116,0,0 // movaps 0x74ea(%eax),%xmm6
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,41,117,184 // movaps %xmm6,-0x48(%ebp)
.byte 15,88,212 // addps %xmm4,%xmm2
.byte 15,40,101,72 // movaps 0x48(%ebp),%xmm4
- .byte 15,40,184,122,118,0,0 // movaps 0x767a(%eax),%xmm7
+ .byte 15,40,184,250,116,0,0 // movaps 0x74fa(%eax),%xmm7
.byte 15,41,189,56,255,255,255 // movaps %xmm7,-0xc8(%ebp)
.byte 15,89,231 // mulps %xmm7,%xmm4
.byte 15,88,226 // addps %xmm2,%xmm4
@@ -51571,7 +51041,7 @@ _sk_color_sse2:
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 15,89,214 // mulps %xmm6,%xmm2
.byte 15,88,212 // addps %xmm4,%xmm2
- .byte 15,40,136,138,118,0,0 // movaps 0x768a(%eax),%xmm1
+ .byte 15,40,136,10,117,0,0 // movaps 0x750a(%eax),%xmm1
.byte 15,41,77,168 // movaps %xmm1,-0x58(%ebp)
.byte 15,40,225 // movaps %xmm1,%xmm4
.byte 15,40,93,88 // movaps 0x58(%ebp),%xmm3
@@ -51752,17 +51222,17 @@ _sk_luminosity_sse2:
.byte 15,40,216 // movaps %xmm0,%xmm3
.byte 232,0,0,0,0 // call 21f9 <_sk_luminosity_sse2+0x1a>
.byte 88 // pop %eax
- .byte 15,40,160,231,115,0,0 // movaps 0x73e7(%eax),%xmm4
+ .byte 15,40,160,103,114,0,0 // movaps 0x7267(%eax),%xmm4
.byte 15,41,101,216 // movaps %xmm4,-0x28(%ebp)
.byte 15,40,211 // movaps %xmm3,%xmm2
.byte 15,89,212 // mulps %xmm4,%xmm2
- .byte 15,40,128,247,115,0,0 // movaps 0x73f7(%eax),%xmm0
+ .byte 15,40,128,119,114,0,0 // movaps 0x7277(%eax),%xmm0
.byte 15,41,69,200 // movaps %xmm0,-0x38(%ebp)
.byte 15,40,225 // movaps %xmm1,%xmm4
.byte 15,89,224 // mulps %xmm0,%xmm4
.byte 15,88,226 // addps %xmm2,%xmm4
.byte 15,40,85,88 // movaps 0x58(%ebp),%xmm2
- .byte 15,40,184,23,116,0,0 // movaps 0x7417(%eax),%xmm7
+ .byte 15,40,184,151,114,0,0 // movaps 0x7297(%eax),%xmm7
.byte 15,41,125,152 // movaps %xmm7,-0x68(%ebp)
.byte 15,92,250 // subps %xmm2,%xmm7
.byte 15,89,223 // mulps %xmm7,%xmm3
@@ -51772,7 +51242,7 @@ _sk_luminosity_sse2:
.byte 15,89,253 // mulps %xmm5,%xmm7
.byte 15,41,189,120,255,255,255 // movaps %xmm7,-0x88(%ebp)
.byte 15,40,205 // movaps %xmm5,%xmm1
- .byte 15,40,128,7,116,0,0 // movaps 0x7407(%eax),%xmm0
+ .byte 15,40,128,135,114,0,0 // movaps 0x7287(%eax),%xmm0
.byte 15,89,200 // mulps %xmm0,%xmm1
.byte 15,88,204 // addps %xmm4,%xmm1
.byte 15,40,238 // movaps %xmm6,%xmm5
@@ -51957,7 +51427,7 @@ _sk_srcover_rgba_8888_sse2:
.byte 133,210 // test %edx,%edx
.byte 15,133,40,1,0,0 // jne 25cb <_sk_srcover_rgba_8888_sse2+0x15d>
.byte 243,15,111,12,142 // movdqu (%esi,%ecx,4),%xmm1
- .byte 102,15,111,135,147,113,0,0 // movdqa 0x7193(%edi),%xmm0
+ .byte 102,15,111,135,19,112,0,0 // movdqa 0x7013(%edi),%xmm0
.byte 102,15,111,225 // movdqa %xmm1,%xmm4
.byte 102,15,219,224 // pand %xmm0,%xmm4
.byte 102,15,111,249 // movdqa %xmm1,%xmm7
@@ -51967,9 +51437,9 @@ _sk_srcover_rgba_8888_sse2:
.byte 102,15,114,213,16 // psrld $0x10,%xmm5
.byte 102,15,219,232 // pand %xmm0,%xmm5
.byte 15,91,244 // cvtdq2ps %xmm4,%xmm6
- .byte 15,40,167,163,113,0,0 // movaps 0x71a3(%edi),%xmm4
+ .byte 15,40,167,35,112,0,0 // movaps 0x7023(%edi),%xmm4
.byte 15,92,227 // subps %xmm3,%xmm4
- .byte 15,40,135,179,113,0,0 // movaps 0x71b3(%edi),%xmm0
+ .byte 15,40,135,51,112,0,0 // movaps 0x7033(%edi),%xmm0
.byte 15,41,69,216 // movaps %xmm0,-0x28(%ebp)
.byte 15,40,85,200 // movaps -0x38(%ebp),%xmm2
.byte 15,89,208 // mulps %xmm0,%xmm2
@@ -52128,7 +51598,7 @@ _sk_clamp_1_sse2:
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 15,40,109,56 // movaps 0x38(%ebp),%xmm5
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
- .byte 15,40,184,141,111,0,0 // movaps 0x6f8d(%eax),%xmm7
+ .byte 15,40,184,13,110,0,0 // movaps 0x6e0d(%eax),%xmm7
.byte 15,93,199 // minps %xmm7,%xmm0
.byte 15,93,207 // minps %xmm7,%xmm1
.byte 15,93,215 // minps %xmm7,%xmm2
@@ -52173,7 +51643,7 @@ _sk_clamp_a_sse2:
.byte 15,40,109,56 // movaps 0x38(%ebp),%xmm5
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
.byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
- .byte 15,93,152,40,111,0,0 // minps 0x6f28(%eax),%xmm3
+ .byte 15,93,152,168,109,0,0 // minps 0x6da8(%eax),%xmm3
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 15,93,195 // minps %xmm3,%xmm0
.byte 15,93,203 // minps %xmm3,%xmm1
@@ -52213,7 +51683,7 @@ _sk_clamp_a_dst_sse2:
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 139,125,24 // mov 0x18(%ebp),%edi
.byte 15,40,101,88 // movaps 0x58(%ebp),%xmm4
- .byte 15,93,160,198,110,0,0 // minps 0x6ec6(%eax),%xmm4
+ .byte 15,93,160,70,109,0,0 // minps 0x6d46(%eax),%xmm4
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 15,40,117,56 // movaps 0x38(%ebp),%xmm6
@@ -52452,7 +51922,7 @@ _sk_unpremul_sse2:
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 15,40,109,56 // movaps 0x38(%ebp),%xmm5
.byte 15,87,246 // xorps %xmm6,%xmm6
- .byte 15,40,185,121,108,0,0 // movaps 0x6c79(%ecx),%xmm7
+ .byte 15,40,185,249,106,0,0 // movaps 0x6af9(%ecx),%xmm7
.byte 15,94,251 // divps %xmm3,%xmm7
.byte 15,194,243,4 // cmpneqps %xmm3,%xmm6
.byte 15,84,247 // andps %xmm7,%xmm6
@@ -52498,19 +51968,19 @@ _sk_from_srgb_sse2:
.byte 88 // pop %eax
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,89,219 // mulps %xmm3,%xmm3
- .byte 15,40,160,10,108,0,0 // movaps 0x6c0a(%eax),%xmm4
+ .byte 15,40,160,138,106,0,0 // movaps 0x6a8a(%eax),%xmm4
.byte 15,89,196 // mulps %xmm4,%xmm0
- .byte 15,40,136,26,108,0,0 // movaps 0x6c1a(%eax),%xmm1
+ .byte 15,40,136,154,106,0,0 // movaps 0x6a9a(%eax),%xmm1
.byte 15,41,77,200 // movaps %xmm1,-0x38(%ebp)
.byte 15,88,193 // addps %xmm1,%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,40,152,250,107,0,0 // movaps 0x6bfa(%eax),%xmm3
+ .byte 15,40,152,122,106,0,0 // movaps 0x6a7a(%eax),%xmm3
.byte 15,40,202 // movaps %xmm2,%xmm1
.byte 15,89,203 // mulps %xmm3,%xmm1
- .byte 15,40,184,42,108,0,0 // movaps 0x6c2a(%eax),%xmm7
+ .byte 15,40,184,170,106,0,0 // movaps 0x6aaa(%eax),%xmm7
.byte 15,41,125,216 // movaps %xmm7,-0x28(%ebp)
.byte 15,88,199 // addps %xmm7,%xmm0
- .byte 15,40,184,58,108,0,0 // movaps 0x6c3a(%eax),%xmm7
+ .byte 15,40,184,186,106,0,0 // movaps 0x6aba(%eax),%xmm7
.byte 15,194,215,1 // cmpltps %xmm7,%xmm2
.byte 15,84,202 // andps %xmm2,%xmm1
.byte 15,85,208 // andnps %xmm0,%xmm2
@@ -52589,19 +52059,19 @@ _sk_from_srgb_dst_sse2:
.byte 15,40,77,40 // movaps 0x28(%ebp),%xmm1
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
- .byte 15,40,168,55,107,0,0 // movaps 0x6b37(%eax),%xmm5
+ .byte 15,40,168,183,105,0,0 // movaps 0x69b7(%eax),%xmm5
.byte 15,40,249 // movaps %xmm1,%xmm7
.byte 15,89,253 // mulps %xmm5,%xmm7
- .byte 15,40,144,71,107,0,0 // movaps 0x6b47(%eax),%xmm2
+ .byte 15,40,144,199,105,0,0 // movaps 0x69c7(%eax),%xmm2
.byte 15,41,85,216 // movaps %xmm2,-0x28(%ebp)
.byte 15,88,250 // addps %xmm2,%xmm7
.byte 15,89,248 // mulps %xmm0,%xmm7
- .byte 15,40,176,39,107,0,0 // movaps 0x6b27(%eax),%xmm6
+ .byte 15,40,176,167,105,0,0 // movaps 0x69a7(%eax),%xmm6
.byte 15,40,225 // movaps %xmm1,%xmm4
.byte 15,89,230 // mulps %xmm6,%xmm4
- .byte 15,40,152,87,107,0,0 // movaps 0x6b57(%eax),%xmm3
+ .byte 15,40,152,215,105,0,0 // movaps 0x69d7(%eax),%xmm3
.byte 15,88,251 // addps %xmm3,%xmm7
- .byte 15,40,144,103,107,0,0 // movaps 0x6b67(%eax),%xmm2
+ .byte 15,40,144,231,105,0,0 // movaps 0x69e7(%eax),%xmm2
.byte 15,194,202,1 // cmpltps %xmm2,%xmm1
.byte 15,84,225 // andps %xmm1,%xmm4
.byte 15,85,207 // andnps %xmm7,%xmm1
@@ -52677,25 +52147,25 @@ _sk_to_srgb_sse2:
.byte 232,0,0,0,0 // call 2cd9 <_sk_to_srgb_sse2+0x1e>
.byte 88 // pop %eax
.byte 15,82,218 // rsqrtps %xmm2,%xmm3
- .byte 15,40,160,103,106,0,0 // movaps 0x6a67(%eax),%xmm4
+ .byte 15,40,160,231,104,0,0 // movaps 0x68e7(%eax),%xmm4
.byte 15,40,235 // movaps %xmm3,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
- .byte 15,40,128,119,106,0,0 // movaps 0x6a77(%eax),%xmm0
+ .byte 15,40,128,247,104,0,0 // movaps 0x68f7(%eax),%xmm0
.byte 15,41,69,216 // movaps %xmm0,-0x28(%ebp)
.byte 15,88,232 // addps %xmm0,%xmm5
.byte 15,89,235 // mulps %xmm3,%xmm5
- .byte 15,40,128,135,106,0,0 // movaps 0x6a87(%eax),%xmm0
+ .byte 15,40,128,7,105,0,0 // movaps 0x6907(%eax),%xmm0
.byte 15,41,69,184 // movaps %xmm0,-0x48(%ebp)
.byte 15,88,232 // addps %xmm0,%xmm5
- .byte 15,40,128,151,106,0,0 // movaps 0x6a97(%eax),%xmm0
+ .byte 15,40,128,23,105,0,0 // movaps 0x6917(%eax),%xmm0
.byte 15,41,69,200 // movaps %xmm0,-0x38(%ebp)
.byte 15,88,216 // addps %xmm0,%xmm3
.byte 15,83,195 // rcpps %xmm3,%xmm0
.byte 15,89,197 // mulps %xmm5,%xmm0
- .byte 15,40,168,87,106,0,0 // movaps 0x6a57(%eax),%xmm5
+ .byte 15,40,168,215,104,0,0 // movaps 0x68d7(%eax),%xmm5
.byte 15,40,202 // movaps %xmm2,%xmm1
.byte 15,89,205 // mulps %xmm5,%xmm1
- .byte 15,40,152,167,106,0,0 // movaps 0x6aa7(%eax),%xmm3
+ .byte 15,40,152,39,105,0,0 // movaps 0x6927(%eax),%xmm3
.byte 15,194,211,1 // cmpltps %xmm3,%xmm2
.byte 15,84,202 // andps %xmm2,%xmm1
.byte 15,85,208 // andnps %xmm0,%xmm2
@@ -52784,13 +52254,13 @@ _sk_rgb_to_hsl_sse2:
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 15,92,199 // subps %xmm7,%xmm0
.byte 15,41,69,200 // movaps %xmm0,-0x38(%ebp)
- .byte 15,40,152,120,105,0,0 // movaps 0x6978(%eax),%xmm3
+ .byte 15,40,152,248,103,0,0 // movaps 0x67f8(%eax),%xmm3
.byte 15,94,216 // divps %xmm0,%xmm3
.byte 15,40,197 // movaps %xmm5,%xmm0
.byte 15,92,194 // subps %xmm2,%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
.byte 15,194,234,1 // cmpltps %xmm2,%xmm5
- .byte 15,84,168,136,105,0,0 // andps 0x6988(%eax),%xmm5
+ .byte 15,84,168,8,104,0,0 // andps 0x6808(%eax),%xmm5
.byte 15,88,232 // addps %xmm0,%xmm5
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 15,194,196,0 // cmpeqps %xmm4,%xmm0
@@ -52800,9 +52270,9 @@ _sk_rgb_to_hsl_sse2:
.byte 15,92,101,216 // subps -0x28(%ebp),%xmm4
.byte 15,89,211 // mulps %xmm3,%xmm2
.byte 15,89,227 // mulps %xmm3,%xmm4
- .byte 15,40,152,152,105,0,0 // movaps 0x6998(%eax),%xmm3
+ .byte 15,40,152,24,104,0,0 // movaps 0x6818(%eax),%xmm3
.byte 15,88,211 // addps %xmm3,%xmm2
- .byte 15,88,160,168,105,0,0 // addps 0x69a8(%eax),%xmm4
+ .byte 15,88,160,40,104,0,0 // addps 0x6828(%eax),%xmm4
.byte 15,84,214 // andps %xmm6,%xmm2
.byte 15,85,244 // andnps %xmm4,%xmm6
.byte 15,86,242 // orps %xmm2,%xmm6
@@ -52817,7 +52287,7 @@ _sk_rgb_to_hsl_sse2:
.byte 15,194,231,4 // cmpneqps %xmm7,%xmm4
.byte 15,92,217 // subps %xmm1,%xmm3
.byte 15,88,207 // addps %xmm7,%xmm1
- .byte 15,40,168,200,105,0,0 // movaps 0x69c8(%eax),%xmm5
+ .byte 15,40,168,72,104,0,0 // movaps 0x6848(%eax),%xmm5
.byte 15,92,223 // subps %xmm7,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 15,89,213 // mulps %xmm5,%xmm2
@@ -52830,7 +52300,7 @@ _sk_rgb_to_hsl_sse2:
.byte 15,40,77,200 // movaps -0x38(%ebp),%xmm1
.byte 15,94,205 // divps %xmm5,%xmm1
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
- .byte 15,89,128,184,105,0,0 // mulps 0x69b8(%eax),%xmm0
+ .byte 15,89,128,56,104,0,0 // mulps 0x6838(%eax),%xmm0
.byte 15,84,196 // andps %xmm4,%xmm0
.byte 15,84,204 // andps %xmm4,%xmm1
.byte 15,40,101,88 // movaps 0x58(%ebp),%xmm4
@@ -52868,7 +52338,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,41,69,200 // movaps %xmm0,-0x38(%ebp)
.byte 232,0,0,0,0 // call 2f4d <_sk_hsl_to_rgb_sse2+0x1c>
.byte 88 // pop %eax
- .byte 15,40,152,163,104,0,0 // movaps 0x68a3(%eax),%xmm3
+ .byte 15,40,152,35,103,0,0 // movaps 0x6723(%eax),%xmm3
.byte 15,40,227 // movaps %xmm3,%xmm4
.byte 15,40,243 // movaps %xmm3,%xmm6
.byte 15,41,181,72,255,255,255 // movaps %xmm6,-0xb8(%ebp)
@@ -52882,13 +52352,13 @@ _sk_hsl_to_rgb_sse2:
.byte 15,84,236 // andps %xmm4,%xmm5
.byte 15,85,225 // andnps %xmm1,%xmm4
.byte 15,86,229 // orps %xmm5,%xmm4
- .byte 15,40,136,179,104,0,0 // movaps 0x68b3(%eax),%xmm1
+ .byte 15,40,136,51,103,0,0 // movaps 0x6733(%eax),%xmm1
.byte 15,88,200 // addps %xmm0,%xmm1
.byte 243,15,91,193 // cvttps2dq %xmm1,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,217 // movaps %xmm1,%xmm3
.byte 15,194,216,1 // cmpltps %xmm0,%xmm3
- .byte 15,40,168,195,104,0,0 // movaps 0x68c3(%eax),%xmm5
+ .byte 15,40,168,67,103,0,0 // movaps 0x6743(%eax),%xmm5
.byte 15,41,173,104,255,255,255 // movaps %xmm5,-0x98(%ebp)
.byte 15,84,221 // andps %xmm5,%xmm3
.byte 15,92,195 // subps %xmm3,%xmm0
@@ -52899,19 +52369,19 @@ _sk_hsl_to_rgb_sse2:
.byte 15,41,101,184 // movaps %xmm4,-0x48(%ebp)
.byte 15,88,237 // addps %xmm5,%xmm5
.byte 15,92,236 // subps %xmm4,%xmm5
- .byte 15,40,144,211,104,0,0 // movaps 0x68d3(%eax),%xmm2
+ .byte 15,40,144,83,103,0,0 // movaps 0x6753(%eax),%xmm2
.byte 15,41,85,168 // movaps %xmm2,-0x58(%ebp)
.byte 15,194,209,2 // cmpleps %xmm1,%xmm2
.byte 15,92,229 // subps %xmm5,%xmm4
.byte 15,40,198 // movaps %xmm6,%xmm0
.byte 15,194,193,2 // cmpleps %xmm1,%xmm0
- .byte 15,40,176,3,105,0,0 // movaps 0x6903(%eax),%xmm6
+ .byte 15,40,176,131,103,0,0 // movaps 0x6783(%eax),%xmm6
.byte 15,41,181,88,255,255,255 // movaps %xmm6,-0xa8(%ebp)
.byte 15,194,241,2 // cmpleps %xmm1,%xmm6
- .byte 15,40,152,227,104,0,0 // movaps 0x68e3(%eax),%xmm3
+ .byte 15,40,152,99,103,0,0 // movaps 0x6763(%eax),%xmm3
.byte 15,41,93,152 // movaps %xmm3,-0x68(%ebp)
.byte 15,89,203 // mulps %xmm3,%xmm1
- .byte 15,40,184,243,104,0,0 // movaps 0x68f3(%eax),%xmm7
+ .byte 15,40,184,115,103,0,0 // movaps 0x6773(%eax),%xmm7
.byte 15,41,125,136 // movaps %xmm7,-0x78(%ebp)
.byte 15,92,249 // subps %xmm1,%xmm7
.byte 15,89,252 // mulps %xmm4,%xmm7
@@ -52936,18 +52406,18 @@ _sk_hsl_to_rgb_sse2:
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,202 // movaps %xmm2,%xmm1
.byte 15,194,200,1 // cmpltps %xmm0,%xmm1
- .byte 15,84,136,195,104,0,0 // andps 0x68c3(%eax),%xmm1
+ .byte 15,84,136,67,103,0,0 // andps 0x6743(%eax),%xmm1
.byte 15,92,193 // subps %xmm1,%xmm0
.byte 15,40,202 // movaps %xmm2,%xmm1
.byte 15,92,200 // subps %xmm0,%xmm1
- .byte 15,40,128,211,104,0,0 // movaps 0x68d3(%eax),%xmm0
+ .byte 15,40,128,83,103,0,0 // movaps 0x6753(%eax),%xmm0
.byte 15,194,193,2 // cmpleps %xmm1,%xmm0
- .byte 15,40,144,163,104,0,0 // movaps 0x68a3(%eax),%xmm2
+ .byte 15,40,144,35,103,0,0 // movaps 0x6723(%eax),%xmm2
.byte 15,194,209,2 // cmpleps %xmm1,%xmm2
- .byte 15,40,152,3,105,0,0 // movaps 0x6903(%eax),%xmm3
+ .byte 15,40,152,131,103,0,0 // movaps 0x6783(%eax),%xmm3
.byte 15,194,217,2 // cmpleps %xmm1,%xmm3
- .byte 15,89,136,227,104,0,0 // mulps 0x68e3(%eax),%xmm1
- .byte 15,40,176,243,104,0,0 // movaps 0x68f3(%eax),%xmm6
+ .byte 15,89,136,99,103,0,0 // mulps 0x6763(%eax),%xmm1
+ .byte 15,40,176,115,103,0,0 // movaps 0x6773(%eax),%xmm6
.byte 15,92,241 // subps %xmm1,%xmm6
.byte 15,89,244 // mulps %xmm4,%xmm6
.byte 15,88,245 // addps %xmm5,%xmm6
@@ -52967,7 +52437,7 @@ _sk_hsl_to_rgb_sse2:
.byte 15,40,117,216 // movaps -0x28(%ebp),%xmm6
.byte 15,85,243 // andnps %xmm3,%xmm6
.byte 15,40,85,200 // movaps -0x38(%ebp),%xmm2
- .byte 15,88,144,19,105,0,0 // addps 0x6913(%eax),%xmm2
+ .byte 15,88,144,147,103,0,0 // addps 0x6793(%eax),%xmm2
.byte 243,15,91,194 // cvttps2dq %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
.byte 15,40,202 // movaps %xmm2,%xmm1
@@ -53107,9 +52577,9 @@ _sk_scale_u8_sse2:
.byte 102,15,110,36,57 // movd (%ecx,%edi,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,163,29,102,0,0 // pand 0x661d(%ebx),%xmm4
+ .byte 102,15,219,163,157,100,0,0 // pand 0x649d(%ebx),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,163,45,102,0,0 // mulps 0x662d(%ebx),%xmm4
+ .byte 15,89,163,173,100,0,0 // mulps 0x64ad(%ebx),%xmm4
.byte 15,89,196 // mulps %xmm4,%xmm0
.byte 15,89,204 // mulps %xmm4,%xmm1
.byte 15,89,212 // mulps %xmm4,%xmm2
@@ -53237,9 +52707,9 @@ _sk_lerp_u8_sse2:
.byte 102,15,110,36,57 // movd (%ecx,%edi,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,163,182,100,0,0 // pand 0x64b6(%ebx),%xmm4
+ .byte 102,15,219,163,54,99,0,0 // pand 0x6336(%ebx),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,163,198,100,0,0 // mulps 0x64c6(%ebx),%xmm4
+ .byte 15,89,163,70,99,0,0 // mulps 0x6346(%ebx),%xmm4
.byte 15,92,197 // subps %xmm5,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
.byte 15,40,117,56 // movaps 0x38(%ebp),%xmm6
@@ -53323,17 +52793,17 @@ _sk_lerp_565_sse2:
.byte 15,133,212,0,0,0 // jne 35e3 <_sk_lerp_565_sse2+0xfb>
.byte 243,15,126,52,121 // movq (%ecx,%edi,2),%xmm6
.byte 102,15,97,240 // punpcklwd %xmm0,%xmm6
- .byte 102,15,111,163,186,99,0,0 // movdqa 0x63ba(%ebx),%xmm4
+ .byte 102,15,111,163,58,98,0,0 // movdqa 0x623a(%ebx),%xmm4
.byte 102,15,219,230 // pand %xmm6,%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,163,202,99,0,0 // mulps 0x63ca(%ebx),%xmm4
- .byte 102,15,111,187,218,99,0,0 // movdqa 0x63da(%ebx),%xmm7
+ .byte 15,89,163,74,98,0,0 // mulps 0x624a(%ebx),%xmm4
+ .byte 102,15,111,187,90,98,0,0 // movdqa 0x625a(%ebx),%xmm7
.byte 102,15,219,254 // pand %xmm6,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 15,89,187,234,99,0,0 // mulps 0x63ea(%ebx),%xmm7
- .byte 102,15,219,179,250,99,0,0 // pand 0x63fa(%ebx),%xmm6
+ .byte 15,89,187,106,98,0,0 // mulps 0x626a(%ebx),%xmm7
+ .byte 102,15,219,179,122,98,0,0 // pand 0x627a(%ebx),%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,179,10,100,0,0 // mulps 0x640a(%ebx),%xmm6
+ .byte 15,89,179,138,98,0,0 // mulps 0x628a(%ebx),%xmm6
.byte 15,40,109,40 // movaps 0x28(%ebp),%xmm5
.byte 15,92,197 // subps %xmm5,%xmm0
.byte 15,89,196 // mulps %xmm4,%xmm0
@@ -53421,7 +52891,7 @@ _sk_load_tables_sse2:
.byte 139,58 // mov (%edx),%edi
.byte 15,133,75,1,0,0 // jne 37a9 <_sk_load_tables_sse2+0x16f>
.byte 243,15,111,28,159 // movdqu (%edi,%ebx,4),%xmm3
- .byte 102,15,111,150,200,98,0,0 // movdqa 0x62c8(%esi),%xmm2
+ .byte 102,15,111,150,72,97,0,0 // movdqa 0x6148(%esi),%xmm2
.byte 102,15,111,195 // movdqa %xmm3,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 102,15,112,200,229 // pshufd $0xe5,%xmm0,%xmm1
@@ -53477,7 +52947,7 @@ _sk_load_tables_sse2:
.byte 15,20,215 // unpcklps %xmm7,%xmm2
.byte 102,15,114,211,24 // psrld $0x18,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,158,216,98,0,0 // mulps 0x62d8(%esi),%xmm3
+ .byte 15,89,158,88,97,0,0 // mulps 0x6158(%esi),%xmm3
.byte 139,77,12 // mov 0xc(%ebp),%ecx
.byte 137,206 // mov %ecx,%esi
.byte 141,78,8 // lea 0x8(%esi),%ecx
@@ -53635,7 +53105,7 @@ _sk_load_tables_u16_be_sse2:
.byte 243,15,126,93,208 // movq -0x30(%ebp),%xmm3
.byte 102,15,97,223 // punpcklwd %xmm7,%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,159,59,97,0,0 // mulps 0x613b(%edi),%xmm3
+ .byte 15,89,159,187,95,0,0 // mulps 0x5fbb(%edi),%xmm3
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 137,193 // mov %eax,%ecx
.byte 141,65,8 // lea 0x8(%ecx),%eax
@@ -53804,7 +53274,7 @@ _sk_load_tables_rgb_u16_be_sse2:
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 137,4,36 // mov %eax,(%esp)
.byte 139,69,240 // mov -0x10(%ebp),%eax
- .byte 15,40,152,8,95,0,0 // movaps 0x5f08(%eax),%xmm3
+ .byte 15,40,152,136,93,0,0 // movaps 0x5d88(%eax),%xmm3
.byte 15,40,197 // movaps %xmm5,%xmm0
.byte 255,81,4 // call *0x4(%ecx)
.byte 131,196,124 // add $0x7c,%esp
@@ -53847,7 +53317,7 @@ _sk_byte_tables_sse2:
.byte 90 // pop %edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 139,8 // mov (%eax),%ecx
- .byte 15,40,170,206,92,0,0 // movaps 0x5cce(%edx),%xmm5
+ .byte 15,40,170,78,91,0,0 // movaps 0x5b4e(%edx),%xmm5
.byte 15,89,197 // mulps %xmm5,%xmm0
.byte 102,15,91,192 // cvtps2dq %xmm0,%xmm0
.byte 102,15,112,224,78 // pshufd $0x4e,%xmm0,%xmm4
@@ -53869,7 +53339,7 @@ _sk_byte_tables_sse2:
.byte 102,15,196,192,0 // pinsrw $0x0,%eax,%xmm0
.byte 139,65,4 // mov 0x4(%ecx),%eax
.byte 102,15,196,195,1 // pinsrw $0x1,%ebx,%xmm0
- .byte 15,40,162,222,92,0,0 // movaps 0x5cde(%edx),%xmm4
+ .byte 15,40,162,94,91,0,0 // movaps 0x5b5e(%edx),%xmm4
.byte 15,89,205 // mulps %xmm5,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,15,112,241,78 // pshufd $0x4e,%xmm1,%xmm6
@@ -54013,7 +53483,7 @@ _sk_byte_tables_rgb_sse2:
.byte 102,15,196,199,0 // pinsrw $0x0,%edi,%xmm0
.byte 139,121,4 // mov 0x4(%ecx),%edi
.byte 102,15,196,198,1 // pinsrw $0x1,%esi,%xmm0
- .byte 15,40,170,178,90,0,0 // movaps 0x5ab2(%edx),%xmm5
+ .byte 15,40,170,50,89,0,0 // movaps 0x5932(%edx),%xmm5
.byte 15,89,204 // mulps %xmm4,%xmm1
.byte 102,15,91,201 // cvtps2dq %xmm1,%xmm1
.byte 102,15,112,241,78 // pshufd $0x4e,%xmm1,%xmm6
@@ -54357,15 +53827,15 @@ _sk_parametric_r_sse2:
.byte 15,88,244 // addps %xmm4,%xmm6
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
.byte 15,91,230 // cvtdq2ps %xmm6,%xmm4
- .byte 15,89,166,185,86,0,0 // mulps 0x56b9(%esi),%xmm4
- .byte 15,84,182,201,86,0,0 // andps 0x56c9(%esi),%xmm6
- .byte 15,86,182,217,86,0,0 // orps 0x56d9(%esi),%xmm6
- .byte 15,88,166,233,86,0,0 // addps 0x56e9(%esi),%xmm4
- .byte 15,40,190,249,86,0,0 // movaps 0x56f9(%esi),%xmm7
+ .byte 15,89,166,57,85,0,0 // mulps 0x5539(%esi),%xmm4
+ .byte 15,84,182,73,85,0,0 // andps 0x5549(%esi),%xmm6
+ .byte 15,86,182,89,85,0,0 // orps 0x5559(%esi),%xmm6
+ .byte 15,88,166,105,85,0,0 // addps 0x5569(%esi),%xmm4
+ .byte 15,40,190,121,85,0,0 // movaps 0x5579(%esi),%xmm7
.byte 15,89,254 // mulps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
- .byte 15,88,182,9,87,0,0 // addps 0x5709(%esi),%xmm6
- .byte 15,40,190,25,87,0,0 // movaps 0x5719(%esi),%xmm7
+ .byte 15,88,182,137,85,0,0 // addps 0x5589(%esi),%xmm6
+ .byte 15,40,190,153,85,0,0 // movaps 0x5599(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -54373,21 +53843,21 @@ _sk_parametric_r_sse2:
.byte 15,91,245 // cvtdq2ps %xmm5,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,40,174,41,87,0,0 // movaps 0x5729(%esi),%xmm5
+ .byte 15,40,174,169,85,0,0 // movaps 0x55a9(%esi),%xmm5
.byte 15,84,253 // andps %xmm5,%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,88,166,57,87,0,0 // addps 0x5739(%esi),%xmm4
- .byte 15,40,182,73,87,0,0 // movaps 0x5749(%esi),%xmm6
+ .byte 15,88,166,185,85,0,0 // addps 0x55b9(%esi),%xmm4
+ .byte 15,40,182,201,85,0,0 // movaps 0x55c9(%esi),%xmm6
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 15,92,230 // subps %xmm6,%xmm4
- .byte 15,40,182,89,87,0,0 // movaps 0x5759(%esi),%xmm6
+ .byte 15,40,182,217,85,0,0 // movaps 0x55d9(%esi),%xmm6
.byte 15,92,247 // subps %xmm7,%xmm6
- .byte 15,40,190,105,87,0,0 // movaps 0x5769(%esi),%xmm7
+ .byte 15,40,190,233,85,0,0 // movaps 0x55e9(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,88,252 // addps %xmm4,%xmm7
- .byte 15,89,190,121,87,0,0 // mulps 0x5779(%esi),%xmm7
+ .byte 15,89,190,249,85,0,0 // mulps 0x55f9(%esi),%xmm7
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 243,15,16,103,16 // movss 0x10(%edi),%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
@@ -54456,15 +53926,15 @@ _sk_parametric_g_sse2:
.byte 15,88,244 // addps %xmm4,%xmm6
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
.byte 15,91,230 // cvtdq2ps %xmm6,%xmm4
- .byte 15,89,166,39,86,0,0 // mulps 0x5627(%esi),%xmm4
- .byte 15,84,182,55,86,0,0 // andps 0x5637(%esi),%xmm6
- .byte 15,86,182,71,86,0,0 // orps 0x5647(%esi),%xmm6
- .byte 15,88,166,87,86,0,0 // addps 0x5657(%esi),%xmm4
- .byte 15,40,190,103,86,0,0 // movaps 0x5667(%esi),%xmm7
+ .byte 15,89,166,167,84,0,0 // mulps 0x54a7(%esi),%xmm4
+ .byte 15,84,182,183,84,0,0 // andps 0x54b7(%esi),%xmm6
+ .byte 15,86,182,199,84,0,0 // orps 0x54c7(%esi),%xmm6
+ .byte 15,88,166,215,84,0,0 // addps 0x54d7(%esi),%xmm4
+ .byte 15,40,190,231,84,0,0 // movaps 0x54e7(%esi),%xmm7
.byte 15,89,254 // mulps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
- .byte 15,88,182,119,86,0,0 // addps 0x5677(%esi),%xmm6
- .byte 15,40,190,135,86,0,0 // movaps 0x5687(%esi),%xmm7
+ .byte 15,88,182,247,84,0,0 // addps 0x54f7(%esi),%xmm6
+ .byte 15,40,190,7,85,0,0 // movaps 0x5507(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -54472,21 +53942,21 @@ _sk_parametric_g_sse2:
.byte 15,91,245 // cvtdq2ps %xmm5,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,40,174,151,86,0,0 // movaps 0x5697(%esi),%xmm5
+ .byte 15,40,174,23,85,0,0 // movaps 0x5517(%esi),%xmm5
.byte 15,84,253 // andps %xmm5,%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,88,166,167,86,0,0 // addps 0x56a7(%esi),%xmm4
- .byte 15,40,182,183,86,0,0 // movaps 0x56b7(%esi),%xmm6
+ .byte 15,88,166,39,85,0,0 // addps 0x5527(%esi),%xmm4
+ .byte 15,40,182,55,85,0,0 // movaps 0x5537(%esi),%xmm6
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 15,92,230 // subps %xmm6,%xmm4
- .byte 15,40,182,199,86,0,0 // movaps 0x56c7(%esi),%xmm6
+ .byte 15,40,182,71,85,0,0 // movaps 0x5547(%esi),%xmm6
.byte 15,92,247 // subps %xmm7,%xmm6
- .byte 15,40,190,215,86,0,0 // movaps 0x56d7(%esi),%xmm7
+ .byte 15,40,190,87,85,0,0 // movaps 0x5557(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,88,252 // addps %xmm4,%xmm7
- .byte 15,89,190,231,86,0,0 // mulps 0x56e7(%esi),%xmm7
+ .byte 15,89,190,103,85,0,0 // mulps 0x5567(%esi),%xmm7
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 243,15,16,103,16 // movss 0x10(%edi),%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
@@ -54555,15 +54025,15 @@ _sk_parametric_b_sse2:
.byte 15,88,244 // addps %xmm4,%xmm6
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
.byte 15,91,230 // cvtdq2ps %xmm6,%xmm4
- .byte 15,89,166,149,85,0,0 // mulps 0x5595(%esi),%xmm4
- .byte 15,84,182,165,85,0,0 // andps 0x55a5(%esi),%xmm6
- .byte 15,86,182,181,85,0,0 // orps 0x55b5(%esi),%xmm6
- .byte 15,88,166,197,85,0,0 // addps 0x55c5(%esi),%xmm4
- .byte 15,40,190,213,85,0,0 // movaps 0x55d5(%esi),%xmm7
+ .byte 15,89,166,21,84,0,0 // mulps 0x5415(%esi),%xmm4
+ .byte 15,84,182,37,84,0,0 // andps 0x5425(%esi),%xmm6
+ .byte 15,86,182,53,84,0,0 // orps 0x5435(%esi),%xmm6
+ .byte 15,88,166,69,84,0,0 // addps 0x5445(%esi),%xmm4
+ .byte 15,40,190,85,84,0,0 // movaps 0x5455(%esi),%xmm7
.byte 15,89,254 // mulps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
- .byte 15,88,182,229,85,0,0 // addps 0x55e5(%esi),%xmm6
- .byte 15,40,190,245,85,0,0 // movaps 0x55f5(%esi),%xmm7
+ .byte 15,88,182,101,84,0,0 // addps 0x5465(%esi),%xmm6
+ .byte 15,40,190,117,84,0,0 // movaps 0x5475(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -54571,21 +54041,21 @@ _sk_parametric_b_sse2:
.byte 15,91,245 // cvtdq2ps %xmm5,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,40,174,5,86,0,0 // movaps 0x5605(%esi),%xmm5
+ .byte 15,40,174,133,84,0,0 // movaps 0x5485(%esi),%xmm5
.byte 15,84,253 // andps %xmm5,%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,88,166,21,86,0,0 // addps 0x5615(%esi),%xmm4
- .byte 15,40,182,37,86,0,0 // movaps 0x5625(%esi),%xmm6
+ .byte 15,88,166,149,84,0,0 // addps 0x5495(%esi),%xmm4
+ .byte 15,40,182,165,84,0,0 // movaps 0x54a5(%esi),%xmm6
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 15,92,230 // subps %xmm6,%xmm4
- .byte 15,40,182,53,86,0,0 // movaps 0x5635(%esi),%xmm6
+ .byte 15,40,182,181,84,0,0 // movaps 0x54b5(%esi),%xmm6
.byte 15,92,247 // subps %xmm7,%xmm6
- .byte 15,40,190,69,86,0,0 // movaps 0x5645(%esi),%xmm7
+ .byte 15,40,190,197,84,0,0 // movaps 0x54c5(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,88,252 // addps %xmm4,%xmm7
- .byte 15,89,190,85,86,0,0 // mulps 0x5655(%esi),%xmm7
+ .byte 15,89,190,213,84,0,0 // mulps 0x54d5(%esi),%xmm7
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 243,15,16,103,16 // movss 0x10(%edi),%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
@@ -54654,15 +54124,15 @@ _sk_parametric_a_sse2:
.byte 15,88,244 // addps %xmm4,%xmm6
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
.byte 15,91,230 // cvtdq2ps %xmm6,%xmm4
- .byte 15,89,166,3,85,0,0 // mulps 0x5503(%esi),%xmm4
- .byte 15,84,182,19,85,0,0 // andps 0x5513(%esi),%xmm6
- .byte 15,86,182,35,85,0,0 // orps 0x5523(%esi),%xmm6
- .byte 15,88,166,51,85,0,0 // addps 0x5533(%esi),%xmm4
- .byte 15,40,190,67,85,0,0 // movaps 0x5543(%esi),%xmm7
+ .byte 15,89,166,131,83,0,0 // mulps 0x5383(%esi),%xmm4
+ .byte 15,84,182,147,83,0,0 // andps 0x5393(%esi),%xmm6
+ .byte 15,86,182,163,83,0,0 // orps 0x53a3(%esi),%xmm6
+ .byte 15,88,166,179,83,0,0 // addps 0x53b3(%esi),%xmm4
+ .byte 15,40,190,195,83,0,0 // movaps 0x53c3(%esi),%xmm7
.byte 15,89,254 // mulps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
- .byte 15,88,182,83,85,0,0 // addps 0x5553(%esi),%xmm6
- .byte 15,40,190,99,85,0,0 // movaps 0x5563(%esi),%xmm7
+ .byte 15,88,182,211,83,0,0 // addps 0x53d3(%esi),%xmm6
+ .byte 15,40,190,227,83,0,0 // movaps 0x53e3(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,92,231 // subps %xmm7,%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -54670,21 +54140,21 @@ _sk_parametric_a_sse2:
.byte 15,91,245 // cvtdq2ps %xmm5,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,40,174,115,85,0,0 // movaps 0x5573(%esi),%xmm5
+ .byte 15,40,174,243,83,0,0 // movaps 0x53f3(%esi),%xmm5
.byte 15,84,253 // andps %xmm5,%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,40,252 // movaps %xmm4,%xmm7
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,88,166,131,85,0,0 // addps 0x5583(%esi),%xmm4
- .byte 15,40,182,147,85,0,0 // movaps 0x5593(%esi),%xmm6
+ .byte 15,88,166,3,84,0,0 // addps 0x5403(%esi),%xmm4
+ .byte 15,40,182,19,84,0,0 // movaps 0x5413(%esi),%xmm6
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 15,92,230 // subps %xmm6,%xmm4
- .byte 15,40,182,163,85,0,0 // movaps 0x55a3(%esi),%xmm6
+ .byte 15,40,182,35,84,0,0 // movaps 0x5423(%esi),%xmm6
.byte 15,92,247 // subps %xmm7,%xmm6
- .byte 15,40,190,179,85,0,0 // movaps 0x55b3(%esi),%xmm7
+ .byte 15,40,190,51,84,0,0 // movaps 0x5433(%esi),%xmm7
.byte 15,94,254 // divps %xmm6,%xmm7
.byte 15,88,252 // addps %xmm4,%xmm7
- .byte 15,89,190,195,85,0,0 // mulps 0x55c3(%esi),%xmm7
+ .byte 15,89,190,67,84,0,0 // mulps 0x5443(%esi),%xmm7
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 243,15,16,103,16 // movss 0x10(%edi),%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
@@ -54743,29 +54213,29 @@ _sk_lab_to_xyz_sse2:
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 232,0,0,0,0 // call 4859 <_sk_lab_to_xyz_sse2+0x18>
.byte 88 // pop %eax
- .byte 15,89,144,103,84,0,0 // mulps 0x5467(%eax),%xmm2
- .byte 15,40,160,119,84,0,0 // movaps 0x5477(%eax),%xmm4
+ .byte 15,89,144,231,82,0,0 // mulps 0x52e7(%eax),%xmm2
+ .byte 15,40,160,247,82,0,0 // movaps 0x52f7(%eax),%xmm4
.byte 15,89,204 // mulps %xmm4,%xmm1
- .byte 15,40,168,135,84,0,0 // movaps 0x5487(%eax),%xmm5
+ .byte 15,40,168,7,83,0,0 // movaps 0x5307(%eax),%xmm5
.byte 15,88,205 // addps %xmm5,%xmm1
.byte 15,89,220 // mulps %xmm4,%xmm3
.byte 15,88,221 // addps %xmm5,%xmm3
- .byte 15,88,144,151,84,0,0 // addps 0x5497(%eax),%xmm2
- .byte 15,89,144,167,84,0,0 // mulps 0x54a7(%eax),%xmm2
- .byte 15,89,136,183,84,0,0 // mulps 0x54b7(%eax),%xmm1
+ .byte 15,88,144,23,83,0,0 // addps 0x5317(%eax),%xmm2
+ .byte 15,89,144,39,83,0,0 // mulps 0x5327(%eax),%xmm2
+ .byte 15,89,136,55,83,0,0 // mulps 0x5337(%eax),%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
- .byte 15,89,152,199,84,0,0 // mulps 0x54c7(%eax),%xmm3
+ .byte 15,89,152,71,83,0,0 // mulps 0x5347(%eax),%xmm3
.byte 15,40,234 // movaps %xmm2,%xmm5
.byte 15,92,235 // subps %xmm3,%xmm5
.byte 15,40,193 // movaps %xmm1,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 15,89,193 // mulps %xmm1,%xmm0
- .byte 15,40,152,215,84,0,0 // movaps 0x54d7(%eax),%xmm3
+ .byte 15,40,152,87,83,0,0 // movaps 0x5357(%eax),%xmm3
.byte 15,40,227 // movaps %xmm3,%xmm4
.byte 15,194,224,1 // cmpltps %xmm0,%xmm4
- .byte 15,40,176,231,84,0,0 // movaps 0x54e7(%eax),%xmm6
+ .byte 15,40,176,103,83,0,0 // movaps 0x5367(%eax),%xmm6
.byte 15,88,206 // addps %xmm6,%xmm1
- .byte 15,40,184,247,84,0,0 // movaps 0x54f7(%eax),%xmm7
+ .byte 15,40,184,119,83,0,0 // movaps 0x5377(%eax),%xmm7
.byte 15,89,207 // mulps %xmm7,%xmm1
.byte 15,84,196 // andps %xmm4,%xmm0
.byte 15,85,225 // andnps %xmm1,%xmm4
@@ -54797,8 +54267,8 @@ _sk_lab_to_xyz_sse2:
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 15,86,216 // orps %xmm0,%xmm3
.byte 15,40,69,88 // movaps 0x58(%ebp),%xmm0
- .byte 15,89,160,7,85,0,0 // mulps 0x5507(%eax),%xmm4
- .byte 15,89,152,23,85,0,0 // mulps 0x5517(%eax),%xmm3
+ .byte 15,89,160,135,83,0,0 // mulps 0x5387(%eax),%xmm4
+ .byte 15,89,152,151,83,0,0 // mulps 0x5397(%eax),%xmm3
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 141,88,4 // lea 0x4(%eax),%ebx
.byte 15,41,68,36,80 // movaps %xmm0,0x50(%esp)
@@ -54848,9 +54318,9 @@ _sk_load_a8_sse2:
.byte 102,15,110,28,25 // movd (%ecx,%ebx,1),%xmm3
.byte 102,15,96,216 // punpcklbw %xmm0,%xmm3
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,219,158,248,83,0,0 // pand 0x53f8(%esi),%xmm3
+ .byte 102,15,219,158,120,82,0,0 // pand 0x5278(%esi),%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,158,8,84,0,0 // mulps 0x5408(%esi),%xmm3
+ .byte 15,89,158,136,82,0,0 // mulps 0x5288(%esi),%xmm3
.byte 141,72,8 // lea 0x8(%eax),%ecx
.byte 15,41,100,36,80 // movaps %xmm4,0x50(%esp)
.byte 15,41,84,36,64 // movaps %xmm2,0x40(%esp)
@@ -54920,10 +54390,10 @@ _sk_load_a8_dst_sse2:
.byte 102,15,110,36,57 // movd (%ecx,%edi,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,163,40,83,0,0 // pand 0x5328(%ebx),%xmm4
+ .byte 102,15,219,163,168,81,0,0 // pand 0x51a8(%ebx),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
.byte 102,15,87,237 // xorpd %xmm5,%xmm5
- .byte 15,89,163,56,83,0,0 // mulps 0x5338(%ebx),%xmm4
+ .byte 15,89,163,184,81,0,0 // mulps 0x51b8(%ebx),%xmm4
.byte 141,72,8 // lea 0x8(%eax),%ecx
.byte 102,15,41,108,36,64 // movapd %xmm5,0x40(%esp)
.byte 102,15,41,108,36,48 // movapd %xmm5,0x30(%esp)
@@ -54981,7 +54451,7 @@ _sk_gather_a8_sse2:
.byte 139,8 // mov (%eax),%ecx
.byte 139,17 // mov (%ecx),%edx
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,81,8 // movd 0x8(%ecx),%xmm2
+ .byte 102,15,110,81,4 // movd 0x4(%ecx),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -55017,7 +54487,7 @@ _sk_gather_a8_sse2:
.byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
.byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
.byte 15,91,216 // cvtdq2ps %xmm0,%xmm3
- .byte 15,89,158,1,82,0,0 // mulps 0x5201(%esi),%xmm3
+ .byte 15,89,158,129,80,0,0 // mulps 0x5081(%esi),%xmm3
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,69,40 // movaps 0x28(%ebp),%xmm0
.byte 15,40,77,56 // movaps 0x38(%ebp),%xmm1
@@ -55063,7 +54533,7 @@ _sk_store_a8_sse2:
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 139,48 // mov (%eax),%esi
.byte 139,30 // mov (%esi),%ebx
- .byte 15,40,161,128,81,0,0 // movaps 0x5180(%ecx),%xmm4
+ .byte 15,40,161,0,80,0,0 // movaps 0x5000(%ecx),%xmm4
.byte 15,89,227 // mulps %xmm3,%xmm4
.byte 102,15,91,228 // cvtps2dq %xmm4,%xmm4
.byte 102,15,114,244,16 // pslld $0x10,%xmm4
@@ -55113,7 +54583,7 @@ _sk_store_a8_sse2:
.byte 136,84,59,2 // mov %dl,0x2(%ebx,%edi,1)
.byte 139,85,20 // mov 0x14(%ebp),%edx
.byte 102,15,112,228,212 // pshufd $0xd4,%xmm4,%xmm4
- .byte 102,15,219,161,144,81,0,0 // pand 0x5190(%ecx),%xmm4
+ .byte 102,15,219,161,16,80,0,0 // pand 0x5010(%ecx),%xmm4
.byte 102,15,103,228 // packuswb %xmm4,%xmm4
.byte 102,15,103,228 // packuswb %xmm4,%xmm4
.byte 102,15,103,228 // packuswb %xmm4,%xmm4
@@ -55153,9 +54623,9 @@ _sk_load_g8_sse2:
.byte 102,15,110,4,58 // movd (%edx,%edi,1),%xmm0
.byte 102,15,96,192 // punpcklbw %xmm0,%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
- .byte 102,15,219,128,161,80,0,0 // pand 0x50a1(%eax),%xmm0
+ .byte 102,15,219,128,33,79,0,0 // pand 0x4f21(%eax),%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,128,177,80,0,0 // mulps 0x50b1(%eax),%xmm0
+ .byte 15,89,128,49,79,0,0 // mulps 0x4f31(%eax),%xmm0
.byte 141,81,8 // lea 0x8(%ecx),%edx
.byte 15,41,100,36,80 // movaps %xmm4,0x50(%esp)
.byte 15,41,92,36,64 // movaps %xmm3,0x40(%esp)
@@ -55167,7 +54637,7 @@ _sk_load_g8_sse2:
.byte 137,84,36,4 // mov %edx,0x4(%esp)
.byte 139,85,8 // mov 0x8(%ebp),%edx
.byte 137,20,36 // mov %edx,(%esp)
- .byte 15,40,152,193,80,0,0 // movaps 0x50c1(%eax),%xmm3
+ .byte 15,40,152,65,79,0,0 // movaps 0x4f41(%eax),%xmm3
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,81,4 // call *0x4(%ecx)
@@ -55225,11 +54695,11 @@ _sk_load_g8_dst_sse2:
.byte 102,15,110,36,25 // movd (%ecx,%ebx,1),%xmm4
.byte 102,15,96,224 // punpcklbw %xmm0,%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,219,166,224,79,0,0 // pand 0x4fe0(%esi),%xmm4
+ .byte 102,15,219,166,96,78,0,0 // pand 0x4e60(%esi),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,166,240,79,0,0 // mulps 0x4ff0(%esi),%xmm4
+ .byte 15,89,166,112,78,0,0 // mulps 0x4e70(%esi),%xmm4
.byte 141,72,8 // lea 0x8(%eax),%ecx
- .byte 15,40,174,0,80,0,0 // movaps 0x5000(%esi),%xmm5
+ .byte 15,40,174,128,78,0,0 // movaps 0x4e80(%esi),%xmm5
.byte 15,41,108,36,80 // movaps %xmm5,0x50(%esp)
.byte 137,84,36,16 // mov %edx,0x10(%esp)
.byte 137,124,36,12 // mov %edi,0xc(%esp)
@@ -55286,7 +54756,7 @@ _sk_gather_g8_sse2:
.byte 139,8 // mov (%eax),%ecx
.byte 139,17 // mov (%ecx),%edx
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,81,8 // movd 0x8(%ecx),%xmm2
+ .byte 102,15,110,81,4 // movd 0x4(%ecx),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -55325,7 +54795,7 @@ _sk_gather_g8_sse2:
.byte 102,15,96,197 // punpcklbw %xmm5,%xmm0
.byte 102,15,97,197 // punpcklwd %xmm5,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,134,201,78,0,0 // mulps 0x4ec9(%esi),%xmm0
+ .byte 15,89,134,73,77,0,0 // mulps 0x4d49(%esi),%xmm0
.byte 139,93,24 // mov 0x18(%ebp),%ebx
.byte 137,193 // mov %eax,%ecx
.byte 141,65,8 // lea 0x8(%ecx),%eax
@@ -55339,7 +54809,7 @@ _sk_gather_g8_sse2:
.byte 137,68,36,4 // mov %eax,0x4(%esp)
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 137,4,36 // mov %eax,(%esp)
- .byte 15,40,158,217,78,0,0 // movaps 0x4ed9(%esi),%xmm3
+ .byte 15,40,158,89,77,0,0 // movaps 0x4d59(%esi),%xmm3
.byte 15,40,200 // movaps %xmm0,%xmm1
.byte 15,40,208 // movaps %xmm0,%xmm2
.byte 255,81,4 // call *0x4(%ecx)
@@ -55350,121 +54820,6 @@ _sk_gather_g8_sse2:
.byte 93 // pop %ebp
.byte 195 // ret
-HIDDEN _sk_gather_i8_sse2
-.globl _sk_gather_i8_sse2
-FUNCTION(_sk_gather_i8_sse2)
-_sk_gather_i8_sse2:
- .byte 85 // push %ebp
- .byte 137,229 // mov %esp,%ebp
- .byte 83 // push %ebx
- .byte 87 // push %edi
- .byte 86 // push %esi
- .byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 501b <_sk_gather_i8_sse2+0xe>
- .byte 88 // pop %eax
- .byte 137,69,240 // mov %eax,-0x10(%ebp)
- .byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
- .byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
- .byte 139,69,12 // mov 0xc(%ebp),%eax
- .byte 139,16 // mov (%eax),%edx
- .byte 133,210 // test %edx,%edx
- .byte 116,7 // je 5037 <_sk_gather_i8_sse2+0x2a>
- .byte 131,192,4 // add $0x4,%eax
- .byte 137,209 // mov %edx,%ecx
- .byte 235,6 // jmp 503d <_sk_gather_i8_sse2+0x30>
- .byte 139,72,4 // mov 0x4(%eax),%ecx
- .byte 131,192,8 // add $0x8,%eax
- .byte 139,49 // mov (%ecx),%esi
- .byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,81,8 // movd 0x8(%ecx),%xmm2
- .byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
- .byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
- .byte 102,15,244,218 // pmuludq %xmm2,%xmm3
- .byte 102,15,112,219,232 // pshufd $0xe8,%xmm3,%xmm3
- .byte 102,15,244,209 // pmuludq %xmm1,%xmm2
- .byte 102,15,112,202,232 // pshufd $0xe8,%xmm2,%xmm1
- .byte 102,15,98,203 // punpckldq %xmm3,%xmm1
- .byte 243,15,91,192 // cvttps2dq %xmm0,%xmm0
- .byte 102,15,254,193 // paddd %xmm1,%xmm0
- .byte 102,15,112,200,78 // pshufd $0x4e,%xmm0,%xmm1
- .byte 102,15,126,201 // movd %xmm1,%ecx
- .byte 102,15,112,200,231 // pshufd $0xe7,%xmm0,%xmm1
- .byte 102,15,126,207 // movd %xmm1,%edi
- .byte 15,182,12,14 // movzbl (%esi,%ecx,1),%ecx
- .byte 15,182,60,62 // movzbl (%esi,%edi,1),%edi
- .byte 193,231,8 // shl $0x8,%edi
- .byte 9,207 // or %ecx,%edi
- .byte 102,15,126,193 // movd %xmm0,%ecx
- .byte 102,15,112,192,229 // pshufd $0xe5,%xmm0,%xmm0
- .byte 15,182,12,14 // movzbl (%esi,%ecx,1),%ecx
- .byte 102,15,126,195 // movd %xmm0,%ebx
- .byte 15,182,52,30 // movzbl (%esi,%ebx,1),%esi
- .byte 193,230,8 // shl $0x8,%esi
- .byte 9,206 // or %ecx,%esi
- .byte 102,15,196,198,0 // pinsrw $0x0,%esi,%xmm0
- .byte 102,15,196,199,1 // pinsrw $0x1,%edi,%xmm0
- .byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 102,15,96,193 // punpcklbw %xmm1,%xmm0
- .byte 102,15,97,193 // punpcklwd %xmm1,%xmm0
- .byte 139,74,4 // mov 0x4(%edx),%ecx
- .byte 102,15,112,200,229 // pshufd $0xe5,%xmm0,%xmm1
- .byte 102,15,112,208,231 // pshufd $0xe7,%xmm0,%xmm2
- .byte 102,15,126,210 // movd %xmm2,%edx
- .byte 102,15,110,20,145 // movd (%ecx,%edx,4),%xmm2
- .byte 102,15,126,202 // movd %xmm1,%edx
- .byte 102,15,110,12,145 // movd (%ecx,%edx,4),%xmm1
- .byte 102,15,126,194 // movd %xmm0,%edx
- .byte 102,15,112,192,78 // pshufd $0x4e,%xmm0,%xmm0
- .byte 102,15,110,44,145 // movd (%ecx,%edx,4),%xmm5
- .byte 102,15,126,194 // movd %xmm0,%edx
- .byte 102,15,110,4,145 // movd (%ecx,%edx,4),%xmm0
- .byte 102,15,98,202 // punpckldq %xmm2,%xmm1
- .byte 102,15,98,232 // punpckldq %xmm0,%xmm5
- .byte 102,15,98,233 // punpckldq %xmm1,%xmm5
- .byte 139,77,240 // mov -0x10(%ebp),%ecx
- .byte 102,15,111,145,85,78,0,0 // movdqa 0x4e55(%ecx),%xmm2
- .byte 102,15,111,197 // movdqa %xmm5,%xmm0
- .byte 102,15,219,194 // pand %xmm2,%xmm0
- .byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,40,161,101,78,0,0 // movaps 0x4e65(%ecx),%xmm4
- .byte 15,89,196 // mulps %xmm4,%xmm0
- .byte 102,15,111,205 // movdqa %xmm5,%xmm1
- .byte 102,15,114,209,8 // psrld $0x8,%xmm1
- .byte 102,15,219,202 // pand %xmm2,%xmm1
- .byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,204 // mulps %xmm4,%xmm1
- .byte 102,15,111,221 // movdqa %xmm5,%xmm3
- .byte 102,15,114,211,16 // psrld $0x10,%xmm3
- .byte 102,15,219,218 // pand %xmm2,%xmm3
- .byte 15,91,211 // cvtdq2ps %xmm3,%xmm2
- .byte 15,89,212 // mulps %xmm4,%xmm2
- .byte 102,15,114,213,24 // psrld $0x18,%xmm5
- .byte 15,91,221 // cvtdq2ps %xmm5,%xmm3
- .byte 15,89,220 // mulps %xmm4,%xmm3
- .byte 141,72,4 // lea 0x4(%eax),%ecx
- .byte 15,41,124,36,80 // movaps %xmm7,0x50(%esp)
- .byte 15,41,116,36,64 // movaps %xmm6,0x40(%esp)
- .byte 15,40,101,56 // movaps 0x38(%ebp),%xmm4
- .byte 15,41,100,36,48 // movaps %xmm4,0x30(%esp)
- .byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
- .byte 15,41,100,36,32 // movaps %xmm4,0x20(%esp)
- .byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 137,84,36,16 // mov %edx,0x10(%esp)
- .byte 139,85,20 // mov 0x14(%ebp),%edx
- .byte 137,84,36,12 // mov %edx,0xc(%esp)
- .byte 139,85,16 // mov 0x10(%ebp),%edx
- .byte 137,84,36,8 // mov %edx,0x8(%esp)
- .byte 137,76,36,4 // mov %ecx,0x4(%esp)
- .byte 139,77,8 // mov 0x8(%ebp),%ecx
- .byte 137,12,36 // mov %ecx,(%esp)
- .byte 255,16 // call *(%eax)
- .byte 131,196,108 // add $0x6c,%esp
- .byte 94 // pop %esi
- .byte 95 // pop %edi
- .byte 91 // pop %ebx
- .byte 93 // pop %ebp
- .byte 195 // ret
-
HIDDEN _sk_load_565_sse2
.globl _sk_load_565_sse2
FUNCTION(_sk_load_565_sse2)
@@ -55475,7 +54830,7 @@ _sk_load_565_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 51a8 <_sk_load_565_sse2+0xe>
+ .byte 232,0,0,0,0 // call 501b <_sk_load_565_sse2+0xe>
.byte 88 // pop %eax
.byte 15,40,117,88 // movaps 0x58(%ebp),%xmm6
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
@@ -55488,20 +54843,20 @@ _sk_load_565_sse2:
.byte 139,18 // mov (%edx),%edx
.byte 133,219 // test %ebx,%ebx
.byte 139,125,16 // mov 0x10(%ebp),%edi
- .byte 15,133,134,0,0,0 // jne 5257 <_sk_load_565_sse2+0xbd>
+ .byte 15,133,134,0,0,0 // jne 50ca <_sk_load_565_sse2+0xbd>
.byte 243,15,126,20,122 // movq (%edx,%edi,2),%xmm2
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,128,232,76,0,0 // movdqa 0x4ce8(%eax),%xmm0
+ .byte 102,15,111,128,213,76,0,0 // movdqa 0x4cd5(%eax),%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,128,248,76,0,0 // mulps 0x4cf8(%eax),%xmm0
- .byte 102,15,111,136,8,77,0,0 // movdqa 0x4d08(%eax),%xmm1
+ .byte 15,89,128,229,76,0,0 // mulps 0x4ce5(%eax),%xmm0
+ .byte 102,15,111,136,245,76,0,0 // movdqa 0x4cf5(%eax),%xmm1
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,136,24,77,0,0 // mulps 0x4d18(%eax),%xmm1
- .byte 102,15,219,144,40,77,0,0 // pand 0x4d28(%eax),%xmm2
+ .byte 15,89,136,5,77,0,0 // mulps 0x4d05(%eax),%xmm1
+ .byte 102,15,219,144,21,77,0,0 // pand 0x4d15(%eax),%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,144,56,77,0,0 // mulps 0x4d38(%eax),%xmm2
+ .byte 15,89,144,37,77,0,0 // mulps 0x4d25(%eax),%xmm2
.byte 141,81,8 // lea 0x8(%ecx),%edx
.byte 15,41,116,36,80 // movaps %xmm6,0x50(%esp)
.byte 15,41,108,36,64 // movaps %xmm5,0x40(%esp)
@@ -55513,7 +54868,7 @@ _sk_load_565_sse2:
.byte 137,84,36,4 // mov %edx,0x4(%esp)
.byte 139,85,8 // mov 0x8(%ebp),%edx
.byte 137,20,36 // mov %edx,(%esp)
- .byte 15,40,152,72,77,0,0 // movaps 0x4d48(%eax),%xmm3
+ .byte 15,40,152,53,77,0,0 // movaps 0x4d35(%eax),%xmm3
.byte 255,81,4 // call *0x4(%ecx)
.byte 131,196,108 // add $0x6c,%esp
.byte 94 // pop %esi
@@ -55524,13 +54879,13 @@ _sk_load_565_sse2:
.byte 136,93,243 // mov %bl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,58 // je 529e <_sk_load_565_sse2+0x104>
+ .byte 116,58 // je 5111 <_sk_load_565_sse2+0x104>
.byte 102,15,239,210 // pxor %xmm2,%xmm2
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,93,24 // mov 0x18(%ebp),%ebx
- .byte 116,27 // je 528c <_sk_load_565_sse2+0xf2>
+ .byte 116,27 // je 50ff <_sk_load_565_sse2+0xf2>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,95,255,255,255 // jne 51da <_sk_load_565_sse2+0x40>
+ .byte 15,133,95,255,255,255 // jne 504d <_sk_load_565_sse2+0x40>
.byte 15,183,116,122,4 // movzwl 0x4(%edx,%edi,2),%esi
.byte 102,15,110,198 // movd %esi,%xmm0
.byte 139,117,20 // mov 0x14(%ebp),%esi
@@ -55538,11 +54893,11 @@ _sk_load_565_sse2:
.byte 102,15,110,4,122 // movd (%edx,%edi,2),%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
.byte 242,15,16,208 // movsd %xmm0,%xmm2
- .byte 233,60,255,255,255 // jmp 51da <_sk_load_565_sse2+0x40>
+ .byte 233,60,255,255,255 // jmp 504d <_sk_load_565_sse2+0x40>
.byte 15,183,20,122 // movzwl (%edx,%edi,2),%edx
.byte 102,15,110,210 // movd %edx,%xmm2
.byte 139,93,24 // mov 0x18(%ebp),%ebx
- .byte 233,44,255,255,255 // jmp 51da <_sk_load_565_sse2+0x40>
+ .byte 233,44,255,255,255 // jmp 504d <_sk_load_565_sse2+0x40>
HIDDEN _sk_load_565_dst_sse2
.globl _sk_load_565_dst_sse2
@@ -55554,7 +54909,7 @@ _sk_load_565_dst_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 52bc <_sk_load_565_dst_sse2+0xe>
+ .byte 232,0,0,0,0 // call 512f <_sk_load_565_dst_sse2+0xe>
.byte 94 // pop %esi
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,125,20 // mov 0x14(%ebp),%edi
@@ -55563,22 +54918,22 @@ _sk_load_565_dst_sse2:
.byte 139,9 // mov (%ecx),%ecx
.byte 133,210 // test %edx,%edx
.byte 139,93,16 // mov 0x10(%ebp),%ebx
- .byte 15,133,134,0,0,0 // jne 535b <_sk_load_565_dst_sse2+0xad>
+ .byte 15,133,134,0,0,0 // jne 51ce <_sk_load_565_dst_sse2+0xad>
.byte 243,15,126,36,89 // movq (%ecx,%ebx,2),%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,111,174,68,76,0,0 // movdqa 0x4c44(%esi),%xmm5
+ .byte 102,15,111,174,49,76,0,0 // movdqa 0x4c31(%esi),%xmm5
.byte 102,15,219,236 // pand %xmm4,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,174,84,76,0,0 // mulps 0x4c54(%esi),%xmm5
- .byte 102,15,111,182,100,76,0,0 // movdqa 0x4c64(%esi),%xmm6
+ .byte 15,89,174,65,76,0,0 // mulps 0x4c41(%esi),%xmm5
+ .byte 102,15,111,182,81,76,0,0 // movdqa 0x4c51(%esi),%xmm6
.byte 102,15,219,244 // pand %xmm4,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,182,116,76,0,0 // mulps 0x4c74(%esi),%xmm6
- .byte 102,15,219,166,132,76,0,0 // pand 0x4c84(%esi),%xmm4
+ .byte 15,89,182,97,76,0,0 // mulps 0x4c61(%esi),%xmm6
+ .byte 102,15,219,166,113,76,0,0 // pand 0x4c71(%esi),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,166,148,76,0,0 // mulps 0x4c94(%esi),%xmm4
+ .byte 15,89,166,129,76,0,0 // mulps 0x4c81(%esi),%xmm4
.byte 141,72,8 // lea 0x8(%eax),%ecx
- .byte 15,40,190,164,76,0,0 // movaps 0x4ca4(%esi),%xmm7
+ .byte 15,40,190,145,76,0,0 // movaps 0x4c91(%esi),%xmm7
.byte 15,41,124,36,80 // movaps %xmm7,0x50(%esp)
.byte 137,84,36,16 // mov %edx,0x10(%esp)
.byte 137,124,36,12 // mov %edi,0xc(%esp)
@@ -55599,13 +54954,13 @@ _sk_load_565_dst_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,58 // je 53a2 <_sk_load_565_dst_sse2+0xf4>
+ .byte 116,58 // je 5215 <_sk_load_565_dst_sse2+0xf4>
.byte 102,15,239,228 // pxor %xmm4,%xmm4
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,27 // je 5390 <_sk_load_565_dst_sse2+0xe2>
+ .byte 116,27 // je 5203 <_sk_load_565_dst_sse2+0xe2>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,95,255,255,255 // jne 52de <_sk_load_565_dst_sse2+0x30>
+ .byte 15,133,95,255,255,255 // jne 5151 <_sk_load_565_dst_sse2+0x30>
.byte 15,183,124,89,4 // movzwl 0x4(%ecx,%ebx,2),%edi
.byte 102,15,110,231 // movd %edi,%xmm4
.byte 139,125,20 // mov 0x14(%ebp),%edi
@@ -55613,11 +54968,11 @@ _sk_load_565_dst_sse2:
.byte 102,15,110,44,89 // movd (%ecx,%ebx,2),%xmm5
.byte 102,15,97,232 // punpcklwd %xmm0,%xmm5
.byte 242,15,16,229 // movsd %xmm5,%xmm4
- .byte 233,60,255,255,255 // jmp 52de <_sk_load_565_dst_sse2+0x30>
+ .byte 233,60,255,255,255 // jmp 5151 <_sk_load_565_dst_sse2+0x30>
.byte 15,183,12,89 // movzwl (%ecx,%ebx,2),%ecx
.byte 102,15,110,225 // movd %ecx,%xmm4
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,44,255,255,255 // jmp 52de <_sk_load_565_dst_sse2+0x30>
+ .byte 233,44,255,255,255 // jmp 5151 <_sk_load_565_dst_sse2+0x30>
HIDDEN _sk_gather_565_sse2
.globl _sk_gather_565_sse2
@@ -55629,13 +54984,13 @@ _sk_gather_565_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 53c0 <_sk_gather_565_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5233 <_sk_gather_565_sse2+0xe>
.byte 88 // pop %eax
.byte 139,85,12 // mov 0xc(%ebp),%edx
.byte 139,50 // mov (%edx),%esi
.byte 139,62 // mov (%esi),%edi
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,86,8 // movd 0x8(%esi),%xmm2
+ .byte 102,15,110,86,4 // movd 0x4(%esi),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -55666,17 +55021,17 @@ _sk_gather_565_sse2:
.byte 15,40,117,88 // movaps 0x58(%ebp),%xmm6
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,208 // punpcklwd %xmm0,%xmm2
- .byte 102,15,111,128,176,75,0,0 // movdqa 0x4bb0(%eax),%xmm0
+ .byte 102,15,111,128,157,75,0,0 // movdqa 0x4b9d(%eax),%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,128,192,75,0,0 // mulps 0x4bc0(%eax),%xmm0
- .byte 102,15,111,136,208,75,0,0 // movdqa 0x4bd0(%eax),%xmm1
+ .byte 15,89,128,173,75,0,0 // mulps 0x4bad(%eax),%xmm0
+ .byte 102,15,111,136,189,75,0,0 // movdqa 0x4bbd(%eax),%xmm1
.byte 102,15,219,202 // pand %xmm2,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,136,224,75,0,0 // mulps 0x4be0(%eax),%xmm1
- .byte 102,15,219,144,240,75,0,0 // pand 0x4bf0(%eax),%xmm2
+ .byte 15,89,136,205,75,0,0 // mulps 0x4bcd(%eax),%xmm1
+ .byte 102,15,219,144,221,75,0,0 // pand 0x4bdd(%eax),%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,144,0,76,0,0 // mulps 0x4c00(%eax),%xmm2
+ .byte 15,89,144,237,75,0,0 // mulps 0x4bed(%eax),%xmm2
.byte 139,93,24 // mov 0x18(%ebp),%ebx
.byte 141,74,8 // lea 0x8(%edx),%ecx
.byte 15,41,116,36,80 // movaps %xmm6,0x50(%esp)
@@ -55689,7 +55044,7 @@ _sk_gather_565_sse2:
.byte 137,76,36,4 // mov %ecx,0x4(%esp)
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 137,12,36 // mov %ecx,(%esp)
- .byte 15,40,152,16,76,0,0 // movaps 0x4c10(%eax),%xmm3
+ .byte 15,40,152,253,75,0,0 // movaps 0x4bfd(%eax),%xmm3
.byte 255,82,4 // call *0x4(%edx)
.byte 131,196,108 // add $0x6c,%esp
.byte 94 // pop %esi
@@ -55708,14 +55063,14 @@ _sk_store_565_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 54e2 <_sk_store_565_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5355 <_sk_store_565_sse2+0xe>
.byte 88 // pop %eax
- .byte 15,40,160,254,74,0,0 // movaps 0x4afe(%eax),%xmm4
+ .byte 15,40,160,235,74,0,0 // movaps 0x4aeb(%eax),%xmm4
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
.byte 102,15,91,237 // cvtps2dq %xmm5,%xmm5
.byte 102,15,114,245,11 // pslld $0xb,%xmm5
- .byte 15,40,176,14,75,0,0 // movaps 0x4b0e(%eax),%xmm6
+ .byte 15,40,176,251,74,0,0 // movaps 0x4afb(%eax),%xmm6
.byte 15,89,241 // mulps %xmm1,%xmm6
.byte 102,15,91,246 // cvtps2dq %xmm6,%xmm6
.byte 102,15,114,246,5 // pslld $0x5,%xmm6
@@ -55737,7 +55092,7 @@ _sk_store_565_sse2:
.byte 133,219 // test %ebx,%ebx
.byte 15,40,125,56 // movaps 0x38(%ebp),%xmm7
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
- .byte 117,82 // jne 55a3 <_sk_store_565_sse2+0xcf>
+ .byte 117,82 // jne 5416 <_sk_store_565_sse2+0xcf>
.byte 102,15,126,226 // movd %xmm4,%edx
.byte 102,15,126,238 // movd %xmm5,%esi
.byte 137,20,79 // mov %edx,(%edi,%ecx,2)
@@ -55768,20 +55123,20 @@ _sk_store_565_sse2:
.byte 137,218 // mov %ebx,%edx
.byte 128,226,3 // and $0x3,%dl
.byte 128,250,1 // cmp $0x1,%dl
- .byte 116,37 // je 55db <_sk_store_565_sse2+0x107>
+ .byte 116,37 // je 544e <_sk_store_565_sse2+0x107>
.byte 128,250,2 // cmp $0x2,%dl
- .byte 116,15 // je 55ca <_sk_store_565_sse2+0xf6>
+ .byte 116,15 // je 543d <_sk_store_565_sse2+0xf6>
.byte 128,250,3 // cmp $0x3,%dl
- .byte 117,160 // jne 5560 <_sk_store_565_sse2+0x8c>
+ .byte 117,160 // jne 53d3 <_sk_store_565_sse2+0x8c>
.byte 102,15,197,212,4 // pextrw $0x4,%xmm4,%edx
.byte 102,137,84,79,4 // mov %dx,0x4(%edi,%ecx,2)
.byte 102,15,112,228,212 // pshufd $0xd4,%xmm4,%xmm4
.byte 242,15,112,228,232 // pshuflw $0xe8,%xmm4,%xmm4
.byte 102,15,126,36,79 // movd %xmm4,(%edi,%ecx,2)
- .byte 235,133 // jmp 5560 <_sk_store_565_sse2+0x8c>
+ .byte 235,133 // jmp 53d3 <_sk_store_565_sse2+0x8c>
.byte 102,15,126,226 // movd %xmm4,%edx
.byte 102,137,20,79 // mov %dx,(%edi,%ecx,2)
- .byte 233,120,255,255,255 // jmp 5560 <_sk_store_565_sse2+0x8c>
+ .byte 233,120,255,255,255 // jmp 53d3 <_sk_store_565_sse2+0x8c>
HIDDEN _sk_load_4444_sse2
.globl _sk_load_4444_sse2
@@ -55793,7 +55148,7 @@ _sk_load_4444_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 55f6 <_sk_load_4444_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5469 <_sk_load_4444_sse2+0xe>
.byte 94 // pop %esi
.byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
@@ -55806,24 +55161,24 @@ _sk_load_4444_sse2:
.byte 139,9 // mov (%ecx),%ecx
.byte 133,210 // test %edx,%edx
.byte 139,93,16 // mov 0x10(%ebp),%ebx
- .byte 15,133,149,0,0,0 // jne 56b4 <_sk_load_4444_sse2+0xcc>
+ .byte 15,133,149,0,0,0 // jne 5527 <_sk_load_4444_sse2+0xcc>
.byte 243,15,126,28,89 // movq (%ecx,%ebx,2),%xmm3
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,134,10,74,0,0 // movdqa 0x4a0a(%esi),%xmm0
+ .byte 102,15,111,134,247,73,0,0 // movdqa 0x49f7(%esi),%xmm0
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,134,26,74,0,0 // mulps 0x4a1a(%esi),%xmm0
- .byte 102,15,111,142,42,74,0,0 // movdqa 0x4a2a(%esi),%xmm1
+ .byte 15,89,134,7,74,0,0 // mulps 0x4a07(%esi),%xmm0
+ .byte 102,15,111,142,23,74,0,0 // movdqa 0x4a17(%esi),%xmm1
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,142,58,74,0,0 // mulps 0x4a3a(%esi),%xmm1
- .byte 102,15,111,150,74,74,0,0 // movdqa 0x4a4a(%esi),%xmm2
+ .byte 15,89,142,39,74,0,0 // mulps 0x4a27(%esi),%xmm1
+ .byte 102,15,111,150,55,74,0,0 // movdqa 0x4a37(%esi),%xmm2
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,150,90,74,0,0 // mulps 0x4a5a(%esi),%xmm2
- .byte 102,15,219,158,106,74,0,0 // pand 0x4a6a(%esi),%xmm3
+ .byte 15,89,150,71,74,0,0 // mulps 0x4a47(%esi),%xmm2
+ .byte 102,15,219,158,87,74,0,0 // pand 0x4a57(%esi),%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,158,122,74,0,0 // mulps 0x4a7a(%esi),%xmm3
+ .byte 15,89,158,103,74,0,0 // mulps 0x4a67(%esi),%xmm3
.byte 141,72,8 // lea 0x8(%eax),%ecx
.byte 15,41,124,36,80 // movaps %xmm7,0x50(%esp)
.byte 15,41,116,36,64 // movaps %xmm6,0x40(%esp)
@@ -55845,13 +55200,13 @@ _sk_load_4444_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,58 // je 56fb <_sk_load_4444_sse2+0x113>
+ .byte 116,58 // je 556e <_sk_load_4444_sse2+0x113>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,27 // je 56e9 <_sk_load_4444_sse2+0x101>
+ .byte 116,27 // je 555c <_sk_load_4444_sse2+0x101>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,80,255,255,255 // jne 5628 <_sk_load_4444_sse2+0x40>
+ .byte 15,133,80,255,255,255 // jne 549b <_sk_load_4444_sse2+0x40>
.byte 15,183,124,89,4 // movzwl 0x4(%ecx,%ebx,2),%edi
.byte 102,15,110,199 // movd %edi,%xmm0
.byte 139,125,20 // mov 0x14(%ebp),%edi
@@ -55859,11 +55214,11 @@ _sk_load_4444_sse2:
.byte 102,15,110,4,89 // movd (%ecx,%ebx,2),%xmm0
.byte 102,15,97,192 // punpcklwd %xmm0,%xmm0
.byte 242,15,16,216 // movsd %xmm0,%xmm3
- .byte 233,45,255,255,255 // jmp 5628 <_sk_load_4444_sse2+0x40>
+ .byte 233,45,255,255,255 // jmp 549b <_sk_load_4444_sse2+0x40>
.byte 15,183,12,89 // movzwl (%ecx,%ebx,2),%ecx
.byte 102,15,110,217 // movd %ecx,%xmm3
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,29,255,255,255 // jmp 5628 <_sk_load_4444_sse2+0x40>
+ .byte 233,29,255,255,255 // jmp 549b <_sk_load_4444_sse2+0x40>
HIDDEN _sk_load_4444_dst_sse2
.globl _sk_load_4444_dst_sse2
@@ -55875,7 +55230,7 @@ _sk_load_4444_dst_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5719 <_sk_load_4444_dst_sse2+0xe>
+ .byte 232,0,0,0,0 // call 558c <_sk_load_4444_dst_sse2+0xe>
.byte 95 // pop %edi
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,117,20 // mov 0x14(%ebp),%esi
@@ -55884,24 +55239,24 @@ _sk_load_4444_dst_sse2:
.byte 139,9 // mov (%ecx),%ecx
.byte 133,210 // test %edx,%edx
.byte 139,93,16 // mov 0x10(%ebp),%ebx
- .byte 15,133,149,0,0,0 // jne 57c7 <_sk_load_4444_dst_sse2+0xbc>
+ .byte 15,133,149,0,0,0 // jne 563a <_sk_load_4444_dst_sse2+0xbc>
.byte 243,15,126,36,89 // movq (%ecx,%ebx,2),%xmm4
.byte 102,15,97,224 // punpcklwd %xmm0,%xmm4
- .byte 102,15,111,175,103,73,0,0 // movdqa 0x4967(%edi),%xmm5
+ .byte 102,15,111,175,84,73,0,0 // movdqa 0x4954(%edi),%xmm5
.byte 102,15,219,236 // pand %xmm4,%xmm5
.byte 15,91,237 // cvtdq2ps %xmm5,%xmm5
- .byte 15,89,175,119,73,0,0 // mulps 0x4977(%edi),%xmm5
- .byte 102,15,111,183,135,73,0,0 // movdqa 0x4987(%edi),%xmm6
+ .byte 15,89,175,100,73,0,0 // mulps 0x4964(%edi),%xmm5
+ .byte 102,15,111,183,116,73,0,0 // movdqa 0x4974(%edi),%xmm6
.byte 102,15,219,244 // pand %xmm4,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,89,183,151,73,0,0 // mulps 0x4997(%edi),%xmm6
- .byte 102,15,111,191,167,73,0,0 // movdqa 0x49a7(%edi),%xmm7
+ .byte 15,89,183,132,73,0,0 // mulps 0x4984(%edi),%xmm6
+ .byte 102,15,111,191,148,73,0,0 // movdqa 0x4994(%edi),%xmm7
.byte 102,15,219,252 // pand %xmm4,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
- .byte 15,89,191,183,73,0,0 // mulps 0x49b7(%edi),%xmm7
- .byte 102,15,219,167,199,73,0,0 // pand 0x49c7(%edi),%xmm4
+ .byte 15,89,191,164,73,0,0 // mulps 0x49a4(%edi),%xmm7
+ .byte 102,15,219,167,180,73,0,0 // pand 0x49b4(%edi),%xmm4
.byte 15,91,228 // cvtdq2ps %xmm4,%xmm4
- .byte 15,89,167,215,73,0,0 // mulps 0x49d7(%edi),%xmm4
+ .byte 15,89,167,196,73,0,0 // mulps 0x49c4(%edi),%xmm4
.byte 141,72,8 // lea 0x8(%eax),%ecx
.byte 137,84,36,16 // mov %edx,0x10(%esp)
.byte 137,116,36,12 // mov %esi,0xc(%esp)
@@ -55923,13 +55278,13 @@ _sk_load_4444_dst_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,58 // je 580e <_sk_load_4444_dst_sse2+0x103>
+ .byte 116,58 // je 5681 <_sk_load_4444_dst_sse2+0x103>
.byte 102,15,239,228 // pxor %xmm4,%xmm4
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,27 // je 57fc <_sk_load_4444_dst_sse2+0xf1>
+ .byte 116,27 // je 566f <_sk_load_4444_dst_sse2+0xf1>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,80,255,255,255 // jne 573b <_sk_load_4444_dst_sse2+0x30>
+ .byte 15,133,80,255,255,255 // jne 55ae <_sk_load_4444_dst_sse2+0x30>
.byte 15,183,116,89,4 // movzwl 0x4(%ecx,%ebx,2),%esi
.byte 102,15,110,230 // movd %esi,%xmm4
.byte 139,117,20 // mov 0x14(%ebp),%esi
@@ -55937,11 +55292,11 @@ _sk_load_4444_dst_sse2:
.byte 102,15,110,44,89 // movd (%ecx,%ebx,2),%xmm5
.byte 102,15,97,232 // punpcklwd %xmm0,%xmm5
.byte 242,15,16,229 // movsd %xmm5,%xmm4
- .byte 233,45,255,255,255 // jmp 573b <_sk_load_4444_dst_sse2+0x30>
+ .byte 233,45,255,255,255 // jmp 55ae <_sk_load_4444_dst_sse2+0x30>
.byte 15,183,12,89 // movzwl (%ecx,%ebx,2),%ecx
.byte 102,15,110,225 // movd %ecx,%xmm4
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,29,255,255,255 // jmp 573b <_sk_load_4444_dst_sse2+0x30>
+ .byte 233,29,255,255,255 // jmp 55ae <_sk_load_4444_dst_sse2+0x30>
HIDDEN _sk_gather_4444_sse2
.globl _sk_gather_4444_sse2
@@ -55953,14 +55308,14 @@ _sk_gather_4444_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 582c <_sk_gather_4444_sse2+0xe>
+ .byte 232,0,0,0,0 // call 569f <_sk_gather_4444_sse2+0xe>
.byte 90 // pop %edx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,12 // mov 0xc(%ebp),%ecx
.byte 139,49 // mov (%ecx),%esi
.byte 139,62 // mov (%esi),%edi
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,86,8 // movd 0x8(%esi),%xmm2
+ .byte 102,15,110,86,4 // movd 0x4(%esi),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -55987,21 +55342,21 @@ _sk_gather_4444_sse2:
.byte 139,125,20 // mov 0x14(%ebp),%edi
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,216 // punpcklwd %xmm0,%xmm3
- .byte 102,15,111,130,212,72,0,0 // movdqa 0x48d4(%edx),%xmm0
+ .byte 102,15,111,130,193,72,0,0 // movdqa 0x48c1(%edx),%xmm0
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,89,130,228,72,0,0 // mulps 0x48e4(%edx),%xmm0
- .byte 102,15,111,138,244,72,0,0 // movdqa 0x48f4(%edx),%xmm1
+ .byte 15,89,130,209,72,0,0 // mulps 0x48d1(%edx),%xmm0
+ .byte 102,15,111,138,225,72,0,0 // movdqa 0x48e1(%edx),%xmm1
.byte 102,15,219,203 // pand %xmm3,%xmm1
.byte 15,91,201 // cvtdq2ps %xmm1,%xmm1
- .byte 15,89,138,4,73,0,0 // mulps 0x4904(%edx),%xmm1
- .byte 102,15,111,146,20,73,0,0 // movdqa 0x4914(%edx),%xmm2
+ .byte 15,89,138,241,72,0,0 // mulps 0x48f1(%edx),%xmm1
+ .byte 102,15,111,146,1,73,0,0 // movdqa 0x4901(%edx),%xmm2
.byte 102,15,219,211 // pand %xmm3,%xmm2
.byte 15,91,210 // cvtdq2ps %xmm2,%xmm2
- .byte 15,89,146,36,73,0,0 // mulps 0x4924(%edx),%xmm2
- .byte 102,15,219,154,52,73,0,0 // pand 0x4934(%edx),%xmm3
+ .byte 15,89,146,17,73,0,0 // mulps 0x4911(%edx),%xmm2
+ .byte 102,15,219,154,33,73,0,0 // pand 0x4921(%edx),%xmm3
.byte 15,91,219 // cvtdq2ps %xmm3,%xmm3
- .byte 15,89,154,68,73,0,0 // mulps 0x4944(%edx),%xmm3
+ .byte 15,89,154,49,73,0,0 // mulps 0x4931(%edx),%xmm3
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 15,40,109,56 // movaps 0x38(%ebp),%xmm5
@@ -56035,9 +55390,9 @@ _sk_store_4444_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 595d <_sk_store_4444_sse2+0xe>
+ .byte 232,0,0,0,0 // call 57d0 <_sk_store_4444_sse2+0xe>
.byte 88 // pop %eax
- .byte 15,40,160,35,72,0,0 // movaps 0x4823(%eax),%xmm4
+ .byte 15,40,160,16,72,0,0 // movaps 0x4810(%eax),%xmm4
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
.byte 102,15,91,237 // cvtps2dq %xmm5,%xmm5
@@ -56069,7 +55424,7 @@ _sk_store_4444_sse2:
.byte 133,219 // test %ebx,%ebx
.byte 15,40,125,56 // movaps 0x38(%ebp),%xmm7
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
- .byte 117,82 // jne 5a2d <_sk_store_4444_sse2+0xde>
+ .byte 117,82 // jne 58a0 <_sk_store_4444_sse2+0xde>
.byte 102,15,126,226 // movd %xmm4,%edx
.byte 102,15,126,238 // movd %xmm5,%esi
.byte 137,20,79 // mov %edx,(%edi,%ecx,2)
@@ -56100,20 +55455,20 @@ _sk_store_4444_sse2:
.byte 137,218 // mov %ebx,%edx
.byte 128,226,3 // and $0x3,%dl
.byte 128,250,1 // cmp $0x1,%dl
- .byte 116,37 // je 5a65 <_sk_store_4444_sse2+0x116>
+ .byte 116,37 // je 58d8 <_sk_store_4444_sse2+0x116>
.byte 128,250,2 // cmp $0x2,%dl
- .byte 116,15 // je 5a54 <_sk_store_4444_sse2+0x105>
+ .byte 116,15 // je 58c7 <_sk_store_4444_sse2+0x105>
.byte 128,250,3 // cmp $0x3,%dl
- .byte 117,160 // jne 59ea <_sk_store_4444_sse2+0x9b>
+ .byte 117,160 // jne 585d <_sk_store_4444_sse2+0x9b>
.byte 102,15,197,212,4 // pextrw $0x4,%xmm4,%edx
.byte 102,137,84,79,4 // mov %dx,0x4(%edi,%ecx,2)
.byte 102,15,112,228,212 // pshufd $0xd4,%xmm4,%xmm4
.byte 242,15,112,228,232 // pshuflw $0xe8,%xmm4,%xmm4
.byte 102,15,126,36,79 // movd %xmm4,(%edi,%ecx,2)
- .byte 235,133 // jmp 59ea <_sk_store_4444_sse2+0x9b>
+ .byte 235,133 // jmp 585d <_sk_store_4444_sse2+0x9b>
.byte 102,15,126,226 // movd %xmm4,%edx
.byte 102,137,20,79 // mov %dx,(%edi,%ecx,2)
- .byte 233,120,255,255,255 // jmp 59ea <_sk_store_4444_sse2+0x9b>
+ .byte 233,120,255,255,255 // jmp 585d <_sk_store_4444_sse2+0x9b>
HIDDEN _sk_load_8888_sse2
.globl _sk_load_8888_sse2
@@ -56125,7 +55480,7 @@ _sk_load_8888_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5a80 <_sk_load_8888_sse2+0xe>
+ .byte 232,0,0,0,0 // call 58f3 <_sk_load_8888_sse2+0xe>
.byte 91 // pop %ebx
.byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
@@ -56136,13 +55491,13 @@ _sk_load_8888_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,147,0,0,0 // jne 5b34 <_sk_load_8888_sse2+0xc2>
+ .byte 15,133,147,0,0,0 // jne 59a7 <_sk_load_8888_sse2+0xc2>
.byte 243,15,111,44,185 // movdqu (%ecx,%edi,4),%xmm5
- .byte 102,15,111,147,16,71,0,0 // movdqa 0x4710(%ebx),%xmm2
+ .byte 102,15,111,147,253,70,0,0 // movdqa 0x46fd(%ebx),%xmm2
.byte 102,15,111,197 // movdqa %xmm5,%xmm0
.byte 102,15,219,194 // pand %xmm2,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,40,163,32,71,0,0 // movaps 0x4720(%ebx),%xmm4
+ .byte 15,40,163,13,71,0,0 // movaps 0x470d(%ebx),%xmm4
.byte 15,89,196 // mulps %xmm4,%xmm0
.byte 102,15,111,205 // movdqa %xmm5,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -56180,20 +55535,20 @@ _sk_load_8888_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,44 // je 5b6d <_sk_load_8888_sse2+0xfb>
+ .byte 116,44 // je 59e0 <_sk_load_8888_sse2+0xfb>
.byte 102,15,239,237 // pxor %xmm5,%xmm5
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,21 // je 5b63 <_sk_load_8888_sse2+0xf1>
+ .byte 116,21 // je 59d6 <_sk_load_8888_sse2+0xf1>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,78,255,255,255 // jne 5aa6 <_sk_load_8888_sse2+0x34>
+ .byte 15,133,78,255,255,255 // jne 5919 <_sk_load_8888_sse2+0x34>
.byte 102,15,110,68,185,8 // movd 0x8(%ecx,%edi,4),%xmm0
.byte 102,15,112,232,69 // pshufd $0x45,%xmm0,%xmm5
.byte 102,15,18,44,185 // movlpd (%ecx,%edi,4),%xmm5
- .byte 233,57,255,255,255 // jmp 5aa6 <_sk_load_8888_sse2+0x34>
+ .byte 233,57,255,255,255 // jmp 5919 <_sk_load_8888_sse2+0x34>
.byte 102,15,110,44,185 // movd (%ecx,%edi,4),%xmm5
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,44,255,255,255 // jmp 5aa6 <_sk_load_8888_sse2+0x34>
+ .byte 233,44,255,255,255 // jmp 5919 <_sk_load_8888_sse2+0x34>
HIDDEN _sk_load_8888_dst_sse2
.globl _sk_load_8888_dst_sse2
@@ -56207,7 +55562,7 @@ _sk_load_8888_dst_sse2:
.byte 129,236,140,0,0,0 // sub $0x8c,%esp
.byte 102,15,127,93,200 // movdqa %xmm3,-0x38(%ebp)
.byte 15,41,85,216 // movaps %xmm2,-0x28(%ebp)
- .byte 232,0,0,0,0 // call 5b94 <_sk_load_8888_dst_sse2+0x1a>
+ .byte 232,0,0,0,0 // call 5a07 <_sk_load_8888_dst_sse2+0x1a>
.byte 91 // pop %ebx
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
@@ -56216,13 +55571,13 @@ _sk_load_8888_dst_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,150,0,0,0 // jne 5c43 <_sk_load_8888_dst_sse2+0xc9>
+ .byte 15,133,150,0,0,0 // jne 5ab6 <_sk_load_8888_dst_sse2+0xc9>
.byte 243,15,111,28,185 // movdqu (%ecx,%edi,4),%xmm3
- .byte 102,15,111,147,28,70,0,0 // movdqa 0x461c(%ebx),%xmm2
+ .byte 102,15,111,147,9,70,0,0 // movdqa 0x4609(%ebx),%xmm2
.byte 102,15,111,243 // movdqa %xmm3,%xmm6
.byte 102,15,219,242 // pand %xmm2,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,40,187,44,70,0,0 // movaps 0x462c(%ebx),%xmm7
+ .byte 15,40,187,25,70,0,0 // movaps 0x4619(%ebx),%xmm7
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 102,15,111,227 // movdqa %xmm3,%xmm4
.byte 102,15,114,212,8 // psrld $0x8,%xmm4
@@ -56260,20 +55615,20 @@ _sk_load_8888_dst_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,44 // je 5c7c <_sk_load_8888_dst_sse2+0x102>
+ .byte 116,44 // je 5aef <_sk_load_8888_dst_sse2+0x102>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,21 // je 5c72 <_sk_load_8888_dst_sse2+0xf8>
+ .byte 116,21 // je 5ae5 <_sk_load_8888_dst_sse2+0xf8>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,75,255,255,255 // jne 5bb2 <_sk_load_8888_dst_sse2+0x38>
+ .byte 15,133,75,255,255,255 // jne 5a25 <_sk_load_8888_dst_sse2+0x38>
.byte 102,15,110,100,185,8 // movd 0x8(%ecx,%edi,4),%xmm4
.byte 102,15,112,220,69 // pshufd $0x45,%xmm4,%xmm3
.byte 102,15,18,28,185 // movlpd (%ecx,%edi,4),%xmm3
- .byte 233,54,255,255,255 // jmp 5bb2 <_sk_load_8888_dst_sse2+0x38>
+ .byte 233,54,255,255,255 // jmp 5a25 <_sk_load_8888_dst_sse2+0x38>
.byte 102,15,110,28,185 // movd (%ecx,%edi,4),%xmm3
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,41,255,255,255 // jmp 5bb2 <_sk_load_8888_dst_sse2+0x38>
+ .byte 233,41,255,255,255 // jmp 5a25 <_sk_load_8888_dst_sse2+0x38>
HIDDEN _sk_gather_8888_sse2
.globl _sk_gather_8888_sse2
@@ -56285,14 +55640,14 @@ _sk_gather_8888_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5c97 <_sk_gather_8888_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5b0a <_sk_gather_8888_sse2+0xe>
.byte 90 // pop %edx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,12 // mov 0xc(%ebp),%ecx
.byte 139,49 // mov (%ecx),%esi
.byte 139,62 // mov (%esi),%edi
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,86,8 // movd 0x8(%esi),%xmm2
+ .byte 102,15,110,86,4 // movd 0x4(%esi),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -56315,8 +55670,8 @@ _sk_gather_8888_sse2:
.byte 102,15,110,4,183 // movd (%edi,%esi,4),%xmm0
.byte 139,117,16 // mov 0x10(%ebp),%esi
.byte 139,125,20 // mov 0x14(%ebp),%edi
- .byte 102,15,111,162,57,69,0,0 // movdqa 0x4539(%edx),%xmm4
- .byte 15,40,170,73,69,0,0 // movaps 0x4549(%edx),%xmm5
+ .byte 102,15,111,162,38,69,0,0 // movdqa 0x4526(%edx),%xmm4
+ .byte 15,40,170,54,69,0,0 // movaps 0x4536(%edx),%xmm5
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 15,40,125,56 // movaps 0x38(%ebp),%xmm7
@@ -56370,9 +55725,9 @@ _sk_store_8888_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5dbc <_sk_store_8888_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5c2f <_sk_store_8888_sse2+0xe>
.byte 88 // pop %eax
- .byte 15,40,160,52,68,0,0 // movaps 0x4434(%eax),%xmm4
+ .byte 15,40,160,33,68,0,0 // movaps 0x4421(%eax),%xmm4
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
.byte 102,15,91,237 // cvtps2dq %xmm5,%xmm5
@@ -56401,7 +55756,7 @@ _sk_store_8888_sse2:
.byte 133,219 // test %ebx,%ebx
.byte 139,85,8 // mov 0x8(%ebp),%edx
.byte 15,40,125,40 // movaps 0x28(%ebp),%xmm7
- .byte 117,62 // jne 5e65 <_sk_store_8888_sse2+0xb7>
+ .byte 117,62 // jne 5cd8 <_sk_store_8888_sse2+0xb7>
.byte 243,15,127,36,143 // movdqu %xmm4,(%edi,%ecx,4)
.byte 141,120,8 // lea 0x8(%eax),%edi
.byte 15,40,101,88 // movaps 0x58(%ebp),%xmm4
@@ -56425,20 +55780,20 @@ _sk_store_8888_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,37 // je 5e99 <_sk_store_8888_sse2+0xeb>
+ .byte 116,37 // je 5d0c <_sk_store_8888_sse2+0xeb>
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,8 // mov 0x8(%ebp),%edx
- .byte 116,21 // je 5e92 <_sk_store_8888_sse2+0xe4>
+ .byte 116,21 // je 5d05 <_sk_store_8888_sse2+0xe4>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 117,169 // jne 5e2c <_sk_store_8888_sse2+0x7e>
+ .byte 117,169 // jne 5c9f <_sk_store_8888_sse2+0x7e>
.byte 102,15,112,236,78 // pshufd $0x4e,%xmm4,%xmm5
.byte 102,15,126,108,143,8 // movd %xmm5,0x8(%edi,%ecx,4)
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 102,15,214,36,143 // movq %xmm4,(%edi,%ecx,4)
- .byte 235,147 // jmp 5e2c <_sk_store_8888_sse2+0x7e>
+ .byte 235,147 // jmp 5c9f <_sk_store_8888_sse2+0x7e>
.byte 102,15,126,36,143 // movd %xmm4,(%edi,%ecx,4)
.byte 139,85,8 // mov 0x8(%ebp),%edx
- .byte 235,137 // jmp 5e2c <_sk_store_8888_sse2+0x7e>
+ .byte 235,137 // jmp 5c9f <_sk_store_8888_sse2+0x7e>
HIDDEN _sk_store_8888_2d_sse2
.globl _sk_store_8888_2d_sse2
@@ -56450,9 +55805,9 @@ _sk_store_8888_2d_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5eb1 <_sk_store_8888_2d_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5d24 <_sk_store_8888_2d_sse2+0xe>
.byte 88 // pop %eax
- .byte 15,40,160,79,67,0,0 // movaps 0x434f(%eax),%xmm4
+ .byte 15,40,160,60,67,0,0 // movaps 0x433c(%eax),%xmm4
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
.byte 102,15,91,237 // cvtps2dq %xmm5,%xmm5
@@ -56483,7 +55838,7 @@ _sk_store_8888_2d_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,117,8 // mov 0x8(%ebp),%esi
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
- .byte 117,66 // jne 5f63 <_sk_store_8888_2d_sse2+0xc0>
+ .byte 117,66 // jne 5dd6 <_sk_store_8888_2d_sse2+0xc0>
.byte 243,15,127,60,187 // movdqu %xmm7,(%ebx,%edi,4)
.byte 141,88,8 // lea 0x8(%eax),%ebx
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
@@ -56508,19 +55863,19 @@ _sk_store_8888_2d_sse2:
.byte 136,77,243 // mov %cl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,33 // je 5f93 <_sk_store_8888_2d_sse2+0xf0>
+ .byte 116,33 // je 5e06 <_sk_store_8888_2d_sse2+0xf0>
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,77,20 // mov 0x14(%ebp),%ecx
- .byte 116,17 // je 5f8c <_sk_store_8888_2d_sse2+0xe9>
+ .byte 116,17 // je 5dff <_sk_store_8888_2d_sse2+0xe9>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 117,165 // jne 5f26 <_sk_store_8888_2d_sse2+0x83>
+ .byte 117,165 // jne 5d99 <_sk_store_8888_2d_sse2+0x83>
.byte 102,15,112,239,78 // pshufd $0x4e,%xmm7,%xmm5
.byte 102,15,126,108,187,8 // movd %xmm5,0x8(%ebx,%edi,4)
.byte 102,15,214,60,187 // movq %xmm7,(%ebx,%edi,4)
- .byte 235,147 // jmp 5f26 <_sk_store_8888_2d_sse2+0x83>
+ .byte 235,147 // jmp 5d99 <_sk_store_8888_2d_sse2+0x83>
.byte 102,15,126,60,187 // movd %xmm7,(%ebx,%edi,4)
.byte 139,77,20 // mov 0x14(%ebp),%ecx
- .byte 235,137 // jmp 5f26 <_sk_store_8888_2d_sse2+0x83>
+ .byte 235,137 // jmp 5d99 <_sk_store_8888_2d_sse2+0x83>
HIDDEN _sk_load_bgra_sse2
.globl _sk_load_bgra_sse2
@@ -56532,7 +55887,7 @@ _sk_load_bgra_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 5fab <_sk_load_bgra_sse2+0xe>
+ .byte 232,0,0,0,0 // call 5e1e <_sk_load_bgra_sse2+0xe>
.byte 91 // pop %ebx
.byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
.byte 15,40,117,72 // movaps 0x48(%ebp),%xmm6
@@ -56543,13 +55898,13 @@ _sk_load_bgra_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,147,0,0,0 // jne 605f <_sk_load_bgra_sse2+0xc2>
+ .byte 15,133,147,0,0,0 // jne 5ed2 <_sk_load_bgra_sse2+0xc2>
.byte 243,15,111,44,185 // movdqu (%ecx,%edi,4),%xmm5
- .byte 102,15,111,131,101,66,0,0 // movdqa 0x4265(%ebx),%xmm0
+ .byte 102,15,111,131,82,66,0,0 // movdqa 0x4252(%ebx),%xmm0
.byte 102,15,111,205 // movdqa %xmm5,%xmm1
.byte 102,15,219,200 // pand %xmm0,%xmm1
.byte 15,91,209 // cvtdq2ps %xmm1,%xmm2
- .byte 15,40,163,117,66,0,0 // movaps 0x4275(%ebx),%xmm4
+ .byte 15,40,163,98,66,0,0 // movaps 0x4262(%ebx),%xmm4
.byte 15,89,212 // mulps %xmm4,%xmm2
.byte 102,15,111,205 // movdqa %xmm5,%xmm1
.byte 102,15,114,209,8 // psrld $0x8,%xmm1
@@ -56587,20 +55942,20 @@ _sk_load_bgra_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,44 // je 6098 <_sk_load_bgra_sse2+0xfb>
+ .byte 116,44 // je 5f0b <_sk_load_bgra_sse2+0xfb>
.byte 102,15,239,237 // pxor %xmm5,%xmm5
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,21 // je 608e <_sk_load_bgra_sse2+0xf1>
+ .byte 116,21 // je 5f01 <_sk_load_bgra_sse2+0xf1>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,78,255,255,255 // jne 5fd1 <_sk_load_bgra_sse2+0x34>
+ .byte 15,133,78,255,255,255 // jne 5e44 <_sk_load_bgra_sse2+0x34>
.byte 102,15,110,68,185,8 // movd 0x8(%ecx,%edi,4),%xmm0
.byte 102,15,112,232,69 // pshufd $0x45,%xmm0,%xmm5
.byte 102,15,18,44,185 // movlpd (%ecx,%edi,4),%xmm5
- .byte 233,57,255,255,255 // jmp 5fd1 <_sk_load_bgra_sse2+0x34>
+ .byte 233,57,255,255,255 // jmp 5e44 <_sk_load_bgra_sse2+0x34>
.byte 102,15,110,44,185 // movd (%ecx,%edi,4),%xmm5
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,44,255,255,255 // jmp 5fd1 <_sk_load_bgra_sse2+0x34>
+ .byte 233,44,255,255,255 // jmp 5e44 <_sk_load_bgra_sse2+0x34>
HIDDEN _sk_load_bgra_dst_sse2
.globl _sk_load_bgra_dst_sse2
@@ -56614,7 +55969,7 @@ _sk_load_bgra_dst_sse2:
.byte 129,236,140,0,0,0 // sub $0x8c,%esp
.byte 102,15,127,93,200 // movdqa %xmm3,-0x38(%ebp)
.byte 15,41,85,216 // movaps %xmm2,-0x28(%ebp)
- .byte 232,0,0,0,0 // call 60bf <_sk_load_bgra_dst_sse2+0x1a>
+ .byte 232,0,0,0,0 // call 5f32 <_sk_load_bgra_dst_sse2+0x1a>
.byte 91 // pop %ebx
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
@@ -56623,13 +55978,13 @@ _sk_load_bgra_dst_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,150,0,0,0 // jne 616e <_sk_load_bgra_dst_sse2+0xc9>
+ .byte 15,133,150,0,0,0 // jne 5fe1 <_sk_load_bgra_dst_sse2+0xc9>
.byte 243,15,111,28,185 // movdqu (%ecx,%edi,4),%xmm3
- .byte 102,15,111,147,113,65,0,0 // movdqa 0x4171(%ebx),%xmm2
+ .byte 102,15,111,147,94,65,0,0 // movdqa 0x415e(%ebx),%xmm2
.byte 102,15,111,243 // movdqa %xmm3,%xmm6
.byte 102,15,219,242 // pand %xmm2,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
- .byte 15,40,187,129,65,0,0 // movaps 0x4181(%ebx),%xmm7
+ .byte 15,40,187,110,65,0,0 // movaps 0x416e(%ebx),%xmm7
.byte 15,89,247 // mulps %xmm7,%xmm6
.byte 102,15,111,227 // movdqa %xmm3,%xmm4
.byte 102,15,114,212,8 // psrld $0x8,%xmm4
@@ -56667,20 +56022,20 @@ _sk_load_bgra_dst_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,44 // je 61a7 <_sk_load_bgra_dst_sse2+0x102>
+ .byte 116,44 // je 601a <_sk_load_bgra_dst_sse2+0x102>
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 116,21 // je 619d <_sk_load_bgra_dst_sse2+0xf8>
+ .byte 116,21 // je 6010 <_sk_load_bgra_dst_sse2+0xf8>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 15,133,75,255,255,255 // jne 60dd <_sk_load_bgra_dst_sse2+0x38>
+ .byte 15,133,75,255,255,255 // jne 5f50 <_sk_load_bgra_dst_sse2+0x38>
.byte 102,15,110,100,185,8 // movd 0x8(%ecx,%edi,4),%xmm4
.byte 102,15,112,220,69 // pshufd $0x45,%xmm4,%xmm3
.byte 102,15,18,28,185 // movlpd (%ecx,%edi,4),%xmm3
- .byte 233,54,255,255,255 // jmp 60dd <_sk_load_bgra_dst_sse2+0x38>
+ .byte 233,54,255,255,255 // jmp 5f50 <_sk_load_bgra_dst_sse2+0x38>
.byte 102,15,110,28,185 // movd (%ecx,%edi,4),%xmm3
.byte 139,85,24 // mov 0x18(%ebp),%edx
- .byte 233,41,255,255,255 // jmp 60dd <_sk_load_bgra_dst_sse2+0x38>
+ .byte 233,41,255,255,255 // jmp 5f50 <_sk_load_bgra_dst_sse2+0x38>
HIDDEN _sk_gather_bgra_sse2
.globl _sk_gather_bgra_sse2
@@ -56692,14 +56047,14 @@ _sk_gather_bgra_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 61c2 <_sk_gather_bgra_sse2+0xe>
+ .byte 232,0,0,0,0 // call 6035 <_sk_gather_bgra_sse2+0xe>
.byte 90 // pop %edx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,12 // mov 0xc(%ebp),%ecx
.byte 139,49 // mov (%ecx),%esi
.byte 139,62 // mov (%esi),%edi
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,86,8 // movd 0x8(%esi),%xmm2
+ .byte 102,15,110,86,4 // movd 0x4(%esi),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -56722,8 +56077,8 @@ _sk_gather_bgra_sse2:
.byte 102,15,110,4,183 // movd (%edi,%esi,4),%xmm0
.byte 139,117,16 // mov 0x10(%ebp),%esi
.byte 139,125,20 // mov 0x14(%ebp),%edi
- .byte 102,15,111,162,142,64,0,0 // movdqa 0x408e(%edx),%xmm4
- .byte 15,40,170,158,64,0,0 // movaps 0x409e(%edx),%xmm5
+ .byte 102,15,111,162,123,64,0,0 // movdqa 0x407b(%edx),%xmm4
+ .byte 15,40,170,139,64,0,0 // movaps 0x408b(%edx),%xmm5
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 15,40,125,56 // movaps 0x38(%ebp),%xmm7
@@ -56777,9 +56132,9 @@ _sk_store_bgra_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 62e7 <_sk_store_bgra_sse2+0xe>
+ .byte 232,0,0,0,0 // call 615a <_sk_store_bgra_sse2+0xe>
.byte 88 // pop %eax
- .byte 15,40,160,137,63,0,0 // movaps 0x3f89(%eax),%xmm4
+ .byte 15,40,160,118,63,0,0 // movaps 0x3f76(%eax),%xmm4
.byte 15,40,234 // movaps %xmm2,%xmm5
.byte 15,89,236 // mulps %xmm4,%xmm5
.byte 102,15,91,237 // cvtps2dq %xmm5,%xmm5
@@ -56808,7 +56163,7 @@ _sk_store_bgra_sse2:
.byte 133,219 // test %ebx,%ebx
.byte 139,85,8 // mov 0x8(%ebp),%edx
.byte 15,40,125,40 // movaps 0x28(%ebp),%xmm7
- .byte 117,62 // jne 6390 <_sk_store_bgra_sse2+0xb7>
+ .byte 117,62 // jne 6203 <_sk_store_bgra_sse2+0xb7>
.byte 243,15,127,36,143 // movdqu %xmm4,(%edi,%ecx,4)
.byte 141,120,8 // lea 0x8(%eax),%edi
.byte 15,40,101,88 // movaps 0x58(%ebp),%xmm4
@@ -56832,20 +56187,20 @@ _sk_store_bgra_sse2:
.byte 136,85,243 // mov %dl,-0xd(%ebp)
.byte 128,101,243,3 // andb $0x3,-0xd(%ebp)
.byte 128,125,243,1 // cmpb $0x1,-0xd(%ebp)
- .byte 116,37 // je 63c4 <_sk_store_bgra_sse2+0xeb>
+ .byte 116,37 // je 6237 <_sk_store_bgra_sse2+0xeb>
.byte 128,125,243,2 // cmpb $0x2,-0xd(%ebp)
.byte 139,85,8 // mov 0x8(%ebp),%edx
- .byte 116,21 // je 63bd <_sk_store_bgra_sse2+0xe4>
+ .byte 116,21 // je 6230 <_sk_store_bgra_sse2+0xe4>
.byte 128,125,243,3 // cmpb $0x3,-0xd(%ebp)
- .byte 117,169 // jne 6357 <_sk_store_bgra_sse2+0x7e>
+ .byte 117,169 // jne 61ca <_sk_store_bgra_sse2+0x7e>
.byte 102,15,112,236,78 // pshufd $0x4e,%xmm4,%xmm5
.byte 102,15,126,108,143,8 // movd %xmm5,0x8(%edi,%ecx,4)
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 102,15,214,36,143 // movq %xmm4,(%edi,%ecx,4)
- .byte 235,147 // jmp 6357 <_sk_store_bgra_sse2+0x7e>
+ .byte 235,147 // jmp 61ca <_sk_store_bgra_sse2+0x7e>
.byte 102,15,126,36,143 // movd %xmm4,(%edi,%ecx,4)
.byte 139,85,8 // mov 0x8(%ebp),%edx
- .byte 235,137 // jmp 6357 <_sk_store_bgra_sse2+0x7e>
+ .byte 235,137 // jmp 61ca <_sk_store_bgra_sse2+0x7e>
HIDDEN _sk_load_f16_sse2
.globl _sk_load_f16_sse2
@@ -56857,7 +56212,7 @@ _sk_load_f16_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 129,236,188,0,0,0 // sub $0xbc,%esp
- .byte 232,0,0,0,0 // call 63df <_sk_load_f16_sse2+0x11>
+ .byte 232,0,0,0,0 // call 6252 <_sk_load_f16_sse2+0x11>
.byte 91 // pop %ebx
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
@@ -56866,7 +56221,7 @@ _sk_load_f16_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,220,1,0,0 // jne 65d4 <_sk_load_f16_sse2+0x206>
+ .byte 15,133,220,1,0,0 // jne 6447 <_sk_load_f16_sse2+0x206>
.byte 102,15,16,4,249 // movupd (%ecx,%edi,8),%xmm0
.byte 243,15,111,76,249,16 // movdqu 0x10(%ecx,%edi,8),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
@@ -56894,7 +56249,7 @@ _sk_load_f16_sse2:
.byte 102,15,126,69,232 // movd %xmm0,-0x18(%ebp)
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,97,243 // punpcklwd %xmm3,%xmm6
- .byte 102,15,111,171,161,62,0,0 // movdqa 0x3ea1(%ebx),%xmm5
+ .byte 102,15,111,171,142,62,0,0 // movdqa 0x3e8e(%ebx),%xmm5
.byte 102,15,111,214 // movdqa %xmm6,%xmm2
.byte 102,15,219,213 // pand %xmm5,%xmm2
.byte 102,15,239,242 // pxor %xmm2,%xmm6
@@ -56928,15 +56283,15 @@ _sk_load_f16_sse2:
.byte 102,15,111,199 // movdqa %xmm7,%xmm0
.byte 102,15,114,240,13 // pslld $0xd,%xmm0
.byte 102,15,235,197 // por %xmm5,%xmm0
- .byte 102,15,111,155,177,62,0,0 // movdqa 0x3eb1(%ebx),%xmm3
+ .byte 102,15,111,155,158,62,0,0 // movdqa 0x3e9e(%ebx),%xmm3
.byte 102,15,254,203 // paddd %xmm3,%xmm1
.byte 102,15,254,211 // paddd %xmm3,%xmm2
.byte 102,15,254,227 // paddd %xmm3,%xmm4
.byte 102,15,254,195 // paddd %xmm3,%xmm0
- .byte 102,15,111,155,193,62,0,0 // movdqa 0x3ec1(%ebx),%xmm3
+ .byte 102,15,111,155,174,62,0,0 // movdqa 0x3eae(%ebx),%xmm3
.byte 102,15,127,93,184 // movdqa %xmm3,-0x48(%ebp)
.byte 102,15,239,243 // pxor %xmm3,%xmm6
- .byte 102,15,111,155,209,62,0,0 // movdqa 0x3ed1(%ebx),%xmm3
+ .byte 102,15,111,155,190,62,0,0 // movdqa 0x3ebe(%ebx),%xmm3
.byte 102,15,111,235 // movdqa %xmm3,%xmm5
.byte 102,15,102,238 // pcmpgtd %xmm6,%xmm5
.byte 102,15,223,233 // pandn %xmm1,%xmm5
@@ -56979,12 +56334,12 @@ _sk_load_f16_sse2:
.byte 242,15,16,4,249 // movsd (%ecx,%edi,8),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 131,250,1 // cmp $0x1,%edx
- .byte 15,132,29,254,255,255 // je 6403 <_sk_load_f16_sse2+0x35>
+ .byte 15,132,29,254,255,255 // je 6276 <_sk_load_f16_sse2+0x35>
.byte 102,15,22,68,249,8 // movhpd 0x8(%ecx,%edi,8),%xmm0
.byte 131,250,3 // cmp $0x3,%edx
- .byte 15,130,14,254,255,255 // jb 6403 <_sk_load_f16_sse2+0x35>
+ .byte 15,130,14,254,255,255 // jb 6276 <_sk_load_f16_sse2+0x35>
.byte 243,15,126,76,249,16 // movq 0x10(%ecx,%edi,8),%xmm1
- .byte 233,3,254,255,255 // jmp 6403 <_sk_load_f16_sse2+0x35>
+ .byte 233,3,254,255,255 // jmp 6276 <_sk_load_f16_sse2+0x35>
HIDDEN _sk_load_f16_dst_sse2
.globl _sk_load_f16_dst_sse2
@@ -57000,7 +56355,7 @@ _sk_load_f16_dst_sse2:
.byte 102,15,127,149,104,255,255,255 // movdqa %xmm2,-0x98(%ebp)
.byte 15,41,141,120,255,255,255 // movaps %xmm1,-0x88(%ebp)
.byte 102,15,127,69,136 // movdqa %xmm0,-0x78(%ebp)
- .byte 232,0,0,0,0 // call 662c <_sk_load_f16_dst_sse2+0x2c>
+ .byte 232,0,0,0,0 // call 649f <_sk_load_f16_dst_sse2+0x2c>
.byte 91 // pop %ebx
.byte 139,85,24 // mov 0x18(%ebp),%edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
@@ -57009,7 +56364,7 @@ _sk_load_f16_dst_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 139,117,8 // mov 0x8(%ebp),%esi
- .byte 15,133,233,1,0,0 // jne 682e <_sk_load_f16_dst_sse2+0x22e>
+ .byte 15,133,233,1,0,0 // jne 66a1 <_sk_load_f16_dst_sse2+0x22e>
.byte 102,15,16,12,249 // movupd (%ecx,%edi,8),%xmm1
.byte 243,15,111,68,249,16 // movdqu 0x10(%ecx,%edi,8),%xmm0
.byte 102,15,40,217 // movapd %xmm1,%xmm3
@@ -57038,7 +56393,7 @@ _sk_load_f16_dst_sse2:
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 102,15,97,240 // punpcklwd %xmm0,%xmm6
.byte 102,15,239,228 // pxor %xmm4,%xmm4
- .byte 102,15,111,155,148,60,0,0 // movdqa 0x3c94(%ebx),%xmm3
+ .byte 102,15,111,155,129,60,0,0 // movdqa 0x3c81(%ebx),%xmm3
.byte 102,15,111,198 // movdqa %xmm6,%xmm0
.byte 102,15,219,195 // pand %xmm3,%xmm0
.byte 102,15,239,240 // pxor %xmm0,%xmm6
@@ -57072,15 +56427,15 @@ _sk_load_f16_dst_sse2:
.byte 102,15,111,209 // movdqa %xmm1,%xmm2
.byte 102,15,114,242,13 // pslld $0xd,%xmm2
.byte 102,15,235,211 // por %xmm3,%xmm2
- .byte 102,15,111,155,164,60,0,0 // movdqa 0x3ca4(%ebx),%xmm3
+ .byte 102,15,111,155,145,60,0,0 // movdqa 0x3c91(%ebx),%xmm3
.byte 102,15,254,251 // paddd %xmm3,%xmm7
.byte 102,15,254,235 // paddd %xmm3,%xmm5
.byte 102,15,254,227 // paddd %xmm3,%xmm4
.byte 102,15,254,211 // paddd %xmm3,%xmm2
- .byte 102,15,111,131,180,60,0,0 // movdqa 0x3cb4(%ebx),%xmm0
+ .byte 102,15,111,131,161,60,0,0 // movdqa 0x3ca1(%ebx),%xmm0
.byte 102,15,127,69,184 // movdqa %xmm0,-0x48(%ebp)
.byte 102,15,239,240 // pxor %xmm0,%xmm6
- .byte 102,15,111,131,196,60,0,0 // movdqa 0x3cc4(%ebx),%xmm0
+ .byte 102,15,111,131,177,60,0,0 // movdqa 0x3cb1(%ebx),%xmm0
.byte 102,15,111,216 // movdqa %xmm0,%xmm3
.byte 102,15,102,222 // pcmpgtd %xmm6,%xmm3
.byte 102,15,223,223 // pandn %xmm7,%xmm3
@@ -57122,12 +56477,12 @@ _sk_load_f16_dst_sse2:
.byte 242,15,16,12,249 // movsd (%ecx,%edi,8),%xmm1
.byte 102,15,239,192 // pxor %xmm0,%xmm0
.byte 131,250,1 // cmp $0x1,%edx
- .byte 15,132,16,254,255,255 // je 6650 <_sk_load_f16_dst_sse2+0x50>
+ .byte 15,132,16,254,255,255 // je 64c3 <_sk_load_f16_dst_sse2+0x50>
.byte 102,15,22,76,249,8 // movhpd 0x8(%ecx,%edi,8),%xmm1
.byte 131,250,3 // cmp $0x3,%edx
- .byte 15,130,1,254,255,255 // jb 6650 <_sk_load_f16_dst_sse2+0x50>
+ .byte 15,130,1,254,255,255 // jb 64c3 <_sk_load_f16_dst_sse2+0x50>
.byte 243,15,126,68,249,16 // movq 0x10(%ecx,%edi,8),%xmm0
- .byte 233,246,253,255,255 // jmp 6650 <_sk_load_f16_dst_sse2+0x50>
+ .byte 233,246,253,255,255 // jmp 64c3 <_sk_load_f16_dst_sse2+0x50>
HIDDEN _sk_gather_f16_sse2
.globl _sk_gather_f16_sse2
@@ -57139,13 +56494,13 @@ _sk_gather_f16_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 129,236,204,0,0,0 // sub $0xcc,%esp
- .byte 232,0,0,0,0 // call 686b <_sk_gather_f16_sse2+0x11>
+ .byte 232,0,0,0,0 // call 66de <_sk_gather_f16_sse2+0x11>
.byte 89 // pop %ecx
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 139,48 // mov (%eax),%esi
.byte 139,22 // mov (%esi),%edx
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
- .byte 102,15,110,86,8 // movd 0x8(%esi),%xmm2
+ .byte 102,15,110,86,4 // movd 0x4(%esi),%xmm2
.byte 102,15,112,210,0 // pshufd $0x0,%xmm2,%xmm2
.byte 102,15,112,217,245 // pshufd $0xf5,%xmm1,%xmm3
.byte 102,15,244,218 // pmuludq %xmm2,%xmm3
@@ -57202,7 +56557,7 @@ _sk_gather_f16_sse2:
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,111,236 // movdqa %xmm4,%xmm5
.byte 102,15,97,235 // punpcklwd %xmm3,%xmm5
- .byte 102,15,111,161,149,58,0,0 // movdqa 0x3a95(%ecx),%xmm4
+ .byte 102,15,111,161,130,58,0,0 // movdqa 0x3a82(%ecx),%xmm4
.byte 102,15,111,197 // movdqa %xmm5,%xmm0
.byte 102,15,219,196 // pand %xmm4,%xmm0
.byte 102,15,239,232 // pxor %xmm0,%xmm5
@@ -57236,16 +56591,16 @@ _sk_gather_f16_sse2:
.byte 102,15,111,200 // movdqa %xmm0,%xmm1
.byte 102,15,114,241,13 // pslld $0xd,%xmm1
.byte 102,15,235,204 // por %xmm4,%xmm1
- .byte 102,15,111,153,165,58,0,0 // movdqa 0x3aa5(%ecx),%xmm3
+ .byte 102,15,111,153,146,58,0,0 // movdqa 0x3a92(%ecx),%xmm3
.byte 102,15,254,235 // paddd %xmm3,%xmm5
.byte 102,15,254,243 // paddd %xmm3,%xmm6
.byte 102,15,254,251 // paddd %xmm3,%xmm7
.byte 102,15,254,203 // paddd %xmm3,%xmm1
- .byte 102,15,111,153,181,58,0,0 // movdqa 0x3ab5(%ecx),%xmm3
+ .byte 102,15,111,153,162,58,0,0 // movdqa 0x3aa2(%ecx),%xmm3
.byte 102,15,127,93,184 // movdqa %xmm3,-0x48(%ebp)
.byte 102,15,111,85,136 // movdqa -0x78(%ebp),%xmm2
.byte 102,15,239,211 // pxor %xmm3,%xmm2
- .byte 102,15,111,153,197,58,0,0 // movdqa 0x3ac5(%ecx),%xmm3
+ .byte 102,15,111,153,178,58,0,0 // movdqa 0x3ab2(%ecx),%xmm3
.byte 102,15,111,227 // movdqa %xmm3,%xmm4
.byte 102,15,102,226 // pcmpgtd %xmm2,%xmm4
.byte 102,15,223,229 // pandn %xmm5,%xmm4
@@ -57302,20 +56657,20 @@ _sk_store_f16_sse2:
.byte 129,236,188,0,0,0 // sub $0xbc,%esp
.byte 15,41,93,200 // movaps %xmm3,-0x38(%ebp)
.byte 102,15,111,250 // movdqa %xmm2,%xmm7
- .byte 232,0,0,0,0 // call 6b08 <_sk_store_f16_sse2+0x19>
+ .byte 232,0,0,0,0 // call 697b <_sk_store_f16_sse2+0x19>
.byte 88 // pop %eax
- .byte 102,15,111,176,56,56,0,0 // movdqa 0x3838(%eax),%xmm6
+ .byte 102,15,111,176,37,56,0,0 // movdqa 0x3825(%eax),%xmm6
.byte 102,15,111,208 // movdqa %xmm0,%xmm2
.byte 102,15,219,214 // pand %xmm6,%xmm2
.byte 102,15,127,69,184 // movdqa %xmm0,-0x48(%ebp)
.byte 102,15,111,232 // movdqa %xmm0,%xmm5
.byte 102,15,239,234 // pxor %xmm2,%xmm5
- .byte 102,15,111,160,72,56,0,0 // movdqa 0x3848(%eax),%xmm4
+ .byte 102,15,111,160,53,56,0,0 // movdqa 0x3835(%eax),%xmm4
.byte 102,15,114,210,16 // psrld $0x10,%xmm2
.byte 102,15,111,196 // movdqa %xmm4,%xmm0
.byte 102,15,102,197 // pcmpgtd %xmm5,%xmm0
.byte 102,15,114,213,13 // psrld $0xd,%xmm5
- .byte 102,15,111,152,88,56,0,0 // movdqa 0x3858(%eax),%xmm3
+ .byte 102,15,111,152,69,56,0,0 // movdqa 0x3845(%eax),%xmm3
.byte 102,15,254,211 // paddd %xmm3,%xmm2
.byte 102,15,254,213 // paddd %xmm5,%xmm2
.byte 102,15,114,242,16 // pslld $0x10,%xmm2
@@ -57380,7 +56735,7 @@ _sk_store_f16_sse2:
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 102,15,111,200 // movdqa %xmm0,%xmm1
.byte 102,15,98,205 // punpckldq %xmm5,%xmm1
- .byte 117,82 // jne 6ca4 <_sk_store_f16_sse2+0x1b5>
+ .byte 117,82 // jne 6b17 <_sk_store_f16_sse2+0x1b5>
.byte 15,17,12,203 // movups %xmm1,(%ebx,%ecx,8)
.byte 102,15,106,197 // punpckhdq %xmm5,%xmm0
.byte 243,15,127,68,203,16 // movdqu %xmm0,0x10(%ebx,%ecx,8)
@@ -57406,13 +56761,13 @@ _sk_store_f16_sse2:
.byte 195 // ret
.byte 102,15,214,12,203 // movq %xmm1,(%ebx,%ecx,8)
.byte 131,255,1 // cmp $0x1,%edi
- .byte 116,178 // je 6c60 <_sk_store_f16_sse2+0x171>
+ .byte 116,178 // je 6ad3 <_sk_store_f16_sse2+0x171>
.byte 102,15,23,76,203,8 // movhpd %xmm1,0x8(%ebx,%ecx,8)
.byte 131,255,3 // cmp $0x3,%edi
- .byte 114,167 // jb 6c60 <_sk_store_f16_sse2+0x171>
+ .byte 114,167 // jb 6ad3 <_sk_store_f16_sse2+0x171>
.byte 102,15,106,197 // punpckhdq %xmm5,%xmm0
.byte 102,15,214,68,203,16 // movq %xmm0,0x10(%ebx,%ecx,8)
- .byte 235,155 // jmp 6c60 <_sk_store_f16_sse2+0x171>
+ .byte 235,155 // jmp 6ad3 <_sk_store_f16_sse2+0x171>
HIDDEN _sk_load_u16_be_sse2
.globl _sk_load_u16_be_sse2
@@ -57424,7 +56779,7 @@ _sk_load_u16_be_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 129,236,140,0,0,0 // sub $0x8c,%esp
- .byte 232,0,0,0,0 // call 6cd6 <_sk_load_u16_be_sse2+0x11>
+ .byte 232,0,0,0,0 // call 6b49 <_sk_load_u16_be_sse2+0x11>
.byte 91 // pop %ebx
.byte 15,40,125,88 // movaps 0x58(%ebp),%xmm7
.byte 139,85,24 // mov 0x18(%ebp),%edx
@@ -57434,7 +56789,7 @@ _sk_load_u16_be_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,125,16 // mov 0x10(%ebp),%edi
.byte 141,52,189,0,0,0,0 // lea 0x0(,%edi,4),%esi
- .byte 15,133,66,1,0,0 // jne 6e39 <_sk_load_u16_be_sse2+0x174>
+ .byte 15,133,66,1,0,0 // jne 6cac <_sk_load_u16_be_sse2+0x174>
.byte 102,15,16,4,113 // movupd (%ecx,%esi,2),%xmm0
.byte 243,15,111,76,113,16 // movdqu 0x10(%ecx,%esi,2),%xmm1
.byte 102,15,40,208 // movapd %xmm0,%xmm2
@@ -57455,7 +56810,7 @@ _sk_load_u16_be_sse2:
.byte 102,15,239,219 // pxor %xmm3,%xmm3
.byte 102,15,97,195 // punpcklwd %xmm3,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,40,163,154,54,0,0 // movaps 0x369a(%ebx),%xmm4
+ .byte 15,40,163,135,54,0,0 // movaps 0x3687(%ebx),%xmm4
.byte 15,89,196 // mulps %xmm4,%xmm0
.byte 102,15,111,205 // movdqa %xmm5,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -57516,12 +56871,12 @@ _sk_load_u16_be_sse2:
.byte 242,15,16,4,113 // movsd (%ecx,%esi,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 131,250,1 // cmp $0x1,%edx
- .byte 15,132,183,254,255,255 // je 6d02 <_sk_load_u16_be_sse2+0x3d>
+ .byte 15,132,183,254,255,255 // je 6b75 <_sk_load_u16_be_sse2+0x3d>
.byte 102,15,22,68,113,8 // movhpd 0x8(%ecx,%esi,2),%xmm0
.byte 131,250,3 // cmp $0x3,%edx
- .byte 15,130,168,254,255,255 // jb 6d02 <_sk_load_u16_be_sse2+0x3d>
+ .byte 15,130,168,254,255,255 // jb 6b75 <_sk_load_u16_be_sse2+0x3d>
.byte 243,15,126,76,113,16 // movq 0x10(%ecx,%esi,2),%xmm1
- .byte 233,157,254,255,255 // jmp 6d02 <_sk_load_u16_be_sse2+0x3d>
+ .byte 233,157,254,255,255 // jmp 6b75 <_sk_load_u16_be_sse2+0x3d>
HIDDEN _sk_load_rgb_u16_be_sse2
.globl _sk_load_rgb_u16_be_sse2
@@ -57533,7 +56888,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,124 // sub $0x7c,%esp
- .byte 232,0,0,0,0 // call 6e73 <_sk_load_rgb_u16_be_sse2+0xe>
+ .byte 232,0,0,0,0 // call 6ce6 <_sk_load_rgb_u16_be_sse2+0xe>
.byte 88 // pop %eax
.byte 15,40,117,88 // movaps 0x58(%ebp),%xmm6
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
@@ -57544,7 +56899,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 133,246 // test %esi,%esi
.byte 139,93,16 // mov 0x10(%ebp),%ebx
.byte 141,60,91 // lea (%ebx,%ebx,2),%edi
- .byte 15,133,32,1,0,0 // jne 6fb4 <_sk_load_rgb_u16_be_sse2+0x14f>
+ .byte 15,133,32,1,0,0 // jne 6e27 <_sk_load_rgb_u16_be_sse2+0x14f>
.byte 243,15,111,20,122 // movdqu (%edx,%edi,2),%xmm2
.byte 243,15,111,124,122,8 // movdqu 0x8(%edx,%edi,2),%xmm7
.byte 102,15,115,223,4 // psrldq $0x4,%xmm7
@@ -57569,7 +56924,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 102,15,97,199 // punpcklwd %xmm7,%xmm0
.byte 15,91,192 // cvtdq2ps %xmm0,%xmm0
- .byte 15,40,160,13,53,0,0 // movaps 0x350d(%eax),%xmm4
+ .byte 15,40,160,250,52,0,0 // movaps 0x34fa(%eax),%xmm4
.byte 15,89,196 // mulps %xmm4,%xmm0
.byte 102,15,111,203 // movdqa %xmm3,%xmm1
.byte 102,15,113,241,8 // psllw $0x8,%xmm1
@@ -57607,7 +56962,7 @@ _sk_load_rgb_u16_be_sse2:
.byte 137,84,36,4 // mov %edx,0x4(%esp)
.byte 139,85,8 // mov 0x8(%ebp),%edx
.byte 137,20,36 // mov %edx,(%esp)
- .byte 15,40,152,29,53,0,0 // movaps 0x351d(%eax),%xmm3
+ .byte 15,40,152,10,53,0,0 // movaps 0x350a(%eax),%xmm3
.byte 255,81,4 // call *0x4(%ecx)
.byte 131,196,124 // add $0x7c,%esp
.byte 94 // pop %esi
@@ -57619,20 +56974,20 @@ _sk_load_rgb_u16_be_sse2:
.byte 102,15,196,84,122,4,2 // pinsrw $0x2,0x4(%edx,%edi,2),%xmm2
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 131,254,1 // cmp $0x1,%esi
- .byte 117,13 // jne 6fd6 <_sk_load_rgb_u16_be_sse2+0x171>
+ .byte 117,13 // jne 6e49 <_sk_load_rgb_u16_be_sse2+0x171>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
.byte 102,15,239,192 // pxor %xmm0,%xmm0
- .byte 233,224,254,255,255 // jmp 6eb6 <_sk_load_rgb_u16_be_sse2+0x51>
+ .byte 233,224,254,255,255 // jmp 6d29 <_sk_load_rgb_u16_be_sse2+0x51>
.byte 102,15,110,68,122,6 // movd 0x6(%edx,%edi,2),%xmm0
.byte 102,15,196,68,122,10,2 // pinsrw $0x2,0xa(%edx,%edi,2),%xmm0
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 131,254,3 // cmp $0x3,%esi
- .byte 114,18 // jb 6ffe <_sk_load_rgb_u16_be_sse2+0x199>
+ .byte 114,18 // jb 6e71 <_sk_load_rgb_u16_be_sse2+0x199>
.byte 102,15,110,124,122,12 // movd 0xc(%edx,%edi,2),%xmm7
.byte 102,15,196,124,122,16,2 // pinsrw $0x2,0x10(%edx,%edi,2),%xmm7
- .byte 233,184,254,255,255 // jmp 6eb6 <_sk_load_rgb_u16_be_sse2+0x51>
+ .byte 233,184,254,255,255 // jmp 6d29 <_sk_load_rgb_u16_be_sse2+0x51>
.byte 102,15,239,255 // pxor %xmm7,%xmm7
- .byte 233,175,254,255,255 // jmp 6eb6 <_sk_load_rgb_u16_be_sse2+0x51>
+ .byte 233,175,254,255,255 // jmp 6d29 <_sk_load_rgb_u16_be_sse2+0x51>
HIDDEN _sk_store_u16_be_sse2
.globl _sk_store_u16_be_sse2
@@ -57645,9 +57000,9 @@ _sk_store_u16_be_sse2:
.byte 86 // push %esi
.byte 131,236,124 // sub $0x7c,%esp
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
- .byte 232,0,0,0,0 // call 7019 <_sk_store_u16_be_sse2+0x12>
+ .byte 232,0,0,0,0 // call 6e8c <_sk_store_u16_be_sse2+0x12>
.byte 88 // pop %eax
- .byte 15,40,176,135,51,0,0 // movaps 0x3387(%eax),%xmm6
+ .byte 15,40,176,116,51,0,0 // movaps 0x3374(%eax),%xmm6
.byte 15,40,224 // movaps %xmm0,%xmm4
.byte 15,89,230 // mulps %xmm6,%xmm4
.byte 102,15,91,228 // cvtps2dq %xmm4,%xmm4
@@ -57701,7 +57056,7 @@ _sk_store_u16_be_sse2:
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 102,15,111,220 // movdqa %xmm4,%xmm3
.byte 102,15,98,221 // punpckldq %xmm5,%xmm3
- .byte 117,82 // jne 714c <_sk_store_u16_be_sse2+0x145>
+ .byte 117,82 // jne 6fbf <_sk_store_u16_be_sse2+0x145>
.byte 15,17,28,83 // movups %xmm3,(%ebx,%edx,2)
.byte 102,15,106,229 // punpckhdq %xmm5,%xmm4
.byte 243,15,127,100,83,16 // movdqu %xmm4,0x10(%ebx,%edx,2)
@@ -57728,13 +57083,13 @@ _sk_store_u16_be_sse2:
.byte 195 // ret
.byte 102,15,214,28,83 // movq %xmm3,(%ebx,%edx,2)
.byte 131,255,1 // cmp $0x1,%edi
- .byte 116,178 // je 7108 <_sk_store_u16_be_sse2+0x101>
+ .byte 116,178 // je 6f7b <_sk_store_u16_be_sse2+0x101>
.byte 102,15,23,92,83,8 // movhpd %xmm3,0x8(%ebx,%edx,2)
.byte 131,255,3 // cmp $0x3,%edi
- .byte 114,167 // jb 7108 <_sk_store_u16_be_sse2+0x101>
+ .byte 114,167 // jb 6f7b <_sk_store_u16_be_sse2+0x101>
.byte 102,15,106,229 // punpckhdq %xmm5,%xmm4
.byte 102,15,214,100,83,16 // movq %xmm4,0x10(%ebx,%edx,2)
- .byte 235,155 // jmp 7108 <_sk_store_u16_be_sse2+0x101>
+ .byte 235,155 // jmp 6f7b <_sk_store_u16_be_sse2+0x101>
HIDDEN _sk_load_f32_sse2
.globl _sk_load_f32_sse2
@@ -57759,7 +57114,7 @@ _sk_load_f32_sse2:
.byte 139,125,20 // mov 0x14(%ebp),%edi
.byte 133,210 // test %edx,%edx
.byte 141,52,141,0,0,0,0 // lea 0x0(,%ecx,4),%esi
- .byte 117,117 // jne 7217 <_sk_load_f32_sse2+0xaa>
+ .byte 117,117 // jne 708a <_sk_load_f32_sse2+0xaa>
.byte 15,16,84,179,16 // movups 0x10(%ebx,%esi,4),%xmm2
.byte 15,16,92,179,32 // movups 0x20(%ebx,%esi,4),%xmm3
.byte 15,16,68,179,48 // movups 0x30(%ebx,%esi,4),%xmm0
@@ -57797,17 +57152,17 @@ _sk_load_f32_sse2:
.byte 195 // ret
.byte 15,87,192 // xorps %xmm0,%xmm0
.byte 131,250,1 // cmp $0x1,%edx
- .byte 117,8 // jne 7227 <_sk_load_f32_sse2+0xba>
+ .byte 117,8 // jne 709a <_sk_load_f32_sse2+0xba>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,210 // xorps %xmm2,%xmm2
- .byte 235,138 // jmp 71b1 <_sk_load_f32_sse2+0x44>
+ .byte 235,138 // jmp 7024 <_sk_load_f32_sse2+0x44>
.byte 15,16,84,179,16 // movups 0x10(%ebx,%esi,4),%xmm2
.byte 131,250,3 // cmp $0x3,%edx
- .byte 114,10 // jb 723b <_sk_load_f32_sse2+0xce>
+ .byte 114,10 // jb 70ae <_sk_load_f32_sse2+0xce>
.byte 15,16,92,179,32 // movups 0x20(%ebx,%esi,4),%xmm3
- .byte 233,118,255,255,255 // jmp 71b1 <_sk_load_f32_sse2+0x44>
+ .byte 233,118,255,255,255 // jmp 7024 <_sk_load_f32_sse2+0x44>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 233,110,255,255,255 // jmp 71b1 <_sk_load_f32_sse2+0x44>
+ .byte 233,110,255,255,255 // jmp 7024 <_sk_load_f32_sse2+0x44>
HIDDEN _sk_load_f32_dst_sse2
.globl _sk_load_f32_dst_sse2
@@ -57832,7 +57187,7 @@ _sk_load_f32_dst_sse2:
.byte 139,125,20 // mov 0x14(%ebp),%edi
.byte 133,210 // test %edx,%edx
.byte 141,52,141,0,0,0,0 // lea 0x0(,%ecx,4),%esi
- .byte 117,122 // jne 72f5 <_sk_load_f32_dst_sse2+0xb2>
+ .byte 117,122 // jne 7168 <_sk_load_f32_dst_sse2+0xb2>
.byte 15,16,124,179,16 // movups 0x10(%ebx,%esi,4),%xmm7
.byte 15,16,92,179,32 // movups 0x20(%ebx,%esi,4),%xmm3
.byte 15,16,84,179,48 // movups 0x30(%ebx,%esi,4),%xmm2
@@ -57870,17 +57225,17 @@ _sk_load_f32_dst_sse2:
.byte 195 // ret
.byte 15,87,210 // xorps %xmm2,%xmm2
.byte 131,250,1 // cmp $0x1,%edx
- .byte 117,8 // jne 7305 <_sk_load_f32_dst_sse2+0xc2>
+ .byte 117,8 // jne 7178 <_sk_load_f32_dst_sse2+0xc2>
.byte 15,87,219 // xorps %xmm3,%xmm3
.byte 15,87,255 // xorps %xmm7,%xmm7
- .byte 235,133 // jmp 728a <_sk_load_f32_dst_sse2+0x47>
+ .byte 235,133 // jmp 70fd <_sk_load_f32_dst_sse2+0x47>
.byte 15,16,124,179,16 // movups 0x10(%ebx,%esi,4),%xmm7
.byte 131,250,3 // cmp $0x3,%edx
- .byte 114,10 // jb 7319 <_sk_load_f32_dst_sse2+0xd6>
+ .byte 114,10 // jb 718c <_sk_load_f32_dst_sse2+0xd6>
.byte 15,16,92,179,32 // movups 0x20(%ebx,%esi,4),%xmm3
- .byte 233,113,255,255,255 // jmp 728a <_sk_load_f32_dst_sse2+0x47>
+ .byte 233,113,255,255,255 // jmp 70fd <_sk_load_f32_dst_sse2+0x47>
.byte 15,87,219 // xorps %xmm3,%xmm3
- .byte 233,105,255,255,255 // jmp 728a <_sk_load_f32_dst_sse2+0x47>
+ .byte 233,105,255,255,255 // jmp 70fd <_sk_load_f32_dst_sse2+0x47>
HIDDEN _sk_store_f32_sse2
.globl _sk_store_f32_sse2
@@ -57917,7 +57272,7 @@ _sk_store_f32_sse2:
.byte 133,210 // test %edx,%edx
.byte 139,93,8 // mov 0x8(%ebp),%ebx
.byte 141,60,141,0,0,0,0 // lea 0x0(,%ecx,4),%edi
- .byte 117,99 // jne 73de <_sk_store_f32_sse2+0xbd>
+ .byte 117,99 // jne 7251 <_sk_store_f32_sse2+0xbd>
.byte 102,15,21,194 // unpckhpd %xmm2,%xmm0
.byte 15,17,100,190,16 // movups %xmm4,0x10(%esi,%edi,4)
.byte 102,15,17,116,190,32 // movupd %xmm6,0x20(%esi,%edi,4)
@@ -57947,12 +57302,12 @@ _sk_store_f32_sse2:
.byte 93 // pop %ebp
.byte 195 // ret
.byte 131,250,1 // cmp $0x1,%edx
- .byte 116,173 // je 7390 <_sk_store_f32_sse2+0x6f>
+ .byte 116,173 // je 7203 <_sk_store_f32_sse2+0x6f>
.byte 15,17,100,190,16 // movups %xmm4,0x10(%esi,%edi,4)
.byte 131,250,3 // cmp $0x3,%edx
- .byte 114,163 // jb 7390 <_sk_store_f32_sse2+0x6f>
+ .byte 114,163 // jb 7203 <_sk_store_f32_sse2+0x6f>
.byte 102,15,17,116,190,32 // movupd %xmm6,0x20(%esi,%edi,4)
- .byte 235,155 // jmp 7390 <_sk_store_f32_sse2+0x6f>
+ .byte 235,155 // jmp 7203 <_sk_store_f32_sse2+0x6f>
HIDDEN _sk_clamp_x_sse2
.globl _sk_clamp_x_sse2
@@ -58056,7 +57411,7 @@ _sk_repeat_x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 74f9 <_sk_repeat_x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 736c <_sk_repeat_x_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -58070,7 +57425,7 @@ _sk_repeat_x_sse2:
.byte 243,15,91,245 // cvttps2dq %xmm5,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 15,194,238,1 // cmpltps %xmm6,%xmm5
- .byte 15,84,174,183,46,0,0 // andps 0x2eb7(%esi),%xmm5
+ .byte 15,84,174,164,46,0,0 // andps 0x2ea4(%esi),%xmm5
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,125,40 // movaps 0x28(%ebp),%xmm7
.byte 15,92,245 // subps %xmm5,%xmm6
@@ -58111,7 +57466,7 @@ _sk_repeat_y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 7598 <_sk_repeat_y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 740b <_sk_repeat_y_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -58125,7 +57480,7 @@ _sk_repeat_y_sse2:
.byte 243,15,91,245 // cvttps2dq %xmm5,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 15,194,238,1 // cmpltps %xmm6,%xmm5
- .byte 15,84,174,40,46,0,0 // andps 0x2e28(%esi),%xmm5
+ .byte 15,84,174,21,46,0,0 // andps 0x2e15(%esi),%xmm5
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,125,40 // movaps 0x28(%ebp),%xmm7
.byte 15,92,245 // subps %xmm5,%xmm6
@@ -58166,7 +57521,7 @@ _sk_mirror_x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 7637 <_sk_mirror_x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 74aa <_sk_mirror_x_sse2+0xe>
.byte 95 // pop %edi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -58178,13 +57533,13 @@ _sk_mirror_x_sse2:
.byte 15,40,229 // movaps %xmm5,%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
.byte 15,92,196 // subps %xmm4,%xmm0
- .byte 243,15,89,183,137,50,0,0 // mulss 0x3289(%edi),%xmm6
+ .byte 243,15,89,183,118,50,0,0 // mulss 0x3276(%edi),%xmm6
.byte 15,198,246,0 // shufps $0x0,%xmm6,%xmm6
.byte 15,89,240 // mulps %xmm0,%xmm6
.byte 243,15,91,254 // cvttps2dq %xmm6,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
.byte 15,194,247,1 // cmpltps %xmm7,%xmm6
- .byte 15,84,183,153,45,0,0 // andps 0x2d99(%edi),%xmm6
+ .byte 15,84,183,134,45,0,0 // andps 0x2d86(%edi),%xmm6
.byte 139,125,24 // mov 0x18(%ebp),%edi
.byte 15,92,254 // subps %xmm6,%xmm7
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
@@ -58230,7 +57585,7 @@ _sk_mirror_y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 76f8 <_sk_mirror_y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 756b <_sk_mirror_y_sse2+0xe>
.byte 95 // pop %edi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -58242,13 +57597,13 @@ _sk_mirror_y_sse2:
.byte 15,40,229 // movaps %xmm5,%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
.byte 15,92,204 // subps %xmm4,%xmm1
- .byte 243,15,89,183,204,49,0,0 // mulss 0x31cc(%edi),%xmm6
+ .byte 243,15,89,183,185,49,0,0 // mulss 0x31b9(%edi),%xmm6
.byte 15,198,246,0 // shufps $0x0,%xmm6,%xmm6
.byte 15,89,241 // mulps %xmm1,%xmm6
.byte 243,15,91,254 // cvttps2dq %xmm6,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
.byte 15,194,247,1 // cmpltps %xmm7,%xmm6
- .byte 15,84,183,232,44,0,0 // andps 0x2ce8(%edi),%xmm6
+ .byte 15,84,183,213,44,0,0 // andps 0x2cd5(%edi),%xmm6
.byte 139,125,24 // mov 0x18(%ebp),%edi
.byte 15,92,254 // subps %xmm6,%xmm7
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
@@ -58294,7 +57649,7 @@ _sk_clamp_x_1_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 77b9 <_sk_clamp_x_1_sse2+0xe>
+ .byte 232,0,0,0,0 // call 762c <_sk_clamp_x_1_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
@@ -58306,7 +57661,7 @@ _sk_clamp_x_1_sse2:
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,95,224 // maxps %xmm0,%xmm4
.byte 15,40,69,88 // movaps 0x58(%ebp),%xmm0
- .byte 15,93,160,55,44,0,0 // minps 0x2c37(%eax),%xmm4
+ .byte 15,93,160,36,44,0,0 // minps 0x2c24(%eax),%xmm4
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 141,88,4 // lea 0x4(%eax),%ebx
.byte 15,41,68,36,80 // movaps %xmm0,0x50(%esp)
@@ -58337,7 +57692,7 @@ _sk_repeat_x_1_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 782b <_sk_repeat_x_1_sse2+0xe>
+ .byte 232,0,0,0,0 // call 769e <_sk_repeat_x_1_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
@@ -58349,7 +57704,7 @@ _sk_repeat_x_1_sse2:
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 15,40,248 // movaps %xmm0,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,84,184,213,43,0,0 // andps 0x2bd5(%eax),%xmm7
+ .byte 15,84,184,194,43,0,0 // andps 0x2bc2(%eax),%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,40,125,72 // movaps 0x48(%ebp),%xmm7
.byte 15,92,198 // subps %xmm6,%xmm0
@@ -58383,21 +57738,21 @@ _sk_mirror_x_1_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 78a8 <_sk_mirror_x_1_sse2+0xe>
+ .byte 232,0,0,0,0 // call 771b <_sk_mirror_x_1_sse2+0xe>
.byte 95 // pop %edi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
.byte 139,85,20 // mov 0x14(%ebp),%edx
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
- .byte 15,40,175,104,43,0,0 // movaps 0x2b68(%edi),%xmm5
+ .byte 15,40,175,85,43,0,0 // movaps 0x2b55(%edi),%xmm5
.byte 15,88,197 // addps %xmm5,%xmm0
- .byte 15,40,183,120,43,0,0 // movaps 0x2b78(%edi),%xmm6
+ .byte 15,40,183,101,43,0,0 // movaps 0x2b65(%edi),%xmm6
.byte 15,89,240 // mulps %xmm0,%xmm6
.byte 243,15,91,254 // cvttps2dq %xmm6,%xmm7
.byte 15,91,255 // cvtdq2ps %xmm7,%xmm7
.byte 15,194,247,1 // cmpltps %xmm7,%xmm6
- .byte 15,84,183,136,43,0,0 // andps 0x2b88(%edi),%xmm6
+ .byte 15,84,183,117,43,0,0 // andps 0x2b75(%edi),%xmm6
.byte 15,92,254 // subps %xmm6,%xmm7
.byte 15,40,117,56 // movaps 0x38(%ebp),%xmm6
.byte 15,88,255 // addps %xmm7,%xmm7
@@ -58438,7 +57793,7 @@ _sk_luminance_to_alpha_sse2:
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 232,0,0,0,0 // call 7948 <_sk_luminance_to_alpha_sse2+0x11>
+ .byte 232,0,0,0,0 // call 77bb <_sk_luminance_to_alpha_sse2+0x11>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
@@ -58448,9 +57803,9 @@ _sk_luminance_to_alpha_sse2:
.byte 15,40,101,56 // movaps 0x38(%ebp),%xmm4
.byte 15,40,109,72 // movaps 0x48(%ebp),%xmm5
.byte 15,40,117,88 // movaps 0x58(%ebp),%xmm6
- .byte 15,89,128,248,42,0,0 // mulps 0x2af8(%eax),%xmm0
- .byte 15,89,136,8,43,0,0 // mulps 0x2b08(%eax),%xmm1
- .byte 15,89,152,24,43,0,0 // mulps 0x2b18(%eax),%xmm3
+ .byte 15,89,128,229,42,0,0 // mulps 0x2ae5(%eax),%xmm0
+ .byte 15,89,136,245,42,0,0 // mulps 0x2af5(%eax),%xmm1
+ .byte 15,89,152,5,43,0,0 // mulps 0x2b05(%eax),%xmm3
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 15,88,200 // addps %xmm0,%xmm1
.byte 15,88,217 // addps %xmm1,%xmm3
@@ -58994,7 +58349,7 @@ _sk_evenly_spaced_gradient_sse2:
.byte 86 // push %esi
.byte 129,236,156,0,0,0 // sub $0x9c,%esp
.byte 15,41,69,184 // movaps %xmm0,-0x48(%ebp)
- .byte 232,0,0,0,0 // call 8002 <_sk_evenly_spaced_gradient_sse2+0x15>
+ .byte 232,0,0,0,0 // call 7e75 <_sk_evenly_spaced_gradient_sse2+0x15>
.byte 90 // pop %edx
.byte 139,77,12 // mov 0xc(%ebp),%ecx
.byte 141,65,4 // lea 0x4(%ecx),%eax
@@ -59005,12 +58360,12 @@ _sk_evenly_spaced_gradient_sse2:
.byte 78 // dec %esi
.byte 102,15,110,206 // movd %esi,%xmm1
.byte 102,15,112,201,0 // pshufd $0x0,%xmm1,%xmm1
- .byte 102,15,111,146,110,36,0,0 // movdqa 0x246e(%edx),%xmm2
+ .byte 102,15,111,146,91,36,0,0 // movdqa 0x245b(%edx),%xmm2
.byte 102,15,219,209 // pand %xmm1,%xmm2
- .byte 102,15,235,146,126,36,0,0 // por 0x247e(%edx),%xmm2
+ .byte 102,15,235,146,107,36,0,0 // por 0x246b(%edx),%xmm2
.byte 102,15,114,209,16 // psrld $0x10,%xmm1
- .byte 102,15,235,138,142,36,0,0 // por 0x248e(%edx),%xmm1
- .byte 15,88,138,158,36,0,0 // addps 0x249e(%edx),%xmm1
+ .byte 102,15,235,138,123,36,0,0 // por 0x247b(%edx),%xmm1
+ .byte 15,88,138,139,36,0,0 // addps 0x248b(%edx),%xmm1
.byte 15,88,202 // addps %xmm2,%xmm1
.byte 15,89,200 // mulps %xmm0,%xmm1
.byte 243,15,91,201 // cvttps2dq %xmm1,%xmm1
@@ -59133,7 +58488,7 @@ _sk_gauss_a_to_rgba_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 81f9 <_sk_gauss_a_to_rgba_sse2+0xe>
+ .byte 232,0,0,0,0 // call 806c <_sk_gauss_a_to_rgba_sse2+0xe>
.byte 90 // pop %edx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -59143,15 +58498,15 @@ _sk_gauss_a_to_rgba_sse2:
.byte 15,40,85,56 // movaps 0x38(%ebp),%xmm2
.byte 15,40,101,72 // movaps 0x48(%ebp),%xmm4
.byte 15,40,109,88 // movaps 0x58(%ebp),%xmm5
- .byte 15,40,130,183,34,0,0 // movaps 0x22b7(%edx),%xmm0
+ .byte 15,40,130,164,34,0,0 // movaps 0x22a4(%edx),%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,130,199,34,0,0 // addps 0x22c7(%edx),%xmm0
+ .byte 15,88,130,180,34,0,0 // addps 0x22b4(%edx),%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,130,215,34,0,0 // addps 0x22d7(%edx),%xmm0
+ .byte 15,88,130,196,34,0,0 // addps 0x22c4(%edx),%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,130,231,34,0,0 // addps 0x22e7(%edx),%xmm0
+ .byte 15,88,130,212,34,0,0 // addps 0x22d4(%edx),%xmm0
.byte 15,89,195 // mulps %xmm3,%xmm0
- .byte 15,88,130,247,34,0,0 // addps 0x22f7(%edx),%xmm0
+ .byte 15,88,130,228,34,0,0 // addps 0x22e4(%edx),%xmm0
.byte 139,85,12 // mov 0xc(%ebp),%edx
.byte 141,90,4 // lea 0x4(%edx),%ebx
.byte 15,41,108,36,80 // movaps %xmm5,0x50(%esp)
@@ -59184,7 +58539,7 @@ _sk_gradient_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 129,236,156,0,0,0 // sub $0x9c,%esp
- .byte 232,0,0,0,0 // call 8296 <_sk_gradient_sse2+0x11>
+ .byte 232,0,0,0,0 // call 8109 <_sk_gradient_sse2+0x11>
.byte 90 // pop %edx
.byte 139,69,12 // mov 0xc(%ebp),%eax
.byte 141,72,4 // lea 0x4(%eax),%ecx
@@ -59193,12 +58548,12 @@ _sk_gradient_sse2:
.byte 139,7 // mov (%edi),%eax
.byte 102,15,239,201 // pxor %xmm1,%xmm1
.byte 131,248,2 // cmp $0x2,%eax
- .byte 114,43 // jb 82d8 <_sk_gradient_sse2+0x53>
+ .byte 114,43 // jb 814b <_sk_gradient_sse2+0x53>
.byte 139,79,36 // mov 0x24(%edi),%ecx
.byte 72 // dec %eax
.byte 131,193,4 // add $0x4,%ecx
.byte 102,15,239,201 // pxor %xmm1,%xmm1
- .byte 15,40,146,106,34,0,0 // movaps 0x226a(%edx),%xmm2
+ .byte 15,40,146,87,34,0,0 // movaps 0x2257(%edx),%xmm2
.byte 243,15,16,25 // movss (%ecx),%xmm3
.byte 15,198,219,0 // shufps $0x0,%xmm3,%xmm3
.byte 15,194,216,2 // cmpleps %xmm0,%xmm3
@@ -59206,7 +58561,7 @@ _sk_gradient_sse2:
.byte 102,15,254,203 // paddd %xmm3,%xmm1
.byte 131,193,4 // add $0x4,%ecx
.byte 72 // dec %eax
- .byte 117,231 // jne 82bf <_sk_gradient_sse2+0x3a>
+ .byte 117,231 // jne 8132 <_sk_gradient_sse2+0x3a>
.byte 102,15,126,203 // movd %xmm1,%ebx
.byte 102,15,112,209,229 // pshufd $0xe5,%xmm1,%xmm2
.byte 102,15,126,208 // movd %xmm2,%eax
@@ -59395,7 +58750,7 @@ _sk_xy_to_unit_angle_sse2:
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
.byte 15,40,200 // movaps %xmm0,%xmm1
- .byte 232,0,0,0,0 // call 8556 <_sk_xy_to_unit_angle_sse2+0x1b>
+ .byte 232,0,0,0,0 // call 83c9 <_sk_xy_to_unit_angle_sse2+0x1b>
.byte 88 // pop %eax
.byte 15,87,237 // xorps %xmm5,%xmm5
.byte 15,92,233 // subps %xmm1,%xmm5
@@ -59410,35 +58765,35 @@ _sk_xy_to_unit_angle_sse2:
.byte 15,94,247 // divps %xmm7,%xmm6
.byte 15,40,254 // movaps %xmm6,%xmm7
.byte 15,89,255 // mulps %xmm7,%xmm7
- .byte 15,40,128,186,31,0,0 // movaps 0x1fba(%eax),%xmm0
+ .byte 15,40,128,167,31,0,0 // movaps 0x1fa7(%eax),%xmm0
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 15,88,128,202,31,0,0 // addps 0x1fca(%eax),%xmm0
+ .byte 15,88,128,183,31,0,0 // addps 0x1fb7(%eax),%xmm0
.byte 15,89,199 // mulps %xmm7,%xmm0
- .byte 15,88,128,218,31,0,0 // addps 0x1fda(%eax),%xmm0
+ .byte 15,88,128,199,31,0,0 // addps 0x1fc7(%eax),%xmm0
.byte 15,89,199 // mulps %xmm7,%xmm0
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 139,125,24 // mov 0x18(%ebp),%edi
- .byte 15,88,128,234,31,0,0 // addps 0x1fea(%eax),%xmm0
+ .byte 15,88,128,215,31,0,0 // addps 0x1fd7(%eax),%xmm0
.byte 15,89,198 // mulps %xmm6,%xmm0
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 15,194,236,1 // cmpltps %xmm4,%xmm5
- .byte 15,40,184,250,31,0,0 // movaps 0x1ffa(%eax),%xmm7
+ .byte 15,40,184,231,31,0,0 // movaps 0x1fe7(%eax),%xmm7
.byte 15,92,248 // subps %xmm0,%xmm7
.byte 15,84,253 // andps %xmm5,%xmm7
.byte 15,85,232 // andnps %xmm0,%xmm5
.byte 15,87,228 // xorps %xmm4,%xmm4
.byte 15,86,239 // orps %xmm7,%xmm5
.byte 15,194,204,1 // cmpltps %xmm4,%xmm1
- .byte 15,40,128,10,32,0,0 // movaps 0x200a(%eax),%xmm0
+ .byte 15,40,128,247,31,0,0 // movaps 0x1ff7(%eax),%xmm0
.byte 15,92,197 // subps %xmm5,%xmm0
.byte 15,84,193 // andps %xmm1,%xmm0
.byte 15,85,205 // andnps %xmm5,%xmm1
.byte 15,86,200 // orps %xmm0,%xmm1
.byte 15,40,194 // movaps %xmm2,%xmm0
.byte 15,194,196,1 // cmpltps %xmm4,%xmm0
- .byte 15,40,168,26,32,0,0 // movaps 0x201a(%eax),%xmm5
+ .byte 15,40,168,7,32,0,0 // movaps 0x2007(%eax),%xmm5
.byte 15,92,233 // subps %xmm1,%xmm5
.byte 15,84,232 // andps %xmm0,%xmm5
.byte 15,85,193 // andnps %xmm1,%xmm0
@@ -59526,7 +58881,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
- .byte 232,0,0,0,0 // call 86db <_sk_xy_to_2pt_conical_quadratic_max_sse2+0x18>
+ .byte 232,0,0,0,0 // call 854e <_sk_xy_to_2pt_conical_quadratic_max_sse2+0x18>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -59545,11 +58900,11 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 243,15,16,79,36 // movss 0x24(%edi),%xmm1
.byte 139,125,20 // mov 0x14(%ebp),%edi
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
- .byte 15,89,166,165,30,0,0 // mulps 0x1ea5(%esi),%xmm4
+ .byte 15,89,166,146,30,0,0 // mulps 0x1e92(%esi),%xmm4
.byte 243,15,89,246 // mulss %xmm6,%xmm6
.byte 15,198,246,0 // shufps $0x0,%xmm6,%xmm6
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,89,174,181,30,0,0 // mulps 0x1eb5(%esi),%xmm5
+ .byte 15,89,174,162,30,0,0 // mulps 0x1ea2(%esi),%xmm5
.byte 15,89,239 // mulps %xmm7,%xmm5
.byte 15,40,196 // movaps %xmm4,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -59558,8 +58913,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2:
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
.byte 15,40,197 // movaps %xmm5,%xmm0
.byte 15,92,196 // subps %xmm4,%xmm0
- .byte 15,87,166,197,30,0,0 // xorps 0x1ec5(%esi),%xmm4
- .byte 15,89,142,213,30,0,0 // mulps 0x1ed5(%esi),%xmm1
+ .byte 15,87,166,178,30,0,0 // xorps 0x1eb2(%esi),%xmm4
+ .byte 15,89,142,194,30,0,0 // mulps 0x1ec2(%esi),%xmm1
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 15,92,229 // subps %xmm5,%xmm4
@@ -59603,7 +58958,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
.byte 15,40,218 // movaps %xmm2,%xmm3
.byte 15,40,209 // movaps %xmm1,%xmm2
- .byte 232,0,0,0,0 // call 87cf <_sk_xy_to_2pt_conical_quadratic_min_sse2+0x18>
+ .byte 232,0,0,0,0 // call 8642 <_sk_xy_to_2pt_conical_quadratic_min_sse2+0x18>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -59622,11 +58977,11 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 243,15,16,79,36 // movss 0x24(%edi),%xmm1
.byte 139,125,20 // mov 0x14(%ebp),%edi
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
- .byte 15,89,166,241,29,0,0 // mulps 0x1df1(%esi),%xmm4
+ .byte 15,89,166,222,29,0,0 // mulps 0x1dde(%esi),%xmm4
.byte 243,15,89,246 // mulss %xmm6,%xmm6
.byte 15,198,246,0 // shufps $0x0,%xmm6,%xmm6
.byte 15,92,254 // subps %xmm6,%xmm7
- .byte 15,89,174,1,30,0,0 // mulps 0x1e01(%esi),%xmm5
+ .byte 15,89,174,238,29,0,0 // mulps 0x1dee(%esi),%xmm5
.byte 15,89,239 // mulps %xmm7,%xmm5
.byte 15,40,196 // movaps %xmm4,%xmm0
.byte 15,89,192 // mulps %xmm0,%xmm0
@@ -59635,8 +58990,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2:
.byte 15,198,201,0 // shufps $0x0,%xmm1,%xmm1
.byte 15,40,197 // movaps %xmm5,%xmm0
.byte 15,92,196 // subps %xmm4,%xmm0
- .byte 15,87,166,17,30,0,0 // xorps 0x1e11(%esi),%xmm4
- .byte 15,89,142,33,30,0,0 // mulps 0x1e21(%esi),%xmm1
+ .byte 15,87,166,254,29,0,0 // xorps 0x1dfe(%esi),%xmm4
+ .byte 15,89,142,14,30,0,0 // mulps 0x1e0e(%esi),%xmm1
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,117,40 // movaps 0x28(%ebp),%xmm6
.byte 15,92,229 // subps %xmm5,%xmm4
@@ -59677,7 +59032,7 @@ _sk_xy_to_2pt_conical_linear_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 88b9 <_sk_xy_to_2pt_conical_linear_sse2+0xe>
+ .byte 232,0,0,0,0 // call 872c <_sk_xy_to_2pt_conical_linear_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -59689,7 +59044,7 @@ _sk_xy_to_2pt_conical_linear_sse2:
.byte 243,15,89,236 // mulss %xmm4,%xmm5
.byte 15,198,237,0 // shufps $0x0,%xmm5,%xmm5
.byte 15,88,232 // addps %xmm0,%xmm5
- .byte 15,89,174,71,29,0,0 // mulps 0x1d47(%esi),%xmm5
+ .byte 15,89,174,52,29,0,0 // mulps 0x1d34(%esi),%xmm5
.byte 15,89,192 // mulps %xmm0,%xmm0
.byte 15,40,241 // movaps %xmm1,%xmm6
.byte 15,89,246 // mulps %xmm6,%xmm6
@@ -59697,7 +59052,7 @@ _sk_xy_to_2pt_conical_linear_sse2:
.byte 243,15,89,228 // mulss %xmm4,%xmm4
.byte 15,198,228,0 // shufps $0x0,%xmm4,%xmm4
.byte 15,92,196 // subps %xmm4,%xmm0
- .byte 15,87,134,87,29,0,0 // xorps 0x1d57(%esi),%xmm0
+ .byte 15,87,134,68,29,0,0 // xorps 0x1d44(%esi),%xmm0
.byte 139,117,24 // mov 0x18(%ebp),%esi
.byte 15,40,101,40 // movaps 0x28(%ebp),%xmm4
.byte 15,40,117,56 // movaps 0x38(%ebp),%xmm6
@@ -59827,16 +59182,16 @@ _sk_save_xy_sse2:
.byte 131,236,124 // sub $0x7c,%esp
.byte 15,41,93,216 // movaps %xmm3,-0x28(%ebp)
.byte 15,40,218 // movaps %xmm2,%xmm3
- .byte 232,0,0,0,0 // call 8a5b <_sk_save_xy_sse2+0x15>
+ .byte 232,0,0,0,0 // call 88ce <_sk_save_xy_sse2+0x15>
.byte 88 // pop %eax
- .byte 15,40,160,197,27,0,0 // movaps 0x1bc5(%eax),%xmm4
+ .byte 15,40,160,178,27,0,0 // movaps 0x1bb2(%eax),%xmm4
.byte 15,40,232 // movaps %xmm0,%xmm5
.byte 15,88,236 // addps %xmm4,%xmm5
.byte 243,15,91,245 // cvttps2dq %xmm5,%xmm6
.byte 15,91,246 // cvtdq2ps %xmm6,%xmm6
.byte 15,40,253 // movaps %xmm5,%xmm7
.byte 15,194,254,1 // cmpltps %xmm6,%xmm7
- .byte 15,40,144,213,27,0,0 // movaps 0x1bd5(%eax),%xmm2
+ .byte 15,40,144,194,27,0,0 // movaps 0x1bc2(%eax),%xmm2
.byte 15,84,250 // andps %xmm2,%xmm7
.byte 15,92,247 // subps %xmm7,%xmm6
.byte 15,92,238 // subps %xmm6,%xmm5
@@ -59940,15 +59295,15 @@ _sk_bilinear_nx_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8ba0 <_sk_bilinear_nx_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8a13 <_sk_bilinear_nx_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,12 // mov 0xc(%ebp),%esi
.byte 139,62 // mov (%esi),%edi
.byte 15,16,7 // movups (%edi),%xmm0
- .byte 15,88,128,160,26,0,0 // addps 0x1aa0(%eax),%xmm0
- .byte 15,40,160,176,26,0,0 // movaps 0x1ab0(%eax),%xmm4
+ .byte 15,88,128,141,26,0,0 // addps 0x1a8d(%eax),%xmm0
+ .byte 15,40,160,157,26,0,0 // movaps 0x1a9d(%eax),%xmm4
.byte 139,69,20 // mov 0x14(%ebp),%eax
.byte 15,16,111,64 // movups 0x40(%edi),%xmm5
.byte 15,92,229 // subps %xmm5,%xmm4
@@ -59986,14 +59341,14 @@ _sk_bilinear_px_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8c24 <_sk_bilinear_px_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8a97 <_sk_bilinear_px_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,12 // mov 0xc(%ebp),%esi
.byte 139,62 // mov (%esi),%edi
.byte 15,16,7 // movups (%edi),%xmm0
- .byte 15,88,128,60,26,0,0 // addps 0x1a3c(%eax),%xmm0
+ .byte 15,88,128,41,26,0,0 // addps 0x1a29(%eax),%xmm0
.byte 139,69,20 // mov 0x14(%ebp),%eax
.byte 15,16,103,64 // movups 0x40(%edi),%xmm4
.byte 15,17,167,128,0,0,0 // movups %xmm4,0x80(%edi)
@@ -60030,15 +59385,15 @@ _sk_bilinear_ny_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8c9e <_sk_bilinear_ny_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8b11 <_sk_bilinear_ny_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,12 // mov 0xc(%ebp),%esi
.byte 139,62 // mov (%esi),%edi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
- .byte 15,88,136,210,25,0,0 // addps 0x19d2(%eax),%xmm1
- .byte 15,40,160,226,25,0,0 // movaps 0x19e2(%eax),%xmm4
+ .byte 15,88,136,191,25,0,0 // addps 0x19bf(%eax),%xmm1
+ .byte 15,40,160,207,25,0,0 // movaps 0x19cf(%eax),%xmm4
.byte 139,69,20 // mov 0x14(%ebp),%eax
.byte 15,16,111,96 // movups 0x60(%edi),%xmm5
.byte 15,92,229 // subps %xmm5,%xmm4
@@ -60076,14 +59431,14 @@ _sk_bilinear_py_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8d23 <_sk_bilinear_py_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8b96 <_sk_bilinear_py_sse2+0xe>
.byte 88 // pop %eax
.byte 139,77,8 // mov 0x8(%ebp),%ecx
.byte 139,85,16 // mov 0x10(%ebp),%edx
.byte 139,117,12 // mov 0xc(%ebp),%esi
.byte 139,62 // mov (%esi),%edi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
- .byte 15,88,136,109,25,0,0 // addps 0x196d(%eax),%xmm1
+ .byte 15,88,136,90,25,0,0 // addps 0x195a(%eax),%xmm1
.byte 139,69,20 // mov 0x14(%ebp),%eax
.byte 15,16,103,96 // movups 0x60(%edi),%xmm4
.byte 15,17,167,160,0,0,0 // movups %xmm4,0xa0(%edi)
@@ -60120,7 +59475,7 @@ _sk_bicubic_n3x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8d9e <_sk_bicubic_n3x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8c11 <_sk_bicubic_n3x_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -60128,12 +59483,12 @@ _sk_bicubic_n3x_sse2:
.byte 139,58 // mov (%edx),%edi
.byte 15,16,7 // movups (%edi),%xmm0
.byte 15,16,103,64 // movups 0x40(%edi),%xmm4
- .byte 15,88,134,2,25,0,0 // addps 0x1902(%esi),%xmm0
- .byte 15,40,174,18,25,0,0 // movaps 0x1912(%esi),%xmm5
+ .byte 15,88,134,239,24,0,0 // addps 0x18ef(%esi),%xmm0
+ .byte 15,40,174,255,24,0,0 // movaps 0x18ff(%esi),%xmm5
.byte 15,92,236 // subps %xmm4,%xmm5
.byte 15,40,229 // movaps %xmm5,%xmm4
- .byte 15,89,174,34,25,0,0 // mulps 0x1922(%esi),%xmm5
- .byte 15,88,174,50,25,0,0 // addps 0x1932(%esi),%xmm5
+ .byte 15,89,174,15,25,0,0 // mulps 0x190f(%esi),%xmm5
+ .byte 15,88,174,31,25,0,0 // addps 0x191f(%esi),%xmm5
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,89,228 // mulps %xmm4,%xmm4
.byte 15,89,236 // mulps %xmm4,%xmm5
@@ -60171,7 +59526,7 @@ _sk_bicubic_n1x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8e39 <_sk_bicubic_n1x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8cac <_sk_bicubic_n1x_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -60179,16 +59534,16 @@ _sk_bicubic_n1x_sse2:
.byte 139,58 // mov (%edx),%edi
.byte 15,16,7 // movups (%edi),%xmm0
.byte 15,16,103,64 // movups 0x40(%edi),%xmm4
- .byte 15,88,134,167,24,0,0 // addps 0x18a7(%esi),%xmm0
- .byte 15,40,174,183,24,0,0 // movaps 0x18b7(%esi),%xmm5
+ .byte 15,88,134,148,24,0,0 // addps 0x1894(%esi),%xmm0
+ .byte 15,40,174,164,24,0,0 // movaps 0x18a4(%esi),%xmm5
.byte 15,92,236 // subps %xmm4,%xmm5
- .byte 15,40,166,199,24,0,0 // movaps 0x18c7(%esi),%xmm4
+ .byte 15,40,166,180,24,0,0 // movaps 0x18b4(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,215,24,0,0 // addps 0x18d7(%esi),%xmm4
+ .byte 15,88,166,196,24,0,0 // addps 0x18c4(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,231,24,0,0 // addps 0x18e7(%esi),%xmm4
+ .byte 15,88,166,212,24,0,0 // addps 0x18d4(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,247,24,0,0 // addps 0x18f7(%esi),%xmm4
+ .byte 15,88,166,228,24,0,0 // addps 0x18e4(%esi),%xmm4
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,17,167,128,0,0,0 // movups %xmm4,0x80(%edi)
.byte 139,125,24 // mov 0x18(%ebp),%edi
@@ -60224,21 +59579,21 @@ _sk_bicubic_p1x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8ee2 <_sk_bicubic_p1x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8d55 <_sk_bicubic_p1x_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
.byte 139,85,12 // mov 0xc(%ebp),%edx
.byte 139,58 // mov (%edx),%edi
- .byte 15,40,166,94,24,0,0 // movaps 0x185e(%esi),%xmm4
+ .byte 15,40,166,75,24,0,0 // movaps 0x184b(%esi),%xmm4
.byte 15,16,71,64 // movups 0x40(%edi),%xmm0
- .byte 15,40,174,110,24,0,0 // movaps 0x186e(%esi),%xmm5
+ .byte 15,40,174,91,24,0,0 // movaps 0x185b(%esi),%xmm5
.byte 15,89,232 // mulps %xmm0,%xmm5
- .byte 15,88,174,126,24,0,0 // addps 0x187e(%esi),%xmm5
+ .byte 15,88,174,107,24,0,0 // addps 0x186b(%esi),%xmm5
.byte 15,89,232 // mulps %xmm0,%xmm5
.byte 15,88,236 // addps %xmm4,%xmm5
.byte 15,89,232 // mulps %xmm0,%xmm5
- .byte 15,88,174,142,24,0,0 // addps 0x188e(%esi),%xmm5
+ .byte 15,88,174,123,24,0,0 // addps 0x187b(%esi),%xmm5
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,16,7 // movups (%edi),%xmm0
.byte 15,17,175,128,0,0,0 // movups %xmm5,0x80(%edi)
@@ -60276,7 +59631,7 @@ _sk_bicubic_p3x_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 8f80 <_sk_bicubic_p3x_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8df3 <_sk_bicubic_p3x_sse2+0xe>
.byte 89 // pop %ecx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,85,16 // mov 0x10(%ebp),%edx
@@ -60284,10 +59639,10 @@ _sk_bicubic_p3x_sse2:
.byte 139,62 // mov (%esi),%edi
.byte 15,16,7 // movups (%edi),%xmm0
.byte 15,16,103,64 // movups 0x40(%edi),%xmm4
- .byte 15,88,129,0,24,0,0 // addps 0x1800(%ecx),%xmm0
+ .byte 15,88,129,237,23,0,0 // addps 0x17ed(%ecx),%xmm0
.byte 15,40,236 // movaps %xmm4,%xmm5
- .byte 15,89,161,16,24,0,0 // mulps 0x1810(%ecx),%xmm4
- .byte 15,88,161,32,24,0,0 // addps 0x1820(%ecx),%xmm4
+ .byte 15,89,161,253,23,0,0 // mulps 0x17fd(%ecx),%xmm4
+ .byte 15,88,161,13,24,0,0 // addps 0x180d(%ecx),%xmm4
.byte 139,77,20 // mov 0x14(%ebp),%ecx
.byte 15,89,237 // mulps %xmm5,%xmm5
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -60325,7 +59680,7 @@ _sk_bicubic_n3y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 9011 <_sk_bicubic_n3y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8e84 <_sk_bicubic_n3y_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -60333,12 +59688,12 @@ _sk_bicubic_n3y_sse2:
.byte 139,58 // mov (%edx),%edi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
.byte 15,16,103,96 // movups 0x60(%edi),%xmm4
- .byte 15,88,142,159,23,0,0 // addps 0x179f(%esi),%xmm1
- .byte 15,40,174,175,23,0,0 // movaps 0x17af(%esi),%xmm5
+ .byte 15,88,142,140,23,0,0 // addps 0x178c(%esi),%xmm1
+ .byte 15,40,174,156,23,0,0 // movaps 0x179c(%esi),%xmm5
.byte 15,92,236 // subps %xmm4,%xmm5
.byte 15,40,229 // movaps %xmm5,%xmm4
- .byte 15,89,174,191,23,0,0 // mulps 0x17bf(%esi),%xmm5
- .byte 15,88,174,207,23,0,0 // addps 0x17cf(%esi),%xmm5
+ .byte 15,89,174,172,23,0,0 // mulps 0x17ac(%esi),%xmm5
+ .byte 15,88,174,188,23,0,0 // addps 0x17bc(%esi),%xmm5
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,89,228 // mulps %xmm4,%xmm4
.byte 15,89,236 // mulps %xmm4,%xmm5
@@ -60376,7 +59731,7 @@ _sk_bicubic_n1y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 90ad <_sk_bicubic_n1y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8f20 <_sk_bicubic_n1y_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
@@ -60384,16 +59739,16 @@ _sk_bicubic_n1y_sse2:
.byte 139,58 // mov (%edx),%edi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
.byte 15,16,103,96 // movups 0x60(%edi),%xmm4
- .byte 15,88,142,67,23,0,0 // addps 0x1743(%esi),%xmm1
- .byte 15,40,174,83,23,0,0 // movaps 0x1753(%esi),%xmm5
+ .byte 15,88,142,48,23,0,0 // addps 0x1730(%esi),%xmm1
+ .byte 15,40,174,64,23,0,0 // movaps 0x1740(%esi),%xmm5
.byte 15,92,236 // subps %xmm4,%xmm5
- .byte 15,40,166,99,23,0,0 // movaps 0x1763(%esi),%xmm4
+ .byte 15,40,166,80,23,0,0 // movaps 0x1750(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,115,23,0,0 // addps 0x1773(%esi),%xmm4
+ .byte 15,88,166,96,23,0,0 // addps 0x1760(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,131,23,0,0 // addps 0x1783(%esi),%xmm4
+ .byte 15,88,166,112,23,0,0 // addps 0x1770(%esi),%xmm4
.byte 15,89,229 // mulps %xmm5,%xmm4
- .byte 15,88,166,147,23,0,0 // addps 0x1793(%esi),%xmm4
+ .byte 15,88,166,128,23,0,0 // addps 0x1780(%esi),%xmm4
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,17,167,160,0,0,0 // movups %xmm4,0xa0(%edi)
.byte 139,125,24 // mov 0x18(%ebp),%edi
@@ -60429,21 +59784,21 @@ _sk_bicubic_p1y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 9157 <_sk_bicubic_p1y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 8fca <_sk_bicubic_p1y_sse2+0xe>
.byte 94 // pop %esi
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,77,16 // mov 0x10(%ebp),%ecx
.byte 139,85,12 // mov 0xc(%ebp),%edx
.byte 139,58 // mov (%edx),%edi
- .byte 15,40,166,249,22,0,0 // movaps 0x16f9(%esi),%xmm4
+ .byte 15,40,166,230,22,0,0 // movaps 0x16e6(%esi),%xmm4
.byte 15,16,79,96 // movups 0x60(%edi),%xmm1
- .byte 15,40,174,9,23,0,0 // movaps 0x1709(%esi),%xmm5
+ .byte 15,40,174,246,22,0,0 // movaps 0x16f6(%esi),%xmm5
.byte 15,89,233 // mulps %xmm1,%xmm5
- .byte 15,88,174,25,23,0,0 // addps 0x1719(%esi),%xmm5
+ .byte 15,88,174,6,23,0,0 // addps 0x1706(%esi),%xmm5
.byte 15,89,233 // mulps %xmm1,%xmm5
.byte 15,88,236 // addps %xmm4,%xmm5
.byte 15,89,233 // mulps %xmm1,%xmm5
- .byte 15,88,174,41,23,0,0 // addps 0x1729(%esi),%xmm5
+ .byte 15,88,174,22,23,0,0 // addps 0x1716(%esi),%xmm5
.byte 139,117,20 // mov 0x14(%ebp),%esi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
.byte 15,17,175,160,0,0,0 // movups %xmm5,0xa0(%edi)
@@ -60481,7 +59836,7 @@ _sk_bicubic_p3y_sse2:
.byte 87 // push %edi
.byte 86 // push %esi
.byte 131,236,108 // sub $0x6c,%esp
- .byte 232,0,0,0,0 // call 91f6 <_sk_bicubic_p3y_sse2+0xe>
+ .byte 232,0,0,0,0 // call 9069 <_sk_bicubic_p3y_sse2+0xe>
.byte 89 // pop %ecx
.byte 139,69,8 // mov 0x8(%ebp),%eax
.byte 139,85,16 // mov 0x10(%ebp),%edx
@@ -60489,10 +59844,10 @@ _sk_bicubic_p3y_sse2:
.byte 139,62 // mov (%esi),%edi
.byte 15,16,79,32 // movups 0x20(%edi),%xmm1
.byte 15,16,103,96 // movups 0x60(%edi),%xmm4
- .byte 15,88,137,154,22,0,0 // addps 0x169a(%ecx),%xmm1
+ .byte 15,88,137,135,22,0,0 // addps 0x1687(%ecx),%xmm1
.byte 15,40,236 // movaps %xmm4,%xmm5
- .byte 15,89,161,170,22,0,0 // mulps 0x16aa(%ecx),%xmm4
- .byte 15,88,161,186,22,0,0 // addps 0x16ba(%ecx),%xmm4
+ .byte 15,89,161,151,22,0,0 // mulps 0x1697(%ecx),%xmm4
+ .byte 15,88,161,167,22,0,0 // addps 0x16a7(%ecx),%xmm4
.byte 139,77,20 // mov 0x14(%ebp),%ecx
.byte 15,89,237 // mulps %xmm5,%xmm5
.byte 15,89,229 // mulps %xmm5,%xmm4
@@ -60754,9 +60109,9 @@ BALIGN16
.byte 0,224 // add %ah,%al
.byte 64 // inc %eax
.byte 0,0 // add %al,(%eax)
- .byte 224,64 // loopne 955c <.literal16+0x1fc>
+ .byte 224,64 // loopne 93dc <.literal16+0x1fc>
.byte 0,0 // add %al,(%eax)
- .byte 224,64 // loopne 9560 <.literal16+0x200>
+ .byte 224,64 // loopne 93e0 <.literal16+0x200>
.byte 154,153,153,62,154,153,153 // lcall $0x9999,$0x9a3e9999
.byte 62,154,153,153,62,154,153,153 // ds lcall $0x9999,$0x9a3e9999
.byte 62,61,10,23,63,61 // ds cmp $0x3d3f170a,%eax
@@ -60767,16 +60122,16 @@ BALIGN16
.byte 63 // aas
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9581 <.literal16+0x221>
+ .byte 225,61 // loope 9401 <.literal16+0x221>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9585 <.literal16+0x225>
+ .byte 225,61 // loope 9405 <.literal16+0x225>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9589 <.literal16+0x229>
+ .byte 225,61 // loope 9409 <.literal16+0x229>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 958d <.literal16+0x22d>
+ .byte 225,61 // loope 940d <.literal16+0x22d>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -60793,16 +60148,16 @@ BALIGN16
.byte 63 // aas
.byte 61,10,23,63,174 // cmp $0xae3f170a,%eax
.byte 71 // inc %edi
- .byte 225,61 // loope 95c1 <.literal16+0x261>
+ .byte 225,61 // loope 9441 <.literal16+0x261>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 95c5 <.literal16+0x265>
+ .byte 225,61 // loope 9445 <.literal16+0x265>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 95c9 <.literal16+0x269>
+ .byte 225,61 // loope 9449 <.literal16+0x269>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 95cd <.literal16+0x26d>
+ .byte 225,61 // loope 944d <.literal16+0x26d>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -60819,16 +60174,16 @@ BALIGN16
.byte 63 // aas
.byte 61,10,23,63,174 // cmp $0xae3f170a,%eax
.byte 71 // inc %edi
- .byte 225,61 // loope 9601 <.literal16+0x2a1>
+ .byte 225,61 // loope 9481 <.literal16+0x2a1>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9605 <.literal16+0x2a5>
+ .byte 225,61 // loope 9485 <.literal16+0x2a5>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9609 <.literal16+0x2a9>
+ .byte 225,61 // loope 9489 <.literal16+0x2a9>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 960d <.literal16+0x2ad>
+ .byte 225,61 // loope 948d <.literal16+0x2ad>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -60845,16 +60200,16 @@ BALIGN16
.byte 63 // aas
.byte 61,10,23,63,174 // cmp $0xae3f170a,%eax
.byte 71 // inc %edi
- .byte 225,61 // loope 9641 <.literal16+0x2e1>
+ .byte 225,61 // loope 94c1 <.literal16+0x2e1>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9645 <.literal16+0x2e5>
+ .byte 225,61 // loope 94c5 <.literal16+0x2e5>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 9649 <.literal16+0x2e9>
+ .byte 225,61 // loope 94c9 <.literal16+0x2e9>
.byte 174 // scas %es:(%edi),%al
.byte 71 // inc %edi
- .byte 225,61 // loope 964d <.literal16+0x2ed>
+ .byte 225,61 // loope 94cd <.literal16+0x2ed>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -60876,11 +60231,11 @@ BALIGN16
.byte 0,128,63,0,0,127 // add %al,0x7f00003f(%eax)
.byte 67 // inc %ebx
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 968b <.literal16+0x32b>
+ .byte 127,67 // jg 950b <.literal16+0x32b>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 968f <.literal16+0x32f>
+ .byte 127,67 // jg 950f <.literal16+0x32f>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9693 <.literal16+0x333>
+ .byte 127,67 // jg 9513 <.literal16+0x333>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -61149,13 +60504,13 @@ BALIGN16
.byte 132,55 // test %dh,(%edi)
.byte 8,33 // or %ah,(%ecx)
.byte 132,55 // test %dh,(%edi)
- .byte 224,7 // loopne 98d9 <.literal16+0x579>
+ .byte 224,7 // loopne 9759 <.literal16+0x579>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 98dd <.literal16+0x57d>
+ .byte 224,7 // loopne 975d <.literal16+0x57d>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 98e1 <.literal16+0x581>
+ .byte 224,7 // loopne 9761 <.literal16+0x581>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 98e5 <.literal16+0x585>
+ .byte 224,7 // loopne 9765 <.literal16+0x585>
.byte 0,0 // add %al,(%eax)
.byte 33,8 // and %ecx,(%eax)
.byte 2,58 // add (%edx),%bh
@@ -61204,11 +60559,11 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,127,67 // add %bh,0x43(%edi)
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 999b <.literal16+0x63b>
+ .byte 127,67 // jg 981b <.literal16+0x63b>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 999f <.literal16+0x63f>
+ .byte 127,67 // jg 981f <.literal16+0x63f>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 99a3 <.literal16+0x643>
+ .byte 127,67 // jg 9823 <.literal16+0x643>
.byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%eax)
.byte 128,59,129 // cmpb $0x81,(%ebx)
.byte 128,128,59,129,128,128,59 // addb $0x3b,-0x7f7f7ec5(%eax)
@@ -61223,16 +60578,16 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 9994 <.literal16+0x634>
+ .byte 127,0 // jg 9814 <.literal16+0x634>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9998 <.literal16+0x638>
+ .byte 127,0 // jg 9818 <.literal16+0x638>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 999c <.literal16+0x63c>
+ .byte 127,0 // jg 981c <.literal16+0x63c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 99a0 <.literal16+0x640>
+ .byte 127,0 // jg 9820 <.literal16+0x640>
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
@@ -61241,7 +60596,7 @@ BALIGN16
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
- .byte 119,115 // ja 9a25 <.literal16+0x6c5>
+ .byte 119,115 // ja 98a5 <.literal16+0x6c5>
.byte 248 // clc
.byte 194,119,115 // ret $0x7377
.byte 248 // clc
@@ -61252,7 +60607,7 @@ BALIGN16
.byte 194,117,191 // ret $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
- .byte 117,191 // jne 9989 <.literal16+0x629>
+ .byte 117,191 // jne 9809 <.literal16+0x629>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
.byte 249 // stc
@@ -61268,7 +60623,7 @@ BALIGN16
.byte 68 // inc %esp
.byte 180,62 // mov $0x3e,%ah
.byte 163,233,220,63,163 // mov %eax,0xa33fdce9
- .byte 233,220,63,163,233 // jmp e9a3d9c6 <_sk_callback_sse2+0xe9a3474c>
+ .byte 233,220,63,163,233 // jmp e9a3d846 <_sk_callback_sse2+0xe9a34759>
.byte 220,63 // fdivrl (%edi)
.byte 163,233,220,63,0 // mov %eax,0x3fdce9
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -61323,16 +60678,16 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 9a64 <.literal16+0x704>
+ .byte 127,0 // jg 98e4 <.literal16+0x704>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9a68 <.literal16+0x708>
+ .byte 127,0 // jg 98e8 <.literal16+0x708>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9a6c <.literal16+0x70c>
+ .byte 127,0 // jg 98ec <.literal16+0x70c>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9a70 <.literal16+0x710>
+ .byte 127,0 // jg 98f0 <.literal16+0x710>
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
@@ -61341,7 +60696,7 @@ BALIGN16
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
- .byte 119,115 // ja 9af5 <.literal16+0x795>
+ .byte 119,115 // ja 9975 <.literal16+0x795>
.byte 248 // clc
.byte 194,119,115 // ret $0x7377
.byte 248 // clc
@@ -61352,7 +60707,7 @@ BALIGN16
.byte 194,117,191 // ret $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
- .byte 117,191 // jne 9a59 <.literal16+0x6f9>
+ .byte 117,191 // jne 98d9 <.literal16+0x6f9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
.byte 249 // stc
@@ -61368,7 +60723,7 @@ BALIGN16
.byte 68 // inc %esp
.byte 180,62 // mov $0x3e,%ah
.byte 163,233,220,63,163 // mov %eax,0xa33fdce9
- .byte 233,220,63,163,233 // jmp e9a3da96 <_sk_callback_sse2+0xe9a3481c>
+ .byte 233,220,63,163,233 // jmp e9a3d916 <_sk_callback_sse2+0xe9a34829>
.byte 220,63 // fdivrl (%edi)
.byte 163,233,220,63,0 // mov %eax,0x3fdce9
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -61423,16 +60778,16 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 9b34 <.literal16+0x7d4>
+ .byte 127,0 // jg 99b4 <.literal16+0x7d4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9b38 <.literal16+0x7d8>
+ .byte 127,0 // jg 99b8 <.literal16+0x7d8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9b3c <.literal16+0x7dc>
+ .byte 127,0 // jg 99bc <.literal16+0x7dc>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9b40 <.literal16+0x7e0>
+ .byte 127,0 // jg 99c0 <.literal16+0x7e0>
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
@@ -61441,7 +60796,7 @@ BALIGN16
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
- .byte 119,115 // ja 9bc5 <.literal16+0x865>
+ .byte 119,115 // ja 9a45 <.literal16+0x865>
.byte 248 // clc
.byte 194,119,115 // ret $0x7377
.byte 248 // clc
@@ -61452,7 +60807,7 @@ BALIGN16
.byte 194,117,191 // ret $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
- .byte 117,191 // jne 9b29 <.literal16+0x7c9>
+ .byte 117,191 // jne 99a9 <.literal16+0x7c9>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
.byte 249 // stc
@@ -61468,7 +60823,7 @@ BALIGN16
.byte 68 // inc %esp
.byte 180,62 // mov $0x3e,%ah
.byte 163,233,220,63,163 // mov %eax,0xa33fdce9
- .byte 233,220,63,163,233 // jmp e9a3db66 <_sk_callback_sse2+0xe9a348ec>
+ .byte 233,220,63,163,233 // jmp e9a3d9e6 <_sk_callback_sse2+0xe9a348f9>
.byte 220,63 // fdivrl (%edi)
.byte 163,233,220,63,0 // mov %eax,0x3fdce9
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -61523,16 +60878,16 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 52,255 // xor $0xff,%al
.byte 255 // (bad)
- .byte 127,0 // jg 9c04 <.literal16+0x8a4>
+ .byte 127,0 // jg 9a84 <.literal16+0x8a4>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9c08 <.literal16+0x8a8>
+ .byte 127,0 // jg 9a88 <.literal16+0x8a8>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9c0c <.literal16+0x8ac>
+ .byte 127,0 // jg 9a8c <.literal16+0x8ac>
.byte 255 // (bad)
.byte 255 // (bad)
- .byte 127,0 // jg 9c10 <.literal16+0x8b0>
+ .byte 127,0 // jg 9a90 <.literal16+0x8b0>
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
@@ -61541,7 +60896,7 @@ BALIGN16
.byte 0,63 // add %bh,(%edi)
.byte 0,0 // add %al,(%eax)
.byte 0,63 // add %bh,(%edi)
- .byte 119,115 // ja 9c95 <.literal16+0x935>
+ .byte 119,115 // ja 9b15 <.literal16+0x935>
.byte 248 // clc
.byte 194,119,115 // ret $0x7377
.byte 248 // clc
@@ -61552,7 +60907,7 @@ BALIGN16
.byte 194,117,191 // ret $0xbf75
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
- .byte 117,191 // jne 9bf9 <.literal16+0x899>
+ .byte 117,191 // jne 9a79 <.literal16+0x899>
.byte 191,63,117,191,191 // mov $0xbfbf753f,%edi
.byte 63 // aas
.byte 249 // stc
@@ -61568,7 +60923,7 @@ BALIGN16
.byte 68 // inc %esp
.byte 180,62 // mov $0x3e,%ah
.byte 163,233,220,63,163 // mov %eax,0xa33fdce9
- .byte 233,220,63,163,233 // jmp e9a3dc36 <_sk_callback_sse2+0xe9a349bc>
+ .byte 233,220,63,163,233 // jmp e9a3dab6 <_sk_callback_sse2+0xe9a349c9>
.byte 220,63 // fdivrl (%edi)
.byte 163,233,220,63,0 // mov %eax,0x3fdce9
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -61619,13 +60974,13 @@ BALIGN16
.byte 200,66,0,0 // enter $0x42,$0x0
.byte 200,66,0,0 // enter $0x42,$0x0
.byte 200,66,0,0 // enter $0x42,$0x0
- .byte 127,67 // jg 9d17 <.literal16+0x9b7>
+ .byte 127,67 // jg 9b97 <.literal16+0x9b7>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9d1b <.literal16+0x9bb>
+ .byte 127,67 // jg 9b9b <.literal16+0x9bb>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9d1f <.literal16+0x9bf>
+ .byte 127,67 // jg 9b9f <.literal16+0x9bf>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9d23 <.literal16+0x9c3>
+ .byte 127,67 // jg 9ba3 <.literal16+0x9c3>
.byte 0,0 // add %al,(%eax)
.byte 0,195 // add %al,%bl
.byte 0,0 // add %al,(%eax)
@@ -61676,16 +61031,16 @@ BALIGN16
.byte 128,3,62 // addb $0x3e,(%ebx)
.byte 31 // pop %ds
.byte 215 // xlat %ds:(%ebx)
- .byte 118,63 // jbe 9da3 <.literal16+0xa43>
+ .byte 118,63 // jbe 9c23 <.literal16+0xa43>
.byte 31 // pop %ds
.byte 215 // xlat %ds:(%ebx)
- .byte 118,63 // jbe 9da7 <.literal16+0xa47>
+ .byte 118,63 // jbe 9c27 <.literal16+0xa47>
.byte 31 // pop %ds
.byte 215 // xlat %ds:(%ebx)
- .byte 118,63 // jbe 9dab <.literal16+0xa4b>
+ .byte 118,63 // jbe 9c2b <.literal16+0xa4b>
.byte 31 // pop %ds
.byte 215 // xlat %ds:(%ebx)
- .byte 118,63 // jbe 9daf <.literal16+0xa4f>
+ .byte 118,63 // jbe 9c2f <.literal16+0xa4f>
.byte 246,64,83,63 // testb $0x3f,0x53(%eax)
.byte 246,64,83,63 // testb $0x3f,0x53(%eax)
.byte 246,64,83,63 // testb $0x3f,0x53(%eax)
@@ -61714,11 +61069,11 @@ BALIGN16
.byte 128,59,0 // cmpb $0x0,(%ebx)
.byte 0,127,67 // add %bh,0x43(%edi)
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9e1b <.literal16+0xabb>
+ .byte 127,67 // jg 9c9b <.literal16+0xabb>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9e1f <.literal16+0xabf>
+ .byte 127,67 // jg 9c9f <.literal16+0xabf>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg 9e23 <.literal16+0xac3>
+ .byte 127,67 // jg 9ca3 <.literal16+0xac3>
.byte 255,0 // incl (%eax)
.byte 0,0 // add %al,(%eax)
.byte 0,0 // add %al,(%eax)
@@ -61764,17 +61119,8 @@ BALIGN16
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
.byte 63 // aas
- .byte 255,0 // incl (%eax)
- .byte 0,0 // add %al,(%eax)
- .byte 255,0 // incl (%eax)
- .byte 0,0 // add %al,(%eax)
- .byte 255,0 // incl (%eax)
- .byte 0,0 // add %al,(%eax)
- .byte 255,0 // incl (%eax)
+ .byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%eax)
- .byte 129,128,128,59,129,128,128,59,129,128// addl $0x80813b80,-0x7f7ec480(%eax)
- .byte 128,59,129 // cmpb $0x81,(%ebx)
- .byte 128,128,59,0,248,0,0 // addb $0x0,0xf8003b(%eax)
.byte 0,248 // add %bh,%al
.byte 0,0 // add %al,(%eax)
.byte 0,248 // add %bh,%al
@@ -61789,13 +61135,13 @@ BALIGN16
.byte 132,55 // test %dh,(%edi)
.byte 8,33 // or %ah,(%ecx)
.byte 132,55 // test %dh,(%edi)
- .byte 224,7 // loopne 9eb9 <.literal16+0xb59>
+ .byte 224,7 // loopne 9d19 <.literal16+0xb39>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9ebd <.literal16+0xb5d>
+ .byte 224,7 // loopne 9d1d <.literal16+0xb3d>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9ec1 <.literal16+0xb61>
+ .byte 224,7 // loopne 9d21 <.literal16+0xb41>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9ec5 <.literal16+0xb65>
+ .byte 224,7 // loopne 9d25 <.literal16+0xb45>
.byte 0,0 // add %al,(%eax)
.byte 33,8 // and %ecx,(%eax)
.byte 2,58 // add (%edx),%bh
@@ -61841,13 +61187,13 @@ BALIGN16
.byte 132,55 // test %dh,(%edi)
.byte 8,33 // or %ah,(%ecx)
.byte 132,55 // test %dh,(%edi)
- .byte 224,7 // loopne 9f29 <.literal16+0xbc9>
+ .byte 224,7 // loopne 9d89 <.literal16+0xba9>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9f2d <.literal16+0xbcd>
+ .byte 224,7 // loopne 9d8d <.literal16+0xbad>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9f31 <.literal16+0xbd1>
+ .byte 224,7 // loopne 9d91 <.literal16+0xbb1>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9f35 <.literal16+0xbd5>
+ .byte 224,7 // loopne 9d95 <.literal16+0xbb5>
.byte 0,0 // add %al,(%eax)
.byte 33,8 // and %ecx,(%eax)
.byte 2,58 // add (%edx),%bh
@@ -61893,13 +61239,13 @@ BALIGN16
.byte 132,55 // test %dh,(%edi)
.byte 8,33 // or %ah,(%ecx)
.byte 132,55 // test %dh,(%edi)
- .byte 224,7 // loopne 9f99 <.literal16+0xc39>
+ .byte 224,7 // loopne 9df9 <.literal16+0xc19>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9f9d <.literal16+0xc3d>
+ .byte 224,7 // loopne 9dfd <.literal16+0xc1d>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9fa1 <.literal16+0xc41>
+ .byte 224,7 // loopne 9e01 <.literal16+0xc21>
.byte 0,0 // add %al,(%eax)
- .byte 224,7 // loopne 9fa5 <.literal16+0xc45>
+ .byte 224,7 // loopne 9e05 <.literal16+0xc25>
.byte 0,0 // add %al,(%eax)
.byte 33,8 // and %ecx,(%eax)
.byte 2,58 // add (%edx),%bh
@@ -61941,13 +61287,13 @@ BALIGN16
.byte 248 // clc
.byte 65 // inc %ecx
.byte 0,0 // add %al,(%eax)
- .byte 124,66 // jl a036 <.literal16+0xcd6>
+ .byte 124,66 // jl 9e96 <.literal16+0xcb6>
.byte 0,0 // add %al,(%eax)
- .byte 124,66 // jl a03a <.literal16+0xcda>
+ .byte 124,66 // jl 9e9a <.literal16+0xcba>
.byte 0,0 // add %al,(%eax)
- .byte 124,66 // jl a03e <.literal16+0xcde>
+ .byte 124,66 // jl 9e9e <.literal16+0xcbe>
.byte 0,0 // add %al,(%eax)
- .byte 124,66 // jl a042 <.literal16+0xce2>
+ .byte 124,66 // jl 9ea2 <.literal16+0xcc2>
.byte 0,240 // add %dh,%al
.byte 0,0 // add %al,(%eax)
.byte 0,240 // add %dh,%al
@@ -62081,13 +61427,13 @@ BALIGN16
.byte 136,136,61,137,136,136 // mov %cl,-0x777776c3(%eax)
.byte 61,137,136,136,61 // cmp $0x3d888889,%eax
.byte 0,0 // add %al,(%eax)
- .byte 112,65 // jo a1c5 <.literal16+0xe65>
+ .byte 112,65 // jo a025 <.literal16+0xe45>
.byte 0,0 // add %al,(%eax)
- .byte 112,65 // jo a1c9 <.literal16+0xe69>
+ .byte 112,65 // jo a029 <.literal16+0xe49>
.byte 0,0 // add %al,(%eax)
- .byte 112,65 // jo a1cd <.literal16+0xe6d>
+ .byte 112,65 // jo a02d <.literal16+0xe4d>
.byte 0,0 // add %al,(%eax)
- .byte 112,65 // jo a1d1 <.literal16+0xe71>
+ .byte 112,65 // jo a031 <.literal16+0xe51>
.byte 255,0 // incl (%eax)
.byte 0,0 // add %al,(%eax)
.byte 255,0 // incl (%eax)
@@ -62118,19 +61464,19 @@ BALIGN16
.byte 128,59,129 // cmpb $0x81,(%ebx)
.byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%eax)
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a23b <.literal16+0xedb>
+ .byte 127,67 // jg a09b <.literal16+0xebb>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a23f <.literal16+0xedf>
+ .byte 127,67 // jg a09f <.literal16+0xebf>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a243 <.literal16+0xee3>
+ .byte 127,67 // jg a0a3 <.literal16+0xec3>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a247 <.literal16+0xee7>
+ .byte 127,67 // jg a0a7 <.literal16+0xec7>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a24b <.literal16+0xeeb>
+ .byte 127,67 // jg a0ab <.literal16+0xecb>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a24f <.literal16+0xeef>
+ .byte 127,67 // jg a0af <.literal16+0xecf>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a253 <.literal16+0xef3>
+ .byte 127,67 // jg a0b3 <.literal16+0xed3>
.byte 255,0 // incl (%eax)
.byte 0,0 // add %al,(%eax)
.byte 255,0 // incl (%eax)
@@ -62161,11 +61507,11 @@ BALIGN16
.byte 128,59,129 // cmpb $0x81,(%ebx)
.byte 128,128,59,0,0,127,67 // addb $0x43,0x7f00003b(%eax)
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a2bb <.literal16+0xf5b>
+ .byte 127,67 // jg a11b <.literal16+0xf3b>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a2bf <.literal16+0xf5f>
+ .byte 127,67 // jg a11f <.literal16+0xf3f>
.byte 0,0 // add %al,(%eax)
- .byte 127,67 // jg a2c3 <.literal16+0xf63>
+ .byte 127,67 // jg a123 <.literal16+0xf43>
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%eax)
.byte 0,0 // add %al,(%eax)
.byte 0,128,0,0,0,128 // add %al,-0x80000000(%eax)
@@ -62264,13 +61610,13 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 255 // (bad)
- .byte 127,71 // jg a3eb <.literal16+0x108b>
+ .byte 127,71 // jg a24b <.literal16+0x106b>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg a3ef <.literal16+0x108f>
+ .byte 127,71 // jg a24f <.literal16+0x106f>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg a3f3 <.literal16+0x1093>
+ .byte 127,71 // jg a253 <.literal16+0x1073>
.byte 0,255 // add %bh,%bh
- .byte 127,71 // jg a3f7 <.literal16+0x1097>
+ .byte 127,71 // jg a257 <.literal16+0x1077>
.byte 0,0 // add %al,(%eax)
.byte 128,63,0 // cmpb $0x0,(%edi)
.byte 0,128,63,0,0,128 // add %al,-0x7fffffc1(%eax)
@@ -62378,7 +61724,7 @@ BALIGN16
.byte 192,45,16,17,192,45,16 // shrb $0x10,0x2dc01110
.byte 17,192 // adc %eax,%eax
.byte 45,16,17,192,18 // sub $0x12c01110,%eax
- .byte 120,57 // js a4fc <.literal16+0x119c>
+ .byte 120,57 // js a35c <.literal16+0x117c>
.byte 64 // inc %eax
.byte 18,120,57 // adc 0x39(%eax),%bh
.byte 64 // inc %eax
@@ -62571,11 +61917,11 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 128,63,114 // cmpb $0x72,(%edi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt a6e2 <.literal16+0x1382>
+ .byte 62,114,28 // jb,pt a542 <.literal16+0x1362>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a6e6 <.literal16+0x1386>
+ .byte 62,114,28 // jb,pt a546 <.literal16+0x1366>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a6ea <.literal16+0x138a>
+ .byte 62,114,28 // jb,pt a54a <.literal16+0x136a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%edi)
.byte 170 // stos %al,%es:(%edi)
@@ -62654,13 +62000,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%edi)
.byte 0,192 // add %al,%al
.byte 63 // aas
- .byte 114,28 // jb a7ae <.literal16+0x144e>
+ .byte 114,28 // jb a60e <.literal16+0x142e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a7b2 <.literal16+0x1452>
+ .byte 62,114,28 // jb,pt a612 <.literal16+0x1432>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a7b6 <.literal16+0x1456>
+ .byte 62,114,28 // jb,pt a616 <.literal16+0x1436>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a7ba <.literal16+0x145a>
+ .byte 62,114,28 // jb,pt a61a <.literal16+0x143a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%edi)
.byte 170 // stos %al,%es:(%edi)
@@ -62681,11 +62027,11 @@ BALIGN16
.byte 0,0 // add %al,(%eax)
.byte 128,63,114 // cmpb $0x72,(%edi)
.byte 28,199 // sbb $0xc7,%al
- .byte 62,114,28 // jb,pt a7f2 <.literal16+0x1492>
+ .byte 62,114,28 // jb,pt a652 <.literal16+0x1472>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a7f6 <.literal16+0x1496>
+ .byte 62,114,28 // jb,pt a656 <.literal16+0x1476>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a7fa <.literal16+0x149a>
+ .byte 62,114,28 // jb,pt a65a <.literal16+0x147a>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%edi)
.byte 170 // stos %al,%es:(%edi)
@@ -62764,13 +62110,13 @@ BALIGN16
.byte 192,63,0 // sarb $0x0,(%edi)
.byte 0,192 // add %al,%al
.byte 63 // aas
- .byte 114,28 // jb a8be <.literal16+0x155e>
+ .byte 114,28 // jb a71e <.literal16+0x153e>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a8c2 <_sk_callback_sse2+0x1648>
+ .byte 62,114,28 // jb,pt a722 <_sk_callback_sse2+0x1635>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a8c6 <_sk_callback_sse2+0x164c>
+ .byte 62,114,28 // jb,pt a726 <_sk_callback_sse2+0x1639>
.byte 199 // (bad)
- .byte 62,114,28 // jb,pt a8ca <_sk_callback_sse2+0x1650>
+ .byte 62,114,28 // jb,pt a72a <_sk_callback_sse2+0x163d>
.byte 199 // (bad)
.byte 62,171 // ds stos %eax,%es:(%edi)
.byte 170 // stos %al,%es:(%edi)
diff --git a/src/jumper/SkJumper_generated_win.S b/src/jumper/SkJumper_generated_win.S
index 807e090d1e..bb95114cc0 100644
--- a/src/jumper/SkJumper_generated_win.S
+++ b/src/jumper/SkJumper_generated_win.S
@@ -176,7 +176,7 @@ _sk_seed_shader_hsw LABEL PROC
DB 197,249,110,194 ; vmovd %edx,%xmm0
DB 196,226,125,88,192 ; vpbroadcastd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,223,87,0,0 ; vbroadcastss 0x57df(%rip),%ymm1 # 5a58 <_sk_callback_hsw+0x12c>
+ DB 196,226,125,24,13,223,86,0,0 ; vbroadcastss 0x56df(%rip),%ymm1 # 5958 <_sk_callback_hsw+0x12c>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0
DB 197,249,110,209 ; vmovd %ecx,%xmm2
@@ -184,7 +184,7 @@ _sk_seed_shader_hsw LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,21,191,87,0,0 ; vbroadcastss 0x57bf(%rip),%ymm2 # 5a5c <_sk_callback_hsw+0x130>
+ DB 196,226,125,24,21,191,86,0,0 ; vbroadcastss 0x56bf(%rip),%ymm2 # 595c <_sk_callback_hsw+0x130>
DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
@@ -201,13 +201,13 @@ _sk_dither_hsw LABEL PROC
DB 197,121,110,201 ; vmovd %ecx,%xmm9
DB 196,66,125,88,201 ; vpbroadcastd %xmm9,%ymm9
DB 196,65,53,239,200 ; vpxor %ymm8,%ymm9,%ymm9
- DB 196,98,125,88,21,134,87,0,0 ; vpbroadcastd 0x5786(%rip),%ymm10 # 5a60 <_sk_callback_hsw+0x134>
+ DB 196,98,125,88,21,134,86,0,0 ; vpbroadcastd 0x5686(%rip),%ymm10 # 5960 <_sk_callback_hsw+0x134>
DB 196,65,53,219,218 ; vpand %ymm10,%ymm9,%ymm11
DB 196,193,37,114,243,5 ; vpslld $0x5,%ymm11,%ymm11
DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10
DB 196,193,45,114,242,4 ; vpslld $0x4,%ymm10,%ymm10
- DB 196,98,125,88,37,107,87,0,0 ; vpbroadcastd 0x576b(%rip),%ymm12 # 5a64 <_sk_callback_hsw+0x138>
- DB 196,98,125,88,45,102,87,0,0 ; vpbroadcastd 0x5766(%rip),%ymm13 # 5a68 <_sk_callback_hsw+0x13c>
+ DB 196,98,125,88,37,107,86,0,0 ; vpbroadcastd 0x566b(%rip),%ymm12 # 5964 <_sk_callback_hsw+0x138>
+ DB 196,98,125,88,45,102,86,0,0 ; vpbroadcastd 0x5666(%rip),%ymm13 # 5968 <_sk_callback_hsw+0x13c>
DB 196,65,53,219,245 ; vpand %ymm13,%ymm9,%ymm14
DB 196,193,13,114,246,2 ; vpslld $0x2,%ymm14,%ymm14
DB 196,65,61,219,237 ; vpand %ymm13,%ymm8,%ymm13
@@ -222,8 +222,8 @@ _sk_dither_hsw LABEL PROC
DB 196,65,61,235,194 ; vpor %ymm10,%ymm8,%ymm8
DB 196,65,61,235,193 ; vpor %ymm9,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,24,87,0,0 ; vbroadcastss 0x5718(%rip),%ymm9 # 5a6c <_sk_callback_hsw+0x140>
- DB 196,98,125,24,21,19,87,0,0 ; vbroadcastss 0x5713(%rip),%ymm10 # 5a70 <_sk_callback_hsw+0x144>
+ DB 196,98,125,24,13,24,86,0,0 ; vbroadcastss 0x5618(%rip),%ymm9 # 596c <_sk_callback_hsw+0x140>
+ DB 196,98,125,24,21,19,86,0,0 ; vbroadcastss 0x5613(%rip),%ymm10 # 5970 <_sk_callback_hsw+0x144>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
DB 196,98,125,24,0 ; vbroadcastss (%rax),%ymm8
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
@@ -253,7 +253,7 @@ _sk_uniform_color_hsw LABEL PROC
PUBLIC _sk_black_color_hsw
_sk_black_color_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,179,86,0,0 ; vbroadcastss 0x56b3(%rip),%ymm3 # 5a74 <_sk_callback_hsw+0x148>
+ DB 196,226,125,24,29,179,85,0,0 ; vbroadcastss 0x55b3(%rip),%ymm3 # 5974 <_sk_callback_hsw+0x148>
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -262,7 +262,7 @@ _sk_black_color_hsw LABEL PROC
PUBLIC _sk_white_color_hsw
_sk_white_color_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,158,86,0,0 ; vbroadcastss 0x569e(%rip),%ymm0 # 5a78 <_sk_callback_hsw+0x14c>
+ DB 196,226,125,24,5,158,85,0,0 ; vbroadcastss 0x559e(%rip),%ymm0 # 5978 <_sk_callback_hsw+0x14c>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 197,252,40,216 ; vmovaps %ymm0,%ymm3
@@ -300,7 +300,7 @@ _sk_clear_hsw LABEL PROC
PUBLIC _sk_srcatop_hsw
_sk_srcatop_hsw LABEL PROC
DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0
- DB 196,98,125,24,5,65,86,0,0 ; vbroadcastss 0x5641(%rip),%ymm8 # 5a7c <_sk_callback_hsw+0x150>
+ DB 196,98,125,24,5,65,85,0,0 ; vbroadcastss 0x5541(%rip),%ymm8 # 597c <_sk_callback_hsw+0x150>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,226,61,184,196 ; vfmadd231ps %ymm4,%ymm8,%ymm0
DB 197,244,89,207 ; vmulps %ymm7,%ymm1,%ymm1
@@ -314,7 +314,7 @@ _sk_srcatop_hsw LABEL PROC
PUBLIC _sk_dstatop_hsw
_sk_dstatop_hsw LABEL PROC
- DB 196,98,125,24,5,20,86,0,0 ; vbroadcastss 0x5614(%rip),%ymm8 # 5a80 <_sk_callback_hsw+0x154>
+ DB 196,98,125,24,5,20,85,0,0 ; vbroadcastss 0x5514(%rip),%ymm8 # 5980 <_sk_callback_hsw+0x154>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,226,101,184,196 ; vfmadd231ps %ymm4,%ymm3,%ymm0
@@ -347,7 +347,7 @@ _sk_dstin_hsw LABEL PROC
PUBLIC _sk_srcout_hsw
_sk_srcout_hsw LABEL PROC
- DB 196,98,125,24,5,187,85,0,0 ; vbroadcastss 0x55bb(%rip),%ymm8 # 5a84 <_sk_callback_hsw+0x158>
+ DB 196,98,125,24,5,187,84,0,0 ; vbroadcastss 0x54bb(%rip),%ymm8 # 5984 <_sk_callback_hsw+0x158>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -358,7 +358,7 @@ _sk_srcout_hsw LABEL PROC
PUBLIC _sk_dstout_hsw
_sk_dstout_hsw LABEL PROC
- DB 196,226,125,24,5,158,85,0,0 ; vbroadcastss 0x559e(%rip),%ymm0 # 5a88 <_sk_callback_hsw+0x15c>
+ DB 196,226,125,24,5,158,84,0,0 ; vbroadcastss 0x549e(%rip),%ymm0 # 5988 <_sk_callback_hsw+0x15c>
DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3
DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0
DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1
@@ -369,7 +369,7 @@ _sk_dstout_hsw LABEL PROC
PUBLIC _sk_srcover_hsw
_sk_srcover_hsw LABEL PROC
- DB 196,98,125,24,5,129,85,0,0 ; vbroadcastss 0x5581(%rip),%ymm8 # 5a8c <_sk_callback_hsw+0x160>
+ DB 196,98,125,24,5,129,84,0,0 ; vbroadcastss 0x5481(%rip),%ymm8 # 598c <_sk_callback_hsw+0x160>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0
DB 196,194,85,184,200 ; vfmadd231ps %ymm8,%ymm5,%ymm1
@@ -380,7 +380,7 @@ _sk_srcover_hsw LABEL PROC
PUBLIC _sk_dstover_hsw
_sk_dstover_hsw LABEL PROC
- DB 196,98,125,24,5,96,85,0,0 ; vbroadcastss 0x5560(%rip),%ymm8 # 5a90 <_sk_callback_hsw+0x164>
+ DB 196,98,125,24,5,96,84,0,0 ; vbroadcastss 0x5460(%rip),%ymm8 # 5990 <_sk_callback_hsw+0x164>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0
DB 196,226,61,168,205 ; vfmadd213ps %ymm5,%ymm8,%ymm1
@@ -400,7 +400,7 @@ _sk_modulate_hsw LABEL PROC
PUBLIC _sk_multiply_hsw
_sk_multiply_hsw LABEL PROC
- DB 196,98,125,24,5,43,85,0,0 ; vbroadcastss 0x552b(%rip),%ymm8 # 5a94 <_sk_callback_hsw+0x168>
+ DB 196,98,125,24,5,43,84,0,0 ; vbroadcastss 0x542b(%rip),%ymm8 # 5994 <_sk_callback_hsw+0x168>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -442,7 +442,7 @@ _sk_screen_hsw LABEL PROC
PUBLIC _sk_xor__hsw
_sk_xor__hsw LABEL PROC
- DB 196,98,125,24,5,166,84,0,0 ; vbroadcastss 0x54a6(%rip),%ymm8 # 5a98 <_sk_callback_hsw+0x16c>
+ DB 196,98,125,24,5,166,83,0,0 ; vbroadcastss 0x53a6(%rip),%ymm8 # 5998 <_sk_callback_hsw+0x16c>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -474,7 +474,7 @@ _sk_darken_hsw LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,46,84,0,0 ; vbroadcastss 0x542e(%rip),%ymm8 # 5a9c <_sk_callback_hsw+0x170>
+ DB 196,98,125,24,5,46,83,0,0 ; vbroadcastss 0x532e(%rip),%ymm8 # 599c <_sk_callback_hsw+0x170>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -497,7 +497,7 @@ _sk_lighten_hsw LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,221,83,0,0 ; vbroadcastss 0x53dd(%rip),%ymm8 # 5aa0 <_sk_callback_hsw+0x174>
+ DB 196,98,125,24,5,221,82,0,0 ; vbroadcastss 0x52dd(%rip),%ymm8 # 59a0 <_sk_callback_hsw+0x174>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -523,7 +523,7 @@ _sk_difference_hsw LABEL PROC
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,128,83,0,0 ; vbroadcastss 0x5380(%rip),%ymm8 # 5aa4 <_sk_callback_hsw+0x178>
+ DB 196,98,125,24,5,128,82,0,0 ; vbroadcastss 0x5280(%rip),%ymm8 # 59a4 <_sk_callback_hsw+0x178>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -543,7 +543,7 @@ _sk_exclusion_hsw LABEL PROC
DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,62,83,0,0 ; vbroadcastss 0x533e(%rip),%ymm8 # 5aa8 <_sk_callback_hsw+0x17c>
+ DB 196,98,125,24,5,62,82,0,0 ; vbroadcastss 0x523e(%rip),%ymm8 # 59a8 <_sk_callback_hsw+0x17c>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 196,194,69,184,216 ; vfmadd231ps %ymm8,%ymm7,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -551,7 +551,7 @@ _sk_exclusion_hsw LABEL PROC
PUBLIC _sk_colorburn_hsw
_sk_colorburn_hsw LABEL PROC
- DB 196,98,125,24,5,44,83,0,0 ; vbroadcastss 0x532c(%rip),%ymm8 # 5aac <_sk_callback_hsw+0x180>
+ DB 196,98,125,24,5,44,82,0,0 ; vbroadcastss 0x522c(%rip),%ymm8 # 59ac <_sk_callback_hsw+0x180>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11
DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10
@@ -607,7 +607,7 @@ _sk_colorburn_hsw LABEL PROC
PUBLIC _sk_colordodge_hsw
_sk_colordodge_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,13,55,82,0,0 ; vbroadcastss 0x5237(%rip),%ymm9 # 5ab0 <_sk_callback_hsw+0x184>
+ DB 196,98,125,24,13,55,81,0,0 ; vbroadcastss 0x5137(%rip),%ymm9 # 59b0 <_sk_callback_hsw+0x184>
DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9
@@ -658,7 +658,7 @@ _sk_colordodge_hsw LABEL PROC
PUBLIC _sk_hardlight_hsw
_sk_hardlight_hsw LABEL PROC
- DB 196,98,125,24,5,88,81,0,0 ; vbroadcastss 0x5158(%rip),%ymm8 # 5ab4 <_sk_callback_hsw+0x188>
+ DB 196,98,125,24,5,88,80,0,0 ; vbroadcastss 0x5058(%rip),%ymm8 # 59b4 <_sk_callback_hsw+0x188>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -707,7 +707,7 @@ _sk_hardlight_hsw LABEL PROC
PUBLIC _sk_overlay_hsw
_sk_overlay_hsw LABEL PROC
- DB 196,98,125,24,5,144,80,0,0 ; vbroadcastss 0x5090(%rip),%ymm8 # 5ab8 <_sk_callback_hsw+0x18c>
+ DB 196,98,125,24,5,144,79,0,0 ; vbroadcastss 0x4f90(%rip),%ymm8 # 59b8 <_sk_callback_hsw+0x18c>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -767,10 +767,10 @@ _sk_softlight_hsw LABEL PROC
DB 196,65,20,88,197 ; vaddps %ymm13,%ymm13,%ymm8
DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8
DB 196,66,61,168,192 ; vfmadd213ps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,29,151,79,0,0 ; vbroadcastss 0x4f97(%rip),%ymm11 # 5ac0 <_sk_callback_hsw+0x194>
+ DB 196,98,125,24,29,151,78,0,0 ; vbroadcastss 0x4e97(%rip),%ymm11 # 59c0 <_sk_callback_hsw+0x194>
DB 196,65,20,88,227 ; vaddps %ymm11,%ymm13,%ymm12
DB 196,65,28,89,192 ; vmulps %ymm8,%ymm12,%ymm8
- DB 196,98,125,24,37,136,79,0,0 ; vbroadcastss 0x4f88(%rip),%ymm12 # 5ac4 <_sk_callback_hsw+0x198>
+ DB 196,98,125,24,37,136,78,0,0 ; vbroadcastss 0x4e88(%rip),%ymm12 # 59c4 <_sk_callback_hsw+0x198>
DB 196,66,21,184,196 ; vfmadd231ps %ymm12,%ymm13,%ymm8
DB 196,65,124,82,245 ; vrsqrtps %ymm13,%ymm14
DB 196,65,124,83,246 ; vrcpps %ymm14,%ymm14
@@ -780,7 +780,7 @@ _sk_softlight_hsw LABEL PROC
DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15
DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14
DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15
- DB 196,98,125,24,5,75,79,0,0 ; vbroadcastss 0x4f4b(%rip),%ymm8 # 5abc <_sk_callback_hsw+0x190>
+ DB 196,98,125,24,5,75,78,0,0 ; vbroadcastss 0x4e4b(%rip),%ymm8 # 59bc <_sk_callback_hsw+0x190>
DB 196,65,60,92,237 ; vsubps %ymm13,%ymm8,%ymm13
DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0
DB 196,98,125,168,235 ; vfmadd213ps %ymm3,%ymm0,%ymm13
@@ -893,11 +893,11 @@ _sk_hue_hsw LABEL PROC
DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10
DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10
DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- DB 196,98,125,24,53,74,77,0,0 ; vbroadcastss 0x4d4a(%rip),%ymm14 # 5ac8 <_sk_callback_hsw+0x19c>
- DB 196,98,125,24,61,69,77,0,0 ; vbroadcastss 0x4d45(%rip),%ymm15 # 5acc <_sk_callback_hsw+0x1a0>
+ DB 196,98,125,24,53,74,76,0,0 ; vbroadcastss 0x4c4a(%rip),%ymm14 # 59c8 <_sk_callback_hsw+0x19c>
+ DB 196,98,125,24,61,69,76,0,0 ; vbroadcastss 0x4c45(%rip),%ymm15 # 59cc <_sk_callback_hsw+0x1a0>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13
- DB 196,226,125,24,5,54,77,0,0 ; vbroadcastss 0x4d36(%rip),%ymm0 # 5ad0 <_sk_callback_hsw+0x1a4>
+ DB 196,226,125,24,5,54,76,0,0 ; vbroadcastss 0x4c36(%rip),%ymm0 # 59d0 <_sk_callback_hsw+0x1a4>
DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13
DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10
DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -952,7 +952,7 @@ _sk_hue_hsw LABEL PROC
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9
DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8
- DB 196,226,125,24,13,35,76,0,0 ; vbroadcastss 0x4c23(%rip),%ymm1 # 5ad4 <_sk_callback_hsw+0x1a8>
+ DB 196,226,125,24,13,35,75,0,0 ; vbroadcastss 0x4b23(%rip),%ymm1 # 59d4 <_sk_callback_hsw+0x1a8>
DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11
@@ -1006,11 +1006,11 @@ _sk_saturation_hsw LABEL PROC
DB 196,65,28,89,210 ; vmulps %ymm10,%ymm12,%ymm10
DB 196,65,44,94,214 ; vdivps %ymm14,%ymm10,%ymm10
DB 196,67,45,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm10,%ymm12
- DB 196,98,125,24,53,52,75,0,0 ; vbroadcastss 0x4b34(%rip),%ymm14 # 5ad8 <_sk_callback_hsw+0x1ac>
- DB 196,98,125,24,61,47,75,0,0 ; vbroadcastss 0x4b2f(%rip),%ymm15 # 5adc <_sk_callback_hsw+0x1b0>
+ DB 196,98,125,24,53,52,74,0,0 ; vbroadcastss 0x4a34(%rip),%ymm14 # 59d8 <_sk_callback_hsw+0x1ac>
+ DB 196,98,125,24,61,47,74,0,0 ; vbroadcastss 0x4a2f(%rip),%ymm15 # 59dc <_sk_callback_hsw+0x1b0>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,66,93,184,238 ; vfmadd231ps %ymm14,%ymm4,%ymm13
- DB 196,226,125,24,5,32,75,0,0 ; vbroadcastss 0x4b20(%rip),%ymm0 # 5ae0 <_sk_callback_hsw+0x1b4>
+ DB 196,226,125,24,5,32,74,0,0 ; vbroadcastss 0x4a20(%rip),%ymm0 # 59e0 <_sk_callback_hsw+0x1b4>
DB 196,98,77,184,232 ; vfmadd231ps %ymm0,%ymm6,%ymm13
DB 196,65,116,89,215 ; vmulps %ymm15,%ymm1,%ymm10
DB 196,66,53,184,214 ; vfmadd231ps %ymm14,%ymm9,%ymm10
@@ -1065,7 +1065,7 @@ _sk_saturation_hsw LABEL PROC
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
DB 196,65,36,95,200 ; vmaxps %ymm8,%ymm11,%ymm9
DB 196,65,116,95,192 ; vmaxps %ymm8,%ymm1,%ymm8
- DB 196,226,125,24,13,13,74,0,0 ; vbroadcastss 0x4a0d(%rip),%ymm1 # 5ae4 <_sk_callback_hsw+0x1b8>
+ DB 196,226,125,24,13,13,73,0,0 ; vbroadcastss 0x490d(%rip),%ymm1 # 59e4 <_sk_callback_hsw+0x1b8>
DB 197,116,92,215 ; vsubps %ymm7,%ymm1,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,116,92,219 ; vsubps %ymm3,%ymm1,%ymm11
@@ -1093,11 +1093,11 @@ _sk_color_hsw LABEL PROC
DB 197,108,89,199 ; vmulps %ymm7,%ymm2,%ymm8
DB 197,116,89,215 ; vmulps %ymm7,%ymm1,%ymm10
DB 197,52,89,223 ; vmulps %ymm7,%ymm9,%ymm11
- DB 196,98,125,24,45,160,73,0,0 ; vbroadcastss 0x49a0(%rip),%ymm13 # 5ae8 <_sk_callback_hsw+0x1bc>
- DB 196,98,125,24,53,155,73,0,0 ; vbroadcastss 0x499b(%rip),%ymm14 # 5aec <_sk_callback_hsw+0x1c0>
+ DB 196,98,125,24,45,160,72,0,0 ; vbroadcastss 0x48a0(%rip),%ymm13 # 59e8 <_sk_callback_hsw+0x1bc>
+ DB 196,98,125,24,53,155,72,0,0 ; vbroadcastss 0x489b(%rip),%ymm14 # 59ec <_sk_callback_hsw+0x1c0>
DB 196,65,84,89,230 ; vmulps %ymm14,%ymm5,%ymm12
DB 196,66,93,184,229 ; vfmadd231ps %ymm13,%ymm4,%ymm12
- DB 196,98,125,24,61,140,73,0,0 ; vbroadcastss 0x498c(%rip),%ymm15 # 5af0 <_sk_callback_hsw+0x1c4>
+ DB 196,98,125,24,61,140,72,0,0 ; vbroadcastss 0x488c(%rip),%ymm15 # 59f0 <_sk_callback_hsw+0x1c4>
DB 196,66,77,184,231 ; vfmadd231ps %ymm15,%ymm6,%ymm12
DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9
DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -1153,7 +1153,7 @@ _sk_color_hsw LABEL PROC
DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1
DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8
DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9
- DB 196,226,125,24,5,110,72,0,0 ; vbroadcastss 0x486e(%rip),%ymm0 # 5af4 <_sk_callback_hsw+0x1c8>
+ DB 196,226,125,24,5,110,71,0,0 ; vbroadcastss 0x476e(%rip),%ymm0 # 59f4 <_sk_callback_hsw+0x1c8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -1181,11 +1181,11 @@ _sk_luminosity_hsw LABEL PROC
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
DB 197,100,89,213 ; vmulps %ymm5,%ymm3,%ymm10
DB 197,100,89,222 ; vmulps %ymm6,%ymm3,%ymm11
- DB 196,98,125,24,45,1,72,0,0 ; vbroadcastss 0x4801(%rip),%ymm13 # 5af8 <_sk_callback_hsw+0x1cc>
- DB 196,98,125,24,53,252,71,0,0 ; vbroadcastss 0x47fc(%rip),%ymm14 # 5afc <_sk_callback_hsw+0x1d0>
+ DB 196,98,125,24,45,1,71,0,0 ; vbroadcastss 0x4701(%rip),%ymm13 # 59f8 <_sk_callback_hsw+0x1cc>
+ DB 196,98,125,24,53,252,70,0,0 ; vbroadcastss 0x46fc(%rip),%ymm14 # 59fc <_sk_callback_hsw+0x1d0>
DB 196,65,116,89,230 ; vmulps %ymm14,%ymm1,%ymm12
DB 196,66,109,184,229 ; vfmadd231ps %ymm13,%ymm2,%ymm12
- DB 196,98,125,24,61,237,71,0,0 ; vbroadcastss 0x47ed(%rip),%ymm15 # 5b00 <_sk_callback_hsw+0x1d4>
+ DB 196,98,125,24,61,237,70,0,0 ; vbroadcastss 0x46ed(%rip),%ymm15 # 5a00 <_sk_callback_hsw+0x1d4>
DB 196,66,53,184,231 ; vfmadd231ps %ymm15,%ymm9,%ymm12
DB 196,65,44,89,206 ; vmulps %ymm14,%ymm10,%ymm9
DB 196,66,61,184,205 ; vfmadd231ps %ymm13,%ymm8,%ymm9
@@ -1241,7 +1241,7 @@ _sk_luminosity_hsw LABEL PROC
DB 196,193,116,95,206 ; vmaxps %ymm14,%ymm1,%ymm1
DB 196,65,44,95,198 ; vmaxps %ymm14,%ymm10,%ymm8
DB 196,65,124,95,206 ; vmaxps %ymm14,%ymm0,%ymm9
- DB 196,226,125,24,5,207,70,0,0 ; vbroadcastss 0x46cf(%rip),%ymm0 # 5b04 <_sk_callback_hsw+0x1d8>
+ DB 196,226,125,24,5,207,69,0,0 ; vbroadcastss 0x45cf(%rip),%ymm0 # 5a04 <_sk_callback_hsw+0x1d8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -1268,17 +1268,17 @@ _sk_srcover_rgba_8888_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 15,133,180,0,0,0 ; jne 1547 <_sk_srcover_rgba_8888_hsw+0xcd>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,196,84,37,128,74,0,0 ; vandps 0x4a80(%rip),%ymm7,%ymm4 # 5f20 <_sk_callback_hsw+0x5f4>
+ DB 197,196,84,37,128,73,0,0 ; vandps 0x4980(%rip),%ymm7,%ymm4 # 5e20 <_sk_callback_hsw+0x5f4>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,69,0,45,147,74,0,0 ; vpshufb 0x4a93(%rip),%ymm7,%ymm5 # 5f40 <_sk_callback_hsw+0x614>
+ DB 196,226,69,0,45,147,73,0,0 ; vpshufb 0x4993(%rip),%ymm7,%ymm5 # 5e40 <_sk_callback_hsw+0x614>
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,69,0,53,166,74,0,0 ; vpshufb 0x4aa6(%rip),%ymm7,%ymm6 # 5f60 <_sk_callback_hsw+0x634>
+ DB 196,226,69,0,53,166,73,0,0 ; vpshufb 0x49a6(%rip),%ymm7,%ymm6 # 5e60 <_sk_callback_hsw+0x634>
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
DB 197,197,114,215,24 ; vpsrld $0x18,%ymm7,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,56,70,0,0 ; vbroadcastss 0x4638(%rip),%ymm8 # 5b08 <_sk_callback_hsw+0x1dc>
+ DB 196,98,125,24,5,56,69,0,0 ; vbroadcastss 0x4538(%rip),%ymm8 # 5a08 <_sk_callback_hsw+0x1dc>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
- DB 196,98,125,24,13,47,70,0,0 ; vbroadcastss 0x462f(%rip),%ymm9 # 5b0c <_sk_callback_hsw+0x1e0>
+ DB 196,98,125,24,13,47,69,0,0 ; vbroadcastss 0x452f(%rip),%ymm9 # 5a0c <_sk_callback_hsw+0x1e0>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,194,93,184,192 ; vfmadd231ps %ymm8,%ymm4,%ymm0
DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
@@ -1334,7 +1334,7 @@ _sk_clamp_0_hsw LABEL PROC
PUBLIC _sk_clamp_1_hsw
_sk_clamp_1_hsw LABEL PROC
- DB 196,98,125,24,5,84,69,0,0 ; vbroadcastss 0x4554(%rip),%ymm8 # 5b10 <_sk_callback_hsw+0x1e4>
+ DB 196,98,125,24,5,84,68,0,0 ; vbroadcastss 0x4454(%rip),%ymm8 # 5a10 <_sk_callback_hsw+0x1e4>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
@@ -1344,7 +1344,7 @@ _sk_clamp_1_hsw LABEL PROC
PUBLIC _sk_clamp_a_hsw
_sk_clamp_a_hsw LABEL PROC
- DB 196,98,125,24,5,55,69,0,0 ; vbroadcastss 0x4537(%rip),%ymm8 # 5b14 <_sk_callback_hsw+0x1e8>
+ DB 196,98,125,24,5,55,68,0,0 ; vbroadcastss 0x4437(%rip),%ymm8 # 5a14 <_sk_callback_hsw+0x1e8>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0
DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1
@@ -1354,7 +1354,7 @@ _sk_clamp_a_hsw LABEL PROC
PUBLIC _sk_clamp_a_dst_hsw
_sk_clamp_a_dst_hsw LABEL PROC
- DB 196,98,125,24,5,29,69,0,0 ; vbroadcastss 0x451d(%rip),%ymm8 # 5b18 <_sk_callback_hsw+0x1ec>
+ DB 196,98,125,24,5,29,68,0,0 ; vbroadcastss 0x441d(%rip),%ymm8 # 5a18 <_sk_callback_hsw+0x1ec>
DB 196,193,68,93,248 ; vminps %ymm8,%ymm7,%ymm7
DB 197,220,93,231 ; vminps %ymm7,%ymm4,%ymm4
DB 197,212,93,239 ; vminps %ymm7,%ymm5,%ymm5
@@ -1409,7 +1409,7 @@ PUBLIC _sk_unpremul_hsw
_sk_unpremul_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9
- DB 196,98,125,24,21,153,68,0,0 ; vbroadcastss 0x4499(%rip),%ymm10 # 5b1c <_sk_callback_hsw+0x1f0>
+ DB 196,98,125,24,21,153,67,0,0 ; vbroadcastss 0x4399(%rip),%ymm10 # 5a1c <_sk_callback_hsw+0x1f0>
DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10
DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
@@ -1420,16 +1420,16 @@ _sk_unpremul_hsw LABEL PROC
PUBLIC _sk_from_srgb_hsw
_sk_from_srgb_hsw LABEL PROC
- DB 196,98,125,24,5,122,68,0,0 ; vbroadcastss 0x447a(%rip),%ymm8 # 5b20 <_sk_callback_hsw+0x1f4>
+ DB 196,98,125,24,5,122,67,0,0 ; vbroadcastss 0x437a(%rip),%ymm8 # 5a20 <_sk_callback_hsw+0x1f4>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10
- DB 196,98,125,24,29,108,68,0,0 ; vbroadcastss 0x446c(%rip),%ymm11 # 5b24 <_sk_callback_hsw+0x1f8>
- DB 196,98,125,24,37,103,68,0,0 ; vbroadcastss 0x4467(%rip),%ymm12 # 5b28 <_sk_callback_hsw+0x1fc>
+ DB 196,98,125,24,29,108,67,0,0 ; vbroadcastss 0x436c(%rip),%ymm11 # 5a24 <_sk_callback_hsw+0x1f8>
+ DB 196,98,125,24,37,103,67,0,0 ; vbroadcastss 0x4367(%rip),%ymm12 # 5a28 <_sk_callback_hsw+0x1fc>
DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13
DB 196,66,125,168,235 ; vfmadd213ps %ymm11,%ymm0,%ymm13
- DB 196,98,125,24,53,88,68,0,0 ; vbroadcastss 0x4458(%rip),%ymm14 # 5b2c <_sk_callback_hsw+0x200>
+ DB 196,98,125,24,53,88,67,0,0 ; vbroadcastss 0x4358(%rip),%ymm14 # 5a2c <_sk_callback_hsw+0x200>
DB 196,66,45,168,238 ; vfmadd213ps %ymm14,%ymm10,%ymm13
- DB 196,98,125,24,21,78,68,0,0 ; vbroadcastss 0x444e(%rip),%ymm10 # 5b30 <_sk_callback_hsw+0x204>
+ DB 196,98,125,24,21,78,67,0,0 ; vbroadcastss 0x434e(%rip),%ymm10 # 5a30 <_sk_callback_hsw+0x204>
DB 196,193,124,194,194,1 ; vcmpltps %ymm10,%ymm0,%ymm0
DB 196,195,21,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm13,%ymm0
DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9
@@ -1450,16 +1450,16 @@ _sk_from_srgb_hsw LABEL PROC
PUBLIC _sk_from_srgb_dst_hsw
_sk_from_srgb_dst_hsw LABEL PROC
- DB 196,98,125,24,5,246,67,0,0 ; vbroadcastss 0x43f6(%rip),%ymm8 # 5b34 <_sk_callback_hsw+0x208>
+ DB 196,98,125,24,5,246,66,0,0 ; vbroadcastss 0x42f6(%rip),%ymm8 # 5a34 <_sk_callback_hsw+0x208>
DB 196,65,92,89,200 ; vmulps %ymm8,%ymm4,%ymm9
DB 197,92,89,212 ; vmulps %ymm4,%ymm4,%ymm10
- DB 196,98,125,24,29,232,67,0,0 ; vbroadcastss 0x43e8(%rip),%ymm11 # 5b38 <_sk_callback_hsw+0x20c>
- DB 196,98,125,24,37,227,67,0,0 ; vbroadcastss 0x43e3(%rip),%ymm12 # 5b3c <_sk_callback_hsw+0x210>
+ DB 196,98,125,24,29,232,66,0,0 ; vbroadcastss 0x42e8(%rip),%ymm11 # 5a38 <_sk_callback_hsw+0x20c>
+ DB 196,98,125,24,37,227,66,0,0 ; vbroadcastss 0x42e3(%rip),%ymm12 # 5a3c <_sk_callback_hsw+0x210>
DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13
DB 196,66,93,168,235 ; vfmadd213ps %ymm11,%ymm4,%ymm13
- DB 196,98,125,24,53,212,67,0,0 ; vbroadcastss 0x43d4(%rip),%ymm14 # 5b40 <_sk_callback_hsw+0x214>
+ DB 196,98,125,24,53,212,66,0,0 ; vbroadcastss 0x42d4(%rip),%ymm14 # 5a40 <_sk_callback_hsw+0x214>
DB 196,66,45,168,238 ; vfmadd213ps %ymm14,%ymm10,%ymm13
- DB 196,98,125,24,21,202,67,0,0 ; vbroadcastss 0x43ca(%rip),%ymm10 # 5b44 <_sk_callback_hsw+0x218>
+ DB 196,98,125,24,21,202,66,0,0 ; vbroadcastss 0x42ca(%rip),%ymm10 # 5a44 <_sk_callback_hsw+0x218>
DB 196,193,92,194,226,1 ; vcmpltps %ymm10,%ymm4,%ymm4
DB 196,195,21,74,225,64 ; vblendvps %ymm4,%ymm9,%ymm13,%ymm4
DB 196,65,84,89,200 ; vmulps %ymm8,%ymm5,%ymm9
@@ -1481,19 +1481,19 @@ _sk_from_srgb_dst_hsw LABEL PROC
PUBLIC _sk_to_srgb_hsw
_sk_to_srgb_hsw LABEL PROC
DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9
- DB 196,98,125,24,5,110,67,0,0 ; vbroadcastss 0x436e(%rip),%ymm8 # 5b48 <_sk_callback_hsw+0x21c>
+ DB 196,98,125,24,5,110,66,0,0 ; vbroadcastss 0x426e(%rip),%ymm8 # 5a48 <_sk_callback_hsw+0x21c>
DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10
- DB 196,98,125,24,29,100,67,0,0 ; vbroadcastss 0x4364(%rip),%ymm11 # 5b4c <_sk_callback_hsw+0x220>
- DB 196,98,125,24,37,95,67,0,0 ; vbroadcastss 0x435f(%rip),%ymm12 # 5b50 <_sk_callback_hsw+0x224>
+ DB 196,98,125,24,29,100,66,0,0 ; vbroadcastss 0x4264(%rip),%ymm11 # 5a4c <_sk_callback_hsw+0x220>
+ DB 196,98,125,24,37,95,66,0,0 ; vbroadcastss 0x425f(%rip),%ymm12 # 5a50 <_sk_callback_hsw+0x224>
DB 196,65,124,40,236 ; vmovaps %ymm12,%ymm13
DB 196,66,53,168,235 ; vfmadd213ps %ymm11,%ymm9,%ymm13
- DB 196,98,125,24,53,80,67,0,0 ; vbroadcastss 0x4350(%rip),%ymm14 # 5b54 <_sk_callback_hsw+0x228>
+ DB 196,98,125,24,53,80,66,0,0 ; vbroadcastss 0x4250(%rip),%ymm14 # 5a54 <_sk_callback_hsw+0x228>
DB 196,66,53,168,238 ; vfmadd213ps %ymm14,%ymm9,%ymm13
- DB 196,98,125,24,61,70,67,0,0 ; vbroadcastss 0x4346(%rip),%ymm15 # 5b58 <_sk_callback_hsw+0x22c>
+ DB 196,98,125,24,61,70,66,0,0 ; vbroadcastss 0x4246(%rip),%ymm15 # 5a58 <_sk_callback_hsw+0x22c>
DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9
DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9
DB 196,65,20,89,201 ; vmulps %ymm9,%ymm13,%ymm9
- DB 196,98,125,24,45,50,67,0,0 ; vbroadcastss 0x4332(%rip),%ymm13 # 5b5c <_sk_callback_hsw+0x230>
+ DB 196,98,125,24,45,50,66,0,0 ; vbroadcastss 0x4232(%rip),%ymm13 # 5a5c <_sk_callback_hsw+0x230>
DB 196,193,124,194,197,1 ; vcmpltps %ymm13,%ymm0,%ymm0
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9
@@ -1525,26 +1525,26 @@ _sk_rgb_to_hsl_hsw LABEL PROC
DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9
DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9
DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,29,167,66,0,0 ; vbroadcastss 0x42a7(%rip),%ymm11 # 5b60 <_sk_callback_hsw+0x234>
+ DB 196,98,125,24,29,167,65,0,0 ; vbroadcastss 0x41a7(%rip),%ymm11 # 5a60 <_sk_callback_hsw+0x234>
DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11
DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12
DB 197,116,194,234,1 ; vcmpltps %ymm2,%ymm1,%ymm13
- DB 196,98,125,24,53,148,66,0,0 ; vbroadcastss 0x4294(%rip),%ymm14 # 5b64 <_sk_callback_hsw+0x238>
+ DB 196,98,125,24,53,148,65,0,0 ; vbroadcastss 0x4194(%rip),%ymm14 # 5a64 <_sk_callback_hsw+0x238>
DB 196,65,4,87,255 ; vxorps %ymm15,%ymm15,%ymm15
DB 196,67,5,74,238,208 ; vblendvps %ymm13,%ymm14,%ymm15,%ymm13
DB 196,66,37,168,229 ; vfmadd213ps %ymm13,%ymm11,%ymm12
DB 197,236,92,208 ; vsubps %ymm0,%ymm2,%ymm2
DB 197,124,92,233 ; vsubps %ymm1,%ymm0,%ymm13
- DB 196,98,125,24,53,123,66,0,0 ; vbroadcastss 0x427b(%rip),%ymm14 # 5b6c <_sk_callback_hsw+0x240>
+ DB 196,98,125,24,53,123,65,0,0 ; vbroadcastss 0x417b(%rip),%ymm14 # 5a6c <_sk_callback_hsw+0x240>
DB 196,66,37,168,238 ; vfmadd213ps %ymm14,%ymm11,%ymm13
- DB 196,98,125,24,53,105,66,0,0 ; vbroadcastss 0x4269(%rip),%ymm14 # 5b68 <_sk_callback_hsw+0x23c>
+ DB 196,98,125,24,53,105,65,0,0 ; vbroadcastss 0x4169(%rip),%ymm14 # 5a68 <_sk_callback_hsw+0x23c>
DB 196,194,37,168,214 ; vfmadd213ps %ymm14,%ymm11,%ymm2
DB 197,188,194,201,0 ; vcmpeqps %ymm1,%ymm8,%ymm1
DB 196,227,21,74,202,16 ; vblendvps %ymm1,%ymm2,%ymm13,%ymm1
DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0
DB 196,195,117,74,196,0 ; vblendvps %ymm0,%ymm12,%ymm1,%ymm0
DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1
- DB 196,98,125,24,29,76,66,0,0 ; vbroadcastss 0x424c(%rip),%ymm11 # 5b74 <_sk_callback_hsw+0x248>
+ DB 196,98,125,24,29,76,65,0,0 ; vbroadcastss 0x414c(%rip),%ymm11 # 5a74 <_sk_callback_hsw+0x248>
DB 196,193,116,89,211 ; vmulps %ymm11,%ymm1,%ymm2
DB 197,36,194,218,1 ; vcmpltps %ymm2,%ymm11,%ymm11
DB 196,65,12,92,224 ; vsubps %ymm8,%ymm14,%ymm12
@@ -1554,7 +1554,7 @@ _sk_rgb_to_hsl_hsw LABEL PROC
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 196,195,125,74,199,128 ; vblendvps %ymm8,%ymm15,%ymm0,%ymm0
DB 196,195,117,74,207,128 ; vblendvps %ymm8,%ymm15,%ymm1,%ymm1
- DB 196,98,125,24,5,15,66,0,0 ; vbroadcastss 0x420f(%rip),%ymm8 # 5b70 <_sk_callback_hsw+0x244>
+ DB 196,98,125,24,5,15,65,0,0 ; vbroadcastss 0x410f(%rip),%ymm8 # 5a70 <_sk_callback_hsw+0x244>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -1569,30 +1569,30 @@ _sk_hsl_to_rgb_hsw LABEL PROC
DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp)
DB 197,252,40,233 ; vmovaps %ymm1,%ymm5
DB 197,252,40,224 ; vmovaps %ymm0,%ymm4
- DB 196,98,125,24,5,214,65,0,0 ; vbroadcastss 0x41d6(%rip),%ymm8 # 5b78 <_sk_callback_hsw+0x24c>
+ DB 196,98,125,24,5,214,64,0,0 ; vbroadcastss 0x40d6(%rip),%ymm8 # 5a78 <_sk_callback_hsw+0x24c>
DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9
DB 197,84,89,210 ; vmulps %ymm2,%ymm5,%ymm10
DB 196,65,84,92,218 ; vsubps %ymm10,%ymm5,%ymm11
DB 196,67,45,74,203,144 ; vblendvps %ymm9,%ymm11,%ymm10,%ymm9
DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10
- DB 196,98,125,24,13,185,65,0,0 ; vbroadcastss 0x41b9(%rip),%ymm9 # 5b7c <_sk_callback_hsw+0x250>
+ DB 196,98,125,24,13,185,64,0,0 ; vbroadcastss 0x40b9(%rip),%ymm9 # 5a7c <_sk_callback_hsw+0x250>
DB 196,66,109,170,202 ; vfmsub213ps %ymm10,%ymm2,%ymm9
- DB 196,98,125,24,29,175,65,0,0 ; vbroadcastss 0x41af(%rip),%ymm11 # 5b80 <_sk_callback_hsw+0x254>
+ DB 196,98,125,24,29,175,64,0,0 ; vbroadcastss 0x40af(%rip),%ymm11 # 5a80 <_sk_callback_hsw+0x254>
DB 196,65,92,88,219 ; vaddps %ymm11,%ymm4,%ymm11
DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12
DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15
DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11
- DB 196,98,125,24,45,153,65,0,0 ; vbroadcastss 0x4199(%rip),%ymm13 # 5b88 <_sk_callback_hsw+0x25c>
+ DB 196,98,125,24,45,153,64,0,0 ; vbroadcastss 0x4099(%rip),%ymm13 # 5a88 <_sk_callback_hsw+0x25c>
DB 196,193,4,89,197 ; vmulps %ymm13,%ymm15,%ymm0
- DB 196,98,125,24,53,143,65,0,0 ; vbroadcastss 0x418f(%rip),%ymm14 # 5b8c <_sk_callback_hsw+0x260>
+ DB 196,98,125,24,53,143,64,0,0 ; vbroadcastss 0x408f(%rip),%ymm14 # 5a8c <_sk_callback_hsw+0x260>
DB 197,12,92,224 ; vsubps %ymm0,%ymm14,%ymm12
DB 196,66,37,168,225 ; vfmadd213ps %ymm9,%ymm11,%ymm12
- DB 196,226,125,24,29,117,65,0,0 ; vbroadcastss 0x4175(%rip),%ymm3 # 5b84 <_sk_callback_hsw+0x258>
+ DB 196,226,125,24,29,117,64,0,0 ; vbroadcastss 0x4075(%rip),%ymm3 # 5a84 <_sk_callback_hsw+0x258>
DB 196,193,100,194,255,2 ; vcmpleps %ymm15,%ymm3,%ymm7
DB 196,195,29,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm12,%ymm7
DB 196,65,60,194,231,2 ; vcmpleps %ymm15,%ymm8,%ymm12
DB 196,227,45,74,255,192 ; vblendvps %ymm12,%ymm7,%ymm10,%ymm7
- DB 196,98,125,24,37,96,65,0,0 ; vbroadcastss 0x4160(%rip),%ymm12 # 5b90 <_sk_callback_hsw+0x264>
+ DB 196,98,125,24,37,96,64,0,0 ; vbroadcastss 0x4060(%rip),%ymm12 # 5a90 <_sk_callback_hsw+0x264>
DB 196,65,28,194,255,2 ; vcmpleps %ymm15,%ymm12,%ymm15
DB 196,194,37,168,193 ; vfmadd213ps %ymm9,%ymm11,%ymm0
DB 196,99,125,74,255,240 ; vblendvps %ymm15,%ymm7,%ymm0,%ymm15
@@ -1608,7 +1608,7 @@ _sk_hsl_to_rgb_hsw LABEL PROC
DB 197,156,194,192,2 ; vcmpleps %ymm0,%ymm12,%ymm0
DB 196,194,37,168,249 ; vfmadd213ps %ymm9,%ymm11,%ymm7
DB 196,227,69,74,201,0 ; vblendvps %ymm0,%ymm1,%ymm7,%ymm1
- DB 196,226,125,24,5,12,65,0,0 ; vbroadcastss 0x410c(%rip),%ymm0 # 5b94 <_sk_callback_hsw+0x268>
+ DB 196,226,125,24,5,12,64,0,0 ; vbroadcastss 0x400c(%rip),%ymm0 # 5a94 <_sk_callback_hsw+0x268>
DB 197,220,88,192 ; vaddps %ymm0,%ymm4,%ymm0
DB 196,227,125,8,224,1 ; vroundps $0x1,%ymm0,%ymm4
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
@@ -1654,10 +1654,10 @@ _sk_scale_u8_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,58 ; jne 1b6f <_sk_scale_u8_hsw+0x44>
DB 196,66,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm8
- DB 197,57,219,5,61,71,0,0 ; vpand 0x473d(%rip),%xmm8,%xmm8 # 6280 <_sk_callback_hsw+0x954>
+ DB 197,57,219,5,221,69,0,0 ; vpand 0x45dd(%rip),%xmm8,%xmm8 # 6120 <_sk_callback_hsw+0x8f4>
DB 196,66,125,51,192 ; vpmovzxwd %xmm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,66,64,0,0 ; vbroadcastss 0x4042(%rip),%ymm9 # 5b98 <_sk_callback_hsw+0x26c>
+ DB 196,98,125,24,13,66,63,0,0 ; vbroadcastss 0x3f42(%rip),%ymm9 # 5a98 <_sk_callback_hsw+0x26c>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -1741,10 +1741,10 @@ _sk_lerp_u8_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,78 ; jne 1cab <_sk_lerp_u8_hsw+0x58>
DB 196,66,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm8
- DB 197,57,219,5,37,70,0,0 ; vpand 0x4625(%rip),%xmm8,%xmm8 # 6290 <_sk_callback_hsw+0x964>
+ DB 197,57,219,5,197,68,0,0 ; vpand 0x44c5(%rip),%xmm8,%xmm8 # 6130 <_sk_callback_hsw+0x904>
DB 196,66,125,51,192 ; vpmovzxwd %xmm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,30,63,0,0 ; vbroadcastss 0x3f1e(%rip),%ymm9 # 5b9c <_sk_callback_hsw+0x270>
+ DB 196,98,125,24,13,30,62,0,0 ; vbroadcastss 0x3e1e(%rip),%ymm9 # 5a9c <_sk_callback_hsw+0x270>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,226,61,168,196 ; vfmadd213ps %ymm4,%ymm8,%ymm0
@@ -1818,20 +1818,20 @@ _sk_lerp_565_hsw LABEL PROC
DB 15,133,169,0,0,0 ; jne 1e17 <_sk_lerp_565_hsw+0xb7>
DB 196,65,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm8
DB 196,66,125,51,192 ; vpmovzxwd %xmm8,%ymm8
- DB 196,98,125,88,13,30,62,0,0 ; vpbroadcastd 0x3e1e(%rip),%ymm9 # 5ba0 <_sk_callback_hsw+0x274>
+ DB 196,98,125,88,13,30,61,0,0 ; vpbroadcastd 0x3d1e(%rip),%ymm9 # 5aa0 <_sk_callback_hsw+0x274>
DB 196,65,61,219,201 ; vpand %ymm9,%ymm8,%ymm9
DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9
- DB 196,98,125,24,21,15,62,0,0 ; vbroadcastss 0x3e0f(%rip),%ymm10 # 5ba4 <_sk_callback_hsw+0x278>
+ DB 196,98,125,24,21,15,61,0,0 ; vbroadcastss 0x3d0f(%rip),%ymm10 # 5aa4 <_sk_callback_hsw+0x278>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
- DB 196,98,125,88,21,5,62,0,0 ; vpbroadcastd 0x3e05(%rip),%ymm10 # 5ba8 <_sk_callback_hsw+0x27c>
+ DB 196,98,125,88,21,5,61,0,0 ; vpbroadcastd 0x3d05(%rip),%ymm10 # 5aa8 <_sk_callback_hsw+0x27c>
DB 196,65,61,219,210 ; vpand %ymm10,%ymm8,%ymm10
DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10
- DB 196,98,125,24,29,246,61,0,0 ; vbroadcastss 0x3df6(%rip),%ymm11 # 5bac <_sk_callback_hsw+0x280>
+ DB 196,98,125,24,29,246,60,0,0 ; vbroadcastss 0x3cf6(%rip),%ymm11 # 5aac <_sk_callback_hsw+0x280>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
- DB 196,98,125,88,29,236,61,0,0 ; vpbroadcastd 0x3dec(%rip),%ymm11 # 5bb0 <_sk_callback_hsw+0x284>
+ DB 196,98,125,88,29,236,60,0,0 ; vpbroadcastd 0x3cec(%rip),%ymm11 # 5ab0 <_sk_callback_hsw+0x284>
DB 196,65,61,219,195 ; vpand %ymm11,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,29,221,61,0,0 ; vbroadcastss 0x3ddd(%rip),%ymm11 # 5bb4 <_sk_callback_hsw+0x288>
+ DB 196,98,125,24,29,221,60,0,0 ; vbroadcastss 0x3cdd(%rip),%ymm11 # 5ab4 <_sk_callback_hsw+0x288>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,226,53,168,196 ; vfmadd213ps %ymm4,%ymm9,%ymm0
@@ -1905,21 +1905,21 @@ _sk_load_tables_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,105 ; jne 1f3a <_sk_load_tables_hsw+0x7e>
DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
- DB 197,228,84,13,162,64,0,0 ; vandps 0x40a2(%rip),%ymm3,%ymm1 # 5f80 <_sk_callback_hsw+0x654>
+ DB 197,228,84,13,162,63,0,0 ; vandps 0x3fa2(%rip),%ymm3,%ymm1 # 5e80 <_sk_callback_hsw+0x654>
DB 196,65,61,118,192 ; vpcmpeqd %ymm8,%ymm8,%ymm8
DB 72,139,72,8 ; mov 0x8(%rax),%rcx
DB 76,139,80,16 ; mov 0x10(%rax),%r10
DB 197,237,118,210 ; vpcmpeqd %ymm2,%ymm2,%ymm2
DB 196,226,109,146,4,137 ; vgatherdps %ymm2,(%rcx,%ymm1,4),%ymm0
- DB 196,226,101,0,21,162,64,0,0 ; vpshufb 0x40a2(%rip),%ymm3,%ymm2 # 5fa0 <_sk_callback_hsw+0x674>
+ DB 196,226,101,0,21,162,63,0,0 ; vpshufb 0x3fa2(%rip),%ymm3,%ymm2 # 5ea0 <_sk_callback_hsw+0x674>
DB 196,65,53,118,201 ; vpcmpeqd %ymm9,%ymm9,%ymm9
DB 196,194,53,146,12,146 ; vgatherdps %ymm9,(%r10,%ymm2,4),%ymm1
DB 72,139,64,24 ; mov 0x18(%rax),%rax
- DB 196,98,101,0,13,170,64,0,0 ; vpshufb 0x40aa(%rip),%ymm3,%ymm9 # 5fc0 <_sk_callback_hsw+0x694>
+ DB 196,98,101,0,13,170,63,0,0 ; vpshufb 0x3faa(%rip),%ymm3,%ymm9 # 5ec0 <_sk_callback_hsw+0x694>
DB 196,162,61,146,20,136 ; vgatherdps %ymm8,(%rax,%ymm9,4),%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,138,60,0,0 ; vbroadcastss 0x3c8a(%rip),%ymm8 # 5bb8 <_sk_callback_hsw+0x28c>
+ DB 196,98,125,24,5,138,59,0,0 ; vbroadcastss 0x3b8a(%rip),%ymm8 # 5ab8 <_sk_callback_hsw+0x28c>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -1956,7 +1956,7 @@ _sk_load_tables_u16_be_hsw LABEL PROC
DB 197,185,108,200 ; vpunpcklqdq %xmm0,%xmm8,%xmm1
DB 197,185,109,208 ; vpunpckhqdq %xmm0,%xmm8,%xmm2
DB 197,49,108,195 ; vpunpcklqdq %xmm3,%xmm9,%xmm8
- DB 197,121,111,21,214,66,0,0 ; vmovdqa 0x42d6(%rip),%xmm10 # 62a0 <_sk_callback_hsw+0x974>
+ DB 197,121,111,21,118,65,0,0 ; vmovdqa 0x4176(%rip),%xmm10 # 6140 <_sk_callback_hsw+0x914>
DB 196,193,113,219,194 ; vpand %xmm10,%xmm1,%xmm0
DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1
DB 196,65,37,118,219 ; vpcmpeqd %ymm11,%ymm11,%ymm11
@@ -1978,7 +1978,7 @@ _sk_load_tables_u16_be_hsw LABEL PROC
DB 197,185,235,219 ; vpor %xmm3,%xmm8,%xmm3
DB 196,226,125,51,219 ; vpmovzxwd %xmm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,131,59,0,0 ; vbroadcastss 0x3b83(%rip),%ymm8 # 5bbc <_sk_callback_hsw+0x290>
+ DB 196,98,125,24,5,131,58,0,0 ; vbroadcastss 0x3a83(%rip),%ymm8 # 5abc <_sk_callback_hsw+0x290>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2036,7 +2036,7 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC
DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3
DB 197,185,109,210 ; vpunpckhqdq %xmm2,%xmm8,%xmm2
DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8
- DB 197,121,111,13,118,65,0,0 ; vmovdqa 0x4176(%rip),%xmm9 # 62b0 <_sk_callback_hsw+0x984>
+ DB 197,121,111,13,22,64,0,0 ; vmovdqa 0x4016(%rip),%xmm9 # 6150 <_sk_callback_hsw+0x924>
DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0
DB 196,226,125,51,200 ; vpmovzxwd %xmm0,%ymm1
DB 197,229,118,219 ; vpcmpeqd %ymm3,%ymm3,%ymm3
@@ -2053,7 +2053,7 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC
DB 196,98,125,51,194 ; vpmovzxwd %xmm2,%ymm8
DB 196,162,101,146,20,128 ; vgatherdps %ymm3,(%rax,%ymm8,4),%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,49,58,0,0 ; vbroadcastss 0x3a31(%rip),%ymm3 # 5bc0 <_sk_callback_hsw+0x294>
+ DB 196,226,125,24,29,49,57,0,0 ; vbroadcastss 0x3931(%rip),%ymm3 # 5ac0 <_sk_callback_hsw+0x294>
DB 255,224 ; jmpq *%rax
DB 196,129,121,110,4,81 ; vmovd (%r9,%r10,2),%xmm0
DB 196,129,121,196,68,81,4,2 ; vpinsrw $0x2,0x4(%r9,%r10,2),%xmm0,%xmm0
@@ -2092,7 +2092,7 @@ _sk_load_tables_rgb_u16_be_hsw LABEL PROC
PUBLIC _sk_byte_tables_hsw
_sk_byte_tables_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,121,57,0,0 ; vbroadcastss 0x3979(%rip),%ymm8 # 5bc4 <_sk_callback_hsw+0x298>
+ DB 196,98,125,24,5,121,56,0,0 ; vbroadcastss 0x3879(%rip),%ymm8 # 5ac4 <_sk_callback_hsw+0x298>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
DB 196,65,249,126,201 ; vmovq %xmm9,%r9
@@ -2214,7 +2214,7 @@ _sk_byte_tables_hsw LABEL PROC
DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,30,55,0,0 ; vbroadcastss 0x371e(%rip),%ymm8 # 5bc8 <_sk_callback_hsw+0x29c>
+ DB 196,98,125,24,5,30,54,0,0 ; vbroadcastss 0x361e(%rip),%ymm8 # 5ac8 <_sk_callback_hsw+0x29c>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
@@ -2328,7 +2328,7 @@ _sk_byte_tables_rgb_hsw LABEL PROC
DB 67,15,182,4,26 ; movzbl (%r10,%r11,1),%eax
DB 196,194,125,49,193 ; vpmovzxbd %xmm9,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,10,53,0,0 ; vbroadcastss 0x350a(%rip),%ymm8 # 5bcc <_sk_callback_hsw+0x2a0>
+ DB 196,98,125,24,5,10,52,0,0 ; vbroadcastss 0x340a(%rip),%ymm8 # 5acc <_sk_callback_hsw+0x2a0>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 196,226,125,49,201 ; vpmovzxbd %xmm1,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
@@ -2417,33 +2417,33 @@ _sk_parametric_r_hsw LABEL PROC
DB 196,66,125,168,211 ; vfmadd213ps %ymm11,%ymm0,%ymm10
DB 196,226,125,24,0 ; vbroadcastss (%rax),%ymm0
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,228,51,0,0 ; vbroadcastss 0x33e4(%rip),%ymm12 # 5bd0 <_sk_callback_hsw+0x2a4>
- DB 196,98,125,24,45,223,51,0,0 ; vbroadcastss 0x33df(%rip),%ymm13 # 5bd4 <_sk_callback_hsw+0x2a8>
+ DB 196,98,125,24,37,228,50,0,0 ; vbroadcastss 0x32e4(%rip),%ymm12 # 5ad0 <_sk_callback_hsw+0x2a4>
+ DB 196,98,125,24,45,223,50,0,0 ; vbroadcastss 0x32df(%rip),%ymm13 # 5ad4 <_sk_callback_hsw+0x2a8>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,213,51,0,0 ; vbroadcastss 0x33d5(%rip),%ymm13 # 5bd8 <_sk_callback_hsw+0x2ac>
+ DB 196,98,125,24,45,213,50,0,0 ; vbroadcastss 0x32d5(%rip),%ymm13 # 5ad8 <_sk_callback_hsw+0x2ac>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,203,51,0,0 ; vbroadcastss 0x33cb(%rip),%ymm13 # 5bdc <_sk_callback_hsw+0x2b0>
+ DB 196,98,125,24,45,203,50,0,0 ; vbroadcastss 0x32cb(%rip),%ymm13 # 5adc <_sk_callback_hsw+0x2b0>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,193,51,0,0 ; vbroadcastss 0x33c1(%rip),%ymm11 # 5be0 <_sk_callback_hsw+0x2b4>
+ DB 196,98,125,24,29,193,50,0,0 ; vbroadcastss 0x32c1(%rip),%ymm11 # 5ae0 <_sk_callback_hsw+0x2b4>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,183,51,0,0 ; vbroadcastss 0x33b7(%rip),%ymm12 # 5be4 <_sk_callback_hsw+0x2b8>
+ DB 196,98,125,24,37,183,50,0,0 ; vbroadcastss 0x32b7(%rip),%ymm12 # 5ae4 <_sk_callback_hsw+0x2b8>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,173,51,0,0 ; vbroadcastss 0x33ad(%rip),%ymm12 # 5be8 <_sk_callback_hsw+0x2bc>
+ DB 196,98,125,24,37,173,50,0,0 ; vbroadcastss 0x32ad(%rip),%ymm12 # 5ae8 <_sk_callback_hsw+0x2bc>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,142,51,0,0 ; vbroadcastss 0x338e(%rip),%ymm11 # 5bec <_sk_callback_hsw+0x2c0>
+ DB 196,98,125,24,29,142,50,0,0 ; vbroadcastss 0x328e(%rip),%ymm11 # 5aec <_sk_callback_hsw+0x2c0>
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,132,51,0,0 ; vbroadcastss 0x3384(%rip),%ymm11 # 5bf0 <_sk_callback_hsw+0x2c4>
+ DB 196,98,125,24,29,132,50,0,0 ; vbroadcastss 0x3284(%rip),%ymm11 # 5af0 <_sk_callback_hsw+0x2c4>
DB 196,98,45,172,216 ; vfnmadd213ps %ymm0,%ymm10,%ymm11
- DB 196,226,125,24,5,122,51,0,0 ; vbroadcastss 0x337a(%rip),%ymm0 # 5bf4 <_sk_callback_hsw+0x2c8>
+ DB 196,226,125,24,5,122,50,0,0 ; vbroadcastss 0x327a(%rip),%ymm0 # 5af4 <_sk_callback_hsw+0x2c8>
DB 196,193,124,92,194 ; vsubps %ymm10,%ymm0,%ymm0
- DB 196,98,125,24,21,112,51,0,0 ; vbroadcastss 0x3370(%rip),%ymm10 # 5bf8 <_sk_callback_hsw+0x2cc>
+ DB 196,98,125,24,21,112,50,0,0 ; vbroadcastss 0x3270(%rip),%ymm10 # 5af8 <_sk_callback_hsw+0x2cc>
DB 197,172,94,192 ; vdivps %ymm0,%ymm10,%ymm0
DB 197,164,88,192 ; vaddps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,21,99,51,0,0 ; vbroadcastss 0x3363(%rip),%ymm10 # 5bfc <_sk_callback_hsw+0x2d0>
+ DB 196,98,125,24,21,99,50,0,0 ; vbroadcastss 0x3263(%rip),%ymm10 # 5afc <_sk_callback_hsw+0x2d0>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2451,7 +2451,7 @@ _sk_parametric_r_hsw LABEL PROC
DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,58,51,0,0 ; vbroadcastss 0x333a(%rip),%ymm8 # 5c00 <_sk_callback_hsw+0x2d4>
+ DB 196,98,125,24,5,58,50,0,0 ; vbroadcastss 0x323a(%rip),%ymm8 # 5b00 <_sk_callback_hsw+0x2d4>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2469,33 +2469,33 @@ _sk_parametric_g_hsw LABEL PROC
DB 196,66,117,168,211 ; vfmadd213ps %ymm11,%ymm1,%ymm10
DB 196,226,125,24,8 ; vbroadcastss (%rax),%ymm1
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,242,50,0,0 ; vbroadcastss 0x32f2(%rip),%ymm12 # 5c04 <_sk_callback_hsw+0x2d8>
- DB 196,98,125,24,45,237,50,0,0 ; vbroadcastss 0x32ed(%rip),%ymm13 # 5c08 <_sk_callback_hsw+0x2dc>
+ DB 196,98,125,24,37,242,49,0,0 ; vbroadcastss 0x31f2(%rip),%ymm12 # 5b04 <_sk_callback_hsw+0x2d8>
+ DB 196,98,125,24,45,237,49,0,0 ; vbroadcastss 0x31ed(%rip),%ymm13 # 5b08 <_sk_callback_hsw+0x2dc>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,227,50,0,0 ; vbroadcastss 0x32e3(%rip),%ymm13 # 5c0c <_sk_callback_hsw+0x2e0>
+ DB 196,98,125,24,45,227,49,0,0 ; vbroadcastss 0x31e3(%rip),%ymm13 # 5b0c <_sk_callback_hsw+0x2e0>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,217,50,0,0 ; vbroadcastss 0x32d9(%rip),%ymm13 # 5c10 <_sk_callback_hsw+0x2e4>
+ DB 196,98,125,24,45,217,49,0,0 ; vbroadcastss 0x31d9(%rip),%ymm13 # 5b10 <_sk_callback_hsw+0x2e4>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,207,50,0,0 ; vbroadcastss 0x32cf(%rip),%ymm11 # 5c14 <_sk_callback_hsw+0x2e8>
+ DB 196,98,125,24,29,207,49,0,0 ; vbroadcastss 0x31cf(%rip),%ymm11 # 5b14 <_sk_callback_hsw+0x2e8>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,197,50,0,0 ; vbroadcastss 0x32c5(%rip),%ymm12 # 5c18 <_sk_callback_hsw+0x2ec>
+ DB 196,98,125,24,37,197,49,0,0 ; vbroadcastss 0x31c5(%rip),%ymm12 # 5b18 <_sk_callback_hsw+0x2ec>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,187,50,0,0 ; vbroadcastss 0x32bb(%rip),%ymm12 # 5c1c <_sk_callback_hsw+0x2f0>
+ DB 196,98,125,24,37,187,49,0,0 ; vbroadcastss 0x31bb(%rip),%ymm12 # 5b1c <_sk_callback_hsw+0x2f0>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10
DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10
- DB 196,98,125,24,29,156,50,0,0 ; vbroadcastss 0x329c(%rip),%ymm11 # 5c20 <_sk_callback_hsw+0x2f4>
+ DB 196,98,125,24,29,156,49,0,0 ; vbroadcastss 0x319c(%rip),%ymm11 # 5b20 <_sk_callback_hsw+0x2f4>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,146,50,0,0 ; vbroadcastss 0x3292(%rip),%ymm11 # 5c24 <_sk_callback_hsw+0x2f8>
+ DB 196,98,125,24,29,146,49,0,0 ; vbroadcastss 0x3192(%rip),%ymm11 # 5b24 <_sk_callback_hsw+0x2f8>
DB 196,98,45,172,217 ; vfnmadd213ps %ymm1,%ymm10,%ymm11
- DB 196,226,125,24,13,136,50,0,0 ; vbroadcastss 0x3288(%rip),%ymm1 # 5c28 <_sk_callback_hsw+0x2fc>
+ DB 196,226,125,24,13,136,49,0,0 ; vbroadcastss 0x3188(%rip),%ymm1 # 5b28 <_sk_callback_hsw+0x2fc>
DB 196,193,116,92,202 ; vsubps %ymm10,%ymm1,%ymm1
- DB 196,98,125,24,21,126,50,0,0 ; vbroadcastss 0x327e(%rip),%ymm10 # 5c2c <_sk_callback_hsw+0x300>
+ DB 196,98,125,24,21,126,49,0,0 ; vbroadcastss 0x317e(%rip),%ymm10 # 5b2c <_sk_callback_hsw+0x300>
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 197,164,88,201 ; vaddps %ymm1,%ymm11,%ymm1
- DB 196,98,125,24,21,113,50,0,0 ; vbroadcastss 0x3271(%rip),%ymm10 # 5c30 <_sk_callback_hsw+0x304>
+ DB 196,98,125,24,21,113,49,0,0 ; vbroadcastss 0x3171(%rip),%ymm10 # 5b30 <_sk_callback_hsw+0x304>
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2503,7 +2503,7 @@ _sk_parametric_g_hsw LABEL PROC
DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,5,72,50,0,0 ; vbroadcastss 0x3248(%rip),%ymm8 # 5c34 <_sk_callback_hsw+0x308>
+ DB 196,98,125,24,5,72,49,0,0 ; vbroadcastss 0x3148(%rip),%ymm8 # 5b34 <_sk_callback_hsw+0x308>
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2521,33 +2521,33 @@ _sk_parametric_b_hsw LABEL PROC
DB 196,66,109,168,211 ; vfmadd213ps %ymm11,%ymm2,%ymm10
DB 196,226,125,24,16 ; vbroadcastss (%rax),%ymm2
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,0,50,0,0 ; vbroadcastss 0x3200(%rip),%ymm12 # 5c38 <_sk_callback_hsw+0x30c>
- DB 196,98,125,24,45,251,49,0,0 ; vbroadcastss 0x31fb(%rip),%ymm13 # 5c3c <_sk_callback_hsw+0x310>
+ DB 196,98,125,24,37,0,49,0,0 ; vbroadcastss 0x3100(%rip),%ymm12 # 5b38 <_sk_callback_hsw+0x30c>
+ DB 196,98,125,24,45,251,48,0,0 ; vbroadcastss 0x30fb(%rip),%ymm13 # 5b3c <_sk_callback_hsw+0x310>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,241,49,0,0 ; vbroadcastss 0x31f1(%rip),%ymm13 # 5c40 <_sk_callback_hsw+0x314>
+ DB 196,98,125,24,45,241,48,0,0 ; vbroadcastss 0x30f1(%rip),%ymm13 # 5b40 <_sk_callback_hsw+0x314>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,231,49,0,0 ; vbroadcastss 0x31e7(%rip),%ymm13 # 5c44 <_sk_callback_hsw+0x318>
+ DB 196,98,125,24,45,231,48,0,0 ; vbroadcastss 0x30e7(%rip),%ymm13 # 5b44 <_sk_callback_hsw+0x318>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,221,49,0,0 ; vbroadcastss 0x31dd(%rip),%ymm11 # 5c48 <_sk_callback_hsw+0x31c>
+ DB 196,98,125,24,29,221,48,0,0 ; vbroadcastss 0x30dd(%rip),%ymm11 # 5b48 <_sk_callback_hsw+0x31c>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,211,49,0,0 ; vbroadcastss 0x31d3(%rip),%ymm12 # 5c4c <_sk_callback_hsw+0x320>
+ DB 196,98,125,24,37,211,48,0,0 ; vbroadcastss 0x30d3(%rip),%ymm12 # 5b4c <_sk_callback_hsw+0x320>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,201,49,0,0 ; vbroadcastss 0x31c9(%rip),%ymm12 # 5c50 <_sk_callback_hsw+0x324>
+ DB 196,98,125,24,37,201,48,0,0 ; vbroadcastss 0x30c9(%rip),%ymm12 # 5b50 <_sk_callback_hsw+0x324>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10
DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10
- DB 196,98,125,24,29,170,49,0,0 ; vbroadcastss 0x31aa(%rip),%ymm11 # 5c54 <_sk_callback_hsw+0x328>
+ DB 196,98,125,24,29,170,48,0,0 ; vbroadcastss 0x30aa(%rip),%ymm11 # 5b54 <_sk_callback_hsw+0x328>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,160,49,0,0 ; vbroadcastss 0x31a0(%rip),%ymm11 # 5c58 <_sk_callback_hsw+0x32c>
+ DB 196,98,125,24,29,160,48,0,0 ; vbroadcastss 0x30a0(%rip),%ymm11 # 5b58 <_sk_callback_hsw+0x32c>
DB 196,98,45,172,218 ; vfnmadd213ps %ymm2,%ymm10,%ymm11
- DB 196,226,125,24,21,150,49,0,0 ; vbroadcastss 0x3196(%rip),%ymm2 # 5c5c <_sk_callback_hsw+0x330>
+ DB 196,226,125,24,21,150,48,0,0 ; vbroadcastss 0x3096(%rip),%ymm2 # 5b5c <_sk_callback_hsw+0x330>
DB 196,193,108,92,210 ; vsubps %ymm10,%ymm2,%ymm2
- DB 196,98,125,24,21,140,49,0,0 ; vbroadcastss 0x318c(%rip),%ymm10 # 5c60 <_sk_callback_hsw+0x334>
+ DB 196,98,125,24,21,140,48,0,0 ; vbroadcastss 0x308c(%rip),%ymm10 # 5b60 <_sk_callback_hsw+0x334>
DB 197,172,94,210 ; vdivps %ymm2,%ymm10,%ymm2
DB 197,164,88,210 ; vaddps %ymm2,%ymm11,%ymm2
- DB 196,98,125,24,21,127,49,0,0 ; vbroadcastss 0x317f(%rip),%ymm10 # 5c64 <_sk_callback_hsw+0x338>
+ DB 196,98,125,24,21,127,48,0,0 ; vbroadcastss 0x307f(%rip),%ymm10 # 5b64 <_sk_callback_hsw+0x338>
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2555,7 +2555,7 @@ _sk_parametric_b_hsw LABEL PROC
DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,86,49,0,0 ; vbroadcastss 0x3156(%rip),%ymm8 # 5c68 <_sk_callback_hsw+0x33c>
+ DB 196,98,125,24,5,86,48,0,0 ; vbroadcastss 0x3056(%rip),%ymm8 # 5b68 <_sk_callback_hsw+0x33c>
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2573,33 +2573,33 @@ _sk_parametric_a_hsw LABEL PROC
DB 196,66,101,168,211 ; vfmadd213ps %ymm11,%ymm3,%ymm10
DB 196,226,125,24,24 ; vbroadcastss (%rax),%ymm3
DB 196,65,124,91,218 ; vcvtdq2ps %ymm10,%ymm11
- DB 196,98,125,24,37,14,49,0,0 ; vbroadcastss 0x310e(%rip),%ymm12 # 5c6c <_sk_callback_hsw+0x340>
- DB 196,98,125,24,45,9,49,0,0 ; vbroadcastss 0x3109(%rip),%ymm13 # 5c70 <_sk_callback_hsw+0x344>
+ DB 196,98,125,24,37,14,48,0,0 ; vbroadcastss 0x300e(%rip),%ymm12 # 5b6c <_sk_callback_hsw+0x340>
+ DB 196,98,125,24,45,9,48,0,0 ; vbroadcastss 0x3009(%rip),%ymm13 # 5b70 <_sk_callback_hsw+0x344>
DB 196,65,44,84,213 ; vandps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,255,48,0,0 ; vbroadcastss 0x30ff(%rip),%ymm13 # 5c74 <_sk_callback_hsw+0x348>
+ DB 196,98,125,24,45,255,47,0,0 ; vbroadcastss 0x2fff(%rip),%ymm13 # 5b74 <_sk_callback_hsw+0x348>
DB 196,65,44,86,213 ; vorps %ymm13,%ymm10,%ymm10
- DB 196,98,125,24,45,245,48,0,0 ; vbroadcastss 0x30f5(%rip),%ymm13 # 5c78 <_sk_callback_hsw+0x34c>
+ DB 196,98,125,24,45,245,47,0,0 ; vbroadcastss 0x2ff5(%rip),%ymm13 # 5b78 <_sk_callback_hsw+0x34c>
DB 196,66,37,184,236 ; vfmadd231ps %ymm12,%ymm11,%ymm13
- DB 196,98,125,24,29,235,48,0,0 ; vbroadcastss 0x30eb(%rip),%ymm11 # 5c7c <_sk_callback_hsw+0x350>
+ DB 196,98,125,24,29,235,47,0,0 ; vbroadcastss 0x2feb(%rip),%ymm11 # 5b7c <_sk_callback_hsw+0x350>
DB 196,66,45,172,221 ; vfnmadd213ps %ymm13,%ymm10,%ymm11
- DB 196,98,125,24,37,225,48,0,0 ; vbroadcastss 0x30e1(%rip),%ymm12 # 5c80 <_sk_callback_hsw+0x354>
+ DB 196,98,125,24,37,225,47,0,0 ; vbroadcastss 0x2fe1(%rip),%ymm12 # 5b80 <_sk_callback_hsw+0x354>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,215,48,0,0 ; vbroadcastss 0x30d7(%rip),%ymm12 # 5c84 <_sk_callback_hsw+0x358>
+ DB 196,98,125,24,37,215,47,0,0 ; vbroadcastss 0x2fd7(%rip),%ymm12 # 5b84 <_sk_callback_hsw+0x358>
DB 196,65,28,94,210 ; vdivps %ymm10,%ymm12,%ymm10
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10
DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10
- DB 196,98,125,24,29,184,48,0,0 ; vbroadcastss 0x30b8(%rip),%ymm11 # 5c88 <_sk_callback_hsw+0x35c>
+ DB 196,98,125,24,29,184,47,0,0 ; vbroadcastss 0x2fb8(%rip),%ymm11 # 5b88 <_sk_callback_hsw+0x35c>
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,174,48,0,0 ; vbroadcastss 0x30ae(%rip),%ymm11 # 5c8c <_sk_callback_hsw+0x360>
+ DB 196,98,125,24,29,174,47,0,0 ; vbroadcastss 0x2fae(%rip),%ymm11 # 5b8c <_sk_callback_hsw+0x360>
DB 196,98,45,172,219 ; vfnmadd213ps %ymm3,%ymm10,%ymm11
- DB 196,226,125,24,29,164,48,0,0 ; vbroadcastss 0x30a4(%rip),%ymm3 # 5c90 <_sk_callback_hsw+0x364>
+ DB 196,226,125,24,29,164,47,0,0 ; vbroadcastss 0x2fa4(%rip),%ymm3 # 5b90 <_sk_callback_hsw+0x364>
DB 196,193,100,92,218 ; vsubps %ymm10,%ymm3,%ymm3
- DB 196,98,125,24,21,154,48,0,0 ; vbroadcastss 0x309a(%rip),%ymm10 # 5c94 <_sk_callback_hsw+0x368>
+ DB 196,98,125,24,21,154,47,0,0 ; vbroadcastss 0x2f9a(%rip),%ymm10 # 5b94 <_sk_callback_hsw+0x368>
DB 197,172,94,219 ; vdivps %ymm3,%ymm10,%ymm3
DB 197,164,88,219 ; vaddps %ymm3,%ymm11,%ymm3
- DB 196,98,125,24,21,141,48,0,0 ; vbroadcastss 0x308d(%rip),%ymm10 # 5c98 <_sk_callback_hsw+0x36c>
+ DB 196,98,125,24,21,141,47,0,0 ; vbroadcastss 0x2f8d(%rip),%ymm10 # 5b98 <_sk_callback_hsw+0x36c>
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -2607,33 +2607,33 @@ _sk_parametric_a_hsw LABEL PROC
DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3
- DB 196,98,125,24,5,100,48,0,0 ; vbroadcastss 0x3064(%rip),%ymm8 # 5c9c <_sk_callback_hsw+0x370>
+ DB 196,98,125,24,5,100,47,0,0 ; vbroadcastss 0x2f64(%rip),%ymm8 # 5b9c <_sk_callback_hsw+0x370>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_lab_to_xyz_hsw
_sk_lab_to_xyz_hsw LABEL PROC
- DB 196,98,125,24,5,86,48,0,0 ; vbroadcastss 0x3056(%rip),%ymm8 # 5ca0 <_sk_callback_hsw+0x374>
- DB 196,98,125,24,13,81,48,0,0 ; vbroadcastss 0x3051(%rip),%ymm9 # 5ca4 <_sk_callback_hsw+0x378>
- DB 196,98,125,24,21,76,48,0,0 ; vbroadcastss 0x304c(%rip),%ymm10 # 5ca8 <_sk_callback_hsw+0x37c>
+ DB 196,98,125,24,5,86,47,0,0 ; vbroadcastss 0x2f56(%rip),%ymm8 # 5ba0 <_sk_callback_hsw+0x374>
+ DB 196,98,125,24,13,81,47,0,0 ; vbroadcastss 0x2f51(%rip),%ymm9 # 5ba4 <_sk_callback_hsw+0x378>
+ DB 196,98,125,24,21,76,47,0,0 ; vbroadcastss 0x2f4c(%rip),%ymm10 # 5ba8 <_sk_callback_hsw+0x37c>
DB 196,194,53,168,202 ; vfmadd213ps %ymm10,%ymm9,%ymm1
DB 196,194,53,168,210 ; vfmadd213ps %ymm10,%ymm9,%ymm2
- DB 196,98,125,24,13,61,48,0,0 ; vbroadcastss 0x303d(%rip),%ymm9 # 5cac <_sk_callback_hsw+0x380>
+ DB 196,98,125,24,13,61,47,0,0 ; vbroadcastss 0x2f3d(%rip),%ymm9 # 5bac <_sk_callback_hsw+0x380>
DB 196,66,125,184,200 ; vfmadd231ps %ymm8,%ymm0,%ymm9
- DB 196,226,125,24,5,51,48,0,0 ; vbroadcastss 0x3033(%rip),%ymm0 # 5cb0 <_sk_callback_hsw+0x384>
+ DB 196,226,125,24,5,51,47,0,0 ; vbroadcastss 0x2f33(%rip),%ymm0 # 5bb0 <_sk_callback_hsw+0x384>
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
- DB 196,98,125,24,5,42,48,0,0 ; vbroadcastss 0x302a(%rip),%ymm8 # 5cb4 <_sk_callback_hsw+0x388>
+ DB 196,98,125,24,5,42,47,0,0 ; vbroadcastss 0x2f2a(%rip),%ymm8 # 5bb4 <_sk_callback_hsw+0x388>
DB 196,98,117,168,192 ; vfmadd213ps %ymm0,%ymm1,%ymm8
- DB 196,98,125,24,13,32,48,0,0 ; vbroadcastss 0x3020(%rip),%ymm9 # 5cb8 <_sk_callback_hsw+0x38c>
+ DB 196,98,125,24,13,32,47,0,0 ; vbroadcastss 0x2f20(%rip),%ymm9 # 5bb8 <_sk_callback_hsw+0x38c>
DB 196,98,109,172,200 ; vfnmadd213ps %ymm0,%ymm2,%ymm9
DB 196,193,60,89,200 ; vmulps %ymm8,%ymm8,%ymm1
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
- DB 196,226,125,24,21,13,48,0,0 ; vbroadcastss 0x300d(%rip),%ymm2 # 5cbc <_sk_callback_hsw+0x390>
+ DB 196,226,125,24,21,13,47,0,0 ; vbroadcastss 0x2f0d(%rip),%ymm2 # 5bbc <_sk_callback_hsw+0x390>
DB 197,108,194,209,1 ; vcmpltps %ymm1,%ymm2,%ymm10
- DB 196,98,125,24,29,3,48,0,0 ; vbroadcastss 0x3003(%rip),%ymm11 # 5cc0 <_sk_callback_hsw+0x394>
+ DB 196,98,125,24,29,3,47,0,0 ; vbroadcastss 0x2f03(%rip),%ymm11 # 5bc0 <_sk_callback_hsw+0x394>
DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8
- DB 196,98,125,24,37,249,47,0,0 ; vbroadcastss 0x2ff9(%rip),%ymm12 # 5cc4 <_sk_callback_hsw+0x398>
+ DB 196,98,125,24,37,249,46,0,0 ; vbroadcastss 0x2ef9(%rip),%ymm12 # 5bc4 <_sk_callback_hsw+0x398>
DB 196,65,60,89,196 ; vmulps %ymm12,%ymm8,%ymm8
DB 196,99,61,74,193,160 ; vblendvps %ymm10,%ymm1,%ymm8,%ymm8
DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1
@@ -2648,9 +2648,9 @@ _sk_lab_to_xyz_hsw LABEL PROC
DB 196,65,52,88,203 ; vaddps %ymm11,%ymm9,%ymm9
DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9
DB 196,227,53,74,208,32 ; vblendvps %ymm2,%ymm0,%ymm9,%ymm2
- DB 196,226,125,24,5,174,47,0,0 ; vbroadcastss 0x2fae(%rip),%ymm0 # 5cc8 <_sk_callback_hsw+0x39c>
+ DB 196,226,125,24,5,174,46,0,0 ; vbroadcastss 0x2eae(%rip),%ymm0 # 5bc8 <_sk_callback_hsw+0x39c>
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,165,47,0,0 ; vbroadcastss 0x2fa5(%rip),%ymm8 # 5ccc <_sk_callback_hsw+0x3a0>
+ DB 196,98,125,24,5,165,46,0,0 ; vbroadcastss 0x2ea5(%rip),%ymm8 # 5bcc <_sk_callback_hsw+0x3a0>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -2662,10 +2662,10 @@ _sk_load_a8_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,52 ; jne 2d6e <_sk_load_a8_hsw+0x3e>
DB 196,194,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm0
- DB 197,249,219,5,120,53,0,0 ; vpand 0x3578(%rip),%xmm0,%xmm0 # 62c0 <_sk_callback_hsw+0x994>
+ DB 197,249,219,5,24,52,0,0 ; vpand 0x3418(%rip),%xmm0,%xmm0 # 6160 <_sk_callback_hsw+0x934>
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,118,47,0,0 ; vbroadcastss 0x2f76(%rip),%ymm1 # 5cd0 <_sk_callback_hsw+0x3a4>
+ DB 196,226,125,24,13,118,46,0,0 ; vbroadcastss 0x2e76(%rip),%ymm1 # 5bd0 <_sk_callback_hsw+0x3a4>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -2732,10 +2732,10 @@ _sk_load_a8_dst_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,52 ; jne 2e5e <_sk_load_a8_dst_hsw+0x3e>
DB 196,194,121,48,36,19 ; vpmovzxbw (%r11,%rdx,1),%xmm4
- DB 197,217,219,37,152,52,0,0 ; vpand 0x3498(%rip),%xmm4,%xmm4 # 62d0 <_sk_callback_hsw+0x9a4>
+ DB 197,217,219,37,56,51,0,0 ; vpand 0x3338(%rip),%xmm4,%xmm4 # 6170 <_sk_callback_hsw+0x944>
DB 196,226,125,51,228 ; vpmovzxwd %xmm4,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,138,46,0,0 ; vbroadcastss 0x2e8a(%rip),%ymm5 # 5cd4 <_sk_callback_hsw+0x3a8>
+ DB 196,226,125,24,45,138,45,0,0 ; vbroadcastss 0x2d8a(%rip),%ymm5 # 5bd4 <_sk_callback_hsw+0x3a8>
DB 197,220,89,253 ; vmulps %ymm5,%ymm4,%ymm7
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
@@ -2800,7 +2800,7 @@ _sk_gather_a8_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
@@ -2833,7 +2833,7 @@ _sk_gather_a8_hsw LABEL PROC
DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,18,45,0,0 ; vbroadcastss 0x2d12(%rip),%ymm1 # 5cd8 <_sk_callback_hsw+0x3ac>
+ DB 196,226,125,24,13,18,44,0,0 ; vbroadcastss 0x2c12(%rip),%ymm1 # 5bd8 <_sk_callback_hsw+0x3ac>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -2845,7 +2845,7 @@ PUBLIC _sk_store_a8_hsw
_sk_store_a8_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,244,44,0,0 ; vbroadcastss 0x2cf4(%rip),%ymm8 # 5cdc <_sk_callback_hsw+0x3b0>
+ DB 196,98,125,24,5,244,43,0,0 ; vbroadcastss 0x2bf4(%rip),%ymm8 # 5bdc <_sk_callback_hsw+0x3b0>
DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8
DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
@@ -2870,13 +2870,13 @@ _sk_store_a8_hsw LABEL PROC
DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1)
DB 235,202 ; jmp 300d <_sk_store_a8_hsw+0x33>
DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
- DB 196,98,57,0,5,140,50,0,0 ; vpshufb 0x328c(%rip),%xmm8,%xmm8 # 62e0 <_sk_callback_hsw+0x9b4>
+ DB 196,98,57,0,5,44,49,0,0 ; vpshufb 0x312c(%rip),%xmm8,%xmm8 # 6180 <_sk_callback_hsw+0x954>
DB 196,67,121,21,4,19,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,1)
DB 235,176 ; jmp 300d <_sk_store_a8_hsw+0x33>
DB 196,67,121,20,68,19,6,12 ; vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
DB 196,67,121,20,68,19,5,10 ; vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
DB 196,67,121,20,68,19,4,8 ; vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
- DB 196,98,57,0,5,114,50,0,0 ; vpshufb 0x3272(%rip),%xmm8,%xmm8 # 62f0 <_sk_callback_hsw+0x9c4>
+ DB 196,98,57,0,5,18,49,0,0 ; vpshufb 0x3112(%rip),%xmm8,%xmm8 # 6190 <_sk_callback_hsw+0x964>
DB 196,65,121,126,4,19 ; vmovd %xmm8,(%r11,%rdx,1)
DB 235,135 ; jmp 300d <_sk_store_a8_hsw+0x33>
DB 102,144 ; xchg %ax,%ax
@@ -2907,13 +2907,13 @@ _sk_load_g8_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,57 ; jne 30e7 <_sk_load_g8_hsw+0x43>
DB 196,194,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm0
- DB 197,249,219,5,68,50,0,0 ; vpand 0x3244(%rip),%xmm0,%xmm0 # 6300 <_sk_callback_hsw+0x9d4>
+ DB 197,249,219,5,228,48,0,0 ; vpand 0x30e4(%rip),%xmm0,%xmm0 # 61a0 <_sk_callback_hsw+0x974>
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,18,44,0,0 ; vbroadcastss 0x2c12(%rip),%ymm1 # 5ce0 <_sk_callback_hsw+0x3b4>
+ DB 196,226,125,24,13,18,43,0,0 ; vbroadcastss 0x2b12(%rip),%ymm1 # 5be0 <_sk_callback_hsw+0x3b4>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,7,44,0,0 ; vbroadcastss 0x2c07(%rip),%ymm3 # 5ce4 <_sk_callback_hsw+0x3b8>
+ DB 196,226,125,24,29,7,43,0,0 ; vbroadcastss 0x2b07(%rip),%ymm3 # 5be4 <_sk_callback_hsw+0x3b8>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
@@ -2978,13 +2978,13 @@ _sk_load_g8_dst_hsw LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,57 ; jne 31df <_sk_load_g8_dst_hsw+0x43>
DB 196,194,121,48,36,19 ; vpmovzxbw (%r11,%rdx,1),%xmm4
- DB 197,217,219,37,92,49,0,0 ; vpand 0x315c(%rip),%xmm4,%xmm4 # 6310 <_sk_callback_hsw+0x9e4>
+ DB 197,217,219,37,252,47,0,0 ; vpand 0x2ffc(%rip),%xmm4,%xmm4 # 61b0 <_sk_callback_hsw+0x984>
DB 196,226,125,51,228 ; vpmovzxwd %xmm4,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,34,43,0,0 ; vbroadcastss 0x2b22(%rip),%ymm5 # 5ce8 <_sk_callback_hsw+0x3bc>
+ DB 196,226,125,24,45,34,42,0,0 ; vbroadcastss 0x2a22(%rip),%ymm5 # 5be8 <_sk_callback_hsw+0x3bc>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,61,23,43,0,0 ; vbroadcastss 0x2b17(%rip),%ymm7 # 5cec <_sk_callback_hsw+0x3c0>
+ DB 196,226,125,24,61,23,42,0,0 ; vbroadcastss 0x2a17(%rip),%ymm7 # 5bec <_sk_callback_hsw+0x3c0>
DB 197,252,40,236 ; vmovaps %ymm4,%ymm5
DB 197,252,40,244 ; vmovaps %ymm4,%ymm6
DB 255,224 ; jmpq *%rax
@@ -3047,7 +3047,7 @@ _sk_gather_g8_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
@@ -3080,140 +3080,83 @@ _sk_gather_g8_hsw LABEL PROC
DB 196,227,121,32,192,7 ; vpinsrb $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,166,41,0,0 ; vbroadcastss 0x29a6(%rip),%ymm1 # 5cf0 <_sk_callback_hsw+0x3c4>
+ DB 196,226,125,24,13,166,40,0,0 ; vbroadcastss 0x28a6(%rip),%ymm1 # 5bf0 <_sk_callback_hsw+0x3c4>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,155,41,0,0 ; vbroadcastss 0x299b(%rip),%ymm3 # 5cf4 <_sk_callback_hsw+0x3c8>
+ DB 196,226,125,24,29,155,40,0,0 ; vbroadcastss 0x289b(%rip),%ymm3 # 5bf4 <_sk_callback_hsw+0x3c8>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
-PUBLIC _sk_gather_i8_hsw
-_sk_gather_i8_hsw LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,193 ; mov %rax,%r9
- DB 77,133,201 ; test %r9,%r9
- DB 116,5 ; je 3372 <_sk_gather_i8_hsw+0xf>
- DB 76,137,200 ; mov %r9,%rax
- DB 235,2 ; jmp 3374 <_sk_gather_i8_hsw+0x11>
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 83 ; push %rbx
- DB 76,139,16 ; mov (%rax),%r10
- DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
- DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
- DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
- DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
- DB 196,193,249,126,195 ; vmovq %xmm0,%r11
- DB 68,137,216 ; mov %r11d,%eax
- DB 196,195,121,32,12,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm1
- DB 196,227,249,22,192,1 ; vpextrq $0x1,%xmm0,%rax
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,131,113,32,12,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm1,%xmm1
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,32 ; shr $0x20,%rax
- DB 196,227,125,57,192,1 ; vextracti128 $0x1,%ymm0,%xmm0
- DB 196,131,113,32,12,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm1,%xmm1
- DB 196,193,249,126,195 ; vmovq %xmm0,%r11
- DB 196,195,113,32,12,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1
- DB 68,137,216 ; mov %r11d,%eax
- DB 196,195,113,32,12,2,4 ; vpinsrb $0x4,(%r10,%rax,1),%xmm1,%xmm1
- DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,131,113,32,4,26,5 ; vpinsrb $0x5,(%r10,%r11,1),%xmm1,%xmm0
- DB 137,216 ; mov %ebx,%eax
- DB 196,195,121,32,4,2,6 ; vpinsrb $0x6,(%r10,%rax,1),%xmm0,%xmm0
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,195,121,32,4,26,7 ; vpinsrb $0x7,(%r10,%rbx,1),%xmm0,%xmm0
- DB 196,226,125,49,192 ; vpmovzxbd %xmm0,%ymm0
- DB 73,139,65,8 ; mov 0x8(%r9),%rax
- DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
- DB 196,226,117,144,28,128 ; vpgatherdd %ymm1,(%rax,%ymm0,4),%ymm3
- DB 197,229,219,5,199,43,0,0 ; vpand 0x2bc7(%rip),%ymm3,%ymm0 # 5fe0 <_sk_callback_hsw+0x6b4>
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,210,40,0,0 ; vbroadcastss 0x28d2(%rip),%ymm8 # 5cf8 <_sk_callback_hsw+0x3cc>
- DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,204,43,0,0 ; vpshufb 0x2bcc(%rip),%ymm3,%ymm1 # 6000 <_sk_callback_hsw+0x6d4>
- DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,218,43,0,0 ; vpshufb 0x2bda(%rip),%ymm3,%ymm2 # 6020 <_sk_callback_hsw+0x6f4>
- DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
- DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 255,224 ; jmpq *%rax
-
PUBLIC _sk_load_565_hsw
_sk_load_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 117,114 ; jne 34de <_sk_load_565_hsw+0x7c>
+ DB 117,114 ; jne 33df <_sk_load_565_hsw+0x7c>
DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2
- DB 196,226,125,88,5,124,40,0,0 ; vpbroadcastd 0x287c(%rip),%ymm0 # 5cfc <_sk_callback_hsw+0x3d0>
+ DB 196,226,125,88,5,119,40,0,0 ; vpbroadcastd 0x2877(%rip),%ymm0 # 5bf8 <_sk_callback_hsw+0x3cc>
DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,111,40,0,0 ; vbroadcastss 0x286f(%rip),%ymm1 # 5d00 <_sk_callback_hsw+0x3d4>
+ DB 196,226,125,24,13,106,40,0,0 ; vbroadcastss 0x286a(%rip),%ymm1 # 5bfc <_sk_callback_hsw+0x3d0>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,102,40,0,0 ; vpbroadcastd 0x2866(%rip),%ymm1 # 5d04 <_sk_callback_hsw+0x3d8>
+ DB 196,226,125,88,13,97,40,0,0 ; vpbroadcastd 0x2861(%rip),%ymm1 # 5c00 <_sk_callback_hsw+0x3d4>
DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,89,40,0,0 ; vbroadcastss 0x2859(%rip),%ymm3 # 5d08 <_sk_callback_hsw+0x3dc>
+ DB 196,226,125,24,29,84,40,0,0 ; vbroadcastss 0x2854(%rip),%ymm3 # 5c04 <_sk_callback_hsw+0x3d8>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,88,29,80,40,0,0 ; vpbroadcastd 0x2850(%rip),%ymm3 # 5d0c <_sk_callback_hsw+0x3e0>
+ DB 196,226,125,88,29,75,40,0,0 ; vpbroadcastd 0x284b(%rip),%ymm3 # 5c08 <_sk_callback_hsw+0x3dc>
DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,67,40,0,0 ; vbroadcastss 0x2843(%rip),%ymm3 # 5d10 <_sk_callback_hsw+0x3e4>
+ DB 196,226,125,24,29,62,40,0,0 ; vbroadcastss 0x283e(%rip),%ymm3 # 5c0c <_sk_callback_hsw+0x3e0>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,56,40,0,0 ; vbroadcastss 0x2838(%rip),%ymm3 # 5d14 <_sk_callback_hsw+0x3e8>
+ DB 196,226,125,24,29,51,40,0,0 ; vbroadcastss 0x2833(%rip),%ymm3 # 5c10 <_sk_callback_hsw+0x3e4>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,128 ; ja 3472 <_sk_load_565_hsw+0x10>
+ DB 119,128 ; ja 3373 <_sk_load_565_hsw+0x10>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 3560 <_sk_load_565_hsw+0xfe>
+ DB 76,141,21,98,0,0,0 ; lea 0x62(%rip),%r10 # 3460 <_sk_load_565_hsw+0xfd>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,192 ; vmovd %eax,%xmm0
- DB 233,94,255,255,255 ; jmpq 3472 <_sk_load_565_hsw+0x10>
+ DB 233,94,255,255,255 ; jmpq 3373 <_sk_load_565_hsw+0x10>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,110,12,83 ; vmovd (%r11,%rdx,2),%xmm1
DB 196,227,121,2,193,1 ; vpblendd $0x1,%xmm1,%xmm0,%xmm0
- DB 233,65,255,255,255 ; jmpq 3472 <_sk_load_565_hsw+0x10>
+ DB 233,65,255,255,255 ; jmpq 3373 <_sk_load_565_hsw+0x10>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,122,126,12,83 ; vmovq (%r11,%rdx,2),%xmm1
DB 196,227,113,2,192,12 ; vpblendd $0xc,%xmm0,%xmm1,%xmm0
- DB 233,20,255,255,255 ; jmpq 3472 <_sk_load_565_hsw+0x10>
- DB 102,144 ; xchg %ax,%ax
- DB 166 ; cmpsb %es:(%rdi),%ds:(%rsi)
+ DB 233,20,255,255,255 ; jmpq 3373 <_sk_load_565_hsw+0x10>
+ DB 144 ; nop
+ DB 167 ; cmpsl %es:(%rdi),%ds:(%rsi)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,192 ; inc %eax
+ DB 255,193 ; inc %ecx
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,180,255,255,255,237,255 ; pushq -0x120001(%rdi,%rdi,8)
+ DB 255,181,255,255,255,238 ; pushq -0x11000001(%rbp)
DB 255 ; (bad)
- DB 255,229 ; jmpq *%rbp
DB 255 ; (bad)
+ DB 255,230 ; jmpq *%rsi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 221,255 ; (bad)
DB 255 ; (bad)
- DB 255,209 ; callq *%rcx
+ DB 222,255 ; fdivrp %st,%st(7)
+ DB 255 ; (bad)
+ DB 255,210 ; callq *%rdx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
@@ -3223,53 +3166,53 @@ _sk_load_565_dst_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 117,114 ; jne 35f8 <_sk_load_565_dst_hsw+0x7c>
+ DB 117,114 ; jne 34f8 <_sk_load_565_dst_hsw+0x7c>
DB 196,193,122,111,36,83 ; vmovdqu (%r11,%rdx,2),%xmm4
DB 196,226,125,51,244 ; vpmovzxwd %xmm4,%ymm6
- DB 196,226,125,88,37,126,39,0,0 ; vpbroadcastd 0x277e(%rip),%ymm4 # 5d18 <_sk_callback_hsw+0x3ec>
+ DB 196,226,125,88,37,122,39,0,0 ; vpbroadcastd 0x277a(%rip),%ymm4 # 5c14 <_sk_callback_hsw+0x3e8>
DB 197,205,219,228 ; vpand %ymm4,%ymm6,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,113,39,0,0 ; vbroadcastss 0x2771(%rip),%ymm5 # 5d1c <_sk_callback_hsw+0x3f0>
+ DB 196,226,125,24,45,109,39,0,0 ; vbroadcastss 0x276d(%rip),%ymm5 # 5c18 <_sk_callback_hsw+0x3ec>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
- DB 196,226,125,88,45,104,39,0,0 ; vpbroadcastd 0x2768(%rip),%ymm5 # 5d20 <_sk_callback_hsw+0x3f4>
+ DB 196,226,125,88,45,100,39,0,0 ; vpbroadcastd 0x2764(%rip),%ymm5 # 5c1c <_sk_callback_hsw+0x3f0>
DB 197,205,219,237 ; vpand %ymm5,%ymm6,%ymm5
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,125,24,61,91,39,0,0 ; vbroadcastss 0x275b(%rip),%ymm7 # 5d24 <_sk_callback_hsw+0x3f8>
+ DB 196,226,125,24,61,87,39,0,0 ; vbroadcastss 0x2757(%rip),%ymm7 # 5c20 <_sk_callback_hsw+0x3f4>
DB 197,212,89,239 ; vmulps %ymm7,%ymm5,%ymm5
- DB 196,226,125,88,61,82,39,0,0 ; vpbroadcastd 0x2752(%rip),%ymm7 # 5d28 <_sk_callback_hsw+0x3fc>
+ DB 196,226,125,88,61,78,39,0,0 ; vpbroadcastd 0x274e(%rip),%ymm7 # 5c24 <_sk_callback_hsw+0x3f8>
DB 197,205,219,247 ; vpand %ymm7,%ymm6,%ymm6
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
- DB 196,226,125,24,61,69,39,0,0 ; vbroadcastss 0x2745(%rip),%ymm7 # 5d2c <_sk_callback_hsw+0x400>
+ DB 196,226,125,24,61,65,39,0,0 ; vbroadcastss 0x2741(%rip),%ymm7 # 5c28 <_sk_callback_hsw+0x3fc>
DB 197,204,89,247 ; vmulps %ymm7,%ymm6,%ymm6
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,61,58,39,0,0 ; vbroadcastss 0x273a(%rip),%ymm7 # 5d30 <_sk_callback_hsw+0x404>
+ DB 196,226,125,24,61,54,39,0,0 ; vbroadcastss 0x2736(%rip),%ymm7 # 5c2c <_sk_callback_hsw+0x400>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,7 ; and $0x7,%r9b
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,128 ; ja 358c <_sk_load_565_dst_hsw+0x10>
+ DB 119,128 ; ja 348c <_sk_load_565_dst_hsw+0x10>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 3678 <_sk_load_565_dst_hsw+0xfc>
+ DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 3578 <_sk_load_565_dst_hsw+0xfc>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,224 ; vmovd %eax,%xmm4
- DB 233,94,255,255,255 ; jmpq 358c <_sk_load_565_dst_hsw+0x10>
+ DB 233,94,255,255,255 ; jmpq 348c <_sk_load_565_dst_hsw+0x10>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,121,110,44,83 ; vmovd (%r11,%rdx,2),%xmm5
DB 196,227,89,2,229,1 ; vpblendd $0x1,%xmm5,%xmm4,%xmm4
- DB 233,65,255,255,255 ; jmpq 358c <_sk_load_565_dst_hsw+0x10>
+ DB 233,65,255,255,255 ; jmpq 348c <_sk_load_565_dst_hsw+0x10>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,122,126,44,83 ; vmovq (%r11,%rdx,2),%xmm5
DB 196,227,81,2,228,12 ; vpblendd $0xc,%xmm4,%xmm5,%xmm4
- DB 233,20,255,255,255 ; jmpq 358c <_sk_load_565_dst_hsw+0x10>
+ DB 233,20,255,255,255 ; jmpq 348c <_sk_load_565_dst_hsw+0x10>
DB 168,255 ; test $0xff,%al
DB 255 ; (bad)
DB 255,194 ; inc %edx
@@ -3294,7 +3237,7 @@ _sk_gather_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
@@ -3328,34 +3271,34 @@ _sk_gather_565_hsw LABEL PROC
DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,51,208 ; vpmovzxwd %xmm0,%ymm2
- DB 196,226,125,88,5,239,37,0,0 ; vpbroadcastd 0x25ef(%rip),%ymm0 # 5d34 <_sk_callback_hsw+0x408>
+ DB 196,226,125,88,5,235,37,0,0 ; vpbroadcastd 0x25eb(%rip),%ymm0 # 5c30 <_sk_callback_hsw+0x404>
DB 197,237,219,192 ; vpand %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,226,37,0,0 ; vbroadcastss 0x25e2(%rip),%ymm1 # 5d38 <_sk_callback_hsw+0x40c>
+ DB 196,226,125,24,13,222,37,0,0 ; vbroadcastss 0x25de(%rip),%ymm1 # 5c34 <_sk_callback_hsw+0x408>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,217,37,0,0 ; vpbroadcastd 0x25d9(%rip),%ymm1 # 5d3c <_sk_callback_hsw+0x410>
+ DB 196,226,125,88,13,213,37,0,0 ; vpbroadcastd 0x25d5(%rip),%ymm1 # 5c38 <_sk_callback_hsw+0x40c>
DB 197,237,219,201 ; vpand %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,204,37,0,0 ; vbroadcastss 0x25cc(%rip),%ymm3 # 5d40 <_sk_callback_hsw+0x414>
+ DB 196,226,125,24,29,200,37,0,0 ; vbroadcastss 0x25c8(%rip),%ymm3 # 5c3c <_sk_callback_hsw+0x410>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,88,29,195,37,0,0 ; vpbroadcastd 0x25c3(%rip),%ymm3 # 5d44 <_sk_callback_hsw+0x418>
+ DB 196,226,125,88,29,191,37,0,0 ; vpbroadcastd 0x25bf(%rip),%ymm3 # 5c40 <_sk_callback_hsw+0x414>
DB 197,237,219,211 ; vpand %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,182,37,0,0 ; vbroadcastss 0x25b6(%rip),%ymm3 # 5d48 <_sk_callback_hsw+0x41c>
+ DB 196,226,125,24,29,178,37,0,0 ; vbroadcastss 0x25b2(%rip),%ymm3 # 5c44 <_sk_callback_hsw+0x418>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,171,37,0,0 ; vbroadcastss 0x25ab(%rip),%ymm3 # 5d4c <_sk_callback_hsw+0x420>
+ DB 196,226,125,24,29,167,37,0,0 ; vbroadcastss 0x25a7(%rip),%ymm3 # 5c48 <_sk_callback_hsw+0x41c>
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_565_hsw
_sk_store_565_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,159,37,0,0 ; vbroadcastss 0x259f(%rip),%ymm8 # 5d50 <_sk_callback_hsw+0x424>
+ DB 196,98,125,24,5,155,37,0,0 ; vbroadcastss 0x259b(%rip),%ymm8 # 5c4c <_sk_callback_hsw+0x420>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,53,114,241,11 ; vpslld $0xb,%ymm9,%ymm9
- DB 196,98,125,24,21,138,37,0,0 ; vbroadcastss 0x258a(%rip),%ymm10 # 5d54 <_sk_callback_hsw+0x428>
+ DB 196,98,125,24,21,134,37,0,0 ; vbroadcastss 0x2586(%rip),%ymm10 # 5c50 <_sk_callback_hsw+0x424>
DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10
DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10
DB 196,193,45,114,242,5 ; vpslld $0x5,%ymm10,%ymm10
@@ -3366,7 +3309,7 @@ _sk_store_565_hsw LABEL PROC
DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3808 <_sk_store_565_hsw+0x65>
+ DB 117,10 ; jne 3708 <_sk_store_565_hsw+0x65>
DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3374,22 +3317,22 @@ _sk_store_565_hsw LABEL PROC
DB 65,128,225,7 ; and $0x7,%r9b
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,236 ; ja 3804 <_sk_store_565_hsw+0x61>
+ DB 119,236 ; ja 3704 <_sk_store_565_hsw+0x61>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 3868 <_sk_store_565_hsw+0xc5>
+ DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 3768 <_sk_store_565_hsw+0xc5>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- DB 235,207 ; jmp 3804 <_sk_store_565_hsw+0x61>
+ DB 235,207 ; jmp 3704 <_sk_store_565_hsw+0x61>
DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
DB 196,65,121,126,4,83 ; vmovd %xmm8,(%r11,%rdx,2)
- DB 235,191 ; jmp 3804 <_sk_store_565_hsw+0x61>
+ DB 235,191 ; jmp 3704 <_sk_store_565_hsw+0x61>
DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
DB 196,65,121,214,4,83 ; vmovq %xmm8,(%r11,%rdx,2)
- DB 235,159 ; jmp 3804 <_sk_store_565_hsw+0x61>
+ DB 235,159 ; jmp 3704 <_sk_store_565_hsw+0x61>
DB 15,31,0 ; nopl (%rax)
DB 196 ; (bad)
DB 255 ; (bad)
@@ -3420,28 +3363,28 @@ _sk_load_4444_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,138,0,0,0 ; jne 391c <_sk_load_4444_hsw+0x98>
+ DB 15,133,138,0,0,0 ; jne 381c <_sk_load_4444_hsw+0x98>
DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3
- DB 196,226,125,88,5,178,36,0,0 ; vpbroadcastd 0x24b2(%rip),%ymm0 # 5d58 <_sk_callback_hsw+0x42c>
+ DB 196,226,125,88,5,174,36,0,0 ; vpbroadcastd 0x24ae(%rip),%ymm0 # 5c54 <_sk_callback_hsw+0x428>
DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,165,36,0,0 ; vbroadcastss 0x24a5(%rip),%ymm1 # 5d5c <_sk_callback_hsw+0x430>
+ DB 196,226,125,24,13,161,36,0,0 ; vbroadcastss 0x24a1(%rip),%ymm1 # 5c58 <_sk_callback_hsw+0x42c>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,156,36,0,0 ; vpbroadcastd 0x249c(%rip),%ymm1 # 5d60 <_sk_callback_hsw+0x434>
+ DB 196,226,125,88,13,152,36,0,0 ; vpbroadcastd 0x2498(%rip),%ymm1 # 5c5c <_sk_callback_hsw+0x430>
DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,143,36,0,0 ; vbroadcastss 0x248f(%rip),%ymm2 # 5d64 <_sk_callback_hsw+0x438>
+ DB 196,226,125,24,21,139,36,0,0 ; vbroadcastss 0x248b(%rip),%ymm2 # 5c60 <_sk_callback_hsw+0x434>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,88,21,134,36,0,0 ; vpbroadcastd 0x2486(%rip),%ymm2 # 5d68 <_sk_callback_hsw+0x43c>
+ DB 196,226,125,88,21,130,36,0,0 ; vpbroadcastd 0x2482(%rip),%ymm2 # 5c64 <_sk_callback_hsw+0x438>
DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,121,36,0,0 ; vbroadcastss 0x2479(%rip),%ymm8 # 5d6c <_sk_callback_hsw+0x440>
+ DB 196,98,125,24,5,117,36,0,0 ; vbroadcastss 0x2475(%rip),%ymm8 # 5c68 <_sk_callback_hsw+0x43c>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,88,5,111,36,0,0 ; vpbroadcastd 0x246f(%rip),%ymm8 # 5d70 <_sk_callback_hsw+0x444>
+ DB 196,98,125,88,5,107,36,0,0 ; vpbroadcastd 0x246b(%rip),%ymm8 # 5c6c <_sk_callback_hsw+0x440>
DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,97,36,0,0 ; vbroadcastss 0x2461(%rip),%ymm8 # 5d74 <_sk_callback_hsw+0x448>
+ DB 196,98,125,24,5,93,36,0,0 ; vbroadcastss 0x245d(%rip),%ymm8 # 5c70 <_sk_callback_hsw+0x444>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3450,27 +3393,27 @@ _sk_load_4444_hsw LABEL PROC
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,100,255,255,255 ; ja 3898 <_sk_load_4444_hsw+0x14>
+ DB 15,135,100,255,255,255 ; ja 3798 <_sk_load_4444_hsw+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 39a0 <_sk_load_4444_hsw+0x11c>
+ DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 38a0 <_sk_load_4444_hsw+0x11c>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,192 ; vmovd %eax,%xmm0
- DB 233,66,255,255,255 ; jmpq 3898 <_sk_load_4444_hsw+0x14>
+ DB 233,66,255,255,255 ; jmpq 3798 <_sk_load_4444_hsw+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,110,12,83 ; vmovd (%r11,%rdx,2),%xmm1
DB 196,227,121,2,193,1 ; vpblendd $0x1,%xmm1,%xmm0,%xmm0
- DB 233,37,255,255,255 ; jmpq 3898 <_sk_load_4444_hsw+0x14>
+ DB 233,37,255,255,255 ; jmpq 3798 <_sk_load_4444_hsw+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,122,126,12,83 ; vmovq (%r11,%rdx,2),%xmm1
DB 196,227,113,2,192,12 ; vpblendd $0xc,%xmm0,%xmm1,%xmm0
- DB 233,248,254,255,255 ; jmpq 3898 <_sk_load_4444_hsw+0x14>
+ DB 233,248,254,255,255 ; jmpq 3798 <_sk_load_4444_hsw+0x14>
DB 168,255 ; test $0xff,%al
DB 255 ; (bad)
DB 255,194 ; inc %edx
@@ -3495,28 +3438,28 @@ _sk_load_4444_dst_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,138,0,0,0 ; jne 3a54 <_sk_load_4444_dst_hsw+0x98>
+ DB 15,133,138,0,0,0 ; jne 3954 <_sk_load_4444_dst_hsw+0x98>
DB 196,193,122,111,36,83 ; vmovdqu (%r11,%rdx,2),%xmm4
DB 196,226,125,51,252 ; vpmovzxwd %xmm4,%ymm7
- DB 196,226,125,88,37,154,35,0,0 ; vpbroadcastd 0x239a(%rip),%ymm4 # 5d78 <_sk_callback_hsw+0x44c>
+ DB 196,226,125,88,37,150,35,0,0 ; vpbroadcastd 0x2396(%rip),%ymm4 # 5c74 <_sk_callback_hsw+0x448>
DB 197,197,219,228 ; vpand %ymm4,%ymm7,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,141,35,0,0 ; vbroadcastss 0x238d(%rip),%ymm5 # 5d7c <_sk_callback_hsw+0x450>
+ DB 196,226,125,24,45,137,35,0,0 ; vbroadcastss 0x2389(%rip),%ymm5 # 5c78 <_sk_callback_hsw+0x44c>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
- DB 196,226,125,88,45,132,35,0,0 ; vpbroadcastd 0x2384(%rip),%ymm5 # 5d80 <_sk_callback_hsw+0x454>
+ DB 196,226,125,88,45,128,35,0,0 ; vpbroadcastd 0x2380(%rip),%ymm5 # 5c7c <_sk_callback_hsw+0x450>
DB 197,197,219,237 ; vpand %ymm5,%ymm7,%ymm5
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,125,24,53,119,35,0,0 ; vbroadcastss 0x2377(%rip),%ymm6 # 5d84 <_sk_callback_hsw+0x458>
+ DB 196,226,125,24,53,115,35,0,0 ; vbroadcastss 0x2373(%rip),%ymm6 # 5c80 <_sk_callback_hsw+0x454>
DB 197,212,89,238 ; vmulps %ymm6,%ymm5,%ymm5
- DB 196,226,125,88,53,110,35,0,0 ; vpbroadcastd 0x236e(%rip),%ymm6 # 5d88 <_sk_callback_hsw+0x45c>
+ DB 196,226,125,88,53,106,35,0,0 ; vpbroadcastd 0x236a(%rip),%ymm6 # 5c84 <_sk_callback_hsw+0x458>
DB 197,197,219,246 ; vpand %ymm6,%ymm7,%ymm6
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
- DB 196,98,125,24,5,97,35,0,0 ; vbroadcastss 0x2361(%rip),%ymm8 # 5d8c <_sk_callback_hsw+0x460>
+ DB 196,98,125,24,5,93,35,0,0 ; vbroadcastss 0x235d(%rip),%ymm8 # 5c88 <_sk_callback_hsw+0x45c>
DB 196,193,76,89,240 ; vmulps %ymm8,%ymm6,%ymm6
- DB 196,98,125,88,5,87,35,0,0 ; vpbroadcastd 0x2357(%rip),%ymm8 # 5d90 <_sk_callback_hsw+0x464>
+ DB 196,98,125,88,5,83,35,0,0 ; vpbroadcastd 0x2353(%rip),%ymm8 # 5c8c <_sk_callback_hsw+0x460>
DB 196,193,69,219,248 ; vpand %ymm8,%ymm7,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,73,35,0,0 ; vbroadcastss 0x2349(%rip),%ymm8 # 5d94 <_sk_callback_hsw+0x468>
+ DB 196,98,125,24,5,69,35,0,0 ; vbroadcastss 0x2345(%rip),%ymm8 # 5c90 <_sk_callback_hsw+0x464>
DB 196,193,68,89,248 ; vmulps %ymm8,%ymm7,%ymm7
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3525,27 +3468,27 @@ _sk_load_4444_dst_hsw LABEL PROC
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,100,255,255,255 ; ja 39d0 <_sk_load_4444_dst_hsw+0x14>
+ DB 15,135,100,255,255,255 ; ja 38d0 <_sk_load_4444_dst_hsw+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 3ad8 <_sk_load_4444_dst_hsw+0x11c>
+ DB 76,141,21,97,0,0,0 ; lea 0x61(%rip),%r10 # 39d8 <_sk_load_4444_dst_hsw+0x11c>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,224 ; vmovd %eax,%xmm4
- DB 233,66,255,255,255 ; jmpq 39d0 <_sk_load_4444_dst_hsw+0x14>
+ DB 233,66,255,255,255 ; jmpq 38d0 <_sk_load_4444_dst_hsw+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,121,110,44,83 ; vmovd (%r11,%rdx,2),%xmm5
DB 196,227,89,2,229,1 ; vpblendd $0x1,%xmm5,%xmm4,%xmm4
- DB 233,37,255,255,255 ; jmpq 39d0 <_sk_load_4444_dst_hsw+0x14>
+ DB 233,37,255,255,255 ; jmpq 38d0 <_sk_load_4444_dst_hsw+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,122,126,44,83 ; vmovq (%r11,%rdx,2),%xmm5
DB 196,227,81,2,228,12 ; vpblendd $0xc,%xmm4,%xmm5,%xmm4
- DB 233,248,254,255,255 ; jmpq 39d0 <_sk_load_4444_dst_hsw+0x14>
+ DB 233,248,254,255,255 ; jmpq 38d0 <_sk_load_4444_dst_hsw+0x14>
DB 168,255 ; test $0xff,%al
DB 255 ; (bad)
DB 255,194 ; inc %edx
@@ -3570,7 +3513,7 @@ _sk_gather_4444_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
@@ -3604,25 +3547,25 @@ _sk_gather_4444_hsw LABEL PROC
DB 67,15,183,4,89 ; movzwl (%r9,%r11,2),%eax
DB 197,249,196,192,7 ; vpinsrw $0x7,%eax,%xmm0,%xmm0
DB 196,226,125,51,216 ; vpmovzxwd %xmm0,%ymm3
- DB 196,226,125,88,5,243,33,0,0 ; vpbroadcastd 0x21f3(%rip),%ymm0 # 5d98 <_sk_callback_hsw+0x46c>
+ DB 196,226,125,88,5,239,33,0,0 ; vpbroadcastd 0x21ef(%rip),%ymm0 # 5c94 <_sk_callback_hsw+0x468>
DB 197,229,219,192 ; vpand %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,230,33,0,0 ; vbroadcastss 0x21e6(%rip),%ymm1 # 5d9c <_sk_callback_hsw+0x470>
+ DB 196,226,125,24,13,226,33,0,0 ; vbroadcastss 0x21e2(%rip),%ymm1 # 5c98 <_sk_callback_hsw+0x46c>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,88,13,221,33,0,0 ; vpbroadcastd 0x21dd(%rip),%ymm1 # 5da0 <_sk_callback_hsw+0x474>
+ DB 196,226,125,88,13,217,33,0,0 ; vpbroadcastd 0x21d9(%rip),%ymm1 # 5c9c <_sk_callback_hsw+0x470>
DB 197,229,219,201 ; vpand %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,208,33,0,0 ; vbroadcastss 0x21d0(%rip),%ymm2 # 5da4 <_sk_callback_hsw+0x478>
+ DB 196,226,125,24,21,204,33,0,0 ; vbroadcastss 0x21cc(%rip),%ymm2 # 5ca0 <_sk_callback_hsw+0x474>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,88,21,199,33,0,0 ; vpbroadcastd 0x21c7(%rip),%ymm2 # 5da8 <_sk_callback_hsw+0x47c>
+ DB 196,226,125,88,21,195,33,0,0 ; vpbroadcastd 0x21c3(%rip),%ymm2 # 5ca4 <_sk_callback_hsw+0x478>
DB 197,229,219,210 ; vpand %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,186,33,0,0 ; vbroadcastss 0x21ba(%rip),%ymm8 # 5dac <_sk_callback_hsw+0x480>
+ DB 196,98,125,24,5,182,33,0,0 ; vbroadcastss 0x21b6(%rip),%ymm8 # 5ca8 <_sk_callback_hsw+0x47c>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,88,5,176,33,0,0 ; vpbroadcastd 0x21b0(%rip),%ymm8 # 5db0 <_sk_callback_hsw+0x484>
+ DB 196,98,125,88,5,172,33,0,0 ; vpbroadcastd 0x21ac(%rip),%ymm8 # 5cac <_sk_callback_hsw+0x480>
DB 196,193,101,219,216 ; vpand %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,162,33,0,0 ; vbroadcastss 0x21a2(%rip),%ymm8 # 5db4 <_sk_callback_hsw+0x488>
+ DB 196,98,125,24,5,158,33,0,0 ; vbroadcastss 0x219e(%rip),%ymm8 # 5cb0 <_sk_callback_hsw+0x484>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3631,7 +3574,7 @@ PUBLIC _sk_store_4444_hsw
_sk_store_4444_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,143,33,0,0 ; vbroadcastss 0x218f(%rip),%ymm8 # 5db8 <_sk_callback_hsw+0x48c>
+ DB 196,98,125,24,5,139,33,0,0 ; vbroadcastss 0x218b(%rip),%ymm8 # 5cb4 <_sk_callback_hsw+0x488>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,53,114,241,12 ; vpslld $0xc,%ymm9,%ymm9
@@ -3649,7 +3592,7 @@ _sk_store_4444_hsw LABEL PROC
DB 196,67,125,57,193,1 ; vextracti128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3c8c <_sk_store_4444_hsw+0x71>
+ DB 117,10 ; jne 3b8c <_sk_store_4444_hsw+0x71>
DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -3657,22 +3600,22 @@ _sk_store_4444_hsw LABEL PROC
DB 65,128,225,7 ; and $0x7,%r9b
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,236 ; ja 3c88 <_sk_store_4444_hsw+0x6d>
+ DB 119,236 ; ja 3b88 <_sk_store_4444_hsw+0x6d>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 3cec <_sk_store_4444_hsw+0xd1>
+ DB 76,141,21,69,0,0,0 ; lea 0x45(%rip),%r10 # 3bec <_sk_store_4444_hsw+0xd1>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- DB 235,207 ; jmp 3c88 <_sk_store_4444_hsw+0x6d>
+ DB 235,207 ; jmp 3b88 <_sk_store_4444_hsw+0x6d>
DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
DB 196,65,121,126,4,83 ; vmovd %xmm8,(%r11,%rdx,2)
- DB 235,191 ; jmp 3c88 <_sk_store_4444_hsw+0x6d>
+ DB 235,191 ; jmp 3b88 <_sk_store_4444_hsw+0x6d>
DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
DB 196,65,121,214,4,83 ; vmovq %xmm8,(%r11,%rdx,2)
- DB 235,159 ; jmp 3c88 <_sk_store_4444_hsw+0x6d>
+ DB 235,159 ; jmp 3b88 <_sk_store_4444_hsw+0x6d>
DB 15,31,0 ; nopl (%rax)
DB 196 ; (bad)
DB 255 ; (bad)
@@ -3705,16 +3648,16 @@ _sk_load_8888_hsw LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3d75 <_sk_load_8888_hsw+0x6d>
+ DB 117,88 ; jne 3c75 <_sk_load_8888_hsw+0x6d>
DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
- DB 197,228,84,5,22,35,0,0 ; vandps 0x2316(%rip),%ymm3,%ymm0 # 6040 <_sk_callback_hsw+0x714>
+ DB 197,228,84,5,182,34,0,0 ; vandps 0x22b6(%rip),%ymm3,%ymm0 # 5ee0 <_sk_callback_hsw+0x6b4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,133,32,0,0 ; vbroadcastss 0x2085(%rip),%ymm8 # 5dbc <_sk_callback_hsw+0x490>
+ DB 196,98,125,24,5,129,32,0,0 ; vbroadcastss 0x2081(%rip),%ymm8 # 5cb8 <_sk_callback_hsw+0x48c>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,27,35,0,0 ; vpshufb 0x231b(%rip),%ymm3,%ymm1 # 6060 <_sk_callback_hsw+0x734>
+ DB 196,226,101,0,13,187,34,0,0 ; vpshufb 0x22bb(%rip),%ymm3,%ymm1 # 5f00 <_sk_callback_hsw+0x6d4>
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,41,35,0,0 ; vpshufb 0x2329(%rip),%ymm3,%ymm2 # 6080 <_sk_callback_hsw+0x754>
+ DB 196,226,101,0,21,201,34,0,0 ; vpshufb 0x22c9(%rip),%ymm3,%ymm2 # 5f20 <_sk_callback_hsw+0x6f4>
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -3731,7 +3674,7 @@ _sk_load_8888_hsw LABEL PROC
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0
DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
- DB 235,135 ; jmp 3d22 <_sk_load_8888_hsw+0x1a>
+ DB 235,135 ; jmp 3c22 <_sk_load_8888_hsw+0x1a>
PUBLIC _sk_load_8888_dst_hsw
_sk_load_8888_dst_hsw LABEL PROC
@@ -3740,16 +3683,16 @@ _sk_load_8888_dst_hsw LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3e08 <_sk_load_8888_dst_hsw+0x6d>
+ DB 117,88 ; jne 3d08 <_sk_load_8888_dst_hsw+0x6d>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,196,84,37,227,34,0,0 ; vandps 0x22e3(%rip),%ymm7,%ymm4 # 60a0 <_sk_callback_hsw+0x774>
+ DB 197,196,84,37,131,34,0,0 ; vandps 0x2283(%rip),%ymm7,%ymm4 # 5f40 <_sk_callback_hsw+0x714>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,98,125,24,5,246,31,0,0 ; vbroadcastss 0x1ff6(%rip),%ymm8 # 5dc0 <_sk_callback_hsw+0x494>
+ DB 196,98,125,24,5,242,31,0,0 ; vbroadcastss 0x1ff2(%rip),%ymm8 # 5cbc <_sk_callback_hsw+0x490>
DB 196,193,92,89,224 ; vmulps %ymm8,%ymm4,%ymm4
- DB 196,226,69,0,45,232,34,0,0 ; vpshufb 0x22e8(%rip),%ymm7,%ymm5 # 60c0 <_sk_callback_hsw+0x794>
+ DB 196,226,69,0,45,136,34,0,0 ; vpshufb 0x2288(%rip),%ymm7,%ymm5 # 5f60 <_sk_callback_hsw+0x734>
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
DB 196,193,84,89,232 ; vmulps %ymm8,%ymm5,%ymm5
- DB 196,226,69,0,53,246,34,0,0 ; vpshufb 0x22f6(%rip),%ymm7,%ymm6 # 60e0 <_sk_callback_hsw+0x7b4>
+ DB 196,226,69,0,53,150,34,0,0 ; vpshufb 0x2296(%rip),%ymm7,%ymm6 # 5f80 <_sk_callback_hsw+0x754>
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
DB 196,193,76,89,240 ; vmulps %ymm8,%ymm6,%ymm6
DB 197,197,114,215,24 ; vpsrld $0x18,%ymm7,%ymm7
@@ -3766,27 +3709,27 @@ _sk_load_8888_dst_hsw LABEL PROC
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,125,33,228 ; vpmovsxbd %xmm4,%ymm4
DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
- DB 235,135 ; jmp 3db5 <_sk_load_8888_dst_hsw+0x1a>
+ DB 235,135 ; jmp 3cb5 <_sk_load_8888_dst_hsw+0x1a>
PUBLIC _sk_gather_8888_hsw
_sk_gather_8888_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 196,194,117,144,28,129 ; vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
- DB 197,229,219,5,164,34,0,0 ; vpand 0x22a4(%rip),%ymm3,%ymm0 # 6100 <_sk_callback_hsw+0x7d4>
+ DB 197,229,219,5,68,34,0,0 ; vpand 0x2244(%rip),%ymm3,%ymm0 # 5fa0 <_sk_callback_hsw+0x774>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,91,31,0,0 ; vbroadcastss 0x1f5b(%rip),%ymm8 # 5dc4 <_sk_callback_hsw+0x498>
+ DB 196,98,125,24,5,87,31,0,0 ; vbroadcastss 0x1f57(%rip),%ymm8 # 5cc0 <_sk_callback_hsw+0x494>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,226,101,0,13,169,34,0,0 ; vpshufb 0x22a9(%rip),%ymm3,%ymm1 # 6120 <_sk_callback_hsw+0x7f4>
+ DB 196,226,101,0,13,73,34,0,0 ; vpshufb 0x2249(%rip),%ymm3,%ymm1 # 5fc0 <_sk_callback_hsw+0x794>
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,226,101,0,21,183,34,0,0 ; vpshufb 0x22b7(%rip),%ymm3,%ymm2 # 6140 <_sk_callback_hsw+0x814>
+ DB 196,226,101,0,21,87,34,0,0 ; vpshufb 0x2257(%rip),%ymm3,%ymm2 # 5fe0 <_sk_callback_hsw+0x7b4>
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -3801,7 +3744,7 @@ _sk_store_8888_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
- DB 196,98,125,24,5,11,31,0,0 ; vbroadcastss 0x1f0b(%rip),%ymm8 # 5dc8 <_sk_callback_hsw+0x49c>
+ DB 196,98,125,24,5,7,31,0,0 ; vbroadcastss 0x1f07(%rip),%ymm8 # 5cc4 <_sk_callback_hsw+0x498>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -3817,7 +3760,7 @@ _sk_store_8888_hsw LABEL PROC
DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,12 ; jne 3f17 <_sk_store_8888_hsw+0x73>
+ DB 117,12 ; jne 3e17 <_sk_store_8888_hsw+0x73>
DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -3830,18 +3773,18 @@ _sk_store_8888_hsw LABEL PROC
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9
DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
- DB 235,211 ; jmp 3f10 <_sk_store_8888_hsw+0x6c>
+ DB 235,211 ; jmp 3e10 <_sk_store_8888_hsw+0x6c>
PUBLIC _sk_store_8888_2d_hsw
_sk_store_8888_2d_hsw LABEL PROC
DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 72,139,72,8 ; mov 0x8(%rax),%rcx
+ DB 72,99,72,8 ; movslq 0x8(%rax),%rcx
DB 73,15,175,201 ; imul %r9,%rcx
DB 72,193,225,2 ; shl $0x2,%rcx
DB 72,3,8 ; add (%rax),%rcx
DB 72,141,4,145 ; lea (%rcx,%rdx,4),%rax
- DB 196,98,125,24,5,110,30,0,0 ; vbroadcastss 0x1e6e(%rip),%ymm8 # 5dcc <_sk_callback_hsw+0x4a0>
+ DB 196,98,125,24,5,106,30,0,0 ; vbroadcastss 0x1e6a(%rip),%ymm8 # 5cc8 <_sk_callback_hsw+0x49c>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -3857,7 +3800,7 @@ _sk_store_8888_2d_hsw LABEL PROC
DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,11 ; jne 3fb7 <_sk_store_8888_2d_hsw+0x7a>
+ DB 117,11 ; jne 3eb7 <_sk_store_8888_2d_hsw+0x7a>
DB 197,124,17,0 ; vmovups %ymm8,(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -3870,7 +3813,7 @@ _sk_store_8888_2d_hsw LABEL PROC
DB 196,65,249,110,202 ; vmovq %r10,%xmm9
DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9
DB 196,98,53,46,0 ; vmaskmovps %ymm8,%ymm9,(%rax)
- DB 235,211 ; jmp 3fb0 <_sk_store_8888_2d_hsw+0x73>
+ DB 235,211 ; jmp 3eb0 <_sk_store_8888_2d_hsw+0x73>
PUBLIC _sk_load_bgra_hsw
_sk_load_bgra_hsw LABEL PROC
@@ -3879,16 +3822,16 @@ _sk_load_bgra_hsw LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 404a <_sk_load_bgra_hsw+0x6d>
+ DB 117,88 ; jne 3f4a <_sk_load_bgra_hsw+0x6d>
DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
- DB 197,228,84,5,97,33,0,0 ; vandps 0x2161(%rip),%ymm3,%ymm0 # 6160 <_sk_callback_hsw+0x834>
+ DB 197,228,84,5,1,33,0,0 ; vandps 0x2101(%rip),%ymm3,%ymm0 # 6000 <_sk_callback_hsw+0x7d4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,196,29,0,0 ; vbroadcastss 0x1dc4(%rip),%ymm8 # 5dd0 <_sk_callback_hsw+0x4a4>
+ DB 196,98,125,24,5,192,29,0,0 ; vbroadcastss 0x1dc0(%rip),%ymm8 # 5ccc <_sk_callback_hsw+0x4a0>
DB 196,193,124,89,208 ; vmulps %ymm8,%ymm0,%ymm2
- DB 196,226,101,0,5,102,33,0,0 ; vpshufb 0x2166(%rip),%ymm3,%ymm0 # 6180 <_sk_callback_hsw+0x854>
+ DB 196,226,101,0,5,6,33,0,0 ; vpshufb 0x2106(%rip),%ymm3,%ymm0 # 6020 <_sk_callback_hsw+0x7f4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
DB 196,193,124,89,200 ; vmulps %ymm8,%ymm0,%ymm1
- DB 196,226,101,0,5,116,33,0,0 ; vpshufb 0x2174(%rip),%ymm3,%ymm0 # 61a0 <_sk_callback_hsw+0x874>
+ DB 196,226,101,0,5,20,33,0,0 ; vpshufb 0x2114(%rip),%ymm3,%ymm0 # 6040 <_sk_callback_hsw+0x814>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -3905,7 +3848,7 @@ _sk_load_bgra_hsw LABEL PROC
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,125,33,192 ; vpmovsxbd %xmm0,%ymm0
DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
- DB 235,135 ; jmp 3ff7 <_sk_load_bgra_hsw+0x1a>
+ DB 235,135 ; jmp 3ef7 <_sk_load_bgra_hsw+0x1a>
PUBLIC _sk_load_bgra_dst_hsw
_sk_load_bgra_dst_hsw LABEL PROC
@@ -3914,16 +3857,16 @@ _sk_load_bgra_dst_hsw LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 40dd <_sk_load_bgra_dst_hsw+0x6d>
+ DB 117,88 ; jne 3fdd <_sk_load_bgra_dst_hsw+0x6d>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,196,84,37,46,33,0,0 ; vandps 0x212e(%rip),%ymm7,%ymm4 # 61c0 <_sk_callback_hsw+0x894>
+ DB 197,196,84,37,206,32,0,0 ; vandps 0x20ce(%rip),%ymm7,%ymm4 # 6060 <_sk_callback_hsw+0x834>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,98,125,24,5,53,29,0,0 ; vbroadcastss 0x1d35(%rip),%ymm8 # 5dd4 <_sk_callback_hsw+0x4a8>
+ DB 196,98,125,24,5,49,29,0,0 ; vbroadcastss 0x1d31(%rip),%ymm8 # 5cd0 <_sk_callback_hsw+0x4a4>
DB 196,193,92,89,240 ; vmulps %ymm8,%ymm4,%ymm6
- DB 196,226,69,0,37,51,33,0,0 ; vpshufb 0x2133(%rip),%ymm7,%ymm4 # 61e0 <_sk_callback_hsw+0x8b4>
+ DB 196,226,69,0,37,211,32,0,0 ; vpshufb 0x20d3(%rip),%ymm7,%ymm4 # 6080 <_sk_callback_hsw+0x854>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
DB 196,193,92,89,232 ; vmulps %ymm8,%ymm4,%ymm5
- DB 196,226,69,0,37,65,33,0,0 ; vpshufb 0x2141(%rip),%ymm7,%ymm4 # 6200 <_sk_callback_hsw+0x8d4>
+ DB 196,226,69,0,37,225,32,0,0 ; vpshufb 0x20e1(%rip),%ymm7,%ymm4 # 60a0 <_sk_callback_hsw+0x874>
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
DB 196,193,92,89,224 ; vmulps %ymm8,%ymm4,%ymm4
DB 197,197,114,215,24 ; vpsrld $0x18,%ymm7,%ymm7
@@ -3940,27 +3883,27 @@ _sk_load_bgra_dst_hsw LABEL PROC
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,125,33,228 ; vpmovsxbd %xmm4,%ymm4
DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
- DB 235,135 ; jmp 408a <_sk_load_bgra_dst_hsw+0x1a>
+ DB 235,135 ; jmp 3f8a <_sk_load_bgra_dst_hsw+0x1a>
PUBLIC _sk_gather_bgra_hsw
_sk_gather_bgra_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 196,194,117,144,28,129 ; vpgatherdd %ymm1,(%r9,%ymm0,4),%ymm3
- DB 197,229,219,5,239,32,0,0 ; vpand 0x20ef(%rip),%ymm3,%ymm0 # 6220 <_sk_callback_hsw+0x8f4>
+ DB 197,229,219,5,143,32,0,0 ; vpand 0x208f(%rip),%ymm3,%ymm0 # 60c0 <_sk_callback_hsw+0x894>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,154,28,0,0 ; vbroadcastss 0x1c9a(%rip),%ymm8 # 5dd8 <_sk_callback_hsw+0x4ac>
+ DB 196,98,125,24,5,150,28,0,0 ; vbroadcastss 0x1c96(%rip),%ymm8 # 5cd4 <_sk_callback_hsw+0x4a8>
DB 196,193,124,89,208 ; vmulps %ymm8,%ymm0,%ymm2
- DB 196,226,101,0,5,244,32,0,0 ; vpshufb 0x20f4(%rip),%ymm3,%ymm0 # 6240 <_sk_callback_hsw+0x914>
+ DB 196,226,101,0,5,148,32,0,0 ; vpshufb 0x2094(%rip),%ymm3,%ymm0 # 60e0 <_sk_callback_hsw+0x8b4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
DB 196,193,124,89,200 ; vmulps %ymm8,%ymm0,%ymm1
- DB 196,226,101,0,5,2,33,0,0 ; vpshufb 0x2102(%rip),%ymm3,%ymm0 # 6260 <_sk_callback_hsw+0x934>
+ DB 196,226,101,0,5,162,32,0,0 ; vpshufb 0x20a2(%rip),%ymm3,%ymm0 # 6100 <_sk_callback_hsw+0x8d4>
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,229,114,211,24 ; vpsrld $0x18,%ymm3,%ymm3
@@ -3975,7 +3918,7 @@ _sk_store_bgra_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
- DB 196,98,125,24,5,74,28,0,0 ; vbroadcastss 0x1c4a(%rip),%ymm8 # 5ddc <_sk_callback_hsw+0x4b0>
+ DB 196,98,125,24,5,70,28,0,0 ; vbroadcastss 0x1c46(%rip),%ymm8 # 5cd8 <_sk_callback_hsw+0x4ac>
DB 196,65,108,89,200 ; vmulps %ymm8,%ymm2,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -3991,7 +3934,7 @@ _sk_store_bgra_hsw LABEL PROC
DB 196,65,45,235,192 ; vpor %ymm8,%ymm10,%ymm8
DB 196,65,53,235,192 ; vpor %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,12 ; jne 41ec <_sk_store_bgra_hsw+0x73>
+ DB 117,12 ; jne 40ec <_sk_store_bgra_hsw+0x73>
DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -4004,14 +3947,14 @@ _sk_store_bgra_hsw LABEL PROC
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,125,33,201 ; vpmovsxbd %xmm9,%ymm9
DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
- DB 235,211 ; jmp 41e5 <_sk_store_bgra_hsw+0x6c>
+ DB 235,211 ; jmp 40e5 <_sk_store_bgra_hsw+0x6c>
PUBLIC _sk_load_f16_hsw
_sk_load_f16_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,97 ; jne 427d <_sk_load_f16_hsw+0x6b>
+ DB 117,97 ; jne 417d <_sk_load_f16_hsw+0x6b>
DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2
DB 197,249,16,92,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm3
@@ -4037,36 +3980,36 @@ _sk_load_f16_hsw LABEL PROC
DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,79 ; je 42dc <_sk_load_f16_hsw+0xca>
+ DB 116,79 ; je 41dc <_sk_load_f16_hsw+0xca>
DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,67 ; jb 42dc <_sk_load_f16_hsw+0xca>
+ DB 114,67 ; jb 41dc <_sk_load_f16_hsw+0xca>
DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,68 ; je 42e9 <_sk_load_f16_hsw+0xd7>
+ DB 116,68 ; je 41e9 <_sk_load_f16_hsw+0xd7>
DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,56 ; jb 42e9 <_sk_load_f16_hsw+0xd7>
+ DB 114,56 ; jb 41e9 <_sk_load_f16_hsw+0xd7>
DB 197,251,16,92,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm3
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,114,255,255,255 ; je 4233 <_sk_load_f16_hsw+0x21>
+ DB 15,132,114,255,255,255 ; je 4133 <_sk_load_f16_hsw+0x21>
DB 197,225,22,92,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm3,%xmm3
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,98,255,255,255 ; jb 4233 <_sk_load_f16_hsw+0x21>
+ DB 15,130,98,255,255,255 ; jb 4133 <_sk_load_f16_hsw+0x21>
DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
- DB 233,87,255,255,255 ; jmpq 4233 <_sk_load_f16_hsw+0x21>
+ DB 233,87,255,255,255 ; jmpq 4133 <_sk_load_f16_hsw+0x21>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,74,255,255,255 ; jmpq 4233 <_sk_load_f16_hsw+0x21>
+ DB 233,74,255,255,255 ; jmpq 4133 <_sk_load_f16_hsw+0x21>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,65,255,255,255 ; jmpq 4233 <_sk_load_f16_hsw+0x21>
+ DB 233,65,255,255,255 ; jmpq 4133 <_sk_load_f16_hsw+0x21>
PUBLIC _sk_load_f16_dst_hsw
_sk_load_f16_dst_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,97 ; jne 435d <_sk_load_f16_dst_hsw+0x6b>
+ DB 117,97 ; jne 425d <_sk_load_f16_dst_hsw+0x6b>
DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
DB 197,249,16,116,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm6
DB 197,249,16,124,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm7
@@ -4092,36 +4035,36 @@ _sk_load_f16_dst_hsw LABEL PROC
DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,79 ; je 43bc <_sk_load_f16_dst_hsw+0xca>
+ DB 116,79 ; je 42bc <_sk_load_f16_dst_hsw+0xca>
DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,67 ; jb 43bc <_sk_load_f16_dst_hsw+0xca>
+ DB 114,67 ; jb 42bc <_sk_load_f16_dst_hsw+0xca>
DB 197,251,16,116,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm6
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,68 ; je 43c9 <_sk_load_f16_dst_hsw+0xd7>
+ DB 116,68 ; je 42c9 <_sk_load_f16_dst_hsw+0xd7>
DB 197,201,22,116,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm6,%xmm6
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,56 ; jb 43c9 <_sk_load_f16_dst_hsw+0xd7>
+ DB 114,56 ; jb 42c9 <_sk_load_f16_dst_hsw+0xd7>
DB 197,251,16,124,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm7
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,114,255,255,255 ; je 4313 <_sk_load_f16_dst_hsw+0x21>
+ DB 15,132,114,255,255,255 ; je 4213 <_sk_load_f16_dst_hsw+0x21>
DB 197,193,22,124,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm7,%xmm7
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,98,255,255,255 ; jb 4313 <_sk_load_f16_dst_hsw+0x21>
+ DB 15,130,98,255,255,255 ; jb 4213 <_sk_load_f16_dst_hsw+0x21>
DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
- DB 233,87,255,255,255 ; jmpq 4313 <_sk_load_f16_dst_hsw+0x21>
+ DB 233,87,255,255,255 ; jmpq 4213 <_sk_load_f16_dst_hsw+0x21>
DB 197,193,87,255 ; vxorpd %xmm7,%xmm7,%xmm7
DB 197,201,87,246 ; vxorpd %xmm6,%xmm6,%xmm6
- DB 233,74,255,255,255 ; jmpq 4313 <_sk_load_f16_dst_hsw+0x21>
+ DB 233,74,255,255,255 ; jmpq 4213 <_sk_load_f16_dst_hsw+0x21>
DB 197,193,87,255 ; vxorpd %xmm7,%xmm7,%xmm7
- DB 233,65,255,255,255 ; jmpq 4313 <_sk_load_f16_dst_hsw+0x21>
+ DB 233,65,255,255,255 ; jmpq 4213 <_sk_load_f16_dst_hsw+0x21>
PUBLIC _sk_gather_f16_hsw
_sk_gather_f16_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 196,226,125,88,80,16 ; vpbroadcastd 0x10(%rax),%ymm2
+ DB 196,226,125,88,80,8 ; vpbroadcastd 0x8(%rax),%ymm2
DB 196,226,109,64,201 ; vpmulld %ymm1,%ymm2,%ymm1
DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
DB 197,245,254,192 ; vpaddd %ymm0,%ymm1,%ymm0
@@ -4168,7 +4111,7 @@ _sk_store_f16_hsw LABEL PROC
DB 196,65,57,98,205 ; vpunpckldq %xmm13,%xmm8,%xmm9
DB 196,65,57,106,197 ; vpunpckhdq %xmm13,%xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,27 ; jne 44c1 <_sk_store_f16_hsw+0x65>
+ DB 117,27 ; jne 43c1 <_sk_store_f16_hsw+0x65>
DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8)
DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8)
DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8)
@@ -4177,22 +4120,22 @@ _sk_store_f16_hsw LABEL PROC
DB 255,224 ; jmpq *%rax
DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,241 ; je 44bd <_sk_store_f16_hsw+0x61>
+ DB 116,241 ; je 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,229 ; jb 44bd <_sk_store_f16_hsw+0x61>
+ DB 114,229 ; jb 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8)
- DB 116,221 ; je 44bd <_sk_store_f16_hsw+0x61>
+ DB 116,221 ; je 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,209 ; jb 44bd <_sk_store_f16_hsw+0x61>
+ DB 114,209 ; jb 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8)
- DB 116,201 ; je 44bd <_sk_store_f16_hsw+0x61>
+ DB 116,201 ; je 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,189 ; jb 44bd <_sk_store_f16_hsw+0x61>
+ DB 114,189 ; jb 43bd <_sk_store_f16_hsw+0x61>
DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8)
- DB 235,181 ; jmp 44bd <_sk_store_f16_hsw+0x61>
+ DB 235,181 ; jmp 43bd <_sk_store_f16_hsw+0x61>
PUBLIC _sk_load_u16_be_hsw
_sk_load_u16_be_hsw LABEL PROC
@@ -4200,7 +4143,7 @@ _sk_load_u16_be_hsw LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,204,0,0,0 ; jne 45ea <_sk_load_u16_be_hsw+0xe2>
+ DB 15,133,204,0,0,0 ; jne 44ea <_sk_load_u16_be_hsw+0xe2>
DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8
DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2
DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3
@@ -4219,7 +4162,7 @@ _sk_load_u16_be_hsw LABEL PROC
DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,21,97,24,0,0 ; vbroadcastss 0x1861(%rip),%ymm10 # 5de0 <_sk_callback_hsw+0x4b4>
+ DB 196,98,125,24,21,93,24,0,0 ; vbroadcastss 0x185d(%rip),%ymm10 # 5cdc <_sk_callback_hsw+0x4b0>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -4247,29 +4190,29 @@ _sk_load_u16_be_hsw LABEL PROC
DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,85 ; je 4650 <_sk_load_u16_be_hsw+0x148>
+ DB 116,85 ; je 4550 <_sk_load_u16_be_hsw+0x148>
DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,72 ; jb 4650 <_sk_load_u16_be_hsw+0x148>
+ DB 114,72 ; jb 4550 <_sk_load_u16_be_hsw+0x148>
DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,72 ; je 465d <_sk_load_u16_be_hsw+0x155>
+ DB 116,72 ; je 455d <_sk_load_u16_be_hsw+0x155>
DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,59 ; jb 465d <_sk_load_u16_be_hsw+0x155>
+ DB 114,59 ; jb 455d <_sk_load_u16_be_hsw+0x155>
DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,6,255,255,255 ; je 4539 <_sk_load_u16_be_hsw+0x31>
+ DB 15,132,6,255,255,255 ; je 4439 <_sk_load_u16_be_hsw+0x31>
DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,245,254,255,255 ; jb 4539 <_sk_load_u16_be_hsw+0x31>
+ DB 15,130,245,254,255,255 ; jb 4439 <_sk_load_u16_be_hsw+0x31>
DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9
- DB 233,233,254,255,255 ; jmpq 4539 <_sk_load_u16_be_hsw+0x31>
+ DB 233,233,254,255,255 ; jmpq 4439 <_sk_load_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,220,254,255,255 ; jmpq 4539 <_sk_load_u16_be_hsw+0x31>
+ DB 233,220,254,255,255 ; jmpq 4439 <_sk_load_u16_be_hsw+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,211,254,255,255 ; jmpq 4539 <_sk_load_u16_be_hsw+0x31>
+ DB 233,211,254,255,255 ; jmpq 4439 <_sk_load_u16_be_hsw+0x31>
PUBLIC _sk_load_rgb_u16_be_hsw
_sk_load_rgb_u16_be_hsw LABEL PROC
@@ -4277,7 +4220,7 @@ _sk_load_rgb_u16_be_hsw LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,204,0,0,0 ; jne 4744 <_sk_load_rgb_u16_be_hsw+0xde>
+ DB 15,133,204,0,0,0 ; jne 4644 <_sk_load_rgb_u16_be_hsw+0xde>
DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0
DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2
DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1
@@ -4301,7 +4244,7 @@ _sk_load_rgb_u16_be_hsw LABEL PROC
DB 197,241,235,192 ; vpor %xmm0,%xmm1,%xmm0
DB 196,226,125,51,192 ; vpmovzxwd %xmm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,21,242,22,0,0 ; vbroadcastss 0x16f2(%rip),%ymm10 # 5de4 <_sk_callback_hsw+0x4b8>
+ DB 196,98,125,24,21,238,22,0,0 ; vbroadcastss 0x16ee(%rip),%ymm10 # 5ce0 <_sk_callback_hsw+0x4b4>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -4318,48 +4261,48 @@ _sk_load_rgb_u16_be_hsw LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,166,22,0,0 ; vbroadcastss 0x16a6(%rip),%ymm3 # 5de8 <_sk_callback_hsw+0x4bc>
+ DB 196,226,125,24,29,162,22,0,0 ; vbroadcastss 0x16a2(%rip),%ymm3 # 5ce4 <_sk_callback_hsw+0x4b8>
DB 255,224 ; jmpq *%rax
DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0
DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,5 ; jne 475d <_sk_load_rgb_u16_be_hsw+0xf7>
- DB 233,79,255,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 117,5 ; jne 465d <_sk_load_rgb_u16_be_hsw+0xf7>
+ DB 233,79,255,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1
DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,26 ; jb 478c <_sk_load_rgb_u16_be_hsw+0x126>
+ DB 114,26 ; jb 468c <_sk_load_rgb_u16_be_hsw+0x126>
DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1
DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 117,10 ; jne 4791 <_sk_load_rgb_u16_be_hsw+0x12b>
- DB 233,32,255,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,27,255,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 117,10 ; jne 4691 <_sk_load_rgb_u16_be_hsw+0x12b>
+ DB 233,32,255,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,27,255,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1
DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,26 ; jb 47c0 <_sk_load_rgb_u16_be_hsw+0x15a>
+ DB 114,26 ; jb 46c0 <_sk_load_rgb_u16_be_hsw+0x15a>
DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1
DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 117,10 ; jne 47c5 <_sk_load_rgb_u16_be_hsw+0x15f>
- DB 233,236,254,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,231,254,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 117,10 ; jne 46c5 <_sk_load_rgb_u16_be_hsw+0x15f>
+ DB 233,236,254,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,231,254,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3
DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,20 ; jb 47ee <_sk_load_rgb_u16_be_hsw+0x188>
+ DB 114,20 ; jb 46ee <_sk_load_rgb_u16_be_hsw+0x188>
DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3
DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
- DB 233,190,254,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
- DB 233,185,254,255,255 ; jmpq 46ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,190,254,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
+ DB 233,185,254,255,255 ; jmpq 45ac <_sk_load_rgb_u16_be_hsw+0x46>
PUBLIC _sk_store_u16_be_hsw
_sk_store_u16_be_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
- DB 196,98,125,24,5,227,21,0,0 ; vbroadcastss 0x15e3(%rip),%ymm8 # 5dec <_sk_callback_hsw+0x4c0>
+ DB 196,98,125,24,5,223,21,0,0 ; vbroadcastss 0x15df(%rip),%ymm8 # 5ce8 <_sk_callback_hsw+0x4bc>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10
@@ -4397,7 +4340,7 @@ _sk_store_u16_be_hsw LABEL PROC
DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9
DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,31 ; jne 48ed <_sk_store_u16_be_hsw+0xfa>
+ DB 117,31 ; jne 47ed <_sk_store_u16_be_hsw+0xfa>
DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2)
DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2)
DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2)
@@ -4406,31 +4349,31 @@ _sk_store_u16_be_hsw LABEL PROC
DB 255,224 ; jmpq *%rax
DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 116,240 ; je 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 114,227 ; jb 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2)
- DB 116,218 ; je 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 116,218 ; je 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,205 ; jb 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 114,205 ; jb 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2)
- DB 116,196 ; je 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 116,196 ; je 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,183 ; jb 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 114,183 ; jb 47e9 <_sk_store_u16_be_hsw+0xf6>
DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2)
- DB 235,174 ; jmp 48e9 <_sk_store_u16_be_hsw+0xf6>
+ DB 235,174 ; jmp 47e9 <_sk_store_u16_be_hsw+0xf6>
PUBLIC _sk_load_f32_hsw
_sk_load_f32_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 119,110 ; ja 49b1 <_sk_load_f32_hsw+0x76>
+ DB 119,110 ; ja 48b1 <_sk_load_f32_hsw+0x76>
DB 76,139,8 ; mov (%rax),%r9
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
- DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 49dc <_sk_load_f32_hsw+0xa1>
+ DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 48dc <_sk_load_f32_hsw+0xa1>
DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
DB 76,1,216 ; add %r11,%rax
DB 255,224 ; jmpq *%rax
@@ -4479,10 +4422,10 @@ PUBLIC _sk_load_f32_dst_hsw
_sk_load_f32_dst_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 119,110 ; ja 4a72 <_sk_load_f32_dst_hsw+0x76>
+ DB 119,110 ; ja 4972 <_sk_load_f32_dst_hsw+0x76>
DB 76,139,8 ; mov (%rax),%r9
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
- DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 4a9c <_sk_load_f32_dst_hsw+0xa0>
+ DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 499c <_sk_load_f32_dst_hsw+0xa0>
DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
DB 76,1,216 ; add %r11,%rax
DB 255,224 ; jmpq *%rax
@@ -4539,7 +4482,7 @@ _sk_store_f32_hsw LABEL PROC
DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8
DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11
DB 77,133,192 ; test %r8,%r8
- DB 117,55 ; jne 4b29 <_sk_store_f32_hsw+0x6d>
+ DB 117,55 ; jne 4a29 <_sk_store_f32_hsw+0x6d>
DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
@@ -4552,22 +4495,22 @@ _sk_store_f32_hsw LABEL PROC
DB 255,224 ; jmpq *%rax
DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 4b25 <_sk_store_f32_hsw+0x69>
+ DB 116,240 ; je 4a25 <_sk_store_f32_hsw+0x69>
DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 4b25 <_sk_store_f32_hsw+0x69>
+ DB 114,227 ; jb 4a25 <_sk_store_f32_hsw+0x69>
DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4)
- DB 116,218 ; je 4b25 <_sk_store_f32_hsw+0x69>
+ DB 116,218 ; je 4a25 <_sk_store_f32_hsw+0x69>
DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,205 ; jb 4b25 <_sk_store_f32_hsw+0x69>
+ DB 114,205 ; jb 4a25 <_sk_store_f32_hsw+0x69>
DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
- DB 116,195 ; je 4b25 <_sk_store_f32_hsw+0x69>
+ DB 116,195 ; je 4a25 <_sk_store_f32_hsw+0x69>
DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,181 ; jb 4b25 <_sk_store_f32_hsw+0x69>
+ DB 114,181 ; jb 4a25 <_sk_store_f32_hsw+0x69>
DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
- DB 235,171 ; jmp 4b25 <_sk_store_f32_hsw+0x69>
+ DB 235,171 ; jmp 4a25 <_sk_store_f32_hsw+0x69>
PUBLIC _sk_clamp_x_hsw
_sk_clamp_x_hsw LABEL PROC
@@ -4630,7 +4573,7 @@ _sk_mirror_x_hsw LABEL PROC
DB 196,65,124,92,218 ; vsubps %ymm10,%ymm0,%ymm11
DB 196,193,58,88,192 ; vaddss %xmm8,%xmm8,%xmm0
DB 196,98,125,24,192 ; vbroadcastss %xmm0,%ymm8
- DB 197,178,89,5,177,17,0,0 ; vmulss 0x11b1(%rip),%xmm9,%xmm0 # 5df0 <_sk_callback_hsw+0x4c4>
+ DB 197,178,89,5,173,17,0,0 ; vmulss 0x11ad(%rip),%xmm9,%xmm0 # 5cec <_sk_callback_hsw+0x4c0>
DB 196,226,125,24,192 ; vbroadcastss %xmm0,%ymm0
DB 197,164,89,192 ; vmulps %ymm0,%ymm11,%ymm0
DB 196,227,125,8,192,1 ; vroundps $0x1,%ymm0,%ymm0
@@ -4654,7 +4597,7 @@ _sk_mirror_y_hsw LABEL PROC
DB 196,65,116,92,218 ; vsubps %ymm10,%ymm1,%ymm11
DB 196,193,58,88,200 ; vaddss %xmm8,%xmm8,%xmm1
DB 196,98,125,24,193 ; vbroadcastss %xmm1,%ymm8
- DB 197,178,89,13,85,17,0,0 ; vmulss 0x1155(%rip),%xmm9,%xmm1 # 5df4 <_sk_callback_hsw+0x4c8>
+ DB 197,178,89,13,81,17,0,0 ; vmulss 0x1151(%rip),%xmm9,%xmm1 # 5cf0 <_sk_callback_hsw+0x4c4>
DB 196,226,125,24,201 ; vbroadcastss %xmm1,%ymm1
DB 197,164,89,201 ; vmulps %ymm1,%ymm11,%ymm1
DB 196,227,125,8,201,1 ; vroundps $0x1,%ymm1,%ymm1
@@ -4673,7 +4616,7 @@ PUBLIC _sk_clamp_x_1_hsw
_sk_clamp_x_1_hsw LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,14,17,0,0 ; vbroadcastss 0x110e(%rip),%ymm8 # 5df8 <_sk_callback_hsw+0x4cc>
+ DB 196,98,125,24,5,10,17,0,0 ; vbroadcastss 0x110a(%rip),%ymm8 # 5cf4 <_sk_callback_hsw+0x4c8>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -4687,9 +4630,9 @@ _sk_repeat_x_1_hsw LABEL PROC
PUBLIC _sk_mirror_x_1_hsw
_sk_mirror_x_1_hsw LABEL PROC
- DB 196,98,125,24,5,241,16,0,0 ; vbroadcastss 0x10f1(%rip),%ymm8 # 5dfc <_sk_callback_hsw+0x4d0>
+ DB 196,98,125,24,5,237,16,0,0 ; vbroadcastss 0x10ed(%rip),%ymm8 # 5cf8 <_sk_callback_hsw+0x4cc>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,13,231,16,0,0 ; vbroadcastss 0x10e7(%rip),%ymm9 # 5e00 <_sk_callback_hsw+0x4d4>
+ DB 196,98,125,24,13,227,16,0,0 ; vbroadcastss 0x10e3(%rip),%ymm9 # 5cfc <_sk_callback_hsw+0x4d0>
DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9
DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9
DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9
@@ -4703,11 +4646,11 @@ _sk_mirror_x_1_hsw LABEL PROC
PUBLIC _sk_luminance_to_alpha_hsw
_sk_luminance_to_alpha_hsw LABEL PROC
- DB 196,226,125,24,29,183,16,0,0 ; vbroadcastss 0x10b7(%rip),%ymm3 # 5e04 <_sk_callback_hsw+0x4d8>
- DB 196,98,125,24,5,178,16,0,0 ; vbroadcastss 0x10b2(%rip),%ymm8 # 5e08 <_sk_callback_hsw+0x4dc>
+ DB 196,226,125,24,29,179,16,0,0 ; vbroadcastss 0x10b3(%rip),%ymm3 # 5d00 <_sk_callback_hsw+0x4d4>
+ DB 196,98,125,24,5,174,16,0,0 ; vbroadcastss 0x10ae(%rip),%ymm8 # 5d04 <_sk_callback_hsw+0x4d8>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 196,226,125,184,203 ; vfmadd231ps %ymm3,%ymm0,%ymm1
- DB 196,226,125,24,29,163,16,0,0 ; vbroadcastss 0x10a3(%rip),%ymm3 # 5e0c <_sk_callback_hsw+0x4e0>
+ DB 196,226,125,24,29,159,16,0,0 ; vbroadcastss 0x109f(%rip),%ymm3 # 5d08 <_sk_callback_hsw+0x4dc>
DB 196,226,109,168,217 ; vfmadd213ps %ymm1,%ymm2,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -4891,9 +4834,9 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC
DB 76,139,72,8 ; mov 0x8(%rax),%r9
DB 77,137,211 ; mov %r10,%r11
DB 73,255,203 ; dec %r11
- DB 120,7 ; js 5062 <_sk_evenly_spaced_gradient_hsw+0x19>
+ DB 120,7 ; js 4f62 <_sk_evenly_spaced_gradient_hsw+0x19>
DB 196,193,242,42,203 ; vcvtsi2ss %r11,%xmm1,%xmm1
- DB 235,22 ; jmp 5078 <_sk_evenly_spaced_gradient_hsw+0x2f>
+ DB 235,22 ; jmp 4f78 <_sk_evenly_spaced_gradient_hsw+0x2f>
DB 76,137,219 ; mov %r11,%rbx
DB 72,209,235 ; shr %rbx
DB 65,131,227,1 ; and $0x1,%r11d
@@ -4904,7 +4847,7 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC
DB 197,244,89,200 ; vmulps %ymm0,%ymm1,%ymm1
DB 197,126,91,217 ; vcvttps2dq %ymm1,%ymm11
DB 73,131,250,8 ; cmp $0x8,%r10
- DB 119,70 ; ja 50d1 <_sk_evenly_spaced_gradient_hsw+0x88>
+ DB 119,70 ; ja 4fd1 <_sk_evenly_spaced_gradient_hsw+0x88>
DB 196,66,37,22,1 ; vpermps (%r9),%ymm11,%ymm8
DB 72,139,88,40 ; mov 0x28(%rax),%rbx
DB 196,98,37,22,11 ; vpermps (%rbx),%ymm11,%ymm9
@@ -4920,7 +4863,7 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC
DB 196,226,37,22,27 ; vpermps (%rbx),%ymm11,%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,98,37,22,40 ; vpermps (%rax),%ymm11,%ymm13
- DB 235,110 ; jmp 513f <_sk_evenly_spaced_gradient_hsw+0xf6>
+ DB 235,110 ; jmp 503f <_sk_evenly_spaced_gradient_hsw+0xf6>
DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 196,2,117,146,4,153 ; vgatherdps %ymm1,(%r9,%ymm11,4),%ymm8
@@ -4955,14 +4898,14 @@ _sk_evenly_spaced_gradient_hsw LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_hsw
_sk_gauss_a_to_rgba_hsw LABEL PROC
- DB 196,226,125,24,5,171,12,0,0 ; vbroadcastss 0xcab(%rip),%ymm0 # 5e10 <_sk_callback_hsw+0x4e4>
- DB 196,226,125,24,13,166,12,0,0 ; vbroadcastss 0xca6(%rip),%ymm1 # 5e14 <_sk_callback_hsw+0x4e8>
+ DB 196,226,125,24,5,167,12,0,0 ; vbroadcastss 0xca7(%rip),%ymm0 # 5d0c <_sk_callback_hsw+0x4e0>
+ DB 196,226,125,24,13,162,12,0,0 ; vbroadcastss 0xca2(%rip),%ymm1 # 5d10 <_sk_callback_hsw+0x4e4>
DB 196,226,101,168,200 ; vfmadd213ps %ymm0,%ymm3,%ymm1
- DB 196,226,125,24,5,156,12,0,0 ; vbroadcastss 0xc9c(%rip),%ymm0 # 5e18 <_sk_callback_hsw+0x4ec>
+ DB 196,226,125,24,5,152,12,0,0 ; vbroadcastss 0xc98(%rip),%ymm0 # 5d14 <_sk_callback_hsw+0x4e8>
DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0
- DB 196,226,125,24,13,146,12,0,0 ; vbroadcastss 0xc92(%rip),%ymm1 # 5e1c <_sk_callback_hsw+0x4f0>
+ DB 196,226,125,24,13,142,12,0,0 ; vbroadcastss 0xc8e(%rip),%ymm1 # 5d18 <_sk_callback_hsw+0x4ec>
DB 196,226,101,184,200 ; vfmadd231ps %ymm0,%ymm3,%ymm1
- DB 196,226,125,24,5,136,12,0,0 ; vbroadcastss 0xc88(%rip),%ymm0 # 5e20 <_sk_callback_hsw+0x4f4>
+ DB 196,226,125,24,5,132,12,0,0 ; vbroadcastss 0xc84(%rip),%ymm0 # 5d1c <_sk_callback_hsw+0x4f0>
DB 196,226,101,184,193 ; vfmadd231ps %ymm1,%ymm3,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
@@ -4975,11 +4918,11 @@ _sk_gradient_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 73,131,249,1 ; cmp $0x1,%r9
- DB 15,134,180,0,0,0 ; jbe 5270 <_sk_gradient_hsw+0xc3>
+ DB 15,134,180,0,0,0 ; jbe 5170 <_sk_gradient_hsw+0xc3>
DB 76,139,80,72 ; mov 0x48(%rax),%r10
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 65,187,1,0,0,0 ; mov $0x1,%r11d
- DB 196,226,125,24,21,81,12,0,0 ; vbroadcastss 0xc51(%rip),%ymm2 # 5e24 <_sk_callback_hsw+0x4f8>
+ DB 196,226,125,24,21,77,12,0,0 ; vbroadcastss 0xc4d(%rip),%ymm2 # 5d20 <_sk_callback_hsw+0x4f4>
DB 196,65,53,239,201 ; vpxor %ymm9,%ymm9,%ymm9
DB 196,130,125,24,28,154 ; vbroadcastss (%r10,%r11,4),%ymm3
DB 197,228,194,216,2 ; vcmpleps %ymm0,%ymm3,%ymm3
@@ -4987,10 +4930,10 @@ _sk_gradient_hsw LABEL PROC
DB 196,65,101,254,201 ; vpaddd %ymm9,%ymm3,%ymm9
DB 73,255,195 ; inc %r11
DB 77,57,217 ; cmp %r11,%r9
- DB 117,226 ; jne 51d8 <_sk_gradient_hsw+0x2b>
+ DB 117,226 ; jne 50d8 <_sk_gradient_hsw+0x2b>
DB 76,139,80,8 ; mov 0x8(%rax),%r10
DB 73,131,249,8 ; cmp $0x8,%r9
- DB 118,121 ; jbe 5279 <_sk_gradient_hsw+0xcc>
+ DB 118,121 ; jbe 5179 <_sk_gradient_hsw+0xcc>
DB 196,65,13,118,246 ; vpcmpeqd %ymm14,%ymm14,%ymm14
DB 197,245,118,201 ; vpcmpeqd %ymm1,%ymm1,%ymm1
DB 196,2,117,146,4,138 ; vgatherdps %ymm1,(%r10,%ymm9,4),%ymm8
@@ -5014,7 +4957,7 @@ _sk_gradient_hsw LABEL PROC
DB 196,130,21,146,28,137 ; vgatherdps %ymm13,(%r9,%ymm9,4),%ymm3
DB 72,139,64,64 ; mov 0x40(%rax),%rax
DB 196,34,13,146,44,136 ; vgatherdps %ymm14,(%rax,%ymm9,4),%ymm13
- DB 235,77 ; jmp 52bd <_sk_gradient_hsw+0x110>
+ DB 235,77 ; jmp 51bd <_sk_gradient_hsw+0x110>
DB 76,139,80,8 ; mov 0x8(%rax),%r10
DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9
DB 196,66,53,22,2 ; vpermps (%r10),%ymm9,%ymm8
@@ -5070,24 +5013,24 @@ _sk_xy_to_unit_angle_hsw LABEL PROC
DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12
DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11
DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12
- DB 196,98,125,24,45,208,10,0,0 ; vbroadcastss 0xad0(%rip),%ymm13 # 5e28 <_sk_callback_hsw+0x4fc>
- DB 196,98,125,24,53,203,10,0,0 ; vbroadcastss 0xacb(%rip),%ymm14 # 5e2c <_sk_callback_hsw+0x500>
+ DB 196,98,125,24,45,204,10,0,0 ; vbroadcastss 0xacc(%rip),%ymm13 # 5d24 <_sk_callback_hsw+0x4f8>
+ DB 196,98,125,24,53,199,10,0,0 ; vbroadcastss 0xac7(%rip),%ymm14 # 5d28 <_sk_callback_hsw+0x4fc>
DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14
- DB 196,98,125,24,45,193,10,0,0 ; vbroadcastss 0xac1(%rip),%ymm13 # 5e30 <_sk_callback_hsw+0x504>
+ DB 196,98,125,24,45,189,10,0,0 ; vbroadcastss 0xabd(%rip),%ymm13 # 5d2c <_sk_callback_hsw+0x500>
DB 196,66,29,184,238 ; vfmadd231ps %ymm14,%ymm12,%ymm13
- DB 196,98,125,24,53,183,10,0,0 ; vbroadcastss 0xab7(%rip),%ymm14 # 5e34 <_sk_callback_hsw+0x508>
+ DB 196,98,125,24,53,179,10,0,0 ; vbroadcastss 0xab3(%rip),%ymm14 # 5d30 <_sk_callback_hsw+0x504>
DB 196,66,29,184,245 ; vfmadd231ps %ymm13,%ymm12,%ymm14
DB 196,65,36,89,222 ; vmulps %ymm14,%ymm11,%ymm11
DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,162,10,0,0 ; vbroadcastss 0xaa2(%rip),%ymm10 # 5e38 <_sk_callback_hsw+0x50c>
+ DB 196,98,125,24,21,158,10,0,0 ; vbroadcastss 0xa9e(%rip),%ymm10 # 5d34 <_sk_callback_hsw+0x508>
DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10
DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9
DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,21,140,10,0,0 ; vbroadcastss 0xa8c(%rip),%ymm10 # 5e3c <_sk_callback_hsw+0x510>
+ DB 196,98,125,24,21,136,10,0,0 ; vbroadcastss 0xa88(%rip),%ymm10 # 5d38 <_sk_callback_hsw+0x50c>
DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9
- DB 196,98,125,24,21,118,10,0,0 ; vbroadcastss 0xa76(%rip),%ymm10 # 5e40 <_sk_callback_hsw+0x514>
+ DB 196,98,125,24,21,114,10,0,0 ; vbroadcastss 0xa72(%rip),%ymm10 # 5d3c <_sk_callback_hsw+0x510>
DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10
DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0
DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9
@@ -5111,23 +5054,23 @@ _sk_xy_to_2pt_conical_quadratic_max_hsw LABEL PROC
DB 197,50,89,80,44 ; vmulss 0x2c(%rax),%xmm9,%xmm10
DB 196,66,125,24,210 ; vbroadcastss %xmm10,%ymm10
DB 197,44,88,208 ; vaddps %ymm0,%ymm10,%ymm10
- DB 196,98,125,24,29,42,10,0,0 ; vbroadcastss 0xa2a(%rip),%ymm11 # 5e44 <_sk_callback_hsw+0x518>
+ DB 196,98,125,24,29,38,10,0,0 ; vbroadcastss 0xa26(%rip),%ymm11 # 5d40 <_sk_callback_hsw+0x514>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
DB 197,116,89,217 ; vmulps %ymm1,%ymm1,%ymm11
DB 196,98,125,184,216 ; vfmadd231ps %ymm0,%ymm0,%ymm11
DB 196,193,50,89,193 ; vmulss %xmm9,%xmm9,%xmm0
DB 196,226,125,24,192 ; vbroadcastss %xmm0,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,13,9,10,0,0 ; vbroadcastss 0xa09(%rip),%ymm9 # 5e48 <_sk_callback_hsw+0x51c>
+ DB 196,98,125,24,13,5,10,0,0 ; vbroadcastss 0xa05(%rip),%ymm9 # 5d44 <_sk_callback_hsw+0x518>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,194,45,184,194 ; vfmadd231ps %ymm10,%ymm10,%ymm0
DB 197,252,81,192 ; vsqrtps %ymm0,%ymm0
DB 196,98,125,24,64,36 ; vbroadcastss 0x24(%rax),%ymm8
- DB 196,98,125,24,13,236,9,0,0 ; vbroadcastss 0x9ec(%rip),%ymm9 # 5e4c <_sk_callback_hsw+0x520>
+ DB 196,98,125,24,13,232,9,0,0 ; vbroadcastss 0x9e8(%rip),%ymm9 # 5d48 <_sk_callback_hsw+0x51c>
DB 196,65,44,87,201 ; vxorps %ymm9,%ymm10,%ymm9
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,221,9,0,0 ; vbroadcastss 0x9dd(%rip),%ymm11 # 5e50 <_sk_callback_hsw+0x524>
+ DB 196,98,125,24,29,217,9,0,0 ; vbroadcastss 0x9d9(%rip),%ymm11 # 5d4c <_sk_callback_hsw+0x520>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 196,65,44,89,208 ; vmulps %ymm8,%ymm10,%ymm10
DB 197,180,92,192 ; vsubps %ymm0,%ymm9,%ymm0
@@ -5144,23 +5087,23 @@ _sk_xy_to_2pt_conical_quadratic_min_hsw LABEL PROC
DB 197,50,89,80,44 ; vmulss 0x2c(%rax),%xmm9,%xmm10
DB 196,66,125,24,210 ; vbroadcastss %xmm10,%ymm10
DB 197,44,88,208 ; vaddps %ymm0,%ymm10,%ymm10
- DB 196,98,125,24,29,162,9,0,0 ; vbroadcastss 0x9a2(%rip),%ymm11 # 5e54 <_sk_callback_hsw+0x528>
+ DB 196,98,125,24,29,158,9,0,0 ; vbroadcastss 0x99e(%rip),%ymm11 # 5d50 <_sk_callback_hsw+0x524>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
DB 197,116,89,217 ; vmulps %ymm1,%ymm1,%ymm11
DB 196,98,125,184,216 ; vfmadd231ps %ymm0,%ymm0,%ymm11
DB 196,193,50,89,193 ; vmulss %xmm9,%xmm9,%xmm0
DB 196,226,125,24,192 ; vbroadcastss %xmm0,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,13,129,9,0,0 ; vbroadcastss 0x981(%rip),%ymm9 # 5e58 <_sk_callback_hsw+0x52c>
+ DB 196,98,125,24,13,125,9,0,0 ; vbroadcastss 0x97d(%rip),%ymm9 # 5d54 <_sk_callback_hsw+0x528>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,194,45,184,194 ; vfmadd231ps %ymm10,%ymm10,%ymm0
DB 197,252,81,192 ; vsqrtps %ymm0,%ymm0
DB 196,98,125,24,64,36 ; vbroadcastss 0x24(%rax),%ymm8
- DB 196,98,125,24,13,100,9,0,0 ; vbroadcastss 0x964(%rip),%ymm9 # 5e5c <_sk_callback_hsw+0x530>
+ DB 196,98,125,24,13,96,9,0,0 ; vbroadcastss 0x960(%rip),%ymm9 # 5d58 <_sk_callback_hsw+0x52c>
DB 196,65,44,87,201 ; vxorps %ymm9,%ymm10,%ymm9
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,85,9,0,0 ; vbroadcastss 0x955(%rip),%ymm11 # 5e60 <_sk_callback_hsw+0x534>
+ DB 196,98,125,24,29,81,9,0,0 ; vbroadcastss 0x951(%rip),%ymm11 # 5d5c <_sk_callback_hsw+0x530>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 196,65,44,89,208 ; vmulps %ymm8,%ymm10,%ymm10
DB 197,180,92,192 ; vsubps %ymm0,%ymm9,%ymm0
@@ -5176,14 +5119,14 @@ _sk_xy_to_2pt_conical_linear_hsw LABEL PROC
DB 197,58,89,72,44 ; vmulss 0x2c(%rax),%xmm8,%xmm9
DB 196,66,125,24,201 ; vbroadcastss %xmm9,%ymm9
DB 197,52,88,200 ; vaddps %ymm0,%ymm9,%ymm9
- DB 196,98,125,24,21,32,9,0,0 ; vbroadcastss 0x920(%rip),%ymm10 # 5e64 <_sk_callback_hsw+0x538>
+ DB 196,98,125,24,21,28,9,0,0 ; vbroadcastss 0x91c(%rip),%ymm10 # 5d60 <_sk_callback_hsw+0x534>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
DB 197,116,89,209 ; vmulps %ymm1,%ymm1,%ymm10
DB 196,98,125,184,208 ; vfmadd231ps %ymm0,%ymm0,%ymm10
DB 196,193,58,89,192 ; vmulss %xmm8,%xmm8,%xmm0
DB 196,226,125,24,192 ; vbroadcastss %xmm0,%ymm0
DB 197,172,92,192 ; vsubps %ymm0,%ymm10,%ymm0
- DB 196,98,125,24,5,255,8,0,0 ; vbroadcastss 0x8ff(%rip),%ymm8 # 5e68 <_sk_callback_hsw+0x53c>
+ DB 196,98,125,24,5,251,8,0,0 ; vbroadcastss 0x8fb(%rip),%ymm8 # 5d64 <_sk_callback_hsw+0x538>
DB 196,193,124,87,192 ; vxorps %ymm8,%ymm0,%ymm0
DB 196,193,124,94,193 ; vdivps %ymm9,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5217,7 +5160,7 @@ _sk_apply_vector_mask_hsw LABEL PROC
PUBLIC _sk_save_xy_hsw
_sk_save_xy_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,159,8,0,0 ; vbroadcastss 0x89f(%rip),%ymm8 # 5e6c <_sk_callback_hsw+0x540>
+ DB 196,98,125,24,5,155,8,0,0 ; vbroadcastss 0x89b(%rip),%ymm8 # 5d68 <_sk_callback_hsw+0x53c>
DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9
DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
@@ -5247,9 +5190,9 @@ _sk_accumulate_hsw LABEL PROC
PUBLIC _sk_bilinear_nx_hsw
_sk_bilinear_nx_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,51,8,0,0 ; vbroadcastss 0x833(%rip),%ymm0 # 5e70 <_sk_callback_hsw+0x544>
+ DB 196,226,125,24,5,47,8,0,0 ; vbroadcastss 0x82f(%rip),%ymm0 # 5d6c <_sk_callback_hsw+0x540>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,42,8,0,0 ; vbroadcastss 0x82a(%rip),%ymm8 # 5e74 <_sk_callback_hsw+0x548>
+ DB 196,98,125,24,5,38,8,0,0 ; vbroadcastss 0x826(%rip),%ymm8 # 5d70 <_sk_callback_hsw+0x544>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5258,7 +5201,7 @@ _sk_bilinear_nx_hsw LABEL PROC
PUBLIC _sk_bilinear_px_hsw
_sk_bilinear_px_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,18,8,0,0 ; vbroadcastss 0x812(%rip),%ymm0 # 5e78 <_sk_callback_hsw+0x54c>
+ DB 196,226,125,24,5,14,8,0,0 ; vbroadcastss 0x80e(%rip),%ymm0 # 5d74 <_sk_callback_hsw+0x548>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -5268,9 +5211,9 @@ _sk_bilinear_px_hsw LABEL PROC
PUBLIC _sk_bilinear_ny_hsw
_sk_bilinear_ny_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,246,7,0,0 ; vbroadcastss 0x7f6(%rip),%ymm1 # 5e7c <_sk_callback_hsw+0x550>
+ DB 196,226,125,24,13,242,7,0,0 ; vbroadcastss 0x7f2(%rip),%ymm1 # 5d78 <_sk_callback_hsw+0x54c>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,236,7,0,0 ; vbroadcastss 0x7ec(%rip),%ymm8 # 5e80 <_sk_callback_hsw+0x554>
+ DB 196,98,125,24,5,232,7,0,0 ; vbroadcastss 0x7e8(%rip),%ymm8 # 5d7c <_sk_callback_hsw+0x550>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5279,7 +5222,7 @@ _sk_bilinear_ny_hsw LABEL PROC
PUBLIC _sk_bilinear_py_hsw
_sk_bilinear_py_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,212,7,0,0 ; vbroadcastss 0x7d4(%rip),%ymm1 # 5e84 <_sk_callback_hsw+0x558>
+ DB 196,226,125,24,13,208,7,0,0 ; vbroadcastss 0x7d0(%rip),%ymm1 # 5d80 <_sk_callback_hsw+0x554>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -5289,13 +5232,13 @@ _sk_bilinear_py_hsw LABEL PROC
PUBLIC _sk_bicubic_n3x_hsw
_sk_bicubic_n3x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,183,7,0,0 ; vbroadcastss 0x7b7(%rip),%ymm0 # 5e88 <_sk_callback_hsw+0x55c>
+ DB 196,226,125,24,5,179,7,0,0 ; vbroadcastss 0x7b3(%rip),%ymm0 # 5d84 <_sk_callback_hsw+0x558>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,174,7,0,0 ; vbroadcastss 0x7ae(%rip),%ymm8 # 5e8c <_sk_callback_hsw+0x560>
+ DB 196,98,125,24,5,170,7,0,0 ; vbroadcastss 0x7aa(%rip),%ymm8 # 5d88 <_sk_callback_hsw+0x55c>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,159,7,0,0 ; vbroadcastss 0x79f(%rip),%ymm10 # 5e90 <_sk_callback_hsw+0x564>
- DB 196,98,125,24,29,154,7,0,0 ; vbroadcastss 0x79a(%rip),%ymm11 # 5e94 <_sk_callback_hsw+0x568>
+ DB 196,98,125,24,21,155,7,0,0 ; vbroadcastss 0x79b(%rip),%ymm10 # 5d8c <_sk_callback_hsw+0x560>
+ DB 196,98,125,24,29,150,7,0,0 ; vbroadcastss 0x796(%rip),%ymm11 # 5d90 <_sk_callback_hsw+0x564>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -5305,16 +5248,16 @@ _sk_bicubic_n3x_hsw LABEL PROC
PUBLIC _sk_bicubic_n1x_hsw
_sk_bicubic_n1x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,125,7,0,0 ; vbroadcastss 0x77d(%rip),%ymm0 # 5e98 <_sk_callback_hsw+0x56c>
+ DB 196,226,125,24,5,121,7,0,0 ; vbroadcastss 0x779(%rip),%ymm0 # 5d94 <_sk_callback_hsw+0x568>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,116,7,0,0 ; vbroadcastss 0x774(%rip),%ymm8 # 5e9c <_sk_callback_hsw+0x570>
+ DB 196,98,125,24,5,112,7,0,0 ; vbroadcastss 0x770(%rip),%ymm8 # 5d98 <_sk_callback_hsw+0x56c>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,106,7,0,0 ; vbroadcastss 0x76a(%rip),%ymm9 # 5ea0 <_sk_callback_hsw+0x574>
- DB 196,98,125,24,21,101,7,0,0 ; vbroadcastss 0x765(%rip),%ymm10 # 5ea4 <_sk_callback_hsw+0x578>
+ DB 196,98,125,24,13,102,7,0,0 ; vbroadcastss 0x766(%rip),%ymm9 # 5d9c <_sk_callback_hsw+0x570>
+ DB 196,98,125,24,21,97,7,0,0 ; vbroadcastss 0x761(%rip),%ymm10 # 5da0 <_sk_callback_hsw+0x574>
DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,13,91,7,0,0 ; vbroadcastss 0x75b(%rip),%ymm9 # 5ea8 <_sk_callback_hsw+0x57c>
+ DB 196,98,125,24,13,87,7,0,0 ; vbroadcastss 0x757(%rip),%ymm9 # 5da4 <_sk_callback_hsw+0x578>
DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9
- DB 196,98,125,24,21,81,7,0,0 ; vbroadcastss 0x751(%rip),%ymm10 # 5eac <_sk_callback_hsw+0x580>
+ DB 196,98,125,24,21,77,7,0,0 ; vbroadcastss 0x74d(%rip),%ymm10 # 5da8 <_sk_callback_hsw+0x57c>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
DB 197,124,17,144,128,0,0,0 ; vmovups %ymm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5323,14 +5266,14 @@ _sk_bicubic_n1x_hsw LABEL PROC
PUBLIC _sk_bicubic_p1x_hsw
_sk_bicubic_p1x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,57,7,0,0 ; vbroadcastss 0x739(%rip),%ymm8 # 5eb0 <_sk_callback_hsw+0x584>
+ DB 196,98,125,24,5,53,7,0,0 ; vbroadcastss 0x735(%rip),%ymm8 # 5dac <_sk_callback_hsw+0x580>
DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0
DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9
- DB 196,98,125,24,21,43,7,0,0 ; vbroadcastss 0x72b(%rip),%ymm10 # 5eb4 <_sk_callback_hsw+0x588>
- DB 196,98,125,24,29,38,7,0,0 ; vbroadcastss 0x726(%rip),%ymm11 # 5eb8 <_sk_callback_hsw+0x58c>
+ DB 196,98,125,24,21,39,7,0,0 ; vbroadcastss 0x727(%rip),%ymm10 # 5db0 <_sk_callback_hsw+0x584>
+ DB 196,98,125,24,29,34,7,0,0 ; vbroadcastss 0x722(%rip),%ymm11 # 5db4 <_sk_callback_hsw+0x588>
DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11
DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11
- DB 196,98,125,24,5,23,7,0,0 ; vbroadcastss 0x717(%rip),%ymm8 # 5ebc <_sk_callback_hsw+0x590>
+ DB 196,98,125,24,5,19,7,0,0 ; vbroadcastss 0x713(%rip),%ymm8 # 5db8 <_sk_callback_hsw+0x58c>
DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5339,12 +5282,12 @@ _sk_bicubic_p1x_hsw LABEL PROC
PUBLIC _sk_bicubic_p3x_hsw
_sk_bicubic_p3x_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,255,6,0,0 ; vbroadcastss 0x6ff(%rip),%ymm0 # 5ec0 <_sk_callback_hsw+0x594>
+ DB 196,226,125,24,5,251,6,0,0 ; vbroadcastss 0x6fb(%rip),%ymm0 # 5dbc <_sk_callback_hsw+0x590>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,236,6,0,0 ; vbroadcastss 0x6ec(%rip),%ymm10 # 5ec4 <_sk_callback_hsw+0x598>
- DB 196,98,125,24,29,231,6,0,0 ; vbroadcastss 0x6e7(%rip),%ymm11 # 5ec8 <_sk_callback_hsw+0x59c>
+ DB 196,98,125,24,21,232,6,0,0 ; vbroadcastss 0x6e8(%rip),%ymm10 # 5dc0 <_sk_callback_hsw+0x594>
+ DB 196,98,125,24,29,227,6,0,0 ; vbroadcastss 0x6e3(%rip),%ymm11 # 5dc4 <_sk_callback_hsw+0x598>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -5354,13 +5297,13 @@ _sk_bicubic_p3x_hsw LABEL PROC
PUBLIC _sk_bicubic_n3y_hsw
_sk_bicubic_n3y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,202,6,0,0 ; vbroadcastss 0x6ca(%rip),%ymm1 # 5ecc <_sk_callback_hsw+0x5a0>
+ DB 196,226,125,24,13,198,6,0,0 ; vbroadcastss 0x6c6(%rip),%ymm1 # 5dc8 <_sk_callback_hsw+0x59c>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,192,6,0,0 ; vbroadcastss 0x6c0(%rip),%ymm8 # 5ed0 <_sk_callback_hsw+0x5a4>
+ DB 196,98,125,24,5,188,6,0,0 ; vbroadcastss 0x6bc(%rip),%ymm8 # 5dcc <_sk_callback_hsw+0x5a0>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,177,6,0,0 ; vbroadcastss 0x6b1(%rip),%ymm10 # 5ed4 <_sk_callback_hsw+0x5a8>
- DB 196,98,125,24,29,172,6,0,0 ; vbroadcastss 0x6ac(%rip),%ymm11 # 5ed8 <_sk_callback_hsw+0x5ac>
+ DB 196,98,125,24,21,173,6,0,0 ; vbroadcastss 0x6ad(%rip),%ymm10 # 5dd0 <_sk_callback_hsw+0x5a4>
+ DB 196,98,125,24,29,168,6,0,0 ; vbroadcastss 0x6a8(%rip),%ymm11 # 5dd4 <_sk_callback_hsw+0x5a8>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,36,89,193 ; vmulps %ymm9,%ymm11,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -5370,16 +5313,16 @@ _sk_bicubic_n3y_hsw LABEL PROC
PUBLIC _sk_bicubic_n1y_hsw
_sk_bicubic_n1y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,143,6,0,0 ; vbroadcastss 0x68f(%rip),%ymm1 # 5edc <_sk_callback_hsw+0x5b0>
+ DB 196,226,125,24,13,139,6,0,0 ; vbroadcastss 0x68b(%rip),%ymm1 # 5dd8 <_sk_callback_hsw+0x5ac>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,133,6,0,0 ; vbroadcastss 0x685(%rip),%ymm8 # 5ee0 <_sk_callback_hsw+0x5b4>
+ DB 196,98,125,24,5,129,6,0,0 ; vbroadcastss 0x681(%rip),%ymm8 # 5ddc <_sk_callback_hsw+0x5b0>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,123,6,0,0 ; vbroadcastss 0x67b(%rip),%ymm9 # 5ee4 <_sk_callback_hsw+0x5b8>
- DB 196,98,125,24,21,118,6,0,0 ; vbroadcastss 0x676(%rip),%ymm10 # 5ee8 <_sk_callback_hsw+0x5bc>
+ DB 196,98,125,24,13,119,6,0,0 ; vbroadcastss 0x677(%rip),%ymm9 # 5de0 <_sk_callback_hsw+0x5b4>
+ DB 196,98,125,24,21,114,6,0,0 ; vbroadcastss 0x672(%rip),%ymm10 # 5de4 <_sk_callback_hsw+0x5b8>
DB 196,66,61,168,209 ; vfmadd213ps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,13,108,6,0,0 ; vbroadcastss 0x66c(%rip),%ymm9 # 5eec <_sk_callback_hsw+0x5c0>
+ DB 196,98,125,24,13,104,6,0,0 ; vbroadcastss 0x668(%rip),%ymm9 # 5de8 <_sk_callback_hsw+0x5bc>
DB 196,66,61,184,202 ; vfmadd231ps %ymm10,%ymm8,%ymm9
- DB 196,98,125,24,21,98,6,0,0 ; vbroadcastss 0x662(%rip),%ymm10 # 5ef0 <_sk_callback_hsw+0x5c4>
+ DB 196,98,125,24,21,94,6,0,0 ; vbroadcastss 0x65e(%rip),%ymm10 # 5dec <_sk_callback_hsw+0x5c0>
DB 196,66,61,184,209 ; vfmadd231ps %ymm9,%ymm8,%ymm10
DB 197,124,17,144,160,0,0,0 ; vmovups %ymm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5388,14 +5331,14 @@ _sk_bicubic_n1y_hsw LABEL PROC
PUBLIC _sk_bicubic_p1y_hsw
_sk_bicubic_p1y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,74,6,0,0 ; vbroadcastss 0x64a(%rip),%ymm8 # 5ef4 <_sk_callback_hsw+0x5c8>
+ DB 196,98,125,24,5,70,6,0,0 ; vbroadcastss 0x646(%rip),%ymm8 # 5df0 <_sk_callback_hsw+0x5c4>
DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1
DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9
- DB 196,98,125,24,21,59,6,0,0 ; vbroadcastss 0x63b(%rip),%ymm10 # 5ef8 <_sk_callback_hsw+0x5cc>
- DB 196,98,125,24,29,54,6,0,0 ; vbroadcastss 0x636(%rip),%ymm11 # 5efc <_sk_callback_hsw+0x5d0>
+ DB 196,98,125,24,21,55,6,0,0 ; vbroadcastss 0x637(%rip),%ymm10 # 5df4 <_sk_callback_hsw+0x5c8>
+ DB 196,98,125,24,29,50,6,0,0 ; vbroadcastss 0x632(%rip),%ymm11 # 5df8 <_sk_callback_hsw+0x5cc>
DB 196,66,53,168,218 ; vfmadd213ps %ymm10,%ymm9,%ymm11
DB 196,66,53,168,216 ; vfmadd213ps %ymm8,%ymm9,%ymm11
- DB 196,98,125,24,5,39,6,0,0 ; vbroadcastss 0x627(%rip),%ymm8 # 5f00 <_sk_callback_hsw+0x5d4>
+ DB 196,98,125,24,5,35,6,0,0 ; vbroadcastss 0x623(%rip),%ymm8 # 5dfc <_sk_callback_hsw+0x5d0>
DB 196,66,53,184,195 ; vfmadd231ps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -5404,12 +5347,12 @@ _sk_bicubic_p1y_hsw LABEL PROC
PUBLIC _sk_bicubic_p3y_hsw
_sk_bicubic_p3y_hsw LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,15,6,0,0 ; vbroadcastss 0x60f(%rip),%ymm1 # 5f04 <_sk_callback_hsw+0x5d8>
+ DB 196,226,125,24,13,11,6,0,0 ; vbroadcastss 0x60b(%rip),%ymm1 # 5e00 <_sk_callback_hsw+0x5d4>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,251,5,0,0 ; vbroadcastss 0x5fb(%rip),%ymm10 # 5f08 <_sk_callback_hsw+0x5dc>
- DB 196,98,125,24,29,246,5,0,0 ; vbroadcastss 0x5f6(%rip),%ymm11 # 5f0c <_sk_callback_hsw+0x5e0>
+ DB 196,98,125,24,21,247,5,0,0 ; vbroadcastss 0x5f7(%rip),%ymm10 # 5e04 <_sk_callback_hsw+0x5d8>
+ DB 196,98,125,24,29,242,5,0,0 ; vbroadcastss 0x5f2(%rip),%ymm11 # 5e08 <_sk_callback_hsw+0x5dc>
DB 196,66,61,168,218 ; vfmadd213ps %ymm10,%ymm8,%ymm11
DB 196,65,52,89,195 ; vmulps %ymm11,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -5533,25 +5476,25 @@ ALIGN 4
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 5b11 <.literal4+0xb9>
+ DB 71,225,61 ; rex.RXB loope 5a11 <.literal4+0xb9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 5b21 <.literal4+0xc9>
+ DB 71,225,61 ; rex.RXB loope 5a21 <.literal4+0xc9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 5b31 <.literal4+0xd9>
+ DB 71,225,61 ; rex.RXB loope 5a31 <.literal4+0xd9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 5b41 <.literal4+0xe9>
+ DB 71,225,61 ; rex.RXB loope 5a41 <.literal4+0xe9>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
@@ -5613,7 +5556,7 @@ ALIGN 4
DB 190,129,128,128,59 ; mov $0x3b808081,%esi
DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5bb1 <.literal4+0x159>
+ DB 224,7 ; loopne 5ab1 <.literal4+0x159>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -5629,10 +5572,10 @@ ALIGN 4
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
DB 0,52,255 ; add %dh,(%rdi,%rdi,8)
DB 255 ; (bad)
- DB 127,0 ; jg 5bd8 <.literal4+0x180>
+ DB 127,0 ; jg 5ad8 <.literal4+0x180>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5c51 <.literal4+0x1f9>
+ DB 119,115 ; ja 5b51 <.literal4+0x1f9>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -5646,10 +5589,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5c0c <.literal4+0x1b4>
+ DB 127,0 ; jg 5b0c <.literal4+0x1b4>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5c85 <.literal4+0x22d>
+ DB 119,115 ; ja 5b85 <.literal4+0x22d>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -5663,10 +5606,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5c40 <.literal4+0x1e8>
+ DB 127,0 ; jg 5b40 <.literal4+0x1e8>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5cb9 <.literal4+0x261>
+ DB 119,115 ; ja 5bb9 <.literal4+0x261>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -5680,10 +5623,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 5c74 <.literal4+0x21c>
+ DB 127,0 ; jg 5b74 <.literal4+0x21c>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 5ced <.literal4+0x295>
+ DB 119,115 ; ja 5bed <.literal4+0x295>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -5696,7 +5639,7 @@ ALIGN 4
DB 0,75,0 ; add %cl,0x0(%rbx)
DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax)
DB 66,0,0 ; rex.X add %al,(%rax)
- DB 127,67 ; jg 5ceb <.literal4+0x293>
+ DB 127,67 ; jg 5beb <.literal4+0x293>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -5708,7 +5651,7 @@ ALIGN 4
DB 190,80,128,3,62 ; mov $0x3e038050,%esi
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 5d0b <.literal4+0x2b3>
+ DB 118,63 ; jbe 5c0b <.literal4+0x2b3>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
@@ -5717,14 +5660,9 @@ ALIGN 4
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
DB 59,0 ; cmp (%rax),%eax
- DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
- DB 59,0 ; cmp (%rax),%eax
- DB 248 ; clc
- DB 0,0 ; add %al,(%rax)
- DB 8,33 ; or %ah,(%rcx)
- DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5d0d <.literal4+0x2b5>
- DB 0,0 ; add %al,(%rax)
+ DB 0,128,63,0,248,0 ; add %al,0xf8003f(%rax)
+ DB 0,8 ; add %cl,(%rax)
+ DB 33,132,55,224,7,0,0 ; and %eax,0x7e0(%rdi,%rsi,1)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
DB 31 ; (bad)
@@ -5735,7 +5673,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5d29 <.literal4+0x2d1>
+ DB 224,7 ; loopne 5c25 <.literal4+0x2cd>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -5747,7 +5685,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 5d45 <.literal4+0x2ed>
+ DB 224,7 ; loopne 5c41 <.literal4+0x2e9>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -5758,7 +5696,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 5d9a <.literal4+0x342>
+ DB 124,66 ; jl 5c96 <.literal4+0x33e>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax)
@@ -5784,12 +5722,12 @@ ALIGN 4
DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax)
DB 0,0 ; add %al,(%rax)
DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax)
- DB 112,65 ; jo 5dfd <.literal4+0x3a5>
+ DB 112,65 ; jo 5cf9 <.literal4+0x3a1>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 5e13 <.literal4+0x3bb>
+ DB 127,67 ; jg 5d0f <.literal4+0x3b7>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
@@ -5800,7 +5738,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 5e37 <.literal4+0x3df>
+ DB 127,71 ; jg 5d33 <.literal4+0x3db>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -5927,16 +5865,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005f48 <_sk_callback_hsw+0xa00061c>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005e48 <_sk_callback_hsw+0xa00061c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005f50 <_sk_callback_hsw+0x12000624>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005e50 <_sk_callback_hsw+0x12000624>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005f58 <_sk_callback_hsw+0x1a00062c>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005e58 <_sk_callback_hsw+0x1a00062c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005f60 <_sk_callback_hsw+0x3000634>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005e60 <_sk_callback_hsw+0x3000634>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -5979,16 +5917,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005fa8 <_sk_callback_hsw+0xa00067c>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005ea8 <_sk_callback_hsw+0xa00067c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005fb0 <_sk_callback_hsw+0x12000684>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005eb0 <_sk_callback_hsw+0x12000684>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005fb8 <_sk_callback_hsw+0x1a00068c>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005eb8 <_sk_callback_hsw+0x1a00068c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005fc0 <_sk_callback_hsw+0x3000694>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005ec0 <_sk_callback_hsw+0x3000694>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6031,16 +5969,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006008 <_sk_callback_hsw+0xa0006dc>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005f08 <_sk_callback_hsw+0xa0006dc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006010 <_sk_callback_hsw+0x120006e4>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005f10 <_sk_callback_hsw+0x120006e4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006018 <_sk_callback_hsw+0x1a0006ec>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005f18 <_sk_callback_hsw+0x1a0006ec>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006020 <_sk_callback_hsw+0x30006f4>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005f20 <_sk_callback_hsw+0x30006f4>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6083,16 +6021,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006068 <_sk_callback_hsw+0xa00073c>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005f68 <_sk_callback_hsw+0xa00073c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006070 <_sk_callback_hsw+0x12000744>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005f70 <_sk_callback_hsw+0x12000744>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006078 <_sk_callback_hsw+0x1a00074c>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005f78 <_sk_callback_hsw+0x1a00074c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006080 <_sk_callback_hsw+0x3000754>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005f80 <_sk_callback_hsw+0x3000754>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6135,16 +6073,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0060c8 <_sk_callback_hsw+0xa00079c>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a005fc8 <_sk_callback_hsw+0xa00079c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 120060d0 <_sk_callback_hsw+0x120007a4>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12005fd0 <_sk_callback_hsw+0x120007a4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a0060d8 <_sk_callback_hsw+0x1a0007ac>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a005fd8 <_sk_callback_hsw+0x1a0007ac>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 30060e0 <_sk_callback_hsw+0x30007b4>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3005fe0 <_sk_callback_hsw+0x30007b4>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6187,16 +6125,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006128 <_sk_callback_hsw+0xa0007fc>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006028 <_sk_callback_hsw+0xa0007fc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006130 <_sk_callback_hsw+0x12000804>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006030 <_sk_callback_hsw+0x12000804>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006138 <_sk_callback_hsw+0x1a00080c>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006038 <_sk_callback_hsw+0x1a00080c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006140 <_sk_callback_hsw+0x3000814>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006040 <_sk_callback_hsw+0x3000814>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6239,16 +6177,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006188 <_sk_callback_hsw+0xa00085c>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006088 <_sk_callback_hsw+0xa00085c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006190 <_sk_callback_hsw+0x12000864>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006090 <_sk_callback_hsw+0x12000864>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006198 <_sk_callback_hsw+0x1a00086c>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006098 <_sk_callback_hsw+0x1a00086c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 30061a0 <_sk_callback_hsw+0x3000874>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 30060a0 <_sk_callback_hsw+0x3000874>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6291,68 +6229,16 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0061e8 <_sk_callback_hsw+0xa0008bc>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a0060e8 <_sk_callback_hsw+0xa0008bc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 120061f0 <_sk_callback_hsw+0x120008c4>
+ DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 120060f0 <_sk_callback_hsw+0x120008c4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a0061f8 <_sk_callback_hsw+0x1a0008cc>
+ DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a0060f8 <_sk_callback_hsw+0x1a0008cc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006200 <_sk_callback_hsw+0x30008d4>
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,6 ; incl (%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,10 ; decl (%rdx)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,14 ; decl (%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,18 ; callq *(%rdx)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,22 ; callq *(%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,26 ; lcall *(%rdx)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,30 ; lcall *(%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 1,255 ; add %edi,%edi
- DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006248 <_sk_callback_hsw+0xa00091c>
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,13,255,255,255,17 ; decl 0x11ffffff(%rip) # 12006250 <_sk_callback_hsw+0x12000924>
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,21,255,255,255,25 ; callq *0x19ffffff(%rip) # 1a006258 <_sk_callback_hsw+0x1a00092c>
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006260 <_sk_callback_hsw+0x3000934>
+ DB 255,29,255,255,255,2 ; lcall *0x2ffffff(%rip) # 3006100 <_sk_callback_hsw+0x30008d4>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -6628,7 +6514,7 @@ _sk_seed_shader_avx LABEL PROC
DB 197,249,112,192,0 ; vpshufd $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,165,121,0,0 ; vbroadcastss 0x79a5(%rip),%ymm1 # 7c24 <_sk_callback_avx+0x12c>
+ DB 196,226,125,24,13,1,120,0,0 ; vbroadcastss 0x7801(%rip),%ymm1 # 7a80 <_sk_callback_avx+0x12c>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,88,7 ; vaddps (%rdi),%ymm0,%ymm0
DB 197,249,110,209 ; vmovd %ecx,%xmm2
@@ -6637,7 +6523,7 @@ _sk_seed_shader_avx LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 197,236,88,201 ; vaddps %ymm1,%ymm2,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,21,127,121,0,0 ; vbroadcastss 0x797f(%rip),%ymm2 # 7c28 <_sk_callback_avx+0x130>
+ DB 196,226,125,24,21,219,119,0,0 ; vbroadcastss 0x77db(%rip),%ymm2 # 7a84 <_sk_callback_avx+0x130>
DB 197,228,87,219 ; vxorps %ymm3,%ymm3,%ymm3
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
DB 197,212,87,237 ; vxorps %ymm5,%ymm5,%ymm5
@@ -6659,7 +6545,7 @@ _sk_dither_avx LABEL PROC
DB 196,65,121,112,201,0 ; vpshufd $0x0,%xmm9,%xmm9
DB 196,67,53,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
DB 196,65,52,87,208 ; vxorps %ymm8,%ymm9,%ymm10
- DB 196,98,125,24,29,40,121,0,0 ; vbroadcastss 0x7928(%rip),%ymm11 # 7c2c <_sk_callback_avx+0x134>
+ DB 196,98,125,24,29,132,119,0,0 ; vbroadcastss 0x7784(%rip),%ymm11 # 7a88 <_sk_callback_avx+0x134>
DB 196,65,44,84,203 ; vandps %ymm11,%ymm10,%ymm9
DB 196,193,25,114,241,5 ; vpslld $0x5,%xmm9,%xmm12
DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9
@@ -6670,8 +6556,8 @@ _sk_dither_avx LABEL PROC
DB 196,67,125,25,219,1 ; vextractf128 $0x1,%ymm11,%xmm11
DB 196,193,33,114,243,4 ; vpslld $0x4,%xmm11,%xmm11
DB 196,67,29,24,219,1 ; vinsertf128 $0x1,%xmm11,%ymm12,%ymm11
- DB 196,98,125,24,37,233,120,0,0 ; vbroadcastss 0x78e9(%rip),%ymm12 # 7c30 <_sk_callback_avx+0x138>
- DB 196,98,125,24,45,228,120,0,0 ; vbroadcastss 0x78e4(%rip),%ymm13 # 7c34 <_sk_callback_avx+0x13c>
+ DB 196,98,125,24,37,69,119,0,0 ; vbroadcastss 0x7745(%rip),%ymm12 # 7a8c <_sk_callback_avx+0x138>
+ DB 196,98,125,24,45,64,119,0,0 ; vbroadcastss 0x7740(%rip),%ymm13 # 7a90 <_sk_callback_avx+0x13c>
DB 196,65,44,84,245 ; vandps %ymm13,%ymm10,%ymm14
DB 196,193,1,114,246,2 ; vpslld $0x2,%xmm14,%xmm15
DB 196,67,125,25,246,1 ; vextractf128 $0x1,%ymm14,%xmm14
@@ -6698,9 +6584,9 @@ _sk_dither_avx LABEL PROC
DB 196,65,60,86,193 ; vorps %ymm9,%ymm8,%ymm8
DB 196,65,60,86,194 ; vorps %ymm10,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,79,120,0,0 ; vbroadcastss 0x784f(%rip),%ymm9 # 7c38 <_sk_callback_avx+0x140>
+ DB 196,98,125,24,13,171,118,0,0 ; vbroadcastss 0x76ab(%rip),%ymm9 # 7a94 <_sk_callback_avx+0x140>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,69,120,0,0 ; vbroadcastss 0x7845(%rip),%ymm9 # 7c3c <_sk_callback_avx+0x144>
+ DB 196,98,125,24,13,161,118,0,0 ; vbroadcastss 0x76a1(%rip),%ymm9 # 7a98 <_sk_callback_avx+0x144>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 196,98,125,24,8 ; vbroadcastss (%rax),%ymm9
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
@@ -6730,7 +6616,7 @@ _sk_uniform_color_avx LABEL PROC
PUBLIC _sk_black_color_avx
_sk_black_color_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,229,119,0,0 ; vbroadcastss 0x77e5(%rip),%ymm3 # 7c40 <_sk_callback_avx+0x148>
+ DB 196,226,125,24,29,65,118,0,0 ; vbroadcastss 0x7641(%rip),%ymm3 # 7a9c <_sk_callback_avx+0x148>
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 197,236,87,210 ; vxorps %ymm2,%ymm2,%ymm2
@@ -6739,7 +6625,7 @@ _sk_black_color_avx LABEL PROC
PUBLIC _sk_white_color_avx
_sk_white_color_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,208,119,0,0 ; vbroadcastss 0x77d0(%rip),%ymm0 # 7c44 <_sk_callback_avx+0x14c>
+ DB 196,226,125,24,5,44,118,0,0 ; vbroadcastss 0x762c(%rip),%ymm0 # 7aa0 <_sk_callback_avx+0x14c>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 197,252,40,216 ; vmovaps %ymm0,%ymm3
@@ -6777,7 +6663,7 @@ _sk_clear_avx LABEL PROC
PUBLIC _sk_srcatop_avx
_sk_srcatop_avx LABEL PROC
DB 197,252,89,199 ; vmulps %ymm7,%ymm0,%ymm0
- DB 196,98,125,24,5,115,119,0,0 ; vbroadcastss 0x7773(%rip),%ymm8 # 7c48 <_sk_callback_avx+0x150>
+ DB 196,98,125,24,5,207,117,0,0 ; vbroadcastss 0x75cf(%rip),%ymm8 # 7aa4 <_sk_callback_avx+0x150>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -6796,7 +6682,7 @@ _sk_srcatop_avx LABEL PROC
PUBLIC _sk_dstatop_avx
_sk_dstatop_avx LABEL PROC
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
- DB 196,98,125,24,13,53,119,0,0 ; vbroadcastss 0x7735(%rip),%ymm9 # 7c4c <_sk_callback_avx+0x154>
+ DB 196,98,125,24,13,145,117,0,0 ; vbroadcastss 0x7591(%rip),%ymm9 # 7aa8 <_sk_callback_avx+0x154>
DB 197,52,92,207 ; vsubps %ymm7,%ymm9,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,188,88,192 ; vaddps %ymm0,%ymm8,%ymm0
@@ -6832,7 +6718,7 @@ _sk_dstin_avx LABEL PROC
PUBLIC _sk_srcout_avx
_sk_srcout_avx LABEL PROC
- DB 196,98,125,24,5,212,118,0,0 ; vbroadcastss 0x76d4(%rip),%ymm8 # 7c50 <_sk_callback_avx+0x158>
+ DB 196,98,125,24,5,48,117,0,0 ; vbroadcastss 0x7530(%rip),%ymm8 # 7aac <_sk_callback_avx+0x158>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -6843,7 +6729,7 @@ _sk_srcout_avx LABEL PROC
PUBLIC _sk_dstout_avx
_sk_dstout_avx LABEL PROC
- DB 196,226,125,24,5,183,118,0,0 ; vbroadcastss 0x76b7(%rip),%ymm0 # 7c54 <_sk_callback_avx+0x15c>
+ DB 196,226,125,24,5,19,117,0,0 ; vbroadcastss 0x7513(%rip),%ymm0 # 7ab0 <_sk_callback_avx+0x15c>
DB 197,252,92,219 ; vsubps %ymm3,%ymm0,%ymm3
DB 197,228,89,196 ; vmulps %ymm4,%ymm3,%ymm0
DB 197,228,89,205 ; vmulps %ymm5,%ymm3,%ymm1
@@ -6854,7 +6740,7 @@ _sk_dstout_avx LABEL PROC
PUBLIC _sk_srcover_avx
_sk_srcover_avx LABEL PROC
- DB 196,98,125,24,5,154,118,0,0 ; vbroadcastss 0x769a(%rip),%ymm8 # 7c58 <_sk_callback_avx+0x160>
+ DB 196,98,125,24,5,246,116,0,0 ; vbroadcastss 0x74f6(%rip),%ymm8 # 7ab4 <_sk_callback_avx+0x160>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,204 ; vmulps %ymm4,%ymm8,%ymm9
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -6869,7 +6755,7 @@ _sk_srcover_avx LABEL PROC
PUBLIC _sk_dstover_avx
_sk_dstover_avx LABEL PROC
- DB 196,98,125,24,5,109,118,0,0 ; vbroadcastss 0x766d(%rip),%ymm8 # 7c5c <_sk_callback_avx+0x164>
+ DB 196,98,125,24,5,201,116,0,0 ; vbroadcastss 0x74c9(%rip),%ymm8 # 7ab8 <_sk_callback_avx+0x164>
DB 197,60,92,199 ; vsubps %ymm7,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,252,88,196 ; vaddps %ymm4,%ymm0,%ymm0
@@ -6893,7 +6779,7 @@ _sk_modulate_avx LABEL PROC
PUBLIC _sk_multiply_avx
_sk_multiply_avx LABEL PROC
- DB 196,98,125,24,5,44,118,0,0 ; vbroadcastss 0x762c(%rip),%ymm8 # 7c60 <_sk_callback_avx+0x168>
+ DB 196,98,125,24,5,136,116,0,0 ; vbroadcastss 0x7488(%rip),%ymm8 # 7abc <_sk_callback_avx+0x168>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,208 ; vmulps %ymm0,%ymm9,%ymm10
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -6947,7 +6833,7 @@ _sk_screen_avx LABEL PROC
PUBLIC _sk_xor__avx
_sk_xor__avx LABEL PROC
- DB 196,98,125,24,5,123,117,0,0 ; vbroadcastss 0x757b(%rip),%ymm8 # 7c64 <_sk_callback_avx+0x16c>
+ DB 196,98,125,24,5,215,115,0,0 ; vbroadcastss 0x73d7(%rip),%ymm8 # 7ac0 <_sk_callback_avx+0x16c>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,192 ; vmulps %ymm0,%ymm9,%ymm0
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -6982,7 +6868,7 @@ _sk_darken_avx LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,95,209 ; vmaxps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,251,116,0,0 ; vbroadcastss 0x74fb(%rip),%ymm8 # 7c68 <_sk_callback_avx+0x170>
+ DB 196,98,125,24,5,87,115,0,0 ; vbroadcastss 0x7357(%rip),%ymm8 # 7ac4 <_sk_callback_avx+0x170>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -7006,7 +6892,7 @@ _sk_lighten_avx LABEL PROC
DB 197,100,89,206 ; vmulps %ymm6,%ymm3,%ymm9
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,167,116,0,0 ; vbroadcastss 0x74a7(%rip),%ymm8 # 7c6c <_sk_callback_avx+0x174>
+ DB 196,98,125,24,5,3,115,0,0 ; vbroadcastss 0x7303(%rip),%ymm8 # 7ac8 <_sk_callback_avx+0x174>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -7033,7 +6919,7 @@ _sk_difference_avx LABEL PROC
DB 196,193,108,93,209 ; vminps %ymm9,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,71,116,0,0 ; vbroadcastss 0x7447(%rip),%ymm8 # 7c70 <_sk_callback_avx+0x178>
+ DB 196,98,125,24,5,163,114,0,0 ; vbroadcastss 0x72a3(%rip),%ymm8 # 7acc <_sk_callback_avx+0x178>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -7054,7 +6940,7 @@ _sk_exclusion_avx LABEL PROC
DB 197,236,89,214 ; vmulps %ymm6,%ymm2,%ymm2
DB 197,236,88,210 ; vaddps %ymm2,%ymm2,%ymm2
DB 197,188,92,210 ; vsubps %ymm2,%ymm8,%ymm2
- DB 196,98,125,24,5,2,116,0,0 ; vbroadcastss 0x7402(%rip),%ymm8 # 7c74 <_sk_callback_avx+0x17c>
+ DB 196,98,125,24,5,94,114,0,0 ; vbroadcastss 0x725e(%rip),%ymm8 # 7ad0 <_sk_callback_avx+0x17c>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
DB 197,60,89,199 ; vmulps %ymm7,%ymm8,%ymm8
DB 197,188,88,219 ; vaddps %ymm3,%ymm8,%ymm3
@@ -7063,7 +6949,7 @@ _sk_exclusion_avx LABEL PROC
PUBLIC _sk_colorburn_avx
_sk_colorburn_avx LABEL PROC
- DB 196,98,125,24,5,237,115,0,0 ; vbroadcastss 0x73ed(%rip),%ymm8 # 7c78 <_sk_callback_avx+0x180>
+ DB 196,98,125,24,5,73,114,0,0 ; vbroadcastss 0x7249(%rip),%ymm8 # 7ad4 <_sk_callback_avx+0x180>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,52,89,216 ; vmulps %ymm0,%ymm9,%ymm11
DB 196,65,44,87,210 ; vxorps %ymm10,%ymm10,%ymm10
@@ -7123,7 +7009,7 @@ _sk_colorburn_avx LABEL PROC
PUBLIC _sk_colordodge_avx
_sk_colordodge_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
- DB 196,98,125,24,13,233,114,0,0 ; vbroadcastss 0x72e9(%rip),%ymm9 # 7c7c <_sk_callback_avx+0x184>
+ DB 196,98,125,24,13,69,113,0,0 ; vbroadcastss 0x7145(%rip),%ymm9 # 7ad8 <_sk_callback_avx+0x184>
DB 197,52,92,215 ; vsubps %ymm7,%ymm9,%ymm10
DB 197,44,89,216 ; vmulps %ymm0,%ymm10,%ymm11
DB 197,52,92,203 ; vsubps %ymm3,%ymm9,%ymm9
@@ -7178,7 +7064,7 @@ _sk_colordodge_avx LABEL PROC
PUBLIC _sk_hardlight_avx
_sk_hardlight_avx LABEL PROC
- DB 196,98,125,24,5,251,113,0,0 ; vbroadcastss 0x71fb(%rip),%ymm8 # 7c80 <_sk_callback_avx+0x188>
+ DB 196,98,125,24,5,87,112,0,0 ; vbroadcastss 0x7057(%rip),%ymm8 # 7adc <_sk_callback_avx+0x188>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -7231,7 +7117,7 @@ _sk_hardlight_avx LABEL PROC
PUBLIC _sk_overlay_avx
_sk_overlay_avx LABEL PROC
- DB 196,98,125,24,5,36,113,0,0 ; vbroadcastss 0x7124(%rip),%ymm8 # 7c84 <_sk_callback_avx+0x18c>
+ DB 196,98,125,24,5,128,111,0,0 ; vbroadcastss 0x6f80(%rip),%ymm8 # 7ae0 <_sk_callback_avx+0x18c>
DB 197,60,92,215 ; vsubps %ymm7,%ymm8,%ymm10
DB 197,44,89,200 ; vmulps %ymm0,%ymm10,%ymm9
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -7296,10 +7182,10 @@ _sk_softlight_avx LABEL PROC
DB 196,65,60,88,192 ; vaddps %ymm8,%ymm8,%ymm8
DB 196,65,60,89,216 ; vmulps %ymm8,%ymm8,%ymm11
DB 196,65,60,88,195 ; vaddps %ymm11,%ymm8,%ymm8
- DB 196,98,125,24,29,23,112,0,0 ; vbroadcastss 0x7017(%rip),%ymm11 # 7c8c <_sk_callback_avx+0x194>
+ DB 196,98,125,24,29,115,110,0,0 ; vbroadcastss 0x6e73(%rip),%ymm11 # 7ae8 <_sk_callback_avx+0x194>
DB 196,65,28,88,235 ; vaddps %ymm11,%ymm12,%ymm13
DB 196,65,20,89,192 ; vmulps %ymm8,%ymm13,%ymm8
- DB 196,98,125,24,45,8,112,0,0 ; vbroadcastss 0x7008(%rip),%ymm13 # 7c90 <_sk_callback_avx+0x198>
+ DB 196,98,125,24,45,100,110,0,0 ; vbroadcastss 0x6e64(%rip),%ymm13 # 7aec <_sk_callback_avx+0x198>
DB 196,65,28,89,245 ; vmulps %ymm13,%ymm12,%ymm14
DB 196,65,12,88,192 ; vaddps %ymm8,%ymm14,%ymm8
DB 196,65,124,82,244 ; vrsqrtps %ymm12,%ymm14
@@ -7310,7 +7196,7 @@ _sk_softlight_avx LABEL PROC
DB 197,4,194,255,2 ; vcmpleps %ymm7,%ymm15,%ymm15
DB 196,67,13,74,240,240 ; vblendvps %ymm15,%ymm8,%ymm14,%ymm14
DB 197,116,88,249 ; vaddps %ymm1,%ymm1,%ymm15
- DB 196,98,125,24,5,198,111,0,0 ; vbroadcastss 0x6fc6(%rip),%ymm8 # 7c88 <_sk_callback_avx+0x190>
+ DB 196,98,125,24,5,34,110,0,0 ; vbroadcastss 0x6e22(%rip),%ymm8 # 7ae4 <_sk_callback_avx+0x190>
DB 196,65,60,92,228 ; vsubps %ymm12,%ymm8,%ymm12
DB 197,132,92,195 ; vsubps %ymm3,%ymm15,%ymm0
DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12
@@ -7437,12 +7323,12 @@ _sk_hue_avx LABEL PROC
DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11
DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11
DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- DB 196,98,125,24,53,144,109,0,0 ; vbroadcastss 0x6d90(%rip),%ymm14 # 7c94 <_sk_callback_avx+0x19c>
+ DB 196,98,125,24,53,236,107,0,0 ; vbroadcastss 0x6bec(%rip),%ymm14 # 7af0 <_sk_callback_avx+0x19c>
DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11
- DB 196,98,125,24,61,134,109,0,0 ; vbroadcastss 0x6d86(%rip),%ymm15 # 7c98 <_sk_callback_avx+0x1a0>
+ DB 196,98,125,24,61,226,107,0,0 ; vbroadcastss 0x6be2(%rip),%ymm15 # 7af4 <_sk_callback_avx+0x1a0>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
- DB 196,226,125,24,5,119,109,0,0 ; vbroadcastss 0x6d77(%rip),%ymm0 # 7c9c <_sk_callback_avx+0x1a4>
+ DB 196,226,125,24,5,211,107,0,0 ; vbroadcastss 0x6bd3(%rip),%ymm0 # 7af8 <_sk_callback_avx+0x1a4>
DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13
@@ -7503,7 +7389,7 @@ _sk_hue_avx LABEL PROC
DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10
DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,80,108,0,0 ; vbroadcastss 0x6c50(%rip),%ymm8 # 7ca0 <_sk_callback_avx+0x1a8>
+ DB 196,98,125,24,5,172,106,0,0 ; vbroadcastss 0x6aac(%rip),%ymm8 # 7afc <_sk_callback_avx+0x1a8>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -7560,12 +7446,12 @@ _sk_saturation_avx LABEL PROC
DB 196,65,28,89,219 ; vmulps %ymm11,%ymm12,%ymm11
DB 196,65,36,94,222 ; vdivps %ymm14,%ymm11,%ymm11
DB 196,67,37,74,224,240 ; vblendvps %ymm15,%ymm8,%ymm11,%ymm12
- DB 196,98,125,24,53,88,107,0,0 ; vbroadcastss 0x6b58(%rip),%ymm14 # 7ca4 <_sk_callback_avx+0x1ac>
+ DB 196,98,125,24,53,180,105,0,0 ; vbroadcastss 0x69b4(%rip),%ymm14 # 7b00 <_sk_callback_avx+0x1ac>
DB 196,65,92,89,222 ; vmulps %ymm14,%ymm4,%ymm11
- DB 196,98,125,24,61,78,107,0,0 ; vbroadcastss 0x6b4e(%rip),%ymm15 # 7ca8 <_sk_callback_avx+0x1b0>
+ DB 196,98,125,24,61,170,105,0,0 ; vbroadcastss 0x69aa(%rip),%ymm15 # 7b04 <_sk_callback_avx+0x1b0>
DB 196,65,84,89,239 ; vmulps %ymm15,%ymm5,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
- DB 196,226,125,24,5,63,107,0,0 ; vbroadcastss 0x6b3f(%rip),%ymm0 # 7cac <_sk_callback_avx+0x1b4>
+ DB 196,226,125,24,5,155,105,0,0 ; vbroadcastss 0x699b(%rip),%ymm0 # 7b08 <_sk_callback_avx+0x1b4>
DB 197,76,89,232 ; vmulps %ymm0,%ymm6,%ymm13
DB 196,65,36,88,221 ; vaddps %ymm13,%ymm11,%ymm11
DB 196,65,52,89,238 ; vmulps %ymm14,%ymm9,%ymm13
@@ -7626,7 +7512,7 @@ _sk_saturation_avx LABEL PROC
DB 196,65,36,95,208 ; vmaxps %ymm8,%ymm11,%ymm10
DB 196,195,109,74,209,240 ; vblendvps %ymm15,%ymm9,%ymm2,%ymm2
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,24,106,0,0 ; vbroadcastss 0x6a18(%rip),%ymm8 # 7cb0 <_sk_callback_avx+0x1b8>
+ DB 196,98,125,24,5,116,104,0,0 ; vbroadcastss 0x6874(%rip),%ymm8 # 7b0c <_sk_callback_avx+0x1b8>
DB 197,60,92,207 ; vsubps %ymm7,%ymm8,%ymm9
DB 197,180,89,201 ; vmulps %ymm1,%ymm9,%ymm1
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
@@ -7655,12 +7541,12 @@ _sk_color_avx LABEL PROC
DB 197,252,17,68,36,32 ; vmovups %ymm0,0x20(%rsp)
DB 197,124,89,199 ; vmulps %ymm7,%ymm0,%ymm8
DB 197,116,89,207 ; vmulps %ymm7,%ymm1,%ymm9
- DB 196,98,125,24,45,168,105,0,0 ; vbroadcastss 0x69a8(%rip),%ymm13 # 7cb4 <_sk_callback_avx+0x1bc>
+ DB 196,98,125,24,45,4,104,0,0 ; vbroadcastss 0x6804(%rip),%ymm13 # 7b10 <_sk_callback_avx+0x1bc>
DB 196,65,92,89,213 ; vmulps %ymm13,%ymm4,%ymm10
- DB 196,98,125,24,53,158,105,0,0 ; vbroadcastss 0x699e(%rip),%ymm14 # 7cb8 <_sk_callback_avx+0x1c0>
+ DB 196,98,125,24,53,250,103,0,0 ; vbroadcastss 0x67fa(%rip),%ymm14 # 7b14 <_sk_callback_avx+0x1c0>
DB 196,65,84,89,222 ; vmulps %ymm14,%ymm5,%ymm11
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,61,143,105,0,0 ; vbroadcastss 0x698f(%rip),%ymm15 # 7cbc <_sk_callback_avx+0x1c4>
+ DB 196,98,125,24,61,235,103,0,0 ; vbroadcastss 0x67eb(%rip),%ymm15 # 7b18 <_sk_callback_avx+0x1c4>
DB 196,65,76,89,223 ; vmulps %ymm15,%ymm6,%ymm11
DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0
DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11
@@ -7723,7 +7609,7 @@ _sk_color_avx LABEL PROC
DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9
DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0
DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8
- DB 196,226,125,24,5,86,104,0,0 ; vbroadcastss 0x6856(%rip),%ymm0 # 7cc0 <_sk_callback_avx+0x1c8>
+ DB 196,226,125,24,5,178,102,0,0 ; vbroadcastss 0x66b2(%rip),%ymm0 # 7b1c <_sk_callback_avx+0x1c8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,84,36,32 ; vmulps 0x20(%rsp),%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -7753,12 +7639,12 @@ _sk_luminosity_avx LABEL PROC
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 197,100,89,196 ; vmulps %ymm4,%ymm3,%ymm8
DB 197,100,89,205 ; vmulps %ymm5,%ymm3,%ymm9
- DB 196,98,125,24,45,226,103,0,0 ; vbroadcastss 0x67e2(%rip),%ymm13 # 7cc4 <_sk_callback_avx+0x1cc>
+ DB 196,98,125,24,45,62,102,0,0 ; vbroadcastss 0x663e(%rip),%ymm13 # 7b20 <_sk_callback_avx+0x1cc>
DB 196,65,108,89,213 ; vmulps %ymm13,%ymm2,%ymm10
- DB 196,98,125,24,53,216,103,0,0 ; vbroadcastss 0x67d8(%rip),%ymm14 # 7cc8 <_sk_callback_avx+0x1d0>
+ DB 196,98,125,24,53,52,102,0,0 ; vbroadcastss 0x6634(%rip),%ymm14 # 7b24 <_sk_callback_avx+0x1d0>
DB 196,65,116,89,222 ; vmulps %ymm14,%ymm1,%ymm11
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,61,201,103,0,0 ; vbroadcastss 0x67c9(%rip),%ymm15 # 7ccc <_sk_callback_avx+0x1d4>
+ DB 196,98,125,24,61,37,102,0,0 ; vbroadcastss 0x6625(%rip),%ymm15 # 7b28 <_sk_callback_avx+0x1d4>
DB 196,65,28,89,223 ; vmulps %ymm15,%ymm12,%ymm11
DB 196,193,44,88,195 ; vaddps %ymm11,%ymm10,%ymm0
DB 196,65,60,89,221 ; vmulps %ymm13,%ymm8,%ymm11
@@ -7821,7 +7707,7 @@ _sk_luminosity_avx LABEL PROC
DB 196,65,44,95,207 ; vmaxps %ymm15,%ymm10,%ymm9
DB 196,195,37,74,192,0 ; vblendvps %ymm0,%ymm8,%ymm11,%ymm0
DB 196,65,124,95,199 ; vmaxps %ymm15,%ymm0,%ymm8
- DB 196,226,125,24,5,144,102,0,0 ; vbroadcastss 0x6690(%rip),%ymm0 # 7cd0 <_sk_callback_avx+0x1d8>
+ DB 196,226,125,24,5,236,100,0,0 ; vbroadcastss 0x64ec(%rip),%ymm0 # 7b2c <_sk_callback_avx+0x1d8>
DB 197,124,92,215 ; vsubps %ymm7,%ymm0,%ymm10
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 197,124,92,219 ; vsubps %ymm3,%ymm0,%ymm11
@@ -7852,7 +7738,7 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 15,133,47,1,0,0 ; jne 17da <_sk_srcover_rgba_8888_avx+0x14c>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,124,40,13,40,108,0,0 ; vmovaps 0x6c28(%rip),%ymm9 # 82e0 <_sk_callback_avx+0x7e8>
+ DB 197,124,40,13,136,106,0,0 ; vmovaps 0x6a88(%rip),%ymm9 # 8140 <_sk_callback_avx+0x7ec>
DB 196,193,68,84,225 ; vandps %ymm9,%ymm7,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
DB 197,209,114,215,8 ; vpsrld $0x8,%xmm7,%xmm5
@@ -7870,9 +7756,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7
DB 196,227,53,24,255,1 ; vinsertf128 $0x1,%xmm7,%ymm9,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,187,101,0,0 ; vbroadcastss 0x65bb(%rip),%ymm8 # 7cd4 <_sk_callback_avx+0x1dc>
+ DB 196,98,125,24,5,23,100,0,0 ; vbroadcastss 0x6417(%rip),%ymm8 # 7b30 <_sk_callback_avx+0x1dc>
DB 197,60,92,195 ; vsubps %ymm3,%ymm8,%ymm8
- DB 196,98,125,24,13,178,101,0,0 ; vbroadcastss 0x65b2(%rip),%ymm9 # 7cd8 <_sk_callback_avx+0x1e0>
+ DB 196,98,125,24,13,14,100,0,0 ; vbroadcastss 0x640e(%rip),%ymm9 # 7b34 <_sk_callback_avx+0x1e0>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 197,60,89,212 ; vmulps %ymm4,%ymm8,%ymm10
DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0
@@ -7918,9 +7804,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,121,48,228 ; vpmovzxbw %xmm4,%xmm4
- DB 196,226,89,0,45,30,105,0,0 ; vpshufb 0x691e(%rip),%xmm4,%xmm5 # 8120 <_sk_callback_avx+0x628>
+ DB 196,226,89,0,45,110,103,0,0 ; vpshufb 0x676e(%rip),%xmm4,%xmm5 # 7f70 <_sk_callback_avx+0x61c>
DB 196,226,121,33,237 ; vpmovsxbd %xmm5,%xmm5
- DB 196,226,89,0,37,32,105,0,0 ; vpshufb 0x6920(%rip),%xmm4,%xmm4 # 8130 <_sk_callback_avx+0x638>
+ DB 196,226,89,0,37,112,103,0,0 ; vpshufb 0x6770(%rip),%xmm4,%xmm4 # 7f80 <_sk_callback_avx+0x62c>
DB 196,226,121,33,228 ; vpmovsxbd %xmm4,%xmm4
DB 196,227,85,24,228,1 ; vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
@@ -7932,9 +7818,9 @@ _sk_srcover_rgba_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,211,104,0,0 ; vpshufb 0x68d3(%rip),%xmm9,%xmm10 # 8120 <_sk_callback_avx+0x628>
+ DB 196,98,49,0,21,35,103,0,0 ; vpshufb 0x6723(%rip),%xmm9,%xmm10 # 7f70 <_sk_callback_avx+0x61c>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,213,104,0,0 ; vpshufb 0x68d5(%rip),%xmm9,%xmm9 # 8130 <_sk_callback_avx+0x638>
+ DB 196,98,49,0,13,37,103,0,0 ; vpshufb 0x6725(%rip),%xmm9,%xmm9 # 7f80 <_sk_callback_avx+0x62c>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
@@ -7952,7 +7838,7 @@ _sk_clamp_0_avx LABEL PROC
PUBLIC _sk_clamp_1_avx
_sk_clamp_1_avx LABEL PROC
- DB 196,98,125,24,5,70,100,0,0 ; vbroadcastss 0x6446(%rip),%ymm8 # 7cdc <_sk_callback_avx+0x1e4>
+ DB 196,98,125,24,5,162,98,0,0 ; vbroadcastss 0x62a2(%rip),%ymm8 # 7b38 <_sk_callback_avx+0x1e4>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
@@ -7962,7 +7848,7 @@ _sk_clamp_1_avx LABEL PROC
PUBLIC _sk_clamp_a_avx
_sk_clamp_a_avx LABEL PROC
- DB 196,98,125,24,5,41,100,0,0 ; vbroadcastss 0x6429(%rip),%ymm8 # 7ce0 <_sk_callback_avx+0x1e8>
+ DB 196,98,125,24,5,133,98,0,0 ; vbroadcastss 0x6285(%rip),%ymm8 # 7b3c <_sk_callback_avx+0x1e8>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 197,252,93,195 ; vminps %ymm3,%ymm0,%ymm0
DB 197,244,93,203 ; vminps %ymm3,%ymm1,%ymm1
@@ -7972,7 +7858,7 @@ _sk_clamp_a_avx LABEL PROC
PUBLIC _sk_clamp_a_dst_avx
_sk_clamp_a_dst_avx LABEL PROC
- DB 196,98,125,24,5,15,100,0,0 ; vbroadcastss 0x640f(%rip),%ymm8 # 7ce4 <_sk_callback_avx+0x1ec>
+ DB 196,98,125,24,5,107,98,0,0 ; vbroadcastss 0x626b(%rip),%ymm8 # 7b40 <_sk_callback_avx+0x1ec>
DB 196,193,68,93,248 ; vminps %ymm8,%ymm7,%ymm7
DB 197,220,93,231 ; vminps %ymm7,%ymm4,%ymm4
DB 197,212,93,239 ; vminps %ymm7,%ymm5,%ymm5
@@ -8027,7 +7913,7 @@ PUBLIC _sk_unpremul_avx
_sk_unpremul_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,65,100,194,200,0 ; vcmpeqps %ymm8,%ymm3,%ymm9
- DB 196,98,125,24,21,139,99,0,0 ; vbroadcastss 0x638b(%rip),%ymm10 # 7ce8 <_sk_callback_avx+0x1f0>
+ DB 196,98,125,24,21,231,97,0,0 ; vbroadcastss 0x61e7(%rip),%ymm10 # 7b44 <_sk_callback_avx+0x1f0>
DB 197,44,94,211 ; vdivps %ymm3,%ymm10,%ymm10
DB 196,67,45,74,192,144 ; vblendvps %ymm9,%ymm8,%ymm10,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
@@ -8038,17 +7924,17 @@ _sk_unpremul_avx LABEL PROC
PUBLIC _sk_from_srgb_avx
_sk_from_srgb_avx LABEL PROC
- DB 196,98,125,24,5,108,99,0,0 ; vbroadcastss 0x636c(%rip),%ymm8 # 7cec <_sk_callback_avx+0x1f4>
+ DB 196,98,125,24,5,200,97,0,0 ; vbroadcastss 0x61c8(%rip),%ymm8 # 7b48 <_sk_callback_avx+0x1f4>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 197,124,89,208 ; vmulps %ymm0,%ymm0,%ymm10
- DB 196,98,125,24,29,94,99,0,0 ; vbroadcastss 0x635e(%rip),%ymm11 # 7cf0 <_sk_callback_avx+0x1f8>
+ DB 196,98,125,24,29,186,97,0,0 ; vbroadcastss 0x61ba(%rip),%ymm11 # 7b4c <_sk_callback_avx+0x1f8>
DB 196,65,124,89,227 ; vmulps %ymm11,%ymm0,%ymm12
- DB 196,98,125,24,45,84,99,0,0 ; vbroadcastss 0x6354(%rip),%ymm13 # 7cf4 <_sk_callback_avx+0x1fc>
+ DB 196,98,125,24,45,176,97,0,0 ; vbroadcastss 0x61b0(%rip),%ymm13 # 7b50 <_sk_callback_avx+0x1fc>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,44,89,212 ; vmulps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,69,99,0,0 ; vbroadcastss 0x6345(%rip),%ymm12 # 7cf8 <_sk_callback_avx+0x200>
+ DB 196,98,125,24,37,161,97,0,0 ; vbroadcastss 0x61a1(%rip),%ymm12 # 7b54 <_sk_callback_avx+0x200>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,53,59,99,0,0 ; vbroadcastss 0x633b(%rip),%ymm14 # 7cfc <_sk_callback_avx+0x204>
+ DB 196,98,125,24,53,151,97,0,0 ; vbroadcastss 0x6197(%rip),%ymm14 # 7b58 <_sk_callback_avx+0x204>
DB 196,193,124,194,198,1 ; vcmpltps %ymm14,%ymm0,%ymm0
DB 196,195,45,74,193,0 ; vblendvps %ymm0,%ymm9,%ymm10,%ymm0
DB 196,65,116,89,200 ; vmulps %ymm8,%ymm1,%ymm9
@@ -8072,17 +7958,17 @@ _sk_from_srgb_avx LABEL PROC
PUBLIC _sk_from_srgb_dst_avx
_sk_from_srgb_dst_avx LABEL PROC
- DB 196,98,125,24,5,212,98,0,0 ; vbroadcastss 0x62d4(%rip),%ymm8 # 7d00 <_sk_callback_avx+0x208>
+ DB 196,98,125,24,5,48,97,0,0 ; vbroadcastss 0x6130(%rip),%ymm8 # 7b5c <_sk_callback_avx+0x208>
DB 196,65,92,89,200 ; vmulps %ymm8,%ymm4,%ymm9
DB 197,92,89,212 ; vmulps %ymm4,%ymm4,%ymm10
- DB 196,98,125,24,29,198,98,0,0 ; vbroadcastss 0x62c6(%rip),%ymm11 # 7d04 <_sk_callback_avx+0x20c>
+ DB 196,98,125,24,29,34,97,0,0 ; vbroadcastss 0x6122(%rip),%ymm11 # 7b60 <_sk_callback_avx+0x20c>
DB 196,65,92,89,227 ; vmulps %ymm11,%ymm4,%ymm12
- DB 196,98,125,24,45,188,98,0,0 ; vbroadcastss 0x62bc(%rip),%ymm13 # 7d08 <_sk_callback_avx+0x210>
+ DB 196,98,125,24,45,24,97,0,0 ; vbroadcastss 0x6118(%rip),%ymm13 # 7b64 <_sk_callback_avx+0x210>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,44,89,212 ; vmulps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,37,173,98,0,0 ; vbroadcastss 0x62ad(%rip),%ymm12 # 7d0c <_sk_callback_avx+0x214>
+ DB 196,98,125,24,37,9,97,0,0 ; vbroadcastss 0x6109(%rip),%ymm12 # 7b68 <_sk_callback_avx+0x214>
DB 196,65,44,88,212 ; vaddps %ymm12,%ymm10,%ymm10
- DB 196,98,125,24,53,163,98,0,0 ; vbroadcastss 0x62a3(%rip),%ymm14 # 7d10 <_sk_callback_avx+0x218>
+ DB 196,98,125,24,53,255,96,0,0 ; vbroadcastss 0x60ff(%rip),%ymm14 # 7b6c <_sk_callback_avx+0x218>
DB 196,193,92,194,230,1 ; vcmpltps %ymm14,%ymm4,%ymm4
DB 196,195,45,74,225,64 ; vblendvps %ymm4,%ymm9,%ymm10,%ymm4
DB 196,65,84,89,200 ; vmulps %ymm8,%ymm5,%ymm9
@@ -8107,20 +7993,20 @@ _sk_from_srgb_dst_avx LABEL PROC
PUBLIC _sk_to_srgb_avx
_sk_to_srgb_avx LABEL PROC
DB 197,124,82,200 ; vrsqrtps %ymm0,%ymm9
- DB 196,98,125,24,5,56,98,0,0 ; vbroadcastss 0x6238(%rip),%ymm8 # 7d14 <_sk_callback_avx+0x21c>
+ DB 196,98,125,24,5,148,96,0,0 ; vbroadcastss 0x6094(%rip),%ymm8 # 7b70 <_sk_callback_avx+0x21c>
DB 196,65,124,89,208 ; vmulps %ymm8,%ymm0,%ymm10
- DB 196,98,125,24,29,46,98,0,0 ; vbroadcastss 0x622e(%rip),%ymm11 # 7d18 <_sk_callback_avx+0x220>
+ DB 196,98,125,24,29,138,96,0,0 ; vbroadcastss 0x608a(%rip),%ymm11 # 7b74 <_sk_callback_avx+0x220>
DB 196,65,52,89,227 ; vmulps %ymm11,%ymm9,%ymm12
- DB 196,98,125,24,45,36,98,0,0 ; vbroadcastss 0x6224(%rip),%ymm13 # 7d1c <_sk_callback_avx+0x224>
+ DB 196,98,125,24,45,128,96,0,0 ; vbroadcastss 0x6080(%rip),%ymm13 # 7b78 <_sk_callback_avx+0x224>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,52,89,228 ; vmulps %ymm12,%ymm9,%ymm12
- DB 196,98,125,24,53,21,98,0,0 ; vbroadcastss 0x6215(%rip),%ymm14 # 7d20 <_sk_callback_avx+0x228>
+ DB 196,98,125,24,53,113,96,0,0 ; vbroadcastss 0x6071(%rip),%ymm14 # 7b7c <_sk_callback_avx+0x228>
DB 196,65,28,88,230 ; vaddps %ymm14,%ymm12,%ymm12
- DB 196,98,125,24,61,11,98,0,0 ; vbroadcastss 0x620b(%rip),%ymm15 # 7d24 <_sk_callback_avx+0x22c>
+ DB 196,98,125,24,61,103,96,0,0 ; vbroadcastss 0x6067(%rip),%ymm15 # 7b80 <_sk_callback_avx+0x22c>
DB 196,65,52,88,207 ; vaddps %ymm15,%ymm9,%ymm9
DB 196,65,124,83,201 ; vrcpps %ymm9,%ymm9
DB 196,65,52,89,204 ; vmulps %ymm12,%ymm9,%ymm9
- DB 196,98,125,24,37,247,97,0,0 ; vbroadcastss 0x61f7(%rip),%ymm12 # 7d28 <_sk_callback_avx+0x230>
+ DB 196,98,125,24,37,83,96,0,0 ; vbroadcastss 0x6053(%rip),%ymm12 # 7b84 <_sk_callback_avx+0x230>
DB 196,193,124,194,196,1 ; vcmpltps %ymm12,%ymm0,%ymm0
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 197,124,82,201 ; vrsqrtps %ymm1,%ymm9
@@ -8155,7 +8041,7 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 197,124,93,201 ; vminps %ymm1,%ymm0,%ymm9
DB 197,52,93,202 ; vminps %ymm2,%ymm9,%ymm9
DB 196,65,60,92,209 ; vsubps %ymm9,%ymm8,%ymm10
- DB 196,98,125,24,29,93,97,0,0 ; vbroadcastss 0x615d(%rip),%ymm11 # 7d2c <_sk_callback_avx+0x234>
+ DB 196,98,125,24,29,185,95,0,0 ; vbroadcastss 0x5fb9(%rip),%ymm11 # 7b88 <_sk_callback_avx+0x234>
DB 196,65,36,94,218 ; vdivps %ymm10,%ymm11,%ymm11
DB 197,116,92,226 ; vsubps %ymm2,%ymm1,%ymm12
DB 196,65,28,89,227 ; vmulps %ymm11,%ymm12,%ymm12
@@ -8165,19 +8051,19 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2
DB 197,252,92,201 ; vsubps %ymm1,%ymm0,%ymm1
DB 196,193,116,89,203 ; vmulps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,54,97,0,0 ; vbroadcastss 0x6136(%rip),%ymm11 # 7d38 <_sk_callback_avx+0x240>
+ DB 196,98,125,24,29,146,95,0,0 ; vbroadcastss 0x5f92(%rip),%ymm11 # 7b94 <_sk_callback_avx+0x240>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,36,97,0,0 ; vbroadcastss 0x6124(%rip),%ymm11 # 7d34 <_sk_callback_avx+0x23c>
+ DB 196,98,125,24,29,128,95,0,0 ; vbroadcastss 0x5f80(%rip),%ymm11 # 7b90 <_sk_callback_avx+0x23c>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,227,117,74,202,224 ; vblendvps %ymm14,%ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,12,97,0,0 ; vbroadcastss 0x610c(%rip),%ymm2 # 7d30 <_sk_callback_avx+0x238>
+ DB 196,226,125,24,21,104,95,0,0 ; vbroadcastss 0x5f68(%rip),%ymm2 # 7b8c <_sk_callback_avx+0x238>
DB 196,65,12,87,246 ; vxorps %ymm14,%ymm14,%ymm14
DB 196,227,13,74,210,208 ; vblendvps %ymm13,%ymm2,%ymm14,%ymm2
DB 197,188,194,192,0 ; vcmpeqps %ymm0,%ymm8,%ymm0
DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2
DB 196,227,117,74,194,0 ; vblendvps %ymm0,%ymm2,%ymm1,%ymm0
DB 196,193,60,88,201 ; vaddps %ymm9,%ymm8,%ymm1
- DB 196,98,125,24,37,243,96,0,0 ; vbroadcastss 0x60f3(%rip),%ymm12 # 7d40 <_sk_callback_avx+0x248>
+ DB 196,98,125,24,37,79,95,0,0 ; vbroadcastss 0x5f4f(%rip),%ymm12 # 7b9c <_sk_callback_avx+0x248>
DB 196,193,116,89,212 ; vmulps %ymm12,%ymm1,%ymm2
DB 197,28,194,226,1 ; vcmpltps %ymm2,%ymm12,%ymm12
DB 196,65,36,92,216 ; vsubps %ymm8,%ymm11,%ymm11
@@ -8187,7 +8073,7 @@ _sk_rgb_to_hsl_avx LABEL PROC
DB 197,172,94,201 ; vdivps %ymm1,%ymm10,%ymm1
DB 196,195,125,74,198,128 ; vblendvps %ymm8,%ymm14,%ymm0,%ymm0
DB 196,195,117,74,206,128 ; vblendvps %ymm8,%ymm14,%ymm1,%ymm1
- DB 196,98,125,24,5,182,96,0,0 ; vbroadcastss 0x60b6(%rip),%ymm8 # 7d3c <_sk_callback_avx+0x244>
+ DB 196,98,125,24,5,18,95,0,0 ; vbroadcastss 0x5f12(%rip),%ymm8 # 7b98 <_sk_callback_avx+0x244>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -8202,7 +8088,7 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,252,17,28,36 ; vmovups %ymm3,(%rsp)
DB 197,252,40,225 ; vmovaps %ymm1,%ymm4
DB 197,252,40,216 ; vmovaps %ymm0,%ymm3
- DB 196,98,125,24,5,125,96,0,0 ; vbroadcastss 0x607d(%rip),%ymm8 # 7d44 <_sk_callback_avx+0x24c>
+ DB 196,98,125,24,5,217,94,0,0 ; vbroadcastss 0x5ed9(%rip),%ymm8 # 7ba0 <_sk_callback_avx+0x24c>
DB 197,60,194,202,2 ; vcmpleps %ymm2,%ymm8,%ymm9
DB 197,92,89,210 ; vmulps %ymm2,%ymm4,%ymm10
DB 196,65,92,92,218 ; vsubps %ymm10,%ymm4,%ymm11
@@ -8210,23 +8096,23 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,52,88,210 ; vaddps %ymm2,%ymm9,%ymm10
DB 197,108,88,202 ; vaddps %ymm2,%ymm2,%ymm9
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,29,87,96,0,0 ; vbroadcastss 0x6057(%rip),%ymm11 # 7d48 <_sk_callback_avx+0x250>
+ DB 196,98,125,24,29,179,94,0,0 ; vbroadcastss 0x5eb3(%rip),%ymm11 # 7ba4 <_sk_callback_avx+0x250>
DB 196,65,100,88,219 ; vaddps %ymm11,%ymm3,%ymm11
DB 196,67,125,8,227,1 ; vroundps $0x1,%ymm11,%ymm12
DB 196,65,36,92,252 ; vsubps %ymm12,%ymm11,%ymm15
DB 196,65,44,92,217 ; vsubps %ymm9,%ymm10,%ymm11
- DB 196,98,125,24,37,65,96,0,0 ; vbroadcastss 0x6041(%rip),%ymm12 # 7d50 <_sk_callback_avx+0x258>
+ DB 196,98,125,24,37,157,94,0,0 ; vbroadcastss 0x5e9d(%rip),%ymm12 # 7bac <_sk_callback_avx+0x258>
DB 196,193,4,89,196 ; vmulps %ymm12,%ymm15,%ymm0
- DB 196,98,125,24,45,55,96,0,0 ; vbroadcastss 0x6037(%rip),%ymm13 # 7d54 <_sk_callback_avx+0x25c>
+ DB 196,98,125,24,45,147,94,0,0 ; vbroadcastss 0x5e93(%rip),%ymm13 # 7bb0 <_sk_callback_avx+0x25c>
DB 197,20,92,240 ; vsubps %ymm0,%ymm13,%ymm14
DB 196,65,36,89,246 ; vmulps %ymm14,%ymm11,%ymm14
DB 196,65,52,88,246 ; vaddps %ymm14,%ymm9,%ymm14
- DB 196,226,125,24,13,24,96,0,0 ; vbroadcastss 0x6018(%rip),%ymm1 # 7d4c <_sk_callback_avx+0x254>
+ DB 196,226,125,24,13,116,94,0,0 ; vbroadcastss 0x5e74(%rip),%ymm1 # 7ba8 <_sk_callback_avx+0x254>
DB 196,193,116,194,255,2 ; vcmpleps %ymm15,%ymm1,%ymm7
DB 196,195,13,74,249,112 ; vblendvps %ymm7,%ymm9,%ymm14,%ymm7
DB 196,65,60,194,247,2 ; vcmpleps %ymm15,%ymm8,%ymm14
DB 196,227,45,74,255,224 ; vblendvps %ymm14,%ymm7,%ymm10,%ymm7
- DB 196,98,125,24,53,3,96,0,0 ; vbroadcastss 0x6003(%rip),%ymm14 # 7d58 <_sk_callback_avx+0x260>
+ DB 196,98,125,24,53,95,94,0,0 ; vbroadcastss 0x5e5f(%rip),%ymm14 # 7bb4 <_sk_callback_avx+0x260>
DB 196,65,12,194,255,2 ; vcmpleps %ymm15,%ymm14,%ymm15
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,180,88,192 ; vaddps %ymm0,%ymm9,%ymm0
@@ -8245,7 +8131,7 @@ _sk_hsl_to_rgb_avx LABEL PROC
DB 197,164,89,247 ; vmulps %ymm7,%ymm11,%ymm6
DB 197,180,88,246 ; vaddps %ymm6,%ymm9,%ymm6
DB 196,227,77,74,237,0 ; vblendvps %ymm0,%ymm5,%ymm6,%ymm5
- DB 196,226,125,24,5,165,95,0,0 ; vbroadcastss 0x5fa5(%rip),%ymm0 # 7d5c <_sk_callback_avx+0x264>
+ DB 196,226,125,24,5,1,94,0,0 ; vbroadcastss 0x5e01(%rip),%ymm0 # 7bb8 <_sk_callback_avx+0x264>
DB 197,228,88,192 ; vaddps %ymm0,%ymm3,%ymm0
DB 196,227,125,8,216,1 ; vroundps $0x1,%ymm0,%ymm3
DB 197,252,92,195 ; vsubps %ymm3,%ymm0,%ymm0
@@ -8293,13 +8179,13 @@ _sk_scale_u8_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,74 ; jne 1eb4 <_sk_scale_u8_avx+0x54>
DB 196,66,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm8
- DB 197,57,219,5,200,98,0,0 ; vpand 0x62c8(%rip),%xmm8,%xmm8 # 8140 <_sk_callback_avx+0x648>
+ DB 197,57,219,5,24,97,0,0 ; vpand 0x6118(%rip),%xmm8,%xmm8 # 7f90 <_sk_callback_avx+0x63c>
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 196,65,57,105,201 ; vpunpckhwd %xmm9,%xmm8,%xmm9
DB 196,66,121,51,192 ; vpmovzxwd %xmm8,%xmm8
DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,197,94,0,0 ; vbroadcastss 0x5ec5(%rip),%ymm9 # 7d60 <_sk_callback_avx+0x268>
+ DB 196,98,125,24,13,33,93,0,0 ; vbroadcastss 0x5d21(%rip),%ymm9 # 7bbc <_sk_callback_avx+0x268>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 197,188,89,201 ; vmulps %ymm1,%ymm8,%ymm1
@@ -8387,13 +8273,13 @@ _sk_lerp_u8_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,110 ; jne 2023 <_sk_lerp_u8_avx+0x78>
DB 196,66,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm8
- DB 197,57,219,5,141,97,0,0 ; vpand 0x618d(%rip),%xmm8,%xmm8 # 8150 <_sk_callback_avx+0x658>
+ DB 197,57,219,5,221,95,0,0 ; vpand 0x5fdd(%rip),%xmm8,%xmm8 # 7fa0 <_sk_callback_avx+0x64c>
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 196,65,57,105,201 ; vpunpckhwd %xmm9,%xmm8,%xmm9
DB 196,66,121,51,192 ; vpmovzxwd %xmm8,%xmm8
DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,13,126,93,0,0 ; vbroadcastss 0x5d7e(%rip),%ymm9 # 7d64 <_sk_callback_avx+0x26c>
+ DB 196,98,125,24,13,218,91,0,0 ; vbroadcastss 0x5bda(%rip),%ymm9 # 7bc0 <_sk_callback_avx+0x26c>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
@@ -8449,7 +8335,7 @@ _sk_lerp_u8_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 233,255,255,255,222 ; jmpq ffffffffdf0020d0 <_sk_callback_avx+0xffffffffdeffa5d8>
+ DB 233,255,255,255,222 ; jmpq ffffffffdf0020d0 <_sk_callback_avx+0xffffffffdeffa77c>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,211 ; callq *%rbx
@@ -8471,20 +8357,20 @@ _sk_lerp_565_avx LABEL PROC
DB 196,65,57,105,201 ; vpunpckhwd %xmm9,%xmm8,%xmm9
DB 196,66,121,51,192 ; vpmovzxwd %xmm8,%xmm8
DB 196,67,61,24,193,1 ; vinsertf128 $0x1,%xmm9,%ymm8,%ymm8
- DB 196,98,125,24,13,90,92,0,0 ; vbroadcastss 0x5c5a(%rip),%ymm9 # 7d68 <_sk_callback_avx+0x270>
+ DB 196,98,125,24,13,182,90,0,0 ; vbroadcastss 0x5ab6(%rip),%ymm9 # 7bc4 <_sk_callback_avx+0x270>
DB 196,65,60,84,201 ; vandps %ymm9,%ymm8,%ymm9
DB 196,65,124,91,201 ; vcvtdq2ps %ymm9,%ymm9
- DB 196,98,125,24,21,75,92,0,0 ; vbroadcastss 0x5c4b(%rip),%ymm10 # 7d6c <_sk_callback_avx+0x274>
+ DB 196,98,125,24,21,167,90,0,0 ; vbroadcastss 0x5aa7(%rip),%ymm10 # 7bc8 <_sk_callback_avx+0x274>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,65,92,0,0 ; vbroadcastss 0x5c41(%rip),%ymm10 # 7d70 <_sk_callback_avx+0x278>
+ DB 196,98,125,24,21,157,90,0,0 ; vbroadcastss 0x5a9d(%rip),%ymm10 # 7bcc <_sk_callback_avx+0x278>
DB 196,65,60,84,210 ; vandps %ymm10,%ymm8,%ymm10
DB 196,65,124,91,210 ; vcvtdq2ps %ymm10,%ymm10
- DB 196,98,125,24,29,50,92,0,0 ; vbroadcastss 0x5c32(%rip),%ymm11 # 7d74 <_sk_callback_avx+0x27c>
+ DB 196,98,125,24,29,142,90,0,0 ; vbroadcastss 0x5a8e(%rip),%ymm11 # 7bd0 <_sk_callback_avx+0x27c>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
- DB 196,98,125,24,29,40,92,0,0 ; vbroadcastss 0x5c28(%rip),%ymm11 # 7d78 <_sk_callback_avx+0x280>
+ DB 196,98,125,24,29,132,90,0,0 ; vbroadcastss 0x5a84(%rip),%ymm11 # 7bd4 <_sk_callback_avx+0x280>
DB 196,65,60,84,195 ; vandps %ymm11,%ymm8,%ymm8
DB 196,65,124,91,192 ; vcvtdq2ps %ymm8,%ymm8
- DB 196,98,125,24,29,25,92,0,0 ; vbroadcastss 0x5c19(%rip),%ymm11 # 7d7c <_sk_callback_avx+0x284>
+ DB 196,98,125,24,29,117,90,0,0 ; vbroadcastss 0x5a75(%rip),%ymm11 # 7bd8 <_sk_callback_avx+0x284>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 197,252,92,196 ; vsubps %ymm4,%ymm0,%ymm0
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
@@ -8563,7 +8449,7 @@ _sk_load_tables_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 15,133,251,1,0,0 ; jne 247e <_sk_load_tables_avx+0x21e>
DB 196,65,124,16,18 ; vmovups (%r10),%ymm10
- DB 197,124,40,13,112,96,0,0 ; vmovaps 0x6070(%rip),%ymm9 # 8300 <_sk_callback_avx+0x808>
+ DB 197,124,40,13,208,94,0,0 ; vmovaps 0x5ed0(%rip),%ymm9 # 8160 <_sk_callback_avx+0x80c>
DB 196,193,44,84,201 ; vandps %ymm9,%ymm10,%ymm1
DB 196,227,125,25,200,1 ; vextractf128 $0x1,%ymm1,%xmm0
DB 196,193,249,126,195 ; vmovq %xmm0,%r11
@@ -8655,7 +8541,7 @@ _sk_load_tables_avx LABEL PROC
DB 196,193,65,114,208,24 ; vpsrld $0x18,%xmm8,%xmm7
DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,226,125,24,61,23,89,0,0 ; vbroadcastss 0x5917(%rip),%ymm7 # 7d80 <_sk_callback_avx+0x288>
+ DB 196,226,125,24,61,115,87,0,0 ; vbroadcastss 0x5773(%rip),%ymm7 # 7bdc <_sk_callback_avx+0x288>
DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -8670,9 +8556,9 @@ _sk_load_tables_avx LABEL PROC
DB 73,211,235 ; shr %cl,%r11
DB 196,193,249,110,195 ; vmovq %r11,%xmm0
DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0
- DB 196,226,121,0,13,186,92,0,0 ; vpshufb 0x5cba(%rip),%xmm0,%xmm1 # 8160 <_sk_callback_avx+0x668>
+ DB 196,226,121,0,13,10,91,0,0 ; vpshufb 0x5b0a(%rip),%xmm0,%xmm1 # 7fb0 <_sk_callback_avx+0x65c>
DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1
- DB 196,226,121,0,5,188,92,0,0 ; vpshufb 0x5cbc(%rip),%xmm0,%xmm0 # 8170 <_sk_callback_avx+0x678>
+ DB 196,226,121,0,5,12,91,0,0 ; vpshufb 0x5b0c(%rip),%xmm0,%xmm0 # 7fc0 <_sk_callback_avx+0x66c>
DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 196,66,125,44,18 ; vmaskmovps (%r10),%ymm0,%ymm10
@@ -8701,7 +8587,7 @@ _sk_load_tables_u16_be_avx LABEL PROC
DB 197,113,105,219 ; vpunpckhwd %xmm3,%xmm1,%xmm11
DB 197,177,108,200 ; vpunpcklqdq %xmm0,%xmm9,%xmm1
DB 197,49,109,224 ; vpunpckhqdq %xmm0,%xmm9,%xmm12
- DB 197,121,111,21,75,92,0,0 ; vmovdqa 0x5c4b(%rip),%xmm10 # 8180 <_sk_callback_avx+0x688>
+ DB 197,121,111,21,155,90,0,0 ; vmovdqa 0x5a9b(%rip),%xmm10 # 7fd0 <_sk_callback_avx+0x67c>
DB 196,193,113,219,202 ; vpand %xmm10,%xmm1,%xmm1
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 196,193,113,105,209 ; vpunpckhwd %xmm9,%xmm1,%xmm2
@@ -8799,7 +8685,7 @@ _sk_load_tables_u16_be_avx LABEL PROC
DB 196,226,121,51,219 ; vpmovzxwd %xmm3,%xmm3
DB 196,227,101,24,223,1 ; vinsertf128 $0x1,%xmm7,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,226,125,24,61,86,86,0,0 ; vbroadcastss 0x5656(%rip),%ymm7 # 7d84 <_sk_callback_avx+0x28c>
+ DB 196,226,125,24,61,178,84,0,0 ; vbroadcastss 0x54b2(%rip),%ymm7 # 7be0 <_sk_callback_avx+0x28c>
DB 197,228,89,223 ; vmulps %ymm7,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,16,60,36 ; vmovups (%rsp),%ymm7
@@ -8862,7 +8748,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC
DB 197,185,108,218 ; vpunpcklqdq %xmm2,%xmm8,%xmm3
DB 197,57,109,218 ; vpunpckhqdq %xmm2,%xmm8,%xmm11
DB 197,121,108,193 ; vpunpcklqdq %xmm1,%xmm0,%xmm8
- DB 197,121,111,13,74,89,0,0 ; vmovdqa 0x594a(%rip),%xmm9 # 8190 <_sk_callback_avx+0x698>
+ DB 197,121,111,13,154,87,0,0 ; vmovdqa 0x579a(%rip),%xmm9 # 7fe0 <_sk_callback_avx+0x68c>
DB 196,193,97,219,193 ; vpand %xmm9,%xmm3,%xmm0
DB 196,65,41,239,210 ; vpxor %xmm10,%xmm10,%xmm10
DB 196,193,121,105,202 ; vpunpckhwd %xmm10,%xmm0,%xmm1
@@ -8952,7 +8838,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC
DB 196,195,105,33,211,48 ; vinsertps $0x30,%xmm11,%xmm2,%xmm2
DB 196,227,109,24,211,1 ; vinsertf128 $0x1,%xmm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,115,83,0,0 ; vbroadcastss 0x5373(%rip),%ymm3 # 7d88 <_sk_callback_avx+0x290>
+ DB 196,226,125,24,29,207,81,0,0 ; vbroadcastss 0x51cf(%rip),%ymm3 # 7be4 <_sk_callback_avx+0x290>
DB 197,252,16,52,36 ; vmovups (%rsp),%ymm6
DB 197,252,16,124,36,32 ; vmovups 0x20(%rsp),%ymm7
DB 72,131,196,88 ; add $0x58,%rsp
@@ -8994,7 +8880,7 @@ _sk_load_tables_rgb_u16_be_avx LABEL PROC
PUBLIC _sk_byte_tables_avx
_sk_byte_tables_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,172,82,0,0 ; vbroadcastss 0x52ac(%rip),%ymm8 # 7d8c <_sk_callback_avx+0x294>
+ DB 196,98,125,24,5,8,81,0,0 ; vbroadcastss 0x5108(%rip),%ymm8 # 7be8 <_sk_callback_avx+0x294>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,125,91,200 ; vcvtps2dq %ymm0,%ymm9
DB 196,65,249,126,201 ; vmovq %xmm9,%r9
@@ -9113,7 +8999,7 @@ _sk_byte_tables_avx LABEL PROC
DB 196,194,121,49,204 ; vpmovzxbd %xmm12,%xmm1
DB 196,194,121,49,213 ; vpmovzxbd %xmm13,%xmm2
DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- DB 196,98,125,24,13,86,80,0,0 ; vbroadcastss 0x5056(%rip),%ymm9 # 7d90 <_sk_callback_avx+0x298>
+ DB 196,98,125,24,13,178,78,0,0 ; vbroadcastss 0x4eb2(%rip),%ymm9 # 7bec <_sk_callback_avx+0x298>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
@@ -9227,7 +9113,7 @@ _sk_byte_tables_rgb_avx LABEL PROC
DB 196,194,121,49,203 ; vpmovzxbd %xmm11,%xmm1
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,55,78,0,0 ; vbroadcastss 0x4e37(%rip),%ymm9 # 7d94 <_sk_callback_avx+0x29c>
+ DB 196,98,125,24,13,147,76,0,0 ; vbroadcastss 0x4c93(%rip),%ymm9 # 7bf0 <_sk_callback_avx+0x29c>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,194,121,49,202 ; vpmovzxbd %xmm10,%xmm1
DB 196,194,121,49,212 ; vpmovzxbd %xmm12,%xmm2
@@ -9422,36 +9308,36 @@ _sk_parametric_r_avx LABEL PROC
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,216 ; vcvtdq2ps %ymm0,%ymm11
- DB 196,98,125,24,37,228,74,0,0 ; vbroadcastss 0x4ae4(%rip),%ymm12 # 7d98 <_sk_callback_avx+0x2a0>
+ DB 196,98,125,24,37,64,73,0,0 ; vbroadcastss 0x4940(%rip),%ymm12 # 7bf4 <_sk_callback_avx+0x2a0>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,218,74,0,0 ; vbroadcastss 0x4ada(%rip),%ymm12 # 7d9c <_sk_callback_avx+0x2a4>
+ DB 196,98,125,24,37,54,73,0,0 ; vbroadcastss 0x4936(%rip),%ymm12 # 7bf8 <_sk_callback_avx+0x2a4>
DB 196,193,124,84,196 ; vandps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,208,74,0,0 ; vbroadcastss 0x4ad0(%rip),%ymm12 # 7da0 <_sk_callback_avx+0x2a8>
+ DB 196,98,125,24,37,44,73,0,0 ; vbroadcastss 0x492c(%rip),%ymm12 # 7bfc <_sk_callback_avx+0x2a8>
DB 196,193,124,86,196 ; vorps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,198,74,0,0 ; vbroadcastss 0x4ac6(%rip),%ymm12 # 7da4 <_sk_callback_avx+0x2ac>
+ DB 196,98,125,24,37,34,73,0,0 ; vbroadcastss 0x4922(%rip),%ymm12 # 7c00 <_sk_callback_avx+0x2ac>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,188,74,0,0 ; vbroadcastss 0x4abc(%rip),%ymm12 # 7da8 <_sk_callback_avx+0x2b0>
+ DB 196,98,125,24,37,24,73,0,0 ; vbroadcastss 0x4918(%rip),%ymm12 # 7c04 <_sk_callback_avx+0x2b0>
DB 196,65,124,89,228 ; vmulps %ymm12,%ymm0,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,173,74,0,0 ; vbroadcastss 0x4aad(%rip),%ymm12 # 7dac <_sk_callback_avx+0x2b4>
+ DB 196,98,125,24,37,9,73,0,0 ; vbroadcastss 0x4909(%rip),%ymm12 # 7c08 <_sk_callback_avx+0x2b4>
DB 196,193,124,88,196 ; vaddps %ymm12,%ymm0,%ymm0
- DB 196,98,125,24,37,163,74,0,0 ; vbroadcastss 0x4aa3(%rip),%ymm12 # 7db0 <_sk_callback_avx+0x2b8>
+ DB 196,98,125,24,37,255,72,0,0 ; vbroadcastss 0x48ff(%rip),%ymm12 # 7c0c <_sk_callback_avx+0x2b8>
DB 197,156,94,192 ; vdivps %ymm0,%ymm12,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
DB 197,172,89,192 ; vmulps %ymm0,%ymm10,%ymm0
DB 196,99,125,8,208,1 ; vroundps $0x1,%ymm0,%ymm10
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,135,74,0,0 ; vbroadcastss 0x4a87(%rip),%ymm11 # 7db4 <_sk_callback_avx+0x2bc>
+ DB 196,98,125,24,29,227,72,0,0 ; vbroadcastss 0x48e3(%rip),%ymm11 # 7c10 <_sk_callback_avx+0x2bc>
DB 196,193,124,88,195 ; vaddps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,125,74,0,0 ; vbroadcastss 0x4a7d(%rip),%ymm11 # 7db8 <_sk_callback_avx+0x2c0>
+ DB 196,98,125,24,29,217,72,0,0 ; vbroadcastss 0x48d9(%rip),%ymm11 # 7c14 <_sk_callback_avx+0x2c0>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,124,92,195 ; vsubps %ymm11,%ymm0,%ymm0
- DB 196,98,125,24,29,110,74,0,0 ; vbroadcastss 0x4a6e(%rip),%ymm11 # 7dbc <_sk_callback_avx+0x2c4>
+ DB 196,98,125,24,29,202,72,0,0 ; vbroadcastss 0x48ca(%rip),%ymm11 # 7c18 <_sk_callback_avx+0x2c4>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,100,74,0,0 ; vbroadcastss 0x4a64(%rip),%ymm11 # 7dc0 <_sk_callback_avx+0x2c8>
+ DB 196,98,125,24,29,192,72,0,0 ; vbroadcastss 0x48c0(%rip),%ymm11 # 7c1c <_sk_callback_avx+0x2c8>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,124,88,194 ; vaddps %ymm10,%ymm0,%ymm0
- DB 196,98,125,24,21,85,74,0,0 ; vbroadcastss 0x4a55(%rip),%ymm10 # 7dc4 <_sk_callback_avx+0x2cc>
+ DB 196,98,125,24,21,177,72,0,0 ; vbroadcastss 0x48b1(%rip),%ymm10 # 7c20 <_sk_callback_avx+0x2cc>
DB 196,193,124,89,194 ; vmulps %ymm10,%ymm0,%ymm0
DB 197,253,91,192 ; vcvtps2dq %ymm0,%ymm0
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -9459,7 +9345,7 @@ _sk_parametric_r_avx LABEL PROC
DB 196,195,125,74,193,128 ; vblendvps %ymm8,%ymm9,%ymm0,%ymm0
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,124,95,192 ; vmaxps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,44,74,0,0 ; vbroadcastss 0x4a2c(%rip),%ymm8 # 7dc8 <_sk_callback_avx+0x2d0>
+ DB 196,98,125,24,5,136,72,0,0 ; vbroadcastss 0x4888(%rip),%ymm8 # 7c24 <_sk_callback_avx+0x2d0>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -9479,36 +9365,36 @@ _sk_parametric_g_avx LABEL PROC
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,217 ; vcvtdq2ps %ymm1,%ymm11
- DB 196,98,125,24,37,221,73,0,0 ; vbroadcastss 0x49dd(%rip),%ymm12 # 7dcc <_sk_callback_avx+0x2d4>
+ DB 196,98,125,24,37,57,72,0,0 ; vbroadcastss 0x4839(%rip),%ymm12 # 7c28 <_sk_callback_avx+0x2d4>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,211,73,0,0 ; vbroadcastss 0x49d3(%rip),%ymm12 # 7dd0 <_sk_callback_avx+0x2d8>
+ DB 196,98,125,24,37,47,72,0,0 ; vbroadcastss 0x482f(%rip),%ymm12 # 7c2c <_sk_callback_avx+0x2d8>
DB 196,193,116,84,204 ; vandps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,201,73,0,0 ; vbroadcastss 0x49c9(%rip),%ymm12 # 7dd4 <_sk_callback_avx+0x2dc>
+ DB 196,98,125,24,37,37,72,0,0 ; vbroadcastss 0x4825(%rip),%ymm12 # 7c30 <_sk_callback_avx+0x2dc>
DB 196,193,116,86,204 ; vorps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,191,73,0,0 ; vbroadcastss 0x49bf(%rip),%ymm12 # 7dd8 <_sk_callback_avx+0x2e0>
+ DB 196,98,125,24,37,27,72,0,0 ; vbroadcastss 0x481b(%rip),%ymm12 # 7c34 <_sk_callback_avx+0x2e0>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,181,73,0,0 ; vbroadcastss 0x49b5(%rip),%ymm12 # 7ddc <_sk_callback_avx+0x2e4>
+ DB 196,98,125,24,37,17,72,0,0 ; vbroadcastss 0x4811(%rip),%ymm12 # 7c38 <_sk_callback_avx+0x2e4>
DB 196,65,116,89,228 ; vmulps %ymm12,%ymm1,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,166,73,0,0 ; vbroadcastss 0x49a6(%rip),%ymm12 # 7de0 <_sk_callback_avx+0x2e8>
+ DB 196,98,125,24,37,2,72,0,0 ; vbroadcastss 0x4802(%rip),%ymm12 # 7c3c <_sk_callback_avx+0x2e8>
DB 196,193,116,88,204 ; vaddps %ymm12,%ymm1,%ymm1
- DB 196,98,125,24,37,156,73,0,0 ; vbroadcastss 0x499c(%rip),%ymm12 # 7de4 <_sk_callback_avx+0x2ec>
+ DB 196,98,125,24,37,248,71,0,0 ; vbroadcastss 0x47f8(%rip),%ymm12 # 7c40 <_sk_callback_avx+0x2ec>
DB 197,156,94,201 ; vdivps %ymm1,%ymm12,%ymm1
DB 197,164,92,201 ; vsubps %ymm1,%ymm11,%ymm1
DB 197,172,89,201 ; vmulps %ymm1,%ymm10,%ymm1
DB 196,99,125,8,209,1 ; vroundps $0x1,%ymm1,%ymm10
DB 196,65,116,92,210 ; vsubps %ymm10,%ymm1,%ymm10
- DB 196,98,125,24,29,128,73,0,0 ; vbroadcastss 0x4980(%rip),%ymm11 # 7de8 <_sk_callback_avx+0x2f0>
+ DB 196,98,125,24,29,220,71,0,0 ; vbroadcastss 0x47dc(%rip),%ymm11 # 7c44 <_sk_callback_avx+0x2f0>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,118,73,0,0 ; vbroadcastss 0x4976(%rip),%ymm11 # 7dec <_sk_callback_avx+0x2f4>
+ DB 196,98,125,24,29,210,71,0,0 ; vbroadcastss 0x47d2(%rip),%ymm11 # 7c48 <_sk_callback_avx+0x2f4>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,116,92,203 ; vsubps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,29,103,73,0,0 ; vbroadcastss 0x4967(%rip),%ymm11 # 7df0 <_sk_callback_avx+0x2f8>
+ DB 196,98,125,24,29,195,71,0,0 ; vbroadcastss 0x47c3(%rip),%ymm11 # 7c4c <_sk_callback_avx+0x2f8>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,93,73,0,0 ; vbroadcastss 0x495d(%rip),%ymm11 # 7df4 <_sk_callback_avx+0x2fc>
+ DB 196,98,125,24,29,185,71,0,0 ; vbroadcastss 0x47b9(%rip),%ymm11 # 7c50 <_sk_callback_avx+0x2fc>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,116,88,202 ; vaddps %ymm10,%ymm1,%ymm1
- DB 196,98,125,24,21,78,73,0,0 ; vbroadcastss 0x494e(%rip),%ymm10 # 7df8 <_sk_callback_avx+0x300>
+ DB 196,98,125,24,21,170,71,0,0 ; vbroadcastss 0x47aa(%rip),%ymm10 # 7c54 <_sk_callback_avx+0x300>
DB 196,193,116,89,202 ; vmulps %ymm10,%ymm1,%ymm1
DB 197,253,91,201 ; vcvtps2dq %ymm1,%ymm1
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -9516,7 +9402,7 @@ _sk_parametric_g_avx LABEL PROC
DB 196,195,117,74,201,128 ; vblendvps %ymm8,%ymm9,%ymm1,%ymm1
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,116,95,200 ; vmaxps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,5,37,73,0,0 ; vbroadcastss 0x4925(%rip),%ymm8 # 7dfc <_sk_callback_avx+0x304>
+ DB 196,98,125,24,5,129,71,0,0 ; vbroadcastss 0x4781(%rip),%ymm8 # 7c58 <_sk_callback_avx+0x304>
DB 196,193,116,93,200 ; vminps %ymm8,%ymm1,%ymm1
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -9536,36 +9422,36 @@ _sk_parametric_b_avx LABEL PROC
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,218 ; vcvtdq2ps %ymm2,%ymm11
- DB 196,98,125,24,37,214,72,0,0 ; vbroadcastss 0x48d6(%rip),%ymm12 # 7e00 <_sk_callback_avx+0x308>
+ DB 196,98,125,24,37,50,71,0,0 ; vbroadcastss 0x4732(%rip),%ymm12 # 7c5c <_sk_callback_avx+0x308>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,204,72,0,0 ; vbroadcastss 0x48cc(%rip),%ymm12 # 7e04 <_sk_callback_avx+0x30c>
+ DB 196,98,125,24,37,40,71,0,0 ; vbroadcastss 0x4728(%rip),%ymm12 # 7c60 <_sk_callback_avx+0x30c>
DB 196,193,108,84,212 ; vandps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,194,72,0,0 ; vbroadcastss 0x48c2(%rip),%ymm12 # 7e08 <_sk_callback_avx+0x310>
+ DB 196,98,125,24,37,30,71,0,0 ; vbroadcastss 0x471e(%rip),%ymm12 # 7c64 <_sk_callback_avx+0x310>
DB 196,193,108,86,212 ; vorps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,184,72,0,0 ; vbroadcastss 0x48b8(%rip),%ymm12 # 7e0c <_sk_callback_avx+0x314>
+ DB 196,98,125,24,37,20,71,0,0 ; vbroadcastss 0x4714(%rip),%ymm12 # 7c68 <_sk_callback_avx+0x314>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,174,72,0,0 ; vbroadcastss 0x48ae(%rip),%ymm12 # 7e10 <_sk_callback_avx+0x318>
+ DB 196,98,125,24,37,10,71,0,0 ; vbroadcastss 0x470a(%rip),%ymm12 # 7c6c <_sk_callback_avx+0x318>
DB 196,65,108,89,228 ; vmulps %ymm12,%ymm2,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,159,72,0,0 ; vbroadcastss 0x489f(%rip),%ymm12 # 7e14 <_sk_callback_avx+0x31c>
+ DB 196,98,125,24,37,251,70,0,0 ; vbroadcastss 0x46fb(%rip),%ymm12 # 7c70 <_sk_callback_avx+0x31c>
DB 196,193,108,88,212 ; vaddps %ymm12,%ymm2,%ymm2
- DB 196,98,125,24,37,149,72,0,0 ; vbroadcastss 0x4895(%rip),%ymm12 # 7e18 <_sk_callback_avx+0x320>
+ DB 196,98,125,24,37,241,70,0,0 ; vbroadcastss 0x46f1(%rip),%ymm12 # 7c74 <_sk_callback_avx+0x320>
DB 197,156,94,210 ; vdivps %ymm2,%ymm12,%ymm2
DB 197,164,92,210 ; vsubps %ymm2,%ymm11,%ymm2
DB 197,172,89,210 ; vmulps %ymm2,%ymm10,%ymm2
DB 196,99,125,8,210,1 ; vroundps $0x1,%ymm2,%ymm10
DB 196,65,108,92,210 ; vsubps %ymm10,%ymm2,%ymm10
- DB 196,98,125,24,29,121,72,0,0 ; vbroadcastss 0x4879(%rip),%ymm11 # 7e1c <_sk_callback_avx+0x324>
+ DB 196,98,125,24,29,213,70,0,0 ; vbroadcastss 0x46d5(%rip),%ymm11 # 7c78 <_sk_callback_avx+0x324>
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,111,72,0,0 ; vbroadcastss 0x486f(%rip),%ymm11 # 7e20 <_sk_callback_avx+0x328>
+ DB 196,98,125,24,29,203,70,0,0 ; vbroadcastss 0x46cb(%rip),%ymm11 # 7c7c <_sk_callback_avx+0x328>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,108,92,211 ; vsubps %ymm11,%ymm2,%ymm2
- DB 196,98,125,24,29,96,72,0,0 ; vbroadcastss 0x4860(%rip),%ymm11 # 7e24 <_sk_callback_avx+0x32c>
+ DB 196,98,125,24,29,188,70,0,0 ; vbroadcastss 0x46bc(%rip),%ymm11 # 7c80 <_sk_callback_avx+0x32c>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,86,72,0,0 ; vbroadcastss 0x4856(%rip),%ymm11 # 7e28 <_sk_callback_avx+0x330>
+ DB 196,98,125,24,29,178,70,0,0 ; vbroadcastss 0x46b2(%rip),%ymm11 # 7c84 <_sk_callback_avx+0x330>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,108,88,210 ; vaddps %ymm10,%ymm2,%ymm2
- DB 196,98,125,24,21,71,72,0,0 ; vbroadcastss 0x4847(%rip),%ymm10 # 7e2c <_sk_callback_avx+0x334>
+ DB 196,98,125,24,21,163,70,0,0 ; vbroadcastss 0x46a3(%rip),%ymm10 # 7c88 <_sk_callback_avx+0x334>
DB 196,193,108,89,210 ; vmulps %ymm10,%ymm2,%ymm2
DB 197,253,91,210 ; vcvtps2dq %ymm2,%ymm2
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -9573,7 +9459,7 @@ _sk_parametric_b_avx LABEL PROC
DB 196,195,109,74,209,128 ; vblendvps %ymm8,%ymm9,%ymm2,%ymm2
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,108,95,208 ; vmaxps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,30,72,0,0 ; vbroadcastss 0x481e(%rip),%ymm8 # 7e30 <_sk_callback_avx+0x338>
+ DB 196,98,125,24,5,122,70,0,0 ; vbroadcastss 0x467a(%rip),%ymm8 # 7c8c <_sk_callback_avx+0x338>
DB 196,193,108,93,208 ; vminps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -9593,36 +9479,36 @@ _sk_parametric_a_avx LABEL PROC
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
DB 196,98,125,24,16 ; vbroadcastss (%rax),%ymm10
DB 197,124,91,219 ; vcvtdq2ps %ymm3,%ymm11
- DB 196,98,125,24,37,207,71,0,0 ; vbroadcastss 0x47cf(%rip),%ymm12 # 7e34 <_sk_callback_avx+0x33c>
+ DB 196,98,125,24,37,43,70,0,0 ; vbroadcastss 0x462b(%rip),%ymm12 # 7c90 <_sk_callback_avx+0x33c>
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,197,71,0,0 ; vbroadcastss 0x47c5(%rip),%ymm12 # 7e38 <_sk_callback_avx+0x340>
+ DB 196,98,125,24,37,33,70,0,0 ; vbroadcastss 0x4621(%rip),%ymm12 # 7c94 <_sk_callback_avx+0x340>
DB 196,193,100,84,220 ; vandps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,187,71,0,0 ; vbroadcastss 0x47bb(%rip),%ymm12 # 7e3c <_sk_callback_avx+0x344>
+ DB 196,98,125,24,37,23,70,0,0 ; vbroadcastss 0x4617(%rip),%ymm12 # 7c98 <_sk_callback_avx+0x344>
DB 196,193,100,86,220 ; vorps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,177,71,0,0 ; vbroadcastss 0x47b1(%rip),%ymm12 # 7e40 <_sk_callback_avx+0x348>
+ DB 196,98,125,24,37,13,70,0,0 ; vbroadcastss 0x460d(%rip),%ymm12 # 7c9c <_sk_callback_avx+0x348>
DB 196,65,36,88,220 ; vaddps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,167,71,0,0 ; vbroadcastss 0x47a7(%rip),%ymm12 # 7e44 <_sk_callback_avx+0x34c>
+ DB 196,98,125,24,37,3,70,0,0 ; vbroadcastss 0x4603(%rip),%ymm12 # 7ca0 <_sk_callback_avx+0x34c>
DB 196,65,100,89,228 ; vmulps %ymm12,%ymm3,%ymm12
DB 196,65,36,92,220 ; vsubps %ymm12,%ymm11,%ymm11
- DB 196,98,125,24,37,152,71,0,0 ; vbroadcastss 0x4798(%rip),%ymm12 # 7e48 <_sk_callback_avx+0x350>
+ DB 196,98,125,24,37,244,69,0,0 ; vbroadcastss 0x45f4(%rip),%ymm12 # 7ca4 <_sk_callback_avx+0x350>
DB 196,193,100,88,220 ; vaddps %ymm12,%ymm3,%ymm3
- DB 196,98,125,24,37,142,71,0,0 ; vbroadcastss 0x478e(%rip),%ymm12 # 7e4c <_sk_callback_avx+0x354>
+ DB 196,98,125,24,37,234,69,0,0 ; vbroadcastss 0x45ea(%rip),%ymm12 # 7ca8 <_sk_callback_avx+0x354>
DB 197,156,94,219 ; vdivps %ymm3,%ymm12,%ymm3
DB 197,164,92,219 ; vsubps %ymm3,%ymm11,%ymm3
DB 197,172,89,219 ; vmulps %ymm3,%ymm10,%ymm3
DB 196,99,125,8,211,1 ; vroundps $0x1,%ymm3,%ymm10
DB 196,65,100,92,210 ; vsubps %ymm10,%ymm3,%ymm10
- DB 196,98,125,24,29,114,71,0,0 ; vbroadcastss 0x4772(%rip),%ymm11 # 7e50 <_sk_callback_avx+0x358>
+ DB 196,98,125,24,29,206,69,0,0 ; vbroadcastss 0x45ce(%rip),%ymm11 # 7cac <_sk_callback_avx+0x358>
DB 196,193,100,88,219 ; vaddps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,104,71,0,0 ; vbroadcastss 0x4768(%rip),%ymm11 # 7e54 <_sk_callback_avx+0x35c>
+ DB 196,98,125,24,29,196,69,0,0 ; vbroadcastss 0x45c4(%rip),%ymm11 # 7cb0 <_sk_callback_avx+0x35c>
DB 196,65,44,89,219 ; vmulps %ymm11,%ymm10,%ymm11
DB 196,193,100,92,219 ; vsubps %ymm11,%ymm3,%ymm3
- DB 196,98,125,24,29,89,71,0,0 ; vbroadcastss 0x4759(%rip),%ymm11 # 7e58 <_sk_callback_avx+0x360>
+ DB 196,98,125,24,29,181,69,0,0 ; vbroadcastss 0x45b5(%rip),%ymm11 # 7cb4 <_sk_callback_avx+0x360>
DB 196,65,36,92,210 ; vsubps %ymm10,%ymm11,%ymm10
- DB 196,98,125,24,29,79,71,0,0 ; vbroadcastss 0x474f(%rip),%ymm11 # 7e5c <_sk_callback_avx+0x364>
+ DB 196,98,125,24,29,171,69,0,0 ; vbroadcastss 0x45ab(%rip),%ymm11 # 7cb8 <_sk_callback_avx+0x364>
DB 196,65,36,94,210 ; vdivps %ymm10,%ymm11,%ymm10
DB 196,193,100,88,218 ; vaddps %ymm10,%ymm3,%ymm3
- DB 196,98,125,24,21,64,71,0,0 ; vbroadcastss 0x4740(%rip),%ymm10 # 7e60 <_sk_callback_avx+0x368>
+ DB 196,98,125,24,21,156,69,0,0 ; vbroadcastss 0x459c(%rip),%ymm10 # 7cbc <_sk_callback_avx+0x368>
DB 196,193,100,89,218 ; vmulps %ymm10,%ymm3,%ymm3
DB 197,253,91,219 ; vcvtps2dq %ymm3,%ymm3
DB 196,98,125,24,80,20 ; vbroadcastss 0x14(%rax),%ymm10
@@ -9630,38 +9516,38 @@ _sk_parametric_a_avx LABEL PROC
DB 196,195,101,74,217,128 ; vblendvps %ymm8,%ymm9,%ymm3,%ymm3
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 196,193,100,95,216 ; vmaxps %ymm8,%ymm3,%ymm3
- DB 196,98,125,24,5,23,71,0,0 ; vbroadcastss 0x4717(%rip),%ymm8 # 7e64 <_sk_callback_avx+0x36c>
+ DB 196,98,125,24,5,115,69,0,0 ; vbroadcastss 0x4573(%rip),%ymm8 # 7cc0 <_sk_callback_avx+0x36c>
DB 196,193,100,93,216 ; vminps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
PUBLIC _sk_lab_to_xyz_avx
_sk_lab_to_xyz_avx LABEL PROC
- DB 196,98,125,24,5,9,71,0,0 ; vbroadcastss 0x4709(%rip),%ymm8 # 7e68 <_sk_callback_avx+0x370>
+ DB 196,98,125,24,5,101,69,0,0 ; vbroadcastss 0x4565(%rip),%ymm8 # 7cc4 <_sk_callback_avx+0x370>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,255,70,0,0 ; vbroadcastss 0x46ff(%rip),%ymm8 # 7e6c <_sk_callback_avx+0x374>
+ DB 196,98,125,24,5,91,69,0,0 ; vbroadcastss 0x455b(%rip),%ymm8 # 7cc8 <_sk_callback_avx+0x374>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
- DB 196,98,125,24,13,245,70,0,0 ; vbroadcastss 0x46f5(%rip),%ymm9 # 7e70 <_sk_callback_avx+0x378>
+ DB 196,98,125,24,13,81,69,0,0 ; vbroadcastss 0x4551(%rip),%ymm9 # 7ccc <_sk_callback_avx+0x378>
DB 196,193,116,88,201 ; vaddps %ymm9,%ymm1,%ymm1
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 196,193,108,88,209 ; vaddps %ymm9,%ymm2,%ymm2
- DB 196,98,125,24,5,225,70,0,0 ; vbroadcastss 0x46e1(%rip),%ymm8 # 7e74 <_sk_callback_avx+0x37c>
+ DB 196,98,125,24,5,61,69,0,0 ; vbroadcastss 0x453d(%rip),%ymm8 # 7cd0 <_sk_callback_avx+0x37c>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,215,70,0,0 ; vbroadcastss 0x46d7(%rip),%ymm8 # 7e78 <_sk_callback_avx+0x380>
+ DB 196,98,125,24,5,51,69,0,0 ; vbroadcastss 0x4533(%rip),%ymm8 # 7cd4 <_sk_callback_avx+0x380>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,5,205,70,0,0 ; vbroadcastss 0x46cd(%rip),%ymm8 # 7e7c <_sk_callback_avx+0x384>
+ DB 196,98,125,24,5,41,69,0,0 ; vbroadcastss 0x4529(%rip),%ymm8 # 7cd8 <_sk_callback_avx+0x384>
DB 196,193,116,89,200 ; vmulps %ymm8,%ymm1,%ymm1
DB 197,252,88,201 ; vaddps %ymm1,%ymm0,%ymm1
- DB 196,98,125,24,5,191,70,0,0 ; vbroadcastss 0x46bf(%rip),%ymm8 # 7e80 <_sk_callback_avx+0x388>
+ DB 196,98,125,24,5,27,69,0,0 ; vbroadcastss 0x451b(%rip),%ymm8 # 7cdc <_sk_callback_avx+0x388>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 197,252,92,210 ; vsubps %ymm2,%ymm0,%ymm2
DB 197,116,89,193 ; vmulps %ymm1,%ymm1,%ymm8
DB 196,65,116,89,192 ; vmulps %ymm8,%ymm1,%ymm8
- DB 196,98,125,24,13,168,70,0,0 ; vbroadcastss 0x46a8(%rip),%ymm9 # 7e84 <_sk_callback_avx+0x38c>
+ DB 196,98,125,24,13,4,69,0,0 ; vbroadcastss 0x4504(%rip),%ymm9 # 7ce0 <_sk_callback_avx+0x38c>
DB 196,65,52,194,208,1 ; vcmpltps %ymm8,%ymm9,%ymm10
- DB 196,98,125,24,29,157,70,0,0 ; vbroadcastss 0x469d(%rip),%ymm11 # 7e88 <_sk_callback_avx+0x390>
+ DB 196,98,125,24,29,249,68,0,0 ; vbroadcastss 0x44f9(%rip),%ymm11 # 7ce4 <_sk_callback_avx+0x390>
DB 196,193,116,88,203 ; vaddps %ymm11,%ymm1,%ymm1
- DB 196,98,125,24,37,147,70,0,0 ; vbroadcastss 0x4693(%rip),%ymm12 # 7e8c <_sk_callback_avx+0x394>
+ DB 196,98,125,24,37,239,68,0,0 ; vbroadcastss 0x44ef(%rip),%ymm12 # 7ce8 <_sk_callback_avx+0x394>
DB 196,193,116,89,204 ; vmulps %ymm12,%ymm1,%ymm1
DB 196,67,117,74,192,160 ; vblendvps %ymm10,%ymm8,%ymm1,%ymm8
DB 197,252,89,200 ; vmulps %ymm0,%ymm0,%ymm1
@@ -9676,9 +9562,9 @@ _sk_lab_to_xyz_avx LABEL PROC
DB 196,193,108,88,211 ; vaddps %ymm11,%ymm2,%ymm2
DB 196,193,108,89,212 ; vmulps %ymm12,%ymm2,%ymm2
DB 196,227,109,74,208,144 ; vblendvps %ymm9,%ymm0,%ymm2,%ymm2
- DB 196,226,125,24,5,73,70,0,0 ; vbroadcastss 0x4649(%rip),%ymm0 # 7e90 <_sk_callback_avx+0x398>
+ DB 196,226,125,24,5,165,68,0,0 ; vbroadcastss 0x44a5(%rip),%ymm0 # 7cec <_sk_callback_avx+0x398>
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,64,70,0,0 ; vbroadcastss 0x4640(%rip),%ymm8 # 7e94 <_sk_callback_avx+0x39c>
+ DB 196,98,125,24,5,156,68,0,0 ; vbroadcastss 0x449c(%rip),%ymm8 # 7cf0 <_sk_callback_avx+0x39c>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -9690,13 +9576,13 @@ _sk_load_a8_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,66 ; jne 38a9 <_sk_load_a8_avx+0x4c>
DB 196,194,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm0
- DB 197,249,219,5,43,73,0,0 ; vpand 0x492b(%rip),%xmm0,%xmm0 # 81a0 <_sk_callback_avx+0x6a8>
+ DB 197,249,219,5,123,71,0,0 ; vpand 0x477b(%rip),%xmm0,%xmm0 # 7ff0 <_sk_callback_avx+0x69c>
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,3,70,0,0 ; vbroadcastss 0x4603(%rip),%ymm1 # 7e98 <_sk_callback_avx+0x3a0>
+ DB 196,226,125,24,13,95,68,0,0 ; vbroadcastss 0x445f(%rip),%ymm1 # 7cf4 <_sk_callback_avx+0x3a0>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -9744,7 +9630,7 @@ _sk_load_a8_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 233,255,255,255,222 ; jmpq ffffffffdf003950 <_sk_callback_avx+0xffffffffdeffbe58>
+ DB 233,255,255,255,222 ; jmpq ffffffffdf003950 <_sk_callback_avx+0xffffffffdeffbffc>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,211 ; callq *%rbx
@@ -9762,13 +9648,13 @@ _sk_load_a8_dst_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,66 ; jne 39a8 <_sk_load_a8_dst_avx+0x4c>
DB 196,194,121,48,36,19 ; vpmovzxbw (%r11,%rdx,1),%xmm4
- DB 197,217,219,37,60,72,0,0 ; vpand 0x483c(%rip),%xmm4,%xmm4 # 81b0 <_sk_callback_avx+0x6b8>
+ DB 197,217,219,37,140,70,0,0 ; vpand 0x468c(%rip),%xmm4,%xmm4 # 8000 <_sk_callback_avx+0x6ac>
DB 197,209,239,237 ; vpxor %xmm5,%xmm5,%xmm5
DB 197,217,105,237 ; vpunpckhwd %xmm5,%xmm4,%xmm5
DB 196,226,121,51,228 ; vpmovzxwd %xmm4,%xmm4
DB 196,227,93,24,229,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,8,69,0,0 ; vbroadcastss 0x4508(%rip),%ymm5 # 7e9c <_sk_callback_avx+0x3a4>
+ DB 196,226,125,24,45,100,67,0,0 ; vbroadcastss 0x4364(%rip),%ymm5 # 7cf8 <_sk_callback_avx+0x3a4>
DB 197,220,89,253 ; vmulps %ymm5,%ymm4,%ymm7
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,220,87,228 ; vxorps %ymm4,%ymm4,%ymm4
@@ -9816,7 +9702,7 @@ _sk_load_a8_dst_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 232,255,255,255,221 ; callq ffffffffde003a50 <_sk_callback_avx+0xffffffffddffbf58>
+ DB 232,255,255,255,221 ; callq ffffffffde003a50 <_sk_callback_avx+0xffffffffddffc0fc>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,210 ; callq *%rdx
@@ -9832,7 +9718,7 @@ _sk_gather_a8_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -9869,7 +9755,7 @@ _sk_gather_a8_avx LABEL PROC
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,120,67,0,0 ; vbroadcastss 0x4378(%rip),%ymm1 # 7ea0 <_sk_callback_avx+0x3a8>
+ DB 196,226,125,24,13,212,65,0,0 ; vbroadcastss 0x41d4(%rip),%ymm1 # 7cfc <_sk_callback_avx+0x3a8>
DB 197,252,89,217 ; vmulps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,87,192 ; vxorps %ymm0,%ymm0,%ymm0
@@ -9881,7 +9767,7 @@ PUBLIC _sk_store_a8_avx
_sk_store_a8_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,90,67,0,0 ; vbroadcastss 0x435a(%rip),%ymm8 # 7ea4 <_sk_callback_avx+0x3ac>
+ DB 196,98,125,24,5,182,65,0,0 ; vbroadcastss 0x41b6(%rip),%ymm8 # 7d00 <_sk_callback_avx+0x3ac>
DB 196,65,100,89,192 ; vmulps %ymm8,%ymm3,%ymm8
DB 196,65,125,91,192 ; vcvtps2dq %ymm8,%ymm8
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
@@ -9906,13 +9792,13 @@ _sk_store_a8_avx LABEL PROC
DB 196,67,121,20,4,19,0 ; vpextrb $0x0,%xmm8,(%r11,%rdx,1)
DB 235,202 ; jmp 3b6f <_sk_store_a8_avx+0x33>
DB 196,67,121,20,68,19,2,4 ; vpextrb $0x4,%xmm8,0x2(%r11,%rdx,1)
- DB 196,98,57,0,5,10,70,0,0 ; vpshufb 0x460a(%rip),%xmm8,%xmm8 # 81c0 <_sk_callback_avx+0x6c8>
+ DB 196,98,57,0,5,90,68,0,0 ; vpshufb 0x445a(%rip),%xmm8,%xmm8 # 8010 <_sk_callback_avx+0x6bc>
DB 196,67,121,21,4,19,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,1)
DB 235,176 ; jmp 3b6f <_sk_store_a8_avx+0x33>
DB 196,67,121,20,68,19,6,12 ; vpextrb $0xc,%xmm8,0x6(%r11,%rdx,1)
DB 196,67,121,20,68,19,5,10 ; vpextrb $0xa,%xmm8,0x5(%r11,%rdx,1)
DB 196,67,121,20,68,19,4,8 ; vpextrb $0x8,%xmm8,0x4(%r11,%rdx,1)
- DB 196,98,57,0,5,240,69,0,0 ; vpshufb 0x45f0(%rip),%xmm8,%xmm8 # 81d0 <_sk_callback_avx+0x6d8>
+ DB 196,98,57,0,5,64,68,0,0 ; vpshufb 0x4440(%rip),%xmm8,%xmm8 # 8020 <_sk_callback_avx+0x6cc>
DB 196,65,121,126,4,19 ; vmovd %xmm8,(%r11,%rdx,1)
DB 235,135 ; jmp 3b6f <_sk_store_a8_avx+0x33>
DB 180,255 ; mov $0xff,%ah
@@ -9942,16 +9828,16 @@ _sk_load_g8_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,71 ; jne 3c55 <_sk_load_g8_avx+0x51>
DB 196,194,121,48,4,19 ; vpmovzxbw (%r11,%rdx,1),%xmm0
- DB 197,249,219,5,196,69,0,0 ; vpand 0x45c4(%rip),%xmm0,%xmm0 # 81e0 <_sk_callback_avx+0x6e8>
+ DB 197,249,219,5,20,68,0,0 ; vpand 0x4414(%rip),%xmm0,%xmm0 # 8030 <_sk_callback_avx+0x6dc>
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,108,66,0,0 ; vbroadcastss 0x426c(%rip),%ymm1 # 7ea8 <_sk_callback_avx+0x3b0>
+ DB 196,226,125,24,13,200,64,0,0 ; vbroadcastss 0x40c8(%rip),%ymm1 # 7d04 <_sk_callback_avx+0x3b0>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,97,66,0,0 ; vbroadcastss 0x4261(%rip),%ymm3 # 7eac <_sk_callback_avx+0x3b4>
+ DB 196,226,125,24,29,189,64,0,0 ; vbroadcastss 0x40bd(%rip),%ymm3 # 7d08 <_sk_callback_avx+0x3b4>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
@@ -9996,7 +9882,7 @@ _sk_load_g8_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 233,255,255,255,222 ; jmpq ffffffffdf003cfc <_sk_callback_avx+0xffffffffdeffc204>
+ DB 233,255,255,255,222 ; jmpq ffffffffdf003cfc <_sk_callback_avx+0xffffffffdeffc3a8>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,211 ; callq *%rbx
@@ -10014,16 +9900,16 @@ _sk_load_g8_dst_avx LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,71 ; jne 3d59 <_sk_load_g8_dst_avx+0x51>
DB 196,194,121,48,36,19 ; vpmovzxbw (%r11,%rdx,1),%xmm4
- DB 197,217,219,37,208,68,0,0 ; vpand 0x44d0(%rip),%xmm4,%xmm4 # 81f0 <_sk_callback_avx+0x6f8>
+ DB 197,217,219,37,32,67,0,0 ; vpand 0x4320(%rip),%xmm4,%xmm4 # 8040 <_sk_callback_avx+0x6ec>
DB 197,209,239,237 ; vpxor %xmm5,%xmm5,%xmm5
DB 197,217,105,237 ; vpunpckhwd %xmm5,%xmm4,%xmm5
DB 196,226,121,51,228 ; vpmovzxwd %xmm4,%xmm4
DB 196,227,93,24,229,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,112,65,0,0 ; vbroadcastss 0x4170(%rip),%ymm5 # 7eb0 <_sk_callback_avx+0x3b8>
+ DB 196,226,125,24,45,204,63,0,0 ; vbroadcastss 0x3fcc(%rip),%ymm5 # 7d0c <_sk_callback_avx+0x3b8>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,61,101,65,0,0 ; vbroadcastss 0x4165(%rip),%ymm7 # 7eb4 <_sk_callback_avx+0x3bc>
+ DB 196,226,125,24,61,193,63,0,0 ; vbroadcastss 0x3fc1(%rip),%ymm7 # 7d10 <_sk_callback_avx+0x3bc>
DB 197,252,40,236 ; vmovaps %ymm4,%ymm5
DB 197,252,40,244 ; vmovaps %ymm4,%ymm6
DB 255,224 ; jmpq *%rax
@@ -10068,7 +9954,7 @@ _sk_load_g8_dst_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 233,255,255,255,222 ; jmpq ffffffffdf003e00 <_sk_callback_avx+0xffffffffdeffc308>
+ DB 233,255,255,255,222 ; jmpq ffffffffdf003e00 <_sk_callback_avx+0xffffffffdeffc4ac>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,211 ; callq *%rbx
@@ -10084,7 +9970,7 @@ _sk_gather_g8_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -10121,176 +10007,86 @@ _sk_gather_g8_avx LABEL PROC
DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,224,63,0,0 ; vbroadcastss 0x3fe0(%rip),%ymm1 # 7eb8 <_sk_callback_avx+0x3c0>
+ DB 196,226,125,24,13,60,62,0,0 ; vbroadcastss 0x3e3c(%rip),%ymm1 # 7d14 <_sk_callback_avx+0x3c0>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,213,63,0,0 ; vbroadcastss 0x3fd5(%rip),%ymm3 # 7ebc <_sk_callback_avx+0x3c4>
+ DB 196,226,125,24,29,49,62,0,0 ; vbroadcastss 0x3e31(%rip),%ymm3 # 7d18 <_sk_callback_avx+0x3c4>
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
DB 197,252,40,208 ; vmovaps %ymm0,%ymm2
DB 255,224 ; jmpq *%rax
-PUBLIC _sk_gather_i8_avx
-_sk_gather_i8_avx LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,193 ; mov %rax,%r9
- DB 77,133,201 ; test %r9,%r9
- DB 116,5 ; je 3f00 <_sk_gather_i8_avx+0xf>
- DB 76,137,200 ; mov %r9,%rax
- DB 235,2 ; jmp 3f02 <_sk_gather_i8_avx+0x11>
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 83 ; push %rbx
- DB 76,139,16 ; mov (%rax),%r10
- DB 197,254,91,209 ; vcvttps2dq %ymm1,%ymm2
- DB 197,249,110,72,16 ; vmovd 0x10(%rax),%xmm1
- DB 197,249,112,217,0 ; vpshufd $0x0,%xmm1,%xmm3
- DB 196,226,97,64,202 ; vpmulld %xmm2,%xmm3,%xmm1
- DB 196,227,125,25,210,1 ; vextractf128 $0x1,%ymm2,%xmm2
- DB 196,226,97,64,210 ; vpmulld %xmm2,%xmm3,%xmm2
- DB 197,254,91,192 ; vcvttps2dq %ymm0,%ymm0
- DB 196,227,125,25,195,1 ; vextractf128 $0x1,%ymm0,%xmm3
- DB 197,233,254,211 ; vpaddd %xmm3,%xmm2,%xmm2
- DB 196,193,249,126,211 ; vmovq %xmm2,%r11
- DB 68,137,216 ; mov %r11d,%eax
- DB 196,195,121,32,28,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm3
- DB 196,227,249,22,208,1 ; vpextrq $0x1,%xmm2,%rax
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,131,97,32,20,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm3,%xmm2
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,32 ; shr $0x20,%rax
- DB 197,241,254,192 ; vpaddd %xmm0,%xmm1,%xmm0
- DB 196,131,105,32,12,26,2 ; vpinsrb $0x2,(%r10,%r11,1),%xmm2,%xmm1
- DB 196,193,249,126,195 ; vmovq %xmm0,%r11
- DB 196,195,113,32,12,2,3 ; vpinsrb $0x3,(%r10,%rax,1),%xmm1,%xmm1
- DB 68,137,216 ; mov %r11d,%eax
- DB 196,195,121,32,20,2,0 ; vpinsrb $0x0,(%r10,%rax,1),%xmm0,%xmm2
- DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 73,193,235,32 ; shr $0x20,%r11
- DB 196,131,105,32,4,26,1 ; vpinsrb $0x1,(%r10,%r11,1),%xmm2,%xmm0
- DB 137,216 ; mov %ebx,%eax
- DB 196,195,121,32,4,2,2 ; vpinsrb $0x2,(%r10,%rax,1),%xmm0,%xmm0
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 196,226,121,49,201 ; vpmovzxbd %xmm1,%xmm1
- DB 196,195,121,32,4,26,3 ; vpinsrb $0x3,(%r10,%rbx,1),%xmm0,%xmm0
- DB 196,226,121,49,192 ; vpmovzxbd %xmm0,%xmm0
- DB 77,139,89,8 ; mov 0x8(%r9),%r11
- DB 196,193,249,126,194 ; vmovq %xmm0,%r10
- DB 69,137,209 ; mov %r10d,%r9d
- DB 73,193,234,30 ; shr $0x1e,%r10
- DB 196,129,121,110,20,139 ; vmovd (%r11,%r9,4),%xmm2
- DB 196,227,249,22,195,1 ; vpextrq $0x1,%xmm0,%rbx
- DB 196,131,105,34,4,19,1 ; vpinsrd $0x1,(%r11,%r10,1),%xmm2,%xmm0
- DB 137,216 ; mov %ebx,%eax
- DB 196,195,121,34,4,131,2 ; vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0
- DB 196,225,249,126,200 ; vmovq %xmm1,%rax
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 196,67,121,34,4,27,3 ; vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm8
- DB 137,195 ; mov %eax,%ebx
- DB 196,193,121,110,4,155 ; vmovd (%r11,%rbx,4),%xmm0
- DB 196,227,249,22,203,1 ; vpextrq $0x1,%xmm1,%rbx
- DB 72,193,232,30 ; shr $0x1e,%rax
- DB 196,195,121,34,4,3,1 ; vpinsrd $0x1,(%r11,%rax,1),%xmm0,%xmm0
- DB 137,216 ; mov %ebx,%eax
- DB 196,195,121,34,4,131,2 ; vpinsrd $0x2,(%r11,%rax,4),%xmm0,%xmm0
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 196,195,121,34,28,27,3 ; vpinsrd $0x3,(%r11,%rbx,1),%xmm0,%xmm3
- DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- DB 197,124,40,21,0,67,0,0 ; vmovaps 0x4300(%rip),%ymm10 # 8320 <_sk_callback_avx+0x828>
- DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0
- DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,142,62,0,0 ; vbroadcastss 0x3e8e(%rip),%ymm9 # 7ec0 <_sk_callback_avx+0x3c8>
- DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
- DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1
- DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2
- DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
- DB 196,193,116,84,202 ; vandps %ymm10,%ymm1,%ymm1
- DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,193,116,89,201 ; vmulps %ymm9,%ymm1,%ymm1
- DB 196,193,33,114,208,16 ; vpsrld $0x10,%xmm8,%xmm11
- DB 197,233,114,211,16 ; vpsrld $0x10,%xmm3,%xmm2
- DB 196,227,37,24,210,1 ; vinsertf128 $0x1,%xmm2,%ymm11,%ymm2
- DB 196,193,108,84,210 ; vandps %ymm10,%ymm2,%ymm2
- DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,193,108,89,209 ; vmulps %ymm9,%ymm2,%ymm2
- DB 196,193,57,114,208,24 ; vpsrld $0x18,%xmm8,%xmm8
- DB 197,225,114,211,24 ; vpsrld $0x18,%xmm3,%xmm3
- DB 196,227,61,24,219,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm3
- DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,193,100,89,217 ; vmulps %ymm9,%ymm3,%ymm3
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 255,224 ; jmpq *%rax
-
PUBLIC _sk_load_565_avx
_sk_load_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,128,0,0,0 ; jne 4122 <_sk_load_565_avx+0x8e>
+ DB 15,133,128,0,0,0 ; jne 3f7f <_sk_load_565_avx+0x8e>
DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- DB 196,226,125,24,5,0,62,0,0 ; vbroadcastss 0x3e00(%rip),%ymm0 # 7ec4 <_sk_callback_avx+0x3cc>
+ DB 196,226,125,24,5,251,61,0,0 ; vbroadcastss 0x3dfb(%rip),%ymm0 # 7d1c <_sk_callback_avx+0x3c8>
DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,243,61,0,0 ; vbroadcastss 0x3df3(%rip),%ymm1 # 7ec8 <_sk_callback_avx+0x3d0>
+ DB 196,226,125,24,13,238,61,0,0 ; vbroadcastss 0x3dee(%rip),%ymm1 # 7d20 <_sk_callback_avx+0x3cc>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,234,61,0,0 ; vbroadcastss 0x3dea(%rip),%ymm1 # 7ecc <_sk_callback_avx+0x3d4>
+ DB 196,226,125,24,13,229,61,0,0 ; vbroadcastss 0x3de5(%rip),%ymm1 # 7d24 <_sk_callback_avx+0x3d0>
DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,221,61,0,0 ; vbroadcastss 0x3ddd(%rip),%ymm3 # 7ed0 <_sk_callback_avx+0x3d8>
+ DB 196,226,125,24,29,216,61,0,0 ; vbroadcastss 0x3dd8(%rip),%ymm3 # 7d28 <_sk_callback_avx+0x3d4>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,24,29,212,61,0,0 ; vbroadcastss 0x3dd4(%rip),%ymm3 # 7ed4 <_sk_callback_avx+0x3dc>
+ DB 196,226,125,24,29,207,61,0,0 ; vbroadcastss 0x3dcf(%rip),%ymm3 # 7d2c <_sk_callback_avx+0x3d8>
DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,199,61,0,0 ; vbroadcastss 0x3dc7(%rip),%ymm3 # 7ed8 <_sk_callback_avx+0x3e0>
+ DB 196,226,125,24,29,194,61,0,0 ; vbroadcastss 0x3dc2(%rip),%ymm3 # 7d30 <_sk_callback_avx+0x3dc>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,188,61,0,0 ; vbroadcastss 0x3dbc(%rip),%ymm3 # 7edc <_sk_callback_avx+0x3e4>
+ DB 196,226,125,24,29,183,61,0,0 ; vbroadcastss 0x3db7(%rip),%ymm3 # 7d34 <_sk_callback_avx+0x3e0>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,7 ; and $0x7,%r9b
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,110,255,255,255 ; ja 40a8 <_sk_load_565_avx+0x14>
+ DB 15,135,110,255,255,255 ; ja 3f05 <_sk_load_565_avx+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 41a8 <_sk_load_565_avx+0x114>
+ DB 76,141,21,98,0,0,0 ; lea 0x62(%rip),%r10 # 4004 <_sk_load_565_avx+0x113>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,192 ; vmovd %eax,%xmm0
- DB 233,76,255,255,255 ; jmpq 40a8 <_sk_load_565_avx+0x14>
+ DB 233,76,255,255,255 ; jmpq 3f05 <_sk_load_565_avx+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,110,12,83 ; vmovd (%r11,%rdx,2),%xmm1
DB 196,227,121,14,193,3 ; vpblendw $0x3,%xmm1,%xmm0,%xmm0
- DB 233,47,255,255,255 ; jmpq 40a8 <_sk_load_565_avx+0x14>
+ DB 233,47,255,255,255 ; jmpq 3f05 <_sk_load_565_avx+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,122,126,12,83 ; vmovq (%r11,%rdx,2),%xmm1
DB 196,227,113,14,192,240 ; vpblendw $0xf0,%xmm0,%xmm1,%xmm0
- DB 233,2,255,255,255 ; jmpq 40a8 <_sk_load_565_avx+0x14>
- DB 102,144 ; xchg %ax,%ax
- DB 166 ; cmpsb %es:(%rdi),%ds:(%rsi)
+ DB 233,2,255,255,255 ; jmpq 3f05 <_sk_load_565_avx+0x14>
+ DB 144 ; nop
+ DB 167 ; cmpsl %es:(%rdi),%ds:(%rsi)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,192 ; inc %eax
+ DB 255,193 ; inc %ecx
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,180,255,255,255,237,255 ; pushq -0x120001(%rdi,%rdi,8)
+ DB 255,181,255,255,255,238 ; pushq -0x11000001(%rbp)
DB 255 ; (bad)
- DB 255,229 ; jmpq *%rbp
DB 255 ; (bad)
+ DB 255,230 ; jmpq *%rsi
DB 255 ; (bad)
DB 255 ; (bad)
- DB 221,255 ; (bad)
DB 255 ; (bad)
- DB 255,209 ; callq *%rcx
+ DB 222,255 ; fdivrp %st,%st(7)
+ DB 255 ; (bad)
+ DB 255,210 ; callq *%rdx
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
@@ -10300,56 +10096,56 @@ _sk_load_565_dst_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,128,0,0,0 ; jne 4252 <_sk_load_565_dst_avx+0x8e>
+ DB 15,133,128,0,0,0 ; jne 40ae <_sk_load_565_dst_avx+0x8e>
DB 196,193,122,111,36,83 ; vmovdqu (%r11,%rdx,2),%xmm4
DB 197,209,239,237 ; vpxor %xmm5,%xmm5,%xmm5
DB 197,217,105,237 ; vpunpckhwd %xmm5,%xmm4,%xmm5
DB 196,226,121,51,228 ; vpmovzxwd %xmm4,%xmm4
DB 196,227,93,24,245,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm6
- DB 196,226,125,24,37,236,60,0,0 ; vbroadcastss 0x3cec(%rip),%ymm4 # 7ee0 <_sk_callback_avx+0x3e8>
+ DB 196,226,125,24,37,232,60,0,0 ; vbroadcastss 0x3ce8(%rip),%ymm4 # 7d38 <_sk_callback_avx+0x3e4>
DB 197,204,84,228 ; vandps %ymm4,%ymm6,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,223,60,0,0 ; vbroadcastss 0x3cdf(%rip),%ymm5 # 7ee4 <_sk_callback_avx+0x3ec>
+ DB 196,226,125,24,45,219,60,0,0 ; vbroadcastss 0x3cdb(%rip),%ymm5 # 7d3c <_sk_callback_avx+0x3e8>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
- DB 196,226,125,24,45,214,60,0,0 ; vbroadcastss 0x3cd6(%rip),%ymm5 # 7ee8 <_sk_callback_avx+0x3f0>
+ DB 196,226,125,24,45,210,60,0,0 ; vbroadcastss 0x3cd2(%rip),%ymm5 # 7d40 <_sk_callback_avx+0x3ec>
DB 197,204,84,237 ; vandps %ymm5,%ymm6,%ymm5
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,125,24,61,201,60,0,0 ; vbroadcastss 0x3cc9(%rip),%ymm7 # 7eec <_sk_callback_avx+0x3f4>
+ DB 196,226,125,24,61,197,60,0,0 ; vbroadcastss 0x3cc5(%rip),%ymm7 # 7d44 <_sk_callback_avx+0x3f0>
DB 197,212,89,239 ; vmulps %ymm7,%ymm5,%ymm5
- DB 196,226,125,24,61,192,60,0,0 ; vbroadcastss 0x3cc0(%rip),%ymm7 # 7ef0 <_sk_callback_avx+0x3f8>
+ DB 196,226,125,24,61,188,60,0,0 ; vbroadcastss 0x3cbc(%rip),%ymm7 # 7d48 <_sk_callback_avx+0x3f4>
DB 197,204,84,247 ; vandps %ymm7,%ymm6,%ymm6
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
- DB 196,226,125,24,61,179,60,0,0 ; vbroadcastss 0x3cb3(%rip),%ymm7 # 7ef4 <_sk_callback_avx+0x3fc>
+ DB 196,226,125,24,61,175,60,0,0 ; vbroadcastss 0x3caf(%rip),%ymm7 # 7d4c <_sk_callback_avx+0x3f8>
DB 197,204,89,247 ; vmulps %ymm7,%ymm6,%ymm6
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,61,168,60,0,0 ; vbroadcastss 0x3ca8(%rip),%ymm7 # 7ef8 <_sk_callback_avx+0x400>
+ DB 196,226,125,24,61,164,60,0,0 ; vbroadcastss 0x3ca4(%rip),%ymm7 # 7d50 <_sk_callback_avx+0x3fc>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,7 ; and $0x7,%r9b
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,110,255,255,255 ; ja 41d8 <_sk_load_565_dst_avx+0x14>
+ DB 15,135,110,255,255,255 ; ja 4034 <_sk_load_565_dst_avx+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 42d8 <_sk_load_565_dst_avx+0x114>
+ DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 4134 <_sk_load_565_dst_avx+0x114>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,224 ; vmovd %eax,%xmm4
- DB 233,76,255,255,255 ; jmpq 41d8 <_sk_load_565_dst_avx+0x14>
+ DB 233,76,255,255,255 ; jmpq 4034 <_sk_load_565_dst_avx+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,121,110,44,83 ; vmovd (%r11,%rdx,2),%xmm5
DB 196,227,89,14,229,3 ; vpblendw $0x3,%xmm5,%xmm4,%xmm4
- DB 233,47,255,255,255 ; jmpq 41d8 <_sk_load_565_dst_avx+0x14>
+ DB 233,47,255,255,255 ; jmpq 4034 <_sk_load_565_dst_avx+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,122,126,44,83 ; vmovq (%r11,%rdx,2),%xmm5
DB 196,227,81,14,228,240 ; vpblendw $0xf0,%xmm4,%xmm5,%xmm4
- DB 233,2,255,255,255 ; jmpq 41d8 <_sk_load_565_dst_avx+0x14>
+ DB 233,2,255,255,255 ; jmpq 4034 <_sk_load_565_dst_avx+0x14>
DB 102,144 ; xchg %ax,%ax
DB 166 ; cmpsb %es:(%rdi),%ds:(%rsi)
DB 255 ; (bad)
@@ -10375,7 +10171,7 @@ _sk_gather_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -10416,37 +10212,37 @@ _sk_gather_565_avx LABEL PROC
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,209,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm2
- DB 196,226,125,24,5,54,59,0,0 ; vbroadcastss 0x3b36(%rip),%ymm0 # 7efc <_sk_callback_avx+0x404>
+ DB 196,226,125,24,5,50,59,0,0 ; vbroadcastss 0x3b32(%rip),%ymm0 # 7d54 <_sk_callback_avx+0x400>
DB 197,236,84,192 ; vandps %ymm0,%ymm2,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,41,59,0,0 ; vbroadcastss 0x3b29(%rip),%ymm1 # 7f00 <_sk_callback_avx+0x408>
+ DB 196,226,125,24,13,37,59,0,0 ; vbroadcastss 0x3b25(%rip),%ymm1 # 7d58 <_sk_callback_avx+0x404>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,32,59,0,0 ; vbroadcastss 0x3b20(%rip),%ymm1 # 7f04 <_sk_callback_avx+0x40c>
+ DB 196,226,125,24,13,28,59,0,0 ; vbroadcastss 0x3b1c(%rip),%ymm1 # 7d5c <_sk_callback_avx+0x408>
DB 197,236,84,201 ; vandps %ymm1,%ymm2,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,29,19,59,0,0 ; vbroadcastss 0x3b13(%rip),%ymm3 # 7f08 <_sk_callback_avx+0x410>
+ DB 196,226,125,24,29,15,59,0,0 ; vbroadcastss 0x3b0f(%rip),%ymm3 # 7d60 <_sk_callback_avx+0x40c>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
- DB 196,226,125,24,29,10,59,0,0 ; vbroadcastss 0x3b0a(%rip),%ymm3 # 7f0c <_sk_callback_avx+0x414>
+ DB 196,226,125,24,29,6,59,0,0 ; vbroadcastss 0x3b06(%rip),%ymm3 # 7d64 <_sk_callback_avx+0x410>
DB 197,236,84,211 ; vandps %ymm3,%ymm2,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,226,125,24,29,253,58,0,0 ; vbroadcastss 0x3afd(%rip),%ymm3 # 7f10 <_sk_callback_avx+0x418>
+ DB 196,226,125,24,29,249,58,0,0 ; vbroadcastss 0x3af9(%rip),%ymm3 # 7d68 <_sk_callback_avx+0x414>
DB 197,236,89,211 ; vmulps %ymm3,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,242,58,0,0 ; vbroadcastss 0x3af2(%rip),%ymm3 # 7f14 <_sk_callback_avx+0x41c>
+ DB 196,226,125,24,29,238,58,0,0 ; vbroadcastss 0x3aee(%rip),%ymm3 # 7d6c <_sk_callback_avx+0x418>
DB 255,224 ; jmpq *%rax
PUBLIC _sk_store_565_avx
_sk_store_565_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,230,58,0,0 ; vbroadcastss 0x3ae6(%rip),%ymm8 # 7f18 <_sk_callback_avx+0x420>
+ DB 196,98,125,24,5,226,58,0,0 ; vbroadcastss 0x3ae2(%rip),%ymm8 # 7d70 <_sk_callback_avx+0x41c>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,41,114,241,11 ; vpslld $0xb,%xmm9,%xmm10
DB 196,67,125,25,201,1 ; vextractf128 $0x1,%ymm9,%xmm9
DB 196,193,49,114,241,11 ; vpslld $0xb,%xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
- DB 196,98,125,24,21,191,58,0,0 ; vbroadcastss 0x3abf(%rip),%ymm10 # 7f1c <_sk_callback_avx+0x424>
+ DB 196,98,125,24,21,187,58,0,0 ; vbroadcastss 0x3abb(%rip),%ymm10 # 7d74 <_sk_callback_avx+0x420>
DB 196,65,116,89,210 ; vmulps %ymm10,%ymm1,%ymm10
DB 196,65,125,91,210 ; vcvtps2dq %ymm10,%ymm10
DB 196,193,33,114,242,5 ; vpslld $0x5,%xmm10,%xmm11
@@ -10460,7 +10256,7 @@ _sk_store_565_avx LABEL PROC
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 44ad <_sk_store_565_avx+0x89>
+ DB 117,10 ; jne 4309 <_sk_store_565_avx+0x89>
DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10468,22 +10264,22 @@ _sk_store_565_avx LABEL PROC
DB 65,128,225,7 ; and $0x7,%r9b
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,236 ; ja 44a9 <_sk_store_565_avx+0x85>
+ DB 119,236 ; ja 4305 <_sk_store_565_avx+0x85>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 450c <_sk_store_565_avx+0xe8>
+ DB 76,141,21,68,0,0,0 ; lea 0x44(%rip),%r10 # 4368 <_sk_store_565_avx+0xe8>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- DB 235,207 ; jmp 44a9 <_sk_store_565_avx+0x85>
+ DB 235,207 ; jmp 4305 <_sk_store_565_avx+0x85>
DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
DB 196,65,121,126,4,83 ; vmovd %xmm8,(%r11,%rdx,2)
- DB 235,191 ; jmp 44a9 <_sk_store_565_avx+0x85>
+ DB 235,191 ; jmp 4305 <_sk_store_565_avx+0x85>
DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
DB 196,65,121,214,4,83 ; vmovq %xmm8,(%r11,%rdx,2)
- DB 235,159 ; jmp 44a9 <_sk_store_565_avx+0x85>
+ DB 235,159 ; jmp 4305 <_sk_store_565_avx+0x85>
DB 102,144 ; xchg %ax,%ax
DB 197,255,255 ; (bad)
DB 255,214 ; callq *%rsi
@@ -10512,31 +10308,31 @@ _sk_load_4444_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,152,0,0,0 ; jne 45ce <_sk_load_4444_avx+0xa6>
+ DB 15,133,152,0,0,0 ; jne 442a <_sk_load_4444_avx+0xa6>
DB 196,193,122,111,4,83 ; vmovdqu (%r11,%rdx,2),%xmm0
DB 197,241,239,201 ; vpxor %xmm1,%xmm1,%xmm1
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- DB 196,226,125,24,5,200,57,0,0 ; vbroadcastss 0x39c8(%rip),%ymm0 # 7f20 <_sk_callback_avx+0x428>
+ DB 196,226,125,24,5,196,57,0,0 ; vbroadcastss 0x39c4(%rip),%ymm0 # 7d78 <_sk_callback_avx+0x424>
DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,187,57,0,0 ; vbroadcastss 0x39bb(%rip),%ymm1 # 7f24 <_sk_callback_avx+0x42c>
+ DB 196,226,125,24,13,183,57,0,0 ; vbroadcastss 0x39b7(%rip),%ymm1 # 7d7c <_sk_callback_avx+0x428>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,178,57,0,0 ; vbroadcastss 0x39b2(%rip),%ymm1 # 7f28 <_sk_callback_avx+0x430>
+ DB 196,226,125,24,13,174,57,0,0 ; vbroadcastss 0x39ae(%rip),%ymm1 # 7d80 <_sk_callback_avx+0x42c>
DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,165,57,0,0 ; vbroadcastss 0x39a5(%rip),%ymm2 # 7f2c <_sk_callback_avx+0x434>
+ DB 196,226,125,24,21,161,57,0,0 ; vbroadcastss 0x39a1(%rip),%ymm2 # 7d84 <_sk_callback_avx+0x430>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,156,57,0,0 ; vbroadcastss 0x399c(%rip),%ymm2 # 7f30 <_sk_callback_avx+0x438>
+ DB 196,226,125,24,21,152,57,0,0 ; vbroadcastss 0x3998(%rip),%ymm2 # 7d88 <_sk_callback_avx+0x434>
DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,143,57,0,0 ; vbroadcastss 0x398f(%rip),%ymm8 # 7f34 <_sk_callback_avx+0x43c>
+ DB 196,98,125,24,5,139,57,0,0 ; vbroadcastss 0x398b(%rip),%ymm8 # 7d8c <_sk_callback_avx+0x438>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,133,57,0,0 ; vbroadcastss 0x3985(%rip),%ymm8 # 7f38 <_sk_callback_avx+0x440>
+ DB 196,98,125,24,5,129,57,0,0 ; vbroadcastss 0x3981(%rip),%ymm8 # 7d90 <_sk_callback_avx+0x43c>
DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,119,57,0,0 ; vbroadcastss 0x3977(%rip),%ymm8 # 7f3c <_sk_callback_avx+0x444>
+ DB 196,98,125,24,5,115,57,0,0 ; vbroadcastss 0x3973(%rip),%ymm8 # 7d94 <_sk_callback_avx+0x440>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10545,27 +10341,27 @@ _sk_load_4444_avx LABEL PROC
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,86,255,255,255 ; ja 453c <_sk_load_4444_avx+0x14>
+ DB 15,135,86,255,255,255 ; ja 4398 <_sk_load_4444_avx+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 4654 <_sk_load_4444_avx+0x12c>
+ DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 44b0 <_sk_load_4444_avx+0x12c>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,192 ; vmovd %eax,%xmm0
- DB 233,52,255,255,255 ; jmpq 453c <_sk_load_4444_avx+0x14>
+ DB 233,52,255,255,255 ; jmpq 4398 <_sk_load_4444_avx+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,110,12,83 ; vmovd (%r11,%rdx,2),%xmm1
DB 196,227,121,14,193,3 ; vpblendw $0x3,%xmm1,%xmm0,%xmm0
- DB 233,23,255,255,255 ; jmpq 453c <_sk_load_4444_avx+0x14>
+ DB 233,23,255,255,255 ; jmpq 4398 <_sk_load_4444_avx+0x14>
DB 197,249,239,192 ; vpxor %xmm0,%xmm0,%xmm0
DB 196,193,121,196,68,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,121,196,68,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm0,%xmm0
DB 196,193,122,126,12,83 ; vmovq (%r11,%rdx,2),%xmm1
DB 196,227,113,14,192,240 ; vpblendw $0xf0,%xmm0,%xmm1,%xmm0
- DB 233,234,254,255,255 ; jmpq 453c <_sk_load_4444_avx+0x14>
+ DB 233,234,254,255,255 ; jmpq 4398 <_sk_load_4444_avx+0x14>
DB 102,144 ; xchg %ax,%ax
DB 166 ; cmpsb %es:(%rdi),%ds:(%rsi)
DB 255 ; (bad)
@@ -10591,31 +10387,31 @@ _sk_load_4444_dst_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
DB 77,133,192 ; test %r8,%r8
- DB 15,133,152,0,0,0 ; jne 4716 <_sk_load_4444_dst_avx+0xa6>
+ DB 15,133,152,0,0,0 ; jne 4572 <_sk_load_4444_dst_avx+0xa6>
DB 196,193,122,111,36,83 ; vmovdqu (%r11,%rdx,2),%xmm4
DB 197,209,239,237 ; vpxor %xmm5,%xmm5,%xmm5
DB 197,217,105,237 ; vpunpckhwd %xmm5,%xmm4,%xmm5
DB 196,226,121,51,228 ; vpmovzxwd %xmm4,%xmm4
DB 196,227,93,24,253,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm7
- DB 196,226,125,24,37,160,56,0,0 ; vbroadcastss 0x38a0(%rip),%ymm4 # 7f40 <_sk_callback_avx+0x448>
+ DB 196,226,125,24,37,156,56,0,0 ; vbroadcastss 0x389c(%rip),%ymm4 # 7d98 <_sk_callback_avx+0x444>
DB 197,196,84,228 ; vandps %ymm4,%ymm7,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,226,125,24,45,147,56,0,0 ; vbroadcastss 0x3893(%rip),%ymm5 # 7f44 <_sk_callback_avx+0x44c>
+ DB 196,226,125,24,45,143,56,0,0 ; vbroadcastss 0x388f(%rip),%ymm5 # 7d9c <_sk_callback_avx+0x448>
DB 197,220,89,229 ; vmulps %ymm5,%ymm4,%ymm4
- DB 196,226,125,24,45,138,56,0,0 ; vbroadcastss 0x388a(%rip),%ymm5 # 7f48 <_sk_callback_avx+0x450>
+ DB 196,226,125,24,45,134,56,0,0 ; vbroadcastss 0x3886(%rip),%ymm5 # 7da0 <_sk_callback_avx+0x44c>
DB 197,196,84,237 ; vandps %ymm5,%ymm7,%ymm5
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,226,125,24,53,125,56,0,0 ; vbroadcastss 0x387d(%rip),%ymm6 # 7f4c <_sk_callback_avx+0x454>
+ DB 196,226,125,24,53,121,56,0,0 ; vbroadcastss 0x3879(%rip),%ymm6 # 7da4 <_sk_callback_avx+0x450>
DB 197,212,89,238 ; vmulps %ymm6,%ymm5,%ymm5
- DB 196,226,125,24,53,116,56,0,0 ; vbroadcastss 0x3874(%rip),%ymm6 # 7f50 <_sk_callback_avx+0x458>
+ DB 196,226,125,24,53,112,56,0,0 ; vbroadcastss 0x3870(%rip),%ymm6 # 7da8 <_sk_callback_avx+0x454>
DB 197,196,84,246 ; vandps %ymm6,%ymm7,%ymm6
DB 197,252,91,246 ; vcvtdq2ps %ymm6,%ymm6
- DB 196,98,125,24,5,103,56,0,0 ; vbroadcastss 0x3867(%rip),%ymm8 # 7f54 <_sk_callback_avx+0x45c>
+ DB 196,98,125,24,5,99,56,0,0 ; vbroadcastss 0x3863(%rip),%ymm8 # 7dac <_sk_callback_avx+0x458>
DB 196,193,76,89,240 ; vmulps %ymm8,%ymm6,%ymm6
- DB 196,98,125,24,5,93,56,0,0 ; vbroadcastss 0x385d(%rip),%ymm8 # 7f58 <_sk_callback_avx+0x460>
+ DB 196,98,125,24,5,89,56,0,0 ; vbroadcastss 0x3859(%rip),%ymm8 # 7db0 <_sk_callback_avx+0x45c>
DB 196,193,68,84,248 ; vandps %ymm8,%ymm7,%ymm7
DB 197,252,91,255 ; vcvtdq2ps %ymm7,%ymm7
- DB 196,98,125,24,5,79,56,0,0 ; vbroadcastss 0x384f(%rip),%ymm8 # 7f5c <_sk_callback_avx+0x464>
+ DB 196,98,125,24,5,75,56,0,0 ; vbroadcastss 0x384b(%rip),%ymm8 # 7db4 <_sk_callback_avx+0x460>
DB 196,193,68,89,248 ; vmulps %ymm8,%ymm7,%ymm7
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10624,27 +10420,27 @@ _sk_load_4444_dst_avx LABEL PROC
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 15,135,86,255,255,255 ; ja 4684 <_sk_load_4444_dst_avx+0x14>
+ DB 15,135,86,255,255,255 ; ja 44e0 <_sk_load_4444_dst_avx+0x14>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 479c <_sk_load_4444_dst_avx+0x12c>
+ DB 76,141,21,99,0,0,0 ; lea 0x63(%rip),%r10 # 45f8 <_sk_load_4444_dst_avx+0x12c>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 65,15,183,4,83 ; movzwl (%r11,%rdx,2),%eax
DB 197,249,110,224 ; vmovd %eax,%xmm4
- DB 233,52,255,255,255 ; jmpq 4684 <_sk_load_4444_dst_avx+0x14>
+ DB 233,52,255,255,255 ; jmpq 44e0 <_sk_load_4444_dst_avx+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,4,2 ; vpinsrw $0x2,0x4(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,121,110,44,83 ; vmovd (%r11,%rdx,2),%xmm5
DB 196,227,89,14,229,3 ; vpblendw $0x3,%xmm5,%xmm4,%xmm4
- DB 233,23,255,255,255 ; jmpq 4684 <_sk_load_4444_dst_avx+0x14>
+ DB 233,23,255,255,255 ; jmpq 44e0 <_sk_load_4444_dst_avx+0x14>
DB 197,217,239,228 ; vpxor %xmm4,%xmm4,%xmm4
DB 196,193,89,196,100,83,12,6 ; vpinsrw $0x6,0xc(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,10,5 ; vpinsrw $0x5,0xa(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,89,196,100,83,8,4 ; vpinsrw $0x4,0x8(%r11,%rdx,2),%xmm4,%xmm4
DB 196,193,122,126,44,83 ; vmovq (%r11,%rdx,2),%xmm5
DB 196,227,81,14,228,240 ; vpblendw $0xf0,%xmm4,%xmm5,%xmm4
- DB 233,234,254,255,255 ; jmpq 4684 <_sk_load_4444_dst_avx+0x14>
+ DB 233,234,254,255,255 ; jmpq 44e0 <_sk_load_4444_dst_avx+0x14>
DB 102,144 ; xchg %ax,%ax
DB 166 ; cmpsb %es:(%rdi),%ds:(%rsi)
DB 255 ; (bad)
@@ -10670,7 +10466,7 @@ _sk_gather_4444_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -10711,25 +10507,25 @@ _sk_gather_4444_avx LABEL PROC
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,217,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm3
- DB 196,226,125,24,5,214,54,0,0 ; vbroadcastss 0x36d6(%rip),%ymm0 # 7f60 <_sk_callback_avx+0x468>
+ DB 196,226,125,24,5,210,54,0,0 ; vbroadcastss 0x36d2(%rip),%ymm0 # 7db8 <_sk_callback_avx+0x464>
DB 197,228,84,192 ; vandps %ymm0,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,226,125,24,13,201,54,0,0 ; vbroadcastss 0x36c9(%rip),%ymm1 # 7f64 <_sk_callback_avx+0x46c>
+ DB 196,226,125,24,13,197,54,0,0 ; vbroadcastss 0x36c5(%rip),%ymm1 # 7dbc <_sk_callback_avx+0x468>
DB 197,252,89,193 ; vmulps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,192,54,0,0 ; vbroadcastss 0x36c0(%rip),%ymm1 # 7f68 <_sk_callback_avx+0x470>
+ DB 196,226,125,24,13,188,54,0,0 ; vbroadcastss 0x36bc(%rip),%ymm1 # 7dc0 <_sk_callback_avx+0x46c>
DB 197,228,84,201 ; vandps %ymm1,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,226,125,24,21,179,54,0,0 ; vbroadcastss 0x36b3(%rip),%ymm2 # 7f6c <_sk_callback_avx+0x474>
+ DB 196,226,125,24,21,175,54,0,0 ; vbroadcastss 0x36af(%rip),%ymm2 # 7dc4 <_sk_callback_avx+0x470>
DB 197,244,89,202 ; vmulps %ymm2,%ymm1,%ymm1
- DB 196,226,125,24,21,170,54,0,0 ; vbroadcastss 0x36aa(%rip),%ymm2 # 7f70 <_sk_callback_avx+0x478>
+ DB 196,226,125,24,21,166,54,0,0 ; vbroadcastss 0x36a6(%rip),%ymm2 # 7dc8 <_sk_callback_avx+0x474>
DB 197,228,84,210 ; vandps %ymm2,%ymm3,%ymm2
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
- DB 196,98,125,24,5,157,54,0,0 ; vbroadcastss 0x369d(%rip),%ymm8 # 7f74 <_sk_callback_avx+0x47c>
+ DB 196,98,125,24,5,153,54,0,0 ; vbroadcastss 0x3699(%rip),%ymm8 # 7dcc <_sk_callback_avx+0x478>
DB 196,193,108,89,208 ; vmulps %ymm8,%ymm2,%ymm2
- DB 196,98,125,24,5,147,54,0,0 ; vbroadcastss 0x3693(%rip),%ymm8 # 7f78 <_sk_callback_avx+0x480>
+ DB 196,98,125,24,5,143,54,0,0 ; vbroadcastss 0x368f(%rip),%ymm8 # 7dd0 <_sk_callback_avx+0x47c>
DB 196,193,100,84,216 ; vandps %ymm8,%ymm3,%ymm3
DB 197,252,91,219 ; vcvtdq2ps %ymm3,%ymm3
- DB 196,98,125,24,5,133,54,0,0 ; vbroadcastss 0x3685(%rip),%ymm8 # 7f7c <_sk_callback_avx+0x484>
+ DB 196,98,125,24,5,129,54,0,0 ; vbroadcastss 0x3681(%rip),%ymm8 # 7dd4 <_sk_callback_avx+0x480>
DB 196,193,100,89,216 ; vmulps %ymm8,%ymm3,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10738,7 +10534,7 @@ PUBLIC _sk_store_4444_avx
_sk_store_4444_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,24 ; mov (%rax),%r11
- DB 196,98,125,24,5,114,54,0,0 ; vbroadcastss 0x3672(%rip),%ymm8 # 7f80 <_sk_callback_avx+0x488>
+ DB 196,98,125,24,5,110,54,0,0 ; vbroadcastss 0x366e(%rip),%ymm8 # 7dd8 <_sk_callback_avx+0x484>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,193,41,114,241,12 ; vpslld $0xc,%xmm9,%xmm10
@@ -10765,7 +10561,7 @@ _sk_store_4444_avx LABEL PROC
DB 196,67,125,25,193,1 ; vextractf128 $0x1,%ymm8,%xmm9
DB 196,66,57,43,193 ; vpackusdw %xmm9,%xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 49a7 <_sk_store_4444_avx+0xa7>
+ DB 117,10 ; jne 4803 <_sk_store_4444_avx+0xa7>
DB 196,65,122,127,4,83 ; vmovdqu %xmm8,(%r11,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -10773,22 +10569,22 @@ _sk_store_4444_avx LABEL PROC
DB 65,128,225,7 ; and $0x7,%r9b
DB 65,254,201 ; dec %r9b
DB 65,128,249,6 ; cmp $0x6,%r9b
- DB 119,236 ; ja 49a3 <_sk_store_4444_avx+0xa3>
+ DB 119,236 ; ja 47ff <_sk_store_4444_avx+0xa3>
DB 69,15,182,201 ; movzbl %r9b,%r9d
- DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 4a04 <_sk_store_4444_avx+0x104>
+ DB 76,141,21,66,0,0,0 ; lea 0x42(%rip),%r10 # 4860 <_sk_store_4444_avx+0x104>
DB 75,99,4,138 ; movslq (%r10,%r9,4),%rax
DB 76,1,208 ; add %r10,%rax
DB 255,224 ; jmpq *%rax
DB 196,67,121,21,4,83,0 ; vpextrw $0x0,%xmm8,(%r11,%rdx,2)
- DB 235,207 ; jmp 49a3 <_sk_store_4444_avx+0xa3>
+ DB 235,207 ; jmp 47ff <_sk_store_4444_avx+0xa3>
DB 196,67,121,21,68,83,4,2 ; vpextrw $0x2,%xmm8,0x4(%r11,%rdx,2)
DB 196,65,121,126,4,83 ; vmovd %xmm8,(%r11,%rdx,2)
- DB 235,191 ; jmp 49a3 <_sk_store_4444_avx+0xa3>
+ DB 235,191 ; jmp 47ff <_sk_store_4444_avx+0xa3>
DB 196,67,121,21,68,83,12,6 ; vpextrw $0x6,%xmm8,0xc(%r11,%rdx,2)
DB 196,67,121,21,68,83,10,5 ; vpextrw $0x5,%xmm8,0xa(%r11,%rdx,2)
DB 196,67,121,21,68,83,8,4 ; vpextrw $0x4,%xmm8,0x8(%r11,%rdx,2)
DB 196,65,121,214,4,83 ; vmovq %xmm8,(%r11,%rdx,2)
- DB 235,159 ; jmp 49a3 <_sk_store_4444_avx+0xa3>
+ DB 235,159 ; jmp 47ff <_sk_store_4444_avx+0xa3>
DB 199 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
@@ -10806,7 +10602,7 @@ _sk_store_4444_avx LABEL PROC
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 232,255,255,255,224 ; callq ffffffffe1004a1c <_sk_callback_avx+0xffffffffe0ffcf24>
+ DB 232,255,255,255,224 ; callq ffffffffe1004878 <_sk_callback_avx+0xffffffffe0ffcf24>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255 ; .byte 0xff
@@ -10819,12 +10615,12 @@ _sk_load_8888_avx LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,139,0,0,0 ; jne 4ac5 <_sk_load_8888_avx+0xa5>
+ DB 15,133,139,0,0,0 ; jne 4921 <_sk_load_8888_avx+0xa5>
DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
- DB 197,124,40,21,249,56,0,0 ; vmovaps 0x38f9(%rip),%ymm10 # 8340 <_sk_callback_avx+0x848>
+ DB 197,124,40,21,221,56,0,0 ; vmovaps 0x38dd(%rip),%ymm10 # 8180 <_sk_callback_avx+0x82c>
DB 196,193,100,84,194 ; vandps %ymm10,%ymm3,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,5,43,53,0,0 ; vbroadcastss 0x352b(%rip),%ymm8 # 7f84 <_sk_callback_avx+0x48c>
+ DB 196,98,125,24,5,39,53,0,0 ; vbroadcastss 0x3527(%rip),%ymm8 # 7ddc <_sk_callback_avx+0x488>
DB 196,193,124,89,192 ; vmulps %ymm8,%ymm0,%ymm0
DB 197,241,114,211,8 ; vpsrld $0x8,%xmm3,%xmm1
DB 196,195,125,25,217,1 ; vextractf128 $0x1,%ymm3,%xmm9
@@ -10855,13 +10651,13 @@ _sk_load_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0
- DB 196,226,121,0,13,19,55,0,0 ; vpshufb 0x3713(%rip),%xmm0,%xmm1 # 8200 <_sk_callback_avx+0x708>
+ DB 196,226,121,0,13,7,55,0,0 ; vpshufb 0x3707(%rip),%xmm0,%xmm1 # 8050 <_sk_callback_avx+0x6fc>
DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1
- DB 196,226,121,0,5,21,55,0,0 ; vpshufb 0x3715(%rip),%xmm0,%xmm0 # 8210 <_sk_callback_avx+0x718>
+ DB 196,226,121,0,5,9,55,0,0 ; vpshufb 0x3709(%rip),%xmm0,%xmm0 # 8060 <_sk_callback_avx+0x70c>
DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
- DB 233,47,255,255,255 ; jmpq 4a3f <_sk_load_8888_avx+0x1f>
+ DB 233,47,255,255,255 ; jmpq 489b <_sk_load_8888_avx+0x1f>
PUBLIC _sk_load_8888_dst_avx
_sk_load_8888_dst_avx LABEL PROC
@@ -10871,12 +10667,12 @@ _sk_load_8888_dst_avx LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,139,0,0,0 ; jne 4bb5 <_sk_load_8888_dst_avx+0xa5>
+ DB 15,133,139,0,0,0 ; jne 4a11 <_sk_load_8888_dst_avx+0xa5>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,124,40,21,41,56,0,0 ; vmovaps 0x3829(%rip),%ymm10 # 8360 <_sk_callback_avx+0x868>
+ DB 197,124,40,21,13,56,0,0 ; vmovaps 0x380d(%rip),%ymm10 # 81a0 <_sk_callback_avx+0x84c>
DB 196,193,68,84,226 ; vandps %ymm10,%ymm7,%ymm4
DB 197,252,91,228 ; vcvtdq2ps %ymm4,%ymm4
- DB 196,98,125,24,5,63,52,0,0 ; vbroadcastss 0x343f(%rip),%ymm8 # 7f88 <_sk_callback_avx+0x490>
+ DB 196,98,125,24,5,59,52,0,0 ; vbroadcastss 0x343b(%rip),%ymm8 # 7de0 <_sk_callback_avx+0x48c>
DB 196,193,92,89,224 ; vmulps %ymm8,%ymm4,%ymm4
DB 197,209,114,215,8 ; vpsrld $0x8,%xmm7,%xmm5
DB 196,195,125,25,249,1 ; vextractf128 $0x1,%ymm7,%xmm9
@@ -10907,20 +10703,20 @@ _sk_load_8888_dst_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,121,48,228 ; vpmovzxbw %xmm4,%xmm4
- DB 196,226,89,0,45,67,54,0,0 ; vpshufb 0x3643(%rip),%xmm4,%xmm5 # 8220 <_sk_callback_avx+0x728>
+ DB 196,226,89,0,45,55,54,0,0 ; vpshufb 0x3637(%rip),%xmm4,%xmm5 # 8070 <_sk_callback_avx+0x71c>
DB 196,226,121,33,237 ; vpmovsxbd %xmm5,%xmm5
- DB 196,226,89,0,37,69,54,0,0 ; vpshufb 0x3645(%rip),%xmm4,%xmm4 # 8230 <_sk_callback_avx+0x738>
+ DB 196,226,89,0,37,57,54,0,0 ; vpshufb 0x3639(%rip),%xmm4,%xmm4 # 8080 <_sk_callback_avx+0x72c>
DB 196,226,121,33,228 ; vpmovsxbd %xmm4,%xmm4
DB 196,227,85,24,228,1 ; vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
- DB 233,47,255,255,255 ; jmpq 4b2f <_sk_load_8888_dst_avx+0x1f>
+ DB 233,47,255,255,255 ; jmpq 498b <_sk_load_8888_dst_avx+0x1f>
PUBLIC _sk_gather_8888_avx
_sk_gather_8888_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -10950,10 +10746,10 @@ _sk_gather_8888_avx LABEL PROC
DB 73,193,234,32 ; shr $0x20,%r10
DB 196,131,121,34,28,145,3 ; vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3
DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- DB 197,124,40,21,213,54,0,0 ; vmovaps 0x36d5(%rip),%ymm10 # 8380 <_sk_callback_avx+0x888>
+ DB 197,124,40,21,185,54,0,0 ; vmovaps 0x36b9(%rip),%ymm10 # 81c0 <_sk_callback_avx+0x86c>
DB 196,193,124,84,194 ; vandps %ymm10,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,13,207,50,0,0 ; vbroadcastss 0x32cf(%rip),%ymm9 # 7f8c <_sk_callback_avx+0x494>
+ DB 196,98,125,24,13,203,50,0,0 ; vbroadcastss 0x32cb(%rip),%ymm9 # 7de4 <_sk_callback_avx+0x490>
DB 196,193,124,89,193 ; vmulps %ymm9,%ymm0,%ymm0
DB 196,193,113,114,208,8 ; vpsrld $0x8,%xmm8,%xmm1
DB 197,233,114,211,8 ; vpsrld $0x8,%xmm3,%xmm2
@@ -10982,7 +10778,7 @@ _sk_store_8888_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
- DB 196,98,125,24,5,88,50,0,0 ; vbroadcastss 0x3258(%rip),%ymm8 # 7f90 <_sk_callback_avx+0x498>
+ DB 196,98,125,24,5,84,50,0,0 ; vbroadcastss 0x3254(%rip),%ymm8 # 7de8 <_sk_callback_avx+0x494>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -11007,7 +10803,7 @@ _sk_store_8888_avx LABEL PROC
DB 196,65,45,86,192 ; vorpd %ymm8,%ymm10,%ymm8
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,14 ; jne 4dca <_sk_store_8888_avx+0xac>
+ DB 117,14 ; jne 4c26 <_sk_store_8888_avx+0xac>
DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -11020,25 +10816,25 @@ _sk_store_8888_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,78,52,0,0 ; vpshufb 0x344e(%rip),%xmm9,%xmm10 # 8240 <_sk_callback_avx+0x748>
+ DB 196,98,49,0,21,66,52,0,0 ; vpshufb 0x3442(%rip),%xmm9,%xmm10 # 8090 <_sk_callback_avx+0x73c>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,80,52,0,0 ; vpshufb 0x3450(%rip),%xmm9,%xmm9 # 8250 <_sk_callback_avx+0x758>
+ DB 196,98,49,0,13,68,52,0,0 ; vpshufb 0x3444(%rip),%xmm9,%xmm9 # 80a0 <_sk_callback_avx+0x74c>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
- DB 235,175 ; jmp 4dc1 <_sk_store_8888_avx+0xa3>
+ DB 235,175 ; jmp 4c1d <_sk_store_8888_avx+0xa3>
PUBLIC _sk_store_8888_2d_avx
_sk_store_8888_2d_avx LABEL PROC
DB 80 ; push %rax
DB 73,137,201 ; mov %rcx,%r9
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 72,139,72,8 ; mov 0x8(%rax),%rcx
+ DB 72,99,72,8 ; movslq 0x8(%rax),%rcx
DB 73,15,175,201 ; imul %r9,%rcx
DB 72,193,225,2 ; shl $0x2,%rcx
DB 72,3,8 ; add (%rax),%rcx
DB 72,141,4,145 ; lea (%rcx,%rdx,4),%rax
- DB 196,98,125,24,5,96,49,0,0 ; vbroadcastss 0x3160(%rip),%ymm8 # 7f94 <_sk_callback_avx+0x49c>
+ DB 196,98,125,24,5,92,49,0,0 ; vbroadcastss 0x315c(%rip),%ymm8 # 7dec <_sk_callback_avx+0x498>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -11063,7 +10859,7 @@ _sk_store_8888_2d_avx LABEL PROC
DB 196,65,45,86,192 ; vorpd %ymm8,%ymm10,%ymm8
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,13 ; jne 4ec5 <_sk_store_8888_2d_avx+0xb3>
+ DB 117,13 ; jne 4d21 <_sk_store_8888_2d_avx+0xb3>
DB 197,124,17,0 ; vmovups %ymm8,(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -11076,13 +10872,13 @@ _sk_store_8888_2d_avx LABEL PROC
DB 73,211,234 ; shr %cl,%r10
DB 196,65,249,110,202 ; vmovq %r10,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,115,51,0,0 ; vpshufb 0x3373(%rip),%xmm9,%xmm10 # 8260 <_sk_callback_avx+0x768>
+ DB 196,98,49,0,21,103,51,0,0 ; vpshufb 0x3367(%rip),%xmm9,%xmm10 # 80b0 <_sk_callback_avx+0x75c>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,117,51,0,0 ; vpshufb 0x3375(%rip),%xmm9,%xmm9 # 8270 <_sk_callback_avx+0x778>
+ DB 196,98,49,0,13,105,51,0,0 ; vpshufb 0x3369(%rip),%xmm9,%xmm9 # 80c0 <_sk_callback_avx+0x76c>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
DB 196,98,53,46,0 ; vmaskmovps %ymm8,%ymm9,(%rax)
- DB 235,175 ; jmp 4ebc <_sk_store_8888_2d_avx+0xaa>
+ DB 235,175 ; jmp 4d18 <_sk_store_8888_2d_avx+0xaa>
PUBLIC _sk_load_bgra_avx
_sk_load_bgra_avx LABEL PROC
@@ -11092,12 +10888,12 @@ _sk_load_bgra_avx LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,139,0,0,0 ; jne 4fb2 <_sk_load_bgra_avx+0xa5>
+ DB 15,133,139,0,0,0 ; jne 4e0e <_sk_load_bgra_avx+0xa5>
DB 196,193,124,16,26 ; vmovups (%r10),%ymm3
- DB 197,124,40,21,108,52,0,0 ; vmovaps 0x346c(%rip),%ymm10 # 83a0 <_sk_callback_avx+0x8a8>
+ DB 197,124,40,21,80,52,0,0 ; vmovaps 0x3450(%rip),%ymm10 # 81e0 <_sk_callback_avx+0x88c>
DB 196,193,100,84,202 ; vandps %ymm10,%ymm3,%ymm1
DB 197,252,91,201 ; vcvtdq2ps %ymm1,%ymm1
- DB 196,98,125,24,5,82,48,0,0 ; vbroadcastss 0x3052(%rip),%ymm8 # 7f98 <_sk_callback_avx+0x4a0>
+ DB 196,98,125,24,5,78,48,0,0 ; vbroadcastss 0x304e(%rip),%ymm8 # 7df0 <_sk_callback_avx+0x49c>
DB 196,193,116,89,208 ; vmulps %ymm8,%ymm1,%ymm2
DB 197,241,114,211,8 ; vpsrld $0x8,%xmm3,%xmm1
DB 196,195,125,25,217,1 ; vextractf128 $0x1,%ymm3,%xmm9
@@ -11128,13 +10924,13 @@ _sk_load_bgra_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,192 ; vmovq %rax,%xmm0
DB 196,226,121,48,192 ; vpmovzxbw %xmm0,%xmm0
- DB 196,226,121,0,13,166,50,0,0 ; vpshufb 0x32a6(%rip),%xmm0,%xmm1 # 8280 <_sk_callback_avx+0x788>
+ DB 196,226,121,0,13,154,50,0,0 ; vpshufb 0x329a(%rip),%xmm0,%xmm1 # 80d0 <_sk_callback_avx+0x77c>
DB 196,226,121,33,201 ; vpmovsxbd %xmm1,%xmm1
- DB 196,226,121,0,5,168,50,0,0 ; vpshufb 0x32a8(%rip),%xmm0,%xmm0 # 8290 <_sk_callback_avx+0x798>
+ DB 196,226,121,0,5,156,50,0,0 ; vpshufb 0x329c(%rip),%xmm0,%xmm0 # 80e0 <_sk_callback_avx+0x78c>
DB 196,226,121,33,192 ; vpmovsxbd %xmm0,%xmm0
DB 196,227,117,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm1,%ymm0
DB 196,194,125,44,26 ; vmaskmovps (%r10),%ymm0,%ymm3
- DB 233,47,255,255,255 ; jmpq 4f2c <_sk_load_bgra_avx+0x1f>
+ DB 233,47,255,255,255 ; jmpq 4d88 <_sk_load_bgra_avx+0x1f>
PUBLIC _sk_load_bgra_dst_avx
_sk_load_bgra_dst_avx LABEL PROC
@@ -11144,12 +10940,12 @@ _sk_load_bgra_dst_avx LABEL PROC
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 15,133,139,0,0,0 ; jne 50a2 <_sk_load_bgra_dst_avx+0xa5>
+ DB 15,133,139,0,0,0 ; jne 4efe <_sk_load_bgra_dst_avx+0xa5>
DB 196,193,124,16,58 ; vmovups (%r10),%ymm7
- DB 197,124,40,21,156,51,0,0 ; vmovaps 0x339c(%rip),%ymm10 # 83c0 <_sk_callback_avx+0x8c8>
+ DB 197,124,40,21,128,51,0,0 ; vmovaps 0x3380(%rip),%ymm10 # 8200 <_sk_callback_avx+0x8ac>
DB 196,193,68,84,234 ; vandps %ymm10,%ymm7,%ymm5
DB 197,252,91,237 ; vcvtdq2ps %ymm5,%ymm5
- DB 196,98,125,24,5,102,47,0,0 ; vbroadcastss 0x2f66(%rip),%ymm8 # 7f9c <_sk_callback_avx+0x4a4>
+ DB 196,98,125,24,5,98,47,0,0 ; vbroadcastss 0x2f62(%rip),%ymm8 # 7df4 <_sk_callback_avx+0x4a0>
DB 196,193,84,89,240 ; vmulps %ymm8,%ymm5,%ymm6
DB 197,209,114,215,8 ; vpsrld $0x8,%xmm7,%xmm5
DB 196,195,125,25,249,1 ; vextractf128 $0x1,%ymm7,%xmm9
@@ -11180,20 +10976,20 @@ _sk_load_bgra_dst_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,225,249,110,224 ; vmovq %rax,%xmm4
DB 196,226,121,48,228 ; vpmovzxbw %xmm4,%xmm4
- DB 196,226,89,0,45,214,49,0,0 ; vpshufb 0x31d6(%rip),%xmm4,%xmm5 # 82a0 <_sk_callback_avx+0x7a8>
+ DB 196,226,89,0,45,202,49,0,0 ; vpshufb 0x31ca(%rip),%xmm4,%xmm5 # 80f0 <_sk_callback_avx+0x79c>
DB 196,226,121,33,237 ; vpmovsxbd %xmm5,%xmm5
- DB 196,226,89,0,37,216,49,0,0 ; vpshufb 0x31d8(%rip),%xmm4,%xmm4 # 82b0 <_sk_callback_avx+0x7b8>
+ DB 196,226,89,0,37,204,49,0,0 ; vpshufb 0x31cc(%rip),%xmm4,%xmm4 # 8100 <_sk_callback_avx+0x7ac>
DB 196,226,121,33,228 ; vpmovsxbd %xmm4,%xmm4
DB 196,227,85,24,228,1 ; vinsertf128 $0x1,%xmm4,%ymm5,%ymm4
DB 196,194,93,44,58 ; vmaskmovps (%r10),%ymm4,%ymm7
- DB 233,47,255,255,255 ; jmpq 501c <_sk_load_bgra_dst_avx+0x1f>
+ DB 233,47,255,255,255 ; jmpq 4e78 <_sk_load_bgra_dst_avx+0x1f>
PUBLIC _sk_gather_bgra_avx
_sk_gather_bgra_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -11223,10 +11019,10 @@ _sk_gather_bgra_avx LABEL PROC
DB 73,193,234,32 ; shr $0x20,%r10
DB 196,131,121,34,28,145,3 ; vpinsrd $0x3,(%r9,%r10,4),%xmm0,%xmm3
DB 196,227,61,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm8,%ymm0
- DB 197,124,40,13,72,50,0,0 ; vmovaps 0x3248(%rip),%ymm9 # 83e0 <_sk_callback_avx+0x8e8>
+ DB 197,124,40,13,44,50,0,0 ; vmovaps 0x322c(%rip),%ymm9 # 8220 <_sk_callback_avx+0x8cc>
DB 196,193,124,84,193 ; vandps %ymm9,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,21,246,45,0,0 ; vbroadcastss 0x2df6(%rip),%ymm10 # 7fa0 <_sk_callback_avx+0x4a8>
+ DB 196,98,125,24,21,242,45,0,0 ; vbroadcastss 0x2df2(%rip),%ymm10 # 7df8 <_sk_callback_avx+0x4a4>
DB 196,193,124,89,210 ; vmulps %ymm10,%ymm0,%ymm2
DB 196,193,121,114,208,8 ; vpsrld $0x8,%xmm8,%xmm0
DB 197,241,114,211,8 ; vpsrld $0x8,%xmm3,%xmm1
@@ -11255,7 +11051,7 @@ _sk_store_bgra_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
DB 76,3,16 ; add (%rax),%r10
- DB 196,98,125,24,5,127,45,0,0 ; vbroadcastss 0x2d7f(%rip),%ymm8 # 7fa4 <_sk_callback_avx+0x4ac>
+ DB 196,98,125,24,5,123,45,0,0 ; vbroadcastss 0x2d7b(%rip),%ymm8 # 7dfc <_sk_callback_avx+0x4a8>
DB 196,65,108,89,200 ; vmulps %ymm8,%ymm2,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,65,116,89,208 ; vmulps %ymm8,%ymm1,%ymm10
@@ -11280,7 +11076,7 @@ _sk_store_bgra_avx LABEL PROC
DB 196,65,45,86,192 ; vorpd %ymm8,%ymm10,%ymm8
DB 196,65,53,86,192 ; vorpd %ymm8,%ymm9,%ymm8
DB 77,133,192 ; test %r8,%r8
- DB 117,14 ; jne 52b7 <_sk_store_bgra_avx+0xac>
+ DB 117,14 ; jne 5113 <_sk_store_bgra_avx+0xac>
DB 196,65,124,17,2 ; vmovups %ymm8,(%r10)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,137,201 ; mov %r9,%rcx
@@ -11293,13 +11089,13 @@ _sk_store_bgra_avx LABEL PROC
DB 72,211,232 ; shr %cl,%rax
DB 196,97,249,110,200 ; vmovq %rax,%xmm9
DB 196,66,121,48,201 ; vpmovzxbw %xmm9,%xmm9
- DB 196,98,49,0,21,225,47,0,0 ; vpshufb 0x2fe1(%rip),%xmm9,%xmm10 # 82c0 <_sk_callback_avx+0x7c8>
+ DB 196,98,49,0,21,213,47,0,0 ; vpshufb 0x2fd5(%rip),%xmm9,%xmm10 # 8110 <_sk_callback_avx+0x7bc>
DB 196,66,121,33,210 ; vpmovsxbd %xmm10,%xmm10
- DB 196,98,49,0,13,227,47,0,0 ; vpshufb 0x2fe3(%rip),%xmm9,%xmm9 # 82d0 <_sk_callback_avx+0x7d8>
+ DB 196,98,49,0,13,215,47,0,0 ; vpshufb 0x2fd7(%rip),%xmm9,%xmm9 # 8120 <_sk_callback_avx+0x7cc>
DB 196,66,121,33,201 ; vpmovsxbd %xmm9,%xmm9
DB 196,67,45,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm9
DB 196,66,53,46,2 ; vmaskmovps %ymm8,%ymm9,(%r10)
- DB 235,175 ; jmp 52ae <_sk_store_bgra_avx+0xa3>
+ DB 235,175 ; jmp 510a <_sk_store_bgra_avx+0xa3>
PUBLIC _sk_load_f16_avx
_sk_load_f16_avx LABEL PROC
@@ -11311,7 +11107,7 @@ _sk_load_f16_avx LABEL PROC
DB 197,252,17,116,36,64 ; vmovups %ymm6,0x40(%rsp)
DB 197,252,17,108,36,32 ; vmovups %ymm5,0x20(%rsp)
DB 197,254,127,36,36 ; vmovdqu %ymm4,(%rsp)
- DB 15,133,143,2,0,0 ; jne 55ba <_sk_load_f16_avx+0x2bb>
+ DB 15,133,143,2,0,0 ; jne 5416 <_sk_load_f16_avx+0x2bb>
DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
DB 197,249,16,84,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm2
DB 197,249,16,76,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm1
@@ -11329,13 +11125,13 @@ _sk_load_f16_avx LABEL PROC
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- DB 196,98,125,24,37,36,44,0,0 ; vbroadcastss 0x2c24(%rip),%ymm12 # 7fa8 <_sk_callback_avx+0x4b0>
+ DB 196,98,125,24,37,32,44,0,0 ; vbroadcastss 0x2c20(%rip),%ymm12 # 7e00 <_sk_callback_avx+0x4ac>
DB 196,193,124,84,204 ; vandps %ymm12,%ymm0,%ymm1
DB 197,252,87,193 ; vxorps %ymm1,%ymm0,%ymm0
DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14
- DB 196,98,121,24,29,16,44,0,0 ; vbroadcastss 0x2c10(%rip),%xmm11 # 7fac <_sk_callback_avx+0x4b4>
+ DB 196,98,121,24,29,12,44,0,0 ; vbroadcastss 0x2c0c(%rip),%xmm11 # 7e04 <_sk_callback_avx+0x4b0>
DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3
- DB 196,98,121,24,45,6,44,0,0 ; vbroadcastss 0x2c06(%rip),%xmm13 # 7fb0 <_sk_callback_avx+0x4b8>
+ DB 196,98,121,24,45,2,44,0,0 ; vbroadcastss 0x2c02(%rip),%xmm13 # 7e08 <_sk_callback_avx+0x4b4>
DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3
DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10
DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -11349,7 +11145,7 @@ _sk_load_f16_avx LABEL PROC
DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
DB 197,252,86,193 ; vorps %ymm1,%ymm0,%ymm0
DB 196,227,125,25,193,1 ; vextractf128 $0x1,%ymm0,%xmm1
- DB 196,226,121,24,29,188,43,0,0 ; vbroadcastss 0x2bbc(%rip),%xmm3 # 7fb4 <_sk_callback_avx+0x4bc>
+ DB 196,226,121,24,29,184,43,0,0 ; vbroadcastss 0x2bb8(%rip),%xmm3 # 7e0c <_sk_callback_avx+0x4b8>
DB 197,241,254,203 ; vpaddd %xmm3,%xmm1,%xmm1
DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -11442,29 +11238,29 @@ _sk_load_f16_avx LABEL PROC
DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,79 ; je 5619 <_sk_load_f16_avx+0x31a>
+ DB 116,79 ; je 5475 <_sk_load_f16_avx+0x31a>
DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,67 ; jb 5619 <_sk_load_f16_avx+0x31a>
+ DB 114,67 ; jb 5475 <_sk_load_f16_avx+0x31a>
DB 197,251,16,84,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,68 ; je 5626 <_sk_load_f16_avx+0x327>
+ DB 116,68 ; je 5482 <_sk_load_f16_avx+0x327>
DB 197,233,22,84,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm2,%xmm2
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,56 ; jb 5626 <_sk_load_f16_avx+0x327>
+ DB 114,56 ; jb 5482 <_sk_load_f16_avx+0x327>
DB 197,251,16,76,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm1
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,68,253,255,255 ; je 5342 <_sk_load_f16_avx+0x43>
+ DB 15,132,68,253,255,255 ; je 519e <_sk_load_f16_avx+0x43>
DB 197,241,22,76,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm1,%xmm1
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,52,253,255,255 ; jb 5342 <_sk_load_f16_avx+0x43>
+ DB 15,130,52,253,255,255 ; jb 519e <_sk_load_f16_avx+0x43>
DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
- DB 233,41,253,255,255 ; jmpq 5342 <_sk_load_f16_avx+0x43>
+ DB 233,41,253,255,255 ; jmpq 519e <_sk_load_f16_avx+0x43>
DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,28,253,255,255 ; jmpq 5342 <_sk_load_f16_avx+0x43>
+ DB 233,28,253,255,255 ; jmpq 519e <_sk_load_f16_avx+0x43>
DB 197,241,87,201 ; vxorpd %xmm1,%xmm1,%xmm1
- DB 233,19,253,255,255 ; jmpq 5342 <_sk_load_f16_avx+0x43>
+ DB 233,19,253,255,255 ; jmpq 519e <_sk_load_f16_avx+0x43>
PUBLIC _sk_load_f16_dst_avx
_sk_load_f16_dst_avx LABEL PROC
@@ -11476,7 +11272,7 @@ _sk_load_f16_dst_avx LABEL PROC
DB 197,252,17,84,36,64 ; vmovups %ymm2,0x40(%rsp)
DB 197,252,17,76,36,32 ; vmovups %ymm1,0x20(%rsp)
DB 197,254,127,4,36 ; vmovdqu %ymm0,(%rsp)
- DB 15,133,143,2,0,0 ; jne 58ea <_sk_load_f16_dst_avx+0x2bb>
+ DB 15,133,143,2,0,0 ; jne 5746 <_sk_load_f16_dst_avx+0x2bb>
DB 197,121,16,4,208 ; vmovupd (%rax,%rdx,8),%xmm8
DB 197,249,16,116,208,16 ; vmovupd 0x10(%rax,%rdx,8),%xmm6
DB 197,249,16,108,208,32 ; vmovupd 0x20(%rax,%rdx,8),%xmm5
@@ -11494,13 +11290,13 @@ _sk_load_f16_dst_avx LABEL PROC
DB 197,217,105,232 ; vpunpckhwd %xmm0,%xmm4,%xmm5
DB 196,226,121,51,228 ; vpmovzxwd %xmm4,%xmm4
DB 196,227,93,24,229,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
- DB 196,98,125,24,37,4,41,0,0 ; vbroadcastss 0x2904(%rip),%ymm12 # 7fb8 <_sk_callback_avx+0x4c0>
+ DB 196,98,125,24,37,0,41,0,0 ; vbroadcastss 0x2900(%rip),%ymm12 # 7e10 <_sk_callback_avx+0x4bc>
DB 196,193,92,84,236 ; vandps %ymm12,%ymm4,%ymm5
DB 197,220,87,229 ; vxorps %ymm5,%ymm4,%ymm4
DB 196,195,125,25,230,1 ; vextractf128 $0x1,%ymm4,%xmm14
- DB 196,98,121,24,29,240,40,0,0 ; vbroadcastss 0x28f0(%rip),%xmm11 # 7fbc <_sk_callback_avx+0x4c4>
+ DB 196,98,121,24,29,236,40,0,0 ; vbroadcastss 0x28ec(%rip),%xmm11 # 7e14 <_sk_callback_avx+0x4c0>
DB 196,193,8,87,251 ; vxorps %xmm11,%xmm14,%xmm7
- DB 196,98,121,24,45,230,40,0,0 ; vbroadcastss 0x28e6(%rip),%xmm13 # 7fc0 <_sk_callback_avx+0x4c8>
+ DB 196,98,121,24,45,226,40,0,0 ; vbroadcastss 0x28e2(%rip),%xmm13 # 7e18 <_sk_callback_avx+0x4c4>
DB 197,145,102,255 ; vpcmpgtd %xmm7,%xmm13,%xmm7
DB 196,65,88,87,211 ; vxorps %xmm11,%xmm4,%xmm10
DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -11514,7 +11310,7 @@ _sk_load_f16_dst_avx LABEL PROC
DB 196,227,93,24,231,1 ; vinsertf128 $0x1,%xmm7,%ymm4,%ymm4
DB 197,220,86,229 ; vorps %ymm5,%ymm4,%ymm4
DB 196,227,125,25,229,1 ; vextractf128 $0x1,%ymm4,%xmm5
- DB 196,226,121,24,61,156,40,0,0 ; vbroadcastss 0x289c(%rip),%xmm7 # 7fc4 <_sk_callback_avx+0x4cc>
+ DB 196,226,121,24,61,152,40,0,0 ; vbroadcastss 0x2898(%rip),%xmm7 # 7e1c <_sk_callback_avx+0x4c8>
DB 197,209,254,239 ; vpaddd %xmm7,%xmm5,%xmm5
DB 197,217,254,231 ; vpaddd %xmm7,%xmm4,%xmm4
DB 196,227,93,24,229,1 ; vinsertf128 $0x1,%xmm5,%ymm4,%ymm4
@@ -11607,29 +11403,29 @@ _sk_load_f16_dst_avx LABEL PROC
DB 197,123,16,4,208 ; vmovsd (%rax,%rdx,8),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,79 ; je 5949 <_sk_load_f16_dst_avx+0x31a>
+ DB 116,79 ; je 57a5 <_sk_load_f16_dst_avx+0x31a>
DB 197,57,22,68,208,8 ; vmovhpd 0x8(%rax,%rdx,8),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,67 ; jb 5949 <_sk_load_f16_dst_avx+0x31a>
+ DB 114,67 ; jb 57a5 <_sk_load_f16_dst_avx+0x31a>
DB 197,251,16,116,208,16 ; vmovsd 0x10(%rax,%rdx,8),%xmm6
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,68 ; je 5956 <_sk_load_f16_dst_avx+0x327>
+ DB 116,68 ; je 57b2 <_sk_load_f16_dst_avx+0x327>
DB 197,201,22,116,208,24 ; vmovhpd 0x18(%rax,%rdx,8),%xmm6,%xmm6
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,56 ; jb 5956 <_sk_load_f16_dst_avx+0x327>
+ DB 114,56 ; jb 57b2 <_sk_load_f16_dst_avx+0x327>
DB 197,251,16,108,208,32 ; vmovsd 0x20(%rax,%rdx,8),%xmm5
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,68,253,255,255 ; je 5672 <_sk_load_f16_dst_avx+0x43>
+ DB 15,132,68,253,255,255 ; je 54ce <_sk_load_f16_dst_avx+0x43>
DB 197,209,22,108,208,40 ; vmovhpd 0x28(%rax,%rdx,8),%xmm5,%xmm5
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,52,253,255,255 ; jb 5672 <_sk_load_f16_dst_avx+0x43>
+ DB 15,130,52,253,255,255 ; jb 54ce <_sk_load_f16_dst_avx+0x43>
DB 197,122,126,76,208,48 ; vmovq 0x30(%rax,%rdx,8),%xmm9
- DB 233,41,253,255,255 ; jmpq 5672 <_sk_load_f16_dst_avx+0x43>
+ DB 233,41,253,255,255 ; jmpq 54ce <_sk_load_f16_dst_avx+0x43>
DB 197,209,87,237 ; vxorpd %xmm5,%xmm5,%xmm5
DB 197,201,87,246 ; vxorpd %xmm6,%xmm6,%xmm6
- DB 233,28,253,255,255 ; jmpq 5672 <_sk_load_f16_dst_avx+0x43>
+ DB 233,28,253,255,255 ; jmpq 54ce <_sk_load_f16_dst_avx+0x43>
DB 197,209,87,237 ; vxorpd %xmm5,%xmm5,%xmm5
- DB 233,19,253,255,255 ; jmpq 5672 <_sk_load_f16_dst_avx+0x43>
+ DB 233,19,253,255,255 ; jmpq 54ce <_sk_load_f16_dst_avx+0x43>
PUBLIC _sk_gather_f16_avx
_sk_gather_f16_avx LABEL PROC
@@ -11641,7 +11437,7 @@ _sk_gather_f16_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 197,254,91,201 ; vcvttps2dq %ymm1,%ymm1
- DB 197,249,110,80,16 ; vmovd 0x10(%rax),%xmm2
+ DB 197,249,110,80,8 ; vmovd 0x8(%rax),%xmm2
DB 197,249,112,210,0 ; vpshufd $0x0,%xmm2,%xmm2
DB 196,226,105,64,217 ; vpmulld %xmm1,%xmm2,%xmm3
DB 196,227,125,25,201,1 ; vextractf128 $0x1,%ymm1,%xmm1
@@ -11688,13 +11484,13 @@ _sk_gather_f16_avx LABEL PROC
DB 197,249,105,201 ; vpunpckhwd %xmm1,%xmm0,%xmm1
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
- DB 196,98,125,24,37,93,37,0,0 ; vbroadcastss 0x255d(%rip),%ymm12 # 7fc8 <_sk_callback_avx+0x4d0>
+ DB 196,98,125,24,37,89,37,0,0 ; vbroadcastss 0x2559(%rip),%ymm12 # 7e20 <_sk_callback_avx+0x4cc>
DB 196,193,124,84,204 ; vandps %ymm12,%ymm0,%ymm1
DB 197,252,87,193 ; vxorps %ymm1,%ymm0,%ymm0
DB 196,195,125,25,198,1 ; vextractf128 $0x1,%ymm0,%xmm14
- DB 196,98,121,24,29,73,37,0,0 ; vbroadcastss 0x2549(%rip),%xmm11 # 7fcc <_sk_callback_avx+0x4d4>
+ DB 196,98,121,24,29,69,37,0,0 ; vbroadcastss 0x2545(%rip),%xmm11 # 7e24 <_sk_callback_avx+0x4d0>
DB 196,193,8,87,219 ; vxorps %xmm11,%xmm14,%xmm3
- DB 196,98,121,24,45,63,37,0,0 ; vbroadcastss 0x253f(%rip),%xmm13 # 7fd0 <_sk_callback_avx+0x4d8>
+ DB 196,98,121,24,45,59,37,0,0 ; vbroadcastss 0x253b(%rip),%xmm13 # 7e28 <_sk_callback_avx+0x4d4>
DB 197,145,102,219 ; vpcmpgtd %xmm3,%xmm13,%xmm3
DB 196,65,120,87,211 ; vxorps %xmm11,%xmm0,%xmm10
DB 196,65,17,102,210 ; vpcmpgtd %xmm10,%xmm13,%xmm10
@@ -11708,7 +11504,7 @@ _sk_gather_f16_avx LABEL PROC
DB 196,227,125,24,195,1 ; vinsertf128 $0x1,%xmm3,%ymm0,%ymm0
DB 197,252,86,193 ; vorps %ymm1,%ymm0,%ymm0
DB 196,227,125,25,193,1 ; vextractf128 $0x1,%ymm0,%xmm1
- DB 196,226,121,24,29,245,36,0,0 ; vbroadcastss 0x24f5(%rip),%xmm3 # 7fd4 <_sk_callback_avx+0x4dc>
+ DB 196,226,121,24,29,241,36,0,0 ; vbroadcastss 0x24f1(%rip),%xmm3 # 7e2c <_sk_callback_avx+0x4d8>
DB 197,241,254,203 ; vpaddd %xmm3,%xmm1,%xmm1
DB 197,249,254,195 ; vpaddd %xmm3,%xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
@@ -11806,12 +11602,12 @@ _sk_store_f16_avx LABEL PROC
DB 197,252,17,180,36,128,0,0,0 ; vmovups %ymm6,0x80(%rsp)
DB 197,252,17,108,36,96 ; vmovups %ymm5,0x60(%rsp)
DB 197,252,17,100,36,64 ; vmovups %ymm4,0x40(%rsp)
- DB 196,98,125,24,13,9,35,0,0 ; vbroadcastss 0x2309(%rip),%ymm9 # 7fd8 <_sk_callback_avx+0x4e0>
+ DB 196,98,125,24,13,5,35,0,0 ; vbroadcastss 0x2305(%rip),%ymm9 # 7e30 <_sk_callback_avx+0x4dc>
DB 196,65,124,84,209 ; vandps %ymm9,%ymm0,%ymm10
DB 197,252,17,4,36 ; vmovups %ymm0,(%rsp)
DB 196,65,124,87,218 ; vxorps %ymm10,%ymm0,%ymm11
DB 196,67,125,25,220,1 ; vextractf128 $0x1,%ymm11,%xmm12
- DB 196,98,121,24,5,239,34,0,0 ; vbroadcastss 0x22ef(%rip),%xmm8 # 7fdc <_sk_callback_avx+0x4e4>
+ DB 196,98,121,24,5,235,34,0,0 ; vbroadcastss 0x22eb(%rip),%xmm8 # 7e34 <_sk_callback_avx+0x4e0>
DB 196,65,57,102,236 ; vpcmpgtd %xmm12,%xmm8,%xmm13
DB 196,65,57,102,243 ; vpcmpgtd %xmm11,%xmm8,%xmm14
DB 196,67,13,24,237,1 ; vinsertf128 $0x1,%xmm13,%ymm14,%ymm13
@@ -11821,7 +11617,7 @@ _sk_store_f16_avx LABEL PROC
DB 196,67,13,24,242,1 ; vinsertf128 $0x1,%xmm10,%ymm14,%ymm14
DB 196,193,33,114,211,13 ; vpsrld $0xd,%xmm11,%xmm11
DB 196,193,25,114,212,13 ; vpsrld $0xd,%xmm12,%xmm12
- DB 196,98,125,24,21,182,34,0,0 ; vbroadcastss 0x22b6(%rip),%ymm10 # 7fe0 <_sk_callback_avx+0x4e8>
+ DB 196,98,125,24,21,178,34,0,0 ; vbroadcastss 0x22b2(%rip),%ymm10 # 7e38 <_sk_callback_avx+0x4e4>
DB 196,65,12,86,242 ; vorps %ymm10,%ymm14,%ymm14
DB 196,67,125,25,247,1 ; vextractf128 $0x1,%ymm14,%xmm15
DB 196,65,1,254,228 ; vpaddd %xmm12,%xmm15,%xmm12
@@ -11903,7 +11699,7 @@ _sk_store_f16_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,75 ; jne 5f11 <_sk_store_f16_avx+0x270>
+ DB 117,75 ; jne 5d6d <_sk_store_f16_avx+0x270>
DB 197,120,17,28,208 ; vmovups %xmm11,(%rax,%rdx,8)
DB 197,120,17,84,208,16 ; vmovups %xmm10,0x10(%rax,%rdx,8)
DB 197,120,17,76,208,32 ; vmovups %xmm9,0x20(%rax,%rdx,8)
@@ -11919,22 +11715,22 @@ _sk_store_f16_avx LABEL PROC
DB 255,224 ; jmpq *%rax
DB 197,121,214,28,208 ; vmovq %xmm11,(%rax,%rdx,8)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,193 ; je 5edd <_sk_store_f16_avx+0x23c>
+ DB 116,193 ; je 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,23,92,208,8 ; vmovhpd %xmm11,0x8(%rax,%rdx,8)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,181 ; jb 5edd <_sk_store_f16_avx+0x23c>
+ DB 114,181 ; jb 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,214,84,208,16 ; vmovq %xmm10,0x10(%rax,%rdx,8)
- DB 116,173 ; je 5edd <_sk_store_f16_avx+0x23c>
+ DB 116,173 ; je 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,23,84,208,24 ; vmovhpd %xmm10,0x18(%rax,%rdx,8)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,161 ; jb 5edd <_sk_store_f16_avx+0x23c>
+ DB 114,161 ; jb 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,214,76,208,32 ; vmovq %xmm9,0x20(%rax,%rdx,8)
- DB 116,153 ; je 5edd <_sk_store_f16_avx+0x23c>
+ DB 116,153 ; je 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,23,76,208,40 ; vmovhpd %xmm9,0x28(%rax,%rdx,8)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,141 ; jb 5edd <_sk_store_f16_avx+0x23c>
+ DB 114,141 ; jb 5d39 <_sk_store_f16_avx+0x23c>
DB 197,121,214,68,208,48 ; vmovq %xmm8,0x30(%rax,%rdx,8)
- DB 235,133 ; jmp 5edd <_sk_store_f16_avx+0x23c>
+ DB 235,133 ; jmp 5d39 <_sk_store_f16_avx+0x23c>
PUBLIC _sk_load_u16_be_avx
_sk_load_u16_be_avx LABEL PROC
@@ -11942,7 +11738,7 @@ _sk_load_u16_be_avx LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,253,0,0,0 ; jne 606b <_sk_load_u16_be_avx+0x113>
+ DB 15,133,253,0,0,0 ; jne 5ec7 <_sk_load_u16_be_avx+0x113>
DB 196,65,121,16,4,65 ; vmovupd (%r9,%rax,2),%xmm8
DB 196,193,121,16,84,65,16 ; vmovupd 0x10(%r9,%rax,2),%xmm2
DB 196,193,121,16,92,65,32 ; vmovupd 0x20(%r9,%rax,2),%xmm3
@@ -11964,7 +11760,7 @@ _sk_load_u16_be_avx LABEL PROC
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,29,5,32,0,0 ; vbroadcastss 0x2005(%rip),%ymm11 # 7fe4 <_sk_callback_avx+0x4ec>
+ DB 196,98,125,24,29,1,32,0,0 ; vbroadcastss 0x2001(%rip),%ymm11 # 7e3c <_sk_callback_avx+0x4e8>
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,177,109,202 ; vpunpckhqdq %xmm2,%xmm9,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -11998,29 +11794,29 @@ _sk_load_u16_be_avx LABEL PROC
DB 196,65,123,16,4,65 ; vmovsd (%r9,%rax,2),%xmm8
DB 196,65,49,239,201 ; vpxor %xmm9,%xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,85 ; je 60d1 <_sk_load_u16_be_avx+0x179>
+ DB 116,85 ; je 5f2d <_sk_load_u16_be_avx+0x179>
DB 196,65,57,22,68,65,8 ; vmovhpd 0x8(%r9,%rax,2),%xmm8,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,72 ; jb 60d1 <_sk_load_u16_be_avx+0x179>
+ DB 114,72 ; jb 5f2d <_sk_load_u16_be_avx+0x179>
DB 196,193,123,16,84,65,16 ; vmovsd 0x10(%r9,%rax,2),%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 116,72 ; je 60de <_sk_load_u16_be_avx+0x186>
+ DB 116,72 ; je 5f3a <_sk_load_u16_be_avx+0x186>
DB 196,193,105,22,84,65,24 ; vmovhpd 0x18(%r9,%rax,2),%xmm2,%xmm2
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,59 ; jb 60de <_sk_load_u16_be_avx+0x186>
+ DB 114,59 ; jb 5f3a <_sk_load_u16_be_avx+0x186>
DB 196,193,123,16,92,65,32 ; vmovsd 0x20(%r9,%rax,2),%xmm3
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 15,132,213,254,255,255 ; je 5f89 <_sk_load_u16_be_avx+0x31>
+ DB 15,132,213,254,255,255 ; je 5de5 <_sk_load_u16_be_avx+0x31>
DB 196,193,97,22,92,65,40 ; vmovhpd 0x28(%r9,%rax,2),%xmm3,%xmm3
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 15,130,196,254,255,255 ; jb 5f89 <_sk_load_u16_be_avx+0x31>
+ DB 15,130,196,254,255,255 ; jb 5de5 <_sk_load_u16_be_avx+0x31>
DB 196,65,122,126,76,65,48 ; vmovq 0x30(%r9,%rax,2),%xmm9
- DB 233,184,254,255,255 ; jmpq 5f89 <_sk_load_u16_be_avx+0x31>
+ DB 233,184,254,255,255 ; jmpq 5de5 <_sk_load_u16_be_avx+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
DB 197,233,87,210 ; vxorpd %xmm2,%xmm2,%xmm2
- DB 233,171,254,255,255 ; jmpq 5f89 <_sk_load_u16_be_avx+0x31>
+ DB 233,171,254,255,255 ; jmpq 5de5 <_sk_load_u16_be_avx+0x31>
DB 197,225,87,219 ; vxorpd %xmm3,%xmm3,%xmm3
- DB 233,162,254,255,255 ; jmpq 5f89 <_sk_load_u16_be_avx+0x31>
+ DB 233,162,254,255,255 ; jmpq 5de5 <_sk_load_u16_be_avx+0x31>
PUBLIC _sk_load_rgb_u16_be_avx
_sk_load_rgb_u16_be_avx LABEL PROC
@@ -12028,7 +11824,7 @@ _sk_load_rgb_u16_be_avx LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,243,0,0,0 ; jne 61ec <_sk_load_rgb_u16_be_avx+0x105>
+ DB 15,133,243,0,0,0 ; jne 6048 <_sk_load_rgb_u16_be_avx+0x105>
DB 196,193,122,111,4,65 ; vmovdqu (%r9,%rax,2),%xmm0
DB 196,193,122,111,84,65,12 ; vmovdqu 0xc(%r9,%rax,2),%xmm2
DB 196,193,122,111,76,65,24 ; vmovdqu 0x18(%r9,%rax,2),%xmm1
@@ -12055,7 +11851,7 @@ _sk_load_rgb_u16_be_avx LABEL PROC
DB 196,226,121,51,192 ; vpmovzxwd %xmm0,%xmm0
DB 196,227,125,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm0,%ymm0
DB 197,252,91,192 ; vcvtdq2ps %ymm0,%ymm0
- DB 196,98,125,24,29,101,30,0,0 ; vbroadcastss 0x1e65(%rip),%ymm11 # 7fe8 <_sk_callback_avx+0x4f0>
+ DB 196,98,125,24,29,97,30,0,0 ; vbroadcastss 0x1e61(%rip),%ymm11 # 7e40 <_sk_callback_avx+0x4ec>
DB 196,193,124,89,195 ; vmulps %ymm11,%ymm0,%ymm0
DB 197,185,109,202 ; vpunpckhqdq %xmm2,%xmm8,%xmm1
DB 197,233,113,241,8 ; vpsllw $0x8,%xmm1,%xmm2
@@ -12076,48 +11872,48 @@ _sk_load_rgb_u16_be_avx LABEL PROC
DB 197,252,91,210 ; vcvtdq2ps %ymm2,%ymm2
DB 196,193,108,89,211 ; vmulps %ymm11,%ymm2,%ymm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,29,2,30,0,0 ; vbroadcastss 0x1e02(%rip),%ymm3 # 7fec <_sk_callback_avx+0x4f4>
+ DB 196,226,125,24,29,254,29,0,0 ; vbroadcastss 0x1dfe(%rip),%ymm3 # 7e44 <_sk_callback_avx+0x4f0>
DB 255,224 ; jmpq *%rax
DB 196,193,121,110,4,65 ; vmovd (%r9,%rax,2),%xmm0
DB 196,193,121,196,68,65,4,2 ; vpinsrw $0x2,0x4(%r9,%rax,2),%xmm0,%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,5 ; jne 6205 <_sk_load_rgb_u16_be_avx+0x11e>
- DB 233,40,255,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
+ DB 117,5 ; jne 6061 <_sk_load_rgb_u16_be_avx+0x11e>
+ DB 233,40,255,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
DB 196,193,121,110,76,65,6 ; vmovd 0x6(%r9,%rax,2),%xmm1
DB 196,65,113,196,68,65,10,2 ; vpinsrw $0x2,0xa(%r9,%rax,2),%xmm1,%xmm8
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,26 ; jb 6234 <_sk_load_rgb_u16_be_avx+0x14d>
+ DB 114,26 ; jb 6090 <_sk_load_rgb_u16_be_avx+0x14d>
DB 196,193,121,110,76,65,12 ; vmovd 0xc(%r9,%rax,2),%xmm1
DB 196,193,113,196,84,65,16,2 ; vpinsrw $0x2,0x10(%r9,%rax,2),%xmm1,%xmm2
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 117,10 ; jne 6239 <_sk_load_rgb_u16_be_avx+0x152>
- DB 233,249,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,244,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
+ DB 117,10 ; jne 6095 <_sk_load_rgb_u16_be_avx+0x152>
+ DB 233,249,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,244,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
DB 196,193,121,110,76,65,18 ; vmovd 0x12(%r9,%rax,2),%xmm1
DB 196,65,113,196,76,65,22,2 ; vpinsrw $0x2,0x16(%r9,%rax,2),%xmm1,%xmm9
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,26 ; jb 6268 <_sk_load_rgb_u16_be_avx+0x181>
+ DB 114,26 ; jb 60c4 <_sk_load_rgb_u16_be_avx+0x181>
DB 196,193,121,110,76,65,24 ; vmovd 0x18(%r9,%rax,2),%xmm1
DB 196,193,113,196,76,65,28,2 ; vpinsrw $0x2,0x1c(%r9,%rax,2),%xmm1,%xmm1
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 117,10 ; jne 626d <_sk_load_rgb_u16_be_avx+0x186>
- DB 233,197,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,192,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
+ DB 117,10 ; jne 60c9 <_sk_load_rgb_u16_be_avx+0x186>
+ DB 233,197,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,192,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
DB 196,193,121,110,92,65,30 ; vmovd 0x1e(%r9,%rax,2),%xmm3
DB 196,65,97,196,92,65,34,2 ; vpinsrw $0x2,0x22(%r9,%rax,2),%xmm3,%xmm11
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,20 ; jb 6296 <_sk_load_rgb_u16_be_avx+0x1af>
+ DB 114,20 ; jb 60f2 <_sk_load_rgb_u16_be_avx+0x1af>
DB 196,193,121,110,92,65,36 ; vmovd 0x24(%r9,%rax,2),%xmm3
DB 196,193,97,196,92,65,40,2 ; vpinsrw $0x2,0x28(%r9,%rax,2),%xmm3,%xmm3
- DB 233,151,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
- DB 233,146,254,255,255 ; jmpq 612d <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,151,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
+ DB 233,146,254,255,255 ; jmpq 5f89 <_sk_load_rgb_u16_be_avx+0x46>
PUBLIC _sk_store_u16_be_avx
_sk_store_u16_be_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
- DB 196,98,125,24,5,63,29,0,0 ; vbroadcastss 0x1d3f(%rip),%ymm8 # 7ff0 <_sk_callback_avx+0x4f8>
+ DB 196,98,125,24,5,59,29,0,0 ; vbroadcastss 0x1d3b(%rip),%ymm8 # 7e48 <_sk_callback_avx+0x4f4>
DB 196,65,124,89,200 ; vmulps %ymm8,%ymm0,%ymm9
DB 196,65,125,91,201 ; vcvtps2dq %ymm9,%ymm9
DB 196,67,125,25,202,1 ; vextractf128 $0x1,%ymm9,%xmm10
@@ -12155,7 +11951,7 @@ _sk_store_u16_be_avx LABEL PROC
DB 196,65,17,98,200 ; vpunpckldq %xmm8,%xmm13,%xmm9
DB 196,65,17,106,192 ; vpunpckhdq %xmm8,%xmm13,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,31 ; jne 6395 <_sk_store_u16_be_avx+0xfa>
+ DB 117,31 ; jne 61f1 <_sk_store_u16_be_avx+0xfa>
DB 196,65,120,17,28,65 ; vmovups %xmm11,(%r9,%rax,2)
DB 196,65,120,17,84,65,16 ; vmovups %xmm10,0x10(%r9,%rax,2)
DB 196,65,120,17,76,65,32 ; vmovups %xmm9,0x20(%r9,%rax,2)
@@ -12164,31 +11960,31 @@ _sk_store_u16_be_avx LABEL PROC
DB 255,224 ; jmpq *%rax
DB 196,65,121,214,28,65 ; vmovq %xmm11,(%r9,%rax,2)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 116,240 ; je 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,23,92,65,8 ; vmovhpd %xmm11,0x8(%r9,%rax,2)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 114,227 ; jb 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,214,84,65,16 ; vmovq %xmm10,0x10(%r9,%rax,2)
- DB 116,218 ; je 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 116,218 ; je 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,23,84,65,24 ; vmovhpd %xmm10,0x18(%r9,%rax,2)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,205 ; jb 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 114,205 ; jb 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,214,76,65,32 ; vmovq %xmm9,0x20(%r9,%rax,2)
- DB 116,196 ; je 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 116,196 ; je 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,23,76,65,40 ; vmovhpd %xmm9,0x28(%r9,%rax,2)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,183 ; jb 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 114,183 ; jb 61ed <_sk_store_u16_be_avx+0xf6>
DB 196,65,121,214,68,65,48 ; vmovq %xmm8,0x30(%r9,%rax,2)
- DB 235,174 ; jmp 6391 <_sk_store_u16_be_avx+0xf6>
+ DB 235,174 ; jmp 61ed <_sk_store_u16_be_avx+0xf6>
PUBLIC _sk_load_f32_avx
_sk_load_f32_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 119,110 ; ja 6459 <_sk_load_f32_avx+0x76>
+ DB 119,110 ; ja 62b5 <_sk_load_f32_avx+0x76>
DB 76,139,8 ; mov (%rax),%r9
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
- DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 6484 <_sk_load_f32_avx+0xa1>
+ DB 76,141,29,135,0,0,0 ; lea 0x87(%rip),%r11 # 62e0 <_sk_load_f32_avx+0xa1>
DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
DB 76,1,216 ; add %r11,%rax
DB 255,224 ; jmpq *%rax
@@ -12237,10 +12033,10 @@ PUBLIC _sk_load_f32_dst_avx
_sk_load_f32_dst_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 119,110 ; ja 651a <_sk_load_f32_dst_avx+0x76>
+ DB 119,110 ; ja 6376 <_sk_load_f32_dst_avx+0x76>
DB 76,139,8 ; mov (%rax),%r9
DB 76,141,20,149,0,0,0,0 ; lea 0x0(,%rdx,4),%r10
- DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 6544 <_sk_load_f32_dst_avx+0xa0>
+ DB 76,141,29,134,0,0,0 ; lea 0x86(%rip),%r11 # 63a0 <_sk_load_f32_dst_avx+0xa0>
DB 75,99,4,131 ; movslq (%r11,%r8,4),%rax
DB 76,1,216 ; add %r11,%rax
DB 255,224 ; jmpq *%rax
@@ -12297,7 +12093,7 @@ _sk_store_f32_avx LABEL PROC
DB 196,65,37,20,196 ; vunpcklpd %ymm12,%ymm11,%ymm8
DB 196,65,37,21,220 ; vunpckhpd %ymm12,%ymm11,%ymm11
DB 77,133,192 ; test %r8,%r8
- DB 117,55 ; jne 65d1 <_sk_store_f32_avx+0x6d>
+ DB 117,55 ; jne 642d <_sk_store_f32_avx+0x6d>
DB 196,67,45,24,225,1 ; vinsertf128 $0x1,%xmm9,%ymm10,%ymm12
DB 196,67,61,24,235,1 ; vinsertf128 $0x1,%xmm11,%ymm8,%ymm13
DB 196,67,45,6,201,49 ; vperm2f128 $0x31,%ymm9,%ymm10,%ymm9
@@ -12310,22 +12106,22 @@ _sk_store_f32_avx LABEL PROC
DB 255,224 ; jmpq *%rax
DB 196,65,121,17,20,129 ; vmovupd %xmm10,(%r9,%rax,4)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 65cd <_sk_store_f32_avx+0x69>
+ DB 116,240 ; je 6429 <_sk_store_f32_avx+0x69>
DB 196,65,121,17,76,129,16 ; vmovupd %xmm9,0x10(%r9,%rax,4)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 65cd <_sk_store_f32_avx+0x69>
+ DB 114,227 ; jb 6429 <_sk_store_f32_avx+0x69>
DB 196,65,121,17,68,129,32 ; vmovupd %xmm8,0x20(%r9,%rax,4)
- DB 116,218 ; je 65cd <_sk_store_f32_avx+0x69>
+ DB 116,218 ; je 6429 <_sk_store_f32_avx+0x69>
DB 196,65,121,17,92,129,48 ; vmovupd %xmm11,0x30(%r9,%rax,4)
DB 73,131,248,5 ; cmp $0x5,%r8
- DB 114,205 ; jb 65cd <_sk_store_f32_avx+0x69>
+ DB 114,205 ; jb 6429 <_sk_store_f32_avx+0x69>
DB 196,67,125,25,84,129,64,1 ; vextractf128 $0x1,%ymm10,0x40(%r9,%rax,4)
- DB 116,195 ; je 65cd <_sk_store_f32_avx+0x69>
+ DB 116,195 ; je 6429 <_sk_store_f32_avx+0x69>
DB 196,67,125,25,76,129,80,1 ; vextractf128 $0x1,%ymm9,0x50(%r9,%rax,4)
DB 73,131,248,7 ; cmp $0x7,%r8
- DB 114,181 ; jb 65cd <_sk_store_f32_avx+0x69>
+ DB 114,181 ; jb 6429 <_sk_store_f32_avx+0x69>
DB 196,67,125,25,68,129,96,1 ; vextractf128 $0x1,%ymm8,0x60(%r9,%rax,4)
- DB 235,171 ; jmp 65cd <_sk_store_f32_avx+0x69>
+ DB 235,171 ; jmp 6429 <_sk_store_f32_avx+0x69>
PUBLIC _sk_clamp_x_avx
_sk_clamp_x_avx LABEL PROC
@@ -12404,7 +12200,7 @@ _sk_mirror_x_avx LABEL PROC
DB 196,193,58,88,192 ; vaddss %xmm8,%xmm8,%xmm0
DB 196,227,121,4,192,0 ; vpermilps $0x0,%xmm0,%xmm0
DB 196,99,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm8
- DB 197,178,89,5,175,24,0,0 ; vmulss 0x18af(%rip),%xmm9,%xmm0 # 7ff4 <_sk_callback_avx+0x4fc>
+ DB 197,178,89,5,171,24,0,0 ; vmulss 0x18ab(%rip),%xmm9,%xmm0 # 7e4c <_sk_callback_avx+0x4f8>
DB 196,227,121,4,192,0 ; vpermilps $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,164,89,192 ; vmulps %ymm0,%ymm11,%ymm0
@@ -12435,7 +12231,7 @@ _sk_mirror_y_avx LABEL PROC
DB 196,193,58,88,200 ; vaddss %xmm8,%xmm8,%xmm1
DB 196,227,121,4,201,0 ; vpermilps $0x0,%xmm1,%xmm1
DB 196,99,117,24,193,1 ; vinsertf128 $0x1,%xmm1,%ymm1,%ymm8
- DB 197,178,89,13,42,24,0,0 ; vmulss 0x182a(%rip),%xmm9,%xmm1 # 7ff8 <_sk_callback_avx+0x500>
+ DB 197,178,89,13,38,24,0,0 ; vmulss 0x1826(%rip),%xmm9,%xmm1 # 7e50 <_sk_callback_avx+0x4fc>
DB 196,227,121,4,201,0 ; vpermilps $0x0,%xmm1,%xmm1
DB 196,227,117,24,201,1 ; vinsertf128 $0x1,%xmm1,%ymm1,%ymm1
DB 197,164,89,201 ; vmulps %ymm1,%ymm11,%ymm1
@@ -12459,7 +12255,7 @@ PUBLIC _sk_clamp_x_1_avx
_sk_clamp_x_1_avx LABEL PROC
DB 196,65,60,87,192 ; vxorps %ymm8,%ymm8,%ymm8
DB 197,188,95,192 ; vmaxps %ymm0,%ymm8,%ymm0
- DB 196,98,125,24,5,200,23,0,0 ; vbroadcastss 0x17c8(%rip),%ymm8 # 7ffc <_sk_callback_avx+0x504>
+ DB 196,98,125,24,5,196,23,0,0 ; vbroadcastss 0x17c4(%rip),%ymm8 # 7e54 <_sk_callback_avx+0x500>
DB 196,193,124,93,192 ; vminps %ymm8,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -12473,9 +12269,9 @@ _sk_repeat_x_1_avx LABEL PROC
PUBLIC _sk_mirror_x_1_avx
_sk_mirror_x_1_avx LABEL PROC
- DB 196,98,125,24,5,171,23,0,0 ; vbroadcastss 0x17ab(%rip),%ymm8 # 8000 <_sk_callback_avx+0x508>
+ DB 196,98,125,24,5,167,23,0,0 ; vbroadcastss 0x17a7(%rip),%ymm8 # 7e58 <_sk_callback_avx+0x504>
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,13,161,23,0,0 ; vbroadcastss 0x17a1(%rip),%ymm9 # 8004 <_sk_callback_avx+0x50c>
+ DB 196,98,125,24,13,157,23,0,0 ; vbroadcastss 0x179d(%rip),%ymm9 # 7e5c <_sk_callback_avx+0x508>
DB 196,65,124,89,201 ; vmulps %ymm9,%ymm0,%ymm9
DB 196,67,125,8,201,1 ; vroundps $0x1,%ymm9,%ymm9
DB 196,65,52,88,201 ; vaddps %ymm9,%ymm9,%ymm9
@@ -12489,12 +12285,12 @@ _sk_mirror_x_1_avx LABEL PROC
PUBLIC _sk_luminance_to_alpha_avx
_sk_luminance_to_alpha_avx LABEL PROC
- DB 196,226,125,24,29,113,23,0,0 ; vbroadcastss 0x1771(%rip),%ymm3 # 8008 <_sk_callback_avx+0x510>
+ DB 196,226,125,24,29,109,23,0,0 ; vbroadcastss 0x176d(%rip),%ymm3 # 7e60 <_sk_callback_avx+0x50c>
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,29,104,23,0,0 ; vbroadcastss 0x1768(%rip),%ymm3 # 800c <_sk_callback_avx+0x514>
+ DB 196,226,125,24,29,100,23,0,0 ; vbroadcastss 0x1764(%rip),%ymm3 # 7e64 <_sk_callback_avx+0x510>
DB 197,244,89,203 ; vmulps %ymm3,%ymm1,%ymm1
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
- DB 196,226,125,24,13,91,23,0,0 ; vbroadcastss 0x175b(%rip),%ymm1 # 8010 <_sk_callback_avx+0x518>
+ DB 196,226,125,24,13,87,23,0,0 ; vbroadcastss 0x1757(%rip),%ymm1 # 7e68 <_sk_callback_avx+0x514>
DB 197,236,89,201 ; vmulps %ymm1,%ymm2,%ymm1
DB 197,252,88,217 ; vaddps %ymm1,%ymm0,%ymm3
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -12727,9 +12523,9 @@ _sk_evenly_spaced_gradient_avx LABEL PROC
DB 72,139,24 ; mov (%rax),%rbx
DB 72,139,104,8 ; mov 0x8(%rax),%rbp
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 6c5c <_sk_evenly_spaced_gradient_avx+0x28>
+ DB 120,7 ; js 6ab8 <_sk_evenly_spaced_gradient_avx+0x28>
DB 196,225,242,42,203 ; vcvtsi2ss %rbx,%xmm1,%xmm1
- DB 235,21 ; jmp 6c71 <_sk_evenly_spaced_gradient_avx+0x3d>
+ DB 235,21 ; jmp 6acd <_sk_evenly_spaced_gradient_avx+0x3d>
DB 73,137,217 ; mov %rbx,%r9
DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
@@ -12886,18 +12682,18 @@ _sk_evenly_spaced_gradient_avx LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_avx
_sk_gauss_a_to_rgba_avx LABEL PROC
- DB 196,226,125,24,5,60,16,0,0 ; vbroadcastss 0x103c(%rip),%ymm0 # 8014 <_sk_callback_avx+0x51c>
+ DB 196,226,125,24,5,56,16,0,0 ; vbroadcastss 0x1038(%rip),%ymm0 # 7e6c <_sk_callback_avx+0x518>
DB 197,228,89,192 ; vmulps %ymm0,%ymm3,%ymm0
- DB 196,226,125,24,13,51,16,0,0 ; vbroadcastss 0x1033(%rip),%ymm1 # 8018 <_sk_callback_avx+0x520>
+ DB 196,226,125,24,13,47,16,0,0 ; vbroadcastss 0x102f(%rip),%ymm1 # 7e70 <_sk_callback_avx+0x51c>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,38,16,0,0 ; vbroadcastss 0x1026(%rip),%ymm1 # 801c <_sk_callback_avx+0x524>
+ DB 196,226,125,24,13,34,16,0,0 ; vbroadcastss 0x1022(%rip),%ymm1 # 7e74 <_sk_callback_avx+0x520>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,25,16,0,0 ; vbroadcastss 0x1019(%rip),%ymm1 # 8020 <_sk_callback_avx+0x528>
+ DB 196,226,125,24,13,21,16,0,0 ; vbroadcastss 0x1015(%rip),%ymm1 # 7e78 <_sk_callback_avx+0x524>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 197,252,89,195 ; vmulps %ymm3,%ymm0,%ymm0
- DB 196,226,125,24,13,12,16,0,0 ; vbroadcastss 0x100c(%rip),%ymm1 # 8024 <_sk_callback_avx+0x52c>
+ DB 196,226,125,24,13,8,16,0,0 ; vbroadcastss 0x1008(%rip),%ymm1 # 7e7c <_sk_callback_avx+0x528>
DB 197,252,88,193 ; vaddps %ymm1,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 197,252,40,200 ; vmovaps %ymm0,%ymm1
@@ -12919,12 +12715,12 @@ _sk_gradient_avx LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 73,131,249,2 ; cmp $0x2,%r9
- DB 114,80 ; jb 709e <_sk_gradient_avx+0x72>
+ DB 114,80 ; jb 6efa <_sk_gradient_avx+0x72>
DB 72,139,88,72 ; mov 0x48(%rax),%rbx
DB 73,255,201 ; dec %r9
DB 72,131,195,4 ; add $0x4,%rbx
DB 196,65,52,87,201 ; vxorps %ymm9,%ymm9,%ymm9
- DB 196,98,125,24,21,193,15,0,0 ; vbroadcastss 0xfc1(%rip),%ymm10 # 8028 <_sk_callback_avx+0x530>
+ DB 196,98,125,24,21,189,15,0,0 ; vbroadcastss 0xfbd(%rip),%ymm10 # 7e80 <_sk_callback_avx+0x52c>
DB 197,244,87,201 ; vxorps %ymm1,%ymm1,%ymm1
DB 196,98,125,24,3 ; vbroadcastss (%rbx),%ymm8
DB 197,60,194,192,2 ; vcmpleps %ymm0,%ymm8,%ymm8
@@ -12936,7 +12732,7 @@ _sk_gradient_avx LABEL PROC
DB 196,227,117,24,202,1 ; vinsertf128 $0x1,%xmm2,%ymm1,%ymm1
DB 72,131,195,4 ; add $0x4,%rbx
DB 73,255,201 ; dec %r9
- DB 117,205 ; jne 706b <_sk_gradient_avx+0x3f>
+ DB 117,205 ; jne 6ec7 <_sk_gradient_avx+0x3f>
DB 196,195,249,22,201,1 ; vpextrq $0x1,%xmm1,%r9
DB 69,137,202 ; mov %r9d,%r10d
DB 73,193,233,32 ; shr $0x20,%r9
@@ -13116,27 +12912,27 @@ _sk_xy_to_unit_angle_avx LABEL PROC
DB 196,65,52,95,226 ; vmaxps %ymm10,%ymm9,%ymm12
DB 196,65,36,94,220 ; vdivps %ymm12,%ymm11,%ymm11
DB 196,65,36,89,227 ; vmulps %ymm11,%ymm11,%ymm12
- DB 196,98,125,24,45,180,11,0,0 ; vbroadcastss 0xbb4(%rip),%ymm13 # 802c <_sk_callback_avx+0x534>
+ DB 196,98,125,24,45,176,11,0,0 ; vbroadcastss 0xbb0(%rip),%ymm13 # 7e84 <_sk_callback_avx+0x530>
DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13
- DB 196,98,125,24,53,170,11,0,0 ; vbroadcastss 0xbaa(%rip),%ymm14 # 8030 <_sk_callback_avx+0x538>
+ DB 196,98,125,24,53,166,11,0,0 ; vbroadcastss 0xba6(%rip),%ymm14 # 7e88 <_sk_callback_avx+0x534>
DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13
DB 196,65,28,89,237 ; vmulps %ymm13,%ymm12,%ymm13
- DB 196,98,125,24,53,155,11,0,0 ; vbroadcastss 0xb9b(%rip),%ymm14 # 8034 <_sk_callback_avx+0x53c>
+ DB 196,98,125,24,53,151,11,0,0 ; vbroadcastss 0xb97(%rip),%ymm14 # 7e8c <_sk_callback_avx+0x538>
DB 196,65,20,88,238 ; vaddps %ymm14,%ymm13,%ymm13
DB 196,65,28,89,229 ; vmulps %ymm13,%ymm12,%ymm12
- DB 196,98,125,24,45,140,11,0,0 ; vbroadcastss 0xb8c(%rip),%ymm13 # 8038 <_sk_callback_avx+0x540>
+ DB 196,98,125,24,45,136,11,0,0 ; vbroadcastss 0xb88(%rip),%ymm13 # 7e90 <_sk_callback_avx+0x53c>
DB 196,65,28,88,229 ; vaddps %ymm13,%ymm12,%ymm12
DB 196,65,36,89,220 ; vmulps %ymm12,%ymm11,%ymm11
DB 196,65,52,194,202,1 ; vcmpltps %ymm10,%ymm9,%ymm9
- DB 196,98,125,24,21,119,11,0,0 ; vbroadcastss 0xb77(%rip),%ymm10 # 803c <_sk_callback_avx+0x544>
+ DB 196,98,125,24,21,115,11,0,0 ; vbroadcastss 0xb73(%rip),%ymm10 # 7e94 <_sk_callback_avx+0x540>
DB 196,65,44,92,211 ; vsubps %ymm11,%ymm10,%ymm10
DB 196,67,37,74,202,144 ; vblendvps %ymm9,%ymm10,%ymm11,%ymm9
DB 196,193,124,194,192,1 ; vcmpltps %ymm8,%ymm0,%ymm0
- DB 196,98,125,24,21,97,11,0,0 ; vbroadcastss 0xb61(%rip),%ymm10 # 8040 <_sk_callback_avx+0x548>
+ DB 196,98,125,24,21,93,11,0,0 ; vbroadcastss 0xb5d(%rip),%ymm10 # 7e98 <_sk_callback_avx+0x544>
DB 196,65,44,92,209 ; vsubps %ymm9,%ymm10,%ymm10
DB 196,195,53,74,194,0 ; vblendvps %ymm0,%ymm10,%ymm9,%ymm0
DB 196,65,116,194,200,1 ; vcmpltps %ymm8,%ymm1,%ymm9
- DB 196,98,125,24,21,75,11,0,0 ; vbroadcastss 0xb4b(%rip),%ymm10 # 8044 <_sk_callback_avx+0x54c>
+ DB 196,98,125,24,21,71,11,0,0 ; vbroadcastss 0xb47(%rip),%ymm10 # 7e9c <_sk_callback_avx+0x548>
DB 197,44,92,208 ; vsubps %ymm0,%ymm10,%ymm10
DB 196,195,125,74,194,144 ; vblendvps %ymm9,%ymm10,%ymm0,%ymm0
DB 196,65,124,194,200,3 ; vcmpunordps %ymm8,%ymm0,%ymm9
@@ -13162,7 +12958,7 @@ _sk_xy_to_2pt_conical_quadratic_max_avx LABEL PROC
DB 196,67,121,4,210,0 ; vpermilps $0x0,%xmm10,%xmm10
DB 196,67,45,24,210,1 ; vinsertf128 $0x1,%xmm10,%ymm10,%ymm10
DB 197,44,88,208 ; vaddps %ymm0,%ymm10,%ymm10
- DB 196,98,125,24,29,245,10,0,0 ; vbroadcastss 0xaf5(%rip),%ymm11 # 8048 <_sk_callback_avx+0x550>
+ DB 196,98,125,24,29,241,10,0,0 ; vbroadcastss 0xaf1(%rip),%ymm11 # 7ea0 <_sk_callback_avx+0x54c>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
DB 197,252,89,192 ; vmulps %ymm0,%ymm0,%ymm0
DB 197,116,89,217 ; vmulps %ymm1,%ymm1,%ymm11
@@ -13171,17 +12967,17 @@ _sk_xy_to_2pt_conical_quadratic_max_avx LABEL PROC
DB 196,227,121,4,192,0 ; vpermilps $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,13,201,10,0,0 ; vbroadcastss 0xac9(%rip),%ymm9 # 804c <_sk_callback_avx+0x554>
+ DB 196,98,125,24,13,197,10,0,0 ; vbroadcastss 0xac5(%rip),%ymm9 # 7ea4 <_sk_callback_avx+0x550>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,65,44,89,194 ; vmulps %ymm10,%ymm10,%ymm8
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
DB 197,252,81,192 ; vsqrtps %ymm0,%ymm0
DB 196,98,125,24,64,36 ; vbroadcastss 0x24(%rax),%ymm8
- DB 196,98,125,24,13,167,10,0,0 ; vbroadcastss 0xaa7(%rip),%ymm9 # 8050 <_sk_callback_avx+0x558>
+ DB 196,98,125,24,13,163,10,0,0 ; vbroadcastss 0xaa3(%rip),%ymm9 # 7ea8 <_sk_callback_avx+0x554>
DB 196,65,44,87,201 ; vxorps %ymm9,%ymm10,%ymm9
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,152,10,0,0 ; vbroadcastss 0xa98(%rip),%ymm11 # 8054 <_sk_callback_avx+0x55c>
+ DB 196,98,125,24,29,148,10,0,0 ; vbroadcastss 0xa94(%rip),%ymm11 # 7eac <_sk_callback_avx+0x558>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 196,65,60,89,210 ; vmulps %ymm10,%ymm8,%ymm10
DB 197,180,92,192 ; vsubps %ymm0,%ymm9,%ymm0
@@ -13199,7 +12995,7 @@ _sk_xy_to_2pt_conical_quadratic_min_avx LABEL PROC
DB 196,67,121,4,210,0 ; vpermilps $0x0,%xmm10,%xmm10
DB 196,67,45,24,210,1 ; vinsertf128 $0x1,%xmm10,%ymm10,%ymm10
DB 197,44,88,208 ; vaddps %ymm0,%ymm10,%ymm10
- DB 196,98,125,24,29,87,10,0,0 ; vbroadcastss 0xa57(%rip),%ymm11 # 8058 <_sk_callback_avx+0x560>
+ DB 196,98,125,24,29,83,10,0,0 ; vbroadcastss 0xa53(%rip),%ymm11 # 7eb0 <_sk_callback_avx+0x55c>
DB 196,65,44,89,211 ; vmulps %ymm11,%ymm10,%ymm10
DB 197,252,89,192 ; vmulps %ymm0,%ymm0,%ymm0
DB 197,116,89,217 ; vmulps %ymm1,%ymm1,%ymm11
@@ -13208,17 +13004,17 @@ _sk_xy_to_2pt_conical_quadratic_min_avx LABEL PROC
DB 196,227,121,4,192,0 ; vpermilps $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,164,92,192 ; vsubps %ymm0,%ymm11,%ymm0
- DB 196,98,125,24,13,43,10,0,0 ; vbroadcastss 0xa2b(%rip),%ymm9 # 805c <_sk_callback_avx+0x564>
+ DB 196,98,125,24,13,39,10,0,0 ; vbroadcastss 0xa27(%rip),%ymm9 # 7eb4 <_sk_callback_avx+0x560>
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
DB 197,188,89,192 ; vmulps %ymm0,%ymm8,%ymm0
DB 196,65,44,89,194 ; vmulps %ymm10,%ymm10,%ymm8
DB 196,193,124,88,192 ; vaddps %ymm8,%ymm0,%ymm0
DB 197,252,81,192 ; vsqrtps %ymm0,%ymm0
DB 196,98,125,24,64,36 ; vbroadcastss 0x24(%rax),%ymm8
- DB 196,98,125,24,13,9,10,0,0 ; vbroadcastss 0xa09(%rip),%ymm9 # 8060 <_sk_callback_avx+0x568>
+ DB 196,98,125,24,13,5,10,0,0 ; vbroadcastss 0xa05(%rip),%ymm9 # 7eb8 <_sk_callback_avx+0x564>
DB 196,65,44,87,201 ; vxorps %ymm9,%ymm10,%ymm9
DB 196,65,124,92,210 ; vsubps %ymm10,%ymm0,%ymm10
- DB 196,98,125,24,29,250,9,0,0 ; vbroadcastss 0x9fa(%rip),%ymm11 # 8064 <_sk_callback_avx+0x56c>
+ DB 196,98,125,24,29,246,9,0,0 ; vbroadcastss 0x9f6(%rip),%ymm11 # 7ebc <_sk_callback_avx+0x568>
DB 196,65,60,89,195 ; vmulps %ymm11,%ymm8,%ymm8
DB 196,65,60,89,210 ; vmulps %ymm10,%ymm8,%ymm10
DB 197,180,92,192 ; vsubps %ymm0,%ymm9,%ymm0
@@ -13235,7 +13031,7 @@ _sk_xy_to_2pt_conical_linear_avx LABEL PROC
DB 196,67,121,4,201,0 ; vpermilps $0x0,%xmm9,%xmm9
DB 196,67,53,24,201,1 ; vinsertf128 $0x1,%xmm9,%ymm9,%ymm9
DB 197,52,88,200 ; vaddps %ymm0,%ymm9,%ymm9
- DB 196,98,125,24,21,191,9,0,0 ; vbroadcastss 0x9bf(%rip),%ymm10 # 8068 <_sk_callback_avx+0x570>
+ DB 196,98,125,24,21,187,9,0,0 ; vbroadcastss 0x9bb(%rip),%ymm10 # 7ec0 <_sk_callback_avx+0x56c>
DB 196,65,52,89,202 ; vmulps %ymm10,%ymm9,%ymm9
DB 197,252,89,192 ; vmulps %ymm0,%ymm0,%ymm0
DB 197,116,89,209 ; vmulps %ymm1,%ymm1,%ymm10
@@ -13244,7 +13040,7 @@ _sk_xy_to_2pt_conical_linear_avx LABEL PROC
DB 196,227,121,4,192,0 ; vpermilps $0x0,%xmm0,%xmm0
DB 196,227,125,24,192,1 ; vinsertf128 $0x1,%xmm0,%ymm0,%ymm0
DB 197,172,92,192 ; vsubps %ymm0,%ymm10,%ymm0
- DB 196,98,125,24,5,147,9,0,0 ; vbroadcastss 0x993(%rip),%ymm8 # 806c <_sk_callback_avx+0x574>
+ DB 196,98,125,24,5,143,9,0,0 ; vbroadcastss 0x98f(%rip),%ymm8 # 7ec4 <_sk_callback_avx+0x570>
DB 196,193,124,87,192 ; vxorps %ymm8,%ymm0,%ymm0
DB 196,193,124,94,193 ; vdivps %ymm9,%ymm0,%ymm0
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13279,7 +13075,7 @@ _sk_apply_vector_mask_avx LABEL PROC
PUBLIC _sk_save_xy_avx
_sk_save_xy_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,47,9,0,0 ; vbroadcastss 0x92f(%rip),%ymm8 # 8070 <_sk_callback_avx+0x578>
+ DB 196,98,125,24,5,43,9,0,0 ; vbroadcastss 0x92b(%rip),%ymm8 # 7ec8 <_sk_callback_avx+0x574>
DB 196,65,124,88,200 ; vaddps %ymm8,%ymm0,%ymm9
DB 196,67,125,8,209,1 ; vroundps $0x1,%ymm9,%ymm10
DB 196,65,52,92,202 ; vsubps %ymm10,%ymm9,%ymm9
@@ -13312,9 +13108,9 @@ _sk_accumulate_avx LABEL PROC
PUBLIC _sk_bilinear_nx_avx
_sk_bilinear_nx_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,187,8,0,0 ; vbroadcastss 0x8bb(%rip),%ymm0 # 8074 <_sk_callback_avx+0x57c>
+ DB 196,226,125,24,5,183,8,0,0 ; vbroadcastss 0x8b7(%rip),%ymm0 # 7ecc <_sk_callback_avx+0x578>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,178,8,0,0 ; vbroadcastss 0x8b2(%rip),%ymm8 # 8078 <_sk_callback_avx+0x580>
+ DB 196,98,125,24,5,174,8,0,0 ; vbroadcastss 0x8ae(%rip),%ymm8 # 7ed0 <_sk_callback_avx+0x57c>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13323,7 +13119,7 @@ _sk_bilinear_nx_avx LABEL PROC
PUBLIC _sk_bilinear_px_avx
_sk_bilinear_px_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,154,8,0,0 ; vbroadcastss 0x89a(%rip),%ymm0 # 807c <_sk_callback_avx+0x584>
+ DB 196,226,125,24,5,150,8,0,0 ; vbroadcastss 0x896(%rip),%ymm0 # 7ed4 <_sk_callback_avx+0x580>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -13333,9 +13129,9 @@ _sk_bilinear_px_avx LABEL PROC
PUBLIC _sk_bilinear_ny_avx
_sk_bilinear_ny_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,126,8,0,0 ; vbroadcastss 0x87e(%rip),%ymm1 # 8080 <_sk_callback_avx+0x588>
+ DB 196,226,125,24,13,122,8,0,0 ; vbroadcastss 0x87a(%rip),%ymm1 # 7ed8 <_sk_callback_avx+0x584>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,116,8,0,0 ; vbroadcastss 0x874(%rip),%ymm8 # 8084 <_sk_callback_avx+0x58c>
+ DB 196,98,125,24,5,112,8,0,0 ; vbroadcastss 0x870(%rip),%ymm8 # 7edc <_sk_callback_avx+0x588>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13344,7 +13140,7 @@ _sk_bilinear_ny_avx LABEL PROC
PUBLIC _sk_bilinear_py_avx
_sk_bilinear_py_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,92,8,0,0 ; vbroadcastss 0x85c(%rip),%ymm1 # 8088 <_sk_callback_avx+0x590>
+ DB 196,226,125,24,13,88,8,0,0 ; vbroadcastss 0x858(%rip),%ymm1 # 7ee0 <_sk_callback_avx+0x58c>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -13354,14 +13150,14 @@ _sk_bilinear_py_avx LABEL PROC
PUBLIC _sk_bicubic_n3x_avx
_sk_bicubic_n3x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,63,8,0,0 ; vbroadcastss 0x83f(%rip),%ymm0 # 808c <_sk_callback_avx+0x594>
+ DB 196,226,125,24,5,59,8,0,0 ; vbroadcastss 0x83b(%rip),%ymm0 # 7ee4 <_sk_callback_avx+0x590>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,54,8,0,0 ; vbroadcastss 0x836(%rip),%ymm8 # 8090 <_sk_callback_avx+0x598>
+ DB 196,98,125,24,5,50,8,0,0 ; vbroadcastss 0x832(%rip),%ymm8 # 7ee8 <_sk_callback_avx+0x594>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,39,8,0,0 ; vbroadcastss 0x827(%rip),%ymm10 # 8094 <_sk_callback_avx+0x59c>
+ DB 196,98,125,24,21,35,8,0,0 ; vbroadcastss 0x823(%rip),%ymm10 # 7eec <_sk_callback_avx+0x598>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,29,8,0,0 ; vbroadcastss 0x81d(%rip),%ymm10 # 8098 <_sk_callback_avx+0x5a0>
+ DB 196,98,125,24,21,25,8,0,0 ; vbroadcastss 0x819(%rip),%ymm10 # 7ef0 <_sk_callback_avx+0x59c>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -13371,19 +13167,19 @@ _sk_bicubic_n3x_avx LABEL PROC
PUBLIC _sk_bicubic_n1x_avx
_sk_bicubic_n1x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,0,8,0,0 ; vbroadcastss 0x800(%rip),%ymm0 # 809c <_sk_callback_avx+0x5a4>
+ DB 196,226,125,24,5,252,7,0,0 ; vbroadcastss 0x7fc(%rip),%ymm0 # 7ef4 <_sk_callback_avx+0x5a0>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
- DB 196,98,125,24,5,247,7,0,0 ; vbroadcastss 0x7f7(%rip),%ymm8 # 80a0 <_sk_callback_avx+0x5a8>
+ DB 196,98,125,24,5,243,7,0,0 ; vbroadcastss 0x7f3(%rip),%ymm8 # 7ef8 <_sk_callback_avx+0x5a4>
DB 197,60,92,64,64 ; vsubps 0x40(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,237,7,0,0 ; vbroadcastss 0x7ed(%rip),%ymm9 # 80a4 <_sk_callback_avx+0x5ac>
+ DB 196,98,125,24,13,233,7,0,0 ; vbroadcastss 0x7e9(%rip),%ymm9 # 7efc <_sk_callback_avx+0x5a8>
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,227,7,0,0 ; vbroadcastss 0x7e3(%rip),%ymm10 # 80a8 <_sk_callback_avx+0x5b0>
+ DB 196,98,125,24,21,223,7,0,0 ; vbroadcastss 0x7df(%rip),%ymm10 # 7f00 <_sk_callback_avx+0x5ac>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,212,7,0,0 ; vbroadcastss 0x7d4(%rip),%ymm10 # 80ac <_sk_callback_avx+0x5b4>
+ DB 196,98,125,24,21,208,7,0,0 ; vbroadcastss 0x7d0(%rip),%ymm10 # 7f04 <_sk_callback_avx+0x5b0>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,197,7,0,0 ; vbroadcastss 0x7c5(%rip),%ymm9 # 80b0 <_sk_callback_avx+0x5b8>
+ DB 196,98,125,24,13,193,7,0,0 ; vbroadcastss 0x7c1(%rip),%ymm9 # 7f08 <_sk_callback_avx+0x5b4>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13392,17 +13188,17 @@ _sk_bicubic_n1x_avx LABEL PROC
PUBLIC _sk_bicubic_p1x_avx
_sk_bicubic_p1x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,173,7,0,0 ; vbroadcastss 0x7ad(%rip),%ymm8 # 80b4 <_sk_callback_avx+0x5bc>
+ DB 196,98,125,24,5,169,7,0,0 ; vbroadcastss 0x7a9(%rip),%ymm8 # 7f0c <_sk_callback_avx+0x5b8>
DB 197,188,88,0 ; vaddps (%rax),%ymm8,%ymm0
DB 197,124,16,72,64 ; vmovups 0x40(%rax),%ymm9
- DB 196,98,125,24,21,159,7,0,0 ; vbroadcastss 0x79f(%rip),%ymm10 # 80b8 <_sk_callback_avx+0x5c0>
+ DB 196,98,125,24,21,155,7,0,0 ; vbroadcastss 0x79b(%rip),%ymm10 # 7f10 <_sk_callback_avx+0x5bc>
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
- DB 196,98,125,24,29,149,7,0,0 ; vbroadcastss 0x795(%rip),%ymm11 # 80bc <_sk_callback_avx+0x5c4>
+ DB 196,98,125,24,29,145,7,0,0 ; vbroadcastss 0x791(%rip),%ymm11 # 7f14 <_sk_callback_avx+0x5c0>
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
- DB 196,98,125,24,13,124,7,0,0 ; vbroadcastss 0x77c(%rip),%ymm9 # 80c0 <_sk_callback_avx+0x5c8>
+ DB 196,98,125,24,13,120,7,0,0 ; vbroadcastss 0x778(%rip),%ymm9 # 7f18 <_sk_callback_avx+0x5c4>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13411,13 +13207,13 @@ _sk_bicubic_p1x_avx LABEL PROC
PUBLIC _sk_bicubic_p3x_avx
_sk_bicubic_p3x_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,5,100,7,0,0 ; vbroadcastss 0x764(%rip),%ymm0 # 80c4 <_sk_callback_avx+0x5cc>
+ DB 196,226,125,24,5,96,7,0,0 ; vbroadcastss 0x760(%rip),%ymm0 # 7f1c <_sk_callback_avx+0x5c8>
DB 197,252,88,0 ; vaddps (%rax),%ymm0,%ymm0
DB 197,124,16,64,64 ; vmovups 0x40(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,81,7,0,0 ; vbroadcastss 0x751(%rip),%ymm10 # 80c8 <_sk_callback_avx+0x5d0>
+ DB 196,98,125,24,21,77,7,0,0 ; vbroadcastss 0x74d(%rip),%ymm10 # 7f20 <_sk_callback_avx+0x5cc>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,71,7,0,0 ; vbroadcastss 0x747(%rip),%ymm10 # 80cc <_sk_callback_avx+0x5d4>
+ DB 196,98,125,24,21,67,7,0,0 ; vbroadcastss 0x743(%rip),%ymm10 # 7f24 <_sk_callback_avx+0x5d0>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,128,0,0,0 ; vmovups %ymm8,0x80(%rax)
@@ -13427,14 +13223,14 @@ _sk_bicubic_p3x_avx LABEL PROC
PUBLIC _sk_bicubic_n3y_avx
_sk_bicubic_n3y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,42,7,0,0 ; vbroadcastss 0x72a(%rip),%ymm1 # 80d0 <_sk_callback_avx+0x5d8>
+ DB 196,226,125,24,13,38,7,0,0 ; vbroadcastss 0x726(%rip),%ymm1 # 7f28 <_sk_callback_avx+0x5d4>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,32,7,0,0 ; vbroadcastss 0x720(%rip),%ymm8 # 80d4 <_sk_callback_avx+0x5dc>
+ DB 196,98,125,24,5,28,7,0,0 ; vbroadcastss 0x71c(%rip),%ymm8 # 7f2c <_sk_callback_avx+0x5d8>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,17,7,0,0 ; vbroadcastss 0x711(%rip),%ymm10 # 80d8 <_sk_callback_avx+0x5e0>
+ DB 196,98,125,24,21,13,7,0,0 ; vbroadcastss 0x70d(%rip),%ymm10 # 7f30 <_sk_callback_avx+0x5dc>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,7,7,0,0 ; vbroadcastss 0x707(%rip),%ymm10 # 80dc <_sk_callback_avx+0x5e4>
+ DB 196,98,125,24,21,3,7,0,0 ; vbroadcastss 0x703(%rip),%ymm10 # 7f34 <_sk_callback_avx+0x5e0>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -13444,19 +13240,19 @@ _sk_bicubic_n3y_avx LABEL PROC
PUBLIC _sk_bicubic_n1y_avx
_sk_bicubic_n1y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,234,6,0,0 ; vbroadcastss 0x6ea(%rip),%ymm1 # 80e0 <_sk_callback_avx+0x5e8>
+ DB 196,226,125,24,13,230,6,0,0 ; vbroadcastss 0x6e6(%rip),%ymm1 # 7f38 <_sk_callback_avx+0x5e4>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
- DB 196,98,125,24,5,224,6,0,0 ; vbroadcastss 0x6e0(%rip),%ymm8 # 80e4 <_sk_callback_avx+0x5ec>
+ DB 196,98,125,24,5,220,6,0,0 ; vbroadcastss 0x6dc(%rip),%ymm8 # 7f3c <_sk_callback_avx+0x5e8>
DB 197,60,92,64,96 ; vsubps 0x60(%rax),%ymm8,%ymm8
- DB 196,98,125,24,13,214,6,0,0 ; vbroadcastss 0x6d6(%rip),%ymm9 # 80e8 <_sk_callback_avx+0x5f0>
+ DB 196,98,125,24,13,210,6,0,0 ; vbroadcastss 0x6d2(%rip),%ymm9 # 7f40 <_sk_callback_avx+0x5ec>
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,204,6,0,0 ; vbroadcastss 0x6cc(%rip),%ymm10 # 80ec <_sk_callback_avx+0x5f4>
+ DB 196,98,125,24,21,200,6,0,0 ; vbroadcastss 0x6c8(%rip),%ymm10 # 7f44 <_sk_callback_avx+0x5f0>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,201 ; vmulps %ymm9,%ymm8,%ymm9
- DB 196,98,125,24,21,189,6,0,0 ; vbroadcastss 0x6bd(%rip),%ymm10 # 80f0 <_sk_callback_avx+0x5f8>
+ DB 196,98,125,24,21,185,6,0,0 ; vbroadcastss 0x6b9(%rip),%ymm10 # 7f48 <_sk_callback_avx+0x5f4>
DB 196,65,52,88,202 ; vaddps %ymm10,%ymm9,%ymm9
DB 196,65,60,89,193 ; vmulps %ymm9,%ymm8,%ymm8
- DB 196,98,125,24,13,174,6,0,0 ; vbroadcastss 0x6ae(%rip),%ymm9 # 80f4 <_sk_callback_avx+0x5fc>
+ DB 196,98,125,24,13,170,6,0,0 ; vbroadcastss 0x6aa(%rip),%ymm9 # 7f4c <_sk_callback_avx+0x5f8>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13465,17 +13261,17 @@ _sk_bicubic_n1y_avx LABEL PROC
PUBLIC _sk_bicubic_p1y_avx
_sk_bicubic_p1y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,98,125,24,5,150,6,0,0 ; vbroadcastss 0x696(%rip),%ymm8 # 80f8 <_sk_callback_avx+0x600>
+ DB 196,98,125,24,5,146,6,0,0 ; vbroadcastss 0x692(%rip),%ymm8 # 7f50 <_sk_callback_avx+0x5fc>
DB 197,188,88,72,32 ; vaddps 0x20(%rax),%ymm8,%ymm1
DB 197,124,16,72,96 ; vmovups 0x60(%rax),%ymm9
- DB 196,98,125,24,21,135,6,0,0 ; vbroadcastss 0x687(%rip),%ymm10 # 80fc <_sk_callback_avx+0x604>
+ DB 196,98,125,24,21,131,6,0,0 ; vbroadcastss 0x683(%rip),%ymm10 # 7f54 <_sk_callback_avx+0x600>
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
- DB 196,98,125,24,29,125,6,0,0 ; vbroadcastss 0x67d(%rip),%ymm11 # 8100 <_sk_callback_avx+0x608>
+ DB 196,98,125,24,29,121,6,0,0 ; vbroadcastss 0x679(%rip),%ymm11 # 7f58 <_sk_callback_avx+0x604>
DB 196,65,44,88,211 ; vaddps %ymm11,%ymm10,%ymm10
DB 196,65,52,89,210 ; vmulps %ymm10,%ymm9,%ymm10
DB 196,65,44,88,192 ; vaddps %ymm8,%ymm10,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
- DB 196,98,125,24,13,100,6,0,0 ; vbroadcastss 0x664(%rip),%ymm9 # 8104 <_sk_callback_avx+0x60c>
+ DB 196,98,125,24,13,96,6,0,0 ; vbroadcastss 0x660(%rip),%ymm9 # 7f5c <_sk_callback_avx+0x608>
DB 196,65,60,88,193 ; vaddps %ymm9,%ymm8,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -13484,13 +13280,13 @@ _sk_bicubic_p1y_avx LABEL PROC
PUBLIC _sk_bicubic_p3y_avx
_sk_bicubic_p3y_avx LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 196,226,125,24,13,76,6,0,0 ; vbroadcastss 0x64c(%rip),%ymm1 # 8108 <_sk_callback_avx+0x610>
+ DB 196,226,125,24,13,72,6,0,0 ; vbroadcastss 0x648(%rip),%ymm1 # 7f60 <_sk_callback_avx+0x60c>
DB 197,244,88,72,32 ; vaddps 0x20(%rax),%ymm1,%ymm1
DB 197,124,16,64,96 ; vmovups 0x60(%rax),%ymm8
DB 196,65,60,89,200 ; vmulps %ymm8,%ymm8,%ymm9
- DB 196,98,125,24,21,56,6,0,0 ; vbroadcastss 0x638(%rip),%ymm10 # 810c <_sk_callback_avx+0x614>
+ DB 196,98,125,24,21,52,6,0,0 ; vbroadcastss 0x634(%rip),%ymm10 # 7f64 <_sk_callback_avx+0x610>
DB 196,65,60,89,194 ; vmulps %ymm10,%ymm8,%ymm8
- DB 196,98,125,24,21,46,6,0,0 ; vbroadcastss 0x62e(%rip),%ymm10 # 8110 <_sk_callback_avx+0x618>
+ DB 196,98,125,24,21,42,6,0,0 ; vbroadcastss 0x62a(%rip),%ymm10 # 7f68 <_sk_callback_avx+0x614>
DB 196,65,60,88,194 ; vaddps %ymm10,%ymm8,%ymm8
DB 196,65,52,89,192 ; vmulps %ymm8,%ymm9,%ymm8
DB 197,124,17,128,160,0,0,0 ; vmovups %ymm8,0xa0(%rax)
@@ -13614,25 +13410,25 @@ ALIGN 4
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 7cdd <.literal4+0xb9>
+ DB 71,225,61 ; rex.RXB loope 7b39 <.literal4+0xb9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 7ced <.literal4+0xc9>
+ DB 71,225,61 ; rex.RXB loope 7b49 <.literal4+0xc9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 7cfd <.literal4+0xd9>
+ DB 71,225,61 ; rex.RXB loope 7b59 <.literal4+0xd9>
DB 0,0 ; add %al,(%rax)
DB 128,63,154 ; cmpb $0x9a,(%rdi)
DB 153 ; cltd
DB 153 ; cltd
DB 62,61,10,23,63,174 ; ds cmp $0xae3f170a,%eax
- DB 71,225,61 ; rex.RXB loope 7d0d <.literal4+0xe9>
+ DB 71,225,61 ; rex.RXB loope 7b69 <.literal4+0xe9>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
@@ -13696,7 +13492,7 @@ ALIGN 4
DB 190,129,128,128,59 ; mov $0x3b808081,%esi
DB 129,128,128,59,0,248,0,0,8,33 ; addl $0x21080000,-0x7ffc480(%rax)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 7d79 <.literal4+0x155>
+ DB 224,7 ; loopne 7bd5 <.literal4+0x155>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -13712,10 +13508,10 @@ ALIGN 4
DB 129,128,128,59,129,128,128,59,0,0 ; addl $0x3b80,-0x7f7ec480(%rax)
DB 0,52,255 ; add %dh,(%rdi,%rdi,8)
DB 255 ; (bad)
- DB 127,0 ; jg 7da0 <.literal4+0x17c>
+ DB 127,0 ; jg 7bfc <.literal4+0x17c>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 7e19 <.literal4+0x1f5>
+ DB 119,115 ; ja 7c75 <.literal4+0x1f5>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -13729,10 +13525,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 7dd4 <.literal4+0x1b0>
+ DB 127,0 ; jg 7c30 <.literal4+0x1b0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 7e4d <.literal4+0x229>
+ DB 119,115 ; ja 7ca9 <.literal4+0x229>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -13746,10 +13542,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 7e08 <.literal4+0x1e4>
+ DB 127,0 ; jg 7c64 <.literal4+0x1e4>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 7e81 <.literal4+0x25d>
+ DB 119,115 ; ja 7cdd <.literal4+0x25d>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -13763,10 +13559,10 @@ ALIGN 4
DB 0,128,63,0,0,0 ; add %al,0x3f(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 7e3c <.literal4+0x218>
+ DB 127,0 ; jg 7c98 <.literal4+0x218>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 7eb5 <.literal4+0x291>
+ DB 119,115 ; ja 7d11 <.literal4+0x291>
DB 248 ; clc
DB 194,117,191 ; retq $0xbf75
DB 191,63,249,68,180 ; mov $0xb444f93f,%edi
@@ -13779,7 +13575,7 @@ ALIGN 4
DB 0,75,0 ; add %cl,0x0(%rbx)
DB 0,128,63,0,0,200 ; add %al,-0x37ffffc1(%rax)
DB 66,0,0 ; rex.X add %al,(%rax)
- DB 127,67 ; jg 7eb3 <.literal4+0x28f>
+ DB 127,67 ; jg 7d0f <.literal4+0x28f>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -13791,7 +13587,7 @@ ALIGN 4
DB 190,80,128,3,62 ; mov $0x3e038050,%esi
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 7ed3 <.literal4+0x2af>
+ DB 118,63 ; jbe 7d2f <.literal4+0x2af>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
@@ -13800,14 +13596,9 @@ ALIGN 4
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
DB 59,0 ; cmp (%rax),%eax
- DB 0,128,63,129,128,128 ; add %al,-0x7f7f7ec1(%rax)
- DB 59,0 ; cmp (%rax),%eax
- DB 248 ; clc
- DB 0,0 ; add %al,(%rax)
- DB 8,33 ; or %ah,(%rcx)
- DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 7ed5 <.literal4+0x2b1>
- DB 0,0 ; add %al,(%rax)
+ DB 0,128,63,0,248,0 ; add %al,0xf8003f(%rax)
+ DB 0,8 ; add %cl,(%rax)
+ DB 33,132,55,224,7,0,0 ; and %eax,0x7e0(%rdi,%rsi,1)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
DB 31 ; (bad)
@@ -13818,7 +13609,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 7ef1 <.literal4+0x2cd>
+ DB 224,7 ; loopne 7d49 <.literal4+0x2c9>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -13830,7 +13621,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 7f0d <.literal4+0x2e9>
+ DB 224,7 ; loopne 7d65 <.literal4+0x2e5>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -13841,7 +13632,7 @@ ALIGN 4
DB 0,0 ; add %al,(%rax)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 7f62 <.literal4+0x33e>
+ DB 124,66 ; jl 7dba <.literal4+0x33a>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 137,136,136,55,0,15 ; mov %ecx,0xf003788(%rax)
@@ -13867,12 +13658,12 @@ ALIGN 4
DB 137,136,136,59,15,0 ; mov %ecx,0xf3b88(%rax)
DB 0,0 ; add %al,(%rax)
DB 137,136,136,61,0,0 ; mov %ecx,0x3d88(%rax)
- DB 112,65 ; jo 7fc5 <.literal4+0x3a1>
+ DB 112,65 ; jo 7e1d <.literal4+0x39d>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 7fdb <.literal4+0x3b7>
+ DB 127,67 ; jg 7e33 <.literal4+0x3b3>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
@@ -13895,7 +13686,7 @@ ALIGN 4
DB 0,128,55,0,0,128 ; add %al,-0x7fffffc9(%rax)
DB 63 ; (bad)
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 803b <.literal4+0x417>
+ DB 127,71 ; jg 7e93 <.literal4+0x413>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -14365,22 +14156,6 @@ ALIGN 32
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
ALIGN 32
PUBLIC _sk_start_pipeline_sse41
@@ -14547,7 +14322,7 @@ _sk_seed_shader_sse41 LABEL PROC
DB 102,15,110,194 ; movd %edx,%xmm0
DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
- DB 15,40,21,88,92,0,0 ; movaps 0x5c58(%rip),%xmm2 # 5ec0 <_sk_callback_sse41+0xcd>
+ DB 15,40,21,88,91,0,0 ; movaps 0x5b58(%rip),%xmm2 # 5dc0 <_sk_callback_sse41+0xcf>
DB 15,88,202 ; addps %xmm2,%xmm1
DB 15,16,7 ; movups (%rdi),%xmm0
DB 15,88,193 ; addps %xmm1,%xmm0
@@ -14556,7 +14331,7 @@ _sk_seed_shader_sse41 LABEL PROC
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,21,71,92,0,0 ; movaps 0x5c47(%rip),%xmm2 # 5ed0 <_sk_callback_sse41+0xdd>
+ DB 15,40,21,71,91,0,0 ; movaps 0x5b47(%rip),%xmm2 # 5dd0 <_sk_callback_sse41+0xdf>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,87,237 ; xorps %xmm5,%xmm5
@@ -14574,14 +14349,14 @@ _sk_dither_sse41 LABEL PROC
DB 102,68,15,110,193 ; movd %ecx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 102,69,15,239,193 ; pxor %xmm9,%xmm8
- DB 102,68,15,111,21,21,92,0,0 ; movdqa 0x5c15(%rip),%xmm10 # 5ee0 <_sk_callback_sse41+0xed>
+ DB 102,68,15,111,21,21,91,0,0 ; movdqa 0x5b15(%rip),%xmm10 # 5de0 <_sk_callback_sse41+0xef>
DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10
- DB 102,68,15,111,37,1,92,0,0 ; movdqa 0x5c01(%rip),%xmm12 # 5ef0 <_sk_callback_sse41+0xfd>
- DB 102,68,15,111,45,8,92,0,0 ; movdqa 0x5c08(%rip),%xmm13 # 5f00 <_sk_callback_sse41+0x10d>
+ DB 102,68,15,111,37,1,91,0,0 ; movdqa 0x5b01(%rip),%xmm12 # 5df0 <_sk_callback_sse41+0xff>
+ DB 102,68,15,111,45,8,91,0,0 ; movdqa 0x5b08(%rip),%xmm13 # 5e00 <_sk_callback_sse41+0x10f>
DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14
DB 102,69,15,219,245 ; pand %xmm13,%xmm14
DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14
@@ -14597,8 +14372,8 @@ _sk_dither_sse41 LABEL PROC
DB 102,69,15,235,245 ; por %xmm13,%xmm14
DB 102,69,15,235,240 ; por %xmm8,%xmm14
DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8
- DB 68,15,89,5,195,91,0,0 ; mulps 0x5bc3(%rip),%xmm8 # 5f10 <_sk_callback_sse41+0x11d>
- DB 68,15,88,5,203,91,0,0 ; addps 0x5bcb(%rip),%xmm8 # 5f20 <_sk_callback_sse41+0x12d>
+ DB 68,15,89,5,195,90,0,0 ; mulps 0x5ac3(%rip),%xmm8 # 5e10 <_sk_callback_sse41+0x11f>
+ DB 68,15,88,5,203,90,0,0 ; addps 0x5acb(%rip),%xmm8 # 5e20 <_sk_callback_sse41+0x12f>
DB 243,68,15,16,16 ; movss (%rax),%xmm10
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
@@ -14636,7 +14411,7 @@ _sk_uniform_color_sse41 LABEL PROC
PUBLIC _sk_black_color_sse41
_sk_black_color_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,97,91,0,0 ; movaps 0x5b61(%rip),%xmm3 # 5f30 <_sk_callback_sse41+0x13d>
+ DB 15,40,29,97,90,0,0 ; movaps 0x5a61(%rip),%xmm3 # 5e30 <_sk_callback_sse41+0x13f>
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -14645,7 +14420,7 @@ _sk_black_color_sse41 LABEL PROC
PUBLIC _sk_white_color_sse41
_sk_white_color_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,5,93,91,0,0 ; movaps 0x5b5d(%rip),%xmm0 # 5f40 <_sk_callback_sse41+0x14d>
+ DB 15,40,5,93,90,0,0 ; movaps 0x5a5d(%rip),%xmm0 # 5e40 <_sk_callback_sse41+0x14f>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,40,216 ; movaps %xmm0,%xmm3
@@ -14683,7 +14458,7 @@ _sk_clear_sse41 LABEL PROC
PUBLIC _sk_srcatop_sse41
_sk_srcatop_sse41 LABEL PROC
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 68,15,40,5,29,91,0,0 ; movaps 0x5b1d(%rip),%xmm8 # 5f50 <_sk_callback_sse41+0x15d>
+ DB 68,15,40,5,29,90,0,0 ; movaps 0x5a1d(%rip),%xmm8 # 5e50 <_sk_callback_sse41+0x15f>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -14706,7 +14481,7 @@ PUBLIC _sk_dstatop_sse41
_sk_dstatop_sse41 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
DB 68,15,89,196 ; mulps %xmm4,%xmm8
- DB 68,15,40,13,224,90,0,0 ; movaps 0x5ae0(%rip),%xmm9 # 5f60 <_sk_callback_sse41+0x16d>
+ DB 68,15,40,13,224,89,0,0 ; movaps 0x59e0(%rip),%xmm9 # 5e60 <_sk_callback_sse41+0x16f>
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
@@ -14747,7 +14522,7 @@ _sk_dstin_sse41 LABEL PROC
PUBLIC _sk_srcout_sse41
_sk_srcout_sse41 LABEL PROC
- DB 68,15,40,5,132,90,0,0 ; movaps 0x5a84(%rip),%xmm8 # 5f70 <_sk_callback_sse41+0x17d>
+ DB 68,15,40,5,132,89,0,0 ; movaps 0x5984(%rip),%xmm8 # 5e70 <_sk_callback_sse41+0x17f>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
@@ -14758,7 +14533,7 @@ _sk_srcout_sse41 LABEL PROC
PUBLIC _sk_dstout_sse41
_sk_dstout_sse41 LABEL PROC
- DB 68,15,40,5,116,90,0,0 ; movaps 0x5a74(%rip),%xmm8 # 5f80 <_sk_callback_sse41+0x18d>
+ DB 68,15,40,5,116,89,0,0 ; movaps 0x5974(%rip),%xmm8 # 5e80 <_sk_callback_sse41+0x18f>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
@@ -14773,7 +14548,7 @@ _sk_dstout_sse41 LABEL PROC
PUBLIC _sk_srcover_sse41
_sk_srcover_sse41 LABEL PROC
- DB 68,15,40,5,87,90,0,0 ; movaps 0x5a57(%rip),%xmm8 # 5f90 <_sk_callback_sse41+0x19d>
+ DB 68,15,40,5,87,89,0,0 ; movaps 0x5957(%rip),%xmm8 # 5e90 <_sk_callback_sse41+0x19f>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -14791,7 +14566,7 @@ _sk_srcover_sse41 LABEL PROC
PUBLIC _sk_dstover_sse41
_sk_dstover_sse41 LABEL PROC
- DB 68,15,40,5,43,90,0,0 ; movaps 0x5a2b(%rip),%xmm8 # 5fa0 <_sk_callback_sse41+0x1ad>
+ DB 68,15,40,5,43,89,0,0 ; movaps 0x592b(%rip),%xmm8 # 5ea0 <_sk_callback_sse41+0x1af>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -14815,7 +14590,7 @@ _sk_modulate_sse41 LABEL PROC
PUBLIC _sk_multiply_sse41
_sk_multiply_sse41 LABEL PROC
- DB 68,15,40,5,255,89,0,0 ; movaps 0x59ff(%rip),%xmm8 # 5fb0 <_sk_callback_sse41+0x1bd>
+ DB 68,15,40,5,255,88,0,0 ; movaps 0x58ff(%rip),%xmm8 # 5eb0 <_sk_callback_sse41+0x1bf>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,209 ; movaps %xmm9,%xmm10
@@ -14884,7 +14659,7 @@ _sk_screen_sse41 LABEL PROC
PUBLIC _sk_xor__sse41
_sk_xor__sse41 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
- DB 15,40,29,52,89,0,0 ; movaps 0x5934(%rip),%xmm3 # 5fc0 <_sk_callback_sse41+0x1cd>
+ DB 15,40,29,52,88,0,0 ; movaps 0x5834(%rip),%xmm3 # 5ec0 <_sk_callback_sse41+0x1cf>
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
@@ -14930,7 +14705,7 @@ _sk_darken_sse41 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,95,209 ; maxps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,159,88,0,0 ; movaps 0x589f(%rip),%xmm2 # 5fd0 <_sk_callback_sse41+0x1dd>
+ DB 15,40,21,159,87,0,0 ; movaps 0x579f(%rip),%xmm2 # 5ed0 <_sk_callback_sse41+0x1df>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -14962,7 +14737,7 @@ _sk_lighten_sse41 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,68,88,0,0 ; movaps 0x5844(%rip),%xmm2 # 5fe0 <_sk_callback_sse41+0x1ed>
+ DB 15,40,21,68,87,0,0 ; movaps 0x5744(%rip),%xmm2 # 5ee0 <_sk_callback_sse41+0x1ef>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -14997,7 +14772,7 @@ _sk_difference_sse41 LABEL PROC
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,222,87,0,0 ; movaps 0x57de(%rip),%xmm2 # 5ff0 <_sk_callback_sse41+0x1fd>
+ DB 15,40,21,222,86,0,0 ; movaps 0x56de(%rip),%xmm2 # 5ef0 <_sk_callback_sse41+0x1ff>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -15023,7 +14798,7 @@ _sk_exclusion_sse41 LABEL PROC
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,158,87,0,0 ; movaps 0x579e(%rip),%xmm2 # 6000 <_sk_callback_sse41+0x20d>
+ DB 15,40,21,158,86,0,0 ; movaps 0x569e(%rip),%xmm2 # 5f00 <_sk_callback_sse41+0x20f>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -15034,7 +14809,7 @@ _sk_exclusion_sse41 LABEL PROC
PUBLIC _sk_colorburn_sse41
_sk_colorburn_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,145,87,0,0 ; movaps 0x5791(%rip),%xmm10 # 6010 <_sk_callback_sse41+0x21d>
+ DB 68,15,40,21,145,86,0,0 ; movaps 0x5691(%rip),%xmm10 # 5f10 <_sk_callback_sse41+0x21f>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,203 ; movaps %xmm11,%xmm9
@@ -15114,7 +14889,7 @@ _sk_colorburn_sse41 LABEL PROC
PUBLIC _sk_colordodge_sse41
_sk_colordodge_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,111,86,0,0 ; movaps 0x566f(%rip),%xmm10 # 6020 <_sk_callback_sse41+0x22d>
+ DB 68,15,40,21,111,85,0,0 ; movaps 0x556f(%rip),%xmm10 # 5f20 <_sk_callback_sse41+0x22f>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
@@ -15195,7 +14970,7 @@ _sk_hardlight_sse41 LABEL PROC
DB 15,40,244 ; movaps %xmm4,%xmm6
DB 15,40,227 ; movaps %xmm3,%xmm4
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 68,15,40,21,69,85,0,0 ; movaps 0x5545(%rip),%xmm10 # 6030 <_sk_callback_sse41+0x23d>
+ DB 68,15,40,21,69,84,0,0 ; movaps 0x5445(%rip),%xmm10 # 5f30 <_sk_callback_sse41+0x23f>
DB 65,15,40,234 ; movaps %xmm10,%xmm5
DB 15,92,239 ; subps %xmm7,%xmm5
DB 15,40,197 ; movaps %xmm5,%xmm0
@@ -15277,7 +15052,7 @@ PUBLIC _sk_overlay_sse41
_sk_overlay_sse41 LABEL PROC
DB 68,15,40,201 ; movaps %xmm1,%xmm9
DB 68,15,40,240 ; movaps %xmm0,%xmm14
- DB 68,15,40,21,39,84,0,0 ; movaps 0x5427(%rip),%xmm10 # 6040 <_sk_callback_sse41+0x24d>
+ DB 68,15,40,21,39,83,0,0 ; movaps 0x5327(%rip),%xmm10 # 5f40 <_sk_callback_sse41+0x24f>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 65,15,40,195 ; movaps %xmm11,%xmm0
@@ -15361,7 +15136,7 @@ _sk_softlight_sse41 LABEL PROC
DB 15,40,198 ; movaps %xmm6,%xmm0
DB 15,94,199 ; divps %xmm7,%xmm0
DB 65,15,84,193 ; andps %xmm9,%xmm0
- DB 15,40,13,250,82,0,0 ; movaps 0x52fa(%rip),%xmm1 # 6050 <_sk_callback_sse41+0x25d>
+ DB 15,40,13,250,81,0,0 ; movaps 0x51fa(%rip),%xmm1 # 5f50 <_sk_callback_sse41+0x25f>
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 68,15,92,208 ; subps %xmm0,%xmm10
DB 68,15,40,240 ; movaps %xmm0,%xmm14
@@ -15374,10 +15149,10 @@ _sk_softlight_sse41 LABEL PROC
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,89,210 ; mulps %xmm2,%xmm2
DB 15,88,208 ; addps %xmm0,%xmm2
- DB 68,15,40,45,216,82,0,0 ; movaps 0x52d8(%rip),%xmm13 # 6060 <_sk_callback_sse41+0x26d>
+ DB 68,15,40,45,216,81,0,0 ; movaps 0x51d8(%rip),%xmm13 # 5f60 <_sk_callback_sse41+0x26f>
DB 69,15,88,245 ; addps %xmm13,%xmm14
DB 68,15,89,242 ; mulps %xmm2,%xmm14
- DB 68,15,40,37,216,82,0,0 ; movaps 0x52d8(%rip),%xmm12 # 6070 <_sk_callback_sse41+0x27d>
+ DB 68,15,40,37,216,81,0,0 ; movaps 0x51d8(%rip),%xmm12 # 5f70 <_sk_callback_sse41+0x27f>
DB 69,15,89,252 ; mulps %xmm12,%xmm15
DB 69,15,88,254 ; addps %xmm14,%xmm15
DB 15,40,198 ; movaps %xmm6,%xmm0
@@ -15563,12 +15338,12 @@ _sk_hue_sse41 LABEL PROC
DB 68,15,84,208 ; andps %xmm0,%xmm10
DB 15,84,200 ; andps %xmm0,%xmm1
DB 68,15,84,232 ; andps %xmm0,%xmm13
- DB 15,40,5,62,80,0,0 ; movaps 0x503e(%rip),%xmm0 # 6080 <_sk_callback_sse41+0x28d>
+ DB 15,40,5,62,79,0,0 ; movaps 0x4f3e(%rip),%xmm0 # 5f80 <_sk_callback_sse41+0x28f>
DB 68,15,89,224 ; mulps %xmm0,%xmm12
- DB 15,40,21,67,80,0,0 ; movaps 0x5043(%rip),%xmm2 # 6090 <_sk_callback_sse41+0x29d>
+ DB 15,40,21,67,79,0,0 ; movaps 0x4f43(%rip),%xmm2 # 5f90 <_sk_callback_sse41+0x29f>
DB 15,89,250 ; mulps %xmm2,%xmm7
DB 65,15,88,252 ; addps %xmm12,%xmm7
- DB 68,15,40,53,68,80,0,0 ; movaps 0x5044(%rip),%xmm14 # 60a0 <_sk_callback_sse41+0x2ad>
+ DB 68,15,40,53,68,79,0,0 ; movaps 0x4f44(%rip),%xmm14 # 5fa0 <_sk_callback_sse41+0x2af>
DB 68,15,40,252 ; movaps %xmm4,%xmm15
DB 69,15,89,254 ; mulps %xmm14,%xmm15
DB 68,15,88,255 ; addps %xmm7,%xmm15
@@ -15651,7 +15426,7 @@ _sk_hue_sse41 LABEL PROC
DB 65,15,88,214 ; addps %xmm14,%xmm2
DB 15,40,196 ; movaps %xmm4,%xmm0
DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1
- DB 68,15,40,13,9,79,0,0 ; movaps 0x4f09(%rip),%xmm9 # 60b0 <_sk_callback_sse41+0x2bd>
+ DB 68,15,40,13,9,78,0,0 ; movaps 0x4e09(%rip),%xmm9 # 5fb0 <_sk_callback_sse41+0x2bf>
DB 65,15,40,225 ; movaps %xmm9,%xmm4
DB 15,92,229 ; subps %xmm5,%xmm4
DB 15,40,68,36,48 ; movaps 0x30(%rsp),%xmm0
@@ -15745,14 +15520,14 @@ _sk_saturation_sse41 LABEL PROC
DB 68,15,84,215 ; andps %xmm7,%xmm10
DB 68,15,84,223 ; andps %xmm7,%xmm11
DB 68,15,84,199 ; andps %xmm7,%xmm8
- DB 15,40,21,188,77,0,0 ; movaps 0x4dbc(%rip),%xmm2 # 60c0 <_sk_callback_sse41+0x2cd>
+ DB 15,40,21,188,76,0,0 ; movaps 0x4cbc(%rip),%xmm2 # 5fc0 <_sk_callback_sse41+0x2cf>
DB 15,40,221 ; movaps %xmm5,%xmm3
DB 15,89,218 ; mulps %xmm2,%xmm3
- DB 15,40,13,191,77,0,0 ; movaps 0x4dbf(%rip),%xmm1 # 60d0 <_sk_callback_sse41+0x2dd>
+ DB 15,40,13,191,76,0,0 ; movaps 0x4cbf(%rip),%xmm1 # 5fd0 <_sk_callback_sse41+0x2df>
DB 15,40,254 ; movaps %xmm6,%xmm7
DB 15,89,249 ; mulps %xmm1,%xmm7
DB 15,88,251 ; addps %xmm3,%xmm7
- DB 68,15,40,45,190,77,0,0 ; movaps 0x4dbe(%rip),%xmm13 # 60e0 <_sk_callback_sse41+0x2ed>
+ DB 68,15,40,45,190,76,0,0 ; movaps 0x4cbe(%rip),%xmm13 # 5fe0 <_sk_callback_sse41+0x2ef>
DB 69,15,89,245 ; mulps %xmm13,%xmm14
DB 68,15,88,247 ; addps %xmm7,%xmm14
DB 65,15,40,218 ; movaps %xmm10,%xmm3
@@ -15833,7 +15608,7 @@ _sk_saturation_sse41 LABEL PROC
DB 65,15,88,253 ; addps %xmm13,%xmm7
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 102,68,15,56,20,223 ; blendvps %xmm0,%xmm7,%xmm11
- DB 68,15,40,13,132,76,0,0 ; movaps 0x4c84(%rip),%xmm9 # 60f0 <_sk_callback_sse41+0x2fd>
+ DB 68,15,40,13,132,75,0,0 ; movaps 0x4b84(%rip),%xmm9 # 5ff0 <_sk_callback_sse41+0x2ff>
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 68,15,92,204 ; subps %xmm4,%xmm9
DB 15,40,60,36 ; movaps (%rsp),%xmm7
@@ -15888,14 +15663,14 @@ _sk_color_sse41 LABEL PROC
DB 15,40,231 ; movaps %xmm7,%xmm4
DB 68,15,89,244 ; mulps %xmm4,%xmm14
DB 15,89,204 ; mulps %xmm4,%xmm1
- DB 68,15,40,13,201,75,0,0 ; movaps 0x4bc9(%rip),%xmm9 # 6100 <_sk_callback_sse41+0x30d>
+ DB 68,15,40,13,201,74,0,0 ; movaps 0x4ac9(%rip),%xmm9 # 6000 <_sk_callback_sse41+0x30f>
DB 65,15,40,250 ; movaps %xmm10,%xmm7
DB 65,15,89,249 ; mulps %xmm9,%xmm7
- DB 68,15,40,21,201,75,0,0 ; movaps 0x4bc9(%rip),%xmm10 # 6110 <_sk_callback_sse41+0x31d>
+ DB 68,15,40,21,201,74,0,0 ; movaps 0x4ac9(%rip),%xmm10 # 6010 <_sk_callback_sse41+0x31f>
DB 65,15,40,219 ; movaps %xmm11,%xmm3
DB 65,15,89,218 ; mulps %xmm10,%xmm3
DB 15,88,223 ; addps %xmm7,%xmm3
- DB 68,15,40,29,198,75,0,0 ; movaps 0x4bc6(%rip),%xmm11 # 6120 <_sk_callback_sse41+0x32d>
+ DB 68,15,40,29,198,74,0,0 ; movaps 0x4ac6(%rip),%xmm11 # 6020 <_sk_callback_sse41+0x32f>
DB 69,15,40,236 ; movaps %xmm12,%xmm13
DB 69,15,89,235 ; mulps %xmm11,%xmm13
DB 68,15,88,235 ; addps %xmm3,%xmm13
@@ -15980,7 +15755,7 @@ _sk_color_sse41 LABEL PROC
DB 65,15,88,251 ; addps %xmm11,%xmm7
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 102,15,56,20,207 ; blendvps %xmm0,%xmm7,%xmm1
- DB 68,15,40,13,130,74,0,0 ; movaps 0x4a82(%rip),%xmm9 # 6130 <_sk_callback_sse41+0x33d>
+ DB 68,15,40,13,130,73,0,0 ; movaps 0x4982(%rip),%xmm9 # 6030 <_sk_callback_sse41+0x33f>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,92,196 ; subps %xmm4,%xmm0
DB 68,15,89,192 ; mulps %xmm0,%xmm8
@@ -16032,13 +15807,13 @@ _sk_luminosity_sse41 LABEL PROC
DB 69,15,89,216 ; mulps %xmm8,%xmm11
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,89,205 ; mulps %xmm5,%xmm9
- DB 68,15,40,5,212,73,0,0 ; movaps 0x49d4(%rip),%xmm8 # 6140 <_sk_callback_sse41+0x34d>
+ DB 68,15,40,5,212,72,0,0 ; movaps 0x48d4(%rip),%xmm8 # 6040 <_sk_callback_sse41+0x34f>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
- DB 68,15,40,21,216,73,0,0 ; movaps 0x49d8(%rip),%xmm10 # 6150 <_sk_callback_sse41+0x35d>
+ DB 68,15,40,21,216,72,0,0 ; movaps 0x48d8(%rip),%xmm10 # 6050 <_sk_callback_sse41+0x35f>
DB 15,40,233 ; movaps %xmm1,%xmm5
DB 65,15,89,234 ; mulps %xmm10,%xmm5
DB 15,88,232 ; addps %xmm0,%xmm5
- DB 68,15,40,37,214,73,0,0 ; movaps 0x49d6(%rip),%xmm12 # 6160 <_sk_callback_sse41+0x36d>
+ DB 68,15,40,37,214,72,0,0 ; movaps 0x48d6(%rip),%xmm12 # 6060 <_sk_callback_sse41+0x36f>
DB 68,15,40,242 ; movaps %xmm2,%xmm14
DB 69,15,89,244 ; mulps %xmm12,%xmm14
DB 68,15,88,245 ; addps %xmm5,%xmm14
@@ -16123,7 +15898,7 @@ _sk_luminosity_sse41 LABEL PROC
DB 65,15,88,244 ; addps %xmm12,%xmm6
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 102,68,15,56,20,206 ; blendvps %xmm0,%xmm6,%xmm9
- DB 15,40,5,140,72,0,0 ; movaps 0x488c(%rip),%xmm0 # 6170 <_sk_callback_sse41+0x37d>
+ DB 15,40,5,140,71,0,0 ; movaps 0x478c(%rip),%xmm0 # 6070 <_sk_callback_sse41+0x37f>
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,92,215 ; subps %xmm7,%xmm2
DB 15,89,226 ; mulps %xmm2,%xmm4
@@ -16165,20 +15940,20 @@ _sk_srcover_rgba_8888_sse41 LABEL PROC
DB 15,133,217,0,0,0 ; jne 1a3b <_sk_srcover_rgba_8888_sse41+0xe7>
DB 243,15,111,60,144 ; movdqu (%rax,%rdx,4),%xmm7
DB 77,133,192 ; test %r8,%r8
- DB 102,15,111,37,14,72,0,0 ; movdqa 0x480e(%rip),%xmm4 # 6180 <_sk_callback_sse41+0x38d>
+ DB 102,15,111,37,14,71,0,0 ; movdqa 0x470e(%rip),%xmm4 # 6080 <_sk_callback_sse41+0x38f>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
DB 102,15,111,239 ; movdqa %xmm7,%xmm5
- DB 102,15,56,0,45,10,72,0,0 ; pshufb 0x480a(%rip),%xmm5 # 6190 <_sk_callback_sse41+0x39d>
+ DB 102,15,56,0,45,10,71,0,0 ; pshufb 0x470a(%rip),%xmm5 # 6090 <_sk_callback_sse41+0x39f>
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
DB 102,15,111,247 ; movdqa %xmm7,%xmm6
- DB 102,15,56,0,53,10,72,0,0 ; pshufb 0x480a(%rip),%xmm6 # 61a0 <_sk_callback_sse41+0x3ad>
+ DB 102,15,56,0,53,10,71,0,0 ; pshufb 0x470a(%rip),%xmm6 # 60a0 <_sk_callback_sse41+0x3af>
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 102,15,114,215,24 ; psrld $0x18,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 68,15,40,5,7,72,0,0 ; movaps 0x4807(%rip),%xmm8 # 61b0 <_sk_callback_sse41+0x3bd>
+ DB 68,15,40,5,7,71,0,0 ; movaps 0x4707(%rip),%xmm8 # 60b0 <_sk_callback_sse41+0x3bf>
DB 68,15,92,195 ; subps %xmm3,%xmm8
- DB 68,15,40,37,11,72,0,0 ; movaps 0x480b(%rip),%xmm12 # 61c0 <_sk_callback_sse41+0x3cd>
+ DB 68,15,40,37,11,71,0,0 ; movaps 0x470b(%rip),%xmm12 # 60c0 <_sk_callback_sse41+0x3cf>
DB 65,15,89,196 ; mulps %xmm12,%xmm0
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -16254,7 +16029,7 @@ _sk_clamp_0_sse41 LABEL PROC
PUBLIC _sk_clamp_1_sse41
_sk_clamp_1_sse41 LABEL PROC
- DB 68,15,40,5,253,70,0,0 ; movaps 0x46fd(%rip),%xmm8 # 61d0 <_sk_callback_sse41+0x3dd>
+ DB 68,15,40,5,253,69,0,0 ; movaps 0x45fd(%rip),%xmm8 # 60d0 <_sk_callback_sse41+0x3df>
DB 65,15,93,192 ; minps %xmm8,%xmm0
DB 65,15,93,200 ; minps %xmm8,%xmm1
DB 65,15,93,208 ; minps %xmm8,%xmm2
@@ -16264,7 +16039,7 @@ _sk_clamp_1_sse41 LABEL PROC
PUBLIC _sk_clamp_a_sse41
_sk_clamp_a_sse41 LABEL PROC
- DB 15,93,29,242,70,0,0 ; minps 0x46f2(%rip),%xmm3 # 61e0 <_sk_callback_sse41+0x3ed>
+ DB 15,93,29,242,69,0,0 ; minps 0x45f2(%rip),%xmm3 # 60e0 <_sk_callback_sse41+0x3ef>
DB 15,93,195 ; minps %xmm3,%xmm0
DB 15,93,203 ; minps %xmm3,%xmm1
DB 15,93,211 ; minps %xmm3,%xmm2
@@ -16273,7 +16048,7 @@ _sk_clamp_a_sse41 LABEL PROC
PUBLIC _sk_clamp_a_dst_sse41
_sk_clamp_a_dst_sse41 LABEL PROC
- DB 15,93,61,238,70,0,0 ; minps 0x46ee(%rip),%xmm7 # 61f0 <_sk_callback_sse41+0x3fd>
+ DB 15,93,61,238,69,0,0 ; minps 0x45ee(%rip),%xmm7 # 60f0 <_sk_callback_sse41+0x3ff>
DB 15,93,231 ; minps %xmm7,%xmm4
DB 15,93,239 ; minps %xmm7,%xmm5
DB 15,93,247 ; minps %xmm7,%xmm6
@@ -16329,7 +16104,7 @@ _sk_premul_sse41 LABEL PROC
PUBLIC _sk_unpremul_sse41
_sk_unpremul_sse41 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
- DB 68,15,40,13,137,70,0,0 ; movaps 0x4689(%rip),%xmm9 # 6200 <_sk_callback_sse41+0x40d>
+ DB 68,15,40,13,137,69,0,0 ; movaps 0x4589(%rip),%xmm9 # 6100 <_sk_callback_sse41+0x40f>
DB 68,15,94,203 ; divps %xmm3,%xmm9
DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8
DB 69,15,84,193 ; andps %xmm9,%xmm8
@@ -16341,20 +16116,20 @@ _sk_unpremul_sse41 LABEL PROC
PUBLIC _sk_from_srgb_sse41
_sk_from_srgb_sse41 LABEL PROC
- DB 68,15,40,29,116,70,0,0 ; movaps 0x4674(%rip),%xmm11 # 6210 <_sk_callback_sse41+0x41d>
+ DB 68,15,40,29,116,69,0,0 ; movaps 0x4574(%rip),%xmm11 # 6110 <_sk_callback_sse41+0x41f>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
DB 68,15,40,208 ; movaps %xmm0,%xmm10
DB 69,15,89,210 ; mulps %xmm10,%xmm10
- DB 68,15,40,37,108,70,0,0 ; movaps 0x466c(%rip),%xmm12 # 6220 <_sk_callback_sse41+0x42d>
+ DB 68,15,40,37,108,69,0,0 ; movaps 0x456c(%rip),%xmm12 # 6120 <_sk_callback_sse41+0x42f>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,196 ; mulps %xmm12,%xmm8
- DB 68,15,40,45,108,70,0,0 ; movaps 0x466c(%rip),%xmm13 # 6230 <_sk_callback_sse41+0x43d>
+ DB 68,15,40,45,108,69,0,0 ; movaps 0x456c(%rip),%xmm13 # 6130 <_sk_callback_sse41+0x43f>
DB 69,15,88,197 ; addps %xmm13,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
- DB 68,15,40,53,108,70,0,0 ; movaps 0x466c(%rip),%xmm14 # 6240 <_sk_callback_sse41+0x44d>
+ DB 68,15,40,53,108,69,0,0 ; movaps 0x456c(%rip),%xmm14 # 6140 <_sk_callback_sse41+0x44f>
DB 69,15,88,198 ; addps %xmm14,%xmm8
- DB 68,15,40,61,112,70,0,0 ; movaps 0x4670(%rip),%xmm15 # 6250 <_sk_callback_sse41+0x45d>
+ DB 68,15,40,61,112,69,0,0 ; movaps 0x4570(%rip),%xmm15 # 6150 <_sk_callback_sse41+0x45f>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 68,15,40,209 ; movaps %xmm1,%xmm10
@@ -16389,19 +16164,19 @@ PUBLIC _sk_from_srgb_dst_sse41
_sk_from_srgb_dst_sse41 LABEL PROC
DB 68,15,40,204 ; movaps %xmm4,%xmm9
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,29,251,69,0,0 ; movaps 0x45fb(%rip),%xmm11 # 6260 <_sk_callback_sse41+0x46d>
+ DB 68,15,40,29,251,68,0,0 ; movaps 0x44fb(%rip),%xmm11 # 6160 <_sk_callback_sse41+0x46f>
DB 69,15,40,209 ; movaps %xmm9,%xmm10
DB 69,15,89,211 ; mulps %xmm11,%xmm10
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
- DB 68,15,40,37,244,69,0,0 ; movaps 0x45f4(%rip),%xmm12 # 6270 <_sk_callback_sse41+0x47d>
+ DB 68,15,40,37,244,68,0,0 ; movaps 0x44f4(%rip),%xmm12 # 6170 <_sk_callback_sse41+0x47f>
DB 65,15,89,228 ; mulps %xmm12,%xmm4
- DB 68,15,40,45,248,69,0,0 ; movaps 0x45f8(%rip),%xmm13 # 6280 <_sk_callback_sse41+0x48d>
+ DB 68,15,40,45,248,68,0,0 ; movaps 0x44f8(%rip),%xmm13 # 6180 <_sk_callback_sse41+0x48f>
DB 65,15,88,229 ; addps %xmm13,%xmm4
DB 15,89,224 ; mulps %xmm0,%xmm4
- DB 68,15,40,53,249,69,0,0 ; movaps 0x45f9(%rip),%xmm14 # 6290 <_sk_callback_sse41+0x49d>
+ DB 68,15,40,53,249,68,0,0 ; movaps 0x44f9(%rip),%xmm14 # 6190 <_sk_callback_sse41+0x49f>
DB 65,15,88,230 ; addps %xmm14,%xmm4
- DB 68,15,40,61,253,69,0,0 ; movaps 0x45fd(%rip),%xmm15 # 62a0 <_sk_callback_sse41+0x4ad>
+ DB 68,15,40,61,253,68,0,0 ; movaps 0x44fd(%rip),%xmm15 # 61a0 <_sk_callback_sse41+0x4af>
DB 69,15,194,207,1 ; cmpltps %xmm15,%xmm9
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 102,65,15,56,20,226 ; blendvps %xmm0,%xmm10,%xmm4
@@ -16444,22 +16219,22 @@ _sk_to_srgb_sse41 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 68,15,82,192 ; rsqrtps %xmm0,%xmm8
- DB 68,15,40,29,110,69,0,0 ; movaps 0x456e(%rip),%xmm11 # 62b0 <_sk_callback_sse41+0x4bd>
+ DB 68,15,40,29,110,68,0,0 ; movaps 0x446e(%rip),%xmm11 # 61b0 <_sk_callback_sse41+0x4bf>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
- DB 68,15,40,37,110,69,0,0 ; movaps 0x456e(%rip),%xmm12 # 62c0 <_sk_callback_sse41+0x4cd>
+ DB 68,15,40,37,110,68,0,0 ; movaps 0x446e(%rip),%xmm12 # 61c0 <_sk_callback_sse41+0x4cf>
DB 69,15,40,248 ; movaps %xmm8,%xmm15
DB 69,15,89,252 ; mulps %xmm12,%xmm15
- DB 68,15,40,21,110,69,0,0 ; movaps 0x456e(%rip),%xmm10 # 62d0 <_sk_callback_sse41+0x4dd>
+ DB 68,15,40,21,110,68,0,0 ; movaps 0x446e(%rip),%xmm10 # 61d0 <_sk_callback_sse41+0x4df>
DB 69,15,88,250 ; addps %xmm10,%xmm15
DB 69,15,89,248 ; mulps %xmm8,%xmm15
- DB 68,15,40,45,110,69,0,0 ; movaps 0x456e(%rip),%xmm13 # 62e0 <_sk_callback_sse41+0x4ed>
+ DB 68,15,40,45,110,68,0,0 ; movaps 0x446e(%rip),%xmm13 # 61e0 <_sk_callback_sse41+0x4ef>
DB 69,15,88,253 ; addps %xmm13,%xmm15
- DB 68,15,40,53,114,69,0,0 ; movaps 0x4572(%rip),%xmm14 # 62f0 <_sk_callback_sse41+0x4fd>
+ DB 68,15,40,53,114,68,0,0 ; movaps 0x4472(%rip),%xmm14 # 61f0 <_sk_callback_sse41+0x4ff>
DB 69,15,88,198 ; addps %xmm14,%xmm8
DB 69,15,83,192 ; rcpps %xmm8,%xmm8
DB 69,15,89,199 ; mulps %xmm15,%xmm8
- DB 68,15,40,61,110,69,0,0 ; movaps 0x456e(%rip),%xmm15 # 6300 <_sk_callback_sse41+0x50d>
+ DB 68,15,40,61,110,68,0,0 ; movaps 0x446e(%rip),%xmm15 # 6200 <_sk_callback_sse41+0x50f>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 68,15,82,202 ; rsqrtps %xmm2,%xmm9
@@ -16511,7 +16286,7 @@ _sk_rgb_to_hsl_sse41 LABEL PROC
DB 68,15,93,226 ; minps %xmm2,%xmm12
DB 65,15,40,203 ; movaps %xmm11,%xmm1
DB 65,15,92,204 ; subps %xmm12,%xmm1
- DB 68,15,40,53,184,68,0,0 ; movaps 0x44b8(%rip),%xmm14 # 6310 <_sk_callback_sse41+0x51d>
+ DB 68,15,40,53,184,67,0,0 ; movaps 0x43b8(%rip),%xmm14 # 6210 <_sk_callback_sse41+0x51f>
DB 68,15,94,241 ; divps %xmm1,%xmm14
DB 69,15,40,211 ; movaps %xmm11,%xmm10
DB 69,15,194,208,0 ; cmpeqps %xmm8,%xmm10
@@ -16520,27 +16295,27 @@ _sk_rgb_to_hsl_sse41 LABEL PROC
DB 65,15,89,198 ; mulps %xmm14,%xmm0
DB 69,15,40,249 ; movaps %xmm9,%xmm15
DB 68,15,194,250,1 ; cmpltps %xmm2,%xmm15
- DB 68,15,84,61,159,68,0,0 ; andps 0x449f(%rip),%xmm15 # 6320 <_sk_callback_sse41+0x52d>
+ DB 68,15,84,61,159,67,0,0 ; andps 0x439f(%rip),%xmm15 # 6220 <_sk_callback_sse41+0x52f>
DB 68,15,88,248 ; addps %xmm0,%xmm15
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,194,193,0 ; cmpeqps %xmm9,%xmm0
DB 65,15,92,208 ; subps %xmm8,%xmm2
DB 65,15,89,214 ; mulps %xmm14,%xmm2
- DB 68,15,40,45,146,68,0,0 ; movaps 0x4492(%rip),%xmm13 # 6330 <_sk_callback_sse41+0x53d>
+ DB 68,15,40,45,146,67,0,0 ; movaps 0x4392(%rip),%xmm13 # 6230 <_sk_callback_sse41+0x53f>
DB 65,15,88,213 ; addps %xmm13,%xmm2
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 69,15,89,198 ; mulps %xmm14,%xmm8
- DB 68,15,88,5,142,68,0,0 ; addps 0x448e(%rip),%xmm8 # 6340 <_sk_callback_sse41+0x54d>
+ DB 68,15,88,5,142,67,0,0 ; addps 0x438e(%rip),%xmm8 # 6240 <_sk_callback_sse41+0x54f>
DB 102,68,15,56,20,194 ; blendvps %xmm0,%xmm2,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 102,69,15,56,20,199 ; blendvps %xmm0,%xmm15,%xmm8
- DB 68,15,89,5,134,68,0,0 ; mulps 0x4486(%rip),%xmm8 # 6350 <_sk_callback_sse41+0x55d>
+ DB 68,15,89,5,134,67,0,0 ; mulps 0x4386(%rip),%xmm8 # 6250 <_sk_callback_sse41+0x55f>
DB 69,15,40,203 ; movaps %xmm11,%xmm9
DB 69,15,194,204,4 ; cmpneqps %xmm12,%xmm9
DB 69,15,84,193 ; andps %xmm9,%xmm8
DB 69,15,92,235 ; subps %xmm11,%xmm13
DB 69,15,88,220 ; addps %xmm12,%xmm11
- DB 15,40,5,122,68,0,0 ; movaps 0x447a(%rip),%xmm0 # 6360 <_sk_callback_sse41+0x56d>
+ DB 15,40,5,122,67,0,0 ; movaps 0x437a(%rip),%xmm0 # 6260 <_sk_callback_sse41+0x56f>
DB 65,15,40,211 ; movaps %xmm11,%xmm2
DB 15,89,208 ; mulps %xmm0,%xmm2
DB 15,194,194,1 ; cmpltps %xmm2,%xmm0
@@ -16561,7 +16336,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 15,41,100,36,32 ; movaps %xmm4,0x20(%rsp)
DB 15,41,92,36,16 ; movaps %xmm3,0x10(%rsp)
DB 68,15,40,208 ; movaps %xmm0,%xmm10
- DB 68,15,40,13,60,68,0,0 ; movaps 0x443c(%rip),%xmm9 # 6370 <_sk_callback_sse41+0x57d>
+ DB 68,15,40,13,60,67,0,0 ; movaps 0x433c(%rip),%xmm9 # 6270 <_sk_callback_sse41+0x57f>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,194,194,2 ; cmpleps %xmm2,%xmm0
DB 15,40,217 ; movaps %xmm1,%xmm3
@@ -16574,19 +16349,19 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 15,41,20,36 ; movaps %xmm2,(%rsp)
DB 69,15,88,192 ; addps %xmm8,%xmm8
DB 68,15,92,197 ; subps %xmm5,%xmm8
- DB 68,15,40,53,24,68,0,0 ; movaps 0x4418(%rip),%xmm14 # 6380 <_sk_callback_sse41+0x58d>
+ DB 68,15,40,53,24,67,0,0 ; movaps 0x4318(%rip),%xmm14 # 6280 <_sk_callback_sse41+0x58f>
DB 69,15,88,242 ; addps %xmm10,%xmm14
DB 102,65,15,58,8,198,1 ; roundps $0x1,%xmm14,%xmm0
DB 68,15,92,240 ; subps %xmm0,%xmm14
- DB 68,15,40,29,17,68,0,0 ; movaps 0x4411(%rip),%xmm11 # 6390 <_sk_callback_sse41+0x59d>
+ DB 68,15,40,29,17,67,0,0 ; movaps 0x4311(%rip),%xmm11 # 6290 <_sk_callback_sse41+0x59f>
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 15,40,245 ; movaps %xmm5,%xmm6
DB 65,15,92,240 ; subps %xmm8,%xmm6
- DB 15,40,61,10,68,0,0 ; movaps 0x440a(%rip),%xmm7 # 63a0 <_sk_callback_sse41+0x5ad>
+ DB 15,40,61,10,67,0,0 ; movaps 0x430a(%rip),%xmm7 # 62a0 <_sk_callback_sse41+0x5af>
DB 69,15,40,238 ; movaps %xmm14,%xmm13
DB 68,15,89,239 ; mulps %xmm7,%xmm13
- DB 15,40,29,11,68,0,0 ; movaps 0x440b(%rip),%xmm3 # 63b0 <_sk_callback_sse41+0x5bd>
+ DB 15,40,29,11,67,0,0 ; movaps 0x430b(%rip),%xmm3 # 62b0 <_sk_callback_sse41+0x5bf>
DB 68,15,40,227 ; movaps %xmm3,%xmm12
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 68,15,89,230 ; mulps %xmm6,%xmm12
@@ -16596,7 +16371,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 68,15,40,253 ; movaps %xmm5,%xmm15
DB 102,69,15,56,20,252 ; blendvps %xmm0,%xmm12,%xmm15
- DB 68,15,40,37,234,67,0,0 ; movaps 0x43ea(%rip),%xmm12 # 63c0 <_sk_callback_sse41+0x5cd>
+ DB 68,15,40,37,234,66,0,0 ; movaps 0x42ea(%rip),%xmm12 # 62c0 <_sk_callback_sse41+0x5cf>
DB 65,15,40,196 ; movaps %xmm12,%xmm0
DB 65,15,194,198,2 ; cmpleps %xmm14,%xmm0
DB 68,15,89,238 ; mulps %xmm6,%xmm13
@@ -16630,7 +16405,7 @@ _sk_hsl_to_rgb_sse41 LABEL PROC
DB 65,15,40,198 ; movaps %xmm14,%xmm0
DB 15,40,20,36 ; movaps (%rsp),%xmm2
DB 102,15,56,20,202 ; blendvps %xmm0,%xmm2,%xmm1
- DB 68,15,88,21,99,67,0,0 ; addps 0x4363(%rip),%xmm10 # 63d0 <_sk_callback_sse41+0x5dd>
+ DB 68,15,88,21,99,66,0,0 ; addps 0x4263(%rip),%xmm10 # 62d0 <_sk_callback_sse41+0x5df>
DB 102,65,15,58,8,194,1 ; roundps $0x1,%xmm10,%xmm0
DB 68,15,92,208 ; subps %xmm0,%xmm10
DB 69,15,194,218,2 ; cmpleps %xmm10,%xmm11
@@ -16680,9 +16455,9 @@ _sk_scale_u8_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,52 ; jne 214a <_sk_scale_u8_sse41+0x3e>
DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8
- DB 102,68,15,219,5,186,66,0,0 ; pand 0x42ba(%rip),%xmm8 # 63e0 <_sk_callback_sse41+0x5ed>
+ DB 102,68,15,219,5,186,65,0,0 ; pand 0x41ba(%rip),%xmm8 # 62e0 <_sk_callback_sse41+0x5ef>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,190,66,0,0 ; mulps 0x42be(%rip),%xmm8 # 63f0 <_sk_callback_sse41+0x5fd>
+ DB 68,15,89,5,190,65,0,0 ; mulps 0x41be(%rip),%xmm8 # 62f0 <_sk_callback_sse41+0x5ff>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
@@ -16738,9 +16513,9 @@ _sk_lerp_u8_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,72 ; jne 222b <_sk_lerp_u8_sse41+0x52>
DB 102,69,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm8
- DB 102,68,15,219,5,13,66,0,0 ; pand 0x420d(%rip),%xmm8 # 6400 <_sk_callback_sse41+0x60d>
+ DB 102,68,15,219,5,13,65,0,0 ; pand 0x410d(%rip),%xmm8 # 6300 <_sk_callback_sse41+0x60f>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,17,66,0,0 ; mulps 0x4211(%rip),%xmm8 # 6410 <_sk_callback_sse41+0x61d>
+ DB 68,15,89,5,17,65,0,0 ; mulps 0x4111(%rip),%xmm8 # 6310 <_sk_callback_sse41+0x61f>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -16783,17 +16558,17 @@ _sk_lerp_565_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 15,133,152,0,0,0 ; jne 232b <_sk_lerp_565_sse41+0xa6>
DB 102,69,15,56,51,20,82 ; pmovzxwd (%r10,%rdx,2),%xmm10
- DB 102,68,15,111,5,125,65,0,0 ; movdqa 0x417d(%rip),%xmm8 # 6420 <_sk_callback_sse41+0x62d>
+ DB 102,68,15,111,5,125,64,0,0 ; movdqa 0x407d(%rip),%xmm8 # 6320 <_sk_callback_sse41+0x62f>
DB 102,69,15,219,194 ; pand %xmm10,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,124,65,0,0 ; mulps 0x417c(%rip),%xmm8 # 6430 <_sk_callback_sse41+0x63d>
- DB 102,68,15,111,13,131,65,0,0 ; movdqa 0x4183(%rip),%xmm9 # 6440 <_sk_callback_sse41+0x64d>
+ DB 68,15,89,5,124,64,0,0 ; mulps 0x407c(%rip),%xmm8 # 6330 <_sk_callback_sse41+0x63f>
+ DB 102,68,15,111,13,131,64,0,0 ; movdqa 0x4083(%rip),%xmm9 # 6340 <_sk_callback_sse41+0x64f>
DB 102,69,15,219,202 ; pand %xmm10,%xmm9
DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9
- DB 68,15,89,13,130,65,0,0 ; mulps 0x4182(%rip),%xmm9 # 6450 <_sk_callback_sse41+0x65d>
- DB 102,68,15,219,21,137,65,0,0 ; pand 0x4189(%rip),%xmm10 # 6460 <_sk_callback_sse41+0x66d>
+ DB 68,15,89,13,130,64,0,0 ; mulps 0x4082(%rip),%xmm9 # 6350 <_sk_callback_sse41+0x65f>
+ DB 102,68,15,219,21,137,64,0,0 ; pand 0x4089(%rip),%xmm10 # 6360 <_sk_callback_sse41+0x66f>
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
- DB 68,15,89,21,141,65,0,0 ; mulps 0x418d(%rip),%xmm10 # 6470 <_sk_callback_sse41+0x67d>
+ DB 68,15,89,21,141,64,0,0 ; mulps 0x408d(%rip),%xmm10 # 6370 <_sk_callback_sse41+0x67f>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -16845,7 +16620,7 @@ _sk_load_tables_sse41 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 102,15,111,5,218,64,0,0 ; movdqa 0x40da(%rip),%xmm0 # 6480 <_sk_callback_sse41+0x68d>
+ DB 102,15,111,5,218,63,0,0 ; movdqa 0x3fda(%rip),%xmm0 # 6380 <_sk_callback_sse41+0x68f>
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
DB 102,73,15,126,194 ; movq %xmm0,%r10
@@ -16860,7 +16635,7 @@ _sk_load_tables_sse41 LABEL PROC
DB 102,66,15,58,33,4,179,32 ; insertps $0x20,(%rbx,%r14,4),%xmm0
DB 102,66,15,58,33,4,11,48 ; insertps $0x30,(%rbx,%r9,1),%xmm0
DB 102,65,15,111,200 ; movdqa %xmm8,%xmm1
- DB 102,15,56,0,13,149,64,0,0 ; pshufb 0x4095(%rip),%xmm1 # 6490 <_sk_callback_sse41+0x69d>
+ DB 102,15,56,0,13,149,63,0,0 ; pshufb 0x3f95(%rip),%xmm1 # 6390 <_sk_callback_sse41+0x69f>
DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
DB 68,15,182,211 ; movzbl %bl,%r10d
@@ -16875,7 +16650,7 @@ _sk_load_tables_sse41 LABEL PROC
DB 102,15,58,33,202,48 ; insertps $0x30,%xmm2,%xmm1
DB 76,139,72,24 ; mov 0x18(%rax),%r9
DB 102,65,15,111,208 ; movdqa %xmm8,%xmm2
- DB 102,15,56,0,21,81,64,0,0 ; pshufb 0x4051(%rip),%xmm2 # 64a0 <_sk_callback_sse41+0x6ad>
+ DB 102,15,56,0,21,81,63,0,0 ; pshufb 0x3f51(%rip),%xmm2 # 63a0 <_sk_callback_sse41+0x6af>
DB 102,72,15,58,22,211,1 ; pextrq $0x1,%xmm2,%rbx
DB 102,72,15,126,208 ; movq %xmm2,%rax
DB 68,15,182,208 ; movzbl %al,%r10d
@@ -16890,7 +16665,7 @@ _sk_load_tables_sse41 LABEL PROC
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8
DB 65,15,91,216 ; cvtdq2ps %xmm8,%xmm3
- DB 15,89,29,14,64,0,0 ; mulps 0x400e(%rip),%xmm3 # 64b0 <_sk_callback_sse41+0x6bd>
+ DB 15,89,29,14,63,0,0 ; mulps 0x3f0e(%rip),%xmm3 # 63b0 <_sk_callback_sse41+0x6bf>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
@@ -16931,7 +16706,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
- DB 102,68,15,111,5,124,63,0,0 ; movdqa 0x3f7c(%rip),%xmm8 # 64c0 <_sk_callback_sse41+0x6cd>
+ DB 102,68,15,111,5,124,62,0,0 ; movdqa 0x3e7c(%rip),%xmm8 # 63c0 <_sk_callback_sse41+0x6cf>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
@@ -16949,7 +16724,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC
DB 102,15,58,33,194,32 ; insertps $0x20,%xmm2,%xmm0
DB 243,66,15,16,20,11 ; movss (%rbx,%r9,1),%xmm2
DB 102,15,58,33,194,48 ; insertps $0x30,%xmm2,%xmm0
- DB 102,15,56,0,13,43,63,0,0 ; pshufb 0x3f2b(%rip),%xmm1 # 64d0 <_sk_callback_sse41+0x6dd>
+ DB 102,15,56,0,13,43,62,0,0 ; pshufb 0x3e2b(%rip),%xmm1 # 63d0 <_sk_callback_sse41+0x6df>
DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1
DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
@@ -16985,7 +16760,7 @@ _sk_load_tables_u16_be_sse41 LABEL PROC
DB 102,65,15,235,216 ; por %xmm8,%xmm3
DB 102,15,56,51,219 ; pmovzxwd %xmm3,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,121,62,0,0 ; mulps 0x3e79(%rip),%xmm3 # 64e0 <_sk_callback_sse41+0x6ed>
+ DB 15,89,29,121,61,0,0 ; mulps 0x3d79(%rip),%xmm3 # 63e0 <_sk_callback_sse41+0x6ef>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
@@ -17025,7 +16800,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC
DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9
DB 102,15,111,202 ; movdqa %xmm2,%xmm1
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
- DB 102,68,15,111,5,238,61,0,0 ; movdqa 0x3dee(%rip),%xmm8 # 64f0 <_sk_callback_sse41+0x6fd>
+ DB 102,68,15,111,5,238,60,0,0 ; movdqa 0x3cee(%rip),%xmm8 # 63f0 <_sk_callback_sse41+0x6ff>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
@@ -17043,7 +16818,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC
DB 102,15,58,33,195,32 ; insertps $0x20,%xmm3,%xmm0
DB 243,66,15,16,28,11 ; movss (%rbx,%r9,1),%xmm3
DB 102,15,58,33,195,48 ; insertps $0x30,%xmm3,%xmm0
- DB 102,15,56,0,13,157,61,0,0 ; pshufb 0x3d9d(%rip),%xmm1 # 6500 <_sk_callback_sse41+0x70d>
+ DB 102,15,56,0,13,157,60,0,0 ; pshufb 0x3c9d(%rip),%xmm1 # 6400 <_sk_callback_sse41+0x70f>
DB 102,15,56,51,201 ; pmovzxwd %xmm1,%xmm1
DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 102,72,15,126,203 ; movq %xmm1,%rbx
@@ -17074,7 +16849,7 @@ _sk_load_tables_rgb_u16_be_sse41 LABEL PROC
DB 243,65,15,16,28,25 ; movss (%r9,%rbx,1),%xmm3
DB 102,15,58,33,211,48 ; insertps $0x30,%xmm3,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,8,61,0,0 ; movaps 0x3d08(%rip),%xmm3 # 6510 <_sk_callback_sse41+0x71d>
+ DB 15,40,29,8,60,0,0 ; movaps 0x3c08(%rip),%xmm3 # 6410 <_sk_callback_sse41+0x71f>
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
@@ -17106,7 +16881,7 @@ _sk_byte_tables_sse41 LABEL PROC
DB 65,84 ; push %r12
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,160,60,0,0 ; movaps 0x3ca0(%rip),%xmm8 # 6520 <_sk_callback_sse41+0x72d>
+ DB 68,15,40,5,160,59,0,0 ; movaps 0x3ba0(%rip),%xmm8 # 6420 <_sk_callback_sse41+0x72f>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
DB 102,73,15,58,22,193,1 ; pextrq $0x1,%xmm0,%r9
@@ -17125,7 +16900,7 @@ _sk_byte_tables_sse41 LABEL PROC
DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,13,81,60,0,0 ; movaps 0x3c51(%rip),%xmm9 # 6530 <_sk_callback_sse41+0x73d>
+ DB 68,15,40,13,81,59,0,0 ; movaps 0x3b51(%rip),%xmm9 # 6430 <_sk_callback_sse41+0x73f>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
@@ -17219,7 +16994,7 @@ _sk_byte_tables_rgb_sse41 LABEL PROC
DB 102,15,58,32,195,3 ; pinsrb $0x3,%ebx,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,13,201,58,0,0 ; movaps 0x3ac9(%rip),%xmm9 # 6540 <_sk_callback_sse41+0x74d>
+ DB 68,15,40,13,201,57,0,0 ; movaps 0x39c9(%rip),%xmm9 # 6440 <_sk_callback_sse41+0x74f>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
@@ -17396,31 +17171,31 @@ _sk_parametric_r_sse41 LABEL PROC
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,194 ; cvtdq2ps %xmm10,%xmm8
- DB 68,15,89,5,17,56,0,0 ; mulps 0x3811(%rip),%xmm8 # 6550 <_sk_callback_sse41+0x75d>
- DB 68,15,84,21,25,56,0,0 ; andps 0x3819(%rip),%xmm10 # 6560 <_sk_callback_sse41+0x76d>
- DB 68,15,86,21,33,56,0,0 ; orps 0x3821(%rip),%xmm10 # 6570 <_sk_callback_sse41+0x77d>
- DB 68,15,88,5,41,56,0,0 ; addps 0x3829(%rip),%xmm8 # 6580 <_sk_callback_sse41+0x78d>
- DB 68,15,40,37,49,56,0,0 ; movaps 0x3831(%rip),%xmm12 # 6590 <_sk_callback_sse41+0x79d>
+ DB 68,15,89,5,17,55,0,0 ; mulps 0x3711(%rip),%xmm8 # 6450 <_sk_callback_sse41+0x75f>
+ DB 68,15,84,21,25,55,0,0 ; andps 0x3719(%rip),%xmm10 # 6460 <_sk_callback_sse41+0x76f>
+ DB 68,15,86,21,33,55,0,0 ; orps 0x3721(%rip),%xmm10 # 6470 <_sk_callback_sse41+0x77f>
+ DB 68,15,88,5,41,55,0,0 ; addps 0x3729(%rip),%xmm8 # 6480 <_sk_callback_sse41+0x78f>
+ DB 68,15,40,37,49,55,0,0 ; movaps 0x3731(%rip),%xmm12 # 6490 <_sk_callback_sse41+0x79f>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,196 ; subps %xmm12,%xmm8
- DB 68,15,88,21,49,56,0,0 ; addps 0x3831(%rip),%xmm10 # 65a0 <_sk_callback_sse41+0x7ad>
- DB 68,15,40,37,57,56,0,0 ; movaps 0x3839(%rip),%xmm12 # 65b0 <_sk_callback_sse41+0x7bd>
+ DB 68,15,88,21,49,55,0,0 ; addps 0x3731(%rip),%xmm10 # 64a0 <_sk_callback_sse41+0x7af>
+ DB 68,15,40,37,57,55,0,0 ; movaps 0x3739(%rip),%xmm12 # 64b0 <_sk_callback_sse41+0x7bf>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,196 ; subps %xmm12,%xmm8
DB 69,15,89,195 ; mulps %xmm11,%xmm8
DB 102,69,15,58,8,208,1 ; roundps $0x1,%xmm8,%xmm10
DB 69,15,40,216 ; movaps %xmm8,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,5,38,56,0,0 ; addps 0x3826(%rip),%xmm8 # 65c0 <_sk_callback_sse41+0x7cd>
- DB 68,15,40,21,46,56,0,0 ; movaps 0x382e(%rip),%xmm10 # 65d0 <_sk_callback_sse41+0x7dd>
+ DB 68,15,88,5,38,55,0,0 ; addps 0x3726(%rip),%xmm8 # 64c0 <_sk_callback_sse41+0x7cf>
+ DB 68,15,40,21,46,55,0,0 ; movaps 0x372e(%rip),%xmm10 # 64d0 <_sk_callback_sse41+0x7df>
DB 69,15,89,211 ; mulps %xmm11,%xmm10
DB 69,15,92,194 ; subps %xmm10,%xmm8
- DB 68,15,40,21,46,56,0,0 ; movaps 0x382e(%rip),%xmm10 # 65e0 <_sk_callback_sse41+0x7ed>
+ DB 68,15,40,21,46,55,0,0 ; movaps 0x372e(%rip),%xmm10 # 64e0 <_sk_callback_sse41+0x7ef>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 68,15,40,29,50,56,0,0 ; movaps 0x3832(%rip),%xmm11 # 65f0 <_sk_callback_sse41+0x7fd>
+ DB 68,15,40,29,50,55,0,0 ; movaps 0x3732(%rip),%xmm11 # 64f0 <_sk_callback_sse41+0x7ff>
DB 69,15,94,218 ; divps %xmm10,%xmm11
DB 69,15,88,216 ; addps %xmm8,%xmm11
- DB 68,15,89,29,50,56,0,0 ; mulps 0x3832(%rip),%xmm11 # 6600 <_sk_callback_sse41+0x80d>
+ DB 68,15,89,29,50,55,0,0 ; mulps 0x3732(%rip),%xmm11 # 6500 <_sk_callback_sse41+0x80f>
DB 102,69,15,91,211 ; cvtps2dq %xmm11,%xmm10
DB 243,68,15,16,64,20 ; movss 0x14(%rax),%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
@@ -17428,7 +17203,7 @@ _sk_parametric_r_sse41 LABEL PROC
DB 102,69,15,56,20,193 ; blendvps %xmm0,%xmm9,%xmm8
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,25,56,0,0 ; minps 0x3819(%rip),%xmm8 # 6610 <_sk_callback_sse41+0x81d>
+ DB 68,15,93,5,25,55,0,0 ; minps 0x3719(%rip),%xmm8 # 6510 <_sk_callback_sse41+0x81f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -17456,31 +17231,31 @@ _sk_parametric_g_sse41 LABEL PROC
DB 68,15,88,217 ; addps %xmm1,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,186,55,0,0 ; mulps 0x37ba(%rip),%xmm12 # 6620 <_sk_callback_sse41+0x82d>
- DB 68,15,84,29,194,55,0,0 ; andps 0x37c2(%rip),%xmm11 # 6630 <_sk_callback_sse41+0x83d>
- DB 68,15,86,29,202,55,0,0 ; orps 0x37ca(%rip),%xmm11 # 6640 <_sk_callback_sse41+0x84d>
- DB 68,15,88,37,210,55,0,0 ; addps 0x37d2(%rip),%xmm12 # 6650 <_sk_callback_sse41+0x85d>
- DB 15,40,13,219,55,0,0 ; movaps 0x37db(%rip),%xmm1 # 6660 <_sk_callback_sse41+0x86d>
+ DB 68,15,89,37,186,54,0,0 ; mulps 0x36ba(%rip),%xmm12 # 6520 <_sk_callback_sse41+0x82f>
+ DB 68,15,84,29,194,54,0,0 ; andps 0x36c2(%rip),%xmm11 # 6530 <_sk_callback_sse41+0x83f>
+ DB 68,15,86,29,202,54,0,0 ; orps 0x36ca(%rip),%xmm11 # 6540 <_sk_callback_sse41+0x84f>
+ DB 68,15,88,37,210,54,0,0 ; addps 0x36d2(%rip),%xmm12 # 6550 <_sk_callback_sse41+0x85f>
+ DB 15,40,13,219,54,0,0 ; movaps 0x36db(%rip),%xmm1 # 6560 <_sk_callback_sse41+0x86f>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
- DB 68,15,88,29,219,55,0,0 ; addps 0x37db(%rip),%xmm11 # 6670 <_sk_callback_sse41+0x87d>
- DB 15,40,13,228,55,0,0 ; movaps 0x37e4(%rip),%xmm1 # 6680 <_sk_callback_sse41+0x88d>
+ DB 68,15,88,29,219,54,0,0 ; addps 0x36db(%rip),%xmm11 # 6570 <_sk_callback_sse41+0x87f>
+ DB 15,40,13,228,54,0,0 ; movaps 0x36e4(%rip),%xmm1 # 6580 <_sk_callback_sse41+0x88f>
DB 65,15,94,203 ; divps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,209,55,0,0 ; addps 0x37d1(%rip),%xmm12 # 6690 <_sk_callback_sse41+0x89d>
- DB 15,40,13,218,55,0,0 ; movaps 0x37da(%rip),%xmm1 # 66a0 <_sk_callback_sse41+0x8ad>
+ DB 68,15,88,37,209,54,0,0 ; addps 0x36d1(%rip),%xmm12 # 6590 <_sk_callback_sse41+0x89f>
+ DB 15,40,13,218,54,0,0 ; movaps 0x36da(%rip),%xmm1 # 65a0 <_sk_callback_sse41+0x8af>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 68,15,92,225 ; subps %xmm1,%xmm12
- DB 68,15,40,21,218,55,0,0 ; movaps 0x37da(%rip),%xmm10 # 66b0 <_sk_callback_sse41+0x8bd>
+ DB 68,15,40,21,218,54,0,0 ; movaps 0x36da(%rip),%xmm10 # 65b0 <_sk_callback_sse41+0x8bf>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,13,223,55,0,0 ; movaps 0x37df(%rip),%xmm1 # 66c0 <_sk_callback_sse41+0x8cd>
+ DB 15,40,13,223,54,0,0 ; movaps 0x36df(%rip),%xmm1 # 65c0 <_sk_callback_sse41+0x8cf>
DB 65,15,94,202 ; divps %xmm10,%xmm1
DB 65,15,88,204 ; addps %xmm12,%xmm1
- DB 15,89,13,224,55,0,0 ; mulps 0x37e0(%rip),%xmm1 # 66d0 <_sk_callback_sse41+0x8dd>
+ DB 15,89,13,224,54,0,0 ; mulps 0x36e0(%rip),%xmm1 # 65d0 <_sk_callback_sse41+0x8df>
DB 102,68,15,91,209 ; cvtps2dq %xmm1,%xmm10
DB 243,15,16,72,20 ; movss 0x14(%rax),%xmm1
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
@@ -17488,7 +17263,7 @@ _sk_parametric_g_sse41 LABEL PROC
DB 102,65,15,56,20,201 ; blendvps %xmm0,%xmm9,%xmm1
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,200 ; maxps %xmm0,%xmm1
- DB 15,93,13,203,55,0,0 ; minps 0x37cb(%rip),%xmm1 # 66e0 <_sk_callback_sse41+0x8ed>
+ DB 15,93,13,203,54,0,0 ; minps 0x36cb(%rip),%xmm1 # 65e0 <_sk_callback_sse41+0x8ef>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -17516,31 +17291,31 @@ _sk_parametric_b_sse41 LABEL PROC
DB 68,15,88,218 ; addps %xmm2,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,108,55,0,0 ; mulps 0x376c(%rip),%xmm12 # 66f0 <_sk_callback_sse41+0x8fd>
- DB 68,15,84,29,116,55,0,0 ; andps 0x3774(%rip),%xmm11 # 6700 <_sk_callback_sse41+0x90d>
- DB 68,15,86,29,124,55,0,0 ; orps 0x377c(%rip),%xmm11 # 6710 <_sk_callback_sse41+0x91d>
- DB 68,15,88,37,132,55,0,0 ; addps 0x3784(%rip),%xmm12 # 6720 <_sk_callback_sse41+0x92d>
- DB 15,40,21,141,55,0,0 ; movaps 0x378d(%rip),%xmm2 # 6730 <_sk_callback_sse41+0x93d>
+ DB 68,15,89,37,108,54,0,0 ; mulps 0x366c(%rip),%xmm12 # 65f0 <_sk_callback_sse41+0x8ff>
+ DB 68,15,84,29,116,54,0,0 ; andps 0x3674(%rip),%xmm11 # 6600 <_sk_callback_sse41+0x90f>
+ DB 68,15,86,29,124,54,0,0 ; orps 0x367c(%rip),%xmm11 # 6610 <_sk_callback_sse41+0x91f>
+ DB 68,15,88,37,132,54,0,0 ; addps 0x3684(%rip),%xmm12 # 6620 <_sk_callback_sse41+0x92f>
+ DB 15,40,21,141,54,0,0 ; movaps 0x368d(%rip),%xmm2 # 6630 <_sk_callback_sse41+0x93f>
DB 65,15,89,211 ; mulps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
- DB 68,15,88,29,141,55,0,0 ; addps 0x378d(%rip),%xmm11 # 6740 <_sk_callback_sse41+0x94d>
- DB 15,40,21,150,55,0,0 ; movaps 0x3796(%rip),%xmm2 # 6750 <_sk_callback_sse41+0x95d>
+ DB 68,15,88,29,141,54,0,0 ; addps 0x368d(%rip),%xmm11 # 6640 <_sk_callback_sse41+0x94f>
+ DB 15,40,21,150,54,0,0 ; movaps 0x3696(%rip),%xmm2 # 6650 <_sk_callback_sse41+0x95f>
DB 65,15,94,211 ; divps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,131,55,0,0 ; addps 0x3783(%rip),%xmm12 # 6760 <_sk_callback_sse41+0x96d>
- DB 15,40,21,140,55,0,0 ; movaps 0x378c(%rip),%xmm2 # 6770 <_sk_callback_sse41+0x97d>
+ DB 68,15,88,37,131,54,0,0 ; addps 0x3683(%rip),%xmm12 # 6660 <_sk_callback_sse41+0x96f>
+ DB 15,40,21,140,54,0,0 ; movaps 0x368c(%rip),%xmm2 # 6670 <_sk_callback_sse41+0x97f>
DB 65,15,89,211 ; mulps %xmm11,%xmm2
DB 68,15,92,226 ; subps %xmm2,%xmm12
- DB 68,15,40,21,140,55,0,0 ; movaps 0x378c(%rip),%xmm10 # 6780 <_sk_callback_sse41+0x98d>
+ DB 68,15,40,21,140,54,0,0 ; movaps 0x368c(%rip),%xmm10 # 6680 <_sk_callback_sse41+0x98f>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,21,145,55,0,0 ; movaps 0x3791(%rip),%xmm2 # 6790 <_sk_callback_sse41+0x99d>
+ DB 15,40,21,145,54,0,0 ; movaps 0x3691(%rip),%xmm2 # 6690 <_sk_callback_sse41+0x99f>
DB 65,15,94,210 ; divps %xmm10,%xmm2
DB 65,15,88,212 ; addps %xmm12,%xmm2
- DB 15,89,21,146,55,0,0 ; mulps 0x3792(%rip),%xmm2 # 67a0 <_sk_callback_sse41+0x9ad>
+ DB 15,89,21,146,54,0,0 ; mulps 0x3692(%rip),%xmm2 # 66a0 <_sk_callback_sse41+0x9af>
DB 102,68,15,91,210 ; cvtps2dq %xmm2,%xmm10
DB 243,15,16,80,20 ; movss 0x14(%rax),%xmm2
DB 15,198,210,0 ; shufps $0x0,%xmm2,%xmm2
@@ -17548,7 +17323,7 @@ _sk_parametric_b_sse41 LABEL PROC
DB 102,65,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm2
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,208 ; maxps %xmm0,%xmm2
- DB 15,93,21,125,55,0,0 ; minps 0x377d(%rip),%xmm2 # 67b0 <_sk_callback_sse41+0x9bd>
+ DB 15,93,21,125,54,0,0 ; minps 0x367d(%rip),%xmm2 # 66b0 <_sk_callback_sse41+0x9bf>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -17576,31 +17351,31 @@ _sk_parametric_a_sse41 LABEL PROC
DB 68,15,88,219 ; addps %xmm3,%xmm11
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,91,227 ; cvtdq2ps %xmm11,%xmm12
- DB 68,15,89,37,30,55,0,0 ; mulps 0x371e(%rip),%xmm12 # 67c0 <_sk_callback_sse41+0x9cd>
- DB 68,15,84,29,38,55,0,0 ; andps 0x3726(%rip),%xmm11 # 67d0 <_sk_callback_sse41+0x9dd>
- DB 68,15,86,29,46,55,0,0 ; orps 0x372e(%rip),%xmm11 # 67e0 <_sk_callback_sse41+0x9ed>
- DB 68,15,88,37,54,55,0,0 ; addps 0x3736(%rip),%xmm12 # 67f0 <_sk_callback_sse41+0x9fd>
- DB 15,40,29,63,55,0,0 ; movaps 0x373f(%rip),%xmm3 # 6800 <_sk_callback_sse41+0xa0d>
+ DB 68,15,89,37,30,54,0,0 ; mulps 0x361e(%rip),%xmm12 # 66c0 <_sk_callback_sse41+0x9cf>
+ DB 68,15,84,29,38,54,0,0 ; andps 0x3626(%rip),%xmm11 # 66d0 <_sk_callback_sse41+0x9df>
+ DB 68,15,86,29,46,54,0,0 ; orps 0x362e(%rip),%xmm11 # 66e0 <_sk_callback_sse41+0x9ef>
+ DB 68,15,88,37,54,54,0,0 ; addps 0x3636(%rip),%xmm12 # 66f0 <_sk_callback_sse41+0x9ff>
+ DB 15,40,29,63,54,0,0 ; movaps 0x363f(%rip),%xmm3 # 6700 <_sk_callback_sse41+0xa0f>
DB 65,15,89,219 ; mulps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
- DB 68,15,88,29,63,55,0,0 ; addps 0x373f(%rip),%xmm11 # 6810 <_sk_callback_sse41+0xa1d>
- DB 15,40,29,72,55,0,0 ; movaps 0x3748(%rip),%xmm3 # 6820 <_sk_callback_sse41+0xa2d>
+ DB 68,15,88,29,63,54,0,0 ; addps 0x363f(%rip),%xmm11 # 6710 <_sk_callback_sse41+0xa1f>
+ DB 15,40,29,72,54,0,0 ; movaps 0x3648(%rip),%xmm3 # 6720 <_sk_callback_sse41+0xa2f>
DB 65,15,94,219 ; divps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 102,69,15,58,8,212,1 ; roundps $0x1,%xmm12,%xmm10
DB 69,15,40,220 ; movaps %xmm12,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 68,15,88,37,53,55,0,0 ; addps 0x3735(%rip),%xmm12 # 6830 <_sk_callback_sse41+0xa3d>
- DB 15,40,29,62,55,0,0 ; movaps 0x373e(%rip),%xmm3 # 6840 <_sk_callback_sse41+0xa4d>
+ DB 68,15,88,37,53,54,0,0 ; addps 0x3635(%rip),%xmm12 # 6730 <_sk_callback_sse41+0xa3f>
+ DB 15,40,29,62,54,0,0 ; movaps 0x363e(%rip),%xmm3 # 6740 <_sk_callback_sse41+0xa4f>
DB 65,15,89,219 ; mulps %xmm11,%xmm3
DB 68,15,92,227 ; subps %xmm3,%xmm12
- DB 68,15,40,21,62,55,0,0 ; movaps 0x373e(%rip),%xmm10 # 6850 <_sk_callback_sse41+0xa5d>
+ DB 68,15,40,21,62,54,0,0 ; movaps 0x363e(%rip),%xmm10 # 6750 <_sk_callback_sse41+0xa5f>
DB 69,15,92,211 ; subps %xmm11,%xmm10
- DB 15,40,29,67,55,0,0 ; movaps 0x3743(%rip),%xmm3 # 6860 <_sk_callback_sse41+0xa6d>
+ DB 15,40,29,67,54,0,0 ; movaps 0x3643(%rip),%xmm3 # 6760 <_sk_callback_sse41+0xa6f>
DB 65,15,94,218 ; divps %xmm10,%xmm3
DB 65,15,88,220 ; addps %xmm12,%xmm3
- DB 15,89,29,68,55,0,0 ; mulps 0x3744(%rip),%xmm3 # 6870 <_sk_callback_sse41+0xa7d>
+ DB 15,89,29,68,54,0,0 ; mulps 0x3644(%rip),%xmm3 # 6770 <_sk_callback_sse41+0xa7f>
DB 102,68,15,91,211 ; cvtps2dq %xmm3,%xmm10
DB 243,15,16,88,20 ; movss 0x14(%rax),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
@@ -17608,7 +17383,7 @@ _sk_parametric_a_sse41 LABEL PROC
DB 102,65,15,56,20,217 ; blendvps %xmm0,%xmm9,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,95,216 ; maxps %xmm0,%xmm3
- DB 15,93,29,47,55,0,0 ; minps 0x372f(%rip),%xmm3 # 6880 <_sk_callback_sse41+0xa8d>
+ DB 15,93,29,47,54,0,0 ; minps 0x362f(%rip),%xmm3 # 6780 <_sk_callback_sse41+0xa8f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -17616,29 +17391,29 @@ _sk_parametric_a_sse41 LABEL PROC
PUBLIC _sk_lab_to_xyz_sse41
_sk_lab_to_xyz_sse41 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,89,5,43,55,0,0 ; mulps 0x372b(%rip),%xmm8 # 6890 <_sk_callback_sse41+0xa9d>
- DB 68,15,40,13,51,55,0,0 ; movaps 0x3733(%rip),%xmm9 # 68a0 <_sk_callback_sse41+0xaad>
+ DB 68,15,89,5,43,54,0,0 ; mulps 0x362b(%rip),%xmm8 # 6790 <_sk_callback_sse41+0xa9f>
+ DB 68,15,40,13,51,54,0,0 ; movaps 0x3633(%rip),%xmm9 # 67a0 <_sk_callback_sse41+0xaaf>
DB 65,15,89,201 ; mulps %xmm9,%xmm1
- DB 15,40,5,56,55,0,0 ; movaps 0x3738(%rip),%xmm0 # 68b0 <_sk_callback_sse41+0xabd>
+ DB 15,40,5,56,54,0,0 ; movaps 0x3638(%rip),%xmm0 # 67b0 <_sk_callback_sse41+0xabf>
DB 15,88,200 ; addps %xmm0,%xmm1
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 15,88,208 ; addps %xmm0,%xmm2
- DB 68,15,88,5,54,55,0,0 ; addps 0x3736(%rip),%xmm8 # 68c0 <_sk_callback_sse41+0xacd>
- DB 68,15,89,5,62,55,0,0 ; mulps 0x373e(%rip),%xmm8 # 68d0 <_sk_callback_sse41+0xadd>
- DB 15,89,13,71,55,0,0 ; mulps 0x3747(%rip),%xmm1 # 68e0 <_sk_callback_sse41+0xaed>
+ DB 68,15,88,5,54,54,0,0 ; addps 0x3636(%rip),%xmm8 # 67c0 <_sk_callback_sse41+0xacf>
+ DB 68,15,89,5,62,54,0,0 ; mulps 0x363e(%rip),%xmm8 # 67d0 <_sk_callback_sse41+0xadf>
+ DB 15,89,13,71,54,0,0 ; mulps 0x3647(%rip),%xmm1 # 67e0 <_sk_callback_sse41+0xaef>
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 15,89,21,76,55,0,0 ; mulps 0x374c(%rip),%xmm2 # 68f0 <_sk_callback_sse41+0xafd>
+ DB 15,89,21,76,54,0,0 ; mulps 0x364c(%rip),%xmm2 # 67f0 <_sk_callback_sse41+0xaff>
DB 69,15,40,208 ; movaps %xmm8,%xmm10
DB 68,15,92,210 ; subps %xmm2,%xmm10
DB 68,15,40,217 ; movaps %xmm1,%xmm11
DB 69,15,89,219 ; mulps %xmm11,%xmm11
DB 68,15,89,217 ; mulps %xmm1,%xmm11
- DB 68,15,40,13,64,55,0,0 ; movaps 0x3740(%rip),%xmm9 # 6900 <_sk_callback_sse41+0xb0d>
+ DB 68,15,40,13,64,54,0,0 ; movaps 0x3640(%rip),%xmm9 # 6800 <_sk_callback_sse41+0xb0f>
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0
- DB 15,40,21,64,55,0,0 ; movaps 0x3740(%rip),%xmm2 # 6910 <_sk_callback_sse41+0xb1d>
+ DB 15,40,21,64,54,0,0 ; movaps 0x3640(%rip),%xmm2 # 6810 <_sk_callback_sse41+0xb1f>
DB 15,88,202 ; addps %xmm2,%xmm1
- DB 68,15,40,37,69,55,0,0 ; movaps 0x3745(%rip),%xmm12 # 6920 <_sk_callback_sse41+0xb2d>
+ DB 68,15,40,37,69,54,0,0 ; movaps 0x3645(%rip),%xmm12 # 6820 <_sk_callback_sse41+0xb2f>
DB 65,15,89,204 ; mulps %xmm12,%xmm1
DB 102,65,15,56,20,203 ; blendvps %xmm0,%xmm11,%xmm1
DB 69,15,40,216 ; movaps %xmm8,%xmm11
@@ -17657,8 +17432,8 @@ _sk_lab_to_xyz_sse41 LABEL PROC
DB 65,15,89,212 ; mulps %xmm12,%xmm2
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 102,65,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm2
- DB 15,89,13,254,54,0,0 ; mulps 0x36fe(%rip),%xmm1 # 6930 <_sk_callback_sse41+0xb3d>
- DB 15,89,21,7,55,0,0 ; mulps 0x3707(%rip),%xmm2 # 6940 <_sk_callback_sse41+0xb4d>
+ DB 15,89,13,254,53,0,0 ; mulps 0x35fe(%rip),%xmm1 # 6830 <_sk_callback_sse41+0xb3f>
+ DB 15,89,21,7,54,0,0 ; mulps 0x3607(%rip),%xmm2 # 6840 <_sk_callback_sse41+0xb4f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 65,15,40,200 ; movaps %xmm8,%xmm1
@@ -17671,9 +17446,9 @@ _sk_load_a8_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,39 ; jne 3275 <_sk_load_a8_sse41+0x31>
DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0
- DB 102,15,219,5,243,54,0,0 ; pand 0x36f3(%rip),%xmm0 # 6950 <_sk_callback_sse41+0xb5d>
+ DB 102,15,219,5,243,53,0,0 ; pand 0x35f3(%rip),%xmm0 # 6850 <_sk_callback_sse41+0xb5f>
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,249,54,0,0 ; mulps 0x36f9(%rip),%xmm3 # 6960 <_sk_callback_sse41+0xb6d>
+ DB 15,89,29,249,53,0,0 ; mulps 0x35f9(%rip),%xmm3 # 6860 <_sk_callback_sse41+0xb6f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
@@ -17707,9 +17482,9 @@ _sk_load_a8_dst_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,39 ; jne 32f3 <_sk_load_a8_dst_sse41+0x31>
DB 102,65,15,56,49,36,18 ; pmovzxbd (%r10,%rdx,1),%xmm4
- DB 102,15,219,37,149,54,0,0 ; pand 0x3695(%rip),%xmm4 # 6970 <_sk_callback_sse41+0xb7d>
+ DB 102,15,219,37,149,53,0,0 ; pand 0x3595(%rip),%xmm4 # 6870 <_sk_callback_sse41+0xb7f>
DB 15,91,252 ; cvtdq2ps %xmm4,%xmm7
- DB 15,89,61,155,54,0,0 ; mulps 0x369b(%rip),%xmm7 # 6980 <_sk_callback_sse41+0xb8d>
+ DB 15,89,61,155,53,0,0 ; mulps 0x359b(%rip),%xmm7 # 6880 <_sk_callback_sse41+0xb8f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 102,15,239,237 ; pxor %xmm5,%xmm5
@@ -17742,7 +17517,7 @@ _sk_gather_a8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -17761,7 +17536,7 @@ _sk_gather_a8_sse41 LABEL PROC
DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,224,53,0,0 ; mulps 0x35e0(%rip),%xmm3 # 6990 <_sk_callback_sse41+0xb9d>
+ DB 15,89,29,224,52,0,0 ; mulps 0x34e0(%rip),%xmm3 # 6890 <_sk_callback_sse41+0xb9f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
@@ -17774,7 +17549,7 @@ _sk_store_a8_sse41 LABEL PROC
DB 72,131,236,4 ; sub $0x4,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
- DB 68,15,40,5,207,53,0,0 ; movaps 0x35cf(%rip),%xmm8 # 69a0 <_sk_callback_sse41+0xbad>
+ DB 68,15,40,5,207,52,0,0 ; movaps 0x34cf(%rip),%xmm8 # 68a0 <_sk_callback_sse41+0xbaf>
DB 68,15,89,195 ; mulps %xmm3,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
@@ -17796,7 +17571,7 @@ _sk_store_a8_sse41 LABEL PROC
DB 65,128,249,3 ; cmp $0x3,%r9b
DB 117,217 ; jne 33f3 <_sk_store_a8_sse41+0x33>
DB 102,69,15,58,20,68,18,2,8 ; pextrb $0x8,%xmm8,0x2(%r10,%rdx,1)
- DB 102,68,15,56,0,5,131,53,0,0 ; pshufb 0x3583(%rip),%xmm8 # 69b0 <_sk_callback_sse41+0xbbd>
+ DB 102,68,15,56,0,5,131,52,0,0 ; pshufb 0x3483(%rip),%xmm8 # 68b0 <_sk_callback_sse41+0xbbf>
DB 102,69,15,58,21,4,18,0 ; pextrw $0x0,%xmm8,(%r10,%rdx,1)
DB 235,188 ; jmp 33f3 <_sk_store_a8_sse41+0x33>
DB 102,69,15,58,20,4,18,0 ; pextrb $0x0,%xmm8,(%r10,%rdx,1)
@@ -17809,11 +17584,11 @@ _sk_load_g8_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,42 ; jne 3475 <_sk_load_g8_sse41+0x34>
DB 102,65,15,56,49,4,18 ; pmovzxbd (%r10,%rdx,1),%xmm0
- DB 102,15,219,5,102,53,0,0 ; pand 0x3566(%rip),%xmm0 # 69c0 <_sk_callback_sse41+0xbcd>
+ DB 102,15,219,5,102,52,0,0 ; pand 0x3466(%rip),%xmm0 # 68c0 <_sk_callback_sse41+0xbcf>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,108,53,0,0 ; mulps 0x356c(%rip),%xmm0 # 69d0 <_sk_callback_sse41+0xbdd>
+ DB 15,89,5,108,52,0,0 ; mulps 0x346c(%rip),%xmm0 # 68d0 <_sk_callback_sse41+0xbdf>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,115,53,0,0 ; movaps 0x3573(%rip),%xmm3 # 69e0 <_sk_callback_sse41+0xbed>
+ DB 15,40,29,115,52,0,0 ; movaps 0x3473(%rip),%xmm3 # 68e0 <_sk_callback_sse41+0xbef>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,224 ; jmpq *%rax
@@ -17845,11 +17620,11 @@ _sk_load_g8_dst_sse41 LABEL PROC
DB 77,133,192 ; test %r8,%r8
DB 117,42 ; jne 34f6 <_sk_load_g8_dst_sse41+0x34>
DB 102,65,15,56,49,36,18 ; pmovzxbd (%r10,%rdx,1),%xmm4
- DB 102,15,219,37,21,53,0,0 ; pand 0x3515(%rip),%xmm4 # 69f0 <_sk_callback_sse41+0xbfd>
+ DB 102,15,219,37,21,52,0,0 ; pand 0x3415(%rip),%xmm4 # 68f0 <_sk_callback_sse41+0xbff>
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,27,53,0,0 ; mulps 0x351b(%rip),%xmm4 # 6a00 <_sk_callback_sse41+0xc0d>
+ DB 15,89,37,27,52,0,0 ; mulps 0x341b(%rip),%xmm4 # 6900 <_sk_callback_sse41+0xc0f>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,61,34,53,0,0 ; movaps 0x3522(%rip),%xmm7 # 6a10 <_sk_callback_sse41+0xc1d>
+ DB 15,40,61,34,52,0,0 ; movaps 0x3422(%rip),%xmm7 # 6910 <_sk_callback_sse41+0xc1f>
DB 15,40,236 ; movaps %xmm4,%xmm5
DB 15,40,244 ; movaps %xmm4,%xmm6
DB 255,224 ; jmpq *%rax
@@ -17880,7 +17655,7 @@ _sk_gather_g8_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -17899,156 +17674,95 @@ _sk_gather_g8_sse41 LABEL PROC
DB 102,15,58,32,192,3 ; pinsrb $0x3,%eax,%xmm0
DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,109,52,0,0 ; mulps 0x346d(%rip),%xmm0 # 6a20 <_sk_callback_sse41+0xc2d>
+ DB 15,89,5,109,51,0,0 ; mulps 0x336d(%rip),%xmm0 # 6920 <_sk_callback_sse41+0xc2f>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,116,52,0,0 ; movaps 0x3474(%rip),%xmm3 # 6a30 <_sk_callback_sse41+0xc3d>
+ DB 15,40,29,116,51,0,0 ; movaps 0x3374(%rip),%xmm3 # 6930 <_sk_callback_sse41+0xc3f>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
-PUBLIC _sk_gather_i8_sse41
-_sk_gather_i8_sse41 LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,193 ; mov %rax,%r9
- DB 77,133,201 ; test %r9,%r9
- DB 116,5 ; je 35d4 <_sk_gather_i8_sse41+0xf>
- DB 76,137,200 ; mov %r9,%rax
- DB 235,2 ; jmp 35d6 <_sk_gather_i8_sse41+0x11>
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 65,86 ; push %r14
- DB 83 ; push %rbx
- DB 76,139,16 ; mov (%rax),%r10
- DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
- DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
- DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
- DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
- DB 102,15,254,194 ; paddd %xmm2,%xmm0
- DB 102,72,15,58,22,192,1 ; pextrq $0x1,%xmm0,%rax
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 102,67,15,58,32,4,50,0 ; pinsrb $0x0,(%r10,%r14,1),%xmm0
- DB 102,65,15,58,32,4,26,1 ; pinsrb $0x1,(%r10,%rbx,1),%xmm0
- DB 102,67,15,58,32,4,26,2 ; pinsrb $0x2,(%r10,%r11,1),%xmm0
- DB 102,65,15,58,32,4,2,3 ; pinsrb $0x3,(%r10,%rax,1),%xmm0
- DB 102,15,56,49,192 ; pmovzxbd %xmm0,%xmm0
- DB 102,73,15,58,22,194,1 ; pextrq $0x1,%xmm0,%r10
- DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 73,139,65,8 ; mov 0x8(%r9),%rax
- DB 65,137,217 ; mov %ebx,%r9d
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 69,137,211 ; mov %r10d,%r11d
- DB 73,193,234,30 ; shr $0x1e,%r10
- DB 102,66,15,110,28,136 ; movd (%rax,%r9,4),%xmm3
- DB 102,15,58,34,28,24,1 ; pinsrd $0x1,(%rax,%rbx,1),%xmm3
- DB 102,66,15,58,34,28,152,2 ; pinsrd $0x2,(%rax,%r11,4),%xmm3
- DB 102,66,15,58,34,28,16,3 ; pinsrd $0x3,(%rax,%r10,1),%xmm3
- DB 102,15,111,5,199,51,0,0 ; movdqa 0x33c7(%rip),%xmm0 # 6a40 <_sk_callback_sse41+0xc4d>
- DB 102,15,219,195 ; pand %xmm3,%xmm0
- DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,200,51,0,0 ; movaps 0x33c8(%rip),%xmm8 # 6a50 <_sk_callback_sse41+0xc5d>
- DB 65,15,89,192 ; mulps %xmm8,%xmm0
- DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,199,51,0,0 ; pshufb 0x33c7(%rip),%xmm1 # 6a60 <_sk_callback_sse41+0xc6d>
- DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 65,15,89,200 ; mulps %xmm8,%xmm1
- DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,195,51,0,0 ; pshufb 0x33c3(%rip),%xmm2 # 6a70 <_sk_callback_sse41+0xc7d>
- DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 65,15,89,208 ; mulps %xmm8,%xmm2
- DB 102,15,114,211,24 ; psrld $0x18,%xmm3
- DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 65,15,89,216 ; mulps %xmm8,%xmm3
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,94 ; pop %r14
- DB 255,224 ; jmpq *%rax
-
PUBLIC _sk_load_565_sse41
_sk_load_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,80 ; jne 3721 <_sk_load_565_sse41+0x5a>
+ DB 117,80 ; jne 361f <_sk_load_565_sse41+0x5a>
DB 102,65,15,56,51,20,82 ; pmovzxwd (%r10,%rdx,2),%xmm2
- DB 102,15,111,5,160,51,0,0 ; movdqa 0x33a0(%rip),%xmm0 # 6a80 <_sk_callback_sse41+0xc8d>
+ DB 102,15,111,5,98,51,0,0 ; movdqa 0x3362(%rip),%xmm0 # 6940 <_sk_callback_sse41+0xc4f>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,162,51,0,0 ; mulps 0x33a2(%rip),%xmm0 # 6a90 <_sk_callback_sse41+0xc9d>
- DB 102,15,111,13,170,51,0,0 ; movdqa 0x33aa(%rip),%xmm1 # 6aa0 <_sk_callback_sse41+0xcad>
+ DB 15,89,5,100,51,0,0 ; mulps 0x3364(%rip),%xmm0 # 6950 <_sk_callback_sse41+0xc5f>
+ DB 102,15,111,13,108,51,0,0 ; movdqa 0x336c(%rip),%xmm1 # 6960 <_sk_callback_sse41+0xc6f>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,172,51,0,0 ; mulps 0x33ac(%rip),%xmm1 # 6ab0 <_sk_callback_sse41+0xcbd>
- DB 102,15,219,21,180,51,0,0 ; pand 0x33b4(%rip),%xmm2 # 6ac0 <_sk_callback_sse41+0xccd>
+ DB 15,89,13,110,51,0,0 ; mulps 0x336e(%rip),%xmm1 # 6970 <_sk_callback_sse41+0xc7f>
+ DB 102,15,219,21,118,51,0,0 ; pand 0x3376(%rip),%xmm2 # 6980 <_sk_callback_sse41+0xc8f>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,186,51,0,0 ; mulps 0x33ba(%rip),%xmm2 # 6ad0 <_sk_callback_sse41+0xcdd>
+ DB 15,89,21,124,51,0,0 ; mulps 0x337c(%rip),%xmm2 # 6990 <_sk_callback_sse41+0xc9f>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,193,51,0,0 ; movaps 0x33c1(%rip),%xmm3 # 6ae0 <_sk_callback_sse41+0xced>
+ DB 15,40,29,131,51,0,0 ; movaps 0x3383(%rip),%xmm3 # 69a0 <_sk_callback_sse41+0xcaf>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,53 ; je 3763 <_sk_load_565_sse41+0x9c>
+ DB 116,53 ; je 3661 <_sk_load_565_sse41+0x9c>
DB 102,15,239,210 ; pxor %xmm2,%xmm2
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 374d <_sk_load_565_sse41+0x86>
+ DB 116,21 ; je 364b <_sk_load_565_sse41+0x86>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,154 ; jne 36d8 <_sk_load_565_sse41+0x11>
+ DB 117,154 ; jne 35d6 <_sk_load_565_sse41+0x11>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2
DB 102,65,15,110,4,82 ; movd (%r10,%rdx,2),%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
DB 102,15,58,14,208,15 ; pblendw $0xf,%xmm0,%xmm2
- DB 233,117,255,255,255 ; jmpq 36d8 <_sk_load_565_sse41+0x11>
+ DB 233,117,255,255,255 ; jmpq 35d6 <_sk_load_565_sse41+0x11>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,208 ; movd %eax,%xmm2
- DB 233,103,255,255,255 ; jmpq 36d8 <_sk_load_565_sse41+0x11>
+ DB 233,103,255,255,255 ; jmpq 35d6 <_sk_load_565_sse41+0x11>
PUBLIC _sk_load_565_dst_sse41
_sk_load_565_dst_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,80 ; jne 37cb <_sk_load_565_dst_sse41+0x5a>
+ DB 117,80 ; jne 36c9 <_sk_load_565_dst_sse41+0x5a>
DB 102,65,15,56,51,52,82 ; pmovzxwd (%r10,%rdx,2),%xmm6
- DB 102,15,111,37,102,51,0,0 ; movdqa 0x3366(%rip),%xmm4 # 6af0 <_sk_callback_sse41+0xcfd>
+ DB 102,15,111,37,40,51,0,0 ; movdqa 0x3328(%rip),%xmm4 # 69b0 <_sk_callback_sse41+0xcbf>
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,104,51,0,0 ; mulps 0x3368(%rip),%xmm4 # 6b00 <_sk_callback_sse41+0xd0d>
- DB 102,15,111,45,112,51,0,0 ; movdqa 0x3370(%rip),%xmm5 # 6b10 <_sk_callback_sse41+0xd1d>
+ DB 15,89,37,42,51,0,0 ; mulps 0x332a(%rip),%xmm4 # 69c0 <_sk_callback_sse41+0xccf>
+ DB 102,15,111,45,50,51,0,0 ; movdqa 0x3332(%rip),%xmm5 # 69d0 <_sk_callback_sse41+0xcdf>
DB 102,15,219,238 ; pand %xmm6,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,45,114,51,0,0 ; mulps 0x3372(%rip),%xmm5 # 6b20 <_sk_callback_sse41+0xd2d>
- DB 102,15,219,53,122,51,0,0 ; pand 0x337a(%rip),%xmm6 # 6b30 <_sk_callback_sse41+0xd3d>
+ DB 15,89,45,52,51,0,0 ; mulps 0x3334(%rip),%xmm5 # 69e0 <_sk_callback_sse41+0xcef>
+ DB 102,15,219,53,60,51,0,0 ; pand 0x333c(%rip),%xmm6 # 69f0 <_sk_callback_sse41+0xcff>
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,53,128,51,0,0 ; mulps 0x3380(%rip),%xmm6 # 6b40 <_sk_callback_sse41+0xd4d>
+ DB 15,89,53,66,51,0,0 ; mulps 0x3342(%rip),%xmm6 # 6a00 <_sk_callback_sse41+0xd0f>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,61,135,51,0,0 ; movaps 0x3387(%rip),%xmm7 # 6b50 <_sk_callback_sse41+0xd5d>
+ DB 15,40,61,73,51,0,0 ; movaps 0x3349(%rip),%xmm7 # 6a10 <_sk_callback_sse41+0xd1f>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,53 ; je 380d <_sk_load_565_dst_sse41+0x9c>
+ DB 116,53 ; je 370b <_sk_load_565_dst_sse41+0x9c>
DB 102,15,239,246 ; pxor %xmm6,%xmm6
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 37f7 <_sk_load_565_dst_sse41+0x86>
+ DB 116,21 ; je 36f5 <_sk_load_565_dst_sse41+0x86>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,154 ; jne 3782 <_sk_load_565_dst_sse41+0x11>
+ DB 117,154 ; jne 3680 <_sk_load_565_dst_sse41+0x11>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,224 ; movd %eax,%xmm4
DB 102,15,112,244,69 ; pshufd $0x45,%xmm4,%xmm6
DB 102,65,15,110,36,82 ; movd (%r10,%rdx,2),%xmm4
DB 102,15,56,51,228 ; pmovzxwd %xmm4,%xmm4
DB 102,15,58,14,244,15 ; pblendw $0xf,%xmm4,%xmm6
- DB 233,117,255,255,255 ; jmpq 3782 <_sk_load_565_dst_sse41+0x11>
+ DB 233,117,255,255,255 ; jmpq 3680 <_sk_load_565_dst_sse41+0x11>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,240 ; movd %eax,%xmm6
- DB 233,103,255,255,255 ; jmpq 3782 <_sk_load_565_dst_sse41+0x11>
+ DB 233,103,255,255,255 ; jmpq 3680 <_sk_load_565_dst_sse41+0x11>
PUBLIC _sk_gather_565_sse41
_sk_gather_565_sse41 LABEL PROC
@@ -18056,7 +17770,7 @@ _sk_gather_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -18074,19 +17788,19 @@ _sk_gather_565_sse41 LABEL PROC
DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0
DB 102,15,56,51,208 ; pmovzxwd %xmm0,%xmm2
- DB 102,15,111,5,219,50,0,0 ; movdqa 0x32db(%rip),%xmm0 # 6b60 <_sk_callback_sse41+0xd6d>
+ DB 102,15,111,5,157,50,0,0 ; movdqa 0x329d(%rip),%xmm0 # 6a20 <_sk_callback_sse41+0xd2f>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,221,50,0,0 ; mulps 0x32dd(%rip),%xmm0 # 6b70 <_sk_callback_sse41+0xd7d>
- DB 102,15,111,13,229,50,0,0 ; movdqa 0x32e5(%rip),%xmm1 # 6b80 <_sk_callback_sse41+0xd8d>
+ DB 15,89,5,159,50,0,0 ; mulps 0x329f(%rip),%xmm0 # 6a30 <_sk_callback_sse41+0xd3f>
+ DB 102,15,111,13,167,50,0,0 ; movdqa 0x32a7(%rip),%xmm1 # 6a40 <_sk_callback_sse41+0xd4f>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,231,50,0,0 ; mulps 0x32e7(%rip),%xmm1 # 6b90 <_sk_callback_sse41+0xd9d>
- DB 102,15,219,21,239,50,0,0 ; pand 0x32ef(%rip),%xmm2 # 6ba0 <_sk_callback_sse41+0xdad>
+ DB 15,89,13,169,50,0,0 ; mulps 0x32a9(%rip),%xmm1 # 6a50 <_sk_callback_sse41+0xd5f>
+ DB 102,15,219,21,177,50,0,0 ; pand 0x32b1(%rip),%xmm2 # 6a60 <_sk_callback_sse41+0xd6f>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,245,50,0,0 ; mulps 0x32f5(%rip),%xmm2 # 6bb0 <_sk_callback_sse41+0xdbd>
+ DB 15,89,21,183,50,0,0 ; mulps 0x32b7(%rip),%xmm2 # 6a70 <_sk_callback_sse41+0xd7f>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,252,50,0,0 ; movaps 0x32fc(%rip),%xmm3 # 6bc0 <_sk_callback_sse41+0xdcd>
+ DB 15,40,29,190,50,0,0 ; movaps 0x32be(%rip),%xmm3 # 6a80 <_sk_callback_sse41+0xd8f>
DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
@@ -18094,12 +17808,12 @@ PUBLIC _sk_store_565_sse41
_sk_store_565_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,252,50,0,0 ; movaps 0x32fc(%rip),%xmm8 # 6bd0 <_sk_callback_sse41+0xddd>
+ DB 68,15,40,5,190,50,0,0 ; movaps 0x32be(%rip),%xmm8 # 6a90 <_sk_callback_sse41+0xd9f>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9
- DB 68,15,40,21,241,50,0,0 ; movaps 0x32f1(%rip),%xmm10 # 6be0 <_sk_callback_sse41+0xded>
+ DB 68,15,40,21,179,50,0,0 ; movaps 0x32b3(%rip),%xmm10 # 6aa0 <_sk_callback_sse41+0xdaf>
DB 68,15,89,209 ; mulps %xmm1,%xmm10
DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10
DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10
@@ -18109,7 +17823,7 @@ _sk_store_565_sse41 LABEL PROC
DB 102,69,15,86,194 ; orpd %xmm10,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3926 <_sk_store_565_sse41+0x5f>
+ DB 117,10 ; jne 3824 <_sk_store_565_sse41+0x5f>
DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -18117,105 +17831,105 @@ _sk_store_565_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,35 ; je 395c <_sk_store_565_sse41+0x95>
+ DB 116,35 ; je 385a <_sk_store_565_sse41+0x95>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,15 ; je 394e <_sk_store_565_sse41+0x87>
+ DB 116,15 ; je 384c <_sk_store_565_sse41+0x87>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,221 ; jne 3922 <_sk_store_565_sse41+0x5b>
+ DB 117,221 ; jne 3820 <_sk_store_565_sse41+0x5b>
DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
DB 242,69,15,112,192,232 ; pshuflw $0xe8,%xmm8,%xmm8
DB 102,68,15,126,4,80 ; movd %xmm8,(%rax,%rdx,2)
- DB 235,198 ; jmp 3922 <_sk_store_565_sse41+0x5b>
+ DB 235,198 ; jmp 3820 <_sk_store_565_sse41+0x5b>
DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2)
- DB 235,188 ; jmp 3922 <_sk_store_565_sse41+0x5b>
+ DB 235,188 ; jmp 3820 <_sk_store_565_sse41+0x5b>
PUBLIC _sk_load_4444_sse41
_sk_load_4444_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,95 ; jne 39cf <_sk_load_4444_sse41+0x69>
+ DB 117,95 ; jne 38cd <_sk_load_4444_sse41+0x69>
DB 102,65,15,56,51,28,82 ; pmovzxwd (%r10,%rdx,2),%xmm3
- DB 102,15,111,5,113,50,0,0 ; movdqa 0x3271(%rip),%xmm0 # 6bf0 <_sk_callback_sse41+0xdfd>
+ DB 102,15,111,5,51,50,0,0 ; movdqa 0x3233(%rip),%xmm0 # 6ab0 <_sk_callback_sse41+0xdbf>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,115,50,0,0 ; mulps 0x3273(%rip),%xmm0 # 6c00 <_sk_callback_sse41+0xe0d>
- DB 102,15,111,13,123,50,0,0 ; movdqa 0x327b(%rip),%xmm1 # 6c10 <_sk_callback_sse41+0xe1d>
+ DB 15,89,5,53,50,0,0 ; mulps 0x3235(%rip),%xmm0 # 6ac0 <_sk_callback_sse41+0xdcf>
+ DB 102,15,111,13,61,50,0,0 ; movdqa 0x323d(%rip),%xmm1 # 6ad0 <_sk_callback_sse41+0xddf>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,125,50,0,0 ; mulps 0x327d(%rip),%xmm1 # 6c20 <_sk_callback_sse41+0xe2d>
- DB 102,15,111,21,133,50,0,0 ; movdqa 0x3285(%rip),%xmm2 # 6c30 <_sk_callback_sse41+0xe3d>
+ DB 15,89,13,63,50,0,0 ; mulps 0x323f(%rip),%xmm1 # 6ae0 <_sk_callback_sse41+0xdef>
+ DB 102,15,111,21,71,50,0,0 ; movdqa 0x3247(%rip),%xmm2 # 6af0 <_sk_callback_sse41+0xdff>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,135,50,0,0 ; mulps 0x3287(%rip),%xmm2 # 6c40 <_sk_callback_sse41+0xe4d>
- DB 102,15,219,29,143,50,0,0 ; pand 0x328f(%rip),%xmm3 # 6c50 <_sk_callback_sse41+0xe5d>
+ DB 15,89,21,73,50,0,0 ; mulps 0x3249(%rip),%xmm2 # 6b00 <_sk_callback_sse41+0xe0f>
+ DB 102,15,219,29,81,50,0,0 ; pand 0x3251(%rip),%xmm3 # 6b10 <_sk_callback_sse41+0xe1f>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,149,50,0,0 ; mulps 0x3295(%rip),%xmm3 # 6c60 <_sk_callback_sse41+0xe6d>
+ DB 15,89,29,87,50,0,0 ; mulps 0x3257(%rip),%xmm3 # 6b20 <_sk_callback_sse41+0xe2f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,53 ; je 3a11 <_sk_load_4444_sse41+0xab>
+ DB 116,53 ; je 390f <_sk_load_4444_sse41+0xab>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 39fb <_sk_load_4444_sse41+0x95>
+ DB 116,21 ; je 38f9 <_sk_load_4444_sse41+0x95>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,139 ; jne 3977 <_sk_load_4444_sse41+0x11>
+ DB 117,139 ; jne 3875 <_sk_load_4444_sse41+0x11>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
DB 102,65,15,110,4,82 ; movd (%r10,%rdx,2),%xmm0
DB 102,15,56,51,192 ; pmovzxwd %xmm0,%xmm0
DB 102,15,58,14,216,15 ; pblendw $0xf,%xmm0,%xmm3
- DB 233,102,255,255,255 ; jmpq 3977 <_sk_load_4444_sse41+0x11>
+ DB 233,102,255,255,255 ; jmpq 3875 <_sk_load_4444_sse41+0x11>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,216 ; movd %eax,%xmm3
- DB 233,88,255,255,255 ; jmpq 3977 <_sk_load_4444_sse41+0x11>
+ DB 233,88,255,255,255 ; jmpq 3875 <_sk_load_4444_sse41+0x11>
PUBLIC _sk_load_4444_dst_sse41
_sk_load_4444_dst_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,95 ; jne 3a88 <_sk_load_4444_dst_sse41+0x69>
+ DB 117,95 ; jne 3986 <_sk_load_4444_dst_sse41+0x69>
DB 102,65,15,56,51,60,82 ; pmovzxwd (%r10,%rdx,2),%xmm7
- DB 102,15,111,37,56,50,0,0 ; movdqa 0x3238(%rip),%xmm4 # 6c70 <_sk_callback_sse41+0xe7d>
+ DB 102,15,111,37,250,49,0,0 ; movdqa 0x31fa(%rip),%xmm4 # 6b30 <_sk_callback_sse41+0xe3f>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,58,50,0,0 ; mulps 0x323a(%rip),%xmm4 # 6c80 <_sk_callback_sse41+0xe8d>
- DB 102,15,111,45,66,50,0,0 ; movdqa 0x3242(%rip),%xmm5 # 6c90 <_sk_callback_sse41+0xe9d>
+ DB 15,89,37,252,49,0,0 ; mulps 0x31fc(%rip),%xmm4 # 6b40 <_sk_callback_sse41+0xe4f>
+ DB 102,15,111,45,4,50,0,0 ; movdqa 0x3204(%rip),%xmm5 # 6b50 <_sk_callback_sse41+0xe5f>
DB 102,15,219,239 ; pand %xmm7,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,45,68,50,0,0 ; mulps 0x3244(%rip),%xmm5 # 6ca0 <_sk_callback_sse41+0xead>
- DB 102,15,111,53,76,50,0,0 ; movdqa 0x324c(%rip),%xmm6 # 6cb0 <_sk_callback_sse41+0xebd>
+ DB 15,89,45,6,50,0,0 ; mulps 0x3206(%rip),%xmm5 # 6b60 <_sk_callback_sse41+0xe6f>
+ DB 102,15,111,53,14,50,0,0 ; movdqa 0x320e(%rip),%xmm6 # 6b70 <_sk_callback_sse41+0xe7f>
DB 102,15,219,247 ; pand %xmm7,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,53,78,50,0,0 ; mulps 0x324e(%rip),%xmm6 # 6cc0 <_sk_callback_sse41+0xecd>
- DB 102,15,219,61,86,50,0,0 ; pand 0x3256(%rip),%xmm7 # 6cd0 <_sk_callback_sse41+0xedd>
+ DB 15,89,53,16,50,0,0 ; mulps 0x3210(%rip),%xmm6 # 6b80 <_sk_callback_sse41+0xe8f>
+ DB 102,15,219,61,24,50,0,0 ; pand 0x3218(%rip),%xmm7 # 6b90 <_sk_callback_sse41+0xe9f>
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 15,89,61,92,50,0,0 ; mulps 0x325c(%rip),%xmm7 # 6ce0 <_sk_callback_sse41+0xeed>
+ DB 15,89,61,30,50,0,0 ; mulps 0x321e(%rip),%xmm7 # 6ba0 <_sk_callback_sse41+0xeaf>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,53 ; je 3aca <_sk_load_4444_dst_sse41+0xab>
+ DB 116,53 ; je 39c8 <_sk_load_4444_dst_sse41+0xab>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 3ab4 <_sk_load_4444_dst_sse41+0x95>
+ DB 116,21 ; je 39b2 <_sk_load_4444_dst_sse41+0x95>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,139 ; jne 3a30 <_sk_load_4444_dst_sse41+0x11>
+ DB 117,139 ; jne 392e <_sk_load_4444_dst_sse41+0x11>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,224 ; movd %eax,%xmm4
DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7
DB 102,65,15,110,36,82 ; movd (%r10,%rdx,2),%xmm4
DB 102,15,56,51,228 ; pmovzxwd %xmm4,%xmm4
DB 102,15,58,14,252,15 ; pblendw $0xf,%xmm4,%xmm7
- DB 233,102,255,255,255 ; jmpq 3a30 <_sk_load_4444_dst_sse41+0x11>
+ DB 233,102,255,255,255 ; jmpq 392e <_sk_load_4444_dst_sse41+0x11>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,248 ; movd %eax,%xmm7
- DB 233,88,255,255,255 ; jmpq 3a30 <_sk_load_4444_dst_sse41+0x11>
+ DB 233,88,255,255,255 ; jmpq 392e <_sk_load_4444_dst_sse41+0x11>
PUBLIC _sk_gather_4444_sse41
_sk_gather_4444_sse41 LABEL PROC
@@ -18223,7 +17937,7 @@ _sk_gather_4444_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -18241,21 +17955,21 @@ _sk_gather_4444_sse41 LABEL PROC
DB 65,15,183,4,65 ; movzwl (%r9,%rax,2),%eax
DB 102,15,196,192,3 ; pinsrw $0x3,%eax,%xmm0
DB 102,15,56,51,216 ; pmovzxwd %xmm0,%xmm3
- DB 102,15,111,5,174,49,0,0 ; movdqa 0x31ae(%rip),%xmm0 # 6cf0 <_sk_callback_sse41+0xefd>
+ DB 102,15,111,5,112,49,0,0 ; movdqa 0x3170(%rip),%xmm0 # 6bb0 <_sk_callback_sse41+0xebf>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,176,49,0,0 ; mulps 0x31b0(%rip),%xmm0 # 6d00 <_sk_callback_sse41+0xf0d>
- DB 102,15,111,13,184,49,0,0 ; movdqa 0x31b8(%rip),%xmm1 # 6d10 <_sk_callback_sse41+0xf1d>
+ DB 15,89,5,114,49,0,0 ; mulps 0x3172(%rip),%xmm0 # 6bc0 <_sk_callback_sse41+0xecf>
+ DB 102,15,111,13,122,49,0,0 ; movdqa 0x317a(%rip),%xmm1 # 6bd0 <_sk_callback_sse41+0xedf>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,186,49,0,0 ; mulps 0x31ba(%rip),%xmm1 # 6d20 <_sk_callback_sse41+0xf2d>
- DB 102,15,111,21,194,49,0,0 ; movdqa 0x31c2(%rip),%xmm2 # 6d30 <_sk_callback_sse41+0xf3d>
+ DB 15,89,13,124,49,0,0 ; mulps 0x317c(%rip),%xmm1 # 6be0 <_sk_callback_sse41+0xeef>
+ DB 102,15,111,21,132,49,0,0 ; movdqa 0x3184(%rip),%xmm2 # 6bf0 <_sk_callback_sse41+0xeff>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,196,49,0,0 ; mulps 0x31c4(%rip),%xmm2 # 6d40 <_sk_callback_sse41+0xf4d>
- DB 102,15,219,29,204,49,0,0 ; pand 0x31cc(%rip),%xmm3 # 6d50 <_sk_callback_sse41+0xf5d>
+ DB 15,89,21,134,49,0,0 ; mulps 0x3186(%rip),%xmm2 # 6c00 <_sk_callback_sse41+0xf0f>
+ DB 102,15,219,29,142,49,0,0 ; pand 0x318e(%rip),%xmm3 # 6c10 <_sk_callback_sse41+0xf1f>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,210,49,0,0 ; mulps 0x31d2(%rip),%xmm3 # 6d60 <_sk_callback_sse41+0xf6d>
+ DB 15,89,29,148,49,0,0 ; mulps 0x3194(%rip),%xmm3 # 6c20 <_sk_callback_sse41+0xf2f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
@@ -18264,7 +17978,7 @@ PUBLIC _sk_store_4444_sse41
_sk_store_4444_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,208,49,0,0 ; movaps 0x31d0(%rip),%xmm8 # 6d70 <_sk_callback_sse41+0xf7d>
+ DB 68,15,40,5,146,49,0,0 ; movaps 0x3192(%rip),%xmm8 # 6c30 <_sk_callback_sse41+0xf3f>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -18284,7 +17998,7 @@ _sk_store_4444_sse41 LABEL PROC
DB 102,69,15,86,194 ; orpd %xmm10,%xmm8
DB 102,69,15,56,43,192 ; packusdw %xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3c06 <_sk_store_4444_sse41+0x73>
+ DB 117,10 ; jne 3b04 <_sk_store_4444_sse41+0x73>
DB 242,68,15,17,4,80 ; movsd %xmm8,(%rax,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -18292,36 +18006,36 @@ _sk_store_4444_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,35 ; je 3c3c <_sk_store_4444_sse41+0xa9>
+ DB 116,35 ; je 3b3a <_sk_store_4444_sse41+0xa9>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,15 ; je 3c2e <_sk_store_4444_sse41+0x9b>
+ DB 116,15 ; je 3b2c <_sk_store_4444_sse41+0x9b>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,221 ; jne 3c02 <_sk_store_4444_sse41+0x6f>
+ DB 117,221 ; jne 3b00 <_sk_store_4444_sse41+0x6f>
DB 102,68,15,58,21,68,80,4,4 ; pextrw $0x4,%xmm8,0x4(%rax,%rdx,2)
DB 242,69,15,112,192,232 ; pshuflw $0xe8,%xmm8,%xmm8
DB 102,68,15,126,4,80 ; movd %xmm8,(%rax,%rdx,2)
- DB 235,198 ; jmp 3c02 <_sk_store_4444_sse41+0x6f>
+ DB 235,198 ; jmp 3b00 <_sk_store_4444_sse41+0x6f>
DB 102,68,15,58,21,4,80,0 ; pextrw $0x0,%xmm8,(%rax,%rdx,2)
- DB 235,188 ; jmp 3c02 <_sk_store_4444_sse41+0x6f>
+ DB 235,188 ; jmp 3b00 <_sk_store_4444_sse41+0x6f>
PUBLIC _sk_load_8888_sse41
_sk_load_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3ca8 <_sk_load_8888_sse41+0x62>
+ DB 117,88 ; jne 3ba6 <_sk_load_8888_sse41+0x62>
DB 243,15,111,28,144 ; movdqu (%rax,%rdx,4),%xmm3
- DB 102,15,111,5,35,49,0,0 ; movdqa 0x3123(%rip),%xmm0 # 6d80 <_sk_callback_sse41+0xf8d>
+ DB 102,15,111,5,229,48,0,0 ; movdqa 0x30e5(%rip),%xmm0 # 6c40 <_sk_callback_sse41+0xf4f>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,36,49,0,0 ; movaps 0x3124(%rip),%xmm8 # 6d90 <_sk_callback_sse41+0xf9d>
+ DB 68,15,40,5,230,48,0,0 ; movaps 0x30e6(%rip),%xmm8 # 6c50 <_sk_callback_sse41+0xf5f>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,35,49,0,0 ; pshufb 0x3123(%rip),%xmm1 # 6da0 <_sk_callback_sse41+0xfad>
+ DB 102,15,56,0,13,229,48,0,0 ; pshufb 0x30e5(%rip),%xmm1 # 6c60 <_sk_callback_sse41+0xf6f>
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,31,49,0,0 ; pshufb 0x311f(%rip),%xmm2 # 6db0 <_sk_callback_sse41+0xfbd>
+ DB 102,15,56,0,21,225,48,0,0 ; pshufb 0x30e1(%rip),%xmm2 # 6c70 <_sk_callback_sse41+0xf7f>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -18332,38 +18046,38 @@ _sk_load_8888_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,43 ; je 3ce0 <_sk_load_8888_sse41+0x9a>
+ DB 116,43 ; je 3bde <_sk_load_8888_sse41+0x9a>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,17 ; je 3cd0 <_sk_load_8888_sse41+0x8a>
+ DB 116,17 ; je 3bce <_sk_load_8888_sse41+0x8a>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,144 ; jne 3c55 <_sk_load_8888_sse41+0xf>
+ DB 117,144 ; jne 3b53 <_sk_load_8888_sse41+0xf>
DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
DB 243,15,126,4,144 ; movq (%rax,%rdx,4),%xmm0
DB 102,15,58,14,216,15 ; pblendw $0xf,%xmm0,%xmm3
- DB 233,117,255,255,255 ; jmpq 3c55 <_sk_load_8888_sse41+0xf>
+ DB 233,117,255,255,255 ; jmpq 3b53 <_sk_load_8888_sse41+0xf>
DB 102,15,110,28,144 ; movd (%rax,%rdx,4),%xmm3
- DB 233,107,255,255,255 ; jmpq 3c55 <_sk_load_8888_sse41+0xf>
+ DB 233,107,255,255,255 ; jmpq 3b53 <_sk_load_8888_sse41+0xf>
PUBLIC _sk_load_8888_dst_sse41
_sk_load_8888_dst_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3d4c <_sk_load_8888_dst_sse41+0x62>
+ DB 117,88 ; jne 3c4a <_sk_load_8888_dst_sse41+0x62>
DB 243,15,111,60,144 ; movdqu (%rax,%rdx,4),%xmm7
- DB 102,15,111,37,191,48,0,0 ; movdqa 0x30bf(%rip),%xmm4 # 6dc0 <_sk_callback_sse41+0xfcd>
+ DB 102,15,111,37,129,48,0,0 ; movdqa 0x3081(%rip),%xmm4 # 6c80 <_sk_callback_sse41+0xf8f>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 68,15,40,5,192,48,0,0 ; movaps 0x30c0(%rip),%xmm8 # 6dd0 <_sk_callback_sse41+0xfdd>
+ DB 68,15,40,5,130,48,0,0 ; movaps 0x3082(%rip),%xmm8 # 6c90 <_sk_callback_sse41+0xf9f>
DB 65,15,89,224 ; mulps %xmm8,%xmm4
DB 102,15,111,239 ; movdqa %xmm7,%xmm5
- DB 102,15,56,0,45,191,48,0,0 ; pshufb 0x30bf(%rip),%xmm5 # 6de0 <_sk_callback_sse41+0xfed>
+ DB 102,15,56,0,45,129,48,0,0 ; pshufb 0x3081(%rip),%xmm5 # 6ca0 <_sk_callback_sse41+0xfaf>
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
DB 65,15,89,232 ; mulps %xmm8,%xmm5
DB 102,15,111,247 ; movdqa %xmm7,%xmm6
- DB 102,15,56,0,53,187,48,0,0 ; pshufb 0x30bb(%rip),%xmm6 # 6df0 <_sk_callback_sse41+0xffd>
+ DB 102,15,56,0,53,125,48,0,0 ; pshufb 0x307d(%rip),%xmm6 # 6cb0 <_sk_callback_sse41+0xfbf>
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 65,15,89,240 ; mulps %xmm8,%xmm6
DB 102,15,114,215,24 ; psrld $0x18,%xmm7
@@ -18374,19 +18088,19 @@ _sk_load_8888_dst_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,43 ; je 3d84 <_sk_load_8888_dst_sse41+0x9a>
+ DB 116,43 ; je 3c82 <_sk_load_8888_dst_sse41+0x9a>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,17 ; je 3d74 <_sk_load_8888_dst_sse41+0x8a>
+ DB 116,17 ; je 3c72 <_sk_load_8888_dst_sse41+0x8a>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,144 ; jne 3cf9 <_sk_load_8888_dst_sse41+0xf>
+ DB 117,144 ; jne 3bf7 <_sk_load_8888_dst_sse41+0xf>
DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7
DB 243,15,126,36,144 ; movq (%rax,%rdx,4),%xmm4
DB 102,15,58,14,252,15 ; pblendw $0xf,%xmm4,%xmm7
- DB 233,117,255,255,255 ; jmpq 3cf9 <_sk_load_8888_dst_sse41+0xf>
+ DB 233,117,255,255,255 ; jmpq 3bf7 <_sk_load_8888_dst_sse41+0xf>
DB 102,15,110,60,144 ; movd (%rax,%rdx,4),%xmm7
- DB 233,107,255,255,255 ; jmpq 3cf9 <_sk_load_8888_dst_sse41+0xf>
+ DB 233,107,255,255,255 ; jmpq 3bf7 <_sk_load_8888_dst_sse41+0xf>
PUBLIC _sk_gather_8888_sse41
_sk_gather_8888_sse41 LABEL PROC
@@ -18394,7 +18108,7 @@ _sk_gather_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -18409,17 +18123,17 @@ _sk_gather_8888_sse41 LABEL PROC
DB 102,65,15,58,34,28,129,1 ; pinsrd $0x1,(%r9,%rax,4),%xmm3
DB 102,65,15,58,34,28,153,2 ; pinsrd $0x2,(%r9,%rbx,4),%xmm3
DB 102,67,15,58,34,28,153,3 ; pinsrd $0x3,(%r9,%r11,4),%xmm3
- DB 102,15,111,5,17,48,0,0 ; movdqa 0x3011(%rip),%xmm0 # 6e00 <_sk_callback_sse41+0x100d>
+ DB 102,15,111,5,211,47,0,0 ; movdqa 0x2fd3(%rip),%xmm0 # 6cc0 <_sk_callback_sse41+0xfcf>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,18,48,0,0 ; movaps 0x3012(%rip),%xmm8 # 6e10 <_sk_callback_sse41+0x101d>
+ DB 68,15,40,5,212,47,0,0 ; movaps 0x2fd4(%rip),%xmm8 # 6cd0 <_sk_callback_sse41+0xfdf>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
- DB 102,15,56,0,13,17,48,0,0 ; pshufb 0x3011(%rip),%xmm1 # 6e20 <_sk_callback_sse41+0x102d>
+ DB 102,15,56,0,13,211,47,0,0 ; pshufb 0x2fd3(%rip),%xmm1 # 6ce0 <_sk_callback_sse41+0xfef>
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,211 ; movdqa %xmm3,%xmm2
- DB 102,15,56,0,21,13,48,0,0 ; pshufb 0x300d(%rip),%xmm2 # 6e30 <_sk_callback_sse41+0x103d>
+ DB 102,15,56,0,21,207,47,0,0 ; pshufb 0x2fcf(%rip),%xmm2 # 6cf0 <_sk_callback_sse41+0xfff>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -18433,7 +18147,7 @@ PUBLIC _sk_store_8888_sse41
_sk_store_8888_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,248,47,0,0 ; movaps 0x2ff8(%rip),%xmm8 # 6e40 <_sk_callback_sse41+0x104d>
+ DB 68,15,40,5,186,47,0,0 ; movaps 0x2fba(%rip),%xmm8 # 6d00 <_sk_callback_sse41+0x100f>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -18452,32 +18166,32 @@ _sk_store_8888_sse41 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3ea8 <_sk_store_8888_sse41+0x6d>
+ DB 117,10 ; jne 3da6 <_sk_store_8888_sse41+0x6d>
DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,29 ; je 3ed2 <_sk_store_8888_sse41+0x97>
+ DB 116,29 ; je 3dd0 <_sk_store_8888_sse41+0x97>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,15 ; je 3eca <_sk_store_8888_sse41+0x8f>
+ DB 116,15 ; je 3dc8 <_sk_store_8888_sse41+0x8f>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,227 ; jne 3ea4 <_sk_store_8888_sse41+0x69>
+ DB 117,227 ; jne 3da2 <_sk_store_8888_sse41+0x69>
DB 102,68,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
DB 102,68,15,214,4,144 ; movq %xmm8,(%rax,%rdx,4)
- DB 235,210 ; jmp 3ea4 <_sk_store_8888_sse41+0x69>
+ DB 235,210 ; jmp 3da2 <_sk_store_8888_sse41+0x69>
DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
- DB 235,202 ; jmp 3ea4 <_sk_store_8888_sse41+0x69>
+ DB 235,202 ; jmp 3da2 <_sk_store_8888_sse41+0x69>
PUBLIC _sk_store_8888_2d_sse41
_sk_store_8888_2d_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 76,99,72,8 ; movslq 0x8(%rax),%r9
DB 76,15,175,201 ; imul %rcx,%r9
DB 73,193,225,2 ; shl $0x2,%r9
DB 76,3,8 ; add (%rax),%r9
- DB 68,15,40,5,93,47,0,0 ; movaps 0x2f5d(%rip),%xmm8 # 6e50 <_sk_callback_sse41+0x105d>
+ DB 68,15,40,5,31,47,0,0 ; movaps 0x2f1f(%rip),%xmm8 # 6d10 <_sk_callback_sse41+0x101f>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -18496,42 +18210,42 @@ _sk_store_8888_2d_sse41 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3f53 <_sk_store_8888_2d_sse41+0x79>
+ DB 117,10 ; jne 3e51 <_sk_store_8888_2d_sse41+0x79>
DB 243,69,15,127,4,145 ; movdqu %xmm8,(%r9,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 68,137,192 ; mov %r8d,%eax
DB 36,3 ; and $0x3,%al
DB 60,1 ; cmp $0x1,%al
- DB 116,25 ; je 3f75 <_sk_store_8888_2d_sse41+0x9b>
+ DB 116,25 ; je 3e73 <_sk_store_8888_2d_sse41+0x9b>
DB 60,2 ; cmp $0x2,%al
- DB 116,13 ; je 3f6d <_sk_store_8888_2d_sse41+0x93>
+ DB 116,13 ; je 3e6b <_sk_store_8888_2d_sse41+0x93>
DB 60,3 ; cmp $0x3,%al
- DB 117,235 ; jne 3f4f <_sk_store_8888_2d_sse41+0x75>
+ DB 117,235 ; jne 3e4d <_sk_store_8888_2d_sse41+0x75>
DB 102,69,15,58,22,68,145,8,2 ; pextrd $0x2,%xmm8,0x8(%r9,%rdx,4)
DB 102,69,15,214,4,145 ; movq %xmm8,(%r9,%rdx,4)
- DB 235,218 ; jmp 3f4f <_sk_store_8888_2d_sse41+0x75>
+ DB 235,218 ; jmp 3e4d <_sk_store_8888_2d_sse41+0x75>
DB 102,69,15,126,4,145 ; movd %xmm8,(%r9,%rdx,4)
- DB 235,210 ; jmp 3f4f <_sk_store_8888_2d_sse41+0x75>
+ DB 235,210 ; jmp 3e4d <_sk_store_8888_2d_sse41+0x75>
PUBLIC _sk_load_bgra_sse41
_sk_load_bgra_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 3fdf <_sk_load_bgra_sse41+0x62>
+ DB 117,88 ; jne 3edd <_sk_load_bgra_sse41+0x62>
DB 243,15,111,28,144 ; movdqu (%rax,%rdx,4),%xmm3
- DB 102,15,111,5,204,46,0,0 ; movdqa 0x2ecc(%rip),%xmm0 # 6e60 <_sk_callback_sse41+0x106d>
+ DB 102,15,111,5,142,46,0,0 ; movdqa 0x2e8e(%rip),%xmm0 # 6d20 <_sk_callback_sse41+0x102f>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,208 ; cvtdq2ps %xmm0,%xmm2
- DB 68,15,40,5,205,46,0,0 ; movaps 0x2ecd(%rip),%xmm8 # 6e70 <_sk_callback_sse41+0x107d>
+ DB 68,15,40,5,143,46,0,0 ; movaps 0x2e8f(%rip),%xmm8 # 6d30 <_sk_callback_sse41+0x103f>
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
- DB 102,15,56,0,5,204,46,0,0 ; pshufb 0x2ecc(%rip),%xmm0 # 6e80 <_sk_callback_sse41+0x108d>
+ DB 102,15,56,0,5,142,46,0,0 ; pshufb 0x2e8e(%rip),%xmm0 # 6d40 <_sk_callback_sse41+0x104f>
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
- DB 102,15,56,0,5,200,46,0,0 ; pshufb 0x2ec8(%rip),%xmm0 # 6e90 <_sk_callback_sse41+0x109d>
+ DB 102,15,56,0,5,138,46,0,0 ; pshufb 0x2e8a(%rip),%xmm0 # 6d50 <_sk_callback_sse41+0x105f>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -18542,38 +18256,38 @@ _sk_load_bgra_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,43 ; je 4017 <_sk_load_bgra_sse41+0x9a>
+ DB 116,43 ; je 3f15 <_sk_load_bgra_sse41+0x9a>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,17 ; je 4007 <_sk_load_bgra_sse41+0x8a>
+ DB 116,17 ; je 3f05 <_sk_load_bgra_sse41+0x8a>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,144 ; jne 3f8c <_sk_load_bgra_sse41+0xf>
+ DB 117,144 ; jne 3e8a <_sk_load_bgra_sse41+0xf>
DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
DB 243,15,126,4,144 ; movq (%rax,%rdx,4),%xmm0
DB 102,15,58,14,216,15 ; pblendw $0xf,%xmm0,%xmm3
- DB 233,117,255,255,255 ; jmpq 3f8c <_sk_load_bgra_sse41+0xf>
+ DB 233,117,255,255,255 ; jmpq 3e8a <_sk_load_bgra_sse41+0xf>
DB 102,15,110,28,144 ; movd (%rax,%rdx,4),%xmm3
- DB 233,107,255,255,255 ; jmpq 3f8c <_sk_load_bgra_sse41+0xf>
+ DB 233,107,255,255,255 ; jmpq 3e8a <_sk_load_bgra_sse41+0xf>
PUBLIC _sk_load_bgra_dst_sse41
_sk_load_bgra_dst_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,88 ; jne 4083 <_sk_load_bgra_dst_sse41+0x62>
+ DB 117,88 ; jne 3f81 <_sk_load_bgra_dst_sse41+0x62>
DB 243,15,111,60,144 ; movdqu (%rax,%rdx,4),%xmm7
- DB 102,15,111,37,104,46,0,0 ; movdqa 0x2e68(%rip),%xmm4 # 6ea0 <_sk_callback_sse41+0x10ad>
+ DB 102,15,111,37,42,46,0,0 ; movdqa 0x2e2a(%rip),%xmm4 # 6d60 <_sk_callback_sse41+0x106f>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,244 ; cvtdq2ps %xmm4,%xmm6
- DB 68,15,40,5,105,46,0,0 ; movaps 0x2e69(%rip),%xmm8 # 6eb0 <_sk_callback_sse41+0x10bd>
+ DB 68,15,40,5,43,46,0,0 ; movaps 0x2e2b(%rip),%xmm8 # 6d70 <_sk_callback_sse41+0x107f>
DB 65,15,89,240 ; mulps %xmm8,%xmm6
DB 102,15,111,231 ; movdqa %xmm7,%xmm4
- DB 102,15,56,0,37,104,46,0,0 ; pshufb 0x2e68(%rip),%xmm4 # 6ec0 <_sk_callback_sse41+0x10cd>
+ DB 102,15,56,0,37,42,46,0,0 ; pshufb 0x2e2a(%rip),%xmm4 # 6d80 <_sk_callback_sse41+0x108f>
DB 15,91,236 ; cvtdq2ps %xmm4,%xmm5
DB 65,15,89,232 ; mulps %xmm8,%xmm5
DB 102,15,111,231 ; movdqa %xmm7,%xmm4
- DB 102,15,56,0,37,100,46,0,0 ; pshufb 0x2e64(%rip),%xmm4 # 6ed0 <_sk_callback_sse41+0x10dd>
+ DB 102,15,56,0,37,38,46,0,0 ; pshufb 0x2e26(%rip),%xmm4 # 6d90 <_sk_callback_sse41+0x109f>
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
DB 65,15,89,224 ; mulps %xmm8,%xmm4
DB 102,15,114,215,24 ; psrld $0x18,%xmm7
@@ -18584,19 +18298,19 @@ _sk_load_bgra_dst_sse41 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,43 ; je 40bb <_sk_load_bgra_dst_sse41+0x9a>
+ DB 116,43 ; je 3fb9 <_sk_load_bgra_dst_sse41+0x9a>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,17 ; je 40ab <_sk_load_bgra_dst_sse41+0x8a>
+ DB 116,17 ; je 3fa9 <_sk_load_bgra_dst_sse41+0x8a>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,144 ; jne 4030 <_sk_load_bgra_dst_sse41+0xf>
+ DB 117,144 ; jne 3f2e <_sk_load_bgra_dst_sse41+0xf>
DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7
DB 243,15,126,36,144 ; movq (%rax,%rdx,4),%xmm4
DB 102,15,58,14,252,15 ; pblendw $0xf,%xmm4,%xmm7
- DB 233,117,255,255,255 ; jmpq 4030 <_sk_load_bgra_dst_sse41+0xf>
+ DB 233,117,255,255,255 ; jmpq 3f2e <_sk_load_bgra_dst_sse41+0xf>
DB 102,15,110,60,144 ; movd (%rax,%rdx,4),%xmm7
- DB 233,107,255,255,255 ; jmpq 4030 <_sk_load_bgra_dst_sse41+0xf>
+ DB 233,107,255,255,255 ; jmpq 3f2e <_sk_load_bgra_dst_sse41+0xf>
PUBLIC _sk_gather_bgra_sse41
_sk_gather_bgra_sse41 LABEL PROC
@@ -18604,7 +18318,7 @@ _sk_gather_bgra_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -18619,17 +18333,17 @@ _sk_gather_bgra_sse41 LABEL PROC
DB 102,65,15,58,34,28,129,1 ; pinsrd $0x1,(%r9,%rax,4),%xmm3
DB 102,65,15,58,34,28,153,2 ; pinsrd $0x2,(%r9,%rbx,4),%xmm3
DB 102,67,15,58,34,28,153,3 ; pinsrd $0x3,(%r9,%r11,4),%xmm3
- DB 102,15,111,5,186,45,0,0 ; movdqa 0x2dba(%rip),%xmm0 # 6ee0 <_sk_callback_sse41+0x10ed>
+ DB 102,15,111,5,124,45,0,0 ; movdqa 0x2d7c(%rip),%xmm0 # 6da0 <_sk_callback_sse41+0x10af>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,208 ; cvtdq2ps %xmm0,%xmm2
- DB 68,15,40,5,187,45,0,0 ; movaps 0x2dbb(%rip),%xmm8 # 6ef0 <_sk_callback_sse41+0x10fd>
+ DB 68,15,40,5,125,45,0,0 ; movaps 0x2d7d(%rip),%xmm8 # 6db0 <_sk_callback_sse41+0x10bf>
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
- DB 102,15,56,0,5,186,45,0,0 ; pshufb 0x2dba(%rip),%xmm0 # 6f00 <_sk_callback_sse41+0x110d>
+ DB 102,15,56,0,5,124,45,0,0 ; pshufb 0x2d7c(%rip),%xmm0 # 6dc0 <_sk_callback_sse41+0x10cf>
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
- DB 102,15,56,0,5,182,45,0,0 ; pshufb 0x2db6(%rip),%xmm0 # 6f10 <_sk_callback_sse41+0x111d>
+ DB 102,15,56,0,5,120,45,0,0 ; pshufb 0x2d78(%rip),%xmm0 # 6dd0 <_sk_callback_sse41+0x10df>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
@@ -18643,7 +18357,7 @@ PUBLIC _sk_store_bgra_sse41
_sk_store_bgra_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,161,45,0,0 ; movaps 0x2da1(%rip),%xmm8 # 6f20 <_sk_callback_sse41+0x112d>
+ DB 68,15,40,5,99,45,0,0 ; movaps 0x2d63(%rip),%xmm8 # 6de0 <_sk_callback_sse41+0x10ef>
DB 68,15,40,202 ; movaps %xmm2,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -18662,30 +18376,30 @@ _sk_store_bgra_sse41 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 41df <_sk_store_bgra_sse41+0x6d>
+ DB 117,10 ; jne 40dd <_sk_store_bgra_sse41+0x6d>
DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,29 ; je 4209 <_sk_store_bgra_sse41+0x97>
+ DB 116,29 ; je 4107 <_sk_store_bgra_sse41+0x97>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,15 ; je 4201 <_sk_store_bgra_sse41+0x8f>
+ DB 116,15 ; je 40ff <_sk_store_bgra_sse41+0x8f>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,227 ; jne 41db <_sk_store_bgra_sse41+0x69>
+ DB 117,227 ; jne 40d9 <_sk_store_bgra_sse41+0x69>
DB 102,68,15,58,22,68,144,8,2 ; pextrd $0x2,%xmm8,0x8(%rax,%rdx,4)
DB 102,68,15,214,4,144 ; movq %xmm8,(%rax,%rdx,4)
- DB 235,210 ; jmp 41db <_sk_store_bgra_sse41+0x69>
+ DB 235,210 ; jmp 40d9 <_sk_store_bgra_sse41+0x69>
DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
- DB 235,202 ; jmp 41db <_sk_store_bgra_sse41+0x69>
+ DB 235,202 ; jmp 40d9 <_sk_store_bgra_sse41+0x69>
PUBLIC _sk_load_f16_sse41
_sk_load_f16_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,60,1,0,0 ; jne 435b <_sk_load_f16_sse41+0x14a>
+ DB 15,133,60,1,0,0 ; jne 4259 <_sk_load_f16_sse41+0x14a>
DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0
DB 243,15,111,76,208,16 ; movdqu 0x10(%rax,%rdx,8),%xmm1
DB 102,68,15,40,200 ; movapd %xmm0,%xmm9
@@ -18695,18 +18409,18 @@ _sk_load_f16_sse41 LABEL PROC
DB 102,68,15,97,216 ; punpcklwd %xmm0,%xmm11
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1
- DB 102,68,15,111,5,218,44,0,0 ; movdqa 0x2cda(%rip),%xmm8 # 6f30 <_sk_callback_sse41+0x113d>
+ DB 102,68,15,111,5,156,44,0,0 ; movdqa 0x2c9c(%rip),%xmm8 # 6df0 <_sk_callback_sse41+0x10ff>
DB 102,15,111,209 ; movdqa %xmm1,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,239,202 ; pxor %xmm2,%xmm1
- DB 102,15,111,29,213,44,0,0 ; movdqa 0x2cd5(%rip),%xmm3 # 6f40 <_sk_callback_sse41+0x114d>
+ DB 102,15,111,29,151,44,0,0 ; movdqa 0x2c97(%rip),%xmm3 # 6e00 <_sk_callback_sse41+0x110f>
DB 102,15,114,242,16 ; pslld $0x10,%xmm2
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0
DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0
DB 102,15,114,241,13 ; pslld $0xd,%xmm1
DB 102,15,235,202 ; por %xmm2,%xmm1
- DB 102,68,15,111,21,193,44,0,0 ; movdqa 0x2cc1(%rip),%xmm10 # 6f50 <_sk_callback_sse41+0x115d>
+ DB 102,68,15,111,21,131,44,0,0 ; movdqa 0x2c83(%rip),%xmm10 # 6e10 <_sk_callback_sse41+0x111f>
DB 102,65,15,254,202 ; paddd %xmm10,%xmm1
DB 102,15,219,193 ; pand %xmm1,%xmm0
DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11
@@ -18749,23 +18463,23 @@ _sk_load_f16_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,13 ; jne 4373 <_sk_load_f16_sse41+0x162>
+ DB 117,13 ; jne 4271 <_sk_load_f16_sse41+0x162>
DB 243,15,126,192 ; movq %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,183,254,255,255 ; jmpq 422a <_sk_load_f16_sse41+0x19>
+ DB 233,183,254,255,255 ; jmpq 4128 <_sk_load_f16_sse41+0x19>
DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,163,254,255,255 ; jb 422a <_sk_load_f16_sse41+0x19>
+ DB 15,130,163,254,255,255 ; jb 4128 <_sk_load_f16_sse41+0x19>
DB 243,15,126,76,208,16 ; movq 0x10(%rax,%rdx,8),%xmm1
- DB 233,152,254,255,255 ; jmpq 422a <_sk_load_f16_sse41+0x19>
+ DB 233,152,254,255,255 ; jmpq 4128 <_sk_load_f16_sse41+0x19>
PUBLIC _sk_load_f16_dst_sse41
_sk_load_f16_dst_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,60,1,0,0 ; jne 44dc <_sk_load_f16_dst_sse41+0x14a>
+ DB 15,133,60,1,0,0 ; jne 43da <_sk_load_f16_dst_sse41+0x14a>
DB 102,15,16,36,208 ; movupd (%rax,%rdx,8),%xmm4
DB 243,15,111,108,208,16 ; movdqu 0x10(%rax,%rdx,8),%xmm5
DB 102,68,15,40,204 ; movapd %xmm4,%xmm9
@@ -18775,18 +18489,18 @@ _sk_load_f16_dst_sse41 LABEL PROC
DB 102,68,15,97,220 ; punpcklwd %xmm4,%xmm11
DB 102,68,15,105,204 ; punpckhwd %xmm4,%xmm9
DB 102,65,15,56,51,235 ; pmovzxwd %xmm11,%xmm5
- DB 102,68,15,111,5,137,43,0,0 ; movdqa 0x2b89(%rip),%xmm8 # 6f60 <_sk_callback_sse41+0x116d>
+ DB 102,68,15,111,5,75,43,0,0 ; movdqa 0x2b4b(%rip),%xmm8 # 6e20 <_sk_callback_sse41+0x112f>
DB 102,15,111,245 ; movdqa %xmm5,%xmm6
DB 102,65,15,219,240 ; pand %xmm8,%xmm6
DB 102,15,239,238 ; pxor %xmm6,%xmm5
- DB 102,15,111,61,132,43,0,0 ; movdqa 0x2b84(%rip),%xmm7 # 6f70 <_sk_callback_sse41+0x117d>
+ DB 102,15,111,61,70,43,0,0 ; movdqa 0x2b46(%rip),%xmm7 # 6e30 <_sk_callback_sse41+0x113f>
DB 102,15,114,246,16 ; pslld $0x10,%xmm6
DB 102,15,111,229 ; movdqa %xmm5,%xmm4
DB 102,15,56,63,231 ; pmaxud %xmm7,%xmm4
DB 102,15,118,229 ; pcmpeqd %xmm5,%xmm4
DB 102,15,114,245,13 ; pslld $0xd,%xmm5
DB 102,15,235,238 ; por %xmm6,%xmm5
- DB 102,68,15,111,21,112,43,0,0 ; movdqa 0x2b70(%rip),%xmm10 # 6f80 <_sk_callback_sse41+0x118d>
+ DB 102,68,15,111,21,50,43,0,0 ; movdqa 0x2b32(%rip),%xmm10 # 6e40 <_sk_callback_sse41+0x114f>
DB 102,65,15,254,234 ; paddd %xmm10,%xmm5
DB 102,15,219,229 ; pand %xmm5,%xmm4
DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11
@@ -18829,16 +18543,16 @@ _sk_load_f16_dst_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,15,16,36,208 ; movsd (%rax,%rdx,8),%xmm4
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,13 ; jne 44f4 <_sk_load_f16_dst_sse41+0x162>
+ DB 117,13 ; jne 43f2 <_sk_load_f16_dst_sse41+0x162>
DB 243,15,126,228 ; movq %xmm4,%xmm4
DB 102,15,239,237 ; pxor %xmm5,%xmm5
- DB 233,183,254,255,255 ; jmpq 43ab <_sk_load_f16_dst_sse41+0x19>
+ DB 233,183,254,255,255 ; jmpq 42a9 <_sk_load_f16_dst_sse41+0x19>
DB 102,15,22,100,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm4
DB 102,15,239,237 ; pxor %xmm5,%xmm5
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,163,254,255,255 ; jb 43ab <_sk_load_f16_dst_sse41+0x19>
+ DB 15,130,163,254,255,255 ; jb 42a9 <_sk_load_f16_dst_sse41+0x19>
DB 243,15,126,108,208,16 ; movq 0x10(%rax,%rdx,8),%xmm5
- DB 233,152,254,255,255 ; jmpq 43ab <_sk_load_f16_dst_sse41+0x19>
+ DB 233,152,254,255,255 ; jmpq 42a9 <_sk_load_f16_dst_sse41+0x19>
PUBLIC _sk_gather_f16_sse41
_sk_gather_f16_sse41 LABEL PROC
@@ -18846,7 +18560,7 @@ _sk_gather_f16_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,56,64,209 ; pmulld %xmm1,%xmm2
DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
@@ -18870,18 +18584,18 @@ _sk_gather_f16_sse41 LABEL PROC
DB 102,68,15,97,218 ; punpcklwd %xmm2,%xmm11
DB 102,68,15,105,202 ; punpckhwd %xmm2,%xmm9
DB 102,65,15,56,51,203 ; pmovzxwd %xmm11,%xmm1
- DB 102,68,15,111,5,246,41,0,0 ; movdqa 0x29f6(%rip),%xmm8 # 6f90 <_sk_callback_sse41+0x119d>
+ DB 102,68,15,111,5,184,41,0,0 ; movdqa 0x29b8(%rip),%xmm8 # 6e50 <_sk_callback_sse41+0x115f>
DB 102,15,111,209 ; movdqa %xmm1,%xmm2
DB 102,65,15,219,208 ; pand %xmm8,%xmm2
DB 102,15,239,202 ; pxor %xmm2,%xmm1
- DB 102,15,111,29,241,41,0,0 ; movdqa 0x29f1(%rip),%xmm3 # 6fa0 <_sk_callback_sse41+0x11ad>
+ DB 102,15,111,29,179,41,0,0 ; movdqa 0x29b3(%rip),%xmm3 # 6e60 <_sk_callback_sse41+0x116f>
DB 102,15,114,242,16 ; pslld $0x10,%xmm2
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,15,56,63,195 ; pmaxud %xmm3,%xmm0
DB 102,15,118,193 ; pcmpeqd %xmm1,%xmm0
DB 102,15,114,241,13 ; pslld $0xd,%xmm1
DB 102,15,235,202 ; por %xmm2,%xmm1
- DB 102,68,15,111,21,221,41,0,0 ; movdqa 0x29dd(%rip),%xmm10 # 6fb0 <_sk_callback_sse41+0x11bd>
+ DB 102,68,15,111,21,159,41,0,0 ; movdqa 0x299f(%rip),%xmm10 # 6e70 <_sk_callback_sse41+0x117f>
DB 102,65,15,254,202 ; paddd %xmm10,%xmm1
DB 102,15,219,193 ; pand %xmm1,%xmm0
DB 102,65,15,115,219,8 ; psrldq $0x8,%xmm11
@@ -18928,17 +18642,17 @@ PUBLIC _sk_store_f16_sse41
_sk_store_f16_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 102,68,15,111,21,18,41,0,0 ; movdqa 0x2912(%rip),%xmm10 # 6fc0 <_sk_callback_sse41+0x11cd>
+ DB 102,68,15,111,21,212,40,0,0 ; movdqa 0x28d4(%rip),%xmm10 # 6e80 <_sk_callback_sse41+0x118f>
DB 102,68,15,111,216 ; movdqa %xmm0,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13
DB 102,69,15,239,235 ; pxor %xmm11,%xmm13
- DB 102,68,15,111,13,5,41,0,0 ; movdqa 0x2905(%rip),%xmm9 # 6fd0 <_sk_callback_sse41+0x11dd>
+ DB 102,68,15,111,13,199,40,0,0 ; movdqa 0x28c7(%rip),%xmm9 # 6e90 <_sk_callback_sse41+0x119f>
DB 102,65,15,114,211,16 ; psrld $0x10,%xmm11
DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8
DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8
DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13
- DB 102,68,15,111,37,246,40,0,0 ; movdqa 0x28f6(%rip),%xmm12 # 6fe0 <_sk_callback_sse41+0x11ed>
+ DB 102,68,15,111,37,184,40,0,0 ; movdqa 0x28b8(%rip),%xmm12 # 6ea0 <_sk_callback_sse41+0x11af>
DB 102,69,15,235,220 ; por %xmm12,%xmm11
DB 102,69,15,254,221 ; paddd %xmm13,%xmm11
DB 102,69,15,223,195 ; pandn %xmm11,%xmm8
@@ -18982,7 +18696,7 @@ _sk_store_f16_sse41 LABEL PROC
DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9
DB 102,69,15,98,203 ; punpckldq %xmm11,%xmm9
DB 77,133,192 ; test %r8,%r8
- DB 117,21 ; jne 47e0 <_sk_store_f16_sse41+0x140>
+ DB 117,21 ; jne 46de <_sk_store_f16_sse41+0x140>
DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8)
DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8
DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8)
@@ -18990,13 +18704,13 @@ _sk_store_f16_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 47dc <_sk_store_f16_sse41+0x13c>
+ DB 116,240 ; je 46da <_sk_store_f16_sse41+0x13c>
DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 47dc <_sk_store_f16_sse41+0x13c>
+ DB 114,227 ; jb 46da <_sk_store_f16_sse41+0x13c>
DB 102,69,15,106,195 ; punpckhdq %xmm11,%xmm8
DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8)
- DB 235,213 ; jmp 47dc <_sk_store_f16_sse41+0x13c>
+ DB 235,213 ; jmp 46da <_sk_store_f16_sse41+0x13c>
PUBLIC _sk_load_u16_be_sse41
_sk_load_u16_be_sse41 LABEL PROC
@@ -19004,7 +18718,7 @@ _sk_load_u16_be_sse41 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,185,0,0,0 ; jne 48d6 <_sk_load_u16_be_sse41+0xcf>
+ DB 15,133,185,0,0,0 ; jne 47d4 <_sk_load_u16_be_sse41+0xcf>
DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0
DB 243,65,15,111,76,65,16 ; movdqu 0x10(%r9,%rax,2),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
@@ -19020,7 +18734,7 @@ _sk_load_u16_be_sse41 LABEL PROC
DB 102,15,235,200 ; por %xmm0,%xmm1
DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,135,39,0,0 ; movaps 0x2787(%rip),%xmm8 # 6ff0 <_sk_callback_sse41+0x11fd>
+ DB 68,15,40,5,73,39,0,0 ; movaps 0x2749(%rip),%xmm8 # 6eb0 <_sk_callback_sse41+0x11bf>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -19048,16 +18762,16 @@ _sk_load_u16_be_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,13 ; jne 48ef <_sk_load_u16_be_sse41+0xe8>
+ DB 117,13 ; jne 47ed <_sk_load_u16_be_sse41+0xe8>
DB 243,15,126,192 ; movq %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,59,255,255,255 ; jmpq 482a <_sk_load_u16_be_sse41+0x23>
+ DB 233,59,255,255,255 ; jmpq 4728 <_sk_load_u16_be_sse41+0x23>
DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,38,255,255,255 ; jb 482a <_sk_load_u16_be_sse41+0x23>
+ DB 15,130,38,255,255,255 ; jb 4728 <_sk_load_u16_be_sse41+0x23>
DB 243,65,15,126,76,65,16 ; movq 0x10(%r9,%rax,2),%xmm1
- DB 233,26,255,255,255 ; jmpq 482a <_sk_load_u16_be_sse41+0x23>
+ DB 233,26,255,255,255 ; jmpq 4728 <_sk_load_u16_be_sse41+0x23>
PUBLIC _sk_load_rgb_u16_be_sse41
_sk_load_rgb_u16_be_sse41 LABEL PROC
@@ -19065,7 +18779,7 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,170,0,0,0 ; jne 49cc <_sk_load_rgb_u16_be_sse41+0xbc>
+ DB 15,133,170,0,0,0 ; jne 48ca <_sk_load_rgb_u16_be_sse41+0xbc>
DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2
DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3
DB 102,15,115,219,4 ; psrldq $0x4,%xmm3
@@ -19085,7 +18799,7 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC
DB 102,15,235,200 ; por %xmm0,%xmm1
DB 102,15,56,51,193 ; pmovzxwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,127,38,0,0 ; movaps 0x267f(%rip),%xmm8 # 7000 <_sk_callback_sse41+0x120d>
+ DB 68,15,40,5,65,38,0,0 ; movaps 0x2641(%rip),%xmm8 # 6ec0 <_sk_callback_sse41+0x11cf>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -19102,34 +18816,34 @@ _sk_load_rgb_u16_be_sse41 LABEL PROC
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,70,38,0,0 ; movaps 0x2646(%rip),%xmm3 # 7010 <_sk_callback_sse41+0x121d>
+ DB 15,40,29,8,38,0,0 ; movaps 0x2608(%rip),%xmm3 # 6ed0 <_sk_callback_sse41+0x11df>
DB 255,224 ; jmpq *%rax
DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2
DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,13 ; jne 49f1 <_sk_load_rgb_u16_be_sse41+0xe1>
+ DB 117,13 ; jne 48ef <_sk_load_rgb_u16_be_sse41+0xe1>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,85,255,255,255 ; jmpq 4946 <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 233,85,255,255,255 ; jmpq 4844 <_sk_load_rgb_u16_be_sse41+0x36>
DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0
DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,24 ; jb 4a22 <_sk_load_rgb_u16_be_sse41+0x112>
+ DB 114,24 ; jb 4920 <_sk_load_rgb_u16_be_sse41+0x112>
DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3
DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,36,255,255,255 ; jmpq 4946 <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 233,36,255,255,255 ; jmpq 4844 <_sk_load_rgb_u16_be_sse41+0x36>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 233,27,255,255,255 ; jmpq 4946 <_sk_load_rgb_u16_be_sse41+0x36>
+ DB 233,27,255,255,255 ; jmpq 4844 <_sk_load_rgb_u16_be_sse41+0x36>
PUBLIC _sk_store_u16_be_sse41
_sk_store_u16_be_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
- DB 68,15,40,21,224,37,0,0 ; movaps 0x25e0(%rip),%xmm10 # 7020 <_sk_callback_sse41+0x122d>
+ DB 68,15,40,21,162,37,0,0 ; movaps 0x25a2(%rip),%xmm10 # 6ee0 <_sk_callback_sse41+0x11ef>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
@@ -19166,7 +18880,7 @@ _sk_store_u16_be_sse41 LABEL PROC
DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10
DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10
DB 77,133,192 ; test %r8,%r8
- DB 117,21 ; jne 4b0e <_sk_store_u16_be_sse41+0xe3>
+ DB 117,21 ; jne 4a0c <_sk_store_u16_be_sse41+0xe3>
DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2)
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2)
@@ -19174,13 +18888,13 @@ _sk_store_u16_be_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 4b0a <_sk_store_u16_be_sse41+0xdf>
+ DB 116,240 ; je 4a08 <_sk_store_u16_be_sse41+0xdf>
DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 4b0a <_sk_store_u16_be_sse41+0xdf>
+ DB 114,227 ; jb 4a08 <_sk_store_u16_be_sse41+0xdf>
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2)
- DB 235,213 ; jmp 4b0a <_sk_store_u16_be_sse41+0xdf>
+ DB 235,213 ; jmp 4a08 <_sk_store_u16_be_sse41+0xdf>
PUBLIC _sk_load_f32_sse41
_sk_load_f32_sse41 LABEL PROC
@@ -19191,7 +18905,7 @@ _sk_load_f32_sse41 LABEL PROC
DB 72,193,224,4 ; shl $0x4,%rax
DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,66 ; jne 4b95 <_sk_load_f32_sse41+0x60>
+ DB 117,66 ; jne 4a93 <_sk_load_f32_sse41+0x60>
DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
@@ -19211,17 +18925,17 @@ _sk_load_f32_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,8 ; jne 4ba7 <_sk_load_f32_sse41+0x72>
+ DB 117,8 ; jne 4aa5 <_sk_load_f32_sse41+0x72>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
- DB 235,190 ; jmp 4b65 <_sk_load_f32_sse41+0x30>
+ DB 235,190 ; jmp 4a63 <_sk_load_f32_sse41+0x30>
DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,8 ; jb 4bbb <_sk_load_f32_sse41+0x86>
+ DB 114,8 ; jb 4ab9 <_sk_load_f32_sse41+0x86>
DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
- DB 235,170 ; jmp 4b65 <_sk_load_f32_sse41+0x30>
+ DB 235,170 ; jmp 4a63 <_sk_load_f32_sse41+0x30>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 235,165 ; jmp 4b65 <_sk_load_f32_sse41+0x30>
+ DB 235,165 ; jmp 4a63 <_sk_load_f32_sse41+0x30>
PUBLIC _sk_load_f32_dst_sse41
_sk_load_f32_dst_sse41 LABEL PROC
@@ -19232,7 +18946,7 @@ _sk_load_f32_dst_sse41 LABEL PROC
DB 72,193,224,4 ; shl $0x4,%rax
DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,66 ; jne 4c20 <_sk_load_f32_dst_sse41+0x60>
+ DB 117,66 ; jne 4b1e <_sk_load_f32_dst_sse41+0x60>
DB 67,15,16,100,138,16 ; movups 0x10(%r10,%r9,4),%xmm4
DB 67,15,16,124,138,32 ; movups 0x20(%r10,%r9,4),%xmm7
DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
@@ -19252,17 +18966,17 @@ _sk_load_f32_dst_sse41 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,8 ; jne 4c32 <_sk_load_f32_dst_sse41+0x72>
+ DB 117,8 ; jne 4b30 <_sk_load_f32_dst_sse41+0x72>
DB 15,87,255 ; xorps %xmm7,%xmm7
DB 15,87,228 ; xorps %xmm4,%xmm4
- DB 235,190 ; jmp 4bf0 <_sk_load_f32_dst_sse41+0x30>
+ DB 235,190 ; jmp 4aee <_sk_load_f32_dst_sse41+0x30>
DB 67,15,16,100,138,16 ; movups 0x10(%r10,%r9,4),%xmm4
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,8 ; jb 4c46 <_sk_load_f32_dst_sse41+0x86>
+ DB 114,8 ; jb 4b44 <_sk_load_f32_dst_sse41+0x86>
DB 67,15,16,124,138,32 ; movups 0x20(%r10,%r9,4),%xmm7
- DB 235,170 ; jmp 4bf0 <_sk_load_f32_dst_sse41+0x30>
+ DB 235,170 ; jmp 4aee <_sk_load_f32_dst_sse41+0x30>
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 235,165 ; jmp 4bf0 <_sk_load_f32_dst_sse41+0x30>
+ DB 235,165 ; jmp 4aee <_sk_load_f32_dst_sse41+0x30>
PUBLIC _sk_store_f32_sse41
_sk_store_f32_sse41 LABEL PROC
@@ -19286,7 +19000,7 @@ _sk_store_f32_sse41 LABEL PROC
DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9
DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1)
DB 77,133,192 ; test %r8,%r8
- DB 117,29 ; jne 4cbd <_sk_store_f32_sse41+0x72>
+ DB 117,29 ; jne 4bbb <_sk_store_f32_sse41+0x72>
DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10
DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
@@ -19294,12 +19008,12 @@ _sk_store_f32_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,246 ; je 4cb9 <_sk_store_f32_sse41+0x6e>
+ DB 116,246 ; je 4bb7 <_sk_store_f32_sse41+0x6e>
DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,234 ; jb 4cb9 <_sk_store_f32_sse41+0x6e>
+ DB 114,234 ; jb 4bb7 <_sk_store_f32_sse41+0x6e>
DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
- DB 235,225 ; jmp 4cb9 <_sk_store_f32_sse41+0x6e>
+ DB 235,225 ; jmp 4bb7 <_sk_store_f32_sse41+0x6e>
PUBLIC _sk_clamp_x_sse41
_sk_clamp_x_sse41 LABEL PROC
@@ -19373,7 +19087,7 @@ _sk_mirror_x_sse41 LABEL PROC
DB 65,15,92,194 ; subps %xmm10,%xmm0
DB 243,69,15,88,192 ; addss %xmm8,%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
- DB 243,68,15,89,13,193,38,0,0 ; mulss 0x26c1(%rip),%xmm9 # 7490 <_sk_callback_sse41+0x169d>
+ DB 243,68,15,89,13,131,38,0,0 ; mulss 0x2683(%rip),%xmm9 # 7350 <_sk_callback_sse41+0x165f>
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,89,200 ; mulps %xmm0,%xmm9
DB 102,69,15,58,8,201,1 ; roundps $0x1,%xmm9,%xmm9
@@ -19399,7 +19113,7 @@ _sk_mirror_y_sse41 LABEL PROC
DB 65,15,92,202 ; subps %xmm10,%xmm1
DB 243,69,15,88,192 ; addss %xmm8,%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
- DB 243,68,15,89,13,94,38,0,0 ; mulss 0x265e(%rip),%xmm9 # 7494 <_sk_callback_sse41+0x16a1>
+ DB 243,68,15,89,13,32,38,0,0 ; mulss 0x2620(%rip),%xmm9 # 7354 <_sk_callback_sse41+0x1663>
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,89,201 ; mulps %xmm1,%xmm9
DB 102,69,15,58,8,201,1 ; roundps $0x1,%xmm9,%xmm9
@@ -19419,7 +19133,7 @@ PUBLIC _sk_clamp_x_1_sse41
_sk_clamp_x_1_sse41 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,176,33,0,0 ; minps 0x21b0(%rip),%xmm8 # 7030 <_sk_callback_sse41+0x123d>
+ DB 68,15,93,5,114,33,0,0 ; minps 0x2172(%rip),%xmm8 # 6ef0 <_sk_callback_sse41+0x11ff>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -19433,9 +19147,9 @@ _sk_repeat_x_1_sse41 LABEL PROC
PUBLIC _sk_mirror_x_1_sse41
_sk_mirror_x_1_sse41 LABEL PROC
- DB 68,15,40,5,161,33,0,0 ; movaps 0x21a1(%rip),%xmm8 # 7040 <_sk_callback_sse41+0x124d>
+ DB 68,15,40,5,99,33,0,0 ; movaps 0x2163(%rip),%xmm8 # 6f00 <_sk_callback_sse41+0x120f>
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,13,165,33,0,0 ; movaps 0x21a5(%rip),%xmm9 # 7050 <_sk_callback_sse41+0x125d>
+ DB 68,15,40,13,103,33,0,0 ; movaps 0x2167(%rip),%xmm9 # 6f10 <_sk_callback_sse41+0x121f>
DB 68,15,89,200 ; mulps %xmm0,%xmm9
DB 102,69,15,58,8,201,1 ; roundps $0x1,%xmm9,%xmm9
DB 69,15,88,201 ; addps %xmm9,%xmm9
@@ -19450,10 +19164,10 @@ _sk_mirror_x_1_sse41 LABEL PROC
PUBLIC _sk_luminance_to_alpha_sse41
_sk_luminance_to_alpha_sse41 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 15,89,5,132,33,0,0 ; mulps 0x2184(%rip),%xmm0 # 7060 <_sk_callback_sse41+0x126d>
- DB 15,89,13,141,33,0,0 ; mulps 0x218d(%rip),%xmm1 # 7070 <_sk_callback_sse41+0x127d>
+ DB 15,89,5,70,33,0,0 ; mulps 0x2146(%rip),%xmm0 # 6f20 <_sk_callback_sse41+0x122f>
+ DB 15,89,13,79,33,0,0 ; mulps 0x214f(%rip),%xmm1 # 6f30 <_sk_callback_sse41+0x123f>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,29,147,33,0,0 ; mulps 0x2193(%rip),%xmm3 # 7080 <_sk_callback_sse41+0x128d>
+ DB 15,89,29,85,33,0,0 ; mulps 0x2155(%rip),%xmm3 # 6f40 <_sk_callback_sse41+0x124f>
DB 15,88,217 ; addps %xmm1,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
@@ -19750,9 +19464,9 @@ _sk_evenly_spaced_gradient_sse41 LABEL PROC
DB 72,139,24 ; mov (%rax),%rbx
DB 76,139,112,8 ; mov 0x8(%rax),%r14
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 538f <_sk_evenly_spaced_gradient_sse41+0x1a>
+ DB 120,7 ; js 528d <_sk_evenly_spaced_gradient_sse41+0x1a>
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
- DB 235,21 ; jmp 53a4 <_sk_evenly_spaced_gradient_sse41+0x2f>
+ DB 235,21 ; jmp 52a2 <_sk_evenly_spaced_gradient_sse41+0x2f>
DB 73,137,217 ; mov %rbx,%r9
DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
@@ -19840,15 +19554,15 @@ _sk_evenly_spaced_gradient_sse41 LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_sse41
_sk_gauss_a_to_rgba_sse41 LABEL PROC
- DB 15,40,5,62,27,0,0 ; movaps 0x1b3e(%rip),%xmm0 # 7090 <_sk_callback_sse41+0x129d>
+ DB 15,40,5,0,27,0,0 ; movaps 0x1b00(%rip),%xmm0 # 6f50 <_sk_callback_sse41+0x125f>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,68,27,0,0 ; addps 0x1b44(%rip),%xmm0 # 70a0 <_sk_callback_sse41+0x12ad>
+ DB 15,88,5,6,27,0,0 ; addps 0x1b06(%rip),%xmm0 # 6f60 <_sk_callback_sse41+0x126f>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,74,27,0,0 ; addps 0x1b4a(%rip),%xmm0 # 70b0 <_sk_callback_sse41+0x12bd>
+ DB 15,88,5,12,27,0,0 ; addps 0x1b0c(%rip),%xmm0 # 6f70 <_sk_callback_sse41+0x127f>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,80,27,0,0 ; addps 0x1b50(%rip),%xmm0 # 70c0 <_sk_callback_sse41+0x12cd>
+ DB 15,88,5,18,27,0,0 ; addps 0x1b12(%rip),%xmm0 # 6f80 <_sk_callback_sse41+0x128f>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,86,27,0,0 ; addps 0x1b56(%rip),%xmm0 # 70d0 <_sk_callback_sse41+0x12dd>
+ DB 15,88,5,24,27,0,0 ; addps 0x1b18(%rip),%xmm0 # 6f90 <_sk_callback_sse41+0x129f>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
@@ -19864,12 +19578,12 @@ _sk_gradient_sse41 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,249,2 ; cmp $0x2,%r9
- DB 114,50 ; jb 55cd <_sk_gradient_sse41+0x46>
+ DB 114,50 ; jb 54cb <_sk_gradient_sse41+0x46>
DB 72,139,88,72 ; mov 0x48(%rax),%rbx
DB 73,255,201 ; dec %r9
DB 72,131,195,4 ; add $0x4,%rbx
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 15,40,21,47,27,0,0 ; movaps 0x1b2f(%rip),%xmm2 # 70e0 <_sk_callback_sse41+0x12ed>
+ DB 15,40,21,241,26,0,0 ; movaps 0x1af1(%rip),%xmm2 # 6fa0 <_sk_callback_sse41+0x12af>
DB 243,15,16,27 ; movss (%rbx),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
@@ -19877,7 +19591,7 @@ _sk_gradient_sse41 LABEL PROC
DB 102,15,254,203 ; paddd %xmm3,%xmm1
DB 72,131,195,4 ; add $0x4,%rbx
DB 73,255,201 ; dec %r9
- DB 117,228 ; jne 55b1 <_sk_gradient_sse41+0x2a>
+ DB 117,228 ; jne 54af <_sk_gradient_sse41+0x2a>
DB 102,73,15,58,22,201,1 ; pextrq $0x1,%xmm1,%r9
DB 69,137,202 ; mov %r9d,%r10d
DB 73,193,233,32 ; shr $0x20,%r9
@@ -20003,26 +19717,26 @@ _sk_xy_to_unit_angle_sse41 LABEL PROC
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,40,236 ; movaps %xmm12,%xmm13
DB 69,15,89,237 ; mulps %xmm13,%xmm13
- DB 68,15,40,21,208,24,0,0 ; movaps 0x18d0(%rip),%xmm10 # 70f0 <_sk_callback_sse41+0x12fd>
+ DB 68,15,40,21,146,24,0,0 ; movaps 0x1892(%rip),%xmm10 # 6fb0 <_sk_callback_sse41+0x12bf>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,212,24,0,0 ; addps 0x18d4(%rip),%xmm10 # 7100 <_sk_callback_sse41+0x130d>
+ DB 68,15,88,21,150,24,0,0 ; addps 0x1896(%rip),%xmm10 # 6fc0 <_sk_callback_sse41+0x12cf>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,216,24,0,0 ; addps 0x18d8(%rip),%xmm10 # 7110 <_sk_callback_sse41+0x131d>
+ DB 68,15,88,21,154,24,0,0 ; addps 0x189a(%rip),%xmm10 # 6fd0 <_sk_callback_sse41+0x12df>
DB 69,15,89,213 ; mulps %xmm13,%xmm10
- DB 68,15,88,21,220,24,0,0 ; addps 0x18dc(%rip),%xmm10 # 7120 <_sk_callback_sse41+0x132d>
+ DB 68,15,88,21,158,24,0,0 ; addps 0x189e(%rip),%xmm10 # 6fe0 <_sk_callback_sse41+0x12ef>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,194,195,1 ; cmpltps %xmm11,%xmm0
- DB 68,15,40,29,219,24,0,0 ; movaps 0x18db(%rip),%xmm11 # 7130 <_sk_callback_sse41+0x133d>
+ DB 68,15,40,29,157,24,0,0 ; movaps 0x189d(%rip),%xmm11 # 6ff0 <_sk_callback_sse41+0x12ff>
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10
DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9
- DB 68,15,40,29,212,24,0,0 ; movaps 0x18d4(%rip),%xmm11 # 7140 <_sk_callback_sse41+0x134d>
+ DB 68,15,40,29,150,24,0,0 ; movaps 0x1896(%rip),%xmm11 # 7000 <_sk_callback_sse41+0x130f>
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 102,69,15,56,20,211 ; blendvps %xmm0,%xmm11,%xmm10
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 65,15,194,192,1 ; cmpltps %xmm8,%xmm0
- DB 68,15,40,13,198,24,0,0 ; movaps 0x18c6(%rip),%xmm9 # 7150 <_sk_callback_sse41+0x135d>
+ DB 68,15,40,13,136,24,0,0 ; movaps 0x1888(%rip),%xmm9 # 7010 <_sk_callback_sse41+0x131f>
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 102,69,15,56,20,209 ; blendvps %xmm0,%xmm9,%xmm10
DB 69,15,194,194,7 ; cmpordps %xmm10,%xmm8
@@ -20052,7 +19766,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41 LABEL PROC
DB 243,69,15,89,203 ; mulss %xmm11,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,111,24,0,0 ; mulps 0x186f(%rip),%xmm9 # 7160 <_sk_callback_sse41+0x136d>
+ DB 68,15,89,13,49,24,0,0 ; mulps 0x1831(%rip),%xmm9 # 7020 <_sk_callback_sse41+0x132f>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
@@ -20060,7 +19774,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41 LABEL PROC
DB 243,69,15,89,219 ; mulss %xmm11,%xmm11
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,92,227 ; subps %xmm11,%xmm12
- DB 68,15,89,21,90,24,0,0 ; mulps 0x185a(%rip),%xmm10 # 7170 <_sk_callback_sse41+0x137d>
+ DB 68,15,89,21,28,24,0,0 ; mulps 0x181c(%rip),%xmm10 # 7030 <_sk_callback_sse41+0x133f>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -20069,8 +19783,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse41 LABEL PROC
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,92,193 ; subps %xmm9,%xmm0
- DB 68,15,87,13,66,24,0,0 ; xorps 0x1842(%rip),%xmm9 # 7180 <_sk_callback_sse41+0x138d>
- DB 68,15,89,5,74,24,0,0 ; mulps 0x184a(%rip),%xmm8 # 7190 <_sk_callback_sse41+0x139d>
+ DB 68,15,87,13,4,24,0,0 ; xorps 0x1804(%rip),%xmm9 # 7040 <_sk_callback_sse41+0x134f>
+ DB 68,15,89,5,12,24,0,0 ; mulps 0x180c(%rip),%xmm8 # 7050 <_sk_callback_sse41+0x135f>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
@@ -20089,7 +19803,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41 LABEL PROC
DB 243,69,15,89,203 ; mulss %xmm11,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,17,24,0,0 ; mulps 0x1811(%rip),%xmm9 # 71a0 <_sk_callback_sse41+0x13ad>
+ DB 68,15,89,13,211,23,0,0 ; mulps 0x17d3(%rip),%xmm9 # 7060 <_sk_callback_sse41+0x136f>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
@@ -20097,7 +19811,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41 LABEL PROC
DB 243,69,15,89,219 ; mulss %xmm11,%xmm11
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,92,227 ; subps %xmm11,%xmm12
- DB 68,15,89,21,252,23,0,0 ; mulps 0x17fc(%rip),%xmm10 # 71b0 <_sk_callback_sse41+0x13bd>
+ DB 68,15,89,21,190,23,0,0 ; mulps 0x17be(%rip),%xmm10 # 7070 <_sk_callback_sse41+0x137f>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -20106,8 +19820,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse41 LABEL PROC
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,92,193 ; subps %xmm9,%xmm0
- DB 68,15,87,13,228,23,0,0 ; xorps 0x17e4(%rip),%xmm9 # 71c0 <_sk_callback_sse41+0x13cd>
- DB 68,15,89,5,236,23,0,0 ; mulps 0x17ec(%rip),%xmm8 # 71d0 <_sk_callback_sse41+0x13dd>
+ DB 68,15,87,13,166,23,0,0 ; xorps 0x17a6(%rip),%xmm9 # 7080 <_sk_callback_sse41+0x138f>
+ DB 68,15,89,5,174,23,0,0 ; mulps 0x17ae(%rip),%xmm8 # 7090 <_sk_callback_sse41+0x139f>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
@@ -20123,7 +19837,7 @@ _sk_xy_to_2pt_conical_linear_sse41 LABEL PROC
DB 243,69,15,89,200 ; mulss %xmm8,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,196,23,0,0 ; mulps 0x17c4(%rip),%xmm9 # 71e0 <_sk_callback_sse41+0x13ed>
+ DB 68,15,89,13,134,23,0,0 ; mulps 0x1786(%rip),%xmm9 # 70a0 <_sk_callback_sse41+0x13af>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 69,15,89,210 ; mulps %xmm10,%xmm10
@@ -20131,7 +19845,7 @@ _sk_xy_to_2pt_conical_linear_sse41 LABEL PROC
DB 243,69,15,89,192 ; mulss %xmm8,%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,92,192 ; subps %xmm8,%xmm0
- DB 15,87,5,176,23,0,0 ; xorps 0x17b0(%rip),%xmm0 # 71f0 <_sk_callback_sse41+0x13fd>
+ DB 15,87,5,114,23,0,0 ; xorps 0x1772(%rip),%xmm0 # 70b0 <_sk_callback_sse41+0x13bf>
DB 65,15,94,193 ; divps %xmm9,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20168,7 +19882,7 @@ _sk_apply_vector_mask_sse41 LABEL PROC
PUBLIC _sk_save_xy_sse41
_sk_save_xy_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,86,23,0,0 ; movaps 0x1756(%rip),%xmm8 # 7200 <_sk_callback_sse41+0x140d>
+ DB 68,15,40,5,24,23,0,0 ; movaps 0x1718(%rip),%xmm8 # 70c0 <_sk_callback_sse41+0x13cf>
DB 15,17,0 ; movups %xmm0,(%rax)
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,88,200 ; addps %xmm8,%xmm9
@@ -20208,8 +19922,8 @@ _sk_bilinear_nx_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,216,22,0,0 ; addps 0x16d8(%rip),%xmm0 # 7210 <_sk_callback_sse41+0x141d>
- DB 68,15,40,13,224,22,0,0 ; movaps 0x16e0(%rip),%xmm9 # 7220 <_sk_callback_sse41+0x142d>
+ DB 15,88,5,154,22,0,0 ; addps 0x169a(%rip),%xmm0 # 70d0 <_sk_callback_sse41+0x13df>
+ DB 68,15,40,13,162,22,0,0 ; movaps 0x16a2(%rip),%xmm9 # 70e0 <_sk_callback_sse41+0x13ef>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20220,7 +19934,7 @@ _sk_bilinear_px_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,207,22,0,0 ; addps 0x16cf(%rip),%xmm0 # 7230 <_sk_callback_sse41+0x143d>
+ DB 15,88,5,145,22,0,0 ; addps 0x1691(%rip),%xmm0 # 70f0 <_sk_callback_sse41+0x13ff>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20230,8 +19944,8 @@ _sk_bilinear_ny_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,193,22,0,0 ; addps 0x16c1(%rip),%xmm1 # 7240 <_sk_callback_sse41+0x144d>
- DB 68,15,40,13,201,22,0,0 ; movaps 0x16c9(%rip),%xmm9 # 7250 <_sk_callback_sse41+0x145d>
+ DB 15,88,13,131,22,0,0 ; addps 0x1683(%rip),%xmm1 # 7100 <_sk_callback_sse41+0x140f>
+ DB 68,15,40,13,139,22,0,0 ; movaps 0x168b(%rip),%xmm9 # 7110 <_sk_callback_sse41+0x141f>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20242,7 +19956,7 @@ _sk_bilinear_py_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,183,22,0,0 ; addps 0x16b7(%rip),%xmm1 # 7260 <_sk_callback_sse41+0x146d>
+ DB 15,88,13,121,22,0,0 ; addps 0x1679(%rip),%xmm1 # 7120 <_sk_callback_sse41+0x142f>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20252,13 +19966,13 @@ _sk_bicubic_n3x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,170,22,0,0 ; addps 0x16aa(%rip),%xmm0 # 7270 <_sk_callback_sse41+0x147d>
- DB 68,15,40,13,178,22,0,0 ; movaps 0x16b2(%rip),%xmm9 # 7280 <_sk_callback_sse41+0x148d>
+ DB 15,88,5,108,22,0,0 ; addps 0x166c(%rip),%xmm0 # 7130 <_sk_callback_sse41+0x143f>
+ DB 68,15,40,13,116,22,0,0 ; movaps 0x1674(%rip),%xmm9 # 7140 <_sk_callback_sse41+0x144f>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,174,22,0,0 ; mulps 0x16ae(%rip),%xmm9 # 7290 <_sk_callback_sse41+0x149d>
- DB 68,15,88,13,182,22,0,0 ; addps 0x16b6(%rip),%xmm9 # 72a0 <_sk_callback_sse41+0x14ad>
+ DB 68,15,89,13,112,22,0,0 ; mulps 0x1670(%rip),%xmm9 # 7150 <_sk_callback_sse41+0x145f>
+ DB 68,15,88,13,120,22,0,0 ; addps 0x1678(%rip),%xmm9 # 7160 <_sk_callback_sse41+0x146f>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20269,16 +19983,16 @@ _sk_bicubic_n1x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,165,22,0,0 ; addps 0x16a5(%rip),%xmm0 # 72b0 <_sk_callback_sse41+0x14bd>
- DB 68,15,40,13,173,22,0,0 ; movaps 0x16ad(%rip),%xmm9 # 72c0 <_sk_callback_sse41+0x14cd>
+ DB 15,88,5,103,22,0,0 ; addps 0x1667(%rip),%xmm0 # 7170 <_sk_callback_sse41+0x147f>
+ DB 68,15,40,13,111,22,0,0 ; movaps 0x166f(%rip),%xmm9 # 7180 <_sk_callback_sse41+0x148f>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,177,22,0,0 ; movaps 0x16b1(%rip),%xmm8 # 72d0 <_sk_callback_sse41+0x14dd>
+ DB 68,15,40,5,115,22,0,0 ; movaps 0x1673(%rip),%xmm8 # 7190 <_sk_callback_sse41+0x149f>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,181,22,0,0 ; addps 0x16b5(%rip),%xmm8 # 72e0 <_sk_callback_sse41+0x14ed>
+ DB 68,15,88,5,119,22,0,0 ; addps 0x1677(%rip),%xmm8 # 71a0 <_sk_callback_sse41+0x14af>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,185,22,0,0 ; addps 0x16b9(%rip),%xmm8 # 72f0 <_sk_callback_sse41+0x14fd>
+ DB 68,15,88,5,123,22,0,0 ; addps 0x167b(%rip),%xmm8 # 71b0 <_sk_callback_sse41+0x14bf>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,189,22,0,0 ; addps 0x16bd(%rip),%xmm8 # 7300 <_sk_callback_sse41+0x150d>
+ DB 68,15,88,5,127,22,0,0 ; addps 0x167f(%rip),%xmm8 # 71c0 <_sk_callback_sse41+0x14cf>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20286,17 +20000,17 @@ _sk_bicubic_n1x_sse41 LABEL PROC
PUBLIC _sk_bicubic_p1x_sse41
_sk_bicubic_p1x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,183,22,0,0 ; movaps 0x16b7(%rip),%xmm8 # 7310 <_sk_callback_sse41+0x151d>
+ DB 68,15,40,5,121,22,0,0 ; movaps 0x1679(%rip),%xmm8 # 71d0 <_sk_callback_sse41+0x14df>
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,21,179,22,0,0 ; movaps 0x16b3(%rip),%xmm10 # 7320 <_sk_callback_sse41+0x152d>
+ DB 68,15,40,21,117,22,0,0 ; movaps 0x1675(%rip),%xmm10 # 71e0 <_sk_callback_sse41+0x14ef>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,183,22,0,0 ; addps 0x16b7(%rip),%xmm10 # 7330 <_sk_callback_sse41+0x153d>
+ DB 68,15,88,21,121,22,0,0 ; addps 0x1679(%rip),%xmm10 # 71f0 <_sk_callback_sse41+0x14ff>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,179,22,0,0 ; addps 0x16b3(%rip),%xmm10 # 7340 <_sk_callback_sse41+0x154d>
+ DB 68,15,88,21,117,22,0,0 ; addps 0x1675(%rip),%xmm10 # 7200 <_sk_callback_sse41+0x150f>
DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20306,11 +20020,11 @@ _sk_bicubic_p3x_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,166,22,0,0 ; addps 0x16a6(%rip),%xmm0 # 7350 <_sk_callback_sse41+0x155d>
+ DB 15,88,5,104,22,0,0 ; addps 0x1668(%rip),%xmm0 # 7210 <_sk_callback_sse41+0x151f>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,166,22,0,0 ; mulps 0x16a6(%rip),%xmm8 # 7360 <_sk_callback_sse41+0x156d>
- DB 68,15,88,5,174,22,0,0 ; addps 0x16ae(%rip),%xmm8 # 7370 <_sk_callback_sse41+0x157d>
+ DB 68,15,89,5,104,22,0,0 ; mulps 0x1668(%rip),%xmm8 # 7220 <_sk_callback_sse41+0x152f>
+ DB 68,15,88,5,112,22,0,0 ; addps 0x1670(%rip),%xmm8 # 7230 <_sk_callback_sse41+0x153f>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20321,13 +20035,13 @@ _sk_bicubic_n3y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,156,22,0,0 ; addps 0x169c(%rip),%xmm1 # 7380 <_sk_callback_sse41+0x158d>
- DB 68,15,40,13,164,22,0,0 ; movaps 0x16a4(%rip),%xmm9 # 7390 <_sk_callback_sse41+0x159d>
+ DB 15,88,13,94,22,0,0 ; addps 0x165e(%rip),%xmm1 # 7240 <_sk_callback_sse41+0x154f>
+ DB 68,15,40,13,102,22,0,0 ; movaps 0x1666(%rip),%xmm9 # 7250 <_sk_callback_sse41+0x155f>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,160,22,0,0 ; mulps 0x16a0(%rip),%xmm9 # 73a0 <_sk_callback_sse41+0x15ad>
- DB 68,15,88,13,168,22,0,0 ; addps 0x16a8(%rip),%xmm9 # 73b0 <_sk_callback_sse41+0x15bd>
+ DB 68,15,89,13,98,22,0,0 ; mulps 0x1662(%rip),%xmm9 # 7260 <_sk_callback_sse41+0x156f>
+ DB 68,15,88,13,106,22,0,0 ; addps 0x166a(%rip),%xmm9 # 7270 <_sk_callback_sse41+0x157f>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20338,16 +20052,16 @@ _sk_bicubic_n1y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,150,22,0,0 ; addps 0x1696(%rip),%xmm1 # 73c0 <_sk_callback_sse41+0x15cd>
- DB 68,15,40,13,158,22,0,0 ; movaps 0x169e(%rip),%xmm9 # 73d0 <_sk_callback_sse41+0x15dd>
+ DB 15,88,13,88,22,0,0 ; addps 0x1658(%rip),%xmm1 # 7280 <_sk_callback_sse41+0x158f>
+ DB 68,15,40,13,96,22,0,0 ; movaps 0x1660(%rip),%xmm9 # 7290 <_sk_callback_sse41+0x159f>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,162,22,0,0 ; movaps 0x16a2(%rip),%xmm8 # 73e0 <_sk_callback_sse41+0x15ed>
+ DB 68,15,40,5,100,22,0,0 ; movaps 0x1664(%rip),%xmm8 # 72a0 <_sk_callback_sse41+0x15af>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,166,22,0,0 ; addps 0x16a6(%rip),%xmm8 # 73f0 <_sk_callback_sse41+0x15fd>
+ DB 68,15,88,5,104,22,0,0 ; addps 0x1668(%rip),%xmm8 # 72b0 <_sk_callback_sse41+0x15bf>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,170,22,0,0 ; addps 0x16aa(%rip),%xmm8 # 7400 <_sk_callback_sse41+0x160d>
+ DB 68,15,88,5,108,22,0,0 ; addps 0x166c(%rip),%xmm8 # 72c0 <_sk_callback_sse41+0x15cf>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,174,22,0,0 ; addps 0x16ae(%rip),%xmm8 # 7410 <_sk_callback_sse41+0x161d>
+ DB 68,15,88,5,112,22,0,0 ; addps 0x1670(%rip),%xmm8 # 72d0 <_sk_callback_sse41+0x15df>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20355,17 +20069,17 @@ _sk_bicubic_n1y_sse41 LABEL PROC
PUBLIC _sk_bicubic_p1y_sse41
_sk_bicubic_p1y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,168,22,0,0 ; movaps 0x16a8(%rip),%xmm8 # 7420 <_sk_callback_sse41+0x162d>
+ DB 68,15,40,5,106,22,0,0 ; movaps 0x166a(%rip),%xmm8 # 72e0 <_sk_callback_sse41+0x15ef>
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 68,15,40,21,163,22,0,0 ; movaps 0x16a3(%rip),%xmm10 # 7430 <_sk_callback_sse41+0x163d>
+ DB 68,15,40,21,101,22,0,0 ; movaps 0x1665(%rip),%xmm10 # 72f0 <_sk_callback_sse41+0x15ff>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,167,22,0,0 ; addps 0x16a7(%rip),%xmm10 # 7440 <_sk_callback_sse41+0x164d>
+ DB 68,15,88,21,105,22,0,0 ; addps 0x1669(%rip),%xmm10 # 7300 <_sk_callback_sse41+0x160f>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,163,22,0,0 ; addps 0x16a3(%rip),%xmm10 # 7450 <_sk_callback_sse41+0x165d>
+ DB 68,15,88,21,101,22,0,0 ; addps 0x1665(%rip),%xmm10 # 7310 <_sk_callback_sse41+0x161f>
DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -20375,11 +20089,11 @@ _sk_bicubic_p3y_sse41 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,149,22,0,0 ; addps 0x1695(%rip),%xmm1 # 7460 <_sk_callback_sse41+0x166d>
+ DB 15,88,13,87,22,0,0 ; addps 0x1657(%rip),%xmm1 # 7320 <_sk_callback_sse41+0x162f>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,149,22,0,0 ; mulps 0x1695(%rip),%xmm8 # 7470 <_sk_callback_sse41+0x167d>
- DB 68,15,88,5,157,22,0,0 ; addps 0x169d(%rip),%xmm8 # 7480 <_sk_callback_sse41+0x168d>
+ DB 68,15,89,5,87,22,0,0 ; mulps 0x1657(%rip),%xmm8 # 7330 <_sk_callback_sse41+0x163f>
+ DB 68,15,88,5,95,22,0,0 ; addps 0x165f(%rip),%xmm8 # 7340 <_sk_callback_sse41+0x164f>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -20609,9 +20323,9 @@ ALIGN 16
DB 128,191,0,0,224,64,0 ; cmpb $0x0,0x40e00000(%rdi)
DB 0,224 ; add %ah,%al
DB 64,0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 60bc <.literal16+0x1fc>
+ DB 224,64 ; loopne 5fbc <.literal16+0x1fc>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 60c0 <.literal16+0x200>
+ DB 224,64 ; loopne 5fc0 <.literal16+0x200>
DB 154 ; (bad)
DB 153 ; cltd
DB 153 ; cltd
@@ -20631,13 +20345,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 60e1 <.literal16+0x221>
+ DB 71,225,61 ; rex.RXB loope 5fe1 <.literal16+0x221>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 60e5 <.literal16+0x225>
+ DB 71,225,61 ; rex.RXB loope 5fe5 <.literal16+0x225>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 60e9 <.literal16+0x229>
+ DB 71,225,61 ; rex.RXB loope 5fe9 <.literal16+0x229>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 60ed <.literal16+0x22d>
+ DB 71,225,61 ; rex.RXB loope 5fed <.literal16+0x22d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -20662,13 +20376,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6121 <.literal16+0x261>
+ DB 71,225,61 ; rex.RXB loope 6021 <.literal16+0x261>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6125 <.literal16+0x265>
+ DB 71,225,61 ; rex.RXB loope 6025 <.literal16+0x265>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6129 <.literal16+0x269>
+ DB 71,225,61 ; rex.RXB loope 6029 <.literal16+0x269>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 612d <.literal16+0x26d>
+ DB 71,225,61 ; rex.RXB loope 602d <.literal16+0x26d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -20693,13 +20407,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6161 <.literal16+0x2a1>
+ DB 71,225,61 ; rex.RXB loope 6061 <.literal16+0x2a1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6165 <.literal16+0x2a5>
+ DB 71,225,61 ; rex.RXB loope 6065 <.literal16+0x2a5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6169 <.literal16+0x2a9>
+ DB 71,225,61 ; rex.RXB loope 6069 <.literal16+0x2a9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 616d <.literal16+0x2ad>
+ DB 71,225,61 ; rex.RXB loope 606d <.literal16+0x2ad>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -20724,13 +20438,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 61a1 <.literal16+0x2e1>
+ DB 71,225,61 ; rex.RXB loope 60a1 <.literal16+0x2e1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 61a5 <.literal16+0x2e5>
+ DB 71,225,61 ; rex.RXB loope 60a5 <.literal16+0x2e5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 61a9 <.literal16+0x2e9>
+ DB 71,225,61 ; rex.RXB loope 60a9 <.literal16+0x2e9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 61ad <.literal16+0x2ed>
+ DB 71,225,61 ; rex.RXB loope 60ad <.literal16+0x2ed>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -20747,10 +20461,10 @@ ALIGN 16
DB 0,1 ; add %al,(%rcx)
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006198 <_sk_callback_sse41+0xa0003a5>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006098 <_sk_callback_sse41+0xa0003a7>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30061a0 <_sk_callback_sse41+0x30003ad>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30060a0 <_sk_callback_sse41+0x30003af>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -20769,11 +20483,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
DB 67,0,0 ; rex.XB add %al,(%r8)
- DB 127,67 ; jg 620b <.literal16+0x34b>
+ DB 127,67 ; jg 610b <.literal16+0x34b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 620f <.literal16+0x34f>
+ DB 127,67 ; jg 610f <.literal16+0x34f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6213 <.literal16+0x353>
+ DB 127,67 ; jg 6113 <.literal16+0x353>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -21055,13 +20769,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6449 <.literal16+0x589>
+ DB 224,7 ; loopne 6349 <.literal16+0x589>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 644d <.literal16+0x58d>
+ DB 224,7 ; loopne 634d <.literal16+0x58d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6451 <.literal16+0x591>
+ DB 224,7 ; loopne 6351 <.literal16+0x591>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6455 <.literal16+0x595>
+ DB 224,7 ; loopne 6355 <.literal16+0x595>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -21095,10 +20809,10 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 1,255 ; add %edi,%edi
DB 255 ; (bad)
- DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006498 <_sk_callback_sse41+0xa0006a5>
+ DB 255,5,255,255,255,9 ; incl 0x9ffffff(%rip) # a006398 <_sk_callback_sse41+0xa0006a7>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30064a0 <_sk_callback_sse41+0x30006ad>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 30063a0 <_sk_callback_sse41+0x30006af>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -21153,11 +20867,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 656b <.literal16+0x6ab>
+ DB 127,67 ; jg 646b <.literal16+0x6ab>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 656f <.literal16+0x6af>
+ DB 127,67 ; jg 646f <.literal16+0x6af>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6573 <.literal16+0x6b3>
+ DB 127,67 ; jg 6473 <.literal16+0x6b3>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax)
@@ -21172,16 +20886,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6564 <.literal16+0x6a4>
+ DB 127,0 ; jg 6464 <.literal16+0x6a4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6568 <.literal16+0x6a8>
+ DB 127,0 ; jg 6468 <.literal16+0x6a8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 656c <.literal16+0x6ac>
+ DB 127,0 ; jg 646c <.literal16+0x6ac>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6570 <.literal16+0x6b0>
+ DB 127,0 ; jg 6470 <.literal16+0x6b0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -21190,7 +20904,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 65f5 <.literal16+0x735>
+ DB 119,115 ; ja 64f5 <.literal16+0x735>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -21201,7 +20915,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6559 <.literal16+0x699>
+ DB 117,191 ; jne 6459 <.literal16+0x699>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -21213,7 +20927,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3a59a <_sk_callback_sse41+0xffffffffe9a347a7>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a49a <_sk_callback_sse41+0xffffffffe9a347a9>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -21268,16 +20982,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6634 <.literal16+0x774>
+ DB 127,0 ; jg 6534 <.literal16+0x774>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6638 <.literal16+0x778>
+ DB 127,0 ; jg 6538 <.literal16+0x778>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 663c <.literal16+0x77c>
+ DB 127,0 ; jg 653c <.literal16+0x77c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6640 <.literal16+0x780>
+ DB 127,0 ; jg 6540 <.literal16+0x780>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -21286,7 +21000,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 66c5 <.literal16+0x805>
+ DB 119,115 ; ja 65c5 <.literal16+0x805>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -21297,7 +21011,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6629 <.literal16+0x769>
+ DB 117,191 ; jne 6529 <.literal16+0x769>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -21309,7 +21023,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3a66a <_sk_callback_sse41+0xffffffffe9a34877>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a56a <_sk_callback_sse41+0xffffffffe9a34879>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -21364,16 +21078,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6704 <.literal16+0x844>
+ DB 127,0 ; jg 6604 <.literal16+0x844>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6708 <.literal16+0x848>
+ DB 127,0 ; jg 6608 <.literal16+0x848>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 670c <.literal16+0x84c>
+ DB 127,0 ; jg 660c <.literal16+0x84c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6710 <.literal16+0x850>
+ DB 127,0 ; jg 6610 <.literal16+0x850>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -21382,7 +21096,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6795 <.literal16+0x8d5>
+ DB 119,115 ; ja 6695 <.literal16+0x8d5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -21393,7 +21107,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 66f9 <.literal16+0x839>
+ DB 117,191 ; jne 65f9 <.literal16+0x839>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -21405,7 +21119,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3a73a <_sk_callback_sse41+0xffffffffe9a34947>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a63a <_sk_callback_sse41+0xffffffffe9a34949>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -21460,16 +21174,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 67d4 <.literal16+0x914>
+ DB 127,0 ; jg 66d4 <.literal16+0x914>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 67d8 <.literal16+0x918>
+ DB 127,0 ; jg 66d8 <.literal16+0x918>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 67dc <.literal16+0x91c>
+ DB 127,0 ; jg 66dc <.literal16+0x91c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 67e0 <.literal16+0x920>
+ DB 127,0 ; jg 66e0 <.literal16+0x920>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -21478,7 +21192,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6865 <.literal16+0x9a5>
+ DB 119,115 ; ja 6765 <.literal16+0x9a5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -21489,7 +21203,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 67c9 <.literal16+0x909>
+ DB 117,191 ; jne 66c9 <.literal16+0x909>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -21501,7 +21215,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3a80a <_sk_callback_sse41+0xffffffffe9a34a17>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a70a <_sk_callback_sse41+0xffffffffe9a34a19>
DB 220,63 ; fdivrl (%rdi)
DB 81 ; push %rcx
DB 140,242 ; mov %?,%edx
@@ -21552,13 +21266,13 @@ ALIGN 16
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
- DB 127,67 ; jg 68e7 <.literal16+0xa27>
+ DB 127,67 ; jg 67e7 <.literal16+0xa27>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 68eb <.literal16+0xa2b>
+ DB 127,67 ; jg 67eb <.literal16+0xa2b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 68ef <.literal16+0xa2f>
+ DB 127,67 ; jg 67ef <.literal16+0xa2f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 68f3 <.literal16+0xa33>
+ DB 127,67 ; jg 67f3 <.literal16+0xa33>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -21605,16 +21319,16 @@ ALIGN 16
DB 128,3,62 ; addb $0x3e,(%rbx)
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6973 <.literal16+0xab3>
+ DB 118,63 ; jbe 6873 <.literal16+0xab3>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6977 <.literal16+0xab7>
+ DB 118,63 ; jbe 6877 <.literal16+0xab7>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 697b <.literal16+0xabb>
+ DB 118,63 ; jbe 687b <.literal16+0xabb>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 697f <.literal16+0xabf>
+ DB 118,63 ; jbe 687f <.literal16+0xabf>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
@@ -21643,11 +21357,11 @@ ALIGN 16
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 69eb <.literal16+0xb2b>
+ DB 127,67 ; jg 68eb <.literal16+0xb2b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 69ef <.literal16+0xb2f>
+ DB 127,67 ; jg 68ef <.literal16+0xb2f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 69f3 <.literal16+0xb33>
+ DB 127,67 ; jg 68f3 <.literal16+0xb33>
DB 0,4,0 ; add %al,(%rax,%rax,1)
DB 0,0 ; add %al,(%rax)
DB 0,0 ; add %al,(%rax)
@@ -21691,34 +21405,7 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
DB 63 ; (bad)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
- DB 128,59,129 ; cmpb $0x81,(%rbx)
- DB 128,128,59,1,255,255,255 ; addb $0xff,-0xfec5(%rax)
- DB 5,255,255,255,9 ; add $0x9ffffff,%eax
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006a70 <_sk_callback_sse41+0x3000c7d>
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,6 ; incl (%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,10 ; decl (%rdx)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,14 ; decl (%rsi)
- DB 255 ; (bad)
- DB 255 ; (bad)
- DB 255,0 ; incl (%rax)
- DB 248 ; clc
+ DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%rax)
DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%rax)
@@ -21734,13 +21421,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6aa9 <.literal16+0xbe9>
+ DB 224,7 ; loopne 6969 <.literal16+0xba9>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6aad <.literal16+0xbed>
+ DB 224,7 ; loopne 696d <.literal16+0xbad>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6ab1 <.literal16+0xbf1>
+ DB 224,7 ; loopne 6971 <.literal16+0xbb1>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6ab5 <.literal16+0xbf5>
+ DB 224,7 ; loopne 6975 <.literal16+0xbb5>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -21786,13 +21473,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6b19 <.literal16+0xc59>
+ DB 224,7 ; loopne 69d9 <.literal16+0xc19>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b1d <.literal16+0xc5d>
+ DB 224,7 ; loopne 69dd <.literal16+0xc1d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b21 <.literal16+0xc61>
+ DB 224,7 ; loopne 69e1 <.literal16+0xc21>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b25 <.literal16+0xc65>
+ DB 224,7 ; loopne 69e5 <.literal16+0xc25>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -21838,13 +21525,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6b89 <.literal16+0xcc9>
+ DB 224,7 ; loopne 6a49 <.literal16+0xc89>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b8d <.literal16+0xccd>
+ DB 224,7 ; loopne 6a4d <.literal16+0xc8d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b91 <.literal16+0xcd1>
+ DB 224,7 ; loopne 6a51 <.literal16+0xc91>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6b95 <.literal16+0xcd5>
+ DB 224,7 ; loopne 6a55 <.literal16+0xc95>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -21882,13 +21569,13 @@ ALIGN 16
DB 65,0,0 ; add %al,(%r8)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 6c26 <.literal16+0xd66>
+ DB 124,66 ; jl 6ae6 <.literal16+0xd26>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 6c2a <.literal16+0xd6a>
+ DB 124,66 ; jl 6aea <.literal16+0xd2a>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 6c2e <.literal16+0xd6e>
+ DB 124,66 ; jl 6aee <.literal16+0xd2e>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 6c32 <.literal16+0xd72>
+ DB 124,66 ; jl 6af2 <.literal16+0xd32>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 0,240 ; add %dh,%al
@@ -22022,13 +21709,13 @@ ALIGN 16
DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax)
DB 61,137,136,136,61 ; cmp $0x3d888889,%eax
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6db5 <.literal16+0xef5>
+ DB 112,65 ; jo 6c75 <.literal16+0xeb5>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6db9 <.literal16+0xef9>
+ DB 112,65 ; jo 6c79 <.literal16+0xeb9>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6dbd <.literal16+0xefd>
+ DB 112,65 ; jo 6c7d <.literal16+0xebd>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 6dc1 <.literal16+0xf01>
+ DB 112,65 ; jo 6c81 <.literal16+0xec1>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -22043,7 +21730,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006db0 <_sk_callback_sse41+0x3000fbd>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006c70 <_sk_callback_sse41+0x3000f7f>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22070,7 +21757,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006df0 <_sk_callback_sse41+0x3000ffd>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006cb0 <_sk_callback_sse41+0x3000fbf>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22097,7 +21784,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006e30 <_sk_callback_sse41+0x300103d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006cf0 <_sk_callback_sse41+0x3000fff>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22112,19 +21799,19 @@ ALIGN 16
DB 255,0 ; incl (%rax)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e8b <.literal16+0xfcb>
+ DB 127,67 ; jg 6d4b <.literal16+0xf8b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e8f <.literal16+0xfcf>
+ DB 127,67 ; jg 6d4f <.literal16+0xf8f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e93 <.literal16+0xfd3>
+ DB 127,67 ; jg 6d53 <.literal16+0xf93>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e97 <.literal16+0xfd7>
+ DB 127,67 ; jg 6d57 <.literal16+0xf97>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e9b <.literal16+0xfdb>
+ DB 127,67 ; jg 6d5b <.literal16+0xf9b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6e9f <.literal16+0xfdf>
+ DB 127,67 ; jg 6d5f <.literal16+0xf9f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6ea3 <.literal16+0xfe3>
+ DB 127,67 ; jg 6d63 <.literal16+0xfa3>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -22139,7 +21826,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006e90 <_sk_callback_sse41+0x300109d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006d50 <_sk_callback_sse41+0x300105f>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22166,7 +21853,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006ed0 <_sk_callback_sse41+0x30010dd>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006d90 <_sk_callback_sse41+0x300109f>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22193,7 +21880,7 @@ ALIGN 16
DB 5,255,255,255,9 ; add $0x9ffffff,%eax
DB 255 ; (bad)
DB 255 ; (bad)
- DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006f10 <_sk_callback_sse41+0x300111d>
+ DB 255,13,255,255,255,2 ; decl 0x2ffffff(%rip) # 3006dd0 <_sk_callback_sse41+0x30010df>
DB 255 ; (bad)
DB 255 ; (bad)
DB 255,6 ; incl (%rsi)
@@ -22208,11 +21895,11 @@ ALIGN 16
DB 255,0 ; incl (%rax)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6f6b <.literal16+0x10ab>
+ DB 127,67 ; jg 6e2b <.literal16+0x106b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6f6f <.literal16+0x10af>
+ DB 127,67 ; jg 6e2f <.literal16+0x106f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6f73 <.literal16+0x10b3>
+ DB 127,67 ; jg 6e33 <.literal16+0x1073>
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
DB 0,0 ; add %al,(%rax)
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
@@ -22307,13 +21994,13 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 706b <.literal16+0x11ab>
+ DB 127,71 ; jg 6f2b <.literal16+0x116b>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 706f <.literal16+0x11af>
+ DB 127,71 ; jg 6f2f <.literal16+0x116f>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 7073 <.literal16+0x11b3>
+ DB 127,71 ; jg 6f33 <.literal16+0x1173>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 7077 <.literal16+0x11b7>
+ DB 127,71 ; jg 6f37 <.literal16+0x1177>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -22359,10 +22046,10 @@ ALIGN 16
DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax
DB 152 ; cwtl
DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx)
- DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc081aa <_sk_callback_sse41+0x2dc023b7>
+ DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0806a <_sk_callback_sse41+0x2dc02379>
DB 17,192 ; adc %eax,%eax
DB 45,16,17,192,18 ; sub $0x12c01110,%eax
- DB 120,57 ; js 70dc <.literal16+0x121c>
+ DB 120,57 ; js 6f9c <.literal16+0x11dc>
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
@@ -22543,11 +22230,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 72b2 <.literal16+0x13f2>
+ DB 62,114,28 ; jb,pt 7172 <.literal16+0x13b2>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 72b6 <.literal16+0x13f6>
+ DB 62,114,28 ; jb,pt 7176 <.literal16+0x13b6>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 72ba <.literal16+0x13fa>
+ DB 62,114,28 ; jb,pt 717a <.literal16+0x13ba>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -22591,7 +22278,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640145 <_sk_callback_sse41+0x3d63a352>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640005 <_sk_callback_sse41+0x3d63a314>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -22617,7 +22304,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640185 <_sk_callback_sse41+0x3d63a392>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640045 <_sk_callback_sse41+0x3d63a354>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -22626,13 +22313,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 737e <.literal16+0x14be>
+ DB 114,28 ; jb 723e <.literal16+0x147e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7382 <.literal16+0x14c2>
+ DB 62,114,28 ; jb,pt 7242 <.literal16+0x1482>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7386 <.literal16+0x14c6>
+ DB 62,114,28 ; jb,pt 7246 <.literal16+0x1486>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 738a <.literal16+0x14ca>
+ DB 62,114,28 ; jb,pt 724a <.literal16+0x148a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -22653,11 +22340,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 73c2 <.literal16+0x1502>
+ DB 62,114,28 ; jb,pt 7282 <.literal16+0x14c2>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 73c6 <.literal16+0x1506>
+ DB 62,114,28 ; jb,pt 7286 <.literal16+0x14c6>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 73ca <.literal16+0x150a>
+ DB 62,114,28 ; jb,pt 728a <.literal16+0x14ca>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -22701,7 +22388,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640255 <_sk_callback_sse41+0x3d63a462>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640115 <_sk_callback_sse41+0x3d63a424>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -22727,7 +22414,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640295 <_sk_callback_sse41+0x3d63a4a2>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640155 <_sk_callback_sse41+0x3d63a464>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -22736,13 +22423,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 748e <.literal16+0x15ce>
+ DB 114,28 ; jb 734e <.literal16+0x158e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7492 <_sk_callback_sse41+0x169f>
+ DB 62,114,28 ; jb,pt 7352 <_sk_callback_sse41+0x1661>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7496 <_sk_callback_sse41+0x16a3>
+ DB 62,114,28 ; jb,pt 7356 <_sk_callback_sse41+0x1665>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 749a <_sk_callback_sse41+0x16a7>
+ DB 62,114,28 ; jb,pt 735a <_sk_callback_sse41+0x1669>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -22924,7 +22611,7 @@ _sk_seed_shader_sse2 LABEL PROC
DB 102,15,110,194 ; movd %edx,%xmm0
DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
- DB 15,40,21,136,97,0,0 ; movaps 0x6188(%rip),%xmm2 # 63f0 <_sk_callback_sse2+0xd6>
+ DB 15,40,21,56,96,0,0 ; movaps 0x6038(%rip),%xmm2 # 62a0 <_sk_callback_sse2+0xcb>
DB 15,88,202 ; addps %xmm2,%xmm1
DB 15,16,7 ; movups (%rdi),%xmm0
DB 15,88,193 ; addps %xmm1,%xmm0
@@ -22933,7 +22620,7 @@ _sk_seed_shader_sse2 LABEL PROC
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,21,119,97,0,0 ; movaps 0x6177(%rip),%xmm2 # 6400 <_sk_callback_sse2+0xe6>
+ DB 15,40,21,39,96,0,0 ; movaps 0x6027(%rip),%xmm2 # 62b0 <_sk_callback_sse2+0xdb>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,87,237 ; xorps %xmm5,%xmm5
@@ -22951,14 +22638,14 @@ _sk_dither_sse2 LABEL PROC
DB 102,68,15,110,193 ; movd %ecx,%xmm8
DB 102,69,15,112,192,0 ; pshufd $0x0,%xmm8,%xmm8
DB 102,69,15,239,193 ; pxor %xmm9,%xmm8
- DB 102,68,15,111,21,69,97,0,0 ; movdqa 0x6145(%rip),%xmm10 # 6410 <_sk_callback_sse2+0xf6>
+ DB 102,68,15,111,21,245,95,0,0 ; movdqa 0x5ff5(%rip),%xmm10 # 62c0 <_sk_callback_sse2+0xeb>
DB 102,69,15,111,216 ; movdqa %xmm8,%xmm11
DB 102,69,15,219,218 ; pand %xmm10,%xmm11
DB 102,65,15,114,243,5 ; pslld $0x5,%xmm11
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 102,65,15,114,242,4 ; pslld $0x4,%xmm10
- DB 102,68,15,111,37,49,97,0,0 ; movdqa 0x6131(%rip),%xmm12 # 6420 <_sk_callback_sse2+0x106>
- DB 102,68,15,111,45,56,97,0,0 ; movdqa 0x6138(%rip),%xmm13 # 6430 <_sk_callback_sse2+0x116>
+ DB 102,68,15,111,37,225,95,0,0 ; movdqa 0x5fe1(%rip),%xmm12 # 62d0 <_sk_callback_sse2+0xfb>
+ DB 102,68,15,111,45,232,95,0,0 ; movdqa 0x5fe8(%rip),%xmm13 # 62e0 <_sk_callback_sse2+0x10b>
DB 102,69,15,111,240 ; movdqa %xmm8,%xmm14
DB 102,69,15,219,245 ; pand %xmm13,%xmm14
DB 102,65,15,114,246,2 ; pslld $0x2,%xmm14
@@ -22974,8 +22661,8 @@ _sk_dither_sse2 LABEL PROC
DB 102,69,15,235,245 ; por %xmm13,%xmm14
DB 102,69,15,235,240 ; por %xmm8,%xmm14
DB 69,15,91,198 ; cvtdq2ps %xmm14,%xmm8
- DB 68,15,89,5,243,96,0,0 ; mulps 0x60f3(%rip),%xmm8 # 6440 <_sk_callback_sse2+0x126>
- DB 68,15,88,5,251,96,0,0 ; addps 0x60fb(%rip),%xmm8 # 6450 <_sk_callback_sse2+0x136>
+ DB 68,15,89,5,163,95,0,0 ; mulps 0x5fa3(%rip),%xmm8 # 62f0 <_sk_callback_sse2+0x11b>
+ DB 68,15,88,5,171,95,0,0 ; addps 0x5fab(%rip),%xmm8 # 6300 <_sk_callback_sse2+0x12b>
DB 243,68,15,16,16 ; movss (%rax),%xmm10
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
@@ -23013,7 +22700,7 @@ _sk_uniform_color_sse2 LABEL PROC
PUBLIC _sk_black_color_sse2
_sk_black_color_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,145,96,0,0 ; movaps 0x6091(%rip),%xmm3 # 6460 <_sk_callback_sse2+0x146>
+ DB 15,40,29,65,95,0,0 ; movaps 0x5f41(%rip),%xmm3 # 6310 <_sk_callback_sse2+0x13b>
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -23022,7 +22709,7 @@ _sk_black_color_sse2 LABEL PROC
PUBLIC _sk_white_color_sse2
_sk_white_color_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,5,141,96,0,0 ; movaps 0x608d(%rip),%xmm0 # 6470 <_sk_callback_sse2+0x156>
+ DB 15,40,5,61,95,0,0 ; movaps 0x5f3d(%rip),%xmm0 # 6320 <_sk_callback_sse2+0x14b>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,40,216 ; movaps %xmm0,%xmm3
@@ -23060,7 +22747,7 @@ _sk_clear_sse2 LABEL PROC
PUBLIC _sk_srcatop_sse2
_sk_srcatop_sse2 LABEL PROC
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 68,15,40,5,77,96,0,0 ; movaps 0x604d(%rip),%xmm8 # 6480 <_sk_callback_sse2+0x166>
+ DB 68,15,40,5,253,94,0,0 ; movaps 0x5efd(%rip),%xmm8 # 6330 <_sk_callback_sse2+0x15b>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -23083,7 +22770,7 @@ PUBLIC _sk_dstatop_sse2
_sk_dstatop_sse2 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
DB 68,15,89,196 ; mulps %xmm4,%xmm8
- DB 68,15,40,13,16,96,0,0 ; movaps 0x6010(%rip),%xmm9 # 6490 <_sk_callback_sse2+0x176>
+ DB 68,15,40,13,192,94,0,0 ; movaps 0x5ec0(%rip),%xmm9 # 6340 <_sk_callback_sse2+0x16b>
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
@@ -23124,7 +22811,7 @@ _sk_dstin_sse2 LABEL PROC
PUBLIC _sk_srcout_sse2
_sk_srcout_sse2 LABEL PROC
- DB 68,15,40,5,180,95,0,0 ; movaps 0x5fb4(%rip),%xmm8 # 64a0 <_sk_callback_sse2+0x186>
+ DB 68,15,40,5,100,94,0,0 ; movaps 0x5e64(%rip),%xmm8 # 6350 <_sk_callback_sse2+0x17b>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
@@ -23135,7 +22822,7 @@ _sk_srcout_sse2 LABEL PROC
PUBLIC _sk_dstout_sse2
_sk_dstout_sse2 LABEL PROC
- DB 68,15,40,5,164,95,0,0 ; movaps 0x5fa4(%rip),%xmm8 # 64b0 <_sk_callback_sse2+0x196>
+ DB 68,15,40,5,84,94,0,0 ; movaps 0x5e54(%rip),%xmm8 # 6360 <_sk_callback_sse2+0x18b>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
@@ -23150,7 +22837,7 @@ _sk_dstout_sse2 LABEL PROC
PUBLIC _sk_srcover_sse2
_sk_srcover_sse2 LABEL PROC
- DB 68,15,40,5,135,95,0,0 ; movaps 0x5f87(%rip),%xmm8 # 64c0 <_sk_callback_sse2+0x1a6>
+ DB 68,15,40,5,55,94,0,0 ; movaps 0x5e37(%rip),%xmm8 # 6370 <_sk_callback_sse2+0x19b>
DB 68,15,92,195 ; subps %xmm3,%xmm8
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -23168,7 +22855,7 @@ _sk_srcover_sse2 LABEL PROC
PUBLIC _sk_dstover_sse2
_sk_dstover_sse2 LABEL PROC
- DB 68,15,40,5,91,95,0,0 ; movaps 0x5f5b(%rip),%xmm8 # 64d0 <_sk_callback_sse2+0x1b6>
+ DB 68,15,40,5,11,94,0,0 ; movaps 0x5e0b(%rip),%xmm8 # 6380 <_sk_callback_sse2+0x1ab>
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -23192,7 +22879,7 @@ _sk_modulate_sse2 LABEL PROC
PUBLIC _sk_multiply_sse2
_sk_multiply_sse2 LABEL PROC
- DB 68,15,40,5,47,95,0,0 ; movaps 0x5f2f(%rip),%xmm8 # 64e0 <_sk_callback_sse2+0x1c6>
+ DB 68,15,40,5,223,93,0,0 ; movaps 0x5ddf(%rip),%xmm8 # 6390 <_sk_callback_sse2+0x1bb>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,209 ; movaps %xmm9,%xmm10
@@ -23261,7 +22948,7 @@ _sk_screen_sse2 LABEL PROC
PUBLIC _sk_xor__sse2
_sk_xor__sse2 LABEL PROC
DB 68,15,40,195 ; movaps %xmm3,%xmm8
- DB 15,40,29,100,94,0,0 ; movaps 0x5e64(%rip),%xmm3 # 64f0 <_sk_callback_sse2+0x1d6>
+ DB 15,40,29,20,93,0,0 ; movaps 0x5d14(%rip),%xmm3 # 63a0 <_sk_callback_sse2+0x1cb>
DB 68,15,40,203 ; movaps %xmm3,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 65,15,89,193 ; mulps %xmm9,%xmm0
@@ -23307,7 +22994,7 @@ _sk_darken_sse2 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,95,209 ; maxps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,207,93,0,0 ; movaps 0x5dcf(%rip),%xmm2 # 6500 <_sk_callback_sse2+0x1e6>
+ DB 15,40,21,127,92,0,0 ; movaps 0x5c7f(%rip),%xmm2 # 63b0 <_sk_callback_sse2+0x1db>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -23339,7 +23026,7 @@ _sk_lighten_sse2 LABEL PROC
DB 68,15,89,206 ; mulps %xmm6,%xmm9
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,116,93,0,0 ; movaps 0x5d74(%rip),%xmm2 # 6510 <_sk_callback_sse2+0x1f6>
+ DB 15,40,21,36,92,0,0 ; movaps 0x5c24(%rip),%xmm2 # 63c0 <_sk_callback_sse2+0x1eb>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -23374,7 +23061,7 @@ _sk_difference_sse2 LABEL PROC
DB 65,15,93,209 ; minps %xmm9,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,14,93,0,0 ; movaps 0x5d0e(%rip),%xmm2 # 6520 <_sk_callback_sse2+0x206>
+ DB 15,40,21,190,91,0,0 ; movaps 0x5bbe(%rip),%xmm2 # 63d0 <_sk_callback_sse2+0x1fb>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -23400,7 +23087,7 @@ _sk_exclusion_sse2 LABEL PROC
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 68,15,92,194 ; subps %xmm2,%xmm8
- DB 15,40,21,206,92,0,0 ; movaps 0x5cce(%rip),%xmm2 # 6530 <_sk_callback_sse2+0x216>
+ DB 15,40,21,126,91,0,0 ; movaps 0x5b7e(%rip),%xmm2 # 63e0 <_sk_callback_sse2+0x20b>
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,89,215 ; mulps %xmm7,%xmm2
DB 15,88,218 ; addps %xmm2,%xmm3
@@ -23411,7 +23098,7 @@ _sk_exclusion_sse2 LABEL PROC
PUBLIC _sk_colorburn_sse2
_sk_colorburn_sse2 LABEL PROC
DB 68,15,40,192 ; movaps %xmm0,%xmm8
- DB 68,15,40,21,193,92,0,0 ; movaps 0x5cc1(%rip),%xmm10 # 6540 <_sk_callback_sse2+0x226>
+ DB 68,15,40,21,113,91,0,0 ; movaps 0x5b71(%rip),%xmm10 # 63f0 <_sk_callback_sse2+0x21b>
DB 69,15,40,202 ; movaps %xmm10,%xmm9
DB 68,15,92,207 ; subps %xmm7,%xmm9
DB 69,15,40,217 ; movaps %xmm9,%xmm11
@@ -23503,7 +23190,7 @@ _sk_colorburn_sse2 LABEL PROC
PUBLIC _sk_colordodge_sse2
_sk_colordodge_sse2 LABEL PROC
DB 68,15,40,200 ; movaps %xmm0,%xmm9
- DB 68,15,40,21,119,91,0,0 ; movaps 0x5b77(%rip),%xmm10 # 6550 <_sk_callback_sse2+0x236>
+ DB 68,15,40,21,39,90,0,0 ; movaps 0x5a27(%rip),%xmm10 # 6400 <_sk_callback_sse2+0x22b>
DB 69,15,40,218 ; movaps %xmm10,%xmm11
DB 68,15,92,223 ; subps %xmm7,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
@@ -23596,7 +23283,7 @@ _sk_hardlight_sse2 LABEL PROC
DB 15,41,52,36 ; movaps %xmm6,(%rsp)
DB 15,40,245 ; movaps %xmm5,%xmm6
DB 15,40,236 ; movaps %xmm4,%xmm5
- DB 68,15,40,29,41,90,0,0 ; movaps 0x5a29(%rip),%xmm11 # 6560 <_sk_callback_sse2+0x246>
+ DB 68,15,40,29,217,88,0,0 ; movaps 0x58d9(%rip),%xmm11 # 6410 <_sk_callback_sse2+0x23b>
DB 69,15,40,211 ; movaps %xmm11,%xmm10
DB 68,15,92,215 ; subps %xmm7,%xmm10
DB 69,15,40,194 ; movaps %xmm10,%xmm8
@@ -23683,7 +23370,7 @@ PUBLIC _sk_overlay_sse2
_sk_overlay_sse2 LABEL PROC
DB 68,15,40,193 ; movaps %xmm1,%xmm8
DB 68,15,40,232 ; movaps %xmm0,%xmm13
- DB 68,15,40,13,244,88,0,0 ; movaps 0x58f4(%rip),%xmm9 # 6570 <_sk_callback_sse2+0x256>
+ DB 68,15,40,13,164,87,0,0 ; movaps 0x57a4(%rip),%xmm9 # 6420 <_sk_callback_sse2+0x24b>
DB 69,15,40,209 ; movaps %xmm9,%xmm10
DB 68,15,92,215 ; subps %xmm7,%xmm10
DB 69,15,40,218 ; movaps %xmm10,%xmm11
@@ -23773,7 +23460,7 @@ _sk_softlight_sse2 LABEL PROC
DB 68,15,40,213 ; movaps %xmm5,%xmm10
DB 68,15,94,215 ; divps %xmm7,%xmm10
DB 69,15,84,212 ; andps %xmm12,%xmm10
- DB 68,15,40,13,174,87,0,0 ; movaps 0x57ae(%rip),%xmm9 # 6580 <_sk_callback_sse2+0x266>
+ DB 68,15,40,13,94,86,0,0 ; movaps 0x565e(%rip),%xmm9 # 6430 <_sk_callback_sse2+0x25b>
DB 69,15,40,249 ; movaps %xmm9,%xmm15
DB 69,15,92,250 ; subps %xmm10,%xmm15
DB 69,15,40,218 ; movaps %xmm10,%xmm11
@@ -23786,10 +23473,10 @@ _sk_softlight_sse2 LABEL PROC
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 65,15,88,194 ; addps %xmm10,%xmm0
- DB 68,15,40,53,136,87,0,0 ; movaps 0x5788(%rip),%xmm14 # 6590 <_sk_callback_sse2+0x276>
+ DB 68,15,40,53,56,86,0,0 ; movaps 0x5638(%rip),%xmm14 # 6440 <_sk_callback_sse2+0x26b>
DB 69,15,88,222 ; addps %xmm14,%xmm11
DB 68,15,89,216 ; mulps %xmm0,%xmm11
- DB 68,15,40,21,136,87,0,0 ; movaps 0x5788(%rip),%xmm10 # 65a0 <_sk_callback_sse2+0x286>
+ DB 68,15,40,21,56,86,0,0 ; movaps 0x5638(%rip),%xmm10 # 6450 <_sk_callback_sse2+0x27b>
DB 69,15,89,234 ; mulps %xmm10,%xmm13
DB 69,15,88,235 ; addps %xmm11,%xmm13
DB 15,88,228 ; addps %xmm4,%xmm4
@@ -23934,7 +23621,7 @@ _sk_hue_sse2 LABEL PROC
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 68,15,89,211 ; mulps %xmm3,%xmm10
- DB 68,15,40,5,196,85,0,0 ; movaps 0x55c4(%rip),%xmm8 # 65e0 <_sk_callback_sse2+0x2c6>
+ DB 68,15,40,5,116,84,0,0 ; movaps 0x5474(%rip),%xmm8 # 6490 <_sk_callback_sse2+0x2bb>
DB 69,15,40,216 ; movaps %xmm8,%xmm11
DB 15,40,207 ; movaps %xmm7,%xmm1
DB 68,15,92,217 ; subps %xmm1,%xmm11
@@ -23982,12 +23669,12 @@ _sk_hue_sse2 LABEL PROC
DB 69,15,84,206 ; andps %xmm14,%xmm9
DB 69,15,84,214 ; andps %xmm14,%xmm10
DB 65,15,84,214 ; andps %xmm14,%xmm2
- DB 68,15,40,61,209,84,0,0 ; movaps 0x54d1(%rip),%xmm15 # 65b0 <_sk_callback_sse2+0x296>
+ DB 68,15,40,61,129,83,0,0 ; movaps 0x5381(%rip),%xmm15 # 6460 <_sk_callback_sse2+0x28b>
DB 65,15,89,231 ; mulps %xmm15,%xmm4
- DB 15,40,5,214,84,0,0 ; movaps 0x54d6(%rip),%xmm0 # 65c0 <_sk_callback_sse2+0x2a6>
+ DB 15,40,5,134,83,0,0 ; movaps 0x5386(%rip),%xmm0 # 6470 <_sk_callback_sse2+0x29b>
DB 15,89,240 ; mulps %xmm0,%xmm6
DB 15,88,244 ; addps %xmm4,%xmm6
- DB 68,15,40,53,216,84,0,0 ; movaps 0x54d8(%rip),%xmm14 # 65d0 <_sk_callback_sse2+0x2b6>
+ DB 68,15,40,53,136,83,0,0 ; movaps 0x5388(%rip),%xmm14 # 6480 <_sk_callback_sse2+0x2ab>
DB 68,15,40,239 ; movaps %xmm7,%xmm13
DB 69,15,89,238 ; mulps %xmm14,%xmm13
DB 68,15,88,238 ; addps %xmm6,%xmm13
@@ -24165,14 +23852,14 @@ _sk_saturation_sse2 LABEL PROC
DB 68,15,84,211 ; andps %xmm3,%xmm10
DB 68,15,84,203 ; andps %xmm3,%xmm9
DB 15,84,195 ; andps %xmm3,%xmm0
- DB 68,15,40,5,101,82,0,0 ; movaps 0x5265(%rip),%xmm8 # 65f0 <_sk_callback_sse2+0x2d6>
+ DB 68,15,40,5,21,81,0,0 ; movaps 0x5115(%rip),%xmm8 # 64a0 <_sk_callback_sse2+0x2cb>
DB 15,40,214 ; movaps %xmm6,%xmm2
DB 65,15,89,208 ; mulps %xmm8,%xmm2
- DB 15,40,13,103,82,0,0 ; movaps 0x5267(%rip),%xmm1 # 6600 <_sk_callback_sse2+0x2e6>
+ DB 15,40,13,23,81,0,0 ; movaps 0x5117(%rip),%xmm1 # 64b0 <_sk_callback_sse2+0x2db>
DB 15,40,221 ; movaps %xmm5,%xmm3
DB 15,89,217 ; mulps %xmm1,%xmm3
DB 15,88,218 ; addps %xmm2,%xmm3
- DB 68,15,40,37,102,82,0,0 ; movaps 0x5266(%rip),%xmm12 # 6610 <_sk_callback_sse2+0x2f6>
+ DB 68,15,40,37,22,81,0,0 ; movaps 0x5116(%rip),%xmm12 # 64c0 <_sk_callback_sse2+0x2eb>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
DB 68,15,88,235 ; addps %xmm3,%xmm13
DB 65,15,40,210 ; movaps %xmm10,%xmm2
@@ -24217,7 +23904,7 @@ _sk_saturation_sse2 LABEL PROC
DB 15,40,223 ; movaps %xmm7,%xmm3
DB 15,40,236 ; movaps %xmm4,%xmm5
DB 15,89,221 ; mulps %xmm5,%xmm3
- DB 68,15,40,5,203,81,0,0 ; movaps 0x51cb(%rip),%xmm8 # 6620 <_sk_callback_sse2+0x306>
+ DB 68,15,40,5,123,80,0,0 ; movaps 0x507b(%rip),%xmm8 # 64d0 <_sk_callback_sse2+0x2fb>
DB 65,15,40,224 ; movaps %xmm8,%xmm4
DB 68,15,92,199 ; subps %xmm7,%xmm8
DB 15,88,253 ; addps %xmm5,%xmm7
@@ -24318,14 +24005,14 @@ _sk_color_sse2 LABEL PROC
DB 68,15,40,213 ; movaps %xmm5,%xmm10
DB 69,15,89,208 ; mulps %xmm8,%xmm10
DB 65,15,40,208 ; movaps %xmm8,%xmm2
- DB 68,15,40,45,99,80,0,0 ; movaps 0x5063(%rip),%xmm13 # 6630 <_sk_callback_sse2+0x316>
+ DB 68,15,40,45,19,79,0,0 ; movaps 0x4f13(%rip),%xmm13 # 64e0 <_sk_callback_sse2+0x30b>
DB 68,15,40,198 ; movaps %xmm6,%xmm8
DB 69,15,89,197 ; mulps %xmm13,%xmm8
- DB 68,15,40,53,99,80,0,0 ; movaps 0x5063(%rip),%xmm14 # 6640 <_sk_callback_sse2+0x326>
+ DB 68,15,40,53,19,79,0,0 ; movaps 0x4f13(%rip),%xmm14 # 64f0 <_sk_callback_sse2+0x31b>
DB 65,15,40,195 ; movaps %xmm11,%xmm0
DB 65,15,89,198 ; mulps %xmm14,%xmm0
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,29,95,80,0,0 ; movaps 0x505f(%rip),%xmm11 # 6650 <_sk_callback_sse2+0x336>
+ DB 68,15,40,29,15,79,0,0 ; movaps 0x4f0f(%rip),%xmm11 # 6500 <_sk_callback_sse2+0x32b>
DB 69,15,89,227 ; mulps %xmm11,%xmm12
DB 68,15,88,224 ; addps %xmm0,%xmm12
DB 65,15,40,193 ; movaps %xmm9,%xmm0
@@ -24333,7 +24020,7 @@ _sk_color_sse2 LABEL PROC
DB 69,15,40,250 ; movaps %xmm10,%xmm15
DB 69,15,89,254 ; mulps %xmm14,%xmm15
DB 68,15,88,248 ; addps %xmm0,%xmm15
- DB 68,15,40,5,75,80,0,0 ; movaps 0x504b(%rip),%xmm8 # 6660 <_sk_callback_sse2+0x346>
+ DB 68,15,40,5,251,78,0,0 ; movaps 0x4efb(%rip),%xmm8 # 6510 <_sk_callback_sse2+0x33b>
DB 65,15,40,224 ; movaps %xmm8,%xmm4
DB 15,92,226 ; subps %xmm2,%xmm4
DB 15,89,252 ; mulps %xmm4,%xmm7
@@ -24469,15 +24156,15 @@ _sk_luminosity_sse2 LABEL PROC
DB 68,15,40,205 ; movaps %xmm5,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
DB 15,89,222 ; mulps %xmm6,%xmm3
- DB 68,15,40,37,93,78,0,0 ; movaps 0x4e5d(%rip),%xmm12 # 6670 <_sk_callback_sse2+0x356>
+ DB 68,15,40,37,13,77,0,0 ; movaps 0x4d0d(%rip),%xmm12 # 6520 <_sk_callback_sse2+0x34b>
DB 68,15,40,199 ; movaps %xmm7,%xmm8
DB 69,15,89,196 ; mulps %xmm12,%xmm8
- DB 68,15,40,45,93,78,0,0 ; movaps 0x4e5d(%rip),%xmm13 # 6680 <_sk_callback_sse2+0x366>
+ DB 68,15,40,45,13,77,0,0 ; movaps 0x4d0d(%rip),%xmm13 # 6530 <_sk_callback_sse2+0x35b>
DB 68,15,40,241 ; movaps %xmm1,%xmm14
DB 69,15,89,245 ; mulps %xmm13,%xmm14
DB 69,15,88,240 ; addps %xmm8,%xmm14
- DB 68,15,40,29,89,78,0,0 ; movaps 0x4e59(%rip),%xmm11 # 6690 <_sk_callback_sse2+0x376>
- DB 68,15,40,5,97,78,0,0 ; movaps 0x4e61(%rip),%xmm8 # 66a0 <_sk_callback_sse2+0x386>
+ DB 68,15,40,29,9,77,0,0 ; movaps 0x4d09(%rip),%xmm11 # 6540 <_sk_callback_sse2+0x36b>
+ DB 68,15,40,5,17,77,0,0 ; movaps 0x4d11(%rip),%xmm8 # 6550 <_sk_callback_sse2+0x37b>
DB 69,15,40,248 ; movaps %xmm8,%xmm15
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 68,15,92,248 ; subps %xmm0,%xmm15
@@ -24615,7 +24302,7 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 15,133,227,0,0,0 ; jne 1b19 <_sk_srcover_rgba_8888_sse2+0xf1>
DB 243,68,15,111,4,144 ; movdqu (%rax,%rdx,4),%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 102,15,111,53,105,76,0,0 ; movdqa 0x4c69(%rip),%xmm6 # 66b0 <_sk_callback_sse2+0x396>
+ DB 102,15,111,53,25,75,0,0 ; movdqa 0x4b19(%rip),%xmm6 # 6560 <_sk_callback_sse2+0x38b>
DB 102,65,15,111,224 ; movdqa %xmm8,%xmm4
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
@@ -24629,9 +24316,9 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 15,91,247 ; cvtdq2ps %xmm7,%xmm6
DB 102,65,15,114,208,24 ; psrld $0x18,%xmm8
DB 65,15,91,248 ; cvtdq2ps %xmm8,%xmm7
- DB 68,15,40,5,57,76,0,0 ; movaps 0x4c39(%rip),%xmm8 # 66c0 <_sk_callback_sse2+0x3a6>
+ DB 68,15,40,5,233,74,0,0 ; movaps 0x4ae9(%rip),%xmm8 # 6570 <_sk_callback_sse2+0x39b>
DB 68,15,92,195 ; subps %xmm3,%xmm8
- DB 68,15,40,37,61,76,0,0 ; movaps 0x4c3d(%rip),%xmm12 # 66d0 <_sk_callback_sse2+0x3b6>
+ DB 68,15,40,37,237,74,0,0 ; movaps 0x4aed(%rip),%xmm12 # 6580 <_sk_callback_sse2+0x3ab>
DB 65,15,89,196 ; mulps %xmm12,%xmm0
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 68,15,89,204 ; mulps %xmm4,%xmm9
@@ -24707,7 +24394,7 @@ _sk_clamp_0_sse2 LABEL PROC
PUBLIC _sk_clamp_1_sse2
_sk_clamp_1_sse2 LABEL PROC
- DB 68,15,40,5,46,75,0,0 ; movaps 0x4b2e(%rip),%xmm8 # 66e0 <_sk_callback_sse2+0x3c6>
+ DB 68,15,40,5,222,73,0,0 ; movaps 0x49de(%rip),%xmm8 # 6590 <_sk_callback_sse2+0x3bb>
DB 65,15,93,192 ; minps %xmm8,%xmm0
DB 65,15,93,200 ; minps %xmm8,%xmm1
DB 65,15,93,208 ; minps %xmm8,%xmm2
@@ -24717,7 +24404,7 @@ _sk_clamp_1_sse2 LABEL PROC
PUBLIC _sk_clamp_a_sse2
_sk_clamp_a_sse2 LABEL PROC
- DB 15,93,29,35,75,0,0 ; minps 0x4b23(%rip),%xmm3 # 66f0 <_sk_callback_sse2+0x3d6>
+ DB 15,93,29,211,73,0,0 ; minps 0x49d3(%rip),%xmm3 # 65a0 <_sk_callback_sse2+0x3cb>
DB 15,93,195 ; minps %xmm3,%xmm0
DB 15,93,203 ; minps %xmm3,%xmm1
DB 15,93,211 ; minps %xmm3,%xmm2
@@ -24726,7 +24413,7 @@ _sk_clamp_a_sse2 LABEL PROC
PUBLIC _sk_clamp_a_dst_sse2
_sk_clamp_a_dst_sse2 LABEL PROC
- DB 15,93,61,31,75,0,0 ; minps 0x4b1f(%rip),%xmm7 # 6700 <_sk_callback_sse2+0x3e6>
+ DB 15,93,61,207,73,0,0 ; minps 0x49cf(%rip),%xmm7 # 65b0 <_sk_callback_sse2+0x3db>
DB 15,93,231 ; minps %xmm7,%xmm4
DB 15,93,239 ; minps %xmm7,%xmm5
DB 15,93,247 ; minps %xmm7,%xmm6
@@ -24782,7 +24469,7 @@ _sk_premul_sse2 LABEL PROC
PUBLIC _sk_unpremul_sse2
_sk_unpremul_sse2 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
- DB 68,15,40,13,186,74,0,0 ; movaps 0x4aba(%rip),%xmm9 # 6710 <_sk_callback_sse2+0x3f6>
+ DB 68,15,40,13,106,73,0,0 ; movaps 0x496a(%rip),%xmm9 # 65c0 <_sk_callback_sse2+0x3eb>
DB 68,15,94,203 ; divps %xmm3,%xmm9
DB 68,15,194,195,4 ; cmpneqps %xmm3,%xmm8
DB 69,15,84,193 ; andps %xmm9,%xmm8
@@ -24794,20 +24481,20 @@ _sk_unpremul_sse2 LABEL PROC
PUBLIC _sk_from_srgb_sse2
_sk_from_srgb_sse2 LABEL PROC
- DB 68,15,40,5,165,74,0,0 ; movaps 0x4aa5(%rip),%xmm8 # 6720 <_sk_callback_sse2+0x406>
+ DB 68,15,40,5,85,73,0,0 ; movaps 0x4955(%rip),%xmm8 # 65d0 <_sk_callback_sse2+0x3fb>
DB 68,15,40,232 ; movaps %xmm0,%xmm13
DB 69,15,89,232 ; mulps %xmm8,%xmm13
DB 68,15,40,216 ; movaps %xmm0,%xmm11
DB 69,15,89,219 ; mulps %xmm11,%xmm11
- DB 68,15,40,13,157,74,0,0 ; movaps 0x4a9d(%rip),%xmm9 # 6730 <_sk_callback_sse2+0x416>
+ DB 68,15,40,13,77,73,0,0 ; movaps 0x494d(%rip),%xmm9 # 65e0 <_sk_callback_sse2+0x40b>
DB 68,15,40,240 ; movaps %xmm0,%xmm14
DB 69,15,89,241 ; mulps %xmm9,%xmm14
- DB 68,15,40,21,157,74,0,0 ; movaps 0x4a9d(%rip),%xmm10 # 6740 <_sk_callback_sse2+0x426>
+ DB 68,15,40,21,77,73,0,0 ; movaps 0x494d(%rip),%xmm10 # 65f0 <_sk_callback_sse2+0x41b>
DB 69,15,88,242 ; addps %xmm10,%xmm14
DB 69,15,89,243 ; mulps %xmm11,%xmm14
- DB 68,15,40,29,157,74,0,0 ; movaps 0x4a9d(%rip),%xmm11 # 6750 <_sk_callback_sse2+0x436>
+ DB 68,15,40,29,77,73,0,0 ; movaps 0x494d(%rip),%xmm11 # 6600 <_sk_callback_sse2+0x42b>
DB 69,15,88,243 ; addps %xmm11,%xmm14
- DB 68,15,40,37,161,74,0,0 ; movaps 0x4aa1(%rip),%xmm12 # 6760 <_sk_callback_sse2+0x446>
+ DB 68,15,40,37,81,73,0,0 ; movaps 0x4951(%rip),%xmm12 # 6610 <_sk_callback_sse2+0x43b>
DB 65,15,194,196,1 ; cmpltps %xmm12,%xmm0
DB 68,15,84,232 ; andps %xmm0,%xmm13
DB 65,15,85,198 ; andnps %xmm14,%xmm0
@@ -24841,20 +24528,20 @@ _sk_from_srgb_sse2 LABEL PROC
PUBLIC _sk_from_srgb_dst_sse2
_sk_from_srgb_dst_sse2 LABEL PROC
- DB 68,15,40,5,50,74,0,0 ; movaps 0x4a32(%rip),%xmm8 # 6770 <_sk_callback_sse2+0x456>
+ DB 68,15,40,5,226,72,0,0 ; movaps 0x48e2(%rip),%xmm8 # 6620 <_sk_callback_sse2+0x44b>
DB 68,15,40,236 ; movaps %xmm4,%xmm13
DB 69,15,89,232 ; mulps %xmm8,%xmm13
DB 68,15,40,220 ; movaps %xmm4,%xmm11
DB 69,15,89,219 ; mulps %xmm11,%xmm11
- DB 68,15,40,13,42,74,0,0 ; movaps 0x4a2a(%rip),%xmm9 # 6780 <_sk_callback_sse2+0x466>
+ DB 68,15,40,13,218,72,0,0 ; movaps 0x48da(%rip),%xmm9 # 6630 <_sk_callback_sse2+0x45b>
DB 68,15,40,244 ; movaps %xmm4,%xmm14
DB 69,15,89,241 ; mulps %xmm9,%xmm14
- DB 68,15,40,21,42,74,0,0 ; movaps 0x4a2a(%rip),%xmm10 # 6790 <_sk_callback_sse2+0x476>
+ DB 68,15,40,21,218,72,0,0 ; movaps 0x48da(%rip),%xmm10 # 6640 <_sk_callback_sse2+0x46b>
DB 69,15,88,242 ; addps %xmm10,%xmm14
DB 69,15,89,243 ; mulps %xmm11,%xmm14
- DB 68,15,40,29,42,74,0,0 ; movaps 0x4a2a(%rip),%xmm11 # 67a0 <_sk_callback_sse2+0x486>
+ DB 68,15,40,29,218,72,0,0 ; movaps 0x48da(%rip),%xmm11 # 6650 <_sk_callback_sse2+0x47b>
DB 69,15,88,243 ; addps %xmm11,%xmm14
- DB 68,15,40,37,46,74,0,0 ; movaps 0x4a2e(%rip),%xmm12 # 67b0 <_sk_callback_sse2+0x496>
+ DB 68,15,40,37,222,72,0,0 ; movaps 0x48de(%rip),%xmm12 # 6660 <_sk_callback_sse2+0x48b>
DB 65,15,194,228,1 ; cmpltps %xmm12,%xmm4
DB 68,15,84,236 ; andps %xmm4,%xmm13
DB 65,15,85,230 ; andnps %xmm14,%xmm4
@@ -24889,22 +24576,22 @@ _sk_from_srgb_dst_sse2 LABEL PROC
PUBLIC _sk_to_srgb_sse2
_sk_to_srgb_sse2 LABEL PROC
DB 68,15,82,232 ; rsqrtps %xmm0,%xmm13
- DB 68,15,40,5,187,73,0,0 ; movaps 0x49bb(%rip),%xmm8 # 67c0 <_sk_callback_sse2+0x4a6>
+ DB 68,15,40,5,107,72,0,0 ; movaps 0x486b(%rip),%xmm8 # 6670 <_sk_callback_sse2+0x49b>
DB 68,15,40,240 ; movaps %xmm0,%xmm14
DB 69,15,89,240 ; mulps %xmm8,%xmm14
- DB 68,15,40,13,187,73,0,0 ; movaps 0x49bb(%rip),%xmm9 # 67d0 <_sk_callback_sse2+0x4b6>
+ DB 68,15,40,13,107,72,0,0 ; movaps 0x486b(%rip),%xmm9 # 6680 <_sk_callback_sse2+0x4ab>
DB 69,15,40,253 ; movaps %xmm13,%xmm15
DB 69,15,89,249 ; mulps %xmm9,%xmm15
- DB 68,15,40,21,187,73,0,0 ; movaps 0x49bb(%rip),%xmm10 # 67e0 <_sk_callback_sse2+0x4c6>
+ DB 68,15,40,21,107,72,0,0 ; movaps 0x486b(%rip),%xmm10 # 6690 <_sk_callback_sse2+0x4bb>
DB 69,15,88,250 ; addps %xmm10,%xmm15
DB 69,15,89,253 ; mulps %xmm13,%xmm15
- DB 68,15,40,29,187,73,0,0 ; movaps 0x49bb(%rip),%xmm11 # 67f0 <_sk_callback_sse2+0x4d6>
+ DB 68,15,40,29,107,72,0,0 ; movaps 0x486b(%rip),%xmm11 # 66a0 <_sk_callback_sse2+0x4cb>
DB 69,15,88,251 ; addps %xmm11,%xmm15
- DB 68,15,40,37,191,73,0,0 ; movaps 0x49bf(%rip),%xmm12 # 6800 <_sk_callback_sse2+0x4e6>
+ DB 68,15,40,37,111,72,0,0 ; movaps 0x486f(%rip),%xmm12 # 66b0 <_sk_callback_sse2+0x4db>
DB 69,15,88,236 ; addps %xmm12,%xmm13
DB 69,15,83,237 ; rcpps %xmm13,%xmm13
DB 69,15,89,239 ; mulps %xmm15,%xmm13
- DB 68,15,40,61,187,73,0,0 ; movaps 0x49bb(%rip),%xmm15 # 6810 <_sk_callback_sse2+0x4f6>
+ DB 68,15,40,61,107,72,0,0 ; movaps 0x486b(%rip),%xmm15 # 66c0 <_sk_callback_sse2+0x4eb>
DB 65,15,194,199,1 ; cmpltps %xmm15,%xmm0
DB 68,15,84,240 ; andps %xmm0,%xmm14
DB 65,15,85,197 ; andnps %xmm13,%xmm0
@@ -24952,7 +24639,7 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 68,15,93,218 ; minps %xmm2,%xmm11
DB 65,15,40,202 ; movaps %xmm10,%xmm1
DB 65,15,92,203 ; subps %xmm11,%xmm1
- DB 68,15,40,45,20,73,0,0 ; movaps 0x4914(%rip),%xmm13 # 6820 <_sk_callback_sse2+0x506>
+ DB 68,15,40,45,196,71,0,0 ; movaps 0x47c4(%rip),%xmm13 # 66d0 <_sk_callback_sse2+0x4fb>
DB 68,15,94,233 ; divps %xmm1,%xmm13
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,194,192,0 ; cmpeqps %xmm8,%xmm0
@@ -24961,30 +24648,30 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,40,241 ; movaps %xmm9,%xmm14
DB 68,15,194,242,1 ; cmpltps %xmm2,%xmm14
- DB 68,15,84,53,250,72,0,0 ; andps 0x48fa(%rip),%xmm14 # 6830 <_sk_callback_sse2+0x516>
+ DB 68,15,84,53,170,71,0,0 ; andps 0x47aa(%rip),%xmm14 # 66e0 <_sk_callback_sse2+0x50b>
DB 69,15,88,244 ; addps %xmm12,%xmm14
DB 69,15,40,250 ; movaps %xmm10,%xmm15
DB 69,15,194,249,0 ; cmpeqps %xmm9,%xmm15
DB 65,15,92,208 ; subps %xmm8,%xmm2
DB 65,15,89,213 ; mulps %xmm13,%xmm2
- DB 68,15,40,37,237,72,0,0 ; movaps 0x48ed(%rip),%xmm12 # 6840 <_sk_callback_sse2+0x526>
+ DB 68,15,40,37,157,71,0,0 ; movaps 0x479d(%rip),%xmm12 # 66f0 <_sk_callback_sse2+0x51b>
DB 65,15,88,212 ; addps %xmm12,%xmm2
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 69,15,89,197 ; mulps %xmm13,%xmm8
- DB 68,15,88,5,233,72,0,0 ; addps 0x48e9(%rip),%xmm8 # 6850 <_sk_callback_sse2+0x536>
+ DB 68,15,88,5,153,71,0,0 ; addps 0x4799(%rip),%xmm8 # 6700 <_sk_callback_sse2+0x52b>
DB 65,15,84,215 ; andps %xmm15,%xmm2
DB 69,15,85,248 ; andnps %xmm8,%xmm15
DB 68,15,86,250 ; orps %xmm2,%xmm15
DB 68,15,84,240 ; andps %xmm0,%xmm14
DB 65,15,85,199 ; andnps %xmm15,%xmm0
DB 65,15,86,198 ; orps %xmm14,%xmm0
- DB 15,89,5,218,72,0,0 ; mulps 0x48da(%rip),%xmm0 # 6860 <_sk_callback_sse2+0x546>
+ DB 15,89,5,138,71,0,0 ; mulps 0x478a(%rip),%xmm0 # 6710 <_sk_callback_sse2+0x53b>
DB 69,15,40,194 ; movaps %xmm10,%xmm8
DB 69,15,194,195,4 ; cmpneqps %xmm11,%xmm8
DB 65,15,84,192 ; andps %xmm8,%xmm0
DB 69,15,92,226 ; subps %xmm10,%xmm12
DB 69,15,88,211 ; addps %xmm11,%xmm10
- DB 68,15,40,13,205,72,0,0 ; movaps 0x48cd(%rip),%xmm9 # 6870 <_sk_callback_sse2+0x556>
+ DB 68,15,40,13,125,71,0,0 ; movaps 0x477d(%rip),%xmm9 # 6720 <_sk_callback_sse2+0x54b>
DB 65,15,40,210 ; movaps %xmm10,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 68,15,194,202,1 ; cmpltps %xmm2,%xmm9
@@ -25007,7 +24694,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,41,92,36,32 ; movaps %xmm3,0x20(%rsp)
DB 68,15,40,218 ; movaps %xmm2,%xmm11
DB 15,40,240 ; movaps %xmm0,%xmm6
- DB 68,15,40,13,136,72,0,0 ; movaps 0x4888(%rip),%xmm9 # 6880 <_sk_callback_sse2+0x566>
+ DB 68,15,40,13,56,71,0,0 ; movaps 0x4738(%rip),%xmm9 # 6730 <_sk_callback_sse2+0x55b>
DB 69,15,40,209 ; movaps %xmm9,%xmm10
DB 69,15,194,211,2 ; cmpleps %xmm11,%xmm10
DB 15,40,193 ; movaps %xmm1,%xmm0
@@ -25024,28 +24711,28 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 69,15,88,211 ; addps %xmm11,%xmm10
DB 69,15,88,219 ; addps %xmm11,%xmm11
DB 69,15,92,218 ; subps %xmm10,%xmm11
- DB 15,40,5,82,72,0,0 ; movaps 0x4852(%rip),%xmm0 # 6890 <_sk_callback_sse2+0x576>
+ DB 15,40,5,2,71,0,0 ; movaps 0x4702(%rip),%xmm0 # 6740 <_sk_callback_sse2+0x56b>
DB 15,88,198 ; addps %xmm6,%xmm0
DB 243,15,91,200 ; cvttps2dq %xmm0,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
DB 15,40,216 ; movaps %xmm0,%xmm3
DB 15,194,217,1 ; cmpltps %xmm1,%xmm3
- DB 15,84,29,74,72,0,0 ; andps 0x484a(%rip),%xmm3 # 68a0 <_sk_callback_sse2+0x586>
+ DB 15,84,29,250,70,0,0 ; andps 0x46fa(%rip),%xmm3 # 6750 <_sk_callback_sse2+0x57b>
DB 15,92,203 ; subps %xmm3,%xmm1
DB 15,92,193 ; subps %xmm1,%xmm0
- DB 68,15,40,45,76,72,0,0 ; movaps 0x484c(%rip),%xmm13 # 68b0 <_sk_callback_sse2+0x596>
+ DB 68,15,40,45,252,70,0,0 ; movaps 0x46fc(%rip),%xmm13 # 6760 <_sk_callback_sse2+0x58b>
DB 69,15,40,197 ; movaps %xmm13,%xmm8
DB 68,15,194,192,2 ; cmpleps %xmm0,%xmm8
DB 69,15,40,242 ; movaps %xmm10,%xmm14
DB 69,15,92,243 ; subps %xmm11,%xmm14
DB 65,15,40,217 ; movaps %xmm9,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
- DB 15,40,21,92,72,0,0 ; movaps 0x485c(%rip),%xmm2 # 68e0 <_sk_callback_sse2+0x5c6>
+ DB 15,40,21,12,71,0,0 ; movaps 0x470c(%rip),%xmm2 # 6790 <_sk_callback_sse2+0x5bb>
DB 68,15,40,250 ; movaps %xmm2,%xmm15
DB 68,15,194,248,2 ; cmpleps %xmm0,%xmm15
- DB 15,40,13,44,72,0,0 ; movaps 0x482c(%rip),%xmm1 # 68c0 <_sk_callback_sse2+0x5a6>
+ DB 15,40,13,220,70,0,0 ; movaps 0x46dc(%rip),%xmm1 # 6770 <_sk_callback_sse2+0x59b>
DB 15,89,193 ; mulps %xmm1,%xmm0
- DB 15,40,45,50,72,0,0 ; movaps 0x4832(%rip),%xmm5 # 68d0 <_sk_callback_sse2+0x5b6>
+ DB 15,40,45,226,70,0,0 ; movaps 0x46e2(%rip),%xmm5 # 6780 <_sk_callback_sse2+0x5ab>
DB 15,40,229 ; movaps %xmm5,%xmm4
DB 15,92,224 ; subps %xmm0,%xmm4
DB 65,15,89,230 ; mulps %xmm14,%xmm4
@@ -25068,7 +24755,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,222 ; movaps %xmm6,%xmm3
DB 15,194,216,1 ; cmpltps %xmm0,%xmm3
- DB 15,84,29,167,71,0,0 ; andps 0x47a7(%rip),%xmm3 # 68a0 <_sk_callback_sse2+0x586>
+ DB 15,84,29,87,70,0,0 ; andps 0x4657(%rip),%xmm3 # 6750 <_sk_callback_sse2+0x57b>
DB 15,92,195 ; subps %xmm3,%xmm0
DB 68,15,40,230 ; movaps %xmm6,%xmm12
DB 68,15,92,224 ; subps %xmm0,%xmm12
@@ -25098,12 +24785,12 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,40,60,36 ; movaps (%rsp),%xmm7
DB 15,40,231 ; movaps %xmm7,%xmm4
DB 15,85,227 ; andnps %xmm3,%xmm4
- DB 15,88,53,128,71,0,0 ; addps 0x4780(%rip),%xmm6 # 68f0 <_sk_callback_sse2+0x5d6>
+ DB 15,88,53,48,70,0,0 ; addps 0x4630(%rip),%xmm6 # 67a0 <_sk_callback_sse2+0x5cb>
DB 243,15,91,198 ; cvttps2dq %xmm6,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,222 ; movaps %xmm6,%xmm3
DB 15,194,216,1 ; cmpltps %xmm0,%xmm3
- DB 15,84,29,27,71,0,0 ; andps 0x471b(%rip),%xmm3 # 68a0 <_sk_callback_sse2+0x586>
+ DB 15,84,29,203,69,0,0 ; andps 0x45cb(%rip),%xmm3 # 6750 <_sk_callback_sse2+0x57b>
DB 15,92,195 ; subps %xmm3,%xmm0
DB 15,92,240 ; subps %xmm0,%xmm6
DB 15,89,206 ; mulps %xmm6,%xmm1
@@ -25164,9 +24851,9 @@ _sk_scale_u8_sse2 LABEL PROC
DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8
DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 102,68,15,219,5,168,70,0,0 ; pand 0x46a8(%rip),%xmm8 # 6900 <_sk_callback_sse2+0x5e6>
+ DB 102,68,15,219,5,88,69,0,0 ; pand 0x4558(%rip),%xmm8 # 67b0 <_sk_callback_sse2+0x5db>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,172,70,0,0 ; mulps 0x46ac(%rip),%xmm8 # 6910 <_sk_callback_sse2+0x5f6>
+ DB 68,15,89,5,92,69,0,0 ; mulps 0x455c(%rip),%xmm8 # 67c0 <_sk_callback_sse2+0x5eb>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
@@ -25225,9 +24912,9 @@ _sk_lerp_u8_sse2 LABEL PROC
DB 102,69,15,110,4,18 ; movd (%r10,%rdx,1),%xmm8
DB 102,68,15,96,192 ; punpcklbw %xmm0,%xmm8
DB 102,68,15,97,192 ; punpcklwd %xmm0,%xmm8
- DB 102,68,15,219,5,240,69,0,0 ; pand 0x45f0(%rip),%xmm8 # 6920 <_sk_callback_sse2+0x606>
+ DB 102,68,15,219,5,160,68,0,0 ; pand 0x44a0(%rip),%xmm8 # 67d0 <_sk_callback_sse2+0x5fb>
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,244,69,0,0 ; mulps 0x45f4(%rip),%xmm8 # 6930 <_sk_callback_sse2+0x616>
+ DB 68,15,89,5,164,68,0,0 ; mulps 0x44a4(%rip),%xmm8 # 67e0 <_sk_callback_sse2+0x60b>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -25272,17 +24959,17 @@ _sk_lerp_565_sse2 LABEL PROC
DB 15,133,156,0,0,0 ; jne 246e <_sk_lerp_565_sse2+0xaa>
DB 243,69,15,126,12,82 ; movq (%r10,%rdx,2),%xmm9
DB 102,68,15,97,200 ; punpcklwd %xmm0,%xmm9
- DB 102,68,15,111,5,90,69,0,0 ; movdqa 0x455a(%rip),%xmm8 # 6940 <_sk_callback_sse2+0x626>
+ DB 102,68,15,111,5,10,68,0,0 ; movdqa 0x440a(%rip),%xmm8 # 67f0 <_sk_callback_sse2+0x61b>
DB 102,69,15,219,193 ; pand %xmm9,%xmm8
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
- DB 68,15,89,5,89,69,0,0 ; mulps 0x4559(%rip),%xmm8 # 6950 <_sk_callback_sse2+0x636>
- DB 102,68,15,111,21,96,69,0,0 ; movdqa 0x4560(%rip),%xmm10 # 6960 <_sk_callback_sse2+0x646>
+ DB 68,15,89,5,9,68,0,0 ; mulps 0x4409(%rip),%xmm8 # 6800 <_sk_callback_sse2+0x62b>
+ DB 102,68,15,111,21,16,68,0,0 ; movdqa 0x4410(%rip),%xmm10 # 6810 <_sk_callback_sse2+0x63b>
DB 102,69,15,219,209 ; pand %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
- DB 68,15,89,21,95,69,0,0 ; mulps 0x455f(%rip),%xmm10 # 6970 <_sk_callback_sse2+0x656>
- DB 102,68,15,219,13,102,69,0,0 ; pand 0x4566(%rip),%xmm9 # 6980 <_sk_callback_sse2+0x666>
+ DB 68,15,89,21,15,68,0,0 ; mulps 0x440f(%rip),%xmm10 # 6820 <_sk_callback_sse2+0x64b>
+ DB 102,68,15,219,13,22,68,0,0 ; pand 0x4416(%rip),%xmm9 # 6830 <_sk_callback_sse2+0x65b>
DB 69,15,91,201 ; cvtdq2ps %xmm9,%xmm9
- DB 68,15,89,13,106,69,0,0 ; mulps 0x456a(%rip),%xmm9 # 6990 <_sk_callback_sse2+0x676>
+ DB 68,15,89,13,26,68,0,0 ; mulps 0x441a(%rip),%xmm9 # 6840 <_sk_callback_sse2+0x66b>
DB 15,92,196 ; subps %xmm4,%xmm0
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
@@ -25334,7 +25021,7 @@ _sk_load_tables_sse2 LABEL PROC
DB 65,87 ; push %r15
DB 65,86 ; push %r14
DB 83 ; push %rbx
- DB 102,68,15,111,5,185,68,0,0 ; movdqa 0x44b9(%rip),%xmm8 # 69a0 <_sk_callback_sse2+0x686>
+ DB 102,68,15,111,5,105,67,0,0 ; movdqa 0x4369(%rip),%xmm8 # 6850 <_sk_callback_sse2+0x67b>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
@@ -25390,7 +25077,7 @@ _sk_load_tables_sse2 LABEL PROC
DB 65,15,20,208 ; unpcklps %xmm8,%xmm2
DB 102,65,15,114,209,24 ; psrld $0x18,%xmm9
DB 65,15,91,217 ; cvtdq2ps %xmm9,%xmm3
- DB 15,89,29,194,67,0,0 ; mulps 0x43c2(%rip),%xmm3 # 69b0 <_sk_callback_sse2+0x696>
+ DB 15,89,29,114,66,0,0 ; mulps 0x4272(%rip),%xmm3 # 6860 <_sk_callback_sse2+0x68b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
@@ -25430,7 +25117,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,97,200 ; punpcklwd %xmm0,%xmm1
DB 102,68,15,105,200 ; punpckhwd %xmm0,%xmm9
- DB 102,68,15,111,21,55,67,0,0 ; movdqa 0x4337(%rip),%xmm10 # 69c0 <_sk_callback_sse2+0x6a6>
+ DB 102,68,15,111,21,231,65,0,0 ; movdqa 0x41e7(%rip),%xmm10 # 6870 <_sk_callback_sse2+0x69b>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,194 ; pand %xmm10,%xmm0
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
@@ -25492,7 +25179,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 102,65,15,235,217 ; por %xmm9,%xmm3
DB 102,65,15,97,216 ; punpcklwd %xmm8,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,34,66,0,0 ; mulps 0x4222(%rip),%xmm3 # 69d0 <_sk_callback_sse2+0x6b6>
+ DB 15,89,29,210,64,0,0 ; mulps 0x40d2(%rip),%xmm3 # 6880 <_sk_callback_sse2+0x6ab>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
@@ -25533,7 +25220,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC
DB 102,68,15,97,208 ; punpcklwd %xmm0,%xmm10
DB 102,65,15,111,195 ; movdqa %xmm11,%xmm0
DB 102,65,15,97,194 ; punpcklwd %xmm10,%xmm0
- DB 102,68,15,111,5,145,65,0,0 ; movdqa 0x4191(%rip),%xmm8 # 69e0 <_sk_callback_sse2+0x6c6>
+ DB 102,68,15,111,5,65,64,0,0 ; movdqa 0x4041(%rip),%xmm8 # 6890 <_sk_callback_sse2+0x6bb>
DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
DB 102,65,15,219,192 ; pand %xmm8,%xmm0
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
@@ -25589,7 +25276,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC
DB 15,20,211 ; unpcklps %xmm3,%xmm2
DB 65,15,20,208 ; unpcklps %xmm8,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,156,64,0,0 ; movaps 0x409c(%rip),%xmm3 # 69f0 <_sk_callback_sse2+0x6d6>
+ DB 15,40,29,76,63,0,0 ; movaps 0x3f4c(%rip),%xmm3 # 68a0 <_sk_callback_sse2+0x6cb>
DB 91 ; pop %rbx
DB 65,94 ; pop %r14
DB 65,95 ; pop %r15
@@ -25621,7 +25308,7 @@ _sk_byte_tables_sse2 LABEL PROC
DB 65,86 ; push %r14
DB 83 ; push %rbx
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,53,64,0,0 ; movaps 0x4035(%rip),%xmm8 # 6a00 <_sk_callback_sse2+0x6e6>
+ DB 68,15,40,5,229,62,0,0 ; movaps 0x3ee5(%rip),%xmm8 # 68b0 <_sk_callback_sse2+0x6db>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
DB 102,73,15,126,193 ; movq %xmm0,%r9
@@ -25649,7 +25336,7 @@ _sk_byte_tables_sse2 LABEL PROC
DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0
DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,21,207,63,0,0 ; movaps 0x3fcf(%rip),%xmm10 # 6a10 <_sk_callback_sse2+0x6f6>
+ DB 68,15,40,21,127,62,0,0 ; movaps 0x3e7f(%rip),%xmm10 # 68c0 <_sk_callback_sse2+0x6eb>
DB 65,15,89,194 ; mulps %xmm10,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
@@ -25768,7 +25455,7 @@ _sk_byte_tables_rgb_sse2 LABEL PROC
DB 102,65,15,96,193 ; punpcklbw %xmm9,%xmm0
DB 102,65,15,97,193 ; punpcklwd %xmm9,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,21,23,62,0,0 ; movaps 0x3e17(%rip),%xmm10 # 6a20 <_sk_callback_sse2+0x706>
+ DB 68,15,40,21,199,60,0,0 ; movaps 0x3cc7(%rip),%xmm10 # 68d0 <_sk_callback_sse2+0x6fb>
DB 65,15,89,194 ; mulps %xmm10,%xmm0
DB 65,15,89,200 ; mulps %xmm8,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
@@ -25965,15 +25652,15 @@ _sk_parametric_r_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,75,59,0,0 ; mulps 0x3b4b(%rip),%xmm9 # 6a30 <_sk_callback_sse2+0x716>
- DB 68,15,84,21,83,59,0,0 ; andps 0x3b53(%rip),%xmm10 # 6a40 <_sk_callback_sse2+0x726>
- DB 68,15,86,21,91,59,0,0 ; orps 0x3b5b(%rip),%xmm10 # 6a50 <_sk_callback_sse2+0x736>
- DB 68,15,88,13,99,59,0,0 ; addps 0x3b63(%rip),%xmm9 # 6a60 <_sk_callback_sse2+0x746>
- DB 68,15,40,37,107,59,0,0 ; movaps 0x3b6b(%rip),%xmm12 # 6a70 <_sk_callback_sse2+0x756>
+ DB 68,15,89,13,251,57,0,0 ; mulps 0x39fb(%rip),%xmm9 # 68e0 <_sk_callback_sse2+0x70b>
+ DB 68,15,84,21,3,58,0,0 ; andps 0x3a03(%rip),%xmm10 # 68f0 <_sk_callback_sse2+0x71b>
+ DB 68,15,86,21,11,58,0,0 ; orps 0x3a0b(%rip),%xmm10 # 6900 <_sk_callback_sse2+0x72b>
+ DB 68,15,88,13,19,58,0,0 ; addps 0x3a13(%rip),%xmm9 # 6910 <_sk_callback_sse2+0x73b>
+ DB 68,15,40,37,27,58,0,0 ; movaps 0x3a1b(%rip),%xmm12 # 6920 <_sk_callback_sse2+0x74b>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,107,59,0,0 ; addps 0x3b6b(%rip),%xmm10 # 6a80 <_sk_callback_sse2+0x766>
- DB 68,15,40,37,115,59,0,0 ; movaps 0x3b73(%rip),%xmm12 # 6a90 <_sk_callback_sse2+0x776>
+ DB 68,15,88,21,27,58,0,0 ; addps 0x3a1b(%rip),%xmm10 # 6930 <_sk_callback_sse2+0x75b>
+ DB 68,15,40,37,35,58,0,0 ; movaps 0x3a23(%rip),%xmm12 # 6940 <_sk_callback_sse2+0x76b>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -25981,22 +25668,22 @@ _sk_parametric_r_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,93,59,0,0 ; movaps 0x3b5d(%rip),%xmm10 # 6aa0 <_sk_callback_sse2+0x786>
+ DB 68,15,40,21,13,58,0,0 ; movaps 0x3a0d(%rip),%xmm10 # 6950 <_sk_callback_sse2+0x77b>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,81,59,0,0 ; addps 0x3b51(%rip),%xmm9 # 6ab0 <_sk_callback_sse2+0x796>
- DB 68,15,40,37,89,59,0,0 ; movaps 0x3b59(%rip),%xmm12 # 6ac0 <_sk_callback_sse2+0x7a6>
+ DB 68,15,88,13,1,58,0,0 ; addps 0x3a01(%rip),%xmm9 # 6960 <_sk_callback_sse2+0x78b>
+ DB 68,15,40,37,9,58,0,0 ; movaps 0x3a09(%rip),%xmm12 # 6970 <_sk_callback_sse2+0x79b>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,89,59,0,0 ; movaps 0x3b59(%rip),%xmm12 # 6ad0 <_sk_callback_sse2+0x7b6>
+ DB 68,15,40,37,9,58,0,0 ; movaps 0x3a09(%rip),%xmm12 # 6980 <_sk_callback_sse2+0x7ab>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,93,59,0,0 ; movaps 0x3b5d(%rip),%xmm13 # 6ae0 <_sk_callback_sse2+0x7c6>
+ DB 68,15,40,45,13,58,0,0 ; movaps 0x3a0d(%rip),%xmm13 # 6990 <_sk_callback_sse2+0x7bb>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,93,59,0,0 ; mulps 0x3b5d(%rip),%xmm13 # 6af0 <_sk_callback_sse2+0x7d6>
+ DB 68,15,89,45,13,58,0,0 ; mulps 0x3a0d(%rip),%xmm13 # 69a0 <_sk_callback_sse2+0x7cb>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -26030,15 +25717,15 @@ _sk_parametric_g_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,221,58,0,0 ; mulps 0x3add(%rip),%xmm9 # 6b00 <_sk_callback_sse2+0x7e6>
- DB 68,15,84,21,229,58,0,0 ; andps 0x3ae5(%rip),%xmm10 # 6b10 <_sk_callback_sse2+0x7f6>
- DB 68,15,86,21,237,58,0,0 ; orps 0x3aed(%rip),%xmm10 # 6b20 <_sk_callback_sse2+0x806>
- DB 68,15,88,13,245,58,0,0 ; addps 0x3af5(%rip),%xmm9 # 6b30 <_sk_callback_sse2+0x816>
- DB 68,15,40,37,253,58,0,0 ; movaps 0x3afd(%rip),%xmm12 # 6b40 <_sk_callback_sse2+0x826>
+ DB 68,15,89,13,141,57,0,0 ; mulps 0x398d(%rip),%xmm9 # 69b0 <_sk_callback_sse2+0x7db>
+ DB 68,15,84,21,149,57,0,0 ; andps 0x3995(%rip),%xmm10 # 69c0 <_sk_callback_sse2+0x7eb>
+ DB 68,15,86,21,157,57,0,0 ; orps 0x399d(%rip),%xmm10 # 69d0 <_sk_callback_sse2+0x7fb>
+ DB 68,15,88,13,165,57,0,0 ; addps 0x39a5(%rip),%xmm9 # 69e0 <_sk_callback_sse2+0x80b>
+ DB 68,15,40,37,173,57,0,0 ; movaps 0x39ad(%rip),%xmm12 # 69f0 <_sk_callback_sse2+0x81b>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,253,58,0,0 ; addps 0x3afd(%rip),%xmm10 # 6b50 <_sk_callback_sse2+0x836>
- DB 68,15,40,37,5,59,0,0 ; movaps 0x3b05(%rip),%xmm12 # 6b60 <_sk_callback_sse2+0x846>
+ DB 68,15,88,21,173,57,0,0 ; addps 0x39ad(%rip),%xmm10 # 6a00 <_sk_callback_sse2+0x82b>
+ DB 68,15,40,37,181,57,0,0 ; movaps 0x39b5(%rip),%xmm12 # 6a10 <_sk_callback_sse2+0x83b>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -26046,22 +25733,22 @@ _sk_parametric_g_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,239,58,0,0 ; movaps 0x3aef(%rip),%xmm10 # 6b70 <_sk_callback_sse2+0x856>
+ DB 68,15,40,21,159,57,0,0 ; movaps 0x399f(%rip),%xmm10 # 6a20 <_sk_callback_sse2+0x84b>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,227,58,0,0 ; addps 0x3ae3(%rip),%xmm9 # 6b80 <_sk_callback_sse2+0x866>
- DB 68,15,40,37,235,58,0,0 ; movaps 0x3aeb(%rip),%xmm12 # 6b90 <_sk_callback_sse2+0x876>
+ DB 68,15,88,13,147,57,0,0 ; addps 0x3993(%rip),%xmm9 # 6a30 <_sk_callback_sse2+0x85b>
+ DB 68,15,40,37,155,57,0,0 ; movaps 0x399b(%rip),%xmm12 # 6a40 <_sk_callback_sse2+0x86b>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,235,58,0,0 ; movaps 0x3aeb(%rip),%xmm12 # 6ba0 <_sk_callback_sse2+0x886>
+ DB 68,15,40,37,155,57,0,0 ; movaps 0x399b(%rip),%xmm12 # 6a50 <_sk_callback_sse2+0x87b>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,239,58,0,0 ; movaps 0x3aef(%rip),%xmm13 # 6bb0 <_sk_callback_sse2+0x896>
+ DB 68,15,40,45,159,57,0,0 ; movaps 0x399f(%rip),%xmm13 # 6a60 <_sk_callback_sse2+0x88b>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,239,58,0,0 ; mulps 0x3aef(%rip),%xmm13 # 6bc0 <_sk_callback_sse2+0x8a6>
+ DB 68,15,89,45,159,57,0,0 ; mulps 0x399f(%rip),%xmm13 # 6a70 <_sk_callback_sse2+0x89b>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -26095,15 +25782,15 @@ _sk_parametric_b_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,111,58,0,0 ; mulps 0x3a6f(%rip),%xmm9 # 6bd0 <_sk_callback_sse2+0x8b6>
- DB 68,15,84,21,119,58,0,0 ; andps 0x3a77(%rip),%xmm10 # 6be0 <_sk_callback_sse2+0x8c6>
- DB 68,15,86,21,127,58,0,0 ; orps 0x3a7f(%rip),%xmm10 # 6bf0 <_sk_callback_sse2+0x8d6>
- DB 68,15,88,13,135,58,0,0 ; addps 0x3a87(%rip),%xmm9 # 6c00 <_sk_callback_sse2+0x8e6>
- DB 68,15,40,37,143,58,0,0 ; movaps 0x3a8f(%rip),%xmm12 # 6c10 <_sk_callback_sse2+0x8f6>
+ DB 68,15,89,13,31,57,0,0 ; mulps 0x391f(%rip),%xmm9 # 6a80 <_sk_callback_sse2+0x8ab>
+ DB 68,15,84,21,39,57,0,0 ; andps 0x3927(%rip),%xmm10 # 6a90 <_sk_callback_sse2+0x8bb>
+ DB 68,15,86,21,47,57,0,0 ; orps 0x392f(%rip),%xmm10 # 6aa0 <_sk_callback_sse2+0x8cb>
+ DB 68,15,88,13,55,57,0,0 ; addps 0x3937(%rip),%xmm9 # 6ab0 <_sk_callback_sse2+0x8db>
+ DB 68,15,40,37,63,57,0,0 ; movaps 0x393f(%rip),%xmm12 # 6ac0 <_sk_callback_sse2+0x8eb>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,143,58,0,0 ; addps 0x3a8f(%rip),%xmm10 # 6c20 <_sk_callback_sse2+0x906>
- DB 68,15,40,37,151,58,0,0 ; movaps 0x3a97(%rip),%xmm12 # 6c30 <_sk_callback_sse2+0x916>
+ DB 68,15,88,21,63,57,0,0 ; addps 0x393f(%rip),%xmm10 # 6ad0 <_sk_callback_sse2+0x8fb>
+ DB 68,15,40,37,71,57,0,0 ; movaps 0x3947(%rip),%xmm12 # 6ae0 <_sk_callback_sse2+0x90b>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -26111,22 +25798,22 @@ _sk_parametric_b_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,129,58,0,0 ; movaps 0x3a81(%rip),%xmm10 # 6c40 <_sk_callback_sse2+0x926>
+ DB 68,15,40,21,49,57,0,0 ; movaps 0x3931(%rip),%xmm10 # 6af0 <_sk_callback_sse2+0x91b>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,117,58,0,0 ; addps 0x3a75(%rip),%xmm9 # 6c50 <_sk_callback_sse2+0x936>
- DB 68,15,40,37,125,58,0,0 ; movaps 0x3a7d(%rip),%xmm12 # 6c60 <_sk_callback_sse2+0x946>
+ DB 68,15,88,13,37,57,0,0 ; addps 0x3925(%rip),%xmm9 # 6b00 <_sk_callback_sse2+0x92b>
+ DB 68,15,40,37,45,57,0,0 ; movaps 0x392d(%rip),%xmm12 # 6b10 <_sk_callback_sse2+0x93b>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,125,58,0,0 ; movaps 0x3a7d(%rip),%xmm12 # 6c70 <_sk_callback_sse2+0x956>
+ DB 68,15,40,37,45,57,0,0 ; movaps 0x392d(%rip),%xmm12 # 6b20 <_sk_callback_sse2+0x94b>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,129,58,0,0 ; movaps 0x3a81(%rip),%xmm13 # 6c80 <_sk_callback_sse2+0x966>
+ DB 68,15,40,45,49,57,0,0 ; movaps 0x3931(%rip),%xmm13 # 6b30 <_sk_callback_sse2+0x95b>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,129,58,0,0 ; mulps 0x3a81(%rip),%xmm13 # 6c90 <_sk_callback_sse2+0x976>
+ DB 68,15,89,45,49,57,0,0 ; mulps 0x3931(%rip),%xmm13 # 6b40 <_sk_callback_sse2+0x96b>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -26160,15 +25847,15 @@ _sk_parametric_a_sse2 LABEL PROC
DB 69,15,88,209 ; addps %xmm9,%xmm10
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,91,202 ; cvtdq2ps %xmm10,%xmm9
- DB 68,15,89,13,1,58,0,0 ; mulps 0x3a01(%rip),%xmm9 # 6ca0 <_sk_callback_sse2+0x986>
- DB 68,15,84,21,9,58,0,0 ; andps 0x3a09(%rip),%xmm10 # 6cb0 <_sk_callback_sse2+0x996>
- DB 68,15,86,21,17,58,0,0 ; orps 0x3a11(%rip),%xmm10 # 6cc0 <_sk_callback_sse2+0x9a6>
- DB 68,15,88,13,25,58,0,0 ; addps 0x3a19(%rip),%xmm9 # 6cd0 <_sk_callback_sse2+0x9b6>
- DB 68,15,40,37,33,58,0,0 ; movaps 0x3a21(%rip),%xmm12 # 6ce0 <_sk_callback_sse2+0x9c6>
+ DB 68,15,89,13,177,56,0,0 ; mulps 0x38b1(%rip),%xmm9 # 6b50 <_sk_callback_sse2+0x97b>
+ DB 68,15,84,21,185,56,0,0 ; andps 0x38b9(%rip),%xmm10 # 6b60 <_sk_callback_sse2+0x98b>
+ DB 68,15,86,21,193,56,0,0 ; orps 0x38c1(%rip),%xmm10 # 6b70 <_sk_callback_sse2+0x99b>
+ DB 68,15,88,13,201,56,0,0 ; addps 0x38c9(%rip),%xmm9 # 6b80 <_sk_callback_sse2+0x9ab>
+ DB 68,15,40,37,209,56,0,0 ; movaps 0x38d1(%rip),%xmm12 # 6b90 <_sk_callback_sse2+0x9bb>
DB 69,15,89,226 ; mulps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,88,21,33,58,0,0 ; addps 0x3a21(%rip),%xmm10 # 6cf0 <_sk_callback_sse2+0x9d6>
- DB 68,15,40,37,41,58,0,0 ; movaps 0x3a29(%rip),%xmm12 # 6d00 <_sk_callback_sse2+0x9e6>
+ DB 68,15,88,21,209,56,0,0 ; addps 0x38d1(%rip),%xmm10 # 6ba0 <_sk_callback_sse2+0x9cb>
+ DB 68,15,40,37,217,56,0,0 ; movaps 0x38d9(%rip),%xmm12 # 6bb0 <_sk_callback_sse2+0x9db>
DB 69,15,94,226 ; divps %xmm10,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
DB 69,15,89,203 ; mulps %xmm11,%xmm9
@@ -26176,22 +25863,22 @@ _sk_parametric_a_sse2 LABEL PROC
DB 69,15,91,226 ; cvtdq2ps %xmm10,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,194,236,1 ; cmpltps %xmm12,%xmm13
- DB 68,15,40,21,19,58,0,0 ; movaps 0x3a13(%rip),%xmm10 # 6d10 <_sk_callback_sse2+0x9f6>
+ DB 68,15,40,21,195,56,0,0 ; movaps 0x38c3(%rip),%xmm10 # 6bc0 <_sk_callback_sse2+0x9eb>
DB 69,15,84,234 ; andps %xmm10,%xmm13
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,229 ; subps %xmm13,%xmm12
DB 69,15,40,233 ; movaps %xmm9,%xmm13
DB 69,15,92,236 ; subps %xmm12,%xmm13
- DB 68,15,88,13,7,58,0,0 ; addps 0x3a07(%rip),%xmm9 # 6d20 <_sk_callback_sse2+0xa06>
- DB 68,15,40,37,15,58,0,0 ; movaps 0x3a0f(%rip),%xmm12 # 6d30 <_sk_callback_sse2+0xa16>
+ DB 68,15,88,13,183,56,0,0 ; addps 0x38b7(%rip),%xmm9 # 6bd0 <_sk_callback_sse2+0x9fb>
+ DB 68,15,40,37,191,56,0,0 ; movaps 0x38bf(%rip),%xmm12 # 6be0 <_sk_callback_sse2+0xa0b>
DB 69,15,89,229 ; mulps %xmm13,%xmm12
DB 69,15,92,204 ; subps %xmm12,%xmm9
- DB 68,15,40,37,15,58,0,0 ; movaps 0x3a0f(%rip),%xmm12 # 6d40 <_sk_callback_sse2+0xa26>
+ DB 68,15,40,37,191,56,0,0 ; movaps 0x38bf(%rip),%xmm12 # 6bf0 <_sk_callback_sse2+0xa1b>
DB 69,15,92,229 ; subps %xmm13,%xmm12
- DB 68,15,40,45,19,58,0,0 ; movaps 0x3a13(%rip),%xmm13 # 6d50 <_sk_callback_sse2+0xa36>
+ DB 68,15,40,45,195,56,0,0 ; movaps 0x38c3(%rip),%xmm13 # 6c00 <_sk_callback_sse2+0xa2b>
DB 69,15,94,236 ; divps %xmm12,%xmm13
DB 69,15,88,233 ; addps %xmm9,%xmm13
- DB 68,15,89,45,19,58,0,0 ; mulps 0x3a13(%rip),%xmm13 # 6d60 <_sk_callback_sse2+0xa46>
+ DB 68,15,89,45,195,56,0,0 ; mulps 0x38c3(%rip),%xmm13 # 6c10 <_sk_callback_sse2+0xa3b>
DB 102,69,15,91,205 ; cvtps2dq %xmm13,%xmm9
DB 243,68,15,16,96,20 ; movss 0x14(%rax),%xmm12
DB 69,15,198,228,0 ; shufps $0x0,%xmm12,%xmm12
@@ -26206,29 +25893,29 @@ _sk_parametric_a_sse2 LABEL PROC
PUBLIC _sk_lab_to_xyz_sse2
_sk_lab_to_xyz_sse2 LABEL PROC
- DB 15,89,5,240,57,0,0 ; mulps 0x39f0(%rip),%xmm0 # 6d70 <_sk_callback_sse2+0xa56>
- DB 68,15,40,5,248,57,0,0 ; movaps 0x39f8(%rip),%xmm8 # 6d80 <_sk_callback_sse2+0xa66>
+ DB 15,89,5,160,56,0,0 ; mulps 0x38a0(%rip),%xmm0 # 6c20 <_sk_callback_sse2+0xa4b>
+ DB 68,15,40,5,168,56,0,0 ; movaps 0x38a8(%rip),%xmm8 # 6c30 <_sk_callback_sse2+0xa5b>
DB 65,15,89,200 ; mulps %xmm8,%xmm1
- DB 68,15,40,13,252,57,0,0 ; movaps 0x39fc(%rip),%xmm9 # 6d90 <_sk_callback_sse2+0xa76>
+ DB 68,15,40,13,172,56,0,0 ; movaps 0x38ac(%rip),%xmm9 # 6c40 <_sk_callback_sse2+0xa6b>
DB 65,15,88,201 ; addps %xmm9,%xmm1
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 65,15,88,209 ; addps %xmm9,%xmm2
- DB 15,88,5,249,57,0,0 ; addps 0x39f9(%rip),%xmm0 # 6da0 <_sk_callback_sse2+0xa86>
- DB 15,89,5,2,58,0,0 ; mulps 0x3a02(%rip),%xmm0 # 6db0 <_sk_callback_sse2+0xa96>
- DB 15,89,13,11,58,0,0 ; mulps 0x3a0b(%rip),%xmm1 # 6dc0 <_sk_callback_sse2+0xaa6>
+ DB 15,88,5,169,56,0,0 ; addps 0x38a9(%rip),%xmm0 # 6c50 <_sk_callback_sse2+0xa7b>
+ DB 15,89,5,178,56,0,0 ; mulps 0x38b2(%rip),%xmm0 # 6c60 <_sk_callback_sse2+0xa8b>
+ DB 15,89,13,187,56,0,0 ; mulps 0x38bb(%rip),%xmm1 # 6c70 <_sk_callback_sse2+0xa9b>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,21,17,58,0,0 ; mulps 0x3a11(%rip),%xmm2 # 6dd0 <_sk_callback_sse2+0xab6>
+ DB 15,89,21,193,56,0,0 ; mulps 0x38c1(%rip),%xmm2 # 6c80 <_sk_callback_sse2+0xaab>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 68,15,92,202 ; subps %xmm2,%xmm9
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
DB 68,15,89,225 ; mulps %xmm1,%xmm12
- DB 15,40,21,6,58,0,0 ; movaps 0x3a06(%rip),%xmm2 # 6de0 <_sk_callback_sse2+0xac6>
+ DB 15,40,21,182,56,0,0 ; movaps 0x38b6(%rip),%xmm2 # 6c90 <_sk_callback_sse2+0xabb>
DB 68,15,40,194 ; movaps %xmm2,%xmm8
DB 69,15,194,196,1 ; cmpltps %xmm12,%xmm8
- DB 68,15,40,21,5,58,0,0 ; movaps 0x3a05(%rip),%xmm10 # 6df0 <_sk_callback_sse2+0xad6>
+ DB 68,15,40,21,181,56,0,0 ; movaps 0x38b5(%rip),%xmm10 # 6ca0 <_sk_callback_sse2+0xacb>
DB 65,15,88,202 ; addps %xmm10,%xmm1
- DB 68,15,40,29,9,58,0,0 ; movaps 0x3a09(%rip),%xmm11 # 6e00 <_sk_callback_sse2+0xae6>
+ DB 68,15,40,29,185,56,0,0 ; movaps 0x38b9(%rip),%xmm11 # 6cb0 <_sk_callback_sse2+0xadb>
DB 65,15,89,203 ; mulps %xmm11,%xmm1
DB 69,15,84,224 ; andps %xmm8,%xmm12
DB 68,15,85,193 ; andnps %xmm1,%xmm8
@@ -26252,8 +25939,8 @@ _sk_lab_to_xyz_sse2 LABEL PROC
DB 15,84,194 ; andps %xmm2,%xmm0
DB 65,15,85,209 ; andnps %xmm9,%xmm2
DB 15,86,208 ; orps %xmm0,%xmm2
- DB 68,15,89,5,185,57,0,0 ; mulps 0x39b9(%rip),%xmm8 # 6e10 <_sk_callback_sse2+0xaf6>
- DB 15,89,21,194,57,0,0 ; mulps 0x39c2(%rip),%xmm2 # 6e20 <_sk_callback_sse2+0xb06>
+ DB 68,15,89,5,105,56,0,0 ; mulps 0x3869(%rip),%xmm8 # 6cc0 <_sk_callback_sse2+0xaeb>
+ DB 15,89,21,114,56,0,0 ; mulps 0x3872(%rip),%xmm2 # 6cd0 <_sk_callback_sse2+0xafb>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -26267,9 +25954,9 @@ _sk_load_a8_sse2 LABEL PROC
DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0
DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
- DB 102,15,219,5,170,57,0,0 ; pand 0x39aa(%rip),%xmm0 # 6e30 <_sk_callback_sse2+0xb16>
+ DB 102,15,219,5,90,56,0,0 ; pand 0x385a(%rip),%xmm0 # 6ce0 <_sk_callback_sse2+0xb0b>
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,176,57,0,0 ; mulps 0x39b0(%rip),%xmm3 # 6e40 <_sk_callback_sse2+0xb26>
+ DB 15,89,29,96,56,0,0 ; mulps 0x3860(%rip),%xmm3 # 6cf0 <_sk_callback_sse2+0xb1b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
@@ -26306,9 +25993,9 @@ _sk_load_a8_dst_sse2 LABEL PROC
DB 102,65,15,110,36,18 ; movd (%r10,%rdx,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,37,68,57,0,0 ; pand 0x3944(%rip),%xmm4 # 6e50 <_sk_callback_sse2+0xb36>
+ DB 102,15,219,37,244,55,0,0 ; pand 0x37f4(%rip),%xmm4 # 6d00 <_sk_callback_sse2+0xb2b>
DB 15,91,252 ; cvtdq2ps %xmm4,%xmm7
- DB 15,89,61,74,57,0,0 ; mulps 0x394a(%rip),%xmm7 # 6e60 <_sk_callback_sse2+0xb46>
+ DB 15,89,61,250,55,0,0 ; mulps 0x37fa(%rip),%xmm7 # 6d10 <_sk_callback_sse2+0xb3b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 102,15,87,237 ; xorpd %xmm5,%xmm5
@@ -26343,7 +26030,7 @@ _sk_gather_a8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -26374,7 +26061,7 @@ _sk_gather_a8_sse2 LABEL PROC
DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,29,107,56,0,0 ; mulps 0x386b(%rip),%xmm3 # 6e70 <_sk_callback_sse2+0xb56>
+ DB 15,89,29,27,55,0,0 ; mulps 0x371b(%rip),%xmm3 # 6d20 <_sk_callback_sse2+0xb4b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
@@ -26388,7 +26075,7 @@ _sk_store_a8_sse2 LABEL PROC
DB 72,131,236,40 ; sub $0x28,%rsp
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
- DB 68,15,40,5,89,56,0,0 ; movaps 0x3859(%rip),%xmm8 # 6e80 <_sk_callback_sse2+0xb66>
+ DB 68,15,40,5,9,55,0,0 ; movaps 0x3709(%rip),%xmm8 # 6d30 <_sk_callback_sse2+0xb5b>
DB 68,15,89,195 ; mulps %xmm3,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
DB 102,65,15,114,240,16 ; pslld $0x10,%xmm8
@@ -26415,7 +26102,7 @@ _sk_store_a8_sse2 LABEL PROC
DB 102,68,15,127,68,36,16 ; movdqa %xmm8,0x10(%rsp)
DB 138,68,36,24 ; mov 0x18(%rsp),%al
DB 65,136,68,18,2 ; mov %al,0x2(%r10,%rdx,1)
- DB 102,68,15,219,5,248,55,0,0 ; pand 0x37f8(%rip),%xmm8 # 6e90 <_sk_callback_sse2+0xb76>
+ DB 102,68,15,219,5,168,54,0,0 ; pand 0x36a8(%rip),%xmm8 # 6d40 <_sk_callback_sse2+0xb6b>
DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8
DB 102,69,15,103,192 ; packuswb %xmm8,%xmm8
DB 102,68,15,126,192 ; movd %xmm8,%eax
@@ -26435,11 +26122,11 @@ _sk_load_g8_sse2 LABEL PROC
DB 102,65,15,110,4,18 ; movd (%r10,%rdx,1),%xmm0
DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
- DB 102,15,219,5,195,55,0,0 ; pand 0x37c3(%rip),%xmm0 # 6ea0 <_sk_callback_sse2+0xb86>
+ DB 102,15,219,5,115,54,0,0 ; pand 0x3673(%rip),%xmm0 # 6d50 <_sk_callback_sse2+0xb7b>
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,201,55,0,0 ; mulps 0x37c9(%rip),%xmm0 # 6eb0 <_sk_callback_sse2+0xb96>
+ DB 15,89,5,121,54,0,0 ; mulps 0x3679(%rip),%xmm0 # 6d60 <_sk_callback_sse2+0xb8b>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,208,55,0,0 ; movaps 0x37d0(%rip),%xmm3 # 6ec0 <_sk_callback_sse2+0xba6>
+ DB 15,40,29,128,54,0,0 ; movaps 0x3680(%rip),%xmm3 # 6d70 <_sk_callback_sse2+0xb9b>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,224 ; jmpq *%rax
@@ -26474,11 +26161,11 @@ _sk_load_g8_dst_sse2 LABEL PROC
DB 102,65,15,110,36,18 ; movd (%r10,%rdx,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,37,106,55,0,0 ; pand 0x376a(%rip),%xmm4 # 6ed0 <_sk_callback_sse2+0xbb6>
+ DB 102,15,219,37,26,54,0,0 ; pand 0x361a(%rip),%xmm4 # 6d80 <_sk_callback_sse2+0xbab>
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,112,55,0,0 ; mulps 0x3770(%rip),%xmm4 # 6ee0 <_sk_callback_sse2+0xbc6>
+ DB 15,89,37,32,54,0,0 ; mulps 0x3620(%rip),%xmm4 # 6d90 <_sk_callback_sse2+0xbbb>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,61,119,55,0,0 ; movaps 0x3777(%rip),%xmm7 # 6ef0 <_sk_callback_sse2+0xbd6>
+ DB 15,40,61,39,54,0,0 ; movaps 0x3627(%rip),%xmm7 # 6da0 <_sk_callback_sse2+0xbcb>
DB 15,40,236 ; movaps %xmm4,%xmm5
DB 15,40,244 ; movaps %xmm4,%xmm6
DB 255,224 ; jmpq *%rax
@@ -26511,7 +26198,7 @@ _sk_gather_g8_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -26542,182 +26229,98 @@ _sk_gather_g8_sse2 LABEL PROC
DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,158,54,0,0 ; mulps 0x369e(%rip),%xmm0 # 6f00 <_sk_callback_sse2+0xbe6>
+ DB 15,89,5,78,53,0,0 ; mulps 0x354e(%rip),%xmm0 # 6db0 <_sk_callback_sse2+0xbdb>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,165,54,0,0 ; movaps 0x36a5(%rip),%xmm3 # 6f10 <_sk_callback_sse2+0xbf6>
+ DB 15,40,29,85,53,0,0 ; movaps 0x3555(%rip),%xmm3 # 6dc0 <_sk_callback_sse2+0xbeb>
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 91 ; pop %rbx
DB 93 ; pop %rbp
DB 255,224 ; jmpq *%rax
-PUBLIC _sk_gather_i8_sse2
-_sk_gather_i8_sse2 LABEL PROC
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 73,137,193 ; mov %rax,%r9
- DB 77,133,201 ; test %r9,%r9
- DB 116,5 ; je 3884 <_sk_gather_i8_sse2+0xf>
- DB 76,137,200 ; mov %r9,%rax
- DB 235,2 ; jmp 3886 <_sk_gather_i8_sse2+0x11>
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 85 ; push %rbp
- DB 65,86 ; push %r14
- DB 83 ; push %rbx
- DB 76,139,16 ; mov (%rax),%r10
- DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
- DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
- DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
- DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
- DB 102,15,112,219,232 ; pshufd $0xe8,%xmm3,%xmm3
- DB 102,15,244,209 ; pmuludq %xmm1,%xmm2
- DB 102,15,112,202,232 ; pshufd $0xe8,%xmm2,%xmm1
- DB 102,15,98,203 ; punpckldq %xmm3,%xmm1
- DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
- DB 102,15,254,193 ; paddd %xmm1,%xmm0
- DB 102,72,15,126,192 ; movq %xmm0,%rax
- DB 65,137,195 ; mov %eax,%r11d
- DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 65,137,222 ; mov %ebx,%r14d
- DB 72,193,235,32 ; shr $0x20,%rbx
- DB 67,15,182,44,50 ; movzbl (%r10,%r14,1),%ebp
- DB 65,15,182,28,26 ; movzbl (%r10,%rbx,1),%ebx
- DB 193,227,8 ; shl $0x8,%ebx
- DB 9,235 ; or %ebp,%ebx
- DB 67,15,182,44,26 ; movzbl (%r10,%r11,1),%ebp
- DB 65,15,182,4,2 ; movzbl (%r10,%rax,1),%eax
- DB 193,224,8 ; shl $0x8,%eax
- DB 9,232 ; or %ebp,%eax
- DB 102,15,196,192,0 ; pinsrw $0x0,%eax,%xmm0
- DB 102,15,196,195,1 ; pinsrw $0x1,%ebx,%xmm0
- DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
- DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
- DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
- DB 102,72,15,126,200 ; movq %xmm1,%rax
- DB 68,15,182,208 ; movzbl %al,%r10d
- DB 72,193,232,32 ; shr $0x20,%rax
- DB 102,72,15,126,195 ; movq %xmm0,%rbx
- DB 73,139,105,8 ; mov 0x8(%r9),%rbp
- DB 68,15,182,203 ; movzbl %bl,%r9d
- DB 72,193,235,30 ; shr $0x1e,%rbx
- DB 102,15,110,68,29,0 ; movd 0x0(%rbp,%rbx,1),%xmm0
- DB 102,15,110,76,133,0 ; movd 0x0(%rbp,%rax,4),%xmm1
- DB 102,15,98,193 ; punpckldq %xmm1,%xmm0
- DB 102,70,15,110,76,141,0 ; movd 0x0(%rbp,%r9,4),%xmm9
- DB 102,66,15,110,76,149,0 ; movd 0x0(%rbp,%r10,4),%xmm1
- DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9
- DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9
- DB 102,15,111,21,190,53,0,0 ; movdqa 0x35be(%rip),%xmm2 # 6f20 <_sk_callback_sse2+0xc06>
- DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
- DB 102,15,219,194 ; pand %xmm2,%xmm0
- DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,186,53,0,0 ; movaps 0x35ba(%rip),%xmm8 # 6f30 <_sk_callback_sse2+0xc16>
- DB 65,15,89,192 ; mulps %xmm8,%xmm0
- DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
- DB 102,15,114,209,8 ; psrld $0x8,%xmm1
- DB 102,15,219,202 ; pand %xmm2,%xmm1
- DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 65,15,89,200 ; mulps %xmm8,%xmm1
- DB 102,65,15,111,217 ; movdqa %xmm9,%xmm3
- DB 102,15,114,211,16 ; psrld $0x10,%xmm3
- DB 102,15,219,218 ; pand %xmm2,%xmm3
- DB 15,91,211 ; cvtdq2ps %xmm3,%xmm2
- DB 65,15,89,208 ; mulps %xmm8,%xmm2
- DB 102,65,15,114,209,24 ; psrld $0x18,%xmm9
- DB 65,15,91,217 ; cvtdq2ps %xmm9,%xmm3
- DB 65,15,89,216 ; mulps %xmm8,%xmm3
- DB 72,173 ; lods %ds:(%rsi),%rax
- DB 91 ; pop %rbx
- DB 65,94 ; pop %r14
- DB 93 ; pop %rbp
- DB 255,224 ; jmpq *%rax
-
PUBLIC _sk_load_565_sse2
_sk_load_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,83 ; jne 3a17 <_sk_load_565_sse2+0x5d>
+ DB 117,83 ; jne 38d2 <_sk_load_565_sse2+0x5d>
DB 243,65,15,126,20,82 ; movq (%r10,%rdx,2),%xmm2
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,5,106,53,0,0 ; movdqa 0x356a(%rip),%xmm0 # 6f40 <_sk_callback_sse2+0xc26>
+ DB 102,15,111,5,63,53,0,0 ; movdqa 0x353f(%rip),%xmm0 # 6dd0 <_sk_callback_sse2+0xbfb>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,108,53,0,0 ; mulps 0x356c(%rip),%xmm0 # 6f50 <_sk_callback_sse2+0xc36>
- DB 102,15,111,13,116,53,0,0 ; movdqa 0x3574(%rip),%xmm1 # 6f60 <_sk_callback_sse2+0xc46>
+ DB 15,89,5,65,53,0,0 ; mulps 0x3541(%rip),%xmm0 # 6de0 <_sk_callback_sse2+0xc0b>
+ DB 102,15,111,13,73,53,0,0 ; movdqa 0x3549(%rip),%xmm1 # 6df0 <_sk_callback_sse2+0xc1b>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,118,53,0,0 ; mulps 0x3576(%rip),%xmm1 # 6f70 <_sk_callback_sse2+0xc56>
- DB 102,15,219,21,126,53,0,0 ; pand 0x357e(%rip),%xmm2 # 6f80 <_sk_callback_sse2+0xc66>
+ DB 15,89,13,75,53,0,0 ; mulps 0x354b(%rip),%xmm1 # 6e00 <_sk_callback_sse2+0xc2b>
+ DB 102,15,219,21,83,53,0,0 ; pand 0x3553(%rip),%xmm2 # 6e10 <_sk_callback_sse2+0xc3b>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,132,53,0,0 ; mulps 0x3584(%rip),%xmm2 # 6f90 <_sk_callback_sse2+0xc76>
+ DB 15,89,21,89,53,0,0 ; mulps 0x3559(%rip),%xmm2 # 6e20 <_sk_callback_sse2+0xc4b>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,139,53,0,0 ; movaps 0x358b(%rip),%xmm3 # 6fa0 <_sk_callback_sse2+0xc86>
+ DB 15,40,29,96,53,0,0 ; movaps 0x3560(%rip),%xmm3 # 6e30 <_sk_callback_sse2+0xc5b>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,50 ; je 3a56 <_sk_load_565_sse2+0x9c>
+ DB 116,50 ; je 3911 <_sk_load_565_sse2+0x9c>
DB 102,15,239,210 ; pxor %xmm2,%xmm2
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 3a43 <_sk_load_565_sse2+0x89>
+ DB 116,21 ; je 38fe <_sk_load_565_sse2+0x89>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,154 ; jne 39ce <_sk_load_565_sse2+0x14>
+ DB 117,154 ; jne 3889 <_sk_load_565_sse2+0x14>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,208,69 ; pshufd $0x45,%xmm0,%xmm2
DB 102,65,15,110,4,82 ; movd (%r10,%rdx,2),%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
DB 242,15,16,208 ; movsd %xmm0,%xmm2
- DB 233,120,255,255,255 ; jmpq 39ce <_sk_load_565_sse2+0x14>
+ DB 233,120,255,255,255 ; jmpq 3889 <_sk_load_565_sse2+0x14>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,208 ; movd %eax,%xmm2
- DB 233,106,255,255,255 ; jmpq 39ce <_sk_load_565_sse2+0x14>
+ DB 233,106,255,255,255 ; jmpq 3889 <_sk_load_565_sse2+0x14>
PUBLIC _sk_load_565_dst_sse2
_sk_load_565_dst_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,83 ; jne 3ac1 <_sk_load_565_dst_sse2+0x5d>
+ DB 117,83 ; jne 397c <_sk_load_565_dst_sse2+0x5d>
DB 243,65,15,126,52,82 ; movq (%r10,%rdx,2),%xmm6
DB 102,15,97,240 ; punpcklwd %xmm0,%xmm6
- DB 102,15,111,37,48,53,0,0 ; movdqa 0x3530(%rip),%xmm4 # 6fb0 <_sk_callback_sse2+0xc96>
+ DB 102,15,111,37,5,53,0,0 ; movdqa 0x3505(%rip),%xmm4 # 6e40 <_sk_callback_sse2+0xc6b>
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,50,53,0,0 ; mulps 0x3532(%rip),%xmm4 # 6fc0 <_sk_callback_sse2+0xca6>
- DB 102,15,111,45,58,53,0,0 ; movdqa 0x353a(%rip),%xmm5 # 6fd0 <_sk_callback_sse2+0xcb6>
+ DB 15,89,37,7,53,0,0 ; mulps 0x3507(%rip),%xmm4 # 6e50 <_sk_callback_sse2+0xc7b>
+ DB 102,15,111,45,15,53,0,0 ; movdqa 0x350f(%rip),%xmm5 # 6e60 <_sk_callback_sse2+0xc8b>
DB 102,15,219,238 ; pand %xmm6,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,45,60,53,0,0 ; mulps 0x353c(%rip),%xmm5 # 6fe0 <_sk_callback_sse2+0xcc6>
- DB 102,15,219,53,68,53,0,0 ; pand 0x3544(%rip),%xmm6 # 6ff0 <_sk_callback_sse2+0xcd6>
+ DB 15,89,45,17,53,0,0 ; mulps 0x3511(%rip),%xmm5 # 6e70 <_sk_callback_sse2+0xc9b>
+ DB 102,15,219,53,25,53,0,0 ; pand 0x3519(%rip),%xmm6 # 6e80 <_sk_callback_sse2+0xcab>
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,53,74,53,0,0 ; mulps 0x354a(%rip),%xmm6 # 7000 <_sk_callback_sse2+0xce6>
+ DB 15,89,53,31,53,0,0 ; mulps 0x351f(%rip),%xmm6 # 6e90 <_sk_callback_sse2+0xcbb>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,61,81,53,0,0 ; movaps 0x3551(%rip),%xmm7 # 7010 <_sk_callback_sse2+0xcf6>
+ DB 15,40,61,38,53,0,0 ; movaps 0x3526(%rip),%xmm7 # 6ea0 <_sk_callback_sse2+0xccb>
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,50 ; je 3b00 <_sk_load_565_dst_sse2+0x9c>
+ DB 116,50 ; je 39bb <_sk_load_565_dst_sse2+0x9c>
DB 102,15,239,246 ; pxor %xmm6,%xmm6
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 3aed <_sk_load_565_dst_sse2+0x89>
+ DB 116,21 ; je 39a8 <_sk_load_565_dst_sse2+0x89>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,154 ; jne 3a78 <_sk_load_565_dst_sse2+0x14>
+ DB 117,154 ; jne 3933 <_sk_load_565_dst_sse2+0x14>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,224 ; movd %eax,%xmm4
DB 102,15,112,244,69 ; pshufd $0x45,%xmm4,%xmm6
DB 102,65,15,110,36,82 ; movd (%r10,%rdx,2),%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
DB 242,15,16,244 ; movsd %xmm4,%xmm6
- DB 233,120,255,255,255 ; jmpq 3a78 <_sk_load_565_dst_sse2+0x14>
+ DB 233,120,255,255,255 ; jmpq 3933 <_sk_load_565_dst_sse2+0x14>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,240 ; movd %eax,%xmm6
- DB 233,106,255,255,255 ; jmpq 3a78 <_sk_load_565_dst_sse2+0x14>
+ DB 233,106,255,255,255 ; jmpq 3933 <_sk_load_565_dst_sse2+0x14>
PUBLIC _sk_gather_565_sse2
_sk_gather_565_sse2 LABEL PROC
@@ -26725,7 +26328,7 @@ _sk_gather_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -26750,19 +26353,19 @@ _sk_gather_565_sse2 LABEL PROC
DB 102,15,196,208,3 ; pinsrw $0x3,%eax,%xmm2
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,5,140,52,0,0 ; movdqa 0x348c(%rip),%xmm0 # 7020 <_sk_callback_sse2+0xd06>
+ DB 102,15,111,5,97,52,0,0 ; movdqa 0x3461(%rip),%xmm0 # 6eb0 <_sk_callback_sse2+0xcdb>
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,142,52,0,0 ; mulps 0x348e(%rip),%xmm0 # 7030 <_sk_callback_sse2+0xd16>
- DB 102,15,111,13,150,52,0,0 ; movdqa 0x3496(%rip),%xmm1 # 7040 <_sk_callback_sse2+0xd26>
+ DB 15,89,5,99,52,0,0 ; mulps 0x3463(%rip),%xmm0 # 6ec0 <_sk_callback_sse2+0xceb>
+ DB 102,15,111,13,107,52,0,0 ; movdqa 0x346b(%rip),%xmm1 # 6ed0 <_sk_callback_sse2+0xcfb>
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,152,52,0,0 ; mulps 0x3498(%rip),%xmm1 # 7050 <_sk_callback_sse2+0xd36>
- DB 102,15,219,21,160,52,0,0 ; pand 0x34a0(%rip),%xmm2 # 7060 <_sk_callback_sse2+0xd46>
+ DB 15,89,13,109,52,0,0 ; mulps 0x346d(%rip),%xmm1 # 6ee0 <_sk_callback_sse2+0xd0b>
+ DB 102,15,219,21,117,52,0,0 ; pand 0x3475(%rip),%xmm2 # 6ef0 <_sk_callback_sse2+0xd1b>
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,166,52,0,0 ; mulps 0x34a6(%rip),%xmm2 # 7070 <_sk_callback_sse2+0xd56>
+ DB 15,89,21,123,52,0,0 ; mulps 0x347b(%rip),%xmm2 # 6f00 <_sk_callback_sse2+0xd2b>
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,173,52,0,0 ; movaps 0x34ad(%rip),%xmm3 # 7080 <_sk_callback_sse2+0xd66>
+ DB 15,40,29,130,52,0,0 ; movaps 0x3482(%rip),%xmm3 # 6f10 <_sk_callback_sse2+0xd3b>
DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
@@ -26770,12 +26373,12 @@ PUBLIC _sk_store_565_sse2
_sk_store_565_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
- DB 68,15,40,5,173,52,0,0 ; movaps 0x34ad(%rip),%xmm8 # 7090 <_sk_callback_sse2+0xd76>
+ DB 68,15,40,5,130,52,0,0 ; movaps 0x3482(%rip),%xmm8 # 6f20 <_sk_callback_sse2+0xd4b>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
DB 102,65,15,114,241,11 ; pslld $0xb,%xmm9
- DB 68,15,40,21,162,52,0,0 ; movaps 0x34a2(%rip),%xmm10 # 70a0 <_sk_callback_sse2+0xd86>
+ DB 68,15,40,21,119,52,0,0 ; movaps 0x3477(%rip),%xmm10 # 6f30 <_sk_callback_sse2+0xd5b>
DB 68,15,89,209 ; mulps %xmm1,%xmm10
DB 102,69,15,91,210 ; cvtps2dq %xmm10,%xmm10
DB 102,65,15,114,242,5 ; pslld $0x5,%xmm10
@@ -26787,7 +26390,7 @@ _sk_store_565_sse2 LABEL PROC
DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8
DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3c40 <_sk_store_565_sse2+0x6a>
+ DB 117,10 ; jne 3afb <_sk_store_565_sse2+0x6a>
DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -26795,109 +26398,109 @@ _sk_store_565_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,38 ; je 3c78 <_sk_store_565_sse2+0xa2>
+ DB 116,38 ; je 3b33 <_sk_store_565_sse2+0xa2>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 3c6a <_sk_store_565_sse2+0x94>
+ DB 116,18 ; je 3b25 <_sk_store_565_sse2+0x94>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,222 ; jne 3c3c <_sk_store_565_sse2+0x66>
+ DB 117,222 ; jne 3af7 <_sk_store_565_sse2+0x66>
DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax
DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2)
DB 242,69,15,112,192,232 ; pshuflw $0xe8,%xmm8,%xmm8
DB 102,69,15,126,4,82 ; movd %xmm8,(%r10,%rdx,2)
- DB 235,196 ; jmp 3c3c <_sk_store_565_sse2+0x66>
+ DB 235,196 ; jmp 3af7 <_sk_store_565_sse2+0x66>
DB 102,68,15,126,192 ; movd %xmm8,%eax
DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2)
- DB 235,184 ; jmp 3c3c <_sk_store_565_sse2+0x66>
+ DB 235,184 ; jmp 3af7 <_sk_store_565_sse2+0x66>
PUBLIC _sk_load_4444_sse2
_sk_load_4444_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 3cf0 <_sk_load_4444_sse2+0x6c>
+ DB 117,98 ; jne 3bab <_sk_load_4444_sse2+0x6c>
DB 243,65,15,126,28,82 ; movq (%r10,%rdx,2),%xmm3
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,5,16,52,0,0 ; movdqa 0x3410(%rip),%xmm0 # 70b0 <_sk_callback_sse2+0xd96>
+ DB 102,15,111,5,229,51,0,0 ; movdqa 0x33e5(%rip),%xmm0 # 6f40 <_sk_callback_sse2+0xd6b>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,18,52,0,0 ; mulps 0x3412(%rip),%xmm0 # 70c0 <_sk_callback_sse2+0xda6>
- DB 102,15,111,13,26,52,0,0 ; movdqa 0x341a(%rip),%xmm1 # 70d0 <_sk_callback_sse2+0xdb6>
+ DB 15,89,5,231,51,0,0 ; mulps 0x33e7(%rip),%xmm0 # 6f50 <_sk_callback_sse2+0xd7b>
+ DB 102,15,111,13,239,51,0,0 ; movdqa 0x33ef(%rip),%xmm1 # 6f60 <_sk_callback_sse2+0xd8b>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,28,52,0,0 ; mulps 0x341c(%rip),%xmm1 # 70e0 <_sk_callback_sse2+0xdc6>
- DB 102,15,111,21,36,52,0,0 ; movdqa 0x3424(%rip),%xmm2 # 70f0 <_sk_callback_sse2+0xdd6>
+ DB 15,89,13,241,51,0,0 ; mulps 0x33f1(%rip),%xmm1 # 6f70 <_sk_callback_sse2+0xd9b>
+ DB 102,15,111,21,249,51,0,0 ; movdqa 0x33f9(%rip),%xmm2 # 6f80 <_sk_callback_sse2+0xdab>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,38,52,0,0 ; mulps 0x3426(%rip),%xmm2 # 7100 <_sk_callback_sse2+0xde6>
- DB 102,15,219,29,46,52,0,0 ; pand 0x342e(%rip),%xmm3 # 7110 <_sk_callback_sse2+0xdf6>
+ DB 15,89,21,251,51,0,0 ; mulps 0x33fb(%rip),%xmm2 # 6f90 <_sk_callback_sse2+0xdbb>
+ DB 102,15,219,29,3,52,0,0 ; pand 0x3403(%rip),%xmm3 # 6fa0 <_sk_callback_sse2+0xdcb>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,52,52,0,0 ; mulps 0x3434(%rip),%xmm3 # 7120 <_sk_callback_sse2+0xe06>
+ DB 15,89,29,9,52,0,0 ; mulps 0x3409(%rip),%xmm3 # 6fb0 <_sk_callback_sse2+0xddb>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,50 ; je 3d2f <_sk_load_4444_sse2+0xab>
+ DB 116,50 ; je 3bea <_sk_load_4444_sse2+0xab>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 3d1c <_sk_load_4444_sse2+0x98>
+ DB 116,21 ; je 3bd7 <_sk_load_4444_sse2+0x98>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,139 ; jne 3c98 <_sk_load_4444_sse2+0x14>
+ DB 117,139 ; jne 3b53 <_sk_load_4444_sse2+0x14>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,192 ; movd %eax,%xmm0
DB 102,15,112,216,69 ; pshufd $0x45,%xmm0,%xmm3
DB 102,65,15,110,4,82 ; movd (%r10,%rdx,2),%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
DB 242,15,16,216 ; movsd %xmm0,%xmm3
- DB 233,105,255,255,255 ; jmpq 3c98 <_sk_load_4444_sse2+0x14>
+ DB 233,105,255,255,255 ; jmpq 3b53 <_sk_load_4444_sse2+0x14>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,216 ; movd %eax,%xmm3
- DB 233,91,255,255,255 ; jmpq 3c98 <_sk_load_4444_sse2+0x14>
+ DB 233,91,255,255,255 ; jmpq 3b53 <_sk_load_4444_sse2+0x14>
PUBLIC _sk_load_4444_dst_sse2
_sk_load_4444_dst_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 3da9 <_sk_load_4444_dst_sse2+0x6c>
+ DB 117,98 ; jne 3c64 <_sk_load_4444_dst_sse2+0x6c>
DB 243,65,15,126,60,82 ; movq (%r10,%rdx,2),%xmm7
DB 102,15,97,248 ; punpcklwd %xmm0,%xmm7
- DB 102,15,111,37,215,51,0,0 ; movdqa 0x33d7(%rip),%xmm4 # 7130 <_sk_callback_sse2+0xe16>
+ DB 102,15,111,37,172,51,0,0 ; movdqa 0x33ac(%rip),%xmm4 # 6fc0 <_sk_callback_sse2+0xdeb>
DB 102,15,219,231 ; pand %xmm7,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,37,217,51,0,0 ; mulps 0x33d9(%rip),%xmm4 # 7140 <_sk_callback_sse2+0xe26>
- DB 102,15,111,45,225,51,0,0 ; movdqa 0x33e1(%rip),%xmm5 # 7150 <_sk_callback_sse2+0xe36>
+ DB 15,89,37,174,51,0,0 ; mulps 0x33ae(%rip),%xmm4 # 6fd0 <_sk_callback_sse2+0xdfb>
+ DB 102,15,111,45,182,51,0,0 ; movdqa 0x33b6(%rip),%xmm5 # 6fe0 <_sk_callback_sse2+0xe0b>
DB 102,15,219,239 ; pand %xmm7,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,45,227,51,0,0 ; mulps 0x33e3(%rip),%xmm5 # 7160 <_sk_callback_sse2+0xe46>
- DB 102,15,111,53,235,51,0,0 ; movdqa 0x33eb(%rip),%xmm6 # 7170 <_sk_callback_sse2+0xe56>
+ DB 15,89,45,184,51,0,0 ; mulps 0x33b8(%rip),%xmm5 # 6ff0 <_sk_callback_sse2+0xe1b>
+ DB 102,15,111,53,192,51,0,0 ; movdqa 0x33c0(%rip),%xmm6 # 7000 <_sk_callback_sse2+0xe2b>
DB 102,15,219,247 ; pand %xmm7,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,53,237,51,0,0 ; mulps 0x33ed(%rip),%xmm6 # 7180 <_sk_callback_sse2+0xe66>
- DB 102,15,219,61,245,51,0,0 ; pand 0x33f5(%rip),%xmm7 # 7190 <_sk_callback_sse2+0xe76>
+ DB 15,89,53,194,51,0,0 ; mulps 0x33c2(%rip),%xmm6 # 7010 <_sk_callback_sse2+0xe3b>
+ DB 102,15,219,61,202,51,0,0 ; pand 0x33ca(%rip),%xmm7 # 7020 <_sk_callback_sse2+0xe4b>
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 15,89,61,251,51,0,0 ; mulps 0x33fb(%rip),%xmm7 # 71a0 <_sk_callback_sse2+0xe86>
+ DB 15,89,61,208,51,0,0 ; mulps 0x33d0(%rip),%xmm7 # 7030 <_sk_callback_sse2+0xe5b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,50 ; je 3de8 <_sk_load_4444_dst_sse2+0xab>
+ DB 116,50 ; je 3ca3 <_sk_load_4444_dst_sse2+0xab>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,21 ; je 3dd5 <_sk_load_4444_dst_sse2+0x98>
+ DB 116,21 ; je 3c90 <_sk_load_4444_dst_sse2+0x98>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,139 ; jne 3d51 <_sk_load_4444_dst_sse2+0x14>
+ DB 117,139 ; jne 3c0c <_sk_load_4444_dst_sse2+0x14>
DB 65,15,183,68,82,4 ; movzwl 0x4(%r10,%rdx,2),%eax
DB 102,15,110,224 ; movd %eax,%xmm4
DB 102,15,112,252,69 ; pshufd $0x45,%xmm4,%xmm7
DB 102,65,15,110,36,82 ; movd (%r10,%rdx,2),%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
DB 242,15,16,252 ; movsd %xmm4,%xmm7
- DB 233,105,255,255,255 ; jmpq 3d51 <_sk_load_4444_dst_sse2+0x14>
+ DB 233,105,255,255,255 ; jmpq 3c0c <_sk_load_4444_dst_sse2+0x14>
DB 65,15,183,4,82 ; movzwl (%r10,%rdx,2),%eax
DB 102,15,110,248 ; movd %eax,%xmm7
- DB 233,91,255,255,255 ; jmpq 3d51 <_sk_load_4444_dst_sse2+0x14>
+ DB 233,91,255,255,255 ; jmpq 3c0c <_sk_load_4444_dst_sse2+0x14>
PUBLIC _sk_gather_4444_sse2
_sk_gather_4444_sse2 LABEL PROC
@@ -26905,7 +26508,7 @@ _sk_gather_4444_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -26930,21 +26533,21 @@ _sk_gather_4444_sse2 LABEL PROC
DB 102,15,196,216,3 ; pinsrw $0x3,%eax,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,5,52,51,0,0 ; movdqa 0x3334(%rip),%xmm0 # 71b0 <_sk_callback_sse2+0xe96>
+ DB 102,15,111,5,9,51,0,0 ; movdqa 0x3309(%rip),%xmm0 # 7040 <_sk_callback_sse2+0xe6b>
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,5,54,51,0,0 ; mulps 0x3336(%rip),%xmm0 # 71c0 <_sk_callback_sse2+0xea6>
- DB 102,15,111,13,62,51,0,0 ; movdqa 0x333e(%rip),%xmm1 # 71d0 <_sk_callback_sse2+0xeb6>
+ DB 15,89,5,11,51,0,0 ; mulps 0x330b(%rip),%xmm0 # 7050 <_sk_callback_sse2+0xe7b>
+ DB 102,15,111,13,19,51,0,0 ; movdqa 0x3313(%rip),%xmm1 # 7060 <_sk_callback_sse2+0xe8b>
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,13,64,51,0,0 ; mulps 0x3340(%rip),%xmm1 # 71e0 <_sk_callback_sse2+0xec6>
- DB 102,15,111,21,72,51,0,0 ; movdqa 0x3348(%rip),%xmm2 # 71f0 <_sk_callback_sse2+0xed6>
+ DB 15,89,13,21,51,0,0 ; mulps 0x3315(%rip),%xmm1 # 7070 <_sk_callback_sse2+0xe9b>
+ DB 102,15,111,21,29,51,0,0 ; movdqa 0x331d(%rip),%xmm2 # 7080 <_sk_callback_sse2+0xeab>
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,21,74,51,0,0 ; mulps 0x334a(%rip),%xmm2 # 7200 <_sk_callback_sse2+0xee6>
- DB 102,15,219,29,82,51,0,0 ; pand 0x3352(%rip),%xmm3 # 7210 <_sk_callback_sse2+0xef6>
+ DB 15,89,21,31,51,0,0 ; mulps 0x331f(%rip),%xmm2 # 7090 <_sk_callback_sse2+0xebb>
+ DB 102,15,219,29,39,51,0,0 ; pand 0x3327(%rip),%xmm3 # 70a0 <_sk_callback_sse2+0xecb>
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,29,88,51,0,0 ; mulps 0x3358(%rip),%xmm3 # 7220 <_sk_callback_sse2+0xf06>
+ DB 15,89,29,45,51,0,0 ; mulps 0x332d(%rip),%xmm3 # 70b0 <_sk_callback_sse2+0xedb>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 91 ; pop %rbx
DB 255,224 ; jmpq *%rax
@@ -26953,7 +26556,7 @@ PUBLIC _sk_store_4444_sse2
_sk_store_4444_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,16 ; mov (%rax),%r10
- DB 68,15,40,5,86,51,0,0 ; movaps 0x3356(%rip),%xmm8 # 7230 <_sk_callback_sse2+0xf16>
+ DB 68,15,40,5,43,51,0,0 ; movaps 0x332b(%rip),%xmm8 # 70c0 <_sk_callback_sse2+0xeeb>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -26975,7 +26578,7 @@ _sk_store_4444_sse2 LABEL PROC
DB 102,65,15,114,224,16 ; psrad $0x10,%xmm8
DB 102,69,15,107,192 ; packssdw %xmm8,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 3f4b <_sk_store_4444_sse2+0x7e>
+ DB 117,10 ; jne 3e06 <_sk_store_4444_sse2+0x7e>
DB 242,69,15,17,4,82 ; movsd %xmm8,(%r10,%rdx,2)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -26983,32 +26586,32 @@ _sk_store_4444_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,38 ; je 3f83 <_sk_store_4444_sse2+0xb6>
+ DB 116,38 ; je 3e3e <_sk_store_4444_sse2+0xb6>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 3f75 <_sk_store_4444_sse2+0xa8>
+ DB 116,18 ; je 3e30 <_sk_store_4444_sse2+0xa8>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,222 ; jne 3f47 <_sk_store_4444_sse2+0x7a>
+ DB 117,222 ; jne 3e02 <_sk_store_4444_sse2+0x7a>
DB 102,65,15,197,192,4 ; pextrw $0x4,%xmm8,%eax
DB 102,65,137,68,82,4 ; mov %ax,0x4(%r10,%rdx,2)
DB 242,69,15,112,192,232 ; pshuflw $0xe8,%xmm8,%xmm8
DB 102,69,15,126,4,82 ; movd %xmm8,(%r10,%rdx,2)
- DB 235,196 ; jmp 3f47 <_sk_store_4444_sse2+0x7a>
+ DB 235,196 ; jmp 3e02 <_sk_store_4444_sse2+0x7a>
DB 102,68,15,126,192 ; movd %xmm8,%eax
DB 102,65,137,4,82 ; mov %ax,(%r10,%rdx,2)
- DB 235,184 ; jmp 3f47 <_sk_store_4444_sse2+0x7a>
+ DB 235,184 ; jmp 3e02 <_sk_store_4444_sse2+0x7a>
PUBLIC _sk_load_8888_sse2
_sk_load_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 3ffb <_sk_load_8888_sse2+0x6c>
+ DB 117,98 ; jne 3eb6 <_sk_load_8888_sse2+0x6c>
DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9
- DB 102,15,111,21,153,50,0,0 ; movdqa 0x3299(%rip),%xmm2 # 7240 <_sk_callback_sse2+0xf26>
+ DB 102,15,111,21,110,50,0,0 ; movdqa 0x326e(%rip),%xmm2 # 70d0 <_sk_callback_sse2+0xefb>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,149,50,0,0 ; movaps 0x3295(%rip),%xmm8 # 7250 <_sk_callback_sse2+0xf36>
+ DB 68,15,40,5,106,50,0,0 ; movaps 0x326a(%rip),%xmm8 # 70e0 <_sk_callback_sse2+0xf0b>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -27028,31 +26631,31 @@ _sk_load_8888_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,40 ; je 4030 <_sk_load_8888_sse2+0xa1>
+ DB 116,40 ; je 3eeb <_sk_load_8888_sse2+0xa1>
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 4025 <_sk_load_8888_sse2+0x96>
+ DB 116,18 ; je 3ee0 <_sk_load_8888_sse2+0x96>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,134 ; jne 3f9f <_sk_load_8888_sse2+0x10>
+ DB 117,134 ; jne 3e5a <_sk_load_8888_sse2+0x10>
DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9
DB 102,68,15,18,12,144 ; movlpd (%rax,%rdx,4),%xmm9
- DB 233,111,255,255,255 ; jmpq 3f9f <_sk_load_8888_sse2+0x10>
+ DB 233,111,255,255,255 ; jmpq 3e5a <_sk_load_8888_sse2+0x10>
DB 102,68,15,110,12,144 ; movd (%rax,%rdx,4),%xmm9
- DB 233,100,255,255,255 ; jmpq 3f9f <_sk_load_8888_sse2+0x10>
+ DB 233,100,255,255,255 ; jmpq 3e5a <_sk_load_8888_sse2+0x10>
PUBLIC _sk_load_8888_dst_sse2
_sk_load_8888_dst_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 40a7 <_sk_load_8888_dst_sse2+0x6c>
+ DB 117,98 ; jne 3f62 <_sk_load_8888_dst_sse2+0x6c>
DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9
- DB 102,15,111,53,13,50,0,0 ; movdqa 0x320d(%rip),%xmm6 # 7260 <_sk_callback_sse2+0xf46>
+ DB 102,15,111,53,226,49,0,0 ; movdqa 0x31e2(%rip),%xmm6 # 70f0 <_sk_callback_sse2+0xf1b>
DB 102,65,15,111,225 ; movdqa %xmm9,%xmm4
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 68,15,40,5,9,50,0,0 ; movaps 0x3209(%rip),%xmm8 # 7270 <_sk_callback_sse2+0xf56>
+ DB 68,15,40,5,222,49,0,0 ; movaps 0x31de(%rip),%xmm8 # 7100 <_sk_callback_sse2+0xf2b>
DB 65,15,89,224 ; mulps %xmm8,%xmm4
DB 102,65,15,111,233 ; movdqa %xmm9,%xmm5
DB 102,15,114,213,8 ; psrld $0x8,%xmm5
@@ -27072,18 +26675,18 @@ _sk_load_8888_dst_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,40 ; je 40dc <_sk_load_8888_dst_sse2+0xa1>
+ DB 116,40 ; je 3f97 <_sk_load_8888_dst_sse2+0xa1>
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 40d1 <_sk_load_8888_dst_sse2+0x96>
+ DB 116,18 ; je 3f8c <_sk_load_8888_dst_sse2+0x96>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,134 ; jne 404b <_sk_load_8888_dst_sse2+0x10>
+ DB 117,134 ; jne 3f06 <_sk_load_8888_dst_sse2+0x10>
DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,68,15,112,204,69 ; pshufd $0x45,%xmm4,%xmm9
DB 102,68,15,18,12,144 ; movlpd (%rax,%rdx,4),%xmm9
- DB 233,111,255,255,255 ; jmpq 404b <_sk_load_8888_dst_sse2+0x10>
+ DB 233,111,255,255,255 ; jmpq 3f06 <_sk_load_8888_dst_sse2+0x10>
DB 102,68,15,110,12,144 ; movd (%rax,%rdx,4),%xmm9
- DB 233,100,255,255,255 ; jmpq 404b <_sk_load_8888_dst_sse2+0x10>
+ DB 233,100,255,255,255 ; jmpq 3f06 <_sk_load_8888_dst_sse2+0x10>
PUBLIC _sk_gather_8888_sse2
_sk_gather_8888_sse2 LABEL PROC
@@ -27091,7 +26694,7 @@ _sk_gather_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -27115,11 +26718,11 @@ _sk_gather_8888_sse2 LABEL PROC
DB 102,67,15,110,12,145 ; movd (%r9,%r10,4),%xmm1
DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9
DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9
- DB 102,15,111,21,23,49,0,0 ; movdqa 0x3117(%rip),%xmm2 # 7280 <_sk_callback_sse2+0xf66>
+ DB 102,15,111,21,236,48,0,0 ; movdqa 0x30ec(%rip),%xmm2 # 7110 <_sk_callback_sse2+0xf3b>
DB 102,65,15,111,193 ; movdqa %xmm9,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 68,15,40,5,19,49,0,0 ; movaps 0x3113(%rip),%xmm8 # 7290 <_sk_callback_sse2+0xf76>
+ DB 68,15,40,5,232,48,0,0 ; movaps 0x30e8(%rip),%xmm8 # 7120 <_sk_callback_sse2+0xf4b>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -27142,7 +26745,7 @@ PUBLIC _sk_store_8888_sse2
_sk_store_8888_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,213,48,0,0 ; movaps 0x30d5(%rip),%xmm8 # 72a0 <_sk_callback_sse2+0xf86>
+ DB 68,15,40,5,170,48,0,0 ; movaps 0x30aa(%rip),%xmm8 # 7130 <_sk_callback_sse2+0xf5b>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -27161,33 +26764,33 @@ _sk_store_8888_sse2 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 422b <_sk_store_8888_sse2+0x6d>
+ DB 117,10 ; jne 40e6 <_sk_store_8888_sse2+0x6d>
DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,33 ; je 4259 <_sk_store_8888_sse2+0x9b>
+ DB 116,33 ; je 4114 <_sk_store_8888_sse2+0x9b>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,19 ; je 4251 <_sk_store_8888_sse2+0x93>
+ DB 116,19 ; je 410c <_sk_store_8888_sse2+0x93>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,227 ; jne 4227 <_sk_store_8888_sse2+0x69>
+ DB 117,227 ; jne 40e2 <_sk_store_8888_sse2+0x69>
DB 102,69,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm9
DB 102,68,15,126,76,144,8 ; movd %xmm9,0x8(%rax,%rdx,4)
DB 102,68,15,214,4,144 ; movq %xmm8,(%rax,%rdx,4)
- DB 235,206 ; jmp 4227 <_sk_store_8888_sse2+0x69>
+ DB 235,206 ; jmp 40e2 <_sk_store_8888_sse2+0x69>
DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
- DB 235,198 ; jmp 4227 <_sk_store_8888_sse2+0x69>
+ DB 235,198 ; jmp 40e2 <_sk_store_8888_sse2+0x69>
PUBLIC _sk_store_8888_2d_sse2
_sk_store_8888_2d_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 76,139,72,8 ; mov 0x8(%rax),%r9
+ DB 76,99,72,8 ; movslq 0x8(%rax),%r9
DB 76,15,175,201 ; imul %rcx,%r9
DB 73,193,225,2 ; shl $0x2,%r9
DB 76,3,8 ; add (%rax),%r9
- DB 68,15,40,5,54,48,0,0 ; movaps 0x3036(%rip),%xmm8 # 72b0 <_sk_callback_sse2+0xf96>
+ DB 68,15,40,5,11,48,0,0 ; movaps 0x300b(%rip),%xmm8 # 7140 <_sk_callback_sse2+0xf6b>
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -27206,37 +26809,37 @@ _sk_store_8888_2d_sse2 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 42da <_sk_store_8888_2d_sse2+0x79>
+ DB 117,10 ; jne 4195 <_sk_store_8888_2d_sse2+0x79>
DB 243,69,15,127,4,145 ; movdqu %xmm8,(%r9,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 68,137,192 ; mov %r8d,%eax
DB 36,3 ; and $0x3,%al
DB 60,1 ; cmp $0x1,%al
- DB 116,29 ; je 4300 <_sk_store_8888_2d_sse2+0x9f>
+ DB 116,29 ; je 41bb <_sk_store_8888_2d_sse2+0x9f>
DB 60,2 ; cmp $0x2,%al
- DB 116,17 ; je 42f8 <_sk_store_8888_2d_sse2+0x97>
+ DB 116,17 ; je 41b3 <_sk_store_8888_2d_sse2+0x97>
DB 60,3 ; cmp $0x3,%al
- DB 117,235 ; jne 42d6 <_sk_store_8888_2d_sse2+0x75>
+ DB 117,235 ; jne 4191 <_sk_store_8888_2d_sse2+0x75>
DB 102,69,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm9
DB 102,69,15,126,76,145,8 ; movd %xmm9,0x8(%r9,%rdx,4)
DB 102,69,15,214,4,145 ; movq %xmm8,(%r9,%rdx,4)
- DB 235,214 ; jmp 42d6 <_sk_store_8888_2d_sse2+0x75>
+ DB 235,214 ; jmp 4191 <_sk_store_8888_2d_sse2+0x75>
DB 102,69,15,126,4,145 ; movd %xmm8,(%r9,%rdx,4)
- DB 235,206 ; jmp 42d6 <_sk_store_8888_2d_sse2+0x75>
+ DB 235,206 ; jmp 4191 <_sk_store_8888_2d_sse2+0x75>
PUBLIC _sk_load_bgra_sse2
_sk_load_bgra_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 4374 <_sk_load_bgra_sse2+0x6c>
+ DB 117,98 ; jne 422f <_sk_load_bgra_sse2+0x6c>
DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9
- DB 102,15,111,5,160,47,0,0 ; movdqa 0x2fa0(%rip),%xmm0 # 72c0 <_sk_callback_sse2+0xfa6>
+ DB 102,15,111,5,117,47,0,0 ; movdqa 0x2f75(%rip),%xmm0 # 7150 <_sk_callback_sse2+0xf7b>
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,219,200 ; pand %xmm0,%xmm1
DB 15,91,209 ; cvtdq2ps %xmm1,%xmm2
- DB 68,15,40,5,156,47,0,0 ; movaps 0x2f9c(%rip),%xmm8 # 72d0 <_sk_callback_sse2+0xfb6>
+ DB 68,15,40,5,113,47,0,0 ; movaps 0x2f71(%rip),%xmm8 # 7160 <_sk_callback_sse2+0xf8b>
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -27256,31 +26859,31 @@ _sk_load_bgra_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,40 ; je 43a9 <_sk_load_bgra_sse2+0xa1>
+ DB 116,40 ; je 4264 <_sk_load_bgra_sse2+0xa1>
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 439e <_sk_load_bgra_sse2+0x96>
+ DB 116,18 ; je 4259 <_sk_load_bgra_sse2+0x96>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,134 ; jne 4318 <_sk_load_bgra_sse2+0x10>
+ DB 117,134 ; jne 41d3 <_sk_load_bgra_sse2+0x10>
DB 102,15,110,68,144,8 ; movd 0x8(%rax,%rdx,4),%xmm0
DB 102,68,15,112,200,69 ; pshufd $0x45,%xmm0,%xmm9
DB 102,68,15,18,12,144 ; movlpd (%rax,%rdx,4),%xmm9
- DB 233,111,255,255,255 ; jmpq 4318 <_sk_load_bgra_sse2+0x10>
+ DB 233,111,255,255,255 ; jmpq 41d3 <_sk_load_bgra_sse2+0x10>
DB 102,68,15,110,12,144 ; movd (%rax,%rdx,4),%xmm9
- DB 233,100,255,255,255 ; jmpq 4318 <_sk_load_bgra_sse2+0x10>
+ DB 233,100,255,255,255 ; jmpq 41d3 <_sk_load_bgra_sse2+0x10>
PUBLIC _sk_load_bgra_dst_sse2
_sk_load_bgra_dst_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 117,98 ; jne 4420 <_sk_load_bgra_dst_sse2+0x6c>
+ DB 117,98 ; jne 42db <_sk_load_bgra_dst_sse2+0x6c>
DB 243,68,15,111,12,144 ; movdqu (%rax,%rdx,4),%xmm9
- DB 102,15,111,37,20,47,0,0 ; movdqa 0x2f14(%rip),%xmm4 # 72e0 <_sk_callback_sse2+0xfc6>
+ DB 102,15,111,37,233,46,0,0 ; movdqa 0x2ee9(%rip),%xmm4 # 7170 <_sk_callback_sse2+0xf9b>
DB 102,65,15,111,233 ; movdqa %xmm9,%xmm5
DB 102,15,219,236 ; pand %xmm4,%xmm5
DB 15,91,245 ; cvtdq2ps %xmm5,%xmm6
- DB 68,15,40,5,16,47,0,0 ; movaps 0x2f10(%rip),%xmm8 # 72f0 <_sk_callback_sse2+0xfd6>
+ DB 68,15,40,5,229,46,0,0 ; movaps 0x2ee5(%rip),%xmm8 # 7180 <_sk_callback_sse2+0xfab>
DB 65,15,89,240 ; mulps %xmm8,%xmm6
DB 102,65,15,111,233 ; movdqa %xmm9,%xmm5
DB 102,15,114,213,8 ; psrld $0x8,%xmm5
@@ -27300,18 +26903,18 @@ _sk_load_bgra_dst_sse2 LABEL PROC
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,40 ; je 4455 <_sk_load_bgra_dst_sse2+0xa1>
+ DB 116,40 ; je 4310 <_sk_load_bgra_dst_sse2+0xa1>
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,18 ; je 444a <_sk_load_bgra_dst_sse2+0x96>
+ DB 116,18 ; je 4305 <_sk_load_bgra_dst_sse2+0x96>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,134 ; jne 43c4 <_sk_load_bgra_dst_sse2+0x10>
+ DB 117,134 ; jne 427f <_sk_load_bgra_dst_sse2+0x10>
DB 102,15,110,100,144,8 ; movd 0x8(%rax,%rdx,4),%xmm4
DB 102,68,15,112,204,69 ; pshufd $0x45,%xmm4,%xmm9
DB 102,68,15,18,12,144 ; movlpd (%rax,%rdx,4),%xmm9
- DB 233,111,255,255,255 ; jmpq 43c4 <_sk_load_bgra_dst_sse2+0x10>
+ DB 233,111,255,255,255 ; jmpq 427f <_sk_load_bgra_dst_sse2+0x10>
DB 102,68,15,110,12,144 ; movd (%rax,%rdx,4),%xmm9
- DB 233,100,255,255,255 ; jmpq 43c4 <_sk_load_bgra_dst_sse2+0x10>
+ DB 233,100,255,255,255 ; jmpq 427f <_sk_load_bgra_dst_sse2+0x10>
PUBLIC _sk_gather_bgra_sse2
_sk_gather_bgra_sse2 LABEL PROC
@@ -27319,7 +26922,7 @@ _sk_gather_bgra_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -27343,11 +26946,11 @@ _sk_gather_bgra_sse2 LABEL PROC
DB 102,67,15,110,12,145 ; movd (%r9,%r10,4),%xmm1
DB 102,68,15,98,201 ; punpckldq %xmm1,%xmm9
DB 102,68,15,98,200 ; punpckldq %xmm0,%xmm9
- DB 102,15,111,5,30,46,0,0 ; movdqa 0x2e1e(%rip),%xmm0 # 7300 <_sk_callback_sse2+0xfe6>
+ DB 102,15,111,5,243,45,0,0 ; movdqa 0x2df3(%rip),%xmm0 # 7190 <_sk_callback_sse2+0xfbb>
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,219,200 ; pand %xmm0,%xmm1
DB 15,91,209 ; cvtdq2ps %xmm1,%xmm2
- DB 68,15,40,5,26,46,0,0 ; movaps 0x2e1a(%rip),%xmm8 # 7310 <_sk_callback_sse2+0xff6>
+ DB 68,15,40,5,239,45,0,0 ; movaps 0x2def(%rip),%xmm8 # 71a0 <_sk_callback_sse2+0xfcb>
DB 65,15,89,208 ; mulps %xmm8,%xmm2
DB 102,65,15,111,201 ; movdqa %xmm9,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -27370,7 +26973,7 @@ PUBLIC _sk_store_bgra_sse2
_sk_store_bgra_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 68,15,40,5,220,45,0,0 ; movaps 0x2ddc(%rip),%xmm8 # 7320 <_sk_callback_sse2+0x1006>
+ DB 68,15,40,5,177,45,0,0 ; movaps 0x2db1(%rip),%xmm8 # 71b0 <_sk_callback_sse2+0xfdb>
DB 68,15,40,202 ; movaps %xmm2,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 102,69,15,91,201 ; cvtps2dq %xmm9,%xmm9
@@ -27389,31 +26992,31 @@ _sk_store_bgra_sse2 LABEL PROC
DB 102,69,15,235,193 ; por %xmm9,%xmm8
DB 102,69,15,235,194 ; por %xmm10,%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,10 ; jne 45a4 <_sk_store_bgra_sse2+0x6d>
+ DB 117,10 ; jne 445f <_sk_store_bgra_sse2+0x6d>
DB 243,68,15,127,4,144 ; movdqu %xmm8,(%rax,%rdx,4)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 69,137,193 ; mov %r8d,%r9d
DB 65,128,225,3 ; and $0x3,%r9b
DB 65,128,249,1 ; cmp $0x1,%r9b
- DB 116,33 ; je 45d2 <_sk_store_bgra_sse2+0x9b>
+ DB 116,33 ; je 448d <_sk_store_bgra_sse2+0x9b>
DB 65,128,249,2 ; cmp $0x2,%r9b
- DB 116,19 ; je 45ca <_sk_store_bgra_sse2+0x93>
+ DB 116,19 ; je 4485 <_sk_store_bgra_sse2+0x93>
DB 65,128,249,3 ; cmp $0x3,%r9b
- DB 117,227 ; jne 45a0 <_sk_store_bgra_sse2+0x69>
+ DB 117,227 ; jne 445b <_sk_store_bgra_sse2+0x69>
DB 102,69,15,112,200,78 ; pshufd $0x4e,%xmm8,%xmm9
DB 102,68,15,126,76,144,8 ; movd %xmm9,0x8(%rax,%rdx,4)
DB 102,68,15,214,4,144 ; movq %xmm8,(%rax,%rdx,4)
- DB 235,206 ; jmp 45a0 <_sk_store_bgra_sse2+0x69>
+ DB 235,206 ; jmp 445b <_sk_store_bgra_sse2+0x69>
DB 102,68,15,126,4,144 ; movd %xmm8,(%rax,%rdx,4)
- DB 235,198 ; jmp 45a0 <_sk_store_bgra_sse2+0x69>
+ DB 235,198 ; jmp 445b <_sk_store_bgra_sse2+0x69>
PUBLIC _sk_load_f16_sse2
_sk_load_f16_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,96,1,0,0 ; jne 4748 <_sk_load_f16_sse2+0x16e>
+ DB 15,133,96,1,0,0 ; jne 4603 <_sk_load_f16_sse2+0x16e>
DB 102,15,16,4,208 ; movupd (%rax,%rdx,8),%xmm0
DB 102,15,16,76,208,16 ; movupd 0x10(%rax,%rdx,8),%xmm1
DB 102,68,15,40,192 ; movapd %xmm0,%xmm8
@@ -27425,7 +27028,7 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1
DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1
- DB 102,68,15,111,13,8,45,0,0 ; movdqa 0x2d08(%rip),%xmm9 # 7330 <_sk_callback_sse2+0x1016>
+ DB 102,68,15,111,13,221,44,0,0 ; movdqa 0x2cdd(%rip),%xmm9 # 71c0 <_sk_callback_sse2+0xfeb>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,193 ; pand %xmm9,%xmm0
DB 102,15,239,200 ; pxor %xmm0,%xmm1
@@ -27433,11 +27036,11 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13
DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13
DB 102,68,15,235,232 ; por %xmm0,%xmm13
- DB 102,68,15,111,29,237,44,0,0 ; movdqa 0x2ced(%rip),%xmm11 # 7340 <_sk_callback_sse2+0x1026>
+ DB 102,68,15,111,29,194,44,0,0 ; movdqa 0x2cc2(%rip),%xmm11 # 71d0 <_sk_callback_sse2+0xffb>
DB 102,69,15,254,235 ; paddd %xmm11,%xmm13
- DB 102,68,15,111,37,239,44,0,0 ; movdqa 0x2cef(%rip),%xmm12 # 7350 <_sk_callback_sse2+0x1036>
+ DB 102,68,15,111,37,196,44,0,0 ; movdqa 0x2cc4(%rip),%xmm12 # 71e0 <_sk_callback_sse2+0x100b>
DB 102,65,15,239,204 ; pxor %xmm12,%xmm1
- DB 102,15,111,29,242,44,0,0 ; movdqa 0x2cf2(%rip),%xmm3 # 7360 <_sk_callback_sse2+0x1046>
+ DB 102,15,111,29,199,44,0,0 ; movdqa 0x2cc7(%rip),%xmm3 # 71f0 <_sk_callback_sse2+0x101b>
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0
DB 102,65,15,223,197 ; pandn %xmm13,%xmm0
@@ -27485,24 +27088,24 @@ _sk_load_f16_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,15,16,4,208 ; movsd (%rax,%rdx,8),%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,17 ; jne 4764 <_sk_load_f16_sse2+0x18a>
+ DB 117,17 ; jne 461f <_sk_load_f16_sse2+0x18a>
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 233,143,254,255,255 ; jmpq 45f3 <_sk_load_f16_sse2+0x19>
+ DB 233,143,254,255,255 ; jmpq 44ae <_sk_load_f16_sse2+0x19>
DB 102,15,22,68,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,123,254,255,255 ; jb 45f3 <_sk_load_f16_sse2+0x19>
+ DB 15,130,123,254,255,255 ; jb 44ae <_sk_load_f16_sse2+0x19>
DB 242,15,16,76,208,16 ; movsd 0x10(%rax,%rdx,8),%xmm1
- DB 233,112,254,255,255 ; jmpq 45f3 <_sk_load_f16_sse2+0x19>
+ DB 233,112,254,255,255 ; jmpq 44ae <_sk_load_f16_sse2+0x19>
PUBLIC _sk_load_f16_dst_sse2
_sk_load_f16_dst_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,96,1,0,0 ; jne 48f1 <_sk_load_f16_dst_sse2+0x16e>
+ DB 15,133,96,1,0,0 ; jne 47ac <_sk_load_f16_dst_sse2+0x16e>
DB 102,15,16,36,208 ; movupd (%rax,%rdx,8),%xmm4
DB 102,15,16,108,208,16 ; movupd 0x10(%rax,%rdx,8),%xmm5
DB 102,68,15,40,196 ; movapd %xmm4,%xmm8
@@ -27514,7 +27117,7 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
DB 102,65,15,111,238 ; movdqa %xmm14,%xmm5
DB 102,65,15,97,234 ; punpcklwd %xmm10,%xmm5
- DB 102,68,15,111,13,159,43,0,0 ; movdqa 0x2b9f(%rip),%xmm9 # 7370 <_sk_callback_sse2+0x1056>
+ DB 102,68,15,111,13,116,43,0,0 ; movdqa 0x2b74(%rip),%xmm9 # 7200 <_sk_callback_sse2+0x102b>
DB 102,15,111,229 ; movdqa %xmm5,%xmm4
DB 102,65,15,219,225 ; pand %xmm9,%xmm4
DB 102,15,239,236 ; pxor %xmm4,%xmm5
@@ -27522,11 +27125,11 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 102,68,15,111,237 ; movdqa %xmm5,%xmm13
DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13
DB 102,68,15,235,236 ; por %xmm4,%xmm13
- DB 102,68,15,111,29,132,43,0,0 ; movdqa 0x2b84(%rip),%xmm11 # 7380 <_sk_callback_sse2+0x1066>
+ DB 102,68,15,111,29,89,43,0,0 ; movdqa 0x2b59(%rip),%xmm11 # 7210 <_sk_callback_sse2+0x103b>
DB 102,69,15,254,235 ; paddd %xmm11,%xmm13
- DB 102,68,15,111,37,134,43,0,0 ; movdqa 0x2b86(%rip),%xmm12 # 7390 <_sk_callback_sse2+0x1076>
+ DB 102,68,15,111,37,91,43,0,0 ; movdqa 0x2b5b(%rip),%xmm12 # 7220 <_sk_callback_sse2+0x104b>
DB 102,65,15,239,236 ; pxor %xmm12,%xmm5
- DB 102,15,111,61,137,43,0,0 ; movdqa 0x2b89(%rip),%xmm7 # 73a0 <_sk_callback_sse2+0x1086>
+ DB 102,15,111,61,94,43,0,0 ; movdqa 0x2b5e(%rip),%xmm7 # 7230 <_sk_callback_sse2+0x105b>
DB 102,15,111,231 ; movdqa %xmm7,%xmm4
DB 102,15,102,229 ; pcmpgtd %xmm5,%xmm4
DB 102,65,15,223,229 ; pandn %xmm13,%xmm4
@@ -27574,17 +27177,17 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,15,16,36,208 ; movsd (%rax,%rdx,8),%xmm4
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,17 ; jne 490d <_sk_load_f16_dst_sse2+0x18a>
+ DB 117,17 ; jne 47c8 <_sk_load_f16_dst_sse2+0x18a>
DB 102,15,87,237 ; xorpd %xmm5,%xmm5
DB 102,15,20,229 ; unpcklpd %xmm5,%xmm4
DB 102,15,87,237 ; xorpd %xmm5,%xmm5
- DB 233,143,254,255,255 ; jmpq 479c <_sk_load_f16_dst_sse2+0x19>
+ DB 233,143,254,255,255 ; jmpq 4657 <_sk_load_f16_dst_sse2+0x19>
DB 102,15,22,100,208,8 ; movhpd 0x8(%rax,%rdx,8),%xmm4
DB 102,15,87,237 ; xorpd %xmm5,%xmm5
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,123,254,255,255 ; jb 479c <_sk_load_f16_dst_sse2+0x19>
+ DB 15,130,123,254,255,255 ; jb 4657 <_sk_load_f16_dst_sse2+0x19>
DB 242,15,16,108,208,16 ; movsd 0x10(%rax,%rdx,8),%xmm5
- DB 233,112,254,255,255 ; jmpq 479c <_sk_load_f16_dst_sse2+0x19>
+ DB 233,112,254,255,255 ; jmpq 4657 <_sk_load_f16_dst_sse2+0x19>
PUBLIC _sk_gather_f16_sse2
_sk_gather_f16_sse2 LABEL PROC
@@ -27592,7 +27195,7 @@ _sk_gather_f16_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,80,16 ; movd 0x10(%rax),%xmm2
+ DB 102,15,110,80,8 ; movd 0x8(%rax),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -27624,7 +27227,7 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,69,15,239,210 ; pxor %xmm10,%xmm10
DB 102,65,15,111,206 ; movdqa %xmm14,%xmm1
DB 102,65,15,97,202 ; punpcklwd %xmm10,%xmm1
- DB 102,68,15,111,13,219,41,0,0 ; movdqa 0x29db(%rip),%xmm9 # 73b0 <_sk_callback_sse2+0x1096>
+ DB 102,68,15,111,13,176,41,0,0 ; movdqa 0x29b0(%rip),%xmm9 # 7240 <_sk_callback_sse2+0x106b>
DB 102,15,111,193 ; movdqa %xmm1,%xmm0
DB 102,65,15,219,193 ; pand %xmm9,%xmm0
DB 102,15,239,200 ; pxor %xmm0,%xmm1
@@ -27632,11 +27235,11 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,68,15,111,233 ; movdqa %xmm1,%xmm13
DB 102,65,15,114,245,13 ; pslld $0xd,%xmm13
DB 102,68,15,235,232 ; por %xmm0,%xmm13
- DB 102,68,15,111,29,192,41,0,0 ; movdqa 0x29c0(%rip),%xmm11 # 73c0 <_sk_callback_sse2+0x10a6>
+ DB 102,68,15,111,29,149,41,0,0 ; movdqa 0x2995(%rip),%xmm11 # 7250 <_sk_callback_sse2+0x107b>
DB 102,69,15,254,235 ; paddd %xmm11,%xmm13
- DB 102,68,15,111,37,194,41,0,0 ; movdqa 0x29c2(%rip),%xmm12 # 73d0 <_sk_callback_sse2+0x10b6>
+ DB 102,68,15,111,37,151,41,0,0 ; movdqa 0x2997(%rip),%xmm12 # 7260 <_sk_callback_sse2+0x108b>
DB 102,65,15,239,204 ; pxor %xmm12,%xmm1
- DB 102,15,111,29,197,41,0,0 ; movdqa 0x29c5(%rip),%xmm3 # 73e0 <_sk_callback_sse2+0x10c6>
+ DB 102,15,111,29,154,41,0,0 ; movdqa 0x299a(%rip),%xmm3 # 7270 <_sk_callback_sse2+0x109b>
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
DB 102,15,102,193 ; pcmpgtd %xmm1,%xmm0
DB 102,65,15,223,197 ; pandn %xmm13,%xmm0
@@ -27688,17 +27291,17 @@ PUBLIC _sk_store_f16_sse2
_sk_store_f16_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 72,139,0 ; mov (%rax),%rax
- DB 102,68,15,111,21,236,40,0,0 ; movdqa 0x28ec(%rip),%xmm10 # 73f0 <_sk_callback_sse2+0x10d6>
+ DB 102,68,15,111,21,193,40,0,0 ; movdqa 0x28c1(%rip),%xmm10 # 7280 <_sk_callback_sse2+0x10ab>
DB 102,68,15,111,224 ; movdqa %xmm0,%xmm12
DB 102,69,15,219,226 ; pand %xmm10,%xmm12
DB 102,68,15,111,232 ; movdqa %xmm0,%xmm13
DB 102,69,15,239,236 ; pxor %xmm12,%xmm13
- DB 102,68,15,111,13,223,40,0,0 ; movdqa 0x28df(%rip),%xmm9 # 7400 <_sk_callback_sse2+0x10e6>
+ DB 102,68,15,111,13,180,40,0,0 ; movdqa 0x28b4(%rip),%xmm9 # 7290 <_sk_callback_sse2+0x10bb>
DB 102,65,15,114,212,16 ; psrld $0x10,%xmm12
DB 102,69,15,111,193 ; movdqa %xmm9,%xmm8
DB 102,69,15,102,197 ; pcmpgtd %xmm13,%xmm8
DB 102,65,15,114,213,13 ; psrld $0xd,%xmm13
- DB 102,68,15,111,29,208,40,0,0 ; movdqa 0x28d0(%rip),%xmm11 # 7410 <_sk_callback_sse2+0x10f6>
+ DB 102,68,15,111,29,165,40,0,0 ; movdqa 0x28a5(%rip),%xmm11 # 72a0 <_sk_callback_sse2+0x10cb>
DB 102,69,15,235,227 ; por %xmm11,%xmm12
DB 102,69,15,254,229 ; paddd %xmm13,%xmm12
DB 102,65,15,114,244,16 ; pslld $0x10,%xmm12
@@ -27750,7 +27353,7 @@ _sk_store_f16_sse2 LABEL PROC
DB 102,69,15,111,200 ; movdqa %xmm8,%xmm9
DB 102,69,15,98,204 ; punpckldq %xmm12,%xmm9
DB 77,133,192 ; test %r8,%r8
- DB 117,21 ; jne 4c62 <_sk_store_f16_sse2+0x16c>
+ DB 117,21 ; jne 4b1d <_sk_store_f16_sse2+0x16c>
DB 68,15,17,12,208 ; movups %xmm9,(%rax,%rdx,8)
DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8
DB 243,68,15,127,68,208,16 ; movdqu %xmm8,0x10(%rax,%rdx,8)
@@ -27758,13 +27361,13 @@ _sk_store_f16_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 102,68,15,214,12,208 ; movq %xmm9,(%rax,%rdx,8)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 4c5e <_sk_store_f16_sse2+0x168>
+ DB 116,240 ; je 4b19 <_sk_store_f16_sse2+0x168>
DB 102,68,15,23,76,208,8 ; movhpd %xmm9,0x8(%rax,%rdx,8)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 4c5e <_sk_store_f16_sse2+0x168>
+ DB 114,227 ; jb 4b19 <_sk_store_f16_sse2+0x168>
DB 102,69,15,106,196 ; punpckhdq %xmm12,%xmm8
DB 102,68,15,214,68,208,16 ; movq %xmm8,0x10(%rax,%rdx,8)
- DB 235,213 ; jmp 4c5e <_sk_store_f16_sse2+0x168>
+ DB 235,213 ; jmp 4b19 <_sk_store_f16_sse2+0x168>
PUBLIC _sk_load_u16_be_sse2
_sk_load_u16_be_sse2 LABEL PROC
@@ -27772,7 +27375,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,190,0,0,0 ; jne 4d5d <_sk_load_u16_be_sse2+0xd4>
+ DB 15,133,190,0,0,0 ; jne 4c18 <_sk_load_u16_be_sse2+0xd4>
DB 102,65,15,16,4,65 ; movupd (%r9,%rax,2),%xmm0
DB 102,65,15,16,76,65,16 ; movupd 0x10(%r9,%rax,2),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
@@ -27789,7 +27392,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 102,69,15,239,201 ; pxor %xmm9,%xmm9
DB 102,65,15,97,201 ; punpcklwd %xmm9,%xmm1
DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0
- DB 68,15,40,5,48,39,0,0 ; movaps 0x2730(%rip),%xmm8 # 7420 <_sk_callback_sse2+0x1106>
+ DB 68,15,40,5,5,39,0,0 ; movaps 0x2705(%rip),%xmm8 # 72b0 <_sk_callback_sse2+0x10db>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -27817,17 +27420,17 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 242,65,15,16,4,65 ; movsd (%r9,%rax,2),%xmm0
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,17 ; jne 4d7a <_sk_load_u16_be_sse2+0xf1>
+ DB 117,17 ; jne 4c35 <_sk_load_u16_be_sse2+0xf1>
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 102,15,20,193 ; unpcklpd %xmm1,%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
- DB 233,50,255,255,255 ; jmpq 4cac <_sk_load_u16_be_sse2+0x23>
+ DB 233,50,255,255,255 ; jmpq 4b67 <_sk_load_u16_be_sse2+0x23>
DB 102,65,15,22,68,65,8 ; movhpd 0x8(%r9,%rax,2),%xmm0
DB 102,15,87,201 ; xorpd %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 15,130,29,255,255,255 ; jb 4cac <_sk_load_u16_be_sse2+0x23>
+ DB 15,130,29,255,255,255 ; jb 4b67 <_sk_load_u16_be_sse2+0x23>
DB 242,65,15,16,76,65,16 ; movsd 0x10(%r9,%rax,2),%xmm1
- DB 233,17,255,255,255 ; jmpq 4cac <_sk_load_u16_be_sse2+0x23>
+ DB 233,17,255,255,255 ; jmpq 4b67 <_sk_load_u16_be_sse2+0x23>
PUBLIC _sk_load_rgb_u16_be_sse2
_sk_load_rgb_u16_be_sse2 LABEL PROC
@@ -27835,7 +27438,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,82 ; lea (%rdx,%rdx,2),%rax
DB 77,133,192 ; test %r8,%r8
- DB 15,133,175,0,0,0 ; jne 4e5c <_sk_load_rgb_u16_be_sse2+0xc1>
+ DB 15,133,175,0,0,0 ; jne 4d17 <_sk_load_rgb_u16_be_sse2+0xc1>
DB 243,65,15,111,20,65 ; movdqu (%r9,%rax,2),%xmm2
DB 243,65,15,111,92,65,8 ; movdqu 0x8(%r9,%rax,2),%xmm3
DB 102,15,115,219,4 ; psrldq $0x4,%xmm3
@@ -27856,7 +27459,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 102,69,15,239,192 ; pxor %xmm8,%xmm8
DB 102,65,15,97,200 ; punpcklwd %xmm8,%xmm1
DB 15,91,193 ; cvtdq2ps %xmm1,%xmm0
- DB 68,15,40,13,31,38,0,0 ; movaps 0x261f(%rip),%xmm9 # 7430 <_sk_callback_sse2+0x1116>
+ DB 68,15,40,13,244,37,0,0 ; movaps 0x25f4(%rip),%xmm9 # 72c0 <_sk_callback_sse2+0x10eb>
DB 65,15,89,193 ; mulps %xmm9,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -27873,34 +27476,34 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
DB 65,15,89,209 ; mulps %xmm9,%xmm2
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 15,40,29,230,37,0,0 ; movaps 0x25e6(%rip),%xmm3 # 7440 <_sk_callback_sse2+0x1126>
+ DB 15,40,29,187,37,0,0 ; movaps 0x25bb(%rip),%xmm3 # 72d0 <_sk_callback_sse2+0x10fb>
DB 255,224 ; jmpq *%rax
DB 102,65,15,110,20,65 ; movd (%r9,%rax,2),%xmm2
DB 102,65,15,196,84,65,4,2 ; pinsrw $0x2,0x4(%r9,%rax,2),%xmm2
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,13 ; jne 4e81 <_sk_load_rgb_u16_be_sse2+0xe6>
+ DB 117,13 ; jne 4d3c <_sk_load_rgb_u16_be_sse2+0xe6>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,80,255,255,255 ; jmpq 4dd1 <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 233,80,255,255,255 ; jmpq 4c8c <_sk_load_rgb_u16_be_sse2+0x36>
DB 102,65,15,110,68,65,6 ; movd 0x6(%r9,%rax,2),%xmm0
DB 102,65,15,196,68,65,10,2 ; pinsrw $0x2,0xa(%r9,%rax,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,24 ; jb 4eb2 <_sk_load_rgb_u16_be_sse2+0x117>
+ DB 114,24 ; jb 4d6d <_sk_load_rgb_u16_be_sse2+0x117>
DB 102,65,15,110,92,65,12 ; movd 0xc(%r9,%rax,2),%xmm3
DB 102,65,15,196,92,65,16,2 ; pinsrw $0x2,0x10(%r9,%rax,2),%xmm3
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 233,31,255,255,255 ; jmpq 4dd1 <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 233,31,255,255,255 ; jmpq 4c8c <_sk_load_rgb_u16_be_sse2+0x36>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
- DB 233,22,255,255,255 ; jmpq 4dd1 <_sk_load_rgb_u16_be_sse2+0x36>
+ DB 233,22,255,255,255 ; jmpq 4c8c <_sk_load_rgb_u16_be_sse2+0x36>
PUBLIC _sk_store_u16_be_sse2
_sk_store_u16_be_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 76,139,8 ; mov (%rax),%r9
DB 72,141,4,149,0,0,0,0 ; lea 0x0(,%rdx,4),%rax
- DB 68,15,40,21,128,37,0,0 ; movaps 0x2580(%rip),%xmm10 # 7450 <_sk_callback_sse2+0x1136>
+ DB 68,15,40,21,85,37,0,0 ; movaps 0x2555(%rip),%xmm10 # 72e0 <_sk_callback_sse2+0x110b>
DB 68,15,40,192 ; movaps %xmm0,%xmm8
DB 69,15,89,194 ; mulps %xmm10,%xmm8
DB 102,69,15,91,192 ; cvtps2dq %xmm8,%xmm8
@@ -27945,7 +27548,7 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 102,69,15,111,208 ; movdqa %xmm8,%xmm10
DB 102,69,15,98,209 ; punpckldq %xmm9,%xmm10
DB 77,133,192 ; test %r8,%r8
- DB 117,21 ; jne 4fca <_sk_store_u16_be_sse2+0x10f>
+ DB 117,21 ; jne 4e85 <_sk_store_u16_be_sse2+0x10f>
DB 69,15,17,20,65 ; movups %xmm10,(%r9,%rax,2)
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
DB 243,69,15,127,68,65,16 ; movdqu %xmm8,0x10(%r9,%rax,2)
@@ -27953,13 +27556,13 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 102,69,15,214,20,65 ; movq %xmm10,(%r9,%rax,2)
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,240 ; je 4fc6 <_sk_store_u16_be_sse2+0x10b>
+ DB 116,240 ; je 4e81 <_sk_store_u16_be_sse2+0x10b>
DB 102,69,15,23,84,65,8 ; movhpd %xmm10,0x8(%r9,%rax,2)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,227 ; jb 4fc6 <_sk_store_u16_be_sse2+0x10b>
+ DB 114,227 ; jb 4e81 <_sk_store_u16_be_sse2+0x10b>
DB 102,69,15,106,193 ; punpckhdq %xmm9,%xmm8
DB 102,69,15,214,68,65,16 ; movq %xmm8,0x10(%r9,%rax,2)
- DB 235,213 ; jmp 4fc6 <_sk_store_u16_be_sse2+0x10b>
+ DB 235,213 ; jmp 4e81 <_sk_store_u16_be_sse2+0x10b>
PUBLIC _sk_load_f32_sse2
_sk_load_f32_sse2 LABEL PROC
@@ -27970,7 +27573,7 @@ _sk_load_f32_sse2 LABEL PROC
DB 72,193,224,4 ; shl $0x4,%rax
DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,66 ; jne 5051 <_sk_load_f32_sse2+0x60>
+ DB 117,66 ; jne 4f0c <_sk_load_f32_sse2+0x60>
DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
@@ -27990,17 +27593,17 @@ _sk_load_f32_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,8 ; jne 5063 <_sk_load_f32_sse2+0x72>
+ DB 117,8 ; jne 4f1e <_sk_load_f32_sse2+0x72>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
- DB 235,190 ; jmp 5021 <_sk_load_f32_sse2+0x30>
+ DB 235,190 ; jmp 4edc <_sk_load_f32_sse2+0x30>
DB 67,15,16,68,138,16 ; movups 0x10(%r10,%r9,4),%xmm0
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,8 ; jb 5077 <_sk_load_f32_sse2+0x86>
+ DB 114,8 ; jb 4f32 <_sk_load_f32_sse2+0x86>
DB 67,15,16,92,138,32 ; movups 0x20(%r10,%r9,4),%xmm3
- DB 235,170 ; jmp 5021 <_sk_load_f32_sse2+0x30>
+ DB 235,170 ; jmp 4edc <_sk_load_f32_sse2+0x30>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 235,165 ; jmp 5021 <_sk_load_f32_sse2+0x30>
+ DB 235,165 ; jmp 4edc <_sk_load_f32_sse2+0x30>
PUBLIC _sk_load_f32_dst_sse2
_sk_load_f32_dst_sse2 LABEL PROC
@@ -28011,7 +27614,7 @@ _sk_load_f32_dst_sse2 LABEL PROC
DB 72,193,224,4 ; shl $0x4,%rax
DB 69,15,16,4,2 ; movups (%r10,%rax,1),%xmm8
DB 77,133,192 ; test %r8,%r8
- DB 117,66 ; jne 50dc <_sk_load_f32_dst_sse2+0x60>
+ DB 117,66 ; jne 4f97 <_sk_load_f32_dst_sse2+0x60>
DB 67,15,16,100,138,16 ; movups 0x10(%r10,%r9,4),%xmm4
DB 67,15,16,124,138,32 ; movups 0x20(%r10,%r9,4),%xmm7
DB 71,15,16,76,138,48 ; movups 0x30(%r10,%r9,4),%xmm9
@@ -28031,17 +27634,17 @@ _sk_load_f32_dst_sse2 LABEL PROC
DB 255,224 ; jmpq *%rax
DB 69,15,87,201 ; xorps %xmm9,%xmm9
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 117,8 ; jne 50ee <_sk_load_f32_dst_sse2+0x72>
+ DB 117,8 ; jne 4fa9 <_sk_load_f32_dst_sse2+0x72>
DB 15,87,255 ; xorps %xmm7,%xmm7
DB 15,87,228 ; xorps %xmm4,%xmm4
- DB 235,190 ; jmp 50ac <_sk_load_f32_dst_sse2+0x30>
+ DB 235,190 ; jmp 4f67 <_sk_load_f32_dst_sse2+0x30>
DB 67,15,16,100,138,16 ; movups 0x10(%r10,%r9,4),%xmm4
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,8 ; jb 5102 <_sk_load_f32_dst_sse2+0x86>
+ DB 114,8 ; jb 4fbd <_sk_load_f32_dst_sse2+0x86>
DB 67,15,16,124,138,32 ; movups 0x20(%r10,%r9,4),%xmm7
- DB 235,170 ; jmp 50ac <_sk_load_f32_dst_sse2+0x30>
+ DB 235,170 ; jmp 4f67 <_sk_load_f32_dst_sse2+0x30>
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 235,165 ; jmp 50ac <_sk_load_f32_dst_sse2+0x30>
+ DB 235,165 ; jmp 4f67 <_sk_load_f32_dst_sse2+0x30>
PUBLIC _sk_store_f32_sse2
_sk_store_f32_sse2 LABEL PROC
@@ -28065,7 +27668,7 @@ _sk_store_f32_sse2 LABEL PROC
DB 102,69,15,20,203 ; unpcklpd %xmm11,%xmm9
DB 102,69,15,17,36,2 ; movupd %xmm12,(%r10,%rax,1)
DB 77,133,192 ; test %r8,%r8
- DB 117,29 ; jne 5179 <_sk_store_f32_sse2+0x72>
+ DB 117,29 ; jne 5034 <_sk_store_f32_sse2+0x72>
DB 102,69,15,21,211 ; unpckhpd %xmm11,%xmm10
DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
@@ -28073,12 +27676,12 @@ _sk_store_f32_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
DB 73,131,248,1 ; cmp $0x1,%r8
- DB 116,246 ; je 5175 <_sk_store_f32_sse2+0x6e>
+ DB 116,246 ; je 5030 <_sk_store_f32_sse2+0x6e>
DB 71,15,17,68,138,16 ; movups %xmm8,0x10(%r10,%r9,4)
DB 73,131,248,3 ; cmp $0x3,%r8
- DB 114,234 ; jb 5175 <_sk_store_f32_sse2+0x6e>
+ DB 114,234 ; jb 5030 <_sk_store_f32_sse2+0x6e>
DB 102,71,15,17,76,138,32 ; movupd %xmm9,0x20(%r10,%r9,4)
- DB 235,225 ; jmp 5175 <_sk_store_f32_sse2+0x6e>
+ DB 235,225 ; jmp 5030 <_sk_store_f32_sse2+0x6e>
PUBLIC _sk_clamp_x_sse2
_sk_clamp_x_sse2 LABEL PROC
@@ -28118,7 +27721,7 @@ _sk_repeat_x_sse2 LABEL PROC
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,78,34,0,0 ; andps 0x224e(%rip),%xmm9 # 7460 <_sk_callback_sse2+0x1146>
+ DB 68,15,84,13,35,34,0,0 ; andps 0x2223(%rip),%xmm9 # 72f0 <_sk_callback_sse2+0x111b>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 69,15,89,208 ; mulps %xmm8,%xmm10
@@ -28139,7 +27742,7 @@ _sk_repeat_y_sse2 LABEL PROC
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,15,34,0,0 ; andps 0x220f(%rip),%xmm9 # 7470 <_sk_callback_sse2+0x1156>
+ DB 68,15,84,13,228,33,0,0 ; andps 0x21e4(%rip),%xmm9 # 7300 <_sk_callback_sse2+0x112b>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 69,15,89,208 ; mulps %xmm8,%xmm10
@@ -28160,13 +27763,13 @@ _sk_mirror_x_sse2 LABEL PROC
DB 65,15,92,192 ; subps %xmm8,%xmm0
DB 243,69,15,88,201 ; addss %xmm9,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
- DB 243,68,15,89,21,127,38,0,0 ; mulss 0x267f(%rip),%xmm10 # 7930 <_sk_callback_sse2+0x1616>
+ DB 243,68,15,89,21,84,38,0,0 ; mulss 0x2654(%rip),%xmm10 # 77c0 <_sk_callback_sse2+0x15eb>
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 68,15,89,208 ; mulps %xmm0,%xmm10
DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11
DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11
DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10
- DB 68,15,84,21,176,33,0,0 ; andps 0x21b0(%rip),%xmm10 # 7480 <_sk_callback_sse2+0x1166>
+ DB 68,15,84,21,133,33,0,0 ; andps 0x2185(%rip),%xmm10 # 7310 <_sk_callback_sse2+0x113b>
DB 69,15,87,228 ; xorps %xmm12,%xmm12
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 69,15,89,217 ; mulps %xmm9,%xmm11
@@ -28190,13 +27793,13 @@ _sk_mirror_y_sse2 LABEL PROC
DB 65,15,92,200 ; subps %xmm8,%xmm1
DB 243,69,15,88,201 ; addss %xmm9,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
- DB 243,68,15,89,21,9,38,0,0 ; mulss 0x2609(%rip),%xmm10 # 7934 <_sk_callback_sse2+0x161a>
+ DB 243,68,15,89,21,222,37,0,0 ; mulss 0x25de(%rip),%xmm10 # 77c4 <_sk_callback_sse2+0x15ef>
DB 69,15,198,210,0 ; shufps $0x0,%xmm10,%xmm10
DB 68,15,89,209 ; mulps %xmm1,%xmm10
DB 243,69,15,91,218 ; cvttps2dq %xmm10,%xmm11
DB 69,15,91,219 ; cvtdq2ps %xmm11,%xmm11
DB 69,15,194,211,1 ; cmpltps %xmm11,%xmm10
- DB 68,15,84,21,70,33,0,0 ; andps 0x2146(%rip),%xmm10 # 7490 <_sk_callback_sse2+0x1176>
+ DB 68,15,84,21,27,33,0,0 ; andps 0x211b(%rip),%xmm10 # 7320 <_sk_callback_sse2+0x114b>
DB 69,15,87,228 ; xorps %xmm12,%xmm12
DB 69,15,92,218 ; subps %xmm10,%xmm11
DB 69,15,89,217 ; mulps %xmm9,%xmm11
@@ -28214,7 +27817,7 @@ PUBLIC _sk_clamp_x_1_sse2
_sk_clamp_x_1_sse2 LABEL PROC
DB 69,15,87,192 ; xorps %xmm8,%xmm8
DB 68,15,95,192 ; maxps %xmm0,%xmm8
- DB 68,15,93,5,24,33,0,0 ; minps 0x2118(%rip),%xmm8 # 74a0 <_sk_callback_sse2+0x1186>
+ DB 68,15,93,5,237,32,0,0 ; minps 0x20ed(%rip),%xmm8 # 7330 <_sk_callback_sse2+0x115b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 65,15,40,192 ; movaps %xmm8,%xmm0
DB 255,224 ; jmpq *%rax
@@ -28225,7 +27828,7 @@ _sk_repeat_x_1_sse2 LABEL PROC
DB 69,15,91,192 ; cvtdq2ps %xmm8,%xmm8
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,194,200,1 ; cmpltps %xmm8,%xmm9
- DB 68,15,84,13,6,33,0,0 ; andps 0x2106(%rip),%xmm9 # 74b0 <_sk_callback_sse2+0x1196>
+ DB 68,15,84,13,219,32,0,0 ; andps 0x20db(%rip),%xmm9 # 7340 <_sk_callback_sse2+0x116b>
DB 69,15,92,193 ; subps %xmm9,%xmm8
DB 65,15,92,192 ; subps %xmm8,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -28233,14 +27836,14 @@ _sk_repeat_x_1_sse2 LABEL PROC
PUBLIC _sk_mirror_x_1_sse2
_sk_mirror_x_1_sse2 LABEL PROC
- DB 68,15,40,5,2,33,0,0 ; movaps 0x2102(%rip),%xmm8 # 74c0 <_sk_callback_sse2+0x11a6>
+ DB 68,15,40,5,215,32,0,0 ; movaps 0x20d7(%rip),%xmm8 # 7350 <_sk_callback_sse2+0x117b>
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,13,6,33,0,0 ; movaps 0x2106(%rip),%xmm9 # 74d0 <_sk_callback_sse2+0x11b6>
+ DB 68,15,40,13,219,32,0,0 ; movaps 0x20db(%rip),%xmm9 # 7360 <_sk_callback_sse2+0x118b>
DB 68,15,89,200 ; mulps %xmm0,%xmm9
DB 243,69,15,91,209 ; cvttps2dq %xmm9,%xmm10
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,84,13,252,32,0,0 ; andps 0x20fc(%rip),%xmm9 # 74e0 <_sk_callback_sse2+0x11c6>
+ DB 68,15,84,13,209,32,0,0 ; andps 0x20d1(%rip),%xmm9 # 7370 <_sk_callback_sse2+0x119b>
DB 69,15,87,219 ; xorps %xmm11,%xmm11
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,88,210 ; addps %xmm10,%xmm10
@@ -28254,10 +27857,10 @@ _sk_mirror_x_1_sse2 LABEL PROC
PUBLIC _sk_luminance_to_alpha_sse2
_sk_luminance_to_alpha_sse2 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 15,89,5,226,32,0,0 ; mulps 0x20e2(%rip),%xmm0 # 74f0 <_sk_callback_sse2+0x11d6>
- DB 15,89,13,235,32,0,0 ; mulps 0x20eb(%rip),%xmm1 # 7500 <_sk_callback_sse2+0x11e6>
+ DB 15,89,5,183,32,0,0 ; mulps 0x20b7(%rip),%xmm0 # 7380 <_sk_callback_sse2+0x11ab>
+ DB 15,89,13,192,32,0,0 ; mulps 0x20c0(%rip),%xmm1 # 7390 <_sk_callback_sse2+0x11bb>
DB 15,88,200 ; addps %xmm0,%xmm1
- DB 15,89,29,241,32,0,0 ; mulps 0x20f1(%rip),%xmm3 # 7510 <_sk_callback_sse2+0x11f6>
+ DB 15,89,29,198,32,0,0 ; mulps 0x20c6(%rip),%xmm3 # 73a0 <_sk_callback_sse2+0x11cb>
DB 15,88,217 ; addps %xmm1,%xmm3
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,87,192 ; xorps %xmm0,%xmm0
@@ -28553,9 +28156,9 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
DB 72,139,24 ; mov (%rax),%rbx
DB 76,139,112,8 ; mov 0x8(%rax),%r14
DB 72,255,203 ; dec %rbx
- DB 120,7 ; js 58bf <_sk_evenly_spaced_gradient_sse2+0x18>
+ DB 120,7 ; js 577a <_sk_evenly_spaced_gradient_sse2+0x18>
DB 243,72,15,42,203 ; cvtsi2ss %rbx,%xmm1
- DB 235,21 ; jmp 58d4 <_sk_evenly_spaced_gradient_sse2+0x2d>
+ DB 235,21 ; jmp 578f <_sk_evenly_spaced_gradient_sse2+0x2d>
DB 73,137,217 ; mov %rbx,%r9
DB 73,209,233 ; shr %r9
DB 131,227,1 ; and $0x1,%ebx
@@ -28651,15 +28254,15 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
PUBLIC _sk_gauss_a_to_rgba_sse2
_sk_gauss_a_to_rgba_sse2 LABEL PROC
- DB 15,40,5,192,26,0,0 ; movaps 0x1ac0(%rip),%xmm0 # 7520 <_sk_callback_sse2+0x1206>
+ DB 15,40,5,149,26,0,0 ; movaps 0x1a95(%rip),%xmm0 # 73b0 <_sk_callback_sse2+0x11db>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,198,26,0,0 ; addps 0x1ac6(%rip),%xmm0 # 7530 <_sk_callback_sse2+0x1216>
+ DB 15,88,5,155,26,0,0 ; addps 0x1a9b(%rip),%xmm0 # 73c0 <_sk_callback_sse2+0x11eb>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,204,26,0,0 ; addps 0x1acc(%rip),%xmm0 # 7540 <_sk_callback_sse2+0x1226>
+ DB 15,88,5,161,26,0,0 ; addps 0x1aa1(%rip),%xmm0 # 73d0 <_sk_callback_sse2+0x11fb>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,210,26,0,0 ; addps 0x1ad2(%rip),%xmm0 # 7550 <_sk_callback_sse2+0x1236>
+ DB 15,88,5,167,26,0,0 ; addps 0x1aa7(%rip),%xmm0 # 73e0 <_sk_callback_sse2+0x120b>
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,5,216,26,0,0 ; addps 0x1ad8(%rip),%xmm0 # 7560 <_sk_callback_sse2+0x1246>
+ DB 15,88,5,173,26,0,0 ; addps 0x1aad(%rip),%xmm0 # 73f0 <_sk_callback_sse2+0x121b>
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
@@ -28675,12 +28278,12 @@ _sk_gradient_sse2 LABEL PROC
DB 76,139,8 ; mov (%rax),%r9
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 73,131,249,2 ; cmp $0x2,%r9
- DB 114,50 ; jb 5adb <_sk_gradient_sse2+0x46>
+ DB 114,50 ; jb 5996 <_sk_gradient_sse2+0x46>
DB 72,139,88,72 ; mov 0x48(%rax),%rbx
DB 73,255,201 ; dec %r9
DB 72,131,195,4 ; add $0x4,%rbx
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 15,40,21,177,26,0,0 ; movaps 0x1ab1(%rip),%xmm2 # 7570 <_sk_callback_sse2+0x1256>
+ DB 15,40,21,134,26,0,0 ; movaps 0x1a86(%rip),%xmm2 # 7400 <_sk_callback_sse2+0x122b>
DB 243,15,16,27 ; movss (%rbx),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
@@ -28688,7 +28291,7 @@ _sk_gradient_sse2 LABEL PROC
DB 102,15,254,203 ; paddd %xmm3,%xmm1
DB 72,131,195,4 ; add $0x4,%rbx
DB 73,255,201 ; dec %r9
- DB 117,228 ; jne 5abf <_sk_gradient_sse2+0x2a>
+ DB 117,228 ; jne 597a <_sk_gradient_sse2+0x2a>
DB 102,15,112,209,78 ; pshufd $0x4e,%xmm1,%xmm2
DB 102,73,15,126,211 ; movq %xmm2,%r11
DB 69,137,217 ; mov %r11d,%r9d
@@ -28823,29 +28426,29 @@ _sk_xy_to_unit_angle_sse2 LABEL PROC
DB 69,15,94,220 ; divps %xmm12,%xmm11
DB 69,15,40,227 ; movaps %xmm11,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
- DB 68,15,40,45,114,24,0,0 ; movaps 0x1872(%rip),%xmm13 # 7580 <_sk_callback_sse2+0x1266>
+ DB 68,15,40,45,71,24,0,0 ; movaps 0x1847(%rip),%xmm13 # 7410 <_sk_callback_sse2+0x123b>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,118,24,0,0 ; addps 0x1876(%rip),%xmm13 # 7590 <_sk_callback_sse2+0x1276>
+ DB 68,15,88,45,75,24,0,0 ; addps 0x184b(%rip),%xmm13 # 7420 <_sk_callback_sse2+0x124b>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,122,24,0,0 ; addps 0x187a(%rip),%xmm13 # 75a0 <_sk_callback_sse2+0x1286>
+ DB 68,15,88,45,79,24,0,0 ; addps 0x184f(%rip),%xmm13 # 7430 <_sk_callback_sse2+0x125b>
DB 69,15,89,236 ; mulps %xmm12,%xmm13
- DB 68,15,88,45,126,24,0,0 ; addps 0x187e(%rip),%xmm13 # 75b0 <_sk_callback_sse2+0x1296>
+ DB 68,15,88,45,83,24,0,0 ; addps 0x1853(%rip),%xmm13 # 7440 <_sk_callback_sse2+0x126b>
DB 69,15,89,235 ; mulps %xmm11,%xmm13
DB 69,15,194,202,1 ; cmpltps %xmm10,%xmm9
- DB 68,15,40,21,125,24,0,0 ; movaps 0x187d(%rip),%xmm10 # 75c0 <_sk_callback_sse2+0x12a6>
+ DB 68,15,40,21,82,24,0,0 ; movaps 0x1852(%rip),%xmm10 # 7450 <_sk_callback_sse2+0x127b>
DB 69,15,92,213 ; subps %xmm13,%xmm10
DB 69,15,84,209 ; andps %xmm9,%xmm10
DB 69,15,85,205 ; andnps %xmm13,%xmm9
DB 69,15,86,202 ; orps %xmm10,%xmm9
DB 68,15,194,192,1 ; cmpltps %xmm0,%xmm8
- DB 68,15,40,21,112,24,0,0 ; movaps 0x1870(%rip),%xmm10 # 75d0 <_sk_callback_sse2+0x12b6>
+ DB 68,15,40,21,69,24,0,0 ; movaps 0x1845(%rip),%xmm10 # 7460 <_sk_callback_sse2+0x128b>
DB 69,15,92,209 ; subps %xmm9,%xmm10
DB 69,15,84,208 ; andps %xmm8,%xmm10
DB 69,15,85,193 ; andnps %xmm9,%xmm8
DB 69,15,86,194 ; orps %xmm10,%xmm8
DB 68,15,40,201 ; movaps %xmm1,%xmm9
DB 68,15,194,200,1 ; cmpltps %xmm0,%xmm9
- DB 68,15,40,21,95,24,0,0 ; movaps 0x185f(%rip),%xmm10 # 75e0 <_sk_callback_sse2+0x12c6>
+ DB 68,15,40,21,52,24,0,0 ; movaps 0x1834(%rip),%xmm10 # 7470 <_sk_callback_sse2+0x129b>
DB 69,15,92,208 ; subps %xmm8,%xmm10
DB 69,15,84,209 ; andps %xmm9,%xmm10
DB 69,15,85,200 ; andnps %xmm8,%xmm9
@@ -28876,7 +28479,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 243,69,15,89,203 ; mulss %xmm11,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,6,24,0,0 ; mulps 0x1806(%rip),%xmm9 # 75f0 <_sk_callback_sse2+0x12d6>
+ DB 68,15,89,13,219,23,0,0 ; mulps 0x17db(%rip),%xmm9 # 7480 <_sk_callback_sse2+0x12ab>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
@@ -28884,7 +28487,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 243,69,15,89,219 ; mulss %xmm11,%xmm11
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,92,227 ; subps %xmm11,%xmm12
- DB 68,15,89,21,241,23,0,0 ; mulps 0x17f1(%rip),%xmm10 # 7600 <_sk_callback_sse2+0x12e6>
+ DB 68,15,89,21,198,23,0,0 ; mulps 0x17c6(%rip),%xmm10 # 7490 <_sk_callback_sse2+0x12bb>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -28893,8 +28496,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,92,193 ; subps %xmm9,%xmm0
- DB 68,15,87,13,217,23,0,0 ; xorps 0x17d9(%rip),%xmm9 # 7610 <_sk_callback_sse2+0x12f6>
- DB 68,15,89,5,225,23,0,0 ; mulps 0x17e1(%rip),%xmm8 # 7620 <_sk_callback_sse2+0x1306>
+ DB 68,15,87,13,174,23,0,0 ; xorps 0x17ae(%rip),%xmm9 # 74a0 <_sk_callback_sse2+0x12cb>
+ DB 68,15,89,5,182,23,0,0 ; mulps 0x17b6(%rip),%xmm8 # 74b0 <_sk_callback_sse2+0x12db>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
@@ -28913,7 +28516,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 243,69,15,89,203 ; mulss %xmm11,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,168,23,0,0 ; mulps 0x17a8(%rip),%xmm9 # 7630 <_sk_callback_sse2+0x1316>
+ DB 68,15,89,13,125,23,0,0 ; mulps 0x177d(%rip),%xmm9 # 74c0 <_sk_callback_sse2+0x12eb>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,225 ; movaps %xmm1,%xmm12
DB 69,15,89,228 ; mulps %xmm12,%xmm12
@@ -28921,7 +28524,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 243,69,15,89,219 ; mulss %xmm11,%xmm11
DB 69,15,198,219,0 ; shufps $0x0,%xmm11,%xmm11
DB 69,15,92,227 ; subps %xmm11,%xmm12
- DB 68,15,89,21,147,23,0,0 ; mulps 0x1793(%rip),%xmm10 # 7640 <_sk_callback_sse2+0x1326>
+ DB 68,15,89,21,104,23,0,0 ; mulps 0x1768(%rip),%xmm10 # 74d0 <_sk_callback_sse2+0x12fb>
DB 69,15,89,212 ; mulps %xmm12,%xmm10
DB 65,15,40,193 ; movaps %xmm9,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -28930,8 +28533,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,40,194 ; movaps %xmm10,%xmm0
DB 65,15,92,193 ; subps %xmm9,%xmm0
- DB 68,15,87,13,123,23,0,0 ; xorps 0x177b(%rip),%xmm9 # 7650 <_sk_callback_sse2+0x1336>
- DB 68,15,89,5,131,23,0,0 ; mulps 0x1783(%rip),%xmm8 # 7660 <_sk_callback_sse2+0x1346>
+ DB 68,15,87,13,80,23,0,0 ; xorps 0x1750(%rip),%xmm9 # 74e0 <_sk_callback_sse2+0x130b>
+ DB 68,15,89,5,88,23,0,0 ; mulps 0x1758(%rip),%xmm8 # 74f0 <_sk_callback_sse2+0x131b>
DB 65,15,89,192 ; mulps %xmm8,%xmm0
DB 69,15,92,202 ; subps %xmm10,%xmm9
DB 69,15,89,200 ; mulps %xmm8,%xmm9
@@ -28947,7 +28550,7 @@ _sk_xy_to_2pt_conical_linear_sse2 LABEL PROC
DB 243,69,15,89,200 ; mulss %xmm8,%xmm9
DB 69,15,198,201,0 ; shufps $0x0,%xmm9,%xmm9
DB 68,15,88,200 ; addps %xmm0,%xmm9
- DB 68,15,89,13,91,23,0,0 ; mulps 0x175b(%rip),%xmm9 # 7670 <_sk_callback_sse2+0x1356>
+ DB 68,15,89,13,48,23,0,0 ; mulps 0x1730(%rip),%xmm9 # 7500 <_sk_callback_sse2+0x132b>
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 68,15,40,209 ; movaps %xmm1,%xmm10
DB 69,15,89,210 ; mulps %xmm10,%xmm10
@@ -28955,7 +28558,7 @@ _sk_xy_to_2pt_conical_linear_sse2 LABEL PROC
DB 243,69,15,89,192 ; mulss %xmm8,%xmm8
DB 69,15,198,192,0 ; shufps $0x0,%xmm8,%xmm8
DB 65,15,92,192 ; subps %xmm8,%xmm0
- DB 15,87,5,71,23,0,0 ; xorps 0x1747(%rip),%xmm0 # 7680 <_sk_callback_sse2+0x1366>
+ DB 15,87,5,28,23,0,0 ; xorps 0x171c(%rip),%xmm0 # 7510 <_sk_callback_sse2+0x133b>
DB 65,15,94,193 ; divps %xmm9,%xmm0
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -28992,7 +28595,7 @@ _sk_apply_vector_mask_sse2 LABEL PROC
PUBLIC _sk_save_xy_sse2
_sk_save_xy_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,237,22,0,0 ; movaps 0x16ed(%rip),%xmm8 # 7690 <_sk_callback_sse2+0x1376>
+ DB 68,15,40,5,194,22,0,0 ; movaps 0x16c2(%rip),%xmm8 # 7520 <_sk_callback_sse2+0x134b>
DB 15,17,0 ; movups %xmm0,(%rax)
DB 68,15,40,200 ; movaps %xmm0,%xmm9
DB 69,15,88,200 ; addps %xmm8,%xmm9
@@ -29000,7 +28603,7 @@ _sk_save_xy_sse2 LABEL PROC
DB 69,15,91,210 ; cvtdq2ps %xmm10,%xmm10
DB 69,15,40,217 ; movaps %xmm9,%xmm11
DB 69,15,194,218,1 ; cmpltps %xmm10,%xmm11
- DB 68,15,40,37,216,22,0,0 ; movaps 0x16d8(%rip),%xmm12 # 76a0 <_sk_callback_sse2+0x1386>
+ DB 68,15,40,37,173,22,0,0 ; movaps 0x16ad(%rip),%xmm12 # 7530 <_sk_callback_sse2+0x135b>
DB 69,15,84,220 ; andps %xmm12,%xmm11
DB 69,15,92,211 ; subps %xmm11,%xmm10
DB 69,15,92,202 ; subps %xmm10,%xmm9
@@ -29043,8 +28646,8 @@ _sk_bilinear_nx_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,81,22,0,0 ; addps 0x1651(%rip),%xmm0 # 76b0 <_sk_callback_sse2+0x1396>
- DB 68,15,40,13,89,22,0,0 ; movaps 0x1659(%rip),%xmm9 # 76c0 <_sk_callback_sse2+0x13a6>
+ DB 15,88,5,38,22,0,0 ; addps 0x1626(%rip),%xmm0 # 7540 <_sk_callback_sse2+0x136b>
+ DB 68,15,40,13,46,22,0,0 ; movaps 0x162e(%rip),%xmm9 # 7550 <_sk_callback_sse2+0x137b>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29055,7 +28658,7 @@ _sk_bilinear_px_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,72,22,0,0 ; addps 0x1648(%rip),%xmm0 # 76d0 <_sk_callback_sse2+0x13b6>
+ DB 15,88,5,29,22,0,0 ; addps 0x161d(%rip),%xmm0 # 7560 <_sk_callback_sse2+0x138b>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29065,8 +28668,8 @@ _sk_bilinear_ny_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,58,22,0,0 ; addps 0x163a(%rip),%xmm1 # 76e0 <_sk_callback_sse2+0x13c6>
- DB 68,15,40,13,66,22,0,0 ; movaps 0x1642(%rip),%xmm9 # 76f0 <_sk_callback_sse2+0x13d6>
+ DB 15,88,13,15,22,0,0 ; addps 0x160f(%rip),%xmm1 # 7570 <_sk_callback_sse2+0x139b>
+ DB 68,15,40,13,23,22,0,0 ; movaps 0x1617(%rip),%xmm9 # 7580 <_sk_callback_sse2+0x13ab>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29077,7 +28680,7 @@ _sk_bilinear_py_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,48,22,0,0 ; addps 0x1630(%rip),%xmm1 # 7700 <_sk_callback_sse2+0x13e6>
+ DB 15,88,13,5,22,0,0 ; addps 0x1605(%rip),%xmm1 # 7590 <_sk_callback_sse2+0x13bb>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29087,13 +28690,13 @@ _sk_bicubic_n3x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,35,22,0,0 ; addps 0x1623(%rip),%xmm0 # 7710 <_sk_callback_sse2+0x13f6>
- DB 68,15,40,13,43,22,0,0 ; movaps 0x162b(%rip),%xmm9 # 7720 <_sk_callback_sse2+0x1406>
+ DB 15,88,5,248,21,0,0 ; addps 0x15f8(%rip),%xmm0 # 75a0 <_sk_callback_sse2+0x13cb>
+ DB 68,15,40,13,0,22,0,0 ; movaps 0x1600(%rip),%xmm9 # 75b0 <_sk_callback_sse2+0x13db>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,39,22,0,0 ; mulps 0x1627(%rip),%xmm9 # 7730 <_sk_callback_sse2+0x1416>
- DB 68,15,88,13,47,22,0,0 ; addps 0x162f(%rip),%xmm9 # 7740 <_sk_callback_sse2+0x1426>
+ DB 68,15,89,13,252,21,0,0 ; mulps 0x15fc(%rip),%xmm9 # 75c0 <_sk_callback_sse2+0x13eb>
+ DB 68,15,88,13,4,22,0,0 ; addps 0x1604(%rip),%xmm9 # 75d0 <_sk_callback_sse2+0x13fb>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,128,0,0,0 ; movups %xmm9,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29104,16 +28707,16 @@ _sk_bicubic_n1x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,30,22,0,0 ; addps 0x161e(%rip),%xmm0 # 7750 <_sk_callback_sse2+0x1436>
- DB 68,15,40,13,38,22,0,0 ; movaps 0x1626(%rip),%xmm9 # 7760 <_sk_callback_sse2+0x1446>
+ DB 15,88,5,243,21,0,0 ; addps 0x15f3(%rip),%xmm0 # 75e0 <_sk_callback_sse2+0x140b>
+ DB 68,15,40,13,251,21,0,0 ; movaps 0x15fb(%rip),%xmm9 # 75f0 <_sk_callback_sse2+0x141b>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,42,22,0,0 ; movaps 0x162a(%rip),%xmm8 # 7770 <_sk_callback_sse2+0x1456>
+ DB 68,15,40,5,255,21,0,0 ; movaps 0x15ff(%rip),%xmm8 # 7600 <_sk_callback_sse2+0x142b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,46,22,0,0 ; addps 0x162e(%rip),%xmm8 # 7780 <_sk_callback_sse2+0x1466>
+ DB 68,15,88,5,3,22,0,0 ; addps 0x1603(%rip),%xmm8 # 7610 <_sk_callback_sse2+0x143b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,50,22,0,0 ; addps 0x1632(%rip),%xmm8 # 7790 <_sk_callback_sse2+0x1476>
+ DB 68,15,88,5,7,22,0,0 ; addps 0x1607(%rip),%xmm8 # 7620 <_sk_callback_sse2+0x144b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,54,22,0,0 ; addps 0x1636(%rip),%xmm8 # 77a0 <_sk_callback_sse2+0x1486>
+ DB 68,15,88,5,11,22,0,0 ; addps 0x160b(%rip),%xmm8 # 7630 <_sk_callback_sse2+0x145b>
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29121,17 +28724,17 @@ _sk_bicubic_n1x_sse2 LABEL PROC
PUBLIC _sk_bicubic_p1x_sse2
_sk_bicubic_p1x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,48,22,0,0 ; movaps 0x1630(%rip),%xmm8 # 77b0 <_sk_callback_sse2+0x1496>
+ DB 68,15,40,5,5,22,0,0 ; movaps 0x1605(%rip),%xmm8 # 7640 <_sk_callback_sse2+0x146b>
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,72,64 ; movups 0x40(%rax),%xmm9
DB 65,15,88,192 ; addps %xmm8,%xmm0
- DB 68,15,40,21,44,22,0,0 ; movaps 0x162c(%rip),%xmm10 # 77c0 <_sk_callback_sse2+0x14a6>
+ DB 68,15,40,21,1,22,0,0 ; movaps 0x1601(%rip),%xmm10 # 7650 <_sk_callback_sse2+0x147b>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,48,22,0,0 ; addps 0x1630(%rip),%xmm10 # 77d0 <_sk_callback_sse2+0x14b6>
+ DB 68,15,88,21,5,22,0,0 ; addps 0x1605(%rip),%xmm10 # 7660 <_sk_callback_sse2+0x148b>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,44,22,0,0 ; addps 0x162c(%rip),%xmm10 # 77e0 <_sk_callback_sse2+0x14c6>
+ DB 68,15,88,21,1,22,0,0 ; addps 0x1601(%rip),%xmm10 # 7670 <_sk_callback_sse2+0x149b>
DB 68,15,17,144,128,0,0,0 ; movups %xmm10,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29141,11 +28744,11 @@ _sk_bicubic_p3x_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,0 ; movups (%rax),%xmm0
DB 68,15,16,64,64 ; movups 0x40(%rax),%xmm8
- DB 15,88,5,31,22,0,0 ; addps 0x161f(%rip),%xmm0 # 77f0 <_sk_callback_sse2+0x14d6>
+ DB 15,88,5,244,21,0,0 ; addps 0x15f4(%rip),%xmm0 # 7680 <_sk_callback_sse2+0x14ab>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,31,22,0,0 ; mulps 0x161f(%rip),%xmm8 # 7800 <_sk_callback_sse2+0x14e6>
- DB 68,15,88,5,39,22,0,0 ; addps 0x1627(%rip),%xmm8 # 7810 <_sk_callback_sse2+0x14f6>
+ DB 68,15,89,5,244,21,0,0 ; mulps 0x15f4(%rip),%xmm8 # 7690 <_sk_callback_sse2+0x14bb>
+ DB 68,15,88,5,252,21,0,0 ; addps 0x15fc(%rip),%xmm8 # 76a0 <_sk_callback_sse2+0x14cb>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,128,0,0,0 ; movups %xmm8,0x80(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29156,13 +28759,13 @@ _sk_bicubic_n3y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,21,22,0,0 ; addps 0x1615(%rip),%xmm1 # 7820 <_sk_callback_sse2+0x1506>
- DB 68,15,40,13,29,22,0,0 ; movaps 0x161d(%rip),%xmm9 # 7830 <_sk_callback_sse2+0x1516>
+ DB 15,88,13,234,21,0,0 ; addps 0x15ea(%rip),%xmm1 # 76b0 <_sk_callback_sse2+0x14db>
+ DB 68,15,40,13,242,21,0,0 ; movaps 0x15f2(%rip),%xmm9 # 76c0 <_sk_callback_sse2+0x14eb>
DB 69,15,92,200 ; subps %xmm8,%xmm9
DB 69,15,40,193 ; movaps %xmm9,%xmm8
DB 69,15,89,192 ; mulps %xmm8,%xmm8
- DB 68,15,89,13,25,22,0,0 ; mulps 0x1619(%rip),%xmm9 # 7840 <_sk_callback_sse2+0x1526>
- DB 68,15,88,13,33,22,0,0 ; addps 0x1621(%rip),%xmm9 # 7850 <_sk_callback_sse2+0x1536>
+ DB 68,15,89,13,238,21,0,0 ; mulps 0x15ee(%rip),%xmm9 # 76d0 <_sk_callback_sse2+0x14fb>
+ DB 68,15,88,13,246,21,0,0 ; addps 0x15f6(%rip),%xmm9 # 76e0 <_sk_callback_sse2+0x150b>
DB 69,15,89,200 ; mulps %xmm8,%xmm9
DB 68,15,17,136,160,0,0,0 ; movups %xmm9,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29173,16 +28776,16 @@ _sk_bicubic_n1y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,15,22,0,0 ; addps 0x160f(%rip),%xmm1 # 7860 <_sk_callback_sse2+0x1546>
- DB 68,15,40,13,23,22,0,0 ; movaps 0x1617(%rip),%xmm9 # 7870 <_sk_callback_sse2+0x1556>
+ DB 15,88,13,228,21,0,0 ; addps 0x15e4(%rip),%xmm1 # 76f0 <_sk_callback_sse2+0x151b>
+ DB 68,15,40,13,236,21,0,0 ; movaps 0x15ec(%rip),%xmm9 # 7700 <_sk_callback_sse2+0x152b>
DB 69,15,92,200 ; subps %xmm8,%xmm9
- DB 68,15,40,5,27,22,0,0 ; movaps 0x161b(%rip),%xmm8 # 7880 <_sk_callback_sse2+0x1566>
+ DB 68,15,40,5,240,21,0,0 ; movaps 0x15f0(%rip),%xmm8 # 7710 <_sk_callback_sse2+0x153b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,31,22,0,0 ; addps 0x161f(%rip),%xmm8 # 7890 <_sk_callback_sse2+0x1576>
+ DB 68,15,88,5,244,21,0,0 ; addps 0x15f4(%rip),%xmm8 # 7720 <_sk_callback_sse2+0x154b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,35,22,0,0 ; addps 0x1623(%rip),%xmm8 # 78a0 <_sk_callback_sse2+0x1586>
+ DB 68,15,88,5,248,21,0,0 ; addps 0x15f8(%rip),%xmm8 # 7730 <_sk_callback_sse2+0x155b>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
- DB 68,15,88,5,39,22,0,0 ; addps 0x1627(%rip),%xmm8 # 78b0 <_sk_callback_sse2+0x1596>
+ DB 68,15,88,5,252,21,0,0 ; addps 0x15fc(%rip),%xmm8 # 7740 <_sk_callback_sse2+0x156b>
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29190,17 +28793,17 @@ _sk_bicubic_n1y_sse2 LABEL PROC
PUBLIC _sk_bicubic_p1y_sse2
_sk_bicubic_p1y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
- DB 68,15,40,5,33,22,0,0 ; movaps 0x1621(%rip),%xmm8 # 78c0 <_sk_callback_sse2+0x15a6>
+ DB 68,15,40,5,246,21,0,0 ; movaps 0x15f6(%rip),%xmm8 # 7750 <_sk_callback_sse2+0x157b>
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,72,96 ; movups 0x60(%rax),%xmm9
DB 65,15,88,200 ; addps %xmm8,%xmm1
- DB 68,15,40,21,28,22,0,0 ; movaps 0x161c(%rip),%xmm10 # 78d0 <_sk_callback_sse2+0x15b6>
+ DB 68,15,40,21,241,21,0,0 ; movaps 0x15f1(%rip),%xmm10 # 7760 <_sk_callback_sse2+0x158b>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,32,22,0,0 ; addps 0x1620(%rip),%xmm10 # 78e0 <_sk_callback_sse2+0x15c6>
+ DB 68,15,88,21,245,21,0,0 ; addps 0x15f5(%rip),%xmm10 # 7770 <_sk_callback_sse2+0x159b>
DB 69,15,89,209 ; mulps %xmm9,%xmm10
DB 69,15,88,208 ; addps %xmm8,%xmm10
DB 69,15,89,209 ; mulps %xmm9,%xmm10
- DB 68,15,88,21,28,22,0,0 ; addps 0x161c(%rip),%xmm10 # 78f0 <_sk_callback_sse2+0x15d6>
+ DB 68,15,88,21,241,21,0,0 ; addps 0x15f1(%rip),%xmm10 # 7780 <_sk_callback_sse2+0x15ab>
DB 68,15,17,144,160,0,0,0 ; movups %xmm10,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
DB 255,224 ; jmpq *%rax
@@ -29210,11 +28813,11 @@ _sk_bicubic_p3y_sse2 LABEL PROC
DB 72,173 ; lods %ds:(%rsi),%rax
DB 15,16,72,32 ; movups 0x20(%rax),%xmm1
DB 68,15,16,64,96 ; movups 0x60(%rax),%xmm8
- DB 15,88,13,14,22,0,0 ; addps 0x160e(%rip),%xmm1 # 7900 <_sk_callback_sse2+0x15e6>
+ DB 15,88,13,227,21,0,0 ; addps 0x15e3(%rip),%xmm1 # 7790 <_sk_callback_sse2+0x15bb>
DB 69,15,40,200 ; movaps %xmm8,%xmm9
DB 69,15,89,201 ; mulps %xmm9,%xmm9
- DB 68,15,89,5,14,22,0,0 ; mulps 0x160e(%rip),%xmm8 # 7910 <_sk_callback_sse2+0x15f6>
- DB 68,15,88,5,22,22,0,0 ; addps 0x1616(%rip),%xmm8 # 7920 <_sk_callback_sse2+0x1606>
+ DB 68,15,89,5,227,21,0,0 ; mulps 0x15e3(%rip),%xmm8 # 77a0 <_sk_callback_sse2+0x15cb>
+ DB 68,15,88,5,235,21,0,0 ; addps 0x15eb(%rip),%xmm8 # 77b0 <_sk_callback_sse2+0x15db>
DB 69,15,89,193 ; mulps %xmm9,%xmm8
DB 68,15,17,128,160,0,0,0 ; movups %xmm8,0xa0(%rax)
DB 72,173 ; lods %ds:(%rsi),%rax
@@ -29444,9 +29047,9 @@ ALIGN 16
DB 128,191,0,0,224,64,0 ; cmpb $0x0,0x40e00000(%rdi)
DB 0,224 ; add %ah,%al
DB 64,0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 65ec <.literal16+0x1fc>
+ DB 224,64 ; loopne 649c <.literal16+0x1fc>
DB 0,0 ; add %al,(%rax)
- DB 224,64 ; loopne 65f0 <.literal16+0x200>
+ DB 224,64 ; loopne 64a0 <.literal16+0x200>
DB 154 ; (bad)
DB 153 ; cltd
DB 153 ; cltd
@@ -29466,13 +29069,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6611 <.literal16+0x221>
+ DB 71,225,61 ; rex.RXB loope 64c1 <.literal16+0x221>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6615 <.literal16+0x225>
+ DB 71,225,61 ; rex.RXB loope 64c5 <.literal16+0x225>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6619 <.literal16+0x229>
+ DB 71,225,61 ; rex.RXB loope 64c9 <.literal16+0x229>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 661d <.literal16+0x22d>
+ DB 71,225,61 ; rex.RXB loope 64cd <.literal16+0x22d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -29497,13 +29100,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6651 <.literal16+0x261>
+ DB 71,225,61 ; rex.RXB loope 6501 <.literal16+0x261>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6655 <.literal16+0x265>
+ DB 71,225,61 ; rex.RXB loope 6505 <.literal16+0x265>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6659 <.literal16+0x269>
+ DB 71,225,61 ; rex.RXB loope 6509 <.literal16+0x269>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 665d <.literal16+0x26d>
+ DB 71,225,61 ; rex.RXB loope 650d <.literal16+0x26d>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -29528,13 +29131,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6691 <.literal16+0x2a1>
+ DB 71,225,61 ; rex.RXB loope 6541 <.literal16+0x2a1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6695 <.literal16+0x2a5>
+ DB 71,225,61 ; rex.RXB loope 6545 <.literal16+0x2a5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 6699 <.literal16+0x2a9>
+ DB 71,225,61 ; rex.RXB loope 6549 <.literal16+0x2a9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 669d <.literal16+0x2ad>
+ DB 71,225,61 ; rex.RXB loope 654d <.literal16+0x2ad>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -29559,13 +29162,13 @@ ALIGN 16
DB 10,23 ; or (%rdi),%dl
DB 63 ; (bad)
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 66d1 <.literal16+0x2e1>
+ DB 71,225,61 ; rex.RXB loope 6581 <.literal16+0x2e1>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 66d5 <.literal16+0x2e5>
+ DB 71,225,61 ; rex.RXB loope 6585 <.literal16+0x2e5>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 66d9 <.literal16+0x2e9>
+ DB 71,225,61 ; rex.RXB loope 6589 <.literal16+0x2e9>
DB 174 ; scas %es:(%rdi),%al
- DB 71,225,61 ; rex.RXB loope 66dd <.literal16+0x2ed>
+ DB 71,225,61 ; rex.RXB loope 658d <.literal16+0x2ed>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -29586,11 +29189,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%rax)
DB 67,0,0 ; rex.XB add %al,(%r8)
- DB 127,67 ; jg 671b <.literal16+0x32b>
+ DB 127,67 ; jg 65cb <.literal16+0x32b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 671f <.literal16+0x32f>
+ DB 127,67 ; jg 65cf <.literal16+0x32f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6723 <.literal16+0x333>
+ DB 127,67 ; jg 65d3 <.literal16+0x333>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -29877,13 +29480,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6969 <.literal16+0x579>
+ DB 224,7 ; loopne 6819 <.literal16+0x579>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 696d <.literal16+0x57d>
+ DB 224,7 ; loopne 681d <.literal16+0x57d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6971 <.literal16+0x581>
+ DB 224,7 ; loopne 6821 <.literal16+0x581>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6975 <.literal16+0x585>
+ DB 224,7 ; loopne 6825 <.literal16+0x585>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -29948,11 +29551,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6a4b <.literal16+0x65b>
+ DB 127,67 ; jg 68fb <.literal16+0x65b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6a4f <.literal16+0x65f>
+ DB 127,67 ; jg 68ff <.literal16+0x65f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6a53 <.literal16+0x663>
+ DB 127,67 ; jg 6903 <.literal16+0x663>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%rax)
@@ -29967,16 +29570,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6a44 <.literal16+0x654>
+ DB 127,0 ; jg 68f4 <.literal16+0x654>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6a48 <.literal16+0x658>
+ DB 127,0 ; jg 68f8 <.literal16+0x658>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6a4c <.literal16+0x65c>
+ DB 127,0 ; jg 68fc <.literal16+0x65c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6a50 <.literal16+0x660>
+ DB 127,0 ; jg 6900 <.literal16+0x660>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -29985,7 +29588,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6ad5 <.literal16+0x6e5>
+ DB 119,115 ; ja 6985 <.literal16+0x6e5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -29996,7 +29599,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6a39 <.literal16+0x649>
+ DB 117,191 ; jne 68e9 <.literal16+0x649>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -30008,7 +29611,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3aa7a <_sk_callback_sse2+0xffffffffe9a34760>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a92a <_sk_callback_sse2+0xffffffffe9a34755>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -30062,16 +29665,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6b14 <.literal16+0x724>
+ DB 127,0 ; jg 69c4 <.literal16+0x724>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6b18 <.literal16+0x728>
+ DB 127,0 ; jg 69c8 <.literal16+0x728>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6b1c <.literal16+0x72c>
+ DB 127,0 ; jg 69cc <.literal16+0x72c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6b20 <.literal16+0x730>
+ DB 127,0 ; jg 69d0 <.literal16+0x730>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -30080,7 +29683,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6ba5 <.literal16+0x7b5>
+ DB 119,115 ; ja 6a55 <.literal16+0x7b5>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -30091,7 +29694,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6b09 <.literal16+0x719>
+ DB 117,191 ; jne 69b9 <.literal16+0x719>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -30103,7 +29706,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3ab4a <_sk_callback_sse2+0xffffffffe9a34830>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3a9fa <_sk_callback_sse2+0xffffffffe9a34825>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -30157,16 +29760,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6be4 <.literal16+0x7f4>
+ DB 127,0 ; jg 6a94 <.literal16+0x7f4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6be8 <.literal16+0x7f8>
+ DB 127,0 ; jg 6a98 <.literal16+0x7f8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6bec <.literal16+0x7fc>
+ DB 127,0 ; jg 6a9c <.literal16+0x7fc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6bf0 <.literal16+0x800>
+ DB 127,0 ; jg 6aa0 <.literal16+0x800>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -30175,7 +29778,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6c75 <.literal16+0x885>
+ DB 119,115 ; ja 6b25 <.literal16+0x885>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -30186,7 +29789,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6bd9 <.literal16+0x7e9>
+ DB 117,191 ; jne 6a89 <.literal16+0x7e9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -30198,7 +29801,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3ac1a <_sk_callback_sse2+0xffffffffe9a34900>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3aaca <_sk_callback_sse2+0xffffffffe9a348f5>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -30252,16 +29855,16 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 6cb4 <.literal16+0x8c4>
+ DB 127,0 ; jg 6b64 <.literal16+0x8c4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6cb8 <.literal16+0x8c8>
+ DB 127,0 ; jg 6b68 <.literal16+0x8c8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6cbc <.literal16+0x8cc>
+ DB 127,0 ; jg 6b6c <.literal16+0x8cc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 6cc0 <.literal16+0x8d0>
+ DB 127,0 ; jg 6b70 <.literal16+0x8d0>
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -30270,7 +29873,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
- DB 119,115 ; ja 6d45 <.literal16+0x955>
+ DB 119,115 ; ja 6bf5 <.literal16+0x955>
DB 248 ; clc
DB 194,119,115 ; retq $0x7377
DB 248 ; clc
@@ -30281,7 +29884,7 @@ ALIGN 16
DB 194,117,191 ; retq $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
- DB 117,191 ; jne 6ca9 <.literal16+0x8b9>
+ DB 117,191 ; jne 6b59 <.literal16+0x8b9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; (bad)
DB 249 ; stc
@@ -30293,7 +29896,7 @@ ALIGN 16
DB 249 ; stc
DB 68,180,62 ; rex.R mov $0x3e,%spl
DB 163,233,220,63,163,233,220,63,163 ; movabs %eax,0xa33fdce9a33fdce9
- DB 233,220,63,163,233 ; jmpq ffffffffe9a3acea <_sk_callback_sse2+0xffffffffe9a349d0>
+ DB 233,220,63,163,233 ; jmpq ffffffffe9a3ab9a <_sk_callback_sse2+0xffffffffe9a349c5>
DB 220,63 ; fdivrl (%rdi)
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
@@ -30343,13 +29946,13 @@ ALIGN 16
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
DB 200,66,0,0 ; enterq $0x42,$0x0
- DB 127,67 ; jg 6dc7 <.literal16+0x9d7>
+ DB 127,67 ; jg 6c77 <.literal16+0x9d7>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6dcb <.literal16+0x9db>
+ DB 127,67 ; jg 6c7b <.literal16+0x9db>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6dcf <.literal16+0x9df>
+ DB 127,67 ; jg 6c7f <.literal16+0x9df>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6dd3 <.literal16+0x9e3>
+ DB 127,67 ; jg 6c83 <.literal16+0x9e3>
DB 0,0 ; add %al,(%rax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%rax)
@@ -30396,16 +29999,16 @@ ALIGN 16
DB 128,3,62 ; addb $0x3e,(%rbx)
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6e53 <.literal16+0xa63>
+ DB 118,63 ; jbe 6d03 <.literal16+0xa63>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6e57 <.literal16+0xa67>
+ DB 118,63 ; jbe 6d07 <.literal16+0xa67>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6e5b <.literal16+0xa6b>
+ DB 118,63 ; jbe 6d0b <.literal16+0xa6b>
DB 31 ; (bad)
DB 215 ; xlat %ds:(%rbx)
- DB 118,63 ; jbe 6e5f <.literal16+0xa6f>
+ DB 118,63 ; jbe 6d0f <.literal16+0xa6f>
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
DB 246,64,83,63 ; testb $0x3f,0x53(%rax)
@@ -30434,11 +30037,11 @@ ALIGN 16
DB 128,59,0 ; cmpb $0x0,(%rbx)
DB 0,127,67 ; add %bh,0x43(%rdi)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6ecb <.literal16+0xadb>
+ DB 127,67 ; jg 6d7b <.literal16+0xadb>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6ecf <.literal16+0xadf>
+ DB 127,67 ; jg 6d7f <.literal16+0xadf>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 6ed3 <.literal16+0xae3>
+ DB 127,67 ; jg 6d83 <.literal16+0xae3>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -30484,17 +30087,8 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
DB 63 ; (bad)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
- DB 0,0 ; add %al,(%rax)
- DB 255,0 ; incl (%rax)
+ DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%rax)
- DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%rax)
- DB 128,59,129 ; cmpb $0x81,(%rbx)
- DB 128,128,59,0,248,0,0 ; addb $0x0,0xf8003b(%rax)
DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%rax)
DB 0,248 ; add %bh,%al
@@ -30509,13 +30103,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6f69 <.literal16+0xb79>
+ DB 224,7 ; loopne 6df9 <.literal16+0xb59>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6f6d <.literal16+0xb7d>
+ DB 224,7 ; loopne 6dfd <.literal16+0xb5d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6f71 <.literal16+0xb81>
+ DB 224,7 ; loopne 6e01 <.literal16+0xb61>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6f75 <.literal16+0xb85>
+ DB 224,7 ; loopne 6e05 <.literal16+0xb65>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -30561,13 +30155,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 6fd9 <.literal16+0xbe9>
+ DB 224,7 ; loopne 6e69 <.literal16+0xbc9>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6fdd <.literal16+0xbed>
+ DB 224,7 ; loopne 6e6d <.literal16+0xbcd>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6fe1 <.literal16+0xbf1>
+ DB 224,7 ; loopne 6e71 <.literal16+0xbd1>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 6fe5 <.literal16+0xbf5>
+ DB 224,7 ; loopne 6e75 <.literal16+0xbd5>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -30613,13 +30207,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%rdi)
DB 8,33 ; or %ah,(%rcx)
DB 132,55 ; test %dh,(%rdi)
- DB 224,7 ; loopne 7049 <.literal16+0xc59>
+ DB 224,7 ; loopne 6ed9 <.literal16+0xc39>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 704d <.literal16+0xc5d>
+ DB 224,7 ; loopne 6edd <.literal16+0xc3d>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 7051 <.literal16+0xc61>
+ DB 224,7 ; loopne 6ee1 <.literal16+0xc41>
DB 0,0 ; add %al,(%rax)
- DB 224,7 ; loopne 7055 <.literal16+0xc65>
+ DB 224,7 ; loopne 6ee5 <.literal16+0xc45>
DB 0,0 ; add %al,(%rax)
DB 33,8 ; and %ecx,(%rax)
DB 2,58 ; add (%rdx),%bh
@@ -30657,13 +30251,13 @@ ALIGN 16
DB 65,0,0 ; add %al,(%r8)
DB 248 ; clc
DB 65,0,0 ; add %al,(%r8)
- DB 124,66 ; jl 70e6 <.literal16+0xcf6>
+ DB 124,66 ; jl 6f76 <.literal16+0xcd6>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 70ea <.literal16+0xcfa>
+ DB 124,66 ; jl 6f7a <.literal16+0xcda>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 70ee <.literal16+0xcfe>
+ DB 124,66 ; jl 6f7e <.literal16+0xcde>
DB 0,0 ; add %al,(%rax)
- DB 124,66 ; jl 70f2 <.literal16+0xd02>
+ DB 124,66 ; jl 6f82 <.literal16+0xce2>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%rax)
DB 0,240 ; add %dh,%al
@@ -30797,13 +30391,13 @@ ALIGN 16
DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%rax)
DB 61,137,136,136,61 ; cmp $0x3d888889,%eax
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 7275 <.literal16+0xe85>
+ DB 112,65 ; jo 7105 <.literal16+0xe65>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 7279 <.literal16+0xe89>
+ DB 112,65 ; jo 7109 <.literal16+0xe69>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 727d <.literal16+0xe8d>
+ DB 112,65 ; jo 710d <.literal16+0xe6d>
DB 0,0 ; add %al,(%rax)
- DB 112,65 ; jo 7281 <.literal16+0xe91>
+ DB 112,65 ; jo 7111 <.literal16+0xe71>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -30834,19 +30428,19 @@ ALIGN 16
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%rax)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72eb <.literal16+0xefb>
+ DB 127,67 ; jg 717b <.literal16+0xedb>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72ef <.literal16+0xeff>
+ DB 127,67 ; jg 717f <.literal16+0xedf>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72f3 <.literal16+0xf03>
+ DB 127,67 ; jg 7183 <.literal16+0xee3>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72f7 <.literal16+0xf07>
+ DB 127,67 ; jg 7187 <.literal16+0xee7>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72fb <.literal16+0xf0b>
+ DB 127,67 ; jg 718b <.literal16+0xeeb>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 72ff <.literal16+0xf0f>
+ DB 127,67 ; jg 718f <.literal16+0xeef>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 7303 <.literal16+0xf13>
+ DB 127,67 ; jg 7193 <.literal16+0xef3>
DB 255,0 ; incl (%rax)
DB 0,0 ; add %al,(%rax)
DB 255,0 ; incl (%rax)
@@ -30877,11 +30471,11 @@ ALIGN 16
DB 128,59,129 ; cmpb $0x81,(%rbx)
DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%rax)
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 736b <.literal16+0xf7b>
+ DB 127,67 ; jg 71fb <.literal16+0xf5b>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 736f <.literal16+0xf7f>
+ DB 127,67 ; jg 71ff <.literal16+0xf5f>
DB 0,0 ; add %al,(%rax)
- DB 127,67 ; jg 7373 <.literal16+0xf83>
+ DB 127,67 ; jg 7203 <.literal16+0xf63>
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
DB 0,0 ; add %al,(%rax)
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%rax)
@@ -30977,13 +30571,13 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 255 ; (bad)
- DB 127,71 ; jg 749b <.literal16+0x10ab>
+ DB 127,71 ; jg 732b <.literal16+0x108b>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 749f <.literal16+0x10af>
+ DB 127,71 ; jg 732f <.literal16+0x108f>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 74a3 <.literal16+0x10b3>
+ DB 127,71 ; jg 7333 <.literal16+0x1093>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg 74a7 <.literal16+0x10b7>
+ DB 127,71 ; jg 7337 <.literal16+0x1097>
DB 0,0 ; add %al,(%rax)
DB 128,63,0 ; cmpb $0x0,(%rdi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%rax)
@@ -31060,10 +30654,10 @@ ALIGN 16
DB 61,152,221,147,61 ; cmp $0x3d93dd98,%eax
DB 152 ; cwtl
DB 221,147,61,45,16,17 ; fstl 0x11102d3d(%rbx)
- DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc0863a <_sk_callback_sse2+0x2dc02320>
+ DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110(%rip) # 2dc084ca <_sk_callback_sse2+0x2dc022f5>
DB 17,192 ; adc %eax,%eax
DB 45,16,17,192,18 ; sub $0x12c01110,%eax
- DB 120,57 ; js 756c <.literal16+0x117c>
+ DB 120,57 ; js 73fc <.literal16+0x115c>
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
DB 64,18,120,57 ; adc 0x39(%rax),%dil
@@ -31250,11 +30844,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 7752 <.literal16+0x1362>
+ DB 62,114,28 ; jb,pt 75e2 <.literal16+0x1342>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7756 <.literal16+0x1366>
+ DB 62,114,28 ; jb,pt 75e6 <.literal16+0x1346>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 775a <.literal16+0x136a>
+ DB 62,114,28 ; jb,pt 75ea <.literal16+0x134a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -31298,7 +30892,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d6405e5 <_sk_callback_sse2+0x3d63a2cb>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640475 <_sk_callback_sse2+0x3d63a2a0>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -31324,7 +30918,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640625 <_sk_callback_sse2+0x3d63a30b>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d6404b5 <_sk_callback_sse2+0x3d63a2e0>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -31333,13 +30927,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 781e <.literal16+0x142e>
+ DB 114,28 ; jb 76ae <.literal16+0x140e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7822 <.literal16+0x1432>
+ DB 62,114,28 ; jb,pt 76b2 <.literal16+0x1412>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7826 <.literal16+0x1436>
+ DB 62,114,28 ; jb,pt 76b6 <.literal16+0x1416>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 782a <.literal16+0x143a>
+ DB 62,114,28 ; jb,pt 76ba <.literal16+0x141a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -31360,11 +30954,11 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 128,63,114 ; cmpb $0x72,(%rdi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt 7862 <.literal16+0x1472>
+ DB 62,114,28 ; jb,pt 76f2 <.literal16+0x1452>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7866 <.literal16+0x1476>
+ DB 62,114,28 ; jb,pt 76f6 <.literal16+0x1456>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 786a <.literal16+0x147a>
+ DB 62,114,28 ; jb,pt 76fa <.literal16+0x145a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -31408,7 +31002,7 @@ ALIGN 16
DB 0,0 ; add %al,(%rax)
DB 0,63 ; add %bh,(%rdi)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d6406f5 <_sk_callback_sse2+0x3d63a3db>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640585 <_sk_callback_sse2+0x3d63a3b0>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 0,63 ; add %bh,(%rdi)
DB 0,0 ; add %al,(%rax)
@@ -31434,7 +31028,7 @@ ALIGN 16
DB 0,192 ; add %al,%al
DB 63 ; (bad)
DB 57,142,99,61,57,142 ; cmp %ecx,-0x71c6c29d(%rsi)
- DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d640735 <_sk_callback_sse2+0x3d63a41b>
+ DB 99,61,57,142,99,61 ; movslq 0x3d638e39(%rip),%edi # 3d6405c5 <_sk_callback_sse2+0x3d63a3f0>
DB 57,142,99,61,0,0 ; cmp %ecx,0x3d63(%rsi)
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
@@ -31443,13 +31037,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%rdi)
DB 0,192 ; add %al,%al
DB 63 ; (bad)
- DB 114,28 ; jb 792e <.literal16+0x153e>
+ DB 114,28 ; jb 77be <.literal16+0x151e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7932 <_sk_callback_sse2+0x1618>
+ DB 62,114,28 ; jb,pt 77c2 <_sk_callback_sse2+0x15ed>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 7936 <_sk_callback_sse2+0x161c>
+ DB 62,114,28 ; jb,pt 77c6 <_sk_callback_sse2+0x15f1>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt 793a <_sk_callback_sse2+0x1620>
+ DB 62,114,28 ; jb,pt 77ca <_sk_callback_sse2+0x15f5>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%rdi)
DB 170 ; stos %al,%es:(%rdi)
@@ -36504,7 +36098,7 @@ _sk_seed_shader_sse2 LABEL PROC
DB 102,15,110,199 ; movd %edi,%xmm0
DB 102,15,112,192,0 ; pshufd $0x0,%xmm0,%xmm0
DB 15,91,200 ; cvtdq2ps %xmm0,%xmm1
- DB 15,40,145,104,146,0,0 ; movaps 0x9268(%ecx),%xmm2
+ DB 15,40,145,216,144,0,0 ; movaps 0x90d8(%ecx),%xmm2
DB 15,88,202 ; addps %xmm2,%xmm1
DB 15,16,0 ; movups (%eax),%xmm0
DB 15,88,193 ; addps %xmm1,%xmm0
@@ -36526,7 +36120,7 @@ _sk_seed_shader_sse2 LABEL PROC
DB 137,68,36,4 ; mov %eax,0x4(%esp)
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 137,4,36 ; mov %eax,(%esp)
- DB 15,40,145,120,146,0,0 ; movaps 0x9278(%ecx),%xmm2
+ DB 15,40,145,232,144,0,0 ; movaps 0x90e8(%ecx),%xmm2
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 255,19 ; call *(%ebx)
DB 131,196,108 ; add $0x6c,%esp
@@ -36560,15 +36154,15 @@ _sk_dither_sse2 LABEL PROC
DB 102,15,110,225 ; movd %ecx,%xmm4
DB 102,15,112,252,0 ; pshufd $0x0,%xmm4,%xmm7
DB 102,15,239,253 ; pxor %xmm5,%xmm7
- DB 102,15,111,182,233,145,0,0 ; movdqa 0x91e9(%esi),%xmm6
+ DB 102,15,111,182,89,144,0,0 ; movdqa 0x9059(%esi),%xmm6
DB 102,15,111,207 ; movdqa %xmm7,%xmm1
DB 102,15,219,206 ; pand %xmm6,%xmm1
DB 102,15,219,245 ; pand %xmm5,%xmm6
- DB 102,15,111,134,9,146,0,0 ; movdqa 0x9209(%esi),%xmm0
+ DB 102,15,111,134,121,144,0,0 ; movdqa 0x9079(%esi),%xmm0
DB 102,15,111,231 ; movdqa %xmm7,%xmm4
DB 102,15,219,224 ; pand %xmm0,%xmm4
DB 102,15,219,197 ; pand %xmm5,%xmm0
- DB 102,15,111,158,249,145,0,0 ; movdqa 0x91f9(%esi),%xmm3
+ DB 102,15,111,158,105,144,0,0 ; movdqa 0x9069(%esi),%xmm3
DB 102,15,219,251 ; pand %xmm3,%xmm7
DB 102,15,219,235 ; pand %xmm3,%xmm5
DB 102,15,114,246,4 ; pslld $0x4,%xmm6
@@ -36584,8 +36178,8 @@ _sk_dither_sse2 LABEL PROC
DB 102,15,235,224 ; por %xmm0,%xmm4
DB 102,15,235,231 ; por %xmm7,%xmm4
DB 15,91,196 ; cvtdq2ps %xmm4,%xmm0
- DB 15,89,134,25,146,0,0 ; mulps 0x9219(%esi),%xmm0
- DB 15,88,134,41,146,0,0 ; addps 0x9229(%esi),%xmm0
+ DB 15,89,134,137,144,0,0 ; mulps 0x9089(%esi),%xmm0
+ DB 15,88,134,153,144,0,0 ; addps 0x9099(%esi),%xmm0
DB 139,55 ; mov (%edi),%esi
DB 243,15,16,14 ; movss (%esi),%xmm1
DB 139,117,24 ; mov 0x18(%ebp),%esi
@@ -36703,7 +36297,7 @@ _sk_black_color_sse2 LABEL PROC
DB 137,68,36,4 ; mov %eax,0x4(%esp)
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 137,4,36 ; mov %eax,(%esp)
- DB 15,40,153,116,144,0,0 ; movaps 0x9074(%ecx),%xmm3
+ DB 15,40,153,228,142,0,0 ; movaps 0x8ee4(%ecx),%xmm3
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 15,87,201 ; xorps %xmm1,%xmm1
DB 15,87,210 ; xorps %xmm2,%xmm2
@@ -36744,7 +36338,7 @@ _sk_white_color_sse2 LABEL PROC
DB 137,68,36,4 ; mov %eax,0x4(%esp)
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 137,4,36 ; mov %eax,(%esp)
- DB 15,40,129,18,144,0,0 ; movaps 0x9012(%ecx),%xmm0
+ DB 15,40,129,130,142,0,0 ; movaps 0x8e82(%ecx),%xmm0
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 15,40,216 ; movaps %xmm0,%xmm3
@@ -36890,7 +36484,7 @@ _sk_srcatop_sse2 LABEL PROC
DB 88 ; pop %eax
DB 15,40,69,88 ; movaps 0x58(%ebp),%xmm0
DB 15,89,208 ; mulps %xmm0,%xmm2
- DB 15,40,136,99,142,0,0 ; movaps 0x8e63(%eax),%xmm1
+ DB 15,40,136,211,140,0,0 ; movaps 0x8cd3(%eax),%xmm1
DB 15,92,203 ; subps %xmm3,%xmm1
DB 15,40,249 ; movaps %xmm1,%xmm7
DB 15,89,125,40 ; mulps 0x28(%ebp),%xmm7
@@ -36949,7 +36543,7 @@ _sk_dstatop_sse2 LABEL PROC
DB 88 ; pop %eax
DB 15,40,245 ; movaps %xmm5,%xmm6
DB 15,89,117,40 ; mulps 0x28(%ebp),%xmm6
- DB 15,40,184,201,141,0,0 ; movaps 0x8dc9(%eax),%xmm7
+ DB 15,40,184,57,140,0,0 ; movaps 0x8c39(%eax),%xmm7
DB 15,92,125,88 ; subps 0x58(%ebp),%xmm7
DB 15,89,199 ; mulps %xmm7,%xmm0
DB 15,88,198 ; addps %xmm6,%xmm0
@@ -37089,7 +36683,7 @@ _sk_srcout_sse2 LABEL PROC
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 15,40,109,56 ; movaps 0x38(%ebp),%xmm5
DB 15,40,117,88 ; movaps 0x58(%ebp),%xmm6
- DB 15,40,184,101,140,0,0 ; movaps 0x8c65(%eax),%xmm7
+ DB 15,40,184,213,138,0,0 ; movaps 0x8ad5(%eax),%xmm7
DB 15,92,254 ; subps %xmm6,%xmm7
DB 15,89,199 ; mulps %xmm7,%xmm0
DB 15,89,207 ; mulps %xmm7,%xmm1
@@ -37129,7 +36723,7 @@ _sk_dstout_sse2 LABEL PROC
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 139,125,24 ; mov 0x18(%ebp),%edi
- DB 15,40,160,253,139,0,0 ; movaps 0x8bfd(%eax),%xmm4
+ DB 15,40,160,109,138,0,0 ; movaps 0x8a6d(%eax),%xmm4
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
@@ -37177,7 +36771,7 @@ _sk_srcover_sse2 LABEL PROC
DB 232,0,0,0,0 ; call 8c3 <_sk_srcover_sse2+0x17>
DB 88 ; pop %eax
DB 15,40,109,40 ; movaps 0x28(%ebp),%xmm5
- DB 15,40,128,125,139,0,0 ; movaps 0x8b7d(%eax),%xmm0
+ DB 15,40,128,237,137,0,0 ; movaps 0x89ed(%eax),%xmm0
DB 15,92,195 ; subps %xmm3,%xmm0
DB 15,40,248 ; movaps %xmm0,%xmm7
DB 15,89,253 ; mulps %xmm5,%xmm7
@@ -37233,7 +36827,7 @@ _sk_dstover_sse2 LABEL PROC
DB 139,77,16 ; mov 0x10(%ebp),%ecx
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 139,125,24 ; mov 0x18(%ebp),%edi
- DB 15,40,162,246,138,0,0 ; movaps 0x8af6(%edx),%xmm4
+ DB 15,40,162,102,137,0,0 ; movaps 0x8966(%edx),%xmm4
DB 139,85,12 ; mov 0xc(%ebp),%edx
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 15,40,117,56 ; movaps 0x38(%ebp),%xmm6
@@ -37317,7 +36911,7 @@ _sk_multiply_sse2 LABEL PROC
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 232,0,0,0,0 ; call a50 <_sk_multiply_sse2+0x18>
DB 88 ; pop %eax
- DB 15,40,144,16,138,0,0 ; movaps 0x8a10(%eax),%xmm2
+ DB 15,40,144,128,136,0,0 ; movaps 0x8880(%eax),%xmm2
DB 15,40,250 ; movaps %xmm2,%xmm7
DB 15,92,125,88 ; subps 0x58(%ebp),%xmm7
DB 15,40,231 ; movaps %xmm7,%xmm4
@@ -37487,7 +37081,7 @@ _sk_xor__sse2 LABEL PROC
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
DB 232,0,0,0,0 ; call c37 <_sk_xor__sse2+0x12>
DB 88 ; pop %eax
- DB 15,40,176,57,136,0,0 ; movaps 0x8839(%eax),%xmm6
+ DB 15,40,176,169,134,0,0 ; movaps 0x86a9(%eax),%xmm6
DB 15,40,254 ; movaps %xmm6,%xmm7
DB 15,92,125,88 ; subps 0x58(%ebp),%xmm7
DB 15,89,199 ; mulps %xmm7,%xmm0
@@ -37571,7 +37165,7 @@ _sk_darken_sse2 LABEL PROC
DB 15,92,226 ; subps %xmm2,%xmm4
DB 232,0,0,0,0 ; call d31 <_sk_darken_sse2+0x63>
DB 88 ; pop %eax
- DB 15,40,144,79,135,0,0 ; movaps 0x874f(%eax),%xmm2
+ DB 15,40,144,191,133,0,0 ; movaps 0x85bf(%eax),%xmm2
DB 15,92,214 ; subps %xmm6,%xmm2
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
DB 15,89,213 ; mulps %xmm5,%xmm2
@@ -37639,7 +37233,7 @@ _sk_lighten_sse2 LABEL PROC
DB 15,92,226 ; subps %xmm2,%xmm4
DB 232,0,0,0,0 ; call df6 <_sk_lighten_sse2+0x63>
DB 88 ; pop %eax
- DB 15,40,144,154,134,0,0 ; movaps 0x869a(%eax),%xmm2
+ DB 15,40,144,10,133,0,0 ; movaps 0x850a(%eax),%xmm2
DB 15,92,214 ; subps %xmm6,%xmm2
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
DB 15,89,213 ; mulps %xmm5,%xmm2
@@ -37710,7 +37304,7 @@ _sk_difference_sse2 LABEL PROC
DB 15,92,226 ; subps %xmm2,%xmm4
DB 232,0,0,0,0 ; call ec4 <_sk_difference_sse2+0x6c>
DB 88 ; pop %eax
- DB 15,40,144,220,133,0,0 ; movaps 0x85dc(%eax),%xmm2
+ DB 15,40,144,76,132,0,0 ; movaps 0x844c(%eax),%xmm2
DB 15,92,214 ; subps %xmm6,%xmm2
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
DB 15,89,213 ; mulps %xmm5,%xmm2
@@ -37770,7 +37364,7 @@ _sk_exclusion_sse2 LABEL PROC
DB 15,89,213 ; mulps %xmm5,%xmm2
DB 15,88,210 ; addps %xmm2,%xmm2
DB 15,92,226 ; subps %xmm2,%xmm4
- DB 15,40,144,118,133,0,0 ; movaps 0x8576(%eax),%xmm2
+ DB 15,40,144,230,131,0,0 ; movaps 0x83e6(%eax),%xmm2
DB 15,92,211 ; subps %xmm3,%xmm2
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
DB 15,89,213 ; mulps %xmm5,%xmm2
@@ -37824,7 +37418,7 @@ _sk_colorburn_sse2 LABEL PROC
DB 15,40,196 ; movaps %xmm4,%xmm0
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,92,238 ; subps %xmm6,%xmm5
- DB 15,40,176,213,132,0,0 ; movaps 0x84d5(%eax),%xmm6
+ DB 15,40,176,69,131,0,0 ; movaps 0x8345(%eax),%xmm6
DB 15,40,230 ; movaps %xmm6,%xmm4
DB 15,92,224 ; subps %xmm0,%xmm4
DB 15,40,220 ; movaps %xmm4,%xmm3
@@ -37965,7 +37559,7 @@ _sk_colordodge_sse2 LABEL PROC
DB 15,94,212 ; divps %xmm4,%xmm2
DB 15,40,224 ; movaps %xmm0,%xmm4
DB 15,93,226 ; minps %xmm2,%xmm4
- DB 15,40,152,35,131,0,0 ; movaps 0x8323(%eax),%xmm3
+ DB 15,40,152,147,129,0,0 ; movaps 0x8193(%eax),%xmm3
DB 15,40,211 ; movaps %xmm3,%xmm2
DB 15,92,208 ; subps %xmm0,%xmm2
DB 15,41,85,216 ; movaps %xmm2,-0x28(%ebp)
@@ -38089,7 +37683,7 @@ _sk_hardlight_sse2 LABEL PROC
DB 15,40,224 ; movaps %xmm0,%xmm4
DB 232,0,0,0,0 ; call 134f <_sk_hardlight_sse2+0x1a>
DB 88 ; pop %eax
- DB 15,40,176,145,129,0,0 ; movaps 0x8191(%eax),%xmm6
+ DB 15,40,176,1,128,0,0 ; movaps 0x8001(%eax),%xmm6
DB 15,40,206 ; movaps %xmm6,%xmm1
DB 15,92,77,88 ; subps 0x58(%ebp),%xmm1
DB 15,41,77,184 ; movaps %xmm1,-0x48(%ebp)
@@ -38214,7 +37808,7 @@ _sk_overlay_sse2 LABEL PROC
DB 232,0,0,0,0 ; call 14da <_sk_overlay_sse2+0x18>
DB 88 ; pop %eax
DB 15,40,69,88 ; movaps 0x58(%ebp),%xmm0
- DB 15,40,144,22,128,0,0 ; movaps 0x8016(%eax),%xmm2
+ DB 15,40,144,134,126,0,0 ; movaps 0x7e86(%eax),%xmm2
DB 15,40,234 ; movaps %xmm2,%xmm5
DB 15,92,232 ; subps %xmm0,%xmm5
DB 15,40,248 ; movaps %xmm0,%xmm7
@@ -38356,17 +37950,17 @@ _sk_softlight_sse2 LABEL PROC
DB 232,0,0,0,0 ; call 16a9 <_sk_softlight_sse2+0x51>
DB 88 ; pop %eax
DB 15,40,233 ; movaps %xmm1,%xmm5
- DB 15,40,128,103,126,0,0 ; movaps 0x7e67(%eax),%xmm0
+ DB 15,40,128,215,124,0,0 ; movaps 0x7cd7(%eax),%xmm0
DB 15,41,133,120,255,255,255 ; movaps %xmm0,-0x88(%ebp)
DB 15,88,232 ; addps %xmm0,%xmm5
DB 15,89,234 ; mulps %xmm2,%xmm5
- DB 15,40,184,87,126,0,0 ; movaps 0x7e57(%eax),%xmm7
+ DB 15,40,184,199,124,0,0 ; movaps 0x7cc7(%eax),%xmm7
DB 15,41,125,216 ; movaps %xmm7,-0x28(%ebp)
DB 15,92,249 ; subps %xmm1,%xmm7
DB 15,82,209 ; rsqrtps %xmm1,%xmm2
DB 15,83,242 ; rcpps %xmm2,%xmm6
DB 15,92,241 ; subps %xmm1,%xmm6
- DB 15,40,128,119,126,0,0 ; movaps 0x7e77(%eax),%xmm0
+ DB 15,40,128,231,124,0,0 ; movaps 0x7ce7(%eax),%xmm0
DB 15,41,69,168 ; movaps %xmm0,-0x58(%ebp)
DB 15,89,200 ; mulps %xmm0,%xmm1
DB 15,88,205 ; addps %xmm5,%xmm1
@@ -38577,7 +38171,7 @@ _sk_hue_sse2 LABEL PROC
DB 15,41,101,200 ; movaps %xmm4,-0x38(%ebp)
DB 15,40,233 ; movaps %xmm1,%xmm5
DB 15,89,238 ; mulps %xmm6,%xmm5
- DB 15,40,184,230,123,0,0 ; movaps 0x7be6(%eax),%xmm7
+ DB 15,40,184,86,122,0,0 ; movaps 0x7a56(%eax),%xmm7
DB 15,41,125,168 ; movaps %xmm7,-0x58(%ebp)
DB 15,92,125,88 ; subps 0x58(%ebp),%xmm7
DB 15,89,199 ; mulps %xmm7,%xmm0
@@ -38607,15 +38201,15 @@ _sk_hue_sse2 LABEL PROC
DB 15,89,243 ; mulps %xmm3,%xmm6
DB 15,89,235 ; mulps %xmm3,%xmm5
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,40,152,182,123,0,0 ; movaps 0x7bb6(%eax),%xmm3
+ DB 15,40,152,38,122,0,0 ; movaps 0x7a26(%eax),%xmm3
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
DB 15,40,77,40 ; movaps 0x28(%ebp),%xmm1
DB 15,89,203 ; mulps %xmm3,%xmm1
- DB 15,40,160,198,123,0,0 ; movaps 0x7bc6(%eax),%xmm4
+ DB 15,40,160,54,122,0,0 ; movaps 0x7a36(%eax),%xmm4
DB 15,40,125,56 ; movaps 0x38(%ebp),%xmm7
DB 15,89,252 ; mulps %xmm4,%xmm7
DB 15,88,249 ; addps %xmm1,%xmm7
- DB 15,40,152,214,123,0,0 ; movaps 0x7bd6(%eax),%xmm3
+ DB 15,40,152,70,122,0,0 ; movaps 0x7a46(%eax),%xmm3
DB 15,40,77,72 ; movaps 0x48(%ebp),%xmm1
DB 15,89,203 ; mulps %xmm3,%xmm1
DB 15,88,207 ; addps %xmm7,%xmm1
@@ -38828,15 +38422,15 @@ _sk_saturation_sse2 LABEL PROC
DB 15,89,254 ; mulps %xmm6,%xmm7
DB 232,0,0,0,0 ; call 1cc8 <_sk_saturation_sse2+0x8e>
DB 88 ; pop %eax
- DB 15,40,176,168,120,0,0 ; movaps 0x78a8(%eax),%xmm6
+ DB 15,40,176,24,119,0,0 ; movaps 0x7718(%eax),%xmm6
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 15,89,214 ; mulps %xmm6,%xmm2
- DB 15,40,160,184,120,0,0 ; movaps 0x78b8(%eax),%xmm4
+ DB 15,40,160,40,119,0,0 ; movaps 0x7728(%eax),%xmm4
DB 15,40,77,56 ; movaps 0x38(%ebp),%xmm1
DB 15,89,204 ; mulps %xmm4,%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 15,40,85,72 ; movaps 0x48(%ebp),%xmm2
- DB 15,89,144,200,120,0,0 ; mulps 0x78c8(%eax),%xmm2
+ DB 15,89,144,56,119,0,0 ; mulps 0x7738(%eax),%xmm2
DB 15,88,209 ; addps %xmm1,%xmm2
DB 15,94,232 ; divps %xmm0,%xmm5
DB 15,94,216 ; divps %xmm0,%xmm3
@@ -38852,7 +38446,7 @@ _sk_saturation_sse2 LABEL PROC
DB 15,89,252 ; mulps %xmm4,%xmm7
DB 15,88,249 ; addps %xmm1,%xmm7
DB 15,40,200 ; movaps %xmm0,%xmm1
- DB 15,89,136,200,120,0,0 ; mulps 0x78c8(%eax),%xmm1
+ DB 15,89,136,56,119,0,0 ; mulps 0x7738(%eax),%xmm1
DB 15,88,207 ; addps %xmm7,%xmm1
DB 15,89,85,216 ; mulps -0x28(%ebp),%xmm2
DB 15,92,209 ; subps %xmm1,%xmm2
@@ -38872,7 +38466,7 @@ _sk_saturation_sse2 LABEL PROC
DB 15,89,245 ; mulps %xmm5,%xmm6
DB 15,89,227 ; mulps %xmm3,%xmm4
DB 15,88,230 ; addps %xmm6,%xmm4
- DB 15,40,128,200,120,0,0 ; movaps 0x78c8(%eax),%xmm0
+ DB 15,40,128,56,119,0,0 ; movaps 0x7738(%eax),%xmm0
DB 15,89,194 ; mulps %xmm2,%xmm0
DB 15,88,196 ; addps %xmm4,%xmm0
DB 15,41,69,136 ; movaps %xmm0,-0x78(%ebp)
@@ -38895,7 +38489,7 @@ _sk_saturation_sse2 LABEL PROC
DB 15,40,224 ; movaps %xmm0,%xmm4
DB 15,40,69,88 ; movaps 0x58(%ebp),%xmm0
DB 15,89,200 ; mulps %xmm0,%xmm1
- DB 15,40,144,216,120,0,0 ; movaps 0x78d8(%eax),%xmm2
+ DB 15,40,144,72,119,0,0 ; movaps 0x7748(%eax),%xmm2
DB 15,41,85,152 ; movaps %xmm2,-0x68(%ebp)
DB 15,92,212 ; subps %xmm4,%xmm2
DB 15,41,85,168 ; movaps %xmm2,-0x58(%ebp)
@@ -39023,15 +38617,15 @@ _sk_color_sse2 LABEL PROC
DB 88 ; pop %eax
DB 15,40,85,56 ; movaps 0x38(%ebp),%xmm2
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
- DB 15,40,152,97,118,0,0 ; movaps 0x7661(%eax),%xmm3
+ DB 15,40,152,209,116,0,0 ; movaps 0x74d1(%eax),%xmm3
DB 15,89,227 ; mulps %xmm3,%xmm4
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
- DB 15,40,176,113,118,0,0 ; movaps 0x7671(%eax),%xmm6
+ DB 15,40,176,225,116,0,0 ; movaps 0x74e1(%eax),%xmm6
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,41,117,184 ; movaps %xmm6,-0x48(%ebp)
DB 15,88,212 ; addps %xmm4,%xmm2
DB 15,40,101,72 ; movaps 0x48(%ebp),%xmm4
- DB 15,40,184,129,118,0,0 ; movaps 0x7681(%eax),%xmm7
+ DB 15,40,184,241,116,0,0 ; movaps 0x74f1(%eax),%xmm7
DB 15,41,189,56,255,255,255 ; movaps %xmm7,-0xc8(%ebp)
DB 15,89,231 ; mulps %xmm7,%xmm4
DB 15,88,226 ; addps %xmm2,%xmm4
@@ -39046,7 +38640,7 @@ _sk_color_sse2 LABEL PROC
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 15,89,214 ; mulps %xmm6,%xmm2
DB 15,88,212 ; addps %xmm4,%xmm2
- DB 15,40,136,145,118,0,0 ; movaps 0x7691(%eax),%xmm1
+ DB 15,40,136,1,117,0,0 ; movaps 0x7501(%eax),%xmm1
DB 15,41,77,168 ; movaps %xmm1,-0x58(%ebp)
DB 15,40,225 ; movaps %xmm1,%xmm4
DB 15,40,93,88 ; movaps 0x58(%ebp),%xmm3
@@ -39225,17 +38819,17 @@ _sk_luminosity_sse2 LABEL PROC
DB 15,40,216 ; movaps %xmm0,%xmm3
DB 232,0,0,0,0 ; call 2202 <_sk_luminosity_sse2+0x1a>
DB 88 ; pop %eax
- DB 15,40,160,238,115,0,0 ; movaps 0x73ee(%eax),%xmm4
+ DB 15,40,160,94,114,0,0 ; movaps 0x725e(%eax),%xmm4
DB 15,41,101,216 ; movaps %xmm4,-0x28(%ebp)
DB 15,40,211 ; movaps %xmm3,%xmm2
DB 15,89,212 ; mulps %xmm4,%xmm2
- DB 15,40,128,254,115,0,0 ; movaps 0x73fe(%eax),%xmm0
+ DB 15,40,128,110,114,0,0 ; movaps 0x726e(%eax),%xmm0
DB 15,41,69,200 ; movaps %xmm0,-0x38(%ebp)
DB 15,40,225 ; movaps %xmm1,%xmm4
DB 15,89,224 ; mulps %xmm0,%xmm4
DB 15,88,226 ; addps %xmm2,%xmm4
DB 15,40,85,88 ; movaps 0x58(%ebp),%xmm2
- DB 15,40,184,30,116,0,0 ; movaps 0x741e(%eax),%xmm7
+ DB 15,40,184,142,114,0,0 ; movaps 0x728e(%eax),%xmm7
DB 15,41,125,152 ; movaps %xmm7,-0x68(%ebp)
DB 15,92,250 ; subps %xmm2,%xmm7
DB 15,89,223 ; mulps %xmm7,%xmm3
@@ -39245,7 +38839,7 @@ _sk_luminosity_sse2 LABEL PROC
DB 15,89,253 ; mulps %xmm5,%xmm7
DB 15,41,189,120,255,255,255 ; movaps %xmm7,-0x88(%ebp)
DB 15,40,205 ; movaps %xmm5,%xmm1
- DB 15,40,128,14,116,0,0 ; movaps 0x740e(%eax),%xmm0
+ DB 15,40,128,126,114,0,0 ; movaps 0x727e(%eax),%xmm0
DB 15,89,200 ; mulps %xmm0,%xmm1
DB 15,88,204 ; addps %xmm4,%xmm1
DB 15,40,238 ; movaps %xmm6,%xmm5
@@ -39428,7 +39022,7 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 15,133,40,1,0,0 ; jne 25d4 <_sk_srcover_rgba_8888_sse2+0x15d>
DB 243,15,111,12,142 ; movdqu (%esi,%ecx,4),%xmm1
- DB 102,15,111,135,154,113,0,0 ; movdqa 0x719a(%edi),%xmm0
+ DB 102,15,111,135,10,112,0,0 ; movdqa 0x700a(%edi),%xmm0
DB 102,15,111,225 ; movdqa %xmm1,%xmm4
DB 102,15,219,224 ; pand %xmm0,%xmm4
DB 102,15,111,249 ; movdqa %xmm1,%xmm7
@@ -39438,9 +39032,9 @@ _sk_srcover_rgba_8888_sse2 LABEL PROC
DB 102,15,114,213,16 ; psrld $0x10,%xmm5
DB 102,15,219,232 ; pand %xmm0,%xmm5
DB 15,91,244 ; cvtdq2ps %xmm4,%xmm6
- DB 15,40,167,170,113,0,0 ; movaps 0x71aa(%edi),%xmm4
+ DB 15,40,167,26,112,0,0 ; movaps 0x701a(%edi),%xmm4
DB 15,92,227 ; subps %xmm3,%xmm4
- DB 15,40,135,186,113,0,0 ; movaps 0x71ba(%edi),%xmm0
+ DB 15,40,135,42,112,0,0 ; movaps 0x702a(%edi),%xmm0
DB 15,41,69,216 ; movaps %xmm0,-0x28(%ebp)
DB 15,40,85,200 ; movaps -0x38(%ebp),%xmm2
DB 15,89,208 ; mulps %xmm0,%xmm2
@@ -39595,7 +39189,7 @@ _sk_clamp_1_sse2 LABEL PROC
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 15,40,109,56 ; movaps 0x38(%ebp),%xmm5
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
- DB 15,40,184,148,111,0,0 ; movaps 0x6f94(%eax),%xmm7
+ DB 15,40,184,4,110,0,0 ; movaps 0x6e04(%eax),%xmm7
DB 15,93,199 ; minps %xmm7,%xmm0
DB 15,93,207 ; minps %xmm7,%xmm1
DB 15,93,215 ; minps %xmm7,%xmm2
@@ -39638,7 +39232,7 @@ _sk_clamp_a_sse2 LABEL PROC
DB 15,40,109,56 ; movaps 0x38(%ebp),%xmm5
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
- DB 15,93,152,47,111,0,0 ; minps 0x6f2f(%eax),%xmm3
+ DB 15,93,152,159,109,0,0 ; minps 0x6d9f(%eax),%xmm3
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 15,93,195 ; minps %xmm3,%xmm0
DB 15,93,203 ; minps %xmm3,%xmm1
@@ -39676,7 +39270,7 @@ _sk_clamp_a_dst_sse2 LABEL PROC
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 139,125,24 ; mov 0x18(%ebp),%edi
DB 15,40,101,88 ; movaps 0x58(%ebp),%xmm4
- DB 15,93,160,205,110,0,0 ; minps 0x6ecd(%eax),%xmm4
+ DB 15,93,160,61,109,0,0 ; minps 0x6d3d(%eax),%xmm4
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 15,40,117,56 ; movaps 0x38(%ebp),%xmm6
@@ -39903,7 +39497,7 @@ _sk_unpremul_sse2 LABEL PROC
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 15,40,109,56 ; movaps 0x38(%ebp),%xmm5
DB 15,87,246 ; xorps %xmm6,%xmm6
- DB 15,40,185,128,108,0,0 ; movaps 0x6c80(%ecx),%xmm7
+ DB 15,40,185,240,106,0,0 ; movaps 0x6af0(%ecx),%xmm7
DB 15,94,251 ; divps %xmm3,%xmm7
DB 15,194,243,4 ; cmpneqps %xmm3,%xmm6
DB 15,84,247 ; andps %xmm7,%xmm6
@@ -39947,19 +39541,19 @@ _sk_from_srgb_sse2 LABEL PROC
DB 88 ; pop %eax
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,89,219 ; mulps %xmm3,%xmm3
- DB 15,40,160,17,108,0,0 ; movaps 0x6c11(%eax),%xmm4
+ DB 15,40,160,129,106,0,0 ; movaps 0x6a81(%eax),%xmm4
DB 15,89,196 ; mulps %xmm4,%xmm0
- DB 15,40,136,33,108,0,0 ; movaps 0x6c21(%eax),%xmm1
+ DB 15,40,136,145,106,0,0 ; movaps 0x6a91(%eax),%xmm1
DB 15,41,77,200 ; movaps %xmm1,-0x38(%ebp)
DB 15,88,193 ; addps %xmm1,%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,40,152,1,108,0,0 ; movaps 0x6c01(%eax),%xmm3
+ DB 15,40,152,113,106,0,0 ; movaps 0x6a71(%eax),%xmm3
DB 15,40,202 ; movaps %xmm2,%xmm1
DB 15,89,203 ; mulps %xmm3,%xmm1
- DB 15,40,184,49,108,0,0 ; movaps 0x6c31(%eax),%xmm7
+ DB 15,40,184,161,106,0,0 ; movaps 0x6aa1(%eax),%xmm7
DB 15,41,125,216 ; movaps %xmm7,-0x28(%ebp)
DB 15,88,199 ; addps %xmm7,%xmm0
- DB 15,40,184,65,108,0,0 ; movaps 0x6c41(%eax),%xmm7
+ DB 15,40,184,177,106,0,0 ; movaps 0x6ab1(%eax),%xmm7
DB 15,194,215,1 ; cmpltps %xmm7,%xmm2
DB 15,84,202 ; andps %xmm2,%xmm1
DB 15,85,208 ; andnps %xmm0,%xmm2
@@ -40036,19 +39630,19 @@ _sk_from_srgb_dst_sse2 LABEL PROC
DB 15,40,77,40 ; movaps 0x28(%ebp),%xmm1
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
- DB 15,40,168,62,107,0,0 ; movaps 0x6b3e(%eax),%xmm5
+ DB 15,40,168,174,105,0,0 ; movaps 0x69ae(%eax),%xmm5
DB 15,40,249 ; movaps %xmm1,%xmm7
DB 15,89,253 ; mulps %xmm5,%xmm7
- DB 15,40,144,78,107,0,0 ; movaps 0x6b4e(%eax),%xmm2
+ DB 15,40,144,190,105,0,0 ; movaps 0x69be(%eax),%xmm2
DB 15,41,85,216 ; movaps %xmm2,-0x28(%ebp)
DB 15,88,250 ; addps %xmm2,%xmm7
DB 15,89,248 ; mulps %xmm0,%xmm7
- DB 15,40,176,46,107,0,0 ; movaps 0x6b2e(%eax),%xmm6
+ DB 15,40,176,158,105,0,0 ; movaps 0x699e(%eax),%xmm6
DB 15,40,225 ; movaps %xmm1,%xmm4
DB 15,89,230 ; mulps %xmm6,%xmm4
- DB 15,40,152,94,107,0,0 ; movaps 0x6b5e(%eax),%xmm3
+ DB 15,40,152,206,105,0,0 ; movaps 0x69ce(%eax),%xmm3
DB 15,88,251 ; addps %xmm3,%xmm7
- DB 15,40,144,110,107,0,0 ; movaps 0x6b6e(%eax),%xmm2
+ DB 15,40,144,222,105,0,0 ; movaps 0x69de(%eax),%xmm2
DB 15,194,202,1 ; cmpltps %xmm2,%xmm1
DB 15,84,225 ; andps %xmm1,%xmm4
DB 15,85,207 ; andnps %xmm7,%xmm1
@@ -40122,25 +39716,25 @@ _sk_to_srgb_sse2 LABEL PROC
DB 232,0,0,0,0 ; call 2ce2 <_sk_to_srgb_sse2+0x1e>
DB 88 ; pop %eax
DB 15,82,218 ; rsqrtps %xmm2,%xmm3
- DB 15,40,160,110,106,0,0 ; movaps 0x6a6e(%eax),%xmm4
+ DB 15,40,160,222,104,0,0 ; movaps 0x68de(%eax),%xmm4
DB 15,40,235 ; movaps %xmm3,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
- DB 15,40,128,126,106,0,0 ; movaps 0x6a7e(%eax),%xmm0
+ DB 15,40,128,238,104,0,0 ; movaps 0x68ee(%eax),%xmm0
DB 15,41,69,216 ; movaps %xmm0,-0x28(%ebp)
DB 15,88,232 ; addps %xmm0,%xmm5
DB 15,89,235 ; mulps %xmm3,%xmm5
- DB 15,40,128,142,106,0,0 ; movaps 0x6a8e(%eax),%xmm0
+ DB 15,40,128,254,104,0,0 ; movaps 0x68fe(%eax),%xmm0
DB 15,41,69,184 ; movaps %xmm0,-0x48(%ebp)
DB 15,88,232 ; addps %xmm0,%xmm5
- DB 15,40,128,158,106,0,0 ; movaps 0x6a9e(%eax),%xmm0
+ DB 15,40,128,14,105,0,0 ; movaps 0x690e(%eax),%xmm0
DB 15,41,69,200 ; movaps %xmm0,-0x38(%ebp)
DB 15,88,216 ; addps %xmm0,%xmm3
DB 15,83,195 ; rcpps %xmm3,%xmm0
DB 15,89,197 ; mulps %xmm5,%xmm0
- DB 15,40,168,94,106,0,0 ; movaps 0x6a5e(%eax),%xmm5
+ DB 15,40,168,206,104,0,0 ; movaps 0x68ce(%eax),%xmm5
DB 15,40,202 ; movaps %xmm2,%xmm1
DB 15,89,205 ; mulps %xmm5,%xmm1
- DB 15,40,152,174,106,0,0 ; movaps 0x6aae(%eax),%xmm3
+ DB 15,40,152,30,105,0,0 ; movaps 0x691e(%eax),%xmm3
DB 15,194,211,1 ; cmpltps %xmm3,%xmm2
DB 15,84,202 ; andps %xmm2,%xmm1
DB 15,85,208 ; andnps %xmm0,%xmm2
@@ -40227,13 +39821,13 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 15,92,199 ; subps %xmm7,%xmm0
DB 15,41,69,200 ; movaps %xmm0,-0x38(%ebp)
- DB 15,40,152,127,105,0,0 ; movaps 0x697f(%eax),%xmm3
+ DB 15,40,152,239,103,0,0 ; movaps 0x67ef(%eax),%xmm3
DB 15,94,216 ; divps %xmm0,%xmm3
DB 15,40,197 ; movaps %xmm5,%xmm0
DB 15,92,194 ; subps %xmm2,%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
DB 15,194,234,1 ; cmpltps %xmm2,%xmm5
- DB 15,84,168,143,105,0,0 ; andps 0x698f(%eax),%xmm5
+ DB 15,84,168,255,103,0,0 ; andps 0x67ff(%eax),%xmm5
DB 15,88,232 ; addps %xmm0,%xmm5
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 15,194,196,0 ; cmpeqps %xmm4,%xmm0
@@ -40243,9 +39837,9 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 15,92,101,216 ; subps -0x28(%ebp),%xmm4
DB 15,89,211 ; mulps %xmm3,%xmm2
DB 15,89,227 ; mulps %xmm3,%xmm4
- DB 15,40,152,159,105,0,0 ; movaps 0x699f(%eax),%xmm3
+ DB 15,40,152,15,104,0,0 ; movaps 0x680f(%eax),%xmm3
DB 15,88,211 ; addps %xmm3,%xmm2
- DB 15,88,160,175,105,0,0 ; addps 0x69af(%eax),%xmm4
+ DB 15,88,160,31,104,0,0 ; addps 0x681f(%eax),%xmm4
DB 15,84,214 ; andps %xmm6,%xmm2
DB 15,85,244 ; andnps %xmm4,%xmm6
DB 15,86,242 ; orps %xmm2,%xmm6
@@ -40260,7 +39854,7 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 15,194,231,4 ; cmpneqps %xmm7,%xmm4
DB 15,92,217 ; subps %xmm1,%xmm3
DB 15,88,207 ; addps %xmm7,%xmm1
- DB 15,40,168,207,105,0,0 ; movaps 0x69cf(%eax),%xmm5
+ DB 15,40,168,63,104,0,0 ; movaps 0x683f(%eax),%xmm5
DB 15,92,223 ; subps %xmm7,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 15,89,213 ; mulps %xmm5,%xmm2
@@ -40273,7 +39867,7 @@ _sk_rgb_to_hsl_sse2 LABEL PROC
DB 15,40,77,200 ; movaps -0x38(%ebp),%xmm1
DB 15,94,205 ; divps %xmm5,%xmm1
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
- DB 15,89,128,191,105,0,0 ; mulps 0x69bf(%eax),%xmm0
+ DB 15,89,128,47,104,0,0 ; mulps 0x682f(%eax),%xmm0
DB 15,84,196 ; andps %xmm4,%xmm0
DB 15,84,204 ; andps %xmm4,%xmm1
DB 15,40,101,88 ; movaps 0x58(%ebp),%xmm4
@@ -40309,7 +39903,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,41,69,200 ; movaps %xmm0,-0x38(%ebp)
DB 232,0,0,0,0 ; call 2f56 <_sk_hsl_to_rgb_sse2+0x1c>
DB 88 ; pop %eax
- DB 15,40,152,170,104,0,0 ; movaps 0x68aa(%eax),%xmm3
+ DB 15,40,152,26,103,0,0 ; movaps 0x671a(%eax),%xmm3
DB 15,40,227 ; movaps %xmm3,%xmm4
DB 15,40,243 ; movaps %xmm3,%xmm6
DB 15,41,181,72,255,255,255 ; movaps %xmm6,-0xb8(%ebp)
@@ -40323,13 +39917,13 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,84,236 ; andps %xmm4,%xmm5
DB 15,85,225 ; andnps %xmm1,%xmm4
DB 15,86,229 ; orps %xmm5,%xmm4
- DB 15,40,136,186,104,0,0 ; movaps 0x68ba(%eax),%xmm1
+ DB 15,40,136,42,103,0,0 ; movaps 0x672a(%eax),%xmm1
DB 15,88,200 ; addps %xmm0,%xmm1
DB 243,15,91,193 ; cvttps2dq %xmm1,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,217 ; movaps %xmm1,%xmm3
DB 15,194,216,1 ; cmpltps %xmm0,%xmm3
- DB 15,40,168,202,104,0,0 ; movaps 0x68ca(%eax),%xmm5
+ DB 15,40,168,58,103,0,0 ; movaps 0x673a(%eax),%xmm5
DB 15,41,173,104,255,255,255 ; movaps %xmm5,-0x98(%ebp)
DB 15,84,221 ; andps %xmm5,%xmm3
DB 15,92,195 ; subps %xmm3,%xmm0
@@ -40340,19 +39934,19 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,41,101,184 ; movaps %xmm4,-0x48(%ebp)
DB 15,88,237 ; addps %xmm5,%xmm5
DB 15,92,236 ; subps %xmm4,%xmm5
- DB 15,40,144,218,104,0,0 ; movaps 0x68da(%eax),%xmm2
+ DB 15,40,144,74,103,0,0 ; movaps 0x674a(%eax),%xmm2
DB 15,41,85,168 ; movaps %xmm2,-0x58(%ebp)
DB 15,194,209,2 ; cmpleps %xmm1,%xmm2
DB 15,92,229 ; subps %xmm5,%xmm4
DB 15,40,198 ; movaps %xmm6,%xmm0
DB 15,194,193,2 ; cmpleps %xmm1,%xmm0
- DB 15,40,176,10,105,0,0 ; movaps 0x690a(%eax),%xmm6
+ DB 15,40,176,122,103,0,0 ; movaps 0x677a(%eax),%xmm6
DB 15,41,181,88,255,255,255 ; movaps %xmm6,-0xa8(%ebp)
DB 15,194,241,2 ; cmpleps %xmm1,%xmm6
- DB 15,40,152,234,104,0,0 ; movaps 0x68ea(%eax),%xmm3
+ DB 15,40,152,90,103,0,0 ; movaps 0x675a(%eax),%xmm3
DB 15,41,93,152 ; movaps %xmm3,-0x68(%ebp)
DB 15,89,203 ; mulps %xmm3,%xmm1
- DB 15,40,184,250,104,0,0 ; movaps 0x68fa(%eax),%xmm7
+ DB 15,40,184,106,103,0,0 ; movaps 0x676a(%eax),%xmm7
DB 15,41,125,136 ; movaps %xmm7,-0x78(%ebp)
DB 15,92,249 ; subps %xmm1,%xmm7
DB 15,89,252 ; mulps %xmm4,%xmm7
@@ -40377,18 +39971,18 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,202 ; movaps %xmm2,%xmm1
DB 15,194,200,1 ; cmpltps %xmm0,%xmm1
- DB 15,84,136,202,104,0,0 ; andps 0x68ca(%eax),%xmm1
+ DB 15,84,136,58,103,0,0 ; andps 0x673a(%eax),%xmm1
DB 15,92,193 ; subps %xmm1,%xmm0
DB 15,40,202 ; movaps %xmm2,%xmm1
DB 15,92,200 ; subps %xmm0,%xmm1
- DB 15,40,128,218,104,0,0 ; movaps 0x68da(%eax),%xmm0
+ DB 15,40,128,74,103,0,0 ; movaps 0x674a(%eax),%xmm0
DB 15,194,193,2 ; cmpleps %xmm1,%xmm0
- DB 15,40,144,170,104,0,0 ; movaps 0x68aa(%eax),%xmm2
+ DB 15,40,144,26,103,0,0 ; movaps 0x671a(%eax),%xmm2
DB 15,194,209,2 ; cmpleps %xmm1,%xmm2
- DB 15,40,152,10,105,0,0 ; movaps 0x690a(%eax),%xmm3
+ DB 15,40,152,122,103,0,0 ; movaps 0x677a(%eax),%xmm3
DB 15,194,217,2 ; cmpleps %xmm1,%xmm3
- DB 15,89,136,234,104,0,0 ; mulps 0x68ea(%eax),%xmm1
- DB 15,40,176,250,104,0,0 ; movaps 0x68fa(%eax),%xmm6
+ DB 15,89,136,90,103,0,0 ; mulps 0x675a(%eax),%xmm1
+ DB 15,40,176,106,103,0,0 ; movaps 0x676a(%eax),%xmm6
DB 15,92,241 ; subps %xmm1,%xmm6
DB 15,89,244 ; mulps %xmm4,%xmm6
DB 15,88,245 ; addps %xmm5,%xmm6
@@ -40408,7 +40002,7 @@ _sk_hsl_to_rgb_sse2 LABEL PROC
DB 15,40,117,216 ; movaps -0x28(%ebp),%xmm6
DB 15,85,243 ; andnps %xmm3,%xmm6
DB 15,40,85,200 ; movaps -0x38(%ebp),%xmm2
- DB 15,88,144,26,105,0,0 ; addps 0x691a(%eax),%xmm2
+ DB 15,88,144,138,103,0,0 ; addps 0x678a(%eax),%xmm2
DB 243,15,91,194 ; cvttps2dq %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
DB 15,40,202 ; movaps %xmm2,%xmm1
@@ -40544,9 +40138,9 @@ _sk_scale_u8_sse2 LABEL PROC
DB 102,15,110,36,57 ; movd (%ecx,%edi,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,163,36,102,0,0 ; pand 0x6624(%ebx),%xmm4
+ DB 102,15,219,163,148,100,0,0 ; pand 0x6494(%ebx),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,163,52,102,0,0 ; mulps 0x6634(%ebx),%xmm4
+ DB 15,89,163,164,100,0,0 ; mulps 0x64a4(%ebx),%xmm4
DB 15,89,196 ; mulps %xmm4,%xmm0
DB 15,89,204 ; mulps %xmm4,%xmm1
DB 15,89,212 ; mulps %xmm4,%xmm2
@@ -40670,9 +40264,9 @@ _sk_lerp_u8_sse2 LABEL PROC
DB 102,15,110,36,57 ; movd (%ecx,%edi,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,163,189,100,0,0 ; pand 0x64bd(%ebx),%xmm4
+ DB 102,15,219,163,45,99,0,0 ; pand 0x632d(%ebx),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,163,205,100,0,0 ; mulps 0x64cd(%ebx),%xmm4
+ DB 15,89,163,61,99,0,0 ; mulps 0x633d(%ebx),%xmm4
DB 15,92,197 ; subps %xmm5,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
DB 15,40,117,56 ; movaps 0x38(%ebp),%xmm6
@@ -40754,17 +40348,17 @@ _sk_lerp_565_sse2 LABEL PROC
DB 15,133,212,0,0,0 ; jne 35ec <_sk_lerp_565_sse2+0xfb>
DB 243,15,126,52,121 ; movq (%ecx,%edi,2),%xmm6
DB 102,15,97,240 ; punpcklwd %xmm0,%xmm6
- DB 102,15,111,163,193,99,0,0 ; movdqa 0x63c1(%ebx),%xmm4
+ DB 102,15,111,163,49,98,0,0 ; movdqa 0x6231(%ebx),%xmm4
DB 102,15,219,230 ; pand %xmm6,%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,163,209,99,0,0 ; mulps 0x63d1(%ebx),%xmm4
- DB 102,15,111,187,225,99,0,0 ; movdqa 0x63e1(%ebx),%xmm7
+ DB 15,89,163,65,98,0,0 ; mulps 0x6241(%ebx),%xmm4
+ DB 102,15,111,187,81,98,0,0 ; movdqa 0x6251(%ebx),%xmm7
DB 102,15,219,254 ; pand %xmm6,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 15,89,187,241,99,0,0 ; mulps 0x63f1(%ebx),%xmm7
- DB 102,15,219,179,1,100,0,0 ; pand 0x6401(%ebx),%xmm6
+ DB 15,89,187,97,98,0,0 ; mulps 0x6261(%ebx),%xmm7
+ DB 102,15,219,179,113,98,0,0 ; pand 0x6271(%ebx),%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,179,17,100,0,0 ; mulps 0x6411(%ebx),%xmm6
+ DB 15,89,179,129,98,0,0 ; mulps 0x6281(%ebx),%xmm6
DB 15,40,109,40 ; movaps 0x28(%ebp),%xmm5
DB 15,92,197 ; subps %xmm5,%xmm0
DB 15,89,196 ; mulps %xmm4,%xmm0
@@ -40850,7 +40444,7 @@ _sk_load_tables_sse2 LABEL PROC
DB 139,58 ; mov (%edx),%edi
DB 15,133,75,1,0,0 ; jne 37b2 <_sk_load_tables_sse2+0x16f>
DB 243,15,111,28,159 ; movdqu (%edi,%ebx,4),%xmm3
- DB 102,15,111,150,207,98,0,0 ; movdqa 0x62cf(%esi),%xmm2
+ DB 102,15,111,150,63,97,0,0 ; movdqa 0x613f(%esi),%xmm2
DB 102,15,111,195 ; movdqa %xmm3,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 102,15,112,200,229 ; pshufd $0xe5,%xmm0,%xmm1
@@ -40906,7 +40500,7 @@ _sk_load_tables_sse2 LABEL PROC
DB 15,20,215 ; unpcklps %xmm7,%xmm2
DB 102,15,114,211,24 ; psrld $0x18,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,158,223,98,0,0 ; mulps 0x62df(%esi),%xmm3
+ DB 15,89,158,79,97,0,0 ; mulps 0x614f(%esi),%xmm3
DB 139,77,12 ; mov 0xc(%ebp),%ecx
DB 137,206 ; mov %ecx,%esi
DB 141,78,8 ; lea 0x8(%esi),%ecx
@@ -41062,7 +40656,7 @@ _sk_load_tables_u16_be_sse2 LABEL PROC
DB 243,15,126,93,208 ; movq -0x30(%ebp),%xmm3
DB 102,15,97,223 ; punpcklwd %xmm7,%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,159,66,97,0,0 ; mulps 0x6142(%edi),%xmm3
+ DB 15,89,159,178,95,0,0 ; mulps 0x5fb2(%edi),%xmm3
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 137,193 ; mov %eax,%ecx
DB 141,65,8 ; lea 0x8(%ecx),%eax
@@ -41229,7 +40823,7 @@ _sk_load_tables_rgb_u16_be_sse2 LABEL PROC
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 137,4,36 ; mov %eax,(%esp)
DB 139,69,240 ; mov -0x10(%ebp),%eax
- DB 15,40,152,15,95,0,0 ; movaps 0x5f0f(%eax),%xmm3
+ DB 15,40,152,127,93,0,0 ; movaps 0x5d7f(%eax),%xmm3
DB 15,40,197 ; movaps %xmm5,%xmm0
DB 255,81,4 ; call *0x4(%ecx)
DB 131,196,124 ; add $0x7c,%esp
@@ -41270,7 +40864,7 @@ _sk_byte_tables_sse2 LABEL PROC
DB 90 ; pop %edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 139,8 ; mov (%eax),%ecx
- DB 15,40,170,213,92,0,0 ; movaps 0x5cd5(%edx),%xmm5
+ DB 15,40,170,69,91,0,0 ; movaps 0x5b45(%edx),%xmm5
DB 15,89,197 ; mulps %xmm5,%xmm0
DB 102,15,91,192 ; cvtps2dq %xmm0,%xmm0
DB 102,15,112,224,78 ; pshufd $0x4e,%xmm0,%xmm4
@@ -41292,7 +40886,7 @@ _sk_byte_tables_sse2 LABEL PROC
DB 102,15,196,192,0 ; pinsrw $0x0,%eax,%xmm0
DB 139,65,4 ; mov 0x4(%ecx),%eax
DB 102,15,196,195,1 ; pinsrw $0x1,%ebx,%xmm0
- DB 15,40,162,229,92,0,0 ; movaps 0x5ce5(%edx),%xmm4
+ DB 15,40,162,85,91,0,0 ; movaps 0x5b55(%edx),%xmm4
DB 15,89,205 ; mulps %xmm5,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,15,112,241,78 ; pshufd $0x4e,%xmm1,%xmm6
@@ -41434,7 +41028,7 @@ _sk_byte_tables_rgb_sse2 LABEL PROC
DB 102,15,196,199,0 ; pinsrw $0x0,%edi,%xmm0
DB 139,121,4 ; mov 0x4(%ecx),%edi
DB 102,15,196,198,1 ; pinsrw $0x1,%esi,%xmm0
- DB 15,40,170,185,90,0,0 ; movaps 0x5ab9(%edx),%xmm5
+ DB 15,40,170,41,89,0,0 ; movaps 0x5929(%edx),%xmm5
DB 15,89,204 ; mulps %xmm4,%xmm1
DB 102,15,91,201 ; cvtps2dq %xmm1,%xmm1
DB 102,15,112,241,78 ; pshufd $0x4e,%xmm1,%xmm6
@@ -41768,15 +41362,15 @@ _sk_parametric_r_sse2 LABEL PROC
DB 15,88,244 ; addps %xmm4,%xmm6
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
DB 15,91,230 ; cvtdq2ps %xmm6,%xmm4
- DB 15,89,166,192,86,0,0 ; mulps 0x56c0(%esi),%xmm4
- DB 15,84,182,208,86,0,0 ; andps 0x56d0(%esi),%xmm6
- DB 15,86,182,224,86,0,0 ; orps 0x56e0(%esi),%xmm6
- DB 15,88,166,240,86,0,0 ; addps 0x56f0(%esi),%xmm4
- DB 15,40,190,0,87,0,0 ; movaps 0x5700(%esi),%xmm7
+ DB 15,89,166,48,85,0,0 ; mulps 0x5530(%esi),%xmm4
+ DB 15,84,182,64,85,0,0 ; andps 0x5540(%esi),%xmm6
+ DB 15,86,182,80,85,0,0 ; orps 0x5550(%esi),%xmm6
+ DB 15,88,166,96,85,0,0 ; addps 0x5560(%esi),%xmm4
+ DB 15,40,190,112,85,0,0 ; movaps 0x5570(%esi),%xmm7
DB 15,89,254 ; mulps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
- DB 15,88,182,16,87,0,0 ; addps 0x5710(%esi),%xmm6
- DB 15,40,190,32,87,0,0 ; movaps 0x5720(%esi),%xmm7
+ DB 15,88,182,128,85,0,0 ; addps 0x5580(%esi),%xmm6
+ DB 15,40,190,144,85,0,0 ; movaps 0x5590(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -41784,21 +41378,21 @@ _sk_parametric_r_sse2 LABEL PROC
DB 15,91,245 ; cvtdq2ps %xmm5,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,40,174,48,87,0,0 ; movaps 0x5730(%esi),%xmm5
+ DB 15,40,174,160,85,0,0 ; movaps 0x55a0(%esi),%xmm5
DB 15,84,253 ; andps %xmm5,%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,88,166,64,87,0,0 ; addps 0x5740(%esi),%xmm4
- DB 15,40,182,80,87,0,0 ; movaps 0x5750(%esi),%xmm6
+ DB 15,88,166,176,85,0,0 ; addps 0x55b0(%esi),%xmm4
+ DB 15,40,182,192,85,0,0 ; movaps 0x55c0(%esi),%xmm6
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 15,92,230 ; subps %xmm6,%xmm4
- DB 15,40,182,96,87,0,0 ; movaps 0x5760(%esi),%xmm6
+ DB 15,40,182,208,85,0,0 ; movaps 0x55d0(%esi),%xmm6
DB 15,92,247 ; subps %xmm7,%xmm6
- DB 15,40,190,112,87,0,0 ; movaps 0x5770(%esi),%xmm7
+ DB 15,40,190,224,85,0,0 ; movaps 0x55e0(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,88,252 ; addps %xmm4,%xmm7
- DB 15,89,190,128,87,0,0 ; mulps 0x5780(%esi),%xmm7
+ DB 15,89,190,240,85,0,0 ; mulps 0x55f0(%esi),%xmm7
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 243,15,16,103,16 ; movss 0x10(%edi),%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
@@ -41865,15 +41459,15 @@ _sk_parametric_g_sse2 LABEL PROC
DB 15,88,244 ; addps %xmm4,%xmm6
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
DB 15,91,230 ; cvtdq2ps %xmm6,%xmm4
- DB 15,89,166,46,86,0,0 ; mulps 0x562e(%esi),%xmm4
- DB 15,84,182,62,86,0,0 ; andps 0x563e(%esi),%xmm6
- DB 15,86,182,78,86,0,0 ; orps 0x564e(%esi),%xmm6
- DB 15,88,166,94,86,0,0 ; addps 0x565e(%esi),%xmm4
- DB 15,40,190,110,86,0,0 ; movaps 0x566e(%esi),%xmm7
+ DB 15,89,166,158,84,0,0 ; mulps 0x549e(%esi),%xmm4
+ DB 15,84,182,174,84,0,0 ; andps 0x54ae(%esi),%xmm6
+ DB 15,86,182,190,84,0,0 ; orps 0x54be(%esi),%xmm6
+ DB 15,88,166,206,84,0,0 ; addps 0x54ce(%esi),%xmm4
+ DB 15,40,190,222,84,0,0 ; movaps 0x54de(%esi),%xmm7
DB 15,89,254 ; mulps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
- DB 15,88,182,126,86,0,0 ; addps 0x567e(%esi),%xmm6
- DB 15,40,190,142,86,0,0 ; movaps 0x568e(%esi),%xmm7
+ DB 15,88,182,238,84,0,0 ; addps 0x54ee(%esi),%xmm6
+ DB 15,40,190,254,84,0,0 ; movaps 0x54fe(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -41881,21 +41475,21 @@ _sk_parametric_g_sse2 LABEL PROC
DB 15,91,245 ; cvtdq2ps %xmm5,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,40,174,158,86,0,0 ; movaps 0x569e(%esi),%xmm5
+ DB 15,40,174,14,85,0,0 ; movaps 0x550e(%esi),%xmm5
DB 15,84,253 ; andps %xmm5,%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,88,166,174,86,0,0 ; addps 0x56ae(%esi),%xmm4
- DB 15,40,182,190,86,0,0 ; movaps 0x56be(%esi),%xmm6
+ DB 15,88,166,30,85,0,0 ; addps 0x551e(%esi),%xmm4
+ DB 15,40,182,46,85,0,0 ; movaps 0x552e(%esi),%xmm6
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 15,92,230 ; subps %xmm6,%xmm4
- DB 15,40,182,206,86,0,0 ; movaps 0x56ce(%esi),%xmm6
+ DB 15,40,182,62,85,0,0 ; movaps 0x553e(%esi),%xmm6
DB 15,92,247 ; subps %xmm7,%xmm6
- DB 15,40,190,222,86,0,0 ; movaps 0x56de(%esi),%xmm7
+ DB 15,40,190,78,85,0,0 ; movaps 0x554e(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,88,252 ; addps %xmm4,%xmm7
- DB 15,89,190,238,86,0,0 ; mulps 0x56ee(%esi),%xmm7
+ DB 15,89,190,94,85,0,0 ; mulps 0x555e(%esi),%xmm7
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 243,15,16,103,16 ; movss 0x10(%edi),%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
@@ -41962,15 +41556,15 @@ _sk_parametric_b_sse2 LABEL PROC
DB 15,88,244 ; addps %xmm4,%xmm6
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
DB 15,91,230 ; cvtdq2ps %xmm6,%xmm4
- DB 15,89,166,156,85,0,0 ; mulps 0x559c(%esi),%xmm4
- DB 15,84,182,172,85,0,0 ; andps 0x55ac(%esi),%xmm6
- DB 15,86,182,188,85,0,0 ; orps 0x55bc(%esi),%xmm6
- DB 15,88,166,204,85,0,0 ; addps 0x55cc(%esi),%xmm4
- DB 15,40,190,220,85,0,0 ; movaps 0x55dc(%esi),%xmm7
+ DB 15,89,166,12,84,0,0 ; mulps 0x540c(%esi),%xmm4
+ DB 15,84,182,28,84,0,0 ; andps 0x541c(%esi),%xmm6
+ DB 15,86,182,44,84,0,0 ; orps 0x542c(%esi),%xmm6
+ DB 15,88,166,60,84,0,0 ; addps 0x543c(%esi),%xmm4
+ DB 15,40,190,76,84,0,0 ; movaps 0x544c(%esi),%xmm7
DB 15,89,254 ; mulps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
- DB 15,88,182,236,85,0,0 ; addps 0x55ec(%esi),%xmm6
- DB 15,40,190,252,85,0,0 ; movaps 0x55fc(%esi),%xmm7
+ DB 15,88,182,92,84,0,0 ; addps 0x545c(%esi),%xmm6
+ DB 15,40,190,108,84,0,0 ; movaps 0x546c(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -41978,21 +41572,21 @@ _sk_parametric_b_sse2 LABEL PROC
DB 15,91,245 ; cvtdq2ps %xmm5,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,40,174,12,86,0,0 ; movaps 0x560c(%esi),%xmm5
+ DB 15,40,174,124,84,0,0 ; movaps 0x547c(%esi),%xmm5
DB 15,84,253 ; andps %xmm5,%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,88,166,28,86,0,0 ; addps 0x561c(%esi),%xmm4
- DB 15,40,182,44,86,0,0 ; movaps 0x562c(%esi),%xmm6
+ DB 15,88,166,140,84,0,0 ; addps 0x548c(%esi),%xmm4
+ DB 15,40,182,156,84,0,0 ; movaps 0x549c(%esi),%xmm6
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 15,92,230 ; subps %xmm6,%xmm4
- DB 15,40,182,60,86,0,0 ; movaps 0x563c(%esi),%xmm6
+ DB 15,40,182,172,84,0,0 ; movaps 0x54ac(%esi),%xmm6
DB 15,92,247 ; subps %xmm7,%xmm6
- DB 15,40,190,76,86,0,0 ; movaps 0x564c(%esi),%xmm7
+ DB 15,40,190,188,84,0,0 ; movaps 0x54bc(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,88,252 ; addps %xmm4,%xmm7
- DB 15,89,190,92,86,0,0 ; mulps 0x565c(%esi),%xmm7
+ DB 15,89,190,204,84,0,0 ; mulps 0x54cc(%esi),%xmm7
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 243,15,16,103,16 ; movss 0x10(%edi),%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
@@ -42059,15 +41653,15 @@ _sk_parametric_a_sse2 LABEL PROC
DB 15,88,244 ; addps %xmm4,%xmm6
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
DB 15,91,230 ; cvtdq2ps %xmm6,%xmm4
- DB 15,89,166,10,85,0,0 ; mulps 0x550a(%esi),%xmm4
- DB 15,84,182,26,85,0,0 ; andps 0x551a(%esi),%xmm6
- DB 15,86,182,42,85,0,0 ; orps 0x552a(%esi),%xmm6
- DB 15,88,166,58,85,0,0 ; addps 0x553a(%esi),%xmm4
- DB 15,40,190,74,85,0,0 ; movaps 0x554a(%esi),%xmm7
+ DB 15,89,166,122,83,0,0 ; mulps 0x537a(%esi),%xmm4
+ DB 15,84,182,138,83,0,0 ; andps 0x538a(%esi),%xmm6
+ DB 15,86,182,154,83,0,0 ; orps 0x539a(%esi),%xmm6
+ DB 15,88,166,170,83,0,0 ; addps 0x53aa(%esi),%xmm4
+ DB 15,40,190,186,83,0,0 ; movaps 0x53ba(%esi),%xmm7
DB 15,89,254 ; mulps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
- DB 15,88,182,90,85,0,0 ; addps 0x555a(%esi),%xmm6
- DB 15,40,190,106,85,0,0 ; movaps 0x556a(%esi),%xmm7
+ DB 15,88,182,202,83,0,0 ; addps 0x53ca(%esi),%xmm6
+ DB 15,40,190,218,83,0,0 ; movaps 0x53da(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,92,231 ; subps %xmm7,%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -42075,21 +41669,21 @@ _sk_parametric_a_sse2 LABEL PROC
DB 15,91,245 ; cvtdq2ps %xmm5,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,40,174,122,85,0,0 ; movaps 0x557a(%esi),%xmm5
+ DB 15,40,174,234,83,0,0 ; movaps 0x53ea(%esi),%xmm5
DB 15,84,253 ; andps %xmm5,%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,40,252 ; movaps %xmm4,%xmm7
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,88,166,138,85,0,0 ; addps 0x558a(%esi),%xmm4
- DB 15,40,182,154,85,0,0 ; movaps 0x559a(%esi),%xmm6
+ DB 15,88,166,250,83,0,0 ; addps 0x53fa(%esi),%xmm4
+ DB 15,40,182,10,84,0,0 ; movaps 0x540a(%esi),%xmm6
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 15,92,230 ; subps %xmm6,%xmm4
- DB 15,40,182,170,85,0,0 ; movaps 0x55aa(%esi),%xmm6
+ DB 15,40,182,26,84,0,0 ; movaps 0x541a(%esi),%xmm6
DB 15,92,247 ; subps %xmm7,%xmm6
- DB 15,40,190,186,85,0,0 ; movaps 0x55ba(%esi),%xmm7
+ DB 15,40,190,42,84,0,0 ; movaps 0x542a(%esi),%xmm7
DB 15,94,254 ; divps %xmm6,%xmm7
DB 15,88,252 ; addps %xmm4,%xmm7
- DB 15,89,190,202,85,0,0 ; mulps 0x55ca(%esi),%xmm7
+ DB 15,89,190,58,84,0,0 ; mulps 0x543a(%esi),%xmm7
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 243,15,16,103,16 ; movss 0x10(%edi),%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
@@ -42146,29 +41740,29 @@ _sk_lab_to_xyz_sse2 LABEL PROC
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 232,0,0,0,0 ; call 4862 <_sk_lab_to_xyz_sse2+0x18>
DB 88 ; pop %eax
- DB 15,89,144,110,84,0,0 ; mulps 0x546e(%eax),%xmm2
- DB 15,40,160,126,84,0,0 ; movaps 0x547e(%eax),%xmm4
+ DB 15,89,144,222,82,0,0 ; mulps 0x52de(%eax),%xmm2
+ DB 15,40,160,238,82,0,0 ; movaps 0x52ee(%eax),%xmm4
DB 15,89,204 ; mulps %xmm4,%xmm1
- DB 15,40,168,142,84,0,0 ; movaps 0x548e(%eax),%xmm5
+ DB 15,40,168,254,82,0,0 ; movaps 0x52fe(%eax),%xmm5
DB 15,88,205 ; addps %xmm5,%xmm1
DB 15,89,220 ; mulps %xmm4,%xmm3
DB 15,88,221 ; addps %xmm5,%xmm3
- DB 15,88,144,158,84,0,0 ; addps 0x549e(%eax),%xmm2
- DB 15,89,144,174,84,0,0 ; mulps 0x54ae(%eax),%xmm2
- DB 15,89,136,190,84,0,0 ; mulps 0x54be(%eax),%xmm1
+ DB 15,88,144,14,83,0,0 ; addps 0x530e(%eax),%xmm2
+ DB 15,89,144,30,83,0,0 ; mulps 0x531e(%eax),%xmm2
+ DB 15,89,136,46,83,0,0 ; mulps 0x532e(%eax),%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
- DB 15,89,152,206,84,0,0 ; mulps 0x54ce(%eax),%xmm3
+ DB 15,89,152,62,83,0,0 ; mulps 0x533e(%eax),%xmm3
DB 15,40,234 ; movaps %xmm2,%xmm5
DB 15,92,235 ; subps %xmm3,%xmm5
DB 15,40,193 ; movaps %xmm1,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 15,89,193 ; mulps %xmm1,%xmm0
- DB 15,40,152,222,84,0,0 ; movaps 0x54de(%eax),%xmm3
+ DB 15,40,152,78,83,0,0 ; movaps 0x534e(%eax),%xmm3
DB 15,40,227 ; movaps %xmm3,%xmm4
DB 15,194,224,1 ; cmpltps %xmm0,%xmm4
- DB 15,40,176,238,84,0,0 ; movaps 0x54ee(%eax),%xmm6
+ DB 15,40,176,94,83,0,0 ; movaps 0x535e(%eax),%xmm6
DB 15,88,206 ; addps %xmm6,%xmm1
- DB 15,40,184,254,84,0,0 ; movaps 0x54fe(%eax),%xmm7
+ DB 15,40,184,110,83,0,0 ; movaps 0x536e(%eax),%xmm7
DB 15,89,207 ; mulps %xmm7,%xmm1
DB 15,84,196 ; andps %xmm4,%xmm0
DB 15,85,225 ; andnps %xmm1,%xmm4
@@ -42200,8 +41794,8 @@ _sk_lab_to_xyz_sse2 LABEL PROC
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 15,86,216 ; orps %xmm0,%xmm3
DB 15,40,69,88 ; movaps 0x58(%ebp),%xmm0
- DB 15,89,160,14,85,0,0 ; mulps 0x550e(%eax),%xmm4
- DB 15,89,152,30,85,0,0 ; mulps 0x551e(%eax),%xmm3
+ DB 15,89,160,126,83,0,0 ; mulps 0x537e(%eax),%xmm4
+ DB 15,89,152,142,83,0,0 ; mulps 0x538e(%eax),%xmm3
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 141,88,4 ; lea 0x4(%eax),%ebx
DB 15,41,68,36,80 ; movaps %xmm0,0x50(%esp)
@@ -42249,9 +41843,9 @@ _sk_load_a8_sse2 LABEL PROC
DB 102,15,110,28,25 ; movd (%ecx,%ebx,1),%xmm3
DB 102,15,96,216 ; punpcklbw %xmm0,%xmm3
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,219,158,255,83,0,0 ; pand 0x53ff(%esi),%xmm3
+ DB 102,15,219,158,111,82,0,0 ; pand 0x526f(%esi),%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,158,15,84,0,0 ; mulps 0x540f(%esi),%xmm3
+ DB 15,89,158,127,82,0,0 ; mulps 0x527f(%esi),%xmm3
DB 141,72,8 ; lea 0x8(%eax),%ecx
DB 15,41,100,36,80 ; movaps %xmm4,0x50(%esp)
DB 15,41,84,36,64 ; movaps %xmm2,0x40(%esp)
@@ -42319,10 +41913,10 @@ _sk_load_a8_dst_sse2 LABEL PROC
DB 102,15,110,36,57 ; movd (%ecx,%edi,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,163,47,83,0,0 ; pand 0x532f(%ebx),%xmm4
+ DB 102,15,219,163,159,81,0,0 ; pand 0x519f(%ebx),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
DB 102,15,87,237 ; xorpd %xmm5,%xmm5
- DB 15,89,163,63,83,0,0 ; mulps 0x533f(%ebx),%xmm4
+ DB 15,89,163,175,81,0,0 ; mulps 0x51af(%ebx),%xmm4
DB 141,72,8 ; lea 0x8(%eax),%ecx
DB 102,15,41,108,36,64 ; movapd %xmm5,0x40(%esp)
DB 102,15,41,108,36,48 ; movapd %xmm5,0x30(%esp)
@@ -42378,7 +41972,7 @@ _sk_gather_a8_sse2 LABEL PROC
DB 139,8 ; mov (%eax),%ecx
DB 139,17 ; mov (%ecx),%edx
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,81,8 ; movd 0x8(%ecx),%xmm2
+ DB 102,15,110,81,4 ; movd 0x4(%ecx),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -42414,7 +42008,7 @@ _sk_gather_a8_sse2 LABEL PROC
DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
DB 15,91,216 ; cvtdq2ps %xmm0,%xmm3
- DB 15,89,158,8,82,0,0 ; mulps 0x5208(%esi),%xmm3
+ DB 15,89,158,120,80,0,0 ; mulps 0x5078(%esi),%xmm3
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,69,40 ; movaps 0x28(%ebp),%xmm0
DB 15,40,77,56 ; movaps 0x38(%ebp),%xmm1
@@ -42458,7 +42052,7 @@ _sk_store_a8_sse2 LABEL PROC
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 139,48 ; mov (%eax),%esi
DB 139,30 ; mov (%esi),%ebx
- DB 15,40,161,135,81,0,0 ; movaps 0x5187(%ecx),%xmm4
+ DB 15,40,161,247,79,0,0 ; movaps 0x4ff7(%ecx),%xmm4
DB 15,89,227 ; mulps %xmm3,%xmm4
DB 102,15,91,228 ; cvtps2dq %xmm4,%xmm4
DB 102,15,114,244,16 ; pslld $0x10,%xmm4
@@ -42508,7 +42102,7 @@ _sk_store_a8_sse2 LABEL PROC
DB 136,84,59,2 ; mov %dl,0x2(%ebx,%edi,1)
DB 139,85,20 ; mov 0x14(%ebp),%edx
DB 102,15,112,228,212 ; pshufd $0xd4,%xmm4,%xmm4
- DB 102,15,219,161,151,81,0,0 ; pand 0x5197(%ecx),%xmm4
+ DB 102,15,219,161,7,80,0,0 ; pand 0x5007(%ecx),%xmm4
DB 102,15,103,228 ; packuswb %xmm4,%xmm4
DB 102,15,103,228 ; packuswb %xmm4,%xmm4
DB 102,15,103,228 ; packuswb %xmm4,%xmm4
@@ -42546,9 +42140,9 @@ _sk_load_g8_sse2 LABEL PROC
DB 102,15,110,4,58 ; movd (%edx,%edi,1),%xmm0
DB 102,15,96,192 ; punpcklbw %xmm0,%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
- DB 102,15,219,128,168,80,0,0 ; pand 0x50a8(%eax),%xmm0
+ DB 102,15,219,128,24,79,0,0 ; pand 0x4f18(%eax),%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,128,184,80,0,0 ; mulps 0x50b8(%eax),%xmm0
+ DB 15,89,128,40,79,0,0 ; mulps 0x4f28(%eax),%xmm0
DB 141,81,8 ; lea 0x8(%ecx),%edx
DB 15,41,100,36,80 ; movaps %xmm4,0x50(%esp)
DB 15,41,92,36,64 ; movaps %xmm3,0x40(%esp)
@@ -42560,7 +42154,7 @@ _sk_load_g8_sse2 LABEL PROC
DB 137,84,36,4 ; mov %edx,0x4(%esp)
DB 139,85,8 ; mov 0x8(%ebp),%edx
DB 137,20,36 ; mov %edx,(%esp)
- DB 15,40,152,200,80,0,0 ; movaps 0x50c8(%eax),%xmm3
+ DB 15,40,152,56,79,0,0 ; movaps 0x4f38(%eax),%xmm3
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,81,4 ; call *0x4(%ecx)
@@ -42616,11 +42210,11 @@ _sk_load_g8_dst_sse2 LABEL PROC
DB 102,15,110,36,25 ; movd (%ecx,%ebx,1),%xmm4
DB 102,15,96,224 ; punpcklbw %xmm0,%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,219,166,231,79,0,0 ; pand 0x4fe7(%esi),%xmm4
+ DB 102,15,219,166,87,78,0,0 ; pand 0x4e57(%esi),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,166,247,79,0,0 ; mulps 0x4ff7(%esi),%xmm4
+ DB 15,89,166,103,78,0,0 ; mulps 0x4e67(%esi),%xmm4
DB 141,72,8 ; lea 0x8(%eax),%ecx
- DB 15,40,174,7,80,0,0 ; movaps 0x5007(%esi),%xmm5
+ DB 15,40,174,119,78,0,0 ; movaps 0x4e77(%esi),%xmm5
DB 15,41,108,36,80 ; movaps %xmm5,0x50(%esp)
DB 137,84,36,16 ; mov %edx,0x10(%esp)
DB 137,124,36,12 ; mov %edi,0xc(%esp)
@@ -42675,7 +42269,7 @@ _sk_gather_g8_sse2 LABEL PROC
DB 139,8 ; mov (%eax),%ecx
DB 139,17 ; mov (%ecx),%edx
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,81,8 ; movd 0x8(%ecx),%xmm2
+ DB 102,15,110,81,4 ; movd 0x4(%ecx),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -42714,7 +42308,7 @@ _sk_gather_g8_sse2 LABEL PROC
DB 102,15,96,197 ; punpcklbw %xmm5,%xmm0
DB 102,15,97,197 ; punpcklwd %xmm5,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,134,208,78,0,0 ; mulps 0x4ed0(%esi),%xmm0
+ DB 15,89,134,64,77,0,0 ; mulps 0x4d40(%esi),%xmm0
DB 139,93,24 ; mov 0x18(%ebp),%ebx
DB 137,193 ; mov %eax,%ecx
DB 141,65,8 ; lea 0x8(%ecx),%eax
@@ -42728,7 +42322,7 @@ _sk_gather_g8_sse2 LABEL PROC
DB 137,68,36,4 ; mov %eax,0x4(%esp)
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 137,4,36 ; mov %eax,(%esp)
- DB 15,40,158,224,78,0,0 ; movaps 0x4ee0(%esi),%xmm3
+ DB 15,40,158,80,77,0,0 ; movaps 0x4d50(%esi),%xmm3
DB 15,40,200 ; movaps %xmm0,%xmm1
DB 15,40,208 ; movaps %xmm0,%xmm2
DB 255,81,4 ; call *0x4(%ecx)
@@ -42739,119 +42333,6 @@ _sk_gather_g8_sse2 LABEL PROC
DB 93 ; pop %ebp
DB 195 ; ret
-PUBLIC _sk_gather_i8_sse2
-_sk_gather_i8_sse2 LABEL PROC
- DB 85 ; push %ebp
- DB 137,229 ; mov %esp,%ebp
- DB 83 ; push %ebx
- DB 87 ; push %edi
- DB 86 ; push %esi
- DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5024 <_sk_gather_i8_sse2+0xe>
- DB 88 ; pop %eax
- DB 137,69,240 ; mov %eax,-0x10(%ebp)
- DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
- DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
- DB 139,69,12 ; mov 0xc(%ebp),%eax
- DB 139,16 ; mov (%eax),%edx
- DB 133,210 ; test %edx,%edx
- DB 116,7 ; je 5040 <_sk_gather_i8_sse2+0x2a>
- DB 131,192,4 ; add $0x4,%eax
- DB 137,209 ; mov %edx,%ecx
- DB 235,6 ; jmp 5046 <_sk_gather_i8_sse2+0x30>
- DB 139,72,4 ; mov 0x4(%eax),%ecx
- DB 131,192,8 ; add $0x8,%eax
- DB 139,49 ; mov (%ecx),%esi
- DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,81,8 ; movd 0x8(%ecx),%xmm2
- DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
- DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
- DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
- DB 102,15,112,219,232 ; pshufd $0xe8,%xmm3,%xmm3
- DB 102,15,244,209 ; pmuludq %xmm1,%xmm2
- DB 102,15,112,202,232 ; pshufd $0xe8,%xmm2,%xmm1
- DB 102,15,98,203 ; punpckldq %xmm3,%xmm1
- DB 243,15,91,192 ; cvttps2dq %xmm0,%xmm0
- DB 102,15,254,193 ; paddd %xmm1,%xmm0
- DB 102,15,112,200,78 ; pshufd $0x4e,%xmm0,%xmm1
- DB 102,15,126,201 ; movd %xmm1,%ecx
- DB 102,15,112,200,231 ; pshufd $0xe7,%xmm0,%xmm1
- DB 102,15,126,207 ; movd %xmm1,%edi
- DB 15,182,12,14 ; movzbl (%esi,%ecx,1),%ecx
- DB 15,182,60,62 ; movzbl (%esi,%edi,1),%edi
- DB 193,231,8 ; shl $0x8,%edi
- DB 9,207 ; or %ecx,%edi
- DB 102,15,126,193 ; movd %xmm0,%ecx
- DB 102,15,112,192,229 ; pshufd $0xe5,%xmm0,%xmm0
- DB 15,182,12,14 ; movzbl (%esi,%ecx,1),%ecx
- DB 102,15,126,195 ; movd %xmm0,%ebx
- DB 15,182,52,30 ; movzbl (%esi,%ebx,1),%esi
- DB 193,230,8 ; shl $0x8,%esi
- DB 9,206 ; or %ecx,%esi
- DB 102,15,196,198,0 ; pinsrw $0x0,%esi,%xmm0
- DB 102,15,196,199,1 ; pinsrw $0x1,%edi,%xmm0
- DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 102,15,96,193 ; punpcklbw %xmm1,%xmm0
- DB 102,15,97,193 ; punpcklwd %xmm1,%xmm0
- DB 139,74,4 ; mov 0x4(%edx),%ecx
- DB 102,15,112,200,229 ; pshufd $0xe5,%xmm0,%xmm1
- DB 102,15,112,208,231 ; pshufd $0xe7,%xmm0,%xmm2
- DB 102,15,126,210 ; movd %xmm2,%edx
- DB 102,15,110,20,145 ; movd (%ecx,%edx,4),%xmm2
- DB 102,15,126,202 ; movd %xmm1,%edx
- DB 102,15,110,12,145 ; movd (%ecx,%edx,4),%xmm1
- DB 102,15,126,194 ; movd %xmm0,%edx
- DB 102,15,112,192,78 ; pshufd $0x4e,%xmm0,%xmm0
- DB 102,15,110,44,145 ; movd (%ecx,%edx,4),%xmm5
- DB 102,15,126,194 ; movd %xmm0,%edx
- DB 102,15,110,4,145 ; movd (%ecx,%edx,4),%xmm0
- DB 102,15,98,202 ; punpckldq %xmm2,%xmm1
- DB 102,15,98,232 ; punpckldq %xmm0,%xmm5
- DB 102,15,98,233 ; punpckldq %xmm1,%xmm5
- DB 139,77,240 ; mov -0x10(%ebp),%ecx
- DB 102,15,111,145,92,78,0,0 ; movdqa 0x4e5c(%ecx),%xmm2
- DB 102,15,111,197 ; movdqa %xmm5,%xmm0
- DB 102,15,219,194 ; pand %xmm2,%xmm0
- DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,40,161,108,78,0,0 ; movaps 0x4e6c(%ecx),%xmm4
- DB 15,89,196 ; mulps %xmm4,%xmm0
- DB 102,15,111,205 ; movdqa %xmm5,%xmm1
- DB 102,15,114,209,8 ; psrld $0x8,%xmm1
- DB 102,15,219,202 ; pand %xmm2,%xmm1
- DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,204 ; mulps %xmm4,%xmm1
- DB 102,15,111,221 ; movdqa %xmm5,%xmm3
- DB 102,15,114,211,16 ; psrld $0x10,%xmm3
- DB 102,15,219,218 ; pand %xmm2,%xmm3
- DB 15,91,211 ; cvtdq2ps %xmm3,%xmm2
- DB 15,89,212 ; mulps %xmm4,%xmm2
- DB 102,15,114,213,24 ; psrld $0x18,%xmm5
- DB 15,91,221 ; cvtdq2ps %xmm5,%xmm3
- DB 15,89,220 ; mulps %xmm4,%xmm3
- DB 141,72,4 ; lea 0x4(%eax),%ecx
- DB 15,41,124,36,80 ; movaps %xmm7,0x50(%esp)
- DB 15,41,116,36,64 ; movaps %xmm6,0x40(%esp)
- DB 15,40,101,56 ; movaps 0x38(%ebp),%xmm4
- DB 15,41,100,36,48 ; movaps %xmm4,0x30(%esp)
- DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
- DB 15,41,100,36,32 ; movaps %xmm4,0x20(%esp)
- DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 137,84,36,16 ; mov %edx,0x10(%esp)
- DB 139,85,20 ; mov 0x14(%ebp),%edx
- DB 137,84,36,12 ; mov %edx,0xc(%esp)
- DB 139,85,16 ; mov 0x10(%ebp),%edx
- DB 137,84,36,8 ; mov %edx,0x8(%esp)
- DB 137,76,36,4 ; mov %ecx,0x4(%esp)
- DB 139,77,8 ; mov 0x8(%ebp),%ecx
- DB 137,12,36 ; mov %ecx,(%esp)
- DB 255,16 ; call *(%eax)
- DB 131,196,108 ; add $0x6c,%esp
- DB 94 ; pop %esi
- DB 95 ; pop %edi
- DB 91 ; pop %ebx
- DB 93 ; pop %ebp
- DB 195 ; ret
-
PUBLIC _sk_load_565_sse2
_sk_load_565_sse2 LABEL PROC
DB 85 ; push %ebp
@@ -42860,7 +42341,7 @@ _sk_load_565_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 51b1 <_sk_load_565_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5024 <_sk_load_565_sse2+0xe>
DB 88 ; pop %eax
DB 15,40,117,88 ; movaps 0x58(%ebp),%xmm6
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
@@ -42873,20 +42354,20 @@ _sk_load_565_sse2 LABEL PROC
DB 139,18 ; mov (%edx),%edx
DB 133,219 ; test %ebx,%ebx
DB 139,125,16 ; mov 0x10(%ebp),%edi
- DB 15,133,134,0,0,0 ; jne 5260 <_sk_load_565_sse2+0xbd>
+ DB 15,133,134,0,0,0 ; jne 50d3 <_sk_load_565_sse2+0xbd>
DB 243,15,126,20,122 ; movq (%edx,%edi,2),%xmm2
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,128,239,76,0,0 ; movdqa 0x4cef(%eax),%xmm0
+ DB 102,15,111,128,204,76,0,0 ; movdqa 0x4ccc(%eax),%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,128,255,76,0,0 ; mulps 0x4cff(%eax),%xmm0
- DB 102,15,111,136,15,77,0,0 ; movdqa 0x4d0f(%eax),%xmm1
+ DB 15,89,128,220,76,0,0 ; mulps 0x4cdc(%eax),%xmm0
+ DB 102,15,111,136,236,76,0,0 ; movdqa 0x4cec(%eax),%xmm1
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,136,31,77,0,0 ; mulps 0x4d1f(%eax),%xmm1
- DB 102,15,219,144,47,77,0,0 ; pand 0x4d2f(%eax),%xmm2
+ DB 15,89,136,252,76,0,0 ; mulps 0x4cfc(%eax),%xmm1
+ DB 102,15,219,144,12,77,0,0 ; pand 0x4d0c(%eax),%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,144,63,77,0,0 ; mulps 0x4d3f(%eax),%xmm2
+ DB 15,89,144,28,77,0,0 ; mulps 0x4d1c(%eax),%xmm2
DB 141,81,8 ; lea 0x8(%ecx),%edx
DB 15,41,116,36,80 ; movaps %xmm6,0x50(%esp)
DB 15,41,108,36,64 ; movaps %xmm5,0x40(%esp)
@@ -42898,7 +42379,7 @@ _sk_load_565_sse2 LABEL PROC
DB 137,84,36,4 ; mov %edx,0x4(%esp)
DB 139,85,8 ; mov 0x8(%ebp),%edx
DB 137,20,36 ; mov %edx,(%esp)
- DB 15,40,152,79,77,0,0 ; movaps 0x4d4f(%eax),%xmm3
+ DB 15,40,152,44,77,0,0 ; movaps 0x4d2c(%eax),%xmm3
DB 255,81,4 ; call *0x4(%ecx)
DB 131,196,108 ; add $0x6c,%esp
DB 94 ; pop %esi
@@ -42909,13 +42390,13 @@ _sk_load_565_sse2 LABEL PROC
DB 136,93,243 ; mov %bl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,58 ; je 52a7 <_sk_load_565_sse2+0x104>
+ DB 116,58 ; je 511a <_sk_load_565_sse2+0x104>
DB 102,15,239,210 ; pxor %xmm2,%xmm2
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,93,24 ; mov 0x18(%ebp),%ebx
- DB 116,27 ; je 5295 <_sk_load_565_sse2+0xf2>
+ DB 116,27 ; je 5108 <_sk_load_565_sse2+0xf2>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,95,255,255,255 ; jne 51e3 <_sk_load_565_sse2+0x40>
+ DB 15,133,95,255,255,255 ; jne 5056 <_sk_load_565_sse2+0x40>
DB 15,183,116,122,4 ; movzwl 0x4(%edx,%edi,2),%esi
DB 102,15,110,198 ; movd %esi,%xmm0
DB 139,117,20 ; mov 0x14(%ebp),%esi
@@ -42923,11 +42404,11 @@ _sk_load_565_sse2 LABEL PROC
DB 102,15,110,4,122 ; movd (%edx,%edi,2),%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
DB 242,15,16,208 ; movsd %xmm0,%xmm2
- DB 233,60,255,255,255 ; jmp 51e3 <_sk_load_565_sse2+0x40>
+ DB 233,60,255,255,255 ; jmp 5056 <_sk_load_565_sse2+0x40>
DB 15,183,20,122 ; movzwl (%edx,%edi,2),%edx
DB 102,15,110,210 ; movd %edx,%xmm2
DB 139,93,24 ; mov 0x18(%ebp),%ebx
- DB 233,44,255,255,255 ; jmp 51e3 <_sk_load_565_sse2+0x40>
+ DB 233,44,255,255,255 ; jmp 5056 <_sk_load_565_sse2+0x40>
PUBLIC _sk_load_565_dst_sse2
_sk_load_565_dst_sse2 LABEL PROC
@@ -42937,7 +42418,7 @@ _sk_load_565_dst_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 52c5 <_sk_load_565_dst_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5138 <_sk_load_565_dst_sse2+0xe>
DB 94 ; pop %esi
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,125,20 ; mov 0x14(%ebp),%edi
@@ -42946,22 +42427,22 @@ _sk_load_565_dst_sse2 LABEL PROC
DB 139,9 ; mov (%ecx),%ecx
DB 133,210 ; test %edx,%edx
DB 139,93,16 ; mov 0x10(%ebp),%ebx
- DB 15,133,134,0,0,0 ; jne 5364 <_sk_load_565_dst_sse2+0xad>
+ DB 15,133,134,0,0,0 ; jne 51d7 <_sk_load_565_dst_sse2+0xad>
DB 243,15,126,36,89 ; movq (%ecx,%ebx,2),%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,111,174,75,76,0,0 ; movdqa 0x4c4b(%esi),%xmm5
+ DB 102,15,111,174,40,76,0,0 ; movdqa 0x4c28(%esi),%xmm5
DB 102,15,219,236 ; pand %xmm4,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,174,91,76,0,0 ; mulps 0x4c5b(%esi),%xmm5
- DB 102,15,111,182,107,76,0,0 ; movdqa 0x4c6b(%esi),%xmm6
+ DB 15,89,174,56,76,0,0 ; mulps 0x4c38(%esi),%xmm5
+ DB 102,15,111,182,72,76,0,0 ; movdqa 0x4c48(%esi),%xmm6
DB 102,15,219,244 ; pand %xmm4,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,182,123,76,0,0 ; mulps 0x4c7b(%esi),%xmm6
- DB 102,15,219,166,139,76,0,0 ; pand 0x4c8b(%esi),%xmm4
+ DB 15,89,182,88,76,0,0 ; mulps 0x4c58(%esi),%xmm6
+ DB 102,15,219,166,104,76,0,0 ; pand 0x4c68(%esi),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,166,155,76,0,0 ; mulps 0x4c9b(%esi),%xmm4
+ DB 15,89,166,120,76,0,0 ; mulps 0x4c78(%esi),%xmm4
DB 141,72,8 ; lea 0x8(%eax),%ecx
- DB 15,40,190,171,76,0,0 ; movaps 0x4cab(%esi),%xmm7
+ DB 15,40,190,136,76,0,0 ; movaps 0x4c88(%esi),%xmm7
DB 15,41,124,36,80 ; movaps %xmm7,0x50(%esp)
DB 137,84,36,16 ; mov %edx,0x10(%esp)
DB 137,124,36,12 ; mov %edi,0xc(%esp)
@@ -42982,13 +42463,13 @@ _sk_load_565_dst_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,58 ; je 53ab <_sk_load_565_dst_sse2+0xf4>
+ DB 116,58 ; je 521e <_sk_load_565_dst_sse2+0xf4>
DB 102,15,239,228 ; pxor %xmm4,%xmm4
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,27 ; je 5399 <_sk_load_565_dst_sse2+0xe2>
+ DB 116,27 ; je 520c <_sk_load_565_dst_sse2+0xe2>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,95,255,255,255 ; jne 52e7 <_sk_load_565_dst_sse2+0x30>
+ DB 15,133,95,255,255,255 ; jne 515a <_sk_load_565_dst_sse2+0x30>
DB 15,183,124,89,4 ; movzwl 0x4(%ecx,%ebx,2),%edi
DB 102,15,110,231 ; movd %edi,%xmm4
DB 139,125,20 ; mov 0x14(%ebp),%edi
@@ -42996,11 +42477,11 @@ _sk_load_565_dst_sse2 LABEL PROC
DB 102,15,110,44,89 ; movd (%ecx,%ebx,2),%xmm5
DB 102,15,97,232 ; punpcklwd %xmm0,%xmm5
DB 242,15,16,229 ; movsd %xmm5,%xmm4
- DB 233,60,255,255,255 ; jmp 52e7 <_sk_load_565_dst_sse2+0x30>
+ DB 233,60,255,255,255 ; jmp 515a <_sk_load_565_dst_sse2+0x30>
DB 15,183,12,89 ; movzwl (%ecx,%ebx,2),%ecx
DB 102,15,110,225 ; movd %ecx,%xmm4
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,44,255,255,255 ; jmp 52e7 <_sk_load_565_dst_sse2+0x30>
+ DB 233,44,255,255,255 ; jmp 515a <_sk_load_565_dst_sse2+0x30>
PUBLIC _sk_gather_565_sse2
_sk_gather_565_sse2 LABEL PROC
@@ -43010,13 +42491,13 @@ _sk_gather_565_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 53c9 <_sk_gather_565_sse2+0xe>
+ DB 232,0,0,0,0 ; call 523c <_sk_gather_565_sse2+0xe>
DB 88 ; pop %eax
DB 139,85,12 ; mov 0xc(%ebp),%edx
DB 139,50 ; mov (%edx),%esi
DB 139,62 ; mov (%esi),%edi
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,86,8 ; movd 0x8(%esi),%xmm2
+ DB 102,15,110,86,4 ; movd 0x4(%esi),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -43047,17 +42528,17 @@ _sk_gather_565_sse2 LABEL PROC
DB 15,40,117,88 ; movaps 0x58(%ebp),%xmm6
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,208 ; punpcklwd %xmm0,%xmm2
- DB 102,15,111,128,183,75,0,0 ; movdqa 0x4bb7(%eax),%xmm0
+ DB 102,15,111,128,148,75,0,0 ; movdqa 0x4b94(%eax),%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,128,199,75,0,0 ; mulps 0x4bc7(%eax),%xmm0
- DB 102,15,111,136,215,75,0,0 ; movdqa 0x4bd7(%eax),%xmm1
+ DB 15,89,128,164,75,0,0 ; mulps 0x4ba4(%eax),%xmm0
+ DB 102,15,111,136,180,75,0,0 ; movdqa 0x4bb4(%eax),%xmm1
DB 102,15,219,202 ; pand %xmm2,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,136,231,75,0,0 ; mulps 0x4be7(%eax),%xmm1
- DB 102,15,219,144,247,75,0,0 ; pand 0x4bf7(%eax),%xmm2
+ DB 15,89,136,196,75,0,0 ; mulps 0x4bc4(%eax),%xmm1
+ DB 102,15,219,144,212,75,0,0 ; pand 0x4bd4(%eax),%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,144,7,76,0,0 ; mulps 0x4c07(%eax),%xmm2
+ DB 15,89,144,228,75,0,0 ; mulps 0x4be4(%eax),%xmm2
DB 139,93,24 ; mov 0x18(%ebp),%ebx
DB 141,74,8 ; lea 0x8(%edx),%ecx
DB 15,41,116,36,80 ; movaps %xmm6,0x50(%esp)
@@ -43070,7 +42551,7 @@ _sk_gather_565_sse2 LABEL PROC
DB 137,76,36,4 ; mov %ecx,0x4(%esp)
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 137,12,36 ; mov %ecx,(%esp)
- DB 15,40,152,23,76,0,0 ; movaps 0x4c17(%eax),%xmm3
+ DB 15,40,152,244,75,0,0 ; movaps 0x4bf4(%eax),%xmm3
DB 255,82,4 ; call *0x4(%edx)
DB 131,196,108 ; add $0x6c,%esp
DB 94 ; pop %esi
@@ -43087,14 +42568,14 @@ _sk_store_565_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 54eb <_sk_store_565_sse2+0xe>
+ DB 232,0,0,0,0 ; call 535e <_sk_store_565_sse2+0xe>
DB 88 ; pop %eax
- DB 15,40,160,5,75,0,0 ; movaps 0x4b05(%eax),%xmm4
+ DB 15,40,160,226,74,0,0 ; movaps 0x4ae2(%eax),%xmm4
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
DB 102,15,91,237 ; cvtps2dq %xmm5,%xmm5
DB 102,15,114,245,11 ; pslld $0xb,%xmm5
- DB 15,40,176,21,75,0,0 ; movaps 0x4b15(%eax),%xmm6
+ DB 15,40,176,242,74,0,0 ; movaps 0x4af2(%eax),%xmm6
DB 15,89,241 ; mulps %xmm1,%xmm6
DB 102,15,91,246 ; cvtps2dq %xmm6,%xmm6
DB 102,15,114,246,5 ; pslld $0x5,%xmm6
@@ -43116,7 +42597,7 @@ _sk_store_565_sse2 LABEL PROC
DB 133,219 ; test %ebx,%ebx
DB 15,40,125,56 ; movaps 0x38(%ebp),%xmm7
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
- DB 117,82 ; jne 55ac <_sk_store_565_sse2+0xcf>
+ DB 117,82 ; jne 541f <_sk_store_565_sse2+0xcf>
DB 102,15,126,226 ; movd %xmm4,%edx
DB 102,15,126,238 ; movd %xmm5,%esi
DB 137,20,79 ; mov %edx,(%edi,%ecx,2)
@@ -43147,20 +42628,20 @@ _sk_store_565_sse2 LABEL PROC
DB 137,218 ; mov %ebx,%edx
DB 128,226,3 ; and $0x3,%dl
DB 128,250,1 ; cmp $0x1,%dl
- DB 116,37 ; je 55e4 <_sk_store_565_sse2+0x107>
+ DB 116,37 ; je 5457 <_sk_store_565_sse2+0x107>
DB 128,250,2 ; cmp $0x2,%dl
- DB 116,15 ; je 55d3 <_sk_store_565_sse2+0xf6>
+ DB 116,15 ; je 5446 <_sk_store_565_sse2+0xf6>
DB 128,250,3 ; cmp $0x3,%dl
- DB 117,160 ; jne 5569 <_sk_store_565_sse2+0x8c>
+ DB 117,160 ; jne 53dc <_sk_store_565_sse2+0x8c>
DB 102,15,197,212,4 ; pextrw $0x4,%xmm4,%edx
DB 102,137,84,79,4 ; mov %dx,0x4(%edi,%ecx,2)
DB 102,15,112,228,212 ; pshufd $0xd4,%xmm4,%xmm4
DB 242,15,112,228,232 ; pshuflw $0xe8,%xmm4,%xmm4
DB 102,15,126,36,79 ; movd %xmm4,(%edi,%ecx,2)
- DB 235,133 ; jmp 5569 <_sk_store_565_sse2+0x8c>
+ DB 235,133 ; jmp 53dc <_sk_store_565_sse2+0x8c>
DB 102,15,126,226 ; movd %xmm4,%edx
DB 102,137,20,79 ; mov %dx,(%edi,%ecx,2)
- DB 233,120,255,255,255 ; jmp 5569 <_sk_store_565_sse2+0x8c>
+ DB 233,120,255,255,255 ; jmp 53dc <_sk_store_565_sse2+0x8c>
PUBLIC _sk_load_4444_sse2
_sk_load_4444_sse2 LABEL PROC
@@ -43170,7 +42651,7 @@ _sk_load_4444_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 55ff <_sk_load_4444_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5472 <_sk_load_4444_sse2+0xe>
DB 94 ; pop %esi
DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
@@ -43183,24 +42664,24 @@ _sk_load_4444_sse2 LABEL PROC
DB 139,9 ; mov (%ecx),%ecx
DB 133,210 ; test %edx,%edx
DB 139,93,16 ; mov 0x10(%ebp),%ebx
- DB 15,133,149,0,0,0 ; jne 56bd <_sk_load_4444_sse2+0xcc>
+ DB 15,133,149,0,0,0 ; jne 5530 <_sk_load_4444_sse2+0xcc>
DB 243,15,126,28,89 ; movq (%ecx,%ebx,2),%xmm3
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,134,17,74,0,0 ; movdqa 0x4a11(%esi),%xmm0
+ DB 102,15,111,134,238,73,0,0 ; movdqa 0x49ee(%esi),%xmm0
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,134,33,74,0,0 ; mulps 0x4a21(%esi),%xmm0
- DB 102,15,111,142,49,74,0,0 ; movdqa 0x4a31(%esi),%xmm1
+ DB 15,89,134,254,73,0,0 ; mulps 0x49fe(%esi),%xmm0
+ DB 102,15,111,142,14,74,0,0 ; movdqa 0x4a0e(%esi),%xmm1
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,142,65,74,0,0 ; mulps 0x4a41(%esi),%xmm1
- DB 102,15,111,150,81,74,0,0 ; movdqa 0x4a51(%esi),%xmm2
+ DB 15,89,142,30,74,0,0 ; mulps 0x4a1e(%esi),%xmm1
+ DB 102,15,111,150,46,74,0,0 ; movdqa 0x4a2e(%esi),%xmm2
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,150,97,74,0,0 ; mulps 0x4a61(%esi),%xmm2
- DB 102,15,219,158,113,74,0,0 ; pand 0x4a71(%esi),%xmm3
+ DB 15,89,150,62,74,0,0 ; mulps 0x4a3e(%esi),%xmm2
+ DB 102,15,219,158,78,74,0,0 ; pand 0x4a4e(%esi),%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,158,129,74,0,0 ; mulps 0x4a81(%esi),%xmm3
+ DB 15,89,158,94,74,0,0 ; mulps 0x4a5e(%esi),%xmm3
DB 141,72,8 ; lea 0x8(%eax),%ecx
DB 15,41,124,36,80 ; movaps %xmm7,0x50(%esp)
DB 15,41,116,36,64 ; movaps %xmm6,0x40(%esp)
@@ -43222,13 +42703,13 @@ _sk_load_4444_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,58 ; je 5704 <_sk_load_4444_sse2+0x113>
+ DB 116,58 ; je 5577 <_sk_load_4444_sse2+0x113>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,27 ; je 56f2 <_sk_load_4444_sse2+0x101>
+ DB 116,27 ; je 5565 <_sk_load_4444_sse2+0x101>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,80,255,255,255 ; jne 5631 <_sk_load_4444_sse2+0x40>
+ DB 15,133,80,255,255,255 ; jne 54a4 <_sk_load_4444_sse2+0x40>
DB 15,183,124,89,4 ; movzwl 0x4(%ecx,%ebx,2),%edi
DB 102,15,110,199 ; movd %edi,%xmm0
DB 139,125,20 ; mov 0x14(%ebp),%edi
@@ -43236,11 +42717,11 @@ _sk_load_4444_sse2 LABEL PROC
DB 102,15,110,4,89 ; movd (%ecx,%ebx,2),%xmm0
DB 102,15,97,192 ; punpcklwd %xmm0,%xmm0
DB 242,15,16,216 ; movsd %xmm0,%xmm3
- DB 233,45,255,255,255 ; jmp 5631 <_sk_load_4444_sse2+0x40>
+ DB 233,45,255,255,255 ; jmp 54a4 <_sk_load_4444_sse2+0x40>
DB 15,183,12,89 ; movzwl (%ecx,%ebx,2),%ecx
DB 102,15,110,217 ; movd %ecx,%xmm3
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,29,255,255,255 ; jmp 5631 <_sk_load_4444_sse2+0x40>
+ DB 233,29,255,255,255 ; jmp 54a4 <_sk_load_4444_sse2+0x40>
PUBLIC _sk_load_4444_dst_sse2
_sk_load_4444_dst_sse2 LABEL PROC
@@ -43250,7 +42731,7 @@ _sk_load_4444_dst_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5722 <_sk_load_4444_dst_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5595 <_sk_load_4444_dst_sse2+0xe>
DB 95 ; pop %edi
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,117,20 ; mov 0x14(%ebp),%esi
@@ -43259,24 +42740,24 @@ _sk_load_4444_dst_sse2 LABEL PROC
DB 139,9 ; mov (%ecx),%ecx
DB 133,210 ; test %edx,%edx
DB 139,93,16 ; mov 0x10(%ebp),%ebx
- DB 15,133,149,0,0,0 ; jne 57d0 <_sk_load_4444_dst_sse2+0xbc>
+ DB 15,133,149,0,0,0 ; jne 5643 <_sk_load_4444_dst_sse2+0xbc>
DB 243,15,126,36,89 ; movq (%ecx,%ebx,2),%xmm4
DB 102,15,97,224 ; punpcklwd %xmm0,%xmm4
- DB 102,15,111,175,110,73,0,0 ; movdqa 0x496e(%edi),%xmm5
+ DB 102,15,111,175,75,73,0,0 ; movdqa 0x494b(%edi),%xmm5
DB 102,15,219,236 ; pand %xmm4,%xmm5
DB 15,91,237 ; cvtdq2ps %xmm5,%xmm5
- DB 15,89,175,126,73,0,0 ; mulps 0x497e(%edi),%xmm5
- DB 102,15,111,183,142,73,0,0 ; movdqa 0x498e(%edi),%xmm6
+ DB 15,89,175,91,73,0,0 ; mulps 0x495b(%edi),%xmm5
+ DB 102,15,111,183,107,73,0,0 ; movdqa 0x496b(%edi),%xmm6
DB 102,15,219,244 ; pand %xmm4,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,89,183,158,73,0,0 ; mulps 0x499e(%edi),%xmm6
- DB 102,15,111,191,174,73,0,0 ; movdqa 0x49ae(%edi),%xmm7
+ DB 15,89,183,123,73,0,0 ; mulps 0x497b(%edi),%xmm6
+ DB 102,15,111,191,139,73,0,0 ; movdqa 0x498b(%edi),%xmm7
DB 102,15,219,252 ; pand %xmm4,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
- DB 15,89,191,190,73,0,0 ; mulps 0x49be(%edi),%xmm7
- DB 102,15,219,167,206,73,0,0 ; pand 0x49ce(%edi),%xmm4
+ DB 15,89,191,155,73,0,0 ; mulps 0x499b(%edi),%xmm7
+ DB 102,15,219,167,171,73,0,0 ; pand 0x49ab(%edi),%xmm4
DB 15,91,228 ; cvtdq2ps %xmm4,%xmm4
- DB 15,89,167,222,73,0,0 ; mulps 0x49de(%edi),%xmm4
+ DB 15,89,167,187,73,0,0 ; mulps 0x49bb(%edi),%xmm4
DB 141,72,8 ; lea 0x8(%eax),%ecx
DB 137,84,36,16 ; mov %edx,0x10(%esp)
DB 137,116,36,12 ; mov %esi,0xc(%esp)
@@ -43298,13 +42779,13 @@ _sk_load_4444_dst_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,58 ; je 5817 <_sk_load_4444_dst_sse2+0x103>
+ DB 116,58 ; je 568a <_sk_load_4444_dst_sse2+0x103>
DB 102,15,239,228 ; pxor %xmm4,%xmm4
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,27 ; je 5805 <_sk_load_4444_dst_sse2+0xf1>
+ DB 116,27 ; je 5678 <_sk_load_4444_dst_sse2+0xf1>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,80,255,255,255 ; jne 5744 <_sk_load_4444_dst_sse2+0x30>
+ DB 15,133,80,255,255,255 ; jne 55b7 <_sk_load_4444_dst_sse2+0x30>
DB 15,183,116,89,4 ; movzwl 0x4(%ecx,%ebx,2),%esi
DB 102,15,110,230 ; movd %esi,%xmm4
DB 139,117,20 ; mov 0x14(%ebp),%esi
@@ -43312,11 +42793,11 @@ _sk_load_4444_dst_sse2 LABEL PROC
DB 102,15,110,44,89 ; movd (%ecx,%ebx,2),%xmm5
DB 102,15,97,232 ; punpcklwd %xmm0,%xmm5
DB 242,15,16,229 ; movsd %xmm5,%xmm4
- DB 233,45,255,255,255 ; jmp 5744 <_sk_load_4444_dst_sse2+0x30>
+ DB 233,45,255,255,255 ; jmp 55b7 <_sk_load_4444_dst_sse2+0x30>
DB 15,183,12,89 ; movzwl (%ecx,%ebx,2),%ecx
DB 102,15,110,225 ; movd %ecx,%xmm4
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,29,255,255,255 ; jmp 5744 <_sk_load_4444_dst_sse2+0x30>
+ DB 233,29,255,255,255 ; jmp 55b7 <_sk_load_4444_dst_sse2+0x30>
PUBLIC _sk_gather_4444_sse2
_sk_gather_4444_sse2 LABEL PROC
@@ -43326,14 +42807,14 @@ _sk_gather_4444_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5835 <_sk_gather_4444_sse2+0xe>
+ DB 232,0,0,0,0 ; call 56a8 <_sk_gather_4444_sse2+0xe>
DB 90 ; pop %edx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,12 ; mov 0xc(%ebp),%ecx
DB 139,49 ; mov (%ecx),%esi
DB 139,62 ; mov (%esi),%edi
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,86,8 ; movd 0x8(%esi),%xmm2
+ DB 102,15,110,86,4 ; movd 0x4(%esi),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -43360,21 +42841,21 @@ _sk_gather_4444_sse2 LABEL PROC
DB 139,125,20 ; mov 0x14(%ebp),%edi
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,216 ; punpcklwd %xmm0,%xmm3
- DB 102,15,111,130,219,72,0,0 ; movdqa 0x48db(%edx),%xmm0
+ DB 102,15,111,130,184,72,0,0 ; movdqa 0x48b8(%edx),%xmm0
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,89,130,235,72,0,0 ; mulps 0x48eb(%edx),%xmm0
- DB 102,15,111,138,251,72,0,0 ; movdqa 0x48fb(%edx),%xmm1
+ DB 15,89,130,200,72,0,0 ; mulps 0x48c8(%edx),%xmm0
+ DB 102,15,111,138,216,72,0,0 ; movdqa 0x48d8(%edx),%xmm1
DB 102,15,219,203 ; pand %xmm3,%xmm1
DB 15,91,201 ; cvtdq2ps %xmm1,%xmm1
- DB 15,89,138,11,73,0,0 ; mulps 0x490b(%edx),%xmm1
- DB 102,15,111,146,27,73,0,0 ; movdqa 0x491b(%edx),%xmm2
+ DB 15,89,138,232,72,0,0 ; mulps 0x48e8(%edx),%xmm1
+ DB 102,15,111,146,248,72,0,0 ; movdqa 0x48f8(%edx),%xmm2
DB 102,15,219,211 ; pand %xmm3,%xmm2
DB 15,91,210 ; cvtdq2ps %xmm2,%xmm2
- DB 15,89,146,43,73,0,0 ; mulps 0x492b(%edx),%xmm2
- DB 102,15,219,154,59,73,0,0 ; pand 0x493b(%edx),%xmm3
+ DB 15,89,146,8,73,0,0 ; mulps 0x4908(%edx),%xmm2
+ DB 102,15,219,154,24,73,0,0 ; pand 0x4918(%edx),%xmm3
DB 15,91,219 ; cvtdq2ps %xmm3,%xmm3
- DB 15,89,154,75,73,0,0 ; mulps 0x494b(%edx),%xmm3
+ DB 15,89,154,40,73,0,0 ; mulps 0x4928(%edx),%xmm3
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 15,40,109,56 ; movaps 0x38(%ebp),%xmm5
@@ -43406,9 +42887,9 @@ _sk_store_4444_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5966 <_sk_store_4444_sse2+0xe>
+ DB 232,0,0,0,0 ; call 57d9 <_sk_store_4444_sse2+0xe>
DB 88 ; pop %eax
- DB 15,40,160,42,72,0,0 ; movaps 0x482a(%eax),%xmm4
+ DB 15,40,160,7,72,0,0 ; movaps 0x4807(%eax),%xmm4
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
DB 102,15,91,237 ; cvtps2dq %xmm5,%xmm5
@@ -43440,7 +42921,7 @@ _sk_store_4444_sse2 LABEL PROC
DB 133,219 ; test %ebx,%ebx
DB 15,40,125,56 ; movaps 0x38(%ebp),%xmm7
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
- DB 117,82 ; jne 5a36 <_sk_store_4444_sse2+0xde>
+ DB 117,82 ; jne 58a9 <_sk_store_4444_sse2+0xde>
DB 102,15,126,226 ; movd %xmm4,%edx
DB 102,15,126,238 ; movd %xmm5,%esi
DB 137,20,79 ; mov %edx,(%edi,%ecx,2)
@@ -43471,20 +42952,20 @@ _sk_store_4444_sse2 LABEL PROC
DB 137,218 ; mov %ebx,%edx
DB 128,226,3 ; and $0x3,%dl
DB 128,250,1 ; cmp $0x1,%dl
- DB 116,37 ; je 5a6e <_sk_store_4444_sse2+0x116>
+ DB 116,37 ; je 58e1 <_sk_store_4444_sse2+0x116>
DB 128,250,2 ; cmp $0x2,%dl
- DB 116,15 ; je 5a5d <_sk_store_4444_sse2+0x105>
+ DB 116,15 ; je 58d0 <_sk_store_4444_sse2+0x105>
DB 128,250,3 ; cmp $0x3,%dl
- DB 117,160 ; jne 59f3 <_sk_store_4444_sse2+0x9b>
+ DB 117,160 ; jne 5866 <_sk_store_4444_sse2+0x9b>
DB 102,15,197,212,4 ; pextrw $0x4,%xmm4,%edx
DB 102,137,84,79,4 ; mov %dx,0x4(%edi,%ecx,2)
DB 102,15,112,228,212 ; pshufd $0xd4,%xmm4,%xmm4
DB 242,15,112,228,232 ; pshuflw $0xe8,%xmm4,%xmm4
DB 102,15,126,36,79 ; movd %xmm4,(%edi,%ecx,2)
- DB 235,133 ; jmp 59f3 <_sk_store_4444_sse2+0x9b>
+ DB 235,133 ; jmp 5866 <_sk_store_4444_sse2+0x9b>
DB 102,15,126,226 ; movd %xmm4,%edx
DB 102,137,20,79 ; mov %dx,(%edi,%ecx,2)
- DB 233,120,255,255,255 ; jmp 59f3 <_sk_store_4444_sse2+0x9b>
+ DB 233,120,255,255,255 ; jmp 5866 <_sk_store_4444_sse2+0x9b>
PUBLIC _sk_load_8888_sse2
_sk_load_8888_sse2 LABEL PROC
@@ -43494,7 +42975,7 @@ _sk_load_8888_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5a89 <_sk_load_8888_sse2+0xe>
+ DB 232,0,0,0,0 ; call 58fc <_sk_load_8888_sse2+0xe>
DB 91 ; pop %ebx
DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
@@ -43505,13 +42986,13 @@ _sk_load_8888_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,147,0,0,0 ; jne 5b3d <_sk_load_8888_sse2+0xc2>
+ DB 15,133,147,0,0,0 ; jne 59b0 <_sk_load_8888_sse2+0xc2>
DB 243,15,111,44,185 ; movdqu (%ecx,%edi,4),%xmm5
- DB 102,15,111,147,23,71,0,0 ; movdqa 0x4717(%ebx),%xmm2
+ DB 102,15,111,147,244,70,0,0 ; movdqa 0x46f4(%ebx),%xmm2
DB 102,15,111,197 ; movdqa %xmm5,%xmm0
DB 102,15,219,194 ; pand %xmm2,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,40,163,39,71,0,0 ; movaps 0x4727(%ebx),%xmm4
+ DB 15,40,163,4,71,0,0 ; movaps 0x4704(%ebx),%xmm4
DB 15,89,196 ; mulps %xmm4,%xmm0
DB 102,15,111,205 ; movdqa %xmm5,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -43549,20 +43030,20 @@ _sk_load_8888_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,44 ; je 5b76 <_sk_load_8888_sse2+0xfb>
+ DB 116,44 ; je 59e9 <_sk_load_8888_sse2+0xfb>
DB 102,15,239,237 ; pxor %xmm5,%xmm5
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,21 ; je 5b6c <_sk_load_8888_sse2+0xf1>
+ DB 116,21 ; je 59df <_sk_load_8888_sse2+0xf1>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,78,255,255,255 ; jne 5aaf <_sk_load_8888_sse2+0x34>
+ DB 15,133,78,255,255,255 ; jne 5922 <_sk_load_8888_sse2+0x34>
DB 102,15,110,68,185,8 ; movd 0x8(%ecx,%edi,4),%xmm0
DB 102,15,112,232,69 ; pshufd $0x45,%xmm0,%xmm5
DB 102,15,18,44,185 ; movlpd (%ecx,%edi,4),%xmm5
- DB 233,57,255,255,255 ; jmp 5aaf <_sk_load_8888_sse2+0x34>
+ DB 233,57,255,255,255 ; jmp 5922 <_sk_load_8888_sse2+0x34>
DB 102,15,110,44,185 ; movd (%ecx,%edi,4),%xmm5
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,44,255,255,255 ; jmp 5aaf <_sk_load_8888_sse2+0x34>
+ DB 233,44,255,255,255 ; jmp 5922 <_sk_load_8888_sse2+0x34>
PUBLIC _sk_load_8888_dst_sse2
_sk_load_8888_dst_sse2 LABEL PROC
@@ -43574,7 +43055,7 @@ _sk_load_8888_dst_sse2 LABEL PROC
DB 129,236,140,0,0,0 ; sub $0x8c,%esp
DB 102,15,127,93,200 ; movdqa %xmm3,-0x38(%ebp)
DB 15,41,85,216 ; movaps %xmm2,-0x28(%ebp)
- DB 232,0,0,0,0 ; call 5b9d <_sk_load_8888_dst_sse2+0x1a>
+ DB 232,0,0,0,0 ; call 5a10 <_sk_load_8888_dst_sse2+0x1a>
DB 91 ; pop %ebx
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
@@ -43583,13 +43064,13 @@ _sk_load_8888_dst_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,150,0,0,0 ; jne 5c4c <_sk_load_8888_dst_sse2+0xc9>
+ DB 15,133,150,0,0,0 ; jne 5abf <_sk_load_8888_dst_sse2+0xc9>
DB 243,15,111,28,185 ; movdqu (%ecx,%edi,4),%xmm3
- DB 102,15,111,147,35,70,0,0 ; movdqa 0x4623(%ebx),%xmm2
+ DB 102,15,111,147,0,70,0,0 ; movdqa 0x4600(%ebx),%xmm2
DB 102,15,111,243 ; movdqa %xmm3,%xmm6
DB 102,15,219,242 ; pand %xmm2,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,40,187,51,70,0,0 ; movaps 0x4633(%ebx),%xmm7
+ DB 15,40,187,16,70,0,0 ; movaps 0x4610(%ebx),%xmm7
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 102,15,111,227 ; movdqa %xmm3,%xmm4
DB 102,15,114,212,8 ; psrld $0x8,%xmm4
@@ -43627,20 +43108,20 @@ _sk_load_8888_dst_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,44 ; je 5c85 <_sk_load_8888_dst_sse2+0x102>
+ DB 116,44 ; je 5af8 <_sk_load_8888_dst_sse2+0x102>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,21 ; je 5c7b <_sk_load_8888_dst_sse2+0xf8>
+ DB 116,21 ; je 5aee <_sk_load_8888_dst_sse2+0xf8>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,75,255,255,255 ; jne 5bbb <_sk_load_8888_dst_sse2+0x38>
+ DB 15,133,75,255,255,255 ; jne 5a2e <_sk_load_8888_dst_sse2+0x38>
DB 102,15,110,100,185,8 ; movd 0x8(%ecx,%edi,4),%xmm4
DB 102,15,112,220,69 ; pshufd $0x45,%xmm4,%xmm3
DB 102,15,18,28,185 ; movlpd (%ecx,%edi,4),%xmm3
- DB 233,54,255,255,255 ; jmp 5bbb <_sk_load_8888_dst_sse2+0x38>
+ DB 233,54,255,255,255 ; jmp 5a2e <_sk_load_8888_dst_sse2+0x38>
DB 102,15,110,28,185 ; movd (%ecx,%edi,4),%xmm3
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,41,255,255,255 ; jmp 5bbb <_sk_load_8888_dst_sse2+0x38>
+ DB 233,41,255,255,255 ; jmp 5a2e <_sk_load_8888_dst_sse2+0x38>
PUBLIC _sk_gather_8888_sse2
_sk_gather_8888_sse2 LABEL PROC
@@ -43650,14 +43131,14 @@ _sk_gather_8888_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5ca0 <_sk_gather_8888_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5b13 <_sk_gather_8888_sse2+0xe>
DB 90 ; pop %edx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,12 ; mov 0xc(%ebp),%ecx
DB 139,49 ; mov (%ecx),%esi
DB 139,62 ; mov (%esi),%edi
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,86,8 ; movd 0x8(%esi),%xmm2
+ DB 102,15,110,86,4 ; movd 0x4(%esi),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -43680,8 +43161,8 @@ _sk_gather_8888_sse2 LABEL PROC
DB 102,15,110,4,183 ; movd (%edi,%esi,4),%xmm0
DB 139,117,16 ; mov 0x10(%ebp),%esi
DB 139,125,20 ; mov 0x14(%ebp),%edi
- DB 102,15,111,162,64,69,0,0 ; movdqa 0x4540(%edx),%xmm4
- DB 15,40,170,80,69,0,0 ; movaps 0x4550(%edx),%xmm5
+ DB 102,15,111,162,29,69,0,0 ; movdqa 0x451d(%edx),%xmm4
+ DB 15,40,170,45,69,0,0 ; movaps 0x452d(%edx),%xmm5
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 15,40,125,56 ; movaps 0x38(%ebp),%xmm7
@@ -43733,9 +43214,9 @@ _sk_store_8888_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5dc5 <_sk_store_8888_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5c38 <_sk_store_8888_sse2+0xe>
DB 88 ; pop %eax
- DB 15,40,160,59,68,0,0 ; movaps 0x443b(%eax),%xmm4
+ DB 15,40,160,24,68,0,0 ; movaps 0x4418(%eax),%xmm4
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
DB 102,15,91,237 ; cvtps2dq %xmm5,%xmm5
@@ -43764,7 +43245,7 @@ _sk_store_8888_sse2 LABEL PROC
DB 133,219 ; test %ebx,%ebx
DB 139,85,8 ; mov 0x8(%ebp),%edx
DB 15,40,125,40 ; movaps 0x28(%ebp),%xmm7
- DB 117,62 ; jne 5e6e <_sk_store_8888_sse2+0xb7>
+ DB 117,62 ; jne 5ce1 <_sk_store_8888_sse2+0xb7>
DB 243,15,127,36,143 ; movdqu %xmm4,(%edi,%ecx,4)
DB 141,120,8 ; lea 0x8(%eax),%edi
DB 15,40,101,88 ; movaps 0x58(%ebp),%xmm4
@@ -43788,20 +43269,20 @@ _sk_store_8888_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,37 ; je 5ea2 <_sk_store_8888_sse2+0xeb>
+ DB 116,37 ; je 5d15 <_sk_store_8888_sse2+0xeb>
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,8 ; mov 0x8(%ebp),%edx
- DB 116,21 ; je 5e9b <_sk_store_8888_sse2+0xe4>
+ DB 116,21 ; je 5d0e <_sk_store_8888_sse2+0xe4>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 117,169 ; jne 5e35 <_sk_store_8888_sse2+0x7e>
+ DB 117,169 ; jne 5ca8 <_sk_store_8888_sse2+0x7e>
DB 102,15,112,236,78 ; pshufd $0x4e,%xmm4,%xmm5
DB 102,15,126,108,143,8 ; movd %xmm5,0x8(%edi,%ecx,4)
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 102,15,214,36,143 ; movq %xmm4,(%edi,%ecx,4)
- DB 235,147 ; jmp 5e35 <_sk_store_8888_sse2+0x7e>
+ DB 235,147 ; jmp 5ca8 <_sk_store_8888_sse2+0x7e>
DB 102,15,126,36,143 ; movd %xmm4,(%edi,%ecx,4)
DB 139,85,8 ; mov 0x8(%ebp),%edx
- DB 235,137 ; jmp 5e35 <_sk_store_8888_sse2+0x7e>
+ DB 235,137 ; jmp 5ca8 <_sk_store_8888_sse2+0x7e>
PUBLIC _sk_store_8888_2d_sse2
_sk_store_8888_2d_sse2 LABEL PROC
@@ -43811,9 +43292,9 @@ _sk_store_8888_2d_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5eba <_sk_store_8888_2d_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5d2d <_sk_store_8888_2d_sse2+0xe>
DB 88 ; pop %eax
- DB 15,40,160,86,67,0,0 ; movaps 0x4356(%eax),%xmm4
+ DB 15,40,160,51,67,0,0 ; movaps 0x4333(%eax),%xmm4
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
DB 102,15,91,237 ; cvtps2dq %xmm5,%xmm5
@@ -43844,7 +43325,7 @@ _sk_store_8888_2d_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,117,8 ; mov 0x8(%ebp),%esi
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
- DB 117,66 ; jne 5f6c <_sk_store_8888_2d_sse2+0xc0>
+ DB 117,66 ; jne 5ddf <_sk_store_8888_2d_sse2+0xc0>
DB 243,15,127,60,187 ; movdqu %xmm7,(%ebx,%edi,4)
DB 141,88,8 ; lea 0x8(%eax),%ebx
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
@@ -43869,19 +43350,19 @@ _sk_store_8888_2d_sse2 LABEL PROC
DB 136,77,243 ; mov %cl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,33 ; je 5f9c <_sk_store_8888_2d_sse2+0xf0>
+ DB 116,33 ; je 5e0f <_sk_store_8888_2d_sse2+0xf0>
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,77,20 ; mov 0x14(%ebp),%ecx
- DB 116,17 ; je 5f95 <_sk_store_8888_2d_sse2+0xe9>
+ DB 116,17 ; je 5e08 <_sk_store_8888_2d_sse2+0xe9>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 117,165 ; jne 5f2f <_sk_store_8888_2d_sse2+0x83>
+ DB 117,165 ; jne 5da2 <_sk_store_8888_2d_sse2+0x83>
DB 102,15,112,239,78 ; pshufd $0x4e,%xmm7,%xmm5
DB 102,15,126,108,187,8 ; movd %xmm5,0x8(%ebx,%edi,4)
DB 102,15,214,60,187 ; movq %xmm7,(%ebx,%edi,4)
- DB 235,147 ; jmp 5f2f <_sk_store_8888_2d_sse2+0x83>
+ DB 235,147 ; jmp 5da2 <_sk_store_8888_2d_sse2+0x83>
DB 102,15,126,60,187 ; movd %xmm7,(%ebx,%edi,4)
DB 139,77,20 ; mov 0x14(%ebp),%ecx
- DB 235,137 ; jmp 5f2f <_sk_store_8888_2d_sse2+0x83>
+ DB 235,137 ; jmp 5da2 <_sk_store_8888_2d_sse2+0x83>
PUBLIC _sk_load_bgra_sse2
_sk_load_bgra_sse2 LABEL PROC
@@ -43891,7 +43372,7 @@ _sk_load_bgra_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 5fb4 <_sk_load_bgra_sse2+0xe>
+ DB 232,0,0,0,0 ; call 5e27 <_sk_load_bgra_sse2+0xe>
DB 91 ; pop %ebx
DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
DB 15,40,117,72 ; movaps 0x48(%ebp),%xmm6
@@ -43902,13 +43383,13 @@ _sk_load_bgra_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,147,0,0,0 ; jne 6068 <_sk_load_bgra_sse2+0xc2>
+ DB 15,133,147,0,0,0 ; jne 5edb <_sk_load_bgra_sse2+0xc2>
DB 243,15,111,44,185 ; movdqu (%ecx,%edi,4),%xmm5
- DB 102,15,111,131,108,66,0,0 ; movdqa 0x426c(%ebx),%xmm0
+ DB 102,15,111,131,73,66,0,0 ; movdqa 0x4249(%ebx),%xmm0
DB 102,15,111,205 ; movdqa %xmm5,%xmm1
DB 102,15,219,200 ; pand %xmm0,%xmm1
DB 15,91,209 ; cvtdq2ps %xmm1,%xmm2
- DB 15,40,163,124,66,0,0 ; movaps 0x427c(%ebx),%xmm4
+ DB 15,40,163,89,66,0,0 ; movaps 0x4259(%ebx),%xmm4
DB 15,89,212 ; mulps %xmm4,%xmm2
DB 102,15,111,205 ; movdqa %xmm5,%xmm1
DB 102,15,114,209,8 ; psrld $0x8,%xmm1
@@ -43946,20 +43427,20 @@ _sk_load_bgra_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,44 ; je 60a1 <_sk_load_bgra_sse2+0xfb>
+ DB 116,44 ; je 5f14 <_sk_load_bgra_sse2+0xfb>
DB 102,15,239,237 ; pxor %xmm5,%xmm5
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,21 ; je 6097 <_sk_load_bgra_sse2+0xf1>
+ DB 116,21 ; je 5f0a <_sk_load_bgra_sse2+0xf1>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,78,255,255,255 ; jne 5fda <_sk_load_bgra_sse2+0x34>
+ DB 15,133,78,255,255,255 ; jne 5e4d <_sk_load_bgra_sse2+0x34>
DB 102,15,110,68,185,8 ; movd 0x8(%ecx,%edi,4),%xmm0
DB 102,15,112,232,69 ; pshufd $0x45,%xmm0,%xmm5
DB 102,15,18,44,185 ; movlpd (%ecx,%edi,4),%xmm5
- DB 233,57,255,255,255 ; jmp 5fda <_sk_load_bgra_sse2+0x34>
+ DB 233,57,255,255,255 ; jmp 5e4d <_sk_load_bgra_sse2+0x34>
DB 102,15,110,44,185 ; movd (%ecx,%edi,4),%xmm5
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,44,255,255,255 ; jmp 5fda <_sk_load_bgra_sse2+0x34>
+ DB 233,44,255,255,255 ; jmp 5e4d <_sk_load_bgra_sse2+0x34>
PUBLIC _sk_load_bgra_dst_sse2
_sk_load_bgra_dst_sse2 LABEL PROC
@@ -43971,7 +43452,7 @@ _sk_load_bgra_dst_sse2 LABEL PROC
DB 129,236,140,0,0,0 ; sub $0x8c,%esp
DB 102,15,127,93,200 ; movdqa %xmm3,-0x38(%ebp)
DB 15,41,85,216 ; movaps %xmm2,-0x28(%ebp)
- DB 232,0,0,0,0 ; call 60c8 <_sk_load_bgra_dst_sse2+0x1a>
+ DB 232,0,0,0,0 ; call 5f3b <_sk_load_bgra_dst_sse2+0x1a>
DB 91 ; pop %ebx
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
@@ -43980,13 +43461,13 @@ _sk_load_bgra_dst_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,150,0,0,0 ; jne 6177 <_sk_load_bgra_dst_sse2+0xc9>
+ DB 15,133,150,0,0,0 ; jne 5fea <_sk_load_bgra_dst_sse2+0xc9>
DB 243,15,111,28,185 ; movdqu (%ecx,%edi,4),%xmm3
- DB 102,15,111,147,120,65,0,0 ; movdqa 0x4178(%ebx),%xmm2
+ DB 102,15,111,147,85,65,0,0 ; movdqa 0x4155(%ebx),%xmm2
DB 102,15,111,243 ; movdqa %xmm3,%xmm6
DB 102,15,219,242 ; pand %xmm2,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
- DB 15,40,187,136,65,0,0 ; movaps 0x4188(%ebx),%xmm7
+ DB 15,40,187,101,65,0,0 ; movaps 0x4165(%ebx),%xmm7
DB 15,89,247 ; mulps %xmm7,%xmm6
DB 102,15,111,227 ; movdqa %xmm3,%xmm4
DB 102,15,114,212,8 ; psrld $0x8,%xmm4
@@ -44024,20 +43505,20 @@ _sk_load_bgra_dst_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,44 ; je 61b0 <_sk_load_bgra_dst_sse2+0x102>
+ DB 116,44 ; je 6023 <_sk_load_bgra_dst_sse2+0x102>
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 116,21 ; je 61a6 <_sk_load_bgra_dst_sse2+0xf8>
+ DB 116,21 ; je 6019 <_sk_load_bgra_dst_sse2+0xf8>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 15,133,75,255,255,255 ; jne 60e6 <_sk_load_bgra_dst_sse2+0x38>
+ DB 15,133,75,255,255,255 ; jne 5f59 <_sk_load_bgra_dst_sse2+0x38>
DB 102,15,110,100,185,8 ; movd 0x8(%ecx,%edi,4),%xmm4
DB 102,15,112,220,69 ; pshufd $0x45,%xmm4,%xmm3
DB 102,15,18,28,185 ; movlpd (%ecx,%edi,4),%xmm3
- DB 233,54,255,255,255 ; jmp 60e6 <_sk_load_bgra_dst_sse2+0x38>
+ DB 233,54,255,255,255 ; jmp 5f59 <_sk_load_bgra_dst_sse2+0x38>
DB 102,15,110,28,185 ; movd (%ecx,%edi,4),%xmm3
DB 139,85,24 ; mov 0x18(%ebp),%edx
- DB 233,41,255,255,255 ; jmp 60e6 <_sk_load_bgra_dst_sse2+0x38>
+ DB 233,41,255,255,255 ; jmp 5f59 <_sk_load_bgra_dst_sse2+0x38>
PUBLIC _sk_gather_bgra_sse2
_sk_gather_bgra_sse2 LABEL PROC
@@ -44047,14 +43528,14 @@ _sk_gather_bgra_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 61cb <_sk_gather_bgra_sse2+0xe>
+ DB 232,0,0,0,0 ; call 603e <_sk_gather_bgra_sse2+0xe>
DB 90 ; pop %edx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,12 ; mov 0xc(%ebp),%ecx
DB 139,49 ; mov (%ecx),%esi
DB 139,62 ; mov (%esi),%edi
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,86,8 ; movd 0x8(%esi),%xmm2
+ DB 102,15,110,86,4 ; movd 0x4(%esi),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -44077,8 +43558,8 @@ _sk_gather_bgra_sse2 LABEL PROC
DB 102,15,110,4,183 ; movd (%edi,%esi,4),%xmm0
DB 139,117,16 ; mov 0x10(%ebp),%esi
DB 139,125,20 ; mov 0x14(%ebp),%edi
- DB 102,15,111,162,149,64,0,0 ; movdqa 0x4095(%edx),%xmm4
- DB 15,40,170,165,64,0,0 ; movaps 0x40a5(%edx),%xmm5
+ DB 102,15,111,162,114,64,0,0 ; movdqa 0x4072(%edx),%xmm4
+ DB 15,40,170,130,64,0,0 ; movaps 0x4082(%edx),%xmm5
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 15,40,125,56 ; movaps 0x38(%ebp),%xmm7
@@ -44130,9 +43611,9 @@ _sk_store_bgra_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 62f0 <_sk_store_bgra_sse2+0xe>
+ DB 232,0,0,0,0 ; call 6163 <_sk_store_bgra_sse2+0xe>
DB 88 ; pop %eax
- DB 15,40,160,144,63,0,0 ; movaps 0x3f90(%eax),%xmm4
+ DB 15,40,160,109,63,0,0 ; movaps 0x3f6d(%eax),%xmm4
DB 15,40,234 ; movaps %xmm2,%xmm5
DB 15,89,236 ; mulps %xmm4,%xmm5
DB 102,15,91,237 ; cvtps2dq %xmm5,%xmm5
@@ -44161,7 +43642,7 @@ _sk_store_bgra_sse2 LABEL PROC
DB 133,219 ; test %ebx,%ebx
DB 139,85,8 ; mov 0x8(%ebp),%edx
DB 15,40,125,40 ; movaps 0x28(%ebp),%xmm7
- DB 117,62 ; jne 6399 <_sk_store_bgra_sse2+0xb7>
+ DB 117,62 ; jne 620c <_sk_store_bgra_sse2+0xb7>
DB 243,15,127,36,143 ; movdqu %xmm4,(%edi,%ecx,4)
DB 141,120,8 ; lea 0x8(%eax),%edi
DB 15,40,101,88 ; movaps 0x58(%ebp),%xmm4
@@ -44185,20 +43666,20 @@ _sk_store_bgra_sse2 LABEL PROC
DB 136,85,243 ; mov %dl,-0xd(%ebp)
DB 128,101,243,3 ; andb $0x3,-0xd(%ebp)
DB 128,125,243,1 ; cmpb $0x1,-0xd(%ebp)
- DB 116,37 ; je 63cd <_sk_store_bgra_sse2+0xeb>
+ DB 116,37 ; je 6240 <_sk_store_bgra_sse2+0xeb>
DB 128,125,243,2 ; cmpb $0x2,-0xd(%ebp)
DB 139,85,8 ; mov 0x8(%ebp),%edx
- DB 116,21 ; je 63c6 <_sk_store_bgra_sse2+0xe4>
+ DB 116,21 ; je 6239 <_sk_store_bgra_sse2+0xe4>
DB 128,125,243,3 ; cmpb $0x3,-0xd(%ebp)
- DB 117,169 ; jne 6360 <_sk_store_bgra_sse2+0x7e>
+ DB 117,169 ; jne 61d3 <_sk_store_bgra_sse2+0x7e>
DB 102,15,112,236,78 ; pshufd $0x4e,%xmm4,%xmm5
DB 102,15,126,108,143,8 ; movd %xmm5,0x8(%edi,%ecx,4)
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 102,15,214,36,143 ; movq %xmm4,(%edi,%ecx,4)
- DB 235,147 ; jmp 6360 <_sk_store_bgra_sse2+0x7e>
+ DB 235,147 ; jmp 61d3 <_sk_store_bgra_sse2+0x7e>
DB 102,15,126,36,143 ; movd %xmm4,(%edi,%ecx,4)
DB 139,85,8 ; mov 0x8(%ebp),%edx
- DB 235,137 ; jmp 6360 <_sk_store_bgra_sse2+0x7e>
+ DB 235,137 ; jmp 61d3 <_sk_store_bgra_sse2+0x7e>
PUBLIC _sk_load_f16_sse2
_sk_load_f16_sse2 LABEL PROC
@@ -44208,7 +43689,7 @@ _sk_load_f16_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 129,236,188,0,0,0 ; sub $0xbc,%esp
- DB 232,0,0,0,0 ; call 63e8 <_sk_load_f16_sse2+0x11>
+ DB 232,0,0,0,0 ; call 625b <_sk_load_f16_sse2+0x11>
DB 91 ; pop %ebx
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
@@ -44217,7 +43698,7 @@ _sk_load_f16_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,220,1,0,0 ; jne 65dd <_sk_load_f16_sse2+0x206>
+ DB 15,133,220,1,0,0 ; jne 6450 <_sk_load_f16_sse2+0x206>
DB 102,15,16,4,249 ; movupd (%ecx,%edi,8),%xmm0
DB 243,15,111,76,249,16 ; movdqu 0x10(%ecx,%edi,8),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
@@ -44245,7 +43726,7 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,15,126,69,232 ; movd %xmm0,-0x18(%ebp)
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,97,243 ; punpcklwd %xmm3,%xmm6
- DB 102,15,111,171,168,62,0,0 ; movdqa 0x3ea8(%ebx),%xmm5
+ DB 102,15,111,171,133,62,0,0 ; movdqa 0x3e85(%ebx),%xmm5
DB 102,15,111,214 ; movdqa %xmm6,%xmm2
DB 102,15,219,213 ; pand %xmm5,%xmm2
DB 102,15,239,242 ; pxor %xmm2,%xmm6
@@ -44279,15 +43760,15 @@ _sk_load_f16_sse2 LABEL PROC
DB 102,15,111,199 ; movdqa %xmm7,%xmm0
DB 102,15,114,240,13 ; pslld $0xd,%xmm0
DB 102,15,235,197 ; por %xmm5,%xmm0
- DB 102,15,111,155,184,62,0,0 ; movdqa 0x3eb8(%ebx),%xmm3
+ DB 102,15,111,155,149,62,0,0 ; movdqa 0x3e95(%ebx),%xmm3
DB 102,15,254,203 ; paddd %xmm3,%xmm1
DB 102,15,254,211 ; paddd %xmm3,%xmm2
DB 102,15,254,227 ; paddd %xmm3,%xmm4
DB 102,15,254,195 ; paddd %xmm3,%xmm0
- DB 102,15,111,155,200,62,0,0 ; movdqa 0x3ec8(%ebx),%xmm3
+ DB 102,15,111,155,165,62,0,0 ; movdqa 0x3ea5(%ebx),%xmm3
DB 102,15,127,93,184 ; movdqa %xmm3,-0x48(%ebp)
DB 102,15,239,243 ; pxor %xmm3,%xmm6
- DB 102,15,111,155,216,62,0,0 ; movdqa 0x3ed8(%ebx),%xmm3
+ DB 102,15,111,155,181,62,0,0 ; movdqa 0x3eb5(%ebx),%xmm3
DB 102,15,111,235 ; movdqa %xmm3,%xmm5
DB 102,15,102,238 ; pcmpgtd %xmm6,%xmm5
DB 102,15,223,233 ; pandn %xmm1,%xmm5
@@ -44330,12 +43811,12 @@ _sk_load_f16_sse2 LABEL PROC
DB 242,15,16,4,249 ; movsd (%ecx,%edi,8),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 131,250,1 ; cmp $0x1,%edx
- DB 15,132,29,254,255,255 ; je 640c <_sk_load_f16_sse2+0x35>
+ DB 15,132,29,254,255,255 ; je 627f <_sk_load_f16_sse2+0x35>
DB 102,15,22,68,249,8 ; movhpd 0x8(%ecx,%edi,8),%xmm0
DB 131,250,3 ; cmp $0x3,%edx
- DB 15,130,14,254,255,255 ; jb 640c <_sk_load_f16_sse2+0x35>
+ DB 15,130,14,254,255,255 ; jb 627f <_sk_load_f16_sse2+0x35>
DB 243,15,126,76,249,16 ; movq 0x10(%ecx,%edi,8),%xmm1
- DB 233,3,254,255,255 ; jmp 640c <_sk_load_f16_sse2+0x35>
+ DB 233,3,254,255,255 ; jmp 627f <_sk_load_f16_sse2+0x35>
PUBLIC _sk_load_f16_dst_sse2
_sk_load_f16_dst_sse2 LABEL PROC
@@ -44349,7 +43830,7 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 102,15,127,149,104,255,255,255 ; movdqa %xmm2,-0x98(%ebp)
DB 15,41,141,120,255,255,255 ; movaps %xmm1,-0x88(%ebp)
DB 102,15,127,69,136 ; movdqa %xmm0,-0x78(%ebp)
- DB 232,0,0,0,0 ; call 6635 <_sk_load_f16_dst_sse2+0x2c>
+ DB 232,0,0,0,0 ; call 64a8 <_sk_load_f16_dst_sse2+0x2c>
DB 91 ; pop %ebx
DB 139,85,24 ; mov 0x18(%ebp),%edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
@@ -44358,7 +43839,7 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 139,117,8 ; mov 0x8(%ebp),%esi
- DB 15,133,233,1,0,0 ; jne 6837 <_sk_load_f16_dst_sse2+0x22e>
+ DB 15,133,233,1,0,0 ; jne 66aa <_sk_load_f16_dst_sse2+0x22e>
DB 102,15,16,12,249 ; movupd (%ecx,%edi,8),%xmm1
DB 243,15,111,68,249,16 ; movdqu 0x10(%ecx,%edi,8),%xmm0
DB 102,15,40,217 ; movapd %xmm1,%xmm3
@@ -44387,7 +43868,7 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 102,15,97,240 ; punpcklwd %xmm0,%xmm6
DB 102,15,239,228 ; pxor %xmm4,%xmm4
- DB 102,15,111,155,155,60,0,0 ; movdqa 0x3c9b(%ebx),%xmm3
+ DB 102,15,111,155,120,60,0,0 ; movdqa 0x3c78(%ebx),%xmm3
DB 102,15,111,198 ; movdqa %xmm6,%xmm0
DB 102,15,219,195 ; pand %xmm3,%xmm0
DB 102,15,239,240 ; pxor %xmm0,%xmm6
@@ -44421,15 +43902,15 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 102,15,111,209 ; movdqa %xmm1,%xmm2
DB 102,15,114,242,13 ; pslld $0xd,%xmm2
DB 102,15,235,211 ; por %xmm3,%xmm2
- DB 102,15,111,155,171,60,0,0 ; movdqa 0x3cab(%ebx),%xmm3
+ DB 102,15,111,155,136,60,0,0 ; movdqa 0x3c88(%ebx),%xmm3
DB 102,15,254,251 ; paddd %xmm3,%xmm7
DB 102,15,254,235 ; paddd %xmm3,%xmm5
DB 102,15,254,227 ; paddd %xmm3,%xmm4
DB 102,15,254,211 ; paddd %xmm3,%xmm2
- DB 102,15,111,131,187,60,0,0 ; movdqa 0x3cbb(%ebx),%xmm0
+ DB 102,15,111,131,152,60,0,0 ; movdqa 0x3c98(%ebx),%xmm0
DB 102,15,127,69,184 ; movdqa %xmm0,-0x48(%ebp)
DB 102,15,239,240 ; pxor %xmm0,%xmm6
- DB 102,15,111,131,203,60,0,0 ; movdqa 0x3ccb(%ebx),%xmm0
+ DB 102,15,111,131,168,60,0,0 ; movdqa 0x3ca8(%ebx),%xmm0
DB 102,15,111,216 ; movdqa %xmm0,%xmm3
DB 102,15,102,222 ; pcmpgtd %xmm6,%xmm3
DB 102,15,223,223 ; pandn %xmm7,%xmm3
@@ -44471,12 +43952,12 @@ _sk_load_f16_dst_sse2 LABEL PROC
DB 242,15,16,12,249 ; movsd (%ecx,%edi,8),%xmm1
DB 102,15,239,192 ; pxor %xmm0,%xmm0
DB 131,250,1 ; cmp $0x1,%edx
- DB 15,132,16,254,255,255 ; je 6659 <_sk_load_f16_dst_sse2+0x50>
+ DB 15,132,16,254,255,255 ; je 64cc <_sk_load_f16_dst_sse2+0x50>
DB 102,15,22,76,249,8 ; movhpd 0x8(%ecx,%edi,8),%xmm1
DB 131,250,3 ; cmp $0x3,%edx
- DB 15,130,1,254,255,255 ; jb 6659 <_sk_load_f16_dst_sse2+0x50>
+ DB 15,130,1,254,255,255 ; jb 64cc <_sk_load_f16_dst_sse2+0x50>
DB 243,15,126,68,249,16 ; movq 0x10(%ecx,%edi,8),%xmm0
- DB 233,246,253,255,255 ; jmp 6659 <_sk_load_f16_dst_sse2+0x50>
+ DB 233,246,253,255,255 ; jmp 64cc <_sk_load_f16_dst_sse2+0x50>
PUBLIC _sk_gather_f16_sse2
_sk_gather_f16_sse2 LABEL PROC
@@ -44486,13 +43967,13 @@ _sk_gather_f16_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 129,236,204,0,0,0 ; sub $0xcc,%esp
- DB 232,0,0,0,0 ; call 6874 <_sk_gather_f16_sse2+0x11>
+ DB 232,0,0,0,0 ; call 66e7 <_sk_gather_f16_sse2+0x11>
DB 89 ; pop %ecx
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 139,48 ; mov (%eax),%esi
DB 139,22 ; mov (%esi),%edx
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
- DB 102,15,110,86,8 ; movd 0x8(%esi),%xmm2
+ DB 102,15,110,86,4 ; movd 0x4(%esi),%xmm2
DB 102,15,112,210,0 ; pshufd $0x0,%xmm2,%xmm2
DB 102,15,112,217,245 ; pshufd $0xf5,%xmm1,%xmm3
DB 102,15,244,218 ; pmuludq %xmm2,%xmm3
@@ -44549,7 +44030,7 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,111,236 ; movdqa %xmm4,%xmm5
DB 102,15,97,235 ; punpcklwd %xmm3,%xmm5
- DB 102,15,111,161,156,58,0,0 ; movdqa 0x3a9c(%ecx),%xmm4
+ DB 102,15,111,161,121,58,0,0 ; movdqa 0x3a79(%ecx),%xmm4
DB 102,15,111,197 ; movdqa %xmm5,%xmm0
DB 102,15,219,196 ; pand %xmm4,%xmm0
DB 102,15,239,232 ; pxor %xmm0,%xmm5
@@ -44583,16 +44064,16 @@ _sk_gather_f16_sse2 LABEL PROC
DB 102,15,111,200 ; movdqa %xmm0,%xmm1
DB 102,15,114,241,13 ; pslld $0xd,%xmm1
DB 102,15,235,204 ; por %xmm4,%xmm1
- DB 102,15,111,153,172,58,0,0 ; movdqa 0x3aac(%ecx),%xmm3
+ DB 102,15,111,153,137,58,0,0 ; movdqa 0x3a89(%ecx),%xmm3
DB 102,15,254,235 ; paddd %xmm3,%xmm5
DB 102,15,254,243 ; paddd %xmm3,%xmm6
DB 102,15,254,251 ; paddd %xmm3,%xmm7
DB 102,15,254,203 ; paddd %xmm3,%xmm1
- DB 102,15,111,153,188,58,0,0 ; movdqa 0x3abc(%ecx),%xmm3
+ DB 102,15,111,153,153,58,0,0 ; movdqa 0x3a99(%ecx),%xmm3
DB 102,15,127,93,184 ; movdqa %xmm3,-0x48(%ebp)
DB 102,15,111,85,136 ; movdqa -0x78(%ebp),%xmm2
DB 102,15,239,211 ; pxor %xmm3,%xmm2
- DB 102,15,111,153,204,58,0,0 ; movdqa 0x3acc(%ecx),%xmm3
+ DB 102,15,111,153,169,58,0,0 ; movdqa 0x3aa9(%ecx),%xmm3
DB 102,15,111,227 ; movdqa %xmm3,%xmm4
DB 102,15,102,226 ; pcmpgtd %xmm2,%xmm4
DB 102,15,223,229 ; pandn %xmm5,%xmm4
@@ -44647,20 +44128,20 @@ _sk_store_f16_sse2 LABEL PROC
DB 129,236,188,0,0,0 ; sub $0xbc,%esp
DB 15,41,93,200 ; movaps %xmm3,-0x38(%ebp)
DB 102,15,111,250 ; movdqa %xmm2,%xmm7
- DB 232,0,0,0,0 ; call 6b11 <_sk_store_f16_sse2+0x19>
+ DB 232,0,0,0,0 ; call 6984 <_sk_store_f16_sse2+0x19>
DB 88 ; pop %eax
- DB 102,15,111,176,63,56,0,0 ; movdqa 0x383f(%eax),%xmm6
+ DB 102,15,111,176,28,56,0,0 ; movdqa 0x381c(%eax),%xmm6
DB 102,15,111,208 ; movdqa %xmm0,%xmm2
DB 102,15,219,214 ; pand %xmm6,%xmm2
DB 102,15,127,69,184 ; movdqa %xmm0,-0x48(%ebp)
DB 102,15,111,232 ; movdqa %xmm0,%xmm5
DB 102,15,239,234 ; pxor %xmm2,%xmm5
- DB 102,15,111,160,79,56,0,0 ; movdqa 0x384f(%eax),%xmm4
+ DB 102,15,111,160,44,56,0,0 ; movdqa 0x382c(%eax),%xmm4
DB 102,15,114,210,16 ; psrld $0x10,%xmm2
DB 102,15,111,196 ; movdqa %xmm4,%xmm0
DB 102,15,102,197 ; pcmpgtd %xmm5,%xmm0
DB 102,15,114,213,13 ; psrld $0xd,%xmm5
- DB 102,15,111,152,95,56,0,0 ; movdqa 0x385f(%eax),%xmm3
+ DB 102,15,111,152,60,56,0,0 ; movdqa 0x383c(%eax),%xmm3
DB 102,15,254,211 ; paddd %xmm3,%xmm2
DB 102,15,254,213 ; paddd %xmm5,%xmm2
DB 102,15,114,242,16 ; pslld $0x10,%xmm2
@@ -44725,7 +44206,7 @@ _sk_store_f16_sse2 LABEL PROC
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 102,15,111,200 ; movdqa %xmm0,%xmm1
DB 102,15,98,205 ; punpckldq %xmm5,%xmm1
- DB 117,82 ; jne 6cad <_sk_store_f16_sse2+0x1b5>
+ DB 117,82 ; jne 6b20 <_sk_store_f16_sse2+0x1b5>
DB 15,17,12,203 ; movups %xmm1,(%ebx,%ecx,8)
DB 102,15,106,197 ; punpckhdq %xmm5,%xmm0
DB 243,15,127,68,203,16 ; movdqu %xmm0,0x10(%ebx,%ecx,8)
@@ -44751,13 +44232,13 @@ _sk_store_f16_sse2 LABEL PROC
DB 195 ; ret
DB 102,15,214,12,203 ; movq %xmm1,(%ebx,%ecx,8)
DB 131,255,1 ; cmp $0x1,%edi
- DB 116,178 ; je 6c69 <_sk_store_f16_sse2+0x171>
+ DB 116,178 ; je 6adc <_sk_store_f16_sse2+0x171>
DB 102,15,23,76,203,8 ; movhpd %xmm1,0x8(%ebx,%ecx,8)
DB 131,255,3 ; cmp $0x3,%edi
- DB 114,167 ; jb 6c69 <_sk_store_f16_sse2+0x171>
+ DB 114,167 ; jb 6adc <_sk_store_f16_sse2+0x171>
DB 102,15,106,197 ; punpckhdq %xmm5,%xmm0
DB 102,15,214,68,203,16 ; movq %xmm0,0x10(%ebx,%ecx,8)
- DB 235,155 ; jmp 6c69 <_sk_store_f16_sse2+0x171>
+ DB 235,155 ; jmp 6adc <_sk_store_f16_sse2+0x171>
PUBLIC _sk_load_u16_be_sse2
_sk_load_u16_be_sse2 LABEL PROC
@@ -44767,7 +44248,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 129,236,140,0,0,0 ; sub $0x8c,%esp
- DB 232,0,0,0,0 ; call 6cdf <_sk_load_u16_be_sse2+0x11>
+ DB 232,0,0,0,0 ; call 6b52 <_sk_load_u16_be_sse2+0x11>
DB 91 ; pop %ebx
DB 15,40,125,88 ; movaps 0x58(%ebp),%xmm7
DB 139,85,24 ; mov 0x18(%ebp),%edx
@@ -44777,7 +44258,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,125,16 ; mov 0x10(%ebp),%edi
DB 141,52,189,0,0,0,0 ; lea 0x0(,%edi,4),%esi
- DB 15,133,66,1,0,0 ; jne 6e42 <_sk_load_u16_be_sse2+0x174>
+ DB 15,133,66,1,0,0 ; jne 6cb5 <_sk_load_u16_be_sse2+0x174>
DB 102,15,16,4,113 ; movupd (%ecx,%esi,2),%xmm0
DB 243,15,111,76,113,16 ; movdqu 0x10(%ecx,%esi,2),%xmm1
DB 102,15,40,208 ; movapd %xmm0,%xmm2
@@ -44798,7 +44279,7 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 102,15,239,219 ; pxor %xmm3,%xmm3
DB 102,15,97,195 ; punpcklwd %xmm3,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,40,163,161,54,0,0 ; movaps 0x36a1(%ebx),%xmm4
+ DB 15,40,163,126,54,0,0 ; movaps 0x367e(%ebx),%xmm4
DB 15,89,196 ; mulps %xmm4,%xmm0
DB 102,15,111,205 ; movdqa %xmm5,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -44859,12 +44340,12 @@ _sk_load_u16_be_sse2 LABEL PROC
DB 242,15,16,4,113 ; movsd (%ecx,%esi,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 131,250,1 ; cmp $0x1,%edx
- DB 15,132,183,254,255,255 ; je 6d0b <_sk_load_u16_be_sse2+0x3d>
+ DB 15,132,183,254,255,255 ; je 6b7e <_sk_load_u16_be_sse2+0x3d>
DB 102,15,22,68,113,8 ; movhpd 0x8(%ecx,%esi,2),%xmm0
DB 131,250,3 ; cmp $0x3,%edx
- DB 15,130,168,254,255,255 ; jb 6d0b <_sk_load_u16_be_sse2+0x3d>
+ DB 15,130,168,254,255,255 ; jb 6b7e <_sk_load_u16_be_sse2+0x3d>
DB 243,15,126,76,113,16 ; movq 0x10(%ecx,%esi,2),%xmm1
- DB 233,157,254,255,255 ; jmp 6d0b <_sk_load_u16_be_sse2+0x3d>
+ DB 233,157,254,255,255 ; jmp 6b7e <_sk_load_u16_be_sse2+0x3d>
PUBLIC _sk_load_rgb_u16_be_sse2
_sk_load_rgb_u16_be_sse2 LABEL PROC
@@ -44874,7 +44355,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,124 ; sub $0x7c,%esp
- DB 232,0,0,0,0 ; call 6e7c <_sk_load_rgb_u16_be_sse2+0xe>
+ DB 232,0,0,0,0 ; call 6cef <_sk_load_rgb_u16_be_sse2+0xe>
DB 88 ; pop %eax
DB 15,40,117,88 ; movaps 0x58(%ebp),%xmm6
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
@@ -44885,7 +44366,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 133,246 ; test %esi,%esi
DB 139,93,16 ; mov 0x10(%ebp),%ebx
DB 141,60,91 ; lea (%ebx,%ebx,2),%edi
- DB 15,133,32,1,0,0 ; jne 6fbd <_sk_load_rgb_u16_be_sse2+0x14f>
+ DB 15,133,32,1,0,0 ; jne 6e30 <_sk_load_rgb_u16_be_sse2+0x14f>
DB 243,15,111,20,122 ; movdqu (%edx,%edi,2),%xmm2
DB 243,15,111,124,122,8 ; movdqu 0x8(%edx,%edi,2),%xmm7
DB 102,15,115,223,4 ; psrldq $0x4,%xmm7
@@ -44910,7 +44391,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 102,15,97,199 ; punpcklwd %xmm7,%xmm0
DB 15,91,192 ; cvtdq2ps %xmm0,%xmm0
- DB 15,40,160,20,53,0,0 ; movaps 0x3514(%eax),%xmm4
+ DB 15,40,160,241,52,0,0 ; movaps 0x34f1(%eax),%xmm4
DB 15,89,196 ; mulps %xmm4,%xmm0
DB 102,15,111,203 ; movdqa %xmm3,%xmm1
DB 102,15,113,241,8 ; psllw $0x8,%xmm1
@@ -44948,7 +44429,7 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 137,84,36,4 ; mov %edx,0x4(%esp)
DB 139,85,8 ; mov 0x8(%ebp),%edx
DB 137,20,36 ; mov %edx,(%esp)
- DB 15,40,152,36,53,0,0 ; movaps 0x3524(%eax),%xmm3
+ DB 15,40,152,1,53,0,0 ; movaps 0x3501(%eax),%xmm3
DB 255,81,4 ; call *0x4(%ecx)
DB 131,196,124 ; add $0x7c,%esp
DB 94 ; pop %esi
@@ -44960,20 +44441,20 @@ _sk_load_rgb_u16_be_sse2 LABEL PROC
DB 102,15,196,84,122,4,2 ; pinsrw $0x2,0x4(%edx,%edi,2),%xmm2
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 131,254,1 ; cmp $0x1,%esi
- DB 117,13 ; jne 6fdf <_sk_load_rgb_u16_be_sse2+0x171>
+ DB 117,13 ; jne 6e52 <_sk_load_rgb_u16_be_sse2+0x171>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
DB 102,15,239,192 ; pxor %xmm0,%xmm0
- DB 233,224,254,255,255 ; jmp 6ebf <_sk_load_rgb_u16_be_sse2+0x51>
+ DB 233,224,254,255,255 ; jmp 6d32 <_sk_load_rgb_u16_be_sse2+0x51>
DB 102,15,110,68,122,6 ; movd 0x6(%edx,%edi,2),%xmm0
DB 102,15,196,68,122,10,2 ; pinsrw $0x2,0xa(%edx,%edi,2),%xmm0
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 131,254,3 ; cmp $0x3,%esi
- DB 114,18 ; jb 7007 <_sk_load_rgb_u16_be_sse2+0x199>
+ DB 114,18 ; jb 6e7a <_sk_load_rgb_u16_be_sse2+0x199>
DB 102,15,110,124,122,12 ; movd 0xc(%edx,%edi,2),%xmm7
DB 102,15,196,124,122,16,2 ; pinsrw $0x2,0x10(%edx,%edi,2),%xmm7
- DB 233,184,254,255,255 ; jmp 6ebf <_sk_load_rgb_u16_be_sse2+0x51>
+ DB 233,184,254,255,255 ; jmp 6d32 <_sk_load_rgb_u16_be_sse2+0x51>
DB 102,15,239,255 ; pxor %xmm7,%xmm7
- DB 233,175,254,255,255 ; jmp 6ebf <_sk_load_rgb_u16_be_sse2+0x51>
+ DB 233,175,254,255,255 ; jmp 6d32 <_sk_load_rgb_u16_be_sse2+0x51>
PUBLIC _sk_store_u16_be_sse2
_sk_store_u16_be_sse2 LABEL PROC
@@ -44984,9 +44465,9 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 86 ; push %esi
DB 131,236,124 ; sub $0x7c,%esp
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
- DB 232,0,0,0,0 ; call 7022 <_sk_store_u16_be_sse2+0x12>
+ DB 232,0,0,0,0 ; call 6e95 <_sk_store_u16_be_sse2+0x12>
DB 88 ; pop %eax
- DB 15,40,176,142,51,0,0 ; movaps 0x338e(%eax),%xmm6
+ DB 15,40,176,107,51,0,0 ; movaps 0x336b(%eax),%xmm6
DB 15,40,224 ; movaps %xmm0,%xmm4
DB 15,89,230 ; mulps %xmm6,%xmm4
DB 102,15,91,228 ; cvtps2dq %xmm4,%xmm4
@@ -45040,7 +44521,7 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 102,15,111,220 ; movdqa %xmm4,%xmm3
DB 102,15,98,221 ; punpckldq %xmm5,%xmm3
- DB 117,82 ; jne 7155 <_sk_store_u16_be_sse2+0x145>
+ DB 117,82 ; jne 6fc8 <_sk_store_u16_be_sse2+0x145>
DB 15,17,28,83 ; movups %xmm3,(%ebx,%edx,2)
DB 102,15,106,229 ; punpckhdq %xmm5,%xmm4
DB 243,15,127,100,83,16 ; movdqu %xmm4,0x10(%ebx,%edx,2)
@@ -45067,13 +44548,13 @@ _sk_store_u16_be_sse2 LABEL PROC
DB 195 ; ret
DB 102,15,214,28,83 ; movq %xmm3,(%ebx,%edx,2)
DB 131,255,1 ; cmp $0x1,%edi
- DB 116,178 ; je 7111 <_sk_store_u16_be_sse2+0x101>
+ DB 116,178 ; je 6f84 <_sk_store_u16_be_sse2+0x101>
DB 102,15,23,92,83,8 ; movhpd %xmm3,0x8(%ebx,%edx,2)
DB 131,255,3 ; cmp $0x3,%edi
- DB 114,167 ; jb 7111 <_sk_store_u16_be_sse2+0x101>
+ DB 114,167 ; jb 6f84 <_sk_store_u16_be_sse2+0x101>
DB 102,15,106,229 ; punpckhdq %xmm5,%xmm4
DB 102,15,214,100,83,16 ; movq %xmm4,0x10(%ebx,%edx,2)
- DB 235,155 ; jmp 7111 <_sk_store_u16_be_sse2+0x101>
+ DB 235,155 ; jmp 6f84 <_sk_store_u16_be_sse2+0x101>
PUBLIC _sk_load_f32_sse2
_sk_load_f32_sse2 LABEL PROC
@@ -45096,7 +44577,7 @@ _sk_load_f32_sse2 LABEL PROC
DB 139,125,20 ; mov 0x14(%ebp),%edi
DB 133,210 ; test %edx,%edx
DB 141,52,141,0,0,0,0 ; lea 0x0(,%ecx,4),%esi
- DB 117,117 ; jne 7220 <_sk_load_f32_sse2+0xaa>
+ DB 117,117 ; jne 7093 <_sk_load_f32_sse2+0xaa>
DB 15,16,84,179,16 ; movups 0x10(%ebx,%esi,4),%xmm2
DB 15,16,92,179,32 ; movups 0x20(%ebx,%esi,4),%xmm3
DB 15,16,68,179,48 ; movups 0x30(%ebx,%esi,4),%xmm0
@@ -45134,17 +44615,17 @@ _sk_load_f32_sse2 LABEL PROC
DB 195 ; ret
DB 15,87,192 ; xorps %xmm0,%xmm0
DB 131,250,1 ; cmp $0x1,%edx
- DB 117,8 ; jne 7230 <_sk_load_f32_sse2+0xba>
+ DB 117,8 ; jne 70a3 <_sk_load_f32_sse2+0xba>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,210 ; xorps %xmm2,%xmm2
- DB 235,138 ; jmp 71ba <_sk_load_f32_sse2+0x44>
+ DB 235,138 ; jmp 702d <_sk_load_f32_sse2+0x44>
DB 15,16,84,179,16 ; movups 0x10(%ebx,%esi,4),%xmm2
DB 131,250,3 ; cmp $0x3,%edx
- DB 114,10 ; jb 7244 <_sk_load_f32_sse2+0xce>
+ DB 114,10 ; jb 70b7 <_sk_load_f32_sse2+0xce>
DB 15,16,92,179,32 ; movups 0x20(%ebx,%esi,4),%xmm3
- DB 233,118,255,255,255 ; jmp 71ba <_sk_load_f32_sse2+0x44>
+ DB 233,118,255,255,255 ; jmp 702d <_sk_load_f32_sse2+0x44>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 233,110,255,255,255 ; jmp 71ba <_sk_load_f32_sse2+0x44>
+ DB 233,110,255,255,255 ; jmp 702d <_sk_load_f32_sse2+0x44>
PUBLIC _sk_load_f32_dst_sse2
_sk_load_f32_dst_sse2 LABEL PROC
@@ -45167,7 +44648,7 @@ _sk_load_f32_dst_sse2 LABEL PROC
DB 139,125,20 ; mov 0x14(%ebp),%edi
DB 133,210 ; test %edx,%edx
DB 141,52,141,0,0,0,0 ; lea 0x0(,%ecx,4),%esi
- DB 117,122 ; jne 72fe <_sk_load_f32_dst_sse2+0xb2>
+ DB 117,122 ; jne 7171 <_sk_load_f32_dst_sse2+0xb2>
DB 15,16,124,179,16 ; movups 0x10(%ebx,%esi,4),%xmm7
DB 15,16,92,179,32 ; movups 0x20(%ebx,%esi,4),%xmm3
DB 15,16,84,179,48 ; movups 0x30(%ebx,%esi,4),%xmm2
@@ -45205,17 +44686,17 @@ _sk_load_f32_dst_sse2 LABEL PROC
DB 195 ; ret
DB 15,87,210 ; xorps %xmm2,%xmm2
DB 131,250,1 ; cmp $0x1,%edx
- DB 117,8 ; jne 730e <_sk_load_f32_dst_sse2+0xc2>
+ DB 117,8 ; jne 7181 <_sk_load_f32_dst_sse2+0xc2>
DB 15,87,219 ; xorps %xmm3,%xmm3
DB 15,87,255 ; xorps %xmm7,%xmm7
- DB 235,133 ; jmp 7293 <_sk_load_f32_dst_sse2+0x47>
+ DB 235,133 ; jmp 7106 <_sk_load_f32_dst_sse2+0x47>
DB 15,16,124,179,16 ; movups 0x10(%ebx,%esi,4),%xmm7
DB 131,250,3 ; cmp $0x3,%edx
- DB 114,10 ; jb 7322 <_sk_load_f32_dst_sse2+0xd6>
+ DB 114,10 ; jb 7195 <_sk_load_f32_dst_sse2+0xd6>
DB 15,16,92,179,32 ; movups 0x20(%ebx,%esi,4),%xmm3
- DB 233,113,255,255,255 ; jmp 7293 <_sk_load_f32_dst_sse2+0x47>
+ DB 233,113,255,255,255 ; jmp 7106 <_sk_load_f32_dst_sse2+0x47>
DB 15,87,219 ; xorps %xmm3,%xmm3
- DB 233,105,255,255,255 ; jmp 7293 <_sk_load_f32_dst_sse2+0x47>
+ DB 233,105,255,255,255 ; jmp 7106 <_sk_load_f32_dst_sse2+0x47>
PUBLIC _sk_store_f32_sse2
_sk_store_f32_sse2 LABEL PROC
@@ -45250,7 +44731,7 @@ _sk_store_f32_sse2 LABEL PROC
DB 133,210 ; test %edx,%edx
DB 139,93,8 ; mov 0x8(%ebp),%ebx
DB 141,60,141,0,0,0,0 ; lea 0x0(,%ecx,4),%edi
- DB 117,99 ; jne 73e7 <_sk_store_f32_sse2+0xbd>
+ DB 117,99 ; jne 725a <_sk_store_f32_sse2+0xbd>
DB 102,15,21,194 ; unpckhpd %xmm2,%xmm0
DB 15,17,100,190,16 ; movups %xmm4,0x10(%esi,%edi,4)
DB 102,15,17,116,190,32 ; movupd %xmm6,0x20(%esi,%edi,4)
@@ -45280,12 +44761,12 @@ _sk_store_f32_sse2 LABEL PROC
DB 93 ; pop %ebp
DB 195 ; ret
DB 131,250,1 ; cmp $0x1,%edx
- DB 116,173 ; je 7399 <_sk_store_f32_sse2+0x6f>
+ DB 116,173 ; je 720c <_sk_store_f32_sse2+0x6f>
DB 15,17,100,190,16 ; movups %xmm4,0x10(%esi,%edi,4)
DB 131,250,3 ; cmp $0x3,%edx
- DB 114,163 ; jb 7399 <_sk_store_f32_sse2+0x6f>
+ DB 114,163 ; jb 720c <_sk_store_f32_sse2+0x6f>
DB 102,15,17,116,190,32 ; movupd %xmm6,0x20(%esi,%edi,4)
- DB 235,155 ; jmp 7399 <_sk_store_f32_sse2+0x6f>
+ DB 235,155 ; jmp 720c <_sk_store_f32_sse2+0x6f>
PUBLIC _sk_clamp_x_sse2
_sk_clamp_x_sse2 LABEL PROC
@@ -45383,7 +44864,7 @@ _sk_repeat_x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 7502 <_sk_repeat_x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 7375 <_sk_repeat_x_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -45397,7 +44878,7 @@ _sk_repeat_x_sse2 LABEL PROC
DB 243,15,91,245 ; cvttps2dq %xmm5,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 15,194,238,1 ; cmpltps %xmm6,%xmm5
- DB 15,84,174,190,46,0,0 ; andps 0x2ebe(%esi),%xmm5
+ DB 15,84,174,155,46,0,0 ; andps 0x2e9b(%esi),%xmm5
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,125,40 ; movaps 0x28(%ebp),%xmm7
DB 15,92,245 ; subps %xmm5,%xmm6
@@ -45436,7 +44917,7 @@ _sk_repeat_y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 75a1 <_sk_repeat_y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 7414 <_sk_repeat_y_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -45450,7 +44931,7 @@ _sk_repeat_y_sse2 LABEL PROC
DB 243,15,91,245 ; cvttps2dq %xmm5,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 15,194,238,1 ; cmpltps %xmm6,%xmm5
- DB 15,84,174,47,46,0,0 ; andps 0x2e2f(%esi),%xmm5
+ DB 15,84,174,12,46,0,0 ; andps 0x2e0c(%esi),%xmm5
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,125,40 ; movaps 0x28(%ebp),%xmm7
DB 15,92,245 ; subps %xmm5,%xmm6
@@ -45489,7 +44970,7 @@ _sk_mirror_x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 7640 <_sk_mirror_x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 74b3 <_sk_mirror_x_sse2+0xe>
DB 95 ; pop %edi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -45501,13 +44982,13 @@ _sk_mirror_x_sse2 LABEL PROC
DB 15,40,229 ; movaps %xmm5,%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
DB 15,92,196 ; subps %xmm4,%xmm0
- DB 243,15,89,183,144,50,0,0 ; mulss 0x3290(%edi),%xmm6
+ DB 243,15,89,183,109,50,0,0 ; mulss 0x326d(%edi),%xmm6
DB 15,198,246,0 ; shufps $0x0,%xmm6,%xmm6
DB 15,89,240 ; mulps %xmm0,%xmm6
DB 243,15,91,254 ; cvttps2dq %xmm6,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
DB 15,194,247,1 ; cmpltps %xmm7,%xmm6
- DB 15,84,183,160,45,0,0 ; andps 0x2da0(%edi),%xmm6
+ DB 15,84,183,125,45,0,0 ; andps 0x2d7d(%edi),%xmm6
DB 139,125,24 ; mov 0x18(%ebp),%edi
DB 15,92,254 ; subps %xmm6,%xmm7
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
@@ -45551,7 +45032,7 @@ _sk_mirror_y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 7701 <_sk_mirror_y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 7574 <_sk_mirror_y_sse2+0xe>
DB 95 ; pop %edi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -45563,13 +45044,13 @@ _sk_mirror_y_sse2 LABEL PROC
DB 15,40,229 ; movaps %xmm5,%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
DB 15,92,204 ; subps %xmm4,%xmm1
- DB 243,15,89,183,211,49,0,0 ; mulss 0x31d3(%edi),%xmm6
+ DB 243,15,89,183,176,49,0,0 ; mulss 0x31b0(%edi),%xmm6
DB 15,198,246,0 ; shufps $0x0,%xmm6,%xmm6
DB 15,89,241 ; mulps %xmm1,%xmm6
DB 243,15,91,254 ; cvttps2dq %xmm6,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
DB 15,194,247,1 ; cmpltps %xmm7,%xmm6
- DB 15,84,183,239,44,0,0 ; andps 0x2cef(%edi),%xmm6
+ DB 15,84,183,204,44,0,0 ; andps 0x2ccc(%edi),%xmm6
DB 139,125,24 ; mov 0x18(%ebp),%edi
DB 15,92,254 ; subps %xmm6,%xmm7
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
@@ -45613,7 +45094,7 @@ _sk_clamp_x_1_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 77c2 <_sk_clamp_x_1_sse2+0xe>
+ DB 232,0,0,0,0 ; call 7635 <_sk_clamp_x_1_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
@@ -45625,7 +45106,7 @@ _sk_clamp_x_1_sse2 LABEL PROC
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,95,224 ; maxps %xmm0,%xmm4
DB 15,40,69,88 ; movaps 0x58(%ebp),%xmm0
- DB 15,93,160,62,44,0,0 ; minps 0x2c3e(%eax),%xmm4
+ DB 15,93,160,27,44,0,0 ; minps 0x2c1b(%eax),%xmm4
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 141,88,4 ; lea 0x4(%eax),%ebx
DB 15,41,68,36,80 ; movaps %xmm0,0x50(%esp)
@@ -45654,7 +45135,7 @@ _sk_repeat_x_1_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 7834 <_sk_repeat_x_1_sse2+0xe>
+ DB 232,0,0,0,0 ; call 76a7 <_sk_repeat_x_1_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
@@ -45666,7 +45147,7 @@ _sk_repeat_x_1_sse2 LABEL PROC
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 15,40,248 ; movaps %xmm0,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,84,184,220,43,0,0 ; andps 0x2bdc(%eax),%xmm7
+ DB 15,84,184,185,43,0,0 ; andps 0x2bb9(%eax),%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,40,125,72 ; movaps 0x48(%ebp),%xmm7
DB 15,92,198 ; subps %xmm6,%xmm0
@@ -45698,21 +45179,21 @@ _sk_mirror_x_1_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 78b1 <_sk_mirror_x_1_sse2+0xe>
+ DB 232,0,0,0,0 ; call 7724 <_sk_mirror_x_1_sse2+0xe>
DB 95 ; pop %edi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
DB 139,85,20 ; mov 0x14(%ebp),%edx
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
- DB 15,40,175,111,43,0,0 ; movaps 0x2b6f(%edi),%xmm5
+ DB 15,40,175,76,43,0,0 ; movaps 0x2b4c(%edi),%xmm5
DB 15,88,197 ; addps %xmm5,%xmm0
- DB 15,40,183,127,43,0,0 ; movaps 0x2b7f(%edi),%xmm6
+ DB 15,40,183,92,43,0,0 ; movaps 0x2b5c(%edi),%xmm6
DB 15,89,240 ; mulps %xmm0,%xmm6
DB 243,15,91,254 ; cvttps2dq %xmm6,%xmm7
DB 15,91,255 ; cvtdq2ps %xmm7,%xmm7
DB 15,194,247,1 ; cmpltps %xmm7,%xmm6
- DB 15,84,183,143,43,0,0 ; andps 0x2b8f(%edi),%xmm6
+ DB 15,84,183,108,43,0,0 ; andps 0x2b6c(%edi),%xmm6
DB 15,92,254 ; subps %xmm6,%xmm7
DB 15,40,117,56 ; movaps 0x38(%ebp),%xmm6
DB 15,88,255 ; addps %xmm7,%xmm7
@@ -45751,7 +45232,7 @@ _sk_luminance_to_alpha_sse2 LABEL PROC
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 232,0,0,0,0 ; call 7951 <_sk_luminance_to_alpha_sse2+0x11>
+ DB 232,0,0,0,0 ; call 77c4 <_sk_luminance_to_alpha_sse2+0x11>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
@@ -45761,9 +45242,9 @@ _sk_luminance_to_alpha_sse2 LABEL PROC
DB 15,40,101,56 ; movaps 0x38(%ebp),%xmm4
DB 15,40,109,72 ; movaps 0x48(%ebp),%xmm5
DB 15,40,117,88 ; movaps 0x58(%ebp),%xmm6
- DB 15,89,128,255,42,0,0 ; mulps 0x2aff(%eax),%xmm0
- DB 15,89,136,15,43,0,0 ; mulps 0x2b0f(%eax),%xmm1
- DB 15,89,152,31,43,0,0 ; mulps 0x2b1f(%eax),%xmm3
+ DB 15,89,128,220,42,0,0 ; mulps 0x2adc(%eax),%xmm0
+ DB 15,89,136,236,42,0,0 ; mulps 0x2aec(%eax),%xmm1
+ DB 15,89,152,252,42,0,0 ; mulps 0x2afc(%eax),%xmm3
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 15,88,200 ; addps %xmm0,%xmm1
DB 15,88,217 ; addps %xmm1,%xmm3
@@ -46291,7 +45772,7 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
DB 86 ; push %esi
DB 129,236,156,0,0,0 ; sub $0x9c,%esp
DB 15,41,69,184 ; movaps %xmm0,-0x48(%ebp)
- DB 232,0,0,0,0 ; call 800b <_sk_evenly_spaced_gradient_sse2+0x15>
+ DB 232,0,0,0,0 ; call 7e7e <_sk_evenly_spaced_gradient_sse2+0x15>
DB 90 ; pop %edx
DB 139,77,12 ; mov 0xc(%ebp),%ecx
DB 141,65,4 ; lea 0x4(%ecx),%eax
@@ -46302,12 +45783,12 @@ _sk_evenly_spaced_gradient_sse2 LABEL PROC
DB 78 ; dec %esi
DB 102,15,110,206 ; movd %esi,%xmm1
DB 102,15,112,201,0 ; pshufd $0x0,%xmm1,%xmm1
- DB 102,15,111,146,117,36,0,0 ; movdqa 0x2475(%edx),%xmm2
+ DB 102,15,111,146,82,36,0,0 ; movdqa 0x2452(%edx),%xmm2
DB 102,15,219,209 ; pand %xmm1,%xmm2
- DB 102,15,235,146,133,36,0,0 ; por 0x2485(%edx),%xmm2
+ DB 102,15,235,146,98,36,0,0 ; por 0x2462(%edx),%xmm2
DB 102,15,114,209,16 ; psrld $0x10,%xmm1
- DB 102,15,235,138,149,36,0,0 ; por 0x2495(%edx),%xmm1
- DB 15,88,138,165,36,0,0 ; addps 0x24a5(%edx),%xmm1
+ DB 102,15,235,138,114,36,0,0 ; por 0x2472(%edx),%xmm1
+ DB 15,88,138,130,36,0,0 ; addps 0x2482(%edx),%xmm1
DB 15,88,202 ; addps %xmm2,%xmm1
DB 15,89,200 ; mulps %xmm0,%xmm1
DB 243,15,91,201 ; cvttps2dq %xmm1,%xmm1
@@ -46428,7 +45909,7 @@ _sk_gauss_a_to_rgba_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8202 <_sk_gauss_a_to_rgba_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8075 <_sk_gauss_a_to_rgba_sse2+0xe>
DB 90 ; pop %edx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -46438,15 +45919,15 @@ _sk_gauss_a_to_rgba_sse2 LABEL PROC
DB 15,40,85,56 ; movaps 0x38(%ebp),%xmm2
DB 15,40,101,72 ; movaps 0x48(%ebp),%xmm4
DB 15,40,109,88 ; movaps 0x58(%ebp),%xmm5
- DB 15,40,130,190,34,0,0 ; movaps 0x22be(%edx),%xmm0
+ DB 15,40,130,155,34,0,0 ; movaps 0x229b(%edx),%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,130,206,34,0,0 ; addps 0x22ce(%edx),%xmm0
+ DB 15,88,130,171,34,0,0 ; addps 0x22ab(%edx),%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,130,222,34,0,0 ; addps 0x22de(%edx),%xmm0
+ DB 15,88,130,187,34,0,0 ; addps 0x22bb(%edx),%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,130,238,34,0,0 ; addps 0x22ee(%edx),%xmm0
+ DB 15,88,130,203,34,0,0 ; addps 0x22cb(%edx),%xmm0
DB 15,89,195 ; mulps %xmm3,%xmm0
- DB 15,88,130,254,34,0,0 ; addps 0x22fe(%edx),%xmm0
+ DB 15,88,130,219,34,0,0 ; addps 0x22db(%edx),%xmm0
DB 139,85,12 ; mov 0xc(%ebp),%edx
DB 141,90,4 ; lea 0x4(%edx),%ebx
DB 15,41,108,36,80 ; movaps %xmm5,0x50(%esp)
@@ -46477,7 +45958,7 @@ _sk_gradient_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 129,236,156,0,0,0 ; sub $0x9c,%esp
- DB 232,0,0,0,0 ; call 829f <_sk_gradient_sse2+0x11>
+ DB 232,0,0,0,0 ; call 8112 <_sk_gradient_sse2+0x11>
DB 90 ; pop %edx
DB 139,69,12 ; mov 0xc(%ebp),%eax
DB 141,72,4 ; lea 0x4(%eax),%ecx
@@ -46486,12 +45967,12 @@ _sk_gradient_sse2 LABEL PROC
DB 139,7 ; mov (%edi),%eax
DB 102,15,239,201 ; pxor %xmm1,%xmm1
DB 131,248,2 ; cmp $0x2,%eax
- DB 114,43 ; jb 82e1 <_sk_gradient_sse2+0x53>
+ DB 114,43 ; jb 8154 <_sk_gradient_sse2+0x53>
DB 139,79,36 ; mov 0x24(%edi),%ecx
DB 72 ; dec %eax
DB 131,193,4 ; add $0x4,%ecx
DB 102,15,239,201 ; pxor %xmm1,%xmm1
- DB 15,40,146,113,34,0,0 ; movaps 0x2271(%edx),%xmm2
+ DB 15,40,146,78,34,0,0 ; movaps 0x224e(%edx),%xmm2
DB 243,15,16,25 ; movss (%ecx),%xmm3
DB 15,198,219,0 ; shufps $0x0,%xmm3,%xmm3
DB 15,194,216,2 ; cmpleps %xmm0,%xmm3
@@ -46499,7 +45980,7 @@ _sk_gradient_sse2 LABEL PROC
DB 102,15,254,203 ; paddd %xmm3,%xmm1
DB 131,193,4 ; add $0x4,%ecx
DB 72 ; dec %eax
- DB 117,231 ; jne 82c8 <_sk_gradient_sse2+0x3a>
+ DB 117,231 ; jne 813b <_sk_gradient_sse2+0x3a>
DB 102,15,126,203 ; movd %xmm1,%ebx
DB 102,15,112,209,229 ; pshufd $0xe5,%xmm1,%xmm2
DB 102,15,126,208 ; movd %xmm2,%eax
@@ -46684,7 +46165,7 @@ _sk_xy_to_unit_angle_sse2 LABEL PROC
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
DB 15,40,200 ; movaps %xmm0,%xmm1
- DB 232,0,0,0,0 ; call 855f <_sk_xy_to_unit_angle_sse2+0x1b>
+ DB 232,0,0,0,0 ; call 83d2 <_sk_xy_to_unit_angle_sse2+0x1b>
DB 88 ; pop %eax
DB 15,87,237 ; xorps %xmm5,%xmm5
DB 15,92,233 ; subps %xmm1,%xmm5
@@ -46699,35 +46180,35 @@ _sk_xy_to_unit_angle_sse2 LABEL PROC
DB 15,94,247 ; divps %xmm7,%xmm6
DB 15,40,254 ; movaps %xmm6,%xmm7
DB 15,89,255 ; mulps %xmm7,%xmm7
- DB 15,40,128,193,31,0,0 ; movaps 0x1fc1(%eax),%xmm0
+ DB 15,40,128,158,31,0,0 ; movaps 0x1f9e(%eax),%xmm0
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 15,88,128,209,31,0,0 ; addps 0x1fd1(%eax),%xmm0
+ DB 15,88,128,174,31,0,0 ; addps 0x1fae(%eax),%xmm0
DB 15,89,199 ; mulps %xmm7,%xmm0
- DB 15,88,128,225,31,0,0 ; addps 0x1fe1(%eax),%xmm0
+ DB 15,88,128,190,31,0,0 ; addps 0x1fbe(%eax),%xmm0
DB 15,89,199 ; mulps %xmm7,%xmm0
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 139,125,24 ; mov 0x18(%ebp),%edi
- DB 15,88,128,241,31,0,0 ; addps 0x1ff1(%eax),%xmm0
+ DB 15,88,128,206,31,0,0 ; addps 0x1fce(%eax),%xmm0
DB 15,89,198 ; mulps %xmm6,%xmm0
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 15,194,236,1 ; cmpltps %xmm4,%xmm5
- DB 15,40,184,1,32,0,0 ; movaps 0x2001(%eax),%xmm7
+ DB 15,40,184,222,31,0,0 ; movaps 0x1fde(%eax),%xmm7
DB 15,92,248 ; subps %xmm0,%xmm7
DB 15,84,253 ; andps %xmm5,%xmm7
DB 15,85,232 ; andnps %xmm0,%xmm5
DB 15,87,228 ; xorps %xmm4,%xmm4
DB 15,86,239 ; orps %xmm7,%xmm5
DB 15,194,204,1 ; cmpltps %xmm4,%xmm1
- DB 15,40,128,17,32,0,0 ; movaps 0x2011(%eax),%xmm0
+ DB 15,40,128,238,31,0,0 ; movaps 0x1fee(%eax),%xmm0
DB 15,92,197 ; subps %xmm5,%xmm0
DB 15,84,193 ; andps %xmm1,%xmm0
DB 15,85,205 ; andnps %xmm5,%xmm1
DB 15,86,200 ; orps %xmm0,%xmm1
DB 15,40,194 ; movaps %xmm2,%xmm0
DB 15,194,196,1 ; cmpltps %xmm4,%xmm0
- DB 15,40,168,33,32,0,0 ; movaps 0x2021(%eax),%xmm5
+ DB 15,40,168,254,31,0,0 ; movaps 0x1ffe(%eax),%xmm5
DB 15,92,233 ; subps %xmm1,%xmm5
DB 15,84,232 ; andps %xmm0,%xmm5
DB 15,85,193 ; andnps %xmm1,%xmm0
@@ -46811,7 +46292,7 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
- DB 232,0,0,0,0 ; call 86e4 <_sk_xy_to_2pt_conical_quadratic_max_sse2+0x18>
+ DB 232,0,0,0,0 ; call 8557 <_sk_xy_to_2pt_conical_quadratic_max_sse2+0x18>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -46830,11 +46311,11 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 243,15,16,79,36 ; movss 0x24(%edi),%xmm1
DB 139,125,20 ; mov 0x14(%ebp),%edi
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
- DB 15,89,166,172,30,0,0 ; mulps 0x1eac(%esi),%xmm4
+ DB 15,89,166,137,30,0,0 ; mulps 0x1e89(%esi),%xmm4
DB 243,15,89,246 ; mulss %xmm6,%xmm6
DB 15,198,246,0 ; shufps $0x0,%xmm6,%xmm6
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,89,174,188,30,0,0 ; mulps 0x1ebc(%esi),%xmm5
+ DB 15,89,174,153,30,0,0 ; mulps 0x1e99(%esi),%xmm5
DB 15,89,239 ; mulps %xmm7,%xmm5
DB 15,40,196 ; movaps %xmm4,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -46843,8 +46324,8 @@ _sk_xy_to_2pt_conical_quadratic_max_sse2 LABEL PROC
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
DB 15,40,197 ; movaps %xmm5,%xmm0
DB 15,92,196 ; subps %xmm4,%xmm0
- DB 15,87,166,204,30,0,0 ; xorps 0x1ecc(%esi),%xmm4
- DB 15,89,142,220,30,0,0 ; mulps 0x1edc(%esi),%xmm1
+ DB 15,87,166,169,30,0,0 ; xorps 0x1ea9(%esi),%xmm4
+ DB 15,89,142,185,30,0,0 ; mulps 0x1eb9(%esi),%xmm1
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 15,92,229 ; subps %xmm5,%xmm4
@@ -46886,7 +46367,7 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
DB 15,40,218 ; movaps %xmm2,%xmm3
DB 15,40,209 ; movaps %xmm1,%xmm2
- DB 232,0,0,0,0 ; call 87d8 <_sk_xy_to_2pt_conical_quadratic_min_sse2+0x18>
+ DB 232,0,0,0,0 ; call 864b <_sk_xy_to_2pt_conical_quadratic_min_sse2+0x18>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -46905,11 +46386,11 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 243,15,16,79,36 ; movss 0x24(%edi),%xmm1
DB 139,125,20 ; mov 0x14(%ebp),%edi
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
- DB 15,89,166,248,29,0,0 ; mulps 0x1df8(%esi),%xmm4
+ DB 15,89,166,213,29,0,0 ; mulps 0x1dd5(%esi),%xmm4
DB 243,15,89,246 ; mulss %xmm6,%xmm6
DB 15,198,246,0 ; shufps $0x0,%xmm6,%xmm6
DB 15,92,254 ; subps %xmm6,%xmm7
- DB 15,89,174,8,30,0,0 ; mulps 0x1e08(%esi),%xmm5
+ DB 15,89,174,229,29,0,0 ; mulps 0x1de5(%esi),%xmm5
DB 15,89,239 ; mulps %xmm7,%xmm5
DB 15,40,196 ; movaps %xmm4,%xmm0
DB 15,89,192 ; mulps %xmm0,%xmm0
@@ -46918,8 +46399,8 @@ _sk_xy_to_2pt_conical_quadratic_min_sse2 LABEL PROC
DB 15,198,201,0 ; shufps $0x0,%xmm1,%xmm1
DB 15,40,197 ; movaps %xmm5,%xmm0
DB 15,92,196 ; subps %xmm4,%xmm0
- DB 15,87,166,24,30,0,0 ; xorps 0x1e18(%esi),%xmm4
- DB 15,89,142,40,30,0,0 ; mulps 0x1e28(%esi),%xmm1
+ DB 15,87,166,245,29,0,0 ; xorps 0x1df5(%esi),%xmm4
+ DB 15,89,142,5,30,0,0 ; mulps 0x1e05(%esi),%xmm1
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,117,40 ; movaps 0x28(%ebp),%xmm6
DB 15,92,229 ; subps %xmm5,%xmm4
@@ -46958,7 +46439,7 @@ _sk_xy_to_2pt_conical_linear_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 88c2 <_sk_xy_to_2pt_conical_linear_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8735 <_sk_xy_to_2pt_conical_linear_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -46970,7 +46451,7 @@ _sk_xy_to_2pt_conical_linear_sse2 LABEL PROC
DB 243,15,89,236 ; mulss %xmm4,%xmm5
DB 15,198,237,0 ; shufps $0x0,%xmm5,%xmm5
DB 15,88,232 ; addps %xmm0,%xmm5
- DB 15,89,174,78,29,0,0 ; mulps 0x1d4e(%esi),%xmm5
+ DB 15,89,174,43,29,0,0 ; mulps 0x1d2b(%esi),%xmm5
DB 15,89,192 ; mulps %xmm0,%xmm0
DB 15,40,241 ; movaps %xmm1,%xmm6
DB 15,89,246 ; mulps %xmm6,%xmm6
@@ -46978,7 +46459,7 @@ _sk_xy_to_2pt_conical_linear_sse2 LABEL PROC
DB 243,15,89,228 ; mulss %xmm4,%xmm4
DB 15,198,228,0 ; shufps $0x0,%xmm4,%xmm4
DB 15,92,196 ; subps %xmm4,%xmm0
- DB 15,87,134,94,29,0,0 ; xorps 0x1d5e(%esi),%xmm0
+ DB 15,87,134,59,29,0,0 ; xorps 0x1d3b(%esi),%xmm0
DB 139,117,24 ; mov 0x18(%ebp),%esi
DB 15,40,101,40 ; movaps 0x28(%ebp),%xmm4
DB 15,40,117,56 ; movaps 0x38(%ebp),%xmm6
@@ -47102,16 +46583,16 @@ _sk_save_xy_sse2 LABEL PROC
DB 131,236,124 ; sub $0x7c,%esp
DB 15,41,93,216 ; movaps %xmm3,-0x28(%ebp)
DB 15,40,218 ; movaps %xmm2,%xmm3
- DB 232,0,0,0,0 ; call 8a64 <_sk_save_xy_sse2+0x15>
+ DB 232,0,0,0,0 ; call 88d7 <_sk_save_xy_sse2+0x15>
DB 88 ; pop %eax
- DB 15,40,160,204,27,0,0 ; movaps 0x1bcc(%eax),%xmm4
+ DB 15,40,160,169,27,0,0 ; movaps 0x1ba9(%eax),%xmm4
DB 15,40,232 ; movaps %xmm0,%xmm5
DB 15,88,236 ; addps %xmm4,%xmm5
DB 243,15,91,245 ; cvttps2dq %xmm5,%xmm6
DB 15,91,246 ; cvtdq2ps %xmm6,%xmm6
DB 15,40,253 ; movaps %xmm5,%xmm7
DB 15,194,254,1 ; cmpltps %xmm6,%xmm7
- DB 15,40,144,220,27,0,0 ; movaps 0x1bdc(%eax),%xmm2
+ DB 15,40,144,185,27,0,0 ; movaps 0x1bb9(%eax),%xmm2
DB 15,84,250 ; andps %xmm2,%xmm7
DB 15,92,247 ; subps %xmm7,%xmm6
DB 15,92,238 ; subps %xmm6,%xmm5
@@ -47211,15 +46692,15 @@ _sk_bilinear_nx_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8ba9 <_sk_bilinear_nx_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8a1c <_sk_bilinear_nx_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,12 ; mov 0xc(%ebp),%esi
DB 139,62 ; mov (%esi),%edi
DB 15,16,7 ; movups (%edi),%xmm0
- DB 15,88,128,167,26,0,0 ; addps 0x1aa7(%eax),%xmm0
- DB 15,40,160,183,26,0,0 ; movaps 0x1ab7(%eax),%xmm4
+ DB 15,88,128,132,26,0,0 ; addps 0x1a84(%eax),%xmm0
+ DB 15,40,160,148,26,0,0 ; movaps 0x1a94(%eax),%xmm4
DB 139,69,20 ; mov 0x14(%ebp),%eax
DB 15,16,111,64 ; movups 0x40(%edi),%xmm5
DB 15,92,229 ; subps %xmm5,%xmm4
@@ -47255,14 +46736,14 @@ _sk_bilinear_px_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8c2d <_sk_bilinear_px_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8aa0 <_sk_bilinear_px_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,12 ; mov 0xc(%ebp),%esi
DB 139,62 ; mov (%esi),%edi
DB 15,16,7 ; movups (%edi),%xmm0
- DB 15,88,128,67,26,0,0 ; addps 0x1a43(%eax),%xmm0
+ DB 15,88,128,32,26,0,0 ; addps 0x1a20(%eax),%xmm0
DB 139,69,20 ; mov 0x14(%ebp),%eax
DB 15,16,103,64 ; movups 0x40(%edi),%xmm4
DB 15,17,167,128,0,0,0 ; movups %xmm4,0x80(%edi)
@@ -47297,15 +46778,15 @@ _sk_bilinear_ny_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8ca7 <_sk_bilinear_ny_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8b1a <_sk_bilinear_ny_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,12 ; mov 0xc(%ebp),%esi
DB 139,62 ; mov (%esi),%edi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
- DB 15,88,136,217,25,0,0 ; addps 0x19d9(%eax),%xmm1
- DB 15,40,160,233,25,0,0 ; movaps 0x19e9(%eax),%xmm4
+ DB 15,88,136,182,25,0,0 ; addps 0x19b6(%eax),%xmm1
+ DB 15,40,160,198,25,0,0 ; movaps 0x19c6(%eax),%xmm4
DB 139,69,20 ; mov 0x14(%ebp),%eax
DB 15,16,111,96 ; movups 0x60(%edi),%xmm5
DB 15,92,229 ; subps %xmm5,%xmm4
@@ -47341,14 +46822,14 @@ _sk_bilinear_py_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8d2c <_sk_bilinear_py_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8b9f <_sk_bilinear_py_sse2+0xe>
DB 88 ; pop %eax
DB 139,77,8 ; mov 0x8(%ebp),%ecx
DB 139,85,16 ; mov 0x10(%ebp),%edx
DB 139,117,12 ; mov 0xc(%ebp),%esi
DB 139,62 ; mov (%esi),%edi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
- DB 15,88,136,116,25,0,0 ; addps 0x1974(%eax),%xmm1
+ DB 15,88,136,81,25,0,0 ; addps 0x1951(%eax),%xmm1
DB 139,69,20 ; mov 0x14(%ebp),%eax
DB 15,16,103,96 ; movups 0x60(%edi),%xmm4
DB 15,17,167,160,0,0,0 ; movups %xmm4,0xa0(%edi)
@@ -47383,7 +46864,7 @@ _sk_bicubic_n3x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8da7 <_sk_bicubic_n3x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8c1a <_sk_bicubic_n3x_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -47391,12 +46872,12 @@ _sk_bicubic_n3x_sse2 LABEL PROC
DB 139,58 ; mov (%edx),%edi
DB 15,16,7 ; movups (%edi),%xmm0
DB 15,16,103,64 ; movups 0x40(%edi),%xmm4
- DB 15,88,134,9,25,0,0 ; addps 0x1909(%esi),%xmm0
- DB 15,40,174,25,25,0,0 ; movaps 0x1919(%esi),%xmm5
+ DB 15,88,134,230,24,0,0 ; addps 0x18e6(%esi),%xmm0
+ DB 15,40,174,246,24,0,0 ; movaps 0x18f6(%esi),%xmm5
DB 15,92,236 ; subps %xmm4,%xmm5
DB 15,40,229 ; movaps %xmm5,%xmm4
- DB 15,89,174,41,25,0,0 ; mulps 0x1929(%esi),%xmm5
- DB 15,88,174,57,25,0,0 ; addps 0x1939(%esi),%xmm5
+ DB 15,89,174,6,25,0,0 ; mulps 0x1906(%esi),%xmm5
+ DB 15,88,174,22,25,0,0 ; addps 0x1916(%esi),%xmm5
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,89,228 ; mulps %xmm4,%xmm4
DB 15,89,236 ; mulps %xmm4,%xmm5
@@ -47432,7 +46913,7 @@ _sk_bicubic_n1x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8e42 <_sk_bicubic_n1x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8cb5 <_sk_bicubic_n1x_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -47440,16 +46921,16 @@ _sk_bicubic_n1x_sse2 LABEL PROC
DB 139,58 ; mov (%edx),%edi
DB 15,16,7 ; movups (%edi),%xmm0
DB 15,16,103,64 ; movups 0x40(%edi),%xmm4
- DB 15,88,134,174,24,0,0 ; addps 0x18ae(%esi),%xmm0
- DB 15,40,174,190,24,0,0 ; movaps 0x18be(%esi),%xmm5
+ DB 15,88,134,139,24,0,0 ; addps 0x188b(%esi),%xmm0
+ DB 15,40,174,155,24,0,0 ; movaps 0x189b(%esi),%xmm5
DB 15,92,236 ; subps %xmm4,%xmm5
- DB 15,40,166,206,24,0,0 ; movaps 0x18ce(%esi),%xmm4
+ DB 15,40,166,171,24,0,0 ; movaps 0x18ab(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,222,24,0,0 ; addps 0x18de(%esi),%xmm4
+ DB 15,88,166,187,24,0,0 ; addps 0x18bb(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,238,24,0,0 ; addps 0x18ee(%esi),%xmm4
+ DB 15,88,166,203,24,0,0 ; addps 0x18cb(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,254,24,0,0 ; addps 0x18fe(%esi),%xmm4
+ DB 15,88,166,219,24,0,0 ; addps 0x18db(%esi),%xmm4
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,17,167,128,0,0,0 ; movups %xmm4,0x80(%edi)
DB 139,125,24 ; mov 0x18(%ebp),%edi
@@ -47483,21 +46964,21 @@ _sk_bicubic_p1x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8eeb <_sk_bicubic_p1x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8d5e <_sk_bicubic_p1x_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
DB 139,85,12 ; mov 0xc(%ebp),%edx
DB 139,58 ; mov (%edx),%edi
- DB 15,40,166,101,24,0,0 ; movaps 0x1865(%esi),%xmm4
+ DB 15,40,166,66,24,0,0 ; movaps 0x1842(%esi),%xmm4
DB 15,16,71,64 ; movups 0x40(%edi),%xmm0
- DB 15,40,174,117,24,0,0 ; movaps 0x1875(%esi),%xmm5
+ DB 15,40,174,82,24,0,0 ; movaps 0x1852(%esi),%xmm5
DB 15,89,232 ; mulps %xmm0,%xmm5
- DB 15,88,174,133,24,0,0 ; addps 0x1885(%esi),%xmm5
+ DB 15,88,174,98,24,0,0 ; addps 0x1862(%esi),%xmm5
DB 15,89,232 ; mulps %xmm0,%xmm5
DB 15,88,236 ; addps %xmm4,%xmm5
DB 15,89,232 ; mulps %xmm0,%xmm5
- DB 15,88,174,149,24,0,0 ; addps 0x1895(%esi),%xmm5
+ DB 15,88,174,114,24,0,0 ; addps 0x1872(%esi),%xmm5
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,16,7 ; movups (%edi),%xmm0
DB 15,17,175,128,0,0,0 ; movups %xmm5,0x80(%edi)
@@ -47533,7 +47014,7 @@ _sk_bicubic_p3x_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 8f89 <_sk_bicubic_p3x_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8dfc <_sk_bicubic_p3x_sse2+0xe>
DB 89 ; pop %ecx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,85,16 ; mov 0x10(%ebp),%edx
@@ -47541,10 +47022,10 @@ _sk_bicubic_p3x_sse2 LABEL PROC
DB 139,62 ; mov (%esi),%edi
DB 15,16,7 ; movups (%edi),%xmm0
DB 15,16,103,64 ; movups 0x40(%edi),%xmm4
- DB 15,88,129,7,24,0,0 ; addps 0x1807(%ecx),%xmm0
+ DB 15,88,129,228,23,0,0 ; addps 0x17e4(%ecx),%xmm0
DB 15,40,236 ; movaps %xmm4,%xmm5
- DB 15,89,161,23,24,0,0 ; mulps 0x1817(%ecx),%xmm4
- DB 15,88,161,39,24,0,0 ; addps 0x1827(%ecx),%xmm4
+ DB 15,89,161,244,23,0,0 ; mulps 0x17f4(%ecx),%xmm4
+ DB 15,88,161,4,24,0,0 ; addps 0x1804(%ecx),%xmm4
DB 139,77,20 ; mov 0x14(%ebp),%ecx
DB 15,89,237 ; mulps %xmm5,%xmm5
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -47580,7 +47061,7 @@ _sk_bicubic_n3y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 901a <_sk_bicubic_n3y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8e8d <_sk_bicubic_n3y_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -47588,12 +47069,12 @@ _sk_bicubic_n3y_sse2 LABEL PROC
DB 139,58 ; mov (%edx),%edi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
DB 15,16,103,96 ; movups 0x60(%edi),%xmm4
- DB 15,88,142,166,23,0,0 ; addps 0x17a6(%esi),%xmm1
- DB 15,40,174,182,23,0,0 ; movaps 0x17b6(%esi),%xmm5
+ DB 15,88,142,131,23,0,0 ; addps 0x1783(%esi),%xmm1
+ DB 15,40,174,147,23,0,0 ; movaps 0x1793(%esi),%xmm5
DB 15,92,236 ; subps %xmm4,%xmm5
DB 15,40,229 ; movaps %xmm5,%xmm4
- DB 15,89,174,198,23,0,0 ; mulps 0x17c6(%esi),%xmm5
- DB 15,88,174,214,23,0,0 ; addps 0x17d6(%esi),%xmm5
+ DB 15,89,174,163,23,0,0 ; mulps 0x17a3(%esi),%xmm5
+ DB 15,88,174,179,23,0,0 ; addps 0x17b3(%esi),%xmm5
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,89,228 ; mulps %xmm4,%xmm4
DB 15,89,236 ; mulps %xmm4,%xmm5
@@ -47629,7 +47110,7 @@ _sk_bicubic_n1y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 90b6 <_sk_bicubic_n1y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8f29 <_sk_bicubic_n1y_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
@@ -47637,16 +47118,16 @@ _sk_bicubic_n1y_sse2 LABEL PROC
DB 139,58 ; mov (%edx),%edi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
DB 15,16,103,96 ; movups 0x60(%edi),%xmm4
- DB 15,88,142,74,23,0,0 ; addps 0x174a(%esi),%xmm1
- DB 15,40,174,90,23,0,0 ; movaps 0x175a(%esi),%xmm5
+ DB 15,88,142,39,23,0,0 ; addps 0x1727(%esi),%xmm1
+ DB 15,40,174,55,23,0,0 ; movaps 0x1737(%esi),%xmm5
DB 15,92,236 ; subps %xmm4,%xmm5
- DB 15,40,166,106,23,0,0 ; movaps 0x176a(%esi),%xmm4
+ DB 15,40,166,71,23,0,0 ; movaps 0x1747(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,122,23,0,0 ; addps 0x177a(%esi),%xmm4
+ DB 15,88,166,87,23,0,0 ; addps 0x1757(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,138,23,0,0 ; addps 0x178a(%esi),%xmm4
+ DB 15,88,166,103,23,0,0 ; addps 0x1767(%esi),%xmm4
DB 15,89,229 ; mulps %xmm5,%xmm4
- DB 15,88,166,154,23,0,0 ; addps 0x179a(%esi),%xmm4
+ DB 15,88,166,119,23,0,0 ; addps 0x1777(%esi),%xmm4
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,17,167,160,0,0,0 ; movups %xmm4,0xa0(%edi)
DB 139,125,24 ; mov 0x18(%ebp),%edi
@@ -47680,21 +47161,21 @@ _sk_bicubic_p1y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 9160 <_sk_bicubic_p1y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 8fd3 <_sk_bicubic_p1y_sse2+0xe>
DB 94 ; pop %esi
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,77,16 ; mov 0x10(%ebp),%ecx
DB 139,85,12 ; mov 0xc(%ebp),%edx
DB 139,58 ; mov (%edx),%edi
- DB 15,40,166,0,23,0,0 ; movaps 0x1700(%esi),%xmm4
+ DB 15,40,166,221,22,0,0 ; movaps 0x16dd(%esi),%xmm4
DB 15,16,79,96 ; movups 0x60(%edi),%xmm1
- DB 15,40,174,16,23,0,0 ; movaps 0x1710(%esi),%xmm5
+ DB 15,40,174,237,22,0,0 ; movaps 0x16ed(%esi),%xmm5
DB 15,89,233 ; mulps %xmm1,%xmm5
- DB 15,88,174,32,23,0,0 ; addps 0x1720(%esi),%xmm5
+ DB 15,88,174,253,22,0,0 ; addps 0x16fd(%esi),%xmm5
DB 15,89,233 ; mulps %xmm1,%xmm5
DB 15,88,236 ; addps %xmm4,%xmm5
DB 15,89,233 ; mulps %xmm1,%xmm5
- DB 15,88,174,48,23,0,0 ; addps 0x1730(%esi),%xmm5
+ DB 15,88,174,13,23,0,0 ; addps 0x170d(%esi),%xmm5
DB 139,117,20 ; mov 0x14(%ebp),%esi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
DB 15,17,175,160,0,0,0 ; movups %xmm5,0xa0(%edi)
@@ -47730,7 +47211,7 @@ _sk_bicubic_p3y_sse2 LABEL PROC
DB 87 ; push %edi
DB 86 ; push %esi
DB 131,236,108 ; sub $0x6c,%esp
- DB 232,0,0,0,0 ; call 91ff <_sk_bicubic_p3y_sse2+0xe>
+ DB 232,0,0,0,0 ; call 9072 <_sk_bicubic_p3y_sse2+0xe>
DB 89 ; pop %ecx
DB 139,69,8 ; mov 0x8(%ebp),%eax
DB 139,85,16 ; mov 0x10(%ebp),%edx
@@ -47738,10 +47219,10 @@ _sk_bicubic_p3y_sse2 LABEL PROC
DB 139,62 ; mov (%esi),%edi
DB 15,16,79,32 ; movups 0x20(%edi),%xmm1
DB 15,16,103,96 ; movups 0x60(%edi),%xmm4
- DB 15,88,137,161,22,0,0 ; addps 0x16a1(%ecx),%xmm1
+ DB 15,88,137,126,22,0,0 ; addps 0x167e(%ecx),%xmm1
DB 15,40,236 ; movaps %xmm4,%xmm5
- DB 15,89,161,177,22,0,0 ; mulps 0x16b1(%ecx),%xmm4
- DB 15,88,161,193,22,0,0 ; addps 0x16c1(%ecx),%xmm4
+ DB 15,89,161,142,22,0,0 ; mulps 0x168e(%ecx),%xmm4
+ DB 15,88,161,158,22,0,0 ; addps 0x169e(%ecx),%xmm4
DB 139,77,20 ; mov 0x14(%ebp),%ecx
DB 15,89,237 ; mulps %xmm5,%xmm5
DB 15,89,229 ; mulps %xmm5,%xmm4
@@ -48001,9 +47482,9 @@ ALIGN 16
DB 0,224 ; add %ah,%al
DB 64 ; inc %eax
DB 0,0 ; add %al,(%eax)
- DB 224,64 ; loopne 956c <.literal16+0x1fc>
+ DB 224,64 ; loopne 93dc <.literal16+0x1fc>
DB 0,0 ; add %al,(%eax)
- DB 224,64 ; loopne 9570 <.literal16+0x200>
+ DB 224,64 ; loopne 93e0 <.literal16+0x200>
DB 154,153,153,62,154,153,153 ; lcall $0x9999,$0x9a3e9999
DB 62,154,153,153,62,154,153,153 ; ds lcall $0x9999,$0x9a3e9999
DB 62,61,10,23,63,61 ; ds cmp $0x3d3f170a,%eax
@@ -48014,16 +47495,16 @@ ALIGN 16
DB 63 ; aas
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9591 <.literal16+0x221>
+ DB 225,61 ; loope 9401 <.literal16+0x221>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9595 <.literal16+0x225>
+ DB 225,61 ; loope 9405 <.literal16+0x225>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9599 <.literal16+0x229>
+ DB 225,61 ; loope 9409 <.literal16+0x229>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 959d <.literal16+0x22d>
+ DB 225,61 ; loope 940d <.literal16+0x22d>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48040,16 +47521,16 @@ ALIGN 16
DB 63 ; aas
DB 61,10,23,63,174 ; cmp $0xae3f170a,%eax
DB 71 ; inc %edi
- DB 225,61 ; loope 95d1 <.literal16+0x261>
+ DB 225,61 ; loope 9441 <.literal16+0x261>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 95d5 <.literal16+0x265>
+ DB 225,61 ; loope 9445 <.literal16+0x265>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 95d9 <.literal16+0x269>
+ DB 225,61 ; loope 9449 <.literal16+0x269>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 95dd <.literal16+0x26d>
+ DB 225,61 ; loope 944d <.literal16+0x26d>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48066,16 +47547,16 @@ ALIGN 16
DB 63 ; aas
DB 61,10,23,63,174 ; cmp $0xae3f170a,%eax
DB 71 ; inc %edi
- DB 225,61 ; loope 9611 <.literal16+0x2a1>
+ DB 225,61 ; loope 9481 <.literal16+0x2a1>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9615 <.literal16+0x2a5>
+ DB 225,61 ; loope 9485 <.literal16+0x2a5>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9619 <.literal16+0x2a9>
+ DB 225,61 ; loope 9489 <.literal16+0x2a9>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 961d <.literal16+0x2ad>
+ DB 225,61 ; loope 948d <.literal16+0x2ad>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48092,16 +47573,16 @@ ALIGN 16
DB 63 ; aas
DB 61,10,23,63,174 ; cmp $0xae3f170a,%eax
DB 71 ; inc %edi
- DB 225,61 ; loope 9651 <.literal16+0x2e1>
+ DB 225,61 ; loope 94c1 <.literal16+0x2e1>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9655 <.literal16+0x2e5>
+ DB 225,61 ; loope 94c5 <.literal16+0x2e5>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 9659 <.literal16+0x2e9>
+ DB 225,61 ; loope 94c9 <.literal16+0x2e9>
DB 174 ; scas %es:(%edi),%al
DB 71 ; inc %edi
- DB 225,61 ; loope 965d <.literal16+0x2ed>
+ DB 225,61 ; loope 94cd <.literal16+0x2ed>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48123,11 +47604,11 @@ ALIGN 16
DB 0,128,63,0,0,127 ; add %al,0x7f00003f(%eax)
DB 67 ; inc %ebx
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 969b <.literal16+0x32b>
+ DB 127,67 ; jg 950b <.literal16+0x32b>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 969f <.literal16+0x32f>
+ DB 127,67 ; jg 950f <.literal16+0x32f>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 96a3 <.literal16+0x333>
+ DB 127,67 ; jg 9513 <.literal16+0x333>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48396,13 +47877,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%edi)
DB 8,33 ; or %ah,(%ecx)
DB 132,55 ; test %dh,(%edi)
- DB 224,7 ; loopne 98e9 <.literal16+0x579>
+ DB 224,7 ; loopne 9759 <.literal16+0x579>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 98ed <.literal16+0x57d>
+ DB 224,7 ; loopne 975d <.literal16+0x57d>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 98f1 <.literal16+0x581>
+ DB 224,7 ; loopne 9761 <.literal16+0x581>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 98f5 <.literal16+0x585>
+ DB 224,7 ; loopne 9765 <.literal16+0x585>
DB 0,0 ; add %al,(%eax)
DB 33,8 ; and %ecx,(%eax)
DB 2,58 ; add (%edx),%bh
@@ -48451,11 +47932,11 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,127,67 ; add %bh,0x43(%edi)
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 99ab <.literal16+0x63b>
+ DB 127,67 ; jg 981b <.literal16+0x63b>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 99af <.literal16+0x63f>
+ DB 127,67 ; jg 981f <.literal16+0x63f>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 99b3 <.literal16+0x643>
+ DB 127,67 ; jg 9823 <.literal16+0x643>
DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%eax)
DB 128,59,129 ; cmpb $0x81,(%ebx)
DB 128,128,59,129,128,128,59 ; addb $0x3b,-0x7f7f7ec5(%eax)
@@ -48470,16 +47951,16 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 99a4 <.literal16+0x634>
+ DB 127,0 ; jg 9814 <.literal16+0x634>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 99a8 <.literal16+0x638>
+ DB 127,0 ; jg 9818 <.literal16+0x638>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 99ac <.literal16+0x63c>
+ DB 127,0 ; jg 981c <.literal16+0x63c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 99b0 <.literal16+0x640>
+ DB 127,0 ; jg 9820 <.literal16+0x640>
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
@@ -48488,7 +47969,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
- DB 119,115 ; ja 9a35 <.literal16+0x6c5>
+ DB 119,115 ; ja 98a5 <.literal16+0x6c5>
DB 248 ; clc
DB 194,119,115 ; ret $0x7377
DB 248 ; clc
@@ -48499,7 +47980,7 @@ ALIGN 16
DB 194,117,191 ; ret $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
- DB 117,191 ; jne 9999 <.literal16+0x629>
+ DB 117,191 ; jne 9809 <.literal16+0x629>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
DB 249 ; stc
@@ -48515,7 +47996,7 @@ ALIGN 16
DB 68 ; inc %esp
DB 180,62 ; mov $0x3e,%ah
DB 163,233,220,63,163 ; mov %eax,0xa33fdce9
- DB 233,220,63,163,233 ; jmp e9a3d9d6 <_sk_callback_sse2+0xe9a34753>
+ DB 233,220,63,163,233 ; jmp e9a3d846 <_sk_callback_sse2+0xe9a34750>
DB 220,63 ; fdivrl (%edi)
DB 163,233,220,63,0 ; mov %eax,0x3fdce9
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48570,16 +48051,16 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 9a74 <.literal16+0x704>
+ DB 127,0 ; jg 98e4 <.literal16+0x704>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9a78 <.literal16+0x708>
+ DB 127,0 ; jg 98e8 <.literal16+0x708>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9a7c <.literal16+0x70c>
+ DB 127,0 ; jg 98ec <.literal16+0x70c>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9a80 <.literal16+0x710>
+ DB 127,0 ; jg 98f0 <.literal16+0x710>
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
@@ -48588,7 +48069,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
- DB 119,115 ; ja 9b05 <.literal16+0x795>
+ DB 119,115 ; ja 9975 <.literal16+0x795>
DB 248 ; clc
DB 194,119,115 ; ret $0x7377
DB 248 ; clc
@@ -48599,7 +48080,7 @@ ALIGN 16
DB 194,117,191 ; ret $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
- DB 117,191 ; jne 9a69 <.literal16+0x6f9>
+ DB 117,191 ; jne 98d9 <.literal16+0x6f9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
DB 249 ; stc
@@ -48615,7 +48096,7 @@ ALIGN 16
DB 68 ; inc %esp
DB 180,62 ; mov $0x3e,%ah
DB 163,233,220,63,163 ; mov %eax,0xa33fdce9
- DB 233,220,63,163,233 ; jmp e9a3daa6 <_sk_callback_sse2+0xe9a34823>
+ DB 233,220,63,163,233 ; jmp e9a3d916 <_sk_callback_sse2+0xe9a34820>
DB 220,63 ; fdivrl (%edi)
DB 163,233,220,63,0 ; mov %eax,0x3fdce9
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48670,16 +48151,16 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 9b44 <.literal16+0x7d4>
+ DB 127,0 ; jg 99b4 <.literal16+0x7d4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9b48 <.literal16+0x7d8>
+ DB 127,0 ; jg 99b8 <.literal16+0x7d8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9b4c <.literal16+0x7dc>
+ DB 127,0 ; jg 99bc <.literal16+0x7dc>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9b50 <.literal16+0x7e0>
+ DB 127,0 ; jg 99c0 <.literal16+0x7e0>
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
@@ -48688,7 +48169,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
- DB 119,115 ; ja 9bd5 <.literal16+0x865>
+ DB 119,115 ; ja 9a45 <.literal16+0x865>
DB 248 ; clc
DB 194,119,115 ; ret $0x7377
DB 248 ; clc
@@ -48699,7 +48180,7 @@ ALIGN 16
DB 194,117,191 ; ret $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
- DB 117,191 ; jne 9b39 <.literal16+0x7c9>
+ DB 117,191 ; jne 99a9 <.literal16+0x7c9>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
DB 249 ; stc
@@ -48715,7 +48196,7 @@ ALIGN 16
DB 68 ; inc %esp
DB 180,62 ; mov $0x3e,%ah
DB 163,233,220,63,163 ; mov %eax,0xa33fdce9
- DB 233,220,63,163,233 ; jmp e9a3db76 <_sk_callback_sse2+0xe9a348f3>
+ DB 233,220,63,163,233 ; jmp e9a3d9e6 <_sk_callback_sse2+0xe9a348f0>
DB 220,63 ; fdivrl (%edi)
DB 163,233,220,63,0 ; mov %eax,0x3fdce9
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48770,16 +48251,16 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 52,255 ; xor $0xff,%al
DB 255 ; (bad)
- DB 127,0 ; jg 9c14 <.literal16+0x8a4>
+ DB 127,0 ; jg 9a84 <.literal16+0x8a4>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9c18 <.literal16+0x8a8>
+ DB 127,0 ; jg 9a88 <.literal16+0x8a8>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9c1c <.literal16+0x8ac>
+ DB 127,0 ; jg 9a8c <.literal16+0x8ac>
DB 255 ; (bad)
DB 255 ; (bad)
- DB 127,0 ; jg 9c20 <.literal16+0x8b0>
+ DB 127,0 ; jg 9a90 <.literal16+0x8b0>
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
@@ -48788,7 +48269,7 @@ ALIGN 16
DB 0,63 ; add %bh,(%edi)
DB 0,0 ; add %al,(%eax)
DB 0,63 ; add %bh,(%edi)
- DB 119,115 ; ja 9ca5 <.literal16+0x935>
+ DB 119,115 ; ja 9b15 <.literal16+0x935>
DB 248 ; clc
DB 194,119,115 ; ret $0x7377
DB 248 ; clc
@@ -48799,7 +48280,7 @@ ALIGN 16
DB 194,117,191 ; ret $0xbf75
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
- DB 117,191 ; jne 9c09 <.literal16+0x899>
+ DB 117,191 ; jne 9a79 <.literal16+0x899>
DB 191,63,117,191,191 ; mov $0xbfbf753f,%edi
DB 63 ; aas
DB 249 ; stc
@@ -48815,7 +48296,7 @@ ALIGN 16
DB 68 ; inc %esp
DB 180,62 ; mov $0x3e,%ah
DB 163,233,220,63,163 ; mov %eax,0xa33fdce9
- DB 233,220,63,163,233 ; jmp e9a3dc46 <_sk_callback_sse2+0xe9a349c3>
+ DB 233,220,63,163,233 ; jmp e9a3dab6 <_sk_callback_sse2+0xe9a349c0>
DB 220,63 ; fdivrl (%edi)
DB 163,233,220,63,0 ; mov %eax,0x3fdce9
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -48866,13 +48347,13 @@ ALIGN 16
DB 200,66,0,0 ; enter $0x42,$0x0
DB 200,66,0,0 ; enter $0x42,$0x0
DB 200,66,0,0 ; enter $0x42,$0x0
- DB 127,67 ; jg 9d27 <.literal16+0x9b7>
+ DB 127,67 ; jg 9b97 <.literal16+0x9b7>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9d2b <.literal16+0x9bb>
+ DB 127,67 ; jg 9b9b <.literal16+0x9bb>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9d2f <.literal16+0x9bf>
+ DB 127,67 ; jg 9b9f <.literal16+0x9bf>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9d33 <.literal16+0x9c3>
+ DB 127,67 ; jg 9ba3 <.literal16+0x9c3>
DB 0,0 ; add %al,(%eax)
DB 0,195 ; add %al,%bl
DB 0,0 ; add %al,(%eax)
@@ -48923,16 +48404,16 @@ ALIGN 16
DB 128,3,62 ; addb $0x3e,(%ebx)
DB 31 ; pop %ds
DB 215 ; xlat %ds:(%ebx)
- DB 118,63 ; jbe 9db3 <.literal16+0xa43>
+ DB 118,63 ; jbe 9c23 <.literal16+0xa43>
DB 31 ; pop %ds
DB 215 ; xlat %ds:(%ebx)
- DB 118,63 ; jbe 9db7 <.literal16+0xa47>
+ DB 118,63 ; jbe 9c27 <.literal16+0xa47>
DB 31 ; pop %ds
DB 215 ; xlat %ds:(%ebx)
- DB 118,63 ; jbe 9dbb <.literal16+0xa4b>
+ DB 118,63 ; jbe 9c2b <.literal16+0xa4b>
DB 31 ; pop %ds
DB 215 ; xlat %ds:(%ebx)
- DB 118,63 ; jbe 9dbf <.literal16+0xa4f>
+ DB 118,63 ; jbe 9c2f <.literal16+0xa4f>
DB 246,64,83,63 ; testb $0x3f,0x53(%eax)
DB 246,64,83,63 ; testb $0x3f,0x53(%eax)
DB 246,64,83,63 ; testb $0x3f,0x53(%eax)
@@ -48961,11 +48442,11 @@ ALIGN 16
DB 128,59,0 ; cmpb $0x0,(%ebx)
DB 0,127,67 ; add %bh,0x43(%edi)
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9e2b <.literal16+0xabb>
+ DB 127,67 ; jg 9c9b <.literal16+0xabb>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9e2f <.literal16+0xabf>
+ DB 127,67 ; jg 9c9f <.literal16+0xabf>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg 9e33 <.literal16+0xac3>
+ DB 127,67 ; jg 9ca3 <.literal16+0xac3>
DB 255,0 ; incl (%eax)
DB 0,0 ; add %al,(%eax)
DB 0,0 ; add %al,(%eax)
@@ -49011,17 +48492,8 @@ ALIGN 16
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
DB 63 ; aas
- DB 255,0 ; incl (%eax)
- DB 0,0 ; add %al,(%eax)
- DB 255,0 ; incl (%eax)
- DB 0,0 ; add %al,(%eax)
- DB 255,0 ; incl (%eax)
- DB 0,0 ; add %al,(%eax)
- DB 255,0 ; incl (%eax)
+ DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%eax)
- DB 129,128,128,59,129,128,128,59,129,128; addl $0x80813b80,-0x7f7ec480(%eax)
- DB 128,59,129 ; cmpb $0x81,(%ebx)
- DB 128,128,59,0,248,0,0 ; addb $0x0,0xf8003b(%eax)
DB 0,248 ; add %bh,%al
DB 0,0 ; add %al,(%eax)
DB 0,248 ; add %bh,%al
@@ -49036,13 +48508,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%edi)
DB 8,33 ; or %ah,(%ecx)
DB 132,55 ; test %dh,(%edi)
- DB 224,7 ; loopne 9ec9 <.literal16+0xb59>
+ DB 224,7 ; loopne 9d19 <.literal16+0xb39>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9ecd <.literal16+0xb5d>
+ DB 224,7 ; loopne 9d1d <.literal16+0xb3d>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9ed1 <.literal16+0xb61>
+ DB 224,7 ; loopne 9d21 <.literal16+0xb41>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9ed5 <.literal16+0xb65>
+ DB 224,7 ; loopne 9d25 <.literal16+0xb45>
DB 0,0 ; add %al,(%eax)
DB 33,8 ; and %ecx,(%eax)
DB 2,58 ; add (%edx),%bh
@@ -49088,13 +48560,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%edi)
DB 8,33 ; or %ah,(%ecx)
DB 132,55 ; test %dh,(%edi)
- DB 224,7 ; loopne 9f39 <.literal16+0xbc9>
+ DB 224,7 ; loopne 9d89 <.literal16+0xba9>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9f3d <.literal16+0xbcd>
+ DB 224,7 ; loopne 9d8d <.literal16+0xbad>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9f41 <.literal16+0xbd1>
+ DB 224,7 ; loopne 9d91 <.literal16+0xbb1>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9f45 <.literal16+0xbd5>
+ DB 224,7 ; loopne 9d95 <.literal16+0xbb5>
DB 0,0 ; add %al,(%eax)
DB 33,8 ; and %ecx,(%eax)
DB 2,58 ; add (%edx),%bh
@@ -49140,13 +48612,13 @@ ALIGN 16
DB 132,55 ; test %dh,(%edi)
DB 8,33 ; or %ah,(%ecx)
DB 132,55 ; test %dh,(%edi)
- DB 224,7 ; loopne 9fa9 <.literal16+0xc39>
+ DB 224,7 ; loopne 9df9 <.literal16+0xc19>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9fad <.literal16+0xc3d>
+ DB 224,7 ; loopne 9dfd <.literal16+0xc1d>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9fb1 <.literal16+0xc41>
+ DB 224,7 ; loopne 9e01 <.literal16+0xc21>
DB 0,0 ; add %al,(%eax)
- DB 224,7 ; loopne 9fb5 <.literal16+0xc45>
+ DB 224,7 ; loopne 9e05 <.literal16+0xc25>
DB 0,0 ; add %al,(%eax)
DB 33,8 ; and %ecx,(%eax)
DB 2,58 ; add (%edx),%bh
@@ -49188,13 +48660,13 @@ ALIGN 16
DB 248 ; clc
DB 65 ; inc %ecx
DB 0,0 ; add %al,(%eax)
- DB 124,66 ; jl a046 <.literal16+0xcd6>
+ DB 124,66 ; jl 9e96 <.literal16+0xcb6>
DB 0,0 ; add %al,(%eax)
- DB 124,66 ; jl a04a <.literal16+0xcda>
+ DB 124,66 ; jl 9e9a <.literal16+0xcba>
DB 0,0 ; add %al,(%eax)
- DB 124,66 ; jl a04e <.literal16+0xcde>
+ DB 124,66 ; jl 9e9e <.literal16+0xcbe>
DB 0,0 ; add %al,(%eax)
- DB 124,66 ; jl a052 <.literal16+0xce2>
+ DB 124,66 ; jl 9ea2 <.literal16+0xcc2>
DB 0,240 ; add %dh,%al
DB 0,0 ; add %al,(%eax)
DB 0,240 ; add %dh,%al
@@ -49328,13 +48800,13 @@ ALIGN 16
DB 136,136,61,137,136,136 ; mov %cl,-0x777776c3(%eax)
DB 61,137,136,136,61 ; cmp $0x3d888889,%eax
DB 0,0 ; add %al,(%eax)
- DB 112,65 ; jo a1d5 <.literal16+0xe65>
+ DB 112,65 ; jo a025 <.literal16+0xe45>
DB 0,0 ; add %al,(%eax)
- DB 112,65 ; jo a1d9 <.literal16+0xe69>
+ DB 112,65 ; jo a029 <.literal16+0xe49>
DB 0,0 ; add %al,(%eax)
- DB 112,65 ; jo a1dd <.literal16+0xe6d>
+ DB 112,65 ; jo a02d <.literal16+0xe4d>
DB 0,0 ; add %al,(%eax)
- DB 112,65 ; jo a1e1 <.literal16+0xe71>
+ DB 112,65 ; jo a031 <.literal16+0xe51>
DB 255,0 ; incl (%eax)
DB 0,0 ; add %al,(%eax)
DB 255,0 ; incl (%eax)
@@ -49365,19 +48837,19 @@ ALIGN 16
DB 128,59,129 ; cmpb $0x81,(%ebx)
DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%eax)
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a24b <.literal16+0xedb>
+ DB 127,67 ; jg a09b <.literal16+0xebb>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a24f <.literal16+0xedf>
+ DB 127,67 ; jg a09f <.literal16+0xebf>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a253 <.literal16+0xee3>
+ DB 127,67 ; jg a0a3 <.literal16+0xec3>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a257 <.literal16+0xee7>
+ DB 127,67 ; jg a0a7 <.literal16+0xec7>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a25b <.literal16+0xeeb>
+ DB 127,67 ; jg a0ab <.literal16+0xecb>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a25f <.literal16+0xeef>
+ DB 127,67 ; jg a0af <.literal16+0xecf>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a263 <.literal16+0xef3>
+ DB 127,67 ; jg a0b3 <.literal16+0xed3>
DB 255,0 ; incl (%eax)
DB 0,0 ; add %al,(%eax)
DB 255,0 ; incl (%eax)
@@ -49408,11 +48880,11 @@ ALIGN 16
DB 128,59,129 ; cmpb $0x81,(%ebx)
DB 128,128,59,0,0,127,67 ; addb $0x43,0x7f00003b(%eax)
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a2cb <.literal16+0xf5b>
+ DB 127,67 ; jg a11b <.literal16+0xf3b>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a2cf <.literal16+0xf5f>
+ DB 127,67 ; jg a11f <.literal16+0xf3f>
DB 0,0 ; add %al,(%eax)
- DB 127,67 ; jg a2d3 <.literal16+0xf63>
+ DB 127,67 ; jg a123 <.literal16+0xf43>
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%eax)
DB 0,0 ; add %al,(%eax)
DB 0,128,0,0,0,128 ; add %al,-0x80000000(%eax)
@@ -49511,13 +48983,13 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 255 ; (bad)
- DB 127,71 ; jg a3fb <.literal16+0x108b>
+ DB 127,71 ; jg a24b <.literal16+0x106b>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg a3ff <.literal16+0x108f>
+ DB 127,71 ; jg a24f <.literal16+0x106f>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg a403 <.literal16+0x1093>
+ DB 127,71 ; jg a253 <.literal16+0x1073>
DB 0,255 ; add %bh,%bh
- DB 127,71 ; jg a407 <.literal16+0x1097>
+ DB 127,71 ; jg a257 <.literal16+0x1077>
DB 0,0 ; add %al,(%eax)
DB 128,63,0 ; cmpb $0x0,(%edi)
DB 0,128,63,0,0,128 ; add %al,-0x7fffffc1(%eax)
@@ -49625,7 +49097,7 @@ ALIGN 16
DB 192,45,16,17,192,45,16 ; shrb $0x10,0x2dc01110
DB 17,192 ; adc %eax,%eax
DB 45,16,17,192,18 ; sub $0x12c01110,%eax
- DB 120,57 ; js a50c <.literal16+0x119c>
+ DB 120,57 ; js a35c <.literal16+0x117c>
DB 64 ; inc %eax
DB 18,120,57 ; adc 0x39(%eax),%bh
DB 64 ; inc %eax
@@ -49818,11 +49290,11 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 128,63,114 ; cmpb $0x72,(%edi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt a6f2 <.literal16+0x1382>
+ DB 62,114,28 ; jb,pt a542 <.literal16+0x1362>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a6f6 <.literal16+0x1386>
+ DB 62,114,28 ; jb,pt a546 <.literal16+0x1366>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a6fa <.literal16+0x138a>
+ DB 62,114,28 ; jb,pt a54a <.literal16+0x136a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%edi)
DB 170 ; stos %al,%es:(%edi)
@@ -49901,13 +49373,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%edi)
DB 0,192 ; add %al,%al
DB 63 ; aas
- DB 114,28 ; jb a7be <.literal16+0x144e>
+ DB 114,28 ; jb a60e <.literal16+0x142e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a7c2 <.literal16+0x1452>
+ DB 62,114,28 ; jb,pt a612 <.literal16+0x1432>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a7c6 <.literal16+0x1456>
+ DB 62,114,28 ; jb,pt a616 <.literal16+0x1436>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a7ca <.literal16+0x145a>
+ DB 62,114,28 ; jb,pt a61a <.literal16+0x143a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%edi)
DB 170 ; stos %al,%es:(%edi)
@@ -49928,11 +49400,11 @@ ALIGN 16
DB 0,0 ; add %al,(%eax)
DB 128,63,114 ; cmpb $0x72,(%edi)
DB 28,199 ; sbb $0xc7,%al
- DB 62,114,28 ; jb,pt a802 <.literal16+0x1492>
+ DB 62,114,28 ; jb,pt a652 <.literal16+0x1472>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a806 <.literal16+0x1496>
+ DB 62,114,28 ; jb,pt a656 <.literal16+0x1476>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a80a <.literal16+0x149a>
+ DB 62,114,28 ; jb,pt a65a <.literal16+0x147a>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%edi)
DB 170 ; stos %al,%es:(%edi)
@@ -50011,13 +49483,13 @@ ALIGN 16
DB 192,63,0 ; sarb $0x0,(%edi)
DB 0,192 ; add %al,%al
DB 63 ; aas
- DB 114,28 ; jb a8ce <.literal16+0x155e>
+ DB 114,28 ; jb a71e <.literal16+0x153e>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a8d2 <_sk_callback_sse2+0x164f>
+ DB 62,114,28 ; jb,pt a722 <_sk_callback_sse2+0x162c>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a8d6 <_sk_callback_sse2+0x1653>
+ DB 62,114,28 ; jb,pt a726 <_sk_callback_sse2+0x1630>
DB 199 ; (bad)
- DB 62,114,28 ; jb,pt a8da <_sk_callback_sse2+0x1657>
+ DB 62,114,28 ; jb,pt a72a <_sk_callback_sse2+0x1634>
DB 199 ; (bad)
DB 62,171 ; ds stos %eax,%es:(%edi)
DB 170 ; stos %al,%es:(%edi)
diff --git a/src/jumper/SkJumper_stages.cpp b/src/jumper/SkJumper_stages.cpp
index 94dd2b5428..b9ed31c231 100644
--- a/src/jumper/SkJumper_stages.cpp
+++ b/src/jumper/SkJumper_stages.cpp
@@ -207,7 +207,7 @@ SI void from_8888(U32 _8888, F* r, F* g, F* b, F* a) {
}
template <typename T>
-SI U32 ix_and_ptr(T** ptr, const SkJumper_GatherCtx* ctx, F x, F y) {
+SI U32 ix_and_ptr(T** ptr, const SkJumper_MemoryCtx* ctx, F x, F y) {
*ptr = (const T*)ctx->pixels;
return trunc_(y)*ctx->stride + trunc_(x);
}
@@ -846,14 +846,6 @@ STAGE(gather_g8) {
a = 1.0f;
}
-STAGE(gather_i8) {
- auto c = (const SkJumper_GatherCtx*)ctx;
- const uint8_t* ptr;
- U32 ix = ix_and_ptr(&ptr, ctx, r,g);
- ix = expand(gather(ptr, ix));
- from_8888(gather(c->ctable, ix), &r,&g,&b,&a);
-}
-
STAGE(load_565) {
auto ptr = *(const uint16_t**)ctx + x;
@@ -927,8 +919,8 @@ STAGE(store_8888) {
}
STAGE(store_8888_2d) {
- auto c = (const SkJumper_PtrStride*)ctx;
- auto ptr = (uint32_t*)c->ptr + y*c->stride + x;
+ auto c = (const SkJumper_MemoryCtx*)ctx;
+ auto ptr = (uint32_t*)c->pixels + y*c->stride + x;
U32 px = round(r, 255.0f)
| round(g, 255.0f) << 8
diff --git a/src/shaders/SkImageShader.cpp b/src/shaders/SkImageShader.cpp
index 5eca3a4990..35289127b0 100644
--- a/src/shaders/SkImageShader.cpp
+++ b/src/shaders/SkImageShader.cpp
@@ -300,10 +300,9 @@ bool SkImageShader::onAppendStages(SkRasterPipeline* p, SkColorSpace* dstCS, SkA
misc->paint_color = SkColor4f_from_SkColor(paint.getColor(), dstCS);
p->append_matrix(alloc, matrix);
- auto gather = alloc->make<SkJumper_GatherCtx>();
- gather->pixels = pm.addr();
- gather->ctable = nullptr; // TODO: remove this field
- gather->stride = pm.rowBytesAsPixels();
+ auto gather = alloc->make<SkJumper_MemoryCtx>();
+ gather->pixels = pm.writable_addr(); // Don't worry, we won't write to it.
+ gather->stride = pm.rowBytesAsPixels();
auto limit_x = alloc->make<SkJumper_TileCtx>(),
limit_y = alloc->make<SkJumper_TileCtx>();
diff --git a/tests/SkRasterPipelineTest.cpp b/tests/SkRasterPipelineTest.cpp
index db4d5a34fc..8edff7e061 100644
--- a/tests/SkRasterPipelineTest.cpp
+++ b/tests/SkRasterPipelineTest.cpp
@@ -246,7 +246,7 @@ DEF_TEST(SkRasterPipeline_2d, r) {
SkMatrix::MakeTrans(-0.5f, -0.5f)));
// Write out to rgba, with row stride = 2 pixels.
- SkJumper_PtrStride ctx = { rgba, 2 };
+ SkJumper_MemoryCtx ctx = { rgba, 2 };
p.append(SkRasterPipeline::store_8888_2d, &ctx);
p.run_2d(0,0, 2,2);